谷歌今天公布了对自定义计算的愿景,透露将采用“片上系统”(SoC)基础设施来取代传统主板作为关键集成点。
到目前为止,谷歌一直依靠“古老”的主板来集成自己的计算基础设施各个组件,包括其CPU、网络、存储设备、定制加速卡和内存。但是,当计算达到拐点时,就需要一种新的方法,谷歌系统基础设施副总裁Amit Vahdat在博客中这样表示。
Vahdat说:“与其将组件集成在用几英寸电线隔开的主板上,我们不如采用SoC设计,将多项功能集成到同一个芯片上,或者在一个封装内的多个芯片上。换句话说,SoC就是一种新型主板。”
Vahdat说,SoC有助于确保工作负载与底层硬件之间更深入的集成。他解释说,因为SoC上不同组件之间的延迟和带宽可以提高几个数量级,而与主板上组合单个ASIC相比,SoC的好处有降低功耗和降低成本等。
Vahdat说:“就像在主板上一样,各个功能单元(例如CPU、TPU、视频转码、加密、压缩、远程通信、安全数据汇总等)也来自不同的来源。我们可以按需购买,按需配置,构建让整个行业受益的生态系统。”
他透露,为了推动未来的SoC设计计划,谷歌已经聘请了前英特尔芯片设计师Uri Frank担任新的工程副总裁。Frank拥有超过25年的芯片设计经验,将领导位于以色列的一个新部门,负责设计谷歌的下一代计算基础设施。
Frank说:“谷歌已经设计并构建了一些全球最大、最高效的计算系统。长期以来,定制芯片一直是该策略的一个重要组成部分。”
Google在自研云计算基础设施芯片方面拥有悠久的历史。Vahdat举例说,2016年谷歌公布了第一批TPU,一种用于运行实时语音搜索、照片对象识别和交互式语言翻译等工作负载的专用CPU。他解释说,在运行这些任务方面,TPU的效率比英特尔和AMD的通用芯片高效得多,如果没有TPU,谷歌也就无法很好地提供这些服务。”
除了芯片,谷歌还开发了很多定制硬件,包括固态盘、硬盘驱动器、网络交换机和网络接口卡等。
Vahdat说,未来谷歌的SoC将使其能够设计更多专门针对单个应用的定制硬件,不过他坦言,要足够快速地开发以跟上当前所有不同云服务发展的步伐,还是相当挑战的。
“我们将与全球合作伙伴生态系统一起,继续在计算基础设施的领先优势上进行创新,提供目前其他厂商无法提供的下一代功能,并为下一波人类尚未设想的应用和服务创造沃土。”
好文章,需要你的鼓励
存储扩展专家Lucidity将其AutoScaler平台扩展至Kubernetes容器编排平台,帮助企业控制存储支出。该公司表示,Kubernetes中的持久卷常常成为隐形浪费源,虽然Kubernetes可自动扩展实例数量,但底层存储通常未被充分利用。新服务可为亚马逊EKS提供持久卷的自动扩缩容,声称可为客户节省高达70%的云块存储费用。
腾讯ARC实验室推出AudioStory系统,首次实现AI根据复杂指令创作完整长篇音频故事。该系统结合大语言模型的叙事推理能力与音频生成技术,通过交错式推理生成、解耦桥接机制和渐进式训练,能够将复杂指令分解为连续音频场景并保持整体连贯性。在AudioStory-10K基准测试中表现优异,为AI音频创作开辟新方向。
超过1.8万Spotify用户加入名为"Unwrapped"的集体组织,通过去中心化数据平台Vana将个人听歌数据打包出售给AI开发者。该组织已将1万用户的艺术家偏好数据以5.5万美元价格售出,用于构建新型流媒体数据分析工具。Spotify对此发出警告,称该行为违反开发者政策和商标权,禁止将平台数据用于机器学习模型构建。但Unwrapped团队坚持用户拥有控制和变现个人数据的权利,双方就数据所有权展开争议。
Meta与特拉维夫大学联合研发的VideoJAM技术,通过让AI同时学习外观和运动信息,显著解决了当前视频生成模型中动作不连贯、违反物理定律的核心问题。该技术仅需添加两个线性层就能大幅提升运动质量,在多项测试中超越包括Sora在内的商业模型,为AI视频生成的实用化应用奠定了重要基础。