计算机图形芯片制造商Nvidia正在为新型超级计算机铺平道路,宣布其人工智能和高性能计算基础设施将很快支持基于Arm的CPU。
Nvidia今天早些时候表示,自己的CUDA-X AI和HPC库、GPU加速AI框架和软件开发工具将在今年年底前支持基于Arm的设备。这是重要一步,因为基于Arm的超级计算机由于具有更高功效而能够支持更大的规模。
Nvidia首席执行官黄仁勋表示:“随着传统计算扩展的结束,电力将成为限制所有超级计算机的一个因素。Nvidia的CUDA加速计算和Arm高能效CPU架构相结合,将为高性能计算领域提供一个提升突破百亿亿级性能的机会。”
Nvidia加速计算总经理兼副总裁在新闻发布会上表示,之所以决定支持基于Arm的CPU是因为他们对这个领域有着广泛而越来越浓厚的兴趣。”
“Arm吸引人之处在于它是非常开放的,它提供的灵活性可以连接CPU和GPU,实现更高能效的计算。”
由于Nvidia的寄出设施支持x86和基于POWER的计算机芯片,因此全球25个最节能的超级计算机中已经有22个采用了Nvidia的基础设施。Nvidia希望凭借对Arm芯片的支持提升自己的高性能计算领域的地位,支持更高级的人工智能工作负载。
Nvidia还希望将超级计算能力扩展到特定用途,例如为自动驾驶汽车训练AI系统。
为此,Nvidia在今天推出了所谓号称全球第22快的超级计算机——DGX SuperPOD,以及一个参考架构,面向那些希望将这个超级计算机部署在他们自己数据中心内部或者外部的企业。
Nvidia表示,DGX SuperPOD旨在提供部署大量自动驾驶车辆所需的AI训练基础设施。该系统可以三周之内部署完成,由96个Nvidia旧款DGX-2H超级计算机组成,这些超级计算机采用新的数据中心互连技术(今年早些时候收购Mellanox获得的技术)进行集成。
Nvidia表示,DGX SuperPOD旨在为自动驾驶汽车训练神经网络,使车辆可以了解“道路规则”,并提供每秒9.4 petaflops的性能,这个数字令人惊讶——以至于可以把对主流图像分类ResNet-50 AI算法的训练时间从25天缩短到不到2分钟。
Nvidia人工智能基础设施副总裁Clement Farabet在声明中表示:“要在人工智能领域占据领先地位,就需要在计算基础设施领域占据领先地位。很少有人工智能方面的挑战像训练自动驾驶汽车这样苛刻,需要对神经网络进行数万次的反复训练,以满足极高精确度的要求。”
好文章,需要你的鼓励
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。