计算机图形芯片制造商Nvidia正在为新型超级计算机铺平道路,宣布其人工智能和高性能计算基础设施将很快支持基于Arm的CPU。
Nvidia今天早些时候表示,自己的CUDA-X AI和HPC库、GPU加速AI框架和软件开发工具将在今年年底前支持基于Arm的设备。这是重要一步,因为基于Arm的超级计算机由于具有更高功效而能够支持更大的规模。
Nvidia首席执行官黄仁勋表示:“随着传统计算扩展的结束,电力将成为限制所有超级计算机的一个因素。Nvidia的CUDA加速计算和Arm高能效CPU架构相结合,将为高性能计算领域提供一个提升突破百亿亿级性能的机会。”
Nvidia加速计算总经理兼副总裁在新闻发布会上表示,之所以决定支持基于Arm的CPU是因为他们对这个领域有着广泛而越来越浓厚的兴趣。”
“Arm吸引人之处在于它是非常开放的,它提供的灵活性可以连接CPU和GPU,实现更高能效的计算。”
由于Nvidia的寄出设施支持x86和基于POWER的计算机芯片,因此全球25个最节能的超级计算机中已经有22个采用了Nvidia的基础设施。Nvidia希望凭借对Arm芯片的支持提升自己的高性能计算领域的地位,支持更高级的人工智能工作负载。
Nvidia还希望将超级计算能力扩展到特定用途,例如为自动驾驶汽车训练AI系统。
为此,Nvidia在今天推出了所谓号称全球第22快的超级计算机——DGX SuperPOD,以及一个参考架构,面向那些希望将这个超级计算机部署在他们自己数据中心内部或者外部的企业。
Nvidia表示,DGX SuperPOD旨在提供部署大量自动驾驶车辆所需的AI训练基础设施。该系统可以三周之内部署完成,由96个Nvidia旧款DGX-2H超级计算机组成,这些超级计算机采用新的数据中心互连技术(今年早些时候收购Mellanox获得的技术)进行集成。
Nvidia表示,DGX SuperPOD旨在为自动驾驶汽车训练神经网络,使车辆可以了解“道路规则”,并提供每秒9.4 petaflops的性能,这个数字令人惊讶——以至于可以把对主流图像分类ResNet-50 AI算法的训练时间从25天缩短到不到2分钟。
Nvidia人工智能基础设施副总裁Clement Farabet在声明中表示:“要在人工智能领域占据领先地位,就需要在计算基础设施领域占据领先地位。很少有人工智能方面的挑战像训练自动驾驶汽车这样苛刻,需要对神经网络进行数万次的反复训练,以满足极高精确度的要求。”
好文章,需要你的鼓励
美国连锁超市巨头Albertsons正在基于Databricks构建商品智能平台,整合产品、定价、促销与陈列等决策功能,目标是在2026年底前全面向门店运营商落地。该平台以Databricks Lakehouse存储零售数据,通过Unity Catalog与AI Gateway实现数据治理,并借助AI智能体Genie支持自然语言查询,帮助商家洞察销售趋势,提升决策效率。此举是Albertsons今年四项AI核心战略投资之一。
阿里Qwen团队通过引入强化学习和在线策略蒸馏,将Qwen-Image-2.0升级为Qwen-Image-2.0-RL,让图像生成模型真正学会人类审美,文生图Elo评分提升78分,图像编辑提升93分。
微软正将Windows 11打造成真正的AI操作系统。在Build大会上,微软展示了AI模型与智能代理如何深度融合进Windows 11,让用户通过自然语言完成系统操作。借助Windows ML框架,超过5亿台PC已可在本地离线运行AI任务,无需联网、无token费用、数据不离设备。Office、Photos、Teams等应用已支持本地AI能力,Adobe、WhatsApp、Canva等第三方也在积极跟进,企业级AI PC采购需求有望加速。
港科大与快手联合提出NormGuard,针对流匹配模型强化学习训练中速度范数膨胀问题,通过训练时单向惩罚约束,在保留奖励的同时改善图像真实感。