英特尔公司今天宣布,该公司帮助美国能源部建造的超大规模超级计算机Aurora的所有计算模块已经安装完毕。
该系统是能源部、英特尔和HPE公司三方的合作。它位于Argonne国家实验室。科学家们将使用该系统运行人工智能模型、模拟和大规模数据分析应用。
预计今年晚些时候,Aurora的理论峰值性能将超过2 exaflops。这将使它的速度几乎达到世界目前运行最快的超级计算机(即能源部另一个名为Frontier的系统)的两倍。一个exaflop等于每秒10亿次的计算。
Argonne国家实验室的实验室副主任Rick Stevens表示:“在我们努力进行验收测试的同时,我们将使用Aurora来训练一些科学方面的大规模开源生成式人工智能模型。”“Aurora拥有超过6万个英特尔Max GPU,一个非常快的I/O系统和一个全固态大容量存储系统,是训练这些模型的完美环境。”
Aurora由10,624个被称为刀片的计算模块组成。这些刀片每个重70磅,在166个冰箱大小的机柜里运行。完全组装好的系统所占的空间相当于两个专业篮球场。
每个Aurora刀片包括两个来自英特尔至强Max系列CPU芯片的中央处理单元。还有六个英特尔Max系列GPU显卡。这些处理器由内存芯片、网络设备和内置在每个刀片中的冷却装置支持。
英特尔的Xeon Max系列CPU芯片基于10纳米架构。它们针对人工智能模型等工作负载进行了优化,这些模型需要频繁地将数据移入和移出内存的能力。为了加速此类工作负载,这些CPU采用了一种被称为HBM的高速内存,这在英特尔之前的芯片中是没有的。
英特尔的Max系列GPU,构成了Aurora的另一个核心构件,也针对AI工作负载进行了优化。显卡表达计算的语言被称为指令集。英特尔Max系列GPU的指令集专门针对矩阵乘法,即人工智能模型用来处理数据的数学运算。
这些芯片还包括多达128个光线追踪单元。光线追踪是一种渲染照明和阴影效果的方法。据英特尔称,该技术加快了科学应用的数据可视化功能。
总体而言,Aurora具有21248个CPU和63744个显卡。这使得它成为世界上最大的GPU集群。这些芯片由一个220PB的对象存储池支持,Aurora将用来存储科学应用的数据。
充分利用Aurora的性能需要研究人员专门为该系统优化应用。为了减轻这一任务,能源部已经创建了一个名为Sunspot的缩微版Aurora。它提供了一个环境,研究人员可以在其中测试不同的软件优化方法。
截至今年早些时候,有十多个研究小组正在使用该系统。一旦Aurora开始运行,这些团队将开始从Sunspot转移代码。早期的Aurora用户将侧重确定在第一批生产应用可以部署之前可能必须解决的所有技术问题。
好文章,需要你的鼓励
Anthropic发布了面向成本敏感用户的Claude Haiku 4.5大语言模型,定价为每百万输入令牌1美元,输出令牌5美元,比旗舰版Sonnet 4.5便宜三倍。该模型采用混合推理架构,可根据需求调整计算资源,支持多模态输入最多20万令牌。在八项基准测试中,性能仅比Sonnet 4.5低不到10%,但在编程和数学任务上超越了前代Sonnet 4。模型响应速度比Sonnet 4快两倍以上,适用于客服聊天机器人等低延迟应用场景。
字节跳动发布Seedream 4.0多模态图像生成系统,实现超10倍速度提升,1.4秒可生成2K高清图片。该系统采用创新的扩散变换器架构,统一支持文字生成图像、图像编辑和多图合成功能,在两大国际竞技场排行榜均获第一名,支持4K分辨率输出,已集成至豆包、剪映等平台,为内容创作带来革命性突破。
英国初创公司Nscale将为微软建设四个AI数据中心,总计部署约20万个GPU,合同价值高达240亿美元。首个数据中心将于明年在葡萄牙开建,配备1.26万个GPU。德州数据中心规模最大,将部署10.4万个GPU,容量从240兆瓦扩展至1.2吉瓦。所有设施将采用英伟达最新Blackwell Ultra显卡。
红帽公司研究团队提出危险感知系统卡(HASC)框架,为AI系统建立类似"体检报告"的透明度文档,记录安全风险、防护措施和问题修复历史。同时引入ASH识别码系统,为AI安全问题建立统一标识。该框架支持自动生成和持续更新,与ISO/IEC 42001标准兼容,旨在平衡透明度与商业竞争,建立更可信的AI生态系统,推动行业协作和标准化。