美国俄亥俄州超级计算机中心(OSC)正在建立造一个用于人工智能应用的新高性能计算集群,该集群基于戴尔硬件,配备了AMD Epyc处理器和Nvidia GPU加速器。
该新高性能计算集群名为Ascend,将在今年晚些时候推出,主打支持OSC的人工智能、机器学习、大数据和数据分析工作,OSC是坊间知名的公私合作和工业高性能计算机构。据OSC称,Ascend将和旗下现有的Pitzer 和 Owens计算集群合在一起,整个设施的人工智能、建模和模拟能力可提高两倍。
据OSC中心副主任Doug Johnson表示,在过去几年里,OSC对GPU资源的需求不断增长,因此Ascend将是OSC的第一个完全致力于提供基于GPU密集处理能力的计算集群。
他表示,“建立一个专注于快速分析非常大的数据集的集群,进而提供我们目前的系统上不能运行的人工智能机器学习应用以及一些需要最快GPU的模拟,OSC将可以更好地满足这些客户的需求,同时确保迅速处理我们现有集群Pitzer 和 Owens的请求。”
新集群的硬件包括24个戴尔PowerEdge XE8545服务器节点,配有4U机架式系统及双AMD Eypc第三代处理器。每个节点将配置四个Nvidia A100 80GB GPU,并与Nvidia Quantum HDR 200Gbps网络互连。
Ascend网站目前参与了两个美国国家科学基金会资助的项目,两个项目旨在推进人工智能工作。第一个项目是智能网络基础设施与环境计算学习人工智能研究所(ICICLE),该研究所由俄亥俄州立大学领头,旨在开发下一代网络基础设施,重点放在人工智能的普及。
第二个项目是将于今年举行的“网络基础设施(CI)专业人员AI训练营”,该训练营的焦点是在全国范围内的诸如OSC一类的研究计算设施培养其工作人员的人工智能技能。
OSC的研究软件应用主管Karen Tomko表示,Ascend将为ICICLE研究团队提供探索和开发新的人工智能技术方面最先进的资源,同时也令OSC自己的员工有机会增加对人工智能工作负载的了解以及支持该增长领域的最佳实践。
Ascend将可以通过OSC的OnDemand门户网站访问,而该网站的客户服务团队将评估在该集群上运行项目的请求。OSC表示将在今年夏天给出Ascend推出日期和可用性的更详细时间表。
好文章,需要你的鼓励
Arelion升级其斯堪的纳维亚网络,连接超大规模数据中心以支持该地区蓬勃发展的AI市场。该网络基于1.6Tbps波长和可扩展400G相干可插拔光学技术,在奥斯陆、斯德哥尔摩和哥本哈根之间构建AI"超级高速公路"。升级将为企业客户提供增强的全球互联网骨干网接入和多样化连接服务。预计2025年第二季度末完成,并计划在2025年剩余时间及2026年继续投资。
这项由香港科技大学领导的研究首次建立了大语言模型安全守护栏的系统性评估框架。研究团队对13种主流守护栏进行了全面测试,提出了六维分类体系和SEU三维评估标准,揭示了不同守护栏在安全性、效率和实用性方面的权衡关系,为AI安全防护技术的选择和部署提供了科学指导。
CloudBees首席执行官Anuj Kapur表示,AI可能重新测试DevOps的基础假设,但警告不要为追求效率而创建黑盒代码。他指出,一些因担心错失机会而匆忙采用AI生成代码的客户正开始放缓步伐,变得更加谨慎。Kapur认为,将整代软件外包给提示工程将创建非人类生成的黑盒代码,虽然效率高但质量、测试覆盖率和漏洞问题值得担忧。
南加州大学研究团队开发出一种名为PILS的新技术,能够通过分析AI模型输出时的概率信息来破解隐藏的系统指令。这种方法通过观察AI生成文本过程中多个步骤的"思考轨迹",将隐藏提示的恢复成功率提高了2-3.5倍。研究发现AI模型的概率输出存在于低维空间中,可以用数学方法进行压缩和逆向分析。这项发现对AI安全具有重要影响,揭示了当前依赖隐藏指令的安全机制可能存在漏洞,为AI安全防护提出了新挑战。