NVIDIA合作伙伴提供经验证的可扩展型AI系统。
大多数数据中心在设计的时候都未曾考虑到人工智能的爆炸性增长和独特需求。
但NVIDIA DGX POD为每个想要优化其计算、存储和网络基础设施的数据中心架构师提供了发展蓝图,以应对AI融合型应用的增长浪潮。
包括Arista、思科、DDN、Dell EMC、IBM Storage、Mellanox、NetApp和Pure Storage等在内的业内数据中心领导者已围绕DGX POD,推出了基于其各自特有技术的相关产品。
机器学习和深度学习曾经仅是学术实验室里的科学项目。而如今它们已成为主流功能,帮助企业实现降本增效。
但提升投资回报意味着需要具有扩展性的AI-ready数据中心。许多机构之所以无法做到,原因很简单,就是因为AI工作负载消耗的资源之大是其他重要任务无法相比的。
SATURNV是NVIDIA基于NVIDIA DGX系统构建的一台大型基础设施,我们基于此设施执行了一些最重要、最具突破性的工作。实际上,我们最近借助一套基于NVIDIA DGX-2的配置在MLPerf基准测试中创下了六项AI性能记录。这套系统是我们使用SATURNV所遵循的设计原则和架构,在短短三周内就打造而成的。
Arista、思科、DDN、Dell EMC、IBM Storage、Mellanox、NetApp和Pure Storage都基于NVIDIA DGX,提供了统包型基础设施解决方案。这些集成系统为客户提供了经验证的方法,能够配合其数据中心技术合作伙伴使用。当然,每个企业都能够建立自己的SATURNV,以满足各自的需求。
本周在GTC期间,我们的生态系统合作伙伴都发布了有关DGX POD的重大新闻:
建立在DGX POD之上是实现大规模AI的重要因素。对于那些没有数据中心或资本支出的人来说,现在有一个好消息能使其快速实现。越来越多的数据中心托管服务提供商很清楚如何协助您从计划走向投产。
他们每个都经过认证,具备托管DGX基础设施的能力。他们可通过一个极具吸引力的外包运营支出模型来运行基于DGX POD构建的AI基础架构,消除设施和资本预算之间的鸿沟。
好文章,需要你的鼓励
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。