这些系统今天在该公司于洛杉矶举办的合作伙伴活动上首次亮相。
第一个新产品系列是UCS C885A M8系列,包括可容纳多达八个图形处理器的服务器。思科提供了三种图形处理器选择:由英伟达提供的H100和H200,以及竞争对手AMD的MI300X芯片。
UCS C885A M8机器中的每块图形卡都有自己的网络接口控制器(NIC)。这是一种专用芯片,充当服务器与所连接网络之间的中介。思科提供两种英伟达网卡供用户选择:ConnectX-7或BlueField-3,后者是一种所谓的超级网卡(SuperNIC),带有附加组件,可加快数据流量加密等任务的速度。
思科还为其新服务器配备了BlueField-3芯片。这些芯片是所谓的数据处理单元(DPU),同样由英伟达制造。它们加快了管理服务器所连接的网络和存储基础设施的一些任务。
一对AMD中央处理器执行服务器专用芯片无法完成的计算。客户可以选择该芯片制造商最新的第五代 CPU 或其 2022 服务器处理器产品。
思科在首次推出服务器系列的同时,还推出了四款所谓的AI POD。据 TechTarget 报道,这是一种大型数据中心设备,最多可集成16块英伟达显卡、网络设备和其他支持组件。客户可以选择添加更多硬件,特别是NetApp或Pure Storage公司的存储设备。
在软件方面,AI Pods附带 Nvidia AI Enterprise 许可证。这是一套预先打包好的人工智能模型和工具,企业可以用它来训练自己的神经网络。此外还有一些更专业的组件,如Nvidia Morpheus 框架,它可以用来构建人工智能驱动的网络安全软件。
该套件还辅以其他两个软件产品:HPC-X和Red Hat OpenShift。HPC-X是英伟达开发的一款工具包,可帮助客户优化为其人工智能集群提供动力的网络。OpenShift则是一个平台,可简化构建和部署容器应用的任务。
思科首席产品官 Jeetu Patel 表示:“企业客户面临着部署人工智能工作负载的压力,尤其是在我们向代理工作流迈进以及人工智能开始独立解决问题的时候。”“思科的创新,如AI POD和GPU服务器,加强了这些工作负载的安全性、合规性和处理能力。”
思科将在下个月提供 AI Pods 订购服务。而 UCS C885A M8 服务器系列现在就可以订购,并将在年底前开始向客户发货。
好文章,需要你的鼓励
在2025年KubeCon/CloudNativeCon北美大会上,云原生开发社区正努力超越AI炒作,理性应对人工智能带来的风险与机遇。随着开发者和运营人员广泛使用AI工具构建AI驱动的应用功能,平台工程迎来复兴。CNCF推出Kubernetes AI认证合规程序,为AI工作负载在Kubernetes上的部署设定开放标准。会议展示了网络基础设施层优化、AI辅助开发安全性提升以及AI SRE改善可观测性工作流等创新成果。
香港大学研究团队提出LightReasoner框架,通过让小型"业余"模型与大型"专家"模型对比,识别关键推理步骤并转化为训练信号。该方法在数学推理任务上实现28.1%性能提升,同时将训练时间、样本需求和词元使用量分别减少90%、80%和99%,完全无需人工标注。研究颠覆了传统训练思路,证明通过模型间行为差异可以实现高效的自监督学习,为资源受限环境下的AI能力提升提供了新路径。
DeepL作为欧洲AI领域的代表企业,正将业务拓展至翻译之外,推出面向企业的AI代理DeepL Agent。CEO库蒂洛夫斯基认为,虽然在日常翻译场景面临更多竞争,但在关键业务级别的企业翻译需求中,DeepL凭借高精度、质量控制和合规性仍具优势。他对欧盟AI法案表示担忧,认为过度监管可能阻碍创新,使欧洲在全球AI竞争中落后。
马里兰大学研究团队开发了MONKEY适配器,一种无需额外训练的AI绘画控制技术。该方法通过"两步走"策略解决了个性化AI绘画中主体保真与背景控制难以兼得的问题:先让AI识别主体区域生成"透明胶片",再在第二次生成中让主体区域听从参考图片、背景区域听从文字描述。实验证明该方法在保持主体特征和响应文字要求两方面均表现出色,为AI绘画的精细化控制提供了新思路。