Tensor Core GPU在每一项MLPerf基准测试结果中均实现最佳表现;用户可通过NGC使用加速堆栈。
在最新公布的业内首套人工智能基准测试中,NVIDIA创下6项人工智能性能记录。
在谷歌、英特尔、百度、NVIDIA及其他数十家科技行业领军企业的支持下,新型基准测试套件MLPerf可测定一系列深度学习工作负载。该套件涵盖了计算机视觉、语言翻译、个性化推荐以及强化学习任务等领域,旨在成为业内首个客观的人工智能基准测试套件。
NVIDIA在其提交的6个MLPerf基准测试结果中均取得了最佳表现。这些测试涵盖了多种工作负载和基础架构规模 – 从单节点上的16颗GPU到跨80节点上的多达640颗GPU。
这些测试分为6大类别,分别为图像分类、对象实例分割、目标检测、临时翻译、复发性翻译与推荐系统。NVIDIA并未提交第7类别,即强化学习的基准测试,原因是该类别尚未充分利用到GPU加速。
NVIDIA在语言翻译这一关键基准测试类别中表现尤为出色,仅需6.2分钟即完成了Transformer神经网络的训练。
NVIDIA工程师利用NVIDIA DGX系统实现了这些测试结果。该系统包括全球最强大的人工智能系统NVIDIA DGX-2,搭载了16颗完全连接的V100 Tensor Core GPU。
NVIDIA是唯一一家参与多达6项基准测试的科技公司,充分展现出V100 Tensor Core GPU在部署人工智能工作负载方面的通用性。
NVIDIA副总裁兼加速计算总经理Ian Buck表示:“全新基准MLPerf展示了NVIDIA Tensor Core GPU非凡的性能与通用性。我们的Tensor Core GPU拥有高性价比,且可通过各地的云服务提供商及电脑制造商实现供货,进而帮助世界各地的开发人员在开发过程中的每一个阶段推进人工智能的应用。”
要想在复杂多样的计算工作负载中实现优异性能,不仅仅需要出色的芯片。加速计算也不单单与加速器有关,还需要实现全堆栈创新。
NVIDIA堆栈包括NVIDIA Tensor Cores、NVLink、NVSwitch、DGX系统、CUDA、cuDNN、NCCL、经过优化的深度学习框架容器以及NVIDIA软件开发套件。
NVIDIA的人工智能平台是最便捷且高性价比的选择。Tensor Core GPU可通过各地的云服务提供商及电脑制造商实现供货。
借助售价仅为2500美元的超强桌面级GPU——NVIDIA TITAN RTX,用户在桌面上也可实现相同的Tensor Core GPU强大功能。如果按照3年使用期来计算,该GPU每小时的费用仅相当于几美分。
通过NVIDIA GPU Cloud(NGC)云容器注册,用户可持续更新这些软件的加速堆栈。
用于实现NVIDIA业界领先的MLPerf性能的软件创新与优化,现可通过我们最新的NGC深度学习容器免费获取。
此容器包含经过NVIDIA优化的完整软件堆栈及顶级人工智能框架。18.11版本NGC深度学习容器包含了用于实现我们MLPerf基准测试结果的详细软件。
开发人员可将这些软件用于任意地点以及各大开发阶段:
如果您计划开展自己的人工智能项目,或者参与MLPerf基准测试,请通过NGC容器注册下载容器。
好文章,需要你的鼓励
最新数据显示,Windows 11市场份额已达50.24%,首次超越Windows 10的46.84%。这一转变主要源于Windows 10即将于2025年10月14日结束支持,企业用户加速迁移。一年前Windows 10份额还高达66.04%,而Windows 11仅为29.75%。企业多采用分批迁移策略,部分选择付费延长支持或转向Windows 365。硬件销售受限,AI PC等高端产品销量平平,市场份额提升更多来自系统升级而非新设备采购。
清华大学团队开发出LangScene-X系统,仅需两张照片就能重建完整的3D语言场景。该系统通过TriMap视频扩散模型生成RGB图像、法线图和语义图,配合语言量化压缩器实现高效特征处理,最终构建可进行自然语言查询的三维空间。实验显示其准确率比现有方法提高10-30%,为VR/AR、机器人导航、智能搜索等应用提供了新的技术路径。
新一代液态基础模型突破传统变换器架构,能耗降低10-20倍,可直接在手机等边缘设备运行。该技术基于线虫大脑结构开发,支持离线运行,无需云服务和数据中心基础设施。在性能基准测试中已超越同等规模的Meta Llama和微软Phi模型,为企业级应用和边缘计算提供低成本、高性能解决方案,在隐私保护、安全性和低延迟方面具有显著优势。
IntelliGen AI推出IntFold可控蛋白质结构预测模型,不仅达到AlphaFold 3同等精度,更具备独特的"可控性"特征。该系统能根据需求定制预测特定蛋白质状态,在药物结合亲和力预测等关键应用中表现突出。通过模块化适配器设计,IntFold可高效适应不同任务而无需重新训练,为精准医学和药物发现开辟了新路径。