至顶网服务器频道 11月20日 新闻消息: 近日,浪潮中标华中师范大学,将为其设计建造基于"NVLink+Volta"的千万亿次超级计算机,加速物理前沿科学和自动驾驶AI技术研究。
华中师范大学
这套系统将采用18套浪潮AGX-2超算服务器作为计算节点,配置144块Nvidia最新支持NvLink 2.0的Volta架构V100芯片,采用最新的Intel Xeon SP (Skylake)处理器,通过Mellanox EDR Infiniband网络进行高速互联,运行浪潮ClusterEngine及AIStation等集群管理套件,系统双精度浮点性能超过千万亿次每秒(1PetaFlops)。由于采用了NVLink2.0高速互联技术和Tesla? V100 GPU,该系统将可同时很好支持科学工程计算和AI计算。
浪潮AGX-2超算服务器
浪潮AGX-2是全球首款在2U空间内高速互联集成8颗最高性能GPU的服务器,在2U空间内支持部署8块NVLink 2.0接口的NVIDIA Tesla? V100 GPU,GPU间单向互联带宽高达150GB/s,总带宽达300GB/s。同时, AGX-2具备良好的I/O扩展能力,提供8块NVMe/SAS/SATA热插拔硬盘,可支持最多4块100Gbps的EDR InfiniBand接口卡的高速集群互联,不仅支持通常的风冷散热方式,还可支持片上水冷以提供更高的计算能效比。
AGX-2可以极大提升HPC应用计算效率,其单机双精度浮点计算性能突破60万亿次每秒。以凝聚态物理学和材料科学领域广泛使用的VASP软件为例,在AGX2上使用1块P100 GPU加速卡,即可达到使用8台双路主流CPU计算集群的性能,同时,AGX2提供的Nvlink高通信带宽使其在多GPU卡并行效率上有出色表现,4块P100 GPU卡并行即可达到近20台双路主流CPU计算集群的性能。
在AI计算上,AGX-2搭载的Tesla V100 配备了深度学习高度相关的 Tensor 单元,Tensor 性能可以达到 120 TFLOPS,配合NVLink 2.0可极大提升深度学习框架的训练性能。基于国际通用的Imagenet数据集进行深度学习模型训练,浪潮AGX-2上表现出优异性能,配置8片V100时在TensorFlow框架的GoogleNet模型训练速度达到每秒1898张图片,是单卡性能的7倍,是同数量配置P100系统性能的1.87倍。
好文章,需要你的鼓励
生成式AI在电商领域发展迅速,但真正的客户信任来自可靠的购物体验。数据显示近70%的在线购物者会放弃购物车,主要因为结账缓慢、隐藏费用等问题。AI基础设施工具正在解决这些信任危机,通过实时库存监控、动态结账优化和智能物流配送,帮助商家在售前、售中、售后各环节提升可靠性,最终将一次性买家转化为忠实客户。
泰国SCBX金融集团开发的DoTA-RAG系统通过动态路由和混合检索技术,成功解决了大规模知识库检索中速度与准确性难以兼得的难题。系统将1500万文档的搜索空间缩小92%,响应时间从100秒降至35秒,正确性评分提升96%,为企业级智能问答系统提供了实用的技术方案。
存储供应商Qumulo发布多租户架构Stratus,为每个租户提供独立的虚拟环境,通过加密技术和租户专用密钥管理系统实现隔离。该统一文件和对象存储软件支持本地、边缘、数据中心及AWS、Azure等云环境部署。Stratus采用加密隔离技术确保敏感数据安全,同时提供任务关键操作所需的灵活性和效率,帮助联邦和企业客户满足合规要求。
中科院和字节跳动联合开发了VGR视觉锚定推理系统,突破了传统AI只能粗略"看图"的局限。该系统能在推理过程中主动关注图片关键区域,像人类一样仔细观察细节后再得出结论。实验显示VGR在图表理解等任务上性能大幅提升,同时计算效率更高,代表了多模态AI"可视化推理"的重要进展。