在AWS运行NVIDIA GPU十周年之际,AWS发布了采用全新A100的Amazon EC2 P4d实例
十年前,AWS(Amazon Web Services)发布了首个采用NVIDIA M2050 GPU的实例。当时,基于CUDA的应用主要专注于加速科学模拟,AI和深度学习还遥遥无期。

自那时起,AW就不断扩充云端GPU实例阵容,包括K80(p2)、K520(g3)、M60(g4)、V100(p3 / p3dn)和T4(g4)。
现在,已全面上市的全新AWS P4d实例采用最新NVIDIA A100 Tensor Core GPU,开启了加速计算的下一个十年。
全新的P4d实例,为机器学习训练和高性能计算应用提供AWS上性能与成本效益最高的GPU平台。与默认的FP32精度相比,全新实例将FP16机器学习模型的训练时间减少多达3倍,将TF32机器学习模型的训练的时间减少多达6倍。
这些实例还提供出色的推理性能。NVIDIA A100 GPU在最近的MLPerf Inference基准测试中一骑绝尘,实现了比CPU快237倍的性能。
每个P4d实例均内置八个NVIDIA A100 GPU,通过AWS UltraClusters,客户可以利用AWS的Elastic Fabric Adapter(EFA)和Amazon FSx提供的可扩展高性能存储,按需、可扩展地同时访问多达4,000多个GPU。P4d提供400Gbps网络,通过使用NVLink、NVSwitch、NCCL和GPUDirect RDMA等NVIDIA技术,进一步加速深度学习训练的工作负载。EFA上的NVIDIA GPUDirect RDMA在服务器之间可通过GPU传输数据,无需通过CPU和系统内存,从而确保网络的低延迟。
此外,许多AWS服务都支持P4d实例,包括Amazon Elastic Container Services、Amazon Elastic Kubernetes Service、AWS ParallelCluster和Amazon SageMaker。P4d还可使用所有NGC提供的经过优化的容器化软件,包括HPC应用、AI框架、预训练模型、Helm图表以及TensorRT和Triton Inference Server等推理软件。
目前,P4d实例已在美国东部和西部上市,并将很快扩展到其他地区。用户可以通过按需实例(On-Demand)、Savings Plans、预留实例(Reserved Instances)或竞价型实例(Spot Instances)几种不同的方式进行购买。
GPU云计算发展最初的十年,已为市场带来超过100 exaflops的AI计算。随着基于NVIDIA A100 GPU的Amazon EC2 P4d实例的问世,GPU云计算的下一个十年将迎来一个美好的开端。
NVIDIA和AWS不断帮助各种应用突破AI的界限,以便了解客户将如何运用AI强大的性能。
好文章,需要你的鼓励
西部数据闪存业务分拆后,SanDisk宣布将停用广受欢迎的WD Black和Blue品牌,推出全新的SanDisk Optimus系列NVMe产品线。WD Blue驱动器将更名为SanDisk Optimus,而高端WD Black驱动器将分别更名为Optimus GX和GX Pro。尽管品牌变更,底层硬件和供应链保持不变。然而受全球内存短缺影响,预计2026年第一季度客户端SSD价格可能上涨超过40%。
上海AI实验室开发RePro训练方法,通过将AI推理过程类比为优化问题,教会AI避免过度思考。该方法通过评估推理步骤的进步幅度和稳定性,显著提升了模型在数学、科学和编程任务上的表现,准确率提升5-6个百分点,同时大幅减少无效推理,为高效AI系统发展提供新思路。
福特汽车在2026年消费电子展上宣布将在车辆中引入AI助手技术。该AI助手最初将在福特和林肯智能手机应用中推出,从2027年开始成为新车型的原生功能。福特希望通过AI技术实现车辆个性化体验,提供基于位置、行为和车辆能力的智能服务。同时,福特将采用软件定义车辆架构,推出自研的高性能计算中心,提升信息娱乐、驾驶辅助等功能。
MIT团队开发的VLASH技术首次解决了机器人动作断续、反应迟缓的根本问题。通过"未来状态感知"让机器人边执行边思考,实现了最高2.03倍的速度提升和17.4倍的反应延迟改善,成功展示了机器人打乒乓球等高难度任务,为机器人在动态环境中的应用开辟了新可能性。