在近日举行的re:Invent 2020 CEO主题大会上,AWS 宣布了采用多达8个Habana® Gaudi®加速器的EC2实例,比目前GPU的EC2实例在机器学习性价比上提升了40%,基于Gaudi®的EC2实例计划于2021年上半年提供使用。
在主题大会上,AWS首席执行官Andy Jassy强调了各行业对高性能、更实惠的人工智能工作的巨大需求。随着公司计划引入以Gaudi为特色的新EC2实例进行深度学习训练,AWS将进一步降低AI数据集的训练成本,并降低希望利用AI提供业务分析、改善效率和增强用户体验的客户的运营总成本。
8卡的Gaudi 解决方案可以在TensorFlow上每秒处理12000张图像训练ResNet-50模型。每个Gaudi处理器集成了32GB的HBM2内存,并集成了用于服务器内部处理器互联的RoCE功能。凭借AWS弹性架构适配器(EFA)的技术可以跨服务器扩展,从而允许AWS及其客户无缝地扩展使用多个基于Gaudi的系统以实现高效和可扩展的分布式训练。
Habana的SynapseAI软件套件专为在Habana Gaudi处理器上提供高性能的深度学习训练,SynapseAI与TensorFlow和Pythorch等流行的深度学习框架集成,对Gaudi进行了优化。开发人员将可以获取开放的Gaudi软件、参考模型和文档。参考模型将在Habana的GitHub知识库中公开发布,并将包括各种流行的模型,如图像分类、对象检测、自然语言处理和推荐系统。SynapseAI软件套件包括Habana的图形编译器和实时Tensor Processor Core (TPC)内核库、固件和驱动程序,以及用于定制内核开发的TPC SDK和SynapseAI Profiler等开发工具。有关在Gaudi上使用新的AWS EC2实例的更多信息,请参阅我们的白皮书。
Habana将在目前Gaudi效能基础上,推出下一代TSMC 7nm 的Gaudi2®,让AI训练应用和服务广大客户、数据科学家和研究人员。
好文章,需要你的鼓励
软银集团已完成对OpenAI的400亿美元投资,向其转账225亿美元。此次投资使软银获得约11%的OpenAI股份,成为仅次于微软的第二大投资者。OpenAI将利用这些资金推进Starlink数据中心项目,计划到2029年在美国部署100亿瓦的计算能力。为完成此次投资,软银出售了部分投资组合资产,包括英伟达和T-Mobile股票,并以ARM股份作抵押获得贷款。
MBZUAI和法国综合理工学院联合开发的SchED算法能让AI写作速度提升3-4倍。该算法通过监测AI生成文本的置信度,采用进度感知的动态阈值策略,在保持99.8%-100%原始质量的同时显著减少计算时间。实验覆盖多种任务类型,证明了算法的有效性和鲁棒性。
TrendForce将2026年笔记本市场预测下调至1.73亿台,同比下降5.4%。报告指出,若内存短缺未改善,下滑幅度可能达10.1%。尽管面临挑战,苹果预计将在2026年春季推出低成本MacBook,并凭借供应链效率和规模优势减少影响。IDC警告称,由于AI数据中心需求激增导致内存芯片严重短缺,PC出货量可能下滑9%,平均售价将上涨4-8%。
西安交通大学研究团队发现,AI视觉语言模型容易受到功能词(如"是"、"的"等)的干扰而遭受攻击。他们开发了功能词去注意力(FDA)机制,让AI减少对这些词汇的关注。测试显示,该方法可将攻击成功率降低18%-90%,而正常性能仅下降0.2%-0.6%。FDA无需额外训练即可集成到现有模型中,为AI安全防护提供了简单有效的解决方案。