在近日举行的re:Invent 2020 CEO主题大会上,AWS 宣布了采用多达8个Habana® Gaudi®加速器的EC2实例,比目前GPU的EC2实例在机器学习性价比上提升了40%,基于Gaudi®的EC2实例计划于2021年上半年提供使用。
在主题大会上,AWS首席执行官Andy Jassy强调了各行业对高性能、更实惠的人工智能工作的巨大需求。随着公司计划引入以Gaudi为特色的新EC2实例进行深度学习训练,AWS将进一步降低AI数据集的训练成本,并降低希望利用AI提供业务分析、改善效率和增强用户体验的客户的运营总成本。
8卡的Gaudi 解决方案可以在TensorFlow上每秒处理12000张图像训练ResNet-50模型。每个Gaudi处理器集成了32GB的HBM2内存,并集成了用于服务器内部处理器互联的RoCE功能。凭借AWS弹性架构适配器(EFA)的技术可以跨服务器扩展,从而允许AWS及其客户无缝地扩展使用多个基于Gaudi的系统以实现高效和可扩展的分布式训练。
Habana的SynapseAI软件套件专为在Habana Gaudi处理器上提供高性能的深度学习训练,SynapseAI与TensorFlow和Pythorch等流行的深度学习框架集成,对Gaudi进行了优化。开发人员将可以获取开放的Gaudi软件、参考模型和文档。参考模型将在Habana的GitHub知识库中公开发布,并将包括各种流行的模型,如图像分类、对象检测、自然语言处理和推荐系统。SynapseAI软件套件包括Habana的图形编译器和实时Tensor Processor Core (TPC)内核库、固件和驱动程序,以及用于定制内核开发的TPC SDK和SynapseAI Profiler等开发工具。有关在Gaudi上使用新的AWS EC2实例的更多信息,请参阅我们的白皮书。
Habana将在目前Gaudi效能基础上,推出下一代TSMC 7nm 的Gaudi2®,让AI训练应用和服务广大客户、数据科学家和研究人员。
好文章,需要你的鼓励
FORTIS是专门测量AI代理"越权行为"的基准测试,研究发现十款顶尖模型普遍选择远超任务需要的高权限技能,端到端成功率最高仅14.3%。
谷歌在Android Show发布会上宣布,将Gemini更深度整合至Android系统,推出名为"Gemini Intelligence"的升级功能。该功能可跨应用处理日常任务,包括自动填写表单、安排日程、生成购物清单及自定义小组件等,无需用户频繁切换应用。此外,Gboard新增"Rambler"功能,可自动过滤语音输入中的口误和填充词。Gemini Intelligence将率先登陆三星Galaxy和谷歌Pixel手机,并支持Android Auto、Wear OS及智能眼镜。
荷兰Nebius团队提出SlimSpec,通过低秩分解压缩草稿模型LM-Head的内部表示而非裁剪词汇,在保留完整词汇表的同时将LM-Head计算时间压缩至原来的五分之一,端到端推理速度超越现有方法最高达9%。