Arm宣布推出Cortex-R82,该芯片旨在支持可以同时保存数据和处理数据的新一代存储设备。
这种新型硬件称为计算存储,有助于为延迟敏感型工作负载(例如机器学习和实时分析应用)提升速度。
通常来说,存储数据和处理数据的任务被分配给系统内部的单独组件去完成,磁盘或闪存驱动器用于保留信息,单独的处理器用于处理信息,每次执行操作的时候,数据都必须从存储驱动器传输到处理器,然后再返回,这个过程会导致一定的延迟,从而降低性能。
这种新型计算存储设备的目标是消除这个过程中的延迟,以加快应用的速度。存储驱动器使用内置控制器在本地处理器信息,而不是将信息发送到单独的芯片进行处理。控制器是闪存和磁盘驱动器中的一个微型计算模块,通常只用于执行低级别任务,例如写入数据和读取数据。
Arm此次新推出的Cortex-R82将被用作计算存储设备的控制器,即可以作为芯片设计提供,硬件制造商也可以根据需要进行许可和定制。
Arm称,Cortex-R82最多可以配置8个处理核心,其性能是上一代R8产品的2倍,计算能力的提升让Cortex-R82可以直接在存储驱动器内部运行完整的Linux发行版和应用。
那些计划在存储驱动器上运行机器学习模型的企业,可以通过为Cortex-R82配备Arm Neon机器学习技术来获得更高的性能。Arm表示,与上一代R8相比,Neon将神经网络的性能提高了14倍。
计算存储硬件有许多潜在的应用场景。例如,一家建筑企业可以在建筑工地部署安全摄像头,使用运行在内部闪存驱动器上的AI模型,发现潜在的危险。Arm也列出了一些更为传统的数据中心使用场景,例如数据库加速、视频转码和实时分析。
好文章,需要你的鼓励
很多人担心被AI取代,陷入无意义感。按照杨元庆的思路,其实无论是模型的打造者,还是模型的使用者,都不该把AI放在人的对立面。
MIT研究团队提出递归语言模型(RLM),通过将长文本存储在外部编程环境中,让AI能够编写代码来探索和分解文本,并递归调用自身处理子任务。该方法成功处理了比传统模型大两个数量级的文本长度,在多项长文本任务上显著优于现有方法,同时保持了相当的成本效率,为AI处理超长文本提供了全新解决方案。
谷歌宣布对Gmail进行重大升级,全面集成Gemini AI功能,将其转变为"个人主动式收件箱助手"。新功能包括AI收件箱视图,可按优先级自动分组邮件;"帮我快速了解"功能提供邮件活动摘要;扩展"帮我写邮件"工具至所有用户;支持复杂问题查询如"我的航班何时降落"。部分功能免费提供,高级功能需付费订阅。谷歌强调用户数据安全,邮件内容不会用于训练公共AI模型。
华为研究团队推出SWE-Lego框架,通过混合数据集、改进监督学习和测试时扩展三大创新,让8B参数AI模型在代码自动修复任务上击败32B对手。该系统在SWE-bench Verified测试中达到42.2%成功率,加上扩展技术后提升至49.6%,证明了精巧方法设计胜过简单规模扩展的技术理念。