HPE今天公布了自去年收购Delivered AI之后取得的一些成果:一个用于大规模构建和训练机器学习模型的平台。

HPE表示,这个名为HPE Machine Learning Development System的系统结合了HPE Machine Learning Development Environment与计算、加速器和板载网络,可显着加速模型的开发速度。
该系统旨在解决购买和安装大规模并行处理器所涉及的、通常是很复杂的多步骤过程,包括专门的计算、存储、互连和加速器。此次面市的打包产品让企业组织可以立即就开始构建和训练机器学习模型。
HPE公司高性能计算、关键任务解决方案和实验室总经理Justin Hotard表示:“训练深度学习模型不仅复杂、耗时而且是资源密集的,很多工程师把大量时间花费在管理基础设施上,而不是专注于优化模型上,这意味着他们可以专注于业务成果、而不是技术要求。”
该系统将作为基于HPE Apollo 6500 Gen10系统的单个软件包提供给用户,起步配置是8个Nvidia A100 80 GB GPU,管理堆栈使用HPE ProLiant DL325服务器和1Gb Ethernet Aruba CX 6300交换机。
网络和存储则由Nvidia Quantum InfiniBand提供,监控和管理由HPE Performance Cluster Management提供。
Hotard说:“当今市场上普遍存在的是刚性解决方案,在规模上是非常昂贵的,同时对于客户来说这意味着更复杂、需要更长时间才能获得洞察。”而HPE的目标是为客户“在部署模型的位置和部署模型的基础设施方面提供极大的灵活性”。
HPE还通过推出HPE Swarm Learning(一种用于边缘计算或者分布式计算的隐私保护、去中心化机器学习框架)来巩固自己的AI业务。该框架为客户提供的软件容器可以与使用HPE swarm API的AI模型进行集成,让企业组织能够与其他组织共享AI模型的学习成果,而无需共享任何实际数据。
大多数AI模型训练都依赖于集中的、合并的数据集,由于需要移动大量数据,因此这既低效成本又高。在受监管的行业中,此类模型训练也可能受到限制外部数据共享、移动数据隐私以及所有权方面各项规则的约束,结果就会导致AI模型的质量较低,HPE表示。
HPE Swarm Learning让企业组织在源头位置就可以采用分布式数据,增加训练数据集大小的同时,确保遵循数据治理和数据隐私规定。区块链技术则用于保护链中成员、动态选举领导者、合并模型参数等方面。
此外,HPE还宣布在和高通合作的基础上提供更先进的推理产品,支持异构系统架构以实现大规模AI推理。HPE将提供坚固耐用的Edgeline EL8000 Converged Edge系统以及用于推理和边缘的Qualcomm Cloud AI 100加速器,该产品预计于8月全面上市。
好文章,需要你的鼓励
很多人担心被AI取代,陷入无意义感。按照杨元庆的思路,其实无论是模型的打造者,还是模型的使用者,都不该把AI放在人的对立面。
MIT研究团队提出递归语言模型(RLM),通过将长文本存储在外部编程环境中,让AI能够编写代码来探索和分解文本,并递归调用自身处理子任务。该方法成功处理了比传统模型大两个数量级的文本长度,在多项长文本任务上显著优于现有方法,同时保持了相当的成本效率,为AI处理超长文本提供了全新解决方案。
谷歌宣布对Gmail进行重大升级,全面集成Gemini AI功能,将其转变为"个人主动式收件箱助手"。新功能包括AI收件箱视图,可按优先级自动分组邮件;"帮我快速了解"功能提供邮件活动摘要;扩展"帮我写邮件"工具至所有用户;支持复杂问题查询如"我的航班何时降落"。部分功能免费提供,高级功能需付费订阅。谷歌强调用户数据安全,邮件内容不会用于训练公共AI模型。
华为研究团队推出SWE-Lego框架,通过混合数据集、改进监督学习和测试时扩展三大创新,让8B参数AI模型在代码自动修复任务上击败32B对手。该系统在SWE-bench Verified测试中达到42.2%成功率,加上扩展技术后提升至49.6%,证明了精巧方法设计胜过简单规模扩展的技术理念。