HPE今天公布了自去年收购Delivered AI之后取得的一些成果:一个用于大规模构建和训练机器学习模型的平台。

HPE表示,这个名为HPE Machine Learning Development System的系统结合了HPE Machine Learning Development Environment与计算、加速器和板载网络,可显着加速模型的开发速度。
该系统旨在解决购买和安装大规模并行处理器所涉及的、通常是很复杂的多步骤过程,包括专门的计算、存储、互连和加速器。此次面市的打包产品让企业组织可以立即就开始构建和训练机器学习模型。
HPE公司高性能计算、关键任务解决方案和实验室总经理Justin Hotard表示:“训练深度学习模型不仅复杂、耗时而且是资源密集的,很多工程师把大量时间花费在管理基础设施上,而不是专注于优化模型上,这意味着他们可以专注于业务成果、而不是技术要求。”
该系统将作为基于HPE Apollo 6500 Gen10系统的单个软件包提供给用户,起步配置是8个Nvidia A100 80 GB GPU,管理堆栈使用HPE ProLiant DL325服务器和1Gb Ethernet Aruba CX 6300交换机。
网络和存储则由Nvidia Quantum InfiniBand提供,监控和管理由HPE Performance Cluster Management提供。
Hotard说:“当今市场上普遍存在的是刚性解决方案,在规模上是非常昂贵的,同时对于客户来说这意味着更复杂、需要更长时间才能获得洞察。”而HPE的目标是为客户“在部署模型的位置和部署模型的基础设施方面提供极大的灵活性”。
HPE还通过推出HPE Swarm Learning(一种用于边缘计算或者分布式计算的隐私保护、去中心化机器学习框架)来巩固自己的AI业务。该框架为客户提供的软件容器可以与使用HPE swarm API的AI模型进行集成,让企业组织能够与其他组织共享AI模型的学习成果,而无需共享任何实际数据。
大多数AI模型训练都依赖于集中的、合并的数据集,由于需要移动大量数据,因此这既低效成本又高。在受监管的行业中,此类模型训练也可能受到限制外部数据共享、移动数据隐私以及所有权方面各项规则的约束,结果就会导致AI模型的质量较低,HPE表示。
HPE Swarm Learning让企业组织在源头位置就可以采用分布式数据,增加训练数据集大小的同时,确保遵循数据治理和数据隐私规定。区块链技术则用于保护链中成员、动态选举领导者、合并模型参数等方面。
此外,HPE还宣布在和高通合作的基础上提供更先进的推理产品,支持异构系统架构以实现大规模AI推理。HPE将提供坚固耐用的Edgeline EL8000 Converged Edge系统以及用于推理和边缘的Qualcomm Cloud AI 100加速器,该产品预计于8月全面上市。
好文章,需要你的鼓励
企业AI搜索公司Glean宣布年度经常性收入(ARR)达3亿美元,较15个月前的1亿美元增长三倍。尽管谷歌、微软、OpenAI等科技巨头纷纷入局企业AI搜索市场,Glean凭借"上下文图谱"技术深度理解企业业务需求,并帮助客户显著降低AI计算成本。该公司提供按用量计费和混合定价两种模式,客户涵盖Databricks、Reddit、Pinterest及三星等企业。Glean上轮融资后估值达72亿美元。
香港中文大学与MiniMax提出ClaimDiff-RL框架,将图像描述的AI训练从整体打分升级为逐条核查,有效解决了传统方式导致AI"少说保平安"的问题,同时在多项基准测试上超越Gemini-3-Pro-Preview。
杰夫·贝索斯旗下的蓝色起源公司在佛罗里达卡纳维拉尔角进行静态点火测试时,新格伦重型火箭发生爆炸。这是美国历史上最大规模的火箭爆炸之一,也是蓝色起源公司遭遇的最严重失败。所有人员安全,但该事故可能导致新格伦火箭项目长期暂停。此前该火箭已成功完成三次发射,并实现了助推器回收和重复使用。
ParaVT是一个由南洋理工等多校联合提出的并行视频工具调用框架,通过让AI同时分析多段视频并引入PARA-GRPO算法解决训练中的格式崩溃与工具跳过问题,在六项长视频理解测试中平均提升约7.9%。