Habana Labs正在人工智能市场中向Nvidia发起挑战。
这家以色列初创公司(已经累计融资1.2亿美元)今天推出了一款名为Gaudi(如图)的芯片,专门用于训练人工智能模型。
工程师通过反复试验来验证算法的性能,这是开发生命周期的一个部分。要让AI完成某个任务可能需要经过数千万次尝试,因此任何加速该过程的技术都有可能带来巨大回报。
Gaudi承诺将提供在性能上有重大提升。为了展示其速度,Habana Labs进行了一项内部测试,将Gaudi与Nvidia旗舰的V100数据中心图形卡进行了对比。Habana Labs称Gaudi运行ResNet-50主流AI模型基准测试的速度要比V100快3.8倍,在此过程中创造了性能纪录。
这是Habana Labs在过去一年中第二次打破RestNet-50记录,第一次是Habana Labs的Goya芯片,该芯片旨在为已经经过训练、用于生产处理实时数据的人工智能模型提供动力。
Gaudi与Goya采用了共同的设计理念,都是基于所谓超长指令字架构的八个处理核心组成,并行执行计算而不是像CPU那样逐个执行计算任务。Gaudi与众不同之处在于它的内存不同,而且吞吐量也更适合于人工智能训练。
Habana Labs将以两种形式把Gaudi推向市场:PCIe卡和夹层加速器,设计用于加载到其他更大的卡上。此外Habana Labs还开发了一款名为HLS的数据中心设备,装有8个夹层加速器。
除了处理速度快之外,Gaudi还是可扩展的。夹层卡和PCIe卡分别采用8个和10个内置以太网端口,每个端口支持100Gb连接,这样就不需要额外的芯片来应对网络需求,提高配置了大量Gaudi处理器的大规模人工智能环境的效率。
Habana Labs计划今年晚些时候生产Gaudi芯片样品,并称已经有多加客户采用了早期的Goya处理器,包括几家云提供商和自动驾驶汽车公司。Habana Labs还得到了大厂商的支持,最近一轮7500万美元的融资是由英特尔领投的,其他投资方还包括Bessemer Venture Partners、Battery Ventures等。
好文章,需要你的鼓励
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。