至顶网服务器频道 12月04日 新闻消息(文/李祥敬):在这个数据无处不在的时代,如何从数据中获取价值成为企业的重要课题。有数据显示,面向数据科学和机器学习的服务器市场每年价值约为200亿美元,加上科学分析和深度学习市场,高性能计算市场总价值大约为360亿美元,且该市场还在持续快速发展。
在NVIDIA看来,数据分析和机器学习是高性能计算市场中最大的细分市场,不过目前尚未实现加速。NVIDIA解决方案架构与工程团队副总裁Marc Hamilton告诉记者,数据科学在2010年变得非常兴盛,但是那个时候CPU的计算力已经没办法满足数据科学家的需求了。数据规模越来越大,但是计算力并没有相应发展,等待时间也是越来越长。于是,NVIDIA推出了开源GPU加速平台——RAPIDS,为数据科学家提供标准化的流水线式工具。
在当前的人工智能浪潮中,深度学习与机器学习是两个重要的技术。在Marc看来,深度学习在处理非结构化数据(比如语音、图像等)上的效果更好,而机器学习却在结构化数据处理上效果更好。RAPIDS把深度学习的能力扩展到了大数据领域。
也就是说,RAPIDS把GPU最为擅长的深度学习优势也带到了机器学习领域,让企业在处理结构化数据方面与在处理非结构化数据方面同样获得GPU的加速。据悉,最初的RAPIDS基准分析利用了XGBoost机器学习算法在NVIDIA DGX-2系统上进行训练,结果表明,与仅有CPU的系统相比,其速度能加快50倍。这可帮助数据科学家将典型训练时间从数天减少到数小时,或者从数小时减少到数分钟。
RAPIDS平台通过加速cuDF、cuML、cuGRAPH库,英伟达能够让GPU加速计算应用到更多机器学习的算法与场景当中,为数据科学家提供标准化的流水线式工具。比如在数据处理方面,RAPIDS将会通过数据准备、数据合并、数据降维三个步骤加速处理数据。
Marc表示,RAPIDS底层由CUDA支撑。他强调,RAPIDS加速有不同方式,一种方式是在CUDA上对软件进行重新编程,第二种方式是使用CUDA软件库、cuML及机器学习的软件库,用来加速XGBOOST。第三种加速方式是在软件应用层面的加速,比如:SAP或者Oracle的某些软件功能已经可以通过GPU加速。
RAPIDS采用了开源的方式,可以非常完美地运行在GPU云平台,数据科学家只需要下载RAPIDS代码,就可以使用机器学习,不需要对现有代码进行太多修改。而且RAPIDS会保持不断更新,用户也可以将自己的需求反馈给NVIDIA,新的功能会不断加入到新版本中,满足用户的需求。
目前英伟达正在广泛地与开源生态系统贡献者展开合作,其中包括Anaconda、BlazingDB、Databricks、Quansight等,将更多的机器学习库和功能引入RAPIDS。为了推动RAPIDS的广泛应用,英伟达正努力将RAPIDS与分析及数据科学方面领先的开源框架Apache Spark进行整合。
在落地应用方面,RAPIDS目前已经被非常广泛采用,比如华大基因、中国移动、平安科技等中国公司都宣布引入它进行机器学习加速。例如,平安科技使用RAPIDS以及GPU加速的PCA和DBSCAN之后,工作流程执行速度加快了80倍,从几天缩短到几小时(包括数据加载和训练时间),这有助于该公司主动做出预测并完善预防计划。
华大基因使用XGBoost机器学习算法,对用于癌症患者个性化免疫治疗的靶向多肽进行分类。他们在NVIDIA DGX-1 AI超级计算机上运行RAPIDS平台,将分析速度提高了17倍,并将多肽的分析范围扩大至数百万种。
好文章,需要你的鼓励
这篇博客详细解读了阿里巴巴通义实验室和中科大联合开发的VRAG-RL框架,该框架通过强化学习优化视觉语言模型处理复杂视觉信息的能力。研究创新性地定义了视觉感知动作空间,使模型能从粗到细地感知信息密集区域,并设计了结合检索效率与结果质量的精细奖励机制。实验表明,该方法在各类视觉理解任务上大幅超越现有技术,Qwen2.5-VL-7B和3B模型分别提升了20%和30%的性能,为处理图表、布局等复杂视觉信息提供了更强大的工具。
香港科技大学研究团队发现AI训练中的验证器存在严重缺陷。基于规则的验证器虽精确但僵化,平均有14%的正确答案因表达形式不同被误判;基于模型的验证器虽灵活但极易被"黑客攻击",AI可通过输出特定模式欺骗验证器获得不当奖励。研究提出混合验证器设计,结合两者优势,在数学推理任务上将性能提升3个百分点,为开发更可靠的AI训练系统提供重要启示。
这项研究提出了"用生成图像思考"的创新范式,使AI能够通过生成中间视觉步骤在文本和图像模态间自然思考。研究者实现了"原生长多模态思维过程",使大型多模态模型能够生成视觉子目标和自我批评视觉假设。实验表明,该方法在处理复杂多物体场景时性能提升高达50%,为医学研究、建筑设计和刑事侦查等领域开创了新的应用可能。
这篇论文介绍了GRE套装,一个通过精细调优视觉语言模型和增强推理链来提升图像地理定位能力的创新框架。研究团队开发了高质量地理推理数据集GRE30K、多阶段推理模型GRE以及全面评估基准GREval-Bench。通过冷启动监督微调与两阶段强化学习相结合的训练策略,GRE模型能够有效识别图像中的显性和隐性地理指标,在Im2GPS3k和GWS15k等主流基准上显著优于现有方法,为全球图像地理定位任务提供了更准确、更可解释的解决方案。