强化学习微调,训练数据里到底谁在"划水"
港大与腾讯团队提出DIEM框架,在强化微调训练中通过梯度对齐动态评估每个样本的实时价值并重新分配权重,无需额外训练评估模型,仅增加约1.2%训练耗时,却在多项数学与多模态推理基准上显著超越GRPO等主流方法。
港大与腾讯团队提出DIEM框架,在强化微调训练中通过梯度对齐动态评估每个样本的实时价值并重新分配权重,无需额外训练评估模型,仅增加约1.2%训练耗时,却在多项数学与多模态推理基准上显著超越GRPO等主流方法。
9月22日下午,2026云栖大会技术主论坛上,阿里云正式发布新一代AI Native超节点服务器——磐久AL64分布式SNPO光互连超节点
本文解读EvoUndo框架,研究AI智能体自我修改后能否被安全撤销的问题。通过600个真实任务实验发现197个能力提升方案存在撤销缺陷,常规修复方法全部失败,揭示了状态定位精度和恢复语言表达能力这两个关键瓶颈。
9月21日,在2026人工智能计算大会(AICC2026)上,浪潮信息发布元脑SD200 Ultra超节点AI服务器。元脑SD200 Ultra基于本土AI芯片,单机承载运行2.8万亿参数的Kimi K3大模型,Toke...
本文解读GGSS方法,一种让生成式视觉语言模型在推理阶段减少种族、性别偏见的技术,通过球面几何转向和自适应门控,在四个AI模型上实现最低偏见同时保持模型原有能力不受损。
一篇259篇论文的综述,揭示AI创作系统的核心难题:为何有些AI改东西又快又准,有些却动一下就崩溃?答案藏在状态记录、诊断反馈与修改工具的匹配方式里。
模型上线与业务价值之间的落差,是当下视觉AI行业最普遍的落地难题:算法定制以月计交付,现场环境一变、精度便随之衰减,让AI进入门店之后不止于能用,而是越用越准、成本可控,行业需要的是对生产链路本身的重构
论文提出EASEL基准,测试AI模型能否像人一样照着图片一笔一笔作画。结果发现,最强的多模态大模型画得跟"随便糊一片颜色"差不多,暴露出AI擅长理解图像却难以精确执行视觉动作的核心短板。
苹果因未能如期推出AI升级版Siri,以2.5亿美元达成和解。2024年6月至2025年3月间购买iPhone 15 Pro或iPhone 16系列的美国用户,可在2026年12月21日前提交索赔,每台设备预计赔付25至...
AI健康福利初创公司Corridor完成2500万美元种子轮融资,由贝恩资本风险投资领投。该平台将AI代理与人工顾问结合,专为常被传统经纪公司忽视的中小企业提供医疗保险服务。
Google搜索产品副总裁Robby Stein将在TechCrunch Disrupt 2026发表演讲,探讨产品从MVP成长至十亿用户规模时决策方式的演变,活动于10月13至15日在旧金山举行。
F5 Labs报告称,8月份攻击者对暴露的Vite开发服务器发起逾3.2万次扫描,利用CVE-2026-39364漏洞(CVSS 8.2)绕过文件访问限制,窃取云凭证与基础设施配置文件。
NVIDIA在纽约气候周重点介绍五家清洁能源企业:ThinkLabs AI利用数字孪生将电网互联申请评估从45天压缩至2分钟;Atomic Canyon为核电站引入AI知识管理平台;Redwood Materials以回...
NVIDIA联合Cisco、JFrog、CrowdStrike等合作伙伴,围绕AI Agent全栈安全提出工程化框架,涵盖身份管理、权限边界、沙箱执行与持续红队测试,并开源OpenShell运行时,推动安全防护能力在更广...