AI 新闻中心

AI 新闻中心 过去一年分析了 7690 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

并非每个 Token 都值得保留:高效深度研究智能体的边际价值估计

一项研究探讨了深度研究智能体如何在上下文不断增长时,移除价值较低的信息。研究在检索前、检索后和合成前三个阶段,对比了轻量级启发式方法与学习型价值模型。结果显示,剪枝发生的阶段比具体评分规则更重要:提前剪枝能带来最大的整体节省,而较晚剪枝主要用于优化最终合成上下文。轻量级启发式方法最多可减少 73% 的 Token 使用量,同时几乎不影响质量。但没有任何单一方法能在质量、效率和忠实度方面全面占优。

面向多语言机器翻译的开放式大语言模型无参考后训练

一项研究探讨了开放式大语言模型在46种语言机器翻译任务中的无参考后训练方法。研究人员以监督微调的MiLMMT-46-v0.1模型为基础,采用Group Relative Policy Optimization(GRPO),奖励信号取自两个无参考质量评估模型的平均值,并加入语言识别门控。随后,他们对监督微调和强化学习模型的检查点进行线性插值,得到MiLMMT-46-v1.0。根据论文报告的评测结果,

Combodied Agents:以人为中心的智能体人工智能新范式

Combodied Agents 是一种旨在弥补智能体人工智能结构性缺陷的框架。数字智能体主要改变软件状态,具身智能体则改变物理状态,但两者都未必能够充分建模个人状态、意图和自主性的持续变化。该方法将人的状态轨迹置于核心,并把软件工具、传感器、可穿戴设备、机器人和人工服务作为干预渠道。框架结合多模态事件感知、可由用户纠正的长期记忆以及个人世界模型,并根据同意、不确定性、安全性、可逆性和用户控制选择

台积电:5.5倍光罩尺寸CoWoS良率可达99%

台积电先进封装技术暨服务副总经理何军在OCP APAC峰会上表示,已量产的5.5倍光罩尺寸CoWoS在部分产品上的良率可达99%。这一2.5D异构集成方案已在多个AI客户产品上完成验证,良率稳定超过98%。台积电计划于2029年推出15倍光罩尺寸的超大面积CoWoS。何军指出,先进SoC的验证正加速从器件级转向系统级,因为部分边缘损伤和应力问题只有在集成到不同系统或印刷电路板后才会出现或消失。供应

蚂蚁集团推出医生AI工作站,覆盖在线问诊与患者管理

蚂蚁集团将好大夫医生版升级并更名为“蚂蚁阿福医生版”,新增两款AI助手,支持预问诊、患者沟通、诊后随访、病历整理和医学文献检索。平台还与面向患者的蚂蚁阿福App打通,蚂蚁称该App用户已超过1亿。公司强调,临床决策仍由医生负责,采用“医生把关”模式。平台据称整合了超过6000万篇医学文献、指南及其他专业资料,以及超过14万份药品说明书。目前已有超过30万名实名注册医生接入,医疗机构也可整体入驻。关

阿里云推出M890超节点,支持64卡互联和800GB/s带宽

阿里云正式推出灵骏真武M890超节点实例,首批已在乌兰察布地域上线。企业客户无需自建数据中心,即可在云端使用由64张加速卡高速互联组成的算力单元。阿里云称,该系统可支持最高十万亿参数规模的MoE模型推理,并支持FP8和FP4低精度计算。通过ICN Switch 1.0芯片,卡间互联带宽达到800GB/s。在智能驾驶、具身智能等训练场景中,阿里云宣称其性能较上一代真武810E提升3倍。公司还表示,K

iFAN:面向普通掩码 Transformer 的推理感知学习

研究人员提出 iFAN,一种用于图像分割掩码 Transformer 的训练框架。现有基于查询的解码存在两个不匹配问题:概率分数最高的查询不一定能生成最准确的掩码,最终层解码也可能丢弃中间层更优的预测。iFAN通过调整后的概率—掩码排序,使查询竞争更符合掩码质量,并通过跨层自蒸馏将更强的中间层预测传递到最终层。这些机制仅在训练阶段使用,因此推理仍保持高效。在COCO、ADE20K和Cityscap

TSDS-Toolbox:用于测量时间序列数据集相似性的工具箱

TSDS-Toolbox 是一个统一框架,用于系统且可复现地比较时间序列数据集相似性测量方法。该工具支持用户添加自定义数据集、相似性方法以及预测、分类和生成等下游时间序列任务。通过集成的数据集规约器,它还能够一致地评估数据集级和序列级相似性。研究人员在多种实验设置下验证了该工具的有效性,并已公开发布。

阿里云上线 M890 超节点实例,可运行超 2 万亿参数大模型

阿里云正式上线灵骏真武 M890 超节点实例,首批在内蒙古乌兰察布提供服务。企业客户无需自建机房,即可通过云端使用由 64 卡高速互联组成的算力单元。阿里云称,该实例最高可支持十万亿参数级 Mixture-of-Experts 模型推理,并已运行 Kimi K3、Qwen3.8-Max 等超过 2 万亿参数的模型。系统支持 FP8 和 FP4 低精度计算,卡间互联带宽最高达 800GB/s。在智能

智能体系统的协同进化:迈向超越人类设计的自主进化

这篇综述研究智能体系统中的协同进化,即多个智能体与环境相互适应,并彼此施加进化压力。文章将现有研究分为三个阶段:智能体之间的协同进化、智能体与环境之间的协同进化(涉及不断变化的任务和反馈),以及元协同进化,即让进化机制本身也具备可适应性。研究还讨论了如何评估、扩展、保障安全并控制日益自主的进化系统。

DSAgentBench:智能体能否在真实计算机环境中自动完成端到端数据科学工作流?

DSAgentBench 是一个用于评估 AI 智能体在真实计算机环境中执行完整数据科学工作流的基准测试。它包含 275 项任务,覆盖数据整理、探索、建模、可视化和验证,并要求协调使用笔记本、IDE、终端、浏览器和数据库。确定性评估器不仅检查代码执行,还会验证分析正确性、可视化结果和模型性能。在对 15 个闭源和开源模型的实验中,表现最强的 Claude-4.6-Sonnet 任务成功率也只有 5

SkillZip:通过发现可复用结构实现自我进化智能体的免评估技能压缩

SkillZip是一种无需任务评估即可压缩自我进化AI智能体所积累技能的方法。它不将技能视为扁平文本,而是识别重复的规则和动作序列,将共享结构统一描述,并把差异保留为明确的例外。该方法采用带类型的最小描述长度目标,并对触发条件、工作流边、工具要求、义务和输出字段设置严格的覆盖约束,以保留罕见但重要的规则。SkillZip支持一次性压缩和持续更新,无需重新执行任务或解析完整历史。论文报告的实验显示,

Ex-Omni-2D:具备原生视觉呈现能力的表现力全模态对话模型

Ex-Omni-2D 是一个多模态对话框架,可生成结合文本、个性化语音和参考条件视频的协调式响应。系统接收多模态查询、参考图像和音频后,先预测描述场景、情绪与动作的视觉思维计划,再生成响应文本和语音单元。共享的声学—时间接口能够将语音与视频帧对齐。研究人员将完整序列视频生成器蒸馏为更高效的流式模型,以支持增量生成。在四步推理和四张 GPU 的流水线中,系统在 400×720 或 720×400 分

奕境总经理曾清林:华为智驾仍处于行业顶级水平

东风汽车集团与华为联合打造的汽车品牌奕境,其总经理曾清林发文谈及双方合作。他表示,凭借896线激光雷达、ADS 5以及累计130亿公里的智驾数据,华为的智能驾驶技术仍处于行业顶级水平。曾清林还指出,先进软件需要强大硬件支撑。奕境X9将华为智驾系统与东风全铝底盘、奕境自有的“天穹智盾”安全架构结合,以提升整车性能。这款定位家庭旗舰级六座SUV的新车于8月10日首秀,支持华为乾崑智驾ADS 5,并配备