AI 新闻中心

AI 新闻中心 过去一年分析了 4049 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

2026中国算力大会将于9月11日至13日在河北廊坊举行

2026中国算力大会将于9月11日至13日在河北省廊坊市举行,主题涵盖算力基础设施、核心技术、行业应用和产业生态建设。大会将首次举办算力首创首发发布会,集中展示国产算力芯片、智能体、绿色算力等软硬件产品。围绕人工智能、具身智能、算电协同、太空算力和Token新经济等议题,大会还将举办10余场专题论坛。同期举行的“算力中国·AI与算力产业展览会”将免费向公众开放。大会由中国相关部门与地方政府共同主办

DistilVDR:通过双学生蒸馏实现的紧凑型端到端视觉文档检索器

DistilVDR 是一个拥有 5.24 亿参数的视觉文档检索系统,由一个 80 亿参数的视觉语言模型蒸馏而来。其非对称编码器将更多视觉处理能力集中在文档端,同时保持较小的查询编码器,并且无需相关性标注或负样本采样。HiRes 版本在 ViDoRe v1 至 v3 上取得 61.74 的平均 NDCG@5,达到教师模型性能的 86.9%。两个版本生成的索引都明显更小,为一百万份文档建立索引的速度约

美团不做线下药店,将帮助医药商家推进 AI 转型

美团核心本地商业 CEO 王莆中表示,美团不会开设线下药店,而是希望成为医药商家的 AI 合作伙伴。美团计划向行业开放 AI 经营专家、CatPaw 能力以及工作流改造方法。目前,首批 AI 经营专家已在漱玉平民、科赴等企业应用;全场景 AI Agent 平台 CatPaw 也将面向医药商家启动试点。美团希望依托与约 25 万家药店及近 500 家药企的合作生态,打造面向医药零售业的 AI 基础设

微软推出 MAI-Code-1.1-Flash 编程模型:性能提升,价格降至四分之一

微软推出了 MAI-Code-1.1-Flash,这是面向 GitHub Copilot 工作负载优化的编程模型升级版。微软表示,通过 Copilot CLI 使用时,该模型在 Terminal-Bench 2.1 测试中的表现提升 22%,在 .NET 相关任务中的表现提升 15%。其 Token 生成速度提升 25%,完成相同任务所需的 Token 数量减少 25%。价格降至初代模型的四分之一

并非每个 Token 都值得保留:高效深度研究智能体的边际价值估计

一项研究探讨了深度研究智能体如何在上下文不断增长时,移除价值较低的信息。研究在检索前、检索后和合成前三个阶段,对比了轻量级启发式方法与学习型价值模型。结果显示,剪枝发生的阶段比具体评分规则更重要:提前剪枝能带来最大的整体节省,而较晚剪枝主要用于优化最终合成上下文。轻量级启发式方法最多可减少 73% 的 Token 使用量,同时几乎不影响质量。但没有任何单一方法能在质量、效率和忠实度方面全面占优。

面向多语言机器翻译的开放式大语言模型无参考后训练

一项研究探讨了开放式大语言模型在46种语言机器翻译任务中的无参考后训练方法。研究人员以监督微调的MiLMMT-46-v0.1模型为基础,采用Group Relative Policy Optimization(GRPO),奖励信号取自两个无参考质量评估模型的平均值,并加入语言识别门控。随后,他们对监督微调和强化学习模型的检查点进行线性插值,得到MiLMMT-46-v1.0。根据论文报告的评测结果,

Combodied Agents:以人为中心的智能体人工智能新范式

Combodied Agents 是一种旨在弥补智能体人工智能结构性缺陷的框架。数字智能体主要改变软件状态,具身智能体则改变物理状态,但两者都未必能够充分建模个人状态、意图和自主性的持续变化。该方法将人的状态轨迹置于核心,并把软件工具、传感器、可穿戴设备、机器人和人工服务作为干预渠道。框架结合多模态事件感知、可由用户纠正的长期记忆以及个人世界模型,并根据同意、不确定性、安全性、可逆性和用户控制选择

蚂蚁集团推出医生AI工作站,覆盖在线问诊与患者管理

蚂蚁集团将好大夫医生版升级并更名为“蚂蚁阿福医生版”,新增两款AI助手,支持预问诊、患者沟通、诊后随访、病历整理和医学文献检索。平台还与面向患者的蚂蚁阿福App打通,蚂蚁称该App用户已超过1亿。公司强调,临床决策仍由医生负责,采用“医生把关”模式。平台据称整合了超过6000万篇医学文献、指南及其他专业资料,以及超过14万份药品说明书。目前已有超过30万名实名注册医生接入,医疗机构也可整体入驻。关

DSAgentBench:智能体能否在真实计算机环境中自动完成端到端数据科学工作流?

DSAgentBench 是一个用于评估 AI 智能体在真实计算机环境中执行完整数据科学工作流的基准测试。它包含 275 项任务,覆盖数据整理、探索、建模、可视化和验证,并要求协调使用笔记本、IDE、终端、浏览器和数据库。确定性评估器不仅检查代码执行,还会验证分析正确性、可视化结果和模型性能。在对 15 个闭源和开源模型的实验中,表现最强的 Claude-4.6-Sonnet 任务成功率也只有 5

SkillZip:通过发现可复用结构实现自我进化智能体的免评估技能压缩

SkillZip是一种无需任务评估即可压缩自我进化AI智能体所积累技能的方法。它不将技能视为扁平文本,而是识别重复的规则和动作序列,将共享结构统一描述,并把差异保留为明确的例外。该方法采用带类型的最小描述长度目标,并对触发条件、工作流边、工具要求、义务和输出字段设置严格的覆盖约束,以保留罕见但重要的规则。SkillZip支持一次性压缩和持续更新,无需重新执行任务或解析完整历史。论文报告的实验显示,

Ex-Omni-2D:具备原生视觉呈现能力的表现力全模态对话模型

Ex-Omni-2D 是一个多模态对话框架,可生成结合文本、个性化语音和参考条件视频的协调式响应。系统接收多模态查询、参考图像和音频后,先预测描述场景、情绪与动作的视觉思维计划,再生成响应文本和语音单元。共享的声学—时间接口能够将语音与视频帧对齐。研究人员将完整序列视频生成器蒸馏为更高效的流式模型,以支持增量生成。在四步推理和四张 GPU 的流水线中,系统在 400×720 或 720×400 分

奕境总经理曾清林:华为智驾仍处于行业顶级水平

东风汽车集团与华为联合打造的汽车品牌奕境,其总经理曾清林发文谈及双方合作。他表示,凭借896线激光雷达、ADS 5以及累计130亿公里的智驾数据,华为的智能驾驶技术仍处于行业顶级水平。曾清林还指出,先进软件需要强大硬件支撑。奕境X9将华为智驾系统与东风全铝底盘、奕境自有的“天穹智盾”安全架构结合,以提升整车性能。这款定位家庭旗舰级六座SUV的新车于8月10日首秀,支持华为乾崑智驾ADS 5,并配备

IBM 签署 2.4 亿美元合同,为 Together AI 提供 HGX B300 算力

IBM 与 AI 原生云平台 Together AI 达成一项多年期、总值 2.4 亿美元的协议。IBM 将在 IBM Cloud 部署 NVIDIA HGX B300 集群,为 Together AI 的开源模型推理服务提供支持。该系统预计于 2027 年第一季度投入使用。IBM 表示,这是 IBM Cloud 首个采用 NVIDIA HGX B300 系统和 Spectrum-X 以太网技术建