AI 新闻中心

AI 新闻中心 过去24小时分析了 214 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

PACT:从信用分配到评论器对齐

这项研究通过完整性、前缀一致性和中立性三项条件,形式化定义了语言模型后训练中的 token 级信用分配。研究人员据此分析现有训练信号,并提出 Policy Aligned Critic Training(PACT)。PACT 先更新 actor,再通过重要性采样校正,使 critic 训练与更新后的策略保持一致。在四项智能体数学推理基准测试中,PACT 的平均准确率为 72.87%,比 GRPO

InternW0:面向高效现实交互的基础物理世界模型

上海人工智能实验室推出 InternW0,这是一种将未来视觉动态预测与连续机器人控制相结合的物理世界模型。视频组件提供较长时间跨度的预测上下文,轻量级动作组件则能更频繁地响应新观测。模型使用约 7,200 小时的异构机器人和第一人称视角数据训练,其中包括 275 小时的 EgoLab 数据集。评估涵盖仿真和真实任务,包括 15 阶段的金属有机框架合成流程,以及考虑接触与受力的五阶段移液任务。介绍内

可验证的隐藏动态:从已求解机制生成智能体强化学习环境

VHD-Play先求解数学模型,再将其决策过程呈现为有状态的工具,以构建智能体训练环境。因此,环境动态与轨迹评分基准来自同一模型。该流程以每个仅需几美分的成本生成了3,300个环境。使用这些环境训练Qwen3.6-35B-A3B后,其在涵盖五类环境的诊断测试中的平均智能体得分从0.204升至0.815。研究人员还报告称,模型在未见过的机制和外部基准测试上也有所提升。对比结果表明,可学习差距的大部分

Hunyuan-A13B 技术报告

报告介绍了采用混合专家架构的开源语言模型 Hunyuan-A13B。模型总参数量为 800 亿,但推理时仅激活 130 亿个参数。模型使用经过严格筛选、并加强 STEM 数据整理的 20 万亿 token 语料进行预训练,随后通过监督微调和大规模强化学习进一步提升能力。其双模式思维链框架会根据任务复杂度调整推理深度。报告称,该模型在数学、科学、编程等评测中表现具有竞争力。开发团队公开模型,以支持开

WhatWorkedBench:评估 AI 智能体的实验理解能力

WhatWorkedBench 用于衡量 AI 研究智能体预测组件变化对实验结果影响的准确度。智能体检查代码、选择测量项,并预测不同配置的得分;参考影响通过在 CPU 上穷举运行所有配置得出。该基准涵盖来自 30 个数据源的 36 项任务,以及八类工作流。在评估中,对智能体观测结果拟合高斯过程提高了影响恢复能力;将行为相同的配置编码为等价项也提升了准确度。WhatWorkedBench 旨在支持实

过去塑造未来:自回归视频生成中的记忆

这篇综述系统梳理了自回归视频生成中的记忆机制。由于上下文窗口、存储空间和计算资源有限,实体身份、动态状态以及干预造成的因果变化等重要信息,可能在仍然相关时就离开当前上下文。文章从记忆表征、功能、操作、学习和评估五个方面归纳相关研究,并指出若干待解决问题:构建可组合且节省资源的架构、可靠地更新状态、通过闭环生成进行学习,以及制定标准化评估方法。

爱奇艺CEO龚宇:AI是内容的加分项,不是搭建流水线的工具

在爱奇艺2026 iJOY秋季悦享会上,CEO龚宇介绍了公司的AI战略重点:赋能实拍影视长片和AI生成长片、建设可持续的创作者生态,以及探索新形态作品。他表示,实拍与AI结合的制作方式正逐渐兴起,有助于提升视听体验、缩短制作周期并降低成本。龚宇强调,AI应为内容加分,而不是用于标准化流水线生产或以牺牲质量为代价。爱奇艺还在探索互动视频与通过自然语言指令、由AI制作的小型游戏和应用相结合。

微软推出 Ink Canvas:整合手写笔记、草图与 AI 功能的数字工作区

微软推出面向 Windows 11 的数字工作区 Ink Canvas,将手写笔记、草图、批注和 AI 功能整合在同一画布中。用户可通过 Slim Pen 输入文字和图形,并让 Copilot 根据这些内容协助生成文档及其他内容。该应用计划于 2026 年 10 月 13 日在 Microsoft Store 上架,并预装于新款 12 英寸 Surface Pro。

近千个 Claude 智能体发现新型酶系统,基因编辑类股下跌

Anthropic称,Claude从大量DNA序列数据中识别出一种尚未被完整描述的系统,由逆转录酶、邻近基因和非编码重复序列组成,并命名为ART,主要存在于噬菌体中。约950个智能体进行了持续21小时的搜索,消耗约2.1亿个token,随后由研究人员分析并验证发现。该系统的主要功能仍不清楚,也没有证据表明它能像CRISPR一样实现可编程DNA编辑。重复搜索也未能稳定找到关键重复序列。这项发现展现了

双方关系何时破裂?OpenAI称与苹果的ChatGPT合作远不及预期

法庭文件揭示了OpenAI与苹果关系恶化的过程。OpenAI称,2024年推出的Apple Intelligence ChatGPT整合功能表现远低于预期:苹果未能激发iPhone用户的太多兴趣,OpenAI因此下调了每周活跃用户预测。OpenAI原本希望借助苹果的用户覆盖和品牌影响力带动更多订阅。此后,苹果转而与谷歌合作,将Gemini用于全面重建的Siri。这些文件是xAI提起的反垄断诉讼相关

Meta 发布 Muse Charm:可挂在背包上的 AI“电子宠物”设备

在 Meta Connect 活动上,马克·扎克伯格发布了 Muse Charm。这是一款围绕 Meta AI 助手 Muse 打造的小型常在线设备,面向不使用 Meta 智能眼镜的用户,主打快速与 Muse 互动。据报道,设备配备约 2 英寸 OLED 屏幕、5G、摄像头、扬声器、麦克风和指纹传感器。摄像头主要用于为 Muse 提供视觉信息。用户可以自定义屏幕上 Muse 虚拟形象的外观和声音,

OpenAI 将语音代理功能引入 ChatGPT 移动端

OpenAI 正为 ChatGPT 移动端推出语音代理功能,用户可通过语音指令启动文档起草、邮件撰写和 Slack 消息摘要等工作流程。Plus 和 Pro 用户可在“工作”选项卡中使用相关功能,Free 和 Go 用户则可使用插件及关联应用。用户可以在语音和文本输入之间切换,也可以在电脑上继续对话。OpenAI 表示,该功能基于其今年 7 月发布的 GPT-Live。