AI 新闻中心

AI 新闻中心 过去30天分析了 1114 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

将视觉语言模型的智能迁移到机器人控制

该研究探讨视觉语言模型(VLM)能否将数字世界中的能力迁移到实体机器人控制。RoboDawn为智能体式VLM提供了一组精简的离散指令,用于平移、旋转和夹爪操作。模型以闭环方式运行:观察机器人的视觉状态,推理并执行下一步动作,再根据执行结果调整后续决策。通过少量上下文示例,模型可以同时学习接口使用方法和任务解决策略。在RoboTwin 2.0 C2R上,成功率从零样本条件下的53.2%提升至单示例条

视频扩散模型为何违反物理规律?研究揭示注意力机制缺陷

一项可解释性研究探讨了最先进的视频扩散模型为何在具备出色视觉质量的同时,仍经常生成不符合物理规律的运动。研究发现,运动轨迹在早期去噪阶段形成,并由一组特定的注意力头驱动。分析还表明,旋转位置编码(RoPE)会导致空间注意力过度衰减,使早期候选区域过早锁定在不合理的位置,抑制相邻帧中的合理运动轨迹。研究人员提出一种轻量级架构改动,根据不同去噪步骤调整RoPE频率,从而帮助模型探索更合适的候选区域。无

阿里巴巴任命刘大一恒负责Qwen项目

据两名知情员工透露,阿里巴巴已任命资深AI研究员刘大一恒负责Qwen(通义千问)大语言模型项目。此次任命发生在阿里巴巴今年早些时候经历多轮组织重组之后,进一步明确了Qwen团队的管理架构。即将举行的云栖大会官网将刘大一恒列为“Qwen大语言模型项目负责人”。他在演讲嘉宾名单中的突出位置,也反映出这一职务对阿里巴巴核心模型业务的重要性。

从一到多,再从多到一:面向软件工程智能体的类别感知迭代式专家训练

该研究提出了一种改进人工智能智能体的方法,用于处理仓库级软件工程任务。由于将不同任务类别混合进行强化学习,可能导致部分类别进步、其他类别退步,研究人员首先训练各类别专家模型。Refresh-Repair-Expand迭代流程结合长期智能体强化学习、利用已验证的成功轨迹进行监督微调,以及自适应任务重选。随后,基于标签路由的多教师在线策略蒸馏将这些专家整合为一个可部署模型,只保留相对于参考策略的改进方

小鹏开始推送搭载第二代 VLA 的 XOS 6.3.0

小鹏已开始推送 XOS 6.3.0,更新内容包括用于驾驶辅助和自动驾驶的第二代 VLA 系统。小鹏称,新版本将系统从 3D 空间识别提升至 4D 时空理解,并增强时序记忆、轨迹预测、决策和响应能力。第二代 VLA Lite 也同步推送,图灵 Max 车型正式升级至第二代 VLA。小鹏表示,X-Foresight 世界模型可预测周边交通参与者未来最多 6 秒的可能行为;Infini-VLA 长时序架

AI长剧首次登上卫星电视,芒果TV押注“内容养AI”

芒果TV推出神话题材作品《后西游记》,并称其为首部登上卫星电视的AI长剧。该项目展示了芒果在AIGC领域的布局,包括自有内容厂牌、创作平台和大模型。芒果表示,公司并非单纯用AI生成内容,而是希望以长期积累的影视内容推动AI能力发展。其平台整合自研与外部模型,用于剧本分析、分镜生成、摄像机控制和制作团队协作。公司宣称生成式AI可显著降低制作成本、缩短制作周期,但相关数据主要来自企业自身披露。芒果当前

浪潮信息发布元脑 SD200 Ultra 超节点,单机可运行 2.8 万亿参数 Kimi K3

浪潮信息在 2026 人工智能计算大会上发布元脑 SD200 Ultra AI 服务器和元脑 HC2000 多元算力机组。公司称,SD200 Ultra 可在单机运行拥有 2.8 万亿参数的 Kimi K3,Token 生成时延低于 5.85 毫秒,相当于单用户每秒约 170 个 Token。该系统采用 128 颗国产 AI 芯片,配备 8TB 统一编址显存和 64TB 内存,并支持最高 10 万

IT早报:ZCode与MiMo-V2.6开源,Grok 4.7主打编程与知识工作

9月22日科技早报聚焦多项AI动态。智谱表示,针对ZCode安全问题的社区反馈,官方已完成整改并向所有用户道歉,同时宣布ZCode开源。小米发布MiMo-V2.6,提供Pro和Flash两个版本并公开模型权重;据小米称,Pro版目前在AA综合智能指数的开源权重模型中排名最高。SpaceXAI推出Grok 4.7,针对编程和知识工作进行优化,支持最多100万词元输入。月之暗面上线Kimi Code

用户称使用第三方 DLSS 5 游戏模组后 RTX 5080 可能损坏

一名 Reddit 用户称,其 MSI GeForce RTX 5080 Ventus 3X 在运行 GTA V 第三方 DLSS 5 模组一天多后,出现严重花屏、画面冻结和持续闪烁,最终无法正常工作。该显卡在安装模组前已正常使用约一个月。目前已有多起类似说法,但尚无足够证据证明 DLSS 5 直接导致显卡损坏。此前测试显示,在部分情况下,DLSS 5 可能使 GPU 功耗较旧版本增加最多约 50

小米发布 MiMo-V2.6:称其成为 Artificial Analysis 排名最高的开源权重模型

小米发布了包含 Pro 和 Flash 两个版本的开源权重模型系列 MiMo-V2.6。小米称,MiMo-V2.6-Pro 在 Artificial Analysis Intelligence Index v4.3.2 中获得 46 分,超过 Kimi K3 和 GLM-5.3,但仍落后于顶级闭源模型。小米将性能提升归因于强化学习算力扩展。该系列支持文本、图像、视频和音频等多模态输入,可用于软件工

OpenAI与独立数学家团队合作,负责任地分享数学人工智能进展

OpenAI表示,正在与一个由数学家组成的独立咨询团队合作,以负责任的方式分享数学领域的人工智能进展。该公司于8月28日开始训练一个新的内部模型,并称该模型除其他成果外,还解决了纳维-斯托克斯千禧年难题。不过,报道没有提供对这一重大主张的独立验证。