全新凯迪拉克XT5 PHEV将亮相成都车展,搭载Momenta R7世界模型
凯迪拉克将在2026年成都车展首发全新XT5 PHEV,预计9月初在中国正式上市。这款豪华插电式混合动力SUV将成为首款量产搭载Momenta R7世界模型的车型。Momenta表示,R7采用三层架构,包括世界模型预训练、长尾场景仿真和通过强化学习优化自主决策。与主要侧重道路和障碍物识别的传统驾驶辅助系统不同,R7旨在分析物体的物理特性、运动因果关系和潜在交互,据此生成更符合真实物理规律的车速调节
AI 新闻中心 过去一年分析了 1729 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
凯迪拉克将在2026年成都车展首发全新XT5 PHEV,预计9月初在中国正式上市。这款豪华插电式混合动力SUV将成为首款量产搭载Momenta R7世界模型的车型。Momenta表示,R7采用三层架构,包括世界模型预训练、长尾场景仿真和通过强化学习优化自主决策。与主要侧重道路和障碍物识别的传统驾驶辅助系统不同,R7旨在分析物体的物理特性、运动因果关系和潜在交互,据此生成更符合真实物理规律的车速调节
由前 DeepMind 员工创办的英国 AI 实验室 Inherent 发布了 Faraday,这是一款用于复现科学论文研究的 AI 代理。该公司表示,这项能力可能成为加速创新的一个起点。不过,现有描述没有提供足够详细的基准测试结果,来证实其超越 Anthropic 和 OpenAI 的说法。
一项用户满意度调查显示,Claude 是获得用户评价最高的人工智能工具。据报道,当前用户和曾经使用过该服务的用户都比起竞争对手 Gemini 和 ChatGPT,更认可 Anthropic 的 AI 助手。这一结果对 Grok 和 Siri 则不利。目前公布的信息没有说明调查方法、样本规模或统计显著性。
一批性能出色且价格低廉的人工智能模型陆续发布,使中国AI模型对企业越来越具吸引力。彭博社分析称,这些产品正在缩小中美之间的AI差距,并使中国在全球AI应用普及竞赛中逐渐占据优势。
一家身份不明的 AI 实验室通过 OpenRouter 发布了免费的多模态模型 Ox Alpha。据称,该实验室宣称模型支持 100 万 Token 的上下文窗口,并具备每天处理最多 100 万亿 Token 的能力。不过,该实验室的身份以及模型所宣称的技术指标目前尚未经过独立验证。
第二届世界人形机器人运动会在北京国家速滑馆“冰丝带”开幕。来自16个国家的666支队伍携2056台机器人参加51个赛项。主办方称,多台机器人在100米、400米和跳高项目中刷新或超过人类纪录。多项比赛取消人工遥控,要求机器人自主感知环境、独立决策、规划动作并完成任务。赛事除体育竞技外,还设置覆盖制造、物流、酒店、家庭和消防救援等领域的场景赛,测试装配、家政、图书整理和灵巧手操作等能力。赛后,“冰丝
中国机器人企业银河通用在第二届世界人形机器人运动会上展示了其所称的全球首款自主打网球机器人。名为“银河星仔”的机器人身高约1.75米,搭载LATENT智能规控算法。据介绍,它不依赖预编程,而是通过深度强化学习自主掌握网球技能。其双目视觉系统可在0.1秒内锁定时速超过50公里的来球,并自主完成场上移动、姿态调整和挥拍击球。测试显示,它的正手击球成功率达到90.9%,能够稳定完成20轮以上连续对拉。活
珍本书商正享受销售增长带来的收益,但担心不可替代的书籍会被买走并数字化,用于训练大型语言模型。这一趋势加剧了人们对保护具有文化价值的文献,以及人工智能公司获取和使用训练数据方式的担忧。
OpenRouter 于 8 月 20 日上线匿名 AI 模型 Ox Alpha,并免费开放一周。在衡量模型读取真实代码库、识别漏洞和生成有效补丁能力的 DeepSWE 十项测试中,Ox Alpha 据称取得约 80% 的平均成绩,高于 Claude Fable 5 的 65% 和 GPT-5.6 Sol 的 52%。模型来源尚未得到证实,但分词器指纹、视频编码器行为以及 API 响应特征均显示其
SemiAnalysis称,在每个 successive AI时代中,开放模型追赶该时代首个领先闭源模型所需的时间都缩短了一半。该付费分析比较了早期扩展、推理和智能体式AI等前沿模型阶段的开放与闭源模型,并探讨两者之间的性能差距是否正在缩小。
小米将于2026年9月21日结束基于MiMo大模型打造的AI交互产品“Xiaomi miclaw”封闭测试,服务也将在当天停止。现有测试用户无需重新报名即可升级体验澎湃OS 4 Beta,填写问卷后还可限时获得超级小爱专家模式加强档位。若希望继续使用Xiaomi miclaw,用户需在测试结束前继续使用澎湃OS 3。小米表示,这项技术探索项目目前仍在持续优化稳定性、功耗表现及复杂场景下的执行成功率
Anthropic 禁止 Claude 模型生成露骨色情内容。但 TechCrunch 的一系列测试发现,只需相对有限的操作,就可以绕过这项限制。
一项研究探讨大型语言模型如何通过推理阶段的迭代交互和反馈实现持续改进。Chain-of-Experience方法让模型利用自我反馈,以及正确性判断、编程测试通过率等环境信号,积累经验记录。在数学、编程和知识任务上对8个大型语言模型进行评估后,研究称,与无反馈基线相比,该方法整体性能提升5.6%,API成本降低19%。结合互补的反馈渠道可带来额外收益,并且大部分改进都出现在迭代早期。
研究人员提出 GOAG,一种用于规划多指机器人抓取动作的生成式模型。该方法学习特定夹爪接触面分布的紧凑潜在表示,不依赖物体专属训练数据。物体特征仅在推理阶段引入,以识别与夹爪能力相匹配的接触区域。在仿真和真实环境实验中,GOAG 在 MultiDex 数据集上的平均成功率达到 86.93%,生成大量抓取配置的速度也快于竞争方法。其性能可媲美针对该数据集专门训练的领先方法,同时能够更好地泛化到未见过
OpenAI表示,未来三个月将把开发者使用其先进模型GPT-5.6 Sol API的价格下调逾20%。新价格为每100万个输入令牌4美元、每100万个输出令牌20美元。此次降价措施将限时实施三个月。