AI 新闻中心

AI 新闻中心 过去一年分析了 7989 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

上汽 MG 07 后续将通过 OTA 升级 Momenta R7 世界模型

上汽 MG 07 已于 2026 成都车展上市,后续计划通过 OTA 升级 Momenta R7 世界模型。Momenta 表示,超过 95% 的用户选择了其智能驾驶辅助方案。目前车辆搭载 Momenta 强化学习大模型,以及芯航途 XHEART X7 大模型专用芯片。升级后,MG 07 预计将支持车位到车位自动驾驶、行车漫游等功能。Momenta 宣称 R7 在多个关键场景的性能可提升数倍,但这

阿里云视频生成模型 Wan3.0 正式上线,支持单次生成 30 秒视频及文档输入

阿里云正式上线视频生成模型 Wan3.0。官方称,该模型单次可生成最长 30 秒的视频,并首次支持将 DOC、XLS、PPT、PDF、Markdown 等文档作为输入。经过十余天公测后,Wan3.0 在指令遵循、跨镜头一致性、音频质量和视频编辑等方面进一步改进。模型已接入阿里云百炼、万相、通义千问等多个平台。480P、720P 和 1080P 视频的 API 价格分别为每秒 0.3 元、0.6 元

迈向对人类购物行为的忠实模拟

该研究提出了RecVerse,这是一种基于图形用户界面的智能体,用于模拟跨越多个页面的真实购物会话。为解决长会话中的记忆问题,系统采用受认知机制启发的分层记忆,包括工作记忆、会话内的情景记忆和高层次的偏好记忆。RecVerse还通过轨迹级强化学习目标进行优化,对完整会话而非单个动作进行评估,从而使模拟行为更接近真实用户。研究团队同时发布了USB,这是一个用于多轮用户模拟的交互式电子商务GUI轨迹数

AgentMercury 大规模生成可验证的企业场景环境

AgentMercury 是一个研究框架,可根据高层级商业场景自动生成可执行环境。它不为单一任务构建环境,而是创建包含实体、服务、工具、状态以及可验证跨服务不变量的持久化世界。研究团队覆盖 14 个行业和 50 个国家,生成了 4,783 个环境,并将其用于强化学习训练。训练后,Qwen3.5-4B 在企业工作流以及推理、编程、科学计算和工具使用等域外基准测试中均有所提升。此外,对 Qwen3.5

智元远征 A3 夺得人形机器人太极拳项目金牌

中国机器人企业智元机器人宣布,其人形机器人远征 A3 在第二届世界人形机器人运动会武术太极拳项目中获得金牌。智元目前累计取得 3 金、3 银、2 铜。公司介绍称,A3 采用自研关节,最大电流达 150A,瞬时功率为 12kW,整机重量为 55 公斤,可完成空翻等动作。智元此前还宣称,A3 已能以全自主方式进行乒乓球对抗。官方标称续航时间最长 10 小时,并支持 10 秒快速换电。相关性能数据及刷新

数学自动形式化取得重大进展:OpenBMB开源MathForm,8B模型超越更大模型

OpenBMB开源了MathForm,这是一套用于将自然语言数学表述自动形式化为Lean4的框架、数据集和模型。系统结合检索机制与编译器、语义一致性引导的验证流程,并根据Lean的诊断结果最多进行三轮修正。FormalVerse数据集包含超过36.7万个经过验证的Lean4示例。根据公开测试,使用FormalVerse训练的模型一致性检查率达到60.32%,高于FineLeanCorpus的46.

大语言模型智能体时代的图工程:从个体智能到系统智能

大语言模型智能体正从语言生成器发展为能够执行复杂长期任务的自主系统。文章指出,当任务需要异质专业知识、并行子任务、独立验证和持久状态时,单个智能体的能力或上下文扩展会面临架构限制。作者提出“系统智能”概念,强调将多个专业智能体组织并协调到共同目标之下。“图工程”通过显式、动态且不断演化的图结构表示任务、智能体和系统状态,从而支持复杂目标的组织、异质智能体的协作以及系统演进。文章系统总结了这一范式的

微软放宽 Windows 11 智能应用控制启用限制

微软正在简化 Windows 11“智能应用控制”的启用流程。该安全功能利用云端智能和代码签名信息,在不受信任或可能有害的应用运行前将其拦截。此前,用户通常必须全新安装 Windows 才能启用该功能。现在,受支持的设备可通过“设置 > Windows 安全中心 > 应用和浏览器控制 > 智能应用控制设置”开启或关闭。适用设备为运行 Windows 11 22H2 或更高版本的电脑。不过,实际操作

摩尔线程发布《MTT S5000 Prefill-as-a-Service技术白皮书》

摩尔线程发布了一份基于MTT S5000 AI智算卡的“Prefill-as-a-Service”技术白皮书,面向AI Agent、代码生成和超长文档分析等长上下文推理场景。该方案将主要受计算能力限制的Prefill阶段,与更依赖显存带宽的Decode阶段分离,并分别部署在专用硬件资源池中。公司称,这种配置有望改善首字延迟、处理吞吐和基础设施成本效率。此次发布主要提出了一种推理系统架构,消息中未提

Anthropic 最强模型在 IPO 前遇冷,企业转向低价替代方案

美国企业正逐渐放弃 Anthropic 最强大的模型 Fable 5,转而选择更便宜的替代产品。支付集团 Ramp 的支出数据显示,Fable 5 发布两个月后,企业对其支出仅占 Anthropic 工具总支出的约 11%,此后采用率趋于停滞。分析师认为,主要原因是定价过高,而旧款模型已经能够满足大多数需求。中国及其他地区的低价开放权重模型也为客户提供了更多选择。OpenAI 则凭借价格更低的新模

CLEAR:在保持实用性的同时实现大语言模型安全对齐的连续潜在适配器路由

CLEAR是一种大语言模型安全对齐方法,通过隐藏状态中的轻量级门控机制,连续控制安全低秩适配器的激活强度。该方法旨在减少有害回答,同时避免对良性提示下的基础模型进行不必要的修改。在Llama-3-8B-Instruct测试中,CLEAR将HarmBench攻击成功率从32.3%降至0.5%,并保留了模型大部分实用性。在GSM8K准确率方面,其表现也比全局应用的SFT或LoRA高出最多7.1个百分点

端侧AI格局生变:vivo蓝心登顶手机模型评测榜单

SuperCLUE发布了最新的手机端侧大模型评测结果。vivo蓝心BlueLM 3.5 Nano 3B以89.86分排名第一,据该评测,其表现接近多个主流云端模型。Qwen3.5 9B和Qwen3.5 4B分别以87.82分和85.16分位列第二、第三。端侧模型能够在手机本地处理文本和图像,无需持续联网,因而有助于提升隐私保护和离线使用能力。不过,手机硬件限制了模型规模,也限制了其处理复杂任务的性