AI 新闻中心

AI 新闻中心 过去一年分析了 1732 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

中国日均 Token 调用量突破 500 万亿,中国大模型稳居全球第一梯队

据中国官媒报道,截至2026年6月,中国日均 Token 调用量已突破500万亿。报道指出,大模型竞争持续加剧,模型迭代周期缩短,算力需求快速增长。行业竞争重点正从单纯追求模型能力,转向智能体落地和生态建设。腾讯表示,混元3正式版上线首周的 Token 调用量,是上一代混元2的68倍。中国科技企业正在加快建设人工智能智算中心,并通过长期协议锁定算力资源。报道中的相关数据和行业判断主要来自媒体及业内

何小鹏:目标2027年获欧洲监管许可并交付第二代VLA

小鹏汽车董事长何小鹏表示,公司希望在2027年率先获得欧洲监管许可,并开始向更多海外用户交付第二代VLA系统。小鹏称,该系统已在德国完成本地化验证,在几乎不增加本地训练数据的情况下,实际体验已接近中国市场。公司正加快欧洲市场的量产适配,并计划在中国和欧洲使用同一套模型。相关欧洲许可尚未取得,性能表现目前主要依据企业自身披露,2027年交付仍属于公司目标。

10万张国产算力卡支撑“牛来”:智谱开源GLM-5.3-Flash

智谱宣布上线并以MIT协议开源多模态模型GLM-5.3-Flash(320B-A18B)。该模型总参数320B、激活参数18B,支持100万Token上下文,并采用稀疏注意力与线性注意力混合架构及mHC技术。据Artificial Analysis评测,模型得分57分,与Claude Opus 4.8持平,高于文中提到的GLM-5.2和DeepSeek V4 Pro。智谱称其调用价格仅为部分竞品旗

小鹏第二代 VLA 新版本将于 9 月推送至所有 Ultra 和 Ultra SE 车型

小鹏汽车宣布,第二代 VLA 新版本将于 9 月面向所有 Ultra 和 Ultra SE 车型推送。蒸馏版第二代 VLA Lite 也预计在同月开始首批推送,小鹏 G9L Max 将首发搭载。小鹏表示,该系统基于统一技术底座,能力覆盖 L2 至 L4。通过学习式 Token 压缩和蒸馏训练,公司计划在保留输入信息和模型容量的同时,将基础模型部署到算力更低的平台。新版本首次搭载 X-Foresig

从3.3GB压缩至440MB:腾讯混元极低比特量化基本保持翻译质量

腾讯混元团队将旗下18亿参数的端侧翻译模型Hy-MT2大幅压缩。2-bit版本大小为574MB,1.25-bit版本则将原本3.3GB的模型压缩至440MB。方案结合了弹性量化、量化感知蒸馏,以及腾讯自研的Sherry稀疏三值量化技术。英特尔针对包括最新酷睿Ultra在内的x86处理器,对低比特矩阵运算进行了适配和优化。哔哩哔哩已将该压缩模型用于直播弹幕实时翻译。完整下载资源约600MB,运行时内

小鹏首次将 X-Foresight 世界模型搭载上车,可预测未来 6 秒路况

小鹏发布了第二代 VLA 驾驶模型的新版本。X-Foresight 世界模型可提前模拟周边交通参与者未来 6 秒内的可能行为,例如前车突然刹停或行人改变方向。系统结合 Flow Matching 生成多种未来情景,利用 Infini-VLA 保留更长的时间上下文,并通过混合架构将不同驾驶任务动态分配给专门的模型组件。小鹏称,流式自回归推理使端到端响应速度提升 300%,实现边观察、边推理、边行动。

小鹏将 Master Agent 引入车辆,第二代 VLA 推出全新版本

小鹏发布了第二代 VLA 模型的全新版本。首次推出的 Master Agent 基于小鹏自研的 Omni 全模态模型,将自然语言理解与智能辅助驾驶、车辆控制相结合。它可以把用户意图自动拆解为任务,并协调智驾、底盘、座舱和车身控制等专用 Agent 执行。在演示中,车辆能够根据语音指令靠边停车。新版本还可以理解模糊的语义,例如根据对门店的不完整描述找到目标门店并规划路线。

小鹏汽车以第二代 VLA 进入主驾无人的公路测试关键阶段

小鹏汽车宣布,搭载第二代 VLA 的 Robotaxi 近日获得广州市智能网联汽车远程测试资质,可在广州一至三级测试道路开展主驾无安全员测试。公司称,新版 VLA 已实现 L2 至 L4 能力贯通,并计划向更多量产车型及海外场景扩展。小鹏还通过 Token 压缩和蒸馏训练,将模型部署到算力更低的平台。上述信息来自企业活动,尚未公布独立的性能验证结果。

Claude Cowork 新增内置浏览器,可独立完成网页操作

Anthropic 为 Claude Cowork 桌面应用加入了独立的内置浏览器。Claude 可以使用它浏览网页、读取内容、点击按钮、填写表单,以及从在线门户提取数据,而不会访问用户现有浏览器中的标签页、书签或保存的密码。该功能将陆续向 macOS、Windows 和 Linux 上的 Pro、Max 及 Team 用户开放,Enterprise 管理员已可为组织启用。用户可以按网站导入登录信

小鹏:第二代 VLA 升级的核心是建立对时间维度的理解

小鹏汽车通用智能中心负责人刘先明表示,第二代视觉—语言—动作(VLA)模型首次将时间维度纳入模型。新推出的 Infini-VLA 长时序架构可记忆此前 30 秒的环境信息,为驾驶判断提供更长的上下文。小鹏还采用流式自回归推理,并宣称端到端响应速度提升 300%,使模型能够在道路状况不断变化时并行完成观察、思考和行动。相关性能数据来自小鹏的企业介绍,报道未提供独立测试或第三方验证。

亚马逊据称将英伟达芯片订单增至三倍,GPU成为全球战略资源

亚马逊与英伟达将扩大双方的战略合作。亚马逊此前已宣布部署超过100万枚英伟达GPU,据称还计划为AWS数据中心追加200万枚芯片,涵盖未来的Blackwell Ultra、Rubin和Rubin Ultra架构,预计于2027年至2028年部署。双方尚未公布具体财务条款。合作范围还将延伸至CPU、网络硬件、软件、开源模型和机器人平台。AWS计划把英伟达Nemotron模型整合进Bedrock和Sa

千问办公首发上线 Qwen3.8-Flash,推出全新标准模式

千问办公已上线 Qwen3.8-Flash,并向全体用户开放搭载该模型的新标准模式。官方表示,该模式可通过更低的积分消耗和更高的 Token 吞吐效率处理日常办公任务。千问办公计划建立标准模式与高级模式的双模型体系。官方还称,Qwen3.8-Flash采用全新架构,总参数规模达千亿级,并在内部测试中超过 Claude Opus 4.6。企业实测数据显示,标准模式单任务生成速度提升约一倍,Token

Next-Chunk 推理强化学习真的优于 SFT 吗?重新审视无 CoT 数据下的训练策略

一项受控研究比较了 Next-Chunk 推理强化学习与 Mixed SFT。后者是一种更简单的监督微调方法,同时使用无 CoT 数据和长 CoT 数据进行训练。Mixed SFT 在 RLVR 后的性能上限明显更高,而所需训练算力减少了 60 倍以上。这一优势在领域内数学推理和领域外推理任务中均得到体现。研究表明,Next-Chunk RL 的收益可能主要来自更有效地利用无 CoT 数据,而不一

英伟达CEO黄仁勋:在很多任务上我们已经实现AGI

英伟达CEO黄仁勋表示,在许多任务上,人工智能已经可以被视为实现了通用人工智能(AGI),因此传统的AGI里程碑正变得不那么重要。他指出,AI智能体正日益具备自主性,能够执行任务,并通过反复运行持续改进。黄仁勋认为,当前行业更重要的是AI能否完成具有生产力和盈利能力的工作,以及更多算力能否带来更多可产生收入的Token。不过,批评者指出,现有大型语言模型仍存在幻觉、缺乏持久记忆、逻辑理解能力有限等