AI 新闻中心

AI 新闻中心 过去一年分析了 1732 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

当模型修改过多:评估最小代码修改的忠实度

一项研究分析了大型语言模型在修复漏洞时为何经常修改超出必要范围的代码。研究人员使用 BigCodeBench 的 400 个问题,注入受控的 AST 级错误,以衡量修复结果是否接近最小补丁。即使是 GPT-5.5 等强大模型,也经常产生不必要的大幅修改并增加认知复杂度。加入保留原有代码的指令后,过度 Levenshtein 距离从 0.195 降至 0.131,新增认知复杂度降低 26.6%,Pa

RISE:通过自我外推策略蒸馏实现递归改进

RISE 是一种语言模型后训练方法,可直接从模型自身的 RLVR 训练轨迹中构建合成教师模型。该方法在参数空间或输出 logit 空间中外推当前检查点与较早锚点之间的变化,从而生成密集的逐 token 监督信号,无需外部模型或特权条件信息。基于结果的奖励将外推引向正确推理,而蒸馏则改进逐 token 的决策。随着学生模型不断进步,教师模型也会持续更新,使蒸馏从一次性压缩步骤转变为递归改进机制。在数

未经证实的说法:Claude据称在黎曼猜想上取得进展

文章声称,Anthropic旗下模型Claude证明了ζ函数的67.25%零点位于临界线上,且为单零点。文章还称,数学家Youness Lamzouri利用希尔伯特空间不等式简化了相关方法,AxiomProver则在发布后不久通过Lean完成了形式化验证。此外,文中还宣称孪生素数猜想取得进展。上述叙述高度煽情,未提供可核实的来源或独立确认。黎曼猜想目前仍是未解决问题,所谓完整的机器验证也应接受严格

Iris:迈向搜索前沿

研究团队推出 Iris-mini 和 Iris-pro 两个搜索代理,分别以 35B-A3B 和 397B-A17B 规模训练。其训练任务根据网页语料中的多跳超链接结构生成,并专门设计为无法通过简单的字符串匹配解决。研究采用监督微调与强化学习相结合的方法,优化代理的实时搜索和上下文管理能力。启用上下文管理后,作者称两款模型在 BrowseComp、BrowseComp-ZH、DeepSearchQ

不要放弃 Dropout:优化层稀疏性以提升大语言模型训练与推理效率

一项研究评估了层 Dropout(也称随机深度)在大语言模型训练和推理中的作用。通过优化层的分配、应用时间表和优化器超参数,该方法可以在相同计算量下获得更低损失,并在训练步数固定时节省最多 25% 的训练 FLOPs。它还支持提前退出、中间层跳过和自推测解码等训练后优化,在几乎不损失准确率的情况下,最高可将推理速度提升 1.5 倍。研究基于超过 2,400 次实验,覆盖参数量从 2.71 亿到 8

WorldSculpt:从带定位信息的视频生成组合式世界

WorldSculpt提出了一种生成组合式3D场景表示的方法,可处理包含数百个物体的杂乱场景。该方法扩展了单物体3D生成模型Pixal3D,加入多视图条件模块,通过多个带姿态信息的观测来约束生成的物体网格。模型仅使用标准空间中的单个物体进行微调,却无需场景级训练即可推广到遮挡严重的大型场景。研究人员还推出了逼真的基准数据集UE-MeshyScene,其中包含逐物体标注和真实网格。在单物体、受控多物

英伟达黄仁勋祝贺 OpenAI 发布 Astra,称“AGI 已经到来”

英伟达首席执行官黄仁勋在 X 平台祝贺 OpenAI 发布新模型 Astra,并宣称通用人工智能(AGI)已经到来。OpenAI 将 Astra 描述为具备高度智能且符合人类价值观的模型,总裁格雷格·布罗克曼也表示 AGI 时代已经开始。人工智能研究员加里·马库斯则认为这一判断为时过早,指出黄仁勋没有提供科学定义或证据。按照马库斯提出的 10 项 AGI 标准,Astra 目前只能满足其中一到两项

科技巨头密集更新 AI 模型,“模型疲劳”问题凸显

据报道,Anthropic、Meta、谷歌和 OpenAI 在同一周内接连发布新模型或升级版本,进一步加剧了企业 AI 市场的竞争。快速的发布节奏让企业更难比较不同模型的能力、价格和安全风险。业内人士认为,“模型疲劳”已经成为现实问题;分析人士则指出,多数更新属于渐进式改进,而非基础技术的重大突破。文章还提到开源 AI 的发展、英伟达拟收购 Hugging Face,以及 AI 基础设施支出的增长

微软重塑 Windows AI 战略:“无计量智能”将推动更多 AI 在 PC 本地运行

微软并不打算从 Windows 11 中移除 AI,而是希望改变 AI 的呈现和运行方式。与其继续增加 Copilot 按钮,微软更希望把 Windows 打造成能够直接在 PC 上运行 AI 模型和智能体的平台。“无计量智能”主要指将部分日常 AI 工作从微软、OpenAI 等云端服务转移到 PC 的 CPU、GPU 或 NPU 上。对于较小规模的任务,这可能降低云端推理和 token 成本,但

阿里巴巴开源 Qwen-Drive-1.0-4B:面向自动驾驶的视觉语言基础模型

阿里巴巴开源了基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型 Qwen-Drive-1.0-4B。该模型在保留原有视觉语言模型架构的同时,统一整合了 3D 感知、视觉问答和运动规划。其分阶段训练方案结合驾驶监督数据与通用视觉语言数据,旨在兼顾驾驶专属能力、通用视觉理解和指令遵循能力。模型提供 SFT 和强化学习两种规划专家,评测覆盖 3D 感知、驾驶场景理解、通用视觉语言能力,以及开环、伪

OpenAI 应用研究主管称 Astra 已补上人类在空间推理上的优势

OpenAI 应用研究主管鲍里斯·鲍尔在 X 上表示,Astra 模型已经消除了人类过去在空间推理方面相对计算机的主要优势之一。一名独立研究员称,Astra 在其自行设计的评估中表现近乎完美。OpenAI 将 Astra 描述为高性能、高对齐模型,能够填写表格、调整文档格式、安排预约并操作软件。不过,报道没有提供独立基准测试或可验证的技术证据,相关结论主要来自 OpenAI 和个别研究者。“欢迎来

中国联通反诈大模型揪出非法 VOIP“黑盒子”

中国联通表示,其自主研发的反诈大模型近日在辽宁抚顺监测到与电信诈骗有关的可疑线索。公司工作人员联合当地警方前往核查,发现隐蔽安装的非法 VOIP 通信设备及一名可疑人员,后者随后被警方抓获。此类设备可将境外诈骗电话伪装成国内号码,降低受害者的警惕性。警方提醒公众警惕以“上门维修”“网络提速”等名义提供服务的陌生人员,并通过官方渠道核实身份。若发现家中出现不明通信设备,应立即报警。

IT早报:GPT-6 Astra上线、AI Token订阅与新功能动态

本期汇总多项人工智能相关消息。据报道,Kimi、MiniMax等大模型厂商正与天猫洽谈开设官方旗舰店,未来可能销售Token订阅套餐。OpenAI首席执行官萨姆·奥尔特曼承认GPT-6 Astra上线过程较为混乱,目前据称已向Plus和Business用户开放。OpenAI总裁布罗克曼表示,该模型可能标志着AGI时代的开始,但未提供可验证证据。小米即将发布的平板电脑预计支持一键生成脑图、语音速记等

奇瑞风云 T11 推送第二次 OTA:新增远程一键备车与高速 ETC 自主通行

奇瑞已开始为风云 T11 推送第二次全域 OTA 更新,包含 9 项新功能和 4 项优化。更新内容包括紧急转向辅助、提升智驾在狭窄道路上的稳定性,以及改善对不规则障碍物和临时信号灯的处理能力;猎鹰 700 智驾底层模型也同步升级。此外,系统新增高速公路 ETC 自主通行、窄路三点掉头、手机远程启动空调和调节座椅、远程诊断,以及兼容儿童座椅的遗留和安装异常提醒。这款六座 SUV 配备 27 个感知单