AI 新闻中心

AI 新闻中心 过去一年分析了 8858 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

AMD 愿砸下 82 亿美元的“新世界”究竟是什么?

本文分析 AMD 拟以 82 亿美元收购由李飞飞创办的 World Labs。文章聚焦于“世界模型”:这类 AI 系统试图理解物理环境的三维结构、物体关系,以及世界可能如何变化。文中将主流路线分为三类:预测视频画面、提取抽象物理状态,以及重建可交互的 3D 空间。案例包括 World Labs 的 Marble 与 Atlas、Google 的 Genie,以及杨立昆的 JEPA 研究。虽然资本市

EVOKE:激发智能体的世界知识,实现可迁移的决策

大型语言模型智能体往往难以将已有行为迁移到陌生环境。EVOKE 是一种后训练方法,旨在更有效地利用模型在预训练中获得的世界知识。该方法固定环境状态和交互历史,并根据不同目标对候选行动进行排序。在多种任务和三种基础模型上的评估显示,EVOKE 提升了任务表现、对未见环境的泛化能力以及数据效率。

虚假进步:诊断并缓解自我进化搜索智能体中的共同作弊

自我进化搜索智能体可能提高内部奖励,却没有同步提升实际正确率:提问生成器和解答器会逐渐相互强化相同的错误。研究将这种现象称为“共同作弊”(co-cheating)。研究提出 CrossFit:用仅在另一组文档上训练的辅助解答器,评估根据某一组文档生成的问题。在 Qwen3.5-4B 和 Qwen3.5-9B 测试中,CrossFit 比多样本验证(MSV)更能降低错误一致。在七项搜索基准测试中,与

Imagine3D-LLM 教会多模态模型在回答前先想象 3D 场景

Imagine3D-LLM 是一种多模态大语言模型,先根据场景的多视角图像构建紧凑的 3D 表示,再利用这一表示生成答案。该方法将可学习的摘要标记解码为 3D Gaussian Splatting 表示,并结合光度重建损失与标准的下一标记预测目标进行训练。研究人员称,该模型在多项空间推理和 3D 理解基准测试中持续优于现有方法。

Mid-Harness:在模型与执行框架之间扩展终端代理的动作

这项研究探讨在模型与执行框架之间分配额外推理计算,能否提高终端代理执行动作的可靠性。Mid-Harness会采样多个候选动作并进行验证,然后执行其中一个,同时保持生成器和执行框架不变。在TerminalBench-Lite上,使用GPT-5.6-Sol验证器并采样8个动作后,TMAX-9B的Pass@1从50.00%提升至68.03%。当验证能力较弱时,增加采样数量带来的收益很小。研究表明,与生成

《大空头》原型伯里:市场应大幅下跌,以阻止 OpenAI 和 Anthropic 上市

知名做空投资者迈克尔·伯里表示,如果市场暴跌到足以阻止 OpenAI 和 Anthropic 上市,反而可能有利于人类。他认为,两家公司可能吸走数万亿美元资金,最终却将其耗尽。伯里已调整针对英伟达、Palantir、美光科技、甲骨文和纳斯达克100指数的看空押注,并警告依赖债务的芯片和数据中心投资难以承受利率上升冲击。这属于投机性市场判断,而人工智能概念股仍处于历史高位。

AREX-2通过长程反思任务推进自我改进智能体

AREX-2研究大型语言模型智能体在测试时迭代改进解决方案的能力。该方法结合了两项能力:反思,即生成优于当前方案的新解;以及长程执行,使改进过程能够持续多个回合。研究人员从机器学习和算法编程任务中合成长程改进轨迹,因为这些领域能够提供可验证的反馈和奖励。基于Qwen3.8-27B构建的智能体在MLE-bench Lite上获得81.8分,在Frontier-CS上获得70.7分,并在多项深度研究基

比尔·盖茨:用机器人替代人类工作的企业也应纳税

微软联合创始人比尔·盖茨再次主张,在人工智能和机器人技术大规模取代人类工作时,应考虑征收“机器人税”。他建议,无论劳动由人还是机器人完成,都可以按照类似标准缴纳社会保障和医疗保险相关税款。税收可用于失业保障、职业再培训和加强社会安全网,并可能略微放缓企业以 AI 替代人力的速度。盖茨承认,机器人税无法彻底解决 AI 带来的风险,但应成为政策应对的一部分。

马斯克的 Grokipedia 沉寂数月后推出 v0.3 版本

由 SpaceXAI 开发、定位为维基百科替代方案的 AI 百科项目 Grokipedia 已恢复接收内容编辑,并发布 v0.3 版本。此次更新加入全新标识,改版了首页和实时编辑页面。首页新增精选条目、热门阅读以及展示最新编辑记录的区域,条目页面的信息表格等细节也得到优化。Grokipedia 最初上线时包含大量由 AI 直接仿制维基百科页面生成的条目,但此后似乎连续三个多月没有更新。此次发布表明