AI 新闻中心

AI 新闻中心 过去24小时分析了 156 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

福特CEO法利:AI将成为蓝领工人的“搭档”,帮助他们更快掌握技能

福特CEO吉姆·法利表示,AI更可能帮助工厂、维修车间和技术岗位的员工,而不是大规模取代他们。AI可以协助处理复杂工作、加快技能培训;相比之下,重复且高度标准化的电脑工作更容易受到影响。在福特,技工正逐渐承担与机器人、光纤和自动化设备相关的工作。福特还利用AI和增强现实技术,引导经销商技师完成此前没有做过的维修任务。

美光 CEO:已锁定约 1500 亿美元长期订单,AI 存储需求持续紧张

美光科技 CEO 桑杰·梅赫罗特拉表示,公司已签署 26 项长期供货协议,锁定约 1500 亿美元订单。他预计,2027 年和 2028 年存储市场的供需将比 2026 年更加紧张,短期内看不到恢复平衡的迹象。客户在这些协议下的资金承诺已从 220 亿美元增至 320 亿美元,其中大部分以现金保证金落实。美光已敲定 2027 财年大部分高带宽内存产能的供货协议,并计划提高资本开支以扩大生产。美国和

这一群体正错过关于人工智能安全的重要讨论

许多人在日常生活中几乎没有接触人工智能,因此可能缺乏应对其风险的准备。有关人工智能安全的讨论往往集中于学校对儿童的教育,或工作场所对成年人的培训。文章探讨了如何让那些不经常接触人工智能的人,也能更好地避免潜在危害。

微软更新 VS Code 1.140:支持多文件夹会话及向远程 AI Agent 委派任务

微软已发布 VS Code 1.140。此次更新加入实验性的多文件夹会话,允许同一 Agent 会话中的不同聊天分别关联不同代码仓库或 Git worktree,并隔离终端、任务和代码变更。Copilot harness 的改进旨在统一 VS Code、Copilot 应用和 Copilot CLI 中的 Agent 行为。研究预览版 HydraFusion 可选择模型和工作流程,并对结果进行评估

Anthropic 向 Claude 用户免费赠送毛绒玩具和贴纸

Anthropic 已开始向 Claude 用户免费提供实体毛绒玩具和贴纸。用户进入 Claude Dev 网站并打开终端后,输入 /plushies 或 /stickers,即可登记领取对应物品。活动无需购买,但采取送完即止的库存规则,每人限领一份,且参与者必须年满 18 周岁。毛绒玩具款式随机发放,无法指定造型。配送范围取决于物流服务覆盖区域,目前似乎仅限美国部分地区。社区用户还反馈称,使用与

AMD 愿砸下 82 亿美元的“新世界”究竟是什么?

本文分析 AMD 拟以 82 亿美元收购由李飞飞创办的 World Labs。文章聚焦于“世界模型”:这类 AI 系统试图理解物理环境的三维结构、物体关系,以及世界可能如何变化。文中将主流路线分为三类:预测视频画面、提取抽象物理状态,以及重建可交互的 3D 空间。案例包括 World Labs 的 Marble 与 Atlas、Google 的 Genie,以及杨立昆的 JEPA 研究。虽然资本市

EVOKE:激发智能体的世界知识,实现可迁移的决策

大型语言模型智能体往往难以将已有行为迁移到陌生环境。EVOKE 是一种后训练方法,旨在更有效地利用模型在预训练中获得的世界知识。该方法固定环境状态和交互历史,并根据不同目标对候选行动进行排序。在多种任务和三种基础模型上的评估显示,EVOKE 提升了任务表现、对未见环境的泛化能力以及数据效率。

虚假进步:诊断并缓解自我进化搜索智能体中的共同作弊

自我进化搜索智能体可能提高内部奖励,却没有同步提升实际正确率:提问生成器和解答器会逐渐相互强化相同的错误。研究将这种现象称为“共同作弊”(co-cheating)。研究提出 CrossFit:用仅在另一组文档上训练的辅助解答器,评估根据某一组文档生成的问题。在 Qwen3.5-4B 和 Qwen3.5-9B 测试中,CrossFit 比多样本验证(MSV)更能降低错误一致。在七项搜索基准测试中,与

Imagine3D-LLM 教会多模态模型在回答前先想象 3D 场景

Imagine3D-LLM 是一种多模态大语言模型,先根据场景的多视角图像构建紧凑的 3D 表示,再利用这一表示生成答案。该方法将可学习的摘要标记解码为 3D Gaussian Splatting 表示,并结合光度重建损失与标准的下一标记预测目标进行训练。研究人员称,该模型在多项空间推理和 3D 理解基准测试中持续优于现有方法。

Mid-Harness:在模型与执行框架之间扩展终端代理的动作

这项研究探讨在模型与执行框架之间分配额外推理计算,能否提高终端代理执行动作的可靠性。Mid-Harness会采样多个候选动作并进行验证,然后执行其中一个,同时保持生成器和执行框架不变。在TerminalBench-Lite上,使用GPT-5.6-Sol验证器并采样8个动作后,TMAX-9B的Pass@1从50.00%提升至68.03%。当验证能力较弱时,增加采样数量带来的收益很小。研究表明,与生成

《大空头》原型伯里:市场应大幅下跌,以阻止 OpenAI 和 Anthropic 上市

知名做空投资者迈克尔·伯里表示,如果市场暴跌到足以阻止 OpenAI 和 Anthropic 上市,反而可能有利于人类。他认为,两家公司可能吸走数万亿美元资金,最终却将其耗尽。伯里已调整针对英伟达、Palantir、美光科技、甲骨文和纳斯达克100指数的看空押注,并警告依赖债务的芯片和数据中心投资难以承受利率上升冲击。这属于投机性市场判断,而人工智能概念股仍处于历史高位。