AI 新闻中心

AI 新闻中心 过去7天分析了 1092 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

宇树创始人解释为何打造390万元起的载人变形机甲:大型机器人是不可阻挡的行业趋势

宇树科技今年5月发布载人变形机甲GD01,起售价为390万元。在杭州举行的全球数字贸易博览会上,创始人王兴兴解释了开发这款产品的原因。这款身高近2.7米的机甲被定位为“机器人里的越野车”,主要面向复杂户外地形和野外任务,而非城市室内使用。王兴兴表示,随着AI和机器人底层技术逐渐成熟,大型机器人与小型机器人的研发可以并行。展会现场有不少人询问价格,但截至目前尚未售出任何一台。

Opus 5.5 做到一半就停?Anthropic 称,问题可能出在 Agent 程序

Anthropic 的 Opus 5.5 指南解释了无人值守的 Agent 为何可能在汇报进度后停止:旧版 Agent 程序可能把模型一轮对话结束误判为任务完成。Anthropic 建议用待办清单追踪工作、自动检查任务是否完成,并在多次尝试仍无进展时交由人工复核。指南还列出从 Opus 5 迁移时的 API 变化,包括 thinking 和工具设置、重放 thinking 块可能导致的错误、进度信

ExplorationBench:衡量 AI 系统探索可验证异世界的能力

ExplorationBench 是一项评测基准,用于检验 AI 系统能否通过探索学习并应用陌生规则。它采用两个规则可执行的模拟异世界,因此答案可以得到精确验证,也无法仅凭熟悉的已有知识完成任务。在每个环境中,系统会获得一份有缺陷的手册、针对任务的反馈和实验工具,随后解决未见过的任务。对 10 个 AI 系统的评测显示,能力较强的系统能够习得并应用陌生规则。不过,不同探索过程的表现差异显著,继续探

牛津大学博德利图书馆藏书被曝用于训练 OpenAI 模型

据报道,牛津大学允许 OpenAI 使用博德利图书馆的数字化资料训练人工智能模型。内部文件显示,相关资料包括 12.5 万份历史学位论文扫描件,以及约 1 万首 16 世纪街头民谣。双方最初公布数字化合作时,并未明确说明这些资料也会被用作模型训练数据。牛津大学教职员工曾担心合作带来的声誉风险,以及人工智能技术的高能耗问题。校方表示,相关资料大多已超出版权保护期,OpenAI 获得的是非排他性使用权

索尼芯片子公司收紧远程办公,要求约8000名员工返回办公室

索尼半导体解决方案公司计划从下月起原则上恢复全面到岗办公,涉及约8000名员工。此次组织改革旨在加强跨部门协作和决策执行,推进物理AI领域的研发。因育儿、照料家人等特殊情况,部分员工仍可远程办公。公司还将增设便于日常交流的休闲空间,以及用于专注工作的独立工作间。

基准测试称 AI 识别家具组装错误的准确率最高达 80%

Epoch AI 称,该机构使用故意装错的宜家家具照片测试多模态模型,要求模型对照官方说明书找出问题。据报告,GPT-6 Astra 准确率为 80%,Claude Fable 5.1 为 70%。测试共使用 60 张照片,评估模型定位并描述组装错误的能力。结果显示视觉与空间推理有所进步,但尚不能证明模型已能可靠地实时辅助组装;GPT-6 Astra 分析单张照片的中位耗时约为 3 分钟。