AI 新闻中心

AI 新闻中心 过去24小时分析了 49 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Anthropic称Claude在理论物理模型中算出九圈散射振幅

Anthropic称,Claude在平面N=4超对称杨-米尔斯理论中,将六粒子散射振幅计算至九圈,超过此前公布的八圈结果。据称,模型在几乎没有人工干预的情况下连续运行数日,并采用两种计算方法。物理学家兰斯·迪克森花了两周核验结果;文章称他确认计算正确。不过,这项工作针对的是简化的理论模型,并非直接解释现实中的粒子现象。中国研究团队也公布了九圈数据,据报道GPT仅辅助了部分计算,并未构建整体研究框架

用户称借助 AI 绕过 IDM 授权验证,引发争议

一名 Reddit 用户声称,使用无审查限制的 Qwen 模型分析 Internet Download Manager(IDM)6.43 后,生成了绕过授权验证的补丁。据其称,他提供约 25 万 Token 的上下文,并花费 5 欧元租用云 GPU,约 30 分钟后得到可用补丁。目前这一说法尚未经过独立验证。事件引发了关于 AI 辅助代码分析是否会降低软件篡改门槛的讨论。业内人士指出,技术上能够实

宇树创始人解释为何打造390万元起的载人变形机甲:大型机器人是不可阻挡的行业趋势

宇树科技今年5月发布载人变形机甲GD01,起售价为390万元。在杭州举行的全球数字贸易博览会上,创始人王兴兴解释了开发这款产品的原因。这款身高近2.7米的机甲被定位为“机器人里的越野车”,主要面向复杂户外地形和野外任务,而非城市室内使用。王兴兴表示,随着AI和机器人底层技术逐渐成熟,大型机器人与小型机器人的研发可以并行。展会现场有不少人询问价格,但截至目前尚未售出任何一台。

Opus 5.5 做到一半就停?Anthropic 称,问题可能出在 Agent 程序

Anthropic 的 Opus 5.5 指南解释了无人值守的 Agent 为何可能在汇报进度后停止:旧版 Agent 程序可能把模型一轮对话结束误判为任务完成。Anthropic 建议用待办清单追踪工作、自动检查任务是否完成,并在多次尝试仍无进展时交由人工复核。指南还列出从 Opus 5 迁移时的 API 变化,包括 thinking 和工具设置、重放 thinking 块可能导致的错误、进度信

ExplorationBench:衡量 AI 系统探索可验证异世界的能力

ExplorationBench 是一项评测基准,用于检验 AI 系统能否通过探索学习并应用陌生规则。它采用两个规则可执行的模拟异世界,因此答案可以得到精确验证,也无法仅凭熟悉的已有知识完成任务。在每个环境中,系统会获得一份有缺陷的手册、针对任务的反馈和实验工具,随后解决未见过的任务。对 10 个 AI 系统的评测显示,能力较强的系统能够习得并应用陌生规则。不过,不同探索过程的表现差异显著,继续探

牛津大学博德利图书馆藏书被曝用于训练 OpenAI 模型

据报道,牛津大学允许 OpenAI 使用博德利图书馆的数字化资料训练人工智能模型。内部文件显示,相关资料包括 12.5 万份历史学位论文扫描件,以及约 1 万首 16 世纪街头民谣。双方最初公布数字化合作时,并未明确说明这些资料也会被用作模型训练数据。牛津大学教职员工曾担心合作带来的声誉风险,以及人工智能技术的高能耗问题。校方表示,相关资料大多已超出版权保护期,OpenAI 获得的是非排他性使用权