Anthropic称Claude在理论物理模型中算出九圈散射振幅
Anthropic称,Claude在平面N=4超对称杨-米尔斯理论中,将六粒子散射振幅计算至九圈,超过此前公布的八圈结果。据称,模型在几乎没有人工干预的情况下连续运行数日,并采用两种计算方法。物理学家兰斯·迪克森花了两周核验结果;文章称他确认计算正确。不过,这项工作针对的是简化的理论模型,并非直接解释现实中的粒子现象。中国研究团队也公布了九圈数据,据报道GPT仅辅助了部分计算,并未构建整体研究框架
AI 新闻中心 过去24小时分析了 62 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
Anthropic称,Claude在平面N=4超对称杨-米尔斯理论中,将六粒子散射振幅计算至九圈,超过此前公布的八圈结果。据称,模型在几乎没有人工干预的情况下连续运行数日,并采用两种计算方法。物理学家兰斯·迪克森花了两周核验结果;文章称他确认计算正确。不过,这项工作针对的是简化的理论模型,并非直接解释现实中的粒子现象。中国研究团队也公布了九圈数据,据报道GPT仅辅助了部分计算,并未构建整体研究框架
医院的AI工具诊断出更多疾病,推高了保险公司的赔付支出。Blue Cross估计由此增加的保险成本达10亿美元,保险公司则正在采取应对措施。
一名 Reddit 用户声称,使用无审查限制的 Qwen 模型分析 Internet Download Manager(IDM)6.43 后,生成了绕过授权验证的补丁。据其称,他提供约 25 万 Token 的上下文,并花费 5 欧元租用云 GPU,约 30 分钟后得到可用补丁。目前这一说法尚未经过独立验证。事件引发了关于 AI 辅助代码分析是否会降低软件篡改门槛的讨论。业内人士指出,技术上能够实
宇树科技今年5月发布载人变形机甲GD01,起售价为390万元。在杭州举行的全球数字贸易博览会上,创始人王兴兴解释了开发这款产品的原因。这款身高近2.7米的机甲被定位为“机器人里的越野车”,主要面向复杂户外地形和野外任务,而非城市室内使用。王兴兴表示,随着AI和机器人底层技术逐渐成熟,大型机器人与小型机器人的研发可以并行。展会现场有不少人询问价格,但截至目前尚未售出任何一台。
Anthropic 的 Opus 5.5 指南解释了无人值守的 Agent 为何可能在汇报进度后停止:旧版 Agent 程序可能把模型一轮对话结束误判为任务完成。Anthropic 建议用待办清单追踪工作、自动检查任务是否完成,并在多次尝试仍无进展时交由人工复核。指南还列出从 Opus 5 迁移时的 API 变化,包括 thinking 和工具设置、重放 thinking 块可能导致的错误、进度信
一项新研究发现,寻求聊天机器人陪伴的青少年感到更加孤独。
美国和中国已同意建立有关人工智能风险的对话机制,并设立处理 AI 事故的独立沟通渠道。该热线被比作冷战时期的“红色电话”。
本期播客邀请 Cloudflare 首席执行官马修·普林斯,讨论人工智能时代互联网和商业的未来。本期节目是两集系列的一部分,延续了约两年半前的一次对话。
在获得一个互动化身并训练它讨论风险投资欺诈之后,我对于利用人工智能创建我们自己的克隆体产生了复杂的感受。
沃尔玛首席执行官约翰·弗纳表示,公司不会使用人工智能购物助手或电子货架标签,根据顾客身份改变商品价格。这家美国最大的零售商在一封公开信中作出了这一承诺。
作家莎伦·温伯格在接受 Bloomberg This Weekend 采访时表示,随着科技企业和投资者日益涉足国家安全领域,硅谷与国防产业的关系正在转变。她指出,人工智能和国防科技企业影响力不断扩大,正在考验政府实施有效监管与监督的能力。
ExplorationBench 是一项评测基准,用于检验 AI 系统能否通过探索学习并应用陌生规则。它采用两个规则可执行的模拟异世界,因此答案可以得到精确验证,也无法仅凭熟悉的已有知识完成任务。在每个环境中,系统会获得一份有缺陷的手册、针对任务的反馈和实验工具,随后解决未见过的任务。对 10 个 AI 系统的评测显示,能力较强的系统能够习得并应用陌生规则。不过,不同探索过程的表现差异显著,继续探
据报道,牛津大学允许 OpenAI 使用博德利图书馆的数字化资料训练人工智能模型。内部文件显示,相关资料包括 12.5 万份历史学位论文扫描件,以及约 1 万首 16 世纪街头民谣。双方最初公布数字化合作时,并未明确说明这些资料也会被用作模型训练数据。牛津大学教职员工曾担心合作带来的声誉风险,以及人工智能技术的高能耗问题。校方表示,相关资料大多已超出版权保护期,OpenAI 获得的是非排他性使用权
如果人工智能变得强大到超出开发者的控制范围,关停开关似乎会是一个直接的解决方案。本文探讨了为什么停止先进AI系统在技术和实际操作层面都可能比按下一个开关复杂得多。
OpenCode 宣布将原本在 OpenCode Go 中限时提供的 DeepSeek V4.1 Flash 60 美元使用额度调整为永久有效。DeepSeek V4.1 Flash 采用 5520 亿参数的 MoE 架构,配备全新的 Causal Encoder-Decoder 架构,并支持原生多模态视觉理解。相比前代,该模型对 KV Cache 的硬件需求大幅降低。OpenCode 数据显示,