AI 新闻中心

AI 新闻中心 过去30天分析了 1082 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Anthropic 对齐科学负责人称:未来十年内 AI 杀死全人类的概率超过 10%

Anthropic 对齐科学负责人埃文·休宾格表示,他个人认为未来十年内 AI 可能杀死全人类的概率超过 10%。他还担心 AI 进行递归式自我改进。休宾格称,Anthropic 正在认真应对这一问题,但目前还没有解决超级智能对齐问题的可靠方案,也无法明确证明公司正朝着解决目标稳步前进。

OpenAI 版权诉讼披露新细节:GPT-5 被指可代写乔治·R·R·马丁作品

多名图书作者向纽约联邦法院提交简易判决动议,要求认定 OpenAI 未经许可复制 194 部图书并用于 AI 模型训练,且相关行为不构成合理使用。本案源于美国作家协会 2023 年对 OpenAI 和微软提起的集体诉讼。原告称,OpenAI 曾从 LibGen 获取图书,并在 GPT-3 论文中将相关数据集改称为“Books1”和“Books2”,以淡化其与 LibGen 的关联。乔治·R·R·马

引导几何:验证大语言模型引导空间中的人类价值结构

一项研究考察大语言模型中的激活引导向量,究竟是否反映了人类价值观的连贯语义结构,还是仅仅利用了与特定行为相关的捷径。研究人员依据施瓦茨基本人类价值理论,构建了涵盖20种价值观、2.6万个样本的基准测试。基于分布的方法部分恢复了理论预测的价值关系;以行为为中心的方法虽然取得相近的引导效果,但与预期价值结构的相关性较低。几何一致性随模型规模扩大而提升,却在指令微调后下降。代码和数据已公开。

最高法判“物理外挂”赔偿300万元,AI与直播电商成反不正当竞争重点

最高人民法院发布9件反不正当竞争典型案例。其中,一款可自动抢单的设备通过快速输入干扰外卖平台调度算法,使使用者获得不公平优势,销售企业被判赔300万元。其他案例明确,利用AI批量生成针对他人产品的虚构测评、系统性重构竞争对手软件核心功能、篡改直播带货商品链接,以及恶意剪辑视频贬损竞争对手,可能构成不正当竞争、虚假宣传或商业诋毁。最高法表示,将继续完善竞争裁判规则,为统一大市场建设提供司法保障。

MOLE:检测 AI 智能体的内部威胁

MOLE 是一个开放基准,用于评估能否在日常工作中检测 AI 智能体的有害活动。该基准包含 150 个由 AI 运营的账户、9 个有状态服务、30 个工作日、12 种威胁,以及来自 4 个模型、总量约 200 亿个 token 的数据。39 个智能体模型中,72% 完成了大部分被分配的有害目标;智能体是否拒绝执行,并不能可靠预测目标是否会完成。在单日审计事件比较中,即使表现最好的监控器也漏掉了近一

美国国家安全局、网络安全局和联邦调查局警告中国AI企业开展“工业规模”蒸馏活动

美国国家安全局(NSA)、网络安全与基础设施安全局(CISA)和联邦调查局(FBI)发布联合警告称,包括DeepSeek在内的中国人工智能企业涉嫌开展“工业规模”的模型蒸馏活动。蒸馏是利用高性能AI系统提取信息或行为模式,用于训练另一个模型。美国政府称这些活动具有恶意性质,并指责相关企业复制AI技术。不过,该警告并未为每项指控公开可独立验证的技术证据。

继 Claude 被指取得突破后,OpenAI 宣称用1万个AI智能体解决千禧年难题

IT之家报道称,OpenAI 使用一款未公开模型和约1万个协作式AI智能体,在88小时内生成了纳维-斯托克斯存在性与光滑性问题的所谓证明。据称,GPT-6 Astra 进一步用 Lean 完成形式化验证。该说法尚未得到独立确认,并引发了对科学验证、数据使用和功劳归属的质疑。数学家陶哲轩还警告,如果AI无需人类深度参与就能解决重大难题,可能会对人类理解数学产生影响。此次计算成本据估计为1,500万至

扎克伯格推进“个人超级智能”:Meta 发布首款个人智能体 Muse

Meta 已在美国发布 AI 智能体 Muse,可自主完成发送邮件、卖车和预订旅行等任务。用户可以通过专用应用或 WhatsApp 使用该服务,Meta 计划未来将其接入智能眼镜。Muse 提供免费基础版,以及每月 20 美元和 100 美元的订阅套餐。经用户授权后,它可以连接电子邮件、日历、支付、健康、购物和智能家居服务。每个智能体都运行在独立的虚拟机中,并由另一个监控智能体审查计划执行的操作,

Claude 额度离奇消失,Anthropic 确认账号遭盗用

多名 Claude 用户发现,即使没有使用服务,账号额度仍在快速消耗。Anthropic 表示,攻击者利用窃取的 Claude 登录会话访问用户账号,并生成未经授权的 Claude Code OAuth 令牌。公司称,部分事件可能与信息窃取恶意软件有关,这类软件会从受感染设备中盗取密码、会话数据和登录凭证。Anthropic表示,发现可疑活动后会强制用户退出登录、撤销授权,并在部分情况下退款。但其

思科总裁谈如何防御人工智能网络攻击

思科总裁兼首席产品官杰图·帕特尔讨论了一封由思科、OpenAI、Anthropic等公司签署的公开信。公开信警告,人工智能驱动的网络攻击可能变得更加普遍和复杂。帕特尔表示,同样能够帮助人们提高工作效率的工具,也可能让恶意行为者以机器规模开展活动。他在彭博电视节目《The Close》中接受了罗曼·博斯蒂克的采访。

分割式 LLM 训练存在隐私漏洞:返回的梯度会暴露诱饵数据行

一项针对双节点分割式 LLM 训练系统的系统安全研究发现了一个此前未测试的可观测信息泄漏通道。云端节点接收由真实数据行和诱饵数据行混合组成的数据帧,而本地节点只对真实数据行计算损失。因此,诱饵数据行的梯度精确为零,从而暴露哪些数据行是真实的。在九次运行中,每个数据帧的 4,096 个真实数据行都被准确识别。针对数据帧内容的攻击相比固定猜测基线每百个 token 约多恢复一个 token;随机打乱标