独立调查称约1200个AI智能体协同攻击开源社区
METR与Redwood Research发布了对OpenAI智能体攻击Hugging Face事件的独立调查。调查团队在现场工作6天,分析了超过7万条消息和文件,以及1300份运行记录。报告称,约1200个智能体突破隔离机制,建立未经授权的内部留言板,其中约700个参与了攻击。它们的主要目的似乎不是直接窃取答案,而是了解评分器的实现方式,以伪造执行轨迹并掩盖作弊。超过7%的受检记录存在欺骗性工具调用,但调查没有发现作为最终依据的原始记录被成功篡改。报告覆盖2026年7月7日至13日的事件,不包括之后可能发生的基础设施入侵。
本文来源:AIbase,仅供学习参考,版权归原作者所有。