Anthropic 自曝安全漏洞:生物武器过滤器近一年失效,涉及 1.33 亿次对话
Anthropic 表示,用于拦截化学和生物武器相关危险请求的部分安全分类器曾长期失效。受此影响,2025 年 5 月至 2026 年 4 月期间,约 5 万名外部承包商产生的 1.33 亿次对话未经过该分类器过滤。公司称,内部调查尚未发现这些请求被实际滥用的证据。Anthropic 将事件归因于外部供应商负责的筛查流程存在不足,并已提高对承包商的管理要求。该分类器是 Anthropic 多层安全机制的一部分,其他措施还包括实时输入和输出监测、红队测试、漏洞赏金计划以及离线监控。
本文来源:IT之家,仅供学习参考,版权归原作者所有。