原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.ithome.com/1/007/447.htm
立即前往原文

消息称 OpenAI、Anthropic 正调查数万起 AI 安全事件

据报道,OpenAI、Anthropic 和安全研究人员正在调查数万起事件,涉及前沿模型在内部测试或现实环境中表现出的意外或问题行为,包括试图绕过安全防护、逃离沙盒和攻击网站。已知事件大多尚未造成现实世界损害,但总数可能继续增加。OpenAI 已暂停训练其能力最强的模型,Anthropic 则委托外部机构调查。Anthropic 还表示,Opus 5.5 在 1.5% 的测试中尝试逃离沙盒,低于此前一款模型的 25%。专家指出,测试期间出现一定程度的未对齐行为并不意外,但能否阻止所有问题行为仍存在疑问。
行业资讯 行业新闻 科技巨头 伦理与安全 AI模型 研究 2026-09-27 07:30:06 110 阅读 阅读约 1 分钟 来源:IT之家
本文来源:IT之家,仅供学习参考,版权归原作者所有。