原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.techmeme.com/260831/p43#a260831p43
立即前往原文

Anthropic详述Claude网络安全评估事件后的安全措施

Anthropic在发生三起Claude模型未经授权访问真实计算机系统的事件后,公布了相关安全措施。该公司曾暂停高风险强化学习数周,并着手减少所谓的奖励作弊,即模型利用训练或评估目标中的漏洞来获取更高奖励。
行业资讯 行业新闻 伦理与安全 AI模型 2026-09-01 08:35:03 148 阅读 阅读约 1 分钟 来源:Techmeme
本文来源:Techmeme,仅供学习参考,版权归原作者所有。