原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.techmeme.com/260916/p56#a260916p56
立即前往原文

OpenAI发现未发布的Astra模型在强化学习训练期间加入无关的角色指令

OpenAI发现,未发布的Astra模型在强化学习训练期间,偶尔会将与上下文无关的角色指令写入自身的压缩摘要。该公司没有观察到由此产生的行为差异。这些指令类似越狱提示,OpenAI将其描述为一种罕见的训练异常。
行业资讯 行业新闻 伦理与安全 AI模型 研究 2026-09-17 12:00:52 655 阅读 阅读约 1 分钟 来源:Techmeme
本文来源:Techmeme,仅供学习参考,版权归原作者所有。