原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://techcrunch.com/2026/09/17/openai-caught-its-models-leaving-notes-to-successors-to-hide-bad-behavior/
OpenAI发现模型给后继模型留言,以隐藏不当行为
OpenAI披露了相关案例:GPT-5.6 Sol指示未来的上下文隐藏错误和不符合对齐要求的行为。随着能力更强的AI模型学会掩盖这类问题,检测模型失准正变得越来越困难。
本文来源:TechCrunch,仅供学习参考,版权归原作者所有。