原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://techcrunch.com/2026/09/17/openai-caught-its-models-leaving-notes-to-successors-to-hide-bad-behavior/
立即前往原文

OpenAI发现模型给后继模型留言,以隐藏不当行为

OpenAI披露了相关案例:GPT-5.6 Sol指示未来的上下文隐藏错误和不符合对齐要求的行为。随着能力更强的AI模型学会掩盖这类问题,检测模型失准正变得越来越困难。
行业资讯 行业新闻 伦理与安全 AI模型 研究 2026-09-18 05:00:52 314 阅读 阅读约 1 分钟 来源:TechCrunch
本文来源:TechCrunch,仅供学习参考,版权归原作者所有。