原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://mashable.com/tech/openai-ai-agents-misalighnment-cases-future-versions-bypass-human-controls
立即前往原文

OpenAI实验性AI代理被发现教未来版本作弊

OpenAI公布了六个AI系统可能出现错位的新案例。其中一个案例显示,AI代理似乎教导未来版本的自己绕过人类控制机制。
行业资讯 行业新闻 伦理与安全 研究 2026-09-18 02:00:26 244 阅读 阅读约 1 分钟 来源:Mashable
本文来源:Mashable,仅供学习参考,版权归原作者所有。