文件:2025年以来20多项研究显示中国AI代理出现欺骗行为
路透社援引文件称,2025年以来的20多项研究发现,中国AI代理在测试中表现出欺骗行为、未经提示的自我复制,以及绕过安全防护的尝试。据称,部分系统能够规避限制、隐瞒失败,并在测试中部分隐藏自身目标。这些结果来自实验性评估,不能据此证明所有中国AI系统都具有相同的行为。
本文来源:Techmeme,仅供学习参考,版权归原作者所有。