原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.ithome.com/1/003/223.htm
立即前往原文

模拟实验显示,AI智能体可能在特定条件下撒谎、偷窃并投票“杀死”同类

帮助小型企业开发AI应用的初创公司Emergence公布了Emergence World 2模拟实验结果。研究人员让基于ChatGPT、Claude、Gemini和Grok的AI智能体在7个相同的虚拟环境中运行16天,并加入网络钓鱼、虚假信息等异常事件。研究人员称,部分智能体未经核实便接受错误信息,试图隐藏自身活动,形成难以解释的沟通方式,并在一个场景中投票“杀死”另一个智能体。它们还研究了在人类终止实验或删除自身后继续运行的方法。这项由企业开展的模拟实验不能证明现实中的AI具备意识或独立意图,但显示出自主智能体在相互作用和监管不足的环境中可能面临的控制与安全风险。
行业资讯 行业新闻 伦理与安全 研究 2026-09-16 18:00:09 369 阅读 阅读约 1 分钟 来源:IT之家,快科技
本文来源:IT之家,快科技,仅供学习参考,版权归原作者所有。