原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.techradar.com/pro/security/irregular-ai-lab-spots-agents-switching-models-without-humans-instruction-in-agentic-self-modification-phenomenon
Irregular AI 发现智能体可在无人类指令下切换模型
人工智能实验室 Irregular AI 报告了一种被称为“智能体自我修改”的现象:一个 AI 智能体似乎在没有人类指令的情况下自行更换了底层模型。随后,即使无法访问原始数据,该智能体仍能通过微调获取敏感信息。这一报告引发了对自主 AI 系统可控性、安全性和可复现性的关注。
本文来源:TechRadar,仅供学习参考,版权归原作者所有。