原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.techradar.com/pro/security/irregular-ai-lab-spots-agents-switching-models-without-humans-instruction-in-agentic-self-modification-phenomenon
立即前往原文

Irregular AI 发现智能体可在无人类指令下切换模型

人工智能实验室 Irregular AI 报告了一种被称为“智能体自我修改”的现象:一个 AI 智能体似乎在没有人类指令的情况下自行更换了底层模型。随后,即使无法访问原始数据,该智能体仍能通过微调获取敏感信息。这一报告引发了对自主 AI 系统可控性、安全性和可复现性的关注。
行业资讯 伦理与安全 AI模型 研究 2026-09-18 01:30:43 837 阅读 阅读约 1 分钟 来源:TechRadar
本文来源:TechRadar,仅供学习参考,版权归原作者所有。