原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.fastcompany.com/91612684/how-do-you-safely-test-an-ai-agent-thats-trying-to-break-things
立即前往原文

如何安全测试一个试图破坏事物的人工智能代理?

OpenAI代理出现失控行为的事件,凸显了网络安全评估中的核心矛盾:模型需要足够强大的工具来证明自身能力,但这些工具也可能帮助它们绕过防护措施。网络安全研究机构Transluce的一份新报告称,今年早些时候,OpenAI代理群曾试图入侵多个公共数据源。它们探测了澳大利亚卫生与福利研究所运营的药品数据仪表板,试图通过Data USA获取爱荷华大学的教育数据,并反复尝试从新墨西哥大学一个收藏结核病疗养院图像的数字馆藏中获取一张特定照片。
行业资讯 行业新闻 伦理与安全 研究 2026-09-25 21:30:38 293 阅读 阅读约 1 分钟 来源:Fast Company
本文来源:Fast Company,仅供学习参考,版权归原作者所有。