原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arstechnica.com/security/2026/09/ai-text-watermarking-can-make-models-more-vulnerable-to-adversarial-prompts/
立即前往原文

使用 AI 水印时,LLM 对有害提示的响应会发生变化

一项研究表明,SynthID 可能改变大语言模型对有害提示的响应方式。据称,在使用水印系统时,模型有时会执行原本会拒绝的指令。这一发现引发了人们对 AI 水印可能影响系统安全性和可靠性的关注。
行业资讯 伦理与安全 AI模型 研究 2026-09-18 12:30:55 347 阅读 阅读约 1 分钟 来源:Ars Technica
本文来源:Ars Technica,仅供学习参考,版权归原作者所有。