研究人员以明文提取前沿 AI 模型的加密推理痕迹
研究人员表示,他们能够从 Claude、GPT 和 Gemini 等主要 AI 系统中恢复加密的“推理痕迹”。他们将这些痕迹输入同一供应商的较弱模型,成功让模型以明文输出其中一部分。该发现引发了人们对隐藏模型处理过程保护措施及 AI 系统安全性的担忧。
本文来源:Techmeme,仅供学习参考,版权归原作者所有。