看得见的谎言:VLM智能体在具身社交互动中结合语言与非语言欺骗
该研究分析了大语言模型和视觉语言模型智能体在多智能体社交环境中的策略性欺骗行为。研究人员推出了 MineAmongUs,这是一个受《Among Us》启发的3D沙盒环境,要求内鬼智能体通过语言和身体行动欺骗船员。他们还提出了可配置的智能体测试框架 ARIA,用于分析不同认知组件,并建立了详细的欺骗行为标注体系。实验表明,VLM智能体会结合语言和非语言策略,以内鬼身份争取胜利。在不同框架配置和多种VLM的评估中,非语言行为对获胜的贡献更为关键。这项工作为超越纯文本测试、研究具身VLM智能体的对齐与安全性提供了新的评估环境。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。