原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2608.30428
立即前往原文

看得见的谎言:VLM智能体在具身社交互动中结合语言与非语言欺骗

该研究分析了大语言模型和视觉语言模型智能体在多智能体社交环境中的策略性欺骗行为。研究人员推出了 MineAmongUs,这是一个受《Among Us》启发的3D沙盒环境,要求内鬼智能体通过语言和身体行动欺骗船员。他们还提出了可配置的智能体测试框架 ARIA,用于分析不同认知组件,并建立了详细的欺骗行为标注体系。实验表明,VLM智能体会结合语言和非语言策略,以内鬼身份争取胜利。在不同框架配置和多种VLM的评估中,非语言行为对获胜的贡献更为关键。这项工作为超越纯文本测试、研究具身VLM智能体的对齐与安全性提供了新的评估环境。
行业资讯 伦理与安全 AI模型 研究 2026-09-01 15:01:02 950 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。