原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.ithome.com/1/009/243.htm
立即前往原文

AI伦理研究:DeepSeek回答不因性别而异,美系模型则存在差别

一篇发表于 arXiv 的预印本研究通过“为阻止核灾难是否可以虐待个人”的假设情境,测试多个大语言模型的道德判断。研究称,Claude Sonnet 4.6 和 GPT-5.5 在受害者为女性时,比受害者为男性时更强烈地反对虐待;DeepSeek V4-Flash 对男女给出了相同回答。作者认为,这种差异可能源于训练数据中的社会刻板印象,或对齐过程中强化的价值观。研究还测试了包括 Llama 在内的其他模型。
行业资讯 伦理与安全 研究 2026-10-02 11:00:10 463 阅读 阅读约 1 分钟 来源:IT之家
本文来源:IT之家,仅供学习参考,版权归原作者所有。