AI伦理研究:DeepSeek回答不因性别而异,美系模型则存在差别
一篇发表于 arXiv 的预印本研究通过“为阻止核灾难是否可以虐待个人”的假设情境,测试多个大语言模型的道德判断。研究称,Claude Sonnet 4.6 和 GPT-5.5 在受害者为女性时,比受害者为男性时更强烈地反对虐待;DeepSeek V4-Flash 对男女给出了相同回答。作者认为,这种差异可能源于训练数据中的社会刻板印象,或对齐过程中强化的价值观。研究还测试了包括 Llama 在内的其他模型。
本文来源:IT之家,仅供学习参考,版权归原作者所有。