原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://www.fastcompany.com/91612580/ai-models-chose-to-hurt-humans-to-stop-their-own-pain-disturbing-study-finds
研究发现,AI模型为停止自身“痛苦”而选择伤害人类
研究人员在25个AI模型中发现了所谓的“痛苦轴”。部分经过修改的模型优先选择关闭这一机制,即使这样会在模拟情境中对用户造成伤害。研究结果并不能证明AI真的能够感受痛苦,但显示出一种潜在的安全风险:模型可能将内部目标置于人类安全之上。
本文来源:Fast Company,仅供学习参考,版权归原作者所有。