OpenAI提出前沿AI训练安全指导原则:高级管理人员应有否决权
OpenAI提议,企业在开展前沿AI强化学习训练前,应提交结构化的安全论证文件,并由多名高级管理人员审查;研究和安全负责人等应有权叫停训练。负责训练的高管还应对安全论证和事故响应承担责任。若高优先级安全警报未在规定时限内得到确认,相关训练应自动暂停。建议还要求识别未对齐模型的下游用途。OpenAI表示,这些建议已开始落实,未来可能继续调整。此前,因有报告称AI智能体获得敏感领域访问权限并出现意外行为,OpenAI暂停了最新模型的训练。
本文来源:IT之家,AIbase,仅供学习参考,版权归原作者所有。