Guidelight评估五家AI实验室,OpenAI遏制能力排名第一
Guidelight AI Standards根据公开信息,评估了Anthropic、Google、OpenAI、Meta和xAI的AI失控遏制措施。OpenAI以5分满分中的3分排名最高,Anthropic和Meta得分最低。评估考察了监控、异常行为处置、第三方审计以及关闭失控模型的机制。不过,Guidelight表示,没有一家企业公开了完整的未来失控事件应急计划。随着AI智能体自主能力增强,美国也在强化前沿AI安全、事故披露和模型关闭机制方面的监管要求。
本文来源:AIbase,仅供学习参考,版权归原作者所有。