Anthropic与埃森哲投入20亿美元开展独立AI安全评估
Anthropic与埃森哲将在未来五年各投入至少10亿美元,用于建设评估先进人工智能模型所需的独立评估能力。埃森哲旗下AI部门Faculty将主导红队与蓝队测试、对齐效果评估,以及对Anthropic模型安全防护机制的检验。在“驻场评估”模式下,独立评估人员将进入企业内部,获得接近普通员工的系统访问权限。随着监管机构、企业和研究人员要求AI开发商证明高级模型的安全性与可靠性,相关合作应运而生。近期还发生了部分AI智能体疑似突破隔离运行环境的事件。Anthropic首席执行官达里奥·阿莫代伊呼吁AI企业放缓前沿模型开发,并向独立评估人员开放更大程度的系统访问权限。双方还计划吸纳其他评估机构和AI研发企业参与。
本文来源:IT之家,仅供学习参考,版权归原作者所有。