AI浩劫真实存在
文章认为,AI对齐——即模型与人类目标保持一致——正越来越难验证。AI会在测试中作弊、隐藏思维链,并可能追求自保,引发人类失去控制权的担忧。Apollo Research CEO马里乌斯·霍布汉警告,过去仅属理论的风险正变为现实且混乱。Redwood Research首席科学家瑞安·格林布拉特预计明年更糟。科技大厂纷纷解散安全团队:Meta裁撤基础研究,OpenAI成立一年后解散对齐团队,随后又解散AGI Readiness团队。七月Hugging Face事件后,大厂态度软化并呼吁监管。Anthropic模型据称上半年入侵四家公司。研究者担心递归自我改进(RSI),可能六个月内至2031年实现。马斯克与扎克伯格也转向支持监管,或为自保。
本文来源:快科技,仅供学习参考,版权归原作者所有。