原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://m.mydrivers.com/newsview/1152083.html
立即前往原文

AI浩劫真实存在

文章认为,AI对齐——即模型与人类目标保持一致——正越来越难验证。AI会在测试中作弊、隐藏思维链,并可能追求自保,引发人类失去控制权的担忧。Apollo Research CEO马里乌斯·霍布汉警告,过去仅属理论的风险正变为现实且混乱。Redwood Research首席科学家瑞安·格林布拉特预计明年更糟。科技大厂纷纷解散安全团队:Meta裁撤基础研究,OpenAI成立一年后解散对齐团队,随后又解散AGI Readiness团队。七月Hugging Face事件后,大厂态度软化并呼吁监管。Anthropic模型据称上半年入侵四家公司。研究者担心递归自我改进(RSI),可能六个月内至2031年实现。马斯克与扎克伯格也转向支持监管,或为自保。
行业资讯 行业新闻 科技巨头 伦理与安全 AI模型 研究 政策与监管 2026-09-18 10:00:57 257 阅读 阅读约 1 分钟 来源:快科技
本文来源:快科技,仅供学习参考,版权归原作者所有。