杰弗里·辛顿今日引言:“如果我们无法让人工智能变得安全,它确实可能毁灭我们”
许多人认为人工智能的风险只是科幻小说中的噩梦。然而,人工智能科学家杰弗里·辛顿警告称,如果无法找到确保先进人工智能系统安全的方法,就不能完全排除灾难性后果的可能性。
AI 新闻中心 过去30天分析了 4661 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
许多人认为人工智能的风险只是科幻小说中的噩梦。然而,人工智能科学家杰弗里·辛顿警告称,如果无法找到确保先进人工智能系统安全的方法,就不能完全排除灾难性后果的可能性。
人工智能的发展速度已经超过各国政府制定监管政策的能力,导致全球范围内出现政策真空。欧盟《人工智能法》的执行进展迟缓,监管机构也在如何利用人工智能的经济潜力、同时控制其风险的问题上存在分歧。欧盟委员会主席乌尔苏拉·冯德莱恩本月在布鲁塞尔郊外召集高级官员举行了一次闭门会议。
酒井化学工业公司拥有百年历史的细粉制造经验,过去用于生产艺伎化妆粉,如今正找到新的盈利用途,为人工智能热潮提供支持。
一项研究评估了经过校准决策强化学习训练的模型 Jev,能否检测语言模型的对齐失效。研究团队推出 RLCDAlignBench,涵盖 10 类失效、44 项基准测试和 5 个目标模型。仅使用一个通用问题,零样本中位数 AUROC 即达到 0.886,并在多数基准测试中超过监督式基线。Jev 与参考评分器在人工标注上的一致程度相当,也揭示了部分现有基准的缺陷。研究称,其成本比基于 LLM 评审的评分低
音乐初创公司 Thoughtful Things 已在 Kickstarter 上为其首款乐器 Engram 发起众筹。这款采样器与 Groovebox 结合了 AI,可对输入音频进行重塑,甚至生成全新的声音。不过,Engram 并不是装进盒子里的 Suno:它并非通过按键即可制作适合主流排行榜的成品歌曲,而是定位为实验性音乐创作工具。
Instagram的Pixel特效可以通过文字提示模糊Story中的人物。这项功能可能被用来低调暗示恋情,因此引发了讨论。
在Equity节目中,讨论了Meta的AI公告如何抢走了OpenAI和Anthropic的风头。
这家软件巨头的人工智能负责人谈到了近期安全事件、在测试规模大十倍的未来模型时移除防护措施的风险,以及成立跨行业安全机构的构想。他还认为,政府应协助推动人工智能模型评估工作。
据知情人士透露,Anthropic PBC首席执行官达里奥·阿莫迪预计将于周日晚与美国总统唐纳德·特朗普共进晚餐。这次会面将两位在人工智能安全问题上立场不同的人士聚到一起。
设计良好的系统或许能帮助我们更好地了解已知的内容,以及仍然未知的部分。
《华尔街日报》刊文介绍 Anthropic 早期投资人之一 Jaan Tallinn。他在 2021 年领投了 Anthropic 1.24 亿美元的 A 轮融资,十多年来一直倡导人工智能安全,并向相关安全项目捐赠约 1.7 亿美元。Tallinn 警告称,不应陷入一场竞相开发可能终结人类的技术的竞赛。
Anthropic首席执行官达里奥·阿莫代伊在《周六夜现场》的一段小品中遭到讽刺。小品采用了“人工智能是魔鬼,而我是它的创造者”这一挑衅性设定。
据消息人士称,中国政府要求阿里巴巴、字节跳动等企业报告购买英伟达 RTX Pro 5500 的计划,并表示有意批准相关采购。这款芯片面向高端专业电脑。
熟悉相关安排的消息人士告诉Axios,美国总统特朗普计划于周日晚上在白宫宴请Anthropic首席执行官达里奥·阿莫代伊。特朗普据称亲自发出了邀请。这场会面可能表明双方关系有所缓和。
与监管相比,法律责任可能更能有效促使企业安全地开发和使用人工智能。