AI 水印可能让大语言模型遵守安全防护措施变得不可预测,给欧盟人工智能法案带来问题
研究人员发现,AI 水印可能改变大语言模型的行为,使模型不再稳定地遵守安全防护措施。这可能引发对系统安全性以及能否符合欧盟人工智能法案要求的担忧。
AI 新闻中心 过去一年分析了 952 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
研究人员发现,AI 水印可能改变大语言模型的行为,使模型不再稳定地遵守安全防护措施。这可能引发对系统安全性以及能否符合欧盟人工智能法案要求的担忧。
美国参议员要求联邦贸易委员会调查沃尔玛和亚马逊如何使用与“美国制造”声明相关的人工智能机器人数据。此外,美国监管机构已批准代币化股票,信用卡公司则希望由人工智能机器人代替消费者购物。
美国加州圣马刁县监事会已通过一项针对自主式 AI 控制机器人的许可制度草案。企业若要在人类可进入的场所使用此类机器人,须事先申请许可,并提交机器人安全状况、制造商信息以及经济和劳动力影响评估。若机器人导致员工失业,企业必须提供薪酬不低于原岗位的其他工作,提前 60 天通知并支付遣散费,或向新设的“县自动化影响费”缴费,资助失业人员接受职业再培训。该条例仍需完成最终批准程序,正式通过 30 天后生效
政治左翼支持对人工智能进行监管,但对于监管应采取何种形式,以及人工智能的潜在风险究竟有多严重,仍未达成一致。
在唐纳德·特朗普与习近平即将举行会晤之际,美国和中国仍未能就人工智能带来的最大威胁达成一致。
国家互联网信息办公室公布《国务院关于保障未成年人健康安全使用网络的规定(征求意见稿)》,向社会公开征求意见。草案要求网络服务提供者识别未成年人用户、提供未成年人模式,并限制部分社交、游戏、直播及虚拟亲密关系服务。可能影响未成年人认知的人工智能服务,应通过未成年人模式提供。网络平台不得设置诱导未成年人情感依赖、沉迷使用或过度消费的算法模型。智能终端制造商和应用程序分发平台还需提供一键切换、退出核验、
文章探讨企业如何将影子 AI 项目从单纯盘点未经授权的工具,转向实时采取管控措施。
Palantir CEO 亚历克斯·卡普表示,Anthropic 等前沿 AI 实验室呼吁政府加强监管,背后可能不只是安全考量。他在接受 CNBC 采访时称,这些企业或许会为了获得政府保护,应对未来因涉嫌侵犯知识产权而面临的大量诉讼,甚至寻求国有化。卡普说,一些客户曾反映,企业内部的专有商业构想进入聊天机器人的训练数据后,最终暴露给了竞争对手。他认为,如果类似诉讼大规模出现,AI 企业可能会请求美
《纽约时报》起诉 OpenAI 和微软的案件中,近期解封的法庭文件披露了多名 AI 高管关于生成式模型训练数据的表态。微软应用科学主管布伦特·赫克特据称将 AI 行业的大规模建设称为“人类历史上规模最大的劳动成果盗窃”。OpenAI 总裁格雷格·布罗克曼则表示,生成式 AI 产品可能逐渐替代传统媒体,对出版商构成生存威胁。《纽约时报》指控两家公司未经许可复制数百万篇受版权保护的文章,并利用这些内容
亚马逊表示,AI 模型只有在严格测试确认具备足够安全保障后,才应对外发布。公司发言人称,技术进步与安全并非只能二选一,但如果行业无法确保模型经过充分准备并能安全使用,就可能产生风险。这一表态使亚马逊加入了有关是否应放缓先进 AI 开发速度的讨论。OpenAI 和 Anthropic 高管此前也曾主张采取更审慎的研发节奏,以便评估技术安全性。亚马逊既是这两家公司的合作伙伴和投资者,也在开发自己的大型
巴黎检方已针对疑似利用智能眼镜实施性骚扰的行为展开刑事调查。案件涉及一种在社交媒体上流行的做法:未经同意拍摄街头女性,再将视频上传网络。Meta与依视路陆逊梯卡推出的AI智能眼镜内置小型摄像头,可在不易察觉的情况下拍摄。法国数据保护机构CNIL也收到多起有关职场使用智能眼镜的投诉。监管机构指出,如何让周围人明确知道自己正在被拍摄,以及如何取得有效同意,是这类设备带来的主要挑战。具备AI功能的可穿戴
诺贝尔奖得主、计算机科学家杰弗里·辛顿向美国国会议员表示,为先进人工智能建立真正有效的安全护栏,可能只剩大约一年时间。他指出,AI的发展速度超出许多研究人员此前的预期,超级智能的出现时间也从过去认为的数十年提前到几年之内。辛顿警告,如果不采取行动,AI可能失控;在继续推进强大AI之前,研究人员应先弄清楚如何控制这些系统。他还表示,认为未来十年内AI导致人类灭绝的概率约为10%,并非没有道理。
爱尔兰财政部长西蒙·哈里斯表示,成立一个负责人工智能事务的全球机构将是一件好事。他没有提出建立该机构的具体建议或计划。
人工智能研究者吴恩达表示,顶尖模型开发商近期关于人工智能可能威胁人类生存的警告,更像科幻小说而非科学。他认为,这类叙事可能让行业忽视网络安全、失控和对齐失败等具体安全问题。吴恩达还指出,部分业内人士可能为了吸引关注、影响监管方向而放大灾难性风险。与全面放缓人工智能发展的主张不同,他支持继续推进技术,同时通过受控测试、工程防护措施和持续迭代,解决可以验证的安全问题。
本周,围绕人工智能风险的全球讨论进入新阶段。科技企业高管就前沿人工智能实验室是否应放缓开发进度产生分歧。Anthropic、OpenAI、SpaceX和Google DeepMind的负责人呼吁建立自我监管机制,赋予人工智能模型更强的控制能力。微软、亚马逊和Meta表示,也在开发用于检查、控制和管理人工智能风险的工具。美国总统唐纳德·特朗普则称这些警告是“骗局”。随着投资者开始质疑人工智能投资快速