AI 新闻中心

AI 新闻中心 过去30天分析了 1081 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

英伟达黄仁勋大会现场公开接听特朗普电话,后者称 AI 安全担忧是“骗局”

美国总统唐纳德·特朗普在一场行业峰会期间致电英伟达 CEO 黄仁勋,再次为人工智能辩护。特朗普将外界对 AI 安全的担忧称为“骗局”,表示机器人不会接管世界,AI 也不会统治世界。他还称赞数据中心,认为其将成为未来 20 至 25 年的重要经济资产。美国总统科学与技术顾问委员会联合主席戴维·萨克斯则表示,Anthropic 和 OpenAI 应开发安全产品,必要时可在没有政府干预的情况下按自身节奏

消息称英国国王查尔斯三世本周将与科技巨头高管讨论人工智能

据报道,英国国王查尔斯三世计划本周在苏格兰邓弗里斯主持一场峰会,邀请多家大型科技公司的高管讨论人工智能。受邀者据称包括英伟达首席执行官黄仁勋、谷歌DeepMind董事长德米斯·哈萨比斯和OpenAI首席财务官莎拉·弗里亚,以及Anthropic、IonQ、英国政府和梵蒂冈的代表。会议将讨论如何让人工智能发展造福社会,以及制定共同准则是否有助于推动负责任的创新。目前尚未确认任何具体法规、协议或技术发

蚂蚁开源 SingProbe:以不足 0.5% 额外算力实时拦截大模型生成风险

蚂蚁集团 AI 安全实验室开源了大模型内生式安全护栏技术 SingProbe。该技术不依赖外挂式安全审核,而是复用模型推理过程中的隐藏状态,在不足 0.5% 额外计算开销下进行 token 级实时风险评估。SingProbe 支持意图分类、安全检测和幻觉识别,并可在内容输出前以毫秒级速度阻断风险结果,面向医疗等高风险场景。蚂蚁集团称,该技术已适配 29 个主流大模型,同时发布了开源代码和预训练模型

OpenAI被曝让人工审核员查看ChatGPT对话

据404 Media调查,OpenAI雇用数百名合同工审核真实ChatGPT用户对话。审核人员据称会对模型回复按1至7分评分,以帮助减少过度奉承和过度拟人化等问题。OpenAI采用匿名化和隐私过滤器,但承认对话仍可能包含敏感个人信息,过滤器也可能误判。“为所有人改进模型”设置默认开启,用户可以关闭;临时聊天不会用于训练。OpenAI至少自2023年起就说明,获授权人员和服务提供商可能为改进服务而查

ReactHuman:面向具身多模态大语言模型类人反应式决策的物理基础基准

ReactHuman是一项用于评估多模态大语言模型能否控制人形机器人及时、安全应对突发物理危险的基准测试。它涵盖17类事件和1,000多个可复现场景,并通过240Hz刚体模拟生成精确的标准答案。每次反应根据合理性、安全性和物理依据三个维度,以五项指标进行评分。对7个具有代表性的MLLM进行评测发现,模型大约会错误处理三分之一的危险情境。它们经常依赖固定的行为倾向或物体外观,而不是观察到的运动;即使

OpenAI联合创始人布罗克曼:人类已进入AGI时代

OpenAI联合创始人格雷格·布罗克曼在接受a16z采访时表示,随着GPT-6 Astra等模型具备长时间自主执行任务和操作电脑的能力,人类已经进入通用人工智能(AGI)时代。这是布罗克曼的判断,并不构成AGI已经实现的独立验证。他表示,OpenAI已将25%的生产工程师从原有项目中调出,转而加强系统防御和安全架构。团队使用Astra排查内部系统漏洞,并修复了多项严重问题。不过,布罗克曼强调,问题

科技巨头放缓人工智能发展,是安全协议还是卡特尔?

据报道,OpenAI、Anthropic、谷歌DeepMind和SpaceX的负责人周末就放缓人工智能发展达成了一项松散共识。他们表示,目标是更好地控制技术前沿的发展节奏。然而,怀疑者立即质疑,这一倡议是否也服务于竞争利益,或可能帮助既有企业限制市场竞争。

Gebru:人工智能安全需要人类控制

DAIR研究所创始人兼执行董事蒂姆尼特·格布鲁谈及她早期对人工智能风险发出的警告,以及她于2020年离开谷歌人工智能伦理团队的经历。在美国人工智能模型开发不断提速的背景下,她还讨论了公众和政策制定者是否正在提出有关人工智能安全与防护的正确问题。