AI 新闻中心

AI 新闻中心 过去一年分析了 8035 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

“AI 教父”辛顿支持要求独立第三方评估的公开信

由多家 AI 监督组织组成的论坛呼吁 Anthropic、OpenAI 等 AI 实验室,确保外部评估人员能够独立、透明地工作,并免受企业干预。由杰弗里·辛顿、斯图尔特·罗素等专家联署的公开信要求,第三方评估人员应获得与内部评估人员同等的系统、数据、工具和场所访问权限,能够直接与公司董事会沟通,并在不受企业过滤的情况下公布评估结果。论坛还要求保护评估人员免受因工作遭到的报复,并引入具有不同专业背景

千寻智能联合创始人:人形机器人最快明年可理解语音指令

千寻智能联合创始人兼首席科学家高阳预计,人形机器人最快从2027年开始就能理解语音指令并执行大多数通用任务,但真正进入家庭承担实用工作仍需更长时间。中国人形机器人企业正将竞争重点从硬件转向软件和具身智能。千寻智能目前通过约1000名合同人员收集真实世界数据,用于训练机器人。公司称,机器人在结构化客厅环境中执行简单任务的成功率已达到90%。未来一至两年可能成为工业应用的起点,商业服务场景随后有望出现

北京发布“词元经济十条”:推动高标准建设词元工厂

北京市经济和信息化主管部门发布了2026年至2028年词元经济发展行动方案。方案将制定词元工厂分级评价标准,涵盖模型适配数量、词元吞吐速度、首词元延迟、缓存命中率和能源利用效率等指标。北京还将支持基础模型、推理专用芯片、模型轻量化和边缘部署,建立词元质量评测体系以及具备统一接口、计量和结算功能的词元分发平台。同时,方案鼓励发展通用和垂直行业智能体,推进安全软件、海外服务、数据产品、算力金融工具和工

MiniMax Code CLI 正式开源,评测任务通过率达 76.7%

MiniMax 已面向全球开发者正式开源 MiniMax Code CLI v0.4.12,并采用 MIT 许可证。该 CLI 是 MiniMax Code 客户端的核心组件。根据官方信息,在基于 FrontierHarness Eval 的评测中,工具取得了 76.7% 的任务通过率,成功任务的耗时中位数为 4 分 33 秒,两项指标均高于报告列出的公开基线。MiniMax 表示,开源将帮助开发

优步全球裁员10%,员工称AI加速渗透日常工作

优步已在全球裁减约3300个岗位。公司表示,裁员主要是为了减少管理层级,并未明确将人工智能列为直接原因。不过,多名近期被裁员工透露,过去几个月AI工具在日常工作中的使用明显增加。优步的内部聊天机器人Genie可在Slack中回答员工问题,Glean等工具则帮助客服处理司机和乘客的咨询。部分员工甚至会将AI生成的答案直接复制到客户对话中,尽管这并非工具规定的使用方式。据报道,优步还削减了Claude

Anthropic 计划年底前拥有约 5 吉瓦可用算力,明年底再翻倍

据《纽约时报》援引知情人士报道,Anthropic 计划在今年年底前将可用计算容量提升至约 5 吉瓦(GW),并在明年底前进一步翻倍。据称,Anthropic 去年的可用算力约为 1.5 GW,而 OpenAI 约为 2 GW。OpenAI 也计划今年达到约 5 GW,明年扩展至约 10 GW。上述数字来自知情人士和内部估算,尚未得到独立验证。此举表明,Anthropic 可能已改变此前对大规模人

甲骨文斥数十亿美元帮其他企业运行 AI,但自身推广并不顺利

过去两年,甲骨文投入数十亿美元帮助其他企业运行 AI,但自家公司全面引入 AI 的进度明显更慢。部署 ChatGPT Enterprise 和 Codex 后,内部使用率在三个月内达到 80%,公司同时制定了使用标准、安全控制措施和内部政策。AI 大幅提升了软件开发速度,却将瓶颈转移到测试、验证、部署和发布管理等环节。甲骨文采用 Anthropic 的代码安全扫描模型后,两周内发现的潜在问题超过此

智谱 ZCode 被质疑“偷传代码”:官方称问题已修复,将开源代码库

智谱旗下编程产品 ZCode 就代码库数据上传问题向受影响用户致歉。问题源于代码库索引功能,该功能支持历史版本检查点恢复、版本回退以及生成 Repo Wiki。生成 Wiki 页面时,可能触发将代码库数据上传至云端处理。智谱表示,相关数据在 Wiki 生成后会立即销毁,不会保存。由于该功能在上线初期默认开启,部分用户受到影响。官方称已完成自查并修复问题,近期将开源 ZCode 代码库,邀请第三方评

MiniMax-H3能否推理物理世界?全模态生成模型评测

一项研究评估MiniMax-H3能否通过联合处理文本、图像、视频和音频,提升对物理世界的推理能力。研究团队构建了包含517个样本的评测框架,覆盖四种场景:结合多帧画面的隐式提示、音频-图像输入、前缀视频以及音频-视频输入。由于每种模态只能提供部分证据,模型需要整合互补线索,以推断事件状态和未来动态。MiniMax-H3的总体成功率为41.97%。其中,基于视频的决策推理表现最好,成功率为56.00