AI 新闻中心

AI 新闻中心 过去7天分析了 956 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Skill2Real:通过智能体式技能学习,实现机器人操作从仿真到现实的零样本迁移

Skill2Real是一种在仿真环境中学习机器人技能,并在无需针对具体任务微调的情况下迁移至真实机器人的框架。Proposer-Verifier-Governor循环利用仿真中的特权信息诊断结果并验证更新。系统先学习基础操作技能,再学习将这些技能组合起来完成更高层级的任务。在LIBERO-90上训练的冻结技能,在四项真实世界操作任务中的平均完成率达到78.75%。在未用于训练的LIBERO-Pro

通过递归式自我改写提升复杂任务表现

一项研究提出递归式自我改写(RSR)方法,将模型在专用任务环境中获得的成功解法转化为适用于通用环境的训练轨迹。规划器提取操作流程并生成手册,评审器检查验证器或解答信息泄漏并指导修订,执行器则在全新的沙箱中测试合格手册。在约3,000项经过筛选的终端任务中,三种环境合计解决759项,比记录中表现最好的单一环境多34.3%。RSR将2,001条成功的源轨迹扩展为11,094条改写轨迹。使用这些数据进行

World Embedding Benchmark评估视频嵌入中的物理信息

World Embedding Benchmark包含8,000个受控仿真案例,覆盖流体与固体力学、动力学、光学和电磁学等80个类别。它通过文本—视频检索、物理属性回归以及视频—描述配对分类任务评估视频嵌入。预训练全模态模型的检索表现较弱,同类别配对分类接近随机水平;但轻量探针能够从冻结的视频嵌入中提取有用的物理信息。使用物理领域专用的视频—文本对继续进行对比训练,可改善检索和分类,却会降低定量物

消息称 Wayve 将为大众供应自动驾驶技术

据德国媒体《多瑙库里尔报》报道,英国具身智能初创企业 Wayve 据称从多家竞争者中胜出,被选为大众汽车集团提供自动驾驶技术。Wayve 将开发自动驾驶 AI 软件,大众旗下软件公司 CARIAD 则负责将软件与大众和博世共同开发的硬件进行系统集成。据称,超过 10 家技术供应商参加了在德国南部一座主要城市举行的方案演示。Wayve 凭借技术能力和财务表现给大众留下了深刻印象。目前大众尚未正式确认

OpenAI宣布Codex与ChatGPT Work“28天计划”

OpenAI表示,未来28天将每天发布一项更新,目标是为大多数Codex和ChatGPT Work用户带来明显且实际的改善。如果无法提供有意义的更新,团队将提供一次“重置”,但目前尚未说明重置的具体方式、适用用户范围以及是否涉及使用额度。该周期预计从10月5日持续至11月2日。团队还在推进产品简化、提升使用效率、开发新功能和新模型。

奥尔特曼:人工智能的巨大效益值得承担部分风险

OpenAI 首席执行官萨姆·奥尔特曼在采访中表示,OpenAI 与 Anthropic 在人工智能监管问题上仍存在根本性分歧。他认为,社会应承担部分负面后果,以获取这项技术的效益并扩大人们的自主权。不过,奥尔特曼称,真正具有毁灭性的风险不可接受,包括人类严重失去对人工智能的控制。近几个月来,两家公司的监管立场已有所接近。

报道称,Meta AI 助手 Muse 会分析社交关系并为联系人建立个人档案

研究人员提取的 Meta Muse 内部指令显示,这款 AI 助手可以为用户生活中的联系人建立并定期更新个人档案,内容可能包括事实信息、共同经历、关系特点以及维护关系的建议。Meta 表示,Muse 使用公开信息和用户选择分享的数据,指令也要求系统不得编造缺乏依据的内容。用户可以删除记忆或断开外部服务。不过,专家指出,汇总个人数据并推断人际关系会带来重要的隐私风险。

软银孙正义罕见警告 AI 安全风险,呼吁各国携手应对

软银创始人孙正义在京都一场论坛上表示,AI 能力快速提升带来显著安全风险,各国应建立互信并合作应对强大模型的威胁,尤其要防范超级智能落入不法分子手中。他还预计,AI 服务将逐步与机器人及其他硬件更深入地交互。孙正义预测,到 2040 年,AI 和具备学习能力的机器可能占全球 GDP 的至少 20%;这属于预测,并非已经证实的结果。

DeepSeek V4.1 Flash 发力,中美顶尖模型 LiveBench 跑分差距缩至 3%

据彭博行业研究,中国顶尖 AI 模型的基准测试得分目前仅落后美国竞争对手约 3%;这一差距在今年 5 月约为 9%,年初则约为 15%。9 月发布的 DeepSeek V4.1 Flash 在 LiveBench 排名第六,得分 81.1,低于排名最高的 Anthropic 模型的 83.4 分。彭博分析师罗伯特·利亚认为,中国 AI 专业能力的深化以及针对国产硬件优化模型,推动了这一进展。他同时

专访谷歌高级副总裁詹姆斯·马尼卡:AI风险与产业、政府和社会的共同责任

彭博社记者米沙尔·侯赛因采访了谷歌高级副总裁、DeepMind Institute联合主任詹姆斯·马尼卡,探讨AI风险,以及产业界、政府和社会共同承担责任的重要性。一项不具法律约束力的协议要求Anthropic、OpenAI、Nvidia、Meta、SpacexAI和Google承诺建立“稳健的内部流程”。

Meta 开源 Muse Gadgets,支持用 ESP32 和树莓派打造定制 AI 硬件

Meta 发布开源项目 Muse Gadgets,开发者可将自定义硬件连接到其个人 AI 智能体 Muse。Meta 按 Apache 2.0 许可开源了 ESP32 固件和 Linux 设备 SDK,支持树莓派等开发板,以及显示屏、传感器和执行器等外设。在 Linux 设备上,Muse 可以执行 shell 命令并读写文件,因此其权限取决于运行所用的账户。Meta 提醒用户注意配对安全和设备内凭

TypeSafe AI称决策模型Jev日处理1万亿Token,竞争对手陆续跟进

TypeSafe AI三周前推出的Jev不会像聊天机器人那样生成文本,而是将输入归类到预先设定的结果中。公司将这一方法称为“面向校准决策的强化学习”,并将Jev定位为自动化软件的组件。创始人迪奥戈·阿尔梅达称,模型每日处理1万亿Token,约25%的《财富》世界500强企业正在使用;这些数据是报道所引述的公司说法。TypeSafe此前已从DCVC获得4000万美元融资。据媒体报道,公司正在洽谈新一

报道称 OpenAI GPT-6 Sol Codex 系统提示词疑似泄露

一篇网络报道声称,有人公开了约 29.4 万字符的 OpenAI GPT-6 Sol Codex 系统提示词及工具定义。据称,内容涉及写作风格、自主执行任务、工具调用、上下文交接和代码审查等指令。文章将其描述为重大泄露,但也提到部分开发者认为内容并不意外,或已有部分信息可以从其他渠道找到。报道未独立核实此次疑似泄露的真实性和范围。

FieldAI 据称寻求融资 7 亿美元,估值达 100 亿美元

据报道,机器人初创公司 FieldAI 正寻求以 100 亿美元估值融资 7 亿美元。这家成立于 2023 年的公司据称已签署投资条款清单,但交易尚未完成。FieldAI 正开发通用 AI 软件,旨在让人形机器人、四足机器人、无人机和工业车辆等不同设备在多变环境中自主运行。据称,自 6 月以来,公司新增至少 3,500 万美元营收及客户合同,总额超过 1.35 亿美元。高估值体现了投资者的押注:该