AI 新闻中心

AI 新闻中心 过去一年分析了 8807 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Diptych:面向音乐制作参考聆听的范围指定与AI解读比较系统

Diptych是一套用于比较音乐录音的AI辅助系统。用户可以选择比较整首曲目,或独立选定片段进行比较,并查看结构化音频特征以及针对特定比较范围的AI解读。在一项包含12名音乐家的研究中,该系统帮助参与者发现了更多差异;其中10项发现有9项获得专家至少部分支持。参与者认为系统易于使用,并表示对可能的后续步骤更加清晰。研究结果表明,用于创意比较的AI工具应允许用户定义比较范围,提供可检查的证据和可执行

将八叉树作为显式的3D语言

OctLLM是一种多模态语言模型,将3D几何表示为显式的八叉树占用标记序列,而不是压缩为潜在码本索引或坐标文本。其稀疏八叉树表示在保留空间和深度信息的同时缩短序列。为增加3D能力,模型采用独立的可训练分支,并冻结预训练的语言和视觉路径,因此所需训练参数远少于完整微调。研究人员称,与ShapeLLM-Omni相比,OctLLM将图像到3D的FID降低17.4%,并将基于渲染结果的描述生成提升28.7

EditHero:面向长程部件级 3D 编辑与风格建模的基准

EditHero 是一个用于评估长程部件级 3D 编辑的基准。它通过自然语言指令以及几何和纹理目标图像,测试一系列连续修改。确定性装配引擎会在每次编辑后生成精确目标,所有编辑序列也经过人工审核。研究显示,非代理方法经常无法完成指定修改,还会改变本应保持不变的区域。基于 LLM 和 VLM 的智能体通常更能遵循指令,也更好地保留未编辑部分,但每次编辑需要数分钟。研究人员计划发布该引擎和编辑序列,以支

Skill2Real:通过智能体式技能学习,实现机器人操作从仿真到现实的零样本迁移

Skill2Real是一种在仿真环境中学习机器人技能,并在无需针对具体任务微调的情况下迁移至真实机器人的框架。Proposer-Verifier-Governor循环利用仿真中的特权信息诊断结果并验证更新。系统先学习基础操作技能,再学习将这些技能组合起来完成更高层级的任务。在LIBERO-90上训练的冻结技能,在四项真实世界操作任务中的平均完成率达到78.75%。在未用于训练的LIBERO-Pro

通过递归式自我改写提升复杂任务表现

一项研究提出递归式自我改写(RSR)方法,将模型在专用任务环境中获得的成功解法转化为适用于通用环境的训练轨迹。规划器提取操作流程并生成手册,评审器检查验证器或解答信息泄漏并指导修订,执行器则在全新的沙箱中测试合格手册。在约3,000项经过筛选的终端任务中,三种环境合计解决759项,比记录中表现最好的单一环境多34.3%。RSR将2,001条成功的源轨迹扩展为11,094条改写轨迹。使用这些数据进行

World Embedding Benchmark评估视频嵌入中的物理信息

World Embedding Benchmark包含8,000个受控仿真案例,覆盖流体与固体力学、动力学、光学和电磁学等80个类别。它通过文本—视频检索、物理属性回归以及视频—描述配对分类任务评估视频嵌入。预训练全模态模型的检索表现较弱,同类别配对分类接近随机水平;但轻量探针能够从冻结的视频嵌入中提取有用的物理信息。使用物理领域专用的视频—文本对继续进行对比训练,可改善检索和分类,却会降低定量物

消息称 Wayve 将为大众供应自动驾驶技术

据德国媒体《多瑙库里尔报》报道,英国具身智能初创企业 Wayve 据称从多家竞争者中胜出,被选为大众汽车集团提供自动驾驶技术。Wayve 将开发自动驾驶 AI 软件,大众旗下软件公司 CARIAD 则负责将软件与大众和博世共同开发的硬件进行系统集成。据称,超过 10 家技术供应商参加了在德国南部一座主要城市举行的方案演示。Wayve 凭借技术能力和财务表现给大众留下了深刻印象。目前大众尚未正式确认

OpenAI宣布Codex与ChatGPT Work“28天计划”

OpenAI表示,未来28天将每天发布一项更新,目标是为大多数Codex和ChatGPT Work用户带来明显且实际的改善。如果无法提供有意义的更新,团队将提供一次“重置”,但目前尚未说明重置的具体方式、适用用户范围以及是否涉及使用额度。该周期预计从10月5日持续至11月2日。团队还在推进产品简化、提升使用效率、开发新功能和新模型。

奥尔特曼:人工智能的巨大效益值得承担部分风险

OpenAI 首席执行官萨姆·奥尔特曼在采访中表示,OpenAI 与 Anthropic 在人工智能监管问题上仍存在根本性分歧。他认为,社会应承担部分负面后果,以获取这项技术的效益并扩大人们的自主权。不过,奥尔特曼称,真正具有毁灭性的风险不可接受,包括人类严重失去对人工智能的控制。近几个月来,两家公司的监管立场已有所接近。

报道称,Meta AI 助手 Muse 会分析社交关系并为联系人建立个人档案

研究人员提取的 Meta Muse 内部指令显示,这款 AI 助手可以为用户生活中的联系人建立并定期更新个人档案,内容可能包括事实信息、共同经历、关系特点以及维护关系的建议。Meta 表示,Muse 使用公开信息和用户选择分享的数据,指令也要求系统不得编造缺乏依据的内容。用户可以删除记忆或断开外部服务。不过,专家指出,汇总个人数据并推断人际关系会带来重要的隐私风险。

软银孙正义罕见警告 AI 安全风险,呼吁各国携手应对

软银创始人孙正义在京都一场论坛上表示,AI 能力快速提升带来显著安全风险,各国应建立互信并合作应对强大模型的威胁,尤其要防范超级智能落入不法分子手中。他还预计,AI 服务将逐步与机器人及其他硬件更深入地交互。孙正义预测,到 2040 年,AI 和具备学习能力的机器可能占全球 GDP 的至少 20%;这属于预测,并非已经证实的结果。

DeepSeek V4.1 Flash 发力,中美顶尖模型 LiveBench 跑分差距缩至 3%

据彭博行业研究,中国顶尖 AI 模型的基准测试得分目前仅落后美国竞争对手约 3%;这一差距在今年 5 月约为 9%,年初则约为 15%。9 月发布的 DeepSeek V4.1 Flash 在 LiveBench 排名第六,得分 81.1,低于排名最高的 Anthropic 模型的 83.4 分。彭博分析师罗伯特·利亚认为,中国 AI 专业能力的深化以及针对国产硬件优化模型,推动了这一进展。他同时

专访谷歌高级副总裁詹姆斯·马尼卡:AI风险与产业、政府和社会的共同责任

彭博社记者米沙尔·侯赛因采访了谷歌高级副总裁、DeepMind Institute联合主任詹姆斯·马尼卡,探讨AI风险,以及产业界、政府和社会共同承担责任的重要性。一项不具法律约束力的协议要求Anthropic、OpenAI、Nvidia、Meta、SpacexAI和Google承诺建立“稳健的内部流程”。

Meta 开源 Muse Gadgets,支持用 ESP32 和树莓派打造定制 AI 硬件

Meta 发布开源项目 Muse Gadgets,开发者可将自定义硬件连接到其个人 AI 智能体 Muse。Meta 按 Apache 2.0 许可开源了 ESP32 固件和 Linux 设备 SDK,支持树莓派等开发板,以及显示屏、传感器和执行器等外设。在 Linux 设备上,Muse 可以执行 shell 命令并读写文件,因此其权限取决于运行所用的账户。Meta 提醒用户注意配对安全和设备内凭

TypeSafe AI称决策模型Jev日处理1万亿Token,竞争对手陆续跟进

TypeSafe AI三周前推出的Jev不会像聊天机器人那样生成文本,而是将输入归类到预先设定的结果中。公司将这一方法称为“面向校准决策的强化学习”,并将Jev定位为自动化软件的组件。创始人迪奥戈·阿尔梅达称,模型每日处理1万亿Token,约25%的《财富》世界500强企业正在使用;这些数据是报道所引述的公司说法。TypeSafe此前已从DCVC获得4000万美元融资。据媒体报道,公司正在洽谈新一