Attention-DP3:通过几何对齐注意力实现物体感知的三维扩散策略
Attention-DP3是一种三维扩散策略,旨在帮助机器人在物体遮挡、混杂且干扰物较多的操作场景中识别与任务相关的几何信息。该方法首先对RGB图像进行开放词汇二维分割,再利用经过标定的相机几何将目标物体掩码提升到三维空间。其三场注意力条件机制分别强调目标物体、目标内部与任务相关的区域,并抑制背景和干扰物。 在Adroit、DexArt、MetaWorld以及真实SO101平台上的实验显示,该方法
AI 新闻中心 过去24小时分析了 232 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
Attention-DP3是一种三维扩散策略,旨在帮助机器人在物体遮挡、混杂且干扰物较多的操作场景中识别与任务相关的几何信息。该方法首先对RGB图像进行开放词汇二维分割,再利用经过标定的相机几何将目标物体掩码提升到三维空间。其三场注意力条件机制分别强调目标物体、目标内部与任务相关的区域,并抑制背景和干扰物。 在Adroit、DexArt、MetaWorld以及真实SO101平台上的实验显示,该方法
BVB,即 Blender-VideoBench,用于评估多模态智能体能否通过编程,将现实世界视频重建为带动画的 Blender 场景。所有智能体都在相同的沙盒环境中完成重建,评测指标包括保留视频时空事实的能力,以及与原始视频的感知相似度。在来自 10 个模型系列的 51 种配置中,最佳模型的潜在相似度达到 88.6,但仅保留了原视频正确时空答案的 53.7%。增加推理过程可以提升视觉相似度,却无
该研究提出“发现基础模型”,这类 AI 系统不仅能够利用现有知识进行推理或解决人类定义的任务,还能参与提出新问题、构建新表示、形成假设并创造知识。其框架 Zetema 维护可修订的研究状态,验证证据、控制实验,并跨任务持续改进发现能力。GALILEO 将干实验室推理、机器人和实际湿实验室实验、外部生物学证据以及反复的假设修订结合起来,应用于治疗研究。研究还提出了超越最终答案准确率、训练和评估发现过
Dream-RSI 是一个用于可扩展、递归式改进自主 AI 智能体探索策略的框架。它将历史发现树构建为回放模拟器,使策略能够通过即时、低成本的离策略反馈进行评估和优化,而无需反复执行昂贵的在线评估。改进后的策略会重新部署,以推动后续发现,形成持续自我改进的循环。在算法工程、数学优化和 GPU 内核工程测试中,Dream-RSI 在多个场景下取得了具有竞争力或更高的发现质量,同时显著降低了发现成本。
中国工业和信息化部、国家发展改革委发布“十五五”电子信息制造业发展规划。规划提出提升先进制程制造能力,突破高端手机核心芯片和高性能PC芯片,并夯实人工智能芯片与终端的硬件基础。同时,相关部门将加强开源鸿蒙等国产操作系统搭载,推进RISC-V研发与产业化,构建人工智能软硬件全栈生态。规划还覆盖先进封装、电子设计自动化工具、智能终端和消费电子等领域,并提出到2030年规模以上企业营业收入突破30万亿元
据 Business Insider 报道,谷歌已通过内部开发平台 Antigravity,向全公司工程师开放 Anthropic Claude 的使用权限。员工可在个人配额内使用包括 Claude Opus 5 在内的部分第三方模型。谷歌表示,Gemini 仍是内部开发的主要模型,Claude 则作为专门用例的补充工具。此前,Claude 主要仅限 DeepMind 团队及部分高优先级项目使用。
Omni-Streaming Thinking(OST)是一种让模型持续处理视频和同步音频的方法。它将视觉与听觉证据分开保存,先把结论标记为待验证,并在未来证据出现时进行检查。检测到矛盾后,系统会降低相关结论及其依赖状态的影响,再依据新证据更新模型状态。研究人员使用轻量适配的 Qwen3-Omni-30B-A3B-Instruct 进行测试,报告称 OST 在五项流式和视听基准测试中平均超过开放基
有关人工智能可能危及人类的讨论拖累了一些股票,却提振了另一些股票。美国主要股指小幅下跌。
蚂蚁集团 AI 安全实验室开源了大模型内生式安全护栏技术 SingProbe。该技术不依赖外挂式安全审核,而是复用模型推理过程中的隐藏状态,在不足 0.5% 额外计算开销下进行 token 级实时风险评估。SingProbe 支持意图分类、安全检测和幻觉识别,并可在内容输出前以毫秒级速度阻断风险结果,面向医疗等高风险场景。蚂蚁集团称,该技术已适配 29 个主流大模型,同时发布了开源代码和预训练模型
英伟达首席执行官黄仁勋在洛杉矶举行的 All-In Summit 上反对放慢人工智能发展速度。活动期间,他与美国总统特朗普现场通话。特朗普表示,美国不会因政治反对或与中国的竞争而放缓人工智能发展,并将继续扩大相关基础设施建设,黄仁勋对此表示认同。此前,Anthropic CEO达里奥·阿莫迪、埃隆·马斯克和山姆·奥特曼都曾支持更谨慎地提升人工智能能力。与此同时,美国社会对数据中心扩张的反对情绪正在
据404 Media调查,OpenAI雇用数百名合同工审核真实ChatGPT用户对话。审核人员据称会对模型回复按1至7分评分,以帮助减少过度奉承和过度拟人化等问题。OpenAI采用匿名化和隐私过滤器,但承认对话仍可能包含敏感个人信息,过滤器也可能误判。“为所有人改进模型”设置默认开启,用户可以关闭;临时聊天不会用于训练。OpenAI至少自2023年起就说明,获授权人员和服务提供商可能为改进服务而查
苹果已向兼容设备推送iOS 27、watchOS 27、iPadOS 27和visionOS 27。延迟已久的Siri AI升级成为四大系统的核心AI功能,目前仅以英语测试版提供。苹果表示,法语、日语、韩语、葡萄牙语和西班牙语支持将于10月推出。visionOS 27为Apple Vision Pro带来完整的Siri AI升级。此外,各系统还更新了界面设计和小组件,新增独立音量控制,并改善运动功
ANZ集团首席执行官努诺·马托斯警告称,与人工智能相关的风险正在上升且难以预测。随着该银行采用快速发展的人工智能技术,他没有排除大规模裁员的可能性。
中国通信企业协会已启动AI-eSIM团体标准编制工作,中国移动、中国联通和中国电信,以及腾讯云、阿里云、火山引擎、京东等企业参与。标准拟规范智能物联终端、空中写卡、身份认证、智能体平台和AI-eSIM运营管理平台等环节的接口定义、交互流程和操作准则。由于目前产业链缺乏统一技术规范,不同厂商之间的产品对接成本较高、互联互通受限,此次标准化旨在改善这些问题。雄安新区还同步成立了AI智能硬件重点实验室,
据未经证实的消息,Anthropic 正在面向部分 Claude Code 用户灰度测试尚未正式发布的 Claude Opus 5.2。部分开发者称,他们从后端模型标识中发现了指向该版本的线索。与此同时,外界还流传 Anthropic 内部的“Model 2”已承担大量代码编写工作,甚至可能替代部分研究职能。Anthropic 尚未正式确认上述说法,因此目前应将其视为传闻,而非已证实的产品发布或组