AI 新闻中心

AI 新闻中心 过去一年分析了 4110 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

《心灵杀手 2》销量突破 300 万份,新增支持 AMD FSR 4 超分技术

Remedy Entertainment 为《心灵杀手 2》发布了 1.2.10 更新,新增 AMD FSR 4 超分辨率技术和 FSR 帧生成支持。FSR 4 利用机器学习,包括卷积神经网络,将低分辨率图像重建为高质量画面,并减少闪烁、伪影和动态模糊。在兼容 GPU 上,玩家安装更新并选择 FSR 超分辨率后,FSR 4 会自动启用。游戏于 2023 年 10 月 27 日发行,目前累计销量已超

训练具备化学合理性感知能力的大语言模型,用于单步逆合成

一项研究提出将 Top-K 提示作为单步逆合成的训练和推理方法,使系统能够生成多条合理的反应路径,而不是只给出一个答案。研究人员构建了 CREED-CCV-2+USPTO-XL 数据集,其中包含约 4,560 万条经过验证的反应,并据此训练化学语言模型 C3LM。模型将微调与基于 ChemCensor 的奖励及面向新颖性的奖励相结合。研究作者称,该模型在分布外基准 URSA-expert-2026

潜在世界模型中的决策指标对齐:用于MPC规划的诊断与动作条件目标

该研究分析了在采用JEPA风格潜在世界模型的模型预测控制中,目标潜在表示的欧氏距离能否可靠反映实际任务进展。作者提出Plan-Real Spearman和CEM-Stage Spearman,用于衡量候选动作序列的潜在排序与真实排序在搜索前及交叉熵方法搜索逐渐集中时的一致性。研究指出,编码器失真、终端滚动预测误差和候选方案之间的差距是影响对齐效果的关键因素。DA-LeWM在LeWM基础上加入逆向动

京东物流培训快递员转型机器人维修工程师,计划五年创造超10万个岗位

京东物流完成首批一线员工转型机器人维修工程师的培训,参与者包括快递员、仓管员和质检员。来自中国各地的员工学习了机器人产业、设备构造和标准化维修流程,并使用头部机器人企业提供的样机进行实操。完成培训和岗位认证的员工已开始担任新职务。京东物流称,其机器人售后服务涵盖维修、故障诊断、换电补能、测试鉴定、保养和设备回收等环节。公司表示,未来五年将创造超过10万个机器人维修工程师岗位,并建设更多技术培训认证

Zetta ζ:面向自我进化物理智能的高效闭环系统

Zetta是一套面向具身AI代理的闭环控制与学习系统。在冻结基础策略模型的同时,它能够在线演化运行时批评器和恢复技能。三个具有不同时间尺度的循环分别负责在动作频率上进行执行控制、在每次 rollout 层面提出批评与恢复方案,并在通过验证后更新技能。结合将代理逻辑与异构执行资源解耦的Z-Infra,研究团队报告称,Zetta在LIBERO-Pro和RoboCasa上的成功率分别达到90.8%和93

SoftVTBench:面向可变形物体操作的形变感知视觉触觉数据集与基准

SoftVTBench 是一个用于评估可变形物体操作的数据集和基准,重点衡量物理交互质量。它包含 4,000 次专家示范和 50 多个物体,包括体积可变形物体及外观匹配的刚性对照物。每个回合同步记录多视角 RGB 图像、双指触觉图像和标记点运动、本体感知、语言及夹爪动作,并提供仅供评估使用的有限元状态作为独立的物理真实值。该基准提出“形变感知成功率”,只有在完成任务且最大形变保持在容差范围内时才算

宇树科技创始人:具身智能的关键拐点在于大模型与真机对齐

宇树科技创始人王兴兴表示,人形机器人要实现大规模普及,当前最大的障碍已不再主要是运动硬件,而是大模型与真实机器人之间的对齐。她将具身智能的“ChatGPT时刻”定义为:机器人身处80%的陌生场景时,仅凭语音或文字指令,就能独立完成约80%的任务。王兴兴预计,这一拐点最快可能在2到3年内到来,较慢则需要5到10年。相关判断属于行业预测,目前并不构成技术突破已经实现的证据。

微软发布 VS Code 1.134:新增并排聊天和提示时间线

微软发布了 Visual Studio Code 1.134,重点新增并排聊天、提示时间线、聊天中查找和 HTML 文件预览四项功能。开发者可以将聊天窗口和子智能体对话按水平或垂直方式并排放置,以便比较结果或同时监控工作进度。返回会话或重新加载窗口时,VS Code 会自动恢复聊天分组布局和焦点。智能体窗口中的提示时间线可以帮助用户快速定位此前的提示。现在,用户还可以使用 Ctrl+F,在聊天视图

SemaPLC:面向 PLC 代码生成的项目基础与验证门控代理框架

SemaPLC 是一个用于生成可编程逻辑控制器(PLC)代码的代理框架。它整合传统工具,只有在外部检查确认规格、编译结果以及实时运行环境中的行为后,才会判定任务完成。在涵盖 117 个独立程序组织单元任务、涉及 7 个模型的测试中,SemaPLC 的严格验证通过率平均达到 72.6%。在另一项包含 65 个项目上下文任务的测试中,生成的逻辑必须在现有项目内完成编译并运行;SemaPLC 在集成编译

初探苹果 iOS 27 相机应用:新增 Siri 模式可估算食物卡路里

AppleInsider 汇总了 iOS 27 Beta 6 中相机应用的变化。应用界面整体延续现有设计,但新增控制面板,方便用户访问拍摄设置。主要新功能是 Siri 模式,该模式基于苹果现有的视觉智能功能,可识别植物和食物、估算一盒树莓的卡路里,还能扫描婚礼请柬并将信息添加到日历。苹果还推出 RAW 9,利用新的 Core ML 模型整合去马赛克和降噪处理,并通过 Apple Neural En

Counterpoint:2026年上半年全球人形机器人出货量同比增长近300%

Counterpoint Research数据显示,2026年上半年全球人形机器人出货量突破2.2万台,同比增长近300%。智元AGIBOT以9700台出货量、超过43%的市场份额排名第一,宇树、银河通用、优必选和乐聚位列其后。前五大厂商均为中国企业,合计占全球出货量的86%。娱乐表演、研究和数据生产仍占需求的60%以上,但制造、仓储和物流应用的占比正在提升。Counterpoint预计,2026

循环语言模型提升组合式工具调用能力

一项研究考察了循环语言模型在复杂工具使用场景中的表现。这类任务要求模型协调多次 API 调用、维护中间状态,并保留工具交互之间的依赖关系。在 API-Bank、BFCL 和 NESTful 测试中,循环计算通常能提升多步骤及依赖感知工具调用的准确率,但对单独 API 调用的提升较小且依赖具体模型。自适应推理只在必要时增加计算量,因此在计算成本与性能之间取得了更好的平衡。

SPADE:在自适应合成可执行环境中进行自博弈

SPADE是一种强化学习框架,让同一个大语言模型同时承担两种角色:设计可执行的训练环境,并作为推理智能体在其中学习行动。每个环境都包含状态转移、奖励函数和验证代码,能够覆盖推理任务以及多步骤工具使用。在最高300亿参数的模型上,SPADE在数学、科学、代码和推理等八项留出测试中,平均比采用固定环境的强基线高5.3分。在工具使用任务上,BFCL-v4提升5.7分,ACEBench-Agent提升13