AI 新闻中心

AI 新闻中心 过去24小时分析了 212 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

论高维潜在表示的扩散适性

表示自编码器(Representation Autoencoder)使扩散模型能够在预训练视觉编码器的特征空间中运行。然而,许多现成编码器并未针对忠实重建进行优化,因此会丢弃细微的视觉细节。为重建任务微调编码器可以恢复这些细节,但也会降低表示的有效维度并改变其几何结构。研究发现,在这种情况下,流匹配中的标准速度预测要求模型拟合信号低维流形之外的正交噪声方向,导致优化效率低下。改为预测干净数据x₀,

腾讯混元将临界批大小理论应用于大模型强化学习:PPO生成吞吐最高提升2.29倍,GRPO训练时间缩短29%

腾讯混元研究团队探讨了在线大模型强化学习中的批大小调整问题,重点关注生成与训练扩展速度不一致的情况。研究将经典临界批大小理论应用于这一场景,发现对于PPO和GRPO,只要相应调整学习率,就能在有限范围内扩大批大小,同时保留每条响应的学习效果。在固定硬件配置下,扩大批大小使PPO生成吞吐最高提升2.29倍。测试中表现最佳的GRPO配置则以少29%的时间达到相同验证目标。研究为提高在线强化学习训练效率

所有模态一律平等,但视频更平等:弥合联合视频生成中的交叉注意力差距

研究发现,联合多模态扩散 Transformer 存在一种不对称性:音频或 3D 身体动作等伴随模态与视频的对应关系较强,但它们对视频生成的约束作用明显较弱。研究团队提出 RecCAR,即互惠跨模态注意力正则化,通过 KL 正则项,让较弱的“模态到视频”对应关系向较强的“视频到模态”对应关系靠拢。在视频-动作和视频-音频联合生成任务中,人体解剖评分从 0.69 提升至 0.75,音视频不同步程度则

阿里达摩院发布食管癌筛查 AI 模型,可从常规 CT 识别病变

阿里达摩院联合医疗机构研发 DAMO EAGLE,旨在从常规胸部平扫 CT 中识别食管癌及早期、癌前病变,无需内镜或造影剂。发表于《自然·医学》的研究称,该模型已在三个国家的 8 万多例病例中得到验证。在机会性筛查场景中,模型对食管癌的敏感性为 90%,对癌前病变为 52.5%,特异性为 99.2%;在低剂量 CT 上性能未见下降。因此,它有望接入现有肺癌筛查流程。该模型用于筛选需要进一步接受内镜

消息称月之暗面 Kimi K3.1 将于下月登场

据报道,月之暗面正在筹备 Kimi K3.1,预计可能于 2026 年 10 月发布。相关模型标识据称出现在内部 JSON 和 API 响应中。配置资料显示,该模型可能提供三档推理强度、最高 100 万 Token 的上下文,以及智能体、多智能体协作、搜索和批处理模式。目前这些信息尚未获得官方确认。2026 年 7 月发布的 Kimi K3,是月之暗面目前公开推出的旗舰模型。

京东七鲜大厨专业版首发价为19888元

京东公布七鲜大厨专业版首发价为19888元,套餐包含智能烹饪机器人、Health Brain膳食管理系统,以及价值15000元的膳食权益。该服务整合膳食规划AI模型、净菜配送和自动烹饪。用户上传体检报告并填写饮食偏好后,AI会生成阶段性膳食方案和每日菜单。目前,首批预售已覆盖中国多个主要城市。

PackLab:用于机器人容器装箱 MLLM 开发、训练与评测的综合框架

PackLab 是一个用于开发和评估多模态大语言模型的框架,面向机器人容器装箱中的闭环长期序列决策。该套件包括基于物理的仿真平台,可规模化生成多样化训练轨迹;PackLab-VLM,可根据物体和容器状态的变化同时选择物体并预测放置位置;以及 PackLab-Bench,提供多个难度等级的标准化评测场景。实验显示,在不同物体集合和容器配置下,PackLab-VLM 平均优于传统装箱启发式方法、传统强

HappyWorld-Bench评估世界模型的可靠性

HappyWorld-Bench是一套用于评估世界模型的综合基准。它不仅衡量生成世界的视觉质量,还测试模型在探索、交互和修改过程中的一致性与响应能力。该框架围绕六项能力,覆盖视频、空间和具身世界模型三个评测方向。研究评估了14个视频模型、9个空间系统和8个具身模型候选,并结合自动化行为指标、人工A/B比较和Elo评分。结果显示,三类模型都存在明显的可靠性缺口:视频模型在长时间生成和重新访问时一致性

智元第2万台具身智能机器人下线,刷新量产纪录

智元第2万台通用具身智能机器人“远征A3 Ultra”在横琴长隆飞船乐园下线,并交付长隆集团。双方同日启用一座大型具身智能主题乐园,称其为全球首个此类园区。智元全系300多台机器人将常态化用于游客互动、导览、演艺和科普教育。智元表示,此次交付意味着产品从研发验证和展示进一步迈向批量生产与日常运营。A3 Ultra搭载360度感知系统、UWB与RTK融合定位、700 TOPS算力平台,以及拥有20个

中国直播带货明星李佳琦:AI 无法取代真人主播

路透社报道探讨了 AI 对中国直播电商行业的影响。平台和商家越来越多地使用可全天候直播的数字主播;京东称,AI 主播可将运营成本降低 80% 至 90%。李佳琦认为,AI 是提升效率的工具,而非真人主播的替代品,因为人的判断力和与顾客建立的信任难以复制。其他业内人士也指出数字主播的局限。2025 年 9 月,AI 生成内容标识规定生效。抖音禁止完全由 AI 生成的直播,并要求披露数字主播的使用情况

StudentBench:AI辅导与真人辅导带来相当的GRE学习进步

一项针对2,383名参与者的研究使用StudentBench比较了GRE备考中的AI辅导和真人辅导。研究人员称,两者带来的学习进步在统计上相当;在七个GRE领域中,有五个领域的最佳AI辅导平均表现超过真人辅导。一款AI辅导工具以显著更低的成本取得了相近效果:每提升一个百分点,AI成本为0.0052美元,真人辅导为4.81美元。StudentBench还收录了超过17.5万条学生与AI的对话,并向公

EmbodiedSWE:面向长时程灵巧机器人任务的编程智能体

这项研究探讨编程智能体能否通过解决复杂、耗时的机器人任务,为通用机器人策略的训练提供可扩展的监督数据。研究团队推出模拟基准 EMBODIEDSWE-BENCH,涵盖接触密集型操作、可变形物体,以及最长达 30 分钟的连续交互。前沿编程智能体能够解决复杂任务,并将已有方案迁移到不同任务和机器人形态上,但需要大量迭代交互,且方案通常针对单个任务实例。EMBODIEDSWE-GEN 将单个智能体方案扩展

即时记忆:学习为LLM智能体按任务自适应整理记忆

这项研究提出JitMem,一种面向LLM智能体的记忆系统:先完整保留过去的交互轨迹,待新任务到来时再整理出所需信息,从而避免在未知未来查询出现前就决定该记住什么。在ALFWorld、WebShop和τ^2-bench测试中,JitMem优于无记忆智能体,以及在写入时整理记忆的启发式和学习式方法。与最强基线相比,成功率分别提高16.2、16.3和3.9个百分点。即使未经训练的记忆整理器也表现出竞争力