AI 新闻中心

AI 新闻中心 过去24小时分析了 165 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

TestPrism:重新思考超越单一参考实现的测试评估

编程智能体生成的测试通常只针对一个参考实现进行评估,这可能忽略其他有效实现,并高估测试质量。TestPrism包含来自17个来源的300项测试任务和3,000个候选实现,有效与无效实现各占一半。其核心指标Joint Success Function要求测试在初始程序上失败、接受所有有效候选,并拒绝所有无效候选。在14种编程智能体配置中,该指标得分为28.00%,而单一参考评估的成功率为59.67%

豆包工作新增画布功能并更新模型

豆包工作的任务模式新增画布功能,用户可在无限画布上查看、比较和整理素材与成果,并在生成后调整文字、配色和布局。服务还上线了图片模型 Seedream 5.0 Flash 和豆包 2.1 Lite。官方称,2.1 Lite 能减少额度消耗、加快交付,适用于文档撰写、表格处理和 PPT 制作等常见任务。

MC-Sparse:分析并缩小扩散 Transformer 中密集与稀疏注意力的差距

稀疏注意力可降低扩散 Transformer 处理长序列时的延迟,但稀疏度过高往往会损害生成质量。研究指出,质量下降源于 token 分组限制、交互选择不准确,以及丢弃 token 时损失的注意力贡献。研究提出无需训练的 MC-Sparse:选择单个键值(KV)token,将相似查询分组以便在 GPU 上高效执行,并在后续去噪步骤中复用缓存的元数据。在视频和 3D 生成测试中,与密集注意力相比,M

超越时空先验:一种通用的稠密对应匹配方法

FreeMatching 是一种通用方法,即使图像编辑或参考引导生成打破了物理连续性,也能寻找像素间的对应关系。它将生成式和语义基础表征与来自经典数据集、跟踪视频及合成场景的监督信号相结合。教师模型引导的迭代优化无需稠密对应标注即可提升结果。实验显示,单一模型能够改善困难图像对的匹配质量,同时在经典基准测试中保持竞争力。该方法还可用于定量评估身份保持,其评分与人类判断相关。代码已公开。

华为智能门锁 2 Pro 悦享版开售,支持 AI 3D 人脸识别 3.0

华为智能门锁 2 Pro 悦享版于 10 月 9 日开售,建议零售价 2699 元,补贴后到手价为 2124.15 元。产品采用 3D ToF 技术和 AI 人脸识别,华为称解锁用时为 0.8 秒,并可动态学习面容及环境变化。活体检测功能旨在防范使用照片、视频和 3D 头模进行的恶意解锁。产品还配备广角智能猫眼、远程操作功能和 10000mAh 电池。

中国电信推出外卖食品安全监管方案,支持扫码追溯

中国电信在上海推出结合后厨监控与外卖防拆封签的食品安全方案。AI 视频分析可识别七类违规行为,包括未穿戴防护服、吸烟和使用手机,并向管理人员实时告警,便于通过双向语音及时干预。消费者收到餐品后可扫描封签,查看留存的监控视频和追溯信息。南京也已落地类似的一体化食品安全监管项目。

消息称人形机器人租赁价格大幅下跌,日租金已低于千元

2025年央视春晚带热的人形机器人租赁市场,如今价格大幅回落。据报道,日租金从2025年初的万元级降至今年初的2,000至3,000元,目前已跌破1,000元。闲鱼等电商平台上,宇树科技人形机器人的租赁标价低至289元/天。租赁价格降低,让一些用户选择先租用体验,而非直接购买。全球首个机器人租赁平台“擎天租”于2026年1月宣布完成种子轮融资;其2月1日至7日的租赁订单量环比增长约30%。

人工智能如何颠覆数学世界

OpenAI上个月表示,已经生成了一份与纳维–斯托克斯问题相关的人工智能证明。过去连计数都表现不佳的大型语言模型,如今开始解决困扰人类数十年的数学问题。与此同时,大学也在应对人工智能对教育的冲击,因为学生可以利用大语言模型完成作业。麻省理工学院工程教育副院长贾斯汀·所罗门介绍了纯数学和应用数学家如何回应人工智能的发展,并解释纳维–斯托克斯问题的内容,以及为什么OpenAI公布的证明即使对专家来说也

为何摩根大通是人工智能应用最先进的银行

摩根大通再次位居 Evident Insight 全球人工智能先进银行排行榜首位。Evident 首席执行官兼联合创始人亚历山德拉·穆萨维扎德解释了为何率先采用人工智能的银行正在取得领先,以及为何人工智能投资力度最大的银行仍在扩大员工队伍,尽管这项技术正在改变工作岗位。

OuroWorld 将静态 3D 场景变为多样且无缝循环的 3D 动态影像

OuroWorld 是一种无需掩码的框架,可将基于 3D Gaussian Splatting 的静态场景转换为动态 3D cinemagraph。视觉语言模型推断合理的运动,并引导视频模型生成参考视频,再将其扩展和补全为多视角视频。周期性 4D Gaussian Splatting 变形场从设计上保证循环播放;以参考视角为锚点的漂移场则用于吸收不同视角间的不一致。该方法还旨在处理一般形变、物体运