AI 新闻中心

AI 新闻中心 过去一年分析了 1377 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

阿里发布 Qwen-UI-Agent,称在多项 GUI 基准测试中领先

阿里巴巴于8月20日发布GUI智能体基础模型Qwen-UI-Agent,支持移动设备、电脑、网页浏览器和深度搜索环境。根据阿里公布的结果,该模型在MobileWorld、MobileWorld-Real、AndroidDaily和OSWorld-Verified上分别取得82.1%、92.2%、97.5%和79.5%的成绩,并在其他多项评测中刷新最高纪录。除常规GUI操作外,模型还支持执行命令行指

宇树科技推进具备自进化能力的物理AI机器人模型

宇树科技创始人王兴兴在2026世界机器人大会上表示,公司正在开发能够自我进化的物理AI机器人模型。相关计划将以大模型为核心,结合学术论文、研究成果、开源方案及自定义规则,自动生成机器人控制代码,并通过模型自评和人工审核进行验证。公司还计划把仿真数据、真实世界数据和人类行为数据纳入训练流程。宇树科技现场展示了人形、四足和轮式机器人在自研群控系统下的协同运行。王兴兴认为,机器人在陌生环境中的泛化能力不

VA-Judger:基于人类偏好的视频音频联合生成奖励建模

VA-Judger是一种用于视频音频联合生成的奖励模型,旨在比单独评估音频质量、视觉保真度和同步性的传统指标更准确地反映人类偏好。研究团队构建了包含9,000个提示词和10,300组细粒度成对比较的VAPref-10K数据集,并提出VA-Judger-Bench评测基准。该模型逐步学习结构化的偏好解释,并通过按质量维度分解人类反馈的强化学习来提供更密集的奖励信号。实验表明,VA-Judger在域内

Google开源Gemma模型下载量突破十亿,拓展至太空与医疗领域

Google DeepMind表示,Gemma系列模型的全球下载量已超过十亿次,开发者还发布了十万多个模型变体。据Google介绍,Gemma已部署在本地设备、边缘基础设施和轨道系统中,用于卫星图像分析、有限带宽优化及通信路由。在印度,Gemma已整合到医疗应用Aarogya Setu中。研究团队还利用Gemma开发医疗数据处理、癌症研究和临床分诊系统。其他项目包括面向医疗场景的MedGemma,

蚂蚁百灵开源 Ling-3.0 Tiny 与 Flash 基础模型,公开训练过程关键 Checkpoint

蚂蚁集团 AI 团队百灵开源了 Ling-3.0-tiny 和 Ling-3.0-flash 基础模型。除最终 Base checkpoint 外,团队还公开了预训练和中期训练阶段的 checkpoint,两个模型合计 6 个。Ling-3.0-tiny-base 拥有 79 亿总参数和 13 亿激活参数;Ling-3.0-flash-base 拥有 1240 亿总参数和 51 亿激活参数。这些

机器人可能很快就要开始工作了

今年在北京举行的世界机器人大会显示,机器人正从展台上的演示逐步进入实际工作场景。目前,机器人已被用于工厂搬运、物流拣货、按摩、手术、机场行李分拣和清洁等任务。人形机器人仍然是展会焦点,但厂商也在根据具体需求开发履带式平台、移动底盘和机械臂。当前多数机器人动作较慢,通用性也不足,往往只能完成单一任务。下一阶段的关键在于训练机器人大脑,并采集大量同步的视觉、关节运动、力度和触觉数据。数据采集手套、外骨

SkillGate:训练长程智能体在策略内选择技能

SkillGate研究人工智能智能体如何在长程任务中决定读取哪项程序性技能。研究人员发现了“选择器信用饥饿”现象:在仅依据结果进行强化学习时,负责命名所选技能的少数词元几乎得不到有效训练信号;如果后续执行失败,正确的选择也可能受到惩罚。SkillGate将传递给执行词元的结果信用,与只传递给技能命名词元的局部优势信号分开。在五项智能体基准测试中,使用16个候选技能时,一个9B策略模型的试验成功率从

欢迎来到数学领域的人工智能危机

在《Decoder》节目中,《The Verge》驻伦敦人工智能记者罗伯特·哈特讨论了人工智能如何改变数学领域,以及许多顶尖数学家为何正经历存在危机。OpenAI近日公布了一组长期数学问题的解答,据称在数学界引发了巨大震动,成为这场讨论的背景。

中国已建成启用超70家具身智能训练场

中国信息通信研究院发布的报告显示,截至6月底,中国已建成并启用超过70家具身智能训练场,另有46家正在建设或规划中。这些训练场是在真实物理环境中支持具身智能数据生产、模型训练,以及系统能力验证和优化的关键基础设施。目前,相关设施已覆盖全国过半省级行政区,并在长三角、京津冀和珠三角形成三大集群。训练场建设正从人才和资本集中的大城市向中小城市延伸,选址逻辑也逐步转向重视真实场景、数据供给和运营效率。按

美光在美国成立存储研究实验室,未来十年计划投入100亿美元

美光科技宣布在美国爱达荷州博伊西成立研究实验室,并计划未来十年投入100亿美元。该实验室将开展长期前沿研究,方向包括核心存储技术、先进存储与计算架构、芯片封装以及下一代半导体制造技术。美光表示,这将成为美国首个专门面向存储技术的研究中心。公司计划与客户、高校、政府、初创企业及产业伙伴合作,连接美国、欧洲和亚洲的研究团队。此次投资是在美光已承诺向美国制造和研发投入超过2500亿美元的基础上追加。公司

OpenAI的长期目标:让AI智能体像人类一样操作电脑

OpenAI多年来一直在开发能够像人类一样操作电脑和浏览器的AI智能体。公司员工称,这项功能正接近向客户逐步开放。相关训练使用了屏幕数据、真人示范,并可能结合强化学习。较新的系统不仅能分析屏幕截图,还能读取网页结构、无障碍信息和链接,从而执行数据录入、合规工作和日程安排等任务,也能让Codex自行测试并修改生成的代码。不过,这项技术在任意网页、应用程序和操作系统上的速度与可靠性仍有限,处理邮件和社