英伟达同意以130亿美元收购Hugging Face
英伟达已同意以130亿美元收购Hugging Face。该交易正值英伟达加大开发开放权重模型及相关服务力度之际。
AI 新闻中心 过去30天分析了 317 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
英伟达已同意以130亿美元收购Hugging Face。该交易正值英伟达加大开发开放权重模型及相关服务力度之际。
中国 GPU 厂商摩尔线程在 2026 年上半年业绩说明会上表示,公司已打通具身智能从合成数据生成、大模型训练、仿真验证到端侧硬件部署的完整链路。公司推出全栈具身智能仿真平台 MT Lambda,并开源了基于 MUSA 架构的 GPU 加速物理仿真后端 MuJoCo Warp MUSA。摩尔线程还表示,已完成四足机器狗和两足人形机器人的 Sim-to-Real 真机验证。公司在无锡设立工业具身智能
VibeVoice-ASR-Streaming 是一款用于实时流式自动语音识别和说话人归属的端到端模型。不同于将语音识别与说话人分离作为两个独立任务的传统系统,该模型结合固定大小的音频片段、少量前瞻音频和先前文本,在语音到达时直接输出“谁说了什么”。根据公布的评测结果,7B 模型在五个评测集上取得最低的平均 WER/CER,并在 13 项说话人归属设置中的 12 项达到最佳或并列最佳表现。研究团队
该研究推出 DisCo,一种将 GitHub 仓库和论文中的实践知识转化为紧凑、经过验证的技能的研究代理,用于自主机器学习研究。其 AREX-Skill Library 从 1,000 个广泛使用的 ML 仓库中提炼出超过 5,000 项技能。在模型、研究框架和执行预算保持不变的情况下,研究称配备这些技能的代理在 MLE-bench、PaperBench、FrontierCS 和 PassNet
百度基础模型研发部门正在重组研究团队。百度引进了来自一家未具名北美前沿实验室的资深研究员武钦,以增强文心系列模型的预训练能力。前 DeepSeek 研究员魏浩然也已转入百度,负责多模态算法开发。他的团队此前开源了 Unlimited OCR 模型,并在 OmniDocBench 基准测试中排名第一。百度希望通过引进人才强化文心的研究组织和技术开发,但这名新研究员的具体背景尚未公开。
据《The Information》报道,中国人工智能公司月之暗面已秘密提交在香港进行首次公开募股(IPO)的申请。一位消息人士称,公司还在洽谈一轮上市前融资,潜在估值为500亿美元。月之暗面是开源模型Kimi K3的开发商。
该研究探讨模型如何直接在像素空间中读取、检索和压缩语言。通过系统性的控制变量实验,研究人员确定了四项关键因素:可变图像分辨率和字体大小、用于视觉对齐的自然图像文本对、防止像素级捷径学习的布局感知渲染,以及用于跨语言对齐的两阶段多语言训练课程。研究团队将这些原则整合到 Pixel Linguist II 中。这是一款采用原生分辨率、支持即时渲染,并使用2.8亿个训练样本训练的视觉编码器。该模型在英语
ExecRetrieval 是一个用于测试代码嵌入系统能否区分功能正确代码与几乎相同但存在错误的代码变体的基准。数据集包含 939 个 Python 任务,每个任务配有一个经过执行验证的标准实现,以及最多四个通过单一目标修改生成、同样经过执行验证的错误干扰项。研究人员评估了 23 种密集嵌入配置和 BM25。表现最佳的托管系统 exec@10 达到 1.00,但 exec@1 仅为 0.331。在
SolarWM 是一个完全开放的视频世界模型基础平台,覆盖从数据准备到长时域推理的完整流程。其数据引擎将来自 10 个数据集的 143 万个标准化视频片段转换为统一的逐帧对齐格式,涵盖视觉观测、度量相机几何、字幕、质量元数据、筛选决策和数据来源。统一的相机条件控制、训练和推理接口支持 4 个基于 Wan2.2、LTX-2.5 和 MiniMax-H3 的模型,参数规模为 50 亿至 330 亿,同
一项研究在接触密集的机器人 ParcelStow 任务中,以不同执行速度比较脚本专家与利用专家示范训练的 Action Chunking with Transformers(ACT)策略。两者在标称速度下的任务成功率均为 100%。但在测试的最高速度下,专家成功率降至 84%,ACT 仅为 53%。两个 ACT 策略相比标称速度分别下降 34 和 48 个百分点,而专家下降 16 个百分点。ACT
马克·扎克伯格表示,Meta 的 Watermelon 模型以及 Muse Spark 的开放权重版本将很快发布。据介绍,Muse Spark 1.3 目前正在陆续上线,并宣称在编程和智能体任务方面实现性能提升,同时保持极低成本。关于其达到前沿水平以及取得大幅进步的说法,目前尚未得到独立基准测试的验证。
SemiAnalysis分析了韩国建设主权人工智能能力的努力,其中包括计划投资9190亿美元发展人工智能基础设施。报告还讨论了英伟达与三星、SK海力士扩大合作关系的进展、一项受《鱿鱼游戏》启发的全国人工智能竞赛、非中国地区最具代表性的开源模型被淘汰,以及英伟达支持开源的原因。文章还评估了这些发展对韩国半导体产业可能产生的影响。
该论文提出 Harness-of-Harness(HoH),一个面向大语言模型编程代理的框架。HoH 将现有代理运行环境组织为反复执行的规划、编码和测试循环,在修复问题与扩展能力之间取得平衡,并将开发拆分为可验证的小步骤,分离实现阶段测试与独立评估,同时保留带版本记录的项目历史。研究人员报告称,在 GameCraft-Bench、FrontierSWE 和 ProgramBench 上,经过三次迭
OPPO 联合 OpenKG,以及浙江大学、同济大学、东南大学等高校的研究团队,推出端侧 AI 记忆评测基准 MobileMem。该项目旨在建立统一标准,让不同技术方案能够进行测试、比较和改进。技术白皮书已经公开,数据集和相关工具预计将陆续开源。OPPO 认为,端侧记忆是 AI 助手持续理解用户、记住其习惯和偏好,并在合适时机提供帮助的重要基础。目前公告没有公布具体评测结果,也未提供经验证的性能提
E-Commerce Bench 是一个开源基准,用于评估大语言模型智能体在动态年度商业模拟中的表现。智能体需要同时运营多家网店,开展市场调研,与供应商谈判,优化销售策略,处理订单和退货,并管理现金流。模拟环境包括促销活动、自然灾害和供应链冲击。研究团队从七个维度评估了18个前沿模型,结果显示没有任何模型在所有领域都占据优势。GPT-5.6 Sol 将10万初始资金增至1,431,425,期末资产