AI 新闻中心

AI 新闻中心 过去一年分析了 504 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

DeepSeek 运行在华为芯片上,为何可能成为美国的难题

文章分析华为建设 AI 超节点的策略,以及其对英伟达竞争格局的潜在影响。重点包括昇腾 960 加速器、鲲鹏 CPU、UnifiedBus 互联协议、采用近封装光学技术的 Hi-One,以及面向 AI 上下文数据的 OceanStor 存储系统。华为希望将这些组件整合为支持训练、推理和智能体 AI 的平台,通过大规模扩展与系统级整合来弥补单芯片性能差距。不过,相关性能数据主要来自华为的企业发布,独立

Whisper 编码器减少六层:利用无标签数据恢复性能

研究提出的方法移除 Whisper large-v3-turbo 中对词错误率(WER)影响最小的六个编码器层,使编码器规模减少 18.5%。生成的模型无需定制推理实现。随后使用无标签单语语音数据进行蒸馏,使四种语言的平均 WER 从剪枝后的 21.9% 降至 20.1%;原始模型为 18.2%。研究团队已公开代码和剪枝后的模型。

Meta称Muse从零打造,但产品设计深受OpenClaw启发

Meta产品负责人纳特·弗里德曼表示,Muse是从零开始构建的,但产品设计确实深受OpenClaw启发。团队曾使用这款开源AI智能体,并希望打造类似产品,同时实现安全、可靠、易用以及服务数十亿用户的规模。此前,有用户指出两套系统的文件和结构存在相似之处。弗里德曼没有否认这些说法,并称赞OpenClaw开发者彼得·斯坦伯格。Muse近期登上美国App Store免费应用榜第一名。

摩尔线程宣布:MTT S5000 适配字节跳动开源生物分子结构预测模型 Protenix-v2

摩尔线程宣布,旗下 MTT S5000 智算卡已支持开源生物分子结构预测模型 Protenix-v2 的全链路推理。该模型由字节跳动 Seed 团队研发,于 2026 年 4 月发布,据称在多项核心基准测试中表现与 DeepMind 的 AlphaFold 3 持平或更优,可预测蛋白质、DNA、RNA及小分子配体复合物。摩尔线程表示,此次适配完成了面向 AI for Science 场景的端到端工

OpenAI 发布 MentalHealthBench:以 1215 段对话评估 AI 的心理健康应对能力

OpenAI 发布了开放基准测试 MentalHealthBench,包含 1215 段合成心理健康对话,用于评估 AI 系统应对日常议题和紧急情况的能力。来自 22 个国家和地区的 80 多名持证心理学家与精神科医生参与制定,内容覆盖 19 种语言和近 20 个专业领域,并设有 5262 条专家评分标准。OpenAI 称,在受测模型中 GPT-6 Astra 得分最高,同时强调该基准是可审查的诊

腾讯推出翻译应用“腾讯 Hy 翻译”,支持 33 种语言互译

腾讯混元推出“腾讯 Hy 翻译”App,同时提供小程序、插件和 PC 端版本。该应用基于 Hy-MT2 翻译模型,支持 33 种语言互译,涵盖 5 种中国少数民族语言及方言,并提供语音、拍照和离线翻译。用户可将模型预先下载到手机,在无网络连接时使用。Hy-MT2 已于今年 5 月开源,并支持在移动设备本地部署。该应用目前已在 12 个国家和地区上线。

PackLab:用于机器人容器装箱 MLLM 开发、训练与评测的综合框架

PackLab 是一个用于开发和评估多模态大语言模型的框架,面向机器人容器装箱中的闭环长期序列决策。该套件包括基于物理的仿真平台,可规模化生成多样化训练轨迹;PackLab-VLM,可根据物体和容器状态的变化同时选择物体并预测放置位置;以及 PackLab-Bench,提供多个难度等级的标准化评测场景。实验显示,在不同物体集合和容器配置下,PackLab-VLM 平均优于传统装箱启发式方法、传统强

高通加码物理人工智能,拟收购机器人软件企业 PickNik Robotics

高通已就收购机器人软件企业 PickNik Robotics 达成协议。PickNik 长期维护 MoveIt,这是全球应用广泛的开源机器人框架之一。高通表示,将继续保持 MoveIt 开源,并由社区制定发展路线图;同时简化其与 Dragonwing 机器人平台的集成,并继续支持 MoveIt 在第三方硬件上的应用。

Hunyuan-A13B 技术报告

报告介绍了采用混合专家架构的开源语言模型 Hunyuan-A13B。模型总参数量为 800 亿,但推理时仅激活 130 亿个参数。模型使用经过严格筛选、并加强 STEM 数据整理的 20 万亿 token 语料进行预训练,随后通过监督微调和大规模强化学习进一步提升能力。其双模式思维链框架会根据任务复杂度调整推理深度。报告称,该模型在数学、科学、编程等评测中表现具有竞争力。开发团队公开模型,以支持开

小米宣布 MiMo-V3 将采用全新架构,HySparse 2 今日发布

小米 MiMo 大模型负责人罗福莉宣布,即将推出的 MiMo-V3 将采用全新架构,核心技术 HySparse 2 于今日发布。小米称,在 100 万 Token 的上下文长度下,该技术可将预填充计算量降低 5.02 倍、KV 缓存缩小 4.5 倍,同时提升 MRCRv2 和 RULER-v2 评分,并降低 AgentPPL 和 LongPPL。其设计结合了自解码器与交叉解码器之间的 KV 桥接,

蚂蚁百灵开源 Ming-Image-0.1-Design 系列模型

蚂蚁百灵团队开源两款参数量均为 60 亿的模型。Ming-Image-0.1-Design 可根据文字需求生成 UI、信息图、海报等视觉设计;Layer 版本可将设计拆分为可独立编辑的透明图层。团队还开源了 Design Skill 和 PPT Skill。在 Artificial Analysis 的 UI/UX 设计专项评测中,该模型位列开源模型第一,Elo 得分为 1082。蚂蚁称,模型在复

RoboFollow揭示具身智能体指令遵循能力的假象

一项新基准测试发现,具身智能体遵循指令的能力远不如成功率所显示的那样。在场景熵较低、只有一项有效任务时,智能体可能几乎不依赖语言也能成功。RoboFollow让每个场景都包含多种可能任务,并通过分层诊断流程检验智能体能否一致地理解和执行指令。对九种VLA和WAM策略的评估显示,在简单测试中的良好表现无法可靠地迁移到更具挑战性的测试中。多种受测改进方法也未能弥合这一差距。代码和数据集现已公开。

从模式识别器到个性化陪伴者:大型语言模型在心理健康领域的综述

本综述将大型语言模型(LLM)在心理健康领域的发展概括为三个阶段:最初作为信息工具和模式识别器,随后成为用于即时互动的共情型对话者,目前则迈向具备持续记忆的长期个性化陪伴者。文章系统分析了相关核心技术,以及涵盖用户画像、记忆、推理和规划的智能体架构,并梳理数据集与评测基准。研究旨在整合这一领域较为分散的文献,为构建负责任、有效且以人为本的心理健康人工智能系统提供发展方向。