AI 新闻中心

AI 新闻中心 过去7天分析了 260 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

从 Anthropic 到机器人:AI 的下一个前沿

彭博社的 Ed Ludlow 介绍 Anthropic 推出的新款、更快速且成本更低的 AI 模型。这家初创公司正努力在可能的 IPO 前保持领先于竞争对手。Morgan Stanley 的 Adam Jonas 还谈及 SpaceX、Tesla 和机器人行业的发展。彭博社另报道称,Apple 计划推出自家的无屏健康与健身追踪器,以与 Whoop 竞争。

Siri AI 或将登陆 HomePod

audioOS 27 中发现的代码表明,苹果可能会将 Siri AI 引入 HomePod。据称,软件包含 Siri AI 背后的系统“Linwood”,以及采用 Siri AI 配色的新状态灯。目前尚不清楚现有 HomePod 是否支持,可能需要新硬件。更新版 HomePod mini 最早或于 10 月推出,并在连接兼容 iPhone 后提供部分 Siri AI 功能。

Anthropic工程师解释Claude写作变差的原因:模型被训练成写给AI看,而非写给人看

负责Claude微调的Anthropic工程师表示,后续模型更加注重数学和编程能力,也接受了大量为其他AI模型撰写技术解释的训练。这促成了Claude独特、信息密集的表达风格,但对人类读者而言可能不够易读。他认为,强化学习的奖励机制是原因之一:它可能更重视模型能否理解解释,而非人类能否轻松读懂。工程师称,Anthropic在Opus 5.5上找到了更好的平衡,但这并不代表其写作表现已经超过Opus

谷歌推出 Gemini 3.8 Flash 和 Flash-Lite TTS,可逐句精细控制台词演绎

谷歌发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS。用户可通过文本提示创建定制语音,并逐句调整演绎方式、节奏和口音,也可编排双人对话。Flash TTS 面向创意用途,Flash-Lite 则针对大规模、低成本场景。两款模型均支持 100 多种语言和方言。语音复制需要 30 秒音频样本并通过同意验证;生成音频会嵌入 SynthID 水印。开发

小米宣布 MiMo-V3 将采用全新架构,HySparse 2 今日发布

小米 MiMo 大模型负责人罗福莉宣布,即将推出的 MiMo-V3 将采用全新架构,核心技术 HySparse 2 于今日发布。小米称,在 100 万 Token 的上下文长度下,该技术可将预填充计算量降低 5.02 倍、KV 缓存缩小 4.5 倍,同时提升 MRCRv2 和 RULER-v2 评分,并降低 AgentPPL 和 LongPPL。其设计结合了自解码器与交叉解码器之间的 KV 桥接,

蚂蚁百灵开源 Ming-Image-0.1-Design 系列模型

蚂蚁百灵团队开源两款参数量均为 60 亿的模型。Ming-Image-0.1-Design 可根据文字需求生成 UI、信息图、海报等视觉设计;Layer 版本可将设计拆分为可独立编辑的透明图层。团队还开源了 Design Skill 和 PPT Skill。在 Artificial Analysis 的 UI/UX 设计专项评测中,该模型位列开源模型第一,Elo 得分为 1082。蚂蚁称,模型在复

科大讯飞发布语音识别大模型 Spark-ASR-2.0,明日起逐步上线讯飞输入法

科大讯飞发布新一代语音识别大模型 Spark-ASR-2.0。公司称,该模型提升了中英文混合、方言及复杂声学环境下的识别效果,采用非自回归与经大语言模型增强的自回归识别协同、动态上下文注入等技术。相比 Spark-ASR-1.0,推理成本增加 10%。模型将于明日起逐步上线讯飞输入法,并通过讯飞开放平台提供 API,后续还将应用于更多讯飞产品。