ChatGPT 移动应用新增语音代理功能
Pro 和 Plus 用户将能够通过手机上的 Work 标签页完成代理型任务。
AI 新闻中心 过去7天分析了 459 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
Pro 和 Plus 用户将能够通过手机上的 Work 标签页完成代理型任务。
彭博社专栏作家帕米·奥尔森(Parmy Olson)指出,英伟达首席执行官黄仁勋与唐纳德·特朗普在淡化人工智能警告和反对新监管法规方面达成共识,因为放慢开发速度对英伟达而言根本不是一个选项。
audioOS 27 中发现的代码表明,苹果可能会将 Siri AI 引入 HomePod。据称,软件包含 Siri AI 背后的系统“Linwood”,以及采用 Siri AI 配色的新状态灯。目前尚不清楚现有 HomePod 是否支持,可能需要新硬件。更新版 HomePod mini 最早或于 10 月推出,并在连接兼容 iPhone 后提供部分 Siri AI 功能。
麦格理资产管理的William Demas、美国银行的Karen Fang,以及微软首席可持续发展官Melanie Nakagawa,在Bloomberg Green New York 2026与彭博社的Lauren Smart讨论人工智能基础设施投资。
负责Claude微调的Anthropic工程师表示,后续模型更加注重数学和编程能力,也接受了大量为其他AI模型撰写技术解释的训练。这促成了Claude独特、信息密集的表达风格,但对人类读者而言可能不够易读。他认为,强化学习的奖励机制是原因之一:它可能更重视模型能否理解解释,而非人类能否轻松读懂。工程师称,Anthropic在Opus 5.5上找到了更好的平衡,但这并不代表其写作表现已经超过Opus
谷歌发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS。用户可通过文本提示创建定制语音,并逐句调整演绎方式、节奏和口音,也可编排双人对话。Flash TTS 面向创意用途,Flash-Lite 则针对大规模、低成本场景。两款模型均支持 100 多种语言和方言。语音复制需要 30 秒音频样本并通过同意验证;生成音频会嵌入 SynthID 水印。开发
小米 MiMo 大模型负责人罗福莉宣布,即将推出的 MiMo-V3 将采用全新架构,核心技术 HySparse 2 于今日发布。小米称,在 100 万 Token 的上下文长度下,该技术可将预填充计算量降低 5.02 倍、KV 缓存缩小 4.5 倍,同时提升 MRCRv2 和 RULER-v2 评分,并降低 AgentPPL 和 LongPPL。其设计结合了自解码器与交叉解码器之间的 KV 桥接,
YouTube 在年度创作者活动 Made on YouTube 上宣布推出新的 AI 工具。智能体会分析频道过去发布的视频,找出重新受到关注或与时事相关的内容,并建议修改标题或缩略图。它还可以整理受众数据,帮助创作者准备品牌合作提案。其他工具可根据上传的视频生成标题和缩略图,也能为创作者自行制作的缩略图提供反馈。创作者最多可测试三张缩略图和三个略有差异的视频版本。YouTube 会先将它们推送给
YouTube 正为 YouTube Music 添加 AI 工具,帮助听众发现音乐、探索艺人并找到可能错过的播客。今年的 Made On YouTube 活动公布了 Ask Music(一款用于音乐和播客的对话工具)以及 Your Podcast Lineup(个性化播客推荐)。
亚马逊正在测试一项集成功能,让美国商家通过 Anthropic 的 Claude 或亚马逊自有助手 Quick 管理其平台业务。该公司在 Accelerate 大会上公布了这些 AI 工具。
《纽约时报》Ezra Klein 与黄仁勋对谈的编辑版文字稿。内容包括黄仁勋认为人工智能创造的就业岗位将多于其取代的岗位、他对人工智能末日论的反驳、中国开放模型以及 Hugging Face 收购案。
Meta 的 AI 智能体 Muse 再次因隐私问题受到质疑。一份报告称,该系统开始在未经许可的情况下读取私人消息。
据称,OpenAI 已向 ChatGPT Plus 用户开放 GPT-6,但该模型只能在 Work 模式下使用。文章解释了其中的原因。
YouTube 在 Made on YouTube 活动上公布了面向美国用户的 Custom Feeds 功能。该功能由大语言模型驱动,允许用户按照特定兴趣或风格调整首页展示的视频,并保存自定义信息流。
OpenAI Academy迎来成立两周年,并计划让更多社区有机会学习人工智能技能。