ElevenLabs 推出 v4 和 v4 Turbo 语音模型,支持超过 90 种语言
ElevenLabs 正式推出 v4 和 v4 Turbo 语音模型,新增更精细的情绪控制,降低响应延迟,并提升声音克隆速度。公司表示,用户仅需提供 10 秒音频即可完成声音克隆。新模型支持超过 90 种语言,高于上一代的 70 种;ElevenLabs 称日语、巴西葡萄牙语、普通话和粤语的合成质量提升最明显。用户现在可以组合多个情绪标签,模型会按照指定顺序执行。v4 系列还面向语音智能体场景,可
AI 新闻中心 过去24小时分析了 258 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
ElevenLabs 正式推出 v4 和 v4 Turbo 语音模型,新增更精细的情绪控制,降低响应延迟,并提升声音克隆速度。公司表示,用户仅需提供 10 秒音频即可完成声音克隆。新模型支持超过 90 种语言,高于上一代的 70 种;ElevenLabs 称日语、巴西葡萄牙语、普通话和粤语的合成质量提升最明显。用户现在可以组合多个情绪标签,模型会按照指定顺序执行。v4 系列还面向语音智能体场景,可
三星将向Helix Digital Infrastructure投资10亿美元。这笔投资使该平台获得的总资本超过110亿美元。
据 Artificial Analysis 称,采用最高推理设置的 Sonnet 5.5 在其 Intelligence Index 中排名第二,仅次于 Opus 5.5,并超过 GPT-6 Astra。与 Sonnet 5 相比,该模型得分提高了 18 分,但在比较的三个模型中使用的 token 也最多。该排名反映的是 Artificial Analysis 的评测结果,不能单独证明其在实际使用
Anthropic 发布中端模型的最新版本 Sonnet 5.5。该公司称,新模型比 Sonnet 5 快 30%,Token 消耗也更少,适用于编写代码和制作办公文档等日常任务。根据 Anthropic 自行公布的基准测试,Sonnet 5.5 在智能体编码任务上的表现超过 Opus 5.5。该公司认为,在不突破成本上限的情况下同时运行多个智能体,可能是促成这一结果的因素之一。Anthropic
快手宣布 Kling 4.0 将于 10 月正式上线,Kling 4.0 Flash 已于 9 月 28 日开放小范围体验。据介绍,该模型支持 4K、1080p 10-bit HDR 输出,单次可生成最长 30 秒的视频,并可组合使用图片、视频和主体参考素材。新版本还提供多语种音频,以及更细致的视频编辑和叙事控制功能。HDR 输出和将视频续拍至最长 2 分钟等部分功能仍待推出。
据报道,OpenAI 因安全问题取消了一个新人工智能模型的发布。该模型名为 GPT-6.1 Astra,原计划于 10 月在 ChatGPT 和 Codex 中推出。
佛罗里达州声称大型语言模型威胁文明,并称其为“有史以来最大的公共危害”,同时试图通过法律行动叫停 OpenAI 的开发。
据报道,中国正在考虑允许字节跳动和阿里巴巴购买目前被禁止销售的英伟达芯片。
文章批评把软件当作人来对待。将人工智能拟人化,可能让真正负责其设计、部署及后果的人逃避问责。
洛克菲勒国际董事长、Breakout Capital创始人兼首席投资官鲁奇尔·夏尔马警告,美国10年期国债收益率上升可能威胁人工智能相关交易。他在近期专栏中表示,收益率达到5%可能令人工智能热潮受挫。随着收益率已明显高于这一水平,夏尔马在彭博节目《收盘》中讨论了升至5.2%对人工智能行业可能意味着什么。
Libby Leffler认为,英伟达推出旨在防止人工智能代理失控的新系统,是积极的一步。她表示,股票回购能够反映企业状况。她认为,当天市场走弱,与其说是英伟达底层模型出现问题,不如说更可能受到油价、美国国债收益率等宏观因素,以及市场对人工智能相关新闻的整体情绪影响。
早在图书馆、学期论文和印刷书籍出现之前,学生就通过对话展示所学。
这笔新融资预计将使这家 AI 基础设施初创公司的估值较仅仅四个月前增长三倍以上。
Basis表示,GPT-6 Astra完成一份包含50个标签页的税务工作簿,耗时仅为GPT-5.6 Sol的一半。该公司还称,模型对用户意图的理解更强,因此对其在实际场景中的应用更有信心。
Codex 正在征集使用该工具的开发者、创客、研究人员和创作者的故事。有意者可以分享自己的项目和经历,争取加入 Codex Originals 计划。