ElevenLabs 推出 v4 和 v4 Turbo 语音模型,支持超过 90 种语言
ElevenLabs 正式推出 v4 和 v4 Turbo 语音模型,新增更精细的情绪控制,降低响应延迟,并提升声音克隆速度。公司表示,用户仅需提供 10 秒音频即可完成声音克隆。新模型支持超过 90 种语言,高于上一代的 70 种;ElevenLabs 称日语、巴西葡萄牙语、普通话和粤语的合成质量提升最明显。用户现在可以组合多个情绪标签,模型会按照指定顺序执行。v4 系列还面向语音智能体场景,可在大型语言模型生成回答的同时同步生成音频。今年早些时候,ElevenLabs 从红杉资本融资 5 亿美元,投后估值达到 110 亿美元。公司称年化营收运行率已超过 6 亿美元,并计划在未来几年内进行首次公开募股。
本文来源:IT之家,仅供学习参考,版权归原作者所有。