阿里巴巴发布 Qwen-Audio-3.1 系列语音模型,并下调全线产品价格
阿里巴巴推出 Qwen-Audio-3.1 系列,涵盖语音识别、语音合成、音频理解、音频创作和实时交互模型。新功能包括多语言及方言识别、带说话人区分的转写、结合上下文润色转写文本,以及将语音、音效和环境声整合生成。阿里巴巴称,模型在部分公开和内部评测中有所提升。公司还宣布下调 Qwen-Audio 全线产品价格:TTS 约降 70%,Realtime 约降 85%,ASR 约降 95%。
本文来源:IT之家,AIbase,仅供学习参考,版权归原作者所有。