阿里巴巴在千问 AI 平台上线 Qwen-Audio-3.0 系列语音模型
阿里云宣布,Qwen-Audio-3.0 系列语音模型已上线千问 AI 平台和阿里云百炼平台。开发者可通过 API 或 Token Plan 调用模型。该系列包括语音识别模型 Qwen-Audio-3.0-ASR、语音合成模型 Qwen-Audio-3.0-TTS,以及实时语音交互模型 Qwen-Audio-3.0-Realtime。阿里巴巴称,该系列在 Artificial Analysis 今年 7 月的语音模型排行榜中,获得语音识别、实时交互和语音合成三个类别的全球第一。模型支持复杂及专业场景识别、多语言和多方言、情绪与语气控制,以及可随时打断并调用工具的端到端语音对话。目前已应用于千问 App、千问办公和 Qoder 等产品。
本文来源:IT之家,AIbase,仅供学习参考,版权归原作者所有。