科大讯飞发布语音识别大模型 Spark-ASR-2.0,明日起逐步上线讯飞输入法
科大讯飞发布新一代语音识别大模型 Spark-ASR-2.0。公司称,该模型提升了中英文混合、方言及复杂声学环境下的识别效果,采用非自回归与经大语言模型增强的自回归识别协同、动态上下文注入等技术。相比 Spark-ASR-1.0,推理成本增加 10%。模型将于明日起逐步上线讯飞输入法,并通过讯飞开放平台提供 API,后续还将应用于更多讯飞产品。
本文来源:IT之家,仅供学习参考,版权归原作者所有。