IT之家 AI·· 12 天前评分72
科大讯飞发布全新语音识别大模型 Spark-ASR-2.0,明日上线讯飞输入法
摘要
IT之家 9 月 23 日消息,今日,科大讯飞正式发布最新一代语音识别大模型 Spark-ASR-2.0。 据官方介绍,Spark-ASR-2.0 通过非自回归与 LLM 增强自回归协同、中英文混合文本与声学联合增强、动态上下文注入等关键技术创新,整体的语音识别效果大幅提升,尤其在通用识别(中英文混合、方言、专业术语)、复杂声学场景识别(高噪、小音量、快语速、儿童)、上下文识别和文本流畅规范性等方面改善明显。在效果提升的同时,Spark-ASR-2.0 的整体推理成本相对 Spark-ASR-1.0 仅增加了 10%。 官方称,“如果说过去的语音识别追求的是一字不差地还原所说内容,那么 Spark-ASR-2.0 则更进一步,让识别结果‘流畅成文’—— 在提升识别准确率的同时,结合上下文逻辑与语境理解,精简冗余表达、精修各类细节,让文字更连贯、语义更清晰。” 相较于 Spark-ASR-1.0,Spark-ASR-2.0 在语音...
本站只提供摘要与原文入口。完整内容请阅读原文。
来源:IT之家 AI · ithome.com