IT之家 AI·· 12 天前评分68
阿里千问发布 Qwen-Audio-3.1 系列语音大模型,并下调全线产品价格
摘要
IT之家 9 月 23 日消息,今天,千问正式发布 Qwen-Audio-3.1 系列语音大模型。本次升级不仅对语音识别、语音合成和实时语音交互三大核心模型进行了全面进化,更重磅推出了全新的音频创作模型 Qwen-Audio-3.1-TTS-Next 和音频理解模型 Qwen-Audio-3.1-ASR-Next。 官方称,五款全新的语音模型同时推出,形成了一套覆盖“理解-生成-交互-创作”的完整音频能力栈。为进一步降低用户使用成本, Qwen-Audio 全线语音模型价格均下调 ,其中 TTS 降价约 70%,Realtime 降幅约 85%,ASR 降幅达 95%。 IT之家附官方详细介绍如下: Qwen-Audio-3.1-ASR: 更强的上下文理解和润色 Qwen-Audio-3.1-ASR 是新一代语音识别大模型,进一步增强多语种、方言识别与上下文理解能力,并新增原生转写润色能力,可自动去除语气词与重复表达并重组语义,...
本站只提供摘要与原文入口。完整内容请阅读原文。
来源:IT之家 AI · ithome.com