IT之家 AI·· 7 天前评分68
ElevenLabs 推出 v4 和 v4 Turbo 语音模型:支持 90 余种语言,10 秒素材即可克隆声音
摘要
IT之家 9 月 29 日消息,ElevenLabs 于当地时间周一正式推出了两款全新语音模型,分别为 ElevenLabs v4 与 v4 Turbo。新版模型强化了情绪表达控制能力,降低了语音智能体的响应延迟,同时支持 90 余种语言。 该公司去年发布了 v3 模型,并于今年早些时候在华沙举办的活动上对新一代模型进行了预热。v4 系列采用全新架构,实现了更精细的语音控制以及速度更快的声音克隆。官方表示,借助 v4,用户仅需 10 秒音频素材即可完成语音克隆。 在内容创作方面,当朗读大段文本时,新版模型可以更好地维持说话人的音色特征;朗读过程中还能够记住前后文本语境,随之调整语气。ElevenLabs 曾在 v3 版本当中引入内联标签用以设定语音情绪;到了 v4,标签功能得到进一步扩充,用户可以叠加多个标签,模型将按照标签的先后顺序执行。 旧版模型支持 70 种语言。经过优化之后,新版本的语言支持数量提升至 90 种。这家初创...
本站只提供摘要与原文入口。完整内容请阅读原文。
来源:IT之家 AI · ithome.com