ElevenLabs 推出 v4 和 v4 Turbo 语音模型:支持 90 余种语言,10 秒素材即可克隆声音

IT之家 9 月 29 日消息,ElevenLabs 于当地时间周一正式推出了两款全新语音模型,分别为 ElevenLabs v4 与 v4 Turbo。新版模型强化了情绪表达控制能力,降低了语音智能体的响应延迟,同时支持 90 余种语言。 该公司去年发布了 v3 模型,并于今年早些时候在华沙举办的活动上对新一代模型进行了预热。v4 系列采用全新架构,实现了更精细的语音控制以及速度更快的声音克隆。官方表示,借助 v4,用户仅需 10 秒音频素材即可完成语音克隆。 在内容创作方面,当朗读大段文本时,新版模型可以更好地维持说话人的音色特征;朗读过程中还能够记住前后文本语境,随之调整语气。Eleve…
以上为资讯摘要,完整内容请访问原文网站。
阅读原文 →