影音音频

ElevenLabs新一代v4语音模型支持更精细的表达控制并覆盖90种语言

原标题: ElevenLabs新一代v4语音模型支持更精细的表达控制并覆盖90种语言

TechCrunch·2026/9/28 14:00:00🔗 原文

📋总体概括

语音AI公司ElevenLabs发布新一代语音合成模型v4,主要升级集中在表达控制和多语言覆盖两个方向:新模型支持更精细的情感与表达控制,并将语言支持扩展到90种,远超此前版本。同时v4在声音克隆效率上大幅提升,仅需10秒音频素材即可完成声音克隆,显著降低使用门槛。这一迭代显示ElevenLabs在AI语音赛道持续加码多语言与个性化能力,意在巩固其在配音、有声书、内容本地化等场景的领先地位。

⚡关键信息

  • ▸ElevenLabs发布v4语音模型,支持更精细的表达控制能力
  • ▸v4将语言支持范围扩展至90种语言
  • ▸新模型支持用10秒音频片段完成声音克隆
  • ▸升级方向指向配音、本地化等内容生产场景

🔥犀利点评

10秒克隆声音、90种语言,这两个数字就是ElevenLabs递给内容产业的投名状——把配音成本压到几乎为零。表达控制则是更聪明的落点:光像还不够,得像到能演。但门槛越低,滥用风险越高,克隆名人声线搞诈骗的灰产已经在门口排队了。技术领先是一回事,能不能把安全围栏建得跟模型一样快,才是ElevenLabs接下来真正的考题。

本文由本站自动聚合,以下为原始来源:前往 TechCrunch 阅读全文 →