影音音频
ElevenLabs新一代v4语音模型支持更精细的表达控制并覆盖90种语言
原标题: ElevenLabs新一代v4语音模型支持更精细的表达控制并覆盖90种语言
📋总体概括
语音AI公司ElevenLabs发布新一代语音合成模型v4,主要升级集中在表达控制和多语言覆盖两个方向:新模型支持更精细的情感与表达控制,并将语言支持扩展到90种,远超此前版本。同时v4在声音克隆效率上大幅提升,仅需10秒音频素材即可完成声音克隆,显著降低使用门槛。这一迭代显示ElevenLabs在AI语音赛道持续加码多语言与个性化能力,意在巩固其在配音、有声书、内容本地化等场景的领先地位。
⚡关键信息
- ▸ElevenLabs发布v4语音模型,支持更精细的表达控制能力
- ▸v4将语言支持范围扩展至90种语言
- ▸新模型支持用10秒音频片段完成声音克隆
- ▸升级方向指向配音、本地化等内容生产场景
🔥犀利点评
10秒克隆声音、90种语言,这两个数字就是ElevenLabs递给内容产业的投名状——把配音成本压到几乎为零。表达控制则是更聪明的落点:光像还不够,得像到能演。但门槛越低,滥用风险越高,克隆名人声线搞诈骗的灰产已经在门口排队了。技术领先是一回事,能不能把安全围栏建得跟模型一样快,才是ElevenLabs接下来真正的考题。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 TechCrunch 阅读全文 →