产业观察
阶跃发布语音大模型StepAudio 3系列
📋总体概括
9月15日,阶跃星辰发布新一代语音大模型StepAudio 3系列,一次性推出Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音识别、真人级语音生成和音乐创作等完整语音链路。不同于单点模型迭代,阶跃以全家桶方式切入语音赛道,意在打造端到端的语音能力底座,向实时对话、内容生成与音乐创作等多元场景同时卡位。
⚡关键信息
- ▸阶跃星辰于9月15日发布StepAudio 3系列语音大模型
- ▸系列包含Realtime、ASR、TTS、Gen、Music五款模型,一次性齐发
- ▸覆盖实时语音交互、语音识别、语音生成和音乐创作四大场景
- ▸强调真人级语音生成能力,主打端到端语音全链路布局
🔥犀利点评
一次发五款模型,听起来阵仗很大,但本质是把语音赛道从单点竞争拉到全家桶竞争。实时交互、识别、合成、音乐各有强敌,阶跃想用全链路协同做差异化,思路没错,可也意味着五条战线同时开打,没有一条能输得太难看。模型齐不齐是姿态,实际延迟、音色和落地案例才是生死线,发布只是入场券。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文 →