产业观察
阶跃发布 StepAudio 3 ,多款语音模型登顶 Artificial Analysis 全球榜单
📋总体概括
9月15日,阶跃星辰发布新一代语音大模型StepAudio 3系列,一次性推出Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音识别、语音生成与音乐创作等场景,多款模型在第三方评测机构Artificial Analysis榜单位列全球第一。相比以往围绕单项语音能力的竞争,StepAudio 3强调全栈能力,涵盖语音理解与生成、实时推理、任务执行和音频创作,其中Realtime支持原生全双工对话,可判断回应时机并处理打断,标志着国产语音模型从「能听说」迈向「懂语义、能执行」的新阶段。
⚡关键信息
- ▸阶跃星辰9月15日发布StepAudio 3系列,包含Realtime、ASR、TTS、Gen、Music五款语音模型
- ▸多款模型在权威评测机构Artificial Analysis榜单中位列全球第一
- ▸StepAudio 3 Realtime支持原生全双工对话,可在持续交流中判断回应时机并处理临时打断
- ▸该系列从单项语音识别或生成竞争扩展到理解、推理、任务执行与音频创作的全栈能力
- ▸模型能理解声音背后的语义与情绪,参与更完整的交互和内容生产流程
🔥犀利点评
语音赛道的竞争正在换规则:拼识别率、拼音色的老打法已经不够看了,阶跃直接把实时交互、语义理解、任务执行打包成一个全栈系列,还顺手把Artificial Analysis的全球第一拿下。这种「一个系列打五个场景」的打法,明摆着是要卡位AI语音助手的底层入口。不过榜单第一和商业化落地之间还隔着一道鸿沟,接下来的问题是:谁来用、怎么收费、能不能扛住真实场景的延迟和成本考验。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 雷峰网 阅读全文 →