产业观察🔥7.0

阶跃发布 StepAudio 3 系列语音大模型,拿下多个全球第一

IT之家·2026/9/15 07:45:40🔗 原文

📋总体概括

阶跃星辰9月15日发布StepAudio3系列语音大模型,包含Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音理解、语音与音频生成、音乐创作等核心场景,并已全部上线阶跃星辰开放平台。其中StepAudio3Realtime在Artificial Analysis对话动态榜单中以98.9%的综合得分位列全球第一,主打原生全双工、可打断、能理解对话节奏并执行任务的实时交互能力,官方强调真正的差距在于边听边理解和判断何时接话。

关键信息

  • 阶跃星辰9月15日发布StepAudio3系列,含Realtime、ASR、TTS、Gen、Music五款模型
  • 五款模型已全部上线阶跃星辰开放平台
  • StepAudio3Realtime以98.9%综合得分登顶Artificial Analysis对话动态榜单
  • 多款模型在Artificial Analysis榜单位列全球第一
  • Realtime支持原生全双工对话,可理解节奏、处理打断与连续反馈

🔥犀利点评

五款模型一口气打包发布还自称多个全球第一,声势拉满,但第三方榜单第一和真实产品体验之间隔着十万八千里。语音交互真正的考验不在跑分,而在噪音环境、方言口音和复杂任务下的稳定性。全双工+任务执行确实踩中了行业痛点,方向没错,接下来就看有没有杀手级应用敢把它放到用户耳边接受检验。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文