产业观察🔥7.0
阶跃发布 StepAudio 3 系列语音大模型,拿下多个全球第一
📋总体概括
阶跃星辰9月15日发布StepAudio3系列语音大模型,包含Realtime、ASR、TTS、Gen和Music五款模型,覆盖实时语音交互、语音理解、语音与音频生成、音乐创作等核心场景,并已全部上线阶跃星辰开放平台。其中StepAudio3Realtime在Artificial Analysis对话动态榜单中以98.9%的综合得分位列全球第一,主打原生全双工、可打断、能理解对话节奏并执行任务的实时交互能力,官方强调真正的差距在于边听边理解和判断何时接话。
⚡关键信息
- ▸阶跃星辰9月15日发布StepAudio3系列,含Realtime、ASR、TTS、Gen、Music五款模型
- ▸五款模型已全部上线阶跃星辰开放平台
- ▸StepAudio3Realtime以98.9%综合得分登顶Artificial Analysis对话动态榜单
- ▸多款模型在Artificial Analysis榜单位列全球第一
- ▸Realtime支持原生全双工对话,可理解节奏、处理打断与连续反馈
🔥犀利点评
五款模型一口气打包发布还自称多个全球第一,声势拉满,但第三方榜单第一和真实产品体验之间隔着十万八千里。语音交互真正的考验不在跑分,而在噪音环境、方言口音和复杂任务下的稳定性。全双工+任务执行确实踩中了行业痛点,方向没错,接下来就看有没有杀手级应用敢把它放到用户耳边接受检验。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →