产业观察

智谱 GLM-5.3-FlashX 模型上线,更快、更流畅

IT之家·2026/9/18 04:45:33🔗 原文

📋总体概括

智谱于9月18日推出GLM-5.3-FlashX模型,最高速度达200 tokens/s,面向企业与开发者提供更快更流畅的推理体验。该模型的前身GLM-5.3-Flash曾以「Ox Alpha」之名面向全球开发者,调用量持续攀升。智谱在10万张国产芯片推理算力基础上,进一步加大Infra侧投入与推理优化,官方称GLM-5.3-Flash长期保持同尺寸最强智能水平,此次提速使其在智能、价格、速度三方面形成全面竞争力。API现已上线,模型Key为GLM-5.3-FlashX。

关键信息

  • 智谱9月18日发布GLM-5.3-FlashX模型,推理速度最高达200 tokens/s
  • 前代GLM-5.3-Flash曾以「Ox Alpha」名义面向全球开发者,调用量持续攀升
  • 推理算力基于10万张国产芯片,并进一步加大Infra侧投入与推理优化
  • API已上线,模型Key为GLM-5.3-FlashX,官方称其保持同尺寸最强智能水平

🔥犀利点评

200 tokens/s确实是能打动开发者的硬指标,但真正的看点其实是那10万张国产芯片——在英伟达算力受限的背景下,敢把推理优化和成本故事讲圆的国产大模型公司不多。智谱用Flash系列走「便宜、够快、还行」的走量路线,逻辑清晰,但「同尺寸最强」这类自评听听就好,最终还得看第三方评测和留存率说话。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文