产业观察🔥7.0
智谱 GLM 公开国内大模型首个递归自我改进实践:AI 在十万卡国产集群上自建推理系统
📋总体概括
智谱GLM公布国内大模型行业首个递归自我改进(RSI)工程化实践:由GLM-5.3驱动的Infra Agent在超10万张国产芯片集群上,从零完成GLM-5.3-Flash生产级推理系统的设计、调试与优化,不到两周将端到端吞吐提升至初始基线3倍,硬件利用效率与单Token成本号称达到主流NVIDIA GPU相当水平。该系统已投入真实使用,GLM-5.3-Flash以匿名模型Ox-Alpha身份在OpenCode、OpenRouter上线,6天Token调用量超62万亿,标志AI从写代码延伸到参与推理系统工程闭环。
⚡关键信息
- ▸智谱GLM公开国内大模型厂商首个递归自我改进(RSI)生产环境实践,让AI改进自身运行系统
- ▸Infra Agent由GLM-5.3驱动,在超10万张国产芯片集群上从零搭建生产级推理服务
- ▸不到两周将端到端吞吐提升至初始基线3倍,单Token成本与硬件效率对标主流NVIDIA GPU
- ▸GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线,6天Token调用量超62万亿
🔥犀利点评
AI给自己造引擎,叙事确实漂亮,但要有清醒认知:这是AI辅助调优基础设施,离真正「自我改进」的智能爆炸还很远。真正值得注意的不是RSI噱头,而是敢在十万卡国产芯片上跑生产、且敢用匿名模型接受市场检验——这才是硬实力的试金石。至于「对标NVIDIA」的自评,等第三方压测再说。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →