资讯

英伟达新一代算力平台补齐拼图 结合DeepSeek模型Token成本可降35倍

财联社深度·2026/8/25 02:52:48🔗 原文

📋总体概括

英伟达8月24日宣布Groq 3 LPX推理加速器机架进入全面量产,该组件需与Vera Rubin NVL72 GPU主机架搭配部署,专门加速超低延迟Token生成,将于今年晚些时候在Nebius数据中心上线。Vera Rubin平台定位为智能体AI时代的机架级超级计算平台,相比Blackwell在智能体工作效率大幅提升,结合DeepSeek模型可使Token成本降低35倍。

关键信息

  • Groq 3 LPX机架进入全面量产,与Vera Rubin NVL72 GPU主机架异构协同部署
  • LPX专门加速低延迟Token生成,补齐GPU架构在智能体推理上的短板
  • 结合DeepSeek模型,Token成本可降35倍,今年晚些时候上线Nebius数据中心

🔥犀利点评

英伟达不搞GPU替代而是异构互补,算力生意又补上一块高墙砖。

本文由本站自动聚合,以下为原始来源:前往 财联社深度 阅读全文