资讯
英伟达新一代算力平台补齐拼图 结合DeepSeek模型Token成本可降35倍
📋总体概括
英伟达8月24日宣布Groq 3 LPX推理加速器机架进入全面量产,该组件需与Vera Rubin NVL72 GPU主机架搭配部署,专门加速超低延迟Token生成,将于今年晚些时候在Nebius数据中心上线。Vera Rubin平台定位为智能体AI时代的机架级超级计算平台,相比Blackwell在智能体工作效率大幅提升,结合DeepSeek模型可使Token成本降低35倍。
⚡关键信息
- ▸Groq 3 LPX机架进入全面量产,与Vera Rubin NVL72 GPU主机架异构协同部署
- ▸LPX专门加速低延迟Token生成,补齐GPU架构在智能体推理上的短板
- ▸结合DeepSeek模型,Token成本可降35倍,今年晚些时候上线Nebius数据中心
🔥犀利点评
英伟达不搞GPU替代而是异构互补,算力生意又补上一块高墙砖。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 财联社深度 阅读全文 →