产业观察

英伟达展示 DSX MaxLPS 技术,AI 工厂每兆瓦 token 吞吐量最高提升 40%

IT之家·2026/9/17 05:04:39🔗 原文

📋总体概括

英伟达在AI基础设施峰会上展示了面向AI工厂的DSX MaxLPS功耗调度系统,可将每兆瓦token吞吐量最高提升40%。该技术已由Emerald AI集成至Conductor平台,通过DSX Flex根据电网状态动态调整数据中心用电需求,已接收200次电网信号且无需人工干预。GPU云服务商Lambda在5机架19节点的测试集群中验证:在固定功率预算下,通过动态功率调度,token吞吐量从每秒约400万提升至500万,增幅24%,每瓦性能提升23%。此外Vera Rubin等机架在相同站点功耗下GPU数量最多可增40%。

关键信息

  • 英伟达展示DSX MaxLPS功耗调度系统,AI工厂每兆瓦token吞吐量最高提升40%
  • 该技术已由Emerald AI集成至Conductor平台,可根据电网状态动态调整数据中心用电需求
  • Lambda在5机架19节点集群测试,固定功率预算下吞吐量从每秒400万token提升至500万,增幅24%
  • Vera Rubin等机架在相同站点功耗范围内,GPU数量最多可增加40%,token吞吐量最多提升35%

🔥犀利点评

电闸一拉一合,吞吐量凭空多出24%——这才是AI时代真正的炼金术。当算力竞赛的瓶颈从芯片转向电网,谁能把每一瓦电力榨出更多token,谁就掌握定价权。英伟达此招本质是把电网调度的余量变现,Lambda小规模验证尚可,但电网信号、负载波动的真实生产环境远比5个机架复杂。与其说这是技术突破,不如说是电力稀缺时代的生存策略。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文