供应链

OceanStor M900为华为SuperPoD带来PB级上下文记忆

原标题: OceanStor M900 Brings PB-Scale Context Memory to Huawei SuperPoDs

unite.ai·2026/9/17 13:32:01🔗 原文

📋总体概括

华为在2026年9月17日上海HUAWEI CONNECT 2026大会上发布OceanStor M900上下文记忆存储系统,由轮值董事长 David Wang 主题演讲中推出。该系统面向超大规模数据中心的AI推理场景,单集群可提供64PB的KV cache容量,为SuperPoD提供全共享内存空间与PB级容量,本质是把KV缓存从GPU显存和节点本地内存中剥离出来做成共享存储层,解决大模型推理中长上下文、多会话复用带来的显存瓶颈与重复计算问题,是华为AI基础设施「存算协同」路线的关键落子。

关键信息

  • 华为于2026年9月17日在上海HUAWEI CONNECT 2026发布OceanStor M900上下文记忆存储
  • 轮值董事长David Wang在主题演讲中亲自介绍该产品
  • 单集群可提供64PB的KV cache容量,面向超大规模数据中心AI推理
  • 系统为SuperPoD提供全共享内存空间和PB级容量,定位为AI推理的「上下文记忆」层
  • 将KV缓存从GPU显存外置到共享存储,目标是缓解推理显存瓶颈与重复预填充开销

🔥犀利点评

华为把KV缓存做成独立存储品类,名字起得聪明——「上下文记忆」直接对着推理成本这一痛点。64PB单集群数字漂亮,但真正的问题是共享内存的访问延迟和带宽能否追上GPU的胃口:KV cache复用省的是预填充算力,可若取回速度不够快,省下的钱又吐回去了。这步棋与英伟达张扬的显存堆叠路线相反,赌的是「存算分离+池化」架构。方向没错,成败取决于实测时延,而非发布会上的容量数字。

本文由本站自动聚合,以下为原始来源:前往 unite.ai 阅读全文