供应链
OceanStor M900为华为SuperPoD带来PB级上下文记忆
原标题: OceanStor M900 Brings PB-Scale Context Memory to Huawei SuperPoDs
📋总体概括
华为在2026年9月17日上海HUAWEI CONNECT 2026大会上发布OceanStor M900上下文记忆存储系统,由轮值董事长 David Wang 主题演讲中推出。该系统面向超大规模数据中心的AI推理场景,单集群可提供64PB的KV cache容量,为SuperPoD提供全共享内存空间与PB级容量,本质是把KV缓存从GPU显存和节点本地内存中剥离出来做成共享存储层,解决大模型推理中长上下文、多会话复用带来的显存瓶颈与重复计算问题,是华为AI基础设施「存算协同」路线的关键落子。
⚡关键信息
- ▸华为于2026年9月17日在上海HUAWEI CONNECT 2026发布OceanStor M900上下文记忆存储
- ▸轮值董事长David Wang在主题演讲中亲自介绍该产品
- ▸单集群可提供64PB的KV cache容量,面向超大规模数据中心AI推理
- ▸系统为SuperPoD提供全共享内存空间和PB级容量,定位为AI推理的「上下文记忆」层
- ▸将KV缓存从GPU显存外置到共享存储,目标是缓解推理显存瓶颈与重复预填充开销
🔥犀利点评
华为把KV缓存做成独立存储品类,名字起得聪明——「上下文记忆」直接对着推理成本这一痛点。64PB单集群数字漂亮,但真正的问题是共享内存的访问延迟和带宽能否追上GPU的胃口:KV cache复用省的是预填充算力,可若取回速度不够快,省下的钱又吐回去了。这步棋与英伟达张扬的显存堆叠路线相反,赌的是「存算分离+池化」架构。方向没错,成败取决于实测时延,而非发布会上的容量数字。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 unite.ai 阅读全文 →