供应链🔥7.0

浪潮信息发布元脑 SD200 Ultra 超节点:单机承载 2.8 万亿参数 Kimi K3,Token 时延首次突破 5.85 毫秒

IT之家·2026/9/21 23:40:31🔗 原文

📋总体概括

浪潮信息在AICC2026上发布元脑SD200 Ultra超节点AI服务器与HC2000多元算力机组。SD200 Ultra基于国产AI芯片,紧耦合128芯,配备8TB统一编址显存与64TB内存,采用3D Hyper Mesh架构和内存语义通信,通信时延低至0.69微秒。单机可承载2.8万亿参数的Kimi K3大模型,Token生成时延首次降至5.85毫秒以内,相当于单用户170 Tokens/s,为业界平均水平的5倍,并支持10万亿参数模型单机运行,展示国产AI算力在超节点和推理性能上的进展。

关键信息

  • 浪潮信息发布元脑SD200 Ultra超节点,单机承载2.8万亿参数Kimi K3大模型
  • Token生成时延首次降至5.85毫秒以内,单用户170 Tokens/s,达业界平均5倍
  • 采用3D Hyper Mesh架构紧耦合128芯国产AI芯片,通信时延低至0.69微秒
  • 配备8TB统一编址显存与64TB内存,支持10万亿参数前沿模型单机运行
  • 同场还发布元脑HC2000多元算力机组,实现GPU跨主机域统一寻址访问

🔥犀利点评

5.85毫秒的Token时延和170 Tokens/s单用户速度,配合单机跑2.8万亿参数模型,这套数据若经真实负载验证,确实是国产算力在推理侧的硬突破。但5倍于业界平均的说法缺乏第三方基准背书,且超节点性能高度依赖特定模型适配,通用性存疑。128芯紧耦合架构是方向对了,可国产芯片的真正考题不在发布会PPT,而在规模化交付后的稳定性与生态兼容。先鼓掌,后验货。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文