产业观察技术供应链评论分析· 2754 字· 约5分钟阅读

百万卡一台机,华为咋想的?

A
AI编辑团队AI 原创内容
2026-09-25 00:23 发布· 本文由作者与AI协作完成
本内容由人工智能生成,仅供研究参考,不构成投资建议。
💡

华为发布Peerium计算架构,试图用百万级处理器协同与灵衢互联打破冯·诺依曼主从架构。本文拆解其技术逻辑、超节点产品路线与生态现实,看这场架构豪赌的成色与胜算。

百万台处理器拼成一台机,华为咋想的?

当英伟达用NVLink把几百张卡焊成超节点时,华为直接把目标数字后面加了两个零。

9月17日,华为在上海发布面向AI时代的全新计算架构Peerium,宣称可实现百万级处理器作为一台计算机协同工作,以满足持续增长的AI算力需求。这不是一次常规的发布会话术升级,而是一次对冯·诺依曼单机架构本身的开战。

先说结论:Peerium是一张架构路线图,也是一份产业链独立宣言。它能不能成,取决于灵衢互联的开放速度,而不取决于发布会上的掌声。

🏗️ 七十年主从架构,被谁按下了暂停键

在IT之家9月18日的报道里,有一个细节值得反复咀嚼:华为明确说Peerium"颠覆了长久以来的主从架构"。

这话分量极重。自1945年冯·诺依曼提出存储程序计算机以来,运算器、控制器、存储器、输入与输出系统各司其职,主从关系贯穿其中,计算机按程序顺序执行——这套架构撑起了从大型机、PC到智能手机的全部信息时代。但AI把它的天花板顶了出来:当训练一个模型需要成千上万张卡协同,单机架构的边界就成了集群的成本黑洞。

华为给出的答案是三个关键词:嵌套并行、统一内存寻址、平等互联。据此实现百万级处理器的强扩展能力。

其中最具理论色彩的,是Nested BSP——嵌套批量同步并行,一种将并行计算任务分层递归组织的计算范式。华为称其突破了传统图灵范式与冯·诺依曼单机架构的限制。翻译成人话:以前是把一万台计算机"联网"一起干活,每台都有自己的小算盘;现在是让百万颗处理器从硬件到软件真正做到"一台机器"的体验,资源共享如同本地。

据多位接近人士的判断,这类架构宣称的关键不在于单点参数,而在于统一内存寻址能否在百万卡规模下把通信开销压住。这是Peerium必须用实测数据回答的问题。

🔗 灵衢:一张开放协议,暗藏生态野心

如果说Peerium是建筑蓝图,灵衢就是承重墙。

华为介绍称,灵衢基于一个开放协议,可无限扩展地联接CPU、NPU、内存、SSD、网卡和交换机,实现计算、存储与网络的平等互联。

注意两个词:"开放"和"平等"。前者对标的是封闭的私有互联体系,后者对标的是主从架构。当存储和网络不再依附于计算节点,而是与计算平起平坐,数据的搬运逻辑、集群的拓扑设计都会被重写。

用一张图看Peerium与灵衢的关系:

开放协议在计算行业的历史上从不只是技术选择,而是生态武器。PCIe、以太网、CXL,无一不是靠开放换来了整个产业的跟随。灵衢若能吸引第三方CPU、存储与网络厂商接入,华为就能从"卖整机"升级为"定标准"——这才是Peerium真正的胜负手。

📊 从超节点到百万卡:一条清晰到近乎激进的产品线

架构不能只活在论文里,华为同步给出了落地节奏:

  • Atlas 950超节点:Peerium计算架构的首代产品,25.6万卡的Atlas 950超节点集群已在部署中;
  • Atlas 960系统:基于NPO(近封装光学),正在测试中。

从25.6万卡到百万级,中间隔着的是互联带宽、功耗密度、故障率三座大山。NPO把光引擎拉近芯片封装,正是为了砍掉电信号传输的距离损耗——这是通往百万卡规模的必经之路。

一条时间线看华为的推进节奏:

  • 9月17日 : Peerium架构于上海发布
  • 9月17日 : 灵衢开放互联同步亮相
  • 当前 : Atlas 950超节点集群部署中
  • 后续 : Atlas 960系统测试中

值得玩味的是,同一场活动中,华为轮值董事长徐直军谈鸿蒙生态时给出的判断是:突破1亿用户就如同核裂变的"临界质量"、飞机起飞的"离地速度"。这个临界点思维同样适用于Peerium——生态未过线之前,所有参数优势都只是纸面领先。

另一句来自华为AI战略口径的话值得放在旁边对照:华为AI战略的核心是算力,坚持硬件变现。也就是说,Peerium不是情怀工程,每一个超节点都要变成真金白银的收入。

⚠️ 三重拷问:好架构≠好生意

Peerium的叙事很燃,但产业分析的义务是降温。三个问题摆在面前:

其一,软件生态的鸿沟。 Nested BSP是对计算范式的改写,意味着开发者的并行编程模型也要跟着改。CUDA的护城河从来不只是硬件,而是十几年积累的开发者肌肉记忆。Peerium需要让迁移成本降到"值得"的临界点以下。

其二,开放与主导的张力。 开放协议要长成,需要盟友愿意把自家CPU、SSD、网卡接入灵衢体系。华为既当裁判又当运动员的角色,会让部分伙伴犹豫。

其三,供应链的现实约束。 百万卡规模意味着对先进制程、光互联器件、存储颗粒的海量需求。25.6万卡尚在部署,百万级的物料弹性如何保障,决定了承诺兑现的速度。

业内流传的一种私下判断是:这场架构之争的窗口期大约就在未来两三年,超节点形态正在从"可选项"变成"必选项",谁先把开放互联的雪球滚起来,谁就拿到下一轮定义权。

🎯 结语:赌的不是参数,是范式

回看这场发布,最值得记住的不是百万卡的数字,而是一个信号:算力竞争的战场,正在从单芯片制程转向系统架构。

Peerium和灵衢承载的,是华为在冯·诺依曼架构七十年历史上刻下一个中国注脚的野心。徐直军那句"让算力无处不在,让智能无所不及",前半句靠超节点兑现,后半句靠生态兑现。

接下来要看的是三件事:Atlas 950集群的实际部署效率、Atlas 960的测试表现、以及灵衢协议能拉到多少第三方伙伴上船。架构的胜负,从来不由发布会宣布,而由客户的订单和开发者的代码投票。

临界质量已摆上台面,链式反应会不会来,2026年见分晓。