摘要:华为全联接大会2026发布全球首个采用NPO光引擎的昇腾960超节点,单节点可扩至4096卡、提供8 EFLOPS FP8算力与1PB HBM,已部署超千套,国产超节点进入批量交付期。

9月17日至19日,华为全联接大会2026在上海举行。轮值董事长汪涛在主题演讲里公布了一个分量很重的数字:昇腾960超节点基于"灵衢+Hi-ONE"打造,采用正交架构和全液冷设计,单节点可扩展至4096卡规模,提供8 EFLOPS FP8算力和高达1PB的HBM容量。更值得记一笔的是,昇腾超节点已经部署1000多套、覆盖370多家客户,昇腾960DT还提前到2027年Q1发布、性能翻番。换句话说,这不是PPT上的路线图,而是已经在客户机房里跑着的货。

中金公司的判断很直接:2026年有望成为国产超节点放量元年,产业正从概念验证进入批量交付。这句话背后是一条清晰的路线变化——过去几年国产AI芯片被反复拿"制程落后几代"说事,华为这次给出的解法是系统工程:用全液冷把功耗压住,用NPO近封装光学把卡间互联带宽拉起来,用正交架构把万卡级扩展做成单节点的事。单点制程追不上,就用架构创新和集群工程把总算力堆出来。

01-华为昇腾960超节点国产算力系统.jpg

我倒觉得这件事的意义不在某一颗芯片,而在生态。汪涛披露,鲲鹏全球开发者超过416万,昇腾AI核心基础软件平台CANN已进入常态化开源社区运作,鲲鹏900存储方案也跟上了。对一个意图当底座的算力厂商来说,开发者数量和软件栈成熟度,比单次跑分更能决定长期胜负。昇腾960把"国产可替代"从口号变成可采购的方案,对受出口管制掣肘的国内大模型厂和智算中心,是个实在的变量。

当然也得泼点冷水。超节点解决的是"集群能堆多大、多稳",不等于单卡能效追平最先进制程;NPO光引擎的量产良率、液冷数据中心的电力和运维成本,都是交付后的真问题。但方向上,华为把"用系统能力补单点差距"这条路走通了一步,2026年作为国产算力生态转折年,这个定性大概率是成立的。