2026年国产算力最火的是超节点:AI转向推理后,用户关注点从“有多少卡”变成“每秒稳定产出多少有效Token、成本多少”,超节点把高速互连域从8卡扩展到上百卡,让卡间通信接近内存访问的低延迟。
需求由模型和应用双重倒逼:MoE架构使前沿模型参数破万亿,每生成一个Token触发上百次跨卡通信,Agent又让单次请求多轮调用、Token消耗激增;英伟达NVL72实验显示同代GPU下单卡吞吐最高达B200的4.4倍,提升来自互连域与系统架构对通信开销的压缩。
但落地极难,行业用“四堵墙”概括瓶颈——通信、功耗与散热、存储、复杂度,考验计算、互连、供电、散热、存储、软件的系统级整合,前期仅芯片架构设计投入就可能超亿元,液冷已成标配。
更棘手的是生态与标准化:各家互连协议和软件栈互不兼容,迁移适配成本高,浪潮、曙光、联想分别以开放架构、分层解耦、通用加定制破局,业内共识是规模是手段而非目的,要优化的是一定规模约束下的系统效率。
