此前各说各话的“超节点”,终于有了统一标尺。
WAIC 2026期间,由鹏城实验室和全球计算联盟联合牵头编制的《超节点定义与实践白皮书》正式发布,这是行业内首个系统性定义超节点的权威文件。白皮书明确,跨物理节点的统一内存编址是核心架构特征,内存语义与统一内存编址、超低时延、超大带宽共同构成三大技术特征。
超节点的本质,是通过高速互联协议,将数百至上千颗AI芯片整合为一台逻辑统一的超级计算机。传统集群中,每台服务器是孤岛,GPU跨卡通信需经CPU、网卡、交换机等多道环节,带宽约25-64GB/s,时延2微秒以上,集群算力利用率往往只有40%-60%。超节点让所有卡共享同一内存池,卡与卡可直接读写对方内存,利用率可跃升到75%-85%。
为何此刻爆发: 一是万亿参数MoE模型单卡装不下,跨卡通信频率极高;二是Agent要求实时响应,对推理延迟极度敏感;三是日均Token调用从千亿级跃至百万亿级,超节点把Token生产效率翻倍,直接压降推理成本。
多强并立: 英伟达GB200 NVL72以72颗GPU加36颗CPU、130TB/s NVLink带宽成行业标杆;华为昇腾950以1024卡灵衢互联、256TB统一内存、1 EFLOPS FP8算力推进,上一代384超节点已在20多个行业落地750多套;阿里云磐久AL128采用128卡单柜、正交无缆化,面向推理优化;中兴OEX走开放解耦,兼容壁仞、沐曦、燧原等多家国产GPU,正交无背板零线缆互联可将互联成本降约80%。白皮书为产业提供标准指引,超节点正从概念验证走向规模商用。