万卡之后,国产AI基建被推到了十万卡这一档。中科曙光把这件事从规划写成了已经落成的集群。
中科曙光做高端计算和算力基础设施。7月10日,在光合组织2026智能计算应用大会上,公司宣布中国首个全国产十万卡AI超集群曙光8000(登峰)正式落成,并同步接入国家超算互联网。国家超算互联网可以理解成把超算中心连成可调用的网络,而不是每一座机器房各自关门运行。
集群采用「超智融合」路线,不按传统方式把科学计算和智能计算分成两套互不往来的分区。它支持从FP64到INT8的全精度运算。FP64是科学计算常用的高精度浮点,INT8则是推理里更省的整数格式。同一套系统因此要同时覆盖科学计算、大模型训练、AI推理和工业仿真。
全链路能核对的环节:
曙光已与北京科学智能研究院达成战略合作,启动第二套全国产十万卡超智融合系统设计。目前在核心节点上完成300余项应用优化,超过70个应用实现万卡规模扩展,重点覆盖蛋白质折叠模拟、万亿原子级水分子动力学模拟、百万亿网格湍流模拟。这些都是既吃科学计算精度、又吃AI方法的负载。
十万卡的难点不在「卡的数量加总」,而在网络、存储和散热能不能让这些卡同时干活。IO500双榜第一针对的是存储别先堵住;液冷针对的是单柜功率上来之后风冷不够用。第二套系统已经启动研制,说明第一套被当成可复制的模板,而不是一次性展品。
国产算力的竞争,因此从「能不能做出卡」转向「能不能把十万卡跑稳、跑满,并且接到国家超算互联网上给应用用」。下一观察点是那70个万卡应用里,有多少从优化名单变成稳定队列,而不是再宣布一次落成。