中科曙光"曙光8000(登峰)"正式落成,国产AI基础设施迈入十万卡时代

PromptTree|阅读 0
2026/07/14 10:26
中科曙光十万卡超算国产算力液冷
7月10日中科曙光宣布全国产十万卡AI超集群曙光8000(登峰)落成并接入国家超算互联网。集群走超智融合路线,芯片到服务七环节全自研,已完成300余项应用优化,并启动第二套系统设计。

万卡之后,国产AI基建被推到了十万卡这一档。中科曙光把这件事从规划写成了已经落成的集群。

中科曙光做高端计算和算力基础设施。7月10日,在光合组织2026智能计算应用大会上,公司宣布中国首个全国产十万卡AI超集群曙光8000(登峰)正式落成,并同步接入国家超算互联网。国家超算互联网可以理解成把超算中心连成可调用的网络,而不是每一座机器房各自关门运行。

集群采用「超智融合」路线,不按传统方式把科学计算和智能计算分成两套互不往来的分区。它支持从FP64到INT8的全精度运算。FP64是科学计算常用的高精度浮点,INT8则是推理里更省的整数格式。同一套系统因此要同时覆盖科学计算、大模型训练、AI推理和工业仿真。

全链路能核对的环节:

  1. 芯片、计算、存储、网络、散热、应用、服务七个环节全自研
  2. 海光等国产芯片做底层
  3. scaleFabric类IB原生RDMA高速网络负责十万卡连接。RDMA白话是网卡直接搬数据,少绕一层CPU
  4. ParaStor分布式存储在2026全球IO500中拿下生产型全节点和10节点性能双榜第一
  5. 浸没式相变液冷支撑单机柜兆瓦级高功率密度。机器泡在冷却液里,液体变气体时把热带走

曙光已与北京科学智能研究院达成战略合作,启动第二套全国产十万卡超智融合系统设计。目前在核心节点上完成300余项应用优化,超过70个应用实现万卡规模扩展,重点覆盖蛋白质折叠模拟、万亿原子级水分子动力学模拟、百万亿网格湍流模拟。这些都是既吃科学计算精度、又吃AI方法的负载。

十万卡的难点不在「卡的数量加总」,而在网络、存储和散热能不能让这些卡同时干活。IO500双榜第一针对的是存储别先堵住;液冷针对的是单柜功率上来之后风冷不够用。第二套系统已经启动研制,说明第一套被当成可复制的模板,而不是一次性展品。

国产算力的竞争,因此从「能不能做出卡」转向「能不能把十万卡跑稳、跑满,并且接到国家超算互联网上给应用用」。下一观察点是那70个万卡应用里,有多少从优化名单变成稳定队列,而不是再宣布一次落成。