十万张加速卡叠在一起,难的不是报出这个数字,而是全用国产部件,还让集群像一台机器一样可用。中科曙光把曙光8000的真机送进了WAIC。
中科曙光做高性能计算和人工智能基础设施。曙光8000又名“登峰”,是中国首个全国产10万卡人工智能超集群,WAIC 2026期间真机首次亮相,并入选十大镇馆之宝。它是“曙光6000”系列之后的新一代超大规模人工智能集群。整机基于国产人工智能芯片混插,点名的品牌包括华为昇腾、寒武纪、海光,再加上国产高速互联协议、国产存储和国产液冷。全栈国产的意思是:算、连、存、冷都不靠进口部件才能点亮。混插则是承认国产芯片不是单一型号,集群必须同时调度多家的卡。
规模上,10万卡在国内和全球都属于第一梯队。对照口径写在公开比较里:英伟达Hopper时代,最大单集群是Meta的24576卡;B200时代大约65536卡;Blackwell Ultra时代正在冲击10万卡量级。曙光8000的亮相,意味着国产人工智能算力已经能在规模上和英伟达最新一代图形处理器集群放在同一量级讨论。从“能用”到“敢用”再到“好用”,原文把这三步分开:规模对照解决“敢不敢摆到同一张表”,软件和稳定性才解决“好不好用”。真机亮相完成的是前一步。
存储同时给出了排名。曙光8000的ParaStor存储系统在IO500两项世界排名第一,并与7月20日国家超算互联网核心节点的信息同步披露。IO500衡量的是存储系统处理大规模输入输出的能力。训练集群如果只把卡堆够、存储跟不上,模型会把时间耗在等数据上。液冷则是万卡机房的散热路径,功耗上去之后,风冷很难把热量带出机柜。
中科曙光把算力、存储和互联放进同一套方案。还没有在这条消息里公布的,是这10万卡里各品牌芯片的配比、已点亮的比例和对外售价。能确认的是:全国产超集群已经有真机,存储有两项世界排名,规模对照也有明确的卡数可以核对。
10万卡要和Meta的24576卡、B200时代约65536卡放在一起看,比的是规模量级,不是已经跑赢同一项训练。ParaStor在IO500拿到两项世界第一,补的是存储。混插昇腾、寒武纪和海光,说明调度必须面对多家芯片。液冷和国产互联,则是万卡机房要同时解决的散热和通信。真机亮相完成的是敢摆上桌,点亮比例原文没有给。