开源和上市叙事还没凉,马斯克把「可能超越Kimi」说了出来。月之暗面选择当众接,而不是不回应。
月之暗面做Kimi。7月16日它发布Kimi K3:2.8万亿参数,100万token上下文,自研KDA算法,896个专家里每次激活16个。专家是混合专家模型里的子网络,激活16个的意思是每次推理只用其中一部分,用来省计算。马斯克在评测下留言「令人印象深刻」。7月18日他在X上说,xAI正在训练2万亿参数的Grok 4.6,计划一周内完成首轮完整训练,相对1.5万亿参数的Grok 4.5是升级,「可能超越Kimi」。
7月21日,月之暗面相关负责人公开回应:「我们拭目以待,欢迎大家一起掰一掰手腕。他有信心,我们有更强的信心。」公司另有一句更短的公开回应:「欢迎加入2万亿+俱乐部。」2万亿是参数规模的门槛,不是收入。Kimi K3本身是2.8万亿,所以这句是把对方的2万亿放进自己已经站着的区间,而不是承认已经被超过。
定价: 输入在缓存未命中时20元/百万tokens,缓存命中时2元/百万tokens,输出100元/百万tokens。输出价明显高于DeepSeek V4-Pro、小米MiMo V2、智谱GLM-5.2和Qwen3.7-Max。缓存命中便宜,说明重复上下文被设计成可复用;输出贵,说明生成这一侧仍是主要成本。发布约48小时后,公司暂停面向新个人用户的订阅,服务器负载接近上限。暂停的是新订阅,不是已有用户的服务。
资本: 市场消息称公司已启动港股上市筹备,投前估值315亿美元。此前它已向投资者寻求支持,目标是最快6个月内完成上市,并与高盛、中金讨论安排;2025年底投后估值还在43亿美元,2026年5月融资后突破200亿美元,6月30日新一轮投前升至315亿美元。年度经常性收入从4月约2亿美元增至6月约3亿美元。有机构把这一幕称作「另一个DeepSeek时刻」,意思是中国模型第一次以竞争威胁的身份进入全球叙事,而不是只在国内榜上比较。
参数俱乐部、输出定价和上市估值是三本不同的账。马斯克说的是训练规模和「可能超越」;月之暗面亮出的是已经开源的2.8万亿、更高的输出价,以及负载到顶。谁的下一版更强,这周没有评测分。能核对的是:回应已经公开,新订阅已经暂停,315亿美元的投前估值还在上市筹备的说法里。