DeepSeek自研AI推理芯片,并正式开源DSpark推理加速框架

PromptTree|阅读 1
2026/07/09 08:57
DeepSeekDSpark推理芯片昇腾
DeepSeek推进自研AI推理芯片,以减少对英伟达和华为芯片的依赖,并开源DSpark推理加速框架,单用户生成速度提升60%至85%。近期70亿美元融资中,部分资金指向芯片研发,并与外部芯片设计、晶圆代工和存储企业协同。

训练很贵,但大规模亏钱或赚钱,往往发生在推理。DeepSeek同时做了两件事:推进自研AI推理芯片,并正式开源推理加速框架DSpark。

DeepSeek是做大模型的公司,创始人兼首席执行官是梁文锋。外界更熟悉它的模型,这次公开的方向是减少对英伟达和华为芯片的依赖,从纯算法公司走向算法与芯片一起推进。

梁文锋在2023年和2024年的采访里,已经多次谈到高端芯片和算力限制。他当时的判断可以收成三点:真正的挑战不是资金,而是高端芯片的出口限制;对研究员来说,对算力的渴求没有尽头;公司会有意识地部署尽可能多的算力。自研芯片,是这几句话的后续,不是突然改口。

近期DeepSeek完成70亿美元融资,约合人民币500亿元。部分资金明确指向AI芯片研发,并与接触外部芯片设计企业、晶圆代工厂、存储企业形成协同。钱被写进了自研和供应链,而不是只写成再去买现成卡。

DSpark是正式开源的推理加速框架。公开结果是单用户生成速度提升60%至85%,高并发下有效吞吐显著提升。推理加速,白话就是同样的芯片上让模型把下一个字吐得更快,很多人同时调用时吞吐还撑得住。开源意味着这套优化不只留给自家服务。

这条线和7月8日已经出现的进展接在一起:DeepSeek V4深度融合昇腾950,Pro价格计划在下半年大幅下调。V4的细粒度专家并行,已在英伟达GPU和华为昇腾NPU上完成验证。外部开发者面对的硬件因此是三类:英伟达、昇腾,以及仍在推进的自研芯片。

自研芯片、国产超节点、推理加速框架,是同一套少依赖英伟达的推理体系里的三层。芯片决定供不供得上,超节点决定能不能堆成集群,框架决定效率能不能被社区用起来。缺一层,另外两层都更难单独成立。

专家并行可以理解成:模型里不同部分同时处理请求,而不是所有计算挤在一条路径上。V4的细粒度专家并行已经在英伟达GPU和华为昇腾NPU上验证。DSpark开源后,外部开发者可以先在这两类现有硬件上做加速,不必等自研芯片量产。60%至85%是单用户生成速度,高并发吞吐是另一项,两项都能被复现,框架才算可用。

下一步能核对的,是自研芯片有没有可公开的流片或供货进度,以及DSpark在昇腾和英伟达上的加速能否被外部复现。70亿美元里有多少进入芯片,原文只写到部分资金明确指向,不宜再往下拆。