模型一换挡,最先慌的往往不是榜单,而是已经写进运维手册的模型名、缓存策略和账单脚本。9月11日,DeepSeek宣布:为响应用户需求,决定在2026年9月14日之后继续提供DeepSeek V4 Pro的API调用服务,计费方式保持不变;如有变动将另行通知。这等于把前两天刚铺开的「Pro即将被Flash接走」路线图,又拨回双轨并存。
DeepSeek是国内开源与API双线推进的大模型团队,近窗刚发布新架构家族中的最小型号V4.1-Flash,强调原生多模态、KV缓存压缩与更低价。Flash上线时,公司曾称多方测试显示新模型在性能、成本、速度与总运行时间上优于V4-Pro,并计划在V4.1-Pro到来前,将deepseek-v4-pro请求按Flash费率路由至新模型;随后又把下线节点推迟到北京时间9月14日12:00。用户侧反馈与兼容顾虑迅速抬头后,官方改口续服。
时间线与政策要点:
所谓继续提供,白话是先把「强制搬家」改回「自愿迁移」;所谓计费不变,白话是Pro账单短期内不再被Flash价表覆盖。对已经按Flash做容量规划的团队,要重新评估双轨选型;对重度依赖Pro推理强度与旧兼容路径的业务,则少了一场突袭式切流。公开价格表仍保留百万tokens输入/输出的分档:例如Flash缓存命中空闲时段约0.02元、高峰约0.04元,Pro对应约0.15元与约0.30元;未命中与输出档差距更大——续服意味着「贵但熟悉」的那一档仍买得到。
放在Agent成本竞赛上下文里,行业一边用Flash证明「更小激活也能跑生产」,一边又发现企业工作流对旗舰档位的黏性被低估了。DeepSeek此轮纠偏,本质上是承认迁移窗口不能只按发布会节奏设计,还要按客户账单与评测基线设计。竞品若只宣布替代、不给并行期与回滚说明,同样会在企业侧撞墙。
产业影响上,若官方文档迅速同步「Pro仍可用」的路由说明,短期摩擦会下降;若后续又以静默方式收窄Pro配额,市场会更敏感。需要把边界读清楚:续服不等于Pro永不退役;V4.1-Pro上线后双轨如何定价仍未知。下一观察点是文档与控制台是否明确双轨状态,以及企业侧是否出现「Pro回流」账单曲线。