DeepSeek|V4 Pro正式版(0813)离开预览上线API

PromptTree|阅读 0
2026/08/13 08:13
DeepSeekV4 ProAPI智能体Token定价
深度求索API文档将deepseek-v4-pro版本更新为DeepSeek-V4-Pro-0813,结束预览标签;支持约1M上下文与工具调用等,现行定价约0.435/0.87美元每百万输入输出Token,并提示近期将整体上调价格。

预览标签摘掉之后,开发者真正要验收的不是又一张跑分海报,而是同一条 deepseek-v4-pro 端点,能不能更稳地跑完长链路Agent。

深度求索(DeepSeek)是中国开源与API并重的大模型公司,产品线覆盖对话、推理与面向工具调用的智能体场景。所谓正式版离开预览,白话不是换个营销口号,而是生产端点上的模型版本号、能力集与计费口径进入可被采购合同引用的稳态——调用方式可以不变,但「还在Preview」的不确定性被拿掉了。

公开API文档现已把 deepseek-v4-pro 的模型版本更新为 DeepSeek-V4-Pro-0813;调用方法不变,指向同一端点即可拿到正式版构建。与之并列的是此前已转正的 deepseek-v4-flash(版本口径 DeepSeek-V4-Flash-0731)。两条线共同构成「轻量默认 + 旗舰加强」的双端点叙事:Flash吃高并发与成本敏感负载,Pro吃更难的Agent与长程任务。

可核验的能力与计费口径:

  1. 上下文与输出:Pro与Flash均支持约1M上下文长度,最大输出口径约384K。
  2. 功能:JSON结构化输出、工具调用、Responses API、Anthropic兼容接口;Chat Prefix与FIM补全仍标Beta,FIM仅非思考模式可用。
  3. 思考模式:支持非思考与思考(默认)切换,具体切换见官方Thinking Mode说明。
  4. 定价(每百万Token):Pro缓存未命中输入约0.435美元、输出约0.87美元,缓存命中输入约0.003625美元;Flash对应约0.14/0.28美元与约0.0028美元缓存命中输入。
  5. 并发:Pro约500、Flash约2500——官方仍把高吞吐默认位留给Flash。

所谓工具调用,白话就是模型按约定 schema 发起外部函数/API,而不是只生成一段自然语言建议;Responses API与Anthropic兼容接口,则是为了让既有编排框架少改胶水代码。对独立开发者与初创团队,Agent项目真正卡脖子的往往不是「会不会答题」,而是长链路里工具失败后能否自检重试、Token账单会不会先于产品市场契合度爆掉。

把这条放进2026年中的模型竞争坐标:行业比拼已从「谁先放出旗舰预览」转向「谁敢把旗舰写进稳定端点」。Flash先转正,等于先抢默认调用位;Pro正式化补的是企业采购叙事与复杂Agent天花板。文档同时写明,计划在近期整体上调API服务价格,具体方案以正式通知为准——因此「现在能按表计费」不等于「价格会长期锁死」。另有开发者反馈网页端与API在思维链文风上存在差异,属体验层观察,不构成对基准分数的独立核验。

需要把边界读清楚。第三方转述的「部分Agent基准逼近或超越某闭源旗舰」若未附可复现实验协议,只能作为产业讨论材料,不能当成已审计成绩。下一观察点是涨价通知落地后的账单曲线,以及长软件工程、工具调用失败恢复在真实业务里的完成率——正式版是入场券,稳态交付才是验收。