预览标签摘掉之后,开发者真正要验收的不是又一张跑分海报,而是同一条 deepseek-v4-pro 端点,能不能更稳地跑完长链路Agent。
深度求索(DeepSeek)是中国开源与API并重的大模型公司,产品线覆盖对话、推理与面向工具调用的智能体场景。所谓正式版离开预览,白话不是换个营销口号,而是生产端点上的模型版本号、能力集与计费口径进入可被采购合同引用的稳态——调用方式可以不变,但「还在Preview」的不确定性被拿掉了。
公开API文档现已把 deepseek-v4-pro 的模型版本更新为 DeepSeek-V4-Pro-0813;调用方法不变,指向同一端点即可拿到正式版构建。与之并列的是此前已转正的 deepseek-v4-flash(版本口径 DeepSeek-V4-Flash-0731)。两条线共同构成「轻量默认 + 旗舰加强」的双端点叙事:Flash吃高并发与成本敏感负载,Pro吃更难的Agent与长程任务。
可核验的能力与计费口径:
所谓工具调用,白话就是模型按约定 schema 发起外部函数/API,而不是只生成一段自然语言建议;Responses API与Anthropic兼容接口,则是为了让既有编排框架少改胶水代码。对独立开发者与初创团队,Agent项目真正卡脖子的往往不是「会不会答题」,而是长链路里工具失败后能否自检重试、Token账单会不会先于产品市场契合度爆掉。
把这条放进2026年中的模型竞争坐标:行业比拼已从「谁先放出旗舰预览」转向「谁敢把旗舰写进稳定端点」。Flash先转正,等于先抢默认调用位;Pro正式化补的是企业采购叙事与复杂Agent天花板。文档同时写明,计划在近期整体上调API服务价格,具体方案以正式通知为准——因此「现在能按表计费」不等于「价格会长期锁死」。另有开发者反馈网页端与API在思维链文风上存在差异,属体验层观察,不构成对基准分数的独立核验。
需要把边界读清楚。第三方转述的「部分Agent基准逼近或超越某闭源旗舰」若未附可复现实验协议,只能作为产业讨论材料,不能当成已审计成绩。下一观察点是涨价通知落地后的账单曲线,以及长软件工程、工具调用失败恢复在真实业务里的完成率——正式版是入场券,稳态交付才是验收。