8月13日,DeepSeek官方将V4 Pro从预览版转为正式版。模型版本号已更新为DeepSeek-V4-Pro-0813。

这次转正并非临时决定。4月底,官方API支持V4-Pro和V4-Flash时,已在更新日志中预告过V4-Pro的正式发布。如今,它如期而至。

DeepSeek V4 Pro正式版的核心参数非常强大:上下文长度达到1M,最大输出384K Token,支持thinking模式和非thinking模式,默认开启thinking模式。同时支持JSON输出、工具调用、Responses API,兼容Anthropic API格式,并发限制为500。1M上下文在国产模型中属于顶尖水平,配合384K输出,处理长文档和长代码库等任务比上一代更加从容。对于长代码库、大规模文档处理以及需要连续执行大量步骤的Agent任务来说,这意味着一次调用能够容纳和生成的内容规模相当可观。配套能力也基本覆盖了目前主流的Agent开发需求,支持JSON Output、Tool Calls、Responses API、Anthropic API,同时支持Beta阶段的对话前缀续写与FIM补全,其中FIM补全仅限非思考模式使用。

定价页上,官方挂了一条重要注释:“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用,具体方案以正式通知为准。”这条信息比V4 Pro转正本身更值得关注。打算长期使用DeepSeek API的用户,尤其是重度调用方,可能需要趁当前价格囤一点额度,或者提前评估涨价后的成本。不过具体涨多少、什么时候涨,官方尚未给出正式方案,需等待后续通知。
调用方式没有变化。base_url不变,只需将model参数改为deepseek-v4-pro即可。走OpenAI兼容接口,或者在官方文档提到的Anthropic接口(api.deepseek.com/anthropic)里设置成对应模型名,两种都能用。旧的两个模型名deepseek-chat和deepseek-reasoner,在7月24日已经停用,现在分别指向V4-Flash的非thinking和thinking模式,API的老用户需要注意这一点。
对大多数日常任务,DeepSeek V4 Flash的0731版本已经够用。官方公布的agent能力数据(如Terminal Bench 82.7、Cybergym 76.7等),标的是V4-Flash 0731相比V4-Pro-Preview的提升,并非V4-Pro正式版的数据。如果只做聊天、轻量编程、日常问答,Flash的性价比更高。需要处理超长上下文、复杂Agent任务,或者对输出质量有更高要求,才值得为Pro的三倍价格买单。
随着DeepSeek-V4-Pro-0813正式上线,V4系列的产品结构也进一步清晰起来:Flash主打更低成本和更高并发,Pro则提供更高规格的模型服务,并围绕Tool Calls、Responses API、Anthropic API等能力继续向Agent和Coding场景延伸。