DeepSeek V4 Pro正式版上线:1M超大上下文+384K输出,价格比Flash贵三倍

潮新闻 张云山

8月13日,DeepSeek官方把V4 Pro从预览版正式转正了。官方定价页上,模型版本号已经更新为DeepSeek-V4-Pro-0813。

DeepSeek-V4-Pro-0813为版本型号(网站截图)

这次转正并非临时起意。4月底,官方API刚支持V4-Pro和V4-Flash的时候,就在更新日志里预告过,V4-Pro的正式发布会随后跟上。如今,它正式来了。

1M上下文+384K输出,长文档处理更从容

DeepSeek V4 Pro正式版的核心参数相当能打:上下文长度达到1M,最大输出384K Token,支持thinking模式和非thinking模式,默认开启thinking模式。同时支持JSON输出、工具调用、Responses API,兼容Anthropic API格式,并发限制为500。

1M上下文在国产模型里属于头部水平。配合384K输出,处理长文档、长代码仓库这类任务比上一代从容得多。对于长代码库、大规模文档处理以及需要连续执行大量步骤的Agent任务来说,这意味着一次调用能够容纳和生成的内容规模都相当可观。

配套能力也基本覆盖了目前主流的Agent开发需求,支持JSON Output、Tool Calls、Responses API、Anthropic API,同时支持Beta阶段的对话前缀续写与FIM补全,其中FIM补全仅限非思考模式使用。

价格比Flash贵三倍,并发限制更严格

DeepSeek V4 Pro是走量的高端档,价格明显高于V4-Flash。按每1M token计算,缓存命中输入0.025元,缓存未命中输入3元,输出6元。相比之下,V4-Flash分别为0.02元、1元和2元。输出token从2元涨到6元,正好是三倍。输入未命中从1元涨到3元,也是三倍。

价格表(网站截图)

两者的并发限制也有所区别:V4-Flash的并发限制为2500,V4-Pro则为500。从价格和并发配置来看,Flash更明显地面向高频、大规模调用场景,而Pro则把资源进一步集中到规格更高的任务上。需要提醒的是,DeepSeek官方从来没有把V4-Pro标成免费。V4-Flash 7月31日进入public beta,一直按token计费。V4 Pro同样按量收费。

官方预告整体涨价,涨幅较大

这次定价页上,官方在价格表下方挂了一条重要注释:“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用,具体方案以正式通知为准。”

这条信息比V4 Pro转正本身更值得关注。换句话说,这也是官方给用户打“预防针”。

打算长期使用DeepSeek API的,尤其是重度调用方,可能需要趁当前价格囤一点额度,或者提前评估涨价后的成本。不过具体涨多少、什么时候涨,官方还没给出正式方案,需要等后续通知。

调用方式没有变化。base_url不变,把model参数改成deepseek-v4-pro就行。走OpenAI兼容接口,或者在官方文档提到的Anthropic接口(api.deepseek.com/anthropic)里设置成对应模型名,两种都能用。旧的两个模型名deepseek-chat和deepseek-reasoner,在7月24日已经停用,现在分别指向V4-Flash的非thinking和thinking模式,用API的老用户需要注意。

Flash够用就别急着上Pro

对大多数日常任务,DeepSeek V4 Flash的0731版本已经够用。官方那批agent能力数据(Terminal Bench 82.7、Cybergym 76.7等),标的是V4-Flash 0731相比V4-Pro-Preview的提升,并非V4-Pro正式版的数据,这一点需要看清。

如果只做聊天、轻量编程、日常问答,Flash的性价比明显更高。需要处理超长上下文、复杂Agent任务,或者对输出质量有更高要求,才值得为Pro的三倍价格买单。

随着DeepSeek-V4-Pro-0813正式上线,V4系列的产品结构也进一步清晰起来:Flash主打更低成本和更高并发,Pro则提供更高规格的模型服务,并围绕Tool Calls、Responses API、Anthropic API等能力继续向Agent和Coding场景延伸。

“转载请注明出处”

责任编辑:祝瑶