正式版发布与模型版本号确定
上线时间
8月13日,DeepSeek官方把V4Pro从预览版正式转正,模型版本号更新为DeepSeek-V4-Pro-0813。其实早在4月底,官方API支持V4-Pro和V4-Flash时,就已在更新日志中预告过V4-Pro的正式发布,如今如期而至。
调用方式
开发者直接使用“deepseek-v4-pro”模型名即可调用最新版本,无需额外迁移。走OpenAI兼容接口,或者在官方文档提到的Anthropic接口(api.deepseek.com/anthropic)里设置成对应模型名,两种方式都可行。不过需要注意的是,旧的两个模型名deepseek-chat和deepseek-reasoner,在7月24日已经停用,现在分别指向V4-Flash的非thinking和thinking模式,API的老用户需留意这一点。
核心能力亮点
强大的上下文与输出能力
DeepSeekV4Pro正式版核心参数十分强大,上下文长度达到1M,最大输出384KToken。这一特性使其在处理长文档和长代码库等任务时比上一代更加从容,一次调用能够容纳和生成的内容规模相当可观,对于相关任务的处理优势明显。

支持双模式推理
该版本支持thinking模式和非thinking模式,默认开启thinking模式。在一些评测中表现出色,如在DeepSWE等评测中表现接近ClaudeOpus4.6及Fable5,其Agent能力大幅增强,多项基准测试相比预览版大幅提升,在部分项目上超越竞品、站上开源模型首位。
定价与配置情况
价格体系
V4Pro价格明显高于V4-Flash。按每1Mtoken计算,缓存命中输入0.025元,缓存未命中输入3元,输出6元;而V4-Flash分别为0.02元、1元和2元。输出token从2元涨到6元,输入未命中从1元涨到3元,均为三倍。从价格体系来看,V4Pro更侧重于规格更高的任务。
并发限制
V4-Flash的并发限制为2500,V4-Pro则为500。这表明V4-Pro把资源进一步集中到重度推理等规格更高的任务上,而V4-Flash更明显地面向高频、大规模调用场景。官方还在定价页预告近期将整体上调DeepSeekAPI服务的定价,预计涨幅较大,具体方案以正式通知为准。

相关问答
DeepSeekV4Pro正式版何时上线?
8月13日,DeepSeek官方将V4Pro从预览版转为正式版,模型版本号更新为DeepSeek-V4-Pro-0813。
V4Pro正式版的核心参数有哪些?
其上下文长度达到1M,最大输出384KToken,支持thinking模式和非thinking模式,默认开启thinking模式,还支持JSON输出、工具调用等。
V4Pro正式版的价格相比V4-Flash如何?
V002元、1元和2元。
V4Pro正式版的并发限制是多少?
V4-Pro并发限制为500,低于V4-Flash版的2500,主打重度推理场景。
官方对API服务定价有何调整?
官方预告近期将整体上调DeepSeekAPI服务的定价,预计涨幅较大,具体方案以正式通知为准。
V4Pro正式版在处理任务上有什么优势?
凭借1M上下文和384K最大输出,在处理长代码库、大规模文档处理以及需要连续执行大量步骤的Agent任务时,一次调用能容纳和生成的内容规模可观。
简短标题:DeepSeekV4Pro正式版上线,有哪些新特性和价格变化?
转载声明:欢迎分享本文,转载请保留出处!发布者 财云量化
