8月13日,DeepSeek官方将V4 Pro从预览版正式转正。模型版本号已更新为DeepSeek-V4-Pro-0813。
这次转正早有预告。4月底,官方API支持V4-Pro和V4-Flash时,就曾在更新日志中提到V4-Pro的正式发布会随后跟上。如今,它终于来了。
DeepSeek V4 Pro正式版的核心参数十分强大:上下文长度达到1M,最大输出384K Token,支持thinking模式和非thinking模式,默认开启thinking模式。同时支持JSON输出、工具调用、Responses API,兼容Anthropic API格式,并发限制为500。
1M上下文在国产模型中处于领先水平,配合384K输出,处理长文档、长代码仓库等任务比上一代更加从容。对于长代码库、大规模文档处理以及需要连续执行大量步骤的Agent任务来说,这意味着一次调用能够容纳和生成的内容规模都相当可观。此外,配套能力也基本覆盖了目前主流的Agent开发需求,包括JSON Output、Tool Calls、Responses API、Anthropic API,还支持Beta阶段的对话前缀续写与FIM补全,其中FIM补全仅限非思考模式使用。
定价页上,官方挂了一条重要注释:“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用,具体方案以正式通知为准。”这条信息比V4 Pro转正本身更值得关注。打算长期使用DeepSeek API的用户,尤其是重度调用方,可能需要趁当前价格囤一点额度,或者提前评估涨价后的成本。不过具体涨多少、什么时候涨,官方尚未给出正式方案,需等待后续通知。
调用方式没有变化。base_url不变,只需将model参数改成deepseek-v4-pro即可。走OpenAI兼容接口,或者在官方文档提到的Anthropic接口(api.deepseek.com/anthropic)里设置成对应模型名,两种方法都可以使用。旧的两个模型名deepseek-chat和deepseek-reasoner,在7月24日已经停用,现在分别指向V4-Flash的非thinking和thinking模式,API的老用户需要注意。
对大多数日常任务,DeepSeek V4 Flash的0731版本已经够用。官方公布的agent能力数据(Terminal Bench 82.7、Cybergym 76.7等),标的是V4-Flash 0731相比V4-Pro-Preview的提升,并非V4-Pro正式版的数据。如果只做聊天、轻量编程、日常问答,Flash的性价比更高。需要处理超长上下文、复杂Agent任务,或者对输出质量有更高要求,才值得为Pro的三倍价格买单。
随着DeepSeek-V4-Pro-0813正式上线,V4系列的产品结构进一步清晰:Flash主打低成本和高并发,Pro则提供更高规格的模型服务,并围绕Tool Calls、Responses API、Anthropic API等能力继续向Agent和Coding场景延伸。
DeepSeek V4 Pro 正式版已更新至API,调用模型名保持不变。新版本增强了Agent能力,支持Responses API和Codex接入
2026-08-13 09:46:13DeepSeekV4Pro正式版8月12日深夜,全球AI圈迎来了一场罕见的“同日对垒”。DeepSeek与Grok几乎在同一时间各自推出了新一代旗舰模型,这两款产品都主打高性价比路线,专注于智能体与长任务场景
2026-08-13 14:45:13DeepSeekV4Pro和Grok48月6日,DeepSeek在开放平台发布公告,计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,具体方案以正式通知为准。公告没有给出新的价目表,但措辞表明这将是一次整体上调
2026-08-13 20:21:01DeepSeek官宣涨价DeepSeek全系列API服务从即日起降价,输入缓存命中的价格降至原有价格的十分之一。此外,Pro模型在2026年5月5日前还有额外的2.5折限时优惠
2026-04-26 23:13:12DeepSeek输入缓存降价