DeepSeek V4 Pro 正式版这次先出现在 API 文档里。
8 月 13 日凌晨,DeepSeek API 文档的模型价格页已经把 deepseek-v4-pro 对应版本写成 DeepSeek-V4-Pro-0813。同一张表里,V4 Pro 与 V4 Flash 并列,基础 URL 不变,OpenAI 格式与 Anthropic 格式都能接入。潮新闻随后报道,DeepSeek 官方把 V4 Pro 从预览版“转正”,开发者已经可以按新版本调用。
这件事的抓手不在“又发了一个模型”。4 月的 V4 Preview 已经把 1.6T 总参数、49B 激活参数和 100 万 token 上下文摆出来。今天的新节点更具体:API 服务形态、输出长度、并发限制和价格差距一起落到文档里,并且官方在价格表下方给了一个很直接的成本提醒。
“计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。”
这句话把发布会式热闹拉回了账单。
384K 输出,把长任务推到台前
官方文档列出的核心参数有几组:V4 Pro 与 V4 Flash 都支持 100 万 token 上下文,最大输出长度为 384K;二者都支持 JSON Output、Tool Calls、Responses API 和 Anthropic API;对话前缀续写与 FIM 补全仍在 Beta,FIM 只限非思考模式。
对普通聊天产品来说,384K 输出并不常用。它更像是为长代码库分析、批量文档处理、长程 Agent 和研究型任务准备的天花板。一次调用能读进 1M token,又能吐出几十万 token,意味着模型不只回答一个问题,还可以连续生成迁移计划、代码修改说明、审计报告或多文件重构方案。
但这个上限也会放大成本。长上下文模型最容易被误用:看起来“能塞进去”,就把仓库、日志、合同和历史记录全塞进去。调用成功不等于成本可控,尤其在输出长度被放大后,账单往往出现在结果生成阶段。
Pro 比 Flash 贵三倍,也少五分之四并发
价格表把 V4 Pro 和 V4 Flash 的定位切得很清楚。按每 100 万 tokens 计算,V4 Pro 缓存命中输入 0.025 元,缓存未命中输入 3 元,输出 6 元;V4 Flash 分别是 0.02 元、1 元和 2 元。
换成开发者更容易记住的说法:V4 Pro 的未命中输入和输出单价都是 Flash 的 3 倍,缓存命中价只高 25%。并发限制也不同,V4 Pro 是 500,V4 Flash 是 2500。潮新闻对这组差异的解读很实在:Flash 更像高频、大规模调用档,Pro 把资源集中给规格更高的任务。
两档模型适合分工使用。Flash 0731 在 7 月底的更新日志里已经拿到一批 Agent 能力数据:Terminal Bench 2.1 为 82.7,NL2Repo 为 54.2,Cybergym 为 76.7,DeepSWE 为 54.4。官方还特别注明,那次更新只升级 V4 Flash,V4 Pro API 和 App/Web 模型当时未变。
现在 V4 Pro-0813 出现在价格页,说明产品线进入新阶段,但并不自动证明它在每个 Agent benchmark 上都超过 Flash 0731。开发团队如果只看“Pro”这个名字,很容易为日常任务付出三倍输出价格。
1.6T 参数也要看账单
DeepSeek 在 Hugging Face 的 V4 Pro 模型卡仍给出底层规模:V4 Pro 是 1.6T 总参数、49B 激活参数的 MoE 模型,支持 100 万 token 上下文;V4 Flash 是 284B 总参数、13B 激活参数。OpenRouter 的模型页也用同一组口径描述 V4 Pro,并标出每 100 万 token 0.435 美元输入、0.87 美元输出的美元价格。
这些数字说明了 Pro 档的来历:轻量模型加高级名字撑不起这档服务,底层是一档更大的稀疏模型。问题也随之出现。更大的模型、更长的上下文、更大的输出窗口,会把企业最先碰到的三件事推到前面:延迟、吞吐和预算。
如果任务是客服摘要、简单代码补全、日常问答或短文档抽取,Flash 的价格和并发限制更合适。V4 Pro 的使用场景应当更窄:超长仓库理解、跨文档推理、复杂工具调用、需要更强推理稳定性的 Agent 流程,以及可以接受更高单次成本的离线分析。
涨价预告才是开发者要看的第二行
DeepSeek 的文档没有给出涨价日期和涨幅,只写“预计涨幅较大”。这让 V4 Pro-0813 的发布时间带了另一个含义:当前价目表可能是一个过渡窗口。
对中国开发团队来说,DeepSeek 的吸引力一直不只在模型能力,也在人民币计价、国内网络可达、OpenAI/Anthropic 兼容接口和低成本长上下文。价格如果明显上调,很多已经把 DeepSeek 接进内部工具链的团队要重新算四笔账:
- 高频任务继续用 Flash,还是拆到更小模型;
- Pro 是否只保留给长上下文和复杂 Agent;
- 缓存命中能否通过固定上下文、分层提示和批处理提高;
- 预算告警、调用审计和模型路由是否要提前上线。
这里的增量判断很简单:V4 Pro 转正让 DeepSeek 的高端 API 档更完整,涨价预告则提醒用户,低价窗口不会永远替工程决策兜底。
短期可验证的节点也很清楚。第一,看 DeepSeek 是否补一篇独立更新日志或模型报告,给出 V4 Pro-0813 相比 Preview 的训练后变化。第二,看第三方榜单能否区分 V4 Pro-0813、V4 Pro Preview 和 V4 Flash 0731,不再混用旧分数。第三,看涨价方案落地后,DeepSeek 还能不能保住“长上下文高性价比”的开发者心智。
DeepSeek 没有把这次转正包装成大事件,但价格页已经足够说明问题:高端模型进入可调用状态,成本纪律也同时上桌。
参考来源:DeepSeek API 模型与价格文档、DeepSeek API 更新日志、潮新闻、Hugging Face DeepSeek-V4-Pro 模型卡、CocoLoop、OpenRouter;核验 DeepSeek-V4-Pro-0813 版本号、1M 上下文、384K 最大输出、人民币与美元计费口径、并发限制、V4 Flash 对照价格、1.6T 总参数与 49B 激活参数。