O DeepSeek V4 Pro entrou em uma etapa de API mais concreta. Em 13 de agosto, a página de preços da DeepSeek passou a listar deepseek-v4-pro como DeepSeek-V4-Pro-0813, mantendo os formatos compatíveis com OpenAI e Anthropic.
A mesma tabela reúne contexto de 1M tokens, saída máxima de 384K tokens, JSON Output, Tool Calls, Responses API e Anthropic API. O limite de concorrência do Pro é 500, contra 2500 no Flash.
Saída longa também pesa na fatura
“We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.”
O aviso oficial muda a leitura do lançamento. A saída de 384K pode ajudar em análise de repositórios grandes, revisão documental, planos de migração e fluxos com agentes, mas amplia a cobrança na fase de geração.
Pro custa três vezes o Flash
Na tabela chinesa, o V4 Pro custa RMB 0,025 por 1M tokens de entrada com cache, RMB 3 em entrada sem cache e RMB 6 em saída. O V4 Flash custa RMB 0,02, RMB 1 e RMB 2. Em entrada sem cache e saída, o Pro sai três vezes mais caro.
Hugging Face e OpenRouter descrevem o V4 Pro como um MoE de 1,6T parâmetros totais, 49B ativos e contexto de 1M tokens. É um tier pesado, mais indicado para tarefas longas e difíceis do que para uso rotineiro.
Os próximos testes são claros: relatório separado do V4 Pro-0813, benchmarks independentes que o separem do Preview e do Flash 0731, e o impacto da alta de preços na vantagem de custo em contexto longo.
Fontes: documentação de modelos e preços da DeepSeek API, changelog da DeepSeek API, Chao News, cartão de modelo Hugging Face DeepSeek-V4-Pro, CocoLoop, OpenRouter; verificados versão DeepSeek-V4-Pro-0813, contexto de 1M, saída máxima de 384K, escopos de preço em RMB e USD, limites de concorrência, preços comparativos do V4 Flash, 1,6T parâmetros totais e 49B ativos.