DeepSeek V4 Pro pasó a una fase de API más concreta. El 13 de agosto, la página de precios de DeepSeek mostraba deepseek-v4-pro como DeepSeek-V4-Pro-0813, con los formatos compatibles con OpenAI y Anthropic sin cambios.
La misma tabla reúne contexto de 1M tokens, salida máxima de 384K tokens, JSON Output, Tool Calls, Responses API y Anthropic API. El límite de concurrencia de Pro es 500, frente a 2500 en Flash.
La salida larga también se factura
“We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.”
Ese aviso oficial convierte la actualización en una decisión de costes. Una salida de 384K sirve para analizar repositorios grandes, revisar documentos, preparar migraciones y ejecutar agentes de larga duración, pero aumenta el gasto en generación.
Pro cuesta tres veces Flash
Según la tabla china, V4 Pro cuesta 0,025 yuanes por 1M tokens de entrada con caché, 3 yuanes por entrada sin caché y 6 yuanes por salida. V4 Flash cuesta 0,02, 1 y 2 yuanes. En entrada sin caché y salida, Pro triplica a Flash.
Hugging Face y OpenRouter describen V4 Pro como un MoE de 1,6T parámetros totales, 49B activos y contexto de 1M tokens. Es un servicio de gama alta, no una opción por defecto para tareas breves.
Los próximos puntos de verificación son un informe específico de V4 Pro-0813, benchmarks externos que lo separen de Preview y Flash 0731, y el efecto de la subida de precios sobre la ventaja en contexto largo.
Fuentes: documentación de modelos y precios de DeepSeek API, registro de cambios de DeepSeek API, Chao News, ficha de modelo Hugging Face DeepSeek-V4-Pro, CocoLoop, OpenRouter; verificados versión DeepSeek-V4-Pro-0813, contexto de 1M, salida máxima de 384K, precios en RMB y USD, límites de concurrencia, precios comparados de V4 Flash, 1,6T parámetros totales y 49B activos.