La vista previa del V4-Pro se lanzó en la madrugada del viernes de la semana pasada.
Esta mañana, DeepSeek publicó un aviso en el panel de API: 75% de descuento en V4-Pro, válido directamente hasta el 5 de mayo. Al mismo tiempo, el precio de acierto de caché de entrada de toda la API se redujo a una décima parte del precio original.
Desde el lanzamiento hasta el drástico recorte de precios, pasaron menos de 72 horas.
Poniendo los números sobre la mesa
Precios originales de DeepSeek-V4-Pro:
| Ítem | Precio original (por 1 millón de tokens) |
|---|---|
| Entrada | $0,145 |
| Salida | $3,48 |
| Acierto de caché | 0,025 yuanes/millón de tokens (ya es precio reducido, 1/10 del original) |
Durante el período promocional, el precio de entrada del V4-Pro se redujo directamente a aproximadamente $0,036/millón de tokens, más barato que cualquier otro – este precio es tan bajo que muchos sospechan que está operando con pérdidas para aumentar la base de usuarios.
Comparación horizontal con los precios actuales de los modelos insignia cerrados:
- GPT-5.5: Versión estándar $1,5/millón entrada, $10/millón salida
- Gemini 3.1 Pro: Aproximadamente $1,25/millón entrada, $10/millón salida
- Claude Opus 4.7: $15/millón entrada, $75/millón salida
Es decir, el precio original del V4-Pro ya había reducido el GPT-5.5 a menos de una décima parte y el Claude Opus 4.7 a menos de una centésima parte. Con un 75% de descuento adicional, la brecha sigue ampliándose.
El verdadero daño está en el golpe del caché
Si solo miramos el precio unitario del token del V4-Pro, ya es barato. Pero el golpe más fuerte es que DeepSeek redujo el precio de acierto de caché de entrada de toda la línea de productos API a una décima parte del precio original.
¿Para qué sirve el precio de acierto de caché?
- Aplicaciones tipo agente que ejecutan repetidamente el mismo system prompt – grandes bloques de contenido se repiten
- En escenarios RAG, a menudo se alimenta el mismo contexto al modelo
- En diálogos de múltiples rondas, los mensajes históricos se reenvían
En estos escenarios, el precio de acierto de caché es el costo real principal que pagan las empresas. Reducirlo un 90% significa – la barrera de costo para que los desarrolladores migren de GPT y Claude a DeepSeek queda casi nivelada.
¿Por qué actuar en este momento?
Después del lanzamiento de la vista previa del V4-Pro en la madrugada del viernes (24 de abril), la reacción del mercado fue algo sutil. El titular de Bloomberg ese día fue "El tan esperado nuevo modelo de DeepSeek no logra reducir la ventaja de EE. UU. en IA" – "no logró acortar la brecha con EE. UU.". Fortune dijo que el V4-Pro todavía estaba por detrás del Gemini 3.1 Pro en los benchmarks de conocimiento mundial.
En pocas palabras: técnicamente no se ha creado una brecha, pero en precio todavía se puede competir.
El movimiento de DeepSeek es claro – dado que no puede enfrentarse frontalmente a GPT-5.5 y Claude Opus en capacidades punteras a corto plazo, toma otro camino: reducir el costo de migración de los desarrolladores a un nivel imposible de ignorar. Ofrecer una prueba gratuita del modelo no es sorprendente, pero recortar un 75% solo 72 horas después del lanzamiento es una declaración – le dice a todos los desarrolladores que aún están dudando: yo te ahorro el costo de la migración.
Quienes conocen este círculo saben que DeepSeek, al lanzar R1 en enero del año pasado, utilizó el mismo conjunto: rendimiento suficiente, precio aplastante. Esa ola desencadenó directamente la guerra de precios de los modelos abiertos chinos, y OpenAI, Anthropic y Google posteriormente realizaron múltiples rondas de ajustes de precios.
Esta vez, parece ser el mismo guion.
¿Quién aguanta primero?
Los competidores nacionales ya han reaccionado. Las acciones de MiniMax cayeron un 9% durante la sesión en Hong Kong, y la conocida empresa de modelos base Knowledge Atlas (Zhipu) también cayó en la misma proporción. Esto no se debe a que los modelos sean malos, sino a que su espacio de fijación de precios fue directamente comprimido por el precio promocional del V4-Pro.
En lenguaje llano: ¿todavía quieres vender tu modelo nacional a $1/millón de tokens hoy? Los desarrolladores abren la consola de DeepSeek y ven 0,036 dólares estadounidenses por un millón de tokens – ¿cómo explicas por qué debería ser 27 veces más caro?
OpenAI y Anthropic probablemente no seguirán a corto plazo. Su estrategia siempre ha sido "precio alto, calidad alta" – los clientes pagan más por confiabilidad, SLA, cumplimiento y soporte empresarial. Pero los que realmente sufren son la capa intermedia:
- Mistral, Cohere – actores cerrados con precios medios
- Zhipu, MiniMax, Moonshot en el mercado nacional
- Un montón de pequeños fabricantes de "relación calidad-precio"
No pueden decir que son más baratos que DeepSeek, ni que son más fuertes que GPT-5.5. Esta presión difumina su posicionamiento.
Los efectos secundarios de esta jugada
Este enfoque de DeepSeek tiene un costo obvio: el margen bruto podría ser negativo.
El V4-Pro es un modelo MoE con 1,6 billones de parámetros, que activa 49 mil millones de parámetros en cada inferencia. Con esta escala ejecutándose en Huawei Ascend 950PR, el costo marginal por token no será mucho más alto que el de Gemini Flash o GPT-5.4-Nano – pero en comparación con el precio promocional, es casi seguro que está generando pérdidas.
Entonces, ¿por qué hacerlo? La respuesta es probablemente – DeepSeek está tratando el "número de usuarios" y la "frecuencia de uso" como puntos de datos centrales para la próxima ronda de financiación y salida a bolsa. Hace unos días, hubo noticias de que Liang Wenfeng comenzó a contactar a inversores externos – la primera vez en tres años que se abre después de rechazar a los VC. La calidad del modelo ya ha alcanzado el segundo escalón, el siguiente paso debe contar la historia de "participación de mercado de desarrolladores".
Barato por sí solo no es una barrera. Barato + calidad suficiente + pesos abiertos + API estable lo es. Si en el próximo mes las descargas de V4-Pro en Hugging Face y las llamadas reales de API continúan explotando, esta jugada habrá valido la pena.
En cuanto a si otros seguirán? Antes de junio debería haber una respuesta.
Fuentes de referencia: DeepSeek Slashes Fees for New AI Model in Chinese Price War (Bloomberg); DeepSeek slashes AI model costs, reignites price war in sector (Investing.com / Reuters); DeepSeek V4-Pro Price Cut: 75% (TheNextWeb); China's DeepSeek Slashes AI Prices With 75% Discount on V4-Pro Model (Republic World); CocoLoop, DeepSeek's Long-Awaited New Model Fails to Narrow US Lead in AI (Bloomberg)