DeepSeek V4 solo lanzó una versión preview.
Muchos no se dieron cuenta. El 24 de abril, DeepSeek presentó V4 Flash y V4 Pro, pero ambos son versiones de vista previa. La versión final llegará en el segundo semestre – y no porque el modelo no esté listo, sino porque los chips de Huawei aún no están en producción en masa.
El 26 de abril, Bloomberg citando a la cuenta "Yuyuantantian" de la CCTV reveló los entresijos, aclarando lo que DeepSeek ha hecho en los últimos meses.
No es que el modelo sea lento, es que los chips no han llegado
El equipo de DeepSeek en los últimos meses no ha lanzado muchas funciones nuevas, sino que ha migrado todo el framework de entrenamiento de NVIDIA a Huawei Ascend.
Esto es mucho más difícil que lanzar un modelo nuevo. El ecosistema CUDA está profundamente arraigado en el mundo de la IA desde hace más de una década. Migrar el pipeline de entrenamiento de un modelo de billones de parámetros de CUDA a CANN (Compute Architecture for Neural Networks) de Huawei requirió reescribir:
- Bibliotecas de operadores (matmul, attention, layernorm y cientos de kernels más)
- Planificación distribuida (reemplazar NCCL por HCCL)
- Entrenamiento de precisión mixta (comportamiento de FP8, BF16 en los nuevos chips)
- Checkpointing y tolerancia a fallos
Este trabajo de migración no se puede completar en medio año. DeepSeek lo ha hecho, pero el hardware aún está pendiente.
¿Qué es el Ascend 950PR y por qué esperarlo?
DeepSeek admitió abiertamente: V4 en el primer semestre de 2026 tiene "problemas de throughput" – el modelo puede ejecutarse, pero no lo suficientemente rápido y estable.
Lo que se espera es la producción en masa de los supernodos Ascend 950PR de Huawei a gran escala. El 950PR y el 950DT son la próxima generación de chips de IA de Huawei que se entregarán a finales de año, con la arquitectura SuperNode – que agrupa múltiples chips con interconexiones de alta velocidad en un supernodo, con rendimiento comparable al NVIDIA NVLink.
Solo cuando el 950PR esté a escala, la versión final de DeepSeek V4 podrá ejecutar inferencia completa. Por lo tanto, las versiones preview actuales V4 Flash y V4 Pro son esencialmente una preparación de marketing para el 950PR – primero se cuenta la historia de la capacidad del modelo, y cuando el hardware esté listo en el segundo semestre, la versión final se lanza inmediatamente al mercado.
Huawei también dio una promesa correspondiente: toda la línea de productos Ascend SuperNode está "totalmente adaptada" para DeepSeek V4, con un rendimiento de inferencia "significativamente mejorado". La pila de software CANN se ha adaptado específicamente para V4 en los últimos meses. La coordinación entre ambas partes es muy estrecha.
La "narrativa de dos vías" de la IA china, revelada por primera vez
Lo más interesante de esto no son los detalles técnicos, sino la narrativa.
En los últimos seis meses, el mundo de la IA china ha tenido una especie de "dos vías" tácitas:
- Externamente: Modelos de código abierto compiten en precio, benchmarks, enfatizando "independencia"
- Internamente: Los recursos reales de hardware y entrenamiento aún se ejecutan en NVIDIA
Con esta acción, DeepSeek unió las dos vías. Vinculó completamente el cronograma de lanzamiento de V4 a la capacidad de producción de chips de Huawei. Esto es algo que ninguna empresa china de IA se había atrevido a hacer antes – los riesgos son evidentes:
- Si la producción en masa del Huawei 950PR se retrasa, la versión final de DeepSeek V4 también se retrasa
- Si el rendimiento del Ascend no cumple con las expectativas, DeepSeek sufrirá el daño reputacional de "modelo que no funciona"
- Si los clientes quieren usar la versión final de V4, deben aceptar un "vínculo de chip"
Pero el beneficio también es claro: La IA china tiene a partir de ahora un ciclo completo de entrenamiento-inferencia-despliegue independiente de NVIDIA.
Las dos caras de un espejo
Esta historia y el acuerdo de 40 mil millones de dólares de Anthropic con Google son como dos caras de un espejo.
La soberanía computacional se está disputando globalmente de diferentes maneras – las empresas estadounidenses apuestan por la construcción de centros de datos en la nube y contratos a largo plazo; las empresas chinas apuestan por la vinculación a chips nacionales, ajustando el ritmo de lanzamiento a la curva de producción. Al final, todas quieren poner "cuántos tokens puedo ejecutar en el segundo semestre" en el balance general.
El hecho de que la cuenta de la CCTV haya revelado los entresijos esta vez también es oportuno. El segundo semestre aún no ha llegado, pero las expectativas del mercado ya se han fijado de antemano – si la producción de chips de Huawei es exitosa, DeepSeek V4 se convierte en un producto de referencia; si no, toda la narrativa de la IA china sufrirá un descuento.
La apuesta está hecha. El segundo semestre mostrará el resultado.
Fuentes de referencia: DeepSeek V4 Launch Postponed as Company Prioritizes Domestic Chip Integration (Bloomberg); CocoLoop, Huawei, DeepSeek strengthen China's AI self-reliance with collaboration on V4 model (South China Morning Post); DeepSeek delays V4 launch to tune for Huawei Ascend chips (Newsbytes)