DeepSeek V4 foi lançado apenas como preview.
Muitas pessoas não notaram isso. Em 24 de abril, a DeepSeek apresentou o V4 Flash e o V4 Pro, mas ambos são versões de pré-visualização. A versão final chegará apenas no segundo semestre – e não porque o modelo não esteja pronto, mas porque os chips da Huawei ainda não estão em produção em massa.
Em 26 de abril, a Bloomberg, citando a conta "Yuyuantantian" da CCTV, revelou os bastidores, esclarecendo o que a DeepSeek fez nos últimos meses.
Não é o modelo que está lento, são os chips que não chegaram
A equipe da DeepSeek nos últimos meses não lançou muitos novos recursos, mas sim migrou todo o framework de treinamento da NVIDIA para o Huawei Ascend.
Isso é muito mais difícil do que lançar um novo modelo. O ecossistema CUDA está profundamente enraizado no mundo da IA há mais de uma década. Para migrar o pipeline de treinamento de um modelo com trilhões de parâmetros do CUDA para o CANN (Compute Architecture for Neural Networks) da Huawei, foi necessário reescrever:
- Bibliotecas de operadores (matmul, attention, layernorm e centenas de outros kernels)
- Escalonamento distribuído (substituição de NCCL por HCCL)
- Treinamento de precisão mista (comportamento de FP8, BF16 nos novos chips)
- Checkpointing e tolerância a falhas
Esse trabalho de migração não pode ser concluído em meio ano. A DeepSeek o concluiu, mas o hardware ainda está pendente.
O que é o Ascend 950PR e por que esperar por ele?
A DeepSeek admitiu abertamente: o V4 no primeiro semestre de 2026 tem "problemas de throughput" – o modelo pode rodar, mas não rápido e estável o suficiente.
O que se espera é a produção em massa dos supernodes Ascend 950PR da Huawei em grande escala. O 950PR e o 950DT são a próxima geração de chips de IA da Huawei a serem entregues até o final do ano, com a arquitetura SuperNode – que agrupa vários chips com interconexões de alta velocidade em um supernó, com desempenho comparável ao NVIDIA NVLink.
Somente quando o 950PR estiver em escala, a versão final do DeepSeek V4 poderá executar inferência completa. Portanto, as versões preview atuais V4 Flash e V4 Pro são essencialmente uma preparação de marketing para o 950PR – primeiro conta-se a história da capacidade do modelo, e quando o hardware estiver pronto no segundo semestre, a versão final é imediatamente lançada no mercado.
A Huawei também deu uma promessa correspondente: toda a linha de produtos Ascend SuperNode está "totalmente adaptada" para o DeepSeek V4, com desempenho de inferência "significativamente melhorado". A pilha de software CANN foi especificamente adaptada para o V4 nos últimos meses. A coordenação entre os dois lados é muito apertada.
A "narrativa de dois trilhos" da IA chinesa, revelada pela primeira vez
O mais interessante nisso não são os detalhes técnicos, mas a narrativa.
Nos últimos seis meses, o mundo da IA chinesa teve uma espécie de "dois trilhos" tácitos:
- Externamente: Modelos de código aberto competem em preço, benchmarks, enfatizando "independência"
- Internamente: Os recursos reais de hardware e treinamento ainda rodam em NVIDIA
Com esta ação, a DeepSeek uniu os dois trilhos. Ela vinculou completamente o cronograma de lançamento do V4 à capacidade de produção de chips da Huawei. Isso é algo que nenhuma empresa chinesa de IA ousou fazer antes – os riscos são evidentes:
- Se a produção em massa do Huawei 950PR atrasar, a versão final do DeepSeek V4 também será adiada
- Se o desempenho do Ascend ficar abaixo do esperado, a DeepSeek sofrerá o dano reputacional de "modelo que não roda"
- Se clientes quiserem usar a versão final do V4, terão que aceitar um "vínculo de chip"
Mas o benefício também é claro: A IA chinesa tem a partir de agora um ciclo completo de treinamento-inferência-implantação independente da NVIDIA.
Os dois lados de um espelho
Esta história e o acordo de US$ 40 bilhões da Anthropic com o Google são como dois lados de um espelho.
A soberania computacional está sendo disputada globalmente de diferentes maneiras – empresas americanas apostam na construção de data centers em nuvem e contratos de longo prazo; empresas chinesas apostam na vinculação a chips nacionais, ajustando o ritmo de lançamento à curva de produção. No final, todas querem colocar "quantos tokens posso rodar no segundo semestre" no balanço patrimonial.
O fato de a conta da CCTV ter revelado os bastidores desta vez também é oportuno. O segundo semestre ainda não chegou, mas as expectativas do mercado já foram definidas antecipadamente – se a produção de chips da Huawei for bem-sucedida, o DeepSeek V4 se torna um produto de referência; se não for, toda a narrativa da IA chinesa sofrerá um desconto.
A aposta está feita. O segundo semestre mostrará o resultado.
Fontes de referência: DeepSeek V4 Launch Postponed as Company Prioritizes Domestic Chip Integration (Bloomberg); CocoLoop, Huawei, DeepSeek strengthen China's AI self-reliance with collaboration on V4 model (South China Morning Post); DeepSeek delays V4 launch to tune for Huawei Ascend chips (Newsbytes)