T-Head lança chip Zhenwu V900, mas produção em massa só em 2027

Em 22 de setembro, a T-Head, fabricante de chips da Alibaba, apresentou na Apsara Conference 2026, em Hangzhou, sua nova geração de chip de IA que une treinamento e inferência, o Zhenwu V900. Segundo o anúncio oficial, o desempenho é 3 vezes maior que o do antecessor Zhenwu M890, e um único cluster pode escalar até 500 mil placas. Segundo a cobertura de vários veículos no local, o chip entra em produção em massa em 2027, e os servidores super-nó Panjiu de nova geração equipados com ele chegam ao mercado no primeiro trimestre de 2027.

Ou seja, o que foi lançado agora é a próxima etapa de um roteiro de produtos — este ano, os clientes da Alibaba Cloud ainda só conseguem alugar o M890.

Quais especificações foram divulgadas

A T-Head divulgou três especificações: 216GB de memória, largura de banda de interconexão entre chips de 1200GB/s e suporte às precisões FP8 e FP4. O posicionamento oficial é atender às necessidades de treinamento e inferência de modelos na casa do trilhão de parâmetros.

O servidor super-nó Panjiu vai combinar o Zhenwu V900 com outros chips próprios da T-Head — o ICN Switch e os chips Panmai e Zhenyue —, com switching, rede e controle de armazenamento todos desenvolvidos internamente. A T-Head também adiantou a próxima geração, o Zhenwu J900, que deve adotar uma arquitetura de computação paralela própria, com lançamento previsto para 2028; o trimestre exato varia conforme a reportagem.

O que não foi divulgado é ainda mais: desempenho máximo por placa, consumo de energia, processo de fabricação e parceiro de fundição, tipo de memória — nada disso apareceu nos materiais de lançamento. O "3 vezes" é em relação ao M890, cujo desempenho absoluto a própria T-Head também nunca revelou por completo.

Em que ponto está o M890 hoje

Em seu discurso, o CEO da Alibaba, Wu Yongming, atualizou o andamento do produto já em operação: o super-nó de IA M890, desenvolvido internamente, já é capaz de sustentar a inferência de modelos de 2 trilhões de parâmetros e, neste trimestre, começa a ser implantado em larga escala nos data centers da Alibaba Cloud. O produto de nuvem correspondente se chama instância de super-nó Lingjun Zhenwu M890 GP9A, já disponível para venda.

Wu também disse que, como a linha de chips da T-Head já amadureceu e tem alta adoção pelos clientes, o volume de embarques anual deve crescer bastante. A Alibaba não deu números concretos de volume.

Os números mais expressivos do discurso ficaram por conta dos modelos e dos data centers: a Qwen planeja treinar novos modelos de 5 a 10 trilhões de parâmetros, e a capacidade global de data centers da Alibaba Cloud deve superar 20GW até 2032. Ele chamou modelos de IA, chips de IA e nuvem de IA de "os três pilares da era da inteligência de máquina", afirmando que a Alibaba vai investir firmemente nessas três frentes.

Qual o impacto para usuários na China

Para as empresas chinesas que rodam modelos na Alibaba Cloud, a informação mais direta deste lançamento é o cronograma: até o primeiro trimestre do ano que vem, a única opção de computação nacional própria disponível continua sendo a instância M890; a Alibaba não disse quando o super-nó V900 será oferecido como instância de nuvem, nem a que preço.

Para clientes que constroem seus próprios data centers, os 216GB de memória são um número diretamente comparável — determinam o tamanho do fragmento de modelo que cabe em uma única placa e quantas placas são necessárias para rodar um modelo de um trilhão de parâmetros. O suporte a FP4 significa que, na inferência, é possível trocar precisão por throughput, desde que a pilha de software acompanhe. Até agora, os chips da T-Head rodavam principalmente nos próprios negócios da Alibaba e na Alibaba Cloud; ainda não há dados reais de terceiros sobre o custo de adaptação para clientes externos que migrarem.

A produção em massa em 2027 ainda está a mais de um ano de distância. Nesse meio-tempo, os concorrentes do mercado chinês de chips de IA também vão trocar de geração; onde o "3 vezes" do V900 vai ficar frente a produtos do mesmo período só poderá ser avaliado quando surgirem o desempenho real por placa e resultados de benchmark.

Fontes: discurso de Wu Yongming na Apsara Conference 2026 em Hangzhou, ITHome, CocoLoop, Sina Finance; as especificações do chip foram verificadas com base no anúncio da T-Head no evento, e os prazos de produção em massa e lançamento seguem a cobertura de vários veículos no local.