T-Head presenta el chip Zhenwu V900, pero la producción en masa no llega hasta 2027

El 22 de septiembre, T-Head, la empresa de chips de Alibaba, presentó en la Apsara Conference 2026 de Hangzhou su nuevo chip de IA que unifica entrenamiento e inferencia, el Zhenwu V900. Según el anuncio oficial, su rendimiento es 3 veces superior al de su predecesor, el Zhenwu M890, y un solo clúster puede escalar hasta 500.000 tarjetas. Según la cobertura de varios medios presentes en el evento, el chip entrará en producción en masa en 2027, y los servidores superenodo Panjiu de nueva generación que lo incorporen llegarán al mercado en el primer trimestre de 2027.

Es decir, lo presentado ahora es la siguiente parada de una hoja de ruta: este año, los clientes de Alibaba Cloud todavía solo pueden alquilar el M890.

Qué especificaciones se han hecho públicas

T-Head dio a conocer tres especificaciones: 216GB de memoria, una interconexión entre chips de 1200GB/s y soporte para las precisiones FP8 y FP4. Su posicionamiento oficial es cubrir las necesidades de entrenamiento e inferencia de modelos de escala de billones de parámetros.

El servidor superenodo Panjiu combinará el Zhenwu V900 con otros chips propios de T-Head —el ICN Switch y los chips Panmai y Zhenyue—, con el conmutador, la red y el control de almacenamiento desarrollados internamente. T-Head también adelantó su siguiente generación, el Zhenwu J900, que según la compañía adoptará una arquitectura de computación paralela propia y está previsto para 2028; el trimestre exacto varía según la fuente.

Lo que no se ha divulgado es aún más: el rendimiento máximo por tarjeta, el consumo eléctrico, el proceso de fabricación y el socio de fundición, o el tipo de memoria; nada de esto aparece en los materiales de lanzamiento. El "3 veces" es relativo al M890, cuyo rendimiento absoluto tampoco ha sido revelado por completo por T-Head hasta ahora.

En qué punto está el M890 ahora mismo

En su discurso, el CEO de Alibaba, Wu Yongming, dio una actualización del producto que ya está en servicio: el superenodo de IA M890, desarrollado internamente, ya es capaz de sostener la inferencia de modelos de 2 billones de parámetros, y este trimestre empieza a desplegarse a gran escala en los centros de datos de Alibaba Cloud. El producto en la nube correspondiente se llama instancia de superenodo Lingjun Zhenwu M890 GP9A, que ya está a la venta.

Wu también dijo que, como la línea de chips de T-Head ya es madura y tiene una adopción alta entre los clientes, se espera que el volumen de envíos anual aumente considerablemente. Alibaba no dio cifras concretas de volumen.

Las cifras más grandes del discurso tuvieron que ver con los modelos y los centros de datos: Qwen planea entrenar nuevos modelos de entre 5 y 10 billones de parámetros, y la capacidad global de centros de datos de Alibaba Cloud superará los 20GW en 2032. Calificó los modelos de IA, los chips de IA y la nube de IA como "los tres pilares de la era de la inteligencia de máquina", y afirmó que Alibaba invertirá firmemente en los tres frentes.

Cuál es el impacto para los usuarios en China

Para las empresas chinas que ejecutan sus modelos en Alibaba Cloud, la información más directa de este lanzamiento es el calendario: hasta el primer trimestre del próximo año, la única opción de cómputo propio nacional disponible seguirá siendo la instancia M890; Alibaba no ha dicho cuándo se ofrecerá el superenodo V900 como instancia en la nube ni a qué precio.

Para los clientes que construyen sus propios centros de datos, los 216GB de memoria son una cifra directamente comparable: determinan el tamaño del fragmento de modelo que cabe en una sola tarjeta y cuántas tarjetas se necesitan para alojar un modelo de un billón de parámetros. El soporte para FP4 significa que, en el lado de la inferencia, se puede intercambiar precisión por rendimiento, siempre que la pila de software esté a la altura. Hasta ahora, los chips de T-Head funcionaban sobre todo en el propio negocio de Alibaba y en Alibaba Cloud; todavía no hay datos reales de terceros sobre cuánto costará la adaptación a los clientes externos que migren.

La producción en masa en 2027 todavía está a más de un año vista. En ese tiempo, los competidores del mercado chino de chips de IA también renovarán sus generaciones; dónde quedará ese "3 veces" del V900 frente a los productos de la misma época solo podrá evaluarse cuando existan cifras reales de rendimiento por tarjeta y resultados de pruebas de referencia.

Fuentes: discurso de Wu Yongming en la Apsara Conference 2026 de Hangzhou, ITHome, CocoLoop, Sina Finance; las especificaciones del chip se han verificado con el anuncio de T-Head en el evento, y los plazos de producción en masa y lanzamiento siguen la cobertura de varios medios presentes en el lugar.