Le 22 septembre, T-Head, la société de puces d'Alibaba, a dévoilé lors de l'Apsara Conference 2026 à Hangzhou sa nouvelle puce IA Zhenwu V900, qui réunit entraînement et inférence. Selon l'annonce officielle, sa puissance de calcul est trois fois supérieure à celle de son prédécesseur, le Zhenwu M890, et un seul cluster peut monter jusqu'à 500 000 cartes. D'après plusieurs médias présents sur place, la puce entrera en production de masse en 2027, et les serveurs super-nœuds Panjiu de nouvelle génération qui l'embarqueront arriveront sur le marché au premier trimestre 2027.
Autrement dit, ce qui vient d'être annoncé n'est qu'une étape supplémentaire sur une feuille de route : cette année encore, les clients d'Alibaba Cloud ne pourront louer que le M890.
Quelles caractéristiques ont été dévoilées
T-Head a communiqué trois caractéristiques : 216 Go de mémoire, une bande passante d'interconnexion entre puces de 1200 Go/s, et la prise en charge des précisions FP8 et FP4. Officiellement, la puce est positionnée pour répondre aux besoins d'entraînement et d'inférence des modèles de l'ordre du trillion de paramètres.
Le serveur super-nœud Panjiu associera le Zhenwu V900 à d'autres puces maison de T-Head — l'ICN Switch, ainsi que les puces Panmai et Zhenyue —, avec commutation, réseau et contrôle du stockage entièrement développés en interne. T-Head a également annoncé la génération suivante, le Zhenwu J900, censée adopter une architecture de calcul parallèle maison, prévue pour 2028 ; le trimestre exact varie selon les sources.
Ce qui n'a pas été dévoilé est encore plus vaste : la puissance de crête d'une seule carte, la consommation électrique, le nœud de gravure et le partenaire de fonderie, le type de mémoire — rien de tout cela ne figure dans les documents de lancement. Le facteur "trois fois" est relatif au M890, dont la puissance de calcul absolue n'a elle-même jamais été entièrement dévoilée par T-Head.
Où en est le M890 aujourd'hui
Dans son discours, le PDG d'Alibaba, Wu Yongming, a fait le point sur le produit déjà en service : le super-nœud IA M890, développé en interne, permet déjà l'inférence de modèles de 2 000 milliards de paramètres, et son déploiement à grande échelle dans les centres de données d'Alibaba Cloud a commencé ce trimestre. Le produit cloud correspondant s'appelle l'instance super-nœud Lingjun Zhenwu M890 GP9A, déjà commercialisée.
Wu Yongming a également indiqué que, la gamme de puces de T-Head étant désormais mature et largement adoptée par les clients, les volumes d'expédition annuels devraient fortement augmenter. Alibaba n'a donné aucun chiffre précis à ce sujet.
Les chiffres les plus marquants du discours concernaient les modèles et les centres de données : Qwen prévoit d'entraîner de nouveaux modèles de 5 000 à 10 000 milliards de paramètres, et la capacité mondiale des centres de données d'Alibaba Cloud doit dépasser 20 GW d'ici 2032. Il a qualifié les modèles d'IA, les puces d'IA et le cloud d'IA de "trois piliers de l'ère de l'intelligence machine", assurant qu'Alibaba investirait fermement dans ces trois domaines.
Quel impact pour les utilisateurs en Chine
Pour les entreprises chinoises qui font tourner leurs modèles sur Alibaba Cloud, l'information la plus concrète de cette annonce est le calendrier : jusqu'au premier trimestre de l'an prochain, la seule puissance de calcul nationale maison disponible reste l'instance M890 ; Alibaba n'a pas précisé quand le super-nœud V900 sera proposé sous forme d'instance cloud, ni à quel prix.
Pour les clients qui construisent leurs propres centres de données, les 216 Go de mémoire constituent un chiffre directement comparable : il détermine la taille du fragment de modèle qu'une seule carte peut contenir, et le nombre de cartes nécessaires pour héberger un modèle de mille milliards de paramètres. La prise en charge du FP4 signifie que, côté inférence, on peut échanger de la précision contre du débit, à condition que la pile logicielle suive. Jusqu'ici, les puces de T-Head tournaient surtout sur les activités internes d'Alibaba et sur Alibaba Cloud ; aucune donnée tierce ne permet encore de chiffrer le coût d'adaptation pour les clients externes qui migreraient.
La production de masse en 2027, c'est encore dans plus d'un an. D'ici là, les concurrents du marché chinois des puces IA changeront eux aussi de génération ; où se situera ce "trois fois" du V900 face aux produits contemporains ne pourra être jugé qu'une fois connues la puissance réelle par carte et les résultats de benchmarks.
Sources : discours de Wu Yongming à l'Apsara Conference 2026 de Hangzhou, ITHome, CocoLoop, Sina Finance ; les caractéristiques de la puce ont été vérifiées d'après l'annonce de T-Head sur place, les échéances de production de masse et de lancement reprennent la couverture de plusieurs médias présents sur site.