Der Alibaba-Chiphersteller T-Head hat am 22. September auf der Apsara Conference 2026 in Hangzhou seinen neuen KI-Chip Zhenwu V900 vorgestellt, der Training und Inferenz in einem Chip vereint. Laut offizieller Angabe liegt die Rechenleistung dreimal so hoch wie beim Vorgänger Zhenwu M890, ein einzelner Cluster soll sich auf bis zu 500.000 Karten skalieren lassen. Mehreren Medienberichten vor Ort zufolge geht der Chip 2027 in die Massenproduktion, die damit ausgestatteten Panjiu-Supernode-Server der neuen Generation sollen im ersten Quartal 2027 auf den Markt kommen.
Das bedeutet: Diese Vorstellung ist die nächste Station auf einer Roadmap – wer heute bei Alibaba Cloud mietet, bekommt weiterhin nur den M890.
Welche Spezifikationen wurden veröffentlicht
T-Head nannte drei Kennzahlen: 216 GB Speicher, 1200 GB/s Chip-zu-Chip-Bandbreite sowie Unterstützung für FP8- und FP4-Genauigkeit. Offiziell soll der Chip den Trainings- und Inferenzbedarf von Modellen im Billionen-Parameter-Bereich decken.
Der Panjiu-Supernode-Server bündelt den Zhenwu V900 mit weiteren Eigenentwicklungen von T-Head – dem ICN Switch sowie den Chips Panmai und Zhenyue; Switching, Netzwerk und Storage-Steuerung stammen komplett aus eigener Entwicklung. T-Head kündigte zudem bereits die übernächste Generation an, den Zhenwu J900, der auf eine eigene Parallelrechenarchitektur setzen und 2028 erscheinen soll; zum genauen Quartal gibt es in den Berichten unterschiedliche Angaben.
Unveröffentlicht bleibt deutlich mehr: die Spitzenleistung einer einzelnen Karte, der Stromverbrauch, der Fertigungsprozess samt Foundry-Partner sowie der Speichertyp tauchen in den Launch-Unterlagen nicht auf. Die "dreifache" Leistung bezieht sich relativ auf den M890, dessen absolute Rechenleistung T-Head bislang ebenfalls nie vollständig offengelegt hat.
Wo steht der M890 aktuell
Alibaba-CEO Wu Yongming gab in seiner Keynote ein Update zum bereits im Einsatz befindlichen Produkt: Der hauseigene KI-Supernode M890 unterstützt inzwischen die Inferenz von Modellen mit 2 Billionen Parametern und wird in diesem Quartal in großem Maßstab in den Rechenzentren von Alibaba Cloud ausgerollt. Das entsprechende Cloud-Produkt trägt den Namen Lingjun-Zhenwu-M890-Supernode-Instanz GP9A und ist bereits im Verkauf.
Wu sagte außerdem, dass die Chip-Produktlinie von T-Head inzwischen ausgereift sei und von Kunden stark nachgefragt werde, weshalb die jährliche Auslieferungsmenge deutlich steigen dürfte. Konkrete Zahlen zum Auslieferungsvolumen nannte Alibaba nicht.
Die größeren Zahlen der Keynote betrafen Modelle und Rechenzentren: Qwen plant neue Modelle mit 5 bis 10 Billionen Parametern, und die globale Rechenzentrumskapazität von Alibaba Cloud soll bis 2032 die Marke von 20 GW überschreiten. KI-Modelle, KI-Chips und KI-Cloud bezeichnete Wu als "die drei Fundamente des Zeitalters der maschinellen Intelligenz", in die Alibaba konsequent investieren werde.
Was bedeutet das für Nutzer in China
Für chinesische Unternehmen, die ihre Modelle auf Alibaba Cloud betreiben, ist die konkreteste Botschaft dieser Vorstellung der Zeitplan: Bis zum ersten Quartal des kommenden Jahres bleibt die M890-Instanz die einzige Option an heimischer Eigenentwicklung. Wann V900-Supernodes als Cloud-Instanz verfügbar sein und was sie kosten werden, hat Alibaba nicht mitgeteilt.
Für Kunden, die eigene Rechenzentren aufbauen, ist der Speicher von 216 GB eine unmittelbar vergleichbare Kennzahl – sie bestimmt, wie groß ein Modell-Shard auf einer einzelnen Karte sein darf und wie viele Karten für ein Billionen-Parameter-Modell nötig sind. Die FP4-Unterstützung erlaubt es, auf der Inferenzseite Genauigkeit gegen Durchsatz einzutauschen, sofern der Software-Stack mitzieht. Die bisherigen T-Head-Chips liefen vor allem im eigenen Geschäft von Alibaba und auf Alibaba Cloud; wie hoch der Migrationsaufwand für externe Kunden ausfällt, dazu gibt es bislang keine unabhängigen Praxisdaten.
Bis zur Massenproduktion 2027 ist es noch mehr als ein Jahr hin. In dieser Zeit bringen auch die Konkurrenten auf dem chinesischen KI-Chip-Markt neue Generationen heraus; wo die "dreifache" Leistung des V900 dann im Vergleich zu zeitgleichen Produkten steht, lässt sich erst beurteilen, sobald reale Leistungswerte einzelner Karten und Benchmark-Ergebnisse vorliegen.
Quellen: Keynote von Wu Yongming auf der Apsara Conference 2026 in Hangzhou, ITHome, CocoLoop, Sina Finance; die Chip-Spezifikationen wurden anhand der Angaben von T-Head vor Ort geprüft, Angaben zu Massenproduktion und Markteinführung stammen aus mehreren Vor-Ort-Berichten.