DeepSeek steht kurz vor der Veröffentlichung von V4, doch diesmal ist nicht die Größe des Modells die wichtigste Neuigkeit, sondern der Chip, auf dem es läuft.
Laut The Information wird DeepSeek V4 auf Huaweis Ascend 950PR-Chip laufen. Es ist das erste hochmoderne KI-Modell, das speziell für eine einheimische chinesische Chip-Architektur entwickelt wurde.
Zunächst zum Modell selbst
Die Spezifikationen von V4 sind beeindruckend:
| Parameter | Wert |
|---|---|
| Gesamtparameter | ca. 1 Billion (MoE-Architektur) |
| Aktivierte Parameter bei Inferenz | ca. 37 Milliarden |
| Kontextfenster | 1 Million Token |
| SWE-bench-Punktzahl | 81% |
Die Logik hinter der MoE-Architektur ist dieselbe wie bei V3: 1 Billion Parameter sind gespeichert, aber bei jeder Inferenz werden nur 37 Milliarden aktiviert. Die tatsächlichen Betriebskosten ähneln denen eines dichten Modells mit 37 Milliarden Parametern, während die Fähigkeiten an die einer Billion Parameter heranreichen. Der API-Preis nach dem Training beträgt 0,30 USD pro Million Token – eine Größenordnung günstiger als die GPT-Serie.
Multimodalität ist ebenfalls integriert: V4 unterstützt die native Verarbeitung von Text, Bildern und Videogenerierung.
Warum ist die Huawei-Chip-Frage so wichtig?
Frühere DeepSeek-Modelle, einschließlich V3 und R1, wurden auf NVIDIA A100/H100 trainiert (oder nutzten zumindest das CUDA-Ökosystem). V4 ist das erste Modell, das von Grund auf auf Huaweis CANN-Architektur basiert.
Hardware-Spezifikationen des Ascend 950PR:
- Rechenleistung: FP8 1 PFLOPS / FP4 2 PFLOPS
- Verbindungsbandbreite: 2 TB/s
- Fertigungsprozess: SMIC N+3-Prozess (Leistung nahe 5nm-Niveau)
- Integriert in Huaweis Atlas 350-Beschleunigerkarte
Damit V4 auf diesem Chip läuft, hat DeepSeek gemeinsam mit Huawei und Cambricon umfangreiche Low-Level-Code umgeschrieben, mit dem Ziel, das NVIDIA-CUDA-Ökosystem vollständig zu umgehen.
Die Analyse von TrendForce geht davon aus, dass DeepSeeks Entwicklungspipeline bei Erfolg innerhalb von ein bis zwei Jahren eine substanzielle Unabhängigkeit von CUDA erreichen könnte.
Alibaba, ByteDance und Tencent sichern sich Huawei-Chips
Die Marktreaktion ist direkt: Alibaba, ByteDance und Tencent haben bei Huawei Bestellungen über insgesamt mehrere Hunderttausend Ascend-Chips aufgegeben. Die Nachfrage ist sprunghaft gestiegen, und Huaweis Chip-Preise sind um etwa 20% gestiegen.
Huawei plant, im Jahr 2026 etwa 600.000 Ascend 910C-Chips zu produzieren – doppelt so viele wie 2025 – und die gesamte Ascend-Produktion auf 1,6 Millionen Chips zu steigern.
Anders betrachtet: Wenn DeepSeek V4 auf Huawei-Chips gut läuft, haben chinesische KI-Anbieter einen praktikablen alternativen Weg – sie sind nicht mehr vollständig auf NVIDIA angewiesen. Das hat für die gesamte Industriekette eine noch größere Bedeutung als V4 selbst.
Aber sind Huawei-Chips wirklich gut?
Ehrlich gesagt, das bleibt abzuwarten.
Die theoretischen Rechenleistungszahlen des Ascend 950PR sehen gut aus, aber es gibt noch keine groß angelegten validierten Daten zur tatsächlichen Effizienz von verteiltem Training und Inferenz im Vergleich zum NVIDIA H100-Ökosystem. V4-Lite wird derzeit auf API-Knoten intern getestet; Entwickler berichten von einer 30%igen Steigerung der Inferenzgeschwindigkeit und einer deutlichen Verbesserung des Kontextabrufs – allerdings in einer speziell optimierten Umgebung.
Die eigentliche Bewährungsprobe: Wird die Leistung nach der Veröffentlichung der offiziellen V4-Version so stabil sein wie beworben?
Wenn es funktioniert, ist das ein echter Beweis für den Weg der chinesischen KI-Hardware-Unabhängigkeit. Wenn nicht, zeigt es nur, dass die Richtung der Unabhängigkeit richtig ist, aber die Zeit noch nicht reif.
Die offizielle Version von V4 wird voraussichtlich Mitte April veröffentlicht. Wir werden die Ergebnisse abwarten.
Quellenangabe: CocoLoop, DeepSeek's V4 model will run on Huawei chips, The Information reports (WHBL); Decoding DeepSeek V4: How Huawei's Ascend 950PR Is Powering China's Push to Break CUDA Dependence (TrendForce); DeepSeek V4 points to growing use of Huawei chips in AI models (TechWire Asia); DeepSeek V4 And Tencent's New Hunyuan Model To Launch In April (Dataconomy)