DeepSeek s'apprête à lancer V4, mais cette fois, le point le plus remarquable n'est pas la taille des paramètres du modèle, mais la puce sur laquelle il tourne.
Selon The Information, DeepSeek V4 fonctionnera sur la puce Ascend 950PR de Huawei. Il s'agit du premier modèle d'IA de pointe construit spécifiquement pour une architecture de puce nationale chinoise.
D'abord, le modèle lui-même
Les spécifications de V4 sont impressionnantes :
| Paramètre | Valeur |
|---|---|
| Nombre total de paramètres | Environ 1 billion (architecture MoE) |
| Paramètres activés lors de l'inférence | Environ 37 milliards |
| Fenêtre de contexte | 1 million de tokens |
| Score SWE-bench | 81% |
La logique de l'utilisation de l'architecture MoE est la même que pour V3 : 1 billion de paramètres sont stockés, mais à chaque inférence, seuls 37 milliards sont activés. Le coût d'exploitation réel est plus proche de celui d'un modèle dense de 37 milliards de paramètres, tandis que les capacités peuvent atteindre le niveau du billion. Le prix de l'API après l'entraînement est de 0,30 USD par million de tokens, soit un ordre de grandeur moins cher que la série GPT.
La multimodalité a également été intégrée : V4 prend en charge le traitement natif du texte, des images et la génération de vidéos.
Pourquoi la question de la puce Huawei est-elle importante ?
Les modèles précédents de DeepSeek, y compris V3 et R1, ont été entraînés sur des NVIDIA A100/H100 (ou ont au moins utilisé l'écosystème CUDA). V4 est le premier modèle construit de A à Z sur l'architecture CANN de Huawei.
Spécifications matérielles de l'Ascend 950PR :
- Puissance de calcul : FP8 1 PFLOPS / FP4 2 PFLOPS
- Bande passante d'interconnexion : 2 To/s
- Procédé de fabrication : Procédé N+3 de SMIC (performances proches du niveau 5 nm)
- Intégré sur la carte accélératrice Atlas 350 de Huawei
Pour que V4 fonctionne sur cette puce, DeepSeek, en collaboration avec Huawei et Cambricon, a réécrit une grande quantité de code de bas niveau, dans le but de contourner complètement l'écosystème CUDA de NVIDIA.
L'analyse de TrendForce estime qu'en cas de succès, le pipeline de développement de DeepSeek pourrait atteindre une indépendance substantielle vis-à-vis de CUDA d'ici un à deux ans.
Alibaba, ByteDance et Tencent se disputent tous les puces Huawei
La réaction du marché est directe : Alibaba, ByteDance et Tencent ont déjà passé commande auprès de Huawei pour un total de plusieurs centaines de milliers de puces Ascend. La demande a grimpé en flèche et les prix des puces de Huawei ont déjà augmenté d'environ 20%.
Huawei prévoit de produire environ 600 000 puces Ascend 910C en 2026, soit le double de 2025, avec une capacité totale de production Ascend de 1,6 million de puces.
Vu sous un autre angle : si DeepSeek V4 fonctionne bien sur la puce Huawei, les fabricants d'IA nationaux disposeront d'une voie de remplacement viable et réaliste – ne dépendant plus entièrement de NVIDIA. Cela a une signification plus grande pour l'ensemble de la chaîne industrielle que V4 lui-même.
Mais la puce Huawei est-elle vraiment performante ?
Honnêtement, c'est encore une inconnue.
Les chiffres théoriques de puissance de calcul de l'Ascend 950PR semblent bons, mais l'efficacité réelle de l'entraînement distribué et de l'inférence, par rapport à l'écosystème H100 de NVIDIA, ne dispose pas encore de données de validation à grande échelle. V4-Lite est actuellement en test interne sur des nœuds API ; les développeurs signalent une augmentation de 30% de la vitesse d'inférence et une amélioration significative de la récupération de contexte – mais cela dans un environnement spécialement optimisé.
Le véritable test est le suivant : après le lancement de la version officielle de V4, les performances seront-elles aussi stables que promis ?
Si cela fonctionne, ce sera une preuve tangible de la voie de l'indépendance du matériel d'IA chinois. Si cela ne fonctionne pas bien, cela montre seulement que la direction de l'indépendance est correcte, mais que le temps n'est pas encore suffisant.
La version officielle de V4 devrait être publiée à la mi-avril. Attendons les résultats.
Source de référence : CocoLoop, DeepSeek's V4 model will run on Huawei chips, The Information reports (WHBL) ; Decoding DeepSeek V4: How Huawei's Ascend 950PR Is Powering China's Push to Break CUDA Dependence (TrendForce) ; DeepSeek V4 points to growing use of Huawei chips in AI models (TechWire Asia) ; DeepSeek V4 And Tencent's New Hunyuan Model To Launch In April (Dataconomy)