L'aperçu du V4-Pro a été lancé tôt vendredi matin de la semaine dernière.
Ce matin, DeepSeek a publié une annonce sur le tableau de bord API : 75 % de réduction sur le V4-Pro, valable directement jusqu'au 5 mai. Parallèlement, le prix de hit de cache d'entrée de l'ensemble de l'API a été réduit à un dixième du prix d'origine.
Entre le lancement et la baisse de prix drastique, il s'est écoulé moins de 72 heures.
Les chiffres sur la table
Prix d'origine du DeepSeek-V4-Pro :
| Poste | Prix d'origine (par 1 million de tokens) |
|---|---|
| Entrée | $0,145 |
| Sortie | $3,48 |
| Hit de cache | 0,025 yuan/million de tokens (déjà un prix réduit, 1/10 du prix d'origine) |
Pendant la période promotionnelle, le prix d'entrée du V4-Pro est directement tombé à environ $0,036/million de tokens, moins cher que quiconque – ce prix est si bas que beaucoup soupçonnent qu'il est vendu à perte pour augmenter le nombre d'utilisateurs.
Comparaison horizontale avec les prix actuels des modèles phares propriétaires :
- GPT-5.5 : Version standard $1,5/million entrée, $10/million sortie
- Gemini 3.1 Pro : Environ $1,25/million entrée, $10/million sortie
- Claude Opus 4.7 : $15/million entrée, $75/million sortie
Cela signifie que le prix d'origine du V4-Pro avait déjà réduit le GPT-5.5 à moins d'un dixième et le Claude Opus 4.7 à moins d'un centième. Avec une réduction supplémentaire de 75 %, l'écart continue de se creuser.
Le vrai coup vient du cache
Si l'on regarde uniquement le prix unitaire du token du V4-Pro, il est déjà bon marché. Mais le coup le plus dur est que DeepSeek a réduit le prix de hit de cache d'entrée de toute la gamme de produits API à un dixième du prix d'origine.
À quoi sert le prix de hit de cache :
- Les applications de type agent qui exécutent à plusieurs reprises le même system prompt – de grandes parties du contenu sont répétées
- Dans les scénarios RAG, le même contexte est souvent fourni au modèle
- Dans les dialogues à plusieurs tours, les messages historiques sont renvoyés
Dans ces scénarios, le prix de hit de cache est le coût réel principal payé par les entreprises. Le réduire de 90 % signifie – la barrière de coût pour les développeurs de migrer de GPT et Claude vers DeepSeek est presque nivelée.
Pourquoi agir à ce moment précis
Après le lancement de l'aperçu du V4-Pro tôt vendredi matin (24 avril), la réaction du marché a été quelque peu subtile. Le titre de Bloomberg ce jour-là était "Le nouveau modèle tant attendu de DeepSeek ne parvient pas à réduire l'avance des États-Unis dans l'IA" – "n'a pas réussi à combler l'écart avec les États-Unis". Fortune a déclaré que le V4-Pro était encore en retard sur le Gemini 3.1 Pro dans les benchmarks de connaissances mondiales.
En termes simples : techniquement, aucun écart n'a été créé, mais sur le prix, on peut encore se battre.
Le mouvement de DeepSeek est clair – ne pouvant pas affronter frontalement GPT-5.5 et Claude Opus en termes de capacités de pointe à court terme, il emprunte une autre voie : réduire le coût de migration des développeurs à un niveau impossible à ignorer. Proposer un essai gratuit du modèle n'est pas surprenant, mais réduire de 75 % seulement 72 heures après le lancement est une déclaration – elle dit à tous les développeurs qui hésitent encore : je vous économise le coût de la migration.
Ceux qui connaissent ce milieu savent que DeepSeek, lors du lancement de R1 en janvier dernier, a utilisé la même recette : performances suffisantes, prix écrasant. Cette vague a directement déclenché la guerre des prix des modèles ouverts chinois, et OpenAI, Anthropic et Google ont ensuite procédé à plusieurs tours d'ajustements de prix.
Cette fois, cela semble être le même scénario.
Qui craquera en premier
Les concurrents nationaux ont déjà réagi. L'action de MiniMax a chuté de 9 % pendant la séance à Hong Kong, et la célèbre entreprise de modèles de base Knowledge Atlas (Zhipu) a également baissé dans la même proportion. Ce n'est pas parce que les modèles sont mauvais, mais parce que leur espace de tarification a été directement écrasé par le prix promotionnel du V4-Pro.
En termes simples : voulez-vous encore vendre votre modèle national à $1/million de tokens aujourd'hui ? Les développeurs ouvrent la console DeepSeek et voient 0,036 dollar américain pour un million de tokens – comment expliquez-vous pourquoi il devrait être 27 fois plus cher ?
OpenAI et Anthropic ne suivront probablement pas à court terme. Leur stratégie a toujours été "prix élevé, qualité élevée" – les clients paient plus pour la fiabilité, les SLA, la conformité et le support d'entreprise. Mais ceux qui souffrent vraiment sont la couche intermédiaire :
- Mistral, Cohere – des acteurs propriétaires avec des prix moyens
- Zhipu, MiniMax, Moonshot sur le marché national
- Une multitude de petits fabricants "rapport qualité-prix"
Ils ne peuvent ni dire qu'ils sont moins chers que DeepSeek, ni qu'ils sont plus forts que GPT-5.5. Cette pression rend leur positionnement flou.
Les effets secondaires de cette manœuvre
Cette approche de DeepSeek a un coût évident : la marge brute pourrait être négative.
Le V4-Pro est un modèle MoE avec 1,6 billion de paramètres, activant 49 milliards de paramètres à chaque inférence. Avec cette échelle fonctionnant sur Huawei Ascend 950PR, le coût marginal par token ne sera pas beaucoup plus élevé que celui de Gemini Flash ou GPT-5.4-Nano – mais par rapport au prix promotionnel, il est presque certainement vendu à perte.
Alors pourquoi le faire ? La réponse est probablement – DeepSeek traite le "nombre d'utilisateurs" et la "fréquence d'utilisation" comme des points de données clés pour le prochain tour de financement et l'introduction en bourse. Il y a quelques jours, des informations ont indiqué que Liang Wenfeng avait commencé à contacter des investisseurs externes – la première fois en trois ans qu'il s'ouvre après avoir refusé les VC. La qualité du modèle a déjà rattrapé le deuxième échelon, la prochaine étape doit raconter l'histoire de la "part de marché des développeurs".
Le bon marché seul n'est pas une barrière. Le bon marché + une qualité suffisante + des poids ouverts + une API stable l'est. Si au cours du mois prochain, les téléchargements de V4-Pro sur Hugging Face et les appels API réels continuent d'exploser, cette manœuvre en aura valu la peine.
Quant à savoir si d'autres suivront ? Avant juin, la réponse devrait être connue.
Sources de référence : DeepSeek Slashes Fees for New AI Model in Chinese Price War (Bloomberg) ; DeepSeek slashes AI model costs, reignites price war in sector (Investing.com / Reuters) ; DeepSeek V4-Pro Price Cut: 75% (TheNextWeb) ; China's DeepSeek Slashes AI Prices With 75% Discount on V4-Pro Model (Republic World) ; CocoLoop, DeepSeek's Long-Awaited New Model Fails to Narrow US Lead in AI (Bloomberg)