DeepSeek réduit le prix du V4-Pro de 75 % seulement 72 heures après son lancement

L'aperçu du V4-Pro a été lancé tôt vendredi matin de la semaine dernière.

Ce matin, DeepSeek a publié une annonce sur le tableau de bord API : 75 % de réduction sur le V4-Pro, valable directement jusqu'au 5 mai. Parallèlement, le prix de hit de cache d'entrée de l'ensemble de l'API a été réduit à un dixième du prix d'origine.

Entre le lancement et la baisse de prix drastique, il s'est écoulé moins de 72 heures.

Les chiffres sur la table

Prix d'origine du DeepSeek-V4-Pro :

Poste Prix d'origine (par 1 million de tokens)
Entrée $0,145
Sortie $3,48
Hit de cache 0,025 yuan/million de tokens (déjà un prix réduit, 1/10 du prix d'origine)

Pendant la période promotionnelle, le prix d'entrée du V4-Pro est directement tombé à environ $0,036/million de tokens, moins cher que quiconque – ce prix est si bas que beaucoup soupçonnent qu'il est vendu à perte pour augmenter le nombre d'utilisateurs.

Comparaison horizontale avec les prix actuels des modèles phares propriétaires :

  • GPT-5.5 : Version standard $1,5/million entrée, $10/million sortie
  • Gemini 3.1 Pro : Environ $1,25/million entrée, $10/million sortie
  • Claude Opus 4.7 : $15/million entrée, $75/million sortie

Cela signifie que le prix d'origine du V4-Pro avait déjà réduit le GPT-5.5 à moins d'un dixième et le Claude Opus 4.7 à moins d'un centième. Avec une réduction supplémentaire de 75 %, l'écart continue de se creuser.

Le vrai coup vient du cache

Si l'on regarde uniquement le prix unitaire du token du V4-Pro, il est déjà bon marché. Mais le coup le plus dur est que DeepSeek a réduit le prix de hit de cache d'entrée de toute la gamme de produits API à un dixième du prix d'origine.

À quoi sert le prix de hit de cache :

  • Les applications de type agent qui exécutent à plusieurs reprises le même system prompt – de grandes parties du contenu sont répétées
  • Dans les scénarios RAG, le même contexte est souvent fourni au modèle
  • Dans les dialogues à plusieurs tours, les messages historiques sont renvoyés

Dans ces scénarios, le prix de hit de cache est le coût réel principal payé par les entreprises. Le réduire de 90 % signifie – la barrière de coût pour les développeurs de migrer de GPT et Claude vers DeepSeek est presque nivelée.

Pourquoi agir à ce moment précis

Après le lancement de l'aperçu du V4-Pro tôt vendredi matin (24 avril), la réaction du marché a été quelque peu subtile. Le titre de Bloomberg ce jour-là était "Le nouveau modèle tant attendu de DeepSeek ne parvient pas à réduire l'avance des États-Unis dans l'IA" – "n'a pas réussi à combler l'écart avec les États-Unis". Fortune a déclaré que le V4-Pro était encore en retard sur le Gemini 3.1 Pro dans les benchmarks de connaissances mondiales.

En termes simples : techniquement, aucun écart n'a été créé, mais sur le prix, on peut encore se battre.

Le mouvement de DeepSeek est clair – ne pouvant pas affronter frontalement GPT-5.5 et Claude Opus en termes de capacités de pointe à court terme, il emprunte une autre voie : réduire le coût de migration des développeurs à un niveau impossible à ignorer. Proposer un essai gratuit du modèle n'est pas surprenant, mais réduire de 75 % seulement 72 heures après le lancement est une déclaration – elle dit à tous les développeurs qui hésitent encore : je vous économise le coût de la migration.

Ceux qui connaissent ce milieu savent que DeepSeek, lors du lancement de R1 en janvier dernier, a utilisé la même recette : performances suffisantes, prix écrasant. Cette vague a directement déclenché la guerre des prix des modèles ouverts chinois, et OpenAI, Anthropic et Google ont ensuite procédé à plusieurs tours d'ajustements de prix.

Cette fois, cela semble être le même scénario.

Qui craquera en premier

Les concurrents nationaux ont déjà réagi. L'action de MiniMax a chuté de 9 % pendant la séance à Hong Kong, et la célèbre entreprise de modèles de base Knowledge Atlas (Zhipu) a également baissé dans la même proportion. Ce n'est pas parce que les modèles sont mauvais, mais parce que leur espace de tarification a été directement écrasé par le prix promotionnel du V4-Pro.

En termes simples : voulez-vous encore vendre votre modèle national à $1/million de tokens aujourd'hui ? Les développeurs ouvrent la console DeepSeek et voient 0,036 dollar américain pour un million de tokens – comment expliquez-vous pourquoi il devrait être 27 fois plus cher ?

OpenAI et Anthropic ne suivront probablement pas à court terme. Leur stratégie a toujours été "prix élevé, qualité élevée" – les clients paient plus pour la fiabilité, les SLA, la conformité et le support d'entreprise. Mais ceux qui souffrent vraiment sont la couche intermédiaire :

  • Mistral, Cohere – des acteurs propriétaires avec des prix moyens
  • Zhipu, MiniMax, Moonshot sur le marché national
  • Une multitude de petits fabricants "rapport qualité-prix"

Ils ne peuvent ni dire qu'ils sont moins chers que DeepSeek, ni qu'ils sont plus forts que GPT-5.5. Cette pression rend leur positionnement flou.

Les effets secondaires de cette manœuvre

Cette approche de DeepSeek a un coût évident : la marge brute pourrait être négative.

Le V4-Pro est un modèle MoE avec 1,6 billion de paramètres, activant 49 milliards de paramètres à chaque inférence. Avec cette échelle fonctionnant sur Huawei Ascend 950PR, le coût marginal par token ne sera pas beaucoup plus élevé que celui de Gemini Flash ou GPT-5.4-Nano – mais par rapport au prix promotionnel, il est presque certainement vendu à perte.

Alors pourquoi le faire ? La réponse est probablement – DeepSeek traite le "nombre d'utilisateurs" et la "fréquence d'utilisation" comme des points de données clés pour le prochain tour de financement et l'introduction en bourse. Il y a quelques jours, des informations ont indiqué que Liang Wenfeng avait commencé à contacter des investisseurs externes – la première fois en trois ans qu'il s'ouvre après avoir refusé les VC. La qualité du modèle a déjà rattrapé le deuxième échelon, la prochaine étape doit raconter l'histoire de la "part de marché des développeurs".

Le bon marché seul n'est pas une barrière. Le bon marché + une qualité suffisante + des poids ouverts + une API stable l'est. Si au cours du mois prochain, les téléchargements de V4-Pro sur Hugging Face et les appels API réels continuent d'exploser, cette manœuvre en aura valu la peine.

Quant à savoir si d'autres suivront ? Avant juin, la réponse devrait être connue.

Sources de référence : DeepSeek Slashes Fees for New AI Model in Chinese Price War (Bloomberg) ; DeepSeek slashes AI model costs, reignites price war in sector (Investing.com / Reuters) ; DeepSeek V4-Pro Price Cut: 75% (TheNextWeb) ; China's DeepSeek Slashes AI Prices With 75% Discount on V4-Pro Model (Republic World) ; CocoLoop, DeepSeek's Long-Awaited New Model Fails to Narrow US Lead in AI (Bloomberg)