DeepSeek Pro passe à 384K en sortie

DeepSeek V4 Pro entre dans une phase API plus concrète. Le 13 août, la page tarifaire indiquait deepseek-v4-pro comme DeepSeek-V4-Pro-0813, avec les formats compatibles OpenAI et Anthropic inchangés.

Le même tableau réunit contexte de 1M tokens, sortie maximale de 384K tokens, JSON Output, Tool Calls, Responses API et Anthropic API. La limite de concurrence de Pro est de 500, contre 2500 pour Flash.

Une longue sortie est aussi un sujet de coût

“We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.”

Cet avertissement officiel donne une lecture très pratique de la mise à jour. Une sortie de 384K peut aider pour de grands dépôts de code, des dossiers documentaires, des plans de migration et des workflows d'agents, mais elle gonfle la facture côté génération.

Pro coûte trois fois Flash

Dans la grille chinoise, V4 Pro coûte 0,025 yuan par 1M tokens d'entrée avec cache, 3 yuans sans cache et 6 yuans en sortie. V4 Flash coûte 0,02, 1 et 2 yuans. L'entrée sans cache et la sortie sont donc trois fois plus chères avec Pro.

Hugging Face et OpenRouter décrivent V4 Pro comme un modèle MoE de 1,6T paramètres au total, 49B actifs et 1M tokens de contexte. C'est un niveau haut de gamme, à réserver aux tâches longues ou complexes.

Les prochains signaux seront un rapport dédié à V4 Pro-0813, des benchmarks tiers séparés de Preview et Flash 0731, et l'effet de la hausse tarifaire sur l'avantage coût du long contexte.

Sources : documentation modèles et tarifs de DeepSeek API, changelog DeepSeek API, Chao News, carte modèle Hugging Face DeepSeek-V4-Pro, CocoLoop, OpenRouter ; vérification de la version DeepSeek-V4-Pro-0813, contexte 1M, sortie maximale 384K, périmètres tarifaires RMB et USD, limites de concurrence, prix comparés de V4 Flash, 1,6T paramètres au total et 49B actifs.