Die Preview von V4-Pro wurde am frühen Freitagmorgen letzter Woche veröffentlicht.
Heute Morgen hat DeepSeek im API-Dashboard eine Ankündigung veröffentlicht: 75 Prozent Rabatt auf V4-Pro, direkt gültig bis zum 5. Mai. Gleichzeitig wurde der Preis für eingehende Cache-Treffer der gesamten API auf ein Zehntel des ursprünglichen Preises gesenkt.
Zwischen Veröffentlichung und der drastischen Preissenkung lagen weniger als 72 Stunden.
Die Zahlen auf einen Blick
Originalpreise von DeepSeek-V4-Pro:
| Posten | Originalpreis (pro 1 Mio. Tokens) |
|---|---|
| Eingabe | $0,145 |
| Ausgabe | $3,48 |
| Cache-Treffer | 0,025 Yuan/Mio. Tokens (bereits reduziert, 1/10 des Originalpreises) |
Während der Aktionszeit liegt der Eingabepreis von V4-Pro direkt bei etwa $0,036/Mio. Tokens, günstiger als jeder andere – dieser Preis ist so niedrig, dass viele vermuten, es werde mit Verlust gearbeitet, um Nutzerzahlen zu steigern.
Ein horizontaler Vergleich mit den Listenpreisen aktueller proprietärer Flaggschiffmodelle:
- GPT-5.5: Standardversion $1,5/Mio. Eingabe, $10/Mio. Ausgabe
- Gemini 3.1 Pro: Etwa $1,25/Mio. Eingabe, $10/Mio. Ausgabe
- Claude Opus 4.7: $15/Mio. Eingabe, $75/Mio. Ausgabe
Das bedeutet, der Originalpreis von V4-Pro hat GPT-5.5 bereits auf unter ein Zehntel und Claude Opus 4.7 auf unter ein Hundertstel gedrückt. Mit zusätzlichen 75 Prozent Rabatt wird der Abstand noch größer.
Der eigentliche Schlag sitzt beim Cache
Betrachtet man nur den Token-Stückpreis von V4-Pro, ist er bereits günstig. Doch der härtere Schlag ist, dass DeepSeek den Preis für eingehende Cache-Treffer der gesamten API-Produktlinie auf ein Zehntel des ursprünglichen Preises gesenkt hat.
Wofür wird der Cache-Treffer-Preis verwendet:
- Agentenartige Anwendungen, die immer wieder dasselbe System-Prompt ausführen – große Teile des Inhalts sind wiederholt
- In RAG-Szenarien wird häufig derselbe Kontext an das Modell übergeben
- In mehrrundigen Dialogen werden historische Nachrichten wiederholt gesendet
In diesen Szenarien ist der Cache-Treffer-Preis der tatsächliche Hauptkostenpunkt für Unternehmensnutzer. Eine Reduzierung um 90 Prozent bedeutet – die Kostenbarriere für Entwickler, von GPT und Claude zu DeepSeek zu wechseln, wird nahezu eingeebnet.
Warum gerade jetzt dieser Schritt
Nach der Veröffentlichung der V4-Pro-Preview am frühen Freitagmorgen (24. April) war die Marktreaktion etwas verhalten. Die Schlagzeile von Bloomberg an diesem Tag lautete "DeepSeeks lang erwartetes neues Modell kann den US-Vorsprung in KI nicht verringern" – "konnte die Lücke zu den USA nicht schließen". Fortune sagte, V4-Pro liege bei weltweiten Wissensbenchmarks noch hinter Gemini 3.1 Pro.
Einfach gesagt: Technisch hat man keinen Abstand geschaffen, aber preislich kann man noch kämpfen.
DeepSeeks Schachzug ist klar – da man kurzfristig nicht frontal mit GPT-5.5 und Claude Opus in Bezug auf Spitzenfähigkeiten konkurrieren kann, geht man einen anderen Weg: die Migrationskosten für Entwickler auf ein nicht ignorierbares Niveau drücken. Ein kostenloses Modell anzubieten ist nicht ungewöhnlich, aber eine Preissenkung um 75 Prozent nur 72 Stunden nach der Veröffentlichung ist eine Haltung – sie sagt allen noch zögernden Entwicklern: Ich spare dir die Kosten für den Wechsel.
Wer in diesem Kreis bewandert ist, weiß, dass DeepSeek bei der Einführung von R1 im Januar letzten Jahres das gleiche Rezept verwendet hat: ausreichende Leistung, überwältigender Preis. Diese Welle löste direkt den Preissenkungstrend bei chinesischen Open-Source-Modellen aus, und OpenAI, Anthropic und Google haben später mehrfach ihre Preise angepasst.
Dieses Mal scheint es das gleiche Drehbuch zu sein.
Wer hält zuerst nicht stand
Inländische Konkurrenten haben bereits reagiert. Die Aktie von MiniMax fiel im Hongkonger Handel um 9 Prozent, und das bekannte Basismodell-Unternehmen Knowledge Atlas (Zhipu) verzeichnete ebenfalls einen Rückgang in ähnlicher Höhe. Dies liegt nicht an schlechten Modellen, sondern daran, dass ihr Preisspielraum durch den Aktionspreis von V4-Pro direkt zusammengedrückt wurde.
Auf den Punkt gebracht: Willst du heute noch dein heimisches Modell für $1/Mio. Tokens verkaufen? Entwickler öffnen die DeepSeek-Konsole und sehen 0,036 US-Dollar für eine Million Tokens – wie erklärst du, warum es 27 Mal teurer sein soll?
OpenAI und Anthropic werden kurzfristig wahrscheinlich nicht nachziehen. Ihre Strategie war schon immer "hoher Preis, hohe Qualität" – Kunden zahlen bereitwillig extra für Zuverlässigkeit, SLA, Compliance und Unternehmenssupport. Aber die mittlere Schicht hat es wirklich schwer:
- Mistral, Cohere – proprietäre Spieler mit mittleren Preisen
- Zhipu, MiniMax, Moonshot im Inland
- Eine Reihe kleiner Hersteller, die mit "Preis-Leistung" werben
Sie können weder behaupten, günstiger als DeepSeek zu sein, noch stärker als GPT-5.5. Dieser Druck verwischt ihre Positionierung.
Die Nebenwirkungen dieses Manövers
DeepSeeks Vorgehen hat einen offensichtlichen Preis: Die Bruttomarge könnte negativ sein.
V4-Pro ist ein MoE-Modell mit 1,6 Billionen Parametern, das bei jeder Inferenz 49 Milliarden Parameter aktiviert. Bei dieser Größe, die auf Huawei Ascend 950PR läuft, werden die Grenzkosten pro Token nicht viel höher sein als bei Gemini Flash oder GPT-5.4-Nano – aber im Vergleich zum Aktionspreis ist es fast sicher ein Verlustgeschäft.
Warum also trotzdem? Die Antwort ist wahrscheinlich – DeepSeek behandelt "Nutzerzahlen" und "Nutzungshäufigkeit" als Kernkennzahlen für die nächste Finanzierungsrunde und den Börsengang. Vor einigen Tagen gab es Berichte, dass Liang Wenfeng begonnen hat, mit externen Investoren zu sprechen – das erste Mal nach drei Jahren, dass er sich nach der Ablehnung von VC öffnet. Die Modellqualität hat die zweite Stufe erreicht, die nächste Geschichte muss sich um "Entwicklermarktanteil" drehen.
Billig allein ist keine Barriere. Billig + ausreichende Qualität + offene Gewichte + stabiler API ist es. Wenn die Downloads von V4-Pro auf Hugging Face und die tatsächlichen API-Aufrufe im nächsten Monat weiter explodieren, hat sich dieser Schachzug gelohnt.
Und ob andere nachziehen? Vor Juni sollte es eine Antwort geben.
Quellenangabe: DeepSeek Slashes Fees for New AI Model in Chinese Price War (Bloomberg); DeepSeek slashes AI model costs, reignites price war in sector (Investing.com / Reuters); DeepSeek V4-Pro Price Cut: 75% (TheNextWeb); China's DeepSeek Slashes AI Prices With 75% Discount on V4-Pro Model (Republic World); CocoLoop, DeepSeek's Long-Awaited New Model Fails to Narrow US Lead in AI (Bloomberg)