Im 200-Dollar-Tarif: Claude-Kontingent rund 5x so viel wie OpenAI

Das Halbleiter- und KI-Analysehaus SemiAnalysis hat am 5. Oktober einen Praxistest zu Abo-Kontingenten veröffentlicht, dessen Fazit unmissverständlich ausfällt: Im 200-Dollar-Monatstarif ist bei Agenten-Workloads mit Modellen der mittleren Leistungsklasse der auf API-Preise umgerechnete Gegenwert eines Anthropic-Abos mehr als 5-mal so hoch wie bei OpenAI. Verglichen wurden Claude Opus 5.5 und GPT-6.1 Sol.

Der Report trägt die Autorennamen Andrew Megalaa, Max Kan und Dylan Patel. Getestet wurden Abos von Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Z.ai sowie den beiden Wrapper-Produkten Cursor und Cognition.

Wie das Kontingent gemessen wurde

Beide Anbieter legen nicht offen, wie viele Token ein Abo-Kontingent tatsächlich umfasst, sondern zeigen nur eine prozentuale Nutzungsanzeige plus zwei Rate-Limit-Fenster von 5 Stunden und 7 Tagen. SemiAnalysis hat daraus zurückgerechnet: Eingabe-, Cache-Schreib-, Cache-Lese- und Ausgabe-Token wurden getrennt gemessen, um zu bestimmen, wie stark jede Token-Art die Nutzungsanzeige bewegt. Aus den Ständen in beiden Zeitfenstern wurde dann die monatlich verfügbare Gesamt-Token-Menge errechnet und zum offiziellen API-Preis in Dollar umgerechnet.

Laut Implicator fütterte das Team zahlungspflichtige Accounts abschnittsweise mit "Krieg und Frieden": Mit zufälligen Tags wurde komplett neue Eingabe erzeugt, mit festen Tags die Cache-Trefferquote gemessen, mit langen Fachtexten lange Ausgaben erzwungen - wiederholt, bis die Abweichung auf unter plusminus 5 Prozent sank.

Beide Anbieter drehen gerade in entgegengesetzte Richtungen

Der Test fiel genau in eine Phase, in der beide Seiten ihre Tarife anpassten.

OpenAI hat am 30. September den 200-Dollar-Pro-Tarif neu aufgelegt und zugleich auf eine Umrechnung des Kontingents nach API-Ausgaben umgestellt. Codex-Chef Thibault Sottiaux sagte dazu:

"If you do the math, it will net out at half the dollar in API spend compared to the old Pro $200 plan."
(Rechnet man es durch, entspricht das nur noch der Hälfte des API-Gegenwerts des alten 200-Dollar-Pro-Tarifs.)

Laut den von SemiAnalysis zitierten Details sank das Kontingent dieser Stufe in Codex und Work vom 20-Fachen des Plus-Tarifs auf das 10-Fache, dazu kam oben ein neuer 500-Dollar-Pro-Tarif. Der Report beschreibt OpenAIs Vorgehen als direkten Schnitt der Limits über alle Stufen hinweg.

Anthropic geht den umgekehrten Weg: Die API-Preise für Ein- und Ausgabe von Opus 5.5 sanken um 20 Prozent, Cache-Lesezugriffe um 60 Prozent, während das Opus-Kontingent im Max-Tarif um rund 20 Prozent und im Pro-Tarif um rund 50 Prozent angehoben wurde. Laut der Analyse im Report zieht Anthropic die Gewinnspanne eher dadurch an, dass der Verbrauch des Flaggschiffmodells Fable gegenüber Opus relativ verteuert wird, statt das Gesamtkontingent zu kürzen.

Deshalb zeigt sich der Faktor "5" vor allem bei Modellen der mittleren Klasse. Bei den Flaggschiffen hält SemiAnalysis den Unterschied zwischen Fable 5.1 und GPT-6 Astra für gering.

Eine grobe Kostenrechnung fürs Abo

Der Report liefert ein Zahlenpaar, das die Sache greifbarer macht: Abos machen bei Anthropic nur rund 10 Prozent des Umsatzes aus, verschlingen aber möglicherweise mehr als 40 Prozent der Inferenz-Rechenleistung.

Rechnet man diese beiden Anteile grob gegeneinander: Jede Einheit Rechenleistung, die Abos beanspruchen, bringt rund 0,25 Einheiten Umsatz; jede Einheit, die API und übriges Geschäft beanspruchen, bringt rund 1,5 Einheiten Umsatz. Das ist ein Unterschied um den Faktor 6. Das ist nur eine vereinfachte Rechnung auf Basis der im Report genannten Anteile, ohne Cache-Treffer oder Lastverteilung zwischen Spitzen- und Schwachlastzeiten zu berücksichtigen, und Anthropic hat seine eigene Kalkulation nie veröffentlicht.

Diese Lücke erklärt zweierlei: warum OpenAI selbst das Risiko abwandernder Nutzer in Kauf nimmt, um Kontingente zu kürzen, und warum Anthropic das Opus-Kontingent anhebt und gleichzeitig den Verbrauchsfaktor von Fable erhöht. Für Entwickler, die Claude Code intensiv nutzen, lohnt sich das Abo derzeit deutlich mehr als Pay-per-Use - wie lange das so bleibt, hängt davon ab, wie lange Anthropic bereit ist, draufzuzahlen.

Was hinter der Bezahlschranke steckt

Der öffentlich zugängliche Teil des Reports endet beim Abschnitt "Abos über Drittanbieter-Wrapper schneiden schlechter ab als offizielle Abos" und verschwindet dann hinter der Paywall; wie groß der Unterschied bei Produkten wie Cursor oder Devin genau ist, nennt die öffentliche Fassung nicht. Wie die Abos chinesischer Anbieter wie MiniMax, Moonshot und Z.ai abgeschnitten haben, wird zudem von verschiedenen Medien uneinheitlich wiedergegeben und bleibt hier daher unzitiert.

Zu beachten ist, dass solche Praxistests von der Anzeigegenauigkeit der Nutzungsanzeigen abhängen, die Anbieter ihre Zählweise im Hintergrund jederzeit ändern können. Weder Anthropic noch OpenAI haben sich bislang öffentlich zu den Schlussfolgerungen des Reports geäußert.

Quellen: SemiAnalysis-Praxistest zu Abo-Kontingenten, Techmeme, CocoLoop, AI Weekly, Implicator; der Faktor "5" bezieht sich auf den API-Gegenwert von Opus 5.5 gegenüber GPT-6.1 Sol im 200-Dollar-Tarif, die Anteile von Rechenleistung und Umsatz sind Schätzungen von SemiAnalysis.