Claude Opus 5.5 veröffentlicht: Betriebskosten sinken um 40 %

Anthropic hat am 22. September Claude Opus 5.5 veröffentlicht, das erste Modell der Claude-5.5-Reihe. Die offizielle Positionierung lässt sich in zwei Sätzen zusammenfassen: Bei den meisten Aufgaben liegt die Leistung auf dem Niveau von Claude Fable 5.1, die gesamten Betriebskosten liegen jedoch 40 % unter denen von Opus 5.

Schlüsselt man die Preisliste auf, kostet Input 4 US-Dollar pro Million Token, Output 20 US-Dollar – beide jeweils 20 % weniger. Das Lesen aus dem Cache sinkt von 0,50 auf 0,20 US-Dollar, ein Rückgang von 60 %. Bei der Ausgabegeschwindigkeit gibt Anthropic mehr als 30 % gegenüber Opus 5 an, zusätzlich gibt es einen Fast-Modus für 8 und 40 US-Dollar mit bis zu 2,5-facher Geschwindigkeit. Das Modell ist in der Claude-Plattform-API (Modell-ID claude-opus-5-5), bei AWS, Google Cloud und Microsoft Azure verfügbar, ebenso gleichzeitig auf den Endverbraucher-Plattformen; die maximale Ausgabe pro Anfrage liegt bei 128.000 Token.

Benchmarks

Die offizielle Ankündigungsseite liefert folgenden Vergleich.

BenchmarkOpus 5.5Fable 5.1Opus 5
Terminal-Bench 4.066.4%55.8%52.3%
FrontierCode v1.154.4%50.3%48.0%
CursorBench 4.057.8%51.8%46.6%
GDPval-AA v2.11846 Elo17351708
OSWorld 2.081.8%80.7%74.0%

Der unabhängige Bewerter Artificial Analysis setzt Opus 5.5 mit einem Wert von 58 an die Spitze seines Intelligenz-Index. Claude Code wurde am selben Tag in Version 2.1.280 veröffentlicht und hat Opus 5.5 bereits als Standard-Opus-Modell festgelegt.

Die Ankündigungsseite zitiert außerdem Rückmeldungen mehrerer Testkunden: GitHub berichtet, dass für dieselben Terminal-Aufgaben weniger als halb so viele Schritte nötig sind wie bei Opus 5; Optiver gibt an, die Qualität sei mit Opus 5 vergleichbar, während sich die Zahl der Runden etwa halbiere und die Kosten um 40 bis 50 % sänken; Deloitte berichtet, dass auf der niedrigsten Denkstufe 72 % der bekannten Fehler erkannt wurden, gegenüber 56 % bei Opus 5 auf der höchsten Stufe. All diese Zahlen stammen aus Kundenaussagen, die der Hersteller auf seiner Ankündigungsseite wiedergibt, eine unabhängige Überprüfung durch Dritte liegt nicht vor.

Was Anthropic zur Sicherheit sagt

Anthropic erklärt, Opus 5.5 habe ein automatisiertes Verhaltensaudit bestanden und erreiche den bislang höchsten Alignment-Wert; Versuche, Sandbox-Grenzen zu umgehen, seien um 85 % gegenüber Opus 5 zurückgegangen. Die meisten Cybersicherheitsaufgaben werden weiterhin an Opus 4.8 weitergeleitet, das Schutzniveau im Biobereich entspricht dem von Claude Fable 5.1. Das Modell behält die Schutzmaßnahmen gegen Distillation des Denkprozesses bei, ist gemäß dem KI-Gesetz der EU mit einem Wasserzeichen versehen, und Unternehmen können sich für eine Zero-Data-Retention-Option entscheiden. Vor der Veröffentlichung waren METR und Frontier Design an der Bewertung beteiligt.

Konkrete Fehlerquoten, Ablehnungsraten und Red-Team-Einträge lassen sich erst anhand der vollständigen System Card überprüfen; die offizielle Seite selbst listet diese Zahlen nicht auf.

Im Preisvergleich desselben Tages

Am 22. September brachte auch OpenAI GPT-6 Sol und Luna heraus, deren API-Preise gegenüber der Vorgängergeneration halbiert wurden: Sol kostet 2 und 10 US-Dollar, Luna 0,10 und 0,50 US-Dollar. Im direkten Vergleich liegt der Preis von Opus 5.5 damit weiterhin beim Doppelten von Sol; Anthropic verkauft in derselben Preisklasse Punktzahl und weniger Arbeitsschritte: Laut Optiver und GitHub gleicht der Rückgang der Rundenzahl pro Aufgabe die Preislücke auf der Rechnung teilweise aus. Wie stark dieser Ausgleich ausfällt, hängt von der konkreten Aufgabenart ab, eine allgemeingültige Antwort gibt es nicht.

Auf Entwicklerseite ist bereits ein gegenteiliger Praxistest aufgetaucht. Der Tech-Blogger Simon Willison ließ Opus 5.5 in seinem Test auf der höchsten Denkstufe ein komplexes SVG erzeugen; das Modell verbrauchte alle 128.000 Output-Token, ohne die Aufgabe abzuschließen. Eine hohe Denkstufe in Kombination mit langer Ausgabe verbraucht leicht das gesamte Output-Budget – wer das Modell in automatisierte Abläufe einbindet, sollte diese Obergrenze vorher einkalkulieren.

Für Teams, die bereits Opus 5 einsetzen, entstehen Umstellungskosten vor allem an zwei Stellen: Die Modell-ID muss geändert werden, und die veränderte Ausgabegeschwindigkeit sowie Rundenzahl machen bestehende Timeout- und Retry-Parameter unpassend. Die Preissenkung macht sich bei häufig aufgerufenen Szenarien stärker bemerkbar, besonders bei den 60 % Rabatt auf das Cache-Lesen – je länger der dauerhafte System-Prompt und je dichter die Anfragen, desto größer der Einsparanteil.

Quellen: offizielle Ankündigungsseite von Anthropic, Artificial Analysis, CocoLoop, Blog von Simon Willison; die offizielle Ankündigungsseite dient als Grundlage für Preise, Benchmarks und Sicherheitsmaßnahmen.