Anthropic hat am 7. Oktober Claude Haiku 5.5 vorgestellt, das erste kleine Modell der Claude-5-Generation – der vorherige Haiku blieb bei Version 4.5 stehen. Das neue Modell ist ab dem ersten Tag auf der Claude Platform verfügbar und gleichzeitig bei AWS, Google Cloud und Microsoft Azure gelistet; auch Claude Code hat es am selben Tag mit einem Update aufgenommen.
Offiziell ist die Positionierung eng gefasst: Batch-Aufgaben mit hohem Durchsatz sowie die Rolle als Subagent für größere Modelle. Im Mittelpunkt dieser Ankündigung steht der Preis.
Zwei Preisstufen, gestaffelt nach Prompt-Länge
Haiku 5.5 teilt die Preise je nach Länge eines einzelnen Prompts in zwei Stufen, mit 100.000 Token als Grenze:
| Pro Million Token | Haiku 5.5 (≤100k) | Haiku 5.5 (>100k) | Haiku 4.5 |
|---|---|---|---|
| Eingabe | 0,10 $ | 0,50 $ | 1,00 $ |
| Ausgabe | 0,50 $ | 2,50 $ | 5,00 $ |
| Cache-Lesen | 0,01 $ | 0,05 $ | 0,10 $ |
| Cache-Schreiben | 0,125 $ | 0,625 $ | 1,25 $ |
In der kurzen Stufe liegt jeder Preis bei nur einem Zehntel von Haiku 4.5, in der langen Stufe bei der Hälfte. Anthropic selbst spricht von durchschnittlich rund 75 Prozent niedrigeren Gesamtbetriebskosten.
Die Ein- und Ausgabepreise der kurzen Stufe entsprechen exakt denen von OpenAIs GPT-6 Luna, das Ende September vorgestellt wurde. Die kleinen Modelle beider Anbieter liegen preislich nun auf einer Linie.
Am selben Tag senkte Anthropic auch den Cache-Lese-Preis von Sonnet 5.5 von 0,20 auf 0,10 US-Dollar pro Million Token und schrieb Abonnenten API-Guthaben gut: Max 5x erhält 100 US-Dollar pro Monat, Max 20x 200 US-Dollar, und der Team-Plan bis zu 500 US-Dollar für das gesamte Team. Entwickler Simon Willison schrieb in seinem Blog, dass ungenutztes Guthaben am Monatsende verfällt.
Benchmarks und Reasoning-Stufen
Haiku 5.5 denkt standardmäßig in Schritten und lässt sich nicht abschalten; wählbar sind fünf Stufen – low, medium, high, xhigh, max – mit medium als Standard. Laut offiziellen Zahlen erreicht das Modell 72,4 Prozent auf dem Offline-Teilset von OSWorld 2.1, 39,2 Prozent bei Terminal-Bench 4.0 und bei Humanity's Last Exam 45,9 Prozent ohne Tools beziehungsweise 57,4 Prozent mit Tools.
Einige frühe Kunden haben eigene interne Zahlen veröffentlicht. Box berichtet, das neue Modell erziele in ihren eigenen Tests 11 Punkte mehr als Haiku 4.5, bei etwa halbierter Latenz:
"Claude Haiku 5.5 scored 11 points higher than Haiku 4.5 at about half the latency."
(Claude Haiku 5.5 erzielte 11 Punkte mehr als Haiku 4.5 bei etwa halbierter Latenz.)
Asana berichtet von einer um mehr als 30 Prozent gesunkenen Latenz, HubSpot von der höchsten je in diesem Test gemessenen Punktzahl: 92,8 Prozent. All das sind selbst durchgeführte Kundentests, deren Aufgabenstellungen nicht veröffentlicht wurden.
Die Reasoning-Stufe wirkt sich stark auf die Kosten aus. Simon Willison testete denselben Prompt – 'zeichne einen Pelikan, der Fahrrad fährt' – einmal auf der niedrigsten und einmal auf der höchsten Stufe: Low kostete rund 0,0009 US-Dollar und dauerte 7 Sekunden, Max kostete rund 0,034 US-Dollar und dauerte 5 Minuten 9 Sekunden – ein Kostenunterschied von über dem 30-Fachen pro Durchlauf.
Überschlagsrechnung: Der Tokenizer frisst einen Teil der Preissenkung auf
Neben der Preistabelle gibt es eine leicht übersehene Variable. Simon Willison weist darauf hin, dass Haiku 5.5 einen neuen Tokenizer verwendet, der denselben Text in etwa das 1,25-Fache an Token gegenüber Haiku 4.5 zerlegt.
Rechnet man mit diesem Faktor grob nach, entspricht der tatsächliche Eingabepreis der kurzen Stufe 0,125 US-Dollar pro Million 'alter Token', verglichen mit 1 US-Dollar bei Haiku 4.5 – ein Rückgang von rund 87 Prozent, immer noch beträchtlich. Bei der langen Stufe sieht es weniger rosig aus: 0,50 US-Dollar mal 1,25 ergibt 0,625 US-Dollar, der Rückgang schrumpft auf etwa 37 Prozent.
Rechnet man das standardmäßig aktivierte Reasoning hinzu, fallen mehr Ausgabe-Token an als beim nicht reasoning-fähigen Haiku 4.5 – wie viel mehr, hängt von Stufe und Aufgabe ab. Für Teams mit kurzen Eingaben wie Benchmarks, Extraktion oder Routing spart der Modellwechsel praktisch direkt Geld; bei Szenarien mit langen Dokumenten und langem Kontext sollte man erst die eigene Rechnung mit echtem Traffic durchrechnen.
Bei der Sicherheit gibt Anthropic an, dass die Einschränkungen von Haiku 5.5 bei Anfragen zur Cybersicherheit zwischen denen von Haiku 4.5 und Sonnet 5.5 liegen, während die Schutzmaßnahmen im Biologie-Bereich denen der Sonnet-5-Reihe entsprechen; entsprechende Forschung erfordert eine separat zu beantragende Verifizierung.
Quellen: Anthropic-Produktseite zu Claude Haiku 5.5, Simon-Willison-Blog, CocoLoop, SiliconANGLE; die Preistabelle von Anthropic wurde für beide Stufen sowie die Cache-Preise mit Haiku 4.5 abgeglichen, die Preissenkung beim Cache-Lesen von Sonnet 5.5 folgt der offiziellen Ankündigung.