GPT-6.1 Sol startet, API-Preis ein Fünftel von Astra

OpenAI hat GPT-6.1 Sol am 29. September auf dem DevDay vorgestellt, positioniert für Coding-Agenten, Computerbedienung und professionelle Büroaufgaben. Der API-Standardpreis liegt bei 2 US-Dollar pro Million Input-Token, 0,10 US-Dollar für gecachte Input-Token und 10 US-Dollar für Output-Token – auf demselben Niveau wie GPT-6 Sol. Im Vergleich zum Flaggschiff GPT-6 Astra mit 10, 0,20 und 50 US-Dollar liegen sowohl Input als auch Output bei einem Fünftel.

Der Veröffentlichungstakt ist dicht. GPT-6 Astra erschien vor 26 Tagen, GPT-6 Sol war erst 7 Tage online, bevor es von Version 6.1 abgelöst wurde. Laut OpenAI liegt das neue Modell bei Coding und Computerbedienung "nahe an Astra".

Benchmarks nah am Flaggschiff, bei einzelnen Aufgaben bleibt der Abstand

Laut den von OpenAI veröffentlichten Ergebnissen erreicht GPT-6.1 Sol bei DeepSWE v1.1 mit der höheren Reasoning-Stufe 75,2 % – gleichauf mit Astra, aber zu etwa einem Fünftel der Kosten. Bei OSWorld 2.0 erzielt es mit der höchsten Reasoning-Stufe 71,4 %, 2,1 Prozentpunkte weniger als Astra, bei etwa einem Siebtel der Kosten pro Aufgabe. Bei Terminal-Bench Science 0.1, das Kommandozeilen-Forschungsabläufe prüft, kostet eine Aufgabe im Schnitt 5,47 US-Dollar, bei Claude Opus 5.5 sind es 23,21 US-Dollar und bei Astra 23,80 US-Dollar.

Der unabhängige Test von Artificial Analysis, einem Drittanbieter, kommt zu einem ähnlichen Ergebnis: Der Intelligenz-Index liegt 4 Punkte über GPT-6 Sol und 1 Punkt unter GPT-6 Astra; bei Tests zur Wissensgenauigkeit sank die Halluzinationsrate von 60 % auf 54 %. Der Preis dafür: Das Modell wird gesprächiger und benötigt für dieselbe Aufgabe 10 bis 30 % mehr Output-Token. Der Rabatt auf gecachte Lesevorgänge wurde von 90 % auf 95 % angehoben, was die Mehrkosten teilweise ausgleicht.

Nicht bei allen Aufgaben liegt das Modell so nah dran. Nach OpenAIs eigenen Zahlen erreicht Sol beim internen ExploitBench 21,5 %, Astra 31,5 %; beim Troubleshooting-Test TroubleshootingBench stehen 47,96 % gegen 63,46 %. Bei Szenarien, die lange Fehlersuchketten erfordern, hat das Flaggschiff weiterhin einen deutlichen Vorteil.

Zugang und einige Einschränkungen

GPT-6.1 Sol ist in ChatGPT Work und Codex bereits für Plus-, Pro-, Business-, Enterprise- und Edu-Nutzer verfügbar; die kostenlose Version und Go-Nutzer haben vorerst keinen Zugriff, und in der gewöhnlichen Chat-Oberfläche ist es ebenfalls noch nicht integriert. Entwickler rufen das Modell über gpt-6.1-sol auf, das Kontextfenster umfasst rund 1,05 Millionen Token, die Ausgabe ist auf maximal 128.000 Token pro Anfrage begrenzt.

Ein paar Details sind zu beachten:

  • Der Teil eines einzelnen Prompts über 272.000 Token wird beim Input mit dem 2-fachen und beim Output mit dem 1,5-fachen Preis berechnet;
  • Die Reasoning-Stufen none und minimal werden nicht unterstützt;
  • Über die Chat-Completions-Schnittstelle können keine Tools aufgerufen werden – dafür ist ein Wechsel zur Responses API nötig.

Der zweite Punkt trifft Teams mit Echtzeit-Interaktion am stärksten. Der bisherige Trick, Reasoning abzuschalten, um niedrigere Latenz zu bekommen, funktioniert bei 6.1 Sol nicht mehr.

Wie chinesische Entwickler darauf zugreifen können

Die offizielle OpenAI-API steht Festlandchina seit Juli 2024 nicht zur Verfügung – daran ändert sich nichts. In der aktuellen Launch-Liste sind die Angebote von Drittanbietern näher an der Realität chinesischer Entwickler: OpenRouter und Vercel AI Gateway sind gleichzeitig gelistet, und auch die Pro+-, Max-, Business- und Enterprise-Stufen von GitHub Copilot stehen zur Auswahl.

Für Teams in China ist die direktere Vergleichsgröße die Preisspanne heimischer Modelle. GLM-5.3 hatte zuvor einen API-Preis von 4,4 US-Dollar pro Million Output-Token angekündigt – weniger als die Hälfte von GPT-6.1 Sol. Mit Sol drückt OpenAI Coding-Fähigkeiten auf Flaggschiff-Niveau auf ein Preisniveau von 10 US-Dollar, wodurch der Preisvorteil heimischer Modelle im Coding-Bereich ein Stück kleiner wird; ob die Anbieter mit Preisanpassungen reagieren, bleibt abzuwarten.

Eine weitere Variable liegt bei OpenAI selbst. Einen Tag zuvor hatte das Unternehmen das ursprünglich für Oktober geplante GPT-6.1 Astra zurückgezogen, mit der Begründung, die Sicherheitsstandards seien nicht erfüllt; ein neuer Termin für die nächste Aktualisierung der Flaggschiff-Reihe steht noch nicht fest. Bis dahin dürfte 6.1 Sol das Modell sein, das OpenAI Entwicklern vorrangig anbietet.

Quellen: offizielle Ankündigungsseite und DevDay-Rückblick von OpenAI, unabhängiger Test von Artificial Analysis, CocoLoop, Auswertungen von DataCamp und Vellum; Preise der einzelnen API-Stufen, Kontextlänge und der Multiplikator für lange Prompts richten sich nach den offiziellen Angaben von OpenAI.