Am ersten Tag, an dem GLM-5.3-Flash sein kostenloses Angebot beendete und ins Bezahlmodell wechselte, übernahm DeepSeek beim täglichen Nutzungsvolumen auf OpenCode wieder den ersten Platz. Diese Angabe stammt vom offiziellen OpenCode-Account, der in derselben Mitteilung noch einen weiteren Namen hervorhob: Muse Spark, das auf den hinteren Plätzen liegt, wurde darin als unauffälliger Außenseiter bezeichnet.
Um diese Verschiebung zu verstehen, muss man zunächst die vorherige Position von GLM betrachten.
Wie das Gratis-Fenster das Ranking aufgebläht hat
Am 26. August veröffentlichte Zhipu AI offiziell GLM-5.3-Flash und bestätigte zugleich, dass es sich dabei um das zuvor anonym auf OpenCode und OpenRouter laufende Modell ox-alpha handelte. Während dieser anonymen Testphase stand es Entwicklern kostenlos zur Verfügung und wurde binnen kurzer Zeit zum meistgenutzten Modell der Woche.
Das öffentliche Kumulativ-Ranking von OpenCode (Erfassungszeitraum 4. Juli bis 28. August) macht diese durch das Gratisangebot ausgelöste Verschiebung sichtbar:
| Modell | Anbieter | Kumulierte Token | Veränderung |
|---|---|---|---|
| glm-5.3-flash | Zhipu AI | 41T | +881% |
| deepseek-v4-flash | DeepSeek | 17T | -75% |
| mimo-v2.5 | Xiaomi | 11T | -2% |
| muse-spark-1.2-contributor | Meta | 9.5T | +180% |
| hy3 | Tencent | 3.2T | +111% |
Ein Plus von 881 Prozent auf der einen, ein Minus von 75 Prozent auf der anderen Seite – die Form der beiden Kurven passt zusammen: Dieselbe budgetsensible Entwicklergruppe ist in den Wochen, in denen das Gratis-Kontingent auftauchte, insgesamt umgezogen.
Rechnet man anhand des Aktionspreises zurück: 41 Billionen Token zum Aktions-Eingabepreis von 0,075 US-Dollar pro Million Token ergeben grob gerechnet rund 3,07 Millionen US-Dollar. So viel Geld hat Zhipu AI in diesem Zeitraum nicht eingenommen – und genau das ist der Preis, den das Unternehmen für diese Spitzenposition und die damit verbundene Aufmerksamkeit bezahlt hat. Gemessen an den Marketingausgaben führender chinesischer Großmodell-Anbieter sind drei Millionen US-Dollar für einen ganzen Monat Entwickler-Mindshare nicht teuer.
Das Preispoker ist noch nicht zu Ende
Der Standardpreis von GLM-5.3-Flash liegt bei 0,15 US-Dollar pro Million Eingabe-Token und 0,50 US-Dollar pro Million Ausgabe-Token; während der Aktion wird dieser Preis noch einmal halbiert auf 0,075 US-Dollar Eingabe und 0,25 US-Dollar Ausgabe, gültig bis 9. September, 24:00 Uhr (UTC+8). Zum Vergleich: GLM-5.3 kostet 1,4 US-Dollar Eingabe und 4,4 US-Dollar Ausgabe – Flash liegt damit bei etwa einem Zehntel davon.
Technisch gesehen ist GLM-5.3-Flash ein nativ multimodales Modell mit 320 Milliarden Gesamtparametern, davon 18 Milliarden aktiv, sowie einem Kontextfenster von 1 Million Token; laut öffentlichen Angaben laufen Training und Inferenz auf inländisch produzierten Chips. Bei den Benchmarks nennt Zhipu AI einen Wert von 84,3 im Terminal Bench 2.1 und 63,4 im DeepSWE v1.1 – in allen sechs Programmier- und Agenten-Benchmarks übertrifft das Modell die Vorgängergeneration GLM-5.2.
Der Rückgang bedeutet also nicht, dass das Produkt an sich abgelehnt wird. Der Verlust des ersten Platzes im Tagesranking direkt am ersten Bezahltag testet vor allem die Preiselastizität: Liegt der Fähigkeitsunterschied zwischen zwei Modellen in einem für Entwickler tolerierbaren Bereich, bleiben als Entscheidungsvariablen nur noch Kosten pro Einheit und Kontingent. DeepSeek-V4-Flash hatte seinen Preis bereits sehr niedrig angesetzt; sobald das Gratis-Kontingent von GLM wegfiel, hatten dessen ursprüngliche Nutzer keinen Grund mehr, anderswo zu bleiben.
Wie man solche Ranglisten lesen sollte
Das OpenCode-Ranking wird nach Token-Verbrauch berechnet – der Vorteil liegt darin, dass es nah an der realen Arbeitslast ist, der Nachteil, dass jede Gratisaktion den Nenner direkt aufbläht. Dasselbe Problem zeigt sich auch bei OpenRouter: anonyme Modelle, Testkontingente, zeitlich begrenzte Rabatte – jeder dieser Faktoren hinterlässt im Ranking einen steilen Anstieg, der nichts mit der eigentlichen Modellfähigkeit zu tun hat.
Für Entwickler in China liegt der aussagekräftigere Blick auf der Linie nach dem Start der Bezahlpflicht. Das Ranking während der Gratisphase zeigt lediglich, wer bereit ist, Geld in die Werbung zu stecken; erst das Ranking nach dem ersten Bezahltag zeigt, wer tatsächlich gehalten werden konnte. Der 9. September, wenn die Aktion endet und Flash zum Standardpreis zurückkehrt, ist das nächste Beobachtungsfenster.
Quellen: Öffentliche Datenseite und offizieller Account von OpenCode, Veröffentlichungshinweise von Zhipu AI zu GLM-5.3-Flash, CocoLoop, öffentlich zugängliche technische Benchmark-Zusammenstellungen; kumulierte Token-Werte und Veränderungsraten stammen aus dem auf der OpenCode-Datenseite angegebenen Erfassungszeitraum, die Kostenangabe ist eine grobe Schätzung auf Basis des Aktions-Eingabepreises.