Le premier jour où GLM-5.3-Flash a mis fin à son offre gratuite pour passer au payant, DeepSeek avait déjà repris la première place en usage quotidien sur OpenCode. Cette information provient du compte officiel d'OpenCode, qui a mis en avant un autre nom dans le même message : Muse Spark, plus bas dans le classement, y est qualifié d'outsider discret.
Pour comprendre ce basculement, il faut d'abord revoir la position qu'occupait GLM auparavant.
Jusqu'où la période gratuite a gonflé le classement
Le 26 août, Zhipu AI a officiellement lancé GLM-5.3-Flash, révélant du même coup qu'il s'agissait du modèle jusque-là anonyme ox-alpha, déjà en test sur OpenCode et OpenRouter. Pendant cette phase de test anonyme, le modèle était gratuit pour les développeurs et est rapidement devenu le plus utilisé de la semaine.
Le classement cumulé public d'OpenCode (fenêtre de mesure du 4 juillet au 28 août) rend bien visible le déplacement provoqué par cette offre gratuite :
| Modèle | Fournisseur | Tokens cumulés | Variation |
|---|---|---|---|
| glm-5.3-flash | Zhipu AI | 41T | +881% |
| deepseek-v4-flash | DeepSeek | 17T | -75% |
| mimo-v2.5 | Xiaomi | 11T | -2% |
| muse-spark-1.2-contributor | Meta | 9.5T | +180% |
| hy3 | Tencent | 3.2T | +111% |
Une hausse de 881 % d'un côté, une baisse de 75 % de l'autre — les deux courbes se répondent : le même groupe de développeurs sensibles au budget s'est déplacé en bloc pendant les semaines où le quota gratuit est apparu.
En recalculant à partir du tarif promotionnel : 41 000 milliards de tokens facturés au tarif d'entrée promotionnel de 0,075 dollar par million de tokens représentent environ 3,07 millions de dollars. C'est la somme que Zhipu AI n'a pas encaissée durant cette période, et c'est aussi le prix payé pour cette exposition en tête de classement. Rapporté aux dépenses marketing habituelles des grands modèles chinois de premier plan, trois millions de dollars pour capter l'attention des développeurs pendant un mois entier n'a rien d'excessif.
La guerre des prix n'est pas terminée
Le tarif standard de GLM-5.3-Flash est de 0,15 dollar par million de tokens en entrée et 0,50 dollar en sortie ; pendant la promotion, ce tarif est encore réduit de moitié, à 0,075 dollar en entrée et 0,25 dollar en sortie, jusqu'au 9 septembre à 24h00 (UTC+8). À titre de comparaison, GLM-5.3 coûte 1,4 dollar en entrée et 4,4 dollars en sortie — Flash revient donc à environ un dixième de ce prix.
Côté spécifications, GLM-5.3-Flash est un modèle multimodal natif de 320 milliards de paramètres au total, dont 18 milliards activés, avec une fenêtre de contexte d'un million de tokens ; selon les informations publiques, l'entraînement et l'inférence tournent sur des puces fabriquées en Chine. Côté benchmarks, Zhipu AI annonce un score de 84,3 sur Terminal Bench 2.1 et de 63,4 sur DeepSWE v1.1, dépassant la génération précédente GLM-5.2 sur les six évaluations de programmation et d'agents.
Ce reflux ne signifie donc pas un rejet du produit. Perdre la première place du classement quotidien dès le premier jour de facturation est avant tout un test d'élasticité-prix : lorsque l'écart de capacités entre deux modèles reste dans une fourchette tolérable pour les développeurs, la seule variable de décision qui subsiste est le coût unitaire et le quota disponible. DeepSeek-V4-Flash avait déjà ramené son prix à un niveau très bas ; dès que le quota gratuit de GLM a disparu, ses anciens utilisateurs n'avaient plus de raison de rester ailleurs.
Comment lire ce type de classement
Le classement d'OpenCode se calcule sur la consommation de tokens, ce qui a l'avantage de coller à la charge de travail réelle, mais l'inconvénient est que toute distribution gratuite gonfle directement le dénominateur. Le même problème se retrouve sur OpenRouter : modèles anonymes, quotas d'essai, remises limitées dans le temps — chacun de ces éléments laisse dans le classement une pente abrupte qui n'a rien à voir avec les capacités réelles du modèle.
Pour les développeurs en Chine, la lecture la plus utile consiste à observer la courbe après le passage au payant. Le classement pendant la période gratuite montre seulement qui est prêt à dépenser pour se faire connaître ; celui qui suit le premier jour payant commence, lui, à montrer qui a vraiment su retenir ses utilisateurs. Le 9 septembre, quand la promotion prendra fin et que Flash reviendra à son tarif standard, sera la prochaine fenêtre d'observation.
Sources : page de données publiques et compte officiel d'OpenCode, communiqué de lancement de GLM-5.3-Flash par Zhipu AI, CocoLoop, compilation publique d'évaluations techniques ; les tokens cumulés et la variation proviennent de la fenêtre de mesure indiquée sur la page de données d'OpenCode, le coût étant une estimation approximative basée sur le tarif d'entrée promotionnel.