El primer día en que GLM-5.3-Flash puso fin a su oferta gratuita y pasó al modelo de pago, DeepSeek ya había recuperado el primer puesto en el uso diario de OpenCode. Este dato proviene de la cuenta oficial de OpenCode, que en el mismo mensaje mencionó otro nombre: Muse Spark, que aparece más abajo en la lista, fue calificado como un caballo negro discreto.
Para entender este cambio, primero hay que ver qué posición ocupaba GLM antes.
Hasta dónde infló la clasificación el periodo gratuito
El 26 de agosto, Zhipu AI lanzó oficialmente GLM-5.3-Flash y, al mismo tiempo, confirmó que se trataba del modelo hasta entonces anónimo ox-alpha, que ya circulaba en OpenCode y OpenRouter. Durante ese periodo de pruebas anónimas, el modelo era gratuito para los desarrolladores y rápidamente se convirtió en el más utilizado de la semana.
La clasificación acumulada pública de OpenCode (ventana de medición del 4 de julio al 28 de agosto) deja ver con claridad el desplazamiento que provocó esta oferta gratuita:
| Modelo | Proveedor | Tokens acumulados | Variación |
|---|---|---|---|
| glm-5.3-flash | Zhipu AI | 41T | +881% |
| deepseek-v4-flash | DeepSeek | 17T | -75% |
| mimo-v2.5 | Xiaomi | 11T | -2% |
| muse-spark-1.2-contributor | Meta | 9.5T | +180% |
| hy3 | Tencent | 3.2T | +111% |
Una subida del 881% por un lado y una caída del 75% por el otro: las dos curvas encajan en forma, señal de que el mismo grupo de desarrolladores sensibles al presupuesto se desplazó en bloque durante las semanas en que apareció la cuota gratuita.
Haciendo el cálculo inverso con el precio promocional: 41 billones de tokens facturados al precio promocional de entrada de 0,075 dólares por millón de tokens equivaldrían aproximadamente a 3,07 millones de dólares. Ese es el dinero que Zhipu AI dejó de cobrar durante esta ventana, y también el precio que pagó por esa exposición en la cima de la clasificación. Medido con los estándares de gasto en marketing de los grandes modelos chinos de primera línea, tres millones de dólares por conquistar la atención de los desarrolladores durante un mes entero no resulta caro.
La partida de precios todavía no ha terminado
El precio estándar de GLM-5.3-Flash es de 0,15 dólares por millón de tokens de entrada y 0,50 dólares por millón de tokens de salida; durante la promoción, ese precio se reduce a la mitad, quedando en 0,075 dólares de entrada y 0,25 dólares de salida, vigente hasta las 24:00 horas del 9 de septiembre (UTC+8). Como referencia, GLM-5.3 cuesta 1,4 dólares de entrada y 4,4 dólares de salida, por lo que Flash equivale aproximadamente a una décima parte de ese precio.
En cuanto a especificaciones, GLM-5.3-Flash es un modelo multimodal nativo con 320.000 millones de parámetros totales y 18.000 millones activos, con una ventana de contexto de 1 millón de tokens; según información pública, el entrenamiento y la inferencia se ejecutan en chips de fabricación nacional china. En cuanto a los benchmarks, Zhipu AI reporta 84,3 puntos en Terminal Bench 2.1 y 63,4 en DeepSWE v1.1, superando a la generación anterior, GLM-5.2, en las seis evaluaciones de programación y agentes.
Así que este reflujo no equivale a un rechazo del producto. Perder el primer puesto en la clasificación diaria justo el primer día de pago es, en realidad, una prueba de elasticidad de precio: cuando la diferencia de capacidad entre dos modelos cae dentro de un rango que los desarrolladores pueden tolerar, la única variable de decisión que queda es el costo por unidad y la cuota disponible. DeepSeek-V4-Flash ya había bajado su precio a un nivel muy reducido, así que en cuanto se retiró la cuota gratuita de GLM, sus antiguos usuarios ya no tenían motivo para quedarse en otro lugar.
Cómo leer este tipo de clasificaciones
La clasificación de OpenCode se calcula según el consumo de tokens, lo que tiene la ventaja de reflejar de cerca la carga de trabajo real, pero el costo es que cualquier distribución gratuita infla directamente el denominador. El mismo problema aparece en OpenRouter: modelos anónimos, cuotas de prueba, descuentos por tiempo limitado; cada uno de estos factores deja en la clasificación una pendiente pronunciada que nada tiene que ver con la capacidad real del modelo.
Para los desarrolladores en China, la lectura más útil es observar la curva después del inicio del cobro. La clasificación durante el periodo gratuito solo muestra quién está dispuesto a gastar en promoción; la clasificación tras el primer día de pago es la que empieza a mostrar quién realmente logró retener usuarios. El 9 de septiembre, cuando termine la promoción y Flash vuelva al precio estándar, será la próxima ventana de observación.
Fuentes: página de datos públicos y cuenta oficial de OpenCode, nota de lanzamiento de GLM-5.3-Flash de Zhipu AI, CocoLoop, recopilación pública de evaluaciones técnicas; los tokens acumulados y la variación se tomaron de la ventana de medición indicada en la página de datos de OpenCode, y el costo es un cálculo aproximado basado en el precio promocional de entrada.