El 26 de agosto, Zhipu confirmó que Ox Alpha, que había aparecido de forma anónima en OpenRouter, es una nueva iteración de su propia serie GLM, y anunció que liberaría los pesos del modelo esa misma noche. La identidad del modelo llevaba especulándose entre desarrolladores desde el día de su lanzamiento, sin respuesta oficial alguna, hasta que el volumen de uso lo llevó a la cima de la plataforma.
Ox Alpha apareció en OpenRouter y OpenCode el 20 de agosto, con el campo de proveedor mostrando solo "stealth" y el ID de modelo stealth/ox-alpha. Ofrece una ventana de contexto de 1,04 millones de tokens, acepta entradas de texto, imagen y video, con una salida máxima de alrededor de 128.000 tokens, y era completamente gratuito durante el periodo de vista previa. Sin evento de lanzamiento, sin informe técnico, ni siquiera una línea de presentación oficial.
La huella digital reveló la identidad primero
La comunidad no esperó a que la empresa se pronunciara. Hacia el 22 de agosto, varios equipos de pruebas independientes dirigieron sus sospechas hacia Zhipu. El método consistió en enviar el mismo conjunto de prompts a Ox Alpha y a GLM-5.3, y luego comparar la tokenización: en 25 a 30 prompts distintos, el recuento de tokens de ambos coincidía casi por completo, con una diferencia constante de 75 tokens atribuible a una capa de encapsulado. El costo de codificación de las entradas de video también coincidía con el de GLM-5V-Turbo de Zhipu. Una pista aún más directa llegó de un stack trace en Java, provocado por una solicitud malformada, que reveló el nombre del paquete de la API interna de Zhipu, junto con el código de error 1214.
En su momento, estas evidencias se quedaron en el terreno de la "alta sospecha". Un investigador llegó a fijar el nivel de certeza en 0,98, pero ni Zhipu, ni OpenRouter, ni el proveedor anónimo se pronunciaron. Esta confirmación pone fin a seis días de especulación.
La vista previa gratuita dispara el uso a la cima
Lo que dio notoriedad a Ox Alpha fue el volumen de llamadas. Cuatro días después de su lanzamiento, OpenRouter señaló que su procesamiento diario se acercaba a los 6 billones de tokens; actualmente ya ocupa el primer puesto en uso de la plataforma, y reportes públicos indican un volumen más del doble que el de DeepSeek. Se espera que la vista previa gratuita dure aproximadamente una semana más, y el precio oficial aún no se ha anunciado.
Convertir la vista previa gratuita en herramienta de distribución es algo que los modelos chinos han ido dominando cada vez más en los últimos años. Dejar que los desarrolladores lo usen primero en flujos de trabajo reales, y discutir el precio después, funciona más rápido que una rueda de prensa citando benchmarks. El costo de esta estrategia también es real: con un procesamiento diario de 6 billones de tokens, incluso con una estimación conservadora de unos pocos centavos por millón de tokens, el gasto diario en inferencia ya se sitúa en el orden de los millones, lo que en una semana representa un presupuesto de adquisición de usuarios nada desdeñable. A cambio, la empresa obtiene una posición en el ranking, datos reales de uso y un grupo de desarrolladores que ya ha integrado la API en sus proyectos.
Los benchmarks hay que tomarlos con cautela
Una de las afirmaciones más difundidas al principio fue que Ox Alpha superaba a Claude Fable 5 y GPT-5.6 Sol en DeepSWE. Esa conclusión provenía de una muestra de solo 10 tareas. Más tarde, dos repeticiones independientes con el conjunto completo de 113 tareas arrojaron un resultado cercano al 63%, prácticamente empatado con GPT-5.6 Sol: sigue siendo de primer nivel, pero muy lejos de "aplastante".
Los benchmarks basados en muestras pequeñas se difunden en redes sociales mucho más rápido que las correcciones posteriores, un patrón que se ha repetido en varios lanzamientos recientes de modelos. Para quienes deben tomar decisiones técnicas, esperar a la evaluación completa y a la publicación de los pesos antes de sacar conclusiones sale mucho más barato.
Lo que viene tras la publicación de los pesos
Ahora que Zhipu ha anunciado que liberará los pesos, Ox Alpha no se quedará en ser "una API cerrada gratis durante una semana". La serie GLM ya ha optado por el código abierto en varias ocasiones anteriores; una vez públicos los pesos, los proveedores externos de inferencia suelen desplegarlo y la comunidad se encarga de la cuantización y el ajuste fino, normalmente en cuestión de días.
Para los desarrolladores del ecosistema de habla china, hay dos puntos que vale la pena seguir de cerca: primero, en qué rango se situará el precio oficial y si continuará la estrategia de precios bajos habitual de GLM; segundo, los términos de la licencia con la que se liberen los pesos, ya sea una licencia totalmente abierta de tipo Apache o una con restricciones de uso comercial. Lo primero determina si el modelo se mantendrá a largo plazo en el flujo de trabajo diario; lo segundo, si podrá entrar en el ámbito empresarial.
Fuentes: Bloomberg, OpenRouter, CocoLoop, IT Home; la longitud de contexto, el periodo de vista previa gratuita y los resultados de la repetición de DeepSWE se verificaron respectivamente según las páginas de la plataforma y pruebas públicas.