No primeiro dia em que o GLM-5.3-Flash encerrou a oferta gratuita e passou para o modelo pago, o DeepSeek já havia retomado o primeiro lugar no uso diário do OpenCode. A informação vem da conta oficial do OpenCode, que na mesma mensagem destacou outro nome: o Muse Spark, mais abaixo na lista, foi chamado de azarão discreto.
Para entender essa mudança, é preciso primeiro olhar para a posição que o GLM ocupava antes.
Até onde o período gratuito inflou o ranking
Em 26 de agosto, a Zhipu AI lançou oficialmente o GLM-5.3-Flash e, ao mesmo tempo, revelou que ele era o modelo até então anônimo ox-alpha, que já rodava no OpenCode e no OpenRouter. Durante esse período de teste anônimo, o modelo era gratuito para os desenvolvedores e rapidamente se tornou o mais usado da semana.
O ranking acumulado público do OpenCode (janela de medição de 4 de julho a 28 de agosto) mostra bem o deslocamento causado por essa oferta gratuita:
| Modelo | Fornecedor | Tokens acumulados | Variação |
|---|---|---|---|
| glm-5.3-flash | Zhipu AI | 41T | +881% |
| deepseek-v4-flash | DeepSeek | 17T | -75% |
| mimo-v2.5 | Xiaomi | 11T | -2% |
| muse-spark-1.2-contributor | Meta | 9.5T | +180% |
| hy3 | Tencent | 3.2T | +111% |
Uma alta de 881% de um lado e uma queda de 75% do outro — as duas curvas têm formatos que se encaixam: o mesmo grupo de desenvolvedores sensíveis a orçamento se deslocou em bloco nas semanas em que a cota gratuita apareceu.
Fazendo as contas com base no preço promocional: 41 trilhões de tokens, cobrados ao preço promocional de entrada de US$ 0,075 por milhão de tokens, dariam aproximadamente US$ 3,07 milhões. Esse é o valor que a Zhipu AI deixou de receber nesse período — e também o preço que pagou por essa exposição no topo do ranking. Pelos padrões de gasto de marketing dos grandes modelos chineses de ponta, três milhões de dólares para conquistar a atenção dos desenvolvedores por um mês inteiro não é caro.
A guerra de preços ainda não terminou
O preço padrão do GLM-5.3-Flash é de US$ 0,15 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída; durante a promoção, esse valor cai pela metade, para US$ 0,075 na entrada e US$ 0,25 na saída, válido até as 24h de 9 de setembro (UTC+8). Como referência, o GLM-5.3 custa US$ 1,4 na entrada e US$ 4,4 na saída — o Flash fica em cerca de um décimo desse valor.
Em termos de especificações, o GLM-5.3-Flash é um modelo multimodal nativo com 320 bilhões de parâmetros totais e 18 bilhões ativados, com janela de contexto de 1 milhão de tokens; informações públicas indicam que o treinamento e a inferência rodam em chips de fabricação nacional chinesa. Nos benchmarks, a Zhipu AI divulgou 84,3 pontos no Terminal Bench 2.1 e 63,4 no DeepSWE v1.1, superando a geração anterior, o GLM-5.2, nas seis avaliações de programação e agentes.
Ou seja, a queda não significa que o produto tenha sido rejeitado. Perder o primeiro lugar no ranking diário logo no primeiro dia de cobrança é, na verdade, um teste de elasticidade de preço — quando a diferença de capacidade entre dois modelos está dentro do que os desenvolvedores toleram, a única variável de decisão que resta é o custo por unidade e a cota disponível. O DeepSeek-V4-Flash já havia baixado seu preço bastante; assim que a cota gratuita do GLM acabou, os antigos usuários dele não tiveram mais motivo para continuar em outro lugar.
Como ler esse tipo de ranking
O ranking do OpenCode é calculado pelo consumo de tokens, o que tem a vantagem de refletir a carga de trabalho real, mas o custo é que qualquer distribuição gratuita infla diretamente o denominador. O mesmo problema aparece no OpenRouter — modelos anônimos, cotas de teste, descontos por tempo limitado: cada um desses fatores deixa no ranking uma subida acentuada que nada tem a ver com a capacidade real do modelo.
Para os desenvolvedores na China, a leitura mais útil é observar a curva depois do início da cobrança. O ranking durante o período gratuito só mostra quem está disposto a gastar em divulgação; o ranking após o primeiro dia pago é que começa a mostrar quem realmente foi retido. O dia 9 de setembro, quando a promoção termina e o Flash volta ao preço padrão, será a próxima janela de observação.
Fontes: página de dados públicos e conta oficial do OpenCode, nota de lançamento do GLM-5.3-Flash da Zhipu AI, CocoLoop, compilação pública de benchmarks técnicos; os tokens acumulados e a variação percentual foram retirados da janela de medição indicada na página de dados do OpenCode, e o custo é uma estimativa aproximada com base no preço promocional de entrada.