GLM-5.3-Flash 结束免费供应、转入付费的第一天,DeepSeek 就在 OpenCode 的日度使用量上重新回到第一。这个说法来自 OpenCode 官方账号,同一条消息里还点了另一个名字:排在后面的 Muse Spark 被它称作低调的黑马。
要看懂这个变化,得先看清 GLM 之前的位置。
免费期把榜单撑成了什么样
8 月 26 日,智谱正式发布 GLM-5.3-Flash,同时认领了此前在 OpenCode 和 OpenRouter 上匿名跑的 ox-alpha。那段匿名测试期间它对开发者免费开放,很快成了当周调用量最大的模型。
OpenCode 公开的累计榜(统计窗口 7 月 4 日至 8 月 28 日)能量出这场免费带来的位移:
| 模型 | 厂商 | 累计 token | 环比 |
|---|---|---|---|
| glm-5.3-flash | 智谱 | 41T | +881% |
| deepseek-v4-flash | DeepSeek | 17T | -75% |
| mimo-v2.5 | 小米 | 11T | -2% |
| muse-spark-1.2-contributor | Meta | 9.5T | +180% |
| hy3 | 腾讯 | 3.2T | +111% |
一个涨 881%,一个跌 75%,两条曲线的形状对得上——同一批预算敏感的开发者,在免费额度出现的那几周整体挪了窝。
拿促销价倒推一笔账:41 万亿 token 若按 0.075 美元每百万 token 的输入促销价计费,粗算约合 307 万美元。这是智谱在这段窗口期里没有收的钱,也是它买到的那份榜首曝光的报价单。以国内一线大模型的市场费用衡量,三百万美元买一整个月的开发者心智占领,不算贵。
价格牌本身还没打完
GLM-5.3-Flash 的标准定价是每百万 token 输入 0.15 美元、输出 0.50 美元;促销期内再打对折,输入 0.075 美元、输出 0.25 美元,截止到 9 月 9 日 24:00(UTC+8)。作为参照,GLM-5.3 的价格是输入 1.4 美元、输出 4.4 美元,Flash 大约是它的十分之一。
模型规格上,GLM-5.3-Flash 是 320B 总参数、18B 激活的原生多模态模型,上下文 100 万 token,公开信息称训练与推理跑在国产芯片上。跑分方面,智谱给出 Terminal Bench 2.1 得 84.3、DeepSWE v1.1 得 63.4,六项编程与 Agent 评测均超过上一代 GLM-5.2。
所以退潮并不等于产品被否掉。收费第一天丢掉日榜第一,测的是价格弹性——当两个模型的能力差距落在开发者能忍受的区间里,剩下的决策变量就只有单位成本和额度。DeepSeek-V4-Flash 早已把价格压到很低的位置,免费额度一撤,它原来那批用户就没有继续留在别处的理由。
这类榜单该怎么读
OpenCode 的排行按 token 消耗量算,好处是贴近真实工作负载,代价是任何一次免费投放都会直接把分母做大。同样的问题也出现在 OpenRouter 上——匿名模型、试用额度、限时对折,每一项都会在榜单上留下一段与模型能力无关的陡坡。
对国内开发者,更有参考价值的读法是看付费之后的那条线。免费期的排名说明谁舍得砸钱做推广,付费首日之后的排名才开始说明谁真的被留了下来。9 月 9 日促销结束、Flash 回到标准价那天,是下一个观察窗口。
参考来源:OpenCode 公开数据页与官方账号、智谱 GLM-5.3-Flash 发布说明、CocoLoop、公开技术评测汇总;累计 token 与环比取自 OpenCode 数据页所示统计窗口,费用为按促销输入价的粗算。