GLM-5.3-Flash結束免費供應、轉為付費的第一天,DeepSeek就在OpenCode的每日使用量上重新奪回第一。這項訊息來自OpenCode官方帳號,同一則貼文裡還點名了另一個模型:排名在後面的Muse Spark被形容為低調的黑馬。
要看懂這次變化,得先弄清楚GLM之前的位置。
免費期間把排行榜撐成了什麼樣子
8月26日,智譜正式發表GLM-5.3-Flash,同時證實先前在OpenCode與OpenRouter上匿名測試的ox-alpha就是這款模型。那段匿名測試期間對開發者免費開放,很快成為當週使用量最大的模型。
OpenCode公開的累計排行榜(統計區間為7月4日至8月28日)清楚呈現出這波免費帶來的變化:
| 模型 | 廠商 | 累計token | 環比 |
|---|---|---|---|
| glm-5.3-flash | 智譜 | 41T | +881% |
| deepseek-v4-flash | DeepSeek | 17T | -75% |
| mimo-v2.5 | 小米 | 11T | -2% |
| muse-spark-1.2-contributor | Meta | 9.5T | +180% |
| hy3 | 騰訊 | 3.2T | +111% |
一個漲881%、一個跌75%,兩條曲線的形狀對得上——同一批對預算敏感的開發者,在免費額度出現的那幾週整批換了位置。
拿促銷價回推一筆帳:41兆token若按每百萬token輸入0.075美元的促銷價計費,粗估約合307萬美元。這是智譜在這段期間沒有收到的錢,也是它買下這份榜首曝光度所付出的代價。以中國一線大型語言模型廠商的行銷費用水準來看,三百萬美元換一整個月的開發者心智佔有率,算不上貴。
價格戰還沒打完
GLM-5.3-Flash的標準定價是每百萬token輸入0.15美元、輸出0.50美元;促銷期間再打對折,輸入0.075美元、輸出0.25美元,優惠到9月9日24時(UTC+8)為止。作為對照,GLM-5.3本身的定價是輸入1.4美元、輸出4.4美元,Flash大約只有它的十分之一。
在規格方面,GLM-5.3-Flash是總參數320B、啟用參數18B的原生多模態模型,上下文長度達100萬token,公開資訊指出訓練與推論都跑在自製晶片上。跑分部分,智譜公布Terminal Bench 2.1得84.3分、DeepSWE v1.1得63.4分,六項程式設計與代理(Agent)評測皆超越上一代GLM-5.2。
所以退潮並不等於產品被否定。收費第一天丟掉日榜冠軍,測的其實是價格彈性——當兩個模型的能力差距落在開發者能容忍的範圍內,剩下的決策變數就只剩單位成本與額度。DeepSeek-V4-Flash早已把價格壓得很低,免費額度一取消,原本那批用戶自然沒有繼續留在別處的理由。
這類排行榜該怎麼解讀
OpenCode的排名以token消耗量計算,好處是貼近真實工作負載,代價則是任何一次免費推廣都會直接把分母撐大。同樣的問題也出現在OpenRouter上——匿名模型、試用額度、限時折扣,每一項都會在排行榜上留下一段與模型實力無關的陡坡。
對中國開發者而言,更值得參考的是付費之後那條線。免費期間的排名只能說明誰捨得砸錢做推廣,付費首日之後的排名才開始說明誰真正被留了下來。9月9日促銷結束、Flash回歸標準價的那一天,會是下一個觀察點。
參考來源:OpenCode公開數據頁與官方帳號、智譜GLM-5.3-Flash發布說明、CocoLoop、公開技術評測彙整;累計token與環比取自OpenCode數據頁所示統計區間,費用為依促銷輸入價的粗估。