智譜在8月26日證實,先前在OpenRouter上以匿名身分出現的Ox Alpha,是自家GLM系列的最新一代迭代,並表示當晚就會釋出模型權重。這個身分從模型上線那天起就被開發者反覆猜測,官方始終沒有回應,直到用量把它推上平台榜首。
Ox Alpha於8月20日出現在OpenRouter與OpenCode,供應商欄位只寫著stealth,模型ID為stealth/ox-alpha。它支援104萬token的上下文,可接受文字、圖片與影片輸入,最大輸出約在12.8萬token上下,預覽期間完全免費。沒有發表會、沒有技術報告,甚至連一句官方介紹都沒有。
指紋先把身分挖了出來
社群沒等官方開口。8月22日前後,幾組獨立測試把矛頭指向智譜。做法是拿同一批提示詞分別餵給Ox Alpha與GLM-5.3,再比對斷詞結果:在25到30個不同提示下,兩邊的token數幾乎完全對齊,只差一個固定的75 token包裝層落差。影片輸入的編碼開銷也與智譜的GLM-5V-Turbo吻合。更直接的一條線索,來自一個格式錯誤的請求觸發的Java堆疊追蹤,裡頭出現了智譜內部API的套件名稱,附帶的錯誤碼是1214。
這些證據當時都停在「高度疑似」。有研究者把把握度標到0.98,但智譜、OpenRouter與那個匿名供應商都沒吭聲。這次證實,等於替六天的猜測畫下句點。
免費預覽把用量衝上榜首
讓Ox Alpha出圈的是用量。上線四天後,OpenRouter方面提到它單日處理量逼近6兆token;目前它已經坐上該平台用量第一,公開報導顯示用量是DeepSeek的兩倍以上。免費預覽預計還會再持續一週左右,正式定價尚未公布。
把免費預覽當成通路手段,中國模型業者這兩年愈來愈熟練。先讓開發者在真實工作流程裡用上,價格晚點再談,比開發表會念跑分見效更快。這條路的代價也很實際:以單日6兆token的處理量粗估,就算按每百萬token幾毛錢人民幣的成本計算,一天燒掉的推論開支也在百萬元人民幣等級,一週下來是一筆不算小的獲客預算。換來的是排行榜位置、真實使用數據,以及一批已經把API接進專案的開發者。
跑分要打折扣看
早期流傳最廣的一個說法,是Ox Alpha在DeepSWE上壓過Claude Fable 5與GPT-5.6 Sol。這個結論來自一個只有10項任務的樣本。後來兩次獨立的完整113項任務重跑,成績落在63%附近,與GPT-5.6 Sol大致持平——依然是第一梯隊的水準,但跟「輾壓」是兩回事。
小樣本跑分在社群平台上傳播的速度,遠比修正後的結果快,這種情形在最近幾輪模型發表裡已經反覆出現。對要做技術選型的人來說,等完整評測與權重開源後再下判斷,成本要低得多。
權重釋出之後
智譜說要放權重,Ox Alpha就不會停在「能白用一週的閉源API」這一步。GLM系列先前多次走開源路線,模型權重公開後,第三方推論服務商跟進部署、社群做量化與微調,通常是幾天之內的事。
對中文圈開發者來說,這條線值得盯的有兩件事:一是正式定價會落在什麼區間,能不能延續GLM一貫的低價策略;二是權重開放的授權條款——是完全的Apache類授權,還是帶商用限制。前者決定它能不能長期留在日常工作流裡,後者決定它能不能打進企業市場。
參考來源:彭博社、OpenRouter、CocoLoop、IT之家;上下文長度、免費預覽週期與DeepSWE重跑成績分別按平台頁面與公開測試口徑核實。