智谱认领Ox Alpha,用量超DeepSeek两倍

智谱在 8 月 26 日确认,此前在 OpenRouter 上匿名出现的 Ox Alpha,是自家 GLM 系列的新一轮迭代,并表示当晚会把模型权重放出来。这个身份从模型上线那天起就被开发者反复猜,官方一直没接话,直到用量把它顶上平台榜首。

Ox Alpha 于 8 月 20 日出现在 OpenRouter 和 OpenCode,供应商一栏只写着 stealth,模型 ID 是 stealth/ox-alpha。它开放 104 万 token 上下文,接受文字、图片和视频输入,最大输出在 12.8 万 token 上下,预览期完全免费。没有发布会,没有技术报告,甚至没有一句官方介绍。

指纹先把身份挖了出来

社区没等官方开口。8 月 22 日前后,几组独立测试把矛头对准了智谱。做法是拿同一批提示词分别喂给 Ox Alpha 和 GLM-5.3,再比对分词结果:25 到 30 个不同提示下,两边 token 数几乎完全对齐,只差一个恒定的 75 token 包装层偏差。视频输入的编码开销也和智谱的 GLM-5V-Turbo 对得上。更直接的一条线索来自一个畸形请求触发的 Java 堆栈跟踪,里面出现了智谱内部 API 的包名,附带的错误码是 1214。

这些证据当时都停在”高度疑似”。有研究者把把握度标到 0.98,但智谱、OpenRouter 和那个匿名供应商都没吭声。这次确认,等于给六天的猜测收了尾。

免费预览把用量顶到榜首

让 Ox Alpha 出圈的是调用量。上线四天后,OpenRouter 方面提到它当日处理量逼近 6 万亿 token;目前它已经坐上该平台用量第一,公开报道显示用量是 DeepSeek 的两倍以上。免费预览预计还会持续一周左右,正式定价没公布。

把免费预览做成分发手段,国产模型这两年越来越熟练。先让开发者在真实工作流里用上,再谈价格,比开发布会念跑分见效快。这条路的代价也很实在:按 6 万亿 token 的日处理量粗算,即便照每百万 token 几毛钱的成本口径估,一天烧掉的推理开支也在百万元级别,一周下来是一笔不算小的获客预算。这笔钱换来的是排行榜位置、真实使用数据,以及一批已经把 API 接进项目的开发者。

跑分要打个折看

早期流传最广的一条说法是 Ox Alpha 在 DeepSWE 上压过 Claude Fable 5 和 GPT-5.6 Sol。这个结论来自一个 10 任务的样本。后来两次独立的完整 113 任务复跑,成绩落在 63% 附近,和 GPT-5.6 Sol 大致持平——依然是第一梯队的水平,跟”碾压”却是两回事。

小样本跑分在社交平台上传播得远比修正结果快,这在最近几轮模型发布里已经反复出现。对要做技术选型的人来说,等完整评测和权重开源之后再下判断,成本要低得多。

权重放出来之后

智谱说要放权重,Ox Alpha 就不会停在”能白用一周的闭源 API”。GLM 系列此前多次走开源路线,模型权重公开后,第三方推理服务商跟进部署、社区做量化和微调,通常是几天之内的事。

对中文开发者来说,这条线值得盯的是两件事:一是正式定价落在什么区间,能不能延续 GLM 一贯的低价策略;二是权重开放的许可条款——是完全的 Apache 类协议,还是带商用限制。前者决定它能不能长期留在日常工作流里,后者决定它能不能进企业。

参考来源:彭博社、OpenRouter、CocoLoop、IT之家;上下文长度、免费预览周期与 DeepSWE 复跑成绩分别按平台页面与公开测试口径核验。