日均詞元調用量三個月增至500兆

中國央視今天播出的報導給出一個數字:截至今年6月,中國日均詞元(token)調用量突破500兆。同一個統計口徑三個月前才剛由官方公布過一次,當時是140兆。

往前梳理這條曲線會更清楚。Token 被正式定名為「詞元」是今年3月的事,同批公布的數據是日均調用量超過140兆,相較2024年初的1000億暴增逾千倍,也比2025年底的100兆多出四成。照這個速度推算,第二季這三個月的增幅是上一季的好幾倍——粗估接近3.6倍,曲線在第二季明顯拗了個彎。

拗彎的地方在推論端

央視財經的說法是,競爭焦點已經從單純比拚「模型智商」,轉向智能體落地與生態建設。這句話放到算力帳上,有很具體的意涵:聊天式調用是一問一答,一次幾百到幾千詞元就結束;智能體接下一個任務,卻要反覆檢索、讀取上下文、呼叫工具、跑好幾輪回饋,同一件事的詞元消耗量可以差出一到兩個數量級。

騰訊智慧產業總經理劉峰在報導中給了一個可以直接對照的數字:混元3正式版上線第一週,Token 調用量比上一代混元2暴增68倍。一次換代帶來近七十倍的調用量跳升,已經超出「用戶變多」能解釋的範圍,更像是單一任務的消耗結構整個被改寫了。

這也說明了為什麼各家都在擴建推論叢集,而不是只盯著訓練用的晶片。訓練是一次性投入,模型練完就攤提結束;推論卻是持續性開銷,用得越多燒得越兇,而智能體恰好是那種會把「大量使用」變成預設狀態的產品。

迭代週期壓縮到四到六週

稀宇科技(StepFun)開放平台首席架構師馮雯提到一個變化:2025年下半年,廠商的目標還是每3個月迭代一次模型;現在卻要每4到6週就發布一個新模型。

這對算力的擠壓是雙向的。訓練端的排程被壓縮,一個叢集才剛喘口氣就得接下一輪;推論端則要同時伺候好幾個仍在服役的版本——新模型上線不代表舊版本立刻下架,API上的舊版本往往還要再掛好幾個月,服務量能得按平行供養來準備。

節奏加快還帶來一個連鎖效應:單一模型攤提訓練成本的窗口變短了。國產模型今年接連降價,價格戰打得兇,跟這個窗口收窄脫不了關係——趁還在服役期盡量把調用量衝高,比慢慢賣高價更划算。

智算中心跟著長約走

遠景科技集團人工智慧算力中心總經理鄭子浩,把智算中心的興建形容為井噴式發展,理由是客戶提供了長期穩定的訂單承諾。

「長期穩定訂單」這五個字是關鍵。資料中心是重資產,一棟樓從取得土地到點亮往往要一到兩年,投資方最怕的就是建好之後閒置。有長約打底,建設方才敢按滿載規格去設計,供電、水冷、機櫃密度都能一次做到位。多地正在推動的國產「詞元工廠」與智算綜合體,走的是同一套邏輯:先鎖定需求,再把產能拉上去,把國產算力產業鏈從產品驗證推進到量產交付。

數字之外還缺什麼

500兆目前還缺一個橫向對照。公開管道還看不到同一口徑的全球數字,「第一梯隊」這個說法現階段只能算定性判斷,還沒有比值可以坐實。

把500兆平均攤到人頭上,14億人口每天人均約35萬詞元(粗估)。這個數字本身沒什麼實際意義——絕大多數調用來自企業系統與後台智能體,跟個人打字量無關。它真正的用處是提醒一件事:詞元已經從技術指標變成產業指標。接下來會被反覆拿來比較的,會是每兆詞元背後的電費、卡時,以及它換回來的營收。

參考來源:央視財經、IT之家、CocoLoop、中國國家數據局公開通報;調用量數字已與上一次官方公布口徑逐項比對,人均值為編輯部粗估。