央视今天播出的报道给出一个数字:截至今年6月,我国日均词元调用量突破500万亿。同一个口径三个月前刚被官方通报过一次,当时是140万亿。
往前捋一遍这条线更清楚。Token 被定名为”词元”是今年3月的事,同批通报的数据是日均超过140万亿,相比2024年初的1000亿涨了一千多倍,相比2025年底的100万亿多出四成。按这个节奏推,二季度这三个月的增幅是上一个季度的好几倍——粗算接近3.6倍,曲线在二季度折了个弯。
折弯的地方在推理侧
央视财经的表述是,竞争焦点从单纯的”模型智商”转向智能体落地和生态建设。这句话落到算力账上有很具体的含义:聊天式调用是一问一答,一次几百到几千词元就结束;智能体接下一个任务,要反复检索、读取上下文、调用工具、跑多轮反馈,同一件事的词元消耗能差出一两个数量级。
腾讯公司智慧产业总经理刘峰在报道里给了一个可以直接拿来对照的数字:混元3正式版上线第一周,Token 调用量比上一代混元2增长了68倍。一次换代带来近七十倍的调用量跳升,已经超出”用户变多了”能解释的范围,更像是单次任务的消耗结构整个换了。
这也解释了为什么各家都在扩推理集群而非只盯训练卡。训练是一次性投入,模型练完就摊销;推理是持续开销,用得越多烧得越多,而智能体恰好是把”用得多”做成默认状态的那类产品。
迭代周期压到四到六周
稀宇科技开放平台首席架构师冯雯提到一个变化:2025年下半年,厂商的目标还是每3个月迭代一次模型;现在每4到6周就要发布一个新模型。
这对算力的挤压是双向的。训练侧排期被压缩,一个集群还没喘匀就得接下一轮;推理侧要同时伺候好几个仍在服役的版本——新模型上线不代表旧版本立刻下线,API 上的老版本往往还要再挂几个月,服务能力得按并行供养来备。
节奏加快还有一个连带效应:单个模型摊销训练成本的窗口变短了。国产模型今年接连降价,价格战打得凶,跟这个窗口收窄脱不开关系——趁着还在服役期尽量把调用量做起来,比慢慢卖高价更划算。
智算中心跟着长约走
远景科技集团人工智能算力中心总经理郑子浩把智算中心的建设形容为井喷式发展,给出的理由是用户提供了长期稳定的订单承诺。
“长期稳定订单”这五个字是关键。数据中心是重资产,一栋楼从拿地到点亮要一到两年,投资方最怕建好了空置。有长约打底,建设方才敢按满负荷设计,供电、水冷、机柜密度都能一次做到位。多地正在推的国产词元工厂和智算综合体走的是同一套逻辑:先锁需求,再上产能,把国产算力产业链从产品验证推到批量交付。
数字之外还缺什么
500万亿目前缺一个横向参照。公开渠道还看不到同口径的全球数字,“第一梯队”这个说法眼下只能算定性判断,没法用一个比值坐实。
把500万亿摊到人头上,14亿人每天人均约35万词元(粗算)。这个数字本身没什么实际意义——绝大部分调用来自企业系统和后台智能体,跟个人打字量无关。它的用处是提醒一件事:词元已经从技术指标变成了产业指标。接下来被反复拿来比的,会是每万亿词元背后的电费、卡时和它换回来的收入。
参考来源:央视财经、IT之家、CocoLoop、国家数据局公开通报;调用量数字与上一次官方通报口径逐项比对,人均值为编辑粗算。