9 月 22 日,全球 API 聚合平台 OpenRouter 的日榜显示,智谱 AI 的 GLM-5.3-Flash 当日调用量达到 4.36 万亿 Token,较上一统计周期增长 73%,位列平台模型调用量第一,超过 DeepSeek V4.1 Flash(2.43T)与腾讯 Hy4 preview(1.88T)。这组数字来自开发者真实请求流量的实时聚合,不是厂商自报的跑分。

[1][2]

nut graf:OpenRouter 日榜是"开发者用脚投票"的实时温度计——4.36 万亿 Token 说明的不只是模型好用,而是中国开源模型的价格-能力组合,已经在一大批中小开发者的默认模型选择里占住了位置。榜单同时显示,第二名 DeepSeek V4.1 Flash(2.43T)环比 -2%,第三名腾讯 Hy4 preview(1.88T)环比 -4%,而 GLM-5.3-Flash 单日 +73%——增量主要来自它。

把 73% 的增长拆开看,有两个可验证的背景。其一,GLM-5.3-Flash 是原生多模态模型,定位高效编码与长上下文,这类"干活型"模型正是 Flash 档位的主战场,开发者从"试一下"到"设为默认"的转化会直接体现在调用量曲线上。其二,OpenRouter 的榜单逻辑是累计开发者真实流量,不含厂商注水或自评,所以它对"哪个开源模型真的被用起来"的指示意义,比任何基准榜单都更接近市场真相。值得注意的是,周榜口径下 GLM 5.3 Flash 的累计 Token 已到 16.9T,说明这不是单日脉冲,而是持续占用的结果。

当然要标注口径。4.36 万亿 Token 是 OpenRouter 一个聚合平台上的日调用量,不等于智谱全渠道的调用量;+73% 的环比基准是"上一统计周期",具体窗口由平台定义;榜单排名反映流量而非质量,一个模型可能因为便宜、缓存命中率高而被大量调用,这不等于它能力最强。但把视角拉远,这组数据与近半年的趋势一致:开源模型的能力差在收窄,而价格差在拉大,调用量正在向"够用且便宜"的档位集中。GLM-5.3-Flash 登顶更像是一个信号——下一阶段的开源竞争,衡量标准会越来越多地是"开发者实际用掉了多少 Token",而不是"你在几个榜单上排第几"。

[1][2]
上午的 API 运营监控室,一名工程师背影站在一面弧形大屏前,大屏上显示模型调用量排行榜:多根柱状图中最左侧一根明显高出其他柱子,屏幕边缘是实时 Token 计数与区域流量地图,工程师一手端着咖啡,一手指向领先的柱子,落地窗外是上午的城市
调用量登顶, AI 生成插画,非新闻照片