OpenRouter 最新统计显示,在 8 月 31 日至 9 月 6 日这一周,全球大模型周总调用量达 115 万亿 Token;其中国产大模型周调用量 56.72 万亿 Token,环比增长 2.83%,连续 19 周位居全球首位。同一口径下,美国模型周调用量 16.54 万亿 Token,环比下滑 3.1%。全球调用量排名前五中,四款来自中国。中国 AI 正从「参数追赶」走进「用量领跑」。
一、数字背后:115 万亿 Token 的一周
115 万亿 Token 是什么概念?它约等于全球开发者与企业用户一周内,通过单一聚合平台向大模型发出的请求总量。调用量之所以重要,是因为它比论文里的 benchmark 更接近真实需求——有人在用、用得多、用得久,才说明模型真正进了生产环境,而不只是发布会的展品。
二、中美此消彼长:19 周的分水岭
连续 19 周领先,意味着这不是一次偶然的流量波动,而是一种结构性趋势。国产模型在价格、中文与多语言表现、以及面向开发者的开放生态上形成的组合优势,正在转化为持续的调用黏性。与此同时,美国模型调用量出现环比下滑,提示海外市场的需求增速或已阶段性放缓。
三、混元 Hy4 登顶:环比 379% 的爆发
在头部玩家中,腾讯混元 Hy4 preview 以 14.7 万亿 Token 的周调用量登顶,环比暴涨 379%。这一爆发与混元近期针对 Agent 场景的专项优化直接相关——通过降低长思考与过度自我验证带来的 token 消耗,企业在同等预算下能跑更多任务,调用量随之放大。调用量竞赛的本质,往往是对「单位成本下的可用产出」的竞赛。
四、从「参数竞赛」到「用量竞赛」
过去行业习惯用参数量、榜单分来证明实力,如今调用量正成为更硬的通货。它同时反映了三件事:模型是否好用、价格是否被接受、生态是否方便接入。国产模型在这三个维度上的同步改善,才撑起了 19 周的领跑。对厂商而言,下一个 KPI 可能不再是「我有多强」,而是「有多少人天天在用我」。
五、隐忧:调用量不等于收入与壁垒
也要看到,调用量高不等于商业闭环已经跑通。聚合平台上的高频调用,部分由低价与开发者尝鲜驱动;若价格战不可持续,或头部应用被自建模型替代,调用量优势能否沉淀为收入与护城河,仍是未知数。对中国 AI 而言,领跑调用榜是阶段胜利,把用量变成可持续的商业模式,才是下一关。