2026年8月,全球AI大模型竞争格局出现了一个标志性节点。根据全球最大AI模型聚合平台OpenRouter最新发布的周度数据,中国AI大模型的Token调用量已经连续15周超过美国,稳居全球首位。更值得注意的是,上周全球调用量排名前四的模型全部来自中国厂商,中美之间的调用量差距已接近4倍。
69万亿Token的周度较量
具体来看,8月3日至8月9日当周,全球AI大模型总调用量达到69万亿Token,环比增长21.48%。其中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,虽然环比增长109.36%,但绝对值仍远落后于中国。

从月度维度看,中国模型在OpenRouter平台的Token份额已从2025年1月的6.0%飙升至2026年7月的61.5%,18个月内提升了超过10倍。近28天的全球AI调用量中,中国模型占比约63.5%,美国仅35.5%,差距仍在持续拉大。
前四名全是国产模型
上周全球调用量前五名如下:DeepSeek-V4-Flash正式版以8.83万亿Token登顶,环比暴涨570%;腾讯Hy3以8.05万亿Token排名第二,环比增长67%;DeepSeek-V4-Flash预览版排名第三,调用量5.88万亿Token;小米MiMo-V2.5位列第四,5.39万亿Token;OpenAI的GPT-5.6 Luna排在第五位,4.43万亿Token。前四名中没有一款海外模型,这在OpenRouter平台历史上尚属首次。

DeepSeek正式版引爆增长
DeepSeek-V4-Flash正式版的爆发式增长尤为引人关注。7月31日该版本API上线公测后,周调用量环比暴涨570%,从预览版的”能力验证”角色一跃成为全球调用量最高的单体模型。其官方价格为每百万Token输入1元、输出2元,据Artificial Analysis测算,完成单项测试任务的平均成本约0.03美元,仅为Anthropic旗舰模型的百分之一。正式版上线后,单日使用量和合作平台新订阅用户均增长约30%。
成本差距超20倍
成本是这轮竞争的核心变量。根据OpenRouter数据,中国模型的平均费用低至每百万Token仅18美分,而美国模型则为4美元,成本差距超过20倍。

这一差距的根源在于三个方面:架构优势——中国模型普遍采用混合专家(MoE)架构,单次推理激活参数比例普遍在个位数至10%左右,而美国模型为15%至30%;训练成本——部分头部模型的训练成本显著低于美国竞争对手,公开数据显示可能仅为美国同行的十分之一;基础设施——中国在电力供应、数据中心建设和运维方面的优势,进一步压低了AI服务的边际成本。
在”客场”赢得的市场份额
更值得关注的是,这些调用量并非来自中国本土用户。OpenRouter数据显示,该平台用户中美国开发者占比高达47%,中国开发者仅约6%。换句话说,中国AI大模型是在海外开发者主导的”客场”环境中,凭借产品实力赢得的市场份额。
据报道,智谱公司的GLM-5.2模型发布后一周内,每日Token使用量增长了约27倍,使用该模型的客户数量增长了约80倍。美国开源AI平台Hugging Face机器学习负责人表示:”成本曲线急剧下降,简直是’断崖式下跌’。越来越多的公司倾向于使用成本更低、可以自行控制的AI技术栈,鉴于开源模型的现状,这通常意味着使用中国方案。”
不只是价格战
从产业视角看,这轮调用量的爆发并非简单的”价格战”结果。数据显示,Agent与Coding类应用仅占应用数量的19%,却贡献了81.2%的Token用量,表明智能体化任务正在成为驱动推理需求高速扩张的核心引擎。国产大模型已形成从经济适用型到旗舰大参数型的完整产品矩阵。
当然,OpenRouter的数据并不能完全代表中美AI的全方位差距——它主要覆盖第三方开发者和海外用户的调用流量。但这一趋势的信号已经足够清晰:在全球开发者市场的真实商业环境中,中国AI大模型正从”用便宜换份额”走向”能力和成本一起立得住”的新阶段。





