GEO资讯

中国大模型调用量连续十六周领跑全球

发布于 2026/8/19 56 次阅读
中国大模型调用量连续十六周领跑全球

一组被忽视的周度数据

过去一个月,行业注意力大多被各家大模型的新版本发布吸引。但有一组周度数据,其实更值得企业决策层留意。全球模型聚合平台 OpenRouter 在 8 月 17 日前后公布的周度 Token(词元)调用统计显示,8 月 10 日至 16 日这一周,全球 AI 大模型总调用量达到 75.3 万亿 Token,环比增长 9.13%。其中中国大模型周调用量为 36.84 万亿 Token,美国为 10.26 万亿 Token。按这个口径,中国已连续十六周超过美国,稳居平台调用量首位。

排在前面的都是谁

把镜头拉到具体模型,格局也在悄悄变化。DeepSeek-V4-Flash 正式版连续两周位居全球调用量第一,周调用量 11.2 万亿 Token,环比增长 27%;腾讯 Hy3 以 9.95 万亿 Token 排在第二,环比增长 24%。更值得关注的是 OpenAI 的 GPT-5.6 Luna 首次挤进前三,周调用量 5.31 万亿 Token,环比增长 20%,已经连续三周增长。

这说明头部位置不再由某一个爆款独享,而是多家厂商、多个版本在轮流接力。过去那种"出一个旗舰就霸榜一个月"的节奏,正在被高频迭代取代。

为什么看"调用量"而不是"参数"

Token 调用量衡量的是模型被真实使用的频次,而不是训练规模或榜单分数。多家媒体援引《金融时报》中文版的分析指出,当前 AI 算力的支出重点,正从模型训练转向更大规模的推理;Agent(智能体)的兴起,让 AI 从简单问答转向执行复杂任务,单次请求消耗的 Token 也明显变大。

企业把 AI 接进日常工作流之后,调用是持续发生的——写代码、跑报表、处理客服、生成内容,每一步都在消耗 Token。这正是调用量快速攀升的底层逻辑,也比参数规模更能反映真实需求。

对 B 端企业的三点提示

  • 成本与落地能力,正成为中国模型的差异化优势。对想用 AI 提效的中小企业和实体商家来说,可选模型比一年前丰富得多,价格也更友好。
  • 多厂商接力,选型风险在下降。企业不必绑定单一模型,完全可以按照任务把不同模型组合使用,比如用开源模型跑批量任务,用闭源模型处理高难度推理。
  • 从 GEO 视角看,机会在变大。中文大模型被用户直接提问的频率越来越高,品牌内容被中文模型采纳、写进答案的机会也在增加。把企业信息做成 AI 容易引用的结构化内容,是当下性价比很高的一件事。

信息来源

  • 每日经济新闻《中国 AI 大模型调用量连续十六周领跑:DeepSeek-V4-Flash 正式版连续两周第一,今日正式涨价!》(2026-08-17),数据引自 OpenRouter 周度统计
  • 观察者网《连续 15 周霸榜!中国 AI 大模型调用量缘何跑赢美国?》(2026-08-10)
  • 财联社 / 智通财经 同主题快讯(2026-08-10)