简介
据全球最大模型聚合平台 OpenRouter 数据,中国大模型调用量已连续 14 周超过美国、稳居全球首位,全球前五名全部为中国模型,DeepSeek-V4-Flash 多次登顶第一。
据全球最大模型聚合平台 OpenRouter 的数据,中国大模型的调用量已连续 14 周超过美国、稳居全球首位,全球调用量前五名全部是中国模型,DeepSeek-V4-Flash 多次登顶第一,Kimi、MiniMax 也都进入过全球前十,智谱紧随其后。这组数据背后,是一条由算法效率、基础设施经济性与开源反馈循环共同构成的成本优势链条。
一、事件速览
OpenRouter 的调用量排名被视为观察全球真实使用情况的窗口。2026 年,中国模型在这一榜单上连续 14 周超过美国,前五名全部为中国模型,DeepSeek-V4-Flash 多次拿下第一,Kimi 与 MiniMax 也都曾进入全球前十,智谱紧随其后。另一组数据更能说明变化速度:截至 2025 年 11 月,中国模型在全球 LLM 使用量中的占比,在 12 个月内从 1.2% 攀升至约 30%。上海人工智能实验室的 InternVL3 为开源视觉语言模型树立了标准,仅上海徐汇区就聚集了近 400 家相关企业。
二、关键数据与技术细节
- 全球排名:据 OpenRouter 数据,中国大模型调用量连续 14 周超过美国,稳居全球首位。
- 头部集中度:全球调用量前五名全部是中国模型,DeepSeek-V4-Flash 多次登顶第一。
- 生态广度:Kimi、MiniMax 都曾进入全球调用量前十,智谱紧随其后。
- 份额变化:截至 2025 年 11 月,中国模型在全球 LLM 使用量中的占比从 1.2% 升至约 30%,历时 12 个月。
- 算力成本:甘肃、贵州、内蒙古等省份对数据中心电费补贴最高达 50%,东数西算把算力密集型负载从东部高成本城市转移到西部能源富集省份。
- 开源标杆:上海人工智能实验室的 InternVL3 为开源视觉语言模型树立标准,上海徐汇区聚集近 400 家相关企业。
三、行业影响与解读
调用量全球第一的意义不只是榜单好看,而是意味着全球开发者在真实业务中选择了中国模型。背后是三条相互强化的链条:算法效率上,MoE 架构、多头潜在注意力压缩显存、多 token 预测加速推理等技术已被中国模型生态普遍采用;基础设施上,西部省份最高 50% 的电费补贴加东数西算,把训练与推理的电力成本压到极低;开源反馈循环则让开放权重的改进在整个生态中复利叠加。三者叠加的结果是,中国模型在同等智能水平下可以提供显著更低的价格,而价格正是调用量最敏感的杠杆。对海外闭源厂商而言,这是一个难以用资本优势直接对冲的结构性挑战,因为对手的低成本来自架构选择与能源结构,而不是补贴式的烧钱。
四、值得关注的信号
- 调用量领先会强化数据反馈与生态惯性,开源阵营的马太效应在 2026 年下半年还会加剧。
- 电费补贴与东数西算说明算力经济性已成为竞争工具,成本优势具备长期性。
- MoE、多头潜在注意力、多 token 预测等效率技术会加速向全球扩散,成为新的行业默认配置。
- 上海徐汇区聚集近 400 家相关企业,区域产业集群将进一步降低协作与试错成本。
小结:连续 14 周全球第一,标志着中国大模型从追赶者变成了全球使用量意义上的主导者。价格、算力与开源三点构成的成本优势,短期内难以被复制。接下来值得关注的问题是,调用量优势能否沉淀为可持续的商业模式。
