ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

全球调用量前四全是国产模型:本周榜单说了什么、没说什么,以及开发者该怎么选型

全球调用量前四全是国产模型:本周榜单说了什么、没说什么,以及开发者该怎么选型 过去一周2026-08-03 至 2026-08-09OpenRouter 的全球大模型调用量榜出现了一个「视觉上很显眼」的格局前四名全部来自中国厂商第五名是美国 OpenAI 的 GPT-5.6 Luna。中国模型合计周调用量 34.25 万亿 Token美国为 9.17 万亿 Token两者差距依然悬殊。但如果你只看头条会少读很多信息——比如这份榜单的统计口径、它衡量的是什么、它衡量不出的又是什么以及为什么「国产霸榜」并不能直接回答「该用哪个模型」。本文分四个部分先把本周关键数据落到一张可对照的表再拆解榜单的边界与本周末尾的小变化快照漂移然后给出一份从榜单信号到选型动作的过滤框架最后诚实交代本文的局限。一、本周事实表开源周报里的真实数字下面这张表的数字都来自 OpenRouter 周度数据《每日经济新闻》《财联社》《证券时报》三家在 8 月 10 日当天有公开转述可以交叉比对。全球总调用量69 万亿 Token环比 21.48%。中国模型合计周调用量34.25 万亿 Token环比 21.76%连续 15 周超过美国。美国模型合计周调用量9.17 万亿 Token环比 109.36%——增速很高但基数小得多。全球前四中国模型包揽第五名 GPT-5.6 Luna。图1中美 AI 大模型周调用量对比2026.08.03–08.09。数据来源OpenRouter 周度数据经《每日经济新闻》《财联社》测算转述2026-08-10。本周前五名的具体数字与环比变化环比数据来源同上中国份额 63.5% 来自《光明网》8 月 5 日对 28 天滚动窗口的转述排名模型周调用量万亿 Token环比变化1DeepSeek-V4-Flash-0731正式版8.83570%2腾讯 Hy38.0567%3DeepSeek-V4-Flash-0423预览版5.88−19%4小米 MiMo-V2.55.39−14%5GPT-5.6 LunaOpenAI4.43128%几点容易被人忽略的细节榜首的 DeepSeek-V4-Flash-0731 是 7 月 31 日上线的正式版 API结构与预览版相同差异在「重新做了一遍后训练」预览版-0423则直接被自己「同期同榜顶替」跌到第三。小米 MiMo-V2.5 排名从上上周的第二滑到第四但绝对值仍在 5 万亿级别跌幅 14% 在榜单内属「显著但非崩盘」。榜单上的 MiniMax M3 与阶跃星辰 Step 3.7 Flash 已跌出前五《每日经济新闻》的原标题里点名了它们。DeepSeek-V4-Flash 正式版的「单项任务平均成本约 0.03 美元」据 Artificial Analysis 的测算约为 Claude Fable 5 的 1/100。这是榜单之外的另一个解释变量。二、榜单的边界它告诉你什么、没告诉你什么把这张表放大到「榜单能/不能告诉你什么」的层面至少有四件事会被这周的标题盖住。图2OpenRouter 调用量前五的本周与上一周对照。红色为中国模型蓝色为美国模型右侧百分比为该模型周调用量环比变化。数据来源OpenRouter 周度数据经《每日经济新闻》《财联社》《光明网》转述整理2026-08-10上一周仅榜首有公开精确数值。第一统计口径 开发者 API 调用不等于全部大模型流量。OpenRouter 是聚合平台覆盖的是通过其路由的开发者 API 调用量ChatGPT、Gemini、Claude 等厂商自有渠道Web/App/企业合同不在内。因此「63.5% 对 35.5%」衡量的是开发者市场而不是模型市场——这一边界在多家专业评论《高维周期》《光明网》里都被反复提醒。第二榜单是快照不是稳定排序。图2 的「一周之内的变化」卡片列出的是上周与本周前五名的差异榜首换人、MiMo 从第二滑到第四、GPT-5.6 Luna 补位进入前五。一周之内就足以出现两位数的名次变动以单周快照下「国产模型稳居前五」是事实但「永远霸榜」不是。第三调用量反映的是「开发者愿意付费跑什么」不直接反映「推理能力」。引用率高通常意味着成本/许可证/生态接入三件事占优——本期榜单里被反复提到的三个变量是开源权重、API 价格、以及 Day 0 适配的芯片/推理框架数量。第四与调用量同时发生的另一件事是国产模型在权重市场的扩张。据《经济日报》8 月 10 日的数据过去一年 Hugging Face 新增开源模型下载流量中中国自研大模型占比 41%全球累计下载量超过 100 亿次。Kimi-K3 在 Hugging Face 上的累计下载量约 96.8 万居榜首。这条「权重侧」的故事与「调用量侧」的故事是平行的但不能合并成一个数。三、把榜单信号翻译成选型动作四层过滤对工程团队「霸榜前三 / 第一名」这种结论没法指导具体选型。下面这张图是我把文中事实整理后的一个选型流程不代表任何厂商的官方推荐或实测结论仅作为阅读这份榜单后的思考路径。图3把「榜单信号」翻译成「选型动作」的四层过滤示意图。作者根据本文事实整理的选型流程不代表任何厂商官方推荐或实测结论。四层过滤的最小可执行版任务契约先把输入输出、上下文长度、并发与延迟上限、是否需要工具调用写成验收标准。这一步不写清楚后面三层都白做。单位任务成本算「一次任务多少钱」而不是只看「每百万 Token 单价」。缓存命中率、输出长度、是否需要调用工具链这些变量往往决定月底账单。权重可得性能否拿到开源权重MIT/Apache 2.0 等决定能否自托管、能否微调、能否规避数据出境与供应商锁定。这一项上DeepSeek、MiniMax、腾讯、阿里、智谱都在过去半年给出了清晰的开放权重路径。生态与退出成本推理框架、芯片适配、量化路径是否就位——以及哪天换模型时需要改多少代码。本周榜单以外的另一个事实是H3 在 8 月 3 日开源当日华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel 九家芯片厂商同步完成 Day 0 适配ComfyUI、vLLM-Omni、SGLang 等推理框架亦同步上线。这是「Day 0 生态响应」从营销词变成可验证事实的一个例证。把四层过滤过完调用量榜单才从「行业新闻」变成「决策依据」。四、本文局限与待核实快照属性本周榜单对「单周排名变化」的指示较强对「长期市场份额」的指示较弱。文中的「连续 15 周领先」来自《每日经济新闻》转述的 OpenRouter 数据「28 天滚动中国份额 63.5%」来自《光明网》对更早一周的转述——两个口径不同本文已分别标注。成本对比的可比性DeepSeek-V4-Flash 正式版「单项任务成本约 0.03 美元」「约为 Claude Fable 5 的 1/100」均来自 Artificial Analysis。该比较基于 Artificial Analysis 定义的「单项测试任务」口径与企业实际账单口径可能存在差异建议作为方向性参考。生态数据H3 Day 0 适配名单来自 MiniMax 官方公告与智东西、ChooseAI 等多家转述具体到某一家芯片厂商实测性能数据本文未做交叉验证。未涉事项本文不涉及任何厂商的财务判断、不涉及股价预测、不涉及模型架构的技术深评。如果你读到「国产霸榜」的标题时觉得兴奋请记得把它和上面四件事放在一起读——兴奋应该来自决策框架被收紧而不是来自一个单周快照。
返回列表