OpenRouter,作为全球规模领先的大模型路由平台,其数据趋势往往能折射出行业宏观风向。定期登录查看调用量排行榜,已逐渐成为我的日常习惯——借此观察近期哪些模型备受青睐、哪些方向正在悄然演变。

Token调用量整体趋势

从数据来看,OpenRouter上的周Token调用量从去年一周2T飙升至当前一周36T,增幅高达18倍。而目前重度使用AI或Agent能力的人群渗透率,可能连1%都尚未触及。这恰好解释了为何从芯片、云服务商到大模型厂商,整个AI生态的市值能持续暴涨——资本押注的并非当前规模,而是现有基础上还有百倍以上的增长空间。
最近的调用量排名中,DeepSeek V4 Flash稳居榜首,腾讯混元3 Hy Preview位列第二,MiniMax最新发布的M3拿下第三,第四名是MiMo-V2.5。前十名里,DeepSeek占据三个席位:V4 Flash第一、V4 Pro第七、V3.2第九。DeepSeek近期传出高达500亿的融资额,也就不足为奇了。
另外,KIMI和阶跃星辰跌出了前十,这两家正冲刺IPO,需要加把劲。至于GLM和Qwen系列,是否已逐渐掉队?还有一个值得关注的现象:Claude Sonnet 4.6、Opus 4.7和Opus 4.8均在前十,而OpenAI竟然没有一个模型入围——难道是使用了GPT-5.4/5.5的用户都转移到了Codex方向?
按供应商维度的市场占有率

从供应商维度观察,DeepSeek拿下第一,腾讯第二,A社第三,MiniMax第四,Google第五。小米排在第六,OpenRouter自营第七,OpenAI第八,NVIDIA第九。KIMI和阶跃星辰仍需努力。智谱和阿里呢?并未出现在这份榜单中。
国内主流大模型价格对比

将国内主流大模型的价格梳理后,就能更清晰地理解OpenRouter调用量排名为何是当前格局:
DeepSeek V4 Flash最便宜,每百万Token仅需$0.197;混元Hy3 Preview次之,$0.210;DeepSeek V3.2的价格实际上比V4 Flash还贵一些,但依然位列调用量前十——推测是许多已有项目已稳定运行较长时间,开发者不愿轻易更换模型。对于常规文本处理,默认选择DeepSeek V4 Flash即可,性价比高、吞吐量大,无需纠结。
Productivity Agent调用量排行榜

在Productivity Agent这一类别中,Hermes排名第一,OpenClaw排名第二。需要注意的是,OpenClaw的调用量仅剩Hermes的五分之一左右——曾经风光无限,如今颇有“伤仲永”之感。
Hermes的模型Token调用量趋势

Hermes的整体调用量仍在上升(最后那条灰线可忽略,通常预测不准)。其内部大模型调用量排名中,第一名是匿名免费的Owl Alpha,非多模态,支持1M上下文,暂时不确定是GLM5.2还是DeepSeek V4.1 Flash。第二、三名则分别是DeepSeek V4 Flash和Pro。
OpenClaw的模型Token调用量趋势

OpenClaw的调用量仍在持续走低——从巅峰时期的1000B一路下滑,如同温水煮青蛙。可惜无法获取过去半年的趋势图,否则曲线一定非常触目惊心。该类别中,第一名是Claude Sonnet 4.6,第二名DeepSeek V4 Flash,第三名MiniMax最新发布的M3。
Coding Agent模型Token调用量排行榜

在Coding Agent方向,Hermes也被纳入统计,紧随其后的是你可能不太熟悉的Kilo Code,其调用量比Claude Code高出两倍多——推测许多用户在使用Claude Code时默认走了Coding Plan,因此实际调用量未能完整反映在此榜单中。
图片生成领域

在图片生成领域,Nano Banana系列占据主导地位:Nano Banana、Nano Banana 2、Nano Banana Pro分别包揽前三。第四是Seedream4.5,第五是Grok Imagine Image Quality,第六是GPT-Image-2。不过从近期测试来看,GPT-Image-2依然堪称王者,表现无可匹敌。
