原标题:中国AI大模型调用量连续十五周领跑:周环比增长570%,DeepSeek-V4-Flash正式版登顶第一!MiniMax M3、阶跃星辰Step 3.7 Flash退出榜单
每经记者|宋欣悦 每经编辑|兰素英
《每日经济新闻》依据OpenRouter最新数据测算显示,上周全球AI大模型总调用量达到69万亿Token,较前一周增长21.48%。
其中,在进入榜单的AI大模型中,中国AI大模型周调用量达到34.25万亿Token,环比提升21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量已连续十五周超过美国,持续位居全球第一。


《每日经济新闻》关注到,上周全球AI大模型调用量排名前四的产品全部来自中国。其中,DeepSeek-V4-Flash-0731排名第一,周调用量达到8.83万亿Token,环比大增570%;腾讯Hy3位列第二,周调用量为8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423排名第三,周调用量达5.88万亿Token,环比下降19%;小米MiMo-V2.5滑落至第四,周调用量为5.39万亿Token,环比下滑14%。
7月31日,DeepSeek宣布,DeepSeek-V4-Flash正式版API已开启公测。根据目前披露的信息,DeepSeek-V4-Flash正式版在模型结构和参数规模上与DeepSeek-V4-Flash预览版保持一致,此次最主要的变化是重新进行了后训练。从最新更新日志来看,V4-Flash正式版在Agent能力方面获得明显增强,且基准测试成绩已显著优于预览版。
据Artificial Analysis测算,V4-Flash正式版完成单项测试任务的平均成本约为0.03美元,仅为Anthropic旗舰模型Claude Fable 5的1/100,成为当前全球主流AI模型中成本最低的产品之一。

OpenAI旗下GPT-5.6 Luna进入前五,周调用量达到4.43万亿Token,环比增长128%。
7月10日,OpenAI正式发布GPT-5.6系列模型。其中,GPT-5.6 Luna是该系列中响应速度最快、使用成本最低的版本,更适合应用于大规模、高频次任务处理,同时支持工具调用和多步骤工作流。该系列模型上线不到三周,OpenAI便宣布进一步优化GPT-5.6系列模型的定价与性能,以提升企业用户在AI应用场景中的综合性价比。此次调整中,GPT-5.6 Luna模型价格下调80%。
谷歌Gemini 3.6 Flash首次进入榜单,排名第九,周调用量达到2.33万亿Token,环比增长446%。
Gemini 3.6 Flash于7月22日发布。第三方测评机构Artificial Analysis Index数据显示,Gemini 3.6 Flash在输出阶段消耗的token数量较上一代Gemini 3.5 Flash平均减少17%。
其每百万输入Token价格维持在1.50美元,输出价格则由上一代的9美元下调至7.50美元,降幅约为16.7%。
值得关注的是,此前一周排名第七的MiniMax M3以及排名第九的阶跃星辰Step 3.7 Flash,本周均已跌出榜单。
