近日,全球模型聚合平台OpenRouter最新发布的周度Token(词元)调用排行榜出现里程碑式变化:前五名全部由国产大模型包揽,DeepSeekV4Flash位居第一,小米MiMoV2.5、腾讯Hy3、DeepSeekV4Pro、智谱GLM5.2分列第二至第五。随着DeepSeekV4Flash正式版上线,其单日调用量和合作平台新增订阅用户均实现约30%的增长。凭借突出的高性价比优势,这一国产大模型正在重塑全球AI开发者的调用选择与使用格局。

DeepSeek为何能够登顶全球调用榜?这背后反映出我国大模型产业具备怎样的核心竞争力?围绕这些市场关注的热点问题,科技日报记者采访了相关专家。
第一问:DeepSeek为何登顶全球调用榜?
对于DeepSeek“登顶”的原因,中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙表示,最直接的推动因素是DeepSeekV4Flash正式版的发布上线。
他介绍,正式版上线意味着此前预览版完成了能力验证,并进一步转化为稳定可用的商业化服务。在发布过程中,DeepSeek与合作平台同步推进旧版本用户迁移以及旧接口停用,因此大量用户调用在短时间内快速集中到正式版,带动整体调用数据明显攀升。
与此同时,极具竞争力的价格优势叠加智能体应用需求增长,也进一步放大了DeepSeekV4Flash正式版的市场吸引力。数据显示,该版本当前定价为每百万Token输入1元、输出2元,而智能体相关应用通常Token消耗较高,因此对低成本、高效率模型服务的需求持续上升。据报道,该版本上线后,单日使用量和合作平台新增订阅用户均增长30%,这表明它的发布不仅提升了老用户的调用频次,也有效吸引了新客户进入市场。“可以理解为,正式版上线激活了需求,而成本性能比优势和智能体生态又进一步持续放大了需求。”钟新龙说。
第二问:国产模型在技术层面有哪些优势?
在国产大模型包揽榜单前五的背景下,我国大模型在技术层面的综合优势愈发受到关注。“国产大模型的核心优势,已经不再局限于单点能力,而是延伸到全链路工程化能力。”钟新龙表示。
以DeepSeekV4Flash为例,该模型通过混合专家、稀疏注意力、长上下文压缩等技术路线,在百万级上下文处理、推理性能、工具调用能力和低成本部署之间实现了较好的平衡;而小米MiMoV2.5、腾讯Hy3、DeepSeekV4Pro以及智谱GLM5.2,则分别在多模态能力、代码生成、长程规划、复杂推理等方向形成差异化优势与互补布局。
“更关键的是,国内企业能够快速完成灰度测试、正式发布、接口迁移以及多平台分发,从而让技术进步更快转化为全球开发者真实可感知的模型调用量。”钟新龙说。
第三问:将给国内AI企业带来哪些机遇与挑战?
从更长周期来看,国产模型在海外推理成本上的优势,正在为中国AI产业发展打开更广阔的增长空间。
我国大模型普遍采用MoE(混合专家)架构,这一技术架构能够通过降低参数激活比例来有效压缩推理成本。通俗来说,就像一家机构拥有几十位专家,在处理具体任务时,MoE架构只需“激活”其中最擅长的几位,而不是同时调用全部专家,从而达到更高效率的“降本”效果。
在钟新龙看来,国内AI企业完全可以借助此次正式版上线的窗口期,进一步吸引全球开发者的关注;先以低价API(应用程序接口)服务切入市场,再逐步向推理工具链、行业解决方案等附加值更高的业务环节延伸,持续放大商业增长空间。与此同时,一旦模型调用量持续增长,国产推理芯片、服务器、存储等AI基础设施需求也将被同步带动,这恰好能够为软硬件协同优化提供更加真实且更具价值的应用场景。
不过,机遇之外,挑战同样不容忽视。钟新龙提到,高调用量并不意味着高利润。正式版发布后,流量峰值将直接考验企业的算力供给能力、服务稳定性以及故障恢复水平;如果长期维持低价策略,企业利润空间也可能被进一步压缩。与此同时,海外市场对于版权合规、网络安全、审计监管等方面的要求正不断趋严,合规门槛也在持续提升。钟新龙建议,对国内AI企业而言,下一阶段的关键,是把价格优势真正转化为稳定服务能力、合规交付能力、开发者生态建设以及高价值应用落地能力。
(科技日报)
