欢迎光临
我们一直在努力

中国大模型周调用量连续20周超美国,OpenRouter榜单前五占四席

9月14日,《每日经济新闻》根据OpenRouter最新数据测算,上周(9月7日至13日)全球AI大模型总调用量达127万亿Token,环比增长10.43%。其中,中国AI大模型周调用量达61.17万亿Token,环比增长7.85%,连续二十周超过美国,稳居全球首位。

全球调用量排名前五中,有四款是中国模型。

前五名格局:中国模型占四席

腾讯混元Hy4 preview位居第二,周调用量达16.8万亿Token,环比增长15%。该模型于8月28日正式发布并开源,总参数770B、激活参数49B,上下文长度突破1M,重点面向Agent、Coding与生产力场景优化。

智谱GLM 5.3 Flash位列第三,周调用量达11.9万亿Token,环比小幅下滑4%。该模型采用混合稀疏与线性注意力架构,在保持长上下文准确性的同时降低计算开销,在OpenRouter上的定价为输入$0.075/百万Token、输出$0.25/百万Token,目前提供50%折扣。

DeepSeek V4 Flash 0731位居第四,周调用量达11.6万亿Token,环比下滑6%。作为DeepSeek V4 Flash的GA版本,该模型总参数284B、激活参数13B,支持1M Token上下文窗口,定价为输入$0.05/百万Token、输出$0.16/百万Token。

小米MiMo-V2.5升至第五,周调用量达7.77万亿Token,环比暴涨230%,是本周增速最快的模型。该模型为小米原生全模态模型,以约一半的推理成本实现Pro级Agent性能,在图像和视频理解任务上表现突出,定价为输入$0.119/百万Token、输出$0.238/百万Token。

新模型上线三天即冲入前十

DeepSeek V4.1 Flash于9月10日正式发布,仅3天就以4.94万亿Token的周调用量升至第六。该模型基于全新架构,KV缓存压缩至每token 890字节,大幅降低长上下文推理成本。定价方面,空闲时段缓存命中输入仅0.02元/百万Token,输出4元/百万Token。

美国模型表现:Luna增速领先

美国模型方面,GPT-5.6 Luna虽未进入前五,但在本周实现了31.56%的环比增长,是美国模型中增速最快的。Luna定位为高吞吐、低延迟的性价比模型,定价为输入$0.20/百万Token、输出$1.20/百万Token,适合批量任务、分类和轻量Agent工作流。

此前一周(8月31日至9月6日),Luna曾以12.9万亿Token位居第二,环比增长66%。

对开发者意味着什么

OpenRouter的周榜数据,本质上是一份“开发者用真金白银投票的结果”。

中国模型在前五中占据四席,覆盖了从高性能Agent场景(Hy4 preview)到低成本批量任务(GLM 5.3 Flash、DeepSeek V4 Flash)再到多模态应用(MiMo-V2.5)的多个价位段。这意味着开发者的选择正在从“单一模型打天下”转向“按任务场景配模型”。

但这种“矩阵式”的模型格局,也带来了新的管理成本。同一个厂商可能同时有多个版本在榜,不同模型的定价、缓存策略、上下文窗口各不相同。如果在业务代码里硬编码调用逻辑,每次模型迭代或调价都是一次改代码的体力活。

EasyAPI 这类聚合层的价值正在于此:一个Key接入所有主流模型,切换只改配置不碰业务代码。无论榜单如何变化、价格如何波动,调用层保持稳定,你只需要关心单次任务的实际成本。

赞(0)
未经允许不得转载:171主机测评 » 中国大模型周调用量连续20周超美国,OpenRouter榜单前五占四席
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址