资讯详情
周Token消耗榜丨DeepSeek暴涨570%登顶,MiniMax等八款国产模型排名齐跌
张永堃| 2026-08-10 20:10:47
OpenRouterToken调用量AI


出品/未来科技界

作者/张永堃

编辑/李彦

截至8月9日的一周,OpenRouter平台Token调用量达到69.0万亿,创历史新高。在连续两周回落后,平台调用量迎来大幅反弹,较7月27日统计的周度数据增长约21.5%。

本轮增长主要由头部模型拉动。上周排名前两位的DeepSeek V4 Flash 0731和腾讯Hy3合计消耗16.88万亿Token,较前一周榜单前两名DeepSeek V4 Flash 0423和MiMo-V2.5的13.52万亿增长3.36万亿,增幅约24.9%。这一增量约占平台同期总增量的近三成,显示开发者调用进一步向头部模型集中。

从模型调用量排名看,上周榜单头部格局再次发生调整。DeepSeek V4 Flash 0731(即DeepSeek-V4-Flash正式版)以8.83万亿Token消耗量登顶第一,较上周排名飙升11位;腾讯Hy3以8.05万亿Token升至第二;原版DeepSeek V4 Flash 0423(即DeepSeek-V4-Flash预览版)以5.88万亿Token降至第三;小米MiMo-V2.5以5.39万亿Token降至第四。

在国产模型连续多周占据前五名的背景下,OpenAI的GPT-5.6 Luna成为上周最突出的海外模型。该模型以4.43万亿Token升至第五,低价策略带来的滞后效应开始集中释放,也打破了国产模型对榜单前五名的连续包揽。

除GPT-5.6 Luna外,另有两款海外模型首次进入Top20。谷歌Gemini 3.6 Flash以2.33万亿Token位列第九。该模型输入价格为1.50美元/百万Token,输出价格为7.50美元/百万Token,整体处于中高价位。

OpenAI旗下GPT-5.6 Terra则以0.80万亿Token位列第18,输入$1/百万Token、输出$6/百万Token,与GPT-5.6 Luna形成高低搭配,进一步丰富OpenAI在平台的模型矩阵。

相比头部模型的强势增长,其他国产模型普遍出现排名下滑。MiniMax M3下降4位至第11,月之暗面Kimi K3下降2位至第12,Step 3.7 Flash下降5位至第14,蚂蚁集团Ling-3.0-flash更是大幅下降8位至第19。国产模型在平台上的优势,正进一步向DeepSeek和Hy3等少数头部产品集中。

从国家分布来看,上周Top20模型中,中国模型共占据10席,美国模型占10席(包括1款美法双中心模型)。中国模型在Top20的Token消耗占比约为70.3%,合计消耗约39.2万亿Token;美国9款大模型合计消耗约16.57万亿Token,占比约29.7%。尽管中国模型数量较上周减少1席,但凭借DeepSeek和Hy3的强势表现,国产模型在Top20中的消耗占比反而进一步提升。

应用端方面,Hermes Agent以9.97万亿Token蝉联榜首,较之前的7.26万亿增长约37.3%,领先优势进一步扩大。前三名保持稳定,Claude Code以2.16万亿位列第二,Kilo Code以1.75万亿位列第三。

排行榜的腰部排名出现明显调整,Cline上升2位至第4名,调用量从0.69万亿增至1.43万亿,实现翻倍增长。OpenClaw和pi分别下降1位至第5、第6名,但调用量基本保持稳定。

Nous Research API飙升12位至第8名,调用量从上周未进前15跃升至0.48万亿;土耳其应用Oh-My-Pi上升5位至第10名。与之相对的,上周表现亮眼的Codebuff、Peezy Gateway、Janitor AI和Internally Broken均掉出前15,中国应用Hello Minds下降7位至第14名,榜单中尾部应用竞争依然激烈。

转载之前请先阅读转载说明,违规转载法律必究
寻求报道或合作,请点击这里
如果您加入壹览的讨论群,请联系我们的工作人员(微信号:star_3979)