资讯详情
周Token消耗榜丨DeepSeek蝉联榜首,GPT-5.6家族集体入榜
张永堃| 2026-08-18 18:10:41
OpenRouterToken调用量AI

出品/未来科技界

作者/张永堃

编辑/李彦

截至8月16日,OpenRouter平台周Token调用量达到75.3万亿,环比增长9.1%,继上周的69万亿之后再创历史新高。增速虽较上周的21.5%明显放缓,但增长动能并未减弱。

本轮增长依旧由头部模型强势拉动。DeepSeek V4 Flash 0731和腾讯Hy3蝉联前二,环比分别增长26.8%和23.6%,两款模型合计消耗21.15万亿,较上周的16.88万亿增加4.27万亿,约占平台当周总增量的近七成,开发者调用向头部模型集中的趋势进一步加剧。

从模型调用量排名看,上周Top20中,DeepSeek V4 Flash 0731以11.20万亿Token蝉联榜首,腾讯Hy3以9.95万亿保持第二,GPT-5.6 Luna以5.31万亿升至第三,环比增长近20%,使美国模型在上周打破了国产模型对前三名的长期包揽。

DeepSeek V4 Flash 0423以4.83万亿位列第四,智谱GLM 5.2以4.33万亿升至第五。小米MiMo-V2.5和DeepSeek V4 Pro 0423分列第六、第七。Anthropic的Claude Opus 5上升5位至第8,是上周上升幅度最大的模型。

GPT-5.6 Luna跻身前三,与OpenAI在8月7日实施的一项关键产品调整密切相关:ChatGPT免费版及Go版用户的默认模型正式升级为GPT-5.6 Luna,同时取消文字聊天次数限制,开放无限文本对话。OpenAI披露,与此前的即时响应模型相比,Luna的事实性错误减少约62%。默认入口切换叠加使用门槛降低,迅速扩大了Luna的用户覆盖和交互规模,并在一定程度上推动相关API调用需求集中增长。

同时,统计期间,Luna的平台定价为输入0.10美元、输出0.60美元/百万Token,低价策略带来的滞后效应仍在持续释放。

GPT-5.6家族由此成为榜单中仅次于DeepSeek的第二大势力:除Luna外,Terra、最高配的GPT-5.6 Sol也在上周首次入榜、位列第20。三款合计消耗6.95万亿,约占前二十总消耗的11.6%。

从国家分布来看,上周Top20模型中,中国模型占9席,美国模型占11席(含一款美法双中心)。中国模型在Top20的Token消耗占比约为68.1%(40.75万亿),美国模型占比约31.9%(19.07万亿)。尽管中国模型数量较上周减少1席,但凭借DeepSeek的强势表现,国产模型在Top20中的消耗占比仍维持在近七成的绝对主导地位。

数据之外,OpenRouter本身也在上周成为市场焦点。8月16日,彭博社报道称支付巨头Stripe已最终敲定协议,以超70亿美元收购AI模型聚合平台OpenRouter。该价格较OpenRouter今年5月B轮融资时13亿美元的估值翻涨5倍以上。OpenRouter目前周Token调用量已突破75万亿,Stripe的收购意味着支付基础设施与AI模型路由层的深度融合,也为“模型即服务”赛道的估值逻辑提供了新的参照系。

应用端方面,编程与Agent工具继续主导Token消耗。Hermes Agent以9.87万亿Token蝉联榜首,应用榜前七名排名纹丝不动。变动集中在8-15名:Zazen(Freebuff fork)飙升4位至第8,Lemonade同样上升4位至第12,成为上周应用端最亮眼的两匹黑马。与之相对的是,Nous Research API下降3位至第11,HighLevel下降1位至第10。

国别分布上,美国应用占前十五中的10席,继续统治该榜单。中国应用上周无一入榜——上周还排在第14的中国香港Hello Minds已跌出前十五。对照模型榜近七成的消耗占比,“模型强、应用弱”仍是中国AI最明显的短板。

转载之前请先阅读转载说明,违规转载法律必究
寻求报道或合作,请点击这里
如果您加入壹览的讨论群,请联系我们的工作人员(微信号:star_3979)