
出品/未来科技界
作者/张永堃
编辑/李彦
截至9月13日,OpenRouter平台周Token消耗量达到127.0万亿,环比增长10.4%,再创历史新高。上周增速一度放缓至1.8%,本周重新回到两位数增长,单周增量12万亿。

本轮增长的重要驱动力之一,是消耗量升至平台首位的GPT-5.6 Luna。该模型主打速度、价格与稳定性,其快速放量也表明,在高频、标准化任务中,具备稳定基础能力和成本优势的模型,依然拥有较强的规模化应用潜力。

具体来看,GPT-5.6 Luna上升1位强势登顶,周消耗量18.20万亿,环比增长41.1%,一周增量超过5万亿。过去近两个月里,榜首在DeepSeek、Ox Alpha、腾讯Hy4等国产模型之间轮转。这是自今年4月下旬以来,美国模型首次重回榜首。
此前登顶的腾讯Hy4 preview回落1位至第2,但自身消耗量仍保持增长,达16.80万亿,环比仍增长14.3%。腾讯同期将Hy3单价从输入0.126美元下调至0.07美元/百万Token,降幅约44.4%,使Hy3继续保持较高消耗量,两款模型合计20.60万亿,显示其在OpenRouter上的开发者使用基础仍然较为稳固。
DeepSeek仍是入榜模型最多的厂商:上周,新版本V4.1 Flash首次入榜即列第6,该模型于9月10日发布,是DeepSeek首次采用因果编码器-解码器(CED)架构的模型,总参数552B但激活仅8B/16B,推理成本极低,配合100万Token上下文,特别适合Agent工作流。DeepSeek官方称其智能水平已超越V4 Pro。
加上V4 Flash 0731、V4 Flash 0423与V4 Pro 0423,四款合计21.76万亿,厂商第一的位置更加稳定。主力V4 Flash 0731单价同期进一步下调至输入0.0352美元/百万Token。
上周,智谱旗下GLM 5.3 Flash保持第3,GLM 5.3与GLM 5.2分别下滑至第11、第13,三款合计16.15万亿。小米MiMo-V2.5依旧波动较大:上周环比下滑超七成,本周又增长逾两倍至7.77万亿,回升5位至第5。
美国阵营也迎来两个“新面孔”。9月2日发布的谷歌Gemini 3.8 Flash首次入榜,从3.6到3.8,谷歌在一个多月里完成三次迭代。Gemini 3.8 Flash主打软件工程、Agent任务和多步骤推理,在保持Flash系列低价定位的同时进一步提升性能。
同日发布的Meta Muse Spark 1.3 Contributor也首次进入榜单,以1.98万亿位列第12。Meta公布的测试数据显示,Muse Spark 1.3在DeepSWE v1.1等编码测试中领先GPT-5.6 Sol和Claude Opus 5。
值得注意的是,Contributor是Meta推出的“数据共享版”,它与标准版是同一个模型,但输入输出价格约为标准版的1/12和1/21。作为交换,通过Contributor发送的提示词和生成内容可能被用于训练Meta的模型。
随着Meta入榜,OpenAI、谷歌、Meta、Anthropic、英伟达五大美国AI厂商同时出现在前二十。
而9月初首次入榜的韩国模型Upstage Solar Pro 4则持续攀升:上升6位至第14,消耗量1.71万亿、环比增长41.3%。与之相对,Claude系列延续退潮:Opus 5下滑5位至第20,距跌出前二十仅一步之遥,Sonnet 5下降位至第18,两款合计2.62万亿,均在榜单末尾徘徊。
从国别分布看,上周Top20中,中国模型占12席,前十名中就有7款中国模型,合计69.66万亿,占Top20的68.3%;美国模型占7席,合计30.56万亿,占比30.0%,较此前的27.1%明显上升,增量主要来自Luna放量与Meta、谷歌两款新模型入榜;韩国占1席,占比约1.7%,较此前统计小幅上涨0.4%。

应用端方面,Hermes Agent以10.80万亿蝉联榜首,消耗量与上周持平;Claude Code以4.87万亿列第二,环比增长9.2%,前四名排名全部不变。
应用排行榜变动集中在腰部,上周位列第5的Zazen(Freebuff fork)跌出前十五,Freebuff本体则以0.88万亿进入前十五、位列第10;聊天界面Open WebUI飙升26位至第11,是本周升幅最大的应用。
中国应用方面,DeepSeek Harness回升1位至第9,Hello Minds保持第14,中国应用维持两席。
24小时热榜
热门视频
