截至9月13日,OpenRouter平台的Token消耗总量达到了127.0万亿,环比增长10.4%,创下了新高。本周的增长显著回升,单周增量达12万亿,尽管上周增速有所放缓,但本周重新进入了两位数的增长。推动这一增长的主要原因之一是GPT-5.6 Luna模型的崛起,该模型以其速度、价格和稳定性能为特点,在高频、标准化任务中表现优越,显示出良好的广泛应用潜力。
具体来看,GPT-5.6 Luna强势上升至榜首,周消耗量达到18.20万亿,环比增长41.1%,一周增加逾5万亿。过去近两个月,该榜首位置在多个国产模型中轮换,包括DeepSeek、Ox Alpha和腾讯Hy4,这是自四月以来美国模型首次重返榜首。同时,腾讯的Hy4 preview则退至第二位,但消耗量仍保持在16.80万亿,环比增长14.3%。腾讯也在此期间将Hy3的价格大幅降低,使得两款模型的合计消耗量达20.60万亿,显示出其在开发者中的稳定使用基础。
在入榜模型数量上,DeepSeek仍占优势,上周新发布的V4.1 Flash首次登榜,位列第六。该模型采用了因果编码器-解码器架构,参数量达到552B,推理成本极低,非常适合Agent类工作流。DeepSeek的其他几款模型合计达到21.76万亿的消耗量,巩固了其市场地位。V4 Flash 0731的价格也进一步降低至0.0352美元每百万Token。 球友会
智谱的GLM 5.3 Flash保持第三,GLM 5.3和GLM 5.2则有所下滑,三者合计消耗量为16.15万亿。小米的MiMo-V2.5则经历了较大的波动,本周消耗量上升至7.77万亿,回升至第五位。
美国阵营迎来了两个新模型:谷歌的Gemini 3.8 Flash和Meta的Muse Spark 1.3 Contributor。Gemini 3.8 Flash以其出色的多步骤推理能力首次入榜,而Muse Spark作为数据共享版本,其价格显著低于标准版,并在编码测试中表现优越。
在国别分布方面,上周前20名中,中国模型占据了12席,前十名中有7款来自中国,合计消耗量为69.66万亿,占据Top20的68.3%;美国模型占7席,总体消耗量为30.56万亿,占比30.0%;韩国模型占1席,略增至约1.7%。 球友会
在应用方面,Hermes Agent以10.80万亿的消耗量再次夺冠,Claude Code紧随其后。应用榜也出现了一些变化,DeepSeek的Harness回升至第九位,而中国应用保持了两席的稳定。