全球一周129万亿Token的调用量里,中国模型吃掉了一半还多。
OpenRouter 最新一周的数据(9 月 14 日至 20 日)显示,全球大模型总调用量 129 万亿 Token,比前一周涨了 1.57%。其中中国模型 67.46 万亿,环比涨 10.28%;美国模型 14.21 万亿,环比掉了 34.7%。这已经是中国模型连续第 21 周在这个平台上压过美国。
前五名里有四个是中国模型。
第一名是 DeepSeek V4.1-Flash,一周 15.8 万亿 Token,环比暴涨 219%。它 9 月 10 日才发布,主打的是编程、Agent 和多模态理解,架构换成了 Causal-Encoder-Decoder,全局 KV Cache 压到了 V4-Flash 的四分之一左右。
价格是它冲上来的一个重要原因。闲时每百万 Token 的输入缓存命中 0.02 元、未命中 1 元、输出 4 元,比上一代分别降了 60%、33.3% 和 11.1%。
但单价便宜不等于干一件活就便宜。Artificial Analysis 的测试里,V4.1-Flash 平均每个任务要输出大约 8.9 万个 Token,而 V4Flash0731 大约是 6.2 万,评价是输出偏啰嗦。用量上去了,账单不一定跟着降,这一点接入之前最好自己算一算。
其他几位:智谱 GLM5.3Flash 一周 14.1 万亿 Token,排第二;腾讯混元 Hy4preview 12.5 万亿,排第三;DeepSeek-V4-Flash-0731 以 9.44 万亿排第五。
有意思的是,DeepSeek 新老两代同时挤在前五。老版本并没有因为新版本上线就被迅速替换,很多开发者在生产环境里换模型比想象中慢,稳定性和兼容性往往比新功能更重要。
美国模型单周掉三成多,这个幅度不小。OpenRouter 主要反映的是开发者和中小团队通过 API 的实际调用,并不代表各家官方渠道的全部用量,但在这个对价格很敏感的场景里,便宜又够用的中国模型确实占了上风。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






OpenRouter周榜:中国模型连续21周调用量压过美国