当前判断:公开数据尚不能生成可信的全球模型 token 总排名。现阶段只能建立多平台代理指标:OpenRouter 等聚合 API 榜、厂商披露、云渠道、开源自托管与端侧信号。任何单一平台榜都不能写成全球市场份额。
本周可核验基线
2026 年 7 月 30 日直接复核 OpenRouter “This Week”榜单。平台口径是经 OpenRouter 路由的 prompt、completion 与 reasoning token 总和。
| 排名 | 模型 | 机构 | 周 token |
|---|---|---|---|
| 1 | MiMo-V2.5 | 小米 | 10.6T |
| 2 | DeepSeek V4 Flash | DeepSeek | 7T |
| 3 | Hy3 | 腾讯 | 5T |
| 4 | DeepSeek V4 Pro | DeepSeek | 3.49T |
| 5 | GLM 5.2 | 智谱 | 3.28T |
| 6 | Nemotron 3 Ultra (free) | NVIDIA | 2.6T |
| 7 | MiniMax M3 | MiniMax | 2.06T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 1.98T |
| 9 | Kimi K3 | 月之暗面 | 1.28T |
| 10 | Claude Opus 4.8 | Anthropic | 1.02T |
每周固定监测面
- 聚合平台:OpenRouter、Vercel AI Gateway 及其他公开路由平台的模型、token、周环比、免费/付费状态。
- 第一方:OpenAI、Anthropic、Google 与中国模型厂商公开的产品/API用量。
- 云渠道:AWS Bedrock、Google Vertex AI、Azure 等公开采用、调用或收入信号。
- 开放部署:模型下载、自托管推理、端侧调用及其可比口径。
- 结构扰动:促销、免费额度、模型上下架、路由规则、tokenizer、reasoning token 与长输出。
禁止偷换的四个指标
token ≠ 请求
同一任务的输入、输出和思考 token 会因模型与 tokenizer 不同而变化。
token ≠ 用户少数批处理客户可制造巨大 token,用量不能直接代表采用广度。
token ≠ 收入免费模型、补贴、缓存与输入/输出价差会使相同 token 对应完全不同的收入。
平台份额 ≠ 全球份额第一方产品、直连 API、云渠道、私有部署和端侧调用不在 OpenRouter 分母内。
本周判断
中国模型在 OpenRouter 这一低切换成本、价格敏感的聚合 API 市场取得显著用量优势,强化通用模型调用层价格下行和可替代性上升的方向;它没有证明中国模型已取得全球 token、收入、企业采用或利润优势。
升级条件
只有获得多平台同窗口数据、厂商或云渠道可核披露、统一 token/请求/收入定义,并能校验免费补贴和模型上下架影响,才尝试生成跨平台综合排名。字段不齐时保持局部榜。
来源
- OpenRouter Rankings(2026-07-30 直接复核)
- mhmcAI 文章(线索来源;14 倍及份额矛盾数字不采用)