0 个完整生产迁移案例。公开资料证明模型调用层正在标准化,OpenRouter 也显示低切换成本市场中的模型用量能快速迁移;但仍缺迁移范围、时间、人工、回归失败、质量/成本变化与恢复结果。Q1 维持 72%。
反证矩阵
更换 base URL、API key 和 model name 即可用 OpenAI SDK 测试 Claude;但官方明确兼容层主要用于测试比较,并非多数场景的长期生产方案,strict、音频、缓存与消息语义存在差异。
Google · 调用层可移植官方称可不改现有代码,低成本切换并比较 OpenAI 与托管模型;但参数语义、认证、数据和治理仍有平台差异。
GitHub Copilot · 模型可换、平台不换同一聊天可切换模型并保持上下文,也可接入 Anthropic、Gemini、OpenAI 等供应商;用户仍留在 Copilot 的 IDE、组织策略、上下文、计费和工作流。
三个不能偷换
- 三行代码能调用,不等于生产迁移完成;
- 同一平台能换模型,不等于能低成本离开平台;
- 请求格式兼容,不等于 tool use、结构化输出、缓存、质量与安全语义一致。
OpenRouter 提供了一个窄但真实的市场信号
2026 年 7 月 30 日直接复核 OpenRouter 周榜,前五名均为中国模型,前十中占八席。这支持一个窄结论:在能低成本切换模型、且免费与低价模型占比较高的聚合 API 市场中,中国模型获得了显著 token 使用量。
OpenRouter 不覆盖 ChatGPT、Claude、Gemini 等第一方产品与直接 API,也不覆盖大量云渠道、私有部署和端侧调用。
token 不是商业结果榜单统计 prompt、completion 与 reasoning token 总和;它不是用户数、请求数、收入、支出、成功任务或企业生产采用。免费补贴、输出长度和推理 token 都会放大用量。
二手文章的数学冲突文章同时给出“中国 33T / 美国 2.34T(14.1 倍)”与“中国 63.5% / 美国 35.5%(1.79 倍)”,无法在同一 token 口径下同时成立,因此不采用“14 倍全球差距”。
结论修正
模型 API 锁定正在下降;生产系统锁定尚未被推翻。OpenRouter 榜单强化低切换成本市场中的模型可替代性,却没有证明完整生产迁移、全球模型份额或长期利润。
唯一触发条件
真实企业跨供应商或跨平台迁移,必须同时披露迁移范围、天数、人工小时、失败率、质量、延迟、每成功任务成本和事故恢复。字段不足只登记接口兼容信号,不调整 Q1。
补充来源
- OpenRouter Rankings(2026-07-30 实时复核)
- mhmcAI 二手统计文章(只作线索,矛盾数字不采用)