8 月 2 日,央视新闻发了一条不算轰动但很有意思的消息:全球多模型聚合平台 OpenRouter 发布了最新一周 AI 大模型调用量榜单,前五名全是中国的。
排第一的是小米 MiMo-V2.5,单周调用量 10.5 万亿 Token,环比涨了 12%。第二和第五都是 DeepSeek 的——一款主打性价比的 Flash 版和旗舰 Pro 版,形成高低搭配。第三名是腾讯混元 Hy3,7 月 6 日才开源,周环比直接飙了 999%。第四名是智谱 GLM 5.2。
你可能觉得这榜单跟自己没什么关系——”我又不是开发者”。但你想想:全球数万海外开发者、海外中小 AI 应用公司,用真金白银在 OpenRouter 上付费调用模型,结果投出来的前五全是国产。这说明什么?说明中国模型在”好用”和”便宜”这两个维度上,已经拿到了全球开发者的真金白银投票。
今天就讲三件事:OpenRouter 是什么、怎么注册使用,以及榜单上这五个模型分别适合什么场景、你该怎么选。
OpenRouter 是什么?一句话:一个 Key 调用 300+ 个模型
如果你之前被各种 AI 平台的 API Key 搞到头大——OpenAI 一个、Anthropic 一个、Google 一个、DeepSeek 又一个——OpenRouter 就是来解决这个问题的。
它的定位很简单:一个统一的 API 端点,一把 Key,调用 300 多个模型。不管是 GPT-5.6、Claude Opus 5、Gemini,还是 DeepSeek、Kimi K3、小米 MiMo,都用同一套代码调,换模型只需要改一个字符串。
具体来说,OpenRouter 做了三件事:
- 统一入口:所有模型通过
https://openrouter.ai/api/v1这个地址调用,跟 OpenAI 的 API 完全兼容。你现有的 OpenAI SDK 代码不用改,换个base_url和api_key就行。 - 统一计费:充值一次,所有模型的花销在一个面板上看。不用在每个供应商那里各开一个账户。
- 自动容灾:可以设置 fallback——主力模型挂了,自动切到备用模型,不用你写重试逻辑。
代价是什么?OpenRouter 在每个 API 调用上加收 5.5% 的手续费。对个人开发者来说,这点费用换来不用管理十几个 API Key 的便利,值。对跑量大用户来说,也可以用自己的 Key 走 BYOK 模式,免掉手续费。
五分钟注册上手:从零到第一次调用
第一步:注册并获取 API Key
去 openrouter.ai 注册账号,在 Keys 页面生成一个 API Key。OpenRouter 的 Key 以 sk-or- 开头,跟你手上的 OpenAI Key 不一样,别搞混了。
第二步:充值
OpenRouter 是预充值模式,最低充 5 美元就能开始用。部分模型(比如千问的某些版本)是免费的,不花钱也能试。建议第一次充 5-10 美元,够你把感兴趣的模型都跑一遍。
第三步:发第一个请求
用 Python 的 OpenAI SDK 最快:
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="sk-or-你的key"
)
response = client.chat.completions.create(
model="deepseek/deepseek-chat",
messages=[
{"role": "user", "content": "用三句话解释什么是投机解码"}
]
)
print(response.choices[0].message.content)
就这样,改了 base_url 和 api_key,其他代码一行不用动。想换模型?把 model 字段改成别的就行,比如 anthropic/claude-opus-5 或者 xiaomi/mimo-v2.5。
如果你不想写代码,OpenRouter 还提供了 Playground 网页版,可以直接在浏览器里跟任何模型对话,还能并排对比不同模型的回答。注册后进去就能用,零门槛。
榜单前五逐个看:每个模型擅长什么
第一名:小米 MiMo-V2.5——调用量碾压全场
10.5 万亿 Token 单周调用量,什么概念?比第二名 DeepSeek 高了将近一倍。
MiMo-V2.5 是小米今年 4 月 23 日公测、4 月底全系列开源的模型。两个月时间,单周调用量从 1.5 万亿涨到 10.5 万亿,翻了 6 倍多。在 6 月份,小米还联合 TileRT 推出了 MiMo-V2.5-Pro-UltraSpeed 版本,成为全球第一款在通用 GPU 上推理速度突破 1000 tokens/s 的模型——这意味着等 AI 回话的时间从”秒级”压到”毫秒级”。
为什么这么火?小米团队的回答是:便宜、开源、Agent 能力稳。下载用户主要是独立开发者和三五人小团队,这类人群买不起大厂的全套 AI 基础设施,但需要一个能稳定跑 Agent 任务的底座。MiMo 恰好填了这个位置。
如果你的项目需要长期跑 Agent 任务、预算敏感、又想要稳定的工具调用能力,MiMo-V2.5 是个值得优先试的选项。之前我们专门写过一篇 小米 MiMo-V2 模型评测,感兴趣可以回顾。
第二名:DeepSeek V2 Flash——性价比之王的老款
注意,这里说的是 V2 Flash,不是前两天刚上的 V4 Flash。
DeepSeek V2 Flash 之所以还排在第二,是因为它已经跑了一段时间了,6.37 万亿 Token 的周调用量说明开发者对它的稳定性已经建立了信任。DeepSeek 的策略是高低搭配:V2 Flash 打性价比、覆盖日常需求,V4 Pro 打旗舰、对标海外顶级闭源模型。
刚发布的 V4-Flash 正式版 还没上到这个榜单,毕竟才上线两天。但以它在 Terminal Bench 2.1 拿到 82.7 分、Agent 能力暴涨 6 倍的表现来看,下周进榜几乎板上钉钉。
想深入了解 DeepSeek 的技术路线,可以看看之前的 DeepSeek V4 开源解析 和 DSpark 推理加速框架指南。
第三名:腾讯混元 Hy3——增长最猛的新人
7 月 6 日才正式开源,一周环比增长 999%——这个数字在榜单里最扎眼。
Hy3 是腾讯混元团队的开源模型,之前我们聊过 Hy3 preview 版的评测,以及腾讯混元刚开源的 AngelSpec 投机解码框架。Hy3 的特点是中文能力强、多模态支持好,加上腾讯的工程基础设施兜底,稳定性有保障。
999% 的环比增长说明它从零到一的渗透速度极快——开发者们发现了一个新的高质量开源模型,正在快速涌入。
第四名:智谱 GLM 5.2——老牌劲旅持续在线
智谱的 GLM 系列在国内 AI 圈算是”老牌”了,GLM-5.2 是最新版本。它没有像 MiMo 那样靠低价横扫,也没有像 Hy3 那样靠增长曲线刷屏,但一直稳定在前五——说明它有一批忠实的开发者群体在持续使用。
GLM 系列的特点是代码能力强、中文理解扎实,在编程辅助和知识问答场景表现稳定。如果你在做 AI 编程相关的项目,GLM 5.2 是一个靠谱的选择。之前我们写过 AI 编程工程化指南,里面也涉及了 GLM 系列在编程场景的应用。
第五名:DeepSeek V4 Pro——旗舰版对标海外顶级闭源
榜单第五是 DeepSeek 的旗舰 Pro 版本。官方说法是”在代码、复杂 Agent 任务上对标海外顶级闭源模型”。它排在第五不是因为不够强,而是因为价格比 V2 Flash 高——调用量自然少一些。但它存在的意义是给那些需要旗舰级能力、又不想被 OpenAI 锁死的开发者一个选择。
怎么选?一张表说清楚
| 模型 | 核心优势 | 适合场景 | 调用成本 |
|---|---|---|---|
| 小米 MiMo-V2.5 | 便宜、开源、Agent 稳 | Agent 任务、工具调用、预算敏感项目 | 极低 |
| DeepSeek V2 Flash | 性价比、生态成熟 | 日常开发、文本处理、代码生成 | 低 |
| 腾讯混元 Hy3 | 中文强、多模态 | 中文场景、多模态应用 | 中低 |
| 智谱 GLM 5.2 | 代码强、稳定 | 编程辅助、知识问答 | 中低 |
| DeepSeek V4 Pro | 旗舰能力 | 复杂 Agent、高难度推理 | 中 |
实际选择的时候,建议先想清楚三件事:
1. 你的主要任务是什么? 如果是 Agent 工具调用,优先试 MiMo-V2.5 和 DeepSeek 系列。如果是中文内容处理,Hy3 更合适。如果偏编程,GLM 5.2 和 DeepSeek 都行。
2. 你的预算多少? OpenRouter 是按 Token 计费的,不同模型差价很大。如果你一个月只花几美元,MiMo-V2.5 和 DeepSeek V2 Flash 足够。如果你需要旗舰级推理能力,DeepSeek V4 Pro 的性价比仍然比 GPT-5.6 Sol 和 Claude Opus 5 高一大截。
3. 你需要私有化部署吗? 如果数据不能出内网,这些模型都有开源权重,可以在本地跑。之前写过一篇 本地部署大模型完全指南,覆盖了 Ollama 和 LM Studio 两条路线。Kimi K3 的权重也已经开源了,具体可以看 Kimi K3 权重部署指南。OpenAI 也在 7 月底开源了 gpt-oss,详见 gpt-oss 部署指南。
国内用户的替代方案:千问 AI 平台
OpenRouter 虽好用,但有两个问题:一是需要美元支付,二是访问速度取决于你的网络环境。如果你在国内,还有一个更顺手的选择——阿里千问 AI 平台。
千问 AI 平台的逻辑跟 OpenRouter 类似:一个 API Key 聚合了 Qwen、DeepSeek、Kimi 等百余个模型,个人版 39 元/月起,还有潮汐时段折扣。对于不想折腾美元支付的开发者来说,这是国内更省心的入口。之前我们专门评测过 Qwen3.6-Plus 的免费 API 体验,感兴趣可以看看。
如果你只是想快速试一下某个模型,不想注册任何平台,OpenRouter 的 Playground 页面可以直接用,不写代码也能对话。千问这边也有类似的网页端入口。
别光看榜单:三个实操建议
1. 先试再买。 OpenRouter 的 Playground 支持并排对比多个模型的回答。别急着写代码,先把你要对比的两三个模型丢进去跑一遍同样的 prompt,看输出质量再决定用哪个。这比看任何跑分都靠谱。
2. 用 fallback 省心又省钱。 OpenRouter 支持设置 fallback 链——主力模型用便宜的,比如 DeepSeek V2 Flash;如果挂了或者限流了,自动切到备用模型,比如 MiMo-V2.5。这样既省钱又不中断服务。配置方式很简单,在请求里加一个 route 字段就行:
response = client.chat.completions.create(
model="deepseek/deepseek-chat",
messages=[...],
extra_body={
"route": "fallback",
"models": [
"deepseek/deepseek-chat",
"xiaomi/mimo-v2.5",
"zhipu/glm-5.2"
]
}
)
3. 注意控制用量。 OpenRouter 的计费是实时的,但没有默认的日限额。建议在 Dashboard 里设一个每日消费上限,免得一觉醒来发现某个 Agent 跑飞了、几十美元没了。如果你之前被 GitHub Copilot 的按量计费搞过,那篇 Copilot 计费省钱指南 里总结的 token 管理方法在这里同样适用。
这波国产模型霸榜意味着什么
最后说几句感受。
HuggingFace 上中国开源模型的累计下载量已经全球第一,千问系列以超过 10 亿次下载量居首。OpenRouter 这份榜单是另一个维度的佐证:不只是”下载了看看”,而是全球开发者真金白银在付费调用。
小米的 MiMo 系列为什么能登顶?不是因为它在某项跑分上天下无敌,而是因为它在”够用”和”便宜”之间找到了最佳平衡点。独立开发者和小团队不需要天下第一的模型,他们需要一个稳定、便宜、能跑 Agent 的底座。MiMo 恰好满足了这个需求。
如果你之前一直在用 OpenAI 或 Claude 的 API,不妨花 5 美元在 OpenRouter 上试一下这些国产模型。你会发现自己花的钱可能只需要原来的十分之一,就能拿到差不多的效果。具体能省多少,可以参考之前那篇 AI 实战应用指南 里算过的账。
5 美元,试五个模型,值不值你自己判断。




发表回复