全球开发者调用量前五,全是中国大模型了——OpenRouter 怎么用、选哪个,这篇讲清楚

8 月 2 日,央视新闻发了一条不算轰动但很有意思的消息:全球多模型聚合平台 OpenRouter 发布了最新一周 AI 大模型调用量榜单,前五名全是中国的

排第一的是小米 MiMo-V2.5,单周调用量 10.5 万亿 Token,环比涨了 12%。第二和第五都是 DeepSeek 的——一款主打性价比的 Flash 版和旗舰 Pro 版,形成高低搭配。第三名是腾讯混元 Hy3,7 月 6 日才开源,周环比直接飙了 999%。第四名是智谱 GLM 5.2。

你可能觉得这榜单跟自己没什么关系——”我又不是开发者”。但你想想:全球数万海外开发者、海外中小 AI 应用公司,用真金白银在 OpenRouter 上付费调用模型,结果投出来的前五全是国产。这说明什么?说明中国模型在”好用”和”便宜”这两个维度上,已经拿到了全球开发者的真金白银投票。

今天就讲三件事:OpenRouter 是什么、怎么注册使用,以及榜单上这五个模型分别适合什么场景、你该怎么选。


OpenRouter 是什么?一句话:一个 Key 调用 300+ 个模型

如果你之前被各种 AI 平台的 API Key 搞到头大——OpenAI 一个、Anthropic 一个、Google 一个、DeepSeek 又一个——OpenRouter 就是来解决这个问题的。

它的定位很简单:一个统一的 API 端点,一把 Key,调用 300 多个模型。不管是 GPT-5.6、Claude Opus 5、Gemini,还是 DeepSeek、Kimi K3、小米 MiMo,都用同一套代码调,换模型只需要改一个字符串。

具体来说,OpenRouter 做了三件事:

  1. 统一入口:所有模型通过 https://openrouter.ai/api/v1 这个地址调用,跟 OpenAI 的 API 完全兼容。你现有的 OpenAI SDK 代码不用改,换个 base_urlapi_key 就行。
  2. 统一计费:充值一次,所有模型的花销在一个面板上看。不用在每个供应商那里各开一个账户。
  3. 自动容灾:可以设置 fallback——主力模型挂了,自动切到备用模型,不用你写重试逻辑。

代价是什么?OpenRouter 在每个 API 调用上加收 5.5% 的手续费。对个人开发者来说,这点费用换来不用管理十几个 API Key 的便利,值。对跑量大用户来说,也可以用自己的 Key 走 BYOK 模式,免掉手续费。


五分钟注册上手:从零到第一次调用

第一步:注册并获取 API Key

openrouter.ai 注册账号,在 Keys 页面生成一个 API Key。OpenRouter 的 Key 以 sk-or- 开头,跟你手上的 OpenAI Key 不一样,别搞混了。

第二步:充值

OpenRouter 是预充值模式,最低充 5 美元就能开始用。部分模型(比如千问的某些版本)是免费的,不花钱也能试。建议第一次充 5-10 美元,够你把感兴趣的模型都跑一遍。

第三步:发第一个请求

用 Python 的 OpenAI SDK 最快:

Python
from openai import OpenAI

client = OpenAI(

    base_url="https://openrouter.ai/api/v1",

    api_key="sk-or-你的key"

)

response = client.chat.completions.create(

    model="deepseek/deepseek-chat",

    messages=[

        {"role": "user", "content": "用三句话解释什么是投机解码"}

    ]

)

print(response.choices[0].message.content)

就这样,改了 base_urlapi_key,其他代码一行不用动。想换模型?把 model 字段改成别的就行,比如 anthropic/claude-opus-5 或者 xiaomi/mimo-v2.5

如果你不想写代码,OpenRouter 还提供了 Playground 网页版,可以直接在浏览器里跟任何模型对话,还能并排对比不同模型的回答。注册后进去就能用,零门槛。


榜单前五逐个看:每个模型擅长什么

第一名:小米 MiMo-V2.5——调用量碾压全场

10.5 万亿 Token 单周调用量,什么概念?比第二名 DeepSeek 高了将近一倍。

MiMo-V2.5 是小米今年 4 月 23 日公测、4 月底全系列开源的模型。两个月时间,单周调用量从 1.5 万亿涨到 10.5 万亿,翻了 6 倍多。在 6 月份,小米还联合 TileRT 推出了 MiMo-V2.5-Pro-UltraSpeed 版本,成为全球第一款在通用 GPU 上推理速度突破 1000 tokens/s 的模型——这意味着等 AI 回话的时间从”秒级”压到”毫秒级”。

为什么这么火?小米团队的回答是:便宜、开源、Agent 能力稳。下载用户主要是独立开发者和三五人小团队,这类人群买不起大厂的全套 AI 基础设施,但需要一个能稳定跑 Agent 任务的底座。MiMo 恰好填了这个位置。

如果你的项目需要长期跑 Agent 任务、预算敏感、又想要稳定的工具调用能力,MiMo-V2.5 是个值得优先试的选项。之前我们专门写过一篇 小米 MiMo-V2 模型评测,感兴趣可以回顾。

第二名:DeepSeek V2 Flash——性价比之王的老款

注意,这里说的是 V2 Flash,不是前两天刚上的 V4 Flash。

DeepSeek V2 Flash 之所以还排在第二,是因为它已经跑了一段时间了,6.37 万亿 Token 的周调用量说明开发者对它的稳定性已经建立了信任。DeepSeek 的策略是高低搭配:V2 Flash 打性价比、覆盖日常需求,V4 Pro 打旗舰、对标海外顶级闭源模型。

刚发布的 V4-Flash 正式版 还没上到这个榜单,毕竟才上线两天。但以它在 Terminal Bench 2.1 拿到 82.7 分、Agent 能力暴涨 6 倍的表现来看,下周进榜几乎板上钉钉。

想深入了解 DeepSeek 的技术路线,可以看看之前的 DeepSeek V4 开源解析DSpark 推理加速框架指南

第三名:腾讯混元 Hy3——增长最猛的新人

7 月 6 日才正式开源,一周环比增长 999%——这个数字在榜单里最扎眼。

Hy3 是腾讯混元团队的开源模型,之前我们聊过 Hy3 preview 版的评测,以及腾讯混元刚开源的 AngelSpec 投机解码框架。Hy3 的特点是中文能力强、多模态支持好,加上腾讯的工程基础设施兜底,稳定性有保障。

999% 的环比增长说明它从零到一的渗透速度极快——开发者们发现了一个新的高质量开源模型,正在快速涌入。

第四名:智谱 GLM 5.2——老牌劲旅持续在线

智谱的 GLM 系列在国内 AI 圈算是”老牌”了,GLM-5.2 是最新版本。它没有像 MiMo 那样靠低价横扫,也没有像 Hy3 那样靠增长曲线刷屏,但一直稳定在前五——说明它有一批忠实的开发者群体在持续使用。

GLM 系列的特点是代码能力强、中文理解扎实,在编程辅助和知识问答场景表现稳定。如果你在做 AI 编程相关的项目,GLM 5.2 是一个靠谱的选择。之前我们写过 AI 编程工程化指南,里面也涉及了 GLM 系列在编程场景的应用。

第五名:DeepSeek V4 Pro——旗舰版对标海外顶级闭源

榜单第五是 DeepSeek 的旗舰 Pro 版本。官方说法是”在代码、复杂 Agent 任务上对标海外顶级闭源模型”。它排在第五不是因为不够强,而是因为价格比 V2 Flash 高——调用量自然少一些。但它存在的意义是给那些需要旗舰级能力、又不想被 OpenAI 锁死的开发者一个选择。


怎么选?一张表说清楚

模型核心优势适合场景调用成本
小米 MiMo-V2.5便宜、开源、Agent 稳Agent 任务、工具调用、预算敏感项目极低
DeepSeek V2 Flash性价比、生态成熟日常开发、文本处理、代码生成
腾讯混元 Hy3中文强、多模态中文场景、多模态应用中低
智谱 GLM 5.2代码强、稳定编程辅助、知识问答中低
DeepSeek V4 Pro旗舰能力复杂 Agent、高难度推理

实际选择的时候,建议先想清楚三件事:

1. 你的主要任务是什么? 如果是 Agent 工具调用,优先试 MiMo-V2.5 和 DeepSeek 系列。如果是中文内容处理,Hy3 更合适。如果偏编程,GLM 5.2 和 DeepSeek 都行。

2. 你的预算多少? OpenRouter 是按 Token 计费的,不同模型差价很大。如果你一个月只花几美元,MiMo-V2.5 和 DeepSeek V2 Flash 足够。如果你需要旗舰级推理能力,DeepSeek V4 Pro 的性价比仍然比 GPT-5.6 Sol 和 Claude Opus 5 高一大截。

3. 你需要私有化部署吗? 如果数据不能出内网,这些模型都有开源权重,可以在本地跑。之前写过一篇 本地部署大模型完全指南,覆盖了 Ollama 和 LM Studio 两条路线。Kimi K3 的权重也已经开源了,具体可以看 Kimi K3 权重部署指南。OpenAI 也在 7 月底开源了 gpt-oss,详见 gpt-oss 部署指南


国内用户的替代方案:千问 AI 平台

OpenRouter 虽好用,但有两个问题:一是需要美元支付,二是访问速度取决于你的网络环境。如果你在国内,还有一个更顺手的选择——阿里千问 AI 平台

千问 AI 平台的逻辑跟 OpenRouter 类似:一个 API Key 聚合了 Qwen、DeepSeek、Kimi 等百余个模型,个人版 39 元/月起,还有潮汐时段折扣。对于不想折腾美元支付的开发者来说,这是国内更省心的入口。之前我们专门评测过 Qwen3.6-Plus 的免费 API 体验,感兴趣可以看看。

如果你只是想快速试一下某个模型,不想注册任何平台,OpenRouter 的 Playground 页面可以直接用,不写代码也能对话。千问这边也有类似的网页端入口。


别光看榜单:三个实操建议

1. 先试再买。 OpenRouter 的 Playground 支持并排对比多个模型的回答。别急着写代码,先把你要对比的两三个模型丢进去跑一遍同样的 prompt,看输出质量再决定用哪个。这比看任何跑分都靠谱。

2. 用 fallback 省心又省钱。 OpenRouter 支持设置 fallback 链——主力模型用便宜的,比如 DeepSeek V2 Flash;如果挂了或者限流了,自动切到备用模型,比如 MiMo-V2.5。这样既省钱又不中断服务。配置方式很简单,在请求里加一个 route 字段就行:

Python
response = client.chat.completions.create(
    model="deepseek/deepseek-chat",
    messages=[...],
    extra_body={
        "route": "fallback",
        "models": [
            "deepseek/deepseek-chat",
            "xiaomi/mimo-v2.5",
            "zhipu/glm-5.2"
        ]
    }
)

3. 注意控制用量。 OpenRouter 的计费是实时的,但没有默认的日限额。建议在 Dashboard 里设一个每日消费上限,免得一觉醒来发现某个 Agent 跑飞了、几十美元没了。如果你之前被 GitHub Copilot 的按量计费搞过,那篇 Copilot 计费省钱指南 里总结的 token 管理方法在这里同样适用。


这波国产模型霸榜意味着什么

最后说几句感受。

HuggingFace 上中国开源模型的累计下载量已经全球第一,千问系列以超过 10 亿次下载量居首。OpenRouter 这份榜单是另一个维度的佐证:不只是”下载了看看”,而是全球开发者真金白银在付费调用。

小米的 MiMo 系列为什么能登顶?不是因为它在某项跑分上天下无敌,而是因为它在”够用”和”便宜”之间找到了最佳平衡点。独立开发者和小团队不需要天下第一的模型,他们需要一个稳定、便宜、能跑 Agent 的底座。MiMo 恰好满足了这个需求。

如果你之前一直在用 OpenAI 或 Claude 的 API,不妨花 5 美元在 OpenRouter 上试一下这些国产模型。你会发现自己花的钱可能只需要原来的十分之一,就能拿到差不多的效果。具体能省多少,可以参考之前那篇 AI 实战应用指南 里算过的账。

5 美元,试五个模型,值不值你自己判断。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

推荐阅读

  • 全球开发者调用量前五,全是中国大模型了——OpenRouter 怎么用、选哪个,这篇讲清楚

    8 月 2 日,央视新闻发了一条不算轰动但很有意思的消息:全球多模型聚合平台 OpenRouter 发布了最新一周 AI 大模型调用量榜单,前五名全是中国的。 排第一的是小米 MiMo-V2.5,单周…

  • DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90

    DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90 7 月 31 日下午,DeepSeek 悄悄干了一件大事——V4-Flash 正式版…

  • 国产开源视频模型终于能用了:MiniMax H3 上手指南,8 月 3 日开源,2K 直出 0.8 元/秒

    如果你最近刷到任何关于 AI 视频的新闻,八成会看到”价格又创新低”或者”开源阵营又添一员”这两条主线。7 月 31 日,这两条主线同时被一款叫 Min…

  • 把大模型推理速度翻倍:腾讯混元开源 AngelSpec,教你部署投机解码

    大模型推理贵、慢、卡,这件事困扰整个行业太久了。 7 月 30 日,腾讯混元团队甩出一个新开源项目:AngelSpec。这是一个端到端的投机解码(Speculative Decoding)训练与部署框…

暗夜独行