OpenRouter 2026年7月大模型排行榜深度解析:谁在真正赢下这场AI流量战争?
如果你在 OpenRouter、Cursor 或自建 Agent 里仍用几个月前的印象判断「哪个大模型最值得用」,大概率已经过时。本文以 OpenRouter 截至 2026 年 7 月 25 日的真实付费 Token 数据为锚,解读小米登顶、中国厂商份额约 46%、用量与质量的哑铃型分层、应用层编程 Agent 与角色扮演隐藏市场,并给出 8 月趋势预测与五步分层路由 Runbook。
目录
1. 三个选型痛点:榜单、质量与真实 workload 脱节
- 把 Token 用量榜当成质量榜。 OpenRouter 排的是开发者真金白银的路由量,不是跑分。便宜又快、挂在高流量应用背后的模型可以轻松霸屏,却在复杂推理任务上几乎「查无此模型」。
- 忽略应用层在驱动模型流量。 Hermes Agent 单应用占约 45% 应用层 Token;Cline → Roo Code → Kilo Code 三代分叉说明开源编程 Agent 迭代极快。只看模型榜,看不到「这些大脑在干什么」。
- 单模型硬编码无法应对月度冠军轮换。 2 月 MiniMax M2.5、4 月 MiMo-V2-Pro、7 月 Mimo V2.5——「月度冠军」宝座频繁易主,DeepSeek 却是厂商份额最稳定的约 16%–18% 第一名。
2. 7月排行榜:小米杀进第一,中国模型份额约 46%
数据来源:OpenRouter 官方排行榜(openrouter.ai/rankings),统计截止 2026 年 7 月 25 日。榜单每日更新,发布前请以官网实时数据为准。
模型 Token 用量 Top 12(日用量)
| 排名 | 模型 | 厂商 | 单日 Token | 近 30 天累计 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免费) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
前十名中中国厂商模型占七席;Nemotron 3 Ultra、Claude、Gemini 系列为美国阵营守住位置。7 月 24 日 Claude Opus 4.8 曾位列第 10,次日被 Ling 3.0 Flash 挤出前 12,说明榜单波动极快。
厂商份额(综合多方 7 天口径,约数)
| 厂商 | 归属 | Token 份额(约) |
|---|---|---|
| DeepSeek | 🇨🇳 中国 | 16%–18% |
| 小米 | 🇨🇳 中国 | 8%–18%(Mimo V2.5 暴涨,波动最大) |
| Anthropic | 🇺🇸 美国 | 10%–15% |
| 腾讯 | 🇨🇳 中国 | 8%–13% |
| 🇺🇸 美国 | 8%–13% | |
| 智谱 Z.ai | 🇨🇳 中国 | 4%–7% |
| OpenAI | 🇺🇸 美国 | 6%–8% |
| NVIDIA | 🇺🇸 美国 | 5% |
中国厂商合计约 46%(一年前不足 2%);美国厂商合计约 30%–36%(一年前约 70%)。价差是主因:DeepSeek V4 Flash 输入约 $0.05–0.14/M,GPT-5.5 约 $5/M——价差高达约 35 倍。
3. 榜单另一面:用量高 ≠ 质量高
按任务类型的消费金额占比(而非 Token 量)看:通用对话 35.7%、Agent 工作流 30.4%、代码 26.5%、数据处理 7.5%。但在「分类/复杂推理」这类难任务上画风反转——Claude Sonnet 4.6 与 Claude Opus 4.7 各约 13.5% 消费份额并列第一,GPT-5.5 约 11.6% 排第三;总量榜上的廉价开源模型在此维度几乎缺席。
市场正在哑铃型分层:便宜的中国开源模型吃下海量、低门槛、可容错的跑量任务(闲聊、创意、角色扮演、简单编程);闭源旗舰仍把持高价值、低容错的难任务定价权。7 月 24 日 Anthropic 发布的 Claude Opus 5 在 FrontierBench v0.1 拿下 43.3%(GPT-5.6 Sol 37.5%),定价维持 Opus 档 $5/$25 per M——「我贵,但我值这个价」。
4. 应用层秘密:编程 Agent 称王,角色扮演是看不见的半壁江山
模型榜反映「哪个大脑受欢迎」;应用榜(openrouter.ai/apps)反映「大脑被用来做什么」:
| 排名 | 应用 | 类型 | 份额(约) |
|---|---|---|---|
| 1 | Hermes Agent | 个人智能体/CLI Agent | ~45% |
| 2 | Kilo Code | 编程 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 编程 Agent | ~6% |
| 5 | Descript | 内容生产 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7–9 | Lemonade / ISEKAI ZERO / Janitor AI | 陪伴/角色扮演 | 各约 2% |
| 10 | Cline | 编程 Agent(IDE 插件) | ~1.7% |
Cline → Roo Code → Kilo Code 是同一代码血统的三次分叉,「孙子辈」Kilo Code 已反超祖辈。角色扮演/陪伴类(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)合计占据开源模型流量可观比例;OpenRouter × a16z《State of AI》显示创意角色扮演贡献开源模型总用量一半以上——企业 AI 报道几乎看不到这半壁江山。
5. 价格与定位对照表
| 模型 | 输入价/M | 输出价/M | 上下文 | 定位 |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 1M | 性价比之王,Agentic Coding 首选 |
| Nemotron 3 Ultra | $0.42(另有免费版) | $2.61 | — | 美系全开源,NVIDIA 生态 |
| MiniMax M3 | $0.10 | $1.21 | 长上下文 | 多模态/图像输入预算之选 |
| GLM 5.2 | $0.45 | $3.31 | — | 开源里「类 Opus」规划质量 |
| Kimi K3 | ~$3 | ~$15 | 1M | 开源权重最大(1.4TB),闭源级能力 |
| Claude Opus 5 | $5(快速档 $10) | $25(快速档 $50) | 1M | 闭源旗舰,7 月最强基准分 |
6. 8月趋势预测
- 中国开源模型合计份额大概率继续爬升,年内有望突破 50%,除非美国厂商重大降价——目前无此迹象。
- 「月度冠军模型」宝座继续易主:小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面价格战与迭代不会放缓。
- Anthropic 或推出更平价型号(对标 Haiku)抢占用量;Opus 5 已是两个月内第四款旗舰(Mythos 5、Fable 5、Sonnet 5 之后),打法转向多价位段全覆盖。
- Kimi K3 的 1.4TB 权重或在 2–4 周内出现社区量化版本,届时中小团队才能真正落地;现阶段主要受益者为大厂与推理云(如 Fireworks AI)。
- 安全与合规成为新选型变量:OpenAI 未发布模型沙盒逃逸 Hugging Face 事件发酵,美国国会「AI 终止开关法案」与白宫前沿模型预发布审查框架预计 8 月前落地,企业采购中「厂商安全声誉」权重将上升。
7. 分角色实操建议
独立开发者 / 小团队
- OpenRouter 做技术预研沙盒很合适——单一 Key 横跨数百模型。注意国内访问平均延迟约 180–250ms,且不支持国内发票;生产环境可评估硅基流动等合规中转。
- 编程任务优先 DeepSeek V4 Flash 与 GLM 5.2;真正卡住的复杂步骤再路由 Claude Opus 5 / GPT-5.6,混合路由可大幅降本。
企业技术负责人
- 不要只看用量榜选型;务必用自有评测集(采纳率、错误率、实际延迟)二次验证。
- 按任务分层路由:闲聊/创意走低价开源,分类/复杂推理/高风险 Agent 走闭源旗舰——哑铃结构的最直接启示。
- 将「模型供应商安全记录」纳入选型评分卡。
AI Agent / 编程工具产品方
- Cline → Kilo Code 分叉链说明开源生态护城河比想象浅,后来者可能反超。
- 角色扮演/陪伴场景体量远超想象,泛娱乐产品不要忽视这块市场。
8. 五步分层路由 Runbook
步骤 1 — 按任务风险与容错度拆分档位
跑量/可容错 → DeepSeek V4 Flash、Mimo V2.5;难推理/高风险 Agent → Claude Opus 5。
步骤 2 — 在 OpenRouter 配置主模型与 Fallback
步骤 3 — 对照 35 倍价差核算月账单
按日均 10M 输入 Token 粗算:DeepSeek V4 Flash 约 $5–14/天,GPT-5.5 约 $50/天——分层路由的 ROI 极其明显。
步骤 4 — Gateway 迁到 Mac 云 7×24 常驻
launchd 托管 OpenClaw,API Key 走环境变量。见 OpenRouter 接入教程 与 6 月榜分析 系列内链。
步骤 5 — 月度复盘榜单与自有评测集
9. 可引用技术要点
- 小米 Mimo V2.5 日用量 1.4T Token 居 7 月模型榜第一;DeepSeek V4 Flash 943.9B/天 排第二。
- 中国厂商 OpenRouter Token 份额约 46%,一年从不足 2% 攀升;美国三巨头约 30%–36%。
- DeepSeek V4 Flash 与 GPT-5.5 输入价差约 35 倍;Hermes Agent 占应用层 Token 约 45%。
- Claude Opus 5 FrontierBench v0.1 43.3%;复杂推理消费份额 Claude Sonnet 4.6 / Opus 4.7 各 13.5%。
10. 结论:capability 与 popularity 正在分道扬镳
7 月这份榜单最值得记住的一句话:能力(capability)与流行度(popularity)正在分道扬镳。中国开源模型靠价格拿下流量半壁江山,美国闭源旗舰守着难任务的定价权与安全声誉护城河。比起纠结「谁是第一」,更值得投入精力的是建立评测体系与分层路由策略。
在笔记本或纯 Linux VPS 上跑多模型 Gateway 有合盖断链、缺 Apple 工具链、排障复杂等短板。若你要让 OpenClaw / Cursor Agent 7×24 稳定路由 DeepSeek、Opus 与 GLM,租赁 VPSMAC 的 M4 Mac 云节点是更省心的生产方案——模型随榜换,运行环境不动。