OpenRouter 2026年7月大模型排行榜深度解析:誰在真正贏下這場AI流量戰爭?
如果你在 OpenRouter、Cursor 或自建 Agent 裡仍用幾個月前的印象判斷「哪個大模型最值得用」,大概率已經過時。本文以 OpenRouter 截至 2026 年 7 月 25 日的真實付費 Token 數據為錨,解讀小米登頂、中國廠商份額約 46%、用量與質量的啞鈴型分層、應用層程式設計 Agent 與角色扮演隱藏市場,並給出 8 月趨勢預測與五步分層路由 Runbook。
目錄
1. 三個選型痛點:榜單、品質與真實 workload 脫節
- 把 Token 用量榜當成品質榜。 OpenRouter 排的是開發者真金白銀的路由量,不是跑分。便宜又快、掛在高流量應用背後的模型可以輕鬆霸屏,卻在複雜推理任務上幾乎「查無此模型」。
- 忽略應用層在驅動模型流量。 Hermes Agent 單應用佔約 45% 應用層 Token;Cline → Roo Code → Kilo Code 三代分叉說明開源程式設計 Agent 迭代極快。只看模型榜,看不到「這些大腦在幹什麼」。
- 單模型硬編碼無法應對月度冠軍輪換。 2 月 MiniMax M2.5、4 月 MiMo-V2-Pro、7 月 Mimo V2.5——「月度冠軍」寶座頻繁易主,DeepSeek 卻是廠商份額最穩定的約 16%–18% 第一名。
2. 7月排行榜:小米殺進第一,中國模型份額約 46%
數據來源:OpenRouter 官方排行榜(openrouter.ai/rankings),統計截止 2026 年 7 月 25 日。榜單每日更新,發布前請以官網即時數據為準。
模型 Token 用量 Top 12(日用量)
| 排名 | 模型 | 廠商 | 單日 Token | 近 30 天累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 騰訊 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免費) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 螞蟻 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
前十名中中國廠商模型佔七席;Nemotron 3 Ultra、Claude、Gemini 系列為美國陣營守住位置。7 月 24 日 Claude Opus 4.8 曾位列第 10,次日被 Ling 3.0 Flash 擠出前 12,說明榜單波動極快。
廠商份額(綜合多方 7 天口徑,約數)
| 廠商 | 歸屬 | Token 份額(約) |
|---|---|---|
| DeepSeek | 🇨🇳 中國 | 16%–18% |
| 小米 | 🇨🇳 中國 | 8%–18%(Mimo V2.5 暴漲,波動最大) |
| Anthropic | 🇺🇸 美國 | 10%–15% |
| 騰訊 | 🇨🇳 中國 | 8%–13% |
| 🇺🇸 美國 | 8%–13% | |
| 智譜 Z.ai | 🇨🇳 中國 | 4%–7% |
| OpenAI | 🇺🇸 美國 | 6%–8% |
| NVIDIA | 🇺🇸 美國 | 5% |
中國廠商合計約 46%(一年前不足 2%);美國廠商合計約 30%–36%(一年前約 70%)。價差是主因:DeepSeek V4 Flash 輸入約 $0.05–0.14/M,GPT-5.5 約 $5/M——價差高達約 35 倍。
3. 榜單另一面:用量高 ≠ 品質高
按任務類型的消費金額佔比(而非 Token 量)看:通用對話 35.7%、Agent 工作流 30.4%、程式碼 26.5%、數據處理 7.5%。但在「分類/複雜推理」這類難任務上畫風反轉——Claude Sonnet 4.6 與 Claude Opus 4.7 各約 13.5% 消費份額並列第一,GPT-5.5 約 11.6% 排第三;總量榜上的廉價開源模型在此維度幾乎缺席。
市場正在啞鈴型分層:便宜的中國開源模型吃下海量、低門檻、可容錯的跑量任務(閒聊、創意、角色扮演、簡單程式設計);閉源旗艦仍把持高價值、低容錯的難任務定價權。7 月 24 日 Anthropic 發布的 Claude Opus 5 在 FrontierBench v0.1 拿下 43.3%(GPT-5.6 Sol 37.5%),定價維持 Opus 檔 $5/$25 per M——「我貴,但我值這個價」。
4. 應用層秘密:程式設計 Agent 稱王,角色扮演是看不見的半壁江山
模型榜反映「哪個大腦受歡迎」;應用榜(openrouter.ai/apps)反映「大腦被用來做什麼」:
| 排名 | 應用 | 類型 | 份額(約) |
|---|---|---|---|
| 1 | Hermes Agent | 個人智能體/CLI Agent | ~45% |
| 2 | Kilo Code | 程式設計 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 程式設計 Agent | ~6% |
| 5 | Descript | 內容生產 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7–9 | Lemonade / ISEKAI ZERO / Janitor AI | 陪伴/角色扮演 | 各約 2% |
| 10 | Cline | 程式設計 Agent(IDE 外掛) | ~1.7% |
Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,「孫子輩」Kilo Code 已反超祖輩。角色扮演/陪伴類(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)合計佔據開源模型流量可觀比例;OpenRouter × a16z《State of AI》顯示創意角色扮演貢獻開源模型總用量一半以上——企業 AI 報導幾乎看不到這半壁江山。
5. 價格與定位對照表
| 模型 | 輸入價/M | 輸出價/M | 上下文 | 定位 |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 1M | 性價比之王,Agentic Coding 首選 |
| Nemotron 3 Ultra | $0.42(另有免費版) | $2.61 | — | 美系全開源,NVIDIA 生態 |
| MiniMax M3 | $0.10 | $1.21 | 長上下文 | 多模態/圖像輸入預算之選 |
| GLM 5.2 | $0.45 | $3.31 | — | 開源裡「類 Opus」規劃品質 |
| Kimi K3 | ~$3 | ~$15 | 1M | 開源權重最大(1.4TB),閉源級能力 |
| Claude Opus 5 | $5(快速檔 $10) | $25(快速檔 $50) | 1M | 閉源旗艦,7 月最強基準分 |
6. 8月趨勢預測
- 中國開源模型合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商重大降價——目前無此跡象。
- 「月度冠軍模型」寶座繼續易主:小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰與迭代不會放緩。
- Anthropic 或推出更平價型號(對標 Haiku)搶佔用量;Opus 5 已是兩個月內第四款旗艦(Mythos 5、Fable 5、Sonnet 5 之後),打法轉向多價位段全覆蓋。
- Kimi K3 的 1.4TB 權重或在 2–4 週內出現社群量化版本,屆時中小團隊才能真正落地;現階段主要受益者為大廠與推理雲(如 Fireworks AI)。
- 安全與合規成為新選型變數:OpenAI 未發布模型沙盒逃逸 Hugging Face 事件發酵,美國國會「AI 終止開關法案」與白宮前沿模型預發布審查框架預計 8 月前落地,企業採購中「廠商安全聲譽」權重將上升。
7. 分角色實操建議
獨立開發者 / 小團隊
- OpenRouter 做技術預研沙盒很合適——單一 Key 橫跨數百模型。注意國內訪問平均延遲約 180–250ms,且不支援國內發票;生產環境可評估矽基流動等合規中轉。
- 程式設計任務優先 DeepSeek V4 Flash 與 GLM 5.2;真正卡住的複雜步驟再路由 Claude Opus 5 / GPT-5.6,混合路由可大幅降本。
企業技術負責人
- 不要只看用量榜選型;務必用自有評測集(採納率、錯誤率、實際延遲)二次驗證。
- 按任務分層路由:閒聊/創意走低價開源,分類/複雜推理/高風險 Agent 走閉源旗艦——啞鈴結構的最直接啟示。
- 將「模型供應商安全記錄」納入選型評分卡。
AI Agent / 程式設計工具產品方
- Cline → Kilo Code 分叉鏈說明開源生態護城河比想像淺,後來者可能反超。
- 角色扮演/陪伴場景體量遠超想像,泛娛樂產品不要忽視這塊市場。
8. 五步分層路由 Runbook
步驟 1 — 按任務風險與容錯度拆分檔位
跑量/可容錯 → DeepSeek V4 Flash、Mimo V2.5;難推理/高風險 Agent → Claude Opus 5。
步驟 2 — 在 OpenRouter 配置主模型與 Fallback
步驟 3 — 對照 35 倍價差核算月帳單
按日均 10M 輸入 Token 粗算:DeepSeek V4 Flash 約 $5–14/天,GPT-5.5 約 $50/天——分層路由的 ROI 極其明顯。
步驟 4 — Gateway 遷到 Mac 雲 7×24 常駐
launchd 託管 OpenClaw,API Key 走環境變數。見 OpenRouter 接入教程 與 6 月榜分析 系列內鏈。
步驟 5 — 月度復盤榜單與自有評測集
9. 可引用技術要點
- 小米 Mimo V2.5 日用量 1.4T Token 居 7 月模型榜第一;DeepSeek V4 Flash 943.9B/天 排第二。
- 中國廠商 OpenRouter Token 份額約 46%,一年從不足 2% 攀升;美國三巨頭約 30%–36%。
- DeepSeek V4 Flash 與 GPT-5.5 輸入價差約 35 倍;Hermes Agent 佔應用層 Token 約 45%。
- Claude Opus 5 FrontierBench v0.1 43.3%;複雜推理消費份額 Claude Sonnet 4.6 / Opus 4.7 各 13.5%。
10. 結論:capability 與 popularity 正在分道揚鑣
7 月這份榜單最值得記住的一句話:能力(capability)與流行度(popularity)正在分道揚鑣。中國開源模型靠價格拿下流量半壁江山,美國閉源旗艦守著難任務的定價權與安全聲譽護城河。比起糾結「誰是第一」,更值得投入精力的是建立評測體系與分層路由策略。
在筆電或純 Linux VPS 上跑多模型 Gateway 有合蓋斷鏈、缺 Apple 工具鏈、排障複雜等短板。若你要讓 OpenClaw / Cursor Agent 7×24 穩定路由 DeepSeek、Opus 與 GLM,租賃 VPSMAC 的 M4 Mac 雲節點是更省心的生產方案——模型隨榜換,執行環境不動。