Рейтинги OpenRouter за июль 2026: кто на самом деле выигрывает войну за AI-трафик?
Если вы в OpenRouter, Cursor или своём Agent всё ещё выбираете LLM по картине нескольких месяцев назад — вы, скорее всего, отстали. Эта статья опирается на реальный платный трафик OpenRouter до 25 июля 2026: Xiaomi Mimo V2.5 на вершине, китайские провайдеры около 46%, «штанга» объём/качество, coding-агенты и невидимый рынок roleplay — плюс прогноз на август и пятишаговый runbook многоуровневой маршрутизации.
Содержание
- 1. Три боли при выборе
- 2. Рейтинг июля: модели и провайдеры
- 3. Большой объём ≠ высокое качество
- 4. Уровень приложений: coding-агенты и скрытый рынок
- 5. Таблица цен и позиционирования
- 6. Прогноз на август
- 7. Советы по ролям
- 8. Пятишаговый runbook многоуровневой маршрутизации
- 9. Цитируемые технические факты
- 10. Заключение
1. Три боли: рейтинг, качество и реальные workloads расходятся
- Путать рейтинг по токенам с рейтингом качества. OpenRouter сортирует по реально оплаченному routing-трафику — не по бенчмаркам. Дешёвые быстрые модели за high-traffic приложениями легко доминируют, но почти исчезают в сложном reasoning.
- Игнорировать уровень приложений как драйвер трафика. Hermes Agent один около 45% app-токенов; Cline → Roo Code → Kilo Code показывает скорость форков open-source coding-агентов. Только рейтинг моделей не показывает «для чего используются эти мозги».
- Хардкод одной модели при ежемесячной смене чемпиона. Февраль MiniMax M2.5, апрель MiMo-V2-Pro, июль Mimo V2.5 — «месячный чемпион» меняется часто; DeepSeek остаётся самым стабильным провайдером с около 16-18%.
2. Рейтинг июля: Xiaomi на первом месте, китайские модели около 46%
Источник: официальный рейтинг OpenRouter (openrouter.ai/rankings), данные на 25 июля 2026. Рейтинг обновляется ежедневно — перед публикацией проверяйте live-данные на сайте.
Top 12 моделей по токенам (суточно)
| Место | Модель | Провайдер | Токенов/день | 30 дней накопленно |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (бесплатно) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot | 157,6B | 1,6T (новинка) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
Семь из топ-10 — китайские модели; Nemotron 3 Ultra, Claude и Gemini держат позиции за США. 24 июля Claude Opus 4.8 был ещё 10-м, 25-го выбит Ling 3.0 Flash из топ-12 — рейтинг меняется крайне быстро.
Доли провайдеров (7 дней, несколько источников, округлено)
| Провайдер | Регион | Доля токенов (ок.) |
|---|---|---|
| DeepSeek | 🇨🇳 Китай | 16-18% |
| Xiaomi | 🇨🇳 Китай | 8-18% (скачок Mimo V2.5, максимальная волатильность) |
| Anthropic | 🇺🇸 США | 10-15% |
| Tencent | 🇨🇳 Китай | 8-13% |
| 🇺🇸 США | 8-13% | |
| Z.ai | 🇨🇳 Китай | 4-7% |
| OpenAI | 🇺🇸 США | 6-8% |
| NVIDIA | 🇺🇸 США | 5% |
Китайские провайдеры вместе около 46% (год назад менее 2%); US-провайдеры вместе около 30-36% (год назад около 70%). Главная причина — цена: DeepSeek V4 Flash input около $0,05-0,14/M, GPT-5.5 около $5/M — разница до 35 раз.
3. Обратная сторона: большой объём ≠ высокое качество
По доле расходов (не объёму токенов) по типу задачи: общий диалог 35,7%, Agent-workflows 30,4%, код 26,5%, обработка данных 7,5%. В сложной классификации/reasoning картина переворачивается — Claude Sonnet 4.6 и Claude Opus 4.7 по около 13,5% расходов делят первое место, GPT-5.5 около 11,6% на третьем; дешёвые open-source модели из объёмного рейтинга здесь почти отсутствуют.
Рынок формирует «штангу»: дешёвые китайские open-source модели поглощают массовые нагрузки с высокой толерантностью к ошибкам (smalltalk, креатив, roleplay, простой код); closed-source флагманы держат ценовую власть на сложных, не терпящих ошибок задачах. 24 июля Anthropic выпустила Claude Opus 5 с FrontierBench v0.1 43,3% (GPT-5.6 Sol 37,5%), цена остаётся Opus-уровня $5/$25 за M — «я дорогой, но стою этого».
4. Секрет приложений: coding-агенты правят, roleplay — невидимая половина
Рейтинг моделей показывает «какой мозг популярен»; рейтинг приложений (openrouter.ai/apps) — «для чего его используют»:
| Место | Приложение | Тип | Доля (ок.) |
|---|---|---|---|
| 1 | Hermes Agent | Личный Agent / CLI Agent | ~45% |
| 2 | Kilo Code | Coding Agent | ~13% |
| 3 | OpenClaw | Универсальный Agent | ~9% |
| 4 | Claude Code | Coding Agent | ~6% |
| 5 | Descript | Производство контента | ~4,5% |
| 6 | pi | Agent | ~3,3% |
| 7-9 | Lemonade / ISEKAI ZERO / Janitor AI | Компаньоны / roleplay | ~2% каждый |
| 10 | Cline | Coding Agent (IDE-плагин) | ~1,7% |
Cline → Roo Code → Kilo Code — одна кодовая линия в трёх поколениях; «внук» Kilo Code уже обогнал предков. Roleplay/компаньоны (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) занимают заметную долю open-source трафика; OpenRouter × a16z «State of AI»: креативный roleplay даёт более половины всего open-source объёма — в enterprise-отчётах практически невидим.
5. Таблица цен и позиционирования
| Модель | Input/M | Output/M | Контекст | Позиционирование |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0,05-0,14 | ~$0,24-0,28 | 1M | Король цена/качество, Agentic Coding |
| Nemotron 3 Ultra | $0,42 (есть бесплатная версия) | $2,61 | — | US open source, экосистема NVIDIA |
| MiniMax M3 | $0,10 | $1,21 | Длинный контекст | Мультимодальный/ввод изображений в бюджете |
| GLM 5.2 | $0,45 | $3,31 | — | «Opus-подобное» качество планирования в open source |
| Kimi K3 | ~$3 | ~$15 | 1M | Крупнейший open-source вес (1,4TB), уровень closed source |
| Claude Opus 5 | $5 (Fast $10) | $25 (Fast $50) | 1M | Closed-source флагман, лучшие бенчмарки июля |
6. Прогноз на август
- Доля китайских open-source моделей продолжит расти, 50% в году вероятно — если US-провайдеры не снизят цены резко; признаков пока нет.
- «Месячный чемпион» продолжит меняться: Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot — ценовая война и итерации не остановятся.
- Anthropic может выпустить более доступную модель (уровень Haiku) для объёма; Opus 5 уже четвёртый флагман за два месяца (после Mythos 5, Fable 5, Sonnet 5) — стратегия полного ценового покрытия.
- Kimi K3 с весом 1,4TB: community-квантизация возможна за 2-4 недели — тогда смогут развернуть малые команды; сейчас выигрывают в основном крупные игроки и inference-облака (например Fireworks AI).
- Безопасность и compliance как новая переменная выбора: побег sandbox модели OpenAI на Hugging Face, «AI Kill Switch Act» в Конгрессе США и White House framework для frontier-моделей — «репутация безопасности провайдера» весит больше в enterprise-закупках.
7. Советы по ролям
Indie-разработчик / малая команда
- OpenRouter хорош как tech-sandbox — один ключ, сотни моделей. Учитывайте: задержка из Китая около 180-250 ms, нет локальных счетов; для production оцените compliant-реле.
- Код: сначала DeepSeek V4 Flash и GLM 5.2; на застрявших шагах — маршрут на Claude Opus 5 / GPT-5.6 — смешанная маршрутизация сильно снижает затраты.
Enterprise tech lead
- Не выбирать только по объёмному рейтингу; собственный eval-набор (adoption rate, error rate, реальная latency) обязателен.
- Многоуровневая маршрутизация: smalltalk/креатив дёшево, классификация/сложный reasoning/высокорисковые Agents — на closed-source флагманы — прямой урок «штанги».
- Включить «историю безопасности провайдера модели» в scorecard выбора.
Производитель AI Agent / coding-инструмента
- Cline → Kilo Code показывает: open-source moat мельче, чем кажется — преемник может быстро обогнать.
- Roleplay/компаньоны больше, чем enterprise-отчёты предполагают — не игнорируйте entertainment-рынок.
8. Пятишаговый runbook многоуровневой маршрутизации
Шаг 1 — Разделить по риску задачи и толерантности к ошибкам
Массовые/тolerant → DeepSeek V4 Flash, Mimo V2.5; сложный reasoning/высокорисковые Agents → Claude Opus 5.
Шаг 2 — Настроить primary и fallback на OpenRouter
Шаг 3 — Учесть 35-кратную разницу в цене в месячном счёте
При 10M input-токенов/день грубо: DeepSeek V4 Flash около $5-14/день, GPT-5.5 около $50/день — ROI многоуровневой маршрутизации огромен.
Шаг 4 — Перенести Gateway на Mac cloud 7×24
launchd для OpenClaw, API-ключи через переменные окружения. См. руководство по API OpenRouter и анализ рейтинга за июнь.
Шаг 5 — Ежемесячный review: рейтинг и собственный eval-набор
9. Цитируемые технические факты
- Xiaomi Mimo V2.5 1,4T токенов/день — 1-е место в модельном рейтинге июля; DeepSeek V4 Flash 943,9B/день — 2-е.
- Китайские провайдеры на OpenRouter около 46% токенов, с менее 2% за год; три крупнейших US около 30-36%.
- DeepSeek V4 Flash vs GPT-5.5 input около 35 раз дешевле; Hermes Agent около 45% app-токенов.
- Claude Opus 5 FrontierBench v0.1 43,3%; сложный reasoning Claude Sonnet 4.6 / Opus 4.7 по 13,5% расходов каждый.
10. Заключение: capability и popularity расходятся
Главная мысль июля: capability и popularity расходятся. Китайские open-source модели забирают половину трафика ценой; US closed-source флагманы держат ценовую власть и moat безопасности на сложных задачах. Важнее «кто первый» — построить eval-систему и многоуровневую маршрутизацию.
Multi-model Gateway на ноутбуке или чистом Linux VPS имеет слабые места: крышка закрыта, нет Apple toolchain, сложный debug. Для OpenClaw / Cursor Agent 7×24 с DeepSeek, Opus и GLM: аренда узла Mac cloud M4 VPSMAC — модель меняется по рейтингу, среда выполнения остаётся.