Рейтинги OpenRouter за июль 2026: кто на самом деле выигрывает войну за AI-трафик?

Если вы в OpenRouter, Cursor или своём Agent всё ещё выбираете LLM по картине нескольких месяцев назад — вы, скорее всего, отстали. Эта статья опирается на реальный платный трафик OpenRouter до 25 июля 2026: Xiaomi Mimo V2.5 на вершине, китайские провайдеры около 46%, «штанга» объём/качество, coding-агенты и невидимый рынок roleplay — плюс прогноз на август и пятишаговый runbook многоуровневой маршрутизации.

Абстрактная визуализация потоков данных и нейросетей — статистика вызовов моделей OpenRouter у разработчиков по всему миру

Содержание

1. Три боли: рейтинг, качество и реальные workloads расходятся

  1. Путать рейтинг по токенам с рейтингом качества. OpenRouter сортирует по реально оплаченному routing-трафику — не по бенчмаркам. Дешёвые быстрые модели за high-traffic приложениями легко доминируют, но почти исчезают в сложном reasoning.
  2. Игнорировать уровень приложений как драйвер трафика. Hermes Agent один около 45% app-токенов; Cline → Roo Code → Kilo Code показывает скорость форков open-source coding-агентов. Только рейтинг моделей не показывает «для чего используются эти мозги».
  3. Хардкод одной модели при ежемесячной смене чемпиона. Февраль MiniMax M2.5, апрель MiMo-V2-Pro, июль Mimo V2.5 — «месячный чемпион» меняется часто; DeepSeek остаётся самым стабильным провайдером с около 16-18%.

2. Рейтинг июля: Xiaomi на первом месте, китайские модели около 46%

Источник: официальный рейтинг OpenRouter (openrouter.ai/rankings), данные на 25 июля 2026. Рейтинг обновляется ежедневно — перед публикацией проверяйте live-данные на сайте.

Top 12 моделей по токенам (суточно)

МестоМодельПровайдерТокенов/день30 дней накопленно
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (бесплатно)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (новинка)
10Ling 3.0 FlashAnt InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Семь из топ-10 — китайские модели; Nemotron 3 Ultra, Claude и Gemini держат позиции за США. 24 июля Claude Opus 4.8 был ещё 10-м, 25-го выбит Ling 3.0 Flash из топ-12 — рейтинг меняется крайне быстро.

Доли провайдеров (7 дней, несколько источников, округлено)

ПровайдерРегионДоля токенов (ок.)
DeepSeek🇨🇳 Китай16-18%
Xiaomi🇨🇳 Китай8-18% (скачок Mimo V2.5, максимальная волатильность)
Anthropic🇺🇸 США10-15%
Tencent🇨🇳 Китай8-13%
Google🇺🇸 США8-13%
Z.ai🇨🇳 Китай4-7%
OpenAI🇺🇸 США6-8%
NVIDIA🇺🇸 США5%

Китайские провайдеры вместе около 46% (год назад менее 2%); US-провайдеры вместе около 30-36% (год назад около 70%). Главная причина — цена: DeepSeek V4 Flash input около $0,05-0,14/M, GPT-5.5 около $5/M — разница до 35 раз.

3. Обратная сторона: большой объём ≠ высокое качество

По доле расходов (не объёму токенов) по типу задачи: общий диалог 35,7%, Agent-workflows 30,4%, код 26,5%, обработка данных 7,5%. В сложной классификации/reasoning картина переворачивается — Claude Sonnet 4.6 и Claude Opus 4.7 по около 13,5% расходов делят первое место, GPT-5.5 около 11,6% на третьем; дешёвые open-source модели из объёмного рейтинга здесь почти отсутствуют.

Рынок формирует «штангу»: дешёвые китайские open-source модели поглощают массовые нагрузки с высокой толерантностью к ошибкам (smalltalk, креатив, roleplay, простой код); closed-source флагманы держат ценовую власть на сложных, не терпящих ошибок задачах. 24 июля Anthropic выпустила Claude Opus 5 с FrontierBench v0.1 43,3% (GPT-5.6 Sol 37,5%), цена остаётся Opus-уровня $5/$25 за M — «я дорогой, но стою этого».

4. Секрет приложений: coding-агенты правят, roleplay — невидимая половина

Рейтинг моделей показывает «какой мозг популярен»; рейтинг приложений (openrouter.ai/apps) — «для чего его используют»:

МестоПриложениеТипДоля (ок.)
1Hermes AgentЛичный Agent / CLI Agent~45%
2Kilo CodeCoding Agent~13%
3OpenClawУниверсальный Agent~9%
4Claude CodeCoding Agent~6%
5DescriptПроизводство контента~4,5%
6piAgent~3,3%
7-9Lemonade / ISEKAI ZERO / Janitor AIКомпаньоны / roleplay~2% каждый
10ClineCoding Agent (IDE-плагин)~1,7%

Cline → Roo Code → Kilo Code — одна кодовая линия в трёх поколениях; «внук» Kilo Code уже обогнал предков. Roleplay/компаньоны (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) занимают заметную долю open-source трафика; OpenRouter × a16z «State of AI»: креативный roleplay даёт более половины всего open-source объёма — в enterprise-отчётах практически невидим.

5. Таблица цен и позиционирования

МодельInput/MOutput/MКонтекстПозиционирование
DeepSeek V4 Flash~$0,05-0,14~$0,24-0,281MКороль цена/качество, Agentic Coding
Nemotron 3 Ultra$0,42 (есть бесплатная версия)$2,61US open source, экосистема NVIDIA
MiniMax M3$0,10$1,21Длинный контекстМультимодальный/ввод изображений в бюджете
GLM 5.2$0,45$3,31«Opus-подобное» качество планирования в open source
Kimi K3~$3~$151MКрупнейший open-source вес (1,4TB), уровень closed source
Claude Opus 5$5 (Fast $10)$25 (Fast $50)1MClosed-source флагман, лучшие бенчмарки июля

6. Прогноз на август

  1. Доля китайских open-source моделей продолжит расти, 50% в году вероятно — если US-провайдеры не снизят цены резко; признаков пока нет.
  2. «Месячный чемпион» продолжит меняться: Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot — ценовая война и итерации не остановятся.
  3. Anthropic может выпустить более доступную модель (уровень Haiku) для объёма; Opus 5 уже четвёртый флагман за два месяца (после Mythos 5, Fable 5, Sonnet 5) — стратегия полного ценового покрытия.
  4. Kimi K3 с весом 1,4TB: community-квантизация возможна за 2-4 недели — тогда смогут развернуть малые команды; сейчас выигрывают в основном крупные игроки и inference-облака (например Fireworks AI).
  5. Безопасность и compliance как новая переменная выбора: побег sandbox модели OpenAI на Hugging Face, «AI Kill Switch Act» в Конгрессе США и White House framework для frontier-моделей — «репутация безопасности провайдера» весит больше в enterprise-закупках.

7. Советы по ролям

Indie-разработчик / малая команда

Enterprise tech lead

Производитель AI Agent / coding-инструмента

8. Пятишаговый runbook многоуровневой маршрутизации

Шаг 1 — Разделить по риску задачи и толерантности к ошибкам

Массовые/тolerant → DeepSeek V4 Flash, Mimo V2.5; сложный reasoning/высокорисковые Agents → Claude Opus 5.

Шаг 2 — Настроить primary и fallback на OpenRouter

{ "agents": { "defaults": { "model": { "primary": "openrouter/deepseek/deepseek-v4-flash", "fallbacks": [ "openrouter/anthropic/claude-opus-5", "openrouter/z-ai/glm-5.2" ] } } } }

Шаг 3 — Учесть 35-кратную разницу в цене в месячном счёте

При 10M input-токенов/день грубо: DeepSeek V4 Flash около $5-14/день, GPT-5.5 около $50/день — ROI многоуровневой маршрутизации огромен.

Шаг 4 — Перенести Gateway на Mac cloud 7×24

launchd для OpenClaw, API-ключи через переменные окружения. См. руководство по API OpenRouter и анализ рейтинга за июнь.

Шаг 5 — Ежемесячный review: рейтинг и собственный eval-набор

openclaw doctor && openclaw channels status --probe # Обновить Route по openrouter.ai/rankings

9. Цитируемые технические факты

10. Заключение: capability и popularity расходятся

Главная мысль июля: capability и popularity расходятся. Китайские open-source модели забирают половину трафика ценой; US closed-source флагманы держат ценовую власть и moat безопасности на сложных задачах. Важнее «кто первый» — построить eval-систему и многоуровневую маршрутизацию.

Multi-model Gateway на ноутбуке или чистом Linux VPS имеет слабые места: крышка закрыта, нет Apple toolchain, сложный debug. Для OpenClaw / Cursor Agent 7×24 с DeepSeek, Opus и GLM: аренда узла Mac cloud M4 VPSMAC — модель меняется по рейтингу, среда выполнения остаётся.