Рейтинг OpenRouter за июль 2026: 46% токенов у китайских моделей — кто реально выигрывает войну за AI-трафик?

Реальный платный трафик OpenRouter на 25 июля: Xiaomi Mimo V2.51,4T токенов/сутки, китайские вендоры вместе ~46% — но лидер по объёму не равен лидеру по качеству: Claude удерживает ценовую власть на сложных задачах.

В конце июля 2026 опираться на картину рынка трёхмесячной давности — значит принимать решения по устаревшим данным. OpenRouter не меряет маркетинговые бенчмарки, а считает реальные платные запросы разработчиков. Материал закрывает: (1) Top 12 моделей и доли вендоров, Китай ~46%; (2) структуру «гиря» объём vs качество; (3) слой приложений Hermes Agent, Kilo Code и скрытый roleplay-рынок; (4) пять трендов на август; (5) рекомендации по ролям и шестишаговый runbook. Параллельно: руководство по OpenRouter API, рейтинг за июнь, CLI-инструменты.

00Июль: Xiaomi на первом месте, доля Китая впервые 46%

На 25 июля 2026 суточный рейтинг OpenRouter: Xiaomi Mimo V2.5 (1,4T токенов/сутки), DeepSeek V4 Flash (943,9B) и Tencent Hy3 (590B). Семь из двенадцати моделей — китайские; US-флагманы Nemotron 3 Ultra (NVIDIA), Claude и Gemini удерживают оставшиеся позиции.

МестоМодельВендорТокены/сут.30 дней
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (бесплатно)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot AI157,6B1,6T (новинка)
10Ling 3.0 FlashAnt InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

На уровне вендоров: китайские лаборатории суммарно ~46% токенов — год назад менее 2%. Большая тройка США (OpenAI, Anthropic, Google) упала с ~70% в середине 2025 до ~30% в июне 2026 и колеблется в диапазоне 30–36%.

  • Цифра 1: DeepSeek V4 Flash input ~$0,05–0,14/M, GPT-5.5 ~$5/M — разрыв ×35.
  • Цифра 2: DeepSeek остаётся самым стабильным вендором (~16–18%), но «чемпион месяца» меняется: фев. MiniMax M2.5 → апр. MiMo-V2-Pro → июль Mimo V2.5.
  • Цифра 3: Claude Opus 4.8 был в Top 10 24.07 (1,44T за неделю), 25.07 вытеснен Ling 3.0 Flash — перед публикацией сверяйте openrouter.ai/rankings.

ЛовушкиОбратная сторона: высокий объём ≠ высокое качество

OpenRouter сортирует по потреблению токенов, а не по capability. Дешёвая быстрая модель за высокотрафиковым приложением легко попадает в Top — даже если на сложном reasoning слаба. Именно здесь отличается глубокий разбор от таблиц «для SEO».

По типу задач картина расходов другая: общий диалог 35,7%, Agent-workflow 30,4%, код 26,5%, обработка данных 7,5%. На классификации и сложном reasoning: Claude Sonnet 4.6 и Claude Opus 4.7 по 13,5% расходов, GPT-5.5 — 11,6% — дешёвые open-source лидеры по объёму здесь почти не видны.

Рынок естественно расслаивается: китайские open-source модели забирают массовую fault-tolerant нагрузку (чат, креатив, roleplay, простой coding assist), а закрытые frontier удерживают pricing на high-value задачах. Claude Opus 5 (24 июля) набрал 43,3% на FrontierBench v0.1, обогнав GPT-5.6 Sol (37,5%) при $5/$25 per M.

01Доли вендоров и ценовая матрица

ВендорПроисхождениеДоля токенов (ок.)
DeepSeekКитай16–18%
XiaomiКитай8–18% (Mimo V2.5, макс. волатильность)
AnthropicСША10–15%
TencentКитай8–13%
GoogleСША8–13%
Z.aiКитай4–7%
OpenAIСША6–8%
NVIDIAСША5%
MiniMaxКитай4–8%
Moonshot AIКитай3–4%
МодельInput/MOutput/MКонтекстПозиционирование
DeepSeek V4 Flash~$0,05–0,14~$0,24–0,281MЦена/качество, Agentic Coding
Nemotron 3 Ultra$0,42 (есть free)$2,61US open source, стек NVIDIA
MiniMax M3$0,10$1,21ДлинныйБюджетный multimodal
GLM 5.2$0,45$3,31«Opus-подобное» планирование в open weights
Kimi K3~$3~$151MКрупнейшие open weights (1,4TB)
Claude Opus 5$5 (fast $10)$25 (fast $50)1MClosed frontier, лучшие июльские бенчмарки

02Слой приложений: coding-агенты лидируют, roleplay — невидимая половина

Рейтинг моделей показывает, какой «мозг» выбирают; рейтинг приложений — для чего его используют:

МестоПриложениеТипДоля (ок.)
1Hermes Agent (Nous Research)Персональный агент / CLI~45%
2Kilo CodeCoding-агент~13%
3OpenClawУниверсальный агент~9%
4Claude Code (Anthropic)Coding-агент~6%
5DescriptКонтент-производство~4,5%
6piАгент~3,3%
7LemonadeКомпаньон / игры~2,1% (новинка)
8ISEKAI ZERORoleplay~2,0% (новинка)
9Janitor AIRoleplay~1,8% (новинка)
10ClineCoding-агент (IDE)~1,7%
  • Cline → Roo Code → Kilo Code — три поколения одной кодовой линии; Kilo Code сегодня обгоняет предков.
  • Roleplay и companion (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) дают заметную долю open-source трафика — по OpenRouter × a16z State of AI более половины в креативном roleplay.
  • Enterprise-медиа эту половину рынка не видит. См. разбор CLI-инструментов.

03Прогноз на август: доли, безопасность и окно квантизации Kimi K3

  1. 01
    Китайские open-source модели, вероятно, превысят 50%, пока US-вендоры не пойдут на резкое снижение цен. Признаков агрессивного price war у OpenAI/Google нет.
  2. 02
    «Чемпион месяца» продолжит меняться. Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax и Moonshot конкурируют ценой и темпом релизов — в августе вероятен новый кандидат в Top 1.
  3. 03
    Anthropic может выпустить более доступную модель (уровень Haiku) для захвата объёма — Opus 5 уже четвёртый flagship за два месяца.
  4. 04
    1,4TB весов Kimi K3 получат community-квантизации за 2–4 недели (см. обзор Kimi K3) — тогда модель станет практичной для средних команд.
  5. 05
    Безопасность и compliance станут фактором выбора. Истории об escape из sandbox у неопубликованных моделей OpenAI, законопроект «AI kill switch» в Конгрессе США и рамка предрелизной проверки frontier-моделей к августу усиливают давление.
  6. 06
    Репутация безопасности вендора весомее в enterprise-закупках — плюс Anthropic, больше осторожности с автономными агентами с широкими правами.

04Рекомендации по ролям

Инди-разработчики и малые команды: OpenRouter — отличная песочница: один ключ, сотни моделей. Для прода: latency до OpenRouter из Европы/СНГ часто 180–250 ms. Код: сначала DeepSeek V4 Flash (разбор V4 GA) и GLM 5.2; Claude Opus 5 / GPT-5.6 — только на заблокированных шагах; гибридный роутинг резко снижает счёт.

Enterprise-архитекторы: не выбирать только по объёму рейтинга. Нужны свои eval (acceptance rate, error rate, latency под нагрузкой). Слои: чат/креатив/roleplay — дешёвые open source; классификация, сложный reasoning и рискованные Agent-решения — closed frontier. Структура «гиря» из данных OpenRouter. Включить security track record в scorecard.

Продукты Agent и coding-tools: цепочка Cline→Kilo Code показывает: в open-source наследник может обогнать первопроходца. Roleplay-сценарии дают больше объёма, чем кажется из enterprise-отчётов.

05Итог: capability и popularity расходятся

Главный вывод июля: способность и популярность идут разными путями. Китайские open-source модели берут трафик ценой; US closed frontier держит pricing и security narrative на сложных задачах. В августе напряжение «цена vs премиум» усилится — ценнее собственной eval-пайплайна и слоистого роутинга, чем спора «кто первый».

06Шестишаговый runbook: слоистый роутинг на облачном Mac

  1. 01
    Следить за дневным рейтингом: еженедельно проверять OpenRouter Rankings; Kimi K3 и Ling 3.0 Flash — в watchlist.
  2. 02
    Роутинг 95% объёма + 5% frontier: daily — DeepSeek V4 Flash / Mimo V2.5 / GLM 5.2; сложный reasoning — Claude Opus 5 / GPT-5.6. Fallback по руководству API.
  3. 03
    Развернуть облачный Mac: в консоли NUKCLOUD выбрать 32 GB+ unified memory для длинных Agent-сессий; почасово тестировать Kimi K3 / GLM 5.2 на странице цен.
  4. 04
    Моделировать TCO: «полный Claude stack» vs «Claude frontier + китайские daily» vs выделенный Mac 7×24; заложить августовские tier-изменения и compliance-аудит.
  5. 05
    Compliance и безопасность: security track record в scorecard; автономные агенты с минимальными правами и sandbox.
  6. 06
    launchd 7×24 Agent: после пилота зафиксировать spec на странице заказа; детали в production runbook и центре помощи.

Multi-model агенты на локальном MacBook или перегруженном VPS ломаются на sleep при закрытии крышки, обрывах SSE и раздувании API-счёта. Для стабильного 7×24 и гибкой смены маршрутов мультирегиональные bare-metal Mac / cloud Mac узлы NUKCLOUD с выделенной tenant-границей лучше совпадают с августовским темпом релизов моделей.

07FAQ: рейтинг OpenRouter за июль

Какая модель была самой популярной в июле 2026?
На 25 июля: Xiaomi Mimo V2.5 с ~1,4T токенов/сутки, далее DeepSeek V4 Flash (943,9B) и Tencent Hy3 (590B).
Какую долю занимают китайские модели?
По 7-дневным данным ~46% (год назад < 2%). Большая тройка США ~30–36%.
Отражает ли рейтинг качество?
Нет. На сложном reasoning Claude Sonnet 4.6 и Opus 4.7 по 13,5%; GPT-5.5 — 11,6%.
Почему Kimi K3 растёт так быстро?
Новинка Top 12: 157,6B/сутки, 1,6T за 30 дней. 1,4TB open weights — крупнейший опубликованный пакет. См. обзор Kimi K3.
Какую модель для кода?
Daily: DeepSeek V4 Flash и GLM 5.2. Сложный Agent: Claude Opus 5. Apps: Kilo Code (~13%) и Hermes Agent (~45%).
Ключевые тренды августа?
Доля Китая возможно 50%+; смена месячного лидера; более дешёвая модель Anthropic; квантизации Kimi K3; безопасность и compliance.
Почему не ставить на одну модель?
Top 10 меняется ежедневно (24.07 vs 25.07). Ценность — слойный model-agnostic роутинг, а не lock-in. Сравнение: рейтинг за июнь.

Материал от 27 июля 2026, данные на 25 июля 2026. Не инвестиционный совет. Источники: OpenRouter Rankings, OpenRouter Apps, State of AI.