В конце июля 2026 опираться на картину рынка трёхмесячной давности — значит принимать решения по устаревшим данным. OpenRouter не меряет маркетинговые бенчмарки, а считает реальные платные запросы разработчиков. Материал закрывает: (1) Top 12 моделей и доли вендоров, Китай ~46%; (2) структуру «гиря» объём vs качество; (3) слой приложений Hermes Agent, Kilo Code и скрытый roleplay-рынок; (4) пять трендов на август; (5) рекомендации по ролям и шестишаговый runbook. Параллельно: руководство по OpenRouter API, рейтинг за июнь, CLI-инструменты.
00Июль: Xiaomi на первом месте, доля Китая впервые 46%
На 25 июля 2026 суточный рейтинг OpenRouter: Xiaomi Mimo V2.5 (1,4T токенов/сутки), DeepSeek V4 Flash (943,9B) и Tencent Hy3 (590B). Семь из двенадцати моделей — китайские; US-флагманы Nemotron 3 Ultra (NVIDIA), Claude и Gemini удерживают оставшиеся позиции.
| Место | Модель | Вендор | Токены/сут. | 30 дней |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (бесплатно) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot AI | 157,6B | 1,6T (новинка) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
На уровне вендоров: китайские лаборатории суммарно ~46% токенов — год назад менее 2%. Большая тройка США (OpenAI, Anthropic, Google) упала с ~70% в середине 2025 до ~30% в июне 2026 и колеблется в диапазоне 30–36%.
- Цифра 1: DeepSeek V4 Flash input ~$0,05–0,14/M, GPT-5.5 ~$5/M — разрыв ×35.
- Цифра 2: DeepSeek остаётся самым стабильным вендором (~16–18%), но «чемпион месяца» меняется: фев. MiniMax M2.5 → апр. MiMo-V2-Pro → июль Mimo V2.5.
- Цифра 3: Claude Opus 4.8 был в Top 10 24.07 (1,44T за неделю), 25.07 вытеснен Ling 3.0 Flash — перед публикацией сверяйте openrouter.ai/rankings.
ЛовушкиОбратная сторона: высокий объём ≠ высокое качество
OpenRouter сортирует по потреблению токенов, а не по capability. Дешёвая быстрая модель за высокотрафиковым приложением легко попадает в Top — даже если на сложном reasoning слаба. Именно здесь отличается глубокий разбор от таблиц «для SEO».
По типу задач картина расходов другая: общий диалог 35,7%, Agent-workflow 30,4%, код 26,5%, обработка данных 7,5%. На классификации и сложном reasoning: Claude Sonnet 4.6 и Claude Opus 4.7 по 13,5% расходов, GPT-5.5 — 11,6% — дешёвые open-source лидеры по объёму здесь почти не видны.
Рынок естественно расслаивается: китайские open-source модели забирают массовую fault-tolerant нагрузку (чат, креатив, roleplay, простой coding assist), а закрытые frontier удерживают pricing на high-value задачах. Claude Opus 5 (24 июля) набрал 43,3% на FrontierBench v0.1, обогнав GPT-5.6 Sol (37,5%) при $5/$25 per M.
01Доли вендоров и ценовая матрица
| Вендор | Происхождение | Доля токенов (ок.) |
|---|---|---|
| DeepSeek | Китай | 16–18% |
| Xiaomi | Китай | 8–18% (Mimo V2.5, макс. волатильность) |
| Anthropic | США | 10–15% |
| Tencent | Китай | 8–13% |
| США | 8–13% | |
| Z.ai | Китай | 4–7% |
| OpenAI | США | 6–8% |
| NVIDIA | США | 5% |
| MiniMax | Китай | 4–8% |
| Moonshot AI | Китай | 3–4% |
| Модель | Input/M | Output/M | Контекст | Позиционирование |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0,05–0,14 | ~$0,24–0,28 | 1M | Цена/качество, Agentic Coding |
| Nemotron 3 Ultra | $0,42 (есть free) | $2,61 | — | US open source, стек NVIDIA |
| MiniMax M3 | $0,10 | $1,21 | Длинный | Бюджетный multimodal |
| GLM 5.2 | $0,45 | $3,31 | — | «Opus-подобное» планирование в open weights |
| Kimi K3 | ~$3 | ~$15 | 1M | Крупнейшие open weights (1,4TB) |
| Claude Opus 5 | $5 (fast $10) | $25 (fast $50) | 1M | Closed frontier, лучшие июльские бенчмарки |
02Слой приложений: coding-агенты лидируют, roleplay — невидимая половина
Рейтинг моделей показывает, какой «мозг» выбирают; рейтинг приложений — для чего его используют:
| Место | Приложение | Тип | Доля (ок.) |
|---|---|---|---|
| 1 | Hermes Agent (Nous Research) | Персональный агент / CLI | ~45% |
| 2 | Kilo Code | Coding-агент | ~13% |
| 3 | OpenClaw | Универсальный агент | ~9% |
| 4 | Claude Code (Anthropic) | Coding-агент | ~6% |
| 5 | Descript | Контент-производство | ~4,5% |
| 6 | pi | Агент | ~3,3% |
| 7 | Lemonade | Компаньон / игры | ~2,1% (новинка) |
| 8 | ISEKAI ZERO | Roleplay | ~2,0% (новинка) |
| 9 | Janitor AI | Roleplay | ~1,8% (новинка) |
| 10 | Cline | Coding-агент (IDE) | ~1,7% |
- Cline → Roo Code → Kilo Code — три поколения одной кодовой линии; Kilo Code сегодня обгоняет предков.
- Roleplay и companion (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) дают заметную долю open-source трафика — по OpenRouter × a16z State of AI более половины в креативном roleplay.
- Enterprise-медиа эту половину рынка не видит. См. разбор CLI-инструментов.
03Прогноз на август: доли, безопасность и окно квантизации Kimi K3
-
01
Китайские open-source модели, вероятно, превысят 50%, пока US-вендоры не пойдут на резкое снижение цен. Признаков агрессивного price war у OpenAI/Google нет.
-
02
«Чемпион месяца» продолжит меняться. Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax и Moonshot конкурируют ценой и темпом релизов — в августе вероятен новый кандидат в Top 1.
-
03
Anthropic может выпустить более доступную модель (уровень Haiku) для захвата объёма — Opus 5 уже четвёртый flagship за два месяца.
-
04
1,4TB весов Kimi K3 получат community-квантизации за 2–4 недели (см. обзор Kimi K3) — тогда модель станет практичной для средних команд.
-
05
Безопасность и compliance станут фактором выбора. Истории об escape из sandbox у неопубликованных моделей OpenAI, законопроект «AI kill switch» в Конгрессе США и рамка предрелизной проверки frontier-моделей к августу усиливают давление.
-
06
Репутация безопасности вендора весомее в enterprise-закупках — плюс Anthropic, больше осторожности с автономными агентами с широкими правами.
04Рекомендации по ролям
Инди-разработчики и малые команды: OpenRouter — отличная песочница: один ключ, сотни моделей. Для прода: latency до OpenRouter из Европы/СНГ часто 180–250 ms. Код: сначала DeepSeek V4 Flash (разбор V4 GA) и GLM 5.2; Claude Opus 5 / GPT-5.6 — только на заблокированных шагах; гибридный роутинг резко снижает счёт.
Enterprise-архитекторы: не выбирать только по объёму рейтинга. Нужны свои eval (acceptance rate, error rate, latency под нагрузкой). Слои: чат/креатив/roleplay — дешёвые open source; классификация, сложный reasoning и рискованные Agent-решения — closed frontier. Структура «гиря» из данных OpenRouter. Включить security track record в scorecard.
Продукты Agent и coding-tools: цепочка Cline→Kilo Code показывает: в open-source наследник может обогнать первопроходца. Roleplay-сценарии дают больше объёма, чем кажется из enterprise-отчётов.
05Итог: capability и popularity расходятся
Главный вывод июля: способность и популярность идут разными путями. Китайские open-source модели берут трафик ценой; US closed frontier держит pricing и security narrative на сложных задачах. В августе напряжение «цена vs премиум» усилится — ценнее собственной eval-пайплайна и слоистого роутинга, чем спора «кто первый».
06Шестишаговый runbook: слоистый роутинг на облачном Mac
-
01
Следить за дневным рейтингом: еженедельно проверять OpenRouter Rankings; Kimi K3 и Ling 3.0 Flash — в watchlist.
-
02
Роутинг 95% объёма + 5% frontier: daily — DeepSeek V4 Flash / Mimo V2.5 / GLM 5.2; сложный reasoning — Claude Opus 5 / GPT-5.6. Fallback по руководству API.
-
03
Развернуть облачный Mac: в консоли NUKCLOUD выбрать 32 GB+ unified memory для длинных Agent-сессий; почасово тестировать Kimi K3 / GLM 5.2 на странице цен.
-
04
Моделировать TCO: «полный Claude stack» vs «Claude frontier + китайские daily» vs выделенный Mac 7×24; заложить августовские tier-изменения и compliance-аудит.
-
05
Compliance и безопасность: security track record в scorecard; автономные агенты с минимальными правами и sandbox.
-
06
launchd 7×24 Agent: после пилота зафиксировать spec на странице заказа; детали в production runbook и центре помощи.
Multi-model агенты на локальном MacBook или перегруженном VPS ломаются на sleep при закрытии крышки, обрывах SSE и раздувании API-счёта. Для стабильного 7×24 и гибкой смены маршрутов мультирегиональные bare-metal Mac / cloud Mac узлы NUKCLOUD с выделенной tenant-границей лучше совпадают с августовским темпом релизов моделей.
07FAQ: рейтинг OpenRouter за июль
Материал от 27 июля 2026, данные на 25 июля 2026. Не инвестиционный совет. Источники: OpenRouter Rankings, OpenRouter Apps, State of AI.