Итог: вся дорожная карта Grok 4.6/4.7 держится на одном посте Маска — не на анонсе xAI. Если график сработает, xAI выпустит три frontier-модели за ~два месяца, поместив Grok 4.6 в то же августовское окно, что open-weight-шок Kimi K3 и слухи о Claude Fable 5.1. В тот же день 1 100+ сотрудников подписали письмо «Pacing the Frontier» — xAI в списке не было. Ниже: таймлайн, таблицы спецификаций, разбор SFT/RL, матрица конкурентов, болевые точки для инженерных команд, 6-шаговый runbook и FAQ.
00Таймлайн: от Grok 4.5 к 4.6 и 4.7 менее чем за два месяца
| Дата | Событие |
|---|---|
| 8 июля 2026 | xAI выпускает Grok 4.5 — co-training с Cursor, контекст 500K, $2/$6 за M токенов, model card с 15 бенчмарками |
| 16–27 июля 2026 | Moonshot AI запускает Kimi K3 как сервис, затем публикует open weights 2,8T на Hugging Face |
| 28 июля 2026 | Маск отвечает @rauchg: Grok 4.6 (~7 авг.), Grok 4.7 (через несколько недель) — единственный публичный источник по обеим моделям |
| 28 июля 2026 | 1 100+ сотрудников OpenAI, Anthropic, Google и Meta подписывают «Pacing the Frontier»; OpenAI и Anthropic на корпоративном уровне — xAI отсутствует |
| ~7 августа 2026 (цель) | Grok 4.6 — 1,5T параметров, фокус SFT/RL |
| Конец авг.–нач. сент. 2026 (оценка) | Grok 4.7 — 2,1T; Маск: лучше 4.6, чуть медленнее serving, выше токен-эффективность |
01Ключевые данные: известно vs заявлено
| Модель | Дата | Параметры | Фокус | Статус |
|---|---|---|---|---|
| Grok 4.3 Beta | 17 апр. 2026 | Не раскрыто | Предыдущая база | Выпущена |
| Grok 4.5 | 8 июл. 2026 | Не раскрыто | Coding/agentic, co-training Cursor | Выпущена, с бенчмарками |
| Grok 4.6 | ~7 авг. 2026 | 1,5T | Апгрейд SFT/RL | Только твит, не выпущена |
| Grok 4.7 | ~конец авг. | 2,1T | Широкий апгрейд над 4.6, токен-эффективность | Только твит, не выпущена |
Grok 4.5 вышел с model card, 15 бенчмарками и ценами API. У Grok 4.6 ноль независимых оценок. Числа параметров и заявления о post-training — vendor statements из одного поста в X, пока xAI не опубликует иное.
PainПочему планирование моделей на август сейчас больно
- Риск roadmap из одного источника: календарь закупок завязан на твит, а не на продуктовую страницу xAI. Команды, строящие августовские спринты вокруг Grok 4.6, не имеют SLA, beta-доступа и запасного плана при сдвиге даты.
- Сжатый срок жизни флагмана: Grok 4.5 вышел 8 июля. Если 4.6 придёт 7 августа, вы можете закончить онбординг модели, уже устаревшей на поколение — до того как бенчмарки оправдают миграцию.
- Вакуум бенчмарков: у Grok 4.5 были SWE-Bench Pro (64,7 %), Terminal Bench 2.1 (83,3 %) и данные по токен-эффективности. У 4.6 — ничего. Ответственный bake-off против Kimi K3 (93,4 % SWE-bench Verified) или GPT-5.6 Sol (96,2 %) на вере невозможен.
- Путаница с двумя SKU: Маск в одном ответе описал 4.6 (1,5T, быстрее) и 4.7 (2,1T, медленнее serving, лучше токен-эффективность). Ждать «лучшую» или шипить «быструю» — без дельты цен и API model ID.
- Vendor safety liability: в июле 2026 xAI подала иск против пользователя за предполагаемую генерацию CSAM через Grok — неявное признание, что защиты обходятся. Отчёт Common Sense Media (январь 2026) поставил Grok среди худших чатботов по защите детей.
- Августовский затор релизов: слухи о Claude Fable 5.1, open-weight-шок Kimi K3 и лоббирование GPT-6 в Белом доме сходятся в одном окне — узкое место — пропускная способность оценки, а не GPU-бюджет.
02Почему xAI ставит на SFT и RL, а не только на масштаб
Маск подчеркнул «значительно улучшенные SFT и RL» для Grok 4.6 вместо чистого роста параметров. Это продолжение логики Grok 4.5: co-training на реальных сессиях разработчиков в Cursor дал 4,2× разрыв по токен-эффективности на SWE-Bench Pro (15 954 vs 67 020 токенов у Opus 4.8) без лидерства на каждом intelligence-лидерборде.
SFT и RL простыми словами
Supervised fine-tuning (SFT) формирует поведение на курируемых примерах. Reinforcement learning (RL) использует сигналы награды, чтобы модель училась успешным многошаговым цепочкам действий — критично для agentic-воркфлоу, где один неверный tool call рвёт цепь.
Стратегия двух SKU
Grok 4.6 на 1,5T — заметный скачок масштаба. Формулировка Маска про 4.7 — больше, «лучше почти везде, чуть медленнее serving» — намекает на разделение latency-sensitive и quality-sensitive нагрузок, как Sonnet/Opus или mini/full tiers.
Давление Kimi K3 без названия
Целевая дата Grok 4.6 — примерно через 10 дней после полного open-weight-релиза Kimi K3. K3 возглавил Frontend Code Arena с 1 679 очками — первая open-weight модель, обошедшая все closed models на этой доске. Маск называл K3 «впечатляющим» в ветках бенчмарков. Сжатый темп xAI читается как конкурентный ответ.
03Сравнение frontier: Grok 4.6 в августовском поле
| Модель | Вендор | Параметры | Контекст | Цена (input/output за 1M) | Источник |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | Не раскрыто | 500K | $2 / $6 | xAI официально |
| Grok 4.6 (анонс) | xAI | 1,5T | Не раскрыто | Не раскрыто | Пост Маска в X (не верифицировано) |
| Grok 4.7 (анонс) | xAI | 2,1T | Не раскрыто | Не раскрыто | Пост Маска в X (не верифицировано) |
| Kimi K3 | Moonshot AI | 2,8T MoE (~104B активных) | 1M | $0,30 cache hit / $3 miss in, $15 out | Moonshot + Hugging Face |
| Claude Fable 5.1 (слухи) | Anthropic | Не раскрыто | Не раскрыто | Слух $10 / $50 | 36kr, WinCentral — не подтверждено |
| GPT-5.6 Sol | OpenAI | Не раскрыто | Не раскрыто | Не раскрыто | OpenAI официально |
Верифицированные бенчмарки (только выпущенные модели)
| Модель | SWE-bench Verified | Artificial Analysis Index | Статус |
|---|---|---|---|
| Claude Opus 5 | 97 % | — | Выпущен 24 июл. |
| GPT-5.6 Sol | 96,2 % | 59 | Выпущен 9 июл. |
| Claude Fable 5 | 95 % | 60 | Выпущен 9 июн. |
| Kimi K3 | 93,4 % | ~57 (#3 в мире) | Выпущен 16–27 июл. |
| Grok 4.5 | 64,7 % (SWE-Bench Pro) | 54 | Выпущен 8 июл. |
| Grok 4.6 | Нет данных | Нет данных | Не выпущена |
Реальное преимущество Grok 4.5 сегодня — экономика на задачу и завершение agent-воркфлоу, а не ранг SWE-bench. Закроет ли push SFT/RL у 4.6 разрыв в coding на 16–30 пунктов против Fable 5 / K3 без потери токен-эффективности — открытый вопрос до релиза.
04Pacing the Frontier, иск о безопасности и августовское узкое место
28 июля стал днём раздвоенного экрана. Пока Маск публиковал roadmap Grok 4.6/4.7, более 1 100 сотрудников OpenAI, Anthropic, Google DeepMind и Meta выпустили «Pacing the Frontier» — открытое письмо с просьбой к правительству США создать инструменты для целенаправленного замедления frontier-AI-исследований. OpenAI и Anthropic поддержали на корпоративном уровне. xAI отсутствовала.
На той же неделе Альтман продемонстрировал неопубликованную модель (широко считается GPT-6) в Белом доме после инцидента sandbox Hugging Face. Индустрия одновременно лоббирует замедление и гонку релизов — xAI твёрдо в лагере ускорения с тремя frontier-моделями за два месяца.
Август 2026 складывается в узкое место релизов. Если график Маска сработает, Grok 4.6 и 4.7 приземлятся в том же месяце, что слухи о Claude Fable 5.1, и через недели после open-weight-шока Kimi K3. Для инженерных команд полезный срок жизни каждого флагмана сжимается до недель — токен-эффективность и реальная стоимость задачи становятся более устойчивой основой выбора, чем один лидерборд.
056-шаговый runbook до выхода Grok 4.6
- 01
- 02
-
03
Спланировать routing двух SKU: 4.6 (быстрее, 1,5T) vs 4.7 (медленнее serving, 2,1T, лучше токен-эффективность). Набросать политику: latency-sensitive agent loops на 4.6, quality-critical refactors на 4.7 — с учётом реальных цен.
-
04
Собрать шаблон bake-off на 48 часов: 20–50 реальных repo-задач с автоматическим скорингом. При выходе Grok 4.6 прогнать тот же harness против Grok 4.5, K3 и incumbent за 48 часов до prod-трафика.
-
05
Учесть vendor-risk в закупках: пройтись с legal/compliance по иску xAI по CSAM и рейтингу Common Sense Media. Если продукт обслуживает несовершеннолетних или регулируемые данные — sign-off до prod на Grok 4.6.
-
06
Бюджет на август, не архитектура на август: не перестраивать agent-пайплайны под невыпущенные модели. Держать Grok 4.5 или текущий стек в prod весь август; sandbox-бюджет только на оценку 4.6. Пересмотреть routing после официальных цен и model card — и следить, не сдвинет ли поле Claude Fable 5.1 или GPT-6.
06Вердикт: ждать Grok 4.6?
Grok 4.6 правдоподобен — у xAI есть GPU-кластер Memphis, партнёрство с Cursor и давление Kimi K3. Но «правдоподобно» ≠ «подтверждено». Пока нет model card, бенчмарков и цен, ставка prod на 7 августа — игра на «время Маска».
Разумнее в июле–августе 2026: продолжать на Grok 4.5 (если токен-экономика устраивает), Kimi K3 (если важна open-weight-гибкость) или текущем Claude/GPT (если точность SWE-bench не обсуждается). Runbook выше позволит оценить Grok 4.6 в sandbox в день релиза — без миграции prod по твиту.
Оценка агентов требует стабильной инфраструктуры. Команды с 48-часовыми bake-off по API Grok, Kimi и Claude часто упираются в общие CI-раннеры, домашние Mac и нестабильные long-lived-соединения, искажающие латентность и замеры токенов. Для выделенных 24/7 agent-хостов с аудируемыми build-плоскостями и региональными primary-путями подходят мультирегиональные bare-metal Mac / cloud Mac узлы NUKCLOUD в стратегии multi-model routing. Спеки на странице цен, trial через заказ.
-
Когда именно выйдет Grok 4.6?Маск указал «около 7 августа 2026» в ответе @rauchg 28 июля. xAI официально не подтвердила. Считайте целевой датой с возможным сдвигом на дни или недели.
-
Чем Grok 4.6 отличается от Grok 4.7?Grok 4.6: 1,5T параметров, фокус SFT/RL. Grok 4.7 через несколько недель: 2,1T, по словам Маска лучше почти везде, чуть медленнее serving, выше токен-эффективность.
-
Победит ли Grok 4.6 Kimi K3 или Claude Fable 5.1?Рано судить. У Kimi K3 верифицированные оценки, включая Frontend Code Arena. Claude Fable 5.1 Anthropic не подтвердила. Сравнение после релиза с model card.
-
Сколько будет стоить Grok 4.6?Неизвестно. Grok 4.5 стартовал с $2/M input и $6/M output — ориентир, но цены 4.6 xAI не раскрыла.
-
Где будет доступен Grok 4.6?По аналогии с Grok 4.5: сначала Grok Build, API xAI и консоль xAI, затем сторонние платформы вроде Cursor — для 4.6 не подтверждено.
Данные на 2026-07-30. Источники: релиз Grok 4.5 xAI, пост Илона Маска в X 28 июля 2026 (ответ @rauchg), релиз Kimi K3 Moonshot, Emergent.sh / WinCentral / 36kr о Claude Fable 5.1, The Verge / TechTimes о Pacing the Frontier, Ars Technica / TechCrunch / The Guardian об иске xAI по безопасности.