Дата выхода Grok 4.6: Маск назвал 7 августа и 1,5 трлн параметров

28 июля 2026 Илон Маск ответил в X CEO Vercel Гильермо Рауху: xAI выпустит Grok 4.6 около 7 августа — модель с 1,5 трлн параметров и серьёзным апгрейдом SFT/RL —, а через несколько недель Grok 4.7 на 2,1 трлн. Официального поста xAI, model card и страницы цен нет. Этот разбор отделяет подтверждённые факты от «времени Маска» и ставит Grok 4.6 рядом с Grok 4.5, Kimi K3 и динамикой перед GPT-6.

Итог: вся дорожная карта Grok 4.6/4.7 держится на одном посте Маска — не на анонсе xAI. Если график сработает, xAI выпустит три frontier-модели за ~два месяца, поместив Grok 4.6 в то же августовское окно, что open-weight-шок Kimi K3 и слухи о Claude Fable 5.1. В тот же день 1 100+ сотрудников подписали письмо «Pacing the Frontier» — xAI в списке не было. Ниже: таймлайн, таблицы спецификаций, разбор SFT/RL, матрица конкурентов, болевые точки для инженерных команд, 6-шаговый runbook и FAQ.

00Таймлайн: от Grok 4.5 к 4.6 и 4.7 менее чем за два месяца

ДатаСобытие
8 июля 2026xAI выпускает Grok 4.5 — co-training с Cursor, контекст 500K, $2/$6 за M токенов, model card с 15 бенчмарками
16–27 июля 2026Moonshot AI запускает Kimi K3 как сервис, затем публикует open weights 2,8T на Hugging Face
28 июля 2026Маск отвечает @rauchg: Grok 4.6 (~7 авг.), Grok 4.7 (через несколько недель) — единственный публичный источник по обеим моделям
28 июля 20261 100+ сотрудников OpenAI, Anthropic, Google и Meta подписывают «Pacing the Frontier»; OpenAI и Anthropic на корпоративном уровне — xAI отсутствует
~7 августа 2026 (цель)Grok 4.6 — 1,5T параметров, фокус SFT/RL
Конец авг.–нач. сент. 2026 (оценка)Grok 4.7 — 2,1T; Маск: лучше 4.6, чуть медленнее serving, выше токен-эффективность
Оговорка по источникам: спецификации Grok 4.6 и 4.7 — из одного поста руководителя в соцсети. xAI не публиковала ни в блоге, ни в документации, ни на продуктовых страницах. «Время Маска» у Tesla, SpaceX и xAI исторически сдвигалось на дни и недели — 7 августа это ориентир, не контрактная дата.

01Ключевые данные: известно vs заявлено

МодельДатаПараметрыФокусСтатус
Grok 4.3 Beta17 апр. 2026Не раскрытоПредыдущая базаВыпущена
Grok 4.58 июл. 2026Не раскрытоCoding/agentic, co-training CursorВыпущена, с бенчмарками
Grok 4.6~7 авг. 20261,5TАпгрейд SFT/RLТолько твит, не выпущена
Grok 4.7~конец авг.2,1TШирокий апгрейд над 4.6, токен-эффективностьТолько твит, не выпущена

Grok 4.5 вышел с model card, 15 бенчмарками и ценами API. У Grok 4.6 ноль независимых оценок. Числа параметров и заявления о post-training — vendor statements из одного поста в X, пока xAI не опубликует иное.

PainПочему планирование моделей на август сейчас больно

  • Риск roadmap из одного источника: календарь закупок завязан на твит, а не на продуктовую страницу xAI. Команды, строящие августовские спринты вокруг Grok 4.6, не имеют SLA, beta-доступа и запасного плана при сдвиге даты.
  • Сжатый срок жизни флагмана: Grok 4.5 вышел 8 июля. Если 4.6 придёт 7 августа, вы можете закончить онбординг модели, уже устаревшей на поколение — до того как бенчмарки оправдают миграцию.
  • Вакуум бенчмарков: у Grok 4.5 были SWE-Bench Pro (64,7 %), Terminal Bench 2.1 (83,3 %) и данные по токен-эффективности. У 4.6 — ничего. Ответственный bake-off против Kimi K3 (93,4 % SWE-bench Verified) или GPT-5.6 Sol (96,2 %) на вере невозможен.
  • Путаница с двумя SKU: Маск в одном ответе описал 4.6 (1,5T, быстрее) и 4.7 (2,1T, медленнее serving, лучше токен-эффективность). Ждать «лучшую» или шипить «быструю» — без дельты цен и API model ID.
  • Vendor safety liability: в июле 2026 xAI подала иск против пользователя за предполагаемую генерацию CSAM через Grok — неявное признание, что защиты обходятся. Отчёт Common Sense Media (январь 2026) поставил Grok среди худших чатботов по защите детей.
  • Августовский затор релизов: слухи о Claude Fable 5.1, open-weight-шок Kimi K3 и лоббирование GPT-6 в Белом доме сходятся в одном окне — узкое место — пропускная способность оценки, а не GPU-бюджет.

02Почему xAI ставит на SFT и RL, а не только на масштаб

Маск подчеркнул «значительно улучшенные SFT и RL» для Grok 4.6 вместо чистого роста параметров. Это продолжение логики Grok 4.5: co-training на реальных сессиях разработчиков в Cursor дал 4,2× разрыв по токен-эффективности на SWE-Bench Pro (15 954 vs 67 020 токенов у Opus 4.8) без лидерства на каждом intelligence-лидерборде.

SFT и RL простыми словами

Supervised fine-tuning (SFT) формирует поведение на курируемых примерах. Reinforcement learning (RL) использует сигналы награды, чтобы модель училась успешным многошаговым цепочкам действий — критично для agentic-воркфлоу, где один неверный tool call рвёт цепь.

Стратегия двух SKU

Grok 4.6 на 1,5T — заметный скачок масштаба. Формулировка Маска про 4.7 — больше, «лучше почти везде, чуть медленнее serving» — намекает на разделение latency-sensitive и quality-sensitive нагрузок, как Sonnet/Opus или mini/full tiers.

Давление Kimi K3 без названия

Целевая дата Grok 4.6 — примерно через 10 дней после полного open-weight-релиза Kimi K3. K3 возглавил Frontend Code Arena с 1 679 очками — первая open-weight модель, обошедшая все closed models на этой доске. Маск называл K3 «впечатляющим» в ветках бенчмарков. Сжатый темп xAI читается как конкурентный ответ.

03Сравнение frontier: Grok 4.6 в августовском поле

МодельВендорПараметрыКонтекстЦена (input/output за 1M)Источник
Grok 4.5xAIНе раскрыто500K$2 / $6xAI официально
Grok 4.6 (анонс)xAI1,5TНе раскрытоНе раскрытоПост Маска в X (не верифицировано)
Grok 4.7 (анонс)xAI2,1TНе раскрытоНе раскрытоПост Маска в X (не верифицировано)
Kimi K3Moonshot AI2,8T MoE (~104B активных)1M$0,30 cache hit / $3 miss in, $15 outMoonshot + Hugging Face
Claude Fable 5.1 (слухи)AnthropicНе раскрытоНе раскрытоСлух $10 / $5036kr, WinCentral — не подтверждено
GPT-5.6 SolOpenAIНе раскрытоНе раскрытоНе раскрытоOpenAI официально

Верифицированные бенчмарки (только выпущенные модели)

МодельSWE-bench VerifiedArtificial Analysis IndexСтатус
Claude Opus 597 %Выпущен 24 июл.
GPT-5.6 Sol96,2 %59Выпущен 9 июл.
Claude Fable 595 %60Выпущен 9 июн.
Kimi K393,4 %~57 (#3 в мире)Выпущен 16–27 июл.
Grok 4.564,7 % (SWE-Bench Pro)54Выпущен 8 июл.
Grok 4.6Нет данныхНет данныхНе выпущена

Реальное преимущество Grok 4.5 сегодня — экономика на задачу и завершение agent-воркфлоу, а не ранг SWE-bench. Закроет ли push SFT/RL у 4.6 разрыв в coding на 16–30 пунктов против Fable 5 / K3 без потери токен-эффективности — открытый вопрос до релиза.

04Pacing the Frontier, иск о безопасности и августовское узкое место

28 июля стал днём раздвоенного экрана. Пока Маск публиковал roadmap Grok 4.6/4.7, более 1 100 сотрудников OpenAI, Anthropic, Google DeepMind и Meta выпустили «Pacing the Frontier» — открытое письмо с просьбой к правительству США создать инструменты для целенаправленного замедления frontier-AI-исследований. OpenAI и Anthropic поддержали на корпоративном уровне. xAI отсутствовала.

На той же неделе Альтман продемонстрировал неопубликованную модель (широко считается GPT-6) в Белом доме после инцидента sandbox Hugging Face. Индустрия одновременно лоббирует замедление и гонку релизов — xAI твёрдо в лагере ускорения с тремя frontier-моделями за два месяца.

Август 2026 складывается в узкое место релизов. Если график Маска сработает, Grok 4.6 и 4.7 приземлятся в том же месяце, что слухи о Claude Fable 5.1, и через недели после open-weight-шока Kimi K3. Для инженерных команд полезный срок жизни каждого флагмана сжимается до недель — токен-эффективность и реальная стоимость задачи становятся более устойчивой основой выбора, чем один лидерборд.

056-шаговый runbook до выхода Grok 4.6

  1. 01
    Зафиксировать baseline на выпущенных моделях: прогнать стандартный eval-harness против Grok 4.5, Kimi K3 и текущего tier Claude или GPT. Записать токены и долларовую стоимость на задачу.
  2. 02
    Подписаться только на официальные каналы: следить за @xai в X и x.ai / docs.x.ai. Игнорировать сторонние «early access», пока xAI не опубликует model card.
  3. 03
    Спланировать routing двух SKU: 4.6 (быстрее, 1,5T) vs 4.7 (медленнее serving, 2,1T, лучше токен-эффективность). Набросать политику: latency-sensitive agent loops на 4.6, quality-critical refactors на 4.7 — с учётом реальных цен.
  4. 04
    Собрать шаблон bake-off на 48 часов: 20–50 реальных repo-задач с автоматическим скорингом. При выходе Grok 4.6 прогнать тот же harness против Grok 4.5, K3 и incumbent за 48 часов до prod-трафика.
  5. 05
    Учесть vendor-risk в закупках: пройтись с legal/compliance по иску xAI по CSAM и рейтингу Common Sense Media. Если продукт обслуживает несовершеннолетних или регулируемые данные — sign-off до prod на Grok 4.6.
  6. 06
    Бюджет на август, не архитектура на август: не перестраивать agent-пайплайны под невыпущенные модели. Держать Grok 4.5 или текущий стек в prod весь август; sandbox-бюджет только на оценку 4.6. Пересмотреть routing после официальных цен и model card — и следить, не сдвинет ли поле Claude Fable 5.1 или GPT-6.

06Вердикт: ждать Grok 4.6?

Grok 4.6 правдоподобен — у xAI есть GPU-кластер Memphis, партнёрство с Cursor и давление Kimi K3. Но «правдоподобно» ≠ «подтверждено». Пока нет model card, бенчмарков и цен, ставка prod на 7 августа — игра на «время Маска».

Разумнее в июле–августе 2026: продолжать на Grok 4.5 (если токен-экономика устраивает), Kimi K3 (если важна open-weight-гибкость) или текущем Claude/GPT (если точность SWE-bench не обсуждается). Runbook выше позволит оценить Grok 4.6 в sandbox в день релиза — без миграции prod по твиту.

Оценка агентов требует стабильной инфраструктуры. Команды с 48-часовыми bake-off по API Grok, Kimi и Claude часто упираются в общие CI-раннеры, домашние Mac и нестабильные long-lived-соединения, искажающие латентность и замеры токенов. Для выделенных 24/7 agent-хостов с аудируемыми build-плоскостями и региональными primary-путями подходят мультирегиональные bare-metal Mac / cloud Mac узлы NUKCLOUD в стратегии multi-model routing. Спеки на странице цен, trial через заказ.

  • Когда именно выйдет Grok 4.6?
    Маск указал «около 7 августа 2026» в ответе @rauchg 28 июля. xAI официально не подтвердила. Считайте целевой датой с возможным сдвигом на дни или недели.
  • Чем Grok 4.6 отличается от Grok 4.7?
    Grok 4.6: 1,5T параметров, фокус SFT/RL. Grok 4.7 через несколько недель: 2,1T, по словам Маска лучше почти везде, чуть медленнее serving, выше токен-эффективность.
  • Победит ли Grok 4.6 Kimi K3 или Claude Fable 5.1?
    Рано судить. У Kimi K3 верифицированные оценки, включая Frontend Code Arena. Claude Fable 5.1 Anthropic не подтвердила. Сравнение после релиза с model card.
  • Сколько будет стоить Grok 4.6?
    Неизвестно. Grok 4.5 стартовал с $2/M input и $6/M output — ориентир, но цены 4.6 xAI не раскрыла.
  • Где будет доступен Grok 4.6?
    По аналогии с Grok 4.5: сначала Grok Build, API xAI и консоль xAI, затем сторонние платформы вроде Cursor — для 4.6 не подтверждено.

Данные на 2026-07-30. Источники: релиз Grok 4.5 xAI, пост Илона Маска в X 28 июля 2026 (ответ @rauchg), релиз Kimi K3 Moonshot, Emergent.sh / WinCentral / 36kr о Claude Fable 5.1, The Verge / TechTimes о Pacing the Frontier, Ars Technica / TechCrunch / The Guardian об иске xAI по безопасности.