Grok 4.6 : date de sortie, Musk annonce le 7 août et 1,5 billion de paramètres

Le 28 juillet 2026, Elon Musk a répondu sur X à Guillermo Rauch (Vercel) : xAI livrerait Grok 4.6 vers le 7 août1,5 billion de paramètres, upgrades SFT/RL majeurs — puis Grok 4.7 à 2,1 billions quelques semaines après. Pas de billet officiel xAI, pas de fiche modèle, pas de page tarifs. Ce guide sépare faits confirmés et spéculation « Musk time », et situe Grok 4.6 face à Grok 4.5, Kimi K3 et la dynamique pré-GPT-6.

Synthèse : toute la feuille de route Grok 4.6/4.7 repose sur un seul post Musk — pas une annonce xAI. Si le calendrier tient, xAI sortirait trois modèles frontier en deux mois, plaçant Grok 4.6 dans la même fenêtre d'août que le choc open-weight de Kimi K3 et les rumeurs Claude Fable 5.1. Le même jour, plus de 1 100 employés ont signé « Pacing the Frontier » — xAI absent de la liste. Ci-dessous : chronologie, tableaux de specs, lecture SFT/RL, matrice concurrentielle, points de friction, runbook en six étapes et FAQ.

00Chronologie : de Grok 4.5 à 4.6 puis 4.7 en moins de deux mois

DateÉvénement
8 juillet 2026xAI livre Grok 4.5 — co-entraînement Cursor, contexte 500K, 2/6 USD par M tokens, fiche modèle avec 15 benchmarks
16–27 juillet 2026Moonshot AI lance Kimi K3 en service hébergé, puis publie les poids open 2,8T sur Hugging Face
28 juillet 2026Musk répond à @rauchg : Grok 4.6 (~7 août), Grok 4.7 (quelques semaines après) — seule source publique pour les deux modèles
28 juillet 20261 100+ employés chez OpenAI, Anthropic, Google et Meta signent « Pacing the Frontier » ; OpenAI et Anthropic approuvent au niveau corporate — xAI absent
~7 août 2026 (cible)Grok 4.6 — 1,5T paramètres, focus SFT/RL
Fin août–début sept. 2026 (estimé)Grok 4.7 — 2,1T ; Musk : meilleur que 4.6 sauf serving un peu plus lent, meilleure efficacité token
Réserves sur les sources : les specs Grok 4.6 et 4.7 proviennent d'un post social exécutif. xAI n'a rien publié sur son blog, sa doc ou ses pages produit. Le « Musk time » a historiquement glissé de jours à semaines — le 7 août est une cible directionnelle, pas une date contractuelle.

01Données clés : confirmé vs annoncé

ModèleDateParamètresFocusStatut
Grok 4.3 Beta17 avr. 2026Non divulguéBaseline antérieureLivré
Grok 4.58 juil. 2026Non divulguéCoding/agentique, co-training CursorLivré, benchmarké
Grok 4.6~7 août 20261,5TUpgrade SFT/RLTweet seul, non livré
Grok 4.7~fin août2,1TUpgrade large sur 4.6, efficacité tokenTweet seul, non livré

Grok 4.5 est arrivé avec fiche modèle, 15 benchmarks et tarifs API. Grok 4.6 n'a aucune donnée d'évaluation indépendante. Comptages de paramètres et claims post-entraînement = déclarations vendeur issues d'un post X, jusqu'à preuve contraire de xAI.

PainPourquoi planifier des modèles en août fait mal

  • Risque roadmap mono-source : le calendrier achats dépend d'un tweet, pas d'une page produit xAI. Les équipes qui calent des sprints d'août sur Grok 4.6 n'ont ni SLA, ni accès bêta, ni plan B si la date glisse.
  • Durée de vie flagship compressée : Grok 4.5 est sorti le 8 juillet. Si 4.6 arrive le 7 août, vous finissez peut-être l'onboarding d'un modèle déjà une génération en retard — avant que les benchmarks justifient la migration.
  • Vide de benchmarks : Grok 4.5 apportait SWE-Bench Pro (64,7 %), Terminal Bench 2.1 (83,3 %) et données d'efficacité token. Rien pour 4.6. Impossible de faire un bake-off responsable contre Kimi K3 (93,4 % SWE-bench Verified) ou GPT-5.6 Sol (96,2 %) sur la seule foi.
  • Confusion double SKU : Musk a esquissé 4.6 (1,5T, plus rapide) et 4.7 (2,1T, serving plus lent, meilleure efficacité token) dans la même réponse. Attendre le « meilleur » ou shipper le « plus rapide » — sans delta prix ni IDs modèle API.
  • Responsabilité sécurité fournisseur : en juillet 2026, xAI a poursuivi un utilisateur pour usage présumé de Grok en CSAM — admission implicite que les garde-fous peuvent être contournés. Un rapport Common Sense Media de janvier 2026 classe Grok parmi les pires chatbots pour la protection des mineurs.
  • Embouteillage releases août : rumeurs Claude Fable 5.1, choc open-weight Kimi K3 et lobbying GPT-6 à la Maison-Blanche convergent — la bande passante d'évaluation devient le goulot, pas le budget GPU.

02Pourquoi xAI mise sur SFT et RL, pas seulement l'échelle

Musk a insisté sur un SFT et RL « nettement améliorés » pour Grok 4.6 plutôt que sur la seule croissance paramétrique. Cela prolonge la logique Grok 4.5 : co-entraînement sur sessions développeur Cursor réelles → écart d'efficacité token 4,2× sur SWE-Bench Pro (15 954 vs 67 020 tokens Opus 4.8) sans dominer chaque leaderboard intelligence.

SFT et RL en termes simples

Supervised fine-tuning (SFT) façonne le comportement via exemples curatés. Reinforcement learning (RL) utilise des signaux de récompense pour apprendre quelles séquences d'actions multi-étapes réussissent — crucial pour les workflows agentiques où un mauvais appel d'outil casse la chaîne.

La stratégie double SKU

Grok 4.6 à 1,5T représente un saut d'échelle notable. Le cadrage de 4.7 — plus gros, « meilleur partout sauf serving un peu plus lent » — suggère une séparation délibérée des charges sensibles à la latence vs à la qualité, comme Sonnet/Opus ou les tiers mini/full.

La pression Kimi K3 non nommée

La date cible de Grok 4.6 tombe ~10 jours après le release open-weight complet de Kimi K3. K3 a dominé Frontend Code Arena (1 679 pts) — premier modèle open-weight à battre tous les modèles fermés sur ce board. Musk a qualifié K3 d'« impressionnant » dans des fils benchmark. La cadence xAI compressée se lit comme réponse compétitive.

03Comparaison frontier : Grok 4.6 dans le champ d'août

ModèleÉditeurParamètresContextePrix (entrée/sortie par 1M)Source
Grok 4.5xAINon divulgué500K2 USD / 6 USDxAI officiel
Grok 4.6 (annoncé)xAI1,5TNon divulguéNon divulguéPost X Musk (non vérifié)
Grok 4.7 (annoncé)xAI2,1TNon divulguéNon divulguéPost X Musk (non vérifié)
Kimi K3Moonshot AI2,8T MoE (~104B actifs)1M0,30 USD cache hit / 3 USD miss in, 15 USD outMoonshot + Hugging Face
Claude Fable 5.1 (rumeur)AnthropicNon divulguéNon divulguéRumeur 10 USD / 50 USD36kr, WinCentral — non confirmé
GPT-5.6 SolOpenAINon divulguéNon divulguéNon divulguéOpenAI officiel

Benchmarks vérifiés (modèles livrés uniquement)

ModèleSWE-bench VerifiedArtificial Analysis IndexStatut
Claude Opus 597 %Livré 24 juil.
GPT-5.6 Sol96,2 %59Livré 9 juil.
Claude Fable 595 %60Livré 9 juin
Kimi K393,4 %~57 (#3 mondial)Livré 16–27 juil.
Grok 4.564,7 % (SWE-Bench Pro)54Livré 8 juil.
Grok 4.6Aucune donnéeAucune donnéeNon livré

L'avantage actuel de Grok 4.5 est l'économie par tâche et la complétion de workflows agent — pas le rang SWE-bench. La question ouverte : le push SFT/RL de 4.6 comble-t-il l'écart coding de 16–30 points face à Fable 5 / K3 sans sacrifier l'efficacité token ? Réponse impossible avant le launch.

04Pacing the Frontier, procès sécurité et goulot d'août

Le 28 juillet fut une journée en écran partagé. Pendant que Musk postait la roadmap Grok 4.6/4.7, plus de 1 100 employés d'OpenAI, Anthropic, Google DeepMind et Meta publiaient « Pacing the Frontier » — lettre ouverte demandant à l'État américain des outils pour ralentir délibérément la recherche frontier. OpenAI et Anthropic ont approuvé au niveau corporate. xAI était absent.

La même semaine, Altman a démontré un modèle non publié (largement supposé être GPT-6) à la Maison-Blanche après l'incident sandbox Hugging Face. L'industrie lobbys simultanément pour ralentir et pour shipper — xAI est clairement dans le camp accélération avec trois modèles frontier visés en deux mois.

Août 2026 devient un goulot de releases. Si le calendrier Musk tient, Grok 4.6 et 4.7 atterrissent le même mois que les rumeurs Claude Fable 5.1 et quelques semaines après le choc open-weight Kimi K3. Pour les équipes engineering, la durée utile de chaque flagship se réduit à des semaines — efficacité token et coût réel par tâche deviennent des bases de choix plus durables que le rang leaderboard seul.

05Runbook en six étapes avant Grok 4.6

  1. 01
    Fixer la baseline sur modèles livrés : lancer votre harness d'éval standard contre Grok 4.5, Kimi K3 et votre tier Claude ou GPT actuel. Noter tokens et coût dollar par tâche.
  2. 02
    S'abonner aux canaux officiels uniquement : suivre @xai sur X et surveiller x.ai / docs.x.ai. Ignorer les offres « early access » tierces tant qu'xAI n'a pas publié de fiche modèle.
  3. 03
    Planifier le routage double SKU : 4.6 (plus rapide, 1,5T) vs 4.7 (serving plus lent, 2,1T, meilleure efficacité token). Esquisser la politique de routage : boucles agent sensibles latence sur 4.6, refactors critiques qualité sur 4.7 — sous réserve des prix réels.
  4. 04
    Préparer un template bake-off 48 h : 20–50 tâches repo réelles avec scoring automatisé. Au drop de Grok 4.6, exécuter le même harness contre Grok 4.5, K3 et l'incumbent en 48 h avant tout trafic prod.
  5. 05
    Intégrer le risque fournisseur à l'achat : passer en revue la plainte CSAM xAI et le rating Common Sense Media avec legal/compliance. Si votre produit touche des mineurs ou des données régulées, obtenir un sign-off avant routage prod vers Grok 4.6.
  6. 06
    Budgeter août, pas l'architecture d'août : ne pas ré-architecturer les pipelines agent autour de modèles non livrés. Garder Grok 4.5 ou la stack actuelle en prod tout août ; allouer un budget sandbox pour l'éval 4.6 seulement. Revoir le routage après tarifs officiels et fiche modèle — et surveiller si Claude Fable 5.1 ou GPT-6 déplace à nouveau le terrain.

06Verdict : attendre Grok 4.6 ?

Grok 4.6 est plausible — xAI dispose du cluster GPU Memphis, du partenariat Cursor et d'une pression claire de Kimi K3. Mais « plausible » n'est pas « confirmé ». Tant qu'il n'y a pas de fiche modèle, benchmarks et tarifs, miser la prod sur le 7 août, c'est parier sur le Musk time.

Le jeu plus intelligent juillet–août 2026 : continuer sur Grok 4.5 (si l'économie token convient), Kimi K3 (si la flexibilité open-weight compte) ou votre tier Claude/GPT actuel (si la précision SWE-bench est non négociable). Exécuter le runbook ci-dessus pour évaluer Grok 4.6 en sandbox le jour J — sans migrer la prod sur un tweet.

L'évaluation agent nécessite une infra stable. Les équipes qui enchaînent des bake-offs 48 h sur APIs Grok, Kimi et Claude butent souvent sur des runners CI partagés, Mac domestiques et connexions longues instables qui biaisent latence et mesures token. Pour des hôtes agent dédiés 24/7 avec plans de build auditables et chemins primaires régionaux, les nœuds Mac bare metal / cloud Mac multirégionaux NUKCLOUD s'alignent avec une stratégie de routage multi-modèles. Specs sur la page tarifs, environnement d'essai via commander.

  • Quelle est la date exacte de sortie de Grok 4.6 ?
    Musk a indiqué « autour du 7 août 2026 » dans une réponse X à @rauchg le 28 juillet. xAI n'a pas confirmé officiellement. Considérez une cible susceptible de glisser de quelques jours ou semaines.
  • Quelle différence entre Grok 4.6 et Grok 4.7 ?
    Grok 4.6 : 1,5T paramètres, focus SFT/RL. Grok 4.7, quelques semaines après : 2,1T, meilleur partout selon Musk sauf serving un peu plus lent, meilleure efficacité token.
  • Grok 4.6 battra-t-il Kimi K3 ou Claude Fable 5.1 ?
    Trop tôt. Kimi K3 a des scores tiers vérifiés dont Frontend Code Arena. Claude Fable 5.1 n'est pas confirmé par Anthropic. Comparaison sérieuse après release avec fiche modèle.
  • Quel sera le prix de Grok 4.6 ?
    Inconnu. Grok 4.5 a démarré à 2 USD/M entrée et 6 USD/M sortie — référence, mais pas de tarifs 4.6 d'xAI.
  • Où utiliser Grok 4.6 ?
    D'après Grok 4.5, probablement Grok Build, API xAI et console xAI en premier, puis intégrations tierces comme Cursor — non confirmé pour 4.6.

Données au 2026-07-30. Sources : lancement Grok 4.5 xAI, post X Elon Musk 28 juillet 2026 (réponse à @rauchg), release Kimi K3 Moonshot, Emergent.sh / WinCentral / 36kr sur Claude Fable 5.1, The Verge / TechTimes sur Pacing the Frontier, Ars Technica / TechCrunch / The Guardian sur procès sécurité xAI.