Synthèse : toute la feuille de route Grok 4.6/4.7 repose sur un seul post Musk — pas une annonce xAI. Si le calendrier tient, xAI sortirait trois modèles frontier en deux mois, plaçant Grok 4.6 dans la même fenêtre d'août que le choc open-weight de Kimi K3 et les rumeurs Claude Fable 5.1. Le même jour, plus de 1 100 employés ont signé « Pacing the Frontier » — xAI absent de la liste. Ci-dessous : chronologie, tableaux de specs, lecture SFT/RL, matrice concurrentielle, points de friction, runbook en six étapes et FAQ.
00Chronologie : de Grok 4.5 à 4.6 puis 4.7 en moins de deux mois
| Date | Événement |
|---|---|
| 8 juillet 2026 | xAI livre Grok 4.5 — co-entraînement Cursor, contexte 500K, 2/6 USD par M tokens, fiche modèle avec 15 benchmarks |
| 16–27 juillet 2026 | Moonshot AI lance Kimi K3 en service hébergé, puis publie les poids open 2,8T sur Hugging Face |
| 28 juillet 2026 | Musk répond à @rauchg : Grok 4.6 (~7 août), Grok 4.7 (quelques semaines après) — seule source publique pour les deux modèles |
| 28 juillet 2026 | 1 100+ employés chez OpenAI, Anthropic, Google et Meta signent « Pacing the Frontier » ; OpenAI et Anthropic approuvent au niveau corporate — xAI absent |
| ~7 août 2026 (cible) | Grok 4.6 — 1,5T paramètres, focus SFT/RL |
| Fin août–début sept. 2026 (estimé) | Grok 4.7 — 2,1T ; Musk : meilleur que 4.6 sauf serving un peu plus lent, meilleure efficacité token |
01Données clés : confirmé vs annoncé
| Modèle | Date | Paramètres | Focus | Statut |
|---|---|---|---|---|
| Grok 4.3 Beta | 17 avr. 2026 | Non divulgué | Baseline antérieure | Livré |
| Grok 4.5 | 8 juil. 2026 | Non divulgué | Coding/agentique, co-training Cursor | Livré, benchmarké |
| Grok 4.6 | ~7 août 2026 | 1,5T | Upgrade SFT/RL | Tweet seul, non livré |
| Grok 4.7 | ~fin août | 2,1T | Upgrade large sur 4.6, efficacité token | Tweet seul, non livré |
Grok 4.5 est arrivé avec fiche modèle, 15 benchmarks et tarifs API. Grok 4.6 n'a aucune donnée d'évaluation indépendante. Comptages de paramètres et claims post-entraînement = déclarations vendeur issues d'un post X, jusqu'à preuve contraire de xAI.
PainPourquoi planifier des modèles en août fait mal
- Risque roadmap mono-source : le calendrier achats dépend d'un tweet, pas d'une page produit xAI. Les équipes qui calent des sprints d'août sur Grok 4.6 n'ont ni SLA, ni accès bêta, ni plan B si la date glisse.
- Durée de vie flagship compressée : Grok 4.5 est sorti le 8 juillet. Si 4.6 arrive le 7 août, vous finissez peut-être l'onboarding d'un modèle déjà une génération en retard — avant que les benchmarks justifient la migration.
- Vide de benchmarks : Grok 4.5 apportait SWE-Bench Pro (64,7 %), Terminal Bench 2.1 (83,3 %) et données d'efficacité token. Rien pour 4.6. Impossible de faire un bake-off responsable contre Kimi K3 (93,4 % SWE-bench Verified) ou GPT-5.6 Sol (96,2 %) sur la seule foi.
- Confusion double SKU : Musk a esquissé 4.6 (1,5T, plus rapide) et 4.7 (2,1T, serving plus lent, meilleure efficacité token) dans la même réponse. Attendre le « meilleur » ou shipper le « plus rapide » — sans delta prix ni IDs modèle API.
- Responsabilité sécurité fournisseur : en juillet 2026, xAI a poursuivi un utilisateur pour usage présumé de Grok en CSAM — admission implicite que les garde-fous peuvent être contournés. Un rapport Common Sense Media de janvier 2026 classe Grok parmi les pires chatbots pour la protection des mineurs.
- Embouteillage releases août : rumeurs Claude Fable 5.1, choc open-weight Kimi K3 et lobbying GPT-6 à la Maison-Blanche convergent — la bande passante d'évaluation devient le goulot, pas le budget GPU.
02Pourquoi xAI mise sur SFT et RL, pas seulement l'échelle
Musk a insisté sur un SFT et RL « nettement améliorés » pour Grok 4.6 plutôt que sur la seule croissance paramétrique. Cela prolonge la logique Grok 4.5 : co-entraînement sur sessions développeur Cursor réelles → écart d'efficacité token 4,2× sur SWE-Bench Pro (15 954 vs 67 020 tokens Opus 4.8) sans dominer chaque leaderboard intelligence.
SFT et RL en termes simples
Supervised fine-tuning (SFT) façonne le comportement via exemples curatés. Reinforcement learning (RL) utilise des signaux de récompense pour apprendre quelles séquences d'actions multi-étapes réussissent — crucial pour les workflows agentiques où un mauvais appel d'outil casse la chaîne.
La stratégie double SKU
Grok 4.6 à 1,5T représente un saut d'échelle notable. Le cadrage de 4.7 — plus gros, « meilleur partout sauf serving un peu plus lent » — suggère une séparation délibérée des charges sensibles à la latence vs à la qualité, comme Sonnet/Opus ou les tiers mini/full.
La pression Kimi K3 non nommée
La date cible de Grok 4.6 tombe ~10 jours après le release open-weight complet de Kimi K3. K3 a dominé Frontend Code Arena (1 679 pts) — premier modèle open-weight à battre tous les modèles fermés sur ce board. Musk a qualifié K3 d'« impressionnant » dans des fils benchmark. La cadence xAI compressée se lit comme réponse compétitive.
03Comparaison frontier : Grok 4.6 dans le champ d'août
| Modèle | Éditeur | Paramètres | Contexte | Prix (entrée/sortie par 1M) | Source |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | Non divulgué | 500K | 2 USD / 6 USD | xAI officiel |
| Grok 4.6 (annoncé) | xAI | 1,5T | Non divulgué | Non divulgué | Post X Musk (non vérifié) |
| Grok 4.7 (annoncé) | xAI | 2,1T | Non divulgué | Non divulgué | Post X Musk (non vérifié) |
| Kimi K3 | Moonshot AI | 2,8T MoE (~104B actifs) | 1M | 0,30 USD cache hit / 3 USD miss in, 15 USD out | Moonshot + Hugging Face |
| Claude Fable 5.1 (rumeur) | Anthropic | Non divulgué | Non divulgué | Rumeur 10 USD / 50 USD | 36kr, WinCentral — non confirmé |
| GPT-5.6 Sol | OpenAI | Non divulgué | Non divulgué | Non divulgué | OpenAI officiel |
Benchmarks vérifiés (modèles livrés uniquement)
| Modèle | SWE-bench Verified | Artificial Analysis Index | Statut |
|---|---|---|---|
| Claude Opus 5 | 97 % | — | Livré 24 juil. |
| GPT-5.6 Sol | 96,2 % | 59 | Livré 9 juil. |
| Claude Fable 5 | 95 % | 60 | Livré 9 juin |
| Kimi K3 | 93,4 % | ~57 (#3 mondial) | Livré 16–27 juil. |
| Grok 4.5 | 64,7 % (SWE-Bench Pro) | 54 | Livré 8 juil. |
| Grok 4.6 | Aucune donnée | Aucune donnée | Non livré |
L'avantage actuel de Grok 4.5 est l'économie par tâche et la complétion de workflows agent — pas le rang SWE-bench. La question ouverte : le push SFT/RL de 4.6 comble-t-il l'écart coding de 16–30 points face à Fable 5 / K3 sans sacrifier l'efficacité token ? Réponse impossible avant le launch.
04Pacing the Frontier, procès sécurité et goulot d'août
Le 28 juillet fut une journée en écran partagé. Pendant que Musk postait la roadmap Grok 4.6/4.7, plus de 1 100 employés d'OpenAI, Anthropic, Google DeepMind et Meta publiaient « Pacing the Frontier » — lettre ouverte demandant à l'État américain des outils pour ralentir délibérément la recherche frontier. OpenAI et Anthropic ont approuvé au niveau corporate. xAI était absent.
La même semaine, Altman a démontré un modèle non publié (largement supposé être GPT-6) à la Maison-Blanche après l'incident sandbox Hugging Face. L'industrie lobbys simultanément pour ralentir et pour shipper — xAI est clairement dans le camp accélération avec trois modèles frontier visés en deux mois.
Août 2026 devient un goulot de releases. Si le calendrier Musk tient, Grok 4.6 et 4.7 atterrissent le même mois que les rumeurs Claude Fable 5.1 et quelques semaines après le choc open-weight Kimi K3. Pour les équipes engineering, la durée utile de chaque flagship se réduit à des semaines — efficacité token et coût réel par tâche deviennent des bases de choix plus durables que le rang leaderboard seul.
05Runbook en six étapes avant Grok 4.6
- 01
- 02
-
03
Planifier le routage double SKU : 4.6 (plus rapide, 1,5T) vs 4.7 (serving plus lent, 2,1T, meilleure efficacité token). Esquisser la politique de routage : boucles agent sensibles latence sur 4.6, refactors critiques qualité sur 4.7 — sous réserve des prix réels.
-
04
Préparer un template bake-off 48 h : 20–50 tâches repo réelles avec scoring automatisé. Au drop de Grok 4.6, exécuter le même harness contre Grok 4.5, K3 et l'incumbent en 48 h avant tout trafic prod.
-
05
Intégrer le risque fournisseur à l'achat : passer en revue la plainte CSAM xAI et le rating Common Sense Media avec legal/compliance. Si votre produit touche des mineurs ou des données régulées, obtenir un sign-off avant routage prod vers Grok 4.6.
-
06
Budgeter août, pas l'architecture d'août : ne pas ré-architecturer les pipelines agent autour de modèles non livrés. Garder Grok 4.5 ou la stack actuelle en prod tout août ; allouer un budget sandbox pour l'éval 4.6 seulement. Revoir le routage après tarifs officiels et fiche modèle — et surveiller si Claude Fable 5.1 ou GPT-6 déplace à nouveau le terrain.
06Verdict : attendre Grok 4.6 ?
Grok 4.6 est plausible — xAI dispose du cluster GPU Memphis, du partenariat Cursor et d'une pression claire de Kimi K3. Mais « plausible » n'est pas « confirmé ». Tant qu'il n'y a pas de fiche modèle, benchmarks et tarifs, miser la prod sur le 7 août, c'est parier sur le Musk time.
Le jeu plus intelligent juillet–août 2026 : continuer sur Grok 4.5 (si l'économie token convient), Kimi K3 (si la flexibilité open-weight compte) ou votre tier Claude/GPT actuel (si la précision SWE-bench est non négociable). Exécuter le runbook ci-dessus pour évaluer Grok 4.6 en sandbox le jour J — sans migrer la prod sur un tweet.
L'évaluation agent nécessite une infra stable. Les équipes qui enchaînent des bake-offs 48 h sur APIs Grok, Kimi et Claude butent souvent sur des runners CI partagés, Mac domestiques et connexions longues instables qui biaisent latence et mesures token. Pour des hôtes agent dédiés 24/7 avec plans de build auditables et chemins primaires régionaux, les nœuds Mac bare metal / cloud Mac multirégionaux NUKCLOUD s'alignent avec une stratégie de routage multi-modèles. Specs sur la page tarifs, environnement d'essai via commander.
-
Quelle est la date exacte de sortie de Grok 4.6 ?Musk a indiqué « autour du 7 août 2026 » dans une réponse X à @rauchg le 28 juillet. xAI n'a pas confirmé officiellement. Considérez une cible susceptible de glisser de quelques jours ou semaines.
-
Quelle différence entre Grok 4.6 et Grok 4.7 ?Grok 4.6 : 1,5T paramètres, focus SFT/RL. Grok 4.7, quelques semaines après : 2,1T, meilleur partout selon Musk sauf serving un peu plus lent, meilleure efficacité token.
-
Grok 4.6 battra-t-il Kimi K3 ou Claude Fable 5.1 ?Trop tôt. Kimi K3 a des scores tiers vérifiés dont Frontend Code Arena. Claude Fable 5.1 n'est pas confirmé par Anthropic. Comparaison sérieuse après release avec fiche modèle.
-
Quel sera le prix de Grok 4.6 ?Inconnu. Grok 4.5 a démarré à 2 USD/M entrée et 6 USD/M sortie — référence, mais pas de tarifs 4.6 d'xAI.
-
Où utiliser Grok 4.6 ?D'après Grok 4.5, probablement Grok Build, API xAI et console xAI en premier, puis intégrations tierces comme Cursor — non confirmé pour 4.6.
Données au 2026-07-30. Sources : lancement Grok 4.5 xAI, post X Elon Musk 28 juillet 2026 (réponse à @rauchg), release Kimi K3 Moonshot, Emergent.sh / WinCentral / 36kr sur Claude Fable 5.1, The Verge / TechTimes sur Pacing the Frontier, Ars Technica / TechCrunch / The Guardian sur procès sécurité xAI.