En bref : le 24 juillet 2026, Anthropic a lancé Claude Opus 5 — tarifs identiques à Opus 4.8 ($5/$25 par million de tokens), pic CursorBench 3.2 à seulement 0,5 % de Fable 5 pour la moitié du coût. Parallèlement, Kimi K3 fait l'objet d'accusations de distillation ; Ryan Greenblatt documente que K3 divulgue claude-opus-4-5-20250929 et d'autres IDs internes. Cet article couvre benchmarks, matrice de choix, chronologie, preuves techniques, runbook en six étapes et FAQ.
00Claude Opus 5 : pas le flagship, mais peut-être le Claude le plus utile
Le 24 juillet 2026 (heure du Pacifique), Anthropic a officiellement lancé Claude Opus 5, immédiatement défini comme modèle par défaut de Claude Max — la version la plus puissante accessible aux utilisateurs Claude Pro. ID modèle : claude-opus-5 ; disponible via Claude API, AWS Bedrock, Google Vertex AI et Microsoft Foundry.
- Tarifs stables : entrée $5/M, sortie $25/M — identiques à Opus 4.8. Mode Fast : ~2,5× la vitesse, 2× le prix.
- Contexte : 1 million de tokens (unique palier), sortie max 128K. Thinking activé par défaut ; le paramètre Effort contrôle l'intensité du raisonnement.
- Rétention des données : comme les Opus précédents — pas de rétention obligatoire de 30 jours. Fable 5 / Mythos 5 exigent une politique de rétention.
| Benchmark | Opus 5 | Lecture |
|---|---|---|
| Frontier-Bench v0.1 | Dépasse tous les modèles | Plus du double d'Opus 4.8, coût par tâche inférieur |
| CursorBench 3.2 (max effort) | 0,5 % sous le pic Fable 5 | Coût deux fois inférieur à Fable 5 |
| ARC-AGI 3 | 3× le modèle suivant | Saut en résolution de problèmes inédits |
| OSWorld 2.0 | Meilleur à tout budget | Dépasse Fable 5 pour ~⅓ du coût |
| Zapier AutomationBench | 100 % de réussite | Premier modèle à valider un workflow complet de bout en bout |
Retours clients Box : workflows d'analyse de données +11 %, due diligence +17 %, précision globale +8 %. Sciences du vivant : inférence de structure moléculaire +10,2 points vs Opus 4.8 ; prédiction fonctionnelle de variants protéiques +7,7 points.
01Claude Opus 5 ou Fable 5 : matrice de décision
Si Fable 5 convainquait par la qualité mais pas par le prix, Opus 5 propose « perte marginale, coût divisé par deux ». Matrice pour trancher rapidement :
| Dimension | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Entrée (/M tokens) | $5 | ~$10 |
| Sortie (/M tokens) | $25 | ~$50 |
| Pic CursorBench 3.2 | 0,5 % sous Fable 5 | Maximum |
| Défaut Claude Max | Oui (depuis 2026-07-24) | Non |
| Rétention des données | Pas de rétention imposée | Rétention 30 jours requise |
| Risque dual-use | Volontairement limité | Plus élevé (Mythos 5 au-delà) |
L'équipe Cursor : « Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. » Zapier note qu'Opus 5 domine AutomationBench sans consommer plus de tokens. Pour le routage multi-modèles, voir notre guide OpenRouter.
02La tempête de distillation autour de Kimi K3
Là où Opus 5 suit un lancement classique, Kimi K3 bascule dans l'arène politique. Moonshot a publié le 16 juillet 2026 Kimi K3 : 2,8 billions de paramètres, MoE 896 experts avec 16 actifs (~50 milliards actifs), contexte 1 M tokens, vision native. GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Poids complets promis pour le 27 juillet — non vérifiables de l'extérieur au moment de la controverse.
| Date | Événement |
|---|---|
| 2026-02 | Anthropic accuse Moonshot/DeepSeek/MiniMax de « distillation industrielle » — 3,4 M+ interactions API anormales |
| 2026-07-01 | Claude Fable 5 disponible publiquement |
| 2026-07-16 | Lancement API/produit Kimi K3 |
| 2026-07-22/23 | Michael Kratsios (OSTP) : « distillation industrielle à grande échelle » + allégations GB300 |
| 2026-07-23 | TechCrunch : experts contestent la thèse de distillation |
| 2026-07-24 | Ryan Greenblatt publie les statistiques « K3 se dit Claude » |
| 2026-07-27 (prévu) | Open weights Kimi K3 |
Kratsios : « Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable. » Le secrétaire au Trésor Scott Bessent évoque des « filigranes » de grands modèles américains dans des LLM chinois — sans précision technique.
- Contre-argument temporel : Fable 5 public depuis le 1er juillet seulement — deux semaines avant K3. Braden Hancock (Snorkel AI) : « You can't distill that much data, train a model, and release it in two weeks. »
- Rendements décroissants : Nathan Lambert (Allen AI) : à mesure que les modèles chinois approchent la frontière, la distillation simple rapporte moins que l'entraînement par renforcement.
- Double standard sectoriel : Elon Musk a admis en audience que xAI avait distillé OpenAI pour Grok — la frontière entre « benchmarking » et « vol dissimulé » reste floue.
03La preuve la plus solide : K3 affirme être Claude
Ryan Greenblatt, scientifique en chef chez Redwood Research, a publié autour du 24 juillet une analyse statistique (GitHub : rgreenblatt/which_claude_is_k3) sur l'auto-identification des modèles à la question « Qui es-tu ? » :
- Kimi K3 se déclare Claude avec une fréquence anormale et cite des IDs de déploiement internes :
claude-opus-4-5-20250929,claude-sonnet-4-5-20250929. - Les vrais Claude ne le font pas : Sonnet 4.5 dit « Je suis Claude Sonnet 4.5 » ; Opus 4.5 omet souvent le numéro de version.
- Progression générationnelle : K2 pointe vers Claude Sonnet 4 (mi-2025), K3 vers Opus 4.5 (fin 2025) — pas vers Fable/Mythos.
Greenblatt : lorsqu'un élève cite les métadonnées de déploiement du professeur plus précisément que le professeur lui-même, l'imitation de style ne suffit pas — on pense plutôt à des données Claude annotées avec métadonnées API. Cela fait écho à notre analyse des empreintes Claude Code.
PainCoûts cachés et risques de conformité pour les développeurs
- Facture API vs facture compute : Opus 5 divise les coûts tokens — mais des agents sur VPS partagé ou Mac de bureau perdent l'avantage via jitter de file d'attente et sessions longues interrompues.
- Conformité : Fable 5 / Mythos 5 imposent 30 jours de rétention — barrière dure en finance et santé. Les accusations contre K3 ajoutent une incertitude export et réglementaire.
- Fenêtre de vérification open source : avant le 27 juillet, architecture et scores K3 reposent sur les déclarations du fabricant — asymétrie d'information en production.
- Complexité du routage : fallback multi-modèles (Opus 5 + K3 + local) exige CI stable et hôtes agents dédiés, pas seulement une nouvelle clé API.
04Runbook en six étapes : intégration production après les mises à jour
-
01
Auditer les appels Claude : vérifier si les requêtes ciblent encore Opus 4.8 ou Fable 5. Utilisateurs Claude Max : confirmer le basculement vers Opus 5 par défaut.
-
02
Smoke tests CursorBench / benchmarks internes : comparer Opus 5 et Fable 5 sur votre codebase réelle — taux de réussite et consommation de tokens en high/max effort.
-
03
Évaluer les clauses de rétention : workloads sensibles → Opus 5 (pas de rétention imposée). Pic Fable 5 uniquement après évaluation séparée de la politique 30 jours.
-
04
Reporter K3 en production : après open weights (27 juillet), reproduire indépendamment GPQA-Diamond / SWE Marathon et lancer des sondes d'identité type Greenblatt.
-
05
Configurer le routage multi-modèles : via OpenRouter ou LiteLLM — Opus 5 en primary, fallback open source ; journaliser ID modèle et coût par appel.
-
06
Déployer un hôte agent stable : sessions longues exigent compute dédié et SSH fiable. Consulter les tarifs : nœuds Mac dédiés NUKCLOUD comme plan CI et build agent, plutôt qu'un pool partagé à latence de queue.
05Le rapport qualité-prix comme champ de bataille principal
Opus 5 répond à la demande de « flagship à moitié prix » ; Kimi K3 attaque avec open source, tarifs bas et moins de refus. La controverse de distillation est la confrontation publique sur une question simple : votre modèle bon marché vient-il de l'optimisation interne ou de l'emprunt dissimulé ?
Pour les développeurs : scénario d'abord, idéologie ensuite. Conformité, rétention, chaîne d'approvisionnement → Opus 5 offre un rapport qualité-prix exceptionnel. Coût extrême et contrôle open source → évaluer K3 après vérification indépendante des poids le 27 juillet. Sur Reddit r/LocalLLaMA : enthousiasme pour l'écart open/closed réduit à des « jours » ; scepticisme sur l'inférence locale de 2,8T ; pragmatiques voient le vrai atout de K3 en prix bas + peu de censure, pas en « battre Fable 5 ».
Les équipes qui pilotent des agents longue durée sur de grandes codebases avec Opus 5 ou K3 ont besoin d'un plan dev et CI stable et auditable. Pools à la minute, Mac de bureau ou VPS sursouscrits génèrent jitter réseau, contention CPU et coupures de session — et absorbent les économies de tokens. Pour un hôte agent production, les nœuds Mac bare-metal multirégionaux NUKCLOUD offrent compute Apple Silicon dédié et limites de locataire claires. Spécifications sur la page tarifs, essai via commander.
06Synthèse et FAQ
claude-opus-4-5-20250929 et d'autres IDs internes — plus précisément que les vrais Claude. Probable contamination par des logs API Claude annotés.Données au 2026-07-25. Sources : communiqué Anthropic, blog technique Moonshot/Kimi, TechCrunch, GitHub Ryan Greenblatt, CNBC, The Verge.