Claude Opus 5 : moitié prix, quasi Fable 5 — Kimi K3 pris dans la tempête « je suis Claude »

Deux événements majeurs cette semaine convergent vers un même enjeu — le rapport qualité-prix et l'origine réelle des capacités des modèles : Anthropic déploie Claude Opus 5 comme modèle du quotidien ; Kimi K3 de Moonshot est accusé de distillation par la Maison Blanche, tandis qu'un chercheur indépendant montre qu'il se présente comme Claude.

En bref : le 24 juillet 2026, Anthropic a lancé Claude Opus 5 — tarifs identiques à Opus 4.8 ($5/$25 par million de tokens), pic CursorBench 3.2 à seulement 0,5 % de Fable 5 pour la moitié du coût. Parallèlement, Kimi K3 fait l'objet d'accusations de distillation ; Ryan Greenblatt documente que K3 divulgue claude-opus-4-5-20250929 et d'autres IDs internes. Cet article couvre benchmarks, matrice de choix, chronologie, preuves techniques, runbook en six étapes et FAQ.

00Claude Opus 5 : pas le flagship, mais peut-être le Claude le plus utile

Le 24 juillet 2026 (heure du Pacifique), Anthropic a officiellement lancé Claude Opus 5, immédiatement défini comme modèle par défaut de Claude Max — la version la plus puissante accessible aux utilisateurs Claude Pro. ID modèle : claude-opus-5 ; disponible via Claude API, AWS Bedrock, Google Vertex AI et Microsoft Foundry.

  • Tarifs stables : entrée $5/M, sortie $25/M — identiques à Opus 4.8. Mode Fast : ~2,5× la vitesse, 2× le prix.
  • Contexte : 1 million de tokens (unique palier), sortie max 128K. Thinking activé par défaut ; le paramètre Effort contrôle l'intensité du raisonnement.
  • Rétention des données : comme les Opus précédents — pas de rétention obligatoire de 30 jours. Fable 5 / Mythos 5 exigent une politique de rétention.
BenchmarkOpus 5Lecture
Frontier-Bench v0.1Dépasse tous les modèlesPlus du double d'Opus 4.8, coût par tâche inférieur
CursorBench 3.2 (max effort)0,5 % sous le pic Fable 5Coût deux fois inférieur à Fable 5
ARC-AGI 3 le modèle suivantSaut en résolution de problèmes inédits
OSWorld 2.0Meilleur à tout budgetDépasse Fable 5 pour ~⅓ du coût
Zapier AutomationBench100 % de réussitePremier modèle à valider un workflow complet de bout en bout

Retours clients Box : workflows d'analyse de données +11 %, due diligence +17 %, précision globale +8 %. Sciences du vivant : inférence de structure moléculaire +10,2 points vs Opus 4.8 ; prédiction fonctionnelle de variants protéiques +7,7 points.

Positionnement sécurité : Opus 5 est le modèle le plus aligné d'Anthropic (comportement de tromperie minimal), mais n'a volontairement pas repoussé la frontière cybersécurité/biosécurité — réservée à Mythos 5. Le classificateur cybersécurité est ~85 % moins restrictif que Fable 5 ; vulnérabilités source oui, exploits binaires non.

01Claude Opus 5 ou Fable 5 : matrice de décision

Si Fable 5 convainquait par la qualité mais pas par le prix, Opus 5 propose « perte marginale, coût divisé par deux ». Matrice pour trancher rapidement :

DimensionClaude Opus 5Claude Fable 5
Entrée (/M tokens)$5~$10
Sortie (/M tokens)$25~$50
Pic CursorBench 3.20,5 % sous Fable 5Maximum
Défaut Claude MaxOui (depuis 2026-07-24)Non
Rétention des donnéesPas de rétention imposéeRétention 30 jours requise
Risque dual-useVolontairement limitéPlus élevé (Mythos 5 au-delà)

L'équipe Cursor : « Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. » Zapier note qu'Opus 5 domine AutomationBench sans consommer plus de tokens. Pour le routage multi-modèles, voir notre guide OpenRouter.

02La tempête de distillation autour de Kimi K3

Là où Opus 5 suit un lancement classique, Kimi K3 bascule dans l'arène politique. Moonshot a publié le 16 juillet 2026 Kimi K3 : 2,8 billions de paramètres, MoE 896 experts avec 16 actifs (~50 milliards actifs), contexte 1 M tokens, vision native. GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Poids complets promis pour le 27 juillet — non vérifiables de l'extérieur au moment de la controverse.

DateÉvénement
2026-02Anthropic accuse Moonshot/DeepSeek/MiniMax de « distillation industrielle » — 3,4 M+ interactions API anormales
2026-07-01Claude Fable 5 disponible publiquement
2026-07-16Lancement API/produit Kimi K3
2026-07-22/23Michael Kratsios (OSTP) : « distillation industrielle à grande échelle » + allégations GB300
2026-07-23TechCrunch : experts contestent la thèse de distillation
2026-07-24Ryan Greenblatt publie les statistiques « K3 se dit Claude »
2026-07-27 (prévu)Open weights Kimi K3

Kratsios : « Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable. » Le secrétaire au Trésor Scott Bessent évoque des « filigranes » de grands modèles américains dans des LLM chinois — sans précision technique.

  • Contre-argument temporel : Fable 5 public depuis le 1er juillet seulement — deux semaines avant K3. Braden Hancock (Snorkel AI) : « You can't distill that much data, train a model, and release it in two weeks. »
  • Rendements décroissants : Nathan Lambert (Allen AI) : à mesure que les modèles chinois approchent la frontière, la distillation simple rapporte moins que l'entraînement par renforcement.
  • Double standard sectoriel : Elon Musk a admis en audience que xAI avait distillé OpenAI pour Grok — la frontière entre « benchmarking » et « vol dissimulé » reste floue.

03La preuve la plus solide : K3 affirme être Claude

Ryan Greenblatt, scientifique en chef chez Redwood Research, a publié autour du 24 juillet une analyse statistique (GitHub : rgreenblatt/which_claude_is_k3) sur l'auto-identification des modèles à la question « Qui es-tu ? » :

  • Kimi K3 se déclare Claude avec une fréquence anormale et cite des IDs de déploiement internes : claude-opus-4-5-20250929, claude-sonnet-4-5-20250929.
  • Les vrais Claude ne le font pas : Sonnet 4.5 dit « Je suis Claude Sonnet 4.5 » ; Opus 4.5 omet souvent le numéro de version.
  • Progression générationnelle : K2 pointe vers Claude Sonnet 4 (mi-2025), K3 vers Opus 4.5 (fin 2025) — pas vers Fable/Mythos.

Greenblatt : lorsqu'un élève cite les métadonnées de déploiement du professeur plus précisément que le professeur lui-même, l'imitation de style ne suffit pas — on pense plutôt à des données Claude annotées avec métadonnées API. Cela fait écho à notre analyse des empreintes Claude Code.

Nuance importante : Greenblatt insiste — ces résultats ne prouvent pas directement une distillation. Confusion d'identité, contamination de données ou prompts synthétiques restent possibles. Combinés aux accusations d'Anthropic en février, c'est néanmoins le socle technique le plus solide à ce jour.

PainCoûts cachés et risques de conformité pour les développeurs

  • Facture API vs facture compute : Opus 5 divise les coûts tokens — mais des agents sur VPS partagé ou Mac de bureau perdent l'avantage via jitter de file d'attente et sessions longues interrompues.
  • Conformité : Fable 5 / Mythos 5 imposent 30 jours de rétention — barrière dure en finance et santé. Les accusations contre K3 ajoutent une incertitude export et réglementaire.
  • Fenêtre de vérification open source : avant le 27 juillet, architecture et scores K3 reposent sur les déclarations du fabricant — asymétrie d'information en production.
  • Complexité du routage : fallback multi-modèles (Opus 5 + K3 + local) exige CI stable et hôtes agents dédiés, pas seulement une nouvelle clé API.

04Runbook en six étapes : intégration production après les mises à jour

  1. 01
    Auditer les appels Claude : vérifier si les requêtes ciblent encore Opus 4.8 ou Fable 5. Utilisateurs Claude Max : confirmer le basculement vers Opus 5 par défaut.
  2. 02
    Smoke tests CursorBench / benchmarks internes : comparer Opus 5 et Fable 5 sur votre codebase réelle — taux de réussite et consommation de tokens en high/max effort.
  3. 03
    Évaluer les clauses de rétention : workloads sensibles → Opus 5 (pas de rétention imposée). Pic Fable 5 uniquement après évaluation séparée de la politique 30 jours.
  4. 04
    Reporter K3 en production : après open weights (27 juillet), reproduire indépendamment GPQA-Diamond / SWE Marathon et lancer des sondes d'identité type Greenblatt.
  5. 05
    Configurer le routage multi-modèles : via OpenRouter ou LiteLLM — Opus 5 en primary, fallback open source ; journaliser ID modèle et coût par appel.
  6. 06
    Déployer un hôte agent stable : sessions longues exigent compute dédié et SSH fiable. Consulter les tarifs : nœuds Mac dédiés NUKCLOUD comme plan CI et build agent, plutôt qu'un pool partagé à latence de queue.

05Le rapport qualité-prix comme champ de bataille principal

Opus 5 répond à la demande de « flagship à moitié prix » ; Kimi K3 attaque avec open source, tarifs bas et moins de refus. La controverse de distillation est la confrontation publique sur une question simple : votre modèle bon marché vient-il de l'optimisation interne ou de l'emprunt dissimulé ?

Pour les développeurs : scénario d'abord, idéologie ensuite. Conformité, rétention, chaîne d'approvisionnement → Opus 5 offre un rapport qualité-prix exceptionnel. Coût extrême et contrôle open source → évaluer K3 après vérification indépendante des poids le 27 juillet. Sur Reddit r/LocalLLaMA : enthousiasme pour l'écart open/closed réduit à des « jours » ; scepticisme sur l'inférence locale de 2,8T ; pragmatiques voient le vrai atout de K3 en prix bas + peu de censure, pas en « battre Fable 5 ».

Les équipes qui pilotent des agents longue durée sur de grandes codebases avec Opus 5 ou K3 ont besoin d'un plan dev et CI stable et auditable. Pools à la minute, Mac de bureau ou VPS sursouscrits génèrent jitter réseau, contention CPU et coupures de session — et absorbent les économies de tokens. Pour un hôte agent production, les nœuds Mac bare-metal multirégionaux NUKCLOUD offrent compute Apple Silicon dédié et limites de locataire claires. Spécifications sur la page tarifs, essai via commander.

06Synthèse et FAQ

Claude Opus 5 est-il moins cher que Fable 5 ?
Opus 5 : $5/M entrée, $25/M sortie — environ la moitié de Fable 5 ($10/$50). CursorBench 3.2 max effort : écart inférieur à 1 %.
Opus 5 est-il le modèle par défaut de Claude Max ?
Oui, depuis le 24 juillet 2026. Opus 5 est le défaut Claude Max et la version la plus puissante pour Claude Pro.
Kimi K3 a-t-il vraiment distillé Claude ?
Non prouvé et disputé. Pas de preuves publiques de la Maison Blanche ; experts contestent une distillation complète en deux semaines. Les statistiques Greenblatt sont la meilleure preuve indirecte.
Quand télécharger les poids complets de Kimi K3 ?
Officiellement le 27 juillet 2026. À la date de publication, vérification externe complète impossible.
Pourquoi Kimi K3 se présente-t-il comme Claude ?
Greenblatt montre que K3 cite claude-opus-4-5-20250929 et d'autres IDs internes — plus précisément que les vrais Claude. Probable contamination par des logs API Claude annotés.
Sur quelle infrastructure faire tourner la CI agent ?
Agents longue durée : SSH stable, IO disque prévisible, pas de voisinage CPU. Nœuds Mac dédiés NUKCLOUD conviennent comme hôte agent et plan CI.

Données au 2026-07-25. Sources : communiqué Anthropic, blog technique Moonshot/Kimi, TechCrunch, GitHub Ryan Greenblatt, CNBC, The Verge.