Classement OpenRouter juillet 2026 : 46 % pour les modèles chinois — qui gagne vraiment la guerre du trafic IA ?

Trafic payant réel sur OpenRouter au 25 juillet : Xiaomi Mimo V2.5 à 1,4 T tokens/jour, éditeurs chinois ~46 % — mais le leader en volume n'est pas le leader en qualité : Claude garde le pouvoir de prix sur les tâches difficiles.

En fin juillet 2026, raisonner encore avec l'image du marché d'il y a trois mois conduit à de mauvaises décisions. OpenRouter ne mesure pas les benchmarks marketing : il agrège le trafic payant des développeurs. Cet article couvre : (1) le Top 12 modèles et les parts fabricants, Chine ~46 % ; (2) la structure en haltère volume vs qualité ; (3) la couche applications Hermes Agent, Kilo Code et le marché roleplay invisible ; (4) cinq tendances pour août ; (5) conseils par profil et runbook en six étapes. À lire avec : guide API OpenRouter, classement de juin, outils CLI.

00Juillet : Xiaomi numéro un, les modèles chinois franchissent 46 %

Au 25 juillet 2026, le podium quotidien OpenRouter : Xiaomi Mimo V2.5 (1,4 T tokens/jour), DeepSeek V4 Flash (943,9 B) et Tencent Hy3 (590 B). Sept modèles sur douze sont chinois ; seuls Nemotron 3 Ultra (NVIDIA), Claude et Gemini maintiennent le camp américain.

RangModèleÉditeurTokens / jourCumul 30 j
1Mimo V2.5Xiaomi1,4 T31,2 T
2DeepSeek V4 FlashDeepSeek943,9 B23,6 T
3Hy3Tencent590 B23,4 T
4Nemotron 3 Ultra 550B (gratuit)NVIDIA428,6 B9 T
5DeepSeek V4 ProDeepSeek413,7 B11,6 T
6GLM 5.2Z.ai316,7 B13,3 T
7MiniMax M3MiniMax262,5 B15,1 T
8Step 3.7 FlashStepFun204,8 B5,9 T
9Kimi K3Moonshot AI157,6 B1,6 T (nouveau)
10Ling 3.0 FlashAnt InclusionAI128,3 B417,3 B
11Gemini 3 Flash PreviewGoogle106,3 B4 T
12Claude Sonnet 5Anthropic99,5 B3,6 T

À l'échelle fabricant : les éditeurs chinois totalisent ~46 % des tokens — contre moins de 2 % il y a un an. Le trio US (OpenAI, Anthropic, Google) est passé de ~70 % mi-2025 à ~30 % en juin 2026, puis oscille entre 30 % et 36 %.

  • Chiffre 1 : DeepSeek V4 Flash en entrée ~0,05–0,14 $/M, GPT-5.5 ~5 $/M — écart ×35.
  • Chiffre 2 : DeepSeek reste le fabricant le plus stable (~16–18 %), mais le champion mensuel change : fév. MiniMax M2.5 → avr. MiMo-V2-Pro → juil. Mimo V2.5.
  • Chiffre 3 : Claude Opus 4.8 était Top 10 le 24/7 (1,44 T hebdo), évincé le 25/7 par Ling 3.0 Flash — vérifier openrouter.ai/rankings avant publication.

PiègesL'envers du classement : volume élevé ≠ qualité élevée

OpenRouter classe par consommation de tokens, pas par capacité. Un modèle bon marché derrière une app à fort trafic monte facilement — même s'il faiblit sur le raisonnement difficile. C'est l'angle que la plupart des articles de comparaison ignorent.

Par type de tâche, la répartition des dépenses raconte une autre histoire : dialogue général 35,7 %, workflows Agent 30,4 %, code 26,5 %, traitement de données 7,5 %. Sur classification et raisonnement complexe : Claude Sonnet 4.6 et Claude Opus 4.7 à 13,5 % chacun, GPT-5.5 à 11,6 % — les modèles open source bon marché du Top volume sont quasi absents.

Le marché se stratifie : les modèles chinois open source absorbent le volume tolérant aux erreurs (chat, créatif, roleplay, aide code simple), tandis que les modèles fermés gardent le pricing des tâches critiques. Claude Opus 5 (24 juillet) atteint 43,3 % sur FrontierBench v0.1, devant GPT-5.6 Sol (37,5 %) à 5 $/25 $ par M.

01Parts fabricants et matrice tarifaire

ÉditeurOriginePart tokens (env.)
DeepSeekChine16–18 %
XiaomiChine8–18 % (Mimo V2.5, forte volatilité)
AnthropicÉtats-Unis10–15 %
TencentChine8–13 %
GoogleÉtats-Unis8–13 %
Z.aiChine4–7 %
OpenAIÉtats-Unis6–8 %
NVIDIAÉtats-Unis5 %
MiniMaxChine4–8 %
Moonshot AIChine3–4 %
ModèleEntrée/MSortie/MContextePositionnement
DeepSeek V4 Flash~0,05–0,14 $~0,24–0,28 $1MRoi rapport qualité-prix, Agentic Coding
Nemotron 3 Ultra0,42 $ (gratuit dispo)2,61 $Open source US, écosystème NVIDIA
MiniMax M30,10 $1,21 $LongMultimodal budget
GLM 5.20,45 $3,31 $Planification « type Opus » en open source
Kimi K3~3 $~15 $1MPlus gros poids ouverts (1,4 To)
Claude Opus 55 $ (rapide 10 $)25 $ (rapide 50 $)1MFrontier fermé, meilleurs scores juillet

02Couche apps : les agents code dominent, le roleplay est la moitié cachée

Les classements modèles montrent quel « cerveau » est choisi ; les classements apps montrent l'usage réel :

RangAppTypePart (env.)
1Hermes Agent (Nous Research)Agent personnel / CLI~45 %
2Kilo CodeAgent code~13 %
3OpenClawAgent généraliste~9 %
4Claude Code (Anthropic)Agent code~6 %
5DescriptProduction de contenu~4,5 %
6piAgent~3,3 %
7LemonadeCompagnie / jeu~2,1 % (nouveau)
8ISEKAI ZERORoleplay~2,0 % (nouveau)
9Janitor AIRoleplay~1,8 % (nouveau)
10ClineAgent code (IDE)~1,7 %
  • Cline → Roo Code → Kilo Code : trois générations d'une même lignée ; Kilo Code dépasse aujourd'hui ses ancêtres.
  • Les apps roleplay et compagnie (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) représentent une part majeure du trafic open source — plus de la moitié en roleplay créatif selon OpenRouter × a16z State of AI.
  • La presse enterprise ne voit pas cette moitié du marché. Voir analyse des outils CLI.

03Prévisions août : parts, sécurité et fenêtre Kimi K3

  1. 01
    Les modèles chinois open source pourraient dépasser 50 % sans concession tarifaire majeure des US. Aucun signal de baisse agressive chez OpenAI ou Google.
  2. 02
    Le champion mensuel continuera de changer. Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax et Moonshot maintiennent guerre des prix et rythme de release — un nouveau Top 1 est probable en août.
  3. 03
    Anthropic pourrait lancer un modèle plus abordable (niveau Haiku) pour gagner du volume — Opus 5 est déjà le quatrième flagship en deux mois.
  4. 04
    Les poids 1,4 To de Kimi K3 auront des quantisations communautaires en 2–4 semaines (voir test Kimi K3) — moment où les petites équipes pourront l'exploiter.
  5. 05
    Sécurité et conformité deviennent des variables de choix. Fuites sur des évasions de sandbox, projet de loi « kill switch » au Congrès US et cadre de pré-publication des modèles frontier attendu avant août.
  6. 06
    La réputation sécurité des éditeurs pèse davantage en achat entreprise — avantage Anthropic, prudence accrue sur les agents autonomes à larges permissions.

04Conseils pratiques par profil

Développeurs indépendants et petites équipes : OpenRouter est une excellente sandbox — une clé, des centaines de modèles. En production : latence Europe vers OpenRouter souvent 180–250 ms, facturation locale limitée. Code : tester DeepSeek V4 Flash (analyse V4 GA) et GLM 5.2 ; réserver Claude Opus 5 / GPT-5.6 aux étapes bloquées — le routage hybride réduit fortement la facture.

Responsables techniques entreprise : ne pas choisir sur le seul classement volume. Évals internes obligatoires (taux d'acceptation, erreurs, latence sous charge). Stratifier : chat/créatif/roleplay sur modèles open source bon marché ; classification, raisonnement complexe et décisions Agent à risque sur frontier fermé — la structure en haltère des données OpenRouter. Intégrer la réputation sécurité dans la grille de notation.

Produits Agent et outils de code : la chaîne Cline→Kilo Code montre qu'un successeur open source peut dépasser le pionnier. Le roleplay porte plus de volume que la plupart des rapports enterprise ne le suggèrent.

05Conclusion : capability et popularité divergent

La leçon de juillet en une phrase : capacité et popularité prennent des chemins séparés. Les modèles chinois open source gagnent le trafic par le prix ; les frontier US fermés gardent le pricing et le récit sécurité sur les tâches difficiles. En août, la tension prix vs premium s'intensifiera — plus utile qu'un débat « qui est numéro un » : construire sa propre évaluation et son routage par couches.

06Runbook en six étapes : routage par couches sur Mac cloud

  1. 01
    Suivre le classement quotidien : chaque semaine consulter OpenRouter Rankings ; ajouter Kimi K3 et Ling 3.0 Flash à la liste de veille.
  2. 02
    Routage 95 % volume + 5 % frontier : quotidien via DeepSeek V4 Flash / Mimo V2.5 / GLM 5.2 ; raisonnement difficile via Claude Opus 5 / GPT-5.6. Chaîne de fallback selon le guide API.
  3. 03
    Provisionner un Mac cloud : dans la console NUKCLOUD, choisir 32 Go+ de mémoire unifiée pour les sessions Agent longues ; tester Kimi K3 / GLM 5.2 à l'heure sur la page tarifs.
  4. 04
    Modéliser le TCO : « stack Claude intégral » vs « frontier Claude + modèles chinois quotidiens » vs Mac dédié 7×24 ; intégrer ajustements de tiers août et audit conformité.
  5. 05
    Conformité et sécurité : réputation sécurité dans la grille ; agents autonomes avec permissions minimales et sandbox.
  6. 06
    Agent launchd 7×24 : après pilote, verrouiller la spec via commander ; détails dans le runbook production et le centre d'aide.

Les agents multi-modèles sur MacBook local ou VPS surchargé échouent sur sommeil au rabat, coupures SSE et factures API qui explosent. Pour rester 7×24 en ligne et changer de route librement, les nœuds Mac cloud NUKCLOUD multi-régions offrent une frontière locataire dédiée alignée sur le rythme des releases d'août.

07FAQ : classement OpenRouter juillet

Quel modèle était le plus populaire en juillet 2026 ?
Au 25 juillet : Xiaomi Mimo V2.5 avec ~1,4 T tokens/jour, suivi de DeepSeek V4 Flash (943,9 B) et Tencent Hy3 (590 B).
Quelle part pour les modèles chinois ?
Sur 7 jours ~46 % (il y a un an < 2 %). Trio US ~30–36 %.
Le classement reflète-t-il la qualité ?
Non. Sur raisonnement complexe, Claude Sonnet 4.6 et Opus 4.7 à 13,5 % chacun ; GPT-5.5 à 11,6 %.
Pourquoi Kimi K3 monte si vite ?
Nouveau Top 12 : 157,6 B/jour, 1,6 T sur 30 jours. 1,4 To de poids ouverts — le plus gros package publié. Voir test Kimi K3.
Quel modèle pour le code ?
Quotidien : DeepSeek V4 Flash et GLM 5.2. Agent complexe : Claude Opus 5. Apps : Kilo Code (~13 %) et Hermes Agent (~45 %).
Tendances clés en août ?
Part chinoise possible 50 %+ ; champion mensuel changeant ; modèle Anthropic abordable ; quantisations Kimi K3 ; sécurité et conformité.
Pourquoi ne pas miser sur un seul modèle ?
Le Top 10 change quotidiennement (24/7 vs 25/7). L'atout est un routage par couches agnostique, pas le lock-in. Comparer avec le classement de juin.

Rédigé le 27 juillet 2026, données au 25 juillet 2026. Pas de conseil en investissement. Sources : OpenRouter Rankings, OpenRouter Apps, State of AI.