OpenRouter Juli 2026: Chinesische Modelle bei 46 % — wer gewinnt den AI-Traffic-Krieg wirklich?

Echte OpenRouter-Aufrufe bis 25. Juli: Xiaomi Mimo V2.5 mit 1,4T Tokens/Tag an der Spitze, chinesische Anbieter zusammen 46 % — doch Volumenführer ist nicht Qualitätsführer: Claude behält die Preissetzung bei schweren Aufgaben.

Wer im Juli 2026 noch mit dem Marktbild von vor drei Monaten plant, unterschätzt die Geschwindigkeit des Wandels. OpenRouter misst keine Marketing-Benchmarks, sondern bezahlten Entwickler-Traffic. Dieser Artikel deckt alle Kernpunkte ab: (1) Top-12-Modelle und Anbieteranteile mit China bei 46 %; (2) die Hantel-Struktur Volumen vs Qualität; (3) die App-Schicht mit Hermes Agent, Kilo Code und dem versteckten Roleplay-Markt; (4) fünf August-Trends; (5) Rollen-spezifische Empfehlungen und ein Sechs-Schritte-Runbook. Ergänzend lesen: OpenRouter-API-Leitfaden, Juni-Ranking, CLI-Tool-Rankings.

00Juli-Ranking: Xiaomi auf Platz 1, chinesische Modelle erstmals bei 46 %

Stand 25. Juli 2026 führen die täglichen Token-Rankings auf OpenRouter: Xiaomi Mimo V2.5 (1,4T Tokens/Tag), DeepSeek V4 Flash (943,9B) und Tencent Hy3 (590B). Sieben der Top-12-Modelle stammen aus China; nur Nemotron 3 Ultra (NVIDIA), Claude und Gemini halten die US-Positionen.

RangModellAnbieterTages-Tokens30-Tage-Summe
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (kostenlos)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot AI157,6B1,6T (neu)
10Ling 3.0 FlashAnt InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Auf Anbieter-Ebene: chinesische Labore halten zusammen rund 46 % der Tokens — vor einem Jahr unter 2 %. Der US-Dreiklang (OpenAI, Anthropic, Google) fiel von ~70 % Mitte 2025 auf ~30 % im Juni 2026 und pendelt seitdem bei 30–36 %.

  • Datenpunkt 1: DeepSeek V4 Flash Input ~$0,05–0,14/M, GPT-5.5 ~$5/M — Faktor 35×.
  • Datenpunkt 2: DeepSeek bleibt stabilstes Einzelunternehmen (~16–18 %), doch der Monats-Champion wechselt: Feb MiniMax M2.5 → Apr MiMo-V2-Pro → Jul Mimo V2.5.
  • Datenpunkt 3: Claude Opus 4.8 lag am 24.7. noch Top-10 (1,44T Wochen-Tokens), am 25.7. verdrängt durch Ling 3.0 Flash — vor Veröffentlichung stets openrouter.ai/rankings prüfen.

FallstrickeDie Kehrseite: hohes Volumen bedeutet nicht hohe Qualität

OpenRouter sortiert nach Token-Verbrauch, nicht nach Fähigkeit. Ein günstiges, schnelles Modell hinter einer High-Traffic-App landet leicht vorn — auch wenn es bei schwerem Reasoning schwächelt. Genau hier liegt der Unterschied zu reinen Tabellen-Artikeln.

Nach Aufgabentyp zeigt die Ausgabenverteilung ein anderes Bild: Alltagsdialog 35,7 %, Agent-Workflows 30,4 %, Code 26,5 %, Datenverarbeitung 7,5 %. Bei Klassifikation und komplexem Reasoning dreht sich die Logik um: Claude Sonnet 4.6 und Claude Opus 4.7 teilen sich mit je 13,5 % den ersten Platz, GPT-5.5 folgt mit 11,6 % — die günstigen Open-Source-Leader sind hier kaum sichtbar.

Der Markt teilt sich natürlich: günstige chinesische Open-Source-Modelle fressen volumenstarke, fehlertolerante Last (Chat, Kreativtext, Roleplay, einfache Coding-Hilfe), während geschlossene Flaggschiffe die Preissetzung bei hochwertigen, fehlerintoleranten Aufgaben behalten. Claude Opus 5 (24. Juli) erreichte 43,3 % auf FrontierBench v0.1 und überholte GPT-5.6 Sol (37,5 %) bei $5/$25 per M.

01Anbieteranteile und Preispositionierung

AnbieterHerkunftToken-Anteil (ca.)
DeepSeekChina16–18 %
XiaomiChina8–18 % (Mimo V2.5, höchste Volatilität)
AnthropicUSA10–15 %
TencentChina8–13 %
GoogleUSA8–13 %
Z.aiChina4–7 %
OpenAIUSA6–8 %
NVIDIAUSA5 %
MiniMaxChina4–8 %
Moonshot AIChina3–4 %
ModellInput/MOutput/MKontextPositionierung
DeepSeek V4 Flash~$0,05–0,14~$0,24–0,281MPreis-Leistungs-König, Agentic Coding
Nemotron 3 Ultra$0,42 (auch gratis)$2,61US-Open-Source, NVIDIA-Stack
MiniMax M3$0,10$1,21LangMultimodal-Budget-Option
GLM 5.2$0,45$3,31Open-Source-„Opus-ähnliche“ Planung
Kimi K3~$3~$151MGrößte Open Weights (1,4TB)
Claude Opus 5$5 (Fast $10)$25 (Fast $50)1MClosed Frontier, stärkste Juli-Benchmarks

02App-Schicht: Coding-Agenten führen, Roleplay ist die unsichtbare Hälfte

Modell-Rankings zeigen, welches „Gehirn“ gewählt wird; die App-Rankings zeigen, wofür es eingesetzt wird:

RangAppTypAnteil (ca.)
1Hermes Agent (Nous Research)Persönlicher Agent / CLI~45 %
2Kilo CodeCoding-Agent~13 %
3OpenClawAllgemeiner Agent~9 %
4Claude Code (Anthropic)Coding-Agent~6 %
5DescriptContent-Produktion~4,5 %
6piAgent~3,3 %
7LemonadeBegleitung / Gaming~2,1 % (neu)
8ISEKAI ZERORoleplay~2,0 % (neu)
9Janitor AIRoleplay~1,8 % (neu)
10ClineCoding-Agent (IDE)~1,7 %
  • Cline → Roo Code → Kilo Code sind drei Generationen derselben Code-Linie; Kilo Code überholt heute Vorfahren deutlich.
  • Roleplay- und Begleitungs-Apps (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) machen einen erheblichen Teil des Open-Source-Traffics aus — laut OpenRouter × a16z State of AI über die Hälfte in kreativen Roleplay-Szenarien.
  • Wer nur Enterprise-Berichterstattung liest, übersieht diese Hälfte. Details: CLI-Tool-Analyse.

03August-Ausblick: Anteile, Sicherheit und Kimi-K3-Quantisierung

  1. 01
    Chinesische Open-Source-Modelle dürften 50 % überschreiten, solange US-Anbieter nicht massiv nachgeben. Kein Signal für aggressive OpenAI/Google-Preissenkungen.
  2. 02
    Der Monats-Champion wechselt weiter. Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax und Moonshot konkurrieren mit Preis und Release-Tempo — im August ist ein neuer Top-1-Kandidat wahrscheinlich.
  3. 03
    Anthropic könnte ein günstigeres Modell launchen (Haiku-Niveau), um Volumen zu gewinnen — Opus 5 ist bereits die vierte Flaggschiff-Welle in zwei Monaten.
  4. 04
    Kimi K3s 1,4TB-Gewichte bekommen in 2–4 Wochen Community-Quantisierungen (siehe Kimi-K3-Test) — dann wird das Modell für kleinere Teams praktikabel.
  5. 05
    Sicherheit und Compliance werden zur Auswahlvariable. Berichte über Sandbox-Escapes unveröffentlichter OpenAI-Modelle, ein US-Kongress-„AI-Kill-Switch“-Gesetz und ein voraussichtliches August-Framework für Frontier-Modell-Prüfungen erhöhen den Druck.
  6. 06
    Sicherheitsreputation der Anbieter gewinnt in Enterprise-Beschaffung — Vorteil für Anthropic, mehr Vorsicht bei autonomen Agenten mit weiten Berechtigungen.

04Praxisempfehlungen nach Rolle

Indie-Entwickler und kleine Teams: OpenRouter eignet sich hervorragend als Technologie-Sandbox — ein Key, hunderte Modelle. Für Produktion beachten: EU-Latenz zu OpenRouter oft 180–250 ms, keine EU-Rechnungsstellung. Coding: zuerst DeepSeek V4 Flash (V4-GA-Analyse) und GLM 5.2 testen; Claude Opus 5 / GPT-5.6 nur für blockierte Schritte — Hybrid-Routing senkt Kosten stark.

Enterprise-Architektinnen: Nicht allein nach Volumen-Rankings wählen. Eigene Evals (Akzeptanzrate, Fehlerquote, Latenz unter Last) sind Pflicht. Schichten: Chat/Kreativ/Roleplay über günstige Open-Source-Modelle; Klassifikation, komplexes Reasoning und riskante Agent-Entscheidungen über Closed Frontier — die Hantel-Struktur aus OpenRouter-Daten. Sicherheitsreputation in die Scorecard aufnehmen.

AI-Agent- und Coding-Tool-Produkte: Die Cline→Kilo-Code-Fork-Kette zeigt: im Open-Source-Ökosystem kann der Nachfolger den Pionier überholen. Roleplay-Szenarien tragen mehr Volumen als viele Enterprise-Reports vermuten lassen.

05Fazit: Capability und Popularity divergieren

Die Juli-Liste in einem Satz: Fähigkeit und Popularität gehen auseinander. Chinesische Open-Source-Modelle gewinnen den Traffic über den Preis; US-Closed-Frontier behält Preissetzung und Sicherheitsnarrativ bei schweren Aufgaben. Im August wird die Spannung Preis vs Premium nur zunehmen — wertvoller als „Wer ist Nummer eins?“ ist eine eigene Eval-Pipeline und Schicht-Routing.

06Sechs-Schritte-Runbook: Schicht-Routing auf Cloud-Mac

  1. 01
    Tages-Ranking statt nur Monats-Ranking: Wöchentlich OpenRouter Rankings prüfen; Kimi K3 und Ling 3.0 Flash auf die Beobachtungsliste setzen.
  2. 02
    Routing 95 % Volumen + 5 % Frontier: Alltag über DeepSeek V4 Flash / Mimo V2.5 / GLM 5.2; schweres Reasoning über Claude Opus 5 / GPT-5.6. Fallback-Kette laut API-Leitfaden.
  3. 03
    Cloud-Mac bereitstellen: In der NUKCLOUD-Konsole 32 GB+ Unified Memory für lange Agent-Sessions wählen; stundenweise Kimi K3 / GLM 5.2 auf der Preisseite testen.
  4. 04
    TCO modellieren: „Voller Claude-Stack“ vs „Claude Frontier + chinesische Alltagsmodelle“ vs dedizierter Mac 7×24; August-Tier-Anpassungen und Compliance-Audit einplanen.
  5. 05
    Compliance und Sicherheit: Anbieter-Sicherheitsbilanz in die Scorecard; autonome Agenten mit Minimalrechten und Sandbox-Isolation betreiben.
  6. 06
    launchd 7×24 Agent: Nach Pilot Spec über Bestellseite fixieren; Details im Produktions-Runbook und Hilfezentrum.

Multi-Modell-Agenten auf lokalem MacBook oder überbuchtem VPS scheitern an Deckel-Sleep, SSE-Abbrüchen und explodierenden API-Rechnungen. Wer 7×24 stabil online bleiben und Routen flexibel wechseln will, profitiert von NUKCLOUD Multi-Region Bare-Metal Mac / Cloud-Mac-Knoten mit dedizierter Tenant-Grenze — abgestimmt auf das August-Modell-Tempo.

07FAQ: OpenRouter Juli-Ranking

Welches Modell war im Juli 2026 auf OpenRouter am beliebtesten?
Stand 25. Juli: Xiaomi Mimo V2.5 mit ~1,4T Tokens/Tag, gefolgt von DeepSeek V4 Flash (943,9B) und Tencent Hy3 (590B).
Welchen Anteil haben chinesische Modelle?
Nach 7-Tage-Daten ~46 % (vor einem Jahr unter 2 %). US-Dreiklang zusammen ~30–36 %.
Spiegelt das Ranking die Qualität wider?
Nein. Bei komplexem Reasoning teilen sich Claude Sonnet 4.6 und Opus 4.7 mit je 13,5 % den ersten Platz; GPT-5.5 hat 11,6 %.
Warum steigt Kimi K3 so schnell?
Neu in den Top 12 mit 157,6B Tokens/Tag, 1,6T in 30 Tagen. 1,4TB Open Weights — größtes bisher veröffentlichtes Gewichtspaket. Siehe Kimi-K3-Test.
Welches Modell für Coding?
Alltag: DeepSeek V4 Flash und GLM 5.2. Komplexe Agent-Planung: Claude Opus 5. App-Schicht: Kilo Code (~13 %) und Hermes Agent (~45 %).
Was ist im August am wichtigsten?
China-Anteil evtl. 50 %+; Monats-Champion wechselt; Anthropic günstigeres Modell; Kimi-K3-Quantisierungen; Sicherheit und Compliance als Auswahlfaktor.
Warum nicht auf ein Modell setzen?
Top-10 ändert sich täglich (24.7. vs 25.7.). Wertvoll ist modellagnostisches Schicht-Routing, nicht Vendor-Lock-in. Vergleich: Juni-Ranking.

Stand 27. Juli 2026, Daten bis 25. Juli 2026. Keine Anlageberatung. Quellen: OpenRouter Rankings, OpenRouter Apps, State of AI.