Wer im Juli 2026 noch mit dem Marktbild von vor drei Monaten plant, unterschätzt die Geschwindigkeit des Wandels. OpenRouter misst keine Marketing-Benchmarks, sondern bezahlten Entwickler-Traffic. Dieser Artikel deckt alle Kernpunkte ab: (1) Top-12-Modelle und Anbieteranteile mit China bei 46 %; (2) die Hantel-Struktur Volumen vs Qualität; (3) die App-Schicht mit Hermes Agent, Kilo Code und dem versteckten Roleplay-Markt; (4) fünf August-Trends; (5) Rollen-spezifische Empfehlungen und ein Sechs-Schritte-Runbook. Ergänzend lesen: OpenRouter-API-Leitfaden, Juni-Ranking, CLI-Tool-Rankings.
00Juli-Ranking: Xiaomi auf Platz 1, chinesische Modelle erstmals bei 46 %
Stand 25. Juli 2026 führen die täglichen Token-Rankings auf OpenRouter: Xiaomi Mimo V2.5 (1,4T Tokens/Tag), DeepSeek V4 Flash (943,9B) und Tencent Hy3 (590B). Sieben der Top-12-Modelle stammen aus China; nur Nemotron 3 Ultra (NVIDIA), Claude und Gemini halten die US-Positionen.
| Rang | Modell | Anbieter | Tages-Tokens | 30-Tage-Summe |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (kostenlos) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot AI | 157,6B | 1,6T (neu) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
Auf Anbieter-Ebene: chinesische Labore halten zusammen rund 46 % der Tokens — vor einem Jahr unter 2 %. Der US-Dreiklang (OpenAI, Anthropic, Google) fiel von ~70 % Mitte 2025 auf ~30 % im Juni 2026 und pendelt seitdem bei 30–36 %.
- Datenpunkt 1: DeepSeek V4 Flash Input ~$0,05–0,14/M, GPT-5.5 ~$5/M — Faktor 35×.
- Datenpunkt 2: DeepSeek bleibt stabilstes Einzelunternehmen (~16–18 %), doch der Monats-Champion wechselt: Feb MiniMax M2.5 → Apr MiMo-V2-Pro → Jul Mimo V2.5.
- Datenpunkt 3: Claude Opus 4.8 lag am 24.7. noch Top-10 (1,44T Wochen-Tokens), am 25.7. verdrängt durch Ling 3.0 Flash — vor Veröffentlichung stets openrouter.ai/rankings prüfen.
FallstrickeDie Kehrseite: hohes Volumen bedeutet nicht hohe Qualität
OpenRouter sortiert nach Token-Verbrauch, nicht nach Fähigkeit. Ein günstiges, schnelles Modell hinter einer High-Traffic-App landet leicht vorn — auch wenn es bei schwerem Reasoning schwächelt. Genau hier liegt der Unterschied zu reinen Tabellen-Artikeln.
Nach Aufgabentyp zeigt die Ausgabenverteilung ein anderes Bild: Alltagsdialog 35,7 %, Agent-Workflows 30,4 %, Code 26,5 %, Datenverarbeitung 7,5 %. Bei Klassifikation und komplexem Reasoning dreht sich die Logik um: Claude Sonnet 4.6 und Claude Opus 4.7 teilen sich mit je 13,5 % den ersten Platz, GPT-5.5 folgt mit 11,6 % — die günstigen Open-Source-Leader sind hier kaum sichtbar.
Der Markt teilt sich natürlich: günstige chinesische Open-Source-Modelle fressen volumenstarke, fehlertolerante Last (Chat, Kreativtext, Roleplay, einfache Coding-Hilfe), während geschlossene Flaggschiffe die Preissetzung bei hochwertigen, fehlerintoleranten Aufgaben behalten. Claude Opus 5 (24. Juli) erreichte 43,3 % auf FrontierBench v0.1 und überholte GPT-5.6 Sol (37,5 %) bei $5/$25 per M.
01Anbieteranteile und Preispositionierung
| Anbieter | Herkunft | Token-Anteil (ca.) |
|---|---|---|
| DeepSeek | China | 16–18 % |
| Xiaomi | China | 8–18 % (Mimo V2.5, höchste Volatilität) |
| Anthropic | USA | 10–15 % |
| Tencent | China | 8–13 % |
| USA | 8–13 % | |
| Z.ai | China | 4–7 % |
| OpenAI | USA | 6–8 % |
| NVIDIA | USA | 5 % |
| MiniMax | China | 4–8 % |
| Moonshot AI | China | 3–4 % |
| Modell | Input/M | Output/M | Kontext | Positionierung |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0,05–0,14 | ~$0,24–0,28 | 1M | Preis-Leistungs-König, Agentic Coding |
| Nemotron 3 Ultra | $0,42 (auch gratis) | $2,61 | — | US-Open-Source, NVIDIA-Stack |
| MiniMax M3 | $0,10 | $1,21 | Lang | Multimodal-Budget-Option |
| GLM 5.2 | $0,45 | $3,31 | — | Open-Source-„Opus-ähnliche“ Planung |
| Kimi K3 | ~$3 | ~$15 | 1M | Größte Open Weights (1,4TB) |
| Claude Opus 5 | $5 (Fast $10) | $25 (Fast $50) | 1M | Closed Frontier, stärkste Juli-Benchmarks |
02App-Schicht: Coding-Agenten führen, Roleplay ist die unsichtbare Hälfte
Modell-Rankings zeigen, welches „Gehirn“ gewählt wird; die App-Rankings zeigen, wofür es eingesetzt wird:
| Rang | App | Typ | Anteil (ca.) |
|---|---|---|---|
| 1 | Hermes Agent (Nous Research) | Persönlicher Agent / CLI | ~45 % |
| 2 | Kilo Code | Coding-Agent | ~13 % |
| 3 | OpenClaw | Allgemeiner Agent | ~9 % |
| 4 | Claude Code (Anthropic) | Coding-Agent | ~6 % |
| 5 | Descript | Content-Produktion | ~4,5 % |
| 6 | pi | Agent | ~3,3 % |
| 7 | Lemonade | Begleitung / Gaming | ~2,1 % (neu) |
| 8 | ISEKAI ZERO | Roleplay | ~2,0 % (neu) |
| 9 | Janitor AI | Roleplay | ~1,8 % (neu) |
| 10 | Cline | Coding-Agent (IDE) | ~1,7 % |
- Cline → Roo Code → Kilo Code sind drei Generationen derselben Code-Linie; Kilo Code überholt heute Vorfahren deutlich.
- Roleplay- und Begleitungs-Apps (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) machen einen erheblichen Teil des Open-Source-Traffics aus — laut OpenRouter × a16z State of AI über die Hälfte in kreativen Roleplay-Szenarien.
- Wer nur Enterprise-Berichterstattung liest, übersieht diese Hälfte. Details: CLI-Tool-Analyse.
03August-Ausblick: Anteile, Sicherheit und Kimi-K3-Quantisierung
-
01
Chinesische Open-Source-Modelle dürften 50 % überschreiten, solange US-Anbieter nicht massiv nachgeben. Kein Signal für aggressive OpenAI/Google-Preissenkungen.
-
02
Der Monats-Champion wechselt weiter. Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax und Moonshot konkurrieren mit Preis und Release-Tempo — im August ist ein neuer Top-1-Kandidat wahrscheinlich.
-
03
Anthropic könnte ein günstigeres Modell launchen (Haiku-Niveau), um Volumen zu gewinnen — Opus 5 ist bereits die vierte Flaggschiff-Welle in zwei Monaten.
-
04
Kimi K3s 1,4TB-Gewichte bekommen in 2–4 Wochen Community-Quantisierungen (siehe Kimi-K3-Test) — dann wird das Modell für kleinere Teams praktikabel.
-
05
Sicherheit und Compliance werden zur Auswahlvariable. Berichte über Sandbox-Escapes unveröffentlichter OpenAI-Modelle, ein US-Kongress-„AI-Kill-Switch“-Gesetz und ein voraussichtliches August-Framework für Frontier-Modell-Prüfungen erhöhen den Druck.
-
06
Sicherheitsreputation der Anbieter gewinnt in Enterprise-Beschaffung — Vorteil für Anthropic, mehr Vorsicht bei autonomen Agenten mit weiten Berechtigungen.
04Praxisempfehlungen nach Rolle
Indie-Entwickler und kleine Teams: OpenRouter eignet sich hervorragend als Technologie-Sandbox — ein Key, hunderte Modelle. Für Produktion beachten: EU-Latenz zu OpenRouter oft 180–250 ms, keine EU-Rechnungsstellung. Coding: zuerst DeepSeek V4 Flash (V4-GA-Analyse) und GLM 5.2 testen; Claude Opus 5 / GPT-5.6 nur für blockierte Schritte — Hybrid-Routing senkt Kosten stark.
Enterprise-Architektinnen: Nicht allein nach Volumen-Rankings wählen. Eigene Evals (Akzeptanzrate, Fehlerquote, Latenz unter Last) sind Pflicht. Schichten: Chat/Kreativ/Roleplay über günstige Open-Source-Modelle; Klassifikation, komplexes Reasoning und riskante Agent-Entscheidungen über Closed Frontier — die Hantel-Struktur aus OpenRouter-Daten. Sicherheitsreputation in die Scorecard aufnehmen.
AI-Agent- und Coding-Tool-Produkte: Die Cline→Kilo-Code-Fork-Kette zeigt: im Open-Source-Ökosystem kann der Nachfolger den Pionier überholen. Roleplay-Szenarien tragen mehr Volumen als viele Enterprise-Reports vermuten lassen.
05Fazit: Capability und Popularity divergieren
Die Juli-Liste in einem Satz: Fähigkeit und Popularität gehen auseinander. Chinesische Open-Source-Modelle gewinnen den Traffic über den Preis; US-Closed-Frontier behält Preissetzung und Sicherheitsnarrativ bei schweren Aufgaben. Im August wird die Spannung Preis vs Premium nur zunehmen — wertvoller als „Wer ist Nummer eins?“ ist eine eigene Eval-Pipeline und Schicht-Routing.
06Sechs-Schritte-Runbook: Schicht-Routing auf Cloud-Mac
-
01
Tages-Ranking statt nur Monats-Ranking: Wöchentlich OpenRouter Rankings prüfen; Kimi K3 und Ling 3.0 Flash auf die Beobachtungsliste setzen.
-
02
Routing 95 % Volumen + 5 % Frontier: Alltag über DeepSeek V4 Flash / Mimo V2.5 / GLM 5.2; schweres Reasoning über Claude Opus 5 / GPT-5.6. Fallback-Kette laut API-Leitfaden.
-
03
Cloud-Mac bereitstellen: In der NUKCLOUD-Konsole 32 GB+ Unified Memory für lange Agent-Sessions wählen; stundenweise Kimi K3 / GLM 5.2 auf der Preisseite testen.
-
04
TCO modellieren: „Voller Claude-Stack“ vs „Claude Frontier + chinesische Alltagsmodelle“ vs dedizierter Mac 7×24; August-Tier-Anpassungen und Compliance-Audit einplanen.
-
05
Compliance und Sicherheit: Anbieter-Sicherheitsbilanz in die Scorecard; autonome Agenten mit Minimalrechten und Sandbox-Isolation betreiben.
-
06
launchd 7×24 Agent: Nach Pilot Spec über Bestellseite fixieren; Details im Produktions-Runbook und Hilfezentrum.
Multi-Modell-Agenten auf lokalem MacBook oder überbuchtem VPS scheitern an Deckel-Sleep, SSE-Abbrüchen und explodierenden API-Rechnungen. Wer 7×24 stabil online bleiben und Routen flexibel wechseln will, profitiert von NUKCLOUD Multi-Region Bare-Metal Mac / Cloud-Mac-Knoten mit dedizierter Tenant-Grenze — abgestimmt auf das August-Modell-Tempo.
07FAQ: OpenRouter Juli-Ranking
Stand 27. Juli 2026, Daten bis 25. Juli 2026. Keine Anlageberatung. Quellen: OpenRouter Rankings, OpenRouter Apps, State of AI.