Kernaussage: Am 24. Juli 2026 veröffentlichte Anthropic Claude Opus 5 — gleiche Preise wie Opus 4.8 ($5/$25 pro Million Tokens), CursorBench-3.2-Peak nur 0,5 % unter Fable 5, Kosten halbiert. Parallel steht Kimi K3 unter Destillationsvorwurf; Ryan Greenblatt dokumentiert, dass K3 claude-opus-4-5-20250929 und ähnliche interne IDs ausgibt. Dieser Artikel liefert Benchmark-Tabellen, Entscheidungsmatrix, Zeitlinie, technische Evidenz, Sechs-Schritte-Runbook und FAQ.
00Claude Opus 5: Kein Spitzenmodell, aber vermutlich das sinnvollste Claude
Am 24. Juli 2026 (US-Pacific) veröffentlichte Anthropic Claude Opus 5 und setzte es als Claude-Max-Standard — die stärkste öffentlich nutzbare Version auch für Claude-Pro-Abonnenten. Modell-ID: claude-opus-5; erreichbar über Claude API, AWS Bedrock, Google Vertex AI und Microsoft Foundry.
- Preise unverändert: Input $5/M, Output $25/M — identisch zu Opus 4.8. Fast-Modus: ~2,5× Geschwindigkeit, 2× Preis.
- Kontext: 1 Mio. Tokens (einzige Stufe), max. Output 128K. Thinking standardmäßig aktiv; Effort-Parameter steuert Denkaufwand.
- Datenaufbewahrung: Wie frühere Opus-Generationen — kein erzwungenes 30-Tage-Retention. Fable 5 / Mythos 5 erfordern Retention-Zustimmung.
| Benchmark | Opus 5 | Einordnung |
|---|---|---|
| Frontier-Bench v0.1 | Übertrifft alle Modelle | Mehr als doppelt so stark wie Opus 4.8, geringere Kosten pro Task |
| CursorBench 3.2 (max effort) | 0,5 % unter Fable-5-Peak | Kosten halb so hoch wie Fable 5 |
| ARC-AGI 3 | 3× des nächsten Modells | Sprung bei neuartigen Problemen |
| OSWorld 2.0 | Beste Leistung bei jedem Budget | Übertrifft Fable-5-Bestwert bei ~⅓ der Kosten |
| Zapier AutomationBench | 100 % Pass-Rate | Erstes Modell mit vollständigem End-to-End-Workflow |
Box-Kundendaten: Datenanalyse-Workflows +11 %, Due Diligence +17 %, Gesamtgenauigkeit +8 %. Life Sciences: Molekülstruktur aus Spektren +10,2 Prozentpunkte gegenüber Opus 4.8; Proteinvarianten-Prognose +7,7 Prozentpunkte.
01Claude Opus 5 vs. Fable 5: Entscheidungsmatrix
Wer Fable 5 schätzte, aber den Preis scheute, erhält mit Opus 5 «minimaler Leistungsverlust, halbe Kosten». Die Matrix für schnelle Entscheidungen:
| Dimension | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Input (/M Tokens) | $5 | ~$10 |
| Output (/M Tokens) | $25 | ~$50 |
| CursorBench 3.2 Peak | 0,5 % unter Fable 5 | Höchstwert |
| Claude-Max-Default | Ja (seit 2026-07-24) | Nein |
| Daten-Retention | Keine Pflicht-Retention | 30-Tage-Retention erforderlich |
| Dual-Use-Risiko | Bewusst begrenzt | Stärker (Mythos 5 stärker) |
Cursor-Team: «Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.» Zapier: Opus 5 dominiert AutomationBench ohne Mehrverbrauch an Tokens. Für Multi-Modell-Routing siehe unseren OpenRouter-Leitfaden.
02Kimi K3 Destillations-Streit: Weißes Haus, Experten, Zeitlinie
Während Opus 5 ein regulärer Release ist, eskalierte Kimi K3 politisch. Moonshot veröffentlichte am 16. Juli 2026 Kimi K3: 2,8 Billionen Parameter, 896-Experten-MoE mit 16 aktiven (~50 Mrd. aktive Parameter), 1 Mio. Token Kontext, native Vision. GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Vollständige Gewichte versprochen für 27. Juli — zum Zeitpunkt der Kontroverse noch nicht extern verifizierbar.
| Datum | Ereignis |
|---|---|
| 2026-02 | Anthropic wirft Moonshot/DeepSeek/MiniMax «industrielle Destillation» vor — 3,4 Mio.+ anomale API-Interaktionen |
| 2026-07-01 | Claude Fable 5 öffentlich verfügbar |
| 2026-07-16 | Kimi K3 API/Produkt-Launch |
| 2026-07-22/23 | OSTP-Direktor Michael Kratsios: «Large-scale, covert industrial distillation» + GB300-Vorwurf |
| 2026-07-23 | TechCrunch: Experten bezweifeln Destillationsthese |
| 2026-07-24 | Ryan Greenblatt veröffentlicht «K3 identifiziert sich als Claude»-Statistik |
| 2026-07-27 (geplant) | Kimi K3 Open Weights |
Kratsios: «Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable.» Finanzminister Scott Bessent sprach von «Wasserzeichen» US-Modelle in chinesischen LLMs — ohne technische Details.
- Zeitlinien-Einwand: Fable 5 erst ab 1. Juli öffentlich — bis K3-Release nur zwei Wochen. Snorkel-AI-Mitgründer Braden Hancock: «You can't distill that much data, train a model, and release it in two weeks.»
- Abnehmende Grenzerträge: Allen-AI-Forscher Nathan Lambert: Chinesische Modelle nähern sich der Frontier — reine Destillation liefert weniger Mehrwert als RL-Training.
- Industrie-Doppelstandard: Elon Musk gab zu, xAI habe Grok mit OpenAI-Destillation trainiert — Grenze zwischen «Benchmarking» und «Covert Theft» umstritten.
03Technische Evidenz: K3 gibt sich als Claude aus
Redwood-Research-Wissenschaftler Ryan Greenblatt veröffentlichte um den 24. Juli Statistiken (GitHub: rgreenblatt/which_claude_is_k3) zum Identitätsverhalten bei der Frage «Wer bist du?»:
- Kimi K3 nennt sich ungewöhnlich oft Claude und gibt interne Deployment-IDs preis:
claude-opus-4-5-20250929,claude-sonnet-4-5-20250929. - Echte Claude-Modelle tun das nicht: Sonnet 4.5 sagt «Ich bin Claude Sonnet 4.5»; Opus 4.5 meldet oft gar keine Versionsnummer.
- Generationsmuster: K2 zeigt auf Claude Sonnet 4 (Mitte 2025), K3 auf Opus 4.5 (Ende 2025) — nicht auf Fable/Mythos.
Greenblatt: Ein Schüler, der Lehrer-Deployment-Metadaten präziser nennt als der Lehrer selbst, lässt sich schwer durch «Stilimitation» erklären — eher durch Claude-Trainingsdaten mit API-Metadaten. Das verbindet sich mit unserer Analyse zu Claude-Code-Fingerprints.
PainVersteckte Kosten und Compliance-Risiken bei der Modellwahl
- API-Rechnung vs. Compute-Rechnung: Opus 5 halbiert Token-Kosten — doch Agenten auf Shared-VPS oder Desktop-Macs verlieren den Vorteil durch Queue-Jitter und abgebrochene Long-Lived-Sessions.
- Compliance: Fable 5 / Mythos 5 erzwingen 30-Tage-Retention — harte Hürde für Finanz und Gesundheitswesen. K3-Destillationsvorwürfe bringen Exportkontroll- und Policy-Unsicherheit.
- Open-Source-Verifikationsfenster: Bis 27. Juli basieren K3-Architektur und Benchmarks auf Herstellerangaben — Produktions-Integration mit Informationsasymmetrie.
- Routing-Komplexität: Multi-Modell-Fallback (Opus 5 + K3 + lokal) erfordert stabile CI und dedizierte Agent-Hosts, nicht nur einen neuen API-Key.
04Sechs-Schritte-Runbook: Produktions-Integration nach dem Modell-Update
-
01
Claude-API-Audit: Prüfen, ob Calls noch Opus 4.8 oder Fable 5 adressieren. Claude-Max-Nutzer: Konsole auf Opus-5-Default verifizieren.
-
02
CursorBench / interne Smoke-Tests: Opus 5 vs. Fable 5 auf der echten Codebase — Pass-Rate und Token-Verbrauch bei high/max effort messen.
-
03
Retention-Bedingungen prüfen: Compliance-sensible Workloads → Opus 5 (keine Pflicht-Retention). Fable-5-Peak nur nach separater Retention-Bewertung.
-
04
K3-Produktion zurückhalten: Nach Open Weights (27. Juli) GPQA-Diamond / SWE Marathon unabhängig replizieren und Greenblatt-Identitätsprobes fahren.
-
05
Multi-Modell-Routing konfigurieren: Über OpenRouter oder LiteLLM Opus 5 als Primary + Open-Source-Fallback; Modell-ID und Kosten pro Call loggen.
-
06
Stabilen Agent-Host deployen: Langzeit-Agent-Sessions brauchen dedizierte Compute und stabiles SSH. Preisseite prüfen: NUKCLOUD dedizierte Mac-Knoten als CI- und Agent-Build-Ebene statt Shared-Pool-Tail-Latenz.
05Preis-Leistung als Hauptkampffeld — beide Stories im Kontext
Opus 5 antwortet mit «halber Preis, fast Flaggschiff-Niveau»; Kimi K3 attackiert mit Open Source, niedrigen Preisen und weniger Refusals. Der Destillations-Streit ist die öffentliche Auseinandersetzung darüber, ob günstige Leistung aus eigener Optimierung oder aus fremden Modellen stammt.
Für Entwickler gilt: Szenario vor Ideologie. Compliance, Retention, Lieferkette → Opus 5 bietet außergewöhnliches Preis-Leistungs-Verhältnis. Extremkosten und Open-Source-Kontrolle → K3 erst nach unabhängiger Gewichts-Verifikation am 27. Juli bewerten. Reddit r/LocalLLaMA: Jubel über schrumpfende Open-/Closed-Gaps; Skepsis wegen 2,8T lokaler Inferenz; Pragmatiker sehen K3s Kern als günstig + wenig Zensur, nicht als Fable-5-Killer.
Teams, die Opus 5 oder K3 für Langzeit-Agenten auf großen Codebases einsetzen, brauchen eine stabile, auditierbare Dev- und CI-Ebene. Shared-Minuten-Pools, Desktop-Macs oder oversubscribed VPS erzeugen Bandbreiten-Jitter, CPU-Konkurrenz und Session-Abbrüche — und fressen Token-Ersparnisse auf. Für produktionsreife Agent-Hosts bieten NUKCLOUD multiregionale Bare-Metal-Mac-Knoten dedizierte Apple-Silicon-Compute und klare Mandantengrenzen. Spezifikationen auf der Preisseite, Trial über Bestellung.
06Zusammenfassung und FAQ
claude-opus-4-5-20250929 und ähnliche interne Deployment-IDs nennt — präziser als echte Claude-Modelle. Wahrscheinlichste Erklärung: Trainingsdaten mit Claude-API-Metadaten.Datenstand: 2026-07-25. Quellen: Anthropic Release, Moonshot/Kimi Tech Blog, TechCrunch, Ryan Greenblatt GitHub, CNBC, The Verge.