Вывод: 24 июля 2026 Anthropic выпустил Claude Opus 5 — те же цены, что у Opus 4.8 ($5/$25 за миллион токенов), пик CursorBench 3.2 всего на 0,5 % ниже Fable 5 при половине стоимости. Параллельно Kimi K3 обвиняют в дистилляции; Ryan Greenblatt зафиксировал, что K3 выдаёт claude-opus-4-5-20250929 и другие внутренние ID. Разбор: бенчмарки, матрица выбора, хронология, технические доказательства, 6-шаговый runbook и FAQ.
00Claude Opus 5: не топ-модель, но, возможно, самый практичный Claude
24 июля 2026 (US Pacific) Anthropic официально выпустил Claude Opus 5 и сделал его дефолтом Claude Max — самой мощной публично доступной версией и для Claude Pro. Model ID: claude-opus-5; доступ через Claude API, AWS Bedrock, Google Vertex AI и Microsoft Foundry.
- Цены без изменений: input $5/M, output $25/M — как у Opus 4.8. Fast mode: ~2,5× скорость, 2× цена.
- Контекст: 1 млн токенов (единственный tier), max output 128K. Thinking включён по умолчанию; параметр Effort управляет глубиной рассуждений.
- Data retention: как у прежних Opus — без принудительного 30-дневного хранения. Fable 5 / Mythos 5 требуют политику retention.
| Бенчмарк | Opus 5 | Интерпретация |
|---|---|---|
| Frontier-Bench v0.1 | Обходит все модели | Более чем в 2× сильнее Opus 4.8, ниже cost per task |
| CursorBench 3.2 (max effort) | 0,5 % ниже пика Fable 5 | Стоимость вдвое ниже Fable 5 |
| ARC-AGI 3 | 3× следующей модели | Скачок в novel problem solving |
| OSWorld 2.0 | Лучший при любом бюджете | Обходит Fable 5 при ~⅓ стоимости |
| Zapier AutomationBench | 100 % pass rate | Первый end-to-end workflow без провала |
Данные клиентов Box: data analytics workflows +11 %, due diligence +17 %, общая точность +8 %. Life sciences: inferring molecular structure from spectra +10,2 п.п. vs Opus 4.8; protein variant prediction +7,7 п.п.
01Claude Opus 5 vs Fable 5: матрица выбора
Если Fable 5 нравился по качеству, но не по цене — Opus 5 даёт «минимальная потеря, половина cost». Матрица для быстрого решения:
| Измерение | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Input (/M tokens) | $5 | ~$10 |
| Output (/M tokens) | $25 | ~$50 |
| CursorBench 3.2 peak | 0,5 % ниже Fable 5 | Максимум |
| Claude Max default | Да (с 2026-07-24) | Нет |
| Data retention | Без принудительного хранения | 30-дневный retention обязателен |
| Dual-use risk | Осознанно ограничен | Выше (Mythos 5 ещё выше) |
Cursor team: «Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.» Zapier: Opus 5 лидирует в AutomationBench без роста token consumption. Для multi-model routing — наш гайд OpenRouter.
02«Distillation gate» Kimi K3: Белый дом, эксперты, timeline
Если Opus 5 — обычный релиз, Kimi K3 ушёл в политику. 16 июля 2026 Moonshot выпустил Kimi K3: 2,8 триллиона параметров, MoE 896 experts / 16 active (~50 млрд active params), контекст 1M, native vision. GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Полные веса обещаны на 27 июля — на момент скандала внешняя верификация невозможна.
| Дата | Событие |
|---|---|
| 2026-02 | Anthropic обвиняет Moonshot/DeepSeek/MiniMax в «industrial distillation» — 3,4M+ anomalous API interactions |
| 2026-07-01 | Claude Fable 5 публично доступен |
| 2026-07-16 | Launch Kimi K3 API/product |
| 2026-07-22/23 | OSTP director Michael Kratsios: «large-scale covert industrial distillation» + GB300 allegations |
| 2026-07-23 | TechCrunch: эксперты оспаривают distillation thesis |
| 2026-07-24 | Ryan Greenblatt публикует статистику «K3 identifies as Claude» |
| 2026-07-27 (plan) | Kimi K3 open weights |
Kratsios: «Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable.» Treasury Secretary Scott Bessent упомянул «watermarks» US models в китайских LLM — без технических деталей.
- Timeline counter: Fable 5 public с 1 июля — до K3 release только две недели. Snorkel AI co-founder Braden Hancock: «You can't distill that much data, train a model, and release it in two weeks.»
- Diminishing returns: Allen AI researcher Nathan Lambert: по мере приближения китайских моделей к frontier простая distillation даёт меньше, чем RL training.
- Industry double standard: Elon Musk признал в суде, что xAI distillation OpenAI для Grok — граница «normal benchmarking» vs «covert theft» размыта.
03Hard evidence: K3 называет себя Claude
Chief scientist Redwood Research Ryan Greenblatt ~24 июля опубликовал статистику (GitHub: rgreenblatt/which_claude_is_k3) — поведение моделей на вопрос «кто ты?»:
- Kimi K3 аномально часто называет себя Claude и выдаёт internal deployment ID:
claude-opus-4-5-20250929,claude-sonnet-4-5-20250929. - Настоящие Claude так не делают: Sonnet 4.5 говорит «I'm Claude Sonnet 4.5»; Opus 4.5 часто не сообщает version string.
- Generation pattern: K2 → Claude Sonnet 4 (mid-2025), K3 → Opus 4.5 (late 2025), не Fable/Mythos.
Greenblatt: когда student model цитирует teacher deployment metadata точнее, чем teacher сам — «style imitation» не объясняет; вероятнее training data с Claude API metadata. Связь с нашим разбором Claude Code fingerprints.
PainHidden costs и compliance risk при выборе модели
- API bill vs compute bill: Opus 5 halved token cost — но agents на shared VPS или desktop Mac теряют выгоду из-за queue jitter и обрыва long-lived sessions.
- Compliance: Fable 5 / Mythos 5 требуют 30-day retention — hard gate для finance/healthcare. K3 distillation allegations добавляют export control и policy uncertainty.
- Open verification window: до 27 июля architecture и benchmarks K3 — «vendor claims + external guesswork», production integration с information asymmetry.
- Routing complexity: multi-model fallback (Opus 5 + K3 + local inference) требует stable CI и dedicated agent host, не только новый API key.
046-шаговый runbook: production integration после model update
-
01
Audit Claude API calls: проверить, что endpoints не указывают на Opus 4.8 или Fable 5. Claude Max users: console должна показывать Opus 5 default.
-
02
CursorBench / internal smoke: Opus 5 vs Fable 5 на реальной codebase — pass rate и token burn на high/max effort.
-
03
Evaluate retention terms: compliance-sensitive workloads → Opus 5 (no forced retention). Fable 5 peak только после отдельной оценки 30-day policy.
-
04
Hold K3 production: после open weights (27 июля) независимо воспроизвести GPQA-Diamond / SWE Marathon и прогнать Greenblatt-style identity probes.
-
05
Configure multi-model routing: через OpenRouter или LiteLLM — Opus 5 primary + open-source fallback; log model ID и cost per call.
-
06
Deploy stable agent host: long-running agent sessions нужны dedicated compute и stable SSH. Сравнить цены: NUKCLOUD dedicated Mac nodes как CI и agent build plane вместо shared-pool tail latency.
05Price/performance — главное поле боя
Opus 5 отвечает «half price, near flagship»; Kimi K3 атакует open source + low price + fewer refusals. Distillation controversy — публичная разборка: ваш дешёвый performance из internal optimization или из чужой модели?
Для разработчиков: scenario first, ideology second. Compliance, retention, supply chain → Opus 5 exceptional value. Extreme cost + open control → K3 после independent weight verification 27 июля. Reddit r/LocalLLaMA: celebration open/closed gap в «days» not «months»; skepticism про 2.8T local inference; pragmatists видят K3 sell как low price + less censorship, не «beat Fable 5».
Teams с long-running agents на large codebases через Opus 5 или K3 нуждаются в stable, auditable dev/CI plane. Shared minute pools, desktop Macs, oversubscribed VPS дают bandwidth jitter, neighbor CPU contention, session drops — и съедают token savings. Для production agent hosts NUKCLOUD multiregional bare-metal Mac nodes дают dedicated Apple Silicon и clear tenant boundaries. Specs на странице цен, trial через заказ.
06Итог и FAQ
claude-opus-4-5-20250929 и другие internal deployment IDs точнее, чем real Claude models. Likely training data с Claude API metadata annotations.Data as of 2026-07-25. Sources: Anthropic release, Moonshot/Kimi tech blog, TechCrunch, Ryan Greenblatt GitHub, CNBC, The Verge.