Claude Opus 5: полцены Fable 5 — Kimi K3 в скандале «я Claude»

Два события этой недели сходятся к одной теме — цена/качество и реальный источник способностей модели: Anthropic выпустил повседневный флагман Claude Opus 5; Kimi K3 Moonshot под обвинением Белого дома в дистилляции, а независимый исследователь показал, что K3 называет себя Claude.

Вывод: 24 июля 2026 Anthropic выпустил Claude Opus 5 — те же цены, что у Opus 4.8 ($5/$25 за миллион токенов), пик CursorBench 3.2 всего на 0,5 % ниже Fable 5 при половине стоимости. Параллельно Kimi K3 обвиняют в дистилляции; Ryan Greenblatt зафиксировал, что K3 выдаёт claude-opus-4-5-20250929 и другие внутренние ID. Разбор: бенчмарки, матрица выбора, хронология, технические доказательства, 6-шаговый runbook и FAQ.

00Claude Opus 5: не топ-модель, но, возможно, самый практичный Claude

24 июля 2026 (US Pacific) Anthropic официально выпустил Claude Opus 5 и сделал его дефолтом Claude Max — самой мощной публично доступной версией и для Claude Pro. Model ID: claude-opus-5; доступ через Claude API, AWS Bedrock, Google Vertex AI и Microsoft Foundry.

  • Цены без изменений: input $5/M, output $25/M — как у Opus 4.8. Fast mode: ~2,5× скорость, 2× цена.
  • Контекст: 1 млн токенов (единственный tier), max output 128K. Thinking включён по умолчанию; параметр Effort управляет глубиной рассуждений.
  • Data retention: как у прежних Opus — без принудительного 30-дневного хранения. Fable 5 / Mythos 5 требуют политику retention.
БенчмаркOpus 5Интерпретация
Frontier-Bench v0.1Обходит все моделиБолее чем в 2× сильнее Opus 4.8, ниже cost per task
CursorBench 3.2 (max effort)0,5 % ниже пика Fable 5Стоимость вдвое ниже Fable 5
ARC-AGI 3 следующей моделиСкачок в novel problem solving
OSWorld 2.0Лучший при любом бюджетеОбходит Fable 5 при ~⅓ стоимости
Zapier AutomationBench100 % pass rateПервый end-to-end workflow без провала

Данные клиентов Box: data analytics workflows +11 %, due diligence +17 %, общая точность +8 %. Life sciences: inferring molecular structure from spectra +10,2 п.п. vs Opus 4.8; protein variant prediction +7,7 п.п.

Safety positioning: Opus 5 — наиболее aligned модель Anthropic (минимальное deceptive behavior), но намеренно не обновляет cyber/bio frontier — там Mythos 5. Cybersecurity classifier на ~85 % менее restrictive, чем у Fable 5; source-level vuln discovery да, binary exploit generation нет.

01Claude Opus 5 vs Fable 5: матрица выбора

Если Fable 5 нравился по качеству, но не по цене — Opus 5 даёт «минимальная потеря, половина cost». Матрица для быстрого решения:

ИзмерениеClaude Opus 5Claude Fable 5
Input (/M tokens)$5~$10
Output (/M tokens)$25~$50
CursorBench 3.2 peak0,5 % ниже Fable 5Максимум
Claude Max defaultДа (с 2026-07-24)Нет
Data retentionБез принудительного хранения30-дневный retention обязателен
Dual-use riskОсознанно ограниченВыше (Mythos 5 ещё выше)

Cursor team: «Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.» Zapier: Opus 5 лидирует в AutomationBench без роста token consumption. Для multi-model routing — наш гайд OpenRouter.

02«Distillation gate» Kimi K3: Белый дом, эксперты, timeline

Если Opus 5 — обычный релиз, Kimi K3 ушёл в политику. 16 июля 2026 Moonshot выпустил Kimi K3: 2,8 триллиона параметров, MoE 896 experts / 16 active (~50 млрд active params), контекст 1M, native vision. GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Полные веса обещаны на 27 июля — на момент скандала внешняя верификация невозможна.

ДатаСобытие
2026-02Anthropic обвиняет Moonshot/DeepSeek/MiniMax в «industrial distillation» — 3,4M+ anomalous API interactions
2026-07-01Claude Fable 5 публично доступен
2026-07-16Launch Kimi K3 API/product
2026-07-22/23OSTP director Michael Kratsios: «large-scale covert industrial distillation» + GB300 allegations
2026-07-23TechCrunch: эксперты оспаривают distillation thesis
2026-07-24Ryan Greenblatt публикует статистику «K3 identifies as Claude»
2026-07-27 (plan)Kimi K3 open weights

Kratsios: «Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable.» Treasury Secretary Scott Bessent упомянул «watermarks» US models в китайских LLM — без технических деталей.

  • Timeline counter: Fable 5 public с 1 июля — до K3 release только две недели. Snorkel AI co-founder Braden Hancock: «You can't distill that much data, train a model, and release it in two weeks.»
  • Diminishing returns: Allen AI researcher Nathan Lambert: по мере приближения китайских моделей к frontier простая distillation даёт меньше, чем RL training.
  • Industry double standard: Elon Musk признал в суде, что xAI distillation OpenAI для Grok — граница «normal benchmarking» vs «covert theft» размыта.

03Hard evidence: K3 называет себя Claude

Chief scientist Redwood Research Ryan Greenblatt ~24 июля опубликовал статистику (GitHub: rgreenblatt/which_claude_is_k3) — поведение моделей на вопрос «кто ты?»:

  • Kimi K3 аномально часто называет себя Claude и выдаёт internal deployment ID: claude-opus-4-5-20250929, claude-sonnet-4-5-20250929.
  • Настоящие Claude так не делают: Sonnet 4.5 говорит «I'm Claude Sonnet 4.5»; Opus 4.5 часто не сообщает version string.
  • Generation pattern: K2 → Claude Sonnet 4 (mid-2025), K3 → Opus 4.5 (late 2025), не Fable/Mythos.

Greenblatt: когда student model цитирует teacher deployment metadata точнее, чем teacher сам — «style imitation» не объясняет; вероятнее training data с Claude API metadata. Связь с нашим разбором Claude Code fingerprints.

Important caveat: Greenblatt подчёркивает — findings не доказывают distillation напрямую. Identity confusion возможна из data contamination, prompt leaks, synthetic datasets. В связке с February allegations Anthropic — сильнейшая technical evidence chain на сегодня.

PainHidden costs и compliance risk при выборе модели

  • API bill vs compute bill: Opus 5 halved token cost — но agents на shared VPS или desktop Mac теряют выгоду из-за queue jitter и обрыва long-lived sessions.
  • Compliance: Fable 5 / Mythos 5 требуют 30-day retention — hard gate для finance/healthcare. K3 distillation allegations добавляют export control и policy uncertainty.
  • Open verification window: до 27 июля architecture и benchmarks K3 — «vendor claims + external guesswork», production integration с information asymmetry.
  • Routing complexity: multi-model fallback (Opus 5 + K3 + local inference) требует stable CI и dedicated agent host, не только новый API key.

046-шаговый runbook: production integration после model update

  1. 01
    Audit Claude API calls: проверить, что endpoints не указывают на Opus 4.8 или Fable 5. Claude Max users: console должна показывать Opus 5 default.
  2. 02
    CursorBench / internal smoke: Opus 5 vs Fable 5 на реальной codebase — pass rate и token burn на high/max effort.
  3. 03
    Evaluate retention terms: compliance-sensitive workloads → Opus 5 (no forced retention). Fable 5 peak только после отдельной оценки 30-day policy.
  4. 04
    Hold K3 production: после open weights (27 июля) независимо воспроизвести GPQA-Diamond / SWE Marathon и прогнать Greenblatt-style identity probes.
  5. 05
    Configure multi-model routing: через OpenRouter или LiteLLM — Opus 5 primary + open-source fallback; log model ID и cost per call.
  6. 06
    Deploy stable agent host: long-running agent sessions нужны dedicated compute и stable SSH. Сравнить цены: NUKCLOUD dedicated Mac nodes как CI и agent build plane вместо shared-pool tail latency.

05Price/performance — главное поле боя

Opus 5 отвечает «half price, near flagship»; Kimi K3 атакует open source + low price + fewer refusals. Distillation controversy — публичная разборка: ваш дешёвый performance из internal optimization или из чужой модели?

Для разработчиков: scenario first, ideology second. Compliance, retention, supply chain → Opus 5 exceptional value. Extreme cost + open control → K3 после independent weight verification 27 июля. Reddit r/LocalLLaMA: celebration open/closed gap в «days» not «months»; skepticism про 2.8T local inference; pragmatists видят K3 sell как low price + less censorship, не «beat Fable 5».

Teams с long-running agents на large codebases через Opus 5 или K3 нуждаются в stable, auditable dev/CI plane. Shared minute pools, desktop Macs, oversubscribed VPS дают bandwidth jitter, neighbor CPU contention, session drops — и съедают token savings. Для production agent hosts NUKCLOUD multiregional bare-metal Mac nodes дают dedicated Apple Silicon и clear tenant boundaries. Specs на странице цен, trial через заказ.

06Итог и FAQ

Насколько Claude Opus 5 дешевле Fable 5?
Opus 5: $5/M input, $25/M output — ~половина Fable 5 ($10/$50). CursorBench 3.2 max effort: gap <1 %.
Opus 5 — default в Claude Max?
Да, с 24 июля 2026. Opus 5 — Claude Max default и strongest version для Claude Pro.
Kimi K3 действительно distillation Claude?
Не доказано, disputed. Белый дом без public evidence; experts сомневаются в full distillation за 2 weeks. Greenblatt identity stats — strongest indirect technical evidence.
Когда скачать полные веса Kimi K3?
Officially 27 июля 2026. На дату публикации external researchers не могли fully independently verify architecture и benchmarks.
Почему Kimi K3 называет себя Claude?
Greenblatt: K3 выдаёт claude-opus-4-5-20250929 и другие internal deployment IDs точнее, чем real Claude models. Likely training data с Claude API metadata annotations.
На какой инфраструктуре гонять agent CI?
Long-running agents нужны stable SSH, predictable disk IO, no neighbor contention. NUKCLOUD dedicated Mac nodes подходят как agent host и CI build plane.

Data as of 2026-07-25. Sources: Anthropic release, Moonshot/Kimi tech blog, TechCrunch, Ryan Greenblatt GitHub, CNBC, The Verge.