Повышение DeepSeek, веса Alibaba на 2,4 трлн, GLM-5.3: почему китайские лаборатории сменили строй в августе

С 12 по 17 августа DeepSeek вводит пиковые тарифы до более чем 1100%, Alibaba впервые выкладывает Max-веса на 2,4 трлн параметров, Zhipu на той же базе поднимает кодовые бенчи примерно в шесть раз. Спор уже не о дне цены, а о праве её задавать.

За пять дней три китайские лаборатории сделали шаги, которые выглядят противоречиво и на деле рифмуются. DeepSeek поднимает отдельные позиции API до более чем 1100%. Alibaba в том же окне впервые отдаёт веса флагмана Qwen-Max на 2,4 трлн параметров. Zhipu выпускает GLM-5.3 на базе 743 млрд от GLM-5.2 и почти весь кодовый скачок берёт пост-обучением. Общий сигнал: конкуренция уходит с «кто дешевле» на «кто держит ценообразование». Продуктовый фон — в заметке о запуске Qwen3.8-Max и обзоре V4 Flash; здесь — веса, почасовая сетка и скачок без новой базы.

00Хронология двух недель

ДатаСобытие
16 июля 2026Moonshot AI открывает Kimi K3 (2,8 трлн параметров); уже попал в поле зрения американской безопасности
2–3 августаAlibaba анонсирует и запускает Qwen3.8-Max как облачный API
10 августаMeta выпускает Muse Glimmer (30 млрд, Apache 2.0) и обещает веса флагмана Muse Spark 1.2
12 августаAlibaba кладёт Qwen3.8-2.4T-A95B на ModelScope/Hugging Face; в тот же день xAI отдаёт Grok 4.6
13 августаDeepSeek-V4-Pro выходит в GA и объявляет повышение с 17 августа; Google снижает Gemini 3.7 Flash
14 августаZhipu выпускает GLM-5.3 на базе 743 млрд от GLM-5.2
17 августа, 00:00 по ПекинуНовая сетка DeepSeek вступает в силу

Шире: 30 июля OpenAI срезал самый дешёвый ярус GPT-5.6 Luna на 80%, 6–7 августа сделал Luna моделью по умолчанию для бесплатных аккаунтов с безлимитным текстом. Пока китайские лаборатории добавляют повышение и открытие флагманов, американские добавляют бесплатность и снижение. Это не совпадение, а две стороны одной ценовой войны. Срез Luna — в заметке о снижении GPT-5.6.

ОшибкиГде закупки ломают логику на этой неделе

  • Читать «1100%» как весь счёт. 11×, 1100% и 350% могут быть верны одновременно. Это cache-hit input, output и cache-miss input.
  • Считать официальный API всегда самым дешёвым. В пике GMI Cloud и Novita уже ниже официального пика.
  • Путать open weights с Apache 2.0. У Qwen3.8-Max своя Qwen3.8-Max License. Крупный MaaS / AI-ассистент всё равно идёт на отдельную сделку.
  • Повторять слух о геозапрете. В тексте нет территориальных оговорок. Пороги — выручка и отображение имени.
  • Писать GLM-5.3 как новую базу. 743 млрд те же, что у 5.2. Скачок — пост-обучение, цифры вендорские.
  • Закладывать бюджет «китайская = самая дешёвая». Off-peak DeepSeek всё ещё ниже Claude Opus 5, но Qwen international и Luna уже бьют его хотя бы по одной оси.

01Цифры: что именно сдвинулось

Сетка DeepSeek с 17 августа, 00:00 Пекин. Пик: 9–12 и 14–18 по Пекину. Единица — за 1 млн tokens.

ПозицияБылоOff-peakPeakРост в пике
V4-Flash cache-hit input¥0,02¥0,05¥0,10~400%
V4-Flash cache-miss input¥1,0¥1,5¥3,0200%
V4-Flash output¥2,0¥4,5¥9,0350%
V4-Pro cache-hit input¥0,025¥0,15¥0,30~1100%
V4-Pro cache-miss input¥3,0¥4,5¥9,0200%
V4-Pro output¥6,0¥13,5¥27,0350%
Цитируемый факт 1: Официальное объявление сверено с Wall Street CN, IT Home и V2EX. 1100% сидит на peak cache-hit input. Счёт двигают output (+350%) и cache-miss input. Тяжёлая нагрузка (~84 млн tokens/мес, в основном off-peak, около половины хитов) ближе к 1,8×.

Qwen3.8-2.4T-A95B (открытые веса Qwen3.8-Max)

ПараметрЗначение
Параметры2,4 трлн всего, 95 млрд активных (MoE, 512 экспертов, 10 маршрутизируемых + 1 общий)
Контекст262 144 tokens нативно, до ~1,01 млн; облачный Max по умолчанию 1 млн
Ритм2 авг. превью → 3 авг. API → 12 авг. веса
Международный API$2 вход / $6 выход за миллион
Лицензияне Apache 2.0 — своя Qwen3.8-Max License
Смыслпервый открытый Max-флагман; 3.5/3.6/3.7 Max оставались API-only

GLM-5.3 против GLM-5.2: та же база, только пост-обучение. Цифры Zhipu, независимого прогона нет.

БенчмаркGLM-5.2GLM-5.3Сдвиг
Terminal-Bench 3.04,6%28,3%+23,7
DeepSWE v1.146,2%66,9%+20,7
Agents' Last Exam (CLI)23,8%28,5%+4,7
CyberGym77,2%84,5%+7,3
AutomationBench26,2%48,2%+22,0
Цитируемый факт 2: На Terminal-Bench 3.0 GLM-5.3 всё ещё ниже GPT-5.6 Sol (34,6%) и Claude Fable 5 (33,7%). Верх открытого эшелона, не абсолютный фронтир. Международный API Qwen: $2 / $6.

02Три стратегии, три механики

DeepSeek: с плоского демпинга на time-of-day. Суть — дефицит compute, вынесенный в прайс. Самое ленивое чтение — «сдались марже». Структура ближе к первой прозрачной ведомости мощности. Старый круглосуточный низкий тариф покупал пользователей, пока GPU успевали за спросом. Когда вызовы растут экспоненциально, фраза «более гибкое планирование нагрузки» переводится как «пикового compute не хватает, сдвиньте сами».

Деталь, которую международная пресса часто пропускает: в пике официальный API уже дороже GMI Cloud, Novita и других реселлеров. Гипотеза «официал всегда самый дешёвый» сломана впервые.

Alibaba: веса покупают экосистему, своя лицензия держит потолок выручки. Чекпоинт на 2,4 трлн качается бесплатно, лицензия не Apache 2.0. MaaS или AI Work Assistant с выручкой свыше $50 млн за любые 12 месяцев требует отдельной коммерческой лицензии. Продукт с 100+ млн MAU или $20+ млн месячной выручки обязан заметно показывать имя модели.

Логика: отдать веса ради зарубежных разработчиков и снять ярлык «китайская модель несерьёзна», оставив рычаг на тех немногих, кто способен построить на этом inference-бизнес. Это другой уровень «открытости», чем Muse Glimmer под чистым Apache 2.0. Слух о запрете скачивания из США, ЕС, Великобритании и Кореи ложный: в тексте нет географических оговорок.

GLM-5.3: не новая база, а более жирный пост-тренинг. Интересен не балл, а метод: те же 743 млрд, без повторного претрейна, Terminal-Bench 3.0 с 4,6% до 28,3% (примерно 6×) за счёт масштаба RL-сред. Когда предельная отдача Scaling Law претрейна падает, масштаб RL на пост-обучении становится рычагом с более низким полом затрат, чем новая фундаментная модель.

Цитируемый факт 3: Пороги лицензии — $50 млн / 12 месяцев (MaaS, ассистент) и 100 млн MAU либо $20 млн в месяц (имя модели). GLM-5.3 Terminal-Bench 3.0: 4,6% → 28,3%.

03Сравнение: DeepSeek ещё самый дешёвый флагман?

МодельВход / 1 млн tokensВыход / 1 млн tokensОткрытые веса
DeepSeek V4-Pro (пик)¥9,0 (~$1,26)¥27,0 (~$3,78)нет
DeepSeek V4-Pro (off-peak)¥4,5 (~$0,63)¥13,5 (~$1,89)нет
Qwen3.8-Max (международный API)$2$6да (своя лицензия)
OpenAI GPT-5.6 Luna$0,20$1,20нет
Claude Opus 5 (кратность Alibaba)~$5~$25нет

Курс около ¥7,15/$1. Off-peak V4-Pro всё ещё заметно ниже Claude Opus 5, но уже не дно рынка. Международный Qwen и Luna подрезают off-peak DeepSeek. «Китайская модель = самая дешёвая» держалось в 2025 и начале 2026; сейчас это небезопасное допущение.

04Спорное и неподтверждённое

  • Заголовок «1100%» технически верен и без контекста врёт. Он относится только к peak cache-hit input. Output, который доминирует в реальных счетах, вырос на 350%.
  • Инференс на отечественных Zhenwu M890 гуляет в китайской финансовой прессе, без независимого техдока Alibaba и сторонних бенчей. Держать как непроверенное.
  • «Серьёзная дыра в Cursor» от GLM-5.3 — VentureBeat плюс раскрытие Zhipu. Технических деталей нет; односторонняя вендорская заявка.
  • Ответные экспортные ограничения Минкоммерции КНР — медиа-догадки, не официальное объявление.

05Контекст: две ценовые войны параллельно

Примерно месяц китайские топ-лаборатории штампуют релизы в темпе, который внутренняя финпресса называет «три обновления модели в неделю» — DeepSeek, Alibaba, Zhipu плюс Kimi K3 (16 июля, 2,8 трлн) и MiniMax H3. Китайская рамка: открытые веса заставляют мир пересчитать цены.

Американские лаборатории бегут в обратную сторону на потребительском слое: OpenAI 30 июля срезал самый дешёвый ярус на 80% и через неделю сделал модель бесплатной и безлимитной; Google 13 августа выпустил кодовый модель за половину цены трёхнедельного предшественника. Китай открывает флагманы и ступенчато поднимает верх, США дешевеют внизу воронки. Обе стратегии настоящие, оптимизируют разные этажи.

Геополитический слой стоит назвать аккуратно. Открытие Kimi K3 уже вызвало интерес американской безопасности; выбор Alibaba открыть 2,4 трлн в этом окне часть аналитиков читает как фиксацию международной заметности и нарратива «технологического паритета» до возможного ужесточения. Это интерпретация, не факт — но контекст, который англоязычная техпресса часто режет на изолированные продуктовые заметки.

06Шесть шагов до следующего счёта

  1. 01
    Разрезать трафик по пекинским пикам. 9–12 и 14–18 против остального. Американский день почти весь off-peak, китайские будни попадают в пик.
  2. 02
    Вынести cache-hit в отдельный KPI. 1100% сидит на hit-input. Счёт двигают output 350% и miss-input 200%. Тяжёлая нагрузка ближе к 1,8×.
  3. 03
    Свести официал, реселл, Qwen и Luna в одну таблицу. В пике: список DeepSeek, GMI Cloud / Novita, Qwen $2/$6, Luna $0,20/$1,20. Убрать догму «официал самый дешёвый».
  4. 04
    Прочитать LICENSE до скачивания весов. Личное и внутреннее почти не задеты. $50 млн / 12 месяцев MaaS или ассистента требуют отдельной лицензии. 100 млн MAU или $20 млн в месяц — заметное имя модели. Геозапрета нет.
  5. 05
    Держать GLM-5.3 как апгрейд пост-тренинга. База 743 млрд. Terminal-Bench 3.0 ниже Sol 34,6% и Fable 5 33,7%. Не писать «открытый №1» до независимого прогона.
  6. 06
    Самохост-оценки — на выделенном хосте. Чекпоинт 2,4 трлн, off-peak батчи и воспроизведение GLM-бенчей требуют стабильных процессов и границы арендатора. Оценить выделенный Apple Silicon / облачный Mac на странице цен, прогнать офлайн-инференс через страницу заказа, масштабировать по доле обрывов, не по маркетингу.
Минимальный чеклист недели повышения
[ ] Трафик разрезан по пекинскому peak / off-peak
[ ] Hit-rate и output tokens отдельно
[ ] Официальный пик vs реселл vs Qwen vs Luna
[ ] Пороги Qwen3.8-Max License прочитаны
[ ] GLM-5.3: вендорские цифры, ждём третьих
[ ] Самохост-плоскость отделена от прод-секретов

07Итог и FAQ

DeepSeek вписал дефицит compute в прайс. Alibaba обменяла веса флагмана на внимание и оставила свою лицензию над денежным слоем. Zhipu показала, что масштаб пост-обучения двигает кодовые бенчи без новой базы. Общие минутные пулы, перепроданные VPS и Mac под столом ломаются одинаково: джиттер канала, соседи, оборванные длинные сессии убивают off-peak батчи и локальный аудит. Для более стабильной прод- и оценочной плоскости мультирегиональные bare-metal Mac / облачные Mac-узлы NUKCLOUD дают выделенный Apple Silicon и ясную границу арендатора. Сверить SKU на странице цен и стартовать с страницы заказа.

После повышения DeepSeek дороже GPT-5.6 и Claude?
Off-peak всё ещё дешевле Claude Opus 5, но уже не абсолютный минимум. Luna ($0,20/$1,20) и международный Qwen ($2/$6) подрезают новый off-peak хотя бы по одной оси. Для фронтир-класса DeepSeek ещё относительно дёшев, просто больше не безусловно самый дешёвый.
Можно ли бесплатно использовать веса Qwen3.8-Max в коммерческом продукте?
Для большинства сценариев да: личные проекты и внутреннее использование почти не задеты. Отдельная лицензия Alibaba нужна только если вы крутите MaaS или AI Work Assistant с выручкой свыше $50 млн за любые 12 месяцев подряд.
Пользователи США, ЕС и Великобритании отрезаны от Qwen3.8-Max?
Нет. Это ложный слух. В опубликованной лицензии нет географических ограничений. Пороги завязаны на выручку, не на локацию.
В чём реальная разница GLM-5.3 и 5.2?
На уровне базы — ни в чём: те же 743 млрд. Прирост примерно в 6× на Terminal-Bench 3.0 целиком из масштаба RL на пост-обучении, без повторного претрейна.
Meta откроет настоящий флагман, а не только Muse Glimmer?
Пока нет. Glimmer — дистиллят на 30 млрд. Цукерберг заявил веса закрытого Muse Spark 1.2 «скоро». На момент этой статьи релиза нет; это намерение, не факт.

Источники: официальное объявление цен DeepSeek (сверка Wall Street CN, IT Home, AIGC.cn, V2EX); официальные репозитории Qwen (Hugging Face / ModelScope) и SCMP по лицензии; техстраница Z.ai по GLM-5.3, VentureBeat и StableLearn; блог Meta AI Research и VentureBeat по Muse Glimmer; Yicai и Sohu Finance по темпу китайских релизов. Цены, лицензия и бенчи — на момент публикации. Перед перепечаткой сверять официальные страницы. Утверждения про отечественные чипы, дыру в Cursor и экспортный контроль остаются непроверенными.