DeepSeek 인상, 알리바바 2.4조 플래그십 공개, GLM-5.3: 중국 LLM은 왜 8월에 한꺼번에 바뀌었나

8월 12일부터 17일까지 닷새 동안 DeepSeek는 피크 요금을 최대 1100% 이상 올리고, 알리바바는 한 번도 공개하지 않았던 2.4조 파라미터 가중치를 풀었으며, 지푸는 같은 기반으로 코딩 점수를 수 배 끌어올렸습니다. 싸움을 싼 가격이 아니라 가격 결정권으로 옮긴 신호입니다.

겉으로는 모순입니다. DeepSeek는 일부 과금 항목을 최대 1100% 이상 올렸고, 같은 주 알리바바는 Qwen-Max급 2.4조 파라미터 가중치를 처음 공개했으며, 지푸는 GLM-5.2와 같은 7430억 기반 위에서 GLM-5.3을 내고 후학습만으로 코딩 벤치를 약 6배 올렸습니다. 세 회사의 수는 다르지만 신호는 같습니다. 중국 플래그십은 최저가 경쟁에서 가격 결정권 경쟁으로 이동합니다. 제품 출시 맥락은 Qwen3.8-Max 출시 기록V4 Flash 정식판 리뷰를 먼저 보고, 이 글은 가중치 공개, 시간대 인상, 동일 기반 도약을 이어서 봅니다.

00타임라인: 이 2주에 일어난 일

날짜사건
7월 16일문샷 AI가 Kimi K3(2.8조 파라미터)를 공개. 이미 미국 안보 관심을 불렀음
8월 2–3일알리바바가 Qwen3.8-Max를 예고하고 클라우드 API를 올림
8월 10일Meta가 Muse Glimmer(300억, Apache 2.0)를 내고 플래그십 Muse Spark 1.2 가중치 공개를 예고
8월 12일알리바바가 ModelScope/Hugging Face에 Qwen3.8-2.4T-A95B를 올림. 같은 날 xAI가 Grok 4.6 출하
8월 13일DeepSeek-V4-Pro 정식판과 8월 17일 인상 발표. Google은 인하한 Gemini 3.7 Flash 출하
8월 14일지푸가 GLM-5.3 발표. 기반은 GLM-5.2와 같은 7430억
8월 17일 0시(베이징)DeepSeek 새 요금 발효

더 넓히면 7월 30일 OpenAI는 가장 싼 GPT-5.6 Luna를 80% 내렸고, 8월 6–7일에는 무료 사용자 기본 모델로 두고 텍스트를 무제한으로 열었습니다. 중국 쪽이 인상과 공개를 더하는 같은 시간에 미국 쪽은 무료와 인하를 더합니다. 우연이 아니라 같은 가격 전쟁의 양면입니다. Luna 인하는 GPT-5.6 인하 정리를 참고하십시오.

함정이번 주 구매팀이 틀리기 쉬운 지점

  • 「1100%」를 전체 청구서로 읽습니다. 11배, 1100%, 350%는 모두 맞을 수 있습니다. 대상은 캐시 히트 입력, 출력, 캐시 미스 입력입니다.
  • 공식 API가 항상 가장 싸다고 가정합니다. 피크에는 GMI Cloud, Novita 등 재판매가 공식 피크보다 싼 경우가 있습니다.
  • 오픈 웨이트를 Apache 2.0과 동일시합니다. Qwen3.8-Max는 맞춤 Qwen3.8-Max License입니다. 대형 MaaS/AI 업무 도우미는 별도 상업 허가가 필요합니다.
  • 「미·유럽 다운로드 금지」 소문을 반복합니다. 공개 조항에 지역 제한은 없습니다. 제약은 매출과 표기입니다.
  • GLM-5.3을 새 기반으로 적습니다. 7430억은 5.2와 같습니다. 상승은 후학습이고 수치는 벤더 자체 측정입니다.
  • 「중국산=최저가」로 예산을 짭니다. 오프피크 DeepSeek는 여전히 Claude Opus 5보다 싸지만, Qwen 국제 API와 Luna가 적어도 한 축에서 더 낮습니다.

01핵심 수치

DeepSeek 인상 명세(8월 17일 0시 발효. 피크는 베이징 9–12시, 14–18시). 단위는 100만 tokens당입니다.

과금 항목인상 전오프피크(신)피크(신)피크 상승
V4-Flash 캐시 히트 입력¥0.02¥0.05¥0.10약 400%
V4-Flash 캐시 미스 입력¥1.0¥1.5¥3.0200%
V4-Flash 출력¥2.0¥4.5¥9.0350%
V4-Pro 캐시 히트 입력¥0.025¥0.15¥0.30약 1100%
V4-Pro 캐시 미스 입력¥3.0¥4.5¥9.0200%
V4-Pro 출력¥6.0¥13.5¥27.0350%
인용 가능한 사실 #1: DeepSeek 공식 공고를 华尔街见闻, IT之家, V2EX로 교차 확인했습니다. 1100%는 피크 캐시 히트 입력입니다. 실제 청구를 움직이는 것은 출력 350%와 캐시 미스 입력입니다. 월 약 8400만 tokens, 주로 오프피크, 히트 약 절반인 헤비 사용은 청구가 약 1.8배라는 추산이 있습니다.

Qwen3.8-2.4T-A95B(Qwen3.8-Max 공개 가중치) 사양입니다.

항목내용
파라미터총 2.4조, 활성 950억(MoE, 전문가 512, 라우팅 10+공유 1)
컨텍스트공개 가중치 원생 26.2만 tokens, 약 101만까지 확장. 클라우드 Max 기본 100만
공개 리듬8월 2일 예고 → 8월 3일 API → 8월 12일 가중치
국제 API입력 $2/M, 출력 $6/M
라이선스Apache 2.0 아님. 맞춤 Qwen3.8-Max License
의미알리바바 첫 Max급 공개. 3.5/3.6/3.7 Max는 API만

GLM-5.3 대 GLM-5.2. 기반은 같고 후학습만입니다. 수치는 지푸 자체 측정이며 독립 재측정은 아직 없습니다.

벤치마크GLM-5.2GLM-5.3변화
Terminal-Bench 3.04.6%28.3%+23.7
DeepSWE v1.146.2%66.9%+20.7
Agents' Last Exam(CLI)23.8%28.5%+4.7
CyberGym77.2%84.5%+7.3
AutomationBench26.2%48.2%+22.0
인용 가능한 사실 #2: Terminal-Bench 3.0에서 GPT-5.6 Sol(34.6%)과 Claude Fable 5(33.7%)에는 아직 못 미칩니다. 오픈 웨이트 1군이지 전면 1위가 아닙니다. Qwen 국제 API는 입력 $2 / 출력 $6입니다.

02세 가지 전략의 논리

DeepSeek: 종일 저가에서 시간대 요금으로. 본질은 연산 부족의 가시화입니다. 「마진 압박에 굴복했다」고 읽기 쉽습니다. 구조를 보면 연산 제약을 가격표에 처음 쓴 움직임에 가깝습니다. 예전 종일 저가는 사용자 규모를 사는 도구였고, GPU가 수요를 따라가는 한 유지됐습니다. 호출이 지수로 늘고 용량이 못 따라가면 「더 유연한 워크로드 스케줄링을 권장한다」는 문장은 「피크 연산이 부족하니 직접 비껴 가라」는 뜻입니다.

국제 보도가 놓친 세부: 피크에는 공식 API가 GMI Cloud, Novita 등 재판매보다 비쌉니다. 「공식이 항상 가장 싸다」는 평판이 처음 깨졌습니다.

알리바바: 가중치로 생태계를 사고, 맞춤 라이선스로 매출 천장을 지킵니다. 2.4조 체크포인트를 무료로 풀면서 소형 Qwen의 Apache 2.0이 아닌 맞춤 조항을 붙였습니다. 연속 12개월 MaaS 또는 AI 업무 도우미 매출이 5000만 달러를 넘으면 별도 상업 허가가 필요하고, 월간 활성 1억 또는 월 매출 2000만 달러 초과 제품은 모델명을 눈에 띄게 표시해야 합니다.

해외 기업 구매자의 「중국산 모델」 주저를 가중치로 완화하고, 그 위에 추론 사업을 세울 수 있는 소수 대고객에는 협상권을 남깁니다. 제한 없는 Apache 2.0의 Muse Glimmer와 「오픈」의 의미가 다릅니다. 미국·EU·영국·한국 다운로드 금지 소문은 거짓이며, 공개 조항에 지역 조항은 없습니다.

GLM-5.3: 새 기반이 아니라 더 큰 후학습 베팅입니다. 점수가 아니라 방법이 핵심입니다. 기반은 GLM-5.2와 같은 7430억, 재사전학습 없음, 강화학습 환경 확대만으로 Terminal-Bench 3.0이 4.6%에서 28.3%로 약 6배입니다. 사전학습 Scaling Law의 한계 수익이 둔화하는 동안 후학습 RL 규모는 재훈련보다 낮은 비용 바닥의 레버가 되고, 중규모 랩도 에이전트/코딩 격차를 좁힐 수 있습니다.

인용 가능한 사실 #3: Qwen 라이선스 임계값은 12개월 5000만 달러 초과 MaaS/AI 업무 도우미는 별도 허가, MAU 1억 또는 월 매출 2000만 달러 초과는 모델명 표시입니다. GLM-5.3 Terminal-Bench 3.0은 4.6%→28.3%(+23.7, 약 6배)입니다.

03비교: 인상 후에도 DeepSeek가 가장 싼 플래그십인가

모델입력(100만 tokens)출력(100만 tokens)가중치 공개
DeepSeek V4-Pro(피크)¥9.0(약 $1.26)¥27.0(약 $3.78)없음
DeepSeek V4-Pro(오프피크)¥4.5(약 $0.63)¥13.5(약 $1.89)없음
Qwen3.8-Max(국제 API)$2$6있음(맞춤 라이선스)
OpenAI GPT-5.6 Luna$0.20$1.20없음
Claude Opus 5(알리바바 배수 추산)약 $5약 $25없음

환율은 약 ¥7.15/$1입니다. 오프피크 V4-Pro는 여전히 Claude Opus 5보다 분명히 싸지만 전장 최저가는 아닙니다. Qwen 국제 가격과 Luna가 오프피크 DeepSeek를 밑돕니다. 「중국산=최저가」는 2025년과 2026년 초에는 맞았어도 지금은 안전한 가정이 아닙니다.

04쟁점과 미검증 세부

  • 상승률 기준이 섞입니다. 11배, 1100%, 350%는 다른 과금 축입니다. 헤드라인만 옮기지 마십시오.
  • 전오 M890 국산 칩 추론은 여러 중국 금융 매체에 나오지만 알리바바 공식 독립 기술 문서나 제3자 벤치는 확인되지 않았습니다. 독립 미검증으로 두십시오.
  • GLM-5.3이 Cursor 심각 취약점을 발견했다는 말은 VentureBeat와 지푸 측 공개입니다. 기술 세부는 비공개이며 벤더 일방 공개입니다.
  • 중국 상무부가 AI/반도체 보복 수출 통제를 준비한다는 보도는 공식 확인이 없고 추측/소문입니다. 배경으로만 두십시오.

05배경: 동시에 달리는 두 가격 전쟁

지난 한 달 중국 상위 랩은 국내 금융 매체가 「일주일에 모델 세 번」이라 부르는 밀도로 출하했습니다. DeepSeek, 알리바바, 지푸에 더해 7월 16일 공개된 Kimi K3(2.8조)와 MiniMax H3가 앞섰습니다. 중국어 보도는 「중국 오픈 웨이트가 세계 AI 재가격을 압박한다」고 강하게 프레임합니다.

미국 쪽은 소비 층에서 반대로 달립니다. OpenAI는 7월 30일 최저 구간을 80% 내리고 일주일 뒤 무료·무제한으로 만들었으며, Google은 8월 13일 3주 전 모델의 반값으로 코딩 중심 모델을 냈습니다. 중국은 플래그십 가중치 공개와 연산 제약 쪽의 단계 인상, 미국은 소비단 무료와 인하입니다. 둘 다 실제 전략이고 최적화하는 깔때기 위치가 다릅니다.

지정학 층도 조심히 적어야 합니다. Kimi K3 공개는 이미 미국 안보 심사를 불렀고, 알리바바가 이 창에서 2.4조 플래그십을 연 것을 규제 강화 전에 국제 존재감과 「기술 대등」 서사를 고정하려는 움직임으로 읽는 분석이 있습니다. 확정 사실이 아니라 해석이지만, 영어 테크 기사가 개별 제품 뉴스로 잘라 보기 쉬운 맥락의 일부입니다.

066단계: 다음 청구서 전에 스택을 다시 가격 매기기

  1. 01
    베이징 피크 창으로 트래픽을 나눕니다. 9–12시와 14–18시를 피크, 나머지를 오프피크로 둡니다. 미국 주간은 대부분 오프피크, 중국 평일 주간은 피크에 겹칩니다.
  2. 02
    캐시 히트율을 별도 KPI로 둡니다. 1100%는 히트 입력입니다. 청구를 움직이는 것은 출력 350%와 미스 입력 200%입니다. 헤비 사용 추산은 약 1.8배입니다.
  3. 03
    공식, 재판매, Qwen, Luna를 한 표에 놓습니다. 피크에는 DeepSeek 공식, GMI Cloud/Novita, Qwen 국제($2/$6), GPT-5.6 Luna($0.20/$1.20)를 비교하고 「공식이 최저」를 버립니다.
  4. 04
    LICENSE를 읽고 가중치를 받습니다. 개인과 내부 사용은 거의 영향이 없습니다. 12개월 5000만 달러 초과 MaaS/AI 업무 도우미는 별도 허가, MAU 1억 또는 월 매출 2000만 달러 초과는 모델명 표시가 필요합니다. 지역 금지는 없습니다.
  5. 05
    GLM-5.3은 후학습 업그레이드로 다룹니다. 기반은 7430억입니다. Terminal-Bench 3.0은 Sol 34.6%, Fable 5 33.7%에 못 미칩니다. 독립 재측정 전에 「오픈 1위」를 품의에 쓰지 마십시오.
  6. 06
    셀프호스트 평가는 전용 호스트에서 합니다. 2.4조 전개, 오프피크 배치, GLM 후학습 벤치 재현에는 안정 프로세스와 테넌트 경계가 필요합니다. 요금 페이지에서 전용 Apple Silicon/클라우드 Mac을 산정하고 주문 페이지에서 오프라인 추론을 시험한 뒤 중단율로 증설을 결정하십시오.
인상 주 최소 점검(개념)
[ ] 베이징 피크/오프피크로 분할
[ ] 히트율과 출력 token 별도 기장
[ ] 공식 피크 vs 재판매 vs Qwen vs Luna
[ ] Qwen3.8-Max License 매출 임계값 확인
[ ] GLM-5.3: 자체 측정, 제3자 대기
[ ] 셀프호스트 면과 운영 비밀 물리 분리

07정리와 FAQ

DeepSeek는 연산 부족을 가격표에 썼고, 알리바바는 플래그십 가중치로 인지도를 사고 맞춤 라이선스로 현금층을 지켰으며, 지푸는 같은 기반으로 후학습 규모가 레버임을 보였습니다. 공유 분 과금 풀, 과잉 판매 VPS, 책상 아래 한 대는 대역 흔들림, 이웃 선점, 장시간 연결 끊김으로 오프피크 배치와 로컬 평가의 감사 가능성을 없앱니다. 더 안정적인 운영/평가 면에는 NUKCLOUD 다지역 베어메탈 Mac / 클라우드 Mac 노드가 전용 Apple Silicon과 분명한 테넌트 경계를 제공합니다. 요금 페이지에서 사양을 맞추고 주문 페이지에서 시험하십시오.

인상 후 DeepSeek는 GPT-5.6이나 Claude보다 비쌉니까?
오프피크는 여전히 Claude Opus 5보다 싸지만 전체 최저가는 아닙니다. GPT-5.6 Luna($0.20/$1.20)와 Qwen 국제($2/$6)는 적어도 한 축에서 새 오프피크를 밑돕니다. 플래그십급으로는 아직 상대적으로 싸지만 무조건 최저가는 아닙니다.
Qwen3.8-Max 공개 가중치를 상업 제품에서 무료로 쓸 수 있습니까?
개인 프로젝트와 내부 사용은 거의 영향이 없습니다. 연속 12개월 MaaS 또는 AI 업무 도우미 매출이 5000만 달러를 넘는 경우에만 알리바바와 별도 상업 허가가 필요합니다.
미국·EU·영국 사용자는 Qwen3.8-Max를 받을 수 없습니까?
아닙니다. 그 주장은 거짓입니다. 공개 라이선스에 지역 제한은 없습니다. 제약은 매출 규모이지 소재지가 아닙니다.
GLM-5.3과 5.2의 실제 차이는 무엇입니까?
기반은 같은 7430억입니다. Terminal-Bench 3.0에서 약 6배 상승은 후학습 강화학습 환경 확대만으로 이뤄졌고 기반 재훈련은 없습니다.
Meta는 플래그십도 정말 공개합니까? Glimmer만으로는 부족하지 않습니까?
아직입니다. Muse Glimmer는 300억 증류 모델입니다. Zuckerberg는 폐쇄 Muse Spark 1.2 가중치를 「곧」이라고 했지만 이 글을 쓰는 시점에는 나오지 않았습니다. 의도 표명이지 확정 사실이 아닙니다.

출처: DeepSeek 공식 가격 공고(华尔街见闻, IT之家, AIGC.cn, V2EX 교차 확인), 알리바바 Qwen 공식 저장소(Hugging Face/ModelScope)와 SCMP 라이선스 보도, 지푸(Z.ai) GLM-5.3 공식 기술 페이지 및 VentureBeat/StableLearn, Meta AI Research 공식 블로그와 VentureBeat의 Muse Glimmer 보도, 第一财经·搜狐财经 등 중국 측 공개 밀도 보도. 가격·라이선스·벤치는 공개 시점 정보입니다. 재게시 전 공식을 다시 확인하고, 국산 칩·Cursor 취약점·수출 통제 소문은 독립 미검증으로 다루십시오.