DeepSeek 調價、阿里開源 2.4 兆旗艦、GLM-5.3 躍升:中國大模型 8 月為何集體變陣?

8 月 12 日至 17 日五天內,DeepSeek 以尖峰/離峰重寫 API 價目,阿里放出從未公開的 2.4 兆參數旗艦權重,智譜則在同一基座上以後訓練把編程基準拉高數倍。三家路徑不同,共同爭的是定價權。

五天之內,中國三家頭部實驗室做出表面矛盾、實則呼應的三步:DeepSeek 宣布部分計費項調升最高逾 1100%;阿里把從未開源的 Qwen-Max 級 2.4 兆參數權重放到 ModelScope 與 Hugging Face;智譜發布 GLM-5.3,基座仍是 GLM-5.2 的 7430 億參數,分數幾乎全靠後訓練。訊號只有一個——國產大模型正從「比誰更便宜」轉成「比誰握得住定價權」。產品發布側可對照本站 Qwen3.8-Max 上線紀錄V4 Flash 正式版評測,本文補上權重落地、分時調價與同基座躍升。

00時間線:這兩週發生了什麼

日期事件
7 月 16 日月之暗面 Kimi K3(2.8 兆參數)開源,此前已引發美方安全關注
8 月 2–3 日阿里 Qwen3.8-Max 先預告、後上線雲端 API
8 月 10 日Meta 發布開源模型 Muse Glimmer(300 億參數,Apache 2.0),預告旗艦 Muse Spark 1.2 權重「即將開源」
8 月 12 日阿里於 ModelScope/Hugging Face 放出 Qwen3.8-2.4T-A95B 開源權重;同日 xAI 發布 Grok 4.6
8 月 13 日DeepSeek-V4-Pro 正式版上線,同步公告 8 月 17 日起 API 調價;Google 發布降價的 Gemini 3.7 Flash
8 月 14 日智譜發布 GLM-5.3,沿用 GLM-5.2 的 7430 億參數基座
8 月 17 日 0 時(北京時間)DeepSeek 新定價正式生效

再往前看:7 月 30 日 OpenAI 已把最便宜檔 GPT-5.6 Luna 降價 80%,8 月 6–7 日再把 Luna 設為免費用戶預設模型並開放無限文字對話。中國廠商在調價與開源上做加法的同一時間,美國廠商在免費與降價上做加法。這不是巧合,而是同一場定價博弈的兩面。Luna 那一輪見本站 GPT-5.6 降價整理

痛點採購與工程這週最容易誤判之處

  • 把「漲 1100%」當成整張帳單:媒體分別寫「漲 11 倍」「逾 1100%」「漲 350%」,對應快取命中輸入、輸出、快取未命中輸入,不是同一列。
  • 預設官方 API 永遠最便宜:尖峰時段 DeepSeek 官方價已高於部分轉售平台(如 GMI Cloud、Novita 目前報價仍低於官方尖峰價)。
  • 把開源權重當成 Apache 2.0:Qwen3.8-Max 使用自訂「Qwen3.8-Max License」,大型 MaaS/AI 工作助手仍須另談商業授權。
  • 相信「禁止美歐下載」謠言:官方授權條款原文沒有地域限制,限制的是營收門檻與介面標示。
  • 把 GLM-5.3 當成新基座:7430 億參數與 5.2 完全相同,分數來自後訓練,且為廠商自測、尚無獨立複測。
  • 預算仍寫「國產=最便宜」:調價後 DeepSeek 離峰價仍低於 Claude Opus 5,但已被 Qwen 國際站與 OpenAI Luna 在至少一個維度擊穿。

01核心數據一覽

DeepSeek 調價明細(8 月 17 日 0 時起;北京時間 9–12 時、14–18 時為尖峰),單位為每百萬 tokens:

計費項調價前離峰(新)尖峰(新)漲幅(尖峰)
V4-Flash 快取命中輸入¥0.02¥0.05¥0.10約 400%
V4-Flash 快取未命中輸入¥1.0¥1.5¥3.0200%
V4-Flash 輸出¥2.0¥4.5¥9.0350%
V4-Pro 快取命中輸入¥0.025¥0.15¥0.30約 1100%
V4-Pro 快取未命中輸入¥3.0¥4.5¥9.0200%
V4-Pro 輸出¥6.0¥13.5¥27.0350%
可引用資料 #1:數據來自 DeepSeek 官方公告,經華爾街見聞、IT之家、V2EX 交叉核對。快取命中漲幅最大(最高約 12 倍/1100%+),絕對金額仍小;重度用戶真正受影響的是輸出(350%)與快取未命中輸入。有分析估算重度負載(約 8400 萬 tokens/月、多在離峰、約一半命中)帳單約 1.8 倍。

Qwen3.8-2.4T-A95B(Qwen3.8-Max 開源權重)規格:

項目數據
參數規模總參數 2.4 兆,啟用 950 億(MoE,512 專家,10 路由 + 1 共享)
上下文視窗開源權重原生 26.2 萬 tokens,可擴至約 101 萬;雲端 Max 預設 100 萬
發布節奏8 月 2 日預告 → 8 月 3 日 API 上線 → 8 月 12 日開源權重
API 定價(國際站)輸入 $2/M tokens,輸出 $6/M tokens
授權非 Apache 2.0,自訂「Qwen3.8-Max License」
意義阿里首次開源 Max 級旗艦;Qwen3.5/3.6/3.7 Max 均為閉源 API

GLM-5.3 對照 GLM-5.2:同基座、純後訓練(智譜官方自測,尚無獨立第三方複測):

基準測試GLM-5.2GLM-5.3變化
Terminal-Bench 3.04.6%28.3%+23.7
DeepSWE v1.146.2%66.9%+20.7
Agents' Last Exam(CLI)23.8%28.5%+4.7
CyberGym77.2%84.5%+7.3
AutomationBench26.2%48.2%+22.0
可引用資料 #2:GLM-5.3 在 Terminal-Bench 3.0 仍落後 GPT-5.6 Sol(34.6%)與 Claude Fable 5(33.7%),屬開源第一梯隊而非全面登頂。Qwen 國際站 API 為輸入 $2/輸出 $6。

02三種打法,三種邏輯

DeepSeek:從統一低價到分時定價,本質是算力缺口被寫進價目表。最容易被讀成「跟漲」,結構上更像把算力帳單透明化。過去不分時段的貼地價,靠低價換規模、再靠快取命中與錯峰攤薄成本。呼叫量指數成長、GPU 產能跟不上時,這套撐不住——公告裡「鼓勵更靈活的工作負載調度」,翻譯就是「尖峰算力不夠,請你自己錯峰」。

一個常被國際報導略過的細節:調價後,尖峰時段官方 API 已高於部分轉售(GMI Cloud、Novita 等目前報價仍低於官方尖峰)。「官方永遠最便宜」這條護城河第一次被打破。

阿里:開源權重圈生態,自訂授權圈收入。Qwen3.8-Max 開源不是單純慈善。阿里同時做兩件事:公開 2.4 兆參數權重,並配上不同於以往 Apache 2.0 的自訂授權——過去 12 個月「模型即服務」或「AI 工作助手」累計收入逾 5000 萬美元,須另向阿里申請商業授權;月活逾 1 億或月收入逾 2000 萬美元的產品,須在介面顯著標示模型名稱。

邏輯是:用開源換開發者生態與海外口碑,在真正能產生現金流的大客戶身上保留議價權。這與 Meta Muse Glimmer(完全 Apache 2.0、無附加條款)的「開源程度」不是同一量級。網傳授權禁止美國、歐盟、英國、韓國用戶下載,與原文不符——官方條款沒有任何地域限制。

智譜 GLM-5.3:不換基座,只換後訓練配方。值得看的不是分數本身,而是拿分方法:基座與 GLM-5.2 完全相同(7430 億),沒有重新預訓練,只靠擴大強化學習環境規模,就把 Terminal-Bench 3.0 從 4.6% 拉到 28.3%,接近 6 倍。預訓練 Scaling Law 邊際收益放緩後,「後訓練強化學習規模化」成為門檻更低的性能槓桿,中小型實驗室也有機會靠精修追上頭部模型。

可引用資料 #3:Qwen 授權兩條硬門檻——MaaS/AI 工作助手年營收逾 5000 萬美元須另授權;月活逾 1 億或月收入逾 2000 萬美元須顯著標示。GLM-5.3 Terminal-Bench 3.0:4.6% → 28.3%(+23.7,約 6 倍)。

03橫向比價:調價後 DeepSeek 還是最便宜的旗艦嗎?

模型輸入(每百萬 tokens)輸出(每百萬 tokens)開源程度
DeepSeek V4-Pro(尖峰)¥9.0(約 $1.26)¥27.0(約 $3.78)權重未開源
DeepSeek V4-Pro(離峰)¥4.5(約 $0.63)¥13.5(約 $1.89)權重未開源
Qwen3.8-Max(國際站)$2$6開源(自訂授權)
OpenAI GPT-5.6 Luna$0.20$1.20閉源
Claude Opus 5(依阿里披露倍數推算)約 $5約 $25閉源

匯率按約 ¥7.15/$1 估算,僅供參考。調價後 DeepSeek V4-Pro 離峰仍明顯低於 Claude Opus 5,但已不是全場最低——阿里國際站 Qwen3.8-Max 與 OpenAI Luna 都比 DeepSeek 離峰更便宜。「國產=最便宜」正在瓦解,價格競爭進入分層。

04爭議點與未經驗證細節

  • 漲幅口徑混亂:「11 倍」「逾 1100%」「350%」都對,但對應不同計費維度,閱讀時須看清是哪一項。
  • 阿里「震悟 M890 國產晶片」服務:多家中文財經媒體稱 Qwen3.8-Max 部分推理跑在震悟 M890 與「盤古 AL128」超節點,目前僅見中文媒體轉述,未見阿里官方獨立技術文件或第三方基準確認,應標為未經獨立驗證
  • GLM-5.3「發現 Cursor 嚴重漏洞」:來自 VentureBeat 與智譜方面透露,漏洞細節未公開,屬廠商單方面披露,有待第三方安全機構確認。
  • 中國商務部可能醞釀反制出口管制:部分報道提及官方可能針對 AI/半導體技術醞釀反制措施,目前未見官方正式確認,屬媒體推測/傳聞,僅供背景。

05影響與背景:一場兩線戰爭

過去一個月,中國頭部模型呈現「一週三更」——DeepSeek、阿里、智譜之外,還有月之暗面 Kimi K3(7 月 16 日,2.8 兆參數開源)、MiniMax H3 輪番登場。國內財經媒體普遍解讀為「中國開源模型密集發布,倒逼全球 AI 重新定價」。

美國廠商走另一條路:OpenAI 7 月 30 日大幅降價(Luna 降 80%),8 月 6–7 日把降價後的 Luna 設為免費預設並開放無限文字對話;Google 8 月 13 日發布價格減半的 Gemini 3.7 Flash。中國側是「開源旗艦+梯度調價」,美國側是「消費端免費+降價防守」。兩條路徑同時發生,把 2026 年 8 月變成定價邏輯重構的節點。

地緣層面:Kimi K3 開源已引發美方安全審查關注,阿里選在這個窗口開源 2.4 兆旗艦,被部分分析讀成「在潛在監管收緊前,搶先鞏固國際影響力與技術對等敘事」。此判斷帶推測性質,卻是理解這波開源潮時機時不應忽略的背景。

06六步落地:調價週如何重算帳單與宿主

  1. 01
    先畫尖峰視窗:把既有呼叫依北京時間 9–12 時、14–18 時拆成尖峰/離峰。美國團隊白天多落在離峰,中國工作日白天正好撞尖峰。
  2. 02
    單獨統計快取命中率:headline 1100% 打在快取命中輸入,絕對金額小;真正抬帳單的是輸出 350% 與快取未命中 200%。重度用戶實測帳單約 1.8 倍。
  3. 03
    官方、轉售、Qwen、Luna 並列:尖峰時段把 DeepSeek 官方、GMI Cloud/Novita、Qwen 國際站($2/$6)與 GPT-5.6 Luna($0.20/$1.20)放進同一張表,禁止預設「官方最便宜」。
  4. 04
    讀完 LICENSE 再下載權重:個人與內部使用基本不受影響;MaaS/AI 工作助手且過去 12 個月該業務累計收入逾 5000 萬美元須另授權;月活逾 1 億或月收入逾 2000 萬美元須顯著標示。不要信「禁美歐下載」。
  5. 05
    把 GLM-5.3 當後訓練升級:基座仍是 7430 億,分數為官方自測;Terminal-Bench 3.0 仍落後 Sol 34.6% 與 Fable 5 33.7%。等獨立複測再把「開源第一」寫進選型結論。
  6. 06
    自託管與評測用獨占宿主:2.4 兆權重本機拉起、錯峰批次、復現 GLM 後訓練評測,都需要穩定行程與清晰租戶邊界。先在 定價頁 估算獨占 Apple Silicon/雲端 Mac 成本,再經 訂購頁 試跑離線推理與帳單對照,用中斷率決定是否擴容。
調價週最小核對清單(概念)
[ ] 呼叫依北京時間尖峰/離峰分桶
[ ] 快取命中率與輸出 token 單獨記帳
[ ] 官方尖峰價 vs 轉售 vs Qwen vs Luna
[ ] Qwen3.8-Max License:營收門檻已讀
[ ] GLM-5.3:自測分數,等待第三方
[ ] 自託管平面與生產憑證實體分離

07總結與 FAQ

DeepSeek 用分時調價把算力缺口寫進價目表,阿里用開源權重換生態、用自訂授權留住大客戶議價權,智譜用同一基座證明後訓練規模化本身就是槓桿。共享分鐘池、超賣 VPS 或桌下機器常見的頻寬抖動、鄰居搶占與長連線中斷,會直接吃掉錯峰批次、本機開源評測與帳單對照的可稽核性。對更穩定的生產與評測環境,NUKCLOUD 多區域裸金屬 Mac/雲端 Mac 節點提供獨占 Apple Silicon 與清晰租戶邊界,可在 定價頁 對照規格並經 訂購頁 試跑。

DeepSeek 這次調價之後,是不是以後用起來都更貴?
要分場景。若呼叫多落在離峰(非北京時間 9–12 時、14–18 時),且快取命中率較高,實際漲幅會明顯低於「350%」「1100%」這類標題數字(有分析測算重度用戶帳單約 1.8 倍);若集中在尖峰且命中率低,漲幅會接近甚至達到標題數字。
阿里開源的 Qwen3.8-Max,個人開發者能免費商用嗎?
個人開發者與內部使用基本不受影響。若業務是「模型即服務」或「AI 工作助手」,且過去 12 個月該業務累計收入超過 5000 萬美元,須另向阿里申請商業授權;產品月活逾 1 億或月收入逾 2000 萬美元,須在介面顯著標示模型名稱。
GLM-5.3 和 GLM-5.2 是同一個模型嗎?為什麼突然變強這麼多?
底層基座確實完全相同(7430 億參數),智譜沒有重新訓練。分數大幅提升是因為後訓練階段大幅擴大強化學習環境規模,說明「後訓練規模化」本身就是獨立、有效的性能槓桿,不一定要重新預訓練更大的基座。
網傳阿里的 Qwen3.8-Max 授權禁止美國、歐盟用戶下載,是真的嗎?
不是。這是不實資訊,官方授權原文沒有任何地域限制,主要限制針對超過特定營收規模的商業化服務,與用戶所在地區無關。
Meta 這次開源 Muse Glimmer,是不是代表 Llama 時代的開源精神回來了?
目前只能算部分回歸。Muse Glimmer 本身只是 300 億參數的蒸餾小模型,真正的旗艦閉源模型 Muse Spark 1.2 尚未開源,祖克柏只是預告未來會開放權重。若這一步落地,才稱得上美國廠商首次把旗艦級閉源模型轉為開源,目前仍須持續觀察。

資料來源:DeepSeek 官方調價公告,經華爾街見聞、IT之家、AIGC 工具導航、V2EX 交叉核對;阿里 Qwen 官方模型倉庫(Hugging Face/ModelScope)及南華早報(SCMP)關於授權條款的報道;智譜(Z.ai)GLM-5.3 官方技術頁面及 VentureBeat、StableLearn 相關報道;Meta AI Research 官方博客及 VentureBeat 關於 Muse Glimmer 的報道;第一財經、搜狐財經等關於中國大模型密集發布節奏的綜合報道。以上截至發稿前公開資訊整理,價格、授權條款、基準分數建議發布前再核最新官方公告;晶片服務、安全漏洞、出口管制傳聞已在正文標為未經獨立驗證。