8月12日到17日的五天里,中国大模型圈接连做了三件互相矛盾又互相呼应的事:DeepSeek宣布API涨价最高超1100%,阿里同步把从未开源过的Qwen-Max级旗舰模型2.4万亿参数权重放出来,智谱则用同一个基座模型、纯靠后训练把编程测试成绩拉高数倍。三家公司、三种打法,共同指向同一个信号——国产大模型正在从「卷价格」转向「卷定价权」。发布前可对照本站 Qwen3.8-Max 发布解读 与 DeepSeek V4 Flash 正式版评测,本文补上开源落地、分时涨价与 GLM-5.3 同基座跃升这三步。
00发生了什么:一张时间线看懂这两周
| 日期 | 事件 |
|---|---|
| 7月16日 | 月之暗面Kimi K3(2.8万亿参数)开源,此前已引发美方安全关注 |
| 8月2日-3日 | 阿里Qwen3.8-Max先预告、后上线云端API |
| 8月10日 | Meta发布开源模型Muse Glimmer(300亿参数,Apache 2.0),预告旗舰Muse Spark 1.2权重「即将开源」 |
| 8月12日 | 阿里正式在ModelScope/Hugging Face放出Qwen3.8-2.4T-A95B开源权重;同日xAI发布Grok 4.6 |
| 8月13日 | DeepSeek-V4-Pro正式版上线,同步公告8月17日起API涨价;谷歌发布降价的Gemini 3.7 Flash |
| 8月14日 | 智谱发布GLM-5.3,沿用GLM-5.2的7430亿参数基座 |
| 8月17日 0点(北京时间) | DeepSeek新定价正式生效 |
把镜头拉远一点:7月30日OpenAI已经把最便宜档的GPT-5.6 Luna降价80%,8月6日-7日又把Luna设为免费用户默认模型并开放无限文本对话——也就是说,中国厂商在涨价和开源上做加法的同一时间,美国厂商正在免费和降价上做加法。这不是巧合,而是同一场定价博弈的两个侧面。Luna 那一轮可另读本站 GPT-5.6 降价盘点。
痛点选型团队这周最容易踩的坑
涨价、开源、后训练三条新闻叠在一起,最容易把采购和工程判断带偏。下面六条是内部评审里反复出现的误读:
- 把「涨1100%」当成整张账单:不同媒体分别报「涨11倍」「涨超1100%」「涨350%」,对应的是缓存命中输入、输出、缓存未命中输入等不同计费项,不是同一张发票。
- 以为官方 API 永远最便宜:高峰时段 DeepSeek 官方价已反超部分第三方转售平台(如 GMI Cloud、Novita 目前报价仍低于官方高峰价)。
- 把开源权重当成 Apache 2.0:Qwen3.8-Max 用的是自定义「Qwen3.8-Max License」,大客户仍要谈商业授权。
- 相信「禁美欧下载」谣言:官方许可证原文并无地域限制,限制的是营收规模与产品标注。
- 把 GLM-5.3 当成新基座:7430亿参数与 GLM-5.2 完全相同,分数来自后训练,且为厂商自测、尚无独立复测。
- 继续用「国产=最便宜」做预算:涨价后 DeepSeek 空闲价仍低于 Claude Opus 5,但已被 Qwen 国际站与 OpenAI Luna 在至少一维上击穿。
01核心数据一览
DeepSeek涨价明细(8月17日0点起,北京时间9-12点、14-18点为高峰时段),单位为每百万tokens:
| 计费项 | 涨价前 | 空闲时段(新) | 高峰时段(新) | 涨幅(高峰) |
|---|---|---|---|---|
| V4-Flash 缓存命中输入 | ¥0.02 | ¥0.05 | ¥0.10 | 约400% |
| V4-Flash 缓存未命中输入 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 输出 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro 缓存命中输入 | ¥0.025 | ¥0.15 | ¥0.30 | 约1100% |
| V4-Pro 缓存未命中输入 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 输出 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
Qwen3.8-2.4T-A95B(Qwen3.8-Max开源权重)关键规格:
| 项目 | 数据 |
|---|---|
| 参数规模 | 2.4万亿总参数,950亿激活参数(MoE,512个专家,10路由+1共享) |
| 上下文窗口 | 开源权重原生26.2万tokens,可扩展至约101万;云端Max版默认100万tokens |
| 发布节奏 | 8月2日预告→8月3日API上线→8月12日开源权重 |
| API定价(国际站) | 输入$2/M tokens,输出$6/M tokens |
| 许可证 | 非Apache 2.0,自定义「Qwen3.8-Max License」 |
| 意义 | 阿里历史上首次把Max级(旗舰)模型开源,此前Qwen3.5/3.6/3.7 Max均为闭源API |
GLM-5.3 vs GLM-5.2:同基座,纯靠后训练(智谱官方自测,尚无独立第三方复测):
| 基准测试 | GLM-5.2 | GLM-5.3 | 变化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
02深度拆解:三种打法,三种逻辑
1. DeepSeek:从「贴地价」到「分时定价」,本质是算力紧张的显性化。这次涨价最容易被误读为「跟涨」,但细看结构更像一次「算力账单透明化」。此前 DeepSeek 长期采用不分时段的统一低价,本质上是用低价换取用户规模,再靠缓存命中率和错峰调度摊薄成本。但当调用量指数级增长、GPU 产能跟不上时,这套模式撑不住了——涨价公告里「鼓励更灵活的工作负载调度」这句话,翻译过来就是「我们的算力已经不够用了,请你自己错峰」。
值得注意的细节:涨价后 DeepSeek 官方 API 的价格,在高峰时段已经反超部分第三方转售平台(如 GMI Cloud、Novita 等目前报价仍低于 DeepSeek 官方高峰价)。这意味着「官方价格最便宜」这个曾经支撑 DeepSeek 护城河的假设,第一次被打破。
2. 阿里:开源权重,圈住生态;自定义许可证,圈住收入。Qwen3.8-Max 的开源不是简单的「慈善」。阿里同时做了两件事:把 2.4 万亿参数的权重公开下载,同时给这个权重配了一份不同于以往 Apache 2.0 的自定义许可证——年营收超 5000 万美元的「模型即服务」或「AI 工作助手」业务,必须单独找阿里谈商业授权;月活超 1 亿或月收入超 2000 万美元的产品,必须在界面上显著展示模型名称。
这套组合拳的逻辑是:用开源换开发者生态和口碑(尤其是海外开发者,缓解「国产模型上不了台面」的印象),但在真正能产生现金流的大客户身上,继续保留议价权。这也是为什么它和 Meta 的 Muse Glimmer(完全 Apache 2.0,无附加条款)在「开源程度」上其实不是一个量级。需要澄清一个流传较广的谣言:网上一度传阿里的许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息,官方许可证原文中并无任何地域限制条款——这类谣言的传播速度往往比读一遍原始许可证文本更快,值得对信息源保持警惕。
3. 智谱 GLM-5.3:不换基座,只换「后训练配方」,说明规模化训练已不是唯一杠杆。GLM-5.3 最值得关注的不是分数本身,而是「怎么拿到这个分数」——基座模型和 GLM-5.2 完全相同(7430 亿参数),没有重新预训练,仅靠扩大强化学习环境规模做后训练,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍提升。这印证了行业内近半年逐渐清晰的一个趋势:当预训练的 Scaling Law 边际收益放缓,「后训练强化学习规模化」正在成为新的性能杠杆,而这个杠杆的门槛显著低于重新训练一个千亿级基座模型,意味着更多中小厂商也有机会靠「精装修」追上头部模型。
03横向对比:涨价之后,DeepSeek还是「最便宜的旗舰」吗?
| 模型 | 输入价格(每百万tokens) | 输出价格(每百万tokens) | 开源程度 |
|---|---|---|---|
| DeepSeek V4-Pro(高峰) | ¥9.0(约$1.26) | ¥27.0(约$3.78) | 权重未开源 |
| DeepSeek V4-Pro(空闲) | ¥4.5(约$0.63) | ¥13.5(约$1.89) | 权重未开源 |
| Qwen3.8-Max(国际站) | $2 | $6 | 开源(自定义许可证) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | 闭源 |
| Claude Opus 5(据阿里披露的倍数关系推算) | 约$5 | 约$25 | 闭源 |
换算汇率按约¥7.15/$1估算,仅供参考,实际以官方公告为准。可以看到:涨价后 DeepSeek V4-Pro 空闲时段价格仍明显低于 Claude Opus 5,但已经不再是「全场最低」——阿里国际站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的空闲价更便宜,说明「国产=最便宜」的等式正在瓦解,价格竞争进入分层阶段。
04争议点与需要注意的细节
- 涨价幅度的口径混乱:不同媒体分别报道「涨11倍」「涨超1100%」「涨350%」,这些说法都对,但对应的是不同计费维度(缓存命中输入 vs 输出 vs 缓存未命中输入),阅读时需要看清具体是哪一项。
- 阿里「震悟M890国产芯片」服务的说法:多家中文财经媒体报道称 Qwen3.8-Max 部分推理服务跑在阿里自研的震悟 M890 芯片和「盘古AL128」超节点上,但这一细节目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准测试确认,建议标注为未经独立验证的信息。
- GLM-5.3「发现Cursor严重漏洞」的说法:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开披露,真实性和影响范围有待第三方安全机构确认,属于厂商单方面披露。
- 中国商务部可能酝酿反制出口管制:部分报道提及中国官方可能针对 AI/半导体技术酝酿反制性出口管制措施,这一说法目前未见官方正式确认,属于媒体推测/传闻性质,仅供背景参考。
05影响与背景:这不是孤立事件,而是一场「两线战争」
把这几件事放进更大的叙事里看:过去一个月,中国头部模型厂商呈现出「一周三更」的密集发布节奏——DeepSeek、阿里、智谱之外,还有月之暗面 Kimi K3(7月16日,2.8万亿参数开源)、MiniMax H3 等轮番登场。国内财经媒体普遍将这一现象解读为「中国开源模型密集发布,倒逼全球 AI 行业重新定价」。
与此同时,美国厂商走的是另一条路径:OpenAI 7月30日大幅降价(Luna降80%),8月6日-7日把降价后的 Luna 设为免费用户默认模型并开放无限文本对话;谷歌 8月13日发布价格减半的 Gemini 3.7 Flash。也就是说,中国厂商在「开源旗舰+梯度涨价」,美国厂商在「消费端免费+降价防守」——两条路径同时发生,共同把 2026 年 8 月变成了大模型行业定价逻辑重构的一个关键节点。
另一层背景是地缘政治:月之暗面 Kimi K3 的开源此前已引发美方安全审查关注,阿里选择在这个窗口把 2.4 万亿参数的旗舰模型开源,被部分分析解读为「在潜在监管收紧前,抢先巩固国产模型的国际影响力和技术对等叙事」。这一判断带有一定推测性质,但确实是理解这波开源潮时机选择时不可忽略的背景。
06六步落地:涨价周如何重算模型账单与宿主
把新闻落成内部 Runbook,建议按下面六步走,避免被 headline 数字带偏采购:
-
01
先画峰谷窗口:把现有调用按北京时间 9–12 点、14–18 点拆成高峰/空闲两桶,再估算各桶 token 占比;美国团队白天多数落在空闲档,国内工作日白天则正好撞高峰。
-
02
单独统计缓存命中率:headline「1100%」打在缓存命中输入上,绝对金额很小;真正抬账单的是输出 350% 与缓存未命中输入 200%。有分析测算重度用户(约 8400 万 tokens/月、多在空闲、约一半命中)实际账单约 1.8 倍。
-
03
官方价与转售价并列比:高峰时段把 DeepSeek 官方、GMI Cloud / Novita 等转售、Qwen 国际站($2/$6)和 GPT-5.6 Luna($0.20/$1.20)放进同一张表,禁止默认「官方最便宜」。
-
04
读完 LICENSE 再下权重:个人与内部使用基本不受影响;MaaS / AI 工作助手且过去 12 个月该业务累计收入超 5000 万美元须单独授权;月活超 1 亿或月收入超 2000 万美元须显著标注模型名。不要信「禁美欧下载」。
-
05
把 GLM-5.3 当后训练升级:基座仍是 7430 亿,分数为官方自测;Terminal-Bench 3.0 仍落后 Sol 34.6% 与 Fable 5 33.7%。等独立复测再把「开源第一」写进选型结论。
- 06
[ ] 调用按北京时间高峰/空闲分桶
[ ] 缓存命中率与输出 token 单独记账
[ ] 官方高峰价 vs 转售 vs Qwen vs Luna
[ ] Qwen3.8-Max License:营收门槛已读
[ ] GLM-5.3:自测分数,等待第三方
[ ] 自托管平面与生产凭证物理分离
07总结与 FAQ
DeepSeek 用分时涨价把算力缺口写进价目表,阿里用开源权重换生态、用自定义许可证留住大客户议价权,智谱用同一基座证明后训练规模化本身就是杠杆。共享分钟池、超卖 VPS 或桌下机器常见的带宽抖动、邻居抢占与长连接中断,会直接吃掉错峰批处理、本地开源评测与账单对照的可审计性。对更稳定的生产与评测环境,NUKCLOUD 多区域裸金属 Mac / 云端 Mac 节点提供独占 Apple Silicon 与清晰租户边界,可在 定价页 对照规格并经 下单页 试跑。
数据来源:DeepSeek官方涨价公告,经华尔街见闻、IT之家、AIGC工具导航、V2EX社区讨论交叉核对;阿里Qwen官方模型仓库(Hugging Face / ModelScope)及南华早报(SCMP)关于许可证条款的报道;智谱(Z.ai)GLM-5.3官方技术页面及VentureBeat、StableLearn相关报道;Meta AI Research官方博客及VentureBeat关于Muse Glimmer的报道;第一财经、搜狐财经等关于中国大模型密集发布节奏的综合报道。以上数据截至发稿前公开信息整理,涉及价格、许可证条款、基准测试分数等内容建议发布前再次核实最新官方公告,部分细节(如芯片服务、安全漏洞发现、出口管制传闻)已在正文中标注为未经独立验证信息。