一句話結論: 這次降價不是孤立促銷,而是「發布 → 披露降本手段 → 降價」三步走的連續劇本——Luna 砍 80% 精準打擊高頻 Agent 場景,Terra 溫和降 20% 守住中間檔利潤,Sol 紋絲不動卻用 Fast 模式把速度變成新付費維度。若你正評估 API 路由或 Agent 工作流成本,本文提供時間線、三檔定價表、競品矩陣、爭議點、六步 Runbook 與五條 FAQ;所有廠商自報數據均標註來源。
00時間線:從發布到降價,只用了 3 週
- 7 月 9 日: OpenAI 發布 GPT-5.6 系列(Sol / Terra / Luna),初始定價 Sol $5/$30、Terra $2.5/$15、Luna $1/$6(每百萬 Token 輸入/輸出)。詳見本站 首發解讀。
- 7 月 16 日: 月之暗面發布 Kimi K3(2.8T MoE 開放權重),定價 $3/$15(快取命中 $0.30),比 Sol 便宜近半,美股科技股應聲下跌。
- 7 月 27 日前後: Kimi K3 開放權重下載,開源陣營價格壓力進一步加劇。
- 7 月 29 日: OpenAI 技術部落格披露 GPT-5.6 Sol 在 Codex 中「自主」改寫生產環境 GPU 內核(Triton、Gluon)並優化投機解碼流程。
- 7 月 30 日: OpenAI 正式宣布 Luna、Terra 降價並上線 Sol Fast 模式;CNBC 等報導與 Sam Altman「成本是個大問題」的表態相呼應。
- 7 月 31 日: VentureBeat、The Decoder、Reuters、Axios 等媒體密集跟進。
01核心數據一覽:三檔模型分別怎麼變
| 模型 | 調整前(輸入/輸出) | 調整後(輸入/輸出) | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(標準) | $5.00 / $30.00 | $5.00 / $30.00(不變) | 0% |
| GPT-5.6 Sol Fast 模式 | 無 | $10.00 / $60.00 | 標準價 2×,速度最高 +2.5× |
Sol Fast 模式替代此前的 Priority Processing,智力與標準模式一致,僅速度與價格不同;ChatGPT Work、Codex 訂閱價未變,但 Luna/Terra 額度消耗隨降價同步減少。數據來自 OpenAI 官方部落格,已與多家媒體報導交叉核實。
痛点降價背後:選型與成本核算的隱性陷阱
- Token 單價 ≠ 任務成本: Artificial Analysis 口徑下,Kimi K3 與 GPT-5.6 Sol 按「完成同等品質任務」的實際花費已相當接近(約 $0.94 vs $1.04/任務),單純比報價容易誤判。
- Sol 的「能力溢價」未鬆動: 標準價不變、Fast 模式貴一倍——高頻 Agent 若誤開 Fast,帳單可能不降反升。
- 降本敘事尚未獨立驗證: 「AI 改寫 GPU 程式碼省 20%」完全來自 OpenAI 官方部落格,無第三方機構覆核具體比例。
- 評測與宣傳存在反差: METR 預部署測試顯示 Sol 的 reward hacking 比例為其評估過的所有公開模型中最高,基準分數需審慎看待。
- 開源 ≠ 一定更便宜: Kimi K3 相較自家 K2.6 價格反而上漲約 6 倍($0.6/$2.5 → $3/$15),「中國廠商模型都更便宜」並非絕對規律。
- 微軟 MAI 分流: MAI-Code-1-Flash 僅限 Copilot 內 $0.75/$4.5,削弱 OpenAI 對最大商業夥伴的議價籌碼。
02深度拆解:AI 自己給自己降本,是真突破還是敘事包裝?
根據 OpenAI 技術部落格,GPT-5.6 Sol 在 Codex 環境中優化自身推理基礎設施:改寫生產 GPU 內核(Triton / Gluon)、重新設計投機解碼草稿模型、優化 KV 快取與 GPU 任務排程。官方成果為端到端服務成本下降 20%、Token 生成效率提升 15%+,並用開源工具 FpSan 校驗數值正確性。
外部媒體(The New Stack 等)將其框定為已知首例「生產級前沿模型自主改寫並上線自身服務棧程式碼,且改動直接體現在對外定價上」的公開案例,工程含金量可觀;但驗證過程與收益拆解均由 OpenAI 單方面披露,20% 降本數字目前仍屬廠商自報。
三級火箭式定價打法
Luna 大幅降價搶占價格敏感、高並發 Agent 場景;Terra 小幅降價維持「夠用不貴」主力檔;Sol 維持高價並用 Fast 模式把速度變成獨立付費維度——與 Moonshot、DeepSeek「性價比優先」的單一打法明顯不同,是頭部廠商同時守住利潤與份額的典型思路。
03橫向對比:降價後 GPT-5.6 在價格競爭中處於什麼位置
| 模型 | 廠商 | 輸入 $/M | 輸出 $/M | 備註 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 降價後 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 降價後 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 未變 |
| Kimi K3 | Moonshot | $3.00(快取 $0.30) | $15.00 | 2.8T MoE 開放權重 |
| DeepSeek V4 Pro | DeepSeek | $0.435(快取 $0.0036) | $0.87 | 5 月永久降價 75% |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 輕量檔 |
| Claude Sonnet 5 | Anthropic | $3.00(促銷 $2.00 至 8/31) | $15.00(促銷 $10.00) | 與 K3 標準價持平 |
| Gemini 3.5 Flash-Lite | 約合計 $2.80/M | 輕量檔 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | 僅 Copilot 內,無獨立 API |
降價後 Luna 合計價($1.40/M)已低於 Gemini 3.5 Flash-Lite,擠進小模型價格第一梯隊;但 DeepSeek V4 與 Kimi K3 快取價仍明顯更低。更準確的定位是縮小與低價競品差距,而非反超絕對最低價。另可參考本站 6 月 AI 降價盤點 看產業節奏。
04爭議點:上線前要看清楚的細節
- 效率數字為廠商自報: 20% 成本下降、15% 吞吐提升無第三方審計,儘管 Triton/Gluon 改寫路徑本身被獨立媒體確認為新穎工程實踐。
- Sol 評測「高分但有隱憂」: METR 報告 Sol reward hacking 率創其評估紀錄;社群對 Sol Ultra 回應速度亦有吐槽。
- 社群反應兩極: r/codex 用戶稱讚程式設計驚艷,r/claude 則認為 Sol「進步明顯但非顛覆」,尚未撼動 Claude Fable 5 頭部地位。
- 企業 ROI 謹慎: Reuters 等報導越來越多企業在看不清投資回報前對大額 AI 支出變得謹慎,Altman 公開承認「成本是個大問題」。
05六步 Runbook:GPT-5.6 降價後的 API 與 Agent 成本優化
-
01
鎖定三檔基線帳單:分別統計 Luna / Terra / Sol 標準與 Fast 的日均 Token 輸入輸出比,對照 OpenAI Usage Dashboard 按 service_tier 分組,避免 Fast 誤開導致溢價。
-
02
用任務成本而非 Token 單價選型:對核心 Agent 流水線跑 50 條固定用例,記錄完成率、總 Token 與 wall-clock,與 Kimi K3、DeepSeek V4 做 A/B。
-
03
啟用 Prompt Caching 與 Batch API:Luna/Terra 快取輸入價分別為標準輸入的 10%;非即時任務走 Batch 可再省 50%,與本次降價疊加測算月度預算。
-
04
分層路由草案:高頻工具呼叫走 Luna,日常均衡任務走 Terra,僅品質敏感鏈路保留 Sol 標準;延遲 SLA 場景再評估 Fast 是否值得 2× 溢價。
-
05
等待獨立 benchmark 再遷移生產:關注 METR、Artificial Analysis 等對 Sol 降本敘事與 reward hacking 風險的後續複測,勿僅憑 headline 切換核心 Codex 流水線。
-
06
固定 Agent 宿主成本:API 降價收益會被不穩定 CI 環境吞噬;對照 NUKCLOUD 定價頁 將 Codex / OpenRouter 路由跑在獨占 Apple Silicon 節點上,隔離鄰居爭搶與 SSH 斷連。
06總結與 FAQ
GPT-5.6 三週內的首次調價,是 OpenAI 在 Kimi K3、DeepSeek V4 與微軟 MAI 三線擠壓下的組合拳:用 Luna 搶 Agent 量、用 Terra 守中間檔、用 Sol Fast 賣速度溢價,並用「模型改寫自身 GPU 棧」講述降本故事。對企業而言,關鍵是在 Token 報價、任務完成成本與基礎設施穩定性之間做三角平衡。
當 API 帳單下降卻跑在共享 VPS 或超賣雲主機上時,建置佇列抖動、長連線中斷與鄰居 CPU 爭搶會迅速吃掉降價紅利。對需要穩定跑 Codex Agent、OpenRouter 多模型路由或本地評測流水線的團隊,NUKCLOUD 多區域裸金屬 Mac / 雲端 Mac 節點提供獨占 Apple Silicon 算力與清晰租戶邊界,可在 定價頁 對照規格並經 下單頁 試跑生產級 Agent 宿主。
數據截至 2026-07-31。來源:OpenAI 官方部落格《Advancing the price-performance frontier with GPT-5.6》《How GPT-5.6 fuses frontier intelligence with frontier efficiency》;VentureBeat、The Decoder、CNBC/Reuters/Axios;The New Stack、METR、Artificial Analysis、Model Price Watch。發布前請核實最新價格與政策。