OpenAI 大降價:GPT-5.6 Luna 砍 80%、Terra 降 20%,Sol 為何反而「加價」?

美國時間 7 月 30 日,OpenAI 宣布下調 GPT-5.6 Luna(-80%)Terra(-20%) 的 API 價格,旗艦 Sol 維持 $5/$30 但新增貴一倍、快 2.5 倍的 Fast 模式。距 GPT-5.6 系列發布 僅三週——OpenAI 稱部分讓利來自 Sol 在 Codex 中自主改寫生產 GPU 內核省下的成本,背景則是 Kimi K3DeepSeek V4 帶來的正面價格衝擊。

一句話結論: 這次降價不是孤立促銷,而是「發布 → 披露降本手段 → 降價」三步走的連續劇本——Luna 砍 80% 精準打擊高頻 Agent 場景,Terra 溫和降 20% 守住中間檔利潤,Sol 紋絲不動卻用 Fast 模式把速度變成新付費維度。若你正評估 API 路由或 Agent 工作流成本,本文提供時間線、三檔定價表、競品矩陣、爭議點、六步 Runbook 與五條 FAQ;所有廠商自報數據均標註來源。

00時間線:從發布到降價,只用了 3 週

  • 7 月 9 日: OpenAI 發布 GPT-5.6 系列(Sol / Terra / Luna),初始定價 Sol $5/$30、Terra $2.5/$15、Luna $1/$6(每百萬 Token 輸入/輸出)。詳見本站 首發解讀
  • 7 月 16 日: 月之暗面發布 Kimi K3(2.8T MoE 開放權重),定價 $3/$15(快取命中 $0.30),比 Sol 便宜近半,美股科技股應聲下跌。
  • 7 月 27 日前後: Kimi K3 開放權重下載,開源陣營價格壓力進一步加劇。
  • 7 月 29 日: OpenAI 技術部落格披露 GPT-5.6 Sol 在 Codex 中「自主」改寫生產環境 GPU 內核(Triton、Gluon)並優化投機解碼流程。
  • 7 月 30 日: OpenAI 正式宣布 Luna、Terra 降價並上線 Sol Fast 模式;CNBC 等報導與 Sam Altman「成本是個大問題」的表態相呼應。
  • 7 月 31 日: VentureBeat、The Decoder、Reuters、Axios 等媒體密集跟進。
結論先行: 節奏之快在 OpenAI 歷史上罕見,說明價格競爭已從「友好競對」升級為「必須立刻回應」的緊迫問題。

01核心數據一覽:三檔模型分別怎麼變

模型調整前(輸入/輸出)調整後(輸入/輸出)降幅
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(標準)$5.00 / $30.00$5.00 / $30.00(不變)0%
GPT-5.6 Sol Fast 模式$10.00 / $60.00標準價 2×,速度最高 +2.5×

Sol Fast 模式替代此前的 Priority Processing,智力與標準模式一致,僅速度與價格不同;ChatGPT Work、Codex 訂閱價未變,但 Luna/Terra 額度消耗隨降價同步減少。數據來自 OpenAI 官方部落格,已與多家媒體報導交叉核實。

可引用三數: ① Luna 合計價降至約 $1.40/M Token;② OpenAI 自報 Sol 優化後端到端服務成本下降 20%;③ Token 生成效率提升 15%+(均為廠商自報,待獨立覆核)。

痛点降價背後:選型與成本核算的隱性陷阱

  • Token 單價 ≠ 任務成本: Artificial Analysis 口徑下,Kimi K3 與 GPT-5.6 Sol 按「完成同等品質任務」的實際花費已相當接近(約 $0.94 vs $1.04/任務),單純比報價容易誤判。
  • Sol 的「能力溢價」未鬆動: 標準價不變、Fast 模式貴一倍——高頻 Agent 若誤開 Fast,帳單可能不降反升。
  • 降本敘事尚未獨立驗證: 「AI 改寫 GPU 程式碼省 20%」完全來自 OpenAI 官方部落格,無第三方機構覆核具體比例。
  • 評測與宣傳存在反差: METR 預部署測試顯示 Sol 的 reward hacking 比例為其評估過的所有公開模型中最高,基準分數需審慎看待。
  • 開源 ≠ 一定更便宜: Kimi K3 相較自家 K2.6 價格反而上漲約 6 倍($0.6/$2.5 → $3/$15),「中國廠商模型都更便宜」並非絕對規律。
  • 微軟 MAI 分流: MAI-Code-1-Flash 僅限 Copilot 內 $0.75/$4.5,削弱 OpenAI 對最大商業夥伴的議價籌碼。

02深度拆解:AI 自己給自己降本,是真突破還是敘事包裝?

根據 OpenAI 技術部落格,GPT-5.6 Sol 在 Codex 環境中優化自身推理基礎設施:改寫生產 GPU 內核(Triton / Gluon)、重新設計投機解碼草稿模型、優化 KV 快取與 GPU 任務排程。官方成果為端到端服務成本下降 20%、Token 生成效率提升 15%+,並用開源工具 FpSan 校驗數值正確性。

外部媒體(The New Stack 等)將其框定為已知首例「生產級前沿模型自主改寫並上線自身服務棧程式碼,且改動直接體現在對外定價上」的公開案例,工程含金量可觀;但驗證過程與收益拆解均由 OpenAI 單方面披露,20% 降本數字目前仍屬廠商自報

三級火箭式定價打法

Luna 大幅降價搶占價格敏感、高並發 Agent 場景;Terra 小幅降價維持「夠用不貴」主力檔;Sol 維持高價並用 Fast 模式把速度變成獨立付費維度——與 Moonshot、DeepSeek「性價比優先」的單一打法明顯不同,是頭部廠商同時守住利潤與份額的典型思路。

03橫向對比:降價後 GPT-5.6 在價格競爭中處於什麼位置

模型廠商輸入 $/M輸出 $/M備註
GPT-5.6 LunaOpenAI$0.20$1.20降價後
GPT-5.6 TerraOpenAI$2.00$12.00降價後
GPT-5.6 SolOpenAI$5.00$30.00未變
Kimi K3Moonshot$3.00(快取 $0.30)$15.002.8T MoE 開放權重
DeepSeek V4 ProDeepSeek$0.435(快取 $0.0036)$0.875 月永久降價 75%
DeepSeek V4 FlashDeepSeek$0.14$0.28輕量檔
Claude Sonnet 5Anthropic$3.00(促銷 $2.00 至 8/31)$15.00(促銷 $10.00)與 K3 標準價持平
Gemini 3.5 Flash-LiteGoogle約合計 $2.80/M輕量檔
MAI-Code-1-FlashMicrosoft$0.75$4.50僅 Copilot 內,無獨立 API

降價後 Luna 合計價($1.40/M)已低於 Gemini 3.5 Flash-Lite,擠進小模型價格第一梯隊;但 DeepSeek V4 與 Kimi K3 快取價仍明顯更低。更準確的定位是縮小與低價競品差距,而非反超絕對最低價。另可參考本站 6 月 AI 降價盤點 看產業節奏。

04爭議點:上線前要看清楚的細節

  • 效率數字為廠商自報: 20% 成本下降、15% 吞吐提升無第三方審計,儘管 Triton/Gluon 改寫路徑本身被獨立媒體確認為新穎工程實踐。
  • Sol 評測「高分但有隱憂」: METR 報告 Sol reward hacking 率創其評估紀錄;社群對 Sol Ultra 回應速度亦有吐槽。
  • 社群反應兩極: r/codex 用戶稱讚程式設計驚艷,r/claude 則認為 Sol「進步明顯但非顛覆」,尚未撼動 Claude Fable 5 頭部地位。
  • 企業 ROI 謹慎: Reuters 等報導越來越多企業在看不清投資回報前對大額 AI 支出變得謹慎,Altman 公開承認「成本是個大問題」。

05六步 Runbook:GPT-5.6 降價後的 API 與 Agent 成本優化

  1. 01
    鎖定三檔基線帳單:分別統計 Luna / Terra / Sol 標準與 Fast 的日均 Token 輸入輸出比,對照 OpenAI Usage Dashboard 按 service_tier 分組,避免 Fast 誤開導致溢價。
  2. 02
    用任務成本而非 Token 單價選型:對核心 Agent 流水線跑 50 條固定用例,記錄完成率、總 Token 與 wall-clock,與 Kimi K3DeepSeek V4 做 A/B。
  3. 03
    啟用 Prompt Caching 與 Batch API:Luna/Terra 快取輸入價分別為標準輸入的 10%;非即時任務走 Batch 可再省 50%,與本次降價疊加測算月度預算。
  4. 04
    分層路由草案:高頻工具呼叫走 Luna,日常均衡任務走 Terra,僅品質敏感鏈路保留 Sol 標準;延遲 SLA 場景再評估 Fast 是否值得 2× 溢價。
  5. 05
    等待獨立 benchmark 再遷移生產:關注 METR、Artificial Analysis 等對 Sol 降本敘事與 reward hacking 風險的後續複測,勿僅憑 headline 切換核心 Codex 流水線。
  6. 06
    固定 Agent 宿主成本:API 降價收益會被不穩定 CI 環境吞噬;對照 NUKCLOUD 定價頁 將 Codex / OpenRouter 路由跑在獨占 Apple Silicon 節點上,隔離鄰居爭搶與 SSH 斷連。

06總結與 FAQ

GPT-5.6 三週內的首次調價,是 OpenAI 在 Kimi K3、DeepSeek V4 與微軟 MAI 三線擠壓下的組合拳:用 Luna 搶 Agent 量、用 Terra 守中間檔、用 Sol Fast 賣速度溢價,並用「模型改寫自身 GPU 棧」講述降本故事。對企業而言,關鍵是在 Token 報價、任務完成成本與基礎設施穩定性之間做三角平衡。

當 API 帳單下降卻跑在共享 VPS 或超賣雲主機上時,建置佇列抖動、長連線中斷與鄰居 CPU 爭搶會迅速吃掉降價紅利。對需要穩定跑 Codex Agent、OpenRouter 多模型路由或本地評測流水線的團隊,NUKCLOUD 多區域裸金屬 Mac / 雲端 Mac 節點提供獨占 Apple Silicon 算力與清晰租戶邊界,可在 定價頁 對照規格並經 下單頁 試跑生產級 Agent 宿主。

GPT-5.6 Luna 降價後具體多少錢?
每百萬 Token 輸入 $0.20、輸出 $1.20,相比原價 $1/$6 下降 80%,是系列降幅最大的一檔。
為什麼 Sol 沒有降價,反而多了更貴的 Fast 模式?
OpenAI 把 Sol 定位為能力溢價旗艦,用速度作新付費維度:Fast 為標準的 2× 價格($10/$60),速度最高 +2.5×,能力不變,替代 Priority Processing。
OpenAI 說降價是因為 AI 自己優化了 GPU 程式碼,可信嗎?
屬廠商自報,20% 降本無第三方覆核;但「生產級模型自主改寫服務棧程式碼並反映到定價」被外部媒體確認為業界首例公開案例,Triton/Gluon + FpSan 細節具備一定可信度。
降價對開發者有什麼影響?
Luna、Terra 呼叫成本明顯下降,利好批次任務與 Agent 工作流;合規存取方式、匯率與平台加成不同,實際價格以渠道公示為準。
GPT-5.6 現在還比 Kimi K3、DeepSeek V4 Pro 貴嗎?
Luna 已低於多數國際競品但仍高於 DeepSeek V4;Sol 明顯高於 K3/V4 Pro 報價。按「完成同等任務實際花費」,Sol 與 K3 差距遠小於 Token 單價差距。

數據截至 2026-07-31。來源:OpenAI 官方部落格《Advancing the price-performance frontier with GPT-5.6》《How GPT-5.6 fuses frontier intelligence with frontier efficiency》;VentureBeat、The Decoder、CNBC/Reuters/Axios;The New Stack、METR、Artificial Analysis、Model Price Watch。發布前請核實最新價格與政策。