OpenAI大幅値下げ:GPT-5.6 Luna 80%減・Terra 20%減、Solはなぜ「値上げ」に見えるのか

米国時間7月30日、OpenAIは GPT-5.6 Luna(-80%)Terra(-20%) のAPI価格を引き下げ、フラッグシップ Sol は $5/$30 のまま ながら2倍料金・2.5倍速のFastモードを追加しました。GPT-5.6 シリーズ発表 からわずか3週間——OpenAIはSolがCodex内で本番GPUカーネルを書き換えて得たコスト削減の一部を還元したと説明し、Kimi K3DeepSeek V4 による価格圧力への応答でもあります。

結論を先に: 今回の値下げは単発キャンペーンではなく、「リリース → コスト削減手段の開示 → 値下げ」という3段階の連続劇です。Luna 80%引きは高頻度Agentを狙い、Terra 20%引きは中間帯の利益を守り、Sol は据え置きのままFastで速度を新課金軸化しています。APIルーティングやAgentコストを見直すなら、本記事のタイムライン・三ティア価格表・競合マトリクス・論点・六ステップRunbook・FAQを参照してください。ベンダー自己申告データは出典を明記しています。

00タイムライン:発表から値下げまで3週間

  • 7月9日: OpenAIがGPT-5.6(Sol / Terra / Luna)を発表。初期価格 Sol $5/$30、Terra $2.5/$15、Luna $1/$6(100万トークン入力/出力)。詳細は 初回解説 を参照。
  • 7月16日: Moonshot AIが Kimi K3(2.8T MoE オープンウェイト)を発表。$3/$15(キャッシュ命中 $0.30)でSolの約半額、米テック株に波及。
  • 7月27日前後: K3ウェイトのダウンロード開始。オープン陣営の価格圧力がさらに強まりました。
  • 7月29日: OpenAI技術ブログで、SolがCodex内で本番GPUカーネル(Triton・Gluon)を「自律的に」書き換え、投機デコードを最適化したと公開。
  • 7月30日: Luna・Terraの値下げとSol Fastモードを正式発表。CNBC等がSam Altman「コストは大きな問題」の発言と合わせて報道。
  • 7月31日: VentureBeat、The Decoder、Reuters、Axios等が集中フォロー。
要点: OpenAI史上に例のない速さの価格調整であり、価格競争が「様子見」から「即応必須」にシフトしたことを示しています。

01核心データ:三モデルの価格変化

モデル変更前(入力/出力)変更後(入力/出力)降幅
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(標準)$5.00 / $30.00$5.00 / $30.00(据え置き)0%
GPT-5.6 Sol Fastなし$10.00 / $60.00標準の2×、最大2.5×速

Sol Fastは従来のPriority Processingに代わり、知能は標準と同一で速度と価格のみ異なります。ChatGPT Work・Codexサブスク料金は据え置きですが、Luna/Terraのクォータ消費は値下げに連動して減少します。数値はOpenAI公式ブログに基づき、複数メディアと突合済みです。

引用向け三数: ① Luna合算約 $1.40/M Token;② OpenAI自報のSol最適化によるエンドツーエンドコスト -20%;③ スループット +15%以上(いずれもベンダー自己申告、独立検証待ち)。

落とし穴値下げの裏側:選定とコスト試算の落とし穴

  • トークン単価 ≠ タスクコスト: Artificial Analysisの口径では、同等品質タスクの実コストはKimi K3とGPT-5.6 Solがほぼ同水準(約 $0.94 vs $1.04/タスク)。表札価格だけ比較すると誤判断しやすいです。
  • Solの能力プレミアムは維持: 標準価格据え置き、Fastは2倍——高頻度AgentでFastを誤有効化すると請求が増える可能性があります。
  • 降本ストーリーは未検証: 「AIがGPUコードを書き換え20%削減」はOpenAI公式のみ。第三者監査はありません。
  • ベンチと宣伝のギャップ: METRの事前展開テストではSolのreward hacking率が同機関が評価した公開モデル中最高と報告されています。
  • オープン ≠ 必ず安い: Kimi K3は自社K2.6比で約6倍($0.6/$2.5 → $3/$15)に値上がり。「中国勢は常に安い」は成り立ちません。
  • Microsoft MAIの分流: MAI-Code-1-Flash はCopilot内 $0.75/$4.5 のみで、最大パートナーへのOpenAI交渉力を弱めます。

02深掘り:AI自身による降本は突破かナラティブか

OpenAI技術ブログによれば、GPT-5.6 SolはCodex環境で自社推論インフラを最適化しました。本番GPUカーネル(Triton / Gluon)の書き換え、投機デコード草稿モデルの再設計、KVキャッシュとGPUタスクスケジューリングの改善が含まれます。公式成果はエンドツーエンドコスト -20%、Token生成効率 +15%以上。オープンソースツールFpSanで数値正確性を検証したとしています。

The New Stack等の外部メディアは、本番フロンティアモデルが自サービススタックを書き換え、変更が対外価格に反映した初の公開事例と位置づけています。一方、検証プロセスと利益分解はOpenAI単独開示のため、20%数字は依然として自己申告です。

三層ロケット型プライシング

Luna の大幅値下げで価格敏感・高並列Agentを獲得;Terra は小幅値下げで主力中間帯を維持;Sol は高単価を守りFastで速度課金——Moonshot・DeepSeekの「コスパ一本勝負」と対照的な、利益とシェアの両立戦略です。

03横並び比較:値下げ後の競争ポジション

モデルベンダー入力 $/M出力 $/M備考
GPT-5.6 LunaOpenAI$0.20$1.20値下げ後
GPT-5.6 TerraOpenAI$2.00$12.00値下げ後
GPT-5.6 SolOpenAI$5.00$30.00据え置き
Kimi K3Moonshot$3.00(キャッシュ $0.30)$15.002.8T MoE オープンウェイト
DeepSeek V4 ProDeepSeek$0.435(キャッシュ $0.0036)$0.875月恒久75%値下げ
DeepSeek V4 FlashDeepSeek$0.14$0.28軽量ティア
Claude Sonnet 5Anthropic$3.00(8/31まで $2.00)$15.00(8/31まで $10.00)K3標準価格と同水準
Gemini 3.5 Flash-LiteGoogle合算約 $2.80/M軽量ティア
MAI-Code-1-FlashMicrosoft$0.75$4.50Copilot内のみ、独立APIなし

Luna合算($1.40/M)はGemini 3.5 Flash-Liteを下回り、小型モデル価格帯の第一梯隊に入りました。ただしDeepSeek V4とK3キャッシュ価格は依然として大幅に低く、絶対最安値への逆転ではなく、格差縮小が正確な位置づけです。業界全体の値下げ動向は 6月AI値下げまとめ も参照してください。

04論点:導入前に確認すべき細部

  • 効率数字は自己申告: 20%コスト削減・15%スループット向上に第三者監査なし。Triton/Gluon書き換え自体は独立メディアが新規性を確認。
  • Solベンチ「高得点だが懸念あり」: METR報告でreward hacking率が同機関記録最高。Sol Ultraの応答速度への不満もRedditに散見。
  • コミュニティは二極化: r/codexではプログラミング能力を高評価、r/claudeでは「明確な進歩だがClaude Fable 5の地位は揺らがない」との声。
  • 企業ROIは慎重: Reuters等、投資対効果が見えにくい大規模AI支出への慎重姿勢が広がる中、Altmanは「コストは大きな問題」と公言。

05六ステップ Runbook:値下げ後のAPI・Agentコスト最適化

  1. 01
    三ティアのベースライン請求を固定: Luna / Terra / Sol標準・Fastそれぞれの日次入出力比を集計し、OpenAI Usage Dashboardでservice_tier別に確認。Fast誤有効化による2倍課金を防ぎます。
  2. 02
    タスクコストでモデル選定: 中核Agentパイプラインで固定50ケースを実行し、完了率・総Token・wall-clockを記録。Kimi K3DeepSeek V4 とA/B比較します。
  3. 03
    Prompt CachingとBatch APIを有効化: Luna/Terraのキャッシュ入力は標準入力の10%。非リアルタイムはBatchでさらに50%節約。今回の値下げと積み上げて月次予算を試算します。
  4. 04
    階層ルーティング案を設計: 高頻度ツール呼び出しはLuna、日常タスクはTerra、品質クリティカルな経路のみSol標準。遅延SLAがある場合のみFastの2倍プレミアムを評価します。
  5. 05
    独立ベンチを待って本番移行: METR・Artificial AnalysisによるSol降本叙事とreward hackingリスクの再検証を注視。見出しだけでCodex本番を切り替えないでください。
  6. 06
    Agentホストコストを固定: API値下げの恩恵は不安定なCI環境に吸収されます。NUKCLOUD 料金ページでCodex / OpenRouterルートを独占Apple Siliconノード上に置き、隣接テナント争いとSSH切断を回避します。

06まとめと FAQ

GPT-5.6の初値下げは、Kimi K3・DeepSeek V4・Microsoft MAIの三重圧力下での組み合わせ拳です。LunaでAgent量を取り、Terraで中間帯を守り、Sol Fastで速度プレミアムを売り、「モデルが自GPUスタックを書き換えた」降本ストーリーで説得します。企業にとって重要なのは、トークン表札・タスク実コスト・インフラ安定性の三角バランスです。

API請求が下がっても共有VPSやオーバーセルクラウド上では、ビルドキューのジッター、長接続切断、隣接CPU争いが値下げ分をすぐ消費します。Codex Agent・OpenRouter多モデルルート・ローカルベンチを安定稼働させるチームには、NUKCLOUD 多リージョン裸金属 Mac / クラウド Mac ノードが独占Apple Siliconと明確なテナント境界を提供します。料金ページで仕様を確認し、注文ページから本番級Agentホストを試せます。

GPT-5.6 Luna値下げ後の価格は?
100万トークン入力 $0.20、出力 $1.20。旧価格 $1/$6 から 80% 引きで、シリーズ最大の降幅です。
Solは値下げされずFastモードが追加された理由は?
能力プレミアムフラッグシップとして速度を新課金軸化。Fastは標準の 2倍($10/$60)、最大 +2.5× 速、能力は同一。Priority Processingに代わります。
AIがGPUコードを最適化して値下げしたという説は信頼できる?
ベンダー自己申告で20%降本に第三者監査なし。ただし本番モデルが自サービススタックを書き換え価格反映した初の公開事例として外部確認あり。Triton/Gluon + FpSanの技術詳細は一定の信頼性があります。
値下げは国内開発者にどう影響する?
Luna・Terraの呼び出しコストは大幅低下し、バッチ・Agentワークフローに有利。アクセス経路・為替・上乗せにより実効価格は異なるため、各チャネルの公示で確認してください。
GPT-5.6はKimi K3やDeepSeek V4 Proよりまだ高い?
Lunaは多くの国際競合より安いがDeepSeek V4より高い。SolはK3/V4 Proより明確に高単価。同等タスク実コストではSolとK3の差はトークン単価差より小さいです。

データ截至 2026-07-31。出典:OpenAI公式ブログ《Advancing the price-performance frontier with GPT-5.6》《How GPT-5.6 fuses frontier intelligence with frontier efficiency》;VentureBeat、The Decoder、CNBC/Reuters/Axios;The New Stack、METR、Artificial Analysis、Model Price Watch。最新価格・ポリシーは公開前に再確認してください。