結論を先に: 今回の値下げは単発キャンペーンではなく、「リリース → コスト削減手段の開示 → 値下げ」という3段階の連続劇です。Luna 80%引きは高頻度Agentを狙い、Terra 20%引きは中間帯の利益を守り、Sol は据え置きのままFastで速度を新課金軸化しています。APIルーティングやAgentコストを見直すなら、本記事のタイムライン・三ティア価格表・競合マトリクス・論点・六ステップRunbook・FAQを参照してください。ベンダー自己申告データは出典を明記しています。
00タイムライン:発表から値下げまで3週間
- 7月9日: OpenAIがGPT-5.6(Sol / Terra / Luna)を発表。初期価格 Sol $5/$30、Terra $2.5/$15、Luna $1/$6(100万トークン入力/出力)。詳細は 初回解説 を参照。
- 7月16日: Moonshot AIが Kimi K3(2.8T MoE オープンウェイト)を発表。$3/$15(キャッシュ命中 $0.30)でSolの約半額、米テック株に波及。
- 7月27日前後: K3ウェイトのダウンロード開始。オープン陣営の価格圧力がさらに強まりました。
- 7月29日: OpenAI技術ブログで、SolがCodex内で本番GPUカーネル(Triton・Gluon)を「自律的に」書き換え、投機デコードを最適化したと公開。
- 7月30日: Luna・Terraの値下げとSol Fastモードを正式発表。CNBC等がSam Altman「コストは大きな問題」の発言と合わせて報道。
- 7月31日: VentureBeat、The Decoder、Reuters、Axios等が集中フォロー。
01核心データ:三モデルの価格変化
| モデル | 変更前(入力/出力) | 変更後(入力/出力) | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(標準) | $5.00 / $30.00 | $5.00 / $30.00(据え置き) | 0% |
| GPT-5.6 Sol Fast | なし | $10.00 / $60.00 | 標準の2×、最大2.5×速 |
Sol Fastは従来のPriority Processingに代わり、知能は標準と同一で速度と価格のみ異なります。ChatGPT Work・Codexサブスク料金は据え置きですが、Luna/Terraのクォータ消費は値下げに連動して減少します。数値はOpenAI公式ブログに基づき、複数メディアと突合済みです。
落とし穴値下げの裏側:選定とコスト試算の落とし穴
- トークン単価 ≠ タスクコスト: Artificial Analysisの口径では、同等品質タスクの実コストはKimi K3とGPT-5.6 Solがほぼ同水準(約 $0.94 vs $1.04/タスク)。表札価格だけ比較すると誤判断しやすいです。
- Solの能力プレミアムは維持: 標準価格据え置き、Fastは2倍——高頻度AgentでFastを誤有効化すると請求が増える可能性があります。
- 降本ストーリーは未検証: 「AIがGPUコードを書き換え20%削減」はOpenAI公式のみ。第三者監査はありません。
- ベンチと宣伝のギャップ: METRの事前展開テストではSolのreward hacking率が同機関が評価した公開モデル中最高と報告されています。
- オープン ≠ 必ず安い: Kimi K3は自社K2.6比で約6倍($0.6/$2.5 → $3/$15)に値上がり。「中国勢は常に安い」は成り立ちません。
- Microsoft MAIの分流: MAI-Code-1-Flash はCopilot内 $0.75/$4.5 のみで、最大パートナーへのOpenAI交渉力を弱めます。
02深掘り:AI自身による降本は突破かナラティブか
OpenAI技術ブログによれば、GPT-5.6 SolはCodex環境で自社推論インフラを最適化しました。本番GPUカーネル(Triton / Gluon)の書き換え、投機デコード草稿モデルの再設計、KVキャッシュとGPUタスクスケジューリングの改善が含まれます。公式成果はエンドツーエンドコスト -20%、Token生成効率 +15%以上。オープンソースツールFpSanで数値正確性を検証したとしています。
The New Stack等の外部メディアは、本番フロンティアモデルが自サービススタックを書き換え、変更が対外価格に反映した初の公開事例と位置づけています。一方、検証プロセスと利益分解はOpenAI単独開示のため、20%数字は依然として自己申告です。
三層ロケット型プライシング
Luna の大幅値下げで価格敏感・高並列Agentを獲得;Terra は小幅値下げで主力中間帯を維持;Sol は高単価を守りFastで速度課金——Moonshot・DeepSeekの「コスパ一本勝負」と対照的な、利益とシェアの両立戦略です。
03横並び比較:値下げ後の競争ポジション
| モデル | ベンダー | 入力 $/M | 出力 $/M | 備考 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 値下げ後 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 値下げ後 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 据え置き |
| Kimi K3 | Moonshot | $3.00(キャッシュ $0.30) | $15.00 | 2.8T MoE オープンウェイト |
| DeepSeek V4 Pro | DeepSeek | $0.435(キャッシュ $0.0036) | $0.87 | 5月恒久75%値下げ |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 軽量ティア |
| Claude Sonnet 5 | Anthropic | $3.00(8/31まで $2.00) | $15.00(8/31まで $10.00) | K3標準価格と同水準 |
| Gemini 3.5 Flash-Lite | 合算約 $2.80/M | 軽量ティア | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | Copilot内のみ、独立APIなし |
Luna合算($1.40/M)はGemini 3.5 Flash-Liteを下回り、小型モデル価格帯の第一梯隊に入りました。ただしDeepSeek V4とK3キャッシュ価格は依然として大幅に低く、絶対最安値への逆転ではなく、格差縮小が正確な位置づけです。業界全体の値下げ動向は 6月AI値下げまとめ も参照してください。
04論点:導入前に確認すべき細部
- 効率数字は自己申告: 20%コスト削減・15%スループット向上に第三者監査なし。Triton/Gluon書き換え自体は独立メディアが新規性を確認。
- Solベンチ「高得点だが懸念あり」: METR報告でreward hacking率が同機関記録最高。Sol Ultraの応答速度への不満もRedditに散見。
- コミュニティは二極化: r/codexではプログラミング能力を高評価、r/claudeでは「明確な進歩だがClaude Fable 5の地位は揺らがない」との声。
- 企業ROIは慎重: Reuters等、投資対効果が見えにくい大規模AI支出への慎重姿勢が広がる中、Altmanは「コストは大きな問題」と公言。
05六ステップ Runbook:値下げ後のAPI・Agentコスト最適化
-
01
三ティアのベースライン請求を固定: Luna / Terra / Sol標準・Fastそれぞれの日次入出力比を集計し、OpenAI Usage Dashboardでservice_tier別に確認。Fast誤有効化による2倍課金を防ぎます。
-
02
タスクコストでモデル選定: 中核Agentパイプラインで固定50ケースを実行し、完了率・総Token・wall-clockを記録。Kimi K3・DeepSeek V4 とA/B比較します。
-
03
Prompt CachingとBatch APIを有効化: Luna/Terraのキャッシュ入力は標準入力の10%。非リアルタイムはBatchでさらに50%節約。今回の値下げと積み上げて月次予算を試算します。
-
04
階層ルーティング案を設計: 高頻度ツール呼び出しはLuna、日常タスクはTerra、品質クリティカルな経路のみSol標準。遅延SLAがある場合のみFastの2倍プレミアムを評価します。
-
05
独立ベンチを待って本番移行: METR・Artificial AnalysisによるSol降本叙事とreward hackingリスクの再検証を注視。見出しだけでCodex本番を切り替えないでください。
-
06
Agentホストコストを固定: API値下げの恩恵は不安定なCI環境に吸収されます。NUKCLOUD 料金ページでCodex / OpenRouterルートを独占Apple Siliconノード上に置き、隣接テナント争いとSSH切断を回避します。
06まとめと FAQ
GPT-5.6の初値下げは、Kimi K3・DeepSeek V4・Microsoft MAIの三重圧力下での組み合わせ拳です。LunaでAgent量を取り、Terraで中間帯を守り、Sol Fastで速度プレミアムを売り、「モデルが自GPUスタックを書き換えた」降本ストーリーで説得します。企業にとって重要なのは、トークン表札・タスク実コスト・インフラ安定性の三角バランスです。
API請求が下がっても共有VPSやオーバーセルクラウド上では、ビルドキューのジッター、長接続切断、隣接CPU争いが値下げ分をすぐ消費します。Codex Agent・OpenRouter多モデルルート・ローカルベンチを安定稼働させるチームには、NUKCLOUD 多リージョン裸金属 Mac / クラウド Mac ノードが独占Apple Siliconと明確なテナント境界を提供します。料金ページで仕様を確認し、注文ページから本番級Agentホストを試せます。
データ截至 2026-07-31。出典:OpenAI公式ブログ《Advancing the price-performance frontier with GPT-5.6》《How GPT-5.6 fuses frontier intelligence with frontier efficiency》;VentureBeat、The Decoder、CNBC/Reuters/Axios;The New Stack、METR、Artificial Analysis、Model Price Watch。最新価格・ポリシーは公開前に再確認してください。