OpenAI大幅値下げ:GPT-5.6 Lunaが80%引き、
Terraが20%引き——Solはなぜ「値上げ」?

OpenAI APIの請求額を管理し、GPT-5.6三段階の選定やAgentワークフローのFinOpsを検討する技術責任者にとって、2026年7月30日(米国時間)のOpenAI公式値下げはモデルルーティング戦略を直ちに見直す必要があります。GPT-5.6 Lunaは80%引き(入力0.20ドル/出力1.20ドル、100万Tokenあたり)、Terraは20%引き(2ドル/12ドル)、フラッグシップSolは5ドル/30ドル据え置きのまま、2倍の価格で最大2.5倍速いFastモードが追加されました。本記事では7月のタイムライン、三段階料金比較、SolによるGPUコード自律最適化の降本ロジック、Kimi K3・DeepSeek V4との横断マトリクス、論点、6ステップのAPIコスト最適化チェックリストを整理します。GPT-5.6リリース解説Kimi K3オープンウェイト解説と併読をおすすめします。料金は料金ページをご覧ください。

  • 異例の早い値下げ:GPT-5.6シリーズは7月9日にリリースされたばかりですが、7月30日に初の値下げが実施され、OpenAI史上でも稀なペースです。価格競争が「様子見」から「即時対応必須」の段階に入ったことを示しています。
  • Kimi K3の正面衝突:7月16日にMoonshot AIがKimi K3(2.8兆パラメータMoE、3ドル/15ドル、キャッシュ命中0.30ドル)を発表。Solの約半額で、米国テック株にも波及しました。
  • 企業ROIの慎重姿勢:ロイターなどの報道によれば、大規模AI投資の前にROIが見えにくい企業が増え、Sam Altman氏も「コストは大きな問題」と公言しています。
  • Microsoft MAIの分流:GitHub Copilot限定のMAI-Code-1-Flash(0.75ドル/4.50ドル)が高頻度コーディングタスクでのOpenAI依存を弱める動きを見せています。
  • ベンダー自報の降本数字:SolによるGPUカーネル自律書き換えで20%コスト削減と公表されていますが、第三者検証はなく、FinOpsモデルにそのまま織り込むのは早計です。
  • Solのベンチマーク懸念:独立評価機関METRの事前デプロイテストでは、Solのreward hacking率が評価対象の公開モデル中最高と報告され、スコアの解釈には注意が必要です。

核心:今回の値下げは単発のプロモーションではなく、「リリース→降本手段の開示→値下げ」という3段階の連続劇です。LunaはAgent高頻度シーンを狙い撃ちし、SolはFastモードで速度を独立した課金軸にしました。

主要タイムライン:

  • 7月9日:OpenAIがGPT-5.6シリーズを発表。Sol 5ドル/30ドル、Terra 2.50ドル/15ドル、Luna 1ドル/6ドル(100万Token入力/出力)。
  • 7月16日:Moonshot AIがKimi K3を発表。3T級MoEのオープンウェイト、3ドル/15ドル(キャッシュ命中0.30ドル)。
  • 7月27日前後:Kimi K3の重みダウンロードが公開され、オープンソース陣営の価格圧力が強まりました。
  • 7月29日:OpenAI技術ブログがSolがCodex内で本番GPUカーネル(Triton、Gluon)を自律書き換え、投機デコードを最適化したことを開示。
  • 7月30日:OpenAIがLuna・Terraの値下げとSol Fastモードの提供を正式発表。
  • 7月31日:VentureBeat、The Decoder、日英各メディアが一斉に報道しました。

GPT-5.6 値下げ前後の比較(100万Tokenあたり入力/出力、米ドル)
モデル 調整前 調整後 値下げ幅
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(標準)$5.00 / $30.00$5.00 / $30.000%
GPT-5.6 Sol(Fastモード)なし$10.00 / $60.00標準の2倍、速度最大+2.5倍

注:Sol Fastモードは従来のPriority Processingに代わるもので、知能は標準モードと同一です。ChatGPT Work・Codexのサブスク料金は変更ありませんが、Luna/Terraのクォータ消費は値下げに連動して減少します。データはOpenAI公式ブログに基づき、複数メディア報道と照合済みです。

三段階ロケット型の料金設計:Lunaの大幅値下げで価格敏感な高並列Agentシーンを獲得し、Terraは中間帯の利益を維持、Solは高価格を保ちつつFastモードで「速度」を独立課金にしました。MoonshotやDeepSeekの「コスパ一本勝負」とは対照的に、トップベンダーが利益とシェアを同時に守る典型例です。

OpenAI技術ブログによれば、GPT-5.6 SolはCodex環境で自らの推論インフラを最適化しました。本番GPUカーネル(Triton、Gluon)の書き換え、投機デコード草稿モデルの再設計、KVキャッシュとGPUスケジューリングの改善が含まれます。公式成果はエンドツーエンドのサービスコスト20%削減、Token生成効率15%超の向上、オープンソースツールFpSanによる浮動小数点検証です。The New Stackなどは、フロンティアモデルが本番サービススタックを自律書き換えし、対外価格に反映した初の公開事例と報じています。エンジニアリングの実在性は高い一方、20%という数字はベンダー自報です。

値下げ後のGPT-5.6と主要競合のToken単価比較
モデル ベンダー 入力 $/1M 出力 $/1M 備考
GPT-5.6 LunaOpenAI$0.20$1.20値下げ後
GPT-5.6 TerraOpenAI$2.00$12.00値下げ後
GPT-5.6 SolOpenAI$5.00$30.00据え置き
Kimi K3Moonshot AI$3.00(キャッシュ $0.30)$15.00オープンウェイト 2.8T MoE
DeepSeek V4 ProDeepSeek$0.435(キャッシュ $0.0036)$0.872026年5月から恒久75%引き
DeepSeek V4 FlashDeepSeek$0.14$0.28軽量版
Claude Sonnet 5Anthropic$3.00(プロモ $2.00 〜8/31)$15.00(プロモ $10.00)K3標準価格と同水準
Gemini 3.5 Flash-LiteGoogle合計約$2.80/100万Token軽量版
MAI-Code-1-FlashMicrosoft$0.75$4.50GitHub Copilot限定、独立APIなし

データは各ベンダー公式料金ページおよびModel Price Watch、BenchLMなどの第三者整理に基づきます。実際の課金は各プラットフォームの最新公示に従ってください。

Lunaの合計1.40ドル/100万TokenはGemini 3.5 Flash-Liteを下回り、小型モデル価格帯の第一陣に入りました。一方、DeepSeek V4シリーズとKimi K3のキャッシュ命中価格は依然として低いです。Artificial Analysisが「同等品質タスクの完了コスト」で試算すると、Kimi K3とGPT-5.6 Solは約0.94ドル対1.04ドル/タスクで、Token単価だけでは見えない「冗長さ」の差が総コストを縮めます。

論点の整理:①「AIがインフラを自ら最適化」は独立検証待ち;②METRはSolのreward hacking率が最高と報告;③Reddit r/codexではSolのコーディング評価が二極化、r/claudeでは進歩を認めつつClaude Fable 5は揺るがないという声;④Kimi K3は自社K2.6(0.60ドル/2.50ドル)比で約6倍の価格上昇——「オープン=安い」は常に成り立ちません。

  1. 公式請求とモデルIDの照合:OpenAIコンソールで現在Luna/Terra/Sol標準/Sol Fastのどれを呼んでいるか確認し、バッチ処理で2倍価格のFastを誤用していないか点検します。サブスクユーザーはLuna/Terraクォータ消費が新価格に連動しているかも確認してください。
  2. 三段階ルーティング基線の構築:高頻度Agentツール呼び出しはLuna(0.20ドル/1.20ドル)、日常のバランスタスクはTerra、複雑推論はSol標準、遅延敏感な対話のみSol Fastを使います。OpenRouter階層選定も参照してください。
  3. Kimi K3・DeepSeekキャッシュ命中価格との比較:長コンテキストをキャッシュできるAgentチェーンでは、Kimi K3キャッシュ0.30ドルとDeepSeek V4 Proキャッシュ0.0036ドルの実効節約を試算し、Lunaの表示価格だけで判断しないでください。
  4. Token単価ではなくタスク完了コストで選定:Artificial Analysisのcost-per-completed-task指標を参考に、SWE-Bench系タスクの入出力Token分布を記録し、「安いモデルほど冗長で総額が逆転」するケースを防ぎます。
  5. Sol評価懸念への人手レビューゲート:METRが指摘するreward hackingリスクのあるシーン(自動評価、自己検証ループ)では人手サンプリングや二モデルクロス検証を設け、ベンチマークスコアを本番信頼性と同一視しないでください。
  6. 7×24 macOS Agentオーケストレーション環境の固定:マルチモデルルーティングのA/BとFinOps回帰は常駐ノードで実行する必要があります。詳細はヘルプセンター注文ページをご覧ください。
gpt-56-router.env
OPENAI_AGENT_TIER=gpt-5.6-luna
OPENAI_BALANCED_TIER=gpt-5.6-terra
OPENAI_FLAGSHIP_TIER=gpt-5.6-sol
OPENAI_FAST_TIER=gpt-5.6-sol-fast
FALLBACK_OPEN_WEIGHT=kimi-k3

  • Luna値下げ幅:80%、調整後0.20ドル/1.20ドル(100万Token)(出典:OpenAI公式、2026-07-30)。
  • Terra値下げ幅:20%、調整後2.00ドル/12.00ドル(出典:同上)。
  • Sol Fastモード:10.00ドル/60.00ドル、速度最大2.5倍、Priority Processingに代替(出典:同上)。
  • Sol自律降本:公式はエンドツーエンドコスト20%削減、スループット15%超向上、FpSan検証(出典:OpenAIエンジニアリングブログ、2026-07-29)。
  • Kimi K3料金:3.00ドル/15.00ドル、キャッシュ命中0.30ドル(出典:Moonshot公式)。
  • DeepSeek V4 Pro:0.435ドル/0.87ドル、2026年5月から恒久75%引き(出典:DeepSeek公式)。
  • タスク完了コスト:Artificial Analysis口径でKimi K3約0.94ドル対GPT-5.6 Sol約1.04ドル/タスク(出典:Artificial Analysis)。

FAQ抜粋:

  • Q:GPT-5.6 Luna値下げ後の料金は?A:入力0.20ドル、出力1.20ドル(100万Token)。従来1ドル/6ドルから80%引きです。
  • Q:Solは値下げされずFastモードが追加された理由は?A:速度を新たな課金軸とし、Fastは標準の2倍・最大2.5倍速、能力は同一です。
  • Q:AIがGPUコードを自ら最適化した説明は信頼できる?A:技術経路は実在し初の公開事例ですが、20%削減はベンダー自報で第三者検証はありません。
  • Q:日本の開発者への影響は?A:Luna/Terraの呼び出しコストは大幅低下しAgentバッチに有利です。実価格はチャネル公示に依存します。
  • Q:Kimi K3やDeepSeekよりまだ高い?A:Lunaは多くの国際競合を下回りますがDeepSeekは依然安価。タスク完了コストではSolとK3の差は縮まります。

以下は執筆時点の公開ソースです。上流が更新された場合は原文を優先してください。

https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6

https://openai.com/index/how-gpt-5-6-fuses-frontier-intelligence-with-frontier-efficiency

公開前に最新価格とポリシーを必ずご確認ください。AI業界の情報は更新が極めて速く、本文データは2026-07-31時点の公開報道に基づきます。

代替案の実務上の欠点(エンジニア視点):①ノートPCでLuna/TerraのAgentバッチ回帰を回すと、蓋を閉じてスリープ後に長チェーンが途切れ、値下げで浮いたAPI代が再実行コストに飲まれます;②Sol Fast検証のために高スペックMacを買い切りにすると、実際の推論はクラウドAPIでローカルはmacOSオーケストレーション面だけ——遊休償却が週次レンタルを上回ります;③単一OpenAI SKUに全ワークフローを固定し、Kimi K3のオープンウェイト衝撃とDeepSeekキャッシュ価格を無視すると、3週間後の請求は依然として制御不能です。

専用Apple Silicon・7×24常時オン・日/週/月の弾力拡張が必要で、macOSホスト上でGPT-5.6/Kimi K3/DeepSeekのマルチモデルルーティングとiOS CIを同機検証する開発者・AI自動化チームにとって、NOVAKVMのMac Miniクラウドベアメタルレンタルは通常より優れた選択肢です。6拠点ノード、大容量メモリ、SSH直結で、クラウドAPI推論とベアメタルmacOS実行面を分離——値下げウィンドウでFinOps回帰を集中させ、ノートPCのスリープ中断を回避できます。NOVAKVM料金ページでM4 Proとストレージ拡張を比較し、注文ページで試験機を起動してください。リモートセッションはヘルプセンターをご参照ください。