OpenAIがGPT-5.6 APIの価格を値下げ:何が変わったのか、その理由、入手方法
Guides & Insights

OpenAIがGPT-5.6 APIの価格を値下げ:何が変わったのか、その理由、入手方法

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

2026年7月30日、OpenAIは低価格帯の2つのGPT-5.6モデルのAPI価格を引き下げ、最安ティアを大幅に値下げし、ミッドティアも削減しました。3週間後、今度はフラッグシップモデルです。2026年8月21日、OpenAIは次のように発表しました。GPT-5.6 SolのAPI価格は、同社がモデルをより効率的に運用するための取り組みにより、今後3か月間20%以上値下がりします。この記事では、2回の値下げで正確に何が変わったのか、その背後にあるエンジニアリング、新価格が競合他社とどう比較されるか、注意すべき隠れたコスト、請求額をさらに削減する方法、そして新価格がすでにOrcaRouterで0%マークアップで利用可能になっていることについて詳しく説明します。

以下の各図は出典が明記されています。料金はトークン100万個あたり(入力/出力)です。LunaおよびTerraの料金は、Unite.AIを含む各メディアが報じたOpenAIの2026年7月30日付レートカードに基づきます。Solの値下げは、OpenAIの2026年8月21日付の発表に基づき、トークン単価はRuntimewireおよびReutersを含む各メディアの報道によるものです。OrcaRouterのパススルーモデルのページにも同じ数値が表示されます。競合他社の数値は出典が明記されています。料金は変動します。構築前に必ずご確認ください。

{{1}}TL;DR.{{/1}} OpenAIは7月30日、GPT-5.6 Lunaを$0.20 / $1.20(従来の$1 / $6から約80%引き)、GPT-5.6 Terraを$2 / $12(従来の$2.50 / $15から約20%引き)に値下げしました。{{2}}8月21日には、この割引をフラッグシップモデルに拡大しました。OpenAIによると、GPT-5.6 Sol APIの価格は今後3か月間、20%以上引き下げられ、100万トークンあたり$5 / $30から$4 / $20になります。一方、トークンベースのCodexおよびChatGPT Workクレジットはより多くのトークンを購入できるようになり、サブスクリプションの利用には変更がありません。{{/2}} {{3}}7月の値下げは、2つの効率化の成果によってまかなわれました。書き直されたGPUカーネル(推論コストを約20%削減)と、再設計された投機的デコード用ドラフトモデル(トークン生成が15%以上高速化)です。{{/3}} {{4}}OrcaRouterのようなベンダー中立・マークアップ0%のエンドポイントを経由すれば、新しい料金はすでに適用されています。同じ価格で、OpenAI互換のAPIが1つあり、その横には比較やルーティングに使えるすべての競合モデルが並んでいます。{{/4}}

重要なポイント

• GPT-5.6 Luna: 100万トークンあたり $0.20 / $1.20 に改定、従来の $1 / $6 から約80%の値下げ。

• GPT-5.6 Terra:現在は$2/$12、以前の$2.50/$15から約20%の値下げです。

• GPT-5.6 Sol(フラッグシップ):今後3か月間は$4 / $20、以前の$5 / $30から引き下げ — 2026年8月21日に発表された20%超の値下げ。

• Codex & ChatGPT Workのトークンベースのクレジットで購入できる量が増加:Solの入力は1Mトークンあたり100クレジット、出力は500クレジットに低下(従来の125 / 750から)。

• サブスクリプションは変更なし:Plus、Pro、Business の利用枠、週5時間の制限、およびレガシークレジット料金は影響を受けません。

• 理由: OpenAIは両方のラウンドを効率性の配当として位置づけました — OpenAIの7月29日のエンジニアリング投稿によると、書き直された本番用GPUカーネル(サービスコスト約20%削減)と、投機的デコーディング用ドラフトモデルの再設計(トークン生成効率15%以上向上)です。

• 入手方法: カットはすでにOrcaRouter(マークアップ0%)に反映されています — Lunaは$0.20 / $1.20、Solは$4 / $20 — 1つのOpenAI互換エンドポイントを通じて。

正確には何が変わったのか

OpenAIのGPT-5.6ファミリーは、Luna(高速・最安)、Terra(ミッド)、Sol(最上位)というティア構成になっています。7月30日の値下げは、安い2つのティアに適用されました。報告されたレートカードによると、GPT-5.6 Lunaは入力/出力トークンあたりの価格が$1/$6から$0.20/$1.20へと低下し、入力・出力とも約80%減となりました。GPT-5.6 Terraは$2.50/$15から$2/$12へと、およそ20%の削減です。GPT-5.6 Sol(最も難しい推論とエージェント型コーディング向けに作られたフラッグシップ)は、その日は変更されませんでした。しかし2026年8月21日に、OpenAIはこれについても一時的な値下げを発表しました。API価格は今後3か月間で20%以上下がり、入力トークンは100万トークンあたり$4、出力トークンは100万トークンあたり$20となり、キャッシュされた入力は$0.50から$0.40に下がります。同じ発表によると、トークンベースのプランでは、購入したクレジットがCodexでより多く使えるようになり、サブスクリプションに含まれる利用量は変わりません。

ベースのトークン単価だけが全体像ではありません。GPT-5.6の料金には、入力長による段階(非常に長いコンテキストはより高いレートに移行)、プロンプトキャッシュの割引(キャッシュ済み入力は新しい入力よりもはるかに安い)、バッチオプション(非同期ジョブは割引)もあります。これら3つすべてが値下げの対象となるため、キャッシュやバッチを多用するワークロードの実効価格はさらに低くなります。逆に、長いコンテキストの段階には注意が必要です。巨大なプロンプトを送ると、上位の段階に上がる可能性があります。

カットの背後にある2つの最適化

これは赤字覚悟の販売戦略ではない。OpenAIはこれを効率化の成果として位置づけている。2026年7月29日のエンジニアリングに関する投稿で、OpenAIの技術スタッフは、CodexとChatGPT Workの背後にある推論とエージェントハーネス全体にわたる最適化について説明した。特に際立つものが2つある。1つ目は、本番インフラ全体にわたるGPUカーネルの書き換えだ。Codex内で動作するSolを使って自社のカーネルを書き換えるもので、OpenAIによればエンドツーエンドの提供コストを約20%削減したという。2つ目は、再設計された投機的デコーディングのドラフトモデルで、トークン生成効率を15%以上改善したと報告されている。提供コストの低下を、大量利用ティアの価格引き下げとして顧客に還元する——それがこの話の要点であり、業界全体が追い求めるフィードバックループ、すなわちフロンティアモデルを使ってそれらを提供するインフラそのものを最適化するという姿を垣間見せている。

8月21日に発表されたSolの値下げも同じ枠組みです。OpenAIによると、今回の削減(今後3か月間で20%以上)は、同社がモデルの実行効率を向上させたことに伴うものであり、恒久的な価格リセットではなく、あくまで一時的なものです。

新しい価格の比較方法

この値下げは明らかに競合を狙ったものだ。Unite.AIの報道によると、Lunaの新価格0.20ドル/1.20ドルは、AnthropicのHaiku 4.5を入力で約5倍、出力で約4倍下回る。また、Terraの新価格2ドル/12ドルは、Claude Sonnet 5の標準価格(2026年8月31日以降に適用される3ドル/15ドルと報じられている)を下回る。オープンウェイト分野では、LunaはDeepSeekのV4シリーズとZhipuのGLM-5.2(約1.20ドル/4.10ドル)が確立した低コスト推論の下限に近い位置にあり、AlibabaのQwenやGoogleのGemini Flashティアも同水準にある。Solの一時的な4ドル/20ドルへの値下げは、フラッグシップを自社のボリューム層よりかなり高い位置に保ちつつ、プレミアムを縮小するものであり、出力トークンの3分の1削減は、出力量の多いエージェントワークロードにとって最も重要だ。この動きに関する報道は、OpenAIがAnthropicや中国のAIモデルとの競争激化に直面している中での出来事だと指摘している。

推論はどんどん安くなり続けている

視野を広げると、今回の値下げは複数年にわたるトレンドに沿っている。研究所が同じハードウェアからより多くのスループットを引き出すにつれ、一定レベルの能力に対するコストは世代を追うごとに急落してきた。OpenAI自身の旧世代プランもこの下落傾向を物語っており、カーネルの改良、投機的デコーディング、より低コストなアテンションといった効率性のブレークスルーは、それぞれ数ヶ月以内に値下げとして現れる傾向がある。買い手にとっての現実的な含意は、推論コストが計画的に低下する世界を前提にアーキテクチャを設計することだ。つまり、単一モデルの価格に過度に依存せず、乗り換えコストを低く抑え続けることである。

注意すべき隠れたコスト:推論トークン

GPT-5.6モデルは推論モデルであり、それが実際のコストに影響を与えます。推論が有効な場合、モデルは出力として課金される内部推論トークンを生成します。そのため、実際の出力コストは、単純な「回答内の単語数」による見積もりよりも高くなる可能性があります。特に、高い推論努力を要する難しいプロンプトでは顕著です。対策としては、タスクに応じて推論努力を調整し(単純な呼び出しでは低くするかオフ)、可能な場合は出力を上限で制限し、想定に頼らず実際のトークン使用量を測定することです。トークンあたりの単価が安いことも役立ちますが、生成するトークン数を制御することの方がより効果的です。

開発者にとっての意味

GPT-5.6 LunaまたはTerraを高ボリュームの作業(分類、抽出、ルーティング、軽量エージェント、チャット)で使用しているなら、請求額は下がっているはずだ。場合によってはその大部分が削減され、コードの変更も不要だ。これにより、ボリュームティアはコスト重視のワークロードにとってさらに魅力的になり、安価なオープンモデルとの価格差も縮まる。 フラッグシップの料金計算も変わった(少なくとも当面は)。Solが今後3か月間$4/$20で提供されることで、最上位ティアにおける推論重視の作業やエージェント型タスクのコストが下がり、トークンベースのCodexとChatGPT Workクレジットもより長く持つ。最も難しいタスクには今でもプレミアムな選択肢であることに変わりはない——ただ、以前よりは安くなっただけだ。 勝ちパターンは同じだ。難易度に応じてルーティングする——簡単な80%には安価なティア(または安価なオープンモデル)を、フラッグシップはコストに見合う場面だけに使う。

請求額をさらに削減する方法

値下げは土台であり、ゴールではありません。最大の追加レバーは次の通りです:プロンプトキャッシング(安定したシステムプロンプトや長いコンテキストを再利用し、はるかに低いキャッシュ入力レートで支払う);バッチオプション(緊急でないジョブを非同期で割引価格で実行する);ティアとモデルのルーティング(各リクエストを処理できる最も安いモデル(オープンモデルを含む)に送る);および推論制御(些細なリクエストに深い推論のコストを払わない)。これらを組み合わせれば、実際の請求額はどの単一の料金変更よりもはるかに削減できます。具体的な目安として:月間1,000万トークン、入力割合70%の場合、Lunaの新しい料金は月額およそ5ドル(キャッシュ利用時は約4.37ドル);同じ量をSolで利用すると月額約125ドル——難易度によるルーティングの最も明確な論拠です。

より低い価格を即座に捉える方法

これが全体を結び付ける部分です。OrcaRouterはマークアップ0%で、プロバイダーの価格をそのまま通します。そのため、OpenAIの値下げはすでにOrcaRouter上で反映されています。GPT-5.6 Lunaは$0.20 / $1.20、Terraは$2 / $12、GPT-5.6 Solは$4 / $20と、モデルページに今すぐ表示されています。これはOpenAI自身のカードと同じ料金であり、単一のOpenAI互換エンドポイントから185以上の他のモデルと一緒にアクセスできます。移行不要で値下げを利用でき、Sol、Luna、TerraをDeepSeek、GLM、Qwen、Gemini、Claudeと一か所で価格比較して、各リクエストをその仕事に最も安いものにルーティングできます。さらに、無料プランと追加の節約のためのオファーページもあります。

値下げはすでにOrcaRouterで実施されています: GPT-5.6 Lunaは1Mトークンあたり$0.20/$1.20、GPT-5.6 Solは1Mトークンあたり$4/$20で、0%マークアップでそのまま提供されています。

難易度でルートを選んで、さらに節約

最も安い請求額は単一のモデルではなく、リクエストごとに適切なモデルを選ぶことで実現します。OrcaRouterはすべてのモデルを単一のエンドポイントで公開しているため、簡単な大量呼び出しはLunaや安価なオープンモデルに送り、難しいリクエストにはSolなどのフラッグシップモデルを温存できます。切り替えは再統合ではなく設定変更だけで完了します。Lunaの値下げにより、この難易度別ルーティング戦略はさらに安くなり、期間限定のSol割引は難しい呼び出しのコストも引き下げます。しかも、配管をやり直す必要は一切ありません。

よくある質問

OpenAIはGPT-5.6の価格をどれくらい値下げしましたか?

GPT-5.6 Luna は、100万トークンあたり $1 / $6 から $0.20 / $1.20 に値下がりし(約80%)、GPT-5.6 Terra は $2.50 / $15 から $2 / $12 に値下がりしました(約20%)。2026年8月21日、OpenAI は GPT-5.6 Sol も今後3か月間、$5 / $30 から $4 / $20 に値下げしました。

値下げはいつから有効になりましたか?

LunaおよびTerraの料金引き下げは、2026年7月30日付で公開レートカードに反映されました。OpenAIは2026年8月21日に、今後3か月間のSolの一時的な料金引き下げを発表しました。

OpenAIはなぜ価格を引き下げたのですか?

OpenAIは、7月の値下げを推論最適化によるものとしている ― 書き直された本番用GPUカーネル(サービス提供コスト約20%削減)と、再設計された投機的デコーディング用ドラフトモデル(トークン生成効率15%以上向上)である ― 2026年7月29日のエンジニアリング投稿によると。同社はSolの値下げも同様に、競争が激化する市場においてモデルの運用コストが下がる中で講じた一歩として位置づけた。

フラッグシップ(Sol)は安くなりましたか?

はい — 一時的に。7月30日の値下げでGPT-5.6 Solは$5 / $30でしたが、2026年8月21日にOpenAIは今後3か月間、20%以上の値下げを発表し、100万トークンあたり$4 / $20となりました。CodexとChatGPT Workのトークンベースのクレジットもより多く購入でき、サブスクリプションの利用は変わりません。

新しい価格はAnthropicやオープンモデルとどう比較されますか?

報道によると、Lunaは現在、AnthropicのHaiku 4.5を入力で約5倍、出力で約4倍下回り、TerraはClaude Sonnet 5の標準価格($3/$15)を下回る。またLunaは、DeepSeekとGLM-5.2が設定した安価なオープンモデルの下限にも近い。

推論トークンの落とし穴は何ですか?

GPT-5.6は推論モデルです。内部推論トークンは出力として課金されるため、実効的な出力コストが単純な見積もりを超える可能性があります。推論努力を調整し、出力を制限してコストを管理してください。

新しい低価格はどうやって手に入れますか?

これらはすでにOpenAIのAPI上で、また0%マークアップでOrcaRouter上でも稼働しています。OrcaRouterではGPT-5.6 Lunaが$0.20/$1.20、GPT-5.6 Solが$4/$20と表示され、OpenAI互換の単一エンドポイントを通じて利用できるため、コードの変更は一切不要です。

結論

OpenAIの7月30日の値下げにより、GPT-5.6 LunaとTerraは高負荷なワークロードで劇的に安価になりました。そして8月21日の発表で、その流れはフラッグシップモデルにも広がっています。GPT-5.6 Solは今後3か月間、$4 / $20に引き下げられ、Codexのトークンクレジットはより多く購入でき、サブスクリプションの利用は変わりません。この2つの値下げは、どちらも効率化の成果です。一方はカーネル書き換えと投機的復号化によるゲイン、もう一方はより低コストな推論サーバーによるものであり、現実の価格競争への明確な対応でもあります。難易度に応じてルーティングし、キャッシュとバッチ処理を活用し、推論トークンを制御することで、最大限のコスト削減が可能です。さらにOrcaRouterはプロバイダーの価格を0%マークアップでそのまま通すため、値下げ後の料金はすでに反映されています。Lunaは$0.20 / $1.20、Solは$4 / $20です。同じ価格で、OpenAI互換のエンドポイント1つから、すべてのモデルが利用できます。コードを1行も変更せずに値下げを適用し、各リクエストにその仕事を処理できる最も安いモデルを選択させることができます。