
GPT-5.6 Sol APIの料金:100万トークンあたり5ドル/30ドル、キャッシュ0.50ドル、そして実際のコスト
- DeepSeekNEWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100万トークンあたり
- z-aiNEWZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianNEWQwen3.8 27B2026-08-1552知能68コーディング
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokNEWSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
GPT-5.6 Sol は、入力100万トークンあたり5.00ドル、出力100万トークンあたり30.00ドルです。これは GPT-5.6 Sol API での料金であり、OrcaRouter ディレクトリでフラッグシップティアが提示している料金と同じです(2026-08-18 時点で確認済み、マークアップはゼロ)。GPT-5.6 ファミリーの中で最も高価なティアであり、7月30日の値下げでも定価が変わらなかった唯一のティアです。そのため、予算を組む際は、稼働中の GPT-5.6 Sol モデルページの料金表を基準にしてください。見出しの数字よりも調整要素が重要です。プロンプトキャッシュによる再利用入力は100万トークンあたり0.50ドル、バッチAPIでは入力2.50ドル / 出力15.00ドルに下がり、ファストモードは2倍の割増料金と引き換えに最大2.5倍の速度を提供します。このページは Sol 専用の料金リファレンスです。正確な料金表、リクエストの実際のコスト、フラッグシップと他モデルとの比較、購入が不適切なケース、そして独自のキーで OpenAI 互換の単一エンドポイントを通じて呼び出す方法を解説します。
料金は100万トークンあたりの価格(入力/出力)で、2026-08-18時点のものです。ドル表示額はOpenAIが公開しているAPI料金から読み取り、GPT-5.6 SolのOrcaRouterモデルページと照合しています。キャッシュ、バッチ、高速モード、および長文コンテキストの料金はOpenAIが発表したものです。料金は変動します — 構築する前に必ず確認してください。
本日確認済みの正確な価格
こちらがGPT-5.6 Solの完全なレートカードです(2026-08-18確認済み):

• 入力 — キャッシュミス時、1Mトークンあたり$5.00.
• 出力 — $30.00 / 1Mトークン。
• プロンプトキャッシュ読み取り — 1Mトークンあたり$0.50、再送信する入力は90%割引。
• Prompt cache write — 1Mトークンあたり$6.25。
• ロングコンテキスト層 — 約272Kトークンを超える入力は、入力$10.00 / 出力$45.00(入力の2倍、出力の1.5倍)で課金されます。
• Batch API — 入力$2.50 / 出力$15.00、一律50%オフ、非同期、通常約24時間以内に準備完了。
• 高速モード — 入力$10.00 / 出力$60.00、知能に変化はなく、最大約2.5倍の出力速度に対する2倍のプレミアム。
• コンテキストウィンドウ — 約1.05Mトークン、最大128K出力。
OrcaRouterはプロバイダーの料金をマークアップなしでそのまま通すため、ディレクトリに表示されている金額がそのまま支払額になります。ライブモデルページのカードには、100万トークンあたり$5.00 / $30.00、キャッシュ読み取りは$0.500と表示され、Vision、Tools、JSON、Reasoningのバッジが付いています。Solの$5 / $30も値下げ前の価格のままです。OpenAIの7月30日の値下げはGPT-5.6 Luna(現在$0.20 / $1.20)とGPT-5.6 Terra(現在$2 / $12)に適用され、フラッグシップは据え置かれました。
実効価格を変えるレバー
基準レートは出発点に過ぎません。4つの修正要素が、Solの実際のコストを変えます:
• プロンプトキャッシュ — 再利用されたコンテキストは100万トークンあたり$0.50で請求され、新規の場合は$5、キャッシュ書き込みは100万トークンあたり$6.25です。毎ターン大きなプレフィックスを再送信するエージェントやチャットにとって、キャッシュは請求額に最も大きな影響を与える要素です。OpenAIはキャッシュをプロジェクトとAPIキーごとに管理するため、1つのキー(1つのチャネル)に固定することがヒット率を維持する鍵となります。
• ロングコンテキストティア — 入力がおよそ272Kトークンを超えるリクエストは、基本レートから$10 / $45に移行します。少数の巨大なプロンプトは、平均価格を気づかないうちに上げることがあります。そのため、深いコンテキストが本当に必要でない場合は、バッチ処理するか入力を切り詰めてください。
• バッチ — OpenAIのバッチAPIは、ジョブを非同期で実行し、約24時間のターンアラウンドで、価格は正確に半額の$2.50 / $15.00(キャッシュ入力は$0.25、キャッシュ書き込みは$3.13)です。プロンプトキャッシングと併用でき、レイテンシーが問題にならない評価(evals)、一括分類、オフライン生成に適しています。
• 高速モード — $10 / $60 で、最大約2.5倍の出力スループットを実現。レイテンシが重要で、ユーザーが待っている作業(ライブコーディング支援など)に役立ちます。トークンごとに標準レートの2倍で課金され、購入したScale TierのTPMパッケージにはカウントされず、共有レート制限を超えた場合は標準処理にフォールバックすることができます。
リクエストの実際のコスト
トークン単価は抽象的でわかりにくいので、本日のレートでの具体的な計算例を示します:
• チャット1回、50K入力 + 20K出力 — $0.25 + $0.60 = $0.85。
• 1M入力 + 1M出力 — $5 + $30 = $35。
• エージェンティックターン、200Kのキャッシュ済みコンテキスト + 20Kの新規入力 + 30Kの出力 — $0.10 + $0.10 + $0.90 = $1.10。同じターンをコールドキャッシュで行う場合 — 220Kの新規入力($1.10) — 合計は$2.00。キャッシュによりほぼ半減します。
• 10Mトークンの月間使用量(入力70% / 出力30%)で、入力の80%がキャッシュから配信されると、1.4Mの新規入力($7.00) + 5.6Mのキャッシュ入力($2.80) + 3Mの出力($90) ≈ $100。キャッシュなしでは、同じ月は$125 — そして同じ月をGPT-5.6 Terraで実行すると約$50、GPT-5.6 Lunaでは約$5になります。SolとLunaの間の20倍の差こそ、単一の料金よりもティアマッチングが重要である理由です。
実効レートを引き上げる注意点が2つある。Solは推論モデルであり、内部推論トークンは出力として100万トークンあたり30ドルで課金される。高い推論努力設定の難しいプロンプトでは、出力予算の多くを思考に費やす可能性があるため、困難な作業における実効出力コストは単純な見積もりを大幅に上回る。さらに、OpenAIのトークナイザーは一部の入力において従来世代よりも冗長であるため、同じテキストでもGPT-5.5よりも多くのトークンを消費する可能性がある。推論努力はタスクに合わせて調整し、可能な限り出力を制限し、請求を見積もる前に実際の使用量を測定すること。
Solの価格設定は競合他社とどう比較されるか

2026-08-18に公表されたリスト価格に照らして読み取った値:
• GPT-5.6 Terra — $2 / $12、値下げ後の中間ティアです。Sol は入力と出力の両方で2.5倍のコストがかかります。フラッグシップ推論が不要な場合は、Terra がデフォルトです。
• GPT-5.6 Luna — $0.20 / $1.20、値下げ後のボリュームティア。Sol との入力差は25倍で、Luna はトラフィックの大半を手頃に処理できる価格設定です。
• Claude Opus 5 — $5 / $25。同じ入力なら、紙の上では出力が20%安い。実際には、一部のワークロードでは比較が逆転する。このブログは以前、同じ英語/混合サンプルで、SolがAnthropicモデルよりも約34.5%少ないトークンであると測定した。また、公開されたトークン経済分析(TheBlockBeats)は、より高い出力レートにもかかわらず、同等の作業に対してSolの総請求額がClaude Opus 5よりも約21%低くなる可能性があると推定している。ステッカープライスではなく、自分自身のトークナイザーを測定しよう。
• Claude Fable 5 — $10 / $50。Sol は入力価格の半分で、出力は Anthropic の最上位モデルより40%安い。
• Claude Opus 4.8 — $5 / $25。入力はSolと同じ、出力はより安価 — Anthropicの前世代フラッグシップモデル。
• Grok 4.6 — $2 / $6。ボード上で最も際立った数字:Artificial Analysis指数でGPT-5.6 Solに並んだ(両方とも61)。入力価格は2.5倍安く、出力価格は5倍安い。
• DeepSeek V4 Pro — $0.44 / $0.88 オフピーク時(ピーク時間帯は2倍)。安価なオープンウェイト向けとしては、まったく別次元の価格帯です。
正直に言えば:Solはプレミアムな出力レートを備えたプレミアム・フラッグシップです。これはClaude Fable 5未満のクローズド・フラッグシップの中で最高の出力レートです。Solが勝っているのは絶対的なレートではなく、ハードワーク単位当たりの実効コスト(トークナイザー、推論、長いコンテキスト)においてです。トラフィックが短いプロンプトと単純なタスク中心であれば、$2のTerra、$0.20のLuna、または$2/$6のGrok 4.6の方が割安です。そしてインデックス上では、Grok 4.6は書面上では何も劣っていません。
Solが間違った選択であるとき
この価格がご希望の価格ではない4つのケース:
短く単純なプロンプト。 およそ20Kトークン未満で深い推論を必要としない場合、フラッグシップのプレミアムは無駄になる。GPT-5.6 Terra($2 / $12)またはGPT-5.6 Luna($0.20 / $1.20)は、わずかなコストでボリューム層を処理できる。そして、Grok 4.6やDeepSeekクラスのモデルはさらに低コストである。
推論負荷の高いボリューム。思考は出力として請求されるため、高努力設定の難しいプロンプトは、名目上の出力トークン数をはるかに超えるコストになることがあります。ワークロードが多くの難しい呼び出しを含む場合は、コミットする前に実際の出力トークンを測定してください。実効レートには驚かされるかもしれません。
トークン単価を唯一の目標とする。 Grok 4.6 はインデックスで Sol と同率の $2 / $6 となり、DeepSeek V4 Pro はオフピーク時に $0.44 / $0.88 です。フロンティアベンチマークのスコアが必須条件でないなら、これらのモデルは同じクラスの作業に対してはるかに低いトークン単価を実現します。
厳格なレイテンシ予算。Solは大規模な推論モデルであるため、最初のトークンまでの時間(TTFT)がFlashレベルのモデルを大きく上回ります。サブ秒のTTFTが重要なリアルタイムチャットでは、$10 / $60の高速モードはスループットを向上させるものであり、最初のトークンのレイテンシを下げるものではありません。そして、より小さなモデルの方が依然として安価な修正策です。
OrcaRouterでの呼び出し方

GPT-5.6 Sol は OrcaRouter 上でモデル ID openai/gpt-5.6-sol としてホストされ、OpenAI 互換エンドポイント api.orcarouter.ai/v1 を通じて、プロバイダー料金のままマークアップなしで提供されます。すでに OpenAI クライアントをお持ちの場合、移行はベース URL とモデル ID の変更のみです。同じキーとエンドポイントで 200 以上のモデルを利用できるため、Sol は GPT-5.6 Terra、GPT-5.6 Luna、Claude Opus 5、Claude Fable 5、Grok 4.6、そして比較したいオープンウェイトモデルの隣に位置し、各モデルを再統合することなく難易度に応じてルーティングできます。
料金ページで紹介する価値のあるOrcaRouter固有の2つのポイント。 BYOK: お客様自身のOpenAIキーを持ち込み、OpenAIが独自の料金で直接請求します。OrcaRouterはトークンあたり$0を上乗せし、プロバイダーのレート制限とクレジットをそのまま維持します。 Guardrails: PIIシールドとコンテンツポリシーは課金前に実行されるため、ブロックされたリクエストはクリーンな400を返し、課金されることはありません。また、Agent Firewallはツール呼び出しとMCP呼び出しを実行前に評価します。
料金ページにとって重要な正直な注記:私たちはモデルのルーティングを行うだけで、価格を設定するわけではありません。$5 / $30という数字は、OpenAIのレートをそのまま反映したものです。OpenAIがそれを変更すると、掲載も追従します。— このページに日付が記載されているのは、まさにそのためです。OpenAIを直接呼び出しても同じレートです。OrcaRouterは、モデルライン全体で単一のエンドポイントを利用したい場合のために、単一キー・マークアップなしのルートを提供します。
出典と日付
上記のすべての価格は2026年8月18日に検証されました。GPT-5.6 Solの数値は、OpenAIが公開しているAPI料金から取得し、同日に確認したOrcaRouterのGPT-5.6 Solモデルページ、および当社が公開しているGPT-5.6の料金ページと照合しています。バッチ、高速モード、キャッシュ書き込み、長文コンテキストの各料金は、OpenAIが発表したものです。Claude、Grok、DeepSeekの数値は現在のOrcaRouterディレクトリのリストに基づくもので、DeepSeek V4 Proはオフピーク料金で表示されています。OpenAIは2026年7月9日のローンチ以降、Solの定価を変更していません(7月30日の値下げでもフラッグシップは対象外でした)が、価格は変動するものです。以前の「GPT-5.6 Sol pricing」ページを見つけた場合は、その日付を確認した上で扱ってください。ここに記載されている数値は本日時点の最新情報です。
上記のすべての価格は、次のライブレートです:GPT-5.6 Sol on OrcaRouter — 2026-08-18時点、マークアップなしで確認済み、ご自身のキーですぐにご利用いただけます。
この記事で比較したモデル3
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
