
GPT-5.6 Sol API:呼び出し方、料金、そしてダウングレードすべきタイミング
- obsidianNEWQwen3.8 27B Uncensored (Aggressive)2026-08-1552知能68コーディング
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-1359 tok/s
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokNEWSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaNEWMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり · 230 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
- grokxAI: Grok 4.52026-07-0856知能72コーディング
- tencentTencent: Hy32026-07-0642知能59コーディング
To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.
2つの方言と1つのモデルID
GPT-5.6 Solのチュートリアルのほとんどは、単一の方言だけを示してそこで止まっています。実際には2つあり、どちらも同じ重みに到達します。
• Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.
• Responses API — client.responses.create.同じモデルIDで、より新しいリクエスト形式を使用します。単一のinputフィールドとreasoningブロック({"effort": "high"})の代わりにmessages配列を使用します。OpenAIは、reasoningパラメータを直接受け取り、reasoningトークンを第一級の出力として返すので、新規ビルドにはこれを推奨しています。また、最高の努力レベルはここでのみ利用可能です。
• Pin the tier. The bare alias gpt-5.6 routes to Sol today, but an alias is exactly what a vendor changes when a new flagship ships. Passing gpt-5.6-sol explicitly means every call states what it costs, and it is the id every gateway expects.
得られるもの — そして、請求額を決めるダイヤル
GPT-5.6 Sol は、OpenAI の推論重視のフラッグシップモデルです。約105万トークンのコンテキストウィンドウ、128Kの最大出力、2026年2月16日の知識カットオフ、そしてテキスト・画像・ファイル入力とテキスト出力を備えています。独立した Artificial Analysis リーダーボードでは、AAインテリジェンス指数61およびAAコーディングスコア77、さらにSWE-bench Proスコア64.6%を記録しています(llm-statsによる独立測定)。コーディングの数値こそ、エージェント業界が実際に引用している数字です。

思考はデフォルトでオンになっています、そして推論努力パラメータはレイテンシとコストの両方において最も大きな影響を与える要素です:
• 6つのレベル — none、low、medium、high、xhigh、max。noneは機械的なタスクでは推論をオフにし、maxはエラーコストが高い問題用で、Responses APIでのみ利用可能です。
• 中程度から始めて、一度に1レベルずつ動かします。apidog GPT-5.6 チュートリアルによると、多くの GPT-5.5 ワークロードは 5.6 系では品質が1レベル低いまま維持されます。より多くの思考にコストをかける前に、品質を測定してください。
• Proモードは設定であり、モデルではありません。に設定すると、reasoning.mode: "pro"モデルは速度よりも回答品質を優先します。価格とモデルIDは変わりません。
• 詳細度 — 低、中(デフォルト)、高 — 推論とは独立に出力の長さを制御します。
• 推論トークンは出力トークンとして、100万トークンあたり30ドルで請求されます。xhighまたはmaxの難しいプロンプトでは、内部推論が請求額の大部分を占めることがあります — 値札には決して載らない、推論モデル料金設定の隠れた部分です。
Solの実際のコスト
Solの基本価格は、OpenAIの2026年7月30日の値下げ後も変わりませんでした:100万入力トークンあたり5ドル、100万出力トークンあたり30ドル。値下げは2つの低価格帯に適用されました —GPT-5.6 Terraは$2 / $12に、そしてGPT-5.6 Lunaは$0.20 / $1.20に下がりました—これは、Solが過剰であることを示す正確な比較対象となるため、ここで重要です。

3つの修飾子が実効レートを変更します:
• プロンプトキャッシュ。再利用された入力はおおよそ100万トークンあたり$0.50で課金され(キャッシュ読み取り時、新規入力より90%オフ)、キャッシュ書き込みは100万トークンあたり$6.25(非キャッシュ入力の1.25倍)で課金されます。キャッシュはデフォルトで暗黙的に有効になり、prompt_cache_optionsとttlを指定して明示的にすることができます。キャッシュされたプレフィックスは少なくとも1,024トークン必要で、少なくとも30分間ウォームな状態が維持されます。
• 長文コンテキストのティア。入力サイズが閾値を超えると、Sol は$10 / $45 per millionにステップアップします。ごく一部の非常に長いプロンプトが、平均価格を静かに押し上げます。
• モデルが出力するものはすべて出力です。これには内部推論トークンも含まれるため、推論を多用する呼び出しでは、出力側にコストが集中します。
具体的な請求書の例:100Kトークンのリクエストが20K出力トークンを生成する場合、請求額は、入力が$0.50、出力が$0.60、合計$1.10で、キャッシュされていない場合です。次の呼び出しでその100Kプロンプトがキャッシュから提供されると、入力側は約$0.05、往復は約$0.65になります。一日中同じシステムプロンプトを再利用する長いエージェントループでは、キャッシュがSolの手頃さを左右します。
1つのエンドポイント、200以上のモデル
If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

経済面は正直なところです。OrcaRouterが追加するのはトークンあたり$0です — モデルページの$5 / $30はOpenAIの料金をそのまま転送したもので、ベンダーの価格変更は発表された当日に当社側で反映されます。 キー持ち込みはファーストクラスのオプションです。既存のOpenAIキーを渡せば、自身のレート制限とクレジットを維持でき、OpenAIから直接請求されます。ガードレール — PIIシールドとコンテンツポリシー — は、リクエストが課金される前に適用され、課金後ではありません。ルーティングDSLはフェイルオーバーを構成するため、Solがエラーを起こした場合やトラフィックの形状が許す場合に、より安価なモデルが応答します。
Solが間違ったティアにいる時
旗艦モデルであることは、すべての用途に適しているという意味ではありません。$5 / $30という料金が不利になる場面が3つあります。
• 高頻度・低重要度のコール。 月間1,000万入力トークンを処理する分類・抽出パイプラインのコストはSolでは$50に対しGPT-5.6 Lunaでは$2 — 同じエンドポイント、同じキー、IDを1つ変えるだけ。Lunaの$0.20 / $1.20という価格設定は、まさにこの用途向けです。
• フロンティア級の深さを必要としないミッドティアの推論。 GPT-5.6 Terraは、$2 / $12 でボリューム層とフラッグシップ層の間に位置します。apidog チュートリアルのアドバイスは賢明なデフォルトです。Terra でプロトタイプを作成し、Terra が明確に失敗する場合にのみ Sol にエスカレーションし、安定した高ボリュームのパスは Luna に移行します。
• 約束できることの限界OrcaRouterはルーティングと課金を行い、OpenAIはモデルを実行します。エンドポイント、ゼロマークアップ、フェイルオーバー、ガードレールは当社のものですが、推論品質と安全性の挙動はOpenAIのものであり、BYOKでは料金は直接OpenAIに支払われます。これが明確に述べられた取引内容です。どちらにせよプロバイダー料金を支払うことになり、問題は200以上のモデルに対する単一のエンドポイントに価値があるかどうかです。
結論
既存のOpenAIクライアントをお持ちの場合はChat Completionsで、新規に構築する場合はResponses APIで、GPT-5.6 Sol APIを呼び出してください。モデルIDはgpt-5.6-sol、レートは$5/$30、推論ダイヤルもどちらでも同じです。タスクが難しく、コンテキストが長く、出力が100万トークンあたり$30に見合う場合は最適なモデルです。逆に、日常的なタスクでは、TerraとLunaの方がはるかに低コストなので、不適切なモデルです。最もクリーンな構成は、考えを変えられる構成です。つまり、単一のエンドポイント、自分のAPIキー、$0のマークアップ、そしてワークロードが変わった日に交換できるモデルIDです。
GPT-5.6 Sol は OrcaRouter で利用可能になりました。OpenAI の定価 $5 / $30、トークンあたりのマークアップは $0 です。既存の OpenAI キーを使用すれば、プロバイダーが直接請求します。まずは GPT-5.6 Sol on OrcaRouter から始めましょう。単一のエンドポイントで、追加の統合は不要です。
