
GPT-5.6 Sol API:呼び出し方、料金、そしてダウングレードすべきタイミング
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 112 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 53 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 58 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 372 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.
2つの方言と1つのモデルID
GPT-5.6 Solのチュートリアルのほとんどは、単一の方言だけを示してそこで止まっています。実際には2つあり、どちらも同じ重みに到達します。
• Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.
• Responses API — client.responses.create.同じモデルIDで、より新しいリクエスト形式を使用します。単一のinputフィールドとreasoningブロック({"effort": "high"})の代わりにmessages配列を使用します。OpenAIは、reasoningパラメータを直接受け取り、reasoningトークンを第一級の出力として返すので、新規ビルドにはこれを推奨しています。また、最高の努力レベルはここでのみ利用可能です。
• ティアを固定する。ベアのエイリアス gpt-5.6は現在 Sol にルーティングされますが、エイリアスはまさに、新しいフラッグシップが出荷されるときにベンダーが変更するものです。そして、gpt-5.6-solを明示的に渡すということは、すべての呼び出しがそのコストを明示し、それがすべてのゲートウェイが期待するIDであることを意味します。
得られるもの — そして、請求額を決めるダイヤル
GPT-5.6 Sol は、OpenAI の推論重視のフラッグシップモデルです。約105万トークンのコンテキストウィンドウ、128Kの最大出力、2026年2月16日の知識カットオフ、そしてテキスト・画像・ファイル入力とテキスト出力を備えています。独立した Artificial Analysis リーダーボードでは、AAインテリジェンス指数61およびAAコーディングスコア77、さらにSWE-bench Proスコア64.6%を記録しています(llm-statsによる独立測定)。コーディングの数値こそ、エージェント業界が実際に引用している数字です。

思考はデフォルトでオンになっています、そして推論努力パラメータはレイテンシとコストの両方において最も大きな影響を与える要素です:
• 6つのレベル — none、low、medium、high、xhigh、max。noneは機械的なタスクでは推論をオフにし、maxはエラーコストが高い問題用で、Responses APIでのみ利用可能です。
• 中程度から始めて、一度に1レベルずつ動かします。apidog GPT-5.6 チュートリアルによると、多くの GPT-5.5 ワークロードは 5.6 系では品質が1レベル低いまま維持されます。より多くの思考にコストをかける前に、品質を測定してください。
• Proモードは設定であり、モデルではありません。に設定すると、reasoning.mode: "pro"モデルは速度よりも回答品質を優先します。価格とモデルIDは変わりません。
• 詳細度 — 低、中(デフォルト)、高 — 推論とは独立に出力の長さを制御します。
• 推論トークンは出力トークンとして、100万トークンあたり30ドルで請求されます。xhighまたはmaxの難しいプロンプトでは、内部推論が請求額の大部分を占めることがあります — 値札には決して載らない、推論モデル料金設定の隠れた部分です。
Solの実際のコスト
Solの基本価格は、OpenAIの2026年7月30日の値下げ後も変わりませんでした:100万入力トークンあたり5ドル、100万出力トークンあたり30ドル。値下げは2つの低価格帯に適用されました —GPT-5.6 Terraは$2 / $12に、そしてGPT-5.6 Lunaは$0.20 / $1.20に下がりました—これは、Solが過剰であることを示す正確な比較対象となるため、ここで重要です。

3つの修飾子が実効レートを変更します:
• プロンプトキャッシュ。再利用された入力はおおよそ100万トークンあたり$0.50で課金され(キャッシュ読み取り時、新規入力より90%オフ)、キャッシュ書き込みは100万トークンあたり$6.25(非キャッシュ入力の1.25倍)で課金されます。キャッシュはデフォルトで暗黙的に有効になり、prompt_cache_optionsとttlを指定して明示的にすることができます。キャッシュされたプレフィックスは少なくとも1,024トークン必要で、少なくとも30分間ウォームな状態が維持されます。
• 長文コンテキストのティア。入力サイズが閾値を超えると、Sol は$10 / $45 per millionにステップアップします。ごく一部の非常に長いプロンプトが、平均価格を静かに押し上げます。
• モデルが出力するものはすべて出力です。これには内部推論トークンも含まれるため、推論を多用する呼び出しでは、出力側にコストが集中します。
具体的な請求書の例:100Kトークンのリクエストが20K出力トークンを生成する場合、請求額は、入力が$0.50、出力が$0.60、合計$1.10で、キャッシュされていない場合です。次の呼び出しでその100Kプロンプトがキャッシュから提供されると、入力側は約$0.05、往復は約$0.65になります。一日中同じシステムプロンプトを再利用する長いエージェントループでは、キャッシュがSolの手頃さを左右します。
Solが量子コンピューティング実験を実行:OpenAIの記事
現時点で最も有力な答えは、その$5 / $30という料金で得られるものに対するもの、すなわちOpenAI自身が2026年9月8日に公開したユースケース(公式投稿、「GPT-5.6 Solが量子コンピューティング実験の実行をどのように支援するか」)であり、モデルを別のコーディングベンチマークではなく実際の実験室ハードウェアに向けることに関するものです。その中でOpenAIは、MITのEngineering Quantum Systems Group (EQuS)の大学院生であるBeatriz Yankelevichを紹介しています。この研究室は、ほぼ絶対零度に冷却された超伝導量子ビットを研究しています。そして彼女が接続しているのは、GPT-5.6 Sol(Codex経由で実行される)を、そのチップ上の測定を調整するソフトウェアに接続することです。測定固有のスキルとチップの設計目標が与えられたとき、GPT-5.6 Solは測定パラメータを選択し、ハードウェアを駆動し、返ってきたデータを分析し、何を改善または保存するかを決定しました。未較正の6量子ビットチップ上で、研究者の介入がほとんどない状態で標準較正シーケンスを完了しました。各量子ビットの遷移周波数を見つけ、量子ビットの制御と読み出しを行うパルスを較正し、量子ビットが量子情報を保持する時間を測定しました。
OpenAIはその境界線について率直で、その留保は主張と同じ息遣いで語られるべきものだ。実験的なシグナルが弱かったりノイズが多かったりすると、Sol は実行可能なパラメータを見つけるのに時間がかかり、時に経験豊富な研究者が舵を取る必要があった。この投稿はOpenAI が報告した——独立したベンチマークではなくベンダーのケーススタディ——として扱い、その本当のシグナルはワークロードプロファイルとして受け止めるべきだ。EQuS は今や、エージェントが日常的なチップ特性評価を一晩で実行できるようにする。これはかつて、チップ1枚あたり研究者の数日を要した作業だ。まさにこれが、推論ダイヤルが存在する理由となるタスクの形である。長く、多段階で、ツールを使うループ——モデルが次に何をするかを決め、誤った一手が高くつく。それはまた、同じgpt-5.6-solの重みでもあり、API を通じてたどり着くものだ——Codex はハーネスであり、別のモデルではない。
1つのエンドポイント、200以上のモデル
If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

経済面は正直なところです。OrcaRouterが追加するのはトークンあたり$0です — モデルページの$5 / $30はOpenAIの料金をそのまま転送したもので、ベンダーの価格変更は発表された当日に当社側で反映されます。 キー持ち込みはファーストクラスのオプションです。既存のOpenAIキーを渡せば、自身のレート制限とクレジットを維持でき、OpenAIから直接請求されます。ガードレール — PIIシールドとコンテンツポリシー — は、リクエストが課金される前に適用され、課金後ではありません。ルーティングDSLはフェイルオーバーを構成するため、Solがエラーを起こした場合やトラフィックの形状が許す場合に、より安価なモデルが応答します。
Solが間違ったティアにいる時
旗艦モデルであることは、すべての用途に適しているという意味ではありません。$5 / $30という料金が不利になる場面が3つあります。
• 高頻度・低重要度のコール。 月間1,000万入力トークンを処理する分類・抽出パイプラインのコストはSolでは$50に対しGPT-5.6 Lunaでは$2 — 同じエンドポイント、同じキー、IDを1つ変えるだけ。Lunaの$0.20 / $1.20という価格設定は、まさにこの用途向けです。
• フロンティア級の深さを必要としないミッドティアの推論。 GPT-5.6 Terraは、$2 / $12 でボリューム層とフラッグシップ層の間に位置します。apidog チュートリアルのアドバイスは賢明なデフォルトです。Terra でプロトタイプを作成し、Terra が明確に失敗する場合にのみ Sol にエスカレーションし、安定した高ボリュームのパスは Luna に移行します。
• 約束できることの限界OrcaRouterはルーティングと課金を行い、OpenAIはモデルを実行します。エンドポイント、ゼロマークアップ、フェイルオーバー、ガードレールは当社のものですが、推論品質と安全性の挙動はOpenAIのものであり、BYOKでは料金は直接OpenAIに支払われます。これが明確に述べられた取引内容です。どちらにせよプロバイダー料金を支払うことになり、問題は200以上のモデルに対する単一のエンドポイントに価値があるかどうかです。
結論
既存のOpenAIクライアントをお持ちの場合はChat Completionsで、新規に構築する場合はResponses APIで、GPT-5.6 Sol APIを呼び出してください。モデルIDはgpt-5.6-sol、レートは$5/$30、推論ダイヤルもどちらでも同じです。タスクが難しく、コンテキストが長く、出力が100万トークンあたり$30に見合う場合は最適なモデルです。逆に、日常的なタスクでは、TerraとLunaの方がはるかに低コストなので、不適切なモデルです。最もクリーンな構成は、考えを変えられる構成です。つまり、単一のエンドポイント、自分のAPIキー、$0のマークアップ、そしてワークロードが変わった日に交換できるモデルIDです。
GPT-5.6 Sol は OrcaRouter で利用可能になりました。OpenAI の定価 $5 / $30、トークンあたりのマークアップは $0 です。既存の OpenAI キーを使用すれば、プロバイダーが直接請求します。まずは GPT-5.6 Sol on OrcaRouter から始めましょう。単一のエンドポイントで、追加の統合は不要です。
