
GPT-5.6 Sol API:如何呼叫、費用為何,以及何時該降級
- obsidian新Qwen3.8 27B Uncensored (Aggressive)2026-08-1552智能68程式
- qwen新Qwen: Qwen3.8 27B (free)2026-08-1359 tok/s
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grok新SpaceXAI: Grok 4.62026-08-1261智能77程式
- meta新Meta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens · 230 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
- grokxAI: Grok 4.52026-07-0856智能72程式
- tencentTencent: Hy32026-07-0642智能59程式
To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.
兩種方言和同一個模型ID
大多數 GPT-5.6 Sol 教學只展示單一方言就到此為止。其實有兩種,而且兩者都能達到相同的權重。
• Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.
• Responses API — client.responses.create. 使用相同模型 ID,但請求格式較新:單一 input 欄位和 reasoning 區塊({"effort": "high"}),取代原本的 messages 陣列。OpenAI 建議新專案採用此方式,因為它直接接受推理參數,並將推理 token 以第一級輸出形式回傳——而最高推理強度也只有在此才可使用。
• 固定層級。 裸別名 gpt-5.6 目前路由到 Sol,但當新款旗艦機出貨時,供應商更動的正是別名。明確傳遞 gpt-5.6-sol 表示每次呼叫都標明了其成本,而這也是每個閘道所預期的 ID。
你獲得的內容 — 以及決定你帳單的儀表
GPT-5.6 Sol 是 OpenAI 主打深度推理的旗艦模型:約 105 萬 token 的上下文視窗、128K 最大輸出、知識截止日期為 2026 年 2 月 16 日,並支援文字、圖像和檔案輸入,輸出為文字。在獨立的 Artificial Analysis 排行榜上,它的 AA 智能指數為 61,AA 編碼得分為 77,SWE-bench Pro 得分為 64.6%(由 llm-stats 獨立測量)——編碼分數才是代理(agent)圈真正引用的數字。

思考預設為開啟,而推理努力參數是影響延遲和成本的單一最大槓桿:
• 六個等級 — none, low, medium, high, xhigh, max。none會為機械式任務關閉推理;max則適用於錯誤成本高的問題,且僅可透過 Responses API 使用。
• 從中等開始,一次調整一級。apidog GPT-5.6 教學指南指出,許多 GPT-5.5 的工作負載在 5.6 系列上以低一級即可維持相同品質——在為更多思考付費之前,請先衡量品質。
• Pro 模式是設定,不是模型。設定 reasoning.mode: "pro",模型將優先考量回答品質而非速度。價格與模型 ID 保持不變。
• 詳細程度 — 低、中(預設)、高 — 獨立於推理控制輸出長度。
• 推理 token 以輸出計費,每百萬個 30 美元。在 xhigh 或 max 的高難度提示下,內部推理可能主導帳單——這是推理模型定價中隱藏的部分,價格標籤上從不顯示。
Sol 的實際成本
Sol 的基礎價格在 OpenAI 2026 年 7 月 30 日的降價中維持不變:輸入每百萬 tokens 5 美元,輸出每百萬 tokens 30 美元。此次降價影響的是較便宜的兩個層級——GPT-5.6 Terra降至$2 / $12,而GPT-5.6 Luna則降至$0.20 / $1.20——這點之所以重要,是因為它正是判斷 Sol 何時屬於大材小用的確切對比。

三個修飾符會改變有效費率:
• 提示詞快取。重複使用的輸入計費約為$0.50 per million在快取讀取時 — 較全新輸入便宜 90% — 而快取寫入的計費為$6.25 per million(為未快取輸入費率的 1.25 倍)。快取預設為隱式,可透過prompt_cache_options搭配ttl明確指定;快取前綴至少需要 1,024 個 token,且會保持有效至少 30 分鐘。
• 長上下文計費等級。當輸入大小超過門檻值時,Sol 會升級至 $10 / $45 per million。少數非常長的提示詞會悄悄拉高你的平均價格。
• 模型產出的所有內容都算輸出。這包括內部推理token,因此在推理密集的呼叫中,帳單主要集中在輸出端。
一個具體的帳單:一個產生 20K 個輸出 token 的 100K-token 請求,費用為:輸入 $0.50、輸出 $0.60 — 共 $1.10(未快取)。如果該 100K 提示詞在下次呼叫時命中快取,輸入部分會降至約 $0.05,往返總價則接近 $0.65。在一個整天重複使用相同系統提示詞的長時間 agent 迴圈中,快取與否正是 Sol 是否負擔得起的關鍵。
一個端點,200+個模型
If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

經濟層面是最誠實的部分。OrcaRouter 增加每個 token $0——模型頁面上的 $5 / $30 是 OpenAI 的費率原封不動轉傳,供應商價格變動會在公告當天就同步在我們這邊生效。自備金鑰(BYOK)是一等公民選項:提供你現有的 OpenAI 金鑰,保留自己的速率限制與額度,由 OpenAI 直接向你收費。護欄——PII 防護盾與內容政策——會在請求計費之前執行,而非事後。路由 DSL 組合出故障轉移,因此當 Sol 出錯或你的流量型態允許時,就會由較便宜的模型回應。
當Sol的層級不對時
作為旗艦產品並不等於適合所有情況,$5 / $30 的費率在三個方面會落敗。
• 大量、低風險的呼叫。一個每月處理 1000 萬個輸入 token 的分類或萃取管線,成本為Sol 上的 $50,相較於GPT-5.6 Luna 上的 $2——相同的端點、相同的金鑰,只改一個 id。Luna 的 $0.20 / $1.20 定價正是為這種工作而設。
• 中階推理,不需要前沿深度。 GPT-5.6 Terra以 $2 / $12 的價格,介於量大與旗艦之間。apidog 教學文件的建議是合理的預設做法:在 Terra 上進行原型開發;只有在 Terra 於實際量測中確實失敗時,才升級到 Sol;並將穩定且高流量的路徑下放到 Luna。
• 我們所能承諾的界線。 OrcaRouter 負責路由與計費;OpenAI 執行權重。端點、零加價、故障轉移和防護措施是我們的,但推論品質與安全行為是 OpenAI 的;使用 BYOK 時,費用直接歸他們。這就是明說的協議:無論如何你都要支付供應商費率,問題在於一個端點支援 200+ 模型是否值得。
底線
如果你已有 OpenAI 用戶端,請透過 Chat Completions 呼叫 GPT-5.6 Sol API;如果你正在新建,則使用 Responses API——模型 ID 為 gpt-5.6-sol,費率為 $5 / $30,無論哪種方式,推理撥盤都相同。當任務困難、上下文很長,且輸出價值為每百萬個 token 30 美元時,它是正確的模型;而當任務是例行公事時,它就是錯誤的模型,因為 Terra 和 Luna 的價格只是其中的一小部分。最簡潔的設定是能讓你改變主意的設定:一個端點、你自己的金鑰、$0 加成,以及一個你可以在工作負載變化的當天就更換的模型 ID。
GPT-5.6 Sol 已在 OrcaRouter 上線,採用 OpenAI 的 $5 / $30 定價,每個 token 零加價——您可以直接使用現有的 OpenAI 金鑰,由供應商直接向您收費。從 GPT-5.6 Sol on OrcaRouter 開始——單一端點,無需二次整合。
