編輯風格的扁平向量插圖,用於科技部落格主視覺,主題為旗艦模型定價:一顆大型圓角模型晶片,深藍色,帶柔和青色光暈,置於淺色背景上;一張紙質價格標籤夾在晶片角落;三股 token 流從晶片流出,匯入一個帶有細小抽象刻度的圓形價格儀表;儀表旁有一小疊快取區塊;還有一張細長日曆頁從左側滑入。白色背景,帶柔和藍青色漸層點綴與一處細微暖色高光;極簡扁平線條圖示;簡潔現代的幾何無襯線字體排版;不含任何可讀文字。
Guides & Insights

GPT-5.6 Sol API 定價:每 1M Token 為 $5 / $30,快取 $0.50,以及實際成本

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

GPT-5.6 Sol 的費用為每百萬輸入 Token 5.00 美元,每百萬輸出 Token 30.00 美元,這是 GPT-5.6 Sol API 的價格——與旗艦級在 OrcaRouter 目錄上的費率相同,檢查日期為 2026-08-18,零加價。這是 GPT-5.6 系列中最貴的等級,也是唯一在 7 月 30 日降價中未調整牌價的等級,因此應以即時 GPT-5.6 Sol 模型頁面上的費率表作為預算依據。這些調整槓桿比標題價格更重要:透過提示快取,重用輸入的計費為每百萬 $0.50;批次 API 降至 $2.50 / $15.00;快速模式則以 2 倍溢價換取最高 2.5 倍速度。此頁面是 Sol 專屬的定價參考——包含確切費率表、請求的實際成本、旗艦級與其他方案的比較、何時不該購買,以及如何透過單一 OpenAI 相容端點使用您自己的金鑰來呼叫它。

價格以每百萬個 token(輸入/輸出)計,截至 2026-08-18。美元金額取自 OpenAI 公布的 API 費率,並與 OrcaRouter 上 GPT-5.6 Sol 的模型頁面交叉比對;快取、批次、快速模式與長上下文費率均由 OpenAI 公告。價格會變動——建置前請先確認。

確切價格,今日已驗證

以下是 GPT-5.6 Sol 的完整費率卡,已於 2026-08-18 驗證:

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

輸入 — 每 1M tokens(快取未命中時)收費 $5.00。

輸出 — 每 1M tokens 收費 $30.00。

提示詞快取讀取 — 每 1M tokens 僅需 $0.50,您重新傳送的任何輸入皆可享 90% 折扣。

提示詞緩存寫入 — $6.25 每 1M tokens。

長上下文方案 — 輸入超過約 272K tokens 時,計費為 $10.00 輸入 / $45.00 輸出(2 倍輸入、1.5 倍輸出)。

Batch API — 輸入 $2.50 / 輸出 $15.00,統一 50% 折扣,非同步,通常約 24 小時內完成。

快速模式 — $10.00 輸入 / $60.00 輸出,需支付 2 倍溢價,可獲得最高約 2.5 倍的輸出速度,且智慧能力不變。

上下文窗口 — 約1.05M tokens,最多128K輸出。

OrcaRouter 會將提供者費率原樣傳遞,不加價,因此目錄上的數字就是您實際支付的金額。在即時模型頁面上,卡片顯示每 1M 為 $5.00 / $30.00,快取讀取 $0.500,並帶有 Vision、Tools、JSON 和 Reasoning 徽章。Sol 的 $5 / $30 也是未調降前的價格:OpenAI 在 7 月 30 日的降價適用於 GPT-5.6 Luna(現為 $0.20 / $1.20)和 GPT-5.6 Terra(現為 $2 / $12),而旗艦模型維持不變。

改變有效價格的槓桿

基本費率僅是起點。四個調整因素會改變Sol實際花費您的成本:

提示快取 — 重複使用的上下文(快取命中)每百萬個 token 計費 0.50 美元,而全新的內容則為 5 美元;快取寫入的費用為每百萬個 token 6.25 美元。對於任何在每一輪都會重複傳送大型前綴的代理程式或聊天,快取是帳單上最大的單一影響因素。OpenAI 以專案和 API 金鑰作為快取的鍵值,因此持續使用同一個金鑰(同一個管道)才能讓快取持續命中。

長上下文等級 — 當請求的輸入超過約 272K tokens 時,費率會從基礎價格移至 $10 / $45。少數大型提示詞可能會悄悄拉高你的平均價格,因此若無真正需要深度上下文,請進行批次處理或截斷輸入。

批次— OpenAI 的批次 API 以非同步方式執行工作,約 24 小時內完成,價格恰好是半價:$2.50 / $15.00,快取輸入為 $0.25,快取寫入為 $3.13。它可與提示快取搭配使用,適用於評估、大量分類及對延遲不敏感的離線生成。

快速模式 — 價格為 $10 / $60,輸出吞吐量最高約為 2.5 倍,適用於對延遲敏感、使用者等待中的工作,例如即時程式碼輔助。此模式按 token 計費,費率為標準費率的 2 倍,不計入已購買的 Scale Tier TPM 方案;若超出共用速率上限,則會回退至標準處理。

一個請求的實際成本

每個 token 的價格過於抽象,因此這裡提供按今日費率計算的實際範例。

單次聊天呼叫,50K 輸入 + 20K 輸出 — $0.25 + $0.60 = $0.85

1M 輸入 + 1M 輸出 — $5 + $30 = $35

代理回合,200K 快取上下文 + 20K 新輸入 + 30K 輸出 — $0.10 + $0.10 + $0.90 = $1.10。相同回合若為冷快取 — 220K 新輸入需 $1.10 — 總計 $2.00。使用快取可節省近一半成本。

一個月1,000萬個token,按70%輸入/30%輸出分配,其中80%的輸入由快取提供:140萬非快取輸入($7.00)+560萬快取輸入($2.80)+300萬輸出($90)≈ $100。若不使用快取,同樣一個月是$125——而在GPT-5.6 Terra上,同樣一個月約需$50,在GPT-5.6 Luna上則約需$5。Sol與Luna之間20倍的價差,正是等級匹配比任何單一費率都更重要的原因。

{{1}}兩個注意事項會提高實際費率。{{/1}}{{2}}Sol 是一個推理模型——內部推理 token 以每百萬個 30 美元的輸出價格計費。{{/2}}{{3}}在高推理強度設定下處理困難提示詞時,模型會將大部分輸出預算花在思考上,因此處理艱難任務的實際輸出成本遠高於粗略估算。{{/3}}{{4}}此外,OpenAI 的 tokenizer 在某些輸入上比上一代更為冗長,因此同一段文字所需的 token 數會多於在 GPT-5.5 上所需的數量。{{/4}}{{5}}應根據任務調整推理強度,盡可能限制輸出長度,並在估算帳單前先測量實際使用量。{{/5}}

Sol 的定價與同業相比如何

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

對照2026-08-18公布的目錄價格:

GPT-5.6 Terra — $2 / $12,降價後的中階方案。Sol 的輸入和輸出費用貴 2.5 倍;當你不需要旗艦級推理時,Terra 是預設選擇。

GPT-5.6 Luna — $0.20 / $1.20,降價後的用量等級。與 Sol 相比有 25 倍的輸入差距;Luna 的定價瞄準的是佔多數的簡單流量。

Claude Opus 5 — $5 / $25。同樣的輸入,表面上輸出便宜 20%。實際上,對某些工作負載而言,比較結果會反轉:本部落格先前曾在相同的英語/混合樣本上量測,Sol 的 token 數比 Anthropic 模型少了約 34.5%;而一篇已發表的 token 經濟學分析(TheBlockBeats)估計,儘管輸出單價較高,執行同等工作量時,Sol 的總帳單可比 Claude Opus 5 低約 21%。請自行量測你的 tokenizer,別只看標價。

Claude Fable 5 — $10 / $50。Sol 的輸入價格為 Anthropic 頂級方案的一半,輸出價格則便宜 40%。

Claude Opus 4.8 — $5 / $25。與 Sol 相同的輸入,更便宜的輸出 — 上一代 Anthropic 旗艦。

Grok 4.6 — $2 / $6。榜上最亮眼的數字:它在 Artificial Analysis 指數上與 GPT-5.6 Sol 持平(兩者皆為 61),輸入價格便宜 2.5 倍,輸出價格便宜 5 倍。

DeepSeek V4 Pro — $0.44 / $0.88 離峰時段(尖峰時段價格翻倍)。對平價開放權重模型賽道而言,完全是另一個價格檔次。

誠實而言:Sol 是一款高階旗艦,具備高階的輸出速率——是低於 Claude Fable 5 的閉源旗艦中輸出速率最高者。它的優勢在於單位艱鉅工作的有效成本(其 tokenizer、推理能力、長上下文),而非絕對速率。如果你的流量以簡短提示詞和簡單任務為主,$2 的 Terra、$0.20 的 Luna,或 $2/$6 的 Grok 4.6 是更便宜的選擇——而且在指數上,Grok 4.6 在紙面上毫不遜色。

當Sol是錯誤的選擇時

有四種情況,這個價格不是您想要的。

簡短、簡單的提示。低於約 20K token、不需深度推理的請求,使用旗艦頂級模型就是浪費。GPT-5.6 Terra($2 / $12)或 GPT-5.6 Luna($0.20 / $1.20)能以一小部分成本處理大量級別的請求,而 Grok 4.6 或 DeepSeek 這類模型的成本又更低。

推理密集型用量。 由於思考會以輸出(token)計費,困難的提示詞在高強度設定下的成本可能遠高於名義輸出價格。如果您的工作負載中有大量困難的調用,請在投入前先測量實際輸出的 token 數量——實際有效費率可能會讓您大吃一驚。

以每個 token 的價格作為唯一目標。 Grok 4.6 在指數上與 Sol 打平,價格為 $2 / $6,而 DeepSeek V4 Pro 在離峰時段的價格為 $0.44 / $0.88。如果前沿基準分數不是硬性要求,這些模型在相同類型的工作上,每 token 的費率會低得多。

嚴格的延遲預算。Sol 是大型推理模型,因此首個 token 的等待時間遠高於 Flash 級別模型。在需要亞秒級 TTFT 的即時聊天場景中,$10 / $60 的快速模式提升的是吞吐量,而非降低首個 token 的延遲——使用較小的模型仍然是更經濟的解決方案。

如何在OrcaRouter上呼叫它

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol 託管於 OrcaRouter,模型 ID 為 openai/gpt-5.6-sol,透過位於 api.orcarouter.ai/v1 的 OpenAI 相容端點提供服務,以供應商原價、零加價供應。如果您已經有 OpenAI 用戶端,遷移只需變更 base-URL 和模型 ID——僅此而已。同一個金鑰和端點可存取 200+ 個模型,因此 Sol 與 GPT-5.6 Terra、GPT-5.6 Luna、Claude Opus 5、Claude Fable 5、Grok 4.6 以及您想與之比較的開放權重模型並列,您可以依難度進行路由,而不必逐一重新整合。

在定價頁面上值得列出的兩個 OrcaRouter 特點。BYOK:自帶 OpenAI 金鑰,OpenAI 會按照自己的費率直接向你收費——OrcaRouter 每個 token 加收 $0,並保持你的供應商速率限制與額度不變。Guardrails:PII Shield 與內容政策會在計費之前執行,因此被封鎖的請求會回傳乾淨的 400 狀態碼,且絕不會被收費;Agent Firewall 則會在工具和 MCP 呼叫執行之前對其進行評估。

定價頁面上重要的誠實說明:我們路由模型,但不設定其價格。 $5 / $30 這個數字是 OpenAI 的價格直接轉傳;當 OpenAI 調整價格時,列表也會隨之變動——這正是本頁面標註日期的原因。如果你直接呼叫 OpenAI,也會得到相同價格;OrcaRouter 存在的目的,是提供單一金鑰、零加價的路由途徑,讓你以單一端點存取整個模型系列。

來源與日期

上述所有價格均已於 2026-08-18 驗證。GPT-5.6 Sol 的數字取自 OpenAI 公布的 API 定價,並與 OrcaRouter 上 GPT-5.6 Sol 的模型頁面(同日查核)及我們自行公布的 GPT-5.6 定價頁面交叉比對。批次、快速模式、快取寫入與長上下文費率均為 OpenAI 官方公布。Claude、Grok 與 DeepSeek 的數字是 OrcaRouter 目錄中的現行列表,其中 DeepSeek V4 Pro 顯示的是離峰費率。OpenAI 自 2026 年 7 月 9 日推出以來,從未改變 Sol 的定價——7 月 30 日的降價並未觸及這款旗艦——但價格仍可能變動;對於你找到的任何較早的「GPT-5.6 Sol 定價」頁面,請以頁面上標示的查核日期為準。此處的數字為截至今日的最新資料。

以上每個價格都是GPT-5.6 Sol on OrcaRouter上的即時匯率 — 已於2026-08-18核對,零加價,可直接搭配您自己的金鑰使用。

本文中的比較3

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

providers@orcarouter.ai

加入我們的社區

Discordsupport@orcarouter.aiXGitHubYouTube