編輯風格的扁平向量插圖,用於科技部落格主視覺,主題為旗艦模型定價:一顆大型圓角模型晶片,深藍色,帶柔和青色光暈,置於淺色背景上;一張紙質價格標籤夾在晶片角落;三股 token 流從晶片流出,匯入一個帶有細小抽象刻度的圓形價格儀表;儀表旁有一小疊快取區塊;還有一張細長日曆頁從左側滑入。白色背景,帶柔和藍青色漸層點綴與一處細微暖色高光;極簡扁平線條圖示;簡潔現代的幾何無襯線字體排版;不含任何可讀文字。
Guides & Insights

GPT-5.6 Sol API 定價:降價後每 1M Tokens 為 $4 / $20

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

GPT-5.6 Sol 的費用為每百萬輸入代幣 4.00 美元,每百萬輸出代幣 20.00 美元,這是截至今日 GPT-5.6 Sol API 的價格——與 OrcaRouter 目錄中旗艦等級的轉傳費率相同,於 2026-08-25 查詢,零加價。2026 年 8 月 24 日,OpenAI 將 Sol 的 API 價格調降,輸入端降價 20%,輸出端降幅約 33%,這是一項暫時性促銷,至少持續至 2026 年 11 月 21 日。它仍是 GPT-5.6 系列中最昂貴的等級,也是自 7 月 30 日調降(當時未涵蓋旗艦等級)以來,首個掛牌價格有所變動的等級。關鍵因素比標題更重要:透過提示快取,重複使用的輸入每個百萬個代幣只需 0.40 美元;批次 API 降至 2.00 美元 / 10.00 美元;快速模式則以 2 倍溢價換取最高 2.5 倍的速度。本頁面是 Sol 專屬的定價參考——包含確切的費率表、每次請求的實際成本、旗艦等級與其他等級的比較、何時不該選擇它,以及如何透過單一 OpenAI 相容端點使用您自己的金鑰來呼叫它。

{{1}}價格以每百萬個 token(輸入/輸出)計,截至 2026-08-25。{{/1}} {{2}}此降價——輸入端 20%、輸出端約 33%,至少持續至 2026 年 11 月 21 日——是 OpenAI 自行發布的公告,依其面值照實報導;{{/2}} {{3}}美元數字取自 OpenAI 公布的 API 費率,並與 OrcaRouter 上 GPT-5.6 Sol 的模型頁面交叉核對。{{/3}} {{4}}快取、批次、快速模式及長上下文費率均由 OpenAI 公告。{{/4}} {{5}}這些是促銷費率,而非永久調降——價格會變動,也可能調回;開發前請先查證。{{/5}}

確切價格,今日已驗證

以下是 GPT-5.6 Sol 的完整價目表,已於 2026 年 8 月 25 日以促銷價格確認。相同的價格也適用於使用 gpt-5.6 別名的請求,折扣正逐步推廣至符合資格的 ChatGPT Work 和 Codex 積分方案;ChatGPT Pro、Plus 和 Business 訂閱則保持不變。

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

• 輸入 — 快取未命中時,每1M tokens收費4.00美元(原價5.00美元,11月21日前享20%折扣)。

• 輸出 — 每1M tokens 為 $20.00(原價 $30.00,至11月21日止約33%折扣)。

• Prompt cache read — 每1M個tokens $0.40(原為$0.50),對您重新傳送的任何輸入享有90%折扣。

• 提示快取寫入 — 每 1M tokens 為 $5.00(原為 $6.25)。

• 長上下文層級 — 超過約 272K 個 token 的輸入,按 $8.00 輸入 / $30.00 輸出計費(之前為 $10.00 / $45.00;相同的 2 倍輸入、1.5 倍輸出倍率現在套用於較低的基準)。

• Batch API — 輸入 $2.00 / 輸出 $10.00,固定 5 折優惠(原價 $2.50 / $15.00),非同步處理,通常約 24 小時內完成。

• 快速模式 — 輸入 $8.00 / 輸出 $40.00(原為 $10.00 / $60.00),即 2 倍溢價,可獲得約 2.5 倍的輸出速度,且智能水準不變。

• 上下文窗口 — 約1.05M tokens,最多128K輸出。

OrcaRouter 會將供應商費率原封不動地傳遞,不加任何加成,因此目錄上的數字就是您實際支付的金額——而供應商調降費用時,同一日就會反映在列表上。在實際模型頁面上,卡片顯示每 1M 次 $4.00 / $20.00,快取讀取 $0.400,並帶有 Vision、Tools、JSON 與 Reasoning 徽章。這是 Sol 的列表價格自 7 月 30 日調降以來的首次變動;那次調降將 GPT-5.6 Luna 降至 $0.20 / $1.20,GPT-5.6 Terra 降至 $2 / $12,而旗艦版價格維持不變;8 月 24 日的調降則是輪到旗艦版。

改變有效價格的槓桿

基本費率僅是起點。四個調整因素會改變Sol實際花費您的成本:

• 提示詞快取 — 重複使用的上下文計費為每百萬個 token 0.40 美元,而非重新計算的 4 美元,且快取寫入的費用為每百萬個 token 5.00 美元。對於任何在每一輪都會重新發送大型前置內容的 agent 或聊天系統,快取是帳單上影響最大的單一杠杆。OpenAI 以專案和 API 金鑰作為快取的鍵值,因此固定使用同一把金鑰(同一通道),才能確保持續命中快取。

• 長上下文層級——輸入超過約 272K 個 token 的請求,會從基礎費率調整為 $8 / $30。少數幾個大型提示詞可能會悄悄拉高您的平均價格,因此當您並非真正需要深度上下文時,請進行批次處理或截斷。

• Batch — OpenAI 的批次 API 以非同步方式執行作業,約 24 小時內完成,價格正好減半:$2.00 / $10.00,快取輸入為 $0.20,快取寫入為 $2.50。它可與提示快取疊加使用,適合評估、大量分類及延遲無關緊要的離線生成。

• 快速模式 — 以 $8 / $40 提供最高約 2.5 倍的輸出吞吐量,適合延遲敏感、使用者等待中的工作,例如即時程式碼輔助。此模式按 token 計費,費率為標準的 2 倍,不計入已購買的 Scale Tier TPM 方案;若超出共享速率限制,則可回退至標準處理。

一個請求的實際成本

每個 token 的價格過於抽象,因此這裡提供按今日費率計算的實際範例。

• 單次聊天呼叫,50K 輸入 + 20K 輸出 — $0.20 + $0.40 = $0.60(原價 $0.85)。

• 1M 輸入 + 1M 輸出 — $4 + $20 = $24(原價 $35)

• Agentic 回合,200K 快取上下文 + 20K 新輸入 + 30K 輸出 — $0.08 + $0.08 + $0.60 = $0.76。同樣的回合在冷快取情況下 — 220K 新輸入,$0.88,加上 $0.60 輸出 — 總共 $1.48。快取大約能省一半。

• 每月1,000萬個token,按70%輸入/30%輸出劃分,其中80%的輸入由快取提供:140萬個新輸入($5.60)+ 560萬個快取($2.24)+ 300萬個輸出($60)≈ $68。若無快取,同一個月則為$88——而在GPT-5.6 Terra上,同一個月約需$50,在GPT-5.6 Luna上則約需$5。Sol與Luna之間約14倍的差距,正是分層匹配比任何單一費率都重要的原因。

有兩個注意事項會提高實際費率。Sol 是推理模型——內部推理 token 以輸出計費,每百萬個 20 美元。在高推理努力設定下,困難的提示詞可能將大部分輸出預算花在思考上,因此處理困難任務時的實際輸出成本會遠高於粗略估計。而且 OpenAI 的 tokenizer 在某些輸入上比上一代更冗長,所以同一段文字可能比在 GPT-5.5 上耗費更多 token。請依任務調整推理努力,在可行之處限制輸出,並在預估帳單前先衡量實際使用量。

Sol 的定價與同業相比如何

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

對照2026-08-25公布的公開牌價(Sol以促銷價計算)來看。媒體報導將此次降價解讀為對Anthropic與中國實驗室定價壓力的回應——那是第三方解讀,非OpenAI聲明。

• GPT-5.6 Terra — 2美元 / 12美元,降價後的中階方案。Sol 現在在輸入方面貴 2 倍,輸出方面貴約 1.7 倍;當你不需要旗艦級推理時,Terra 是預設選擇。

• GPT-5.6 Luna — $0.20 / $1.20,降價後的用量等級。與 Sol 的輸入價格有 20 倍差距;Luna 的定價是為了應付大多數簡單流量。

• Claude Opus 5—— 5 美元 / 25 美元。相較於舊費率下輸入匹配 Opus 5 的情況,Sol 現在在輸入和輸出上都在帳面上便宜了 20%。這個比較在降價前就已對 Sol 有利:本部落格先前在相同的英文/混合樣本上測量到,Sol 使用的 token 比 Anthropic 模型約少 34.5%;而一篇已發表的 token 經濟學分析(TheBlockBeats)估計,即使 Sol 的輸出費率較高,完成同等工作時 Sol 的總帳單仍可比 Claude Opus 5 低約 21%。請衡量你自己的 tokenizer,而不是標價。

• Claude Fable 5 — $10 / $50。Sol 現在在輸入端比 Anthropic 的最高等級便宜 60%,在輸出端也便宜 60%(舊費率為 50% / 40%)。

• Claude Opus 4.8 — $5 / $25。Sol 現在輸入端便宜 20%,輸出端也便宜 20%——相較於上一代 Anthropic 旗艦機型的標價優勢已完全逆轉。

• Grok 4.6 — $2 / $6。榜上最犀利的數字:它在 Artificial Analysis 指數上與 GPT-5.6 Sol 持平(皆為 61),輸入便宜 2 倍、輸出便宜約 3.3 倍,相較於舊費率的 2.5 倍 / 5 倍差距有所縮小。

• DeepSeek V4 Pro — $0.44 / $0.88 離峰時段(尖峰時段價格翻倍)。對平價開放權重模型賽道而言,完全是另一個價格檔次。

誠實的說法:{{1}}Sol 仍是高階旗艦機種,但這次調降使其脫離頂級價格區間{{2}}——20 美元的輸出價格現在低於 Claude Opus 5 的 25 美元和 Claude Opus 4.8 的 25 美元,{{3}}使得 Claude Fable 5 的 50 美元成為唯一高於它的封閉旗艦輸出費率。{{4}}它的優勢在於每單位艱鉅工作的有效成本{{5}}(其 tokenizer、其推理能力、其長上下文){{/5}}而非絕對費率,{{6}}而 8 月 24 日的調降更強化了這個論點。{{7}}如果你的流量是短提示詞和簡單任務,{{8}}2 美元的 Terra、0.20 美元的 Luna,或 2 美元/6 美元的 Grok 4.6 仍是更便宜的選擇{{9}}——而且在指數上,Grok 4.6 在紙面上毫不遜色。{{10}}

當Sol是錯誤的選擇時

有四種情況,這個價格不是您想要的。

簡短、簡單的提示。低於約 20K token、不需深度推理的請求,使用旗艦頂級模型就是浪費。GPT-5.6 Terra($2 / $12)或 GPT-5.6 Luna($0.20 / $1.20)能以一小部分成本處理大量級別的請求,而 Grok 4.6 或 DeepSeek 這類模型的成本又更低。

推理密集型用量。 由於思考會以輸出(token)計費,困難的提示詞在高強度設定下的成本可能遠高於名義輸出價格。如果您的工作負載中有大量困難的調用,請在投入前先測量實際輸出的 token 數量——實際有效費率可能會讓您大吃一驚。

以每個 token 的價格作為唯一目標。 Grok 4.6 在指數上與 Sol 打平,價格為 $2 / $6,而 DeepSeek V4 Pro 在離峰時段的價格為 $0.44 / $0.88。如果前沿基準分數不是硬性要求,這些模型在相同類型的工作上,每 token 的費率會低得多。

嚴格的延遲預算。Sol 是一個大型推理模型,因此首次生成 token 的時間遠高於 Flash 級別的模型。對於即時聊天這類需要次秒級 TTFT 的場景,每次 $8 / $40 的快速模式買到的是吞吐量,而非更低的首次 token 延遲——而使用較小的模型仍是更便宜的解決方案。

如何在OrcaRouter上呼叫它

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol 託管於 OrcaRouter,模型 ID 為 openai/gpt-5.6-sol,透過位於 api.orcarouter.ai/v1 的 OpenAI 相容端點提供服務,以供應商原價、零加價供應。如果您已經有 OpenAI 用戶端,遷移只需變更 base-URL 和模型 ID——僅此而已。同一個金鑰和端點可存取 200+ 個模型,因此 Sol 與 GPT-5.6 Terra、GPT-5.6 Luna、Claude Opus 5、Claude Fable 5、Grok 4.6 以及您想與之比較的開放權重模型並列,您可以依難度進行路由,而不必逐一重新整合。

在定價頁面上值得列出的兩個 OrcaRouter 特點。BYOK:自帶 OpenAI 金鑰,OpenAI 會按照自己的費率直接向你收費——OrcaRouter 每個 token 加收 $0,並保持你的供應商速率限制與額度不變。Guardrails:PII Shield 與內容政策會在計費之前執行,因此被封鎖的請求會回傳乾淨的 400 狀態碼,且絕不會被收費;Agent Firewall 則會在工具和 MCP 呼叫執行之前對其進行評估。

定價頁面上重要的誠實說明:我們負責路由模型,而非設定其價格。 $4 / $20 的數字是 OpenAI 促銷費率的直接轉傳——當 OpenAI 於 8 月 24 日變更時,列表於同日更新,這正是此頁面標註日期戳記的原因。直接呼叫 OpenAI 可獲得相同費率;OrcaRouter 的存在是為了提供單一金鑰、零加價的路由,讓您只需一個端點即可涵蓋整個模型系列。

來源與日期

上述所有價格均已於 2026-08-25 驗證。GPT-5.6 Sol 的數字取自 OpenAI 公布的 API 定價,並與 OrcaRouter 上 GPT-5.6 Sol 的模型頁面(於同一天查閱)及 8 月 24 日降價的新聞報導(Indian Express、Economic Times、The Star)交叉核對;批次、快速模式、快取寫入與長上下文費率則為 OpenAI 官方公布。Claude、Grok 與 DeepSeek 的數字為 OrcaRouter 目錄目前的列表內容,其中 DeepSeek V4 Pro 以離峰費率顯示。Sol 的定價自 7 月 9 日推出至 7 月 30 日降價期間維持不變,並於 8 月 24 日隨此促銷活動首次變動——這正是日期在此如此重要的原因:$4 / $20 的費率是暫時的,價格會變動;任何你找到的更早或更晚的「GPT-5.6 Sol 定價」頁面,都請以所標示的查閱日期為準。此處的數字截至今日均為最新。

以上每個價格均是GPT-5.6 Sol on OrcaRouter上的即時匯率 — 已於 2026-08-25 以零加成核對,並可搭配您自己的金鑰使用。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新