
GPT-5.6 降價後的價格:Luna 對 Terra 對 Sol,以及該使用哪個等級
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 546 tok/s
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 182 tok/s
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 114 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
在 OpenAI 於 2026 年 7 月 30 日降價之後,GPT-5.6 系列——GPT-5.6 Luna、GPT-5.6 Terra 和 GPT-5.6 Sol——在規模化運行上從未如此便宜。一周後,亦即 8 月 6 日,OpenAI 將相同的等級推入 ChatGPT 本身:GPT-5.6 Luna 正成為免費帳戶與 Go 帳戶的預設模型,提供無限制的文字聊天;而 GPT-5.6 Sol 則針對 Plus 與 Pro 進行了更新。8 月 19 日,OpenAI 與 Replit 宣布,Replit 針對 Core 與 Pro 訂閱者推出的全新 Free Mode 將運行於 GPT-5.6 Luna——這是迄今為止第三方在低價量級(volume tier)上最大的一次押注。而在 8 月底,OpenAI 開始為重度消費用戶推出一項備援機制:「Luna Reserve」額度,在特定 ChatGPT Plus 與 Pro 帳戶的常規使用上限耗盡後,提供有限的 GPT-5.6 Luna 用量,可用於 Codex 與 ChatGPT Work。不過,這三個等級的定價差異極大,而選擇正確的等級(並善用快取、批次與路由)是影響 API 帳單金額的最大單一槓桿。本指南將說明降價後的完整定價、實際成本計算範例、各等級與競品的比較,以及如何透過單一端點在它們之間進行路由。
價格以每百萬個代幣(輸入/輸出)計算,反映調降後的費率表(依通報內容)與 OrcaRouter 的 pass-through 模型頁面;分層與快取費率來自 OrcaRouter 的模型頁面,競爭對手的數據則標明出處。本文中的 ChatGPT 推出細節係依 OpenAI 於 2026 年 8 月 6 日的聲明,Replit Free Mode 細節則依 OpenAI 與 Replit 於 2026 年 8 月 19 日的聲明——皆為供應商通報,未經獨立實測。Luna Reserve 的細節依 OpenAI 說明中心之記載,以及 OpenAI 員工與早期使用者在 2026 年 8 月下旬的報告——皆為供應商與社群說法,未經獨立驗證。價格會變動——建置前請先確認。
太長;沒看
GPT-5.6 Luna($0.20 / $1.20)是高吞吐量的主力機型;Terra($2 / $12)是均衡的中階機型;Sol($5 / $30)是旗艦機型,專為最困難的推理和代理式程式設計(agentic coding)而設。這三款都具備約 105 萬個 token 的上下文,以及 128K 的最大輸出。提示詞快取(prompt caching)和批次選項能進一步降低成本,而極長的輸入則會使你進入更高的服務等級。在消費端,OpenAI 於 8 月 6 日宣布,GPT-5.6 Luna 將成為 ChatGPT Free 與 Go 帳號的預設模型,提供無限的純文字聊天;更新版的 GPT-5.6 Sol 則正逐步向 Plus 和 Pro 用戶推出。8 月 19 日,Replit 在 GPT-5.6 Luna 上為 Core 和 Pro 訂閱用戶推出了 Free Mode,並視需要將較困難的任務升級至 GPT-5.6 Sol。8 月下旬,OpenAI 也開始推出名為「Luna Reserve」的備援機制,讓部分獲選的 ChatGPT Plus 和 Pro 帳號在一般額度用完後,仍可在 Codex 和 ChatGPT Work 中使用有限的 GPT-5.6 Luna 額度——此機制已有 OpenAI 官方文件記載,且有用戶回報已向獲選帳號推出。簡單的多數任務使用 Luna,需要更強能力時使用 Terra,唯有在 Sol 能值回成本之處才使用 Sol——並透過單一 OpenAI 相容端點依難度分流,以將花費降到最低。
重點摘要
• Luna:每 100 萬個 token 為 $0.20 / $1.20 — 快速、便宜,適合大量且對延遲敏感的工作。
• Terra:$2 / $12 — 平衡的中階選擇,適合不需旗艦等級的較艱鉅任務。
• Sol:$5 / $30 — 深度推理、大規模編碼、長時程代理的旗艦方案。
• 快取和批次處理可進一步降低成本;長輸入會將您移至更昂貴的長上下文層級。
• ChatGPT(OpenAI 所述,8月6日):Luna 成為免費/Go 方案的預設,提供無限文字聊天;Sol 獲得適用於 Plus/Pro 的可靠性更新。
• Replit(8月19日宣布):Core/Pro 的免費模式運行於 GPT-5.6 Luna——每個 Replit 的用量最多提升 30 倍,較困難的任務會路由至 GPT-5.6 Sol。此為 Replit 官方說法,未經獨立驗證。
• Luna Reserve(8月下旬,OpenAI 官方文件記載):一個設有上限的備用額度,讓特定的 ChatGPT Plus 和 Pro 帳戶在一般額度用盡後,仍可在 Codex 和 ChatGPT Work 中繼續使用 GPT-5.6 Luna — 並非無限制,也不適用於 Business 或 Enterprise 工作區。
• 最大的省錢槓桿:依難度分流——不需要為 Luna 就能完成的工作支付 Sol 的費率。
新的 GPT-5.6 基礎定價
以下是每百萬輸入/輸出 token 的降價後基礎定價:Luna $0.20 / $1.20(原為 $1 / $6)、Terra $2 / $12(原為 $2.50 / $15)、Sol $5 / $30(不變)。兩個較低等級已於 2026 年 7 月 30 日降價;旗艦等級維持原價。簡而言之,低等級現在以規模為定價導向,而旗艦等級維持高階定位。

分層、快取和批次定價
基本費率只是起點。GPT-5.6 的定價有三個調整因素,會大幅改變您的有效成本:
• 長上下文層級。非常長的輸入會逐步提高價格。在 OrcaRouter 的傳遞頁面上,Luna 在大型上下文層級之前為 $0.20 / $1.20,超過後為 $0.40 / $1.80;Sol 在基本層級為 $5 / $30,在最大層級為 $10 / $45。層級由每個請求的輸入 token 數決定,因此少數巨大的提示可能悄悄拉高你的平均價格。
• 提示詞快取。重複使用的上下文以大幅折扣計費 — Luna 的快取讀取約為每百萬 token $0.02(全新讀取為 $0.20),快取寫入約為 $0.25;Sol 的快取讀取約為 $0.50(全新讀取為 $5)。對於具有穩定系統提示詞的代理和聊天應用,快取往往是最大的一項節省。
• 批次:非緊急任務以折扣價格非同步執行 — 非常適合批量分類、評估與離線生成,這些場景不在乎延遲。
實例解說:實際成本為何
具體的數字讓各等級更真實。以每月一千萬個 token 為例,按 70% 輸入 / 30% 輸出的比例分配(典型的聊天/代理混合使用):
• Luna:每月約 $5(使用提示詞快取時約為 $4.37)。
• Terra:每月約 50 美元。
• Sol:每月約125美元(使用快取後約109美元)。
同樣的用量,Luna 和 Sol 之間有 25 倍的價差——這正是為什麼將每個請求匹配到最便宜且可勝任的層級,比任何單一費率都更重要。(這些與 OrcaRouter 頁面上的成本計算器一致,該計算器是根據定價表估算的;你的實際數字取決於快取以及你的輸入/輸出組合。)
每個級別的實際用途
GPT-5.6 Luna — 處理大量任務的主力
Luna 是快速且具成本效益的服務等級,專為高流量、延遲敏感的工作負載而調校:涵蓋聊天、分類、資訊萃取、路由,以及輕量級代理任務,其 p50 首次輸出 token 的時間約為 1.65 秒。降價之後,以 $0.20 / $1.20 的定價直接與廉價的開放模型競爭——成為大多數簡單呼叫的預設選擇。它也是 OpenAI 正引導消費版 ChatGPT 採用的等級:根據其 8 月 6 日的公告,GPT-5.6 Luna 將成為 Free 與 Go 帳戶的預設模型,純文字聊天將改為無限制,並於隔週推出新的「Think」按鈕,以便在較難的問題上進行更高階的推理(檔案、圖片與語音限制維持不變)。OpenAI 表示,Luna 的事實錯誤比它所取代的 GPT-5.5 Instant 減少 62%——這是供應商自行公布的數字,但清楚顯示該公司正將大部分流量導向這個高容量等級。
2026年8月19日,Replit 將 GPT-5.6 Luna 作為其全新免費模式(Free Mode)的引擎——這是 Core 與 Pro 訂閱者的預設體驗。日常聊天、構思發想與簡單的程式設計任務皆在 Luna 上運行,不會消耗用戶付費的 AI 額度;Replit 表示,Core 用戶現在每月可創作多達 30 倍的內容,包括最多 30 小時的聊天。當任務需要更強的推理能力時,Replit 的 Agent 會將該部分請求轉給較大的模型——例如 Power/Max 模式或 GPT-5.6 Sol——然後再回到 Luna。這些是 Replit 與 OpenAI 官方說法,尚未經過獨立驗證——但這個方向與降價相符:價格便宜 80% 的 Luna,正是讓「永遠在線、預設包含」的方案得以成真的關鍵。
另一個消費者端的變化在 2026 年 8 月下旬出現:Luna Reserve。如同 OpenAI 在其說明中心所述,部分 ChatGPT Plus 和 Pro 帳戶在一般使用額度用完後,可以在 Codex 和 ChatGPT Work 中獲得有限的 GPT-5.6 Luna 用量作為備援——到達上限時會出現通知或月亮指示器,在 Reserve 仍可用期間你可以繼續在 Luna 上工作。這不是無限延伸:Reserve 與一般額度分開,且本身也有上限;它只提供 GPT-5.6 Luna(絕不提供 Terra 或 Sol),不適用於 Business 或 Enterprise 工作區,而且觸及一般限制並不保證一定能使用 Reserve。OpenAI 員工於 8 月 27 日確認了 Reserve 的存在,早期用戶報告描述它正逐步向選定帳戶推出——這些說法來自廠商與社群,未經獨立驗證。一些早期社群報告也指出,Reserve 執行的是 GPT-5.6 Luna 的精簡瀏覽器端,因此在 Reserve 上工作時,即時網頁檢查任務可能無法運作。
GPT-5.6 Terra — 均衡中庸
Terra 介於平價款與旗艦款之間:在較艱深的推理與程式撰寫上,能力比 Luna 更強,但價格遠比 Sol 便宜。以 $2 / $12 的定價,當 Luna 略顯不足、但你還不需要旗艦款時,它是合理的預設選擇 — 適合中等複雜度的資訊擷取、草稿撰寫,以及仍可大規模執行的多步驟任務。
GPT-5.6 Sol — 旗艦
Sol 是為最艱鉅的工作而生:深度多步驟推理、大規模軟體工程,以及長程代理式工作流程,在約 1.05M token 的上下文與高達 128K 的輸出中保持連貫。定價為 $5 / $30(基礎版),屬於高階選擇——請將其保留給真正需要的任務,例如複雜的多檔案程式編寫或長時間的代理執行。8 月 6 日,OpenAI 也為 Plus 和 Pro 用戶更新了 ChatGPT 中的 GPT-5.6 Sol:該公司表示,聊天版本在事實方面更加可靠——根據 OpenAI 的說法,事實錯誤減少了 68%——並提供更聚焦的回答,且新增了一個滑桿,可控制其投入多少推理努力。此更新僅限聊天(Work 和 Codex 背後的 Sol 未變),且 API 層級仍維持 $5 / $30。
推理令牌的注意事項
GPT-5.6 是推理模型,因此有效輸出成本可能超出簡單估算:啟用推理時,內部推理 token 會以輸出計費。在推理強度高的困難提示下,這可能主導你的費用。請根據任務調整推理強度(簡單的呼叫可設為低或關閉),在可行的情況下限制輸出 token 上限,並測量實際使用情況。較低的每 token 費率有幫助,但產生更少的 token 幫助更大。
每個層級如何與競爭對手比較
這次降價使 GPT-5.6 在市場上重新定位。據報導,Luna 的 $0.20 / $1.20 現在在輸入端約比 Claude Haiku 4.5 便宜 5 倍,輸出端約便宜 4 倍;而 Terra 的 $2 / $12 則低於 Claude Sonnet 5 的標準定價(據報為 $3 / $15)。在開放權重模型中,Luna 的價格接近 DeepSeek 的 V4 系列和 Zhipu 的 GLM-5.2 所設定的低點(約 $1.20 / $4.10),而 Qwen 與 Gemini Flash 層級也相去不遠。結論是:對於成本敏感的工作,Luna 現在已能與最便宜的可用模型競爭,而非淪為它們的高價替代品;同時 Sol 仍是真正的高階層級,提供你無法以低價取得的能力。
真正的節省槓桿:按難度分流
最省錢的帳單並非單一層級——而是將每個請求對應到能完成它的最便宜模型。實務上:將簡單、大量的呼叫送給 Luna(或便宜的開放模型),較難的任務升級到 Terra,Sol 則只用於真正困難的少數。搭配快取與批次處理,這樣所削減的成本往往遠超過任何單一價格調整。問題在於營運層面:你不會想分別重新整合三個 OpenAI 層級與開放模型的替代方案。
透過單一端點存取全部三種(以及更便宜的競爭產品)
這就是供應商中立路由器能派上用場的地方。OrcaRouter 透過單一 OpenAI 相容端點,以相同的降價後價格(0% 加成)提供 GPT-5.6 Luna、Terra 和 Sol,同時也提供更便宜的開放模型,如 DeepSeek V4 Pro、GLM-5.2 和 Qwen。切換方案層級(或對 Luna 與開放模型進行 A/B 測試)只是設定變更,無需重新整合,而且您可以將每個請求路由到最便宜的選項。Luna Reserve 是同一概念在消費者端的版本——一種內建後備機制,讓特定使用者在一般配額用完後仍能繼續使用 GPT-5.6 Luna——API 端的對應方案則是自動故障轉移,當供應商對請求進行速率限制或回傳錯誤時,OrcaRouter 會自動處理。

降價後的 Luna 費率卡顯示在 OrcaRouter 自家模型頁面上,以標價呈現——每百萬 tokens 0.20 美元 / 1.20 美元——因為路由器以 0% 加價轉傳供應商價格,頁面上並附有成本計算器,可估算每月典型帳單。此外還有免費方案和 Offers 頁面,可獲得額外優惠。

常見問題
降價後 GPT-5.6 的價格是多少?
Luna $0.20 / $1.20、Terra $2 / $12、Sol $5 / $30(每百萬輸入/輸出代幣)。Luna 和 Terra 已於 2026 年 7 月 30 日降價;Sol 維持不變。
我應該使用哪個 GPT-5.6 等級?
Luna 適合高吞吐量、延遲敏感的工作;Terra 適合較困難但無需旗艦等級的任務;Sol 適合最困難的推理與智能體編碼。依難度分流,以最小化成本。
GPT-5.6 Luna 在 ChatGPT 中是否免費?
OpenAI 於 8 月 6 日宣布,GPT-5.6 Luna 將成為免費及 Go ChatGPT 帳戶的預設模型,提供無限文字對話;檔案上傳、圖片和語音工具仍有限制,而用於更高推理能力的 Think 按鈕則另行推出。這些是 OpenAI 公布的計畫,未經獨立驗證。
為什麼 Replit 在免費模式中使用 GPT-5.6 Luna?
Replit 的 Free Mode 於 2026 年 8 月 19 日發布,對於 Core 和 Pro 訂閱者,預設在 GPT-5.6 Luna 上執行日常聊天、構思和簡單編碼,並視需要將較困難的任務路由到較大的模型——即其 Power/Max 模式或 GPT-5.6 Sol。Replit 將 7 月 30 日 Luna API 約 80% 的降價視為讓此經濟模式得以運作的關鍵。這些是供應商陳述的計畫,並非經獨立驗證。
Luna Reserve 是什麼?
OpenAI 為 Codex 和 ChatGPT Work 文件記載的備用額度:部分 ChatGPT Plus 和 Pro 帳戶在一般使用額度耗盡後,會獲得有限的 GPT-5.6 Luna 使用池,讓它們能繼續運作而不會被中斷。它只會提供 GPT-5.6 Luna——絕不會是 Terra 或 Sol——有自己的上限,獨立於一般使用額度,且不適用於 Business 或 Enterprise 工作區。其存在已由 OpenAI 聲明(員工於 8 月 27 日證實);對特定帳戶的推出則為社群回報,未經獨立驗證。
GPT-5.6 每個月要多少錢?
每月1000萬個token(70%為輸入):在Luna上約$5,在Terra上約$50,在Sol上約$125——在快取之前就有25倍的價差。您的實際成本取決於快取以及您的輸入/輸出組合。
所有三個層級是否都有相同的上下文窗口?
是的——約 1.05M token 的上下文,以及最高 128K 的輸出 token,並支援視覺、工具、JSON 與推理。
提示詞快取如何影響成本?
快取能大幅降低重複上下文的成本——Luna 的快取讀取約為每百萬個 token 0.02 美元,相較於全新讀取的 0.20 美元——因此請盡可能重用已快取的提示。相反地,長輸入可能會使你進入更昂貴的長上下文層級。
這些層級與 Anthropic 或開源模型相比如何?
據報導,Luna 的定價低於 Claude Haiku 4.5(輸入約 1/5、輸出約 1/4),而 Terra 則低於 Claude Sonnet 5($3 / $15)。Luna 也接近平價開放模型的低價底線(DeepSeek、GLM-5.2 約 $1.20/$4.10)。
我可以在哪裡同時使用全部三層?
透過 OrcaRouter 的單一 OpenAI 相容端點(0% 加價),以及用於根據難度進行路由的較便宜的開放模型。
總結來說
降價之後,GPT-5.6 Luna($0.20 / $1.20)與 Terra($2 / $12)對高流量與中階工作很有吸引力,而 Sol($5 / $30)仍是高階旗艦——25 倍的成本差距讓智慧路由更有價值。消費級產品的推出強化了這個劃分:OpenAI 將 Luna 設為免費預設,同時把 Sol 的可靠性更新保留給付費方案;Replit 的 8 月 19 日免費模式——建構於 GPT-5.6 Luna,較困難的任務會路由升級至 GPT-5.6 Sol——顯示高流量產品也落在同一個層級;而 8 月底的 Luna Reserve 備援方案延續了這個模式,讓部分 Plus 與 Pro 使用者即使在一般額度用完後仍留在 GPT-5.6 Luna。對 API 開發者來說,這又多了一個將簡單流量導向 Luna 的理由。最大的節省來自依難度分流、善用快取與批次處理,以及控制推理 token,而不是預設使用單一層級。要做到這點,最簡單的方式是透過單一 0% 加成端點(例如 OrcaRouter),在那裡三個層級(以新價格)與你想拿來對比的更便宜開源模型並列。
