一張生成的標題卡,標題為「GPT-6.1 Sol 定價」,副標題為「費率表、唯一有變動的那一項計量,以及 272K 斷崖」,上方是一排四個圓角標籤,分別寫著「輸入:$2.00 /M」、「快取輸入:$0.10 /M」、「快取寫入:$2.50 /M」與「輸出:$10.00 /M」,圖說為「OpenAI 標準方案,讀取於 2026 年 10 月 7 日」,搭配極簡扁平圖示,並將 OrcaRouter 標誌合成於右下角。
Guides & Insights

GPT-6.1 Sol 定價:價目表、唯一有變動的計量指標,以及 272K 斷崖

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

本頁是價目表。GPT-6.1 Sol在供應商的標準方案中,每百萬輸入符元要價 $2.00、每百萬快取輸入符元 $0.10、每百萬快取寫入符元 $2.50,每百萬輸出符元則為 $10.00;而GPT-6 Sol——這個模型所取代的層級,也是我們型錄所服務的層級——同樣這四項計量分別讀作 $2.00、$0.20、$2.50 與 $10.00。兩張價目卡之間只有一個數字不同,兩者重新計價的門檻落在同一位置,而定價之下的折扣是乘數,而非另一份價目表。本頁所有內容均取自供應商自家的開發者定價頁面,以及其 GPT-6.1 Sol 與 GPT-6 Sol 這兩個模型頁面,全部於 2026 年 10 月 7 日讀取;若有標示為我方數據的數字,則取自我們自家的模型卡。此處不重述發布過程的來龍去脈;若你想知道實際推出了什麼,那是另一頁的事。

費率卡,而 GPT-6 Sol 的四個計量器就在正下方

OpenAI 將這些公布為標準處理級別上每百萬個 token 的價格,適用於輸入 token 數不超過 272,000 的請求。真正重要的那兩列是刻意相鄰排列的,因為這次發布的完整論點就呈現在這一對之中:依次往下讀每個計量項目,恰好只有其中一個會改變。

• GPT-6.1 Sol 輸入 — 每百萬個 token 2.00 美元,與 GPT-6 Sol 相同。
• GPT-6.1 Sol 快取輸入 — 每百萬個 token 0.10 美元,較 GPT-6 Sol 的 0.20 美元減半。
• GPT-6.1 Sol 快取寫入 — 每百萬個 token 2.50 美元,與 GPT-6 Sol 相同。
• GPT-6.1 Sol 輸出 — 每百萬個 token 10.00 美元,與 GPT-6 Sol 相同。

• GPT-6 Sol 輸入 — 每百萬個 token $2.00。
• GPT-6 Sol 快取輸入 — 每百萬個 token $0.20。
• GPT-6 Sol 快取寫入 — 每百萬個 token $2.50。
• GPT-6 Sol 輸出 — 每百萬個 token $10.00。

那八行裡有三行是同一個數字寫了兩次,而這正是重點:這不是重新定價,而是同一個模型上的一個計量單位在變動。快取寫入在兩張價目卡上都是未快取輸入費率的 1.25 倍,所以 $2.50 在兩者上都是 $2.00 × 1.25——寫入溢價是這個系列的屬性,而不是版本的屬性。快取讀取是唯一讓這兩個模型有所區隔的項目:在 GPT-6.1 Sol 上,快取讀取是輸入費率的 5%;在 GPT-6 Sol 上則是 10%,而 OpenAI 將兩者都表述為輸入費率的比例,而非獨立價格。

關於本頁陳述數字的方式,有一點說明。OpenAI 公布的是費率表,以每百萬詞元(token)的固定列表價格呈現,上述八行都沒有附上推理強度(reasoning effort)的限定條件,因此其中任何一項都不是以特定強度水準報價。強度改變的是某項任務會花費多少詞元,而不是每個詞元的價格,這也是為什麼費率表與強度無關,但你的帳單並非如此。本頁沒有任何內容是與競爭對手模型在相同強度下的一對一正面對比,以下也不會暗示任何這類比較——凡某項數字會取決於強度者,本頁都會註明它是在哪個強度下產生。

A generated two-column scoreboard headed 'GPT-6.1 Sol vs GPT-6 Sol - the rate card'. Left column 'GPT-6.1 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.10 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.20 /M'. Right column 'GPT-6 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.20 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.40 /M'. A footer reads 'Standard tier prices per OpenAI's pricing page, read October 7, 2026; the whole request reprices above 272K input tokens.'

唯一變動的一行:快取輸入,$0.20 降至 $0.10

快取輸入計量器會對請求中未變動的部分計價。當一段冗長且穩定的前綴——例如系統提示、一組工具結構描述、檢索到的語料庫、迴圈累積的對話逐字稿——被刻意儲存起來,讓下一次請求能夠重複使用時,重複使用的詞元會以快取費率而非輸入費率計費,而最初被儲存的詞元則以快取寫入費率計費。這是對重複的折扣,它之所以存在,是因為對供應商而言,替代做法是在每次呼叫時從頭重新計算相同的前綴。

把那項計價砍半,和把輸入計價砍半,並不是同一種消息,而這個差異值得精確說明。輸入費率是該系列中每個未快取 token 的成本,所以把它砍半會是整條產品線的重新定價。快取費率則是一種折扣深度——也就是重複使用的 token 比輸入費率低多少——所以調整它,改變的是對特定行為的獎勵,而不是基準。GPT-6.1 Sol 的輸入費率是 $2.00,與 GPT-6 Sol 收費完全相同,所以沒有快取前綴的請求在兩個模型上計費相同。把快取計價砍半,會讓折扣從輸入費率減免 90% 變成減免 95%,而這正好觸及那些前綴夠長、且重複使用夠頻繁,因而至少會反映在帳單上的工作負載。把這項被調整的計價讀成「同一項任務若有快取就更便宜」,而不是「模型變便宜了」,這張卡就不再令人意外。

這筆算術只取決於這兩列,別無其他。一百萬個快取輸入詞元在 GPT-6.1 Sol 上要價 $0.10,在 GPT-6 Sol 上則是 $0.20,因此這次發布相當於每百萬快取詞元省下十分錢——這個數字在單次呼叫中微不足道,在漫長執行中卻舉足輕重,因為快取的前綴每一回合都會被讀取一次。快取寫入仍維持 $2.50 不變,所以是否採用快取的損益兩平點並未因這次發布而改變:寫入溢價的回本來自前綴的重複使用,而不是取決於兩種快取費率中哪一種適用。

超過 272,000 個輸入 Token 時,整個請求會重新計價

兩張卡都設有長上下文級別,而 OpenAI 的定價頁面對兩者採用相同的規則說明:輸入權杖超過 272K 的提示,其輸入與快取費率為 2 倍、輸出為 1.5 倍,且適用於整個請求。整個請求都會重新計價——不只是超過門檻的那些權杖。這句話是這個段落最該帶走的重點,因為正是在這裡,費率表不再只是一張查詢表:當輸入權杖達到 272,001 個時,整個請求(包括第一個權杖)都按長上下文的欄位計費。

GPT-6.1 Sol 重新定價後的價目表,超過 272,000 個輸入 token:

• 輸入 — 每百萬個 token $4.00,為短上下文費率的 2 倍。
• 快取輸入 — 每百萬個 token $0.20,為短上下文費率的 2 倍。
• 快取寫入 — 每百萬個 token $5.00,為短上下文費率的 2 倍。
• 輸出 — 每百萬個 token $15.00,為短上下文費率的 1.5 倍。

以及 GPT-6 Sol 上的同一層級,這樣這兩列就可以相互對照閱讀:

• 輸入 — 每百萬個權杖 $4.00。
• 快取輸入 — 每百萬個權杖 $0.40。
• 快取寫入 — 每百萬個權杖 $5.00。
• 輸出 — 每百萬個權杖 $15.00。

同樣地,整個請求會重新計價,而不是只有超出的部分,因此一個 273,000 詞元的提示,全部 273,000 個詞元都以 4.00 美元的輸入價計費,而不是前 272,000 個詞元以 2.00 美元、最後一千個以 4.00 美元計費。這使得跨越門檻成為一個階梯,而不是一段斜坡,也讓快取輸入的變動在門檻之上與之下看起來不一樣。GPT-6.1 Sol 在 272K 以上對快取讀取收取的 0.20 美元,正好就是 GPT-6 Sol 在門檻以下收取的費率,因此在新模型上執行的長上下文快取工作負載,支付的是發布前的數字。省下的費用在門檻以上仍以相對值保留了下來——0.20 美元對上 GPT-6 Sol 的 0.40 美元仍是減半——但宣傳的那十分錢並不適用於跨越門檻的請求,因為那筆請求根本不會按短上下文的價目表計費。

A screenshot of OpenAI's own developer pricing page headed 'Our latest models' and 'Prices per 1M tokens.', with column groups 'Short context' and 'Long context', each headed Model, Input, Cached input, Cache writes, Output. The gpt-6.1-sol row reads $2.00, $0.10, $2.50 and $10.00 in the short-context columns and $4.00, $0.20, $5.00 and $15.00 under long context; a gpt-6-astra row sits above it and a gpt-6-luna row below. Beneath the rows are three footnotes covering the 10% regional-processing uplift for models released on or after March 5, 2026, the rename of priority processing to Fast mode on July 30, 2026, and GPT-5.6 Sol's promotional pricing being available at least through November 21, 2026.

折扣層級,以乘數表示

標準定價以下的所有內容,都是套用於上方那張價目卡的乘數,而不是另一份獨立價目表。把它們寫成乘數,正是讓它們具備通用性的原因:同樣的三個乘數適用於兩種型號上的全部四個計量器,因此只要持有標準價目卡,就掌握了完整的級距結構。

• 批次 —— 標準價的 50%。OpenAI 的批次定價在兩款模型的所有四項計量上正好都是半價:GPT-6.1 Sol 每百萬為 $1.00 輸入、$0.05 快取輸入、$1.25 快取寫入與 $5.00 輸出;GPT-6 Sol 則為 $1.00、$0.10、$1.25 與 $5.00。
• Flex —— 標準價的 50%,且在兩款模型上與批次逐項完全相同,因此兩者之間的選擇是排程選擇,而非價格選擇。
• 快速模式 —— 在兩張價目表上,兩款模型的所有四項計量皆為標準價的 2 倍,且兩份定價表均未列出任何例外。快速模式在 GPT-6.1 Sol 上每百萬為 $4.00 輸入、$0.20 快取輸入、$5.00 快取寫入與 $20.00 輸出,而 GPT-6 Sol 則為 $4.00、$0.40、$5.00 與 $20.00——兩列僅在快取那一項不同,且差異正好就是各模型本身標準快取費率已帶有的同一個 2 倍係數。
• 區域處理 —— 在適用方案之上加收 10%,適用於 2026 年 3 月 5 日或之後發布的模型,且資料駐留地點非預設值時。

Fast mode 有一項僅從價格看不出來的可用性限制。OpenAI 自家 GPT-6.1 Sol 的模型頁面指出,Fast mode 無法搭配歐盟資料駐留使用,而其資料駐留指引則將 GPT-6.1 Sol 列在支援歐盟駐留(搭配 Standard、Flex 與 Batch 處理)的模型之中。因此,在歐盟境內,層級階梯少的是兩級,而不是一級:半價層級還在,加倍價層級則不在。讀者在比較歐洲部署與美國部署時,應該拿它與 Standard 相比,因為那是它所能取得的最快層級——對歐盟工作負載引用 Fast mode 的數字,等於在描述供應商並未提供的配置。

這張卡上沒有任何促銷內容,也沒有任何項目設有到期日。

上方這些 GPT-6.1 Sol 的欄位列出的就是定價。OpenAI 的定價頁面並未對它們附加任何促銷條件,也沒有標註結束日期,而且短脈絡與長脈絡方案卡上的四項計費項目,沒有任何一項被標示為限時數字。這一點值得明確指出,因為這個系列在同一頁上就有個反例:GPT-5.6 Sol 的促銷定價附有註腳,承諾至少持續到 2026 年 11 月 21 日,這表示今天引用的任何 GPT-5.6 Sol 價格,都是附帶已知檢視時點的價格。GPT-6.1 Sol 上沒有任何項目具有那樣的形態。

實際後果是,這個頁面不需要對數字本身加上日期檢查的但書——它需要的是在你正在閱讀的頁面上加註,因為表定費率可能在到期日尚未觸發的情況下就變更。這也意味著,如果你正在兩個 Sol 級距之間做選擇,並希望比較結果保持穩定,那麼 GPT-6.1 Sol 卡片就是建立成本模型的正確那一列:GPT-6 Sol 的 $0.20 快取計價也是普通的表定費率,沒有附加任何促銷,因此兩者之間的十美分差距是卡片本身的結構性差異,而不是某個模型對另一個模型所推出的臨時折扣。

如何解讀其他人提出的 GPT-6.1 Sol 價格主張

兩個問題幾乎能解決所有關於 Sol 級模型成本的分歧,而這兩者都能從卡片本身得到答案,而不是從其周遭的說明文字。

• 引用的是哪一項計費指標?輸入、快取輸入、快取寫入與輸出,在同一個請求上是四個不同的數字,而單一主打價格幾乎總是輸入指標,其餘三項則隱而不談。一個讀起來像是總成本的說法,通常只是輸入費率乘以某個假設的詞元組成,而分歧正出在那個假設的組成上。
• 假設的是哪一個上下文層級?短上下文與長上下文的價目在輸入與快取上相差 2 倍、在輸出上相差 1.5 倍,而層級取決於整個請求,而非超出的部分,因此未標明層級的數字,會在請求跨過 272,000 個輸入詞元的那一刻隨之改變。
• 假設的是哪一個處理層級?Standard、Batch、Flex 與 Fast 之間相差 2 倍與 50%,而一筆未說明是哪一種的報價,在還沒問到任何計費指標問題之前,就已內建了四倍的不確定性。
• 若涉及詞元數量,假設的是哪一個推理強度等級?費率與推理強度無關,但詞元數量並非如此,因此任何每項任務的成本數字都會承襲其測量時所用的推理強度——而在不同強度設定下比較兩個模型,並不是在比較它們的價格。

回答那四項,價格主張要麼成立,要麼不成立。它不該做的,是在尚未先指名層級與計量表的情況下,就拿來和本頁的四個計量表相比,因為這兩張卡片之所以相鄰,正是為了讓那唯一一條會移動的線清楚可見,而不會讓其他任何東西被誤認為它。

A screenshot of the OrcaRouter model page for openai/gpt-6-sol showing the breadcrumb 'Home / Models / OpenAI', the title 'GPT-6 Sol', the slug openai/gpt-6-sol, 'Max output 128K', a context figure of 1M tokens, a chip row reading $2.00, $10.00, 1.44 s, 10.00 s and 950.6K, the buttons 'Get the GPT-6 Sol API', 'Try in playground' and 'Use via API', an OpenAI-compatible code sample against https://api.orcarouter.ai/v1, and a description stating that GPT-6 Sol is the cost-efficient high-end model in OpenAI's GPT-6 series, above the fast GPT-6 Luna tier and below the flagship GPT-6 Astra.

GPT-6 Sol 層級在哪裡提供服務

OrcaRouter 以 OpenAI 自家的定價表費率提供 GPT-6 這個等級,不額外加價。位於 https://www.orcarouter.ai/models/openai/gpt-6-sol 的模型頁面列出 GPT-6 Sol 每百萬個 token 輸入 $2.00、輸出 $10.00,與上方卡片逐行相符,並以 0% 加成,而目錄收錄了 超過 200 款模型,條件相同。我們針對該路由的卡片同樣載有 OpenAI 公布的 $0.20 快取輸入與 $2.50 快取寫入數字,因此這些數字逐項相符;請將本頁所有快取相關數字視為 OpenAI 公布費率的轉述,而非我們獨立的報價。GPT-6.1 Sol 也列在我們的目錄中——openai/gpt-6.1-sol 的即時卡片載明發布日期為 2026 年 9 月 29 日,兩個定價層級皆與 OpenAI 一致,且七日 token 使用量達數億——因此想了解較新等級的讀者,應參閱該頁面自身的數字,而非將本頁視為相關數字的最終依據。價格會變動;頁面即為報價。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新