一張生成的 Hero 卡片,標題為「Dots vs. GPT-5.6 Sol」,副標題為「同一家供應商,兩種計費模式」。一條垂直分隔線將卡片分為兩半:左側面板標示為「Dots」,寫著「1.05M token 上下文根本沒寫在盒子上」;右側面板標示為「GPT-5.6 Sol」,寫著「1,050,000 個 token 的上下文——每 1M 為 $4 / $20」。OrcaRouter 標誌合成於右下角。
Guides & Insights

Dots 對比 GPT-5.6 Sol:同一家公司推出的訂閱方案與價目表

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

這家公司賣的兩樣東西,從外表看都像「一個 Open​AI 模型」。Dots 是在 2026 年 9 月 29 日 DevDay 上發表的常駐代理:每個 dot 都有自己的雲端電腦和瀏覽器,透過公司的連接器生態系觸及超過 4,000 款應用程式,存在於 ChatGPT、Slack 和 Teams 中,並在 GPT-6 Astra 上運行,而這正是公司在自家發表資料中點名的模型。GPT-5.6 Sol 是計量制 API 模型,自 2026 年 7 月 9 日起推出:1,050,000 個 token 的上下文視窗,每次回應最多 128,000 個 token 的輸出,支援文字、圖像和檔案輸入並輸出文字、工具呼叫、結構化輸出,以及可設定的推理投入程度旋鈕。第一個是訂閱制,但沒有人公布過它的額度;第二個則是一張寫著四個數字的價目表。這個比較真正要談的,是這個差異,而不是基準測試的分數差距。

所以,有用的問題不是哪一個比較聰明。而是哪一個是你能據以規劃的,以及哪一個會默默決定,你的工作究竟有多少是可能做到的。

唯一區分它們的那件事

一個點沒有詞元計量器。你看不到它燒掉多少詞元,因為那不是它販售的單位。GPT-5.6 Sol 只有詞元計量器——它具備的每一項能力都按每百萬詞元計價,而它唯一的硬性架構限制,也就是 1,050,000 詞元的視窗,同時也是你一次能交給它多大的問題的上限。

這種不對稱幾乎解釋了它們之間所有實務上的差異。當你無法計量某樣東西時,就無法預測它,也無法搬移它。當你能計量某樣東西時,就能把它拿來跟更便宜的同類項目比較並切換,因為唯一改變的只是一個識別字串。

GPT-5.6 Sol 發布的內容

• 上下文與輸出 — 輸入 1,050,000 個詞元,輸出 128,000 個詞元,這足以在一次呼叫中處理完整的儲存庫或一整年的往來書信

• 輸入介面 — 文字、圖像與檔案輸入,文字輸出,並將視覺、工具呼叫、JSON 與推理全數列為一級能力

• 價格 — 當提示低於 272,000 個 token 時,每百萬個輸入 token 為 $4.00,每百萬個輸出 token 為 $20.00;超過該門檻後,分別調升至 $8.00 與 $30.00;快取讀取每百萬個為 $0.40,快取寫入為 $5.00

• 獨立證據 — Artificial Analysis Coding Index 為 77.4,在 138 個受測模型中排名第三;Intelligence Index 為 47,在 145 個中排名第十三;GPQA Diamond 為 94.1,長上下文召回為 84,所有第三方數據皆連同其來源載於我們的目錄中,而非採用廠商提供的數字

• 在我們自己的流量中觀察到的行為 — 在七天區間內,首個 token 的中位數時間為 1.72 秒,每秒約 171 個輸出 token,且該週路由了 8,899 萬個 token

那些數字不是推銷話術,而是一份規格。你可以在執行工作之前,就用這個模型為工作估價,之後也能核對答案,因為每一個單位都會在某處被計數。

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, showing the identifier 'openai/gpt-5.6-sol' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-07-09, a description of it as the flagship of OpenAI's GPT-5.6 series built for deep multi-step reasoning and long-horizon agentic work, a side panel reading 1.05M tokens of context and 128K of maximum output over text, image and file input, and a price strip reading $4.00 and $20.00 with a 1.72-second p50 time to first token.

Dots 不發布的內容

OpenAI 對於一個 dot 的成本,只明確說過一件事:第一個 dot 隨 Pro 與 Business Premium 附帶提供,第一個月享有擴充額度,而且與你的 dot 對話不會扣減 ChatGPT 使用額度。其他一切都未量化。沒有任何額度數字、沒有第二個 dot 的價格、沒有更快速或更大容量的公開費率,發佈資料中也完全沒有每項任務的成本。每月 500 美元的 Pro 500 方案是一項使用額度加上 Ultrafast 模式,並不是按每個 dot 計費,因此即使是 OpenAI 價目表上最昂貴的方案,也無法換算成每單位代理工作量的成本。

把它解讀為一種產品類別的描述,而不是文件中的缺口。一個 dot 的定價方式像席位,而不是像工作負載。席位容易編列預算,卻不可能最佳化;這就是整體的取捨。

兩項法案,其中一項你可以預測

把這兩個成本模型並排放在一起,差別不在於大小,而在於形狀。GPT-5.6 Sol 的成本是一條穿過原點的直線,在超過 272,000 個輸入 token 之後會變得更陡。A dot 的成本則是一條平線,不會告訴你沿著它走了多遠——直到它改變為止。

第二個性質正是讓團隊大吃一驚的那一項。容量變更、速度層級變更,或第一個點所包含內容的變更,會以一封支援電子郵件和一個新價格的形式出現,而沒有等同於可供你進行差異比對的價目表修訂版這回事。代幣價格變動是數字在動;訂閱變更則是政策在動。兩者都合理,但只有其中一項是你能在試算表中建立模型的東西。

A generated scoreboard titled 'Dots vs GPT-5.6 Sol - specification against subscription', with two columns. The left column, 'Dots', lists: price first dot included with Pro or Business Premium; allowance not published; cost per task not published; model GPT-6 Astra (vendor-stated); computer its own cloud computer and browser; independent benchmark none. The right column, 'GPT-5.6 Sol', lists: context 1,050,000 tokens; max output 128,000 tokens; price $4.00 in / $20.00 out per 1M below 272K; above 272K $8.00 in / $30.00 out per 1M; cached reads $0.40 per 1M; AA Coding Index 77.4, 3rd of 138. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; GPT-5.6 Sol figures as listed in the OrcaRouter catalogue with their third-party sources.'

這兩個形狀在一條管線中應該放在哪裡

一個點在沒有自然單位的工作上贏得一席之地:花四天在三個應用程式之間追蹤一項決策、在無人關注時讓專案持續推進。GPT-5.6 Sol 則在有自然單位的工作上贏得一席之地。從冗長的檔案庫中擷取結構化記錄、一次審閱大型儲存庫、從冗長的來源產生長篇文件——這些任務有開端、有終點,也有 token 數量,而 105 萬 token 的視窗正是其中一些任務之所以可能的原因,而非對那些原本就已可行的任務所提供的便利。

OrcaRouter 完全落在這條線的計量側。模型是以 openai/gpt-5.6-sol 進行路由,依 OpenAI 的定價原價轉嫁、不額外加收任何費用,並與 同一組金鑰背後的兩百多個其他模型同列於一份目錄中,還具備自動的跨上游供應商容錯移轉,以及一套路由 DSL,能將個別請求送往應該負責回答的模型。但這換不到的是「點」內部的任何東西:沒有 Dots API、沒有可供指定請求的模型識別碼,也沒有辦法替換某個點底下運作的智慧。這份目錄觸及價目表後就止步了。

哪一筆購買是個錯誤?

買一個 dot 就指望能對它做優化,這是個錯誤,因為你想優化的那個介面根本沒有開放。買 GPT-5.6 Sol 就指望它替你追一個專案,則是反方向的同一個錯誤——一個叫了才回答的模型,並不是一個在你停止呼喚後仍會繼續做下去的工作者。

把這件事做對的團隊,會把兩者當成不同的項目,並各自配上不同的動詞:訂閱制對應的是必須持續發生的工作,計量制則對應必須被計數的工作。訂閱是你會取消的那一項;計量制是你會預測的那一項。在做出承諾之前,知道哪個是哪個,就已經決定了大半。

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards and credit top-up offers visible beneath.

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新