
Dots 對比 GPT-5.6 Sol:同一家公司推出的訂閱方案與價目表
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 349 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 210 tok/s
- Orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
這家公司賣的兩樣東西,從外表看都像「一個 OpenAI 模型」。Dots 是在 2026 年 9 月 29 日 DevDay 上發表的常駐代理:每個 dot 都有自己的雲端電腦和瀏覽器,透過公司的連接器生態系觸及超過 4,000 款應用程式,存在於 ChatGPT、Slack 和 Teams 中,並在 GPT-6 Astra 上運行,而這正是公司在自家發表資料中點名的模型。GPT-5.6 Sol 是計量制 API 模型,自 2026 年 7 月 9 日起推出:1,050,000 個 token 的上下文視窗,每次回應最多 128,000 個 token 的輸出,支援文字、圖像和檔案輸入並輸出文字、工具呼叫、結構化輸出,以及可設定的推理投入程度旋鈕。第一個是訂閱制,但沒有人公布過它的額度;第二個則是一張寫著四個數字的價目表。這個比較真正要談的,是這個差異,而不是基準測試的分數差距。
所以,有用的問題不是哪一個比較聰明。而是哪一個是你能據以規劃的,以及哪一個會默默決定,你的工作究竟有多少是可能做到的。
唯一區分它們的那件事
一個點沒有詞元計量器。你看不到它燒掉多少詞元,因為那不是它販售的單位。GPT-5.6 Sol 只有詞元計量器——它具備的每一項能力都按每百萬詞元計價,而它唯一的硬性架構限制,也就是 1,050,000 詞元的視窗,同時也是你一次能交給它多大的問題的上限。
這種不對稱幾乎解釋了它們之間所有實務上的差異。當你無法計量某樣東西時,就無法預測它,也無法搬移它。當你能計量某樣東西時,就能把它拿來跟更便宜的同類項目比較並切換,因為唯一改變的只是一個識別字串。
GPT-5.6 Sol 發布的內容
• 上下文與輸出 — 輸入 1,050,000 個詞元,輸出 128,000 個詞元,這足以在一次呼叫中處理完整的儲存庫或一整年的往來書信
• 輸入介面 — 文字、圖像與檔案輸入,文字輸出,並將視覺、工具呼叫、JSON 與推理全數列為一級能力
• 價格 — 當提示低於 272,000 個 token 時,每百萬個輸入 token 為 $4.00,每百萬個輸出 token 為 $20.00;超過該門檻後,分別調升至 $8.00 與 $30.00;快取讀取每百萬個為 $0.40,快取寫入為 $5.00
• 獨立證據 — Artificial Analysis Coding Index 為 77.4,在 138 個受測模型中排名第三;Intelligence Index 為 47,在 145 個中排名第十三;GPQA Diamond 為 94.1,長上下文召回為 84,所有第三方數據皆連同其來源載於我們的目錄中,而非採用廠商提供的數字
• 在我們自己的流量中觀察到的行為 — 在七天區間內,首個 token 的中位數時間為 1.72 秒,每秒約 171 個輸出 token,且該週路由了 8,899 萬個 token
那些數字不是推銷話術,而是一份規格。你可以在執行工作之前,就用這個模型為工作估價,之後也能核對答案,因為每一個單位都會在某處被計數。

Dots 不發布的內容
OpenAI 對於一個 dot 的成本,只明確說過一件事:第一個 dot 隨 Pro 與 Business Premium 附帶提供,第一個月享有擴充額度,而且與你的 dot 對話不會扣減 ChatGPT 使用額度。其他一切都未量化。沒有任何額度數字、沒有第二個 dot 的價格、沒有更快速或更大容量的公開費率,發佈資料中也完全沒有每項任務的成本。每月 500 美元的 Pro 500 方案是一項使用額度加上 Ultrafast 模式,並不是按每個 dot 計費,因此即使是 OpenAI 價目表上最昂貴的方案,也無法換算成每單位代理工作量的成本。
把它解讀為一種產品類別的描述,而不是文件中的缺口。一個 dot 的定價方式像席位,而不是像工作負載。席位容易編列預算,卻不可能最佳化;這就是整體的取捨。
兩項法案,其中一項你可以預測
把這兩個成本模型並排放在一起,差別不在於大小,而在於形狀。GPT-5.6 Sol 的成本是一條穿過原點的直線,在超過 272,000 個輸入 token 之後會變得更陡。A dot 的成本則是一條平線,不會告訴你沿著它走了多遠——直到它改變為止。
第二個性質正是讓團隊大吃一驚的那一項。容量變更、速度層級變更,或第一個點所包含內容的變更,會以一封支援電子郵件和一個新價格的形式出現,而沒有等同於可供你進行差異比對的價目表修訂版這回事。代幣價格變動是數字在動;訂閱變更則是政策在動。兩者都合理,但只有其中一項是你能在試算表中建立模型的東西。

這兩個形狀在一條管線中應該放在哪裡
一個點在沒有自然單位的工作上贏得一席之地:花四天在三個應用程式之間追蹤一項決策、在無人關注時讓專案持續推進。GPT-5.6 Sol 則在有自然單位的工作上贏得一席之地。從冗長的檔案庫中擷取結構化記錄、一次審閱大型儲存庫、從冗長的來源產生長篇文件——這些任務有開端、有終點,也有 token 數量,而 105 萬 token 的視窗正是其中一些任務之所以可能的原因,而非對那些原本就已可行的任務所提供的便利。
OrcaRouter 完全落在這條線的計量側。模型是以 openai/gpt-5.6-sol 進行路由,依 OpenAI 的定價原價轉嫁、不額外加收任何費用,並與 同一組金鑰背後的兩百多個其他模型同列於一份目錄中,還具備自動的跨上游供應商容錯移轉,以及一套路由 DSL,能將個別請求送往應該負責回答的模型。但這換不到的是「點」內部的任何東西:沒有 Dots API、沒有可供指定請求的模型識別碼,也沒有辦法替換某個點底下運作的智慧。這份目錄觸及價目表後就止步了。
哪一筆購買是個錯誤?
買一個 dot 就指望能對它做優化,這是個錯誤,因為你想優化的那個介面根本沒有開放。買 GPT-5.6 Sol 就指望它替你追一個專案,則是反方向的同一個錯誤——一個叫了才回答的模型,並不是一個在你停止呼喚後仍會繼續做下去的工作者。
把這件事做對的團隊,會把兩者當成不同的項目,並各自配上不同的動詞:訂閱制對應的是必須持續發生的工作,計量制則對應必須被計數的工作。訂閱是你會取消的那一項;計量制是你會預測的那一項。在做出承諾之前,知道哪個是哪個,就已經決定了大半。

本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
