
GPT-5.6 Sol Ultrafast 對決 Xiaomi MiMo v2.6 Pro Ultraspeed:兩種速度等級,價格卻獨缺其一
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 610 tok/s
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 189 tok/s
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
兩家廠商相隔三週推出了同樣的產品構想,而兩者之間的差異,正是看清各自真正在賣什麼的最佳方式。小米這一邊在 2026 年 9 月 22 日登場:Xiaomi MiMo v2.6 Pro Ultraspeed 與 MiMo-V2.6-Pro 是同一個 1.02 兆參數的檢查點,只是服務速度更快,每百萬輸入 token 收費 4.35 美元、每百萬輸出 token 收費 8.70 美元,而標準 Pro 路線則是 0.44 美元與 0.87 美元。該廠商的 GPT-5.6 Sol Ultrafast 則是對 GPT-5.6 Sol 施展的同一套手法:權重完全相同,輸出速度最高可達每秒 750 個 token,是標準層級的最高 14 倍,並執行於 Cerebras 的晶圓級硬體上——而且在該模式於 8 月 13 日發表六週之後,完全沒有公布任何價格。
把這兩者並排放在一起,異常之處立刻顯現。小米先公布了費率表,之後才公布大多數基準測試。OpenAI 公布了基準測試、硬體合作夥伴和客戶名稱——卻仍未公布任何你能據以編列預算的數字。這些層級中,有一個今天就能購買。另一個則是 API 結構描述裡的一個值。因此,比較這兩者,與其說是在比誰更快,不如說是在比:當一家供應商已經告訴你價格,另一家卻還沒有的時候,一個速度層級究竟值多少。
每一個實際上是什麼
兩者都不是新模型。這是共同的前提,值得直白說明,因為這兩次發布都引來報導,把它們的服務變更當成能力發布。
MiMo v2.6 Pro Ultraspeed 是小米旗艦模型的服務配置:同樣是 1.02T 參數的稀疏混合專家檢查點,每個 token 啟動 42B 參數;同樣具備 1M token 上下文;同樣原生支援文字、圖像、影片與音訊的多模態能力;同樣在公開儲存庫提供 MIT 授權的權重。小米自家的資料宣稱,在相同品質下,輸出速度最高可達標準 Pro 服務的 20 倍;第三方型錄在同一天描述同一模型時則稱約為 10 倍。至今沒有人發表過能調和這兩者的測量結果。
GPT-5.6 Sol Ultrafast 是 OpenAI 旗艦模型的一種服務配置:相同的檢查點、相同的推理行為、相同的 1,050,000 詞元上下文視窗、相同的 128K 最大輸出量,答案也完全相同。其加速來自硬體而非排程——模型的權重存放在 Cerebras 晶圓級矽晶的片上 SRAM 中,而非在 GPU 記憶體與運算單元之間來回搬移——這是 2026 年 1 月 OpenAI 與 Cerebras 運算合作計畫的首項產品,據報導該合作為期三年、金額約 100 億美元。
所以,誠實的比較軸線不是智慧。而是廠商選擇改變了什麼、為這項改變收取了多少費用,以及它讓你驗證多少這項改變。

費率卡,包括空白的那一張。
• MiMo v2.6 Pro Ultraspeed — 每百萬個 token 輸入 $4.35 / 輸出 $8.70,由小米發布。
• MiMo-V2.6-Pro 標準版 — $0.44 / $0.87,由小米商用型錄公佈。輸入約 9.9 倍,輸出正好 10 倍。
• GPT-5.6 Sol Ultrafast — 截至 2026 年 9 月 27 日,尚未公布費率表。OpenAI 的定價頁面仍設有四個分頁——Standard、Batch、Flex、Fast——而該層級並不在其中。
• GPT-5.6 Sol 標準版 — 每百萬 $4.00 / $20.00,這是 OpenAI 目前的優惠費率,快取輸入為 $0.40,而當輸入超過約 272K 個 token 後,長上下文級距則為 $8.00 / $30.00。
• OpenAI 歷來唯一曾定價的同等級高階方案——Fast mode,價格為 $8.00 / $40.00,正好是標準費率的兩倍,換來最高約 2.5× 的輸出速度。
最後那一列正是那個空白之所以重要的全部原因。小米的速度等級要價是標準車道的十倍,並宣稱速度是十到二十倍,這至少作為一筆交易在內部是自洽的:你按比例付更多,換取按比例更少的等待,而賭的是實際掛鐘時間才是產品本身。OpenAI 的速度等級對更稀缺的晶片資源的占用比 Fast 模式更大,所以無論它最終定價多少,先例說的都是溢價而非折扣。但「先例說的是溢價」不是一個數字,而在數字出現之前,這個等級根本無法在價格上與 UltraSpeed 相比——只能就一個事實來比:小米願意說出自己的數字,而 OpenAI 不願意。
這些數字從何而來
這兩個層級有著方向相反的證據問題,值得把兩者都指出來,而不是折衷取中。
小米的速度宣稱在量級上含糊,卻錨定於一個已公布的價格。20 倍是廠商在小米未指明條件下的上限,10 倍則是某份型錄清單願意聲稱的典型值,而真正的倍數落在一個寬廣區間內的某處,沒有任何人曾在公開場合、以明確載明的併發水準測量過。相較之下,價格是精確的,權重可依 MIT 條款下載,技術報告與強化學習訓練環境也都是公開的——你可以檢視小米做了什麼,只是還無法驗證它跑得有多快。
OpenAI 的速度宣稱在量級上很具體,卻沒有對應到任何可購買的方案。每秒最高 750 個輸出 token,最高可達標準的 14 倍,說得直白。這同時也是輸出 token 的吞吐量數字,而不是整體端到端的固定倍率:輸入處理與模型自身的推理不會以該比例壓縮,這正是該公司將其標示為上限的原因。佐證的基準測試由供應商自行報告,其中一項還是跨供應商比較——一場 2,500 題的 Humanity's Last Exam 測試據稱在 11 小時 11 分鐘內完成,相較之下 Claude Fable 5 為 78 小時 27 分鐘,且準確率相當。針對此次發布的獨立報導,引述了同一場測試中範圍較窄、約 11 倍的生成速度比較,而 Cerebras 自家數據則暗示總測試時間約為 7 倍。三個來源,同一項工作負載的三種切分,卻沒有任何一項經過第三方重現。Cerebras 另行報告在 GDP-Val 上端到端達到 5.6 倍,且沒有可量測的品質損失,同樣未經重現。
這兩組數字都是廠商自己說的。差別在於,小米的含糊是關於速度,OpenAI 的含糊是關於成本;而對任何編列預算的人來說,成本是更難猜的那一項。

本週發生了什麼事,以及為什麼它無法縮小差距
這個比較之所以有新聞由頭,靠的是一筆提交,而不是一則公告。ultrafast 這個值打從 2026 年 8 月 13 日起就已存在於 OpenAI 公開的 openai-openapi schema 中——正是該模式對外公布的同一天——其描述將它限定於 gpt-5.6-sol,並稱其受存取控管。本週真正有所變動的那筆提交時間較晚、幅度也較小:2026 年 9 月 25 日,fe4f7a1 將 ultrafast 加入另外兩份列舉,也就是請求層級的服務層級參數與代理服務層級政策欄位。在該提交之前,這兩份清單列出的是 auto、default、flex、priority、fast。之後,則出現一項描述為「使用 ultrafast 服務層級」的條目。ultrafast 加入service_tier 列舉,這些列舉位於其公開的openai-openapi 規格中——也就是規範描述為「用於模型請求的服務層級」的那個欄位,以及附加於代理的政策欄位。在這次變更之前,該清單列出的是 default、flex、priority、fast。之後則出現一項描述為「使用 ultrafast 服務層級」的條目。
這個區別對任何閱讀這則報導的人來說都很重要。這不是正在被建立的那個層級;而是正在被接入代理(agent)設定所用欄位的那個層級,這意味著用戶端最終可以針對它來編寫,而無需任何新端點。隔天的報導描述了即將登陸 Responses API Playground 的 Fast / Standard / Ultrafast 選擇器,並預期在 OpenAI 的 DevDay 大會之後會有更廣泛的存取權限。我們尚未見過該選擇器,OpenAI 也未發布推出說明,因此這部分是單一消息來源。可查證的是新增的結構描述(schema)項目,以及公告六週後仍持續缺乏費率表。
與此同時,Xiaomi 的等級已可購買五天,且仍是兩者中唯一能開立發票的。它本身懸而未決的問題則不同:10 倍溢價是否維持得住,還是會像多數全新高階等級的上市定價那樣,在上市報導停止後逐漸漂向標準價位。Standard Pro 的 $0.44 / $0.87 是錨點,而以錨點十倍價格開局的等級,很少會以該價位作收。
在兩者之間做選擇,考慮到你很可能無法做到
令人不安的現實是,對大多數讀者來說,這是在比較一個你買不到的層級,以及一個你大概不該按定價購買的層級。GPT-5.6 Sol Ultrafast 是針對特定客戶提供的候補預覽,會隨著容量增加而擴大,既沒有正式上市日期,也沒有價格;MiMo v2.6 Pro Ultraspeed 則已可購買、價格昂貴,且是為特定類型的買家打造。
工作負載測試對兩者都相同,而重點在於你請求圖的形狀,而不是提示詞的大小。單次長生成所獲得的效益遠低於宣傳的倍數,因為輸入處理與推理不會以相同比例加速。在單一使用者可見動作背後運作的四十步代理迴圈,所獲得的效益則更接近完整數字,因為每一次來回往返都是使用者正在忍受的延遲。如果你的流量屬於第二種形狀,那麼兩個層級都是為你而設;如果屬於第一種,那麼任一模型的標準通道一直都是正確選擇,而標準 MiMo-V2.6-Pro 通道 $0.44 / $0.87 是隨處呼叫兆參數級模型最便宜的方式之一。
無論哪一個層級都不會改變的是:你買到的是延遲,不是品質。如果你在相同的提示上,將 UltraSpeed 或 Ultrafast 與其自家的標準通道進行基準測試,卻得到不同答案,那是值得回報的發現,而不是一項功能——兩家廠商的說明都沒有聲稱權重有所改變。
這也正是路由器派上用場的情況,尤其是針對你還拿不到的那個層級。GPT-5.6 Sol 已在 OrcaRouter 上線,代號為 openai/gpt-5.6-sol,以供應商自身的費率提供,代幣零加成,透過位於 api.orcarouter.ai/v1 的 OpenAI 相容端點存取,所以你原本會退回使用的標準通道只差一次 base-URL 變更,而同一把金鑰可通行 200+ 個模型。這點很重要,因為對於「我現在該用 Ultrafast 嗎」這個問題,誠實的答案是「你不能用,所以先決定在這段期間由什麼來承載互動流量」——而在沒有候補名單的情況下買到低延遲的方法,就是把互動呼叫導向型錄上任何一個以最低實際耗時通過你品質門檻的模型,並把夜間工作留在最便宜且合格的通道上。當該層級開放時,那就是你要切換的開關。請明白指出我們未代管的項目:OrcaRouter 上沒有任何小米模型,因此 MiMo v2.6 Pro Ultraspeed 來自小米自家的 API 與數個第三方平台,而本頁並非取得它的途徑。

什麼能讓它塵埃落定
三項量測,目前都還不存在。一份公開的 Ultrafast 費率表,能讓這件事成為它應有的比較,而不是一個有缺漏的比較。一份在明確標示的併發層級下取得的獨立延遲分布,能告訴你小米的真實倍數較接近 10× 還是 20×,以及它在負載下是否仍成立,而不是只在單流演示中成立。而獨立重現任一廠商的基準測試套件,將能把這兩組數字移出「宣稱」那一欄。
在那之前,站得住腳的解讀很狹窄。小米推出了一個速度等級,有價格、速度卻含糊;OpenAI 推出了一個速度等級,有明確速度、卻沒有價格;兩者都和它們被拿來定價對比的東西是同一款模型,而且兩者都未經獨立測量。如果你現在就需要低延遲,而且工作負載是互動式的,UltraSpeed 是真實存在、可購買的,而且定價正好鎖定它想要的買家。如果你現在就需要它,但工作負載不是互動式的,那麼這兩款模型的標準通道更便宜、經過驗證,而且今天就可用——而當有人公布數字時,大家爭論不休的那個等級仍然會在那裡。
