
GPT Image 2.5 vs GPT Image 2:相同 Token 價格,更精準編輯,尚未證實
- openai新OpenAI: GPT-6 Astra2026-09-0455智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0247智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0247智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0157智能82程式
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-ai新Z.ai: GLM 5.3 Flash2026-08-2646智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1849智能75程式
- obsidianQwen3.8 27B2026-08-1541智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242智能69程式
- grokSpaceXAI: Grok 4.62026-08-1251智能77程式
- metaMeta: Muse Spark 1.22026-08-0547智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0347智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2140智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128智能49程式
OpenAI 於 9 月 8 日推出 GPT Image 2.5——消費端名為 ChatGPT Images 2.5,API 端則以兩個獨立識別碼 gpt-image-2.5-flare 與 gpt-image-2.5-sunburst 提供——並為新產品線訂定了與 GPT Image 2 完全相同的 token 計價表,而 GPT Image 2 正是這款新模型所要接續的對象。這使得它成為少見的「紙面上零漲價」影像模型升級:同樣是每百萬影像輸入 token 8 美元、每百萬影像輸出 token 30 美元,同時 OpenAI 宣稱其細節更銳利、多輪編輯更精準,且延遲比 GPT Image 2 降低最多 50%。問題在於,這些宣稱全都出自供應商自述;而在獨立排行榜上,仍是 GPT Image 2——自 2026 年 4 月 21 日推出以來——握有顯而易見的桂冠。這場正面對決要探討的是:一個同價但尚無法驗證的承諾,是否值得今天就跟進;還是那個有實績撐腰的模型,依然更適合作為生產環境的預設選擇。
實際推出的型號有兩個,而非一個。
OpenAI 用兩個同門模型取代了一個 API 模型,而這個一分為二的安排正是理解本次升級首先要掌握的事。GPT-Image-2.5 Flare 是快速的預設選擇——OpenAI 將其定位於大量生成,並表示它能在延遲降低最多 50% 的情況下,提供比 GPT Image 2 更高的品質。GPT-Image-2.5 Sunburst 則是精準度模型,每次生成刻意較慢,鎖定「編輯精確度至關重要」的編輯工作:廣告行銷創意素材、產品圖像,以及任何需要經得起檢視的編輯內容。在消費者端,同一波發布首日就將 ChatGPT Images 2.5 帶給 ChatGPT、ChatGPT Work 和 Codex 使用者,並附帶新產品功能——Sketch 工具、版面範本、圖上留言、提示詞分享——這些功能位於聊天產品中,而非 API。

若要比較 GPT Image 2,有兩個 API 細節很重要。首先,2.5 系列模型在品質等級上新增了 `xhigh` 與 `max`——GPT Image 2 最高只到 `high`——而且預設為 `auto`,因此文件記載的參數範圍絕對比上一代更廣。其次,透明背景現在是一級參數:兩個 2.5 識別符都接受將 `background` 設為 `transparent`、`opaque` 或 `auto`,並輸出 PNG 或 WebP。透明輸出原本是 GPT Image 2 的痛點:它出廠時不支援,之後才加入預覽旗標;因此首日就有透明背景支援,是這次版本較具體的差異之一。OpenAI 也表示 2.5 是附加式部署——GPT Image 2 仍留在 API 中——這對下方的決策很重要,因為沒有任何因素強制遷移。
正面交鋒,逐項比較
• 發布 — GPT Image 2,2026年4月21日;GPT Image 2.5,2026年9月8日。
• API 陣容——一個識別碼 gpt-image-2,對比兩個:gpt-image-2.5-flare(快速、高吞吐量)與 gpt-image-2.5-sunburst(精準編輯)。
• Token 計價 — 採用相同的公開價目表:影像輸入 Token 每百萬個 8 美元,影像輸出 Token 每百萬個 30 美元;兩者皆另計文字輸入費用。
• 品質等級 — GPT Image 2 支援 low、medium 和 high;2.5 這對型號則新增 xhigh 和 max,並預設為 auto。
• 編輯行為——GPT Image 2 往往會重新渲染:編輯可能會重建影像,並偏離您原本想保留的內容。OpenAI 對 2.5 的主打賣點是定向編輯,只更改要求的區域,並在連續多輪操作中保持一致。
• 透明背景 — GPT Image 2 直到後期的預覽旗標才支援此功能;GPT Image 2.5 則自推出起即將其列為標準的背景參數。
• 獨立地位 — GPT Image 2 在 Artificial Analysis 的文生圖競技場中名列第一,圖像編輯方面也位居前兩名;目前兩款 2.5 模型均尚未登上任何獨立排行榜。

價格的故事:相同的費率表,每張圖片成本不明
相同的 token 費率是這場對決中最具決策參考價值的事實,但有一點必須提醒:費率表並不等於每張圖像的價格——每張圖像的成本是費率乘以模型實際消耗的 token 數,而 OpenAI 尚未公布 2.5 快照版本的 token 消耗量或成本計算器。就 GPT Image 2 而言,每張圖像的數字是已知的,因為獨立追蹤機構已實際測量:根據 Artificial Analysis,高品質 1024×1024 圖像約為 0.21 美元,中等品質約 0.05 美元,低品質約 0.006 美元。至於 GPT Image 2.5,誠實的答案是:在 OpenAI 之外,目前還沒有任何人知道 Flare 和 Sunburst 在特定品質設定下會高於或低於這些數字。一個共享相同費率表、但每張圖像消耗更多 token 的模型,實際上並不是同價升級;因此在投入大量使用之前,首先要驗證的就是每張圖像的成本。

在這種特定比較中,路由層的價值正是在於價格直通這點。GPT Image 2 是今天在 OrcaRouter 上以供應商牌價提供的——也就是每百萬個 token 收費 $8/$30,完全不加價——因此你看到的費率表就是 OpenAI 自己的;OpenAI 改價當天,我們這端也會即時生效,無需重新協商。由於這些帶 2.5 的識別碼共用那張費率表,成本問題純粹取決於 token 效率,而非取決於你呼叫哪一家供應商。此外,要試用尚未驗證的模型,走路由是安全做法:保留一個 OpenAI 相容的端點,當 gpt-image-2.5-flare 出現在你已經呼叫的上游清單上時,把一部分流量導向它,並維持自動容錯切換至 GPT Image 2,這樣一來,出錯的批次不會拖垮整個生成佇列。
延遲:兩個新模型彼此分歧之處
標題中的延遲數字——最高比 GPT Image 2 低 50%——屬於 Flare,而且是 OpenAI 自己的測量結果。Sunburst 則是制衡的另一端:OpenAI 表示它刻意以速度換取精確度,因此每次生成耗時更長。這意味著真正的比較並非單純「2.5 比 2 快」;而是 OpenAI 把原本的單一模型拆分為「快速車道」與「精細車道」,前者承載延遲優勢的承諾,後者承載編輯能力的承諾。早期發布合作夥伴回報 Flare 在實務上帶來大幅加速——OpenAI 挑選來展示的整合描述了更快的管線與更穩定的編輯行為——但這些是由廠商挑選的早期客戶,並非獨立基準。在沒有商業利益的人以相同品質設定測量兩種模型的「生成圖像時間」之前,請將 50% 這個數字視為方向性參考。
編輯才是真正的戰場——而這尚未獲得證實。
如果你讀過 OpenAI 為何要打造 2.5 的理由,就會發現整個發布其實是針對 GPT Image 2 最受批評的弱點所做出的回應:編輯時會重新渲染,而不是精準保留原貌。關於 GPT Image 2 的常見抱怨包括:用戶提出的小幅修改可能導致整張圖重建、人物或產品在多輪編輯中發生偏移、以及文字或背景在第二次、第三次處理時品質下降。2.5 的發布資料正是針對這些失敗模式下手——從參考照片保留主體、只做針對性編輯而讓畫面其餘部分不變,以及多輪一致性讓先前的修改不會被後續的修改覆蓋。早期的整合也呼應了這種說法:OpenAI 示範的編輯導向合作夥伴表示,該模型「了解哪些東西不該變動」。而截至本文撰寫時,這些宣稱尚未有任何獨立評測重現,因此 GPT Image 2 與 GPT Image 2.5 之間的編輯差距,目前仍是由展示影片背書的承諾,而非實測出來的結果。
基準差距與觀察重點
這是唯一一個對戰態勢對 GPT Image 2 有利的地方。GPT Image 2 在獨立排行榜上是已知變數:截至 2026 年 9 月初,它在 Artificial Analysis 的文字轉影像競技場位居榜首,在影像編輯競技場也排進前二——這些名次會隨著新模型加入而浮動,但確實是盲測的人類偏好分數。GPT Image 2.5 尚未出現在任何獨立排行榜上。有一個值得觀察的變數:2026 年 8 月期間,帶有 OpenAI 出處但匿名的檢查點以 mona-lisa-1 和 luna-lisa-alpha 代號在影像競技場中運行,觀察者在上線前就將它們與 2.5 系列連結起來。如果這些說法屬實,9 月 8 日的模型可能已在競技場 Elo 中享有領先優勢,一旦排行榜以真實名稱加入它們,這點就會浮現。
具體而言,值得觀察的有三點。第一,Flare 與 Sunburst 在各個品質等級下每張影像的 token 消耗量——這決定了「同價」的主張在碰到真實帳單時是否還能成立。第二,針對 Flare 與 GPT Image 2 做獨立的延遲或吞吐量測試,因為 50% 這個數字是這次升級最大的實際誘因。第三,Sunburst 加入後在影像編輯排行榜上的位置——那項結果會告訴你,OpenAI 是否真的縮小了它所宣稱的編輯差距,不單是對上 GPT Image 2,也包括排名在它之上的專業編輯工具。
該由誰來選擇哪一個
• 新專案、大量生成、品質至上——先以 GPT-Image-2.5 Flare 開始。它與 GPT Image 2 共用同一份費率表,並新增品質等級,且照規格來說更快;在正式投入管線之前,請先將首批批次與 GPT Image 2 平行執行,並在你自己的圖片上比較結果。
• 生產環境已在使用 GPT Image 2,一切正常——沒有急迫性。這次推出是追加性質,GPT Image 2 仍會留在排行榜上,而你等於是要用一個有獨立排行榜成績的模型,去換一個其宣稱仍屬廠商自行回報的模型。等到獨立分數或你自己的評估證明值得這樣做時再遷移,而不是在發表當天就遷移。
• 必須經得起審查的編輯——GPT-Image-2.5 Sunburst 是引人注目的模型,但也是公開證據最少的一個。如果截止時間迫使你必須選擇,請先在一組具代表性的編輯測試集上測試;否則就等每張圖片的成本與編輯排行榜出現後再決定。
• 對預算敏感的低品質或中等品質批次工作——請繼續使用 GPT Image 2,直到 2.5 模型在那些等級的 token 消耗量有文件記錄為止。以每張圖片 $0.006 至 $0.05 的價格來說,現有產品既便宜又為人所知;一張相同費率等級的後繼產品,仍可能在往上調整時讓你大吃一驚。
最終結論是一個標註日期的判定。GPT Image 2.5 在紙面上看起來更值得押注——同樣的公開定價、更寬廣的品質梯級、第一天就開誠布公,以及直指 GPT Image 2 已知弱點的編輯敘事——但這些優勢全是 OpenAI 的一面之詞,而 GPT Image 2 才是擁有獨立實測憑據的那一方。若要用一句話下決定:如果你能在自己的圖像上驗證效果,現在就試用 GPT Image 2.5;否則繼續以 GPT Image 2 作為生產環境預設,直到排行榜與 Token 計量表對這條新產品線給出屬於它們自己的判定。
對於 OrcaRouter 目前所路由的模型 — 瀏覽 OrcaRouter 的模型目錄 — 包括 openai/gpt-image-2 — 您看到的價格是供應商列表價格,原價傳遞,無任何加成。
