
Ideogram 4.5 對比 Grok Imagine Image 2.0:同樣的價格問題,相反的答案
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 261 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 216 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
用一句話總結這個比較:在 Artificial Analysis 的編輯排行榜上,Grok Imagine Image 2.0以 1,107 Elo 排名第 10,定價為每 1,000 張圖片 $60。Ideogram 4.5以 1,064 Elo 排名第 23,在同一排行榜的換算中定價為每 1,000 張圖片 $220。便宜 3.7 倍,領先 43 Elo。在文字轉圖像排行榜上,這個模式再次出現——Grok Imagine Image 2.0 為 1,155,Ideogram 4.5 為 1,014,價格分別為 $60 對 $100。
這兩款模型都是來自認定「編輯就是前沿」的實驗室所推出的編輯優先產品。兩者都在今年問世——Grok 於 2026 年 8 月 7 日,Ideogram 4.5 於 2026 年 9 月 30 日。而它們以截然相反的方式回答同一個問題:xAI 打造了一個編輯環境,並配備一整套面向使用者的工具;Ideogram 則打造了一個編輯引擎,並針對單一特性加以最佳化。了解這兩種形態哪一種更契合你的工作,比 Elo 差距更有用,但 Elo 差距確實存在,而且是單向的。
框住它的四個數字
• 文字轉圖像 — Grok Imagine Image 2.0 167 個中的第 4 名,以 1,155 ± 11 Elo(6,879 票,2026 年 8 月),每 1,000 張圖像 $60.00。Ideogram 4.5 第 34 名,以 1,014 ± 11 Elo(2,247 票,2026 年 9 月),每 1,000 張 $100.00。
• 影像編輯 — Grok Imagine Image 2.0 第 10 名,以 1,107 ± 9 Elo(7,308 票),每 1,000 張 $60.00。Ideogram 4.5 第 23 名,以 1,064 ± 11 Elo(2,382 票),每 1,000 張 $220.00。
編輯那一列才是決定這場對決的關鍵,因為這兩款模型主要都是以編輯器身分來販售。43 分的 Elo 差距,且信賴區間不重疊,價格又高出 3.7 倍,這可不是微不足道的結果。這並不代表 Ideogram 4.5 是糟糕的模型。這代表的是,在市場唯一擁有的獨立衡量標準上,較便宜的模型所產生的編輯結果,更常獲得盲測評審偏好。
關於那些數據的兩點補充說明。排行榜將 Grok Imagine Image 2.0 的創作者列為 SpaceXAI,這是 xAI 在其資料中的顯示方式——那是排行榜的標籤,不是錯誤。而 Ideogram 4.5 的資料列已有兩週之久,樣本量約為 Grok 的三分之一,因此其 ±11 區間是最寬的一種估計;差距確實存在,但隨著票數累積,名次可能會略微變動。
一個引擎和一個環境
分數的重要性不如每件產品的形狀,而這些形狀確實截然不同。
• Ideogram 4.5——一款引擎。兩項操作:生成與精準編輯,四種渲染速度,原生 2K,以及一項核心特性:編輯會保留邊界,因此裁切後的片段能重新拼接回 4,016 × 6,016 的原圖,而不必重新渲染畫面的其餘部分。你下指令,它負責像素。
• Grok Imagine Image 2.0——一套環境。用於區域選擇性編輯的魔法棒、可精準為特定區域重新上色或替換的分割功能、背景移除、多參考輸入(消費級應用程式最多支援五張圖片,API 則為三張)、能將單一圖片重新構圖成九種長寬比的 Smart Resize,以及適用於產品攝影、人物肖像、電子商務、遊戲素材與行銷海報的範本。
讀完那兩份清單,定價就不再顯得奇怪了。Ideogram 是針對單一操作收取保真保證的費用。xAI 則是針對一套工具組收取一筆固定費用。如果你的工作是「把這項精確指令套用到一個 2400 萬像素檔案的這個精確區域,並讓其他一切保持位元完全相同」,那麼 Ideogram 的方案更為具體。如果你的工作是「讓這張產品照能在九種格式中派上用場,並更換背景」,這套工具已經涵蓋得到,而且費用更低。

這項主張,兩個董事會都沒有測試。
Ideogram 4.5 的具體承諾是,反覆編輯不再漂移——沒有像素位移、沒有色彩偏移,也沒有跨回合的偽影累積。其發佈頁面正是展示了這一點,而該示範也將 Grok 的同系列世代與其他模型並列,作為比較基準。
沒有排行榜衡量這件事。編輯競技場向投票者展示單一來源圖像、單一指令和兩項結果。投票者看不出第四輪悄悄柔化了某些字型,或把一張臉移動了兩毫米,因為第四輪不在螢幕上。多輪保真度對這個方法而言是隱形的。
所以,公平的解讀雖然狹隘但很真實:在兩家廠商實際販售的特性上——也就是以一次一次編輯來評判的編輯品質——Grok Imagine Image 2.0 有更多證據顯示它領先,而且成本少了四分之三。在只有 Ideogram 宣稱的特性上——也就是跨序列的保真度——兩個模型都沒有公開的量測數據,而唯一取得數據的方法就是自己實測。
這種不對稱值得直白地指出,因為人很容易把計分板讀成一項已成定論的裁決,也很容易把 Ideogram 的發布頁面讀成反駁。這兩種讀法都不成立。計分板衡量的是與該主張相近但不等同的某件事;發布頁面則在缺乏第三方可查證證據的情況下,逕自斷言該主張。
BFL 風格的多輪編輯會讓你付出什麼代價
若漂移是你的瓶頸,這筆帳離中立還差得遠。Ideogram 4.5 在推出時公布的經銷商價目表上,Low 每張影像為 0.03 美元,Medium 為 0.06 美元,High 為 0.22 美元。漂移示範——2400 萬像素來源、保留編輯邊界——是 High 設定的工作負載。對單一圖片進行十輪編輯序列,在你決定它是否奏效之前,就要花費 2.20 美元的 Ideogram 點數。
Grok Imagine Image 2.0 每 1,000 張 60 美元,相當於每張圖片 0.06 美元。同一張圖片跑十輪是 60 美分;如果第十輪已經出現漂移,你的損失不到用 Ideogram 跑到同樣令人失望結果所花費的三分之一——或者更實用地說,你可以負擔得起在五倍數量的圖片上進行實驗,以了解漂移是否真的是你管線中的問題。
這就是反對在你尚未衡量某個保真度問題之前,就先從 Ideogram 著手的實務理由。先做低成本的實驗;只針對低成本工具明顯失敗的圖像,才購買專門引擎。


可用性問題
在本次比較的版本中,這兩個模型都不在 OrcaRouter 上。我們的目錄收錄了 xAI 較早期的圖像模型,grok/grok-imagine-image,每次呼叫收費 $0.20——那是上一代,並非 2.0 版本,也不是上面所討論的那一列。我們的目錄完全沒有收錄 Ideogram。這裡的比較,是兩個各自透過其供應商 API 存取的代管產品之間的比較,而且在兩種情況下都是透過第三方平台存取。
我們的 OpenAI 圖像產品線,正好是相反情況的一個有用例證。GPT-Image-2 的價格是每百萬個輸入 token 8 美元、每百萬個輸出 token 30 美元,這正是 OpenAI 自家的定價——零加成,直接沿用供應商費率。當型錄上的供應商降價時,那道降價當天就會在我們這邊生效,無需重新協商;這正是讓路由層在圖像工作上值得擁有的特性。本文提到的模型尚未列入該清單,所以誠實的說法很簡單:它們今天在這裡還無法透過路由取用。
無論哪一個先推出,評估模式都不變且成本低廉:把一部分流量導向新的識別碼,讓現行版本作為自動容錯移轉,並讓新模型在真實影像上、而非展示影片上,證明自己值得採用。比起用兩張圖片並排比較,這才是驗證漂移說法實質上更好的方式。
該選哪一個
如果你想要一個涵蓋生成、編輯與周邊工具組的單一固定價格,而且你的圖片大小是瀏覽器分頁能容納的,就選擇 Grok Imagine Image 2.0。它在生成方面排名世界第四,在編輯方面排名第十,在兩個排行榜上都比周遭所有項目便宜,而它獲得近 7,000 票、1,155 Elo 的參考分數是穩定的數字,而非兩週前才出爐的數字。
如果你的交付成品是印刷解析度或來源解析度,就選擇 Ideogram 4.5;而如果確實搞壞你工作流程的具體問題,是第十次編輯毀了第一次的成果,那也該選它。這是個真實的問題,而 4.5 是唯一已推出、直接處理這個問題的產品。進場前請明白,你大約要付 Grok 費率的 3.7 倍,換取一項沒有人獨立測量過的特性,而且它並非在推銷的那項特性——原始編輯偏好——目前以 43 Elo 之差傾向 xAI。
決勝關鍵在於:兩種情況下都是同一個測試,而且只花一個下午——一張圖、十次編輯,比對第一次與第十次之間未經更動的區域。先在便宜的模型上跑一遍。如果它撐得住,你就省下了一紙專家合約。如果它崩了,你就確切知道 Ideogram 4.5 適合哪些圖像——而且手上有前後對照,足以證明那 0.22 美元花得有理。
