用於 Ideogram 4.5 對決 MAI-Image-2.5-Pro 的主視覺標題卡,寫著「在位者已被取代兩次」,並附上標籤:「Ideogram 4.5 —— 編輯排名第 23、1,064 Elo、2026 年 9 月 30 日上線」、「MAI-Image-2.5-Pro —— 編輯排名第 9、1,108 Elo、自 2026 年 7 月起預覽」、「MAI-Image-2.6-Flash —— 排名第 4、1,125 Elo、每 1k 收費 $19.50」。OrcaRouter 標誌合成於右下角。
Guides & Insights

Ideogram 4.5 對決 MAI-Image-2.5-Pro:新編輯器遇上已被取代的舊款

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

在這場對決中,藏著一個雙方廠商行銷都不會揭露的尷尬事實。 MAI-Image-2.5-Pro是比較中點名的對手,而且它確實很強——在 Artificial Analysis 的編輯排行榜上排名世界第九;而在同一份榜單上,你還能看到 Microsoft 之後已推出 MAI-Image-2.6 與 MAI-Image-2.6-Flash,兩者得分都高於它,成本卻只要一小部分。同時,Ideogram 4.5自 2026 年 9 月 30 日起上線,是該榜單上最新的編輯器,排名第 23。所以這篇文章有用的版本並不是「這兩者哪個勝出」。而是:一個帶著未經檢驗宣稱的新專才,對上一個經過充分考驗、但其自家廠商早已將其超越的現任者。

兩個具名模型之間的直接答案:MAI-Image-2.5-Pro 在編輯上領先 44 Elo,每張圖片大約便宜三倍,而且樣本數大五倍。接下來所談的一切,都是在說明為什麼這並非故事的全部。

兩個模型各用一個簡短段落

• Ideogram 4.5 — 於 2026 年 9 月 30 日推出。這是一款精準編輯模型,具備生成與編輯兩種操作,並提供四種渲染速度。其主打跨序列的保真度:編輯會保留變更區域的邊界,讓結果能拼接回最高達 4,016 × 6,016 的來源影像,而無需重新渲染畫面其餘部分。文字轉圖像在 167 個項目中排名第 34,Elo 為 1,014;圖像編輯排名第 23,Elo 為 1,064;依速度設定,每張圖像為 $0.03 至 $0.22。

• MAI-Image-2.5-Pro — 微軟品質層級的圖像模型,自 2026 年 7 月 23 日起在 Azure AI Foundry 上開放公開預覽。它是一款專注而精準的編輯器:可進行目標物件替換、版面調整、圖中文字更新、瑕疵清除,微軟聲稱其在五種語言間具備 94% 的多圖角色一致性與 96.8% 的文字算繪準確率——兩者皆為廠商自行回報且未經查證。文字生圖以 1,100 Elo 排名第 12;圖像編輯以 1,108 Elo 排名第 9;依該排行榜的換算,每 1,000 張圖像為 108.50 美元。

兩者都是封閉、託管且按用量計費。兩者都不是通用型視覺模型。兩者都鎖定同一種買家:手上已有圖像、需要修改而不必重建的人。

棋盤,以及那一列下方的那一列

Artificial Analysis 的編輯委員會採用盲測的成對人類偏好。來看這裡相關的兩列:

• 編輯 — MAI-Image-2.5-Pro 第 9 名,以 1,108 ± 8 Elo、14,733 票、每 1,000 次 $108.50。Ideogram 4.5 第 23 名,以 1,064 ± 11 Elo、2,382 票、每 1,000 次 $220.00。

• 文字轉圖像 — MAI-Image-2.5-Pro 第 12 名,1,100 ± 8 Elo,14,523 票。Ideogram 4.5 第 34 名,1,014 ± 11 Elo,2,247 票。

現在,微軟寧可你沒讀到緊接在它們旁邊的那些資料列,因為它們改變了「現任者」的定義:

• MAI-Image-2.6(2026 年 8 月)——編輯排名第 3 名,Elo 1,137;文字轉圖像排名第 5,Elo 1,150;每 1,000 張圖片 $38.90。

• MAI-Image-2.6-Flash(2026 年 9 月)— 編輯 第 4 名,Elo 1,125;文字轉圖像第 9 名,Elo 1,105;每 1,000 張圖像 19.50 美元。

• MAI-Image-2.5(2026 年 6 月)—— 編輯排名第 7,1,113 Elo,每 1,000 次 48.10 美元。

把這些放在一起讀,MAI-Image-2.5-Pro 的處境就變得清清楚楚,而且難看得與 Ideogram 毫無關係。它是榜上最貴的微軟圖像模型,要價 108.50 美元,卻在編輯項目上被自家三個同門兄弟擊敗,其中一個的價格還便宜五倍半。它七月預覽版的定價本來就注定要重新檢討;這份榜單顯示的是,微軟後來打造出更便宜、分數卻更高的模型,而這既是產品線成熟化的尋常樣貌,也是在比較「Ideogram 4.5 vs MAI-Image-2.5-Pro」的買家應該把視野再擴大一列的原因。

Screenshot of the Artificial Analysis Image Editing leaderboard (AA-Image-Editing v2.0) showing MAI-Image-2.5-Pro at rank 9 with 1,108 Elo from 14,733 samples at $108.5 per 1,000 images, ranking 7-12, with MAI-Image-2.6 at 1,137 and MAI-Image-2.6-Flash at 1,125 above it and Ideogram 4.5 (High) at 1,064 Elo from 2,382 samples at $220.0 per 1,000 further down the same table.

兩種不同的編輯哲學

Elo 差距為 44 分;設計差距則更大。

微軟為 MAI-Image-2.5-Pro 提出的賣點是一致性。這個模型的設計是要讓你只改變一件事,其他一切都不會跟著移動——主體身分、光線和紋理在多次迭代中都保持穩定,而這就是 94% 多圖角色一致性說法的重點。它是一款通用型的精準編輯器:替換物件、修正版面、校正招牌上的文字、清除瑕疵。它不是圍繞單一主打功能而打造;而是為了把日常工作做得又好又一致。

Ideogram 對 4.5 的宣傳訴求更狹窄、也更技術性。它並未宣稱自己的編輯效果比任何人都更好看——它自家的頁面小心翼翼地展示一種行為,而不是印出排名。它宣稱的是,當你不斷疊加編輯時,編輯不會逐漸劣化,並在一個 2400 萬像素檔案的原始解析度下展示這一點。微軟賣的是主體的一致性,Ideogram 賣的則是未觸及像素的一致性。

那些是不同的失敗模式。模型可以完美保留一張臉,卻仍重新渲染壁紙。模型可以讓影格保持位元完全一致,卻仍在身分上漂移。沒有人發表過能在連續編輯序列中捕捉到其中任一項的基準測試,這就是為什麼兩家廠商推銷的宣稱都落在競技場之外。

Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.

價格,在真正重要的設定下

• Ideogram 4.5 — 低模式下每張圖片 $0.03,中模式 $0.06,高模式 $0.22。原生 2K,成本取決於渲染速度而非解析度。

• MAI-Image-2.5-Pro — 以 token 計量:每百萬文字輸入 token 收費 $5、每百萬圖像輸入 $8、每百萬圖像輸出 $106,Artificial Analysis 換算為每 1,000 張圖像 $108.50。這是預覽版定價;正式推出(一般可用性)的價目表可能使其變動,而從同系列的其他項目來看,很難看好它能維持下去。

• 微軟更廣泛的產品陣容——MAI-Image-2.6-Flash 每 1,000 單位為 19.50 美元,相較於 MAI-Image-2.5-Pro 的 108.50 美元,對於一個在兩個排行榜上都排名更高的模型來說,這是五倍半的差距。

所以每張影像的計算方式是:Ideogram 4.5 在 High 設定下($0.22)的成本約為 MAI-Image-2.5-Pro 換算費率的兩倍,也大約是 MAI-Image-2.6-Flash 的十一倍。在 Low 設定下,它則比這裡所有方案都便宜。設定就是整個決策的關鍵,而 Ideogram 所推銷的 drift 示範則落在昂貴的那一端。

Comparison scoreboard for Ideogram 4.5 and MAI-Image-2.5-Pro. Left column 'Ideogram 4.5': live Sep 30 2026, editing rank 23 at 1,064 Elo, text-to-image rank 34 at 1,014 Elo, $0.03 to $0.22 per image, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'MAI-Image-2.5-Pro': preview since Jul 23 2026, editing rank 9 at 1,108 Elo, text-to-image rank 12 at 1,100 Elo, $108.50 per 1,000 images, surgical editing with 94% character consistency claimed, 1MP output cap. A footer reads 'All leaderboard figures per Artificial Analysis, October 2026; Microsoft capability claims are vendor-reported and unverified.'

明智的買家在這裡實際上會怎麼做

這個比較中隱藏著三個決定,而它們有不同的答案。

如果問題是「這兩款編輯器我該用哪一款」,MAI-Image-2.5-Pro 在證據上勝出——Elo 領先 44 分,票數是對方的五倍,價格卻只要大約三分之一。Ideogram 4.5 的反駁是一項序列保真度的主張,而沒有任何競技場測試過這點。這是一項真實的主張,值得用你自己的圖片來測試,但它目前還不是證據。

如果問題是「我已決定要用 Microsoft,該選哪個模型」,MAI-Image-2.5-Pro 幾乎就是錯誤答案。MAI-Image-2.6-Flash 在編輯方面全球排名第四,在生成方面排名第九,而且每 1,000 次收費 19.50 美元——是 2.5-Pro 費率的五分之一。除非你有特定理由認為 2.5-Pro 能在你的工作負載上勝出,否則這個較新、較便宜的兄弟型號是更好的預設選擇。

如果問題是「我今天用的模型是否已經好到我不該換」,那麼誠實的測試是沒有人會公開的那一種:在你自己的檔案上跑一段十輪編輯序列,比對那些你從未要求模型動到的區域,並以每個完成的序列、而不是每張生成的圖片來計算這趟執行的成本。在購買其中任何一個之前先做這件事。它只需要一個下午,卻能回答 44 Elo 和 220 美元價目表無法回答的問題。

OrcaRouter 適合的地方,以及不適合的地方

標題中提到的兩個模型都不在我們的目錄中。Ideogram 完全沒有出現在 OrcaRouter 上,而 MAI-Image-2.5-Pro 是透過 Azure 存取的 Microsoft Foundry 預覽版。說成其他情況會是不準確的,而這同樣適用於較新的 Microsoft 項目——2.6 和 2.6-Flash 是 Foundry 模型,並非我們提供的路由。

現時目錄上可供圖像工作使用的選擇更為狹窄:OpenAI 的 GPT-Image-1.5 每百萬輸入詞元 8 美元、每百萬輸出 32 美元,GPT-Image-2 則為 8 美元與 30 美元,xAI 較早推出的 grok/grok-imagine-image每次呼叫 0.20 美元,以及 Google 的 Imagen 4 系列。全部按 供應商定價表價格、不加價計算,這意味着供應商自己降價,當天就會直接反映在我們這邊,無須重新議價——這也是你在這裏讀到的每張圖片價目表,其實是供應商的價目表,而非我們的價目表的原因。

像這樣的比較,其實用價值在於試用階段,而非生產階段。當某個模型上架到目錄時,測試保真度宣稱的低成本做法,是把一部分流量導向它,讓你目前使用的模型作為自動容錯移轉,並讓不良批次容錯移轉,而不是直接失敗。不過,在這個特定的對戰組合中,兩個候選者都不在目錄內,而「我該去哪裡取得?」的答案,就是各家廠商自家的 API,以及轉售它們的第三方平台。

裁決,附帶但書

就現有的衡量指標來看,MAI-Image-2.5-Pro 在編輯上勝過 Ideogram 4.5,在生成上也勝過它,每張影像的成本更低,而且背後有高出五倍的投票者樣本作為後盾。如果你今天就需要一個答案,而你的名單上只有這兩個名字,那就是答案。

有兩點但書應與其並列。第一,這項衡量並未測試 Ideogram 所推銷的東西——多輪保真度在單次編輯競技場中是看不見的,因此第 23 名並非對漂移說法的反駁,正如漂移說法本身也不是證據。第二,現任者正被自家供應商取代:以每 1,000 次 19.50 美元、且在編輯項目排名第四的表現來看,MAI-Image-2.6-Flash 才是大多數買家應該拿來比較的微軟影像模型;而本文竟是圍繞著一個更昂貴、得分更低的同門模型來鋪陳,這點與其說反映了任一實驗室的工程實力,不如說反映了這場對決是如何被安排的。

留意兩件事。一項獨立的多輪保真度測試——第一份發表的測試將為兩家供應商目前各執一詞、卻拿不出憑據的爭論一槌定音。還有 MAI-Image-2.5-Pro 預覽定價的任何變動,因為一張 108.50 美元的價目表高懸於三個更便宜、評分更高的同門產品之上,這種定位一碰上銷售週期就站不住腳。