Ideogram 4.5 與 MAI Image 2.6 Preview 比較的主視覺卡片。標題寫著「Ideogram 4.5 vs MAI Image 2.6 Preview」,下方一行是「專才對上平台」。左側卡片標題為「Ideogram 4.5」,列出「自 2026 年 9 月 30 日起提供公開 API」、「Elo 1,013,2,278 個樣本」以及「每張圖片 $0.03 至 $0.22」;右側卡片標題為「MAI Image 2.6 Preview」,列出「於 Microsoft Foundry 公開預覽」、「Elo 1,161,9,410 個樣本」以及「最高 1.5K 輸出」。頁尾寫著「同樣的看板,同樣的評審小組 - Artificial Analysis」。
Guides & Insights

Ideogram 4.5 對決 MAI Image 2.6 Preview:專才迎戰平台

作者

Magnus Corvin

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

Ideogram 4.5存在的目的只有一個:反覆編輯圖片,卻不讓它劣化。MAI Image 2.6 Preview是 Microsoft AI 的旗艦圖像模型,它的存在則是為了一次搞定所有事——生成、以多張參考圖進行編輯、讓提示詞以即時網路內容為依據,以及自行挑選長寬比——而且自 2026 年 9 月 4 日起,已可透過 Microsoft Foundry 以公開預覽形式呼叫。把兩者並排比較,數字指向一邊,產品形態卻指向另一邊。Ideogram 在它專為之打造的領域勝出;Microsoft 則幾乎在其他每一條軸線上都勝出,包括那些決定一個團隊究竟能否實際部署它的關鍵面向。

每一項是什麼

Ideogram 4.5 於 2026 年 9 月 30 日正式上線,範圍涵蓋 Ideogram 自家的應用程式、自有 API、MCP 整合與其應用程式集,以及合作夥伴平台。它提供四種渲染速度進行生成與編輯,原生以 2K 輸出,並在 4,016 × 6,016 的來源影像(2,420 萬像素)上展示局部編輯,全程不需降採樣。廠商的說法是,反覆多次處理不再產生漂移:邊緣維持原位、紋理得以留存,編輯過的局部裁切能重新接回原圖。權重並未公開。

MAI Image 2.6 是 Microsoft AI 最強大的圖像模型,也是這條血脈的巔峰,其脈絡依序涵蓋 2026 年 3 月的 MAI-Image-2、6 月的 MAI-Image-2.5、7 月的 MAI-Image-2.5-Pro,以及一路走來的 MAI-Image-2-Efficient。它於 2026 年 8 月在 Arena 的排行榜上首度亮相,名列第 2,而微軟在 2026 年 9 月 4 日將它推進 Microsoft Foundry 與 MAI Playground 的公開預覽,同時推出全新的 MAI-Image-2.6-Flash,鎖定高吞吐量的工作負載。這張規格表上的能力相當廣泛:可結合多張影像中的人物、產品、風格與場景的多參考編輯、網路接地、動態長寬比,以及最高 1.5K 解析度的輸出。它同時也是封閉模型,而且只能在微軟的雲端上運行。

A generated two-column comparison scoreboard for Ideogram 4.5 and MAI Image 2.6 Preview. The Ideogram column reads 'Access: public API', 'Price: $0.03 to $0.22', 'Text-to-image: Elo 1,013', 'Editing: rank 23', 'Output: native 2K' and 'Announced: Sep 30, 2026'; the MAI column reads 'Access: invite-gated', 'Price: none published', 'Text-to-image: Elo 1,161', 'Editing: No. 3 on Arena', 'Output: not specified' and 'Announced: Aug 19, 2026'. The footer reads 'Elo figures per Artificial Analysis; access per Microsoft.'

陣容

• 存取 — 公開應用程式、API 與 MCP 整合自 2026 年 9 月 30 日起提供,而 Microsoft Foundry 與 MAI Playground 中的公開預覽則自 2026 年 9 月 4 日起提供。

• 價格 — 低每張 $0.03、中 $0.06、高 $0.22,見於供應商價目表,而微軟新聞貼文未公布價目表;定價藏在 Foundry 模型卡之後,獨立看板則列出該模型每 1,000 張圖片 $38.90。

• 文字生圖評分 — 在 2,278 個樣本中取得 1,013 Elo,排名第 34,對比 9,410 個樣本取得的 1,161 Elo,於 2026 年 8 月發布。

• 編輯分數 — 以 1,064 Elo 排名第 23,取自 2,459 個樣本,每 1,000 張圖片 $220.00;對比以 1,137 Elo 排名第 3,取自 15,684 個樣本,每 1,000 張 $38.90。

• 輸出 — 原生 2K,編輯功能以 4,016 × 6,016 展示,對比微軟規格所列最高 1.5K 解析度。

• 能力輪廓 — 一個突出的強項(多輪編輯保真度)對比廣泛的一組能力:多參考編輯、網路接地、動態長寬比,以及更快的 Flash 同系列型號。

A screenshot of the MAI-Image-2.6 model card in Microsoft Foundry, captured in English with a throwaway browser profile, showing the model's publisher, its Preview lifecycle stage, a context window of 32,000 and token limits of 4,096 output, and the pay-as-you-go pricing link. The card does not display a per-image rate.

同樣的板,同樣的面板,而且差距一點也不小。

這是罕見的對戰,其中存在乾淨的比較,因為兩個模型都列在 Artificial Analysis 上,且其資料列是由同一組評審小組和同一個投票池測量而得。

文字轉圖像:MAI-Image-2.6 以 1,161 Elo、9,410 個樣本,對上 Ideogram 4.5(High)的 1,013 Elo、2,278 個樣本。這是在樣本數為四倍的情況下領先 148 Elo,而價格欄顯示每千張圖片為 $38.90 對 $100.00。

圖像編輯:MAI-Image-2.6 以 15,684 個樣本取得 1,137 Elo,對上 Ideogram 4.5(High)以 2,459 個樣本取得 1,064 Elo,經獨立換算,每千次分別為 $38.90 對 $220.00。

微軟自己在 9 月 4 日的文章中,宣稱在這份排行榜上拿下文字生圖第 2 名與圖像編輯第 1 名的位置,兩者都標註「截至 2026 年 9 月 4 日」。一個月後再讀,文字生圖的名次依然成立,但圖像編輯的宣稱已不再成立:GPT Image 2.5 Sunburst 於 9 月問世,以 1,182 Elo 位居該榜第一,MAI-Image-2.6 則以 1,137 排名第三。這並不是在貶低該模型——在一個每週都有新產品推出的市場裡,任何「今日第 1 名」的宣稱都會遭遇這種情況,而這也是本文在每個名次旁都附上日期的原因。

A screenshot of the Artificial Analysis text-to-image leaderboard, captured in English, showing MAI-Image-2.6 at 1,161 Elo, Ideogram 4.5 (High) at rank 34 with 1,013 Elo from 2,278 samples at $100.0 per 1,000 images, and GPT Image 2.5 Sunburst (max) first at 1,197 Elo.

真正重要的差異不是分數

如果董事會決定此事,那就結束了。他們沒有,原因有兩個。

首先,這兩個排行榜都沒有衡量 Ideogram 實際的主張。編輯競技場向投票者展示一張原始圖像和兩個單一指令的結果;它們從未讓投票者看到一連串編輯中的第十次與第一次相比,而這正是 Ideogram 打造 4.5 所要防止的偏移。73 分的編輯差距告訴你,MAI Image 2.6 在單次編輯上更受青睞。它完全無法說明大型檔案上的第十輪表現,而第十輪正是型錄團隊、招牌替換或照片修復真正仰賴的關鍵。

第二點是可用性形態。預覽版與正式產品並不相同。Foundry 公開預覽是評估與內部工具的理想歸屬,而 Microsoft 並未對其附加一般可用性條款——沒有可用性承諾、沒有淘汰通知、沒有輸送量保證。Microsoft 的模型也只能透過 Microsoft 的雲端與遊樂場存取,因此當預覽端點受到節流時,沒有第二家供應商可以作為後援。Ideogram 4.5 依照公開的分級方案推出,並附有可納入預算的價目表,而 Ideogram 自家的 API 是承諾,而非預覽版。

接著是價格走向,這對較新的模型來說確實令人不安。在微軟未公布價目表的情況下,唯一可比的數字是這些排行榜的換算值:MAI-Image-2.6 每千次 38.90 美元,對比 Ideogram 4.5 的文字轉圖像 100.00 美元與編輯 220.00 美元。一個在兩個排行榜上都拿到更高分數、換算價格又更低的模型,並不需要費力推銷——它就是預設選擇。

每一個實際上掙得自己一席之地的地方

當你工作流程中成本最高的環節是修復已核准的作品,而不是產出全新作品時,就選用 Ideogram 4.5:型錄的配色變體、整套行銷活動中需要翻譯的招牌標示、受損照片在還原時不重繪原本倖存的部分。24.2 百萬像素的示範與保留邊緣的宣稱,正是瞄準這個用途,而且沒有其他競爭模型以相當的證據提出這種宣稱。在正式採用之前,先用你最棘手的序列測試它;這項宣稱尚未被廠商以外的任何人重現。

當你需要整合的廣度與速度時,就選 MAI Image 2.6。以多張來源圖片進行的多重參考編輯、網路接地以及動態長寬比,已能涵蓋大多數製作需求,不必在流程中再加入第二個模型;而 MAI-Image-2.6-Flash 則針對高用量層級而存在——Microsoft 自家公布的數據是比 GPT-Image-2-Medium 快 2.8 倍,這項數據是在每分鐘 100 次請求、1024 × 1024 的內部負載測試中測得,屬於供應商自行回報且未經重現。如果你的團隊已經在 Azure 生態系中運作,整合成本幾乎為零,而這點可能勝過 2400 萬像素的編輯保真度。

如果你正在經營真正的内容營運,就兩者都採用。一個用於生成與產量的平台模型,一個用於必須像素級忠實的輪次的專門模型,以及一條說明哪個負責哪個步驟的規則。錯誤在於把這當成單次購買。

路由,當兩個端點具有不同的保證時

這場對決中沒有任何一項在 OrcaRouter 的目錄上。Ideogram 4.5 可透過廠商自家的 API 及數個第三方平台取得;MAI Image 2.6 Preview 則只能經由 Microsoft Foundry 和 MAI Playground 存取。我們的圖像產品線另有所屬——G​oogle 的 Gemini 3.1 Flash Image 和 Imagen 4 識別碼、O​penAI 的 GPT-Image 模型——而聲稱我們有路由其中任何一個,根本禁不起一次查核。

這裡路由層真正要解決的,是這兩種可用性故事之間的不對稱。一個沒有 SLA 的預覽端點,正是自動容錯移轉最能發揮價值的情境:呼叫會落到某個有服務的替代方案上,而不是在凌晨兩點直接拋錯,而且你是在日誌裡發現,而不是在客服單裡。依供應商定價、按次計費,完全不額外加價意味著廠商降價或某個預覽版首次公布費率時,會在你帳單上當天就反映出來——當你正在進行的比較在編輯那一項上是 2.6 倍時,這點就很重要。而如果你想在不簽兩份合約的情況下,把某個預覽版拿來跟某個專門方案做 A/B 測試,用一把金鑰是最便宜的做法。

現在該怎麼辦

如果你今天只能選一個模型,老實說,更好的模型同時也是更便宜的那個,而且是你只能在預覽版中取得的那個。如果你能接受待在 Microsoft 的雲端與預覽條款之內,就選 MAI Image 2.6;如果你需要可預測的價目表、第一方 API,或特定的編輯保真度行為,就選 Ideogram 4.5,並接受你為此支付的費用大約是換算後編輯費率的兩倍半。

有兩件事就能拍板定案。第一是多輪保真度基準測試:同一張影像、十次連續編輯、量測其偏差。在有人實際跑過之前,讓 Ideogram 4.5 顯得有趣的那項特性尚未被量測,而讓 MAI Image 2.6 顯得有趣的那項特性則已被量測。第二是微軟將 MAI Image 2.6 從預覽版推進到正式推出,並公布價目表;這消除了對平台策略的最後一個實際反對理由,也讓專用模型的論點完全落在漂移上。