
Ideogram 4.5 對決 MAI Image 2.6 Preview:專才迎戰平台
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 217 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 111 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 982 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 43 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
Ideogram 4.5存在的目的只有一個:反覆編輯圖片,卻不讓它劣化。MAI Image 2.6 Preview是 Microsoft AI 的旗艦圖像模型,它的存在則是為了一次搞定所有事——生成、以多張參考圖進行編輯、讓提示詞以即時網路內容為依據,以及自行挑選長寬比——而且自 2026 年 9 月 4 日起,已可透過 Microsoft Foundry 以公開預覽形式呼叫。把兩者並排比較,數字指向一邊,產品形態卻指向另一邊。Ideogram 在它專為之打造的領域勝出;Microsoft 則幾乎在其他每一條軸線上都勝出,包括那些決定一個團隊究竟能否實際部署它的關鍵面向。
每一項是什麼
Ideogram 4.5 於 2026 年 9 月 30 日正式上線,範圍涵蓋 Ideogram 自家的應用程式、自有 API、MCP 整合與其應用程式集,以及合作夥伴平台。它提供四種渲染速度進行生成與編輯,原生以 2K 輸出,並在 4,016 × 6,016 的來源影像(2,420 萬像素)上展示局部編輯,全程不需降採樣。廠商的說法是,反覆多次處理不再產生漂移:邊緣維持原位、紋理得以留存,編輯過的局部裁切能重新接回原圖。權重並未公開。
MAI Image 2.6 是 Microsoft AI 最強大的圖像模型,也是這條血脈的巔峰,其脈絡依序涵蓋 2026 年 3 月的 MAI-Image-2、6 月的 MAI-Image-2.5、7 月的 MAI-Image-2.5-Pro,以及一路走來的 MAI-Image-2-Efficient。它於 2026 年 8 月在 Arena 的排行榜上首度亮相,名列第 2,而微軟在 2026 年 9 月 4 日將它推進 Microsoft Foundry 與 MAI Playground 的公開預覽,同時推出全新的 MAI-Image-2.6-Flash,鎖定高吞吐量的工作負載。這張規格表上的能力相當廣泛:可結合多張影像中的人物、產品、風格與場景的多參考編輯、網路接地、動態長寬比,以及最高 1.5K 解析度的輸出。它同時也是封閉模型,而且只能在微軟的雲端上運行。

陣容
• 存取 — 公開應用程式、API 與 MCP 整合自 2026 年 9 月 30 日起提供,而 Microsoft Foundry 與 MAI Playground 中的公開預覽則自 2026 年 9 月 4 日起提供。
• 價格 — 低每張 $0.03、中 $0.06、高 $0.22,見於供應商價目表,而微軟新聞貼文未公布價目表;定價藏在 Foundry 模型卡之後,獨立看板則列出該模型每 1,000 張圖片 $38.90。
• 文字生圖評分 — 在 2,278 個樣本中取得 1,013 Elo,排名第 34,對比 9,410 個樣本取得的 1,161 Elo,於 2026 年 8 月發布。
• 編輯分數 — 以 1,064 Elo 排名第 23,取自 2,459 個樣本,每 1,000 張圖片 $220.00;對比以 1,137 Elo 排名第 3,取自 15,684 個樣本,每 1,000 張 $38.90。
• 輸出 — 原生 2K,編輯功能以 4,016 × 6,016 展示,對比微軟規格所列最高 1.5K 解析度。
• 能力輪廓 — 一個突出的強項(多輪編輯保真度)對比廣泛的一組能力:多參考編輯、網路接地、動態長寬比,以及更快的 Flash 同系列型號。

同樣的板,同樣的面板,而且差距一點也不小。
這是罕見的對戰,其中存在乾淨的比較,因為兩個模型都列在 Artificial Analysis 上,且其資料列是由同一組評審小組和同一個投票池測量而得。
文字轉圖像:MAI-Image-2.6 以 1,161 Elo、9,410 個樣本,對上 Ideogram 4.5(High)的 1,013 Elo、2,278 個樣本。這是在樣本數為四倍的情況下領先 148 Elo,而價格欄顯示每千張圖片為 $38.90 對 $100.00。
圖像編輯:MAI-Image-2.6 以 15,684 個樣本取得 1,137 Elo,對上 Ideogram 4.5(High)以 2,459 個樣本取得 1,064 Elo,經獨立換算,每千次分別為 $38.90 對 $220.00。
微軟自己在 9 月 4 日的文章中,宣稱在這份排行榜上拿下文字生圖第 2 名與圖像編輯第 1 名的位置,兩者都標註「截至 2026 年 9 月 4 日」。一個月後再讀,文字生圖的名次依然成立,但圖像編輯的宣稱已不再成立:GPT Image 2.5 Sunburst 於 9 月問世,以 1,182 Elo 位居該榜第一,MAI-Image-2.6 則以 1,137 排名第三。這並不是在貶低該模型——在一個每週都有新產品推出的市場裡,任何「今日第 1 名」的宣稱都會遭遇這種情況,而這也是本文在每個名次旁都附上日期的原因。

真正重要的差異不是分數
如果董事會決定此事,那就結束了。他們沒有,原因有兩個。
首先,這兩個排行榜都沒有衡量 Ideogram 實際的主張。編輯競技場向投票者展示一張原始圖像和兩個單一指令的結果;它們從未讓投票者看到一連串編輯中的第十次與第一次相比,而這正是 Ideogram 打造 4.5 所要防止的偏移。73 分的編輯差距告訴你,MAI Image 2.6 在單次編輯上更受青睞。它完全無法說明大型檔案上的第十輪表現,而第十輪正是型錄團隊、招牌替換或照片修復真正仰賴的關鍵。
第二點是可用性形態。預覽版與正式產品並不相同。Foundry 公開預覽是評估與內部工具的理想歸屬,而 Microsoft 並未對其附加一般可用性條款——沒有可用性承諾、沒有淘汰通知、沒有輸送量保證。Microsoft 的模型也只能透過 Microsoft 的雲端與遊樂場存取,因此當預覽端點受到節流時,沒有第二家供應商可以作為後援。Ideogram 4.5 依照公開的分級方案推出,並附有可納入預算的價目表,而 Ideogram 自家的 API 是承諾,而非預覽版。
接著是價格走向,這對較新的模型來說確實令人不安。在微軟未公布價目表的情況下,唯一可比的數字是這些排行榜的換算值:MAI-Image-2.6 每千次 38.90 美元,對比 Ideogram 4.5 的文字轉圖像 100.00 美元與編輯 220.00 美元。一個在兩個排行榜上都拿到更高分數、換算價格又更低的模型,並不需要費力推銷——它就是預設選擇。
每一個實際上掙得自己一席之地的地方
當你工作流程中成本最高的環節是修復已核准的作品,而不是產出全新作品時,就選用 Ideogram 4.5:型錄的配色變體、整套行銷活動中需要翻譯的招牌標示、受損照片在還原時不重繪原本倖存的部分。24.2 百萬像素的示範與保留邊緣的宣稱,正是瞄準這個用途,而且沒有其他競爭模型以相當的證據提出這種宣稱。在正式採用之前,先用你最棘手的序列測試它;這項宣稱尚未被廠商以外的任何人重現。
當你需要整合的廣度與速度時,就選 MAI Image 2.6。以多張來源圖片進行的多重參考編輯、網路接地以及動態長寬比,已能涵蓋大多數製作需求,不必在流程中再加入第二個模型;而 MAI-Image-2.6-Flash 則針對高用量層級而存在——Microsoft 自家公布的數據是比 GPT-Image-2-Medium 快 2.8 倍,這項數據是在每分鐘 100 次請求、1024 × 1024 的內部負載測試中測得,屬於供應商自行回報且未經重現。如果你的團隊已經在 Azure 生態系中運作,整合成本幾乎為零,而這點可能勝過 2400 萬像素的編輯保真度。
如果你正在經營真正的内容營運,就兩者都採用。一個用於生成與產量的平台模型,一個用於必須像素級忠實的輪次的專門模型,以及一條說明哪個負責哪個步驟的規則。錯誤在於把這當成單次購買。
路由,當兩個端點具有不同的保證時
這場對決中沒有任何一項在 OrcaRouter 的目錄上。Ideogram 4.5 可透過廠商自家的 API 及數個第三方平台取得;MAI Image 2.6 Preview 則只能經由 Microsoft Foundry 和 MAI Playground 存取。我們的圖像產品線另有所屬——Google 的 Gemini 3.1 Flash Image 和 Imagen 4 識別碼、OpenAI 的 GPT-Image 模型——而聲稱我們有路由其中任何一個,根本禁不起一次查核。
這裡路由層真正要解決的,是這兩種可用性故事之間的不對稱。一個沒有 SLA 的預覽端點,正是自動容錯移轉最能發揮價值的情境:呼叫會落到某個有服務的替代方案上,而不是在凌晨兩點直接拋錯,而且你是在日誌裡發現,而不是在客服單裡。依供應商定價、按次計費,完全不額外加價意味著廠商降價或某個預覽版首次公布費率時,會在你帳單上當天就反映出來——當你正在進行的比較在編輯那一項上是 2.6 倍時,這點就很重要。而如果你想在不簽兩份合約的情況下,把某個預覽版拿來跟某個專門方案做 A/B 測試,用一把金鑰是最便宜的做法。
現在該怎麼辦
如果你今天只能選一個模型,老實說,更好的模型同時也是更便宜的那個,而且是你只能在預覽版中取得的那個。如果你能接受待在 Microsoft 的雲端與預覽條款之內,就選 MAI Image 2.6;如果你需要可預測的價目表、第一方 API,或特定的編輯保真度行為,就選 Ideogram 4.5,並接受你為此支付的費用大約是換算後編輯費率的兩倍半。
有兩件事就能拍板定案。第一是多輪保真度基準測試:同一張影像、十次連續編輯、量測其偏差。在有人實際跑過之前,讓 Ideogram 4.5 顯得有趣的那項特性尚未被量測,而讓 MAI Image 2.6 顯得有趣的那項特性則已被量測。第二是微軟將 MAI Image 2.6 從預覽版推進到正式推出,並公布價目表;這消除了對平台策略的最後一個實際反對理由,也讓專用模型的論點完全落在漂移上。
