
MAI-Image-2.5-Pro vs MAI-Image-2.6 Preview:可部署的編輯器 vs 只能排名的模型
- z-ai新Z.ai: GLM 5.32026-08-1860智能75程式
- obsidian新Qwen3.8 27B Uncensored (Aggressive)2026-08-1552智能68程式
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grok新SpaceXAI: Grok 4.62026-08-1261智能77程式
- metaMeta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
- grokxAI: Grok 4.52026-07-0856智能72程式
每個人都在問的問題是MAI-Image-2.5-Pro和MAI-Image-2.6 Preview 哪一個比較好。但這是錯誤的問題,因為其中只有一個是你可以建構於其上的產品。MAI-Image-2.6 Preview 是在文生圖排行榜上排名較高的模型,但 MAI-Image-2.5-Pro 才是擁有公開 API、已公布的價格表,以及在獨立排行榜上排名第一的圖像編輯器。Microsoft 在一個月內相繼推出了這兩者,而這組配對之所以令人困惑,是因為兩者位於同一產品管線的不同階段——一個是今天即可部署的產品,另一個是該系列下一代產品的排名預覽。
一句話版本
如果您現在需要在生產環境中使用 Microsoft 影像模型,唯一的選擇是 MAI-Image-2.5-Pro——公開預覽、按 token 計費、在獨立影像編輯排行榜上名列第一。如果您正在決定下一季度要建置的目標,MAI-Image-2.6 Preview 是發展方向:它在純文字轉影像方面勝過其姊妹版,但需要邀請、尚未定價,也還不是可呼叫的 API。一個是部署,另一個是訊號。
兩次發佈,相隔一個月
Microsoft 於 2026 年 7 月 23 日宣佈推出 MAI-Image-2.5-Pro,同時推出 MAI-Voice-2-Flash,並在 Azure AI Foundry 上將其開放公開預覽,涵蓋全球七個區域,外加免費的 MAI Playground。它是自家 MAI-Image-2.5 系列中的高階品質等級——該系列已為 Bing Image Creator、PowerPoint 與 OneDrive 提供支援——並承襲該系列最高保真度的定位:主視覺影像、精細編輯,以及精確的圖像內文字。
MAI-Image-2.6 Preview 是下一步。這個版本大約在 8 月 10 日出現在 Arena 的文字轉影像排行榜上,而微軟於 8 月 19 日在 MAI Playground 和 Microsoft Foundry 上確認了它的私人預覽。因此,在四週內,該公司先是推出了其高階版本,接著又預覽了後續版本——這個節奏對這次比較的重要性,勝過任何單一數字。
兩個董事會意見不合,這就是事情的全部。
造成混淆的部分原因是,這兩個模型各自在不同的排行榜上領先,且兩者都沒有登上同一個排行榜的榜首。
• MAI-Image-2.5-Pro — 在 Artificial Analysis Image Editing Arena 排名第一,分數為 Elo 1,272 (約 6,100 次盲選投票),領先 Reve 2.1 的 1,262 分,以及同為 1,256 分的 MAI-Image-2.5 與 GPT Image 2 (high)。在 Artificial Analysis 的 Text-to-Image 排行榜上,它的表現較為遜色,位居第 7 名,分數為 Elo 1,292。
• MAI-Image-2.6 Preview — 在 Arena 的文生圖排行榜上名列第 2,獲得 Elo 1,336(約 3,500 票),僅次於 GPT Image 2 Medium 的 1,381,領先 Grok Imagine Image 2.0 的 1,316。Arena 的圖像編輯排行榜將同一預覽版本列為第 3 名,得分 1,420 分,從第 5 名上升。
這些排行榜彼此不同——Artificial Analysis 與 Arena——因此數字之間無法直接相互比較,而且這裡的每個數字都是基於少量投票的初步結果。但若從趨勢方向來解讀,整體情況是一致的:MAI-Image-2.6 Preview 是更好的生成器,能從空白提示詞生成圖像;而 MAI-Image-2.5-Pro 是更好的編輯器,能編輯現有圖像。微軟尚未推出任何一款能同時稱霸兩者的單一模型,而目前的兩位領先者各自選擇了這項工作的不同半邊。


你今天實際可以撥打的電話
這就是比較不再只是學術層面的地方。
• MAI-Image-2.5-Pro — 可部署。在 Azure AI Foundry 的七個區域提供公開預覽,在 MAI Playground 上免費,按 token 計量並提供定價表。您今天就可以註冊、傳送圖片和指令,並立即取得結果。
• MAI-Image-2.6 Preview — 邀請制。私人預覽版代表存取權是授予的,而非購買的;沒有定價表,也沒有按 token 計費的端點。Arena 版本可免費投票,但不是可從程式碼呼叫的服務。
如果您的需求是即時 API,那麼決定已經為您做好了。MAI-Image-2.6 Preview 是等待的理由,而不是採用的東西。
Pro 方案費率表及其包含內容
MAI-Image-2.5-Pro 在 Foundry 上按 token 計費:每百萬個文字輸入 token 5 美元,每百萬個圖片輸入 token 8 美元,每百萬個圖片輸出 token 106 美元。Microsoft 並未公布每張圖片的 token 數,因此每張圖片的成本是算術推估而非官方報價;根據 Artificial Analysis 的換算,一張 1024×1024 圖片約落在每 1,000 張圖片 108.50 美元。這大約是同系列 MAI-Image-2.5(約每千張 48 美元)的 2.3 倍,也是 MAI-Image-2.5-Flash(約每千張 20 美元)的 5.4 倍——Pro 等級是為了編輯之冠而刻意設定的高價。
Pro 層級的官方規格表:最多 32,000 個文字輸入 token、131k 上下文視窗、4,096 個輸出 token、JPEG/PNG 圖片輸入,輸出上限為 1,048,576 像素(等同 1024×1024)。最後這個數字值得注意,因為 Microsoft 的行銷宣傳主打「8K」層級;在 API 上,實際上限約為一百萬像素。對生產環境的買家而言,工作解析度約為 1K,而非印刷解析度。

MAI-Image-2.6 Preview 尚無價目表。其可能成本的參考依據是該產品系列現有的價格區間——輸入 $1.75 至 $5,輸出 $19.50 至 $106,涵蓋 Flash、2.5 和 Pro——因此 2.6 的正式價格將取決於它落入哪個級別,且無論如何,預覽版定價都不等同於 GA 定價。
MAI-Image-2.6 預覽版正式推出時會新增哪些功能
微軟自己對 2.6 升級的描述,全部都是廠商回報的,而且目前還沒有任何一個被獨立重現:
• 更強的文字渲染 — 更長的句子、複雜的版面,以及相較於 2.5 最大的 Elo 提升(根據 Arena 公布的細項,在 Arena 的文字渲染類別中 +91)br />• 更自然的人像 — 臉部細節、光線、皮膚質感br />• 更好的 3D 影像與建模,以及更扎實的指令遵循 — 更貼近提示詞中的具體要求br />• 單次生成支援多張參考影像,並讓使用者對推理、格式與解析度擁有更多控制
注意這份清單沒有包含什麼:完全沒有提到要在編輯能力上超越 Pro 等級。微軟將 2.6 描述為更好的通才,而非比自家高階版本更優秀的編輯者。這就是為什麼這兩個模型可以並存於產品線中——編輯專家和快速進步的通才是不同的產品。
排序就是策略。
Microsoft 以六到八週的週期推出影像改進功能,而 Pro 版與預覽版的搭配,正是外界所看到的這種節奏。整個產品家族的模式一直很一致:一個模型進入預覽,一旦被認為適合正式生產環境,就會推送到 Bing Image Creator 和 Office 介面,然後下一個模型開始其預覽週期。MAI-Image-2.5 已經承擔了 Bing Image Creator 100% 的影像生成工作,也是 PowerPoint 和 OneDrive 中的引擎;Pro 層級則是同一個系列,但專注於更高保真度的工作。MAI-Image-2.6 Preview 正是這個管線接下來要邁向的方向。
務實的判斷是:如果你正基於這個系列進行開發,現在就採用 MAI-Image-2.5-Pro 來承擔編輯工作負載,並預期 MAI-Image-2.6(或 Pro 的後繼版本)會在一季內於相同的介面上推出。獨立排行榜為 Pro 等級提供了一項站得住腳的宣稱——在盲投票板中評價最高的影像編輯器——這是任何廠商發表都無法炮製的。
路由層適合的位置——最終
目前這兩款模型都還無法透過第三方 API 呼叫,因此在 OrcaRouter 上也還都無法使用——一份誠實的比較就應該直說這一點。當 MAI-Image-2.5-Pro(或之後的 MAI-Image-2.6 Preview)開始由可呼叫的託管供應商提供時,直通計費的經濟模式便適用:OrcaRouter 在供應商牌價之上收取 0% 加成,所以你支付的就是微軟的費率表價格,而上市折扣或降價也會在宣布當天就反映在你的帳單上——無需重新協商,也不需要第二份合約。路由層存在的另一半理由是故障轉移:一個全新的預覽模型,在排行榜上得票數還很低,正是你應該把一部分流量導向它的對象,同時保留一個經過驗證的模型作為備援,而不是把生產環境路徑押在一個未定價的預覽版上。
誰應該行動,誰應該等待
如果您的工作負載是變更現有圖片——定點編輯、圖內文字、產品主視覺——請立即部署 MAI-Image-2.5-Pro,因為它是兩者中唯一具備 API 的版本,且其編輯排名第一,就是它能勝任工作的獨立證據。如果您是從空白提示詞生成圖片,且唯一考量是品質,則請等待 MAI-Image-2.6 Preview:預覽版本在文字轉圖片方面已勝過其兄弟版本,且日後的 Foundry 價格很可能會低於 Pro 等級。如果您正在選擇要標準化的系列,請將 2.6 Preview 視為 Microsoft 影像產品線未來方向的訊號——而非現在即可使用的模型。
