
MAI-Image-2.6:微軟排名第 2 的新影像模型在 API 上線前於 Arena 登場
- meta新Meta: Muse Spark 1.22026-08-0557智能72程式
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
- grokxAI: Grok 4.52026-07-0856智能72程式
- tencentTencent: Hy32026-07-0642智能59程式
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42程式
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39程式
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72程式
- klingKling: Kling 3.0 Turbo2026-06-1757智能52程式57數學
微軟的MAI-Image-2.6剛成為 Arena 排行榜上評分第二高的文字轉圖像模型——儘管它仍然沒有公開 API。該模型於 2026 年 8 月 10 日發布,以 1,336 分的 Arena 成績位居第二,僅次於 GPT Image 2 Medium(1,381 分),領先 Grok Imagine Image 2.0(1,316 分)、Meta 的 Muse Image 和 Nano Banana Pro。其前代產品MAI-Image-2.5排名第十。
引人注目的部分是脈絡,而不只是排名。那個衝上第2名的條目,名稱就叫「mai-image-2.6-preview」,在該快照中獲得約3,500票。它一次爬升了8個名次,相較於MAI-Image-2.5一口氣獲得了+79的Elo分數,而微軟也承諾「很快」開放API和Foundry存取,早期報導指向下週。這使得這成為迄今最強烈的獨立訊號,顯示微軟內部影像研發已縮小與OpenAI的差距——而你們大多數人仍然無法透過API呼叫它。
關鍵數字
• Arena 文生圖排名:第 2 名 — 分數 1,336±11,初步結果,約 3,488 票
• 與第1名(GPT Image 2 Medium)的差距: 45 Elo
• 領先第三名 (Grok Imagine Image 2.0): 20 Elo
• 超越 MAI-Image-2.5: 整體 +79 Elo,文字渲染 +91 Elo
• 前身的位置: MAI-Image-2.5 位居第 10 名(1,256)
• 供應情況: Arena 現已推出;MAI Playground 本週稍後推出;APIs/Foundry 預計下週推出

MAI-Image-2.6 是什麼
MAI-Image-2.6 是微軟內部影像生成系列的最新模型,由 Mustafa Suleyman 領導的 Microsoft AI 所打造。該系列進展迅速:MAI-Image-1 是基礎,MAI-Image-2(2026 年 3 月)實現了照片級真實感與文字渲染的躍進,MAI-Image-2.5(2026 年 6 月)加入了專業級輸出與編輯功能,並成為 Bing Image Creator、PowerPoint 和 OneDrive 背後的引擎,MAI-Image-2.5-Pro(2026 年 7 月)新增了 8K 高階方案,而 2.6 現在於其前代推出約六週後問世。
節奏與模型本身同等重要。Microsoft 正以六到八週的週期推出影像改進,這種步調比影像市場過往的演進方式,更接近前沿實驗室發布文字模型的頻率。當這種節奏持續累積,便表現為在 Arena 首次登場即拿下第二名。
請仔細閱讀 Arena 的結果
Arena(更名後的 LMArena)以人類盲測偏好為影像模型排名:投票者看到由相同提示詞生成的兩張圖片,然後選出較強者。這使其成為衡量人們實際偏好的獨立指標,而非廠商主導的基準測試——這就是為什麼第二名首次登場便具有實質分量。這也是為什麼這個數字需要附帶說明:1,336 的分數是初步數據,基於約 3,500 票,而第一名模型則有超過 70,000 票,且該條目被標記為「預覽版」。早期投票的 Elo 分數會波動;請將方向視為可靠,確切分數則僅供參考。

進步集中的領域比頭條數字更有意思。Arena 將 MAI-Image-2.6 在 3D 影像與建模方面排名第一(從第六名上升),並在卡通/動畫/奇幻(從第八名上升)、產品與品牌及商業設計(從第七名上升)、文字渲染(從第八名上升,Elo 增加 +91)、以及藝術(從第四名上升)方面排名第二。微軟表示它在每個評測類別中都有所提升。這種涵蓋商業設計、3D、文字和藝術的廣泛分佈,是通用影像模型的標誌,而非只會一招的專門模型。
實際上有什麼新功能(廠商回報)
在能力方面,微軟自己對 MAI-Image-2.6 的描述是:
• 更強的文字渲染、人像與 3D 影像
• 更精緻的商業與擬真輸出,涵蓋產品、品牌與電影級應用場景
• 在單次生成中同時使用多張參考圖像
• 更豐富的基礎 — 更好地遵循提示中的具體內容
• 對推理、格式和解析度有更強的控制力
這些全都是廠商自行回報的結果,尚未經過獨立重現。目前唯一獨立的證據是 Arena 排名的躍升——這確實是獨立的,但仍屬初步。在 API 開放、第三方能夠執行受控評估之前,應把這份能力清單視為微軟的宣稱,而以排行榜作為目前可用的參考訊號。
當你真正能使用它的時候
该模型今天已上线供测试,但仅限于Arena。微软表示,{{1}}MAI Playground将于本周晚些时候获得该模型,而API访问以及Microsoft Foundry“即将推出”{{/1}}——早期报道指出将在下周推出。{{2}}实际可观察的信号是:当MAI-Image-2.5成为Bing Image Creator的默认选项,并整合到PowerPoint和OneDrive中时,意味着微软认为它已具备生产环境安全条件。{{/2}}{{3}}类似地,2.6版本若在这些界面中推出,将是预览标签即将移除的信号。{{/3}}

可能的費用
2.6 的定價尚未公布。錨點是系列中的其他產品,全部由廠商回報:
• MAI-Image-2.5:每百萬文字輸入Token $5,圖片輸入 $8,圖片輸出 $47
• MAI-Image-2.5-Flash:$1.75 / $1.75 / $19.50 — 高用量方案
• MAI-Image-2.5-Pro(2026年7月):$5 / $8 / $106 — 8K 輸出,96.8% 文字渲染準確度
微軟已販售的影像輸出費率中,最便宜與最貴之間相差五倍,因此 2.6 的生產成本將取決於它落在哪個級距。以 2.5 每百萬輸出 token 47 美元的費率來算,一張消耗約一千個輸出 token 的影像,成本將近五美分——但微軟並未公布每張影像的 token 數,所以請把這個數字視為推算,而非正式報價。
定價也是路由層在 API 開放後證明自身價值的所在。在 OrcaRouter 上,無論微軟收取多少費用,都會以 0% 加價率直接轉嫁——就是供應商列表價,不加任何費用——因此發佈折扣或後續降價,會在宣佈當天就反映在你的帳單上。無需重新協商,也無需第二份合約;該模型會與其他一切項目一起出現在同一個金鑰上。
這讓圖像模型之爭何去何從
目前 Arena 文字轉圖片排行榜的頂端:GPT Image 2 (Medium) 以 1,381 居首,MAI-Image-2.6 為 1,336,Grok Imagine Image 2.0 為 1,316,Reve 2.1 為 1,302,Meta 的 Muse Image 為 1,282。前五名模型的 Elo 差距僅約 100 分。過去用來拉開領先者與其他模型差距的品質鴻溝,如今已壓縮到「最佳影像模型」不再是個有用的問題——編輯、grounding、速度與價格才是。
微軟的賭注比任何單一排行榜冠軍都更廣泛:一套涵蓋影像、語音、程式碼與推理的內部模型組合,透過 Copilot、Bing 和 Office 分發。Arena 排名是工作量證明;分發才是真正的產品。
如何在不冒生產環境風險的情況下試用它
Arena 預覽版是免費的——如果你想要原始訊號,今天就開始用它來生成吧。一旦 API 開放,要採用一個帶有「初步」評分的全新模型,明智的做法是將一部分流量導向它,並保留你經過驗證的模型作為備援。這正是路由層設計要處理的故障模式:在 OrcaRouter 上,一旦 MAI-Image-2.6 由上游供應商代管,你就會將一個端點指向它,並讓自動容錯移轉捕捉 3,000 票排行榜評分無法看到的邊緣情況。一個 API 金鑰,200 多種模型,供應商價格直接轉嫁。
接下來要看什麼
• MAI-Image-2.6 是否會出現在圖像編輯排行榜上 — MAI-Image-2.5 已經是相當優秀的編輯器,而 2.6 的編輯成績尚未公布
• API 的價格以及它落在哪個層級
• Bing Image Creator 和 Copilot 是否將其預設值從 2.5 切換為 2.6
• 待API開放後進行獨立基準測試
• 「預覽」標籤是否會移除——這是微軟對產品已有足夠信心、足以正式銷售的信號
常見問題
MAI-Image-2.6 何時可透過 API 使用?
還沒有。它現在以預覽版的形式出現在 Arena 上;微軟表示 API 和 Foundry 的存取權限「即將推出」,早期報導指出是下週。目前尚未公布確切的日期或價格。
它與 GPT Image 2 Medium 有多接近?
目前 Arena 快照上的 45 Elo — 這個差距夠小,使第 2 名 / 第 1 名的差異落在投票流量所能影響的範圍內,而前五名模型之間的 Elo 差距都在約 100 以內。
No. 2 Arena 的排名可靠嗎?
這是一項獨立、盲測的人類偏好結果,這正是它有意義的原因——但它是初步的(約3,500票),並且附屬於預覽版本。相信方向,而不是小數點。
結論:MAI-Image-2.6 是微軟第一款真正躋身頂尖行列的影像模型,而且它比 API 更早登場。如果定價落在接近 Flash 等級的位置,它將成為今年影像生成領域最值得關注的價值選擇之一。API 越快開放越好——一旦開放,價格與編輯評分會告訴你,這第二名究竟是初次登場,還是已達高原期。
