MAI-Image-2.6 的 Hero 標題卡片,這是 Microsoft 在 Arena 上排名第 2 的文字轉圖像模型,顯示 Arena 分數 1,336、排名第 2,以及相較於 MAI-Image-2.5 的 +79 Elo 增幅。
Guides & Insights

MAI-Image-2.6:微軟排名第 2 的新影像模型在 API 上線前於 Arena 登場

作者

Jim Song

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

微軟的MAI-Image-2.6剛成為 Arena 排行榜上評分第二高的文字轉圖像模型——儘管它仍然沒有公開 API。該模型於 2026 年 8 月 10 日發布,以 1,336 分的 Arena 成績位居第二,僅次於 GPT Image 2 Medium(1,381 分),領先 Grok Imagine Image 2.0(1,316 分)、Meta 的 Muse Image 和 Nano Banana Pro。其前代產品MAI-Image-2.5排名第十。

引人注目的部分是脈絡,而不只是排名。那個衝上第2名的條目,名稱就叫「mai-image-2.6-preview」,在該快照中獲得約3,500票。它一次爬升了8個名次,相較於MAI-Image-2.5一口氣獲得了+79的Elo分數,而微軟也承諾「很快」開放API和Foundry存取,早期報導指向下週。這使得這成為迄今最強烈的獨立訊號,顯示微軟內部影像研發已縮小與OpenAI的差距——而你們大多數人仍然無法透過API呼叫它。

關鍵數字

Arena 文生圖排名:第 2 名 — 分數 1,336±11,初步結果,約 3,488 票

與第1名(GPT Image 2 Medium)的差距: 45 Elo

領先第三名 (Grok Imagine Image 2.0): 20 Elo

超越 MAI-Image-2.5: 整體 +79 Elo,文字渲染 +91 Elo

前身的位置: MAI-Image-2.5 位居第 10 名(1,256)

供應情況: Arena 現已推出;MAI Playground 本週稍後推出;APIs/Foundry 預計下週推出

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

MAI-Image-2.6 是什麼

MAI-Image-2.6 是微軟內部影像生成系列的最新模型,由 Mustafa Suleyman 領導的 Microsoft AI 所打造。該系列進展迅速:MAI-Image-1 是基礎,MAI-Image-2(2026 年 3 月)實現了照片級真實感與文字渲染的躍進,MAI-Image-2.5(2026 年 6 月)加入了專業級輸出與編輯功能,並成為 Bing Image Creator、PowerPoint 和 OneDrive 背後的引擎,MAI-Image-2.5-Pro(2026 年 7 月)新增了 8K 高階方案,而 2.6 現在於其前代推出約六週後問世。

節奏與模型本身同等重要。Microsoft 正以六到八週的週期推出影像改進,這種步調比影像市場過往的演進方式,更接近前沿實驗室發布文字模型的頻率。當這種節奏持續累積,便表現為在 Arena 首次登場即拿下第二名。

請仔細閱讀 Arena 的結果

Arena(更名後的 LMArena)以人類盲測偏好為影像模型排名:投票者看到由相同提示詞生成的兩張圖片,然後選出較強者。這使其成為衡量人們實際偏好的獨立指標,而非廠商主導的基準測試——這就是為什麼第二名首次登場便具有實質分量。這也是為什麼這個數字需要附帶說明:1,336 的分數是初步數據,基於約 3,500 票,而第一名模型則有超過 70,000 票,且該條目被標記為「預覽版」。早期投票的 Elo 分數會波動;請將方向視為可靠,確切分數則僅供參考。

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

進步集中的領域比頭條數字更有意思。Arena 將 MAI-Image-2.6 在 3D 影像與建模方面排名第一(從第六名上升),並在卡通/動畫/奇幻(從第八名上升)、產品與品牌及商業設計(從第七名上升)、文字渲染(從第八名上升,Elo 增加 +91)、以及藝術(從第四名上升)方面排名第二。微軟表示它在每個評測類別中都有所提升。這種涵蓋商業設計、3D、文字和藝術的廣泛分佈,是通用影像模型的標誌,而非只會一招的專門模型。

實際上有什麼新功能(廠商回報)

在能力方面,微軟自己對 MAI-Image-2.6 的描述是:

• 更強的文字渲染、人像與 3D 影像

• 更精緻的商業與擬真輸出,涵蓋產品、品牌與電影級應用場景

• 在單次生成中同時使用多張參考圖像

• 更豐富的基礎 — 更好地遵循提示中的具體內容

• 對推理、格式和解析度有更強的控制力

這些全都是廠商自行回報的結果,尚未經過獨立重現。目前唯一獨立的證據是 Arena 排名的躍升——這確實是獨立的,但仍屬初步。在 API 開放、第三方能夠執行受控評估之前,應把這份能力清單視為微軟的宣稱,而以排行榜作為目前可用的參考訊號。

當你真正能使用它的時候

该模型今天已上线供测试,但仅限于Arena。微软表示,{{1}}MAI Playground将于本周晚些时候获得该模型,而API访问以及Microsoft Foundry“即将推出”{{/1}}——早期报道指出将在下周推出。{{2}}实际可观察的信号是:当MAI-Image-2.5成为Bing Image Creator的默认选项,并整合到PowerPoint和OneDrive中时,意味着微软认为它已具备生产环境安全条件。{{/2}}{{3}}类似地,2.6版本若在这些界面中推出,将是预览标签即将移除的信号。{{/3}}

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

可能的費用

2.6 的定價尚未公布。錨點是系列中的其他產品,全部由廠商回報:

• MAI-Image-2.5:每百萬文字輸入Token $5,圖片輸入 $8,圖片輸出 $47

• MAI-Image-2.5-Flash:$1.75 / $1.75 / $19.50 — 高用量方案

• MAI-Image-2.5-Pro(2026年7月):$5 / $8 / $106 — 8K 輸出,96.8% 文字渲染準確度

微軟已販售的影像輸出費率中,最便宜與最貴之間相差五倍,因此 2.6 的生產成本將取決於它落在哪個級距。以 2.5 每百萬輸出 token 47 美元的費率來算,一張消耗約一千個輸出 token 的影像,成本將近五美分——但微軟並未公布每張影像的 token 數,所以請把這個數字視為推算,而非正式報價。

定價也是路由層在 API 開放後證明自身價值的所在。在 OrcaRouter 上,無論微軟收取多少費用,都會以 0% 加價率直接轉嫁——就是供應商列表價,不加任何費用——因此發佈折扣或後續降價,會在宣佈當天就反映在你的帳單上。無需重新協商,也無需第二份合約;該模型會與其他一切項目一起出現在同一個金鑰上。

這讓圖像模型之爭何去何從

目前 Arena 文字轉圖片排行榜的頂端:GPT Image 2 (Medium) 以 1,381 居首,MAI-Image-2.6 為 1,336,Grok Imagine Image 2.0 為 1,316,Reve 2.1 為 1,302,Meta 的 Muse Image 為 1,282。前五名模型的 Elo 差距僅約 100 分。過去用來拉開領先者與其他模型差距的品質鴻溝,如今已壓縮到「最佳影像模型」不再是個有用的問題——編輯、grounding、速度與價格才是。

微軟的賭注比任何單一排行榜冠軍都更廣泛:一套涵蓋影像、語音、程式碼與推理的內部模型組合,透過 Copilot、Bing 和 Office 分發。Arena 排名是工作量證明;分發才是真正的產品。

如何在不冒生產環境風險的情況下試用它

Arena 預覽版是免費的——如果你想要原始訊號,今天就開始用它來生成吧。一旦 API 開放,要採用一個帶有「初步」評分的全新模型,明智的做法是將一部分流量導向它,並保留你經過驗證的模型作為備援。這正是路由層設計要處理的故障模式:在 OrcaRouter 上,一旦 MAI-Image-2.6 由上游供應商代管,你就會將一個端點指向它,並讓自動容錯移轉捕捉 3,000 票排行榜評分無法看到的邊緣情況。一個 API 金鑰,200 多種模型,供應商價格直接轉嫁。

接下來要看什麼

• MAI-Image-2.6 是否會出現在圖像編輯排行榜上 — MAI-Image-2.5 已經是相當優秀的編輯器,而 2.6 的編輯成績尚未公布

• API 的價格以及它落在哪個層級

• Bing Image Creator 和 Copilot 是否將其預設值從 2.5 切換為 2.6

• 待API開放後進行獨立基準測試

• 「預覽」標籤是否會移除——這是微軟對產品已有足夠信心、足以正式銷售的信號

常見問題

MAI-Image-2.6 何時可透過 API 使用?

還沒有。它現在以預覽版的形式出現在 Arena 上;微軟表示 API 和 Foundry 的存取權限「即將推出」,早期報導指出是下週。目前尚未公布確切的日期或價格。

它與 GPT Image 2 Medium 有多接近?

目前 Arena 快照上的 45 Elo — 這個差距夠小,使第 2 名 / 第 1 名的差異落在投票流量所能影響的範圍內,而前五名模型之間的 Elo 差距都在約 100 以內。

No. 2 Arena 的排名可靠嗎?

這是一項獨立、盲測的人類偏好結果,這正是它有意義的原因——但它是初步的(約3,500票),並且附屬於預覽版本。相信方向,而不是小數點。

結論:MAI-Image-2.6 是微軟第一款真正躋身頂尖行列的影像模型,而且它比 API 更早登場。如果定價落在接近 Flash 等級的位置,它將成為今年影像生成領域最值得關注的價值選擇之一。API 越快開放越好——一旦開放,價格與編輯評分會告訴你,這第二名究竟是初次登場,還是已達高原期。

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

聯絡我們

加入我們的社區

DiscordEmailXGitHubYouTube