MAI-Image-2.6 的 Hero 標題卡片,這是 Microsoft 在 Arena 上排名第 2 的文字轉圖像模型,顯示 Arena 分數 1,336、排名第 2,以及相較於 MAI-Image-2.5 的 +79 Elo 增幅。
Guides & Insights

MAI-Image-2.6-Preview:圖像編輯 #1,文字轉圖像 #2

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

微軟的 MAI-Image-2.6-Preview 不再只是 Arena 排行榜上一個你碰不到的條目——它現在已是獨立的排行榜冠軍。8月25日,獨立評測機構 Artificial Analysis 將同一預覽版本在其圖像編輯排行榜上列為第1名,並在文生圖(Text to Image)中列為第2名。這個編輯類別的第1名讓它超越了微軟自家的 MAI-Image-2.5-Pro(先前榜首)、Reve 2.1 以及 OpenAI 的 GPT Image 2,使微軟在該排行榜上佔據前兩名。根據微軟的公告,該模型於8月19日在 MAI Playground 和 Microsoft Foundry 上進入私人預覽——需邀請才能使用,仍無公開 API,也仍無定價表。

引人注目的不只是排名,而是發展軌跡。在 Arena 文生圖榜上名列第 2 的條目,名稱就叫 "mai-image-2.6-preview",在該次快照中獲得約 3,500 票,並且一次爬升八個名次,Elo 較 MAI-Image-2.5 提升了 79。此後輪廓迅速清晰:8 月 19 日,MAI Playground 與 Microsoft Foundry 開放私人預覽權限;Arena 的圖像編輯榜將該版本推進到第 3 名;如今 Artificial Analysis 將其列為圖像編輯第 1 名、文生圖第 2 名。這是迄今為止最有力的獨立訊號,顯示微軟內部圖像專案已拉近與 OpenAI 的差距——而公開 API 至今仍未全面開放。

關鍵數字

• Arena 文生圖排名:第 2 名 — 分數 1,336±11,初步結果,約 3,488 票

• 與第1名(GPT Image 2 Medium)的差距: 45 Elo

• 領先第三名 (Grok Imagine Image 2.0): 20 Elo

• 超越 MAI-Image-2.5: 整體 +79 Elo,文字渲染 +91 Elo

• 前身的位置: MAI-Image-2.5 位居第 10 名(1,256)

• 影像編輯排名:在 Arena 的「Single Image Edit」中名列第 3 — 1,420 分,自第 5 名上升

• Artificial Analysis 影像編輯排名:第一名——領先 MAI-Image-2.5-Pro(先前的第一名)、Reve 2.1 和 GPT Image 2;微軟佔據前兩名

• Artificial Analysis 文生圖排名:第 2 名 — 僅次於 GPT Image 2;在 19 個類別排行榜中,有 5 個位居第一

• 私人預覽:於 8 月 19 日在 MAI Playground 和 Microsoft Foundry 上宣佈 — 據廠商所述,採邀請制,尚無定價資訊

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

MAI-Image-2.6 是什麼

MAI-Image-2.6 是微軟內部影像生成系列的最新模型,由 Mustafa Suleyman 領導的 Microsoft AI 所打造。該系列進展迅速:MAI-Image-1 是基礎,MAI-Image-2(2026 年 3 月)實現了照片級真實感與文字渲染的躍進,MAI-Image-2.5(2026 年 6 月)加入了專業級輸出與編輯功能,並成為 Bing Image Creator、PowerPoint 和 OneDrive 背後的引擎,MAI-Image-2.5-Pro(2026 年 7 月)新增了 8K 高階方案,而 2.6 現在於其前代推出約六週後問世。

節奏與模型本身同等重要。微軟以六到八週的週期推出影像改進,這比影像市場歷史上的步調,更接近前沿實驗室推出文字模型的方式。在Arena以第2名之姿登場,一週後在編輯排名升至第3名,這就是這種節奏複利累積的成果。

排行榜結果,請仔細閱讀

競技場(更名後的 LMArena)透過盲測人類偏好來為影像模型排名:投票者會看到由相同提示詞產生的兩張圖片,然後選出較好的一張。Artificial Analysis 則以自家 Elo 評分系統,運行同類型的獨立盲測偏好競技場。兩者都是獨立衡量人們實際偏好,而非廠商自辦的基準測試——這就是為什麼排名第二的首秀具有真實分量,也是為什麼兩個獨立榜單對同一模型看法一致,比任何單一數字更有意義。這也正是這些數字需要附帶條件的原因:Arena 的 1,336 分只是初步分數,約 3,500 票的基礎,對比第一名模型的超過 70,000 票,而且該條目標註為「預覽版」。早期投票的 Elo 會變動;請把趨勢方向視為可靠,而確切分數則視為暫時性。

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

進步集中的領域比頭條數字更有意思。Arena 將 MAI-Image-2.6 在 3D 影像與建模方面排名第一(從第六名上升),並在卡通/動畫/奇幻(從第八名上升)、產品與品牌及商業設計(從第七名上升)、文字渲染(從第八名上升,Elo 增加 +91)、以及藝術(從第四名上升)方面排名第二。微軟表示它在每個評測類別中都有所提升。這種涵蓋商業設計、3D、文字和藝術的廣泛分佈,是通用影像模型的標誌,而非只會一招的專門模型。

接著又出現了兩個數據點。Arena 的圖像編輯排行榜——「單圖編輯」類別——將同一個 mai-image-2.6-preview 版本列為第 3 名,獲得 1,420 分,從第 5 名升至第 3 名,並領先 MAI-Image-2.5 達 19 分,其中文字渲染是最大單項漲幅(+43 分)。8 月 25 日,Artificial Analysis 更進一步:其 Image Editing Leaderboard 將預覽版列為第 1 名,從微軟自家的 MAI-Image-2.5-Pro(先前以 1,272 Elo 位居第 1)手中奪下榜首,並領先 Reve 2.1 和 OpenAI 的 GPT Image 2——微軟目前占據該排行榜的前兩名。微軟 AI 主管 Mustafa Suleyman 稱 2.6 是「AA 上最棒的圖像編輯模型」,並表示微軟占據前五名中的三個位置——這是廠商的說法;底層排名其實是 Artificial Analysis 自己的。AA 本身並未公布預覽版的編輯評分,而且兩個排行榜都還處於早期階段、投票數偏低,因此請把趨勢方向視為可靠,確切數字則視為暫時性。

實際上有什麼新功能(廠商回報)

在能力方面,微軟自己對 MAI-Image-2.6 的描述是:

• 更強的文字渲染、人像與 3D 影像

• 更精緻的商業與擬真輸出,涵蓋產品、品牌與電影級應用場景

• 在單次生成中同時使用多張參考圖像

• 更豐富的基礎 — 更好地遵循提示中的具體內容

• 對推理、格式和解析度有更強的控制力

這些全部都來自廠商自行回報,尚未經獨立重現驗證。獨立的證據是那兩組排行榜:在 Arena 和 Artificial Analysis 的文字生成圖片項目皆排名第 2、在 Arena 的編輯排行榜排名第 3、在 Artificial Analysis 的編輯排行榜排名第 1——但全都是初步結果。在 MAI-Image-2.6 廣泛開放、第三方能執行受控評測之前,請把能力清單視為 Microsoft 的說法,並以那兩個排行榜作為現階段可參考的訊號。

當你真正能使用它的時候

本週,MAI-Image-2.6 從「僅限 Arena」變成「Arena 加上官方預覽」。8 月 19 日,微軟宣布該模型已在 MAI Playground 和 Microsoft Foundry 上提供私人預覽。這是廠商自己的說法,而且預覽存取是邀請制,而非公開註冊——因此目前仍沒有價格表,也沒有按 token 計費的 API。值得觀察的實務訊號是:當 MAI-Image-2.5 成為 Bing Image Creator 的預設模型,並推展到 PowerPoint 和 OneDrive 時,代表微軟認為它已可安全用於生產環境。若 2.6 也類似地推展到這些介面——或「預覽」標籤被移除——那就是它已準備好承擔生產工作負載的訊號。

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

可能的費用

2.6 尚未公布任何定價——私人預覽版沒有費率表。定價基準是產品家族中的其他成員,全部由供應商報告:

• MAI-Image-2.5:每百萬文字輸入Token $5,圖片輸入 $8,圖片輸出 $47

• MAI-Image-2.5-Flash:$1.75 / $1.75 / $19.50 — 高用量方案

• MAI-Image-2.5-Pro(2026年7月):$5 / $8 / $106 — 8K 輸出,96.8% 文字渲染準確度

微軟已販售的影像輸出費率中,最便宜與最貴之間相差五倍,因此 2.6 的生產成本將取決於它落在哪個級距。以 2.5 每百萬輸出 token 47 美元的費率來算,一張消耗約一千個輸出 token 的影像,成本將近五美分——但微軟並未公布每張影像的 token 數,所以請把這個數字視為推算,而非正式報價。

當模型進入公開 API 階段時,定價也是路由層證明其價值的地方。在 OrcaRouter 上,微軟收取的任何費用都會以 0% 加成直接轉嫁——也就是供應商的定價,不加任何費用——因此發布折扣或日後的降價,會在宣布當天就反映在你的帳單上。無需重新協商,也無需第二份合約;該模型會與其他所有模型一起出現在同一個 API 金鑰上。

這讓圖像模型之爭何去何從

目前 Arena 文生圖排行榜的頂端:GPT Image 2 (Medium) 以 1,381 分居首、MAI-Image-2.6 以 1,336 分居次、Grok Imagine Image 2.0 以 1,316 分排第三、Reve 2.1 以 1,302 分排第四、Meta 的 Muse Image 則以 1,282 分排第五。前五名的 Elo 差距約僅 100 分。Artificial Analysis 得出相同的整體結論——文生圖排名第 2,僅次於 GPT Image 2——並補充了類別細節:預覽版本在其 19 個文生圖類別中拿下 5 個第一(Material、Knowledge、Frontier、Retail & Ecommerce 與 Marketing & Advertising),而其餘所有類別均由 GPT Image 2 領先。兩個獨立且以偏好為基礎的排行榜指向同一方向,是對這個如此年輕的模型所能獲得的最強訊號。過去將領先者與其他對手拉開差距的品質鴻溝,如今已壓縮到「最佳影像模型」不再是個有用問題的地步——編輯、接地性、速度與價格才是重點。

微軟的賭注比任何單一的排行榜桂冠都更為宏大:一套涵蓋影像、語音、程式碼與推理的內部模型堆疊,透過 Copilot、Bing 和 Office 進行分發。Arena 的排名是工作量證明;分發管道才是真正的產品。

如何在不冒生產環境風險的情況下試用它

Arena 預覽版是免費的——如果你想要第一手訊號,今天就針對它生成內容。如果你有私人預覽存取權限,MAI Playground 和 Microsoft Foundry 入口可讓你在正式採用前執行真實工作負載。對於其他人來說,採用一款帶有「初步」評分的新模型,明智的做法是將一部分流量導向它,並保留你已驗證的模型作為備援。這正是路由層要處理的故障模式:在 OrcaRouter 上,一旦 MAI-Image-2.6 在上游供應商上架,你就可以將一個端點指向它,讓自動故障切換捕捉低投票數排行榜評分無法察覺的邊緣情況。一個 API 金鑰,200+ 模型,供應商價格直接轉嫁。

接下來要看什麼

• 隨著票數累積,Artificial Analysis 的編輯排名第 1 名與 Arena 第 3 名是否還能維持——這兩個榜單都還很初期、票數偏低。

• 公開 API 的價格以及它屬於哪個方案等級——私人預覽版仍無定價表

• Bing Image Creator 和 Copilot 是否將其預設值從 2.5 切換為 2.6

• 待API開放後進行獨立基準測試

• 「預覽」標籤是否會移除——這是微軟對產品已有足夠信心、足以正式銷售的信號

常見問題

我什麼時候才能真正使用 MAI-Image-2.6?

目前可透過 Arena 使用,而且是免費的。自 8 月 19 日起,它也已在 MAI Playground 和 Microsoft Foundry 上提供私人預覽——依微軟官方公告,存取是邀請制,而非公開註冊。目前仍沒有公開的、按 token 計費的 API,也沒有公布價格。

影像編輯結果有多強?

在Artificial Analysis的图像编辑排行榜上,MAI-Image-2.6-Preview排名第一,领先于MAI-Image-2.5-Pro、Reve 2.1和GPT Image 2——微软包揽前两名。在Arena的“单图编辑”榜单上,它以1,420分排名第三,从第五名上升。两者都是独立的盲测偏好结果,但样本量尚早且偏少,AA对预览版的编辑评分尚未公布。

它與 GPT Image 2 Medium 有多接近?

在目前的文生圖 Arena 快照中,Elo 差距為 45 — 這已經接近到 No. 2 / No. 1 之間的差異落在投票流動所能影響的範圍內,而前五名模型的 Elo 差距大致都在 100 以內。

競技場排名可靠嗎?

它們是獨立的盲測人類偏好結果,這正是它們之所以有意義的原因——但兩者都仍是初步結果(在文生圖投票板上約有 3,500 票),且附屬於預覽版本。相信方向,而非小數點後的數字。

重點是:MAI-Image-2.6-Preview 是第一個真正躋身前沿討論的 Microsoft 影像模型——而且它很快就做到了:首次登場即在 Arena 的文字生成圖片排行榜上名列第 2,截至 8 月 25 日在 Artificial Analysis 的影像編輯項目中排名第 1,且在公共 API 推出之前,就已先在 Microsoft 自家平台上進行私人預覽。兩個獨立的排行榜現在得出相同的結論。如果最終價格落在接近 Flash 等級的區間,它將成為今年影像生成領域最值得關注的性價比選擇之一。影像編輯的排名與預覽結果回答了「這是否貨真價實」。公共 API 及其價格將回答「這是否值得在此基礎上開發」。