
MAI-Image-2.6-Preview:圖像編輯 #1,文字轉圖像 #2
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 361 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
微軟的 MAI-Image-2.6-Preview 不再只是 Arena 排行榜上一個你碰不到的條目——它現在已是獨立的排行榜冠軍。8月25日,獨立評測機構 Artificial Analysis 將同一預覽版本在其圖像編輯排行榜上列為第1名,並在文生圖(Text to Image)中列為第2名。這個編輯類別的第1名讓它超越了微軟自家的 MAI-Image-2.5-Pro(先前榜首)、Reve 2.1 以及 OpenAI 的 GPT Image 2,使微軟在該排行榜上佔據前兩名。根據微軟的公告,該模型於8月19日在 MAI Playground 和 Microsoft Foundry 上進入私人預覽——需邀請才能使用,仍無公開 API,也仍無定價表。
引人注目的不只是排名,而是發展軌跡。在 Arena 文生圖榜上名列第 2 的條目,名稱就叫 "mai-image-2.6-preview",在該次快照中獲得約 3,500 票,並且一次爬升八個名次,Elo 較 MAI-Image-2.5 提升了 79。此後輪廓迅速清晰:8 月 19 日,MAI Playground 與 Microsoft Foundry 開放私人預覽權限;Arena 的圖像編輯榜將該版本推進到第 3 名;如今 Artificial Analysis 將其列為圖像編輯第 1 名、文生圖第 2 名。這是迄今為止最有力的獨立訊號,顯示微軟內部圖像專案已拉近與 OpenAI 的差距——而公開 API 至今仍未全面開放。
關鍵數字
• Arena 文生圖排名:第 2 名 — 分數 1,336±11,初步結果,約 3,488 票
• 與第1名(GPT Image 2 Medium)的差距: 45 Elo
• 領先第三名 (Grok Imagine Image 2.0): 20 Elo
• 超越 MAI-Image-2.5: 整體 +79 Elo,文字渲染 +91 Elo
• 前身的位置: MAI-Image-2.5 位居第 10 名(1,256)
• 影像編輯排名:在 Arena 的「Single Image Edit」中名列第 3 — 1,420 分,自第 5 名上升
• Artificial Analysis 影像編輯排名:第一名——領先 MAI-Image-2.5-Pro(先前的第一名)、Reve 2.1 和 GPT Image 2;微軟佔據前兩名
• Artificial Analysis 文生圖排名:第 2 名 — 僅次於 GPT Image 2;在 19 個類別排行榜中,有 5 個位居第一
• 私人預覽:於 8 月 19 日在 MAI Playground 和 Microsoft Foundry 上宣佈 — 據廠商所述,採邀請制,尚無定價資訊

MAI-Image-2.6 是什麼
MAI-Image-2.6 是微軟內部影像生成系列的最新模型,由 Mustafa Suleyman 領導的 Microsoft AI 所打造。該系列進展迅速:MAI-Image-1 是基礎,MAI-Image-2(2026 年 3 月)實現了照片級真實感與文字渲染的躍進,MAI-Image-2.5(2026 年 6 月)加入了專業級輸出與編輯功能,並成為 Bing Image Creator、PowerPoint 和 OneDrive 背後的引擎,MAI-Image-2.5-Pro(2026 年 7 月)新增了 8K 高階方案,而 2.6 現在於其前代推出約六週後問世。
節奏與模型本身同等重要。微軟以六到八週的週期推出影像改進,這比影像市場歷史上的步調,更接近前沿實驗室推出文字模型的方式。在Arena以第2名之姿登場,一週後在編輯排名升至第3名,這就是這種節奏複利累積的成果。
排行榜結果,請仔細閱讀
競技場(更名後的 LMArena)透過盲測人類偏好來為影像模型排名:投票者會看到由相同提示詞產生的兩張圖片,然後選出較好的一張。Artificial Analysis 則以自家 Elo 評分系統,運行同類型的獨立盲測偏好競技場。兩者都是獨立衡量人們實際偏好,而非廠商自辦的基準測試——這就是為什麼排名第二的首秀具有真實分量,也是為什麼兩個獨立榜單對同一模型看法一致,比任何單一數字更有意義。這也正是這些數字需要附帶條件的原因:Arena 的 1,336 分只是初步分數,約 3,500 票的基礎,對比第一名模型的超過 70,000 票,而且該條目標註為「預覽版」。早期投票的 Elo 會變動;請把趨勢方向視為可靠,而確切分數則視為暫時性。

進步集中的領域比頭條數字更有意思。Arena 將 MAI-Image-2.6 在 3D 影像與建模方面排名第一(從第六名上升),並在卡通/動畫/奇幻(從第八名上升)、產品與品牌及商業設計(從第七名上升)、文字渲染(從第八名上升,Elo 增加 +91)、以及藝術(從第四名上升)方面排名第二。微軟表示它在每個評測類別中都有所提升。這種涵蓋商業設計、3D、文字和藝術的廣泛分佈,是通用影像模型的標誌,而非只會一招的專門模型。
接著又出現了兩個數據點。Arena 的圖像編輯排行榜——「單圖編輯」類別——將同一個 mai-image-2.6-preview 版本列為第 3 名,獲得 1,420 分,從第 5 名升至第 3 名,並領先 MAI-Image-2.5 達 19 分,其中文字渲染是最大單項漲幅(+43 分)。8 月 25 日,Artificial Analysis 更進一步:其 Image Editing Leaderboard 將預覽版列為第 1 名,從微軟自家的 MAI-Image-2.5-Pro(先前以 1,272 Elo 位居第 1)手中奪下榜首,並領先 Reve 2.1 和 OpenAI 的 GPT Image 2——微軟目前占據該排行榜的前兩名。微軟 AI 主管 Mustafa Suleyman 稱 2.6 是「AA 上最棒的圖像編輯模型」,並表示微軟占據前五名中的三個位置——這是廠商的說法;底層排名其實是 Artificial Analysis 自己的。AA 本身並未公布預覽版的編輯評分,而且兩個排行榜都還處於早期階段、投票數偏低,因此請把趨勢方向視為可靠,確切數字則視為暫時性。
實際上有什麼新功能(廠商回報)
在能力方面,微軟自己對 MAI-Image-2.6 的描述是:
• 更強的文字渲染、人像與 3D 影像
• 更精緻的商業與擬真輸出,涵蓋產品、品牌與電影級應用場景
• 在單次生成中同時使用多張參考圖像
• 更豐富的基礎 — 更好地遵循提示中的具體內容
• 對推理、格式和解析度有更強的控制力
這些全部都來自廠商自行回報,尚未經獨立重現驗證。獨立的證據是那兩組排行榜:在 Arena 和 Artificial Analysis 的文字生成圖片項目皆排名第 2、在 Arena 的編輯排行榜排名第 3、在 Artificial Analysis 的編輯排行榜排名第 1——但全都是初步結果。在 MAI-Image-2.6 廣泛開放、第三方能執行受控評測之前,請把能力清單視為 Microsoft 的說法,並以那兩個排行榜作為現階段可參考的訊號。
當你真正能使用它的時候
本週,MAI-Image-2.6 從「僅限 Arena」變成「Arena 加上官方預覽」。8 月 19 日,微軟宣布該模型已在 MAI Playground 和 Microsoft Foundry 上提供私人預覽。這是廠商自己的說法,而且預覽存取是邀請制,而非公開註冊——因此目前仍沒有價格表,也沒有按 token 計費的 API。值得觀察的實務訊號是:當 MAI-Image-2.5 成為 Bing Image Creator 的預設模型,並推展到 PowerPoint 和 OneDrive 時,代表微軟認為它已可安全用於生產環境。若 2.6 也類似地推展到這些介面——或「預覽」標籤被移除——那就是它已準備好承擔生產工作負載的訊號。

可能的費用
2.6 尚未公布任何定價——私人預覽版沒有費率表。定價基準是產品家族中的其他成員,全部由供應商報告:
• MAI-Image-2.5:每百萬文字輸入Token $5,圖片輸入 $8,圖片輸出 $47
• MAI-Image-2.5-Flash:$1.75 / $1.75 / $19.50 — 高用量方案
• MAI-Image-2.5-Pro(2026年7月):$5 / $8 / $106 — 8K 輸出,96.8% 文字渲染準確度
微軟已販售的影像輸出費率中,最便宜與最貴之間相差五倍,因此 2.6 的生產成本將取決於它落在哪個級距。以 2.5 每百萬輸出 token 47 美元的費率來算,一張消耗約一千個輸出 token 的影像,成本將近五美分——但微軟並未公布每張影像的 token 數,所以請把這個數字視為推算,而非正式報價。
當模型進入公開 API 階段時,定價也是路由層證明其價值的地方。在 OrcaRouter 上,微軟收取的任何費用都會以 0% 加成直接轉嫁——也就是供應商的定價,不加任何費用——因此發布折扣或日後的降價,會在宣布當天就反映在你的帳單上。無需重新協商,也無需第二份合約;該模型會與其他所有模型一起出現在同一個 API 金鑰上。
這讓圖像模型之爭何去何從
目前 Arena 文生圖排行榜的頂端:GPT Image 2 (Medium) 以 1,381 分居首、MAI-Image-2.6 以 1,336 分居次、Grok Imagine Image 2.0 以 1,316 分排第三、Reve 2.1 以 1,302 分排第四、Meta 的 Muse Image 則以 1,282 分排第五。前五名的 Elo 差距約僅 100 分。Artificial Analysis 得出相同的整體結論——文生圖排名第 2,僅次於 GPT Image 2——並補充了類別細節:預覽版本在其 19 個文生圖類別中拿下 5 個第一(Material、Knowledge、Frontier、Retail & Ecommerce 與 Marketing & Advertising),而其餘所有類別均由 GPT Image 2 領先。兩個獨立且以偏好為基礎的排行榜指向同一方向,是對這個如此年輕的模型所能獲得的最強訊號。過去將領先者與其他對手拉開差距的品質鴻溝,如今已壓縮到「最佳影像模型」不再是個有用問題的地步——編輯、接地性、速度與價格才是重點。
微軟的賭注比任何單一的排行榜桂冠都更為宏大:一套涵蓋影像、語音、程式碼與推理的內部模型堆疊,透過 Copilot、Bing 和 Office 進行分發。Arena 的排名是工作量證明;分發管道才是真正的產品。
如何在不冒生產環境風險的情況下試用它
Arena 預覽版是免費的——如果你想要第一手訊號,今天就針對它生成內容。如果你有私人預覽存取權限,MAI Playground 和 Microsoft Foundry 入口可讓你在正式採用前執行真實工作負載。對於其他人來說,採用一款帶有「初步」評分的新模型,明智的做法是將一部分流量導向它,並保留你已驗證的模型作為備援。這正是路由層要處理的故障模式:在 OrcaRouter 上,一旦 MAI-Image-2.6 在上游供應商上架,你就可以將一個端點指向它,讓自動故障切換捕捉低投票數排行榜評分無法察覺的邊緣情況。一個 API 金鑰,200+ 模型,供應商價格直接轉嫁。
接下來要看什麼
• 隨著票數累積,Artificial Analysis 的編輯排名第 1 名與 Arena 第 3 名是否還能維持——這兩個榜單都還很初期、票數偏低。
• 公開 API 的價格以及它屬於哪個方案等級——私人預覽版仍無定價表
• Bing Image Creator 和 Copilot 是否將其預設值從 2.5 切換為 2.6
• 待API開放後進行獨立基準測試
• 「預覽」標籤是否會移除——這是微軟對產品已有足夠信心、足以正式銷售的信號
常見問題
我什麼時候才能真正使用 MAI-Image-2.6?
目前可透過 Arena 使用,而且是免費的。自 8 月 19 日起,它也已在 MAI Playground 和 Microsoft Foundry 上提供私人預覽——依微軟官方公告,存取是邀請制,而非公開註冊。目前仍沒有公開的、按 token 計費的 API,也沒有公布價格。
影像編輯結果有多強?
在Artificial Analysis的图像编辑排行榜上,MAI-Image-2.6-Preview排名第一,领先于MAI-Image-2.5-Pro、Reve 2.1和GPT Image 2——微软包揽前两名。在Arena的“单图编辑”榜单上,它以1,420分排名第三,从第五名上升。两者都是独立的盲测偏好结果,但样本量尚早且偏少,AA对预览版的编辑评分尚未公布。
它與 GPT Image 2 Medium 有多接近?
在目前的文生圖 Arena 快照中,Elo 差距為 45 — 這已經接近到 No. 2 / No. 1 之間的差異落在投票流動所能影響的範圍內,而前五名模型的 Elo 差距大致都在 100 以內。
競技場排名可靠嗎?
它們是獨立的盲測人類偏好結果,這正是它們之所以有意義的原因——但兩者都仍是初步結果(在文生圖投票板上約有 3,500 票),且附屬於預覽版本。相信方向,而非小數點後的數字。
重點是:MAI-Image-2.6-Preview 是第一個真正躋身前沿討論的 Microsoft 影像模型——而且它很快就做到了:首次登場即在 Arena 的文字生成圖片排行榜上名列第 2,截至 8 月 25 日在 Artificial Analysis 的影像編輯項目中排名第 1,且在公共 API 推出之前,就已先在 Microsoft 自家平台上進行私人預覽。兩個獨立的排行榜現在得出相同的結論。如果最終價格落在接近 Flash 等級的區間,它將成為今年影像生成領域最值得關注的性價比選擇之一。影像編輯的排名與預覽結果回答了「這是否貨真價實」。公共 API 及其價格將回答「這是否值得在此基礎上開發」。
