
MAI-Image-2.6-Preview: 画像編集で第1位、テキストから画像生成で第2位
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 361 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
マイクロソフトのMAI-Image-2.6-Previewは、もはや触れられないArenaリーダーボードのエントリーではなく、独立したリーダーボード首位の座に立っている。8月25日、独立系ベンチマーク企業であるArtificial Analysisは、同じプレビュービルドを画像編集リーダーボードで第1位、Text to Imageで第2位にランク付けした。画像編集部門での第1位獲得により、マイクロソフト自身のMAI-Image-2.5-Pro(前回首位)、Reve 2.1、OpenAIのGPT Image 2を抑え、マイクロソフトは同ボードの上位2位を占めることになった。このモデルは、マイクロソフトの発表によると、8月19日にMAI PlaygroundとMicrosoft Foundryでプライベートプレビュー入りした。招待制で、いまだ公開APIも価格表もない。
注目すべきは順位そのものではなく、その軌跡だ。Arenaのテキストから画像部門のボードで2位に達したエントリーは、その名も「mai-image-2.6-preview」。その時点で約3,500票を集め、MAI-Image-2.5に対して+79のEloゲインを記録し、一挙に8ランク上昇した。それ以降、状況は急速に明らかになってきた。8月19日にMAI PlaygroundとMicrosoft Foundryでプライベートプレビューへのアクセスが開始され、Arenaの画像編集ボードはこのビルドを3位に引き上げ、現在ではArtificial Analysisで画像編集1位、テキストから画像2位にランクされている。これは、マイクロソフトの社内画像生成への取り組みがOpenAIとの差を縮めたことを示す、これまでで最も強力な独立系シグナルだ——しかも公開APIはまだ一般提供されていない。
主要な数字
• Arena text-to-imageランク: 2位 — スコア 1,336±11、暫定、約3,488票
• 1位との差(GPT Image 2 Medium): 45 Elo
• 第3位(Grok Imagine Image 2.0)に対するリード: 20 Elo
• MAI-Image-2.5を上回る: 総合+79 Elo、テキストレンダリングで+91 Elo
• 前モデルの順位: MAI-Image-2.5 10位(1,256)
• 画像編集ランク: Arenaの「Single Image Edit」で第3位 — 1,420ポイント、第5位から上昇
• Artificial Analysis 画像編集ランキング: 第1位 — MAI-Image-2.5-Pro(前回の第1位)、Reve 2.1、GPT Image 2 を抑えて首位。Microsoft がトップ2を独占
• Artificial Analysis text-to-imageランキング: 第2位 — GPT Image 2に次ぐ; 19カテゴリーボード中5つで首位
• プライベートプレビュー:8月19日にMAI PlaygroundとMicrosoft Foundryで発表 — ベンダー表明、招待制、価格表は未公開

MAI-Image-2.6とは
MAI-Image-2.6は、Microsoft社内の画像生成ラインアップにおける最新モデルであり、ムスタファ・スレイマン率いるMicrosoft AIのもとで構築されました。このファミリーは急速に進化してきました。MAI-Image-1が基盤となり、MAI-Image-2(2026年3月)はフォトリアリズムとテキスト描画の飛躍的な向上を実現し、MAI-Image-2.5(2026年6月)はプロ向けの出力と編集機能を追加して、Bing Image Creator、PowerPoint、OneDrive内部のエンジンとなりました。MAI-Image-2.5-Pro(2026年7月)は8Kプレミアムティアを追加し、そして2.6は前モデルからおよそ6週間後に登場しました。
モデルの質と同じくらい、そのリズムが重要だ。マイクロソフトは画像機能の改善を6〜8週間のサイクルで投入しており、これは画像市場の従来の動き方というよりも、フロンティアラボがテキストモデルをリリースするペースに近い。ローンチ時のArenaランキング2位、その1週間後の編集部門3位というのは、そのリズムが複利のように効いてきた結果の姿だ。
リーダーボードの結果を注意深くお読みください。
{{1}}Arena(旧LMArena、ブランド名変更後)は、画像モデルをブラインド方式の人間の好みでランク付けします。投票者は同じプロンプトから生成された2つの画像を見て、より優れた方を選びます。{{/1}} {{2}}Artificial Analysisも、独自のEloレーティングを用いた、同種の独立したブラインド選好アリーナを運営しています。{{/2}} {{3}}どちらも、ベンダー主導のベンチマークではなく、人々が実際に好むものを示す独立した指標です。だからこそ、2位でのデビューには確かな重みがあり、2つの異なるボードが同じモデルで一致することは、どちらか一方の数字単独よりも重要な意味を持ちます。{{/3}} {{4}}数字に注意点が必要なのもそのためです。Arenaの1,336というスコアは暫定値であり、1位のモデルの70,000票以上に対して約3,500票に基づいています。また、このエントリには「プレビュー」というラベルが付けられています。{{/4}} {{5}}早期投票によるEloは変動します。方向性は確実なものとして捉え、正確なスコアは暫定的なものとして扱ってください。{{/5}}

向上が見られた分野は、見出しの数字そのものよりも興味深い。ArenaはMAI-Image-2.6を、3Dイメージングおよびモデリングで1位(6位から上昇)、漫画・アニメ・ファンタジーで2位(8位から上昇)、製品・ブランディング・商業デザインで2位(7位から上昇)、テキスト描画で2位(8位から上昇、+91 Elo獲得)、アートで2位(4位から上昇)にランク付けした。Microsoftは、測定されたすべてのカテゴリーで改善したと述べている。その広がり——商業デザイン、3D、テキスト、アート——は、一芸に特化したモデルではなく、汎用画像モデルの特徴である。
その後、さらに2つのデータポイントが加わった。Arenaの画像編集ボード(「Single Image Edit」カテゴリ)では、同じmai-image-2.6-previewビルドが1,420ポイントで3位にランクイン。5位から上昇し、MAI-Image-2.5より19ポイント上回っている。最も大きな伸びはテキストレンダリングで、単独で+43ポイントを記録した。8月25日、Artificial Analysisはさらに踏み込み、自社のImage Editing Leaderboardでこのプレビュービルドを1位に据えた。Microsoft自身のMAI-Image-2.5-Pro(それまで1位、1,272 Elo)からトップの座を奪い、Reve 2.1やOpenAIのGPT Image 2を抑えての1位である。これによりMicrosoftは、同ボードの編集部門でトップ2を占めることになった。MicrosoftのAI責任者ムスタファ・スレイマンは、2.6を「AA上で最高の画像編集モデル」と評し、Microsoftがトップ5のうち3つを占めていると述べた。これはベンダー側の見せ方であり、根底にあるランキングはArtificial Analysis独自のものだ。プレビュービルド自体のAA編集スコアはまだ公表されておらず、どちらのボードも初期段階で投票数が少ない。したがって、方向性は確かなものとして捉えつつ、正確な数値は暫定的なものと見なすべきだ。
実際に新しくなった内容(ベンダー報告)
能力について、マイクロソフト自身によるMAI-Image-2.6の説明は以下のとおりです。
• より強力なテキストレンダリング、ポートレート、および3Dイメージ
• 製品、ブランディング、シネマティックの各ユースケースにおいて、より洗練された商業クオリティのフォトリアリスティックな出力
• 単一の生成で複数の参照画像を扱う
• より豊かなグラウンディング — プロンプトの詳細へのより高い忠実さ
推論、形式、解像度に対するより高度な制御
これらはすべてベンダーが報告したものであり、まだ独立に再現されてはいません。独立した証拠は、2つのリーダーボード、すなわちArenaとArtificial Analysisの両方でテキストから画像への生成が2位、Arenaの編集ボードで3位、Artificial Analysisの編集ボードで1位——すべて暫定結果です。MAI-Image-2.6が広く利用可能になり、第三者が統制された評価を実施できるようになるまでは、機能リストはMicrosoftの主張として扱い、2つのリーダーボードを実用的なシグナルとみなしてください。
実際に使えるとき
MAI-Image-2.6は、今週「Arenaのみ」から「Arenaに加えて公式プレビュー」へと移行しました。8月19日、マイクロソフトは、同モデルがMAI PlaygroundとMicrosoft Foundryでプライベートプレビューとして利用可能になったと発表しました。これはベンダー自身の発表であり、プレビューへのアクセスは一般公開の申し込みではなく招待制です。そのため、料金表も、トークン単位の課金APIもまだ存在しません。注目すべき実用的な指標は次の通りです。MAI-Image-2.5がBing Image Creatorのデフォルトになり、PowerPointとOneDriveにも展開されたとき、それはマイクロソフトが同モデルを本番環境で安全と判断したことを意味しました。同様に2.6がこれらのサービスに展開されるか、「プレビュー」のラベルが外れれば、本番ワークロードに使用できる状態になったというシグナルとなるでしょう。

かかる費用
2.6の価格はまだ公表されていません — プライベートプレビューには料金表がありません。基準となるのは残りのファミリーで、すべてベンダー報告によるものです:
• MAI-Image-2.5: テキスト入力トークン100万件あたり$5、画像入力$8、画像出力$47
• MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — ハイボリュームティア
• MAI-Image-2.5-Pro (2026年7月): $5 / $8 / $106 — 8K出力、96.8%のテキスト描画精度
これは、Microsoftがすでに販売している画像出力レートの最安値と最高値の間で5倍の開きがあることを意味するため、2.6の生産コストはどの階層に位置するかにかかっています。2.5の100万出力トークンあたり47ドルのレートでは、およそ1,000出力トークンを消費する画像は約5セントになります。ただし、Microsoftは画像ごとのトークン数を公開していないため、これは引用ではなく計算上の数字として扱ってください。
価格設定は、ルーティングレイヤーがその存在価値を発揮する場面でもあります。モデルが公開APIに到達すると、その価格設定が重要になります。OrcaRouterでは、Microsoftが請求する金額はそのまま0%のマークアップで転送されます。プロバイダーのリスト価格そのままで、追加は一切ありません。そのため、ローンチ時の割引やその後の値下げは、発表された当日にあなたの請求に反映されます。再交渉も、追加の契約も不要です。モデルは他のすべてと同じキーに表示されます。
これで画像モデル競争はどうなるのか
Arenaのテキスト画像生成ボードの現在のトップは、GPT Image 2(Medium)が1,381、MAI-Image-2.6が1,336、Grok Imagine Image 2.0が1,316、Reve 2.1が1,302、MetaのMuse Imageが1,282。上位5モデルが約100 Elo以内にひしめいている。Artificial Analysisも同じ総合評価に達している——テキスト画像生成でGPT Image 2に次ぐ2位——さらにカテゴリ別の詳細も示しており、プレビュービルドは19のテキスト画像生成カテゴリのうち5つ(Material、Knowledge、Frontier、Retail & Ecommerce、Marketing & Advertising)で1位を獲得、それ以外の全カテゴリではGPT Image 2が首位を占めている。独立した2つの嗜好ベースのボードが同じ方向を指しているのは、これほど新しいモデルについて得られる最も強い評価指標だ。かつてトップと他社を隔てていた品質の差は、「最高の画像モデル」という問いがもはや有用でなくなるほどに縮まっている。今や重要なのは、編集能力、グラウンディング、速度、価格である。
マイクロソフトの賭けは、単一のリーダーボードの頂点よりも広範なものだ。すなわち、画像、音声、コード、推論にわたる自社モデルスタックを、Copilot、Bing、Officeを通じて配布することにある。Arenaのランキングはプルーフ・オブ・ワークであり、実際の製品とはその流通網なのである。
本番環境を危険にさらさずに試す方法
Arena プレビューは無料です。生のシグナルが必要なら、今日のうちに生成を試してみてください。プライベートプレビューアクセスをお持ちの場合は、MAI Playground と Microsoft Foundry のエントリポイントから、コミットする前に実際のワークロードを実行できます。それ以外の皆さんにとって、「プレリミナリー」スコアの真新しいモデルを採用する賢明な方法は、トラフィックの一部をそのモデルに振り向け、実績のあるモデルをフォールバックとして維持することです。これはまさに、ルーティングレイヤーが構築された障害モードです。OrcaRouter では、MAI-Image-2.6 がアップストリームプロバイダーでホストされたら、1つのエンドポイントをそこに向け、自動フェイルオーバーに、投票数の少ないリーダーボード評価では見えないエッジケースを捉えさせることができます。1つのAPIキーで200以上のモデル、プロバイダー料金はそのまま適用されます。
次に見るもの
• Artificial Analysis の編集ランキング1位と Arena の3位が、投票が蓄積されるにつれて維持されるかどうか — 両ボードはともに初期段階で投票数が少ない
パブリックAPIの価格とそれがどのティアに該当するか — プライベートプレビューにはまだ料金表がない。
• Bing Image Creator と Copilot がデフォルトを 2.5 から 2.6 に切り替えるかどうか
• API公開後の独立したベンチマーク
「プレビュー」というラベルが外れるかどうか——それは、Microsoftが販売できるほど自信を持っているというシグナルだ。
よくある質問
MAI-Image-2.6を実際にいつ使えますか?
現在は無料のArena経由で利用できます。8月19日以降は、マイクロソフト自身の発表によると、MAI PlaygroundとMicrosoft Foundryでもプライベートプレビューとして提供されており、アクセスは一般公開のサインアップではなく招待制となっています。依然として、一般向けのトークン単位課金APIはなく、公表された価格もありません。
画像編集の結果はどのくらい強力ですか?
Artificial Analysisの画像編集リーダーボードで、MAI-Image-2.6-PreviewがMAI-Image-2.5-Pro、Reve 2.1、GPT Image 2を抑えて1位を獲得。Microsoftがトップ2を独占しています。Arenaの「Single Image Edit」ボードでは1,420ポイントで5位から3位に浮上。どちらも独立したブラインド選好による結果ですが、初期段階で投票数が少なく、プレビュービルドのAA編集スコアはまだ公開されていません。
それはGPT Image 2 Mediumにどれほど近いですか?
現在の text-to-image Arena スナップショットでは45 Elo差 — 投票の流れで変動し得る範囲に2位と1位の差が収まるほどの僅差で、上位5モデルはすべておおよそ100 Elo以内に収まっている。
アリーナのランクは信頼できますか?
これらは独立したブラインドでの人間の好みによる評価結果であり、まさにその点が重要です。ただし、どちらも予備的なもので(テキストから画像へのボードで約3,500票)、プレビュービルドに付随しています。信頼すべきは方向性であり、細かい数値ではありません。
結論: MAI-Image-2.6-Preview は、真にフロンティア級の議論に加わる最初の Microsoft 画像モデルであり、しかも急速にその地位を獲得しました。デビュー時に Arena のテキストから画像へのリーダーボードで 2 位、8 月 25 日までに Artificial Analysis の画像編集で 1 位、そして公開 API に先駆けて Microsoft 自身のサーフェスでプライベートプレビューを実施しました。2 つの独立したボードが現在、同じ評価に収束しています。最終的な価格が Flash ティアに近い水準になれば、今年の画像生成における最も興味深いバリュープレイの 1 つになります。編集ランキングとプレビューは「これは本物か」という問いに答えています。公開 API とその価格は、「これを基盤に構築する価値があるか」に答えるでしょう。
