Титульная карточка для MAI-Image-2.6, модели Microsoft №2 для генерации изображений по тексту на Arena, с оценкой Arena 1 336, местом №2 и приростом +79 Elo по сравнению с MAI-Image-2.5.
Guides & Insights

MAI-Image-2.6-Preview: #1 в редактировании изображений, #2 в генерации изображений по тексту

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

MAI-Image-2.6-Preview от Microsoft больше не просто запись в таблице лидеров Arena, до которой нельзя дотянуться, — теперь это самостоятельный лидер таблицы. 25 августа Artificial Analysis, независимая организация по бенчмаркингу, поставила эту же предварительную сборку на №1 в своем рейтинге редактирования изображений и на №2 в генерации изображений по текстовому описанию. Первое место в редактировании ставит ее выше собственной MAI-Image-2.5-Pro от Microsoft (предыдущего лидера), Reve 2.1 и GPT Image 2 от OpenAI, что дает Microsoft две верхние позиции в этой таблице. Модель поступила в частный предварительный доступ на MAI Playground и Microsoft Foundry 19 августа, согласно объявлению Microsoft, — по приглашениям, без публичного API и без прайс-листа.

Больше всего поражает не место в рейтинге, а траектория. Модель, добравшаяся до № 2 в лидерборде text-to-image на Arena, буквально называется «mai-image-2.6-preview»: на том срезе она набрала около 3 500 голосов и за один шаг поднялась на восемь позиций с приростом +79 Elo по сравнению с MAI-Image-2.5. С тех пор картина быстро прояснилась: приватный предварительный доступ открылся на MAI Playground и Microsoft Foundry 19 августа, лидерборд Arena по редактированию изображений поднял сборку до № 3, а теперь Artificial Analysis ставит её на № 1 в редактировании изображений и на № 2 в text-to-image. Это самый сильный независимый сигнал на сегодняшний день о том, что собственная разработка Microsoft в области изображений сократила разрыв с OpenAI, — а публичный API до сих пор не открыт для общего доступа.

Ключевые цифры

• Рейтинг Arena text-to-image: № 2 — предварительный результат 1 336±11, ~3 488 голосов

• Отставание от №1 (GPT Image 2 Medium): 45 Elo

• Преимущество над № 3 (Grok Imagine Image 2.0): 20 Elo

• Обходит MAI-Image-2.5: +79 Elo в целом, +91 Elo на рендеринге текста

• Позиция предшественника: MAI-Image-2.5 на 10-м месте (1,256)

• Рейтинг редактирования изображений: № 3 на Arena в категории «Single Image Edit» — 1 420 очков, поднявшись с № 5

• Рейтинг редактирования изображений Artificial Analysis: № 1 — опережая MAI-Image-2.5-Pro (предыдущий № 1), Reve 2.1 и GPT Image 2; Microsoft занимает первые два места

• Рейтинг Artificial Analysis в генерации изображений по тексту: № 2 — уступает только GPT Image 2; первое место в 5 из 19 категорий.

• Закрытая предварительная версия: анонсировано 19 августа на MAI Playground и Microsoft Foundry — по заявлению вендора, доступ по приглашениям, прайс-листа пока нет

Scoreboard for MAI-Image-2.6: Arena T2I rank No. 2 (1,336 Elo, preliminary), gap to GPT Image 2 Medium -45 Elo, gain vs MAI-Image-2.5 +79 Elo, text rendering +91 Elo, best category 3D and modeling No. 1, API status expected next week. Footer notes Arena figures as of Aug 10, 2026 and that vendor claims are unreproduced.

Что такое MAI-Image-2.6

MAI-Image-2.6 — новейшая модель в линейке собственных генераторов изображений Microsoft, созданная в рамках Microsoft AI под руководством Мустафы Сулеймана. Семейство развивалось быстро: MAI-Image-1 стал фундаментом, MAI-Image-2 (март 2026 года) обеспечил скачок в фотореализме и рендеринге текста, MAI-Image-2.5 (июнь 2026 года) добавил вывод и редактирование профессионального уровня и стал движком Bing Image Creator, PowerPoint и OneDrive, MAI-Image-2.5-Pro (июль 2026 года) добавил премиальный 8K-уровень — и теперь 2.6 появляется примерно через шесть недель после своего предшественника.

Периодичность важна не меньше, чем сама модель. Microsoft выпускает улучшения для изображений с циклом в шесть‑восемь недель — это ближе к тому, как передовые лаборатории поставляют текстовые модели, чем к тому, как исторически развивался рынок изображений. Дебют на втором месте в Arena при запуске и третье место по редактированию неделю спустя — вот как эта периодичность выглядит, когда даёт накопительный эффект.

Результаты таблицы лидеров — читайте внимательно.

Arena (переименованная LMArena) ранжирует модели генерации изображений по слепым предпочтениям людей: избиратели видят два изображения, созданные по одному и тому же запросу, и выбирают то, которое кажется сильнее. Artificial Analysis проводит аналогичную независимую арену слепых предпочтений с собственными рейтингами Эло. Оба подхода — независимые меры того, что люди действительно предпочитают, а не бенчмарки, проводимые вендорами. Именно поэтому дебют со второго места имеет реальный вес, и почему согласие двух независимых площадок по одной и той же модели важнее, чем любое число по отдельности. Это также причина, по которой к числам нужно относиться с оговорками: оценка Arena в 1 336 баллов предварительна, основана на примерно 3 500 голосах против более чем 70 000 у модели на первом месте, и запись помечена как «превью». Рейтинг Эло на ранних голосах меняется; считайте направление надёжным, а точный балл — предварительным.

The Arena text-to-image leaderboard as of August 10, 2026, showing MAI-Image-2.6 in second place at 1,336 Elo with 3,488 votes, behind gpt-image-2 (medium) at 1,381 and ahead of grok-imagine-image-2.0 at 1,316.

Распределение улучшений интереснее, чем итоговая цифра. Arena поставила MAI-Image-2.6 на первое место в 3D-визуализации и моделировании (поднявшись с шестого) и на второе — в категориях мультфильмы/аниме/фэнтези (поднявшись с восьмого), товарный, брендовый и коммерческий дизайн (поднявшись с седьмого), отрисовка текста (поднявшись с восьмого, с приростом +91 к рейтингу Elo) и искусство (поднявшись с четвёртого). Microsoft утверждает, что модель улучшилась во всех измеряемых категориях. Такой разброс — коммерческий дизайн, 3D, текст и искусство — характерен для универсальной модели изображений, а не для узкоспециализированной модели с одним трюком.

Затем поступили ещё две точки данных. Таблица редактирования изображений Arena — категория «Single Image Edit» — размещает ту же сборку mai-image-2.6-preview на 3-м месте с 1420 очками, поднявшись с 5-го места и опережая MAI-Image-2.5 на 19 очков, при этом рендеринг текста дал наибольший отдельный прирост (+43 очка). 25 августа Artificial Analysis пошла дальше: её таблица лидеров по редактированию изображений ставит предварительную сборку на 1-е место, отобрав верхнюю позицию у собственной MAI-Image-2.5-Pro от Microsoft (ранее №1 с 1272 Elo) и опережая Reve 2.1 и GPT Image 2 от OpenAI — теперь Microsoft занимает две верхние позиции по редактированию в этой таблице. Глава ИИ-направления Microsoft Мустафа Сулейман назвал 2.6 «лучшей моделью редактирования изображений на AA» и заявил, что Microsoft занимает три из пяти верхних позиций — это подача вендора; сами рейтинги принадлежат Artificial Analysis. Оценка AA для редактирования самой предварительной сборки ещё не опубликована, и обе таблицы предварительные и с малым количеством голосов, так что направление можно считать надёжным, а точные цифры — предварительными.

Что на самом деле нового (сообщено вендором)

Что касается возможностей, собственные описания Microsoft для MAI-Image-2.6 таковы:

• Более качественное отображение текста, портретов и 3D-изображений

• Более качественный коммерческий и фотореалистичный результат в продуктовых, брендинговых и кинематографических сценариях использования

• Работайте с несколькими референсными изображениями за одну генерацию

• Более глубокая привязка к контексту — лучшее следование конкретным деталям промпта

• Больший контроль над рассуждениями, форматом и разрешением

Все они указаны вендором и пока не воспроизведены независимо. Независимые доказательства — это пара таблиц лидеров: №2 в text-to-image и на Arena, и на Artificial Analysis, №3 в редактировании на Arena и №1 в редактировании на Artificial Analysis — все предварительные. Пока MAI-Image-2.6 не станет широко доступной и третьи стороны не смогут проводить контролируемые оценки, относитесь к списку возможностей как к заявлению Microsoft, а к двум таблицам лидеров — как к рабочему сигналу.

Когда вы действительно можете использовать это

На этой неделе MAI-Image-2.6 перешёл из статуса «только Arena» в статус «Arena плюс официальная предварительная версия». 19 августа Microsoft объявил, что модель доступна в частной предварительной версии на MAI Playground и Microsoft Foundry. Это заявление самого вендора, и доступ к предварительной версии предоставляется по приглашениям, а не через открытую регистрацию — поэтому до сих пор нет прайс-листа и нет API с оплатой за токены. Практический индикатор, за которым стоит следить: когда MAI-Image-2.5 стал моделью по умолчанию в Bing Image Creator и был внедрён в PowerPoint и OneDrive, это означало, что Microsoft считает его безопасным для продакшена. Аналогичное развёртывание 2.6 в этих же продуктах — или снятие ярлыка «preview» — станет сигналом, что модель готова к производственным нагрузкам.

Microsoft's announcement that MAI-Image-2.6 launches at No. 2 on the Arena leaderboard ahead of Google, Meta and xAI, with category highlights for text rendering, 3D imaging and modeling, branding and commercial, portraits, and photorealistic and cinematic output.

Сколько это может стоить

Цены на 2.6 не публиковались — в закрытой предварительной версии нет прайс-листа. Ориентир — остальная часть семейства, все данные указаны вендором:

• MAI-Image-2.5: $5 за миллион токенов текстового ввода, $8 за ввод изображений, $47 за вывод изображений

• MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — тариф для высоких объемов

• MAI-Image-2.5-Pro (июль 2026): $5 / $8 / $106 — вывод в 8K, точность рендеринга текста 96,8%

Это пятикратный разрыв между самыми дешёвыми и самыми дорогими тарифами на вывод изображений, которые Microsoft уже продаёт, поэтому себестоимость производства 2.6 будет зависеть от того, в какой тарифный уровень он попадёт. При ставке вывода в 47 долларов за миллион токенов для 2.5 изображение, потребляющее примерно тысячу выходных токенов, обойдётся почти в пять центов — но Microsoft не публикует количество токенов на изображение, так что воспринимайте это как арифметику, а не как официальную котировку.

Ценообразование — это также то, где уровень маршрутизации оправдывает своё существование, когда модель достигает публичного API. На OrcaRouter всё, что взимает Microsoft, передаётся с наценкой 0% — цена по прайс-листу провайдера, без каких-либо добавок — поэтому скидка при запуске или последующее снижение цены отражается на вашей стороне счёта в тот же день, когда об этом объявлено. Никаких переговоров и второго контракта; модель появляется на том же ключе, что и всё остальное.

Что это значит для гонки моделей изображений

Сейчас верхнюю часть таблицы лидеров Arena по генерации изображений из текста занимают: GPT Image 2 (Medium) — 1 381, MAI-Image-2.6 — 1 336, Grok Imagine Image 2.0 — 1 316, Reve 2.1 — 1 302 и Meta's Muse Image — 1 282. Пять моделей наверху укладываются в диапазон примерно 100 пунктов Эло. Artificial Analysis приходит к тому же общему выводу — второе место в генерации изображений из текста, уступая только GPT Image 2, — и добавляет детали по категориям: превью-сборка занимает первое место в 5 из 19 категорий (Material, Knowledge, Frontier, Retail & Ecommerce и Marketing & Advertising), а во всех остальных лидирует GPT Image 2. Две независимые таблицы лидеров, основанные на предпочтениях и указывающие в одном направлении, — это самый сильный сигнал, который можно получить о такой молодой модели. Разрыв в качестве, который раньше отделял лидера от остальных, сжался настолько, что вопрос «какая модель лучшая для генерации изображений» перестал быть осмысленным — теперь важны редактирование, соответствие запросу, скорость и цена.

Ставка Microsoft шире, чем любая отдельная корона в лидерборде: собственный стек моделей, охватывающий изображения, голос, код и рассуждения, распространяемый через Copilot, Bing и Office. Ранги в Arena — это доказательство работы; распространение — это сам продукт.

Как попробовать это, не ставя на кон продакшн

{{1}}Предварительная версия Arena бесплатна — запускайте генерацию на ней уже сегодня, если вам нужен сырой сигнал.{{/1}} {{2}}Если у вас есть доступ к закрытой предварительной версии, точки входа MAI Playground и Microsoft Foundry позволяют прогнать реальные рабочие нагрузки, прежде чем вы возьмёте на себя обязательства.{{/2}} {{3}}Для всех остальных разумный способ внедрения совершенно новой модели с «предварительной» оценкой — направить на неё долю трафика, оставив проверенную модель в качестве запасного варианта.{{/3}} {{4}}Именно для такого сценария отказа и создан маршрутизирующий слой: в OrcaRouter вы направляете один эндпоинт на MAI-Image-2.6, как только она будет размещена у вышестоящего провайдера, а автоматическое аварийное переключение отлавливает пограничные случаи, которые не видит рейтинг в таблице лидеров с небольшим числом голосов.{{/4}} {{5}}Один API-ключ, 200+ моделей, цены провайдеров без наценки.{{/5}}

Что посмотреть дальше

• Удержится ли рейтинг №1 по редактированию в Artificial Analysis и №3 в Arena по мере накопления голосов — обе таблицы находятся на раннем этапе и имеют мало голосов.

• Цена публичного API и то, в какой тарифный план он попадает — в закрытой предварительной версии по-прежнему нет прайс-листа

• Переключат ли Bing Image Creator и Copilot свою версию по умолчанию с 2.5 на 2.6

• Независимые бенчмарки, как только API откроется

• Снимется ли пометка «preview» — сигнал того, что Microsoft достаточно уверена, чтобы продавать его.

Часто задаваемые вопросы

Когда я на самом деле смогу использовать MAI-Image-2.6?

Прямо сейчас — через Arena, и это бесплатно. С 19 августа модель также доступна в приватной предварительной версии на MAI Playground и Microsoft Foundry — согласно собственному объявлению Microsoft, доступ предоставляется по приглашению, а не через публичную регистрацию. Публичного API с оплатой за токены по-прежнему нет, как и опубликованной цены.

Насколько силён результат редактирования изображения?

В рейтинге редактирования изображений Artificial Analysis модель MAI-Image-2.6-Preview занимает № 1, опережая MAI-Image-2.5-Pro, Reve 2.1 и GPT Image 2, — Microsoft удерживает две верхние позиции. На доске Arena «Single Image Edit» она занимает № 3 с 1420 очками, поднявшись с № 5. Оба результата являются независимыми слепыми предпочтениями, но предварительными и с низким числом голосов, а оценка редактирования AA для предварительной сборки ещё не опубликована.

Насколько это близко к GPT Image 2 Medium?

45 Elo на текущем снимке Arena text-to-image — достаточно близко, чтобы разница между №2 и №1 находилась в пределах того, что может сдвинуть поток голосов, а все пять лучших моделей укладываются в примерно 100 Elo друг от друга.

Надёжны ли ранги Арены?

Это независимые результаты слепой оценки предпочтений людьми, и именно это делает их значимыми — но оба показателя предварительны (около 3 500 голосов на доске text-to-image) и относятся к превью-сборке. Доверяйте направлению, а не десятичным знакам.

Суть: MAI-Image-2.6-Preview — первая модель Microsoft для генерации изображений, которая по-настоящему входит в число передовых, — и она добилась этого быстро: № 2 в таблице text-to-image на Arena сразу после дебюта, № 1 в редактировании изображений на Artificial Analysis к 25 августа и приватный предпросмотр на собственных площадках Microsoft до появления какого-либо публичного API. Две независимые таблицы лидеров теперь сходятся в одном и том же выводе. Если итоговая цена окажется где-то рядом с уровнем Flash, это станет одним из самых интересных предложений по соотношению цены и качества в генерации изображений в этом году. Ранги в редактировании и предпросмотр отвечают на вопрос «это настоящее?». Публичный API и его цена ответят на вопрос «стоит ли на этом строить?».