
MAI-Image-2.5-Pro занимает первое место в редактировании изображений: что на самом деле доказывает независимая победа Microsoft
- AlibabaНОВИНКАQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.3 Flash2026-08-2658Интеллект72Кодинг
- DeepSeekНОВИНКАDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianНОВИНКАQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
MAI-Image-2.5-Pro теперь является лучшей моделью редактирования изображений в рейтинге Artificial Analysis — независимой доске голосования вслепую — но при этом занимает лишь седьмое место в простой генерации текста в изображение. Этот разрыв и есть суть: модель, находящаяся в публичном предварительном доступе менее месяца, созданная полностью внутри Microsoft AI, обогнала GPT Image 2, Reve 2.1, и собственный аналог MAI-Image-2.5 на доске редактирования, но уступает большинству участников того же рейтинга, когда запрос звучит как «нарисуй мне что-нибудь из ничего». Прочитайте оба показателя вместе — и вы получите точную картину того, что выпустила Microsoft: специалиста по изменению существующих изображений, а не универсального генератора.
Два числа, бок о бок
По данным августовского снимка 2026 года, Image Editing Arena от Artificial Analysis ставит MAI-Image-2.5-Pro на No. 1 с Elo 1,272, что основано на примерно 6,100 слепых сравнениях пользователей. Преследователи идут вплотную: Reve 2.1 — 1,262, затем MAI-Image-2.5 и GPT Image 2 (high) с одинаковым результатом 1,256, GPT Image 1.5 (high) — 1,250, Qwen-Image-3.0-Pro — 1,249, и Nano Banana 2 от Gogle — 1,249. В Text-to-Image Arena она находится на No. 7 с Elo 1,292, уступая GPT Image 2 (high) с 1,369, Reve 2.1 с 1,322, Nano Banana 2 с 1,320, GPT Image 1.5 (high) с 1,310, MAI-Image-2.5 с 1,304 и Nano Banana Pro с 1,296.
• Редактирование: № 1 — 1 272 Elo, ~6 100 образцов
• Текст-в-изображение: № 7 — 1 292 Elo, ~11 500 образцов
• Отрыв от №2 по редактированию: 10 Elo выше Reve 2.1
• Отставание от № 1 по текстовой генерации изображений: 77 Elo ниже GPT Image 2 (высокая)
Что делает позицию в рейтинге редактирования более ценной, чем просто цифра для тщеславия, — это механизм. Арена Artificial Analysis — это слепое человеческое предпочтение: участники видят одно и то же входное изображение и инструкцию, получают два отредактированных результата и выбирают более сильный. Никакой скрипт вендора не пишет счёт. Поэтому #1 там — это самое близкое к тому, что рынок называет «результат этого редактора понравился людям больше всего» — и это недавний подъём, а не всплеск в день запуска. Относитесь к направлению как к надёжному, а к точному Эло — как к предварительному; доски с низким числом голосов двигаются.

Таблица text-to-image, зафиксированная в тот же день, показывает ту же модель в ином свете — она уже не лидирует, но по-прежнему уверенно входит в десятку лучших среди участников, чьи результаты плотно сгруппированы в диапазоне от 1290 до 1370 Elo.

Что такое MAI-Image-2.5-Pro на самом деле
MAI-Image-2.5-Pro — это качественный уровень Microsoft AI в семействе MAI-Image-2.5, анонсированный 23 июля 2026 года вместе с MAI-Voice-2-Flash и размещённый в публичной предварительной версии на Microsoft Foundry (Azure AI Foundry) и в бесплатном MAI Playground. Microsoft описывает его как свою самую точную модель генерации изображений на сегодняшний день, предназначенную для героических изображений, детального редактирования и точного рендеринга текста в изображениях. Семейство теперь покрывает всю кривую затрат: MAI-Image-2.5 для сбалансированной работы, MAI-Image-2.5-Flash для больших объёмов и уровень Pro на качественном конце — с более новой версией, MAI-Image-2.6, уже доступной в частной предварительной версии по состоянию на 19 августа.
Собственные заявления Microsoft о тарифе Pro — все они исходят от вендора, и ни одно из них еще не было независимо воспроизведено:
• 96.8% точность рендеринга текста — указано как охватывающее китайский, английский, японский, корейский и испанский языки, хотя та же документация ограничивает вывод примерно одним мегапикселем, поэтому формулировку «8K» в заявлении лучше рассматривать как маркетинг.
• на 27% лучше следует промпту, чем GPT-Image-1.5, по внутренним оценкам Microsoft.
• 94% согласованность персонажа на нескольких изображениях между генерациями.
• До 84–89% ниже затраты на GPU по сравнению с моделями GPT в конкретных сценариях Microsoft (PowerPoint, OneDrive), а не общее число.
Документированная спецификация обосновывает эти утверждения: ввод текста до 32,000 токенов, контекстное окно 131k, вывод 4,096 токенов, ввод изображений JPEG/PNG, а вывод ограничен 1,048,576 пикселей (эквивалент 1024×1024). Это последнее число важно для покупателей: это высококачественный редактор, а не генератор с разрешением для печати.
Где проявляется качество
Сила редактирования, которую измеряет таблица лидеров, совпадает с тем, что подчёркивает Microsoft: точные, хирургические правки, сохраняющие остальное изображение консистентным. Целевая замена объектов, изменения композиции, обновление текста внутри изображения и очистка артефактов вроде смаза движения — класс правок, при котором старые модели регенерируют всю сцену и теряют объект. Объедините это с заявлением о 94% консистентности персонажа — и вы получите модель, созданную для коммерчески важного рабочего процесса: возьмите существующий ассет, измените одну деталь, сдавайте его.
Ранг #7 в области текст-в-изображение — это честный противовес. При пустом промпте MAI-Image-2.5-Pro хорош, но не лидер: отставание в 77 Elo от GPT Image 2 (high) — это реальный разрыв на слепой доске. Microsoft в настоящее время не претендует на корону текст-в-изображение; она претендует на корону редактирования, и данные подтверждают более узкое утверждение гораздо лучше, чем более широкое.
Сколько это стоит
MAI-Image-2.5-Pro тарифицируется по токенам на Foundry: $5 за миллион входных текстовых токенов, $8 за миллион входных токенов для изображений, $106 за миллион выходных токенов для изображений. Microsoft не публикует количество токенов на изображение, поэтому стоимость одного изображения — это арифметический расчёт, а не официальная цена; используя пересчёт Artificial Analysis, изображение 1024×1024 обходится примерно в $108.50 за 1 000 изображений. Это примерно в 2,3 раза больше, чем у родственной MAI-Image-2.5 (~$48 за 1 тыс.), и в 5,4 раза больше, чем у MAI-Image-2.5-Flash (~$20 за 1 тыс.) — уровень Pro намеренно премиальный.
Цены предварительной версии — это не цены GA; предварительный прайс-лист может измениться до выхода общедоступной версии. Когда это происходит, снижение цены доходит до вашего счёта в тот же день благодаря сквозному маршрутизирующему слою: на OrcaRouter цена провайдера по прайс-листу передаётся с нулевой наценкой, поэтому как только MAI-Image-2.5-Pro становится доступен через вызываемый сторонний API, вы платите ровно столько, сколько берёт Microsoft, — без пересмотра условий и без второго контракта.

Почему #1 принадлежит компании Microsoft, а не просто модели
Результат в лидерборде появляется в тот момент, когда Microsoft наглядно заменяет сторонние модели генерации изображений собственными. MAI-Image-2.5 уже является движком по умолчанию в Bing Image Creator и работает в PowerPoint, OneDrive и Dynamics 365 Contact Center; уровень Pro — то же семейство, нацеленное на работу с более высокой точностью. Microsoft сообщила, что модели MAI обучаются на чистых, прослеживаемых данных «без дистилляции из сторонних моделей» — это прямой ответ на вопрос о зависимости от OpenAI, а заявления о стоимости (до 84% снижения затрат на GPU в PowerPoint, по данным поставщика, применительно к конкретным сценариям) — часть той же истории: собственная модель, которая дешевле в расчете на задачу, чем модель, которую она заменяет.
Скептически настроенному покупателю ничто из этого нельзя было бы доказать без независимого рейтинга, поэтому первое место стратегически значимо, а не просто оценка. Это первое независимое доказательство того, что собственная линейка изображений Microsoft превосходит конкурентов в конкретной задаче, для которой она создана.
Что посмотреть дальше
• Удержится ли лидерство по правкам по мере поступления голосов? 1 272 Elo на ~6 100 образцах — преимущество, а не гарантия; Reve 2.1 отстаёт на 10 очков.
• Общая доступность и итоговая тарифная сетка — цена предварительной версии не равна цене GA.
• Потолок разрешения. Ограничение в 1 мегапиксель не позволяет Pro заниматься печатными работами; если Microsoft уберёт его, ситуация изменится.
• MAI-Image-2.6 (приватное превью, 19 августа) — следующий шаг семейства, занимающий 2-е место среди моделей «текст-в-изображение» на другой основной арене.
• Независимые оценки заявлений вендора — точность отображения текста и согласованность символов не проверены вне Microsoft.
Вывод из разделённого рейтинга не в том, что «Microsoft теперь создаёт лучшую модель генерации изображений». Он более узкий и более полезный: Microsoft теперь создаёт лучший по оценкам редактор изображений в независимом рейтинге — по премиальной цене, в предварительной версии, с жёстким ограничением разрешения. Если ваша работа — изменение существующих изображений — главные кадры, визуалы продуктов, текст на изображениях — это именно та модель, за которой стоит следить. Если ваша работа — генерация с чистого листа, 7-е место говорит, что лучший выбор по-прежнему — GPT Image 2, и именно такое честное прочтение дают вам оба числа.
