Hero-карточка для противостояния между MAI-Image-2.5-Pro, доступной в предварительной версии на Microsoft Foundry, и Flux 3 — мультимодальной базовой моделью Black Forest Labs, чей уровень генерации изображений ещё не выпущен.
Guides & Insights

MAI-Image-2.5-Pro против Flux 3: одна неделя запуска — две разные реальности

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

MAI-Image-2.5-Pro и Flux 3 были анонсированы в одну и ту же неделю — 23 июля 2026 года. Месяц спустя они занимают разные вселенные. MAI-Image-2.5-Pro, качественная модель изображений от Microsoft, находится в публичном предварительном доступе на Microsoft Foundry и поднялась до № 1 на Artificial Analysis Image Editing Arena (Elo 1,272 по результатам ~6,100 анонимных голосов). Flux 3, объединённая мультимодальная базовая модель Black Forest Labs, выпустила ровно один из своих уровней — видео — а её уровень изображений не имеет ни публичной конечной точки, ни цены, ни бенчмарков, которые можно запустить. Читатель, спрашивающий «какую модель изображений мне использовать», не видит здесь двух кандидатов; у него есть один продукт и одно обещание.

Что каждый из них на самом деле из себя представляет

MAI-Image-2.5-Pro — специализированная проприетарная модель генерации и редактирования изображений, самая точная модель в собственном семействе Microsoft MAI-Image-2.5. Тарифицируется по токенам, размещена на Foundry, ориентирована на главные изображения, детальное редактирование и рендеринг текста внутри изображений. Это вся модель: изображения.

Flux 3единая мультимодальная фундаментальная модель, обученная совместно на изображениях, видео и аудио (а также на прогнозировании действий робота), построенная на методе flow-matching, который BFL называет Self-Flow. Было анонсировано пять вариантов: Flux 3 Video, Flux 3 Image, Flux 3 Action, Flux-mimic для робототехники и Flux 3 Dev (открытые веса планируются позднее в 2026 году). Изображение — это одна модальность в рамках более крупной ставки, а не сам продукт.

Это структурное различие важнее любых спецификаций. Специализированная модель изображений направляет весь свой потенциал на статические изображения; мультимодальная модель распределяет потенциал между разными медиа. MAI-Image-2.5-Pro существует, чтобы побеждать в редактировании изображений. Flux 3 существует, чтобы быть одной моделью, которая делает всё, и её уровень обработки изображений — та часть этого видения, которая ещё не реализована.

Наличие: всё сравнение

По состоянию на середину августа 2026 года асимметрия абсолютна:

MAI-Image-2.5-Pro — публичная предварительная версия в Azure AI Foundry в семи глобальных регионах, плюс бесплатный MAI Playground. Вы можете использовать её уже сегодня с учётной записью Microsoft; это уже качественный уровень семейства, которое обеспечивает работу Bing Image Creator, PowerPoint и OneDrive.

Flux 3 Image — не выпущен. В документации BFL нет эндпоинта для изображений; текущая линейка изображений, доступных для вызова, остаётся FLUX.2 (Pro, Dev, Flex, Klein). На странице Flux 3 стоит пометка «скоро» с формой заявки, а не кнопкой начала работы. BFL сообщила, что ранний доступ к изображениям откроется «в ближайшие недели» после анонса 23 июля; на данный момент не опубликовано ни идентификатора модели, ни спецификаций изображений, ни лимита промптов. В общий доступ вышел только Flux 3 Video (4 августа, посекундная тарификация).

Итак, практический ответ на вопрос «на чём сегодня можно строить редактирование изображений» содержит ровно одно название.

Доказательства, которые каждая сторона может представить.

Сила редактирования MAI-Image-2.5-Pro измеряется независимо. Помимо первого места по Elo в редактировании, его рейтинг text-to-image составляет 7-е место с 1292 Elo — хорошо, но не лидер — таково честное прочтение специализированной модели. Microsoft также публикует заявленные вендором показатели: 96,8% точности рендеринга текста (отмечено как охватывающее пять языков), на 27% лучшее следование промптам, чем у GPT Image 1.5, по внутренним оценкам, и 94% согласованности персонажей на нескольких изображениях. Помечайте все это как собственные цифры Microsoft; лидерборд — независимая часть.

У Flux 3 Image нет никаких публичных доказательств. Бенчмарков по изображениям не существует, поскольку нет эндпоинта для их тестирования. Единственные цифры, которые сообщает BFL в этом семействе, относятся к Flux 3 Video — внутренний Elo 1135 для text-to-video и 1051 для image-to-video, которые, по заявлению BFL, превосходят Omni Flash, H3 и Seedance 2.0, — но они предоставлены производителем, не воспроизведены независимо и в любом случае не переносятся на уровень изображений. Всё, что вы читаете о «бенчмарках» качества изображений Flux 3, — это экстраполяция либо из видеопоказателей, либо из более старой линейки FLUX.2.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 ahead of Reve 2.1, MAI-Image-2.5, and GPT Image 2Comparison scoreboard for MAI-Image-2.5-Pro and Flux 3: availability in preview on Microsoft Foundry versus image tier unreleased; image editing rank No. 1 at 1,272 Elo versus no image benchmarks; scope focused image model versus unified multimodal; text rendering 96.8% claimed versus roadmap claim of multilingual accuracy; price USD 108.50 per 1k versus no image price published; callable today versus coming soon

Что обещает Flux 3 в отношении изображений (дорожная карта вендора, а не спецификация)

Заявления из дорожной карты BFL касательно уровня изображений стоит знать точно именно потому, что это утверждения:

• Синтез и редактирование изображений в различных стилях, соотношениях сторон и разрешениях

• Улучшена обработка сложных промптов и повышена точность многоязычного рендеринга текста

• Перенос стиля zero-shot с эталонного изображения, с объединением нескольких стилевых эталонов за один проход

• Согласованность персонажа и бренда между поколениями без тонкой настройки

• Неразрушающее редактирование — сохранение текстур, зернистости, освещения и фона, чтобы многоэтапные правки не приводили к ухудшению качества

Последнее утверждение — самое интересное: это то же свойство «редактирование без перегенерации сцены», которое дизайн хирургического редактирования MAI-Image-2.5-Pro уже реализует и получает за него высокие оценки. Если Flux 3 Image действительно обеспечит это, он будет напрямую конкурировать с тем, что MAI-Image-2.5-Pro уже делает. «Если» — ключевое слово: всё в этом списке остаётся непроверенным, пока не появится endpoint.

Стоимость

MAI-Image-2.5-Pro — $5 за миллион входных текстовых токенов, $8 за миллион входных токенов изображений, $106 за миллион выходных токенов изображений. По расчётам Artificial Analysis, изображение 1024×1024 стоит около $108.50 за 1000. Предварительные цены; GA может их изменить.

Flux 3 Image — цены не существует, потому что не существует эндпоинта. Единственные опубликованные цены Flux 3 — для видео: $0.17/сек (HD) и $0.29/сек (FHD) за полные рендеры. Для справки: в доступной для вызова линейке изображений FLUX.2 BFL взимает примерно $0.04 за изображение для Flux Pro и $0.015 для Flux Dev — но это предыдущее поколение, а не прогноз.

Нельзя сравнивать цену с пустой строкой. Сегодняшнее сравнение стоимости — это премиальная ставка MAI-Image-2.5-Pro против ничего вообще.

Screenshot of Microsoft's announcement of MAI-Image-2.5-Pro and MAI-Voice-2-Flash, showing the preview launch and positioning as Microsoft's highest-fidelity image model

Что взять за основу

Если ваш конечный результат в 2026 году — изображения, ответ — MAI-Image-2.5-Pro (или один из других облачных редакторов — GPT Image 2 по-прежнему лидирует в text-to-image и на другой основной доске лидеров по редактированию). Он доступен по API, у него независимая оценка #1 по редактированию, а ограничение разрешения около мегапикселя — главное, что нужно сверить с вашим сценарием использования. Flux 3 — на заметку: когда выйдет его уровень для изображений, его заявления о неразрушающем редактировании и консистентности бренда заслуживают серьёзной проверки именно против той модели, которую Microsoft сейчас ставит на #1.

Есть также способ думать об этом ожидании через призму маршрутизации. Когда у Flux 3 Image наконец появится эндпоинт, низкорисковый способ внедрения совершенно новой модели без бенчмарков — направить на нее часть трафика, оставив проверенную модель в качестве автоматического фейловера: один эндпоинт, цены провайдера передаются без наценки, и непроверенная модель доказывает себя на живом трафике, а не на слайде дорожной карты. Это паттерн, ради которого существует OrcaRouter, и это же паттерн делает модели превью-уровня вроде MAI-Image-2.5-Pro пригодными для внедрения до выхода в общий доступ.

Вердикт

Обе вышли в одну неделю запуска, месяц спустя: MAI-Image-2.5-Pro — по результатам замеров #1 редактор, который можно вызывать уже сегодня, а Flux 3 — мультимодальная фундаментальная модель, чьи возможности в части изображений всё ещё остаются обещанием с дорожной картой. Сравнивать их по качеству изображений — всё равно что сравнивать боксёра с бойцом, который ещё не вышел на ринг. Используйте MAI-Image-2.5-Pro для работы с изображениями уже сейчас; держите Flux 3 Image в списке того, что стоит пересмотреть в тот день, когда его endpoint действительно появится.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube