
GPT-Image-2 против Flux 3: сравнение действующей модели с дорожной картой
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Это не обычный пост о сравнении моделей, потому что GPT-Image-2 и Flux 3 находятся на разных стадиях существования. GPT-Image-2, выпущенная 21 апреля 2026 года, доступна для вызовов через API OpenAI с начала мая, а на этой неделе приобрела новую возможность — генерацию изображений с прозрачным фоном в API, анонсированную 20 августа и доступную сейчас. Flux 3 — это мультимодальная базовая модель Black Forest Labs, анонсированная 23 июля 2026 года, и у её подсистемы изображений до сих пор нет публичной конечной точки, идентификатора модели и прайс-карты на момент написания. Одну из них можно вызвать в три часа ночи с действующим ключом; для другой можно записаться в лист ожидания. Поэтому полезное сравнение — не «что лучше», а то, что выпущенная модель реально делает сегодня, что дорожная карта обещает для невыпущенной, и как разработчику следует относиться к обещанной модели, сроки которой постоянно сдвигаются, пока живая продолжает улучшаться.
Один из них имеет конечную точку.
Начнём с доступности, потому что она определяет всё остальное. Black Forest Labs представила Flux 3 23 июля как единую модель, обученную совместно на предсказании изображений, видео, аудио и действий робота и построенную на основе подхода flow matching, который лаборатория называет Self-Flow. Как сообщается, более 95% вычислительных мощностей, затраченных на обучение, пришлось на предсказание видео, и результат этого виден в реально выпущенном продукте: общей доступности достиг лишь Flux 3 Video — 4 августа, с платным API. Страница модели для изображений до сих пор помечена «скоро» и содержит форму заявки, а не кнопку «Начать работу» — ни эндпоинта, ни документированных параметров, ни цены за изображение, ни бенчмарка, который можно запустить.
GPT-Image-2, напротив, находится в продакшене уже четыре месяца. OpenAI открыл доступ к API в начале мая, и идентификатор модели, gpt-image-2, достаточно стабилен, чтобы с ним сосуществовал закреплённый снапшот, gpt-image-2-2026-04-21. Это текущая модель номер один для генерации изображений из текста на обеих крупных независимых площадках — 1 381 Elo в text-to-image лидерборде Arena (средняя сборка) и 1 369 Elo для высокой сборки на Artificial Analysis — а также она рендерит многоязычный текст, включая CJK, привязывает генерацию к веб-поиску и выдаёт изображения разрешением до 4K. Четыре месяца продакшен-трафика — это разница между заявлением и послужным списком.
Недавнее изменение на стороне GPT-Image-2
Событие, которое делает это сравнение своевременным, не имеет отношения к Flux 3. 20 августа OpenAI открыла предварительный просмотр с прозрачным фоном для GPT-Image-2 в Images API: установите для параметра background значение "transparent", и конечная точка вернёт PNG или WebP с настоящим альфа-каналом, вырезанным и готовым к композитингу. Это функция, направленная прямо на ту производственную работу, которую также обещает в своей дорожной карте модель изображений Flux 3 — предметная съёмка, иконки, маркетинговые материалы, — и она появилась как параметр в уже работающей конечной точке, а не в составе новой модели. Так что, пока мир ждёт конечную точку изображений Flux 3, которая всё ещё говорит «скоро», действующий игрок только что закрыл один из недостатков, из-за которого его не использовали в пайплайнах композитинга.
Возможность доступна только через API — переключателя ChatGPT нет — и это параметр, а не новый продукт. Обе конечные точки Images API, генерация и редактирование, принимают поле background со значениями "transparent", "opaque" и "auto" (по умолчанию, когда модель решает сама). Альфа-канал сохраняется только в выводе PNG или WebP, поэтому запрос явно задаёт формат вывода. В справочнике API OpenAI поддержка прозрачности для gpt-image-2 и его снимка gpt-image-2-2026-04-21 по-прежнему помечена как «in preview» — это ярлык вендора, а не объявление о выходе из беты — и рекомендуется формулировать запрос без какого-либо описанного фона, чтобы модель действительно выполнила запрос на прозрачность. Ни новой конечной точки, ни нового ID модели, ни отдельного прайс-листа: тот же вызов gpt-image-2, который возвращал непрозрачный PNG, теперь возвращает вырезанное изображение.

Что обещает Flux 3, и что на самом деле поставляется
Уровень изображений Flux 3 в спецификации — это дорожная карта вендора, так что относитесь к ней соответственно. Black Forest Labs пообещала синтез и редактирование изображений в разных стилях и разрешениях, улучшенную обработку сложных промптов, высокоточный многоязычный рендеринг текста, перенос стиля zero-shot по референсным изображениям, консистентность персонажей и бренда без дообучения, а также недеструктивное редактирование, сохраняющее текстуру и освещение. Это правильные обещания — именно те функции, за которые конкурируют нынешние лидеры рынка, — но ни одна из них сегодня не проверяема, потому что ни у одной нет эндпоинта.
Что на самом деле доступно через BFL — это видеомодели и старая линейка изображений FLUX. Flux 3 Video стоит $0,17 за секунду в HD и $0,29 за секунду в FHD для полного рендеринга, плюс черновой режим по $0,06 за секунду. Заявленные самой BFL показатели — 1135 Elo для text-to-video и 1051 для image-to-video, а также победы по предпочтениям над Luma Ray 3.2, Runway Gen-4.5, Grok Imagine Video и Kling v3 Pro. Всё это заявлено производителем, не воспроизведено независимо и к линейке изображений в любом случае не относится. Что касается статичных изображений, текущее предложение BFL — это по-прежнему линейка FLUX.2, которая занимает 1226 Elo в том же рейтинге Artificial Analysis, где GPT-Image-2 лидирует с 1369 Elo. Этот разрыв и есть практический контекст фразы «Flux 3 image is coming»: сегодняшний API изображений BFL отстаёт от API OpenAI примерно на 140 Elo, и именно обещанная модель нужна BFL, чтобы закрыть этот разрыв.

Цены: существует только одна настоящая ценовая карточка.
Цены на изображения Flux 3 нет, потому что продукта Flux 3 для изображений не существует. Единственные опубликованные цифры — это тарифы GPT-Image-2: $5 за миллион входных текстовых токенов, $8 за миллион входных токенов изображений и $30 за миллион выходных токенов изображений, при этом Batch API стоит примерно вдвое дешевле при обработке до 24 часов. OpenAI не публикует количество токенов на изображение, поэтому цифры в пересчёте на одно изображение — это конверсия, а не расценки: примерно $0.006 за изображение 1024×1024 низкого качества, около $0.05 за среднее, около $0.21 за высокое качество и до примерно $0.41 за рендеринг 4K. Для сравнения: это та сторона баланса, которая реальна; колонка изображений Flux 3 — пустая ячейка.

Что должен делать строитель с обещанной моделью
Разумная позиция, когда модель конкурента постоянно задерживается, — строить на том, что уже существует, и превращать будущее в изменение конфигурации, а не в перестройку архитектуры. GPT-Image-2 уже сегодня можно направлять через OrcaRouter — один API-ключ, цена OpenAI по прайс-листу без наценки, автоматическое переключение между провайдерами — поэтому конвейер генерации ассетов на этой модели сможет позже направить тот же endpoint на API Flux 3 image в тот день, когда endpoint действительно появится, и направлять на него часть трафика с помощью routing DSL, не трогая вызывающий код. Вы получаете выпущенную модель сейчас, а когда обещанная выйдет, вы оцениваете её по рабочему эталону, а не по пресс-релизу. Ожидание вам ничего не стоит; строить на пустоте, пока вы ждёте, стоит вам всего.
Вердикт намеренно однобок. Если вам нужна генерация изображений в этом квартале, GPT-Image-2 — очевидный выбор, и второй вопрос не возникает: это независимый номер один, он только что добавил в API вывод изображений с прозрачным фоном, а ещё у него публичный API и стабильная цена. Flux 3 image — повод следить за Black Forest Labs, а не повод приостанавливать проект. Следите за открытием раннего доступа и первыми независимыми бенчмарками; как только появится эндпоинт, сравнение из этого поста станет тестом, который вы действительно сможете запустить.
