Сгенерированная hero-карточка для статьи «Qwen-Image 2.1 против Qwen-Image 3.0», показывающая две скруглённые карточки моделей с подписями «Qwen-Image 2.1» и «Qwen-Image 3.0», маркерами дат 20 сентября 2026 г. и 21 июля 2026 г., значком скачивания на одной и значком облака на другой, а также ленту с надписью «Меньшее число — более новая модель».
Guides & Insights

Qwen-Image 2.1 против Qwen-Image 3.0: меньшее число — это более новая модель

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Начнём с того, что сбивает с толку всех. Qwen-Image 2.1 новее, чем Qwen-Image 3.0. Вендор выпустил Qwen-Image 3.0 21 июля 2026 года и довёл её до общего доступа 5 августа. Qwen-Image 2.1 он выпустил 20 сентября 2026 года — семь недель спустя и на одну минорную версию ниже. Эта нумерация — не последовательность; это две разные продуктовые линейки, носящие одно имя, и самый полезный факт о любой из них состоит в том, что они занимают противоположные позиции по вопросу, который определяет, можно ли на них строить. Qwen-Image 3.0 — закрытая и размещённая у вендора, без весов, без лицензии и без технического отчёта. Qwen-Image 2.1 — открытые веса, доступна для скачивания уже сегодня, по исследовательской лицензии, допускающей только некоммерческое использование.

Два продукта, которые случайно имеют одно и то же название

Семейство Qwen-Image за четырнадцать месяцев заняло уже три разные позиции по лицензированию, и их изложение устраняет большую часть путаницы:

Qwen-Image 1.0 и 2.0 — открытые веса под лицензией Apache 2.0 на Hugging Face и ModelScope, технические отчёты в день запуска, с возможностью самостоятельного развёртывания, дообучения и квантования.

Qwen-Image 3.0 — закрытая. Ни весов, ни указанной лицензии, ни карточки модели, ни технического отчёта, ни опубликованной таблицы бенчмарков. Доступна только через размещённый API, в редакциях Pro и Standard.

Qwen-Image 2.1 — снова открытые веса, но уже под Лицензионным соглашением Qwen Research от 20 сентября 2026 года, которое предоставляет права «ТОЛЬКО ДЛЯ НЕКОММЕРЧЕСКИХ ЦЕЛЕЙ» и предусматривает для коммерческого использования отдельно согласуемую лицензию.

Если читать это как закономерность, а не как хронологию, форма ясна: Alibaba больше не рассматривает «открытость» как бинарную категорию. Qwen-Image 2.1 — это ни разрешительный релиз, какими были 1.0 и 2.0, ни закрытый релиз, каким был 3.0. Это третья позиция: веса, которые можно изучить, запустить и изменить, а спереди к ним прикручен коммерческий шлюз.

Что на самом деле представляет собой каждая модель

Qwen-Image 2.1 — унифицированная модель генерации изображений по тексту и редактирования изображений с 7 млрд параметров в компоненте визуальной генерации, построенная как 32-слойный однопоточный DiT. Рядом с ней находятся текстовый энкодер Qwen3-VL 8B и 64-канальный RGBA VAE с 16-кратным пространственным сжатием; полный объём загрузки составляет примерно 33 ГБ, причём на текстовый энкодер приходится более половины. Блочно-каузальное внимание с каузальной маской на уровне токенов для текста и двунаправленной маской на уровне чанков для генерации изображений, а также повторное использование префиксного KV-кэша для редактирования нескольких изображений. Нативное 2K, по умолчанию 2048×2048 при 40 шагах, с семью пресетами соотношения сторон.

Qwen-Image 3.0 — закрытая облачная модель в редакциях Pro и Standard, обеспечивающая генерацию и редактирование изображений через единый API. В материалах запуска Alibaba утверждается, что промпты могут достигать примерно 4 500 токенов, разборчивый текст — вплоть до примерно 10 пикселей, а поддержка охватывает 12 языков и более 20 шрифтов, при выводе до 2048×2048 и до шести изображений за один вызов. Количество параметров не публиковалось; широко повторяемая цифра ~20 млрд для MMDiT приводится как сообщение, а не как подтверждённый факт.

Самое важное на практике архитектурное различие — не размер, а то, где работает модель и что вы можете с ней сделать. Qwen-Image 2.1 поставляется в виде файлов, которые можно изучить, квантовать, дообучить на приватных данных и запустить на собственном оборудовании, причём пул-реквест с поддержкой SGLang был влит за три дня до того, как веса вообще появились. Qwen-Image 3.0 поставляется в виде эндпоинта. Вы не можете его квантовать, не можете дообучить и не можете запустить нигде, кроме как там, где его запускает Alibaba.

Редактирование — вот где эти двое расходятся сильнее всего.

Обе модели выполняют генерацию и редактирование в рамках одной системы, поэтому самое интересное сравнение — в особенностях редактирования, и здесь более новая и компактная модель на бумаге выглядит более способной.

Референсные изображения — Qwen-Image 2.1 принимает до 10 входных референсов. В документации к Pro-версии Qwen-Image 3.0 описана поддержка 1–3 входных изображений.

Локальный контроль правок — Qwen-Image 2.1 поддерживает круги, нарисованные пометки и отдельную маску, подаваемую как самостоятельный вход, благодаря чему исходное изображение остаётся без пометок. Документированный путь редактирования Qwen-Image 3.0 охватывает локальное переписывание, расширение содержимого, перенос стиля и генерацию с нескольких ракурсов камеры, но без опубликованного рабочего процесса на основе маски.

Прозрачность — Qwen-Image 2.1 нативно генерирует и редактирует RGBA-изображения, редактирует текст внутри прозрачного слоя и извлекает объект с RGB-фотографии в прозрачный слой. В анонсе Qwen-Image 3.0 нет никаких заявлений о прозрачности.

Переписывание промптов — Qwen-Image 2.1 поставляется с двумя специализированными чекпоинтами переписывания, оба — дообученные модели Qwen3.5-VL 9B: один для генерации изображений по тексту, другой для редактирования, при этом код переписывания и системный промпт опубликованы. Обработка промптов в Qwen-Image 3.0 — чёрный ящик за API.

Экосистема — Qwen-Image 2.1 получила поддержку с первого дня в Diffusers, ComfyUI, vLLM-Omni, SGLang и LightX2V, а также пути AMD ROCm и FlagOS. У Qwen-Image 3.0 есть API.

Эта последняя строка — не риторическое украшение. Для команды, у которой пайплайн живёт в ComfyUI или стек инференса — vLLM, разница между моделью с влитым классом пайплайна и моделью с HTTP-эндпоинтом — это разница между задачей интеграции и переписыванием.

A generated two-column comparison scoreboard titled 'Qwen-Image 2.1 vs Qwen-Image 3.0 — the scoreboard'. Left column 'Qwen-Image 2.1': rows reading Released: 20 Sep 2026; Licence: research, non-commercial; Access: 33 GB open download; Reference images: up to 10; Transparency: native RGBA; Published price: none. Right column 'Qwen-Image 3.0': rows reading Released: 21 Jul 2026, GA 5 Aug; Licence: not published; Access: closed hosted API; Reference images: 1 to 3; Transparency: none claimed; Published price: ~$0.04 Pro, $0.03 Std. Footer reads 'Qwen-Image 2.1 specs per vendor model card, unaudited; Qwen-Image 3.0 pricing is vendor list, unaudited.'

Цена и то, что цена не отражает

Из этих двух только у Qwen-Image 3.0 опубликована цена: в облаке поставщика Pro указан примерно за $0,04 за изображение, а Standard — около $0,03, при этом цены для потребителей на внутреннем рынке начинаются примерно от ¥0,18. Это стартовые цифры, и они не проходили независимый аудит. У Qwen-Image 2.1 вообще нет опубликованного тарифа на хостинг — это скачиваемая модель, и её стоимость равна тому, во сколько вам обходится собственное время работы GPU.

Эти две строки несопоставимы, и делать вид, что это не так, — самая распространённая ошибка в этом сравнении. Цена за изображение покрывает модель, инфраструктуру обслуживания, масштабирование и чей-то аптайм. Скачивание весов не покрывает ничего из этого. Правильный вопрос не в том, какое число меньше; а в том, есть ли у вас операционные возможности для запуска стека моделей на 33 ГБ и позволяет ли лицензия на дешёвой стороне делать то, что вы планируете с ним делать.

Что возвращает лицензию в центр сравнения — туда, где ей и место. Условия Qwen-Image 3.0 не опубликованы, и это само по себе проблема для работы в регулируемых сферах или в агентствах — нет документа, на который можно сослаться. Условия Qwen-Image 2.1опубликованы, и в них сказано: некоммерческое использование. Когда выбор стоит между неясной лицензией и явно ограничительной, явно ограничительная проще для планирования, потому что по крайней мере понятно, о чём именно нужно вести разговор.

A screenshot of the Qwen vendor blog page for Qwen-Image 3.0, captured September 20 2026, showing the launch announcement, the Pro and Standard edition descriptions, the claimed prompt-length and text-rendering figures, and the per-image list pricing.

К какому из них вам стоит обратиться

Вам нужны насыщенные текстом изображения для продакшена, и вы хотите, чтобы этим занимался кто-то другой — Qwen-Image 3.0 подходит, с оговоркой, что его ключевые показатели рендеринга текста — это заявления производителя, а существующее независимое тестирование описывает, что мелкий текст в некоторых случаях всё ещё искажается.

Вам нужно запускать модель самостоятельно, дообучать её или хранить данные на собственном оборудовании — Qwen-Image 2.1 — единственный вариант из этих двух, и исследовательская лицензия — это плата за вход.

Вам нужны прозрачные ассеты, вырезанные изображения товаров или более трёх референсных изображений — Qwen-Image 2.1, судя по опубликованным спецификациям, является более сильным инструментом, и по количеству референсов он вне конкуренции.

Вам нужны коммерческие права и разрешительное лицензирование — ни то, ни другое не относится к вашей модели. У Qwen-Image 3.0 вообще нет опубликованных условий, а Qwen-Image 2.1 требует согласованной коммерческой лицензии. Релизы под Apache-2.0 в этом семействе — это более ранние Qwen-Image 1.0 и 2.0.

Именно на последней строке стоит задержаться, потому что она описывает сокращающееся множество. Уже выданная лицензия не меняется задним числом, поэтому релизы Qwen-Image под Apache-2.0 остаются доступными на своих первоначальных условиях. Но если вы планируете коммерческий конвейер обработки изображений, исходя из предположения, что новейший Qwen-Image будет под разрешительной лицензией, последние три релиза свидетельствуют против этого предположения.

Запускать любой из них, не ставя на это весь пайплайн

Обе эти модели по разным причинам сегодня неудобно ставить за продакшн-маршрут — одну из-за лицензии, другую из-за чёрного ящика и неопубликованного количества параметров. Именно для такой ситуации и создаётся слой маршрутизации. OrcaRouter предоставляет доступ к более чем 200 моделям через единый эндпоинт, совместимый с OpenAI, по каталожной цене провайдера без наценки, с автоматическим переключением при сбое между провайдерами и DSL маршрутизации, который позволяет объединять несколько моделей в один вызов, так что новая или неудобная модель может стоять рядом с проверенной, а не перед ней. Объединение моделей (model fusion) идёт ещё дальше: запускается панель моделей одновременно, и вы можете сравнивать их на собственных запросах, а не на графике с презентации.

Ни Qwen-Image 2.1, ни Qwen-Image 3.0 не входят в число моделей, которые мы маршрутизируем сегодня, и эта статья не будет утверждать обратное. Модели изображений, которые мы действительно маршрутизируем — линейка GPT-Image от OpenAI, уровни Imagen 4 и предварительные версии изображений Gemini от Google, а также эндпоинт изображений Grok Imagine от xAI — это то, из чего на самом деле будет построен путь аварийного переключения, пока вы оцениваете пару Qwen по своим собственным критериям.

То, за чем стоит следить, — более узкая задача, чем кажется. Alibaba уже продемонстрировала, что в одном и том же квартале в рамках одного семейства выпустит открытые веса, закрытые хостируемые модели и загрузки по исследовательской лицензии. Следующий релиз не скажет, какая схема победила. А файл лицензии скажет.

A screenshot of the Qwen vendor blog page for Qwen-Image 2.1, captured September 20 2026, showing the 2026/09/20 date, the headline 'Compact, Efficient, and Unified Image Creation', the 'Now open weights' hero banner, GitHub, Hugging Face and ModelScope buttons, and the 7B parameter figure.