Сгенерированная главная титульная карточка с заголовком «Qwen-Image-2.1 возглавляет обе Image Arenas», подзаголовком «Что скрывает ярлык №1 среди open-source», показывающая две карточки лидерборда с названиями Image Edit Arena — с чипом позиции «16 из 56» и чипом оценки «1367», и Text-to-Image Arena — с чипом позиции «17 из 79» и чипом оценки «1228», над меткой с надписью «лицензия qwen-research».
Guides & Insights

Qwen-Image-2.1 возглавляет обе арены изображений: что скрывает ярлык открытого исходного кода №1

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Команда, стоящая за Qwen-Image-2.1, поблагодарила Arena за признание, и признание это настоящее. Qwen-Image-2.1 — модель с наивысшим баллом на обеих досках изображений Arena, которые сами доски не помечают как Proprietary: 1 367 в Image Edit и 1 228 в Text-to-Image, по срезу от 22 сентября 2026 года. Каждая строка выше неё на обеих досках несёт тег Proprietary. Три факта, которых в объявлении нет, столь же проверяемы, как и само утверждение, — общий ранг, который обеспечивают эти баллы, флаг Preliminary, с которым выпускаются обе строки, и строку лицензии, гласящую qwen-research, а не Apache 2.0, как у её более ранних имиджевых моделей. Утверждение выдерживает контакт с досками. Просто оно говорит меньше, чем подразумевает заголовок.

Чтение двух плат бок о бок

Оценки Arena — это рейтинги в стиле Elo, построенные на слепых попарных голосованиях: человек видит два результата, не знает, какая модель создала какой, и выбирает. Это принципиально иной класс доказательств, чем вендорский бенчмарк, поэтому утверждение, опирающееся на него, стоит проверять, а не повторять. Обе таблицы были зафиксированы 22 сентября 2026 года, и обе были прочитаны строка за строкой, а не просмотрены по графику рейтинга.

A screenshot of the LMArena Image Edit Arena leaderboard, captured September 22 2026, showing the board header reading 29,902,508 votes and 56 models, with ranks 13 to 22 visible: gemini-3-pro-image-preview at 1385, reve-2.1 at 1375, gpt-image-1.5-high-fidelity at 1370, qwen-image-2.1 at rank 16 with 1367 and a confidence interval of plus or minus 9 and 4,841 votes marked Preliminary, reve-2.0 at 1358, uni-1.1-max at 1334, grok-imagine-image at 1329, uni-1.1 at 1315, gemini-3.1-flash-lite-image at 1314 and qwen-image-2.0-pro-2026-06-22 at 1304, with every row above qwen-image-2.1 labelled Proprietary.

В таблице Image Edit перечислены 56 моделей и 29 902 508 голосов. Qwen-Image-2.1 занимает 16-е место с оценкой 1 367, доверительным интервалом ±9 и 4 841 голосом. Пятнадцать строк над ней — от gpt-image-2.5-sunburst с 1 526 до gpt-image-1.5-high-fidelity с 1 370 — все Проприетарные. Две строки непосредственно под ней, reve-2.0 с 1 358 и uni-1.1-max с 1 334, — тоже.

A screenshot of the LMArena Text-to-Image Arena leaderboard, captured September 22 2026, showing the board header reading 6,258,152 votes and 79 models, with ranks 14 to 21 visible: gemini-3-pro-image-2k at 1246, gpt-image-1.5-high-fidelity at 1239, gemini-3-pro-image-preview at 1232, qwen-image-2.1 at rank 17 with 1228 and a confidence interval of plus or minus 11 and 2,843 votes marked Preliminary, ideogram-4.0-quality at 1204 labelled Ideogram Open Model, qwen-image-2.0-pro-2026-06-22 at 1191, uni-1.1-max at 1188 and mai-image-2 at 1183, with Proprietary labelling on every row above qwen-image-2.1.

В тот же день на лидерборде Text-to-Image указано 79 моделей и 6 258 152 голоса. Qwen-Image-2.1 занимает 17-е место с показателем 1 228, доверительным интервалом ±11 и 2 843 голосами. Та же закономерность: шестнадцать строк выше неё — Проприетарные, а первая непроприетарная строка ниже — ideogram-4.0-quality с 1 204, помеченная как Ideogram Open Model.

Две детали из этих строк стоит выделить, поскольку они противоречат тому, как обычно повторяется это утверждение.

Ранг и балл рассказывают разные истории — 1,367 — лучший результат среди моделей без метки Proprietary на доске редактирования изображений, и в то же время это шестнадцатое место: на 159 баллов позади лидера и на 3 балла отставая от пятнадцатого места.
На одной доске побеждает собственная закрытая модель Alibaba — qwen-image-3.0-pro с меткой Proprietary занимает 1,254 в Text-to-Image, на двадцать шесть баллов выше 1,228 у qwen-image-2.1. На доске редактирования открытая модель обходит более раннюю проприетарную qwen-image-2.0-pro-2026-06-22 с результатом 1,304. Флагман компании — это не одна и та же модель на обеих досках.
Разрыв до следующей открытой модели велик на одной доске и мал на другой — на Image Edit следующая строка без метки Proprietary — это hunyuan-image-3.0-instruct с 1,302, отставание в шестьдесят пять баллов; на Text-to-Image это ideogram-4.0-quality с 1,204, отставание в двадцать четыре балла.

Строка лицензии выполняет больше работы, чем ранжирование.

Каждая строка Arena содержит метку организации и лицензии. У Qwen-Image-2.1 указано Alibaba · qwen-research на обеих таблицах. Это не метка Apache 2.0 на более ранних графических моделях Alibaba: qwen-image-edit с 1 241 и qwen-image-edit-2511 с 1 235 на таблице редактирования обе помечены Apache 2.0, как и qwen-image-2512 с 1 125 и qwen-image с 1 057 на Text-to-Image. Пост в блоге поставщика замыкает тот же круг, публикуя веса по Qwen Research License Agreement от 20 сентября 2026 года, которая разрешает исследования и оценку, но не коммерческое использование.

Итак, честное прочтение «модели №1 с открытым исходным кодом» уже, чем звучит. В собственной двухчастной классификации самого рейтинга — проприетарная или нет — Qwen-Image-2.1 стоит первой. По определению открытого исходного кода от OSI, которое не допускает ограничений по области использования, она вовсе не является открытым исходным кодом, и большинство моделей, с которыми её сравнивают, тоже: в тех же рейтингах есть строки с метками flux-non-commercial-license, tencent-hunyuan-community, krea-2-community-license и Ideogram Open Model. Фильтр «Открытый исходный код» на Arena — это грубый переключатель между проприетарным и всем остальным. Он полезен. Но это не проверка лицензии.

Здесь это различие важнее, чем отрывы в два пункта, потому что это единственное, что не может измениться за ещё одну неделю голосования. Если вам сегодня нужна модель для работы с изображениями из этого семейства с разрешительной лицензией, то строки Apache 2.0 — это qwen-image-edit и qwen-image-edit-2511 — обе более старые, и обе более чем на сто двадцать пунктов ниже в том же рейтинге редактирования (1 241 и 1 235 против 1 367). Лучшая по оценкам Qwen-модель для изображений с открытой маркировкой и коммерчески пригодная Qwen-модель для изображений — это не один и тот же вариант для скачивания.

Предварительный означает, что число ещё может измениться.

Обе строки Qwen-Image-2.1 несут на таблице Предварительный маркер, который Arena присваивает, когда строка ещё не набрала достаточно голосов, чтобы её оценку можно было считать устоявшейся. Причина — сами числа голосов: 4 841 голос против 29 902 508 в целом по таблице Image Edit и 2 843 против 6 258 152 на Text-to-Image. Для сравнения, соседние строки несут куда больше: у gpt-image-1.5-high-fidelity 589 013 голосов на таблице редактирования, а у qwen-image-2.0-pro-2026-06-22 — 307 705 на таблице Text-to-Image.

Доверительные интервалы ±9 и ±11 для модели, которой три дня, — это не тревожный сигнал; именно так выглядит новый релиз. Но это действительно означает, что конкретный порядок на вершине открытого уровня может меняться по мере накопления голосов, особенно в Text-to-Image, где отрыв от следующей открытой строки составляет двадцать четыре пункта.

Что представляет собой модель по собственной спецификации поставщика

В собственном описании Alibaba говорится об унифицированной модели текст-в-изображение и редактирования с компонентом визуальной генерации на 7 млрд параметров, построенным из 32 слоёв Single-Stream DiT, нативной генерацией и редактированием прозрачных изображений, поддержкой до 10 референсных изображений и нативным потолком вывода 2048×2048 — полная загрузка пайплайна составляет примерно 33 ГБ. Поддержка прозрачности — наименее распространённый пункт в этом списке; не очевидно, что борд Arena по редактированию её измеряет, поэтому место в борде не является доказательством ни за, ни против этой конкретной возможности.

Основной бенчмарк вендора — Qwen-Image-Bench, где, как сообщается, модель набирает 60,28, опережая Nano Banana 2.0 с 59,82 и GPT Image 1.5 с 59,65. Это оценка, проведённая самим вендором, без независимого воспроизведения, а разрывы составляют менее одного пункта — разброс, который не выдержал бы смены набора промптов. Стоит прямо сказать: числа Arena выше — это голоса других людей, а числа Qwen-Image-Bench — собственные данные Alibaba. Это не один и тот же тип доказательств, и их не следует усреднять в одно впечатление о модели.

Поддержка развёртывания появилась вместе с релизом, а не после него: интеграции нулевого дня для модели уже существуют в ComfyUI, SGLang, vLLM-Omni, LightX2V и библиотеке Diffusers, а значит, практический вопрос для большинства команд — не в том, можно ли обслуживать модель, а в том, приемлема ли стоимость обслуживания.

Как будет воспринято такое утверждение, если вам на этой неделе нужен API для изображений

Здесь важно быть точными в отношении нашей собственной позиции. OrcaRouter не маршрутизирует Qwen-Image-2.1 или любую модель Qwen-Image любой версии. Если вас убедили оценки Arena, модель доступна через собственный API вендора и несколько сторонних платформ — или в виде загрузки для самостоятельного хостинга, — но не через нас. У нас нет маршрута к изображениям Qwen, который мы могли бы вам продать, и место в рейтинге — не причина делать вид, что это не так.

Что мы маршрутизируем — так это остальную часть уровня изображений, который ранжируют эти таблицы, и несколько строк выше Qwen-Image-2.1 входят в него. Доступны GPT-Image-2, GPT-Image-1.5 и GPT-Image-1-mini от OpenAI, а также уровни Imagen 4 от Google, эндпоинты предварительного просмотра изображений Gemini и эндпоинт изображений Grok Imagine от xAI. Такое сочетание — практический ответ на подобное утверждение. Если бы Arena сразу поставила открытую модель на первое место, переключение было бы изменением кода в одну строку с одним ключом. Arena этого не сделала — на вершине обеих таблиц находятся проприетарные модели, и интересное решение — между загрузкой по исследовательской лицензии и хостируемым эндпоинтом, который можно вызвать уже сегодня.

Для этого решения важны три свойства платформы. Маршрутизация работает через одну конечную точку, совместимую с OpenAI, для более чем 200 моделей, поэтому сравнение размещённых строк между собой не означает второго контракта или второго SDK. Каталожная цена провайдера передаётся без наценки, а значит, изменение цены поставщиком попадает в ваш счёт в тот же день, когда оно объявлено, а не при следующем продлении контракта. А автоматическое переключение при сбое между провайдерами означает, что новая модель с малым числом голосов может стоять за проверенной в цепочке резервирования, вместо того чтобы стать производственной зависимостью на третий день — а именно в этой точке сейчас находится Qwen-Image-2.1.

Утверждение верно — и оно тоньше, чем кажется при чтении.

То, что опубликовала Alibaba, поддаётся проверке: в срезе обеих таблиц Arena для изображений от 22 сентября 2026 года Qwen-Image-2.1 — лучшая по баллам модель, не помеченная тегом Proprietary. Что пост сжимает, так это всё, что делает это утверждение условным, — шестнадцатое и семнадцатое места в общем зачёте, предварительный балл по нескольким тысячам голосов и исследовательская лицензия, выдаваемая за лицензию с открытым исходным кодом, которую подразумевает эта фраза.

A generated scoreboard titled Qwen-Image-2.1 - the scoreboard, with rows reading Image Edit Arena score 1367 at rank 16 of 56, Text-to-Image Arena score 1228 at rank 17 of 79, row status Preliminary on both boards, licence qwen-research non-commercial, Apache 2.0 sibling qwen-image-edit at 1241, and vendor benchmark Qwen-Image-Bench 60.28 unreproduced, above a footer reading Arena figures per the LMArena boards captured September 22 2026; Qwen-Image-Bench figure vendor-reported, no third-party reproduction.

Ничто из этого не делает результат незначительным. То, что она стала первой непроприетарной строкой в обеих таблицах через три дня после выпуска, — это реальное изменение в том, где находится открытый уровень: модели изображений Qwen с разрешительной лицензией, которые идут перед ней, отстают более чем на сто двадцать пунктов в той же таблице редактирования. Но это просто не то же самое утверждение, что «лучшая модель изображений с открытым исходным кодом», а разница — это строка о лицензии и столбец с рейтингом, на проверку которых уходит около минуты.