
Qwen-Image-2.1 to najlepszy model generowania obrazów z otwartymi wagami w obu rankingach Artificial Analysis
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 223 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Zespół Qwen firmy Alibaba udostępnił Qwen-Image-2.1 z otwartymi wagami 20 września 2026 r. Dwanaście dni później niezależne rankingi dogoniły go, a wynik jest ciekawszy niż premiera. W rankingu AA-Image-T2I v2.0 Qwen-Image-2.1 zajmuje 18. miejsce na 166 z Elo 1,034, z 5,286 ślepych porównań. W rankingu AA-Image-Editing v2.0 zajmuje 18. miejsce na 97 z Elo 1,074, z 5,536. Oba te wiersze są oznaczone Otwarte wagi na tablicy, która oznacza każdy model indywidualnie. Żaden inny model z tym oznaczeniem na którejkolwiek z tablic nie znajduje się wyżej. To całe odkrycie: na jedynych dwóch publicznych tablicach obrazów, które oceniają modele przez ślepe porównania parami, wydany Qwen-Image-2.1 to najsilniejszy zestaw możliwych do pobrania wag w tej dziedzinie, a to Qwen-Image-2.1 konkretnie, a nie jego wersja zapoznawcza, zajmuje oba miejsca.
Poniżej wyjaśniamy, skąd pochodzą te dwie liczby, jak wyglądają otaczające je wiersze oraz trzy szczegóły na tablicy, które większość relacji z premiery pominęła — zaczynając od tego, że tablica nie odnotowuje nigdzie żadnego API dla tego modelu.
Gdzie znajdują się dwa rzędy
Artificial Analysis tworzy oba rankingi na podstawie zaślepionych porównań parami: dwa modele odpowiadają na ten sam prompt, głosujący wybiera lepszą odpowiedź, a z agregatu wyłania się Elo. Oba rankingi łączy wyłącznie wspólny styl i nic poza tym. Oceniają różne zadania, mają różne populacje, a ich wartości Elo nie są ze sobą porównywalne. Qwen-Image-2.1 przypadkiem zajmuje tę samą pozycję w obu rankingach, co jest zbiegiem okoliczności w przypadku dwóch różnych rozkładów.
Tekst na obraz, 166 modeli na tablicy:
• W górnym wierszu tabeli znajduje się GPT Image 2.5 Sunburst (max) z wynikiem 1 107 Elo na podstawie 14 023 wystąpień — model własnościowy z ponad dwukrotnie większą próbą niż Qwen-Image-2.1.
• Qwen-Image-2.1 zajmuje 18. miejsce z wynikiem 1 034 Elo i 95% przedziałem ufności od 1 024 do 1 044, na podstawie 5 286 wystąpień.
• Przeczytaj liczby wierszy, zanim spojrzysz na pozycje w rankingach. Qwen-Image-2.1 znajduje się na 18. miejscu w obu rankingach, ale te pozycje pochodzą z różnych populacji — 166 modeli w generowaniu obrazu z tekstu, 97 w edycji — a dwie wartości Elo należą do dwóch odrębnych skal. Identyczna pozycja to arytmetyka, a nie dowód, że oba rankingi są ze sobą w czymkolwiek zgodne.
• Dwa własne modele klasy Pro firmy Alibaba są wyżej od niego na tej liście: Qwen-Image-3.0-Pro z 1089 Elo, miejsce 14, i Qwen-Image-3.0 z 1075, miejsce 16. Żaden nie ma znacznika Open Weights. Wrześniowy snapshot tej listy wymienia oba jako wydania z lipca 2026 r., co jest wersją tej historii, w której najnowszy model obrazowy Qwen nie jest tym z najwyższym wynikiem — a w przypadku text-to-image nie jest.
Edycja obrazów, 97 modeli na tablicy:
• GPT Image 2.5 Sunburst (max) również prowadzi tę tabelę, z 1,182 Elo przy 17,899 występach.
• Qwen-Image-2.1 znajduje się na 18. miejscu z wynikiem 1074 Elo, przedział od 1065 do 1083, na podstawie 5536 wystąpień — nieco większa próba niż w jego wierszu tekst-na-obraz, co ma sens w przypadku modelu, którego część edycyjna otrzymała głośniejszą kampanię premiery.
• Wiersze wokół niego są ciasno stłoczone. grok-imagine-image plasuje się jedno miejsce poniżej, z wynikiem 1 071, a Luma UNI 1 Max z 1 069. Najbliższy wiersz z otwartymi wagami poniżej niego na tej tablicy to HunyuanImage 3.0 Instruct z wynikiem 1 066 przy 5 221 wystąpieniach — o 8 punktów Elo w tyle. Siedem wierszy mieści się w granicach osiemnastu punktów Elo.
Uczciwie czytając twierdzenie o „czołowym modelu z otwartymi wagami”
To sformułowanie w nagłówku pełni konkretną funkcję i zasługuje na sprawdzenie, a nie na powtarzanie.
• To pozycja wśród modeli z oznaczeniem, a nie pozycja ogólna. Qwen-Image-2.1 zajmuje 18. miejsce w obu rankingach ogółem. To etykieta Open Weights sprawia, że plasuje się na pierwszym miejscu w każdym z nich, a etykieta jest przypisywana poszczególnym modelom zgodnie z decyzją samego rankingu — 47 wierszy text-to-image nosi to oznaczenie; 36 wierszy nosi je w rankingu edycji, który liczy 97 pozycji.
• Znacznik opisuje wagi, a nie warunki. Qwen-Image-2.1 jest udostępniany na podstawie Umowy licencyjnej Qwen Research z dnia 20 września 2026 r., która przyznaje prawa wyłącznie do celów niekomercyjnych. Etykieta Open Weights zarządu jest trafna co do możliwości pobrania i milczy o tym, co można zrobić z pobranym plikiem. Każdy, kto odczytuje „najlepszy model obrazu z otwartymi wagami” jako „darmowy do użycia w produkcie”, wyczytał z etykiety więcej, niż ona mówi.
• To migawka, a nie ustalony ranking. Tabela zmienia się codziennie w miarę napływania głosów. Przedziały ufności Qwen-Image-2.1 wynoszą ±10 Elo w przypadku generowania obrazu z tekstu i ±9 w przypadku edycji; wiersze poniżej opierają się na nakładających się przedziałach. Traktuj tę pozycję jako bieżącą, a nie stałą.
Szczegół, którego zabrakło w relacjach z premiery: brak API
Oba wiersze Qwen-Image-2.1 zawierają wyraźną Brak dostępnego API adnotację. To realny koszt dla rankingu i mówi coś o tym, kto wygenerował 5 286 i 5 536 głosów — jeśli nie ma punktu końcowego, do którego można skierować prompt, porównania pochodziły od osób, które samodzielnie uruchamiały wagi i przesyłały wyniki. Niezależne Elo dla modelu przeznaczonego wyłącznie do samodzielnego hostowania to naprawdę trudniejszy pomiar niż Elo dla czegoś, co każdy może wywołać, i dlatego próbki tutaj są jedną trzecią rozmiaru górnych wierszy.
Dla dewelopera kształt tego jest znajomy: najsilniejszy pobierany model obrazu w tej dziedzinie to nie ten, który możesz wywołać dzisiaj. W praktyce dzieli to pracę. Albo sam hostujesz Qwen-Image-2.1 na własnym sprzęcie, albo wywołujesz jeden z modeli wokół niego z tej tablicy. Druga opcja to miejsce, w którym routing się opłaca — jedno API obejmujące ponad 200 modeli z ceną katalogową dostawcy przekazywaną bez marży, automatyczne przełączanie awaryjne, gdy dostawca zawodzi, oraz DSL routingu do składania kilku modeli w jedno wywołanie. OrcaRouter nie obsługuje dziś Qwen-Image-2.1; linie obrazowe na platformie to poziomy Imagen od Google i podglądy obrazów Gemini, endpoint obrazów Grok Imagine od xAI oraz rodzina GPT-Image od OpenAI. Na tej tablicy to wiersz GPT Image 2.5 Sunburst na samym szczycie, i jest to uzasadniona odpowiedź na „chcę najlepszy wynik i chcę móc go wywołać jeszcze dziś po południu”.

Co obserwować na tablicy
Trzy rzeczy wprawią tę historię w ruch, a wszystkie trzy są już widoczne na tablicach.
Pierwszą kwestią jest to, czy pojawi się API. Jeśli Alibaba lub partner świadczący usługi udostępni Qwen-Image-2.1 za punktem końcowym, Brak dostępnego API adnotacja zniknie, liczba głosów powinna wzrosnąć do poziomu sąsiednich wierszy, a przedział ufności się zawęzi. Węższy przedział dla 1 034 lub 1 074 to znacznie mocniejsze twierdzenie niż obecne.
Drugi to własny stos firmy Alibaba. Qwen-Image-3.0-Pro z wynikiem 1089 i Qwen-Image-3.0 z wynikiem 1075 wyprzedzają Qwen-Image-2.1 w generowaniu obrazów na podstawie tekstu, nie mając przy tym znacznika Open Weights. Jeśli Qwen-Image-2.1 ma być odpowiednikiem tej linii do pobrania, a nie jej następcą, ciekawym pytaniem jest, czy różnica się zmniejszy — a w rankingu edycji już się zmniejszyła, gdzie Qwen-Image-3.0-Pro wyprzedza Qwen-Image-2.1 o dwa punkty Elo.
Trzeci element to licencja. Każdy wiersz Open Weights na obu tablicach równie kwalifikuje się do etykiety, a licencje, które za nimi stoją, nie są nawet w najmniejszym stopniu równe. Tablica nigdy ci tego nie powie. To jedyna kolumna, której nie ma tablica wyników.

Najczęściej zadawane pytania
Czy Qwen-Image-2.1 to najlepszy model obrazowy z otwartymi wagami?
Na tych dwóch rankingach — tak, to wiersz z najwyższym Elo, który na obu nosi znacznik Open Weights, z wynikiem 1034 w kategorii text-to-image i 1074 w edycji. Ogólnie zajmuje 18. miejsce na każdym z nich — a 18 to miejsce wśród 166 wierszy na jednym rankingu i wśród 97 na drugim, reprezentując dwie skale Elo, których nie można ze sobą porównywać. Twierdzenie to jest prawdziwe tylko wtedy, gdy oba kwalifikatory pozostają dołączone.
Dlaczego dwa rankingi pokazują różne wartości Elo dla tego samego modelu?
Oceniają różne zadania względem różnych populacji modeli. Elo dla generowania obrazów z tekstu i Elo dla edycji to dwie odrębne skale; porównywanie 1034 z 1074 mierzy rankingi, a nie model.
Czy mogę wywołać Qwen-Image-2.1 przez API?
Oba wiersze tablicy odnotowują Brak dostępnego API. Wagi można pobrać z repozytoriów firmy Alibaba, więc model działa — po prostu nie ma hostowanego punktu końcowego, któremu tablica przypisała obsługę modelu.
Jeśli chcesz dziś liczbę, a nie pobranie, szczyt obu rankingów można wywołać przez własne API dostawców, a linia GPT-Image, poziomy Google Imagen i xAI Grok Imagine to modele obrazowe, które OrcaRouter udostępnia bezpośrednio. Zachowaj plik wag dla eksperymentu, a endpoint dla terminu.
