Kartu judul hero yang dihasilkan berjudul Qwen-Image-2.1 Mengungguli Kedua Arena Gambar, dengan subjudul Apa yang disembunyikan label open-source #1, menampilkan dua kartu papan peringkat berlabel Image Edit Arena dengan chip peringkat bertuliskan 16 dari 56 dan chip skor bertuliskan 1367, serta Text-to-Image Arena dengan chip peringkat bertuliskan 17 dari 79 dan chip skor bertuliskan 1228, di atas tag bertuliskan qwen-research licence.
Guides & Insights

Qwen-Image-2.1 Menduduki Puncak di Kedua Arena Gambar: Apa yang Disembunyikan oleh Label Open-Source #1

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Tim di balik Qwen-Image-2.1 berterima kasih kepada Arena atas pengakuan tersebut, dan pengakuan itu nyata. Qwen-Image-2.1 adalah model dengan skor tertinggi di kedua papan peringkat gambar Arena yang tidak dilabeli Proprietary oleh papan-papan tersebut: 1.367 pada Image Edit dan 1.228 pada Text-to-Image, dalam snapshot 22 September 2026. Setiap baris di atasnya di kedua papan peringkat membawa tag Proprietary. Tiga fakta yang tidak disertakan dalam pengumuman itu sama-sama dapat diperiksa seperti klaim itu sendiri — peringkat keseluruhan yang diperoleh dari skor-skor tersebut, Preliminary tanda yang menyertai kedua baris tersebut, dan string lisensi yang bertuliskan qwen-research alih-alih Apache 2.0 pada model gambar sebelumnya. Klaim itu bertahan saat bersentuhan dengan papan peringkat tersebut. Hanya saja, yang dikatakannya lebih sedikit daripada yang tersirat oleh judulnya.

Membaca kedua papan secara berdampingan

Skor Arena adalah peringkat bergaya Elo yang dibangun dari voting berpasangan secara buta: seseorang melihat dua keluaran, tidak tahu model mana yang menghasilkan yang mana, lalu memilih. Itu adalah kelas bukti yang secara kategoris berbeda dari tolok ukur vendor, itulah sebabnya klaim yang bersandar padanya layak diverifikasi daripada sekadar diulang. Kedua papan tersebut diambil pada 22 September 2026, dan keduanya dibaca baris demi baris, bukan sekadar dipindai dari grafik peringkat.

A screenshot of the LMArena Image Edit Arena leaderboard, captured September 22 2026, showing the board header reading 29,902,508 votes and 56 models, with ranks 13 to 22 visible: gemini-3-pro-image-preview at 1385, reve-2.1 at 1375, gpt-image-1.5-high-fidelity at 1370, qwen-image-2.1 at rank 16 with 1367 and a confidence interval of plus or minus 9 and 4,841 votes marked Preliminary, reve-2.0 at 1358, uni-1.1-max at 1334, grok-imagine-image at 1329, uni-1.1 at 1315, gemini-3.1-flash-lite-image at 1314 and qwen-image-2.0-pro-2026-06-22 at 1304, with every row above qwen-image-2.1 labelled Proprietary.

Papan Image Edit mencantumkan 56 model dan 29.902.508 suara. Qwen-Image-2.1 berada di peringkat 16 dengan skor 1.367, interval kepercayaan ±9, dan 4.841 suara. Lima belas baris di atasnya — dari gpt-image-2.5-sunburst pada 1.526 hingga gpt-image-1.5-high-fidelity pada 1.370 — semuanya bersifat proprietary. Demikian pula dua baris tepat di bawahnya, reve-2.0 pada 1.358 dan uni-1.1-max pada 1.334.

A screenshot of the LMArena Text-to-Image Arena leaderboard, captured September 22 2026, showing the board header reading 6,258,152 votes and 79 models, with ranks 14 to 21 visible: gemini-3-pro-image-2k at 1246, gpt-image-1.5-high-fidelity at 1239, gemini-3-pro-image-preview at 1232, qwen-image-2.1 at rank 17 with 1228 and a confidence interval of plus or minus 11 and 2,843 votes marked Preliminary, ideogram-4.0-quality at 1204 labelled Ideogram Open Model, qwen-image-2.0-pro-2026-06-22 at 1191, uni-1.1-max at 1188 and mai-image-2 at 1183, with Proprietary labelling on every row above qwen-image-2.1.

Papan Text-to-Image pada hari yang sama mencantumkan 79 model dan 6.258.152 suara. Qwen-Image-2.1 berada di peringkat 17 dengan skor 1.228, interval kepercayaan ±11, dan 2.843 suara. Pola yang sama: enam belas baris di atasnya adalah Proprietary, dan baris non-Proprietary pertama di bawahnya adalah ideogram-4.0-quality pada 1.204, dilabeli Ideogram Open Model.

Dua detail dari baris-baris itu layak disorot, karena keduanya bertentangan dengan cara klaim tersebut biasanya diulang.

Peringkat dan skor menceritakan kisah yang berbeda — 1.367 adalah angka non-Proprietary terbaik di papan penyuntingan gambar, dan juga merupakan peringkat keenam belas, tertinggal 159 poin dari pemimpin dan selisih 3 poin dari peringkat kelima belas.
Di satu papan, model tertutup milik Alibaba sendiri menang — qwen-image-3.0-pro, ditandai Proprietary, berada di 1.254 pada Text-to-Image, dua puluh enam poin di atas qwen-image-2.1 yang bernilai 1.228. Di papan penyuntingan, model terbuka mengalahkan model proprietary sebelumnya, qwen-image-2.0-pro-2026-06-22, di 1.304. Juara internal bukan model yang sama di kedua papan.
Selisih dengan model terbuka berikutnya lebar di satu papan dan sempit di papan lainnya — pada Image Edit, baris non-Proprietary berikutnya adalah hunyuan-image-3.0-instruct pada 1.302, tertinggal enam puluh lima poin; pada Text-to-Image, yaitu ideogram-4.0-quality pada 1.204, tertinggal dua puluh empat poin.

String lisensi itu melakukan lebih banyak pekerjaan daripada peringkat.

Setiap baris Arena mencantumkan label organisasi dan lisensi. Qwen-Image-2.1 bertuliskan Alibaba · qwen-research di kedua papan. Itu bukan label Apache 2.0 pada model gambar Alibaba yang lebih awal: qwen-image-edit pada 1.241 dan qwen-image-edit-2511 pada 1.235 di papan penyuntingan keduanya ditandai Apache 2.0, begitu pula qwen-image-2512 pada 1.125 dan qwen-image pada 1.057 di Text-to-Image. Pos blog vendor tersebut menutup lingkaran yang sama, menerbitkan bobot di bawah Perjanjian Lisensi Riset Qwen bertanggal 20 September 2026, yang mengizinkan riset dan evaluasi, bukan penggunaan komersial.

Jadi, pembacaan yang jujur atas "#1 model open source" lebih sempit daripada kedengarannya. Dalam pembagian dua arah papan peringkat itu sendiri — Proprietary, atau bukan — Qwen-Image-2.1 berada di peringkat pertama. Menurut definisi open source OSI, yang tidak menerima pembatasan bidang penggunaan, model itu sama sekali bukan open source, dan begitu pula sebagian besar model yang dibandingkan dengannya: papan peringkat yang sama memuat baris-baris berlabel flux-non-commercial-license, tencent-hunyuan-community, krea-2-community-license dan Ideogram Open Model. Filter "Open Source" milik Arena adalah sakelar kasar proprietary-versus-not. Itu adalah sakelar yang berguna. Itu bukan tinjauan lisensi.

Perbedaan itu lebih penting di sini daripada selisih dua poin, karena itulah satu-satunya hal yang tidak dapat berubah dengan satu minggu pemungutan suara lagi. Jika Anda menginginkan model gambar berlisensi permisif dari keluarga ini hari ini, baris Apache 2.0-nya adalah qwen-image-edit dan qwen-image-edit-2511 — keduanya lebih tua, dan keduanya lebih dari seratus dua puluh poin lebih rendah pada papan penyuntingan yang sama (1.241 dan 1.235 berbanding 1.367). Model gambar Qwen berlabel terbuka dengan skor tertinggi dan model gambar Qwen yang dapat digunakan secara komersial bukanlah unduhan yang sama.

Sementara artinya angka itu masih bisa berubah

Kedua baris Qwen-Image-2.1 membawa penanda Sementara papan skor, yang diterapkan Arena ketika suatu baris belum mengumpulkan cukup suara agar skornya dianggap final. Jumlah suaranya itulah alasannya: 4.841 suara dibandingkan total papan 29.902.508 pada Image Edit, dan 2.843 dibandingkan 6.258.152 pada Text-to-Image. Sebagai perbandingan, baris-baris di sekitarnya memiliki jauh lebih banyak suara — gpt-image-1.5-high-fidelity memiliki 589.013 suara pada papan penyuntingan, dan qwen-image-2.0-pro-2026-06-22 memiliki 307.705 pada papan Text-to-Image.

Interval kepercayaan ±9 dan ±11 pada model yang berusia tiga hari bukanlah tanda peringatan; memang seperti itulah rilis baru. Namun itu berarti urutan spesifik di puncak tier terbuka dapat bergeser seiring bertambahnya suara, terutama pada Text-to-Image yang selisihnya dengan baris terbuka berikutnya adalah dua puluh empat poin.

Apa modelnya, menurut lembar milik vendor sendiri

Uraian Alibaba sendiri menggambarkan model terpadu teks-ke-gambar dan penyuntingan dengan komponen pembangkitan visual berparameter 7B yang dibangun dari 32 lapisan DiT Single-Stream, pembangkitan dan penyuntingan native untuk gambar transparan, dukungan hingga 10 gambar referensi, serta batas keluaran native 2048×2048 — unduhan pipeline lengkapnya sekitar 33 GB. Dukungan transparansi adalah item yang paling jarang ada dalam daftar itu; papan penyuntingan Arena tidak secara jelas mengukurnya, jadi peringkat di papan bukanlah bukti yang mendukung maupun menolak kemampuan spesifik tersebut.

Tolok ukur utama dari vendor ini adalah Qwen-Image-Bench, tempat model tersebut dilaporkan berada di 60,28, di depan Nano Banana 2.0 pada 59,82 dan GPT Image 1.5 pada 59,65. Itu adalah evaluasi yang dijalankan vendor tanpa reproduksi pihak ketiga, dan marginnya di bawah satu poin — sebaran yang tidak akan bertahan jika set prompt diubah. Perlu dinyatakan secara gamblang: angka Arena di atas adalah suara orang lain, sedangkan angka Qwen-Image-Bench adalah milik Alibaba sendiri. Keduanya bukan jenis bukti yang sama dan tidak boleh dirata-ratakan menjadi satu kesan tentang model tersebut.

Dukungan penerapan hadir bersamaan dengan rilis, bukan setelahnya: integrasi hari pertama untuk model ini sudah tersedia di ComfyUI, SGLang, vLLM-Omni, LightX2V, dan pustaka Diffusers, yang berarti pertanyaan praktis bagi sebagian besar tim bukanlah apakah model tersebut dapat dilayani, melainkan apakah biaya penyajiannya sesuai.

Bagaimana klaim seperti ini diterima jika Anda membutuhkan API gambar minggu ini

Ketepatan soal posisi kami sendiri penting di sini. OrcaRouter tidak merutekan Qwen-Image-2.1, atau model Qwen-Image versi apa pun. Jika skor Arena yang meyakinkan Anda, model itu dapat diakses melalui API milik vendor sendiri dan beberapa platform pihak ketiga, atau sebagai unduhan yang di-host sendiri — bukan melalui kami. Kami tidak punya rute gambar Qwen untuk dijual kepada Anda, dan peringkat di papan itu bukan alasan untuk berpura-pura sebaliknya.

Yang kami rutekan adalah sisa dari tier gambar yang diperingkat oleh papan-papan tersebut, dan beberapa baris di atas Qwen-Image-2.1 ada di dalamnya. GPT-Image-2, GPT-Image-1.5, dan GPT-Image-1-mini dari OpenAI tersedia, begitu pula tier Imagen 4 milik Google dan endpoint pratinjau gambar Gemini, serta endpoint gambar Grok Imagine dari xAI. Campuran itulah jawaban praktis untuk klaim seperti ini. Jika Arena menempatkan model terbuka langsung di posisi teratas, beralih model hanya akan jadi perubahan kode satu baris pada satu kunci. Nyatanya tidak demikian — puncak kedua papan itu dikuasai model proprietary, dan keputusan yang menarik adalah memilih antara unduhan berlisensi riset dan endpoint terkelola yang bisa Anda panggil hari ini.

Tiga properti platform penting untuk keputusan itu. Perutean berjalan pada satu endpoint yang kompatibel dengan OpenAI di lebih dari 200 model, sehingga membandingkan baris-baris yang dihosting satu sama lain tidak berarti kontrak kedua atau SDK kedua. Harga daftar penyedia diteruskan tanpa markup, yang berarti perubahan harga vendor sampai ke faktur Anda pada hari yang sama saat diumumkan, bukan pada pembaruan kontrak berikutnya. Dan failover otomatis antar penyedia berarti model baru dengan sedikit suara dapat berada di belakang model yang sudah mapan dalam rantai fallback alih-alih menjadi dependensi produksi pada hari ketiga — kira-kira di situlah posisi Qwen-Image-2.1 saat ini.

Klaim itu benar, dan lebih tipis daripada yang terlihat saat dibaca.

Apa yang diposting Alibaba dapat diverifikasi: pada snapshot 22 September 2026 dari kedua papan peringkat gambar Arena, Qwen-Image-2.1 adalah model dengan skor terbaik yang tidak diberi tag Proprietary. Yang diringkas oleh postingan itu adalah semua hal yang memberi syarat pada klaim tersebut — peringkat keenam belas dan ketujuh belas secara keseluruhan, skor awal dari beberapa ribu suara, dan lisensi riset yang menggantikan lisensi sumber terbuka yang terbayang dari frasa itu.

A generated scoreboard titled Qwen-Image-2.1 - the scoreboard, with rows reading Image Edit Arena score 1367 at rank 16 of 56, Text-to-Image Arena score 1228 at rank 17 of 79, row status Preliminary on both boards, licence qwen-research non-commercial, Apache 2.0 sibling qwen-image-edit at 1241, and vendor benchmark Qwen-Image-Bench 60.28 unreproduced, above a footer reading Arena figures per the LMArena boards captured September 22 2026; Qwen-Image-Bench figure vendor-reported, no third-party reproduction.

Tidak ada dari semua ini yang membuat hasilnya kecil. Menjadi baris non-proprieter pertama di kedua papan, tiga hari setelah rilis, adalah perubahan nyata dalam posisi tingkat terbuka — model gambar Qwen berlisensi permisif yang mendahuluinya tertinggal lebih dari seratus dua puluh poin di papan penyuntingan yang sama. Ini hanya bukan pernyataan yang sama dengan "model gambar terbaik yang bersumber terbuka," dan perbedaannya adalah baris lisensi dan kolom peringkat yang membutuhkan sekitar satu menit untuk diperiksa.