
Qwen-Image-2.1 Adalah Model Gambar Open-Weights Teratas di Kedua Papan Artificial Analysis
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 223 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Tim Qwen milik Alibaba merilis Qwen-Image-2.1 dengan bobot terbuka pada 20 September 2026. Dua belas hari kemudian, papan skor independen sudah menyusulnya, dan hasilnya lebih menarik daripada saat peluncurannya. Di papan peringkat AA-Image-T2I v2.0, Qwen-Image-2.1 berada di peringkat 18 dari 166 dengan Elo 1.034, dari 5.286 perbandingan buta. Di AA-Image-Editing v2.0 ia berada di peringkat 18 dari 97 dengan Elo 1.074, dari 5.536. Kedua baris itu ditandai Open Weights pada papan yang menandai setiap model secara individual. Tidak ada model lain yang menyandang penanda tersebut di kedua papan itu yang ditempatkan di atasnya. Itulah keseluruhan temuannya: pada satu-satunya dua papan gambar publik yang menilai model melalui perbandingan berpasangan secara buta, Qwen-Image-2.1 yang telah dirilis adalah kumpulan bobot yang dapat diunduh terkuat di bidang ini, dan Qwen-Image-2.1 secara spesifik, bukan pratinjaunya, yang memegang kedua posisi tersebut.
Berikut ini adalah dari mana kedua angka itu berasal, seperti apa baris-baris di sekitar keduanya, dan tiga detail pada papan tersebut yang paling banyak dilewatkan oleh liputan peluncuran — dimulai dari fakta bahwa papan itu tidak mencatat API mana pun untuk model tersebut.
Di mana dua baris berada
Artificial Analysis membangun kedua papan tersebut dari perbandingan berpasangan secara buta: dua model menjawab prompt yang sama, seorang pemilih memilih keluaran yang lebih baik, dan sebuah Elo muncul dari agregatnya. Kedua papan itu hanya berbagi gaya khas dan tidak yang lain. Keduanya menilai tugas yang berbeda, memiliki populasi yang berbeda, dan nilai Elo mereka tidak dapat dibandingkan satu sama lain. Qwen-Image-2.1 kebetulan berada di peringkat yang sama di keduanya, yang merupakan kebetulan dari dua distribusi yang berbeda.
Teks ke gambar, 166 model di papan:
• Baris teratas papan peringkat adalah GPT Image 2.5 Sunburst (max) pada 1.107 Elo dari 14.023 kemunculan — model proprietary dengan lebih dari dua kali sampel Qwen-Image-2.1.
• Qwen-Image-2.1 berada di peringkat 18 dengan 1.034 Elo dan interval kepercayaan 95% sebesar 1.024 hingga 1.044, dari 5.286 kemunculan.
• Baca jumlah baris sebelum peringkat. Qwen-Image-2.1 berada di peringkat 18 pada kedua papan, tetapi peringkat tersebut berasal dari populasi yang berbeda — 166 model pada teks-ke-gambar, 97 pada penyuntingan — dan kedua nilai Elo itu milik dua skala yang terpisah. Peringkat yang identik adalah aritmetika, bukan bukti bahwa kedua papan sepakat tentang apa pun.
• Dua model kelas Pro milik Alibaba sendiri berada di atasnya di papan peringkat ini: Qwen-Image-3.0-Pro pada 1.089 Elo, peringkat 14, dan Qwen-Image-3.0 pada 1.075, peringkat 16. Tidak satu pun membawa penanda Open Weights. Snapshot September papan peringkat tersebut mencantumkan keduanya sebagai rilis Juli 2026, yang merupakan versi cerita di mana model gambar Qwen terbaru bukanlah model dengan skor tertinggi — dan pada text-to-image, memang bukan.
Pengeditan gambar, 97 model di papan:
• GPT Image 2.5 Sunburst (max) juga memuncaki papan peringkat ini, dengan 1.182 Elo dari 17.899 kemunculan.
• Qwen-Image-2.1 berada di peringkat 18 dengan 1.074 Elo, interval 1.065 hingga 1.083, dari 5.536 kemunculan — sampel yang sedikit lebih besar daripada baris teks-ke-gambar-nya, yang masuk akal untuk model yang sisi penyuntingannya mendapat naskah peluncuran yang lebih gencar.
• Baris-baris di sekitarnya padat. grok-imagine-image berada satu peringkat di bawahnya pada 1.071 dan Luma UNI 1 Max pada 1.069. Baris open-weights terdekat di bawahnya di papan ini adalah HunyuanImage 3.0 Instruct pada 1.066 dengan 5.221 kemunculan — selisih 8 Elo. Tujuh baris berada dalam delapan belas poin Elo.
Membaca klaim "model open-weights teratas" secara jujur
Frasa dalam judul itu menjalankan fungsi tertentu, dan layak diperiksa, bukan diulang.
• Ini adalah peringkat di antara suatu penanda, bukan peringkat keseluruhan. Qwen-Image-2.1 berada di peringkat ke-18 di kedua papan secara keseluruhan. Label Open Weights-lah yang menempatkannya di posisi pertama di masing-masing papan, dan label tersebut diterapkan per model berdasarkan kewenangan papan itu sendiri — 47 baris text-to-image membawa penanda tersebut; 36 baris membawanya di papan penyuntingan, yang mencantumkan 97.
• Penanda itu menggambarkan bobot, bukan ketentuan. Qwen-Image-2.1 dirilis di bawah Perjanjian Lisensi Riset Qwen tertanggal 20 September 2026, yang hanya memberikan hak untuk tujuan non-komersial. Label Bobot Terbuka dari dewan tersebut akurat soal dapat diunduh dan bungkam soal apa yang boleh Anda lakukan dengan unduhan itu. Siapa pun yang membaca "model gambar dengan bobot terbuka terbaik" sebagai "bebas digunakan dalam produk" telah membaca label itu melampaui maknanya.
• Ini adalah potret sesaat, bukan peringkat yang sudah final. Papan peringkat bergerak setiap hari seiring bertambahnya suara. Interval kepercayaan Qwen-Image-2.1 adalah ±10 Elo pada text-to-image dan ±9 pada editing; baris-baris di bawahnya berada pada interval yang saling tumpang tindih. Anggap posisi ini sebagai kondisi terkini, bukan permanen.
Detail yang tidak dimiliki liputan peluncuran: tidak ada API
Kedua baris Qwen-Image-2.1 membawa API tidak tersedia sebagai catatan eksplisit. Itu adalah biaya nyata bagi peringkat, dan itu memberi tahu Anda sesuatu tentang siapa yang menghasilkan 5.286 dan 5.536 suara — jika tidak ada endpoint untuk mengarahkan prompt, perbandingan berasal dari orang-orang yang menjalankan bobotnya sendiri dan mengirimkan keluaran. Elo independen untuk model yang hanya di-hosting sendiri adalah pengukuran yang benar-benar lebih sulit daripada Elo untuk sesuatu yang bisa dipanggil siapa saja, dan itulah sebabnya sampel di sini sepertiga ukuran baris teratas.
Bagi pengembang, bentuknya sudah tidak asing: model gambar yang dapat diunduh terkuat di bidang ini bukanlah yang dapat Anda panggil hari ini. Secara praktis, hal itu membagi pekerjaan. Anda bisa menyajikan Qwen-Image-2.1 sendiri di perangkat keras Anda sendiri, atau Anda memanggil salah satu model di sekitarnya di papan ini. Opsi kedua adalah di mana perutean membuktikan nilainya — satu API untuk 200+ model dengan harga daftar penyedia diteruskan tanpa markup, failover otomatis saat penyedia mengalami degradasi, dan DSL perutean untuk menggabungkan beberapa model menjadi satu panggilan. OrcaRouter tidak menyajikan Qwen-Image-2.1 hari ini; lini gambar di platform ini adalah tingkatan Imagen Google dan pratinjau gambar Gemini, endpoint gambar Grok Imagine xAI dan keluarga GPT-Image OpenAI. Di papan ini, itu adalah baris GPT Image 2.5 Sunburst di posisi paling atas, dan itu adalah jawaban yang sah untuk "Saya ingin skor terbaik dan saya ingin itu dapat dipanggil sore ini."

Apa yang perlu dipantau di papan
Tiga hal akan menggerakkan cerita ini, dan ketiganya sudah terlihat di papan.
Yang pertama adalah apakah sebuah API muncul. Jika Alibaba atau mitra penyedia menempatkan Qwen-Image-2.1 di balik endpoint, catatan Tidak ada API tersedia akan menghilang, jumlah suara seharusnya naik menuju ukuran baris tetangga, dan interval kepercayaan menyempit. Interval yang lebih sempit pada 1.034 atau 1.074 adalah klaim yang jauh lebih kuat daripada yang sekarang.
Yang kedua adalah stack milik Alibaba sendiri. Qwen-Image-3.0-Pro dengan skor 1.089 dan Qwen-Image-3.0 dengan skor 1.075 sama-sama mengungguli Qwen-Image-2.1 pada text-to-image sekaligus tidak membawa penanda Open Weights. Jika Qwen-Image-2.1 dimaksudkan sebagai padanan yang dapat diunduh untuk lini tersebut alih-alih penerusnya, pertanyaan yang menarik adalah apakah selisihnya menyempit — dan di papan editing hal itu sudah terjadi, di mana Qwen-Image-3.0-Pro memimpin Qwen-Image-2.1 dengan selisih dua poin Elo.
Yang ketiga adalah lisensi. Setiap baris Open Weights di kedua papan sama-sama memenuhi syarat untuk label itu, dan lisensi di baliknya sama sekali tidak setara. Papan itu tidak akan pernah memberitahumu hal itu. Itulah satu kolom yang tidak dimiliki papan skor.

FAQ
Apakah Qwen-Image-2.1 model gambar open-weights terbaik?
Pada kedua papan peringkat ini, ya — ini adalah baris dengan Elo tertinggi yang membawa penanda Open Weights di keduanya, pada 1.034 untuk teks-ke-gambar dan 1.074 untuk penyuntingan. Secara keseluruhan, ia berada di peringkat ke-18 di masing-masing papan — dan angka 18 itu adalah peringkat dalam 166 baris di satu papan dan dalam 97 baris di papan lainnya, mewakili dua skala Elo yang tidak dapat dibandingkan satu sama lain. Klaim ini hanya berlaku jika kedua kualifikasi tetap melekat.
Mengapa kedua papan peringkat menampilkan nilai Elo yang berbeda untuk model yang sama?
Mereka menilai tugas-tugas yang berbeda terhadap populasi model yang berbeda. Elo text-to-image dan Elo penyuntingan adalah dua skala yang terpisah; membandingkan 1.034 dengan 1.074 berarti mengukur papan peringkatnya, bukan modelnya.
Bisakah saya memanggil Qwen-Image-2.1 melalui API?
Kedua baris papan tersebut mencatat Tidak ada API yang tersedia. Bobotnya dapat diunduh dari repositori Alibaba, jadi model tersebut tetap bisa dijalankan — hanya saja tidak ada endpoint terkelola yang dicatat oleh papan tersebut sebagai penyedianya.
Jika Anda ingin angka hari ini alih-alih mengunduh, peringkat teratas di kedua papan dapat dipanggil melalui API milik vendor masing-masing, dan lini GPT-Image, tingkatan Imagen milik Google, serta Grok Imagine milik xAI adalah model gambar yang dihadirkan langsung oleh OrcaRouter. Simpan file bobot untuk eksperimen dan endpoint untuk tenggat waktu.
