
Qwen-Image 2.1 vs FLUX 3: Dua Model Gambar yang Tidak Benar-Benar Bisa Anda Gunakan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen-Image 2.1 dan FLUX 3 adalah dua rilis gambar paling menarik pada paruh kedua 2026, dan tidak ada satu pun yang bisa langsung digunakan. Qwen-Image 2.1, yang di-open-source-kan oleh tim Qwen-Image pada 20 September 2026, adalah model terpadu berparameter 7B untuk generasi dan penyuntingan yang bisa Anda unduh sore ini dan tidak dapat secara legal dimasukkan ke dalam produk komersial. FLUX 3, yang diumumkan Black Forest Labs pada 23 Juli 2026, adalah model fondasi multimodal terpadu yang tier gambarnya — bagian yang sebenarnya akan Anda bandingkan — masih belum memiliki endpoint publik, ID model, harga, maupun tolok ukur dua bulan setelah pengumuman. Oleh karena itu, perbandingannya bukanlah "yang mana yang lebih baik." Melainkan hambatan mana dari kedua hambatan tersebut yang bisa Anda akali.
Dua jenis berbeda dari tidak tersedia
Sungguh menggoda untuk mengarsipkan keduanya sebagai "belum siap" lalu beralih. Itu akan menyembunyikan satu-satunya keputusan yang penting, karena kedua penghambat itu memiliki bentuk yang berlawanan.
Penghambat Qwen-Image 2.1 bersifat legal, dan itu adalah satu baris dalam berkas yang bisa Anda baca sebelum mengunduh apa pun. Bobotnya ada di Hugging Face dan ModelScope, kartu modelnya sudah ditulis, kode inferensinya sudah diterbitkan, dan dukungan untuk empat framework serving terpisah sudah digabungkan sebelum atau pada hari peluncuran. Tidak ada hal teknis yang berdiri di antara Anda dan model yang berjalan. Yang menghalangi Anda merilisnya adalah Qwen Research License Agreement, bertanggal 20 September 2026, yang klausul pemberian haknya mengizinkan penggunaan "HANYA UNTUK TUJUAN NON-KOMERSIAL" dan mengarahkan siapa pun yang menginginkan hak komersial untuk meminta lisensi terpisah dari vendor.
Penghalang FLUX 3 bersifat fisik. Tidak ada endpoint gambar untuk dipanggil, tidak ada pengenal model untuk diteruskan, dan tidak ada kartu harga untuk dijadikan dasar penganggaran. Halaman harga BFL sendiri mencakup tier FLUX 3 Video dan lini gambar FLUX.2 yang lebih lama; halaman itu tidak mencakup tier gambar FLUX 3, karena tidak ada yang bisa diberi harga. Akses ke model gambar hanya berdasarkan permintaan, bukan tombol mulai: halaman FLUX 3 milik BFL sendiri mencantumkan tier gambar sebagai "segera hadir", dan tier aksi itulah yang menyandang label akses awal.
Jadi, salah satunya adalah model yang bisa Anda jalankan malam ini dan tidak bisa dijual, sedangkan yang lain adalah model yang bisa Anda jual dan tidak bisa dijalankan. Mana yang lebih berguna bagi Anda sepenuhnya bergantung pada sisi kalimat mana Anda berdiri — tim riset internal dan tim produk komersial seharusnya sampai pada kesimpulan yang berlawanan dari dua fakta yang sama.
Pembacaan dimensi demi dimensi
• Status — Bobot, lisensi, dan kartu model Qwen-Image 2.1 diterbitkan pada 20 September 2026, disertai postingan blog vendor pada hari yang sama. FLUX 3 diumumkan pada 23 Juli 2026; hanya tier video yang telah dirilis, dan mencapai ketersediaan umum pada 4 Agustus 2026.
• Apa yang sebenarnya bisa Anda panggil hari ini — Qwen-Image 2.1 berjalan secara lokal melalui Diffusers, ComfyUI, vLLM-Omni, SGLang, dan LightX2V, atau melalui API milik vendor sendiri dan beberapa platform pihak ketiga. FLUX 3 mencantumkan tier gambarnya sebagai "segera hadir" tanpa endpoint untuk dipanggil, dan menawarkan endpoint video berbayar yang tersedia secara umum.
• Arsitektur — Qwen-Image 2.1 adalah DiT single-stream 32 lapis dengan 7B parameter pada komponen pembuatan visual, sebuah encoder teks Qwen3-VL 8B, dan VAE RGBA 64 kanal dengan kompresi spasial 16×. FLUX 3 adalah model flow terpadu tunggal yang dilatih secara bersama untuk gambar, video, dan audio, dibangun di atas metode flow-matching self-supervised yang oleh BFL disebut Self-Flow, dengan tingkat prediksi aksi yang dikembangkan bersama Mimic Robotics.
• Transparansi native — Qwen-Image 2.1 menghasilkan dan mengedit gambar RGBA, mengedit teks di dalam lapisan transparan, dan mengekstrak subjek dari foto RGB ke lapisan transparan, menggabungkan kemampuan yang Alibaba rilis secara terpisah sebagai Qwen-Image-Layered pada Desember 2025. BFL tidak menerbitkan klaim transparansi apa pun untuk FLUX 3 Image.
• Gambar referensi — Qwen-Image 2.1 menerima hingga 10 referensi masukan, dengan penyuntingan lokal melalui lingkaran, anotasi yang dilukis, atau mask terpisah. Tidak ada angka yang dipublikasikan untuk FLUX 3 Image.
• Resolusi — Qwen-Image 2.1 bersifat native 2K, secara default 2048×2048 pada 40 langkah inferensi, dengan tujuh preset rasio aspek yang didokumentasikan. Resolusi FLUX 3 Image dalam pengumuman hanya dijelaskan sebagai "luas", tanpa ada yang dipublikasikan.
• Harga — tidak ada harga yang dipublikasikan untuk keduanya. Qwen-Image 2.1 tidak memiliki tarif hosted yang tercantum pada saat penulisan ini; FLUX 3 Image tidak memiliki kartu harga karena tidak memiliki endpoint. Satu-satunya harga FLUX 3 yang ada adalah video, yaitu $0,06 per detik untuk draft, $0,17 per detik untuk HD, dan $0,29 per detik untuk FHD.
• Lisensi — Perjanjian Lisensi Qwen Research, hanya untuk non-komersial, penggunaan komersial dengan permintaan terpisah. Ketentuan lisensi FLUX 3 untuk tier gambar belum dipublikasikan sama sekali.
Satu asimetri pantas mendapat barisnya sendiri, karena itulah jebakan dalam pertarungan ini. FLUX 3 memang memiliki angka tolok ukur yang dipublikasikan — Elo internal 1.135 untuk teks-ke-video dan tingkat kemenangan preferensi manusia yang dilaporkan terhadap Grok Imagine Video, Seedance 2.0, Gemini Omni Flash, Runway Gen-4.5, dan Luma Ray 3.2. Setiap angka tersebut menggambarkan tingkat video tersebut. Tidak satu pun darinya berlaku untuk pembuatan gambar, dan BFL sendiri tidak mempublikasikan tolok ukur atau tingkat kemenangan untuk gambar. Mengutip Elo video FLUX 3 sebagai bukti tentang kualitas gambar FLUX 3 adalah kesalahan tunggal yang paling mudah dilakukan dalam perbandingan ini.

Apa yang sebenarnya dapat ditunjukkan oleh masing-masing pihak
Bandingkan bukti-buktinya secara berdampingan dan asimetrinya terbalik dari bagian sebelumnya.
FLUX 3 memiliki produk yang sudah dirilis, berharga, dan tersedia secara umum — hanya saja bukan yang ada di judul artikel ini. FLUX 3 Video menghasilkan klip hingga 20 detik dengan audio tersinkronisasi dalam satu proses, mendukung text-to-video, image-to-video, video-to-video, keyframe-to-video dan generative continuation, dan sedang diuji oleh Canva, Burda, Magnific, Krea dan Picsart. Itu adalah sistem nyata yang telah diterapkan dengan daftar pelanggan nyata. Tingkat gambar adalah bagian yang belum datang, dan panduan awal BFL bahwa itu akan menyusul "dalam beberapa minggu ke depan" kini telah melewati dua bulan penuh tanpa endpoint publik.
Qwen-Image 2.1 memiliki profil yang berlawanan. Klaim kualitasnya berasal dari bagan perbandingan Qwen-Image-Bench milik vendor sendiri, dan tidak ada pihak ketiga yang mereproduksinya. Tetapi barangnya sendiri ada di tangan Anda: 33 GB bobot, tata letak repositori bergaya Apache dengan file lisensi yang jujur menyatakan bahwa penggunaannya hanya untuk riset, dan jalur penyajian day-zero di lima kerangka kerja. Ada juga satu ulasan praktik akses awal, dari penguji yang menjalankan bobot final melalui antarmuka ModelScope Studio dan melaporkan sekitar 10–15 detik untuk text-to-image dan 18–23 detik untuk penyuntingan, perilaku penetapan peran multi-karakter dan preset kamera yang kuat, serta konsistensi multi-referensi yang mulai menurun dari sekitar tiga gambar masukan. Satu pengulas, tanpa pengatur waktu, tanpa kumpulan prompt yang dipublikasikan. Berguna secara arah, secara formal belum terverifikasi.
Ringkasan jujur dari bukti: Qwen-Image 2.1 memiliki model yang dapat dijalankan dan tidak ada data kualitas independen; FLUX 3 Image memiliki klaim vendor dan tidak memiliki model yang dapat dijalankan maupun data gambar sama sekali. Jika pertanyaan Anda adalah "mana dari ini yang harus saya rencanakan untuk membangun pipeline," jawabannya hari ini adalah tidak keduanya, dan alasannya berbeda.

Di mana solusi sementara itu sebenarnya berada
Bagi tim komersial, penghambat Qwen-Image 2.1 memiliki bentuk yang bisa Anda perhitungkan. Lisensinya eksplisit, kontak lisensi komersial tercantum di repositori, dan modelnya cukup kecil — 7B pada komponen generasi — sehingga biaya mengevaluasinya di perangkat keras Anda sendiri diukur dalam hitungan satu sore, bukan satu kuartal. Evaluasi dulu, negosiasi kemudian, dan sementara itu jauhkan build riset dari jalur apa pun yang berhadapan dengan pelanggan. Itu masalah pengadaan yang normal.
Penghalang FLUX 3 Image bukanlah masalah pengadaan, karena tidak ada yang perlu diadakan. Anda dapat bergabung dengan antrean akses awal, dan Anda dapat memantau kapan endpoint muncul, dan itulah keseluruhan tindakan yang tersedia. Jika Anda memerlukan pembuatan gambar keluarga FLUX di produksi saat ini, opsi yang dapat dipanggil adalah lini FLUX.2 dan FLUX Pro/Dev yang lebih lama, yang sudah memiliki harga dan tersedia — dan yang merupakan generasi model yang berbeda dari model yang dibahas dalam artikel ini.
Bagi tim yang ingin menguji kedua kandidat tanpa mengikat salah satunya ke jalur produksi, inilah kasus yang menjadi alasan lapisan routing ada. OrcaRouter menempatkan 200+ model di balik satu endpoint yang kompatibel dengan OpenAI dengan harga daftar penyedia tanpa markup, dengan failover otomatis antar penyedia, sehingga model yang belum terbukti atau belum dirilis berada di balik rute di samping sesuatu yang sudah Anda percaya alih-alih menggantikannya — dan karena harga daftar diteruskan apa adanya, setiap perubahan harga vendor pada model yang dirutekan langsung berlaku pada hari yang sama. Baik Qwen-Image 2.1 maupun FLUX 3 Image tidak dapat dirutekan saat artikel ini ditulis, dan kami tidak akan berpura-pura sebaliknya; yang kami rutekan adalah lini gambar di sekitar keduanya, termasuk keluarga GPT-Image dari OpenAI, tingkatan Imagen 4 dan pratinjau gambar Gemini dari Google, serta endpoint gambar Grok Imagine dari xAI. Itulah model-model yang dapat menangani beban kerja sementara kedua model ini menyelesaikan urusannya sendiri.
Satu hal lagi yang patut diperhatikan khususnya di sisi Qwen. Alibaba merilis Qwen-Image 1.0 dan 2.0 sebagai bobot terbuka Apache-2.0, lalu merilis Qwen-Image 3.0 pada Juli 2026 sebagai model hosted tertutup sepenuhnya tanpa bobot, tanpa lisensi, dan tanpa laporan teknis, kemudian merilis Qwen-Image 2.1 pada September sebagai bobot terbuka di bawah lisensi khusus riset. Arah pergerakannya bukanlah garis lurus, dan ketentuan lisensi pada rilis berikutnya adalah pertanyaan terbuka yang sesungguhnya, bukan asumsi yang aman ke arah mana pun.

Vonisnya, apa adanya.
Jika Anda seorang peneliti atau tim evaluasi internal, Qwen-Image 2.1 adalah yang lebih berguna di antara keduanya saat ini, dengan selisih yang jauh — model ini dapat diunduh, terdokumentasi, didukung framework, dan jujur soal ketentuannya. Jika Anda tim komersial, keduanya terblokir dan blokirnya tidak setara: yang satu adalah kontrak yang bisa mulai Anda bicarakan, yang lain adalah produk yang belum ada.
Jika Anda perlu merilis fitur pembuatan gambar bulan ini, tidak ada satu pun dari keduanya yang menjadi jawabannya, dan pertanyaan yang berguna adalah model mana di antara model-model yang bisa Anda panggil yang paling mendekatkan Anda. Itu adalah latihan tolok ukur, dan sebaiknya dilakukan dengan prompt Anda sendiri, bukan dengan grafik peluncuran siapa pun — termasuk milik vendor, dan termasuk yang ini.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
