Kartu judul hero untuk GPT-Image-2 vs Flux 3, judul utama 'GPT-Image-2 vs Flux 3' dengan subjudul 'Satu model live, satu peta jalan', dua kartu menampilkan GPT-Image-2 dengan lencana 'API publik sejak Mei 2026' dan Flux 3 dengan lencana 'Tingkat gambar: segera hadir', logo OrcaRouter di pojok kanan bawah.
Guides & Insights

GPT-Image-2 vs Flux 3: Membandingkan Model Langsung dengan Peta Jalan

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Ini bukan postingan model-versus-model biasa, karena GPT-Image-2 dan Flux 3berada dalam kondisi keberadaan yang tidak sama. GPT-Image-2 dirilis pada 21 April 2026, telah dapat dipanggil melalui API Ope​nAI sejak awal Mei, dan memperoleh kemampuan baru minggu ini — pembuatan gambar dengan latar belakang transparan di API, diumumkan pada 20 Agustus dan tersedia sekarang. Flux 3 adalah model fondasi multimodal milik Black Forest Labs, diumumkan pada 23 Juli 2026, dan tingkat gambar masih belum memiliki endpoint publik, ID model, atau daftar harga hingga tulisan ini dibuat. Salah satunya dapat Anda panggil pada pukul 3 pagi dengan kunci yang valid; yang lainnya Anda dapat mendaftar untuk masuk daftar tunggu. Perbandingan yang berguna, kemudian, bukanlah "mana yang lebih baik" — melainkan apa yang sebenarnya dilakukan model yang telah dirilis hari ini, apa yang diklaim peta jalan untuk model yang belum dirilis, dan bagaimana seorang pengembang harus memperlakukan model yang dijanjikan tetapi terus tertunda sementara model yang aktif terus meningkat.

Salah satunya memiliki titik akhir.

Mulai dari ketersediaan, karena itu menentukan segalanya. Black Forest Labs meluncurkan Flux 3 pada 23 Juli sebagai satu model yang dilatih secara bersama-sama untuk prediksi gambar, video, audio, dan aksi robot, dibangun dengan pendekatan flow-matching yang disebut lab tersebut Self-Flow. Lebih dari 95% komputasi pelatihan tersebut dilaporkan digunakan untuk prediksi video, yang terlihat dari apa yang sebenarnya dirilis: hanya Flux 3 Video yang mencapai ketersediaan umum, pada 4 Agustus, dengan API berbayar. Halaman model untuk tingkatan gambar masih menampilkan label "segera hadir" dengan formulir aplikasi, bukan tombol mulai — tidak ada endpoint, tidak ada parameter terdokumentasi, tidak ada biaya per gambar, dan tidak ada tolok ukur yang dapat dijalankan siapa pun.

GPT-Image-2, sebaliknya, telah berproduksi selama empat bulan. Ope​nAI membuka akses API pada awal Mei, dan pengidentifikasi modelnya, gpt-image-2, cukup stabil sehingga snapshot tetap, gpt-image-2-2026-04-21, hidup berdampingan dengannya. Ini adalah model teks-ke-gambar nomor satu saat ini di kedua papan independen utama — 1.381 Elo di papan peringkat teks-ke-gambar Arena (build medium) dan 1.369 Elo untuk build high di Artificial Analysis — dan ia merender teks multibahasa termasuk CJK, mendasarkan generasi pada penelusuran web, dan menghasilkan keluaran hingga 4K. Empat bulan lalu lintas produksi adalah perbedaan antara klaim dan rekam jejak.

Perubahan terbaru di sisi GPT-Image-2

Peristiwa yang membuat perbandingan ini menjadi relevan tidak ada hubungannya dengan Flux 3. Pada 20 Agustus, Ope​nAI membuka pratinjau latar belakang transparan untuk GPT-Image-2 di Images API: atur latar belakang menjadi "transparent" dan endpoint mengembalikan PNG atau WebP dengan kanal alfa asli, sudah dipotong dan siap untuk dikomposit. Itu adalah fitur yang secara langsung menyasar pekerjaan produksi yang juga ditawarkan oleh roadmap Flux 3 image — foto produk, ikon, aset pemasaran — dan fitur tersebut hadir sebagai parameter pada endpoint yang sudah aktif, bukan sebagai model baru. Jadi sementara dunia menunggu endpoint Flux 3 image yang masih bertuliskan "coming soon," pemain mapan tersebut baru saja menutup salah satu celah yang selama ini menghalanginya masuk ke pipeline komposit.

Kemampuan ini hanya tersedia melalui API — tidak ada toggle ChatGPT — dan ini adalah parameter, bukan produk baru. Kedua endpoint Images API, yaitu generation dan edit, menerima field background dengan nilai "transparent", "opaque", dan "auto" (nilai default, di mana model yang memutuskan). Saluran alpha hanya bertahan pada output PNG atau WebP, sehingga permintaan harus menetapkan format output secara eksplisit. Referensi API OpenAI sendiri masih menandai dukungan transparent untuk gpt-image-2 dan snapshot gpt-image-2-2026-04-21 sebagai "in preview" — itu adalah label vendor, bukan pengumuman kelulusan — dan panduannya adalah menjaga prompt tetap bebas dari latar belakang yang dideskripsikan agar model benar-benar memenuhi permintaan transparent. Tidak ada endpoint baru, tidak ada ID model baru, tidak ada kartu harga terpisah: panggilan gpt-image-2 yang sama yang sebelumnya mengembalikan PNG buram sekarang mengembalikan cutout.

Comparison scoreboard titled 'GPT-Image-2 vs Flux 3 - the scoreboard'. GPT-Image-2 column: Released Apr 21, 2026; Availability Public API since May; Arena T2I Elo 1,381 (#1); Text rendering multilingual incl. CJK; Transparent bg preview Aug 20; Max resolution 4K. Flux 3 column: Released announced Jul 23, 2026; Availability image tier coming soon; Arena T2I Elo none yet; Text rendering promised; Transparent bg not stated; Max resolution not specified. Footer: GPT-Image-2 figures per Arena and OpenAI list pricing; Flux 3 image claims are a vendor roadmap. OrcaRouter logo bottom-right.

Apa yang dijanjikan gambar Flux 3, dan apa yang sebenarnya dirilis

Lembar spesifikasi tier gambar Flux 3 adalah peta jalan vendor, jadi perlakukanlah demikian. Black Forest Labs telah menjanjikan sintesis dan penyuntingan gambar di berbagai gaya dan resolusi, penanganan prompt kompleks yang lebih baik, rendering teks multibahasa berakurasi tinggi, transfer gaya zero-shot dari gambar referensi, konsistensi karakter dan merek tanpa fine-tuning, serta penyuntingan non-destruktif yang mempertahankan tekstur dan pencahayaan. Itu adalah hal-hal yang tepat untuk dijanjikan — itu adalah fitur-fitur persis yang menjadi ajang persaingan para pemimpin pasar saat ini — tetapi tidak ada satu pun yang dapat diuji saat ini karena tidak ada satu pun yang memiliki endpoint.

Yang sebenarnya dapat dipanggil dari BFL adalah tier video dan lini gambar FLUX yang lebih lama. Flux 3 Video dijual seharga $0.17 per detik untuk HD dan $0.29 per detik untuk FHD untuk render penuh, dengan mode draf $0.06 per detik. Angka yang dilaporkannya sendiri adalah 1.135 Elo untuk teks-ke-video dan 1.051 untuk gambar-ke-video, serta kemenangan preferensi atas Luma Ray 3.2, Runway Gen-4.5, Gr​ok Imagine Video, dan Kling v3 Pro — semuanya dilaporkan oleh vendor dan belum direproduksi, dan tidak ada yang terbawa ke tier gambar pula. Untuk gambar diam, penawaran BFL saat ini tetap pada lini FLUX.2, yang berada di 1.226 Elo pada papan Artificial Analysis yang sama tempat GPT-Image-2 memimpin dengan 1.369. Kesenjangan itulah konteks praktis untuk "Flux 3 image is coming": API gambar BFL saat ini sekitar 140 Elo di belakang milik Ope​nAI, dan model yang dijanjikan itulah yang dibutuhkan BFL untuk menutupnya.

Screenshot of the Artificial Analysis Text-to-Image leaderboard (captured August 20, 2026) showing GPT Image 2 (high) in first place at 1,369 Elo and Black Forest Labs' current image entry FLUX.2 (max) at 1,226 Elo, with no Flux 3 image entry present, in English.

Harga: hanya ada satu kartu harga asli.

Tidak ada harga gambar Flux 3, karena memang tidak ada produk gambar Flux 3. Satu-satunya angka yang dipublikasikan adalah tarif token GPT-Image-2: $5 per juta token input teks, $8 per juta token input gambar, dan $30 per juta token output gambar, dengan Batch API yang berjalan sekitar setengahnya untuk waktu pemrosesan hingga 24 jam. Ope​nAI tidak mempublikasikan token per gambar, sehingga angka per gambar adalah konversi, bukan kuotasi: kira-kira $0.006 untuk 1024×1024 kualitas rendah, sekitar $0.05 untuk kualitas sedang, sekitar $0.21 untuk kualitas tinggi, dan hingga sekitar $0.41 untuk render tinggi 4K. Sebagai perbandingan, itulah satu sisi pembukuan yang nyata; kolom gambar Flux 3 adalah sel kosong.

Screenshot of the OrcaRouter model page for openai/gpt-image-2 (captured August 20, 2026), showing the model description, input rate of $8.00 and output rate of $30.00 per million tokens, median latency, and community usage, in English.

Apa yang harus dilakukan pembangun dengan model yang dijanjikan

Sikap yang waras ketika model kompetitor terus tertunda adalah membangun di atas apa yang ada dan menjadikan masa depan sebagai perubahan konfigurasi, bukan arsitektur ulang. GPT-Image-2 dapat dirutekan hari ini melalui OrcaRouter — satu kunci API, harga daftar Ope​nAI diteruskan dengan markup 0%, failover otomatis antar penyedia — sehingga pipeline yang menghasilkan aset dengan itu nantinya dapat mengarahkan endpoint yang sama ke API Flux 3 image pada hari endpoint itu benar-benar ada, dan merutekan sebagian lalu lintas ke sana dengan DSL perutean tanpa menyentuh kode pemanggil. Anda mendapatkan model yang sudah dirilis sekarang, dan ketika model yang dijanjikan tiba, Anda mengevaluasinya terhadap baseline yang berfungsi, bukan terhadap siaran pers. Menunggu tidak membuat Anda kehilangan apa pun; membangun di atas ketiadaan sambil menunggu membuat Anda kehilangan segalanya.

Kesimpulannya memang sengaja dibuat timpang. Jika Anda membutuhkan pembuatan gambar pada kuartal ini, GPT-Image-2 adalah pilihannya dan tidak ada pertanyaan kedua — ia adalah nomor satu secara independen, baru saja menambahkan keluaran latar belakang transparan di API, serta memiliki API publik dan harga yang stabil. Flux 3 image adalah alasan untuk mengawasi Black Forest Labs, bukan alasan untuk menunda proyek. Pantau pembukaan akses awal dan benchmark independen pertama; begitu endpoint tersedia, perbandingan dalam pos ini menjadi pengujian yang benar-benar dapat Anda jalankan.