
GPT-Image-2 vs Flux 3: Membandingkan Model Langsung dengan Peta Jalan
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0240Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0340Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Kecerdasan69Koding
Ini bukan postingan model-versus-model biasa, karena GPT-Image-2 dan Flux 3berada dalam kondisi keberadaan yang tidak sama. GPT-Image-2 dirilis pada 21 April 2026, telah dapat dipanggil melalui API OpenAI sejak awal Mei, dan memperoleh kemampuan baru minggu ini — pembuatan gambar dengan latar belakang transparan di API, diumumkan pada 20 Agustus dan tersedia sekarang. Flux 3 adalah model fondasi multimodal milik Black Forest Labs, diumumkan pada 23 Juli 2026, dan tingkat gambar masih belum memiliki endpoint publik, ID model, atau daftar harga hingga tulisan ini dibuat. Salah satunya dapat Anda panggil pada pukul 3 pagi dengan kunci yang valid; yang lainnya Anda dapat mendaftar untuk masuk daftar tunggu. Perbandingan yang berguna, kemudian, bukanlah "mana yang lebih baik" — melainkan apa yang sebenarnya dilakukan model yang telah dirilis hari ini, apa yang diklaim peta jalan untuk model yang belum dirilis, dan bagaimana seorang pengembang harus memperlakukan model yang dijanjikan tetapi terus tertunda sementara model yang aktif terus meningkat.
Salah satunya memiliki titik akhir.
Mulai dari ketersediaan, karena itu menentukan segalanya. Black Forest Labs meluncurkan Flux 3 pada 23 Juli sebagai satu model yang dilatih secara bersama-sama untuk prediksi gambar, video, audio, dan aksi robot, dibangun dengan pendekatan flow-matching yang disebut lab tersebut Self-Flow. Lebih dari 95% komputasi pelatihan tersebut dilaporkan digunakan untuk prediksi video, yang terlihat dari apa yang sebenarnya dirilis: hanya Flux 3 Video yang mencapai ketersediaan umum, pada 4 Agustus, dengan API berbayar. Halaman model untuk tingkatan gambar masih menampilkan label "segera hadir" dengan formulir aplikasi, bukan tombol mulai — tidak ada endpoint, tidak ada parameter terdokumentasi, tidak ada biaya per gambar, dan tidak ada tolok ukur yang dapat dijalankan siapa pun.
GPT-Image-2, sebaliknya, telah berproduksi selama empat bulan. OpenAI membuka akses API pada awal Mei, dan pengidentifikasi modelnya, gpt-image-2, cukup stabil sehingga snapshot tetap, gpt-image-2-2026-04-21, hidup berdampingan dengannya. Ini adalah model teks-ke-gambar nomor satu saat ini di kedua papan independen utama — 1.381 Elo di papan peringkat teks-ke-gambar Arena (build medium) dan 1.369 Elo untuk build high di Artificial Analysis — dan ia merender teks multibahasa termasuk CJK, mendasarkan generasi pada penelusuran web, dan menghasilkan keluaran hingga 4K. Empat bulan lalu lintas produksi adalah perbedaan antara klaim dan rekam jejak.
Perubahan terbaru di sisi GPT-Image-2
Peristiwa yang membuat perbandingan ini menjadi relevan tidak ada hubungannya dengan Flux 3. Pada 20 Agustus, OpenAI membuka pratinjau latar belakang transparan untuk GPT-Image-2 di Images API: atur latar belakang menjadi "transparent" dan endpoint mengembalikan PNG atau WebP dengan kanal alfa asli, sudah dipotong dan siap untuk dikomposit. Itu adalah fitur yang secara langsung menyasar pekerjaan produksi yang juga ditawarkan oleh roadmap Flux 3 image — foto produk, ikon, aset pemasaran — dan fitur tersebut hadir sebagai parameter pada endpoint yang sudah aktif, bukan sebagai model baru. Jadi sementara dunia menunggu endpoint Flux 3 image yang masih bertuliskan "coming soon," pemain mapan tersebut baru saja menutup salah satu celah yang selama ini menghalanginya masuk ke pipeline komposit.
Kemampuan ini hanya tersedia melalui API — tidak ada toggle ChatGPT — dan ini adalah parameter, bukan produk baru. Kedua endpoint Images API, yaitu generation dan edit, menerima field background dengan nilai "transparent", "opaque", dan "auto" (nilai default, di mana model yang memutuskan). Saluran alpha hanya bertahan pada output PNG atau WebP, sehingga permintaan harus menetapkan format output secara eksplisit. Referensi API OpenAI sendiri masih menandai dukungan transparent untuk gpt-image-2 dan snapshot gpt-image-2-2026-04-21 sebagai "in preview" — itu adalah label vendor, bukan pengumuman kelulusan — dan panduannya adalah menjaga prompt tetap bebas dari latar belakang yang dideskripsikan agar model benar-benar memenuhi permintaan transparent. Tidak ada endpoint baru, tidak ada ID model baru, tidak ada kartu harga terpisah: panggilan gpt-image-2 yang sama yang sebelumnya mengembalikan PNG buram sekarang mengembalikan cutout.

Apa yang dijanjikan gambar Flux 3, dan apa yang sebenarnya dirilis
Lembar spesifikasi tier gambar Flux 3 adalah peta jalan vendor, jadi perlakukanlah demikian. Black Forest Labs telah menjanjikan sintesis dan penyuntingan gambar di berbagai gaya dan resolusi, penanganan prompt kompleks yang lebih baik, rendering teks multibahasa berakurasi tinggi, transfer gaya zero-shot dari gambar referensi, konsistensi karakter dan merek tanpa fine-tuning, serta penyuntingan non-destruktif yang mempertahankan tekstur dan pencahayaan. Itu adalah hal-hal yang tepat untuk dijanjikan — itu adalah fitur-fitur persis yang menjadi ajang persaingan para pemimpin pasar saat ini — tetapi tidak ada satu pun yang dapat diuji saat ini karena tidak ada satu pun yang memiliki endpoint.
Yang sebenarnya dapat dipanggil dari BFL adalah tier video dan lini gambar FLUX yang lebih lama. Flux 3 Video dijual seharga $0.17 per detik untuk HD dan $0.29 per detik untuk FHD untuk render penuh, dengan mode draf $0.06 per detik. Angka yang dilaporkannya sendiri adalah 1.135 Elo untuk teks-ke-video dan 1.051 untuk gambar-ke-video, serta kemenangan preferensi atas Luma Ray 3.2, Runway Gen-4.5, Grok Imagine Video, dan Kling v3 Pro — semuanya dilaporkan oleh vendor dan belum direproduksi, dan tidak ada yang terbawa ke tier gambar pula. Untuk gambar diam, penawaran BFL saat ini tetap pada lini FLUX.2, yang berada di 1.226 Elo pada papan Artificial Analysis yang sama tempat GPT-Image-2 memimpin dengan 1.369. Kesenjangan itulah konteks praktis untuk "Flux 3 image is coming": API gambar BFL saat ini sekitar 140 Elo di belakang milik OpenAI, dan model yang dijanjikan itulah yang dibutuhkan BFL untuk menutupnya.

Harga: hanya ada satu kartu harga asli.
Tidak ada harga gambar Flux 3, karena memang tidak ada produk gambar Flux 3. Satu-satunya angka yang dipublikasikan adalah tarif token GPT-Image-2: $5 per juta token input teks, $8 per juta token input gambar, dan $30 per juta token output gambar, dengan Batch API yang berjalan sekitar setengahnya untuk waktu pemrosesan hingga 24 jam. OpenAI tidak mempublikasikan token per gambar, sehingga angka per gambar adalah konversi, bukan kuotasi: kira-kira $0.006 untuk 1024×1024 kualitas rendah, sekitar $0.05 untuk kualitas sedang, sekitar $0.21 untuk kualitas tinggi, dan hingga sekitar $0.41 untuk render tinggi 4K. Sebagai perbandingan, itulah satu sisi pembukuan yang nyata; kolom gambar Flux 3 adalah sel kosong.

Apa yang harus dilakukan pembangun dengan model yang dijanjikan
Sikap yang waras ketika model kompetitor terus tertunda adalah membangun di atas apa yang ada dan menjadikan masa depan sebagai perubahan konfigurasi, bukan arsitektur ulang. GPT-Image-2 dapat dirutekan hari ini melalui OrcaRouter — satu kunci API, harga daftar OpenAI diteruskan dengan markup 0%, failover otomatis antar penyedia — sehingga pipeline yang menghasilkan aset dengan itu nantinya dapat mengarahkan endpoint yang sama ke API Flux 3 image pada hari endpoint itu benar-benar ada, dan merutekan sebagian lalu lintas ke sana dengan DSL perutean tanpa menyentuh kode pemanggil. Anda mendapatkan model yang sudah dirilis sekarang, dan ketika model yang dijanjikan tiba, Anda mengevaluasinya terhadap baseline yang berfungsi, bukan terhadap siaran pers. Menunggu tidak membuat Anda kehilangan apa pun; membangun di atas ketiadaan sambil menunggu membuat Anda kehilangan segalanya.
Kesimpulannya memang sengaja dibuat timpang. Jika Anda membutuhkan pembuatan gambar pada kuartal ini, GPT-Image-2 adalah pilihannya dan tidak ada pertanyaan kedua — ia adalah nomor satu secara independen, baru saja menambahkan keluaran latar belakang transparan di API, serta memiliki API publik dan harga yang stabil. Flux 3 image adalah alasan untuk mengawasi Black Forest Labs, bukan alasan untuk menunda proyek. Pantau pembukaan akses awal dan benchmark independen pertama; begitu endpoint tersedia, perbandingan dalam pos ini menjadi pengujian yang benar-benar dapat Anda jalankan.
