
Ideogram 4.5 vs GPT Image 2.5: Ideogram Sendiri yang Memulai Pertarungan Ini
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 261 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 216 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- xAISpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
Sebagian besar perbandingan model disusun oleh siapa pun yang menulisnya. Yang ini disusun oleh Ideogram. Halaman peluncuran untuk Ideogram 4.5, yang tayang sejak 30 September 2026, menampilkan demo penyuntingan berdampingan dan menyebutkan para pesaingnya dalam keterangan: "penyuntingan yang sama pada Ideogram 4.5 vs. GPT Image 2.5 Sunburst, Nano Banana Pro, dan Nano Banana 2." Lalu muncul klaim tentang apa yang akan dilihat penonton — "hasil GPT Image dan Nano Banana menjadi tidak dapat digunakan setelah beberapa kali penyuntingan, sementara Ideogram 4.5 tetap bersih dari satu penyuntingan ke penyuntingan berikutnya."
Itu sangat langsung. Vendor yang memilih target benchmark dan memberi tahu Anda hasilnya terlebih dahulu patut ditanggapi dengan serius dalam satu sisi dan dengan skeptis dalam sisi lain. GPT Image 2.5 adalah yang terkuat di papan independen di kedua kategori gambar, jadi itu lawan yang tepat untuk dipilih. Dan ini adalah rilis dua-identifier — Flare dan Sunburst, keduanya dirilis pada 8 September 2026 — dengan skor arena publik yang saat ini belum bisa disamai oleh Ideogram 4.5. Pertanyaan yang menarik bukanlah siapa yang menang di arena. Melainkan apakah klaim Ideogram mengukur sesuatu yang tidak diukur oleh arena.
Di mana posisi kedua model, tepatnya
• Ideogram 4.5 — dirilis 30 September 2026. Model penyuntingan presisi; menghasilkan sekaligus menyunting pada empat kecepatan rendering; 2K native; penyuntingan ditunjukkan pada resolusi sumber hingga 4.016 × 6.016 (24,2 MP). Text-to-image peringkat ke-34 dari 167 pada 1.014 ± 11 Elo (2.247 suara); penyuntingan gambar peringkat ke-23 pada 1.064 ± 11 Elo (2.382 suara). $0,03–$0,22 per gambar menurut pengaturan kecepatan.
• GPT Image 2.5 Sunburst — dirilis 8 September 2026 sebagai bagian pertama yang mengutamakan presisi dari peningkatan gambar terpisah OpenAI, pengenal API gpt-image-2.5-sunburst. Teks-ke-gambar No. 1 pada 1,197 ± 9 Elo (14,023 suara); penyuntingan gambar No. 1 pada 1,182 ± 8 Elo (17,899 suara). Dihargai $210.70 per 1,000 gambar berdasarkan konversi papan peringkat.
• GPT Image 2.5 Flare — bagian cepat dari rilis yang sama, pengenal gpt-image-2.5-flare. No. 2 di kedua papan peringkat: 1.190 teks-ke-gambar, 1.162 penyuntingan. Sama $210,70 per 1.000.
Letakkan kedua angka pengeditan itu berdampingan dan selisihnya adalah 118 Elo — 1.182 berbanding 1.064 — dengan interval kepercayaan ±8 dan ±11. Interval-interval tersebut tidak tumpang tindih. Di papan yang mengukur preferensi pengeditan sekali jalan, Sunburst menang, dan kemenangannya didukung oleh jumlah suara sekitar tujuh setengah kali lipat.
Apa yang diukur dan tidak diukur oleh leaderboard
Inilah bagian yang menentukan apakah klaim Ideogram bertahan saat bersentuhan dengan bukti.
Arena penyuntingan Artificial Analysis adalah preferensi manusia berpasangan secara buta: pemilih melihat gambar sumber yang sama dan instruksi yang sama, menerima dua hasil editan tanpa label, lalu memilih yang lebih baik. Ini adalah metode yang kuat untuk “mana dari dua keluaran ini yang tampak lebih sesuai dengan apa yang diminta oleh instruksi.”
Ini tidak dapat mengukur hal yang diiklankan Ideogram. Pemilih yang menilai satu penyuntingan tidak dapat melihat apakah model diam-diam mengubah wallpaper, menggeser wajah sejauh dua milimeter, atau merender ulang grain di seluruh bagian bingkai lainnya. Kegagalan yang diklaim Ideogram dapat diperbaiki baru menjadi terlihat dalam suatu rangkaian — langkah keempat, ketujuh, kesepuluh — dan tidak ada arena arus utama yang menyajikan rangkaian kepada pemilih. Elo 1.064 menunjukkan bahwa penyuntingan individual Ideogram bagus. Itu sama sekali tidak menunjukkan apakah penyuntingan tersebut tetap bagus.
Hal itu bisa menguntungkan sekaligus merugikan Ideogram, dan versi jujurnya adalah ini: papan peringkat tidak mengonfirmasi klaim pergeseran itu, dan juga tidak membantahnya. Yang dibantahnya adalah klaim implisit yang lebih kuat yang mungkin disiratkan halaman peluncuran — bahwa 4.5 adalah editor yang lebih baik, titik. Jika dibandingkan dengan papan peringkat, ia adalah editor berperingkat lebih rendah dengan selisih yang lebih lebar daripada margin galatnya.

Apa yang dilakukan masing-masing yang tidak dilakukan oleh yang lain
• Pengeditan resolusi sumber — Klaim teknis yang membedakan Ideogram 4.5. Halamannya menunjukkan pengeditan yang diterapkan pada sumber 4.016 × 6.016 tanpa penurunan skala, dengan janji bahwa batas pengeditan dipertahankan cukup baik untuk menyambungkan kembali potongan ke dalam aslinya. Untuk pekerjaan cetak, itulah perbedaan antara hasil yang dapat diserahkan dan kompromi.
• Luasnya permukaan parameter — milik GPT Image 2.5. OpenAI menambahkan xhigh dan max ke tangga kualitas dan menjadikan latar belakang transparan sebagai parameter kelas satu, dengan background disetel ke transparent, opaque, atau auto serta keluaran PNG atau WebP. Keluaran transparan merupakan celah pada GPT Image 2 dan menjadi fitur unggulan pada pasangan 2.5.
• Jalur cepat — Flare hadir khusus untuk menjadi default yang cepat. OpenAI mengklaim latensi hingga 50% lebih rendah dibandingkan generasi sebelumnya; Sunburst sengaja dibuat lebih lambat dan ditujukan untuk penyuntingan yang harus tahan terhadap pemeriksaan ketat.
• Struktur harga — Ideogram menagih per gambar berdasarkan kecepatan rendering ($0,03 hingga $0,22). OpenAI menagih berdasarkan token dengan kartu tarif yang sama seperti GPT Image 2 — $8 per juta token masukan gambar, $30 per juta token keluaran gambar — itulah sebabnya konversi per gambar independen berada di kisaran $0,21 untuk gambar 1024 × 1024 berkualitas tinggi.
Garis harga bersilangan di titik yang janggal. Pada setelan Low dan Medium Ideogram 4.5, biaya per gambar jauh lebih murah dibandingkan pasangan OpenAI. Pada High — tempat demonstrasi drift berada, dan tempat Anda akan menjalankan sumber 24 megapiksel — keduanya hampir sama angkanya. Perbandingan yang sebenarnya akan dijalankan sebagian besar pembeli adalah Ideogram 4.5 kualitas High melawan Sunburst kualitas tinggi, dan pada perbandingan itu harganya kurang lebih imbang dengan defisit 118 Elo pada papan terukur.
Itu tidak masalah, jika klaim drift itu benar. Itulah keseluruhan taruhannya.


Perbedaan aksesibilitas yang tidak dipasarkan siapa pun
Satu asimetri praktis berjalan berlawanan arah dari papan skor. Dua pengenal GPT Image 2.5 lebih baru daripada apa pun di katalog OrcaRouter — lini gambar OpenAI kami saat ini adalah GPT-Image-1.5 pada $8/$32 per juta token dan GPT-Image-2 pada $8/$30, keduanya pada harga daftar penyedia tanpa markup tambahan. Pasangan 2.5 muncul di daftar tarif OpenAI pada $8/$30 yang sama seperti GPT-Image-2, yang berarti begitu keduanya dapat dirutekan, keduanya mendarat pada harga pass-through yang sama alih-alih harga baru, dan pertanyaan biaya di antara keduanya menjadi tentang efisiensi token alih-alih tentang vendor mana yang Anda panggil.
Ideogram 4.5 tersedia di API milik Ideogram sendiri dan di platform mitra. Model ini tidak ada di katalog kami. Hal itu penting untuk perbandingan ini dengan cara yang membosankan: salah satu dari dua model ini bisa langsung dipakai untuk klien yang kompatibel dengan OpenAI dan yang lainnya adalah integrasi baru. Jika Anda sudah memanggil GPT-Image-2 melalui endpoint yang berbentuk OpenAI, biaya mencoba Sunburst hanyalah mengubah ID model; biaya mencoba Ideogram 4.5 adalah kontrak kedua dan klien kedua, bahkan sebelum Anda sampai ke tahap mengevaluasi kualitas.
Lapisan perutean tidak menghilangkan perbedaan itu — lapisan itu hanya menghilangkan urusan integrasi dari sisi yang sudah kompatibel, dan memungkinkan Anda mengarahkan sebagian trafik ke pendatang baru tanpa mengikatkan jalur produksi padanya. Failover lebih penting daripada biasanya di sini, karena yang akan Anda uji coba adalah model yang klaim utamanya tidak memiliki verifikasi independen dan ukuran sampelnya hanya seperlima dari pesaingnya.
Cara menyelesaikannya
Jangan jalankan perbandingan ini pada gambar tunggal. Itu metode arena dan itu instrumen yang salah — ia akan memberitahu Anda bahwa Sunburst menang, yang sudah Anda ketahui.
Jalankan ini pada sekuens. Ambil lima atau sepuluh gambar dari karya Anda sendiri, tulis rantai yang sama yang terdiri dari enam atau delapan edit progresif, lalu jalankan rantai identik itu pada Ideogram 4.5 (High) dan pada Sunburst (max). Kemudian lakukan diff antara langkah satu dan langkah delapan untuk setiap model, pada area yang tidak pernah Anda minta disentuh oleh model. Hitung piksel yang berubah. Angka itu — divergensi wilayah tak berubah di sepanjang sekuens — adalah hal yang diklaim Ideogram untuk dimenangkan, dan sepengetahuan saya tidak ada yang mempublikasikannya untuk model mana pun di antara keduanya.
Lalu, hitung harga kedua eksekusi per sekuens yang selesai. Pada titik itu, Anda akan memiliki jawaban yang bernilai lebih dari 118 Elo, karena jawaban itu akan tentang gambar Anda, bukan tentang gambar milik panel pemilih.
Apa sebenarnya pertandingan ini
Ideogram 4.5 tidak mengikuti kontes yang dimenangkannya di papan peringkat, dan tampaknya ia mengetahui hal itu — itulah sebabnya halaman peluncurannya memperagakan sebuah perilaku alih-alih mencetak peringkat. Perilaku yang diperagakannya cukup nyata untuk layak diuji dan cukup spesifik untuk dapat difalsifikasi: entah hasil suntingan berulang tetap koheren atau tidak, dan uji sepuluh putaran pada berkas Anda sendiri menyelesaikannya dalam satu sore.
Pembacaan yang masuk akal saat ini adalah bahwa GPT Image 2.5 Sunburst adalah editor yang lebih baik berdasarkan satu-satunya tolok ukur independen yang ada, dengan selisih di luar batas kesalahan, dan dengan jauh lebih banyak bukti yang mendukung angka tersebut — serta bahwa Ideogram 4.5 menjual properti yang lebih sempit dan belum terukur pada harga yang lebih murah pada pengaturan rendah dan kurang lebih setara pada pengaturan yang menjadi dasar klaimnya. Jika kesetiaan multi-turn adalah hambatan produksi Anda, pengujiannya murah dan model itu layak mendapatkannya. Jika bukan, papan peringkat sudah menjawabnya.
