Kartu judul hero untuk Ideogram 4.5 vs GPT Image 2.5, bertuliskan 'Terpaut 97 Elo dalam penyuntingan — dan vendor menyebut lawannya', dengan chip untuk 'Ideogram 4.5 — live 30 Sep 2026', 'GPT Image 2.5 Sunburst — live 8 Sep 2026', 'Elo edit Ideogram 4.5 1,064', 'Elo edit Sunburst 1,182'. Logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

Ideogram 4.5 vs GPT Image 2.5: Ideogram Sendiri yang Memulai Pertarungan Ini

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Sebagian besar perbandingan model disusun oleh siapa pun yang menulisnya. Yang ini disusun oleh Ideogram. Halaman peluncuran untuk Ideogram 4.5, yang tayang sejak 30 September 2026, menampilkan demo penyuntingan berdampingan dan menyebutkan para pesaingnya dalam keterangan: "penyuntingan yang sama pada Ideogram 4.5 vs. GPT Image 2.5 Sunburst, Nano Banana Pro, dan Nano Banana 2." Lalu muncul klaim tentang apa yang akan dilihat penonton — "hasil GPT Image dan Nano Banana menjadi tidak dapat digunakan setelah beberapa kali penyuntingan, sementara Ideogram 4.5 tetap bersih dari satu penyuntingan ke penyuntingan berikutnya."

Itu sangat langsung. Vendor yang memilih target benchmark dan memberi tahu Anda hasilnya terlebih dahulu patut ditanggapi dengan serius dalam satu sisi dan dengan skeptis dalam sisi lain. GPT Image 2.5 adalah yang terkuat di papan independen di kedua kategori gambar, jadi itu lawan yang tepat untuk dipilih. Dan ini adalah rilis dua-identifier — Flare dan Sunburst, keduanya dirilis pada 8 September 2026 — dengan skor arena publik yang saat ini belum bisa disamai oleh Ideogram 4.5. Pertanyaan yang menarik bukanlah siapa yang menang di arena. Melainkan apakah klaim Ideogram mengukur sesuatu yang tidak diukur oleh arena.

Di mana posisi kedua model, tepatnya

• Ideogram 4.5 — dirilis 30 September 2026. Model penyuntingan presisi; menghasilkan sekaligus menyunting pada empat kecepatan rendering; 2K native; penyuntingan ditunjukkan pada resolusi sumber hingga 4.016 × 6.016 (24,2 MP). Text-to-image peringkat ke-34 dari 167 pada 1.014 ± 11 Elo (2.247 suara); penyuntingan gambar peringkat ke-23 pada 1.064 ± 11 Elo (2.382 suara). $0,03–$0,22 per gambar menurut pengaturan kecepatan.

• GPT Image 2.5 Sunburst — dirilis 8 September 2026 sebagai bagian pertama yang mengutamakan presisi dari peningkatan gambar terpisah OpenAI, pengenal API gpt-image-2.5-sunburst. Teks-ke-gambar No. 1 pada 1,197 ± 9 Elo (14,023 suara); penyuntingan gambar No. 1 pada 1,182 ± 8 Elo (17,899 suara). Dihargai $210.70 per 1,000 gambar berdasarkan konversi papan peringkat.

• GPT Image 2.5 Flare — bagian cepat dari rilis yang sama, pengenal gpt-image-2.5-flare. No. 2 di kedua papan peringkat: 1.190 teks-ke-gambar, 1.162 penyuntingan. Sama $210,70 per 1.000.

Letakkan kedua angka pengeditan itu berdampingan dan selisihnya adalah 118 Elo — 1.182 berbanding 1.064 — dengan interval kepercayaan ±8 dan ±11. Interval-interval tersebut tidak tumpang tindih. Di papan yang mengukur preferensi pengeditan sekali jalan, Sunburst menang, dan kemenangannya didukung oleh jumlah suara sekitar tujuh setengah kali lipat.

Apa yang diukur dan tidak diukur oleh leaderboard

Inilah bagian yang menentukan apakah klaim Ideogram bertahan saat bersentuhan dengan bukti.

Arena penyuntingan Artificial Analysis adalah preferensi manusia berpasangan secara buta: pemilih melihat gambar sumber yang sama dan instruksi yang sama, menerima dua hasil editan tanpa label, lalu memilih yang lebih baik. Ini adalah metode yang kuat untuk “mana dari dua keluaran ini yang tampak lebih sesuai dengan apa yang diminta oleh instruksi.”

Ini tidak dapat mengukur hal yang diiklankan Ideogram. Pemilih yang menilai satu penyuntingan tidak dapat melihat apakah model diam-diam mengubah wallpaper, menggeser wajah sejauh dua milimeter, atau merender ulang grain di seluruh bagian bingkai lainnya. Kegagalan yang diklaim Ideogram dapat diperbaiki baru menjadi terlihat dalam suatu rangkaian — langkah keempat, ketujuh, kesepuluh — dan tidak ada arena arus utama yang menyajikan rangkaian kepada pemilih. Elo 1.064 menunjukkan bahwa penyuntingan individual Ideogram bagus. Itu sama sekali tidak menunjukkan apakah penyuntingan tersebut tetap bagus.

Hal itu bisa menguntungkan sekaligus merugikan Ideogram, dan versi jujurnya adalah ini: papan peringkat tidak mengonfirmasi klaim pergeseran itu, dan juga tidak membantahnya. Yang dibantahnya adalah klaim implisit yang lebih kuat yang mungkin disiratkan halaman peluncuran — bahwa 4.5 adalah editor yang lebih baik, titik. Jika dibandingkan dengan papan peringkat, ia adalah editor berperingkat lebih rendah dengan selisih yang lebih lebar daripada margin galatnya.

Screenshot of the Ideogram 4.5 model page showing the model-comparison section headed 'Compare models across multi-turn edits', with a side-by-side video widget captioned to show the same edits applied to Ideogram 4.5 alongside GPT Image 2.5 Sunburst, Nano Banana Pro and Nano Banana 2

Apa yang dilakukan masing-masing yang tidak dilakukan oleh yang lain

• Pengeditan resolusi sumber — Klaim teknis yang membedakan Ideogram 4.5. Halamannya menunjukkan pengeditan yang diterapkan pada sumber 4.016 × 6.016 tanpa penurunan skala, dengan janji bahwa batas pengeditan dipertahankan cukup baik untuk menyambungkan kembali potongan ke dalam aslinya. Untuk pekerjaan cetak, itulah perbedaan antara hasil yang dapat diserahkan dan kompromi.

• Luasnya permukaan parameter — milik GPT Image 2.5. OpenAI menambahkan xhigh dan max ke tangga kualitas dan menjadikan latar belakang transparan sebagai parameter kelas satu, dengan background disetel ke transparent, opaque, atau auto serta keluaran PNG atau WebP. Keluaran transparan merupakan celah pada GPT Image 2 dan menjadi fitur unggulan pada pasangan 2.5.

• Jalur cepat — Flare hadir khusus untuk menjadi default yang cepat. OpenAI mengklaim latensi hingga 50% lebih rendah dibandingkan generasi sebelumnya; Sunburst sengaja dibuat lebih lambat dan ditujukan untuk penyuntingan yang harus tahan terhadap pemeriksaan ketat.

• Struktur harga — Ideogram menagih per gambar berdasarkan kecepatan rendering ($0,03 hingga $0,22). OpenAI menagih berdasarkan token dengan kartu tarif yang sama seperti GPT Image 2 — $8 per juta token masukan gambar, $30 per juta token keluaran gambar — itulah sebabnya konversi per gambar independen berada di kisaran $0,21 untuk gambar 1024 × 1024 berkualitas tinggi.

Garis harga bersilangan di titik yang janggal. Pada setelan Low dan Medium Ideogram 4.5, biaya per gambar jauh lebih murah dibandingkan pasangan OpenAI. Pada High — tempat demonstrasi drift berada, dan tempat Anda akan menjalankan sumber 24 megapiksel — keduanya hampir sama angkanya. Perbandingan yang sebenarnya akan dijalankan sebagian besar pembeli adalah Ideogram 4.5 kualitas High melawan Sunburst kualitas tinggi, dan pada perbandingan itu harganya kurang lebih imbang dengan defisit 118 Elo pada papan terukur.

Itu tidak masalah, jika klaim drift itu benar. Itulah keseluruhan taruhannya.

Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.Comparison scoreboard for Ideogram 4.5 and GPT Image 2.5 Sunburst. Left column 'Ideogram 4.5': live Sep 30 2026, editing rank 23 at 1,064 Elo from 2,382 votes, text-to-image rank 34 at 1,014 Elo, $0.03 to $0.22 per image, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'GPT Image 2.5 Sunburst': live Sep 8 2026, editing rank 1 at 1,182 Elo from 17,899 votes, text-to-image rank 1 at 1,197 Elo, $210.70 per 1,000 images, transparent background output, quality ladder through max. A footer reads 'All leaderboard figures per Artificial Analysis, October 2026; price conversions are the board's own.'

Perbedaan aksesibilitas yang tidak dipasarkan siapa pun

Satu asimetri praktis berjalan berlawanan arah dari papan skor. Dua pengenal GPT Image 2.5 lebih baru daripada apa pun di katalog OrcaRouter — lini gambar OpenAI kami saat ini adalah GPT-Image-1.5 pada $8/$32 per juta token dan GPT-Image-2 pada $8/$30, keduanya pada harga daftar penyedia tanpa markup tambahan. Pasangan 2.5 muncul di daftar tarif OpenAI pada $8/$30 yang sama seperti GPT-Image-2, yang berarti begitu keduanya dapat dirutekan, keduanya mendarat pada harga pass-through yang sama alih-alih harga baru, dan pertanyaan biaya di antara keduanya menjadi tentang efisiensi token alih-alih tentang vendor mana yang Anda panggil.

Ideogram 4.5 tersedia di API milik Ideogram sendiri dan di platform mitra. Model ini tidak ada di katalog kami. Hal itu penting untuk perbandingan ini dengan cara yang membosankan: salah satu dari dua model ini bisa langsung dipakai untuk klien yang kompatibel dengan OpenAI dan yang lainnya adalah integrasi baru. Jika Anda sudah memanggil GPT-Image-2 melalui endpoint yang berbentuk OpenAI, biaya mencoba Sunburst hanyalah mengubah ID model; biaya mencoba Ideogram 4.5 adalah kontrak kedua dan klien kedua, bahkan sebelum Anda sampai ke tahap mengevaluasi kualitas.

Lapisan perutean tidak menghilangkan perbedaan itu — lapisan itu hanya menghilangkan urusan integrasi dari sisi yang sudah kompatibel, dan memungkinkan Anda mengarahkan sebagian trafik ke pendatang baru tanpa mengikatkan jalur produksi padanya. Failover lebih penting daripada biasanya di sini, karena yang akan Anda uji coba adalah model yang klaim utamanya tidak memiliki verifikasi independen dan ukuran sampelnya hanya seperlima dari pesaingnya.

Cara menyelesaikannya

Jangan jalankan perbandingan ini pada gambar tunggal. Itu metode arena dan itu instrumen yang salah — ia akan memberitahu Anda bahwa Sunburst menang, yang sudah Anda ketahui.

Jalankan ini pada sekuens. Ambil lima atau sepuluh gambar dari karya Anda sendiri, tulis rantai yang sama yang terdiri dari enam atau delapan edit progresif, lalu jalankan rantai identik itu pada Ideogram 4.5 (High) dan pada Sunburst (max). Kemudian lakukan diff antara langkah satu dan langkah delapan untuk setiap model, pada area yang tidak pernah Anda minta disentuh oleh model. Hitung piksel yang berubah. Angka itu — divergensi wilayah tak berubah di sepanjang sekuens — adalah hal yang diklaim Ideogram untuk dimenangkan, dan sepengetahuan saya tidak ada yang mempublikasikannya untuk model mana pun di antara keduanya.

Lalu, hitung harga kedua eksekusi per sekuens yang selesai. Pada titik itu, Anda akan memiliki jawaban yang bernilai lebih dari 118 Elo, karena jawaban itu akan tentang gambar Anda, bukan tentang gambar milik panel pemilih.

Apa sebenarnya pertandingan ini

Ideogram 4.5 tidak mengikuti kontes yang dimenangkannya di papan peringkat, dan tampaknya ia mengetahui hal itu — itulah sebabnya halaman peluncurannya memperagakan sebuah perilaku alih-alih mencetak peringkat. Perilaku yang diperagakannya cukup nyata untuk layak diuji dan cukup spesifik untuk dapat difalsifikasi: entah hasil suntingan berulang tetap koheren atau tidak, dan uji sepuluh putaran pada berkas Anda sendiri menyelesaikannya dalam satu sore.

Pembacaan yang masuk akal saat ini adalah bahwa GPT Image 2.5 Sunburst adalah editor yang lebih baik berdasarkan satu-satunya tolok ukur independen yang ada, dengan selisih di luar batas kesalahan, dan dengan jauh lebih banyak bukti yang mendukung angka tersebut — serta bahwa Ideogram 4.5 menjual properti yang lebih sempit dan belum terukur pada harga yang lebih murah pada pengaturan rendah dan kurang lebih setara pada pengaturan yang menjadi dasar klaimnya. Jika kesetiaan multi-turn adalah hambatan produksi Anda, pengujiannya murah dan model itu layak mendapatkannya. Jika bukan, papan peringkat sudah menjawabnya.