
Grok Imagine Image 2.0: #4 di Artificial Analysis, dengan Harga Sepertiga
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok Imagine Image 2.0 telah menempati peringkat #4 di Text to Image Leaderboard milik Artificial Analysis, dan angka yang penting bukanlah peringkatnya — melainkan harganya yang tertera di sebelahnya. Model ini berada di 1.153,66 Elo, di belakang tiga entri: GPT Image 2.5 Flare (max), GPT Image 2.5 Sunburst (max), dan GPT Image 2 (high). Mengungguli model dari lab lain mana pun, termasuk MAI-Image-2.6 milik Microsoft dan model Nano Banana 2. Hal itu menjadikan model ini sebagai generator gambar dengan peringkat tertinggi di luar trio tersebut, dan yang termurah di empat besar itu dengan selisih yang lebar: Artificial Analysis menetapkan harganya pada $60 per 1.000 gambar, dibandingkan sekitar $211 untuk tiga entri di atasnya. Model itu sendiri berasal dari 7 Agustus 2026 — yang berubah adalah posisi yang diberikan papan independen tersebut, dan dampaknya terhadap narasi "nomor 2 dunia" yang digunakan pembuatnya saat peluncuran.
Apa yang sebenarnya diukur oleh penempatan #4
Text to Image Leaderboard dari Artificial Analysis adalah arena preferensi manusia secara buta: pemilih melihat keluaran dari prompt yang sama tanpa label model dan memilih yang lebih baik, lalu Elo yang dihasilkan dipublikasikan secara independen dari vendor mana pun. Entri Grok Imagine Image 2.0 tercatat di peringkat #4 dengan Elo 1.153,66 dan interval kepercayaan 95% dari 1.141,66 hingga 1.165,66. Tidak ada satu pun dari angka itu yang berasal dari xAI. (Satu detail administratif yang perlu diketahui saat Anda membaca papan peringkat tersebut: Artificial Analysis mencantumkan pencipta model sebagai SpaceXAI.)
Separuh cerita tentang harga adalah separuh yang lebih menarik. Halaman yang sama memplot kualitas terhadap harga dengan garis Pareto yang menandai model-model yang menghasilkan Elo paling banyak per dolar, dan berdasarkan angka yang diterbitkan sendiri oleh papan peringkat tersebut, Grok Imagine Image 2.0 adalah model dengan skor tertinggi yang harganya di bawah $100 per 1.000 gambar. Model berikutnya di atasnya dalam hal kualitas, GPT Image 2 (high), berharga $211 per 1.000 — sekitar tiga setengah kali lipat lebih mahal untuk tambahan sekitar 17 Elo. Itu adalah klaim harga-kinerja, bukan klaim sebagai model terbaik, dan itulah versi cerita yang sebenarnya didukung oleh data independen.
Posisi terdepan itu nyata tetapi sempit, dan layak dikatakan secara terang-terangan. MAI-Image-2.6 milik Microsoft berada satu peringkat di bawahnya dengan harga $38,90 per 1.000, dan Muse Image milik Meta seharga $10 per 1.000 pada 1.111 Elo. Interval Elo di papan ini berkisar sekitar ±12 poin, jadi #4 dan #5 — terpisah oleh 6,5 Elo — berada di dalam rentang kesalahan satu sama lain. Anggap penempatan ini sebagai "lima besar," bukan sebagai slot yang sudah pasti.
Kenaikan 14 peringkat itu adalah selisih terhadap tingkat yang digantikan oleh Grok Imagine Image 2.0. Tingkat kualitas sebelumnya dari xAI, grok-imagine-image-quality, berada di #18 pada papan peringkat yang sama dengan 1.043,21 Elo, dan grok-imagine-image yang asli berada di #29 dengan 1.017,86. Itu sekitar 110 Elo dan 14 posisi peringkat antara model yang kini didokumentasikan xAI sebagai default citranya dan model yang digantikannya.
Bagaimana status klaim "world #2" saat ini
Saat peluncuran, xAI menyebutkan finis #2 di papan Arena teks-ke-gambar dan penyuntingan gambar, dengan sekitar 1.320 Elo dan ditandai Preliminary. Angka-angka itu adalah angka yang xAI soroti dalam pengumumannya sendiri — bukan evaluasi independen yang mereka pesan — dan telah berubah sejak saat itu: cuplikan 10 Agustus menempatkan model di #3 dengan 1.316 Elo, di belakang MAI-Image-2.6 dan GPT Image 2. Peringkat #2 untuk penyuntingan gambar tetap merupakan kutipan xAI sendiri.
Artificial Analysis adalah papan peringkat yang berbeda dengan metode yang berbeda dan kumpulan pemberi suara yang berbeda, dan sekarang menempatkan model itu di #4. Keduanya sebenarnya tidak saling bertentangan — keduanya mengambil sampel preferensi manusia dengan cara yang berbeda, dan keduanya adalah cuplikan dari papan peringkat yang berubah dari minggu ke minggu. Ringkasan yang jujur dari enam minggu pemeringkatan independen adalah bahwa Grok Imagine Image 2.0 secara konsisten berada di lima besar dan tidak pernah benar-benar menjadi #2 yang diumumkan xAI.
Apa yang sebenarnya dikirimkan oleh Grok Imagine Image 2.0
xAI memposisikan Grok Imagine Image 2.0 sebagai lingkungan penyuntingan, bukan sekadar generator sekali pakai. Kumpulan fiturnya:
• Magic Wand — edit tingkat region yang tidak memengaruhi bagian frame lainnya
• Segmentasi — pemilihan area secara presisi untuk grading warna, penggantian, atau penyesuaian
• Penghapusan latar belakang — ekspor subjek berlatar belakang transparan
• Input multi-gambar — hingga lima gambar sumber per penyuntingan; dokumentasi xAI kini mencantumkan lima, naik dari tiga yang dibatasi API saat peluncuran
• Smart Resize — menyusun ulang satu gambar menjadi 9 rasio aspek (1:2 tinggi hingga 2:1 lebar), menciptakan konten bingkai baru daripada memotong
• Templat — alur kerja prasetel untuk fotografi produk, headshot, listing e-commerce, aset game, dan poster pemasaran
API ini mengekspos kontrol yang tidak ditampilkan oleh aplikasi konsumen: rasio aspek — termasuk 21:9 dan 5:2, keduanya baru di versi 2.0 — resolusi (1K secara default, 2K opsional), dan parameter kualitas yang menerima low, medium, atau auto. Di sisi konsumen, model ini hadir sebagai Quality Mode default di grok.com/imagine, iOS, dan Android, dan sejak 13 Agustus model ini juga telah terdaftar di platform Runway, tempat ia bergabung dengan model gambar dan video yang sudah dihosting Runway. Pendaftaran itu adalah pernyataan vendor dan mitra, bukan evaluasi independen, tetapi itu adalah tanda pertama distribusi pihak ketiga setelah peluncuran.
Pada rendering teks judul, xAI menyatakan bahwa modelnya "merencanakan tipografi dan tata letak layaknya seorang desainer," menjaga komposisi multi-bagian yang padat tetap utuh dan merender teks kecil dengan tajam. Model ini juga mempertahankan identitas subjek dan pengaturan di seluruh proses edit berulang multi-putaran.
Apa yang ditemukan oleh uji independen pertama
Perbandingan enam prompt, seed tunggal, tanpa cherry-picking terhadap gpt-image-2 menemukan perbedaan yang jelas, dan tidak ada apa pun dalam penempatan papan peringkat baru yang membatalkannya.
Grok menang: fotorealisme dan retensi identitas. Anatomi tangan pada potret sudah benar, dengan detail kulit hingga tingkat pori, hamburan subpermukaan, serta catchlight dan rim-light yang natural. Dalam tugas rotasi geometris 45 derajat, Grok mempertahankan identitas wajah di atas ambang batas ArcFace 0,5, sementara gpt-image-2 lebih melenceng.
Grok kalah: area-area yang krusial dalam produksi. Saat diminta membuat judul poster film berbahasa Tionghoa Sederhana, ia menampilkan karakter Tionghoa Tradisional — disebut sebagai "faktor diskualifikasi berat" untuk jalur lokalisasi dan penerbitan. Permintaan fusi gaya cat air menghasilkan gambar fotorealistis dengan hanya lapisan tekstur bergaya lukis yang tipis — sebuah "diskualifikasi tingkat kategori." Pengeditan lokal menyelesaikan ketiga permintaan tetapi gagal mempertahankan tampilan jendela dan salah menempatkan sorotan.
Ringkasan: Grok Imagine Image 2.0 "unggul dalam fotorealisme dan identitas, tetapi tertinggal dalam keandalan penyuntingan, teks multibahasa, dan transfer gaya yang sesungguhnya." Papan peringkat merata-ratakan preferensi dari ribuan perbandingan buta; papan itu tidak dapat memberi tahu Anda apakah model akan menulis judul berbahasa Tionghoa Anda dengan benar. Satu tes dengan enam prompt juga bukan kumpulan bukti yang kuat — tetapi di antara keduanya, kegagalan spesifik adalah sinyal yang lebih dapat ditindaklanjuti bagi tim yang merilis aset terlokalisasi.
API dan matematika penetapan harga
Kisah pengembang telah berubah sejak peluncuran. grok-imagine-image-2.0 kini menjadi model yang didokumentasikan xAI untuk pembuatan gambar, pengeditan gambar tunggal, dan pengeditan multi-gambar, dan itulah yang direkomendasikan halaman model xAI sendiri untuk gambar. Frasa "akses API pengembang segera hadir" dari masa peluncuran sudah hilang dari halaman model dan harga vendor.
• grok-imagine-image-2.0: mulai dari $0,04 per gambar, ditagih sesuai kualitas yang sebenarnya disajikan
• grok-imagine-image (1.0): $0,02 per gambar, tidak terpengaruh oleh perubahan di bawah ini
• grok-imagine-image-quality: $0,05 per gambar, akan dihentikan pada 2 November 2026
Kualitas adalah tuas pengendali biaya. Auto — nilai default saat parameter dihilangkan — saat ini menerapkan low untuk pembuatan dan medium untuk penyuntingan, sehingga permintaan pembuatan ditagih dengan tarif low dan penyuntingan dengan tarif medium. Menetapkan low atau medium secara tetap membuat tagihan dapat diprediksi, bukan bergantung pada jalur mana yang dipilih layanan.
Butir terakhir itu membawa tenggat waktu. Panduan migrasi xAI menyatakan bahwa slug grok-imagine-image-quality dihentikan pada 2 November 2026, setelah pemberitahuan 60 hari yang dimulai pada 2 September. Sejak tanggal itu slug tersebut tetap dapat diresolusi, tetapi permintaannya dilayani oleh grok-imagine-image-2.0 dengan quality diatur ke low — sebuah pengalihan kompatibilitas, bukan penghentian paksa. Karena tier low $0,01 per gambar lebih murah daripada tier quality lama pada setiap resolusi, tim yang tidak mengubah apa pun akan mengalami penurunan harga sekaligus perubahan kualitas keluaran yang senyap. Bermigrasi secara sengaja, dengan menyebut grok-imagine-image-2.0 dan menyematkan quality di tempat yang mengutamakan keluaran stabil, adalah versi yang Anda inginkan. Tanggal dan perilaku pengalihan itu berasal dari dokumentasi xAI sendiri — dinyatakan oleh vendor, bukan diuji secara independen.
Dibandingkan dengan opsi-opsi OpenAI, perbandingannya adalah perbedaan model penetapan harga yang sama besarnya dengan perbedaan harga. gpt-image-2 diberi harga berbasis token — $8 per juta token input gambar dan $30 per juta token output gambar berdasarkan tarif yang dipublikasikan OpenAI — sehingga biaya per gambar berfluktuasi mengikuti resolusi dan tingkat detail. Angka representatif Artificial Analysis sebesar $211 per 1.000 gambar untuk GPT Image 2 (high) dibandingkan $60 milik Grok adalah fluktuasi tersebut yang tampil sebagai satu angka. Penetapan harga tetap per gambar jauh lebih mudah diproyeksikan pada skala besar, dan itulah sebagian besar alasan mengapa model di peringkat keempat sama sekali layak untuk dilirik.
Mencobanya tanpa mempertaruhkan pipeline.
Reaksi yang wajar terhadap Grok Imagine Image 2.0 tetap "coba dulu, jangan berkomitmen dulu." Posisinya berada di dalam interval kepercayaan yang saling tumpang tindih, satu pengujian independen menandai kelemahan nyata pada teks yang dilokalkan dan transfer gaya, dan xAI akan memensiunkan sebuah slug di bawahnya pada November. Itulah tepatnya alasan untuk melakukan routing alih-alih memasang integrasi langsung.
Di OrcaRouter, grok-imagine-image — model gambar xAI di katalog kami — berada di endpoint yang kompatibel dengan OpenAI yang sama dengan gpt-image-2, sehingga berpindah antara model gambar xAI dan OpenAI hanyalah perubahan string model: tanpa kontrak kedua, tanpa SDK baru. OrcaRouter meneruskan harga daftar penyedia tanpa markup, jadi pemotongan harga vendor langsung berlaku di sini pada hari yang sama, dan failover otomatis dapat mengirim error, batas laju, atau penolakan ke model cadangan alih-alih ke jalur produksi Anda. Satu catatan jujur, tidak berubah dari ulasan awal: tier kualitas terbaru xAI adalah entri terpisah dari model gambar Grok yang sudah ada di katalog kami, jadi periksa daftar model terkini alih-alih mengasumsikan bahwa varian Grok tertentu dapat dirutekan hari ini.
Tontonan Berikutnya
1. Migrasi 2 November.Apakah tim beralih ke grok-imagine-image-2.0 secara eksplisit atau justru terbawa ke pengalihan beserta defaultnya yang berkualitas rendah adalah hal terbesar yang masih bisa disalahkan xAI pada model ini — dan pengalihan itu membuat kesalahan tersebut tak terlihat kecuali Anda membaca kolom model di respons Anda.
2. Apakah #4 bertahan. Selisih dengan MAI-Image-2.6 adalah 6,5 Elo dengan interval ±12 poin, sehingga beberapa ribu suara lagi dapat mengubah urutan papan peringkat ke arah mana pun. Kenaikan 110 Elo dibandingkan tingkat sebelumnya tampak bertahan lama; peringkat persisnya tidak.
3. Seberapa banyak permukaan konsumen yang menjangkau API. Pembuatan, pengeditan, dan pengeditan multi-gambar telah didokumentasikan. Templat dan alur kerja bernama Smart Resize tetap menjadi fitur aplikasi, dan celah itulah tempat catatan "khusus konsumen" yang tersisa berada.
Intinya: Grok Imagine Image 2.0 adalah model nyata yang mumpuni yang kini telah ditempatkan secara independen — #4 di Papan Peringkat Text to Image Artificial Analysis, entri non-OpenAI terbaik di sana, sekitar 110 Elo lebih unggul dari tier yang digantikannya, dan berada di garis depan harga-kualitas papan tersebut pada $60 per 1.000 gambar dibandingkan sekitar $211 untuk model OpenAI yang tepat di atasnya. Framing "peringkat #2 dunia" selalu merupakan snapshot peluncuran xAI, dan papan independen tidak pernah benar-benar mengatakan itu. Dua kelemahan independennya yang paling jelas — kepatuhan Tionghoa Sederhana dan keandalan transfer gaya — terletak pada fitur yang paling sering dibutuhkan tim dari API gambar. Uji coba segera untuk pekerjaan fotorealistis yang mempertahankan identitas; tunggu dulu untuk pipeline yang mengirim teks terlokalisasi atau aset bergaya, dan jika Anda sudah memanggil slug kualitas yang akan dihentikan, migrasikan sebelum 2 November.
