Kartu hero untuk pertarungan antara MAI-Image-2.5-Pro dan Grok Imagine Image 2.0, dua model gambar yang mengutamakan pengeditan dari Microsoft dan xAI
Guides & Insights

MAI-Image-2.5-Pro vs Grok Imagine Image 2.0: Dua Taruhan yang Mengutamakan Penyuntingan pada Generasi Gambar

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua model citra paling menarik tahun ini sepakat pada gagasan besar: pengeditan adalah masa depan, generasi adalah syarat dasar. MAI-Image-2.5-Pro (Microsoft, pratinjau publik di Foundry sejak 23 Juli) dan Grok Imagine Image 2.0 (x​AI, dirilis 7 Agustus sebagai "Quality Mode" bawaan di aplikasi G​rok) keduanya mempromosikan diri mereka terutama sebagai pengedit. Namun mereka membangun alat yang berbeda untuk membuktikannya. Model Microsoft adalah mesin kualitas — suntingan presisi yang menjaga konsistensi, didukung peringkat No. 1 di Artificial Analysis Image Editing Arena. Model x​AI adalah lingkungan pengeditan — seperangkat alat untuk pengguna (Magic Wand, segmentasi, penghapusan latar belakang, Smart Resize) yang membungkus generator berperingkat No. 2-to-3 di arena besar lainnya. Yang satu diukur dari fidelitas, yang lain dari alur kerja. Itulah perbedaan sesungguhnya di antara keduanya.

Kumpulan alat pengeditan tidak memiliki bentuk yang sama

MAI-Image-2.5-Pro — mesin, bukan kotak peralatan. Anda membawa instruksi dan gambar; ia melakukan penyuntingan yang presisi dan bedah — penggantian objek yang ditargetkan, perubahan tata letak, pembaruan teks dalam gambar, pembersihan artefak — sambil menjaga identitas subjek, pencahayaan, dan tekstur tetap konsisten di setiap iterasi. Klaim Microsoft tentang konsistensi karakter multi-gambar 94% (dilaporkan vendor) adalah inti penawarannya: ubah satu hal, pertahankan semua yang lain.

Grok Imagine Image 2.0 — sebuah lingkungan. Lingkungan ini menyertakan Magic Wand (mengedit hanya wilayah yang dipilih), Segmentation (mewarnai ulang atau mengganti area yang presisi), penghapusan latar belakang, input multi-referensi (hingga 5 gambar di aplikasi konsumen, 3 di API), Smart Resize (menyusun ulang satu gambar menjadi sembilan rasio aspek), dan Templates untuk fotografi produk, headshots, e-commerce, aset game, dan poster pemasaran.

Baca daftar itu dan posisinya menjadi jelas: MAI-Image-2.5-Pro adalah model yang diarahkan pengembang ke API; Grok Imagine Image 2.0 adalah model yang digunakan seseorang dengan berada di dalam UI dan bekerja dengannya. x​AI menyebutnya sebagai "lingkungan pengeditan" saat diluncurkan, dan toolset-nya memang persis seperti itu.

Di mana peringkat masing-masing

MAI-Image-2.5-Pro — No. 1 di Arena Pengeditan Gambar Artificial Analysis (Elo 1.272, ~6.100 voting buta); No. 7 text-to-image (1.292 Elo). Penilaian independen berbasis preferensi buta.

Grok Imagine Image 2.0 — klaim peluncuran xAI adalah No. 2 di seluruh dunia pada papan teks-ke-gambar Arena di belakang GPT Image 2; pada snapshot 10 Agustus, posisinya berada di No. 3 (Elo 1,316) di belakang GPT Image 2 (1,381) dan MAI-Image-2.6 (1,336) yang lebih baru dari Microsoft. Peringkat itu independen dan sementara, dan penyebutan "No. 2 di seluruh dunia" dari xAI harus dilabeli apa adanya: klaim peluncuran dari vendor yang telah direvisi oleh papan peringkat langsung sejak saat itu.

Tidak ada model yang memimpin di wilayah utama model lainnya, dan tidak ada yang menduduki puncak papan utama model lainnya. Cara mudah untuk membacanya: model Microsoft menguasai skor penyuntingan, model xAI menguasai perkakas dan berada di dekat puncak generasi.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 ahead of the field

Perenderan teks, fitur penentu

Teks dalam gambar adalah tempat keduanya paling tajam berbeda, dan di mana bukti independen hanya berat sebelah. Microsoft mengklaim akurasi rendering teks 96,8% untuk MAI-Image-2.5-Pro pada bahasa Inggris, Tionghoa, Jepang, Korea, dan Spanyol — dilaporkan vendor, belum diverifikasi, dan disertai batas keluaran megapiksel, tetapi merupakan kemampuan nyata yang dinyatakan dengan cakupan multibahasa. Hasil pengujian independen Grok Imagine Image 2.0, yang dipublikasikan dari evaluasi OrcaRouter sendiri terhadap model tersebut dibandingkan dengan GPT Image 2, menemukan bahwa model itu merender teks CJK secara tidak andal — dalam satu pengujian, ia merender Tionghoa Tradisional saat diminta Tionghoa Sederhana pada judul poster film, sebuah disqualifier berat untuk pekerjaan iklan terlokalisasi. Untuk alur kerja apa pun yang membutuhkan kata yang terbaca di dalam gambar, MAI-Image-2.5-Pro adalah taruhan yang lebih aman di atas kertas; kualitas teks Grok perlu diuji pada materi Anda sendiri sebelum Anda mempercayainya.

Harga

MAI-Image-2.5-Pro — dihitung per token: $5 per juta input teks, $8 per juta input gambar, $106 per juta token output gambar. Konversi Artificial Analysis menempatkan gambar 1024×1024 di sekitar $108.50 per 1,000.

Grok Imagine Image 2.0 — harga tetap per gambar, tanpa token: $0,05 per gambar pada 1K atau 2K untuk tingkat kualitas (`grok-imagine-image-quality`), $0,02 untuk tingkat standar, dengan pengeditan yang membebankan biaya pada input dan output. Pada 1K, itu berarti $50 per 1.000 gambar berkualitas — kira-kira setengah dari angka per-1k MAI-Image-2.5-Pro, dengan biaya tetap yang tidak berubah sesuai panjang prompt.

Model penetapan harga keduanya secara filosofis berbeda. Pengukuran berbasis token milik Microsoft menghukum prompt yang panjang dan keluaran yang besar; tarif tetap per gambar milik xAI bersifat dapat diprediksi dan tidak bergantung pada panjang prompt. Pada volume yang besar, tarif tetap lebih mudah diperkirakan, dan label harga tier kualitasnya lebih murah daripada milik MAI-Image-2.5-Pro.

Comparison scoreboard for MAI-Image-2.5-Pro and Grok Imagine Image 2.0: editing rank No. 1 at 1,272 Elo versus Arena text-to-image No. 3 at 1,316 Elo; editing approach surgical engine versus tool environment; text rendering 96.8% claimed versus independent CJK failures; price USD 108.50 per 1k versus USD 50 per 1k quality; billing token-metered versus flat per image; availability Foundry preview versus Grok apps and API

Ketersediaan dan sudut perutean

Keduanya dapat diakses, tetapi melalui pintu yang berbeda. MAI-Image-2.5-Pro adalah pratinjau Microsoft Foundry dan MAI Playground — Anda memerlukan akun Microsoft dan kartu tarif pratinjau berlaku. Grok Imagine Image 2.0 dirilis di aplikasi konsumen xAI pada 7 Agustus dan tingkat kualitasnya dapat dipanggil melalui API Imagine xAI; juga telah tersedia di endpoint yang kompatibel dengan OpenAI dari OrcaRouter sejak pertengahan Agustus, di mana tingkat standar dan tingkat kualitas berada di belakang satu kunci dengan harga penyedia diteruskan dengan markup 0% dan failover otomatis ke cadangan seperti GPT Image 2.

Perbedaan praktis yang dihasilkan: mengadopsi Grok Imagine Image 2.0 dalam jalur produksi adalah perubahan string model pada endpoint yang mungkin sudah Anda gunakan, dengan tarif flat yang murah dan fallback bawaan untuk kasus-kasus yang gagal ditanganinya — tepatnya mode kegagalan yang lapisan perutean ada untuk menangkapnya. Mengadopsi MAI-Image-2.5-Pro berarti berkontrak langsung dengan Foundry untuk saat ini, dan catatan perutean yang jujur sama seperti sebulan lalu: ketika pratinjau Microsoft menjadi dapat dipanggil secara luas melalui API pihak ketiga, saat itulah pola satu-kunci yang sama terbuka untuknya.

Screenshot of the OrcaRouter model page for grok-imagine-image, showing the xAI image model routable through one API key

Putusan

Pilih MAI-Image-2.5-Pro saat tugas Anda adalah penyuntingan berfidelitas tinggi pada gambar yang sudah ada dan hasilnya harus tahan uji — ia adalah editor #1 independen di Artificial Analysis, ia benar-benar mengklaim rendering teks multibahasa, dan harganya setimpal. Pilih Grok Imagine Image 2.0 saat Anda menginginkan alur kerja penyuntingan dengan alat-alat yang benar-benar ada, harga tetap yang mudah diprediksi dan kira-kira setengah dari biaya per gambar, serta model yang dapat Anda arahkan hari ini dengan fallback. Kerangka yang jujur bukanlah "mana yang lebih baik" — melainkan taruhan mana yang cocok dengan alur kerja Anda: Microsoft bertaruh bahwa fidelitas memenangkan penyuntingan, dan xAI bertaruh bahwa perangkat alat memenangkan pengguna. Keduanya dapat dipertahankan; kebutuhan kualitas keluaran Anda dan toleransi Anda terhadap risiko rendering teks itulah yang menjadi penentu.

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

providers@orcarouter.ai

Gabung komunitas kami

Discordsupport@orcarouter.aiXGitHubYouTube