
MAI-Image-2.5-Pro Menduduki Posisi #1 dalam Penyuntingan Gambar: Apa yang Sebenarnya Dibuktikan oleh Kemenangan Independen Microsoft
- AlibabaBARUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiBARUZ.ai: GLM 5.3 Flash2026-08-2658Kecerdasan72Koding
- DeepSeekBARUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiBARUZ.ai: GLM 5.32026-08-1860Kecerdasan75Koding
- obsidianBARUQwen3.8 27B2026-08-1552Kecerdasan68Koding
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
MAI-Image-2.5-Pro kini menjadi model penyunting gambar berperingkat teratas di papan peringkat Artificial Analysis — papan pemungutan suara buta yang independen — meskipun hanya menempati peringkat ketujuh dalam text-to-image biasa. Perbedaan tersebut adalah inti ceritanya: sebuah model yang telah berada dalam pratinjau publik selama kurang dari sebulan, dibangun sepenuhnya secara internal oleh Microsoft AI, telah mengungguli GPT Image 2, Reve 2.1, dan saudaranya sendiri MAI-Image-2.5 di papan penyuntingan, namun masih tertinggal dari sebagian besar pesaing yang sama ketika perintahnya adalah "gambarkan sesuatu dari ketiadaan." Baca kedua angka tersebut secara bersamaan dan Anda akan mendapatkan gambaran yang tepat tentang apa yang dirilis Microsoft: spesialis dalam mengubah gambar yang sudah ada, bukan generator serba guna.
Kedua angka, berdampingan
Per snapshot Agustus 2026, Image Editing Arena milik Artificial Analysis menempatkan MAI-Image-2.5-Pro di No. 1 dengan Elo 1.272, yang dibangun dari sekitar 6.100 perbandingan pengguna buta. Kelompok pengejarnya sangat ketat: Reve 2.1 dengan 1.262, lalu MAI-Image-2.5 dan GPT Image 2 (high) seri di 1.256, GPT Image 1.5 (high) di 1.250, Qwen-Image-3.0-Pro di 1.249, dan Nano Banana 2 milik Gogle di 1.249. Di Arena Text-to-Image, ia berada di No. 7 dengan Elo 1.292, di belakang GPT Image 2 (high) dengan 1.369, Reve 2.1 dengan 1.322, Nano Banana 2 dengan 1.320, GPT Image 1.5 (high) dengan 1.310, MAI-Image-2.5 dengan 1.304, dan Nano Banana Pro dengan 1.296.
• Mengedit: No. 1 — 1.272 Elo, ~6.100 sampel
• Teks-ke-gambar: No. 7 — 1.292 Elo, ~11.500 sampel
• Selisih dengan No. 2 pada editing: 10 Elo di atas Reve 2.1
• Jarak ke No. 1 pada teks-ke-gambar: 77 Elo di belakang GPT Image 2 (tinggi)
Apa yang membuat peringkat penyuntingan lebih berharga daripada sekadar angka pamer adalah mekanismenya. Arena Artificial Analysis adalah preferensi manusia secara buta: para pemilih melihat gambar masukan dan instruksi yang sama, mendapatkan dua hasil suntingan, dan memilih yang lebih kuat. Tidak ada skrip vendor yang menulis skornya. Jadi peringkat #1 di sana adalah hal terdekat yang dimiliki pasar dengan "hasil editor ini paling disukai orang" — dan itu adalahbaru-baru inikenaikan, bukan sekadar gejolak sesaat di hari peluncuran. Perlakukan arah sebagai sesuatu yang solid dan Elo yang pasti sebagai sementara; papan dengan sedikit suara dapat bergerak.

Papan peringkat text-to-image yang diambil pada hari yang sama menampilkan model yang sama dalam perspektif berbeda — tidak lagi memimpin, tetapi masih berada di sepuluh besar dengan nyaman, di antara para pesaing yang berkumpul pada rentang 1.290 hingga 1.370 Elo.

Apa sebenarnya MAI-Image-2.5-Pro itu
MAI-Image-2.5-Pro adalah tingkatan kualitas Microsoft AI dari keluarga MAI-Image-2.5, yang diumumkan pada 23 Juli 2026 bersama dengan MAI-Voice-2-Flash dan tersedia dalam pratinjau publik di Microsoft Foundry (Azure AI Foundry) dan MAI Playground gratis. Microsoft menggambarkannya sebagai model gambar dengan fidelitas tertinggi sejauh ini, yang ditujukan untuk citra hero, pengeditan detail, dan rendering teks dalam gambar yang presisi. Keluarga ini kini mencakup kurva biaya: MAI-Image-2.5 untuk pekerjaan yang seimbang, MAI-Image-2.5-Flash untuk volume tinggi, dan tingkatan Pro di ujung kualitas — dengan saudara yang lebih baru, MAI-Image-2.6, yang sudah dalam pratinjau pribadi sejak 19 Agustus.
Klaim Microsoft sendiri untuk tier Pro, semuanya dilaporkan oleh vendor dan belum ada satu pun yang direproduksi secara independen:
• 96.8% akurasi rendering teks — disebutkan mencakup bahasa Mandarin, Inggris, Jepang, Korea, dan Spanyol, meskipun dokumentasi yang sama membatasi keluaran hingga kira-kira satu megapiksel, jadi frasa "8K" dalam klaim tersebut sebaiknya dianggap sebagai pemasaran.
• Kepatuhan prompt 27% lebih baik daripada GPT-Image-1.5 pada evaluasi internal Microsoft.
• Konsistensi karakter multi-gambar 94% lintas generasi.
• Biaya GPU hingga 84–89% lebih rendah dibanding model GPT dalam skenario Microsoft tertentu (PowerPoint, OneDrive), bukan angka umum.
Lembar spesifikasi yang terdokumentasi adalah dasar dari klaim-klaim tersebut: input teks hingga 32.000 token, jendela konteks 131k, 4.096 token output, input gambar JPEG/PNG, dan output dibatasi maksimal 1.048.576 piksel (setara dengan 1024×1024). Angka terakhir itu penting bagi pembeli: ini adalah editor berkualitas tinggi, bukan generator resolusi cetak.
Di mana kualitas terlihat
Kekuatan penyuntingan yang diukur papan peringkat ini sejalan dengan apa yang ditekankan Microsoft: penyuntingan yang presisi dan cermat yang menjaga bagian lain dari gambar tetap konsisten. Penggantian objek yang ditargetkan, perubahan tata letak, pembaruan teks dalam gambar, dan pembersihan artefak seperti blur gerakan — kategori penyuntingan di mana model-model lama meregenerasi seluruh pemandangan dan kehilangan subjeknya. Gabungkan itu dengan klaim konsistensi karakter 94%, dan Anda memiliki model yang dirancang untuk alur kerja yang penting secara komersial: ambil aset yang ada, ubah satu hal, lalu kirim.
Peringkat #7 text-to-image adalah penyeimbang yang jujur. Dari prompt kosong, MAI-Image-2.5-Pro bagus tetapi bukan pemimpin — selisih 77 Elo di belakang GPT Image 2 (tinggi) adalah kesenjangan nyata di papan buta. Microsoft saat ini tidak mengklaim mahkota text-to-image; mereka mengklaim mahkota penyuntingan, dan data mendukung klaim yang lebih sempit itu jauh lebih baik daripada klaim yang lebih luas.
Berapa biayanya
MAI-Image-2.5-Pro diukur berdasarkan token di Foundry: $5 per juta token input teks, $8 per juta token input gambar, $106 per juta token output gambar. Microsoft tidak mempublikasikan token per gambar, jadi biaya per gambar adalah hasil perhitungan, bukan penawaran resmi; menggunakan konversi Artificial Analysis, gambar 1024×1024 mendekati $108,50 per 1.000 gambar. Itu kira-kira 2,3× dari saudaranya MAI-Image-2.5 (~$48 per 1k) dan 5,4× MAI-Image-2.5-Flash (~$20 per 1k) — tingkatan Pro adalah premi yang disengaja.
Harga pratinjau bukan harga GA; kartu tarif pratinjau dapat berubah sebelum ketersediaan umum. Ketika itu terjadi, lapisan perutean pass-through adalah cara pemotongan harga mencapai tagihan Anda pada hari yang sama: di OrcaRouter, harga daftar penyedia diteruskan dengan markup 0%, jadi begitu MAI-Image-2.5-Pro dapat diakses melalui API pihak ketiga yang dapat dipanggil, berapa pun yang dibebankan Microsoft adalah persis yang Anda bayar — tanpa negosiasi ulang, tanpa kontrak kedua.

Mengapa peringkat #1 menjadi milik Microsoft sebagai perusahaan, bukan hanya modelnya.
Hasil papan peringkat ini muncul di saat Microsoft secara nyata mengganti model gambar pihak ketiga dengan model miliknya sendiri. MAI-Image-2.5 sudah menjadi mesin default di Bing Image Creator dan berjalan di PowerPoint, OneDrive, dan Dynamics 365 Contact Center; tingkatan Pro merupakan keluarga yang sama yang diarahkan untuk pekerjaan dengan fidelitas lebih tinggi. Microsoft telah menyatakan bahwa model MAI dilatih pada data yang bersih dan dapat dilacak "tanpa distilasi dari model pihak ketiga" — jawaban langsung atas pertanyaan ketergantungan pada OpenAI, dan klaim biaya (hingga 84% lebih rendah biaya GPU di PowerPoint, dilaporkan vendor dan spesifik skenario) adalah bagian dari cerita yang sama: model internal yang lebih murah per tugas dibandingkan model yang digantikannya.
Tidak ada satu pun dari itu yang dapat dibuktikan kepada pembeli yang skeptis tanpa papan peringkat independen, itulah sebabnya #1 memiliki signifikansi strategis, bukan sekadar skor. Ini adalah bukti independen pertama bahwa lini gambar internal Microsoft mengungguli para pesaing pada tugas spesifik yang dirancang untuk itu.
Tontonan Berikutnya
• Apakah keunggulan penyuntingan bertahan seiring bertambahnya suara? 1.272 Elo pada ~6.100 sampel adalah keunggulan, bukan kepastian; Reve 2.1 terpaut 10 poin.
• Ketersediaan umum dan daftar tarif final — harga pratinjau bukanlah harga GA.
• Batas resolusi. Batas 1 megapiksel menjauhkan Pro dari pekerjaan cetak; jika Microsoft menghapusnya, ceritanya berubah.
• MAI-Image-2.6 (pratinjau pribadi, 19 Agustus) — langkah keluarga berikutnya, berperingkat No. 2 untuk teks-ke-gambar di arena utama lainnya.
• Evaluasi independen atas klaim vendor — akurasi rendering teks dan konsistensi karakter belum diverifikasi di luar Microsoft.
Kesimpulan dari papan peringkat yang terbagi bukanlah "Microsoft kini membuat model gambar terbaik." Ini lebih sempit dan lebih berguna: Microsoft kini membuat editor gambar dengan reputasi terbaik di papan peringkat independen, dengan harga premium, dalam pratinjau, dengan batas resolusi yang keras. Jika pekerjaan Anda adalah mengubah gambar yang ada — bidikan utama, visual produk, teks dalam gambar — itulah model yang tepat untuk diperhatikan. Jika pekerjaan Anda adalah pembuatan kanvas kosong, peringkat #7 menunjukkan bahwa pilihan yang lebih baik masih GPT Image 2 — dan itulah bacaan jujur yang diberikan kedua angka tersebut kepada Anda.
