Kartu hero untuk MAI-Image-2.5-Pro, model gambar Microsoft yang berfokus pada kualitas, menunjukkan peringkat #1 dalam pengeditan gambar dan #7 dalam teks-ke-gambar di papan peringkat Artificial Analysis.
Guides & Insights

MAI-Image-2.5-Pro Menduduki Posisi #1 dalam Penyuntingan Gambar: Apa yang Sebenarnya Dibuktikan oleh Kemenangan Independen Microsoft

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

MAI-Image-2.5-Pro kini menjadi model penyunting gambar berperingkat teratas di papan peringkat Artificial Analysis — papan pemungutan suara buta yang independen — meskipun hanya menempati peringkat ketujuh dalam text-to-image biasa. Perbedaan tersebut adalah inti ceritanya: sebuah model yang telah berada dalam pratinjau publik selama kurang dari sebulan, dibangun sepenuhnya secara internal oleh Microsoft AI, telah mengungguli GPT Image 2, Reve 2.1, dan saudaranya sendiri MAI-Image-2.5 di papan penyuntingan, namun masih tertinggal dari sebagian besar pesaing yang sama ketika perintahnya adalah "gambarkan sesuatu dari ketiadaan." Baca kedua angka tersebut secara bersamaan dan Anda akan mendapatkan gambaran yang tepat tentang apa yang dirilis Microsoft: spesialis dalam mengubah gambar yang sudah ada, bukan generator serba guna.

Kedua angka, berdampingan

Per snapshot Agustus 2026, Image Editing Arena milik Artificial Analysis menempatkan MAI-Image-2.5-Pro di No. 1 dengan Elo 1.272, yang dibangun dari sekitar 6.100 perbandingan pengguna buta. Kelompok pengejarnya sangat ketat: Reve 2.1 dengan 1.262, lalu MAI-Image-2.5 dan GPT Image 2 (high) seri di 1.256, GPT Image 1.5 (high) di 1.250, Qwen-Image-3.0-Pro di 1.249, dan Nano Banana 2 milik Go​gle di 1.249. Di Arena Text-to-Image, ia berada di No. 7 dengan Elo 1.292, di belakang GPT Image 2 (high) dengan 1.369, Reve 2.1 dengan 1.322, Nano Banana 2 dengan 1.320, GPT Image 1.5 (high) dengan 1.310, MAI-Image-2.5 dengan 1.304, dan Nano Banana Pro dengan 1.296.

Mengedit: No. 1 — 1.272 Elo, ~6.100 sampel

Teks-ke-gambar: No. 7 — 1.292 Elo, ~11.500 sampel

Selisih dengan No. 2 pada editing: 10 Elo di atas Reve 2.1

Jarak ke No. 1 pada teks-ke-gambar: 77 Elo di belakang GPT Image 2 (tinggi)

Apa yang membuat peringkat penyuntingan lebih berharga daripada sekadar angka pamer adalah mekanismenya. Arena Artificial Analysis adalah preferensi manusia secara buta: para pemilih melihat gambar masukan dan instruksi yang sama, mendapatkan dua hasil suntingan, dan memilih yang lebih kuat. Tidak ada skrip vendor yang menulis skornya. Jadi peringkat #1 di sana adalah hal terdekat yang dimiliki pasar dengan "hasil editor ini paling disukai orang" — dan itu adalahbaru-baru inikenaikan, bukan sekadar gejolak sesaat di hari peluncuran. Perlakukan arah sebagai sesuatu yang solid dan Elo yang pasti sebagai sementara; papan dengan sedikit suara dapat bergerak.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 and 6,133 samples, ahead of Reve 2.1 at 1,262, MAI-Image-2.5 at 1,256, and GPT Image 2 (high) at 1,256

Papan peringkat text-to-image yang diambil pada hari yang sama menampilkan model yang sama dalam perspektif berbeda — tidak lagi memimpin, tetapi masih berada di sepuluh besar dengan nyaman, di antara para pesaing yang berkumpul pada rentang 1.290 hingga 1.370 Elo.

Screenshot of the Artificial Analysis Text to Image Leaderboard showing MAI-Image-2.5-Pro at No. 7 with Elo 1,292 behind GPT Image 2 (high), Reve 2.1, Nano Banana 2, GPT Image 1.5 (high), MAI-Image-2.5, and Nano Banana Pro

Apa sebenarnya MAI-Image-2.5-Pro itu

MAI-Image-2.5-Pro adalah tingkatan kualitas Microsoft AI dari keluarga MAI-Image-2.5, yang diumumkan pada 23 Juli 2026 bersama dengan MAI-Voice-2-Flash dan tersedia dalam pratinjau publik di Microsoft Foundry (Azure AI Foundry) dan MAI Playground gratis. Microsoft menggambarkannya sebagai model gambar dengan fidelitas tertinggi sejauh ini, yang ditujukan untuk citra hero, pengeditan detail, dan rendering teks dalam gambar yang presisi. Keluarga ini kini mencakup kurva biaya: MAI-Image-2.5 untuk pekerjaan yang seimbang, MAI-Image-2.5-Flash untuk volume tinggi, dan tingkatan Pro di ujung kualitas — dengan saudara yang lebih baru, MAI-Image-2.6, yang sudah dalam pratinjau pribadi sejak 19 Agustus.

Klaim Microsoft sendiri untuk tier Pro, semuanya dilaporkan oleh vendor dan belum ada satu pun yang direproduksi secara independen:

96.8% akurasi rendering teks — disebutkan mencakup bahasa Mandarin, Inggris, Jepang, Korea, dan Spanyol, meskipun dokumentasi yang sama membatasi keluaran hingga kira-kira satu megapiksel, jadi frasa "8K" dalam klaim tersebut sebaiknya dianggap sebagai pemasaran.

Kepatuhan prompt 27% lebih baik daripada GPT-Image-1.5 pada evaluasi internal Microsoft.

Konsistensi karakter multi-gambar 94% lintas generasi.

Biaya GPU hingga 84–89% lebih rendah dibanding model GPT dalam skenario Microsoft tertentu (PowerPoint, OneDrive), bukan angka umum.

Lembar spesifikasi yang terdokumentasi adalah dasar dari klaim-klaim tersebut: input teks hingga 32.000 token, jendela konteks 131k, 4.096 token output, input gambar JPEG/PNG, dan output dibatasi maksimal 1.048.576 piksel (setara dengan 1024×1024). Angka terakhir itu penting bagi pembeli: ini adalah editor berkualitas tinggi, bukan generator resolusi cetak.

Di mana kualitas terlihat

Kekuatan penyuntingan yang diukur papan peringkat ini sejalan dengan apa yang ditekankan Microsoft: penyuntingan yang presisi dan cermat yang menjaga bagian lain dari gambar tetap konsisten. Penggantian objek yang ditargetkan, perubahan tata letak, pembaruan teks dalam gambar, dan pembersihan artefak seperti blur gerakan — kategori penyuntingan di mana model-model lama meregenerasi seluruh pemandangan dan kehilangan subjeknya. Gabungkan itu dengan klaim konsistensi karakter 94%, dan Anda memiliki model yang dirancang untuk alur kerja yang penting secara komersial: ambil aset yang ada, ubah satu hal, lalu kirim.

Peringkat #7 text-to-image adalah penyeimbang yang jujur. Dari prompt kosong, MAI-Image-2.5-Pro bagus tetapi bukan pemimpin — selisih 77 Elo di belakang GPT Image 2 (tinggi) adalah kesenjangan nyata di papan buta. Microsoft saat ini tidak mengklaim mahkota text-to-image; mereka mengklaim mahkota penyuntingan, dan data mendukung klaim yang lebih sempit itu jauh lebih baik daripada klaim yang lebih luas.

Berapa biayanya

MAI-Image-2.5-Pro diukur berdasarkan token di Foundry: $5 per juta token input teks, $8 per juta token input gambar, $106 per juta token output gambar. Microsoft tidak mempublikasikan token per gambar, jadi biaya per gambar adalah hasil perhitungan, bukan penawaran resmi; menggunakan konversi Artificial Analysis, gambar 1024×1024 mendekati $108,50 per 1.000 gambar. Itu kira-kira 2,3× dari saudaranya MAI-Image-2.5 (~$48 per 1k) dan 5,4× MAI-Image-2.5-Flash (~$20 per 1k) — tingkatan Pro adalah premi yang disengaja.

Harga pratinjau bukan harga GA; kartu tarif pratinjau dapat berubah sebelum ketersediaan umum. Ketika itu terjadi, lapisan perutean pass-through adalah cara pemotongan harga mencapai tagihan Anda pada hari yang sama: di OrcaRouter, harga daftar penyedia diteruskan dengan markup 0%, jadi begitu MAI-Image-2.5-Pro dapat diakses melalui API pihak ketiga yang dapat dipanggil, berapa pun yang dibebankan Microsoft adalah persis yang Anda bayar — tanpa negosiasi ulang, tanpa kontrak kedua.

Scoreboard for MAI-Image-2.5-Pro: image editing rank No. 1 at 1,272 Elo, text-to-image rank No. 7 at 1,292 Elo, price about USD 108.50 per 1k images, 32k text input tokens, 131k context window, ~1-megapixel output cap, preview status on Microsoft Foundry

Mengapa peringkat #1 menjadi milik Microsoft sebagai perusahaan, bukan hanya modelnya.

Hasil papan peringkat ini muncul di saat Microsoft secara nyata mengganti model gambar pihak ketiga dengan model miliknya sendiri. MAI-Image-2.5 sudah menjadi mesin default di Bing Image Creator dan berjalan di PowerPoint, OneDrive, dan Dynamics 365 Contact Center; tingkatan Pro merupakan keluarga yang sama yang diarahkan untuk pekerjaan dengan fidelitas lebih tinggi. Microsoft telah menyatakan bahwa model MAI dilatih pada data yang bersih dan dapat dilacak "tanpa distilasi dari model pihak ketiga" — jawaban langsung atas pertanyaan ketergantungan pada OpenAI, dan klaim biaya (hingga 84% lebih rendah biaya GPU di PowerPoint, dilaporkan vendor dan spesifik skenario) adalah bagian dari cerita yang sama: model internal yang lebih murah per tugas dibandingkan model yang digantikannya.

Tidak ada satu pun dari itu yang dapat dibuktikan kepada pembeli yang skeptis tanpa papan peringkat independen, itulah sebabnya #1 memiliki signifikansi strategis, bukan sekadar skor. Ini adalah bukti independen pertama bahwa lini gambar internal Microsoft mengungguli para pesaing pada tugas spesifik yang dirancang untuk itu.

Tontonan Berikutnya

Apakah keunggulan penyuntingan bertahan seiring bertambahnya suara? 1.272 Elo pada ~6.100 sampel adalah keunggulan, bukan kepastian; Reve 2.1 terpaut 10 poin.

Ketersediaan umum dan daftar tarif final — harga pratinjau bukanlah harga GA.

Batas resolusi. Batas 1 megapiksel menjauhkan Pro dari pekerjaan cetak; jika Microsoft menghapusnya, ceritanya berubah.

MAI-Image-2.6 (pratinjau pribadi, 19 Agustus) — langkah keluarga berikutnya, berperingkat No. 2 untuk teks-ke-gambar di arena utama lainnya.

Evaluasi independen atas klaim vendor — akurasi rendering teks dan konsistensi karakter belum diverifikasi di luar Microsoft.

Kesimpulan dari papan peringkat yang terbagi bukanlah "Microsoft kini membuat model gambar terbaik." Ini lebih sempit dan lebih berguna: Microsoft kini membuat editor gambar dengan reputasi terbaik di papan peringkat independen, dengan harga premium, dalam pratinjau, dengan batas resolusi yang keras. Jika pekerjaan Anda adalah mengubah gambar yang ada — bidikan utama, visual produk, teks dalam gambar — itulah model yang tepat untuk diperhatikan. Jika pekerjaan Anda adalah pembuatan kanvas kosong, peringkat #7 menunjukkan bahwa pilihan yang lebih baik masih GPT Image 2 — dan itulah bacaan jujur yang diberikan kedua angka tersebut kepada Anda.

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

providers@orcarouter.ai

Gabung komunitas kami

Discordsupport@orcarouter.aiXGitHubYouTube