Kartu hero untuk pertandingan antara MAI-Image-2.5-Pro, yang tersedia dalam pratinjau di Microsoft Foundry, dan Flux 3, model fondasi multimodal milik Black Forest Labs yang tingkat gambarnya masih belum dirilis.
Guides & Insights

MAI-Image-2.5-Pro vs Flux 3: Minggu Peluncuran yang Sama, Dua Realitas yang Berbeda

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

MAI-Image-2.5-Pro dan Flux 3 sama-sama diumumkan pada minggu yang sama — 23 Juli 2026. Satu bulan kemudian, keduanya menempati dunia yang berbeda. MAI-Image-2.5-Pro, model gambar kelas kualitas Microsoft, sedang dalam pratinjau publik di Microsoft Foundry dan telah naik ke No. 1 di Artificial Analysis Image Editing Arena (Elo 1.272 dari ~6.100 suara buta). Flux 3, model fondasi multimodal terpadu Black Forest Labs, telah merilis tepat satu tier-nya — video — dan tier gambarnya tidak memiliki endpoint publik, tidak memiliki harga, dan tidak memiliki benchmark yang dapat dijalankan siapa pun. Pembaca yang bertanya "model gambar mana yang harus saya gunakan" tidak memiliki dua kandidat di sini; mereka memiliki satu produk dan satu janji.

Apa sebenarnya masing-masing itu

MAI-Image-2.5-Pro — model pembuatan dan pengeditan gambar yang khusus dan proprietary, tingkatan fidelitas tertinggi dari keluarga MAI-Image-2.5 internal Microsoft. Berbasis token, dihosting di Foundry, ditujukan untuk gambar hero, pengeditan detail, dan rendering teks dalam gambar. Ini adalah seluruh model: gambar.

Flux 3 — model dasar multimodal terpadu yang dilatih secara bersama pada gambar, video, dan audio (plus prediksi aksi robot), dibangun dengan metode flow-matching yang disebut BFL sebagai Self-Flow. Lima varian diumumkan: Flux 3 Video, Flux 3 Image, Flux 3 Action, Flux-mimic untuk robotika, dan Flux 3 Dev (bobot terbuka direncanakan untuk dirilis akhir 2026). Gambar adalah satu modalitas dalam taruhan yang lebih besar, bukan produk itu sendiri.

Perbedaan struktural itu lebih penting daripada spesifikasi apa pun. Model gambar yang fokus mencurahkan seluruh kapasitasnya untuk gambar diam; model multimodal menyebarkan kapasitasnya ke berbagai media. MAI-Image-2.5-Pro hadir untuk memenangkan pengeditan gambar. Flux 3 hadir untuk menjadi satu model yang melakukan segalanya, dan tingkat gambarnya adalah bagian dari visi itu yang belum terwujud.

Ketersediaan: seluruh perbandingan

Per pertengahan Agustus 2026, asimetrinya bersifat mutlak:

MAI-Image-2.5-Pro — pratinjau publik di Azure AI Foundry di tujuh wilayah global, plus MAI Playground gratis. Anda dapat menggunakannya hari ini dengan akun Microsoft; ini sudah menjadi tingkat kualitas dari keluarga yang mendukung Bing Image Creator, PowerPoint, dan OneDrive.

Flux 3 Image — belum dirilis. Dokumentasi BFL tidak mencantumkan endpoint gambar; lini gambar yang dapat dipanggil saat ini tetap FLUX.2 (Pro, Dev, Flex, Klein). Halaman Flux 3 memuat label "coming soon" dengan formulir aplikasi, bukan tombol get-started. BFL mengatakan akses awal gambar akan dibuka "dalam beberapa minggu" setelah pengumuman 23 Juli; hingga saat ini belum ada ID model, spesifikasi gambar, atau batas prompt yang dipublikasikan. Hanya Flux 3 Video yang mencapai ketersediaan umum (4 Agustus, ditagih per detik).

Jadi jawaban praktis untuk "yang mana yang bisa saya andalkan untuk pengeditan gambar saat ini" hanya memuat satu nama.

Bukti yang dapat ditunjukkan oleh masing-masing pihak

Kekuatan editing MAI-Image-2.5-Pro diukur secara independen. Selain Elo editing #1, peringkat teks-ke-gambarnya adalah No. 7 pada 1.292 Elo — bagus, bukan pemimpin, yang merupakan cara jujur untuk membaca seorang spesialis. Microsoft juga menerbitkan klaim yang dilaporkan vendor: akurasi rendering teks 96,8% (ditandai sebagai mencakup lima bahasa), kepatuhan prompt 27% lebih baik daripada GPT Image 1.5 pada evaluasi internal, dan konsistensi karakter multi-gambar 94%. Labeli semua itu sebagai angka milik Microsoft sendiri; papan peringkat adalah bagian yang independen.

Flux 3 Image tidak memiliki bukti publik sama sekali. Tidak ada tolok ukur gambar, karena tidak ada endpoint gambar untuk diuji. Satu-satunya angka yang dilaporkan BFL dalam keluarga ini adalah untuk Flux 3 Video — Elo internal 1.135 untuk text-to-video dan 1.051 untuk image-to-video yang menurut BFL mengalahkan Omni Flash, H3, dan Seedance 2.0 — dan angka-angka itu dilaporkan oleh vendor, belum direproduksi, dan tidak berlaku untuk tingkat gambar. Apa pun yang Anda baca yang "membandingkan" kualitas gambar Flux 3 adalah ekstrapolasi dari angka video atau dari lini FLUX.2 yang lebih lama.

Screenshot of the Artificial Analysis Image Editing Leaderboard showing MAI-Image-2.5-Pro at No. 1 with Elo 1,272 ahead of Reve 2.1, MAI-Image-2.5, and GPT Image 2Comparison scoreboard for MAI-Image-2.5-Pro and Flux 3: availability in preview on Microsoft Foundry versus image tier unreleased; image editing rank No. 1 at 1,272 Elo versus no image benchmarks; scope focused image model versus unified multimodal; text rendering 96.8% claimed versus roadmap claim of multilingual accuracy; price USD 108.50 per 1k versus no image price published; callable today versus coming soon

Apa yang dijanjikan Flux 3 untuk gambar (peta jalan vendor, bukan spesifikasi)

Klaim peta jalan BFL untuk tingkatan gambar layak untuk diketahui justru karena itu hanyalah klaim:

• Sintesis dan pengeditan gambar di berbagai gaya, rasio aspek, dan resolusi

• Peningkatan penanganan prompt kompleks dan rendering teks multibahasa dengan akurasi tinggi

• Transfer gaya zero-shot dari gambar referensi, dengan beberapa referensi gaya yang digabungkan dalam satu proses.

• Konsistensi karakter dan merek lintas generasi tanpa fine-tuning

• Pengeditan non-destruktif — mempertahankan tekstur, grain, pencahayaan, dan latar belakang sehingga pengeditan berulang tidak menurunkan kualitas

Klaim terakhir itulah yang menarik: ini adalah properti 'edit tanpa regenerasi adegan' yang sama dengan yang sudah dirilis dan diunggulkan oleh desain surgical-edit MAI-Image-2.5-Pro. Jika Flux 3 Image mewujudkannya, ia akan bersaing langsung dengan hal yang sudah dilakukan MAI-Image-2.5-Pro. 'Jika' adalah kata kuncinya — semua yang ada dalam daftar itu belum terverifikasi sampai endpoint-nya ada.

Biaya

MAI-Image-2.5-Pro — $5 per juta token input teks, $8 per juta token input gambar, $106 per juta token output gambar. Menurut konversi Artificial Analysis, gambar 1024×1024 berharga mendekati $108.50 per 1,000. Harga pratinjau; GA dapat mengubahnya.

Flux 3 Image — tidak ada harga karena tidak ada endpoint. Satu-satunya harga Flux 3 yang dipublikasikan adalah untuk video: $0.17/detik (HD) dan $0.29/detik (FHD) untuk render penuh. Sebagai titik referensi untuk lini gambar FLUX.2 yang dapat dipanggil, BFL mengenakan biaya sekitar $0.04 per gambar untuk Flux Pro dan $0.015 untuk Flux Dev — tetapi itu adalah generasi sebelumnya, bukan perkiraan.

Anda tidak dapat membandingkan harga dengan baris kosong. Perbandingan biaya hari ini adalah tarif premium MAI-Image-2.5-Pro dibandingkan dengan tidak ada apa pun.

Screenshot of Microsoft's announcement of MAI-Image-2.5-Pro and MAI-Voice-2-Flash, showing the preview launch and positioning as Microsoft's highest-fidelity image model

Yang mana yang akan dijadikan dasar

Jika hasil akhir Anda adalah gambar pada tahun 2026, jawabannya adalah MAI-Image-2.5-Pro (atau salah satu editor hosted lainnya — GPT Image 2 masih memimpin untuk text-to-image dan platform pengeditan utama lainnya). Model ini dapat dipanggil, memiliki skor pengeditan #1 independen, dan batas resolusi sekitar satu megapiksel adalah hal utama yang perlu Anda perhatikan untuk kasus penggunaan Anda. Flux 3 adalah item yang perlu dipantau: ketika tier gambar diluncurkan, klaim pengeditan non-destruktif dan konsistensi mereknya layak diuji secara serius terhadap model yang saat ini Microsoft beri peringkat #1.

Ada juga cara berpikir ala routing untuk memahami penantian ini. Ketika Flux 3 Image akhirnya memiliki endpoint, cara berisiko rendah untuk mengadopsi model yang benar-benar baru dan tanpa benchmark adalah dengan merutekan sebagian lalu lintas ke model tersebut dan mempertahankan model yang sudah terbukti sebagai failover otomatis — satu endpoint, harga penyedia diteruskan dengan markup 0%, dan model yang belum terbukti mendapatkan tempatnya pada lalu lintas langsung, bukan sekadar slide roadmap. Itulah pola yang menjadi alasan keberadaan OrcaRouter, dan pola yang sama pula yang membuat model tingkat pratinjau seperti MAI-Image-2.5-Pro dapat diadopsi sebelum mencapai ketersediaan umum.

Putusan

Minggu peluncuran yang sama, satu bulan kemudian: MAI-Image-2.5-Pro adalah editor #1 terukur yang dapat Anda gunakan hari ini, dan Flux 3 adalah model fondasi multimodal yang tingkat gambarnya masih sekadar janji dengan peta jalan. Membandingkan keduanya dalam hal kualitas gambar seperti membandingkan petinju dengan petarung yang belum masuk ring. Gunakan MAI-Image-2.5-Pro untuk pekerjaan gambar sekarang; simpan Flux 3 Image dalam daftar hal yang perlu dievaluasi ulang pada hari endpoint-nya benar-benar dirilis.

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

providers@orcarouter.ai

Gabung komunitas kami

Discordsupport@orcarouter.aiXGitHubYouTube