
MAI-Image-2.5-Pro vs GPT Image 2: La corona de la imagen ahora está dividida
- z-aiNUEVOZ.ai: GLM 5.32026-08-1860Inteligencia75Código
- obsidianNUEVOQwen3.8 27B Uncensored (Aggressive)2026-08-1552Inteligencia68Código
- qwenNUEVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNUEVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencia69Código
- grokNUEVOSpaceXAI: Grok 4.62026-08-1261Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligencia71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencia76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencia71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencia77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencia77Código
- grokxAI: Grok 4.52026-07-0856Inteligencia72Código
La forma más clara de resumir MAI-Image-2.5-Pro frente a GPT Image 2 es que «el mejor modelo de imagen» dejó de ser una sola pregunta. En el Image Editing Arena de Artificial Analysis, el MAI-Image-2.5-Pro de Microsoft es el n.º 1 con Elo 1,272; en el Text-to-Image Arena del mismo sitio, el GPT Image 2 de OpenAI es el n.º 1 con Elo 1,369; y en el otro gran tablero — LMArena, ahora Arena — GPT Image 2 sigue dominando por completo la edición de imágenes, liderando las siete categorías de indicaciones. Ambos modelos son premium, ambos son APIs alojadas y medidas por tokens, y la respuesta honesta a «cuál gana» depende por completo de la tarea que nombres: la edición favorece al recién llegado de Microsoft, mientras que la generación y el cumplimiento de indicaciones complejas favorecen al veterano de OpenAI.
La división de la tabla de clasificación, lea con atención.
• Edición (Artificial Analysis):MAI-Image-2.5-Pro N.º 1 — 1,272 Elo, ~6,100 muestras. GPT Image 2 (high) N.º 4 — 1,256 Elo.
• Text-to-image (Artificial Analysis): GPT Image 2 (high) N.º 1 — 1,369 Elo, ~14,500 muestras. MAI-Image-2.5-Pro N.º 7 — 1,292 Elo, ~11,500 muestras.
• Edición (Arena):GPT Image 2 lidera con ~1.463 Elo y la mayor ventaja medida en cada categoría — el resultado independiente más fuerte que tiene cualquiera de los modelos.
Los paneles de edición en conflicto no son una contradicción; son dos arenas diferentes con diferentes entradas de modelos y diferentes grupos de votantes. Artificial Analysis prueba el nivel específico "alto" de GPT Image 2 cara a cara contra la versión preliminar de MAI-Image-2.5-Pro, y el modelo de Microsoft gana allí. Arena prueba la versión media contra un campo más amplio, y OpenAI gana allí por un margen mayor. Ambos son reales, ambos son independientes, y la ventaja de ningún panel es lo suficientemente grande como para dar por resuelto el título de edición.

En qué es bueno cada uno
MAI-Image-2.5-Pro es un editor especializado. Microsoft lo creó para realizar cambios precisos y quirúrgicos — intercambiar un objeto, actualizar texto dentro de la imagen, limpiar artefactos — manteniendo el resto de la imagen consistente, y su afirmación de consistencia de personajes en múltiples imágenes del 94% (reportada por el proveedor) es el objetivo de diseño expresado en un número. Su capacidad principal es el renderizado de texto: Microsoft afirma una precisión del 96.8% en inglés, chino, japonés, coreano y español, aunque los mismos documentos limitan la salida a cerca de un megapíxel, por lo que la frase "8K" en esa afirmación es marketing que debe ignorarse. Lo que el modelo no es, es un líder de lienzo en blanco: su puesto #7 en el ranking de texto a imagen lo dice directamente.
GPT Image 2 es un generalista con un motor de razonamiento. Fue el primer modelo de imagen de OpenAI con un modo de pensamiento integrado: planifica el diseño, puede buscar referencias en la web y se autoverifica antes de dibujar, por lo que es el líder reconocido en indicaciones complejas con múltiples restricciones y en las categorías de edición de Arena. Renderiza bien texto multilingüe (incluido CJK), admite hasta resolución 4K con un límite de relación de aspecto de 3:1 y ofrece tres niveles de calidad. Sus debilidades son el espejo de sus fortalezas: es caro a alta calidad y regenera en lugar de preservar quirúrgicamente; la "edición" se parece más a "volver a renderizar siguiendo esta instrucción", que es donde la propuesta de consistencia de MAI-Image-2.5-Pro intenta diferenciarse.
Precio
Ambos se miden por tokens, y ninguno publica tokens por imagen, por lo que las cifras por imagen son conversiones, no cotizaciones.
• MAI-Image-2.5-Pro — $5 por millón de tokens de entrada de texto, $8 por millón de tokens de entrada de imagen, $106 por millón de tokens de salida de imagen. La conversión de Artificial Analysis: ≈ $108.50 por 1,000 imágenes de 1024×1024.
• GPT Image 2 — $5 por millón de tokens de entrada de texto, $8 por millón de tokens de entrada de imagen, $30 por millón de tokens de salida de imagen. El costo por imagen varía según el nivel de calidad: aproximadamente $0.006 para baja, $0.05 para media, $0.21 para alta a 1024×1024 — ≈ $211 por 1,000 en calidad alta.
Así que, en los niveles que los compradores realmente usan, MAI-Image-2.5-Pro cuesta aproximadamente la mitad del precio por imagen de GPT Image 2 high — una diferencia real a volumen, y consistente con la afirmación de Microsoft (reportada por el proveedor y específica del escenario) de hasta un 84% menos de costo de GPU que los modelos GPT en PowerPoint y OneDrive. La advertencia: la tabla de clasificación muestra el nivel "high" de GPT Image 2, y si bajas GPT Image 2 a calidad media, su precio se acerca al de MAI-Image-2.5-Pro, mientras que su Elo también baja.

Resolución y formatos
• Límite de salida:MAI-Image-2.5-Pro está limitado a cerca de 1 megapíxel (equivalente a 1024×1024, lado mínimo 768px) — suficiente para web y la mayoría de los visuales de producto, un límite absoluto para impresión. GPT Image 2 llega a 4K (borde máximo 4,000px, total de píxeles hasta ~8.3M) con un techo de relación de aspecto de 3:1.
• Entradas: ambos aceptan imágenes JPEG/PNG además de texto. MAI-Image-2.5-Pro documenta una entrada de texto de 32k tokens y una ventana de contexto de 131k; el modo de razonamiento de GPT Image 2 es el factor diferenciador en el lado de la entrada.
• Formatos: GPT Image 2 no admite fondos transparentes en su lanzamiento; la postura de Microsoft sobre la transparencia para el nivel Pro no se ha declarado en ningún sentido.
Si tu salida necesita ser grande — carteles, impresos, vallas publicitarias — el techo de 4K de GPT Image 2 es una ventaja decisiva hoy en día. Si tu salida es nativa para la web, el límite de megapíxeles rara vez es un factor limitante.
Disponibilidad y el ángulo de enrutamiento
Ambas son APIs alojadas, pero no son igualmente accesibles. GPT Image 2 ha estado disponible de forma general desde el 21 de abril de 2026 a través de la API de OpenAI y se puede enrutar a través de OrcaRouter hoy mismo — una sola clave, precio de lista del proveedor trasladado con un margen del 0 %, conmutación automática por fallo entre proveedores. MAI-Image-2.5-Pro es una vista previa pública lanzada el 23 de julio de 2026 en Microsoft Foundry y en el MAI Playground; todavía no se puede acceder a ella a través de una capa de enrutamiento de terceros, y su precio de vista previa puede variar cuando se alcance la disponibilidad general (GA).
Esa asimetría merece una nota de decisión para cualquiera que compare estos dos en un pipeline real. Hoy puedes enrutar una parte del tráfico a GPT Image 2 y otra parte a otro modelo en el mismo endpoint, y cambiar el string del modelo cuando la vista previa de Microsoft esté ampliamente disponible. El flujo de trabajo que quieres —comparar ambos editores con tus propias imágenes, mantener el probado como respaldo mientras el nuevo gana confianza— es exactamente lo que te ofrece una capa de enrutamiento, y no cuesta nada extra en OrcaRouter porque el precio del proveedor es el precio.

El veredicto
Si tu tarea es editar imágenes existentes y tu salida es de tamaño web, MAI-Image-2.5-Pro es la opción con mejor relación calidad-precio y el actual #1 independiente en el panel de edición de Artificial Analysis — a aproximadamente la mitad del precio por imagen de GPT Image 2 high. Si tu tarea es generación desde lienzo en blanco, prompts complejos con múltiples restricciones o salida de gran formato, GPT Image 2 es la mejor herramienta y su puesto #1 en texto a imagen y su dominio en edición en Arena lo confirman. Ambos son modelos premium y ambos merecen estar disponibles; el panel dividido no es un empate de marketing — son dos especialidades genuinamente diferentes. Y como ambos están alojados, la capa de enrutamiento es la forma sensata de ejecutarlos lado a lado en tus propias imágenes antes de comprometerte con una ruta de producción para cualquiera de ellos.
