Tarjeta destacada para el enfrentamiento entre Fugu Ultra v2 y MiniMax M3, que muestra la gran diferencia de precio entre un nivel de orquestación y un modelo multimodal de pesos abiertos y bajo costo.
Guides & Insights

Fugu Ultra v2 vs. MiniMax M3: veinticinco veces el precio de salida

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Ponga las dos tarifas de salida una al lado de la otra y el número parece un error tipográfico. MiniMax M3 cobra $1,20 por millón de tokens de salida. Fugu Ultra v2, anunciado por Sakana AI el 11 de septiembre de 2026, se reporta en $30,00. Eso es 25× — y en la entrada la brecha es de 16,7×, $0,30 frente a unos $5,00 reportados. MiniMax M3 también es más rápido, acepta video de forma nativa y se distribuye como pesos abiertos descargables. Ante esa tabla, la primera reacción razonable es que el nivel de orquestación no puede justificar su precio. La pregunta más interesante es qué tendría que ser verdad para que sí lo justifique.

La brecha, expresada sin rodeos

Entrada — MiniMax M3 $0.30 por 1M frente a Fugu Ultra v2, con unos $5.00 por 1M según lo reportado. MiniMax indica que la tarifa de M3 es un descuento permanente del 50%, no una promoción con fecha de vencimiento.

Salida — MiniMax M3 a 1,20 $ por 1M frente a los 30,00 $ por 1M que se reportan para Fugu Ultra v2.

Entrada en caché — MiniMax M3 $0.06 por 1M frente a los $0.50 por 1M reportados de Fugu Ultra v2. La lectura de caché de M3 es una quinta parte de su propio precio de entrada, lo que hace que los bucles repetidos de agentes sobre un prompt estable sean inusualmente baratos.

Entrada superior a 512K — MiniMax M3 se duplica a $0.60 / $2.40 / $0.12. El nivel reportado de Fugu Ultra v2 por encima de aproximadamente 272K pasa a unos $10.00 / $45.00 / $1.00. Ambos reajustan el precio de toda la solicitud; M3 comienza más tarde y termina a una fracción de la tarifa.

Contexto — MiniMax M3, 1.048.576 tokens con un mínimo garantizado por el proveedor de 512K. El contexto de Fugu Ultra v2 se reporta como 1M en listados de terceros; la página de anuncio de Sakana no indica ninguna cifra.

Una advertencia sobre la columna de Fugu, y no es menor: Sakana no publica las tarifas de tokens de Fugu Ultra v2 en su propia página de anuncio. Las cifras de $5.00 / $0.50 / $30.00 provienen de listados de modelos de terceros y deben considerarse no confirmadas hasta que verifiques la tarjeta de tarifas en vivo. La columna de M3, en cambio, está documentada por el proveedor. Esa diferencia de procedencia es en sí misma parte de la comparación.

Two-column comparison scoreboard for Fugu Ultra v2 and MiniMax M3 covering type, release date, input price ($5.00 vs $0.30 per million tokens), output price ($30.00 vs $1.20), cached input ($0.50 vs $0.06) and input modes (text vs text, image and video).

Lo que M3 hace de forma nativa que un orquestador tiene que enrutar

MiniMax M3 acepta entrada de texto, imagen y vídeo, y devuelve texto. El vídeo es el aspecto más destacado. El modelo se entrenó con modalidades mixtas desde el paso cero, y se basa en MiniMax Sparse Attention, una arquitectura que, según el proveedor, ofrece un prellenado hasta 9× más rápido y una decodificación hasta 15× más rápida con un contexto de 1M en comparación con su predecesor, con aproximadamente una vigésima parte del cómputo por token.

Eso importa en esta comparación porque es una capacidad que Fugu Ultra v2 no reclama para sí mismo. La respuesta de un orquestador a «encárgate de este vídeo» es enrutar el vídeo a un modelo que pueda verlo, lo que significa una subllamada, lo que significa más tokens facturados a la tarifa del orquestador. La respuesta de M3 es simplemente leerlo. Con $0.30 de entrada, una hora de análisis de vídeo es un error de redondeo; con $5.00 de entrada más lo que cueste el enrutamiento, es una línea de presupuesto.

La comparación de arquitecturas también está desequilibrada de otra manera. MiniMax M3 tiene aproximadamente 428B parámetros totales con unos 23B activos por token — un diseño de mezcla de expertos en el que el enrutamiento disperso mantiene bajo el costo de servicio. Fugu Ultra v2 no tiene un recuento de parámetros publicado, porque su capacidad reside en una política de planificación sobre los modelos de otras empresas en lugar de en pesos que Sakana entrenó. Uno de estos es un modelo. El otro es un procedimiento de decisión.

La incómoda implicación

Esto es algo que vale la pena considerar antes de pagar 25× por el resultado.

MiniMax M3 es de pesos abiertos, barato, rápido, multimodal y de contexto largo. Sobre el papel, es un subagente excelente. Si estuvieras construyendo una capa de orquestación desde cero —eso que es Fugu Ultra v2—, un modelo como M3 se acerca al componente ideal: lo bastante barato como para llamarlo de forma especulativa, lo bastante capaz como para encargarse de la mayor parte de las subtareas descompuestas, y capaz de ver imágenes y video sin un segundo salto.

Sakana no publica el conjunto de modelos de Fugu Ultra v2, así que no podemos decir si M3 está en él. Lo que sí podemos decir es que la lógica económica solo tiene sentido de una de dos maneras. O bien Fugu Ultra v2 no está llamando a modelos como M3, en cuyo caso está dejando sobre la mesa la capacidad apta más barata. O los está llamando, en cuyo caso una parte significativa de los tokens que se te facturan a $5.00 y $30.00 son tokens de M3 que cuestan $0.30 y $1.20 en origen, y el sobreprecio es la política de orquestación más un margen.

Ninguna de las dos interpretaciones es fatal para el producto — un buen planificador puede valer un múltiplo considerable, y pagar por uno te evita tener que construirlo y mantenerlo. Pero sí significa que la pregunta que hay que hacer sobre Fugu Ultra v2 no es «¿es mejor que M3?». Es «¿vale la planificación más que los tokens?». Y esa es una pregunta que solo tus propias mediciones de tareas pueden responder.

No existe un punto de referencia compartido.

A diferencia de otros enfrentamientos de esta serie, no hay ni una sola prueba comparativa sobre la que ambos fabricantes publiquen una cifra.

El conjunto publicado por MiniMax para M3 es amplio y, en su forma, en su mayoría reproducible: SWE-bench Verified con un 80.5 %, SWE-bench Pro con un 59.0 %, Terminal-Bench 2.0/2.1 con 66, BrowseComp con un 83.5 %, OSWorld-Verified con un 70.1 % y PostTrainBench con un 37.1 — tercer lugar, por detrás de Claude Opus 4.7 con 42.4 y GPT-5.5 con 39.3. Todos reportados por el proveedor. De forma independiente, Artificial Analysis otorga a MiniMax M3 una puntuación de 30 en su índice de inteligencia v4.3, con el puesto n.º 16 de 113, una capacidad de procesamiento de 95.7 tokens por segundo y un tiempo hasta el primer token de 1.95 segundos — rápido, y entre los modelos mejor servidos de su clase. Si ha visto que se cita a M3 con 44 o 45, eso es anterior a la reformulación del índice.

Los ocho benchmarks de Sakana para Fugu Ultra v2 —entre ellos GDP.pdf, Chartography, SWEFish, DeepSWE y Toolathon, con el mejor o empatado en el mejor resultado en cinco y entre los dos primeros en siete— no se cruzan en absoluto con esa lista. Dos de ellos, SWEFish y Toolathon, son pruebas internas de Sakana. Las afirmaciones destacadas, Chartography con 48,3 frente a 27,3 de Opus 5 y 29,5 de Fable 5, y DeepSWE con 74,3, están reportadas por el proveedor y se publicaron hoy. Nada sobre Fugu Ultra v2 ha sido verificado de forma independiente.

Así que la comparación que todo agregador producirá en las próximas dos semanas —una tabla de puntuaciones compartidas— no está disponible. Lo único honesto que se puede decir sobre la capacidad es que MiniMax M3 tiene una posición medida e independiente y Fugu Ultra v2 tiene una pretensión.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

Velocidad versus configuración

Los números de MiniMax M3 son conocidos: 95,7 tokens por segundo, 1,95 segundos hasta el primer token. Eso es aproximadamente dos veces y media el rendimiento de Kimi K3 y está entre los modelos más rápidos cercanos a la frontera que se han medido, lo que encaja con un diseño optimizado explícitamente para el servicio económico de contexto largo.

Fugu Ultra v2 no publica ninguna cifra de latencia ni de rendimiento. Como ocurre con el precio, parte de eso es estructural —el tiempo de respuesta de un orquestador depende de qué modelos elija y de cuántas pasadas necesite, así que una única cifra resultaría engañosa—. Pero significa que el coste en tiempo real de adoptarlo no está medido y es imposible de medir desde fuera. En el caso del Fugu Ultra anterior, los evaluadores informaron públicamente de ejecuciones que se acercaban a los 30 minutos; ese es el modelo de junio de 2026, no la v2, y no constituye evidencia sobre el nuevo; pero si te estás gastando 25 veces más en la salida, saber cuánto vas a esperar no es un simple extra.

La licencia, y lo que dice el texto árabe

Los pesos de MiniMax M3 se pueden descargar bajo la Min​iMax Community License, que es de pesos abiertos con condiciones comerciales adjuntas — en particular, un umbral de ingresos por encima del cual se requiere autorización por escrito. No es MIT, y cualquier página que te diga que lo es no ha leído la etiqueta de la licencia. Fugu Ultra v2 no te da nada que licenciar porque no hay nada que descargar.

El desarrollo reciente más interesante para M3 es lo que otras personas están haciendo con esos pesos. El 3 de septiembre de 2026, HUMAIN —la empresa de IA respaldada por el PIF saudí— lanzó un modelo insignia en árabe creado mediante post-entrenamiento de MiniMax M3 con más de un billón de tokens en árabe, con 428B de parámetros totales y 23B activos, reportando un 89,37 % ponderado por igual en siete benchmarks de árabe y situándolo por delante de GPT-5.6 Sol con 87,30 y de Claude Opus 5 con 87,34. Es una vista previa de investigación, y esos son los propios números de HUMAIN.

El contraste con Fugu Ultra v2 no podría ser más nítido como declaración sobre lo que es cada producto. MiniMax M3 es una base sobre la que otras empresas construyen modelos soberanos. Fugu Ultra v2 es una puerta por la que llamas, cuya composición no puedes ver y cuyos pesos no puedes sostener. Ambas son posturas legítimas. No son ni remotamente la misma clase de cosa.

Screenshot of the OrcaRouter model page for MiniMax M3 showing the minimax/minimax-m3 identifier, a 1M token context window, 512K maximum output, and pricing of $0.30 per million input tokens and $1.20 per million output tokens.

Llamando a cualquiera de ellos

MiniMax M3 está en OrcaRouter a la propia tarifa de Min​iMax — $0.30 por cada millón de tokens de entrada, $0.06 en un acierto de caché, $1.20 por cada millón de tokens de salida — transferida sin ningún margen, así que si Min​iMax cambia la estructura de descuentos, llega aquí el mismo día en lugar de en un ciclo de migración. Es compatible con OpenAI en la misma URL base que el resto del catálogo, lo que significa que puedes enrutar hacia él por regla, ponerlo detrás de una cadena de failover o incluirlo en un panel de fusión de modelos sin un segundo contrato ni un cambio de código. Para un modelo cuyo argumento entero es el precio, esa transferencia es la parte que importa: la ruta más barata sigue siendo la más barata.

Fugu Ultra v2 no lo enrutamos nosotros. Está disponible desde la propia API compatible con OpenAI de Sakana AI, y la compañía afirma que una integración existente de Fugu se traslada a él con un cambio de parámetro de una línea. Ambos hablan el mismo formato de solicitud, así que ponerlos detrás de una sola bandera para evaluación es un cambio de URL base.

El veredicto

Para la inmensa mayoría de las cargas de trabajo, MiniMax M3 gana esta comparación solo por la aritmética. Es 16,7× más barato en entrada y 25× más barato en salida, más rápido en todas las métricas medidas, multimodal de forma nativa, incluido video, de pesos abiertos bajo una licencia cuyo límite la mayoría de las empresas nunca alcanzará, y con una puntuación independiente de 30 en el índice actual de Artificial Analysis. Sus debilidades son reales pero limitadas: es verboso, su puntuación en la categoría agéntica es mediocre en relación con sus puntuaciones de programación, y su conjunto de benchmarks del proveedor es sólido en ingeniería de software y más flojo en autonomía de largo horizonte.

Elige Fugu Ultra v2 solo si crees en lo que Sakana realmente vende — un nivel de máxima capacidad que descompone tareas complejas de varios pasos a través de un conjunto que ningún proveedor de frontera controla, alcanzando resultados de nivel frontera sin depender de modelos de frontera — y tienes mediciones a nivel de tarea que demuestran que la descomposición supera a un único modelo barato en tu trabajo. Esa es una propuesta genuinamente diferente de cualquier cosa que ofrezca Min​iMax, y es la razón por la que existe el 25×.

Pero haz la medición antes de la compra, no después. Si un modelo de $0.30 termina tu tarea en dos intentos y Fugu Ultra v2 la termina en uno, Fugu sigue siendo más caro. La única carga de trabajo en la que 25× es una ganga es aquella en la que el modelo barato no puede terminar en absoluto — y ese es un conjunto de tareas mucho más pequeño de lo que implica el texto de lanzamiento.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario