Una tarjeta de título principal que dice 'Fugu Max vs Grok 4.6' con el subtítulo 'Tarifas idénticas, una puntuación publicada', tres insignias tipo píldora que dicen '$2.00 vs $2.00 de entrada', '$6.00 vs $6.00 de salida' y 'Seis victorias, cero cifras', una línea de pie de página que dice 'Sakana AI, septiembre de 2026 vs SpaceXAI, agosto de 2026', y el logotipo de OrcaRouter en la esquina inferior derecha.
Guides & Insights

Fugu Max vs Grok 4.6: tarifas idénticas, una puntuación publicada

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Fugu Max y Grok 4.6 cuestan exactamente lo mismo. Sakana AI lanzó Fugu Max el 11 de septiembre de 2026, con un precio de $2,00 por millón de tokens de entrada y $6,00 por millón de tokens de salida, y esa es, línea por línea, la tarifa que SpaceXAI ha estado cobrando por Grok 4.6 desde su lanzamiento el 12 de agosto. La coincidencia es el dato más útil de esta comparativa, porque elimina el precio de la ecuación. Cuando dos productos facturan de forma idéntica, la única pregunta que queda es qué se recibe a cambio del dinero, y ahí los dos se separan por completo. Grok 4.6 es un único modelo que puedes fijar por versión, consultar en una tabla de benchmarks y verificar contra un índice independiente. Fugu Max es un coordinador entrenado que envía cada tarea al modelo más barato de su conjunto, y el anuncio de Sakana afirma que obtiene la mejor puntuación global en seis benchmarks sin publicar una sola cifra de ninguno de ellos. Una de estas compras es medible antes de realizarla. La otra, no.

Dos productos, una tarifa

• Entrada — Fugu Max $2.00 por 1 millón de tokens vs. Grok 4.6 $2.00 por 1 millón de tokens

• Salida — Fugu Max $6.00 por 1M tokens vs Grok 4.6 $6.00 por 1M tokens

• Entrada en caché — Fugu Max $0.25 por 1M de tokens vs Grok 4.6 $0.50 por 1M de tokens, la única línea en la que ambos precios difieren en absoluto

• Ventana de contexto — Fugu Max no publicada por el proveedor frente a Grok 4.6, 500.000 tokens, sin cambios respecto a Grok 4.5

• Nuevo precio para prompts largos — Fugu Max: no se indica ningún tramo en el comunicado, frente a Grok 4.6, que se duplica a $4.00 / $12.00 una vez que una sola solicitud supera los 200,000 tokens, aplicado a toda la solicitud en lugar de solo al exceso

• Control de razonamiento — Fugu Max no expuesto frente a Grok 4.6, cuatro niveles de esfuerzo, de bajo a xhigh, predeterminado en alto y no desactivable

• Arquitectura — Fugu Max, un coordinador entrenado sobre un conjunto no revelado que incluye modelos de pesos abiertos y especializados, ampliado para Max con la familia NVIDIA Nemotron mediante una colaboración con NVIDIA, frente a Grok 4.6, un solo modelo en una sola versión

• Evaluación independiente — Para Fugu Max no se ha publicado ninguna, y no existe ninguna página de Artificial Analysis para ningún modelo Fugu, frente a Grok 4.6, que tiene un Artificial Analysis Intelligence Index en vivo de 44, clasificado en el puesto n.º 20 de 200

La columna barata es la que no se puede pronosticar

Mira dónde Fugu Max realmente gana en precio: en la lectura de caché, a la mitad de la de Grok 4.6. Es una ventaja real y es exactamente el lugar equivocado para construir un modelo de costos, porque el precio de la caché solo compensa en proporción a tu tasa de aciertos de caché — y Sakana no publica una para Fugu Max. El anuncio tampoco especifica una ventana de contexto, ni un nivel de contexto largo, ni un límite de salida. Así que la única columna donde Fugu Max es más barato que Grok 4.6 es un descuento de tamaño desconocido aplicado a una proporción desconocida de tus tokens.

Las debilidades de Grok 4.6 son, al menos, visibles. Su umbral de 200.000 tokens es agresivo: recalcula el precio de toda la solicitud, así que un prompt de 250.000 tokens se factura al doble de tarifa desde el primer token, no desde el 200.001. Pero puedes ver el acantilado, medir tus prompts con respecto a él y decidir si dividirlos en fragmentos. Esa es la diferencia de naturaleza que hay aquí: un sistema publica una tabla de precios con una forma en torno a la cual puedes planificar, y el otro publica una tarifa destacada sin ninguna tabla adjunta.

Seis victorias y ni una sola anotación

Los benchmarks que Sakana menciona son Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench y SWEFish. Cinco de ellos son evaluaciones públicas reconocidas. El sexto, SWEFish, es el propio benchmark de programación de Sakana, lo que significa que una de las seis victorias declaradas se puntúa con una prueba que escribió el proveedor y que no ha publicado. Para los otros cinco, el comunicado dice que Fugu Max logra la mejor puntuación general y ahí se queda: ninguna puntuación, ningún margen, ninguna cifra de la competencia para poner a su lado.

Contrasta eso con la tabla que SpaceXAI publicó para Grok 4.6, que está reportada por el proveedor en su totalidad pero que al menos es una tabla: GDPVal-AA v2 en 1.753, AA-Briefcase en 1.577, DeepSWE v1.1 en 65,9%, CursorBench v3.2 en 69,9% y GPQA Diamond en 94,9%. El material de lanzamiento también informa de aproximadamente 53 turnos y unos quinientos millones de tokens de entrada para resolver tareas de horizonte largo en AA-Briefcase, frente a aproximadamente 103 turnos y dos mil millones de tokens para un modelo de frontera de la competencia — un argumento, de nuevo reportado por el proveedor, de que Grok es barato por trabajo completado incluso a una tarifa modesta por token.

Dos de esas cifras de Grok deben tratarse con cuidado antes de citarlas. La primera es que su puntuación destacada de 94,9 % en GPQA Diamond proviene de un benchmark que Artificial Analysis ha retirado desde entonces por considerarlo saturado, por lo que ya no separa a los modelos de frontera como lo hacía antes. La segunda es la cifra que verás en coberturas más antiguas: un Artificial Analysis Intelligence Index de 61 para Grok 4.6. Esa era la escala anterior a la reexpresión. Artificial Analysis recalibró el índice en septiembre de 2026, y la cifra vigente es 44 en el puesto n.º 20 de 200, con un costo de $1.86 por tarea de Artificial Analysis Intelligence Index. Cualquiera que clasifique a Grok 4.6 frente a Claude Fable 5 o GPT-5.6 Sol usando un 61 está comparando lecturas de dos instrumentos distintos.

A two-column scoreboard titled 'Fugu Max vs Grok 4.6 - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, benchmarks six wins with no figures, evidence vendor-reported only. Grok 4.6: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.50 per 1M, context 500K with a 200K repricing cliff, benchmarks GDPVal 1,753 and DeepSWE 65.9%, evidence Artificial Analysis Index 44 ranked #20 of 200. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Grok 4.6 rows SpaceXAI-reported and per Artificial Analysis. No independent Fugu Max evaluation exists.' OrcaRouter logo bottom-right.

Lo que no incluye el precio del token de un orquestador

La propia cobertura de Sakana sobre el lanzamiento reconoce el problema estructural. Como Fugu Max cambia entre modelos dentro de una sola tarea, "puede reducir la reutilización de la caché de contexto y también generar tokens de orquestación adicionales", y la empresa no reveló la tasa de aciertos de caché resultante ni un costo total de tokens por tarea. Cada agente que genera el coordinador escribe texto de razonamiento y de salida, y todo ello se factura a $6.00 por millón. La tarifa es idéntica a la de Grok 4.6. El volumen no lo es, y el volumen es la variable que una página de precios no puede mostrarle.

Ambos proveedores te están empujando hacia la misma corrección —deja de comparar tarifas, empieza a comparar el costo por trabajo terminado—, pero solo uno de ellos te da un número del que partir. Grok 4.6 llega con un perfil publicado de turnos y tokens. Fugu Max llega con la instrucción de medirlo tú mismo.

Hay una lectura justa del silencio de Fugu Max y merece ser expuesta. Max es el nivel optimizado en costos de la línea Fugu, lanzado el mismo día que Fugu Ultra v2, que es el impulso de capacidades a $5.00 de entrada y $30.00 de salida. El argumento visual de Sakana para Max es un gráfico de Pareto —capacidad frente a costo—, y en un gráfico de Pareto una puntuación bruta de benchmark es irrelevante; la puntuación por dólar es toda la afirmación. Si ese es el argumento, imprimir seis puntuaciones ganadoras sin sus costos sería el gráfico engañoso, no el ausente. Lo que el lanzamiento aún le debe a un comprador es un denominador, y no lo proporciona.

Dónde Grok 4.6 queda realmente expuesto

El trabajo en terminal es la superficie publicada más débil de Grok 4.6. Su puntuación en Terminal-Bench v3.0 se sitúa en el 26 %, muy por detrás de la cabeza del sector. Cuidado con la cifra contigua: el mismo modelo registra un 88,4 % en Terminal-Bench v2.1, y son pruebas diferentes. Verás las dos mezcladas en la cobertura, y esa mezcla favorece considerablemente a Grok.

La segunda exposición es que el razonamiento no se puede desactivar. Los tokens de pensamiento se facturan en cada solicitud, por lo que el coste efectivo de salida de Grok 4.6 depende de con cuánta intensidad decida pensar el modelo sobre tu prompt. El control de esfuerzo te da control en el extremo inferior, pero no hay un ajuste de cero.

Frente a eso, Grok 4.6 tiene algo que Fugu Max no puede ofrecer actualmente a ningún precio: un número. Cada fila de arriba puede ser verificada por un tercero, y la entrada de Artificial Analysis significa que una ya lo ha sido. Las seis victorias de Fugu Max se publicaron el mismo día que el modelo, por la empresa que lo creó, y, al momento de escribir esto, nadie fuera de Sakana lo ha ejecutado.

Llamando a uno, pilotando al otro

Grok 4.6 está en OrcaRouter al precio de lista de SpaceXAI — $2,00 por millón de tokens de entrada, $0,50 por acierto de caché, $6,00 por millón de tokens de salida — repercutidos con un 0 % de recargo, de modo que un cambio de precio del proveedor llega a nuestra puerta de enlace el mismo día, en lugar de hacerlo según un calendario de migración. Es compatible con OpenAI en la misma URL base que el resto del catálogo, lo que significa que puedes ponerlo en una cadena de conmutación por error o detrás de una regla de enrutamiento condicional en lugar de codificar un proveedor de forma fija en una ruta de producción, y puedes hacerle una prueba A/B con otro modelo sin un segundo contrato. Ha movido 46,6 millones de tokens a través de la puerta de enlace en los últimos siete días.

Fugu Max no está en nuestro catálogo. Llega a ti a través de la propia API de Sakana compatible con OpenAI y de varias plataformas de terceros, y la empresa dice que una integración existente de Fugu se actualiza a él con un solo cambio de parámetro. Como ambos hablan el mismo formato de solicitud, una evaluación que los ponga detrás de un mismo flag es un intercambio de URL base en lugar de una reescritura, que es la forma correcta de resolver este argumento en particular, ya que el argumento trata sobre tokens por tarea finalizada y solo tu propia carga de trabajo puede producir ese número.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the introductory argument that a system deploying a multi-trillion-parameter model for a simple lookup is wasteful, and a cost-versus-performance chart placing Fugu Max on a frontier formed by Fugu models above the frontier formed by single models.

¿Cuál comprar?

Grok 4.6 es la opción predeterminada defendible. Con una tarifa idéntica a la de Fugu Max, te ofrece una ventana de contexto de 500K con la que puedes planificar, una versión que puedes fijar, cuatro niveles de control de razonamiento, una posición en un índice independiente en 44 con una cifra de coste por tarea al lado, y meses de mediciones de terceros. Sus costes son específicos y conocidos: el precipicio de reajuste de precios de los 200K, razonamiento que siempre se factura y un perfil de trabajo de terminal que va por detrás del resto.

Fugu Max es la apuesta más interesante y, según la evidencia disponible, la menos inspeccionable. El argumento de diseño es sólido: si un coordinador elige de forma fiable el modelo más barato que pueda completar tu tarea, tu costo mediano por trabajo completado baja incluso cuando tu tarifa no lo hace. Pero a $2.00 / $6.00, la tarifa por token no es donde reside la ventaja de Fugu Max; esa tarifa es exactamente la de Grok 4.6. La ventaja tiene que venir de gastar menos tokens, y Sakana no ha publicado la medición que lo demostraría.

Así que haz la comparación tal como ambos proveedores te piden que lo hagas. Pon Grok 4.6 en tu puerta de enlace, llama a Fugu Max detrás de una bandera de funcionalidad y cuenta los tokens de salida por tarea completada en trabajo que se parezca al tuyo. Si Fugu Max termina con menos tokens que un solo modelo a la misma tarifa, el descuento por caché y la coordinación son dinero real, y el cambio está justificado. Si no lo hace, estás pagando tarifas idénticas por un sistema cuya composición puede cambiar por debajo de ti sin que su número de versión se mueva.

Para todo lo que puedas decidir este trimestre sin esa medición, empieza por el modelo que tiene un marcador.

A screenshot of the OrcaRouter model page for Grok 4.6 (English UI, captured September 11, 2026), showing the NEW and Featured badges, the identifier grok/grok-4.6, by SpaceXAI dated 2026-08-12, vision, tools, JSON and reasoning capability tags, a 500K-token context window with text, image and file input, a p50 TTFT of 10.00 seconds, list pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens, traffic of 46.6 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario