Una tarjeta de título principal para "Fugu Max vs Claude Opus 5" con el subtítulo "Cuatro veces más barato, y un número que nadie publicó", tres insignias tipo píldora que dicen $6.00 vs $25.00 de salida", "Seis victorias, cero puntuaciones", "$2.00 vs $5.00 de entrada, una línea de pie de página que dice "Sakana AI vs Anthropic - septiembre de 2026", y el logotipo de OrcaRouter en la esquina inferior derecha.
Guides & Insights

Fugu Max vs Claude Opus 5: cuatro veces más barato, y una cifra que nadie publicó

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Fugu Max cuesta $6.00 producir un millón de tokens de salida. Claude Opus 5 cuesta $25.00. Sakana AI lanzó Fugu Max el 11 de septiembre de 2026 como un coordinador que enruta cada tarea al modelo más ligero de su conjunto, y lo puso a un precio lo suficientemente agresivo como para que una brecha de salida de cuatro veces frente al buque insignia de Anthropic sea el hecho destacado del lanzamiento. Lo que el lanzamiento no contiene es ni un solo número que describa qué tan bien funciona Fugu Max en realidad. Sakana dice que obtiene la “mejor puntuación general” en seis benchmarks y amplía la frontera de costo-rendimiento en siete de diez: afirmaciones sobre la ubicación en una gráfica más que sobre valores en un eje. Claude Opus 5, en cambio, llega con una puntuación publicada para casi todo lo que hace. Así que la versión honesta de esta comparación no es barato contra caro. Es medido frente a aseverado, y la brecha de precios es lo que hace que esa disyuntiva merezca debate.

La brecha, y la comparación que Sakana decidió no hacer

La página de lanzamiento de Sakana justifica la tasa de salida de Fugu Max comparándola con otros modelos. Los tres que menciona son Claude Sonnet 5, GPT-5.6 Terra y Kimi K3, y la afirmación es que el precio de salida de Fugu Max es entre un 40 y un 60 por ciento inferior al de ellos. Fíjate en quién está ausente. Claude Opus 5 no figura en esa lista, y la razón es aritmética: con $6.00 frente a $25.00, Fugu Max no es un 40 por ciento más barato que Opus 5, sino un 76 por ciento más barato. Nombrar a Opus 5 habría hecho que la afirmación pareciera inverosímil en lugar de competitiva, así que la comparación se establece contra el escalón inferior al buque insignia.

Eso no es una crítica a los precios, que son genuinamente bajos. Es una observación sobre lo que está haciendo la frase que los rodea. El propio planteamiento de Sakana —rendimiento "a tiro de piedra de los modelos de élite a un costo de dos a seis veces menor"— está calibrado para los modelos que eligió nombrar. Frente a Claude Opus 5, el múltiplo no es de dos a seis, sino superior a cuatro en salida; si Opus 5 sigue siendo un "modelo de élite" según los criterios de esa frase queda sin decir, lo cual es una omisión curiosa en un lanzamiento cuyo argumento de venta entero es la eficiencia de costo-rendimiento en la frontera.

• Precio de entrada — Fugu Max $2.00 por 1M de tokens frente a Claude Opus 5 $5.00 por 1M de tokens

• Precio de salida — Fugu Max $6.00 por 1M de tokens vs Claude Opus 5 $25.00 por 1M de tokens

• Entrada en caché — Fugu Max $0.25 por 1M de tokens frente al almacenamiento en caché de Claude Opus 5 con un precio de descuento de hasta el 90% en la entrada en caché

• Puntuaciones de benchmark — Fugu Max: ninguna publicada; se afirman seis victorias en benchmarks sin cifras frente a Claude Opus 5, según Anthropic: 96,0 % en SWE-bench Verified, 79,2 % en SWE-bench Pro, aproximadamente 30,2 % en ARC-AGI 3

• Arquitectura — Fugu Max, un coordinador entrenado sobre un conjunto no revelado, frente a Claude Opus 5, un único modelo que puede fijarse por versión

• Contexto — Fugu Max no publicado frente a Claude Opus 5 con 1M de tokens, con un límite de salida de 128K

• Evaluación independiente — no existe ninguna para ningún modelo Fugu, frente a los 5 meses de posiciones en clasificaciones de terceros de Claude Opus

Seis victorias sin puntuaciones adjuntas

Los seis benchmarks son Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench y SWEFish. Cinco de ellos son evaluaciones públicas reconocibles. El sexto, SWEFish, es el propio benchmark de programación de Sakana, lo que significa que una de las seis victorias se puntúa con una prueba escrita por el proveedor y que no ha publicado.

Para los otros cinco, el comunicado afirma que Fugu Max logra la mejor puntuación general sin indicar cuál es esa puntuación, ni qué puntuó ninguno de los competidores. Esa es una forma inusual para el anuncio de un modelo. Los proveedores suelen exagerar, pero normalmente exageran con números, porque los números son lo que viaja. Un comunicado que afirma seis victorias y no imprime ninguna de ellas pide que se le tome solo por la fuerza de la afirmación.

Hay una interpretación caritativa y vale la pena decirla sin rodeos. Fugu Max es un coordinador optimizado en costos, no un impulso de capacidades: Sakana lo lanzó el mismo día que Fugu Ultra v2, que es la versión orientada a la máxima capacidad con $5.00 de entrada y $30.00 de salida. La misión de Max es alcanzar una calidad aceptable con $6.00 de salida, y la puntuación destacada de un orquestador es menos significativa que su puntuación por dólar, que es exactamente lo que muestra un gráfico de Pareto. La comunicación visual de Sakana para este lanzamiento son gráficos de Pareto. Si el argumento es «mira la curva, no el pico», entonces una cifra bruta de benchmark no viene al caso.

La lectura poco caritativa es que una cifra invitaría a una comparación que el proveedor preferiría evitar. Ambas lecturas son coherentes con la evidencia, y nada en el registro público permite distinguirlas actualmente. Lo que puede decirse es que ninguna parte independiente ha evaluado ningún modelo Fugu, y no existe una entrada de Artificial Analysis para Fugu Max ni para ninguno de sus similares. Todas las cifras del comunicado, incluidas las seis victorias, provienen de Sakana.

A two-column scoreboard titled "Fugu Max vs Claude Opus 5 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Benchmarks six wins with no figures, Context not published, Evidence vendor-reported only. Right column Claude Opus 5: Output price $25.00 / 1M, Input price $5.00 / 1M, Cached input up to 90% discount, Benchmarks 96.0% SWE-bench Verified, Context 1M with a 128K output ceiling, Evidence independent evals. Footer reading "Fugu Max figures vendor-reported by Sakana AI; Opus 5 rows Anthropic-reported. No independent Fugu Max evaluation exists.", with the OrcaRouter logo bottom-right.

La compra que realmente estás haciendo

Cuando un proveedor de un solo modelo publica un benchmark, lo que se compra es una afirmación sobre un modelo. Cuando un orquestador publica uno, lo que se compra es una afirmación sobre un conjunto —modelos que el proveedor no entrenó, que se ejecutan bajo un coordinador cuyas decisiones de enrutamiento deliberadamente no se exponen. El conjunto aquí se describe como el más grande que Fugu ha utilizado, ampliado con modelos de pesos abiertos y especializados, incluida la familia NVIDIA Nemotron, mediante una colaboración con NVIDIA. Por lo demás, los miembros no se divulgan.

La consecuencia práctica es que el comportamiento de Fugu Max puede cambiar sin que cambie su versión. La deprecación de un laboratorio de frontera, un cambio de precio o la retirada de un modelo de una región alteran lo que el coordinador puede invocar, y Sakana es explícita en que esta resiliencia es el objetivo: vende protección contra la dependencia de proveedores y las revocaciones de API. Eso es un beneficio real y no es gratis. También es la razón por la que un benchmark de Fugu Max, si se publicara, llevaría una fecha de caducidad que un benchmark de Claude Opus 5 no tiene.

La propuesta de valor de Claude Opus 5 es la inversa y es más fácil de fijar precio. Es un modelo en una versión, que ejecuta pensamiento adaptativo por defecto con un dial de esfuerzo explícito de bajo a máximo, con una ventana de contexto de 1M de tokens y un techo de salida de 128K, con visión, uso de herramientas y modo JSON. Anth​ropic reporta 96,0% en SWE-bench Verified y 79,2% en SWE-bench Pro, y esos números se midieron sobre lo que obtienes cuando llamas al endpoint, no sobre un conjunto cuya composición puede moverse por debajo de ti. Para una carga de trabajo que se ejecuta en producción y se revisa, esa estabilidad es una característica que estás pagando 19,00 $ por millón de tokens de salida por tener.

Costo por tarea finalizada, no por token

La tarifa de salida de $6.00 de Fugu Max es genuinamente atractiva, y la forma de probarla es dejar de comparar precios de tokens. Un orquestador genera agentes; cada uno escribe tokens de razonamiento y de salida; el coordinador escribe una síntesis. Las preguntas frecuentes sobre precios de Sakana para la línea Fugu se comprometen con una única tarifa combinada basada en el modelo participante de primer nivel, sin que las ejecuciones multiagente acumulen la factura, lo que elimina la multiplicación por abanico del peor caso que hace que los sistemas multiagente ingenuos sean inasequibles. No elimina el volumen. La cantidad de tokens de salida que se te factura es función de cuántos agentes se ejecutaron, y a $6.00 por millón, ese volumen es la variable que una página de precios no puede decirte.

El perfil de costos de Claude Opus 5 es una sola llamada, un solo modelo, un dial de esfuerzo que tú controlas y procesamiento por lotes a mitad de tarifa para el trabajo que puede esperar. Puedes pronosticarlo antes de ejecutarlo. A lo largo de más de diez mil ejecuciones, la capacidad de previsión vale mucho más que un margen de referencia que nadie ha publicado.

Aquí es donde la cuestión del enrutamiento se separa de la cuestión del modelo. Claude Opus 5 está en OrcaRouter al precio de lista de Anth​ropic con 0% de margen — la tarifa del proveedor se transmite directamente, por lo que un cambio en el precio de Anth​ropic se aplica en la misma clave el mismo día, con conmutación por error automática entre las rutas de los proveedores cuando una tiene límite de velocidad o no está disponible. Fugu Max no está en nuestro catálogo; llega a ti a través de la propia API compatible con OpenAI de Sakana y varias plataformas de terceros, y pasar a él desde un Fugu anterior es un cambio de una sola línea en los parámetros. Si quieres la base de evidencia de Opus 5 y una factura que puedas predecir, el enrutador es el camino más corto. Si quieres un sistema que arme su propia distribución en abanico para problemas difíciles, Fugu Max es lo que hace eso, y deberías pilotarlo con la contabilidad de tokens activada desde la primera solicitud.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Donde Fugu Max es probablemente la respuesta correcta

Reconozcamos el mérito del diseño. Si tu trabajo es de gran volumen, verificable, y te importa el costo mediano de una tarea completada en lugar de la capacidad máxima de cualquier llamada individual, un orquestador que elige el modelo suficiente más barato para cada solicitud hace algo que un modelo insignia fijo no puede hacer. Fugu Max apunta directamente a esa carga de trabajo, y la tarifa de entrada de $2.00 con $0.25 de entrada en caché está pensada para los contextos largos y repetitivos que generan esas cargas de trabajo. La colaboración con NVIDIA también importa más de lo que parece: los modelos Nemotron son de pesos abiertos, lo que significa que el escalón más barato del conjunto no está expuesto a las decisiones de precios de otro laboratorio.

Lo que eso no te da es una razón para creer que Fugu Max igualará a Claude Opus 5 en las tareas donde los números publicados de Opus 5 son más fuertes: ingeniería de software a escala de repositorio y razonamiento difícil. Esas son precisamente las filas donde el tablero de seis benchmarks de Sakana no ofrece ninguna cifra. Si tu problema es uno en el que ser el mejor importa más que ser barato, la tarifa de salida de $25.00 compra lo que realmente necesitas.

En resumen

Claude Opus 5 es la compra mejor respaldada por evidencia y la opción predeterminada más segura para producción: benchmarks publicados por el proveedor, una versión que puedes fijar, una ventana de contexto que no se mueve, un límite de salida de 128K, un control de esfuerzo que te permite comprar razonamiento solo cuando vale la pena, y meses de resultados de terceros que lo respaldan. Fugu Max es la apuesta más interesante y una opción genuinamente más barata —aproximadamente 60 por ciento menos en entrada y 76 por ciento menos en salida, con una tasa de caché un orden de magnitud por debajo del precio base de entrada de Opus 5.

Si realizas trabajo verificable, repetitivo y de gran volumen y estás fuera de la UE/EEE, Fugu Max merece un piloto con alcance definido, con un límite máximo de tokens de salida fijado antes de empezar y una medición de tokens por tarea completada en lugar de tokens por llamada. Si necesitas una decisión de producción que puedas defender ante alguien más este trimestre, Claude Opus 5 sigue siendo la respuesta —y está disponible en OrcaRouter al precio de lista de Anthropic, con la tarifa del proveedor transferida sin modificaciones.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured September 11, 2026, English UI), showing the Featured badge, the anthropic/claude-opus-5 model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24, the /v1/chat/completions and /v1/messages endpoints, the pricing tiles reading INPUT $5.00 and OUTPUT $25.00 per 1M tokens with p50 TTFT 4.94s and 195.4M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.