
Fugu Max vs DeepSeek V4 Pro: el optimizado en costes es el caro
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiNUEVOOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleNUEVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenNUEVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencia72Código
- anthropicNUEVOAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencia69Código
Fugu Max está diseñado para ser la opción barata y, de todos modos, DeepSeek V4 Pro lo supera en precio. Sakana AI lanzó Fugu Max el 11 de septiembre de 2026 a 2,00 USD por millón de tokens de entrada y 6,00 USD por millón de tokens de salida, posicionándolo como un coordinador que amplía la frontera de costo-rendimiento al enrutar cada tarea al modelo más económico de su conjunto. DeepSeek V4 Pro, en catálogo desde abril de 2026, se sitúa en 0,73 USD de entrada y 2,18 USD de salida por millón según la tarifa medida de OrcaRouter — aproximadamente un tercio de lo que Fugu Max cobra en ambos ejes, proveniente de un único modelo de mezcla de expertos con pesos abiertos, con un techo de salida de 384K y sin capa de orquestación alguna. Esa inversión de precios es toda la comparación. Todo lo demás sobre este par es una pregunta sobre qué te aporta la orquestación cuando la base que intentas socavar con precios más bajos ya es más barata que tú.
Dos maneras de reducir una factura, y una de ellas ya es más baja
El argumento de Sakana a favor de Fugu Max es que un coordinador puede reducir el gasto al no pagar precios de frontera por tareas que no necesitan capacidad de frontera. Es un argumento sólido. El problema es el modelo contra el que se plantea. DeepSeek V4 Pro es una mezcla de expertos de 1,6 billones de parámetros con 49.000 millones de parámetros activos por token, que es la misma idea de reducción de costes ejecutada un nivel más abajo: pagas por los parámetros que un token activa realmente, no por el tamaño de la red. Ambos productos son respuestas a «cómo dejar de pagar por capacidad que no usamos». Uno de ellos cobra 2,18 dólares por millón de tokens de salida por el privilegio.
• Precio de entrada — Fugu Max $2.00 por 1M de tokens vs. DeepSeek V4 Pro $0.73 por 1M de tokens con medición
• Precio de salida — Fugu Max $6.00 por 1M de tokens frente a DeepSeek V4 Pro $2.18 por 1M de tokens medidos
• Entrada en caché — Fugu Max $0.25 por 1M de tokens frente a la entrada con acierto de caché de DeepSeek V4 Pro, con un precio muy inferior a su tarifa base, y con la tarifa de lista publicada por el proveedor situada por debajo de $1.00 por 1M
• Contexto — Fugu Max no publicado frente a DeepSeek V4 Pro 1M tokens
• Límite de salida — Fugu Max no publicado frente a DeepSeek V4 Pro 384K tokens
• Modalidad — Fugu Max no publicado frente a DeepSeek V4 Pro solo texto, con uso de herramientas, modo JSON y razonamiento
• Arquitectura — Fugu Max, un coordinador entrenado sobre un conjunto no revelado, frente a DeepSeek V4 Pro, un único modelo MoE, linaje de pesos abiertos
• Cifras de benchmark — seis victorias de Fugu Max afirmadas sin puntuaciones frente a las reportadas por el proveedor de DeepSeek V4 Pro: 87.9 en Terminal Bench 2.1, 92.8 en GPQA Diamond, 96.4 en SWE-bench Vals
Un número en esa lista merece ser destacado. DeepSeek reporta 87.9 en Terminal Bench 2.1. Fugu Max afirma tener "la mejor puntuación general" en Terminal Bench 2.1. El mismo benchmark, la misma ventana de lanzamiento, un lado publica una cifra y el otro publica la palabra "mejor". Esa es la ilustración más clara de la asimetría de evidencia en este par, y no es un detalle: es la razón completa por la que la brecha de precio no es el final del argumento.

Qué aporta la orquestación cuando la línea base ya es barata
El argumento a favor de pagar más por Fugu Max tiene que basarse en trabajo que un solo modelo maneja mal, y existe una categoría real de ello. Las tareas de horizonte largo en las que un paso en falso se acumula —refactorizaciones de varios archivos, cambios a escala de repositorio, cualquier cosa en la que un verificador que compruebe la salida del trabajador valga más que un trabajador más potente— son exactamente para lo que sirve una disposición Pensador/Trabajador/Verificador. El propio planteamiento de Sakana para la línea Fugu es que detectar un error en una segunda pasada es más barato que acertar a la primera. En esas tareas, una tarifa de salida de $6.00 que termina en un intento puede superar a una tarifa de $2.18 que necesita tres.
Ese argumento tiene una forma comprobable y Sakana no la ha ejecutado en público. La comparación que querrías es el costo por tarea completada en un benchmark que ambos sistemas intentan — Terminal Bench 2.1 está justo ahí, es agéntico y basado en terminal por construcción, y solo uno de los dos proveedores ha publicado una cifra para él. Hasta que se cierre esa brecha, la postura honesta es que la ventaja de costo de Fugu Max se afirma a nivel de tokens y no está probada a nivel de tarea, mientras que la de DeepSeek V4 Pro es directa: los propios tokens cuestan una tercera parte.
Hay un punto de segundo orden sobre la composición del pool que importa más para esta comparativa que para la mayoría. El pool de Fugu Max se amplió en esta versión para incluir modelos de pesos abiertos y especializados, con la familia NVIDIA Nemotron nombrada mediante una colaboración con NVIDIA. Los pesos abiertos en el pool hacen que el peldaño más barato de la escalera de Sakana no esté expuesto a las decisiones de precios de otro laboratorio. DeepSeek V4 Pro, al ser él mismo de pesos abiertos, no está expuesto a las decisiones de precios de nadie salvo a las de DeepSeek — y es el peldaño. El argumento de resiliencia que Sakana plantea para la orquestación se aplica directamente a DeepSeek y solo indirectamente al suministro subyacente de Fugu Max.
El almacenamiento en caché es donde las cargas de trabajo de los agentes realmente se vuelven costosas.
La tarifa base de ninguno de los dos proveedores es la tarifa que paga un bucle de agente. Las ejecuciones largas de agentes reenvían en cada turno un prefijo extenso que, en su mayor parte, no cambia, y la tasa de aciertos de caché es lo que determina la factura real. Fugu Max indica la entrada en caché a $0.25 por millón, una cifra auténtica y agresiva — una octava parte de su propia tarifa base de entrada. DeepSeek V4 Pro fija el precio de la entrada con acierto de caché muy por debajo de su base publicada, y su tarifa de salida se establece en aproximadamente tres veces su entrada, en lugar de la proporción de cuatro a cinco veces que usan la mayoría de los proveedores, lo que comprime específicamente el costo de los bucles con mucha generación.
Lo que no puedes hacer hoy es calcular la comparación de forma fiable a partir de la lista de precios de cualquiera de los dos proveedores, porque la tarifa en caché de Fugu Max se aplica a una cantidad de tokens que no puedes predecir. Un orquestador decide cuántos agentes se ejecutan; el contexto de cada agente contribuye; el coordinador añade el suyo. El compromiso de precios de Sakana para la línea Fugu —una tarifa combinada basada en el modelo participante de nivel superior, sin que los agentes acumulen la factura— elimina el peor escenario, lo cual es una concesión real y digna de reconocimiento. No hace que el volumen se pueda conocer de antemano. La factura de DeepSeek V4 Pro es una función de los tokens que envías y los tokens que recibes, y nada más.
Esa previsibilidad es una propiedad de enrutamiento tanto como una propiedad del modelo. DeepSeek V4 Pro está en OrcaRouter al precio de lista del proveedor con un 0 % de recargo, así que una revisión de tarifas de DeepSeek llega a tu clave existente el mismo día en lugar de en tu próxima renovación de contrato, y la conmutación por error automática te cubre cuando una ruta de proveedor alcanza su límite de tasa. Esa última parte tiene un peso inusual para este modelo en concreto: DeepSeek ya ha revisado sus precios una vez en este ciclo, con niveles de hora punta y fuera de punta cuyas cifras finales varían entre fuentes. Cuando cambia la lista de tarifas de un proveedor, el enrutador es la diferencia entre absorber el cambio y descubrirlo en una factura.

Lo que no pudimos verificar
Tres cosas del lanzamiento de Fugu Max no se pudieron contrastar con nada fuera de los propios materiales de Sakana, y se enumeran aquí en lugar de pasarlas por alto. Primero, las seis victorias en benchmarks no incluyen cifras: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench y SWEFish se mencionan como victorias sin puntuaciones asociadas, y SWEFish es un benchmark interno de Sakana. Segundo, la ventana de contexto, el límite de salida y las modalidades compatibles de Fugu Max no se han publicado, por lo que las filas de modalidad y límite anteriores comparan una especificación ya publicada frente al silencio. Tercero, no existe ninguna evaluación independiente de ningún modelo Fugu, y no hay ninguna entrada de Artificial Analysis para Fugu Max.
Para DeepSeek V4 Pro, la situación es la inversa. El proveedor informa una larga lista de cifras — Terminal Bench 2.1 87.9, GPQA Diamond 92.8, SWE-bench Vals 96.4, HLE 42.7 y 60.0 en dos configuraciones, MCP Atlas 73.6, Toolathlon-Verified 74.1, CyberGym 83.3 — y todas ellas también son reportadas por el proveedor. La diferencia no es que un proveedor sea más confiable. Es que cuando ambas partes publican números, el desacuerdo es posible, y un desacuerdo puede investigarse. Una afirmación sin ningún número no puede comprobarse; solo puede aceptarse o ignorarse.
Una salvedad adicional sobre el precio de DeepSeek que aparece arriba: nuestra propia página del modelo contiene dos cifras, una tarifa medida de $0.73 de entrada y $2.18 de salida por millón en los mosaicos de precios y una descripción más antigua de $0.44 de entrada y $0.87 de salida por millón. DeepSeek también ha anunciado niveles de hora punta y hora valle sobre cuyas tarifas finales las fuentes no se ponen de acuerdo. Trata $0.73 y $2.18 como la tarifa que realmente se te facturará a través de nosotros hoy y confírmala con la tarjeta de tarifas publicada antes de elaborar un presupuesto basado en ella.
En resumen
DeepSeek V4 Pro gana esta comparación en los términos que eligió Fugu Max. Es más barato en entrada y salida, tiene una ventana de contexto publicada y un límite de salida de 384K, reporta un número real en el benchmark que Fugu Max afirma liderar, y su linaje es de pesos abiertos, que es la forma más fuerte disponible del argumento de independencia del proveedor que vende Sakana. Si tu carga de trabajo es intensiva en tokens y tu prioridad es el costo por token más bajo y defendible de un modelo que puedas fijar, no hay comparación.
Fugu Max gana una pregunta más acotada que DeepSeek V4 Pro no responde en absoluto: si un coordinador que ensambla su propio equipo de agentes puede terminar trabajo difícil y de horizonte largo en menos intentos que un solo modelo. Vale la pena pilotarlo si tienes trabajo verificable y tolerante a fallos, y estás fuera de la UE/EEE. Calcula su costo en tokens por tarea completada, fija primero un límite máximo y compáralo con el endpoint de DeepSeek V4 Pro en OrcaRouter al precio de lista del proveedor — una clave, 0% de recargo, y una tarifa que sigue la del propio proveedor.

Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
