
Fugu Max vs GPT-5.6 Sol: la afirmación de precios apuntaba a la parte media de la familia
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiNUEVOOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleNUEVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenNUEVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencia72Código
- anthropicNUEVOAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencia69Código
Fugu Max's price justification names a GPT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same OpenAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.
Verificando la afirmación contra la familia a la que apunta
La cifra del 40 al 60 por ciento de Sakana es comprobable, porque el modelo que menciona tiene una tarifa publicada. GPT-5.6 Terra aparece listado a $2.00 de entrada y $12.00 de salida por millón de tokens. Fugu Max aparece listado a $2.00 de entrada y $6.00 de salida. Haz la comparación y surgen dos cosas. En salida, $6.00 frente a $12.00 es un recorte de exactamente el 50 por ciento —justo en el centro de la ventana declarada del 40 al 60, lo que es señal de que la ventana se trazó alrededor de esta comparación en lugar de descubrirse a partir de ella. En entrada, las dos tarifas son idénticas hasta el centavo.
That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the GPT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.
• Precio de entrada — Fugu Max $2.00 por 1M de tokens vs GPT-5.6 Sol $4.00 por 1M de tokens
• Precio de salida — Fugu Max $6.00 por 1M de tokens vs GPT-5.6 Sol $20.00 por 1M de tokens
• Entrada en caché — Fugu Max $0.25 por 1 millón de tokens frente al caché de GPT-5.6 Sol, cuyo precio es un descuento sobre la tarifa base de entrada
• Contexto — Fugu Max no publicado vs GPT-5.6 Sol 1M tokens
• Límite de salida — Fugu Max no publicado vs GPT-5.6 Sol 128K tokens
• Modalidad de entrada — Fugu Max: no publicada vs. GPT-5.6 Sol: texto, imagen y archivo
• Etiquetas de capacidades — Fugu Max: ninguna publicada frente a GPT-5.6 Sol: visión, uso de herramientas, modo JSON, razonamiento
• Endpoints — Fugu Max, una superficie compatible con OpenAI frente a las completaciones de chat de GPT-5.6 Sol y la API de respuestas
• Cifras de benchmark — Fugu Max afirma seis victorias sin puntuaciones, frente a las cifras publicadas por el proveedor de GPT-5.6 Sol, que incluyen Terminal-Bench 2.0 con un 91,9 % y SWE-bench Pro con un 64,6 %
Por qué el peldaño medio es el peldaño correcto para nombrar
Hay una versión defendible de la elección de Sakana, y merece ser expuesta antes de la crítica. Un orquestador que enruta cada tarea al modelo capaz más ligero no compite con un modelo insignia en trabajo de gama alta. Compite con un modelo de gama media en trabajo de gama media, y ofrece realizar un subconjunto de ese trabajo a menor costo. Si la propuesta es «la mayor parte de tu tráfico no necesita Sol», entonces Terra es el comparador correcto, porque Terra es lo que la mayoría de los equipos realmente elige cuando no quiere pagar los precios de Sol. Medirse contra la gama que tu cliente compraría de otro modo es más honesto que medirse contra el modelo más caro disponible.
La dificultad es que la misma frase también afirma un rendimiento «a tiro de piedra de los modelos de élite». Esas dos mitades del argumento tiran en direcciones opuestas. Si Fugu Max es un sustituto de Terra, entonces el encuadre de modelo de élite está haciendo un trabajo de marketing que no puede sostener, porque a Terra no se la posiciona explícitamente como élite: se la posiciona como el nivel de lo suficientemente bueno. Si Fugu Max está de verdad a tiro de piedra de Sol, entonces la comparación de precios debería haberse trazado contra Sol, donde la brecha es mayor y más halagadora. Un lanzamiento que hace la afirmación agresiva sobre la capacidad y la comparación conservadora de precios en el mismo párrafo se está quedando con lo mejor de ambos mundos, y el lector no tiene forma de saber qué mitad es la que sostiene el peso.

Seis puntos de referencia, sin cifras, y un nombre que debería suscitar una pregunta
La mitad del pitch dedicada a las capacidades se basa en una lista. Fugu Max «logra la mejor puntuación general» en Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench y SWEFish. No se muestra ninguna puntuación de ninguno de ellos. SWEFish es el benchmark interno de codificación de la propia Sakana, lo que significa que una de las seis victorias se puntúa con una prueba que el proveedor escribió y no ha publicado.
GPT-5.6 Sol reporta cifras. Sol figura con un 91,9 % en Terminal-Bench 2.0 y un 64,6 % en SWE-bench Pro en datos comparativos de terceros. Ten en cuenta la discrepancia de versiones en el benchmark de terminal: la cifra publicada de Sol corresponde a Terminal-Bench 2.0, y Sakana afirma una victoria en 2.1, que es una evaluación diferente y no se puede comparar con ella. Merece la pena señalarlo porque las dos afirmaciones parecen estar una al lado de la otra en un titular y no son comparables en realidad.
La comparación relevante para este enfrentamiento sería Sol contra un modelo Fugu en una evaluación compartida. Las páginas de comparación de terceros sí incluyen GPT-5.6 Sol frente a la generación base Sakana Fugu —con Sol por delante en Terminal-Bench 2.0 con 91,9% a 80,2% y en SWE-bench Pro con 64,6% a 59%—, pero esas son cifras de la generación anterior, no de Fugu Max, y esas mismas fuentes se niegan explícitamente a nombrar un ganador global porque la cobertura de benchmarks compartidos es demasiado escasa. No existe ninguna comparación publicada de ningún tipo entre Fugu Max y GPT-5.6 Sol. Quien afirme que existe una está extrapolando.
Ninguna parte independiente ha evaluado Fugu Max, y no existe una entrada de Artificial Analysis para él ni para ningún modelo Fugu. Cada número en el anuncio, incluidas las seis victorias, proviene del proveedor. Sol, en cambio, está disponible de forma general desde el 9 de julio de 2026 y aparece en clasificaciones de terceros — un nivel de escrutinio externo que Fugu Max no ha tenido la oportunidad de recibir.
Lo que realmente estás comprando en cada lado
Configurar GPT-5.6 Sol es terreno conocido. Cuenta con una ventana de contexto de 1M de tokens, un límite de salida de 128K, entrada de texto, imágenes y archivos, visión, uso de herramientas, modo JSON y razonamiento como capacidades documentadas, y dos endpoints —chat completions y la Responses API—, de modo que una integración existente tiene hacia dónde ir. Muestra un tiempo hasta el primer token (p50) de 6,68 segundos en el tráfico que servimos, lo cual es más lento que los modelos más rápidos de nuestro catálogo y conviene saberlo antes de construir sobre él un producto interactivo.
Configurar Fugu Max se parece más a comprar un nivel de servicio que a comprar un modelo. Obtienes un único endpoint compatible con OpenAI, un cambio de parámetro de una sola línea para migrar a él desde un Fugu anterior y un coordinador que decide qué modelos invocar. Lo que no obtienes, según la página de la versión, es una ventana de contexto, un límite de salida, una lista de modalidades, una cifra de latencia ni una puntuación de benchmark. Las decisiones de enrutamiento del coordinador no se exponen por diseño. El conjunto se amplió en esta versión para incluir modelos de pesos abiertos y especializados, con la familia NVIDIA Nemotron mencionada mediante una colaboración con NVIDIA, y por lo demás no se divulga.
La justificación declarada de Sakana para esa opacidad es defendible — un pool agnóstico de proveedores que se puede intercambiar es una protección contra deprecaciones, cambios de precios y retiradas regionales. Es una cobertura real, y la tarifa de entrada en caché de $0.25 sugiere que Sakana espera las cargas de trabajo de contexto largo y alta repetición donde esa cobertura importaría más. Pero sí significa que la especificación que está comprando es una promesa sobre una cadena de suministro en lugar de una descripción de un producto.

Cómo ejecutar la prueba
La forma correcta de resolver esto no es leer la página de ninguno de los dos proveedores. Toma una muestra de tu propio tráfico —unos cientos de solicitudes reales, idealmente incluyendo las que tu equipo escala actualmente— y ejecútalas contra ambos endpoints con la contabilidad de tokens activada. Calcula el costo en tokens por tarea completada en lugar de tokens por llamada, establece un presupuesto de salida antes de empezar para que un fan-out no te sorprenda, y mide la calidad según si una segunda persona coincide en que la respuesta fue aceptable. Ese experimento responde a la pregunta en una semana y cuesta poco.
The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at OpenAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to OpenAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.
En resumen
GPT-5.6 Sol gana la comparación que Sakana se negó a trazar. Cuesta el doble por entrada y más del triple por salida, y a cambio obtienes una ventana de contexto publicada, un límite de salida de 128K, entrada multimodal documentada, etiquetas de capacidades con nombre, dos endpoints y benchmarks del proveedor que terceros han tenido meses para examinar. Si tu trabajo es del tipo para el que se creó Sol —razonamiento profundo de varios pasos, ingeniería de software a gran escala, tareas agénticas de largo horizonte—, la diferencia de precio es el costo de comprar algo que puedes especificar.
Fugu Max gana una apuesta más estrecha y genuinamente interesante, y es la más económica por un amplio margen: un 50 por ciento por debajo de GPT-5.6 Terra en salida, un 70 por ciento por debajo de Sol, con la tasa de caché más baja en cualquiera de las dos listas de tarifas. Si tu tráfico es de gran volumen, solo texto, verificable y en su mayoría no necesita razonamiento de gama alta, un orquestador que enruta hacia el modelo suficiente más ligero es un diseño coherente y la tarifa de salida de $6.00 es donde reside el valor. Toma el propio planteamiento del lanzamiento al pie de la letra y pruébalo como sustituto de Terra en lugar de Sol — y si quieres el modelo insignia con el precio de lista del proveedor pasado sin modificaciones, GPT-5.6 Sol está a una tecla de distancia en OrcaRouter.

Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
