
Fugu Max vs Claude Opus 5: vier keer goedkoper, en een getal dat niemand heeft gepubliceerd
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Fugu Max kost $6,00 om een miljoen tokens aan output te produceren. Claude Opus 5 kost $25,00. Sakana AI bracht Fugu Max op 11 september 2026 uit als een coördinator die elke taak naar het zuinigste model in zijn pool routert, en prijsde het zo agressief dat een viervoudig outputverschil ten opzichte van Anthropics vlaggenschip het opvallendste feit van de release is. Wat de release niet bevat, is één enkel getal dat beschrijft hoe goed Fugu Max daadwerkelijk presteert. Sakana zegt dat het de "beste totaalscore" haalt op zes benchmarks en de kosten-prestatiegrens verruimt op zeven van de tien — uitspraken over de plaats op een grafiek in plaats van waarden op een as. Claude Opus 5 daarentegen komt met een gepubliceerde score voor bijna alles wat het doet. De eerlijke versie van deze vergelijking is dus niet goedkoop tegenover duur. Het is gemeten tegenover beweerd, en het prijsverschil is wat maakt dat die afweging het waard is om over te discussiëren.
De kloof, en de vergelijking die Sakana verkoos niet te maken
Sakana's releasepagina rechtvaardigt het outputtarief van Fugu Max door het te vergelijken met andere modellen. De drie die het noemt, zijn Claude Sonnet 5, GPT-5.6 Terra en Kimi K3, en de bewering is dat de outputprijs van Fugu Max 40 tot 60 procent onder die van hen ligt. Let op wie ontbreekt. Claude Opus 5 staat niet in die lijst, en de reden is rekenkundig: bij $6,00 tegenover $25,00 is Fugu Max niet 40 procent goedkoper dan Opus 5, maar 76 procent goedkoper. Het noemen van Opus 5 zou de claim ongeloofwaardig in plaats van concurrerend hebben doen lijken, dus wordt de vergelijking getrokken met de laag onder het vlaggenschip.
Dat is geen kritiek op de prijsstelling, die werkelijk laag is. Het is een opmerking over wat de omliggende zin doet. Sakana's eigen framing — prestaties die "binnen schootsafstand van elite-modellen liggen, tegen twee tot zes keer lagere kosten" — is afgestemd op de modellen die het koos te noemen. Tegenover Claude Opus 5 is de factor geen twee tot zes, maar meer dan vier bij output; of Opus 5 volgens de maatstaven van die zin nog steeds een "elite model" is, blijft onvermeld, wat een merkwaardige weglating is in een release waarvan de hele propositie kosten-prestatie-efficiëntie aan de voorhoede is.
• Invoerprijs — Fugu Max $2,00 per 1 miljoen tokens vs Claude Opus 5 $5,00 per 1 miljoen tokens
• Uitvoerprijs — Fugu Max $6,00 per 1 miljoen tokens vs Claude Opus 5 $25,00 per 1 miljoen tokens
• Gecachte input — Fugu Max $0,25 per 1 miljoen tokens versus Claude Opus 5-caching, geprijsd als een korting van maximaal 90% op gecachte input
• Benchmarkscores — Fugu Max: niets gepubliceerd, zes beweerde benchmarkoverwinningen zonder cijfers, tegenover Claude Opus 5, door Anthropic gerapporteerd: 96,0% SWE-bench Verified, 79,2% SWE-bench Pro, ongeveer 30,2% op ARC-AGI 3
• Architectuur — Fugu Max, een getrainde coördinator over een niet-openbaar gemaakte pool versus Claude Opus 5, één enkel model dat per versie kan worden gepind
• Context — Fugu Max niet gepubliceerd versus Claude Opus 5 1M tokens, met een outputplafond van 128K
• Onafhankelijke evaluatie — Fugu Max: voor geen enkel Fugu-model bestaat er een, tegenover de 5 maanden aan posities op leaderboards van derden van Claude Opus
Zes overwinningen zonder bijbehorende scores
De zes benchmarks zijn Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench en SWEFish. Vijf daarvan zijn bekende publieke evaluaties. De zesde, SWEFish, is Sakana's eigen codebenchmark, wat betekent dat een van de zes overwinningen wordt gescoord op een test die de leverancier zelf heeft geschreven en niet heeft gepubliceerd.
Voor de andere vijf stelt het persbericht dat Fugu Max de beste algehele score behaalt, zonder te vermelden wat die score is, of wat een concurrent heeft gescoord. Dat is een ongebruikelijke vorm voor een modelaankondiging. Leveranciers overdrijven stelselmatig, maar ze overdrijven meestal met cijfers, omdat cijfers nu eenmaal hetgeen zijn dat rondgaat. Een persbericht dat zes overwinningen claimt en er nul van afdrukt, vraagt om louter op de kracht van de bewering te worden aangenomen.
Er is een welwillende lezing, en het is de moeite waard die ronduit te geven. Fugu Max is een op kosten geoptimaliseerde coördinator, geen capaciteitspush — Sakana bracht hem dezelfde dag uit als Fugu Ultra v2, de versie die is gericht op maximale capaciteit tegen $5,00 voor input en $30,00 voor output. De taak van Max is om acceptabele kwaliteit te bereiken tegen $6,00 voor output, en de hoofdscore van een orchestrator is minder betekenisvol dan de score per dollar, en dat is precies wat een Pareto-plot laat zien. Sakana's visuele communicatie voor deze release bestaat uit Pareto-plots. Als het argument is: 'kijk naar de curve, niet naar de piek', dan is een ruw benchmarkcijfer niet ter zake.
De minst welwillende lezing is dat een getal zou uitnodigen tot een vergelijking die de leverancier liever niet heeft. Beide lezingen zijn consistent met het bewijs, en niets in het openbare dossier onderscheidt ze momenteel. Wat wel gezegd kan worden, is dat geen enkele onafhankelijke partij enig Fugu-model heeft geëvalueerd, en dat er geen Artificial Analysis-vermelding is voor Fugu Max of een van zijn zustermodellen. Elk cijfer in het persbericht, inclusief de zes overwinningen, is afkomstig van Sakana.

De aankoop die u daadwerkelijk doet
Wanneer een leverancier met één model een benchmark publiceert, koop je een bewering over een model. Wanneer een orchestrator er een publiceert, koop je een bewering over een pool — modellen die de leverancier niet heeft getraind, draaiend onder een coördinator waarvan de routeringsbeslissingen bewust niet worden blootgelegd. De pool hier wordt beschreven als de grootste die Fugu heeft gebruikt, uitgebreid met open-weights en gespecialiseerde modellen, waaronder de NVIDIA Nemotron-familie via een samenwerking met NVIDIA. De leden worden verder niet bekendgemaakt.
De praktische consequentie is dat het gedrag van Fugu Max kan veranderen zonder dat de versie verandert. Een deprecatie door een frontier-lab, een prijswijziging of het terugtrekken van een model uit een regio verandert wat de coördinator kan aanroepen, en Sakana is expliciet dat deze veerkracht het punt is — het verkoopt bescherming tegen vendor lock-in en het intrekken van API's. Dat is een echt voordeel en het is niet gratis. Het is ook de reden waarom een Fugu Max-benchmark, als die zou worden gepubliceerd, een vervaldatum zou hebben die een Claude Opus 5-benchmark niet heeft.
De waardepropositie van Claude Opus 5 is het omgekeerde en is gemakkelijker te prijzen. Het is één model in één versie, dat standaard adaptief denken uitvoert met een expliciete inspanningsregelaar van laag tot max, met een contextvenster van 1M tokens en een uitvoerplafond van 128K, plus vision, toolgebruik en JSON-modus. Anthropic rapporteert 96,0% op SWE-bench Verified en 79,2% op SWE-bench Pro, en die cijfers zijn gemeten op wat je krijgt wanneer je het eindpunt aanroept — niet op een ensemble waarvan de samenstelling onder je vandaan kan veranderen. Voor een workload die in productie draait en wordt beoordeeld, is die stabiliteit een eigenschap waarvoor je $19,00 per miljoen outputtokens betaalt.
Kosten per voltooide taak, niet per token
Het outputtarief van $6,00 van Fugu Max is werkelijk aantrekkelijk, en de manier om het te testen is te stoppen met het vergelijken van tokenprijzen. Een orchestrator start agents; elk schrijft reasoning- en outputtokens; de coördinator schrijft een synthese. De prijs-FAQ van Sakana voor de Fugu-lijn belooft één enkel gemengd tarief op basis van het deelnemende model uit de topklasse, waarbij multi-agentruns de rekening niet laten oplopen — wat de fan-outvermenigvuldiging in het slechtste geval wegneemt die naïeve multi-agentsystemen onbetaalbaar maakt. Het neemt het volume niet weg. Het aantal outputtokens waarvoor je wordt gefactureerd, is een functie van het aantal agents dat heeft gedraaid, en bij $6,00 per miljoen is dat volume de variabele die een prijzenpagina je niet kan vertellen.
De kostenstructuur van Claude Opus 5 is één aanroep, één model, een inspanningsknop die jij beheert, en batchverwerking tegen half tarief voor werk dat kan wachten. Je kunt die vóór uitvoering voorspellen. Over tienduizend uitvoeringen heen is voorspelbaarheid veel meer waard dan een benchmarkmarge die niemand heeft gepubliceerd.
Hier scheidt de routeringsvraag zich van de modelvraag. Claude Opus 5 staat op OrcaRouter tegen Anthropic's lijstprijs met 0% markup — het tarief van de aanbieder wordt rechtstreeks doorgegeven, dus een wijziging in Anthropic's prijsstelling is dezelfde dag live op dezelfde sleutel, met automatische failover over aanbiederpaden wanneer een daarvan een limiet bereikt of niet beschikbaar is. Fugu Max staat niet in onze catalogus; het bereikt je via Sakana's eigen OpenAI-compatibele API en diverse platforms van derden, en overstappen van een eerdere Fugu is een parameterwijziging van één regel. Als je de bewijsbasis van Opus 5 wilt en een rekening die je kunt voorspellen, is de router de kortere weg. Als je een systeem wilt dat bij moeilijke problemen zijn eigen fan-out samenstelt, is Fugu Max het ding dat dat doet — en je moet het in een pilot draaien met tokenadministratie vanaf het eerste verzoek ingeschakeld.

Waar Fugu Max waarschijnlijk het juiste antwoord is
Geef het ontwerp de waardering die het verdient. Als je werk een hoog volume heeft, controleerbaar is, en je geeft om de mediane kosten van een voltooide taak in plaats van de piekcapaciteit van één enkele aanroep, dan doet een orchestrator die per verzoek het goedkoopste toereikende model kiest iets wat een vast vlaggenschipmodel niet kan. Fugu Max is rechtstreeks op die workload gericht, en het invoertarief van $2,00 met $0,25 voor gecachte invoer is geprijsd voor de lange, repetitieve contexten die zulke workloads genereren. De samenwerking met NVIDIA is ook belangrijker dan het lijkt: Nemotron-modellen zijn open-weights, wat betekent dat de goedkoopste trede van de pool niet blootstaat aan de prijsbeslissingen van een ander lab.
Wat dat je niet oplevert, is een reden om te geloven dat Fugu Max Claude Opus 5 zal evenaren op de taken waarop de gepubliceerde cijfers van Opus 5 het sterkst zijn — software-engineering op repositoryschaal en moeilijk redeneren. Dat zijn precies de rijen waarop Sakana's bord met zes benchmarks helemaal geen cijfer biedt. Als jouw probleem er een is waarbij het belangrijker is de beste te zijn dan goedkoop te zijn, dan koop je met het outputtarief van $25,00 wat je echt nodig hebt.
Kortom
Claude Opus 5 is de beter onderbouwde aankoop en de veiligere standaard voor productie: gepubliceerde leveranciersbenchmarks, een versie die je kunt vastpinnen, een contextvenster dat niet verschuift, een uitvoerplafond van 128K, een inspanningsregelaar waarmee je alleen redeneervermogen inkoopt wanneer het loont, en maanden aan resultaten van derden erachter. Fugu Max is de interessantere gok en een oprecht goedkopere — ongeveer 60 procent minder op invoer en 76 procent minder op uitvoer, met een cachetarief dat een orde van grootte onder de basisinvoerprijs van Opus 5 ligt.
Als je verifieerbaar, repetitief werk met een hoog volume uitvoert en je bevindt je buiten de EU/EER, dan verdient Fugu Max een afgebakende pilot, met een plafond voor outputtokens dat je vóór aanvang vaststelt, en een meting van tokens per voltooide taak in plaats van tokens per aanroep. Als je dit kwartaal een productiebeslissing nodig hebt die je tegenover iemand anders kunt verdedigen, blijft Claude Opus 5 het antwoord — en het is beschikbaar op OrcaRouter tegen de listprijs van Anthropic, waarbij het tarief van de provider ongewijzigd wordt doorgegeven.

