Een hero-titelkaart voor "Fugu Max vs Claude Opus 5" met de ondertitel "Vier keer goedkoper, en een getal dat niemand publiceerde", drie pill-badges met de tekst "$6.00 vs $25.00 output", "Zes overwinningen, nul scores", "$2.00 vs $5.00 input", een voettekst met "Sakana AI vs Anthropic - september 2026", en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

Fugu Max vs Claude Opus 5: vier keer goedkoper, en een getal dat niemand heeft gepubliceerd

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Fugu Max kost $6,00 om een miljoen tokens aan output te produceren. Claude Opus 5 kost $25,00. Sakana AI bracht Fugu Max op 11 september 2026 uit als een coördinator die elke taak naar het zuinigste model in zijn pool routert, en prijsde het zo agressief dat een viervoudig outputverschil ten opzichte van Anthropics vlaggenschip het opvallendste feit van de release is. Wat de release niet bevat, is één enkel getal dat beschrijft hoe goed Fugu Max daadwerkelijk presteert. Sakana zegt dat het de "beste totaalscore" haalt op zes benchmarks en de kosten-prestatiegrens verruimt op zeven van de tien — uitspraken over de plaats op een grafiek in plaats van waarden op een as. Claude Opus 5 daarentegen komt met een gepubliceerde score voor bijna alles wat het doet. De eerlijke versie van deze vergelijking is dus niet goedkoop tegenover duur. Het is gemeten tegenover beweerd, en het prijsverschil is wat maakt dat die afweging het waard is om over te discussiëren.

De kloof, en de vergelijking die Sakana verkoos niet te maken

Sakana's releasepagina rechtvaardigt het outputtarief van Fugu Max door het te vergelijken met andere modellen. De drie die het noemt, zijn Claude Sonnet 5, GPT-5.6 Terra en Kimi K3, en de bewering is dat de outputprijs van Fugu Max 40 tot 60 procent onder die van hen ligt. Let op wie ontbreekt. Claude Opus 5 staat niet in die lijst, en de reden is rekenkundig: bij $6,00 tegenover $25,00 is Fugu Max niet 40 procent goedkoper dan Opus 5, maar 76 procent goedkoper. Het noemen van Opus 5 zou de claim ongeloofwaardig in plaats van concurrerend hebben doen lijken, dus wordt de vergelijking getrokken met de laag onder het vlaggenschip.

Dat is geen kritiek op de prijsstelling, die werkelijk laag is. Het is een opmerking over wat de omliggende zin doet. Sakana's eigen framing — prestaties die "binnen schootsafstand van elite-modellen liggen, tegen twee tot zes keer lagere kosten" — is afgestemd op de modellen die het koos te noemen. Tegenover Claude Opus 5 is de factor geen twee tot zes, maar meer dan vier bij output; of Opus 5 volgens de maatstaven van die zin nog steeds een "elite model" is, blijft onvermeld, wat een merkwaardige weglating is in een release waarvan de hele propositie kosten-prestatie-efficiëntie aan de voorhoede is.

• Invoerprijs — Fugu Max $2,00 per 1 miljoen tokens vs Claude Opus 5 $5,00 per 1 miljoen tokens

• Uitvoerprijs — Fugu Max $6,00 per 1 miljoen tokens vs Claude Opus 5 $25,00 per 1 miljoen tokens

• Gecachte input — Fugu Max $0,25 per 1 miljoen tokens versus Claude Opus 5-caching, geprijsd als een korting van maximaal 90% op gecachte input

• Benchmarkscores — Fugu Max: niets gepubliceerd, zes beweerde benchmarkoverwinningen zonder cijfers, tegenover Claude Opus 5, door Anthropic gerapporteerd: 96,0% SWE-bench Verified, 79,2% SWE-bench Pro, ongeveer 30,2% op ARC-AGI 3

• Architectuur — Fugu Max, een getrainde coördinator over een niet-openbaar gemaakte pool versus Claude Opus 5, één enkel model dat per versie kan worden gepind

• Context — Fugu Max niet gepubliceerd versus Claude Opus 5 1M tokens, met een outputplafond van 128K

• Onafhankelijke evaluatie — Fugu Max: voor geen enkel Fugu-model bestaat er een, tegenover de 5 maanden aan posities op leaderboards van derden van Claude Opus

Zes overwinningen zonder bijbehorende scores

De zes benchmarks zijn Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench en SWEFish. Vijf daarvan zijn bekende publieke evaluaties. De zesde, SWEFish, is Sakana's eigen codebenchmark, wat betekent dat een van de zes overwinningen wordt gescoord op een test die de leverancier zelf heeft geschreven en niet heeft gepubliceerd.

Voor de andere vijf stelt het persbericht dat Fugu Max de beste algehele score behaalt, zonder te vermelden wat die score is, of wat een concurrent heeft gescoord. Dat is een ongebruikelijke vorm voor een modelaankondiging. Leveranciers overdrijven stelselmatig, maar ze overdrijven meestal met cijfers, omdat cijfers nu eenmaal hetgeen zijn dat rondgaat. Een persbericht dat zes overwinningen claimt en er nul van afdrukt, vraagt om louter op de kracht van de bewering te worden aangenomen.

Er is een welwillende lezing, en het is de moeite waard die ronduit te geven. Fugu Max is een op kosten geoptimaliseerde coördinator, geen capaciteitspush — Sakana bracht hem dezelfde dag uit als Fugu Ultra v2, de versie die is gericht op maximale capaciteit tegen $5,00 voor input en $30,00 voor output. De taak van Max is om acceptabele kwaliteit te bereiken tegen $6,00 voor output, en de hoofdscore van een orchestrator is minder betekenisvol dan de score per dollar, en dat is precies wat een Pareto-plot laat zien. Sakana's visuele communicatie voor deze release bestaat uit Pareto-plots. Als het argument is: 'kijk naar de curve, niet naar de piek', dan is een ruw benchmarkcijfer niet ter zake.

De minst welwillende lezing is dat een getal zou uitnodigen tot een vergelijking die de leverancier liever niet heeft. Beide lezingen zijn consistent met het bewijs, en niets in het openbare dossier onderscheidt ze momenteel. Wat wel gezegd kan worden, is dat geen enkele onafhankelijke partij enig Fugu-model heeft geëvalueerd, en dat er geen Artificial Analysis-vermelding is voor Fugu Max of een van zijn zustermodellen. Elk cijfer in het persbericht, inclusief de zes overwinningen, is afkomstig van Sakana.

A two-column scoreboard titled "Fugu Max vs Claude Opus 5 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Benchmarks six wins with no figures, Context not published, Evidence vendor-reported only. Right column Claude Opus 5: Output price $25.00 / 1M, Input price $5.00 / 1M, Cached input up to 90% discount, Benchmarks 96.0% SWE-bench Verified, Context 1M with a 128K output ceiling, Evidence independent evals. Footer reading "Fugu Max figures vendor-reported by Sakana AI; Opus 5 rows Anthropic-reported. No independent Fugu Max evaluation exists.", with the OrcaRouter logo bottom-right.

De aankoop die u daadwerkelijk doet

Wanneer een leverancier met één model een benchmark publiceert, koop je een bewering over een model. Wanneer een orchestrator er een publiceert, koop je een bewering over een pool — modellen die de leverancier niet heeft getraind, draaiend onder een coördinator waarvan de routeringsbeslissingen bewust niet worden blootgelegd. De pool hier wordt beschreven als de grootste die Fugu heeft gebruikt, uitgebreid met open-weights en gespecialiseerde modellen, waaronder de NVIDIA Nemotron-familie via een samenwerking met NVIDIA. De leden worden verder niet bekendgemaakt.

De praktische consequentie is dat het gedrag van Fugu Max kan veranderen zonder dat de versie verandert. Een deprecatie door een frontier-lab, een prijswijziging of het terugtrekken van een model uit een regio verandert wat de coördinator kan aanroepen, en Sakana is expliciet dat deze veerkracht het punt is — het verkoopt bescherming tegen vendor lock-in en het intrekken van API's. Dat is een echt voordeel en het is niet gratis. Het is ook de reden waarom een Fugu Max-benchmark, als die zou worden gepubliceerd, een vervaldatum zou hebben die een Claude Opus 5-benchmark niet heeft.

De waardepropositie van Claude Opus 5 is het omgekeerde en is gemakkelijker te prijzen. Het is één model in één versie, dat standaard adaptief denken uitvoert met een expliciete inspanningsregelaar van laag tot max, met een contextvenster van 1M tokens en een uitvoerplafond van 128K, plus vision, toolgebruik en JSON-modus. Anthropic rapporteert 96,0% op SWE-bench Verified en 79,2% op SWE-bench Pro, en die cijfers zijn gemeten op wat je krijgt wanneer je het eindpunt aanroept — niet op een ensemble waarvan de samenstelling onder je vandaan kan veranderen. Voor een workload die in productie draait en wordt beoordeeld, is die stabiliteit een eigenschap waarvoor je $19,00 per miljoen outputtokens betaalt.

Kosten per voltooide taak, niet per token

Het outputtarief van $6,00 van Fugu Max is werkelijk aantrekkelijk, en de manier om het te testen is te stoppen met het vergelijken van tokenprijzen. Een orchestrator start agents; elk schrijft reasoning- en outputtokens; de coördinator schrijft een synthese. De prijs-FAQ van Sakana voor de Fugu-lijn belooft één enkel gemengd tarief op basis van het deelnemende model uit de topklasse, waarbij multi-agentruns de rekening niet laten oplopen — wat de fan-outvermenigvuldiging in het slechtste geval wegneemt die naïeve multi-agentsystemen onbetaalbaar maakt. Het neemt het volume niet weg. Het aantal outputtokens waarvoor je wordt gefactureerd, is een functie van het aantal agents dat heeft gedraaid, en bij $6,00 per miljoen is dat volume de variabele die een prijzenpagina je niet kan vertellen.

De kostenstructuur van Claude Opus 5 is één aanroep, één model, een inspanningsknop die jij beheert, en batchverwerking tegen half tarief voor werk dat kan wachten. Je kunt die vóór uitvoering voorspellen. Over tienduizend uitvoeringen heen is voorspelbaarheid veel meer waard dan een benchmarkmarge die niemand heeft gepubliceerd.

Hier scheidt de routeringsvraag zich van de modelvraag. Claude Opus 5 staat op OrcaRouter tegen Anth​ropic's lijstprijs met 0% markup — het tarief van de aanbieder wordt rechtstreeks doorgegeven, dus een wijziging in Anth​ropic's prijsstelling is dezelfde dag live op dezelfde sleutel, met automatische failover over aanbiederpaden wanneer een daarvan een limiet bereikt of niet beschikbaar is. Fugu Max staat niet in onze catalogus; het bereikt je via Sakana's eigen OpenAI-compatibele API en diverse platforms van derden, en overstappen van een eerdere Fugu is een parameterwijziging van één regel. Als je de bewijsbasis van Opus 5 wilt en een rekening die je kunt voorspellen, is de router de kortere weg. Als je een systeem wilt dat bij moeilijke problemen zijn eigen fan-out samenstelt, is Fugu Max het ding dat dat doet — en je moet het in een pilot draaien met tokenadministratie vanaf het eerste verzoek ingeschakeld.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Waar Fugu Max waarschijnlijk het juiste antwoord is

Geef het ontwerp de waardering die het verdient. Als je werk een hoog volume heeft, controleerbaar is, en je geeft om de mediane kosten van een voltooide taak in plaats van de piekcapaciteit van één enkele aanroep, dan doet een orchestrator die per verzoek het goedkoopste toereikende model kiest iets wat een vast vlaggenschipmodel niet kan. Fugu Max is rechtstreeks op die workload gericht, en het invoertarief van $2,00 met $0,25 voor gecachte invoer is geprijsd voor de lange, repetitieve contexten die zulke workloads genereren. De samenwerking met NVIDIA is ook belangrijker dan het lijkt: Nemotron-modellen zijn open-weights, wat betekent dat de goedkoopste trede van de pool niet blootstaat aan de prijsbeslissingen van een ander lab.

Wat dat je niet oplevert, is een reden om te geloven dat Fugu Max Claude Opus 5 zal evenaren op de taken waarop de gepubliceerde cijfers van Opus 5 het sterkst zijn — software-engineering op repositoryschaal en moeilijk redeneren. Dat zijn precies de rijen waarop Sakana's bord met zes benchmarks helemaal geen cijfer biedt. Als jouw probleem er een is waarbij het belangrijker is de beste te zijn dan goedkoop te zijn, dan koop je met het outputtarief van $25,00 wat je echt nodig hebt.

Kortom

Claude Opus 5 is de beter onderbouwde aankoop en de veiligere standaard voor productie: gepubliceerde leveranciersbenchmarks, een versie die je kunt vastpinnen, een contextvenster dat niet verschuift, een uitvoerplafond van 128K, een inspanningsregelaar waarmee je alleen redeneervermogen inkoopt wanneer het loont, en maanden aan resultaten van derden erachter. Fugu Max is de interessantere gok en een oprecht goedkopere — ongeveer 60 procent minder op invoer en 76 procent minder op uitvoer, met een cachetarief dat een orde van grootte onder de basisinvoerprijs van Opus 5 ligt.

Als je verifieerbaar, repetitief werk met een hoog volume uitvoert en je bevindt je buiten de EU/EER, dan verdient Fugu Max een afgebakende pilot, met een plafond voor outputtokens dat je vóór aanvang vaststelt, en een meting van tokens per voltooide taak in plaats van tokens per aanroep. Als je dit kwartaal een productiebeslissing nodig hebt die je tegenover iemand anders kunt verdedigen, blijft Claude Opus 5 het antwoord — en het is beschikbaar op OrcaRouter tegen de listprijs van Anthropic, waarbij het tarief van de provider ongewijzigd wordt doorgegeven.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured September 11, 2026, English UI), showing the Featured badge, the anthropic/claude-opus-5 model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24, the /v1/chat/completions and /v1/messages endpoints, the pricing tiles reading INPUT $5.00 and OUTPUT $25.00 per 1M tokens with p50 TTFT 4.94s and 195.4M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.