
Fugu Max vs Claude Opus 5: fyra gånger billigare, och en siffra som ingen har publicerat
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Fugu Max kostar 6,00 dollar per miljon producerade utdatatokens. Claude Opus 5 kostar 25,00 dollar. Sakana AI lanserade Fugu Max den 11 september 2026 som en koordinator som dirigerar varje uppgift till den mest resurssnåla modellen i sin pool, och prissatte den så aggressivt att en fyrdubbel kostnadsskillnad för utdata gentemot Anthropics flaggskepp är den centrala nyheten i lanseringen. Vad lanseringen inte innehåller är en enda siffra som beskriver hur bra Fugu Max faktiskt presterar. Sakana säger att den tar "bästa övergripande poäng" på sex benchmarks och expanderar kostnads-prestanda-fronten på sju av tio – uttalanden om placering i ett diagram snarare än värden på en axel. Claude Opus 5 kommer däremot med en publicerad poäng för nästan allt den gör. Så den ärliga versionen av den här jämförelsen är inte billig mot dyr. Den är uppmätt mot påstått, och prisklyftan är det som gör den avvägningen värd att argumentera om.
Klyftan, och jämförelsen som Sakana valde att inte göra
Sakanas releasesida motiverar priset för Fugu Maxs utdata genom att jämföra det med andra modeller. De tre som nämns är Claude Sonnet 5, GPT-5.6 Terra och Kimi K3, och påståendet är att priset för Fugu Maxs utdata ligger 40 till 60 procent under deras. Lägg märke till vem som saknas. Claude Opus 5 finns inte med i listan, och anledningen är aritmetisk: med $6.00 mot $25.00 är Fugu Max inte 40 procent billigare än Opus 5, utan 76 procent billigare. Att nämna Opus 5 skulle ha fått påståendet att verka osannolikt snarare än konkurrenskraftigt, så jämförelsen görs mot nivån under flaggskeppet.
Det är inte en kritik av prissättningen, som verkligen är låg. Det är en kommentar om vad den omgivande meningen gör. Sakanas egen formulering – prestanda som "ligger inom räckhåll för elitmodeller, till två till sex gånger lägre kostnad" – är kalibrerad efter de modeller man valde att namnge. Mot Claude Opus 5 är faktorn inte två till sex, utan strax över fyra på output; huruvida Opus 5 fortfarande är en "elitmodell" enligt den meningens måttstock lämnas osagt, vilket är en märklig utelämning i ett släpp vars hela säljargument är kostnads- och prestandaeffektivitet vid fronten.
• Indatapris — Fugu Max $2.00 per 1 miljon tokens jämfört med Claude Opus 5 $5.00 per 1 miljon tokens
Pris för utdata — Fugu Max 6,00 USD per 1 miljon tokens jämfört med Claude Opus 5 25,00 USD per 1 miljon tokens
• Cachad indata — Fugu Max $0,25 per 1M tokens jämfört med Claude Opus 5-cachning prissatt som en rabatt på upp till 90 % på cachad indata
• Benchmarkresultat — Fugu Max inga publicerade, sex benchmarkvinster påstådda utan siffror mot Claude Opus 5 Anthropics rapporterade 96,0 % SWE-bench Verified, 79,2 % SWE-bench Pro, ungefär 30,2 % på ARC-AGI 3
• Arkitektur — Fugu Max, en tränad koordinator över en icke offentliggjord pool, mot Claude Opus 5, en enskild modell som kan pinnas per version
• Kontext — Fugu Max inte publicerad jämfört med Claude Opus 5 1M tokens, med ett utdatatak på 128K
• Oberoende utvärdering – Fugu Max: ingen finns för någon Fugu-modell jämfört med Claude Opus 5 månader av tredjepartsplaceringar på topplistor
Sex segrar utan tillhörande resultat
De sex benchmarkarna är Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench och SWEFish. Fem av dessa är igenkännbara offentliga utvärderingar. Den sjätte, SWEFish, är Sakanas egen kodningsbenchmark, vilket innebär att en av de sex segrarna är poängsatt på ett test som leverantören har skrivit och inte har publicerat.
För de övriga fem uppger utskicket att Fugu Max får bästa totalpoäng utan att ange vad den poängen är, eller vad någon konkurrent fick. Det är en ovanlig form för ett tillkännagivande av en modell. Leverantörer överdriver rutinmässigt, men de överdriver vanligtvis med siffror, eftersom siffror är det som sprider sig. Ett utskick som hävdar sex segrar och inte trycker en enda av dem begär att bli trodd enbart på påståendets styrka.
Det finns en välvillig tolkning, och den är värd att säga rakt ut. Fugu Max är en kostnadsoptimerad koordinator, inte en kapacitetssatsning – Sakana släppte den samma dag som Fugu Ultra v2, som är versionen inriktad på maximal kapacitet vid $5.00 input och $30.00 output. Max uppgift är att nå acceptabel kvalitet vid $6.00 output, och för en orkestrerare är rubrikpoängen mindre meningsfull än poängen per dollar, vilket är precis vad ett Pareto-diagram visar. Sakanas visuella kommunikation för den här lanseringen är Pareto-diagram. Om argumentet är ”titta på kurvan, inte toppen”, så är ett rått benchmarkvärde irrelevant.
Den ovälvilliga tolkningen är att en siffra skulle bjuda in till en jämförelse som leverantören helst vill undvika. Båda tolkningarna är förenliga med bevisningen, och ingenting i den offentliga dokumentationen skiljer dem för närvarande åt. Vad som kan sägas är att ingen oberoende part har utvärderat någon Fugu-modell, och det finns ingen Artificial Analysis-post för Fugu Max eller något av dess syskon. Varje siffra i pressmeddelandet, inklusive de sex vinsterna, har sitt ursprung hos Sakana.

Köpet du faktiskt gör
När en leverantör av en enskild modell publicerar ett benchmark köper du ett påstående om en modell. När en orkestrerare publicerar ett köper du ett påstående om en pool – modeller som leverantören inte har tränat, som körs under en koordinator vars routingbeslut medvetet inte avslöjas. Poolen här beskrivs som den största som Fugu har använt, utökad med modeller med öppna vikter och specialiserade modeller, inklusive NVIDIA Nemotron-familjen genom ett samarbete med NVIDIA. Medlemmarna är i övrigt inte offentliggjorda.
Den praktiska konsekvensen är att Fugu Maxs beteende kan förändras utan att dess version ändras. Ett frontlabs avveckling, en prisändring eller att en modell dras tillbaka från en region förändrar vad koordinatorn kan anropa, och Sakana är tydliga med att denna motståndskraft är själva poängen — man säljer skydd mot inlåsning hos leverantörer och API-återkallanden. Det är en verklig fördel och den är inte gratis. Det är också anledningen till att ett Fugu Max-benchmark, om ett sådant publicerades, skulle ha ett utgångsdatum som ett Claude Opus 5-benchmark inte har.
Claude Opus 5:s värdeerbjudande är det omvända och det är lättare att prissätta. Det är en modell i en version, som kör adaptivt tänkande som standard med en explicit ansträngningsratt från låg till max, har ett kontextfönster på 1M token och ett utdatatak på 128K, med vision, verktygsanvändning och JSON-läge. Anthropic rapporterar 96,0 % på SWE-bench Verified och 79,2 % på SWE-bench Pro, och dessa siffror mättes på det du får när du anropar slutpunkten – inte på en ensemble vars sammansättning kan förändras under fötterna på dig. För en arbetsbelastning som körs i produktion och granskas är den stabiliteten en funktion som du betalar 19,00 USD per miljon utdatatoken för att få.
Kostnad per slutförd uppgift, inte per token
Fugu Maxs utpris på 6,00 dollar är verkligen attraktivt, och sättet att testa det är att sluta jämföra tokenpriser. En orkestrerare startar agenter; var och en skriver resonemangstoken och utdatatoken; koordinatorn skriver en syntes. Sakanas pris-FAQ för Fugu-serien lovar en enda blandad taxa baserad på den deltagande modell som ligger i toppskiktet, där multiagentkörningar inte staplar räkningen — vilket tar bort den värsta tänkbara fan-out-multiplikationen som gör naiva multiagentsystem oöverkomliga. Det tar inte bort volymen. Antalet utdatatoken du debiteras för är en funktion av hur många agenter som kördes, och vid 6,00 dollar per miljon är den volymen den variabel som en prissida inte kan tala om för dig.
Kostnadsprofilen för Claude Opus 5 är ett anrop, en modell, en ratt för ansträngning som du styr, och batchbearbetning till halva priset för arbete som kan vänta. Du kan prognostisera den innan du kör den. Över tiotusen körningar är förutsägbarhet värt betydligt mer än en benchmarkmarginal som ingen har publicerat.
Det är här som routingfrågan skiljer sig från modellfrågan. Claude Opus 5 finns på OrcaRouter till Anthropics listpris utan påslag — leverantörens avgift förs vidare direkt, så en ändring i Anthropics prissättning slår igenom på samma nyckel samma dag, med automatisk redundansväxling mellan leverantörsvägar när en av dem är hastighetsbegränsad eller otillgänglig. Fugu Max finns inte i vår katalog; det når dig via Sakanas eget OpenAI-kompatibla API och flera tredjepartsplattformar, och att byta till det från en tidigare Fugu är en ändring av en enda parameter. Om du vill ha Opus 5:s evidensbas och en räkning du kan förutse är routern den kortare vägen. Om du vill ha ett system som bygger sin egen fan-out vid svåra problem är Fugu Max det som gör just det — och du bör pilotköra det med tokenredovisning påslagen redan från första begäran.

Där Fugu Max förmodligen är det rätta svaret
Ge designen det den förtjänar. Om ditt arbete är högvolymigt, granskningsbart och du bryr dig om mediankostnaden för en slutförd uppgift snarare än toppkapaciteten hos ett enskilt anrop, gör en orkestrator som väljer den billigaste tillräckliga modellen per begäran något som en fast flaggskeppsmodell inte kan göra. Fugu Max riktar sig rakt mot den arbetsbelastningen, och indatapriset på $2.00 med $0.25 för cachad indata är prissatt för de långa, repetitiva kontexter som dessa arbetsbelastningar genererar. NVIDIA-samarbetet betyder också mer än vad det verkar: Nemotron-modellerna har öppna vikter, vilket innebär att den billigaste nivån i poolen inte är exponerad för ett annat labs prissättningsbeslut.
Det som detta inte ger dig är en anledning att tro att Fugu Max kommer att matcha Claude Opus 5 på de uppgifter där Opus 5:s publicerade siffror är starkast – programvaruutveckling i repositorieskala och svårt resonemang. Det är just de raderna där Sakanas sexbenchmarktavla inte anger någon siffra alls. Om ditt problem är ett där det är viktigare att vara bäst än att vara billig, köper utdatapriset på $25.00 det du faktiskt behöver.
Slutsats
Claude Opus 5 är det bättre underbyggda köpet och den säkrare standarden för produktion: publicerade leverantörsbenchmarkar, en version du kan låsa, ett kontextfönster som inte ändras, ett tak för utdata på 128K, en ratt för ansträngning som låter dig köpa resonemang bara när det lönar sig, och månader av tredjepartsresultat bakom sig. Fugu Max är det mer intressanta vadet och ett genuint billigare sådant – ungefär 60 procent lägre på indata och 76 procent lägre på utdata, med ett cachepris en tiopotens under Opus 5:s baspris för indata.
Om du kör verifierbart, repetitivt arbete med hög volym och befinner dig utanför EU/EES, förtjänar Fugu Max en avgränsad pilot med ett tak för utdatatokens som fastställs innan du börjar och en mätning av tokens per slutförd uppgift i stället för tokens per anrop. Om du behöver ett produktionsbeslut som du kan försvara inför någon annan det här kvartalet är Claude Opus 5 fortfarande svaret – och den finns på OrcaRouter till Anthropics listpris, där leverantörens avgift förs vidare oförändrad.

