Hero-kaart voor de confrontatie tussen Fugu Ultra v2 en MiniMax M3, met het grote prijsverschil tussen een orchestratielaag en een goedkoop open-weight multimodaal model.
Guides & Insights

Fugu Ultra v2 vs MiniMax M3: vijfentwintig keer de outputprijs

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Zet de twee outputtarieven naast elkaar en het getal ziet eruit als een typefout. MiniMax M3 factureert $1,20 per miljoen outputtokens. Fugu Ultra v2, aangekondigd door Sakana AI op 11 september 2026, wordt gerapporteerd op $30,00. Dat is 25× — en bij input is de kloof 16,7×, $0,30 tegen een gerapporteerde $5,00. MiniMax M3 is ook sneller, accepteert video native en wordt geleverd als downloadbare open weights. Geconfronteerd met die tabel is de redelijke eerste reactie dat de orchestratielaag onmogelijk haar prijs kan rechtvaardigen. De interessantere vraag is wat er waar zou moeten zijn wil het dat kunnen.

De kloof, eenvoudig gesteld

Invoer — MiniMax M3 $0,30 per 1 mln versus Fugu Ultra v2 een gerapporteerde $5,00 per 1 mln. Het M3-tarief wordt door MiniMax opgegeven als een permanente korting van 50%, niet als een promotie met een einddatum.

Uitvoer — MiniMax M3 $1,20 per 1M tegenover Fugu Ultra v2, naar verluidt $30,00 per 1M.

Gecachte invoer — MiniMax M3 $0,06 per 1M tegenover Fugu Ultra v2 een gerapporteerde $0,50 per 1M. De cache-read van M3 is een vijfde van zijn eigen invoerprijs, wat herhaalde agent-loops over een stabiele prompt ongewoon goedkoop maakt.

Boven 512K invoer — MiniMax M3 verdubbelt naar $0,60 / $2,40 / $0,12. De gerapporteerde tariefklasse van Fugu Ultra v2 boven ongeveer 272K gaat naar ongeveer $10,00 / $45,00 / $1,00. Beide passen de prijs voor het hele verzoek opnieuw aan; M3 begint later en komt uit op een fractie van dat tarief.

Context — MiniMax M3 1.048.576 tokens met een door de leverancier gegarandeerd minimum van 512K. De context van Fugu Ultra v2 wordt door externe vermeldingen op 1M geschat; op de aankondigingspagina van Sakana wordt geen cijfer genoemd.

Eén kanttekening bij de Fugu-kolom, en het is geen kleine: Sakana publiceert de tokentarieven van Fugu Ultra v2 niet op zijn eigen aankondigingspagina. De cijfers $5,00 / $0,50 / $30,00 komen uit modellenlijsten van derden en moeten als onbevestigd worden beschouwd totdat u de actuele tariefkaart controleert. De M3-kolom daarentegen is gedocumenteerd door de leverancier. Dat verschil in herkomst is zelf deel van de vergelijking.

Two-column comparison scoreboard for Fugu Ultra v2 and MiniMax M3 covering type, release date, input price ($5.00 vs $0.30 per million tokens), output price ($30.00 vs $1.20), cached input ($0.50 vs $0.06) and input modes (text vs text, image and video).

Wat M3 native doet, wat een orchestrator moet routeren

MiniMax M3 accepteert tekst-, beeld- en video-invoer en retourneert tekst. Video is het opvallende onderdeel. Het model is vanaf stap nul getraind op gemengde modaliteiten en is gebouwd op MiniMax Sparse Attention, een architectuur waarvan de leverancier claimt dat deze tot 9× snellere prefill en 15× snellere decode bij 1M-context levert in vergelijking met zijn voorganger, bij ongeveer een twintigste van de rekenkracht per token.

Dat is in deze vergelijking van belang, omdat het een capaciteit is die Fugu Ultra v2 niet voor zichzelf claimt. Het antwoord van een orchestrator op "verwerk deze video" is om de video te routeren naar een model dat hem kan zien, wat een subaanroep betekent, wat betekent dat er meer tokens tegen het tarief van de orchestrator worden gefactureerd. Het antwoord van M3 is om hem gewoon te lezen. Bij een inputprijs van $0,30 is een uur videoanalyse een afrondingsfout; bij een inputprijs van $5,00 plus wat de routering ook kost, is het een begrotingspost.

De architectuurvergelijking pakt ook op een andere manier scheef uit. MiniMax M3 heeft ruwweg 428B totale parameters, met ongeveer 23B actief per token — een Mixture-of-Experts-ontwerp waarbij de sparse routering de serveerkosten laag houdt. Fugu Ultra v2 heeft geen gepubliceerd aantal parameters, omdat de capaciteit ervan zit in een schedulingbeleid over de modellen van andere bedrijven, en niet in gewichten die Sakana heeft getraind. Een van deze is een model. De andere is een beslissingsprocedure.

De ongemakkelijke implicatie

Dit is iets om over na te denken voordat je 25× voor output betaalt.

MiniMax M3 is open-weight, goedkoop, snel, multimodaal en heeft een lange context. Op papier is het een uitstekende sub-agent. Als je een orchestratielaag vanaf nul zou bouwen — het ding dat Fugu Ultra v2 is — dan komt een model als M3 dicht bij de ideale component: goedkoop genoeg om speculatief aan te roepen, capabel genoeg om het merendeel van de opgesplitste subtaken af te handelen, en in staat om afbeeldingen en video te zien zonder een tweede hop.

Sakana publiceert de modellenpool van Fugu Ultra v2 niet, dus we kunnen niet zeggen of M3 er deel van uitmaakt. Wat we wel kunnen zeggen, is dat de economische logica alleen op één van twee manieren klopt. Ofwel Fugu Ultra v2 roept geen modellen zoals M3 aan, in welk geval het de goedkoopste capabele capaciteit onbenut laat. Ofwel het roept ze wel aan, in welk geval een aanzienlijk deel van de tokens die je tegen $5.00 en $30.00 worden gefactureerd, M3-tokens zijn die upstream $0.30 en $1.20 kosten, en de premie bestaat uit het orchestratiebeleid plus een marge.

Geen van beide interpretaties is fataal voor het product — een goede scheduler kan een grote veelvoud waard zijn, en ervoor betalen voorkomt dat je hem zelf moet bouwen en onderhouden. Maar het betekent wel dat de vraag die je over Fugu Ultra v2 moet stellen niet is: "is het beter dan M3?" Het is: "is de scheduling meer waard dan de tokens?" En dat is een vraag die alleen je eigen taakmetingen kunnen beantwoorden.

Er is geen gedeelde benchmark

Anders dan bij sommige andere vergelijkingen in deze reeks, is er geen enkele benchmark waarop beide leveranciers een cijfer publiceren.

De door MiniMax gepubliceerde set voor M3 is breed en qua opzet grotendeels reproduceerbaar: SWE-bench Verified op 80,5%, SWE-bench Pro op 59,0%, Terminal-Bench 2.0/2.1 op 66, BrowseComp op 83,5%, OSWorld-Verified op 70,1% en PostTrainBench op 37,1 — derde plaats, achter Claude Opus 4.7 met 42,4 en GPT-5.5 met 39,3. Allemaal door de leverancier gerapporteerd. Onafhankelijk daarvan geeft Artificial Analysis MiniMax M3 een score van 30 op zijn v4.3 Intelligence Index, op plaats 16 van de 113, met een doorvoer van 95,7 tokens per seconde en een time-to-first-token van 1,95 seconden — snel, en een van de modellen in zijn klasse die beter worden bediend. Als je M3 met 44 of 45 hebt zien vermelden, dateert dat van vóór de herziening van de index.

Sakana's acht benchmarks voor Fugu Ultra v2 — waaronder GDP.pdf, Chartography, SWEFish, DeepSWE en Toolathon, met beste of gedeelde beste scores op vijf en top twee op zeven — overlappen helemaal niet met die lijst. Twee ervan, SWEFish en Toolathon, zijn interne tests van Sakana. De hoofdbeweringen — Chartography op 48,3 tegen de 27,3 van Opus 5 en de 29,5 van Fable 5, en DeepSWE op 74,3 — zijn door de leverancier gerapporteerd en vandaag gepubliceerd. Niets over Fugu Ultra v2 is onafhankelijk geverifieerd.

Dus de vergelijking die elke aggregator in de komende twee weken zal produceren — een tabel met gedeelde scores — is niet beschikbaar. Het enige eerlijke dat over capaciteit te zeggen valt, is dat MiniMax M3 een gemeten, onafhankelijke positie heeft en Fugu Ultra v2 een claim.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

Snelheid versus configuratie

De cijfers van MiniMax M3 zijn bekend: 95,7 tokens per seconde, 1,95 seconde tot het eerste token. Dat is ongeveer tweeënhalf keer de doorvoer van Kimi K3 en behoort tot de snelste aan de frontier grenzende modellen die zijn gemeten, wat past bij een ontwerp dat expliciet is geoptimaliseerd voor goedkope long-contextdienstverlening.

Fugu Ultra v2 publiceert geen latentie- of doorvoercijfer. Net als bij de prijsstelling is een deel daarvan structureel — de responstijd van een orchestrator hangt af van welke modellen hij kiest en hoeveel passes er nodig zijn, dus één enkel getal zou misleidend zijn. Maar het betekent wel dat de wall-clockkosten van het adopteren ervan ongemeten zijn en van buitenaf niet te meten. Voor de vorige Fugu Ultra meldden testers publiekelijk runs die richting de 30 minuten strekten; dat is het model van juni 2026, niet v2, en het is geen bewijs over de nieuwe — maar als je 25× uitgeeft aan output, is weten hoe lang je wacht geen overbodige luxe.

De licentie, en wat de Arabische tekst zegt

De gewichten van MiniMax M3 zijn downloadbaar onder de Min​iMax Community License, een vorm van open weights met commerciële voorwaarden — met name een omzetdrempel waarboven schriftelijke toestemming vereist is. Het is niet MIT, en elke pagina die beweert van wel, heeft de licentietag niet gelezen. Fugu Ultra v2 geeft je niets om te licentiëren, want er is niets om te downloaden.

De interessantere recente ontwikkeling voor M3 is wat andere mensen met die gewichten doen. Op 3 september 2026 bracht HUMAIN — het door het Saudische PIF gesteunde AI-bedrijf — een Arabisch vlaggenschipmodel uit dat is gebouwd door MiniMax M3 na te trainen op meer dan een biljoen Arabische tokens, met in totaal 428 miljard en 23 miljard actieve parameters, en rapporteerde een gelijk gewogen 89,37% over zeven Arabische benchmarks, waarmee het GPT-5.6 Sol met 87,30 en Claude Opus 5 met 87,34 voorblijft. Het is een onderzoekspreview, en dat zijn HUMAIN's eigen cijfers.

Het contrast met Fugu Ultra v2 kan niet scherper zijn als uitspraak over wat elk product is. MiniMax M3 is een basis waarop andere bedrijven soevereine modellen bouwen. Fugu Ultra v2 is een poort waar je via een aanroep doorheen gaat, waarvan je de samenstelling niet kunt zien en waarvan je de gewichten niet kunt vasthouden. Beide zijn legitieme posities. Het zijn totaal niet hetzelfde soort ding.

Screenshot of the OrcaRouter model page for MiniMax M3 showing the minimax/minimax-m3 identifier, a 1M token context window, 512K maximum output, and pricing of $0.30 per million input tokens and $1.20 per million output tokens.

Een van beide bellen

MiniMax M3 staat op OrcaRouter tegen MiniMax' eigen tarief — $0,30 per miljoen input, $0,06 bij een cache-hit, $1,20 per miljoen output — doorgegeven zonder enige markup, dus als MiniMax de kortingsstructuur wijzigt, landt die hier dezelfde dag in plaats van na een migratiecyclus. Het is OpenAI-compatibel op dezelfde base-URL als de rest van de catalogus, wat betekent dat je er op basis van regels naartoe kunt routeren, het achter een failover-keten kunt plaatsen of het in een model-fusiepanel kunt opnemen zonder een tweede contract of een codewijziging. Voor een model waarvan het hele argument de prijs is, is die doorgeving het deel dat ertoe doet: de goedkoopste route blijft de goedkoopste.

Fugu Ultra v2 wordt niet door ons gerouteerd. Het is beschikbaar via Sakana AI's eigen OpenAI-compatibele API, en het bedrijf zegt dat een bestaande Fugu-integratie met een parameterwijziging van één regel daarop overstapt. Beide gebruiken hetzelfde aanvraagformaat, dus ze voor evaluatie achter één enkele flag zetten is een kwestie van de base-URL omwisselen.

Het vonnis

Voor de overgrote meerderheid van de workloads, MiniMax M3 wint deze vergelijking louter op basis van de rekensom. Het is 16,7× goedkoper op input en 25× goedkoper op output, sneller volgens elke gemeten maatstaf, native multimodaal inclusief video, open-weight onder een licentie waarvan de meeste bedrijven het plafond nooit zullen bereiken, en onafhankelijk gescoord op 30 op de huidige Artificial Analysis-index. De zwakke punten zijn reëel maar smal: het is breedsprakig, de score in de agentische categorie is middelmatig ten opzichte van de coderingsscores, en de benchmarkset van de leverancier is sterk op software-engineering en minder sterk op langdurige autonomie.

Kies Fugu Ultra v2alleen als je gelooft in wat Sakana feitelijk verkoopt — een tier met piekcapaciteiten die moeilijke, meerstaps taken opdeelt over een pool die geen enkele frontier-leverancier controleert, en daarmee frontier-niveau output bereikt zonder afhankelijk te zijn van frontier-modellen — en je hebt metingen op taakniveau die aantonen dat decompositie op jouw werk beter presteert dan één enkel goedkoop model. Dat is een wezenlijk ander voorstel dan wat Min​iMax ook maar biedt, en het is de reden dat de 25× bestaat.

Maar doe de meting vóór de aankoop, niet erna. Als een model van $0,30 je taak in twee pogingen afrondt en Fugu Ultra v2 doet het in één poging, dan is Fugu nog steeds duurder. De enige workload waarbij 25× een koopje is, is er een waarbij het goedkope model het helemaal niet kan afronden — en dat is een veel kleinere set taken dan de lanceertekst doet vermoeden.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt