Een gegenereerde hero-kaart met de titel 'Claude Haiku 5.5 vs Sakana Namazu' met twee naast elkaar geplaatste panelen. Het linkerpaneel, Claude Haiku 5.5, vermeldt 'Algemeen doel', '$0,10 / $0,50 per 1M' en 'Index 43'. Het rechterpaneel, Sakana Namazu, vermeldt 'Japanse specialist', '$0,95 / $4,00 per 1M' en 'Alleen leveranciersbenchmarks'. Een strook over de volledige breedte eronder luidt: 'Hetzelfde snelle en goedkope profiel, tegengestelde specialisaties.' Een voettekst luidt: 'Index volgens Artificial Analysis; Namazu-cijfers volgens Sakana AI, niet-geauditeerd.' Het OrcaRouter-logo is in de rechteronderhoek gecompositeerd.
Guides & Insights

Claude Haiku 5.5 vs Sakana Namazu: beide goedkoop, beide snel, verder bijna niets gemeen

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Op het eerste gezicht lijken deze twee gelijkwaardig. Claude Haiku 5.5 is de kleine, snelle tier van de leverancier, uitgebracht op 7 oktober 2026 voor $0,10 per miljoen inputtokens en $0,50 per miljoen output met een venster van één miljoen tokens, gebouwd voor classificatie, extractie, routing en subagent-werk. Sakana Namazu is het Japans-gespecialiseerde API-model van Sakana AI, gelanceerd op 3 augustus 2026, gefactureerd tegen $0,95 per miljoen inputtokens en $4,00 per miljoen output met een tarief van $0,15 voor gecachte input, verfijnd bovenop de open Kimi K2.6-basis met Sakana's eigen post-training, en beschikbaar via een OpenAI-compatibel endpoint.

Ze zijn beide gepositioneerd als de betaalbare optie binnen hun respectieve line-ups, en daar houdt de gelijkenis op. Claude Haiku 5.5 is een algemeen inzetbaar Westers model waar je naar zou grijpen om verkeer te routeren; Sakana Namazu is een landspecifiek model waar je naar zou grijpen wanneer de taak in het Japans is en het alternatief een algemeen model is dat het slecht doet. De interessante vraag is niet welke beter is. Het is wat een specialist je oplevert, waar de grens van dat specialisme werkelijk ligt, en wat het kost om die te verlaten.

Wat Sakana AI daadwerkelijk heeft gebouwd

Sakana Namazu is het waard om te begrijpen voordat het met iets wordt vergeleken, omdat de constructie ervan ongebruikelijk is. Het is niet vanaf nul getraind. Het is een verfijning van een bestaand open-gewichtenmodel — Kimi K2.6 — dat Sakana nog verder heeft nagetraind, en dat het als een gesloten API aanbiedt. De afstamming is van belang: de algemene redeneer- en codeervaardigheid van het basismodel is geërfd, en wat Sakana heeft toegevoegd is de Japan-specifieke laag.

Die laag is gedocumenteerd, wat meer is dan gezegd kan worden over de meeste lokalisatieclaims. Sakana meldt dat Namazu de prestaties van het basismodel op algemene evaluaties — AIME26, MMLU-Pro, LiveCodeBench v6 — behoudt en die overtreft op de Japanse en Japan-specifieke set, waarbij FairPoliticsQA stijgt van 34,10% naar 56,30%. Het draait zijn eigen interne Japanse vertaalbenchmark, JFBench, en rapporteert ook daar verbeteringen op alle fronten. Een afzonderlijke casestudy, een hulpmiddel voor artsen om bewijs te vinden, rapporteert 96,8% op het 119e landelijke medische examen en 96,4% op het 120e.

Dat zijn Sakana's cijfers op Sakana's benchmarks, en JFBench is geen publieke standaard die iemand anders kan reproduceren. De bewering die dat voorbehoud overleeft, is smal maar reëel: het model is een genoemd basismodel plus een gedocumenteerde post-trainingsstap, en de gerapporteerde delta's zijn ten opzichte van zijn eigen basis in plaats van ten opzichte van het veld.

De API en de commerciële voorwaarden zijn de onderdelen die de meeste businesscases zullen bepalen. Namazu is OpenAI-compatibel — een wijziging van het endpoint en de modelnaam sakana-namazu is de enige codewijziging, volgens Sakana's eigen documentatie. Het factureert in Amerikaanse dollars en biedt betaling in yen op het Enterprise-plan. Het brengt ook toolingkosten met zich mee die een vergelijking per token nooit aan het licht zal brengen: $7,00 per duizend webzoekopdrachten en $0,12 per uur code-uitvoering, die Sakana in het product bundelt.

Er zijn twee beperkingen die zwaarder wegen dan welk cijfer dan ook op de tariefkaart. Namazu is niet beschikbaar in de EU, de EER, het VK of Zwitserland, in afwachting van GDPR-gerelateerde compliancewerkzaamheden, volgens Sakana's eigen pagina. En het standaardbeleid voor gegevensverwerking stelt dat invoer mag worden gebruikt om de modellen van Sakana te trainen en te verbeteren, met een opt-out in de Console-instellingen; het bedrijf zegt dat het momenteel niet kan garanderen dat de verwerking volledig in Japan plaatsvindt. Voor een Europees of Brits team is het eerste diskwalificerend en het tweede een vraag die vóór de eerste call moet worden beantwoord.

De grens, eerlijk gesteld

Dit is het gedeelte waar een vergelijking op basis van specificaties je zou misleiden, dus hier is wat daadwerkelijk vergelijkbaar is:

• Prijs — Claude Haiku 5.5: $0,10 voor input en $0,50 voor output per miljoen tokens tot 100.000 tokens aan prompt, daarna $0,50 en $2,50. Sakana Namazu: $0,95 en $4,00, met een tarief van $0,15 voor gecachte input. Namazu is in de eerste schijf ongeveer negeneneenhalf keer duurder voor input en acht keer duurder voor output.

• Caching — Claude Haiku 5.5 cache-reads kosten $0,01 en $0,05 per miljoen, afhankelijk van het niveau; bij Sakana Namazu is het een vast tarief van $0,15. De absolute cijfers liggen dicht bij elkaar op het hoogste niveau en een factor negenentwintig uit elkaar op het laagste.

• Tools — geen van beide is een kaal tekstmodel en geen van beide rekent op dezelfde manier af. Claude Haiku 5.5 levert adaptief denken met een inspanningsregelaar van Laag tot Max en ondersteuning voor tools aan de serverzijde; Sakana Namazu bundelt webzoekopdrachten voor $7.00 per duizend aanroepen en code-uitvoering voor $0.12 per uur.

• Context — één miljoen tokens voor Claude Haiku 5.5. Sakana publiceert geen contextvenster voor Namazu, en elk cijfer dat je daarvoor ziet geciteerd, is een aanname over de Kimi K2.6-basis in plaats van een specificatie.

• Onafhankelijke scoring — Claude Haiku 5.5 heeft een Artificial Analysis Intelligence Index van 43, tweede van 182 in zijn klasse op die ranglijst, met een kostprijs van $0,21 per Intelligence Index-taak. Sakana Namazu heeft geen vermelding bij Artificial Analysis en geen enkele vorm van evaluatie door derden die ik kon vinden. De gepubliceerde cijfers zijn afkomstig van henzelf.

Beschikbaarheid — Claude Haiku 5.5 is beschikbaar via de Claude API, Amazon Bedrock, Vertex AI, Microsoft Foundry en Claude Platform on AWS, met een gepubliceerde toezegging tot uitfasering niet eerder dan 7 oktober 2027. Sakana Namazu is beschikbaar via de eigen API van Sakana, Sakana Chat en het product Sakana Translate, en is niet beschikbaar in de EU, de EER, het VK en Zwitserland.

• Gegevensverwerking — De voorwaarden van de leverancier zijn enterprise-standaard, en de denkblokken van het model zijn beperkt tot het account dat ze heeft geproduceerd. Sakana Namazu hanteert standaard dat invoer mag worden gebruikt voor training, met de mogelijkheid om af te melden.

• Modaliteit — Claude Haiku 5.5 verwerkt tekst en afbeeldingen; de modaliteitsdekking van Sakana Namazu is niet gepubliceerd buiten de tekst-eerst-positionering ervan.

• Licentie en herkomst — Claude Haiku 5.5 is propriëtair en alleen via API beschikbaar. Sakana Namazu is propriëtair maar gebouwd op open Kimi K2.6-gewichten, wat betekent dat de basis inspecteerbaar is en het bijgestelde model niet.

Het eerlijke scoringsprobleem

Lees die lijst en merk op wat ontbreekt: elke regel die zegt welk model betere Japanse output produceert. Dat is geen omissie. Er is geen gedeelde benchmark tussen beide die dat zou beslechten. De sterke Japanse prestaties van Claude Haiku 5.5 zijn niet iets wat de leverancier als een prominente claim aanprijst, en de JFBench-cijfers van Sakana zijn zijn eigen instrument. Een algemeen klein model van frontier-niveau van een leverancier met sterke meertalige capaciteiten, geëvalueerd tegen een op Kimi gebaseerd model dat specifiek voor het Japans is nagetraind, is een vergelijking die niemand daadwerkelijk heeft uitgevoerd en gepubliceerd.

Wat gezegd kan worden, is eerder structureel dan empirisch. De hele commerciële identiteit van Namazu is de claim dat een algemeen model niet goed genoeg is voor Japans werk — dat landspecifieke taal, culturele inferentie en binnenlandse context een onderscheidende capaciteit vormen die een gespecialiseerd model rechtvaardigt tegen een negenvoudige prijspremie. Als je die claim gelooft, is Namazu het antwoord en is de prijs wat het antwoord kost. Als je dat niet doet, gebruik je een algemeen model van $0,10 per miljoen tokens, en de vraag is of je het verschil kunt meten aan de hand van je eigen verkeer.

De meetbare versie van de bewering is degene die Sakana levert: FairPoliticsQA gaat van 34,10% naar 56,30% ten opzichte van het basismodel waarop de tuning is gebaseerd. Dat is een echte verbetering op een echte benchmark, maar het is een vergelijking met Kimi K2.6, niet met Claude Haiku 5.5 — en het zegt je dat post-training voor Japans-specifieke politieke context het verschil maakt bij die taak, wat een beperktere en beter verdedigbare uitspraak is dan "beter in het Japans".

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Sakana Namazu - the scoreboard', with six rows carrying both sides. Input price: $0.10 / 1M against $0.95 / 1M. Output price: $0.50 / 1M against $4.00 / 1M. Cached input: $0.01 to $0.05 / 1M against $0.15 / 1M. Focus: general purpose against Japanese language and context. Lineage: proprietary against Kimi K2.6 post-trained. Independent index: 43 against no entry. The footer reads 'Claude Haiku 5.5 index per Artificial Analysis; Namazu figures per vendor.' The OrcaRouter logo is composited in the bottom-right corner.

Hoe het kostenverschil er bij volume uitziet

Laat een bescheiden pipeline met 10 miljoen invoertokens en 2 miljoen uitvoertokens per dag door beide lopen.

• Kosten voor invoer, per dag — $1,00 op Claude Haiku 5.5, $9,50 op Sakana Namazu.

• Uitvoerkosten, per dag — $1.00 op Claude Haiku 5.5, $8.00 op Sakana Namazu.

• Dagelijks totaal — $2,00 tegenover $17,50, ongeveer $60 per maand tegenover $525.

Dat bedrag van $525 is nog vóór één enkele webzoekopdracht of één uur code-uitvoering. Komt daar 500 zoekopdrachten per dag bij, dan kost Namazu nog eens $3,50 per dag, wat het op $21,00 tegen $2,00 brengt — een verhouding van beter dan tien tegen één die geen enkele hoeveelheid token-efficiëntie kan dichten.

Of dat veel is, hangt helemaal af van wat het alternatief is. Als je keuze Namazu is of een algemeen model dat middelmatige Japanse output produceert die je reviewers met de hand moeten corrigeren, dan koopt die $525 revieweruren terug, en de vergelijking is niet token tegen token, maar token tegen salaris. Als je Japanse verkeer routine is en al goed genoeg op een algemeen model, dan levert de meerprijs niets meetbaars op en koop je voor hetzelfde geld elders tien keer zoveel volume.

De derde optie is de interessante optie voor een Japanstalig product: gebruik de specialist waar de specialistenclaim opgaat — vertaling, binnenlandse context, regelgevende en politieke teksten — en een algemeen model voor het bulkwerk eromheen. Dat is geen compromis. Het is de architectuur die de prijsstelling eigenlijk impliceert, want de premium van Namazu wordt per token betaald en er is geen reden om die voor classificatie te betalen.

A headless capture of Anthropic's Claude Platform model documentation showing the Models overview comparison table with the Claude Haiku 5.5 column alongside Claude Fable 5.1, Claude Opus 5.5 and Claude Sonnet 5.5, including the 'From $0.10 / input MTok' and 'From $0.50 / output MTok' pricing rows, the 1M-token context window entry and the 'Fastest' comparative latency listing for Claude Haiku 5.5.

Geen van beide modellen staat in onze catalogus

We moeten hier duidelijk over zijn, want dit is het soort vergelijking waarbij een alinea over beschikbaarheid gemakkelijk binnengesmokkeld kan worden: OrcaRouter bedient noch Claude Haiku 5.5 noch Sakana Namazu. Namazu is beschikbaar via Sakana's eigen API, en Claude Haiku 5.5 via die van de leverancier en de grote clouds. Geen van beide feiten verandert de vergelijking, die rust op gepubliceerde tarieven, gepubliceerde mogelijkheden en gepubliceerde beperkingen.

De rol die één endpoint in een geval als dit speelt, is beperkter en eerlijker dan een plug. Het is het algemene-modelgedeelte van een hybride — de plek waar je het niet-Japanstalige classificatie- en extractieverkeer zou routeren dat de specialist niet nodig heeft, zonder daarvoor een tweede leveranciersrelatie op te zetten. Eén API voor 200-plus modellen, lijsttarieven van providers doorgegeven met 0% opslag, automatische failover tussen providers, en de routing-DSL wanneer de taal van het verzoek de route moet bepalen in plaats van de applicatie. Als je een Japanstalig product naast een Engelstalig product draait, is dat de naad die je anders met de hand zou bouwen.

Welke, voor wie

Kies Sakana Namazu wanneer Japans het product is in plaats van een locale — wanneer je reviewers de output corrigeren, wanneer het domein nationaal recht, geneeskunde, politiek of klantenservice is, wanneer een negenvoudige tokentoeslag kleiner is dan de kosten van de correcties die het overbodig maakt, en wanneer je gebruikers buiten de EU, de EER, het VK en Zwitserland zijn of je juridisch adviseurs hebt die de kwestie van gegevensverwerking hebben goedgekeurd.

Kies Claude Haiku 5.5 wanneer het werk algemeen is, het volume hoog is en je een onafhankelijk gemeten score wilt in plaats van een leveranciersbenchmark — wanneer $0,10 en $0,50 per miljoen tokens het rekenwerk voor je doen, wanneer je het venster van één miljoen tokens nodig hebt voor een lang document, of wanneer het antwoord op "wat is beter in het Japans" uit je eigen evaluatie moet komen in plaats van die van een van beide leveranciers.

De twee zijn niet echt rivalen. De een is een model voor algemeen gebruik, geprijsd om constant te worden gebruikt; de ander is een specialist, geprijsd om doelbewust te worden ingezet. De fout is de specialist kopen voor werk dat de generalist al goed doet, en de tegenovergestelde fout — aannemen dat een algemeen model de taal en context van een specifiek land net zo goed aankan als iets dat daarvoor is getraind — is de fout waarop Sakana's hele bedrijf is gebouwd: dat mensen die maken.

A headless capture of the OrcaRouter models catalogue page reading '207 models, 16 providers, one API key, one bill', with the filter sidebar showing input-modality counts, a pricing filter and a populated model list, and the panel that reads 'How to call any model' with an OpenAI-compatible curl sample pointing at https://api.orcarouter.ai/v1/chat/completions.