Eine generierte Hero-Karte mit dem Titel „Claude Haiku 5.5 vs. Sakana Namazu“ mit zwei nebeneinanderliegenden Panels. Das linke Panel, Claude Haiku 5.5, listet „Allgemeiner Zweck“, „0,10 $ / 0,50 $ pro 1 Mio.“ und „Index 43“ auf. Das rechte Panel, Sakana Namazu, listet „Japanisch-Spezialist“, „0,95 $ / 4,00 $ pro 1 Mio.“ und „Nur Anbieter-Benchmarks“ auf. Ein Streifen über die volle Breite darunter lautet: „Gleiche schnell-und-günstig-Form, entgegengesetzte Spezialgebiete.“ Eine Fußzeile lautet: „Index laut Artificial Analysis; Namazu-Werte laut Sakana AI, ungeprüft.“ Das OrcaRouter-Logo ist in die untere rechte Ecke eingefügt.
Guides & Insights

Claude Haiku 5.5 vs. Sakana Namazu: Beide günstig, beide schnell, ansonsten kaum etwas gemeinsam

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Oberflächlich betrachtet wirken diese beiden wie ebenbürtige Modelle. Claude Haiku 5.5 ist die kleine, schnelle Tarifstufe des Anbieters, veröffentlicht am 7. Oktober 2026 zu 0,10 $ pro Million Input-Tokens und 0,50 $ pro Million Output mit einem Fenster von einer Million Tokens, konzipiert für Klassifizierung, Extraktion, Routing und Subagenten-Arbeit. Sakana Namazu ist das japanisch-spezialisierte API-Modell von Sakana AI, gestartet am 3. August 2026, abgerechnet mit 0,95 $ pro Million Input-Tokens und 4,00 $ pro Million Output bei einem Cache-Input-Preis von 0,15 $, verfeinert auf Basis des offenen Kimi K2.6 mit Sakanas eigenem Post-Training und verfügbar über einen OpenAI-kompatiblen Endpunkt.

Beide sind in ihren jeweiligen Produktlinien als die günstige Option positioniert, und genau dort hört die Ähnlichkeit auch schon auf. Claude Haiku 5.5 ist ein westliches Allzweckmodell, zu dem man greifen würde, um Traffic weiterzuleiten; Sakana Namazu ist ein auf ein Land spezialisiertes Modell, zu dem man greifen würde, wenn die Aufgabe auf Japanisch ist und die Alternative ein Allzweckmodell ist, das sie schlecht erledigt. Die interessante Frage ist nicht, welches besser ist. Sondern was einem ein Spezialist bringt, wo die Grenze dieser Spezialisierung tatsächlich verläuft und was es kostet, sie zu verlassen.

Was Sakana AI tatsächlich gebaut hat

Sakana Namazu ist es wert, verstanden zu werden, bevor es mit irgendetwas verglichen wird, denn seine Konstruktion ist ungewöhnlich. Es wird nicht von Grund auf trainiert. Es ist eine Weiterentwicklung eines bestehenden Open-Weights-Modells – Kimi K2.6 –, das Sakana weiter nachtrainiert hat und das es als geschlossene API bereitstellt. Die Abstammungslinie ist wichtig: Die allgemeinen Schlussfolgerungs- und Programmierfähigkeiten des Basismodells werden übernommen, und was Sakana hinzugefügt hat, ist die japanspezifische Ebene.

Diese Ebene ist dokumentiert, was man von den meisten Lokalisierungsbehauptungen nicht behaupten kann. Sakana berichtet, dass Namazu die Leistung des Basismodells bei allgemeinen Evaluierungen – AIME26, MMLU-Pro, LiveCodeBench v6 – beibehält und sie im japanischen und Japan-spezifischen Set übertrifft, wobei FairPoliticsQA von 34,10 % auf 56,30 % steigt. Es betreibt seinen eigenen hauseigenen japanischen Übersetzungs-Benchmark, JFBench, und meldet auch dort durchgängig Verbesserungen. Eine separate Fallstudie, ein Werkzeug zur Evidenzsuche für Ärzte, berichtet 96,8 % bei der 119. nationalen medizinischen Prüfung und 96,4 % bei der 120.

Das sind Sakanas Zahlen auf Sakanas Benchmarks, und JFBench ist kein öffentlicher Standard, den irgendein anderer reproduzieren kann. Die Behauptung, die unter diesem Vorbehalt Bestand hat, ist eng, aber real: Das Modell ist ein benanntes Basismodell plus ein dokumentierter Post-Training-Schritt, und die berichteten Deltas beziehen sich auf sein eigenes Basismodell statt auf das Feld.

Die API und die kommerziellen Bedingungen sind die Teile, die über die meisten Geschäftsfälle entscheiden werden. Namazu ist OpenAI-kompatibel – eine Änderung des Endpunkts und ein sakana-namazu-Modellname sind die einzige Codeänderung, laut Sakanas eigener Dokumentation. Es wird in US-Dollar abgerechnet und bietet im Enterprise-Plan die Zahlung in Yen an. Außerdem fallen Tooling-Kosten an, die ein Vergleich pro Token nie zutage fördern wird: 7,00 US-Dollar pro 1.000 Websuche-Aufrufe und 0,12 US-Dollar pro Stunde Codeausführung, die Sakana in das Produkt bündelt.

Es gibt zwei Einschränkungen, die wichtiger sind als jede Zahl auf der Preisliste. Namazu ist laut Sakana eigener Seite bis zum Abschluss DSGVO-bezogener Compliance-Arbeiten nicht in der EU, im EWR, im Vereinigten Königreich oder in der Schweiz verfügbar. Und die Standardrichtlinie für den Umgang mit Daten besagt, dass Eingaben zum Trainieren und Verbessern von Sakana-Modellen verwendet werden dürfen, wobei ein Opt-out in den Console-Einstellungen verfügbar ist; das Unternehmen sagt, es könne derzeit nicht garantieren, dass die Verarbeitung vollständig in Japan erfolgt. Für ein europäisches oder britisches Team ist Ersteres ein Ausschlusskriterium, und Letzteres ist eine Frage, die vor dem ersten Gespräch zu klären ist.

Die Grenze, ehrlich gesagt

Dies ist der Abschnitt, in dem ein Datenblattvergleich Sie belügen würde, deshalb kommt hier, was tatsächlich vergleichbar ist:

• Preis — Claude Haiku 5.5 $0,10 Eingabe und $0,50 Ausgabe pro Million Token bis zu 100.000 Token Prompt, dann $0,50 und $2,50. Sakana Namazu $0,95 und $4,00, mit einem Tarif von $0,15 für Cache-Eingabe. Namazu ist ungefähr neuneinhalb Mal teurer bei der Eingabe und acht Mal bei der Ausgabe in der ersten Stufe.

• Caching — Cache-Reads von Claude Haiku 5.5 kosten je nach Stufe $0.01 bzw. $0.05 pro Million; bei Sakana Namazu sind es pauschal $0.15. Die absoluten Zahlen liegen in der obersten Stufe nahe beieinander und in der untersten um den Faktor neunundzwanzig auseinander.

• Tools — keines von beiden ist ein reines Textmodell, und keines von beiden wird auf dieselbe Weise abgerechnet. Claude Haiku 5.5 bietet adaptives Denken mit einem Aufwandsregler von Low bis Max und serverseitiger Tool-Unterstützung; Sakana Namazu bündelt Websuche für 7,00 $ pro tausend Aufrufe und Codeausführung für 0,12 $ pro Stunde.

• Kontext — eine Million Token für Claude Haiku 5.5. Sakana veröffentlicht kein Kontextfenster für Namazu, und jede Zahl, die man dafür zitiert sieht, ist eine Annahme über die Kimi K2.6-Basis und keine Spezifikation.

• Unabhängige Bewertung — Claude Haiku 5.5 hat einen Artificial Analysis Intelligence Index von 43, an zweiter Stelle von 182 in seiner Klasse auf diesem Board, bei Kosten von 0,21 $ pro Aufgabe des Intelligence Index. Sakana Namazu hat keinen Eintrag bei Artificial Analysis und keine wie auch immer geartete Bewertung durch Dritte, die ich finden konnte. Die veröffentlichten Zahlen stammen von ihm selbst.

• Verfügbarkeit — Claude Haiku 5.5 ist auf der Claude API, Amazon Bedrock, Vertex AI, Microsoft Foundry und Claude Platform on AWS verfügbar, mit einer veröffentlichten Stilllegungszusage nicht vor dem 7. Oktober 2027. Sakana Namazu ist auf Sakanas eigener API, Sakana Chat und dem Sakana Translate-Produkt verfügbar und ist in der EU, im EWR, im UK und in der Schweiz nicht verfügbar.

• Umgang mit Daten — Die Bedingungen des Anbieters entsprechen Unternehmensstandards, und die Denkblöcke des Modells sind auf das Konto beschränkt, das sie erzeugt hat. Bei Sakana Namazu gilt standardmäßig, dass Eingaben für das Training verwendet werden dürfen, mit Opt-out.

• Modalität — Claude Haiku 5.5 verarbeitet Text und Bilder; die Modalitätsabdeckung von Sakana Namazu ist über ihre Text-First-Positionierung hinaus nicht veröffentlicht.

• Lizenz und Abstammung — Claude Haiku 5.5 ist proprietär und nur per API verfügbar. Sakana Namazu ist proprietär, basiert aber auf offenen Kimi K2.6-Gewichten, was bedeutet, dass die Basis einsehbar ist, das feinabgestimmte Modell jedoch nicht.

Das ehrliche Scoring-Problem

Lies diese Liste und achte darauf, was fehlt: jede Zeile, die angibt, welches Modell bessere japanische Ausgaben erzeugt. Das ist kein Versehen. Es gibt keinen gemeinsamen Benchmark zwischen ihnen, der dies entscheiden würde. Die starke japanische Leistung von Claude Haiku 5.5 ist nichts, was der Anbieter als zentrale Werbeaussage vermarktet, und Sakanas JFBench-Zahlen sind ein eigenes Instrument. Ein allgemeines kleines Modell der Frontier-Klasse von einem Anbieter mit starker Mehrsprachigkeitskompetenz, evaluiert gegen ein Kimi-basiertes Modell, das speziell für Japanisch nachtrainiert wurde, ist ein Vergleich, den bisher niemand tatsächlich durchgeführt und veröffentlicht hat.

Was sich sagen lässt, ist struktureller Natur und nicht empirisch. Namazus gesamte kommerzielle Identität ist die Behauptung, dass ein allgemeines Modell für japanische Arbeit nicht gut genug ist – dass landesspezifische Sprache, kulturelle Inferenz und inländischer Kontext eine eigenständige Fähigkeit sind, die ein spezialisiertes Modell zu einem neunfachen Preisaufschlag rechtfertigt. Wenn Sie diese Behauptung glauben, ist Namazu die Antwort, und der Preis ist das, was die Antwort kostet. Wenn nicht, verwenden Sie ein allgemeines Modell zu $0.10 pro Million Token, und die Frage ist, ob Sie den Unterschied in Ihrem eigenen Traffic messen können.

Die messbare Version der Behauptung ist die, die Sakana liefert: FairPoliticsQA steigt gegenüber dem Basismodell, von dem es getunt wurde, von 34,10 % auf 56,30 %. Das ist eine echte Verbesserung bei einem echten Benchmark, aber es ist ein Vergleich mit Kimi K2.6, nicht mit Claude Haiku 5.5 — und es sagt einem, dass Post-Training für den japanspezifischen politischen Kontext bei dieser Aufgabe einen messbaren Unterschied bewirkt, was eine engere und besser verteidigbare Aussage ist als „besser im Japanischen“.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Sakana Namazu - the scoreboard', with six rows carrying both sides. Input price: $0.10 / 1M against $0.95 / 1M. Output price: $0.50 / 1M against $4.00 / 1M. Cached input: $0.01 to $0.05 / 1M against $0.15 / 1M. Focus: general purpose against Japanese language and context. Lineage: proprietary against Kimi K2.6 post-trained. Independent index: 43 against no entry. The footer reads 'Claude Haiku 5.5 index per Artificial Analysis; Namazu figures per vendor.' The OrcaRouter logo is composited in the bottom-right corner.

Wie die Kostenlücke bei hohem Volumen aussieht

Lass eine bescheidene Pipeline mit 10 Millionen Eingabe- und 2 Millionen Ausgabe-Tokens pro Tag durch beide laufen.

• Eingabekosten, pro Tag — $1,00 bei Claude Haiku 5.5, $9,50 bei Sakana Namazu.

• Ausgabekosten, pro Tag — 1,00 $ bei Claude Haiku 5.5, 8,00 $ bei Sakana Namazu.

• Tagesgesamtbetrag — 2,00 $ gegenüber 17,50 $, monatlich etwa 60 $ gegenüber 525 $.

Diese 525 $ fallen an, noch bevor auch nur ein einziger Web-Suchaufruf oder eine Stunde Codeausführung stattgefunden hat. Fügt man 500 Suchaufrufe pro Tag hinzu, kostet Namazu täglich weitere 3,50 $, was es auf 21,00 $ gegenüber 2,00 $ bringt – ein Verhältnis von mehr als zehn zu eins, das durch keine noch so große Token-Effizienz geschlossen wird.

Ob das viel ist, hängt ganz davon ab, was die Alternative ist. Wenn Ihre Wahl Namazu oder ein allgemeines Modell ist, das mittelmäßige japanische Ergebnisse produziert, die Ihre Reviewer von Hand korrigieren müssen, dann kauft der Betrag von $525 Reviewer-Stunden zurück, und der Vergleich ist nicht Token gegen Token, sondern Token gegen Gehalt. Wenn Ihr japanischer Traffic Routine ist und auf einem allgemeinen Modell bereits gut genug, dann bringt der Aufpreis nichts Messbares, und dieselben Dollars kaufen anderswo das Zehnfache an Volumen.

Die dritte Option ist die interessante für ein japanischsprachiges Produkt: Setze den Spezialisten dort ein, wo die Spezialisten-Behauptung zutrifft – Übersetzung, inländischer Kontext, regulatorische und politische Texte –, und ein allgemeines Modell für die Massenarbeit drumherum. Das ist kein Kompromiss. Es ist die Architektur, die die Preisgestaltung tatsächlich impliziert, denn Namazus Premium wird pro Token bezahlt, und es gibt keinen Grund, es für die Klassifizierung zu bezahlen.

A headless capture of Anthropic's Claude Platform model documentation showing the Models overview comparison table with the Claude Haiku 5.5 column alongside Claude Fable 5.1, Claude Opus 5.5 and Claude Sonnet 5.5, including the 'From $0.10 / input MTok' and 'From $0.50 / output MTok' pricing rows, the 1M-token context window entry and the 'Fastest' comparative latency listing for Claude Haiku 5.5.

Keines der beiden Modelle ist in unserem Katalog.

Wir sollten das klar sagen, denn es ist die Art von Vergleich, bei der sich leicht ein Absatz zur Verfügbarkeit einschmuggeln lässt: OrcaRouter bedient weder Claude Haiku 5.5 noch Sakana Namazu. Namazu ist über Sakanas eigene API verfügbar und Claude Haiku 5.5 über die des Anbieters sowie über die großen Cloud-Plattformen. Keine der beiden Tatsachen ändert den Vergleich, der auf veröffentlichten Preisen, veröffentlichten Fähigkeiten und veröffentlichten Einschränkungen beruht.

Die Rolle, die ein einzelner Endpunkt in einem solchen Fall spielt, ist enger und ehrlicher als die eines Plug-ins. Er ist das General-Model-Bein eines Hybrids – die Stelle, an die du den nicht-japanischen Klassifizierungs- und Extraktionsverkehr routen würdest, der den Spezialisten nicht braucht, ohne dafür eine zweite Anbieterbeziehung aufzubauen.Eine API für über 200 Modelle, Listenpreise der Anbieter ohne Aufschlag weitergegeben, automatisches Failover über Anbieter hinweg, und die Routing-DSL, wenn die Sprache der Anfrage über die Route entscheiden soll statt die Anwendung. Wenn du ein japanisches Produkt neben einem englischen betreibst, ist das genau die Nahtstelle, die du sonst von Hand bauen würdest.

Welches, für wen?

Wählen Sie Sakana Namazu, wenn Japanisch das Produkt und nicht bloß ein Locale ist – wenn Ihre Prüfer die Ausgabe korrigieren, wenn es um innerstaatliches Recht, Medizin, Politik oder Kundenservice geht, wenn ein neunfacher Token-Aufpreis geringer ist als die Kosten der Korrekturen, die er überflüssig macht, und wenn sich Ihre Nutzer außerhalb der EU, des EWR, des Vereinigten Königreichs und der Schweiz befinden oder Sie Rechtsberater haben, die die Frage der Datenverarbeitung geklärt haben.

Wählen Sie Claude Haiku 5.5, wenn die Arbeit allgemein ist, das Volumen hoch ist und Sie eine unabhängig gemessene Bewertung statt eines Anbieter-Benchmarks wünschen – wenn 0,10 $ und 0,50 $ pro Million Token für Sie die Rechnung übernehmen, wenn Sie das Fenster von einer Million Token bei einem langen Dokument benötigen oder wenn die Antwort auf die Frage „Welcher ist besser im Japanischen?“ aus Ihrer eigenen Bewertung kommen muss statt aus der Bewertung eines der beiden Anbieter.

Die beiden sind keine echten Rivalen. Das eine ist ein Allzweckmodell, dessen Preis darauf ausgelegt ist, ständig genutzt zu werden; das andere ist ein Spezialist, dessen Preis darauf ausgelegt ist, gezielt eingesetzt zu werden. Der Fehler ist, den Spezialisten für Arbeit zu kaufen, die der Generalist bereits gut erledigt – und der entgegengesetzte Fehler, anzunehmen, ein allgemeines Modell beherrsche die Sprache und den Kontext eines bestimmten Landes genauso gut wie etwas, das dafür trainiert wurde, ist derjenige, auf dem Sakanas gesamtes Geschäft beruht: dass Menschen ihn machen.

A headless capture of the OrcaRouter models catalogue page reading '207 models, 16 providers, one API key, one bill', with the filter sidebar showing input-modality counts, a pricing filter and a populated model list, and the panel that reads 'How to call any model' with an OpenAI-compatible curl sample pointing at https://api.orcarouter.ai/v1/chat/completions.