Eine Hero-Titelkarte für „Fugu Max vs Claude Opus 5“ mit dem Untertitel „Viermal günstiger und eine Zahl, die niemand veröffentlicht hat“, drei Pillen-Badges mit der Aufschrift „$6.00 vs. $25.00 Ausgabe“, „Sechs Siege, null Punkte“, „$2.00 vs. $5.00 Eingabe“, eine Fußzeile mit dem Text „Sakana AI vs Anthropic – September 2026“ und das OrcaRouter-Logo in der unteren rechten Ecke.
Guides & Insights

Fugu Max vs Claude Opus 5: viermal günstiger und eine Zahl, die niemand veröffentlicht hat

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Fugu Max kostet 6,00 US-Dollar, um eine Million Ausgabe-Tokens zu erzeugen. Claude Opus 5 kostet 25,00 US-Dollar. Sakana AI brachte Fugu Max am 11. September 2026 als Koordinator heraus, der jede Aufgabe an das schlankste Modell in seinem Pool weiterleitet, und bepreiste es aggressiv genug, dass ein vierfacher Abstand bei den Ausgabekosten gegenüber dem Flaggschiff von Anthropic die Schlagzeile der Veröffentlichung ist. Was die Veröffentlichung nicht enthält, ist eine einzige Zahl, die beschreibt, wie gut Fugu Max tatsächlich abschneidet. Sakana sagt, es erziele bei sechs Benchmarks den „best overall score“ und erweitere bei sieben von zehn die Kosten-Leistungs-Grenze – Aussagen über die Platzierung in einem Diagramm statt über Werte auf einer Achse. Claude Opus 5 hingegen kommt mit einer veröffentlichten Punktzahl für nahezu alles, was es tut. Die ehrliche Version dieses Vergleichs lautet also nicht billig gegen teuer. Sie lautet gemessen gegen behauptet, und die Preislücke ist das, was diesen Trade-off diskussionswürdig macht.

Die Lücke und der Vergleich, den Sakana bewusst nicht vornahm

Sakanas Release-Seite rechtfertigt die Ausgaberate von Fugu Max durch einen Vergleich mit anderen Modellen. Die drei, die sie nennt, sind Claude Sonnet 5, GPT-5.6 Terra und Kimi K3, und die Behauptung ist, dass Fugu Max' Ausgabepreise 40 bis 60 Prozent unter denen dieser liegen. Man beachte, wer fehlt. Claude Opus 5 ist nicht in dieser Liste, und der Grund ist Arithmetik: Bei 6,00 $ gegenüber 25,00 $ ist Fugu Max nicht 40 Prozent billiger als Opus 5, sondern 76 Prozent billiger. Hätte man Opus 5 genannt, hätte die Behauptung unglaubwürdig statt wettbewerbsfähig gewirkt, daher wird der Vergleich mit der Stufe unter dem Flaggschiff gezogen.

Das ist keine Kritik an der Preisgestaltung, die wirklich niedrig ist. Es ist eine Anmerkung dazu, was der umgebende Satz bewirkt. Sakanas eigene Darstellung – Leistung „in Schlagdistanz zu Elite-Modellen bei zwei- bis sechsmal niedrigeren Kosten“ – ist auf die Modelle kalibriert, die sie zu nennen wählte. Im Vergleich zu Claude Opus 5 liegt der Faktor nicht bei zwei bis sechs, sondern beim Output bei über vier; ob Opus 5 nach den Maßstäben dieses Satzes noch ein „Elite-Modell“ ist, bleibt unausgesprochen, was eine merkwürdige Auslassung in einer Veröffentlichung ist, deren gesamtes Verkaufsargument Kosten-Leistungs-Effizienz an der Frontier ist.

• Eingabepreis — Fugu Max 2,00 $ pro 1 Mio. Tokens vs. Claude Opus 5 5,00 $ pro 1 Mio. Tokens

• Ausgabepreis – Fugu Max 6,00 $ pro 1 Mio. Token vs. Claude Opus 5 25,00 $ pro 1 Mio. Token

• Zwischengespeicherte Eingabe — Fugu Max 0,25 $ pro 1 Mio. Token gegenüber Claude Opus 5, dessen Caching mit einem Rabatt von bis zu 90 % auf zwischengespeicherte Eingaben bepreist wird

• Benchmark-Ergebnisse — für Fugu Max wurden keine veröffentlicht, sechs Benchmark-Siege ohne Zahlen behauptet gegenüber Claude Opus 5, von Anthropic gemeldet: 96,0 % SWE-bench Verified, 79,2 % SWE-bench Pro, rund 30,2 % bei ARC-AGI 3

• Architektur — Fugu Max: ein trainierter Koordinator über einen nicht offengelegten Pool vs. Claude Opus 5: ein einzelnes Modell, das pro Version fixiert werden kann

• Kontext — Fugu Max nicht veröffentlicht vs. Claude Opus 5 1M Tokens, mit einer Ausgabegrenze von 128K

• Unabhängige Evaluierung — Fugu Max: Für kein Fugu-Modell existiert eine vs. Claude Opus: 5 Monate Platzierungen in Drittanbieter-Bestenlisten

Sechs Siege ohne zugehörige Ergebnisse

Die sechs Benchmarks sind Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench und SWEFish. Fünf davon sind bekannte öffentliche Evaluierungen. Der sechste, SWEFish, ist Sakanas eigener Coding-Benchmark, was bedeutet, dass einer der sechs Siege anhand eines Tests bewertet wird, den der Anbieter geschrieben und nicht veröffentlicht hat.

Für die anderen fünf heißt es in der Pressemitteilung, dass Fugu Max die beste Gesamtpunktzahl erzielt, ohne zu sagen, wie hoch diese Punktzahl ist oder was ein Wettbewerber erreicht hat. Das ist eine ungewöhnliche Form für eine Modellankündigung. Anbieter übertreiben routinemäßig, doch meistens übertreiben sie mit Zahlen, weil Zahlen das sind, was weitergetragen wird. Eine Pressemitteilung, die sechs Siege beansprucht und keinen einzigen davon nennt, verlangt, allein aufgrund der Behauptung akzeptiert zu werden.

Es gibt eine wohlwollende Lesart, und es lohnt sich, sie klar zu benennen. Fugu Max ist ein kostenoptimierter Koordinator, kein Vorstoß zur Leistungssteigerung – Sakana hat es am selben Tag wie Fugu Ultra v2 veröffentlicht, die Version, die auf maximale Leistungsfähigkeit bei 5,00 $ Eingabe und 30,00 $ Ausgabe ausgerichtet ist. Max’ Aufgabe ist es, bei 6,00 $ Ausgabe akzeptable Qualität zu erreichen, und eine Schlagzeilenpunktzahl eines Orchestrators ist weniger aussagekräftig als seine Punktzahl pro Dollar, was genau das ist, was ein Pareto-Diagramm zeigt. Sakanas visuelle Kommunikation für dieses Release sind Pareto-Diagramme. Wenn das Argument „Schau auf die Kurve, nicht auf die Spitze“ lautet, dann ist eine rohe Benchmark-Zahl nebensächlich.

Die wenig wohlwollende Lesart ist, dass eine Zahl zu einem Vergleich einladen würde, den der Anbieter lieber vermeiden würde. Beide Lesarten sind mit der Beweislage vereinbar, und nichts in der öffentlichen Aktenlage unterscheidet derzeit zwischen ihnen. Was sich sagen lässt, ist, dass keine unabhängige Partei irgendein Fugu-Modell bewertet hat und dass es keinen Eintrag bei Artificial Analysis für Fugu Max oder eines seiner Schwestermodelle gibt. Jede Angabe in der Veröffentlichung, einschließlich der sechs Siege, stammt von Sakana.

A two-column scoreboard titled "Fugu Max vs Claude Opus 5 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Benchmarks six wins with no figures, Context not published, Evidence vendor-reported only. Right column Claude Opus 5: Output price $25.00 / 1M, Input price $5.00 / 1M, Cached input up to 90% discount, Benchmarks 96.0% SWE-bench Verified, Context 1M with a 128K output ceiling, Evidence independent evals. Footer reading "Fugu Max figures vendor-reported by Sakana AI; Opus 5 rows Anthropic-reported. No independent Fugu Max evaluation exists.", with the OrcaRouter logo bottom-right.

Der Kauf, den Sie tatsächlich tätigen

Wenn ein Anbieter eines einzelnen Modells einen Benchmark veröffentlicht, kaufen Sie eine Behauptung über ein Modell. Wenn ein Orchestrator einen veröffentlicht, kaufen Sie eine Behauptung über einen Pool – Modelle, die der Anbieter nicht trainiert hat und die unter einem Koordinator laufen, dessen Routing-Entscheidungen bewusst nicht offengelegt werden. Der Pool hier wird als der größte beschrieben, den Fugu je genutzt hat, erweitert um Open-Weights- und spezialisierte Modelle, darunter die NVIDIA Nemotron-Familie durch eine Zusammenarbeit mit NVIDIA. Die Mitglieder bleiben ansonsten unbekannt.

Die praktische Konsequenz ist, dass sich das Verhalten von Fugu Max ändern kann, ohne dass sich seine Version ändert. Die Abschaffung durch ein Frontier-Labor, eine Preisänderung oder der Rückzug eines Modells aus einer Region verändern, was der Koordinator aufrufen kann, und Sakana macht unmissverständlich klar, dass genau diese Resilienz der Punkt ist – das Unternehmen verkauft Schutz vor Vendor-Lock-in und API-Widerrufen. Das ist ein echter Vorteil, und er ist nicht kostenlos. Es ist auch der Grund, warum ein Fugu-Max-Benchmark, falls einer veröffentlicht würde, ein Ablaufdatum hätte, das ein Claude-Opus-5-Benchmark nicht hat.

Das Wertversprechen von Claude Opus 5 ist genau umgekehrt und leichter zu bepreisen. Es ist ein einziges Modell in einer einzigen Version, das standardmäßig adaptives Denken verwendet, mit einem expliziten Effort-Regler von niedrig bis maximal, einem Kontextfenster von 1 Mio. Tokens und einer Ausgabegrenze von 128 K, mit Vision, Tool-Nutzung und JSON-Modus. Anthropic berichtet 96,0 % bei SWE-bench Verified und 79,2 % bei SWE-bench Pro, und diese Zahlen wurden an dem gemessen, was Sie erhalten, wenn Sie den Endpunkt aufrufen – nicht an einem Ensemble, dessen Zusammensetzung sich unter Ihnen verändern kann. Für eine Workload, die in der Produktion läuft und überprüft wird, ist diese Stabilität ein Feature, für das Sie 19,00 US-Dollar pro Million Ausgabe-Tokens zahlen.

Kosten pro abgeschlossener Aufgabe, nicht pro Token

Fugu Max' Ausgaberate von 6,00 $ ist wirklich attraktiv, und der Weg, sie zu testen, besteht darin, aufzuhören, Token-Preise zu vergleichen. Ein Orchestrator startet Agenten; jeder schreibt Reasoning- und Ausgabe-Tokens; der Koordinator schreibt eine Synthese. Sakanas Preis-FAQ für die Fugu-Linie verpflichtet sich zu einem einzigen Mischpreis, der auf dem beteiligten Top-Tier-Modell basiert, wobei Multi-Agenten-Läufe die Rechnung nicht aufsummieren – was die Worst-Case-Fan-out-Vervielfachung beseitigt, die naive Multi-Agenten-Systeme unbezahlbar macht. Das Volumen beseitigt es jedoch nicht. Die Anzahl der Ausgabe-Tokens, die Ihnen in Rechnung gestellt werden, hängt davon ab, wie viele Agenten gelaufen sind, und bei 6,00 $ pro Million ist dieses Volumen die Variable, die Ihnen eine Preisseite nicht nennen kann.

Die Kostenstruktur von Claude Opus 5 ist ein Aufruf, ein Modell, ein Aufwandsregler, den Sie steuern, und Batch-Verarbeitung zum halben Preis für Arbeit, die warten kann. Sie können sie vorhersagen, bevor Sie sie ausführen. Bei über zehntausend Ausführungen ist Vorhersagbarkeit sehr viel mehr wert als ein Benchmark-Vorteil, den niemand veröffentlicht hat.

Hier trennt sich die Routing-Frage von der Modell-Frage. Claude Opus 5 ist auf OrcaRouter zum Listenpreis von Anth​ropic mit 0 % Aufschlag — der Tarif des Anbieters wird direkt durchgereicht, sodass eine Änderung an Anth​ropics Preisgestaltung am selben Tag über denselben Schlüssel live ist, mit automatischem Failover über mehrere Anbieterpfade, wenn einer rate-limited oder nicht verfügbar ist. Fugu Max ist nicht in unserem Katalog; es erreicht Sie über Sakanas eigene OpenAI-kompatible API und mehrere Drittanbieterplattformen, und der Wechsel von einem früheren Fugu ist eine Parameteränderung in einer Zeile. Wenn Sie die Evidenzbasis von Opus 5 und eine Rechnung wollen, die Sie vorhersehen können, ist der Router der kürzere Weg. Wenn Sie ein System wollen, das bei schwierigen Problemen sein eigenes Fan-out zusammenstellt, dann ist Fugu Max genau das — und Sie sollten es pilotieren, wobei die Token-Abrechnung ab der ersten Anfrage aktiviert ist.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Wo Fugu Max wahrscheinlich die richtige Antwort ist

Zolle dem Design, was ihm zusteht. Wenn deine Arbeit hochvolumig und prüfbar ist und dir die medianen Kosten einer erledigten Aufgabe wichtiger sind als die Spitzenleistung eines einzelnen Aufrufs, dann leistet ein Orchestrator, der pro Anfrage das günstigste ausreichende Modell auswählt, etwas, das ein festes Flaggschiff nicht leisten kann. Fugu Max zielt genau auf diese Arbeitslast ab, und der Eingabetarif von 2,00 $ mit 0,25 $ für gecachten Input ist auf die langen, repetitiven Kontexte ausgelegt, die solche Arbeitslasten erzeugen. Auch die Zusammenarbeit mit NVIDIA ist bedeutender, als es aussieht: Nemotron-Modelle sind Open-Weights, was bedeutet, dass die günstigste Stufe des Pools nicht den Preisentscheidungen eines anderen Labors ausgesetzt ist.

Was Ihnen das nicht liefert, ist ein Grund anzunehmen, dass Fugu Max bei den Aufgaben, bei denen die veröffentlichten Zahlen von Opus 5 am stärksten sind, mit Claude Opus 5 mithalten wird – Software-Engineering im Repository-Maßstab und schwieriges Schlussfolgern. Genau das sind die Zeilen, in denen Sakanas Übersicht mit sechs Benchmarks überhaupt keine Zahl ausweist. Wenn Ihr Problem eines ist, bei dem es wichtiger ist, der Beste zu sein als billig zu sein, dann erkauft der Ausgabepreis von 25,00 $ genau das, was Sie tatsächlich brauchen.

Fazit

Claude Opus 5 ist der besser belegte Kauf und die sicherere Standardeinstellung für die Produktion: veröffentlichte Hersteller-Benchmarks, eine Version, die Sie pinnen können, ein Kontextfenster, das sich nicht ändert, ein Ausgabelimit von 128K, ein Aufwandsregler, mit dem Sie Reasoning nur dann einkaufen, wenn es sich lohnt, und monatelange Ergebnisse von Drittanbietern dahinter. Fugu Max ist die interessantere Wette und eine wirklich günstigere — rund 60 Prozent weniger bei Eingaben und 76 Prozent weniger bei Ausgaben, mit einer Cache-Rate, die um eine Größenordnung unter dem Grundpreis von Opus 5 für Eingaben liegt.

Wenn Sie überprüfbare, repetitive, hochvolumige Arbeit ausführen und sich außerhalb der EU/des EWR befinden, verdient Fugu Max einen klar abgegrenzten Pilotversuch mit einer vorab festgelegten Obergrenze für Ausgabe-Token und einer Messung der Token pro abgeschlossener Aufgabe statt Token pro Aufruf. Wenn Sie in diesem Quartal eine Produktionsentscheidung benötigen, die Sie gegenüber Dritten verteidigen können, bleibt Claude Opus 5 die Antwort — und es ist auf OrcaRouter zum Listenpreis von Anth​ropic erhältlich, wobei der Tarif des Anbieters unverändert weitergegeben wird.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured September 11, 2026, English UI), showing the Featured badge, the anthropic/claude-opus-5 model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24, the /v1/chat/completions and /v1/messages endpoints, the pricing tiles reading INPUT $5.00 and OUTPUT $25.00 per 1M tokens with p50 TTFT 4.94s and 195.4M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.