Une carte de titre principale pour « Fugu Max vs Claude Opus 5 » avec le sous-titre « Quatre fois moins cher, et un chiffre que personne n'a publié », trois badges en forme de pastille affichant « 6,00 $ vs 25,00 $ en sortie », « Six victoires, zéro score », « 2,00 $ vs 5,00 $ en entrée », une ligne de pied de page affichant « Sakana AI vs Anthropic - septembre 2026 », et le logo OrcaRouter dans le coin inférieur droit.
Guides & Insights

Fugu Max vs Claude Opus 5 : quatre fois moins cher, et un chiffre que personne n'a publié

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Fugu Max coûte 6,00 $ pour produire un million de tokens de sortie. Claude Opus 5 coûte 25,00 $. Sakana AI a lancé Fugu Max le 11 septembre 2026 comme un coordinateur qui achemine chaque tâche vers le modèle le plus frugal de son pool, et l’a proposé à un prix suffisamment agressif pour qu’un écart de sortie de quatre pour un face au modèle phare d’Anthropic soit le fait marquant de l’annonce. Ce que l’annonce ne contient pas, c’est un seul chiffre décrivant la performance réelle de Fugu Max. Sakana affirme qu’il obtient le « meilleur score global » sur six benchmarks et élargit la frontière coût-performance sur sept des dix — des déclarations sur le placement sur un graphique plutôt que sur des valeurs sur un axe. Claude Opus 5, en revanche, arrive avec un score publié pour presque tout ce qu’il fait. Donc la version honnête de cette comparaison n’est pas bon marché contre cher. C’est mesuré contre affirmé, et l’écart de prix est ce qui rend ce compromis digne de débat.

L’écart, et la comparaison que Sakana a choisi de ne pas faire

La page de lancement de Sakana justifie le tarif de sortie de Fugu Max en le comparant à d'autres modèles. Les trois qu'elle nomme sont Claude Sonnet 5, GPT-5.6 Terra et Kimi K3, et l'affirmation est que le tarif de sortie de Fugu Max est 40 à 60 % inférieur à celui de ces modèles. Remarquez qui est absent. Claude Opus 5 ne figure pas dans cette liste, et la raison est arithmétique : à 6,00 $ contre 25,00 $, Fugu Max n'est pas 40 % moins cher qu'Opus 5, il est 76 % moins cher. Citer Opus 5 aurait fait paraître l'affirmation invraisemblable plutôt que compétitive, c'est pourquoi la comparaison est établie face à l'échelon inférieur au modèle phare.

Ce n'est pas une critique de la tarification, qui est réellement basse. C'est une remarque sur ce que fait la phrase qui l'entoure. La formulation de Sakana elle-même — des performances « à portée de tir des modèles d'élite, à un coût deux à six fois inférieur » — est calibrée sur les modèles qu'elle a choisi de nommer. Face à Claude Opus 5, le multiple n'est pas de deux à six, il est supérieur à quatre sur les sorties ; on ne précise pas si Opus 5 est encore un « modèle d'élite » selon les critères de cette phrase, ce qui est une omission curieuse dans une annonce dont tout l'argument est l'efficacité coût-performance à la frontière.

• Prix d'entrée — Fugu Max 2,00 $ par million de tokens vs Claude Opus 5 5,00 $ par million de tokens

• Prix des tokens de sortie — Fugu Max 6,00 $ par million de tokens vs Claude Opus 5 25,00 $ par million de tokens

• Entrée mise en cache — Fugu Max 0,25 $ par million de jetons contre la mise en cache de Claude Opus 5, facturée comme une remise pouvant atteindre 90 % sur l’entrée mise en cache

• Scores de benchmark — Fugu Max : aucun score publié, six victoires de benchmark affirmées sans chiffres, contre Claude Opus 5 pour lequel Anthropic rapporte 96,0 % sur SWE-bench Verified, 79,2 % sur SWE-bench Pro et environ 30,2 % sur ARC-AGI 3

• Architecture — Fugu Max, un coordinateur entraîné sur un pool non divulgué, vs Claude Opus 5, un modèle unique épinglable par version

• Contexte — Fugu Max non publié vs Claude Opus 5, 1 M de jetons, avec un plafond de sortie de 128 K

• Évaluation indépendante — Fugu Max : il n’en existe aucune pour aucun modèle Fugu, contrairement aux 5 mois de placements sur des classements tiers de Claude Opus

Six victoires sans scores associés

Les six benchmarks sont Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench et SWEFish. Cinq d’entre eux sont des évaluations publiques reconnaissables. Le sixième, SWEFish, est le benchmark de codage propre à Sakana, ce qui signifie que l’une des six victoires est évaluée sur un test que le fournisseur a rédigé et n’a pas publié.

Pour les cinq autres, le communiqué affirme que Fugu Max obtient le meilleur score global sans préciser quel est ce score, ni le score d’aucun concurrent. C’est une forme inhabituelle pour une annonce de modèle. Les fournisseurs exagèrent systématiquement, mais ils le font généralement avec des chiffres, car ce sont les chiffres qui circulent. Un communiqué qui revendique six victoires et n’en imprime aucune demande à être pris au sérieux sur la seule foi de l’affirmation.

Il existe une lecture charitable, et elle mérite d’être énoncée clairement. Fugu Max est un coordinateur optimisé pour le coût, et non une poussée de capacités — Sakana l’a livré le même jour que Fugu Ultra v2, qui est la version visant une capacité maximale, à 5,00 $ en entrée et 30,00 $ en sortie. Le rôle de Max est d’atteindre une qualité acceptable à 6,00 $ en sortie, et le score phare d’un orchestrateur est moins significatif que son score par dollar, ce que montre précisément un graphique de Pareto. La communication visuelle de Sakana pour cette version repose sur des graphiques de Pareto. Si l’argument est « regardez la courbe, pas le pic », alors un chiffre brut de benchmark est hors sujet.

L’interprétation peu charitable est qu’un chiffre inviterait à une comparaison que le fournisseur préférerait éviter. Les deux interprétations sont compatibles avec les éléments de preuve, et rien dans les documents publics ne permet actuellement de les départager. Ce que l’on peut dire, c’est qu’aucune partie indépendante n’a évalué de modèle Fugu, et qu’il n’existe aucune entrée Artificial Analysis pour Fugu Max ni pour aucun de ses modèles frères. Chaque chiffre du communiqué, y compris les six victoires, provient de Sakana.

A two-column scoreboard titled "Fugu Max vs Claude Opus 5 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Benchmarks six wins with no figures, Context not published, Evidence vendor-reported only. Right column Claude Opus 5: Output price $25.00 / 1M, Input price $5.00 / 1M, Cached input up to 90% discount, Benchmarks 96.0% SWE-bench Verified, Context 1M with a 128K output ceiling, Evidence independent evals. Footer reading "Fugu Max figures vendor-reported by Sakana AI; Opus 5 rows Anthropic-reported. No independent Fugu Max evaluation exists.", with the OrcaRouter logo bottom-right.

L'achat que vous effectuez réellement

Lorsqu'un fournisseur de modèle unique publie un benchmark, vous achetez une affirmation sur un modèle. Lorsqu'un orchestrateur en publie un, vous achetez une affirmation sur un ensemble — des modèles que le fournisseur n'a pas entraînés, exécutés sous la direction d'un coordinateur dont les décisions de routage ne sont délibérément pas exposées. L'ensemble décrit ici est présenté comme le plus grand que Fugu ait utilisé, enrichi de modèles à poids ouverts et spécialisés, dont la famille NVIDIA Nemotron, grâce à une collaboration avec NVIDIA. Les membres ne sont pas divulgués par ailleurs.

La conséquence pratique est que le comportement de Fugu Max peut changer sans que sa version change. La dépréciation d’un modèle par un laboratoire de pointe, une modification de prix ou le retrait d’un modèle d’une région modifient ce que le coordinateur peut appeler, et Sakana affirme explicitement que cette résilience est justement l’objectif : elle vend une protection contre l’enfermement propriétaire et les révocations d’API. C’est un avantage réel, et il n’est pas gratuit. C’est aussi la raison pour laquelle un benchmark de Fugu Max, s’il était publié, porterait une date d’expiration qu’un benchmark de Claude Opus 5 ne porte pas.

La proposition de valeur de Claude Opus 5 est l'inverse, et elle est plus facile à tarifer. Il s'agit d'un seul modèle, à une seule version, qui exécute la réflexion adaptative par défaut avec un réglage d'effort explicite allant de faible à max, qui dispose d'une fenêtre de contexte de 1M de tokens et d'un plafond de sortie de 128K, avec la vision, l'utilisation d'outils et le mode JSON. Anth​ropic annonce 96,0 % sur SWE-bench Verified et 79,2 % sur SWE-bench Pro, et ces chiffres ont été mesurés sur ce que vous obtenez lorsque vous appelez le point de terminaison — pas sur un ensemble dont la composition peut changer sous vos pieds. Pour une charge de travail exécutée en production et soumise à revue, cette stabilité est une caractéristique que vous payez 19,00 $ par million de tokens de sortie pour avoir.

Coût par tâche terminée, pas par token

Le tarif de 6,00 $ pour les tokens de sortie de Fugu Max est vraiment attractif, et pour le tester, il faut arrêter de comparer les prix des tokens. Un orchestrateur lance des agents ; chacun écrit des tokens de raisonnement et de sortie ; le coordinateur écrit une synthèse. La FAQ tarifaire de Sakana pour la gamme Fugu s'engage sur un tarif unique mixte basé sur le modèle participant le plus haut de gamme, les exécutions multi-agents ne s'ajoutant pas à la facture — ce qui élimine la multiplication en fan-out du pire cas qui rend les systèmes multi-agents naïfs inabordables. Cela n'élimine pas le volume. Le nombre de tokens de sortie qui vous sont facturés dépend du nombre d'agents exécutés, et à 6,00 $ par million, ce volume est la variable qu'une page de tarification ne peut pas vous indiquer.

Le profil de coûts de Claude Opus 5, c’est un seul appel, un seul modèle, un curseur d’effort que vous contrôlez, et un traitement par lots à demi-tarif pour le travail qui peut attendre. Vous pouvez le prévoir avant de l’exécuter. Sur plus de dix mille exécutions, la prévisibilité vaut bien plus qu’une marge de benchmark que personne n’a publiée.

C'est ici que la question du routage se sépare de la question du modèle. Claude Opus 5 est disponible sur OrcaRouter au prix catalogue d'Anth​ropic, avec 0 % de marge — le tarif du fournisseur est répercuté tel quel, de sorte qu'une modification de la tarification d'Anth​ropic est effective le jour même sur la même clé, avec un basculement automatique entre les chemins de fournisseurs lorsque l'un d'eux est limité en débit ou indisponible. Fugu Max ne figure pas dans notre catalogue ; il vous parvient via l'API compatible OpenAI de Sakana et plusieurs plateformes tierces, et passer à Fugu Max depuis une version antérieure de Fugu ne demande qu'un changement d'un seul paramètre. Si vous voulez la base de preuves d'Opus 5 et une facture prévisible, le routeur est le chemin le plus court. Si vous voulez un système qui assemble lui-même son fan-out sur les problèmes difficiles, c'est Fugu Max qui fait cela — et vous devriez le tester avec la comptabilisation des tokens activée dès la première requête.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Là où Fugu Max est probablement la bonne réponse

Rendez à cette conception ce qui lui revient. Si votre travail est à fort volume, vérifiable, et que vous vous souciez du coût médian d’une tâche accomplie plutôt que de la capacité de pointe d’un seul appel, un orchestrateur qui choisit le modèle suffisant le moins cher par requête fait quelque chose qu’un modèle phare figé ne peut pas faire. Fugu Max vise précisément cette charge de travail, et le tarif d’entrée de 2,00 $ avec 0,25 $ pour l’entrée mise en cache est calibré pour les contextes longs et répétitifs que ces charges de travail génèrent. La collaboration avec NVIDIA compte aussi plus qu’il n’y paraît : les modèles Nemotron sont à poids ouverts, ce qui signifie que l’échelon le moins cher du pool n’est pas exposé aux décisions tarifaires d’un autre laboratoire.

Ce que cela ne vous donne pas, c’est une raison de croire que Fugu Max égalera Claude Opus 5 sur les tâches où les chiffres publiés d’Opus 5 sont les plus solides — l’ingénierie logicielle à l’échelle d’un dépôt et le raisonnement difficile. Ce sont précisément les lignes où le tableau à six benchmarks de Sakana n’offre aucun chiffre du tout. Si votre problème est un cas où être le meilleur compte plus que d’être bon marché, le tarif de sortie de $25.00 vous achète ce dont vous avez réellement besoin.

En résumé

Claude Opus 5 est l’achat le mieux étayé par les preuves et la valeur par défaut la plus sûre pour la production : des benchmarks fournisseurs publiés, une version que vous pouvez épingler, une fenêtre de contexte qui ne bouge pas, un plafond de sortie de 128 K, un réglage d’effort qui vous permet d’acheter du raisonnement uniquement quand cela en vaut la peine, et des mois de résultats tiers derrière lui. Fugu Max est le pari le plus intéressant et un choix réellement moins cher — environ 60 % de moins en entrée et 76 % de moins en sortie, avec un tarif de cache d’un ordre de grandeur inférieur au prix d’entrée de base d’Opus 5.

Si vous exécutez un travail vérifiable, répétitif et à fort volume et que vous êtes en dehors de l'UE/EEE, Fugu Max mérite un pilote à périmètre défini, avec un plafond de tokens de sortie fixé avant de commencer et une mesure des tokens par tâche terminée plutôt que des tokens par appel. Si vous avez besoin d'une décision de production que vous pouvez défendre devant quelqu'un d'autre ce trimestre, Claude Opus 5 reste la réponse — et il est disponible sur OrcaRouter au prix catalogue d'Anthropic, le tarif du fournisseur étant répercuté sans modification.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured September 11, 2026, English UI), showing the Featured badge, the anthropic/claude-opus-5 model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24, the /v1/chat/completions and /v1/messages endpoints, the pricing tiles reading INPUT $5.00 and OUTPUT $25.00 per 1M tokens with p50 TTFT 4.94s and 195.4M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.