Carte principale pour l'affrontement Fugu Ultra v2 contre MiniMax M3, illustrant le large écart de prix entre un palier d'orchestration et un modèle multimodal open-weight à faible coût.
Guides & Insights

Fugu Ultra v2 vs MiniMax M3 : vingt-cinq fois le prix de sortie

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Placez les deux tarifs de sortie côte à côte et le nombre ressemble à une faute de frappe. MiniMax M3facture 1,20 $ par million de jetons de sortie. Fugu Ultra v2, annoncé par Sakana AI le 11 septembre 2026, est indiqué à 30,00 $. Cela fait 25× — et du côté de l'entrée, l'écart est de 16,7×, 0,30 $ contre 5,00 $ annoncés. MiniMax M3 est aussi plus rapide, accepte nativement la vidéo et est livré sous forme de poids ouverts téléchargeables. Face à ce tableau, la première réaction raisonnable est que le niveau d'orchestration ne peut en aucun cas justifier son prix. La question plus intéressante est de savoir ce qui devrait être vrai pour qu'il le justifie.

L'écart, exprimé simplement

Entrée — MiniMax M3 à 0,30 $ le million contre Fugu Ultra v2 annoncé à 5,00 $ le million. Le tarif du M3 est présenté par MiniMax comme une remise permanente de 50 %, et non comme une promotion à durée limitée.

Sortie — MiniMax M3 à 1,20 $ par million contre Fugu Ultra v2, annoncé à 30,00 $ par million.

Entrée mise en cache — MiniMax M3 à 0,06 $ par million contre Fugu Ultra v2 à 0,50 $ par million annoncé. La lecture du cache de M3 équivaut à un cinquième de son propre prix d'entrée, ce qui rend les boucles d'agents répétées sur une invite stable exceptionnellement bon marché.

Au-delà de 512 K en entrée — MiniMax M3 double pour atteindre 0,60 $ / 2,40 $ / 0,12 $. Le palier annoncé de Fugu Ultra v2 au-delà d'environ 272 K passe à environ 10,00 $ / 45,00 $ / 1,00 $. Les deux refacturent l'ensemble de la requête ; M3 commence plus tard et aboutit à une fraction du tarif.

Contexte — MiniMax M3 : 1 048 576 tokens avec un minimum garanti par le fournisseur de 512 K. Le contexte de Fugu Ultra v2 est annoncé à 1 M par des listes tierces ; la page d'annonce de Sakana ne mentionne aucun chiffre.

Une réserve concernant la colonne Fugu, et elle n’est pas minime : Sakana ne publie pas les tarifs de jetons de Fugu Ultra v2 sur sa propre page d’annonce. Les chiffres de 5,00 $ / 0,50 $ / 30,00 $ proviennent de listes de modèles tierces et doivent être considérés comme non confirmés tant que vous n’avez pas vérifié la grille tarifaire à jour. La colonne M3, en revanche, est documentée par le fournisseur. Cette différence de provenance fait elle-même partie de la comparaison.

Two-column comparison scoreboard for Fugu Ultra v2 and MiniMax M3 covering type, release date, input price ($5.00 vs $0.30 per million tokens), output price ($30.00 vs $1.20), cached input ($0.50 vs $0.06) and input modes (text vs text, image and video).

Ce que M3 fait nativement et qu'un orchestrateur doit router

MiniMax M3 accepte en entrée du texte, des images et de la vidéo, et renvoie du texte. La vidéo est celle qui se démarque. Le modèle a été entraîné sur des modalités mixtes dès l’étape zéro, et il repose sur MiniMax Sparse Attention, une architecture dont le fournisseur affirme qu’elle offre un préremplissage jusqu’à 9× plus rapide et un décodage 15× plus rapide sur un contexte de 1 M, par rapport à son prédécesseur, avec environ un vingtième du calcul par token.

Cela compte dans cette confrontation, car c’est une capacité que Fugu Ultra v2 ne revendique pas pour lui-même. La réponse d’un orchestrateur à « gère cette vidéo » consiste à router la vidéo vers un modèle capable de la voir, ce qui implique un sous-appel, donc davantage de tokens facturés au tarif de l’orchestrateur. La réponse de M3 consiste simplement à la lire. À 0,30 $ en entrée, une heure d’analyse vidéo est une erreur d’arrondi ; à 5,00 $ en entrée, plus ce que coûte le routage, c’est une ligne budgétaire.

La comparaison des architectures est elle aussi déséquilibrée, mais d'une autre manière. MiniMax M3 compte environ 428B de paramètres au total, avec environ 23B actifs par token — une conception Mixture-of-Experts où le routage épars permet de maintenir un faible coût d'inférence. Fugu Ultra v2 n'a pas de nombre de paramètres publié, car sa capacité réside dans une politique d'ordonnancement appliquée aux modèles d'autres entreprises plutôt que dans des poids entraînés par Sakana. L'un est un modèle. L'autre est une procédure de décision.

L'implication inconfortable

Voici ce qu'il vaut la peine de bien peser avant de payer 25× pour de l'output.

MiniMax M3 est à poids ouverts, bon marché, rapide, multimodal et à long contexte. Sur le papier, c’est un excellent sous-agent. Si vous construisiez une couche d’orchestration à partir de zéro — ce qu’est Fugu Ultra v2 —, un modèle comme M3 est proche du composant idéal : assez bon marché pour être appelé de manière spéculative, assez capable pour traiter la majeure partie des sous-tâches décomposées, et capable de voir des images et des vidéos sans second saut.

Sakana ne publie pas le pool de modèles de Fugu Ultra v2, donc nous ne pouvons pas dire si M3 en fait partie. Ce que nous pouvons dire, c'est que l'équation économique n'a de sens que d'une des deux façons suivantes. Soit Fugu Ultra v2 n'appelle pas des modèles comme M3, auquel cas la capacité capable la moins chère est laissée sur la table. Soit il les appelle, auquel cas une part significative des tokens qui vous sont facturés à 5,00 $ et 30,00 $ est constituée de tokens M3 qui coûtent 0,30 $ et 1,20 $ en amont, et la prime correspond à la politique d'orchestration plus une marge.

Aucune des deux interprétations n'est fatale au produit — un bon ordonnanceur peut valoir plusieurs fois son coût, et payer pour en avoir un vous évite d'avoir à le construire et à le maintenir. Mais cela signifie que la question à se poser au sujet de Fugu Ultra v2 n'est pas « est-ce mieux que M3 ? ». C'est « l'ordonnancement vaut-il plus que les tokens ? ». Et c'est une question à laquelle seules vos propres mesures de tâches peuvent répondre.

Il n'y a pas de benchmark commun

Contrairement à certains autres duels de cette série, il n'existe pas un seul benchmark sur lequel les deux fournisseurs publient un chiffre.

L'ensemble publié par MiniMax pour M3 est vaste et majoritairement reproductible dans sa structure : SWE-bench Verified à 80,5 %, SWE-bench Pro à 59,0 %, Terminal-Bench 2.0/2.1 à 66, BrowseComp à 83,5 %, OSWorld-Verified à 70,1 % et PostTrainBench à 37,1 — troisième place, derrière Claude Opus 4.7 à 42,4 et GPT-5.5 à 39,3. Tous rapportés par le fournisseur. Indépendamment, Artificial Analysis attribue à MiniMax M3 un score de 30 sur son Intelligence Index v4.3, classé 16e sur 113, avec un débit de 95,7 tokens par seconde et un temps jusqu'au premier token de 1,95 seconde — rapide, et parmi les modèles les mieux servis de sa catégorie. Si vous avez vu M3 cité à 44 ou 45, cela précède le retraitement de l'indice.

Les huit benchmarks de Sakana pour Fugu Ultra v2 — GDP.pdf, Chartography, SWEFish, DeepSWE et Toolathon parmi eux, avec le meilleur ou ex æquo meilleur sur cinq et dans les deux premiers sur sept — ne recoupent pas du tout cette liste. Deux d’entre eux, SWEFish et Toolathon, sont des tests internes de Sakana. Les affirmations phares, Chartography à 48,3 contre 27,3 pour Opus 5 et 29,5 pour Fable 5, et DeepSWE à 74,3, sont rapportées par le fournisseur et ont été publiées aujourd’hui. Rien concernant Fugu Ultra v2 n’a été vérifié de façon indépendante.

Donc, la comparaison que chaque agrégateur produira dans les deux semaines à venir — un tableau de scores partagés — n’est pas disponible. La seule chose honnête à dire sur la capacité est que MiniMax M3 a une position mesurée et indépendante, et que Fugu Ultra v2 a une revendication.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

Vitesse versus configuration

Les chiffres de MiniMax M3 sont connus : 95,7 jetons par seconde, 1,95 seconde jusqu’au premier jeton. C’est environ deux fois et demie le débit de Kimi K3 et l’un des modèles proches de la frontière les plus rapides mesurés, ce qui correspond à une conception explicitement optimisée pour le service de contextes longs à bas coût.

Fugu Ultra v2 ne publie aucun chiffre de latence ni de débit. Comme pour la tarification, une partie de cela est structurelle — le temps de réponse d’un orchestrateur dépend des modèles qu’il choisit et du nombre de passes qu’il effectue, donc un chiffre unique serait trompeur. Mais cela signifie que le coût en temps réel de son adoption n’est pas mesuré et est impossible à mesurer de l’extérieur. Pour le précédent Fugu Ultra, des testeurs ont rapporté publiquement des exécutions s’étirant vers 30 minutes ; il s’agit du modèle de juin 2026 et non de la v2, et ce n’est pas une preuve concernant le nouveau — mais si vous payez 25× plus cher pour la sortie, savoir combien de temps vous attendez n’est pas un simple agrément.

La licence, et ce que dit le passage en arabe

Les poids de MiniMax M3 sont téléchargeables sous la licence MiniMax Community License, qui est une licence de poids ouverts avec des conditions commerciales attachées — notamment un seuil de chiffre d’affaires au-delà duquel une autorisation écrite est requise. Ce n’est pas MIT, et toute page qui vous dit le contraire n’a pas lu l’étiquette de licence. Fugu Ultra v2 ne vous donne rien à concéder sous licence, car il n’y a rien à télécharger.

Le développement récent le plus intéressant pour M3, c'est ce que d'autres font avec ces poids. Le 3 septembre 2026, HUMAIN — l'entreprise d'IA soutenue par le PIF saoudien — a publié un modèle phare en arabe, construit en effectuant du post-entraînement de MiniMax M3 sur plus d'un billion de tokens arabes, avec 428 Md de paramètres au total et 23 Md de paramètres actifs, rapportant une moyenne pondérée à parts égales de 89,37 % sur sept benchmarks arabes et le plaçant devant GPT-5.6 Sol à 87,30 et Claude Opus 5 à 87,34. Il s'agit d'un aperçu de recherche, et ces chiffres sont ceux de HUMAIN.

Le contraste avec Fugu Ultra v2 ne saurait être plus tranché comme affirmation de ce qu’est chaque produit. MiniMax M3 est un socle sur lequel d’autres entreprises bâtissent des modèles souverains. Fugu Ultra v2 est une passerelle que l’on appelle, dont on ne peut pas voir la composition et dont on ne peut pas détenir les poids. Les deux sont des positions légitimes. Ce ne sont pas du tout le même genre de chose.

Screenshot of the OrcaRouter model page for MiniMax M3 showing the minimax/minimax-m3 identifier, a 1M token context window, 512K maximum output, and pricing of $0.30 per million input tokens and $1.20 per million output tokens.

Appeler l'un ou l'autre d'entre eux

MiniMax M3 est disponible sur OrcaRouter au tarif propre à MiniMax — 0,30 $ par million de tokens d'entrée, 0,06 $ en cas de hit de cache, 1,20 $ par million de tokens de sortie — répercuté sans marge, donc si MiniMax modifie la structure de remise, elle arrive ici le jour même plutôt que sur un cycle de migration. Il est compatible OpenAI sur la même URL de base que le reste du catalogue, ce qui signifie que vous pouvez router vers lui selon une règle, le placer derrière une chaîne de basculement, ou l'inclure dans un panneau de fusion de modèles sans second contrat ni modification de code. Pour un modèle dont tout l'argument est le prix, cette répercussion est l'élément qui compte : la route la moins chère reste la moins chère.

Fugu Ultra v2 n'est pas routé par nos services. Il est disponible via l'API compatible OpenAI propre à Sakana AI, et l'entreprise affirme qu'une intégration Fugu existante migre vers lui avec la modification d'un seul paramètre sur une ligne. Les deux utilisent le même format de requête, donc les placer derrière un seul indicateur pour l'évaluation revient à un échange d'URL de base.

Le verdict

Pour la très grande majorité des charges de travail, MiniMax M3 remporte cette comparaison sur le seul plan arithmétique. Il est 16,7 fois moins cher en entrée et 25 fois moins cher en sortie, plus rapide selon chaque métrique mesurée, nativement multimodal, y compris la vidéo, à poids ouverts sous une licence dont la plupart des entreprises n'atteindront jamais le plafond, et évalué indépendamment à 30 sur l'indice Artificial Analysis actuel. Ses faiblesses sont réelles mais limitées : il est verbeux, son score dans la catégorie agentique est moyen par rapport à ses scores en codage, et son ensemble de benchmarks fournisseurs est solide en ingénierie logicielle et plus limité en autonomie à long terme.

Choisissez Fugu Ultra v2 uniquement si vous croyez à ce que Sakana vend réellement — un palier de capacité maximale qui décompose des tâches complexes à étapes multiples à travers un pool qu'aucun fournisseur de pointe ne contrôle, atteignant une production de niveau frontière sans dépendre de modèles de frontière — et si vous disposez de mesures au niveau des tâches montrant que la décomposition surpasse un seul modèle bon marché dans votre travail. C'est une proposition véritablement différente de tout ce que Min​Max propose, et c'est la raison d'être du 25×.

Mais faites la mesure avant l’achat, pas après. Si un modèle à 0,30 $ termine votre tâche en deux essais et que Fugu Ultra v2 la termine en un seul, Fugu reste plus cher. La seule charge de travail où un facteur 25× est une aubaine est celle où le modèle bon marché ne peut pas du tout terminer — et c’est un ensemble de tâches bien plus restreint que ne le laisse entendre l’argumentaire de lancement.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement