Une carte hero générée intitulée « Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview » avec le sur-titre « L'UN A UN PRIX. L'AUTRE A UN PLAN DE TOKENS » et des pastilles indiquant 0,10 $ / 0,50 $ par 1M contre non publié, 1M de contexte chacun, et AA Index 43 contre aucun publié.
Guides & Insights

Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview : l'un a un prix, l'autre a un plan de tokens

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

MiniMax M3.1 Flash Preview n'a aucun prix publié par token. Pas un prix élevé, pas un prix promotionnel — aucun. Il n'est disponible que via le Token Plan du fournisseur et sa surface Code, et la documentation pour les développeurs le dit en toutes lettres. Claude Haiku 5.5, sorti le 7 octobre 2026, coûte 0,10 $ par million de tokens d'entrée et 0,50 $ par million de tokens de sortie, jusqu'à une invite de 100 000 tokens. La première chose à dire sur cette confrontation, c'est donc qu'il ne s'agit pas d'une comparaison de prix, car un seul des deux modèles a un prix. Il s'agit plutôt d'une comparaison entre une API facturée à l'usage et un abonnement — et cette différence en dit plus sur vos coûts que n'importe quel benchmark.

La deuxième chose à dire, c'est que MiniMax M3.1 Flash Preview n'a pas de fiche modèle, pas de benchmarks publiés, pas de poids et aucun score indépendant que nous puissions trouver. Il est apparu le 27 septembre 2026 et c'est, selon l'appellation du fournisseur lui-même, un aperçu accessible via un abonnement plutôt que par une API. Ce n'est pas une critique du modèle ; c'est une description de ce que l'on peut et ne peut pas savoir à son sujet. Tout ce qui suit garde cette limite bien visible.

Ce que chacun est réellement

Claude Haiku 5.5 — Anthropic, ID claude-haiku-5-5, publié le 7 octobre 2026. Entrée texte et image, sortie texte. Fenêtre de contexte de 1 M de tokens, sortie maximale de 128 000 tokens (300 000 via un en-tête bêta sur la Batch API), date limite d'entraînement en juin 2026, retrait pas avant le 7 octobre 2027. Effort ajustable entre Low, Medium, High, Xhigh et Max, Medium étant la valeur par défaut, et réflexion adaptative activée par défaut. Facturation au token, avec lectures du cache à 0,01 $ par million et Batch à moitié prix.

MiniMax M3.1 Flash Preview — MiniMax, disponible depuis le 27 septembre 2026. Une fenêtre de contexte d'un million de tokens. Entrée texte, image et vidéo, sortie texte. Le raisonnement est toujours activé, avec un contrôle de l'effort allant de faible à maximal. L'API est compatible avec Anthropic, OpenAI et OpenAI Responses, ce qui en fait un remplacement quasi direct pour l'un ou l'autre SDK. L'accès se fait uniquement via le Token Plan et MiniMax Code ; il n'existe aucune formule de paiement à l'usage ni de tarif publié.

A capture of the MiniMax developer documentation text-model page containing the line stating that MiniMax-M3.1-Flash-Preview is available only through Token Plan and MiniMax Code for now, alongside the subscription-key instructions and the supported API endpoint formats.

• La comparaison, dimension par dimension

• Prix — Claude Haiku 5.5 : 0,10 $ par million de tokens en entrée et 0,50 $ en sortie jusqu'à 100 000 tokens, puis 0,50 $ et 2,50 $ ; MiniMax M3.1 Flash Preview n'a pas de tarif publié par token, seulement un abonnement Token Plan.

• Fenêtre de contexte — 1 000 000 de tokens chacun. C’est la seule dimension où ils sont véritablement à égalité.

• Sortie maximale — 128 000 tokens pour Claude Haiku 5.5, avec un accès bêta de 300 000 tokens sur Batch ; non publié pour MiniMax M3.1 Flash Preview.

• Modalités d’entrée — texte et image par rapport à texte, image et vidéo. L’entrée vidéo est un véritable différenciateur et MiniMax l’emporte.

• Contrôle de l'effort — cinq positions, par défaut Medium, sur Claude Haiku 5.5 ; de low à max avec la réflexion toujours activée pour MiniMax M3.1 Flash Preview.

• Score indépendant — Artificial Analysis Intelligence Index 43, configuration Max 43,40, deuxième sur 182 pour Claude Haiku 5.5 ; aucun publié pour MiniMax M3.1 Flash Preview.

• Coût par tâche terminée — 0,21 $ par tâche de l’indice Artificial Analysis pour Claude Haiku 5.5 ; non calculable pour MiniMax M3.1 Flash Preview sans à la fois un score et un tarif.

• Vitesse de sortie — 243,4 tokens par seconde pour Claude Haiku 5.5 ; non communiquée pour MiniMax M3.1 Flash Preview.

• Poids ouverts — aucun des deux. Claude Haiku 5.5 est propriétaire ; MiniMax n'a pas publié les poids de M3.1 Flash Preview.

Pourquoi un abonnement est moins adapté qu'il n'y paraît

Il existe une version de cette comparaison où le Token Plan est l'achat le plus avantageux, et il est juste de lui rendre justice. Si vous utilisez MiniMax Code de manière interactive, un abonnement plafonne votre coût à un montant mensuel connu, quelle que soit votre utilisation, tandis que la tarification par token n'a pas de plafond équivalent. Pour un utilisateur interactif intensif, un forfait fixe bat un compteur presque à chaque fois.

Cette logique s'inverse dès que la charge de travail devient programmatique. Un abonnement est tarifé pour un schéma d'usage humain — irrégulier, interactif, auto-limitant. Un agent, une tâche par lots ou un point de terminaison de production n'a pas ce schéma : il tourne autant que la file d'attente l'exige. Faire passer ce trafic sur une offre tarifée pour un usage interactif revient soit à heurter une limite invisible, soit à payer une place alors qu'il fallait du débit. Et le problème de second ordre est pire : sans tarif publié par jeton, impossible de prévoir le coût à mesure que le volume augmente, impossible de comparer le prix avec n'importe quel autre modèle, et impossible de déterminer si un modèle moins cher aurait fait l'affaire. Un prix que l'on ne peut pas calculer est un budget que l'on ne peut pas défendre.

Claude Haiku 5.5 pose le problème inverse, de la meilleure façon possible. Le tarif est publié, les paliers sont publiés, la remise de cache est publiée, et le seul piège est structurel plutôt que caché : dépassez 100 000 jetons de prompt et les deux tarifs sont multipliés par cinq. C'est une falaise que l'on peut contourner par conception. Un tarif non publié est un brouillard que l'on ne peut pas.

L'égalité à 1 M de jetons, et pourquoi elle ne signifie pas ce que cela semble être

Les deux modèles annoncent une fenêtre de contexte d'un million de tokens, et c'est l'argument phare que mettent en avant les deux fournisseurs. C'est aussi la dimension où cette égalité est la plus trompeuse, car une fenêtre de contexte n'est pas la même chose qu'un contexte exploitable. Claude Haiku 5.5 annonce une sortie maximale de 128 000 tokens en plus de sa fenêtre et facture cinq fois le tarif de base au-delà de 100 000 tokens d'entrée — un modèle tarifaire qui indique clairement que les longs prompts sont autorisés, mais qu'ils ne constituent pas le cas d'usage par défaut prévu. MiniMax ne publie aucune sortie maximale pour M3.1 Flash Preview et aucune tarification pour le contexte long, car elle ne publie aucune tarification du tout.

Le contexte long est précisément l'endroit où la différence de coût entre les deux architectures ressortirait le plus clairement, et c'est exactement là que l'une d'elles ne vous donne aucun chiffre. Si votre charge de travail est réellement à contexte long, cette absence est le fait décisif, et non le chiffre de 1M partagé.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview — the scoreboard'. Claude Haiku 5.5 reads price $0.10 / $0.50 per million, 1M-token context, 128K max output, text and image input, AA Index 43, billed per token; MiniMax M3.1 Flash Preview reads price not published, 1M-token context, max output not published, text image and video input, no published independent score, billed by subscription plan. A footer notes the Claude figures are per Artificial Analysis and the MiniMax figures are vendor-reported with no independent evaluation.

Si ce que vous voulez réellement, c’est MiniMax M3

MiniMax M3.1 Flash Preview est une préversion, réservée à un forfait et non notée. MiniMax M3 n'est rien de tout cela. Il s'agit du modèle phare à poids ouverts que MiniMax a publié le 31 mai 2026 : une fenêtre de contexte de 1 M de tokens, une multimodalité native qui prend en entrée du texte, des images et de la vidéo et renvoie du texte, une architecture reposant sur MiniMax Sparse Attention, et un prix de 0,30 $ par million de tokens en entrée et 1,20 $ par million de tokens en sortie. Artificial Analysis lui attribue un score de 29 à l'Intelligence Index, avec un coût par tâche d'indice de 0,51 $, 91,7 tokens par seconde en sortie et un temps jusqu'au premier token de 2,16 secondes, ainsi qu'une remise de 80 % sur le cache. Il figure aujourd'hui au catalogue d'OrcaRouter sous minimax/minimax-m3.

Ce qui met en évidence un point concret au sujet de cette confrontation que dissimule une fiche technique. Le modèle MiniMax que l’on peut réellement acheter au token a une génération de retard sur la preview, obtient un score de 29 sur l’indice indépendant, contre 43 pour Claude Haiku 5.5, coûte environ deux fois plus cher par tâche terminée, à 0,51 $ contre 0,21 $, et son débit de sortie est environ trois fois inférieur. La preview pourrait bien surpasser tout cela. Personne en dehors de MiniMax ne le sait, et il n’y a aucun moyen de le découvrir depuis une page d’abonnement.

A capture of the OrcaRouter model page for minimax/minimax-m3 showing the MiniMax M3 listing with its Vision, Tools, JSON and Reasoning capability badges, the MiniMax byline and May 31, 2026 date, the 1M-token context description, the $0.30 and $1.20 per-million pricing and the Get the MiniMax M3 API call to action.

Appeler ces deux depuis un seul endroit

MiniMax M3.1 Flash Preview est disponible via le Token Plan et MiniMax Code de MiniMax. Claude Haiku 5.5 est disponible via l'API propre à Anthropic et, à partir de là, partout où les modèles Anthropic sont revendus. Ni l'un ni l'autre ne figure au catalogue d'OrcaRouter — ce que nous routons à partir de cette paire, c'est minimax/minimax-m3, aux côtés de anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 et anthropic/claude-fable-5.1, et nous ne laisserons pas entendre que nous proposons les deux modèles dont traite cet article.

Ce que la couche de routage offre véritablement ici, c'est une échappatoire au problème des deux formes de facturation. minimax/minimax-m3est facturé à l'usage et figure dans notre catalogue ; Claude Haiku 5.5 est facturé à l'usage et figure dans celui d'Anthropic. Les deux exposent une interface compatible OpenAI, si bien que le test A/B entre eux se résume à une chaîne de modèle plutôt qu'à une réécriture, et OrcaRouter répercute le prix catalogue du fournisseur avec 0 % de marge, ce qui signifie qu'un changement de tarif MiniMax atteint votre facture le jour même. Le modèle Token Plan est le seul élément qui ne peut pas être normalisé de cette façon — un abonnement n'a aucun prix par token à répercuter, ce qui revient au même problème énoncé du côté de la facturation.

Comment décider sans score

Si vous avez besoin d'une entrée vidéo, MiniMax M3.1 Flash Preview est le seul des deux à l'accepter, et si votre charge de travail est interactive plutôt que programmatique, le Token Plan est un achat raisonnable. Si vous avez besoin d'un chiffre à mettre dans un budget, d'un score à vérifier et d'une fenêtre à tarifer, Claude Haiku 5.5 est le seul des deux à proposer ne serait-ce qu'un de ces éléments. Et si vous voulez la famille MiniMax sur une API à facturation à l'usage avec un score indépendant associé, la recommandation honnête est d'utiliser la génération réellement achetable au token plutôt que d'attendre un aperçu dont les conditions n'ont pas été publiées.

Les deux exposent une interface compatible OpenAI, si bien que le test A/B entre eux se résume à une chaîne de modèle plutôt qu'à une réécriture, et OrcaRouter répercute le prix catalogue du fournisseur avec 0 % de marge, ce qui signifie qu'une modification du prix MiniMax se répercute sur votre facture le jour même.