Carte de titre comparant Step 5 Preview et MiniMax M3 sur le coût par tâche de l'Artificial Analysis Intelligence Index, indiquant 0,71 $ à un indice de 44 pour Step 5 Preview et 0,51 $ à un indice de 29 pour MiniMax M3.
Guides & Insights

Step 5 Preview vs MiniMax M3 : moins cher par token, plus cher par point

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le prix unitaire favorise largement MiniMax M3. À 0,30 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie, le modèle sparse 428B de l'éditeur sous-cote de plus d'un facteur deux les 1,00 $ et 2,70 $ de Step 5 Preview, et ce des deux côtés. Mais le prix unitaire est le mauvais dénominateur pour un modèle que l'on utilise pour répondre à des questions, et dès que l'on divise par ce que chaque modèle délivre réellement, le classement s'inverse. Step 5 Preview coûte 0,71 $ par tâche de l'Intelligence Index pour un score de 44. MiniMax M3 coûte 0,51 $ par tâche d'index pour un score de 29. Par point de capacité mesurée, le modèle au prix affiché le plus élevé est le moins cher — et la raison en est un écart de quinze points dans l'index qu'aucune remise ne peut combler.

Deux types très différents de « disponible »

MiniMax M3 est en disponibilité générale depuis le 1er juin 2026, date à laquelle MiniMax l'a ouvert via MiniMax Code, son Token Plan et l'API — aucune mention d'aperçu nulle part au lancement. Les poids ont suivi le 12 juin, onze jours plus tard, comme promis. Le dépôt MiniMaxAI/MiniMax-M3 comporte environ 428 milliards de paramètres au total, avec environ 23 milliards actifs par token, construit sur MiniMax Sparse Attention, aux côtés d'une version quantifiée MXFP8 distincte.

Step 5 Preview a ouvert son API le 20 septembre 2026. Ses poids n'ont pas été publiés — le dépôt Hugging Face stepfun-ai/Step-5-Preview-BF16 est une coquille vide — et StepFun s'est engagé sur une date du 15 octobre 2026. La différence pratique est donc que M3 est un modèle que l'on peut télécharger, auto-héberger et inspecter, tandis que Step 5 Preview est un point de terminaison hébergé assorti d'une intention publiée.

À signaler : la propre page de modèle de MiniMax indique encore que M3 « sera bientôt entièrement open source », ce qui contredit le dépôt qu’elle a publié en juin. Considérez cela comme une page fournisseur obsolète plutôt que comme une preuve que les poids sont manquants.

L’histoire du prix n’est pas l’histoire du coût

Artificial Analysis calcule un chiffre de coût par tâche de l’indice en exécutant le même ensemble d’évaluations sur chaque modèle et en totalisant ce que coûtent les tokens. C’est ce que le domaine a de plus proche d’un chiffre de coût total de possession pour une quantité de travail fixe, et cela intègre les deux effets que les prix des tokens masquent : le degré de verbosité d’un modèle et l’ampleur de sa réflexion.

Step 5 Preview revient à 0,71 $ par tâche d'index, pour un coût total d'exécution d'index de 922,84 $. MiniMax M3 revient à 0,51 $, pour un coût total d'exécution de 537,98 $. En termes de débit brut de tâches, M3 est environ 28 % moins cher. Divisez par le score d'index — 44 contre 29 — et Step 5 Preview ressort à environ 1,6 cent par point d'index contre 1,8 cent pour M3.

Une mise en garde s'impose ici : il s'agit d'une seule exécution d'index par modèle, et une exécution d'index ne constitue qu'un petit échantillon. L'arithmétique point par point sert de contrôle de cohérence du chiffre par tâche, et non de référence à part entière. Mais la tendance concorde avec les chiffres par tâche, et ce sont là des chiffres que les grilles tarifaires respectives des deux fournisseurs ne peuvent pas montrer.

Intelligence Index — Step 5 Preview 44 (#24 sur 200) vs MiniMax M3 29 (#15 sur 113), tous deux sur la version actuelle de l'index

Prix des entrées — 1,00 $ par million contre 0,30 $ par million

Prix de sortie — 2,70 $ par million contre 1,20 $ par million

Coût par tâche d'indexation — 0,71 $ vs 0,51 $

Paramètres actifs — 27B vs 23B

Fenêtre de contexte — 1M tokens vs 1M tokens

Vitesse de sortie — 99,8 tokens/s vs 210,4 tokens/s

Poids — annoncés pour le 15 octobre 2026 vs disponibles depuis le 12 juin 2026

A comparison scoreboard for Step 5 Preview and MiniMax M3 covering Intelligence Index, output price, cost per index task, output speed, weight availability, and licensing terms.

Le piège de la version d’index qui rend cela confus

Il y a un véritable danger à lire les chiffres de M3, et cela mérite un paragraphe car cela trompe presque toutes les pages de comparaison tierces. Artificial Analysis a recalibré son Intelligence Index le 7 septembre 2026, et le recalibrage a comprimé les scores partout. À l'échelle actuelle, M3 mesure 29. À l'échelle d'avant septembre, il mesurait 44 à 45 — et un certain nombre de trackers publient encore 44,4 ou 45,4 pour lui.

Cette collision compte plus que d'habitude ici, car le score actuel de Step 5 Preview est lui aussi de 44. Une page qui place un chiffre M3 obsolète à côté d'un chiffre actuel de Step 5 Preview donne l'impression que deux modèles sont à égalité, alors que l'écart actuel est de quinze points. Les deux chiffres de cet article proviennent de la version actuelle de l'index et sont comparables entre eux ; tout ce qui a été publié avant le 7 septembre ne l'est pas.

Là où MiniMax M3 est vraiment difficile à battre

Deux choses concernant M3 ne sont pas proches. La première est la vitesse : 210,4 jetons de sortie par seconde, quatrième plus rapide des 113 modèles suivis par Artificial Analysis, contre une médiane de 76,3. Les 99,8 jetons par seconde de Step 5 Preview sont respectables et représentent moins de la moitié de ce chiffre. Le temps jusqu'au premier jeton de M3, de 1,01 seconde, est lui aussi le chiffre le plus rapide, contre 2,96 secondes.

Le second est la modalité d’entrée. M3 accepte le texte, les images et la vidéo et renvoie du texte, et MiniMax documente le fonctionnement sur poste de travail et l’utilisation de l’ordinateur. L’étape 5 Preview prend en entrée du texte et des images. Si votre pipeline injecte des enregistrements d’écran ou des images vidéo dans un modèle, ce n’est pas une préférence — c’est une différence de capacité.

L’écart de prix renforce les deux. À 0,30 $ et 1,20 $ avec une remise permanente de 50 % appliquée à des tarifs catalogue de 0,60 $ et 2,40 $, et une remise de 80 % sur le cache qui ramène les lectures en cache à 0,06 $ par million, M3 est l’un des moyens les moins chers de faire transiter un grand volume de tokens par un modèle performant. À noter la tarification par paliers : une entrée supérieure à 512 K tokens double l’ensemble de la requête, et le niveau de service prioritaire coûte 1,5×.

Là où ça se défait

Le propre ensemble d’évaluation de MiniMax pour M3 est solide et doit être interprété comme déclaré par le fournisseur : SWE-bench Verified à 80,5 %, SWE-bench Pro à 59,0 %, Terminal-Bench 2.1 à 66,0 %, MCP Atlas à 74,2 %, BrowseComp à 83,5 et OSWorld-Verified à 70,06 %. MiniMax les a exécutés sur sa propre infrastructure en utilisant Claude Code comme échafaudage, avec une moyenne sur quatre exécutions, et la configuration de notation n’est pas publique — ils ne sont donc pas reproductibles par un tiers en l’état.

L'image obtenue par des mesures indépendantes est bien plus sévère pour le travail agentique. Artificial Analysis a enregistré Terminal-Bench 4.0 à 2 % pour M3 — une version différente du benchmark par rapport au chiffre Terminal-Bench 2.1 du fournisseur, et non comparable à celui-ci, mais tout de même frappant. SciCode a atteint 47 %, AutomationBench-AA 21 %, et CritPt 4 %. Les résultats indépendants les plus solides de M3 portent sur les contextes longs et le travail intellectuel : AA-LCR v1.1 à 83 %, Humanity's Last Exam à 39 %.

Step 5 Preview inverse ce profil. Terminal-Bench 4.0 à 33,3 % sur le même harnais que les 2 % de M3, SciCode à 59 % contre 47 %. Si le travail est agentique ou de nature logicielle, la comparaison n’est pas serrée et l’avantage de prix ne le compense pas.

The Hugging Face repository page for stepfun-ai Step-5-Preview-BF16, showing an empty repository with no model card and no files, indicating the weights have not been published.

La clause de licence que la plupart des comparaisons omettent

MiniMax M3 est à poids ouverts, mais il n'est pas open source au sens de l'OSI, et les conditions sont plus strictes que ne le suggère l'expression « poids ouverts ». Le dépôt porte la licence communautaire MiniMax : gratuit pour un usage non commercial, l'usage commercial étant subordonné à l'affichage bien visible de « Built with MiniMax M3 » — et tout produit dont le chiffre d'affaires annuel dépasse 20 millions USD doit obtenir l'autorisation écrite préalable de MiniMax. Ce n'est ni MIT, ni Apache, et ce n'est pas le genre de licence qu'une équipe juridique valide sans broncher.

Step 5 Preview ne peut absolument pas encore être évalué sur cet axe, car il n’y a aucune licence à lire. StepFun s’est engagé à publier les poids le 15 octobre et n’a pas publié les conditions qui l’encadreront. Quiconque envisage de s’appuyer dessus devrait considérer la licence comme une question ouverte plutôt que de supposer qu’elle ressemblera à celle de Moonshot ou de DeepSeek.

C’est là l’asymétrie honnête entre les deux : les conditions de M3 sont restrictives mais connues ; celles de Step 5 Preview sont inconnues. Une licence restrictive que l’on peut anticiper vaut mieux qu’une licence non annoncée que l’on ne peut pas anticiper.

Appeler l'un ou l'autre d'entre eux

MiniMax M3 figure dans notre catalogue, à l'adresse /models/minimax/minimax-m3, accessible avec la même clé et la même structure de requête que le reste des plus de 200 modèles que nous routons, avec le prix catalogue du fournisseur répercuté à 0 % de marge — le rabais permanent de 50 % appliqué par MiniMax est donc le prix que vous voyez, et il change le jour où MiniMax le change. Le basculement automatique en cas d'échec est l'autre volet de cet engagement : avec ses 210 jetons par seconde, M3 est attrayant pour les gros volumes de travail, et les gros volumes de travail sont précisément le cas où un seul point de terminaison dégradé fait le plus de dégâts.

Step 5 Preview ne figure pas dans notre catalogue. Les modèles de texte de StepFun ne font pas partie de ceux que nous proposons, il est donc disponible via l’API propre à StepFun et plusieurs plateformes tierces — et il n’est pas accessible avec la clé que vous utiliseriez pour M3.

OrcaRouter model page for MiniMax M3, showing the model in the catalogue with its provider, context window and per-million-token pricing.

Le verdict

Choisissez MiniMax M3 lorsque le volume, la latence ou l’entrée vidéo sont la contrainte, lorsque vous voulez un modèle que vous pouvez télécharger dès aujourd’hui, et lorsque vous pouvez vivre dans le cadre de la licence communautaire — y compris le seuil de revenus de 20 millions de dollars. Acceptez que les scores agentiques indépendants le placent loin derrière, et que ses benchmarks de fournisseur n’ont pas été reproduits en dehors de l’infrastructure propre de MiniMax.

Prenez Step 5 Preview lorsque le travail est agentique ou très orienté code, lorsque vous voulez la capacité par dollar plutôt que le token par dollar, et lorsque cela ne vous dérange pas d’être un client précoce d’un endpoint hébergé dont les poids arrivent le mois prochain. Acceptez de ne pas pouvoir vérifier la licence avant de construire, et qu’un écart de 2 % contre 33,3 % sur Terminal-Bench 4.0 soit le genre d’écart qui décide d’un projet.

La remise est réelle. Ce n’est simplement pas ce qui est acheté.

MiniMax M3 est l'un des modèles que nous acheminons à 0 % de marge avec basculement automatique, de sorte qu'un changement de prix de fournisseur est effectif sur la même clé le jour même.