Une carte de titre principale générée affichant « LongCat-2.5-Preview vs MiniMax M3 », avec le surtitre « La place à bas prix est déjà prise », et deux panneaux : « LongCat-2.5-Preview : 0,30 $ / 1,20 $ pour 1 M, 131 072 de sortie max » et « MiniMax M3 : 0,30 $ / 1,20 $ pour 1 M, 512 000 de sortie max ». Logo OrcaRouter en bas à droite.
Guides & Insights

LongCat-2.5-Preview vs MiniMax M3 : la place à bas prix est déjà prise

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le postulat de la plupart des articles consacrés à LongCat-2.5-Preview est que Meituan a cassé les prix du secteur. Face à MiniMax M3, ce postulat s'évapore au contact. MiniMax M3 est affiché à 0,30 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie dans notre catalogue. La grille tarifaire publiée de LongCat-2.5-Preview est de 0,30 $ par million de tokens d'entrée non mis en cache et 1,20 $ par million de tokens de sortie. Ce ne sont pas des chiffres similaires ; ce sont les mêmes chiffres. Le seul point où ils divergent est l'entrée mise en cache, où Meituan annonce 0,006 $ par million contre 0,06 $ pour le modèle en place — un écart de dix pour un sur la ligne la moins chère de la facture. La question intéressante n'est donc pas de savoir si LongCat-2.5-Preview est bon marché. C'est ce que vous achetez et ce à quoi vous renoncez lorsqu'un nouveau modèle arrive exactement au prix du modèle en place.

La réponse courte : un plafond de sortie beaucoup plus élevé, une base de preuves beaucoup plus mince et une remise de cache.

Même prix d’appel, des plafonds publiés très différents

MiniMax M3 est répertorié depuis le 31 mai 2026. Notre catalogue le propose avec une fenêtre de contexte de 1 048 576 jetons et une sortie maximale de 512 000 jetons — plus que ce que la plupart des modèles autorisent, et quatre fois les 131 072 de LongCat-2.5-Preview. Il accepte en entrée du texte, des images et de la vidéo et renvoie du texte, avec appel d'outils, mode JSON et raisonnement exposés.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview, référencé sur la plateforme API LongCat de Meituan le 25 septembre 2026, affiche un contexte de 1 000 000 de tokens et reste très en deçà en sortie, avec 131 072. C'est son profil d'entrée qui est la vraie question : le journal des modifications présente la compréhension d'images comme son ajout phare, mais l'exemple de réponse dans la documentation « Retrieve Model » de Meituan montre toujours input_modalities/ comme ["text"]/ avec une text->text/ chaîne de modalité. MiniMax M3 accepte aussi la vidéo, ce que LongCat-2.5-Preview ne revendique pas du tout. Si votre pipeline alimente des enregistrements d'écran ou des séquences d'images, cette comparaison s'arrête ici.

L’asymétrie de cache joue dans l’autre sens et mérite d’être soulignée à l’avantage de Meituan, car c’est la seule dimension où le nouveau modèle se différencie véritablement. $0.006 par million d’entrées mises en cache contre $0.06 constitue un véritable avantage pour les charges de travail d’agents qui renvoient le même long préfixe à chaque tour — ce qui est le cas de la plupart d’entre elles. C’est aussi le poste le plus susceptible de changer sans préavis, puisque Meituan présente l’ensemble de la fiche tarifaire comme une remise à durée limitée.

L’écart de preuves, mesuré honnêtement dans les deux sens

La position de MiniMax M3 dans les benchmarks n'est pas solide, et le dire fait partie d'une comparaison menée correctement. Artificial Analysis lui attribue un Coding Index de 58,6 — quarante-sixième des modèles suivis — et un Intelligence Index de 29,2, au soixantième rang. GPQA Diamond 92,9 %, Humanity's Last Exam 39 %, SciCode 47,1 %, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Les chiffres publiés par MiniMax lui-même portent sur un tout autre terrain : BrowseComp 83,5, GDPval rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Ce sont des chiffres déclarés par le fournisseur, qui appartiennent à une autre colonne que les chiffres indépendants, mais ils existent, et c'est là le mot qui compte.

A screenshot of OrcaRouter's own model page for MiniMax M3 at /models/minimax/minimax-m3, showing the minimax/minimax-m3 identifier, a 1M-token context window, 512K maximum output, text + image + video input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-05-31, a p50 first-token figure of 3.35 s, $0.30 and $1.20 rate tiles, and the OpenAI-compatible code samples.

LongCat-2.5-Preview n'a aucune colonne du tout. Aucune table de référence publiée, aucune fiche modèle, aucun rapport technique, aucun dépôt sur HuggingFace ni dans l'organisation GitHub de Meituan, et des métadonnées de catalogue indiquant les poids ouverts comme faux. Le nombre de paramètres d'environ 1,6 billion au total / 48 milliards actifs est rapporté d'après les métadonnées du site de Meituan et la couverture commerciale chinoise, plutôt que d'après la documentation. Ainsi, l'affirmation exacte est la suivante : les scores de M3 sont médiocres et proviennent de sources indépendantes ; ceux de LongCat-2.5-Preview sont absents. Un modèle qui obtient un score dans les quarante sur l'indice de codage est une valeur connue sur laquelle on peut planifier. Un modèle sans score représente un autre type de risque, et le fait que le prix soit identique supprime la compensation qui justifie habituellement de le choisir.

Là où le même prix change ce que vous devriez faire

Quand un nouveau modèle casse les prix du marché, la démarche rationnelle consiste à l’évaluer — le gain potentiel est une remise réelle. Quand un nouveau modèle arrive exactement au même prix qu’un acteur en place commercialisé depuis mai, le gain potentiel n’est pas le prix. C’est la capacité, et la capacité est la seule chose que LongCat-2.5-Preview n’a pas publiée. Cela reconfigure entièrement l’évaluation : vous ne testez pas s’il est moins cher, vous testez s’il est meilleur, sur vos tâches, en partant de zéro, sans aucune preuve sur laquelle vous appuyer.

Il y a un détail de second ordre qui rend ce test moins cher qu'il n'y paraît. LongCat-2.5-Preview est gratuit et illimité via OpenCode pour une fenêtre de durée non précisée, avec une politique de rétention zéro qu'OpenCode documente explicitement — entraînement du modèle « Non utilisé », rétention des données « 0 jour », contre trente jours pour la fiche comparative. Ainsi, le coût de génération de votre propre évaluation est proche de zéro, et la politique de rétention signifie que vous pouvez l'exécuter sur du code privé. Le seul détail de harnais à régler en premier est que le modèle renvoie sa trace de raisonnement dans un champ entrelacé reasoning_content/ ; les clients qui analysent les complétions de chat sans s'y attendre supprimeront silencieusement la réflexion et feront paraître le modèle moins bon qu'il ne l'est.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs MiniMax M3' with the subhead 'Identical headline rates, four times the output ceiling, ten times the cache discount'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'MiniMax M3' (MiniMax, released 2026-05-31, independently scored): 1,048,576-token context, 512,000 max output described as four times as much, text, image and video to text, $0.30 uncached / $0.06 cached input, $1.20 output, coding index 58.6 at rank 46 and intelligence index 29.2 at rank 60 by Artificial Analysis, long-context recall 83. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

L’argument de routage, spécifique à une comparaison à prix identique

Nous proposons MiniMax M3 auprix catalogue de MiniMax, sans aucune marge. LongCat-2.5-Preview ne fait pas partie de nos routes — nous ne le proposons pas, et rien ici ne doit être interprété comme affirmant le contraire.

Un face-à-face à prix égal est exactement le cas où le routage justifie sa place plutôt que de n'être qu'un simple confort. Si deux modèles coûtent le même prix, le choix entre eux se fait requête par requête et tâche par tâche : M3 pour le plafond de sortie de 512 000 tokens et l'entrée vidéo, LongCat-2.5-Preview pour la remise sur préfixe en cache dans les longues boucles d'agents, une fois que vous vous êtes convaincu de sa qualité. La fusion de modèles est le mécanisme qui rend cela littéral — une passe de récupération et une étape de synthèse peuvent être deux modèles différents sur une même requête, vous n'êtes donc pas obligé de désigner un vainqueur avant d'avoir des preuves. Et comme nous répercutons les prix catalogue des fournisseurs sans marge, un changement de tarif d'un fournisseur apparaît sur votre facture le jour même, plutôt qu'à la prochaine renégociation de contrat, ce qui compte plus que d'ordinaire quand l'une des deux cartes est explicitement promotionnelle. Le basculement automatique, lui, couvre le cas où un fournisseur se dégrade, et c'est pour le modèle dont aucun historique de service ne peut être examiné que cela compte le plus.

Fréquemment demandé

• LongCat-2.5-Preview est-il moins cher que MiniMax M3 ? Non. Sur les fiches tarifaires publiées, les tarifs d’entrée et de sortie sont identiques, à 0,30 $ et 1,20 $ par million. Le seul avantage tarifaire concerne l’entrée mise en cache, 0,006 $ contre 0,06 $, et Meituan qualifie l’ensemble de sa fiche de remise à durée limitée sans préciser ce qui suivra.

• Lequel offre la plus grande sortie utilisable ? MiniMax M3, et de loin : 512 000 tokens contre 131 072. Pour la génération de textes longs, l’extraction structurée sur de grands documents, ou tout ce qui produit plus qu’un chapitre, ce plafond est la caractéristique décisive.

• Lequel puis-je vérifier ? MiniMax M3, et la vérification ne le flatte pas — Coding 58,6 à la quarante-sixième place et un Intelligence Index de 29,2 à la soixantième place d'après Artificial Analysis. LongCat-2.5-Preview n'a aucune évaluation publiée par quiconque. Si un benchmark de LongCat-2.5-Preview apparaît cette semaine, considérez-le comme non vérifiable jusqu'à ce que vous puissiez le relier à un évaluateur nommé.

• Lequel dois-je mettre en production ? Aucun des deux sans un test de votre part. Entre les deux, M3 est le choix à la variance la plus faible, car ses faiblesses sont documentées et ses modalités d’entrée sont confirmées ; LongCat-2.5-Preview est celui à la variance la plus élevée, avec une fenêtre de contexte annoncée plus grande, un plafond de sortie bien plus faible, une remise sur le cache et aucune preuve publique. Utilisez-le gratuitement tant que la fenêtre est ouverte, gardez les deux derrière une seule clé, et laissez vos propres chiffres trancher.