
LongCat-2.5-Preview vs MiniMax M3 : la place à bas prix est déjà prise
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 610 tok/s
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 189 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
Le postulat de la plupart des articles consacrés à LongCat-2.5-Preview est que Meituan a cassé les prix du secteur. Face à MiniMax M3, ce postulat s'évapore au contact. MiniMax M3 est affiché à 0,30 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie dans notre catalogue. La grille tarifaire publiée de LongCat-2.5-Preview est de 0,30 $ par million de tokens d'entrée non mis en cache et 1,20 $ par million de tokens de sortie. Ce ne sont pas des chiffres similaires ; ce sont les mêmes chiffres. Le seul point où ils divergent est l'entrée mise en cache, où Meituan annonce 0,006 $ par million contre 0,06 $ pour le modèle en place — un écart de dix pour un sur la ligne la moins chère de la facture. La question intéressante n'est donc pas de savoir si LongCat-2.5-Preview est bon marché. C'est ce que vous achetez et ce à quoi vous renoncez lorsqu'un nouveau modèle arrive exactement au prix du modèle en place.
La réponse courte : un plafond de sortie beaucoup plus élevé, une base de preuves beaucoup plus mince et une remise de cache.
Même prix d’appel, des plafonds publiés très différents
MiniMax M3 est répertorié depuis le 31 mai 2026. Notre catalogue le propose avec une fenêtre de contexte de 1 048 576 jetons et une sortie maximale de 512 000 jetons — plus que ce que la plupart des modèles autorisent, et quatre fois les 131 072 de LongCat-2.5-Preview. Il accepte en entrée du texte, des images et de la vidéo et renvoie du texte, avec appel d'outils, mode JSON et raisonnement exposés.

LongCat-2.5-Preview, référencé sur la plateforme API LongCat de Meituan le 25 septembre 2026, affiche un contexte de 1 000 000 de tokens et reste très en deçà en sortie, avec 131 072. C'est son profil d'entrée qui est la vraie question : le journal des modifications présente la compréhension d'images comme son ajout phare, mais l'exemple de réponse dans la documentation « Retrieve Model » de Meituan montre toujours input_modalities/ comme ["text"]/ avec une text->text/ chaîne de modalité. MiniMax M3 accepte aussi la vidéo, ce que LongCat-2.5-Preview ne revendique pas du tout. Si votre pipeline alimente des enregistrements d'écran ou des séquences d'images, cette comparaison s'arrête ici.
L’asymétrie de cache joue dans l’autre sens et mérite d’être soulignée à l’avantage de Meituan, car c’est la seule dimension où le nouveau modèle se différencie véritablement. $0.006 par million d’entrées mises en cache contre $0.06 constitue un véritable avantage pour les charges de travail d’agents qui renvoient le même long préfixe à chaque tour — ce qui est le cas de la plupart d’entre elles. C’est aussi le poste le plus susceptible de changer sans préavis, puisque Meituan présente l’ensemble de la fiche tarifaire comme une remise à durée limitée.
L’écart de preuves, mesuré honnêtement dans les deux sens
La position de MiniMax M3 dans les benchmarks n'est pas solide, et le dire fait partie d'une comparaison menée correctement. Artificial Analysis lui attribue un Coding Index de 58,6 — quarante-sixième des modèles suivis — et un Intelligence Index de 29,2, au soixantième rang. GPQA Diamond 92,9 %, Humanity's Last Exam 39 %, SciCode 47,1 %, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Les chiffres publiés par MiniMax lui-même portent sur un tout autre terrain : BrowseComp 83,5, GDPval rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Ce sont des chiffres déclarés par le fournisseur, qui appartiennent à une autre colonne que les chiffres indépendants, mais ils existent, et c'est là le mot qui compte.

LongCat-2.5-Preview n'a aucune colonne du tout. Aucune table de référence publiée, aucune fiche modèle, aucun rapport technique, aucun dépôt sur HuggingFace ni dans l'organisation GitHub de Meituan, et des métadonnées de catalogue indiquant les poids ouverts comme faux. Le nombre de paramètres d'environ 1,6 billion au total / 48 milliards actifs est rapporté d'après les métadonnées du site de Meituan et la couverture commerciale chinoise, plutôt que d'après la documentation. Ainsi, l'affirmation exacte est la suivante : les scores de M3 sont médiocres et proviennent de sources indépendantes ; ceux de LongCat-2.5-Preview sont absents. Un modèle qui obtient un score dans les quarante sur l'indice de codage est une valeur connue sur laquelle on peut planifier. Un modèle sans score représente un autre type de risque, et le fait que le prix soit identique supprime la compensation qui justifie habituellement de le choisir.
Là où le même prix change ce que vous devriez faire
Quand un nouveau modèle casse les prix du marché, la démarche rationnelle consiste à l’évaluer — le gain potentiel est une remise réelle. Quand un nouveau modèle arrive exactement au même prix qu’un acteur en place commercialisé depuis mai, le gain potentiel n’est pas le prix. C’est la capacité, et la capacité est la seule chose que LongCat-2.5-Preview n’a pas publiée. Cela reconfigure entièrement l’évaluation : vous ne testez pas s’il est moins cher, vous testez s’il est meilleur, sur vos tâches, en partant de zéro, sans aucune preuve sur laquelle vous appuyer.
Il y a un détail de second ordre qui rend ce test moins cher qu'il n'y paraît. LongCat-2.5-Preview est gratuit et illimité via OpenCode pour une fenêtre de durée non précisée, avec une politique de rétention zéro qu'OpenCode documente explicitement — entraînement du modèle « Non utilisé », rétention des données « 0 jour », contre trente jours pour la fiche comparative. Ainsi, le coût de génération de votre propre évaluation est proche de zéro, et la politique de rétention signifie que vous pouvez l'exécuter sur du code privé. Le seul détail de harnais à régler en premier est que le modèle renvoie sa trace de raisonnement dans un champ entrelacé reasoning_content/ ; les clients qui analysent les complétions de chat sans s'y attendre supprimeront silencieusement la réflexion et feront paraître le modèle moins bon qu'il ne l'est.

L’argument de routage, spécifique à une comparaison à prix identique
Nous proposons MiniMax M3 auprix catalogue de MiniMax, sans aucune marge. LongCat-2.5-Preview ne fait pas partie de nos routes — nous ne le proposons pas, et rien ici ne doit être interprété comme affirmant le contraire.
Un face-à-face à prix égal est exactement le cas où le routage justifie sa place plutôt que de n'être qu'un simple confort. Si deux modèles coûtent le même prix, le choix entre eux se fait requête par requête et tâche par tâche : M3 pour le plafond de sortie de 512 000 tokens et l'entrée vidéo, LongCat-2.5-Preview pour la remise sur préfixe en cache dans les longues boucles d'agents, une fois que vous vous êtes convaincu de sa qualité. La fusion de modèles est le mécanisme qui rend cela littéral — une passe de récupération et une étape de synthèse peuvent être deux modèles différents sur une même requête, vous n'êtes donc pas obligé de désigner un vainqueur avant d'avoir des preuves. Et comme nous répercutons les prix catalogue des fournisseurs sans marge, un changement de tarif d'un fournisseur apparaît sur votre facture le jour même, plutôt qu'à la prochaine renégociation de contrat, ce qui compte plus que d'ordinaire quand l'une des deux cartes est explicitement promotionnelle. Le basculement automatique, lui, couvre le cas où un fournisseur se dégrade, et c'est pour le modèle dont aucun historique de service ne peut être examiné que cela compte le plus.
Fréquemment demandé
• LongCat-2.5-Preview est-il moins cher que MiniMax M3 ? Non. Sur les fiches tarifaires publiées, les tarifs d’entrée et de sortie sont identiques, à 0,30 $ et 1,20 $ par million. Le seul avantage tarifaire concerne l’entrée mise en cache, 0,006 $ contre 0,06 $, et Meituan qualifie l’ensemble de sa fiche de remise à durée limitée sans préciser ce qui suivra.
• Lequel offre la plus grande sortie utilisable ? MiniMax M3, et de loin : 512 000 tokens contre 131 072. Pour la génération de textes longs, l’extraction structurée sur de grands documents, ou tout ce qui produit plus qu’un chapitre, ce plafond est la caractéristique décisive.
• Lequel puis-je vérifier ? MiniMax M3, et la vérification ne le flatte pas — Coding 58,6 à la quarante-sixième place et un Intelligence Index de 29,2 à la soixantième place d'après Artificial Analysis. LongCat-2.5-Preview n'a aucune évaluation publiée par quiconque. Si un benchmark de LongCat-2.5-Preview apparaît cette semaine, considérez-le comme non vérifiable jusqu'à ce que vous puissiez le relier à un évaluateur nommé.
• Lequel dois-je mettre en production ? Aucun des deux sans un test de votre part. Entre les deux, M3 est le choix à la variance la plus faible, car ses faiblesses sont documentées et ses modalités d’entrée sont confirmées ; LongCat-2.5-Preview est celui à la variance la plus élevée, avec une fenêtre de contexte annoncée plus grande, un plafond de sortie bien plus faible, une remise sur le cache et aucune preuve publique. Utilisez-le gratuitement tant que la fenêtre est ouverte, gardez les deux derrière une seule clé, et laissez vos propres chiffres trancher.
