Une carte de titre principale générée indiquant « LongCat-2.5-Preview vs GPT-5.6 Sol », avec le surtitre « Une fenêtre de 1M dont le coût reste identique de bout en bout », et deux panneaux : « LongCat-2.5-Preview : 0,30 $ / 1,20 $ par 1M, 131 072 en sortie max » et « GPT-5.6 Sol : 4,00 $ / 20,00 $ par 1M, double au-delà de 272K en entrée ». Logo OrcaRouter en bas à droite.
Engineering & Research

LongCat-2.5-Preview vs GPT-5.6 Sol : ce que coûte une fenêtre de 1 M de tokens de chaque côté

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

La chose la plus utile que l’on puisse dire à propos de LongCat-2.5-Preview face à GPT-5.6 Sol n’est pas de savoir lequel est le plus intelligent. C’est que tous deux annoncent une fenêtre de contexte d’environ un million de jetons, et que seul l’un des deux facture le même tarif pour toute la fenêtre. Le prix de Sol double au-delà de 272 000 jetons d’entrée. La grille tarifaire publiée de LongCat-2.5-Preview, du moins telle que Meituan la consigne, ne comporte aucun palier. Cette seule différence structurelle détermine la plupart des charges de travail réelles sur documents longs avant même que l’on consulte un benchmark — et c’est le genre de chose qu’une comparaison de fiches techniques ne vous montrera jamais, parce que les deux modèles affichent « 1M » dans la même taille de police.

Voici ce qui figure réellement au dossier pour chacun, organisé en fonction des questions qui méritent d’être posées.

La fenêtre d'un million de tokens correspond-elle au même produit des deux côtés ?

Non, et la différence n’est pas la fenêtre — c’est ce qui se produit lorsque vous la remplissez. Notre catalogue propose Sol avec une fenêtre de contexte de 1 050 000 jetons et une sortie maximale de 128 000 jetons, à 4,00 $ par million de jetons d’entrée et 20,00 $ par million de jetons de sortie pour les requêtes allant jusqu’à 272 000 jetons, l’entrée mise en cache étant à 0,40 $ par million et les écritures dans le cache à 5,00 $ par million. Au-delà de ce seuil, les tarifs passent à 8,00 $ et 30,00 $ par million. Ainsi, une passe de document de 500 000 jetons sur Sol est facturée au tarif de contexte long pour l’ensemble de la requête, et non à un tarif mixte.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview affiche 1 000 000 de tokens de contexte et 131 072 tokens de sortie maximale. Sa grille tarifaire, publiée sur la propre plateforme de Meituan et signalée comme une remise à durée limitée, est de 0,30 $ par million de tokens d'entrée non mis en cache, 0,006 $ par million de tokens d'entrée mis en cache et 1,20 $ par million de tokens de sortie. Meituan ne publie aucun second palier. Cela ne revient pas à dire qu'il n'en existe aucun — cela signifie que le fournisseur n'en a pas décrit, et un prix qui n'est pas décrit n'est pas un prix sur lequel on peut établir un budget.

Mettons un chiffre dessus. Une lecture de 500 000 jetons qui réécrit 20 000 jetons coûte environ 4,60 $ sur Sol au palier de contexte long, et environ 17 cents sur LongCat-2.5-Preview à son tarif promotionnel publié. Ces deux chiffres relèvent de l’arithmétique sur des grilles tarifaires publiées, pas de mesures. Le rapport est suffisamment élevé pour changer ce qu’il est économiquement raisonnable de tenter : aux tarifs de contexte long de Sol, injecter une base de code dans un modèle est une décision ; à ceux de LongCat, c’est plutôt une option par défaut.

Laquelle a des preuves derrière le chiffre ?

Sol, et de loin, et c'est là ce qui empêche la comparaison de se réduire à un simple argument de prix. Sol est une sortie de juillet 2026 avec un profil indépendant complet dans notre catalogue : un Coding Index de 77,4, troisième des modèles suivis par Artificial Analysis ; un Intelligence Index de 47, à la treizième place ; GPQA Diamond 94,1 % ; Humanity's Last Exam 49,5 % ; SciCode 57,1 % ; Terminal-Bench v2.1 à 88,0 ; τ²-Bench à 85,1. Toutes ces données proviennent d'Artificial Analysis, et non d'OpenAI.

Son indicateur le plus pertinent pour cette comparaison est le Rappel en contexte long : 84. C'est le plus élevé des modèles de pointe que nous proposons, et il mesure si le modèle utilise encore des informations situées en profondeur dans une entrée longue — la question à laquelle une grande fenêtre de contexte est censée répondre. Il est également relevé à la longueur de contexte propre à Sol, selon les propres critères de Sol.

LongCat-2.5-Preview n'a pas d'équivalent. L'entrée du journal des modifications de Meituan pour le 25 septembre 2026 revendique la compréhension d'images, des capacités de codage et une compatibilité avec « Claude Code et d'autres environnements de développement courants », citant Hermes, OpenClaw, OpenCode et Kilo Code. Elle ne publie ni tableau de benchmarks, ni fiche de modèle, ni rapport technique. Les chiffres d'environ 1,6 billion de paramètres au total, dont environ 48 milliards d'actifs par token, proviennent des métadonnées du site de Meituan et de la couverture de la presse spécialisée chinoise, plutôt que de la documentation. Il n'existe aucun dépôt LongCat-2.5-Preview sur HuggingFace, aucun dans l'organisation GitHub de Meituan, et les métadonnées du catalogue fournies par OpenCode indiquent « open weights » : false.

A screenshot of OrcaRouter's own model page for OpenAI GPT-5.6 Sol at /models/openai/gpt-5.6-sol, showing the openai/gpt-5.6-sol identifier, a 1.05M-token context window, 128K maximum output, text + image + file input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-07-09, a p50 first-token figure of 10.00 s, $4.00 and $20.00 rate tiles, and the OpenAI-compatible code samples.

Est-ce que le côté entrée correspond, ou seulement le côté sortie ?

C'est ici que le profil de Sol est plus large et que celui de LongCat est contesté. Sol accepte le texte, les images et les fichiers comme entrée dans notre catalogue, et renvoie du texte. Le changelog de LongCat-2.5-Preview présente la compréhension d'images comme sa principale nouveauté — « analyser le contenu d'une image pour les questions-réponses intermodales, le résumé de contenu et le raisonnement visuel complexe » — mais l'exemple de réponse dans la documentation « Retrieve Model » de Meituan montre encore input_modalities comme ["text"] avec une chaîne de modalité text->text. Cet exemple est peut-être simplement obsolète. Il n'en reste pas moins le contrat publié du fournisseur, et la lecture honnête est que l'entrée d'image est revendiquée plutôt que confirmée jusqu'à ce que vous la testiez.

Une conséquence pratique : une trace de raisonnement de LongCat-2.5-Preview arrive dans un champ reasoning_content entrelacé plutôt que sous forme de paramètre échantillonné. Les harnais qui analysent les complétions de chat sans s'attendre à ce champ laisseront tomber silencieusement la réflexion du modèle — aucune erreur, juste une réponse moins bonne. Quoi que vous décidiez au sujet du modèle lui-même, vérifiez cela en premier.

Laquelle est une voie que vous pouvez réellement garder ?

Sol fait partie des nôtres. Nous le servons au prix catalogue d'OpenAI, avec zéro marge, de sorte qu'un changement de prix du fournisseur se répercute sur votre facture le jour même plutôt qu'au prochain renouvellement, et le basculement automatique déplace une requête dégradée vers un fournisseur sain sans que votre application ne s'en aperçoive. LongCat-2.5-Preview ne fait pas partie de nos routes — nous ne le servons pas, et rien dans ce texte ne doit être interprété comme affirmant que nous le servons.

Cette asymétrie est précisément ce qui justifie la place de la couche de routage dans cette comparaison spécifique, plutôt que comme une remarque générale. La tarification par paliers de Sol signifie qu'une même tâche peut coûter deux fois plus cher uniquement à cause de la longueur de l'entrée, et le seuil se situe à 272 000 tokens — un nombre que votre application connaît avant d'envoyer la requête. Répartir une charge de travail selon la taille des requêtes entre plusieurs fournisseurs est exactement la raison d'être d'un DSL de routage, et la fusion de modèles va plus loin : deux modèles peuvent être composés sur une seule requête, de sorte qu'une passe à long contexte et une étape de synthèse de haute qualité n'aient pas à être le même modèle au même tarif. Ni l'un ni l'autre n'est une raison de choisir un modèle sans benchmark publié. Les deux sont des raisons de ne pas en figer un en dur.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs GPT-5.6 Sol' with the subhead 'Two million-token windows, and only one of them prices the whole window the same'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, no second tier described by the vendor, $1.20 output flagged limited-time, long-context recall not published, no repo and catalogue open_weights false. Right column 'GPT-5.6 Sol' (OpenAI, released 2026-07-09, independently scored): 1,050,000-token context, 128,000 max output, text, image and file to text, $4.00 input up to 272K then $8.00, price doubles at 272,000 input tokens, $20.00 output up to 272K then $30.00, long-context recall 84, coding index 77.4 at rank 3 by Artificial Analysis. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

En résumé

Si votre charge de travail est courte, Sol est le choix simple : il est troisième de l’index de codage, il affiche des chiffres indépendants sur tous les plans, et son côté entrée est documenté. Si votre charge de travail est longue, l’arithmétique s’inverse nettement — le palier de contexte long de Sol coûte environ 26 fois le tarif promotionnel de LongCat-2.5-Preview pour la même lecture de 500 000 tokens, et c’est Sol dont le score de rappel, 84, répond réellement à la question de savoir si la longue fenêtre fonctionne. Vous achetez une fenêtre longue mesurée à un tarif de pointe, face à une fenêtre longue non mesurée à un prix réduit que le fournisseur a déjà qualifié de temporaire.

Le mode de défaillance à éviter est de les traiter comme des options comparables. Ce ne sont pas le même produit vendu à des prix différents ; ce sont une capacité documentée et une promesse. La bonne façon de combler l’écart est d’exécuter LongCat-2.5-Preview sur vos propres tâches à long contexte tant qu’il est gratuit via OpenCode ou bon marché via Meituan — et de garder Sol derrière un routeur afin que le jour où le tarif promotionnel disparaît, ou où le palier long contexte dépasse votre budget, le basculement soit une ligne de configuration plutôt qu’une migration.