Eine generierte Hero-Titelkarte mit der Aufschrift „LongCat-2.5-Preview vs. GPT-5.6 Sol“ und der Überzeile „Ein 1-Mio.-Fenster, das durchgehend gleich viel kostet“, sowie zwei Panels: „LongCat-2.5-Preview: 0,30 $ / 1,20 $ pro 1 Mio., 131.072 max. Ausgabe“ und „GPT-5.6 Sol: 4,00 $ / 20,00 $ pro 1 Mio., verdoppelt sich ab 272K Eingabe“. OrcaRouter-Logo unten rechts.
Engineering & Research

LongCat-2.5-Preview vs. GPT-5.6 Sol: Was ein 1M-Token-Fenster auf jeder Seite kostet

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Das Nützlichste, was man über LongCat-2.5-Preview im Vergleich zu GPT-5.6 Sol sagen kann, ist nicht, welches der beiden intelligenter ist. Es ist, dass beide ein Kontextfenster von ungefähr einer Million Token angeben, und nur eines von ihnen denselben Tarif für das gesamte Fenster berechnet. Sols Preis verdoppelt sich ab 272.000 Eingabe-Token. Die veröffentlichte Preisliste von LongCat-2.5-Preview, soweit Meituan sie niederschreibt, staffelt überhaupt nicht. Dieser eine strukturelle Unterschied entscheidet die meisten echten Long-Document-Workloads, bevor ein Benchmark herangezogen wird — und es ist die Art von Sache, die ein Datenblatt-Vergleich Ihnen niemals zeigen wird, weil beide Modelle „1M“ in derselben Schriftgröße schreiben.

Hier ist, was zu jedem tatsächlich aktenkundig ist, geordnet nach den Fragen, die es wert sind, gestellt zu werden.

Ist das Million-Token-Fenster auf beiden Seiten dasselbe Produkt?

Nein, und der Unterschied ist nicht das Fenster – es ist das, was passiert, wenn man es füllt. Unser Katalog führt Sol mit einem Kontextfenster von 1.050.000 Tokens und maximal 128.000 Tokens Ausgabe, zu 4,00 $ pro Million Eingabe-Tokens und 20,00 $ pro Million Ausgabe-Tokens für Anfragen bis zu 272.000 Tokens, mit zwischengespeicherter Eingabe zu 0,40 $ pro Million und Cache-Schreibvorgängen zu 5,00 $ pro Million. Oberhalb dieser Schwelle steigen die Sätze auf 8,00 $ bzw. 30,00 $ pro Million. Ein Dokumentdurchlauf mit 500.000 Tokens auf Sol wird also für die gesamte Anfrage zum Langkontext-Tarif abgerechnet, nicht zu einem gemischten Tarif.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview listet einen Kontext von 1.000.000 Tokens und eine maximale Ausgabe von 131.072 Tokens. Die Preisliste, veröffentlicht auf Meituans eigener Plattform und dort als zeitlich begrenzter Rabatt gekennzeichnet, beträgt 0,30 $ pro Million nicht gecachter Eingabe-Tokens, 0,006 $ pro Million gecachter Eingabe-Tokens und 1,20 $ pro Million Ausgabe-Tokens. Meituan veröffentlicht keine zweite Stufe. Das ist nicht dasselbe wie zu sagen, dass keine existiert – es bedeutet, dass der Anbieter keine beschrieben hat, und ein Preis, der nicht beschrieben ist, ist kein Preis, auf den man ein Budget stützen kann.

Setzen wir eine Zahl darauf. Ein Lesevorgang von 500.000 Token, der 20.000 Token zurückschreibt, kostet auf Sol in der Long-Context-Stufe ungefähr 4,60 $ und auf LongCat-2.5-Preview zum veröffentlichten Aktionspreis ungefähr 17 Cent. Beide Zahlen sind Arithmetik auf Basis veröffentlichter Preistabellen, keine Messungen. Das Verhältnis ist groß genug, dass es verändert, was ökonomisch sinnvoll zu versuchen ist: Bei Sols Long-Context-Preisen ist das Einspeisen einer Codebasis in ein Modell eine Entscheidung; bei LongCat ist es eher der Standardfall.

Welche davon hat Belege hinter der Zahl?

Sol, mit großem Abstand, und das ist der Teil, der verhindert, dass der Vergleich ein reines Preisargument ist. Sol ist eine Veröffentlichung vom Juli 2026 mit einem vollständigen unabhängigen Profil in unserem Katalog: ein Coding Index von 77,4, Dritter unter den von Artificial Analysis erfassten Modellen; ein Intelligence Index von 47 auf Platz dreizehn; GPQA Diamond 94,1 %; Humanity's Last Exam 49,5 %; SciCode 57,1 %; Terminal-Bench v2.1 bei 88,0; τ²-Bench bei 85,1. Alle diese Angaben stammen von Artificial Analysis, nicht von OpenAI.

Seine relevanteste Kennzahl für diesen Vergleich ist Long-Context-Recall: 84. Das ist der höchste Wert unter den Frontier-Modellen, die wir führen, und sie misst, ob das Modell Informationen tief in einer langen Eingabe noch verwendet – die Frage, die ein großes Kontextfenster beantworten soll. Sie wird außerdem bei Sols eigener Kontextlänge gemessen, nach Sols eigenen Maßstäben.

LongCat-2.5-Preview hat kein Äquivalent. Meituans Changelog-Eintrag für den 25. September 2026 beansprucht Bildverständnis, Programmierfähigkeiten und Kompatibilität mit „Claude Code und anderen gängigen Entwicklungsumgebungen“, wobei Hermes, OpenClaw, OpenCode und Kilo Code genannt werden. Er veröffentlicht keine Benchmark-Tabelle, keine Modellkarte und keinen technischen Bericht. Rund 1,6 Billionen Gesamtparameter bei etwa 48 Milliarden aktiven pro Token werden aus Meituans Website-Metadaten und chinesischer Fachberichterstattung statt aus der Dokumentation berichtet. Es gibt kein LongCat-2.5-Preview-Repository auf HuggingFace, keines in Meituans GitHub-Organisation, und die von OpenCode ausgelieferten Katalogmetadaten verzeichnen offene Gewichte als falsch.

A screenshot of OrcaRouter's own model page for OpenAI GPT-5.6 Sol at /models/openai/gpt-5.6-sol, showing the openai/gpt-5.6-sol identifier, a 1.05M-token context window, 128K maximum output, text + image + file input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-07-09, a p50 first-token figure of 10.00 s, $4.00 and $20.00 rate tiles, and the OpenAI-compatible code samples.

Stimmt die Eingangsseite überein, oder nur die Ausgangsseite?

Hier ist Sols Profil breiter und das von LongCat umstritten. Sol akzeptiert in unserem Katalog Text, Bilder und Dateien als Eingabe und gibt Text zurück. Im Changelog von LongCat-2.5-Preview wird das Bildverständnis als wichtigste Neuerung präsentiert – „Bildinhalte für modalitätsübergreifende Fragebeantwortung, Inhaltszusammenfassung und komplexes visuelles Reasoning auswerten" – doch die Beispielantwort in Meituans eigener „Retrieve Model"-Dokumentation zeigt weiterhin input_modalities als ["text"] mit einer text->text Modalitätszeichenfolge. Dieses Beispiel ist möglicherweise schlicht veraltet. Es ist nichtsdestoweniger der veröffentlichte Vertrag des Anbieters, und die ehrliche Lesart ist, dass die Bildeingabe eher behauptet als bestätigt wird, solange man sie nicht getestet hat.

Eine praktische Konsequenz: Ein Reasoning-Trace von LongCat-2.5-Preview liegt in einem verschachtelten reasoning_content-Feld vor, nicht als abgetasteter Parameter. Harnesse, die Chat-Completions parsen, ohne dieses Feld zu erwarten, verwerfen das Denken des Modells stillschweigend – kein Fehler, nur eine schlechtere Antwort. Was auch immer Sie über das Modell selbst entscheiden, prüfen Sie das zuerst.

Welche davon ist eine Route, die man tatsächlich beibehalten kann?

Sol ist eines von unseren. Wir bieten es zum Listenpreis von OpenAI mit null Aufschlag, sodass eine Preisänderung des Anbieters noch am selben Tag auf Ihrer Rechnung erscheint statt erst zur nächsten Verlängerung, und automatisches Failover leitet eine beeinträchtigte Anfrage an einen gesunden Anbieter weiter, ohne dass Ihre Anwendung davon erfährt. LongCat-2.5-Preview ist keine unserer Routen — wir bieten es nicht an, und nichts in diesem Beitrag sollte so verstanden werden, als würden wir dies behaupten.

Diese Asymmetrie ist der Punkt, an dem die Routing-Schicht in diesem konkreten Vergleich ihren Platz verdient und nicht als allgemeine Randbemerkung. Sols gestufte Preisgestaltung bedeutet, dass dieselbe Aufgabe allein aufgrund der Eingabelänge doppelt so viel kosten kann, und die Schwelle liegt bei 272.000 Token – eine Zahl, die Ihre Anwendung kennt, bevor sie die Anfrage absendet. Eine Workload nach Anforderungsgröße über Anbieter hinweg aufzuteilen ist genau das, wofür eine Routing-DSL da ist, und Modellfusion geht noch weiter: Zwei Modelle können in einer Anfrage zusammengesetzt werden, sodass ein Long-Context-Durchlauf und ein hochwertiger Syntheseschritt nicht dasselbe Modell zum selben Tarif sein müssen. Nichts davon ist ein Grund, ein Modell ohne veröffentlichten Benchmark zu wählen. Beides sind Gründe, eines nicht fest zu verdrahten.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs GPT-5.6 Sol' with the subhead 'Two million-token windows, and only one of them prices the whole window the same'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, no second tier described by the vendor, $1.20 output flagged limited-time, long-context recall not published, no repo and catalogue open_weights false. Right column 'GPT-5.6 Sol' (OpenAI, released 2026-07-09, independently scored): 1,050,000-token context, 128,000 max output, text, image and file to text, $4.00 input up to 272K then $8.00, price doubles at 272,000 input tokens, $20.00 output up to 272K then $30.00, long-context recall 84, coding index 77.4 at rank 3 by Artificial Analysis. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

Fazit

Wenn Ihre Arbeitslast kurz ist, ist Sol die naheliegende Wahl: Sol liegt auf dem Coding-Index auf Platz drei, hat durchgängig unabhängige Werte, und seine Eingabeseite ist dokumentiert. Wenn Ihre Arbeitslast lang ist, kehrt sich die Rechnung deutlich um — Sols Long-Context-Stufe kostet ungefähr 26-mal so viel wie der Aktionspreis von LongCat-2.5-Preview für denselben 500.000-Token-Lesevorgang, und Sol ist derjenige, dessen Recall-Wert von 84 tatsächlich beantwortet, ob das lange Fenster funktioniert. Sie kaufen ein gemessenes langes Fenster zu einem Frontier-Preis gegen ein ungemessenes langes Fenster zu einem Rabattpreis, den der Anbieter bereits als vorübergehend gekennzeichnet hat.

Das zu vermeidende Fehlermuster ist, diese als vergleichbare Optionen zu behandeln. Sie sind nicht dasselbe Produkt, das zu unterschiedlichen Preisen verkauft wird; sie sind eine dokumentierte Fähigkeit und ein Versprechen. Der richtige Weg, die Lücke zu schließen, besteht darin, LongCat-2.5-Preview mit Ihren eigenen Long-Context-Aufgaben laufen zu lassen, solange es über OpenCode kostenlos oder über Meituan günstig ist – und Sol hinter einem Router zu halten, damit an dem Tag, an dem der Aktionspreis verschwindet oder die Long-Context-Stufe Ihr Budget übersteigt, der Wechsel eine Konfigurationszeile statt einer Migration ist.