
LongCat-2.5-Preview vs. GPT-5.6 Sol: Was ein 1M-Token-Fenster auf jeder Seite kostet
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 610 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 189 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
Das Nützlichste, was man über LongCat-2.5-Preview im Vergleich zu GPT-5.6 Sol sagen kann, ist nicht, welches der beiden intelligenter ist. Es ist, dass beide ein Kontextfenster von ungefähr einer Million Token angeben, und nur eines von ihnen denselben Tarif für das gesamte Fenster berechnet. Sols Preis verdoppelt sich ab 272.000 Eingabe-Token. Die veröffentlichte Preisliste von LongCat-2.5-Preview, soweit Meituan sie niederschreibt, staffelt überhaupt nicht. Dieser eine strukturelle Unterschied entscheidet die meisten echten Long-Document-Workloads, bevor ein Benchmark herangezogen wird — und es ist die Art von Sache, die ein Datenblatt-Vergleich Ihnen niemals zeigen wird, weil beide Modelle „1M“ in derselben Schriftgröße schreiben.
Hier ist, was zu jedem tatsächlich aktenkundig ist, geordnet nach den Fragen, die es wert sind, gestellt zu werden.
Ist das Million-Token-Fenster auf beiden Seiten dasselbe Produkt?
Nein, und der Unterschied ist nicht das Fenster – es ist das, was passiert, wenn man es füllt. Unser Katalog führt Sol mit einem Kontextfenster von 1.050.000 Tokens und maximal 128.000 Tokens Ausgabe, zu 4,00 $ pro Million Eingabe-Tokens und 20,00 $ pro Million Ausgabe-Tokens für Anfragen bis zu 272.000 Tokens, mit zwischengespeicherter Eingabe zu 0,40 $ pro Million und Cache-Schreibvorgängen zu 5,00 $ pro Million. Oberhalb dieser Schwelle steigen die Sätze auf 8,00 $ bzw. 30,00 $ pro Million. Ein Dokumentdurchlauf mit 500.000 Tokens auf Sol wird also für die gesamte Anfrage zum Langkontext-Tarif abgerechnet, nicht zu einem gemischten Tarif.

LongCat-2.5-Preview listet einen Kontext von 1.000.000 Tokens und eine maximale Ausgabe von 131.072 Tokens. Die Preisliste, veröffentlicht auf Meituans eigener Plattform und dort als zeitlich begrenzter Rabatt gekennzeichnet, beträgt 0,30 $ pro Million nicht gecachter Eingabe-Tokens, 0,006 $ pro Million gecachter Eingabe-Tokens und 1,20 $ pro Million Ausgabe-Tokens. Meituan veröffentlicht keine zweite Stufe. Das ist nicht dasselbe wie zu sagen, dass keine existiert – es bedeutet, dass der Anbieter keine beschrieben hat, und ein Preis, der nicht beschrieben ist, ist kein Preis, auf den man ein Budget stützen kann.
Setzen wir eine Zahl darauf. Ein Lesevorgang von 500.000 Token, der 20.000 Token zurückschreibt, kostet auf Sol in der Long-Context-Stufe ungefähr 4,60 $ und auf LongCat-2.5-Preview zum veröffentlichten Aktionspreis ungefähr 17 Cent. Beide Zahlen sind Arithmetik auf Basis veröffentlichter Preistabellen, keine Messungen. Das Verhältnis ist groß genug, dass es verändert, was ökonomisch sinnvoll zu versuchen ist: Bei Sols Long-Context-Preisen ist das Einspeisen einer Codebasis in ein Modell eine Entscheidung; bei LongCat ist es eher der Standardfall.
Welche davon hat Belege hinter der Zahl?
Sol, mit großem Abstand, und das ist der Teil, der verhindert, dass der Vergleich ein reines Preisargument ist. Sol ist eine Veröffentlichung vom Juli 2026 mit einem vollständigen unabhängigen Profil in unserem Katalog: ein Coding Index von 77,4, Dritter unter den von Artificial Analysis erfassten Modellen; ein Intelligence Index von 47 auf Platz dreizehn; GPQA Diamond 94,1 %; Humanity's Last Exam 49,5 %; SciCode 57,1 %; Terminal-Bench v2.1 bei 88,0; τ²-Bench bei 85,1. Alle diese Angaben stammen von Artificial Analysis, nicht von OpenAI.
Seine relevanteste Kennzahl für diesen Vergleich ist Long-Context-Recall: 84. Das ist der höchste Wert unter den Frontier-Modellen, die wir führen, und sie misst, ob das Modell Informationen tief in einer langen Eingabe noch verwendet – die Frage, die ein großes Kontextfenster beantworten soll. Sie wird außerdem bei Sols eigener Kontextlänge gemessen, nach Sols eigenen Maßstäben.
LongCat-2.5-Preview hat kein Äquivalent. Meituans Changelog-Eintrag für den 25. September 2026 beansprucht Bildverständnis, Programmierfähigkeiten und Kompatibilität mit „Claude Code und anderen gängigen Entwicklungsumgebungen“, wobei Hermes, OpenClaw, OpenCode und Kilo Code genannt werden. Er veröffentlicht keine Benchmark-Tabelle, keine Modellkarte und keinen technischen Bericht. Rund 1,6 Billionen Gesamtparameter bei etwa 48 Milliarden aktiven pro Token werden aus Meituans Website-Metadaten und chinesischer Fachberichterstattung statt aus der Dokumentation berichtet. Es gibt kein LongCat-2.5-Preview-Repository auf HuggingFace, keines in Meituans GitHub-Organisation, und die von OpenCode ausgelieferten Katalogmetadaten verzeichnen offene Gewichte als falsch.

Stimmt die Eingangsseite überein, oder nur die Ausgangsseite?
Hier ist Sols Profil breiter und das von LongCat umstritten. Sol akzeptiert in unserem Katalog Text, Bilder und Dateien als Eingabe und gibt Text zurück. Im Changelog von LongCat-2.5-Preview wird das Bildverständnis als wichtigste Neuerung präsentiert – „Bildinhalte für modalitätsübergreifende Fragebeantwortung, Inhaltszusammenfassung und komplexes visuelles Reasoning auswerten" – doch die Beispielantwort in Meituans eigener „Retrieve Model"-Dokumentation zeigt weiterhin input_modalities als ["text"] mit einer text->text Modalitätszeichenfolge. Dieses Beispiel ist möglicherweise schlicht veraltet. Es ist nichtsdestoweniger der veröffentlichte Vertrag des Anbieters, und die ehrliche Lesart ist, dass die Bildeingabe eher behauptet als bestätigt wird, solange man sie nicht getestet hat.
Eine praktische Konsequenz: Ein Reasoning-Trace von LongCat-2.5-Preview liegt in einem verschachtelten reasoning_content-Feld vor, nicht als abgetasteter Parameter. Harnesse, die Chat-Completions parsen, ohne dieses Feld zu erwarten, verwerfen das Denken des Modells stillschweigend – kein Fehler, nur eine schlechtere Antwort. Was auch immer Sie über das Modell selbst entscheiden, prüfen Sie das zuerst.
Welche davon ist eine Route, die man tatsächlich beibehalten kann?
Sol ist eines von unseren. Wir bieten es zum Listenpreis von OpenAI mit null Aufschlag, sodass eine Preisänderung des Anbieters noch am selben Tag auf Ihrer Rechnung erscheint statt erst zur nächsten Verlängerung, und automatisches Failover leitet eine beeinträchtigte Anfrage an einen gesunden Anbieter weiter, ohne dass Ihre Anwendung davon erfährt. LongCat-2.5-Preview ist keine unserer Routen — wir bieten es nicht an, und nichts in diesem Beitrag sollte so verstanden werden, als würden wir dies behaupten.
Diese Asymmetrie ist der Punkt, an dem die Routing-Schicht in diesem konkreten Vergleich ihren Platz verdient und nicht als allgemeine Randbemerkung. Sols gestufte Preisgestaltung bedeutet, dass dieselbe Aufgabe allein aufgrund der Eingabelänge doppelt so viel kosten kann, und die Schwelle liegt bei 272.000 Token – eine Zahl, die Ihre Anwendung kennt, bevor sie die Anfrage absendet. Eine Workload nach Anforderungsgröße über Anbieter hinweg aufzuteilen ist genau das, wofür eine Routing-DSL da ist, und Modellfusion geht noch weiter: Zwei Modelle können in einer Anfrage zusammengesetzt werden, sodass ein Long-Context-Durchlauf und ein hochwertiger Syntheseschritt nicht dasselbe Modell zum selben Tarif sein müssen. Nichts davon ist ein Grund, ein Modell ohne veröffentlichten Benchmark zu wählen. Beides sind Gründe, eines nicht fest zu verdrahten.

Fazit
Wenn Ihre Arbeitslast kurz ist, ist Sol die naheliegende Wahl: Sol liegt auf dem Coding-Index auf Platz drei, hat durchgängig unabhängige Werte, und seine Eingabeseite ist dokumentiert. Wenn Ihre Arbeitslast lang ist, kehrt sich die Rechnung deutlich um — Sols Long-Context-Stufe kostet ungefähr 26-mal so viel wie der Aktionspreis von LongCat-2.5-Preview für denselben 500.000-Token-Lesevorgang, und Sol ist derjenige, dessen Recall-Wert von 84 tatsächlich beantwortet, ob das lange Fenster funktioniert. Sie kaufen ein gemessenes langes Fenster zu einem Frontier-Preis gegen ein ungemessenes langes Fenster zu einem Rabattpreis, den der Anbieter bereits als vorübergehend gekennzeichnet hat.
Das zu vermeidende Fehlermuster ist, diese als vergleichbare Optionen zu behandeln. Sie sind nicht dasselbe Produkt, das zu unterschiedlichen Preisen verkauft wird; sie sind eine dokumentierte Fähigkeit und ein Versprechen. Der richtige Weg, die Lücke zu schließen, besteht darin, LongCat-2.5-Preview mit Ihren eigenen Long-Context-Aufgaben laufen zu lassen, solange es über OpenCode kostenlos oder über Meituan günstig ist – und Sol hinter einem Router zu halten, damit an dem Tag, an dem der Aktionspreis verschwindet oder die Long-Context-Stufe Ihr Budget übersteigt, der Wechsel eine Konfigurationszeile statt einer Migration ist.
