
LongCat-2.5-Preview vs. MiniMax M3: Der günstige Platz ist bereits vergeben
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 610 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 189 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
Die Prämisse der meisten Berichte über LongCat-2.5-Preview ist, dass Meituan das Feld unterboten hat. Gegen MiniMax M3 verflüchtigt sich diese Prämisse beim Kontakt. MiniMax M3 wird in unserem Katalog mit $0.30 pro Million Eingabe-Tokens und $1.20 pro Million Ausgabe-Tokens gelistet. Die veröffentlichte Preisliste von LongCat-2.5-Preview nennt $0.30 pro Million nicht gecachte Eingabe-Tokens und $1.20 pro Million Ausgabe-Tokens. Das sind keine ähnlichen Zahlen; es sind dieselben Zahlen. Die einzige Stelle, an der sie auseinandergehen, ist gecachte Eingabe, wo Meituan $0.006 pro Million gegenüber $0.06 des etablierten Anbieters nennt – eine zehnfache Lücke beim günstigsten Posten der Rechnung. Die interessante Frage ist also nicht, ob LongCat-2.5-Preview günstig ist. Sondern was man kauft und aufgibt, wenn ein neues Modell genau zum Preis des etablierten Anbieters erscheint.
Die kurze Antwort: eine deutlich höhere Ausgabeobergrenze, eine viel dünnere Evidenzbasis und ein Cache-Rabatt.
Gleicher Nennpreis, sehr unterschiedliche veröffentlichte Obergrenzen
MiniMax M3 ist seit dem 31. Mai 2026 offiziell verzeichnet. Unser Katalog führt es mit einem Kontextfenster von 1.048.576 Token und einer maximalen Ausgabe von 512.000 Token — mehr, als die meisten Modelle erlauben, und viermal so viel wie die 131.072 von LongCat-2.5-Preview. Es akzeptiert Text, Bilder und Videos als Eingabe und gibt Text zurück, wobei Tool-Calling, JSON-Modus und Reasoning verfügbar gemacht werden.

LongCat-2.5-Preview, am 25. September 2026 auf Meituans LongCat API Platform gelistet, liegt beim Kontext mit 1.000.000 Tokens gleichauf und bleibt bei der Ausgabe mit 131.072 deutlich darunter. Sein Eingabeprofil ist die entscheidende Frage: Das Changelog führt Bildverständnis als wichtigste Neuerung auf, doch die Beispielantwort in Meituans eigener „Retrieve Model“-Dokumentation zeigt weiterhin input_modalities/ als ["text"]/ mit einem text->text/ Modalitätsstring. MiniMax M3 akzeptiert außerdem Video, was LongCat-2.5-Preview überhaupt nicht für sich beansprucht. Wenn Ihre Pipeline Bildschirmaufzeichnungen oder Frame-Sequenzen einspeist, endet dieser Vergleich hier.
Die Cache-Asymmetrie verläuft in die andere Richtung und sollte zu Meituans Gunsten erwähnt werden, denn sie ist die eine Dimension, in der sich das neue Modell wirklich unterscheidet. $0.006 pro Million gecachter Eingabe gegenüber $0.06 ist ein echter Vorteil für Agent-Workloads, die bei jedem Turn denselben langen Präfix erneut senden – was auf die meisten zutrifft. Es ist außerdem der Posten, der am ehesten ohne Vorankündigung geändert wird, da Meituan die gesamte Karte als zeitlich begrenzten Rabatt kennzeichnet.
Die Evidenzlücke, ehrlich in beide Richtungen gemessen
Die Benchmark-Position von MiniMax M3 ist nicht stark, und das zu sagen gehört zu einer ordnungsgemäßen Durchführung dieses Vergleichs. Artificial Analysis verzeichnet dafür einen Coding Index von 58,6 – Platz sechsundvierzig der erfassten Modelle – und einen Intelligence Index von 29,2 auf Platz sechzig. GPQA Diamond 92,9 %, Humanity's Last Exam 39 %, SciCode 47,1 %, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Die von MiniMax selbst veröffentlichten Zahlen decken anderes Terrain ab: BrowseComp 83,5, GDPval-Rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Das sind vom Anbieter gemeldete Zahlen, und sie gehören in eine andere Spalte als die unabhängigen, aber sie existieren, und auf dieses Wort kommt es an.

LongCat-2.5-Preview hat überhaupt keine Spalte. Keine veröffentlichte Benchmark-Tabelle, keine Modellkarte, keinen technischen Bericht, kein Repository auf HuggingFace oder in Meituans GitHub-Organisation und Katalogmetadaten, die offene Gewichte als falsch ausweisen. Die ungefähre Angabe von 1,6 Billionen Gesamtparametern / 48 Milliarden aktiven Parametern stammt aus Meituans Website-Metadaten und chinesischer Fachberichterstattung statt aus Dokumentation. Die korrekte Aussage lautet also: M3s Ergebnisse sind mittelmäßig und stammen aus unabhängiger Quelle; die von LongCat-2.5-Preview fehlen. Ein Modell, das im Coding-Index im Vierzigbereich liegt, ist eine bekannte Größe, mit der man planen kann. Ein Modell ohne Ergebnis ist eine andere Art von Risiko, und da der Preis identisch ist, entfällt der Ausgleich, der normalerweise dafür spricht, es zu nehmen.
Wo derselbe Preis das ändert, was Sie tun sollten
Wenn ein neues Modell das Feld unterbietet, ist der rationale Schritt, es zu bewerten – der Vorteil ist ein echter Rabatt. Wenn ein neues Modell zu exakt demselben Preis wie ein etabliertes Modell erscheint, das seit Mai ausgeliefert wird, ist der Vorteil nicht der Preis. Es ist die Leistungsfähigkeit, und Leistungsfähigkeit ist das Einzige, was LongCat-2.5-Preview nicht veröffentlicht hat. Das ordnet die Bewertung völlig neu ein: Sie testen nicht, ob es günstiger ist, sondern ob es besser ist – bei Ihren Aufgaben, aus dem Stand, ohne Evidenz, an der Sie sich orientieren können.
Es gibt ein Detail zweiter Ordnung, das diesen Test billiger macht, als er aussieht. LongCat-2.5-Preview ist über OpenCode für ein Zeitfenster unbestimmter Länge kostenlos und unbegrenzt, mit einer Null-Aufbewahrungsrichtlinie, die OpenCode ausdrücklich dokumentiert – Modelltraining „Not used“, Datenaufbewahrung „0 days“, gegenüber dreißig Tagen beim Vergleichseintrag. Die Kosten für die Erstellung einer eigenen Evaluierung liegen also nahe bei null, und die Aufbewahrungsrichtlinie bedeutet, dass man sie gegen privaten Code laufen lassen kann. Das eine Harness-Detail, das zuerst geklärt werden muss, ist, dass das Modell seinen Reasoning-Trace in einem verschachtelten reasoning_content/ Feld zurückgibt; Clients, die Chat-Completions parsen, ohne damit zu rechnen, verwerfen das Denken stillschweigend und lassen das Modell schlechter aussehen, als es ist.

Das Routing-Argument, spezifisch für einen Gleichpreisvergleich
Wir bieten MiniMax M3 an zu MiniMax' Listenpreis mit null Aufschlag. LongCat-2.5-Preview ist keine unserer Routen — wir bieten es nicht an, und nichts hier sollte als eine gegenteilige Aussage verstanden werden.
Ein Duell zum gleichen Preis ist genau der Fall, in dem Routing sich bezahlt macht, statt bloß eine Bequemlichkeit zu sein. Wenn zwei Modelle gleich viel kosten, fällt die Entscheidung zwischen ihnen pro Anfrage und pro Aufgabe: M3 wegen der Obergrenze von 512.000 Tokens bei der Ausgabe und der Videoeingabe, LongCat-2.5-Preview wegen des Rabatts für zwischengespeicherte Präfixe bei langen Agent-Schleifen, sobald man sich von seiner Qualität überzeugt hat. Modell-Fusion ist der Mechanismus, der das wörtlich nimmt – ein Retrieval-Durchlauf und ein Syntheseschritt können bei einer einzigen Anfrage unterschiedliche Modelle sein, sodass man nicht gezwungen ist, einen Sieger zu küren, bevor man Belege hat. Und weil wir die Listenpreise der Anbieter ohne Aufschlag weitergeben, schlägt eine Tarifänderung eines Anbieters noch am selben Tag auf Ihrer Rechnung durch statt erst bei der nächsten Vertragsverlängerung, was mehr als sonst zählt, wenn eine der beiden Karten ausdrücklich eine Werbeaktion ist. Der automatische Failover deckt dann den Fall ab, dass ein Anbieter schlechter wird, und er zählt am meisten für das Modell, für das es keine Serving-Historie gibt, die man prüfen könnte.
Häufig gefragt
• Ist LongCat-2.5-Preview günstiger als MiniMax M3? Nein. Auf den veröffentlichten Preistabellen sind die Input- und Output-Raten mit 0,30 $ und 1,20 $ pro Million identisch. Der einzige Preisvorteil besteht beim gecachten Input: 0,006 $ gegenüber 0,06 $, und Meituan kennzeichnet seine gesamte Preistabelle als zeitlich begrenzten Rabatt, ohne zu sagen, was danach kommt.
• Welches hat die größere nutzbare Ausgabe? MiniMax M3 mit großem Abstand: 512.000 Tokens gegenüber 131.072. Für die Generierung langer Texte, strukturierte Extraktion über große Dokumente oder alles, was mehr als ein Kapitel schreibt, ist diese Obergrenze die entscheidende Spezifikation.
• Welche kann ich überprüfen? MiniMax M3, und die Überprüfung schmeichelt ihm nicht – Coding 58,6 auf Platz 46 und ein Intelligence Index von 29,2 auf Platz 60 von Artificial Analysis. LongCat-2.5-Preview hat keine von irgendjemandem veröffentlichte Bewertung. Wenn diese Woche ein LongCat-2.5-Preview-Benchmark auftaucht, behandle ihn als nicht verifizierbar, bis du ihn auf einen namentlich genannten Evaluator zurückführen kannst.
• Was sollte ich in Produktion einsetzen? Keines von beiden ohne einen eigenen Test. Von den beiden ist M3 die Wahl mit der geringeren Varianz, weil seine Schwächen dokumentiert und seine Eingabemodalitäten bestätigt sind; LongCat-2.5-Preview ist die mit der höheren Varianz, mit einer größeren Kontextangabe, einer deutlich niedrigeren Ausgabeobergrenze, einem Cache-Rabatt und null öffentlichen Belegen. Lass es kostenlos laufen, solange das Zeitfenster offen ist, halte beide hinter einem Schlüssel, und lass deine eigenen Zahlen entscheiden.
