Eine generierte Hero-Titelkarte mit der Aufschrift „LongCat-2.5-Preview vs. MiniMax M3“ und der Überzeile „Der günstige Platz ist bereits vergeben“, dazu zwei Panels: „LongCat-2.5-Preview: $0,30 / $1,20 pro 1 Mio., 131.072 maximale Ausgabe“ und „MiniMax M3: $0,30 / $1,20 pro 1 Mio., 512.000 maximale Ausgabe“. OrcaRouter-Logo unten rechts.
Guides & Insights

LongCat-2.5-Preview vs. MiniMax M3: Der günstige Platz ist bereits vergeben

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Die Prämisse der meisten Berichte über LongCat-2.5-Preview ist, dass Meituan das Feld unterboten hat. Gegen MiniMax M3 verflüchtigt sich diese Prämisse beim Kontakt. MiniMax M3 wird in unserem Katalog mit $0.30 pro Million Eingabe-Tokens und $1.20 pro Million Ausgabe-Tokens gelistet. Die veröffentlichte Preisliste von LongCat-2.5-Preview nennt $0.30 pro Million nicht gecachte Eingabe-Tokens und $1.20 pro Million Ausgabe-Tokens. Das sind keine ähnlichen Zahlen; es sind dieselben Zahlen. Die einzige Stelle, an der sie auseinandergehen, ist gecachte Eingabe, wo Meituan $0.006 pro Million gegenüber $0.06 des etablierten Anbieters nennt – eine zehnfache Lücke beim günstigsten Posten der Rechnung. Die interessante Frage ist also nicht, ob LongCat-2.5-Preview günstig ist. Sondern was man kauft und aufgibt, wenn ein neues Modell genau zum Preis des etablierten Anbieters erscheint.

Die kurze Antwort: eine deutlich höhere Ausgabeobergrenze, eine viel dünnere Evidenzbasis und ein Cache-Rabatt.

Gleicher Nennpreis, sehr unterschiedliche veröffentlichte Obergrenzen

MiniMax M3 ist seit dem 31. Mai 2026 offiziell verzeichnet. Unser Katalog führt es mit einem Kontextfenster von 1.048.576 Token und einer maximalen Ausgabe von 512.000 Token — mehr, als die meisten Modelle erlauben, und viermal so viel wie die 131.072 von LongCat-2.5-Preview. Es akzeptiert Text, Bilder und Videos als Eingabe und gibt Text zurück, wobei Tool-Calling, JSON-Modus und Reasoning verfügbar gemacht werden.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview, am 25. September 2026 auf Meituans LongCat API Platform gelistet, liegt beim Kontext mit 1.000.000 Tokens gleichauf und bleibt bei der Ausgabe mit 131.072 deutlich darunter. Sein Eingabeprofil ist die entscheidende Frage: Das Changelog führt Bildverständnis als wichtigste Neuerung auf, doch die Beispielantwort in Meituans eigener „Retrieve Model“-Dokumentation zeigt weiterhin input_modalities/ als ["text"]/ mit einem text->text/ Modalitätsstring. MiniMax M3 akzeptiert außerdem Video, was LongCat-2.5-Preview überhaupt nicht für sich beansprucht. Wenn Ihre Pipeline Bildschirmaufzeichnungen oder Frame-Sequenzen einspeist, endet dieser Vergleich hier.

Die Cache-Asymmetrie verläuft in die andere Richtung und sollte zu Meituans Gunsten erwähnt werden, denn sie ist die eine Dimension, in der sich das neue Modell wirklich unterscheidet. $0.006 pro Million gecachter Eingabe gegenüber $0.06 ist ein echter Vorteil für Agent-Workloads, die bei jedem Turn denselben langen Präfix erneut senden – was auf die meisten zutrifft. Es ist außerdem der Posten, der am ehesten ohne Vorankündigung geändert wird, da Meituan die gesamte Karte als zeitlich begrenzten Rabatt kennzeichnet.

Die Evidenzlücke, ehrlich in beide Richtungen gemessen

Die Benchmark-Position von MiniMax M3 ist nicht stark, und das zu sagen gehört zu einer ordnungsgemäßen Durchführung dieses Vergleichs. Artificial Analysis verzeichnet dafür einen Coding Index von 58,6 – Platz sechsundvierzig der erfassten Modelle – und einen Intelligence Index von 29,2 auf Platz sechzig. GPQA Diamond 92,9 %, Humanity's Last Exam 39 %, SciCode 47,1 %, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Die von MiniMax selbst veröffentlichten Zahlen decken anderes Terrain ab: BrowseComp 83,5, GDPval-Rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Das sind vom Anbieter gemeldete Zahlen, und sie gehören in eine andere Spalte als die unabhängigen, aber sie existieren, und auf dieses Wort kommt es an.

A screenshot of OrcaRouter's own model page for MiniMax M3 at /models/minimax/minimax-m3, showing the minimax/minimax-m3 identifier, a 1M-token context window, 512K maximum output, text + image + video input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-05-31, a p50 first-token figure of 3.35 s, $0.30 and $1.20 rate tiles, and the OpenAI-compatible code samples.

LongCat-2.5-Preview hat überhaupt keine Spalte. Keine veröffentlichte Benchmark-Tabelle, keine Modellkarte, keinen technischen Bericht, kein Repository auf HuggingFace oder in Meituans GitHub-Organisation und Katalogmetadaten, die offene Gewichte als falsch ausweisen. Die ungefähre Angabe von 1,6 Billionen Gesamtparametern / 48 Milliarden aktiven Parametern stammt aus Meituans Website-Metadaten und chinesischer Fachberichterstattung statt aus Dokumentation. Die korrekte Aussage lautet also: M3s Ergebnisse sind mittelmäßig und stammen aus unabhängiger Quelle; die von LongCat-2.5-Preview fehlen. Ein Modell, das im Coding-Index im Vierzigbereich liegt, ist eine bekannte Größe, mit der man planen kann. Ein Modell ohne Ergebnis ist eine andere Art von Risiko, und da der Preis identisch ist, entfällt der Ausgleich, der normalerweise dafür spricht, es zu nehmen.

Wo derselbe Preis das ändert, was Sie tun sollten

Wenn ein neues Modell das Feld unterbietet, ist der rationale Schritt, es zu bewerten – der Vorteil ist ein echter Rabatt. Wenn ein neues Modell zu exakt demselben Preis wie ein etabliertes Modell erscheint, das seit Mai ausgeliefert wird, ist der Vorteil nicht der Preis. Es ist die Leistungsfähigkeit, und Leistungsfähigkeit ist das Einzige, was LongCat-2.5-Preview nicht veröffentlicht hat. Das ordnet die Bewertung völlig neu ein: Sie testen nicht, ob es günstiger ist, sondern ob es besser ist – bei Ihren Aufgaben, aus dem Stand, ohne Evidenz, an der Sie sich orientieren können.

Es gibt ein Detail zweiter Ordnung, das diesen Test billiger macht, als er aussieht. LongCat-2.5-Preview ist über OpenCode für ein Zeitfenster unbestimmter Länge kostenlos und unbegrenzt, mit einer Null-Aufbewahrungsrichtlinie, die OpenCode ausdrücklich dokumentiert – Modelltraining „Not used“, Datenaufbewahrung „0 days“, gegenüber dreißig Tagen beim Vergleichseintrag. Die Kosten für die Erstellung einer eigenen Evaluierung liegen also nahe bei null, und die Aufbewahrungsrichtlinie bedeutet, dass man sie gegen privaten Code laufen lassen kann. Das eine Harness-Detail, das zuerst geklärt werden muss, ist, dass das Modell seinen Reasoning-Trace in einem verschachtelten reasoning_content/ Feld zurückgibt; Clients, die Chat-Completions parsen, ohne damit zu rechnen, verwerfen das Denken stillschweigend und lassen das Modell schlechter aussehen, als es ist.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs MiniMax M3' with the subhead 'Identical headline rates, four times the output ceiling, ten times the cache discount'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'MiniMax M3' (MiniMax, released 2026-05-31, independently scored): 1,048,576-token context, 512,000 max output described as four times as much, text, image and video to text, $0.30 uncached / $0.06 cached input, $1.20 output, coding index 58.6 at rank 46 and intelligence index 29.2 at rank 60 by Artificial Analysis, long-context recall 83. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

Das Routing-Argument, spezifisch für einen Gleichpreisvergleich

Wir bieten MiniMax M3 an zu MiniMax' Listenpreis mit null Aufschlag. LongCat-2.5-Preview ist keine unserer Routen — wir bieten es nicht an, und nichts hier sollte als eine gegenteilige Aussage verstanden werden.

Ein Duell zum gleichen Preis ist genau der Fall, in dem Routing sich bezahlt macht, statt bloß eine Bequemlichkeit zu sein. Wenn zwei Modelle gleich viel kosten, fällt die Entscheidung zwischen ihnen pro Anfrage und pro Aufgabe: M3 wegen der Obergrenze von 512.000 Tokens bei der Ausgabe und der Videoeingabe, LongCat-2.5-Preview wegen des Rabatts für zwischengespeicherte Präfixe bei langen Agent-Schleifen, sobald man sich von seiner Qualität überzeugt hat. Modell-Fusion ist der Mechanismus, der das wörtlich nimmt – ein Retrieval-Durchlauf und ein Syntheseschritt können bei einer einzigen Anfrage unterschiedliche Modelle sein, sodass man nicht gezwungen ist, einen Sieger zu küren, bevor man Belege hat. Und weil wir die Listenpreise der Anbieter ohne Aufschlag weitergeben, schlägt eine Tarifänderung eines Anbieters noch am selben Tag auf Ihrer Rechnung durch statt erst bei der nächsten Vertragsverlängerung, was mehr als sonst zählt, wenn eine der beiden Karten ausdrücklich eine Werbeaktion ist. Der automatische Failover deckt dann den Fall ab, dass ein Anbieter schlechter wird, und er zählt am meisten für das Modell, für das es keine Serving-Historie gibt, die man prüfen könnte.

Häufig gefragt

• Ist LongCat-2.5-Preview günstiger als MiniMax M3? Nein. Auf den veröffentlichten Preistabellen sind die Input- und Output-Raten mit 0,30 $ und 1,20 $ pro Million identisch. Der einzige Preisvorteil besteht beim gecachten Input: 0,006 $ gegenüber 0,06 $, und Meituan kennzeichnet seine gesamte Preistabelle als zeitlich begrenzten Rabatt, ohne zu sagen, was danach kommt.

• Welches hat die größere nutzbare Ausgabe? MiniMax M3 mit großem Abstand: 512.000 Tokens gegenüber 131.072. Für die Generierung langer Texte, strukturierte Extraktion über große Dokumente oder alles, was mehr als ein Kapitel schreibt, ist diese Obergrenze die entscheidende Spezifikation.

• Welche kann ich überprüfen? MiniMax M3, und die Überprüfung schmeichelt ihm nicht – Coding 58,6 auf Platz 46 und ein Intelligence Index von 29,2 auf Platz 60 von Artificial Analysis. LongCat-2.5-Preview hat keine von irgendjemandem veröffentlichte Bewertung. Wenn diese Woche ein LongCat-2.5-Preview-Benchmark auftaucht, behandle ihn als nicht verifizierbar, bis du ihn auf einen namentlich genannten Evaluator zurückführen kannst.

• Was sollte ich in Produktion einsetzen? Keines von beiden ohne einen eigenen Test. Von den beiden ist M3 die Wahl mit der geringeren Varianz, weil seine Schwächen dokumentiert und seine Eingabemodalitäten bestätigt sind; LongCat-2.5-Preview ist die mit der höheren Varianz, mit einer größeren Kontextangabe, einer deutlich niedrigeren Ausgabeobergrenze, einem Cache-Rabatt und null öffentlichen Belegen. Lass es kostenlos laufen, solange das Zeitfenster offen ist, halte beide hinter einem Schlüssel, und lass deine eigenen Zahlen entscheiden.