Een gegenereerde hero-titelkaart met de tekst 'LongCat-2.5-Preview vs MiniMax M3' en de bovenregel 'De goedkope plek is al bezet', en twee panelen: 'LongCat-2.5-Preview: $0,30 / $1,20 per 1M, 131.072 max. output' en 'MiniMax M3: $0,30 / $1,20 per 1M, 512.000 max. output'. OrcaRouter-logo rechtsonder.
Guides & Insights

LongCat-2.5-Preview vs MiniMax M3: De goedkope plaats is al bezet

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Het uitgangspunt van de meeste berichtgeving over LongCat-2.5-Preview is dat Meituan de rest van het veld heeft onderboden. Tegenover MiniMax M3 vervliegt dat uitgangspunt onmiddellijk. MiniMax M3 staat in onze catalogus voor $0,30 per miljoen inputtokens en $1,20 per miljoen outputtokens. De gepubliceerde tariefkaart van LongCat-2.5-Preview vermeldt $0,30 per miljoen niet-gecachete inputtokens en $1,20 per miljoen outputtokens. Dat zijn geen vergelijkbare cijfers; het zijn dezelfde cijfers. Het enige punt waarop ze uiteenlopen, is gecachte input, waar Meituan $0,006 per miljoen rekent tegenover $0,06 van de gevestigde aanbieder — een tienvoudig verschil op de goedkoopste regel van de rekening. De interessante vraag is dus niet of LongCat-2.5-Preview goedkoop is. Het is wat je koopt en opgeeft wanneer een nieuw model tegen exact dezelfde prijs als de gevestigde aanbieder op de markt komt.

Het korte antwoord: een veel hoger outputplafond, een veel dunnere bewijsbasis en een cachekorting.

Dezelfde koprijs, heel verschillende gepubliceerde plafonds.

MiniMax M3 is sinds 31 mei 2026 officieel bekend. Onze catalogus bevat het met een contextvenster van 1.048.576 tokens en een maximale uitvoer van 512.000 tokens — meer dan de meeste modellen toestaan, en vier keer de 131.072 van LongCat-2.5-Preview. Het accepteert tekst, afbeeldingen en video als invoer en retourneert tekst, met beschikbare tool calling, JSON-modus en reasoning.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview, op 25 september 2026 vermeld op het LongCat API-platform van Meituan, komt overeen qua context bij 1.000.000 tokens en blijft op de output ernstig onder de maat bij 131.072. Het inputprofiel is de actuele vraag: de changelog presenteert beeldbegrip als de voornaamste toevoeging, maar de voorbeeldrespons in Meituan's eigen "Retrieve Model"-documentatie toont nog steeds input_modalities/ als ["text"]/ met een text->text/ modaliteitsstring. MiniMax M3 accepteert ook video, wat LongCat-2.5-Preview helemaal niet claimt. Als jouw pipeline schermopnames of framesreeksen aanvoert, eindigt deze vergelijking hier.

De cache-asymmetrie loopt de andere kant op en verdient het om in het voordeel van Meituan te worden vermeld, want het is de enige dimensie waarop het nieuwe model zich echt onderscheidt. $0,006 per miljoen gecachte invoer tegenover $0,06 is een echt voordeel voor agent-workloads die bij elke beurt dezelfde lange prefix opnieuw versturen — wat voor de meeste daarvan geldt. Het is ook de regelpost die het waarschijnlijkst zonder kennisgeving zal veranderen, aangezien Meituan de hele kaart als een tijdelijke korting aanmerkt.

De bewijskloof, eerlijk gemeten in beide richtingen

De benchmarkpositie van MiniMax M3 is niet sterk, en dat benoemen hoort bij het goed uitvoeren van deze vergelijking. Artificial Analysis registreert een Coding Index van 58,6 voor het model — de zesenveertigste van de gevolgde modellen — en een Intelligence Index van 29,2 op de zestigste plaats. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. De eigen gepubliceerde cijfers van MiniMax bestrijken een ander gebied: BrowseComp 83,5, GDPval rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Dat zijn door de leverancier gerapporteerde cijfers en die horen in een andere kolom dan de onafhankelijke cijfers, maar ze bestaan, en dat is het sleutelwoord.

A screenshot of OrcaRouter's own model page for MiniMax M3 at /models/minimax/minimax-m3, showing the minimax/minimax-m3 identifier, a 1M-token context window, 512K maximum output, text + image + video input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-05-31, a p50 first-token figure of 3.35 s, $0.30 and $1.20 rate tiles, and the OpenAI-compatible code samples.

LongCat-2.5-Preview heeft helemaal geen kolom. Geen gepubliceerde benchmarktabel, geen modelkaart, geen technisch rapport, geen repository op HuggingFace of in de GitHub-organisatie van Meituan, en catalogusmetadata die open weights als false registreert. Het aantal van ongeveer 1,6 biljoen totale / 48 miljard actieve parameters is afkomstig uit de sitemetadata van Meituan en Chinese vakpers, niet uit documentatie. De accurate bewering is dus: de scores van M3 zijn middelmatig en afkomstig uit onafhankelijke bronnen; die van LongCat-2.5-Preview ontbreken. Een model dat in de veertig scoort op de coderingsindex is een bekend gegeven waarmee je kunt plannen. Een model zonder score is een ander soort risico, en omdat de prijs identiek is, verdwijnt de compensatie die normaal gesproken rechtvaardigt dat je ervoor kiest.

Waar dezelfde prijs verandert wat je moet doen

Wanneer een nieuw model de concurrentie onderbiedt, is de rationele zet om het te evalueren — het voordeel is een echte korting. Wanneer een nieuw model precies dezelfde prijs heeft als een gevestigde speler die al sinds mei levert, is het voordeel niet de prijs. Het zijn de capaciteiten, en capaciteiten zijn nu juist het enige dat LongCat-2.5-Preview niet heeft gepubliceerd. Dat herkadert de evaluatie volledig: je test niet of het goedkoper is, je test of het beter is, op jouw taken, vanaf nul zonder enig bewijs als houvast.

Er is een detail van de tweede orde dat die test goedkoper maakt dan hij lijkt. LongCat-2.5-Preview is gratis en onbeperkt via OpenCode gedurende een periode van onbekende lengte, met een zeroretentiebeleid dat OpenCode expliciet documenteert — modeltraining "Niet gebruikt", gegevensretentie "0 dagen", tegenover dertig dagen voor de vergelijkingsvermelding. De kosten van het genereren van je eigen evaluatie liggen dus bijna op nul, en het retentiebeleid betekent dat je het op privécode kunt loslaten. Het enige harnasdetail dat je eerst moet regelen, is dat het model zijn redeneerspoor teruggeeft in een tussengevoegd reasoning_content-veld; clients die chat completions parsen zonder dit te verwachten, laten het denkproces stilzwijgend weg en laten het model slechter lijken dan het is.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs MiniMax M3' with the subhead 'Identical headline rates, four times the output ceiling, ten times the cache discount'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'MiniMax M3' (MiniMax, released 2026-05-31, independently scored): 1,048,576-token context, 512,000 max output described as four times as much, text, image and video to text, $0.30 uncached / $0.06 cached input, $1.20 output, coding index 58.6 at rank 46 and intelligence index 29.2 at rank 60 by Artificial Analysis, long-context recall 83. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

Het routeringsargument, specifiek voor een vergelijking bij gelijke prijs

Wij bieden MiniMax M3 aan tegen MiniMax' lijstprijs met nul opslag. LongCat-2.5-Preview is geen van onze routes — wij bieden het niet aan, en niets hier mag worden opgevat als een bewering van het tegendeel.

Een matchup met dezelfde prijs is precies het geval waarin routing zijn bestaansrecht verdient in plaats van louter gemak te zijn. Als twee modellen evenveel kosten, is de keuze tussen hen per verzoek en per taak: M3 voor het uitvoerplafond van 512.000 tokens en video-invoer, LongCat-2.5-Preview voor de korting op gecachte prefixen bij lange agent-loops, zodra je jezelf hebt overtuigd van de kwaliteit. Modelfusie is het mechanisme dat dat letterlijk maakt — een retrieval-stap en een synthesestap kunnen verschillende modellen zijn binnen één verzoek, zodat je niet gedwongen wordt een winnaar te kiezen voordat je bewijs hebt. En omdat wij de lijstprijzen van providers doorgeven zonder markup, komt een tariefwijziging van een leverancier dezelfde dag op je factuur terecht in plaats van bij de volgende contractverlenging, wat meer dan gewoonlijk van belang is wanneer een van de twee kaarten expliciet promotioneel is. Automatische failover dekt dan de situatie waarin één provider degradeert, en dat is het belangrijkst voor het model zonder serveergeschiedenis om te inspecteren.

Vaak gesteld

• Is LongCat-2.5-Preview goedkoper dan MiniMax M3? Nee. Op de gepubliceerde tariefkaarten zijn de tarieven voor input en output identiek: $0,30 en $1,20 per miljoen. Het enige prijsvoordeel is te vinden bij gecachte input: $0,006 tegenover $0,06, en Meituan bestempelt de hele tariefkaart als een tijdelijke korting zonder te zeggen wat er daarna komt.

• Welke heeft de grotere bruikbare output? MiniMax M3 met een ruime marge: 512.000 tokens tegenover 131.072. Voor het genereren van lange teksten, gestructureerde extractie uit grote documenten, of alles wat meer dan een hoofdstuk schrijft, is die bovengrens de doorslaggevende specificatie.

• Welke kan ik verifiëren? MiniMax M3, en de verificatie is niet flatteus voor het model — Coding 58,6 op de zesenveertigste plaats en een Intelligence Index van 29,2 op de zestigste plaats van Artificial Analysis. LongCat-2.5-Preview heeft van niemand een gepubliceerde evaluatie. Als er deze week een LongCat-2.5-Preview-benchmark verschijnt, behandel die dan als niet verifieerbaar totdat je hem kunt herleiden tot een met naam genoemde evaluator.

• Welke moet ik in productie zetten? Geen van beide zonder een eigen test. Van de twee is M3 de keuze met de laagste variantie, omdat de zwakke punten gedocumenteerd zijn en de invoermodaliteiten bevestigd zijn; LongCat-2.5-Preview is degene met de hoogste variantie, met een grotere contextclaim, een veel lager uitvoerplafond, een cachekorting en nul openbaar bewijs. Draai het gratis zolang het venster open is, houd beide achter één sleutel, en laat je eigen cijfers de beslissing nemen.