
LongCat-2.5-Preview vs MiniMax M3: De goedkope plaats is al bezet
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 610 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 189 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
Het uitgangspunt van de meeste berichtgeving over LongCat-2.5-Preview is dat Meituan de rest van het veld heeft onderboden. Tegenover MiniMax M3 vervliegt dat uitgangspunt onmiddellijk. MiniMax M3 staat in onze catalogus voor $0,30 per miljoen inputtokens en $1,20 per miljoen outputtokens. De gepubliceerde tariefkaart van LongCat-2.5-Preview vermeldt $0,30 per miljoen niet-gecachete inputtokens en $1,20 per miljoen outputtokens. Dat zijn geen vergelijkbare cijfers; het zijn dezelfde cijfers. Het enige punt waarop ze uiteenlopen, is gecachte input, waar Meituan $0,006 per miljoen rekent tegenover $0,06 van de gevestigde aanbieder — een tienvoudig verschil op de goedkoopste regel van de rekening. De interessante vraag is dus niet of LongCat-2.5-Preview goedkoop is. Het is wat je koopt en opgeeft wanneer een nieuw model tegen exact dezelfde prijs als de gevestigde aanbieder op de markt komt.
Het korte antwoord: een veel hoger outputplafond, een veel dunnere bewijsbasis en een cachekorting.
Dezelfde koprijs, heel verschillende gepubliceerde plafonds.
MiniMax M3 is sinds 31 mei 2026 officieel bekend. Onze catalogus bevat het met een contextvenster van 1.048.576 tokens en een maximale uitvoer van 512.000 tokens — meer dan de meeste modellen toestaan, en vier keer de 131.072 van LongCat-2.5-Preview. Het accepteert tekst, afbeeldingen en video als invoer en retourneert tekst, met beschikbare tool calling, JSON-modus en reasoning.

LongCat-2.5-Preview, op 25 september 2026 vermeld op het LongCat API-platform van Meituan, komt overeen qua context bij 1.000.000 tokens en blijft op de output ernstig onder de maat bij 131.072. Het inputprofiel is de actuele vraag: de changelog presenteert beeldbegrip als de voornaamste toevoeging, maar de voorbeeldrespons in Meituan's eigen "Retrieve Model"-documentatie toont nog steeds input_modalities/ als ["text"]/ met een text->text/ modaliteitsstring. MiniMax M3 accepteert ook video, wat LongCat-2.5-Preview helemaal niet claimt. Als jouw pipeline schermopnames of framesreeksen aanvoert, eindigt deze vergelijking hier.
De cache-asymmetrie loopt de andere kant op en verdient het om in het voordeel van Meituan te worden vermeld, want het is de enige dimensie waarop het nieuwe model zich echt onderscheidt. $0,006 per miljoen gecachte invoer tegenover $0,06 is een echt voordeel voor agent-workloads die bij elke beurt dezelfde lange prefix opnieuw versturen — wat voor de meeste daarvan geldt. Het is ook de regelpost die het waarschijnlijkst zonder kennisgeving zal veranderen, aangezien Meituan de hele kaart als een tijdelijke korting aanmerkt.
De bewijskloof, eerlijk gemeten in beide richtingen
De benchmarkpositie van MiniMax M3 is niet sterk, en dat benoemen hoort bij het goed uitvoeren van deze vergelijking. Artificial Analysis registreert een Coding Index van 58,6 voor het model — de zesenveertigste van de gevolgde modellen — en een Intelligence Index van 29,2 op de zestigste plaats. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. De eigen gepubliceerde cijfers van MiniMax bestrijken een ander gebied: BrowseComp 83,5, GDPval rubrics 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Dat zijn door de leverancier gerapporteerde cijfers en die horen in een andere kolom dan de onafhankelijke cijfers, maar ze bestaan, en dat is het sleutelwoord.

LongCat-2.5-Preview heeft helemaal geen kolom. Geen gepubliceerde benchmarktabel, geen modelkaart, geen technisch rapport, geen repository op HuggingFace of in de GitHub-organisatie van Meituan, en catalogusmetadata die open weights als false registreert. Het aantal van ongeveer 1,6 biljoen totale / 48 miljard actieve parameters is afkomstig uit de sitemetadata van Meituan en Chinese vakpers, niet uit documentatie. De accurate bewering is dus: de scores van M3 zijn middelmatig en afkomstig uit onafhankelijke bronnen; die van LongCat-2.5-Preview ontbreken. Een model dat in de veertig scoort op de coderingsindex is een bekend gegeven waarmee je kunt plannen. Een model zonder score is een ander soort risico, en omdat de prijs identiek is, verdwijnt de compensatie die normaal gesproken rechtvaardigt dat je ervoor kiest.
Waar dezelfde prijs verandert wat je moet doen
Wanneer een nieuw model de concurrentie onderbiedt, is de rationele zet om het te evalueren — het voordeel is een echte korting. Wanneer een nieuw model precies dezelfde prijs heeft als een gevestigde speler die al sinds mei levert, is het voordeel niet de prijs. Het zijn de capaciteiten, en capaciteiten zijn nu juist het enige dat LongCat-2.5-Preview niet heeft gepubliceerd. Dat herkadert de evaluatie volledig: je test niet of het goedkoper is, je test of het beter is, op jouw taken, vanaf nul zonder enig bewijs als houvast.
Er is een detail van de tweede orde dat die test goedkoper maakt dan hij lijkt. LongCat-2.5-Preview is gratis en onbeperkt via OpenCode gedurende een periode van onbekende lengte, met een zeroretentiebeleid dat OpenCode expliciet documenteert — modeltraining "Niet gebruikt", gegevensretentie "0 dagen", tegenover dertig dagen voor de vergelijkingsvermelding. De kosten van het genereren van je eigen evaluatie liggen dus bijna op nul, en het retentiebeleid betekent dat je het op privécode kunt loslaten. Het enige harnasdetail dat je eerst moet regelen, is dat het model zijn redeneerspoor teruggeeft in een tussengevoegd reasoning_content-veld; clients die chat completions parsen zonder dit te verwachten, laten het denkproces stilzwijgend weg en laten het model slechter lijken dan het is.

Het routeringsargument, specifiek voor een vergelijking bij gelijke prijs
Wij bieden MiniMax M3 aan tegen MiniMax' lijstprijs met nul opslag. LongCat-2.5-Preview is geen van onze routes — wij bieden het niet aan, en niets hier mag worden opgevat als een bewering van het tegendeel.
Een matchup met dezelfde prijs is precies het geval waarin routing zijn bestaansrecht verdient in plaats van louter gemak te zijn. Als twee modellen evenveel kosten, is de keuze tussen hen per verzoek en per taak: M3 voor het uitvoerplafond van 512.000 tokens en video-invoer, LongCat-2.5-Preview voor de korting op gecachte prefixen bij lange agent-loops, zodra je jezelf hebt overtuigd van de kwaliteit. Modelfusie is het mechanisme dat dat letterlijk maakt — een retrieval-stap en een synthesestap kunnen verschillende modellen zijn binnen één verzoek, zodat je niet gedwongen wordt een winnaar te kiezen voordat je bewijs hebt. En omdat wij de lijstprijzen van providers doorgeven zonder markup, komt een tariefwijziging van een leverancier dezelfde dag op je factuur terecht in plaats van bij de volgende contractverlenging, wat meer dan gewoonlijk van belang is wanneer een van de twee kaarten expliciet promotioneel is. Automatische failover dekt dan de situatie waarin één provider degradeert, en dat is het belangrijkst voor het model zonder serveergeschiedenis om te inspecteren.
Vaak gesteld
• Is LongCat-2.5-Preview goedkoper dan MiniMax M3? Nee. Op de gepubliceerde tariefkaarten zijn de tarieven voor input en output identiek: $0,30 en $1,20 per miljoen. Het enige prijsvoordeel is te vinden bij gecachte input: $0,006 tegenover $0,06, en Meituan bestempelt de hele tariefkaart als een tijdelijke korting zonder te zeggen wat er daarna komt.
• Welke heeft de grotere bruikbare output? MiniMax M3 met een ruime marge: 512.000 tokens tegenover 131.072. Voor het genereren van lange teksten, gestructureerde extractie uit grote documenten, of alles wat meer dan een hoofdstuk schrijft, is die bovengrens de doorslaggevende specificatie.
• Welke kan ik verifiëren? MiniMax M3, en de verificatie is niet flatteus voor het model — Coding 58,6 op de zesenveertigste plaats en een Intelligence Index van 29,2 op de zestigste plaats van Artificial Analysis. LongCat-2.5-Preview heeft van niemand een gepubliceerde evaluatie. Als er deze week een LongCat-2.5-Preview-benchmark verschijnt, behandel die dan als niet verifieerbaar totdat je hem kunt herleiden tot een met naam genoemde evaluator.
• Welke moet ik in productie zetten? Geen van beide zonder een eigen test. Van de twee is M3 de keuze met de laagste variantie, omdat de zwakke punten gedocumenteerd zijn en de invoermodaliteiten bevestigd zijn; LongCat-2.5-Preview is degene met de hoogste variantie, met een grotere contextclaim, een veel lager uitvoerplafond, een cachekorting en nul openbaar bewijs. Draai het gratis zolang het venster open is, houd beide achter één sleutel, en laat je eigen cijfers de beslissing nemen.
