
Step 5 Preview vs MiniMax M3: goedkoper per token, duurder per punt
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
De prijs per eenheid valt ruim in het voordeel van MiniMax M3 uit. Met $0,30 per miljoen input en $1,20 per miljoen output onderbiedt het 428B sparse model van de leverancier de $1,00 en $2,70 van Step 5 Preview aan beide kanten met meer dan een factor twee. Maar de prijs per eenheid is de verkeerde noemer voor een model dat je gebruikt om vragen te beantwoorden, en zodra je deelt door wat elk model daadwerkelijk levert, keert de rangorde om. Step 5 Preview kost $0,71 per Intelligence Index-taak bij een score van 44. MiniMax M3 kost $0,51 per indextaak bij een score van 29. Per punt gemeten capaciteit is het model met het hogere prijskaartje het goedkoopste — en de reden is een verschil van vijftien punten op de index dat geen enkele korting dicht.
Twee heel verschillende soorten "beschikbaar"
MiniMax M3 is algemeen beschikbaar sinds 1 juni 2026, toen MiniMax het opende via MiniMax Code, zijn Token Plan en de API — nergens in de lancering een preview-label. De gewichten volgden op 12 juni, elf dagen later, zoals beloofd. De repository MiniMaxAI/MiniMax-M3 bevat ongeveer 428 miljard totale parameters, met ongeveer 23 miljard actief per token, gebouwd op MiniMax Sparse Attention, naast een aparte MXFP8-gekwantiseerde release.
Step 5 Preview opende zijn API op 20 september 2026. De gewichten zijn niet gepubliceerd — de Hugging Face-repository stepfun-ai/Step-5-Preview-BF16 is een lege huls — en StepFun heeft zich vastgelegd op een datum van 15 oktober 2026. Het praktische verschil is dus dat M3 een model is dat je kunt downloaden, zelf kunt hosten en kunt inspecteren, terwijl Step 5 Preview een gehoste endpoint is met een gepubliceerde intentie.
Het is het vermelden waard: MiniMax' eigen modelpagina zegt nog steeds dat M3 "binnenkort volledig open-source wordt gemaakt", wat in tegenspraak is met de repository die het in juni heeft gepubliceerd. Beschouw dat als een verouderde leverancierspagina, niet als bewijs dat de gewichten ontbreken.
Het prijsverhaal is niet het kostenverhaal
Artificial Analysis berekent een kosten-per-index-taakcijfer door dezelfde evaluatieset door elk model te laten lopen en de totale tokencosten op te tellen. Het is het dichtste dat het vakgebied heeft bij een total-cost-of-ownershipcijfer voor een vaste hoeveelheid werk, en het neemt de twee effecten mee die tokenprijzen verbergen: hoe breedsprakig een model is, en hoeveel het nadenkt.
Step 5 Preview komt uit op $0,71 per indextaak, met een totale kostprijs voor de indexrun van $922,84. MiniMax M3 komt uit op $0,51, met een totale kostprijs voor de run van $537,98. Op basis van de ruwe doorvoer van taken is M3 ongeveer 28% goedkoper. Deel door de indexscore — 44 tegenover 29 — en Step 5 Preview komt uit op ongeveer 1,6 cent per indexpunt tegenover de 1,8 cent van M3.
Een voorbehoud is hier op zijn plaats: dat is één indexrun per model, en een indexrun is een kleine steekproef. De rekenkundige bewerking per punt is een sanitycheck op het cijfer per taak, niet een benchmark op zichzelf. Maar de richting komt overeen met de cijfers per taak, en dat zijn de cijfers die de prijslijsten van de twee leveranciers zelf niet kunnen tonen.
• Intelligence Index — Step 5 Preview 44 (#24 van 200) vs MiniMax M3 29 (#15 van 113), beide op de huidige indexversie
• Inputprijs — $1,00 per miljoen vs. $0,30 per miljoen
• Outputprijs — $2,70 per miljoen vs $1,20 per miljoen
• Kosten per indextaak — $0.71 vs $0.51
• Actieve parameters — 27B vs 23B
• Contextvenster — 1M tokens vs 1M tokens
• Uitvoersnelheid — 99,8 tokens/s vs 210,4 tokens/s
• Gewichten — beloofd 15 oktober 2026 vs beschikbaar sinds 12 juni 2026

De indexversie-valkuil die dit verwarrend maakt
Er schuilt een reëel gevaar in het lezen van de cijfers van M3, en het is een alinea waard, want het laat bijna elke vergelijkingspagina van derden struikelen. Artificial Analysis heeft zijn Intelligence Index opnieuw gekalibreerd op 7 september 2026, en de herkalibratie drukte de scores over de hele linie. Volgens de huidige schaal meet M3 29. Volgens de schaal van vóór september mat het 44 tot 45 — en een aantal trackers publiceert nog steeds 44,4 of 45,4 voor M3.
Die botsing is hier meer dan gebruikelijk van belang, omdat de huidige score van Step 5 Preview ook 44 is. Een pagina die een verouderd M3-cijfer naast een actueel Step 5 Preview-cijfer zet, lijkt twee modellen gelijk te laten eindigen, terwijl het huidige verschil vijftien punten is. Beide cijfers in dit artikel komen uit de huidige indexversie en zijn onderling vergelijkbaar; alles wat vóór 7 september is gepubliceerd, is dat niet.
Waar MiniMax M3 echt moeilijk te verslaan is
Twee dingen aan M3 zijn niet dichtbij. Het eerste is snelheid: 210,4 outputtokens per seconde, de vierde snelste van de 113 modellen die Artificial Analysis volgt, tegenover een mediaan van 76,3. De 99,8 tokens per seconde van Step 5 Preview is respectabel en minder dan de helft daarvan. De tijd tot het eerste token van M3 van 1,01 seconde is eveneens het snellere cijfer tegenover 2,96 seconden.
De tweede is invoermodaliteit. M3 accepteert tekst, afbeelding en video en retourneert tekst, en MiniMax documenteert desktop- en computergebruikbediening. Step 5 Preview accepteert tekst en afbeeldingen. Als je pipeline schermopnames of videoframes aan een model voert, is dat geen voorkeur — het is een verschil in mogelijkheden.
Het prijsverschil versterkt beide. Met $0,30 en $1,20, met een permanente korting van 50% toegepast op een lijstprijs van $0,60 en $2,40, en een cachediscount van 80% die cache-reads naar $0,06 per miljoen brengt, is M3 een van de goedkoopste manieren om een groot volume tokens door een capabel model te verwerken. Let op de staffeling: input boven 512K tokens verdubbelt het hele verzoek, en de priority-servicetier kost 1,5×.
Waar het uit elkaar valt
MiniMax' eigen evaluatieset voor M3 is sterk en moet worden opgevat als door de leverancier gerapporteerd: SWE-bench Verified op 80,5%, SWE-bench Pro op 59,0%, Terminal-Bench 2.1 op 66,0%, MCP Atlas op 74,2%, BrowseComp op 83,5 en OSWorld-Verified op 70,06%. MiniMax heeft deze op zijn eigen infrastructuur gedraaid met Claude Code als scaffolding, met een gemiddelde over vier runs, en de scoringsopzet is niet openbaar — dus ze zijn zoals de zaken er nu voor staan niet reproduceerbaar door een derde partij.
Het onafhankelijk gemeten beeld is veel harder voor agentisch werk. Artificial Analysis registreerde Terminal-Bench 4.0 op 2% voor M3 — een andere versie van de benchmark dan het Terminal-Bench 2.1-cijfer van de leverancier, en niet daarmee vergelijkbaar, maar hoe dan ook schrijnend. SciCode kwam uit op 47%, AutomationBench-AA op 21%, en CritPt op 4%. De sterkste onafhankelijke resultaten van M3 liggen op het gebied van lange context en kenniswerk: AA-LCR v1.1 op 83%, Humanity's Last Exam op 39%.
Step 5 Preview keert dat profiel om. Terminal-Bench 4.0 op 33,3% met dezelfde harness als M3's 2%, SciCode op 59% tegenover 47%. Als het werk agentisch of code-achtig is, is dit geen nek-aan-nekvergelijking en weegt het prijsvoordeel daar niet tegenop.

De licentieclausule die de meeste vergelijkingen overslaan
MiniMax M3 heeft open gewichten, maar het is geen open source in de OSI-zin, en de voorwaarden zijn strenger dan de uitdrukking "open weights" doet vermoeden. De repository bevat de MiniMax Community License: gratis voor niet-commercieel gebruik, met commercieel gebruik onder de voorwaarde dat "Built with MiniMax M3" prominent wordt weergegeven — en elk product met meer dan $20 miljoen USD aan jaarlijkse omzet vereist voorafgaande schriftelijke toestemming van MiniMax. Het is geen MIT, geen Apache, en niet het soort licentie dat een juridisch team er zomaar doorheen laat gaan.
Step 5 Preview kan op deze as nog helemaal niet worden beoordeeld, omdat er nog geen licentie is om te lezen. StepFun heeft zich ertoe verbonden op 15 oktober een release van de gewichten te doen en heeft de voorwaarden die daarvoor zullen gelden niet gepubliceerd. Wie van plan is erop voort te bouwen, moet de licentie als een open vraag beschouwen in plaats van aan te nemen dat die op die van Moonshot of DeepSeek zal lijken.
Dit is de eerlijke asymmetrie tussen de twee: de voorwaarden van M3 zijn beperkend maar bekend; die van Step 5 Preview zijn onbekend. Een beperkende licentie waar je rekening mee kunt houden, is beter dan een onaangekondigde waar dat niet kan.
Een van beide bellen
MiniMax M3 staat in onze catalogus op /models/minimax/minimax-m3, bereikbaar via dezelfde sleutel en dezelfde aanvraagvorm als de rest van de ruim 200 modellen die we routeren, waarbij de lijstprijs van de provider tegen 0% opslag wordt doorgegeven — dus de permanente korting van 50% die MiniMax heeft toegepast, is de prijs die je ziet, en die verandert op de dag dat MiniMax die verandert. Automatische failover is de andere helft daarvan: M3 met 210 tokens per seconde is aantrekkelijk voor werk met een hoog volume, en werk met een hoog volume is precies waar één gedegradeerd endpoint het meest pijn doet.
Step 5 Preview staat niet in onze catalogus. De tekstmodellen van StepFun behoren niet tot de modellen die wij aanbieden, dus het is beschikbaar via de eigen API van StepFun en verschillende platforms van derden — en het is niet bereikbaar met de sleutel die je voor M3 zou gebruiken.

Het vonnis
Kies MiniMax M3 wanneer volume, latentie of video-invoer de beperkende factor is, wanneer je een model wilt dat je vandaag kunt downloaden, en wanneer je kunt leven met de communitylicentie — inclusief de omzetdrempel van $20 miljoen. Accepteer dat onafhankelijke agentic-scores het ver achterop plaatsen, en dat de leveranciersbenchmarks niet zijn gereproduceerd buiten MiniMax' eigen infrastructuur.
Neem Step 5 Preview wanneer het werk agentisch of code-intensief is, wanneer je capaciteit per dollar wilt in plaats van tokens per dollar, en wanneer je het prettig vindt om een vroege klant te zijn van een gehost endpoint waarvan de weights volgende maand arriveren. Accepteer dat je de licentie niet kunt controleren voordat je bouwt, en dat een verschil van 2% tegenover 33,3% op Terminal-Bench 4.0 het soort kloof is dat een project beslist.
De korting is echt. Het is alleen niet het ding dat gekocht wordt.
MiniMax M3 is een van de modellen die we routeren tegen 0% opslag met automatische failover, dus een prijswijziging van de leverancier is dezelfde dag live op dezelfde key.
