Ett genererat hero-kort med titeln MiniMax M3.1 Flash Preview och undertexten 'Live på Token Plan, 27 september 2026'. Tre chips lyder '1M-tokenkontext', 'text + bild + video som indata' och 'endast Token Plan – ingen betalning per användning'. Ett kort till vänster lyder 'Bekräftat av leverantören: samma Subscription Key som M3 och M2.7, tänkande aktiverat som standard, effort från låg till max'; ett kort till höger lyder 'Ej publicerat: pris per token, modellkort, benchmarks, vikter, oberoende mätning'. OrcaRouter-logotypen sitter nere till höger.
Guides & Insights

MiniMax M3.1 Flash Preview är nu live på Token Plan: vad din prenumeration faktiskt låser upp

Författare

Elias Hawthorne

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

MiniMax-M3.1-Flash-Preview gick live den 27 september 2026, och sättet den gick live på är själva historien. Det är inte en modell med betalning per användning. Leverantören har lagt sin nyaste textmodell bakom samma Token Plan Subscription Key som redan omfattar MiniMax-M3, MiniMax M2.7 och varianten M2.7-highspeed, så om du har en plats finns det ingen ny nyckel att skapa och inget andra avtal att skriva under. Det som inte heller finns, i dag, är ett pris per token, ett modellkort, ett publicerat benchmark eller något sätt att stänga av modellens tänkande.

Den kombinationen – friktionslös åtkomst i kombination med helt opublicerade ekonomiska villkor – är ovanlig nog att vara värd att reda ut innan någon kopplar en produktionspipeline till den. Resten av den här artikeln är vad leverantörens egen dokumentation faktiskt säger, vad den påfallande nog inte säger, och den enda kodrad som inom en minut kommer att berätta för dig huruvida den här modellen passar hur du arbetar.

Vad landade egentligen den 27 september

MiniMaxs utvecklardokumentation innehåller nu en stående not, som upprepas på varje sida för textmodeller: MiniMax-M3.1-Flash-Preview är för närvarande endast tillgänglig via Token Plan och MiniMax Code. Modellen visas först i leverantörens egen modelltabell, ovanför MiniMax-M3, och beskrivs som en banbrytande multimodal kodningsmodell med ett kontextfönster på 1M och justerbart tänkandedjup.

• Kontextfönster — 1 000 000 tokens, samma tak som MiniMax-M3 har
• Indatamodaliteter — text, bild och video, returnerar text
• Tankedjup — en effort-inställning som accepterar low, medium, high, xhigh och max, med standardvärdet max när det utelämnas
• Protokollstöd — samma modell-id fungerar via MiniMaxs Anthropic-kompatibla slutpunkt, dess OpenAI-kompatibla slutpunkt och dess OpenAI Responses-slutpunkt
• Tillgänglighet — endast Token Plan och MiniMax Code; inte via pay-as-you-go
• Pris — inget pris per token har publicerats någonstans
• Vikter — inga; MiniMaxAI-organisationens två senaste offentliga repositorier är fortfarande MiniMax-Music3 och MiniMax-H3
• Oberoende benchmarks — inga; modellen finns inte med i Artificial Analysis modellindex

Företaget tillkännagav det samma dag på sitt MiniMaxAgent-konto och ramade in det för vardaglig utveckling snarare än banbrytande arbete: snabbt och pålitligt, från snabba buggfixar till fullständig funktionsutveckling. Det är en uppgift för Flash-nivån, inte för en flaggskeppsmodell. Tredjepartsbevakning från PANews och KuCoin beskrev det i samma ordalag och noterade att utvecklare hade upptäckt modellen i MiniMax Code-väljaren innan företaget bekräftade det.

A headless Chromium screenshot of MiniMax's own model documentation page, showing the standing note that MiniMax-M3.1-Flash-Preview is available only through Token Plan and MiniMax Code for now, above the vendor's language-model table in which MiniMax-M3.1-Flash-Preview is listed first with a 1,000,000-token context window and the description 'Frontier multimodal coding model with 1M context window and tunable thinking depth', ahead of MiniMax-M3 with the same 1,000,000-token window, captured 28 September 2026.

Vilken nyckel du använder spelar större roll än vanligt.

Det här är delen som får folk att gå i fällan. MiniMax har två separata typer av autentiseringsuppgifter, och M3.1-Flash-Preview svarar bara på en av dem. Token Plan-prenumerationsnyckeln kommer från Billing > Token Plan och täcker prenumerationsanvändning och köpta Credits. API-nyckeln för betala per användning täcker per-token-modellerna. Leverantörens dokumentation är tydlig med att de två inte är utbytbara, och att en prenumerationsnyckel kan finnas innan någon betald resurs har kopplats till den — i vilket fall det är en giltig nyckel utan något bakom sig.

Så det praktiska testet är inte ”har jag en MiniMax API-nyckel” utan ”har jag en Token Plan-plats”. Befintliga platser täcks. Dokumentationen noterar att en Subscription Key blir användbar när en plats eller Credits-åtkomst tilldelas, och att Credits-överskott dras automatiskt när prenumerationskvoten har förbrukats.

Det finns också en dokumentationsinkonsekvens som är värd att känna till, eftersom den kommer att förvirra alla som läser prissidan först. Täckningsfotnoten på Token Plan-prissidan listar fortfarande det kvalificerade utbudet som M3, M2.7, bild och tal, med H3 utesluten – den har inte uppdaterats för att ange M3.1-Flash-Preview. Modellsidorna säger motsatsen: att M3.1-Flash-Preview är tillgänglig i Token Plan och inget annat. Båda sidorna är aktiva leverantörssidor i dag. Endast nyckeln i din hand avgör saken.

400:an som talar om vilken typ av modell detta är

Varje modell i MiniMax M-serien tänker innan den svarar, men M3.1-Flash-Preview är den första som vägrar sluta. Skicka thinking: {"type": "disabled"} eller reasoning_effort: "none" och API:et returnerar HTTP 400 med meddelandet:

Modellen "MiniMax-M3.1-Flash-Preview" kräver adaptivt tänkande; thinking.type="disabled" (inklusive reasoning.effort=none) är inte tillåtet (2013)

Tillverkarens egen vägledning är att sänka ansträngningen i stället för att försöka stänga av tänkandet, och stegen är latensreglaget: en rutinmässig redigering vid low och en ändring i hela kodbasen vid xhigh är samma modell som gör olika avvägningar. Två ytterligare detaljer är specifika för den här modellen. Parametern reasoning_effort dokumenteras som effektiv endast för MiniMax-M3.1-Flash-Preview – den är inte någon allmän styrning för M-serien. Och reasoning_split-utdatabrytaren, som separerar tänkande i ett reasoning_content-fält, kan för närvarande inte sättas till false på den här modellen.

Var tänkandetexten hamnar är protokollberoende: den Anthropic-kompatibla slutpunkten returnerar den som ett tänkande-innehållsblock, den OpenAI-kompatibla slutpunkten returnerar den i reasoning_content, och Responses-slutpunkten returnerar den som ett utdataobjekt för resonemang. Om du parsade <think>-taggar ur MiniMax-M3-utdata är det arbetet inte längre nödvändigt på den nyare modellen — och för konversationer med interfolierad verktygsanvändning måste hela svaret, inklusive tänkandeblocket, läggas tillbaka i meddelandehistoriken, annars bryts resonemangskedjan.

Kampanjen som pågår just nu

MiniMax Code kör en incheckningskampanj från 28 september till 7 oktober i UTC+8, med dubbla gratiskrediter för dagliga inloggningar och öppnar den för både nya och befintliga användare. De rapporterade krediterna gäller för samtliga modeller som stöds, med M3.1-Flash-Preview och H3-videomodellerna som exempel. Separat uppgav företaget att kvoterna för Token Plan återställs för alla användare vid lansering och att ytterligare återställningar planeras under evenemanget, med behörighet som visas i appen.

Betrakta de två som leverantörsuttalanden som förmedlats via lanseringsbevakningen – de är kampanjvillkor med datum kopplade till sig, inte produktbeteende, och samma bevakning noterar att tillkännagivandet inte specificerade antalet krediter per incheckning eller de exakta reglerna för missade dagar. Ekonomin i stabilt tillstånd är enklare att ange: Token Plan listas till $22 per månad för Plus, $55 för Max och $132 för Ultra, med rullande 5-timmars- och veckovisa kvotfönster, dimensionerade av leverantören till ungefär tre till fyra, fyra till fem respektive sex till sju samtidiga agenter. Köpta Credits kostar 1 000 krediter per dollar och dras av enligt varje modells pay-as-you-go-listpris.

De fyra sakerna den här modellen fortfarande inte har

Inget av följande är en kritik av modellen; vart och ett är ett hål som ett team måste planera kring, och alla fyra är verifierbara i dag.

• Inget pris. Det finns ingen per-token-taxa för M3.1-Flash-Preview på någon MiniMax-sida, så den kan inte jämföras med M3:s $0,30 per miljon input och $1,20 per miljon output, eller med något annat, i kostnad per token.
• Inga benchmarks. MiniMax publicerade ingen utvärderingstabell i samband med denna lansering. Inte heller någon annan: modellen saknas i Artificial Analysis index, så dess kolumn är verkligen tom snarare än bara för tidig.
• Inga vikter. MiniMax-M3 levererades med öppna vikter; M3.1-Flash-Preview har inget arkiv och ingen nedladdningsbar checkpoint.
• Inga oberoende mätningar. Inga siffror för utmatningshastighet, latens eller felfrekvens från någon tredje part, och inga från vår egen routing-telemetri, eftersom modellen inte finns i vår katalog.

Jämfört med M3-lanseringen i juni 2026, som kom med en arkitekturanteckning, ett benchmarkblad och en prislista redan första dagen, är detta en avsiktligt tyst lansering. Den rimliga tolkningen — och det är en tolkning, inte en uttalad plan — är att MiniMax vill se verklig användning i sin egen produkt innan man bestämmer vad modellen kostar och om man öppnar upp den.

A generated two-column infographic titled 'What the vendor confirms, and what it has not published', for MiniMax M3.1 Flash Preview. The left column, headlined 'Confirmed on day one', lists 'Listed first in MiniMax's own model table, above MiniMax-M3', '1,000,000-token context window', 'Text, image and video input returning text', 'An effort ladder from low to max, defaulting to max', 'Reachable over Anthropic-, OpenAI- and Responses-compatible endpoints', and 'Covered by the existing Token Plan Subscription Key'. The right column, headlined 'Still unpublished', lists 'Per-token price, anywhere on MiniMax's pages', 'A model card or evaluation table', 'Public weights or a downloadable checkpoint', 'Any entry on Artificial Analysis's model index', and 'Output-speed and latency figures from any third party'. A footer reads 'Per platform.minimax.io documentation and the launch announcement, 27 September 2026.'

Vad den läckta förhandsvisningsnoten hade rätt om

Fyra dagar före lanseringen cirkulerade ett förhandsvisningsdokument, transkriberat i ett offentligt partnerarkiv, som beskrev en MiniMax M3.1 med sparse attention, Q8KV4-attentionskvantisering, NVFP4-routade experter, ett DSpark-huvud för spekulativ avkodning och ett nytt reasoning_effort-fält som tar värden från max ner till low. Vid den tidpunkten skrev vi om det som overifierat, för det var det: inga vikter, inget modellkort, ingen prissida och inget API-modell-id fanns.

Ett av dessa fem påståenden bekräftas nu av leverantörens egen dokumentation, och det är reasoning_effort-fältet – inklusive stegen från max till låg, som exakt matchar de levererade värdena. De övriga fyra är fortfarande obekräftade. MiniMaxs publicerade beskrivning av M3.1-Flash-Preview säger endast att det är en multimodal kodningsmodell i framkanten med ett kontextfönster på 1M och justerbart tänkandedjup; den beskriver inte uppmärksamhetsschemat, kvantiseringen eller avkodningshuvudet. Den som upprepar påståendena om gles uppmärksamhet och NVFP4 som fastställd specifikation upprepar en tredje parts transkription, vilket är exakt vad släppet inte bekräftade.

Om du vill testa det utan att satsa en pipeline på det

Det besvärliga med en förhandsvisning som endast finns i Token-Plan är att det naturliga sättet att utvärdera en ny modell – att anropa den från din befintliga stack och mäta – är det enda du inte kan göra ordentligt. Det finns ingen per-token-pris att modellera mot, ingen publicerad latensprofil och ingen failover-strategi i leverantörens egen produkt om förhandsvisningen strular.

Det är situationen som ett routningslager är byggt för. Allt du kan anropa i dag ligger bakom en OpenAI-kompatibel slutpunkt och en API-nyckel, och modellerna som ligger nära den här finns redan där: MiniMax-M3 till leverantörens pris på 0,30 USD per miljon indatatoken och 1,20 USD per miljon utdatatoken, MiniMax M2.7 till samma prislapp med ett fönster på 200 000 token och öppna vikter, samt DeepSeek- och Qwen Flash-nivåerna i samma prisklass. Priserna hos oss är leverantörens listpris som förs vidare med 0 % påslag, så när en leverantör sänker ett pris hamnar det här samma dag i stället för att vänta på en omförhandlingscykel. Automatisk failover innebär att ett beroende av preview-kvalitet kan ligga bredvid en produktionsväg i stället för under den, och när MiniMax väl publicerar en prislista och en slutpunkt för MiniMax-M3.1-Flash-Preview blir frågan en post i routningstabellen i stället för ett migreringsprojekt. Själva MiniMax-M3.1-Flash-Preview finns inte i vår katalog, och sättet att nå den i dag är leverantörens egen Token Plan och dess kodningsprodukt.

Den ärliga sammanfattningen för ett team som läser detta på lanseringsdagen: modellen är live, gratis i marginalen om du redan betalar för en Token Plan-plats, och helt oprissatt och omätt på sina egna villkor. Prova den i MiniMax Code, behåll pipelinen du är beroende av på en modell med en prislista och ett track record, och håll utkik efter de två saker som kommer att förvandla detta från en kuriositet till ett beslut – ett publicerat pris och de första oberoende poängen.

A generated scorecard infographic titled 'The models you can call today, and what they cost'. Six rows read: 'MiniMax M3 — $0.30 in / $1.20 out per 1M tokens, 1,048,576-token context, open weights', 'MiniMax M2.7 — $0.30 in / $1.20 out per 1M tokens, 204,800-token context, open weights', 'DeepSeek V4 Flash — $0.22 in / $0.66 out per 1M tokens, 1,048,576-token context', 'DeepSeek V4.1 Flash — routed on the same key in the same price band', 'MiniMax M3.1 Flash Preview — no per-token rate published; Token Plan and MiniMax Code only', and 'One OrcaRouter API key reaches 200+ models with 0% markup on the provider's list price and automatic failover across providers'. A footer reads 'Catalogue figures per OrcaRouter's public model API, 28 September 2026; MiniMax M3.1 Flash Preview is not on the OrcaRouter catalogue.'