MiniMax M2.7 highspeed

minimax/minimax-m2.7-highspeed
Flaggskepp
Resonemang
av minimax · 2026-03-18

MiniMax M2.7 high-speed — samma modell + samma 200k kontext som M2.7, snabbare utdata (~100 tps mot ~60 tps).

ctx204.8K tokens
Max output2K
Inmatningtext
Utdatatext
p50 TTFT1.64 s
INMATNING$0.60/ 1M token
UTDATA$2.40/ 1M token
p50 TTFT1.64 s7d
p95 TTFT3.67 s7d
TRAFIK342.7Ktokens/7d

MiniMax M2.7 highspeed är en flaggskeppsmodell för enbart text utvecklad av MiniMax, ett kinesiskt AI-företag. Den är optimerad för snabb inferens samtidigt som den bibehåller starka…

Vad är MiniMax M2.7 highspeed?

Vem bör använda den här modellen?

Hur skiljer det sig från standard MiniMax-modeller?

Vilka är de viktigaste specifikationerna?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="minimax/minimax-m2.7-highspeed",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • max_completion_tokens
  • reasoning
  • reasoning_split
  • stream
  • temperature
  • top_p

Priser

Inmatning / 1M token$0.600
Utdata / 1M tokens$2.40
Cacheläsning / 1M$0.060
Cache-skrivning / 1M$0.375
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $11.40 · Med promptcachning $9.51

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.001211

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
1.64 s
Utdatahastighet
62.9 tok/s
p95 TTFT
3.67 s
Felfrekvens
0%

Offentliga benchmarks

52.6
AA Coding
Bättre än 64% av jämförda modeller
#43 av 123
38.1
AA Intelligence
Bättre än 58% av jämförda modeller
#51 av 125
58.6
AA Math
Bättre än 38% av jämförda modeller
#50 av 81
GPQA Diamond
87.4
Humanity's Last Exam
28.1
IFBench
75.7
Long-Context Recall
68.7
MMLU-Pro
62.6 index
SciCode
47.0
tau_banking
8.9
TerminalBench Hard
39.4
terminalbench_v2_1
55.4
τ²-Bench
84.8
Källa: artificialanalysis.ai

Så jämför den sig

MiniMax M2.7 highspeedMiniMax M3MiniMax M2.7MiniMax M2.5
Input $/M$0.60$0.30$0.30$0.30
Output $/M$2.40$1.20$1.20$1.20
Kontext205K1.0M205K205K
Kvalitet8/109/108/107/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar MiniMax M2.7 highspeed per token?
Indatatokens är $0,60 per 1M tokens. Utatatokens är $2,40 per 1M tokens. Det finns ingen påslag; OrcaRouter fakturerar till leverantörens taxa.
Vad är storleken på kontextfönstret?
Modellen stöder ett kontextfönster på 204 800 tokens. Maximal utmatning är 2 048 tokens per begäran.
Vilka är modellens främsta styrkor?
Den uppnår 87,4 poäng på GPQA Diamond, ett riktmärke för resonemang på högskolenivå, och erbjuder snabb inferens med ett stort kontextfönster till ett konkurrenskraftigt pris.
Hur står den sig mot GPT-4 Turbo?
MiniMax M2.7 highspeed är endast textbaserad jämfört med GPT-4 Turbos bildstöd. Den har en större kontext (204K vs 128K) och är betydligt billigare ($0.60/$2.40 vs $10/$30 per miljon token). Båda är starka på resonemangsbenchmarks.
Hanterar OrcaRouter dataintegritet?
OrcaRouter fungerar som ett pass-through-API. Data skickas till MiniMaxs servrar för inferens. Se MiniMaxs integritetspolicy och OrcaRouters användarvillkor för detaljer om datahantering och lagring.
Hur anropar jag den här modellen via ett OpenAI-kompatibelt API?
Ställ in din API-slutpunkt till https://api.orcarouter.ai/v1, använd modell-ID:t "minimax/minimax-m2.7-highspeed", och skicka en standardbegäran för chattkomplettering med din OrcaRouter API-nyckel.
Är denna modell lämplig för realtidsapplikationer?
Ja, "highspeed"-varianten är optimerad för låg latens, vilket gör den lämplig för realtidschattbotar, livedokumentanalys och interaktiva kodningsassistenter.
Kan den bearbeta bilder eller ljud?
Nej. Det är en textbaserad modell. All indata måste vara text. För multimodala uppgifter, överväg modeller som GPT-4 Vision eller Claude 3 Opus.
Vad är den maximala utdatalängden?
Modellen kan generera upp till 2 048 tokens per förfrågan. För längre utdata skulle du behöva dela upp genereringen eller använda en annan modell.
Finns det några rabatter för hög volym?
Inga volymrabatter nämns. Prissättningen är linjär per token. Du betalar samma avgift oavsett användningsvolym.

Bädda in denna badge

MiniMax M2.7 highspeed$0.60/M in1636ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/minimax/minimax-m2.7-highspeed" target="_blank"> <img src="https://www.orcarouter.ai/embed/minimax/minimax-m2.7-highspeed.svg" alt="MiniMax M2.7 highspeed på OrcaRouter" /> </a>
Markdown [![MiniMax M2.7 highspeed](https://www.orcarouter.ai/embed/minimax/minimax-m2.7-highspeed.svg)](https://www.orcarouter.ai/models/minimax/minimax-m2.7-highspeed)

Modellkort som data

GET /api/public/models/minimax/minimax-m2.7-highspeedÖppna