MiniMax M2.7 highspeed

minimax/minimax-m2.7-highspeed
Flagowy
Rozumowanie
przez minimax · 2026-03-18

MiniMax M2.7 high-speed — ten sam model + ten sam kontekst 200k jak M2.7, szybsze wyjście (~100 tps vs ~60 tps).

Punkty końcowe:/v1/chat/completions
kont.204K tokenów
Maks. wyjście2K
Wejścietext
Wyjścietext
p50 TTFT1.64 s
WEJŚCIE$0.60/ 1M tokenów
WYJŚCIE$2.40/ 1M tokenów
p50 TTFT1.64 s7 d
p95 TTFT8.33 s7 d
RUCH3.1Mtokenów / 7 d

MiniMax M2.7 highspeed to flagowy model tekstowy opracowany przez firmę MiniMax, chińską firmę AI. Jest zoptymalizowany pod kątem szybkiego wnioskowania przy jednoczesnym zachowaniu silnych zdolności…

Czym jest MiniMax M2.7 highspeed?

Kto powinien używać tego modelu?

Czym różni się od standardowych modeli MiniMax?

Jakie są kluczowe specyfikacje?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="minimax/minimax-m2.7-highspeed",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • max_completion_tokens
  • reasoning
  • reasoning_split
  • stream
  • temperature
  • top_p

Cennik

Wejście / 1M tokenów$0.600
Wyjście / 1M tokenów$2.40
Odczyt cache / 1M$0.060
Zapis cache / 1M$0.375
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $11.40 · Z cache promptów $9.51

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.001211

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
1.64 s
Prędkość wyjścia
67.4 tok/s
p95 TTFT
8.33 s
Wskaźnik błędów
0%

Publiczne benchmarki

52.6
AA Coding
Lepszy niż 60% porównywanych modeli
53 z 134
38.9
AA Intelligence
Lepszy niż 55% porównywanych modeli
60 z 136
58.6
AA Math
Lepszy niż 38% porównywanych modeli
51 z 82
GPQA Diamond
87.4
Humanity's Last Exam
29.6
IFBench
75.7
Long-Context Recall
75.3
MMLU-Pro
62.6 index
SciCode
47.0
tau_banking
9.9
TerminalBench Hard
39.4
terminalbench_v2_1
55.4
τ²-Bench
84.8
Źródło: artificialanalysis.ai

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News0 wzmianek · 7 dni

Porównanie

MiniMax M2.7 highspeedMiniMax M3MiniMax M2.7MiniMax M2.5
Wejście $/M$0.60$0.30$0.30$0.30
Wyjście $/M$2.40$1.20$1.20$1.20
Kontekst205K1.0M205K205K
Jakość8/109/108/107/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje MiniMax M2.7 highspeed za token?
Tokeny wejściowe kosztują 0,60 USD za 1M tokenów. Tokeny wyjściowe kosztują 2,40 USD za 1M tokenów. Nie ma narzutu; OrcaRouter fakturowana jest według stawki dostawcy.
Jaki jest rozmiar okna kontekstu?
Model obsługuje okno kontekstowe o wielkości 204 800 tokenów. Maksymalna liczba tokenów na wyjściu wynosi 2 048 na żądanie.
Jakie są główne zalety modelu?
Osiąga wynik 87.4 w GPQA Diamond, benchmarku rozumowania na poziomie absolwenta, i oferuje szybkie wnioskowanie z dużym oknem kontekstowym w konkurencyjnej cenie.
Jak porównuje się do GPT-4 Turbo?
MiniMax M2.7 highspeed jest wyłącznie tekstowy w porównaniu do wsparcia wizji GPT-4 Turbo. Ma większy kontekst (204K vs 128K) i jest znacznie tańszy ($0,60/$2,40 vs $10/$30 za milion tokenów). Oba są silne w benchmarkach rozumowania.
Czy OrcaRouter zajmuje się prywatnością danych?
OrcaRouter działa jako API przelotowe. Dane są wysyłane do serwerów MiniMax w celu wnioskowania. Aby uzyskać szczegółowe informacje na temat przetwarzania i przechowywania danych, zapoznaj się z polityką prywatności MiniMax oraz warunkami korzystania z OrcaRouter.
Jak wywołać ten model przez API zgodne z OpenAI?
Ustaw swój punkt końcowy API na https://api.orcarouter.ai/v1, użyj identyfikatora modelu "minimax/minimax-m2.7-highspeed" i prześlij standardowe żądanie zakończenia czatu ze swoim kluczem API OrcaRouter.
Czy ten model nadaje się do zastosowań w czasie rzeczywistym?
Tak, wariant "highspeed" jest zoptymalizowany pod kątem niskiego opóźnienia, co czyni go odpowiednim do czatbotów czasu rzeczywistego, analizy dokumentów na żywo i interaktywnych asystentów kodowania.
Czy może przetwarzać obrazy lub dźwięk?
Nie. Jest to model obsługujący wyłącznie tekst. Wszystkie dane wejściowe muszą być tekstem. W przypadku zadań multimodalnych rozważ modele takie jak GPT-4 Vision lub Claude 3 Opus.
Jaka jest maksymalna długość wyjścia?
Model może wygenerować do 2,048 tokenów na żądanie. W przypadku dłuższych wyników, trzeba będzie podzielić generację na części lub użyć innego modelu.
Czy są jakieś rabaty dla dużych ilości?
Nie wspomniano o żadnych rabatach ilościowych. Cennik jest liniowy za token. Płacisz tę samą stawkę niezależnie od wolumenu użycia.

Osadź tę odznakę

MiniMax M2.7 highspeed$0.60/M in1636ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/minimax/minimax-m2.7-highspeed" target="_blank"> <img src="https://www.orcarouter.ai/embed/minimax/minimax-m2.7-highspeed.svg" alt="MiniMax M2.7 highspeed w OrcaRouter" /> </a>
Markdown [![MiniMax M2.7 highspeed](https://www.orcarouter.ai/embed/minimax/minimax-m2.7-highspeed.svg)](https://www.orcarouter.ai/models/minimax/minimax-m2.7-highspeed)

Karta modelu jako dane

GET /api/public/models/minimax/minimax-m2.7-highspeedOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt