MiniMax M2.7 highspeed

minimax/minimax-m2.7-highspeed
เรือธง
การให้เหตุผล
โดย minimax · 2026-03-18

MiniMax M2.7 ความเร็วสูง — รุ่นเดียวกัน + บริบท 200k เท่า M2.7, เอาต์พุตที่เร็วกว่า (~100 tps เทียบกับ ~60 tps).

เอนด์พอยต์:/v1/chat/completions
ctx204K โทเค็น
เอาต์พุตสูงสุด2K
อินพุตtext
เอาต์พุตtext
p50 TTFT1.64 s
INPUT$0.60/ 1M โทเค็น
OUTPUT$2.40/ 1M โทเค็น
p50 TTFT1.64 s7 วัน
p95 TTFT8.33 s7 วัน
ทราฟฟิก3.1Mโทเค็น / 7วัน
รับ API ของ MiniMax M2.7 highspeed ลองใน playground</> ใช้ผ่าน API

MiniMax M2.7 highspeed เป็นโมเดลเรือธงที่ประมวลผลเฉพาะข้อความ พัฒนาโดย MiniMax บริษัท AI สัญชาติจีน โมเดลนี้ถูกปรับให้เหมาะสมสำหรับการอนุมานที่รวดเร็ว…

MiniMax M2.7 highspeed คืออะไร?

ใครควรใช้โมเดลนี้

มันแตกต่างจากรุ่น MiniMax มาตรฐานอย่างไร

ข้อกำหนดหลักคืออะไร?

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="minimax/minimax-m2.7-highspeed",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • max_completion_tokens
  • reasoning
  • reasoning_split
  • stream
  • temperature
  • top_p

ราคา

อินพุต / 1M โทเค็น$0.600
เอาต์พุต / 1M โทเค็น$2.40
อ่านแคช / 1M$0.060
เขียนแคช / 1M$0.375
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $11.40 · เมื่อใช้แคชพรอมป์ต์ $9.51

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.001208

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
1.64 s
ความเร็วเอาต์พุต
67.4 tok/s
p95 TTFT
8.33 s
อัตราข้อผิดพลาด
0%

เกณฑ์มาตรฐานสาธารณะ

52.6
AA Coding
ดีกว่า 60% ของโมเดลที่เปรียบเทียบ
อันดับ 53 จาก 134
38.9
AA Intelligence
ดีกว่า 55% ของโมเดลที่เปรียบเทียบ
อันดับ 60 จาก 136
58.6
AA Math
ดีกว่า 38% ของโมเดลที่เปรียบเทียบ
อันดับ 51 จาก 82
GPQA Diamond
87.4
Humanity's Last Exam
29.6
IFBench
75.7
Long-Context Recall
75.3
MMLU-Pro
62.6 index
SciCode
47.0
tau_banking
9.9
TerminalBench Hard
39.4
terminalbench_v2_1
55.4
τ²-Bench
84.8
แหล่งที่มา: artificialanalysis.ai

กระแสในชุมชน

สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้

Hacker News0 การกล่าวถึง · 7 วัน

การเปรียบเทียบ

MiniMax M2.7 highspeedMiniMax M3MiniMax M2.7MiniMax M2.5
อินพุต $/ล้าน$0.60$0.30$0.30$0.30
เอาต์พุต $/ล้าน$2.40$1.20$1.20$1.20
บริบท205K1.0M205K205K
คุณภาพ8/109/108/107/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก minimax

FAQ

MiniMax M2.7 highspeed มีค่าใช้จ่ายต่อ token เท่าไหร่?
โทเคนขาเข้าคิดราคา $0.60 ต่อ 1 ล้านโทเคน โทเคนขาออกคิดราคา $2.40 ต่อ 1 ล้านโทเคน ไม่มีค่าบริการเพิ่มเติม OrcaRouter จะคิดอัตราตามผู้ให้บริการ
ขนาดหน้าต่างบริบทคือเท่าไร?
โมเดลรองรับหน้าต่างบริบท 204,800 โทเคน เอาต์พุตสูงสุดคือ 2,048 โทเคนต่อคำขอ
จุดแข็งหลักของแบบจำลองคืออะไร?
มันทำคะแนนได้ 87.4 ในการทดสอบ GPQA Diamond ซึ่งเป็นเกณฑ์มาตรฐานการให้เหตุผลระดับบัณฑิตศึกษา และให้การอนุมานที่รวดเร็วด้วยหน้าต่างบริบทขนาดใหญ่ในราคาที่แข่งขันได้
มันเปรียบเทียบกับ GPT-4 Turbo อย่างไร?
MiniMax M2.7 highspeed รองรับเฉพาะข้อความ ในขณะที่ GPT-4 Turbo รองรับภาพ มีบริบทที่ใหญ่กว่า (204K เทียบกับ 128K) และราคาถูกกว่าอย่างมาก ($0.60/$2.40 เทียบกับ $10/$30 ต่อล้านโทเคน) ทั้งสองโมเดลมีความแข็งแกร่งในการวัดประสิทธิภาพด้านการใช้เหตุผล
OrcaRouter จัดการเรื่องความเป็นส่วนตัวของข้อมูลหรือไม่?
OrcaRouter ทำหน้าที่เป็น pass-through API ข้อมูลจะถูกส่งไปยังเซิร์ฟเวอร์ของ MiniMax เพื่อการอนุมาน โปรดดูนโยบายความเป็นส่วนตัวของ MiniMax และข้อกำหนดของ OrcaRouter สำหรับรายละเอียดเกี่ยวกับการจัดการและการจัดเก็บข้อมูล
ฉันจะเรียกใช้โมเดลนี้ผ่าน API ที่เข้ากันได้กับ OpenAI ได้อย่างไร
ตั้งค่า API endpoint ของคุณเป็น https://api.orcarouter.ai/v1 ใช้โมเดล ID "minimax/minimax-m2.7-highspeed" และส่งคำขอ chat completion มาตรฐานพร้อมกับคีย์ API OrcaRouter ของคุณ
โมเดลนี้เหมาะสมกับการใช้งานแบบเรียลไทม์หรือไม่?
ใช่ รูปแบบ "highspeed" ได้รับการปรับให้เหมาะสมสำหรับความหน่วงต่ำ ทำให้เหมาะสมสำหรับแชทบอทแบบเรียลไทม์ การวิเคราะห์เอกสารสด และผู้ช่วยเขียนโค้ดแบบโต้ตอบ
มันสามารถประมวลผลรูปภาพหรือเสียงได้หรือไม่?
ไม่. มันเป็นโมเดลที่รับเฉพาะข้อความ. อินพุตทั้งหมดจะต้องเป็นข้อความ. สำหรับงานแบบมัลติโมดัล ให้พิจารณาโมเดลเช่น GPT-4 Vision หรือ Claude 3 Opus.
ความยาวเอาต์พุตสูงสุดคือเท่าใด
โมเดลสามารถสร้างโทเคนได้สูงสุด 2,048 โทเคนต่อคำขอ สำหรับผลลัพธ์ที่ยาวขึ้น คุณจะต้องแบ่งการสร้างเป็นส่วนๆ หรือใช้โมเดลอื่น
มีส่วนลดสำหรับการสั่งซื้อปริมาณมากหรือไม่?
ไม่มีการกล่าวถึงส่วนลดตามปริมาณ การคิดราคาเป็นแบบเส้นตรงต่อโทเค็น คุณจ่ายในอัตราเดียวกันไม่ว่าปริมาณการใช้งานเท่าใด

ฝังป้ายนี้

MiniMax M2.7 highspeed$0.60/M in1636ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/minimax/minimax-m2.7-highspeed" target="_blank"> <img src="https://www.orcarouter.ai/embed/minimax/minimax-m2.7-highspeed.svg" alt="MiniMax M2.7 highspeed บน OrcaRouter" /> </a>
Markdown [![MiniMax M2.7 highspeed](https://www.orcarouter.ai/embed/minimax/minimax-m2.7-highspeed.svg)](https://www.orcarouter.ai/models/minimax/minimax-m2.7-highspeed)

ข้อมูลโมเดลแบบ data

GET /api/public/models/minimax/minimax-m2.7-highspeedเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt