
MiniMax M3.1 Flash Preview เปิดใช้งานแล้วบน Token Plan: สิ่งที่การสมัครสมาชิกของคุณปลดล็อกได้จริง
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 468 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 192 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
MiniMax-M3.1-Flash-Preview เปิดตัวเมื่อวันที่ 27 กันยายน 2026 และวิธีที่มันเปิดตัวนั่นแหละคือเรื่องราว มันไม่ใช่โมเดลแบบจ่ายตามการใช้งาน ผู้ขายได้วางโมเดลข้อความใหม่ล่าสุดไว้หลัง Token Plan Subscription Key อันเดียวกับที่ครอบคลุม MiniMax-M3, MiniMax M2.7 และรุ่น M2.7-highspeed อยู่แล้ว ดังนั้นหากคุณมีที่นั่งอยู่แล้ว ก็ไม่ต้องสร้างคีย์ใหม่และไม่ต้องเซ็นสัญญาฉบับที่สอง สิ่งที่ยังไม่มีเช่นกัน ณ วันนี้ คือราคาต่อโทเคน การ์ดโมเดล ผลทดสอบที่เผยแพร่ หรือวิธีใด ๆ ในการปิดการคิดของโมเดล
การผสมผสานนั้น — การเข้าถึงที่ไร้แรงเสียดทาน ควบคู่กับเศรษฐศาสตร์ที่ไม่ได้เปิดเผยเลยแม้แต่น้อย — ถือเป็นเรื่องผิดปกติพอที่จะคุ้มค่าแก่การแกะให้ละเอียดก่อนที่ใครจะเชื่อมต่อไปป์ไลน์สำหรับโปรดักชันเข้ากับมัน ส่วนที่เหลือของบทความนี้คือสิ่งที่เอกสารของผู้ขายกล่าวไว้จริง สิ่งที่มันจงใจไม่กล่าวถึง และโค้ดเพียงหนึ่งบรรทัดที่จะบอกคุณได้ภายในหนึ่งนาทีว่าโมเดลนี้เข้ากับวิธีการทำงานของคุณหรือไม่
สิ่งที่เกิดขึ้นจริงเมื่อวันที่ 27 กันยายน
เอกสารสำหรับนักพัฒนาของ MiniMax ตอนนี้มีข้อความถาวรที่ปรากฏซ้ำในทุกหน้าของโมเดลข้อความ: MiniMax-M3.1-Flash-Preview เปิดให้ใช้งานเฉพาะผ่าน Token Plan MiniMax Code ไปก่อนในตอนนี้ โมเดลนี้ปรากฏเป็นอันดับแรกในตารางโมเดลของ MiniMax เอง เหนือ MiniMax-M3 โดยอธิบายว่าเป็นโมเดลเขียนโค้ดแบบมัลติโมดัลที่มีหน้าต่างบริบท 1M และปรับความลึกของการคิดได้
• หน้าต่างบริบท — 1,000,000 โทเค็น เพดานเดียวกันกับที่ MiniMax-M3 รองรับ
• รูปแบบอินพุต — ข้อความ รูปภาพ และวิดีโอ โดยส่งคืนข้อความ
• ความลึกในการคิด — effort เป็นการตั้งค่าที่รองรับ low, medium, high, xhigh และ max โดยค่าเริ่มต้นเป็น max เมื่อไม่ระบุ
• การรองรับโปรโตคอล — model id เดียวกันใช้งานได้ผ่าน endpoint ที่เข้ากันได้กับ Anthropic ของ MiniMax, endpoint ที่เข้ากันได้กับ OpenAI ของบริษัท และ endpoint OpenAI Responses ของบริษัท
• ความพร้อมใช้งาน — เฉพาะ Token Plan และ MiniMax Code เท่านั้น; ไม่มีในแบบ pay-as-you-go
• ราคา — ไม่มีการเผยแพร่อัตราต่อโทเค็นที่ใดเลย
• น้ำหนักโมเดล — ไม่มี; รีโพซิทอรีสาธารณะล่าสุดสองแห่งขององค์กร MiniMaxAI ยังคงเป็น MiniMax-Music3 และ MiniMax-H3
• การวัดประสิทธิภาพอิสระ — ไม่มี; โมเดลนี้ไม่มีรายการในดัชนีโมเดลของ Artificial Analysis
บริษัทประกาศเรื่องนี้ในวันเดียวกันผ่านบัญชี MiniMaxAgent โดยวางตำแหน่งให้เป็นเครื่องมือสำหรับงานพัฒนาประจำวันมากกว่าการทำงานระดับแนวหน้า: รวดเร็วและเชื่อถือได้ ตั้งแต่การแก้บั๊กด่วนไปจนถึงการพัฒนาฟีเจอร์เต็มรูปแบบ นั่นเป็นโจทย์ของระดับ Flash ไม่ใช่ระดับเรือธง การรายงานข่าวจากสำนักข่าวบุคคลที่สามอย่าง PANews และ KuCoin อธิบายในลักษณะเดียวกัน และระบุว่านักพัฒนาได้พบโมเดลนี้ในตัวเลือก MiniMax Code ก่อนที่บริษัทจะยืนยัน

คีย์ที่คุณใช้มีความสำคัญมากกว่าปกติ
นี่คือจุดที่ทำให้คนพลาดกันบ่อย MiniMax ใช้ข้อมูลรับรองสองประเภทแยกจากกัน และ M3.1-Flash-Preview ใช้งานได้กับเพียงประเภทเดียวเท่านั้น Token Plan Subscription Key มาจาก Billing > Token Plan และครอบคลุมการใช้งานแบบ Subscription กับ Credits ที่ซื้อไว้ ส่วน pay-as-you-go API Key ครอบคลุมโมเดลแบบคิดตามโทเคน เอกสารของผู้ให้บริการระบุชัดเจนว่าทั้งสองใช้แทนกันไม่ได้ และ Subscription Key สามารถมีอยู่ได้ก่อนที่จะมีทรัพยากรแบบเสียค่าใช้จ่ายใด ๆ ถูกผูกเข้ากับมัน — ซึ่งในกรณีนั้น มันเป็นคีย์ที่ถูกต้องแต่ไม่มีอะไรอยู่เบื้องหลัง
ดังนั้นการทดสอบในทางปฏิบัติไม่ใช่ "ฉันมี MiniMax API key หรือไม่" แต่เป็น "ฉันมี seat ของ Token Plan หรือไม่" seat ที่มีอยู่ได้รับการครอบคลุมแล้ว เอกสารระบุว่า Subscription Key จะใช้งานได้เมื่อมีการกำหนด seat หรือสิทธิ์การเข้าถึง Credits และว่า Credits ส่วนเกินจะถูกดึงมาใช้โดยอัตโนมัติเมื่อโควตาการสมัครใช้งานหมดลง
ยังมีความไม่สอดคล้องกันในเอกสารที่ควรรู้ไว้ เพราะมันจะทำให้ใครก็ตามที่อ่านหน้าตั้งราคาก่อนสับสน เชิงอรรถความครอบคลุมของหน้า pricing ของ Token Plan ยังคงระบุกลุ่มที่เข้าเกณฑ์ว่า M3, M2.7, image และ speech โดยตัด H3 ออก — ยังไม่ได้รับการอัปเดตให้ระบุชื่อ M3.1-Flash-Preview ส่วนหน้าของโมเดลกลับบอกตรงกันข้ามว่า M3.1-Flash-Preview ใช้ได้บน Token Plan และไม่มีอย่างอื่น ทั้งสองหน้าเป็นหน้าของผู้ขายที่ยังเปิดใช้งานจริง ณ วันนี้ มีเพียงกุญแจในมือคุณเท่านั้นที่ชี้ขาด
400 ที่บอกคุณว่านี่คือโมเดลประเภทไหน
โมเดล MiniMax M-series ทุกตัวจะคิดก่อนตอบ แต่ M3.1-Flash-Preview เป็นตัวแรกที่ปฏิเสธที่จะหยุด ส่ง thinking: {"type": "disabled"} หรือ reasoning_effort: "none" และ API จะส่งคืน HTTP 400 พร้อมข้อความ:
โมเดล "MiniMax-M3.1-Flash-Preview" จำเป็นต้องใช้ adaptive thinking; ไม่อนุญาตให้ใช้ thinking.type="disabled" (รวมถึง reasoning.effort=none) (2013)
แนวทางของผู้ให้บริการเองคือให้ลด effort ลง แทนที่จะพยายามปิดการคิด และลำดับขั้นนี้คือคันโยกด้านความหน่วง: การแก้ไขงานทั่วไปที่ระดับ low กับการเปลี่ยนแปลงทั้งรีโพซิทอรีที่ระดับ xhigh คือโมเดลเดียวกันที่แลกเปลี่ยนคนละแบบ รายละเอียดเพิ่มเติมอีกสองประการจำเพาะกับโมเดลนี้ พารามิเตอร์ reasoning_effort มีเอกสารระบุว่ามีผลเฉพาะกับ MiniMax-M3.1-Flash-Preview เท่านั้น — ไม่ใช่ตัวควบคุมทั่วไปของซีรีส์ M และสวิตช์เอาต์พุต reasoning_split ซึ่งแยกการคิดออกเป็นฟิลด์ reasoning_content ไม่สามารถตั้งเป็น false ได้ในขณะนี้กับโมเดลนี้
ตำแหน่งที่ข้อความ thinking ปรากฏนั้นขึ้นอยู่กับโปรโตคอล: ปลายทางที่เข้ากันได้กับ Anthropic จะส่งกลับมาเป็น thinking บล็อกเนื้อหา ปลายทางที่เข้ากันได้กับ OpenAI จะส่งกลับมาใน reasoning_content และปลายทาง Responses จะส่งกลับมาเป็นรายการเอาต์พุต reasoning หากคุณเคยแยกวิเคราะห์ <think> แท็กออกจากเอาต์พุตของ MiniMax-M3 งานนั้นไม่จำเป็นอีกต่อไปบนโมเดลใหม่กว่า — และสำหรับบทสนทนาการใช้เครื่องมือแบบสลับกัน ต้องผนวกการตอบกลับแบบเต็มซึ่งรวมถึงบล็อก thinking กลับเข้าไปในประวัติข้อความ มิฉะนั้นห่วงโซ่การให้เหตุผลจะขาด
โปรโมชั่นที่กำลังจัดอยู่ตอนนี้
MiniMax Code กำลังจัดโปรโมชันเช็คอินตั้งแต่วันที่ 28 กันยายน ถึง 7 ตุลาคม ในเขตเวลา UTC+8 โดยเพิ่มเครดิตฟรีที่มอบให้สำหรับการล็อกอินรายวันเป็นสองเท่า และเปิดให้ทั้งผู้ใช้ใหม่และผู้ใช้เดิมเข้าร่วมได้เช่นกัน เครดิตที่ได้รับสามารถใช้ได้กับโมเดลที่รองรับ โดยยกตัวอย่างเช่น M3.1-Flash-Preview และโมเดลวิดีโอตระกูล H3 นอกจากนี้ บริษัทยังระบุว่าโควตาของ Token Plan จะรีเซ็ตให้ผู้ใช้ทุกคนเมื่อเริ่มกิจกรรม และมีแผนจะรีเซ็ตเพิ่มเติมระหว่างกิจกรรม โดยแสดงสิทธิ์ไว้ในแอป
ให้ถือว่าสองสิ่งนั้นเป็นคำแถลงของผู้ขายที่ถ่ายทอดผ่านการรายงานข่าวการเปิดตัว —它们是促销条款ที่แนบวันที่มาด้วย ไม่ใช่พฤติกรรมของผลิตภัณฑ์ และรายงานข่าวเดียวกันยังระบุว่าประกาศไม่ได้ระบุจำนวนเครดิตต่อการเช็คอินหรือกฎเกณฑ์ที่แน่ชัดสำหรับวันที่พลาดการเช็คอิน เศรษฐศาสตร์ในสภาวะคงตัวนั้นอธิบายได้ง่ายกว่า: Token Plan ตั้งราคาไว้ที่ 22 ดอลลาร์ต่อเดือนสำหรับ Plus, 55 ดอลลาร์สำหรับ Max และ 132 ดอลลาร์สำหรับ Ultra โดยมีหน้าต่างโควตาแบบหมุนเวียน 5 ชั่วโมงและแบบรายสัปดาห์ ซึ่งผู้ขายกำหนดขนาดไว้ที่ประมาณ 3 ถึง 4, 4 ถึง 5 และ 6 ถึง 7 เอเจนต์ที่ทำงานพร้อมกันตามลำดับ Purchased Credits มีอัตรา 1,000 เครดิตต่อดอลลาร์ และหักในอัตราราคาตามการใช้งานจริง (pay-as-you-go) ของแต่ละโมเดล
สี่สิ่งที่โมเดลนี้ยังไม่มี
ไม่มีข้อใดต่อไปนี้เป็นการวิจารณ์โมเดล แต่ละข้อคือช่องโหว่ที่ทีมต้องวางแผนรับมือ และทั้งสี่ข้อล้วนตรวจสอบยืนยันได้ในวันนี้
• ไม่มีราคา ไม่มีอัตราต่อโทเคนสำหรับ M3.1-Flash-Preview บนหน้าใด ๆ ของ MiniMax จึงไม่สามารถเปรียบเทียบกับ M3 ที่ราคา $0.30 ต่อล้านโทเคนอินพุต และ $1.20 ต่อล้านโทเคนเอาต์พุต หรือกับสิ่งอื่นใด ในแง่ต้นทุนต่อโทเคน
• ไม่มีผลการทดสอบมาตรฐาน MiniMax ไม่ได้เผยแพร่ตารางการประเมินใด ๆ พร้อมกับการเปิดตัวนี้ เช่นเดียวกับที่ไม่มีใครอื่นเผยแพร่ โมเดลนี้ไม่มีอยู่ในดัชนีของ Artificial Analysis ดังนั้นคอลัมน์ของมันจึงว่างเปล่าจริง ๆ ไม่ใช่แค่ยังเร็วเกินไป
• ไม่มีน้ำหนักโมเดล MiniMax-M3 เปิดให้ดาวน์โหลดน้ำหนักแบบเปิด ส่วน M3.1-Flash-Preview ไม่มีที่เก็บโค้ดและไม่มีเช็กพอยต์ให้ดาวน์โหลด
• ไม่มีการวัดผลที่เป็นอิสระ ไม่มีตัวเลขความเร็วเอาต์พุต ความหน่วง หรืออัตราข้อผิดพลาดจากบุคคลที่สามใด ๆ และไม่มีจากข้อมูลเทเลเมตรีการกำหนดเส้นทางของเราเอง เนื่องจากโมเดลนี้ไม่ได้อยู่ในแค็ตตาล็อกของเรา
เมื่อเทียบกับการเปิดตัว M3 ในเดือนมิถุนายน 2026 ซึ่งมาพร้อมบันทึกสถาปัตยกรรม ชีตเบนช์มาร์ก และเรตการ์ดตั้งแต่วันแรก นี่คือการเปิดตัวที่เงียบอย่างจงใจ การตีความที่น่าเป็นไปได้ — และมันเป็นการตีความ ไม่ใช่แผนที่ประกาศไว้ — คือ MiniMax ต้องการการใช้งานจริงภายในผลิตภัณฑ์ของตัวเองก่อนที่จะตัดสินใจว่าโมเดลนี้มีค่าใช้จ่ายเท่าไรและจะเปิดให้ใช้หรือไม่

สิ่งที่บันทึกพรีวิวที่รั่วไหลทำนายถูกต้อง
สี่วันก่อนการเปิดตัว เอกสารตัวอย่างที่ถูกถอดความในที่เก็บของพันธมิตรสาธารณะได้แพร่กระจาย โดยอธิบายถึง MiniMax M3.1 ที่มี sparse attention, Q8KV4 attention quantisation, NVFP4 routed experts, หัว speculative-decoding แบบ DSpark และใหม่ reasoning_effort ฟิลด์ที่รับค่าตั้งแต่ max ลงไปจนถึง low ในตอนนั้นเราเขียนถึงมันว่าเป็นข้อมูลที่ยังไม่ได้รับการยืนยัน เพราะมันเป็นเช่นนั้น: ไม่มี weights, ไม่มี model card, ไม่มีหน้าตาราคา และไม่มี API model id อยู่
หนึ่งในห้าข้อกล่าวอ้างเหล่านั้นได้รับการยืนยันแล้วโดยเอกสารของผู้จำหน่ายเอง และมันคือ reasoning_effort ฟิลด์ — รวมถึงขั้นบันไดจากสูงสุดไปต่ำสุด ซึ่งตรงกับค่าที่จัดส่งจริงทุกประการ อีกสี่ข้อยังไม่ได้รับการยืนยัน คำอธิบายที่เผยแพร่ของ MiniMax เกี่ยวกับ M3.1-Flash-Preview ระบุเพียงว่าเป็นโมเดลเขียนโค้ดแบบมัลติโหมดระดับแนวหน้าที่มีหน้าต่างบริบท 1M และความลึกในการคิดที่ปรับได้; ไม่ได้อธิบายถึงรูปแบบแอตเทนชัน การควอนไทซ์ หรือหัวถอดรหัส ใครก็ตามที่พูดซ้ำข้อกล่าวอ้างเรื่อง sparse-attention และ NVFP4 ว่าเป็นข้อกำหนดที่สรุปแล้ว กำลังพูดซ้ำการถอดความของบุคคลที่สาม ซึ่งเป็นสิ่งที่การเปิดตัวไม่ได้ยืนยัน
ถ้าคุณอยากลองใช้มันโดยไม่ต้องเอาไปป์ไลน์ทั้งชุดมาเดิมพันกับมัน
ส่วนที่น่าอึดอัดของ Token-Plan-only preview คือวิธีประเมินโมเดลใหม่ตามธรรมชาติ — เรียกใช้จากสแต็กที่มีอยู่ของคุณแล้ววัดผล — เป็นสิ่งเดียวที่คุณทำได้ไม่ราบรื่นนัก ไม่มีอัตราต่อโทเคนให้จำลองเทียบ ไม่มีโปรไฟล์ความหน่วงที่เผยแพร่ และไม่มีแนวทาง failover ภายในผลิตภัณฑ์ของผู้ขายเอง หากตัว preview สั่นคลอน
นั่นคือสถานการณ์ที่ routing layer ถูกสร้างขึ้นมาเพื่อรองรับ ทุกอย่างที่คุณเรียกใช้ได้ในวันนี้อยู่เบื้องหลังปลายทางที่เข้ากันได้กับ OpenAI เพียงจุดเดียวและ API key เพียงรายการเดียว และโมเดลที่อยู่ใกล้เคียงกับตัวนี้ก็มีอยู่แล้ว: MiniMax-M3 ในอัตราของผู้ให้บริการ ที่ 0.30 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 1.20 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน, MiniMax M2.7 ในราคาเดียวกันกับหน้าต่าง 200,000 โทเคนและ weights แบบเปิด, และ DeepSeek กับ Qwen Flash tiers ในช่วงราคาเดียวกัน ราคาฝั่งเราเป็นราคาตามรายการของผู้ให้บริการที่ส่งผ่านโดยบวกเพิ่ม 0% ดังนั้นเมื่อผู้ขายลดราคา มันก็ลงที่นี่ในวันเดียวกัน แทนที่จะเป็นรอบการเจรจาใหม่ Automatic failover หมายความว่าสิ่งที่ต้องพึ่งพาระดับพรีวิวสามารถวางอยู่ข้างเส้นทางโปรดักชันได้ ไม่ใช่ไว้ข้างใต้ และเมื่อ MiniMax เผยแพร่ตารางราคาและปลายทางสำหรับ MiniMax-M3.1-Flash-Preview จริง ๆ คำถามก็จะกลายเป็นเพียงรายการในตารางจัดเส้นทาง แทนที่จะเป็นโปรเจกต์ย้ายระบบ ตัว MiniMax-M3.1-Flash-Preview เองไม่ได้อยู่ในแคตตาล็อกของเรา และวิธีเข้าถึงมันในวันนี้คือ Token Plan ของผู้ขายเองและผลิตภัณฑ์สำหรับเขียนโค้ดของพวกเขา
สรุปตามตรงสำหรับทีมที่อ่านสิ่งนี้ในวันเปิดตัว: โมเดลนี้เปิดใช้งานแล้ว ฟรีที่ส่วนเพิ่มหากคุณจ่ายค่าที่นั่ง Token Plan อยู่แล้ว และยังไม่มีราคาและไม่มีการวัดผลโดยสิ้นเชิงตามเงื่อนไขของตัวเอง ลองใช้ดูใน MiniMax Code คงไปป์ไลน์ที่คุณพึ่งพาไว้บนโมเดลที่มีตารางราคาและผลงานที่ผ่านมา และจับตาดูสองสิ่งที่จะเปลี่ยนสิ่งนี้จากความอยากรู้อยากเห็นให้กลายเป็นการตัดสินใจ — ราคาที่ประกาศเผยแพร่และคะแนนอิสระชุดแรก

