
Mistral Large 4 vs MiniMax M3: ความก้าวหน้าในห้าเดือนมีราคาที่ต้องจ่ายแค่ไหน
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 151 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 116 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 52 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 249 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
MiniMax M3 เป็นโมเดลที่ถูกที่สุดในคลาสนี้ และเป็นเช่นนี้มาตั้งแต่วันที่ 31 พฤษภาคม 2026 ด้วยราคา $0.30 ต่อหนึ่งล้านโทเคนอินพุต, $1.20 ต่อหนึ่งล้านโทเคนเอาต์พุต และ $0.06 ต่อหนึ่งล้านโทเคนแคช มันตัดราคา Mistral Large 4 ลงประมาณครึ่งหนึ่งสำหรับอินพุต และทำให้ Mistral Large 4 แพงกว่าเกือบสองเท่าสำหรับเอาต์พุต — และต่างจากโมเดลที่ใหม่กว่า คุณสามารถซื้อได้วันนี้โดยไม่มีป้ายพรีวิวติดอยู่ Mistral Large 4 โมเดลโอเพนเวต 1.05 ล้านล้านพารามิเตอร์ที่อยู่ในพับลิกพรีวิวตั้งแต่ 6 ตุลาคม 2026 มีราคา $0.68 และ $2.09 และสัญญาว่าจะปล่อยน้ำหนักโมเดลภายในสิ้นเดือนนี้ เรือธงโอเพนเวตสองรุ่น ห่างกันห้าเดือน และห้าเดือนนั้นปรากฏให้เห็นในที่เดียวเท่านั้น: คะแนน Intelligence Index แบบอิสระของ M3 ที่ 29.2 เทียบกับคะแนนของ Mistral Large 4 ที่ยังไม่มี
นั่นคือภาพที่ตรงไปตรงมาของการเปรียบเทียบนี้ และมันน่าสนใจกว่าที่ตารางราคาจะบอกไว้ M3 ถูกสร้างขึ้นจากเดิมพันเชิงสถาปัตยกรรมเฉพาะอย่าง — MiniMax Sparse Attention ที่คงอยู่ต่อเนื่องเหนือบริบทหนึ่งล้านโทเคน โดยมีวิดีโอเป็นอินพุตระดับชั้นหนึ่ง — และมันชนะในทางทฤษฎีในสองหมวดหมู่ที่ Mistral Large 4 ไม่ได้ลงแข่งด้วย: ความยาวเอาต์พุตดิบและวิดีโอแบบเนทีฟ ในทุกด้านอื่น โมเดลที่ใหม่กว่าคือตัวเลือกที่ผู้ซื้ออยากได้มากกว่า ด้วยราคาที่ยังต่ำพอที่ความแตกต่างนั้นแทบไม่ใช่ตัวตัดสินการซื้อ
สองสถาปัตยกรรม สองเดิมพัน
MiniMax M3 เป็นโมเดลพื้นฐานแบบเปิดน้ำหนัก (open-weight) ระดับเรือธงของ MiniMax และเป็นรุ่นแรกที่ผสมผสานประสิทธิภาพการเขียนโค้ดระดับแนวหน้าและความสามารถแบบเอเจนต์ หน้าต่างบริบทขนาดหนึ่งล้านโทเคน และมัลติโมดัลแบบเนทีฟไว้ในรุ่นเดียว รองรับอินพุตทั้งข้อความ รูปภาพ และวิดีโอ และส่งออกเป็นข้อความ โดยสร้างขึ้นบน MiniMax Sparse Attention สถาปัตยกรรมที่ออกแบบมาเพื่อรองรับบริบทได้สูงสุดถึง 1,048,576 โทเคน โดยมีการรับประกันขั้นต่ำที่ 512K ไปป์ไลน์การฝึกก่อนการฝึก (pretraining) ถูกสร้างขึ้นใหม่เพื่อขยาย規模เกิน 100 ล้านล้านโทเคน ด้วยข้อมูลมัลติโมดัลตั้งแต่ขั้นตอนแรกแทนที่จะมาต่อยอดภายหลัง เอาต์พุตสูงสุดของโมเดลคือ 512,000 โทเคน
Mistral Large 4 วางเดิมพันที่แตกต่างออกไป มันเป็นโมเดล mixture-of-experts แบบละเอียด โดยมีพารามิเตอร์ที่ใช้งานอยู่ 4.9 หมื่นล้านจากทั้งหมด 1.05 ล้านล้าน พร้อมตัวเข้ารหัสภาพขนาด 1.6 พันล้านพารามิเตอร์ ฝึกตั้งแต่เริ่มต้นบน GPU NVIDIA Grace Blackwell จำนวน 3,800 ตัวภายในศูนย์ข้อมูลยุโรปของ Mistral เอง ด้วยข้อมูลที่ครอบคลุมมากกว่า 160 ภาษา มันรับข้อความและรูปภาพ — ไม่มีวิดีโอ — ครอบคลุมบริบทประมาณหนึ่งล้านโทเค็น และ Mistral วางตำแหน่งผลิตภัณฑ์นี้ไว้ที่การติดตั้งใช้งานแบบ sovereign: โครงสร้างพื้นฐานยุโรป, open weights และความสามารถในการรันภายใต้นโยบายของคุณเอง โดยมีความมั่นคงปลอดภัยไซเบอร์เป็นกรณีการใช้งานเรือธง
• หน้าต่างบริบท — MiniMax M3 1,048,576 โทเคน เทียบกับ Mistral Large 4 ประมาณ 1,000,000 โทเคน
• เอาต์พุตสูงสุด — MiniMax M3 512,000 โทเคน เทียบกับ Mistral Large 4 ที่ยังไม่มีเอกสารระบุ
• รูปแบบอินพุต — MiniMax M3 รองรับข้อความ รูปภาพ และวิดีโอ เทียบกับ Mistral Large 4 รองรับข้อความและรูปภาพ
• ราคาอินพุต — MiniMax M3 $0.30 ต่อ 1 ล้าน เทียบกับ Mistral Large 4 $0.68 ต่อ 1 ล้าน
ราคาผลลัพธ์ — MiniMax M3 $1.20 ต่อ 1M เทียบกับ Mistral Large 4 $2.09 ต่อ 1M
• อินพุตที่แคชไว้ — MiniMax M3 $0.06 ต่อ 1 ล้าน เทียบกับ Mistral Large 4 $0.07 ต่อ 1 ล้าน
• พารามิเตอร์ — Mistral Large 4 รวม 1.05T / ใช้งาน 49B เทียบกับ MiniMax M3 ที่ไม่เปิดเผย
• เปิดตัว — MiniMax M3 31 พฤษภาคม 2026 เทียบกับ Mistral Large 4 6 ตุลาคม 2026, พรีวิว
• ค่าน้ำหนักโมเดล — ทั้งคู่เป็นสัญญาอนุญาตแบบเปิด โดย Mistral Large 4 สัญญาไว้ว่าจะเปิดภายในสิ้นเดือนตุลาคม 2026

สกอร์ไม่ใกล้กันเลย และก็ไม่ยุติธรรมด้วย
บน Artificial Analysis Intelligence Index v4.3.2 นั้น MiniMax M3 ได้คะแนน 29.2 และอยู่อันดับที่ 62 จาก 147 โมเดล นั่นเป็นผลลัพธ์ระดับกลางตาราง และไม่ใช่คำวิจารณ์ตัวโมเดล — Index ถูกปรับปรุงหลังจาก M3 เปิดตัว และรวมการประเมินที่ยังไม่มีอยู่ในตอนที่ MiniMax กำลังเทรน คะแนนย่อยด้านการเขียนโค้ดบอกเรื่องราวได้ดีกว่า: 58.6 บน AA Coding index, อันดับที่ 46 จาก 138 และ 65.2% บน Terminal-Bench 2.1 โดยทำได้ 92.9% บน GPQA Diamond, 83% ในการเรียกคืนบริบทยาว และ 47.1% บน SciCode
Mistral Large 4 ไม่มีคะแนน Index บนบอร์ดเดียวกัน หน้าเว็บยังใช้งานอยู่ภายใต้ชื่อเรื่อง "Mistral Large 4 Preview" และตัวเลขก็ไม่ปรากฏ สิ่งที่ Mistral เผยแพร่คือ ML4 นำหน้า DeepSeek V4 Pro 0813 และ Qwen3.8 Max บน Coding Agent Index แบบรวมด้วย 49.8% และบน AutomationBench — เวิร์กโฟลว์ธุรกิจ 657 รายการครอบคลุม Gmail, Sheets, Slack และ Salesforce — ได้คะแนน 59.9% เหนือกว่า Kimi K3, MiMo-V2.6-Pro และ DeepSeek V4 Pro ไม่มีการเอ่ยชื่อ MiniMax ในการเปรียบเทียบทั้งสองครั้ง ซึ่งนั่นเองเป็นสัญญาณว่า Mistral มองรุ่นใดเป็นคู่แข่งตัวจริง
ดังนั้นการตีความที่เป็นธรรมก็คือ: M3 เป็นโมเดลที่มีความสามารถ ราคาถูก มีเอกสารครบถ้วน มีคะแนนทั่วไปอยู่ระดับกลางตาราง และมีโปรไฟล์ด้านการเขียนโค้ดที่ใช้ได้ โดยมีอายุห้าเดือน ML4 เป็นโมเดลพรีวิวที่อ้างว่าเพดานสูงกว่า ไม่มีคะแนนทั่วไปที่เผยแพร่ และมีชุดตัวเลขเชิงเอเจนต์ที่ Artificial Analysis ประเมินแบบเป็นการส่วนตัว และจะเผยแพร่บน Coding Agent Index เมื่อฮาร์เนสนั้นเปิดตัว ถ้าคุณต้องการตัวเลขสักตัววันนี้ M3 ให้คุณได้ ถ้าคุณรอได้อีกสองสามสัปดาห์ ML4 ก็จะให้คุณเช่นกัน และ Mistral กำลังเดิมพันว่ามันจะสูงกว่า
ในกรณีที่ M3 ไม่มีการแข่งขันจาก ML4 เลย
สองแถวในรายการนั้นไม่ใช่การแลกเปลี่ยน แต่คือการไม่มีอยู่
อินพุตวิดีโอมาเป็นอันดับแรก M3 รองรับวิดีโอโดยตรง ควบคู่ไปกับข้อความและรูปภาพ Mistral Large 4 รับข้อความและรูปภาพเท่านั้น ไม่รับอย่างอื่น — การเจาะลึกของ Mistral เองก็เกี่ยวกับการเชื่อมโยงกับภาพถ่ายดาวเทียมระดับกิกะพิกเซลและแบบวิศวกรรม ซึ่งยังคงเป็นงานด้านรูปภาพ หากไปป์ไลน์ของคุณนำเข้าบันทึกหน้าจอ ฟุตเทจจากการเฝ้าระวัง หรือเอกสารวิดีโอ ML4 ไม่สามารถเป็นโมเดลนั้นได้ ไม่ว่าราคาจะเป็นเท่าใด นั่นไม่ใช่ช่องว่างที่ Mistral จะปิดด้วยการปรับราคา
ความยาวของเอาต์พุตเป็นประเด็นที่สอง M3 ส่งออกได้สูงสุด 512,000 โทเค็นในการตอบกลับครั้งเดียว Mistral ยังไม่ได้ประกาศเพดานเอาต์พุตสำหรับ ML4 การสร้างอาร์ติแฟกต์ที่มีโครงสร้างยาวในครั้งเดียว — รายงานฉบับเต็ม สคริปต์การย้ายข้อมูลขนาดใหญ่ สเปกฉบับสมบูรณ์ — คือเวิร์กโหลดที่เพดาน 512K มีค่ามากกว่าคะแนน Intelligence Index หนึ่งคะแนน และจนกว่า Mistral จะจัดทำเอกสารขีดจำกัดของ ML4 M3 ก็เป็นเพียงหนึ่งในสองตัวที่คุณใช้เป็นหลักในการวางแผนเวิร์กโหลดนั้นได้
ตัวเลขเชิงเอเจนต์ที่ผู้ขายรายงานของ M3 ตอกย้ำภาพเดียวกันนี้ MiniMax ระบุว่าอยู่ที่ 83.5 บน BrowseComp สำหรับการค้นคว้าเว็บแบบอัตโนมัติ 70 บน OSWorld-verified สำหรับการใช้งานคอมพิวเตอร์ 74.2 บน MCP Atlas สำหรับการใช้เครื่องมือ 76.7 บนเกณฑ์ GDPval และ 59 บน SWE Bench Pro คะแนนเหล่านี้มาจากการประเมินของ MiniMax เองและยังไม่มีการทำซ้ำอย่างอิสระ และดูขัดกับคะแนน Index 29.2 ของมันอย่างประหลาด — ซึ่งนี่คือเหตุผลที่ความแตกต่างระหว่างผู้ขายกับอิสระจึงสำคัญ โมเดลหนึ่งสามารถนำในเบนช์มาร์กที่ผู้ขายเลือกไว้ และไปอยู่กลางตารางเมื่อเทียบกับค่าเฉลี่ยจากการประเมินสิบรายการที่เป็นกลาง และทั้งสองอย่างก็เป็นจริงได้พร้อมกัน
2x คุ้มไหม
ช่องว่างราคาตรงนี้เล็กจริง ๆ ในเชิงตัวเลขสัมบูรณ์ ซึ่งเปลี่ยนการคำนวณเมื่อเทียบกับการจับคู่ที่ไม่ลงตัวกับเรือธงแบบปิด สมมติเดือนหนึ่งใช้หนึ่งร้อยล้านโทเค็น แบ่งอินพุต/เอาต์พุต 4:1: อินพุต 80 ล้านโทเค็น และเอาต์พุต 20 ล้าน M3 คิดเงิน $24 บวก $24 รวม $48 Mistral Large 4 คิดเงิน $54.40 บวก $41.80 รวม $96.20 ส่วนต่างที่จ่ายเพิ่มอยู่ที่ประมาณ $48 ต่อเดือน — เงินจำนวนจริงเมื่อใช้ในสเกลใหญ่ แต่เป็นช่องว่างแบบที่ความล้มเหลวเพียงครั้งเดียวที่หลีกเลี่ยงได้ก็คุ้มค่าแล้ว
การแคชช่วยลดช่องว่างลงอีก และเข้าข้าง M3 เพียงเล็กน้อยเท่านั้น: $0.06 เทียบกับ $0.07 ต่อโทเคนแคชหนึ่งล้านโทเคนถือเป็นความคลาดเคลื่อนจากการปัดเศษ ณ ระดับราคานี้ ทั้งสองราคาถูกพอที่การตัดสินใจควรอยู่ที่ความสามารถและความเหมาะสมมากกว่าราคาที่ต้องจ่าย ซึ่งเป็นตรงกันข้ามกับสิ่งที่การเปรียบเทียบนี้ดูเหมือนจะสื่อในตอนแรก
สิ่งที่ค่าพรีเมียมซื้อมาคือช่วงเวลา ML4 ถูกเทรนห้าเดือนหลังจากนั้นด้วยข้อมูลที่ใหม่กว่า ในโครงสร้าง mixture-of-experts ที่มีหนึ่งล้านล้านพารามิเตอร์ โดยมี 49 พันล้านพารามิเตอร์ที่ใช้งานอยู่ และ Mistral กำลังทำ reinforcement learning กับมันในอัตราที่ระบุไว้ 33 พันล้านโทเค็นต่อวัน โดยเป็นการรันที่ยังไม่อิ่มตัว M3 เสร็จสิ้นแล้ว ส่วน ML4 กำลังพัฒนาตามจังหวะที่ประกาศไว้ เมื่อผู้ขายบอกว่าโมเดลที่คุณซื้อวันนี้เป็นเวอร์ชันที่อ่อนแอที่สุดที่คุณจะจ่ายเงินซื้อ และค่าพรีเมียมเมื่อเทียบกับตัวเดิมต่ำกว่าหนึ่งดอลลาร์ต่อหนึ่งล้านโทเค็น โมเดลที่ใหม่กว่ามักจะเป็นค่าเริ่มต้นที่ดีกว่า ข้อยกเว้นคือสองเวิร์กโหลดข้างต้น ซึ่งโมเดลที่เก่ากว่าเป็นเพียงตัวเดียวที่เหมาะสม
การกำหนดเส้นทางอ้อมช่องว่าง

นี่คือการจับคู่ที่การรันทั้งสองตัวไม่ใช่การป้องกันความเสี่ยง แต่เป็นคำตอบที่แท้จริง เพราะทั้งสองโมเดลเก่งในจุดที่แตกต่างกันโดยสิ้นเชิง วิดีโอเข้า อาร์ติแฟกต์ยาวออก หรือลูปการใช้งานคอมพิวเตอร์: M3 การวิเคราะห์เอกสารและภาพ เวิร์กโฟลว์แบบเอเจนต์ หรืออะไรก็ตามที่ต้องรันบนโครงสร้างพื้นฐานยุโรปภายใต้นโยบายของคุณเอง: ML4 ไม่มีกฎการจัดเส้นทางใดที่ทำให้ตัวใดตัวหนึ่งกลายเป็นส่วนเกิน
ทั้งคู่อยู่เบื้องหลังเอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI บน OrcaRouter โดยมีมาร์กอัป 0% และราคาตามรายการของผู้ให้บริการที่ส่งผ่านโดยไม่ดัดแปลง ซึ่งทำให้ส่วนต่างราคาห้าเดือนยังคงซื่อตรง — ถ้า MiniMax ลดราคาของ M3 หรือ Mistral ยุติราคาพรีวิว ตัวเลขที่เส้นทางของคุณถูกประเมินเทียบจะเปลี่ยนในวันเดียวกัน DSL การจัดเส้นทางคือสิ่งที่เปลี่ยนจุดแข็งที่แยกจากกันให้กลายเป็น พื้นผิวการเรียกหนึ่งเดียว: กฎที่ตรวจสอบโมดาลิตีของคำขอจะส่งเพย์โหลดที่มีวิดีโอไปยัง M3 และส่งอย่างอื่นไปยัง ML4 ด้วยความมั่นใจว่าการสะดุดด้านความพร้อมใช้งานของโมเดลพรีวิวจะ ถูกดูดซับโดยการสลับทำงานอัตโนมัติ แทนที่จะถูกส่งต่อไปยังผู้ใช้ของคุณ. ในกรณีที่ผลลัพธ์เดียวสำคัญกว่าราคาเดียว การหลอมรวมโมเดลสามารถรันทั้งสองและให้คณะผู้ตัดสินเลือก ซึ่งเป็นวิธีที่สมเหตุสมผลในการซื้อเพดานที่ Mistral อ้างไว้ ขณะที่รักษาพฤติกรรมที่บันทึกไว้ของ M3 เป็นพื้น

คำตัดสิน
MiniMax M3 เป็นคำตอบที่ถูกต้องสำหรับสองเวิร์กโหลด และเป็นคำตอบที่ปกป้องได้สำหรับเวิร์กโหลดที่สาม การป้อนข้อมูลวิดีโอ การสร้างข้อความในรอบเดียวหลายแสนโทเคน และเอเจนต์ที่ใช้งานคอมพิวเตอร์เป็นถิ่นของมัน ราคาของมันต่ำที่สุดในบรรดาเรือธงระดับนี้ และคะแนนระดับกลางตารางที่เผยแพร่ของมันหมายความว่าคุณรู้แน่ชัดว่าคุณกำลังจะได้อะไร อายุห้าเดือนไม่ถือว่าเก่าสำหรับโมเดลที่ยังไม่มีอะไรมาแทนที่ในกลุ่มเฉพาะของตัวเอง
Mistral Large 4 เป็นค่าเริ่มต้นที่ดีกว่าสำหรับทุกอย่างอื่น การใช้โทเค็นหนึ่งร้อยล้านโทเค็นต่อเดือนมีค่าใช้จ่ายเพิ่มขึ้นประมาณ $48 จำนวนพารามิเตอร์และที่มาของการฝึกในยุโรปชี้ไปที่เพดานที่สูงกว่า คำกล่าวอ้างด้านความปลอดภัยไซเบอร์มีความเฉพาะเจาะจงเพียงพอที่จะตรวจสอบได้ และน้ำหนักโมเดลแบบเปิดที่สัญญาไว้พร้อมการปรับใช้ภายในองค์กร ตอบโจทย์ความต้องการที่เรื่องราวสำหรับองค์กรแบบ API-only ของ M3 ไม่สามารถทำได้ ราคาของการเดิมพันนั้นคือคุณกำลังผูกมัดกับโมเดลที่คะแนน Independent Intelligence Index ยังไม่ได้รับการเผยแพร่ และพฤติกรรมที่ Mistral บอกว่าจะเปลี่ยนแปลงอย่างมากภายในไม่กี่สัปดาห์
สองวันที่จะคลี่คลายเรื่องนี้: ปลายเดือนตุลาคม 2026 เมื่อน้ำหนักของ ML4 ถูกปล่อยออกมาหรือไม่ก็คำสัญญาเรื่อง open-weights เริ่มดูไม่หนักแน่น และการเผยแพร่ Coding Agent Index ที่ซึ่ง 49.8% ที่ประเมินเป็นการภายในของ Mistral มาบรรจบกับคะแนนเขียนโค้ด 58.6 ที่เปิดเผยของ M3 บนรีวิชันเดียวกัน จนถึงตอนนั้น M3 คือโมเดลที่คุณตรวจสอบได้ และ ML4 คือโมเดลที่คุณกำลังเดิมพัน — และด้วยส่วนต่างราคารายเดือน 48 ดอลลาร์สำหรับหนึ่งร้อยล้านโทเคน นั่นก็ไม่ใช่การเดิมพันที่ใหญ่โตอะไร
