การ์ดหลักที่มีหัวข้อ 'MiMo-V2.6-Pro vs MiMo-V2.6-Flash' พร้อมคำโปรย 'ช่องว่างราคา 3 เท่า และสิ่งที่ไม่ได้อธิบายช่องว่างนั้น' และสองพาเนล: พาเนลซ้ายมีหัวข้อ 'MiMo-V2.6-Pro' ระบุ '$0.435 / $0.87 ต่อ 1M' และ 'พารามิเตอร์ที่ใช้งาน 42B' และพาเนลขวามีหัวข้อ 'MiMo-V2.6-Flash' ระบุ '$0.14 / $0.28 ต่อ 1M' และ 'พารามิเตอร์ที่ใช้งาน 15B' เหนือส่วนท้ายที่ระบุ 'ทั้งคู่ใช้สัญญาอนุญาต MIT · ทั้งคู่มีบริบท 1M · ดัชนีเผยแพร่สำหรับ Pro เท่านั้น'
Guides & Insights

MiMo-V2.6-Pro vs MiMo-V2.6-Flash: ช่องว่างราคา 3 เท่าที่เบนช์มาร์กสองรายการไม่อาจอธิบายได้

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ในตารางการประเมินของ Xiaomi เอง MiMo-V2.6-Flash เอาชนะ MiMo-V2.6-Pro ได้ แถวนั้นคือ CyberGym และส่วนต่างคือ 95.1 ต่อ 94.0 มันเป็นเพียงหนึ่งแถวจากทั้งหมดสิบห้าแถว และนี่คือเหตุผลที่ควรอ่านส่วนที่เหลือของการเปรียบเทียบนี้อย่างละเอียด แทนที่จะคิดไปเองว่ารุ่นเรือธงคือคำตอบเสมอ — เพราะ MiMo-V2.6-Flash มีค่าใช้จ่ายประมาณหนึ่งในสามของ MiMo-V2.6-Pro และในแถวส่วนใหญ่ ทั้งสองรุ่นมีคะแนนห่างกันเพียงไม่กี่คะแนน

ทั้งสองโมเดลได้รับการเผยแพร่เป็นรีโพซิทอรีบน Hugging Face เมื่อวันที่ 21 กันยายน 2026 ภายใต้สัญญาอนุญาต MIT โดยห่างกันสิบแปดวินาที ในฐานะการรันเทรนที่แยกจากกัน มากกว่าจะเป็นขั้นบันไดเดียวกัน Xiaomi MiMo-V2.6-Pro คือระดับพารามิเตอร์ล้านล้าน ส่วน MiMo-V2.6-Flash คือระดับที่เน้นประสิทธิภาพ คำถามที่หน้านี้ตอบคือรุ่นใดในสองรุ่นนี้ควรอยู่ในเส้นทางโปรดักชันของคุณ และคำตอบที่ตรงไปตรงมาขึ้นอยู่กับตัวเลขที่ไม่มีอยู่ในทั้งสองรุ่นที่เผยแพร่

แต่ละอย่างคืออะไร

• พารามิเตอร์ — Xiaomi MiMo-V2.6-Pro มี 1.02T ทั้งหมด โดยมี 42B ที่ทำงานต่อโทเคน เทียบกับ Xiaomi MiMo-V2.6-Flash ที่ราว 309B ทั้งหมด โดยมี 15B ที่ทำงาน
• สถาปัตยกรรม — ทั้งคู่เป็น sparse mixture-of-experts ที่มีอินพุตแบบ omnimodal โดยกำเนิด; Flash มีเอกสารระบุที่ 48 เลเยอร์, 39 sliding-window และ 9 full attention, ขนาด hidden 4096, 256 routed experts โดยมี 8 ตัวที่ทำงานและไม่มี shared experts พร้อมกับ vision transformer ขนาด 681M, audio tokenizer ขนาด 308M และ audio patch encoder ขนาด 127M
• Context — 1M โทเคนในทั้งสองรุ่น โดยมีเอาต์พุตสูงสุด 128,000 โทเคนในทั้งสองรุ่น
• สัญญาอนุญาต — MIT ทั้งคู่, น้ำหนักโมเดลเปิดให้เข้าถึงได้โดยไม่มีข้อจำกัดทั้งคู่
• ราคา — $0.435 ขาเข้า และ $0.87 ขาออก ต่อล้านโทเคนสำหรับ Pro เทียบกับ $0.14 และ $0.28 สำหรับ Flash: ช่องว่าง 3.1 เท่าในทั้งสองด้านของการ์ด
• อินพุตที่แคชฮิต — $0.0036 ต่อล้านบน Pro, $0.0028 บน Flash
• ค่าใช้จ่ายในการฝึก — Xiaomi รายงานประมาณ $2.62M สำหรับการรัน RL ของ Pro และ $854K สำหรับ Flash โดยแต่ละครั้งเสร็จสิ้นภายในไม่ถึงหกวัน ผ่าน 30 ขั้นตอนการเรียนรู้แบบเสริมกำลัง และประมาณ 750,000 เทรเจกทอรี
• คะแนนดัชนีอิสระ — 46 สำหรับ Xiaomi MiMo-V2.6-Pro บน Artificial Analysis Intelligence Index v4.3.2; ไม่มีเผยแพร่สำหรับ MiMo-V2.6-Flash

บรรทัดสุดท้ายนั่นแหละคือสิ่งที่ต้องยึดไว้ให้ดี ทุกอย่างที่อยู่เหนือขึ้นไป ยกเว้นคะแนน Pro เป็นข้อมูลที่ Xiaomi รายงานเอง

ที่ราคาสามเท่าแทบไม่ได้อะไรเลย

ตารางที่ 3 ของ Xiaomi นำทั้งสองมาเปรียบเทียบเคียงข้างกันในฮาร์เนสต่างๆ ที่ซีรีส์นี้ถูกฝึกมา และเมื่องานแบบเอเจนต์ที่มีขอบเขตยาวนาน ส่วนต่างกลับมีน้อย:

• DeepSWE v1.1 — Pro 71.9, Flash 67.9
• MiMo Code Bench — Pro 63.2, Flash 61.2
• AutomationBench v1.0.6 — Pro 53.1, Flash 52.3
• Toolathlon-Verified — Pro 76.9, Flash 73.6
• Terminal Bench 2.1 — Pro 89.9, Flash 87.6
• OSWorld-Verified — Pro 82.0, Flash 80.8
• JobBench — Pro 62.0, Flash 61.2
• MiMo Visual Coding — Pro 72.3, Flash 71.5
• CyberGym — Pro 94.0, Flash 95.1
• MiMo Cyber Bench — Pro 80.2, Flash 77.2

อ่านลงไปตามคอลัมน์นั้น แล้วจะเห็นว่าข้อได้เปรียบของเรือธงส่วนใหญ่อยู่ระหว่างหนึ่งถึงสี่คะแนน โดยมีหนึ่งแถวที่แพ้ไปเลย ในเวิร์กโฟลว์ที่ความต่างระหว่าง 67.9 กับ 71.9 คือความต่างระหว่างงานที่ทำสำเร็จกับงานที่ล้มเหลว ราคาสามเท่าถือว่าถูก แต่ในเวิร์กโฟลว์ที่มันเป็นเพียงความต่างระหว่างคำตอบที่ยอมรับได้สองแบบ มันก็ไม่ถูก ตารางของผู้ขายที่มีทศนิยมแบบนี้ชวนให้เกิดความแม่นยำลวง ไม่มีใครนอกเสียวหมี่ได้รันมัน และช่องว่างสองคะแนนบนชุดทดสอบที่ให้คะแนนกันภายในนั้นก็อยู่ในช่วงที่ผู้ให้คะแนนคนละคนหรือนโยบายลองใหม่ที่ต่างออกไปสามารถขยับได้อย่างสบาย

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6-Flash — the scoreboard'. The left column, MiMo-V2.6-Pro, reads Active params 42B, Price $0.435 / $0.87, DeepSWE v1.1 71.9, CyberGym 94.0, ExploitGym 17.8, Independent index 46. The right column, MiMo-V2.6-Flash, reads Active params 15B, Price $0.14 / $0.28, DeepSWE v1.1 67.9, CyberGym 95.1, ExploitGym 6.0, Independent index none published. A footer reads 'All benchmark figures are Xiaomi's own runs; only the Pro index score is independent.'

ที่ที่มันซื้อจำนวนมาก

มีกลุ่มของแถวหนึ่งที่ช่องว่างนั้นไม่ใช่แค่เรื่องการปัดเศษอีกต่อไป ทุกแถวในกลุ่มนี้ล้วนเป็นงานด้านความปลอดภัย:

• ExploitGym — Pro 17.8, Flash 6.0
• ExploitBench — Pro 47.9, Flash 25.3
• SEC Bench Pro — Pro 66.3, Flash 47.5
• Agents' Last Exam — Pro 31.6, Flash 27.6
• Terminal Bench 4.0 — Pro 34.9, Flash 28.8

บน ExploitGym รุ่นเรือธงทำได้เป็นสามเท่าของรุ่นที่ถูกกว่า ซึ่งเป็นตัวคูณเดียวกับราคา และบน SEC Bench Pro มันอยู่ที่ 1.4 เท่า รูปแบบแบบนี้คือสิ่งที่คุณคาดว่าจะเห็นได้จากโมเดลที่มีพารามิเตอร์ที่ใช้งานจริง 42B เมื่อเทียบกับโมเดลที่มี 15B: งานที่ต้องใช้ห่วงโซ่การให้เหตุผลที่ยาวโดยไม่มีคะแนนบางส่วนเป็นงานประเภทที่ความจุที่เพิ่มขึ้นจะแสดงออกมา และการที่ CyberGym อยู่ตรงกันข้ามนั้นเป็นข้อยกเว้นที่พิสูจน์ว่าการรันทั้งสองครั้งได้เรียนรู้สิ่งที่แตกต่างกัน ไม่ใช่สิ่งเดียวกันในขนาดที่ต่างกัน

ดังนั้นการแบ่งแยกนี้จึงสอดคล้องกับขอบเขตของภาระงานจริง ไม่ใช่แค่กลยุทธ์การตลาด งานเอเจนต์ปริมาณมากที่มีเกณฑ์ความสำเร็จแบบผ่อนปรน — การค้นคืน, การจำแนกประเภท, การแก้ไขงานประจำ, การเรียกใช้ที่การลองใหม่สามารถกู้คืนได้ — เป็นพื้นที่ของ Flash งานที่คำตอบผิดมีค่าใช้จ่ายสูงและคำตอบที่ไม่สมบูรณ์ไม่มีค่า — การพัฒนาเอ็กซ์พลอยต์, การตรวจสอบความปลอดภัย, เซสชันเทอร์มินัลที่มีสถานะหลายขั้นตอน — คือจุดที่ระดับ Pro คุ้มค่ากับราคาที่สูงกว่า

ตัวเลขที่ไม่มีอยู่

MiMo-V2.6-Flash ไม่มีหน้าโมเดลบน Artificial Analysis แต่รุ่นพี่น้องของมันมี ความไม่สมมาตรนี้คือสิ่งสำคัญที่สุดในหน้านี้ เพราะมันหมายความว่าตัวเลขเดียวที่วัดอย่างเป็นอิสระในซีรีส์ MiMo-V2.6 ทั้งหมดคือ 46 ที่อยู่ข้าง Xiaomi MiMo-V2.6-Pro ทุกตัวเลขของ Flash ข้างต้น — รวมถึงแถว CyberGym ที่มันชนะ — มาจากฮาร์เนสของ Xiaomi ตัวให้คะแนนของ Xiaomi และการรันแบบออฟไลน์ของ Xiaomi

มีเหตุผลที่น่าเชื่อถือว่าเรื่องนี้เป็นเพียงชั่วคราว: โมเดลเพิ่งเปิดตัวได้หนึ่งวันในเวลาที่เขียน และการประเมินโดยบุคคลที่สามต้องใช้เวลา ยังมีเหตุผลที่น่าเชื่อถือเช่นกันว่ามันเป็นเชิงโครงสร้าง เนื่องจาก Flash เป็นระดับปริมาณ (volume tier) และระดับปริมาณมักได้รับความสนใจในการทดสอบ benchmark น้อยกว่า ไม่ว่าจะทางใด ผลในทางปฏิบัติในวันนี้คือคุณไม่สามารถเปรียบเทียบ Flash กับสิ่งใดนอกจากครอบครัวของมันเองด้วยความมั่นใจเท่ากับที่คุณเปรียบเทียบ Pro ได้ หากคุณกำลังเลือกระหว่าง Flash กับโมเดลที่ไม่ใช่ Xiaomi โดยพิจารณาจากราคาต่อคุณภาพ คุณกำลังเปรียบเทียบตัวเลขจากผู้ขายกับตัวเลขที่วัดได้จากบุคคลอื่น

การ์ดโมเดลทั้งสองใบมีข้อแม้ที่สองเหมือนกัน ไม่มีรีโพซิทอรีใดถูกนำไปใช้งานโดยผู้ให้บริการ inference รายใด — Hugging Face ระบุไว้อย่างชัดเจนในแต่ละหน้า และ Artificial Analysis นับผู้ให้บริการ API เพียงรายเดียวสำหรับ Pro เราไม่ได้โฮสต์เช็กพอยต์ใดในสองตัวนี้ ดังนั้นจึงไม่มีตัวใดที่สามารถเรียกใช้งานผ่านเราได้ เส้นทางไปยังทั้งสองคือแพลตฟอร์มของ Xiaomi เองและแค็ตตาล็อกของบุคคลที่สามที่ให้บริการโมเดลทั้งสอง

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Flash-RL, showing the MIT licence tag and multimodal tags including 8-bit precision and fp8, a Safetensors panel reporting a model size of 159B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a model tree listing one finetune and six quantizations, and a collection block headed MiMo-V2.6 holding three items.

ราคาที่คุณต้องจ่ายในรูปของฮาร์ดแวร์ ไม่ใช่โทเคน

ราคาต่อโทเคนเป็นเพียงครึ่งเดียวของสิ่งที่เช็กพอยต์ทำให้คุณต้องจ่าย และทั้งสองอย่างแตกต่างกันรุนแรงกว่ามากบนดิสก์มากกว่าบนตารางราคา MiMo-V2.6-Flash เผยแพร่น้ำหนัก FP8 ขนาด 172.9 GB กระจายอยู่ใน 65 ชาร์ด Xiaomi MiMo-V2.6-Pro มีจำนวนพารามิเตอร์ราวสามเท่า ซึ่งทำให้ขนาดดาวน์โหลดดิบอยู่ในช่วงครึ่งเทระไบต์ก่อนการควอนไทซ์ใด ๆ — และที่เก็บข้อมูลของมันเองรายงานขนาดโมเดล Safetensors ไว้ที่ 524B พารามิเตอร์ ซึ่งเป็นตัวเลขที่ไม่สอดคล้องกับทั้งจำนวนรวม 1.02T และจำนวนที่ใช้งานจริง 42B

ช่องว่างนั้นเปลี่ยนรูปร่างของการตัดสินใจ Flash ที่ 172.9 GB เป็นโมเดลที่ทีมเล็กสามารถโฮสต์เองบนความจุเช่าและมองเป็นสินค้าโภคภัณฑ์ได้ Pro ที่ขนาดประมาณสามเท่าของสิ่งนั้นเป็นการตัดสินใจระดับคลัสเตอร์ — การรายงานข่าวช่วงเปิดตัวระบุว่าการฝึกสองครั้งใช้ GPU เทียบเท่า H200 ประมาณ 4,000 และ 8,000 ตัวตามลำดับ หากเหตุผลที่คุณดูเวตแบบเปิดคือคุณต้องการทางเลือกในการหยุดจ่ายต่อโทเคน เช็กพอยต์ทั้งสองก็มอบทางเลือกนั้นในระดับความมุ่งมั่นที่ต่างกันมาก

การเลือกระหว่างพวกมัน

กฎที่ยังคงใช้ได้แม้มีข้อแม้ข้างต้นคือ ให้เลือกตามประเภทของภาระงาน ไม่ใช่ตามค่าเฉลี่ยเบนช์มาร์ก ใช้ Flash กับงานใดก็ตามที่คุณสบายใจจะลองใหม่ ใช้ Pro กับงานใดก็ตามที่การลองใหม่ไม่ช่วยกอบกู้คุณ จากนั้นก็วัดผล เพราะไม่มีโมเดลใดมีคะแนนอิสระบนเบนช์มาร์กที่คุณสนใจจริง ๆ

การวัดสองเช็คพอยต์เทียบกันแบบเคียงข้างกันคือจุดที่เราเตอร์ทำสิ่งที่สัญญาแบบรายโมเดลทำไม่ได้ การวางระดับราคาถูกให้รองรับปริมาณทราฟฟิกส่วนใหญ่ของคุณ แล้วส่งเฉพาะเคสยาก ๆ ไต่ขึ้นไปยังระดับราคาแพงเป็นการตัดสินใจแบบเดียวกับที่หน้านี้พูดถึง เพียงแต่แสดงออกมาในรูปของการตั้งค่าแทนการเขียนใหม่ — และองค์ประกอบแบบนั้นคือสิ่งที่ชั้นการจัดเส้นทางมีอยู่เพื่อรองรับ มันยังสำคัญต่อตัวราคาเองด้วย: เราส่งผ่านราคาตามรายการของผู้ให้บริการโดยบวกเพิ่ม 0% ดังนั้นหาก Xiaomi ลดราคาลงในเช็คพอยต์ใดเช็คพอยต์หนึ่ง ตัวเลขฝั่งเราก็จะขยับในวันเดียวกัน ไม่ใช่รอไปจนถึงการต่อสัญญาครั้งถัดไป เรื่องนี้ใช้กับโมเดลที่เราดำเนินการอยู่ สำหรับคู่ MiMo-V2.6 โดยเฉพาะ ตอนนี้คุณยังคงซื้อตรงจาก Xiaomi

อะไรจะยุติเรื่องนี้ได้

สองสิ่งจะเปลี่ยนเรื่องนี้จากการตัดสินใจด้วยดุลพินิจให้กลายเป็นการคำนวณ หน้า Artificial Analysis สำหรับ MiMo-V2.6-Flash จะวางเช็กพอยต์ทั้งสองไว้บนแกนต้นทุนต่องานเดียวกัน ซึ่งปัจจุบันจัดให้ Pro อยู่ที่ $0.133 ต่องาน Intelligence Index และการเปรียบเทียบก็จะคลี่คลายไปเอง การทำซ้ำโดยบุคคลที่สามของกลุ่มความปลอดภัย — ExploitGym, ExploitBench, SEC Bench Pro — จะยืนยันว่าช่องว่าง 3 เท่าในแถวเหล่านั้นเป็นคุณสมบัติของโมเดลหรือเป็นคุณสมบัติของเกรดเดอร์

จนถึงตอนนั้น จุดยืนที่สามารถปกป้องได้คือ Xiaomi MiMo-V2.6-Flash เป็นตัวเลือกที่น่าซื้อกว่าสำหรับทีมส่วนใหญ่เกือบตลอดเวลา และ Xiaomi MiMo-V2.6-Pro เป็นตัวเลือกที่น่าซื้อกว่าสำหรับงานเฉพาะกลุ่มแคบ ๆ ที่ความล้มเหลวเป็นผลลัพธ์ที่มีต้นทุนสูง แถวเดียวที่ Flash ชนะไม่ได้หักล้างข้อสรุปนั้น — แต่มันเป็นเครื่องเตือนใจที่มีประโยชน์ว่าส่วนเพิ่มราคาของเรือธงเป็นข้ออ้างเกี่ยวกับภาระงาน ไม่ใช่เกี่ยวกับตัวโมเดล

Screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, showing the Xiaomi attribution and 'Released September 2026', an Intelligence card reading 46 ranked #1 of 114, a Speed card reading 125.2 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.13 cost per Intelligence Index task, and a Verbosity card reading 140M output tokens, with a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube