การ์ดหลักหัวข้อ 'MiMo-V2.6-Pro vs MiMo-V2.6' พร้อมคำโปรย 'อันหนึ่งคือเช็กพอยต์ อีกอันคือป้ายชื่อ' และสองแผง: แผงซ้ายหัวข้อ 'MiMo-V2.6-Pro' ระบุ 'ค่าน้ำหนัก, ราคา, ดัชนี 46.3' และ 'ต้นทุนต่องาน $0.13' และแผงขวาหัวข้อ 'MiMo-V2.6' ระบุ 'ชื่อซีรีส์' และ 'ครอบคลุม Pro และ Flash' เหนือส่วนท้ายที่ระบุ 'ส่วนต่างราคาระหว่างเช็กพอยต์สองตัวที่มันครอบคลุม: 3.1x'
Guides & Insights

MiMo-V2.6-Pro vs MiMo-V2.6: เมื่อชื่อโมเดลเลิกเป็นโมเดล

ผู้เขียน

Magnus Corvin

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Artificial Analysis มีหน้าสำหรับ MiMo-V2.5 แต่ไม่มีหน้าสำหรับ MiMo-V2.6 การไม่มีอยู่นั้นคือเรื่องราวทั้งหมดของการจับคู่นี้: ในรุ่นก่อน เลขเวอร์ชันล้วน ๆ ชี้ไปที่เช็กพอยต์ที่คุณดาวน์โหลดและเรียกใช้ได้ ในรุ่นนี้มันไม่เป็นเช่นนั้น Xiaomi MiMo-V2.6-Pro เป็นโมเดลที่มีน้ำหนัก มีราคา และมีคะแนนที่วัดอย่างอิสระ "MiMo-V2.6" เป็นเพียงป้ายที่วางอยู่เหนือมัน และทั้งสองไม่ใช่สิ่งประเภทเดียวกัน — ซึ่งทำให้การเปรียบเทียบนี้เป็นการเปรียบเทียบระหว่างเช็กพอยต์กับชื่อ ไม่ใช่ระหว่างโมเดลสองตัว

การระบุให้ชัดเจนในเรื่องนี้เป็นสิ่งที่คุ้มค่า เพราะความแตกต่างนั้นมีราคาติดอยู่ Xiaomi MiMo-V2.6-Pro ระบุราคาไว้ที่ $0.435 ต่อหนึ่งล้านโทเค็นอินพุต และ $0.87 ต่อหนึ่งล้านโทเค็นเอาต์พุต Xiaomi MiMo-V2.6-Flash ซึ่งเป็นเช็คพอยต์อีกตัวที่ป้ายกำกับครอบคลุม ระบุราคาไว้ที่ $0.14 และ $0.28 หากคุณเลือกผิดตัวใดตัวหนึ่งในนั้น เพราะแคตตาล็อก ไฟล์คอนฟิก หรือเอกสารจัดซื้อระบุเพียง "MiMo-V2.6" และไม่มีอะไรอื่นอีก คุณจะคลาดเคลื่อนไปถึงสามเท่าก่อนที่คุณจะเรียกใช้งานแม้แต่ครั้งเดียว

"MiMo-V2.6" แปลงไปเป็นอะไร

สามสิ่งที่แตกต่างกัน ขึ้นอยู่กับว่าคุณอ่านมันที่ไหน

อย่างแรกคือซีรีส์นี้ เอกสารเปิดตัวของเสียวหมี่เองระบุว่ายุค V2.6 ประกอบด้วยเช็กพอยต์แบบ omnimodal แท้จริงสองรายการ ได้แก่ Pro และ Flash ซึ่งเผยแพร่เป็นรอบการฝึกแยกจากกัน คอลเลกชันบน Hugging Face ที่เก็บเช็กพอยต์เหล่านี้มีชื่อตรง ๆ ว่า MiMo-V2.6 — ปัจจุบันมีรายการอยู่สามรายการ หากนับรวมระดับการให้บริการ Pro-UltraSpeed และชื่อคอลเลกชันนั้นคือจุดที่เป็นไปได้มากที่สุดเพียงแห่งเดียวที่ใครสักคนจะได้รู้หมายเลขเวอร์ชันล้วน ๆ แล้วเข้าใจว่ามันเป็นชื่อของโมเดล

อย่างที่สองเป็นคำเรียกสั้น ๆ สำหรับเรือธง ในการรายงานข่าวการเปิดตัวส่วนใหญ่และในการสนทนาแบบเรียกสั้น ๆ ส่วนใหญ่ "MiMo-V2.6" หมายถึงระดับพารามิเตอร์ล้านล้าน เพราะนั่นคือโมเดลที่การรายงานข่าวกล่าวถึง นี่คือการตีความที่ก่อความเสียหายน้อยที่สุด เนื่องจากโดยปกติแล้วมันสื่อถึงโมเดลที่ผู้คนตั้งใจหมายถึง

อย่างที่สามคืออันที่ต้องจ่ายเงิน: แค็ตตาล็อกหรือคอนฟิกที่ "MiMo-V2.6" ถูกยุบรวมเข้ากับเช็กพอยต์ใดก็ตามที่ผู้ขายรายนั้นให้บริการอยู่ รีโพซิทอรีมีชื่อว่า MiMo-V2.6-Pro-RL และ MiMo-V2.6-Flash-RL และคำต่อท้าย -RL นั้นหมายถึงสายการฝึกหลังการฝึก มากกว่าจะเป็นอะแดปเตอร์ที่วางทับอยู่บนโมเดลฐาน — เป็นรายละเอียดที่ควรรู้ก่อนที่คุณจะไปตามหาเวตแบบ non-RL ที่ใช้คู่กับพวกมัน เพราะไม่มีเวตแบบนั้นอยู่เลย

ระดับกลางที่ไม่มีอยู่อีกต่อไป

ความกำกวมนี้เป็นเรื่องใหม่ และสาเหตุก็คือตรงกลางของไลน์อัปหายไป

Artificial Analysis ยังคงระบุโมเดลชื่อ MiMo-V2.5 ซึ่งเปิดตัวเมื่อวันที่ 22 เมษายน 2026 ได้คะแนน 25.17 บนดัชนี ในราคา $0.14 ต่ออินพุตโทเคนหนึ่งล้าน และ $0.28 ต่อเอาต์พุต พร้อมน้ำหนักแบบเปิด มันอยู่ต่ำกว่า MiMo-V2.5-Pro ซึ่งได้คะแนน 26.0 บนมาตรฐานเดียวกัน ที่ราคา $0.435 และ $0.87 พร้อมบริบท 1M และพารามิเตอร์ทั้งหมด 1023B นั่นคือรุ่นที่มีสามขั้น: โมเดลชื่อเปล่า ๆ ราคาถูก, เรือธง, และไม่มีอะไรบังคับให้คุณต้องเลือกระหว่างสองสุดขั้ว

รุ่น V2.6 มีสองระดับที่ใครก็เรียกใช้ได้: Pro อยู่บนสุด และ Flash อยู่ล่างสุด ไม่มี checkpoint ระดับกลางมาดูดซับทราฟฟิกที่ตกอยู่ระหว่างทั้งสอง และไม่มีเอกสารเปิดตัวใดอธิบายถึงสิ่งนั้นไว้ Xiaomi เผยแพร่จุดเริ่มต้น MiMo-V2.6-Distill-Qwen-9B และเฟรมเวิร์ก RL ควบคู่ไปกับเวต แต่จุดเริ่มต้นแบบ distillation สำหรับงานฝึกไม่ใช่ระดับกลางที่โฮสต์ไว้สำหรับการอนุมาน

ในทางปฏิบัติ นั่นหมายความว่าการตัดสินใจที่หน้านี้อธิบายไว้ — จะเป็น Pro หรือชื่อเปล่า ๆ — แท้จริงแล้วเป็นการตัดสินใจว่าคุณกำลังยืนอยู่บนขั้นไหน หากสิ่งที่คุณต้องการจริง ๆ คือช่อง MiMo-V2.5 แบบเก่า สิ่งที่ใกล้เคียงที่สุดในรุ่นใหม่คือ Flash ในราคาเดียวกันที่ $0.14/$0.28 และมีคำกล่าวอ้างเรื่องความสามารถที่สูงกว่ามากแนบมาด้วย

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6 — the scoreboard'. The left column, MiMo-V2.6-Pro, reads What it is a checkpoint, Index 46.3 measured, Price $0.435 / $0.87, Weights MIT on Hugging Face, Context 1M tokens, API providers one. The right column, MiMo-V2.6, reads What it is the series label, Index not measured, Price $0.14 to $0.87, Weights held by Pro and Flash, Context 1M on both, API providers none per the model cards. A footer reads 'Pro figures measured by Artificial Analysis v4.3.2; series facts per Xiaomi's release material.'

การอัปเกรดที่ชื่อซ่อนไว้

ตัดประเด็นเรื่องชื่อเรียกออกไป แล้วจะเหลือข้อเท็จจริงที่ชัดเจน เป็นวงกว้าง และมีหลักฐานหนุนแน่นหนาอยู่ข้างใต้ นั่นคือเรือธงรุ่นนี้พัฒนาไปไกลมากภายในรุ่นเดียวโดยไม่ปรับราคา

• คะแนนดัชนี — MiMo-V2.5-Pro ได้ 26.0 บน Artificial Analysis Intelligence Index เทียบกับ 46.3 สำหรับ Xiaomi MiMo-V2.6-Pro โดยทั้งคู่เป็นผลการวัดจาก Artificial Analysis ไม่ใช่จาก Xiaomi
• ราคาต่อโทเคน — ไม่เปลี่ยนแปลง: อินพุต $0.435, เอาต์พุต $0.87 สำหรับทั้งสองรุ่น
• ค่าใช้จ่ายต่องานดัชนี — $0.054 สำหรับ MiMo-V2.5-Pro เทียบกับ $0.1332 สำหรับ MiMo-V2.6-Pro โดยที่การเพิ่มขึ้นนั้นเกิดจากความเยิ่นเย้อของคำตอบ มากกว่าจะเกิดจากการเปลี่ยนแปลงอัตราค่าใช้จ่าย
• พารามิเตอร์ — ทั้งหมด 1023B และเปิดใช้งาน 42B เทียบกับทั้งหมด 1.02T และเปิดใช้งาน 42B
• บริบท — 1M โทเคน ไม่เปลี่ยนแปลง
• สัญญาอนุญาต — MIT ไม่เปลี่ยนแปลง
• วันที่เปิดตัว — 22 เมษายน 2026 เทียบกับ 21 กันยายน 2026

คะแนนคือส่วนที่สำคัญ และเป็นส่วนที่การตั้งชื่อบดบังไว้ ยี่สิบจุดดัชนีในห้าเดือน โดยที่เรตการ์ดยังไม่เปลี่ยน ถือเป็นก้าวกระโดดข้ามรุ่นที่ใหญ่กว่าที่ข่าวการเปิดตัววางกรอบไว้ — ส่วนใหญ่ของข่าวนั้นไปที่ "โมเดลน้ำหนักเปิดระดับท็อป" ซึ่งเป็นข้อกล่าวอ้างเกี่ยวกับวงการมากกว่าเกี่ยวกับการอัปเกรด หากคุณกำลังรันเรือธงรุ่นก่อนอยู่และสงสัยว่าการย้ายระบบคุ้มค่ากับงานวิศวกรรมหรือไม่ บรรทัดนั้นเพียงบรรทัดเดียวคือคำตอบ และมันเป็นข้อโต้แย้งที่หนักแน่นกว่าสิ่งใดในสื่อการตลาด

ข้อแม้นี้เป็นข้อแม้เดียวกับที่ใช้กับตัวเลขทุกตัวจาก Xiaomi ในรีลีสนี้ ทั้ง 26.0 และ 46.3 ต่างเป็นค่าที่วัดโดย Artificial Analysis ซึ่งทำให้ทั้งสองเปรียบเทียบกันได้ และเปรียบเทียบกับโมเดลอื่น ๆ บนเวอร์ชันดัชนีเดียวกันได้ ส่วนตาราง benchmark ของผู้ผลิตเอง — DeepSWE v1.1, Terminal Bench, AutomationBench และอื่น ๆ — ไม่สามารถทำเช่นนั้นได้ และไม่ควรนำมาใช้คำนวณส่วนต่างของการอัปเกรด การนำคะแนนที่วัดได้มาปนกับคะแนนจากผู้ผลิตเพื่อสร้างตัวเลข "คะแนนที่เพิ่มขึ้น" เป็นข้อผิดพลาดที่พบบ่อยที่สุดในการรายงานรีลีสนี้

ทำไมชื่อจึงเป็นปัญหาด้านการดำเนินงาน

ไม่มีส่วนใดของเรื่องนี้เป็นการจู้จี้เรื่องเล็กน้อย เมื่อป้ายกำกับไปถึงระบบแล้ว ตัวระบุโมเดลที่ชี้ไปยังเช็กพอยต์สองรายการซึ่งมีส่วนต่างราคา 3.1 เท่า คือเหตุการณ์ด้านการเรียกเก็บเงินที่รอตัวกระตุ้น และมีสามจุดที่มันผิดพลาดได้อย่างแน่นอน ไฟล์การกำหนดค่าและไฟล์สภาพแวดล้อม ซึ่งสตริงอย่าง mimo-v2.6 ถูกเขียนครั้งเดียวและไม่ถูกกลับมาแก้ไขอีก ตารางต้นทุน ซึ่งการประเมินราคาต่อโทเคนถูกผูกกับชื่อซีรีส์แล้วนำไปใช้กับระดับชั้นผิด และแถวการประเมิน ซึ่งผลลัพธ์ถูกจัดเก็บภายใต้ตระกูลผลิตภัณฑ์แล้วภายหลังถูกอ่านว่าเป็นคุณสมบัติของเรือธง

ยังมีจุดที่สี่ และเป็นจุดที่กัดรีลีสนี้โดยเฉพาะ นั่นคือจำนวนพารามิเตอร์ Xiaomi MiMo-V2.6-Pro มีเอกสารระบุไว้ที่ 1.02T ทั้งหมด และ 42B ที่ทำงานอยู่ ส่วน repository บน Hugging Face รายงานขนาดโมเดล Safetensors ไว้ที่ 524B ส่วน MiMo-V2.6-Flash มีเอกสารระบุไว้ที่ประมาณ 309B ทั้งหมด และ 15B ที่ทำงานอยู่ และ repository ของมันรายงานไว้ที่ 159B ไม่มีคู่ใดที่สอดคล้องกันเลย หากการวางแผนความจุของคุณอ่านจาก model card และการจัดเตรียมทรัพยากรของคุณอ่านจาก repository คุณจะกำหนดขนาดของ deployment เดียวกันออกมาได้สองแบบที่แตกต่างกัน

ปักหมุดชื่อเช็คพอยต์ไว้ทุกที่ ไม่ใช่ชื่อซีรีส์ นั่นคือวิธีแก้ปัญหาทั้งหมด และมันไม่มีค่าใช้จ่ายใด ๆ จนถึงวันที่มันช่วยประหยัดงบประมาณหนึ่งไตรมาส

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the repository name, MIT licence and fp8 tags, a Safetensors panel reporting a model size of 524B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a collection block headed MiMo-V2.6 holding three items, and the model card introduction describing MiMo-V2.6-Pro-RL as the flagship checkpoint of the MiMo-V2.6 series with native omnimodal input and a 1M-token context.

วิธีที่สิ่งนี้ถูกแก้ไขบนเราเตอร์

ปัญหาการตั้งชื่อเป็นปัญหาของแคตตาล็อก และแคตตาล็อกคือที่เดียวที่แก้ไขได้ง่าย การอ้างอิงถึงโมเดลด้วยตัวระบุที่แม่นยำผ่านคีย์ API เพียงคีย์เดียว แทนที่จะอ้างอิงด้วยชื่อตระกูลข้ามบัญชีผู้ให้บริการหลายบัญชี หมายความว่าสตริงในคอนฟิกของคุณคือสตริงเดียวกับที่ระบบเรียกเก็บเงินเห็น — ซึ่งเป็นคุณสมบัติที่ชื่ออย่าง "MiMo-V2.6" ทำลายไป นั่นก็เป็นเหตุผลว่าทำไม เราจึงส่งผ่านราคาตามรายการของผู้ให้บริการที่มาร์กอัป 0% แทนที่จะบวกกำไรของเราเอง: ราคาบนหน้าเว็บคือราคาที่ผู้ให้บริการกำหนด ดังนั้นระดับที่คุณระบุผิดจึงผิดไปในทิศทางเดียวกันสำหรับทุกคน แทนที่จะผิดไปในทิศทางที่จำเพาะกับเรา

พูดตรง ๆ ถึงข้อจำกัด: เราไม่ได้โฮสต์เช็กพอยต์ MiMo-V2.6 ทั้งสองตัว ดังนั้นทั้งคู่จึงไม่สามารถกำหนดเส้นทางผ่านเราได้ในวันนี้ และทั้งคู่ก็ไม่ได้ถูกดีพลอยโดยผู้ให้บริการ inference บุคคลที่สามรายใด ตามรีโพซิทอรี Hugging Face ของตัวเอง เส้นทางไปยังทั้งคู่คือแพลตฟอร์มของ Xiaomi เองและแคตตาล็อกที่รองรับมัน แต่ระเบียบวินัยด้านตัวระบุที่หน้านี้กำลังสนับสนุนนั้นใช้ได้กับทุกโมเดลที่คุณเรียกใช้ และนั่นคือเหตุผลที่เลเยอร์การกำหนดเส้นทางจึงคุ้มค่าที่จะมีไว้ แม้กับโมเดลที่คุณยังไม่ได้กำหนดเส้นทางก็ตาม

สิ่งที่ควรนำกลับไป

หากคุณมาที่นี่เพื่อเปรียบเทียบสองโมเดล การเปรียบเทียบนั้นใช้ไม่ได้ — หนึ่งในสองสิ่งนี้ไม่ใช่โมเดล Xiaomi MiMo-V2.6-Pro คือเช็กพอยต์: 46.3 บนดัชนี, $0.435 และ $0.87 ต่อล้านโทเคน, น้ำหนักแบบ MIT, คอนเท็กซ์ 1M และเป็นรายการน้ำหนักเปิดเพียงรายการเดียวบนเส้นพาเรโตด้านต้นทุนของ Artificial Analysis ที่อยู่เหนือระดับเกือบฟรี ส่วน MiMo-V2.6 คือป้ายกำกับที่อยู่เหนือมันและป้ายกำกับที่อยู่ข้าง ๆ มัน ซึ่งครอบคลุมเช็กพอยต์ที่ถูกกว่าด้วยราคาหนึ่งในสาม และระดับการให้บริการที่เร็วกว่าด้วยราคาสิบเท่า

การเปรียบเทียบที่ควรทำแทนคือสิ่งที่การตั้งชื่อปกปิดไว้: เรือธงของรุ่นนี้เทียบกับรุ่นก่อนหน้าที่ใช้เพียงหมายเลขเวอร์ชันเปล่า ๆ ยี่สิบจุดดัชนี ห้าเดือน อัตราไม่เปลี่ยนแปลง นั่นคือตัวเลขที่ต้องวางไว้ตรงหน้าคนที่เซ็นอนุมัติการโยกย้าย — ไม่ใช่ตัวเลขเกี่ยวกับการเป็นที่หนึ่งบนลีดเดอร์บอร์ด

Screenshot of the Artificial Analysis model page for MiMo-V2.5-Pro, showing 'Released April 2026', an Intelligence card reading 26 ranked #24 of 114, a Speed card reading 45.9 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.05 cost per Intelligence Index task ranked #3 of 114, a Verbosity card reading 110M output tokens, and a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube