การ์ดฮีโร่ของ OrcaRouter model radar หัวข้อ 'MiMo-V2.6-Flash vs MiMo-V2.6' คำโปรย 'ซีรีส์เดียว สองเช็กพอยต์ และชื่อที่ทำหน้าที่ได้สองแบบ' พร้อมแผงด้านซ้ายสำหรับ MiMo-V2.6-Flash ที่ระบุ 309B รวม / 15B ทำงานอยู่ น้ำหนัก FP8 172.9 GB และเช็กพอยต์ Efficiency แผงด้านขวาสำหรับ MiMo-V2.6-Pro ที่ระบุ 1.02T รวม / 42B ทำงานอยู่ 'ชื่อที่ผู้คนใช้เรียกเรือธง' และสัญญาอนุญาต MIT แบบเดียวกัน และแบดจ์สามอันด้านล่างที่ระบุว่า เผยแพร่ 21 Sept 2026 ข้ออ้างบริบท 1M โทเคน และไม่มีเอนด์พอยต์ Xiaomi ให้เรียก
Guides & Insights

MiMo-V2.6-Flash กับ MiMo-V2.6: ซีรีส์เดียว สองเช็กพอยต์ และชื่อที่ทำหน้าที่สองอย่าง

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ถามคนสองคนว่า MiMo-V2.6 คืออะไร คุณอาจได้คำตอบเป็นโมเดลที่ต่างกันสองแบบ การเปิดตัวของ Xiaomi ในเดือนกันยายน 2026 เป็นซีรีส์ที่มีเช็กพอยต์เผยแพร่แล้วสองตัว — MiMo-V2.6-Flash ที่ 309 พันล้านพารามิเตอร์ และ MiMo-V2.6-Pro ที่ 1.02 ล้านล้าน — และชื่อล้วน ๆ อย่าง MiMo-V2.6 ถูกใช้ทั้งกับตระกูลนี้ และในสื่อส่วนใหญ่ ใช้กับระดับสูงสุดของรุ่นนี้ ดังนั้นหน้าหนึ่งที่มีหัวข้อว่า "MiMo-V2.6-Flash vs MiMo-V2.6" จริง ๆ แล้วคือการเทียบเช็กพอยต์ที่เน้นประสิทธิภาพกับชื่อที่ผู้คนเขียนถึงเมื่อหมายถึงเรือธง ทั้งสองเช็กพอยต์ขึ้นบน Hugging Face ห่างกันสิบแปดวินาทีเมื่อวันที่ 21 กันยายน 2026 ทั้งคู่ใช้สัญญาอนุญาต MIT และทั้งคู่เป็นแบบดาวน์โหลดก่อน — ไม่มีเอนด์พอยต์ของ Xiaomi ให้เรียกใช้งาน แทบไม่มีอย่างอื่นเกี่ยวกับทั้งสองที่เหมือนกันเลย

เรื่องนี้สำคัญกว่าที่การถกเถียงเรื่องชื่อเรียกมักจะเป็น เพราะสองตัวนี้ไม่ใช่บันไดขนาดที่คุณจะไต่ขึ้นไปในภายหลังได้ พวกมันเป็นการรันการเทรนที่แยกจากกัน มีตาราง benchmark แยกกัน มีหน่วยความจำที่ใช้แยกกัน และ — ตามที่ตัวเลขที่เผยแพร่แสดงให้เห็น — มีสองสามจุดที่ตัวที่เล็กกว่าชนะไปเลย

สองจุดตรวจ หนึ่งนาทีที่เผยแพร่

รีโพซิทอรีเหล่านี้คือ XiaomiMiMo/MiMo-V2.6-Flash-RL ซึ่งสร้างเมื่อ 15:39:51 UTC และ XiaomiMiMo/MiMo-V2.6-Pro-RL ซึ่งสร้างเมื่อ 15:39:33 UTC ทั้งสองไม่ถูกจำกัดการเข้าถึง ทั้งคู่แนบรายงานทางเทคนิคและการ์ดโมเดลมาด้วย และทั้งคู่ถูก Xiaomi อธิบายว่าเป็นผลผลิตจากการรันการเรียนรู้แบบเสริมกำลังแบบผสมเพียงครั้งเดียว ซึ่งรวบงานเขียนโค้ด งานเอเจนต์ทั่วไป งานด้านภาพ และงานด้านความมั่นคงไซเบอร์ไว้ในการฝึกหนึ่งรอบ แทนที่จะเป็นการรันแยกตามโดเมน

• พารามิเตอร์ — MiMo-V2.6-Flash: รวม 309B, เปิดใช้งาน 15B ต่อโทเคน MiMo-V2.6-Pro: รวม 1.02T, เปิดใช้งาน 42B ทั้งสองเป็น sparse mixture-of-experts

• แกนหลัก — Flash มี 48 เลเยอร์ โดยเป็น sliding-window 39 เลเยอร์และ full attention 9 เลเยอร์, ขนาด hidden 4096, routed experts 256 ตัวโดยเปิดใช้งาน 8 ตัว, หน้าต่างเลื่อนขนาด 128 โทเคน และไม่มี shared experts ส่วน Pro ใช้แนวคิด hybrid attention เดียวกันในความกว้างที่ใหญ่กว่ามาก

• โมดัลลิตี — ทั้งคู่เป็นแบบ omnimodal โดยกำเนิด โดยรับข้อความ รูปภาพ วิดีโอ และเสียงเข้าในโมเดลเดียว แทนที่จะเป็นไปป์ไลน์สามชุดที่ต่อกันแบบง่าย ๆ Flash มี vision transformer ขนาด 681M พารามิเตอร์, audio tokenizer ขนาด 308M และ audio patch encoder ขนาด 127M

• บริบท — 1M โทเค็น โดยอ้างสำหรับทั้งคู่ พร้อมคอนฟิกที่รองรับการฝังตำแหน่งสูงสุด 1,048,576 โทเค็น

• สัญญาอนุญาต — ทั้งสองเป็น MIT โดยไม่มีเกณฑ์รายได้ ไม่มีข้อจำกัดการใช้งานที่ยอมรับได้นอกเหนือจากที่ใช้กันทั่วไป และไม่มีข้อกำหนดเกี่ยวกับการวิจัย การนำไปใช้เชิงพาณิชย์ การแก้ไข และการเผยแพร่ต่อ ได้รับอนุญาตทั้งหมด

• ไฟล์น้ำหนัก — Flash เผยแพร่ข้อมูลน้ำหนัก FP8 จำนวน 172.9 GB กระจายอยู่ 65 shard โดย Pro มีจำนวนพารามิเตอร์มากกว่าประมาณสามเท่า ดังนั้นการดาวน์โหลดจึงอยู่ในระดับครึ่งเทระไบต์ก่อนที่คุณจะทำการควอนไทซ์ใด ๆ ด้วยตัวเอง

• สถานที่ให้บริการ — Hugging Face, แพลตฟอร์ม API ของ Xiaomi เอง, AI Studio, MiMo Code และแอปเดสก์ท็อป MiMo การ์ดระบุว่าปัจจุบันเช็กพอยต์ทั้งสองยังไม่ถูกปรับใช้โดยผู้ให้บริการอินเฟอเรนซ์จากบุคคลที่สามบน Hub เอง

การชนที่ทำให้ผู้คนต้องสูญเสียฮาร์ดแวร์

ความสับสนในการจับคู่นี้ไม่ใช่ระหว่าง Flash กับ Pro จริง ๆ แต่อยู่ระหว่าง MiMo-V2.6-Flash กับโมเดลรุ่นก่อนหน้า

MiMo-V2-Flash เปิดตัวในเดือนธันวาคม 2025 และโพสต์บล็อกของ Xiaomi เองที่ประกาศเปิดตัวก็อธิบายว่าเป็นโมเดลแบบ mixture-of-experts ที่มีพารามิเตอร์รวม 309 พันล้านตัว เปิดใช้งาน 15 พันล้านตัว ใช้รูปแบบความสนใจแบบไฮบริดที่สลับระหว่าง sliding-window กับ full attention และมี sliding window ขนาด 128 โทเคนที่แคบมาก ลองอ่านเทียบกับรายการหัวข้อด้านบนดู เช็คพอยต์ปี 2026 กับเช็คพอยต์ปี 2025 มีโครงสร้างหลักเหมือนกัน มีขนาด sliding-window เท่ากัน และมีงบประมาณการเปิดใช้งานเท่ากัน — ห่างกันเก้าเดือน มาจากการรันการฝึกคนละครั้ง มีความสามารถต่างกัน และมีตาราง benchmark ต่างกัน

ดังนั้นการค้นหา "MiMo V2.6 Flash" จะส่งผลให้คุณได้หน้าเว็บเกี่ยวกับ MiMo-V2-Flash อย่างสบาย ๆ พร้อมตัวเลขคอนเท็กซ์ 256K และราคาหนึ่งในสิบของดอลลาร์ต่อโทเค็นอินพุตหนึ่งล้านโทเค็น ซึ่งเป็นของโมเดลรุ่นเก่า หากคุณกำลังประเมินขนาดโหนด นั่นไม่ใช่ข้อผิดพลาดเพียงผิวเผิน เช็กพอยต์รุ่นเก่าและรุ่นใหม่เป็นไฟล์ดาวน์โหลดคนละชุดพร้อมสูตรการให้บริการที่ต่างกัน และรุ่นใหม่อ้างว่ามีคอนเท็กซ์เป็นสี่เท่า

มีกับดักที่สองที่เงียบกว่าในการตั้งชื่อ รีโพซิทอรีทั้งสองลงท้ายด้วย -RL ซึ่งอ่านดูเหมือนอะแดปเตอร์ reinforcement learning ที่วางอยู่บนโมเดลฐานอื่น พวกมันไม่ใช่อะแดปเตอร์ คำต่อท้ายนี้บ่งบอกสายที่มาหลังการฝึก: สิ่งเหล่านี้คือเช็กพอยต์แบบเต็มที่ออกมาจากการรัน RL แบบสตรีม ดัชนีน้ำหนักยืนยันเรื่องนี้ — เทนเซอร์หลายหมื่นตัวครอบคลุมทั้งแกนหลัก ตัวเข้ารหัสภาพ สแตกเสียง และ speculative drafter

สิ่งที่ตารางของผู้ขายเองระบุ

ตัวเลขทุกตัวในส่วนนี้มาจากตารางการประเมินของ Xiaomi ใน model card ทั้งสองฉบับ Xiaomi รันชุดทดสอบบนเช็คพอยต์ของตัวเอง ไม่มีส่วนใดได้รับการทำซ้ำนอกห้องแล็บ ไม่มีส่วนใดปรากฏบน leaderboard สาธารณะ และคอลัมน์เปรียบเทียบคือการรันชุดทดสอบเดียวกันของผู้ขายเองกับโมเดลของบริษัทอื่น ให้ถือว่าการจัดอันดับเป็นข้อมูลประกอบ และตำแหน่งทศนิยมเป็นเพียงการตกแต่ง

• โค้ดเอเจนต์ — DeepSWE v1.1: Flash 67.9, Pro 71.9. Terminal Bench 2.1: Flash 87.6, Pro 89.9. ProgramBench: Flash 26.0. MiMo Code Bench: Flash 61.2.

• เอเจนต์ทั่วไป — AutomationBench v1.0.6: Flash 52.3, Pro 53.1 Toolathlon-Verified: Flash 73.6, Pro 76.9 OSWorld-Verified: Flash 80.8, Pro 82.0 Agents' Last Exam: Flash 27.6 Terminal Bench 4.0: Flash 28.8

• ความมั่นคงปลอดภัยทางไซเบอร์ — คอลัมน์เดียวที่โมเดลขนาดเล็กเป็นผู้นำ CyberGym: Flash 95.1 เทียบกับ 94.0 ของ Pro MiMo Cyber Bench: Flash 77.2 จากนั้นค่าต่ำสุดก็ดิ่งลง: ExploitGym 6.0, ExploitBench 25.3, SEC Bench Pro 47.5

• เอเจนต์ด้านภาพ — MiMo VisualCoding: Flash 71.5, Pro 72.3

อ่านไล่ลงไปตามหัวข้อเหล่านั้น แล้วบทสรุปที่ตรงไปตรงมาคือ Pro นำอยู่แทบทุกด้าน ด้วยส่วนต่างเล็ก ๆ และส่วนต่างเหล่านั้นเล็กพอที่จะอยู่ในช่วงสัญญาณรบกวนของฮาร์เนสที่รันเอง บน DeepSWE ทั้งสองห่างกันสี่คะแนนบนสเกลที่เช็กพอยต์เดียวกันขยับไปสองคะแนนระหว่างการประเมินสองครั้งของ Xiaomi เอง

ประเด็นสุดท้ายนั้นควรมีย่อหน้าเป็นของตัวเอง เพราะมันเป็นสิ่งที่มีประโยชน์ที่สุดในบัตรทั้งสองใบ แดชบอร์ด RL สาธารณะของ Xiaomi ซึ่งสตรีมการรันเทรนทั้งสองครั้งตลอดเดือนกันยายน เผยแพร่ Flash ที่ 65.68 บน DeepSWE v1.1 โดยใช้ฮาร์เนส mini-swe-agent ที่ค่าเฉลี่ยจากการรันสามครั้ง บัตรฉบับสมบูรณ์พิมพ์ 67.9 สำหรับเวตที่ปล่อยจริง ขณะที่ตัวเลขบนแดชบอร์ดของ Pro อยู่ที่ 72.57 และบัตรของมันพิมพ์ 71.9 — มันลดลง สองเช็กพอยต์จากการรันเดียวกัน ถูกประเมินสองครั้ง และช่องว่างระหว่างการประเมินทั้งสองครั้งมีขนาดเท่ากับช่องว่างระหว่างสองโมเดล ถ้าคุณอ้างตัวเลขจากแดชบอร์ดตั้งแต่สัปดาห์ที่แล้ว พวกมันอธิบายสแนปช็อตการเทรน ไม่ใช่สิ่งที่คุณจะดาวน์โหลดวันนี้

Scoreboard card headed 'MiMo-V2.6-Flash vs MiMo-V2.6-Pro', with paired rows for parameters (309B total / 15B active against 1.02T total / 42B active), weights on disk (172.9 GB FP8 across 65 shards against about three times Flash), DeepSWE v1.1 (67.9 against 71.9, with the RL dashboard's earlier 65.68 and 72.57 noted), CyberGym (95.1 against 94.0), independent score (None published against an Artificial Analysis Index of 46 at 134.3 output tokens per second) and price, plus a sourcing footer stating that every benchmark is Xiaomi's own run except the Pro index score.

ทั้งคู่ไม่ได้อยู่บนเราเตอร์

นี่คือส่วนที่ตัดสินการประเมินจริงส่วนใหญ่ Xiaomi ไม่ได้ขายเช็กพอยต์ทั้งสองแบบ: ไม่มีราคาต่อโทเคนที่เผยแพร่สำหรับรุ่น MiMo-V2.6 บนเว็บไซต์ของตัวเอง และไม่มีตัวระบุโมเดลที่เรียกใช้ได้ซึ่งประกาศออกมาสำหรับทั้งสองรุ่น สิ่งที่มีแทนคือไฟล์ดาวน์โหลด บวกกับ — สำหรับ Pro เท่านั้น — ผู้ให้บริการ API รายเดียวที่ Artificial Analysis นับว่ารองรับมันในราคา $0.435 ต่อล้านโทเคนอินพุต และ $0.87 ต่อล้านโทเคนเอาต์พุต นั่นคือรายการของผู้ให้บริการ ไม่ใช่ตารางราคาของผู้ขาย และไม่มีอะไรเทียบได้สำหรับ Flash เลย ตัวเลขที่แพร่กระจายบนหน้าแคตตาล็อกของบุคคลที่สามควรอ่านในลักษณะเดียวกัน

ดังนั้น การเลือกระหว่าง Flash กับ Pro จึงไม่ใช่การเลือกระหว่างปลายทางสองแบบที่มีมาตรวัดต่างกัน แต่เป็นการเลือกระหว่างบิลค่า GPU สองใบ และใบที่เล็กกว่านั้นมีค่าใช้จ่ายประมาณหนึ่งในสามของใบที่ใหญ่กว่า นั่นคือข้อโต้แย้งเชิงพาณิชย์ทั้งหมดสำหรับ Flash และมันเป็นข้อโต้แย้งที่หนักแน่นกว่าที่ตาราง benchmark บ่งชี้ เพราะสองโมเดลนี้มีคะแนนห่างกันเพียงไม่กี่จุดในงานที่คนส่วนใหญ่ซื้อมาเพื่อใช้งาน

สิ่งที่เหลืออยู่ก็คือการแบ่งออกเป็นสามทางที่คุ้นเคย จะเช่าโมเดลระดับแนวหน้า เป็นเจ้าของโมเดลขนาดเล็ก หรือเป็นเจ้าของโมเดลขนาดใหญ่ คอลัมน์ระดับแนวหน้าคือคอลัมน์ที่ Xiaomi ใช้เป็นเกณฑ์เปรียบเทียบในตารางของตนเอง — Claude Opus 5, GPT-5.6 Sol และ Claude Fable 5 ต่างก็มีคะแนนสูงกว่า Pro อยู่ไม่กี่คะแนนบน DeepSWE ในการเปรียบเทียบของผู้ขายเอง และทั้งสามรุ่นก็เรียกใช้งานได้แล้ววันนี้ผ่านคีย์ API เพียงคีย์เดียวบน OrcaRouter ในราคาตามรายการของผู้ให้บริการ โดยมีมาร์กอัป 0% ที่ส่งผ่านไปยังคุณเรื่องนี้สำคัญต่อการตัดสินใจเฉพาะเรื่องที่คุณกำลังเผชิญอยู่: การเปลี่ยนแปลงราคาของผู้ขายจะส่งผลถึงฝั่งคุณภายในวันเดียวกัน แทนที่จะไปมีผลตอนต่อสัญญาครั้งถัดไป การคำนวณระหว่างการเช่ากับการเป็นเจ้าของจึงยังคงตรงไปตรงมาแม่นยำเมื่อราคาแบบโฮสต์ขยับขึ้นลง การสลับไปใช้ระบบสำรองอัตโนมัติยังหมายความว่าโมเดลที่คุณยังอยู่ระหว่างการประเมินไม่จำเป็นต้องอยู่บนเส้นทางการใช้งานจริงเพียงลำพังในระหว่างที่คุณตัดสินใจ

สิ่งที่คุณทำไม่ได้บนเราเตอร์ใด ๆ ในวันนี้ — รวมถึงของเรา — คือการเรียกใช้ MiMo-V2.6-Flash หรือ MiMo-V2.6-Pro เราไม่ได้จัดเส้นทางให้โมเดล Xiaomi ใด ๆ และบรรทัดความพร้อมใช้งานในการ์ดของ Xiaomi เองก็ชี้ไปที่ช่องทางของ Xiaomi เอง: แพลตฟอร์ม MiMo API, AI Studio, MiMo Code และแอปเดสก์ท็อป

เช็กพอยต์ใด และเมื่อใด

เลือก MiMo-V2.6-Flash หากคุณต้องการรุ่น MiMo-V2.6 และฮาร์ดแวร์คือข้อจำกัดชี้ขาด คุณจะเสียคะแนน DeepSWE ไปราวสี่คะแนน และอีกหนึ่งถึงสองคะแนนในเบนช์มาร์กเอเจนต์ส่วนใหญ่เมื่อเทียบกับรุ่นเรือธง แต่คุณจะได้เช็กพอยต์ที่ใช้หน่วยความจำเพียงประมาณหนึ่งในสาม นำหน้า Pro ใน CyberGym ตามตารางของ Xiaomi เอง และใช้สัญญาอนุญาตเดียวกัน มีข้ออ้างเรื่องบริบท 1 ล้านโทเคนเดียวกัน และมีความสามารถมัลติโมดัลเหมือนกัน สำหรับทีมที่ทำงานด้านการประเมินความมั่นคงปลอดภัยไซเบอร์ คอลัมน์ CyberGym นั้นไม่ใช่เรื่องเล็กน้อยที่มองข้ามได้

เลือก MiMo-V2.6-Pro หากเวิร์กโหลดเป็นการเขียนโค้ดหรืองานเอเจนต์ระยะยาว และโหนดนั้นได้ชำระค่าใช้จ่ายไปแล้ว มันเป็นโมเดลที่ดีกว่าในแทบทุกคอลัมน์ เป็นรุ่นที่ Artificial Analysis ได้วัดจริง — ด้วย Intelligence Index 46 บนสเกล v4.3 ที่ปรับคาลิเบรตใหม่ เป็นอันดับหนึ่งในบรรดา 114 โมเดลในคลาส open-weights ของตน 134.3 โทเคนเอาต์พุตต่อวินาที และมีราคาอยู่ที่ $0.435 ต่อล้านโทเคนอินพุต และ $0.87 ต่อล้านเอาต์พุต — และการวัดผลโดยอิสระมีค่ามากกว่าตารางของผู้ขายเมื่อคุณกำลังวางแผนสำหรับโปรดักชัน

อย่าเพิ่งเชื่อข้อมูลใด ๆ จนกว่าคุณจะได้อ่านไฟล์คอนฟิกเอง ไม่ใช่แค่บทสรุป การ์ดของ Flash อธิบายถึงตัวร่างแบบ speculative ที่มีห้าชั้นซึ่งทำนายเจ็ดโทเคนต่อรอบ ส่วน config.json ในรีโพซิทอรีเดียวกันตั้งค่า num_nextn_predict_layers เป็น 3 บทสรุปบนการ์ดไม่ใช่สิ่งที่รันไทม์อ่าน และบล็อก Safetensors บนหน้ารีโพซิทอรีรายงานว่า Flash มีพารามิเตอร์ 159B และ Pro มี 524B ซึ่งไม่ตรงกับจำนวนรวมหรือจำนวนที่ใช้งานจริงในการ์ดโมเดลของทั้งสองรุ่น Xiaomi ยังไม่ได้อธิบายความคลาดเคลื่อนนี้ ให้ดูขนาดจากข้อมูลน้ำหนักที่เผยแพร่แทน เพราะนั่นคือตัวเลขที่คุณต้องจ่ายใน VRAM ไม่ว่าจะนับพารามิเตอร์อย่างไร

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Flash-RL, showing the MIT licence and multimodal tags, the model card heading 'Scaling Reinforcement Learning Toward Self-Improvement', a Safetensors block reporting a 159B model size, and an inference-providers panel stating that the model is not deployed by any inference provider.

อะไรจะยุติเรื่องนี้ได้

สามสิ่ง เรียงตามลำดับประโยชน์ใช้สอยคร่าว ๆ การรันโดยบุคคลที่สามบนฮาร์เนสชุดเดียวกัน — DeepSWE หรือ Terminal Bench ที่ส่งเข้าประเมินแทนที่จะรายงานเอง — จะบอกคุณได้ว่าช่องว่างสี่จุดระหว่าง Flash กับ Pro นั้นเป็นตำแหน่งที่แท้จริงหรือเป็นการตั้งค่าที่เอื้อประโยชน์ รายการราคาที่เปิดเผยต่อสาธารณะจะเปลี่ยนการเปรียบเทียบทั้งหมดจากโปรเจกต์ฮาร์ดแวร์ให้กลายเป็นรายการค่าใช้จ่ายบรรทัดเดียวที่คุณวางเทียบเคียงกับด่านหน้าของผู้ให้บริการโฮสต์ได้ และสภาพแวดล้อม RL ซึ่ง Xiaomi กล่าวว่าจะเปิดซอร์สนั้น เป็นชิ้นงานที่ทีมส่วนใหญ่ต้องการจริง ๆ เพราะมันคือสิ่งที่คุณจะต้องใช้เพื่อทำซ้ำลูปบนเทรซของคุณเอง

จนถึงตอนนั้น การตีความในทางปฏิบัติก็ยังแคบอยู่ MiMo-V2.6 มีสองเช็กพอยต์ ไม่ใช่หนึ่ง และชื่อเปล่า ๆ มักหมายถึงตัวที่แพงกว่า หากวันนี้คุณกำลังเลือกภายในซีรีส์นี้ ค่าเริ่มต้นที่ตรงไปตรงมาคือ Flash เว้นแต่คอลัมน์ benchmark ที่คุณสนใจเป็นพิเศษจะบอกเป็นอย่างอื่น — และถ้าคุณยังไม่พร้อมจะซื้อโหนด ตอนนี้ก็ยังไม่มีตัวไหนเป็นคำตอบที่ถูกต้อง

Screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, showing an Intelligence Index of 46 on the updated scale, ranked first of 114, output speed of 134.3 tokens per second, a price of $0.435 per million input tokens and $0.87 per million output with a 99% cache discount and $0.13 cost per Intelligence Index task, a 1M-token context window, and 1.02T total with 42B active parameters under the MIT licence with weights on Hugging Face.
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube