
MiMo-V2.6-Pro กับ GPT-5.6 Sol: หนึ่งคะแนนดัชนีมีต้นทุนต่องานสูงกว่าถึงสิบห้าเท่า
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 36 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 181 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
บน Artificial Analysis Intelligence Index v4.3.2 ซึ่งอ่านเมื่อวันที่ 25 กันยายน 2026 GPT-5.6 Sol ที่ความพยายามสูงสุดได้คะแนน 47 และ MiMo-V2.6-Pro ของ Xiaomi ได้คะแนน 46 หนึ่งคะแนน ตัวเลขที่แยกพวกเขาจริง ๆ ไม่ใช่คะแนน และไม่ใช่อัตราต่อโทเคน — แต่เป็นต้นทุนของงานดัชนีหนึ่งงาน ซึ่ง Artificial Analysis ระบุไว้ที่ $1.99 สำหรับ GPT-5.6 Sol และ $0.13 สำหรับ MiMo-V2.6-Pro เงินมากกว่าสิบห้าเท่าสำหรับหนึ่งคะแนน และ ณ การอ่านนี้ หน้าของผู้ประเมินเองสำหรับโมเดลนั้นมีประกาศเลิกใช้งาน เนื่องจาก GPT-6 Sol ได้เข้ามาแทนที่แล้ว
Xiaomi เผยแพร่น้ำหนักโมเดลและรายงานทางเทคนิคของ MiMo-V2.6-Pro เมื่อวันที่ 21 กันยายน 2026 ก่อนการอ่านนี้สี่วัน; OpenAI เปิดตัว GPT-5.6 Sol เมื่อวันที่ 9 กรกฎาคม 2026 ข้อเท็จจริงทั้งสองข้อข้างต้นถือเป็นเรื่องใหม่นับตั้งแต่การจับคู่นี้ถูกเขียนถึงครั้งล่าสุด และมันดึงไปคนละทิศทาง ประกาศเลิกใช้งานระบุว่าการเปรียบเทียบนี้เป็นการเทียบกับโมเดลที่ OpenAI ก้าวข้ามไปแล้ว ส่วนตัวเลขต่องานบอกว่าสิ่งที่ดูเหมือนความคลาดเคลื่อนจากการปัดเศษเมื่อทั้งสองโมเดลถูกเสนอราคาตามราคาตั้ง เมื่อเจอกับภาระงานจริง กลับกลายเป็นตัวชี้ขาดทั้งหมด ว่าสองสิ่งนี้สิ่งใดสำคัญนั้น ขึ้นอยู่กับว่าคุณกำลังซื้อโมเดล หรือกำลังเปลี่ยนแทนโมเดลหนึ่ง
สิ่งที่ทั้งสองหน้าตอนนี้บอก
GPT-5.6 Sol เปิดตัวเมื่อวันที่ 9 กรกฎาคม 2026 ในฐานะเรือธงของตระกูล GPT-5.6 ราคาตั้งอยู่ที่ 4.00 ดอลลาร์ต่อโทเคนอินพุตหนึ่งล้านโทเคน และ 20.00 ดอลลาร์ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคนบน API ของ OpenAI โดยตรง พร้อมส่วนลดแคช 90% และหน้านี้บันทึกว่ามีการสร้างโทเคนเอาต์พุต 90 ล้านโทเคนตลอดการรันดัชนี เทียบกับค่ามัธยฐานที่ 88 ล้าน วัดค่าได้ 73 โทเคนเอาต์พุตต่อวินาที ซึ่งหน้าเดียวกันระบุว่าเร็วกว่าค่าเฉลี่ย เมื่อเทียบกับค่ามัธยฐานที่ 72 t/s รายการในดัชนีของมันอยู่ในอันดับที่ 19 จาก 210 โมเดลในคลาสเดียวกัน
Xiaomi MiMo-V2.6-Pro เป็นเช็คพอยต์แบบผสมผู้เชี่ยวชาญแบบเบาบางที่มีพารามิเตอร์ทั้งหมด 1.02 ล้านล้าน และพารามิเตอร์ที่ใช้งาน 42 พันล้าน ได้รับอนุญาตภายใต้สัญญาอนุญาต MIT มีหน้าต่างบริบทขนาด 1 ล้านโทเค็น และรองรับอินพุตข้อความ รูปภาพ เสียง และวิดีโอ โดยมีเอาต์พุตเป็นข้อความ มีราคาอยู่ที่ $0.43 และ $0.87 ต่อล้านโทเค็น พร้อมส่วนลดแคช 99% — คิดเป็นหนึ่งในสิบของอัตราอินพุตของ Sol และหนึ่งในยี่สิบสามของอัตราเอาต์พุตของ Sol มันสร้างโทเค็นเอาต์พุต 140 ล้านโทเค็นในการรัน Index และวัดได้ 43.6 โทเค็นเอาต์พุตต่อวินาที ซึ่งหน้าเพจของมันอธิบายว่าช้าอย่างเห็นได้ชัดเมื่อเทียบกับค่ามัธยฐาน 67.1 t/s
• ค่าใช้จ่ายของงาน Index — MiMo-V2.6-Pro $0.13; GPT-5.6 Sol $1.99 — ช่องว่างอยู่ที่ 15 เท่า • ราคาตั้งต้น — MiMo-V2.6-Pro $0.43 / $0.87 ต่อ 1M; GPT-5.6 Sol $4.00 / $20.00 • ส่วนลดแคช — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • โทเค็นเอาต์พุตในการรัน index — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • ความเร็วเอาต์พุต — MiMo-V2.6-Pro 43.6 t/s เทียบกับค่ามัธยฐาน 67.1; GPT-5.6 Sol 73 t/s เทียบกับค่ามัธยฐาน 72 • คอนเท็กซ์และเวต — MiMo-V2.6-Pro 1M และใช้สัญญาอนุญาต MIT; GPT-5.6 Sol 1M และเป็นกรรมสิทธิ์เฉพาะ

ประกาศเลิกใช้งานเป็นบรรทัดที่มีนัยสำคัญกว่า
Artificial Analysis ตอนนี้เปิดหน้า GPT-5.6 Sol พร้อมข้อความแจ้งในกรอบว่า “โมเดลนี้เลิกใช้แล้ว เราจะวัดประสิทธิภาพต่อเฉพาะสำหรับภาระงานอินพุตโทเคน 10k เริ่มต้นเท่านั้น” ตามด้วยประโยคที่ว่า OpenAI ได้เปิดตัวโมเดลใหม่กว่า คือ GPT-6 Sol (max) และควรพิจารณาโมเดลนั้นแทน ดังนั้นเลข 47 บนดัชนีจึงเป็นค่าที่อ่านได้จากโมเดลที่ไม่ได้เป็นสิ่งที่ควรซื้ออีกต่อไปแล้ว นั่นไม่ได้ทำให้ค่าที่อ่านได้นั้นผิด — มันถูกวัดบนดัชนีเดียวกัน ในวันเดียวกัน ในการตั้งค่าระดับความพยายามแบบเดียวกับเลข 46 — แต่สิ่งนี้เปลี่ยนว่าการเปรียบเทียบนี้มีไว้เพื่ออะไร มันไม่ใช่ “ควรใช้เรือธงตัวไหน” อีกต่อไป มันคือ “จุดสูงสุดของบอร์ด proprietary มีค่าใช้จ่ายเท่าใด ณ ตอนที่มันเป็นจุดสูงสุด”
การวางกรอบใหม่นี้สำคัญกว่าที่ฟังดู เพราะประกาศเลิกใช้งานบนหน้าผู้ประเมินเป็นหนึ่งในไม่กี่ที่ที่จังหวะการออกผลิตภัณฑ์ของผู้ขายปรากฏออกมาเป็นการเปลี่ยนแปลงของข้อมูล มากกว่าจะเป็นข่าวประชาสัมพันธ์ คะแนนถูกตรึงไว้ ส่วนโมเดลไม่ได้เปิดให้ใช้งาน สิ่งใดก็ตามที่คุณสร้างโดยอิงกับ 47 ย่อมเป็นการสร้างบนสแนปช็อต

ทำไมตัวเลขต่องานจึงเป็นค่าที่ควรนำมาใช้ในการสร้างแบบจำลอง
อัตราต่อโทเคนทำให้โมเดลราคาถูกดูดีเกินจริงและทำให้เข้าใจผิดกับเวิร์กโหลดที่ไม่เป็นกลางต่อโทเคน ต้นทุนต่องานของดัชนีเป็นการวัดที่แตกต่างออกไป: มันคือสิ่งที่ผู้ประเมินใช้จ่ายจริงเพื่อให้ได้คำตอบหนึ่งคำตอบจากแต่ละโมเดล ซึ่งรวมทั้งอัตราและจำนวนโทเคนที่โมเดลเลือกจะปล่อยออกมา MiMo-V2.6-Pro ปล่อยโทเคนมากกว่า Sol ในการรันดัชนี — 140 ล้านเทียบกับ 90 ล้าน ประมาณ 1.6 เท่า — และยังมีค่าใช้จ่าย $0.13 ต่องาน เทียบกับ $1.99 ข้อได้เปรียบด้านอัตราอยู่ที่ประมาณ 23 เท่าในเอาต์พุต; บทลงโทษจากความเยิ่นเย้อคือ 1.6×; ผลคูณคือส่วนต่างต่องานที่ 15 เท่า
นั่นคือเลขคณิตที่แบบจำลองต้นทุนควรสร้างขึ้นมา และเป็นเลขคณิตที่มองไม่เห็นหากคุณนำ $0.87 ไปเทียบกับ $20.00 แล้วหยุดแค่นั้น มันยังบอกคุณว่าอะไรจะทำให้ข้อสรุปพัง หากปริมาณงานของคุณถูกครอบงำด้วยเอาต์พุตที่สั้นมาก จำนวนโทเคนของ Sol จะลดฮวบเข้าใกล้จำนวนของคุณ และช่องว่างอัตราที่ต่างกันถึงยี่สิบสามเท่าก็จะเป็นตัวขับเคลื่อนหลัก ดังนั้นตัวคูณที่แท้จริงจะเคลื่อนเข้าหาช่องว่างอัตรา มากกว่าจะเคลื่อนออกห่างจากมัน หากปริมาณงานของคุณถูกครอบงำด้วยร่องรอยการใช้เหตุผลแบบยาว ความฟุ่มเฟือย 1.6× ของ MiMo-V2.6-Pro จะทบต้น และ $0.13 จะกลายเป็นเพดานแทนที่จะเป็นค่าประมาณ ตัวเลขที่เผยแพร่คือการวัดรูปร่างของ benchmark หนึ่ง ไม่ใช่ราคาที่คุณยื่นให้ฝ่ายการเงินได้
เส้นความหน่วงคือตัวถ่วงดุลที่ซื่อสัตย์
ที่ 43.6 โทเคนเอาต์พุตต่อวินาที MiMo-V2.6-Pro ช้ากว่า GPT-5.6 Sol ที่วัดในวันเดียวกันซึ่งได้ 73 — และช้ากว่าโมเดลที่หน้าเพจของมันเองนำมาเปรียบเทียบ ซึ่งมีค่ามัธยฐานอยู่ที่ 67.1 หน้าเพจของมันระบุไว้ตรงๆ แบบนั้นเลยว่า “ช้าอย่างเห็นได้ชัด” สำหรับไปป์ไลน์แบบแบตช์ นี่คือต้นทุนด้านทรูพุตที่คุณตีราคาได้ สำหรับเอเจนต์แบบอินเทอร์แอกทีฟ นี่คือการตัดสินใจเชิงผลิตภัณฑ์ และการที่ถูกกว่าต่องานถึงสิบห้าเท่าก็ไม่ได้ทำให้โมเดลที่ช้ากลายเป็นโมเดลที่เร็ว ถ้าข้อจำกัดของคุณคืองบประมาณต่อเทิร์น ไม่ใช่บิลรายเดือน อัตราส่วนที่สำคัญคือ 43.6 เทียบกับ 73 และ MiMo-V2.6-Pro แพ้ในเรื่องนี้
ตำแหน่งที่สิ่งนี้ไปอยู่บนเราเตอร์
รูปแบบที่เป็นประโยชน์ของการจับคู่นี้ไม่ใช่ “เลือกอันใดอันหนึ่ง” แต่คือการที่ทั้งสองโมเดลตอบดัชนีเดียวกัน และผู้ประเมินเผยแพร่ต้นทุนต่องานของแต่ละตัว การแบ่งงานจึงทำได้บนต้นทุนที่วัดได้จริง แทนที่จะอ้างอิงตามระดับของผู้ขาย บน OrcaRouter แค็ตตาล็อกมีถึง โมเดล 200+ ตัว ภายใต้คีย์เดียวในราคาตามที่ผู้ให้บริการแต่ละรายประกาศ โดยบวกเพิ่ม 0% — การลดราคาของผู้ขายมาถึงใบแจ้งหนี้ของคุณภายในวันเดียวกัน โดยไม่ต้องเจรจาสัญญาฉบับที่สองใหม่ — และ DSL สำหรับการจัดเส้นทาง ช่วยให้เวิร์กโหลดส่งคำขอที่ราคาถูกและมีปริมาณสูงไปยังโมเดลหนึ่ง และส่งงานที่ยากไปยังอีกโมเดลหนึ่งตามประเภทงานแทนที่จะตามแบรนด์ ระบบสำรองอัตโนมัติ (failover) ครอบคลุมกรณีที่เส้นทางที่ถูกกว่าเสื่อมประสิทธิภาพลง Xiaomi MiMo-V2.6-Pro ไม่ได้อยู่ในเส้นทางของเรา — เราไม่จัดแสดงโมเดลก่อนที่ผู้ให้บริการจะนำเข้ามาในระบบ — ดังนั้นสำหรับฝั่งนั้นของการเปรียบเทียบ คำตอบที่ตรงไปตรงมาคือ API ของผู้ขายเอง หรือแพลตฟอร์มโฮสต์ใดก็ตามที่คุณมีความสัมพันธ์อยู่แล้ว

จะทำอย่างไรกับสิ่งนี้ภายในสัปดาห์หน้า
สองสิ่งเปลี่ยนไปเมื่อวันที่ 25 กันยายน 2026 และมีเพียงสิ่งเดียวเท่านั้นที่เกี่ยวกับราคา GPT-5.6 Sol มีประกาศเลิกใช้งานบนดัชนีที่มันถูกวัดได้ 47 ซึ่งปลดมันออกจากการเป็นตัวเลือกในการตัดสินใจซื้อ และเหลือไว้เป็นข้อมูลอ้างอิงมาตรฐาน MiMo-V2.6-Pro ถูกวัดที่ $0.13 ต่อหนึ่งงานในดัชนี เทียบกับ $1.99 ของ Sol ซึ่งเป็นเงินสิบห้าเท่าสำหรับหนึ่งจุดดัชนี — และมันทำได้ 43.6 โทเคนต่อวินาที ซึ่งช้ากว่าโมเดลที่ถูกนำมาเปรียบเทียบด้วย และช้ากว่าค่ามัธยฐานในคลาสของมันเอง นำตัวเลขทั้งสองมาวัดกับทราฟฟิกของคุณเองก่อนที่ตัวเลขใดจะกลายเป็นการตัดสินใจ: ต้นทุนต่องานคือการวัด ไม่ใช่อัตรา และความหน่วงคือการวัด ไม่ใช่ความเห็น หากเอาต์พุตของคุณสั้นและไม่มีการโต้ตอบ เหตุผลสนับสนุนเช็กพอยต์แบบเปิดจะแข็งแกร่งกว่าที่ช่องว่างของดัชนีบ่งชี้ หากเอาต์พุตของคุณยาวหรือผู้ใช้ของคุณกำลังรอ การประหยัดสิบห้าเท่าจะทำให้คุณได้ผลิตภัณฑ์ที่ช้ากว่า และนั่นคือการแลกเปลี่ยนที่มีเพียงภาระงานของคุณเท่านั้นที่ตีราคาได้
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
