
DeepSeek V4 Pro ปะทะ Kimi K3: ความเร็วและราคา เมื่อเทียบกับเพดานการให้เหตุผลที่ 44 คะแนน
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
DeepSeek V4 Pro และ Kimi K3 คือสองเรือธงด้านการให้เหตุผลแบบน้ำหนักเปิดที่มีหน้าต่างบริบทหนึ่งล้านโทเคน และการแข่งขันของทั้งคู่ก็เข้าสู่รูปแบบที่มั่นคงเมื่อหนึ่งเดือนที่แล้ว โดย Kimi K3 (โมเดลพารามิเตอร์ 2.8T ของ Moonshot AI เปิดตัวเมื่อวันที่ 16 กรกฎาคม 2026) เป็นผู้นำด้านความฉลาด ส่วน DeepSeek V4 Pro (เปิดตัวเมื่อวันที่ 13 สิงหาคม 2026) เป็นผู้นำด้านความเร็วและราคา สิ่งที่ใหม่คือครึ่งที่ถูกกว่าของคู่นี้เกือบถูกลบทิ้งไปในช่วงครึ่งแรกของเดือนกันยายน — เมื่อวันที่ 8 DeepSeek ได้กำหนดเส้นทางให้ V4 Pro ปลดระวางในวันที่ 14 กันยายน จากนั้นก็เลื่อนออกไป และในวันที่ 11 ก็ยกเลิกการปลดระวางไปเลย โดยยืนยันว่าจะให้บริการโมเดลนี้ต่อไปโดยไม่เปลี่ยนการคิดค่าบริการ เรื่องนี้สำคัญกับคู่นี้มากกว่าคู่อื่น ๆ เพราะ "ถูก เร็ว คอนเท็กซ์ 1M น้ำหนักเปิด" เป็นการผสมผสานที่แทนได้ยากเมื่อทางเลือกอื่นมีราคาแพงกว่าถึงห้าเท่า
ตัวเลขที่เป็นอิสระคือผลการวัดของ Artificial Analysis ส่วนเบนช์มาร์กเปิดตัวของ DeepSeek และ Moonshot เองนั้นถูกระบุว่าเป็นข้อมูลที่ผู้จำหน่ายรายงาน เพราะยังไม่มีการทำซ้ำอย่างอิสระสำหรับทั้งคู่
Kimi K3 ชนะด้านดัชนี; V4 Pro ชนะด้านค่าใช้จ่าย
กระดานคะแนนอิสระชี้ชัดเจนว่าใครฉลาดกว่า Kimi K3 ที่ใช้ความพยายามสูงสุดได้คะแนน 44 บนดัชนีความฉลาด Artificial Analysis จัดอยู่ในอันดับ #2 ในบรรดาโมเดลที่เทียบเคียงกันได้ DeepSeek V4 Pro ได้ 36 คะแนน จัดอยู่ในอันดับ #7 ในระดับเดียวกัน ช่องว่าง 9 คะแนนนั้นคือเหตุผลทั้งหมดที่ทำให้ใครก็ยอมจ่ายในราคาของ Kimi K3 และราคาก็เป็นเหตุผลที่ทำให้การเปรียบเทียบนี้ไม่ได้ถูกตัดสินด้วยดัชนีเพียงอย่างเดียว: Kimi K3 ตั้งราคาไว้ที่ $3.00 ต่อล้านโทเคนอินพุต และ $15.00 ต่อล้านโทเคนเอาต์พุต ขณะที่ V4 Pro ตั้งราคาไว้ที่ $0.66/$1.98 ช่วงออฟพีค ($1.32/$3.96 ช่วงพีค) ในส่วนเอาต์พุต นั่นคิดเป็นประมาณ 7.5 เท่า — ก่อนหักส่วนลดแคช การอ่านแคชของ V4 Pro มีค่าใช้จ่ายประมาณ $0.02 ต่อล้านโทเคนในช่วงออฟพีค ซึ่งเป็นส่วนลด 97% ส่วนส่วนลดแคช 90% ของ Kimi K3 เริ่มต้นจากฐานที่สูงกว่ามาก สำหรับงานที่ใช้โทเคนหนัก ๆ ช่องว่างที่แท้จริงจะขยายไปใกล้สิบเท่า
• ดัชนีสติปัญญา — Kimi K3 44 (อันดับ 2/113) เทียบกับ V4 Pro 36 (อันดับ 7/113)
• ราคา — Kimi K3 $3.00/$15.00 ต่อ 1M เทียบกับ V4 Pro $0.66/$1.98 นอกช่วงพีค ($1.32/$3.96 ช่วงพีค)
• ความเร็ว — V4 Pro ~81 โทเคน/วินาที เทียบกับ Kimi K3 ~35 โทเคน/วินาที
• บริบท — ทั้งสอง 1M โทเค็น
• พารามิเตอร์ — Kimi K3 2.8T รวม / 104B ที่ใช้งาน เทียบกับ V4 Pro 1.6T รวม / 49B ที่ใช้งาน
• เวท — ทั้งแบบเปิด (Kimi K3 เวทแบบเปิด, V4 Pro MIT)
• อินพุต — Kimi K3 ข้อความและรูปภาพ เทียบกับ V4 Pro ข้อความเท่านั้น
ความเร็วคือสิ่งที่ทุกคนประเมินต่ำไป
ช่องว่างที่ไม่มีใครพูดถึงคืออัตราการประมวลผล (throughput) V4 Pro ส่งออกประมาณ 81 โทเคนต่อวินาทีเมื่อวัดอย่างอิสระ ส่วน Kimi K3 ทำได้ประมาณ 35 ในลูปของเอเจนต์ที่โมเดลเขียนหลายพันโทเคนต่อขั้นตอน นั่นคือความแตกต่างระหว่างงานที่เสร็จในไม่กี่นาทีกับงานที่ลากยาวไปทั้งบ่าย — และความแตกต่างด้านต้นทุนก็ซ้ำเติมเข้าไปอีก เพราะคุณจ่าย $15 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคนในความเร็วที่ประมาณครึ่งหนึ่ง สำหรับผู้ช่วยเขียนโค้ดแบบโต้ตอบ การประมวลผลเอกสารจำนวนมาก และงานใด ๆ ที่เวลาตามนาฬิกาเป็นรายการงบประมาณ การผสมผสานของ V4 Pro ที่ให้ความเร็ว 2.3 เท่าในราคาเอาต์พุตหนึ่งในเจ็ด คือคำตอบที่ได้เปรียบอย่างชัดเจน
เมื่อเก้าคะแนนนั้นคุ้มค่า
ข้อโต้แย้งที่ตรงไปตรงมาเพื่อสนับสนุน Kimi K3 คือเพดานความสามารถในการให้เหตุผล ค่าใช้จ่ายในการประเมินบน Intelligence Index ของมันอยู่ที่ประมาณ $3,658 สำหรับการรันครั้งนั้น — ซึ่งสะท้อนถึงห่วงโซ่การให้เหตุผลที่ยาวและมีค่าใช้จ่ายสูงอย่างแท้จริง ไม่ใช่ความผิดปกติของราคา หากเวิร์กโหลดของคุณคือการให้เหตุผลแบบยาก — การพิสูจน์ทางคณิตศาสตร์เชิงลึก การวางแผนระยะยาว งานแบบเอเจนต์ที่ใช้เวลาหลายชั่วโมง ซึ่งคะแนนดัชนีที่เพิ่มขึ้นเก้าคะแนนปรากฏออกมาเป็นความล้มเหลวที่ลดลง — Kimi K3 ก็คุ้มค่ากับราคาพรีเมียมของมัน ข้อโต้แย้งที่ตรงไปตรงมาต่อต้านมันคือทุกสิ่งอื่น: อัตราการประมวลผล เศรษฐศาสตร์ของแคช ราคาต่อโทเคนล้วน ๆ
เหตุผลอีกประการที่การพลิกกลับในเดือนกันยายนมีความสำคัญตรงนี้: เมื่อหนึ่งเดือนก่อน คำแนะนำที่สมเหตุสมผลคือ “ถ้าคุณจะยึดโมเดลเปิดที่ถูกและเร็วเป็นมาตรฐาน ก็ควรป้องกันความเสี่ยงไว้ — มันอาจถูกปลดระวาง” ณ วันที่ 15 กันยายน การป้องกันความเสี่ยงนั้นล้าสมัยไปแล้ว DeepSeek ได้ให้คำมั่นต่อสาธารณะ โดยสัญญาว่าจะแจ้งให้ทราบหากมีอะไรเปลี่ยนแปลง ว่าจะคง V4 Pro ไว้บน API และสัญญาอนุญาต MIT หมายความว่าโมเดลยังคงนำไปติดตั้งใช้งานบนฮาร์ดแวร์ของคุณเองได้ ไม่ว่า DeepSeek จะทำอะไรกับ API ของตน น้ำหนักแบบเปิดของ Kimi K3 ก็ให้อิสระแบบเดียวกันในอีกฝั่งหนึ่ง ซึ่งนั่นคือสิ่งที่ทำให้สิ่งนี้เป็นการเปรียบเทียบน้ำหนักแบบเปิดสองตัวอย่างแท้จริง แทนที่จะเป็นการต่อสู้ระหว่างบริการกับผลิตภัณฑ์

โมเดลทั้งสองอยู่บน OrcaRouter — ทั้ง DeepSeek V4 Pro และ Kimi K3 ต่างก็ส่งคำขอผ่านแพลตฟอร์ม ด้วยคีย์เดียว โดยราคาตามรายการของผู้ให้บริการถูกส่งผ่านโดยไม่บวกกำไร — และ routing DSL ก็เป็นวิธีที่เป็นธรรมชาติในการแยกคู่เปรียบเทียบนี้: ส่งงานด้านการให้เหตุผลระยะยาวไปยัง Kimi K3 ที่ซึ่งคะแนนที่นำอยู่ 9 คะแนนนั้นคุ้มค่า และส่งงานด้านปริมาณโทเคนที่สูงไปยัง DeepSeek V4 Pro ที่ซึ่งช่องว่างราคา 7.5 เท่าและช่องว่างความเร็ว 2.3 เท่าทำงานให้คุณ ทั้งสองเป็นส่วนเสริมกันบ่อยพอ ๆ กับที่เป็นคู่แข่งกัน และแพลตฟอร์มทำให้การรันทั้งสองตัวใช้แรงเท่ากับการรันตัวเดียว


สรุป
Kimi K3 เป็นโมเดล open-weights ที่ฉลาดกว่า นำอยู่เก้าคะแนนดัชนี และค่าพรีเมียมของมัน — 7.5 เท่าสำหรับเอาต์พุตโทเคน โดยมีความเร็วประมาณครึ่งหนึ่ง — เป็นต้นทุนจริง ไม่ใช่ความคลาดเคลื่อนจากการปัดเศษ DeepSeek V4 Pro เป็นม้าทำงานที่เร็ว ถูก และทนทาน และหลังวันที่ 11 กันยายน มันก็ไม่ใช่ความเสี่ยงที่จะจากไปอีกต่อไป คำตอบในทางปฏิบัติคือสิ่งที่คอลัมน์ราคาทั้งสองชี้ไป: ถ้างานของคุณเป็นการใช้เหตุผลที่ยาก ซื้อ Kimi K3; ถ้างานของคุณกินโทเคนมากและอ่อนไหวต่อเวลา ซื้อ DeepSeek V4 Pro; และถ้าคุณมีทั้งสองแบบ ใช้ทั้งสองและจัดเส้นทางตามงาน
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
