
Nex-N2.5 Pro เทียบ DeepSeek V4 Pro: ในบรรดาเวตเปิดเหล่านี้ มีเพียงหนึ่งชุดเท่านั้นที่เปิดจริง
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0455ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0247ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0247ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0157ความฉลาด82การเขียนโค้ด
- Alibabaใหม่Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiใหม่Z.ai: GLM 5.3 Flash2026-08-2646ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1849ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1541ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1251ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0547ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0347ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2140ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128ความฉลาด49การเขียนโค้ด
นี่คือความลับของตระกูลที่ทำให้การแข่งขันครั้งนี้ดูแปลกประหลาดยิ่งกว่าที่เห็น: Nex-N2.5 Max ของ Nex-AGI ซึ่งเป็นรุ่นสูงสุดของตระกูลที่มี Nex-N2.5 Pro รวมอยู่ด้วยนั้น จริงๆ แล้วถูก post-training มาจาก DeepSeek-V4-Pro-Base เอง การรายงานข่าวบันทึกการเผยแพร่เมื่อวันที่ 8 กันยายนระบุอย่างเปิดเผยว่า Mini และ Pro สร้างจาก Qwen3.5 เวอร์ชันต่างๆ ขณะที่ Max แบบข้อความอย่างเดียวขนาด 1.6T ตั้งอยู่บนฐานเปิดที่ DeepSeek ปล่อยออกมาในเดือนสิงหาคม ดังนั้นเมื่อนำ Nex-N2.5 Pro มาเปรียบเทียบกับ DeepSeek V4 Pro ผู้อ่านกำลังเห็นโปรเจกต์ open-model โปรเจกต์หนึ่งยืมรากฐานของอีกโปรเจกต์ไปใช้กับระดับเรือธงของตน แล้วพยายามวางตำแหน่งเหนือกว่าผู้ให้ในระดับที่ต่ำกว่า นั่นไม่ใช่การดูหมิ่น แต่มันคือวิธีที่เศรษฐกิจ open-weights ทำงาน และเป็นกรอบการเปรียบเทียบที่ตรงไปตรงมาที่สุด เมื่อทั้งสองโมเดลมีใบอนุญาตแบบเปิด และมีเพียงโมเดลเดียวเท่านั้นที่ดาวน์โหลดได้จริงในวันนี้
ประเด็นทั้งหมดอยู่ที่ความไม่สมมาตร DeepSeek V4 Pro บิลด์ 0813 ซึ่งเปิดตัวแบบ GA เมื่อวันที่ 13 สิงหาคม มีน้ำหนักโมเดลภายใต้ใบอนุญาต MIT วางอยู่บน Hugging Face ในตอนนี้ — โมเดล mixture-of-experts ขนาดใหญ่ที่มีพารามิเตอร์รวมราว 1.6 ล้านล้านตัว ใช้พารามิเตอร์จริงพร้อมกันราว 49 พันล้านตัว รองรับบริบท 1M โทเคน เพดานเอาต์พุต 384K และมี API อย่างเป็นทางการให้บริการอยู่เบื้องหลัง ส่วน Nex-N2.5 Pro ที่ประกาศเปิดตัวเมื่อวันที่ 8 กันยายน เป็น sparse MoE ที่มีพารามิเตอร์ 397 พันล้านตัว ใช้พารามิเตอร์จริงพร้อมกันราว 17 พันล้านตัว รองรับมัลติโมดัล ขณะที่ DeepSeek จำกัดเฉพาะข้อความ และตั้งเป้าไปที่เอเจนต์ปฏิบัติการบนคอมพิวเตอร์ (computer-use agents) มากกว่าการใช้เป็นเครื่องมืออเนกประสงค์ การ์ดบน Hugging Face ของมันยังคงขึ้นแบนเนอร์ว่าน้ำหนักโมเดลกำลังจะมาเร็วๆ นี้ภายใต้ Apache-2.0 โดยไม่ระบุวันที่ ทว่ามีเพียงเอนด์พอยต์ที่โฮสต์แบบฟรีเท่านั้นที่ให้บริการอยู่ ทั้งคู่มีพันธสัญญาเชิงปรัชญาเดียวกันต่อการเปิดน้ำหนักโมเดล แต่สภาพการส่งมอบต่างกันโดยสิ้นเชิง
ใบอนุญาตสองฉบับ ชุดน้ำหนักหนึ่งชุดที่เผยแพร่ออกมาจริง
ความต่างเรื่องใบอนุญาตสำคัญน้อยกว่าความต่างเรื่องการส่งมอบ แต่มันคือตัวกำหนดเงื่อนไข DeepSeek V4 Pro ใช้ใบอนุญาต MIT — คุณดาวน์โหลดชาร์ดได้ตั้งแต่วันนี้ จะเอาไปให้บริการเอง ปรับแต่งเอง หรือสร้างธุรกิจจากมันก็ได้โดยไม่ต้องขออนุญาตใคร และเพราะน้ำหนักของโมเดลถูกปล่อยออกมาแล้ว จึงไม่มีผู้ให้บริการรายใดรายหนึ่งควบคุมราคาได้เพียงลำพัง ส่วน Nex-N2.5 Pro มีคำมั่นว่าจะเผยแพร่ภายใต้ Apache-2.0 ซึ่งเป็นใบอนุญาตที่ให้สิทธิ์เสรีทัดเทียมกับ MIT และเป็นใบอนุญาตที่พันธมิตรเลือกใช้ แต่แบนเนอร์บนการ์ดโมเดลก็ระบุชัดเจนไม่กำกวม: น้ำหนักของโมเดลไม่สามารถดาวน์โหลดได้ และไม่มีกำหนดวันปล่อยออกมา สำหรับทีมที่มีข้อกำหนดว่า “โมเดลต้องเป็นของเรา” การจับคู่นี้ ณ ตอนนี้จึงไม่ใช่การแข่งขันที่สูสี — DeepSeek V4 Pro คือตัวเลือกเดียวที่คุณเป็นเจ้าของได้จริง ข้อควรระวังในทางปฏิบัติเป็นดาบสองคม: การโฮสต์โมเดล MoE ขนาด ~1.6T ด้วยตัวเองต้องใช้โครงสร้างพื้นฐานระดับใหญ่ ดังนั้นสำหรับทีมส่วนใหญ่ ใบอนุญาต MIT จึงไม่ได้สำคัญในฐานะแผนการโฮสต์ แต่สำคัญในฐานะหลักประกันว่าจะไม่ถูกล็อกอิน (lock-in) กับผู้ให้บริการรายเดียว และจะไม่มีผู้ให้บริการรายใดผูกขาดการตั้งราคา ส่วน Nex-N2.5 Pro เมื่อชาร์ดของมันถูกปล่อยออกมา จะเป็นดีไซน์ที่โฮสต์เองได้ดีกว่า — ระบบที่รันพารามิเตอร์แอกทีฟ 17B บนโหนด H100 แปดตัวมีขนาดเล็กกว่าระบบอ้างอิงของ DeepSeek มาก
แถวที่ทั้งสองแตกต่างกัน
เมื่อเทียบเคียงกันแล้ว ทั้งสองรุ่นแทบไม่มีจุดประสงค์การใช้งานที่ทับซ้อนกันเลย:
• เผยแพร่แล้ว — Nex-N2.5 Pro: 8 กันยายน 2026 (โฮสต์เอนด์พอยต์เปิดให้บริการแล้ว น้ำหนักโมเดลยังไม่เปิดให้ดาวน์โหลด) DeepSeek V4 Pro: 13 สิงหาคม 2026 (บิลด์ GA 0813) น้ำหนักโมเดลเปิดให้ดาวน์โหลดแล้ว
• ขนาด — Nex-N2.5 Pro: ทั้งหมด 397B / ใช้งานจริง ~17B. DeepSeek V4 Pro: ทั้งหมด ~1.6T / ใช้งานจริง ~49B.
• โมดาลิตี้ — Nex-N2.5 Pro: รองรับอินพุตข้อความและภาพ เอาต์พุตเป็นข้อความ ออกแบบมาสำหรับการใช้งานคอมพิวเตอร์แบบอ่านหน้าจอ ส่วน DeepSeek V4 Pro: รองรับเฉพาะข้อความใน API สาธารณะ — ไม่รองรับวิทัศน์ รูปภาพ หรือเสียงแบบเนทีฟ
• บริบท / เอาต์พุต — Nex-N2.5 Pro: บริบท 262,144 โทเคน DeepSeek V4 Pro: บริบท 1M โทเคน เอาต์พุตสูงสุด 384K โทเคน
• การควบคุมการคิด — Nex-N2.5 Pro: ไม่มี / ปานกลาง (ปรับอัตโนมัติ, ค่าเริ่มต้น) / สูง. DeepSeek V4 Pro: ต่ำ / สูง / ความพยายามในการคิดสูงสุดบนสตริงโมเดลเดียวกัน
• น้ำหนักโมเดล — Nex-N2.5 Pro: Apache-2.0 จะมาเร็วๆ นี้ ส่วน DeepSeek V4 Pro: MIT ดาวน์โหลดได้แล้ว
• พื้นผิว API — Nex-N2.5 Pro: รองรับการเรียกแชทที่เข้ากันได้กับ OpenAI บนเอนด์พอยต์ที่โฮสต์ฟรี ส่วน DeepSeek V4 Pro: รองรับ OpenAI Responses API แบบเนทีฟ รวมถึงเอนด์พอยต์ที่เข้ากันได้กับ Anthropic, การเรียกใช้เครื่องมือ และเอาต์พุต JSON.
ผลิตภัณฑ์สองชนิดที่แตกต่างกันอย่างแท้จริงใช้คำว่า "open" ร่วมกัน Nex-N2.5 Pro ถูกสร้างมาเพื่อมองหน้าจอและขับเคลื่อนมัน ขณะที่ DeepSeek V4 Pro ถูกสร้างมาเพื่อคิด เขียนโค้ด และเรียกใช้เครื่องมือ — นี่คือความแตกต่างระหว่างผู้ปฏิบัติการกับนักวิเคราะห์

วัดสิ่งใด และยืมสิ่งใด

ภาพรวมด้าน Benchmark เอนเอียงไม่แพ้ภาพรวมด้านการส่งมอบ DeepSeek V4 Pro มีร่องรอยที่วัดผลได้และเป็นอิสระ: การปรากฏในดัชนี Artificial Analysis Intelligence, การรายงานข่าวและการใช้งานจริงหลายสัปดาห์หลังการวางจำหน่ายทั่วไป (GA) เมื่อ 0813 และตัวเลขด้านการเขียนโค้ดจากผู้ผลิต — Terminal-Bench 2.1 ที่ 87.9 และ DeepSWE ที่ 62.7 ตามรายงานของ DeepSeek เอง — ซึ่งอย่างน้อยก็ตั้งอยู่บนโมเดลที่ใครก็สามารถดาวน์โหลดและรันซ้ำได้ ส่วน Nex-N2.5 Pro ไม่มีสิ่งเหล่านั้นเลย ตัวเลขเด่นของมัน — OSWorld-2 ที่ 56.4, Terminal-Bench 2.1 ที่ 82.7, SWE-Bench Pro ที่ 61.2, BrowseComp ที่ 89.7 — ล้วนเป็นการวัดโดย Nex-AGI เองผ่านชุดทดสอบ NexCUA ซึ่งกลุ่มพันธมิตรบอกว่าจะเปิดเป็นโอเพนซอร์สแต่ยังไม่ได้ทำ ในช่วง 48 ชั่วโมงแรกหลังเปิดตัว ไม่มีห้องปฏิบัติการอิสระใดเคยรัน Nex-N2.5 Pro เพราะไม่มีใครนอกกลุ่มพันธมิตรสามารถทำได้
อ่านข้อเรียกร้องสองชุดนี้เคียงข้างกัน ข้อสรุปที่ซื่อสัตย์ไม่ใช่ "DeepSeek ฉลาดกว่า" แต่เป็น "ตัวเลขของ DeepSeek ตรวจสอบได้ และตัวเลขของ Nex-N2.5 Pro ตรวจสอบไม่ได้" ในจุดที่เอกสารของทั้งสองผู้ขายทับซ้อนกัน — Terminal-Bench 2.1 — DeepSeek อ้าง 87.9 ในขณะที่ Nex-N2.5 Pro ได้ 82.7 ซึ่งเป็นช่องว่าง 5 จุดที่เข้าข้างฝ่ายที่เปิดตัวโมเดลไปแล้ว และเป็นทิศทางที่ผู้อ่านที่รอบคอบควรคาดหวังพอดี: โมเดลที่เปิดตัวแล้วให้ผลวัดบนแถวร่วมสูงกว่าโมเดลที่ยังไม่ได้เปิดตัว
ราคา: จำนวนจริง จำนวนตามกำหนด และไม่มีจำนวน
ราคาของ DeepSeek V4 Pro ไม่ใช่ตัวเลขเดียว และนั่นก็เป็นเรื่องราวของมันเอง ตอน GA วันที่ 0813 API อย่างเป็นทางการระบุราคา $0.435 ต่อล้าน input และ $0.87 ต่อล้าน output; ต่อมาในวันที่ 16 สิงหาคม DeepSeek เปลี่ยนตระกูล V4 ไปเป็นตารางคิดค่าใช้จ่ายแบบช่วงพีค/นอกช่วงพีค ดังนั้น API อย่างเป็นทางการตอนนี้คิด $0.66 input / $1.98 output ในช่วงนอกพีค และ $1.32 / $3.96 ในช่วงพีค ส่วน input แบบ cached อยู่ที่ $0.022 นอกช่วงพีค และ $0.044 ในช่วงพีค ขึ้นอยู่กับเวลาที่คุณเรียกใช้ DeepSeek โดยตรง โมเดลเดียวกันนี้มีต้นทุนตั้งแต่สูงกว่าอัตราเปิดตัวประมาณ 50% ไปจนถึงสี่เท่าครึ่ง เส้นทางก็สำคัญเช่นกัน: หน้าโมเดล OrcaRouter สำหรับ DeepSeek V4 Pro ปัจจุบันระบุอัตราคงที่ $0.44 input / $0.88 output ต่อล้าน ซึ่งเป็นอัตราของผู้ให้บริการที่ส่งผ่านมาโดยไม่มีมาร์กอัป ทำให้ต่ำกว่าตารางอย่างเป็นทางการในช่วงนอกพีคด้วยซ้ำ เส้นทางคงที่แบบนั้นคือราคาที่ต้องเอาชนะถ้าคุณเปรียบเทียบต้นทุนต่อโทเค็น และมันเป็นตัวเลขแบบที่มีอยู่ได้ก็เพราะเลเยอร์การจัดเส้นทางแสดงอัตราจริงของผู้ให้บริการให้คุณเห็น แทนที่จะเป็นราคาที่ถูกตั้งขึ้นใหม่เท่านั้น

Nex-N2.5 Pro ไม่มีราคามาเทียบเคียงกับสิ่งเหล่านั้นเลย ระดับบริการโฮสต์ของมันฟรี และ Nex-AGI ก็ยังไม่มีการเผยแพร่อัตราค่าบริการต่อโทเค็นแบบชำระเงินสำหรับตระกูลนี้ ดังนั้นความคุ้มค่าทางเศรษฐกิจของโมเดลจึงไม่อาจประเมินได้—เอนด์พอยต์ฟรีแค่พิสูจน์ว่ามันทำงานได้จริงเท่านั้น ไม่มีอะไรมากกว่านั้น หากค่าน้ำหนักถูกปล่อยออกมาและมีผู้ให้บริการเริ่มให้บริการ Nex-N2.5 Pro ในราคาที่ประกาศไว้ การเปรียบเทียบอย่างตรงไปตรงมาก็จะเกิดขึ้นได้ จนกว่าจะถึงตอนนั้น "ฟรี" เป็นเพียงกลไกการแสดงตัวอย่าง ไม่ใช่สัญญาณของตลาด
เอเจนต์สองชนิดที่แตกต่างกัน
การเลือกระหว่างสองรุ่นนี้คือการเลือกระหว่างงานสองประเภท ไม่ใช่คะแนนสองค่า Nex-N2.5 Pro สร้างมาสำหรับเอเจนต์ที่ปฏิบัติการกับคอมพิวเตอร์: มันอ่านหน้าจอ เลื่อนเคอร์เซอร์ แก้ไขไฟล์ ตรวจสอบผลลัพธ์ที่เห็น แล้วก็ทำต่อไปเรื่อยๆ — เซสชัน 468 แอ็กชันใน Pokemon Platinum ที่สาธิตไว้คือรูปร่างของความทะเยอทะยานนั้น DeepSeek V4 Pro สร้างมาสำหรับเอเจนต์ที่ปฏิบัติการผ่าน API: มันให้เหตุผล เขียนโค้ดหลายไฟล์ เรียกใช้เครื่องมือ และสร้างเอาต์พุตแบบมีโครงสร้างที่ยาว ทั้งหมดผ่านช่องทางข้อความซึ่งเพดานเอาต์พุต 384K และคอนเทกซ์ 1M มีไว้รองรับ ทีมที่กำลังสร้างระบบอัตโนมัติสำหรับเบราว์เซอร์ควรจับตาดู Nex-N2.5 Pro ทีมที่กำลังสร้างเอเจนต์สำหรับเขียนโค้ดหรืองานด้านความรู้ควรนำ DeepSeek V4 Pro ไปเทียบกับโมเดลปิดระดับแนวหน้า และ Nex-N2.5 Pro ยังไม่ใช่ตัวเลือกสำหรับงานนั้น — เพราะมันไม่สามารถนำภาพออกจากวงจรการทำงานได้ และข้อกล่าวอ้างด้านการเขียนโค้ดของมันก็ทั้งต่ำกว่าและผ่านการยืนยันน้อยกว่าโมเดลที่ถูกนำมาเปรียบเทียบ
บทสรุป: รอสิ่งหนึ่ง แล้วสร้างอีกสิ่งหนึ่ง
DeepSeek V4 Pro คือเป้าหมายการสร้างที่สมเหตุสมผลเพียงหนึ่งเดียวในการประลองครั้งนี้ น้ำหนักโมเดลดาวน์โหลดได้ ราคาระบุชัดเจน — และถูกกว่าผ่านเส้นทาง OrcaRouter แบบเหมาจ่ายเมื่อเทียบกับแผนคิดเงินช่วงพีคของ DeepSeek เอง — และข้อกล่าวอ้างทั้งหมดตรวจสอบได้โดยใครก็ได้ในเวลาเพียงบ่ายเดียว อีกทั้งยังเป็นจุดเริ่มต้นตามธรรมชาติสำหรับการวัดว่าการใช้คอมพิวเตอร์แบบโอเพนจะมีต้นทุนเท่าใด: โยงทราฟฟิกของเอเจนต์เขียนโค้ดผ่าน OrcaRouter พร้อมระบบสลับไปใช้เส้นทางสำรองอัตโนมัติรอบขีดจำกัดราว 500 การเชื่อมต่อพร้อมกันของ API ทางการ แล้วคุณจะได้เส้นฐานโอเพนเวตส์ที่ใช้งานได้จริงในราคาจริง Nex-N2.5 Pro คือการเดิมพันระยะยาวที่น่าสนใจกว่า เพราะเป็นดีไซน์เฉพาะทางมากกว่า — โอเปอเรเตอร์มัลติโมดัลที่แอกทีฟ 17B ซึ่งอาจตัดราคาผู้นำด้านคอมพิวเตอร์ยูสแบบปิดได้ เช่นเดียวกับที่ DeepSeek เคยตัดราคาโมเดลเอนกประสงค์แบบปิด — แต่เอนด์พอยต์ฟรีที่ไม่อาจตรวจสอบได้ไม่อาจเป็นฐานที่มั่นคง เมื่อชาร์ด Apache-2.0 ถูกปล่อยออกมาและชุดทดสอบอิสระรันค่านั้นของ OSWorld-2 ออกมา การประลองครั้งนี้จะเปลี่ยนไปในชั่วข้ามคืน จนกว่าจะถึงตอนนั้น มันคือการเปรียบเทียบระหว่างโมเดลที่คุณเป็นเจ้าของได้ กับโมเดลที่คุณได้แต่มองดู
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
