
Qwen 4 Max กับ DeepSeek V4 Pro: พารามิเตอร์ที่ใช้งาน 95 พันล้าน เทียบกับ 49 พันล้าน
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
การประกาศ Qwen 4 Max ที่การประชุม Yunqi เมื่อวันที่ 22 กันยายน 2026 ทำให้อุตสาหกรรมได้แค่ชื่อและโครงสร้างระดับเท่านั้น — ไม่มีน้ำหนัก ไม่มีราคา ไม่มีหน้าต่างบริบท ไม่มีวันที่ DeepSeek V4 Pro ถูกระบุตั้งแต่เมื่อวันที่ 24 เมษายน 2026 ว่าเป็นโมเดล mixture-of-experts ขนาด 1.6 ล้านล้านพารามิเตอร์ โดยมี 49 พันล้านพารามิเตอร์ที่ทำงานต่อโทเค็น, คอนเท็กซ์ 1 ล้านโทเค็น, และราคาแบบ off-peak ที่ 0.66 ดอลลาร์ต่อล้านโทเค็นอินพุต และ 1.98 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต ตัวเลขที่ควรนำมาเปรียบเทียบกันไม่ใช่จำนวนพารามิเตอร์ทั้งหมด แต่เป็นจำนวนที่ทำงานจริง: Qwen3.8-Max ที่เผยแพร่ล่าสุดเปิดใช้งาน 95 พันล้านพารามิเตอร์ต่อโทเค็น ซึ่งประมาณสองเท่าของ 49 พันล้านพารามิเตอร์ที่ทำงานจริงของ DeepSeek V4 Pro และตัวเลขนี้เพียงตัวเดียวอธิบายช่องว่างราคาสามเท่าระหว่างสองห้องแล็บได้เกือบทั้งหมด ก่อนที่จะมีการทดสอบ benchmark แม้แต่ครั้งเดียว
สองเดิมพันที่แตกต่างกันต่อความเบาบาง
ทั้งสองแล็บสร้างโมเดล sparse mixture-of-experts พวกเขาเห็นไม่ตรงกันอย่างรุนแรงว่าจะ sparse มากน้อยเพียงใด Qwen3.8-Max — เรือธง Qwen ที่วางจำหน่ายแล้ว และเป็น基準ที่เป็นรูปธรรมเพียงหนึ่งเดียวว่าหน้าตาของ Qwen 4 Max จะเป็นอย่างไร — เป็นโมเดลขนาด 2.4 ล้านล้านพารามิเตอร์ที่เปิดใช้งาน 95 พันล้านพารามิเตอร์ต่อโทเค็น คิดเป็นอัตราส่วนประมาณ 1 ต่อ 25 DeepSeek V4 Pro เป็นโมเดลขนาด 1.6 ล้านล้านพารามิเตอร์ที่เปิดใช้งาน 49 พันล้าน คิดเป็นอัตราส่วนประมาณ 1 ต่อ 33 และจัดเก็บน้ำหนัก expert ไว้ใน FP4 โดยปล่อยเลเยอร์ attention, router และ norm ไว้ใน FP8 ซึ่งช่วยลดการประมวลผลต่อโทเค็นลงอีก
นั่นไม่ใช่ความแตกต่างด้านการปรับจูน พวกมันคือสองคำตอบที่แตกต่างกันสำหรับคำถามเดียวกัน — โมเดลระดับแนวหน้าควรใช้จ่ายต่อโทเคนเท่าใด:
• จำนวนพารามิเตอร์ทั้งหมด — Qwen 3.8 รุ่นเรือธง 2.4T เทียบกับ DeepSeek V4 Pro 1.6T
• แอ็กทีฟต่อโทเคน — Qwen 3.8 เรือธง 95B เทียบกับ DeepSeek V4 Pro 49B
• อัตราส่วนการเปิดใช้งาน — ประมาณ 1 ใน 25 เทียบกับประมาณ 1 ใน 33
• ราคาอินพุต ช่วงนอกเวลาเร่งด่วน — Qwen3.8-Max $2.00 ต่อ 1M เทียบกับ DeepSeek V4 Pro $0.66 ต่อ 1M
• ราคาเอาต์พุต ช่วง off-peak — Qwen3.8-Max $6.00 ต่อ 1M เทียบกับ DeepSeek V4 Pro $1.98 ต่อ 1M
• น้ำหนักโมเดลระดับเรือธง — Qwen 3.8 รุ่นเรือธงภายใต้สัญญาอนุญาต Qwen แบบกำหนดเอง เทียบกับ DeepSeek V4 Pro ที่เผยแพร่ภายใต้ MIT
• บริบท — Qwen3.8-Max 1M โทเค็น เทียบกับ DeepSeek V4 Pro 1M โทเค็น
• ประเภทอินพุต — Qwen3.8-Max รองรับข้อความ รูปภาพ และวิดีโอ เทียบกับ DeepSeek V4 Pro ที่เป็นข้อความเท่านั้นตามรายการของตน
• ความหน่วงที่สังเกตได้ — Qwen3.8-Max p50 time-to-first-token 3.29 วินาที เทียบกับ DeepSeek V4 Pro 3.52 วินาที บนแค็ตตาล็อกเดียวกัน
ความแตกต่างด้านความเบาบาง (sparsity) และความแตกต่างด้านราคาชี้ไปในทางเดียวกันในครั้งนี้ ซึ่งไม่ใช่ทิศทางที่จำนวนพารามิเตอร์รวมบ่งชี้ Qwen เปิดใช้งานพารามิเตอร์ต่อโทเคนมากกว่า DeepSeek ประมาณสองเท่า และคิดราคาแพงกว่าประมาณสามเท่า และความเบาบางเพียงอย่างเดียวไม่สามารถปิดช่องว่างนั้นได้ สิ่งที่ปิดช่องว่างที่เหลือคือมอดาลิตี (modality): เรือธงของ Qwen มีตัวเข้ารหัสภาพและวิดีโอติดมาด้วย ซึ่งต้องจ่ายสำหรับสิ่งเหล่านี้ในทุกคำขอไม่ว่าจะมีภาพอยู่ในนั้นหรือไม่ และนั่นคือเหตุผลว่าทำไมอัตราอินพุตจึงอยู่ที่ระดับที่เป็นอยู่ DeepSeek V4 Pro รับข้อความและส่งคืนข้อความ และถูกตั้งราคาเหมือนโมเดลที่ทำเพียงเท่านั้น
มีข้อแม้หนึ่งข้อที่ควรระบุไว้ในคอลัมน์ DeepSeek ก่อนที่จะนำไปใช้กับสิ่งใด ๆ DeepSeek คิดราคาตามตารางแบบพีคและออฟพีค: ตัวเลข $0.66 และ $1.98 เป็นอัตราช่วงออฟพีค และในช่วงเวลาพีค — 01:00 ถึง 04:00 และ 06:00 ถึง 10:00 UTC ในวันธรรมดา ไม่รวมวันหยุดนักขัตฤกษ์ของจีน — โมเดลเดียวกันจะคิดค่าบริการที่ $1.32 สำหรับอินพุต และ $3.96 สำหรับเอาต์พุต ช่วงเวลาอื่นทั้งหมด รวมถึงวันหยุดสุดสัปดาห์และวันหยุดทั้งหมด ถือเป็นช่วงออฟพีค ดังนั้น อัตราที่คุณจ่ายจึงเป็นฟังก์ชันของเวลาที่ทราฟฟิกของคุณทำงาน และโมเดลต้นทุนที่สร้างขึ้นจากตัวเลขออฟพีคเพียงอย่างเดียวจะไม่ถูกต้องสำหรับเวิร์กโหลดใด ๆ ที่มีองค์ประกอบในช่วงเช้าของวันธรรมดา

คอลัมน์ Qwen 4 Max ว่างเปล่า และนั่นไม่ใช่สภาพชั่วคราว
มันน่าดึงดูดใจที่จะเติมการเปรียบเทียบด้วยสมมติฐานว่า Qwen 4 Max จะเปิดตัวใกล้ตัวเลขของ Qwen 3.8 และราคาต่ำกว่านั้น จงต้านทานมัน Alibaba อธิบายสถาปัตยกรรม Qwen 4 ว่าเป็นรุ่นใหม่และกล่าวว่ากำลังเทรนอยู่ อาร์ติแฟกต์ที่เผยแพร่เพียงอย่างเดียวที่อธิบายสถาปัตยกรรมนั้นคือ Qwen3.8-Flash-Next ซึ่งเปิดซอร์สในปลายเดือนสิงหาคม 2026 และติดป้ายบนการ์ดโมเดลของตัวเองว่าเป็นพรีวิวของดีไซน์ Qwen 4 มันเป็นโมเดลหลักขนาด 125 พันล้านพารามิเตอร์ โดยมี 51 พันล้านพารามิเตอร์ของ N-gram embeddings ที่เปิดใช้งานประมาณ 6 พันล้านต่อสเต็ป พร้อมด้วย QSA แอตเทนชันแบบสแปร์ส, เรซิดิวแบบเกต และบริบทเนทีฟ 262,000 โทเคนที่ขยายได้ถึง 1 ล้าน
หากการออกแบบนั้นขยายไปถึงระดับ Max จำนวนที่ใช้งานควรอยู่ในหลักหมื่นล้าน แทนที่จะไต่ขึ้นไปใกล้ยอดรวมของ DeepSeek — การทำให้คอมพิวต์ต่อสเต็ปคงที่โดยประมาณขณะจำนวนพารามิเตอร์รวมเพิ่มขึ้น คือหัวใจทั้งหมดของ QSA และของ N-gram embeddings ที่ถูกค้นหาแบบ lookup แทนที่จะคำนวณแบบหนาแน่น นั่นเป็นทิศทางมากกว่าข้อกำหนด และไม่ควรพิมพ์ออกมาเป็นข้อกำหนด
สิ่งที่สามารถรู้ได้ในตอนนี้คือความไม่สมมาตรในการดำเนินงาน โมเดลที่มีอยู่จริงสามารถวัดผลกับเวิร์กโหลดของคุณได้ ส่วนโมเดลที่ไม่มีอยู่จริงก็ไม่สามารถวัดผลกับสิ่งใดได้เลย Qwen 4 Max สามารถเข้าถึงได้ เมื่อเปิดตัว ผ่าน API ของผู้ขายเองและแพลตฟอร์มบุคคลที่สามหลายแห่ง — เส้นทางเดียวกันกับที่เรือธงทุกรุ่นของ Alibaba ใช้ วันนี้มันยังไม่มีบน OrcaRouter: แคตตาล็อกไม่มีรายการสำหรับตระกูล Qwen 4 เลย ตอนนี้ DeepSeek V4 Pro อยู่บน OrcaRouter แล้ว และสแนปช็อตที่ลงวันที่ของมันก็อยู่ด้วย
ความสามารถในการทำซ้ำคือข้อโต้แย้งที่ไม่มีใครยกขึ้นมา
DeepSeek ออกสแนปช็อตที่ระบุวันที่และทำให้ยังคงเข้าถึงได้ แค็ตตาล็อกมีทั้งตัวระบุ DeepSeek V4 Pro แบบลอยตัว และตัวแปรแบบปักหมุดวันที่ 2026-08-13 โดยวันที่นั้นเป็นบิลด์ที่ DeepSeek เองกำหนดให้เป็นรุ่นที่เปิดให้ใช้งานทั่วไปอย่างเป็นทางการ สิ่งนี้ดูไม่หวือหวาและสำคัญกว่าส่วนต่างของ benchmark สำหรับใครก็ตามที่รันชุดทดสอบประเมินหรือไปป์ไลน์ที่ควบคุมตามข้อกำหนดด้านการปฏิบัติตามกฎ: เมื่อคุณปักหมุดสแนปช็อต ชุดทดสอบการถดถอยของคุณจะวัดโค้ดของคุณเอง ไม่ใช่จังหวะการออกรุ่นของผู้ให้บริการ
รุ่น Qwen 3.8 ก็ทำแบบเดียวกัน — มีสแนปช็อต Qwen3.8-Max ที่ระบุวันที่อยู่ในแค็ตตาล็อกเดียวกัน ควบคู่ไปกับชื่อแบบลอย — และไม่มีเหตุผลที่จะคิดว่า Alibaba จะหยุด แต่มันเป็นคุณสมบัติของโมเดลที่เปิดตัวแล้ว และเป็นเรื่องที่ควรกล่าวอย่างตรงไปตรงมาว่าในวันที่ Qwen 4 Max ถูกประกาศ มันจะไม่มีสแนปช็อตให้ปักหมุด ไม่มีตัวระบุที่เสถียรให้ทดสอบเทียบ และไม่มีวิธีรันการเปรียบเทียบก่อนและหลังบนข้อมูลของคุณเอง ไม่ว่าคุณจะต้องการเปรียบเทียบแบบไหน คุณก็จะได้ทำมันในภายหลัง

รันทั้งคู่โดยไม่ต้องรันสองสแต็ก
OrcaRouter กำหนดเส้นทาง DeepSeek V4 Pro เป็น deepseek/deepseek-v4-pro ในราคา $0.66 สำหรับอินพุต และ $1.98 สำหรับเอาต์พุตต่อล้านโทเค็น ซึ่งเป็นราคาตามรายการช่วงนอกเวลา (off-peak) ของ DeepSeek เองที่ส่งผ่านมาด้วยอัตรากำไร 0% ส่วนหลังนี้มีค่ามากกว่าในที่อื่น ๆ ในชุดนี้ เพราะ $1.98 สำหรับเอาต์พุตนั้นใกล้เคียงกับพื้นราคาของโมเดลระดับแนวหน้าอยู่แล้ว แม้จะเป็นกำไรของแพลตฟอร์มเพียงสิบเปอร์เซ็นต์ ก็ยังคิดเป็นหนึ่งในห้าของส่วนต่างระหว่างโมเดลนี้กับทางเลือกในระดับกลาง และที่อัตรากำไร 0% อัตราที่คุณเห็นบนหน้าก็คืออัตราที่ DeepSeek ประกาศ รวมถึงการแบ่งช่วงพีคและนอกพีค ซึ่งส่งผ่านตามตารางเวลาเดียวกัน แทนที่จะถูกเฉลี่ยให้เป็นอัตราคงที่แบบเดียว
เอนด์พอยต์เดียวกันนี้ให้บริการตระกูล Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27B — เคียงข้างกับ DeepSeek V4 Pro บน API ที่เข้ากันได้กับ OpenAI เพียงหนึ่งเดียวซึ่งมีโมเดลใกล้เคียง 200 รายการ พร้อมระบบ failover อัตโนมัติเมื่อเส้นทางของผู้ให้บริการมีปัญหา และ routing DSL ที่ช่วยให้การเลือกเป็นไปอย่างชัดเจนแทนการฮาร์ดโค้ดไว้ หาก DeepSeek ปรับลดราคา การเปลี่ยนแปลงจะส่งถึงคีย์ของคุณในวันเดียวกัน เพราะไม่มีชั้นมาร์จินให้ส่วนลดไปติดค้างอยู่ เมื่อมีระดับ Qwen 4 เปิดตัว แค็ตตาล็อกเดียวกันนี้ก็คือที่ที่มันจะปรากฏขึ้น
สิ่งนี้ทำให้คุณอยู่ตรงไหน
DeepSeek V4 Pro ชนะการเปรียบเทียบนี้เพราะอีกฝ่ายสละสิทธิ์ และคุ้มค่าที่จะพูดให้ชัดเจนว่าทำไม แทนที่จะปรุงแต่งให้ดูดี มันถูกกว่าในทั้งสองแกนประมาณสามเท่า เปิดใช้งานพารามิเตอร์ต่อโทเคนมากกว่าถึงห้าเท่า หน้าต่างบริบทเท่ากัน และมีสแนปช็อตที่ระบุวันที่ซึ่งคุณปักหมุดได้ ส่วน Qwen 4 Max มีเพียงชื่อระดับและสล็อตในงานประชุม
การเปรียบเทียบที่เกิดขึ้นจริงในตอนนี้คือ DeepSeek V4 Pro กับ Qwen3.8-Max และมันเป็นการแลกหมัดกันจริง ๆ มากกว่าจะเป็นการกวาดล้าง: DeepSeek เป็นโมเดลแบบข้อความล้วนในราคาประมาณหนึ่งในสาม โดยมีเวตเผยแพร่ภายใต้ MIT และมีโปรไฟล์การเปิดใช้งานต่อโทเคนที่เบากว่า ส่วนเรือธงของ Qwen รองรับอินพุตรูปภาพและวิดีโอในราคา $2.00 และ $6.00 ให้เลือกตัดสินจากโมดัลลิตีและต้นทุนที่วัดได้ต่องานที่เสร็จสมบูรณ์ ไม่ใช่จากจำนวนพารามิเตอร์ และให้รันการเปรียบเทียบใหม่เมื่อ Alibaba เผยแพร่โมเดลการ์ด — ซึ่ง ณ จุดนั้น คำถามที่น่าสนใจคือ Qwen 4 Max ตั้งราคาความสามารถมัลติโมดัลของตนสูงกว่าอัตราแบบข้อความของ DeepSeek น้อยกว่าที่เป็นอยู่ในปัจจุบันหรือไม่

การเปรียบเทียบในบทความนี้4
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
