การ์ดชื่อเรื่องหลักสำหรับ "Qwen 4 Max vs DeepSeek V4 Pro" พร้อมคำโปรยย่อย "พารามิเตอร์ที่ใช้งานอยู่ 95 พันล้าน เทียบกับ 49 พันล้าน" ป้ายแบบแคปซูลสามป้ายที่อ่านว่า "$2.00 และ $6.00", "$0.66 และ $1.98" และ "1 ใน 25 เทียบกับ 1 ใน 33" บรรทัดส่วนท้ายที่อ่านว่า "Alibaba ประกาศเมื่อวันที่ 22 กันยายน 2026; DeepSeek จดทะเบียนเมื่อวันที่ 24 เมษายน 2026" และโลโก้ OrcaRouter ที่มุมขวาล่าง
Engineering & Research

Qwen 4 Max กับ DeepSeek V4 Pro: พารามิเตอร์ที่ใช้งาน 95 พันล้าน เทียบกับ 49 พันล้าน

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

การประกาศ Qwen 4 Max ที่การประชุม Yunqi เมื่อวันที่ 22 กันยายน 2026 ทำให้อุตสาหกรรมได้แค่ชื่อและโครงสร้างระดับเท่านั้น — ไม่มีน้ำหนัก ไม่มีราคา ไม่มีหน้าต่างบริบท ไม่มีวันที่ DeepSeek V4 Pro ถูกระบุตั้งแต่เมื่อวันที่ 24 เมษายน 2026 ว่าเป็นโมเดล mixture-of-experts ขนาด 1.6 ล้านล้านพารามิเตอร์ โดยมี 49 พันล้านพารามิเตอร์ที่ทำงานต่อโทเค็น, คอนเท็กซ์ 1 ล้านโทเค็น, และราคาแบบ off-peak ที่ 0.66 ดอลลาร์ต่อล้านโทเค็นอินพุต และ 1.98 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต ตัวเลขที่ควรนำมาเปรียบเทียบกันไม่ใช่จำนวนพารามิเตอร์ทั้งหมด แต่เป็นจำนวนที่ทำงานจริง: Qwen3.8-Max ที่เผยแพร่ล่าสุดเปิดใช้งาน 95 พันล้านพารามิเตอร์ต่อโทเค็น ซึ่งประมาณสองเท่าของ 49 พันล้านพารามิเตอร์ที่ทำงานจริงของ DeepSeek V4 Pro และตัวเลขนี้เพียงตัวเดียวอธิบายช่องว่างราคาสามเท่าระหว่างสองห้องแล็บได้เกือบทั้งหมด ก่อนที่จะมีการทดสอบ benchmark แม้แต่ครั้งเดียว

สองเดิมพันที่แตกต่างกันต่อความเบาบาง

ทั้งสองแล็บสร้างโมเดล sparse mixture-of-experts พวกเขาเห็นไม่ตรงกันอย่างรุนแรงว่าจะ sparse มากน้อยเพียงใด Qwen3.8-Max — เรือธง Qwen ที่วางจำหน่ายแล้ว และเป็น基準ที่เป็นรูปธรรมเพียงหนึ่งเดียวว่าหน้าตาของ Qwen 4 Max จะเป็นอย่างไร — เป็นโมเดลขนาด 2.4 ล้านล้านพารามิเตอร์ที่เปิดใช้งาน 95 พันล้านพารามิเตอร์ต่อโทเค็น คิดเป็นอัตราส่วนประมาณ 1 ต่อ 25 DeepSeek V4 Pro เป็นโมเดลขนาด 1.6 ล้านล้านพารามิเตอร์ที่เปิดใช้งาน 49 พันล้าน คิดเป็นอัตราส่วนประมาณ 1 ต่อ 33 และจัดเก็บน้ำหนัก expert ไว้ใน FP4 โดยปล่อยเลเยอร์ attention, router และ norm ไว้ใน FP8 ซึ่งช่วยลดการประมวลผลต่อโทเค็นลงอีก

นั่นไม่ใช่ความแตกต่างด้านการปรับจูน พวกมันคือสองคำตอบที่แตกต่างกันสำหรับคำถามเดียวกัน — โมเดลระดับแนวหน้าควรใช้จ่ายต่อโทเคนเท่าใด:

• จำนวนพารามิเตอร์ทั้งหมด — Qwen 3.8 รุ่นเรือธง 2.4T เทียบกับ DeepSeek V4 Pro 1.6T

• แอ็กทีฟต่อโทเคน — Qwen 3.8 เรือธง 95B เทียบกับ DeepSeek V4 Pro 49B

• อัตราส่วนการเปิดใช้งาน — ประมาณ 1 ใน 25 เทียบกับประมาณ 1 ใน 33

• ราคาอินพุต ช่วงนอกเวลาเร่งด่วน — Qwen3.8-Max $2.00 ต่อ 1M เทียบกับ DeepSeek V4 Pro $0.66 ต่อ 1M

• ราคาเอาต์พุต ช่วง off-peak — Qwen3.8-Max $6.00 ต่อ 1M เทียบกับ DeepSeek V4 Pro $1.98 ต่อ 1M

• น้ำหนักโมเดลระดับเรือธง — Qwen 3.8 รุ่นเรือธงภายใต้สัญญาอนุญาต Qwen แบบกำหนดเอง เทียบกับ DeepSeek V4 Pro ที่เผยแพร่ภายใต้ MIT

• บริบท — Qwen3.8-Max 1M โทเค็น เทียบกับ DeepSeek V4 Pro 1M โทเค็น

• ประเภทอินพุต — Qwen3.8-Max รองรับข้อความ รูปภาพ และวิดีโอ เทียบกับ DeepSeek V4 Pro ที่เป็นข้อความเท่านั้นตามรายการของตน

• ความหน่วงที่สังเกตได้ — Qwen3.8-Max p50 time-to-first-token 3.29 วินาที เทียบกับ DeepSeek V4 Pro 3.52 วินาที บนแค็ตตาล็อกเดียวกัน

ความแตกต่างด้านความเบาบาง (sparsity) และความแตกต่างด้านราคาชี้ไปในทางเดียวกันในครั้งนี้ ซึ่งไม่ใช่ทิศทางที่จำนวนพารามิเตอร์รวมบ่งชี้ Qwen เปิดใช้งานพารามิเตอร์ต่อโทเคนมากกว่า DeepSeek ประมาณสองเท่า และคิดราคาแพงกว่าประมาณสามเท่า และความเบาบางเพียงอย่างเดียวไม่สามารถปิดช่องว่างนั้นได้ สิ่งที่ปิดช่องว่างที่เหลือคือมอดาลิตี (modality): เรือธงของ Qwen มีตัวเข้ารหัสภาพและวิดีโอติดมาด้วย ซึ่งต้องจ่ายสำหรับสิ่งเหล่านี้ในทุกคำขอไม่ว่าจะมีภาพอยู่ในนั้นหรือไม่ และนั่นคือเหตุผลว่าทำไมอัตราอินพุตจึงอยู่ที่ระดับที่เป็นอยู่ DeepSeek V4 Pro รับข้อความและส่งคืนข้อความ และถูกตั้งราคาเหมือนโมเดลที่ทำเพียงเท่านั้น

มีข้อแม้หนึ่งข้อที่ควรระบุไว้ในคอลัมน์ DeepSeek ก่อนที่จะนำไปใช้กับสิ่งใด ๆ DeepSeek คิดราคาตามตารางแบบพีคและออฟพีค: ตัวเลข $0.66 และ $1.98 เป็นอัตราช่วงออฟพีค และในช่วงเวลาพีค — 01:00 ถึง 04:00 และ 06:00 ถึง 10:00 UTC ในวันธรรมดา ไม่รวมวันหยุดนักขัตฤกษ์ของจีน — โมเดลเดียวกันจะคิดค่าบริการที่ $1.32 สำหรับอินพุต และ $3.96 สำหรับเอาต์พุต ช่วงเวลาอื่นทั้งหมด รวมถึงวันหยุดสุดสัปดาห์และวันหยุดทั้งหมด ถือเป็นช่วงออฟพีค ดังนั้น อัตราที่คุณจ่ายจึงเป็นฟังก์ชันของเวลาที่ทราฟฟิกของคุณทำงาน และโมเดลต้นทุนที่สร้างขึ้นจากตัวเลขออฟพีคเพียงอย่างเดียวจะไม่ถูกต้องสำหรับเวิร์กโหลดใด ๆ ที่มีองค์ประกอบในช่วงเช้าของวันธรรมดา

A two-column scoreboard titled "Qwen 4 Max vs DeepSeek V4 Pro - the scoreboard". Left column Qwen 4 Max: Total parameters 2.4T, Active per token 95B, Input price off-peak $2.00 per 1M tokens, Output price off-peak $6.00 per 1M tokens, Context window 1M tokens, Modality text, image, video in. Right column DeepSeek V4 Pro: Total parameters 1.6T, Active per token 49B, Input price off-peak $0.66 per 1M tokens, Output price off-peak $1.98 per 1M tokens, Context window 1M tokens, Modality text-only. Footer reading "DeepSeek V4 Pro figures from its catalogue listing; Qwen figures from the Qwen3.8-Max model card, September 22 2026.", with the OrcaRouter logo bottom-right.

คอลัมน์ Qwen 4 Max ว่างเปล่า และนั่นไม่ใช่สภาพชั่วคราว

มันน่าดึงดูดใจที่จะเติมการเปรียบเทียบด้วยสมมติฐานว่า Qwen 4 Max จะเปิดตัวใกล้ตัวเลขของ Qwen 3.8 และราคาต่ำกว่านั้น จงต้านทานมัน Alibaba อธิบายสถาปัตยกรรม Qwen 4 ว่าเป็นรุ่นใหม่และกล่าวว่ากำลังเทรนอยู่ อาร์ติแฟกต์ที่เผยแพร่เพียงอย่างเดียวที่อธิบายสถาปัตยกรรมนั้นคือ Qwen3.8-Flash-Next ซึ่งเปิดซอร์สในปลายเดือนสิงหาคม 2026 และติดป้ายบนการ์ดโมเดลของตัวเองว่าเป็นพรีวิวของดีไซน์ Qwen 4 มันเป็นโมเดลหลักขนาด 125 พันล้านพารามิเตอร์ โดยมี 51 พันล้านพารามิเตอร์ของ N-gram embeddings ที่เปิดใช้งานประมาณ 6 พันล้านต่อสเต็ป พร้อมด้วย QSA แอตเทนชันแบบสแปร์ส, เรซิดิวแบบเกต และบริบทเนทีฟ 262,000 โทเคนที่ขยายได้ถึง 1 ล้าน

หากการออกแบบนั้นขยายไปถึงระดับ Max จำนวนที่ใช้งานควรอยู่ในหลักหมื่นล้าน แทนที่จะไต่ขึ้นไปใกล้ยอดรวมของ DeepSeek — การทำให้คอมพิวต์ต่อสเต็ปคงที่โดยประมาณขณะจำนวนพารามิเตอร์รวมเพิ่มขึ้น คือหัวใจทั้งหมดของ QSA และของ N-gram embeddings ที่ถูกค้นหาแบบ lookup แทนที่จะคำนวณแบบหนาแน่น นั่นเป็นทิศทางมากกว่าข้อกำหนด และไม่ควรพิมพ์ออกมาเป็นข้อกำหนด

สิ่งที่สามารถรู้ได้ในตอนนี้คือความไม่สมมาตรในการดำเนินงาน โมเดลที่มีอยู่จริงสามารถวัดผลกับเวิร์กโหลดของคุณได้ ส่วนโมเดลที่ไม่มีอยู่จริงก็ไม่สามารถวัดผลกับสิ่งใดได้เลย Qwen 4 Max สามารถเข้าถึงได้ เมื่อเปิดตัว ผ่าน API ของผู้ขายเองและแพลตฟอร์มบุคคลที่สามหลายแห่ง — เส้นทางเดียวกันกับที่เรือธงทุกรุ่นของ Alibaba ใช้ วันนี้มันยังไม่มีบน OrcaRouter: แคตตาล็อกไม่มีรายการสำหรับตระกูล Qwen 4 เลย ตอนนี้ DeepSeek V4 Pro อยู่บน OrcaRouter แล้ว และสแนปช็อตที่ลงวันที่ของมันก็อยู่ด้วย

ความสามารถในการทำซ้ำคือข้อโต้แย้งที่ไม่มีใครยกขึ้นมา

DeepSeek ออกสแนปช็อตที่ระบุวันที่และทำให้ยังคงเข้าถึงได้ แค็ตตาล็อกมีทั้งตัวระบุ DeepSeek V4 Pro แบบลอยตัว และตัวแปรแบบปักหมุดวันที่ 2026-08-13 โดยวันที่นั้นเป็นบิลด์ที่ DeepSeek เองกำหนดให้เป็นรุ่นที่เปิดให้ใช้งานทั่วไปอย่างเป็นทางการ สิ่งนี้ดูไม่หวือหวาและสำคัญกว่าส่วนต่างของ benchmark สำหรับใครก็ตามที่รันชุดทดสอบประเมินหรือไปป์ไลน์ที่ควบคุมตามข้อกำหนดด้านการปฏิบัติตามกฎ: เมื่อคุณปักหมุดสแนปช็อต ชุดทดสอบการถดถอยของคุณจะวัดโค้ดของคุณเอง ไม่ใช่จังหวะการออกรุ่นของผู้ให้บริการ

รุ่น Qwen 3.8 ก็ทำแบบเดียวกัน — มีสแนปช็อต Qwen3.8-Max ที่ระบุวันที่อยู่ในแค็ตตาล็อกเดียวกัน ควบคู่ไปกับชื่อแบบลอย — และไม่มีเหตุผลที่จะคิดว่า Alibaba จะหยุด แต่มันเป็นคุณสมบัติของโมเดลที่เปิดตัวแล้ว และเป็นเรื่องที่ควรกล่าวอย่างตรงไปตรงมาว่าในวันที่ Qwen 4 Max ถูกประกาศ มันจะไม่มีสแนปช็อตให้ปักหมุด ไม่มีตัวระบุที่เสถียรให้ทดสอบเทียบ และไม่มีวิธีรันการเปรียบเทียบก่อนและหลังบนข้อมูลของคุณเอง ไม่ว่าคุณจะต้องการเปรียบเทียบแบบไหน คุณก็จะได้ทำมันในภายหลัง

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro, English UI), showing the FLAGSHIP badge, the 1M token context badge, the model ID deepseek/deepseek-v4-pro, a 384K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-04-24 credited to DeepSeek, a p50 time-to-first-token of 3.52s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description describing a 1.6T total / 49B active flagship MoE with 1M context and top-tier reasoning and agentic tool use.

รันทั้งคู่โดยไม่ต้องรันสองสแต็ก

OrcaRouter กำหนดเส้นทาง DeepSeek V4 Pro เป็น deepseek/deepseek-v4-pro ในราคา $0.66 สำหรับอินพุต และ $1.98 สำหรับเอาต์พุตต่อล้านโทเค็น ซึ่งเป็นราคาตามรายการช่วงนอกเวลา (off-peak) ของ DeepSeek เองที่ส่งผ่านมาด้วยอัตรากำไร 0% ส่วนหลังนี้มีค่ามากกว่าในที่อื่น ๆ ในชุดนี้ เพราะ $1.98 สำหรับเอาต์พุตนั้นใกล้เคียงกับพื้นราคาของโมเดลระดับแนวหน้าอยู่แล้ว แม้จะเป็นกำไรของแพลตฟอร์มเพียงสิบเปอร์เซ็นต์ ก็ยังคิดเป็นหนึ่งในห้าของส่วนต่างระหว่างโมเดลนี้กับทางเลือกในระดับกลาง และที่อัตรากำไร 0% อัตราที่คุณเห็นบนหน้าก็คืออัตราที่ DeepSeek ประกาศ รวมถึงการแบ่งช่วงพีคและนอกพีค ซึ่งส่งผ่านตามตารางเวลาเดียวกัน แทนที่จะถูกเฉลี่ยให้เป็นอัตราคงที่แบบเดียว

เอนด์พอยต์เดียวกันนี้ให้บริการตระกูล Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27B — เคียงข้างกับ DeepSeek V4 Pro บน API ที่เข้ากันได้กับ OpenAI เพียงหนึ่งเดียวซึ่งมีโมเดลใกล้เคียง 200 รายการ พร้อมระบบ failover อัตโนมัติเมื่อเส้นทางของผู้ให้บริการมีปัญหา และ routing DSL ที่ช่วยให้การเลือกเป็นไปอย่างชัดเจนแทนการฮาร์ดโค้ดไว้ หาก DeepSeek ปรับลดราคา การเปลี่ยนแปลงจะส่งถึงคีย์ของคุณในวันเดียวกัน เพราะไม่มีชั้นมาร์จินให้ส่วนลดไปติดค้างอยู่ เมื่อมีระดับ Qwen 4 เปิดตัว แค็ตตาล็อกเดียวกันนี้ก็คือที่ที่มันจะปรากฏขึ้น

สิ่งนี้ทำให้คุณอยู่ตรงไหน

DeepSeek V4 Pro ชนะการเปรียบเทียบนี้เพราะอีกฝ่ายสละสิทธิ์ และคุ้มค่าที่จะพูดให้ชัดเจนว่าทำไม แทนที่จะปรุงแต่งให้ดูดี มันถูกกว่าในทั้งสองแกนประมาณสามเท่า เปิดใช้งานพารามิเตอร์ต่อโทเคนมากกว่าถึงห้าเท่า หน้าต่างบริบทเท่ากัน และมีสแนปช็อตที่ระบุวันที่ซึ่งคุณปักหมุดได้ ส่วน Qwen 4 Max มีเพียงชื่อระดับและสล็อตในงานประชุม

การเปรียบเทียบที่เกิดขึ้นจริงในตอนนี้คือ DeepSeek V4 Pro กับ Qwen3.8-Max และมันเป็นการแลกหมัดกันจริง ๆ มากกว่าจะเป็นการกวาดล้าง: DeepSeek เป็นโมเดลแบบข้อความล้วนในราคาประมาณหนึ่งในสาม โดยมีเวตเผยแพร่ภายใต้ MIT และมีโปรไฟล์การเปิดใช้งานต่อโทเคนที่เบากว่า ส่วนเรือธงของ Qwen รองรับอินพุตรูปภาพและวิดีโอในราคา $2.00 และ $6.00 ให้เลือกตัดสินจากโมดัลลิตีและต้นทุนที่วัดได้ต่องานที่เสร็จสมบูรณ์ ไม่ใช่จากจำนวนพารามิเตอร์ และให้รันการเปรียบเทียบใหม่เมื่อ Alibaba เผยแพร่โมเดลการ์ด — ซึ่ง ณ จุดนั้น คำถามที่น่าสนใจคือ Qwen 4 Max ตั้งราคาความสามารถมัลติโมดัลของตนสูงกว่าอัตราแบบข้อความของ DeepSeek น้อยกว่าที่เป็นอยู่ในปัจจุบันหรือไม่

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

การเปรียบเทียบในบทความนี้4

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube