DeepSeek V4 Pro วันที่วางจำหน่าย: ถูกกว่า Kimi K3 ถึง 14 เท่าแล้ว แต่ยังไม่ฉลาดเท่า
Guides & Insights

DeepSeek V4 Pro วันที่วางจำหน่าย: ถูกกว่า Kimi K3 ถึง 14 เท่าแล้ว แต่ยังไม่ฉลาดเท่า

ผู้เขียน

Jim Song

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เมื่อวันที่ 31 กรกฎาคม 2026 บริษัทได้เผยแพร่รายการในบันทึกการเปลี่ยนแปลงที่ประกาศว่าโมเดลราคาถูกของตนเอาชนะโมเดลราคาแพงได้ รายการดังกล่าวเกี่ยวกับDeepSeek V4 Flash ซึ่งเป็นรุ่นระดับ 284B ที่เน้นประสิทธิภาพ และคำกล่าวอ้างหลักคือ "ความสามารถด้านเอเจนต์ที่ได้รับการปรับปรุงอย่างมีนัยสำคัญ โดยผลการทดสอบมาตรฐานเหนือกว่า V4-Pro-Preview อย่างมาก" V4-Pro-Preview คือDeepSeek V4 Pro — รุ่นเรือธงที่มีพารามิเตอร์ 1.6 ล้านล้าน ซึ่งมีราคาต่อโทเคนสูงกว่าสามเท่า รายการเดียวกันปิดท้ายด้วยประโยคเดียวเกี่ยวกับมัน: "DeepSeek-V4-Pro เวอร์ชันเต็มจะตามมาในไม่ช้า" ซึ่งเป็นบริบทของกระแสคาดการณ์ที่กำลังแพร่สะพัดอยู่ตอนนี้ว่า เมื่อ V4 Pro ตัวจริงเปิดตัว มันจะมีระดับKimi K3แต่ถูกกว่าสิบเท่า ครึ่งหนึ่งของสิ่งนั้นวัดผลได้แล้ว และมันผิดในทิศทางที่แทบไม่มีใครคาดคิด

หมายเหตุเกี่ยวกับบทความนี้ว่าคืออะไรและไม่ใช่อะไร ไม่มี system card ที่หลุดออกมา ไม่มี benchmark ภายใน ไม่มีวันที่ การคาดการณ์ที่แพร่กระจายอยู่มาจาก @scaling01 บน X — "DeepSeek-V4 Pro จะต้องเป็นอะไรที่เจ๋งมาก อาจจะระดับ Kimi-K3 แต่ถูกกว่า 10 เท่า" — และมันคือการคาดการณ์จากผู้ปฏิบัติงานที่ได้รับความนิยม ไม่ใช่การเปิดเผยจากใครที่เข้าถึงข้อมูล การปฏิบัติต่อมันเหมือนการหลุดคือวิธีที่ทำให้ข่าววันวางจำหน่ายที่ผิดพลาดถูกเขียนขึ้น สิ่งที่เราทำได้แทนคือนำสองส่วนที่ทดสอบได้ของข้อกล่าวอ้างมาตรวจสอบกับตัวเลขที่มีอยู่แล้ว เพราะบิลด์ตัวอย่างถูกเรียกใช้ได้เป็นเวลาสามเดือนแล้ว และทั้งมันและ Kimi K3 ถูกทดสอบโดยแล็บอิสระ ทุกอย่างด้านล่างระบุแหล่งที่มา: เอกสารของบริษัทเอง, การวัดผลของ Artificial Analysis, หรือเลขคณิตที่เราทำเองและแสดงไว้

สิ่งที่ DeepSeek ได้กล่าวจริง และสิ่งที่มันไม่ได้กล่าว

ขอบเขตที่ได้รับการยืนยันนั้นกว้างกว่าที่กรอบ "โมเดลที่ยังไม่เปิดตัว" สื่อให้เห็น V4 Pro ไม่ใช่แค่ข่าวลือ — คุณสามารถเรียกใช้มันได้ในตอนนี้ สิ่งที่ยังไม่เกิดขึ้นคือการเปิดตัวอย่างเป็นทางการตามที่บริษัทเองพิจารณา

สถาปัตยกรรม — โมเดลแบบ mixture-of-experts ที่มีพารามิเตอร์รวม 1.6T และพารามิเตอร์ที่ใช้งานต่อโทเคน 49B ซึ่งได้รับการยืนยันจากบริษัทและระบุเหมือนกันบน Artificial Analysis ว่า 1600B/49B.

บริบทและเอาต์พุต — หน้าต่างอินพุตขนาด 1M โทเคน (1,048,576) พร้อมเอาต์พุตสูงสุด 384K โทเคน รับข้อความเข้า ส่งข้อความออก ไม่รองรับอินพุตรูปภาพ เสียง หรือวิดีโอ

ใบอนุญาตและ weights — MIT โดยมี weights เผยแพร่บน Hugging Face นี่คือโมเดลเรือธงแบบ open-weights ซึ่งเป็นเหตุผลทั้งหมดที่ทำให้การเปรียบเทียบกับ Kimi K3 น่าสนใจ

ราคาป้าย — $0.435 ต่อล้านโทเคนอินพุตเมื่อไม่พบในแคช, $0.003625 เมื่อพบในแคช และ $0.87 ต่อล้านโทเคนเอาต์พุต จากหน้าข้อมูลราคาของบริษัทเอง

อินเทอร์เฟซ — เอนด์พอยต์แบบ ChatCompletions สไตล์ OpenAI และรูปแบบ Anthropic พร้อมระดับการใช้เหตุผล การเรียกใช้เครื่องมือ และเอาต์พุตแบบมีโครงสร้าง

ไทม์ไลน์จนถึงตอนนี้ — ตระกูล V4 เปิดตัวเป็นพรีวิวเมื่อวันที่ 24 เมษายน 2026; ชื่อโมเดลรุ่นเก่า deepseek-chat และ deepseek-reasoner ถูกยกเลิกเมื่อวันที่ 24 กรกฎาคม 2026; Flash ได้รับเวอร์ชันทางการเมื่อวันที่ 31 กรกฎาคม 2026; Pro ไม่ได้.

6 สิงหาคม 2026DeepSeek แจ้งนักพัฒนาว่ามีแผนจะปรับขึ้นราคาโดยรวมของบริการ DeepSeek API "ในอนาคตอันใกล้นี้ โดยคาดว่าราคาจะเพิ่มขึ้นอย่างมีนัยสำคัญ," และย้ำว่าการเปิดตัว V4 Pro อย่างเป็นทางการจะตามมา ยังไม่มีการประกาศอัตราใหม่หรือวันที่มีผลบังคับใช้

และส่วนที่ยังไม่เป็นที่รู้จักอย่างแท้จริง ซึ่งเป็นสิ่งที่ผู้คนส่วนใหญ่กำลังค้นหา:

วันที่ GA — ยังไม่มีการประกาศ "จะประกาศในเร็วๆ นี้" ยังคงเป็นคำมั่นสัญญาอย่างเป็นทางการทั้งหมดของบริษัท รายงานจากสื่อที่ยังไม่ได้รับการยืนยันชี้ไปที่ช่วงกลางเดือนสิงหาคม — สื่อหนึ่งรายระบุช่วงวันที่ 10–20 สิงหาคม และหน้าราคาของผู้จัดจำหน่ายรายหนึ่งได้ปรับราคาแคช V4 Pro เมื่อวันที่ 3 สิงหาคม ในรูปแบบที่ในอดีตมักเกิดขึ้นก่อนการเปิดตัว — แต่ไม่มีสิ่งใดที่กล่าวมาคือบริษัทเป็นผู้พูด ยังไม่มีการยืนยันวันที่ใดๆ

สิ่งที่ GA build จะเปลี่ยนแปลง — ไม่มีการระบุ บริษัทไม่ได้กล่าวว่า V4 Pro อย่างเป็นทางการคือการ re-post-train จาก weights ชุดเดียวกัน การ pretrain ใหม่ หรือการตั้งราคาใหม่

ไม่ว่าราคาจะรอดผ่านมันไปได้หรือไม่ — ยังไม่ได้รับการกล่าวถึง และมีเหตุผลเฉพาะเจาะจงที่ต้องกังวลเกี่ยวกับเรื่องนี้ ซึ่งเราจะกล่าวถึงด้านล่าง

ข้อควรแก้ไขหนึ่งข้อที่ควรกล่าวไว้อย่างชัดเจน เนื่องจากผลการค้นหาสำหรับคำถามนี้ปนเปื้อน: คุณจะพบหน้าต่างๆ ที่อ้างว่าตระกูล V4 เปิดให้ใช้งานทั่วไปเมื่อวันที่ 20 กรกฎาคม 2026 แต่บันทึกการเปลี่ยนแปลงของบริษัทเอง ซึ่งออกหลังวันนั้นสิบเอ็ดวัน ระบุว่าการเปิดตัว V4 Pro อย่างเป็นทางการยังอยู่ในระหว่างรอ และเพิ่มเติมว่าการอัปเดตวันที่ 31 กรกฎาคม "อัปเกรดเฉพาะ DeepSeek-V4-Flash API เท่านั้น ส่วน DeepSeek-V4-Pro API และโมเดลใน APP/WEB ไม่มีการเปลี่ยนแปลง" เมื่อบทสรุปจากบุคคลที่สามกับบันทึกการเปลี่ยนแปลงหลักของผู้ขายขัดแย้งกัน ให้ยึดบันทึกการเปลี่ยนแปลงเป็นหลัก

ข้อกล่าวอ้างเรื่องราคาที่ว่า "ถูกกว่า 10 เท่า" คือการตีความแบบอนุรักษ์นิยม

Kimi K3 มีราคา $3.00 ต่อล้านโทเคนอินพุต และ $15.00 ต่อล้านเอาต์พุต โดยการเข้าถึง cache อยู่ที่ $0.30 ส่วน V4 Pro มีราคา $0.435 และ $0.87 โดย cache hits อยู่ที่ $0.003625 ลองเทียบกันดูแล้ว "10x" กลับเป็นค่าต่ำสุดของช่วง ไม่ใช่ตัวเลขหลัก:

โทเคนอินพุต — $3.00 เทียบกับ $0.435 ดังนั้น V4 Pro จึงถูกกว่า 6.9 เท่า นี่คือมิติเดียวที่การกล่าวอ้างนี้เกินจริง

โทเคนเอาต์พุต — $15.00 เทียบกับ $0.87 หรือถูกกว่า 17.2 เท่า โมเดลเชิงเหตุผลใช้จ่ายไปกับเอาต์พุต ซึ่งทำให้ตัวเลขนี้สำคัญที่สุด

ส่วนผสมอินพุต-เอาต์พุต 70/30 — $6.60 ต่อล้าน เทียบกับ $0.5655 หรือ 11.7 เท่า

ส่วนผสม cache-hit/input/output อัตราส่วน 7:2:1 ของ Artificial Analysis — $2.31 เทียบกับ $0.18 หรือ 12.8 เท่า

อินพุตแบบแคช — $0.30 เทียบกับ $0.003625 หรือประมาณ 83 เท่า ราคาการอ่านแคชของบริษัทอยู่ในอันดับที่ 4 จาก 101 โมเดลที่ Artificial Analysis ติดตาม ซึ่งคิดเป็นส่วนลด 99% จากอัตราการพลาดแคชของตัวเอง

การผสมแบบสมมุติอาจเป็นที่โต้แย้งได้ ดังนั้นนี่คือการวัดที่เกิดขึ้นจริง Artificial Analysis เผยแพร่ค่าใช้จ่ายที่แท้จริงที่ใช้ในการรัน Intelligence Index เต็มรูปแบบสำหรับแต่ละโมเดล — ชุดการประเมินเดียวกัน ระบบเดียวกัน จำนวนโทเค็นจริง ไม่ใช่อัตราส่วนที่สมมุติขึ้น Kimi K3 มีค่าใช้จ่ายในการประเมิน $2,437.41 ส่วน V4 Pro มีค่าใช้จ่าย $176.34 นั่นคือ 13.8 เท่า บนปริมาณงานที่เหมือนกัน ในหน่วยดอลลาร์ที่ใครบางคนจ่ายจริง

สิ่งที่ทำให้ตัวเลขนั้นต่ำกว่าอัตราส่วนเอาต์พุตต่อราคา 17.2 เท่านั้นเป็นเรื่องที่ควรทำความเข้าใจ เพราะมันคือจุดเดียวที่ความถูกของ V4 Pro เกิดจากฝีมือของตัวเองบางส่วน V4 Pro เป็นโมเดลที่พูดมาก: มันใช้โทเคนเอาต์พุต 180M เพื่อฝ่าด่านดัชนี ขณะที่ Kimi K3 ใช้ 130M และค่ามัธยฐานของโมเดลในคลาสเดียวกันอยู่ที่ 100M ดังนั้นมันใช้โทเคนเพิ่มขึ้นราว 38% ในการพูดสิ่งที่ต้องการสื่อ ซึ่งกัดกร่อนความได้เปรียบต่อโทเคน ตัวเลข 13.8 เท่าได้รวมปัจจัยนี้ไว้ในการคิดแล้ว ส่วนตัวเลข 17.2 เท่ายังไม่ได้รวม หากคุณกำลังวางงบประมาณ ให้ใช้ตัวเลขที่วัดได้จริง

นี่คือส่วนหนึ่งของเรื่องราวที่คุณสามารถตรวจสอบได้ด้วยตัวเอง แทนที่จะต้องเชื่อตามที่บอก เพราะ OrcaRouter ส่งต่อราคารายการของผู้ให้บริการโดยตรงที่มาร์กอัป 0% ตัวเลขต่อโทเคนบนหน้าโมเดล deepseek/deepseek-v4-pro และ kimi/kimi-k3 ของเราจึงเป็นราคาของผู้ให้บริการทั้งสองเอง — K3 แสดง $3.00/$15.00 บนหน้าของเรา และ $3.00/$15.00 บนหน้าของ Moonshot — ไม่ใช่อัตราการขายต่อที่มีส่วนต่างซ่อนอยู่ — ซึ่งหมายความว่าการคำนวณข้างต้นสามารถเกิดขึ้นซ้ำได้ในบิลเดียว และหากผู้ให้บริการรายใดรายหนึ่งปรับราคา การเปลี่ยนแปลงจะถึงฝั่งเราในวันเดียวกัน ไม่ใช่หลังจากรอบสัญญา

ข้ออ้างเรื่องความฉลาด: 13 คะแนน ไม่ใช่ความเท่าเทียม

"ระดับ Kimi K3" คือครึ่งหนึ่งของการคาดการณ์ที่ไม่รอดพ้นจากการปะทะกับตัวเลขปัจจุบัน บนดัชนี Intelligence Index ของ Artificial Analysis ณ วันที่ 5 สิงหาคม 2026 Kimi K3 ได้ 57 คะแนน ส่วน DeepSeek V4 Pro (โหมด reasoning, ความพยายามสูงสุด) ได้ 44 คะแนน — อยู่อันดับที่ 6 จาก 101 โมเดล ซึ่งเป็นการจัดอันดับที่แข็งแกร่งอย่างแท้จริง แต่ยังห่างอยู่ 13 คะแนน ทั้งสองถูกวัดโดยห้องแล็บเดียวกันบนตัวชี้วัดรวมเดียวกัน ทั้งในโหมดการใช้เหตุผลสูงสุด และทั้งคู่ทดสอบกับบริบท 1M โทเคน

เกณฑ์วัดจากผู้ขายบอกเล่าเรื่องราวที่แตกต่างและดูดีกว่า ซึ่งเป็นเหตุผลว่าทำไมจึงต้องมีการติดฉลาก บริษัทรายงานผลของ V4 Pro-Preview ที่ 80.6% บน SWE-bench Verified และ 90.1% บน GPQA Diamond Moonshot รายงานผลของ Kimi K3 ที่ 76.8% บน SWE-bench Verified และ 93.5% บน GPQA Diamond ถ้าถือตามที่เห็นตรงๆ V4 Pro ชนะการวัดประสิทธิภาพด้านการเขียนโค้ดอย่างขาดลอย ไม่มีชุดผลลัพธ์ชุดใดได้รับการทำซ้ำโดยอิสระ พวกมันถูกสร้างขึ้นบนชุดทดสอบที่แตกต่างกัน โดยทีมที่มีส่วนได้ส่วนเสียในผลลัพธ์ และในการทดสอบรวมเพียงครั้งเดียวที่บุคคลที่สามเป็นผู้รันทั้งสองโมเดลด้วยตัวเอง ลำดับการจัดอันดับกลับตรงกันข้าม นั่นคือเหตุผลทั้งหมดที่ทำให้ไม่ควรเชื่อถือการเปรียบเทียบจากเกณฑ์วัดเพียงค่าเดียวระหว่างผู้จำหน่าย

สองสิ่งเกี่ยวกับค่าดัชนีสมควรได้รับข้อควรระวังในตัวของมันเอง ประการแรก หากคุณพบงานเขียนเก่าที่อ้างว่า V4 Pro ได้ 52 แทนที่จะเป็น 44 พวกเขาไม่ได้ผิด — บทความเปิดตัวเดือนเมษายนของ Artificial Analysis เองก็ให้ V4 Pro (Max) อยู่ที่ 52 และเรียกมันว่าโมเดลให้เหตุผลแบบ open-weights อันดับ #2 ดัชนีมีการปรับปรุงแก้ไข และการแก้ไขแต่ละครั้งก็เลื่อนคะแนนของทุกโมเดล กฎในทางปฏิบัติคือ มีเพียงการเปรียบเทียบจาก snapshot เดียวกันเท่านั้นที่มีความหมาย คะแนน 52 จากเดือนเมษายนกับ 57 จากเดือนสิงหาคมไม่ควรอยู่ในประโยคเดียวกัน ประการที่สอง หน้าของ Artificial Analysis ระบุวันที่ "เผยแพร่เมษายน 2026" และไม่ได้แยกความแตกต่างระหว่างบิลด์พรีวิวกับเวอร์ชันทางการในอนาคต ดังนั้นคะแนน 44 ของมันจึงเป็นค่าที่วัดได้จากสิ่งที่ endpoint ให้บริการ ไม่ว่าจะทดสอบเมื่อใดก็ตาม

จุดที่ V4 Pro ชนะ Kimi K3 อย่างชัดเจนคือในด้านที่ไม่ใช่ความฉลาด มันสร้าง 66.5 โทเคนต่อวินาที เทียบกับ 37.6 ของ K3 ในคลาสที่มีค่ามัธยฐานอยู่ที่ 65.9 — ดังนั้น V4 Pro จึงอยู่ในระดับประมาณค่าเฉลี่ยของคลาสมัน และ Kimi K3 ช้าผิดปกติ เวลาจนถึงโทเคนแรกคือ 1.61 วินาที เทียบกับ 2.85 สำหรับลูปเอเจนต์แบบอินเทอร์แอกทีฟ ความแตกต่างนี้รู้สึกได้ในทุกเทิร์น และมันเป็นข้อโต้แย้งที่แข็งแกร่งที่สุดสำหรับบิลด์พรีวิวในสถานะปัจจุบัน

สิ่งที่บิลด์อย่างเป็นทางการของ Flash บอกเราเกี่ยวกับ Pro

นี่คือสิ่งที่ใกล้เคียงกับหลักฐานจริงที่สุดเกี่ยวกับโมเดลที่ยังไม่ได้เปิดตัว และมันมาจากคู่หูที่ผ่านกระบวนการนั้นมาแล้ว

บริษัทระบุในบันทึกการเปลี่ยนแปลงวันที่ 31 กรกฎาคมว่า "DeepSeek-V4-Flash-0731 ยังคงสถาปัตยกรรมโมเดลและขนาดเท่าเดิมกับ DeepSeek-V4-Flash-Preview และถูกนำมา post-train ใหม่เท่านั้น" จำนวน weights เท่าเดิม สถาปัตยกรรมเท่าเดิม ราคาเท่าเดิม — มีเพียง post-training เท่านั้นที่เปลี่ยนไป Artificial Analysis ให้คะแนนผลลัพธ์ที่ 50 เทียบกับ 40 ของ Flash เวอร์ชันก่อนหน้า คะแนนรวมเพิ่มขึ้นสิบจุด จากการ post-training เพียงอย่างเดียว โดยไม่มีค่าใช้จ่ายเพิ่มต่อ token อีกทั้งปริมาณการใช้ output-token บนดัชนีก็ลดลง 12% จาก ~234M เป็น ~206M ส่งผลให้ต้นทุนการรันถูกลงในราคาลิสต์เดียวกัน

จงนำแบบอย่างนั้นไปใช้กับ Pro แล้วเลขคณิตก็หลีกเลี่ยงไม่ได้: 44 บวก 10 เป็น 54 Kimi K3 อยู่ที่ 57 ถึงแม้ว่า V4 Pro อย่างเป็นทางการจะทำซ้ำการอัปเกรดหลังการเทรนที่ประสบความสำเร็จที่สุดเพียงครั้งเดียวที่บริษัทเคยสาธิตต่อสาธารณะ มันก็ยังได้ผลลัพธ์ต่ำกว่าระดับ "Kimi K3 level" อยู่ประมาณสามจุด — ในขณะที่ต้นทุนการรันถูกกว่าประมาณหนึ่งในสิบสี่ นั่นเป็นผลลัพธ์ที่โดดเด่น และไม่ใช่ผลลัพธ์ที่การคาดการณ์ทำนายไว้

ข้อแม้ที่ตรงไปตรงมาเกี่ยวกับการอนุมานดังกล่าว ซึ่งเป็นเพียงการคำนวณทางเลขคณิต มิใช่การพยากรณ์: การเพิ่มขึ้น +10 บนโมเดล 284B บอกอะไรได้น้อยมากเกี่ยวกับสิ่งที่มีบนโมเดล 1.6T และส่วนเหลื่อมอาจใหญ่กว่านั้นหรือเล็กกว่านั้นมากก็ได้ บริษัทยังไม่ได้กล่าวว่า Pro build จะเป็นการ post-training เพียงอย่างเดียว และดัชนีนี้เป็นดัชนีรวม ดังนั้นสามจุดอาจมาจากเกณฑ์วัดเดียว เหตุผลที่ยังคงคำนวณตัวเลขนี้อยู่ก็เพราะมันเป็นเพียงแบบอย่างเดียวที่ผ่านการวัดเชิงปริมาณและได้รับการยืนยันจากผู้ผลิตซึ่งมีอยู่จริง และมันมีน้ำหนักมากกว่าสิ่งที่การพยากรณ์นี้ต้องพึ่งพาเป็นอย่างมาก

รายละเอียดอีกหนึ่งอย่างจากบันทึกการเปลี่ยนแปลงนั้นสมควรได้รับการชี้ให้เห็นมากกว่าจะพูดซ้ำ: คะแนน agentic ของ Flash ถูกสร้างขึ้นโดยใช้{{1}}โหมด Harness minimal ของบริษัท ({{2}}ซึ่งจะเปิดตัวเร็วๆ นี้{{/2}}){{/1}} ที่ระดับความพยายามสูงสุด topp=0.95 temperature=1.0 Harness ที่สร้างตัวเลขเหล่านี้ยังไม่ได้รับการเผยแพร่สู่สาธารณะ — มันเข้าสู่{{3}}การทดสอบแบบปิด{{/3}} {{4}}ในต้นเดือนสิงหาคม{{/4}} — ดังนั้นตัวเลขเหล่านั้นจึงยังไม่สามารถทำซ้ำได้โดยใครก็ตามนอกบริษัท {{5}}แม้ในหลักการแล้ว{{/5}} ไม่ใช่เพราะตัวเลขผิด แต่เป็นเพราะเครื่องมือนี้ยังไม่พร้อมใช้งาน คาดว่าการเปิดตัว Pro จะมาพร้อมกับ{{6}}เครื่องหมายดอกจันเดียวกัน{{/6}}

ข้อกำหนดที่อาจหักล้างทฤษฎีแบบจำลองต้นทุนต่ำ

ในเอกสารการกำหนดราคาของบริษัท มีนโยบายหนึ่งซุกซ่อนอยู่ ซึ่งแทบไม่มีรายงานใดเกี่ยวกับราคาของ V4 line กล่าวถึง ตามคำกล่าวของบริษัท API "จะนำมาใช้ในเร็วๆ นี้" ตามกำหนดการที่ว่า "ในช่วงชั่วโมงเร่งด่วน ราคาจะคิดเป็น 2 เท่าของราคาปกติ โดยใช้กับรายการเรียกเก็บเงินทุกรายการ" ชั่วโมงเร่งด่วนถูกกำหนดเป็น 09:00–12:00 และ 14:00–18:00 ตามเวลากรุงปักกิ่ง ทุกวัน — รวมเป็นเจ็ดชั่วโมงต่อวันทุกวัน วันที่เริ่มมีผลบังคับใช้ "ขึ้นอยู่กับประกาศอย่างเป็นทางการ" และ ณ เวลาที่เขียนนี้ ค่าธรรมเนียมเพิ่มเติมยังไม่มีผลบังคับใช้

สังเกตทิศทาง บริษัทเคยให้แบบนอกช่วงเวลาเร่งด่วนของส่วนลดบน V3 และ R1; นี่คือแบบช่วงเร่งด่วนของค่าธรรมเนียมเพิ่มบนอัตรามาตรฐาน. หากเปิดใช้งานที่ตัวคูณที่ระบุ ราคาในเวลากลางวันของ V4 Pro จะกลายเป็น $0.87 สำหรับขาเข้าและ $1.74 สำหรับขาออก และการเปรียบเทียบจะเปลี่ยนรูปร่าง: ความได้เปรียบแบบผสม 11.7x เหนือ Kimi K3 ลดลงเหลือ 5.8x และที่วัดได้ 13.8x ลดลงเหลือ 6.9x ยังถูกอยู่ ไม่ใช่ "ถูกกว่า 10 เท่า" อีกต่อไป และไม่ถูกในช่วงเวลาที่ทีมยุโรปหรือเอเชียทำงานจริง

ในวันที่ 6 สิงหาคม ข่าวใหญ่ก็ประกาศออกมา DeepSeek ประกาศบนแพลตฟอร์มนักพัฒนาว่าบริษัทวางแผนจะปรับขึ้นราคาโดยรวมของบริการ API ของ DeepSeek "ในอนาคตอันใกล้ โดยคาดว่าจะเพิ่มขึ้นอย่างมีนัยสำคัญ" ยังไม่มีการเผยแพร่อัตราใหม่หรือวันที่มีผลบังคับใช้ และบริษัทไม่ได้ระบุว่าการปรับขึ้นนี้แยกจากการคิดค่าบริการช่วงชั่วโมงเร่งด่วนหรือจะมีผลไปพร้อมกัน สื่อที่รายงานข่าวของบริษัทอ่านประกาศนี้เป็นสัญญาณว่าการเปิดตัว V4 Pro อย่างเป็นทางการใกล้เข้ามาแล้ว — แฟลกชิปที่ยังไม่ได้เปิดตัวไม่ใช่สิ่งที่คุณจะตั้งราคาเชิงรุกในระบบส่วนลดที่คุณกำลังจะเลิกใช้ ใครก็ตามที่กำลังสร้างแบบจำลองต้นทุนบน V4 Pro ในวันนี้ควรจำลองทั้งสองกรณีไว้ และใครก็ตามที่อ่านพาดหัวข่าวแบบ "บริษัทถูกกว่า 14 เท่า" — รวมถึงบทความนี้ — ควรรู้ว่ามันอธิบายรายการราคาที่มีเงื่อนไขการหมดอายุที่ประกาศไว้แล้วแนบอยู่ นี่คือหนทางที่เป็นไปได้มากที่สุดที่ส่วนราคาของการคาดการณ์จะไม่เป็นจริงอีกต่อไป และมันไม่เกี่ยวกับตัวโมเดลเลย

วิธีที่คุณจะรู้ว่าบิลด์อย่างเป็นทางการได้ออกมาแล้ว

มีรายละเอียดในวิธีการจัดส่งของบริษัทที่มีความสำคัญมากกว่าวันที่ และเป็นอันตรายในการปฏิบัติงานอย่างแท้จริง

ไอดีโมเดล API คือ deepseek-v4-pro ไม่ใช่ deepseek-v4-pro-preview และไม่ใช่สตริงบิลด์ที่ระบุวันที่ — แม้ว่าบันทึกการเปลี่ยนแปลงของบริษัทเองจะเรียกบิลด์ปัจจุบันว่า V4-Pro-Preview และเรียกบิลด์ Flash ที่เผยแพร่ว่า V4-Flash-0731 เมื่อ Flash เปิดตัวอย่างเป็นทางการ คำแนะนำคือ: "วิธีการเรียก API ยังคงไม่เปลี่ยนแปลง — เพียงแค่ตั้งชื่อโมเดลเป็น deepseek-v4-flash เพื่อใช้เวอร์ชันล่าสุด" กล่าวอีกนัยหนึ่ง การล็อกไอดีโมเดลไม่ได้ล็อกบิลด์ สตริงเดียวกันเริ่มให้บริการชุดน้ำหนักที่แตกต่างกันอย่างเงียบ ๆ โดยมีพฤติกรรมที่แตกต่างอย่างมีนัยสำคัญและมีคะแนนดัชนีเพิ่มขึ้นอีกสิบจุด

ดังนั้น คำตอบเชิงปฏิบัติสำหรับคำถามที่ว่า "V4 Pro เปิดตัวเมื่อไหร่" ก็คือ ถ้าคุณกำลังเรียกใช้ deepseek-v4-proในสภาพแวดล้อม production คุณอาจรู้ได้จากการสังเกตว่าผลลัพธ์ของคุณเองเปลี่ยนแปลงไป กล่าวโดยละเอียด สิ่งที่ต้องจับตาดูคือ: รายการใหม่พร้อมวันที่ในบันทึกการเปลี่ยนแปลง API ของบริษัท ซึ่งเป็นจุดที่การเปิดตัวของ Flash ปรากฏเป็นครั้งแรก; คำต่อท้ายบิลด์ เช่น V4-Pro-0731ในเนื้อหาของรายการนั้น แม้ไอดีสำหรับเรียกใช้จะยังคงเป็นชื่อเดิมโดยไม่มีคำต่อท้าย; การให้คะแนนใหม่บนหน้า V4 Pro ของ Artificial Analysis ซึ่งเป็นการยืนยันจากภายนอกครั้งแรกที่คุณจะได้รับ; การปรับขึ้นราคาที่ประกาศไว้กลายเป็นอัตราจริง เนื่องจากช่วง GA เป็นจังหวะธรรมชาติที่ทั้งการปรับขึ้นราคาและตารางชั่วโมงเร่งด่วนจะถูกนำมาใช้; และ Responses API ของบริษัท ซึ่งเอกสารระบุว่าการรองรับ deepseek-v4-pro มีแผนจะเปิดตัวในต้นเดือนสิงหาคม — การที่โมเดลหายไปจากรายการ "planned" และไปปรากฏในรายการ supported ถือเป็นสัญญาณการเปิดตัวอย่างเป็นทางการที่ใกล้เคียงที่สุดเท่าที่บริษัทจะเผยแพร่ สัญญาณสองอย่างที่เรายืนยันไม่ได้แต่ก็ควรรับรู้ไว้: หน้าราคาของตัวแทนจำหน่ายรายหนึ่งขยับราคาแคชของ V4 Pro เมื่อวันที่ 3 สิงหาคม ในรูปแบบที่ในอดีตมักเกิดขึ้นก่อนการเปิดตัว และชุดเครื่องมือประเมินผลภายในของบริษัทอยู่ในช่วง closed beta ซึ่งหมายความว่าเกณฑ์มาตรฐานของผู้ให้บริการอาจตรวจสอบได้ในที่สุดเมื่อมันเปิดให้ใช้งาน สตริงที่มีลักษณะคล้าย deepseek-v4-pro-202606ก็ถูกเผยแพร่ต่อๆ กันในฐานะตัวระบุบิลด์ที่หลุดออกมา เราไม่สามารถตรวจสอบยืนยันกับแหล่งข้อมูลใดๆ ของบริษัทได้ และไม่ควรให้น้ำหนักกับมันจนกว่าจะมีใครสักคนตรวจสอบได้

วันนี้คุณควรสร้างบนพรีวิวหรือไม่?

สำหรับคนส่วนใหญ่ที่ประเมินโมเดลนี้ วันวางจำหน่ายไม่ใช่คำถามที่ถูกต้อง เวอร์ชันพรีวิวเรียกใช้งานได้ ตั้งราคาไว้แล้ว ใช้ใบอนุญาต MIT และผ่านการวัดผลอย่างอิสระอยู่ที่อันดับ #6 จาก 101 ด้านความฉลาด คำถามที่แท้จริงคือ GA ที่จะออกมาจะส่งผลอย่างไรกับงานที่คุณสร้างในตอนนี้ ซึ่งมีคำตอบที่แตกต่างกันสองข้อ

ถ้าคุณกำลังเลือกระหว่าง V4 Pro กับ Kimi K3 ในด้านความสามารถ หลักฐานในปัจจุบันบ่งชี้ว่า Kimi K3 ชนะคะแนนรวมอยู่ 13 แต้ม ขณะที่ V4 Pro ชนะในด้านความเร็ว latency และต้นทุนอย่างขาดลอย — และการอัปเกรดหลังการฝึก (post-training) ที่กำลังจะมาอาจทำให้ช่องว่างด้านความฉลาดแคบลง แต่ไม่ถึงกับปิดช่องว่างนั้น ถ้างานของคุณอยู่ในระดับแนวหน้าของการให้เหตุผลที่ซับซ้อน 13 แต้มนั้นคือทุกสิ่งทุกอย่าง และเรื่องราคาเป็นเพียงสิ่งรบกวนสมาธิ แต่ถ้างานของคุณมีปริมาณสูงและเพียงแค่ยาก การจ่ายแพงกว่า 14 เท่าเพื่อสิ่งนี้นั้นก็ยากที่จะมีเหตุผลรองรับ

หากคุณเลือก V4 Pro ไว้แล้ว ความเสี่ยงที่ต้องจัดการไม่ใช่วันวางจำหน่าย แต่คือการสลับอย่างเงียบ ๆ: บิลด์ที่อยู่เบื้องหลังไอดีโมเดลนั้นจะเปลี่ยนไปภายใต้คุณ เช่นเดียวกับที่ Flash เคยเป็น และอีวาลของคุณควรจะตรวจจับมันได้ เก็บชุด regression ที่รันซ้ำได้ตามต้องการ และเก็บโมเดลที่สองไว้ให้เข้าถึงได้โดยไม่ต้องแก้โค้ด นี่คือเหตุผลธรรมดาสามัญที่เราสร้าง failover ในแบบที่เราทำ — V4 Pro, V4 Flash และ Kimi K3 ทั้งหมดอยู่เบื้องหลังคีย์ OrcaRouter เดียวบนเอนด์พอยต์ที่เข้ากันได้กับ OpenAI ดังนั้น "รันอีวาลซ้ำทั้งสามตัว แล้วค่อยย้ายทราฟฟิก" คือการแก้ไขคอนฟิก ไม่ใช่การจัดซื้อจัดจ้าง และบิลด์ GA ที่ไม่ดีคือการตัดสินใจเรื่องการจัดเส้นทาง ไม่ใช่อินซิเดนต์ การลองแฟลกชิปที่ยังไม่พิสูจน์นั้นง่ายกว่ามากเมื่อการพลิกกลับตัวเลือกนั้นไม่เสียค่าใช้จ่าย

คำถามที่ผู้คนกำลังถามจริงๆ

DeepSeek V4 Pro เปิดตัวหรือยัง?

ทั้งสองอย่าง ขึ้นอยู่กับว่าคุณหมายถึงอะไร ซึ่งเป็นเหตุผลที่ผลการค้นหาขัดแย้งกัน โมเดลดังกล่าวเปิดให้เรียกใช้งานต่อสาธารณะได้ตั้งแต่วันที่เปิดตัวเวอร์ชันพรีวิว V4 เมื่อวันที่ 24 เมษายน 2026 โดยมีการเผยแพร่ราคา โอเพนเวทภายใต้สัญญาอนุญาต MIT และการรายงานผลวัดประสิทธิภาพจากหน่วยงานอิสระ แต่บันทึกการเปลี่ยนแปลงของบริษัทเองลงวันที่ 31 กรกฎาคม 2026 ระบุอย่างชัดเจนว่า V4 Pro API "ไม่มีการเปลี่ยนแปลง" และการเปิดตัวอย่างเป็นทางการ "จะตามมาในไม่ช้า" และในวันที่ 6 สิงหาคม DeepSeek กล่าวอีกครั้งว่าเวอร์ชันอย่างเป็นทางการจะปล่อยออกมาโดยเร็วที่สุด พร้อมกับประกาศการขึ้นราคา API ครั้งใหญ่ ดังนั้น: ใช้งานได้แล้วแต่ยังไม่เป็นทางการ ยังไม่มีการยืนยันวันที่ รายงานที่ไม่ได้รับการยืนยันบ่งชี้ถึงกลางเดือนสิงหาคม ซึ่งจะทำให้การรอคอยไม่นานนัก

เวอร์ชันทางการจะทำให้มันดีเท่ากับ Kimi K3 ไหม?

จากแบบอย่างเชิงปริมาณเดียวที่มีอยู่ คงไม่ค่อยถึงขนาดนั้น บิลด์อย่างเป็นทางการของ Flash ได้คะแนนเพิ่มขึ้น 10 คะแนนในดัชนีปัญญาประดิษฐ์ของ Artificial Analysis จากการปรับแต่งหลังการฝึกเพียงอย่างเดียว โดย V4 Pro อยู่ที่ 44 และ Kimi K3 อยู่ที่ 57 ดังนั้นหากเพิ่มเท่าเดิมจะได้ 54 การคาดการณ์นั้นอาจผิดได้ทั้งสองทาง — โมเดล 1.6T อาจมีพื้นที่ในการปรับปรุงแตกต่างจากรุ่น 284B และบริษัทยังไม่ได้ระบุว่าการเปิดตัว Pro จะเป็นการปรับแต่งหลังการฝึกเท่านั้น แต่ใครก็ตามที่ยืนยันความเท่าเทียมกันในวันนี้ กำลังยืนยันสิ่งที่ไม่มีงานวัดที่เผยแพร่ฉบับใดสนับสนุน

ทำไมโมเดลราคาถูกของ DeepSeek ถึงได้คะแนนสูงกว่ารุ่นเรือธงในตอนนี้?

เนื่องจากลำดับการเผยแพร่ ไม่ใช่เพราะ Flash เป็นโมเดลที่ดีกว่า Flash ได้รับการอัปเกรดหลังการเทรน (post-training) เมื่อวันที่ 31 กรกฎาคม ซึ่งทำให้คะแนนบนดัชนีเพิ่มขึ้นจาก 40 เป็น 50 ในขณะที่ Pro ยังไม่ได้รับการอัปเกรดในลักษณะเดียวกัน จึงยังคงถูกวัดจาก post-training ของเดือนเมษายน ทางบริษัทเองก็พูดเช่นนั้น โดยระบุว่าผลลัพธ์เชิง agentic ของ Flash-0731 "เหนือกว่า V4-Pro-Preview อย่างมาก" การสลับตำแหน่งนี้เป็นเพียงภาพชั่วขณะของการเปิดตัวที่ยังไม่เสร็จสิ้น และการปล่อย Pro ที่กำลังจะมาถึงคือสิ่งที่ยุติเรื่องนี้ได้อย่างแท้จริง

ราคา $0.435 / $0.87 ปลอดภัยที่จะใช้สร้างแบบจำลองต้นทุนหรือไม่?

ตามเงื่อนไข และปลอดภัยน้อยกว่าเมื่อสัปดาห์ก่อน เป็นราคารายการที่บริษัทเผยแพร่ในปัจจุบัน และสะท้อนการลดลงถาวรครั้งใหญ่จากอัตราเปิดตัว V4 แล้ว แต่เมื่อวันที่ 6 สิงหาคม DeepSeek ประกาศว่าจะขึ้นราคา API โดยรวม "คาดว่าจะเพิ่มขึ้นอย่างมีนัยสำคัญ" และยังไม่มีการเผยแพร่อัตราหรือวันที่ใหม่ — นอกเหนือจากนโยบายช่วงเวลาพีคที่ประกาศแต่ยังไม่เริ่มใช้ ซึ่งจะทำให้รายการเรียกเก็บเงินทั้งหมดเป็นสองเท่าเป็นเวลาเจ็ดชั่วโมงต่อวัน จำลองทั้งสองสถานการณ์ และโปรดทราบว่าแม้ในกรณีที่เพิ่มเป็นสองเท่าก็ยังถูกกว่า Kimi K3 ประมาณ 6 เท่า

การอ่านอย่างตรงไปตรงมา

การคาดการณ์ที่เริ่มต้นเรื่องนี้ถูกเพียงครึ่งเดียว และครึ่งที่ถูกนั้นเป็นส่วนที่คนจะเชื่อยากที่สุด คำว่า "ถูกกว่า 10 เท่า" ยังพูดน้อยไป: ในการวัดภาระงานประเมินผลชุดเดียวกัน บิลด์พรีวิวของ DeepSeek V4 Pro มีต้นทุน 176.34 ดอลลาร์ เทียบกับ 2,437.41 ดอลลาร์ของ Kimi K3 และบนอินพุตที่แคชไว้ ช่องว่างนั้นไม่ใช่สิบเท่าแต่ประมาณแปดสิบเท่า ส่วน "ระดับ Kimi K3" ยังมาไม่ถึง — 44 เทียบกับ 57 ในการทดสอบ composite เดียวที่ห้องแล็บอิสระรันกับทั้งคู่ โดยการคาดการณ์แบบมองโลกในแง่ดีจากแบบอย่างที่ดีที่สุดของบริษัทเองอยู่ที่ 54

สิ่งที่อาจเปลี่ยนการประเมินนี้คือสิ่งเฉพาะเจาะจงและน่าจับตามอง หากเวอร์ชัน V4 Pro อย่างเป็นทางการออกมาในรูปแบบการอัปเกรดหลังการฝึก (post-training) และ Artificial Analysis ให้คะแนนใหม่สูงกว่า 57 การคาดการณ์ก็ได้รับการพิสูจน์อย่างสมบูรณ์ และตัวเลขหลักของบทความนี้ก็ล้าสมัย หากมันออกมาพร้อมค่าธรรมเนียมช่วงชั่วโมงเร่งด่วนหรือการขึ้นราคาที่ประกาศเมื่อวันที่ 6 สิงหาคม ข้อโต้แย้งเรื่องราคาก็ลดลงครึ่งหนึ่ง และคำถามที่น่าสนใจก็คือ ส่วนลด 6 เท่าจะชดเชยส่วนต่าง 13 คะแนนได้หรือไม่ และหากบริษัทเปิดตัวชุดทดสอบการประเมินผล (evaluation harness) — ซึ่งอยู่ในช่วง closed beta แล้ว — benchmarks ของผู้จำหน่ายที่ปัจจุบันให้ผลดีต่อ V4 Pro ด้านการเขียนโค้ดก็จะสามารถตรวจสอบได้เป็นครั้งแรก จนกว่าหนึ่งในกรณีเหล่านี้จะเกิดขึ้น บทสรุปที่แม่นยำของ DeepSeek V4 Pro ก็คือ มันเป็นโมเดล reasoning ระดับจริงจังที่คุ้มค่าที่สุดโดยมี weights ให้ดาวน์โหลดได้ มันไม่ใช่ตัวที่ฉลาดที่สุด และผู้จำหน่ายของมันบอกเราว่ามันยังไม่เสร็จสมบูรณ์

การเปรียบเทียบในบทความนี้4

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

ติดต่อเรา

เข้าร่วมคอมมูนิตี้ของเรา

DiscordEmailXGitHubYouTube