การ์ดชื่อเรื่องที่อ่านว่า “Grok 4.7 vs DeepSeek V4 Pro” พร้อมคำโปรย “อันหนึ่งใหม่ อีกอันกำลังถูกสับเปลี่ยนใต้ตัวคุณ” และการ์ดสามใบ: AA Index v4.3.2 46 vs 36, ราคาช่วงออฟพีคต่อ 1M $2/$6 vs $0.66/$1.98 และ Context 500k vs 1M
Guides & Insights

Grok 4.7 vs DeepSeek V4 Pro: ตัวหนึ่งคือของใหม่ ส่วนอีกตัวกำลังถูกสับเปลี่ยนอยู่ใต้ตัวคุณ

ผู้เขียน

Elias Hawthorne

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

บันทึกที่เผยแพร่เมื่อวันที่ 10 กันยายน 2026 เปลี่ยนประเด็นของการเปรียบเทียบนี้ "เรากำลังเลิกใช้ V4-Pro" ระบุไว้ และตั้งแต่ 04:00 UTC ของวันที่ 14 กันยายน 2026 คำขอทั้งหมดที่ส่งไปยังสตริงโมเดล deepseek-v4-pro จะถูกส่งต่อไปยัง DeepSeek-V4.1-Flash ในอัตราของ V4.1-Flash — ซึ่งเป็นสถานะที่โพสต์ดังกล่าวระบุว่าดำเนินต่อไป "จนกว่า V4.1-Pro จะเปิดตัว" สตริงโมเดลยังคงตอบกลับ แต่โมเดลที่อยู่เบื้องหลังไม่ใช่ตัวที่คุณทดสอบวัดประสิทธิภาพไว้ สิ่งนี้ทำให้การเปรียบเทียบแบบตัวต่อตัวกับ Grok 4.7 — ซึ่งผู้ขายเปิดตัวเมื่อวันที่ 21 กันยายน 2026 หนึ่งวันก่อนการเขียนข้อความนี้ — เป็นการเปรียบเทียบที่มีวันหมดอายุอยู่ฝ่ายเดียว จากตัวเลขที่มีอยู่ Grok 4.7 เป็นโมเดลที่แข็งแกร่งกว่า และ DeepSeek V4 Pro เป็นรุ่นที่ถูกกว่า ในคำถามที่ตัดสินใจเรื่องการผสานรวมจริง ๆ มีเพียงตัวเดียวเท่านั้นที่ยังคงเป็นสิ่งที่มันบอกว่ามันเป็น

แต่ละโมเดลคืออะไร ก่อนคะแนน

DeepSeek V4 Pro เปิดให้ใช้งานทั่วไปอย่างเป็นทางการเมื่อวันที่ 13 สิงหาคม 2026 ในชื่อเช็กพอยต์ DeepSeek-V4-Pro-0813 หลังจากเปิดให้ทดลองใช้เมื่อวันที่ 24 เมษายน เป็นโมเดลแบบเปิดน้ำหนัก (open weights) ภายใต้สัญญาอนุญาต MIT — สัญญาอนุญาตนี้允許การใช้เชิงพาณิชย์ การดัดแปลง และการเผยแพร่ต่อ โดยไม่มีเกณฑ์รายได้หรือข้อยกเว้นเฉพาะภูมิภาค — โดยมีการ์ดโมเดลรุ่น GA ที่ระบุพารามิเตอร์รวม 1.7 ล้านล้านตัว หน้าต่างบริบทขนาด 1 ล้านโทเคน และเอาต์พุตสูงสุด 384K ซึ่งเป็นเพดานเอาต์พุตที่สูงที่สุดในการเปรียบเทียบครั้งนี้ รองรับเฉพาะข้อความเท่านั้น: หน้าราคาของ DeepSeek เองระบุว่า v4-pro ไม่รองรับความสามารถด้านภาพ (vision) ซึ่งถือเป็นข้อจำกัดจริงสำหรับผู้ที่ป้อนภาพหน้าจอหรือไฟล์ PDF ให้กับโมเดล มีตัวปรับระดับความเข้มข้นในการคิดวิเคราะห์ (reasoning effort) ที่ระดับ low, high และ max และถูกจำกัดไว้ที่ 500 คำขอพร้อมกันต่อบัญชี โดยสามารถขอเพิ่มขีดจำกัดได้

Grok 4.7 เป็นโมเดลแบบปิดน้ำหนักและเพิ่งเปิดตัวได้หนึ่งวัน โดยรองรับบริบท 500k โทเค็น ซึ่งเป็นครึ่งหนึ่งของ DeepSeek รับข้อความและรูปภาพเป็นอินพุต และมีตัวปรับระดับความพยายามเป็นของตัวเอง ราคาตามรายการอยู่ที่ 2.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเค็น และ 6.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเค็น เมื่อพรอมป์ต่ำกว่า 200k โทเค็น และจะเพิ่มเป็นสองเท่าคือ 4.00 และ 12.00 ดอลลาร์เมื่อเท่ากับหรือสูงกว่าเกณฑ์นั้น โดยการอ่านจากแคชอยู่ที่ 0.50 และ 1.00 ดอลลาร์ xAI ยังระบุเวอร์ชันที่เร็วกว่า ซึ่งให้ความเร็วเอาต์พุตประมาณสองเท่าและราคาสองเท่า ไม่มีผู้ขายรายใดเผยแพร่ตัวเลขเอาต์พุตสูงสุดสำหรับ Grok 4.7 ในเอกสารที่ตรวจสอบ ณ ที่นี้ ดังนั้นควรถือว่ามิตินั้นไม่ทราบค่าแทนที่จะถือว่าเท่ากัน

บนดัชนีที่ใช้ร่วมกัน ช่องว่างนั้นเอนเอียงไปในทิศทางเดียว

โมเดลทั้งสองถูกให้คะแนนบน Artificial Analysis Intelligence Index v4.3.2 ซึ่งเป็นฉบับปรับปรุงที่เผยแพร่เมื่อวันที่ 19 กันยายน 2026 คอลัมน์ของ Grok 4.7 วัดที่ระดับ xhigh effort ส่วนของ DeepSeek คือเช็กพอยต์ 0813 ที่ระดับ max effort เมื่อพิจารณาควบคู่กัน ช่องว่างของคะแนนรวมยังสะท้อนความแตกต่างเชิงโครงสร้างของสองโมเดลนี้ได้น้อยเกินไป

Composite — Grok 4.7: 46 คะแนนใน Artificial Analysis Intelligence Index v4.3.2 ส่วน DeepSeek V4 Pro 0813: 36 ในเวอร์ชันเดียวกัน

เอเจนต์เทอร์มินัล — Grok 4.7: Terminal-Bench 4.0 ได้ 26 คะแนน DeepSeek V4 Pro: 14 คะแนน เกือบสองเท่า ในการประเมินที่ใกล้เคียงกับงานซอฟต์แวร์แบบอัตโนมัติมากที่สุด

ระบบอัตโนมัติ — Grok 4.7: AutomationBench-AA 66% DeepSeek V4 Pro: 57% ทั้งคู่ล้วนน่าเชื่อถือ Grok นำอยู่เก้าคะแนน

ความรู้และการหลอน — Grok 4.7: AA-Omniscience 32. DeepSeek V4 Pro: 1. นี่คือค่าผิดปกติบนกระดานคะแนน และไม่ใช่ความคลาดเคลื่อนจากการปัดเศษ — ดัชนีให้คะแนนทั้งสิ่งที่โมเดลรู้และความถี่ที่โมเดลแต่งคำตอบขึ้นมาเมื่อมันไม่รู้

บริบทขนาดยาว — Grok 4.7: AA-LCR v1.1 77%, หน้าต่าง 500k. DeepSeek V4 Pro: 80%, หน้าต่าง 1M. นี่คือชัยชนะที่ชัดเจนเพียงหนึ่งเดียวของ DeepSeek และมันคือแกนหลักที่หน้าต่าง 1M ถูกสร้างขึ้นมาเพื่อรองรับ

การให้เหตุผลที่ยาก — Grok 4.7: HLE 43, CritPt 18. DeepSeek V4 Pro: HLE 41, CritPt 18. เสมอกันในเกณฑ์ทดสอบทางฟิสิกส์ และ Grok ได้เปรียบสองคะแนนใน HLE.

ความเยิ่นเย้อของคำตอบ — Grok 4.7: ใช้โทเคนเอาต์พุต 240M ในการรันอินเด็กซ์ และถูกระบุว่ายืดเยื้อผิดปกติ DeepSeek V4 Pro: 163M ทั้งคู่ช่างพูดช่างเจรจา โดย Grok ยิ่งพูดมากกว่า

OrcaRouter model page for DeepSeek V4 Pro showing the deepseek/deepseek-v4-pro identifier, a 1M-token context window, 384K maximum output, text-only input, off-peak list rates of $0.66 per 1M input and $1.98 per 1M output, and 3818.2M tokens of traffic over seven days.

เรื่องราคาไม่ใช่แค่ตัวเลขตัวเดียว แต่เป็นตารางราคา

ราคาของ DeepSeek เป็นสิ่งที่ดุดันที่สุดในตัวมัน และเป็นสิ่งที่อ้างอิงราคาได้ยากที่สุด อัตราตามรายการสำหรับ deepseek-v4-pro อยู่ที่ $0.66 ต่ออินพุตหนึ่งล้านโทเค็นเมื่อแคชไม่ทำงาน และ $1.98 ต่อเอาต์พุตหนึ่งล้านโทเค็น — ในช่วงนอกเวลาพีค ในช่วงเวลาพีค ราคาเหล่านี้จะเพิ่มเป็นสองเท่าเป็น $1.32 และ $3.96 ตามเอกสารของ DeepSeek เอง ช่วงพีคคือ 01:00–04:00 และ 06:00–10:00 UTC วันจันทร์ถึงวันศุกร์ ยกเว้นวันหยุดราชการจีน ส่วนเวลาอื่นทั้งหมด รวมถึงสุดสัปดาห์เต็ม เป็นช่วงนอกเวลาพีคในราคาเพียงครึ่งเดียวพอดี การอ่านอินพุตจากแคชคือจุดเด่นจริง ๆ: $0.022 นอกช่วงพีค และ $0.044 ช่วงพีค ซึ่งถูกกว่ากรณีแคชไม่ทำงานถึงสามสิบเท่า ทำให้เวิร์กโหลด DeepSeek ที่แคชได้ดีมีราคาถูกกว่าที่ตารางราคาของมันบอกไว้อย่างมาก

เมื่อเทียบกันแล้ว ราคา $2.00 และ $6.00 ของ Grok 4.7 ดูแพง — ประมาณ 3 เท่าของราคาอินพุตช่วงออฟพีคของ DeepSeek และ 3 เท่าของราคาเอาต์พุตช่วงออฟพีคของมัน การเปรียบเทียบนี้แคบลงในแง่ที่ควรรู้ ราคาของ Grok 4.7 คงที่ภายในช่วงของตัวเอง而不是ขึ้นอยู่กับเวลา ดังนั้นการพุ่งของงานโปรดักชันตอน 09:00 UTC จึงมีค่าใช้จ่ายเท่ากับแบตช์คืนวันอาทิตย์ ส่วนของ DeepSeek ไม่เป็นเช่นนั้น และเมื่อพรอมป์ตมีมากกว่า 200k โทเค็น Grok 4.7 จะเพิ่มเป็นสองเท่า ณ จุดนั้นจึงเป็นสี่ถึงหกเท่าของราคาช่วงออฟพีคของ DeepSeek ไม่ใช่แค่สามเท่า พูดให้ชัดคือ DeepSeek V4 Pro เป็นโมเดลที่ถูกกว่าในทุกด้าน และ ขนาดของส่วนลดขึ้นอยู่กับว่าคุณรันเมื่อไหร่และแคชได้ดีแค่ไหน.

สิ่งที่ 14 กันยายน เปลี่ยนแปลงไป

นี่คือส่วนที่ทำให้ข้อโต้แย้งเรื่องราคายากขึ้นที่จะใช้เป็นหลักได้ ตั้งแต่ 14 กันยายน 2026 เป็นต้นไป DeepSeek จะเปลี่ยนเส้นทางคำขอ deepseek-v4-pro ไปยัง DeepSeek-V4.1-Flash และคิดค่าบริการคำขอเหล่านั้นในอัตราของ Flash ซึ่งต่ำลงไปอีก บันทึกการเปลี่ยนแปลงและหน้าราคาของ DeepSeek บอกเล่าเรื่องที่ต่างออกไปเล็กน้อยจากที่โพสต์ข่าววันที่ 10 กันยายนบอก: ตารางราคายังคงแสดง deepseek-v4-pro เป็นแถวที่ยังใช้งานอยู่พร้อมอัตราของตัวเองและไม่มีแท็กการเลิกให้บริการ และรายการในบันทึกการเปลี่ยนแปลงระบุว่าบริการ API สำหรับ V4 Pro ยังคงดำเนินต่อไปหลังวันที่ 14 กันยายน โดยการเรียกเก็บเงินไม่เปลี่ยนแปลง สิ่งที่ไม่อาจโต้แย้งได้คือทิศทางที่มุ่งไป V4.1-Pro ได้รับการยืนยันว่าอยู่ระหว่างการพัฒนาโดยยังไม่มีการประกาศวันที่ และ V4.1-Flash — ซึ่งเปิดตัวเมื่อวันที่ 10 กันยายน — คือสิ่งที่ประกาศของ DeepSeek เองบอกว่าดีกว่า V4 Pro ในด้าน "ประสิทธิภาพ ต้นทุน ความเร็ว และเวลารันรวม" ซึ่งเป็นคำกล่าวอ้างของผู้ขายที่ยังไม่ได้รับการทำซ้ำอย่างอิสระในขอบเขตขนาดนั้น

ดังนั้นคำถามในทางปฏิบัติจึงไม่ใช่ "Grok 4.7 หรือ DeepSeek V4 Pro" แต่เป็น "Grok 4.7 หรือไม่ว่าโมเดล DeepSeek ใดก็ตามที่สตริงนั้นจะชี้ไปในไตรมาสหน้า" หากคุณทดสอบประสิทธิภาพ V4 Pro ในเดือนสิงหาคม และกำหนดงบประมาณบริบทของคุณให้อยู่ที่หน้าต่าง 1M โดยมีเพดานเอาต์พุต 384K โมเดลที่คุณเรียกใช้ในเดือนพฤศจิกายนอาจไม่ใช่โมเดลที่คุณวัดไว้ — และขีดจำกัดบริบทและเอาต์พุตของรุ่นสืบทอดไม่ใช่ค่าที่คุณออกแบบไว้ Grok 4.7 มีโปรไฟล์ความเสี่ยงตรงกันข้าม: โมเดลที่อายุหนึ่งวันซึ่งตัวเลขต่างๆ ถูกรายงานโดยผู้ขายและส่วนใหญ่ยังไม่ถูกทำซ้ำ แต่ตัวตนของมันไม่เป็นที่สงสัย

Two-column scoreboard titled “Grok 4.7 vs DeepSeek V4 Pro - the scoreboard”: AA Index 46 vs 36, Terminal-Bench 4.0 26 vs 14, AutomationBench 66% vs 57%, context 500k vs 1M, price per 1M $2/$6 vs $0.66/$1.98 off-peak, and open weights “no” vs “MIT”.

จุดที่เราเตอร์เหมาะ และจุดที่มันไม่เหมาะ

OrcaRouter ให้บริการ DeepSeek V4 Pro และหน้าเพจของโมเดลระบุราคาไว้ที่อัตราของผู้ให้บริการเอง คือ 0.66 ดอลลาร์สำหรับขาเข้า และ 1.98 ดอลลาร์สำหรับขาออก พร้อมหน้าต่างบริบท 1M และเอาต์พุตสูงสุด 384k เนื่องจากเราส่งผ่านราคาตามที่ผู้ให้บริการระบุไว้โดยไม่บวกกำไรเลย (0% markup) เรื่องนี้ยิ่งสำคัญกว่าปกติเมื่อผู้จำหน่ายมีอัตราราคาที่เปลี่ยนแปลงตามตารางช่วงพีก/ออฟพีก และประกาศเมื่อวันที่ 10 กันยายนที่ผ่านมาพร้อมกับการลดราคา: การเปลี่ยนแปลงราคาของ DeepSeek มีผลทันทีบนคีย์เดิมในวันเดียวกัน โดยไม่มีความล่าช้าในการปรับราคาและไม่มีสัญญาฉบับที่สอง เมื่อผู้จำหน่ายเปลี่ยนเส้นทางสตริงโมเดลที่ฝั่งของตน การเปลี่ยนแปลงนั้นจะมาถึงผ่านเอนด์พอยต์เดิม แทนที่จะต้องบูรณาการใหม่ที่ฝั่งของคุณ และการสลับไปใช้ระบบสำรองอัตโนมัติช่วยป้องกันไม่ให้การจำกัดอัตราหรือเหตุการณ์ด้านความจุฝั่งผู้ให้บริการกลายเป็นการหยุดให้บริการ ซึ่งมีประโยชน์เมื่อฝั่งใดฝั่งหนึ่งของสแตกของคุณถูกจำกัดไว้ที่ 500 คำขอพร้อมกัน ณ ขณะเขียนนี้ Grok 4.7 ยังไม่อยู่ในแค็ตตาล็อกของ OrcaRouter การเรียกใช้งานมันจึงหมายถึงต้องผ่าน API ของ xAI เองและแพลตฟอร์มของบุคคลที่สามที่มีให้บริการอยู่

การแยกแบบที่สิ่งนี้ชี้ให้เห็นนั้นไม่หรูหราแต่ปกป้องได้: เก็บ DeepSeek V4 Pro ไว้กับงานที่การคิดราคาแบบ cache-hit และหน้าต่าง 1M กำลังทำงานอยู่ และตั้งความคาดหวังของคุณไปที่ V4.1-Flash แทนที่จะเป็นเช็กพอยต์เดือนสิงหาคม วาง Grok 4.7 ไว้กับงานที่โมเดลต้องรู้ว่าตัวเองไม่รู้อะไร — ดัชนี AA-Omniscience ที่ 1 เป็นสัญญาณดังเกี่ยวกับความเต็มใจของโมเดลที่จะตอบอย่างมั่นใจและผิด และไม่มีข้อได้เปรียบด้านราคาใดอยู่รอดได้เมื่อผู้บริโภคปลายทางเชื่อคำตอบที่กุขึ้น

การโทร

Grok 4.7 เป็นโมเดลที่ดีกว่าในกรณีนี้ และไม่ได้ใกล้เคียงกันเป็นพิเศษ: นำอยู่สิบจุดในคะแนนรวม, คะแนน Terminal-Bench สูงเป็นสองเท่า, มีความได้เปรียบด้านระบบอัตโนมัติ, และช่องว่างด้านความซื่อตรงทางความรู้ที่กว้างพอจะเป็นความแตกต่างคนละระดับ DeepSeek V4 Pro ถูกกว่าโดยประมาณ 3 เท่านอกช่วงพีค และมีหน้าต่างบริบทเป็นสองเท่า ซึ่งเป็นเหตุผลจริงและปกป้องได้ในการเก็บมันไว้ — แต่คุณไม่ได้ซื้อโมเดลที่คุณทดสอบ benchmark อยู่ คุณกำลังซื้อสตริงโมเดลที่ DeepSeek ประกาศแล้วว่าจะเปลี่ยนไปชี้ที่อื่น ในอัตราค่าบริการที่เปลี่ยนทุกชั่วโมง ภายใต้สัญญาอนุญาตและชุดน้ำหนักที่ทำให้การโฮสต์เองกลายเป็นทางเลือกที่สามที่แท้จริง หากเวิร์กโหลดเป็นแบบบริบทยาว ปริมาณสูง และแคชได้ เศรษฐศาสตร์ของ DeepSeek นั้นยากจะเอาชนะ และคุณควรออกแบบสำหรับรุ่นสืบทอดมากกว่าตัวเช็กพอยต์ หากเป็นงานใดก็ตามที่การผิดพลาดมีต้นทุนสูง จ่ายแพงขึ้น 3 เท่าแล้วเลือกโมเดลที่ยอมรับความไม่แน่นอน

Artificial Analysis page for Grok 4.7 at xhigh reasoning effort: an Artificial Analysis Intelligence Index score of 46, ranked #16 of 655; Speed and Cost both reported as N/A; 240M output tokens from the Intelligence Index run, ranked #140 of 655; a 500k-token context window with text and image input and text output; and comparison charts for intelligence, speed and cost per task.

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube