การ์ดชื่อเรื่องหลักสำหรับการเปรียบเทียบ 'Grok 4.6 vs DeepSeek V4 Pro' พร้อมคำบรรยาย 'สงครามราคาระดับแนวหน้า ที่สู้กันห่างเพียง 24 ชั่วโมง' และป้าย 'เปรียบเทียบ · สิงหาคม 2026'
Guides & Insights

Grok 4.6 ปะทะ DeepSeek V4 Pro: สงครามราคาแนวหน้า สู้กันห่างเพียง 24 ชั่วโมง

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

โมเดลระดับแนวหน้าสองตัวเปิดตัวห่างกันภายใน 24 ชั่วโมง และช่องว่างระหว่างตารางราคาของทั้งคู่นั้นกว้างที่สุดเท่าที่รุ่นนี้ได้ผลิตออกมา Grok 4.6 เปิดตัวเมื่อวันที่ 12 สิงหาคม 2026 ที่ราคา 2 ดอลลาร์ต่อล้าน input tokens และ 6 ดอลลาร์ต่อล้าน output tokens ส่วน DeepSeek V4 Pro — เวอร์ชันวางจำหน่ายอย่างเป็นทางการของเรือธง DeepSeek ในเวอร์ชัน DeepSeek-V4-Pro-0813 — ตามมาในวันที่ 13 สิงหาคม 2026 ที่ราคา 3 หยวนต่อล้าน cache-miss input tokens และ 6 หยวนต่อล้าน output tokens ซึ่งคิดเป็นประมาณ $0.42 และ $0.85 หมวดหมู่เดียวกัน ความทะเยอทะยานแบบเอเจนต์เดียวกัน แต่ราคาห่างกันเป็นสิบเท่า นี่ไม่ใช่การเปรียบเทียบสเปกสองอย่าง แต่เป็นการเปรียบเทียบกลยุทธ์สองแบบว่าต้นทุนของโมเดลที่ออกแบบมาเพื่อเอเจนต์ควรเป็นเท่าใด และทั้งคู่ต่างเปิดตัวในสัปดาห์นี้

บทความชิ้นนี้วางตารางราคาทั้งสองชุดไว้เคียงข้างกัน อ่านคำกล่าวอ้างเรื่อง benchmark ของแต่ละผู้จำหน่ายพร้อมกับฉลากชื่อผู้จำหน่าย แล้วคำนวณว่าช่องว่างดังกล่าวมีต้นทุนจริงเท่าใดบนปริมาณงานจริง — เพราะบนกระดาษ โมเดลเหล่านี้ใกล้เคียงกันในด้านความสามารถมากกว่าในด้านปรัชญา และความแตกต่างของราคาต่องานคือจุดที่การตัดสินใจอยู่

จังหวะเวลาคือประเด็น

การที่ทั้งสองโมเดลเปิดตัวภายในกรอบเวลา 48 ชั่วโมงเดียวกัน ไม่ใช่เรื่องบังเอิญของปฏิทิน Grok 4.6 คือการปรับโฉมเชิงเอเจนต์ (agentic refit) ที่ SpaceXAI กระทำกับรากฐานโมเดล 1.5T ของตน — เป็นการรีเฟรชหลังการเทรนที่เน้นการเรียนรู้แบบเสริมแรงอย่างหนักในด้านการเขียนโค้ด งานเคอร์เนล และ CAD โดยตั้งราคาไว้เพื่อเป็นเชื้อเพลิงให้ผลิตภัณฑ์ Cursor และ Grok Bot ที่บริษัทเป็นเจ้าของ DeepSeek V4 Pro คือการยกพรีวิวที่นิยามความหมายของคำว่า "agentic" ใหม่แบบเงียบ ๆ ในราคาเพียงเศษเสี้ยว ขึ้นเป็นเวอร์ชันทางการ ซึ่งตอนนี้ถูกเสริมความสามารถเพื่อเศรษฐกิจเอเจนต์: บันทึกประจำรุ่นของ DeepSeek สำหรับบิลด์ 0813 นำด้วยความสามารถด้านเอเจนต์ที่ปรับปรุงอย่างมีนัยสำคัญ เพิ่มการรองรับ Responses API และการผสานกับ Codex และยังคงทั้งโหมดคิด (ค่าเริ่มต้น) และโหมดไม่คิด, JSON output, การเรียกใช้เครื่องมือ และรูปแบบ Anthropic API เอาไว้ บริษัทสองแห่งที่แตกต่างกันอย่างสิ้นเชิงได้ข้อสรุปพร้อมกันว่าตลาดที่สำคัญในปลายปี 2026 คือเอเจนต์ — และตั้งราคาผลงานของตนไว้สำหรับกระเป๋าเงินคนละระดับอย่างมาก

ใบราคาทั้งสองใบ เคียงข้างกัน

Grok 4.6 — $2.00 / $6.00 / $0.50 (อินพุตแบบแคช) ต่อล้านโทเค็น, บริบท 500K, ขั้นราคา $4 / $12 / $1 สำหรับอินพุตที่เกินประมาณ 200K โทเค็น และเวอร์ชันที่เร็วขึ้นในอัตรา 2 เท่าของราคาพื้นฐาน

DeepSeek V4 Pro — ¥3.00 (≈$0.42) สำหรับอินพุตแบบ cache-miss, ¥0.025 (≈$0.0035) สำหรับอินพุตแบบแคช, ¥6.00 (≈$0.85) สำหรับเอาต์พุตต่อล้านโทเคน พร้อมหน้าต่างบริบท 1 ล้านโทเคนและเอาต์พุตสูงสุด 384K โทเคน รุ่นน้องที่ถูกกว่า V4 Flash ราคา ¥1 / ¥2.

แม้แต่เมื่อเทียบกับ Grok 4.6 — ซึ่งเป็น API ระดับแนวหน้าที่ถูกที่สุดในรุ่นเดียวกันอยู่แล้ว — D​eepSeek V4 Pro กลับมีราคาถูกกว่าประมาณห้าเท่าสำหรับอินพุตแบบ cache-miss และถูกกว่าถึงเจ็ดเท่าสำหรับเอาต์พุต และยังมาพร้อมหน้าต่างบริบทที่ใหญ่กว่า 2 เท่า และเอาต์พุตสูงสุดที่ใหญ่กว่ามากในราคาระดับเดียวกัน ทั้งสองไม่ได้แข่งกันที่ราคา; D​eepSeek ได้กำหนดเพดานราคาขั้นต่ำใหม่เพียงฝ่ายเดียว และ Grok กลายเป็นตัวเลือกระดับพรีเมียมในประโยคเดียวกัน กรอบการมองแบบนี้สำคัญ เพราะกรอบเดิมที่ว่า "Grok 4.6 เป็นโมเดลแนวหน้าที่ถูก" นั้นเป็นจริงเพียงวันเดียวเท่านั้น

Two-column scoreboard: Grok 4.6 AA Index 61 (independent), $2/$6, 500K context, DeepSWE v1.1 65.9% (vendor), Terminal-Bench 26% (v3.0), cache-hit input $0.50 vs DeepSeek V4 Pro AA Index none yet, ≈$0.42/$0.85, 1M context, DeepSWE 62.7% (vendor), Terminal-Bench 87.9% (v2.1), cache-hit input ≈$0.0035.

DeepSeek V4 Pro ปรับปรุงอะไรขึ้นจริงๆ บ้าง

ตัวเลขการเปิดตัวของ D​eepSeek น่าทึ่งที่สุด เพราะถูกวัดเทียบกับเวอร์ชันพรีวิวของตัวเอง และการกระโดดจากพรีวิวไปสู่เวอร์ชันจริงนั้นมหาศาล ในผลการประเมินของผู้จำหน่ายเอง:

DeepSWE — 62.7% บนบิลด์ที่เผยแพร่ เพิ่มขึ้นจาก 12.8% ในพรีวิว — คะแนนงานวิศวกรรมซอฟต์แวร์ระยะยาวที่ผู้จำหน่ายระบุว่าอยู่ระหว่าง 58.0% ของ Opus 4.8 และ 70.0% ของ Claude Fable 5.

Cybergym — 83.3% เพิ่มขึ้นจาก 52.7% เฉือน Fable 5 ที่ 83.1% และเอาชนะ Opus 4.8 ที่ 78.3%.

Terminal Bench 2.1 — 87.9% ซึ่งห่างจาก 88.0% ของ Fable 5 เพียง 1 จุด และนำหน้า 85.0% ของ Opus 4.8

AutomationBench (public) — 31.8% เพิ่มขึ้นจาก 12.8% นำหน้าทั้ง Fable 5 (29.1%) และ Opus 4.8 (27.2%)

Toolathlon-Verified, NL2Repo, DSBench-FullStack และ DSBench-Hard — 74.1%, 61.5%, 71.1% และ 67.2% ตามลำดับ อยู่ในกลุ่มหรือใกล้เคียงกับช่วง Opus 4.8 / Fable 5

ทุกข้อนั้นเป็นผลที่ DeepSeek รายงานเองบนชุดการประเมินของ DeepSeek ทิศทางนั้นชัดเจนไม่อาจเข้าใจผิด — ตัวพรีวิวยังไม่พร้อมสำหรับลูปเอเจนต์ในโพรดักชัน และบิลด์ตัววางจำหน่ายอ้างว่าพร้อม — แต่ป้ายกำกับที่ตรงไปตรงมาก็คือ ยังไม่มีห้องแล็บอิสระใดให้คะแนน DeepSeek V4 Pro และโมเดลที่ถูกนำมาเปรียบเทียบก็ไม่ได้ถูกระบุชื่อโดยหน่วยงานภายนอก

Grok 4.6 ตอบด้วยอะไร

คู่แข่งของ Grok 4.6 แตกต่างกันในเชิงชนิด: มันเป็นเพียงหนึ่งในสองที่มีกระดานคะแนนอิสระ Artificial Analysis วัดค่าได้ 61 บนดัชนีความฉลาด (Intelligence Index) — เสมอด้วย GPT-5.6 Sol และนำหน้า Kimi K3 (60) — ก่อนที่ DeepSeek V4 Pro จะเปิดตัวด้วยซ้ำ ตารางของผู้ผลิตของมันอ้างผลงานนำที่ 65.9% บน DeepSWE v1.1 และ 69.9% บน CursorBench v3.2 โดยยอมรับจุดอ่อนอย่างเปิดเผยที่ 26% บน Terminal-Bench v3.0 ตัวเลขเหล่านี้มาจากรายงานของ xAI ยังไม่มีการทำซ้ำโดยอิสระ ณ วันที่ 13 สิงหาคม

ความไม่ตรงกันของเวอร์ชันมีผลเมื่อคุณพยายามเปรียบเทียบทั้งสองโดยตรง คะแนน 87.9 ของ DeepSeek มาจาก Terminal Bench 2.1 ส่วน 26% ของ Grok มาจาก v3.0 ที่ยากกว่า — เป็นการสอบคนละชุด ดังนั้นประโยคที่ว่า "DeepSeek ชนะขาด Grok ในด้านเทอร์มินัล" จึงไม่ใช่คำพูดที่ตรงไปตรงมา และประโยค "Grok นำใน DeepSWE" ก็ไม่ตรงไปตรงมาเช่นกัน หากไม่ได้ระบุว่าผู้ให้บริการทั้งสองใช้เวอร์ชันประเมินผลที่ต่างกัน และทั้งสองตัวเลขไม่ได้มาจากบุคคลที่สาม สิ่งที่เปรียบเทียบได้คือมิติที่อิสระ: Grok 4.6 มีสกอร์การ์ดที่ได้รับการยืนยันหนึ่งรายการ ขณะที่ DeepSeek V4 Pro ยังไม่มีเลย และสำหรับการตัดสินใจในระดับโปรดักชัน ความไม่สมมาตรนั้นคือข้อมูลในตัวเอง

Screenshot of the Artificial Analysis page for Grok 4.6 (high) scoring 61 — the independent scorecard DeepSeek V4 Pro does not yet have.

ค่าใช้จ่ายทั้งหมดสำหรับการรันเอเจนต์ที่ยาวนาน

ลองพิจารณางานแบบเอเจนต์ที่สมจริง — การอ่านและใช้เหตุผลกับบริบทจำนวน 500K โทเคน การเขียนผลลัพธ์จำนวน 100K โทเคน ซึ่งเป็นการรีแฟกเตอร์ขนาดกลางหรือไปป์ไลน์เอกสารยาว ภายในหน้าต่างของทั้งสองโมเดล:

Grok 4.6 — อินพุต 0.5M ที่ $2 = $1.00 บวกเอาต์พุต 0.1M ที่ $6 = $0.60 รวม: $1.60.

DeepSeek V4 Pro — อินพุตแบบ cache-miss 0.5M ที่ ¥3 = ¥1.50 บวกกับเอาต์พุต 0.1M ที่ ¥6 = ¥0.60 รวม: ¥2.10 ประมาณ $0.29.

นั่นคือช่องว่าง 5.5 เท่าในงานที่ระบุเดียวกัน ก่อนจะนับข้อได้เปรียบจากการแคชใดๆ — และหน้าต่าง 1M ของ D​eepSeek บวกกับเอาต์พุตสูงสุด 384K ยังหมายความว่างานนี้ทำได้ในรอบเดียว ในขณะที่หน้าต่าง 500K ของ Grok 4.6 อาจบังคับให้ต้องทำสองรอบ ข้อแม้ที่ทำให้เรื่องนี้ไม่ใช่คำตอบสั้นๆ บรรทัดเดียวคือต้นทุนและความเสี่ยงของการใช้เหตุผล: โหมดคิดของ D​eepSeek เปิดอยู่โดยค่าเริ่มต้น ดังนั้นทุกคำขอจึงจ่ายค่าการติดตามการใช้เหตุผลแบบเต็มรูปแบบ แม้ในเวลาที่คุณไม่ต้องการ และความมั่นใจในเกณฑ์วัดของตัวผู้ให้บริการเองก็ไม่เคยถูกทดสอบโดยบุคคลภายนอก ราคาถูกต่อโทเค็นกับการใช้เหตุผลที่เปิดตลอดเวลายังถือว่าราคาถูกต่องานในอัตราเหล่านี้ แต่ 'ถูก' กับ 'ได้รับการพิสูจน์แล้ว' เป็นคำกล่าวอ้างที่ต่างกัน และมีเพียงหนึ่งในสองโมเดลนี้เท่านั้นที่รองรับข้อที่สอง

ใครควรเลือกอันไหน

การตัดสินใจไม่ได้อยู่ที่ว่า "อันไหนดีกว่า" แต่อยู่ที่ว่า "โปรไฟล์ความเสี่ยงแบบไหนเหมาะกับปริมาณงาน":

มีปริมาณสูง ผูกพันกับต้นทุน และเต็มใจที่จะแบกรับตัวเลขที่ไม่ผ่านการยืนยัน — DeepSeek V4 Pro คือตัวเลือกที่เน้นราคาต่ำสุด บริบท 1M และเอาต์พุต 384K ทำให้มันเป็นตัวเลือกที่แข็งแกร่งกว่าสำหรับงานบริบทยาวและงานแบบแบตช์ และอัตราอินพุตแคช ¥0.025 ทำให้ไพพ์ไลน์ที่ต้องเรียกค้นข้อมูลจำนวนมากแทบไม่มีค่าใช้จ่าย แค่ทดสอบด้วยตัวเอง เพราะไม่มีใครที่เป็นอิสระเคยทำไว้

เอเจนต์เชิงลึกพร้อมสกอร์การ์ดอิสระ ในระบบนิเวศที่เข้ากันได้กับ OpenAI — คะแนน 61 ของ Grok 4.6 ได้รับการยืนยันแล้ว ทิศทางของเกณฑ์วัดด้านการเขียนโค้ดและเอเจนต์สอดคล้องกัน และจุดอ่อนปลายทางทราบล่วงหน้าแล้ว เวลา 42 วินาทีจนถึงโทเค็นแรกคือราคาที่คุณจ่ายสำหรับคุณภาพที่ได้รับการยืนยัน

Screenshot of the OrcaRouter model page for Grok 4.6, the pass-through endpoint where both models sit behind one key at provider list price.

ทราฟฟิกแบบผสม — นี่คือกรณีที่ควรใช้การจัดเส้นทาง (routing) มากกว่าการเลือก บน OrcaRouter ทั้งสองโมเดลใช้คีย์เดียวกันในราคาแบบ pass-through ตามรายการผู้ให้บริการ — ดังนั้น ¥3/¥6 ของ D​eepSeek จึงยังคงเป็น ¥3/¥6 บนใบแจ้งหนี้ และ Grok 4.6 ยังคงเป็น $2/$6 โดยไม่มีมาร์กอัปเพิ่มเติมทั้งคู่ กฎการจัดเส้นทางสามารถส่งงานที่ต้องใช้บริบทยาวและมีข้อจำกัดด้านต้นทุนไปที่ DeepSeek V4 Pro และส่งงานแบบ agentic ที่ผ่านการตรวจสอบแล้วไปที่ Grok 4.6 โดยแบ่งทราฟฟิกเป็นรายคำขอจนกว่าการประเมินของคุณเองจะสรุปการแบ่งสัดส่วน และใช้การ failover อัตโนมัติหากพฤติกรรมในสัปดาห์แรกของผู้ให้บริการรายใดรายหนึ่งขัดแย้งกับตัวเลขที่ประกาศเปิดตัว สำหรับโมเดลคู่หนึ่งที่เพิ่งเปิดตัวได้หนึ่งวันซึ่งอยู่คนละฝั่งของสงครามราคา ความสามารถในการเปรียบเทียบทั้งสองบนเวิร์กโหลดของคุณเอง — และปรับเปลี่ยนสัดส่วนการแบ่งโดยไม่ต้องแก้โค้ด — ไม่ใช่แค่ความสะดวกสบาย แต่เป็นวิธีเดียวที่สามารถปกป้องได้ในการนำโมเดลใดโมเดลหนึ่งมาใช้

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube