
Grok 4.6 ปะทะ DeepSeek V4 Pro: สงครามราคาแนวหน้า สู้กันห่างเพียง 24 ชั่วโมง
- z-aiใหม่Z.ai: GLM 5.32026-08-1860ความฉลาด75การเขียนโค้ด
- obsidianใหม่Qwen3.8 27B Uncensored (Aggressive)2026-08-1552ความฉลาด68การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 27B (free)2026-08-1340 tok/s
- deepseekใหม่DeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokใหม่SpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaใหม่Meta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น · 230 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0957ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0961ความฉลาด77การเขียนโค้ด
- grokxAI: Grok 4.52026-07-0856ความฉลาด72การเขียนโค้ด
โมเดลระดับแนวหน้าสองตัวเปิดตัวห่างกันภายใน 24 ชั่วโมง และช่องว่างระหว่างตารางราคาของทั้งคู่นั้นกว้างที่สุดเท่าที่รุ่นนี้ได้ผลิตออกมา Grok 4.6 เปิดตัวเมื่อวันที่ 12 สิงหาคม 2026 ที่ราคา 2 ดอลลาร์ต่อล้าน input tokens และ 6 ดอลลาร์ต่อล้าน output tokens ส่วน DeepSeek V4 Pro — เวอร์ชันวางจำหน่ายอย่างเป็นทางการของเรือธง DeepSeek ในเวอร์ชัน DeepSeek-V4-Pro-0813 — ตามมาในวันที่ 13 สิงหาคม 2026 ที่ราคา 3 หยวนต่อล้าน cache-miss input tokens และ 6 หยวนต่อล้าน output tokens ซึ่งคิดเป็นประมาณ $0.42 และ $0.85 หมวดหมู่เดียวกัน ความทะเยอทะยานแบบเอเจนต์เดียวกัน แต่ราคาห่างกันเป็นสิบเท่า นี่ไม่ใช่การเปรียบเทียบสเปกสองอย่าง แต่เป็นการเปรียบเทียบกลยุทธ์สองแบบว่าต้นทุนของโมเดลที่ออกแบบมาเพื่อเอเจนต์ควรเป็นเท่าใด และทั้งคู่ต่างเปิดตัวในสัปดาห์นี้
บทความชิ้นนี้วางตารางราคาทั้งสองชุดไว้เคียงข้างกัน อ่านคำกล่าวอ้างเรื่อง benchmark ของแต่ละผู้จำหน่ายพร้อมกับฉลากชื่อผู้จำหน่าย แล้วคำนวณว่าช่องว่างดังกล่าวมีต้นทุนจริงเท่าใดบนปริมาณงานจริง — เพราะบนกระดาษ โมเดลเหล่านี้ใกล้เคียงกันในด้านความสามารถมากกว่าในด้านปรัชญา และความแตกต่างของราคาต่องานคือจุดที่การตัดสินใจอยู่
จังหวะเวลาคือประเด็น
การที่ทั้งสองโมเดลเปิดตัวภายในกรอบเวลา 48 ชั่วโมงเดียวกัน ไม่ใช่เรื่องบังเอิญของปฏิทิน Grok 4.6 คือการปรับโฉมเชิงเอเจนต์ (agentic refit) ที่ SpaceXAI กระทำกับรากฐานโมเดล 1.5T ของตน — เป็นการรีเฟรชหลังการเทรนที่เน้นการเรียนรู้แบบเสริมแรงอย่างหนักในด้านการเขียนโค้ด งานเคอร์เนล และ CAD โดยตั้งราคาไว้เพื่อเป็นเชื้อเพลิงให้ผลิตภัณฑ์ Cursor และ Grok Bot ที่บริษัทเป็นเจ้าของ DeepSeek V4 Pro คือการยกพรีวิวที่นิยามความหมายของคำว่า "agentic" ใหม่แบบเงียบ ๆ ในราคาเพียงเศษเสี้ยว ขึ้นเป็นเวอร์ชันทางการ ซึ่งตอนนี้ถูกเสริมความสามารถเพื่อเศรษฐกิจเอเจนต์: บันทึกประจำรุ่นของ DeepSeek สำหรับบิลด์ 0813 นำด้วยความสามารถด้านเอเจนต์ที่ปรับปรุงอย่างมีนัยสำคัญ เพิ่มการรองรับ Responses API และการผสานกับ Codex และยังคงทั้งโหมดคิด (ค่าเริ่มต้น) และโหมดไม่คิด, JSON output, การเรียกใช้เครื่องมือ และรูปแบบ Anthropic API เอาไว้ บริษัทสองแห่งที่แตกต่างกันอย่างสิ้นเชิงได้ข้อสรุปพร้อมกันว่าตลาดที่สำคัญในปลายปี 2026 คือเอเจนต์ — และตั้งราคาผลงานของตนไว้สำหรับกระเป๋าเงินคนละระดับอย่างมาก
ใบราคาทั้งสองใบ เคียงข้างกัน
• Grok 4.6 — $2.00 / $6.00 / $0.50 (อินพุตแบบแคช) ต่อล้านโทเค็น, บริบท 500K, ขั้นราคา $4 / $12 / $1 สำหรับอินพุตที่เกินประมาณ 200K โทเค็น และเวอร์ชันที่เร็วขึ้นในอัตรา 2 เท่าของราคาพื้นฐาน
• DeepSeek V4 Pro — ¥3.00 (≈$0.42) สำหรับอินพุตแบบ cache-miss, ¥0.025 (≈$0.0035) สำหรับอินพุตแบบแคช, ¥6.00 (≈$0.85) สำหรับเอาต์พุตต่อล้านโทเคน พร้อมหน้าต่างบริบท 1 ล้านโทเคนและเอาต์พุตสูงสุด 384K โทเคน รุ่นน้องที่ถูกกว่า V4 Flash ราคา ¥1 / ¥2.
แม้แต่เมื่อเทียบกับ Grok 4.6 — ซึ่งเป็น API ระดับแนวหน้าที่ถูกที่สุดในรุ่นเดียวกันอยู่แล้ว — DeepSeek V4 Pro กลับมีราคาถูกกว่าประมาณห้าเท่าสำหรับอินพุตแบบ cache-miss และถูกกว่าถึงเจ็ดเท่าสำหรับเอาต์พุต และยังมาพร้อมหน้าต่างบริบทที่ใหญ่กว่า 2 เท่า และเอาต์พุตสูงสุดที่ใหญ่กว่ามากในราคาระดับเดียวกัน ทั้งสองไม่ได้แข่งกันที่ราคา; DeepSeek ได้กำหนดเพดานราคาขั้นต่ำใหม่เพียงฝ่ายเดียว และ Grok กลายเป็นตัวเลือกระดับพรีเมียมในประโยคเดียวกัน กรอบการมองแบบนี้สำคัญ เพราะกรอบเดิมที่ว่า "Grok 4.6 เป็นโมเดลแนวหน้าที่ถูก" นั้นเป็นจริงเพียงวันเดียวเท่านั้น

DeepSeek V4 Pro ปรับปรุงอะไรขึ้นจริงๆ บ้าง
ตัวเลขการเปิดตัวของ DeepSeek น่าทึ่งที่สุด เพราะถูกวัดเทียบกับเวอร์ชันพรีวิวของตัวเอง และการกระโดดจากพรีวิวไปสู่เวอร์ชันจริงนั้นมหาศาล ในผลการประเมินของผู้จำหน่ายเอง:
• DeepSWE — 62.7% บนบิลด์ที่เผยแพร่ เพิ่มขึ้นจาก 12.8% ในพรีวิว — คะแนนงานวิศวกรรมซอฟต์แวร์ระยะยาวที่ผู้จำหน่ายระบุว่าอยู่ระหว่าง 58.0% ของ Opus 4.8 และ 70.0% ของ Claude Fable 5.
• Cybergym — 83.3% เพิ่มขึ้นจาก 52.7% เฉือน Fable 5 ที่ 83.1% และเอาชนะ Opus 4.8 ที่ 78.3%.
• Terminal Bench 2.1 — 87.9% ซึ่งห่างจาก 88.0% ของ Fable 5 เพียง 1 จุด และนำหน้า 85.0% ของ Opus 4.8
• AutomationBench (public) — 31.8% เพิ่มขึ้นจาก 12.8% นำหน้าทั้ง Fable 5 (29.1%) และ Opus 4.8 (27.2%)
• Toolathlon-Verified, NL2Repo, DSBench-FullStack และ DSBench-Hard — 74.1%, 61.5%, 71.1% และ 67.2% ตามลำดับ อยู่ในกลุ่มหรือใกล้เคียงกับช่วง Opus 4.8 / Fable 5
ทุกข้อนั้นเป็นผลที่ DeepSeek รายงานเองบนชุดการประเมินของ DeepSeek ทิศทางนั้นชัดเจนไม่อาจเข้าใจผิด — ตัวพรีวิวยังไม่พร้อมสำหรับลูปเอเจนต์ในโพรดักชัน และบิลด์ตัววางจำหน่ายอ้างว่าพร้อม — แต่ป้ายกำกับที่ตรงไปตรงมาก็คือ ยังไม่มีห้องแล็บอิสระใดให้คะแนน DeepSeek V4 Pro และโมเดลที่ถูกนำมาเปรียบเทียบก็ไม่ได้ถูกระบุชื่อโดยหน่วยงานภายนอก
Grok 4.6 ตอบด้วยอะไร
คู่แข่งของ Grok 4.6 แตกต่างกันในเชิงชนิด: มันเป็นเพียงหนึ่งในสองที่มีกระดานคะแนนอิสระ Artificial Analysis วัดค่าได้ 61 บนดัชนีความฉลาด (Intelligence Index) — เสมอด้วย GPT-5.6 Sol และนำหน้า Kimi K3 (60) — ก่อนที่ DeepSeek V4 Pro จะเปิดตัวด้วยซ้ำ ตารางของผู้ผลิตของมันอ้างผลงานนำที่ 65.9% บน DeepSWE v1.1 และ 69.9% บน CursorBench v3.2 โดยยอมรับจุดอ่อนอย่างเปิดเผยที่ 26% บน Terminal-Bench v3.0 ตัวเลขเหล่านี้มาจากรายงานของ xAI ยังไม่มีการทำซ้ำโดยอิสระ ณ วันที่ 13 สิงหาคม
ความไม่ตรงกันของเวอร์ชันมีผลเมื่อคุณพยายามเปรียบเทียบทั้งสองโดยตรง คะแนน 87.9 ของ DeepSeek มาจาก Terminal Bench 2.1 ส่วน 26% ของ Grok มาจาก v3.0 ที่ยากกว่า — เป็นการสอบคนละชุด ดังนั้นประโยคที่ว่า "DeepSeek ชนะขาด Grok ในด้านเทอร์มินัล" จึงไม่ใช่คำพูดที่ตรงไปตรงมา และประโยค "Grok นำใน DeepSWE" ก็ไม่ตรงไปตรงมาเช่นกัน หากไม่ได้ระบุว่าผู้ให้บริการทั้งสองใช้เวอร์ชันประเมินผลที่ต่างกัน และทั้งสองตัวเลขไม่ได้มาจากบุคคลที่สาม สิ่งที่เปรียบเทียบได้คือมิติที่อิสระ: Grok 4.6 มีสกอร์การ์ดที่ได้รับการยืนยันหนึ่งรายการ ขณะที่ DeepSeek V4 Pro ยังไม่มีเลย และสำหรับการตัดสินใจในระดับโปรดักชัน ความไม่สมมาตรนั้นคือข้อมูลในตัวเอง

ค่าใช้จ่ายทั้งหมดสำหรับการรันเอเจนต์ที่ยาวนาน
ลองพิจารณางานแบบเอเจนต์ที่สมจริง — การอ่านและใช้เหตุผลกับบริบทจำนวน 500K โทเคน การเขียนผลลัพธ์จำนวน 100K โทเคน ซึ่งเป็นการรีแฟกเตอร์ขนาดกลางหรือไปป์ไลน์เอกสารยาว ภายในหน้าต่างของทั้งสองโมเดล:
• Grok 4.6 — อินพุต 0.5M ที่ $2 = $1.00 บวกเอาต์พุต 0.1M ที่ $6 = $0.60 รวม: $1.60.
• DeepSeek V4 Pro — อินพุตแบบ cache-miss 0.5M ที่ ¥3 = ¥1.50 บวกกับเอาต์พุต 0.1M ที่ ¥6 = ¥0.60 รวม: ¥2.10 ประมาณ $0.29.
นั่นคือช่องว่าง 5.5 เท่าในงานที่ระบุเดียวกัน ก่อนจะนับข้อได้เปรียบจากการแคชใดๆ — และหน้าต่าง 1M ของ DeepSeek บวกกับเอาต์พุตสูงสุด 384K ยังหมายความว่างานนี้ทำได้ในรอบเดียว ในขณะที่หน้าต่าง 500K ของ Grok 4.6 อาจบังคับให้ต้องทำสองรอบ ข้อแม้ที่ทำให้เรื่องนี้ไม่ใช่คำตอบสั้นๆ บรรทัดเดียวคือต้นทุนและความเสี่ยงของการใช้เหตุผล: โหมดคิดของ DeepSeek เปิดอยู่โดยค่าเริ่มต้น ดังนั้นทุกคำขอจึงจ่ายค่าการติดตามการใช้เหตุผลแบบเต็มรูปแบบ แม้ในเวลาที่คุณไม่ต้องการ และความมั่นใจในเกณฑ์วัดของตัวผู้ให้บริการเองก็ไม่เคยถูกทดสอบโดยบุคคลภายนอก ราคาถูกต่อโทเค็นกับการใช้เหตุผลที่เปิดตลอดเวลายังถือว่าราคาถูกต่องานในอัตราเหล่านี้ แต่ 'ถูก' กับ 'ได้รับการพิสูจน์แล้ว' เป็นคำกล่าวอ้างที่ต่างกัน และมีเพียงหนึ่งในสองโมเดลนี้เท่านั้นที่รองรับข้อที่สอง
ใครควรเลือกอันไหน
การตัดสินใจไม่ได้อยู่ที่ว่า "อันไหนดีกว่า" แต่อยู่ที่ว่า "โปรไฟล์ความเสี่ยงแบบไหนเหมาะกับปริมาณงาน":
• มีปริมาณสูง ผูกพันกับต้นทุน และเต็มใจที่จะแบกรับตัวเลขที่ไม่ผ่านการยืนยัน — DeepSeek V4 Pro คือตัวเลือกที่เน้นราคาต่ำสุด บริบท 1M และเอาต์พุต 384K ทำให้มันเป็นตัวเลือกที่แข็งแกร่งกว่าสำหรับงานบริบทยาวและงานแบบแบตช์ และอัตราอินพุตแคช ¥0.025 ทำให้ไพพ์ไลน์ที่ต้องเรียกค้นข้อมูลจำนวนมากแทบไม่มีค่าใช้จ่าย แค่ทดสอบด้วยตัวเอง เพราะไม่มีใครที่เป็นอิสระเคยทำไว้
• เอเจนต์เชิงลึกพร้อมสกอร์การ์ดอิสระ ในระบบนิเวศที่เข้ากันได้กับ OpenAI — คะแนน 61 ของ Grok 4.6 ได้รับการยืนยันแล้ว ทิศทางของเกณฑ์วัดด้านการเขียนโค้ดและเอเจนต์สอดคล้องกัน และจุดอ่อนปลายทางทราบล่วงหน้าแล้ว เวลา 42 วินาทีจนถึงโทเค็นแรกคือราคาที่คุณจ่ายสำหรับคุณภาพที่ได้รับการยืนยัน

• ทราฟฟิกแบบผสม — นี่คือกรณีที่ควรใช้การจัดเส้นทาง (routing) มากกว่าการเลือก บน OrcaRouter ทั้งสองโมเดลใช้คีย์เดียวกันในราคาแบบ pass-through ตามรายการผู้ให้บริการ — ดังนั้น ¥3/¥6 ของ DeepSeek จึงยังคงเป็น ¥3/¥6 บนใบแจ้งหนี้ และ Grok 4.6 ยังคงเป็น $2/$6 โดยไม่มีมาร์กอัปเพิ่มเติมทั้งคู่ กฎการจัดเส้นทางสามารถส่งงานที่ต้องใช้บริบทยาวและมีข้อจำกัดด้านต้นทุนไปที่ DeepSeek V4 Pro และส่งงานแบบ agentic ที่ผ่านการตรวจสอบแล้วไปที่ Grok 4.6 โดยแบ่งทราฟฟิกเป็นรายคำขอจนกว่าการประเมินของคุณเองจะสรุปการแบ่งสัดส่วน และใช้การ failover อัตโนมัติหากพฤติกรรมในสัปดาห์แรกของผู้ให้บริการรายใดรายหนึ่งขัดแย้งกับตัวเลขที่ประกาศเปิดตัว สำหรับโมเดลคู่หนึ่งที่เพิ่งเปิดตัวได้หนึ่งวันซึ่งอยู่คนละฝั่งของสงครามราคา ความสามารถในการเปรียบเทียบทั้งสองบนเวิร์กโหลดของคุณเอง — และปรับเปลี่ยนสัดส่วนการแบ่งโดยไม่ต้องแก้โค้ด — ไม่ใช่แค่ความสะดวกสบาย แต่เป็นวิธีเดียวที่สามารถปกป้องได้ในการนำโมเดลใดโมเดลหนึ่งมาใช้
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
