
วันที่วางจำหน่าย Grok 4.6: เปิดตัวเมื่อวันที่ 12 สิงหาคม ในราคาเดิม $2/$6
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
ในวันพุธที่ 12 สิงหาคม 2026 คำถามที่หน้านี้สร้างขึ้นมาเพื่อตอบนั้นไม่ใช่คำถามอีกต่อไป: Grok 4.6เปิดตัวแล้ว SpaceXAI — บริษัทที่ดำเนินการ Grok นับตั้งแต่เข้าซื้อกิจการสตาร์ทอัพในเดือนกุมภาพันธ์ 2026 และรีแบรนด์ในเดือนกรกฎาคม — ปล่อยโมเดลนี้ในราคา $2/$6 เท่ากับ Grok 4.5 บนรากฐาน V9 เดียวกัน มีหน้าต่างบริบทขนาด 500K โทเคนเท่ากัน และมัสก์เรียกมันว่า "a banger" บน X การเปิดตัวครั้งนี้ยุติข้อคำถามสองข้อที่หน้าก่อนหน้านี้กำลังติดตามอยู่ ได้แก่ โมเดลนี้มีอยู่จริง และเป็นการรีเฟรชหลังการเทรนในระดับเดียวกัน ไม่ใช่การขยายสเกล สิ่งเดียวที่ยังไม่ได้รับการยืนยันคือจำนวนพารามิเตอร์ ซึ่งยังไม่มีการเปิดเผยอย่างเป็นทางการ
เมื่อสัปดาห์ก่อน พาดหัวข่าวที่ตรงไปตรงมาคือ โมเดลยังไม่ได้เปิดตัว: เป้าหมาย "ราววันที่ 7 สิงหาคม" ที่มัสก์ตั้งไว้เมื่อวันที่ 27 กรกฎาคมนั้นล่าช้า และการประเมินที่ระดับสเกลเดิมก็ยังเป็นเพียงการคาดการณ์ หน้านี้แย้งว่าโมเดลดังกล่าวควรอ่านว่าคือการรีเฟรชที่สเกลไม่เปลี่ยนแปลง และการรีเฟรชที่สเกลไม่เปลี่ยนแปลงมักจะเปิดตัวโดยไม่ปรับราคาเพิ่ม วันเปิดตัวยืนยันครึ่งธุรกิจของการคาดการณ์นั้นอย่างแม่นยำ — $2/$6/$0.50 ต่อล้านโทเคน เท่ากับ Grok 4.5 ทุกประการ — และการวัดผลอิสระครั้งแรกก็เข้ามาแล้ว ด้านล่างคือสิ่งที่เปิดตัว ตัวเลขที่บอกเราจนถึงตอนนี้ และสิ่งที่ยังเป็นคำกล่าวจากผู้จำหน่าย
อะไรที่จัดส่งเมื่อวันที่ 12 สิงหาคม
Grok 4.6 เปิดใช้งานแล้วบน SpaceXAI API ในรหัสโมเดล grok-4.6 และใน Grok Build, Cursor และแอป Grok Bot; ผู้ใช้ Cursor และ Grok Build จะได้รับปริมาณการใช้งานที่รวมอยู่เป็นสองเท่าในสัปดาห์แรก มันเป็นโมเดลการให้เหตุผลที่มี chain-of-thought แบบขยาย รับอินพุตทั้งข้อความและรูปภาพ และให้ผลลัพธ์เป็นข้อความ และเพิ่มการตั้งค่า reasoning-effort ระดับ xhigh ใหม่เหนือค่าเริ่มต้น
API ยังคงใช้เอนด์พอยต์ที่เข้ากันได้กับ OpenAI และเพิ่มเครื่องมือสามอย่างบนฝั่งเซิร์ฟเวอร์: การค้นหาเว็บ, การค้นหา X และการเรียกใช้โค้ด สำหรับใครก็ตามที่เชื่อมต่อกับ Grok 4.5 ผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI อยู่แล้ว นั่นหมายความว่าการเปลี่ยนเป็นเพียงการเปลี่ยนสตริงโมเดล ไม่ใช่การเขียนไคลเอนต์ใหม่
สิ่งที่หน้านี้คาดการณ์ไว้ — และสิ่งที่เกิดขึ้นจริง
ข้อโต้แย้งของเวอร์ชันก่อนหน้านี้คือ คำพูดของมัสก์ที่ว่า "the 1.5T model with significantly improved SFT & RL" ชี้ไปที่การรีเฟรชในขนาดเดียวกัน และราคาจะคงเดิม ผลการเปิดตัวยืนยันทั้งสองส่วนของการคาดการณ์ทางธุรกิจ:
• ราคา: $2 / $6 / $0.50 (cache-hit) ต่อล้านโทเคน — เหมือนกับ Grok 4.5 การคาดการณ์ว่า "ไม่มีการเปลี่ยนแปลงราคา" เป็นจริง
• บริบท: 500K โทเคน เหมือนกับ Grok 4.5.
• ขนาด: ยังไม่มีการเปิดเผยอย่างเป็นทางการ ไม่มีจำนวนพารามิเตอร์ปรากฏในโมเดลการ์ด ดังนั้นตัวเลข 1.5T ของมัสก์จึงยังคงเป็นการอ้างที่ดีที่สุดที่มีอยู่ ไม่ใช่สเปกที่ได้รับการยืนยัน ตัวเลข 2T ที่แพร่หลายในการรายงานช่วงแรกเป็นการระบุผิดที่มาจาก 2.1T ของ Grok 4.7

ตัวเลขอิสระ — 61 บน Artificial Analysis Intelligence Index
การวัดโดยบุคคลที่สามครั้งแรกออกมาแล้ว และเป็นผลลัพธ์ที่ดี. Artificial Analysis ให้คะแนน Grok 4.6 ที่ 61 บน Intelligence Index — เสมอกับการกำหนดค่าแบบใช้เหตุผลสูงสุดของ GPT-5.6 Sol ตามหลัง Claude Fable 5 (62) อยู่ 1 คะแนน ตามหลัง Claude Opus 5 (63) อยู่ 2 คะแนน และนำหน้า Kimi K3 (60) นั่นคือการเพิ่มขึ้น 5 คะแนนจาก 56 ของ Grok 4.5 ซึ่งเป็นการพัฒนาครั้งใหญ่สำหรับการรีเฟรชหลังการฝึก.
มีข้อควรระวังสองประการที่มาพร้อมกับตัวเลขนี้ The Index เป็นค่าประกอบ และแต่ละมิติมีความหลากหลายมากกว่า และ Grok 4.6 เริ่มต้นช้า: ใช้เวลา 42 วินาทีในการสร้างโทเค็นแรก เทียบกับค่ามัธยฐานประมาณ 2.9 วินาทีสำหรับระดับราคาเดียวกัน และสร้างเอาต์พุตประมาณ 68 โทเค็นต่อวินาที ซึ่งช้ากว่าค่าเฉลี่ยของกลุ่มเดียวกัน นั่นเป็นเพียงสิ่งรบกวนเล็กน้อยสำหรับเอเจนต์ที่ทำงานต่อเนื่องยาวนาน แต่เป็นประสบการณ์ทั้งหมดสำหรับการแชทแบบโต้ตอบ
บนเส้นพรมแดนพาเรโตระหว่างความฉลาดกับต้นทุน ภาพที่ได้นั้นดูดี: ประมาณ 0.84 ดอลลาร์ต่องาน ทำงานทั่วไปของ AA-Briefcase ได้ในประมาณ 53 เทิร์น และใช้ input tokens ประมาณ 0.5B เมื่อเทียบกับ Claude Opus 5 Max ที่ใช้ประมาณ 103 เทิร์นและ ~2B ดังนั้นมันจึงเป็นข้อตกลงที่คุ้มค่าในระดับแนวหน้า ไม่ใช่แค่ถูกเท่านั้น.
สิ่งที่ยังคงระบุโดยผู้ขาย
ข้อกล่าวอ้างในการเปิดตัวของ SpaceXAI — "ความฉลาดเทียบเท่ากับ GPT-5.6 Sol และ Claude Fable 5" การปรับปรุงเหนือกว่า Grok 4.5 ในการประเมินทุกรายการที่ระบุไว้ โดยอ้างว่าเป็นผลมาจาก "การฝึกเสริมที่ยาวนานขึ้น ข้อมูลทางวิศวกรรมที่แข็งแกร่งขึ้น และการเรียนรู้แบบเสริมกำลังที่ขยายมากขึ้น" — เป็นข้อกล่าวอ้างจากผู้ขาย และยังไม่ได้รับการตรวจสอบอย่างอิสระ ตารางเกณฑ์มาตรฐานในการเปิดตัว (CursorBench, FrontierCode, APEX-Agents, Terminal-Bench และ Elo 1,753 ที่ถูกโปรโมตบน GDPval-AA v2) เป็นข้อมูลที่รายงานโดย xAI; ยังไม่มีตัวเลขใดในนั้นที่ได้รับการทำซ้ำโดยห้องปฏิบัติการที่ไม่ได้ขายโมเดลนี้
ผลการอ่านจากบุคคลที่สามครั้งแรกมาแล้ว (เบื้องต้น)
ผลลัพธ์จากสนามทดสอบอิสระเพียงรายการเดียวจนถึงตอนนี้เป็นเพียงข้อมูลเบื้องต้นแต่ก็เป็นจริง LMArena จัดอันดับ Grok 4.6 (ในชื่อ grok-4.6-high) อยู่ที่ #43 บนกระดานผู้นำโดยรวม Text ด้วย 1,464 Elo จาก 2,448 โหวต — ถูกทำเครื่องหมายว่าเป็นเพียงข้อมูลเบื้องต้น และต่ำกว่าการเปิดตัวครั้งแรกของ Grok 4.5 ที่ 1,468 อยู่ 4 จุด กลุ่มตัวอย่างเล็กเกินไปสำหรับตาราง frontier ที่ LMArena ติดตาม ซึ่งต้องใช้คะแนนที่คงที่เป็นเวลาสองสัปดาห์
กระดานผู้นำ Agent ของเซสชันสดยังไม่ได้รับการเผยแพร่ เมื่อเผยแพร่แล้ว มันจะเป็นการอ่านค่าครั้งแรกที่ไม่สามารถปรับให้เหมาะสมล่วงหน้าได้

การคิดราคา
ที่ $2/$6 Grok 4.6 เป็น API แนวหน้าที่ถูกที่สุดในรุ่นปัจจุบันอย่างเห็นได้ชัด เมื่อเทียบกับ GPT-5.6 Sol ที่ $5/$30 อินพุตถูกกว่า 60% และเอาต์พุตถูกกว่า 80% — และเพราะช่องว่างที่กว้างกว่าในฝั่งเอาต์พุต กลยุทธ์การตลาดแบบ "ราคาครึ่งเดียว" จึงทำให้การประหยัดในงานเขียนโค้ดที่ใช้เอาต์พุตหนักๆ ดูต่ำกว่าความเป็นจริง
รายละเอียดปลีกย่อย: คำขอที่มีโทเค็นนำเข้ารวมมากกว่า 200K จะขยับขึ้นไปอยู่ในระดับ $4 / $12 / $1 และตัวเลือกที่เร็วกว่าจะมีค่าใช้จ่ายเป็นสองเท่า สำหรับการสลับ ตัวเลขแทบไม่ขยับ — Grok 4.5 และ Grok 4.6 มีราคาและบริบทเดียวกัน ดังนั้นการย้ายระหว่างทั้งคู่จึงเป็นการเปลี่ยนการตั้งค่า ไม่ใช่การตัดสินใจเรื่องงบประมาณ
เนื่องจาก OrcaRouter ส่งต่อราคารายการของผู้ให้บริการโดยตรงที่มาร์กอัป 0% ตัวเลข $2/$6 บนเอนด์พอยต์ grok-4.6 จึงเป็นตัวเลขของ SpaceXAI เอง ไม่ใช่อัตราการขายต่อ — การลดราคาของผู้จำหน่ายจะมาถึงที่นี่ในวันเดียวกัน และการเฟลโอเวอร์ไปยังผู้ให้บริการรายที่สองเป็นกฎการจัดเส้นทาง ไม่ใช่กระบวนการจัดซื้อจัดจ้าง
Grok 4.7 และ Grok 5 ยังคงนำอยู่
Grok 4.7 คือก้าวถัดไป และคำอธิบายของมัสก์ก็ไม่เปลี่ยนแปลง: "โมเดล 2.1T" ที่ดีกว่า Grok 4.6 "ในทุกด้าน ยกเว้นให้บริการช้าลงเล็กน้อย" เมื่อวันที่ 5 สิงหาคม เขาบอกว่าใช้เวลาอีกสามถึงสี่สัปดาห์ ซึ่งตรงกับปลายเดือนสิงหาคมหรือต้นเดือนกันยายน ไทม์ไลน์ดังกล่าวเป็นคำกล่าวของมัสก์เอง และมันก็เลื่อนออกไปเรื่อยๆ ในทุกครั้งที่มีการกล่าวถึง ดังนั้นควรถือเป็นเพียงแนวทางคร่าวๆ เท่านั้น
Grok 5 มีกำหนดเปิดตัวช่วงสิ้นปี โดยฝึกฝน — ตามการประชุมผลประกอบการวันที่ 4 สิงหาคม — ด้วย "ข้อมูลทั้งหมดที่ SpaceX เคยสร้างขึ้นมา"
สิ่งที่ควรตรวจสอบต่อไป
สี่สิ่งจะทำให้ภาพชัดเจนขึ้น และในปัจจุบันแต่ละอย่างยังคงอ่านว่าเปิดอยู่:
• ลีดเดอร์บอร์ด LMArena Agent ยังไม่เผยแพร่ ณ วันที่ 13 สิงหาคม
• การทำซ้ำโดยบุคคลที่สามของตัวเลขผลการวัดด้านการเขียนโค้ดและเอเจนต์ — DeepSWE, CursorBench, APEX-Agents จากผู้ที่ไม่ได้ขายโมเดล
• ราคาจริงและความหน่วงของรุ่นที่เร็วกว่าเมื่อวางจำหน่ายอย่างแพร่หลาย
• ว่าไทม์ไลน์ปลายเดือนสิงหาคมของ Grok 4.7 จะยังคงเป็นจริงหรือไม่ เมื่อพิจารณาว่าวันที่เฉพาะแต่ละวันที่ผ่านมานั้นล่าช้าออกไปสองสามวัน
และสิ่งเดียวที่สำคัญจริงๆ สำหรับการตัดสินใจ: ภาระงานของคุณเอง ตำแหน่งบนลีดเดอร์บอร์ดเป็นเพียงสมมติฐานเกี่ยวกับงานของคุณ ไม่ใช่ผลลัพธ์ของงานนั้น
คำถามที่พบบ่อย
Grok 4.6 เปิดตัวจริงเมื่อไหร่?12 สิงหาคม 2026 บน SpaceXAI API และใน Grok Build, Cursor และแอป Grok Bot เป้าหมายของมัสก์เมื่อวันที่ 27 กรกฎาคมที่ว่า "ประมาณวันที่ 7 สิงหาคม" ล่าช้าไปห้าวัน; วลี "สัปดาห์หน้า" จากการประชุมผลประกอบการวันที่ 4 สิงหาคมคือช่วงเวลาที่แม่นยำ
Grok 4.6 ราคาเท่าไร? $2 / $6 / $0.50 ต่อล้านโทเคน — เท่ากับ Grok 4.5 และต่ำกว่า GPT-5.6 Sol ที่ $5/$30 มาก หากเกิน 200K อินพุตโทเคน ราคาจะขยับขึ้นเป็น $4 / $12 / $1 และเวอร์ชันที่เร็วกว่าจะมีราคาเป็นสองเท่า
Grok 4.6 เป็นโมเดล 2T หรือไม่? ยังไม่มีการเผยแพร่จำนวนพารามิเตอร์ ตัวเลข 1.5T ของ Musk ยังคงเป็นข้อมูลอ้างอิงที่ดีที่สุดที่มีอยู่ (ยังไม่ได้รับการยืนยัน) ส่วนตัวเลข 2T ที่แพร่หลายนั้นเป็น 2.1T ของ Grok 4.7 ที่ถูกระบุผิดว่าเป็น 4.6
Grok 4.6 เก่งเท่า GPT-5.6 Sol หรือไม่?ในดัชนี Artificial Analysis Intelligence Index ทั้งคู่มีคะแนนเท่ากันที่ 61 (การกำหนดค่าแบบใช้เหตุผลสูงสุด) ผู้จำหน่ายอ้างว่ามันเทียบเท่ากับ GPT-5.6 Sol และ Claude Fable 5 มันช้าอย่างเห็นได้ชัดในเรื่องเวลาจนกว่าจะได้รับโทเค็นแรก และถูกกว่ามาก ข้อได้เปรียบด้าน agentic ยังต้องรอการตรวจสอบโดยอิสระ
สิ่งนี้ทำให้คุณอยู่ตรงไหน
แนวทางปฏิบัติยังคงไม่เปลี่ยนแปลงจากเวอร์ชันก่อนเปิดตัวของหน้านี้ หากโค้ดของคุณเชื่อมต่อกับ Grok 4.5 ผ่าน endpoint ที่เข้ากันได้กับ OpenAI อยู่แล้ว Grok 4.6 ก็เป็นเพียงการเปลี่ยนการกำหนดค่าราคาเท่าเดิม — สลับสตริงโมเดล คงบรรทัดงบประมาณเดิมไว้ แล้วรัน evals ใหม่ เพราะบิลด์ใหม่ หากยังไม่ได้เชื่อมต่อ endpoint แบบ pass-through-pricing เพียงตัวเดียวก็ทำให้สามารถสลับไปใช้โมเดล frontier ใหม่ได้โดยไม่ต้องเสี่ยงเส้นทางการผลิตกับ benchmark ในสัปดาห์แรก ซึ่งก็คือสิ่งที่ตัวเลข arena เบื้องต้นเหล่านั้นเป็นอยู่นั่นเอง

การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
