
Grok 4.7 คืออะไร? สเปก ราคา หน้าต่างบริบท และเบนช์มาร์ก
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 300 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 195 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 112 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
Grok 4.7เป็นโมเดลเรือธงรุ่นปัจจุบันของ SpaceXAI: โมเดลแบบให้เหตุผลที่รับข้อความและรูปภาพเข้า และส่งออกเป็นข้อความ มีหน้าต่างบริบทขนาด 500,000 โทเคน และมีราคาอยู่ที่ 2.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 6.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน โดยเลือกระดับความเข้มข้นในการให้เหตุผลได้สี่ระดับ และสืบทอดตำแหน่งจาก Grok 4.6โดยมีราคาและขนาดบริบทตรงกันทุกประการ และมุ่งเป้าไปที่งานระยะยาว — การเขียนโค้ดที่ใช้เวลาหลายชั่วโมง ลูปการใช้เครื่องมือแบบเอเจนติก งานความรู้ระดับมืออาชีพ — ซึ่งตอนนี้บริษัทขายผลิตภัณฑ์ทั้งสายโดยมีงานเหล่านี้เป็นแกน หน้านี้เป็นหน้าอ้างอิงสำหรับโมเดลนี้: โมเดลคืออะไร อยู่ในตำแหน่งใด รองรับอะไรได้บ้าง ราคาเท่าไร จากนั้นเป็นสองส่วนที่จงใจแยกออกจากกัน — สิ่งที่ SpaceXAI พูดเกี่ยวกับโมเดลของตัวเอง และสิ่งที่ผู้ประเมินอิสระวัดได้
ทำไมหน้านี้จึงเป็นหน้าอ้างอิง ไม่ใช่ข่าวการเปิดตัว Grok 4.7 เปิดตัวเมื่อวันที่ 21 กันยายน 2026 และการเปิดตัวนั้นได้รับการรายงานไปแล้วในบล็อกนี้ (ดู grok-4-7-release-date สำหรับการอ่านในวันแรก) ดังนั้นวันที่ด้านล่างจึงถูกใช้เป็นข้อเท็จจริงที่ระบุอายุของโมเดล ไม่ใช่เป็นเหตุการณ์ที่ถูกรายงานซ้ำ ผู้อ่านที่หน้านี้มีไว้เพื่อคือคนที่พิมพ์ชื่อเปล่า ๆ ของโมเดลลงในช่องค้นหาและต้องการตัวโมเดล ไม่ใช่ข่าว: ในช่วง 28 วันจนถึงวันที่ 25 กันยายน 2026 ข้อมูล Search Console ของเราเองบันทึกการแสดงผล 31,934 ครั้งสำหรับคำค้นหาที่ตรงกับ "grok 4.7" และ 34,160 ครั้งสำหรับทุกการสะกดที่ลดรูปเหลือชื่อนั้น โดยมีอันดับเฉลี่ยอยู่ที่ 7.8 ทั้งที่ไม่มีหน้าเฉพาะให้ผลลัพธ์ไปลง นั่นคือการวัดสิ่งที่ผู้คนพิมพ์ — ไม่ได้บอกอะไรว่าตัวโมเดลดีแค่ไหน — และนั่นคือเหตุผลที่หน้าเว็บนี้เริ่มต้นด้วยคำถามที่ตรงไปตรงมาที่สุด ทุกตัวเลขในบทความนี้มีป้ายกำกับว่ามาจากไหน: รายงานโดยผู้ขาย สำหรับสิ่งใดก็ตามที่มาจากเอกสาร โพสต์เปิดตัว หรือหน้าราคาของ SpaceXAI เอง อิสระ สำหรับ Artificial Analysis และ ของเราเอง สำหรับสิ่งที่แค็ตตาล็อกและข้อมูลการค้นหาของเราแสดงให้เห็น
Grok 4.7 อยู่ตรงไหนในสาย Grok
ตอนนี้ผู้ให้บริการเขียนชื่อของตนว่า SpaceXAI ทั้งในเอกสารสำหรับนักพัฒนาและหน้าข่าว ขณะที่ API เองยังให้บริการจาก api.x.ai และตัวระบุโมเดลก็ยังเป็นแบบ grok อยู่ Grok 4.7 เป็นรุ่นสูงสุดในสายข้อความ และเป็นคำแนะนำเริ่มต้นของผู้ให้บริการเอง เมื่อถูกถามว่าควรเลือกโมเดลใด หน้าโมเดลตอบว่าสำหรับทุกอย่างยกเว้นงานด้านเสียง ภาพ และวิดีโอ — "รวมถึงโค้ด" — คุณควรใช้ Grok 4.7 เพราะ "มันเป็นโมเดลที่ความสามารถสูงที่สุดที่เราสร้างมา" รุ่นพี่น้องของมัน ตามอัตราที่ผู้ให้บริการเผยแพร่เองต่อหนึ่งล้านโทเคน มีดังนี้
• Grok 4.6 — บริบท 500K, อินพุต $2.00 / แคช $0.50 / เอาต์พุต $6.00, เปิดตัวเดือนสิงหาคม 2026 เป็นรุ่นก่อนหน้าโดยตรง และเป็นรุ่นที่ใช้เทียบราคาสำหรับ 4.7
• Grok 4.5 — คอนเท็กซ์ 500K, อินพุต $2.00 / แคช $0.30 / เอาต์พุต $6.00, วางจำหน่ายกรกฎาคม 2026 ราคาป้ายเท่ากับรุ่นที่มาทีหลัง แต่มีอัตราค่าแคชที่ถูกกว่า ซึ่งตอนนี้เป็นเหตุผลที่เป็นรูปธรรมเพียงข้อเดียวที่ยังทำให้ควรเลือกใช้มัน
• Grok 4.3 — คอนเท็กซ์ 1M, อินพุต $1.25 / แคช $0.20 / เอาต์พุต $2.50 ราคาครึ่งหนึ่งของรุ่นเรือธงปัจจุบัน และหน้าต่างคอนเท็กซ์ใหญ่เป็นสองเท่า
• Grok 4.20 (แบบ reasoning, แบบ non-reasoning และแบบ multi-agent) — บริบท 1M, อินพุต $1.25 / แคช $0.20 / เอาต์พุต $2.50
• Grok Build 0.1 — บริบท 256K, อินพุต $1.00 / แคช $0.20 / เอาต์พุต $2.00 เป็นผู้เชี่ยวชาญด้านการเขียนโค้ดมากกว่าเป็นโมเดลทั่วไป และโมเดลเริ่มต้นของเอเจนต์ Grok Build คือ Grok 4.7 ไม่ใช่ตัวนี้
ดังนั้นโครงสร้างของไลน์ปัจจุบันคือการแลกเปลี่ยนระหว่างขีดความสามารถกับขนาดหน้าต่างบริบท: เรือธงให้บริบท 500K ในราคา $2/$6 และระดับ 4.3/4.20 ให้หนึ่งล้านโทเค็นเต็มในราคาอินพุตประมาณครึ่งหนึ่ง และราคาเอาต์พุตน้อยกว่าครึ่งหนึ่ง ไม่มีสิ่งใดในเอกสารของผู้จำหน่ายที่บ่งชี้ว่า Grok 4.7 เป็นสถาปัตยกรรมที่แตกต่างจาก Grok 4.6 — สิ่งที่การเปิดตัวอธิบายคือโมเดลฐานที่ใหญ่ขึ้น การรันการเรียนรู้แบบเสริมกำลังที่นานขึ้นซึ่งให้น้ำหนักกับงานที่ใช้เวลาหลายชั่วโมงจึงจะเสร็จ การตรวจสอบตนเองที่ดีขึ้น การจัดการบริบทแบบยาวที่ดีขึ้น และการฝึกบนฮาร์เนส Grok Bot เพื่อให้โมเดลทำงานได้ดีขึ้นในงานสนทนาและงานความรู้ทั่วไป เป็นการอ้างถึงการปรับปรุง ไม่ใช่การออกแบบใหม่ SpaceXAI ไม่เปิดเผยจำนวนพารามิเตอร์สำหรับ Grok 4.7 ทั้งในหน้าโมเดลหรือตารางราคา และหน้านี้จะไม่คาดเดาจำนวนนั้น
เมื่อมันเปิดตัว และสิ่งที่มาพร้อมกับมัน
โพสต์เปิดตัวลงวันที่ 21 กันยายน 2026 และหน้าโมเดลสำหรับนักพัฒนาก็ระบุวันที่เดียวกันเป็นวันที่อัปเดตล่าสุด ซึ่งถือเป็นความละเอียดมากที่สุดเท่าที่จะทำได้ — SpaceXAI ไม่เผยแพร่เวลาการเปิดตัวที่ละเอียดไปกว่าระดับวัน สิ่งที่เปิดตัวในวันนั้นไม่ใช่แค่ชื่อรหัสของโมเดลgrok-4.7 สลักนี้เปิดใช้งานทั้งบน Responses API และ Chat Completions ด้วยหน้าต่างบริบท 500,000 โทเคน จุดตัดความรู้เดือนพฤษภาคม 2026 ระดับการให้เหตุผลสี่ระดับ รวมถึงการตั้งค่าระดับสูงสุดแบบใหม่ ตัวแปร Fast ที่จำกัดไว้เฉพาะสองพื้นผิวของบริษัทเอง ปลายทางภูมิภาคเฉพาะสหรัฐฯ และราคาตามรายการที่เหมือนกับของ Grok 4.6 ทุกประการ ในเวลาเดียวกันก็ถูกตั้งเป็นโมเดลเริ่มต้นของ Grok Build เอเจนต์เขียนโค้ด และเปิดให้ใช้ใน Cursor ทุกแพ็กเกจ หากคุณต้องการปฏิกิริยาในวันแรกมากกว่าข้อกำหนดทางเทคนิค บทความgrok-4-7-release-dateครอบคลุมเรื่องนั้นไว้แล้ว หน้านี้ถือว่าวันที่เดียวกันเป็นข้อเท็จจริงเกี่ยวกับโมเดล และมุ่งต่อไปยังสิ่งที่มันจะทำเพื่อคุณได้จริง
ซองข้อมูล: สิ่งที่คุณส่งได้ และส่งได้มากแค่ไหน
ทั้งหมดต่อไปนี้มาจากหน้าของโมเดลและหน้าโมเดลของ SpaceXAI เอง โดยอ่านเมื่อวันที่ 28 กันยายน 2026 เว้นแต่จะระบุไว้เป็นอย่างอื่น

• หน้าต่างบริบท — 500,000 โทเค็น เท่ากับ Grok 4.6 ซึ่งเป็นครึ่งหนึ่งของที่ Grok 4.3 และตระกูล 4.20 มีให้
• จุดตัดความรู้ — พฤษภาคม 2026 ช้ากว่าของ Grok 4.6 อยู่สามเดือน ข้อมูลใดที่ใหม่กว่านั้นต้องใช้เครื่องมือค้นหาที่เปิดใช้งานอยู่ โมเดลไม่มีความรับรู้แบบเรียลไทม์โดยค่าเริ่มต้น
• อินพุต — ข้อความและรูปภาพ รูปภาพอาจเป็น JPG/JPEG หรือ PNG ขนาดไม่เกิน 20 MiB ต่อรูป และผู้ขายไม่ได้ระบุเพดานจำนวนรูปภาพในหนึ่งคำขอ; รูปภาพและข้อความอาจปรากฏในลำดับใดก็ได้
• เอาต์พุต — ข้อความเท่านั้น โมเดลนี้ไม่มีความสามารถในการสร้างภาพ เสียง หรือวิดีโอ สิ่งเหล่านั้นเป็นโมเดลแยกต่างหากในสายของ SpaceXAI
• เพดานเอาต์พุต — ผู้ให้บริการระบุว่าไม่มีขีดจำกัดการส่งออกข้อความ การ์ดโมเดล OrcaRouter ของเราเองสำหรับ grok-4.7 ระบุเอาต์พุตสูงสุด 450,000 โทเคน และตัวเลขทั้งสองไม่ตรงกัน เรากำลังตั้งข้อสังเกตไว้แทนที่จะเลือกตัวเลขใดตัวเลขหนึ่งอย่างเงียบ ๆ เอกสารของ SpaceXAI ถือเป็นแหล่งอ้างอิงที่เชื่อถือได้สำหรับโมเดลของ SpaceXAI และการอ่านตามตรงก็คือผู้ให้บริการไม่ได้เผยแพร่เพดานการส่งออกข้อความ
• การควบคุมการใช้เหตุผล — reasoning_effortรองรับค่า low, medium, high (ค่าเริ่มต้นของผู้พัฒนา) หรือ xhigh โดย xhigh เป็นค่าใหม่ในรุ่นนี้ Grok 4.6 ก็มีให้เลือกสี่ระดับเช่นกัน และตัวเลขเบนช์มาร์กที่เผยแพร่สำหรับ 4.7 นั้นอ้างอิงที่ค่า xhigh
• เครื่องมือ — การเรียกใช้ฟังก์ชัน การค้นหาเว็บ การค้นหา X และการรันโค้ด ทั้งหมดมีเอกสารกำกับเป็นเครื่องมือฝั่งเซิร์ฟเวอร์
• เอาต์พุตแบบมีโครงสร้าง — ผู้ขายได้จัดทำเอกสารความสามารถด้านเอาต์พุตแบบมีโครงสร้างควบคู่ไปกับการสร้างข้อความ หน้าเพจของเราเองแสดงความสามารถนี้ในชื่อ response_format และ structured_outputs.
• พารามิเตอร์ที่หน้าเพจของเรารองรับ ได้แก่ include_reasoning, logprobs, max_tokens, reasoning, reasoning_effort, response_format, seed, structured_outputs, temperature, tool_choice, tools, top_logprobs และ top_p ข้อควรระวังหนึ่งที่ควรทราบก่อนที่คุณจะสร้างบน logprobs: หน้าเพจโมเดลของ SpaceXAI ระบุว่า logprobs และ top_logprobs ไม่ได้รับการรองรับโดย grok-4.20 และโมเดลที่ใหม่กว่า และ "จะถูกเพิกเฉยอย่างเงียบ ๆ หากตั้งค่าไว้" ซึ่งครอบคลุมถึง Grok 4.7 การที่หน้าเพจของเราแสดงรายการพารามิเตอร์เหล่านี้ไม่ใช่คำมั่นสัญญาว่าต้นทางจะส่งคืนค่าเหล่านี้
• ปลายทาง (Endpoints) — API Chat Completions ที่เข้ากันได้กับ OpenAI และ API Responses
• การแคชพรอมต์ — ผู้ให้บริการแนะนำให้ตั้งค่า prompt_cache_key บน Responses API ( x-grok-conv-id เฮดเดอร์บน Chat Completions) เพื่อให้คำขอของบทสนทนาไปที่เซิร์ฟเวอร์เดียวกัน; หากไม่มีมัน เอกสารเตือนว่า คุณมักจะจ่ายราคาอินพุตเต็มบนเซิร์ฟเวอร์ที่แคชเย็น อินพุตที่แคชไว้จะถูกคิดค่าบริการที่ $0.50 ต่อล้านโทเค็นเมื่อต่ำกว่าเกณฑ์ 200K.
• การให้เหตุผลแบบเข้ารหัส — บน Responses API Grok 4.7 จะส่งคืน reasoning.encrypted_contentเสมอ แม้ว่าคุณจะไม่ได้ร้องขอ ทำให้การเรียกแบบหลายรอบยังคงเก็บการให้เหตุผลของโมเดลไว้ได้โดยไม่ต้องตั้งค่าเพิ่มเติม ส่วน Chat Completions ไม่มีการเปลี่ยนแปลง
เรตการ์ด หรือพูดอีกนัยหนึ่ง
การกำหนดราคาแบ่งเป็นขั้นตามขนาดพรอมป์ต์ และเมื่อข้ามเกณฑ์แล้ว เกณฑ์นั้นจะใช้กับคำขอทั้งหมด ไม่ใช่เฉพาะโทเค็นที่เกินเกณฑ์เท่านั้น ตัวเลขทุกตัวที่นี่เป็นข้อมูลที่ผู้ขายเผยแพร่เอง อ่านจากหน้าการกำหนดราคาของ SpaceXAI เมื่อวันที่ 28 กันยายน 2026:
• มาตรฐาน พร้อมท์ต่ำกว่า 200K โทเคน — $2.00 อินพุต / $0.50 อินพุตที่แคชไว้ / $6.00 เอาต์พุต ต่อล้านโทเคน
• คอนเท็กซ์ยาว พรอมต์ที่ 200K โทเคนขึ้นไป — $4.00 อินพุต / $1.00 อินพุตที่แคชไว้ / $12.00 เอาต์พุตต่อล้านโทเคน
• Grok 4.7 Fast — โมเดลเดียวกันบนโครงสร้างพื้นฐานที่เร็วกว่า ในอัตราสองเท่าของอัตรามาตรฐาน: $4.00 / $1.00 / $12.00 สำหรับต่ำกว่า 200K และ $6.00 / $1.50 / $18.00 สำหรับสูงกว่านั้น ใช้งานได้เฉพาะผ่าน Cursor และ Grok Build เท่านั้น ไม่มีใน public API เลย และแพ็กเกจฟรีของ Grok Build ก็ไม่รวมโมเดลนี้
• US regional endpoint — https://us.api.x.ai/v1 keeps inference in the United States and bills at 1.1×, which works out to $2.20 / $0.55 / $6.60 per million below 200K and $4.40 / $1.10 / $13.20 above. Only grok-4.7 and grok-4.6 are served there today.
เมื่ออ่านเทียบกับส่วนที่เหลือของตลาด สิ่งที่น่าสนใจไม่ใช่อัตราที่พาดหัว — ราคาอินพุต $2 และราคาเอาต์พุต $6 เป็นอัตราที่ Grok 4.6 เคยคิด และเป็นอัตราที่ Grok 4.5 ยังคิดอยู่ — แต่เป็นส่วนลดแคช ซึ่งผู้ขายประกาศไว้ที่ส่วนลด 75% สำหรับอินพุตของคำนำหน้าพรอมป์ที่ส่งซ้ำ สำหรับลูปของเอเจนต์แบบยาวที่ส่งพรอมป์ระบบและบริบทไฟล์ชุดเดิมซ้ำทุกเทิร์น ส่วนลดนั้นคือความต่างระหว่างราคาตามรายการกับบิลที่ต้องจ่ายจริง และยังเป็นจุดเดียวที่ Grok 4.7 ด้อยกว่ารุ่นพี่อย่าง Grok 4.5: Grok 4.5 คิดค่าแคชที่ $0.30 ต่อล้าน เทียบกับ $0.50 ของ Grok 4.7
Grok 4.7 อยู่บน OrcaRouter ในชื่อ grok/grok-4.7 ในราคาตามที่ SpaceXAI กำหนดเองโดยบวกเพิ่ม 0% — ราคาจากผู้ให้บริการถูกส่งผ่านมาตรง ๆ ดังนั้นการเปลี่ยนแปลงราคาจากผู้ขายจึงมีผลที่นี่ในวันเดียวกัน แทนที่จะเป็นหลังจากการปรับราคาอีกรอบ สิ่งนี้สำคัญกว่าปกติสำหรับโมเดลที่มีเกณฑ์พรอมป์ตสองระดับและอัตราแคช เพราะทั้งสองอย่างนั้นส่งผลต่อสิ่งที่คุณจ่ายจริง มันคือคีย์เดียวและปลายทางที่เข้ากันได้กับ OpenAI เพียงหนึ่งเดียวสำหรับไลน์ Grok ทั้งหมด ดังนั้นการสลับเวิร์กโหลดจาก Grok 4.7 ไปเป็น Grok 4.5 หรือ 4.3 เพื่อทดสอบความต่างของค่าใช้จ่ายจึงเป็นการเปลี่ยนสตริงแทนที่จะเป็นสัญญาอีกฉบับ
สิ่งที่ SpaceXAI อ้างสำหรับมัน
ทุกอย่างในส่วนนี้เป็นข้อมูลที่ผู้พัฒนาเป็นผู้รายงานเอง ไม่มีส่วนใดได้รับการทำซ้ำอย่างอิสระแม้แต่รายการเดียว และการตั้งค่าระดับความพยายาม (effort) ก็มีผล — ตารางในโพสต์เปิดตัวระบุว่า Grok 4.7 ใช้ xHigh, Grok 4.6 ใช้ High และโมเดลเปรียบเทียบทั้งสองตัวใช้ Max ซึ่งไม่ใช่การเปรียบเทียบที่ตั้งเงื่อนไขให้ตรงกัน
CursorBench 4.0 — 46.3% สำหรับ Grok 4.7 ที่ xHigh เทียบกับ 40.4% สำหรับ Grok 4.6 ที่ High กรอบที่โพสต์เปิดตัวกำหนดขึ้นเองก็คือ นี่คือจุดที่ Grok 4.7 อยู่ “ที่แนวหน้าด้านราคาต่อประสิทธิภาพ”
• Terminal-Bench 4.0 — 37.6% เทียบกับ 20.3% ของ Grok 4.6 นี่คือส่วนต่างเดี่ยวที่ใหญ่ที่สุดในการเปิดตัวครั้งนี้ และเป็นส่วนที่ตรงกับคำกล่าวอ้างเรื่อง "การฝึก RL ที่นานขึ้นบนงานที่ยากขึ้น"
• DeepSWE v1.1 — 71.0% ซึ่งในตารางของผู้จำหน่ายเองระบุว่าเป็นคะแนนแบบใช้ความพยายามสูง เทียบกับ 65.2% ของ Grok 4.6
• AA Briefcase v1.1 — 1,657 เทียบกับ 1,546 สำหรับ Grok 4.6 หมายเหตุความซ้ำกันของชื่อตรงนี้: นี่คือผู้ขายที่อ้างอิงเบนช์มาร์กซึ่ง Artificial Analysis ก็ดำเนินการเช่นกัน และผลลัพธ์ที่เป็นอิสระจะถูกกล่าวถึงในหัวข้อถัดไป
• EEBench — 64.0% เทียบกับ 53.0% ของ Grok 4.6
• Harvey Legal Agent Benchmark — 19.6% เทียบกับ 15.8% สำหรับ Grok 4.6
• HealthBench Professional — 56.7% เทียบกับ 48.5% สำหรับ Grok 4.6
• GDPval — 1,695 Elo ที่ xhigh เทียบกับ 1,605 สำหรับ Grok 4.6 ที่ high
ข้อกล่าวอ้างด้านความปลอดภัยก็เป็นข้อมูลที่ผู้ขายรายงานเช่นกัน และเจาะจงอย่างผิดปกติ: SpaceXAI กล่าวว่า Grok 4.7 ถูกสร้างบนชุดระบบป้องกันใหม่ ว่ามันได้คะแนนสูงสุดในเกณฑ์มาตรฐานความปลอดภัยทางชีวภาพของ LatchBio ที่ 62.4% และว่าใน HackerBench v0.3 ของตัวเอง มันปล่อยให้พรอมต์แบบ dual-use ที่มีความเสี่ยงผ่านเพียง 3.3% ขณะที่แทบไม่บล็อกงานด้านความปลอดภัยที่ชอบด้วยกฎหมาย บริษัทยังกล่าวอีกว่าได้เริ่มให้พันธมิตรด้านความมั่นคงปลอดภัยไซเบอร์ที่คัดเลือกแล้วเข้าถึงความสามารถด้าน red-team ของโมเดลแบบเฉพาะผู้ได้รับเชิญ ควรถือว่าทั้งหมดนั้นเป็นการทดสอบโมเดลของตัวเองโดยผู้ขายเอง — มันเป็นชุดข้อกล่าวอ้างที่เจาะจงพอจะตรวจสอบภายหลังได้ ซึ่งไม่เหมือนกับการตรวจสอบแล้วในตอนนี้ ประโยคระบุจุดยืนหนึ่งบรรทัดในโพสต์เปิดตัวที่ว่า "เร็วเป็นสองเท่า ในราคาครึ่งหนึ่งของโมเดลที่เทียบเคียงได้" เป็นการตลาดเกี่ยวกับคู่แข่งมากกว่าการวัดค่า Grok 4.7 และตัวเลขความเร็วจากแหล่งอิสระด้านล่างไม่สนับสนุนครึ่งที่เป็น "เร็วเป็นสองเท่า" ของข้อความนั้น

สิ่งที่ผู้ประเมินอิสระวัด
Artificial Analysis เป็นแหล่งข้อมูลเดียวในเรื่องนี้ที่ไม่มีส่วนได้ส่วนเสียในโมเดล และหน้า Grok 4.7 ของแหล่งนี้เป็นคอนฟิกูเรชัน xhigh อย่างชัดเจน อ่านเมื่อวันที่ 28 กันยายน 2026:
• ความฉลาด — 46 บน Artificial Analysis Intelligence Index, ดัชนีเวอร์ชัน v4.3.2 ซึ่งอยู่ในอันดับที่ 21 จาก 211 โมเดลบนบอร์ดนั้น และสูงกว่าค่ามัธยฐานของดัชนีที่ 26 อย่างมาก ดัชนีนี้เป็นการประกอบรวมของการประเมินสิบรายการ: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience และ AA-LCR v1.1
• ค่าใช้จ่าย — $3.74 ต่อการรัน Intelligence Index หนึ่งครั้ง โดยผู้ประเมินรายเดียวกันเผยแพร่ว่าส่วนลดแคชอยู่ที่ 75% และอัตราอินพุต/เอาต์พุตที่ตรงกับของผู้จำหน่าย ($2.00 / $6.00) ความเห็นของมันเองคือโมเดลนี้ "ราคาสมเหตุสมผลเมื่อเทียบกับโมเดลอื่นในราคาใกล้เคียง"
• ความละเอียดมากเกินไป (Verbosity) — โทเคนเอาต์พุต 240M ที่สร้างขึ้นทั่วทั้ง Intelligence Index เทียบกับค่ามัธยฐานที่ 88M Artificial Analysis เรียกสิ่งนี้ว่า "very verbose" และมันเป็นตัวเลขที่มีประโยชน์ที่สุดเพียงหนึ่งเดียวตรงนี้สำหรับใครก็ตามที่ต้องจัดงบประมาณ: โมเดลที่คิดเป็นลูกโซ่ยาวขึ้นจะเสียค่าใช้จ่ายต่องานมากขึ้น แม้จะใช้อัตราโทเคนคงที่ก็ตาม
• ความเร็ว — 82.6 โทเคนเอาต์พุตต่อวินาที อยู่อันดับ 83 จาก 211 บนบอร์ดนั้น ซึ่งผู้ประเมินก็ยังติดป้ายว่า "ช้ากว่าค่าเฉลี่ย" มีข้อควรระวังสองประการก่อนที่คุณจะนำตัวเลขนี้ไปอ้างอิงที่ใด ๆ Artificial Analysis ได้เปลี่ยนภาระงานมาตรฐานสำหรับการวัดประสิทธิภาพเป็นอินพุตขนาด 10,000 โทเคน เพื่อสะท้อนการใช้งานจริงในโปรดักชันได้ดียิ่งขึ้น และค่าความเร็วที่เผยแพร่สำหรับโมเดลนี้มีการเปลี่ยนแปลงอย่างมีนัยสำคัญระหว่างสแนปช็อต ดังนั้นจึงควรมองมันเป็นสแนปช็อตของภาระงานหนึ่ง ไม่ใช่ค่าคงที่ ในด้านผู้ให้บริการ API ผู้ประเมินรายเดียวกันนี้มีผู้ให้บริการเพียงรายเดียวที่ระบุไว้สำหรับโมเดลนี้ — SpaceXAI เอง — ดังนั้นค่าแลเทนซีและราคาแบบผสมที่วัดได้จึงเป็นตัวเลขจากเจ้าของโดยตรง ไม่ใช่สเปรดของตลาด
แค็ตตาล็อกของเราเองมีผลลัพธ์ของ Artificial Analysis สำหรับ Grok 4.7 เพิ่มอีกสามรายการ ซึ่งประเมินเมื่อวันที่ 21 กันยายน 2026: 43.1% ใน Humanity's Last Exam, 76.7% ในการประเมินการเรียกคืนบริบทยาว และ 57.4% ใน SciCode ผลลัพธ์เหล่านี้ถูกติดป้ายว่าเป็นอิสระเนื่องจากมาจาก Artificial Analysis และควรอ่านควบคู่กับคำกล่าวอ้างเรื่องการตรวจสอบยืนยันด้วยตนเองของผู้ขาย มากกว่าจะถือเป็นการยืนยันคำกล่าวอ้างเหล่านั้น
ข้อควรทราบในการเปรียบเทียบอย่างตรงไปตรงมา: ตัวเลขของ SpaceXAI และตัวเลขของ Artificial Analysis ผลิตขึ้นบนฮาร์เนสที่ต่างกัน ในการตั้งค่าความพยายามที่ต่างกัน และทั้งสองยังไม่เคยถูกนำมาเปรียบเทียบแบบตัวต่อตัวในการกำหนดค่าที่จับคู่กันเลย ในกรณีที่ชื่อเบนช์มาร์กเดียวกันปรากฏอยู่ทั้งสองฝั่ง — AA Briefcase, Terminal-Bench 4.0 — นั่นคือชื่อที่ใช้ร่วมกัน ไม่ใช่การรันร่วมกัน ใครก็ตามที่อ้างตัวเลขจากผู้ขายวางคู่กับตัวเลขอิสระราวกับว่ามันเป็นการวัดเดียวกัน กำลังคำนวณในแบบที่หลักฐานไม่สนับสนุน
ที่ที่คุณสามารถโทรออกได้จริง
Grok 4.7 สามารถเรียกใช้ได้ตั้งแต่วันเปิดตัวผ่าน API ของ SpaceXAI เองที่ api.x.ai โดยใช้ Responses API หรือ Chat Completions และผ่านปลายทางระดับภูมิภาคสำหรับสหรัฐฯ เท่านั้นในราคาพรีเมียม 10% มันเป็นโมเดลเริ่มต้นของเอเจนต์เขียนโค้ด Grok Build และพร้อมใช้งานใน Cursor ทุกแพ็กเกจ โดยที่ตัวแปร Fast — โมเดลเดียวกันในอัตราสองเท่า — ถูกจำกัดให้ใช้ได้เฉพาะสองพื้นผิวนั้น และไม่มีใน API สาธารณะ นอกเหนือจากการเข้าถึงของบริษัทเอง ผู้ขายระบุว่ามันพร้อมใช้งานผ่านฮาร์เนสเขียนโค้ดของบุคคลที่สาม เราเตอร์โมเดล และแพลตฟอร์มคลาวด์
ในส่วนของเราโดยเฉพาะ: grok/grok-4.7 เปิดให้ใช้งานในแค็ตตาล็อกของ OrcaRouter แล้ววันนี้ โดยคิดราคาตามอัตราตามรายการของ xAI เองโดยมีมาร์กอัป 0% และเรียกใช้ได้บนเอนด์พอยต์ใดก็ได้ผ่านคีย์เดียวกับไลน์ Grok ส่วนที่เหลือ หากคุณกำลังประเมินมันเทียบกับ Grok 4.6 — ราคาเดียวกัน หน้าต่างบริบทเดียวกัน แต่เบื้องหลังเป็นโมเดลคนละตัว — การกำหนดเส้นทางทั้งคู่ผ่านเอนด์พอยต์เดียวพร้อมห่วงโซ่ failover อัตโนมัติเป็นวิธีที่ประหยัดในการหาว่าปริมาณงานของคุณชอบตัวไหนจริง ๆ แทนที่จะมุ่งเส้นทางโปรดักชันไปยังโมเดลที่ใหม่กว่าโดยอาศัยความน่าเชื่อถือจากตารางของผู้จำหน่าย

สิ่งที่ต้องจับตา เมื่อพิจารณาว่าข้อมูลยังมีน้อยเพียงใด SpaceXAI ยังไม่ได้เผยแพร่จำนวนพารามิเตอร์ และคำถามเรื่องเพดานเอาต์พุตก็ยังเปิดอยู่จริง ๆ — การที่ผู้ขายระบุว่า "ไม่จำกัดเอาต์พุตข้อความ" เทียบกับ 450K ที่หน้าเพจของเราแสดงไว้นั้น เป็นความไม่สอดคล้องที่ยังไม่มีใครคลี่คลาย ยังไม่มีการเปรียบเทียบแบบตรงต่อกันด้วยฮาร์เนสที่จับคู่กัน กับโมเดลที่มันถูกขายแข่งด้วย และค่าความเร็วที่อ่านได้ข้างบนคือตัวเลขที่มีแนวโน้มจะเปลี่ยนมากที่สุด เพราะมันเปลี่ยนไปแล้ว สามจุดนี้คือจุดที่หน้านี้จะต้องแก้ไขเมื่อข้อมูลค่อย ๆ ครบขึ้น และดีกว่าที่จะพูดเช่นนั้น มากกว่าจะแกล้งทำเป็นว่าข้อกำหนดนั้นนิ่งแล้ว
Grok 4.7 สามารถกำหนดเส้นทางผ่าน OrcaRouter ได้แล้ววันนี้ และเช่นเดียวกันกับ Grok 4.6, Grok 4.5, Grok 4.3 และตระกูล Grok 4.20 OrcaRouterส่งต่อราคาตามรายการของผู้ให้บริการโดยไม่มีมาร์กอัป ดังนั้นเกณฑ์พรอมป์ตแบบสองระดับของ SpaceXAI และอัตราแคชของบริษัทจึงมาถึงฝั่งเราในวันเดียวกับที่ฝั่งของพวกเขาเปลี่ยนแปลง และการทดสอบเวิร์กโหลดกับโมเดล Grok รุ่นเก่าที่ถูกกว่าเป็นเพียงการเปลี่ยนสตริง ไม่ใช่สัญญาฉบับที่สอง
การเปรียบเทียบในบทความนี้3
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
