
GPT-6 Sol vs Grok 4.7: โทเคนที่ถูกกว่าแต่กลับแพงกว่าถึงสามเท่า
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
สองโมเดลเปิดตัวห่างกันหนึ่งวันในเดือนกันยายน 2026 และเมื่อดูที่ป้ายราคาแล้วพวกมันไม่ได้ใกล้กันเลย Grok 4.7 เปิดตัวเมื่อวันที่ 21 กันยายน ในราคา $2.00 ต่อล้านโทเคนอินพุต และ $6.00 ต่อล้านโทเคนเอาต์พุต GPT-6 Sol เปิดตัวเมื่อวันที่ 22 กันยายน ในราคาอินพุต $2.00 เท่ากัน และเอาต์พุต $10.00 เอาต์พุตของ Grok ถูกกว่า 40% นั่นคือพื้นฐานทั้งหมดที่การเปรียบเทียบส่วนใหญ่จะใช้เลือกมัน และมันเป็นตัวเลขที่ผิดที่จะไปดู
ตัวเลขที่ชี้ขาดการจับคู่นี้ไม่ได้อยู่ในตารางราคาของฝ่ายใดเลย มันคือ 240 ล้านเทียบกับ 77 ล้าน — จำนวนโทเคนเอาต์พุตที่แต่ละโมเดลสร้างขึ้นระหว่างที่ Artificial Analysis รัน Intelligence Index Grok 4.7 ใช้โทเคนมากกว่าเล็กน้อยถึงสามเท่าในการตอบคำถามชุดเดียวกัน เมื่อคูณด้วยอัตราต่อโทเคน โมเดลที่มีเอาต์พุตถูกกว่ากลับมีค่าใช้จ่าย $3.74 ต่อหนึ่งงานที่ทำเสร็จ เทียบกับ $1.06 ถูกกว่าต่อโทเคน แต่บิลมากกว่าสามเท่า
แต่ละโมเดลจริงๆ แล้วคืออะไร
Grok 4.7 เป็นรุ่นสืบทอดของ Grok 4.6 จาก xAI โดยถูกวางตำแหน่งให้เป็นโมเดลที่แข็งแกร่งที่สุดสำหรับการเขียนโค้ดและงานองค์ความรู้ มีหน้าต่างบริบทขนาด 500,000 โทเค็น รองรับอินพุตข้อความและภาพ ส่งออกเป็นข้อความ และสามารถกำหนดระดับความพยายามในการใช้เหตุผลได้ตั้งแต่ low, medium, high และ xhigh xAI ยังไม่เปิดเผยจำนวนพารามิเตอร์ โดยระบุว่ามีจุดตัดข้อมูลก่อนการฝึก (pretraining cutoff) อยู่ที่เดือนมิถุนายน 2026 พร้อมการฝึกเสริมจนถึงเดือนสิงหาคม
GPT-6 Sol เป็นโมเดล GPT-6 ระดับกลางของ OpenAI — อยู่ต่ำกว่า GPT-6 Astra รุ่นเรือธง และสูงกว่า GPT-6 Luna รุ่นราคาประหยัด — โดยมีหน้าต่างบริบท 1,050,000 โทเคน, อินพุตสูงสุด 922,000 โทเคน, เพดานเอาต์พุต 128,000 โทเคน และวันตัดข้อมูลความรู้ 20 เมษายน 2026 เป็นแบบรับข้อความและภาพเข้า ให้ข้อความออก โดยมีระดับความพยายามในการให้เหตุผลตั้งแต่ none ไปจนถึง max และ OpenAI ระบุว่าราคาของโมเดลนี้เป็นแบบถาวร ไม่ใช่ราคาโปรโมชัน
หน้าต่างบริบทไม่ได้ใกล้เคียงกันเลย ของ Sol นั้นมากกว่าประมาณสองเท่า เรื่องนี้สำคัญกับงานเพียงประเภทเดียวเท่านั้น และไม่ใช่ประเภทที่คนส่วนใหญ่ใช้งานกัน
เรทการ์ด และบรรทัดที่กลับด้านมัน
• อินพุต — GPT-6 Sol $2.00 ต่อหนึ่งล้านโทเคน เทียบกับ Grok 4.7 $2.00 ต่อหนึ่งล้านโทเคน; เหมือนกัน
• เอาต์พุต — GPT-6 Sol $10.00 ต่อล้านโทเค็น เทียบกับ Grok 4.7 $6.00 ต่อล้านโทเค็น; Grok ถูกกว่า 40%
• อินพุตที่แคชไว้ — GPT-6 Sol $0.20 ต่อล้านโทเคน เทียบกับ Grok 4.7 $0.50 ต่อล้านโทเคน; การอ่านแคชของ Sol ถูกกว่า 2.5 เท่า ซึ่งตรงข้ามกับสิ่งที่อัตราเอาต์พุตบ่งชี้
• การเขียนแคช — GPT-6 Sol $2.50 ต่อล้านโทเค็น เทียบกับ Grok 4.7 อัตราที่ไม่ได้เผยแพร่ในตารางเดียวกัน
• หน้าต่างบริบท — GPT-6 Sol 1,050,000 โทเคน เทียบกับ Grok 4.7 500,000 โทเคน
• ค่าธรรมเนียมส่วนเพิ่มสำหรับบริบทยาว — GPT-6 Sol คิดราคาคำขอที่สูงกว่า 272,000 โทเค็นอินพุตใหม่เป็น 2× ของอัตราอินพุตและแคช และ 1.5× ของเอาต์พุตสำหรับทั้งคำขอ เทียบกับ Grok 4.7 ที่เพิ่มทุกอัตราเป็นสองเท่าที่ 200,000 โทเค็นอินพุต และสำหรับทั้งคำขอเช่นกัน
• วันตัดข้อมูลความรู้ — GPT-6 Sol 20 เมษายน 2026 เทียบกับ Grok 4.7 ซึ่งมีจุดตัดการฝึกอบรมล่วงหน้าที่รายงานว่าเป็นเดือนมิถุนายน 2026 โดยมีการฝึกอบรมเสริมจนถึงเดือนสิงหาคม
• ระดับความพยายามในการให้เหตุผล — GPT-6 Sol ไม่มี, ต่ำ, ปานกลาง (ค่าเริ่มต้น), สูง, xhigh, สูงสุด เทียบกับ Grok 4.7 ต่ำ, ปานกลาง (ค่าเริ่มต้น), สูง, xhigh
• โมดัลลิตี — รับข้อความและรูปภาพเข้า ส่งออกเป็นข้อความ ใช้ได้กับทั้งสองแบบ
บรรทัดแคชคือบรรทัดที่ผู้ซื้อควรใช้เวลาพิจารณาให้ดี อัตราเอาต์พุตของ Grok ต่ำกว่า แต่แคชอินพุตของมันเป็นสองเท่าครึ่งของ Sol และแคชอินพุตคือที่ที่ประวัติเอเจนต์ยาว ๆ กับพรอมต์ระบบที่ใช้ซ้ำ ๆ อยู่ งานเวิร์กโหลดที่ส่วนใหญ่เป็นการอ่านบริบทขนาดใหญ่ที่คงที่ซ้ำ ๆ จะพบว่าทั้งสองใกล้กันมากกว่าที่ตัวเลข $6 เทียบ $10 บ่งชี้ — และเมื่อนำอัตราส่วนปริมาณโทเคนมาคำนวณเพิ่มเข้าไปด้วย ลำดับก็จะพลิกกลับ

ทำไม 240 ล้านโทเคนจึงเป็นคำตอบทั้งหมด
Artificial Analysis วัด Grok 4.7 ที่ xhigh แล้วพบว่าสร้างเอาต์พุตประมาณ 240 ล้านโทเคนตลอดการรันดัชนีของโมเดล เทียบกับค่ามัธยฐานประมาณ 88 ล้านสำหรับโมเดลบนบอร์ดเดียวกัน บทสรุปของ Artificial Analysis เองเรียกโมเดลนี้ว่า “ช้าอย่างเห็นได้ชัดและใช้คำฟุ่มเฟือยมาก” ส่วน GPT-6 Sol ซึ่งวัดบนชุดทดสอบเดียวกัน สร้างได้ 77 ล้าน — ถูกระบุบนบอร์ดว่า “ค่อนข้างกระชับ”
บอร์ดยังรายงานผลที่ตามมาโดยตรง Grok 4.7 ได้คะแนน 46 บน Intelligence Index ที่ราคา $3.74 ต่องาน ในการตั้งค่าสูงสุด คะแนนก็ยังเป็น 46 และค่าใช้จ่ายอยู่ที่ $2.73 ต่องาน GPT-6 Sol ได้คะแนน 48 ที่ราคา $1.06 ต่องาน ดัชนีเดียวกัน ฮาร์เนสเดียวกัน และความแตกต่างของค่าใช้จ่าย 2 ถึง 3.5 เท่า ที่ไม่มีตารางราคาใดแสดงไว้
ข้อควรระวังสองข้อก่อนที่คุณจะมองตัวเลขเหล่านั้นเป็นการเทียบกันแบบตัวต่อตัวที่สะอาด สองหน้าถูกเก็บในวันเดียวกัน แต่กระดานมีผลรวมต่างกัน — หน้าของ Grok แสดงคลาสที่มี 212 โมเดล และรายการ Grok อีกแห่งรายงานอันดับจากทั้งหมด 655 — ดังนั้นจึงไม่รับประกันว่าคะแนนทั้งสองอยู่บนบิลด์ดัชนีเดียวกัน และไม่มีตัวเลขใดเลยที่เป็นตัวเลขจากผู้ขาย: Artificial Analysis รันฮาร์เนสของตัวเอง ซึ่งนั่นคือประเด็น แต่การตั้งค่าการให้เหตุผลต่างกันระหว่างสองรายการ (xhigh สำหรับ Grok, max สำหรับ Sol) ดังนั้นให้ถือว่าช่องว่างต้นทุนห้าร้อยเปอร์เซ็นต์เป็นข้อค้นพบ และช่องว่างดัชนีสองจุดเป็นค่าประมาณ

สิ่งที่ xAI เผยแพร่ และสิ่งที่ยังไม่มีใครตรวจสอบ
ตัวเลขการเปิดตัวของ xAI เองนั้นแข็งแกร่ง และเช่นเดียวกับตัวเลขการเปิดตัวของผู้จำหน่ายทุกราย ยังไม่มีการทำซ้ำให้เห็น CursorBench 4.0 อยู่ที่ 46.3% ที่ระดับ xhigh เทียบกับ 40.4% ของ Grok 4.6 Terminal-Bench 4.0 อยู่ที่ 38.0% เทียบกับ 20.3% — เป็นการเพิ่มขึ้นครั้งเดียวที่มากที่สุดในการเปิดตัวครั้งนี้ DeepSWE v1.1 อยู่ที่ 71.0% ที่ระดับ high เทียบกับ 65.2% EEBench อยู่ที่ 64.0% เทียบกับ 53.0% นั่นคือฮาร์เนสของ xAI การตั้งค่าของ xAI และการรายงานของ xAI
ตัวเลขของ OpenAI สำหรับ GPT-6 Sol เป็นไปตามรูปแบบเดียวกัน และสมควรได้รับการลดทอนแบบเดียวกัน ข้อแตกต่างคือ Sol มีหลักฐานอิสระเพิ่มขึ้นอีกหนึ่งชิ้นเมื่อเทียบกับ Grok นั่นคือ ตัวเลขต้นทุนต่องานของ Artificial Analysis ซึ่งคำนวณจากปริมาณการใช้โทเคนที่วัดได้จริง แทนที่จะมาจากตารางคะแนนของผู้ขาย นั่นคือตัวเลขที่รอดจากการเปรียบเทียบนี้
สิ่งที่ไม่มีใครเคยเผยแพร่สำหรับโมเดลทั้งสอง คือการเปรียบเทียบแบบตัวต่อตัวบนงานเดียวกัน ด้วยฮาร์เนสเดียวกัน และการตั้งค่าความพยายามเดียวกัน หากคุณเห็นสักอัน ให้ตรวจสอบว่าตัวแปรสามตัวนั้นตัวไหนเปลี่ยนไป
การกำหนดราคาสำหรับทราฟฟิกเอเจนต์ที่แคชไว้หนึ่งเดือน
ลองพิจารณาภาระงานที่มีบริบทเสถียรเป็นส่วนใหญ่: เอเจนต์เขียนโค้ดที่มีพรอมป์ต์ระบบขนาด 60,000 โทเคนและสรุปรีโพซิทอรี ซึ่งถูกอ่านซ้ำในการเรียก 5,000 ครั้งต่อเดือน โดยแต่ละครั้งคืนค่าโทเคนเอาต์พุต 4,000 โทเคน สมมติว่าแคชทำงานได้ และพรีฟิกซ์ที่เสถียรถูกคิดค่าบริการในอัตราแคช
สำหรับ GPT-6 Sol: โทเค็นอินพุตที่แคชไว้ 300 ล้านโทเค็น ในราคา $0.20 ต่อล้านโทเค็น คิดเป็น $60.00 โทเค็นเอาต์พุต 20 ล้านโทเค็น ในราคา $10.00 ต่อล้านโทเค็น คิดเป็น $200.00 รวม $260.00
สำหรับ Grok 4.7: โทเค็นอินพุตที่แคชไว้จำนวน 300 ล้านโทเค็นเดียวกัน ในราคา $0.50 ต่อล้าน คิดเป็น $150.00 โทเค็นเอาต์พุต 20 ล้านโทเค็น ในราคา $6.00 ต่อล้าน คิดเป็น $120.00 รวมทั้งหมด $270.00
เกือบจะเหมือนกันทุกประการ — และนั่นคือเมื่อปริมาณโทเค็นถูกตรึงไว้ให้คงที่ ซึ่งเป็นข้อสมมติที่เอื้อประโยชน์ ความเยิ่นเย้อที่วัดได้ของ Grok 4.7 ในการรันอินเด็กซ์นั้นเป็นสามเท่าของ Sol เพียงแค่ใช้ตัวคูณ 1.5× กับปริมาณเอาต์พุต บิลของ Grok ก็จะพุ่งไปที่ $330.00 เทียบกับ $320.00 ของ Sol และช่องว่างก็ยิ่งกว้างขึ้นจากจุดนั้น อัตราเอาต์พุตที่ถูกกว่านั้นไม่รอดเมื่อเจอการแคชบวกกับความเยิ่นเย้อ; มันแทบจะไม่รอดแม้เจอการแคชเพียงอย่างเดียว
ไม่มีข้อความใดในที่นี้เป็นการกล่าวอ้างเกี่ยวกับราคาของโมเดลใด ๆ ผ่าน OrcaRouter — ทั้งสองไม่ได้อยู่ในแคตตาล็อกของเรา GPT-6 Sol เข้าถึงได้ผ่าน API ของ OpenAI เอง และ Grok 4.7 ผ่าน API ของ xAIส่วนที่เหลือของตระกูล Grok รวมถึง Grok 4.6 นั้นกำหนดเส้นทางผ่านเราได้ ในราคาตามรายการของ xAI ภายใต้โมเดลแบบ pass-throughประเด็นของการคำนวณนี้คือ กฎการยกระดับ (escalation) ที่คุณเขียนขึ้นควรอิงจากต้นทุนต่องานที่ทำสำเร็จบนทราฟฟิกของคุณเอง ไม่ใช่จากตารางราคา (rate card) — และเลเยอร์การกำหนดเส้นทางคือสิ่งที่ทำให้คุณทดสอบกฎนั้นได้โดยไม่ต้องมีสัญญาฉบับที่สอง

ที่ที่แต่ละรายการอยู่
• งานเอเจนต์ปริมาณมากที่ใช้บริบทแบบแคช — GPT-6 Sol รายการค่าอินพุตแบบแคชได้เปรียบอยู่ที่ 2.5 เท่าในฝั่งของ Sol ส่วนรายการปริมาณเอาต์พุตฝั่งของ Grok ก็แย่ยิ่งกว่านั้นอีก และทั้งสองอย่างก็ส่งผลทบกัน
• งานเขียนโค้ดที่คุณต้องการการปรับปรุง Terminal-Bench ที่เผยแพร่แล้วซึ่งแรงที่สุดในรีลีส — Grok 4.7 คือโมเดลที่มีตัวเลขนั้น และมันเป็นตัวเลขที่ใหญ่ แค่ตั้งงบสำหรับโทเคน ไม่ใช่อัตรา
• เอกสารยาวที่เกิน 500,000 โทเคน — GPT-6 Sol และไม่ใช่เรื่องที่สูสีกันเลย หน้าต่างของ Grok สิ้นสุดตรงจุดที่ของ Sol ไปได้แค่ครึ่งทาง
• เส้นทางที่ไวต่อความหน่วง — ไม่ใช่ทั้งสองอย่าง Artificial Analysis ระบุว่า Grok 4.7 อยู่ที่ 39.2 โทเคนเอาต์พุตต่อวินาที ซึ่งจัดว่าช้าอย่างเห็นได้ชัด ตรวจสอบตัวเลขความเร็วของ Sol เองบนบอร์ดปัจจุบันก่อนที่คุณจะคิดว่ามันดีกว่า
• หากมีการแสดงการเปรียบเทียบต่อโทเคนให้คุณดู ซึ่งลงท้ายด้วย "ดังนั้น Grok จึงถูกกว่า" — มันจบเร็วเกินไปหนึ่งขั้น ขั้นถัดไปคือจำนวนโทเคน
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
