
Gemini 3.7 Flash vs Grok 4.6: สงครามราคาของ Google ปะทะเอเจนต์ตรวจสอบตนเองของ SpaceXAI
- googleใหม่Google: Gemini 3.8 Flash2026-09-0259ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0258ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0166ความฉลาด82การเขียนโค้ด
- Alibabaใหม่Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiใหม่Z.ai: GLM 5.3 Flash2026-08-2658ความฉลาด72การเขียนโค้ด
- DeepSeekใหม่DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1860ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1552ความฉลาด68การเขียนโค้ด
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
สามสัปดาห์หลังจาก Gemini 3.6 Flash ประสบความล้มเหลวเป็นส่วนใหญ่ Google ก็ลดราคาลงครึ่งหนึ่งและเปิดตัวGemini 3.7 Flash — การเคลื่อนไหวที่สื่อส่วนใหญ่อ่านว่าคือการยิงตรงใส่Grok 4.6 ซึ่งเป็นเรือธงที่ปรับแต่งสำหรับเอเจนต์ที่ SpaceXAI เปิดตัวเมื่อวันก่อนในราคา $2 และ $6 จังหวะเวลาคือประเด็นสำคัญ: โมเดลระดับใกล้แนวหน้าสองตัว เปิดตัวห่างกันหนึ่งวัน ต่างมุ่งเป้าไปที่ผู้ซื้อรายเดียวกัน — ทีมที่ต้องการเขียนโค้ดแบบเอเจนต์โดยไม่ต้องจ่ายในราคาระดับแนวหน้า — และตั้งราคาด้วยปรัชญาที่ตรงข้ามกัน Google กำลังซื้อการตอบสนองด้วยโปรโมชันห้าเดือน ส่วน SpaceXAI ขายความไว้วางใจต่องานในราคาคงที่แบบเรียบง่าย
Grok 4.6 ซึ่งเปิดตัวเมื่อวันที่ 12 สิงหาคม 2026 เป็นการปรับปรุงของ SpaceXAI บนรากฐาน Grok 4.5 ที่มีพารามิเตอร์ 1.5 ล้านล้าน ออกแบบมาสำหรับเอเจนต์ที่ทำงานยาวนานซึ่งตรวจสอบความสำเร็จของงานย่อยของตนเอง มีหน้าต่างบริบท 500K รองรับอินพุตข้อความและรูปภาพ และอัตราค่าบริการ $2/$6 ที่เพิ่มเป็นสองเท่าเมื่อโทเคนอินพุตเกิน 200K+ Gemini 3.7 Flash เปิดตัวเมื่อวันที่ 13 สิงหาคม 2026 เป็นการปรับปรุงเชิงอัลกอริทึมของ Google ต่อ Gemini 3.6 Flash — บริบท 1M อินพุตมัลติโมดัลรวมถึงวิดีโอและเสียง และราคาส่งเสริมการขาย $0.75/$3.75 ที่เพิ่มเป็นสองเท่าเป็น $1.50/$7.50 ในวันที่ 1 มกราคม 2027 ในดัชนีความฉลาด Artificial Analysis Intelligence Index ที่เป็นอิสระ Grok 4.6 อยู่ที่ 61 ซึ่งสูงกว่าค่าที่อ่านได้ในช่วงแรกประมาณ 56 สำหรับ Gemini 3.7 Flash อย่างชัดเจน
สงครามราคา หนึ่งบรรทัดต่อมิติ
• ราคาต่อ 1M อินพุต — Gemini 3.7 Flash $0.75 (ราคาเปิดตัว) เทียบกับ Grok 4.6 $2.00 Google ถูกกว่ามากกว่า 60%
• ราคาต่อ 1M output — Gemini 3.7 Flash $3.75 (โปรโมชันเปิดตัว) เทียบกับ Grok 4.6 $6.00.
• หลังวันที่ 1 มกราคม 2027 — Gemini ปรับขึ้นสองเท่าเป็น $1.50/$7.50 ส่วน Grok ยังคงเดิมที่ $2/$6.
• หน้าต่างบริบท — Gemini 3.7 Flash 1M เทียบกับ Grok 4.6 500K.
• การคิดค่าบริการสำหรับอินพุตยาว — Gemini คิดค่าบริการในอัตราคงที่ตลอดทั้งวินโดว์ ส่วน Grok เพิ่มเป็นสองเท่าเป็น $4/$12 สำหรับอินพุต 200K ขึ้นไป
• โทเคนการคิด — Gemini คิดค่าใช้จ่ายเป็นเอาต์พุต ส่วนต้นทุนของ Grok ถูกวัดอย่างอิสระที่ประมาณ 0.84 ดอลลาร์ต่องาน
สรุปแบบบรรทัดเดียว: Gemini 3.7 Flash ถูกกว่าในทุกบรรทัดของป้ายราคาวันนี้ และข้อได้เปรียบส่วนใหญ่จะหายไปในวันที่ 1 มกราคม Grok 4.6 มีราคาเท่ากันทั้งในเดือนสิงหาคมและเดือนมีนาคม

เงินของ Gemini 3.7 Flash ไปที่ไหน
ตัวเลขของกูเกิลเองรายงานการก้าวกระโดดครั้งใหญ่สำหรับ Gemini 3.7 Flash เมื่อเทียบกับ 3.6 Flash: 65.3% บน DeepSWE v1.1 (เพิ่มขึ้นจาก 49.0%), 43.6% บน FrontierCode 1.1 Main (เพิ่มขึ้นจาก 34.4%), 85.8% บน Terminal-bench 2.1 (เพิ่มขึ้นจาก 78.0%) และ WebDev Arena Elo 1588 (เพิ่มขึ้นจาก 1538) ตัวเลขเหล่านี้เป็นตัวเลขที่รายงานโดยผู้ผลิต ยังไม่มีการตรวจสอบซ้ำ — เป็นตัวเลขที่วัดทิศทาง ไม่ใช่คำตัดสินเปรียบเทียบระหว่างผู้ผลิต แต่ทิศทางคือประเด็นสำคัญ: การแก้ไขมาถึงสามสัปดาห์หลังการเปิดตัวที่ผู้วิจารณ์ส่วนใหญ่ตัดทิ้งไปแล้ว ซึ่งบอกคุณได้ว่ากูเกิลมองระดับ Flash เป็นสนามรบ ไม่ใช่เรือธง
อีกสิ่งหนึ่งที่โปรโมชันของ Google ทำคือการบีบกรอบเวลาการซื้อให้สั้นลง ที่ $0.75/$3.75 โมเดลนี้ถูกพอที่จะทดสอบในปริมาณมาก ที่ $1.50/$7.50 ยังคงแข่งขันได้ แต่ไม่ใช่เป็นอาวุธในสงครามราคาอีกต่อไป ทีมผลิตใดก็ตามที่นำไปใช้ในช่วงแนะนำผลิตภัณฑ์ ควรจะประเมินความคุ้มทุนของมันอีกครั้งในเดือนธันวาคม ไม่ใช่สมมติว่าตัวเลขจะขยับตามพวกเขาไป
เงินของ Grok 4.6 ไปไหน
จุดขายของ Grok 4.6 ต่างออกไป: ไม่ใช่โทเคนที่ถูกลง แต่เป็นโทเคนที่สูญเปล่าน้อยลง มันถูกฝึกให้ตรวจสอบตัวเอง — เพื่อตรวจสอบว่างานย่อยเสร็จสิ้นจริงก่อนจะเดินหน้าต่อ — และการวัดผลจากภายนอกก็ยืนยันผลดังกล่าว: Artificial Analysis ประเมินต้นทุนไว้ที่ประมาณ $0.84 ต่อหนึ่งงาน โดยมี GDPVal-AA v2 เท่ากับ 1,753 และ Intelligence Index เท่ากับ 61 ตัวเลขเหล่านี้เป็นตัวเลขจากบุคคลที่สาม และเป็นตัวเลขที่แข็งแกร่งที่สุดในการประลองครั้งนี้ เพราะมันสะท้อนสิ่งที่ราคาต่อโทเคนมองไม่เห็น: โมเดลที่ใช้รอบน้อยกว่าในการทำงานให้เสร็จ ย่อมมีต้นทุนต่ำกว่าต่องานที่เสร็จสมบูรณ์ แม้จะมีราคาโทเคนที่สูงกว่าก็ตาม
จุดแลกเปลี่ยนอยู่ตรงที่โมเดลที่ถูกกว่ายังมีพื้นที่ให้พัฒนา บริบท 500K ของ Grok 4.6 เป็นเพียงครึ่งหนึ่งของ 1M ใน Gemini 3.7 Flash และอัตรา $2/$6 ของมันเพิ่มเป็นสองเท่าเมื่ออินพุตเกิน 200K ดังนั้น เวิร์กโหลดที่ต้องใช้บริบทยาวและอินพุตสูงจึงเป็นจุดที่ราคาป้ายของ Grok 4.6 เริ่มไม่สามารถแข่งขันกับอัตราโปรโมชันของ Gemini ได้อีกต่อไป
เศรษฐศาสตร์ต่องาน
ในราคาเปิดตัว อัตราผสมของ Gemini 3.7 Flash ที่การแบ่งอินพุต/เอาต์พุต 80/20 อยู่ที่ประมาณ 1.35 ดอลลาร์ต่อล้านโทเคน; ราคาที่ติดป้ายของ Grok 4.6 ในการแบ่งเดียวกันคือ 2.80 ดอลลาร์ต่อล้านก่อนจะมีค่าปรับสำหรับอินพุตยาว ในทางทฤษฎีโมเดล Google ดูเหมือนจะเป็นผู้ชนะด้านปริมาณอย่างขาดลอย ความซับซ้อนคือ โทเคนการคิดของ Gemini คิดค่าใช้จ่ายในฐานะเอาต์พุต การอ้างสิทธิ์ด้านเกณฑ์มาตรฐานของมันอายุหนึ่งสัปดาห์แล้ว และประสิทธิภาพต่องานของมันยังไม่ถูกวัดอย่างอิสระ — ในขณะที่ของ Grok 4.6 ถูกวัดแล้ว โทเคนราคาถูกบวกกับรอบที่สูญเปล่าสามารถมีต้นทุนสูงกว่าโทเคนราคาแพงที่ทำงานเสร็จ และนี่คือการแข่งขันที่ฝ่ายหนึ่งมีข้อมูลสำหรับคำถามนั้น อีกฝ่ายหนึ่งไม่มี
การเดิมพันกับโมเดลใหม่โดยไม่เดิมพันกับไปป์ไลน์
Grok 4.6 อยู่บน OrcaRouter ในราคารายการ $2/$6 ของ SpaceXAI โดยไม่มีส่วนเพิ่ม (markup) 0% รวมถึงขั้นตอน 2x ที่เกิน 200K ซึ่งหน้าโมเดลดึงข้อมูลสดจากเลเยอร์การกำหนดเส้นทาง Gemini 3.7 Flash เพิ่งเปิดตัวได้หนึ่งวันและอยู่บน API ของ Google เอง; ส่วน Gemini 3.6 Flash รุ่นก่อนหน้าอยู่บน OrcaRouter ในราคารายการของ Google


หากคำถามที่การเปรียบเทียบนี้ต้องการถามจริงๆ คือ "ฉันควรวางเดิมพันไปป์ไลน์เอเจนต์ของฉันบนโมเดลราคาถูกตัวใหม่นี้หรือไม่" ชั้นการจัดเส้นทางคือตัวป้องกันความเสี่ยง: กฎ failover ที่รันเอเจนต์บน Grok 4.6 ในวันนี้และสลับไปใช้ Gemini 3.7 Flash ในวันที่มันเปิดตัว หรือแผงฟิวชันที่ทั้งสองฝ่ายตอบแล้วมีผู้ตัดสินมาประสานคำตอบ — เป็นรูปแบบการตั้งค่าที่ routing DSL ถูกสร้างขึ้นมาเพื่อรองรับ และเป็นรูปแบบที่ไม่จำเป็นต้องเลือกข้างก่อนที่หลักฐานจะชัดเจน
การอ่านอย่างตรงไปตรงมา
หากคุณต้องการโทเค็นที่ถูกที่สุดในวันนี้และคุณเชื่อมั่นในการส่งมอบภายในสามสัปดาห์ Gemini 3.7 Flash คือตัวเลือกที่ aggressive — สงครามราคาจริง รายงานผลการวัดประสิทธิภาพมีอยู่ และช่วงโปรโมชันเป็นส่วนลดจริง หากคุณต้องการโมเดลที่ประสิทธิภาพของเอเจนต์ถูกวัดอย่างอิสระ ราคาไม่ขยับในเดือนมกราคม และลูปการตรวจสอบตัวเองถูกออกแบบมาสำหรับงานที่ใช้เวลานาน Grok 4.6 คือตัวเลือกที่อนุรักษ์นิยม และข้อมูล AA ช่วยให้มันได้เปรียบเรื่องต้นทุนต่องานที่สำเร็จ ฝั่งหนึ่งคือการลดราคาที่มีเวลานับถอยหลัง อีกฝั่งคือราคาที่มีประวัติผลงาน ทั้งสองฝั่งมีเหตุผลรองรับ — นี่คือสิ่งที่ทำให้การเปรียบเทียบนี้เป็นของจริง ไม่ใช่แค่พิธีการ
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
