
Gemini 3.7 Flash ปะทะ DeepSeek V4 Flash: สองโมเดล "Flash" ที่ให้คำตอบตรงข้ามกับคำถามเดียวกัน
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
โมเดลสองรุ่นที่ตั้งชื่อได้สร้างความสับสนมากที่สุดในปี 2026 ต่างก็ใช้ชื่อว่า Flash และทั้งคู่ตอบคำถามเดียวกันได้แตกต่างกันอย่างสิ้นเชิง Gemini 3.7 Flash ที่เปิดตัวเมื่อวันที่ 13 สิงหาคม 2026 คือโมเดลปิดที่ทำงานหนักของ Google: มีความเร็วประมาณ 340 โทเคนเอาต์พุตต่อวินาที, ค่า Intelligence Index 56, และราคาส่งเสริมการขายที่ $0.75 ต่อล้านอินพุตโทเคน และ $3.75 ต่อล้านเอาต์พุตโทเคน ส่วน DeepSeek V4 Flash คือครึ่งหนึ่งของตระกูล DeepSeek V4 ที่เปิดเผยน้ำหนัก เปิดตัวในเดือนเมษายนและอัปเดตเมื่อปลายเดือนกรกฎาคม: ใช้สัญญาอนุญาต MIT, ดาวน์โหลดได้ และมีราคา $0.14 ต่อล้านอินพุตโทเคน และ $0.28 ต่อล้านเอาต์พุตโทเคนบน API ของ DeepSeek เอง ซึ่งคิดเป็นประมาณหนึ่งในห้าของราคาอินพุตส่งเสริมการขายของ Google และหนึ่งในสิบสามของราคาเอาต์พุต ทั้งคู่เป็นโมเดล "flash" ที่ออกแบบมาให้เร็วและถูกสำหรับงานปริมาณมาก ความเหมือนสิ้นสุดลงเพียงแค่ชื่อเท่านั้น
คำถามที่พวกเขาตอบต่างกันคือคำถามที่นิยามคนรุ่นนี้: คุณจะเช่าความชาญฉลาดหรือเป็นเจ้าของมัน? DeepSeek V4 Flash เป็นโมเดล mixture-of-experts ที่มีพารามิเตอร์ 284 พันล้านตัว โดยใช้พารามิเตอร์จริงประมาณ 13 พันล้านตัวต่อโทเคน มีหน้าต่างบริบท 1 ล้านโทเคน และเพดานเอาต์พุต 384K เผยแพร่ภายใต้ใบอนุญาต MIT — น้ำหนักโมเดลมีขนาดดาวน์โหลดประมาณ 160GB และการอัปเดตเมื่อวันที่ 31 กรกฎาคม (V4-Flash-0731) เพิ่มความสามารถด้าน agentic อย่างมีนัยสำคัญ ส่วน Gemini 3.7 Flash เป็นโมเดล proprietary ที่สร้างบน Gemini 3.6 Flash มีบริบท 1 ล้านโทเคน เพดานเอาต์พุต 64K รองรับอินพุตแบบมัลติโมดัล และไม่มีทางเลือกสำหรับการโฮสต์เอง หนึ่งในสองโมเดลนี้สามารถตัดขาดจากเครือข่าย ปรับแต่งละเอียด และรันบนฮาร์ดแวร์ของคุณเองได้ ส่วนอีกโมเดลหนึ่งรันได้เฉพาะที่ Google รันมันเท่านั้น

Flashes ทั้งสองเคียงข้างกัน
โมเดลทั้งสองกำหนดเป้าหมายไปที่ผู้ซื้อกลุ่มเดียวกัน — เวิร์กโหลดการผลิตปริมาณสูงที่ไม่สามารถจ่ายราคาระดับเรือธงต่อโทเคนได้ — แต่ทั้งคู่ไปถึงเป้าหมายนั้นด้วยสถาปัตยกรรมที่ตรงกันข้าม แอตเทนชันแบบไฮบริดของ DeepSeek V4 Flash (sparse ที่ถูกบีบอัด บวกกับแอตเทนชันที่ถูกบีบอัดอย่างหนัก) คือสิ่งที่ทำให้บริบทขนาด 1M มีความคุ้มทุนพอที่จะขายในราคาเหล่านี้; มันคือโมเดลที่ DeepSeek กำหนดให้เอนด์พอยต์รุ่นเก่าอย่าง `deepseek-chat` และ `deepseek-reasoner` ชี้ไปที่ ซึ่งเอนด์พอยต์เหล่านี้ถูกยุติการใช้งานในเดือนกรกฎาคม Gemini 3.7 Flash คือการปรับแต่งเชิงอัลกอริทึมของ Google ต่อสายผลิตภัณฑ์ Flash ของตน และจุดแข็งของมันคือทรูพุตในการให้บริการ: การวัดแบบอิสระระบุว่าอยู่ที่ประมาณ 340 โทเคนต่อวินาที เทียบกับ DeepSeek V4 Flash ที่ประมาณ 113 และมันไปถึงระดับนั้นพร้อมกับรองรับอินพุตเสียงและวิดีโอ ซึ่ง DeepSeek V4 Flash ไม่รองรับ
• Intelligence Index — 56 สำหรับ Gemini 3.7 Flash เทียบกับ 50 สำหรับ DeepSeek V4 Flash ตามข้อมูลของ Artificial Analysis
• ความเร็วเอาต์พุต — ~340 tokens/s เทียบกับ ~113 tokens/s ทั้งคู่จากข้อมูลของ Artificial Analysis.
• หน้าต่างบริบท — 1M tokens สำหรับทั้งคู่; DeepSeek V4 Flash เอาต์พุตสูงสุด 384K เทียบกับ Gemini 3.7 Flash ที่ 64K
• ราคาอินพุต — $0.75 (โปรโมชัน ถึงปี 2026) เทียบกับ $0.14 บน API ของ DeepSeek เอง.
• ราคาเอาต์พุต — $3.75 (ราคาโปรโมชัน) เทียบกับ $0.28.
• น้ำหนัก — แบบกรรมสิทธิ์เทียบกับแบบใช้สัญญาอนุญาต MIT และดาวน์โหลดได้

หกจุดดัชนีซื้ออะไรได้จริง
ช่องว่างดัชนีหกจุดนั้นมีความหมายแต่ไม่ถึงกับเป็นเหว และส่วนใหญ่อยู่ในพื้นที่ที่ DeepSeek V4 Flash ไม่ได้ถูกปรับให้เหมาะสม ตัวเลขการเขียนโค้ดแบบ agentic ที่รายงานของ Gemini 3.7 Flash (65.3 บน DeepSWE v1.1, 43.6 บน FrontierCode 1.1 Main ซึ่งรายงานโดยผู้จำหน่าย) นำหน้าอยู่มาก และค่า Elo การพัฒนาเว็บ (1588 ซึ่งรายงานโดยผู้จำหน่ายเช่นกัน) สะท้อนการปรับปรุงการสร้าง UI ที่เป็นจริง ตัวเลขที่รายงานของ DeepSeek V4 Flash เอง — 79.0 บน SWE-bench Verified, 91.6 บน LiveCodeBench, คะแนน τ²-Bench ที่ 95.0 ซึ่งตัวติดตามอิสระยืนยัน — ยังคงแข็งแกร่งในการเขียนโค้ดแบบมีขอบเขตและการใช้เครื่องมือ และการดึงข้อมูลบริบท 1M (78.7 บน MRCR, 60.5 บน CorpusQA) ก็แข่งขันได้กับทุกรุ่นในระดับราคาเดียวกัน รูปแบบคือ: Gemini 3.7 Flash นำในด้านความลึกแบบ agentic และงานเว็บ; DeepSeek V4 Flash แลกสิ่งเหล่านั้นกับความคุ้มค่าด้าน token ดิบและเพดานบริบทยาวที่โมเดล closed ตัวใดเทียบไม่ได้
โอเพนเวทเปลี่ยนกระบวนการจัดหา ไม่ใช่แค่ราคา
ใบอนุญาต MIT คือส่วนหนึ่งของการเปรียบเทียบนี้ที่ไม่มีตาราง benchmark ใดนำเสนอ DeepSeek V4 Flash สามารถดาวน์โหลดและรันบนฮาร์ดแวร์ของคุณเอง ปรับแต่งด้วยข้อมูลของคุณเอง และใช้ในสภาพแวดล้อมที่ไม่อนุญาตให้เรียกใช้ API — และใบอนุญาตไม่มีข้อจำกัดตามขนาด ดังนั้นการเติบโตของคุณจะไม่เปลี่ยนเงื่อนไข ต้นทุนที่แท้จริงคือด้านปฏิบัติการ: การเสิร์ฟโมเดล MoE ขนาด 284B ที่ความเร็วซึ่งทีมงานโปรดักชันต้องการต้องใช้ GPU จำนวนมาก และสำหรับทีมส่วนใหญ่ ตัวเลือกที่ตรงไปตรงมาคือ hosted API นั่นคือจุดที่ช่องว่างด้านราคาเกิดผลจริง แม้แต่เส้นทาง hosted ที่ราคา $0.14 / $0.28 ก็ถูกพอที่จะเป็นค่าเริ่มต้นสำหรับการใช้งานในระยะยาว Gemini 3.7 Flash ไม่มีความเป็นเจ้าของเลย — สิ่งที่คุณซื้อคือบริการที่จัดการอย่างน่าเชื่อถือ รวดเร็ว หลายโหมด พร้อมป้ายราคาส่งเสริมการขายและจุดสิ้นสุดในเดือนมกราคม
ใบเรียกเก็บเงินตามปริมาณการใช้งาน
รันในวันเดียวกันทั้งสอง: โทเคนอินพุต 20 ล้านตัว และโทเคนเอาต์พุต 4 ล้านตัว บน API ของ DeepSeek V4 Flash เอง ราคาคือ $2.80 + $1.12 รวมประมาณ $3.92 ส่วนบน Gemini 3.7 Flash ในอัตราส่งเสริมการขายคือ $15 + $15 รวมประมาณ $30 — ช่องว่าง 7.6 เท่า แม้ในขณะที่ Google กำลังลดราคาอยู่ หลังวันที่ 1 มกราคม 2027 เมื่อ Gemini 3.7 Flash กลับไปเป็น $1.50 / $7.50 ค่าใช้จ่ายในวันเดียวกันจะอยู่ที่ประมาณ $58 ซึ่งเป็น 15 เท่าของตัวเลขของ DeepSeek ข้อได้เปรียบด้านความเร็วช่วยชดเชยได้บางส่วนในงานแบบโต้ตอบ — โทเคนที่เร็วกว่าหมายถึงคำขอพร้อมกันน้อยลง — แต่สำหรับงานแบบแบตช์และงานเบื้องหลัง โมเดลเปิดชนะเรื่องค่าใช้จ่ายอย่างไม่ต้องสู้ ทั้งสองโมเดลไม่ได้มุ่งไปที่เส้นต้นทุนเดียวกันด้วยซ้ำ ซึ่งนั่นคือประเด็นทั้งหมด

ใครควรสร้างบนอะไร
เลือก DeepSeek V4 Flash เมื่อต้นทุนต่อโทเคนเป็นข้อจำกัดหลัก เมื่อคุณต้องการผลลัพธ์ที่ยาวสูงสุด 384K เมื่อคุณต้องการตัวเลือกการโฮสต์ด้วยตนเองหรือการติดตั้งแบบแยกเครือข่าย (air-gapped) หรือเมื่อคุณกำลังสร้างสิ่งที่อัตรากำไรจะไม่รอดกับราคาโทเคนระดับเรือธง เลือก Gemini 3.7 Flash เมื่อคุณต้องการความเร็วในลูปแบบอินเทอร์แอกทีฟ อินพุตมัลติโมดัล ความน่าเชื่อถือที่จัดการโดย Google หรือผลลัพธ์การเขียนโค้ดแบบเอเจนต์ที่แข็งแกร่งกว่าที่ Google รายงาน — และเมื่อคุณสบายใจว่าราคาส่งเสริมการขายเป็นเพียงชั่วคราว พวกมันไม่ได้เป็นคู่แข่งแบบที่เรือธงสองตัวเป็นคู่แข่งกัน แต่เป็นกลยุทธ์การจัดซื้อที่แตกต่างกันสองแบบที่สวมชื่อเดียวกัน เลเยอร์การกำหนดเส้นทางคือจุดที่กลยุทธ์มาบรรจบกัน: DeepSeek V4 Flash เปิดใช้งานบน OrcaRouter ในราคารายการของ DeepSeek โดยมีมาร์กอัป 0% และรูปแบบ failover เข้ากับการจับคู่นี้โดยธรรมชาติ — กฎที่ให้ปริมาณทราฟฟิกส่วนใหญ่ทำงานบน V4 Flash และส่งต่อส่วนย่อยที่ยากขึ้นไปยังโมเดลปิดที่แข็งแกร่งกว่า โดย Gemini 3.7 Flash เข้าถึงได้ผ่าน Gemini API ของ Google เองบนอีกขาของเราเตอร์ตัวเดียวกัน
การอ่านอย่างตรงไปตรงมา
หากคุณสามารถโฮสต์ได้เองหรือให้ต้นทุนเป็นตัวขับเคลื่อนหลัก DeepSeek V4 Flash คือโมเดลที่ดีกว่าที่จะสร้างต่อ และไลเซนส์ทำให้เป็นการตัดสินใจที่คุณไม่ต้องกลับมาทบทวนอีก หากคุณต้องการความเร็วในการให้บริการของ Google อินพุตแบบมัลติโมดัล หรือความได้เปรียบด้านการเขียนโค้ดแบบ agentic ตามที่มีรายงาน Gemini 3.7 Flash คือบริการที่ดีกว่าในขณะที่โปรโมชันยังคงอยู่ — โดยที่การขึ้นราคาสองเท่าในเดือนมกราคมถูกกำหนดไว้ในปฏิทินแล้ว สองโมเดล หนึ่งชื่อ และตลาดจะได้เห็นว่าปรัชญาใดที่ปริมาณการใช้งานในปีหน้าจะโหวตให้
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
