การ์ดชื่อเรื่องสำหรับการเปรียบเทียบ Gemini 3.7 Flash กับ DeepSeek V4 Flash แสดงสายฟ้าสองอัน: กล่องล็อกแบบปิดที่มีป้าย Gemini 3.7 Flash พร้อมป้ายราคา $0.75 / $3.75 และกล่องเปิดที่มีลูกศรดาวน์โหลดซึ่งมีป้าย DeepSeek V4 Flash พร้อมป้ายราคา $0.14 / $0.28
Guides & Insights

Gemini 3.7 Flash ปะทะ DeepSeek V4 Flash: สองโมเดล "Flash" ที่ให้คำตอบตรงข้ามกับคำถามเดียวกัน

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

โมเดลสองรุ่นที่ตั้งชื่อได้สร้างความสับสนมากที่สุดในปี 2026 ต่างก็ใช้ชื่อว่า Flash และทั้งคู่ตอบคำถามเดียวกันได้แตกต่างกันอย่างสิ้นเชิง Gemini 3.7 Flash ที่เปิดตัวเมื่อวันที่ 13 สิงหาคม 2026 คือโมเดลปิดที่ทำงานหนักของ Google: มีความเร็วประมาณ 340 โทเคนเอาต์พุตต่อวินาที, ค่า Intelligence Index 56, และราคาส่งเสริมการขายที่ $0.75 ต่อล้านอินพุตโทเคน และ $3.75 ต่อล้านเอาต์พุตโทเคน ส่วน DeepSeek V4 Flash คือครึ่งหนึ่งของตระกูล DeepSeek V4 ที่เปิดเผยน้ำหนัก เปิดตัวในเดือนเมษายนและอัปเดตเมื่อปลายเดือนกรกฎาคม: ใช้สัญญาอนุญาต MIT, ดาวน์โหลดได้ และมีราคา $0.14 ต่อล้านอินพุตโทเคน และ $0.28 ต่อล้านเอาต์พุตโทเคนบน API ของ DeepSeek เอง ซึ่งคิดเป็นประมาณหนึ่งในห้าของราคาอินพุตส่งเสริมการขายของ Google และหนึ่งในสิบสามของราคาเอาต์พุต ทั้งคู่เป็นโมเดล "flash" ที่ออกแบบมาให้เร็วและถูกสำหรับงานปริมาณมาก ความเหมือนสิ้นสุดลงเพียงแค่ชื่อเท่านั้น

คำถามที่พวกเขาตอบต่างกันคือคำถามที่นิยามคนรุ่นนี้: คุณจะเช่าความชาญฉลาดหรือเป็นเจ้าของมัน? DeepSeek V4 Flash เป็นโมเดล mixture-of-experts ที่มีพารามิเตอร์ 284 พันล้านตัว โดยใช้พารามิเตอร์จริงประมาณ 13 พันล้านตัวต่อโทเคน มีหน้าต่างบริบท 1 ล้านโทเคน และเพดานเอาต์พุต 384K เผยแพร่ภายใต้ใบอนุญาต MIT — น้ำหนักโมเดลมีขนาดดาวน์โหลดประมาณ 160GB และการอัปเดตเมื่อวันที่ 31 กรกฎาคม (V4-Flash-0731) เพิ่มความสามารถด้าน agentic อย่างมีนัยสำคัญ ส่วน Gemini 3.7 Flash เป็นโมเดล proprietary ที่สร้างบน Gemini 3.6 Flash มีบริบท 1 ล้านโทเคน เพดานเอาต์พุต 64K รองรับอินพุตแบบมัลติโมดัล และไม่มีทางเลือกสำหรับการโฮสต์เอง หนึ่งในสองโมเดลนี้สามารถตัดขาดจากเครือข่าย ปรับแต่งละเอียด และรันบนฮาร์ดแวร์ของคุณเองได้ ส่วนอีกโมเดลหนึ่งรันได้เฉพาะที่ Google รันมันเท่านั้น

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Flashes ทั้งสองเคียงข้างกัน

โมเดลทั้งสองกำหนดเป้าหมายไปที่ผู้ซื้อกลุ่มเดียวกัน — เวิร์กโหลดการผลิตปริมาณสูงที่ไม่สามารถจ่ายราคาระดับเรือธงต่อโทเคนได้ — แต่ทั้งคู่ไปถึงเป้าหมายนั้นด้วยสถาปัตยกรรมที่ตรงกันข้าม แอตเทนชันแบบไฮบริดของ DeepSeek V4 Flash (sparse ที่ถูกบีบอัด บวกกับแอตเทนชันที่ถูกบีบอัดอย่างหนัก) คือสิ่งที่ทำให้บริบทขนาด 1M มีความคุ้มทุนพอที่จะขายในราคาเหล่านี้; มันคือโมเดลที่ Deep​Seek กำหนดให้เอนด์พอยต์รุ่นเก่าอย่าง `deepseek-chat` และ `deepseek-reasoner` ชี้ไปที่ ซึ่งเอนด์พอยต์เหล่านี้ถูกยุติการใช้งานในเดือนกรกฎาคม Gemini 3.7 Flash คือการปรับแต่งเชิงอัลกอริทึมของ Go​ogle ต่อสายผลิตภัณฑ์ Flash ของตน และจุดแข็งของมันคือทรูพุตในการให้บริการ: การวัดแบบอิสระระบุว่าอยู่ที่ประมาณ 340 โทเคนต่อวินาที เทียบกับ DeepSeek V4 Flash ที่ประมาณ 113 และมันไปถึงระดับนั้นพร้อมกับรองรับอินพุตเสียงและวิดีโอ ซึ่ง DeepSeek V4 Flash ไม่รองรับ

Intelligence Index — 56 สำหรับ Gemini 3.7 Flash เทียบกับ 50 สำหรับ DeepSeek V4 Flash ตามข้อมูลของ Artificial Analysis

ความเร็วเอาต์พุต — ~340 tokens/s เทียบกับ ~113 tokens/s ทั้งคู่จากข้อมูลของ Artificial Analysis.

หน้าต่างบริบท — 1M tokens สำหรับทั้งคู่; DeepSeek V4 Flash เอาต์พุตสูงสุด 384K เทียบกับ Gemini 3.7 Flash ที่ 64K

ราคาอินพุต — $0.75 (โปรโมชัน ถึงปี 2026) เทียบกับ $0.14 บน API ของ Deep​Seek เอง.

ราคาเอาต์พุต — $3.75 (ราคาโปรโมชัน) เทียบกับ $0.28.

น้ำหนัก — แบบกรรมสิทธิ์เทียบกับแบบใช้สัญญาอนุญาต MIT และดาวน์โหลดได้

A comparison scoreboard for Gemini 3.7 Flash and DeepSeek V4 Flash: Gemini 3.7 Flash leads 56 to 50 on the AA Index and ~340 to ~113 tokens per second, while DeepSeek V4 Flash leads 384K to 64K on max output, $0.14 to $0.75 on input and $0.28 to $3.75 on output, with both at 1M context and proprietary weights against MIT open weights.

หกจุดดัชนีซื้ออะไรได้จริง

ช่องว่างดัชนีหกจุดนั้นมีความหมายแต่ไม่ถึงกับเป็นเหว และส่วนใหญ่อยู่ในพื้นที่ที่ DeepSeek V4 Flash ไม่ได้ถูกปรับให้เหมาะสม ตัวเลขการเขียนโค้ดแบบ agentic ที่รายงานของ Gemini 3.7 Flash (65.3 บน DeepSWE v1.1, 43.6 บน FrontierCode 1.1 Main ซึ่งรายงานโดยผู้จำหน่าย) นำหน้าอยู่มาก และค่า Elo การพัฒนาเว็บ (1588 ซึ่งรายงานโดยผู้จำหน่ายเช่นกัน) สะท้อนการปรับปรุงการสร้าง UI ที่เป็นจริง ตัวเลขที่รายงานของ DeepSeek V4 Flash เอง — 79.0 บน SWE-bench Verified, 91.6 บน LiveCodeBench, คะแนน τ²-Bench ที่ 95.0 ซึ่งตัวติดตามอิสระยืนยัน — ยังคงแข็งแกร่งในการเขียนโค้ดแบบมีขอบเขตและการใช้เครื่องมือ และการดึงข้อมูลบริบท 1M (78.7 บน MRCR, 60.5 บน CorpusQA) ก็แข่งขันได้กับทุกรุ่นในระดับราคาเดียวกัน รูปแบบคือ: Gemini 3.7 Flash นำในด้านความลึกแบบ agentic และงานเว็บ; DeepSeek V4 Flash แลกสิ่งเหล่านั้นกับความคุ้มค่าด้าน token ดิบและเพดานบริบทยาวที่โมเดล closed ตัวใดเทียบไม่ได้

โอเพนเวทเปลี่ยนกระบวนการจัดหา ไม่ใช่แค่ราคา

ใบอนุญาต MIT คือส่วนหนึ่งของการเปรียบเทียบนี้ที่ไม่มีตาราง benchmark ใดนำเสนอ DeepSeek V4 Flash สามารถดาวน์โหลดและรันบนฮาร์ดแวร์ของคุณเอง ปรับแต่งด้วยข้อมูลของคุณเอง และใช้ในสภาพแวดล้อมที่ไม่อนุญาตให้เรียกใช้ API — และใบอนุญาตไม่มีข้อจำกัดตามขนาด ดังนั้นการเติบโตของคุณจะไม่เปลี่ยนเงื่อนไข ต้นทุนที่แท้จริงคือด้านปฏิบัติการ: การเสิร์ฟโมเดล MoE ขนาด 284B ที่ความเร็วซึ่งทีมงานโปรดักชันต้องการต้องใช้ GPU จำนวนมาก และสำหรับทีมส่วนใหญ่ ตัวเลือกที่ตรงไปตรงมาคือ hosted API นั่นคือจุดที่ช่องว่างด้านราคาเกิดผลจริง แม้แต่เส้นทาง hosted ที่ราคา $0.14 / $0.28 ก็ถูกพอที่จะเป็นค่าเริ่มต้นสำหรับการใช้งานในระยะยาว Gemini 3.7 Flash ไม่มีความเป็นเจ้าของเลย — สิ่งที่คุณซื้อคือบริการที่จัดการอย่างน่าเชื่อถือ รวดเร็ว หลายโหมด พร้อมป้ายราคาส่งเสริมการขายและจุดสิ้นสุดในเดือนมกราคม

ใบเรียกเก็บเงินตามปริมาณการใช้งาน

รันในวันเดียวกันทั้งสอง: โทเคนอินพุต 20 ล้านตัว และโทเคนเอาต์พุต 4 ล้านตัว บน API ของ DeepSeek V4 Flash เอง ราคาคือ $2.80 + $1.12 รวมประมาณ $3.92 ส่วนบน Gemini 3.7 Flash ในอัตราส่งเสริมการขายคือ $15 + $15 รวมประมาณ $30 — ช่องว่าง 7.6 เท่า แม้ในขณะที่ Go​ogle กำลังลดราคาอยู่ หลังวันที่ 1 มกราคม 2027 เมื่อ Gemini 3.7 Flash กลับไปเป็น $1.50 / $7.50 ค่าใช้จ่ายในวันเดียวกันจะอยู่ที่ประมาณ $58 ซึ่งเป็น 15 เท่าของตัวเลขของ Deep​Seek ข้อได้เปรียบด้านความเร็วช่วยชดเชยได้บางส่วนในงานแบบโต้ตอบ — โทเคนที่เร็วกว่าหมายถึงคำขอพร้อมกันน้อยลง — แต่สำหรับงานแบบแบตช์และงานเบื้องหลัง โมเดลเปิดชนะเรื่องค่าใช้จ่ายอย่างไม่ต้องสู้ ทั้งสองโมเดลไม่ได้มุ่งไปที่เส้นต้นทุนเดียวกันด้วยซ้ำ ซึ่งนั่นคือประเด็นทั้งหมด

The OrcaRouter model page for DeepSeek V4 Flash, showing the ~$0.15 per million input and ~$0.29 per million output pass-through pricing, a 1M-token context window with 384K max output, and the text-only 284B-total / 13B-active mixture-of-experts description.

ใครควรสร้างบนอะไร

เลือก DeepSeek V4 Flash เมื่อต้นทุนต่อโทเคนเป็นข้อจำกัดหลัก เมื่อคุณต้องการผลลัพธ์ที่ยาวสูงสุด 384K เมื่อคุณต้องการตัวเลือกการโฮสต์ด้วยตนเองหรือการติดตั้งแบบแยกเครือข่าย (air-gapped) หรือเมื่อคุณกำลังสร้างสิ่งที่อัตรากำไรจะไม่รอดกับราคาโทเคนระดับเรือธง เลือก Gemini 3.7 Flash เมื่อคุณต้องการความเร็วในลูปแบบอินเทอร์แอกทีฟ อินพุตมัลติโมดัล ความน่าเชื่อถือที่จัดการโดย Go​ogle หรือผลลัพธ์การเขียนโค้ดแบบเอเจนต์ที่แข็งแกร่งกว่าที่ Go​ogle รายงาน — และเมื่อคุณสบายใจว่าราคาส่งเสริมการขายเป็นเพียงชั่วคราว พวกมันไม่ได้เป็นคู่แข่งแบบที่เรือธงสองตัวเป็นคู่แข่งกัน แต่เป็นกลยุทธ์การจัดซื้อที่แตกต่างกันสองแบบที่สวมชื่อเดียวกัน เลเยอร์การกำหนดเส้นทางคือจุดที่กลยุทธ์มาบรรจบกัน: DeepSeek V4 Flash เปิดใช้งานบน OrcaRouter ในราคารายการของ Deep​Seek โดยมีมาร์กอัป 0% และรูปแบบ failover เข้ากับการจับคู่นี้โดยธรรมชาติ — กฎที่ให้ปริมาณทราฟฟิกส่วนใหญ่ทำงานบน V4 Flash และส่งต่อส่วนย่อยที่ยากขึ้นไปยังโมเดลปิดที่แข็งแกร่งกว่า โดย Gemini 3.7 Flash เข้าถึงได้ผ่าน Gemini API ของ Go​ogle เองบนอีกขาของเราเตอร์ตัวเดียวกัน

การอ่านอย่างตรงไปตรงมา

หากคุณสามารถโฮสต์ได้เองหรือให้ต้นทุนเป็นตัวขับเคลื่อนหลัก DeepSeek V4 Flash คือโมเดลที่ดีกว่าที่จะสร้างต่อ และไลเซนส์ทำให้เป็นการตัดสินใจที่คุณไม่ต้องกลับมาทบทวนอีก หากคุณต้องการความเร็วในการให้บริการของ Google อินพุตแบบมัลติโมดัล หรือความได้เปรียบด้านการเขียนโค้ดแบบ agentic ตามที่มีรายงาน Gemini 3.7 Flash คือบริการที่ดีกว่าในขณะที่โปรโมชันยังคงอยู่ — โดยที่การขึ้นราคาสองเท่าในเดือนมกราคมถูกกำหนดไว้ในปฏิทินแล้ว สองโมเดล หนึ่งชื่อ และตลาดจะได้เห็นว่าปรัชญาใดที่ปริมาณการใช้งานในปีหน้าจะโหวตให้

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube