
DeepSeek V4 Flash Vision (Exp) เทียบกับ DeepSeek V4 Flash: ราคาเท่ากัน แต่อันหนึ่งมองเห็น
- DeepSeekใหม่DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 ต่อ 1 ล้านโทเค็น
- z-aiใหม่Z.ai: GLM 5.32026-08-1860ความฉลาด75การเขียนโค้ด
- obsidianใหม่Qwen3.8 27B2026-08-1552ความฉลาด68การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekใหม่DeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokใหม่SpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0957ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0961ความฉลาด77การเขียนโค้ด
DeepSeek V4 Flash Vision (Exp) และ DeepSeek V4 Flash เป็นโมเดลเดียวกันที่ต่างกันเพียงจุดเดียว และจุดต่างนั้นคือเรื่องราวทั้งหมด: โมเดลวิทัศน์มองเห็นภาพได้ ส่วนโมเดลข้อความมองไม่เห็น เปิดตัวในวันนี้ 21 สิงหาคม 2026 ในฐานะรุ่นทดลอง DeepSeek V4 Flash Vision (Exp) นำสมองด้านข้อความของ DeepSeek V4 Flash มาใช้โดยไม่เปลี่ยนแปลง — บริบท 1M token เท่าเดิม เอาต์พุตสูงสุด 384K เท่าเดิม ราคาต่อ token เท่าเดิม — และเพิ่มการรับภาพที่ทำให้คะแนนบนเกณฑ์ชี้วัดเอเจนต์ซึ่งโมเดลข้อความล้มเหลวอย่างเงียบๆ เปลี่ยนไป คำถามจริงๆ มีเพียงข้อเดียวว่าคำว่า “experimental” ทำให้คุณต้องจ่ายมากกว่าที่มันช่วยให้ประหยัดหรือไม่
โมเดลทั้งสอง
DeepSeek V4 Flash คือโมเดลหลักราคาประหยัดอย่างเป็นทางการของบริษัท: เป็นโมเดลแบบ Mixture-of-Experts ที่มีพารามิเตอร์รวมประมาณ 284B และพารามิเตอร์ที่ใช้งานจริง 13B รองรับเฉพาะข้อความ ปรับแต่งมาเพื่องานประจำวันที่มีการใช้งานพร้อมกันสูง โดยมีงบประมาณการทำงานพร้อมกันที่ 2,500 โทเคนต่อวินาทีบน API ของผู้ให้บริการ DeepSeek V4 Flash Vision (Exp) เป็นตระกูลน้ำหนักเดียวกันกับรุ่นหลัก แต่เพิ่ม vision encoder เข้ามาทางด้านหน้า คิดค่าบริการในอัตราเดียวกัน และถูกระบุว่าเป็นรุ่นทดลอง ทุกอย่างที่อยู่ใต้ดวงตาใช้ร่วมกัน
• พารามิเตอร์ — Vision-Exp: 284B รวม / 13B MoE ที่ใช้งาน เทียบกับ V4-Flash: 284B รวม / 13B MoE ที่ใช้งาน (ตระกูลเดียวกัน)
• อินพุต — Vision-Exp: ข้อความ + รูปภาพ (JPEG, PNG, GIF, WebP) เทียบกับ V4-Flash: ข้อความเท่านั้น
• บริบท — Vision-Exp: 1M โทเคน เทียบกับ V4-Flash: 1M โทเคน
• เอาต์พุตสูงสุด — Vision-Exp: 384K โทเคน เทียบกับ V4-Flash: 384K โทเคน
• โหมดการคิด — ทั้งสองรองรับการคิดและการไม่คิด
• รูปแบบ API — ทั้งสอง: Chat Completions, Messages, Responses
• ราคา — เหมือนกัน (ทั้งคู่คิดอัตราโทเค็นช่วงพีค/นอกพีคของ V4-Flash)
• สถานะ — Vision-Exp: รุ่นทดลอง ยังไม่มีกำหนด GA เทียบกับ V4-Flash: รุ่นที่วางจำหน่ายอย่างเป็นทางการ (V4-Flash-0731)

ที่ซึ่งวิสัยทัศน์เปลี่ยนกระดานคะแนน
ในเรื่องข้อความล้วน ๆ DeepSeek กล่าวว่าทั้งสองมีความสามารถเทียบเท่ากัน และไม่มีเหตุผลที่จะสงสัย — โมเดลวิทัศน์ถูกสร้างขึ้นจากความสามารถด้านข้อความเดียวกัน ความแตกต่างปรากฏชัดในเกณฑ์วัดเอเจนต์ที่มีภาพหน้าจอ แผนภูมิ และภาพ UI ซึ่งโมเดลที่อ่านได้เฉพาะข้อความจะเพิกเฉยต่อเนื้อหามัลติมีเดียโดยสิ้นเชิง ตัวเลขทั้งหมดด้านล่างนี้เป็นข้อมูลที่ผู้ขายรายงานจากประกาศเปิดตัววันนี้ ไม่ได้ถูกทำซ้ำอย่างอิสระ:
• ApexBench Pass@1 — Vision-Exp 36.5 เทียบกับ V4-Flash 26.2
• Agents' Last Exam — Vision-Exp 27.3 เทียบกับ V4-Flash 25.2
• Terminal-Bench 2.1 — Vision-Exp 83.9 เทียบกับ V4-Flash 82.7
• NL2Repo — Vision-Exp 57.7 เทียบกับ V4-Flash 54.2
• DeepSWE — Vision-Exp 59.3 เทียบกับ V4-Flash 54.4
• Chartography — Vision-Exp 64.3 (V4-Flash ไม่สามารถทำได้)
• ZeroBench Pass@5 — Vision-Exp 35.0 (V4-Flash ไม่สามารถทำได้)

การกระโดดขึ้นครั้งใหญ่ที่สุดคือ ApexBench ที่การเพิ่มความสามารถในการมองเห็นทำให้คะแนนเพิ่มขึ้นจาก 26.2 เป็น 36.5 — การเปลี่ยนแปลงถึงสิบจุดซึ่งไม่ใช่เพราะโมเดลคิดหนักขึ้น แต่เป็นเพราะในที่สุดมันได้อ่านโจทย์จริง ๆ สำหรับเอเจนต์ที่ทำงานผ่านหน้าจอ — เบราว์เซอร์ เดสก์ท็อป หรือเทอร์มินัลที่มีเอาต์พุตเรนเดอร์แล้ว — โมเดลข้อความทำงานแบบมืดบอดในส่วนของงานที่มีข้อมูลอยู่พอดี
คำถามเรื่องราคามีคำตอบเดียว
ไม่มีความแตกต่างด้านราคา และนี่คือจุดที่การเปรียบเทียบกลายเป็นเรื่องง่ายดายในทิศทางเดียว DeepSeek V4 Flash Vision (Exp) คิดค่าบริการในอัตราที่เท่ากันทุกประการกับ DeepSeek V4 Flash ซึ่งตั้งแต่วันที่ 16 สิงหาคม 2026 เป็นต้นมา มีอัตราแบบพีค/นอกช่วงพีค:
• อินพุต, แคชมิส — $0.22 ต่อ 1M โทเค็นนอกช่วงพีค, $0.44 ช่วงพีค (ทั้งสองโมเดล)
อินพุต, แคชฮิต — $0.007 ต่อ 1M โทเค็นนอกช่วงพีค, $0.014 ช่วงพีค (ทั้งสองโมเดล)
• เอาต์พุต — $0.66 ต่อ 1M โทเคน นอกช่วงพีค, $1.32 ช่วงพีค (ทั้งสองโมเดล)
• ช่วงเวลาเร่งด่วน — 01:00–04:00 และ 06:00–10:00 UTC ทั้งสองรุ่น
ต้นทุนเพิ่มเติมเพียงอย่างเดียวที่วิชันนำมาคือตัวรูปภาพเอง: แต่ละรูปจะถูกแปลงเป็นโทเคนสูงสุด 384 โทเคน ดังนั้นภาพหน้าจอหนึ่งภาพจึงมีต้นทุนประมาณ 0.0085 เซนต์ในช่วงนอกชั่วโมงเร่งด่วน แม้แต่เอเจนต์ที่ใช้วิชันหนักซึ่งอ่าน 50 รูปต่อการทำงานหนึ่งครั้ง ก็เพิ่มต้นทุนอินพุตไม่ถึง 1 เซนต์ การเลือกโมเดลข้อความเพื่อประหยัดเงินก็เหมือนการเลือกเศษเงินเพียงเล็กน้อยมากกว่าสายตา — การประหยัดนั้นไม่เป็นความจริง
ควรเลือกแบบไหนเมื่อใด
เลือก DeepSeek V4 Flash Vision (Exp) หากไปป์ไลน์ของคุณอาจต้องรับรูปภาพได้ทุกเมื่อ เอเจนต์ทดสอบ UI และเอเจนต์ QA ที่ตรวจสอบตามภาพหน้าจอ เอเจนต์ท่องเว็บที่ต้องอ่านหน้าที่กำลังเปิดอยู่ การแยกแผนภูมิและไดอะแกรม ภาพหน้าจอเอกสาร การจับภาพข้อความแสดงข้อผิดพลาดจากหน้าจอผู้ใช้ — ในทุกกรณีเหล่านี้ โมเดลวิทัศน์คือโมเดลที่ดีกว่าอย่างชัดเจนในราคาเดียวกัน ไม่มีการลดทอนคุณภาพข้อความ ตามที่ผู้จำหน่ายระบุ ดังนั้นเหตุผลเดียวที่จะไม่ใช้คือความเสถียร
เลือก DeepSeek V4 Flash หากปริมาณการรับส่งข้อมูลของคุณเป็นข้อความล้วนและไม่มีอะไรเกี่ยวกับมันจะเปลี่ยนแปลง สำหรับการเขียนโค้ดให้สมบูรณ์ การค้นคืน และการวนซ้ำเอเจนต์ที่ใช้ข้อความเท่านั้น โมเดลทั้งสองให้คะแนนเท่ากันในด้านข้อความ และเวอร์ชันเปิดตัวอย่างเป็นทางการเป็นตัวเลือกที่ปลอดภัยกว่าโดยนิยาม หากคุณใช้ V4-Flash อยู่แล้วและไม่เคยส่งรูปภาพ ก็ไม่มีเหตุผลที่จะต้องเปลี่ยน — และไม่มีเหตุผลที่จะไม่ให้ตัวเลือกนี้อยู่ในการตั้งค่าคอนฟิกการจัดเส้นทางของคุณเช่นกัน
ความแตกต่างที่แท้จริงเพียงอย่างเดียว: สถานะการทดลอง
ทุกอย่างที่อยู่เหนือดวงตาเหมือนกัน ต้นทุนของการมองเห็นนั้นเล็กน้อย เกณฑ์มาตรฐานให้ความได้เปรียบกับโมเดลวิทัศน์ ปัจจัยเดียวที่สมเหตุสมผลที่ทำให้คุณยังคงใช้ DeepSeek V4 Flash ในระบบผลิตได้ก็คือโมเดลวิทัศน์ยังเป็นเพียงขั้นทดลอง DeepSeek ระบุเช่นนั้น ไม่มีวัน GA ที่แน่นอน และกล่าวว่าไม่แนะนำให้ใช้ในงานผลิต สมองข้อความที่อยู่เบื้องหลังได้รับการพิสูจน์แล้ว แต่เส้นทางวิทัศน์เป็นของใหม่ และพื้นผิว API แบบทดลองคือจุดที่คุณไม่ต้องการให้เกิดความล้มเหลวเงียบๆ ตอนตีสอง
นี่คือจุดเดียวที่การเปรียบเทียบไม่ได้ถูกชี้ขาดด้วยสเปก และยังเป็นจุดเดียวที่เราเตอร์เปลี่ยนคำตอบ บน OrcaRouter ทั้งสองโมเดลทำงานจริง — deepseek/deepseek-v4-flash-vision-exp และ deepseek/deepseek-v4-flash — ภายใต้คีย์ API เดียวกันในราคารายการของผู้ให้บริการ โดยส่งผ่านโดยไม่มีส่วนเพิ่มใดๆ เพราะแพลตฟอร์มเดียวกันนี้จัดการเส้นทางให้ทั้งคู่ คุณจึงใช้โมเดลวิชันในจุดที่คุ้มค่า และตรึงส่วนที่เหลือไว้กับเวอร์ชันทางการ พร้อมระบบเฟลโอเวอร์อัตโนมัติ เพื่อที่ความขัดข้องของรุ่นทดลองจะไม่ทำให้ทั้งไปป์ไลน์ล้มลง คุณจะได้รับคะแนน ApexBench ที่เพิ่มขึ้นสิบจุดสำหรับการเรียกที่ต้องการ และความเสถียรของเวอร์ชันทางการสำหรับการเรียกที่ไม่ต้องการ โดยไม่ต้องมีสัญญาที่สองหรือโค้ดพาธที่สอง

บรรทัดล่าง
หากปริมาณงานของคุณรองรับรูปภาพ DeepSeek V4 Flash Vision (Exp) เอาชนะ DeepSeek V4 Flash ในทุกมิติที่สำคัญ และแพ้เพียงมิติเดียวที่คุณสามารถออกแบบระบบเพื่อเลี่ยงได้ นั่นคือสถานะการทดลอง หากปริมาณงานของคุณเป็นข้อความล้วน โมเดลทั้งสองให้ผลลัพธ์ที่เท่ากัน และเวอร์ชันเผยแพร่อย่างเป็นทางการชนะในด้านความเสถียร ทั้งสองไม่ใช่คู่แข่งกันจริง ๆ — โมเดลวิทัศน์คือโมเดลข้อความที่ปลดล็อกความสามารถพิเศษ โดยไม่มีค่าใช้จ่ายเพิ่มเติม การตัดสินใจเดียวที่คุ้มค่าคือ คุณยินดีจะชี้ทราฟฟิกของคุณไปยัง API ทดลองมากน้อยเพียงใด และนั่นคือการตัดสินใจด้านการกำหนดเส้นทาง ไม่ใช่การตัดสินใจเลือกโมเดล
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
