การ์ดชื่อเรื่องหลัก (hero title card) สำหรับ 'DeepSeek-V4-Flash-Vision-Exp vs DeepSeek-V4-Flash' พร้อมคำบรรยายใต้ชื่อ 'ราคาเท่ากัน แต่มีเพียงหนึ่งที่มองเห็น' โดยมีไอคอนเส้นรูปตาอยู่ทางซ้ายและไอคอนเส้นรูปเอกสารข้อความอยู่ทางขวา คั่นด้วยเส้นแบ่งบางๆ ที่เป็นกลาง และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

DeepSeek V4 Flash Vision (Exp) เทียบกับ DeepSeek V4 Flash: ราคาเท่ากัน แต่อันหนึ่งมองเห็น

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

DeepSeek V4 Flash Vision (Exp) และ DeepSeek V4 Flash เป็นโมเดลเดียวกันที่ต่างกันเพียงจุดเดียว และจุดต่างนั้นคือเรื่องราวทั้งหมด: โมเดลวิทัศน์มองเห็นภาพได้ ส่วนโมเดลข้อความมองไม่เห็น เปิดตัวในวันนี้ 21 สิงหาคม 2026 ในฐานะรุ่นทดลอง DeepSeek V4 Flash Vision (Exp) นำสมองด้านข้อความของ DeepSeek V4 Flash มาใช้โดยไม่เปลี่ยนแปลง — บริบท 1M token เท่าเดิม เอาต์พุตสูงสุด 384K เท่าเดิม ราคาต่อ token เท่าเดิม — และเพิ่มการรับภาพที่ทำให้คะแนนบนเกณฑ์ชี้วัดเอเจนต์ซึ่งโมเดลข้อความล้มเหลวอย่างเงียบๆ เปลี่ยนไป คำถามจริงๆ มีเพียงข้อเดียวว่าคำว่า “experimental” ทำให้คุณต้องจ่ายมากกว่าที่มันช่วยให้ประหยัดหรือไม่

โมเดลทั้งสอง

DeepSeek V4 Flash คือโมเดลหลักราคาประหยัดอย่างเป็นทางการของบริษัท: เป็นโมเดลแบบ Mixture-of-Experts ที่มีพารามิเตอร์รวมประมาณ 284B และพารามิเตอร์ที่ใช้งานจริง 13B รองรับเฉพาะข้อความ ปรับแต่งมาเพื่องานประจำวันที่มีการใช้งานพร้อมกันสูง โดยมีงบประมาณการทำงานพร้อมกันที่ 2,500 โทเคนต่อวินาทีบน API ของผู้ให้บริการ DeepSeek V4 Flash Vision (Exp) เป็นตระกูลน้ำหนักเดียวกันกับรุ่นหลัก แต่เพิ่ม vision encoder เข้ามาทางด้านหน้า คิดค่าบริการในอัตราเดียวกัน และถูกระบุว่าเป็นรุ่นทดลอง ทุกอย่างที่อยู่ใต้ดวงตาใช้ร่วมกัน

• พารามิเตอร์ — Vision-Exp: 284B รวม / 13B MoE ที่ใช้งาน เทียบกับ V4-Flash: 284B รวม / 13B MoE ที่ใช้งาน (ตระกูลเดียวกัน)

• อินพุต — Vision-Exp: ข้อความ + รูปภาพ (JPEG, PNG, GIF, WebP) เทียบกับ V4-Flash: ข้อความเท่านั้น

• บริบท — Vision-Exp: 1M โทเคน เทียบกับ V4-Flash: 1M โทเคน

• เอาต์พุตสูงสุด — Vision-Exp: 384K โทเคน เทียบกับ V4-Flash: 384K โทเคน

• โหมดการคิด — ทั้งสองรองรับการคิดและการไม่คิด

• รูปแบบ API — ทั้งสอง: Chat Completions, Messages, Responses

• ราคา — เหมือนกัน (ทั้งคู่คิดอัตราโทเค็นช่วงพีค/นอกพีคของ V4-Flash)

• สถานะ — Vision-Exp: รุ่นทดลอง ยังไม่มีกำหนด GA เทียบกับ V4-Flash: รุ่นที่วางจำหน่ายอย่างเป็นทางการ (V4-Flash-0731)

A screenshot of the DeepSeek API docs news page (captured August 21 2026) showing 'DeepSeek-V4-Flash-Vision-Exp Release 2026/08/21' at the top of the news list and the release post opening: 'This experimental multimodal model matches DeepSeek-V4-Flash on text capabilities — including agents, reasoning, and world knowledge.'

ที่ซึ่งวิสัยทัศน์เปลี่ยนกระดานคะแนน

ในเรื่องข้อความล้วน ๆ Deep​Seek กล่าวว่าทั้งสองมีความสามารถเทียบเท่ากัน และไม่มีเหตุผลที่จะสงสัย — โมเดลวิทัศน์ถูกสร้างขึ้นจากความสามารถด้านข้อความเดียวกัน ความแตกต่างปรากฏชัดในเกณฑ์วัดเอเจนต์ที่มีภาพหน้าจอ แผนภูมิ และภาพ UI ซึ่งโมเดลที่อ่านได้เฉพาะข้อความจะเพิกเฉยต่อเนื้อหามัลติมีเดียโดยสิ้นเชิง ตัวเลขทั้งหมดด้านล่างนี้เป็นข้อมูลที่ผู้ขายรายงานจากประกาศเปิดตัววันนี้ ไม่ได้ถูกทำซ้ำอย่างอิสระ:

• ApexBench Pass@1 — Vision-Exp 36.5 เทียบกับ V4-Flash 26.2

• Agents' Last Exam — Vision-Exp 27.3 เทียบกับ V4-Flash 25.2

• Terminal-Bench 2.1 — Vision-Exp 83.9 เทียบกับ V4-Flash 82.7

• NL2Repo — Vision-Exp 57.7 เทียบกับ V4-Flash 54.2

• DeepSWE — Vision-Exp 59.3 เทียบกับ V4-Flash 54.4

• Chartography — Vision-Exp 64.3 (V4-Flash ไม่สามารถทำได้)

• ZeroBench Pass@5 — Vision-Exp 35.0 (V4-Flash ไม่สามารถทำได้)

A two-column comparison scoreboard titled 'DeepSeek-V4-Flash-Vision-Exp vs DeepSeek-V4-Flash — the scoreboard': left column DeepSeek-V4-Flash-Vision-Exp — Input text + image, Context 1M tokens, Max output 384K, ApexBench Pass@1 36.5, Price $0.22/M off-peak, Status experimental; right column DeepSeek-V4-Flash — Input text only, Context 1M tokens, Max output 384K, ApexBench Pass@1 26.2, Price $0.22/M off-peak, Status official release; footer 'Benchmark figures vendor-reported; pricing per DeepSeek API docs.'

การกระโดดขึ้นครั้งใหญ่ที่สุดคือ ApexBench ที่การเพิ่มความสามารถในการมองเห็นทำให้คะแนนเพิ่มขึ้นจาก 26.2 เป็น 36.5 — การเปลี่ยนแปลงถึงสิบจุดซึ่งไม่ใช่เพราะโมเดลคิดหนักขึ้น แต่เป็นเพราะในที่สุดมันได้อ่านโจทย์จริง ๆ สำหรับเอเจนต์ที่ทำงานผ่านหน้าจอ — เบราว์เซอร์ เดสก์ท็อป หรือเทอร์มินัลที่มีเอาต์พุตเรนเดอร์แล้ว — โมเดลข้อความทำงานแบบมืดบอดในส่วนของงานที่มีข้อมูลอยู่พอดี

คำถามเรื่องราคามีคำตอบเดียว

ไม่มีความแตกต่างด้านราคา และนี่คือจุดที่การเปรียบเทียบกลายเป็นเรื่องง่ายดายในทิศทางเดียว DeepSeek V4 Flash Vision (Exp) คิดค่าบริการในอัตราที่เท่ากันทุกประการกับ DeepSeek V4 Flash ซึ่งตั้งแต่วันที่ 16 สิงหาคม 2026 เป็นต้นมา มีอัตราแบบพีค/นอกช่วงพีค:

• อินพุต, แคชมิส — $0.22 ต่อ 1M โทเค็นนอกช่วงพีค, $0.44 ช่วงพีค (ทั้งสองโมเดล)

อินพุต, แคชฮิต — $0.007 ต่อ 1M โทเค็นนอกช่วงพีค, $0.014 ช่วงพีค (ทั้งสองโมเดล)

• เอาต์พุต — $0.66 ต่อ 1M โทเคน นอกช่วงพีค, $1.32 ช่วงพีค (ทั้งสองโมเดล)

• ช่วงเวลาเร่งด่วน — 01:00–04:00 และ 06:00–10:00 UTC ทั้งสองรุ่น

ต้นทุนเพิ่มเติมเพียงอย่างเดียวที่วิชันนำมาคือตัวรูปภาพเอง: แต่ละรูปจะถูกแปลงเป็นโทเคนสูงสุด 384 โทเคน ดังนั้นภาพหน้าจอหนึ่งภาพจึงมีต้นทุนประมาณ 0.0085 เซนต์ในช่วงนอกชั่วโมงเร่งด่วน แม้แต่เอเจนต์ที่ใช้วิชันหนักซึ่งอ่าน 50 รูปต่อการทำงานหนึ่งครั้ง ก็เพิ่มต้นทุนอินพุตไม่ถึง 1 เซนต์ การเลือกโมเดลข้อความเพื่อประหยัดเงินก็เหมือนการเลือกเศษเงินเพียงเล็กน้อยมากกว่าสายตา — การประหยัดนั้นไม่เป็นความจริง

ควรเลือกแบบไหนเมื่อใด

เลือก DeepSeek V4 Flash Vision (Exp) หากไปป์ไลน์ของคุณอาจต้องรับรูปภาพได้ทุกเมื่อ เอเจนต์ทดสอบ UI และเอเจนต์ QA ที่ตรวจสอบตามภาพหน้าจอ เอเจนต์ท่องเว็บที่ต้องอ่านหน้าที่กำลังเปิดอยู่ การแยกแผนภูมิและไดอะแกรม ภาพหน้าจอเอกสาร การจับภาพข้อความแสดงข้อผิดพลาดจากหน้าจอผู้ใช้ — ในทุกกรณีเหล่านี้ โมเดลวิทัศน์คือโมเดลที่ดีกว่าอย่างชัดเจนในราคาเดียวกัน ไม่มีการลดทอนคุณภาพข้อความ ตามที่ผู้จำหน่ายระบุ ดังนั้นเหตุผลเดียวที่จะไม่ใช้คือความเสถียร

เลือก DeepSeek V4 Flash หากปริมาณการรับส่งข้อมูลของคุณเป็นข้อความล้วนและไม่มีอะไรเกี่ยวกับมันจะเปลี่ยนแปลง สำหรับการเขียนโค้ดให้สมบูรณ์ การค้นคืน และการวนซ้ำเอเจนต์ที่ใช้ข้อความเท่านั้น โมเดลทั้งสองให้คะแนนเท่ากันในด้านข้อความ และเวอร์ชันเปิดตัวอย่างเป็นทางการเป็นตัวเลือกที่ปลอดภัยกว่าโดยนิยาม หากคุณใช้ V4-Flash อยู่แล้วและไม่เคยส่งรูปภาพ ก็ไม่มีเหตุผลที่จะต้องเปลี่ยน — และไม่มีเหตุผลที่จะไม่ให้ตัวเลือกนี้อยู่ในการตั้งค่าคอนฟิกการจัดเส้นทางของคุณเช่นกัน

ความแตกต่างที่แท้จริงเพียงอย่างเดียว: สถานะการทดลอง

ทุกอย่างที่อยู่เหนือดวงตาเหมือนกัน ต้นทุนของการมองเห็นนั้นเล็กน้อย เกณฑ์มาตรฐานให้ความได้เปรียบกับโมเดลวิทัศน์ ปัจจัยเดียวที่สมเหตุสมผลที่ทำให้คุณยังคงใช้ DeepSeek V4 Flash ในระบบผลิตได้ก็คือโมเดลวิทัศน์ยังเป็นเพียงขั้นทดลอง Deep​Seek ระบุเช่นนั้น ไม่มีวัน GA ที่แน่นอน และกล่าวว่าไม่แนะนำให้ใช้ในงานผลิต สมองข้อความที่อยู่เบื้องหลังได้รับการพิสูจน์แล้ว แต่เส้นทางวิทัศน์เป็นของใหม่ และพื้นผิว API แบบทดลองคือจุดที่คุณไม่ต้องการให้เกิดความล้มเหลวเงียบๆ ตอนตีสอง

นี่คือจุดเดียวที่การเปรียบเทียบไม่ได้ถูกชี้ขาดด้วยสเปก และยังเป็นจุดเดียวที่เราเตอร์เปลี่ยนคำตอบ บน OrcaRouter ทั้งสองโมเดลทำงานจริง — deepseek/deepseek-v4-flash-vision-exp และ deepseek/deepseek-v4-flash — ภายใต้คีย์ API เดียวกันในราคารายการของผู้ให้บริการ โดยส่งผ่านโดยไม่มีส่วนเพิ่มใดๆ เพราะแพลตฟอร์มเดียวกันนี้จัดการเส้นทางให้ทั้งคู่ คุณจึงใช้โมเดลวิชันในจุดที่คุ้มค่า และตรึงส่วนที่เหลือไว้กับเวอร์ชันทางการ พร้อมระบบเฟลโอเวอร์อัตโนมัติ เพื่อที่ความขัดข้องของรุ่นทดลองจะไม่ทำให้ทั้งไปป์ไลน์ล้มลง คุณจะได้รับคะแนน ApexBench ที่เพิ่มขึ้นสิบจุดสำหรับการเรียกที่ต้องการ และความเสถียรของเวอร์ชันทางการสำหรับการเรียกที่ไม่ต้องการ โดยไม่ต้องมีสัญญาที่สองหรือโค้ดพาธที่สอง

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-flash showing the Tools, JSON and Reasoning badges, a 1M-token context, 384K max output, 'Input: text', a price block of $0.15 input / $0.29 output per 1M tokens with p50 TTFT 602 ms, and the model description 'DeepSeek V4 Flash efficient MoE — 284B total / 13B active params, 1M context'.

บรรทัดล่าง

หากปริมาณงานของคุณรองรับรูปภาพ DeepSeek V4 Flash Vision (Exp) เอาชนะ DeepSeek V4 Flash ในทุกมิติที่สำคัญ และแพ้เพียงมิติเดียวที่คุณสามารถออกแบบระบบเพื่อเลี่ยงได้ นั่นคือสถานะการทดลอง หากปริมาณงานของคุณเป็นข้อความล้วน โมเดลทั้งสองให้ผลลัพธ์ที่เท่ากัน และเวอร์ชันเผยแพร่อย่างเป็นทางการชนะในด้านความเสถียร ทั้งสองไม่ใช่คู่แข่งกันจริง ๆ — โมเดลวิทัศน์คือโมเดลข้อความที่ปลดล็อกความสามารถพิเศษ โดยไม่มีค่าใช้จ่ายเพิ่มเติม การตัดสินใจเดียวที่คุ้มค่าคือ คุณยินดีจะชี้ทราฟฟิกของคุณไปยัง API ทดลองมากน้อยเพียงใด และนั่นคือการตัดสินใจด้านการกำหนดเส้นทาง ไม่ใช่การตัดสินใจเลือกโมเดล

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube