DeepSeek V4.1 Flash

deepseek/deepseek-v4.1-flash
ใหม่แนะนำ
การมองเห็นเครื่องมือJSONการให้เหตุผล
โดย DeepSeek · 2026-09-10

DeepSeek-V4.1-Flash เป็นโมเดลที่เล็กที่สุดในตระกูลสถาปัตยกรรมใหม่ของ DeepSeek เปิดตัวเมื่อวันที่ 10 กันยายน 2026 มีความสามารถด้านความเข้าใจภาพแบบมัลติโมดัลโดยกำเนิด — เป็นตัวสืบทอดการใช้งานจริงของทั้ง V4 Flash และการทดลอง V4 Flash Vision สถาปัตยกรรมใหม่นี้ตั้งเป้าขีดความสามารถที่สูงขึ้น การอนุมานที่เร็วขึ้น และปริมาณงานที่สูงขึ้น โดย DeepSeek รายงานว่า V4.1 Flash ดีกว่า V4 Pro อย่างครอบคลุมทั้งในด้านประสิทธิภาพ ต้นทุน ความเร็ว และเวลารวมของงาน รองรับอินพุตข้อความและรูปภาพพร้อมเอาต์พุตข้อความ ให้บริการหน้าต่างบริบทขนาด 1M โทเคน พร้อมเอาต์พุตสูงสุด 384K โทเคน และรองรับโหมดคิด (ค่าเริ่มต้น พร้อมเลือกระดับความพยายาม ต่ำ / สูง / สูงสุด) และโหมดไม่คิด ผ่าน Chat Completions, Responses และ API ที่เข้ากันได้กับ Anthropic พร้อมด้วยเอาต์พุต JSON การเรียกใช้เครื่องมือ และการเติมข้อความนำหน้าแชท FIM ทำงานเฉพาะในโหมดไม่คิดเท่านั้น น้ำหนักของโมเดลเปิดให้ใช้งานบน Hugging Face (deepseek-ai/DeepSeek-V4.1-Flash) เกณฑ์มาตรฐานอย่างเป็นทางการในตอนวางจำหน่าย: 90.6 บน Terminal-Bench 2.1, 74.2 บน DeepSWE v1.1, 65.4 บน NL2Repo-Bench, 90.9 บน GPQA Diamond, 63.9 บน HLE พร้อมเครื่องมือ และผลลัพธ์เอเจนต์วิทัศน์โดยกำเนิดที่แข็งแกร่ง (89.6 BabyVision, 78.9 Chartography พร้อมเครื่องมือ) ราคาถูกปรับลดพร้อมกับการวางจำหน่าย: $0.15/M อินพุต (cache miss), $0.60/M เอาต์พุต และ $0.003/M สำหรับ cache hit ในอัตรานอกช่วงเวลาเร่งด่วน โดยเพิ่มเป็นสองเท่าในช่วงเวลาเร่งด่วนวันธรรมดา (01:00-04:00 และ 06:00-10:00 UTC) ชั่วโมงอื่น ๆ ทั้งหมดรวมถึงวันหยุดสุดสัปดาห์เป็นช่วงนอกเวลาเร่งด่วน

เอนด์พอยต์:/v1/chat/completions/v1/responses/v1/messages
ctx1M โทเค็น
เอาต์พุตสูงสุด384K
อินพุตtext + image
เอาต์พุตtext
p50 TTFT412 ms
INPUT$0.15/ 1M โทเค็น
OUTPUT$0.60/ 1M โทเค็น
p50 TTFT412 ms7 วัน
p95 TTFT1.60 s7 วัน
ทราฟฟิก299.5Mโทเค็น / 7วัน
รับ API ของ DeepSeek V4.1 Flash ลองใน playground</> ใช้ผ่าน API

DeepSeek V4.1 Flash เป็นโมเดลของ DeepSeek ที่ใช้งานได้ผ่าน OrcaRouter ซึ่งเป็น API gateway ที่เข้ากันได้กับ OpenAI โดยรองรับอินพุตทั้งข้อความและรูปภาพ มีหน้าต่างบริบท 1,048,576 โทเค็น…

DeepSeek V4.1 Flash คืออะไร?

DeepSeek V4.1 Flash สร้างขึ้นสำหรับใคร?

ทำไมหน้าต่างบริบท 1,048,576 โทเคนจึงสำคัญ?

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

ราคา

ราคา
อินพุต / 1M โทเค็น · นอกช่วงพีค$0.150
เอาต์พุต / 1M โทเค็น · นอกช่วงพีค$0.600
อ่านแคช / 1M · นอกช่วงพีค$0.0030
ชั่วโมงพีค01:00–04:00, 06:00–10:00 ×2 (UTC)
อินพุต / 1M โทเค็น · ×2$0.300
เอาต์พุต / 1M โทเค็น · ×2$1.20
อ่านแคช / 1M · ×2$0.0060
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $2.85 · เมื่อใช้แคชพรอมป์ต์ $2.34

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.000302

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
412 ms
ความเร็วเอาต์พุต
215 tok/s
p95 TTFT
1.60 s
อัตราข้อผิดพลาด
0.07%

เกณฑ์มาตรฐานสาธารณะ

Agents' Last Exam
31.8
Automation-Bench
54.8
BabyVision (with tools)
89.6
Chartography (with tools)
78.9
CyberGym
88.1
DeepSWE v1.1
74.2
ExploitGym
15.3
GPQA Diamond
90.9
HLE
36.8
HLE (with tools)
63.9
MathArena Apex
65.6
NL2Repo-Bench
65.4
ProgramBench
20.3
SEC-Bench Pro
62.8
Terminal-Bench 2.1
90.6
Terminal-Bench 3.0
30.0
Terminal-Bench 4.0
31.2
ZeroBench-main (with tools)
49.0
แหล่งที่มา: api-docs.deepseek.com

กระแสในชุมชน

สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้

Hacker News13 การกล่าวถึง · 7 วันเพิ่มขึ้น 13 จากสัปดาห์ก่อน

การเปรียบเทียบ

DeepSeek V4.1 FlashDeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash Vision (Exp)
อินพุต $/ล้าน$0.15$0.73$0.24$0.24
เอาต์พุต $/ล้าน$0.60$2.18$0.73$0.73
บริบท1.0M1.0M1.0M1.0M
คุณภาพ8/108/107/107/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก DeepSeek

FAQ

DeepSeek V4.1 Flash มีค่าใช้จ่ายเท่าไรบน OrcaRouter
OrcaRouter เรียกเก็บค่าบริการ DeepSeek V4.1 Flash ในราคา $0.15 ต่อ 1M โทเค็นอินพุต และ $0.60 ต่อ 1M โทเค็นเอาต์พุต โดยคิดตามอัตราของผู้ให้บริการแบบไม่มีมาร์กอัป ไม่มีค่าธรรมเนียมแยกต่างหากที่ระบุไว้สำหรับหน้าต่างบริบทเอง: 1,048,576 โทเค็นเป็นขีดจำกัด ไม่ใช่ค่าธรรมเนียม โทเค็นอินพุตครอบคลุมข้อความ รูปภาพ และประวัติการสนทนาที่คุณส่ง โทเค็นเอาต์พุตครอบคลุมทุกอย่างที่สร้างขึ้น สูงสุด 384,000 โทเค็น
หน้าต่างบริบทและเอาต์พุตสูงสุดมีขนาดใหญ่แค่ไหน
DeepSeek V4.1 Flash มีหน้าต่างบริบทขนาด 1,048,576 โทเคน และเอาต์พุตสูงสุด 384,000 โทเคน หน้าต่างอินพุตช่วยให้คุณส่งเอกสารทั้งฉบับ บันทึกถอดความ หรือสแนปช็อตรีโพซิทอรีได้ในครั้งเดียว ขณะที่เพดานเอาต์พุตรองรับชิ้นงานความยาวแบบรอบเดียว เช่น ข้อกำหนด แผนการโยกย้าย หรือดิฟแบบขยาย
DeepSeek V4.1 Flash เก่งที่สุดในด้านใด?
มันถูกสร้างขึ้นสำหรับงานที่ใช้ข้อมูลนำเข้ายาวและผลลัพธ์ยาว: การวิเคราะห์เอกสารทั้งฉบับ, การทำความเข้าใจโค้ดในคลังขนาดใหญ่, การตรวจสอบแบบหลายรูปแบบของข้อความรวมถึงรูปภาพ, และเวิร์กโฟลว์ที่ต้องการคำตอบที่สร้างขึ้นอย่างมีนัยสำคัญแทนที่จะเป็นคำตอบสั้น ๆ คะแนน 90.9 บน GPQA Diamond ยังชี้ให้เห็นถึงการให้เหตุผลเชิงวิทยาศาสตร์และเชิงเทคนิคระดับบัณฑิตศึกษาที่มั่นคง อินพุตรองรับทั้งข้อความและรูปภาพ; เอาต์พุตเป็นข้อความเท่านั้น
มันเปรียบเทียบกับโมเดลระดับแนวหน้าที่มีขนาดใหญ่กว่าได้อย่างไร?
โมเดลระดับแนวหน้าอาจเป็นผู้นำในเบนช์มาร์กด้านการให้เหตุผลที่ยากที่สุด และมักคิดค่าบริการต่อโทเคนสูงกว่า ในขณะที่ DeepSeek V4.1 Flash มีหน้าต่างบริบท 1,048,576 โทเคน และเพดานเอาต์พุต 384,000 โทเคน ในราคา $0.15 ต่อ 1M โทเคนอินพุต และ $0.60 ต่อ 1M โทเคนเอาต์พุต สำหรับงานที่ใช้บริบทยาวและงานปริมาณมาก มักเป็นตัวเลือกที่ใช้งานได้จริง สำหรับขั้นตอนการให้เหตุผลแต่ละขั้นที่ยากที่สุด การส่งคำขอเหล่านั้นไปยังโมเดลที่มีค่าใช้จ่ายสูงกว่าบน OrcaRouter ถือเป็นรูปแบบที่สมเหตุสมผล
ข้อมูลจะถูกจัดการอย่างไรเมื่อฉันเรียกใช้โมเดลนี้
OrcaRouter ส่งคำขอไปยัง API ของ DeepSeek และคิดค่าบริการในอัตราของผู้ให้บริการโดยไม่มีกำไรส่วนเพิ่ม การเก็บรักษา การใช้เพื่อการฝึก และข้อกำหนดที่เกี่ยวข้องอยู่ภายใต้นโยบายของผู้ให้บริการ ไม่ใช่ข้อตกลงแยกต่างหากที่อธิบายไว้ที่นี่ ดังนั้นโปรดยืนยันข้อกำหนดปัจจุบันของผู้ให้บริการก่อนส่งเนื้อหาที่ละเอียดอ่อน ปิดบังข้อมูลระบุตัวตนที่คุณไม่จำเป็นต้องใช้ และเก็บพรอมป์ต์ให้เหลือน้อยที่สุดเท่าที่งานต้องการ บริบทที่เล็กลงยังช่วยลดต้นทุนอินพุตที่ $0.15 ต่อ 1M โทเคน
ฉันจะเรียกมันผ่าน API ที่เข้ากันได้กับ OpenAI ได้อย่างไร
ตั้งค่า Base URL ของไคลเอนต์ของคุณเป็น https://api.orcarouter.ai/v1 และใช้ model id deepseek/deepseek-v4.1-flash กับ OrcaRouter API key ของคุณ คำขอและการตอบกลับเป็นไปตามสคีมา OpenAI chat completions ดังนั้น SDK ที่มีอยู่ ตัวจัดการสตรีมมิ่ง และการแยกวิเคราะห์การเรียกใช้เครื่องมือจึงทำงานได้โดยไม่ต้องเปลี่ยนแปลง โดยปกติการย้ายระบบเป็นการเปลี่ยน Base URL และสตริงโมเดล บวกกับการรันชุดการประเมินของคุณซ้ำ
DeepSeek V4.1 Flash สามารถรับรูปภาพได้หรือไม่
ใช่ รองรับอินพุตรูปภาพผ่านอาร์เรย์เนื้อหาแบบมัลติโมดัลมาตรฐาน โดยมีส่วนข้อความและรูปภาพอยู่ในข้อความผู้ใช้เดียวกัน โทเค็นรูปภาพนับเป็นอินพุตและคิดค่าบริการที่ $0.15 ต่อ 1M โทเค็นอินพุตบน OrcaRouter เอาต์พุตยังคงเป็นข้อความเท่านั้น ดังนั้นโมเดลจะอธิบายหรือดึงข้อมูลจากรูปภาพแทนการสร้างรูปภาพ
คะแนน 90.9 บน GPQA Diamond เพียงพอที่จะทำให้คุณเชื่อถือมันสำหรับงานของคุณได้หรือไม่
มันเป็นสัญญาณที่มีประโยชน์ ไม่ใช่การรับประกัน GPQA Diamond วัดความสามารถในการให้เหตุผลด้านวิทยาศาสตร์ระดับบัณฑิตศึกษาภายใต้รูปแบบพรอมป์ตที่ตายตัว ซึ่งเกี่ยวข้องกับการตอบคำถามทางเทคนิค แต่บอกอะไรได้น้อยเกี่ยวกับการเรียกคืนข้อมูลในบริบทที่ยาว โทนเสียง หรือความแม่นยำในการสกัดข้อมูลจากข้อมูลของคุณ ให้สร้างชุดประเมินขนาดเล็กจากอินพุตจริง รันกับ DeepSeek V4.1 Flash และ model ids ทางเลือกอื่น ๆ บน OrcaRouter แล้วเปรียบเทียบต้นทุนและคุณภาพก่อนที่จะกำหนดเส้นทางทราฟฟิกโปรดักชัน

ฝังป้ายนี้

DeepSeek: DeepSeek V4.1 Flash$0.15/M in412ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg" alt="DeepSeek: DeepSeek V4.1 Flash บน OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4.1 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash)

ข้อมูลโมเดลแบบ data

GET /api/public/models/deepseek/deepseek-v4.1-flashเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt