
DeepSeek V4.1 Flash: โมเดลพื้นฐานใหม่เอี่ยมที่สวมหมายเลขรุ่นย่อย
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123ความฉลาด49การเขียนโค้ด
DeepSeek V4.1 Flash เปิดตัวเมื่อวันที่ 10 กันยายน 2026 พร้อมกับน้ำหนักโมเดลแบบ MIT แบบเปิด, บริบทหนึ่งล้านโทเคน, สถาปัตยกรรม Causal Encoder-Decoder ใหม่เอี่ยม, และแกนหลัก mixture-of-experts ที่มีพารามิเตอร์ 552 พันล้านตัว ซึ่งการ์ดโมเดลของ DeepSeek เองจัดเก็บภายใต้สิ่งที่บริษัทเรียกว่า "ตระกูลสถาปัตยกรรมใหม่" นอกจากนี้ หากผู้ติดตามที่ชี้ให้เห็นเรื่องการตั้งชื่อนี้ถูกต้อง นี่เป็นครั้งแรกที่ DeepSeek ใส่เลขเวอร์ชัน .1 ลงบนโมเดลฐานใหม่โดยสิ้นเชิง ซึ่งโดยปกติแล้วป้ายดังกล่าวสื่อถึงการปรับแต่งเล็กน้อย ไม่ใช่การสร้างใหม่ DeepSeek V4.1 Pro รุ่นเรือธงที่เลขดังกล่าวบ่งบอกถึง ยังไม่มีอยู่จริง
ความไม่สอดคล้องนั้นมีความหมายมากกว่าแค่เรื่องชื่อ ใครก็ตามที่เปรียบเทียบรุ่นของ DeepSeek ด้วยหมายเลขเวอร์ชันจะอ่านว่า "V4 Flash ไปยัง V4.1 Flash" เป็นขั้นตอนการแก้ไขเล็กน้อย และจัดสรรความสนใจตามนั้น สถาปัตยกรรมที่อยู่เบื้องหลังกลับบอกว่าไม่เป็นเช่นนั้น และการตัดสินใจของบริษัทเองที่จะเลิกใช้โมเดลเรือธงที่มีพารามิเตอร์ 1.6 ล้านล้านตัว เพื่อหันไปใช้โมเดล Flash ก็ยิ่งบอกว่าไม่เป็นเช่นนั้นอย่างชัดเจนยิ่งขึ้น

สิ่งที่วางจำหน่ายจริงเมื่อวันที่ 10 กันยายน
อันนี้ไม่ใช่การรั่วไหลและไม่ใช่เบต้า การทดสอบ API สองวันซึ่งเริ่มเมื่อวันที่ 8 กันยายนภายใต้รหัสโมเดล deepseek-v4.1-flash-expires-on-0910 จบลงตามที่คำต่อท้ายระบุไว้ และการเปิดตัวอย่างเป็นทางการก็มาถึงวันนี้ในเว็บแอป แอปมือถือ และ API ของ DeepSeek เอง พร้อมด้วยน้ำหนักและรายงานทางเทคนิคที่เผยแพร่บน Hugging Face ภายใต้ deepseek-ai/DeepSeek-V4.1-Flash.
รายละเอียดเชิงปฏิบัติสำคัญกว่าพิธีการ:
• ชื่อโมเดล — เรียก deepseek-flash. ชื่อเดิม deepseek-v4-flash และ deepseek-v4-flash-vision-exp ยังคงรองรับอยู่ แต่ไม่ชี้ไปยังโมเดลที่เคยชี้แล้ว: ทั้งคู่ถูกยกเลิก และคำขอที่ระบุชื่อเหล่านี้จะให้บริการโดย DeepSeek V4.1 Flash และคิดค่าบริการในอัตรา Flash
• ในกล่องมีอะไรบ้าง — พารามิเตอร์ backbone 552B, หน้าต่างบริบท 1M โทเคน, เอาต์พุตสูงสุด 384K, เอาต์พุต JSON, การเรียกใช้ฟังก์ชัน และโหมดคิดที่เปิดเป็นค่าเริ่มต้น โดยมีระดับความพยายามต่ำ สูง และสูงสุด
• สัญญาอนุญาต — MIT รวมน้ำหนักโมเดล พร้อมโฟลเดอร์สำหรับการอนุมาน (inference) และโมดูลการเข้ารหัสแยกต่างหากในคลังเก็บโค้ด DeepSeek กำลังเชิญชวนชุมชนโอเพนซอร์สอย่างชัดเจนให้สร้างการรองรับการอนุมาน ซึ่งเป็นสัญญาณมาตรฐานว่าการให้บริการตั้งแต่วันแรกในรันไทม์หลัก ๆ นั้นเป็นเรื่องของวันไม่ใช่สัปดาห์
.1 ที่ไม่ใช่ point release
ข้อกล่าวหาที่เริ่มต้นบทความนี้มาจาก teortaxesTex ผู้เฝ้าติดตาม DeepSeek แบบไม่เปิดเผยตัวตนแต่เป็นที่จับตาอย่างใกล้ชิด ในโพสต์เมื่อวันที่ 10 กันยายน: ว่านี่คือ "ครั้งแรกที่ DeepSeek ตั้งชื่อรุ่นฐานใหม่ทั้งหมดด้วยเวอร์ชัน .1" ว่า V4.1 "แตกต่างจาก V4 มากกว่าอย่างเช่น LLaMA 3 แตกต่างจาก LLaMA 1" และว่า DeepSeek "ไม่รู้สึกว่านี่คู่ควรกับ V5 ในตอนนี้" — โดยที่ผู้โพสต์ไม่สามารถบอกได้ว่าทำไม
ให้ถือว่าส่วนเชิงเหตุเป็นการอนุมาน และส่วนเชิงโครงสร้างเป็นสิ่งที่ตรวจสอบได้ การอนุมานที่ว่าเหตุใด DeepSeek จึงเลือก .1 แทน V5 นั้นเป็นเพียงการอ่าน/ตีความของผู้สังเกตการณ์คนหนึ่งเท่านั้น ไม่มีใครนอกบริษัทอธิบายการตัดสินใจนี้ และเอกสารของ DeepSeek เองก็ไม่เคยพูดถึงมัน ส่วนที่ตรวจสอบได้คือสถาปัตยกรรม และมันไม่ได้ดูเหมือนการออกรุ่นย่อย บันทึกการเปลี่ยนแปลงของ DeepSeek อธิบาย V4.1 Flash ว่าเป็น "โมเดลที่เล็กที่สุดในตระกูลสถาปัตยกรรมใหม่ของเรา" ซึ่งเป็นประโยคที่แปลกที่จะเขียนเกี่ยวกับการเพิ่มเวอร์ชัน เพราะการเพิ่มเวอร์ชันเป็นการขยายตระกูล ไม่ใช่การก่อตั้งตระกูลใหม่
ความคลุมเครือนี้มีต้นทุนจริง และต้นทุนนั้นตกอยู่ที่ผู้ซื้อ ไม่ใช่ที่ DeepSeek หมายเลขเวอร์ชันเป็นสัญญาณที่ราคาถูกที่สุดที่นักพัฒนามีไว้ตอบคำถามว่า "นี่คือเจนเนอเรชันใหม่หรือแค่ปรับแต่งใหม่ และสมควรได้รับงบประมาณในการประเมินเท่าไร" ตอนนี้ DeepSeek ทำให้สัญญาณนั้นเชื่อถือไม่ได้ในทิศทางเดียว — โมเดลที่ก่อตั้งตระกูลสถาปัตยกรรมอยู่ห่างจากโมเดลที่เปลี่ยนสูตร post-training เพียงทศนิยมหนึ่งตำแหน่ง บริษัทได้เก็บเครื่องหมาย V5 ไว้สำรอง ส่วนทุกคนที่ทำการประเมินการย้ายระบบต่างจ่ายค่าความสับสนนี้
"new architecture" ในน้ำหนักหมายถึงอะไร
การ์ดโมเดลมีความเฉพาะเจาะจงผิดปกติ ซึ่งทำให้ข้อกล่าวอ้างเรื่องรุ่นนั้นทดสอบได้ง่ายโดยไม่ต้องมีเกณฑ์มาตรฐานแม้แต่ตัวเดียว มีสี่สิ่งที่โดดเด่น

• การเปิดใช้งานแบบอสมมาตร — การแบ่ง Causal Encoder-Decoder คือทรานส์ฟอร์มเมอร์ 40 เลเยอร์ที่จัดเป็น causal encoder 20 เลเยอร์ตามด้วย decoder 20 เลเยอร์ โดย global KV cache ของ decoder ถูกโปรเจกต์จาก hidden states สุดท้ายของ encoder แทนที่จะได้มาจากแต่ละเลเยอร์ของตัว decoder เอง จุดประสงค์ของการออกแบบนี้คือ โมเดลจะเปิดใช้งานเพียง 8B พารามิเตอร์ต่อโทเค็นในระหว่าง prefill และ 16B ในระหว่าง decode เวิร์กโหลดของเอเจนต์ที่เน้นอินพุตหนัก — เอกสารยาว, trace เครื่องมือยาว — จะได้ครึ่งที่ราคาถูกของโมเดล ส่วนการสร้างเอาต์พุตจะได้ครึ่งที่ราคาแพง
• การบีบอัด KV cache วัดต่อโทเคน — DeepSeek-V4.1-Flash ใช้ FP4 main KV caching ที่ 890 ไบต์ต่อโทเคน ซึ่งการ์ดระบุว่าอยู่ที่ประมาณหนึ่งในสี่ของ DeepSeek V4 Flash การรายงานของฝั่งจีนไปไกลกว่านั้น โดยเทียบการบีบอัดกับโมเดล V4 รุ่นแรกว่าเป็นการลดลง 437 เท่า ตัวเลขที่ใหญ่กว่านั้นมาจากการคำนวณของฝั่งผู้จำหน่ายบนฐานที่ต่างกัน จึงควรถือเป็นข้อกล่าวอ้างมากกว่าผลการวัด
• SWA แบบ Bounded Replay — โดยปกติแล้ว attention แบบ sliding-window จะบังคับให้คุณเก็บสถานะ KV ลงใน SSD เพื่อสร้างบริบทขึ้นมาใหม่ วิธีนี้จะสร้างสถานะ KV ของ SWA ที่หายไปขึ้นมาใหม่โดยการเล่นซ้ำเฉพาะหน้าต่างโทเค็นล่าสุดแทน ซึ่งช่วยลดพื้นที่เก็บข้อมูล KV แบบถาวรลงเหลือประมาณหนึ่งในแปดของ DeepSeek V4 Flash
Compressed Sparse Attention 2 — แต่ละเลเยอร์แอตเทนชันทำงานในหนึ่งในสามโหมดคงที่ (Full, Reindex หรือ Reuse) โดยใช้สถานะ KV และตัวจัดทำดัชนีร่วมกันระหว่างเลเยอร์ ด้วยตัวจัดทำดัชนีแบบเบาบางแบบลำดับชั้นที่จำกัดต้นทุนของเลเยอร์ที่ลึกลงไปโดยไม่ขึ้นกับความยาวของบริบท
เมื่ออ่านทั้งสี่อย่างรวมกัน ภาพเชิงกลยุทธ์ก็ชัดเจน: นี่คือสถาปัตยกรรมที่ให้ความสำคัญกับความเบาบาง (sparsity) และประสิทธิภาพของแคชเป็นอันดับแรก โดยถูกออกแบบขนาดให้โครงสร้างเดียวกันสามารถขยายเพิ่มในภายหลังได้ การกล่าวถึง “ตระกูลสถาปัตยกรรมใหม่” กำลังทำงานจริง — มันคือคำแถลงว่ายังมีอะไรอีกมากที่จะตามมา
เกณฑ์มาตรฐาน: รายงานโดยผู้จำหน่าย และยังไม่ถูกโต้แย้ง
DeepSeek เผยแพร่ชุดเกณฑ์มาตรฐานพร้อมกับการเปิดตัว จากตัวเลขของบริษัทเอง V4.1 Flash ได้คะแนน GPQA Diamond 90.9, เรตติ้ง Codeforces 3471, MathArena Apex 65.6, Terminal-Bench 2.1 ที่ 90.6, DeepSWE v1.1 ที่ 74.2 และ 63.9 บน HLE พร้อมเครื่องมือ — โดยตัวสุดท้ายมีเชิงอรรถระบุว่าตัวเลขพื้นฐาน 36.8 นั้นจำกัดเฉพาะชุดย่อยแบบข้อความล้วนของเกณฑ์มาตรฐานดังกล่าว
เรียกมันตามสิ่งที่มันเป็นเถอะ ตัวเลขเหล่านี้ถูกรายงานโดยผู้พัฒนาเอง เผยแพร่โดยไม่มีการประเมินอิสระจากภายนอกมาประกอบ และเป็นตัวเลขที่ DeepSeek ใช้เป็นเหตุผลในการปลดระวางโมเดลเรือธงของตัวเอง — ซึ่งนั่นทำให้มันเป็นตัวเลขที่น่าตรวจสอบมากที่สุด ณ วันเปิดตัวเมื่อวันที่ 10 กันยายน Artificial Analysis ยังไม่ได้เผยแพร่ผลการวัดประสิทธิภาพของ DeepSeek V4.1 Flash และหน้าข้อมูลโมเดลของ Hugging Face เองก็ยังคงมีข้อความระบุว่าโมเดลนี้ "ไม่ได้ถูกนำไปใช้งานโดยผู้ให้บริการอินเฟอเรนซ์รายใด" ข้อกล่าวอ้างหลักของการเปิดตัวครั้งนี้ — ที่ว่าโมเดลระดับ Flash เอาชนะโมเดลเรือธงขนาด 1.6 ล้านล้านพารามิเตอร์ได้อย่างรอบด้าน ทั้งในด้านประสิทธิภาพ ต้นทุน ความเร็ว และเวลาการประมวลผลรวม — ในขณะนี้เป็นเพียงคำกล่าวอ้างจากผู้พัฒนา โดยไม่มีการตรวจสอบจากภายนอก
อีกด้านหนึ่งก็มีข้อควรระวังที่ตรงไปตรงมาเช่นกัน รายงานจากผู้ขายรายเดียวกันระบุว่า V4.1 Flash ชนะ 13 จาก 16 การเปรียบเทียบกับ Kimi K3 และ 11 จาก 13 กับ GLM-5.3 ในขณะที่ยังตามหลัง GPT-5.6 Sol และ Claude Opus 5 ในงานใหม่ของ Terminal-Bench 3.0 และ 4.0 และใน ProgramBench นี่คือรูปแบบที่สอดคล้องกัน — แข็งแกร่งที่สุดในงานเขียนโค้ด งานเทอร์มินัล และงานอัตโนมัติเอเยนต์ซึ่งสถาปัตยกรรมนี้ถูกปรับให้เหมาะสม อ่อนแอกว่าในงานใช้เหตุผลระดับแนวหน้า — และนี่คือรูปแบบที่การก้าวข้ามรุ่นอย่างแท้จริงควรมี
ราคาและสวิตช์การกำหนดเส้นทางที่คุ้มค่าแก่การบันทึกลงในปฏิทิน
การกำหนดราคาใหม่มีผลบังคับใช้พร้อมการเปิดตัว และเป็นอัตราค่า Flash เดียวกับเดิม ไม่ใช่การลดราคา: สำหรับ deepseek-flash, การป้อนข้อมูลแบบ cache-hit คิดค่าใช้จ่าย $0.003 ต่อล้านโทเคนนอกช่วงพีค และ $0.006 ในช่วงพีค, การป้อนข้อมูลแบบ cache-miss คิด $0.15 และ $0.30, และเอาต์พุตคิด $0.60 และ $1.20 ช่วงพีคเป็นสองเท่าของนอกช่วงพีคพอดี และใช้กับวันจันทร์–ศุกร์ เวลา 01:00–04:00 และ 06:00–10:00 UTC.
การลดราคาครั้งนี้ตกอยู่กับทราฟฟิก Pro แทน DeepSeek V4 Pro ตั้งราคาอินพุตแบบ cache-hit ไว้ที่ $0.022 และ $0.044 อินพุตแบบ cache-miss อยู่ที่ $0.66 และ $1.32 และเอาต์พุตอยู่ที่ $1.98 และ $3.96 — ดังนั้นการส่งคำขอที่ใช้ชื่อ Pro ไปยัง V4.1 Flash จะช่วยลดต้นทุนเอาต์พุตลงได้ประมาณ 70% ขณะเดียวกันก็เพิ่มความสามารถในการตอบคำถามเหล่านั้น ตามที่ DeepSeek ระบุ

การเปลี่ยนเส้นทางนั้นถูกกำหนดเวลาไว้แล้ว ไม่ใช่เรื่องสมมุติ หลังเวลา 12:00 ตามเวลาปักกิ่งของวันที่ 14 กันยายน 2026 คำขอที่ระบุชื่อ deepseek-v4-pro จะถูกส่งไปยัง V4.1 Flash และคิดค่าบริการตามราคา Flash และจะคงอยู่เช่นนั้นจนกว่า DeepSeek V4.1 Pro จะเปิดตัว หากการผสานรวมของคุณกำหนดชื่อรุ่น Pro แบบฮาร์ดโค้ด จะไม่มีอะไรเสียหาย — คุณจะได้รับรุ่นที่แตกต่างกันในราคาเอาต์พุตประมาณหนึ่งในสาม โดยไม่ต้องแก้ไขโค้ด และไม่มีการแจ้งเตือนใด ๆ นอกเหนือจากรายการในบันทึกการเปลี่ยนแปลง หากคุณกำหนดเส้นทางตามระดับความสามารถแทนชื่อรุ่น วันที่ 14 กันยายนคือวันที่ต้องทดสอบใหม่
ถ้าคุณเรียกใช้ DeepSeek วันนี้ นี่หมายความว่าอย่างไร
OrcaRouter ยังไม่รองรับ DeepSeek V4.1 Flash — ณ วันนี้ หน้าโมเดลสำหรับ deepseek-v4.1-flash คืนค่า "ไม่พบโมเดล" และเราอยากพูดตรง ๆ แบบนั้นมากกว่าจะสื่อเป็นอื่น สิ่งที่ตามมาสองประการ ประการแรก การเปลี่ยนเส้นทางที่ DeepSeek ประกาศเป็นพฤติกรรม API ฝั่งผู้ให้บริการเอง ดังนั้นการสลับในวันที่ 14 กันยายนจึงเกิดขึ้นที่เอนด์พอยต์ของ DeepSeek เอง ไม่ว่าคุณจะเข้าถึงด้วยวิธีใด ประการที่สอง หากคุณต้องการสถาปัตยกรรมใหม่ในวันนี้ คุณต้องเรียกผู้ให้บริการโดยตรง
สิ่งที่เราจัดเส้นทางคือส่วนที่เหลือของไลน์ DeepSeek ด้วยคีย์เดียว: DeepSeek V4 Flash และ DeepSeek V4 Pro, พร้อมกับโมเดลอื่นอีก 200+ รุ่น ราคาที่นั่นคือราคารายการของผู้ให้บริการ DeepSeek ที่ส่งผ่านมาโดยคิดมาร์กอัป 0% ซึ่งเป็นส่วนที่สำคัญสำหรับการเปิดตัวแบบนี้ — เมื่อผู้ให้บริการลดราคา การลดราคานั้นจะมีผลจริงบนฝั่งของเราในวันเดียวกัน แทนที่จะเป็นหลังจากรอบการปรับราคาใหม่ และเมื่อ V4.1 Flash ปรากฏในแคตตาล็อกจริง อัตราครึ่งหนึ่งช่วงนอกเวลาเร่งด่วนดังกล่าวข้างต้นคืออัตราที่ใช้ ไม่ใช่ส่วนลดที่เราเจรจา
ข้อโต้แย้งเรื่องการกำหนดเส้นทางสำหรับโมเดลที่ใหม่ขนาดนี้ไม่ได้เกี่ยวกับราคาเป็นหลัก แต่เกี่ยวกับว่าคุณทุ่มเทเส้นทางการผลิตของคุณมากแค่ไหนบนสถาปัตยกรรมสัปดาห์แรกที่ไม่มีเกณฑ์วัดอิสระและไม่มีการให้บริการจากบุคคลที่สาม การเก็บโมเดลใหม่ไว้ในระดับที่คุณสามารถสลับได้ — หรือการทดสอบบนคีย์ที่ไม่ใช่คีย์โปรดักชันของคุณ — คือความแตกต่างระหว่างการประเมินผลและเหตุการณ์
อะไรจะยุติคำถามเรื่องการตั้งชื่อ
สามสิ่ง โดยเรียงลำดับจากน้อยไปมากตามปริมาณที่มันจะบอกคุณ
การประเมินอิสระของ DeepSeek V4.1 Flash จะทดสอบข้อเรียกร้องด้านสถาปัตยกรรมบนโครงสร้างการทดสอบของผู้อื่น นั่นคือการวัดเพียงอย่างเดียวที่เปลี่ยนตารางของผู้ขายให้กลายเป็นข้อเท็จจริง และมันคือข่าวชิ้นถัดไปที่มีแนวโน้มมากที่สุด
DeepSeek V4.1 Pro จะเป็นตัวทดสอบข้อกล่าวอ้างของครอบครัว ประกาศเส้นทางระบุว่ามันเป็นจุดสิ้นสุดของหน้าต่าง Pro-to-Flash ซึ่งทำให้มันเป็นโมเดลที่ทั้งรีลีสนี้ถูกจัดวางโครงสร้างไว้รอบ ๆ — และมันก็ยังคงเป็นโมเดลที่ DeepSeek ยืนยันข้อมูลน้อยที่สุด: ไม่มีการ์ดสเปก, ไม่มีจำนวนพารามิเตอร์, ไม่มีวันที่, ไม่มีน้ำหนัก, ไม่มีราคา
และสิ่งที่มีประโยชน์แม้จะไม่น่าตื่นเต้น: ว่า DeepSeek จะทำแบบนี้อีกหรือไม่ การติดป้าย .1 เป็นครั้งที่สองบนโมเดลพื้นฐานใหม่ตัวอื่น จะเปลี่ยนความผิดปกติให้กลายเป็นธรรมเนียมปฏิบัติ และธรรมเนียมปฏิบัติคือสิ่งที่นักพัฒนาสามารถวางแผนรับมือได้ โมเดลหนึ่งเป็นเพียงความแปลกใหม่ การตั้งชื่อจะกลายเป็นสิ่งที่ทำให้เข้าใจผิดอย่างมีประโยชน์ก็ต่อเมื่อมีรูปแบบเกิดขึ้น
สำหรับตอนนี้ การอ่านสถานการณ์เชิงปฏิบัติแยกออกอย่างชัดเจนตามว่าคุณเป็นใคร หากคุณใช้ DeepSeek V4 Pro ให้ใส่หมายเหตุวันที่ 14 กันยายนในปฏิทินและรันการประเมินของคุณใหม่ก่อนวันนั้น เพราะโมเดลที่อยู่เบื้องหลังชื่อนั้นกำลังจะเปลี่ยนไม่ว่าคุณจะขอหรือไม่ก็ตาม หากคุณใช้ DeepSeek V4 Flash คุณถูกย้ายไปแล้ว ในราคาเดียวกัน ไปสู่สถาปัตยกรรมที่ DeepSeek สร้างขึ้นเพื่อขยายขนาด และหากคุณกำลังรอ V5 อยู่ คำตอบที่ตรงไปตรงมาก็คือ DeepSeek ดูเหมือนจะปล่อยเจนเนอเรชันนั้นออกมาแล้วแต่ปฏิเสธที่จะตั้งชื่อมัน — ซึ่งเป็นสิ่งที่คุณจะทำได้เพียงครั้งเดียวก่อนที่ผู้คนจะเลิกเชื่อถือตัวเลขนั้น
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
