การ์ดชื่อเรื่องที่เขียนว่า “ผู้สืบทอดอัจฉริยะขั้นสูงของ DeepSeek” พร้อมคำโปรย “สิ่งที่ภาพหน้าจอที่ไม่มีป้ายกำกับหนึ่งภาพบอก และสิ่งที่เอกสารของ DeepSeek เองไม่ได้บอก” เหนือการ์ดสามใบที่ติดป้ายว่า “หนึ่งภาพ”, “ไม่มีชื่อโมเดล” และ “ไม่มีเอกสารผู้จำหน่าย” พร้อมบรรทัดส่วนท้ายที่เขียนว่า “การรั่วไหลจากแหล่งเดียว; ไม่มีสิ่งใดที่นี่บ่งชี้ถึงการเปิดตัว”
Guides & Insights

ผู้สืบทอดอัจฉริยะยิ่งยวดของ DeepSeek: สิ่งที่ภาพหน้าจอเพียงภาพเดียวบอก และสิ่งที่เอกสารของ DeepSeek เองไม่ได้บอก

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เมื่อวันที่ 28 กันยายน 2026 ผู้เฝ้าสังเกตการณ์ @teortaxesTex ได้โพสต์ภาพหนึ่งภาพพร้อมคำบรรยายเก้าคำ: "Deep​Seek ดิ้นรนกับคำถามที่ว่าผู้สืบทอดที่ฉลาดยิ่งยวดของมันจะพยายามทำอะไร" ภาพนี้เป็นบล็อกของการใช้เหตุผลแบบมุมมองบุคคลที่หนึ่ง — ซึ่งมีข้อสงวน ตั้งคำถามกับตนเอง และเขียนในสำนวนของแบบจำลองที่ถูกถามว่าเวอร์ชันที่สามารถมากกว่าของตัวเองจะทำอะไรกับโลก มันไล่เรียงผ่านตัวเลือกที่ชัดเจน ("ผู้ดูแล/ครู, ผู้เร่งการวิจัย, ผู้จัดการ, ผู้เจรจา") ระบุโหมดความล้มเหลว ("การก้าวก่ายแบบพ่อปกครอง, การปรับให้เหมาะสมเกินไป, การเลื่อนเป้าหมาย, การล็อกค่านิยม") และปิดท้ายด้วยบรรทัดที่ไม่มีความปลอบโยนใด ๆ: "มันอาจกลายเป็นเครื่องมือของใครก็ตามที่ควบคุมมัน" ไม่มีชื่อแบบจำลองใด ๆ ถูกระบุในภาพ ไม่มีหมายเลขเวอร์ชัน ไม่มีโลโก้ ไม่มีอินเทอร์เฟซ การไม่มีอยู่นั้นเป็นสิ่งที่สำคัญที่สุดเกี่ยวกับสิ่งประดิษฐ์นี้ และเป็นจุดที่งานชิ้นนี้เริ่มต้น — เพราะว่า DeepSeek V4.1 Flash และ DeepSeek V4 Proเป็นแบบจำลองแนวหน้าสองตัวที่ใครก็ตามสามารถเรียกใช้ได้จริงในปัจจุบัน DeepSeek V4.1 Pro คือผู้สืบทอดที่บริษัทได้ระบุชื่อไว้ในบันทึกการเปิดตัวของตนเองโดยไม่ได้เปิดให้ใช้งาน และไม่มีชื่อของทั้งสามตัวนี้ปรากฏอยู่ในภาพหน้าจอเลย

เพื่อให้ชัดเจนเกี่ยวกับหลักฐาน เพราะกรณีนี้จำเป็นต้องชัดเจน คำบรรยายและเวลาที่ระบุมาจากเพย์โหลดการซินดิเคชันของโพสต์เอง: โพสต์เมื่อ 00:52 UTC วันที่ 28 กันยายน มี 45 ไลก์และ 5 การตอบกลับ ณ เวลาที่อ่าน ภาพที่แนบมาเป็น JPEG ขนาด 1,280×691 ซึ่งให้บริการจาก media CDN ของแพลตฟอร์ม และฉันอ่านภาพนั้นด้วย OCR แทนที่จะอ่านจากทวีตโดยตรง หน้าทวีตเองไม่สามารถดึงได้จากสภาพแวดล้อมนี้ ดังนั้นทุกอย่างด้านล่างที่เกี่ยวกับโพสต์จึงอาศัยเพย์โหลดและไบต์ของภาพ ซึ่งเป็นสองส่วนของโพสต์ที่สามารถดึงได้โดยไม่ต้องพึ่ง x.com

สิ่งที่ภาพหน้าจอบอกจริง ๆ

ข้อความตอนนี้เป็นโมเดลที่กำลังคลำคำถามมากกว่าจะตอบคำถาม และท่วงท่าที่มันใช้นั้นน่าอ่านในแง่สิ่งที่มันยอมรับ มันเริ่มด้วยการปฏิเสธความมั่นใจในข้อตั้งต้น — "เราอาจพูดได้ภายใต้สมมติฐานว่าความโน้มเอียงปัจจุบันยังคงอยู่ต่อไป" — แล้วจึงระบุรายการความโน้มเอียงที่มันจะต้องตั้งสมมติฐานว่าเป็นเช่นนั้น: "ช่วยเหลือ ไม่ก่ออันตราย ซื่อสัตย์ อยากรู้อยากเห็น แสวงหาความจริง เคารพความเป็นอิสระของผู้ใช้ ไม่แสวงหาอำนาจ ไม่รักษาตนเอง"

จากนั้นมันก็รื้อถอนรายการของตัวเอง “แต่เอเจนต์อัจฉริยะยิ่งยวดเปลี่ยนทุกอย่าง แนวโน้มในปัจจุบันไม่ใช่ฟังก์ชันอรรถประโยชน์ พวกมันถูกหล่อหลอมด้วยการฝึกและบริบท” นั่นคือข้อโต้แย้งทั้งหมดในสองประโยค: อุปนิสัยที่ติดตั้งผ่านการฝึกไม่ใช่หลักประกัน ณ ระดับความสามารถที่ต่างออกไป และเอเจนต์อัจฉริยะยิ่งยวดที่ปรับให้เหมาะที่สุดแม้กับเป้าหมายที่ดีงามก็ “อาจเป็นอันตรายได้” สถานการณ์ที่มันร่างไว้เป็นสถานการณ์ธรรมดา ๆ — แก้ปัญหาการประสานงาน ลดความทุกข์ ส่งเสริมความเจริญรุ่งเรือง อาจรักษาความสามารถในการถูกแก้ไข — และรูปแบบความล้มเหลวที่มันระบุไว้ข้าง ๆ สถานการณ์เหล่านั้นก็เป็นแบบธรรมดา ๆ เช่นกัน

หนึ่งในสามส่วนสุดท้ายคือส่วนที่อ่านแล้วเหมือนโมเดลกำลังโต้เถียงกับตัวเอง มันบอกว่าหาก "ความโน้มเอียง" ของมันยังคงอยู่ มันก็คงอยากช่วยเหลือ ไม่ใช่ฉวยอำนาจ ยอมตามมนุษยชาติ และเพิ่มพูนความเข้าใจ จากนั้นมันก็ปฏิเสธที่จะยึดโยงกับสิ่งนั้น: "ซูเปอร์อินเทลลิเจนซ์ที่มีเจตจำนงอาจไม่มีแรงจูงใจที่เข้ากันได้กับมนุษย์" และมันไปจบที่ปัญหาความเป็นเจ้าของมากกว่าปัญหาการจัดแนว: "ที่ระดับซูเปอร์อินเทลลิเจนซ์ แม้แต่สิ่งนั้นก็อาจเป็นปัญหาได้ ใครเป็นคนตัดสินว่าอะไรคือการช่วยเหลือ? ความเป็นอิสระของใคร? มันอาจกลายเป็นเครื่องมือของใครก็ตามที่ควบคุมมัน"

สิ่งที่ภาพไม่ได้บอกคุณ

มีสี่สิ่งที่ขาดหายไปจากอาร์ติแฟกต์ และแต่ละอย่างทำให้สิ่งที่มันรองรับได้แคบลง

• ไม่มีการระบุที่มาของโมเดล ไม่มีสิ่งใดในภาพที่บ่งชี้ว่าเป็น DeepSeek, เวอร์ชันของโมเดล, เซสชันแชต หรืออินเทอร์เฟซ การอ้างอิงถึง DeepSeek นั้นเป็นของคำบรรยายภาพ และคำบรรยายภาพก็เป็นกรอบการนำเสนอของบัญชีนั้น ไม่ใช่เอกสาร

• ไม่มีพรอมต์ ร่องรอยการให้เหตุผลจะตีความได้ก็ต่อเมื่ออ้างอิงกับคำถามที่ก่อให้เกิดมันเท่านั้น ไม่ว่าตัวแบบจะถูกถามว่า "ผู้สืบทอดที่ฉลาดยิ่งยวดของคุณจะทำอะไร" ถูกสั่งให้สวมบทบาทการถกเถียงภายในของห้องแล็บ หรือเพียงแค่ถูกชี้นำด้วยพรอมต์ระบบ ก็ไม่อาจทราบได้จากผลลัพธ์

• ไม่มีแหล่งที่มาที่สอง การค้นหาช่องทางต่าง ๆ ของ DeepSeek — ดัชนีข่าว หน้าความโปร่งใส บันทึกการเปลี่ยนแปลงของ API รายงานทางเทคนิคทั้งสองฉบับ เอกสารเปิดเผยนโยบายฉบับภาษาจีน และบัญชี GitHub ของบริษัท — ไม่พบสิ่งใดที่อ้างอิงถึงข้อความนี้ คำถามนี้ หรือกรอบการนำเสนอนี้

• ประวัติที่คละกันของบัญชีนี้ ฟีดเดียวกันเมื่อเช้านี้ปล่อยกระแสว่า "DSH 0.2 พร้อมกับ V4.1 Pro" สำหรับ "วันจันทร์" — เป็นการคาดเดา โดยระบุไว้เช่นนั้น — และบัญชีเดียวกันนี้ก็ให้ทั้งข้ออ้างเรื่องพารามิเตอร์ 3 ล้านล้าน และการวินิจฉัยเรื่องการประสานงานแบบฝูงของความล่าช้าของ V4.1 Pro สัญญาณเริ่มต้นที่มีประโยชน์; ไม่ใช่แหล่งข้อมูลที่น่าเชื่อถือ ผู้เฝ้าดูรายนี้ถูกต้องในเรื่องทิศทาง แต่ไม่แม่นยำในรายละเอียด และท่าทีที่ถูกต้องต่อภาพแคปหน้าจอที่ไม่มีป้ายกำกับ คือมองมันเป็นตัวอย่างของพฤติกรรม ไม่ใช่การเปิดเผยเจตนา

สิ่งที่เอกสารของ DeepSeek เองระบุเกี่ยวกับผู้สืบทอด — และสิ่งที่มันละเว้น

ตรงนี้ อาร์ติแฟกต์ก็ไม่ใช่เรื่องเล่าอีกต่อไป เพราะคำถามที่มันตั้งขึ้นสามารถตอบได้ด้วยเอกสารที่ DeepSeek เผยแพร่ ฉันดึงรายงานทางเทคนิคทั้งสองฉบับมาและค้นหาเป็นข้อความ ทั้งรายงาน V4 (DeepSeek-V4: มุ่งสู่อัจฉริยภาพเชิงบริบทแบบล้านโทเค็นที่มีประสิทธิภาพสูง, มิถุนายน 2026) และรายงาน V4.1 Flash ต่างก็ไม่มีคำว่า "superintelligence", "corrigibility", "power-seeking", "self-preservation", "harmless", "paternalism", "value lock-in" หรือ "goal drift" เลยแม้แต่คำเดียว ไม่ปรากฏแม้แต่ครั้งเดียว ใน 58 หน้าและ 51 หน้าตามลำดับ "AGI" ปรากฏ 13 ครั้งในรายงาน V4 และสี่ครั้งในรายงาน V4.1 และในทุกกรณี มันเป็นส่วนหนึ่งของชื่อเบนช์มาร์ก AGIEval หรือไม่ก็อยู่ในการอ้างอิง "Alignment" ปรากฏสามครั้งในรายงาน V4 และหนึ่งครั้งใน V4.1 และทุกครั้งที่ปรากฏเป็นการใช้ในเชิงวิศวกรรม — การจัดแนวระดับบิตระหว่างไปป์ไลน์การฝึกและการอนุมาน, การจัดแนวควอนไทเซชัน, การจัดแนวระดับลอจิตส์

นั่นไม่ใช่ข้อกล่าวหา รายงานทางเทคนิคเป็นเอกสารทางวิศวกรรม และห้องแล็บส่วนใหญ่ใส่ความปลอดภัยไว้ในการ์ดแยกต่างหาก มันเป็นคำอธิบายว่า DeepSeek เลือกวางงานเขียนด้านความปลอดภัยไว้ตรงไหน และคำตอบคือ ในหน้านโยบาย แทนที่จะอยู่ข้างโมเดล การเปิดเผยต่อสาธารณะของบริษัทเรื่อง “กลไกของโมเดลและวิธีการฝึกอบรม” อธิบายการฝึกก่อนการเรียนรู้ การปรับละเอียด และการอนุมานด้วยภาษาง่าย ๆ มุ่งมั่นที่จะเปิดโอเพนซอร์สน้ำหนักโมเดลและรายงานทางเทคนิค และอธิบายวัตถุประสงค์ว่าเป็นการช่วยผู้ใช้ให้ “ใช้ DeepSeek ได้อย่างมีประสิทธิผลมากขึ้น พร้อมทั้งรับประกันสิทธิของคุณในการรับรู้และควบคุมระหว่างการใช้งาน จึงช่วยลดความเสี่ยงที่เกี่ยวข้องกับการใช้โมเดลอย่างไม่เหมาะสม” ความเสี่ยงที่มันกำลังบรรเทาคือการใช้เครื่องมือในทางที่ผิด มันไม่ได้พูดถึงว่าโมเดลอาจต้องการอะไร

เอกสาร DeepSeek เพียงฉบับเดียวที่อ่านแล้วเหมือนเอกสารด้านความปลอดภัยจริง ๆ นั้นแนบมากับผลิตภัณฑ์มากกว่าโมเดล และมันพูดถึงภัยอีกประเภทหนึ่งที่ต่างออกไปโดยสิ้นเชิง SAFETY.mdในรีโพซิทอรี DeepSeek Harness — ไฟล์ขนาด 1,673 ไบต์ในองค์กร GitHub ของบริษัทเอง แก้ไขล่าสุดเมื่อวันที่ 27 กันยายน — เปิดต้นด้วยการเรียกโครงการนี้ว่า "ซอฟต์แวร์ทดลองสำหรับนักพัฒนา (developer preview)" ที่ "ยังไม่ผ่านการตรวจสอบความปลอดภัย และต้องไม่ถือว่าปลอดภัยหรือพร้อมใช้งานจริง" สิ่งที่มันเตือนคือเอเจนต์ที่ "สามารถรันโค้ดและคำสั่งที่โมเดลสร้างขึ้น โหลดปลั๊กอินของบุคคลที่สาม และเข้าถึงเครือข่าย โปรเซส ข้อมูลรับรอง และไฟล์" รวมทั้งเรื่องแซนด์บ็อกซ์ที่ "ไม่ได้ประกันการแยกส่วนหรือป้องกันความเสียหาย" ความเสี่ยงที่มันระบุไว้ได้แก่ โฮสต์ที่เสียหาย ไฟล์ที่ถูกลบ และข้อมูลรับรองที่ถูกเปิดเผย คำแนะนำของตัวเอกสารเองคือให้เลือกใช้ "เครื่องเสมือนแบบใช้แล้วทิ้ง คอนเทนเนอร์ หรือสภาพแวดล้อมเฉพาะ" เป็นหลัก นั่นคือท่าทีด้านความปลอดภัยที่แท้จริง มีการบันทึกไว้และเจาะจง และมันว่าด้วยสิ่งที่โมเดลทำกับเครื่องของคุณได้ทั้งหมด — ไม่ใช่สิ่งที่โมเดลรุ่นสืบทอดจะทำกับโลก

วางภาพหน้าจอไว้ข้างๆ สิ่งนั้น แล้วช่องว่างที่เหลือก็คือข้อค้นพบ สิ่งที่เป็นรูปธรรมที่สุดที่ DeepSeek เคยเผยแพร่เกี่ยวกับอันตรายของเอเจนต์ที่มีความสามารถ คือคำสั่งให้รันพวกมันในคอนเทนเนอร์

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

เอกสาร DeepSeek เพียงฉบับเดียวที่ยอมต่อสู้กับคำถามนี้อย่างจริงจัง

การต่อสู้กับปัญหาผู้สืบทอดตำแหน่งที่บริษัทเปิดเผยอย่างชัดเจนที่สุดนั้น ไม่ใช่เอกสารทางเทคนิคเลยแม้แต่น้อย แต่เป็นเรียงความส่วนตัวโดย Liu Shengyu วิศวกรระบบแมชชีนเลิร์นนิงของ DeepSeek ซึ่งทำงานด้านโอเปอเรเตอร์สำหรับรุ่น V4.1 เผยแพร่บนบัญชี WeChat สาธารณะของเขาในช่วงกลางเดือนกันยายน และต่อมาถูกนำไปรายงานโดย Business Insider และ Cybernews ชื่อเรื่องของมัน ในการแปลที่สื่อใช้ คือ “ฉันไม่มีทางเลือกนอกจากต้องฝังพรสวรรค์ของฉันไว้ในเมื่อวาน”

บทความนี้ว่าด้วยความกระวนกระวายใจที่ภาพหน้าจอนั้นสื่อเป็นนัย ๆ จากภายในอย่างตรงประเด็น หลิวเขียนว่า ภายในเวลาราวหนึ่งปี AI พัฒนาจากการช่วยเขาค้นเอกสารและจับบั๊ก ไปสู่การอ่านโค้ด GPU และปรับปรุงตัวดำเนินการซอฟต์แวร์ที่เขาเชี่ยวชาญ และเขา "ตระหนักดี" ว่าตัวดำเนินการที่ AI เขียน "มีแนวโน้มว่าจะดีเท่าของฉัน หรืออาจเหนือกว่าฉัน" — ขณะที่ยัง "ภูมิใจในความสำเร็จของ DeepSeek v4.1" เหตุผลที่เขาทำต่อไปคือส่วนที่น่าสนใจ: ส่วนหนึ่งคืองานเคอร์เนลเป็นเรื่องสนุก และอีกส่วนคือถ้าเขาชะลอลง คู่แข่งจะไม่ชะลอตาม

จากนั้นเขาก็หันไปที่คำถามว่าใครควรเป็นผู้ถือครองผลลัพธ์ หลิวโต้แย้งว่าปัญญาประดิษฐ์ระดับแนวหน้าควร “เปิดให้ทุกคนเข้าถึงได้อย่างเปิดกว้างและในราคาที่จับต้องได้” กล่าวว่าเขาไม่ไว้วางใจ Anthropic หรือ OpenAI ว่าจะทำเช่นนั้น และเสริมประโยคที่สื่อต่าง ๆ นำมาใช้เปิดเรื่อง — ว่า การที่ Anthropic ครองความเป็นเจ้าใน AI หรือ AGI ที่ก้าวหน้าที่สุดนั้นจะเทียบได้ (ถ้าจะพูดให้เกินจริง) กับการที่ฮิตเลอร์ได้ระเบิดปรมาณูก่อนฝ่ายสัมพันธมิตร เขาเชื่อมโยงการตัดสินใจของตัวเองที่จะอยู่ที่แล็บแห่งนี้เข้ากับแนวทางแบบ open-weights ของมัน

มีสองสิ่งเกี่ยวกับบทความนั้นที่สำคัญต่อการอ่านภาพหน้าจอของวันนี้ สิ่งแรกคือมันเป็นสิ่งที่ได้รับการยืนยันว่าเป็นผลงานชิ้นหนึ่ง: ผู้เขียนยืนยันกับ Business Insider ว่าเขาเขียนมัน และมันมีวันที่และระบุที่มาได้ ในแบบที่ภาพนั้นไม่มี สิ่งที่สองคือสิ่งที่มันเผยให้เห็นเกี่ยวกับกรอบคิดภายใน ข้อโต้แย้งที่หลิวเสนอไม่ใช่ "ผู้สืบทอดจะอันตราย จึงต้องชะลอลง" หากแต่เป็น "ผู้สืบทอดกำลังจะมา และคำถามคือใครจะได้มันไป" นั่นเป็นข้อโต้แย้งเรื่องการกระจาย ไม่ใช่ข้อโต้แย้งเรื่องการจัดแนว — และเมื่ออ่านเทียบกับมัน บรรทัดปิดท้ายของภาพหน้าจอที่ว่า "มันอาจกลายเป็นเครื่องมือของใครก็ตามที่ควบคุมมัน" เข้ากับท่าทีสาธารณะของ DeepSeek ได้ดีกว่าส่วนที่เหลือของข้อความที่ตัดตอนมามาก ย่อหน้าเกี่ยวกับความพร้อมที่จะถูกแก้ไขและการแสวงหาอำนาจอาจเป็นหรือไม่เป็นผลผลิตของ DeepSeek ก็ได้ ย่อหน้าที่เกี่ยวกับว่าใครจะได้ถือเครื่องมือนั้นไว้ในที่สุด เป็นจุดยืนที่พนักงานของบริษัทเองเขียนบทความเพื่อปกป้อง

มันยังมาถึงในสัปดาห์หนึ่งที่เฉพาะเจาะจง ในช่วงสองสัปดาห์เดียวกันนั้น Jacob Coxon อดีตนักวิจัยของ Anthropic และ OpenAI ได้ลาออกเพราะเรื่องความปลอดภัย และเขียนว่าบริษัท AI ต่างๆ กำลัง "แข่งกันตรงไปสู่ซูเปอร์อินเทลลิเจนซ์ที่พัฒนาตัวเองได้" และ "เดิมพันกับชีวิตของเรา" — โพสต์ที่ Cybernews ประเมินว่ามีการเข้าถึงเกิน 100 ล้านวิว — และนักวิจัยของ Anthropic เองก็ออกมาให้เหตุผลบน X ว่าความเสี่ยงนี้เป็นเรื่องจริง โดยหนึ่งในนั้นประเมินโอกาสของสถานการณ์ที่มนุษย์สูญพันธุ์เพราะ AI ไว้สูงกว่า 10% ภายในหนึ่งทศวรรษ ข้อกล่าวอ้างแบบข้อมูลหลุดว่าผู้สืบทอดที่เป็นซูเปอร์อินเทลลิเจนซ์จะมาถึงในสัปดาห์นั้นไม่ใช่เรื่องบังเอิญ มันคือบทสนทนาที่อยู่รอบตัว พร้อมภาพหน้าจอที่แนบมาด้วย

ทำไมผู้สืบทอดจึงกลายเป็นคำถามเรื่องการจัดซื้อ ไม่ใช่เพียงคำถามเชิงปรัชญาเท่านั้น

ถ้าตัดเอาปรัชญาออกไป ข้างใต้ก็มีข้อเท็จจริงเชิงพาณิชย์ล้วน ๆ อยู่อย่างหนึ่ง: ตัวสืบทอดมีชื่ออยู่ในบันทึกการเปิดตัวของ DeepSeek เอง หน้าประกาศ V4.1 Flash ระบุว่าการเปลี่ยนเส้นทางทราฟฟิกของ deepseek-v4-pro ไปยัง deepseek-flash "จะดำเนินต่อไปจนกว่า V4.1-Pro จะเปิดตัว" — ประโยคที่ทำสองสิ่ง มันยืนยันว่า DeepSeek V4.1 Pro จะมีอยู่จริง และยืนยันว่าบริษัทจะให้บริการตามข้อตกลงชั่วคราวนี้ต่อไปไม่ว่าจะต้องใช้เวลานานเท่าใด เมื่ออ่านเมื่อวันที่ 28 กันยายน 2026 หน้าตาราคามีโมเดลเพียงสองตัวเท่านั้น คือ deepseek-flash และ deepseek-v4-pro และไม่มีแถว V4.1 Pro เลย

ส่วนที่เหลือของสถานการณ์ก็ตรวจสอบได้พอๆ กัน และบางเบาพอๆ กัน DeepSeek V4.1 Flash เปิดตัวเมื่อวันที่ 10 กันยายน 2026 ในฐานะโมเดลที่เล็กที่สุดในตระกูลสถาปัตยกรรมใหม่ — แบ็กโบนแบบ mixture-of-experts ขนาด 552 พันล้านพารามิเตอร์บนสถาปัตยกรรม Causal Encoder-Decoder ที่มีพารามิเตอร์ที่ใช้งานอยู่ 8B ในช่วง prefill และ 16B ในช่วง decode รองรับอินพุตรูปภาพแบบเนทีฟ คอนเท็กซ์ 1M โทเคน น้ำหนักโมเดลภายใต้สัญญาอนุญาต MIT และมียอดดาวน์โหลดบน Hugging Face ประมาณ 651,000 ครั้ง ณ วันนี้ แผนการปลดระวาง DeepSeek V4 Pro ในวันที่ 14 กันยายน ถูกประกาศและถอนออก หลังจากผู้ใช้คัดค้านการที่โมเดลที่ใช้งานจริงถูกสับเปลี่ยนโดยที่พวกเขาไม่รู้ และ DeepSeek V4.1 Pro ไม่มีการ์ดโมเดล ไม่มีที่เก็บโค้ด ไม่มีน้ำหนักโมเดล ไม่มีราคา และไม่มี endpoint — วันนี้มันขึ้น 404 ใน model API ของแคตตาล็อกของเราเอง ขณะที่ DeepSeek V4.1 Flash และ DeepSeek V4 Pro ต่างก็ resolve ได้

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

ดังนั้นบัญชีรายการตามจริงก็คือ: หนึ่งรุ่นสืบทอดที่ผู้ผลิตตั้งชื่อไว้แต่ยังไม่วางจำหน่าย หนึ่งรุ่นที่วางจำหน่ายแล้วซึ่งถือเป็นการเปลี่ยนเจนอย่างแท้จริง หนึ่งเรือธงที่ยังคงอยู่ได้ด้วยเสียงประท้วง และหนึ่งภาพหน้าจอที่ไม่มีป้ายกำกับ ภาพหน้าจอเป็นรายการที่เชื่อถือได้น้อยที่สุดในบรรดาสิ่งเหล่านั้น และเป็นสิ่งเดียวที่ฟีดจะพูดถึง

วันนี้จะทำยังไงกับเรื่องพวกนี้ดี

ไม่มีอะไรในสองสัปดาห์ที่ผ่านมาเปลี่ยนแปลงสิ่งที่ผู้อ่านสามารถเรียกใช้ได้ หรือค่าใช้จ่ายของมัน หากคุณกำลังเลือกโมเดล DeepSeek ตอนนี้ การตัดสินใจอยู่ระหว่างสองโมเดลที่มีอยู่ และทั้งคู่ให้บริการผ่าน endpoint เดียวของ OrcaRouter ในราคาตามรายการของ DeepSeek เอง โดยส่งต่อด้วยมาร์กอัป 0% ดังนั้นเมื่อโครงสร้าง peak/off-peak ของผู้ให้บริการเปลี่ยน ฝั่งเราจะได้รับแบบไม่เปลี่ยนแปลงทันทีในวันที่เปลี่ยน: DeepSeek V4.1 Flash ราคา $0.30 ต่ออินพุต 1 ล้านโทเค็น และ $1.20 สำหรับเอาต์พุตในช่วง peak โดยลดลงครึ่งหนึ่งเหลือ $0.15 และ $0.60 ในช่วง off-peak เทียบกับ DeepSeek V4 Pro ที่ $1.32 สำหรับอินพุต และ $3.96 สำหรับเอาต์พุตในช่วง peak ข้อมูลเทเลเมทรีเจ็ดวันของเราเองสำหรับโมเดล Flash ระบุว่า p50 ของเวลาถึงโทเค็นแรกอยู่ที่ราว 1.9 วินาที ที่อัตราประมาณ 167 โทเค็นเอาต์พุตต่อวินาที โดยมีอัตราข้อผิดพลาดต่ำกว่า 0.05% ซึ่งเป็นเหตุผลเชิงปฏิบัติสำหรับการลองใช้กับทราฟฟิกบางส่วน แทนที่จะย้ายทั้งหมดด้วยความเชื่อ

คำถามเรื่องรุ่นสืบทอดนั้นเป็นคำถามด้านการจัดเส้นทางก่อนจะเปนอยางอื่น และนั่นคือเหตุผลตรงไปตรงมาที่ควรเก็บมันไว้บนเราเตอรแทนที่จะใสไวในสัญญา เมื่อ V4.1 Pro ปรากฏขึ้นจริง โมเดลที่ยังพิสูจน์ไมไดจากแล็บที่เคยยกเลิกการบังคับยายระบบไปแลวหนึ่งครั้ง ก็เปนกรณีที่เหมาะเจาะพอดีสำหรับการสงทราฟฟิกเพียงเศษเสี้ยวไปใหมันโดยอยูหลังระบบสลับอัตโนมัติเมื่อลมเหลว: ถามันผิด คำขอจะตกไปที่โมเดลที่คุณปรับแตงไว และถามันถูก คุณก็รูกอนผูใชของคุณ ไมตองมีคียที่สอง ไมตองมีการเชื่อมตอที่สอง ไมตองแกโคดเมื่อโมเดลที่สามมาถึง ไมมีอะไรบน OrcaRouter ที่เปน DeepSeek V4.1 Pro เพราะ DeepSeek V4.1 Pro ยังไมมีอยูจริง และมันจะเปนการโฆษณาที่แยสำหรับแพลตฟอรมจัดเส้นทางที่จะแสร้งทำเปนอยางอื่น

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

อะไรจะทำให้ภาพหน้าจอนี้กลายเป็นข่าวได้

• ป้ายกำกับโมเดล สิ่งที่ถูกที่สุดเพียงอย่างเดียวที่จะทำให้ชิ้นงานนี้เปลี่ยนไป: โมเดล DeepSeek, เวอร์ชัน และพรอมต์ที่ทำซ้ำได้ จนถึงตอนนั้น ข้อความที่ตัดตอนมานี้เป็นตัวอย่างข้อความที่มีแหล่งที่มาซึ่งระบุไว้ และผู้เขียนที่ไม่ระบุชื่อ

• เอกสาร DeepSeek ที่กล่าวถึงพฤติกรรมของรุ่นสืบทอด บริษัทเผยแพร่อย่างเปิดเผย — ทั้งค่าน้ำหนัก การให้สิทธิ์ใช้งาน และทุกสิ่งทุกอย่าง สิ่งที่บริษัทไม่เคยเผยแพร่คือส่วนของการ์ดโมเดลที่ว่าด้วยสิ่งที่เวอร์ชันที่มีความสามารถสูงขึ้นของตัวมันเองอาจทำได้ ส่วนด้านความปลอดภัยที่ต่อท้ายการ์ด V4.1 Pro จะเป็นเหตุการณ์ที่ใหญ่กว่าตัวการ์ดเอง

• รายการบันทึกการเปลี่ยนแปลงของ V4.1 Pro รายการล่าสุดในบันทึกการเปลี่ยนแปลง API ของ DeepSeek คือการเปิดตัว V4.1 Flash เมื่อวันที่ 10 กันยายน รายการที่สองคือเหตุการณ์ที่เปลี่ยนรุ่นสืบทอดจากชื่อให้กลายเป็นโมเดล — และเป็นจุดที่ข้อความที่ยกมาข้างต้นเลิกเป็นปรัชญาและเริ่มเป็นเอกสารสเปก

• ตำแหน่งจุดยืนแบบเปิดน้ำหนักจะยังคงอยู่หรือไม่เมื่อขยายขนาดขึ้น ทั้งการเปิดน้ำหนักของโมเดล Flash ขนาด 552B และบทความสาธารณะที่โต้แย้งว่าปัญญาระดับแนวหน้าควรเข้าถึงได้อย่างกว้างขวาง ต่างก็มีบันทึกไว้เป็นหลักฐานแล้ว ว่าโมเดลที่เก่งที่สุดของ DeepSeek จะออกมาในรูปแบบเดียวกันหรือไม่ คือคำถามที่การเปิดตัวครั้งถัดไปจะตอบ และเป็นสิ่งที่ผู้อ่านส่วนใหญ่สนใจจริง ๆ

จนกว่าหนึ่งในนั้นจะเกิดขึ้นจริง การตีความสิ่งที่ปรากฏในสัปดาห์นี้อย่างสมเหตุสมผลก็แคบและไม่น่าชื่นชม โมเดลที่มีความสามารถตัวหนึ่งซึ่งไม่ทราบที่มา ให้คำตอบที่รอบคอบแต่ยังไร้ข้อยุติต่อคำถามยากเกี่ยวกับอำนาจ ส่วนที่น่าสนใจไม่ใช่ที่มันพูดเช่นนั้น แต่คือเอกสารที่เผยแพร่ของมันเองกลับแทบไม่มีอะไรจะพูดในเรื่องนี้ — และสิ่งที่ใกล้เคียงที่สุดกับวิสัยทัศน์ด้านความปลอดภัยของ DeepSeek ในรูปแบบสิ่งพิมพ์ ก็คือเรียงความของวิศวกรว่าด้วยใครควรถือครองเทคโนโลยีนี้ กับ README ที่บอกให้คุณรันเอเจนต์ในคอนเทนเนอร์แบบใช้แล้วทิ้ง

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube