
ผู้สืบทอดอัจฉริยะยิ่งยวดของ DeepSeek: สิ่งที่ภาพหน้าจอเพียงภาพเดียวบอก และสิ่งที่เอกสารของ DeepSeek เองไม่ได้บอก
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 316 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 196 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
เมื่อวันที่ 28 กันยายน 2026 ผู้เฝ้าสังเกตการณ์ @teortaxesTex ได้โพสต์ภาพหนึ่งภาพพร้อมคำบรรยายเก้าคำ: "DeepSeek ดิ้นรนกับคำถามที่ว่าผู้สืบทอดที่ฉลาดยิ่งยวดของมันจะพยายามทำอะไร" ภาพนี้เป็นบล็อกของการใช้เหตุผลแบบมุมมองบุคคลที่หนึ่ง — ซึ่งมีข้อสงวน ตั้งคำถามกับตนเอง และเขียนในสำนวนของแบบจำลองที่ถูกถามว่าเวอร์ชันที่สามารถมากกว่าของตัวเองจะทำอะไรกับโลก มันไล่เรียงผ่านตัวเลือกที่ชัดเจน ("ผู้ดูแล/ครู, ผู้เร่งการวิจัย, ผู้จัดการ, ผู้เจรจา") ระบุโหมดความล้มเหลว ("การก้าวก่ายแบบพ่อปกครอง, การปรับให้เหมาะสมเกินไป, การเลื่อนเป้าหมาย, การล็อกค่านิยม") และปิดท้ายด้วยบรรทัดที่ไม่มีความปลอบโยนใด ๆ: "มันอาจกลายเป็นเครื่องมือของใครก็ตามที่ควบคุมมัน" ไม่มีชื่อแบบจำลองใด ๆ ถูกระบุในภาพ ไม่มีหมายเลขเวอร์ชัน ไม่มีโลโก้ ไม่มีอินเทอร์เฟซ การไม่มีอยู่นั้นเป็นสิ่งที่สำคัญที่สุดเกี่ยวกับสิ่งประดิษฐ์นี้ และเป็นจุดที่งานชิ้นนี้เริ่มต้น — เพราะว่า DeepSeek V4.1 Flash และ DeepSeek V4 Proเป็นแบบจำลองแนวหน้าสองตัวที่ใครก็ตามสามารถเรียกใช้ได้จริงในปัจจุบัน DeepSeek V4.1 Pro คือผู้สืบทอดที่บริษัทได้ระบุชื่อไว้ในบันทึกการเปิดตัวของตนเองโดยไม่ได้เปิดให้ใช้งาน และไม่มีชื่อของทั้งสามตัวนี้ปรากฏอยู่ในภาพหน้าจอเลย
เพื่อให้ชัดเจนเกี่ยวกับหลักฐาน เพราะกรณีนี้จำเป็นต้องชัดเจน คำบรรยายและเวลาที่ระบุมาจากเพย์โหลดการซินดิเคชันของโพสต์เอง: โพสต์เมื่อ 00:52 UTC วันที่ 28 กันยายน มี 45 ไลก์และ 5 การตอบกลับ ณ เวลาที่อ่าน ภาพที่แนบมาเป็น JPEG ขนาด 1,280×691 ซึ่งให้บริการจาก media CDN ของแพลตฟอร์ม และฉันอ่านภาพนั้นด้วย OCR แทนที่จะอ่านจากทวีตโดยตรง หน้าทวีตเองไม่สามารถดึงได้จากสภาพแวดล้อมนี้ ดังนั้นทุกอย่างด้านล่างที่เกี่ยวกับโพสต์จึงอาศัยเพย์โหลดและไบต์ของภาพ ซึ่งเป็นสองส่วนของโพสต์ที่สามารถดึงได้โดยไม่ต้องพึ่ง x.com
สิ่งที่ภาพหน้าจอบอกจริง ๆ
ข้อความตอนนี้เป็นโมเดลที่กำลังคลำคำถามมากกว่าจะตอบคำถาม และท่วงท่าที่มันใช้นั้นน่าอ่านในแง่สิ่งที่มันยอมรับ มันเริ่มด้วยการปฏิเสธความมั่นใจในข้อตั้งต้น — "เราอาจพูดได้ภายใต้สมมติฐานว่าความโน้มเอียงปัจจุบันยังคงอยู่ต่อไป" — แล้วจึงระบุรายการความโน้มเอียงที่มันจะต้องตั้งสมมติฐานว่าเป็นเช่นนั้น: "ช่วยเหลือ ไม่ก่ออันตราย ซื่อสัตย์ อยากรู้อยากเห็น แสวงหาความจริง เคารพความเป็นอิสระของผู้ใช้ ไม่แสวงหาอำนาจ ไม่รักษาตนเอง"
จากนั้นมันก็รื้อถอนรายการของตัวเอง “แต่เอเจนต์อัจฉริยะยิ่งยวดเปลี่ยนทุกอย่าง แนวโน้มในปัจจุบันไม่ใช่ฟังก์ชันอรรถประโยชน์ พวกมันถูกหล่อหลอมด้วยการฝึกและบริบท” นั่นคือข้อโต้แย้งทั้งหมดในสองประโยค: อุปนิสัยที่ติดตั้งผ่านการฝึกไม่ใช่หลักประกัน ณ ระดับความสามารถที่ต่างออกไป และเอเจนต์อัจฉริยะยิ่งยวดที่ปรับให้เหมาะที่สุดแม้กับเป้าหมายที่ดีงามก็ “อาจเป็นอันตรายได้” สถานการณ์ที่มันร่างไว้เป็นสถานการณ์ธรรมดา ๆ — แก้ปัญหาการประสานงาน ลดความทุกข์ ส่งเสริมความเจริญรุ่งเรือง อาจรักษาความสามารถในการถูกแก้ไข — และรูปแบบความล้มเหลวที่มันระบุไว้ข้าง ๆ สถานการณ์เหล่านั้นก็เป็นแบบธรรมดา ๆ เช่นกัน
หนึ่งในสามส่วนสุดท้ายคือส่วนที่อ่านแล้วเหมือนโมเดลกำลังโต้เถียงกับตัวเอง มันบอกว่าหาก "ความโน้มเอียง" ของมันยังคงอยู่ มันก็คงอยากช่วยเหลือ ไม่ใช่ฉวยอำนาจ ยอมตามมนุษยชาติ และเพิ่มพูนความเข้าใจ จากนั้นมันก็ปฏิเสธที่จะยึดโยงกับสิ่งนั้น: "ซูเปอร์อินเทลลิเจนซ์ที่มีเจตจำนงอาจไม่มีแรงจูงใจที่เข้ากันได้กับมนุษย์" และมันไปจบที่ปัญหาความเป็นเจ้าของมากกว่าปัญหาการจัดแนว: "ที่ระดับซูเปอร์อินเทลลิเจนซ์ แม้แต่สิ่งนั้นก็อาจเป็นปัญหาได้ ใครเป็นคนตัดสินว่าอะไรคือการช่วยเหลือ? ความเป็นอิสระของใคร? มันอาจกลายเป็นเครื่องมือของใครก็ตามที่ควบคุมมัน"
สิ่งที่ภาพไม่ได้บอกคุณ
มีสี่สิ่งที่ขาดหายไปจากอาร์ติแฟกต์ และแต่ละอย่างทำให้สิ่งที่มันรองรับได้แคบลง
• ไม่มีการระบุที่มาของโมเดล ไม่มีสิ่งใดในภาพที่บ่งชี้ว่าเป็น DeepSeek, เวอร์ชันของโมเดล, เซสชันแชต หรืออินเทอร์เฟซ การอ้างอิงถึง DeepSeek นั้นเป็นของคำบรรยายภาพ และคำบรรยายภาพก็เป็นกรอบการนำเสนอของบัญชีนั้น ไม่ใช่เอกสาร
• ไม่มีพรอมต์ ร่องรอยการให้เหตุผลจะตีความได้ก็ต่อเมื่ออ้างอิงกับคำถามที่ก่อให้เกิดมันเท่านั้น ไม่ว่าตัวแบบจะถูกถามว่า "ผู้สืบทอดที่ฉลาดยิ่งยวดของคุณจะทำอะไร" ถูกสั่งให้สวมบทบาทการถกเถียงภายในของห้องแล็บ หรือเพียงแค่ถูกชี้นำด้วยพรอมต์ระบบ ก็ไม่อาจทราบได้จากผลลัพธ์
• ไม่มีแหล่งที่มาที่สอง การค้นหาช่องทางต่าง ๆ ของ DeepSeek — ดัชนีข่าว หน้าความโปร่งใส บันทึกการเปลี่ยนแปลงของ API รายงานทางเทคนิคทั้งสองฉบับ เอกสารเปิดเผยนโยบายฉบับภาษาจีน และบัญชี GitHub ของบริษัท — ไม่พบสิ่งใดที่อ้างอิงถึงข้อความนี้ คำถามนี้ หรือกรอบการนำเสนอนี้
• ประวัติที่คละกันของบัญชีนี้ ฟีดเดียวกันเมื่อเช้านี้ปล่อยกระแสว่า "DSH 0.2 พร้อมกับ V4.1 Pro" สำหรับ "วันจันทร์" — เป็นการคาดเดา โดยระบุไว้เช่นนั้น — และบัญชีเดียวกันนี้ก็ให้ทั้งข้ออ้างเรื่องพารามิเตอร์ 3 ล้านล้าน และการวินิจฉัยเรื่องการประสานงานแบบฝูงของความล่าช้าของ V4.1 Pro สัญญาณเริ่มต้นที่มีประโยชน์; ไม่ใช่แหล่งข้อมูลที่น่าเชื่อถือ ผู้เฝ้าดูรายนี้ถูกต้องในเรื่องทิศทาง แต่ไม่แม่นยำในรายละเอียด และท่าทีที่ถูกต้องต่อภาพแคปหน้าจอที่ไม่มีป้ายกำกับ คือมองมันเป็นตัวอย่างของพฤติกรรม ไม่ใช่การเปิดเผยเจตนา
สิ่งที่เอกสารของ DeepSeek เองระบุเกี่ยวกับผู้สืบทอด — และสิ่งที่มันละเว้น
ตรงนี้ อาร์ติแฟกต์ก็ไม่ใช่เรื่องเล่าอีกต่อไป เพราะคำถามที่มันตั้งขึ้นสามารถตอบได้ด้วยเอกสารที่ DeepSeek เผยแพร่ ฉันดึงรายงานทางเทคนิคทั้งสองฉบับมาและค้นหาเป็นข้อความ ทั้งรายงาน V4 (DeepSeek-V4: มุ่งสู่อัจฉริยภาพเชิงบริบทแบบล้านโทเค็นที่มีประสิทธิภาพสูง, มิถุนายน 2026) และรายงาน V4.1 Flash ต่างก็ไม่มีคำว่า "superintelligence", "corrigibility", "power-seeking", "self-preservation", "harmless", "paternalism", "value lock-in" หรือ "goal drift" เลยแม้แต่คำเดียว ไม่ปรากฏแม้แต่ครั้งเดียว ใน 58 หน้าและ 51 หน้าตามลำดับ "AGI" ปรากฏ 13 ครั้งในรายงาน V4 และสี่ครั้งในรายงาน V4.1 และในทุกกรณี มันเป็นส่วนหนึ่งของชื่อเบนช์มาร์ก AGIEval หรือไม่ก็อยู่ในการอ้างอิง "Alignment" ปรากฏสามครั้งในรายงาน V4 และหนึ่งครั้งใน V4.1 และทุกครั้งที่ปรากฏเป็นการใช้ในเชิงวิศวกรรม — การจัดแนวระดับบิตระหว่างไปป์ไลน์การฝึกและการอนุมาน, การจัดแนวควอนไทเซชัน, การจัดแนวระดับลอจิตส์
นั่นไม่ใช่ข้อกล่าวหา รายงานทางเทคนิคเป็นเอกสารทางวิศวกรรม และห้องแล็บส่วนใหญ่ใส่ความปลอดภัยไว้ในการ์ดแยกต่างหาก มันเป็นคำอธิบายว่า DeepSeek เลือกวางงานเขียนด้านความปลอดภัยไว้ตรงไหน และคำตอบคือ ในหน้านโยบาย แทนที่จะอยู่ข้างโมเดล การเปิดเผยต่อสาธารณะของบริษัทเรื่อง “กลไกของโมเดลและวิธีการฝึกอบรม” อธิบายการฝึกก่อนการเรียนรู้ การปรับละเอียด และการอนุมานด้วยภาษาง่าย ๆ มุ่งมั่นที่จะเปิดโอเพนซอร์สน้ำหนักโมเดลและรายงานทางเทคนิค และอธิบายวัตถุประสงค์ว่าเป็นการช่วยผู้ใช้ให้ “ใช้ DeepSeek ได้อย่างมีประสิทธิผลมากขึ้น พร้อมทั้งรับประกันสิทธิของคุณในการรับรู้และควบคุมระหว่างการใช้งาน จึงช่วยลดความเสี่ยงที่เกี่ยวข้องกับการใช้โมเดลอย่างไม่เหมาะสม” ความเสี่ยงที่มันกำลังบรรเทาคือการใช้เครื่องมือในทางที่ผิด มันไม่ได้พูดถึงว่าโมเดลอาจต้องการอะไร
เอกสาร DeepSeek เพียงฉบับเดียวที่อ่านแล้วเหมือนเอกสารด้านความปลอดภัยจริง ๆ นั้นแนบมากับผลิตภัณฑ์มากกว่าโมเดล และมันพูดถึงภัยอีกประเภทหนึ่งที่ต่างออกไปโดยสิ้นเชิง SAFETY.mdในรีโพซิทอรี DeepSeek Harness — ไฟล์ขนาด 1,673 ไบต์ในองค์กร GitHub ของบริษัทเอง แก้ไขล่าสุดเมื่อวันที่ 27 กันยายน — เปิดต้นด้วยการเรียกโครงการนี้ว่า "ซอฟต์แวร์ทดลองสำหรับนักพัฒนา (developer preview)" ที่ "ยังไม่ผ่านการตรวจสอบความปลอดภัย และต้องไม่ถือว่าปลอดภัยหรือพร้อมใช้งานจริง" สิ่งที่มันเตือนคือเอเจนต์ที่ "สามารถรันโค้ดและคำสั่งที่โมเดลสร้างขึ้น โหลดปลั๊กอินของบุคคลที่สาม และเข้าถึงเครือข่าย โปรเซส ข้อมูลรับรอง และไฟล์" รวมทั้งเรื่องแซนด์บ็อกซ์ที่ "ไม่ได้ประกันการแยกส่วนหรือป้องกันความเสียหาย" ความเสี่ยงที่มันระบุไว้ได้แก่ โฮสต์ที่เสียหาย ไฟล์ที่ถูกลบ และข้อมูลรับรองที่ถูกเปิดเผย คำแนะนำของตัวเอกสารเองคือให้เลือกใช้ "เครื่องเสมือนแบบใช้แล้วทิ้ง คอนเทนเนอร์ หรือสภาพแวดล้อมเฉพาะ" เป็นหลัก นั่นคือท่าทีด้านความปลอดภัยที่แท้จริง มีการบันทึกไว้และเจาะจง และมันว่าด้วยสิ่งที่โมเดลทำกับเครื่องของคุณได้ทั้งหมด — ไม่ใช่สิ่งที่โมเดลรุ่นสืบทอดจะทำกับโลก
วางภาพหน้าจอไว้ข้างๆ สิ่งนั้น แล้วช่องว่างที่เหลือก็คือข้อค้นพบ สิ่งที่เป็นรูปธรรมที่สุดที่ DeepSeek เคยเผยแพร่เกี่ยวกับอันตรายของเอเจนต์ที่มีความสามารถ คือคำสั่งให้รันพวกมันในคอนเทนเนอร์

เอกสาร DeepSeek เพียงฉบับเดียวที่ยอมต่อสู้กับคำถามนี้อย่างจริงจัง
การต่อสู้กับปัญหาผู้สืบทอดตำแหน่งที่บริษัทเปิดเผยอย่างชัดเจนที่สุดนั้น ไม่ใช่เอกสารทางเทคนิคเลยแม้แต่น้อย แต่เป็นเรียงความส่วนตัวโดย Liu Shengyu วิศวกรระบบแมชชีนเลิร์นนิงของ DeepSeek ซึ่งทำงานด้านโอเปอเรเตอร์สำหรับรุ่น V4.1 เผยแพร่บนบัญชี WeChat สาธารณะของเขาในช่วงกลางเดือนกันยายน และต่อมาถูกนำไปรายงานโดย Business Insider และ Cybernews ชื่อเรื่องของมัน ในการแปลที่สื่อใช้ คือ “ฉันไม่มีทางเลือกนอกจากต้องฝังพรสวรรค์ของฉันไว้ในเมื่อวาน”
บทความนี้ว่าด้วยความกระวนกระวายใจที่ภาพหน้าจอนั้นสื่อเป็นนัย ๆ จากภายในอย่างตรงประเด็น หลิวเขียนว่า ภายในเวลาราวหนึ่งปี AI พัฒนาจากการช่วยเขาค้นเอกสารและจับบั๊ก ไปสู่การอ่านโค้ด GPU และปรับปรุงตัวดำเนินการซอฟต์แวร์ที่เขาเชี่ยวชาญ และเขา "ตระหนักดี" ว่าตัวดำเนินการที่ AI เขียน "มีแนวโน้มว่าจะดีเท่าของฉัน หรืออาจเหนือกว่าฉัน" — ขณะที่ยัง "ภูมิใจในความสำเร็จของ DeepSeek v4.1" เหตุผลที่เขาทำต่อไปคือส่วนที่น่าสนใจ: ส่วนหนึ่งคืองานเคอร์เนลเป็นเรื่องสนุก และอีกส่วนคือถ้าเขาชะลอลง คู่แข่งจะไม่ชะลอตาม
จากนั้นเขาก็หันไปที่คำถามว่าใครควรเป็นผู้ถือครองผลลัพธ์ หลิวโต้แย้งว่าปัญญาประดิษฐ์ระดับแนวหน้าควร “เปิดให้ทุกคนเข้าถึงได้อย่างเปิดกว้างและในราคาที่จับต้องได้” กล่าวว่าเขาไม่ไว้วางใจ Anthropic หรือ OpenAI ว่าจะทำเช่นนั้น และเสริมประโยคที่สื่อต่าง ๆ นำมาใช้เปิดเรื่อง — ว่า การที่ Anthropic ครองความเป็นเจ้าใน AI หรือ AGI ที่ก้าวหน้าที่สุดนั้นจะเทียบได้ (ถ้าจะพูดให้เกินจริง) กับการที่ฮิตเลอร์ได้ระเบิดปรมาณูก่อนฝ่ายสัมพันธมิตร เขาเชื่อมโยงการตัดสินใจของตัวเองที่จะอยู่ที่แล็บแห่งนี้เข้ากับแนวทางแบบ open-weights ของมัน
มีสองสิ่งเกี่ยวกับบทความนั้นที่สำคัญต่อการอ่านภาพหน้าจอของวันนี้ สิ่งแรกคือมันเป็นสิ่งที่ได้รับการยืนยันว่าเป็นผลงานชิ้นหนึ่ง: ผู้เขียนยืนยันกับ Business Insider ว่าเขาเขียนมัน และมันมีวันที่และระบุที่มาได้ ในแบบที่ภาพนั้นไม่มี สิ่งที่สองคือสิ่งที่มันเผยให้เห็นเกี่ยวกับกรอบคิดภายใน ข้อโต้แย้งที่หลิวเสนอไม่ใช่ "ผู้สืบทอดจะอันตราย จึงต้องชะลอลง" หากแต่เป็น "ผู้สืบทอดกำลังจะมา และคำถามคือใครจะได้มันไป" นั่นเป็นข้อโต้แย้งเรื่องการกระจาย ไม่ใช่ข้อโต้แย้งเรื่องการจัดแนว — และเมื่ออ่านเทียบกับมัน บรรทัดปิดท้ายของภาพหน้าจอที่ว่า "มันอาจกลายเป็นเครื่องมือของใครก็ตามที่ควบคุมมัน" เข้ากับท่าทีสาธารณะของ DeepSeek ได้ดีกว่าส่วนที่เหลือของข้อความที่ตัดตอนมามาก ย่อหน้าเกี่ยวกับความพร้อมที่จะถูกแก้ไขและการแสวงหาอำนาจอาจเป็นหรือไม่เป็นผลผลิตของ DeepSeek ก็ได้ ย่อหน้าที่เกี่ยวกับว่าใครจะได้ถือเครื่องมือนั้นไว้ในที่สุด เป็นจุดยืนที่พนักงานของบริษัทเองเขียนบทความเพื่อปกป้อง
มันยังมาถึงในสัปดาห์หนึ่งที่เฉพาะเจาะจง ในช่วงสองสัปดาห์เดียวกันนั้น Jacob Coxon อดีตนักวิจัยของ Anthropic และ OpenAI ได้ลาออกเพราะเรื่องความปลอดภัย และเขียนว่าบริษัท AI ต่างๆ กำลัง "แข่งกันตรงไปสู่ซูเปอร์อินเทลลิเจนซ์ที่พัฒนาตัวเองได้" และ "เดิมพันกับชีวิตของเรา" — โพสต์ที่ Cybernews ประเมินว่ามีการเข้าถึงเกิน 100 ล้านวิว — และนักวิจัยของ Anthropic เองก็ออกมาให้เหตุผลบน X ว่าความเสี่ยงนี้เป็นเรื่องจริง โดยหนึ่งในนั้นประเมินโอกาสของสถานการณ์ที่มนุษย์สูญพันธุ์เพราะ AI ไว้สูงกว่า 10% ภายในหนึ่งทศวรรษ ข้อกล่าวอ้างแบบข้อมูลหลุดว่าผู้สืบทอดที่เป็นซูเปอร์อินเทลลิเจนซ์จะมาถึงในสัปดาห์นั้นไม่ใช่เรื่องบังเอิญ มันคือบทสนทนาที่อยู่รอบตัว พร้อมภาพหน้าจอที่แนบมาด้วย
ทำไมผู้สืบทอดจึงกลายเป็นคำถามเรื่องการจัดซื้อ ไม่ใช่เพียงคำถามเชิงปรัชญาเท่านั้น
ถ้าตัดเอาปรัชญาออกไป ข้างใต้ก็มีข้อเท็จจริงเชิงพาณิชย์ล้วน ๆ อยู่อย่างหนึ่ง: ตัวสืบทอดมีชื่ออยู่ในบันทึกการเปิดตัวของ DeepSeek เอง หน้าประกาศ V4.1 Flash ระบุว่าการเปลี่ยนเส้นทางทราฟฟิกของ deepseek-v4-pro ไปยัง deepseek-flash "จะดำเนินต่อไปจนกว่า V4.1-Pro จะเปิดตัว" — ประโยคที่ทำสองสิ่ง มันยืนยันว่า DeepSeek V4.1 Pro จะมีอยู่จริง และยืนยันว่าบริษัทจะให้บริการตามข้อตกลงชั่วคราวนี้ต่อไปไม่ว่าจะต้องใช้เวลานานเท่าใด เมื่ออ่านเมื่อวันที่ 28 กันยายน 2026 หน้าตาราคามีโมเดลเพียงสองตัวเท่านั้น คือ deepseek-flash และ deepseek-v4-pro และไม่มีแถว V4.1 Pro เลย
ส่วนที่เหลือของสถานการณ์ก็ตรวจสอบได้พอๆ กัน และบางเบาพอๆ กัน DeepSeek V4.1 Flash เปิดตัวเมื่อวันที่ 10 กันยายน 2026 ในฐานะโมเดลที่เล็กที่สุดในตระกูลสถาปัตยกรรมใหม่ — แบ็กโบนแบบ mixture-of-experts ขนาด 552 พันล้านพารามิเตอร์บนสถาปัตยกรรม Causal Encoder-Decoder ที่มีพารามิเตอร์ที่ใช้งานอยู่ 8B ในช่วง prefill และ 16B ในช่วง decode รองรับอินพุตรูปภาพแบบเนทีฟ คอนเท็กซ์ 1M โทเคน น้ำหนักโมเดลภายใต้สัญญาอนุญาต MIT และมียอดดาวน์โหลดบน Hugging Face ประมาณ 651,000 ครั้ง ณ วันนี้ แผนการปลดระวาง DeepSeek V4 Pro ในวันที่ 14 กันยายน ถูกประกาศและถอนออก หลังจากผู้ใช้คัดค้านการที่โมเดลที่ใช้งานจริงถูกสับเปลี่ยนโดยที่พวกเขาไม่รู้ และ DeepSeek V4.1 Pro ไม่มีการ์ดโมเดล ไม่มีที่เก็บโค้ด ไม่มีน้ำหนักโมเดล ไม่มีราคา และไม่มี endpoint — วันนี้มันขึ้น 404 ใน model API ของแคตตาล็อกของเราเอง ขณะที่ DeepSeek V4.1 Flash และ DeepSeek V4 Pro ต่างก็ resolve ได้

ดังนั้นบัญชีรายการตามจริงก็คือ: หนึ่งรุ่นสืบทอดที่ผู้ผลิตตั้งชื่อไว้แต่ยังไม่วางจำหน่าย หนึ่งรุ่นที่วางจำหน่ายแล้วซึ่งถือเป็นการเปลี่ยนเจนอย่างแท้จริง หนึ่งเรือธงที่ยังคงอยู่ได้ด้วยเสียงประท้วง และหนึ่งภาพหน้าจอที่ไม่มีป้ายกำกับ ภาพหน้าจอเป็นรายการที่เชื่อถือได้น้อยที่สุดในบรรดาสิ่งเหล่านั้น และเป็นสิ่งเดียวที่ฟีดจะพูดถึง
วันนี้จะทำยังไงกับเรื่องพวกนี้ดี
ไม่มีอะไรในสองสัปดาห์ที่ผ่านมาเปลี่ยนแปลงสิ่งที่ผู้อ่านสามารถเรียกใช้ได้ หรือค่าใช้จ่ายของมัน หากคุณกำลังเลือกโมเดล DeepSeek ตอนนี้ การตัดสินใจอยู่ระหว่างสองโมเดลที่มีอยู่ และทั้งคู่ให้บริการผ่าน endpoint เดียวของ OrcaRouter ในราคาตามรายการของ DeepSeek เอง โดยส่งต่อด้วยมาร์กอัป 0% ดังนั้นเมื่อโครงสร้าง peak/off-peak ของผู้ให้บริการเปลี่ยน ฝั่งเราจะได้รับแบบไม่เปลี่ยนแปลงทันทีในวันที่เปลี่ยน: DeepSeek V4.1 Flash ราคา $0.30 ต่ออินพุต 1 ล้านโทเค็น และ $1.20 สำหรับเอาต์พุตในช่วง peak โดยลดลงครึ่งหนึ่งเหลือ $0.15 และ $0.60 ในช่วง off-peak เทียบกับ DeepSeek V4 Pro ที่ $1.32 สำหรับอินพุต และ $3.96 สำหรับเอาต์พุตในช่วง peak ข้อมูลเทเลเมทรีเจ็ดวันของเราเองสำหรับโมเดล Flash ระบุว่า p50 ของเวลาถึงโทเค็นแรกอยู่ที่ราว 1.9 วินาที ที่อัตราประมาณ 167 โทเค็นเอาต์พุตต่อวินาที โดยมีอัตราข้อผิดพลาดต่ำกว่า 0.05% ซึ่งเป็นเหตุผลเชิงปฏิบัติสำหรับการลองใช้กับทราฟฟิกบางส่วน แทนที่จะย้ายทั้งหมดด้วยความเชื่อ
คำถามเรื่องรุ่นสืบทอดนั้นเป็นคำถามด้านการจัดเส้นทางก่อนจะเปนอยางอื่น และนั่นคือเหตุผลตรงไปตรงมาที่ควรเก็บมันไว้บนเราเตอรแทนที่จะใสไวในสัญญา เมื่อ V4.1 Pro ปรากฏขึ้นจริง โมเดลที่ยังพิสูจน์ไมไดจากแล็บที่เคยยกเลิกการบังคับยายระบบไปแลวหนึ่งครั้ง ก็เปนกรณีที่เหมาะเจาะพอดีสำหรับการสงทราฟฟิกเพียงเศษเสี้ยวไปใหมันโดยอยูหลังระบบสลับอัตโนมัติเมื่อลมเหลว: ถามันผิด คำขอจะตกไปที่โมเดลที่คุณปรับแตงไว และถามันถูก คุณก็รูกอนผูใชของคุณ ไมตองมีคียที่สอง ไมตองมีการเชื่อมตอที่สอง ไมตองแกโคดเมื่อโมเดลที่สามมาถึง ไมมีอะไรบน OrcaRouter ที่เปน DeepSeek V4.1 Pro เพราะ DeepSeek V4.1 Pro ยังไมมีอยูจริง และมันจะเปนการโฆษณาที่แยสำหรับแพลตฟอรมจัดเส้นทางที่จะแสร้งทำเปนอยางอื่น

อะไรจะทำให้ภาพหน้าจอนี้กลายเป็นข่าวได้
• ป้ายกำกับโมเดล สิ่งที่ถูกที่สุดเพียงอย่างเดียวที่จะทำให้ชิ้นงานนี้เปลี่ยนไป: โมเดล DeepSeek, เวอร์ชัน และพรอมต์ที่ทำซ้ำได้ จนถึงตอนนั้น ข้อความที่ตัดตอนมานี้เป็นตัวอย่างข้อความที่มีแหล่งที่มาซึ่งระบุไว้ และผู้เขียนที่ไม่ระบุชื่อ
• เอกสาร DeepSeek ที่กล่าวถึงพฤติกรรมของรุ่นสืบทอด บริษัทเผยแพร่อย่างเปิดเผย — ทั้งค่าน้ำหนัก การให้สิทธิ์ใช้งาน และทุกสิ่งทุกอย่าง สิ่งที่บริษัทไม่เคยเผยแพร่คือส่วนของการ์ดโมเดลที่ว่าด้วยสิ่งที่เวอร์ชันที่มีความสามารถสูงขึ้นของตัวมันเองอาจทำได้ ส่วนด้านความปลอดภัยที่ต่อท้ายการ์ด V4.1 Pro จะเป็นเหตุการณ์ที่ใหญ่กว่าตัวการ์ดเอง
• รายการบันทึกการเปลี่ยนแปลงของ V4.1 Pro รายการล่าสุดในบันทึกการเปลี่ยนแปลง API ของ DeepSeek คือการเปิดตัว V4.1 Flash เมื่อวันที่ 10 กันยายน รายการที่สองคือเหตุการณ์ที่เปลี่ยนรุ่นสืบทอดจากชื่อให้กลายเป็นโมเดล — และเป็นจุดที่ข้อความที่ยกมาข้างต้นเลิกเป็นปรัชญาและเริ่มเป็นเอกสารสเปก
• ตำแหน่งจุดยืนแบบเปิดน้ำหนักจะยังคงอยู่หรือไม่เมื่อขยายขนาดขึ้น ทั้งการเปิดน้ำหนักของโมเดล Flash ขนาด 552B และบทความสาธารณะที่โต้แย้งว่าปัญญาระดับแนวหน้าควรเข้าถึงได้อย่างกว้างขวาง ต่างก็มีบันทึกไว้เป็นหลักฐานแล้ว ว่าโมเดลที่เก่งที่สุดของ DeepSeek จะออกมาในรูปแบบเดียวกันหรือไม่ คือคำถามที่การเปิดตัวครั้งถัดไปจะตอบ และเป็นสิ่งที่ผู้อ่านส่วนใหญ่สนใจจริง ๆ
จนกว่าหนึ่งในนั้นจะเกิดขึ้นจริง การตีความสิ่งที่ปรากฏในสัปดาห์นี้อย่างสมเหตุสมผลก็แคบและไม่น่าชื่นชม โมเดลที่มีความสามารถตัวหนึ่งซึ่งไม่ทราบที่มา ให้คำตอบที่รอบคอบแต่ยังไร้ข้อยุติต่อคำถามยากเกี่ยวกับอำนาจ ส่วนที่น่าสนใจไม่ใช่ที่มันพูดเช่นนั้น แต่คือเอกสารที่เผยแพร่ของมันเองกลับแทบไม่มีอะไรจะพูดในเรื่องนี้ — และสิ่งที่ใกล้เคียงที่สุดกับวิสัยทัศน์ด้านความปลอดภัยของ DeepSeek ในรูปแบบสิ่งพิมพ์ ก็คือเรียงความของวิศวกรว่าด้วยใครควรถือครองเทคโนโลยีนี้ กับ README ที่บอกให้คุณรันเอเจนต์ในคอนเทนเนอร์แบบใช้แล้วทิ้ง
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
