
วันวางจำหน่าย DSH: คู่แข่ง Claude Code ของ DeepSeek เปิดตัวแล้ว — ความหมายต่อ V4 Flash และ V4 Pro
- obsidianใหม่Qwen3.8 27B Uncensored (Aggressive)2026-08-15$0.40 / $4.21 ต่อ 1 ล้านโทเค็น · 38 tok/s
- qwenใหม่Qwen: Qwen3.8 27B (free)2026-08-1325 tok/s
- deepseekใหม่DeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokใหม่SpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaใหม่Meta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น · 2852 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0957ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0961ความฉลาด77การเขียนโค้ด
- grokxAI: Grok 4.52026-07-0856ความฉลาด72การเขียนโค้ด
- tencentTencent: Hy32026-07-0642ความฉลาด59การเขียนโค้ด
ในขณะที่ DeepSeek V4 Flash และ DeepSeek V4 Pro ยังคงเป็นสองสิ่งที่ DeepSeek เปิดตัวล่าสุด ผู้เฝ้าดู DeepSeek ที่มีผู้ติดตามมากที่สุดบน X ก็เริ่มตั้งเวลารอคอยรุ่นถัดไป "ตามความเป็นจริง DSH จะเปิดตัวในอีกประมาณ 7-9 ชั่วโมง" นักพัฒนา AI นามแฝง teortaxesTex โพสต์ "ผมคาดการณ์ว่าสิ่งนี้จะกำหนดบริบทใหม่ให้กับการเปิดตัวสองครั้งล่าสุด พอทีกับหมอกแห่งสงคราม เราจะได้เห็นว่ามันควรทำงานได้จริงเพียงใด" การนับถอยหลังสิ้นสุดลงในคืนนี้ กลุ่มผู้ทดสอบเบต้าภายในบอกกับบัญชี X ชื่อ op7418 ว่าการเปิดตัวจะเกิดขึ้น "ประมาณ 20:25" ตามเวลาในกรุงปักกิ่ง และในที่สุด DeepSeek Harness เวอร์ชันตัวอย่างสำหรับนักพัฒนาก็เผยแพร่ในเย็นวันเดียวกัน — IT之家 รายงานเมื่อเวลา 20:52 พร้อมกับรายงานเพิ่มเติมในช่วงชั่วโมงถัดมา ฮาร์เนสของ DeepSeek ซึ่งเป็นคำตอบของตัวเองต่อ Claude Code ตอนนี้เปิดให้สาธารณะใช้แล้ว: เวอร์ชัน 0.1 ใช้สัญญาอนุญาต MIT โอเพนซอร์สบน GitHub และสั่งรันได้ด้วยคำสั่ง npm เพียงคำสั่งเดียว
สิ่งที่น่าสนใจคือเหตุผลที่วันที่มีความสำคัญ และเหตุผลที่การเปิดตัวครั้งนี้มีคุณค่ามากกว่าการเปิดตัวทั่วไป เวอร์ชันทางการของ DeepSeek V4 Pro (DeepSeek-V4-Pro-0813) เปิดตัวบน DeepSeek API ในช่วงเวลาเดียวกัน และ DeepSeek V4 Flash เปิดตัวอย่างเป็นทางการก่อนหน้านั้นสองสัปดาห์ ทั้งคู่มาพร้อมคะแนน benchmark แบบ agentic ที่ DeepSeek สร้างขึ้นภายใน harness ของตัวเอง — เอกสาร API ของ V4 Flash ระบุไว้อย่างชัดเจน ถึงขนาดมีชื่อว่า "DeepSeek Harness minimal mode" DSH คือเวอร์ชันเต็มของ harness นั้นที่กำลังเปิดตัวสู่สาธารณะ ซึ่งหมายความว่าตัวเลขที่อยู่เบื้องหลังสองเวอร์ชันล่าสุด ตอนนี้ใครก็ตามที่ต้องการก็สามารถนำไปรันเพื่อให้ได้ผลลัพธ์ซ้ำได้ ไม่มีการรั่วไหลใดๆ ที่นำมาสู่จุดนี้ที่ DeepSeek ยืนยันอย่างเป็นทางการว่าเป็นข้อมูลจริง แต่จุดสิ้นสุดนี้ไม่ใช่การรั่วไหลอีกต่อไป: developer preview ได้เปิดตัวแล้ว สิ่งที่ยังไม่เปิดเผยต่อสาธารณะคือรายการราคา — DeepSeek ยังไม่ได้พูดอะไรเกี่ยวกับค่าใช้จ่ายของตัว harness เลย
คำทำนายที่ตั้งนาฬิกา
teortaxesTex ไม่ใช่พนักงานของ DeepSeek และไม่ได้อ้างว่าเป็น ประวัติบัญชีอธิบายว่าเป็น "เชียร์ลีดเดอร์ DeepSeek ตั้งแต่ปี 2023" ที่แต่งตั้งขึ้นเอง และบันทึกสาธารณะคือการคาดเดาอย่างมีข้อมูลพร้อมการเดาที่แม่นยำหลายครั้ง — การเดิมพันในตลาดพยากรณ์เกี่ยวกับสถาปัตยกรรมของ DeepSeek V4 การคาดการณ์ล่วงหน้าว่า DeepSeek-V4.1 จะได้รับการคำนวณแบบ reinforcement learning มากกว่าคู่แข่งหลายเท่า และจังหวะการคาดการณ์การเปิดตัวที่ชุมชนติดตามอย่างใกล้ชิด จงมองทวีตต้นฉบับอย่างที่เป็น: การคาดการณ์อย่างมีข้อมูล ไม่ใช่การยืนยัน
การคาดการณ์มีสองส่วน ส่วนแรกคือจังหวะเวลา: "จะลดลงในอีกประมาณ 7-9 ชั่วโมง" ซึ่งตรงกับคืนวันที่ 12–13 สิงหาคมตามเวลาปักกิ่ง — ช่วงเวลาเดียวกับที่บิลด์ DeepSeek-V4-Pro-0813 ปรากฏในเอกสาร API ของ DeepSeek และมันก็เป็นจริง กลุ่มเบต้าภายในที่ประเมินไว้ที่ "ประมาณ 20:25" และการเผยแพร่จริงที่ประมาณ 20:52 ต่างก็อยู่ในช่วงเวลานั้น การรั่วไหลคลาดเคลื่อนไปเพียงประมาณครึ่งชั่วโมง ไม่ใช่เป็นวัน ส่วนที่สองคือคำที่หนักแน่นอย่าง "recontextualize" ซึ่งจะเข้าใจได้ก็ต่อเมื่อรู้ว่า DeepSeek วัดประสิทธิภาพของสองเวอร์ชันล่าสุดของตัวเองอย่างไร ส่วนนั้นของการเดิมพันตอนนี้ทดสอบได้แล้ว และนั่นคือประเด็นทั้งหมดของการเผยแพร่ครั้งนี้
DSH แท้จริงแล้วคืออะไร
สูตรภายในของ DeepSeek ซึ่ง Chen Deli นักวิจัยอาวุโสยืนยันต่อสาธารณะแล้ว คือ "Model + Harness = Agent" โดย harness คือชั้นวิศวกรรมทั้งหมดที่นอกเหนือจากตัวโมเดล ซึ่งเปลี่ยนโมเดลภาษาให้กลายเป็นสิ่งที่ทำงานให้สำเร็จ ได้แก่ การจัดการบริบทและหน่วยความจำ การเรียกใช้เครื่องมือ การวางแผนงาน การอ่านและเขียนไฟล์ การรันคำสั่งในเทอร์มินัล การป้อนข้อผิดพลาดกลับเข้าสู่ลูป และการตัดสินว่างานเสร็จสิ้นจริงหรือไม่ ประกาศรับสมัครงานของ DeepSeek อธิบายเป้าหมายไว้ว่าเป็นการเปลี่ยน "ขีดความสามารถของโมเดลระดับแนวหน้าให้เป็นผลิตภัณฑ์เอเจนต์ชั้นนำ" — และเป้าหมายที่ระบุไว้อย่างชัดเจน ตามคำพูดของ Chen Deli เอง ก็คือ Claude Code
ผลิตภัณฑ์นี้ยังเป็นคำตอบของโครงการชุมชน เอเจนต์เทอร์มินัลที่แฟนๆ สร้างขึ้นชื่อ DeepSeek-TUI สร้างด้วยภาษา Rust และถูกเรียกติดตลกว่า "DeepSeek เวอร์ชันของ Claude Code" กลายเป็นไวรัลบน GitHub ในช่วงต้นปีนี้ ชุดเครื่องมืออย่างเป็นทางการได้นำจุดเข้าถึงเทอร์มินัลนั้นกลับคืนมา
สิ่งที่เส้นทางข้อมูลรั่วไหลเคยกล่าวว่าเป็นเพียงข่าวลือ ตอนนี้อยู่ในตัวปล่อยแล้ว v0.1 developer preview ซึ่งเปิดซอร์สภายใต้สัญญาอนุญาต MIT ที่ github.com/deepseek-ai/deepseek-harness เป็นรันไทม์ของเอเจนต์แบบเดสก์ท็อปและ CLI ในเนมสเปซแพ็กเกจ Node.js — คำสั่ง "npx @deepseek-ai/dsh web" จะเริ่ม GUI บนเว็บที่ 127.0.0.1:3080 — สร้างบนเมตาเฟรมเวิร์ก Cordis โดยมีหลักการออกแบบที่ระบุว่า "ทุกสิ่งคือปลั๊กอิน" โมเดล เครื่องมือ ทักษะ เซสชัน แซนด์บ็อกซ์ พื้นที่จัดเก็บ ลูปของเอเจนต์ การจัดตารางเวลา และ UI ล้วนเป็นปลั๊กอิน Cordis ที่เปลี่ยนแทนได้ มีพรีเซ็ตเอเจนต์สี่แบบมาพร้อม: Standard, PTC (โมเดลเขียนโปรแกรม TypeScript เพื่อเชื่อมต่อการเรียกใช้เครื่องมือ), Minimal (เครื่องมือเชลล์บวกตัวแก้ไขไฟล์ ซึ่งเป็นโหมดที่ใช้รันเบนช์มาร์ก V4) และ Creation ทีมลีดตามรายงาน คือ Cui Tianyi — จบจากมหาวิทยาลัยเจ้อเจียง และอดีตวิศวกร Jane Street เก้าปี — ได้รับการยืนยันในตำแหน่ง โดยได้ออกประกาศเรียกรับผู้ทดสอบภายในทั่วโลกเมื่อวันที่ 2 สิงหาคม ข้อควรระวังของ DeepSeek เอง: นี่คือเวอร์ชันตัวอย่างสำหรับนักพัฒนา และการพัฒนาอย่างรวดเร็วอาจทำให้เกิดการเปลี่ยนแปลงที่ไม่เข้ากันได้ (breaking changes)
เส้นทางการรั่วไหลที่สิ้นสุดลงในวันที่ 13 สิงหาคม
ไม่มีร่องรอยใดด้านล่างนี้ที่ DeepSeek ยืนยันอย่างเป็นทางการ แต่บันทึกตอนนี้อ่านเหมือนไทม์ไลน์ที่คลี่คลายลงตรงตามวันที่คาดไว้:
• 26 พฤษภาคม 2026 — มีการสร้างองค์กร DeepSeek GitHub อย่างเป็นทางการ ตามบันทึกที่รั่วไหลจากกลุ่ม
• พฤษภาคม–มิถุนายน — DeepSeek ลงประกาศรับสมัครตำแหน่งงานในปักกิ่งสองตำแหน่ง (product manager ด้าน agent-harness และ research engineer); Chen Deli ยืนยันภารกิจบนโซเชียลมีเดีย
6–7 กรกฎาคม — บัญชี WeChat ของ "ทีม DeepSeek Harness" ซึ่งมีแบรนด์เป็นวาฬสีดำ ลงทะเบียนภายใต้นิติบุคคลปักกิ่งของ DeepSeek และได้รับการรับรอง
• 31 กรกฎาคม — การเปิดตัว API อย่างเป็นทางการของ DeepSeek V4 Flash เอกสารของมันเปิดเผยว่าผลการทดสอบเกณฑ์มาตรฐาน CodeAgent ถูกสร้างขึ้นบน "โหมดขั้นต่ำของ DeepSeek Harness" โดยระบุว่า "(จะเผยแพร่ในเร็วๆ นี้)"
• 1 สิงหาคม — การรับสมัครทดสอบภายในที่มุ่งเป้าไปที่นักพัฒนาโปรเจกต์ open-source ที่เป็น agent-harness; รายงานระบุจำนวนผู้สมัครประมาณ 700–960 ราย และ candidate repositories มากกว่า 700 รายการ
• 11 สิงหาคม — มีการส่งบิลด์ทดสอบภายในครั้งสุดท้ายออกมา เพื่อที่นักพัฒนาปลั๊กอินจะได้ทำงานด้านความเข้ากันได้เสร็จสิ้น ตามภาพหน้าจอที่หลุดออกมาจากกลุ่มเบต้า
• 13 สิงหาคม — teortaxesTex ตั้งนับถอยหลัง; กลุ่มเบต้าภายในบอก op7418 "ประมาณ 20:25"; ตัวอย่างสำหรับนักพัฒนา v0.1 เปิดตัวในเย็นวันนั้น โดยมีรายงานที่ ~20:52 เวลาปักกิ่ง และเผยแพร่ภายใต้สัญญาอนุญาต MIT บน GitHub
ระบบนิเวศปลั๊กอินเป็นส่วนสำคัญที่โดดเด่นของการรั่วไหลครั้งนี้ และมันเป็นเรื่องจริง คลังเก็บปลั๊กอินมีแท็กหัวข้อ #dsh (ที่เก็บ GitHub ระบุ "dsh-plugin" เพื่อให้ค้นพบได้) และการเริ่มต้นอย่างรวดเร็วด้วย npm หมายความว่านักพัฒนา Node ใดๆ ก็สามารถเข้าถึงพื้นผิวปลั๊กอินได้ตั้งแต่การเปิดใช้ครั้งแรก — เป็นการเดิมพันแบบตลาดเปิดว่าโครงสร้างพื้นฐาน (harness) ไม่ใช่แค่ตัวแบบ (model) จะกลายเป็นแพลตฟอร์ม

ทำไม "recontextualize the last two releases" จึงเป็นวลีที่ควรจับตามอง
V4 สองรุ่นล่าสุดเป็นโมเดลที่ออกแบบมาเพื่อเอเยนต์เป็นหลัก (agent-first) บิลด์อย่างเป็นทางการของ DeepSeek V4 Flash เป็นโมเดล MoE ที่มีพารามิเตอร์ 284 พันล้านพารามิเตอร์ โดยมีพารามิเตอร์ที่ทำงานจริง 13 พันล้านพารามิเตอร์ รองรับคอนเท็กซ์ 1 ล้านโทเคน และมีคะแนนเด่นที่ 82.7 บน Terminal-Bench 2.1 ซึ่งเป็นตัวเลขที่ DeepSeek รายงานและสร้างขึ้นจาก "DeepSeek Harness minimal mode" ส่วนบิลด์อย่างเป็นทางการของ DeepSeek V4 Pro เป็นโมเดล MoE ที่มีพารามิเตอร์ 1.6 ล้านล้านพารามิเตอร์ โดยมีพารามิเตอร์ที่ทำงานจริง 49 พันล้านพารามิเตอร์ และการ์ดความสามารถด้านเอเยนต์ (DeepSWE 62.7, Terminal-Bench 2.1 87.9, CyberGym 83.3) ก็เป็นข้อมูลที่ DeepSeek รายงานเช่นกัน และ ณ เวลาที่เขียนบทความนี้ ยังไม่มีห้องปฏิบัติการอิสระแห่งใดทำซ้ำผลดังกล่าวได้
DSH คือ harness ที่ใช้ผลิตตัวเลขเหล่านั้น ซึ่งตอนนี้เปิดสู่สาธารณะแล้ว นั่นคือสิ่งที่หมายถึงตอนที่บอกว่า "เราจะได้เห็นว่ามันควรจะทำงานได้ดีแค่ไหนในโหมดเนทีฟ" — ไม่ใช่ผ่าน Claude Code ไม่ใช่ผ่าน harness ของบุคคลที่สาม ไม่ใช่ผ่าน benchmark harness แต่ผ่านสแตกของ DeepSeek เองแบบครบวงจรตั้งแต่ต้นจนจบ การทดสอบการทำซ้ำไม่ใช่เรื่องสมมุติอีกต่อไป: ใครก็ได้ที่ติดตั้งเวอร์ชันพรีวิวก็สามารถรันงานแบบเอเจนต์เดียวกันกับที่ผู้ผลิตเคยรัน หากตัวเลขเนทีฟทำซ้ำได้ สองเวอร์ชันล่าสุดก็จะอ่านแล้วเป็นเรื่องราวที่สอดคล้องกัน — โมเดลเอเจนต์ระดับจริงจังที่ถูกที่สุด ประกอบกับ harness ความสามารถดีจากผู้ผลิตเอง ขายเป็นระบบเดียวกัน หากทำซ้ำไม่ได้ ช่องว่างระหว่างตัวเลขที่ผู้ผลิตประกาศกับ benchmark ที่บรรดาผู้กังขาเคยชี้ให้เห็นตอนเปิดตัว V4 Flash ก็จะกลายเป็นรูปธรรมและวัดค่าได้ ไม่ว่ากรณีใด บันทึกก็จะเปลี่ยนไป
ผลการประเมินจากภายนอกอย่างอิสระจนถึงตอนนี้ไม่ใช่เรื่องเดียวกัน Artificial Analysis ได้จัดอันดับบิลด์ V4 Pro 0813 บนลีดเดอร์บอร์ดของตนไว้ที่ 53 ในดัชนีความฉลาด (Intelligence Index) — สูงกว่าค่ามัธยฐานที่ 27 และเป็นข้อมูลจากบุคคลที่สามอย่างแท้จริง แต่ก็ยังห่างไกลจากพาดหัวที่ว่า "ล้ำหน้าในทุกมิติ" อยู่มาก ช่องว่างระหว่างตัวเลขเอเจนต์ที่ DeepSeek รายงานด้วยตนเองกับการประเมินจากบุคคลที่สาม คือช่องว่างที่ DSH ทำให้สามารถไขข้อข้องใจได้ในตอนนี้

ยังมีเหตุผลเชิงกลยุทธ์อีกประการที่ทำให้ harness สำคัญกว่าตัวโมเดล harness ที่สมบูรณ์จะปิดวงจรตั้งแต่จุดเริ่มต้นไปจนถึงงานที่เสร็จสมบูรณ์ และในการนี้ก็สร้างข้อมูล task-trajectory ที่ป้อนกลับเข้าสู่การฝึกโมเดลรอบถัดไป — ซึ่งเป็นการวิเคราะห์ที่ CITIC Securities เผยแพร่เมื่อการจ้างงาน Harness ถูกเปิดเผยต่อสาธารณะ โมเดลของ DeepSeek เป็นเอเจนต์จริงจังที่ถูกที่สุดในตลาด ส่วน harness คือที่ซึ่งความได้เปรียบในการแข่งขันและอำนาจในการกำหนดราคาเคลื่อนไป การมีสแตกเอเจนต์แบบ first-party แบบเสียเงินนั้นเป็นธุรกิจที่แตกต่างอย่างสิ้นเชิงจาก API แบบ open-weights
คุณยังไม่จำเป็นต้องใช้ DSH เพื่อรันโมเดล V4
DSH เปิดให้ใช้งานแล้ว แต่เป็นตัวเลือกจากผู้ผลิตโดยตรง ไม่ใช่ข้อกำหนดบังคับ DeepSeek มี endpoint ที่เข้ากันได้กับ Anthropic และ OpenAI สำหรับโมเดลของมันอยู่แล้ว ซึ่งเป็นเหตุผลที่ DeepSeek V4 Flash และ DeepSeek V4 Pro ทำงานภายใน Claude Code และเครื่องมือเอเจนต์อื่นๆ ในปัจจุบันได้แล้ว โดยไม่ต้องใช้ harness
โมเดลทั้งสองยังอยู่ใน OrcaRouter ที่ราคารายการของ DeepSeek เอง — deepseek/deepseek-v4-flash-0731 ที่ประมาณ $0.15 ต่อโทเคนอินพุตหนึ่งล้านตัว และ $0.29 ต่อโทเคนเอาต์พุตหนึ่งล้านตัว ส่วน deepseek/deepseek-v4-pro ที่ประมาณ $0.44/$0.88 — โดยส่งผ่านโดยคิดมาร์กอัป 0% เรื่องนี้สำคัญด้วยสองเหตุผล ประการแรก DeepSeek ประกาศเมื่อต้นเดือนสิงหาคมว่าราคาจะปรับขึ้นอย่างมีนัยสำคัญทั่วทั้งไลน์ V4 ที่กำลังจะมาถึง เนื่องจากราคารายการคือสิ่งที่คุณจ่าย อัตราใหม่จึงมีผลฝั่งเราทันทีในวันเดียวกับที่ปล่อยออกมา โดยไม่ต้องเจรจาใหม่ ประการที่สอง แนวคิดการจัดเส้นทางที่ DSH สร้างขึ้นมา — การสับเปลี่ยนงานระหว่าง V4 Flash ราคาถูกกับ V4 Pro รุ่นเรือธงเพื่อควบคุมต้นทุน — คือสิ่งที่เลเยอร์การจัดเส้นทางทำข้ามผู้ให้บริการบนคีย์เดียว พร้อมระบบเฟลโอเวอร์อัตโนมัติเสริมด้านบน คุณจึงสามารถชี้ทราฟฟิกจริงไปที่บิลด์ V4 ใหม่ได้ ขณะที่แฮร์เนสและเบนช์มาร์กที่ยังทำซ้ำไม่ได้กำลังถูกตรวจสอบความถูกต้อง

สิ่งที่ควรตรวจสอบเมื่อ DSH เปิดใช้งานแล้ว
เมื่อตัวอย่างออกมาแล้ว นี่คือห้าสิ่งที่ตัดสินว่า DSH จะเปลี่ยนอะไรสำหรับคุณหรือไม่:
การทดสอบการทำซ้ำ — ติดตั้งพรีวิวและรันงานแบบเอเยนต์ของ V4 Flash และ V4 Pro โดยตรง จากนั้นเปรียบเทียบกับตัวเลข 82.7 / 87.9 ที่ DeepSeek เผยแพร่ไว้ นี่คือการเดิมพันทั้งหมดของแนวคิด "recontextualize" และตอนนี้ก็สามารถรันได้แล้ว
• การตัดสินใจเปลี่ยนเครื่องมือ — DSH ดีกว่าการรันโมเดลเดียวกันภายใน Claude Code ในปัจจุบันหรือไม่? แฮร์เนส (harness) ที่เป็นผลิตภัณฑ์จากผู้ผลิตโดยตรงต้องชนะในเรื่องที่มากกว่าราคา เพื่อที่จะคุ้มค่ากับการย้ายจากระบบที่ทำงานอยู่แล้ว
• ระบบนิเวศของปลั๊กอิน — พื้นผิว npm และ GitHub มีอยู่จริง แต่คำถามที่ว่าปลั๊กอินที่ติดแท็ก #dsh จะพอร์ตได้อย่างราบรื่นจริงหรือไม่ และบุคคลที่สามจะส่งมอบสิ่งใดที่คุ้มค่าต่อการติดตั้งหรือไม่ ยังคงเป็นคำถามที่เปิดกว้างอยู่
ราคา — ตัว harness ทำงานบนโทเค็นจริง ผู้ทดสอบภายในรายงานการวัดโทเค็นต่องาน และ DeepSeek ยังไม่ได้พูดอะไรเกี่ยวกับต้นทุนของผลิตภัณฑ์เลย คาดว่านี่เป็นผลิตภัณฑ์แบบเสียเงิน รายการราคาคือความไม่รู้ครั้งใหญ่สุดท้าย
• บันทึกการเปลี่ยนแปลง — README อย่างเป็นทางการและบันทึกการเผยแพร่บน GitHub เป็นแหล่งอ้างอิงหลักแล้ว พร้อมกับการประกาศขึ้นราคา V4
บรรทัดล่าง
DSH คือการเคลื่อนไหวด้านผลิตภัณฑ์ที่ส่งผลกระทบมากที่สุดเท่าที่ DeepSeek เคยทำมานับตั้งแต่ไลน์ V4 เอง และตอนนี้มันได้เปิดตัวแล้ว สำหรับผู้อ่าน คำตอบเชิงปฏิบัติยังคงเหมือนเดิม: DeepSeek V4 Flash และ DeepSeek V4 Pro ใช้งานได้แล้ววันนี้ ผ่านเอนด์พอยต์ที่คุณมีอยู่แล้ว ในราคาที่ยังคงเป็นตัวเลือกเอเจนต์จริงจังที่ถูกที่สุดในตอนนี้ — บน OrcaRouter ในราคารายการ ไม่มีมาร์กอัป สิ่งที่ต้องจับตาคือแฮร์เนส ไม่ใช่เพราะการเปิดตัว แต่เพราะสิ่งที่มันทำให้วัดผลได้: สองรีลีสล่าสุดได้โอกาสรันแบบเนทีฟอย่างเป็นธรรมในที่สุด และช่องว่างของเบนช์มาร์กระหว่างผู้ขายกับหน่วยงานอิสระจะปิดลงหรือกลายเป็นค่าเข้าชม นาฬิกาการรั่วไหลบอกถูกต้องทั้งเรื่องวันที่และชั่วโมงโดยประมาณ; สิ่งที่ยังต้องพิสูจน์คือราคา การทำซ้ำคะแนนเนทีฟ และว่าระบบนิเวศปลั๊กอินจะไปได้ไกลหรือไม่ ให้ตัวเลขจากหน่วยงานอิสระ — ไม่ใช่การนับถอยหลัง — เป็นตัวตัดสินว่าคุณจะย้ายสแตกเอเจนต์ในโปรดักชันไปบนแฮร์เนสเนทีฟหรือไม่
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
