นามแฝง DeepSeek สำหรับ V4 Flash thinking mode — บริบท 1M, การให้เหตุผลแบบลูกโซ่ความคิดที่เปิดเผย (นามแฝงรุ่นเก่า, มีกำหนดจะถูกเลิกใช้)
DeepSeek Reasoner เป็นโมเดลสำหรับการให้เหตุผลที่รับเฉพาะข้อความจาก DeepSeek ซึ่งถูกปรับให้เหมาะสมสำหรับงานที่ต้องใช้การอนุมานเชิงตรรกะเชิงลึกและความเข้าใจบริบทที่ยาวขึ้น สามารถเข้าถึงได้ผ่าน API…
DeepSeek Reasoner มีความแข็งแกร่งที่สุดในงานที่ได้ประโยชน์จากการขยายเหตุผลและหน้าต่างบริบทขนาดใหญ่ ซึ่งรวมถึงการพิสูจน์ทฤษฎีบททางคณิตศาสตร์ การแก้ปัญหาคำศัพท์ที่ซับซ้อน การสร้างและดีบักโค้ดข้ามหลายไฟล์ และการตอบคำถามที่ต้องการการสังเคราะห์ข้อมูลจากหลายส่วนของเอกสาร นอกจากนี้ยังสามารถจัดการสนทนาหลายรอบที่แต่ละรอบอ้างอิงบริบทที่ใช้ร่วมกันขนาดใหญ่โดยไม่สูญเสียการติดตาม เนื่องจากมีขีดจำกัดผลลัพธ์ที่สูง จึงมีประโยชน์สำหรับการสร้างรายงานที่มีโครงสร้างหรือคำอธิบายแบบยาว ธรรมชาติที่รับเฉพาะข้อความของโมเดลจำกัดงานที่เกี่ยวข้องกับความเข้าใจภาพ แต่ในโดเมนข้อความ มันทำงานวิเคราะห์เชิงลึกได้อย่างน่าเชื่อถือ
ราคาของ DeepSeek Reasoner อยู่ที่ $0.44 ต่อโทเค็นนำเข้า / $0.87 ต่อโทเค็นส่งออกต่อ 1 ล้านโทเค็น ซึ่งสูงกว่าโมเดลขนาดเล็กหรือโมเดลที่เร็วกว่าหลายตัว คุณควรเลือกโมเดลนี้เมื่องานของคุณต้องการหน้าต่างบริบทขนาด 1 ล้านโทเค็นเต็มรูปแบบ หรือความสามารถในการให้เหตุผลเชิงลึก สำหรับพรอมต์สั้นๆ (สองสามพันโทเค็น) ที่ไม่ต้องการตรรกะแบบทีละขั้นตอน โมเดลที่ถูกกว่าเช่น LLM ที่ปรับแต่งคำสั่งขนาดเล็กจะคุ้มค่ากว่า ในทำนองเดียวกัน หากแอปพลิเคชันของคุณต้องการความหน่วงต่ำสำหรับการตอบสนองแบบเรียลไทม์ โมเดลที่เบากว่าอาจดีกว่า อย่างไรก็ตาม หากคุณกำลังวิเคราะห์เอกสารขนาดใหญ่หรือแก้ปัญหาที่ซับซ้อนซึ่งต้องใช้การเชื่อมโยงเชิงตรรกะ การลงทุนใน DeepSeek Reasoner อาจนำไปสู่ความแม่นยำที่สูงขึ้นและเวลาในการตรวจสอบด้วยตนเองที่น้อยลง
จุดแข็งหลักของ DeepSeek Reasoner คือหน้าต่างบริบทขนาดมหึมา ขีดจำกัดของโทเค็นเอาต์พุตที่สูง และการเน้นที่การให้เหตุผลเชิงตรรกะ สามารถรักษาความสอดคล้องกันในเนื้อหาหลายร้อยหน้า และสร้างผลลัพธ์ที่ยาวและมีโครงสร้างที่ดี โมเดลนี้รองรับเฉพาะข้อความเข้าเท่านั้น แต่มีแนวโน้มว่าจะเข้าใจหลายภาษา แม้ว่าจะยังไม่ได้รับการยืนยันอย่างชัดเจน ความสามารถในการให้เหตุผลหมายความว่ามันสามารถอธิบายกระบวนการคิดของมัน ซึ่งช่วยในการดีบักและการตรวจสอบ นอกจากนี้ เนื่องจาก OrcaRouter ส่งต่ออัตราของผู้ให้บริการโดยไม่มีส่วนเพิ่ม จึงไม่มีค่าใช้จ่ายแอบแฝง สำหรับผู้ใช้ที่ต้องการขยายงานวิเคราะห์เชิงลึก โมเดลนี้มอบการผสมผสานที่แข็งแกร่งระหว่างความจุและความเที่ยงตรงในการให้เหตุผล
คะแนนเกณฑ์มาตรฐานเฉพาะสำหรับ DeepSeek Reasoner ไม่ได้ระบุไว้ในข้อเท็จจริงที่มีอยู่ อย่างไรก็ตาม โมเดลนี้เป็นส่วนหนึ่งของกลุ่มโมเดลที่เน้นการให้เหตุผลของ DeepSeek ซึ่งก่อนหน้านี้ได้แสดงประสิทธิภาพที่แข็งแกร่งในการวัดประสิทธิภาพทางคณิตศาสตร์ (เช่น GSM8K, MATH) และการเขียนโค้ด (เช่น HumanEval) ในการประเมินสาธารณะ ผู้ใช้ควรทดสอบโมเดลกับชุดข้อมูลของตนเองเพื่อตรวจสอบประสิทธิภาพสำหรับกรณีการใช้งานเฉพาะของตน ด้วยหน้าต่างบริบทขนาดใหญ่ โมเดลนี้จึงเหมาะสมเป็นพิเศษสำหรับงานที่ประเมินความเข้าใจการพึ่งพาระยะไกล หากไม่มีตัวเลขอย่างเป็นทางการ ควรเปรียบเทียบอย่างเป็นกลางผ่านการทดลองโดยตรงบน OrcaRouter API
แม้จะมีจุดแข็ง แต่ DeepSeek Reasoner ก็มีข้อจำกัด ประการแรก รองรับเฉพาะการป้อนข้อความเท่านั้น ไม่มีรูปภาพ เสียง หรือวิดีโอ ประการที่สอง ขนาดบริบทที่ใหญ่อาจทำให้เวลาแฝงสูงขึ้น โดยเฉพาะเมื่ออินพุตใกล้ถึง 1 ล้านโทเค็น เวลาในการสร้างโทเค็นแรกอาจนานกว่าโมเดลขนาดเล็กอย่างเห็นได้ชัด ประการที่สาม แม้ว่าโมเดลจะแข็งแกร่งในการใช้เหตุผล แต่อาจเทียบไม่ได้กับความคิดสร้างสรรค์แบบลื่นไหลของโมเดลเอนกประสงค์บางตัวสำหรับงานเช่นบทกวีหรือการเล่าเรื่องแบบเปิด ประการที่สี่ เนื่องจากเป็นโมเดลการใช้เหตุผลเฉพาะทาง จึงอาจวิเคราะห์คำขอที่เรียบง่ายมากเกินไป โดยใช้โทเค็นมากกว่าที่จำเป็น สุดท้าย การกำหนดราคา แม้จะแข่งขันได้ในรุ่นเดียวกัน แต่ก็ยังสูงกว่าทางเลือกน้ำหนักเบา ทำให้ไม่คุ้มค่าสำหรับคำถามที่ไม่สำคัญ
DeepSeek Reasoner มีหน้าต่างบริบทขนาด 1,048,576 โทเคน และผลลัพธ์สูงสุด 384,000 โทเคน ทำให้เป็นหนึ่งในไม่กี่โมเดลที่สามารถจัดการเอกสารที่ยาวกว่านิยายหลายเล่มในพรอมต์เดียว หน้าต่างบริบทประกอบด้วยอินพุตและประวัติการสนทนาที่มีอยู่ โมเดลใช้หน้าต่างเต็มเพื่อสร้างการตอบกลับ ขีดจำกัดผลลัพธ์ 384,000 โทเคนช่วยให้สร้างเนื้อหาที่ยาวมาก เช่น โค้ดเบสทั้งหมดหรือรายงานที่ครอบคลุม ผู้ใช้ควรทราบว่าการใช้บริบทเต็มอาจเพิ่มความหน่วงและต้นทุนตามสัดส่วน ข้อกำหนดเหล่านี้ได้รับการยืนยันในข้อเท็จจริงของโมเดลและรองรับโดยตรงเมื่อเรียกใช้โมเดลผ่าน API ที่เข้ากันได้กับ OpenAI ของ OrcaRouter
บน OrcaRouter การกำหนดราคาสำหรับ DeepSeek Reasoner จะขึ้นอยู่กับจำนวน token ที่ใช้เท่านั้น โดยเรียกเก็บตามอัตราของผู้ให้บริการโดยไม่มีส่วนเพิ่ม (zero markup) token ขาเข้าคิดในอัตรา $0.44 ต่อ 1 ล้าน token และ token ขาออกคิดในอัตรา $0.87 ต่อ 1 ล้าน token ไม่มีค่าธรรมเนียมแพลตฟอร์มเพิ่มเติม ค่าสมาชิก หรือค่าใช้จ่ายแอบแฝงใดๆ การคิดเงินจะคำนวณต่อการเรียก API ตามจำนวน token ทั้งหมดที่ประมวลผล OrcaRouter เรียกเก็บเงินจากผู้ใช้โดยตรง และต้นทุนสะท้อนอัตราดิบของผู้ให้บริการ โมเดลราคาโปร่งใสนี้ช่วยให้นักพัฒนาสามารถปรับขนาดการใช้งานได้อย่างคาดการณ์ได้ โดยไม่ต้องกังวลเกี่ยวกับอัตรากำไรที่เพิ่มโดยเกตเวย์
ต้นทุนต่อโทเคนสามารถคำนวณได้จากอัตราต่อล้านโทเคน: โทเคนนำเข้ามีราคา $0.00000044 ต่อโทเคน และโทเคนส่งออกมีราคา $0.00000087 ต่อโทเคน ในทางปฏิบัติ คำขอทั่วไปที่มีโทเคนนำเข้า 10,000 โทเคนและโทเคนส่งออก 1,000 โทเคนจะมีค่าใช้จ่ายประมาณ $0.0044 + $0.00087 = $0.00527 เนื่องจากหน้าต่างบริบทสามารถมีขนาดใหญ่ถึง 1,048,576 โทเคนนำเข้า คำขอแบบเต็มบริบทจะมีค่าใช้จ่ายประมาณ $0.46 สำหรับการนำเข้าเพียงอย่างเดียว ขีดจำกัดการส่งออกที่ 384,000 โทเคนจะมีค่าใช้จ่ายสูงถึง $0.334 หากใช้เต็มที่ ต้นทุนเหล่านี้เพิ่มขึ้นเป็นเส้นตรง ดังนั้นผู้ใช้ควรตรวจสอบการใช้งานโทเคน โดยเฉพาะเมื่อใช้ความจุสูงสุดของบริบทและเอาต์พุต
OrcaRouter ระบุอย่างชัดเจนว่า DeepSeek Reasoner มีราคาตามอัตราของผู้ให้บริการโดยไม่มีส่วนเพิ่ม (zero markup) ซึ่งหมายความว่าไม่มีค่าธรรมเนียมเพิ่มเติมนอกเหนือจากต้นทุนต่อโทเค็นที่ระบุไว้ ไม่มีข้อกำหนดขั้นต่ำรายเดือน ค่าติดตั้ง หรือค่าธรรมเนียมสำหรับการเข้าถึง API ต้นทุนเดียวที่เกิดขึ้นคือโทเค็นที่ใช้งาน ผู้ใช้สามารถตรวจสอบค่าใช้จ่ายได้โดยเปรียบเทียบจำนวนเงินที่เรียกเก็บกับบันทึกการใช้งานโทเค็น ความโปร่งใสด้านราคาของ OrcaRouter ทำให้มั่นใจได้ว่าสิ่งที่คุณเห็นคือสิ่งที่คุณจ่าย โดยไม่มีค่าธรรมเนียมเพิ่มเติมที่ไม่คาดคิดสำหรับการใช้งานปริมาณมากหรือฟีเจอร์พิเศษ
ข้อเท็จจริงที่มีอยู่ไม่ได้กล่าวถึงกลไกการแคชหรือส่วนลดตามปริมาณสำหรับ DeepSeek Reasoner บน OrcaRouter อาจเป็นไปได้ว่า OrcaRouter อาจเสนอการแคชมาตรฐานสำหรับพรอมพ์ที่ใช้บ่อย แต่ยังไม่ได้รับการยืนยัน ในทำนองเดียวกัน ไม่มีการอธิบายระดับส่วนลด ราคาจะคิดตามจำนวนโทเค็นในอัตราของผู้ให้บริการ ผู้ใช้ควรถือว่าไม่มีแคชในตัวหรือส่วนลด เว้นแต่ OrcaRouter จะแจ้งอย่างชัดเจน สำหรับการใช้งานปริมาณมาก คุณสามารถติดต่อฝ่ายสนับสนุนของ OrcaRouter เพื่อสอบถามเกี่ยวกับข้อตกลงที่กำหนดเอง แต่จากข้อมูลที่มีอยู่ โมเดลราคาเป็นแบบจ่ายตามการใช้งานจริง
ในการเรียกใช้ DeepSeek Reasoner ผ่าน OrcaRouter ให้ใช้ endpoint ที่เข้ากันได้กับ OpenAI ที่ base_url https://api.orcarouter.ai/v1. ตั้งชื่อโมเดลเป็น "deepseek/deepseek-reasoner". รองรับพารามิเตอร์การสนทนา OpenAI มาตรฐานทั้งหมด รวมถึง messages, max_tokens, temperature, top_p และ stop sequences. ตัวอย่างเช่น คำขอจะมีลักษณะดังนี้: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -d '{"model":"deepseek/deepseek-reasoner","messages":[{"role":"user","content":"Solve this math problem..."}],"max_tokens":10000}'. API จะส่งคืนคำตอบในรูปแบบเดียวกับ endpoint การสนทนาของ OpenAI ทำให้การผสานรวมกับแอปพลิเคชันที่มีอยู่เป็นเรื่องง่าย
นอกเหนือจากพารามิเตอร์แชทมาตรฐาน DeepSeek Reasoner รองรับตัวเลือกการกำหนดค่าที่เข้ากันได้กับ OpenAI ปกติ: temperature (ค่าเริ่มต้น 1, ช่วง 0-2), top_p (ค่าเริ่มต้น 1), frequency_penalty, presence_penalty, stop, และ max_tokens (สูงสุด 384,000) เนื่องจากเป็นโมเดลที่ใช้เหตุผล การตั้งค่า temperature ส่งผลต่อความสุ่มของห่วงโซ่การให้เหตุผล; temperature ที่ต่ำกว่าจะให้ผลลัพธ์ที่แน่นอนกว่า ไม่มีพารามิเตอร์เฉพาะสำหรับการให้เหตุผลที่เปิดเผยใน API—พฤติกรรมการให้เหตุผลเป็นคุณสมบัติภายในของโมเดล ผู้ใช้ยังสามารถใช้สตรีมมิงผ่านพารามิเตอร์ stream เพื่อรับโทเค็นแบบเพิ่มทีละส่วน พารามิเตอร์ทั้งหมดต้องส่งใน JSON body ของคำขอ POST ไปยังเอนด์พอยต์ chat completions
การโยกย้ายไปยัง OrcaRouter นั้นตรงไปตรงมา เนื่องจาก API เข้ากันได้อย่างสมบูรณ์กับรูปแบบการเติมเต็มแชทของ OpenAI แทนที่ base URL ที่มีอยู่ด้วย https://api.orcarouter.ai/v1 และอัปเดตชื่อโมเดลเป็น "deepseek/deepseek-reasoner" สร้าง API key จากแดชบอร์ดของ OrcaRouter และรวมไว้ในส่วนหัว Authorization ปรับโค้ดของคุณให้ใช้ base URL และตัวระบุโมเดลใหม่ ส่วนที่เหลือของตรรกะของคุณ รวมถึงการจัดรูปแบบข้อความ ชื่อพารามิเตอร์ และการแยกวิเคราะห์การตอบสนอง ยังคงไม่เปลี่ยนแปลง ความเข้ากันได้นี้ช่วยให้คุณเปลี่ยนผู้ให้บริการโดยมีการเปลี่ยนแปลงโค้ดเพียงเล็กน้อย ซึ่งมักจะเป็นเพียงไม่กี่บรรทัดในการกำหนดค่าไคลเอ็นต์ ทดสอบด้วย payload เล็กน้อยเพื่อยืนยันการเชื่อมต่อและราคาก่อนที่จะปรับขนาด
เมื่อเปรียบเทียบกับซีรีส์ GPT-4 ของ OpenAI แล้ว DeepSeek Reasoner มีหน้าต่างบริบทที่ใหญ่กว่าอย่างมีนัยสำคัญ (1M tokens เทียบกับ 8K-128K สำหรับ GPT-4 Turbo) และขีดจำกัดผลลัพธ์ที่สูงกว่า (384K เทียบกับ 4K-32K) ราคาต่อ token ต่ำกว่า ($0.44/$0.87 เทียบกับ GPT-4 Turbo ที่ประมาณ $10/$30 ต่อ 1M tokens) ทำให้คุ้มค่ากว่าสำหรับงานที่ต้องใช้บริบทที่ยาว อย่างไรก็ตาม GPT-4 Turbo รองรับอินพุตแบบมัลติโมดัล (รูปภาพ, เสียง) และอาจมีความรู้ในวงกว้างมากกว่า DeepSeek Reasoner มุ่งเน้นไปที่การให้เหตุผลโดยเฉพาะ และอาจสร้างการตอบสนองแบบ chain-of-thought ที่ละเอียดกว่า สำหรับงานที่ไม่ต้องการบริบทที่ยาวมากหรือการให้เหตุผลเชิงลึก ความสามารถที่หลากหลายของ GPT-4 Turbo อาจเป็นตัวเลือกที่ดีกว่า
Anthropic's Claude 2 และ Claude 3 Opus มีหน้าต่างบริบทขนาด 100K-200K โทเคน ซึ่งเล็กกว่า 1M โทเคนของ DeepSeek Reasoner โมเดล Claude ยังรองรับอินพุตแบบมัลติโมดอลบางส่วนในเวอร์ชันใหม่กว่า ราคาของ DeepSeek Reasoner ต่ำกว่าอย่างมาก (ประมาณหนึ่งในสิบของต้นทุน Claude 3 Opus สำหรับโทเคนขาเข้า) โมเดล Claude เน้นความปลอดภัยและความช่วยเหลือ ในขณะที่ DeepSeek Reasoner ได้รับการปรับให้เหมาะสมสำหรับความลึกในการใช้เหตุผล หากแอปพลิเคชันของคุณต้องการประมวลผลเอกสารที่ยาวมากด้วยต้นทุนที่ต่ำกว่า DeepSeek Reasoner มีข้อได้เปรียบ สำหรับงานที่ต้องการการป้องกันด้านความปลอดภัยและการรองรับมัลติโมดอล Claude อาจเหมาะสมกว่า ทั้งสองสามารถเข้าถึงได้ผ่าน API ของ OrcaRouter
เลือกใช้ DeepSeek Reasoner เมื่อปริมาณงานของคุณต้องการหน้าต่างบริบทที่ใหญ่กว่า 200K โทเค็น หรือเมื่อคุณจำเป็นต้องสร้างผลลัพธ์ที่เกิน 32K โทเค็น เหมาะอย่างยิ่งสำหรับงานด้านการใช้เหตุผลเชิงระบบที่การแสดงขั้นตอนตรรกะระหว่างกลางมีคุณค่า ข้อได้เปรียบด้านต้นทุนจะเด่นชัดที่สุดสำหรับแอปพลิเคชันที่มีปริมาณมากและบริบทยาว เนื่องจากราคาต่อโทเค็นต่ำกว่าโมเดลระดับพรีเมียมจาก OpenAI หรือ Anthropic อย่างมีนัยสำคัญ อย่างไรก็ตาม หากงานของคุณสั้น ต้องใช้ข้อมูลนำเข้าหลายรูปแบบ หรือได้รับประโยชน์จากชุดข้อมูลฝึกที่ใหญ่กว่า ทางเลือกอื่นอาจดีกว่า ให้ประเมินรูปแบบการใช้โทเค็นและข้อกำหนดด้านการใช้เหตุผลของคุณเพื่อพิจารณาว่าจุดแข็งของ DeepSeek Reasoner สอดคล้องกับลำดับความสำคัญของคุณหรือไม่
เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="deepseek/deepseek-reasoner",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstream| อินพุต / 1M โทเค็น · นอกช่วงพีค | $0.242 |
|---|---|
| เอาต์พุต / 1M โทเค็น · นอกช่วงพีค | $0.726 |
| อ่านแคช / 1M · นอกช่วงพีค | $0.0077 |
| ชั่วโมงพีค | 01:00–04:00, 06:00–10:00 ×2 (UTC) |
| อินพุต / 1M โทเค็น · ×2 | $0.484 |
| เอาต์พุต / 1M โทเค็น · ×2 | $1.452 |
| อ่านแคช / 1M · ×2 | $0.015 |
| สกุลเงิน | USD |
ประมาณการจากราคาตั้ง
เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ
สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้
GET /api/public/models/deepseek/deepseek-reasonerเปิด @misc{orcarouter_deepseek_reasoner,
title = {deepseek/deepseek-reasoner API},
author = {deepseek},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/deepseek/deepseek-reasoner}
}deepseek. (n.d.). deepseek/deepseek-reasoner API. OrcaRouter. https://www.orcarouter.ai/models/deepseek/deepseek-reasoner