การ์ดไตเติลที่อ่านว่า 'Qwen3.8-27B' พร้อมคำบรรยายใต้ไตเติลว่า 'โอเพนเวตกำลังจะมาในสัปดาห์นี้' ข้อความคิ้วว่า 'Alibaba Qwen - สิ่งที่เรารู้จนถึงตอนนี้' และบรรทัดวันที่ว่า 'สัปดาห์ของวันที่ 10 สิงหาคม 2026' ข้างไอคอนกล่องเปิดและไอคอนปฏิทิน
Guides & Insights

Qwen3.8-27B เปิดเผยน้ำหนัก: Max ถูกปล่อยออกมา แต่ 27B ไม่ได้ถูกปล่อย — สิ่งที่เรารู้ตอนนี้

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เมื่อวันที่ 13 สิงหาคม 2026 สัปดาห์ปล่อยน้ำหนักแบบเปิดที่ Alibaba สัญญาไว้สำหรับเจนเนอเรชัน Qwe​n3.8 ถูกแบ่งออกเป็นสองส่วน น้ำหนักของรุ่นเรือธงระดับ Max — Qwen3.8-2.4T-A95B, โมเดล sparse mixture-of-experts ที่มีพารามิเตอร์ 2.4 ล้านล้าน และเป็นการเปิดตัว Q​wen ระดับ Max ครั้งแรกที่สามารถดาวน์โหลดได้ — เปิดตัวจริงบน Hugging Face และ ModelScope โดยมีการประกาศเมื่อคืนก่อนผ่านชุมชน ModelScope โมเดลขนาดเล็กกว่าที่หน้านี้กล่าวถึงคือ Qwen3.8-27B, ไม่ได้ปล่อยออกมา: ถูกกำหนดให้ปล่อยในสัปดาห์เดียวกันของวันที่ 10 สิงหาคม แต่ก็ยังไม่มี repository อย่างเป็นทางการ, model card, ไฟล์ใบอนุญาต หรือ benchmark ของตัวเอง และตัวติดตามจากบุคคลที่สามต่างก็ระบุว่าการเปิดตัวล่าช้าโดยไม่มีการกำหนดวันใหม่ คำถามที่หน้านี้ซึ่งรวบรวมข้อมูลเท่าที่รู้ถูกสร้างขึ้นเพื่อตอบ — "เมื่อไหร่ 27B จะปล่อยจริง ๆ?" — กลายเป็นสองคำถาม: ทำไมน้ำหนักของ Max ถึงปล่อยก่อน และเกิดอะไรขึ้นกับ 27B?

บทความชิ้นนี้ยังคงเป็นบทสรุปสิ่งที่เรารู้เท่าที่ทราบ ณ ตอนนี้ ไม่ใช่รีวิว Qwen3.8-Max ซึ่งเป็น API ระดับเรือธง เปิดให้ใช้งานแล้วตั้งแต่วันที่ 3 สิงหาคม ในราคา $2/$6 ต่อล้านโทเคน; โมเดลฐานแบบเปิดน้ำหนักที่อยู่เบื้องหลังคือ Qwen3.8-2.4T-A95B เปิดให้ดาวน์โหลดได้เมื่อวันที่ 13 สิงหาคม; และน้ำหนักของ Qwen3.8-27B ยังไม่ได้เผยแพร่ ข้อกล่าวอ้างทุกข้อด้านล่างถูกระบุว่า ยืนยันแล้ว รายงานโดยผู้ขาย หรือคาดการณ์โดยชุมชน ตามความเหมาะสม

สัญญาณ และสิ่งที่เกิดขึ้นจริงในสัปดาห์นี้

สัญญาณแรกคือโพสต์บน X โดย @kimmonismus ที่ชี้ว่า "สัปดาห์หน้า" เป็นสัปดาห์ที่ต้องจับตา: "Q​wen-3.8 27b - Grok 4.6" โดยที่ Astra หายไปจากรายการอย่างเห็นได้ชัด ครึ่งหนึ่งของ Grok ในสัปดาห์นั้นเปิดตัวเมื่อวันที่ 12 สิงหาคม ครึ่งหนึ่งของ Q​wen แยกออกเป็นสองส่วน สิ่งที่โพสต์จับได้คืออารมณ์ของผู้คนที่เฝ้าดูการเปิดตัวโมเดลเป็นอาชีพ — การปล่อย open-weights ของ Qwe​n3.8 เป็นอีเวนต์ในปฏิทิน และสัปดาห์นั้นมาถึงโดยที่รายละเอียดยังไม่ถูกกำหนดแน่นอน หนึ่งสัปดาห์ต่อมา รายละเอียดบางส่วนก็กระจ่างขึ้น: หนึ่งในการปล่อย open-weights ที่สัญญาไว้ทั้งสองได้ออกมาแล้ว และไม่ใช่ตัวที่โพสต์นั้นกล่าวถึง

ยืนยันแล้วอะไรบ้าง

• ตระกูลนี้มีจริงและประกาศอย่างเป็นทางการแล้ว Alibaba เปิดตัวตระกูลโมเดลพื้นฐาน Qwen3.8 เมื่อวันที่ 3 สิงหาคม 2026 หลังจากการเปิดตัวรอบพรีวิวในกลางเดือนกรกฎาคม

• Qwen3.8-Max เปิดตัวในวันเดียวกัน เรือธงของ API ซึ่งเป็นโมเดล mixture-of-experts ที่มีพารามิเตอร์ 2.4 ล้านล้านตัว โดยมีพารามิเตอร์ที่ใช้งานอยู่ประมาณ 95 พันล้านตัว หน้าต่างบริบท 1 ล้านโทเค็น และรองรับอินพุตทั้งข้อความ รูปภาพ และวิดีโอ — เปิดให้บริการบน Q​wen API ในราคา $2/$6 ต่อล้านโทเค็น นอกจากนี้ยังมีให้ใช้งานผ่าน OrcaRouter ในราคาประกาศเดียวกัน โดยส่งผ่านโดยคิดมาร์กอัป 0%

• The Max ปล่อย open weights เมื่อวันที่ 13 สิงหาคม. Qwen3.8-2.4T-A95B — โมเดลพื้นฐานที่ใช้สร้าง Qwen3.8-Max API — เปิดให้ดาวน์โหลดได้จาก Hugging Face และ ModelScope พร้อมเวอร์ชันควอนไทซ์ FP8 ควบคู่กันไป นี่คือการปล่อย open weights ระดับ Max ครั้งแรกของ Q​wen เท่าที่เคยมีมา โมเดลที่ดาวน์โหลดได้นี้เป็นแบบข้อความเท่านั้น โดยเปิดโหมดคิด (thinking mode) ไว้บังคับ มีบริบท native ขนาด 256K โทเคน ซึ่งขยายได้ถึงประมาณ 1M และปรับใช้ได้บน SGLang, vLLM และ TokenSpeed

• Qwen3.8-27B เป็นโมเดลน้ำหนักเปิดขนาดเล็กของตระกูล — ยังไม่เผยแพร่Alibaba วางตำแหน่งให้เป็นเส้นทางที่สมจริงสำหรับการติดตั้งในพื้นที่ (local) และภายในองค์กร (on-premise) และให้คำมั่นว่าจะเผยแพร่น้ำหนักของมันบน Hugging Face และ ModelScope พร้อมกับของ Max ณ วันที่ 13 สิงหาคม ยังไม่มี repository อย่างเป็นทางการของ Qwen3.8-27B คำมั่นสัญญานั้นเป็นจริง แต่การส่งมอบยังไม่เกิดขึ้น

• คะแนนอิสระแรกของเจนเนอเรชันนี้มีออกมาแล้ว Artificial Analysis จัดอันดับ Qwen3.8-Max ที่ Intelligence Index 56 ที่ราคาประมาณ $1.14 ต่องาน — ดีจริงๆ แต่ก็มีข้อควรระวังตามปกติของเรือธงที่เพิ่งเปิดตัวไม่กี่วัน

สิ่งที่เรารู้จริงๆ เกี่ยวกับ 27B

การสรุปอย่างตรงไปตรงมาก็คือว่า "Qwen3.8-27B" ยังคงเป็นเพียงชื่อและจำนวนพารามิเตอร์เป็นหลัก ข้อเท็จจริงที่ยืนยันได้คือ มันเป็นโมเดลที่มีพารามิเตอร์ประมาณ 27 พันล้านตัว เป็นสมาชิกแบบ open-weights ของรุ่น Qwe​n3.8 และถูกออกแบบมาสำหรับงานบน GPU ตัวเดียวและภายในองค์กร มากกว่าจะเป็นคลัสเตอร์ GPU หลายร้อยตัว Daniel Han จาก Unsloth รายงานว่ามันควรจะพอดีกับ VRAM ประมาณ 17GB เมื่อเปิดตัว — การ์ดระดับโปรซูเมอร์ตัวเดียว

สิ่งอื่นๆ ยังไม่ได้รับการยืนยัน Alibaba ยังไม่ได้เปิดเผยว่า 27B เป็นโมเดลแบบ dense หรือแบบ mixture-of-experts, ขนาด context window เท่าใด, รองรับ input ประเภทใดบ้าง หรือคะแนน benchmark ของตัวเอง สิ่งที่เปลี่ยนไปในสัปดาห์นี้คือกำหนดเวลา: มีการสัญญาว่า Max และ 27B จะเปิดตัวในสัปดาห์เดียวกัน แต่มีเพียง Max เท่านั้นที่มาถึง ตัวติดตามจากบุคคลที่สามรายงานว่า 27B ล่าช้าโดยไม่มีกำหนดการใหม่ ซึ่งเป็นการคาดการณ์ของชุมชน ไม่ใช่คำแถลงอย่างเป็นทางการจาก Alibaba และเป็นไปได้ที่ตัว repo จะยังเผยแพร่ออกมาก่อนสิ้นสุดสัปดาห์ที่สัญญาไว้ แต่ ณ เวลาที่เขียนนี้ องค์กร Qwen อย่างเป็นทางการบน Hugging Face ยังไม่มีการระบุ Qwen3.8-27B และคลัง (repositories) เพียงไม่กี่แห่งที่ค้นพบ เช่น "Qwen3.8-27B-FP8", "-GGUF" และ "-MLX" ที่ปรากฏในการค้นหาล้วนเป็นการ์ดตัวแทนจากชุมชนซึ่งมีจำนวนดาวน์โหลดเพียงหลักเดียว ไม่ใช่เวอร์ชันเปิดตัวอย่างเป็นทางการ

จุดอ้างอิงที่มีประโยชน์ยังคงเป็น 27B ของเจนเนอเรชันก่อนหน้า นั่นคือ Qwen3.5-27B โมเดลแบบ dense แบบเปิดน้ำหนัก (open-weight) ที่มีหน้าต่างบริบท 32K ซึ่งเป็นเกณฑ์ขั้นต่ำที่สมเหตุสมผลที่ Qwen3.8-27B จะต้องเอาชนะให้ได้ และเป็นเครื่องเตือนใจว่าโมเดลระดับ 27B ของ Q​wen ถูกออกแบบมาให้รันบนฮาร์ดแวร์ที่นักพัฒนาเป็นเจ้าของจริงมาโดยตลอด

Max เป็นจุดอ้างอิงสำหรับสิ่งที่ 27B อาจได้รับสืบทอด

A comparison scoreboard for Qwen3.8-Max and Qwen3.8-27B, contrasting the Max's 2.4T MoE total parameters, ~95B active params, 1M-token context, / pricing and AA Index 56 with the 27B's ~27B params, TBD context, TBD architecture, self-host and no independent score yet.

{{1}}27B จะไม่เทียบชั้นกับเพดานดิบของ Max ได้ แต่ตัวเลขของ Max — ซึ่งตอนนี้เผยแพร่ในการ์ดโมเดลจริง — ได้กำหนดความคาดหวังว่าการพัฒนาของเจนเนอเรชันนี้มีหน้าตาแบบไหน ในการประเมินของ Alibaba เองสำหรับโมเดลโอเพนเวต Qwen3.8-2.4T-A95B ได้คะแนน 93.0 บน PaperBench, 86.1 บน OSworld-Verified, 91.5 บน parametric CAD, 67.7 บน SWE-bench Pro และ 86.6 บน Terminal-Bench 2.1 โดยผู้พัฒนาอ้างว่ามีระดับเทียบเท่า Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol และ Gemini 3.1 Pro{{/1}} {{2}}ตัวเลขเหล่านี้เป็นข้อมูลที่รายงานโดยผู้พัฒนา ตีพิมพ์ในเอกสารเผยแพร่ และยังไม่มีการตรวจสอบซ้ำโดยห้องแล็บอิสระ{{/2}} {{3}}การเพิ่มประสิทธิภาพแบบ agentic ที่การเปิดตัว API อ้างไว้ — FrontierSWE กระโดดจาก 40.7 เป็น 73.5 ในเจนเนอเรชันเดียว — ปรากฏอยู่ในเอกสารเผยแพร่ชุดเดียวกัน{{/3}} {{4}}หากการปรับปรุงส่วนนั้นแม้เพียงบางส่วนไหลลงมายัง 27B มันจะนิยามความหมายของ "โมเดลโค้ดท้องถิ่นที่ดี" ในคลาสของมันใหม่ทั้งหมด{{/4}}

รายละเอียดหนึ่งที่ควรจำไว้: Max ที่ดาวน์โหลดได้ไม่เหมือนกับ Max ใน API ทุกประการ Qwe​n3.8-2.4T-A95B เป็นแบบข้อความเท่านั้นและบังคับเปิดโหมดคิด ในขณะที่ Qwen3.8-Max API เพิ่มการรับภาพ โหมดไม่คิด และบริบทเริ่มต้นที่ 1M โทเค็น ช่องว่างนี้คือสิ่งที่รุ่น 27B มีแนวโน้มจะสืบทอดมา — และควรจดจำไว้เมื่อคุณอ่านพาดหัวข่าวเกณฑ์มาตรฐาน "Qwen3.8" โดยไม่ตรวจสอบว่ารุ่นใดถูกอธิบาย

จุดที่ Max แข็งแกร่งที่สุดคือเรื่องราคา: $2/$6 ต่อล้านโทเคนสำหรับคอนเท็กซ์ทั้งหมด 1M โทเคนบน API โดยไม่มีค่าธรรมเนียมเพิ่มเติมสำหรับพรอมป์ยาว นี่เป็นราคาเชิงรุกสำหรับ API ระดับแนวหน้า และมันสำคัญต่อการคำนวณเส้นทาง — ด้วยตัวเลขเหล่านี้ เจนเนอเรชัน 3.8 กลายเป็นตัวเลือกสำหรับงานที่เคยใช้เรือธงราคาแพงกว่าเป็นค่าเริ่มต้น

อะไรที่สามารถรันมันได้จริง

A hardware reality-check card for Qwen3.8-27B showing community-projected VRAM requirements: Q4_K_M ~16GB, Q3_K_M ~13GB, Q6_K ~21GB, FP8 ~27GB, full precision H100 80GB, with a footer noting these are community projections based on Qwen 3.6-27B quant sizes.

สำหรับ 27B อาลีบาบายังไม่ได้เผยแพร่ข้อกำหนดด้านฮาร์ดแวร์ ดังนั้นตัวเลขที่หมุนเวียนอยู่จึงยังคงเป็นการคาดการณ์ของชุมชนโดยอิงจากตารางควอนไทเซชัน Q​wen 3.6-27B — เป็นการประมาณ ไม่ใช่ข้อมูลจำเพาะ ช่วงการทำงานที่คนส่วนใหญ่ใช้วางแผนยังคงไม่เปลี่ยนแปลง:

• Q4_K_M quant, VRAM ~16GB — RTX 4090 หรือการ์ดเทียบเท่า ซึ่งเป็นจุดที่ลงตัวที่สุดที่นักพัฒนาส่วนใหญ่ที่รันโมเดลในเครื่องของตัวเองจะเลือกใช้

• Q3_K_M quant, ~13GB VRAM — พอดีกับการ์ด 12GB เช่น RTX 3060 ที่คุณภาพลดลง

• Q6_K quant, ~21GB VRAM — แทบไม่สูญเสียข้อมูลบนการ์ดจอ 24GB.

• การให้บริการ FP8, VRAM ~27GB — ใช้ L40S ตัวเดียว ตามที่คาดการณ์ไว้ก่อนหน้านี้ สำหรับการอนุมานระดับโปรดักชัน.

• ความแม่นยำเต็มรูปแบบ, H100 80GB — เส้นทางคุณภาพระดับ benchmark และไม่ใช่สิ่งที่ทีมส่วนใหญ่จะรัน.

ประเด็นใหม่คือข้อความที่ว่า “ตอนนี้คุณสามารถโฮสต์โมเดลตระกูล Qwen3.8 ด้วยตัวเองได้แล้ว” นั้นเป็นความจริง แต่ไม่ใช่สำหรับโมเดลที่ผู้คนวางแผนจะใช้กัน Max มี open weights ที่อยู่คนละคลาสฮาร์ดแวร์โดยสิ้นเชิง: โมเดล BF16 แบบความแม่นยำเต็มมีขนาดประมาณ 4.9TB และเทคนิค 1-bit layered selective quantization ของ Unsloth ทำให้เหลือประมาณ 397GB — รันได้ แต่ต้องมี RAM และ VRAM รวมกันอย่างน้อย 410GB เท่านั้น นั่นคือโครงสร้างพื้นฐานระดับจริงจัง ไม่ใช่การ์ดระดับโปรซูเมอร์ และมันคือช่องว่างที่ 27B ถูกสร้างขึ้นมาเพื่อเติมเต็มพอดี ซึ่งการที่ 27B ยังคงหายไปจึงเป็นเหตุผลที่เส้นทางการรันบนเครื่องตัวเองด้วย GPU ตัวเดียวสำหรับเจนเนอเรชันนี้ยังไม่มีอยู่จริง

คำถามเรื่องใบอนุญาต: Max เพิ่งวางบรรทัดฐานเอาไว้

คำถามเกี่ยวกับใบอนุญาตสำหรับ 27B ยังคงไม่มีคำตอบ แต่ภาพว่า "มันจะมีหน้าตาแบบไหน" ไม่ใช่การคาดเดาอีกต่อไป โอเพนเวตของ Max ถูกเผยแพร่ภายใต้ใบอนุญาตแบบกำหนดเองที่ระบุว่า "qwen3.8-max" — ไม่ใช่ Apache 2.0 ตามที่รายงานจาก model card โดยทั่วไปแล้วใช้ฟรีสำหรับการใช้เชิงพาณิชย์และการโฮสต์ แต่จะทำให้เกิดข้อกำหนดเพิ่มเติมเมื่อใช้งานในระดับใหญ่: ผลิตภัณฑ์ที่มีผู้ใช้งานรายเดือนมากกว่า 100 ล้านคน หรือมีรายได้ต่อเดือนมากกว่า 20 ล้านดอลลาร์สหรัฐ ต้องแสดงชื่อโมเดล และบริษัทที่มีรายได้ต่อปีมากกว่า 50 ล้านดอลลาร์สหรัฐที่ให้บริการ model-as-a-service หรือบริการผู้ช่วยทำงานด้วย AI จำเป็นต้องมีใบอนุญาตแยกต่างหาก ข่าวลือที่แพร่หลายว่าใบอนุญาตห้ามใช้ในสหรัฐฯ สหภาพยุโรป สหราชอาณาจักร และเกาหลี เป็นเท็จ — ใบอนุญาตไม่มีข้อจำกัดด้านอาณาเขต

สำหรับ 27B โดยเฉพาะ ยังไม่มีการระบุใบอนุญาต แต่ Max เปิดตัวภายใต้ใบอนุญาต Q​wen แบบกำหนดเอง ไม่ใช่ Apache 2.0 ซึ่งทำให้การสันนิษฐานว่าเป็น Apache 2.0 สำหรับโมเดลพี่น้องด้วยนั้นไม่ดีนัก ใบอนุญาต Tongyi Qianwen แบบเก่า — ที่มีเงื่อนไขผู้ใช้รายเดือน 100 ล้านคน — ไม่ใช่สิ่งที่ Max ได้รับ ใบอนุญาตของ Max เป็นใบอนุญาตแบบแบ่งระดับตามขนาดแบบใหม่ อ่านไฟล์ LICENSE ในที่เก็บจริงก่อนที่คุณจะวางแผนโดยอิงจากมัน และคาดว่าใบอนุญาตของ 27B จะถูกตัดสินใจเมื่อที่เก็บของมันถูกปล่อยออกมาเท่านั้น

จังหวะของ Toolchain: การสนับสนุนตั้งแต่วันแรกเพิ่งได้รับการพิสูจน์แล้ว

เซิร์ฟวิ่งเอนจินทำงานได้เร็วตามที่คาดหวัง — สำหรับโมเดลที่เปิดตัวไป Qwen3.8-2.4T-A95B เปิดตัวพร้อมรองรับการทำงานใน SGLang, vLLM และ TokenSpeed ซึ่งเป็นสิ่งที่ "ให้บริการผ่าน API ได้เกือบจะทันที" สำหรับโมเดล open-weights ขนาดใหญ่ สำหรับรุ่น 27B เอนจินเดียวกันนี้มีแนวโน้มมากที่สุดที่จะรองรับก่อน เมื่อ repo ของมันถูกเผยแพร่ และการรองรับวันแรกของ Max ทำให้การที่ 27B ได้รับการสืบทอดการสนับสนุนนั้นเป็นความคาดหวังที่สมเหตุสมผล การ quantize แบบ GGUF และ AWQ จากชุมชนมักจะล่าช้าอยู่หนึ่งถึงสองสัปดาห์ ดังนั้นประสบการณ์ "pull and run" แบบ Ollama คงจะยังไม่มีในวันเปิดตัวของ 27B — การตั้งค่า vLLM หรือ llama.cpp ด้วยตนเองน่าจะเป็นทางเลือกสำหรับการใช้งานในเครื่องก่อน

สิ่งที่ยังไม่รู้

บทความเปิดโปงที่ซื่อตรงจะหยุดอยู่ที่สิ่งที่เปิดเผยต่อสาธารณะจริง ๆ และขอบเขตนั้นกว้างกว่าเมื่อหนึ่งสัปดาห์ก่อนในทิศทางหนึ่ง และแคบลงในอีกทิศทางหนึ่ง: คำถามของ Max ได้รับคำตอบ ส่วนของ 27B ไม่ได้รับ

• วันที่เผยแพร่ใหม่. “สัปดาห์ของวันที่ 10 สิงหาคม” คือคำมั่นสัญญา; สัปดาห์ใกล้จะหมดลงแล้วและ repo ยังไม่ปรากฏ ตัวติดตามจากบุคคลที่สามรายงานความล่าช้าโดยไม่มีกำหนดการใหม่ แต่อาลีบาบาไม่ได้ออกแถลงการณ์อย่างเป็นทางการ

• สถาปัตยกรรม. Dense หรือ MoE สำหรับ 27B และหากเป็น MoE จำนวนพารามิเตอร์ที่ใช้งาน

• สเปกชีต หน้าต่างบริบท, โมดาลิตี้, ขีดจำกัดเอาต์พุต, โหมดการใช้เหตุผล

• เกณฑ์ชี้วัด. รุ่น 27B ไม่มีคะแนนอย่างเป็นทางการและการประเมินอิสระ

• ใบอนุญาต ยังไม่มีการตัดสินใจจนกว่า repository ของ 27B จะเผยแพร่; ใบอนุญาตแบบกำหนดเองของ Max คือบรรทัดฐานที่ต้องจับตามอง

• Mirror risk.ปัญหาตัวยึดตำแหน่ง (placeholder) ตอนนี้ปรากฏให้เห็นในโลกจริงแล้ว — การ์ดของชุมชน "Qwen3.8-27B-FP8", "-GGUF" และ "-MLX" มีอยู่จริงโดยไม่มีไฟล์ทางการใด ๆ จนกว่าองค์กร Q​wen อย่างเป็นทางการจะเผยแพร่ repo ให้ดาวน์โหลดจากหน้าองค์กรอย่างเป็นทางการเท่านั้น

มันหมายความว่าอย่างไรสำหรับผู้สร้าง

การแบ่งทางปฏิบัติสำหรับรุ่น Qwe​n3.8 ตอนนี้เป็นสามทางแทนที่จะเป็นสองทาง หากคุณต้องการ API ระดับแนวหน้าในวันนี้ Qwen3.8-Max เปิดใช้งานผ่าน OrcaRouter ในราคาป้ายของ provider ที่ $2/$6 โดยส่งผ่านโดยคิด markup 0% — ราคาที่คุณเห็นคือราคาที่ Alibaba กำหนด หากคุณต้องการโฮสต์โมเดลระดับ Max ด้วยตัวเอง ตอนนี้ดาวน์โหลด open weights ได้แล้ว แต่คุณต้องมีฮาร์ดแวร์สำหรับโมเดล full-precision ประมาณ 4.9TB หรือโมเดล quantized ประมาณ 397GB และหากคุณต้องการการปรับใช้ local บน GPU เดียวที่รุ่นนี้ควรจะให้ได้ คุณยังต้องรอ Qwen3.8-27B ซึ่งยังไม่เปิดตัว คีย์เดียวที่เข้ากันได้กับ OpenAI ครอบคลุมฝั่ง API ในวันนี้ และเมื่อ hosting ของ 27B ลงตัว คีย์เดียวกันนี้ก็สามารถ route ไปยังมันได้

Screenshot of the OrcaRouter model page for Qwen3.8-Max, showing model id qwen/qwen3.8-max, .00/1M input token pricing, a 1M-token context window, and an OpenAI-compatible Python code sample.

ส่วนสุดท้ายนั้นคือประเด็นในภาพกว้าง และนี่คือสิ่งที่การปล่อยโมเดล open-weight ที่ล่าช้าและยังไม่ผ่านการพิสูจน์เป็นกรณีทดสอบพอดี โมเดลที่ยังไม่เปิดตัวเลยย่อมไม่มีประวัติผลงาน ไม่มีชุด benchmark อิสระ และไม่มีประวัติเหตุการณ์ — และเมื่อมันมาถึงจริง มันก็จะเป็นของใหม่ทั้งหมด การ routing คือวิธีที่คุณลองใช้มันโดยไม่ต้องเดิมพันกับเส้นทางที่ลูกค้าเห็น: ส่งทราฟฟิกที่รับความไม่แน่นอนได้ไปให้มัน สลับกลับไปใช้โมเดลที่พิสูจน์แล้วโดยอัตโนมัติเมื่อมันทำผิดพลาด และย้ายทั้งเวิร์กโหลดเมื่อมันได้รับความไว้วางใจแล้ว ชั้น routing ยังทำให้การคิดราคาโปร่งใส — เมื่อ Alibaba ลดราคาโมเดลที่คุณเรียกใช้ผ่านเอนด์พอยต์เดียว การเปลี่ยนแปลงจะมีผลทันทีในวันเดียวกัน เพราะราคาที่ประกาศถูกส่งผ่านตรงๆ

ดูอะไรดี

• ไม่ว่า repo ของ 27B จะปรากฏขึ้นหรือไม่ก็ตาม. การมีรายการอยู่ภายใต้องค์กร Qwen อย่างเป็นทางการบน Hugging Face หรือ ModelScope คือเหตุการณ์ที่จะยุติความล่าช้า — และสัปดาห์ของวันที่ 10 สิงหาคมก็เกือบจะสิ้นสุดลงโดยไม่มีรายการดังกล่าว.

• ไฟล์สัญญาอนุญาตของ 27B Max มาพร้อมกับสัญญาอนุญาตแบบปรับระดับตามขนาดการใช้งานที่กำหนดขึ้นเอง (custom scale-tiered license) ไม่ใช่ Apache 2.0 การที่ 27B จะทำตามแบบอย่างนั้นหรือไม่ ถือเป็นบรรทัดเดียวที่ส่งผลกระทบมากที่สุดในประกาศที่จะออกมาในที่สุด

• สถาปัตยกรรมและความยาวบริบท Dense เทียบกับ MoE และหน้าต่างบริบทเป็นตัวกำหนดว่าตัว 27B ใช้ทำอะไร

• เกณฑ์มาตรฐานอิสระครั้งแรก คะแนน 56 ของ Max บน Artificial Analysis Intelligence Index เป็นตัวกำหนดมาตรฐานไว้ การประเมินภายนอกครั้งแรกของ 27B จะบอกคุณว่าข้อได้เปรียบของเจนเนอเรชันนี้จะอยู่รอดได้มากเพียงใดในขนาดสำหรับผู้บริโภค

• ความครอบคลุมของ Toolchain ว่า 27B จะได้รับการรองรับ SGLang/vLLM/TokenSpeed ตั้งแต่วันแรกเหมือนกับ Max หรือไม่ และชุมชนจะตามมาด้วย quantization ได้เร็วแค่ไหน

คำถามที่พบบ่อย

Qwen3.8-27B เปิดตัวแล้วหรือยัง?

ไม่ Alibaba ประกาศเมื่อวันที่ 3 สิงหาคม 2026 และให้คำมั่นเรื่องน้ำหนักโมเดลกับ Hugging Face และ ModelScope สำหรับสัปดาห์ของวันที่ 10 สิงหาคม แต่ ณ วันที่ 13 สิงหาคม ยังไม่มี repository อย่างเป็นทางการของ Qwen3.8-27B, model card หรือใบอนุญาต น้ำหนักโมเดลแบบเปิดระดับ Max — Qwen3.8-2.4T-A95B — เผยแพร่เมื่อวันที่ 13 สิงหาคม ส่วนตัว 27B ไม่ได้เผยแพร่ และผู้ติดตามบุคคลที่สามรายงานว่าล่าช้าโดยไม่มีกำหนดใหม่

ต้องใช้ฮาร์ดแวร์อะไรบ้างในการรัน Qwen3.8-27B?

ยังไม่ได้รับการยืนยัน แต่การคาดการณ์จากชุมชนโดยอิงตามตาราง quant ของ {{1}}Q​wen 3.6-27B{{/1}} ประเมินว่า quant แบบ Q4_K_M ใช้ VRAM ประมาณ {{2}}16GB (การ์ด RTX 4090){{/2}}, quant แบบ Q3_K_M ใช้ประมาณ {{3}}13GB (การ์ด 12GB){{/3}}, quant แบบ Q6_K ใช้ประมาณ {{4}}21GB (การ์ด 24GB){{/4}} และการ serve แบบ FP8 ใช้ประมาณ {{5}}27GB (L40S หนึ่งตัว){{/5}} Daniel Han จาก Unsloth รายงานว่าอยู่ที่ประมาณ 17GB ในตอนเปิดตัว ให้ถือว่าตัวเลขเหล่านี้เป็นเพียง{{6}}การประมาณการ{{/6}}จนกว่า{{7}}โมเดลการ์ดอย่างเป็นทางการ{{/7}}จะเผยแพร่คำแนะนำด้านฮาร์ดแวร์

Qwen3.8-27B มีให้ใช้งานผ่าน OrcaRouter หรือไม่

ยัง Qwen3.8-27B เป็นโมเดลแบบเปิดน้ำหนัก (open-weight) ที่โฮสต์เองได้ และในขณะนี้ยังไม่มีบนแพลตฟอร์ม เรือธงของตระกูลเดียวกัน — Qwen3.8-Max — พร้อมใช้งานแล้วผ่าน OrcaRouter ในราคารายการของผู้ให้บริการที่ $2/$6 ต่อล้านโทเคน โดยไม่มีมาร์กอัป และเมื่อการโฮสต์ 27B ลงตัวแล้ว ก็สามารถเพิ่มเข้ากับคีย์ที่เข้ากับ OpenAI ได้เหมือนกัน

ฉันควรรอ Qwen3.8-27B หรือใช้ Qwen3.8-Max วันนี้?

ขึ้นอยู่กับว่าเวิร์กโหลดรันที่ไหน หากคุณต้องการ frontier API ในตอนนี้ Qwen3.8-Max เปิดให้บริการแล้วและตั้งราคาไว้ aggressively ที่ $2/$6 ต่อล้านโทเคน หากคุณต้องการ self-host โมเดลคลาส Max ในวันนี้ Qwen3.8-2.4T-A95B ดาวน์โหลดได้แล้ว แต่ต้องใช้ฮาร์ดแวร์ระดับจริงจัง — ประมาณโมเดล full-precision 4.9TB หรือประมาณ 397GB แบบ quantized พร้อม RAM และ VRAM รวมกัน 410GB+ ขึ้นไป หากคุณต้องการโมเดล local หรือ on-premise บนการ์ด consumer ตัวเดียว Qwen3.8-27B ยังคงเป็นตัวที่ต้องรอ — มันคือเส้นทาง self-host ที่สมจริงในเจเนอเรชันนี้ และการปล่อยตัวของมันตอนนี้กลายเป็นคำถามเปิด มากกว่าวันที่ตายตัว

สัปดาห์ที่สัญญาไว้ใกล้จะหมดลงแล้ว และครึ่งหนึ่งของสิ่งที่สัญญาไว้ก็ยังมาไม่ถึง Qwen3.8-2.4T-A95B ดาวน์โหลดได้ มีใบอนุญาต และพร้อมให้บริการแล้ว ส่วน Qwen3.8-27B ได้รับการยืนยันว่ามีอยู่จริง ยังคงมุ่งมั่นที่จะเปิดเผยน้ำหนัก (open weights) แต่ก็ยังไม่มี repository ใบอนุญาต benchmark หรือกำหนดการใหม่ให้เห็น จับตาดูว่า repo ของ 27B จะออกมาก่อนที่สัปดาห์ที่สัญญาไว้จะสิ้นสุดลงหรือไม่ ไฟล์ใบอนุญาตของมันจะเขียนว่าอย่างไรเมื่อเทียบกับของ Max และการประเมินผลอิสระครั้งแรกจะให้คะแนนมันเท่าใด สัญญาณทั้งสามนี้จะบอกคุณว่านี่คือการปล่อยโมเดลแบบเปิดน้ำหนักสองขั้นตอนตามปกติที่โมเดลเล็กกว่ายังมาไม่ถึง หรือเป็นความล่าช้าที่ควรวางแผนรองรับ

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube