
Qwen3.8-27B เปิดเผยน้ำหนัก: Max ถูกปล่อยออกมา แต่ 27B ไม่ได้ถูกปล่อย — สิ่งที่เรารู้ตอนนี้
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 36 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 181 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
เมื่อวันที่ 13 สิงหาคม 2026 สัปดาห์ปล่อยน้ำหนักแบบเปิดที่ Alibaba สัญญาไว้สำหรับเจนเนอเรชัน Qwen3.8 ถูกแบ่งออกเป็นสองส่วน น้ำหนักของรุ่นเรือธงระดับ Max — Qwen3.8-2.4T-A95B, โมเดล sparse mixture-of-experts ที่มีพารามิเตอร์ 2.4 ล้านล้าน และเป็นการเปิดตัว Qwen ระดับ Max ครั้งแรกที่สามารถดาวน์โหลดได้ — เปิดตัวจริงบน Hugging Face และ ModelScope โดยมีการประกาศเมื่อคืนก่อนผ่านชุมชน ModelScope โมเดลขนาดเล็กกว่าที่หน้านี้กล่าวถึงคือ Qwen3.8-27B, ไม่ได้ปล่อยออกมา: ถูกกำหนดให้ปล่อยในสัปดาห์เดียวกันของวันที่ 10 สิงหาคม แต่ก็ยังไม่มี repository อย่างเป็นทางการ, model card, ไฟล์ใบอนุญาต หรือ benchmark ของตัวเอง และตัวติดตามจากบุคคลที่สามต่างก็ระบุว่าการเปิดตัวล่าช้าโดยไม่มีการกำหนดวันใหม่ คำถามที่หน้านี้ซึ่งรวบรวมข้อมูลเท่าที่รู้ถูกสร้างขึ้นเพื่อตอบ — "เมื่อไหร่ 27B จะปล่อยจริง ๆ?" — กลายเป็นสองคำถาม: ทำไมน้ำหนักของ Max ถึงปล่อยก่อน และเกิดอะไรขึ้นกับ 27B?
บทความชิ้นนี้ยังคงเป็นบทสรุปสิ่งที่เรารู้เท่าที่ทราบ ณ ตอนนี้ ไม่ใช่รีวิว Qwen3.8-Max ซึ่งเป็น API ระดับเรือธง เปิดให้ใช้งานแล้วตั้งแต่วันที่ 3 สิงหาคม ในราคา $2/$6 ต่อล้านโทเคน; โมเดลฐานแบบเปิดน้ำหนักที่อยู่เบื้องหลังคือ Qwen3.8-2.4T-A95B เปิดให้ดาวน์โหลดได้เมื่อวันที่ 13 สิงหาคม; และน้ำหนักของ Qwen3.8-27B ยังไม่ได้เผยแพร่ ข้อกล่าวอ้างทุกข้อด้านล่างถูกระบุว่า ยืนยันแล้ว รายงานโดยผู้ขาย หรือคาดการณ์โดยชุมชน ตามความเหมาะสม
สัญญาณ และสิ่งที่เกิดขึ้นจริงในสัปดาห์นี้
สัญญาณแรกคือโพสต์บน X โดย @kimmonismus ที่ชี้ว่า "สัปดาห์หน้า" เป็นสัปดาห์ที่ต้องจับตา: "Qwen-3.8 27b - Grok 4.6" โดยที่ Astra หายไปจากรายการอย่างเห็นได้ชัด ครึ่งหนึ่งของ Grok ในสัปดาห์นั้นเปิดตัวเมื่อวันที่ 12 สิงหาคม ครึ่งหนึ่งของ Qwen แยกออกเป็นสองส่วน สิ่งที่โพสต์จับได้คืออารมณ์ของผู้คนที่เฝ้าดูการเปิดตัวโมเดลเป็นอาชีพ — การปล่อย open-weights ของ Qwen3.8 เป็นอีเวนต์ในปฏิทิน และสัปดาห์นั้นมาถึงโดยที่รายละเอียดยังไม่ถูกกำหนดแน่นอน หนึ่งสัปดาห์ต่อมา รายละเอียดบางส่วนก็กระจ่างขึ้น: หนึ่งในการปล่อย open-weights ที่สัญญาไว้ทั้งสองได้ออกมาแล้ว และไม่ใช่ตัวที่โพสต์นั้นกล่าวถึง
ยืนยันแล้วอะไรบ้าง
• ตระกูลนี้มีจริงและประกาศอย่างเป็นทางการแล้ว Alibaba เปิดตัวตระกูลโมเดลพื้นฐาน Qwen3.8 เมื่อวันที่ 3 สิงหาคม 2026 หลังจากการเปิดตัวรอบพรีวิวในกลางเดือนกรกฎาคม
• Qwen3.8-Max เปิดตัวในวันเดียวกัน เรือธงของ API ซึ่งเป็นโมเดล mixture-of-experts ที่มีพารามิเตอร์ 2.4 ล้านล้านตัว โดยมีพารามิเตอร์ที่ใช้งานอยู่ประมาณ 95 พันล้านตัว หน้าต่างบริบท 1 ล้านโทเค็น และรองรับอินพุตทั้งข้อความ รูปภาพ และวิดีโอ — เปิดให้บริการบน Qwen API ในราคา $2/$6 ต่อล้านโทเค็น นอกจากนี้ยังมีให้ใช้งานผ่าน OrcaRouter ในราคาประกาศเดียวกัน โดยส่งผ่านโดยคิดมาร์กอัป 0%
• The Max ปล่อย open weights เมื่อวันที่ 13 สิงหาคม. Qwen3.8-2.4T-A95B — โมเดลพื้นฐานที่ใช้สร้าง Qwen3.8-Max API — เปิดให้ดาวน์โหลดได้จาก Hugging Face และ ModelScope พร้อมเวอร์ชันควอนไทซ์ FP8 ควบคู่กันไป นี่คือการปล่อย open weights ระดับ Max ครั้งแรกของ Qwen เท่าที่เคยมีมา โมเดลที่ดาวน์โหลดได้นี้เป็นแบบข้อความเท่านั้น โดยเปิดโหมดคิด (thinking mode) ไว้บังคับ มีบริบท native ขนาด 256K โทเคน ซึ่งขยายได้ถึงประมาณ 1M และปรับใช้ได้บน SGLang, vLLM และ TokenSpeed
• Qwen3.8-27B เป็นโมเดลน้ำหนักเปิดขนาดเล็กของตระกูล — ยังไม่เผยแพร่Alibaba วางตำแหน่งให้เป็นเส้นทางที่สมจริงสำหรับการติดตั้งในพื้นที่ (local) และภายในองค์กร (on-premise) และให้คำมั่นว่าจะเผยแพร่น้ำหนักของมันบน Hugging Face และ ModelScope พร้อมกับของ Max ณ วันที่ 13 สิงหาคม ยังไม่มี repository อย่างเป็นทางการของ Qwen3.8-27B คำมั่นสัญญานั้นเป็นจริง แต่การส่งมอบยังไม่เกิดขึ้น
• คะแนนอิสระแรกของเจนเนอเรชันนี้มีออกมาแล้ว Artificial Analysis จัดอันดับ Qwen3.8-Max ที่ Intelligence Index 56 ที่ราคาประมาณ $1.14 ต่องาน — ดีจริงๆ แต่ก็มีข้อควรระวังตามปกติของเรือธงที่เพิ่งเปิดตัวไม่กี่วัน
สิ่งที่เรารู้จริงๆ เกี่ยวกับ 27B
การสรุปอย่างตรงไปตรงมาก็คือว่า "Qwen3.8-27B" ยังคงเป็นเพียงชื่อและจำนวนพารามิเตอร์เป็นหลัก ข้อเท็จจริงที่ยืนยันได้คือ มันเป็นโมเดลที่มีพารามิเตอร์ประมาณ 27 พันล้านตัว เป็นสมาชิกแบบ open-weights ของรุ่น Qwen3.8 และถูกออกแบบมาสำหรับงานบน GPU ตัวเดียวและภายในองค์กร มากกว่าจะเป็นคลัสเตอร์ GPU หลายร้อยตัว Daniel Han จาก Unsloth รายงานว่ามันควรจะพอดีกับ VRAM ประมาณ 17GB เมื่อเปิดตัว — การ์ดระดับโปรซูเมอร์ตัวเดียว
สิ่งอื่นๆ ยังไม่ได้รับการยืนยัน Alibaba ยังไม่ได้เปิดเผยว่า 27B เป็นโมเดลแบบ dense หรือแบบ mixture-of-experts, ขนาด context window เท่าใด, รองรับ input ประเภทใดบ้าง หรือคะแนน benchmark ของตัวเอง สิ่งที่เปลี่ยนไปในสัปดาห์นี้คือกำหนดเวลา: มีการสัญญาว่า Max และ 27B จะเปิดตัวในสัปดาห์เดียวกัน แต่มีเพียง Max เท่านั้นที่มาถึง ตัวติดตามจากบุคคลที่สามรายงานว่า 27B ล่าช้าโดยไม่มีกำหนดการใหม่ ซึ่งเป็นการคาดการณ์ของชุมชน ไม่ใช่คำแถลงอย่างเป็นทางการจาก Alibaba และเป็นไปได้ที่ตัว repo จะยังเผยแพร่ออกมาก่อนสิ้นสุดสัปดาห์ที่สัญญาไว้ แต่ ณ เวลาที่เขียนนี้ องค์กร Qwen อย่างเป็นทางการบน Hugging Face ยังไม่มีการระบุ Qwen3.8-27B และคลัง (repositories) เพียงไม่กี่แห่งที่ค้นพบ เช่น "Qwen3.8-27B-FP8", "-GGUF" และ "-MLX" ที่ปรากฏในการค้นหาล้วนเป็นการ์ดตัวแทนจากชุมชนซึ่งมีจำนวนดาวน์โหลดเพียงหลักเดียว ไม่ใช่เวอร์ชันเปิดตัวอย่างเป็นทางการ
จุดอ้างอิงที่มีประโยชน์ยังคงเป็น 27B ของเจนเนอเรชันก่อนหน้า นั่นคือ Qwen3.5-27B โมเดลแบบ dense แบบเปิดน้ำหนัก (open-weight) ที่มีหน้าต่างบริบท 32K ซึ่งเป็นเกณฑ์ขั้นต่ำที่สมเหตุสมผลที่ Qwen3.8-27B จะต้องเอาชนะให้ได้ และเป็นเครื่องเตือนใจว่าโมเดลระดับ 27B ของ Qwen ถูกออกแบบมาให้รันบนฮาร์ดแวร์ที่นักพัฒนาเป็นเจ้าของจริงมาโดยตลอด
Max เป็นจุดอ้างอิงสำหรับสิ่งที่ 27B อาจได้รับสืบทอด

{{1}}27B จะไม่เทียบชั้นกับเพดานดิบของ Max ได้ แต่ตัวเลขของ Max — ซึ่งตอนนี้เผยแพร่ในการ์ดโมเดลจริง — ได้กำหนดความคาดหวังว่าการพัฒนาของเจนเนอเรชันนี้มีหน้าตาแบบไหน ในการประเมินของ Alibaba เองสำหรับโมเดลโอเพนเวต Qwen3.8-2.4T-A95B ได้คะแนน 93.0 บน PaperBench, 86.1 บน OSworld-Verified, 91.5 บน parametric CAD, 67.7 บน SWE-bench Pro และ 86.6 บน Terminal-Bench 2.1 โดยผู้พัฒนาอ้างว่ามีระดับเทียบเท่า Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol และ Gemini 3.1 Pro{{/1}} {{2}}ตัวเลขเหล่านี้เป็นข้อมูลที่รายงานโดยผู้พัฒนา ตีพิมพ์ในเอกสารเผยแพร่ และยังไม่มีการตรวจสอบซ้ำโดยห้องแล็บอิสระ{{/2}} {{3}}การเพิ่มประสิทธิภาพแบบ agentic ที่การเปิดตัว API อ้างไว้ — FrontierSWE กระโดดจาก 40.7 เป็น 73.5 ในเจนเนอเรชันเดียว — ปรากฏอยู่ในเอกสารเผยแพร่ชุดเดียวกัน{{/3}} {{4}}หากการปรับปรุงส่วนนั้นแม้เพียงบางส่วนไหลลงมายัง 27B มันจะนิยามความหมายของ "โมเดลโค้ดท้องถิ่นที่ดี" ในคลาสของมันใหม่ทั้งหมด{{/4}}
รายละเอียดหนึ่งที่ควรจำไว้: Max ที่ดาวน์โหลดได้ไม่เหมือนกับ Max ใน API ทุกประการ Qwen3.8-2.4T-A95B เป็นแบบข้อความเท่านั้นและบังคับเปิดโหมดคิด ในขณะที่ Qwen3.8-Max API เพิ่มการรับภาพ โหมดไม่คิด และบริบทเริ่มต้นที่ 1M โทเค็น ช่องว่างนี้คือสิ่งที่รุ่น 27B มีแนวโน้มจะสืบทอดมา — และควรจดจำไว้เมื่อคุณอ่านพาดหัวข่าวเกณฑ์มาตรฐาน "Qwen3.8" โดยไม่ตรวจสอบว่ารุ่นใดถูกอธิบาย
จุดที่ Max แข็งแกร่งที่สุดคือเรื่องราคา: $2/$6 ต่อล้านโทเคนสำหรับคอนเท็กซ์ทั้งหมด 1M โทเคนบน API โดยไม่มีค่าธรรมเนียมเพิ่มเติมสำหรับพรอมป์ยาว นี่เป็นราคาเชิงรุกสำหรับ API ระดับแนวหน้า และมันสำคัญต่อการคำนวณเส้นทาง — ด้วยตัวเลขเหล่านี้ เจนเนอเรชัน 3.8 กลายเป็นตัวเลือกสำหรับงานที่เคยใช้เรือธงราคาแพงกว่าเป็นค่าเริ่มต้น
อะไรที่สามารถรันมันได้จริง

สำหรับ 27B อาลีบาบายังไม่ได้เผยแพร่ข้อกำหนดด้านฮาร์ดแวร์ ดังนั้นตัวเลขที่หมุนเวียนอยู่จึงยังคงเป็นการคาดการณ์ของชุมชนโดยอิงจากตารางควอนไทเซชัน Qwen 3.6-27B — เป็นการประมาณ ไม่ใช่ข้อมูลจำเพาะ ช่วงการทำงานที่คนส่วนใหญ่ใช้วางแผนยังคงไม่เปลี่ยนแปลง:
• Q4_K_M quant, VRAM ~16GB — RTX 4090 หรือการ์ดเทียบเท่า ซึ่งเป็นจุดที่ลงตัวที่สุดที่นักพัฒนาส่วนใหญ่ที่รันโมเดลในเครื่องของตัวเองจะเลือกใช้
• Q3_K_M quant, ~13GB VRAM — พอดีกับการ์ด 12GB เช่น RTX 3060 ที่คุณภาพลดลง
• Q6_K quant, ~21GB VRAM — แทบไม่สูญเสียข้อมูลบนการ์ดจอ 24GB.
• การให้บริการ FP8, VRAM ~27GB — ใช้ L40S ตัวเดียว ตามที่คาดการณ์ไว้ก่อนหน้านี้ สำหรับการอนุมานระดับโปรดักชัน.
• ความแม่นยำเต็มรูปแบบ, H100 80GB — เส้นทางคุณภาพระดับ benchmark และไม่ใช่สิ่งที่ทีมส่วนใหญ่จะรัน.
ประเด็นใหม่คือข้อความที่ว่า “ตอนนี้คุณสามารถโฮสต์โมเดลตระกูล Qwen3.8 ด้วยตัวเองได้แล้ว” นั้นเป็นความจริง แต่ไม่ใช่สำหรับโมเดลที่ผู้คนวางแผนจะใช้กัน Max มี open weights ที่อยู่คนละคลาสฮาร์ดแวร์โดยสิ้นเชิง: โมเดล BF16 แบบความแม่นยำเต็มมีขนาดประมาณ 4.9TB และเทคนิค 1-bit layered selective quantization ของ Unsloth ทำให้เหลือประมาณ 397GB — รันได้ แต่ต้องมี RAM และ VRAM รวมกันอย่างน้อย 410GB เท่านั้น นั่นคือโครงสร้างพื้นฐานระดับจริงจัง ไม่ใช่การ์ดระดับโปรซูเมอร์ และมันคือช่องว่างที่ 27B ถูกสร้างขึ้นมาเพื่อเติมเต็มพอดี ซึ่งการที่ 27B ยังคงหายไปจึงเป็นเหตุผลที่เส้นทางการรันบนเครื่องตัวเองด้วย GPU ตัวเดียวสำหรับเจนเนอเรชันนี้ยังไม่มีอยู่จริง
คำถามเรื่องใบอนุญาต: Max เพิ่งวางบรรทัดฐานเอาไว้
คำถามเกี่ยวกับใบอนุญาตสำหรับ 27B ยังคงไม่มีคำตอบ แต่ภาพว่า "มันจะมีหน้าตาแบบไหน" ไม่ใช่การคาดเดาอีกต่อไป โอเพนเวตของ Max ถูกเผยแพร่ภายใต้ใบอนุญาตแบบกำหนดเองที่ระบุว่า "qwen3.8-max" — ไม่ใช่ Apache 2.0 ตามที่รายงานจาก model card โดยทั่วไปแล้วใช้ฟรีสำหรับการใช้เชิงพาณิชย์และการโฮสต์ แต่จะทำให้เกิดข้อกำหนดเพิ่มเติมเมื่อใช้งานในระดับใหญ่: ผลิตภัณฑ์ที่มีผู้ใช้งานรายเดือนมากกว่า 100 ล้านคน หรือมีรายได้ต่อเดือนมากกว่า 20 ล้านดอลลาร์สหรัฐ ต้องแสดงชื่อโมเดล และบริษัทที่มีรายได้ต่อปีมากกว่า 50 ล้านดอลลาร์สหรัฐที่ให้บริการ model-as-a-service หรือบริการผู้ช่วยทำงานด้วย AI จำเป็นต้องมีใบอนุญาตแยกต่างหาก ข่าวลือที่แพร่หลายว่าใบอนุญาตห้ามใช้ในสหรัฐฯ สหภาพยุโรป สหราชอาณาจักร และเกาหลี เป็นเท็จ — ใบอนุญาตไม่มีข้อจำกัดด้านอาณาเขต
สำหรับ 27B โดยเฉพาะ ยังไม่มีการระบุใบอนุญาต แต่ Max เปิดตัวภายใต้ใบอนุญาต Qwen แบบกำหนดเอง ไม่ใช่ Apache 2.0 ซึ่งทำให้การสันนิษฐานว่าเป็น Apache 2.0 สำหรับโมเดลพี่น้องด้วยนั้นไม่ดีนัก ใบอนุญาต Tongyi Qianwen แบบเก่า — ที่มีเงื่อนไขผู้ใช้รายเดือน 100 ล้านคน — ไม่ใช่สิ่งที่ Max ได้รับ ใบอนุญาตของ Max เป็นใบอนุญาตแบบแบ่งระดับตามขนาดแบบใหม่ อ่านไฟล์ LICENSE ในที่เก็บจริงก่อนที่คุณจะวางแผนโดยอิงจากมัน และคาดว่าใบอนุญาตของ 27B จะถูกตัดสินใจเมื่อที่เก็บของมันถูกปล่อยออกมาเท่านั้น
จังหวะของ Toolchain: การสนับสนุนตั้งแต่วันแรกเพิ่งได้รับการพิสูจน์แล้ว
เซิร์ฟวิ่งเอนจินทำงานได้เร็วตามที่คาดหวัง — สำหรับโมเดลที่เปิดตัวไป Qwen3.8-2.4T-A95B เปิดตัวพร้อมรองรับการทำงานใน SGLang, vLLM และ TokenSpeed ซึ่งเป็นสิ่งที่ "ให้บริการผ่าน API ได้เกือบจะทันที" สำหรับโมเดล open-weights ขนาดใหญ่ สำหรับรุ่น 27B เอนจินเดียวกันนี้มีแนวโน้มมากที่สุดที่จะรองรับก่อน เมื่อ repo ของมันถูกเผยแพร่ และการรองรับวันแรกของ Max ทำให้การที่ 27B ได้รับการสืบทอดการสนับสนุนนั้นเป็นความคาดหวังที่สมเหตุสมผล การ quantize แบบ GGUF และ AWQ จากชุมชนมักจะล่าช้าอยู่หนึ่งถึงสองสัปดาห์ ดังนั้นประสบการณ์ "pull and run" แบบ Ollama คงจะยังไม่มีในวันเปิดตัวของ 27B — การตั้งค่า vLLM หรือ llama.cpp ด้วยตนเองน่าจะเป็นทางเลือกสำหรับการใช้งานในเครื่องก่อน
สิ่งที่ยังไม่รู้
บทความเปิดโปงที่ซื่อตรงจะหยุดอยู่ที่สิ่งที่เปิดเผยต่อสาธารณะจริง ๆ และขอบเขตนั้นกว้างกว่าเมื่อหนึ่งสัปดาห์ก่อนในทิศทางหนึ่ง และแคบลงในอีกทิศทางหนึ่ง: คำถามของ Max ได้รับคำตอบ ส่วนของ 27B ไม่ได้รับ
• วันที่เผยแพร่ใหม่. “สัปดาห์ของวันที่ 10 สิงหาคม” คือคำมั่นสัญญา; สัปดาห์ใกล้จะหมดลงแล้วและ repo ยังไม่ปรากฏ ตัวติดตามจากบุคคลที่สามรายงานความล่าช้าโดยไม่มีกำหนดการใหม่ แต่อาลีบาบาไม่ได้ออกแถลงการณ์อย่างเป็นทางการ
• สถาปัตยกรรม. Dense หรือ MoE สำหรับ 27B และหากเป็น MoE จำนวนพารามิเตอร์ที่ใช้งาน
• สเปกชีต หน้าต่างบริบท, โมดาลิตี้, ขีดจำกัดเอาต์พุต, โหมดการใช้เหตุผล
• เกณฑ์ชี้วัด. รุ่น 27B ไม่มีคะแนนอย่างเป็นทางการและการประเมินอิสระ
• ใบอนุญาต ยังไม่มีการตัดสินใจจนกว่า repository ของ 27B จะเผยแพร่; ใบอนุญาตแบบกำหนดเองของ Max คือบรรทัดฐานที่ต้องจับตามอง
• Mirror risk.ปัญหาตัวยึดตำแหน่ง (placeholder) ตอนนี้ปรากฏให้เห็นในโลกจริงแล้ว — การ์ดของชุมชน "Qwen3.8-27B-FP8", "-GGUF" และ "-MLX" มีอยู่จริงโดยไม่มีไฟล์ทางการใด ๆ จนกว่าองค์กร Qwen อย่างเป็นทางการจะเผยแพร่ repo ให้ดาวน์โหลดจากหน้าองค์กรอย่างเป็นทางการเท่านั้น
มันหมายความว่าอย่างไรสำหรับผู้สร้าง
การแบ่งทางปฏิบัติสำหรับรุ่น Qwen3.8 ตอนนี้เป็นสามทางแทนที่จะเป็นสองทาง หากคุณต้องการ API ระดับแนวหน้าในวันนี้ Qwen3.8-Max เปิดใช้งานผ่าน OrcaRouter ในราคาป้ายของ provider ที่ $2/$6 โดยส่งผ่านโดยคิด markup 0% — ราคาที่คุณเห็นคือราคาที่ Alibaba กำหนด หากคุณต้องการโฮสต์โมเดลระดับ Max ด้วยตัวเอง ตอนนี้ดาวน์โหลด open weights ได้แล้ว แต่คุณต้องมีฮาร์ดแวร์สำหรับโมเดล full-precision ประมาณ 4.9TB หรือโมเดล quantized ประมาณ 397GB และหากคุณต้องการการปรับใช้ local บน GPU เดียวที่รุ่นนี้ควรจะให้ได้ คุณยังต้องรอ Qwen3.8-27B ซึ่งยังไม่เปิดตัว คีย์เดียวที่เข้ากันได้กับ OpenAI ครอบคลุมฝั่ง API ในวันนี้ และเมื่อ hosting ของ 27B ลงตัว คีย์เดียวกันนี้ก็สามารถ route ไปยังมันได้

ส่วนสุดท้ายนั้นคือประเด็นในภาพกว้าง และนี่คือสิ่งที่การปล่อยโมเดล open-weight ที่ล่าช้าและยังไม่ผ่านการพิสูจน์เป็นกรณีทดสอบพอดี โมเดลที่ยังไม่เปิดตัวเลยย่อมไม่มีประวัติผลงาน ไม่มีชุด benchmark อิสระ และไม่มีประวัติเหตุการณ์ — และเมื่อมันมาถึงจริง มันก็จะเป็นของใหม่ทั้งหมด การ routing คือวิธีที่คุณลองใช้มันโดยไม่ต้องเดิมพันกับเส้นทางที่ลูกค้าเห็น: ส่งทราฟฟิกที่รับความไม่แน่นอนได้ไปให้มัน สลับกลับไปใช้โมเดลที่พิสูจน์แล้วโดยอัตโนมัติเมื่อมันทำผิดพลาด และย้ายทั้งเวิร์กโหลดเมื่อมันได้รับความไว้วางใจแล้ว ชั้น routing ยังทำให้การคิดราคาโปร่งใส — เมื่อ Alibaba ลดราคาโมเดลที่คุณเรียกใช้ผ่านเอนด์พอยต์เดียว การเปลี่ยนแปลงจะมีผลทันทีในวันเดียวกัน เพราะราคาที่ประกาศถูกส่งผ่านตรงๆ
ดูอะไรดี
• ไม่ว่า repo ของ 27B จะปรากฏขึ้นหรือไม่ก็ตาม. การมีรายการอยู่ภายใต้องค์กร Qwen อย่างเป็นทางการบน Hugging Face หรือ ModelScope คือเหตุการณ์ที่จะยุติความล่าช้า — และสัปดาห์ของวันที่ 10 สิงหาคมก็เกือบจะสิ้นสุดลงโดยไม่มีรายการดังกล่าว.
• ไฟล์สัญญาอนุญาตของ 27B Max มาพร้อมกับสัญญาอนุญาตแบบปรับระดับตามขนาดการใช้งานที่กำหนดขึ้นเอง (custom scale-tiered license) ไม่ใช่ Apache 2.0 การที่ 27B จะทำตามแบบอย่างนั้นหรือไม่ ถือเป็นบรรทัดเดียวที่ส่งผลกระทบมากที่สุดในประกาศที่จะออกมาในที่สุด
• สถาปัตยกรรมและความยาวบริบท Dense เทียบกับ MoE และหน้าต่างบริบทเป็นตัวกำหนดว่าตัว 27B ใช้ทำอะไร
• เกณฑ์มาตรฐานอิสระครั้งแรก คะแนน 56 ของ Max บน Artificial Analysis Intelligence Index เป็นตัวกำหนดมาตรฐานไว้ การประเมินภายนอกครั้งแรกของ 27B จะบอกคุณว่าข้อได้เปรียบของเจนเนอเรชันนี้จะอยู่รอดได้มากเพียงใดในขนาดสำหรับผู้บริโภค
• ความครอบคลุมของ Toolchain ว่า 27B จะได้รับการรองรับ SGLang/vLLM/TokenSpeed ตั้งแต่วันแรกเหมือนกับ Max หรือไม่ และชุมชนจะตามมาด้วย quantization ได้เร็วแค่ไหน
คำถามที่พบบ่อย
Qwen3.8-27B เปิดตัวแล้วหรือยัง?
ไม่ Alibaba ประกาศเมื่อวันที่ 3 สิงหาคม 2026 และให้คำมั่นเรื่องน้ำหนักโมเดลกับ Hugging Face และ ModelScope สำหรับสัปดาห์ของวันที่ 10 สิงหาคม แต่ ณ วันที่ 13 สิงหาคม ยังไม่มี repository อย่างเป็นทางการของ Qwen3.8-27B, model card หรือใบอนุญาต น้ำหนักโมเดลแบบเปิดระดับ Max — Qwen3.8-2.4T-A95B — เผยแพร่เมื่อวันที่ 13 สิงหาคม ส่วนตัว 27B ไม่ได้เผยแพร่ และผู้ติดตามบุคคลที่สามรายงานว่าล่าช้าโดยไม่มีกำหนดใหม่
ต้องใช้ฮาร์ดแวร์อะไรบ้างในการรัน Qwen3.8-27B?
ยังไม่ได้รับการยืนยัน แต่การคาดการณ์จากชุมชนโดยอิงตามตาราง quant ของ {{1}}Qwen 3.6-27B{{/1}} ประเมินว่า quant แบบ Q4_K_M ใช้ VRAM ประมาณ {{2}}16GB (การ์ด RTX 4090){{/2}}, quant แบบ Q3_K_M ใช้ประมาณ {{3}}13GB (การ์ด 12GB){{/3}}, quant แบบ Q6_K ใช้ประมาณ {{4}}21GB (การ์ด 24GB){{/4}} และการ serve แบบ FP8 ใช้ประมาณ {{5}}27GB (L40S หนึ่งตัว){{/5}} Daniel Han จาก Unsloth รายงานว่าอยู่ที่ประมาณ 17GB ในตอนเปิดตัว ให้ถือว่าตัวเลขเหล่านี้เป็นเพียง{{6}}การประมาณการ{{/6}}จนกว่า{{7}}โมเดลการ์ดอย่างเป็นทางการ{{/7}}จะเผยแพร่คำแนะนำด้านฮาร์ดแวร์
Qwen3.8-27B มีให้ใช้งานผ่าน OrcaRouter หรือไม่
ยัง Qwen3.8-27B เป็นโมเดลแบบเปิดน้ำหนัก (open-weight) ที่โฮสต์เองได้ และในขณะนี้ยังไม่มีบนแพลตฟอร์ม เรือธงของตระกูลเดียวกัน — Qwen3.8-Max — พร้อมใช้งานแล้วผ่าน OrcaRouter ในราคารายการของผู้ให้บริการที่ $2/$6 ต่อล้านโทเคน โดยไม่มีมาร์กอัป และเมื่อการโฮสต์ 27B ลงตัวแล้ว ก็สามารถเพิ่มเข้ากับคีย์ที่เข้ากับ OpenAI ได้เหมือนกัน
ฉันควรรอ Qwen3.8-27B หรือใช้ Qwen3.8-Max วันนี้?
ขึ้นอยู่กับว่าเวิร์กโหลดรันที่ไหน หากคุณต้องการ frontier API ในตอนนี้ Qwen3.8-Max เปิดให้บริการแล้วและตั้งราคาไว้ aggressively ที่ $2/$6 ต่อล้านโทเคน หากคุณต้องการ self-host โมเดลคลาส Max ในวันนี้ Qwen3.8-2.4T-A95B ดาวน์โหลดได้แล้ว แต่ต้องใช้ฮาร์ดแวร์ระดับจริงจัง — ประมาณโมเดล full-precision 4.9TB หรือประมาณ 397GB แบบ quantized พร้อม RAM และ VRAM รวมกัน 410GB+ ขึ้นไป หากคุณต้องการโมเดล local หรือ on-premise บนการ์ด consumer ตัวเดียว Qwen3.8-27B ยังคงเป็นตัวที่ต้องรอ — มันคือเส้นทาง self-host ที่สมจริงในเจเนอเรชันนี้ และการปล่อยตัวของมันตอนนี้กลายเป็นคำถามเปิด มากกว่าวันที่ตายตัว
สัปดาห์ที่สัญญาไว้ใกล้จะหมดลงแล้ว และครึ่งหนึ่งของสิ่งที่สัญญาไว้ก็ยังมาไม่ถึง Qwen3.8-2.4T-A95B ดาวน์โหลดได้ มีใบอนุญาต และพร้อมให้บริการแล้ว ส่วน Qwen3.8-27B ได้รับการยืนยันว่ามีอยู่จริง ยังคงมุ่งมั่นที่จะเปิดเผยน้ำหนัก (open weights) แต่ก็ยังไม่มี repository ใบอนุญาต benchmark หรือกำหนดการใหม่ให้เห็น จับตาดูว่า repo ของ 27B จะออกมาก่อนที่สัปดาห์ที่สัญญาไว้จะสิ้นสุดลงหรือไม่ ไฟล์ใบอนุญาตของมันจะเขียนว่าอย่างไรเมื่อเทียบกับของ Max และการประเมินผลอิสระครั้งแรกจะให้คะแนนมันเท่าใด สัญญาณทั้งสามนี้จะบอกคุณว่านี่คือการปล่อยโมเดลแบบเปิดน้ำหนักสองขั้นตอนตามปกติที่โมเดลเล็กกว่ายังมาไม่ถึง หรือเป็นความล่าช้าที่ควรวางแผนรองรับ
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
