
Qwen 4 Max เปิดตัวในงาน Apsara 2026: Alibaba ยืนยันอะไร และไม่ได้ยืนยันอะไร
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
งานประชุม Yunqi ที่หางโจว — Apsara Conference — ถูกใช้เมื่อวันที่ 22 กันยายน 2026 เพื่อแสดงโมเดลสี่ตัวที่ยังไม่วางจำหน่าย หัวหน้าฝ่าย LLM ของแล็บอย่าง Liu Da Yiheng ได้พรีวิว Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus และ Qwen 4 27B บนเวที อธิบายว่าตระกูลนี้ฝึกบนสถาปัตยกรรมรุ่นใหม่ และกล่าวเพียงว่าจะมาถึงในไม่ช้า ณ เวลาที่เขียนนี้ยังไม่มีโมเดลการ์ดสำหรับทั้งสี่ตัว ไม่มีน้ำหนักแบบเปิด ไม่มีตัวระบุ API ไม่มีหน้าต่างบริบท ไม่มีราคา และไม่มีคะแนนเบนช์มาร์ก เรือธงใหม่ล่าสุดที่คุณเรียกใช้ได้จริงวันนี้คือ Qwen3.8-Max ซึ่งพร้อมใช้งานทั่วไปตั้งแต่ 3 สิงหาคม 2026 และช่องว่างระหว่างการประกาศบนเวทีกับปลายทางที่เรียกใช้ได้นั่นคือส่วนของเรื่องนี้ที่ควรอ่านอย่างระมัดระวัง
สี่ระดับ และสิ่งที่แต่ละระดับนั้นควรจะเป็น
ตระกูล Qwen ของ Alibaba ถูกจัดเป็นระดับตามขีดความสามารถมาตั้งแต่รุ่น Qwen 3 และการประกาศเปิดตัว Qwen 4 ก็คงรูปแบบนั้นไว้แทนที่จะเปลี่ยนใหม่ สิ่งที่นำเสนอบนเวทีคือบัญชีรายชื่อ ไม่ใช่เอกสารสเปก:
• Qwen 4 Max — ระดับเรือธง และเป็นรุ่นที่ Alibaba วางตำแหน่งให้แข่งกับโมเดลชั้นนำจากทุกห้องปฏิบัติการแนวหน้าอื่น ๆ
• Qwen 4 Flash — ระดับที่ให้ปริมาณงานสูง สร้างมาเพื่องานที่ไวต่อความหน่วงและมีปริมาณมาก มากกว่าการใช้เหตุผลระดับสูงสุด
• Qwen 4 Plus — ระดับกลางที่สมดุล ซึ่งในอดีตเป็นรุ่นที่มีการรองรับมัลติโมดัลครอบคลุมกว้างขวางที่สุด
• Qwen 4 27B — ระดับท้องถิ่นแบบเปิดน้ำหนัก ตัวที่ถูกดาวน์โหลด ไฟน์จูน และควอนไทซ์โดยผู้ที่ไม่เคยแตะ API ที่โฮสต์
• สถาปัตยกรรม — ได้รับการอธิบายว่าเป็นเจเนอเรชันใหม่ และได้รับการอธิบายว่ากำลังอยู่ในระหว่างการฝึก ซึ่งไม่ใช่สิ่งเดียวกับการเสร็จสมบูรณ์
• ภาระงานหลัก — งานเชิงเอเจนต์และงานที่ใช้เครื่องมือ ตามกรอบของงานประชุม มากกว่าการแชท
• ความพร้อมใช้งาน — ไม่มี ไม่มีระดับใดที่มีวันวางจำหน่าย ราคา หน้าต่างบริบท รายการมอดาลิตี หรือคะแนนที่เผยแพร่
ระดับ 27B คือรุ่นที่ต้องจับตามอง ด้วยเหตุผลที่ไม่เกี่ยวข้องกับ benchmark เลยแม้แต่น้อย มันเป็นระดับเดียวในตระกูลที่ผ่านมาเปิดตัวภายใต้น้ำหนักแบบเปิด (open weights) และรุ่น Qwen 3.8 ก็แสดงให้เห็นว่าการเปิดเช่นนี้ปลดล็อกงานอิสระได้มากเพียงใด ภายในไม่กี่วันหลังจากน้ำหนัก 27B เปิดตัว ชุมชนก็ผลิต MLX conversions, การควอนไทซ์ NVFP4 และ fine-tune ที่ไม่มีการเซ็นเซอร์ออกมาแล้ว การประกาศ 27B จึงเป็นคำสัญญาของระบบนิเวศปลายน้ำทั้งหมด และเป็นส่วนของ roadmap นี้ที่มีการส่งมอบคาดการณ์ได้แม่นยำที่สุด
ตัวเลข 5 ถึง 10 ล้านล้านพารามิเตอร์ไม่ใช่ของ Qwen 4
การรายงานข่าวการประชุมครั้งนี้ยังไม่รัดกุมเกี่ยวกับตัวเลขหนึ่งตัว เป้าหมาย “5 ถึง 10 ล้านล้านพารามิเตอร์” ที่แพร่กระจายควบคู่ไปกับข่าว Qwen 4 ไม่ใช่สเปกของ Qwen 4 — แต่เป็นถ้อยแถลงที่มองไปข้างหน้าเกี่ยวกับรุ่นถัด ๆ ไปหลังจากนั้น ซึ่งอยู่ในกรอบเวลาของ Qwen 4.5 และ Qwen 5 Alibaba ยังไม่ได้ระบุจำนวนพารามิเตอร์ใด ๆ ให้กับ Qwen 4 Max และจากหลักฐานเท่าที่มีอยู่ การตีพิมพ์ตัวเลขดังกล่าวออกไปก็ถือเป็นความผิดพลาด
เรื่องนี้สำคัญเพราะจำนวนพารามิเตอร์เป็นตัวเลขที่ผู้อ่านยึดเป็นหลักและเป็นตัวเลขที่แพร่กระจายต่อไป คำกล่าวอ้างว่า 5T พารามิเตอร์ที่แนบมากับโมเดลซึ่งไม่มีสถาปัตยกรรมเผยแพร่ใด ๆ นั้นไม่อาจพิสูจน์ได้ว่าผิดทั้งสองทาง: ไม่มีใครยืนยันได้ และไม่มีใครแก้ไขได้เมื่อมันถูกพูดซ้ำแล้ว หากคุณเห็น Qwen 4 Max ถูกอธิบายว่าเป็นโมเดลที่มีพารามิเตอร์หลายล้านล้านตัวในสัปดาห์นี้ ตัวเลขนั้นถูกหยิบยืมมาจากสไลด์คนละชุด
สิ่งที่พูดได้อย่างตรงไปตรงมาคือ flagship รุ่นก่อนเป็น mixture-of-experts ขนาด 2.4 ล้านล้านพารามิเตอร์ โดยมีพารามิเตอร์ที่ใช้งานจริง 95 พันล้านพารามิเตอร์ต่อโทเคน ซึ่งยืนยันได้จาก model card อย่างเป็นทางการของ Qwen3.8-Max และจากการเปิดตัวเวอร์ชัน open-weight ที่ตามมา ไม่ว่า Qwen 4 Max จะออกมาเป็นอย่างไร นั่นคือมาตรฐานที่มันต้องเอาชนะ และมันเป็นตัวเลขที่เผยแพร่และตรวจสอบได้ ไม่ใช่ความมุ่งหวังใน roadmap

สถาปัตยกรรมนี้ไม่ใช่ข่าวลือ: ตัวอย่างของมันได้เปิดตัวแล้ว
สิ่งที่มีประโยชน์ที่สุดเกี่ยวกับการประกาศเปิดตัว Qwen 4 คือว่า ส่วนหนึ่งของสถาปัตยกรรมได้ถูกเปิดตัวไปแล้วภายใต้ชื่อที่แตกต่างออกไป Qwen3.8-Flash-Next ได้รับการเปิดโอเพนซอร์สในช่วงปลายเดือนสิงหาคม 2026 และโมเดลการ์ดของมันระบุไว้อย่างชัดเจนว่าเป็นพรีวิวของสถาปัตยกรรม Qwen 4 นั่นทำให้มันเป็นหลักฐานที่เป็นรูปธรรมเพียงหนึ่งเดียวที่ใครก็ตามภายนอกอาลีบาบามี เกี่ยวกับว่าตระกูล Qwen 4 ถูกสร้างขึ้นมาอย่างไร
มันเป็นโมเดลแบบสแปร์สที่มีพารามิเตอร์หลัก 125 พันล้านตัว บวกกับพารามิเตอร์ของ N-gram embeddings อีก 51 พันล้านตัว โดยเปิดใช้งานประมาณ 6 พันล้านตัวต่อขั้นตอนการอนุมาน มันมีบริบทเนทีฟขนาด 262,000 โทเคน ซึ่งการ์ดระบุว่าขยายได้ถึงราว 1 ล้าน และ Alibaba รายงานว่าฝึกด้วยต้นทุนต่ำกว่า Qwen3.7-Plus ประมาณ 90 เปอร์เซ็นต์ บนการ์ดระบุชื่อเทคนิคสามอย่าง:
• QSA ซึ่งเป็นรูปแบบกลไกความสนใจแบบเบาบางที่จำเพาะต่อ Qwen และเป็นกลไกเบื้องหลังข้ออ้างเรื่องการฝึกด้วยบริบทขนาดยาวในราคาประหยัด
• การเชื่อมต่อแบบเรซิดิวที่มีเกต ซึ่งเป็นมาตรวัดความเสถียรสำหรับเครือข่ายเบาบางเชิงลึก
• การฝังตัวแบบ N-gram ซึ่งเป็นที่เก็บพารามิเตอร์แยกต่างหากขนาด 51 พันล้านพารามิเตอร์ ที่ถูกค้นหาแทนที่จะคำนวณแบบหนาแน่น
หากระดับต่าง ๆ ของ Qwen 4 สืบทอดการออกแบบนั้น ผลลัพธ์ที่น่าสนใจจะอยู่ที่มิติเศรษฐกิจมากกว่ามิติสถาปัตยกรรม ตระกูลที่ออกแบบมาเพื่อไปถึงคุณภาพใกล้เคียงระดับแนวหน้า ด้วยต้นทุนการฝึกประมาณหนึ่งในสิบ ย่อมเป็นตระกูลที่สามารถตั้งราคาได้อย่างดุดัน และการตั้งราคาเชิงรุกจาก Alibaba ก็เป็นพลังที่เชื่อถือได้มากที่สุดเพียงหนึ่งเดียวในเศรษฐศาสตร์ของโมเดลแบบเปิดน้ำหนักมาตลอดสองปี นั่นคือการคาดการณ์ ไม่ใช่ข้อเท็จจริง และควรติดป้ายกำกับว่าเป็นเช่นนั้น — แต่มันคือเหตุผลที่ควรติดตามแผนงานนี้มากกว่าจะมองข้ามไป
ควรรันอะไรระหว่างรอ
ไม่มีสิ่งใดในประกาศ Qwen 4 ที่เปลี่ยนสิ่งที่พร้อมใช้งานในสัปดาห์นี้ และคำตอบที่ตรงไปตรงมาสำหรับใครก็ตามที่กำลังสร้างสิ่งต่าง ๆ ในวันนี้คือรุ่น Qwen 3.8 โดย Qwen3.8-Max เปิดให้ใช้งานทั่วไปตั้งแต่เมื่อวันที่ 3 สิงหาคม 2026 ในราคา 2.00 ดอลลาร์ต่อโทเคนอินพุต 1 ล้านโทเคน และ 6.00 ดอลลาร์ต่อโทเคนเอาต์พุต 1 ล้านโทเคน ในอัตราคงที่ตลอดบริบทขนาด 1 ล้านโทเคนเต็ม โดยไม่มีค่าธรรมเนียมเพิ่มสำหรับพรอมป์ต์ยาว และน้ำหนักของโมเดลได้รับการเผยแพร่เมื่อวันที่ 12 สิงหาคม 2026 ในชื่อ Qwen3.8-2.4T-A95B ทั้งในแบบ BF16 และ FP8 ภายใต้ลิขสิทธิ์ Qwen แบบกำหนดเอง มันคือโมเดลที่ระดับต่าง ๆ ของ Qwen 4 จะถูกนำมาเปรียบเทียบด้วย และขณะนี้กำลังให้บริการทราฟฟิกในโปรดักชันอยู่
หากคุณต้องการเปรียบเทียบ Qwen รุ่นที่วางจำหน่ายจริงกับโมเดลชั้นแนวหน้าอื่น ๆ โดยไม่ต้องจัดการบัญชี คีย์ และใบเรียกเก็บเงินแยกต่างหากสำหรับแต่ละแล็บ OrcaRouter ให้บริการตระกูล Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27B — ควบคู่ไปกับ Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview และ GLM 5.3 บนเอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI นั่นคือAPI เดียวสำหรับโมเดลเกือบ 200 รายการโดยบวกเพิ่ม 0% หมายความว่าราคาตามรายการของผู้ให้บริการจะถูกส่งผ่านไปโดยไม่ถูกแตะต้อง ดังนั้นเมื่อผู้ขายลดราคา ผลนั้นก็จะตกถึงคีย์ของคุณในวันเดียวกัน แทนที่จะเป็นรอบบิลถัดไป เมื่อใดก็ตามที่มีการเปิดตัวรุ่น Qwen 4 จริง แคตตาล็อกเดียวกันนี้คือที่ที่มันจะปรากฏขึ้น วันนี้ยังไม่มีรุ่นใดปรากฏเลย

สรุป
Qwen 4 Max เป็นการประกาศจริงและไม่ใช่ผลิตภัณฑ์จริง และทั้งสองส่วนของประโยคนั้นมีความสำคัญ รายชื่อได้รับการยืนยันแล้ว: สี่ระดับ สถาปัตยกรรมรุ่นใหม่ จุดเน้นแบบเอเจนติก และระดับ 27B แบบเปิดน้ำหนัก ที่จะมีความสำคัญต่อผู้คนจำนวนมากกว่าที่เรือธงจะเป็น ทุกสิ่งที่การตัดสินใจซื้อต้องการ — ราคา บริบท รูปแบบ น้ำหนัก คะแนน วันที่ — ยังขาดอยู่
ให้มองสิ่งนี้เป็นสัญญาณของ roadmap ที่มีร่องรอยเอกสารยืนยันดีเป็นพิเศษ เพราะการเปิดตัว Qwen3.8-Flash-Next ให้ตัวอย่างสถาปัตยกรรมแก่คุณฟรี และ Qwen3.8-Max ให้เส้นฐานของโมเดลที่ครองตำแหน่งอยู่ในปัจจุบันพร้อมน้ำหนักที่เผยแพร่และราคาที่ประกาศไว้ ติดตามระดับ 27B สำหรับระบบนิเวศที่มันจะสร้างขึ้น และระดับ Flash สำหรับเศรษฐศาสตร์ของ throughput อย่านำตัวเลข 5 ถึง 10 ล้านล้านพารามิเตอร์ไปเผยแพร่ซ้ำในฐานะข้อเท็จจริงของ Qwen 4 และอย่าวางแผนการโยกย้ายโดยอิงกับโมเดลที่ยังไม่มีวันเปิดตัว — ให้วางแผนโดยอิงกับ Qwen3.8-Max และค่อยย้ายเมื่อมีปลายทางให้ย้ายไป

การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
