การ์ดชื่อเรื่องแบบฮีโร่สำหรับ “Qwen 4 Max เปิดตัวที่ Apsara 2026” พร้อมคำโปรย “สิ่งที่ Alibaba ยืนยัน และสิ่งที่ไม่ได้ยืนยัน” ป้ายทรงแคปซูลสามป้ายที่อ่านว่า “พรีวิว 4 ระดับ”, “เผยแพร่สเปก 0 รายการ” และ “22 กันยายน 2026” และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

Qwen 4 Max เปิดตัวในงาน Apsara 2026: Alibaba ยืนยันอะไร และไม่ได้ยืนยันอะไร

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

งานประชุม Yunqi ที่หางโจว — Apsara Conference — ถูกใช้เมื่อวันที่ 22 กันยายน 2026 เพื่อแสดงโมเดลสี่ตัวที่ยังไม่วางจำหน่าย หัวหน้าฝ่าย LLM ของแล็บอย่าง Liu Da Yiheng ได้พรีวิว Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus และ Qwen 4 27B บนเวที อธิบายว่าตระกูลนี้ฝึกบนสถาปัตยกรรมรุ่นใหม่ และกล่าวเพียงว่าจะมาถึงในไม่ช้า ณ เวลาที่เขียนนี้ยังไม่มีโมเดลการ์ดสำหรับทั้งสี่ตัว ไม่มีน้ำหนักแบบเปิด ไม่มีตัวระบุ API ไม่มีหน้าต่างบริบท ไม่มีราคา และไม่มีคะแนนเบนช์มาร์ก เรือธงใหม่ล่าสุดที่คุณเรียกใช้ได้จริงวันนี้คือ Qwen3.8-Max ซึ่งพร้อมใช้งานทั่วไปตั้งแต่ 3 สิงหาคม 2026 และช่องว่างระหว่างการประกาศบนเวทีกับปลายทางที่เรียกใช้ได้นั่นคือส่วนของเรื่องนี้ที่ควรอ่านอย่างระมัดระวัง

สี่ระดับ และสิ่งที่แต่ละระดับนั้นควรจะเป็น

ตระกูล Qwen ของ Alibaba ถูกจัดเป็นระดับตามขีดความสามารถมาตั้งแต่รุ่น Qwen 3 และการประกาศเปิดตัว Qwen 4 ก็คงรูปแบบนั้นไว้แทนที่จะเปลี่ยนใหม่ สิ่งที่นำเสนอบนเวทีคือบัญชีรายชื่อ ไม่ใช่เอกสารสเปก:

• Qwen 4 Max — ระดับเรือธง และเป็นรุ่นที่ Alibaba วางตำแหน่งให้แข่งกับโมเดลชั้นนำจากทุกห้องปฏิบัติการแนวหน้าอื่น ๆ

• Qwen 4 Flash — ระดับที่ให้ปริมาณงานสูง สร้างมาเพื่องานที่ไวต่อความหน่วงและมีปริมาณมาก มากกว่าการใช้เหตุผลระดับสูงสุด

• Qwen 4 Plus — ระดับกลางที่สมดุล ซึ่งในอดีตเป็นรุ่นที่มีการรองรับมัลติโมดัลครอบคลุมกว้างขวางที่สุด

• Qwen 4 27B — ระดับท้องถิ่นแบบเปิดน้ำหนัก ตัวที่ถูกดาวน์โหลด ไฟน์จูน และควอนไทซ์โดยผู้ที่ไม่เคยแตะ API ที่โฮสต์

• สถาปัตยกรรม — ได้รับการอธิบายว่าเป็นเจเนอเรชันใหม่ และได้รับการอธิบายว่ากำลังอยู่ในระหว่างการฝึก ซึ่งไม่ใช่สิ่งเดียวกับการเสร็จสมบูรณ์

• ภาระงานหลัก — งานเชิงเอเจนต์และงานที่ใช้เครื่องมือ ตามกรอบของงานประชุม มากกว่าการแชท

• ความพร้อมใช้งาน — ไม่มี ไม่มีระดับใดที่มีวันวางจำหน่าย ราคา หน้าต่างบริบท รายการมอดาลิตี หรือคะแนนที่เผยแพร่

ระดับ 27B คือรุ่นที่ต้องจับตามอง ด้วยเหตุผลที่ไม่เกี่ยวข้องกับ benchmark เลยแม้แต่น้อย มันเป็นระดับเดียวในตระกูลที่ผ่านมาเปิดตัวภายใต้น้ำหนักแบบเปิด (open weights) และรุ่น Qwen 3.8 ก็แสดงให้เห็นว่าการเปิดเช่นนี้ปลดล็อกงานอิสระได้มากเพียงใด ภายในไม่กี่วันหลังจากน้ำหนัก 27B เปิดตัว ชุมชนก็ผลิต MLX conversions, การควอนไทซ์ NVFP4 และ fine-tune ที่ไม่มีการเซ็นเซอร์ออกมาแล้ว การประกาศ 27B จึงเป็นคำสัญญาของระบบนิเวศปลายน้ำทั้งหมด และเป็นส่วนของ roadmap นี้ที่มีการส่งมอบคาดการณ์ได้แม่นยำที่สุด

ตัวเลข 5 ถึง 10 ล้านล้านพารามิเตอร์ไม่ใช่ของ Qwen 4

การรายงานข่าวการประชุมครั้งนี้ยังไม่รัดกุมเกี่ยวกับตัวเลขหนึ่งตัว เป้าหมาย “5 ถึง 10 ล้านล้านพารามิเตอร์” ที่แพร่กระจายควบคู่ไปกับข่าว Qwen 4 ไม่ใช่สเปกของ Qwen 4 — แต่เป็นถ้อยแถลงที่มองไปข้างหน้าเกี่ยวกับรุ่นถัด ๆ ไปหลังจากนั้น ซึ่งอยู่ในกรอบเวลาของ Qwen 4.5 และ Qwen 5 Alibaba ยังไม่ได้ระบุจำนวนพารามิเตอร์ใด ๆ ให้กับ Qwen 4 Max และจากหลักฐานเท่าที่มีอยู่ การตีพิมพ์ตัวเลขดังกล่าวออกไปก็ถือเป็นความผิดพลาด

เรื่องนี้สำคัญเพราะจำนวนพารามิเตอร์เป็นตัวเลขที่ผู้อ่านยึดเป็นหลักและเป็นตัวเลขที่แพร่กระจายต่อไป คำกล่าวอ้างว่า 5T พารามิเตอร์ที่แนบมากับโมเดลซึ่งไม่มีสถาปัตยกรรมเผยแพร่ใด ๆ นั้นไม่อาจพิสูจน์ได้ว่าผิดทั้งสองทาง: ไม่มีใครยืนยันได้ และไม่มีใครแก้ไขได้เมื่อมันถูกพูดซ้ำแล้ว หากคุณเห็น Qwen 4 Max ถูกอธิบายว่าเป็นโมเดลที่มีพารามิเตอร์หลายล้านล้านตัวในสัปดาห์นี้ ตัวเลขนั้นถูกหยิบยืมมาจากสไลด์คนละชุด

สิ่งที่พูดได้อย่างตรงไปตรงมาคือ flagship รุ่นก่อนเป็น mixture-of-experts ขนาด 2.4 ล้านล้านพารามิเตอร์ โดยมีพารามิเตอร์ที่ใช้งานจริง 95 พันล้านพารามิเตอร์ต่อโทเคน ซึ่งยืนยันได้จาก model card อย่างเป็นทางการของ Qwen3.8-Max และจากการเปิดตัวเวอร์ชัน open-weight ที่ตามมา ไม่ว่า Qwen 4 Max จะออกมาเป็นอย่างไร นั่นคือมาตรฐานที่มันต้องเอาชนะ และมันเป็นตัวเลขที่เผยแพร่และตรวจสอบได้ ไม่ใช่ความมุ่งหวังใน roadmap

A two-column scoreboard titled "Qwen 4 Max vs the model you can call today". Left column Qwen 4 Max: Release date not given, Input price not given, Output price not given, Context window not given, Open weights not given, Benchmarks not given. Right column Qwen3.8-Max: Release date August 3 2026, Input price $2.00 per 1M tokens, Output price $6.00 per 1M tokens, Context window 1M tokens, Open weights published August 12 2026, Benchmarks vendor and independent. Footer reads "Qwen 4 Max status per Alibaba's September 22 2026 conference; Qwen3.8-Max from its published model card.", with the OrcaRouter logo bottom-right.

สถาปัตยกรรมนี้ไม่ใช่ข่าวลือ: ตัวอย่างของมันได้เปิดตัวแล้ว

สิ่งที่มีประโยชน์ที่สุดเกี่ยวกับการประกาศเปิดตัว Qwen 4 คือว่า ส่วนหนึ่งของสถาปัตยกรรมได้ถูกเปิดตัวไปแล้วภายใต้ชื่อที่แตกต่างออกไป Qwen3.8-Flash-Next ได้รับการเปิดโอเพนซอร์สในช่วงปลายเดือนสิงหาคม 2026 และโมเดลการ์ดของมันระบุไว้อย่างชัดเจนว่าเป็นพรีวิวของสถาปัตยกรรม Qwen 4 นั่นทำให้มันเป็นหลักฐานที่เป็นรูปธรรมเพียงหนึ่งเดียวที่ใครก็ตามภายนอกอาลีบาบามี เกี่ยวกับว่าตระกูล Qwen 4 ถูกสร้างขึ้นมาอย่างไร

มันเป็นโมเดลแบบสแปร์สที่มีพารามิเตอร์หลัก 125 พันล้านตัว บวกกับพารามิเตอร์ของ N-gram embeddings อีก 51 พันล้านตัว โดยเปิดใช้งานประมาณ 6 พันล้านตัวต่อขั้นตอนการอนุมาน มันมีบริบทเนทีฟขนาด 262,000 โทเคน ซึ่งการ์ดระบุว่าขยายได้ถึงราว 1 ล้าน และ Alibaba รายงานว่าฝึกด้วยต้นทุนต่ำกว่า Qwen3.7-Plus ประมาณ 90 เปอร์เซ็นต์ บนการ์ดระบุชื่อเทคนิคสามอย่าง:

• QSA ซึ่งเป็นรูปแบบกลไกความสนใจแบบเบาบางที่จำเพาะต่อ Qwen และเป็นกลไกเบื้องหลังข้ออ้างเรื่องการฝึกด้วยบริบทขนาดยาวในราคาประหยัด

• การเชื่อมต่อแบบเรซิดิวที่มีเกต ซึ่งเป็นมาตรวัดความเสถียรสำหรับเครือข่ายเบาบางเชิงลึก

• การฝังตัวแบบ N-gram ซึ่งเป็นที่เก็บพารามิเตอร์แยกต่างหากขนาด 51 พันล้านพารามิเตอร์ ที่ถูกค้นหาแทนที่จะคำนวณแบบหนาแน่น

หากระดับต่าง ๆ ของ Qwen 4 สืบทอดการออกแบบนั้น ผลลัพธ์ที่น่าสนใจจะอยู่ที่มิติเศรษฐกิจมากกว่ามิติสถาปัตยกรรม ตระกูลที่ออกแบบมาเพื่อไปถึงคุณภาพใกล้เคียงระดับแนวหน้า ด้วยต้นทุนการฝึกประมาณหนึ่งในสิบ ย่อมเป็นตระกูลที่สามารถตั้งราคาได้อย่างดุดัน และการตั้งราคาเชิงรุกจาก Alibaba ก็เป็นพลังที่เชื่อถือได้มากที่สุดเพียงหนึ่งเดียวในเศรษฐศาสตร์ของโมเดลแบบเปิดน้ำหนักมาตลอดสองปี นั่นคือการคาดการณ์ ไม่ใช่ข้อเท็จจริง และควรติดป้ายกำกับว่าเป็นเช่นนั้น — แต่มันคือเหตุผลที่ควรติดตามแผนงานนี้มากกว่าจะมองข้ามไป

ควรรันอะไรระหว่างรอ

ไม่มีสิ่งใดในประกาศ Qwen 4 ที่เปลี่ยนสิ่งที่พร้อมใช้งานในสัปดาห์นี้ และคำตอบที่ตรงไปตรงมาสำหรับใครก็ตามที่กำลังสร้างสิ่งต่าง ๆ ในวันนี้คือรุ่น Qwen 3.8 โดย Qwen3.8-Max เปิดให้ใช้งานทั่วไปตั้งแต่เมื่อวันที่ 3 สิงหาคม 2026 ในราคา 2.00 ดอลลาร์ต่อโทเคนอินพุต 1 ล้านโทเคน และ 6.00 ดอลลาร์ต่อโทเคนเอาต์พุต 1 ล้านโทเคน ในอัตราคงที่ตลอดบริบทขนาด 1 ล้านโทเคนเต็ม โดยไม่มีค่าธรรมเนียมเพิ่มสำหรับพรอมป์ต์ยาว และน้ำหนักของโมเดลได้รับการเผยแพร่เมื่อวันที่ 12 สิงหาคม 2026 ในชื่อ Qwen3.8-2.4T-A95B ทั้งในแบบ BF16 และ FP8 ภายใต้ลิขสิทธิ์ Qwen แบบกำหนดเอง มันคือโมเดลที่ระดับต่าง ๆ ของ Qwen 4 จะถูกนำมาเปรียบเทียบด้วย และขณะนี้กำลังให้บริการทราฟฟิกในโปรดักชันอยู่

หากคุณต้องการเปรียบเทียบ Qwen รุ่นที่วางจำหน่ายจริงกับโมเดลชั้นแนวหน้าอื่น ๆ โดยไม่ต้องจัดการบัญชี คีย์ และใบเรียกเก็บเงินแยกต่างหากสำหรับแต่ละแล็บ OrcaRouter ให้บริการตระกูล Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27B — ควบคู่ไปกับ Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview และ GLM 5.3 บนเอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI นั่นคือAPI เดียวสำหรับโมเดลเกือบ 200 รายการโดยบวกเพิ่ม 0% หมายความว่าราคาตามรายการของผู้ให้บริการจะถูกส่งผ่านไปโดยไม่ถูกแตะต้อง ดังนั้นเมื่อผู้ขายลดราคา ผลนั้นก็จะตกถึงคีย์ของคุณในวันเดียวกัน แทนที่จะเป็นรอบบิลถัดไป เมื่อใดก็ตามที่มีการเปิดตัวรุ่น Qwen 4 จริง แคตตาล็อกเดียวกันนี้คือที่ที่มันจะปรากฏขึ้น วันนี้ยังไม่มีรุ่นใดปรากฏเลย

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the on-page nav, the 1M token context badge, the model ID qwen/qwen3.8-max, multi-modality shown as text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, the code-samples panel with the OpenAI-compatible Python import, the Public benchmarks and Community buzz blocks, and the opening line of the model description calling Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

สรุป

Qwen 4 Max เป็นการประกาศจริงและไม่ใช่ผลิตภัณฑ์จริง และทั้งสองส่วนของประโยคนั้นมีความสำคัญ รายชื่อได้รับการยืนยันแล้ว: สี่ระดับ สถาปัตยกรรมรุ่นใหม่ จุดเน้นแบบเอเจนติก และระดับ 27B แบบเปิดน้ำหนัก ที่จะมีความสำคัญต่อผู้คนจำนวนมากกว่าที่เรือธงจะเป็น ทุกสิ่งที่การตัดสินใจซื้อต้องการ — ราคา บริบท รูปแบบ น้ำหนัก คะแนน วันที่ — ยังขาดอยู่

ให้มองสิ่งนี้เป็นสัญญาณของ roadmap ที่มีร่องรอยเอกสารยืนยันดีเป็นพิเศษ เพราะการเปิดตัว Qwen3.8-Flash-Next ให้ตัวอย่างสถาปัตยกรรมแก่คุณฟรี และ Qwen3.8-Max ให้เส้นฐานของโมเดลที่ครองตำแหน่งอยู่ในปัจจุบันพร้อมน้ำหนักที่เผยแพร่และราคาที่ประกาศไว้ ติดตามระดับ 27B สำหรับระบบนิเวศที่มันจะสร้างขึ้น และระดับ Flash สำหรับเศรษฐศาสตร์ของ throughput อย่านำตัวเลข 5 ถึง 10 ล้านล้านพารามิเตอร์ไปเผยแพร่ซ้ำในฐานะข้อเท็จจริงของ Qwen 4 และอย่าวางแผนการโยกย้ายโดยอิงกับโมเดลที่ยังไม่มีวันเปิดตัว — ให้วางแผนโดยอิงกับ Qwen3.8-Max และค่อยย้ายเมื่อมีปลายทางให้ย้ายไป

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube