
Qwen 4 Max กับ GLM-5.3: น้ำหนักแบบเปิด สัญญาอนุญาตแบบกำหนดเอง และระดับที่วางจำหน่ายจริง
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max ถูกเปิดตัวในรูปแบบพรีวิวที่งานประชุม Yunqi ในเมืองหางโจวเมื่อวันที่ 22 กันยายน 2026 ในฐานะเรือธงของกลุ่มผลิตภัณฑ์สี่โมเดล ซึ่งยังรวมถึง Qwen 4 Flash, Qwen 4 Plus และ Qwen 4 27B ระดับโอเพนเวท GLM-5.3 ของ Z.ai ได้รับการขึ้นทะเบียนตั้งแต่ 18 สิงหาคม 2026 โดยรองรับเฉพาะข้อความ มีหน้าต่างบริบท 1 ล้านโทเคน และเพดานเอาต์พุต 128,000 โทเคน ในราคา $1.26 ต่อล้านโทเคนอินพุต และ $3.96 ต่อล้านโทเคนเอาต์พุตในแคตตาล็อกของเรา เทียบกับราคาป้าย $1.40 และ $4.40 ที่ Z.ai ประกาศ ทั้งสองแล็บมาจากประเพณีโอเพนเวท และปัจจุบันทั้งคู่จำหน่ายโมเดลระดับแนวหน้าผ่าน API ที่โฮสต์ ดังนั้นกรอบแนวคิดแบบปิดกับแบบเปิดตามปกติจึงใช้ไม่ได้ที่นี่ แกนที่ใช้ได้จริงคือสิ่งที่ไม่มีใครใส่ไว้ในตารางเปรียบเทียบ: สิ่งที่ไลเซนส์อนุญาตจริง ๆ และระดับใดในแต่ละตระกูลที่คุณได้รับอนุญาตให้ทำอะไรที่น่าสนใจได้
สองห้องแล็บ สองคำตอบสำหรับคำถามเดียวกัน
Alibaba และ Z.ai เป็นผู้เผยแพร่แบบเปิดน้ำหนักที่สม่ำเสมอที่สุดสองรายในบรรดาแล็บที่อยู่ใกล้ระดับแนวหน้า และทั้งสองมีท่าทีที่แตกต่างกันว่าความเปิดนั้นจะคงอยู่มากเพียงใดเมื่อเข้าสู่ระดับเรือธง
รุ่น Qwen 3.8 ของ Alibaba ได้เผยแพร่เวตสำหรับโมเดลที่ใหญ่ที่สุด — Qwen3.8-2.4T-A95B ใน BF16 และ FP8 — เมื่อวันที่ 12 สิงหาคม 2026 โดยเผยแพร่ภายใต้ใบอนุญาต Qwen แบบกำหนดเอง ไม่ใช่ Apache 2.0 ความแตกต่างนี้คือประเด็นทั้งหมด: เวตมีอยู่จริง ซึ่งหมายความว่าการปรับละเอียด การควอนไทซ์ และการโฮสต์เองเป็นไปได้ในแบบที่โมเดลปิดจะไม่มีทางเป็นไปได้ แต่ข้อกำหนดเป็นของ Alibaba เอง และไม่ใช่ค่าเริ่มต้นแบบเปิดกว้างที่วลี "open weights" มักสื่อ
สายผลิตภัณฑ์ GLM ของ Z.ai มาจากแล็บที่มีประวัติการเปิดน้ำหนักโมเดล และรุ่นเรือธงก็ไม่เป็นข้อยกเว้นต่อเรื่องนี้อีกต่อไป น้ำหนักของ GLM-5.3 เองได้รับการเผยแพร่เมื่อวันที่ 28 สิงหาคม 2026 — รุ่นเรือธงขนาด 743 พันล้านพารามิเตอร์ แบ่งเป็น 141 ชาร์ด safetensors — ภายใต้สัญญาอนุญาตแบบกำหนดเองที่ Z.ai เขียนขึ้นสำหรับมัน แทนที่จะเป็น MIT ข้อกำหนดดังกล่าวประมาณได้ว่าเป็นการอนุญาตแบบ MIT โดยมีเงื่อนไขการตรวจสอบความปลอดภัยแนบมาสำหรับธุรกิจ model-as-a-service ที่มีรายได้สูงกว่าเกณฑ์ขนาดใหญ่ พึงสังเกตความหมายของสิ่งนี้ต่อตระกูลนี้: GLM-5.2 และ GLM-5.3-Flash อยู่ภายใต้ MIT ส่วนรุ่นเรือธงไม่อยู่
ตามที่ระบุไว้ GLM-5.3 เป็นโมเดลแบบข้อความล้วนที่มีหน้าต่างบริบทที่เผยแพร่ เพดานเอาต์พุตที่เผยแพร่ และการใช้เครื่องมือที่จัดทำเอกสารไว้ โหมด JSON และการให้เหตุผล
วางสองสิ่งนี้เคียงข้างกัน แล้วความแตกต่างในทางปฏิบัติก็คือ:
• น้ำหนักโมเดลเรือธง — น้ำหนักเรือธง Qwen 3.8 เผยแพร่ภายใต้สัญญาอนุญาต Qwen แบบกำหนดเอง เทียบกับน้ำหนัก GLM-5.3 ที่เผยแพร่เมื่อวันที่ 28 สิงหาคม 2026 ภายใต้สัญญาอนุญาต Z.ai แบบกำหนดเอง
• ราคาอินพุต — Qwen3.8-Max $2.00 ต่อ 1 ล้านโทเคน เทียบกับ GLM-5.3 $1.26 ต่อ 1 ล้านโทเคนในแค็ตตาล็อกของเรา และ $1.40 ในรายการของ Z.ai เอง
• ราคาเอาต์พุต — Qwen3.8-Max $6.00 ต่อ 1M โทเคน เทียบกับ GLM-5.3 $3.96 ต่อ 1M โทเคนในแค็ตตาล็อกของเรา และ $4.40 ในรายการของ Z.ai เอง
• บริบท — Qwen3.8-Max 1M โทเคน เทียบกับ GLM-5.3 1M โทเคน
• เพดานเอาต์พุต — Qwen3.8-Max 128K tokens เทียบกับ GLM-5.3 128K tokens
• โมดัลลิตี — Qwen3.8-Max รองรับอินพุตข้อความ รูปภาพ และวิดีโอ เทียบกับ GLM-5.3 ที่รองรับเฉพาะข้อความ โดยระบุไว้เช่นนั้น
• แท็กความสามารถ — Qwen3.8-Max การมองเห็น เครื่องมือ JSON และการใช้เหตุผล เทียบกับ GLM-5.3 เครื่องมือ JSON และการใช้เหตุผล
• Qwen 4 Max — ประกาศเมื่อวันที่ 22 กันยายน 2026 ไม่มีราคา ไม่มีบริบท ไม่มีน้ำหนักโมเดล ไม่มีกำหนดวันที่ ต่างจาก GLM-5.3 ที่เปิดตัวและให้บริการรับส่งข้อมูลแล้ว
แถวมัลติโหมดคือส่วนที่ทำให้เกิดช่องว่างราคา เรือธงของ Qwen รับอินพุตรูปภาพและวิดีโอ และคิดราคา $2.00 ขาเข้าและ $6.00 ขาออก; GLM-5.3 รับข้อความและคิดราคา $1.26 และ $3.96 ถ้าภาระงานของคุณเป็นข้อความ คุณกำลังจ่ายส่วนเพิ่มสำหรับตัวเข้ารหัสภาพ (vision encoder) ที่คุณไม่เคยเรียกใช้ และนั่นคือเหตุผลที่ชัดเจนที่สุดว่าทำไมโมเดลเฉพาะทางสำหรับข้อความเท่านั้นจึงชนะเรือธงมัลติโหมดในด้านต้นทุนสำหรับงานข้อความ

ระดับ 27B คือตัวตัดสินเรื่องนี้
Qwen 4 Max คือพาดหัวข่าว และรุ่นระดับ 27B คือเนื้อเรื่องสำคัญ ทุกเจเนอเรชันของ Qwen ได้เปิดตัวรุ่นเล็กแบบโอเพนซอร์สภายใต้เงื่อนไขที่ให้ผู้คนทำสิ่งต่าง ๆ ได้ และหลักฐานปลายน้ำก็ชัดเจนไม่มีข้อกังขา: ภายในไม่กี่วันหลังจากน้ำหนัก Qwen 3.8 27B เปิดให้ใช้งาน ระบบนิเวศก็ผลิตการแปลงเป็น MLX การควอนไทซ์ NVFP4 และไฟน์จูนที่ไม่มีเซ็นเซอร์ออกมาแล้ว โดยไม่มีสิ่งใดต้องขออนุญาตใคร นั่นคือสิ่งที่การเปิดตัวโมเดลเล็กแบบผ่อนปรนมอบให้ และมันเป็นรูปแบบการกระจายที่ไม่มี API แบบโฮสต์ใดเทียบได้
ระดับเรือธงเป็นอีกเรื่องหนึ่ง โมเดลขนาด 2.4 ล้านล้านพารามิเตอร์ที่เผยแพร่ภายใต้สัญญาอนุญาตแบบกำหนดเองนั้นเป็น "เปิด" ในแง่ที่ว่าไบต์สามารถดาวน์โหลดได้ และเป็น "ปิด" ในแง่ที่ว่าสิ่งที่คุณทำกับมันได้นั้นถูกกำหนดโดยผู้เผยแพร่ ทั้งสองสิ่งเป็นจริงในเวลาเดียวกัน และการประกาศ Qwen 4 ก็ไม่ได้เปลี่ยนสิ่งใดในสองข้อนั้น หากระดับ Qwen 4 27B ทำตามรูปแบบของรุ่นก่อน ๆ มันจะเป็นรุ่นที่สำคัญต่อผู้คนจำนวนมากที่สุด และยังเป็นรุ่นที่มีกำหนดส่งมอบที่คาดเดาได้มากที่สุดด้วย เพราะระดับเปิดขนาดเล็กเป็นสิ่งที่สุดในแผนงานที่ทำให้เสร็จได้ง่ายที่สุด
ซึ่งทำให้การเปรียบเทียบกลับมาสู่สิ่งที่เป็นประโยชน์ได้จริง GLM-5.3 เป็นโมเดลแบบโฮสต์ในราคาที่เปิดเผย พร้อมชุดความสามารถที่มีการระบุไว้อย่างชัดเจน และพร้อมใช้งานแล้วในตอนนี้ Qwen 4 Max เป็นเพียงชื่อระดับรุ่น หากคุณต้องการให้ข้อโต้แย้งเรื่องความเปิดกว้างเป็นรูปธรรมมากกว่าเชิงปรัชญา โมเดลที่ควรรอคือ 27B ไม่ใช่ Max
เลเยอร์การจัดเส้นทางคือจุดที่คำถามเรื่องสิทธิ์การใช้งานไม่สำคัญอีกต่อไป
มีแนวทางหนึ่งของการตัดสินใจนี้ที่หลีกเลี่ยงคำถามเรื่องสัญญาอนุญาตได้ทั้งหมด และควรพูดตามตรงว่านี่เป็นทางเลือกจริง ไม่ใช่การประนีประนอม หากความต้องการของคุณคือการเรียกใช้โมเดล ไม่ใช่การเป็นเจ้าของโมเดล สัญญาอนุญาตที่กำกับน้ำหนักโมเดลก็ไม่เกี่ยวข้อง และข้อกำหนดที่สำคัญคือราคา ความหน่วง และพฤติกรรมเมื่อเกิดความล้มเหลว
OrcaRouter ให้บริการ GLM-5.3 ในชื่อ z-ai/glm-5.3ในราคา $1.26 สำหรับอินพุต และ $3.96 สำหรับเอาต์พุตต่อล้านโทเคน — ต่ำกว่า $1.40 และ $4.40 ที่ Z.ai ประกาศไว้ โดยหน้ารายละเอียดโมเดลแสดงอัตราตามประกาศเหล่านั้นเทียบกับอัตราที่เราเรียกเก็บ และไม่มีการบวก markup เพิ่มจากสิ่งที่เราจ่ายให้ผู้ให้บริการ ปลายทางที่รองรับ OpenAI-compatible เดียวกันนี้ยังให้บริการตระกูล Qwen 3.8 Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27Bพร้อมกับโมเดลอื่นอีกเกือบ 200 รายการ ด้วยระบบ failover อัตโนมัติเมื่อเส้นทางของผู้ให้บริการมีปัญหา และ routing DSLที่ช่วยให้คุณกำหนดนโยบายการสลับแทนได้อย่างชัดเจน แทนที่จะต้องแก้สตริงชื่อโมเดลในโค้ดแอปพลิเคชัน เมื่อผู้จำหน่ายเปลี่ยนอัตราราคา การเปลี่ยนแปลงจะมีผลกับคีย์ของคุณภายในวันเดียวกัน เพราะไม่มีชั้นส่วนต่างกำไรที่จะทำให้มันค้างอยู่ตรงนั้น
สิ่งที่ OrcaRouter ไม่มีให้บริการคือ Qwen 4 Max หรือรุ่นใดก็ตามในตระกูล Qwen 4 แค็ตตาล็อกไม่มีรายการสำหรับตระกูลนี้ ซึ่งถือเป็นสถานะที่ถูกต้องสำหรับโมเดลที่ถูกประกาศบนเวทีแต่ยังไม่ได้เปิดให้ใช้งานจริง Qwen 4 Max จะเข้าถึงได้ เมื่อมันเข้าถึงได้จริงเสียที ผ่าน API ของผู้ให้บริการเองและแพลตฟอร์มของบุคคลที่สามหลายแห่ง จนกว่าจะถึงตอนนั้น โมเดล Qwen ในบทเปรียบเทียบนี้ที่คุณเรียกใช้ได้จริงคือ Qwen3.8-Max และมันอยู่ในแค็ตตาล็อกเดียวกับ GLM-5.3 ซึ่งทำให้เวอร์ชันที่ใช้งานจริงของการจับคู่นี้เป็นการตัดสินใจเรื่องนโยบายการจัดเส้นทาง มากกว่าการจัดซื้อจัดหา

คำถามเรื่องใบอนุญาตตัดสินอะไรจริง ๆ
GLM-5.3 ถูกกว่าทั้งสองแกน หน้าต่างบริบทและเพดานเอาต์พุตของมันเทียบเท่ากับเรือธงของ Qwen ข้อจำกัดด้านมอดัลลิตีของมันมีเอกสารระบุไว้แทนที่จะปล่อยให้ต้องอนุมาน และมันให้บริการทราฟฟิกอยู่จริงในวันนี้ Qwen 4 Max มีสล็อตงานประชุมและชื่อระดับ และส่วนเดียวของโรดแมป Qwen 4 ที่มีการส่งมอบที่คาดการณ์ได้คือระดับ 27B
การตัดสินใจที่ยังคงอยู่หลังการเปิดตัวไม่ใช่ว่ารุ่นไหนดีกว่า แต่คือว่าคุณจำเป็นต้องเป็นเจ้าของตัวโมเดลนั้นหรือไม่ หากคุณต้องโฮสต์เอง ไฟน์จูน หรือดัดแปลง น้ำหนักของรุ่นเรือธงจากห้องแล็บใดก็ตามมาพร้อมข้อกำหนดที่คุณควรอ่านก่อนจะสร้างธุรกิจบนสิ่งเหล่านั้น และระดับโอเพนซอร์สขนาดเล็กคือที่ที่ตัวเลือกแบบผ่อนปรนอาศัยอยู่มาโดยตลอด หากคุณต้องเรียกใช้โมเดล GLM-5.3 คือคำตอบที่ถูกกว่าวันนี้สำหรับงานด้านข้อความ Qwen3.8-Max คือคำตอบหากคุณต้องการอินพุตรูปภาพหรือวิดีโอ และทั้งสองอยู่ห่างเพียงปลายทางเดียวและบิลเดียว กลับมาพิจารณาคำถามเรื่องรุ่นเรือธงอีกครั้งเมื่อ Alibaba เผยแพร่การ์ดโมเดล และอ่านสัญญาอนุญาตก่อนดูตาราง benchmark

การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
