การ์ดชื่อเรื่องแบบ Hero สำหรับ "Qwen 4 Max vs GLM-5.3" พร้อมคำโปรยย่อย "โอเพนเวท ไลเซนส์แบบกำหนดเอง และระดับที่วางจำหน่ายจริง" ป้ายทรงแคปซูลสามอันที่อ่านว่า "$1.26 และ $3.96", "ข้อความล้วน vs มัลติโมดัล" และ "ตัว 27B คือรุ่นที่ต้องจับตา" บรรทัดท้ายที่อ่านว่า "Alibaba ประกาศเมื่อวันที่ 22 กันยายน 2026; GLM-5.3 ขึ้นทะเบียนเมื่อวันที่ 18 สิงหาคม 2026" และโลโก้ OrcaRouter ที่มุมขวาล่าง
Engineering & Research

Qwen 4 Max กับ GLM-5.3: น้ำหนักแบบเปิด สัญญาอนุญาตแบบกำหนดเอง และระดับที่วางจำหน่ายจริง

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Qwen 4 Max ถูกเปิดตัวในรูปแบบพรีวิวที่งานประชุม Yunqi ในเมืองหางโจวเมื่อวันที่ 22 กันยายน 2026 ในฐานะเรือธงของกลุ่มผลิตภัณฑ์สี่โมเดล ซึ่งยังรวมถึง Qwen 4 Flash, Qwen 4 Plus และ Qwen 4 27B ระดับโอเพนเวท GLM-5.3 ของ Z.ai ได้รับการขึ้นทะเบียนตั้งแต่ 18 สิงหาคม 2026 โดยรองรับเฉพาะข้อความ มีหน้าต่างบริบท 1 ล้านโทเคน และเพดานเอาต์พุต 128,000 โทเคน ในราคา $1.26 ต่อล้านโทเคนอินพุต และ $3.96 ต่อล้านโทเคนเอาต์พุตในแคตตาล็อกของเรา เทียบกับราคาป้าย $1.40 และ $4.40 ที่ Z.ai ประกาศ ทั้งสองแล็บมาจากประเพณีโอเพนเวท และปัจจุบันทั้งคู่จำหน่ายโมเดลระดับแนวหน้าผ่าน API ที่โฮสต์ ดังนั้นกรอบแนวคิดแบบปิดกับแบบเปิดตามปกติจึงใช้ไม่ได้ที่นี่ แกนที่ใช้ได้จริงคือสิ่งที่ไม่มีใครใส่ไว้ในตารางเปรียบเทียบ: สิ่งที่ไลเซนส์อนุญาตจริง ๆ และระดับใดในแต่ละตระกูลที่คุณได้รับอนุญาตให้ทำอะไรที่น่าสนใจได้

สองห้องแล็บ สองคำตอบสำหรับคำถามเดียวกัน

Alibaba และ Z.ai เป็นผู้เผยแพร่แบบเปิดน้ำหนักที่สม่ำเสมอที่สุดสองรายในบรรดาแล็บที่อยู่ใกล้ระดับแนวหน้า และทั้งสองมีท่าทีที่แตกต่างกันว่าความเปิดนั้นจะคงอยู่มากเพียงใดเมื่อเข้าสู่ระดับเรือธง

รุ่น Qwen 3.8 ของ Alibaba ได้เผยแพร่เวตสำหรับโมเดลที่ใหญ่ที่สุด — Qwen3.8-2.4T-A95B ใน BF16 และ FP8 — เมื่อวันที่ 12 สิงหาคม 2026 โดยเผยแพร่ภายใต้ใบอนุญาต Qwen แบบกำหนดเอง ไม่ใช่ Apache 2.0 ความแตกต่างนี้คือประเด็นทั้งหมด: เวตมีอยู่จริง ซึ่งหมายความว่าการปรับละเอียด การควอนไทซ์ และการโฮสต์เองเป็นไปได้ในแบบที่โมเดลปิดจะไม่มีทางเป็นไปได้ แต่ข้อกำหนดเป็นของ Alibaba เอง และไม่ใช่ค่าเริ่มต้นแบบเปิดกว้างที่วลี "open weights" มักสื่อ

สายผลิตภัณฑ์ GLM ของ Z.ai มาจากแล็บที่มีประวัติการเปิดน้ำหนักโมเดล และรุ่นเรือธงก็ไม่เป็นข้อยกเว้นต่อเรื่องนี้อีกต่อไป น้ำหนักของ GLM-5.3 เองได้รับการเผยแพร่เมื่อวันที่ 28 สิงหาคม 2026 — รุ่นเรือธงขนาด 743 พันล้านพารามิเตอร์ แบ่งเป็น 141 ชาร์ด safetensors — ภายใต้สัญญาอนุญาตแบบกำหนดเองที่ Z.ai เขียนขึ้นสำหรับมัน แทนที่จะเป็น MIT ข้อกำหนดดังกล่าวประมาณได้ว่าเป็นการอนุญาตแบบ MIT โดยมีเงื่อนไขการตรวจสอบความปลอดภัยแนบมาสำหรับธุรกิจ model-as-a-service ที่มีรายได้สูงกว่าเกณฑ์ขนาดใหญ่ พึงสังเกตความหมายของสิ่งนี้ต่อตระกูลนี้: GLM-5.2 และ GLM-5.3-Flash อยู่ภายใต้ MIT ส่วนรุ่นเรือธงไม่อยู่

ตามที่ระบุไว้ GLM-5.3 เป็นโมเดลแบบข้อความล้วนที่มีหน้าต่างบริบทที่เผยแพร่ เพดานเอาต์พุตที่เผยแพร่ และการใช้เครื่องมือที่จัดทำเอกสารไว้ โหมด JSON และการให้เหตุผล

วางสองสิ่งนี้เคียงข้างกัน แล้วความแตกต่างในทางปฏิบัติก็คือ:

• น้ำหนักโมเดลเรือธง — น้ำหนักเรือธง Qwen 3.8 เผยแพร่ภายใต้สัญญาอนุญาต Qwen แบบกำหนดเอง เทียบกับน้ำหนัก GLM-5.3 ที่เผยแพร่เมื่อวันที่ 28 สิงหาคม 2026 ภายใต้สัญญาอนุญาต Z.ai แบบกำหนดเอง

• ราคาอินพุต — Qwen3.8-Max $2.00 ต่อ 1 ล้านโทเคน เทียบกับ GLM-5.3 $1.26 ต่อ 1 ล้านโทเคนในแค็ตตาล็อกของเรา และ $1.40 ในรายการของ Z.ai เอง

• ราคาเอาต์พุต — Qwen3.8-Max $6.00 ต่อ 1M โทเคน เทียบกับ GLM-5.3 $3.96 ต่อ 1M โทเคนในแค็ตตาล็อกของเรา และ $4.40 ในรายการของ Z.ai เอง

• บริบท — Qwen3.8-Max 1M โทเคน เทียบกับ GLM-5.3 1M โทเคน

• เพดานเอาต์พุต — Qwen3.8-Max 128K tokens เทียบกับ GLM-5.3 128K tokens

• โมดัลลิตี — Qwen3.8-Max รองรับอินพุตข้อความ รูปภาพ และวิดีโอ เทียบกับ GLM-5.3 ที่รองรับเฉพาะข้อความ โดยระบุไว้เช่นนั้น

• แท็กความสามารถ — Qwen3.8-Max การมองเห็น เครื่องมือ JSON และการใช้เหตุผล เทียบกับ GLM-5.3 เครื่องมือ JSON และการใช้เหตุผล

• Qwen 4 Max — ประกาศเมื่อวันที่ 22 กันยายน 2026 ไม่มีราคา ไม่มีบริบท ไม่มีน้ำหนักโมเดล ไม่มีกำหนดวันที่ ต่างจาก GLM-5.3 ที่เปิดตัวและให้บริการรับส่งข้อมูลแล้ว

แถวมัลติโหมดคือส่วนที่ทำให้เกิดช่องว่างราคา เรือธงของ Qwen รับอินพุตรูปภาพและวิดีโอ และคิดราคา $2.00 ขาเข้าและ $6.00 ขาออก; GLM-5.3 รับข้อความและคิดราคา $1.26 และ $3.96 ถ้าภาระงานของคุณเป็นข้อความ คุณกำลังจ่ายส่วนเพิ่มสำหรับตัวเข้ารหัสภาพ (vision encoder) ที่คุณไม่เคยเรียกใช้ และนั่นคือเหตุผลที่ชัดเจนที่สุดว่าทำไมโมเดลเฉพาะทางสำหรับข้อความเท่านั้นจึงชนะเรือธงมัลติโหมดในด้านต้นทุนสำหรับงานข้อความ

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

ระดับ 27B คือตัวตัดสินเรื่องนี้

Qwen 4 Max คือพาดหัวข่าว และรุ่นระดับ 27B คือเนื้อเรื่องสำคัญ ทุกเจเนอเรชันของ Qwen ได้เปิดตัวรุ่นเล็กแบบโอเพนซอร์สภายใต้เงื่อนไขที่ให้ผู้คนทำสิ่งต่าง ๆ ได้ และหลักฐานปลายน้ำก็ชัดเจนไม่มีข้อกังขา: ภายในไม่กี่วันหลังจากน้ำหนัก Qwen 3.8 27B เปิดให้ใช้งาน ระบบนิเวศก็ผลิตการแปลงเป็น MLX การควอนไทซ์ NVFP4 และไฟน์จูนที่ไม่มีเซ็นเซอร์ออกมาแล้ว โดยไม่มีสิ่งใดต้องขออนุญาตใคร นั่นคือสิ่งที่การเปิดตัวโมเดลเล็กแบบผ่อนปรนมอบให้ และมันเป็นรูปแบบการกระจายที่ไม่มี API แบบโฮสต์ใดเทียบได้

ระดับเรือธงเป็นอีกเรื่องหนึ่ง โมเดลขนาด 2.4 ล้านล้านพารามิเตอร์ที่เผยแพร่ภายใต้สัญญาอนุญาตแบบกำหนดเองนั้นเป็น "เปิด" ในแง่ที่ว่าไบต์สามารถดาวน์โหลดได้ และเป็น "ปิด" ในแง่ที่ว่าสิ่งที่คุณทำกับมันได้นั้นถูกกำหนดโดยผู้เผยแพร่ ทั้งสองสิ่งเป็นจริงในเวลาเดียวกัน และการประกาศ Qwen 4 ก็ไม่ได้เปลี่ยนสิ่งใดในสองข้อนั้น หากระดับ Qwen 4 27B ทำตามรูปแบบของรุ่นก่อน ๆ มันจะเป็นรุ่นที่สำคัญต่อผู้คนจำนวนมากที่สุด และยังเป็นรุ่นที่มีกำหนดส่งมอบที่คาดเดาได้มากที่สุดด้วย เพราะระดับเปิดขนาดเล็กเป็นสิ่งที่สุดในแผนงานที่ทำให้เสร็จได้ง่ายที่สุด

ซึ่งทำให้การเปรียบเทียบกลับมาสู่สิ่งที่เป็นประโยชน์ได้จริง GLM-5.3 เป็นโมเดลแบบโฮสต์ในราคาที่เปิดเผย พร้อมชุดความสามารถที่มีการระบุไว้อย่างชัดเจน และพร้อมใช้งานแล้วในตอนนี้ Qwen 4 Max เป็นเพียงชื่อระดับรุ่น หากคุณต้องการให้ข้อโต้แย้งเรื่องความเปิดกว้างเป็นรูปธรรมมากกว่าเชิงปรัชญา โมเดลที่ควรรอคือ 27B ไม่ใช่ Max

เลเยอร์การจัดเส้นทางคือจุดที่คำถามเรื่องสิทธิ์การใช้งานไม่สำคัญอีกต่อไป

มีแนวทางหนึ่งของการตัดสินใจนี้ที่หลีกเลี่ยงคำถามเรื่องสัญญาอนุญาตได้ทั้งหมด และควรพูดตามตรงว่านี่เป็นทางเลือกจริง ไม่ใช่การประนีประนอม หากความต้องการของคุณคือการเรียกใช้โมเดล ไม่ใช่การเป็นเจ้าของโมเดล สัญญาอนุญาตที่กำกับน้ำหนักโมเดลก็ไม่เกี่ยวข้อง และข้อกำหนดที่สำคัญคือราคา ความหน่วง และพฤติกรรมเมื่อเกิดความล้มเหลว

OrcaRouter ให้บริการ GLM-5.3 ในชื่อ z-ai/glm-5.3ในราคา $1.26 สำหรับอินพุต และ $3.96 สำหรับเอาต์พุตต่อล้านโทเคน — ต่ำกว่า $1.40 และ $4.40 ที่ Z.ai ประกาศไว้ โดยหน้ารายละเอียดโมเดลแสดงอัตราตามประกาศเหล่านั้นเทียบกับอัตราที่เราเรียกเก็บ และไม่มีการบวก markup เพิ่มจากสิ่งที่เราจ่ายให้ผู้ให้บริการ ปลายทางที่รองรับ OpenAI-compatible เดียวกันนี้ยังให้บริการตระกูล Qwen 3.8 Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27Bพร้อมกับโมเดลอื่นอีกเกือบ 200 รายการ ด้วยระบบ failover อัตโนมัติเมื่อเส้นทางของผู้ให้บริการมีปัญหา และ routing DSLที่ช่วยให้คุณกำหนดนโยบายการสลับแทนได้อย่างชัดเจน แทนที่จะต้องแก้สตริงชื่อโมเดลในโค้ดแอปพลิเคชัน เมื่อผู้จำหน่ายเปลี่ยนอัตราราคา การเปลี่ยนแปลงจะมีผลกับคีย์ของคุณภายในวันเดียวกัน เพราะไม่มีชั้นส่วนต่างกำไรที่จะทำให้มันค้างอยู่ตรงนั้น

สิ่งที่ OrcaRouter ไม่มีให้บริการคือ Qwen 4 Max หรือรุ่นใดก็ตามในตระกูล Qwen 4 แค็ตตาล็อกไม่มีรายการสำหรับตระกูลนี้ ซึ่งถือเป็นสถานะที่ถูกต้องสำหรับโมเดลที่ถูกประกาศบนเวทีแต่ยังไม่ได้เปิดให้ใช้งานจริง Qwen 4 Max จะเข้าถึงได้ เมื่อมันเข้าถึงได้จริงเสียที ผ่าน API ของผู้ให้บริการเองและแพลตฟอร์มของบุคคลที่สามหลายแห่ง จนกว่าจะถึงตอนนั้น โมเดล Qwen ในบทเปรียบเทียบนี้ที่คุณเรียกใช้ได้จริงคือ Qwen3.8-Max และมันอยู่ในแค็ตตาล็อกเดียวกับ GLM-5.3 ซึ่งทำให้เวอร์ชันที่ใช้งานจริงของการจับคู่นี้เป็นการตัดสินใจเรื่องนโยบายการจัดเส้นทาง มากกว่าการจัดซื้อจัดหา

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

คำถามเรื่องใบอนุญาตตัดสินอะไรจริง ๆ

GLM-5.3 ถูกกว่าทั้งสองแกน หน้าต่างบริบทและเพดานเอาต์พุตของมันเทียบเท่ากับเรือธงของ Qwen ข้อจำกัดด้านมอดัลลิตีของมันมีเอกสารระบุไว้แทนที่จะปล่อยให้ต้องอนุมาน และมันให้บริการทราฟฟิกอยู่จริงในวันนี้ Qwen 4 Max มีสล็อตงานประชุมและชื่อระดับ และส่วนเดียวของโรดแมป Qwen 4 ที่มีการส่งมอบที่คาดการณ์ได้คือระดับ 27B

การตัดสินใจที่ยังคงอยู่หลังการเปิดตัวไม่ใช่ว่ารุ่นไหนดีกว่า แต่คือว่าคุณจำเป็นต้องเป็นเจ้าของตัวโมเดลนั้นหรือไม่ หากคุณต้องโฮสต์เอง ไฟน์จูน หรือดัดแปลง น้ำหนักของรุ่นเรือธงจากห้องแล็บใดก็ตามมาพร้อมข้อกำหนดที่คุณควรอ่านก่อนจะสร้างธุรกิจบนสิ่งเหล่านั้น และระดับโอเพนซอร์สขนาดเล็กคือที่ที่ตัวเลือกแบบผ่อนปรนอาศัยอยู่มาโดยตลอด หากคุณต้องเรียกใช้โมเดล GLM-5.3 คือคำตอบที่ถูกกว่าวันนี้สำหรับงานด้านข้อความ Qwen3.8-Max คือคำตอบหากคุณต้องการอินพุตรูปภาพหรือวิดีโอ และทั้งสองอยู่ห่างเพียงปลายทางเดียวและบิลเดียว กลับมาพิจารณาคำถามเรื่องรุ่นเรือธงอีกครั้งเมื่อ Alibaba เผยแพร่การ์ดโมเดล และอ่านสัญญาอนุญาตก่อนดูตาราง benchmark

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube