Nex-N2.5 Pro vs GLM-5.2 hero — การ์ดชื่อเรื่องที่สร้างขึ้นซึ่งอ่านว่า 'Nex-N2.5 Pro vs GLM-5.2' พร้อมคำบรรยายใต้ชื่อว่า 'โมเดลเอเจนต์แบบเปิดน้ำหนักสองตัว ความบังเอิญที่น่าสงสัยหนึ่งอย่างที่ 82.7' และบรรทัดบนสุดว่า 'Nex-AGI vs Z.ai — กันยายน 2026'
Guides & Insights

Nex-N2.5 Pro เทียบกับ GLM-5.2: คะแนน 82.7 เท่ากันบน Terminal-Bench แต่ต้นกำเนิดต่างกันอย่างสิ้นเชิง

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

โมเดลเอเจนต์แบบเปิดน้ำหนักสองตัว ความบังเอิญที่น่าสงสัยหนึ่งอย่าง: Nex-N2.5 Pro และ GLM-5.2 ต่างแสดงผลที่ 82.7 บน Terminal-Bench 2.1 ทั้งคู่ Nex-AGI พิมพ์ 82.7 สำหรับ Nex-N2.5 Pro บนการ์ดโมเดลของตัวเอง ซึ่งวัดด้วยชุดทดสอบ NexCUA ของพันธมิตรเองที่สาธารณชนไม่เคยเห็น ตัวเลขที่ดีที่สุดที่ Z.ai รายงานสำหรับ GLM-5.2 บนชุดทดสอบเดียวกันก็คือ 82.7 เช่นกัน และเมื่อชุดทดสอบอิสระนำโมเดลไปรันอีกครั้ง ผลก็อยู่ที่ 77.9 ต่ำกว่าตัวเลขของผู้ผลิตเองราวห้าจุด การเสมอกันอย่างสมบูรณ์แบบระหว่างตัวเลขที่ใครก็ตรวจสอบไม่ได้กับตัวเลขที่หดลงไปแล้วเมื่อถูกตรวจสอบ ไม่ใช่การเสมอเลยแม้แต่น้อย นี่คือการสาธิตที่ชัดเจนที่สุดว่าทำไมความแตกต่างระหว่าง “น้ำหนักแบบเปิด” กับ “น้ำหนักที่จะมีอยู่จริงในภายหลัง” จึงตัดสินการประจันหน้าครั้งนี้ก่อนที่ผลทดสอบแม้แต่บรรทัดเดียวจะถูกอ่าน

ทั้งสองโมเดลตั้งอยู่ในแวดวงเชิงพาณิชย์เดียวกัน แต่มีลักษณะที่แตกต่างกันอย่างสิ้นเชิง Nex-N2.5 Pro ซึ่งประกาศเมื่อวันที่ 8 กันยายน ค.ศ. 2026 เป็นโมเดลมัลติโหมดสำหรับใช้งานคอมพิวเตอร์ — มีพารามิเตอร์รวม 397 พันล้านตัว โดยทำงานจริงประมาณ 17 พันล้านตัว สร้างจากตระกูล Qwen3.5 ออกแบบมาให้อ่านหน้าจอและขับเคลื่อนเบราว์เซอร์หรือเซสชันเดสก์ท็อปด้วยวงรอบการตอบสนองทางภาพ ส่วน GLM-5.2 คือโมเดลเรือธงของ Z.ai (Zhipu AI) ที่ได้รับอนุญาตแบบ MIT สำหรับการให้เหตุผลในขอบเขตระยะยาวและการเขียนโค้ด — มีพารามิเตอร์รวมประมาณ 743 พันล้านตัว โดยทำงานจริงราว 40 พันล้านตัว เป็นแบบข้อความเท่านั้น เปิดใช้งานทั่วไป (GA) ตั้งแต่วันที่ 16 มิถุนายน ค.ศ. 2026 และเป็นโมเดลที่ทำหน้าที่เป็นเสาหลักของคะแนนอิสระในกลุ่ม open-weights มานานหลายเดือน โมเดลหนึ่งมองโลกผ่านพิกเซลและลงมือกระทำกับมัน ส่วนอีกโมเดลหนึ่งคิดในรูปแบบข้อความและส่งมอบโค้ด สัญญาอนุญาตของทั้งสองระบุว่าคุณสามารถสร้างธุรกิจบนตัวโมเดลได้ แต่ข้อแตกต่างคือ บนหนึ่งในนั้น สัญญาอนุญาตดังกล่าวในปัจจุบันเป็นเพียงคำมั่นสัญญา

จำนวนเดียวกัน แหล่งที่มาต่างกันสองแห่ง

เริ่มจากจุดที่เสมอกันก่อน เพราะมันบ่งบอกถึงภาพรวมของการแข่งขันทั้งหมด บัตรข้อมูลของ Nex-AGI ระบุค่า Terminal-Bench 2.1 ที่ 82.7 สำหรับ Nex-N2.5 Pro พร้อมกับ OSWorld-2 ที่ 56.4, SWE-Bench Pro ที่ 61.2 และ BrowseComp ที่ 89.7 — ทุกค่าล้วนเกิดจากการวัดผ่านชุดทดสอบ NexCUA และไม่มีค่าใดที่ถูกตรวจสอบซ้ำอย่างอิสระในช่วงวันแรก ๆ ของโมเดล ด้วยเหตุผลง่าย ๆ ว่าไม่สามารถดาวน์โหลดน้ำหนัก (weights) มาใช้ได้ ตัวเลข 82.7 ของ Z.ai สำหรับ GLM-5.2 บน Terminal-Bench 2.1 เป็นตัวเลขที่ดีที่สุดที่ผู้พัฒนารายงานเอง แต่มันอยู่บนโมเดลที่ใครก็ได้สามารถโหลดจาก Hugging Face และรันซ้ำได้ในบ่ายวันนี้ การวัดแบบอิสระด้วยชุดทดสอบให้ค่าที่ 77.9 แล้ว และต่ำกว่าที่ Z.ai อ้างอยู่ประมาณห้าคะแนน เมื่อตัวเลขของผู้พัฒนาลดลงเมื่อถูกทดสอบแบบอิสระ นั่นไม่ใช่เรื่องอื้อฉาว แต่เป็นภาษีปกติของการวัดผลด้วยตัวเอง แต่เมื่อตัวเลขของคู่แข่งไม่สามารถทดสอบได้เลย การไม่มีภาษีนี้ต่างหากคือปัญหา ไม่ใช่สัญญาณว่าตัวเลขนั้นบริสุทธิ์

A two-column scoreboard titled 'Nex-N2.5 Pro vs GLM-5.2 — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; License Apache-2.0 pending; Params 397B / ~17B active; Modality text + image (computer use); Terminal-Bench 2.1 82.7 vendor; Price free hosted / no list. Right column GLM-5.2: GA Jun 16 2026; License MIT live now; Params ~743B / ~40B active; Modality text only; Terminal-Bench 2.1 82.7 claimed / 77.9 independent; Price $1.40 / $4.40 per 1M. Footer: 'Nex and Z.ai figures vendor-reported; 77.9 per the OrcaRouter harness.'

อ่านแถวโดยรอบในลักษณะเดียวกัน GLM-5.2 มีค่าดัชนีอิสระสูงสุดที่กลุ่มโมเดลเปิดเคยผลิตได้ — อยู่ในช่วงlow 50s ตามดัชนีความฉลาด (Intelligence Index) ปัจจุบันของ Artificial Analysis — ซึ่งเป็นเหตุผลว่าทำไมมันจึงเป็นโมเดลเปิดอ้างอิงมาหลายเดือนแม้จะไม่ใช่รุ่นใหม่อลังการที่สุดก็ตาม Nex-N2.5 Pro ไม่มีรายการดัชนีอิสระเลย ในแถวที่ทั้งสองผู้ให้บริการอ้างตัวเลข ตัวเลขที่ตรวจสอบได้คือของรายเดิม; ในแถวที่มีเพียง Nex-AGI เผยแพร่ ตัวเลขเหล่านั้นไม่ถูกทำซ้ำเพื่อยืนยัน นั่นไม่ใช่คำตัดสินว่าโมเดลไหนฉลาดกว่า แต่เป็นคำตัดสินว่าโมเดลไหนที่คุณได้รับอนุญาตให้ตรวจสอบได้

เอกสารข้อมูลจำเพาะตรงกันมากเกินกว่าที่คุณจะคาดคิด

เมื่อตัดเกณฑ์วัดออกไปแล้ว ทั้งสองโมเดลก็ใกล้เคียงกันอย่างมากในเรื่องพื้นฐาน:

เผยแพร่แล้ว — Nex-N2.5 Pro: 8 กันยายน 2026 (โฮสต์เอนด์พอยต์ใช้งานได้แล้ว, weights ยังไม่เผยแพร่) GLM-5.2: GA 16 มิถุนายน 2026, เผยแพร่ weights แล้ว

ใบอนุญาต — Nex-N2.5 Pro: Apache-2.0, น้ำหนักโมเดลจะมาเร็วๆ นี้. GLM-5.2: MIT, ดาวน์โหลดได้แล้ว

ขนาด — Nex-N2.5 Pro: รวม 397B / แอกทีฟ ~17B. GLM-5.2: รวม ~743B / แอกทีฟ ~40B.

รูปแบบ — Nex-N2.5 Pro: รับข้อความและรูปภาพเข้า ส่งออกเป็นข้อความ มีลูปวิสัยทัศน์สำหรับใช้งานคอมพิวเตอร์ GLM-5.2: โมเดลการให้เหตุผลที่รองรับเฉพาะข้อความ

บริบท / เอาต์พุต — Nex-N2.5 Pro: บริบท 262,144 โทเคน. GLM-5.2: บริบท 1M โทเคน, เพดานเอาต์พุต 128K.

การควบคุมการใช้เหตุผล — Nex-N2.5 Pro: ไม่มี / ปานกลาง (adaptive, ค่าเริ่มต้น) / สูง. GLM-5.2: มีตัวควบคุมระดับการใช้เหตุผล (reasoning-effort) บนสตริงโมเดลเดียวกัน

ราคาต่อ 1M โทเคน — Nex-N2.5 Pro: มีระดับโฮสต์ฟรี ไม่มีราคาประกาศ. GLM-5.2: $1.40 อินพุต / $4.40 เอาต์พุต, $0.26 อินพุตแบบแคช.

ขอบเขตความสามารถที่ต่างกันสะท้อนงานที่ต่างกันของสองโมเดลนี้: GLM-5.2 มอบบริบทข้อความเต็มล้านโทเคนและเพดานเอาต์พุต 128K ให้กับเซสชันวิศวกรรมระยะยาว ขณะที่ Nex-N2.5 Pro แลกขนาดบริบทกับความสามารถด้านวิทัศน์และหน้าต่าง 262K ที่เล็กกว่า ซึ่งเหมาะกับงานระดับจอภาพ ไม่มีสเปกใดผิด; ทั้งคู่ถูกกำหนดสเปกมาเพื่องานคนละประเภท

ค่าน้ำหนักแบบเปิด สองความหมายที่แตกต่างกัน

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

นี่คือจุดที่การเปรียบเทียบหยุดเป็นเรื่องของตัวเลขโดยสิ้นเชิง GLM-5.2 เปิดกว้างในแบบที่คุณวางตลาดผลิตภัณฑ์ซึ่งต่อยอดเป็นธุรกิจได้: สัญญาอนุญาต MIT น้ำหนักโมเดลบน Hugging Face ไม่มีข้อจำกัดการใช้เชิงพาณิชย์ ไม่มีข้อกำหนดแบ่งปันข้อมูล ไม่มีผู้จำหน่ายคอยจับตามองอยู่ข้างหลังคุณ คุณจะดาวน์โหลดไปใช้ จะฟินจูน จะนำไปให้บริการภายใต้ขอบเขตการปฏิบัติตามข้อกำหนดของตัวเอง หรือจะเอาไปไว้กับโฮสต์ใดก็ได้ตามใจ — และเพราะน้ำหนักโมเดลถูกปล่อยออกสู่สาธารณะแล้ว ราคาของมันจึงมีพื้นรองรับที่ผู้จำหน่ายรายเดียวไม่อาจยกขึ้นได้ Nex-N2.5 Pro ถูกให้สัญญาว่าจะเปิดภายใต้ Apache-2.0 ซึ่งเป็นสัญญาอนุญาตที่เสรีพอๆ กัน แต่แบนเนอร์บนการ์ด Hugging Face ของมันกลับเขียนว่าน้ำหนักโมเดลกำลังจะมา โดยไม่มีกำหนดวันที่แน่นอน สำหรับทีมที่อยู่ใต้กฎการกำกับดูแลข้อมูล หรือทีมที่ต้องการหลุดพ้นจากการคิดค่าบริการต่อโทเคนโดยสิ้นเชิงเมื่อใช้งานในระดับใหญ่ ความต่างนั้นคือตัวตัดสินใจทั้งหมด: GLM-5.2 คือโมเดลที่คุณเป็นเจ้าของได้ในวันนี้ ส่วน Nex-N2.5 Pro คือโมเดลที่คุณได้เพียงคำสัญญา ตัวเลขการโฮสต์ด้วยตัวเองก็เข้าข้างตัวใหม่อีกเช่นกันเมื่อน้ำหนักโมเดลถูกปล่อยออกมาในที่สุด — พารามิเตอร์แอ็กทีฟ 17B บนโหนด H100 แปดตัวถือเป็นขนาดการใช้ทรัพยากรที่เข้าถึงได้ง่ายกว่ากล่องของ GLM-5.2 ซึ่งใช้พารามิเตอร์แอ็กทีฟราว 40B อย่างเทียบกันไม่ได้ — แต่คำว่า “เมื่อน้ำหนักโมเดลถูกปล่อยออกมา” ในประโยคนั้นต้องแบกรับน้ำหนักไว้เยอะมาก

ครอบครัวต่างๆ กำลังย้ายไปในทิศทางตรงกันข้าม

โมเดลทั้งสองอยู่ในตระกูลที่พัฒนาอย่างรวดเร็ว และวิถีการพัฒนาก็ดึงไปคนละทิศทาง สายเลือดของ GLM-5.2 มีความโปร่งใสและเป็นแบบวนซ้ำ: Z.ai เปิดตัว GLM-5.3 ในเดือนสิงหาคมในฐานะการปรับปรุงหลังการเทรนของเบส 5.2 เดิม และ GLM-5.3 Flash ในช่วงต้นเดือนกันยายน ดังนั้นน้ำหนัก 5.2 ที่คุณสร้างต่อในวันนี้คือรากฐานที่ตระกูลยังคงปรับปรุงอย่างต่อเนื่อง — ความรู้ด้านสถาปัตยกรรมและไฟน์จูนของคุณถูกส่งต่อ ตระกูลของ Nex-AGI คือการเดิมพันบนเจเนอเรชันใหม่ล่าสุด: Nex-N2.5 Mini ที่ 35B, Nex-N2.5 Pro ที่ 397B และ Nex-N2.5 Max แบบข้อความอย่างเดียวที่ 1.6T ซึ่งเบสของมันคือ DeepSeek-V4-Pro-Base โดยที่น้ำหนัก Pro ที่จะให้ใครก็ตามตรวจสอบคำกล่าวอ้างของตระกูลได้นั้นยังไม่ถูกเผยแพร่ ทีมที่เลือกแพลตฟอร์มเพื่อสร้างต่อ กำลังเลือกระหว่างสายเลือดที่มีแผนงานการรีเฟรชที่เผยแพร่แล้ว กับการเปิดตัวครั้งแรกที่องก์ที่สองยังมาไม่ถึง

ตัวไหนที่คู่ควรกับ build ของคุณ

หากข้อกำหนดของคุณคือ "โมเดลต้องเป็นของเรา" — เพื่อธรรมาภิบาลข้อมูล เพื่อการตรวจสอบ สำหรับผลิตภัณฑ์ที่คุณไม่ต้องการให้ผู้จำหน่ายรายเดียวควบคุม — GLM-5.2 ไม่ใช่ตัวเลือกที่ดีกว่าในการเปรียบเทียบนี้ แต่เป็นตัวเลือกเดียวเท่านั้น เพราะเป็นโมเดลเดียวในรายการนี้ที่คุณดาวน์โหลดได้ อีกทั้งยังเป็นรุ่นเดียวที่มีคะแนนประเมินอิสระ และมีราคาตามรายการของ Z.ai อยู่ที่ 1.40 ดอลลาร์ต่อล้านอินพุต และ 4.40 ดอลลาร์ต่อล้านเอาต์พุต หากข้อกำหนดของคุณคือเอเจนต์มัลติโหมดสำหรับควบคุมคอมพิวเตอร์ที่อาจกัดกร่อนความได้เปรียบของผู้นำระบบปิดได้ในที่สุด Nex-N2.5 Pro คือแนวคิดระยะยาวที่น่าสนใจกว่า — โอเปอเรเตอร์ด้านวิทัศน์แบบแอกทีฟ 17B จากพันธมิตรที่รู้ชัดเจนว่าตนต้องการสร้างอะไร — แต่แนวคิดไม่ใช่สิ่งที่พึ่งพาได้ และเอนด์พอยต์ที่โฮสต์ให้ใช้ฟรีไม่ใช่รากฐาน

Screenshot of the OrcaRouter model page for GLM-5.2 (z-ai/glm-5.2), marked FEATURED, showing the header stats $1.40 input and $4.40 output per million tokens and the byline 'by Z.ai - 2026-06-16'.

แนวทางปฏิบัติจริงที่จะลงมือกับทั้งหมดนี้คือการต่อยอดจากสิ่งที่มีอยู่แล้ว และวัดผลตามคำสัญญาเมื่อมันมาถึง GLM-5.2 มีให้บริการบน OrcaRouter ในราคารายการของ Z.ai — เท่ากับ $1.40 / $4.40 ส่งผ่านโดยไม่มีมาร์กอัป — และเนื่องจากเป็นโมเดลแบบเปิดน้ำหนัก (open-weights) จึงยังโฮสต์เองได้ หากคุณต้องการให้การวัดผลครอบคลุมสแตกการให้บริการของคุณเอง มันคือจุดอ้างอิงสำหรับรันเวิร์กโหลดแบบเอเจนต์จริงของคุณในวันนี้ โดยมี routing DSL ทำหน้าที่แทนวันที่ Nex-N2.5 Pro จะปรากฏบนผู้ให้บริการตามราคารายการ: เมื่อถึงตอนนั้น การเปลี่ยนการเปรียบเทียบคือกฎการจัดเส้นทาง (routing rule) ไม่ใช่การย้ายระบบ จนกว่าชาร์ดจะถูกปล่อยออกมาและการทดสอบจากอิสระจะยืนยัน — หรือแก้ไข — ว่าคะแนน 82.7 นั้น การเทียบระหว่าง Nex-N2.5 Pro กับ GLM-5.2 คือการจับคู่ระหว่างโมเดลที่คุณตรวจสอบได้กับตัวเลขที่คุณตรวจสอบไม่ได้

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube