
Step 5 Preview vs GLM-5.5: โมเดลหนึ่งเปิดตัววันนี้ อีกโมเดลยังเป็นเพียงการคาดการณ์
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Step 5 Previewเปิด API เมื่อวันที่ 20 กันยายน 2026 ซึ่งเป็นวันเดียวกับที่ StepFun ประกาศเปิดตัว และคุณสามารถเรียกใช้งานได้ในช่วงบ่ายนี้จาก endpoint เดียว ในราคา 1.00 ดอลลาร์ต่อหนึ่งล้านโทเคนอินพุต และ 2.70 ดอลลาร์ต่อหนึ่งล้านโทเคนเอาต์พุต GLM-5.5ไม่มีอยู่จริง ไม่มีการ์ดโมเดล ไม่มีตัวระบุ API ไม่มีราคา ไม่มีเช็กพอยต์ และไม่มีไฟล์ใบอนุญาต และไม่มีหน้าใดของ Z.ai ที่ใช้ชื่อนี้ — เพราะ GLM-5.5 เป็นชื่อเรียกสั้น ๆ ในชุมชนที่บริษัทไม่เคยรับมาใช้ ความไม่สมมาตรนี้คือแก่นของบทความ สิ่งที่ตามมาคือสิ่งที่ StepFun เปิดตัวจริง สิ่งที่ยืนยันได้จริงเกี่ยวกับเรือธงรุ่นถัดไปของ Z.ai และการเปรียบเทียบแบบตัวต่อตัวที่คุณรันได้วันนี้ แทนที่จะเป็นอย่างที่อยู่ในพาดหัว
GLM-5.5 คืออะไร และไม่ใช่อะไร
ชื่อนี้เริ่มเป็นที่รู้จักในช่วงกลางปี 2026 โดยผูกกับช่วงเวลาการเปิดตัว และช่วงเวลานั้นมีที่มาที่สืบย้อนได้: การคาดการณ์ของนักวิเคราะห์ที่ส่งต่อเมื่อวันที่ 25 มิถุนายน 2026 ซึ่งระบุว่าเรือธงรุ่นถัดไปของ Z.ai จะเปิดตัวในเดือนสิงหาคม มันเป็นช่วงเวลาที่จับตามอง ไม่ใช่คำมั่นจากผู้จำหน่าย และเดือนสิงหาคมก็สิ้นสุดลงโดยไม่มีมัน สิ่งที่ Z.ai เปิดตัวแทนคือ GLM-5.3 ซึ่งประกาศเมื่อวันที่ 14 สิงหาคม โดยมี API ใช้งานได้ประมาณวันที่ 18 สิงหาคม และเปิด weights ในวันที่ 28 สิงหาคม ตามมาด้วย GLM-5.3-Flash ในวันที่ 26 สิงหาคม ไม่มีเช็กพอยต์ของ GLM-5.5 ปรากฏบนองค์กร Hugging Face ของผู้จำหน่ายเอง ซึ่งที่เก็บข้อมูลใหม่ล่าสุดยังคงสูงสุดอยู่ที่ซีรีส์ GLM-5.3
การตั้งชื่อก็ยังไม่ลงตัวเช่นกัน GLM-5.3, GLM-5.4, GLM-5.5 และ GLM-6 ต่างถูกพูดถึงในช่วงเวลาเดียวกัน และ Z.ai ก็ยังไม่ได้ยืนยันชื่อใดในนั้นเลย สัญญาณเดียวจากฝั่งบริษัทคือความเห็นของผู้ร่วมก่อตั้งคนหนึ่งเกี่ยวกับการเปิดตัว "epic plus" ซึ่งเป็นเพียงอารมณ์มากกว่าข้อกำหนด นักวิเคราะห์ที่อ่านจังหวะของค่าย — ประมาณหนึ่งรุ่นเรือธงทุก 54 ถึง 70 วัน — ตอนนี้คาดการณ์ว่าโมเดลถัดไปจะมาในช่วงวันที่ 8 ตุลาคม ถึง 9 พฤศจิกายน 2026 และคาดว่าจะใช้หมายเลข GLM-5.4 มากกว่า GLM-5.5
มีข้อกล่าวอ้างสามข้อที่แพร่กระจายราวกับได้รับการยืนยันแล้ว และก็คุ้มค่าที่จะพูดให้ชัดเจนเกี่ยวกับทั้งสามข้อ จำนวนพารามิเตอร์เป็นข้อที่อ่อนที่สุด: ไม่มีแหล่งทางการใดสนับสนุนตัวเลข "มากกว่า 1 ล้านล้าน" และโพสต์โซเชียลในภายหลังที่ปั่นตัวเลขให้เกิน 3 ล้านล้านก็ไม่ได้อ้างอิงอะไรเลย บริบทขนาด 1M โทเคนเป็นสมมติฐานที่ปลอดภัยที่สุด เพราะทั้ง GLM-5.2 และ GLM-5.3 ต่างมีติดมาด้วย การเปิดน้ำหนักโมเดล (open weights) เป็นความคาดหวังมากกว่าคำสัญญา — Z.ai ได้เปิดตัวน้ำหนักของโมเดลเรือธงหลายรุ่นหลังสุด ซึ่งเป็นรูปแบบที่เกิดขึ้นซ้ำ ไม่ใช่คำมั่นสัญญา
สิ่งที่ Step 5 Preview ส่งมอบจริง ๆ
โมเดลของ StepFun คือครึ่งที่เป็นรูปธรรมของการเปรียบเทียบนี้ และสเปกก็ไม่ธรรมดาเลย มันเป็นโมเดล sparse mixture-of-experts ที่มีพารามิเตอร์รวม 600B โดยมีพารามิเตอร์ที่ทำงานจริงประมาณ 27B ต่อโทเคน — อัตราการเปิดใช้งานใกล้ 4.5% — สร้างบนทรานส์ฟอร์เมอร์แบบ narrow-and-deep 92 ชั้นที่ใช้ sparse grouped-query attention และการรวมโทเคนแบบ block-wise หน้าต่างบริบทคือ 1M โทเคน อินพุตเป็นข้อความและรูปภาพ เอาต์พุตเป็นข้อความ และมันให้เหตุผลด้วย extended thinking StepFun ข้ามสาย Step 4.x ทั้งหมดเพื่อมาถึงจุดนี้ โดยข้ามตรงจาก Step-3.7-Flash ไปยัง Step 5
• Intelligence Index — 44 บน Artificial Analysis อยู่อันดับที่ 24 จาก 200 โมเดลที่ได้รับการให้คะแนน เทียบกับค่ามัธยฐานที่ 24
• ความเร็วเอาต์พุต — 99.8 โทเคนต่อวินาที, อันดับที่ 45 จาก 200
• เวลาถึงโทเค็นแรก — 2.96 วินาทีในการรันแบบอิสระเดียวกัน
• ราคา — $1.00 ต่อ 1M โทเคนอินพุต, $2.70 ต่อ 1M โทเคนเอาต์พุต พร้อมส่วนลดแคช 95%
• ค่าใช้จ่ายต่องาน Intelligence Index — $0.71, อันดับ 27 จาก 200
• น้ำหนักโมเดล — วันนี้ยังไม่มี; กำหนดการเผยแพร่เช็กพอยต์ BF16 ในวันที่ 15 ตุลาคม 2026
• สัญญาอนุญาต — ไม่มีการเผยแพร่ โมเดลนี้เป็นกรรมสิทธิ์ โดยไม่มีการระบุถึงการอนุญาตให้ใช้เชิงพาณิชย์ สิทธิ์ในการเผยแพร่ต่อ หรือการอนุญาตให้ปรับแต่งละเอียด
ราคาเป็นแถวที่สะดุดตา และอีกแถวหนึ่งก็เช่นกัน ซึ่งเป็นแถวที่ไม่ได้ให้ประโยชน์กับ StepFun อย่างที่ดูเหมือนในตอนแรก: โทเคนเอาต์พุต 160M บน Intelligence Index เทียบกับค่ามัธยฐานที่ 92M อยู่ในอันดับที่ 64 จาก 200 ในการวัดนั้น โมเดลนี้ช่างพูดช่างเขียนยาว และความยาวเกินจำเป็นคือตัวคูณต้นทุนในงานแบบเอเจนติกที่มันถูกขายให้พอดี ตัวเลขต้นทุนต่องานที่ 0.71 ดอลลาร์ได้รวมเรื่องนั้นเข้าไปแล้ว ซึ่งเป็นเหตุผลว่าทำไมมันจึงเป็นตัวเลขที่ซื่อตรงกว่าที่จะอ้างอิง เมื่อเทียบกับราคาตามรายการ
การประเมินของ StepFun เองนั้นยังไม่ถูกทำซ้ำ และควรอ่านเป็นเอกสารจากผู้ขายจนกว่าจะมีบุคคลอิสระรันมัน พวกเขาจัดให้โมเดลอยู่ที่ 29.5 บน ALE-CLI, 66.4 บน FrontierFinance, 83.3 บน DRACO, 80.5 บน ProgramBench, 67.7 บน DeepSWE v1.1 และ 49.0 บน StepCodeBench โดยได้ 33.3% บน Terminal-Bench 4.0 และ 1571 บน GDPval-AA v2 StepFun ยังรายงานจุดสูงสุด MLA ที่ 508 TFLOPS ในงานปรับแต่งเคอร์เนล GPU เป็นเวลา 24 ชั่วโมง เทียบกับ 493 ของ Claude Opus 5 นั่นเป็นตัวเลขของ StepFun เกี่ยวกับโมเดลที่ StepFun ยังไม่ได้เปิด

การเปรียบเทียบแบบตัวต่อตัวที่คุณสามารถรันแทนอันนี้ได้
ถ้าคุณต้องการการเปรียบเทียบอย่างที่ชื่อเรื่องสัญญาไว้ ตัวเลือกที่ซื่อตรงก็คือ Step 5 Preview เทียบกับ GLM-5.3 — โมเดลที่ Z.ai เปิดตัวจริง ยังคงเป็นเรือธงแบบเปิดรุ่นปัจจุบันของบริษัท และเป็นรุ่นที่ GLM-5.5 ไม่เวอร์ชันไหนก็ตามจะเข้ามาแทนที่ บนบอร์ดจัดอันดับอิสระ ทั้งสองห่างกันเพียงหนึ่งคะแนน แต่ในแทบทุกอย่างอื่นไม่ใช่เช่นนั้น
• ดัชนีความฉลาด — Step 5 Preview 44 vs GLM-5.3 45
• พารามิเตอร์ — 600B ทั้งหมด / 27B ที่ใช้งาน เทียบกับ 753B ทั้งหมด / 40B ที่ใช้งาน
• ความเร็วเอาต์พุต — 99.8 โทเคน/วินาที เทียบกับ 72.1 โทเคน/วินาที
• เวลาถึงโทเคนแรก — 2.96 วินาที เทียบกับ 2.99 วินาที
• ราคาต่อ 1M โทเคน — ขาเข้า $1.00 / ขาออก $2.70 เทียบกับ ขาเข้า $1.40 / ขาออก $4.40
• ส่วนลดแคช — 95% เทียบกับ 81%
• ต้นทุนต่องาน Intelligence Index — $0.71 เทียบกับ $2.01
• รูปแบบอินพุต — ข้อความและรูปภาพ เทียบกับข้อความเท่านั้น
• สัญญาอนุญาต — ไม่มีเผยแพร่ เทียบกับสัญญาอนุญาต Z.ai แบบกำหนดเองที่ไม่ใช่ MIT
รูปแบบนี้ตอกย้ำสิ่งที่การเปิดตัว Step 5 Preview ได้แสดงไว้เมื่อเทียบกับโมเดลที่ออกจำหน่ายแล้วทุกตัวที่มันถูกนำไปให้คะแนนเปรียบเทียบ นั่นคือความได้เปรียบด้านประสิทธิภาพอย่างชัดเจนและความสามารถที่เสมอกันในทางสถิติ มันสร้างโทเค็นได้เร็วขึ้นราว 38% มีค่าใช้จ่ายต่อล้านโทเค็นในทั้งสองทิศทางประมาณครึ่งหนึ่ง และถูกกว่า 2.8 เท่าต่องานดัชนีเมื่อเทียบกับ GLM-5.3 — ทั้งที่ได้คะแนนต่ำกว่าหนึ่งจุด บนกระดานคะแนน เลข 44 นั้นยังทำให้มันอยู่ในระดับเดียวกับ Kimi K3 ซึ่งเป็นสิ่งที่ควรรู้ก่อนจะมองว่าตัวใดตัวหนึ่งเป็นผู้นำ
แถวเดียวที่ Step 5 Preview ตามหลังอย่างชัดเจนคือแถวที่คุณไม่สามารถวัดประสิทธิภาพได้ GLM-5.3 มีไฟล์ใบอนุญาตและน้ำหนักที่ดาวน์โหลดได้ ส่วน Step 5 Preview มีรีโพซิทอรี Hugging Face ที่มีเพียง .gitattributes และระบุวันที่ 15 ตุลาคมสำหรับเช็กพอยต์ BF16 หากเรือธงรุ่นถัดไปของ Z.ai มาพร้อมน้ำหนักแบบเปิดภายใต้ข้อกำหนดเฉพาะแบบเดียวกับที่ใช้มาตลอดทั้งปี มันจะอยู่ในหมวดหมู่เดียวที่ Step 5 Preview ยังไม่มีคำตอบในตอนนี้ — ซึ่งเป็นเหตุผลจริง ๆ ที่การเปรียบเทียบกับ GLM-5.5 นั้นคุ้มค่าที่จะรอมากกว่าจะลงมือทำ

ทำไมการรอ GLM-5.5 จึงเป็นตัวเลือกที่แพง
ปัญหาที่เกิดขึ้นจริงกับโมเดลที่ห่างหายไปสองเดือนมาเป็นเวลาสองเดือน ก็คือ งานประเมินของคุณไม่สามารถรอไปพร้อมกับมันได้ GLM-5.5 ไม่มีเอนด์พอยต์ จึงไม่อาจวัดประสิทธิภาพ เทียบราคา ทดสอบโหลด หรือวางไว้เป็นกฎสำรองได้ ทุกสัปดาห์ที่ใช้ไปกับการวางแผนโดยอิงกับมัน คืออีกหนึ่งสัปดาห์ของการตัดสินใจที่ถูกเลื่อนออกไปด้วยความเชื่อมั่นในคำพยากรณ์ — และคำพยากรณ์นั้นก็พลาดหน้าต่างไปแล้วหนึ่งช่วง
ในทางกลับกัน GLM-5.3 เปิดให้บริการแล้วบน OrcaRouterภายใต้ z-ai/glm-5.3ในราคาอินพุต $1.26 และเอาต์พุต $3.96 เทียบกับราคาที่ Z.ai ประกาศไว้ที่ $1.40 และ $4.40 บนหน้าของตัวเอง นั่นคือการส่งผ่านโดยไม่มีมาร์กอัป ซึ่งหมายความว่าตัวเลขที่คุณเห็นคืออัตราปัจจุบันของผู้ให้บริการ ไม่ใช่อัตราที่เราตั้งไว้ และเมื่อผู้ขายเปลี่ยนแปลงราคา ฝั่งเราจะอัปเดตในวันเดียวกัน ไม่ใช่รอถึงรอบบิลถัดไป
Step 5 Preview ไม่ได้อยู่ในแค็ตตาล็อกของเรา และเราไม่ได้จัดเส้นทางให้มัน มันทำงานบน API และ Studio ของ StepFun เอง และนั่นเป็นที่เดียวที่มันทำงานจนกว่าเช็กพอยต์วันที่ 15 ตุลาคมจะมาถึง สิ่งที่ OrcaRouter มอบให้คุณในระหว่างนี้คือทุกสิ่งในอีกด้านของการเปรียบเทียบนั้น อยู่เบื้องหลัง API เดียวสำหรับโมเดลมากกว่า 200 รุ่น: GLM-5.3 ในอัตราข้างต้น, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 และอื่น ๆ พร้อมการสลับสำรองอัตโนมัติข้ามผู้ให้บริการที่ช่วยให้เส้นทางโปรดักชันมั่นคง ในขณะที่เส้นโค้งความจุของพรีวิวยังไม่เป็นที่ทราบ และ routing DSL ที่ประกอบหลายโมเดลเข้าเป็นการเรียกเดียวแทนที่จะเป็นการผสานรวมครั้งที่สอง ทดสอบพรีวิวเทียบกับโมเดลโปรดักชันด้วยคีย์เดียวกัน แล้วปล่อยเส้นทางโปรดักชันไว้ที่เดิม

อะไรจะเปลี่ยนคำตอบ
สองวันจะเป็นตัวตัดสินเรื่องนี้ วันที่ 15 ตุลาคมคือวันที่ StepFun ระบุว่าเช็กพอยต์ BF16 สำหรับ Step 5 Preview จะเปิดให้ใช้งาน และสัญญาอนุญาตที่มาพร้อมกับมันคือสิ่งที่ไม่ทราบเพียงหนึ่งเดียวที่ส่งผลมากที่สุดในการเปรียบเทียบ — สัญญาอนุญาตแบบผ่อนปรนจะทำให้ข้อได้เปรียบด้านต้นทุนต่องาน 2.8 เท่ากลายเป็นสิ่งที่คุณได้เป็นเจ้าของแทนที่จะต้องเช่า และจะลบมิติเดียวที่ GLM-5.3 เหนือกว่าอย่างชัดเจน สัญญาอนุญาตแบบจำกัดจะทำให้ GLM-5.3 เป็นตัวเดียวในทั้งคู่ที่คุณสร้างผลิตภัณฑ์ต่อยอดได้ และเปลี่ยนช่องว่างหนึ่งจุดให้กลายเป็นเกร็ดเล็กเกร็ดน้อยเกี่ยวกับสองโมเดลที่ยังไงคุณก็ใช้ต่างกันอยู่ดี
อย่างที่สองคือช่วงเวลาของนักวิเคราะห์ที่ดำเนินไปตั้งแต่วันที่ 8 ตุลาคมถึง 9 พฤศจิกายน สำหรับเรือธงรุ่นถัดไปของ Z.ai ซึ่งอาจมีชื่อว่า GLM-5.5 หรืออาจไม่มีก็ได้ และอาจคล้ายหรือไม่คล้ายกับข่าวลือก็ได้ หากมันมาถึงจริง มันจะมาในฐานะโมเดลที่มีใบอนุญาตและเช็กพอยต์ — สองสิ่งที่ Step 5 Preview ขาดไป — และการเปรียบเทียบก็จะกลายเป็นของจริง
จนกว่าทั้งสองจะคลี่คลาย คำถามที่มีประโยชน์ไม่ใช่ว่าตัวไหนในสองตัวนี้ดีกว่า เพราะหนึ่งในนั้นรันไม่ได้ แต่คือว่าตอนนี้คุณควรสร้างต่อยอดบนโมเดลใดในบรรดาโมเดลที่มีอยู่ และคำตอบจะเปลี่ยนไปหรือไม่เมื่อเช็กพอยต์ถัดไปปรากฏขึ้น คำถามนี้มีคำตอบที่ทดสอบได้ในสัปดาห์นี้ และไม่จำเป็นต้องรอให้ชื่อหนึ่งกลายเป็นโมเดล
การเปรียบเทียบในบทความนี้3
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
