การ์ดชื่อเรื่องหลักสำหรับ "Fugu Max vs GLM-5.3" พร้อมคำโปรย "โมเดลคุณค่าถูกกดราคาโดยโมเดลปริมาณ" ป้ายทรงแคปซูลสามป้ายที่ระบุว่า "$6.00 vs $3.96 output", "7,962.7M tokens per 7d", "$2.00 vs $1.26 input" บรรทัดส่วนท้ายที่ระบุว่า "Sakana AI vs Z.ai - September 2026" และโลโก้ OrcaRouter ที่มุมขวาล่าง
Engineering & Research

Fugu Max vs GLM-5.3: โมเดลที่เน้นคุณค่าถูกบั่นทอนโดยโมเดลที่เน้นปริมาณ

ผู้เขียน

Magnus Corvin

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Fugu Max ถูกตั้งราคาให้ชนะในเรื่องต้นทุน และ GLM-5.3 ก็ถูกกว่าในทั้งสองแกน ตัวประสานงานของ Sakana AI เปิดตัวเมื่อวันที่ 11 กันยายน 2026 ในราคา $2.00 ต่ออินพุตหนึ่งล้านโทเคน และ $6.00 ต่อเอาต์พุตหนึ่งล้านโทเคน ถูกสร้างขึ้นเพื่อจัดเส้นทางแต่ละงานไปยังโมเดลที่ถูกที่สุดที่รับมือไหว ส่วน GLM-5.3 ของ Z.ai ซึ่งอยู่ในรายการตั้งแต่ 18 สิงหาคม 2026 อยู่ที่ $1.26 สำหรับอินพุต และ $3.96 สำหรับเอาต์พุตต่อหนึ่งล้านบน OrcaRouter — ต่ำกว่า Fugu Max ตั้งแต่หนึ่งในสามจนถึงสองในห้าในทั้งสองด้าน จากโมเดลแบบข้อความล้วนเพียงตัวเดียวที่มีหน้าต่างบริบท 1M และเพดานเอาต์พุต 128K ตามที่ประกาศไว้ และ GLM-5.3 ก็ยังเป็นโมเดลที่ใช้งานหนาแน่นที่สุดในแค็ตตาล็อกของเราด้วยส่วนต่างที่ห่างมาก การผสมกันเช่นนี้ — ถูกกว่าต่อโทเคน และพิสูจน์ได้ว่ารองรับทราฟฟิกโปรดักชันในระดับสเกล — ทำให้คู่นี้เป็นคู่ที่ค่าเบี้ยพรีเมียมของการประสานงานอธิบายได้ยากที่สุด

ถูกกว่าในทั้งสองแกน โดยมีข้อมูลจำเพาะเผยแพร่แล้ว

การเปรียบเทียบนี้สร้างความอึดอัดให้กับ Fugu Max ก่อนที่เบนช์มาร์กใด ๆ จะเข้ามาเกี่ยวข้องด้วยซ้ำ เพราะนี่ไม่ใช่กรณีของการแลกความสามารถกับราคา GLM-5.3 เป็นเรือธงที่อยู่ใกล้ระดับแนวหน้าด้วยตัวมันเอง — Z.ai ระบุว่ามันมอบการปรับปรุงด้านการเขียนโค้ดราว 50% เมื่อเทียบกับ GLM-5.2 และเทียบเท่า Mythos 5 ในความสามารถด้านความมั่นคงปลอดภัยไซเบอร์บางด้าน มันไม่ใช่โมเดลราคาประหยัดที่ถูกเสนอเป็นทางเลือกราคาถูก แต่เป็นเรือธงที่บังเอิญถูกตั้งราคาไว้ต่ำกว่าออร์เคสเตรเตอร์ที่ปรับให้เหมาะกับต้นทุน

• ราคาอินพุต — Fugu Max $2.00 ต่อ 1 ล้านโทเคน เทียบกับ GLM-5.3 $1.26 ต่อ 1 ล้านโทเคน

• ราคาเอาต์พุต — Fugu Max $6.00 ต่อ 1 ล้านโทเคน เทียบกับ GLM-5.3 $3.96 ต่อ 1 ล้านโทเคน

• อินพุตที่แคชไว้ — Fugu Max $0.25 ต่อ 1M โทเค็น เทียบกับ GLM-5.3 ซึ่งคิดราคาการแคชเป็นส่วนลดจากอัตราอินพุตพื้นฐาน

• บริบท — Fugu Max ยังไม่ถูกเผยแพร่ เทียบกับ GLM-5.3 1M โทเค็น

• เพดานเอาต์พุต — Fugu Max ไม่เปิดเผย vs GLM-5.3 128K โทเคน

• มอดาลิตี — Fugu Max ไม่ได้เปิดเผย เทียบกับ GLM-5.3 แบบข้อความเท่านั้น ซึ่งระบุไว้ในเอกสารเช่นนั้น

• แท็กความสามารถ — Fugu Max ไม่มีการเผยแพร่ เทียบกับ GLM-5.3 การใช้เครื่องมือ โหมด JSON การให้เหตุผล

• ตัวเลข benchmark — Fugu Max อ้างชัยชนะ 6 ครั้งโดยไม่มีคะแนน เทียบกับ GLM-5.3 ที่ผู้ขายรายงาน DeepSWE 46.2 ถึง 66.9 จากรุ่นก่อนหน้า บวกกับคะแนนด้านสติปัญญาของ Artificial Analysis ที่เผยแพร่

• น้ำหนักโมเดล — Fugu Max เป็นแบบปิด, พูลไม่เปิดเผย vs GLM-5.3 จากแล็บที่มีสายตระกูลโอเพนเวตส์

ทราฟฟิกที่สังเกตพบบน OrcaRouter — Fugu Max ไม่มี, ไม่ได้ถูกนำส่ง เทียบกับ GLM-5.3 7,962.7 ล้านโทเคนในช่วงเจ็ดวันที่ผ่านมา

สังเกตว่าสองแถวสุดท้ายทำอะไรร่วมกัน GLM-5.3 มาจากสายตระกูลที่มีน้ำหนักแบบเปิด ซึ่งเป็นรูปแบบที่แข็งแกร่งที่สุดเท่าที่มีของข้อโต้แย้งเรื่องความเป็นอิสระจากผู้จำหน่ายที่ Sakana ใช้ขายเป็นข้อตั้งต้นทั้งหมดของ Fugu Max และมันมีตัวเลขปริมาณการใช้งานที่สังเกตได้สูงกว่าโมเดลส่วนใหญ่ที่เราให้บริการราวหนึ่งอันดับขนาด ถ้าคำถามคือ “ฉันจะรันอะไรสำหรับงานโปรดักชันที่เน้นข้อความในอัตราต่ำ” หลักฐานกลับชี้ไปที่อื่นที่ไม่ใช่ตัวออร์เคสเตรเตอร์

A two-column scoreboard titled "Fugu Max vs GLM-5.3 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Context not published, Output ceiling not published, Modality not published, Observed traffic not carried. Right column GLM-5.3: Output price $3.96 / 1M, Input price $1.26 / 1M, Context 1M tokens, Output ceiling 128K tokens, Modality text-only and documented, Observed traffic 7,962.7M tokens over 7 days. Footer reading "Fugu Max figures vendor-reported by Sakana AI; GLM-5.3 pricing and traffic from OrcaRouter, September 11 2026.", with the OrcaRouter logo bottom-right.

ข้อโต้แย้งเรื่องปริมาณ และเหตุใดจึงไม่ใช่เพียงการประกวดความนิยม

จำนวนทราฟฟิกไม่ใช่ตัวเลขที่บอกคุณภาพ และไม่ควรตีความให้เป็นเช่นนั้น สิ่งที่ 7.96 พันล้านโทเคนในเจ็ดวันแสดงให้เห็นก็คือ GLM-5.3 ถูกใช้งานในระดับโปรดักชันโดยทีมอิสระจำนวนมาก บนเวิร์กโหลดจริง และไม่ได้ทำให้เกิดการย้ายหนีไปจากมันกันเป็นจำนวนมาก นั่นเป็นสัญญาณที่อ่อนเกี่ยวกับคุณภาพ และเป็นสัญญาณที่แข็งแกร่งเกี่ยวกับความพร้อมด้านปฏิบัติการ: ความหน่วงคงที่ ปริมาณงานรับไหว API ทำงานได้ดีภายใต้โหลด และรูปแบบความล้มเหลวเป็นที่รู้จักในหมู่คนมากพอที่จะถูกเปิดเผยต่อสาธารณะ โมเดลที่เปิดตัวในสัปดาห์เดียวกับ Fugu Max ไม่มีสิ่งใดเหล่านั้นรองรับอยู่เลย

บรรทัดข้อมูลความหน่วงทำให้ประเด็นนี้ชัดเจนยิ่งขึ้น GLM-5.3 มีค่า p50 time-to-first-token อยู่ที่ 4.33 วินาที จากทราฟฟิกที่เราให้บริการ สำหรับงานแบบ agentic ซึ่งเป็นภาระงานที่ผลิตภัณฑ์ทั้งสองนี้มุ่งเป้าไปที่ time-to-first-token จะทบต้นไปในทุกเทิร์นของทุก subagent ที่ coordinator สร้างขึ้น ออร์เคสเตรเตอร์ที่ถูกกว่าซึ่งสร้างเอเจนต์สี่ตัวไม่ถือว่าถูกกว่า หากแต่ละตัวต้องรอหลายวินาทีก่อนจะเริ่มส่งอะไรออกมา และค่าใช้จ่ายนั้นไม่เคยปรากฏบนเรตการ์ด

ข้อโต้แย้งตอบกลับของ Fugu Max คือตัวประสานงานของมันจะส่งต่อไปยังโมเดลที่ความสามารถเพียงพอและประหยัดที่สุดต่อหนึ่งคำขอ ซึ่งโดยหลักการแล้วหมายความว่าหลายงานไม่จำเป็นต้องแตะแบ็กเอนด์ราคาแพงเลยด้วยซ้ำ การขยายพูลในรุ่นนี้ของ Sakana ได้เพิ่มโมเดลแบบเปิดน้ำหนักและโมเดลเฉพาะทาง รวมถึงตระกูล NVIDIA Nemotron ผ่านความร่วมมือกับ NVIDIA ดังนั้นขั้นบันไดราคาถูกของบันไดนั้นจึงมีอยู่จริง คำถามคือขั้นเหล่านั้นถูกกว่า $3.96 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคนหรือไม่ สำหรับงานข้อความส่วนใหญ่ พวกมันไม่ถูกกว่า — นั่นเป็นเกณฑ์ที่ต่ำ และโมเดลแบบเปิดน้ำหนักที่ให้บริการในอัตราโฮสต์มักผ่านเกณฑ์นี้เพียงเล็กน้อยเท่านั้น

คำถามที่ควรถามก่อนที่คุณจะเลือก

ออร์เคสเตรเตอร์ถูกกว่าโมเดลแบบเปิดน้ำหนักเพียงตัวเดียวหรือไม่ โดยค่าเริ่มต้นแล้วไม่ และสัญชาตญาณที่มักใช้คิดก็ชี้ไปผิดทาง การออร์เคสเตรชันเพิ่มโทเคนการสังเคราะห์ของผู้ประสานงาน และในการรันแบบหลายเอเจนต์ยังเพิ่มเอาต์พุตของทุกเอเจนต์ในทีมด้วย ราคาของ Fugu จาก Sakana ขจัดกรณีที่แย่ที่สุดออกไป ด้วยการคิดเรตผสมเรตเดียวโดยอิงจากโมเดลระดับสูงสุดที่เข้าร่วม แทนที่จะบวกค่าใช้จ่ายของเอเจนต์ซ้อนกัน ซึ่งถือเป็นความยอมผ่อนที่แท้จริง แต่เรตฐานที่คุณนำมาผสมคือเอาต์พุต $6.00 ส่วนโมเดลเดียวที่คุณจะเรียกใช้แทนนั้นอยู่ที่ $3.96 การออร์เคสเตรชันช่วยประหยัดเงินเมื่อมันป้องกันการลองซ้ำ ไม่ใช่เมื่อมันเพิ่มการทำงานแบบขนานเพื่อความขนานในตัวเอง

ข้อจำกัดแบบรองรับเฉพาะข้อความสำคัญกับตัวใดตัวหนึ่งหรือไม่ สำหรับ GLM-5.3 นั้นมีการบันทึกไว้ จึงเป็นข้อจำกัดที่คุณวางแผนรับมือได้ — ไม่มีวิชัน ไม่มีเสียง ไม่มีวิดีโอ และแคตตาล็อกระบุไว้เช่นนั้น สำหรับ Fugu Max ความสามารถด้านมอดัลลิตี้ไม่ได้ถูกเปิดเผยเลย นั่นแย่กว่าข้อจำกัดเสียอีก เพราะคุณไม่อาจรู้ได้ว่าไปป์ไลน์ที่ส่ง PDF จะทำงานได้หรือไม่จนกว่าจะลอง ข้อจำกัดที่ไม่ได้ระบุไว้ไม่เหมือนกับข้อจำกัดที่ไม่มี

จะเกิดอะไรขึ้นกับแต่ละตัวเมื่อโมเดลพื้นฐานเปลี่ยนแปลง? GLM-5.3 เป็นโมเดลเดียวในเวอร์ชันเดียว ที่ฝึกและให้บริการโดย Z.ai หาก Z.ai เปลี่ยนราคา การเปลี่ยนแปลงนั้นจะส่งผลถึงคีย์ของคุณภายในวันเดียวกันผ่าน OrcaRouter โดยบวกกำไร 0% และคุณมองเห็นและตอบสนองได้ พฤติกรรมของ Fugu Max ขึ้นอยู่กับพูลที่ Sakana ไม่เปิดเผยสมาชิก ดังนั้นการเลิกใช้หรือการเปลี่ยนราคาของแล็บแนวหน้าจะเปลี่ยนสิ่งที่คุณกำลังซื้ออย่างเงียบ ๆ โดยที่ชื่อผลิตภัณฑ์ไม่เปลี่ยน Sakana นำเสนอสิ่งนี้ว่าเป็นความทนทานต่อการเปลี่ยนแปลง มันคือความทนทานสำหรับผู้ขาย และความไม่โปร่งใสสำหรับผู้ซื้อ

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

จุดที่การตัดสินใจด้านเส้นทางเกิดขึ้นจริง

ทั้งสองอย่างนี้แท้จริงแล้วคือการตัดสินใจด้านการกำหนดเส้นทาง — Fugu Max ตัดสินใจ这些事情ภายในตัวประสานงานแบบทึบแสง ส่วนคุณตัดสินใจที่ชั้น API OrcaRouter เป็นแบบที่สอง: API เดียวสำหรับโมเดลกว่า 200 ตัว พร้อม DSL สำหรับการกำหนดเส้นทาง ที่ให้คุณระบุนโยบายได้อย่างชัดแจ้ง พร้อมการสลับไปใช้เส้นทางสำรองอัตโนมัติเมื่อเส้นทางของผู้ให้บริการเสื่อมประสิทธิภาพลง และการหลอมรวมโมเดลเมื่อคุณต้องการรวมผลลัพธ์อย่างจงใจ แทนที่จะปล่อยให้กล่องดำจัดการให้ GLM-5.3 อยู่ในแคตตาล็อกนั้นในราคาตามที่ Z.ai ประกาศ โดยบวกเพิ่ม 0% ซึ่งมีค่ามากกว่าปกติสำหรับโมเดลที่มีปริมาณการใช้งานหนาแน่นขนาดนี้: อัตราที่คุณเห็นคืออัตราที่ Z.ai เผยแพร่ ส่งผ่านมาโดยไม่ถูกปรับแต่งใด ๆ

ความแตกต่างในทางปฏิบัติคือความสามารถในการตรวจสอบย้อนหลัง เมื่อ Fugu Max เลือกโมเดลให้กับคำขอของคุณ คุณจะไม่รู้เลยว่ามันเลือกโมเดลไหนหรือเพราะเหตุใด เมื่อคุณเขียนนโยบายการกำหนดเส้นทางด้วยตัวเอง การตัดสินใจจะอยู่ในรีโพซิทอรีของคุณ ตรวจสอบได้โดยใครก็ตามที่ตรวจสอบโค้ดของคุณ และแก้ไขได้โดยไม่ต้องรอผู้ขาย สำหรับทีมที่อยู่ภายใต้ภาระผูกพันด้านการปฏิบัติตามข้อกำหนดหรือการบัญชีต้นทุนใด ๆ นั่นไม่ใช่ความแตกต่างเชิงปรัชญา

คำตัดสิน

GLM-5.3 ชนะการเปรียบเทียบนี้ในประเด็นที่ทีมงานระดับโปรดักชันให้ความสำคัญมากที่สุด: ราคาถูกกว่าทั้งในส่วนอินพุตและเอาต์พุต มีการเผยแพร่ทั้งหน้าต่างบริบทและเพดานเอาต์พุต มีการระบุข้อจำกัดด้านมอดาลิตีไว้อย่างชัดเจน รองรับ tool use, JSON mode และ reasoning เป็นความสามารถที่มีเอกสารยืนยัน มาจากสายเลือดโมเดลแบบ open-weights และมีตัวเลขทราฟฟิกในรอบเจ็ดวันใกล้แตะแปดพันล้านโทเคน ไม่มีการตีความหลักฐานสาธารณะใดที่ทำให้ Fugu Max เป็นการซื้อที่มีหลักฐานรองรับดีกว่า ณ ระดับราคานี้

Fugu Max ยังมีข้อโต้แย้งอยู่เพียงข้อเดียว และเป็นข้อที่ใช้ได้จริง: สำหรับงานที่การตรวจรอบที่สองของตัวประสานงานจับข้อผิดพลาดที่รอบแรกอาจปล่อยผ่านไปแล้ว ต้นทุนต่องานที่ทำเสร็จอาจชนะต้นทุนต่อโทเคน นั่นคุ้มค่าที่จะทดลองนำร่องแบบจำกัดขอบเขต หากงานของคุณตรวจสอบได้ มีปริมาณสูง และคุณอยู่นอก EU/EEA — โดยกำหนดเพดานโทเคนเอาต์พุตไว้ล่วงหน้า และวัดจำนวนโทเคนต่องานที่ทำเสร็จ มิฉะนั้น คำตอบคือโมเดลเดียวที่ถูกกว่าหนึ่งในสามและรันภายใต้โหลดโปรดักชันมาแล้วหนึ่งเดือน และมีให้ใช้บน OrcaRouter ในราคาตามรายการของ Z.ai โดยส่งผ่านอัตราของผู้ให้บริการตามจริง

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, captured September 11, 2026, English UI), showing the NEW and Featured badges, the z-ai/glm-5.3 model ID, the Tools, JSON and Reasoning tags over a text-only model, the listing date 2026-08-18, the /v1/chat/completions endpoint, the pricing tiles reading INPUT $1.26 and OUTPUT $3.96 per 1M tokens with p50 TTFT 4.33s and 7,962.7M tokens of 7-day traffic, the 1M token context with 128K max output, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube