
Fugu Max vs Qwen3.8-Max: ราคาเดียวกัน เบนช์มาร์กเดียวกัน ตัวเลขที่เผยแพร่เพียงค่าเดียว
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
Fugu Max และ Qwen3.8-Max กำหนดราคาไว้ที่อัตราเดียวกัน: 2.00 ดอลลาร์ต่อ 1 ล้านโทเค็นอินพุต และ 6.00 ดอลลาร์ต่อ 1 ล้านโทเค็นเอาต์พุต Sakana AI เปิดตัว Fugu Max เมื่อวันที่ 11 กันยายน 2026 และ Alibaba ให้บริการ Qwen3.8-Max มาตั้งแต่ต้นเดือนสิงหาคม และผู้ขายทั้งสองรายลงเอยที่ตารางราคาที่เหมือนกันจากทิศทางตรงกันข้าม — รายหนึ่งกำหนดราคาสำหรับนโยบายการจัดเส้นทาง อีกรายกำหนดราคาสำหรับโมเดลที่มีพารามิเตอร์ 2.4 ล้านล้านตัว การที่ราคาเสมอกันทำให้ราคาถูกตัดออกจากการตัดสินใจโดยสิ้นเชิง ซึ่งถือว่าสะอาดอย่างผิดปกติ สิ่งที่เหลืออยู่คือหลักฐาน และทั้งสองฝ่ายแตกต่างกันตรงจุดนั้นมากกว่าที่อื่นใด ตารางของผู้ขายทั้งสองระบุชื่อ Terminal Bench 2.1 Alibaba ระบุ 86.6 สำหรับ Qwen3.8-Max Sakana กล่าวว่า Fugu Max ได้คะแนนรวมดีที่สุดใน Terminal Bench 2.1 และไม่ระบุตัวเลขใด ๆ เลย — ไม่ว่าจะเป็นการทดสอบนั้นหรืออีกห้ารายการที่อ้างว่าชนะก็ตาม
เกณฑ์มาตรฐานเดียวที่ทั้งสองฝ่ายกล่าวถึง
นี่คือการแข่งขันทั้งหมดที่ถูกบีบอัดให้อยู่ในแถวเดียว ดังนั้นจึงคุ้มค่าที่จะให้ความสำคัญกับความแม่นยำในเรื่องนี้
ประกาศของ Sakana ระบุรายชื่อเบนช์มาร์กหกรายการที่ Fugu Max ได้คะแนนรวมสูงสุด ได้แก่ Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench และ SWEFish โดยห้ารายการเป็นการประเมินสาธารณะที่เป็นที่ยอมรับ และรายการที่หกคือ SWEFish ซึ่งเป็นเบนช์มาร์กด้านการเขียนโค้ดของ Sakana เอง สำหรับทั้งหกรายการนี้ ประกาศไม่ได้ระบุค่า ช่วงห่าง หรือตัวเลขของคู่แข่งที่จะนำมาเทียบเคียงไว้เลย ข้อกล่าวอ้างในทำนองเดียวกัน — ที่ว่า Fugu Max ขยายพรมแดนพาเรโต (Pareto frontier) ด้านต้นทุน-ประสิทธิภาพบนเจ็ดในสิบเบนช์มาร์ก — ก็เป็นข้อความเกี่ยวกับตำแหน่งบนแผนภูมิมากกว่าจะเป็นจุดบนแกนเช่นกัน
ตัวเลขที่ Alibaba เผยแพร่สำหรับ Qwen3.8-Max ได้แก่ Terminal-Bench 2.1 ที่ 86.6, OSWorld-Verified ที่ 86.1, GPQA Diamond ที่ 92.6 และ SWE-bench Pro ที่ 67.7 ทั้งหมดเป็นข้อมูลที่ผู้ขายรายงานเอง ทั้งหมดเป็นตัวเลข ดังนั้นในการทดสอบเพียงรายการเดียวที่ทั้งสองบริษัทเลือกเอ่ยชื่อ รายหนึ่งได้เผยแพร่ตัวเลข ส่วนอีกรายหนึ่งได้เผยแพร่อันดับ จากตรงนั้นคุณไม่อาจสรุปได้ว่าระบบใดดีกว่า — คำว่า "ดีที่สุดโดยรวม" ของ Sakana อาจหมายถึง 91 หรือ 87 ก็ได้ สิ่งที่คุณสรุปได้คือ ณ เวลาที่เผยแพร่ ไม่มีหลักฐานสาธารณะใดตอบคำถามนี้ และผู้ขายที่อ้างสิทธิ์มากกว่าคือรายที่ปฏิเสธที่จะระบุเป็นตัวเลข
ราคาเดียวกัน โครงสร้างตรงกันข้าม
• อินพุต — Fugu Max $2.00 ต่อ 1 ล้านโทเค็น เทียบกับ Qwen3.8-Max $2.00 ต่อ 1 ล้านโทเค็น
• เอาต์พุต — Fugu Max $6.00 ต่อ 1M โทเคน เทียบกับ Qwen3.8-Max $6.00 ต่อ 1M โทเคน
• อินพุตที่แคชไว้ — Fugu Max $0.25 ต่อ 1M โทเค็น เทียบกับ Qwen3.8-Max $0.25 ต่อ 1M โทเค็น และ Artificial Analysis วัดได้อย่างอิสระว่ามีส่วนลดแคช 88 เปอร์เซ็นต์ในฝั่ง Qwen
• ค่าธรรมเนียมเพิ่มเติมสำหรับพรอมป์แบบยาว — Fugu Max ไม่ได้ระบุระดับชั้นไว้ในประกาศ เทียบกับ Qwen3.8-Max ที่คิดอัตราคงที่ตลอดหน้าต่าง โดยไม่มีค่าธรรมเนียมเพิ่มเติม
• บริบทและเอาต์พุต — Fugu Max ไม่ได้เผยแพร่ตัวเลขทั้งสอง เมื่อเทียบกับ Qwen3.8-Max ที่มีหน้าต่าง 1M โทเคนพร้อมเพดานเอาต์พุตประมาณ 128K
• รูปแบบอินพุต — ข้อความของ Fugu Max โดยมีความสามารถของพูลเองรองรับอยู่เบื้องหลัง เทียบกับ Qwen3.8-Max ที่รองรับข้อความ รูปภาพ วิดีโอ และ PDF
• สถาปัตยกรรม — Fugu Max เป็นตัวประสานงานที่ผ่านการฝึกฝนบนกลุ่มโมเดลที่ไม่เปิดเผย ซึ่งขยายสำหรับ Max ด้วยโมเดลโอเพนเวตและโมเดลเฉพาะทาง รวมถึงตระกูล NVIDIA Nemotron ผ่านความร่วมมือกับ NVIDIA เทียบกับ Qwen3.8-Max ซึ่งเป็นโมเดล sparse mixture-of-experts หนึ่งโมเดลที่มีพารามิเตอร์รวมประมาณ 2.4 ล้านล้าน และมีพารามิเตอร์ที่ใช้งานจริงประมาณ 95 พันล้านต่อโทเคน
• น้ำหนักโมเดล — Fugu Max เป็นแบบปิด สมาชิกภาพในพูลไม่เปิดเผยโดยเจตนา เทียบกับ Qwen3.8-Max ที่เผยแพร่น้ำหนักแบบเปิดสำหรับเช็กพอยต์ระดับ Max ภายใต้สัญญาอนุญาตแบบกำหนดเอง
• การประเมินโดยอิสระ — Fugu Max ไม่มีข้อมูลที่เผยแพร่ และไม่มีหน้า Artificial Analysis ใด ๆ สำหรับโมเดล Fugu เทียบกับ Qwen3.8-Max ซึ่งเป็นรายการ Artificial Analysis ที่มีอยู่จริง พร้อมตัวเลขความเร็ว ความยาวของคำตอบ และต้นทุนต่องานที่เผยแพร่
สี่ในแถวเหล่านั้นระบุว่า “ไม่เผยแพร่” ทางฝั่ง Fugu และมีตัวเลขกำกับทางฝั่ง Qwen เมื่ออัตราเท่ากัน นั่นคือการเปรียบเทียบทั้งหมด: เงินจำนวนเดียวกันซื้อระบบหนึ่งที่คุณอธิบายได้ และอีกระบบหนึ่งที่คุณอธิบายไม่ได้

คอลัมน์หนึ่งมีบุคคลที่สามอยู่เบื้องหลัง
Artificial Analysis ให้คะแนน Qwen3.8-Max ที่ 40 บนดัชนี Intelligence Index v4.3 ฉบับทบทวนใหม่ โดยอยู่ในอันดับ #30 จาก 200 ด้วยค่าใช้จ่าย $2.67 ต่องาน Intelligence Index หนึ่งงาน และ 37.8 โทเคนเอาต์พุตต่อวินาที — ช้าพอที่จะอยู่ในอันดับ #154 จาก 200 ด้านความเร็ว รายการเดียวกันบันทึกว่ามีการสร้างโทเคนเอาต์พุต 180 ล้านโทเคนทั่วทั้งดัชนี ซึ่งมากกว่าค่ามัธยฐานของโมเดลที่ 89 ล้านถึงสองเท่า และมีส่วนลดแคช 88 เปอร์เซ็นต์
สองการแก้ไขมีผลก่อนที่สิ่งใดจะถูกอ้างอิง ข้อแรกคือตัวเลข 58 — หรือ 58.1 หรือ 58.4 — ที่เผยแพร่กันอย่างกว้างขวางสำหรับ Qwen3.8-Max นั้นมาจากก่อนที่ Artificial Analysis จะปรับเทียบดัชนีใหม่ในเดือนกันยายน 2026 และหน้าปัจจุบันมีป้าย "Updated" ซึ่งบ่งชี้คะแนนที่ถูกระบุใหม่ บทความเก่ายังมีภาระความพยายามที่แตกต่างจากมาตราส่วนก่อนหน้า คือ 64 เทิร์นต่องาน เทียบกับ 14 สำหรับรุ่น Qwen ก่อนหน้า ที่ประมาณ $1.14 ต่องาน Intelligence Index; หน้าปัจจุบันแสดง $2.67 ข้อที่สองเป็นคำเตือนจริง ไม่ใช่ผลจากมาตราส่วน: Artificial Analysis วัดแยกต่างหากว่าอัตราการหลอนของ Qwen3.8-Max เพิ่มขึ้นจาก 23 เปอร์เซ็นต์เป็น 40 เปอร์เซ็นต์ เมื่อเทียบกับรุ่นก่อนหน้า สำหรับโมเดลที่ทำการตลาดสำหรับงานหลายขั้นตอนอัตโนมัติ นั่นคือค่าใช้จ่ายที่คุณต้องจัดงบสำหรับตัวตรวจสอบ ไม่ใช่เชิงอรรถ
Fugu Max ไม่มีรายการอิสระใด ๆ เลย ตัวเลขทุกตัวที่แนบมากับมันมีที่มาจาก Sakana และ ณ เวลาที่เขียนนี้ ยังไม่มีหน้า Artificial Analysis สำหรับ Fugu Max หรือรุ่นพี่น้องใด ๆ ของมัน นั่นไม่ใช่ข้อกล่าวหา — โมเดลที่เพิ่งเปิดตัวเมื่อไม่กี่ชั่วโมงก่อนย่อมไม่มีการรายงานจากบุคคลที่สาม — แต่มันหมายความว่าสองคอลัมน์นั้นตรวจสอบได้ไม่เท่ากัน และจะเป็นเช่นนี้ต่อไปจนกว่าจะมีคนนอก Sakana รันมัน
สองวิธีที่ทำให้ใช้จ่ายเกินตัว
ระบบทั้งสองนี้ได้ย้ายต้นทุนของคำตอบให้ห่างออกจากต้นทุนของโทเค็น และทั้งคู่ทำในทิศทางที่ตรงกันข้าม Qwen3.8-Max ประหยัดในระดับโทเค็นแต่ฟุ่มเฟือยในระดับคำตอบ: โทเค็นเอาต์พุต 180 ล้านโทเค็นบน Intelligence Index ซึ่งเป็นสองเท่าของค่ามัธยฐาน ด้วยราคา $2.67 ต่องาน มันทำงานได้ยาวนานแทนที่จะมีขนาดใหญ่ และส่วนลดแคช 88 เปอร์เซ็นต์คือคันโยกที่ควบคุมบิล — การรันเอเจนต์แบบยาวที่อ่านบริบทเดิมซ้ำแล้วซ้ำเล่าจะยังคงมีต้นทุนต่ำ ส่วนการรันที่สร้างข้อความใหม่ไปเรื่อย ๆ จะไม่เป็นเช่นนั้น
Fugu Max แพงเมื่อคิดตามจำนวนโทเคน และคาดเดาคำตอบไม่ได้ ผู้ประสานงานของมันสร้างเอเจนต์ย่อยขึ้นมา โดยแต่ละตัวจะเขียนข้อความเหตุผลและเอาต์พุตซึ่งถูกคิดค่าบริการที่ 6.00 ดอลลาร์ต่อล้านโทเคน บวกกับการสังเคราะห์ของผู้ประสานงานเอง Sakana ยืนยันว่าการรันแบบหลายเอเจนต์จะถูกคิดในอัตราผสมเดียวที่ผูกกับโมเดลระดับสูงสุดที่เข้าร่วม และการเพิ่มเอเจนต์ไม่ได้ทำให้ค่าใช้จ่ายทวีคูณ ซึ่งขจัดปัญหาการขยายแบบ fan-out ในกรณีเลวร้ายที่สุดที่ทำให้ระบบหลายเอเจนต์แบบง่าย ๆ แพงจนจ่ายไม่ไหว แต่มันไม่ได้ขจัดปริมาณ และในประเด็นเรื่องปริมาณ การเปิดตัวครั้งนี้เงียบในแบบที่มีนัยสำคัญ เนื้อหาที่ Sakana เผยแพร่เองระบุว่าการสลับโมเดลกลางงานอาจลดการนำแคชบริบทกลับมาใช้ซ้ำและสร้างโทเคนสำหรับการประสานงานเพิ่มขึ้น พร้อมยืนยันว่าบริษัทไม่ได้เปิดเผยอัตราการฮิตแคชของ Max หรือต้นทุนโทเคนรวมต่องานของมัน
ดังนั้น อัตรา $2.00 / $6.00 เดียวกันจึงเป็นตัวเลขที่คาดการณ์ได้ในด้านหนึ่ง และเป็นตัวคูณแบบไม่จำกัดที่มีค่าขั้นต่ำในอีกด้านหนึ่ง ความเยิ่นเย้อของ Qwen3.8-Max นั้นวัดได้ก่อนที่คุณจะตัดสินใจใช้ ส่วนของ Fugu Max วัดไม่ได้
การทดสอบช่องทางหนี
นี่คือจุดที่ข้อโต้แย้งเรื่องการถูกล็อกไว้แบบเดิมกลับทิศทาง และมันเป็นสิ่งที่มีประโยชน์ที่สุดในการจับคู่นี้
ข้อโต้แย้งของ Sakana สำหรับ Fugu Max คือความสามารถในการฟื้นตัว พูลที่ครอบคลุมทั้งโมเดล open-weights และโมเดลเฉพาะทาง ซึ่งขยายสำหรับ Max ด้วยตระกูล NVIDIA Nemotron หมายความว่าการเลิกใช้ การปรับราคา หรือการถอนตัวในระดับภูมิภาคของผู้ขาย frontier รายใดรายหนึ่งไม่สามารถทำให้ผลิตภัณฑ์ของคุณล่มได้ — เป็นการป้องกันความเสี่ยงที่แท้จริง และเป็นสิ่งที่บริษัทขายอย่างชัดเจน แต่การป้องกันความเสี่ยงนี้ไม่สามารถตรวจสอบได้จากภายนอก คุณไม่สามารถมองเห็นพูล ไม่สามารถเลือกเพิ่มหรือถอดสมาชิกได้ ไม่สามารถโฮสต์เองได้แม้แต่ส่วนใดส่วนหนึ่ง และไม่สามารถรันใน EU/EEA ได้เลย คำสัญญาเกี่ยวกับพูลที่คุณไม่ได้รับอนุญาตให้ตรวจสอบนั้นเป็นหลักประกันที่อ่อนแอกว่าที่ฟังดู
Qwen3.8-Max ทำให้ข้อโต้แย้งนี้เป็นไปในทางตรงกันข้าม มันเป็นโมเดลของผู้ให้บริการรายเดียว จึงเสี่ยงต่อการตัดสินใจของผู้ให้บริการรายนั้น — แต่ Alibaba เผยแพร่น้ำหนักแบบเปิดสำหรับเช็กพอยต์ Qwen3.8-2.4T-A95B ระดับ Max ภายใต้สัญญาอนุญาตแบบกำหนดเอง ซึ่งหมายความว่าทางออกฉุกเฉินนั้นมีจริง ไม่ใช่แค่คำพูดเชิงวาทศิลป์: หากราคาหรือเงื่อนไขเปลี่ยนไป โมเดลนี้ก็สามารถให้บริการจากโครงสร้างพื้นฐานของคุณเองได้ สำหรับทีมที่สิ่งที่กลัวจริง ๆ คือการที่ผู้ให้บริการชักพรมใต้เท้า เช็กพอยต์ที่ดาวน์โหลดได้ย่อมดีกว่าคำอธิบายเกี่ยวกับพูล
การเรียกอันใดอันหนึ่ง
Qwen3.8-Max อยู่ในแค็ตตาล็อกของเราในราคา $2.00 ขาเข้า และ $6.00 ขาออกต่อล้านโทเคน ซึ่งเป็นราคาตามรายการของ Alibaba โดยมีมาร์กอัป 0% ส่งผ่านไปโดยตรง ดังนั้นการเปลี่ยนแปลงราคาของผู้ขายจะลงที่คีย์เดียวกันในวันเดียวกัน แทนที่จะเป็นตามกำหนดการย้ายระบบ มันเข้ากันได้กับ OpenAI บน base URL เดียวกับส่วนที่เหลือของแค็ตตาล็อก ซึ่งหมายความว่าคุณสามารถ วางมันไว้หลังกฎการกำหนดเส้นทางแบบมีเงื่อนไข ห่วงโซ่ failover หรือแผงผสานโมเดล โดยไม่ต้องมีสัญญาฉบับที่สองหรือแก้ไขโค้ด — และ automatic failover จะครอบคลุมเส้นทางผู้ให้บริการที่ถูกจำกัดอัตราหรือมีประสิทธิภาพลดลง มีโทเคน 127.7 ล้านโทเคนไหลผ่านเกตเวย์ในช่วงเจ็ดวันที่ผ่านมา
Fugu Max ไม่ได้อยู่บน OrcaRouter มันมาถึงคุณผ่าน API ที่เข้ากันได้กับ OpenAI ของ Sakana เอง และแพลตฟอร์มบุคคลที่สามหลายแห่ง และบริษัทกล่าวว่าการผสานรวม Fugu ที่มีอยู่สามารถอัปเกรดได้ด้วยการเปลี่ยนพารามิเตอร์เพียงบรรทัดเดียว เนื่องจากทั้งคู่ใช้รูปแบบคำขอเดียวกัน วิธีที่ประหยัดที่สุดในการคลี่คลายช่องว่างของเบนช์มาร์กคือเลิกรอให้ Sakana เผยแพร่ผลนั้น แล้วรันทั้งคู่ภายใต้แฟล็กเดียวบนเวิร์กโหลดของคุณเอง และนับโทเค็นเอาต์พุตต่องานที่เสร็จสมบูรณ์ นั่นคือการวัดที่ไม่มีผู้ขายรายใดจัดหาให้

อันไหน และเมื่อไหร่
Qwen3.8-Max คือตัวเลือกที่คุณสามารถตรวจสอบได้ ตั้งราคาได้ และเลิกใช้ได้ ภายใต้อัตราค่าบริการแบบเดียวกัน มันให้หน้าต่างบริบท 1M โทเคนโดยไม่มีค่าธรรมเนียมเพิ่มสำหรับพรอมป์ต์ยาว รองรับอินพุตรูปภาพ วิดีโอ และ PDF มีเช็กพอยต์ระดับ Max ให้ดาวน์โหลด มีผลวัดอิสระแบบเรียลไทม์ที่วัดสิ่งที่ขับเคลื่อนค่าใช้จ่ายของคุณ และส่วนลด 88 เปอร์เซ็นต์สำหรับอินพุตที่แคชไว้ ข้อเสียของมันก็เจาะจงพอ ๆ กัน คือ มันช้าเพียง 37.8 โทเคนต่อวินาที จัดอยู่ในอันดับท้าย ๆ ของกลุ่มในด้านความเร็ว มันพูดเยิ่นเย้ออย่างมากที่ 180 ล้านโทเคนบนดัชนี และอัตราการสร้างข้อมูลเท็จที่วัดได้ของมันเพิ่มขึ้นราวสองเท่าเมื่อเทียบกับรุ่นก่อนหน้า ซึ่งเป็นเรื่องน่ากังวลอย่างจริงจังสำหรับงานอัตโนมัติแบบที่มันถูกขายมาเพื่อทำ именноนั้น จงใช้ส่วนลดแคชให้เต็มที่ และกันงบไว้สำหรับตัวตรวจสอบ
Fugu Max คือการเดิมพันว่าการประสานงานชนะความสามารถ หากงานของคุณเป็นงานระยะยาวและตรวจสอบได้ และตัวประสานงานที่สร้างผู้ตรวจสอบขึ้นมาทำงานที่โมเดลเดียวล้มเหลวถึงสองครั้งให้สำเร็จได้ แล้วโทเคนสำหรับการจัดวางระบบก็ถูกกว่าการลองใหม่ และเรตการ์ดที่เหมือนกันก็ไม่ใช่การเสมอกันเลยด้วยซ้ำ สิ่งที่คุณกำลังซื้อคือความคงอยู่ ในระบบที่คุณไม่อาจตรึงพูลได้ หน้าต่างบริบทไม่ถูกเปิดเผย และชัยชนะในเบนช์มาร์กหกครั้งไม่มีค่าตัวเลขแนบมา — จากผู้ขายที่เลือกจะระบุชื่อการทดสอบและปิดตัวเลข
ผลิตภัณฑ์ทั้งสองมีราคาต่อโทเคนเท่ากัน มีเพียงตัวเดียวเท่านั้นที่บอกคุณว่าคุณจะได้อะไรตอบแทน

การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
