
Fugu Max vs Claude Opus 5: ถูกกว่า 4 เท่า และเป็นตัวเลขที่ไม่มีใครเคยเผยแพร่
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Fugu Max มีต้นทุน 6.00 ดอลลาร์ในการผลิตเอาต์พุตหนึ่งล้านโทเคน Claude Opus 5 มีต้นทุน 25.00 ดอลลาร์ Sakana AI เปิดตัว Fugu Max เมื่อวันที่ 11 กันยายน 2026 ในฐานะตัวประสานงานที่จัดเส้นทางแต่ละงานไปยังโมเดลที่ประหยัดที่สุดในกลุ่มของมัน และตั้งราคาไว้อย่างดุดันพอที่ช่องว่างด้านเอาต์พุตถึงสี่เท่าเมื่อเทียบกับเรือธงของ Anthropic จะกลายเป็นข้อเท็จจริงพาดหัวของการเปิดตัวครั้งนี้ สิ่งที่การเปิดตัวครั้งนี้ไม่มีก็คือตัวเลขเพียงตัวเดียวที่อธิบายว่า Fugu Max ทำงานได้ดีแค่ไหนจริง ๆ Sakana กล่าวว่ามันได้ "คะแนนรวมดีที่สุด" ในหกเบนช์มาร์ก และขยายพรมแดนต้นทุน-ประสิทธิภาพในเจ็ดจากสิบรายการ — ซึ่งเป็นคำกล่าวเกี่ยวกับตำแหน่งบนแผนภูมิ มากกว่าค่าบนแกน ตรงกันข้าม Claude Opus 5 มาพร้อมคะแนนที่เผยแพร่สำหรับเกือบทุกอย่างที่มันทำ ดังนั้นเวอร์ชันที่ตรงไปตรงมาของการเปรียบเทียบนี้จึงไม่ใช่ถูกกับแพง แต่เป็นวัดได้กับอ้างเอา และช่องว่างราคาก็คือสิ่งที่ทำให้การแลกเปลี่ยนนี้ควรค่าแก่การถกเถียง
ช่องว่าง และการเปรียบเทียบที่ Sakana เลือกที่จะไม่ทำ
หน้าเปิดตัวของ Sakana ให้เหตุผลรองรับอัตราเอาต์พุตของ Fugu Max ด้วยการเปรียบเทียบกับโมเดลอื่น สามชื่อที่ระบุคือ Claude Sonnet 5, GPT-5.6 Terra และ Kimi K3 และข้ออ้างคือราคาเอาต์พุตของ Fugu Max ต่ำกว่าพวกมัน 40 ถึง 60 เปอร์เซ็นต์ สังเกตว่ามีใครหายไป Claude Opus 5 ไม่ได้อยู่ในรายชื่อนั้น และเหตุผลคือคณิตศาสตร์: ที่ $6.00 เทียบกับ $25.00 Fugu Max ไม่ได้ถูกกว่า Opus 5 อยู่ 40 เปอร์เซ็นต์ แต่มันถูกกว่าอยู่ 76 เปอร์เซ็นต์ การเอ่ยชื่อ Opus 5 จะทำให้ข้ออ้างดูไม่น่าเชื่อถือแทนที่จะดูแข่งขันได้ ดังนั้นการเปรียบเทียบจึงถูกจัดให้เทียบกับระดับที่ต่ำกว่าธงเรือธง
นั่นไม่ใช่การวิจารณ์เรื่องการตั้งราคา ซึ่งต่ำจริง ๆ อยู่แล้ว แต่เป็นข้อสังเกตเกี่ยวกับสิ่งที่ประโยคโดยรอบกำลังทำอยู่ กรอบการนำเสนอของ Sakana เอง — ประสิทธิภาพ "ห่างจากโมเดลระดับหัวกะทิเพียงเล็กน้อย ในต้นทุนที่ต่ำกว่าสองถึงหกเท่า" — ถูกปรับเทียบกับโมเดลที่มันเลือกจะเอ่ยชื่อ เมื่อเทียบกับ Claude Opus 5 ตัวคูณไม่ใช่สองถึงหก หากแต่สูงกว่าสี่ในด้านเอาต์พุต ส่วนว่า Opus 5 ยังเป็น "โมเดลระดับหัวกะทิ" ตามเกณฑ์ของประโยคนั้นหรือไม่นั้นถูกทิ้งไว้โดยไม่ระบุ ซึ่งเป็นการละเว้นที่น่าฉงนในการเปิดตัวที่จุดขายทั้งหมดคือประสิทธิภาพด้านต้นทุนต่อสมรรถนะ ณ ระดับแนวหน้า
• ราคาอินพุต — Fugu Max $2.00 ต่อ 1M โทเคน เทียบกับ Claude Opus 5 $5.00 ต่อ 1M โทเคน
• ราคาขาออก — Fugu Max $6.00 ต่อ 1 ล้านโทเคน เทียบกับ Claude Opus 5 $25.00 ต่อ 1 ล้านโทเคน
• อินพุตที่แคชไว้ — {{1}}Fugu Max{{/1}} {{2}}0.25 ดอลลาร์ต่อ 1M โทเคน{{/2}} เทียบกับ {{3}}Claude Opus 5{{/3}} ที่คิดราคาแคชเป็นส่วนลด {{4}}สูงสุด 90% สำหรับอินพุตที่แคชไว้{{/4}}
• คะแนนเบนช์มาร์ก — Fugu Max ไม่ได้เผยแพร่ค่าใดเลย โดยอ้างว่าชนะการทดสอบเบนช์มาร์กถึงหกครั้งโดยไม่ระบุตัวเลข เมื่อเทียบกับ Claude Opus 5 ที่ Anthropic รายงานว่า 96.0% SWE-bench Verified, 79.2% SWE-bench Pro และประมาณ 30.2% บน ARC-AGI 3
• สถาปัตยกรรม — Fugu Max ผู้ประสานงานที่ผ่านการฝึกบนพูลที่ยังไม่เปิดเผย เทียบกับ Claude Opus 5 โมเดลเดียวที่สามารถปักหมุดตามเวอร์ชันได้
• บริบท — Fugu Max ที่ยังไม่เผยแพร่ เทียบกับ Claude Opus 5 ที่ 1M โทเค็น โดยมีเพดานเอาต์พุต 128K
• การประเมินโดยอิสระ — ไม่มี Fugu Max สำหรับโมเดล Fugu ใด ๆ เทียบกับ Claude Opus ที่มีอันดับบนลีดเดอร์บอร์ดจากบุคคลที่สามมา 5 เดือน
หกชัยชนะที่ไม่มีสกอร์แนบมา
เบนช์มาร์กทั้งหกได้แก่ Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench และ SWEFish ห้าในนั้นเป็นแบบประเมินสาธารณะที่รู้จักกันดี ส่วนที่หก SWEFish เป็นเบนช์มาร์กสำหรับเขียนโค้ดของ Sakana เอง ซึ่งหมายความว่าหนึ่งในหกชัยชนะถูกให้คะแนนด้วยแบบทดสอบที่ผู้ขายเขียนขึ้นเองและยังไม่ได้เผยแพร่
สำหรับอีกห้ารายการ ข่าวประชาสัมพันธ์ระบุว่า Fugu Max ทำคะแนนภาพรวมได้ดีที่สุด โดยไม่บอกว่าคะแนนนั้นคือเท่าไร หรือคู่แข่งรายใดทำคะแนนได้เท่าไร นั่นเป็นรูปแบบที่แปลกสำหรับการประกาศเปิดตัวโมเดล ผู้ขายมักพูดเกินจริงเป็นปกติ แต่โดยทั่วไปพวกเขาพูดเกินจริงด้วยตัวเลข เพราะตัวเลขคือสิ่งที่แพร่กระจายไปได้ ข่าวประชาสัมพันธ์ที่อ้างว่าชนะหกครั้งแต่ไม่พิมพ์ตัวเลขเหล่านั้นเลยสักตัว กำลังขอให้ผู้คนเชื่อตามน้ำหนักของคำกล่าวอ้างเพียงอย่างเดียว
มีการตีความแบบเอื้อเฟื้อ และมันควรค่าแก่การพูดให้ตรง ๆ Fugu Max เป็นผู้ประสานงานที่ปรับให้เหมาะกับต้นทุน ไม่ใช่การผลักดันขีดความสามารถ — Sakana เปิดตัวมันในวันเดียวกับ Fugu Ultra v2 ซึ่งเป็นเวอร์ชันที่มุ่งสู่ขีดความสามารถสูงสุดในราคาอินพุต $5.00 และเอาต์พุต $30.00 หน้าที่ของ Max คือการไปให้ถึงคุณภาพที่ยอมรับได้ในราคาเอาต์พุต $6.00 และคะแนนพาดหัวของออร์เคสเตรเตอร์ก็มีความหมายน้อยกว่าคะแนนต่อดอลลาร์ ซึ่งเป็นสิ่งที่กราฟพาเรโตแสดงไว้พอดี การสื่อสารด้วยภาพของ Sakana สำหรับการเปิดตัวนี้คือกราฟพาเรโต ถ้าข้อโต้แย้งคือ "ดูที่เส้นโค้ง ไม่ใช่จุดสูงสุด" ตัวเลขเบนช์มาร์กดิบก็ไม่ใช่ประเด็น
การตีความแบบไม่ปรานีก็คือ ตัวเลขหนึ่งจะเปิดทางให้เกิดการเปรียบเทียบที่ผู้ขายไม่อยากให้มี การตีความทั้งสองสอดคล้องกับหลักฐาน และไม่มีสิ่งใดในบันทึกสาธารณะที่แยกทั้งสองออกจากกันได้ในขณะนี้ สิ่งที่กล่าวได้คือ ไม่มีฝ่ายอิสระใดประเมินโมเดล Fugu รุ่นใด และไม่มีรายการของ Artificial Analysis สำหรับ Fugu Max หรือโมเดลพี่น้องใด ๆ ของมัน ตัวเลขทุกตัวในเอกสารเผยแพร่ รวมถึงชัยชนะทั้งหกครั้ง มีที่มาจาก Sakana

การซื้อที่คุณกำลังทำอยู่จริงๆ
เมื่อผู้ให้บริการโมเดลเดี่ยวเผยแพร่ผลการทดสอบเบนช์มาร์ก คุณกำลังซื้อคำกล่าวอ้างเกี่ยวกับโมเดลหนึ่ง เมื่อผู้ประสานงานเผยแพร่ผลการทดสอบหนึ่ง คุณกำลังซื้อคำกล่าวอ้างเกี่ยวกับกลุ่มโมเดล — โมเดลที่ผู้ให้บริการไม่ได้ฝึกสอน ซึ่งทำงานภายใต้ตัวประสานงานที่การตัดสินใจด้านการกำหนดเส้นทางถูกจงใจไม่เปิดเผย กลุ่มโมเดลนี้ถูกอธิบายว่าเป็นกลุ่มที่ใหญ่ที่สุดที่ Fugu เคยใช้ โดยขยายด้วยโมเดลแบบเปิดน้ำหนักและโมเดลเฉพาะทาง ซึ่งรวมถึงตระกูล NVIDIA Nemotron ผ่านความร่วมมือกับ NVIDIA นอกเหนือจากนั้น สมาชิกอื่น ๆ ไม่ถูกเปิดเผย
ผลที่ตามมาในทางปฏิบัติคือ พฤติกรรมของ Fugu Max สามารถเปลี่ยนไปได้โดยที่เวอร์ชันของมันไม่เปลี่ยน การเลิกสนับสนุนของห้องปฏิบัติการชั้นแนวหน้า การเปลี่ยนแปลงราคา หรือการถอนโมเดลออกจากภูมิภาคหนึ่ง ๆ ล้วนเปลี่ยนแปลงสิ่งที่ตัวประสานงานสามารถเรียกใช้ได้ และ Sakana ระบุชัดเจนว่าความสามารถในการฟื้นตัวนี้คือประเด็นสำคัญ — บริษัทขายการป้องกันจากการผูกติดกับผู้ขายรายเดียวและการเพิกถอน API นั่นเป็นประโยชน์จริงและไม่ได้มาฟรี มันยังเป็นเหตุผลที่เบนช์มาร์กของ Fugu Max หากมีการเผยแพร่ จะมีวันหมดอายุ ซึ่งเบนช์มาร์กของ Claude Opus 5 ไม่มี
ข้อเสนอคุณค่าของ Claude Opus 5 นั้นกลับกัน และตั้งราคาได้ง่ายกว่า มันคือโมเดลเดียวในหนึ่งเวอร์ชัน ที่ทำงานแบบ adaptive thinking เป็นค่าเริ่มต้น พร้อมปุ่มปรับ effort ที่ชัดเจนตั้งแต่ low ถึง max มีหน้าต่างบริบท 1M โทเคน และเพดานเอาต์พุต 128K พร้อมความสามารถด้าน vision, การใช้เครื่องมือ และโหมด JSON Anthropic รายงาน 96.0% บน SWE-bench Verified และ 79.2% บน SWE-bench Pro และตัวเลขเหล่านั้นวัดจากสิ่งที่คุณได้รับเมื่อเรียก endpoint — ไม่ใช่จาก ensemble ที่องค์ประกอบอาจเปลี่ยนไปได้ตลอดใต้เท้าคุณ สำหรับเวิร์กโหลดที่รันในโปรดักชันและได้รับการรีวิว ความเสถียรนั้นคือฟีเจอร์ที่คุณจ่าย $19.00 ต่อโทเคนเอาต์พุตหนึ่งล้านโทเคนเพื่อให้ได้มา
คิดตามงานที่เสร็จ ไม่ใช่ตามโทเคน
อัตราเอาต์พุต 6.00 ดอลลาร์ของ Fugu Max นั้นน่าสนใจจริง ๆ และวิธีทดสอบก็คือเลิกเปรียบเทียบราคาโทเคน ออร์เคสเตรเตอร์จะปล่อยเอเจนต์ออกมา แต่ละตัวจะเขียนโทเคนสำหรับการให้เหตุผลและโทเคนเอาต์พุต ส่วนผู้ประสานงานจะเขียนบทสรุปสังเคราะห์ คำถามที่พบบ่อยด้านราคาของ Sakana สำหรับสายผลิตภัณฑ์ Fugu ให้คำมั่นว่าจะใช้อัตราคิดเงินแบบผสมเพียงอัตราเดียวโดยอิงจากโมเดลที่เข้าร่วมระดับสูงสุด โดยการรันแบบหลายเอเจนต์จะไม่ทำให้บิลซ้อนทับกัน — ซึ่งช่วยขจัดการคูณแบบ fan-out ในกรณีเลวร้ายที่สุดที่ทำให้ระบบหลายเอเจนต์แบบไร้การวางแผนมีค่าใช้จ่ายสูงจนจ่ายไม่ไหว แต่มันไม่ได้ขจัดปริมาณ จำนวนโทเคนเอาต์พุตที่คุณถูกคิดเงินเป็นฟังก์ชันของจำนวนเอเจนต์ที่รัน และที่ 6.00 ดอลลาร์ต่อล้าน ปริมาณนั้นคือตัวแปรที่หน้าราคาไม่สามารถบอกคุณได้
โครงสร้างต้นทุนของ Claude Opus 5 คือ การเรียกหนึ่งครั้ง โมเดลเดียว ปุ่มปรับระดับความพยายามที่คุณควบคุมได้ และการประมวลผลแบบกลุ่มในราคาครึ่งเดียวสำหรับงานที่รอได้ คุณคาดการณ์ล่วงหน้าได้ก่อนที่จะรันมัน ในการรันกว่าหมื่นครั้ง ความสามารถในการคาดการณ์มีค่ามากกว่าส่วนต่างคะแนน benchmark ที่ยังไม่มีใครเผยแพร่เสียอีก
นี่คือจุดที่คำถามเรื่องการกำหนดเส้นทางแยกออกจากคำถามเรื่องโมเดล Claude Opus 5 อยู่บน OrcaRouter ในราคาตามที่ Anthropic ประกาศไว้ โดยบวกเพิ่ม 0% — อัตราของผู้ให้บริการส่งผ่านตรง ๆ ดังนั้นเมื่อราคาของ Anthropic เปลี่ยนแปลง จะมีผลบนคีย์เดิมในวันเดียวกัน พร้อมการสลับไปเส้นทางผู้ให้บริการอื่นอัตโนมัติเมื่อเส้นทางใดเส้นทางหนึ่งถูกจำกัดอัตราหรือใช้งานไม่ได้ Fugu Max ไม่ได้อยู่ในแคตตาล็อกของเรา คุณเข้าถึงมันผ่าน API ที่เข้ากันได้กับ OpenAI ของ Sakana เองและแพลตฟอร์มของบุคคลที่สามอีกหลายแห่ง และการย้ายมาหามันจาก Fugu รุ่นก่อนหน้าเป็นเพียงการเปลี่ยนพารามิเตอร์บรรทัดเดียว หากคุณต้องการฐานหลักฐานของ Opus 5 และบิลที่คาดการณ์ได้ เราเตอร์คือเส้นทางที่สั้นกว่า หากคุณต้องการระบบที่ประกอบการกระจายงานของตัวเองในปัญหายาก ๆ Fugu Max คือสิ่งที่ทำแบบนั้นได้ — และคุณควรนำร่องทดลองใช้โดยเปิดการนับโทเคนตั้งแต่คำขอแรก

ในกรณีที่ Fugu Max น่าจะเป็นคำตอบที่ถูกต้อง
ให้เครดิตกับการออกแบบนี้ หากงานของคุณมีปริมาณสูง ตรวจสอบได้ และคุณให้ความสำคัญกับต้นทุนมัธยฐานของงานที่เสร็จสมบูรณ์ มากกว่าความสามารถสูงสุดของการเรียกใช้ครั้งเดียว ตัวจัดการที่เลือกโมเดลที่ถูกที่สุดและเพียงพอต่อคำขอแต่ละครั้ง กำลังทำสิ่งที่เรือธงแบบคงที่ทำไม่ได้ Fugu Max มุ่งเป้าไปที่ภาระงานนั้นโดยตรง และอัตราอินพุต $2.00 กับอินพุตแคช $0.25 นั้นตั้งราคาไว้สำหรับบริบทที่ยาวและซ้ำซากซึ่งภาระงานเหล่านั้นสร้างขึ้น ความร่วมมือกับ NVIDIA ก็สำคัญกว่าที่เห็นเช่นกัน: โมเดล Nemotron เป็นโอเพนเวท ซึ่งหมายความว่าขั้นที่ถูกที่สุดของพูลไม่ได้รับผลกระทบจากการตัดสินใจตั้งราคาของแล็บอื่น
สิ่งที่ข้อมูลนั้นไม่ได้ให้คุณคือเหตุผลที่จะเชื่อว่า Fugu Max จะเทียบเท่า Claude Opus 5 ในงานที่ตัวเลขที่เผยแพร่ของ Opus 5 แข็งแกร่งที่สุด — วิศวกรรมซอฟต์แวร์ระดับคลังโค้ดขนาดใหญ่และการให้เหตุผลที่ยากลำบาก แถวเหล่านั้นคือแถวที่กระดานวัดหกเบนช์มาร์กของ Sakana ไม่มีตัวเลขให้เลยแม้แต่ตัวเดียว หากปัญหาของคุณเป็นปัญหาที่การเป็นที่สุดสำคัญกว่าการประหยัด อัตราค่าเอาต์พุต $25.00 ก็ซื้อสิ่งที่คุณต้องการจริง ๆ
บรรทัดล่าง
Claude Opus 5 เป็นตัวเลือกซื้อที่มีหลักฐานรองรับมากกว่า และเป็นค่าตั้งต้นที่ปลอดภัยกว่าสำหรับการใช้งานจริงในโปรดักชัน: มีผลการวัดมาตรฐานจากผู้ขายที่เผยแพร่ มีเวอร์ชันที่คุณปักหมุดได้ มีหน้าต่างบริบทที่ไม่เปลี่ยนแปลง มีเพดานเอาต์พุตที่ 128K มีปุ่มปรับระดับความพยายามที่ให้คุณซื้อความสามารถในการให้เหตุผลเฉพาะเมื่อมันคุ้มค่า และมีผลลัพธ์จากบุคคลที่สามหลายเดือนหนุนหลังอยู่ Fugu Max เป็นการเดิมพันที่น่าสนใจกว่าและถูกกว่าจริง ๆ — ประมาณ 60 เปอร์เซ็นต์ถูกกว่าสำหรับอินพุต และ 76 เปอร์เซ็นต์ถูกกว่าสำหรับเอาต์พุต โดยมีอัตราแคชที่ต่ำกว่าราคาอินพุตพื้นฐานของ Opus 5 อยู่หนึ่งหลัก
หากคุณต้องทำงานที่ตรวจสอบผลได้ ซ้ำ ๆ และมีปริมาณสูง และคุณอยู่นอก EU/EEA แล้ว Fugu Max ก็สมควรได้รับการทดลองนำร่องแบบจำกัดขอบเขต โดยกำหนดเพดานโทเคนเอาต์พุตไว้ล่วงหน้าก่อนเริ่ม และวัดผลเป็นจำนวนโทเคนต่องานที่ทำเสร็จหนึ่งงาน แทนที่จะเป็นจำนวนโทเคนต่อการเรียกหนึ่งครั้ง หากคุณต้องการการตัดสินใจเชิงโปรดักชันที่คุณสามารถปกป้องต่อหน้าคนอื่นได้ภายในไตรมาสนี้ Claude Opus 5 ยังคงเป็นคำตอบ และพร้อมใช้งานบน OrcaRouter ในราคาตามที่ Anthropic กำหนด โดยอัตราค่าบริการของผู้ให้บริการถูกส่งผ่านไปโดยไม่มีการปรับเปลี่ยนใด ๆ

