
Fugu Max vs Grok 4.6: ตารางราคาเหมือนกันทุกประการ แต่มีคะแนนที่เผยแพร่เพียงหนึ่งเดียว
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
Fugu Max และ Grok 4.6 มีราคาเท่ากันเป๊ะ Sakana AI เปิดตัว Fugu Max เมื่อวันที่ 11 กันยายน 2026 ในราคา $2.00 ต่ออินพุตหนึ่งล้านโทเคน และ $6.00 ต่อเอาต์พุตหนึ่งล้านโทเคน — และนั่นคือเรตการ์ดที่ SpaceXAI คิดกับ Grok 4.6 แบบบรรทัดต่อบรรทัดตั้งแต่เปิดตัวเมื่อวันที่ 12 สิงหาคม ความบังเอิญนี้เป็นข้อเท็จจริงที่มีประโยชน์ที่สุดในการเปรียบเทียบนี้ เพราะมันตัดเรื่องราคาออกจากข้อโต้แย้ง เมื่อสองผลิตภัณฑ์คิดเงินเหมือนกันทุกประการ คำถามเดียวที่เหลือคือสิ่งที่ได้รับมาสำหรับเงินจำนวนนั้น และตรงนี้ทั้งสองก็แยกทางกันโดยสิ้นเชิง Grok 4.6 เป็นโมเดลเดียวที่คุณปักหมุดตามเวอร์ชันได้ อ่านตารางเบนช์มาร์กได้ และตรวจสอบเทียบกับดัชนีอิสระได้ Fugu Max เป็นตัวประสานงานที่ผ่านการฝึก ซึ่งกระจายแต่ละงานไปยังโมเดลที่ถูกที่สุดในพูลของมัน และประกาศของ Sakana อ้างว่ามันทำคะแนนรวมได้ดีที่สุดในหกเบนช์มาร์ก โดยไม่เปิดเผยตัวเลขจากอันใดเลย หนึ่งในสองการซื้อนี้วัดผลได้ก่อนที่คุณจะจ่าย อีกอันหนึ่งวัดไม่ได้
สองผลิตภัณฑ์ เรตการ์ดเดียว
• อินพุต — Fugu Max $2.00 ต่อ 1 ล้านโทเค็น เทียบกับ Grok 4.6 $2.00 ต่อ 1 ล้านโทเค็น
• เอาต์พุต — Fugu Max $6.00 ต่อ 1M โทเค็น เทียบกับ Grok 4.6 $6.00 ต่อ 1M โทเค็น
• อินพุตที่แคชไว้ — Fugu Max $0.25 ต่อ 1M โทเค็น เทียบกับ Grok 4.6 $0.50 ต่อ 1M โทเค็น ซึ่งเป็นบรรทัดเดียวที่ราคาทั้งสองแตกต่างกันเลย
• หน้าต่างบริบท — ผู้จำหน่ายไม่เปิดเผย Fugu Max เทียบกับ Grok 4.6 500,000 โทเคน ไม่เปลี่ยนแปลงจาก Grok 4.5
• การปรับราคาสำหรับพรอมป์ยาว — Fugu Max ไม่มีการระบุระดับในประกาศ เทียบกับ Grok 4.6 ที่เพิ่มเป็นสองเท่าเป็น $4.00 / $12.00 เมื่อคำขอเดียวมีโทเค็นเกิน 200,000 โดยคิดกับทั้งคำขอ ไม่ใช่เฉพาะส่วนที่เกิน
• การควบคุมการให้เหตุผล — Fugu Max ไม่เปิดให้ใช้งาน เทียบกับ Grok 4.6 ที่มีสี่ระดับความพยายาม ตั้งแต่ low ไปจนถึง xhigh โดยค่าเริ่มต้นเป็น high และไม่สามารถปิดได้
• สถาปัตยกรรม — Fugu Max เป็นผู้ประสานงานที่ผ่านการฝึกจากกลุ่มที่ยังไม่เปิดเผย ซึ่งรวมถึงโมเดลแบบโอเพนเวทและโมเดลเฉพาะทาง ขยายสำหรับ Max ด้วยตระกูล NVIDIA Nemotron ผ่านความร่วมมือกับ NVIDIA เทียบกับ Grok 4.6 ที่เป็นโมเดลเดียวในหนึ่งเวอร์ชัน
• การประเมินโดยอิสระ — ไม่มีข้อมูลเผยแพร่ของ Fugu Max และไม่มีหน้า Artificial Analysis สำหรับโมเดล Fugu ใด ๆ เมื่อเทียบกับ Grok 4.6 ที่มีค่า Artificial Analysis Intelligence Index ล่าสุดเท่ากับ 44 อยู่อันดับ #20 จาก 200
คอลัมน์ราคาถูกคือคอลัมน์ที่คาดการณ์ไม่ได้
ดูตรงจุดที่ Fugu Max ชนะเรื่องราคาจริง ๆ นั่นคือการอ่านแคช ซึ่งคิดเป็นครึ่งหนึ่งของ Grok 4.6 มันเป็นข้อได้เปรียบจริง และเป็นจุดที่ผิดถนัดสำหรับการสร้างโมเดลต้นทุน เพราะราคาแคชจะให้ผลตอบแทนเป็นสัดส่วนกับอัตราการฮิตแคชของคุณเท่านั้น — และ Sakana ก็ไม่ได้เปิดเผยอัตราดังกล่าวสำหรับ Fugu Max การเปิดตัวก็ไม่ได้ระบุ context window เช่นกัน ไม่ได้ระบุระดับ long-context และไม่ได้ระบุเพดานเอาต์พุต ดังนั้นคอลัมน์เดียวที่ Fugu Max ตัดราคา Grok 4.6 ได้ คือส่วนลดที่ไม่ทราบขนาด ซึ่งใช้กับสัดส่วนโทเคนของคุณที่ไม่ทราบเช่นกัน
จุดอ่อนของ Grok 4.6 อย่างน้อยก็มองเห็นได้ เกณฑ์ 200,000 โทเค็นของมันนั้นรุนแรง — มันคิดราคาทั้งคำขอใหม่ ดังนั้นพรอมป์ต์ 250,000 โทเค็นจะถูกคิดในอัตราสองเท่าตั้งแต่โทเค็นแรก ไม่ใช่โทเค็นที่ 200,001 แต่คุณมองเห็นหน้าผานั้นได้ วัดพรอมป์ต์ของคุณเทียบกับมัน และตัดสินใจว่าจะแบ่งเป็นชังก์หรือไม่ นี่คือความแตกต่างเชิงประเภทในที่นี้: ระบบหนึ่งเผยแพร่ตารางราคาที่มีรูปร่างซึ่งคุณวางแผนรอบ ๆ ได้ ส่วนอีกระบบเผยแพร่อัตราแบบพาดหัวโดยไม่มีตารางผูกมาด้วย
หกชัยชนะและไม่มีคะแนนแม้แต่แต้มเดียว
เบนช์มาร์กที่ Sakana ระบุชื่อได้แก่ Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench และ SWEFish ในจำนวนนี้ห้ารายการเป็นแบบประเมินสาธารณะที่เป็นที่รู้จัก ส่วนรายการที่หกคือ SWEFish ซึ่งเป็นเบนช์มาร์กการเขียนโค้ดของ Sakana เอง นั่นหมายความว่าหนึ่งในหกชัยชนะที่อ้างไว้นั้นถูกวัดด้วยแบบทดสอบที่ผู้พัฒนาเป็นคนสร้างขึ้นและยังไม่ได้เปิดเผย สำหรับอีกห้ารายการ ประกาศดังกล่าวบอกเพียงว่า Fugu Max ทำคะแนนรวมได้ดีที่สุดและจบเพียงเท่านั้น — ไม่มีคะแนน ไม่มีส่วนต่าง ไม่มีตัวเลขของคู่แข่งให้วางเทียบเคียง
ลองเทียบสิ่งนั้นกับตารางที่ SpaceXAI เผยแพร่สำหรับ Grok 4.6 ซึ่งเป็นข้อมูลที่ผู้ขายรายงานทั้งหมด แต่ก็ยังนับว่าเป็นตารางอยู่ดี: GDPVal-AA v2 อยู่ที่ 1,753, AA-Briefcase อยู่ที่ 1,577, DeepSWE v1.1 อยู่ที่ 65.9%, CursorBench v3.2 อยู่ที่ 69.9% และ GPQA Diamond อยู่ที่ 94.9% เอกสารเปิดตัวยังรายงานว่าใช้ประมาณ 53 เทิร์นและโทเคนอินพุตประมาณครึ่งพันล้านโทเคนในการแก้ปัญหางานระยะยาวบน AA-Briefcase เทียบกับประมาณ 103 เทิร์นและสองพันล้านโทเคนสำหรับโมเดลแนวหน้าคู่แข่ง — เป็นข้อโต้แย้งที่ผู้ขายรายงานเช่นกันว่า Grok ถูกต่อหนึ่งงานที่ทำเสร็จ แม้จะมีอัตราต่อโทเคนที่ไม่สูงนัก
ตัวเลข Grok เหล่านั้นมีสองตัวที่ต้องจัดการก่อนที่คุณจะนำไปอ้างอิง ตัวแรกคือคะแนน GPQA Diamond ที่เป็นไฮไลต์ 94.9% มาจากเบนช์มาร์กที่ Artificial Analysis ได้ปลดระวางไปแล้วเนื่องจากอิ่มตัว ดังนั้นจึงไม่สามารถแยกโมเดลระดับแนวหน้าออกจากกันได้เหมือนที่เคยทำได้อีกต่อไป ตัวที่สองคือตัวเลขที่คุณจะเห็นในการรายงานข่าวเก่า ๆ: ดัชนี Intelligence Index ของ Artificial Analysis อยู่ที่ 61 สำหรับ Grok 4.6 นั่นคือสเกลก่อนการปรับปรุงใหม่ Artificial Analysis ได้ปรับเทียบดัชนีใหม่ในเดือนกันยายน 2026 และค่าล่าสุดคือ 44 อยู่อันดับ #20 จาก 200 โดยมีค่าใช้จ่าย $1.86 ต่องาน Intelligence Index หนึ่งงาน ใครก็ตามที่จัดอันดับ Grok 4.6 เทียบกับ Claude Fable 5 หรือ GPT-5.6 Sol บนค่า 61 กำลังเปรียบเทียบค่าที่อ่านได้จากเครื่องมือสองชนิดที่แตกต่างกัน

สิ่งที่ราคาโทเคนของ orchestrator ไม่ได้รวมถึง
การรายงานข่าวการเปิดตัวของ Sakana เองก็ยอมรับปัญหาด้านโครงสร้าง เนื่องจาก Fugu Max สลับไปมาระหว่างโมเดลภายในงานเดียว จึง "อาจลดการนำแคชบริบทกลับมาใช้ซ้ำ และยังสร้างโทเคนสำหรับการประสานงานเพิ่มขึ้น" และบริษัทไม่ได้เปิดเผยอัตราการเข้าแคชที่เกิดขึ้น หรือต้นทุนโทเคนรวมต่องาน ทุกเอเจนต์ที่ตัวประสานงานสร้างขึ้นจะเขียนข้อความให้เหตุผลและข้อความเอาต์พุต และทั้งหมดนั้นถูกคิดค่าบริการในราคา $6.00 ต่อล้าน อัตรานี้เหมือนกับของ Grok 4.6 ทุกประการ แต่ปริมาณไม่เหมือนกัน และปริมาณคือตัวแปรที่หน้าราคาไม่สามารถแสดงให้คุณเห็นได้
ผู้ขายทั้งสองรายกำลังผลักดันให้คุณปรับวิธีคิดแบบเดียวกัน นั่นคือ เลิกเปรียบเทียบอัตราค่าใช้จ่าย แล้วหันมาเปรียบเทียบต้นทุนต่องานที่ทำเสร็จสมบูรณ์หนึ่งงาน แต่มีเพียงรายเดียวเท่านั้นที่มอบตัวเลขให้คุณเริ่มต้นได้ Grok 4.6 มาพร้อมโปรไฟล์จำนวนรอบและโทเคนที่เผยแพร่แล้ว ส่วน Fugu Max มาพร้อมคำแนะนำให้คุณวัดด้วยตัวเอง
มีการตีความความเงียบของ Fugu Max อย่างเป็นธรรม และสมควรกล่าวถึง ความเงียบนั้น Max คือรุ่นที่ปรับให้เหมาะกับต้นทุนของสาย Fugu เปิดตัววันเดียวกับ Fugu Ultra v2 ซึ่งเป็นการผลักดันขีดความสามารถที่ราคาอินพุต $5.00 และเอาต์พุต $30.00 ข้อโต้แย้งเชิงภาพของ Sakana สำหรับ Max คือกราฟพาเรโต — ขีดความสามารถเทียบกับต้นทุน — และบนกราฟพาเรโต คะแนนเบนช์มาร์กดิบไม่ใช่ประเด็น คะแนนต่อดอลลาร์คือข้ออ้างทั้งหมด ถ้านั่นคือข้อโต้แย้ง การพิมพ์คะแนนชนะหกรายการโดยไม่มีต้นทุนของมันต่างหากที่จะเป็นแผนภูมิที่ทำให้เข้าใจผิด ไม่ใช่แผนภูมิที่หายไป สิ่งที่การเปิดตัวยังติดค้างต่อผู้ซื้อคือตัวส่วน และมันไม่ได้ให้ตัวส่วนนั้นมา
จุดที่ Grok 4.6 ถูกเปิดเผยอย่างแท้จริง
งานบนเทอร์มินัลเป็นจุดที่อ่อนที่สุดในบรรดาผลการประเมินที่เผยแพร่ของ Grok 4.6 คะแนน Terminal-Bench v3.0 ของมันอยู่ที่ 26% ซึ่งตามหลังแนวหน้าของวงการอยู่มาก ระวังตัวเลขที่อยู่ใกล้เคียงไว้ให้ดี: โมเดลเดียวกันทำได้ 88.4% บน Terminal-Bench v2.1 และนั่นเป็นแบบทดสอบคนละชุดกัน คุณจะเห็นทั้งสองอย่างถูกนำมาปนกันในการรายงานข่าว และการปนกันนั้นทำให้ Grok ดูดีเกินจริงอย่างมาก
ความเสี่ยงประการที่สองคือการใช้เหตุผลไม่สามารถปิดได้ โทเคนสำหรับการคิดจะถูกคิดค่าบริการในทุกคำขอ ดังนั้นต้นทุนเอาต์พุตที่แท้จริงของ Grok 4.6 จึงขึ้นอยู่กับว่าโมเดลเลือกจะคิดกับพรอมป์ของคุณมากเพียงใด ตัวปรับระดับความพยายามช่วยให้คุณควบคุมได้ในระดับต่ำสุด แต่ไม่มีการตั้งค่าเป็นศูนย์
ในทางตรงกันข้าม Grok 4.6 มีบางสิ่งที่ Fugu Max ไม่สามารถเสนอได้ในราคาใด ๆ ในตอนนี้ นั่นคือ ตัวเลข ทุกแถวข้างต้นสามารถตรวจสอบได้โดยบุคคลที่สาม และรายการของ Artificial Analysis หมายความว่ามีหนึ่งแถวที่ได้รับการตรวจสอบแล้ว ชัยชนะหกครั้งของ Fugu Max ถูกเผยแพร่ในวันเดียวกับตัวโมเดล โดยบริษัทที่สร้างมันขึ้นมา และ ณ เวลาที่เขียนนี้ ยังไม่มีใครนอก Sakana ที่ได้รันมัน
เรียกอันหนึ่ง ขับอีกอัน
Grok 4.6 พร้อมให้บริการบน OrcaRouter ในราคาตามที่ SpaceXAI ประกาศไว้ — 2.00 ดอลลาร์ต่อล้านโทเค็นอินพุต, 0.50 ดอลลาร์เมื่อแคชฮิต, 6.00 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต — ส่งต่อโดยบวกเพิ่ม 0% ดังนั้นหากผู้ให้บริการเปลี่ยนราคา เกตเวย์ของเราจะได้รับราคาใหม่ภายในวันเดียวกัน แทนที่จะต้องรอตามรอบการย้ายระบบ มันรองรับมาตรฐานเดียวกับ OpenAI บน base URL เดียวกับโมเดลอื่น ๆ ในแคตตาล็อก ซึ่งหมายความว่าคุณสามารถใส่ไว้ในเชน failover หรือไว้หลังกฎการกำหนดเส้นทางแบบมีเงื่อนไข แทนที่จะฮาร์ดโค้ดผู้ให้บริการรายใดรายหนึ่งลงในเส้นทางโปรดักชัน และคุณยังทดสอบแบบ A/B เทียบกับโมเดลอื่นได้โดยไม่ต้องมีสัญญาเพิ่มอีกฉบับ ในช่วงเจ็ดวันที่ผ่านมา มีโทเค็น 46.6 ล้านโทเค็นไหลผ่านเกตเวย์นี้
Fugu Max ไม่ได้อยู่ในแคตตาล็อกของเรา มันมาถึงคุณผ่าน API ที่เข้ากันได้กับ OpenAI ของ Sakana เองและแพลตฟอร์มของบุคคลที่สามหลายแห่ง และบริษัทกล่าวว่าการผสานรวม Fugu ที่มีอยู่สามารถอัปเกรดมาใช้มันได้ด้วยการเปลี่ยนพารามิเตอร์เพียงค่าเดียว เนื่องจากทั้งคู่ใช้รูปแบบคำขอเดียวกัน การประเมินที่วางทั้งสองไว้หลังแฟล็กเดียวจึงเป็นการสลับ base-URL มากกว่าการเขียนใหม่ ซึ่งเป็นวิธีที่ถูกต้องในการยุติข้อโต้แย้งเฉพาะเรื่องนี้ เพราะข้อโต้แย้งนี้เกี่ยวกับจำนวนโทเคนต่องานที่เสร็จสิ้น และมีเพียงเวิร์กโหลดของคุณเองเท่านั้นที่ให้ตัวเลขนั้นได้

ซื้ออันไหนดี
Grok 4.6 เป็นค่าเริ่มต้นที่สมเหตุสมผล ด้วยเรทการ์ดที่เหมือนกับของ Fugu Max มันให้หน้าต่างบริบท 500K ที่คุณสามารถวางแผนโดยอ้างอิงได้ เวอร์ชันที่คุณสามารถปักหมุดได้ การควบคุมการให้เหตุผลสี่ระดับ ตำแหน่งดัชนีอิสระที่ 44 พร้อมตัวเลขค่าใช้จ่ายต่องานอยู่ข้างๆ และผลการวัดจากบุคคลที่สามหลายเดือน ต้นทุนของมันเจาะจงและเป็นที่รู้จัก: หน้าผาการปรับราคาที่ 200K การให้เหตุผลที่คิดค่าใช้จ่ายเสมอ และโปรไฟล์งานเทอร์มินัลที่ตามหลังคู่แข่งในสนาม
Fugu Max เป็นเดิมพันที่น่าสนใจกว่า และจากหลักฐานที่มีอยู่ ก็เป็นตัวเลือกที่ตรวจสอบได้น้อยกว่า เหตุผลด้านการออกแบบนั้นฟังขึ้น — ถ้าตัวประสานงานเลือกโมเดลที่ถูกที่สุดซึ่งทำงานของคุณให้เสร็จได้อย่างเชื่อถือได้ ต้นทุนมัธยฐานต่องานที่ทำเสร็จของคุณก็จะลดลง แม้ว่าตารางราคาของคุณจะไม่ลดลงก็ตาม แต่ที่ $2.00 / $6.00 อัตราค่าโทเคนไม่ใช่จุดที่ความได้เปรียบของ Fugu Max อยู่ อัตรานั้นเป็นของ Grok 4.6 พอดี ความได้เปรียบต้องมาจากการใช้โทเคนน้อยลง และ Sakana ยังไม่ได้เผยแพร่การวัดที่จะแสดงว่ามันทำเช่นนั้นได้
ดังนั้นจงรันการเปรียบเทียบในแบบที่ทั้งสองผู้ขายขอให้คุณทำ วาง Grok 4.6 ไว้บนเกตเวย์ของคุณ เรียก Fugu Max หลังฟีเจอร์แฟล็ก และนับโทเค็นเอาต์พุตต่องานที่เสร็จสมบูรณ์ในงานที่ดูเหมือนงานของคุณ ถ้า Fugu Max ทำงานเสร็จโดยใช้โทเค็นน้อยกว่าโมเดลเดียวในอัตราเดียวกัน ส่วนลดแคชและการประสานงานก็เป็นเงินจริง และการสลับระบบก็สมเหตุสมผล ถ้าไม่ใช่ คุณกำลังจ่ายในอัตราที่เท่ากันสำหรับระบบที่องค์ประกอบของมันสามารถเปลี่ยนไปข้างใต้คุณได้โดยที่หมายเลขเวอร์ชันไม่ขยับ
สำหรับทุกสิ่งที่คุณตัดสินใจได้ในไตรมาสนี้โดยไม่ต้องใช้การวัดนั้น ให้เริ่มจากโมเดลที่มีสกอร์บอร์ด

การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
