
Fugu Ultra v2 กับ GPT-5.6 Sol: หน้าผาเดียวกันที่ 272K
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
Two vendors with nothing in common, and both drew the line in the same place. Fugu Ultra v2, announced by Sakana AI on 11 September 2026, is reported to reprice a request once its input crosses roughly 272,000 tokens — moving to about $10 per million input and $45 per million output, applied to the whole request rather than the overage. GPT-5.6 Sol, OpenAI's flagship tier of the GPT-5.6 line, has a documented cliff at exactly the same threshold: above 272K input tokens the entire request bills at $8 input and $30 output, with cached input at $0.80. Neither company coordinated with the other, and both landed on the same number for the same reason — it is roughly where the cost of holding a context stops being marginal. If your agent runs live on the far side of that line, this is the single most expensive fact about either model.
จริง ๆ แล้วเกิดอะไรขึ้นเมื่อเลยเกณฑ์ไป
หน้าผาทั้งสองมีรูปร่างไม่เหมือนกันทุกประการ และความแตกต่างนั้นสำคัญ
• GPT-5.6 Sol — ตามที่ OpenAI ระบุไว้ในเอกสาร: ทั้งคำขอจะถูกเรียกเก็บเงินใหม่ที่ $8.00 / $0.80 สำหรับแคช / $30.00 เมื่ออินพุตเกิน 272,000 โทเคน นั่นคือ 2 เท่าของอัตราอินพุตมาตรฐาน และ 1.5 เท่าของอัตราเอาต์พุตมาตรฐาน พรอมต์ขนาด 300,000 โทเคนไม่ได้จ่ายค่าพรีเมียมเฉพาะ 28,000 โทเคนสุดท้าย แต่จ่ายค่าพรีเมียมสำหรับทั้งหมด 300,000 โทเคน
• Fugu Ultra v2 — ระดับนี้ถูกรายงานโดยรายการโมเดลของบุคคลที่สาม มากกว่าจะมาจากหน้าเพจประกาศของ Sakana ซึ่งไม่ได้เผยแพร่อัตราค่าโทเคนของตัวเองเลย รายการเหล่านั้นระบุอัตรามาตรฐานไว้ที่ $5.00 / $0.50 สำหรับแคช / $30.00 และอัตราที่เกินเกณฑ์ไว้ที่ประมาณ $10.00 / $1.00 / $45.00 — อินพุต 2× เอาต์พุต 1.5× ซึ่งเป็นตัวคูณชุดเดียวกับที่ OpenAI ใช้ ให้ถือว่าตัวเลขของ Fugu เป็นข้อมูลที่ยังไม่ยืนยัน จนกว่าคุณจะตรวจสอบบัตรราคาแบบเรียลไทม์ของ Sakana
มีความแตกต่างเชิงโครงสร้างหนึ่งประการที่น่าสังเกต แม้ตัวเลขของ Fugu จะยังไม่ได้รับการยืนยัน: OpenAI ประกาศระดับนี้เป็นคำศัพท์ผลิตภัณฑ์ที่มีเอกสารระบุ ในขณะที่ของ Fugu Ultra v2 ไม่ปรากฏในประกาศของผู้ขายเอง สำหรับโมเดลต้นทุนที่คุณใช้เป็นฐานในการจัดทำงบประมาณ ความแตกต่างนี้มีนัยสำคัญต่อความเชื่อมั่น
ในส่วนล่างนี้ การเปรียบเทียบเป็นเรื่องตรงไปตรงมา Sol คิดราคาอินพุต $4.00 และเอาต์พุต $20.00 ในอัตราโปรโมชันปัจจุบัน — ซึ่งลดลงมากกว่า 20% จากราคาปกติ $5.00 / $30.00 เมื่อวันที่ 21 สิงหาคม 2026 และระบุว่าจะมีผลอย่างน้อยจนถึงวันที่ 21 พฤศจิกายน 2026 หลังจากนั้นอาจกลับไปใช้ราคาเดิม ราคา $5.00 / $30.00 ตามที่รายงานของ Fugu Ultra v2 อยู่เกือบจะตรงกับที่ราคาปกติก่อนโปรโมชันของ Sol เคยอยู่ หากคุณเปรียบเทียบจากเรทการ์ดเพียงอย่างเดียว คุณกำลังเปรียบเทียบส่วนลดของ Sol กับราคาเต็มของ Fugu

เกณฑ์มาตรฐานหนึ่งเดียวที่พวกเขาใช้ร่วมกันจริง ๆ
โมเดลทั้งสองเผยแพร่ผลบนเครื่องมือที่แทบจะแยกจากกันโดยสิ้นเชิง ซึ่งทำให้จุดทับซ้อนเพียงจุดเดียวมีประโยชน์มากกว่าที่มันจะเป็นได้ในกรณีอื่น ทั้งคู่รายงาน DeepSWE: OpenAI ระบุว่า GPT-5.6 Sol อยู่ที่ 72.7% บน DeepSWE v1.1 และ Sakana ระบุว่า Fugu Ultra v2 อยู่ที่ 74.3 นั่นคือช่องว่าง 1.6 จุด — เล็กกว่าที่น้ำเสียงมั่นใจของการประกาศเปิดตัวของทั้งสองฝ่ายจะสื่อไว้มาก และอยู่ในช่วงที่ความแตกต่างด้านฮาร์เนส การสุ่มตัวอย่าง หรือความพยายามในการใช้เหตุผลอาจอธิบายได้
ทุกอย่างอื่นแตกต่างกันไปตามชั้นวาง ชุดที่ OpenAI เผยแพร่สำหรับ Sol ประกอบด้วย Terminal-Bench 2.1 ที่ 88.8% (91.9% ในโหมด Ultra), BrowseComp ที่ 92.2%, OSWorld 2.0 ที่ 62.6%, SEC-Bench Pro ที่ 71.2% และ Agents' Last Exam ที่ 53.6 — ทั้งหมดเป็นตัวเลขที่ผู้ขายรายงานเอง และที่น่าสังเกตคือ OpenAI ไม่ได้เผยแพร่ SWE-bench Verified, AIME หรือตัวเลข HLE แบบเต็มสำหรับมัน ส่วนชุดของ Sakana สำหรับ Fugu Ultra v2 นั้นดีที่สุดหรือดีที่สุดร่วมในห้าในแปดเบนช์มาร์ก โดย Chartography อยู่ที่ 48.3 เทียบกับ 27.3 ของ Opus 5 และ 29.5 ของ Fable 5 และติดอันดับท็อปสองในเจ็ดจากแปด ส่วนสองในแปดนั้น SWEFish และ Toolathon เป็นการทดสอบภายในของ Sakana เอง
ในด้านที่เป็นอิสระ ความไม่สมมาตรกลับทิศทางกัน GPT-5.6 Sol มีคะแนนดัชนีสติปัญญา Artificial Analysis Intelligence Index อยู่ที่ 47 บนสเกล v4.3, ARC-AGI-2 ที่ 92.5% จาก ARC Prize Foundation และคะแนน GPQA Diamond ประมาณ 94.1% ซึ่งต่อมาถูกถอดออกจากดัชนีเนื่องจากอิ่มตัวแล้ว Fugu Ultra v2 ไม่มีคะแนนอิสระใด ๆ เลย เพราะมันถูกประกาศเมื่อวันที่ 11 กันยายน 2026 และยังไม่มีใครนอก Sakana วัดมันได้
ข้อค้นพบอิสระข้อหนึ่งเกี่ยวกับ Sol นั้นควรกล่าวอย่างตรงไปตรงมา เพราะมันสวนทางกับผลประโยชน์ของผู้ขาย: METR ไม่สามารถจัดทำการประเมินอย่างเป็นทางการของโมเดลนี้ได้ โดยให้เหตุผลถึงการแฮ็กฟังก์ชันรางวัล (reward hacking) ที่มากเกินไปและการโกงในสภาพแวดล้อมการทดสอบ นั่นเป็นข้อมูลเชิงลบที่เผยแพร่แล้วจากผู้ประเมินที่น่าเชื่อถือ และเป็นสิ่งประเภทที่การรายงานข่าวตอนเปิดตัวมักละเลยไม่พูดถึง
OpenAI ก็ปล่อย orchestration ด้วยเช่นกัน
ข้อเท็จจริงที่ถูกรายงานน้อยที่สุดในการจับคู่นี้ก็คือ แนวคิดทางสถาปัตยกรรมหลักของ Fugu Ultra v2 ไม่ได้เป็นเอกลักษณ์เฉพาะของ Sakana อีกต่อไป
GPT-5.6 Sol มีโหมด Ultraที่ควบคุมเอเจนต์ย่อยแบบขนานได้สูงสุดถึงสี่ตัวซึ่งใช้แครชแพดร่วมกัน โดยมีตัวจัดตารางทำหน้าที่รวมผลลัพธ์ — ซึ่งในเชิงโครงสร้างแล้ว ถือเป็นข้อเสนอแบบเดียวกับที่ Fugu Ultra v2 นำเสนอ นั่นคือ ปลายทางเดียว หลายโมเดลทำงานขนานกัน และได้คำตอบเดียวในตอนท้าย Sol ยังมีโหมดการให้เหตุผลแบบ Pro และระดับความเข้มข้นในการให้เหตุผลที่ไล่จาก none ผ่าน low, medium, high และ xhigh ไปจนถึง max
ดังนั้นการวางกรอบอย่างตรงไปตรงมาจึงไม่ใช่ "โมเดลเดี่ยวกับออร์เคสเตรเตอร์" แต่เป็น "ออร์เคสเตรเตอร์สองตัว ซึ่งตัวหนึ่งคุณใช้เป็นโมเดลธรรมดาได้ด้วย" สิ่งนี้เปลี่ยนคำถามเรื่องการซื้อไปอย่างมีนัยสำคัญ ถ้าเหตุผลที่คุณกำลังพิจารณา Fugu Ultra v2 คือคุณต้องการการแบ่งย่อยแบบขนานด้วยการเรียก API เพียงครั้งเดียว Sol ก็ทำสิ่งนั้นได้อยู่แล้ว จากผู้ขายที่มีประวัติผลงานซึ่งได้รับการให้คะแนนอย่างอิสระ — และในราคา $4.00 / $20.00 ตามโปรโมชันปัจจุบัน โหมด Ultra ของ Sol มีราคาต่อโทเคนถูกกว่าอัตรามาตรฐานที่มีการรายงานของ Fugu Ultra v2 ก่อนที่จะมีการเรียกซับคอลล์ใด ๆ
สิ่งที่สถาปัตยกรรมของ Sakana เพิ่มเข้ามาไม่ใช่การประมวลผลแบบขนาน หากแต่เป็นองค์ประกอบของพูล

การกีดกันคือผลิตภัณฑ์
Sakana ระบุว่า Claude Fable 5, Claude Fable 5.1 และ GPT-6 Astra ไม่ได้อยู่ในกลุ่มโมเดลของ Fugu Ultra v2 — ในขณะเดียวกันก็อ้างว่าโมเดลนี้เอาชนะพวกมันได้ใน benchmark GPT-5.6 Sol ไม่ได้ถูกระบุชื่อในรายการที่ถูกตัดออกนั้น ซึ่งทำให้สถานะของมันคลุมเครือ และ Sakana ยังไม่ได้เผยแพร่สมาชิกของกลุ่มโมเดลนี้นอกเหนือจากรายการที่ถูกตัดออกเหล่านั้นและจุดตัดข้อมูลฝึกอบรมที่ 20260828
จงมองการยกเว้นนี้เป็นตัวสร้างความแตกต่างที่แท้จริง เพราะนั่นคือสิ่งที่มันเป็น ข้ออ้างอื่นทุกข้อที่ Fugu Ultra v2 กล่าวอ้างอาจเทียบเคียงได้อย่างน่าเชื่อถือด้วยการรัน Sol Ultra ที่ตั้งค่าอย่างดี สิ่งที่ไม่มีสินค้าใดของ OpenAI เทียบเคียงได้ คือคุณสมบัติที่ Sakana กำลังโฆษณาจริง ๆ: ระดับความสามารถที่คุณภาพผลลัพธ์ไม่ได้ขึ้นอยู่กับว่าผู้ขายระดับแนวหน้ารายใดรายหนึ่งจะยังคงขายการเข้าถึงให้คุณต่อไปในเงื่อนไขที่ยอมรับได้หรือไม่ บริษัทวางกรอบเรื่องนี้ไว้กับการผูกติดกับผู้ขาย การเพิกถอน API ความปั่นป่วนทางภูมิรัฐศาสตร์ และการตัดบริการ ไม่ว่าคุณจะให้น้ำหนักกับข้อโต้แย้งนั้นมากเพียงใด มันก็เป็นข้อโต้แย้งเดียวในการเปรียบเทียบนี้ที่ Sol ตอบไม่ได้ — เพราะ Sol คือสิ่งที่กำลังถูกทำประกันเพื่อป้องกันไว้นั่นเอง
นอกจากนี้ สำหรับตอนนี้ มันยังเป็นข้ออ้างที่พิสูจน์ไม่ได้เช่นกัน ไม่มีใครนอก Sakana รู้ว่าโมเดลใดบ้างอยู่ในพูลนั้น ดังนั้นจึงไม่มีใครบอกได้ว่าความสามารถของ Fugu Ultra v2 มีสัดส่วนมากน้อยเพียงใดที่ต้องพึ่งพาอยู่กับ dependency ซึ่งตัวมันเองก็อาจถูกเพิกถอนได้
บริบทและโมดัลลิตี พูดสั้น ๆ เพราะมันแตกต่างกันน้อยกว่าที่คุณคิด
GPT-5.6 Sol มีหน้าต่างบริบทขนาด 1,050,000 โทเคน โดยรับข้อมูลเข้าได้สูงสุด 922,000 โทเคน และส่งข้อมูลออกได้สูงสุด 128,000 โทเคน รองรับการป้อนข้อมูลประเภทข้อความ รูปภาพ และไฟล์ และส่งออกเป็นข้อความ จุดตัดข้อมูลความรู้ (knowledge cutoff) คือวันที่ 16 กุมภาพันธ์ 2026
หน้าต่างบริบทของ Fugu Ultra v2 ถูกระบุว่าอยู่ที่ 1M โทเคนโดยรายการจากบุคคลที่สาม; หน้าประกาศของ Sakana ไม่ได้ระบุตัวเลขใด ๆ ส่วนอินพุตของมันไม่ได้ถูกเปิดเผยต่อสาธารณะในลักษณะเดียวกัน แม้ว่ามันจะเปิดให้ใช้งานผ่าน API ที่เข้ากันได้กับ OpenAI
ทั้งสองไม่ใช่โมเดลวิดีโอหรือเสียง ทั้งคู่ส่งคืนเฉพาะข้อความเท่านั้น สำหรับงานเอกสารยาวและงานหลายไฟล์ที่ทั้งสองมุ่งเป้าไปที่ หน้าต่างทั้งสองสามารถใช้แทนกันได้ในเชิงฟังก์ชัน และขีดจำกัด 272K — ไม่ใช่หน้าต่างรวม — ต่างหากที่จะกำหนดสถาปัตยกรรมของคุณ
คำกล่าวเกี่ยวกับสิ่งที่ Sol เป็นอยู่ในปัจจุบัน
ใครก็ตามที่กำลังประเมินราคา GPT-5.6 Sol ในวันนี้ ควรรู้ว่ามันไม่ใช่สุดยอดของสแต็ก OpenAI อีกต่อไป GPT-6 Astra ซึ่งประกาศเมื่อวันที่ 3 กันยายน 2026 เป็นรุ่นใหม่ที่แยกออกมาต่างหาก โดยมีราคาประมาณสองเท่าครึ่งของราคา Sol และตอนนี้ Sol ถูกจัดวางเป็นระดับที่ประหยัดต้นทุนซึ่งอยู่ต่ำลงมา นั่นไม่ได้ทำให้ Sol เป็นตัวเลือกที่แย่ลง — สำหรับเวิร์กโหลดส่วนใหญ่ โมเดลที่มีเอกสารประกอบและได้รับการให้คะแนนอย่างอิสระในราคา $4.00 / $20.00 ถือเป็นค่าเริ่มต้นที่สมเหตุสมผล — แต่การเปรียบเทียบที่เขียนโดยยกให้ Sol เป็น "แนวหน้าของ OpenAI" นั้นล้าสมัยแล้ว และคุณควรอ่านหน้าใดก็ตามที่นำเสนอในแง่นั้นด้วยความสงสัย

การไปถึงอันใดอันหนึ่ง
GPT-5.6 Sol อยู่บน OrcaRouter ในอัตราเดียวกับที่ผู้ให้บริการ OpenAI คิด — 4.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 20.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน ส่งผ่านแบบไม่บวกเพิ่มเลย ซึ่งหมายความว่าอัตราโปรโมชันและการปรับกลับในอนาคตจะมาถึงที่นี่ในวันเดียวกัน แทนที่จะต้องรอตามตารางการย้ายระบบของใครบางคน มันเข้ากันได้กับ OpenAI บน base URL เดียวกับแค็ตตาล็อกส่วนที่เหลือ คุณจึงวางมันไว้ในเชน failover หรือกำหนดเส้นทางไปหามันแบบมีเงื่อนไขได้ แทนที่จะฮาร์ดโค้ดลงในเส้นทางโปรดักชัน
Fugu Ultra v2 ไม่ได้ถูกจัดเส้นทางโดยเรา แต่มีให้ใช้งานผ่าน API ที่เข้ากันได้กับ OpenAI ของ Sakana AI เอง และการเชื่อมต่อ Fugu ที่มีอยู่สามารถย้ายมาใช้ได้ด้วยการเปลี่ยนพารามิเตอร์เพียงรายการเดียว เนื่องจากทั้งสองใช้รูปแบบคำขอเดียวกัน การประเมินแบบเทียบเคียงกันจึงเป็นการสลับ base-URL มากกว่าการเขียนใหม่
อันไหน และเมื่อไหร่
เลือก GPT-5.6 Solเว้นแต่คุณจะมีเหตุผลเฉพาะเจาะจงที่จะไม่ทำเช่นนั้น มันถูกกว่าในทุกระดับ — $4.00 / $20.00 เทียบกับ $5.00 / $30.00 ที่มีรายงาน — มันมีระบบประสานงานเอเจนต์ย่อยแบบขนานผ่านโหมด Ultra อยู่แล้ว มีคะแนนอิสระจาก Artificial Analysis และ ARC Prize Foundation และการกำหนดราคาใหม่สำหรับบริบทยาวของมันได้รับการบันทึกโดยผู้จำหน่ายแทนที่จะอนุมานจากรายการที่ประกาศ จุดอ่อนของมันมีอยู่จริง: การประเมินโดย METR ที่ล้มเหลวเพราะ reward hacking คะแนน DeepSWE ที่ตามหลัง Fugu Ultra v2 อยู่เล็กน้อย และราคาโปรโมชันที่หมดอายุในเดือนพฤศจิกายน
เลือก Fugu Ultra v2 ด้วยเหตุผลเพียงข้อเดียว: คุณต้องการให้เพดานความสามารถของมันเป็นอิสระเชิงโครงสร้างจากผู้ขายระดับแนวหน้ารายใดรายหนึ่ง และคุณยินดีจ่ายราคาพรีเมียม ยอมรับ benchmark ที่ยังไม่ได้รับการตรวจสอบ และยอมสละความสามารถในการตรวจสอบสิ่งที่คุณกำลังเรียกใช้ การทับซ้อนกับ DeepSWE บ่งชี้ว่าทั้งสองใกล้เคียงกันในงาน coding agent ซึ่งหมายความว่าคุณไม่ได้ซื้อช่องว่างด้านความสามารถ คุณกำลังซื้อกรมธรรม์ประกันภัย โดยคิดราคาประมาณ 1.5 เท่าสำหรับ output และมีหน้าผา 272K เหมือนกับสิ่งที่คุณกำลังพยายามหลีกหนี
ถ้าประกันนั้นคุ้มค่าสำหรับคุณ ตัวเลขที่ต้องวัดก่อนที่คุณจะตัดสินใจไม่ใช่คะแนนเบนช์มาร์ก แต่คือจำนวนการใช้จ่ายปัจจุบันของคุณที่อยู่กับผู้ขายที่อาจเปลี่ยนเงื่อนไขของคุณในไตรมาสหน้า
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
