การ์ดชื่อเรื่องที่สร้างขึ้นมีข้อความว่า "GPT-6 vs Claude Fable 5.1" พร้อมชิปที่ระบุว่า "ทั้งคู่ $10.00 ขาเข้า / $50.00 ขาออก ต่อล้าน" และชิปที่ระบุว่า "AA Coding: Fable 5.1 81.6 vs GPT-6 Astra 76.9" และส่วนท้ายที่ระบุว่า "ตัวเลขดัชนีอ้างอิงจาก Artificial Analysis; การ์ดอัตราค่าบริการจากหน้าเว็บของผู้ให้บริการแต่ละราย" โลโก้ OrcaRouter ถูกคอมโพสิตไว้ที่มุมล่างขวา
Guides & Insights

GPT-6 vs Claude Fable 5.1: เรตการ์ดตรงกัน แต่บอร์ดเขียนโค้ดไม่ตรง

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

GPT-6 และ Claude Fable 5.1 ตั้งราคาไว้เท่ากันเป๊ะที่ 10.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 50.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน นั่นคือส่วนที่ง่ายทั้งหมด สองชื่อนี้ไม่ใช่สิ่งประเภทเดียวกัน — GPT-6 คือตระกูลของโมเดลสามตัวที่ไม่มี gpt-6 เอนด์พอยต์รองรับ ส่วน Claude Fable 5.1 คือโมเดลเดียวที่วัดค่าได้หนึ่งตัวพร้อมเรตการ์ดหนึ่งใบ — ดังนั้นการที่ราคาตรงกันจึงแทบไม่บอกอะไรคุณเลยจนกว่าจะตัดสินใจได้ว่าสมาชิกตัวไหนของตระกูล GPT-6 เป็นตัวตอบ บนกระดานที่สำคัญที่สุดสำหรับระดับนี้ Fable 5.1 อยู่อันดับหนึ่ง และไม่มีโมเดล GPT-6 ตัวใดติดเลย

GPT-6 ตัวไหนที่โผล่มาในการเปรียบเทียบนี้

เริ่มจากการตั้งชื่อก่อน เพราะมันเป็นตัวกำหนดคำตอบ GPT-6 Astra อยู่บนสุด GPT-6 Sol อยู่ตรงกลาง และ GPT-6 Luna อยู่ล่างสุด ไม่มีโมเดลที่ชื่อ GPT-6 ที่คุณเรียกใช้ได้ ถ้าขอ openai/gpt-6 บนเกตเวย์ใดก็ตาม คุณจะได้ 404 ไม่ใช่คอมพลีชัน

ในบรรดาสามตัวนี้ มีเพียงตัวเดียวเท่านั้นที่มาพร้อมเรตการ์ด $10.00 / $50.00 ซึ่งตรงกับ Claude Fable 5.1 และนั่นคือ Astra ส่วน Sol มีราคาเพียงหนึ่งในห้า โดยอยู่ที่ $2.00 / $10.00 และ Luna มีราคาเพียงหนึ่งในร้อย โดยอยู่ที่ $0.10 / $0.50 ดังนั้น "GPT-6 vs Claude Fable 5.1" อันที่จริงก็คือ "GPT-6 Astra vs Claude Fable 5.1" หากคุณยืนกรานจะเปรียบเทียบเรตการ์ดแบบชนิดต่อชนิด — และคู่เปรียบเทียบนั้นก็ไม่ใช่คู่ที่น่าสนใจอีกต่อไป ด้วยเหตุผลที่เพิ่งปรากฏเมื่อปลายเดือนกันยายน

ฝั่งของ Anthropic ไม่มีความกำกวมเช่นนี้ Claude Fable 5.1 เป็นโมเดลเดียว เปิดตัวเมื่อวันที่ 1 กันยายน 2026 มีหน้าต่างบริบท 1,000,000 โทเคน เพดานเอาต์พุต 128,000 โทเคน และรองรับอินพุตแบบข้อความ รูปภาพ และไฟล์ โดยให้บริการภายใต้ model id anthropic/claude-fable-5.1 การอ้างราคาสำหรับ "Fable 5.1" นั้นชัดเจนไม่กำกวม ในแบบที่การอ้างราคาสำหรับ "GPT-6" ไม่มีทางเป็นได้

จุดที่ Fable 5.1 เหนือกว่าจริง ๆ และมากแค่ไหน

ช่องว่างที่ตัดสินการเปรียบเทียบนี้ไม่ใช่ดัชนีทั่วไป แต่คือบอร์ดการเขียนโค้ด โดยอ่านค่าจาก Artificial Analysis และบันทึกไว้ในรายการแคตตาล็อกของ OrcaRouter สำหรับแต่ละโมเดล ณ วันที่ 8 ตุลาคม 2026:

• ดัชนีการเขียนโค้ด AA — Claude Fable 5.1 81.6 อยู่อันดับ 1 ของโมเดลบนบอร์ดนั้น; GPT-6 Astra 76.9 อยู่อันดับ 4
• ดัชนีความฉลาด AA — Claude Fable 5.1 53.4 อันดับ 8; GPT-6 Astra 52.7 อันดับ 9
• GPQA Diamond — Claude Fable 5.1 93.7 เทียบกับ GPT-6 Astra 96.1
• Humanity's Last Exam — Claude Fable 5.1 59.1 เทียบกับ GPT-6 Astra 54.7
• SciCode — Claude Fable 5.1 63.1 เทียบกับ GPT-6 Astra 56.5
• Terminal-Bench v2.1 — Claude Fable 5.1 91.4 เทียบกับ GPT-6 Astra 88.4
• Terminal-Bench v4.0 — Claude Fable 5.1 52.0 เทียบกับ GPT-6 Astra 59.1
• การเรียกคืนบริบทยาว — Claude Fable 5.1 85.3 เทียบกับ GPT-6 Astra 80.7
• บริบทและเอาต์พุต — ทั้งคู่รับเข้า 1,000,000 โทเคนสำหรับ Fable 5.1 เทียบกับ 1,050,000 สำหรับ Astra; ทั้งคู่ส่งออก 128,000 โทเคน

รูปแบบไม่ใช่ "โมเดลหนึ่งดีกว่า" Fable 5.1 ชนะสองเบนช์มาร์กที่สอดคล้องกับงานเขียนและงานซอฟต์แวร์ระยะยาว — SciCode และ Terminal-Bench 2.1 — Astra ชนะ Terminal-Bench 4.0 และ GPQA Diamond Fable 5.1 มีคะแนนนำ 4.4 จุดใน Humanity's Last Exam และนำ 4.6 จุดในด้านการเรียกคืนบริบทยาว ในด้านทั่วไป ทั้งสองห่างกัน 0.7 จุด ซึ่งอยู่ในช่วงความคลาดเคลื่อนที่คุณคาดว่าจะพบจากเบนช์มาร์ก

ข้อควรระวังหนึ่งข้อใช้กับตัวเลขเปรียบเทียบข้ามโมเดลทุกตัวในบทความนี้ และควรพูดออกมาตรง ๆ มากกว่าจะฝังไว้: Artificial Analysis ไม่รับประกันว่าหน้าโมเดลสองหน้าจะถูกเรนเดอร์เทียบกับดัชนีเวอร์ชันเดียวกันในวันเดียวกัน และตอนนี้ได้แยกกลุ่มเทียบเคียงของตนออกจากกัน — โมเดล open-weights จะถูกจัดอันดับเทียบกับโมเดล open-weights ในระดับขนาดเดียวกัน ส่วนโมเดล proprietary จะเทียบกับช่วงราคา proprietary คะแนนที่อ่านจากหน้าหนึ่งกับคะแนนที่อ่านจากอีกหน้าหนึ่งเป็นเพียงตัวบ่งชี้ ไม่ใช่การวัดที่ควบคุมตัวแปรไว้ ตัวเลขทั้งสองข้างต้นมาจากผู้ประเมินรายเดียวกัน แต่ให้มองความแตกต่างระดับต่ำกว่าหนึ่งจุดเป็นทิศทางมากกว่าความแม่นยำ

ภาวะแทรกซ้อนที่มาถึงเมื่อวันที่ 29 กันยายน

หากคุณประเมินการเปรียบเทียบนี้เมื่อเดือนที่แล้ว คุณคงเลือก Astra ยอมรับความด้อยกว่า 4.7 จุดในด้านการเขียนโค้ด และจ่าย $10.00 / $50.00 สำหรับมัน นั่นไม่ใช่ทางเลือกที่ชัดเจนอีกต่อไปแล้ว เพราะ GPT-6.1 Solมีอยู่ — เปิดตัวเมื่อวันที่ 29 กันยายน 2026 ห่างจาก Astra สามสัปดาห์ และหนึ่งสัปดาห์หลังจากสมาชิกที่เหลือในตระกูล

GPT-6.1 Sol ได้คะแนน 51.8 บน Artificial Analysis Intelligence Index เดียวกัน เทียบกับ 52.7 ของ Astra และมีราคาตั้งไว้ที่ $2.00 / $10.00 — คิดเป็นหนึ่งในห้าของเรตการ์ดของ Astra มันไม่ใช่ผู้นำบนกระดานจัดอันดับการเขียนโค้ดเช่นกัน แต่มันสืบทอดลักษณะที่ห่างจาก Astra หนึ่งจุดแบบเดิม แทนที่จะปิดช่องว่างกับ Fable 5.1 อย่างไรก็ตาม มันเปลี่ยนเศรษฐศาสตร์ของการตัดสินใจ หากเหตุผลที่คุณเอื้อมไปหาโมเดลที่มีค่าขาออก $50 คือ "ฉันต้องการการให้เหตุผลระดับแนวหน้าบนงานยาก" ตอนนี้ GPT-6.1 Sol ตอบโจทย์นั้นได้เกือบทั้งหมดด้วยต้นทุนขาออกเพียงหนึ่งในสิบ หากเหตุผลคือ "ฉันต้องการดัชนีการเขียนโค้ดที่ดีที่สุดในกลุ่มนี้" โดยเฉพาะ ไม่มีโมเดล GPT-6 ตัวไหนตอบโจทย์นี้ได้ และคำแนะนำที่ตรงไปตรงมาคือให้ใช้ Fable 5.1 ต่อไป

สิ่งที่ควรระบุให้ชัดเจนก็คือ OpenAI ไม่เคยเผยแพร่ผลการนำ GPT-6 Astra มาวัดกับ Claude Fable 5.1 แบบตรงกัน และ Anthropic ก็ไม่ได้เผยแพร่การเปรียบเทียบ Fable-5.1 กับ GPT-6 เช่นกัน ตัวเลขข้ามค่ายทุกตัวในบทความนี้ไม่ว่าจะเป็นตัวเลขของผู้ประเมินอิสระหรือการวัดประสิทธิภาพโมเดลของตัวเองโดยผู้ให้บริการเอง ล้วนไม่ใช่การทดสอบแบบจับคู่เปรียบเทียบโดยตรงที่ฝ่ายใดในสองฝ่ายนี้จัดทำขึ้นเลย

บิลน่ะ ไม่ใช่สติกเกอร์

เรทการ์ดที่เหมือนกันไม่ได้สร้างใบแจ้งหนี้ที่เหมือนกัน เพราะมิเตอร์ที่อยู่ภายใต้แตกต่างกัน

• อินพุตที่แคชไว้, Fable 5.1 — $0.25 ต่อล้านตามรายการใน OrcaRouter, ส่วนลด 97.5% จากอัตราอินพุต
• อินพุตที่แคชไว้, GPT-6 Astra — $1.00 ต่อล้าน, ส่วนลด 90%
• การเขียนแคช — Fable 5.1 $12.50 ต่อล้าน, GPT-6 Astra $12.50 ต่อล้าน, เสมอกันพอดี
• เมื่อเกิน 272,000 โทเค็นอินพุต — Astra คิดราคาคำขอทั้งหมดใหม่เป็น $20.00 ขาเข้า / $75.00 ขาออก; Fable 5.1 ไม่มีขั้นบันไดเทียบเท่าในตัวเลขที่แค็ตตาล็อกระบุไว้
• ทราฟฟิก 7 วันล่าสุด — Fable 5.1 1.73 ล้านโทเค็น; GPT-6 Astra 76.2 ล้านโทเค็น
• เวลามัธยฐานถึงโทเค็นแรก — Fable 5.1 4,055 ms; GPT-6 Astra 3,500 ms
• ความเร็วเอาต์พุตมัธยฐาน — Fable 5.1 90.1 โทเค็น/วินาที; GPT-6 Astra 70.4 โทเค็น/วินาที

แคชไลน์คือสิ่งที่ทำให้เงินขยับบนงานที่มีลักษณะแบบ Fable 5.1 การรันเอเจนต์แบบยาวที่ส่งบริบทคลังโค้ดขนาด 200,000 โทเคนเดิมซ้ำถึงยี่สิบครั้ง จะจ่าย $0.25 ต่อล้านสำหรับส่วนที่แคชไว้ แทนที่จะเป็น $10.00 — ถูกกว่าการอ่านแคชของ Astra ที่ $1.00 ถึงหนึ่งระดับอันดับ บนรูปร่างคำขอแบบนั้น การ์ดพาดหัวที่เหมือนกันกลับไม่เหมือนกันเลย และข้อได้เปรียบด้านการเขียนโค้ดของ Fable 5.1 มาพร้อมวิธีใช้ที่ถูกกว่า

ขั้น 272K ให้ผลตรงกันข้ามกับ Astra คำขอใดก็ตามที่ข้ามขั้นนี้จะถูกคิดราคาใหม่ตั้งแต่โทเคนแรก ดังนั้นพรอมต์ขนาด 300,000 โทเคนบน Astra จะถูกเรียกเก็บในอัตรา $20.00 / $75.00 สำหรับทั้งหมด ไม่ใช่แค่ 28,000 โทเคนที่เกินเส้น บนโมเดลราคาประหยัด ขั้นนั้นเป็นเพียงเศษเสี้ยวเล็กน้อย; ที่อินพุตราคา $10.00 มันคือความแตกต่างระหว่างคำขอราคา $3.00 กับคำขอราคา $6.00

รันทั้งสองโดยไม่เลือกผู้ชนะล่วงหน้า

เวอร์ชันที่ใช้ได้จริงของการเปรียบเทียบนี้ก็คือคุณน่าจะต้องการทั้งสองอย่าง และคุณต้องการให้สามารถสลับไปมาระหว่างทั้งสองได้เป็นรายคำขอ ไม่ใช่เป็นรายไตรมาส ทั้งClaude Fable 5.1 และทุกโมเดล GPT-6 ที่ใช้งานจริงอยู่ในแคตตาล็อก OrcaRouter เดียวกัน — API เดียวที่อยู่หน้าโมเดลกว่า 200 ตัว โดยราคาตามรายการของผู้ให้บริการถูกส่งผ่านโดยบวกเพิ่ม 0% ดังนั้นเมื่อผู้ขายเปลี่ยนราคา ที่นี่ก็อัปเดตให้ภายในวันเดียวกัน แทนที่จะรอถึงใบแจ้งหนี้ครั้งถัดไป — และ routing DSL ก็ให้คุณแบ่งทราฟฟิกตามขนาดคำขอหรือตามสัดส่วนได้ รูปแบบที่เหมาะกับคู่นี้คือการแบ่งตามขนาด: ส่งคำขอสั้น ๆ ที่มีลักษณะงานเขียนโค้ดไปยัง Claude Fable 5.1 และrouteงานบริบทขนาดยาวที่จะไปชนกับขั้น 272K ของ Astra ไปยังโมเดลที่การ์ดราคาไม่มีขั้นบันได แล้วขยายส่วนไหนก็ตามที่การประเมินของคุณเองเอื้อให้ดีกว่า

การสลับระบบสำรองอัตโนมัติระหว่างผู้ให้บริการคืออีกครึ่งหนึ่งของเรื่องนั้น โมเดลเหล่านี้ไม่มีตัวใดที่รอดพ้นจากวันที่ย่ำแย่ และเส้นทางที่เสื่อมประสิทธิภาพกลางคันก็ไม่ใช่สิ่งที่คุณอยากค้นพบจากคำร้องเรียนของลูกค้า

A generated two-column comparison scoreboard titled "GPT-6 Astra vs Claude Fable 5.1 — the scoreboard". The left column, GPT-6 Astra, reads Input $10.00, Output $50.00, AA Intelligence 52.7, AA Coding 76.9, Context 1,050,000, Cached input $1.00. The right column, Claude Fable 5.1, reads Input $10.00, Output $50.00, AA Intelligence 53.4, AA Coding 81.6, Context 1,000,000, Cached input $0.25. A footer line reads "Index figures per Artificial Analysis; rate cards per each vendor page, read 8 Oct 2026." The OrcaRouter logo is composited in the bottom-right corner.

สิ่งที่แต่ละฝ่ายต้องพูด ฝ่ายละหนึ่งประโยค

Claude Fable 5.1 เป็นโมเดลเขียนโค้ดที่ดีที่สุดบนบอร์ดอิสระ และถูกตั้งราคาไว้ในระดับพรีเมียม โดยมีค่าอ่านจากแคชที่ถูกที่สุดในบรรดาโมเดลทั้งหมดในระดับราคานี้ ครอบครัว GPT-6 ไม่มีสมาชิกตัวใดที่เอาชนะมันด้านการเขียนโค้ดได้ และสมาชิกในครอบครัวที่ใช้เรตการ์ดเดียวกันกับมันอย่าง Astra ก็เป็นตัวที่คุณมีแนวโน้มจะเลือกน้อยที่สุดในตอนนี้ เพราะ GPT-6.1 Sol ให้ผลลัพธ์ต่างจากดัชนีของ Astra เพียงหนึ่งจุดในราคาแค่หนึ่งในห้า

ดังนั้นคำตอบของ "GPT-6 vs Claude Fable 5.1" ขึ้นอยู่ทั้งหมดกับว่าคุณหมายถึง GPT-6 ตัวไหน ถ้าคุณหมายถึงเรือธงของตระกูลนี้ Fable 5.1 ชนะลีดเดอร์บอร์ดการเขียนโค้ด แต่แพ้เรื่องราคาต่อคำตอบให้กับโมเดลที่ต่ำลงมาหนึ่งขั้น ถ้าคุณหมายถึงทั้งตระกูล ตอนนี้ตัวที่คุ้มค่าที่สุดในฝั่ง OpenAI ของการจับคู่นี้คือ GPT-6.1 Sol ที่ $2.00 / $10.00 — และมันก็ยังไม่ใช่ผู้นำด้านการเขียนโค้ด อัตราราคาตรงกัน แต่ลีดเดอร์บอร์ดไม่ตรงกัน

Screenshot of the OrcaRouter model page for anthropic/claude-fable-5.1, showing the Anthropic vendor label, a 2026-09-01 catalogue release date, a 1,000,000-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $10.00 per million input, $50.00 per million output, a 4.05 s median time to first token, a 10.00 s p95, and 1.7M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the OpenAI vendor label, a 2026-09-04 catalogue release date, a 1,050,000-token context window (shown as ctx 1M tokens), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, a 'Best for reasoning, coding, agentic' tag row, and a rate strip reading $10.00 per million input, $50.00 per million output, a 3.50 s median time to first token, a 10.00 s p95, and 76.2M tokens routed in seven days.

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube