
Claude Sonnet 5.5 กับ Claude Fable 5.1: โมเดลราคาถูกนำอยู่สามคะแนน
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 983 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 196 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
Claude Sonnet 5.5 มาถึงเมื่อวันที่ 28 กันยายน 2026 ในราคา 2.00 ดอลลาร์ต่อล้านโทเค็นอินพุต และ 10.00 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต ส่วน Claude Fable 5.1 โมเดลระดับ Mythos ที่ผู้จำหน่ายเปิดตัวเมื่อวันที่ 1 กันยายน อยู่ในราคา 10.00 และ 50.00 ดอลลาร์ในสองบรรทัดเดียวกัน สรุปที่ชวนให้คิดตามคือ Fable 5.1 เป็นตัวที่แพงกว่าและจึงเป็นตัวที่ดีกว่า แต่บน Artificial Analysis Intelligence Index ลำดับกลับตรงกันข้าม: Claude Sonnet 5.5 ได้ 56 คะแนน และ Claude Fable 5.1 ได้ 53 คะแนน นั่นไม่ใช่ความคลาดเคลื่อนจากการปัดเศษ และก็ไม่ใช่เรื่องราวทั้งหมดเช่นกัน เพราะผู้ประเมินรายเดียวกันจัดให้ทั้งสองห่างกันไม่เกินสามเซนต์ต่องานบนชุดทดสอบเดียวกัน — 7.60 ดอลลาร์ เทียบกับ 7.63 ดอลลาร์ ความแตกต่างห้าเท่าในตารางราคาแทบจะหายไปเมื่อทำงานเสร็จ สิ่งที่เหลืออยู่คือชุดความแตกต่างในด้านรูปร่างมากกว่าคะแนน และการเลือกระหว่างสองตัวนี้ส่วนใหญ่เป็นคำถามว่าภาระงานของคุณมีรูปร่างแบบไหน
เรตการ์ดสองใบ และบรรทัดเดียวที่ส่วนต่างไม่ใช่ห้าเท่า
การเปรียบเทียบต่อโทเคนนั้นชัดเจนและไม่จำเป็นต้องตีความ
• อินพุต — Claude Sonnet 5.5 ราคา $2.00 ต่อล้านโทเค็น เทียบกับ Claude Fable 5.1 ราคา $10.00 ซึ่งเป็นความแตกต่างถึงห้าเท่า
• เอาต์พุต — $10.00 เทียบกับ $50.00 ต่อล้าน อีกครั้งเป็นห้าเท่าพอดี
• การอ่านแคช — $0.20 เทียบกับ $0.25 ต่อล้าน นี่คือรายการที่รองรับการรันเอเจนต์แบบยาวนาน และส่วนลดก็ลดฮวบจาก 5× เหลือ 20%
• การเขียนแคช — $2.50 เทียบกับ $12.50 ต่อล้านสำหรับหน้าต่างมาตรฐานห้านาที ซึ่งเป็นส่วนต่างเดี่ยวที่กว้างที่สุดบนการ์ดทั้งสองใบ
• แบตช์ — โหมดแบตช์ของ Anthropic ใช้กับการ์ดเหล่านี้ไม่ได้ทั้งสองใบในแบบเดียวกับที่ใช้กับ Fable 5.1: Fable 5.1 เปิดตัวพร้อมราคาแบบแบตช์ที่ลดลงครึ่งหนึ่งเหลือ $5.00 สำหรับอินพุต และ $25.00 สำหรับเอาต์พุต อ่านบรรทัดรายการแบตช์จากหน้าข้อมูลราคาของ Anthropic เองก่อนที่คุณจะสรุปว่ามันใช้ได้กับทั้งตระกูล
• บริบทและเพดาน — บริบท 1,000,000 โทเค็น และเอาต์พุตสูงสุด 128,000 โทเค็นบนทั้งคู่ บน Message Batches API, Claude Sonnet 5.5 รองรับเอาต์พุตสูงสุดถึง 300,000 โทเค็นเมื่อเปิดใช้ beta header output-300k-2026-03-24 ซึ่งเป็นความแตกต่างของเพดานที่แท้จริงสำหรับการสร้างจำนวนมาก ไม่ใช่ความแตกต่างทางการตลาด
มีประเด็นเล็ก ๆ ที่เป็นข้อดีของ Claude Sonnet 5.5 ซึ่งตารางราคาไม่ได้สะท้อนให้เห็นเต็มที่ Anthropic รายงานว่าโดยทั่วไปโมเดลนี้ต้องใช้โทเคนน้อยกว่ารุ่นก่อนมากเพื่อทำงานเดียวกัน ซึ่งทางบริษัทกล่าวว่าคิดเป็นต้นทุนต่องานที่ต่ำลงได้ถึง 30% นั่นเป็นคำกล่าวอ้างของผู้ขายเกี่ยวกับการเปรียบเทียบที่แตกต่างออกไป — Sonnet 5.5 กับ Sonnet 5 — และไม่ใช่หลักฐานเกี่ยวกับการเปรียบเทียบนี้ อย่างไรก็ตาม มันคือกลไกที่อธิบายสิ่งที่การวัดผลโดยอิสระพบ
ส่วนต่างราคาห้าเท่าไปอยู่ที่ไหน
Artificial Analysis ได้รันทั้งสองโมเดลเมื่อวันที่ 2026-09-29 ภายใต้ฮาร์เนสเดียวและป้ายการตั้งค่าหนึ่งป้ายว่า "Adaptive Reasoning, Max Effort, Default Fallback" บน Intelligence Index v4.3 ตัวเลขหลักสองตัวคือ 56 สำหรับ Claude Sonnet 5.5 และ 53 สำหรับ Claude Fable 5.1 — โมเดลที่ถูกกว่านำหน้าอยู่ประมาณสามจุดบนสเกลที่ผู้ประเมินรายเดียวกันจัดให้โมเดลมัธยฐานอยู่ที่ 26 ทั้งคู่ถูกติดป้ายว่าเป็นโมเดลชื่อผู้ขายบนหน้าเดียวกัน ดังนั้นนี่จึงเป็นเครื่องมือวัดหนึ่งเดียวและสแนปช็อตหนึ่งเดียว ไม่ใช่สอง
จากนั้นก็คอลัมน์ต้นทุน และเหตุผลที่การจับคู่นี้น่าสนใจแทนที่จะเป็นเรื่องที่เห็นได้ชัดอยู่แล้ว ในการรันดัชนีครั้งเดียวกัน Claude Sonnet 5.5 มีต้นทุน $7.602633 ต่องาน และ Claude Fable 5.1 มีต้นทุน $7.629706 ห่างกันเพียง 27 ในพันของดอลลาร์ การแยกส่วนประกอบคือจุดที่มันเริ่มแปลก: ฝั่งอินพุตของ Claude Fable 5.1 เพียงอย่างเดียวอยู่ที่ $3.73 ต่องาน เทียบกับองค์ประกอบอินพุตที่เล็กกว่าอย่างมากของ Sonnet 5.5 และโทเคนการให้เหตุผลของมันเพียงอย่างเดียวมีต้นทุน $2.36 ต่องาน โมเดลที่ถูกกว่าต่อโทเคนถึงห้าเท่ากลับไม่ได้ถูกกว่าต่องานที่ทำเสร็จเลยแม้แต่น้อย
สาเหตุคือปริมาณ และโมเดลทั้งสองล้มเหลวในทิศทางที่ตรงกันข้าม
• โทเคนเอาต์พุตทั่วทั้งชุดดัชนี — Claude Sonnet 5.5 สร้าง 410,577,501 เทียบกับ 188,465,663 ของ Claude Fable 5.1 บนชุดที่ค่ามัธยฐานที่ติดตามอยู่ที่ 88 ล้าน ทั้งคู่สูงกว่าค่ามัธยฐานอย่างมาก; Sonnet 5.5 มากกว่าสองเท่าของ Fable 5.1 และเกือบห้าเท่าของค่ามัธยฐาน
• โทเค็นเอาต์พุตต่องาน — 192,838 สำหรับ Sonnet 5.5 เทียบกับ 78,111 สำหรับ Fable 5.1 โดยมีสัดส่วนการให้เหตุผล 142,386 เทียบกับ 47,240 Sonnet 5.5 ใช้เวลาคิดนานกว่าประมาณสามเท่าต่องาน
• โทเคนอินพุตในชุดดัชนีทั้งหมด — 18.5 พันล้านสำหรับ Sonnet 5.5 เทียบกับ 5.6 พันล้านสำหรับ Fable 5.1 Sonnet 5.5 อ่านมากกว่าเป็นสามเท่า ซึ่งเป็นตัวเลขที่เงียบกว่าในคู่นี้ และเป็นตัวที่กินเรตอินพุตที่ถูกกว่า
• ราคาแบบผสมที่สัดส่วนอินพุตต่อการอ่านแคชต่อเอาต์พุต 7:2:1 — $1.54 สำหรับ Sonnet 5.5 เทียบกับ $7.17 สำหรับ Fable 5.1 นี่คือรายการที่ตรงกับตารางราคา และเป็นรายการที่อธิบายเวิร์กโหลดที่มีเอาต์พุตสั้นและมีขอบเขตชัดเจน
เมื่อนำสิ่งเหล่านั้นมารวมกัน คำกล่าวที่ตรงไปตรงมาคืออย่างนี้: ช่องว่างราคาแบบผสมนั้นมีจริง แต่ช่องว่างต่องานไม่มี ตัวเลขตัวใดในสองตัวนี้อธิบายบิลของคุณ ขึ้นอยู่ทั้งหมดกับว่างานของคุณจบหรือลากยาว และชุดดัชนีนี้ถูกสร้างมาเพื่อให้พวกมันลากยาวได้
บันไดความพยายามคือการตัดสินใจที่แท้จริง
ทั้งสองโมเดลเปิดให้ใช้พารามิเตอร์ effort — low, medium, high, xhigh, max — และทั้งคู่ถูกวัดที่ทุกระดับเมื่อวันที่ 2026-09-29 นี่คือส่วนของการเปรียบเทียบที่ไม่มีเรตการ์ดใดอธิบายได้ เพราะโมเดลราคาถูกที่ระดับต่ำกว่าเอาชนะโมเดลราคาแพงที่ระดับต่ำกว่าได้อย่างขาดลอย และโมเดลราคาแพงจะแยกตัวออกมาชัดเจนเฉพาะใกล้ระดับสูงสุดเท่านั้น
• ความพยายามต่ำ — Claude Sonnet 5.5 ได้คะแนน 35.84 ที่ $0.41 ต่องาน; Claude Fable 5.1 ได้คะแนน 46.82 ที่ $2.37 ในระดับล่างสุด โมเดลราคาแพงนำอยู่สิบเอ็ดคะแนน ด้วยเงินที่เกือบหกเท่า
• ความพยายามระดับกลาง — 40.74 ที่ $0.59 เทียบกับ 48.92 ที่ $2.98 Fable 5.1 นำอยู่แปดคะแนนที่ต้นทุนห้าเท่า
• ความพยายามสูง — 46.74 ที่ $1.08 เทียบกับ 51.15 ที่ $3.91 ช่องว่างแคบลงเหลือ 4.5 จุด; อัตราส่วนต้นทุนคงอยู่ที่ประมาณ 3.6×
Xhigh effort — 51.85 ที่ราคา $2.74 เทียบกับ 53.20 ที่ราคา $5.98 ห่างกันแค่หนึ่งจุดสามสามคะแนน ในราคาเพียง 46%
• ความพยายามสูงสุด — 55.98 ที่ $7.60 เทียบกับ 53.35 ที่ $7.63 ลำดับกลับด้าน และค่าใช้จ่ายลู่เข้าภายในครึ่งเปอร์เซ็นต์
อ่านแถวที่สี่และแถวที่ห้าไปพร้อมกัน แล้วรูปแบบของการเปรียบเทียบนี้ก็จะปรากฏขึ้น Claude Sonnet 5.5 ที่ xhigh ทำได้ 51.85 — ห่างจากคะแนนดีที่สุดของ Claude Fable 5.1 ที่ความพยายามระดับใดก็ตาม เพียงหนึ่งจุดครึ่งของดัชนี — ด้วยราคา $2.74 ต่องาน เทียบกับ $7.63 หากงานของคุณจำเป็นต้องอยู่ใกล้พรมแดนมากกว่าอยู่ที่พรมแดนนั้น แถวนั้นก็คือคำตอบทั้งหมด และช่วยประหยัด 64% ต่องานที่ทำเสร็จ ดัน Sonnet 5.5 ไปที่ max แล้วคุณจะซื้อคะแนนเพิ่มอีกสามคะแนนด้วยเงิน 2.8 เท่า ซึ่งพาคุณไปสู่ค่าใช้จ่ายเท่ากับ max ของ Fable 5.1 โดยมีคะแนนดีกว่าเล็กน้อยและโปรไฟล์การให้เหตุผลที่ต่างออกไปมาก
ประโยคสุดท้ายนั้นคุ้มค่าที่จะตรึงไว้ให้แน่ชัด เพราะมันขัดกับสัญชาตญาณมากพอที่จะต้องตรวจสอบซ้ำ เมื่อเทียบกันที่ความพยายามสูงสุดระดับเดียวกัน โมเดลที่มีตารางราคาถูกกว่าห้าเท่ามีต้นทุนต่องานเท่ากับโมเดลที่มีตารางราคาแพง มันไปถึงจุดนั้นได้โดยสร้างโทเคนเอาต์พุตมากกว่า 2.5 เท่า ซึ่งในจำนวนนั้นสัดส่วนการให้เหตุผลมากกว่าเป็นสามเท่า เอกสารของ Anthropic เองอธิบายกลไกไว้ส่วนหนึ่งว่า ตัวตัดคำเปลี่ยนไป และข้อความเดียวกันสร้างโทเคนมากกว่าประมาณ 30% บน Claude Sonnet 5.5 เมื่อเทียบกับโมเดลรุ่นก่อน ๆ นั่นเป็นปัจจัยร่วมหนึ่งในหลายปัจจัย และเป็นเครื่องเตือนใจที่มีประโยชน์ว่าจำนวนโทเคนเอาต์พุตไม่อาจนำมาเปรียบเทียบกันได้ข้ามการแก้ไขตัวตัดคำ โดยไม่ระบุไว้
เวลาแฝงคือจุดที่ทั้งสองเริ่มไม่เหมือนกัน
การลู่เข้าของคะแนนไม่ได้ขยายไปถึงเวลา ในสแนปช็อตวันที่ 2026-09-29 เดียวกัน Artificial Analysis รายงานเวลาถึงโทเคนแรกที่ 254.41 วินาทีสำหรับ Claude Fable 5.1 และ 2.80 วินาทีสำหรับ Claude Sonnet 5.5 บนชุดพรอมป์ยาว โดยมีค่ามัธยฐานความเร็วเอาต์พุตที่ 67.9 และ 49.4 โทเคนต่อวินาทีตามลำดับ นั่นคือความแตกต่างถึงสองอันดับขนาดในระยะเวลาที่ผู้เรียกต้องรอก่อนที่จะมีอะไรมาถึง และเป็นตัวเลขที่มีนัยสำคัญเชิงปฏิบัติการมากที่สุดเพียงหนึ่งเดียวในการเปรียบเทียบนี้
ตัวเลขทั้งสองจำเป็นต้องระบุตัวกำกับให้ชัดเจน TTFT ของ Fable 5.1 วัดบนประเภทพรอมป์ต์ยาว ส่วนข้อมูล medium-prompt ของผู้ประเมินสำหรับโมเดลเดียวกันในวันเดียวกันอยู่ที่ 117.60 วินาที ดังนั้นค่า 254 วินาทีจึงเป็นส่วนปลายของการกระจาย ไม่ใช่ค่าคงที่ 2.80 วินาทีของ Sonnet 5.5 เป็นค่ามัธยฐานโดยรวม โดยช่วงความแปรปรวนของผู้ประเมินเองนั้นอยู่ตั้งแต่ 1.91 วินาที ณ เปอร์เซ็นไทล์ที่ 5 ไปจนถึง 4.23 ณ เปอร์เซ็นไทล์ที่ 95 เอกสารของ Anthropic อธิบายว่า Fable 5.1 เมื่อเทียบกันแล้วช้ากว่า และ Sonnet 5.5 ว่าเร็ว ซึ่งสอดคล้องกันในเชิงทิศทางโดยไม่ถือเป็นการวัด
โครงสร้างพื้นฐานของเราเองให้ผลการวัดชุดที่สาม เพราะเราจัดเส้นทางให้ Claude Fable 5.1 และวัดสิ่งที่เราให้บริการจริง ในช่วงเจ็ดวันจนถึงวันที่ 28 กันยายน บนทราฟฟิกของ OrcaRouter เอง Claude Fable 5.1 ทำค่ามัธยฐานของโทเค็นแรกได้ที่ 6,973 มิลลิวินาที โดยเปอร์เซ็นไทล์ที่ 95 อยู่ที่ 10.0 วินาที ความเร็วเอาต์พุต 65.8 โทเค็นต่อวินาที และอัตราข้อผิดพลาด 0.349% ค่า p50 นั้นเร็วกว่าตัวเลขโทเค็นแรกสำหรับพรอมป์ยาวของผู้ประเมินมากกว่าร้อยเท่า ซึ่งไม่ใช่ความขัดแย้ง แต่เป็นนิยามของคำมากกว่า: โทเค็นแรกที่นักพัฒนาเห็นจากพรอมป์สั้นกับโทเค็นแรกของเบนช์มาร์กจากพรอมป์ยาวเป็นการวัดสิ่งที่แตกต่างกัน ใครก็ตามที่วางแผนโดยอิงตัวเลขบนลีดเดอร์บอร์ดควรรู้ว่าตนกำลังซื้อสิ่งไหน

ความซื่อสัตย์ในการจัดหา การคงไว้ และการโยกย้ายที่ไม่มีใครพูดถึง
ตารางเกณฑ์มาตรฐานของผู้ขายและผลการประเมินอิสระเป็นเครื่องมือที่แตกต่างกัน และไม่ควรนำมาลบกันไม่ว่ากรณีใด ตารางเปิดตัวของ Anthropic เองสำหรับ Claude Sonnet 5.5 รายงานว่า Terminal-Bench 4.0 อยู่ที่ 70.6% Artificial Analysis ซึ่งรันชุดทดสอบของตนเอง รายงาน 63.6% สำหรับโมเดลเดียวกันในการประเมินชื่อเดียวกัน สำหรับ Claude Fable 5.1 ความต่างกลับทิศทางกัน: Anthropic รายงาน 55.8% ตอนเปิดตัว และชุดทดสอบอิสระอ่านค่าได้ 52.0% ทั้งสองคู่ไม่ใช่การแก้ไขค่าของกันและกัน ตัดสินแต่ละอันตามเกณฑ์ของมันเอง และเลือกใช้อันที่เป็นอิสระเมื่อคุณกำลังตัดสินใจว่าจะส่งทราฟฟิกโปรดักชันไปที่ใด
ท่าทีด้านการเก็บรักษาข้อมูลก็แตกต่างออกไปเช่นกัน และเป็นความแตกต่างประเภทที่ปรากฏให้เห็นเฉพาะในการทบทวนด้านจัดซื้อจัดจ้างเท่านั้น Anthropic ระบุว่า Claude Sonnet 5.5 พร้อมให้ใช้งานโดยไม่มีการเก็บรักษาข้อมูลเลย ซึ่งเป็นท่าทีเดียวกับที่ใช้กับ Opus 5.5 และ Sonnet 5 เอกสารเปิดตัวของ Claude Fable 5.1 อธิบายถึงนโยบายการใช้ข้อมูลแบบค่อยเป็นค่อยไปที่อยู่ควบคู่กันไป และการติดตั้งใช้งานแยกต่างหากภายใต้ Project Glasswing ซึ่งมีหน้าต่างการเก็บรักษาข้อมูลเริ่มต้น 30 วันสำหรับการเฝ้าระวังด้านความปลอดภัย โดยระบุว่าการไม่เก็บรักษาข้อมูลเป็นสถานะชั่วคราว หากทีมของคุณต้องรับผิดชอบต่อการทบทวนการประมวลผลข้อมูล ความแตกต่างนั้นก็ถือเป็นรายการจริง ไม่ใช่แค่หมายเหตุท้ายเรื่อง และควรอ่านหน้าข้อกำหนดนโยบายปัจจุบันของ Anthropic แทนที่จะอ่านบทสรุปใด ๆ เกี่ยวกับเรื่องนี้ รวมถึงบทสรุปนี้ด้วย
ต้นทุนการย้ายมีความไม่สมมาตรในแบบที่แทบไม่ถูกพูดถึงในการรายงานเปิดตัว การย้ายไปยัง Claude Sonnet 5.5 ไม่ใช่แค่การเปลี่ยนสตริงชื่อโมเดล คู่มือการย้ายของ Anthropic ระบุว่าค่า temperature, top_p และ top_k ที่ไม่ใช่ค่าเริ่มต้นจะส่งคืนข้อผิดพลาด 400 แล้ว, ว่า tool_choice แบบ any หรือแบบระบุชื่อ tool จะถูกปฏิเสธไปเลย, และว่า thinking: {"type": "disabled"} ต้องกลายเป็น between_tools หากคุณรันโดยปิด thinking แบบ up-front ไว้ ประเภท between_tools ถูกยอมรับที่ effort ระดับ low, medium และ high และจะส่งคืน 400 ที่ xhigh หรือ max บน Claude API และ Google Cloud ความสามารถ computer use รองรับเฉพาะผ่าน toolset computer_toolset_20260801 เท่านั้น; ส่วน computer_20251124 ที่เก่ากว่าจะถูกปฏิเสธ ไม่มีข้อใดเหล่านี้ใช้กับการย้ายไปยัง Claude Fable 5.1 ซึ่งเป็นการอัปเกรดในตระกูลเดียวกันจาก Fable 5 พร้อม breaking changes สามรายการของตัวเอง หากคุณกำลังชั่งน้ำหนักทั้งสองเป็นเป้าหมายการย้ายแบบคู่ขนาน โมเดลที่ถูกกว่ากลับเป็นตัวที่แพงกว่าในการนำมาใช้

อันไหนใส่ตรงไหน
การตัดสินใจที่ตามมาจากตัวเลขคือการตัดสินใจว่าทราฟฟิกของคุณมีขอบเขตที่ชัดเจนเพียงใด
• งานที่มีขอบเขตจำกัด ปริมาณสูง และขับเคลื่อนด้วยเครื่องมือ — Claude Sonnet 5.5 ด้วยความพยายามระดับ xhigh หากคุณต้องการอยู่ใกล้ระดับแนวหน้า มันตามหลังจุดดัชนีที่ดีที่สุดของ Fable 5.1 อยู่หนึ่งจุดครึ่ง โดยต้นทุนต่องานที่เสร็จสมบูรณ์ลดลง 64% มันคืนโทเคนแรกภายในเวลาประมาณสามวินาที และบรรทัดการเขียนแคชที่ถูกกว่าของมันทำให้คำนำหน้าบริบทที่สร้างใหม่มีค่าใช้จ่ายที่พอรับได้
• งานระยะยาวแบบปลายเปิดที่คำตอบผิดมีค่าใช้จ่ายสูง — Claude Fable 5.1 ทำคะแนนสูงสุดเท่ากับ Sonnet 5.5 ที่ต้นทุนต่องานเท่ากัน โดยไปถึงจุดนั้นด้วยโทเคนการให้เหตุผลเพียงหนึ่งในสามและอินพุตเพียงหนึ่งในสี่ ซึ่งสำคัญเมื่องานเป็นปลายเปิดอย่างแท้จริงและรูปแบบของชุดประเมินคล้ายกับปัญหาของคุณ
• พื้นผิวอินเทอร์แอกทีฟที่ถูกจำกัดด้วยความหน่วง — Claude Sonnet 5.5 และนี่ไม่ใกล้เคียงเลย ในสแนปช็อตของผู้ประเมินเอง ช่องว่างของโทเค็นแรกนั้นต่างกันถึงสองอันดับของขนาดในประเภทพรอมป์ยาว และค่าที่อ่านได้จากพรอมป์ขนาดกลางก็ลดช่องว่างลงเหลือเพียงประมาณ 118 วินาที พื้นผิวแชทไม่สามารถสร้างบนตัวเลขของ Fable 5.1 ได้โดยไม่ต้องมีการแบตช์หรือสตรีมมิ่งเพื่อหลบเลี่ยงปัญหานั้น
• การสร้างแบบจำนวนมากด้วยเอาต์พุตยาว — Claude Sonnet 5.5 เนื่องจากเพดานเอาต์พุต 300,000 โทเคนที่มีให้บน Message Batches API ภายใต้เฮดเดอร์ output-300k-2026-03-24 เทียบกับเพดาน 128,000 โทเคนในที่อื่น ๆ ยืนยันราคาแบบกลุ่มของคุณก่อนตัดสินใจ อัตราแบบกลุ่มไม่เหมือนกันในการ์ดทั้งสองใบ
• งานที่ต้องข้ามบัญชีหรือส่งต่อการให้เหตุผลระหว่างระบบ — อ่านเอกสาร preserved-thinking ของ Anthropic ก่อนจะทำอย่างใดอย่างหนึ่ง บล็อก Thinking ผูกอยู่กับโมเดลและบัญชีที่สร้างมันขึ้นมา และ Sonnet 5.5 เป็น Sonnet รุ่นแรกที่มาพร้อมตัวจำแนกประเภทซึ่งป้องกันการสกัด reasoning นั่นเป็นทั้งคุณสมบัติด้านการปฏิบัติตามข้อกำหนดและข้อจำกัดในเวลาเดียวกัน
• เวิร์กโหลดที่อยู่ภายใต้การกำกับดูแลหรืออ่อนไหวต่อการเก็บรักษาข้อมูล — ควรตรวจสอบนโยบายปัจจุบันแทนที่จะดูจากความครอบคลุมตอนเปิดตัว Claude Sonnet 5.5 เปิดตัวโดยมี zero data retention ให้ใช้ได้; เอกสารของ Fable 5.1 อธิบายนโยบายแบบค่อยเป็นค่อยไป โดยมีหน้าต่างเริ่มต้น 30 วันบนการติดตั้งใช้งานหนึ่งรายการ และ zero retention เป็นสถานะระหว่างกาล

บน OrcaRouter Claude Fable 5.1 และ Claude Sonnet 5 ต่างก็อยู่เบื้องหลัง credential เดียวที่ราคาตามรายการของผู้ให้บริการโดยบวกเพิ่ม 0% ดังนั้นบรรทัดค่า cache-read และการเปลี่ยนแปลงของ tokenizer จึงเป็นสิ่งเดียวที่ทำให้บิลของคุณขยับเมื่อคุณสลับไปมาระหว่างสองตัวนี้ ปัจจุบัน Claude Sonnet 5.5 ยังไม่ใช่เส้นทางบนแพลตฟอร์มของเรา — โมเดลนี้เพิ่งเปิดตัวได้เพียงหนึ่งวัน — ดังนั้นคำตอบที่ตรงไปตรงมาคือ วันนี้คุณเข้าถึงมันผ่าน API ของ Anthropic เอง ใครก็ตามที่รัน Fable 5.1 ผ่านเรา สามารถคำนวณราคาของการสลับได้ในวันที่มันเปิดให้ใช้ โดยไม่ต้องเปลี่ยนแปลงสิ่งอื่นใดในการผสานรวมของตน และในระหว่างนี้ การ failover อัตโนมัติข้ามผู้ให้บริการคือสิ่งที่ทำให้ปลอดภัยที่จะลองโมเดลใหม่ขนาดนี้บนเส้นทางที่ต้องทำงานต่อเนื่องอยู่เสมอ
ข้อสรุปนั้นแคบกว่าที่ช่องว่างราคาบ่งชี้ Claude Sonnet 5.5 เป็นค่าเริ่มต้นที่ดีกว่าสำหรับงานที่มีขอบเขตจำกัดเกือบทุกอย่าง — มันทำคะแนนได้สูงกว่า 3 คะแนนบนดัชนีอิสระ ตอบกลับภายในไม่กี่วินาที และที่ xhigh มันทำคะแนนได้ห่างจากเพดานของ Fable 5.1 เพียงหนึ่งจุดครึ่ง ด้วยต้นทุนต่องานที่ต่ำกว่าครึ่งหนึ่งมาก Claude Fable 5.1 ยังคงมีข้อโต้แย้งจริงอยู่หนึ่งข้อ และเป็นข้อที่ตารางเปรียบเทียบของ Anthropic เองชี้ให้เห็น นั่นคือ เมื่องานเป็นแบบเปิดกว้าง และต้นทุนของการผิดพลาดสูงกว่าต้นทุนของการคิดนานขึ้น ราคาอินพุตที่แพงกว่าห้าเท่าจะซื้อโมเดลที่ทำคะแนนได้เท่ากันโดยไม่ต้องใช้ reasoning tokens มากกว่าสามเท่าเพื่อไปให้ถึงจุดนั้น เลือกจากรูปร่างของงาน ไม่ใช่ขนาดของเรตการ์ด เพราะที่ระดับสูงสุดของบันไดความพยายาม โมเดลสองตัวนั้นคิดเงินคุณเท่ากัน
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
