
Claude Fable 5 ในฐานะผู้ควบคุมระบบของคุณ: คู่มือ Subagent ที่ช่วยลดต้นทุนโทเคน
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
เมื่อวันที่ 7 สิงหาคม Anthropic ได้ทำการเปลี่ยนแปลงครั้งใหญ่ที่สุดเพียงครั้งเดียวต่อ Claude Fable 5 นับตั้งแต่โมเดลเปิดตัวเมื่อวันที่ 9 มิถุนายน โดยลด "fallbacks" ที่เกี่ยวข้องกับชีววิทยาลงประมาณ 85% ทำให้คำถามด้านสุขภาพและการศึกษาในชีวิตประจำวันได้รับคำตอบโดยตรง แทนที่จะเปลี่ยนไปใช้โมเดลที่อ่อนแอกว่าอย่างเงียบ ๆ แต่รูปแบบที่กำลังแพร่กระจายในชุมชน Claude Code ในสัปดาห์นี้จริง ๆ แล้วไม่เกี่ยวกับชีววิทยาเลย ผู้ปฏิบัติงานต่างโพสต์เวิร์กโฟลว์ที่ Claude Fable 5 วนลูปการประสานงาน — การชี้แจงความต้องการ, การแยกย่อยแผน, การส่งมอบงาน, การยอมรับผลลัพธ์ — ในขณะที่การดำเนินการถูกส่งต่อไปยังซับเอเจนต์ของ Claude Opus 5 ผลตอบแทนที่กล่าวอ้าง: Fable 5 High กลายเป็นค่าเริ่มต้นเซสชันที่คุ้มค่า และความเวิ่นเว้อของ Claude Opus 5 จะไม่ทำให้เซสชันหมดไปอีกต่อไป
ตัวอย่างล่าสุดคือของ @dotey ซึ่งโพสต์เมื่อวันที่ 14 สิงหาคม: การเพิ่มเติมสั้นๆ ในไฟล์ ~/.claude/CLAUDE.md ที่บอกให้เอเจนต์เปิด Opus subagents สำหรับการประมวลผล โดยให้ Claude Fable 5 ใช้ระดับการใช้เหตุผลสูงเป็นค่าเริ่มต้นของเซสชัน โดยผู้เขียนรายงานว่าการใช้โทเคนยังคงอยู่ในระดับที่สมเหตุสมผล — และเหตุผลตรงไปตรงมาที่ไม่ใช้ Claude Opus 5 เป็นค่าเริ่มต้น: ในมือของพวกเขา มันทำงานช้าเกินไปและเผาผลาญโทเคนจำนวนมหาศาลในลูปหลัก นั่นเป็นข้อค้นพบจากชุมชน ไม่ใช่คำแนะนำจาก Anthropic — และควรทำความเข้าใจก่อนที่คุณจะคัดลอกไปใช้ เพราะในทางทฤษฎีแล้วมันดูย้อนกลับ
รูปแบบในย่อหน้าเดียว. ใน Claude Code ซับเอเจนต์จะสืบทอดโมเดลเซสชันของคุณตามค่าเริ่มต้น ดังนั้นวิธีที่จะรักษาวงรอบที่รวดเร็วและประหยัดคือการทำให้โมเดลเซสชันเป็นผู้วางแผน และชี้ให้ผู้ปฏิบัติงานไปที่โมเดลอื่นอย่างชัดเจน Claude Fable 5 — โมเดลคลาส Mythos ของ Anthropic ที่ถูกทำให้ปลอดภัยสำหรับการใช้งานทั่วไป เปิดตัวเมื่อวันที่ 9 มิถุนายน 2026 ในราคา $10/$50 ต่อล้านโทเคน — เก็บข้อกำหนด แยกย่อยงาน มอบหมายงาน และรับผลลัพธ์ Claude Opus 5 — เปิดตัวเมื่อวันที่ 24 กรกฎาคม 2026 ในราคา $5/$25 ต่อล้านโทเคน — ลงมือปฏิบัติจริงภายในซับเอเจนต์ คุณใช้วิจารณญาณระดับ Fable กับรอบการประสานงานจำนวนไม่กี่รอบ และใช้การปฏิบัติระดับ Opus กับรอบการทำงานจำนวนมาก ซึ่งเป็นที่ที่โทเคนส่วนใหญ่ถูกใช้ไปแล้ว
เหตุใดโมเดล main-loop จึงเป็นปัญหาด้านต้นทุนที่แท้จริง
ในเกณฑ์วัดประสิทธิภาพ ปัญหานี้ดูเหมือนจะได้รับการแก้ไขแล้ว — และคำตอบดูเหมือนคือ "ค่าเริ่มต้นเป็น Opus 5" ตัวเลขของ Anthropic เอง (รายงานโดยผู้พัฒนาระบบ ยังไม่มีการทำซ้ำเพื่อยืนยัน) ระบุว่า Claude Opus 5 นำหน้า Claude Fable 5 ในเกณฑ์วัดการเขียนโค้ดแบบ agentic อย่าง Frontier-Bench v0.1 (43.3% vs 33.7%), ใน SWE-bench Verified (96.0% vs 95.5%), และใน ARC-AGI-3 (30.2% ซึ่งมากกว่ารุ่นสาธารณะที่ได้อันดับรองลงมาประมาณ 4 เท่า) Anthropic วางตำแหน่ง Opus 5 ว่ามีความฉลาดระดับแนวหน้าที่ใกล้เคียงกับ Fable 5 ในราคาครึ่งเดียว ถ้าคุณเลือกค่าเริ่มต้นของเซสชันโดยพิจารณาจากเกณฑ์วัดของผู้พัฒนาระบบและราคาต่อโทเคนเพียงอย่างเดียว Opus 5 ก็เป็นตัวเลือกที่เห็นได้ชัด
ผู้ปฏิบัติที่รันเซสชันยาวๆ จริงๆ กำลังไปถึงค่าเริ่มต้นที่ตรงกันข้าม และเหตุผลคือโทเค็นต่องาน ไม่ใช่ราคาต่อโทเค็น การคิดของ Opus 5 เปิดอยู่โดยค่าเริ่มต้นและปรับเปลี่ยนได้ และ Anthropic กล่าวว่ามันตรวจสอบงานของตัวเองโดยไม่ต้องมีการแจ้งเตือน — ซึ่งหมายความว่า ในทางปฏิบัติ ทุกเทิร์นของลูปปล่อยโทเค็นมากกว่าของ Fable 5 อย่างมีนัยสำคัญ การปิดการคิดนั้นถูกจำกัดไว้ที่ระดับความพยายามสูง ดังนั้นคุณไม่สามารถทำให้มันประหยัดสุดๆ ได้ ในเซสชันที่ดำเนินไปเป็นชั่วโมง ลูปคือสิ่งที่ทบต้น: โมเดลที่ถูกที่สุดต่อโทเค็นอาจกลายเป็นแพงที่สุดต่อเซสชัน และโมเดลที่พูดน้อยที่สุดจะทำให้ลูปเร็ว
ตรงกับที่ @dotey รายงาน การตั้งค่าแบบกลับด้านทำให้การใช้โทเค็น “ไม่แย่” ก็เพราะว่า Opus 5 — ตัวที่ verbose — ถูกกักไว้ให้เป็น subagents ซึ่งเอาต์พุตของมันคือสิ่งที่ต้องการส่งมอบ มากกว่าจะเป็นค่าใช้จ่ายแฝง
สถาปัตยกรรมแบบกลับด้าน: Fable 5 วางแผน, Opus ปฏิบัติการ
สถาปัตยกรรมนี้อธิบายได้ง่าย แต่การทำงานค่อนข้างขัดกับสัญชาตญาณ:
• โมเดลเซสชัน — Claude Fable 5 ที่ระดับความพยายามในการใช้เหตุผลสูง (คำว่า "High" ในคำเรียกย่อของชุมชน "Fable 5 High") โมเดลนี้เป็นเจ้าของการสนทนา แผนงาน และนิยามของความสำเร็จ
• เทิร์นการออร์เคสเตรชัน — การชี้แจงข้อกำหนด การแยกย่อยแผน การกระจายงาน และการรับผลลัพธ์ ล้วนเกิดขึ้นบน Fable 5 เทิร์นเหล่านี้มีจำนวนน้อยและเป็นสัดส่วนเล็กน้อยของโทเค็นทั้งหมด
• เทิร์นการดำเนินการ — งานแต่ละงานจะถูกส่งไปยังซับเอเจนต์ที่รัน Claude Opus 5 เทิร์นเหล่านี้คือเทิร์นจำนวนมากและเป็นส่วนหลักของการใช้โทเคน — และ Opus 5 คือจุดที่คะแนนเชิงเอเจนต์ตามรายงานของผู้ให้บริการสูงที่สุด
เศรษฐศาสตร์ใช้ได้เพราะเส้นต้นทุนสองเส้นชี้ไปในทิศทางที่ต่างกัน จุดแข็งของ Fable 5 คือการตัดสินใจ; คุณใช้มันอย่างประหยัด จุดแข็งของ Opus 5 คือการประมวลผล; คุณใช้มันอย่างหนักแต่แบบขนาน แยกออกจากลูป ลูปยังคงเร็วและราคาถูก และความสามารถที่มีค่าใช้จ่ายสูงถูกใช้ตรงจุดที่โทเคนถูกใช้อยู่แล้ว
นี่คือหนึ่งในสองรูปแบบชุมชนที่เผยแพร่อยู่ และทั้งสองเป็นภาพสะท้อนซึ่งกันและกัน รูปแบบ "architect pattern" ที่แนะนำกันทั่วไป (เช่นที่ใช้ในปลั๊กอิน fable-advisor) จะให้ Opus ทำหน้าที่เป็นสถาปนิกเต็มเวลา และสงวน Fable 5 ไว้สำหรับงาน implementation ที่ซับซ้อนสูงสุดและการทบทวนการส่งมอบงานภาคบังคับ ความแตกต่างคือเป้าหมายของการปรับให้เหมาะสม: รูปแบบสถาปนิกใช้โทเค็นระดับ Opus ไปกับการประสานงาน และใช้ Fable 5 เป็นเหมือนมีดผ่าตัด; ส่วนรูปแบบกลับด้านใช้ Fable 5 สำหรับการประสานงาน และใช้ Opus 5 สำหรับปริมาณงาน ทั้งสองเป็นแนวทางจากชุมชน — Anthropic ไม่ได้จัดทำเอกสารสำหรับทั้งคู่ — และทั้งสองเป็นความพยายามที่จะใช้โทเค็นระดับแนวหน้าในจุดที่เปลี่ยนแปลงผลลัพธ์
การตั้งค่าใน Claude Code
Claude Code ไม่มี "โหมดออร์เคสเตรเตอร์" ในตัว ดังนั้นรูปแบบนี้จึงถูกบังคับใช้ด้วยสองวิธี: คำแนะนำในพรอมป์ตของเซสชัน และการปักหมุดโมเดลอย่างชัดเจนในฝั่งการดำเนินการ
ชั้นคำสั่งอยู่ใน ~/.claude/CLAUDE.md — ไฟล์เดียวกันกับที่ @dotey แก้ไข ในเชิงรูปแบบ โพรอมป์บอกให้เอเจนต์หลักทำสี่อย่างก่อนที่จะถือว่างานใดๆ เสร็จสิ้น:
• กล่าวซ้ำข้อกำหนดและยืนยันขอบเขตก่อนเขียนโค้ด
• แยกย่อยงานออกเป็นงานย่อยที่สามารถทำงานแบบขนานได้
• ส่งงานปฏิบัติการแต่ละงานให้กับซับเอเจนต์ที่ผูกกับ Claude Opus 5
• ตรวจสอบผลลัพธ์แต่ละรายการกับแผนก่อนที่จะยอมรับ
รูปแบบนั้นควรกล่าวถึงในฐานะแนวทางปฏิบัติ มากกว่าที่จะเป็นโค้ดสำหรับคัดลอกวาง — ความต้องการและสแต็กเทคโนโลยีของคุณต่างหากที่กำหนดว่าสิ่งใดควรอยู่ในนั้น
เลเยอร์โมเดลมีความสำคัญมากกว่าที่หลาย ๆ การตั้งค่าคาดการณ์เอาไว้ ใน Claude Code ลำดับการกำหนดโมเดลของซับเอเจนต์คือ: ตัวแปรสภาพแวดล้อม CLAUDE_CODE_SUBAGENT_MODEL, ตามด้วยพารามิเตอร์โมเดลเฉพาะการเรียกใช้, ตามด้วย frontmatter ของนิยามเอเจนต์, และสุดท้ายคือโมเดลเซสชัน เอเจนต์ที่ไม่ตั้งค่าโมเดลไว้จะสืบทอดโมเดลเซสชัน ดังนั้น หากเซสชันของคุณรันบน Fable 5 และคุณพึ่งพาอาร์กิวเมนต์โมเดลของเครื่องมือ Agent ก็มีความเสี่ยงที่ระบุไว้ในเอกสารว่าโมเดลนั้นจะถูกเพิกเฉย (GitHub issue #83920): ซับเอเจนต์จะสืบทอดโมเดลเซสชันอยู่ดี และคุณจะจ่ายในราคา Fable 5 สำหรับการประมวลผลที่คุณตั้งใจจะให้รันบน Opus 5
วิธีแก้ไขที่เชื่อถือได้สองวิธี: ตั้งค่า CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 สำหรับเซสชัน หรือระบุโมเดลใน frontmatter ของ subagent ตัวแปรตัวเดียวนั้นคือความแตกต่างระหว่างรูปแบบที่ทำงานตามที่ออกแบบไว้ กับการรันทั้งเซสชันบนโมเดลราคาแพงอย่างเงียบ ๆ
การคำนวณโทเค็นเบื้องหลังการแยก
ต่อไปนี้คือสองรุ่นตามราคาที่ตั้งไว้ในวันนี้ (เผยแพร่โดยผู้จำหน่าย และส่งผ่านในราคาขายปลีกบน OrcaRouter):
• Claude Fable 5 — 10 ดอลลาร์ต่อ 1M โทเคนอินพุต, 50 ดอลลาร์ต่อ 1M โทเคนเอาต์พุต; บริบท 1M โทเคน, เอาต์พุต 128K.
• Claude Opus 5 — $5 ต่อ 1M โทเคนอินพุต, $25 ต่อ 1M โทเคนเอาต์พุต; บริบท 1M โทเคน, เอาต์พุต 128K

ส่วนที่ขัดกับสัญชาตญาณคือ Opus 5 มีราคาต่อโทเค็นเพียงครึ่งเดียว แต่ก็ยังอาจแพ้เกมต้นทุนต่อเซสชันได้ มองเห็นภาพได้ง่ายด้วยตัวเลขคร่าวๆ: หากลูปบน Opus 5 ปล่อยโทเค็นเป็นสองถึงสามเท่าของลูปบน Fable 5 — ตัวเลขที่ใช้เพื่อให้เห็นภาพซึ่งสอดคล้องกับรายงานจากผู้ปฏิบัติจริงเกี่ยวกับพฤติกรรมการตรวจสอบตนเองของ Opus 5 ไม่ใช่ตัวเลขที่วัดได้ — ต่อให้คิดอัตราต่อโทเค็นแค่ครึ่งเดียว ต้นทุนของลูปก็ยังใกล้เคียงกัน และหากช่องว่างกว้างกว่านั้น Opus ในลูปก็ยิ่งแพงขึ้น ในขณะเดียวกัน โทเค็นสำหรับการประมวลผล ซึ่งเป็นส่วนใหญ่ของเซสชัน อยู่บน Opus 5 ในซับเอเจนต์ในอัตราที่ถูกกว่า ไม่ว่ากรณีใดก็ตาม
นั่นคือข้อโต้แย้งทั้งหมดสำหรับรูปแบบกลับด้าน: วางโมเดลที่มีราคาต่อโทเคนสูงกว่าแต่มีลูปที่คล่องตัวกว่าไว้ที่ลูป และวางโมเดลที่ราคาต่อโทเคนถูกกว่าไว้ที่ปริมาณ มันคือการตัดสินใจเรื่องเส้นทางที่ถูกทำให้ดูเหมือนการตัดสินใจเรื่องโมเดล
เนื่องจาก {{1}}OrcaRouter ส่งต่อราคาผู้ให้บริการโดยไม่บวกกำไร (0% markup){{/1}} ตัวเลขด้านบนคือราคาที่คุณจ่ายจริงที่นี่ — ไม่มีค่าธรรมเนียมแพลตฟอร์มเพิ่ม — และหาก {{2}}Anthropic ลดราคาใดราคาหนึ่ง{{/2}} การเปลี่ยนแปลงจะแสดงบนหน้าโมเดลในวันเดียวกัน
เมื่อรูปแบบกลับด้านได้ผล — และเมื่อไม่ได้ผล
การคัดลอกการตั้งค่าของ @dotey โดยไม่พิจารณารูปแบบภาระงานของตัวเองนั้น เป็นความผิดพลาดในทั้งสองทิศทาง
รูปแบบกลับด้านจะชนะเมื่อ:
• ข้อกำหนดไม่ชัดเจนหรือแผนมีองค์ประกอบที่ต้องจัดการหลายส่วน — การใช้ดุลยพินิจในการประสานงานคือทรัพยากรที่ขาดแคลน
• การดำเนินการสามารถแบ่งขนานเป็นซับเอเจนต์ได้ — ปริมาณงานจะหลุดออกจากลูป
• เซสชันยาวนาน — ความยืดยาวของลูปสะสมทบเป็นต้นทุนจริง
คำแนะนำมาตรฐานจะชนะเมื่อ:
• งานส่วนใหญ่ในเซสชันของคุณเป็นงานที่มีขอบเขตจำกัดและเป็นกลไก — แพลนเนอร์ระดับ Fable นั้นเกินความจำเป็น และราคาที่ต่ำกว่าของ Opus 5 กับคะแนน benchmark ที่สูงกว่าทำให้มันเป็นค่าเริ่มต้นที่ชัดเจน นี่คือเหตุผลที่เอกสารของ Claude Code เองกำหนดให้ Opus เป็นค่าเริ่มต้นของเซสชัน และสงวน Fable 5 ไว้สำหรับการเลือกอย่างชัดแจ้ง
• คุณไม่สามารถระบุโมเดลตัวแทนย่อยได้อย่างน่าเชื่อถือ — บั๊กการสืบทอด #83920 เปลี่ยนรูปแบบกลับด้านให้กลายเป็น "ทุกอย่างเป็นเรื่องของการกำหนดราคา Fable 5"
นอกจากนี้ยังมีเส้นทางสายกลางสำหรับการปรับแต่ง Opus 5 เปิดเผยพารามิเตอร์ความพยายาม (จากต่ำไปสูงสุด ค่าเริ่มต้นคือสูง) คุณจึงสามารถปรับให้มีพฤติกรรมที่กระชับขึ้นได้ — แต่ไม่สามารถปรับได้ทั้งหมด เพราะการปิดการคิดนั้นถูกจำกัดไว้ที่ระดับความพยายามสูง หากปัญหาของคุณคือความเยิ่นเย้อของ Opus 5 การลดระดับความพยายามลงอาจเพียงพอ และคุณไม่จำเป็นต้องพลิกสถาปัตยกรรมเลย
การเปลี่ยนแปลงทางชีววิทยาเมื่อวันที่ 7 สิงหาคมส่งผลต่อการตั้งค่านี้อย่างไร
การอัปเดตเมื่อวันที่ 7 สิงหาคมของ Anthropic ได้เขียนและฝึกคลาสสิฟายเออร์ชีววิทยาของ Claude Fable 5 ใหม่ — ระบบที่ใช้ตัดสินว่าคำค้นหาจะทำให้เกิด "fallback" ไปยังโมเดลที่มีความสามารถน้อยกว่าหรือไม่ ตามตัวเลขของ Anthropic เอง (ที่รายงานโดยผู้จำหน่าย) การ fallback ที่เกี่ยวข้องกับชีววิทยาลดลงประมาณ 85% ในทุกพื้นผิวผลิตภัณฑ์ โดยรวม fallback ลดลง ~67% บน Claude.ai, ~55% บน Cowork, ~17% บน Claude Code และ ~7% บน Claude Platform

สำหรับการตั้งค่า orchestration ของ Fable 5 หมายเลข Claude Code คือสิ่งที่สำคัญที่สุด การ fallback คือการที่ระบบเปลี่ยนคำสั่งของคุณไปยังโมเดลอื่นอย่างเงียบ ๆ — ในกรณีนี้คือ Opus 5 ในการแชทธรรมดา นั่นคือความขัดสีที่มองไม่เห็น; ในเซสชันแบบ agentic มันหมายความว่าส่วนหนึ่งของไปป์ไลน์ของคุณทำงานบนโมเดลที่คุณไม่ได้เลือก ด้วยต้นทุนที่คุณไม่ได้วางแผน การอัปเดตไม่ได้ลบสิ่งนั้น: ไวรัสวิทยา พิษวิทยา และการออกแบบโมเลกุลยังคง fallback แต่ชีววิทยาในชีวิตประจำวันและการศึกษา — การอ่านผลแล็บ การทำความเข้าใจอาการ การเรียนชีววิทยา — ตอนนี้ยังคงอยู่บน Fable 5
หมายเหตุล่วงหน้าข้อหนึ่ง ขอระบุให้ชัดเจน: รายงานที่ไม่ได้รับการยืนยันจากปลายเดือนกรกฎาคม (36kr, WinCentral) ชี้ว่าอาจมีการรีเฟรช Claude Fable 5.1 ในเดือนนี้โดยราคาไม่เปลี่ยนแปลง Anthropic ยังไม่ได้ยืนยันชื่อ วันที่ หรือรหัสโมเดล API — ให้ถือว่านั่นเป็นการคาดเดาจนกว่าจะเปิดตัวจริง
ลองใช้โดยไม่ต้องเสี่ยงกับเวิร์กโฟลว์ของคุณ
สิ่งที่ทำให้รูปแบบกลับด้านนี้น่าลองก็คือมันสามารถย้อนกลับได้ และการส่งทั้งสองโมเดลผ่านเอนด์พอยต์เดียวทำให้การย้อนกลับมีต้นทุนต่ำ
บน OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) และ Claude Opus 5 (anthropic/claude-opus-5) อยู่ภายใต้คีย์ API เดียวกัน คุณสามารถรัน execution lane ของเซสชันบนโมเดลใดก็ได้โดยไม่ต้องมีสัญญาเพิ่มเติมหรือแก้ไขโค้ด — ซึ่งตรงกับความต้องการของการทดลองอย่าง "Fable 5 ในฐานะออร์เคสเตรเตอร์" เพราะประเด็นสำคัญคือการวัดต้นทุนต่อเซสชันของคุณเองก่อนตัดสินใจ

ฟีเจอร์ OrcaRouter สองอย่างสอดคล้องโดยตรงกับการตั้งค่านี้ การเฟลโอเวอร์อัตโนมัติช่วยให้คุณกำหนดสายโซ่สำรองได้ — หาก Fable 5 เกิดข้อผิดพลาดหรือหมดเวลา คำขอจะถูกจัดเส้นทางไปยัง Opus 5 หรือโมเดลที่ถูกกว่าแทนที่จะล้มเหลว และ DSL การจัดเส้นทางสามารถรวมทั้งคู่เข้าด้วยกันเป็นการเรียกครั้งเดียว: ขั้นตอนการวางแผนของ Fable 5 ตามด้วยขั้นตอนการทำงานของ Opus 5 ภายใต้เอนด์พอยต์เดียว ซึ่งคือรูปแบบออร์เคสเตรชันที่แสดงออกมาเป็นโครงสร้างพื้นฐาน ไม่ใช่เป็นวินัยด้านพรอมป์ต์
บรรทัดล่าง
สถาปัตยกรรมแบบกลับด้าน — Claude Fable 5 วางแผน, Claude Opus 5 ลงมือปฏิบัติ — คือคำตอบที่แท้จริงและใช้ได้จริงสำหรับปัญหาจริง: โมเดลที่ถูกที่สุดต่อโทเคนไม่จำเป็นต้องถูกที่สุดต่อเซสชัน ไม่ใช่การตัดสินใจเพื่อเบนช์มาร์ก; Opus 5 ชนะการเปรียบเทียบแบบเอเจนต์ที่รายงานโดยผู้ขายส่วนใหญ่ มันคือการตัดสินใจเรื่องการจัดเส้นทางโทเคน และจะคุ้มค่าก็ต่อเมื่อดุลยพินิจในการประสานงานมีจำกัดและการดำเนินการสามารถทำแบบขนานได้
Claude Fable 5 (9 มิถุนายน 2026) และ Claude Opus 5 (24 กรกฎาคม 2026) ต่างก็เป็นโมเดลปัจจุบันของ Anthropic และการเปลี่ยนแปลงมาตรการป้องกันในวันที่ 7 สิงหาคมทำให้ Fable 5 เป็นโมเดลหลักที่ใช้ประจำวันซึ่งถูกขัดจังหวะน้อยลง จงจับตาสามสิ่ง: ว่ารายงานของ Fable 5.1 จะมีน้ำหนักจริงหรือไม่ ว่า Anthropic จะแก้บั๊กการสืบทอดซับเอเยนต์ที่อาจทำให้รูปแบบนี้ถูกทำลายอย่างเงียบ ๆ หรือไม่ และ — ที่สำคัญที่สุด — ต้นทุนต่องานที่สำเร็จของคุณเองตลอดหนึ่งสัปดาห์ของเซสชันจริงจะเป็นเช่นไร
คำถามที่พบบ่อย
Fable 5 เป็นโมเดลเริ่มต้นใน Claude Code หรือไม่
ไม่ เอกสารของ Claude Code เองระบุว่า Fable 5 ไม่ใช่ค่าเริ่มต้นสำหรับบัญชีประเภทใดๆ — เซสชันมีค่าเริ่มต้นเป็นโมเดล Opus มาตรฐาน และคุณเลือก Fable 5 ผ่าน /model การตั้งค่าโมเดล หรือ alias "best" รูปแบบในบทความนี้จงใจทำงานขัดกับค่าเริ่มต้นนั้น
ทำไมไม่ใช้ Opus 5 เป็นค่าเริ่มต้นเลย เพราะมันถูกกว่าต่อโทเคนและได้คะแนนสูงกว่า?
เนื่องจากต้นทุนต่อเซสชันคือจำนวนโทเค็นต่องานคูณด้วยราคาต่อโทเค็น ผู้ปฏิบัติงานรายงานว่าการคิดแบบปรับตัวและการตรวจสอบตนเองของ Opus 5 สร้างโทเค็นต่อเทิร์นมากกว่ามาก ดังนั้นแม้จะมีอัตราราคาต่อโทเค็นเพียงครึ่งเดียว ก็ยังอาจช้ากว่าและแพงกว่าในการวนลูปที่ยาวนาน นี่คือข้อค้นพบของชุมชนที่เพลย์บุ๊กนี้สร้างขึ้นมา — วัดผลกับเวิร์กโหลดของคุณเองก่อนที่จะเลือกข้าง
ฉันสามารถบังคับให้ subagents ของฉันรันโมเดลที่แตกต่างจากเซสชันได้ไหม
ใช่ แต่ไม่ควรพึ่งพาพารามิเตอร์โมเดลแบบต่อการเรียกใช้: GitHub issue #83920 ระบุว่ามันถูกเพิกเฉย โดย subagents จะสืบทอดโมเดลของเซสชันแทน ตั้งค่า CLAUDE_CODE_SUBAGENT_MODEL หรือปักหมุดโมเดลใน frontmatter ของ subagent — นั่นคือความแตกต่างระหว่างการทำงานที่คิดราคา Opus 5 กับการทำงานอย่างเงียบ ๆ ที่คิดราคา Fable 5
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
