การ์ดหัวเรื่อง Hero สำหรับบทความ 'Claude Fable 5 as Your Orchestrator' แสดงโหนดกลาง Claude Fable 5 ที่แตกแขนงออกไปยังโหนด worker subagent Opus 5 ขนาดเล็กกว่าสี่โหนด พร้อมคำบรรยายใต้หัวเรื่องว่า 'A Claude Code subagent playbook for keeping token costs down' และโลโก้ OrcaRouter ประกอบอยู่ที่มุม
Guides & Insights

Claude Fable 5 ในฐานะผู้ควบคุมระบบของคุณ: คู่มือ Subagent ที่ช่วยลดต้นทุนโทเคน

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เมื่อวันที่ 7 สิงหาคม Anthrop​ic ได้ทำการเปลี่ยนแปลงครั้งใหญ่ที่สุดเพียงครั้งเดียวต่อ Claude Fable 5 นับตั้งแต่โมเดลเปิดตัวเมื่อวันที่ 9 มิถุนายน โดยลด "fallbacks" ที่เกี่ยวข้องกับชีววิทยาลงประมาณ 85% ทำให้คำถามด้านสุขภาพและการศึกษาในชีวิตประจำวันได้รับคำตอบโดยตรง แทนที่จะเปลี่ยนไปใช้โมเดลที่อ่อนแอกว่าอย่างเงียบ ๆ แต่รูปแบบที่กำลังแพร่กระจายในชุมชน Claude Code ในสัปดาห์นี้จริง ๆ แล้วไม่เกี่ยวกับชีววิทยาเลย ผู้ปฏิบัติงานต่างโพสต์เวิร์กโฟลว์ที่ Claude Fable 5 วนลูปการประสานงาน — การชี้แจงความต้องการ, การแยกย่อยแผน, การส่งมอบงาน, การยอมรับผลลัพธ์ — ในขณะที่การดำเนินการถูกส่งต่อไปยังซับเอเจนต์ของ Claude Opus 5 ผลตอบแทนที่กล่าวอ้าง: Fable 5 High กลายเป็นค่าเริ่มต้นเซสชันที่คุ้มค่า และความเวิ่นเว้อของ Claude Opus 5 จะไม่ทำให้เซสชันหมดไปอีกต่อไป

ตัวอย่างล่าสุดคือของ @dotey ซึ่งโพสต์เมื่อวันที่ 14 สิงหาคม: การเพิ่มเติมสั้นๆ ในไฟล์ ~/.claude/CLAUDE.md ที่บอกให้เอเจนต์เปิด Opus subagents สำหรับการประมวลผล โดยให้ Claude Fable 5 ใช้ระดับการใช้เหตุผลสูงเป็นค่าเริ่มต้นของเซสชัน โดยผู้เขียนรายงานว่าการใช้โทเคนยังคงอยู่ในระดับที่สมเหตุสมผล — และเหตุผลตรงไปตรงมาที่ไม่ใช้ Claude Opus 5 เป็นค่าเริ่มต้น: ในมือของพวกเขา มันทำงานช้าเกินไปและเผาผลาญโทเคนจำนวนมหาศาลในลูปหลัก นั่นเป็นข้อค้นพบจากชุมชน ไม่ใช่คำแนะนำจาก Anthrop​ic — และควรทำความเข้าใจก่อนที่คุณจะคัดลอกไปใช้ เพราะในทางทฤษฎีแล้วมันดูย้อนกลับ

รูปแบบในย่อหน้าเดียว. ใน Claude Code ซับเอเจนต์จะสืบทอดโมเดลเซสชันของคุณตามค่าเริ่มต้น ดังนั้นวิธีที่จะรักษาวงรอบที่รวดเร็วและประหยัดคือการทำให้โมเดลเซสชันเป็นผู้วางแผน และชี้ให้ผู้ปฏิบัติงานไปที่โมเดลอื่นอย่างชัดเจน Claude Fable 5 — โมเดลคลาส Mythos ของ Anthrop​ic ที่ถูกทำให้ปลอดภัยสำหรับการใช้งานทั่วไป เปิดตัวเมื่อวันที่ 9 มิถุนายน 2026 ในราคา $10/$50 ต่อล้านโทเคน — เก็บข้อกำหนด แยกย่อยงาน มอบหมายงาน และรับผลลัพธ์ Claude Opus 5 — เปิดตัวเมื่อวันที่ 24 กรกฎาคม 2026 ในราคา $5/$25 ต่อล้านโทเคน — ลงมือปฏิบัติจริงภายในซับเอเจนต์ คุณใช้วิจารณญาณระดับ Fable กับรอบการประสานงานจำนวนไม่กี่รอบ และใช้การปฏิบัติระดับ Opus กับรอบการทำงานจำนวนมาก ซึ่งเป็นที่ที่โทเคนส่วนใหญ่ถูกใช้ไปแล้ว

เหตุใดโมเดล main-loop จึงเป็นปัญหาด้านต้นทุนที่แท้จริง

ในเกณฑ์วัดประสิทธิภาพ ปัญหานี้ดูเหมือนจะได้รับการแก้ไขแล้ว — และคำตอบดูเหมือนคือ "ค่าเริ่มต้นเป็น Opus 5" ตัวเลขของ Anthrop​ic เอง (รายงานโดยผู้พัฒนาระบบ ยังไม่มีการทำซ้ำเพื่อยืนยัน) ระบุว่า Claude Opus 5 นำหน้า Claude Fable 5 ในเกณฑ์วัดการเขียนโค้ดแบบ agentic อย่าง Frontier-Bench v0.1 (43.3% vs 33.7%), ใน SWE-bench Verified (96.0% vs 95.5%), และใน ARC-AGI-3 (30.2% ซึ่งมากกว่ารุ่นสาธารณะที่ได้อันดับรองลงมาประมาณ 4 เท่า) Anthrop​ic วางตำแหน่ง Opus 5 ว่ามีความฉลาดระดับแนวหน้าที่ใกล้เคียงกับ Fable 5 ในราคาครึ่งเดียว ถ้าคุณเลือกค่าเริ่มต้นของเซสชันโดยพิจารณาจากเกณฑ์วัดของผู้พัฒนาระบบและราคาต่อโทเคนเพียงอย่างเดียว Opus 5 ก็เป็นตัวเลือกที่เห็นได้ชัด

ผู้ปฏิบัติที่รันเซสชันยาวๆ จริงๆ กำลังไปถึงค่าเริ่มต้นที่ตรงกันข้าม และเหตุผลคือโทเค็นต่องาน ไม่ใช่ราคาต่อโทเค็น การคิดของ Opus 5 เปิดอยู่โดยค่าเริ่มต้นและปรับเปลี่ยนได้ และ Anthrop​ic กล่าวว่ามันตรวจสอบงานของตัวเองโดยไม่ต้องมีการแจ้งเตือน — ซึ่งหมายความว่า ในทางปฏิบัติ ทุกเทิร์นของลูปปล่อยโทเค็นมากกว่าของ Fable 5 อย่างมีนัยสำคัญ การปิดการคิดนั้นถูกจำกัดไว้ที่ระดับความพยายามสูง ดังนั้นคุณไม่สามารถทำให้มันประหยัดสุดๆ ได้ ในเซสชันที่ดำเนินไปเป็นชั่วโมง ลูปคือสิ่งที่ทบต้น: โมเดลที่ถูกที่สุดต่อโทเค็นอาจกลายเป็นแพงที่สุดต่อเซสชัน และโมเดลที่พูดน้อยที่สุดจะทำให้ลูปเร็ว

ตรงกับที่ @dotey รายงาน การตั้งค่าแบบกลับด้านทำให้การใช้โทเค็น “ไม่แย่” ก็เพราะว่า Opus 5 — ตัวที่ verbose — ถูกกักไว้ให้เป็น subagents ซึ่งเอาต์พุตของมันคือสิ่งที่ต้องการส่งมอบ มากกว่าจะเป็นค่าใช้จ่ายแฝง

สถาปัตยกรรมแบบกลับด้าน: Fable 5 วางแผน, Opus ปฏิบัติการ

สถาปัตยกรรมนี้อธิบายได้ง่าย แต่การทำงานค่อนข้างขัดกับสัญชาตญาณ:

• โมเดลเซสชัน — Claude Fable 5 ที่ระดับความพยายามในการใช้เหตุผลสูง (คำว่า "High" ในคำเรียกย่อของชุมชน "Fable 5 High") โมเดลนี้เป็นเจ้าของการสนทนา แผนงาน และนิยามของความสำเร็จ

• เทิร์นการออร์เคสเตรชัน — การชี้แจงข้อกำหนด การแยกย่อยแผน การกระจายงาน และการรับผลลัพธ์ ล้วนเกิดขึ้นบน Fable 5 เทิร์นเหล่านี้มีจำนวนน้อยและเป็นสัดส่วนเล็กน้อยของโทเค็นทั้งหมด

• เทิร์นการดำเนินการ — งานแต่ละงานจะถูกส่งไปยังซับเอเจนต์ที่รัน Claude Opus 5 เทิร์นเหล่านี้คือเทิร์นจำนวนมากและเป็นส่วนหลักของการใช้โทเคน — และ Opus 5 คือจุดที่คะแนนเชิงเอเจนต์ตามรายงานของผู้ให้บริการสูงที่สุด

เศรษฐศาสตร์ใช้ได้เพราะเส้นต้นทุนสองเส้นชี้ไปในทิศทางที่ต่างกัน จุดแข็งของ Fable 5 คือการตัดสินใจ; คุณใช้มันอย่างประหยัด จุดแข็งของ Opus 5 คือการประมวลผล; คุณใช้มันอย่างหนักแต่แบบขนาน แยกออกจากลูป ลูปยังคงเร็วและราคาถูก และความสามารถที่มีค่าใช้จ่ายสูงถูกใช้ตรงจุดที่โทเคนถูกใช้อยู่แล้ว

นี่คือหนึ่งในสองรูปแบบชุมชนที่เผยแพร่อยู่ และทั้งสองเป็นภาพสะท้อนซึ่งกันและกัน รูปแบบ "architect pattern" ที่แนะนำกันทั่วไป (เช่นที่ใช้ในปลั๊กอิน fable-advisor) จะให้ Opus ทำหน้าที่เป็นสถาปนิกเต็มเวลา และสงวน Fable 5 ไว้สำหรับงาน implementation ที่ซับซ้อนสูงสุดและการทบทวนการส่งมอบงานภาคบังคับ ความแตกต่างคือเป้าหมายของการปรับให้เหมาะสม: รูปแบบสถาปนิกใช้โทเค็นระดับ Opus ไปกับการประสานงาน และใช้ Fable 5 เป็นเหมือนมีดผ่าตัด; ส่วนรูปแบบกลับด้านใช้ Fable 5 สำหรับการประสานงาน และใช้ Opus 5 สำหรับปริมาณงาน ทั้งสองเป็นแนวทางจากชุมชน — Anthrop​ic ไม่ได้จัดทำเอกสารสำหรับทั้งคู่ — และทั้งสองเป็นความพยายามที่จะใช้โทเค็นระดับแนวหน้าในจุดที่เปลี่ยนแปลงผลลัพธ์

การตั้งค่าใน Claude Code

Claude Code ไม่มี "โหมดออร์เคสเตรเตอร์" ในตัว ดังนั้นรูปแบบนี้จึงถูกบังคับใช้ด้วยสองวิธี: คำแนะนำในพรอมป์ตของเซสชัน และการปักหมุดโมเดลอย่างชัดเจนในฝั่งการดำเนินการ

ชั้นคำสั่งอยู่ใน ~/.claude/CLAUDE.md — ไฟล์เดียวกันกับที่ @dotey แก้ไข ในเชิงรูปแบบ โพรอมป์บอกให้เอเจนต์หลักทำสี่อย่างก่อนที่จะถือว่างานใดๆ เสร็จสิ้น:

• กล่าวซ้ำข้อกำหนดและยืนยันขอบเขตก่อนเขียนโค้ด

• แยกย่อยงานออกเป็นงานย่อยที่สามารถทำงานแบบขนานได้

• ส่งงานปฏิบัติการแต่ละงานให้กับซับเอเจนต์ที่ผูกกับ Claude Opus 5

• ตรวจสอบผลลัพธ์แต่ละรายการกับแผนก่อนที่จะยอมรับ

รูปแบบนั้นควรกล่าวถึงในฐานะแนวทางปฏิบัติ มากกว่าที่จะเป็นโค้ดสำหรับคัดลอกวาง — ความต้องการและสแต็กเทคโนโลยีของคุณต่างหากที่กำหนดว่าสิ่งใดควรอยู่ในนั้น

เลเยอร์โมเดลมีความสำคัญมากกว่าที่หลาย ๆ การตั้งค่าคาดการณ์เอาไว้ ใน Claude Code ลำดับการกำหนดโมเดลของซับเอเจนต์คือ: ตัวแปรสภาพแวดล้อม CLAUDE_CODE_SUBAGENT_MODEL, ตามด้วยพารามิเตอร์โมเดลเฉพาะการเรียกใช้, ตามด้วย frontmatter ของนิยามเอเจนต์, และสุดท้ายคือโมเดลเซสชัน เอเจนต์ที่ไม่ตั้งค่าโมเดลไว้จะสืบทอดโมเดลเซสชัน ดังนั้น หากเซสชันของคุณรันบน Fable 5 และคุณพึ่งพาอาร์กิวเมนต์โมเดลของเครื่องมือ Agent ก็มีความเสี่ยงที่ระบุไว้ในเอกสารว่าโมเดลนั้นจะถูกเพิกเฉย (GitHub issue #83920): ซับเอเจนต์จะสืบทอดโมเดลเซสชันอยู่ดี และคุณจะจ่ายในราคา Fable 5 สำหรับการประมวลผลที่คุณตั้งใจจะให้รันบน Opus 5

วิธีแก้ไขที่เชื่อถือได้สองวิธี: ตั้งค่า CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 สำหรับเซสชัน หรือระบุโมเดลใน frontmatter ของ subagent ตัวแปรตัวเดียวนั้นคือความแตกต่างระหว่างรูปแบบที่ทำงานตามที่ออกแบบไว้ กับการรันทั้งเซสชันบนโมเดลราคาแพงอย่างเงียบ ๆ

การคำนวณโทเค็นเบื้องหลังการแยก

ต่อไปนี้คือสองรุ่นตามราคาที่ตั้งไว้ในวันนี้ (เผยแพร่โดยผู้จำหน่าย และส่งผ่านในราคาขายปลีกบน OrcaRouter):

• Claude Fable 5 — 10 ดอลลาร์ต่อ 1M โทเคนอินพุต, 50 ดอลลาร์ต่อ 1M โทเคนเอาต์พุต; บริบท 1M โทเคน, เอาต์พุต 128K.

• Claude Opus 5 — $5 ต่อ 1M โทเคนอินพุต, $25 ต่อ 1M โทเคนเอาต์พุต; บริบท 1M โทเคน, เอาต์พุต 128K

A comparison scoreboard for Claude Fable 5 and Claude Opus 5 contrasting price ($10/$50 vs $5/$25 per 1M tokens), context (both 1M in / 128K out), Frontier-Bench v0.1 (33.7% vs 43.3%), SWE-bench Verified (95.5% vs 96.0%), loop behaviour, and the role each plays in the orchestrator pattern, with a footer noting prices are vendor-published and benchmarks vendor-reported.

ส่วนที่ขัดกับสัญชาตญาณคือ Opus 5 มีราคาต่อโทเค็นเพียงครึ่งเดียว แต่ก็ยังอาจแพ้เกมต้นทุนต่อเซสชันได้ มองเห็นภาพได้ง่ายด้วยตัวเลขคร่าวๆ: หากลูปบน Opus 5 ปล่อยโทเค็นเป็นสองถึงสามเท่าของลูปบน Fable 5 — ตัวเลขที่ใช้เพื่อให้เห็นภาพซึ่งสอดคล้องกับรายงานจากผู้ปฏิบัติจริงเกี่ยวกับพฤติกรรมการตรวจสอบตนเองของ Opus 5 ไม่ใช่ตัวเลขที่วัดได้ — ต่อให้คิดอัตราต่อโทเค็นแค่ครึ่งเดียว ต้นทุนของลูปก็ยังใกล้เคียงกัน และหากช่องว่างกว้างกว่านั้น Opus ในลูปก็ยิ่งแพงขึ้น ในขณะเดียวกัน โทเค็นสำหรับการประมวลผล ซึ่งเป็นส่วนใหญ่ของเซสชัน อยู่บน Opus 5 ในซับเอเจนต์ในอัตราที่ถูกกว่า ไม่ว่ากรณีใดก็ตาม

นั่นคือข้อโต้แย้งทั้งหมดสำหรับรูปแบบกลับด้าน: วางโมเดลที่มีราคาต่อโทเคนสูงกว่าแต่มีลูปที่คล่องตัวกว่าไว้ที่ลูป และวางโมเดลที่ราคาต่อโทเคนถูกกว่าไว้ที่ปริมาณ มันคือการตัดสินใจเรื่องเส้นทางที่ถูกทำให้ดูเหมือนการตัดสินใจเรื่องโมเดล

เนื่องจาก {{1}}OrcaRouter ส่งต่อราคาผู้ให้บริการโดยไม่บวกกำไร (0% markup){{/1}} ตัวเลขด้านบนคือราคาที่คุณจ่ายจริงที่นี่ — ไม่มีค่าธรรมเนียมแพลตฟอร์มเพิ่ม — และหาก {{2}}Anthrop​ic ลดราคาใดราคาหนึ่ง{{/2}} การเปลี่ยนแปลงจะแสดงบนหน้าโมเดลในวันเดียวกัน

เมื่อรูปแบบกลับด้านได้ผล — และเมื่อไม่ได้ผล

การคัดลอกการตั้งค่าของ @dotey โดยไม่พิจารณารูปแบบภาระงานของตัวเองนั้น เป็นความผิดพลาดในทั้งสองทิศทาง

รูปแบบกลับด้านจะชนะเมื่อ:

• ข้อกำหนดไม่ชัดเจนหรือแผนมีองค์ประกอบที่ต้องจัดการหลายส่วน — การใช้ดุลยพินิจในการประสานงานคือทรัพยากรที่ขาดแคลน

• การดำเนินการสามารถแบ่งขนานเป็นซับเอเจนต์ได้ — ปริมาณงานจะหลุดออกจากลูป

• เซสชันยาวนาน — ความยืดยาวของลูปสะสมทบเป็นต้นทุนจริง

คำแนะนำมาตรฐานจะชนะเมื่อ:

• งานส่วนใหญ่ในเซสชันของคุณเป็นงานที่มีขอบเขตจำกัดและเป็นกลไก — แพลนเนอร์ระดับ Fable นั้นเกินความจำเป็น และราคาที่ต่ำกว่าของ Opus 5 กับคะแนน benchmark ที่สูงกว่าทำให้มันเป็นค่าเริ่มต้นที่ชัดเจน นี่คือเหตุผลที่เอกสารของ Claude Code เองกำหนดให้ Opus เป็นค่าเริ่มต้นของเซสชัน และสงวน Fable 5 ไว้สำหรับการเลือกอย่างชัดแจ้ง

• คุณไม่สามารถระบุโมเดลตัวแทนย่อยได้อย่างน่าเชื่อถือ — บั๊กการสืบทอด #83920 เปลี่ยนรูปแบบกลับด้านให้กลายเป็น "ทุกอย่างเป็นเรื่องของการกำหนดราคา Fable 5"

นอกจากนี้ยังมีเส้นทางสายกลางสำหรับการปรับแต่ง Opus 5 เปิดเผยพารามิเตอร์ความพยายาม (จากต่ำไปสูงสุด ค่าเริ่มต้นคือสูง) คุณจึงสามารถปรับให้มีพฤติกรรมที่กระชับขึ้นได้ — แต่ไม่สามารถปรับได้ทั้งหมด เพราะการปิดการคิดนั้นถูกจำกัดไว้ที่ระดับความพยายามสูง หากปัญหาของคุณคือความเยิ่นเย้อของ Opus 5 การลดระดับความพยายามลงอาจเพียงพอ และคุณไม่จำเป็นต้องพลิกสถาปัตยกรรมเลย

การเปลี่ยนแปลงทางชีววิทยาเมื่อวันที่ 7 สิงหาคมส่งผลต่อการตั้งค่านี้อย่างไร

การอัปเดตเมื่อวันที่ 7 สิงหาคมของ Anthrop​ic ได้เขียนและฝึกคลาสสิฟายเออร์ชีววิทยาของ Claude Fable 5 ใหม่ — ระบบที่ใช้ตัดสินว่าคำค้นหาจะทำให้เกิด "fallback" ไปยังโมเดลที่มีความสามารถน้อยกว่าหรือไม่ ตามตัวเลขของ Anthrop​ic เอง (ที่รายงานโดยผู้จำหน่าย) การ fallback ที่เกี่ยวข้องกับชีววิทยาลดลงประมาณ 85% ในทุกพื้นผิวผลิตภัณฑ์ โดยรวม fallback ลดลง ~67% บน Claude.ai, ~55% บน Cowork, ~17% บน Claude Code และ ~7% บน Claude Platform

Screenshot of Anthropic's 'Improving Fable 5's biology safeguards' announcement dated August 7, 2026, describing the roughly 85% reduction in biology-related fallbacks across product surfaces.

สำหรับการตั้งค่า orchestration ของ Fable 5 หมายเลข Claude Code คือสิ่งที่สำคัญที่สุด การ fallback คือการที่ระบบเปลี่ยนคำสั่งของคุณไปยังโมเดลอื่นอย่างเงียบ ๆ — ในกรณีนี้คือ Opus 5 ในการแชทธรรมดา นั่นคือความขัดสีที่มองไม่เห็น; ในเซสชันแบบ agentic มันหมายความว่าส่วนหนึ่งของไปป์ไลน์ของคุณทำงานบนโมเดลที่คุณไม่ได้เลือก ด้วยต้นทุนที่คุณไม่ได้วางแผน การอัปเดตไม่ได้ลบสิ่งนั้น: ไวรัสวิทยา พิษวิทยา และการออกแบบโมเลกุลยังคง fallback แต่ชีววิทยาในชีวิตประจำวันและการศึกษา — การอ่านผลแล็บ การทำความเข้าใจอาการ การเรียนชีววิทยา — ตอนนี้ยังคงอยู่บน Fable 5

หมายเหตุล่วงหน้าข้อหนึ่ง ขอระบุให้ชัดเจน: รายงานที่ไม่ได้รับการยืนยันจากปลายเดือนกรกฎาคม (36kr, WinCentral) ชี้ว่าอาจมีการรีเฟรช Claude Fable 5.1 ในเดือนนี้โดยราคาไม่เปลี่ยนแปลง Anthrop​ic ยังไม่ได้ยืนยันชื่อ วันที่ หรือรหัสโมเดล API — ให้ถือว่านั่นเป็นการคาดเดาจนกว่าจะเปิดตัวจริง

ลองใช้โดยไม่ต้องเสี่ยงกับเวิร์กโฟลว์ของคุณ

สิ่งที่ทำให้รูปแบบกลับด้านนี้น่าลองก็คือมันสามารถย้อนกลับได้ และการส่งทั้งสองโมเดลผ่านเอนด์พอยต์เดียวทำให้การย้อนกลับมีต้นทุนต่ำ

บน OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) และ Claude Opus 5 (anthropic/claude-opus-5) อยู่ภายใต้คีย์ API เดียวกัน คุณสามารถรัน execution lane ของเซสชันบนโมเดลใดก็ได้โดยไม่ต้องมีสัญญาเพิ่มเติมหรือแก้ไขโค้ด — ซึ่งตรงกับความต้องการของการทดลองอย่าง "Fable 5 ในฐานะออร์เคสเตรเตอร์" เพราะประเด็นสำคัญคือการวัดต้นทุนต่อเซสชันของคุณเองก่อนตัดสินใจ

Screenshot of the OrcaRouter model page for Claude Fable 5 showing the slug anthropic/claude-fable-5, $10 per 1 million input tokens and $50 per 1 million output tokens, a 1M-token context, and the /v1/messages and /v1/chat/completions endpoints.

ฟีเจอร์ OrcaRouter สองอย่างสอดคล้องโดยตรงกับการตั้งค่านี้ การเฟลโอเวอร์อัตโนมัติช่วยให้คุณกำหนดสายโซ่สำรองได้ — หาก Fable 5 เกิดข้อผิดพลาดหรือหมดเวลา คำขอจะถูกจัดเส้นทางไปยัง Opus 5 หรือโมเดลที่ถูกกว่าแทนที่จะล้มเหลว และ DSL การจัดเส้นทางสามารถรวมทั้งคู่เข้าด้วยกันเป็นการเรียกครั้งเดียว: ขั้นตอนการวางแผนของ Fable 5 ตามด้วยขั้นตอนการทำงานของ Opus 5 ภายใต้เอนด์พอยต์เดียว ซึ่งคือรูปแบบออร์เคสเตรชันที่แสดงออกมาเป็นโครงสร้างพื้นฐาน ไม่ใช่เป็นวินัยด้านพรอมป์ต์

บรรทัดล่าง

สถาปัตยกรรมแบบกลับด้าน — Claude Fable 5 วางแผน, Claude Opus 5 ลงมือปฏิบัติ — คือคำตอบที่แท้จริงและใช้ได้จริงสำหรับปัญหาจริง: โมเดลที่ถูกที่สุดต่อโทเคนไม่จำเป็นต้องถูกที่สุดต่อเซสชัน ไม่ใช่การตัดสินใจเพื่อเบนช์มาร์ก; Opus 5 ชนะการเปรียบเทียบแบบเอเจนต์ที่รายงานโดยผู้ขายส่วนใหญ่ มันคือการตัดสินใจเรื่องการจัดเส้นทางโทเคน และจะคุ้มค่าก็ต่อเมื่อดุลยพินิจในการประสานงานมีจำกัดและการดำเนินการสามารถทำแบบขนานได้

Claude Fable 5 (9 มิถุนายน 2026) และ Claude Opus 5 (24 กรกฎาคม 2026) ต่างก็เป็นโมเดลปัจจุบันของ Anthrop​ic และการเปลี่ยนแปลงมาตรการป้องกันในวันที่ 7 สิงหาคมทำให้ Fable 5 เป็นโมเดลหลักที่ใช้ประจำวันซึ่งถูกขัดจังหวะน้อยลง จงจับตาสามสิ่ง: ว่ารายงานของ Fable 5.1 จะมีน้ำหนักจริงหรือไม่ ว่า Anthrop​ic จะแก้บั๊กการสืบทอดซับเอเยนต์ที่อาจทำให้รูปแบบนี้ถูกทำลายอย่างเงียบ ๆ หรือไม่ และ — ที่สำคัญที่สุด — ต้นทุนต่องานที่สำเร็จของคุณเองตลอดหนึ่งสัปดาห์ของเซสชันจริงจะเป็นเช่นไร

คำถามที่พบบ่อย

Fable 5 เป็นโมเดลเริ่มต้นใน Claude Code หรือไม่

ไม่ เอกสารของ Claude Code เองระบุว่า Fable 5 ไม่ใช่ค่าเริ่มต้นสำหรับบัญชีประเภทใดๆ — เซสชันมีค่าเริ่มต้นเป็นโมเดล Opus มาตรฐาน และคุณเลือก Fable 5 ผ่าน /model การตั้งค่าโมเดล หรือ alias "best" รูปแบบในบทความนี้จงใจทำงานขัดกับค่าเริ่มต้นนั้น

ทำไมไม่ใช้ Opus 5 เป็นค่าเริ่มต้นเลย เพราะมันถูกกว่าต่อโทเคนและได้คะแนนสูงกว่า?

เนื่องจากต้นทุนต่อเซสชันคือจำนวนโทเค็นต่องานคูณด้วยราคาต่อโทเค็น ผู้ปฏิบัติงานรายงานว่าการคิดแบบปรับตัวและการตรวจสอบตนเองของ Opus 5 สร้างโทเค็นต่อเทิร์นมากกว่ามาก ดังนั้นแม้จะมีอัตราราคาต่อโทเค็นเพียงครึ่งเดียว ก็ยังอาจช้ากว่าและแพงกว่าในการวนลูปที่ยาวนาน นี่คือข้อค้นพบของชุมชนที่เพลย์บุ๊กนี้สร้างขึ้นมา — วัดผลกับเวิร์กโหลดของคุณเองก่อนที่จะเลือกข้าง

ฉันสามารถบังคับให้ subagents ของฉันรันโมเดลที่แตกต่างจากเซสชันได้ไหม

ใช่ แต่ไม่ควรพึ่งพาพารามิเตอร์โมเดลแบบต่อการเรียกใช้: GitHub issue #83920 ระบุว่ามันถูกเพิกเฉย โดย subagents จะสืบทอดโมเดลของเซสชันแทน ตั้งค่า CLAUDE_CODE_SUBAGENT_MODEL หรือปักหมุดโมเดลใน frontmatter ของ subagent — นั่นคือความแตกต่างระหว่างการทำงานที่คิดราคา Opus 5 กับการทำงานอย่างเงียบ ๆ ที่คิดราคา Fable 5

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube