
Claude Opus 5.5 ลงมือทำ, Claude Fable 5.1 ให้คำแนะนำ: การคิดราคาวงจรที่ปรึกษาของ Claude Code
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Claude Fable 5.1 เป็นตัวเขียนแผนการออกแบบ Claude Opus 5.5 เป็นตัวรันมันเป็นลูป แล้ว Fable 5.1 ก็กลับมารับบทที่ปรึกษาและตอบรับหรือปฏิเสธผลลัพธ์ นั่นคือแพตเทิร์นที่ X/@dotey โพสต์เมื่อวันที่ 22 กันยายน 2026 — วันที่ผู้ขายเปิดตัว Claude Opus 5.5 — โดยวางกรอบว่ามันเป็นกลไกประหยัดโทเคนที่เกิดขึ้นภายใต้แรงกดดันด้านต้นทุน: ตั้งที่ปรึกษาเป็น Fable, รัน Opus, แล้วปล่อยให้โมเดลแพงพูดเฉพาะจุดตัดสินใจเท่านั้น สิ่งที่พวกเขาใช้อยู่ไม่ใช่ทริกพรอมป์หรือการตั้งค่าซับเอเจนต์อีกต่อไปแล้ว มันคือเครื่องมือที่ปรึกษาในตัวของ Claude Code ฟีเจอร์ฝั่งเซิร์ฟเวอร์ที่คิดค่าบริการในอัตราของโมเดลที่ปรึกษา ซ้อนเพิ่มจากทุกอย่างที่โมเดลหลักใช้จ่ายไป และคำแนะนำคือส่วนที่ถูก ส่วนการอ่านบทสนทนาซ้ำเพื่อสร้างคำแนะนำนั้นไม่ถูก — คอนเท็กซ์ของผู้รันกลายเป็นของที่อ่านซ้ำได้ในราคาถูกไปแล้ว ส่วนคอนเท็กซ์ของที่ปรึกษาไม่เคยถูกเลย ความไม่สมมาตรเพียงข้อเดียวนี้ตัดสินว่าลูปนี้คุ้มที่จะรันหรือไม่ และนั่นคือสิ่งที่ส่วนที่เหลือของบทความนี้จะตีราคาออกมา
จริง ๆ แล้วลูปคืออะไร
เครื่องมือ advisor จะจับคู่โมเดลหลักของคุณกับโมเดลที่สอง ซึ่งโดยปกติจะแข็งแกร่งกว่า ที่ Claude ปรึกษาในช่วงเวลาสำคัญ — ก่อนตัดสินใจเลือกแนวทาง เมื่อเกิดข้อผิดพลาดซ้ำ ๆ หรือก่อนประกาศว่างานเสร็จแล้ว advisor จะได้รับบทสนทนาทั้งหมด รวมถึงการเรียกใช้เครื่องมือทุกครั้งและผลลัพธ์ของมัน แล้วส่งคำแนะนำกลับมา ซึ่งโมเดลหลักจะนำไปใช้ต่อไป มันจะไม่เรียกใช้เครื่องมือเลย และไม่สร้างเอาต์พุตที่ผู้ใช้เห็น คุณเป็นคนเลือกว่าโมเดลใดจะทำหน้าที่ให้คำปรึกษา; Claude เป็นผู้ตัดสินใจว่าจะเรียกใช้เมื่อใด
ส่วนสุดท้ายนั่นคือสิ่งที่ทำให้สิ่งนี้แตกต่างจากแพตเทิร์นแบบออร์เคสเตรเตอร์กับซับเอเจนต์ที่ชุมชน Claude Code กำลังแชร์กันในเดือนสิงหาคม Subagent คือการมอบหมายงาน: planner แตกงานออกเป็นส่วน ๆ แล้วส่งต่อไปยัง worker และคุณกำหนดค่าโมเดลของแต่ละเลนอย่างชัดเจน ส่วน advisor คือการยกระดับ: โมเดลเดียวขับเคลื่อนงานทั้งหมด และโมเดลราคาแพงจะถูกดึงเข้ามากลางทางเพื่อตัดสินใจในเรื่องที่ตัวขับเคลื่อนตัดสินใจเองไม่ได้ ไม่มี worker pool ไม่มี task graph และไม่มี orchestration prompt ให้ต้องดูแล ลูปในทางปฏิบัติที่ @dotey อธิบาย — วางแผน ลงมือทำ ตรวจสอบ ทำซ้ำ — คือหน้าตาของกลไกนั้นเมื่อคุณชี้ advisor ไปที่ Fable 5.1 และปล่อยให้มันคอยกำกับเงื่อนไขการออกจากลูป
การวางกรอบกลยุทธ์ของ Anthropic เองก็พูดตรง ๆ ถึงรูปร่างหน้าตาของชัยชนะว่า ที่ปรึกษา "มอบได้เพียงความสามารถที่ผู้ปฏิบัติขาดอยู่เท่านั้น" ทุกสิ่งด้านล่างนี้ล้วนเป็นผลสืบเนื่องมาจากความสามารถที่ขาดหายไปจริง ๆ มีมากน้อยเพียงใด และผู้ปฏิบัติยอมรับเรื่องนี้บ่อยแค่ไหน
ทำไม Claude Opus 5.5 ถึงเปลี่ยนวิธีคำนวณ

ตารางราคาที่ Anthropic เผยแพร่อย่างเป็นทางการ ต่อหนึ่งล้านโทเคน ตัวเลขเหล่านี้เป็นตัวเลขจากผู้ให้บริการ ไม่ใช่การประมาณการ:
• Claude Opus 5.5 — อินพุต $4, เอาต์พุต $20, อ่านแคช $0.20, เขียนแคช 5 นาที $5
• Claude Opus 5 — $5 อินพุต, $25 เอาต์พุต, $0.50 การอ่านแคช, $6.25 สำหรับการเขียนแคช 5 นาที
• Claude Fable 5.1 — อินพุต $10, เอาต์พุต $50, อ่านแคช $0.25, เขียนแคช 5 นาที $12.50
รายละเอียดสองอย่างในรายการนั้นสำคัญกว่าราคาที่พาดหัวข่าว ประการแรก การอ่านแคชบน Opus 5.5 คิดเป็น 5% ของอินพุตฐาน ตามเชิงอรรถของ Anthropic เอง ซึ่งโมเดล Claude ส่วนใหญ่อยู่ที่ 10% และ Fable 5.1 อยู่ที่ 2.5% Fable 5.1 มีตัวคูณที่ดีกว่าและยังแพ้ในแง่จำนวนเงินจริง — 0.20 ดอลลาร์ เทียบกับ 0.25 ดอลลาร์ — เพราะอัตราอินพุตฐานของมันสูงกว่าสองเท่าครึ่ง
ข้อที่สอง และนี่คือกลไกที่ลูปนี้ทำงานโดยอาศัย: การสลับเปิด/ปิดที่ปรึกษาใน Claude Code ไม่ได้ทำให้แคชพรอมป์ของโมเดลหลักเป็นโมฆะ ดังนั้นบริบทที่ยาวและถูกส่งซ้ำหลายครั้งของตัวดำเนินการจึงยังคงมีต้นทุนต่ำที่ $0.20 ต่อล้าน การอ่านบทสนทนาของที่ปรึกษาเองไม่ถูกแคช การปรึกษาแต่ละครั้งจะประมวลผลบทสนทนาทั้งหมดใหม่ ณ อัตราค่าอินพุต $10 ต่อล้านของ Fable 5.1 ตัวดำเนินการที่อ่านบริบทขนาด 500K โทเคนซ้ำสิบครั้งจ่ายสำหรับการอ่านจากแคช; ที่ปรึกษาที่ถูกปรึกษาสิบครั้งจ่ายค่าอินพุตใหม่สิบรอบบนบทสนทนาที่เติบโตขึ้นตลอดเวลา ยิ่งบริบทของตัวดำเนินการถูกลงเท่าไร การอ่านแบบไม่แคชของที่ปรึกษาก็ยิ่งโดดเด่นขึ้นเท่านั้น — และ Opus 5.5 เพิ่งทำให้บริบทของตัวดำเนินการถูกลง 60% เมื่อเทียบกับ Opus 5
การตั้งค่าใน Claude Code
ที่ปรึกษาเป็นฟีเจอร์ทดลอง และ Anthropic ระบุไว้ในแบนเนอร์ของเซสชันว่า — "Advisor Tool (experimental) เปิดอยู่และอาจใช้โทเค็นมากขึ้น" พฤติกรรม ราคา และความพร้อมใช้งานอาจเปลี่ยนแปลงได้ เมื่อกล่าวข้อแม้ดังกล่าวแล้ว กลไกการทำงานมีเอกสารบันทึกไว้ดังนี้:

• เปิดใช้งานด้วย /advisor fable หรือรัน /advisor โดยไม่ใส่อาร์กิวเมนต์เพื่อเปิดตัวเลือก ตัวเลือกที่เลือกจะถูกบันทึกไว้ในการตั้งค่า advisorModel ในการตั้งค่าผู้ใช้ของคุณ และคงอยู่ข้ามเซสชัน /advisor off จะปิดการใช้งาน
• สำหรับเซสชันเดียวโดยไม่เปลี่ยนค่าเริ่มต้นที่บันทึกไว้ ให้เปิดใช้งานด้วย claude --advisor fable แฟล็กนี้ไม่ได้ระบุไว้ใน claude --help และ Claude Code จะออกเมื่อเปิดใช้งานหากการจับคู่นั้นไม่ถูกต้อง แทนที่จะเริ่มต้นด้วยที่ปรึกษาที่ถูกเพิกเฉยอย่างเงียบ ๆ
• ตั้งค่าเริ่มต้นแบบถาวรในไฟล์การตั้งค่าของคุณด้วย{"advisorModel": "fable"}.
• หากต้องการปิดการทำงานทั้งหมด ให้ตั้งค่า CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — คำสั่ง /advisor จะหายไป และ advisorModel ที่กำหนดค่าไว้จะถูกละเว้น
• การจับคู่ต้องมีความสามารถอย่างน้อยเทียบเท่ากับรุ่นหลัก Claude Opus 5.5 ยอมรับ Fable และ Opus 5 หรือใหม่กว่าเป็นที่ปรึกษา ที่ปรึกษา Opus 4.6 หรือ Sonnet จะถูกปฏิเสธโดย Claude Code; ที่ปรึกษา Opus 4.7 หรือ Opus 4.8 จะถูกแนบไปแล้วจึงถูกปฏิเสธโดย API Fable 5.1 ในฐานะรุ่นหลักยอมรับเฉพาะ Fable 5.1
• เวอร์ชันขั้นต่ำ: เครื่องมือ advisor ต้องใช้ Claude Code v2.1.98 หรือใหม่กว่า; Fable ไม่ว่าจะเป็นโมเดลหลักหรือ advisor ต้องใช้ v2.1.170 หรือใหม่กว่า; Fable 5.1 ต้องใช้ v2.1.257 หรือใหม่กว่า รูปแบบโทเค็นของ /advisor — แบบที่ใช้งานได้ใน -p, Agent SDK, แอปเดสก์ท็อป และ Remote Control — ต้องใช้ v2.1.260 หรือใหม่กว่า
• ที่ปรึกษาใช้ได้เฉพาะกับ Anthropic-API เท่านั้น ไม่มีให้บริการบน Amazon Bedrock, Claude Platform on AWS, Agent Platform ของ Google Cloud หรือ Microsoft Foundry และมันขึ้นอยู่กับการดึง feature flag ดังนั้นเซสชันที่มีการตั้งค่าตัวแปรเช่น DISABLE_TELEMETRY จะทำให้มันปิดอยู่
• สำหรับแผนที่การใช้งาน Fable ถูกเรียกเก็บเป็นเครดิตการใช้งาน การใช้ Fable เป็นที่ปรึกษาจะถูกเรียกเก็บในลักษณะเดียวกัน และต้องได้รับความยินยอมครั้งเดียว จนกว่าคุณจะยอมรับ /advisor fable จะไม่บันทึก และ claude --advisor fable จะออกเมื่อเริ่มทำงานโดยชี้ให้คุณไปที่ /model fable แทน
ซับเอเจนต์สืบทอดที่ปรึกษาที่คุณกำหนดค่าไว้ และรันการตรวจสอบการจับคู่แบบเดิมซ้ำกับโมเดลของตัวเอง นั่นคือปฏิสัมพันธ์เดียวระหว่างรูปแบบนี้กับรูปแบบซับเอเจนต์: ซับเอเจนต์ที่รันโมเดลที่เล็กกว่าอาจได้รับอนุญาตให้มีที่ปรึกษาที่พาเรนต์ของมันไม่ได้รับอนุญาต
รูปแบบของต้นทุน เมื่อวิเคราะห์อย่างละเอียดแล้ว
ไม่มีสิ่งใดด้านล่างนี้เป็นการวัด รูปแบบของโทเคนนี้ถูกสมมติขึ้นเพื่อให้มองเห็นการคำนวณได้ชัดเจน ราคาที่ใช้เป็นอัตราที่ Anthropic เผยแพร่ สมมติว่ามีเซสชันผู้ดำเนินการหนึ่งเซสชันที่อ่านโทเคนอินพุตใหม่ 1M และส่งออกโทเคนเอาต์พุต 500K และมีการขอคำปรึกษาจากที่ปรึกษาสามครั้ง โดยแต่ละครั้งอ่านทรานสคริปต์ขนาด 200K โทเคนซ้ำ และส่งคืนคำแนะนำประมาณ 600 โทเคน — ซึ่งใกล้เคียงกับการปรึกษา 2–3 ครั้งต่องานที่พรอมต์ระบบของ Anthropic เองระบุไว้
• Executor บน Claude Opus 5.5 — อินพุต 1M ในราคา $4.00 บวกเอาต์พุต 500K ในราคา $10.00 = $14.00
• ที่ปรึกษาบน Claude Fable 5.1 — อินพุต 600K ที่ $6.00 บวกกับโทเคนเอาต์พุตประมาณ 1,800 โทเคนที่ราว $0.09 = $6.09
• The loop รวม — ประมาณ $20.09
• รูปแบบเดียวกันที่รันแบบครบวงจรบน Fable 5.1 — อินพุต $10.00 บวกเอาต์พุต $25.00 = $35.00
• รูปแบบเดียวกันเมื่อใช้ Opus 5.5 เพียงอย่างเดียว — $14.00
ลูปนี้ตกอยู่ระหว่างสองสิ่งนั้น ซึ่งเป็นตำแหน่งที่ Anthropic วางไว้พอดี: ถูกกว่าการใช้ Fable 5.1 ตลอดทั้งกระบวนการประมาณ 43% และแพงกว่าการใช้ตัวดำเนินการเพียงอย่างเดียวประมาณ 44% ให้มองตัวเลขตัวที่สองเป็นตัวเลขที่ตรงไปตรงมา ที่ปรึกษาไม่ใช่การประหยัด แต่เป็นการซื้อวิจารณญาณระดับ Fable สำหรับการตัดสินใจสามเรื่อง และมันจะคุ้มค่าก็ต่อเมื่อการตัดสินใจสามเรื่องนั้นเปลี่ยนผลลัพธ์ ดันทรานสคริปต์ไปที่หน้าต่างบริบท 1M และการปรึกษาแต่ละครั้งมีค่าใช้จ่าย $10 แยกต่างหาก ปล่อยให้ตัวดำเนินการเริ่มถามในงานส่วนใหญ่แทนที่จะถามเพียงไม่กี่งาน แล้วคุณกำลังจ่ายในอัตราของที่ปรึกษาทั่วทั้งภาระงาน ซึ่ง ณ จุดนั้น ตามที่ Anthropic พูด การรันโมเดลของที่ปรึกษาเองเป็นเส้นทางที่ถูกกว่าเพื่อไปให้ถึงคะแนนเดียวกัน
สิ่งที่การวัดของ Anthropic เองบอก
Anthropic ได้เผยแพร่ผลการวัดสำหรับรูปแบบนี้ และเป็นข้อมูลที่ผู้ขายรายงานเอง: ดำเนินการโดยบริษัทที่ขายทั้งสองโมเดล บนชุดทดสอบ benchmark ของตัวเอง กระนั้นมันก็ยังเป็นตัวเลขเพียงชุดเดียวที่มีลักษณะเช่นนี้ และยังรวมกรณีที่คัดค้านรูปแบบนี้ไว้ด้วย ซึ่งเป็นเหตุผลว่าทำไมจึงคุ้มค่าที่จะอ่านอย่างละเอียด
• Opus 5 ในฐานะผู้ปฏิบัติงาน โดยมี Fable 5.1 เป็นที่ปรึกษา ทำคะแนนได้ $7.69 ต่อความพยายามบน benchmark การเขียนโค้ดแบบเอเจนต์ภายในของ Anthropic — เป็นการตั้งค่าที่แม่นยำที่สุดที่ Anthropic วัดได้ ซึ่งสูงกว่า Opus 5 เดี่ยว ๆ ที่การตั้งค่าเริ่มต้นของมันอยู่ 3.5 คะแนน ด้วยค่าใช้จ่ายที่น้อยกว่าเล็กน้อย และสูงกว่า Fable 5.1 เดี่ยว ๆ ประมาณ 2.5 คะแนน ด้วยค่าใช้จ่ายที่มากกว่าประมาณครึ่งหนึ่ง ช่องว่าง 3.5 คะแนนนี้แยกออกจากความแปรปรวนระหว่างการรันได้ด้วยการลองห้าครั้งต่องาน
• การจับคู่แบบเดียวกันในการอ่านแผนภูมิให้ผลเทียบเท่ากับ Fable 5.1 เพียงลำพังที่ความพยายามระดับกลางภายในเกณฑ์ความคลาดเคลื่อน — 65.0 เทียบกับ 67.5 — โดยมีต้นทุนต่อภารกิจราว 2.6 เท่า เนื่องจากมีการปรึกษาผู้ให้คำแนะนำในเกือบทุกภารกิจ
• บน GPQA Diamond การเพิ่มขึ้นสะท้อนช่องว่างความสามารถได้เกือบสมบูรณ์แบบ: ตัวดำเนินการ Haiku 4.5 เพิ่มขึ้นอย่างมาก ตัวดำเนินการ Sonnet 5 เพิ่มขึ้นไม่กี่จุด และตัวดำเนินการระดับแนวหน้าแทบไม่เพิ่มขึ้นเลย
• อัตราการปรึกษาเป็นตัวแปรที่เปราะบาง ผู้ดำเนินการ Sonnet 5 ที่ใช้ความพยายามต่ำได้คะแนนเพิ่ม 23 คะแนนบน DeepSWE เมื่อมีที่ปรึกษา จากนั้นก็หยุดถามไปเลยบน SWE-bench Pro และไม่ได้รับอะไรเพิ่มเลย
• ความหน่วง: การเรียกใช้โมเดลระดับแนวหน้าเพิ่มขึ้นประมาณสองครั้งต่อหนึ่งงาน โดยแต่ละครั้งอยู่บนเส้นทางวิกฤต
สองสิ่งเกี่ยวกับหลักฐานนั้นเกี่ยวข้องโดยตรงกับลูปในสภาพที่เป็นอยู่ในสัปดาห์นี้ การวัดใช้ Opus 5 เป็นผู้ดำเนินการ เพราะ Opus 5.5 ยังไม่มีอยู่ในตอนที่ทำการวัด และ Anthropic รายงานว่า Opus 5.5 ทำงานได้ในระดับเดียวกับ Fable 5.1 ในงานส่วนใหญ่ ขณะที่มีต้นทุนการรันต่ำลง 40% — ทั้งสองข้อเป็นคำกล่าวอ้างของผู้ขาย และไม่มีข้อใดถูกทำซ้ำโดยอิสระ หากช่องว่างระหว่างผู้ดำเนินการกับที่ปรึกษาคือสิ่งที่ที่ปรึกษาได้รับค่าจ้างให้ปิด ช่องว่างที่แคบลงก็ย่อมหมายถึงการซื้อที่เล็กลง รูปแบบไม่ได้แย่ลงเมื่อ Opus 5.5 เปิดตัว; สิ่งที่มันขายกลับหายากน้อยลง
โหมดความล้มเหลวที่คุณจะได้เจอจริง ๆ
พฤติกรรมเหล่านี้เป็นพฤติกรรมที่เอกสารระบุไว้ ไม่ใช่การคาดเดา และข้อแรกคือเหตุผลที่คุณควรอ่านส่วนนี้ก่อนเริ่มดีบักสิ่งใดก็ตาม:
• ที่ปรึกษาที่หายไปอย่างเงียบ ๆ หาก API ปฏิเสธการจับคู่ที่ปรึกษา Claude Code จะแนบที่ปรึกษาเข้าไป API ปฏิเสธมัน และ Claude Code จะส่งคำขออีกครั้งโดยไม่มีที่ปรึกษา จากนั้นบทสนทนาที่เหลือจะดำเนินไปโดยไม่มีที่ปรึกษาและไม่มีข้อความแจ้งข้อผิดพลาดใด ๆ มันจะยังคงปิดอยู่จนกว่า /clear หรือ /compact แม้หลังจากที่คุณสลับไปใช้โมเดลหลักที่เข้ากันได้แล้ว
• กรณีที่ถูกปฏิเสธแบบเงียบ ๆ สำหรับการจับคู่ที่ Claude Code เองปฏิเสธ ที่ปรึกษาจะไม่ถูกแนบไปกับคำขอของโมเดลหลักเลย เอาต์พุตของ /advisor และการแจ้งเตือนจะบอกคุณ — แต่ไม่มีอะไรล้มเหลว ดังนั้นเซสชันที่คุณคิดว่ากำลังมีที่ปรึกษาให้คำแนะนำอยู่นั้นอาจไม่เคยมีเลยก็ได้
• ความยินยอมที่คุณยังไม่ได้ให้ไว้ เมื่อเลือก Fable เป็นที่ปรึกษาในแผนที่ต้องได้รับความยินยอมในการใช้เครดิต คำขอจะถูกส่งออกไปโดยไม่มีที่ปรึกษาจนกว่าคุณจะยอมรับ เซสชันเบื้องหลังที่เริ่มด้วย --advisor fableจะเริ่มทำงานโดยไม่มีที่ปรึกษาแทนที่จะออกจากระบบ
• Allowlist ที่คุณไม่ได้ควบคุม หาก allowlist ขององค์กรของคุณavailableModels ไม่รวมโมเดล advisor, Claude Code จะไม่เรียกใช้งานมัน และคุณจำเป็นต้องเลือกโมเดลที่ได้รับอนุญาตด้วย /advisor
• ทุกที่ที่มันไม่มีอยู่ เฉพาะ Anthropic API เท่านั้น: ไม่มี Bedrock, ไม่มี Claude Platform on AWS, ไม่มี Google Cloud Agent Platform, ไม่มี Microsoft Foundry เมื่อผ่านเกตเวย์ ความพร้อมใช้งานขึ้นอยู่กับว่าเกตเวย์ส่งต่อคำขอไปยัง Anthropic API โดยสมบูรณ์หรือไม่ — ซึ่งเป็นคุณสมบัติของเกตเวย์ ไม่ใช่สิ่งที่คุณสามารถสันนิษฐานได้
OrcaRouter เหมาะกับที่ใด
โมเดลทั้งสองในลูปนี้พร้อมใช้งานบน OrcaRouter แล้ววันนี้ ในราคาตามที่ Anthropic ประกาศไว้เอง โดยบวกเพิ่ม 0% — ราคาที่ผู้ให้บริการกำหนดถูกส่งผ่านตรงถึงคุณ อัตราที่คุณเห็นจึงเป็นอัตราที่ Anthropic เผยแพร่ Claude Fable 5.1 อยู่ที่ anthropic/claude-fable-5.1 และ Claude Opus 5 ที่ anthropic/claude-opus-5 ภายใต้คีย์ API เดียว Claude Opus 5.5 ยังไม่ใช่หนึ่งในเส้นทางของเรา แต่พร้อมใช้งานผ่าน API ของ Anthropic เองและคลาวด์รายใหญ่ และเราจะบอกตามตรงเช่นนี้แทนที่จะพูดเป็นนัยเป็นอย่างอื่น

สิ่งที่คีย์เดียวซื้อให้คุณที่นี่คือความสามารถในการเปลี่ยนใจได้อย่างประหยัด เศรษฐศาสตร์ของลูปนั้นขึ้นอยู่กับอัตราส่วนราคาระหว่างผู้ดำเนินการกับที่ปรึกษา และอัตราส่วนนั้นเปลี่ยนไปสองครั้งในเจ็ดสัปดาห์ — Opus 5 เป็น Opus 5.5 เมื่อวันที่ 22 กันยายน และ Fable 5 เป็น Fable 5.1 เมื่อวันที่ 1 กันยายน ซึ่งลดการอ่านแคชของโมเดลนั้นจาก $1.00 เหลือ $0.25 ต่อล้าน ทุกการเปลี่ยนแปลงเหล่านี้เปลี่ยนคำตอบของคำถามที่ว่า "ที่ปรึกษาคุ้มค่าหรือไม่" และการทดสอบคำตอบนั้นไม่ควรต้องใช้สัญญาที่สอง การสลับสำรองอัตโนมัติเป็นอีกครึ่งหนึ่ง: มันช่วยให้คุณชี้ทราฟฟิกส่วนหนึ่งไปยังโมเดลที่คุณยังไม่ได้กำหนดคุณลักษณะไว้ โดยมีตัวสำรองเป็นโมเดลที่คุณมีอยู่แล้ว แทนที่จะเดิมพันเส้นทางโปรดักชันกับตารางเปิดตัว และถ้าคุณสร้างรูปแบบนี้ด้วยตัวเองแทนที่จะใช้เครื่องมือที่มีมาให้ใน Claude Code DSL การกำหนดเส้นทางจะประกอบโมเดลหลายตัวเข้าเป็นการเรียกครั้งเดียว — ขั้นตอนวางแผนบนโมเดลหนึ่ง ตามด้วยขั้นตอนดำเนินการบนอีกโมเดลหนึ่ง โดยอยู่เบื้องหลังเอนด์พอยต์เดียว
หมายเหตุเรื่องขอบเขตอย่างตรงไปตรงมาข้อหนึ่ง: เครื่องมือ advisor เองเป็นเครื่องมือฝั่งเซิร์ฟเวอร์ที่ทำงานบน API ของ Anthropic ดังนั้นเลเยอร์จัดเส้นทาง (routing layer) จึงไม่ใช่สิ่งที่จะมาแทนมันได้ สิ่งที่เราทำได้คือทำให้โมเดลเหล่านี้พร้อมใช้เพียงกดคีย์เดียว ในราคาตามรายการ เพื่อให้การตัดสินใจว่าจะเก็บหรือเลิกใช้ advisor นั้นเป็นของคุณ โดยพิจารณาจากตัวเลขของคุณเอง
วิธีตัดสินใจสำหรับปริมาณงานของคุณเอง
คำแนะนำของ Anthropic เองคือจุดเริ่มต้นที่ถูกต้อง และมันตรงไปตรงมาอย่างน่าสดชื่น: จงรันชุดประเมินของคุณกับสามการตั้งค่า — ผู้ปฏิบัติงานเดี่ยว, ผู้ปฏิบัติงานที่มีที่ปรึกษา, และโมเดลของที่ปรึกษาเพียงลำพังที่ความพยายามต่ำ — และตรวจสอบซ้ำทุกครั้งที่มีการเปิดตัวโมเดลใหม่ เพราะการเปิดตัวนั้นขยับทั้งช่องว่างความสามารถและอัตราส่วนราคา ตัวสุดท้ายในสามแบบนั้นคือเส้นฐานที่ต้องเอาชนะ หากโมเดลของที่ปรึกษาเพียงลำพังที่ความพยายามต่ำได้คะแนนเท่ากับลูปในราคาที่ถูกกว่า คุณก็ได้คำตอบแล้ว
ตัวแปรสองตัวที่ต้องจับตาคือตัวที่ Anthropic ตั้งชื่อ ช่องว่างความสามารถ: ช่องว่างที่กว้างระหว่างผู้ดำเนินการและที่ปรึกษาคือจุดที่ที่ปรึกษาคุ้มค่ากับค่าตอบแทน และ Opus 5.5 ได้ลดช่องว่างนั้นจากด้านล่าง อัตราการปรึกษา: ผลตอบแทนเพิ่มขึ้นตามอัตรานั้นเกือบหนึ่งต่อหนึ่ง และมันไวต่อพรอมต์พอที่จะพังทลาย — ผู้ดำเนินการที่ใช้ความพยายามต่ำอาจหยุดสังเกตว่าตนติดขัด และการจับคู่ที่ทำการปรึกษาในงานส่วนใหญ่ด้วยความพยายามเริ่มต้นอาจลดลงจนเกือบไม่มี พรอมต์ระบบที่ Anthropic จัดหาให้ขอให้เรียกที่ปรึกษาหนึ่งครั้งก่อนงานที่มีเนื้อหาสาระและอีกหนึ่งครั้งก่อนเสร็จ ซึ่งลงเอยที่สองถึงสามครั้งต่องาน; การจับคู่การเขียนโค้ดที่ให้กำไร 3.5 จุดทำงานที่จังหวะนั้น จัดงบสำหรับสิ่งนั้น จำกัดมัน และมองทุกการปรึกษาที่เกินกว่านั้นเป็นสัญญาณว่าผู้ดำเนินการของคุณตั้งค่าผิด มากกว่าที่ว่างานนั้นยาก
สำหรับลูปเฉพาะในบทความนี้ มีการตั้งค่าเพียงสามอย่างที่ทำงานหลักเกือบทั้งหมด ให้ Claude Opus 5.5 อยู่ที่ medium effort ซึ่งเป็นค่าเริ่มต้น แทนที่จะไปเร่งเป็น high เพราะ effort ส่งผลต่อค่าใช้จ่ายโดยตรง และตัวเลข Opus 5.5 ของ Anthropic เองก็แสดงว่า medium ให้ผลลัพธ์ลดลงเพียงเล็กน้อยเท่านั้น ตั้งค่า advisor ด้วย/advisor fable และตรวจสอบว่าแบนเนอร์ปรากฏขึ้นจริง — ถ้าไม่มีแบนเนอร์ ก็หมายความว่า advisor หายไปโดยไม่มีสัญญาณเตือนใด ๆ และก่อนที่คุณจะขยายรูปแบบนี้ไปใช้ ให้วัดจำนวนโทเค็นต่องานที่ทำเสร็จหนึ่งงาน แทนที่จะวัดราคาต่อโทเค็น เพราะนั่นคือตัวเลขที่ลูปนี้ควรจะขยับ
คำถามที่พบบ่อย
ที่ปรึกษาใช้โควตา Fable เท่ากับเซสชัน Fable หรือไม่
ในการคิดค่าบริการผ่าน API โทเค็นของ advisor จะถูกคิดค่าบริการตามอัตราอินพุตและเอาต์พุตของ Fable 5.1 เอง และขีดจำกัดอัตราการใช้งานของ advisor จะดึงมาจากบัคเก็ตต่อโมเดลเดียวกันกับการเรียกใช้โมเดลนั้นโดยตรง — ดังนั้นการเรียก advisor ที่ติดขีดจำกัดอัตราจะปรากฏเป็นข้อผิดพลาดภายในผลลัพธ์ของเครื่องมือ แทนที่จะทำให้คำขอของคุณล้มเหลว ในแผนแบบสมัครสมาชิก การใช้งาน advisor จะนับรวมในขีดจำกัดการใช้งานของแผนของคุณ ยกเว้นว่า advisor ที่เป็น Fable จะคิดเป็นเครดิตการใช้งานในแผนที่การใช้งาน Fable คิดเป็นเครดิตการใช้งาน ผลลัพธ์ในทางปฏิบัติก็คือ advisor ไม่ใช่งบประมาณแยกต่างหากที่คุณใช้จ่ายได้อย่างอิสระ แต่ต้องแข่งขันกับทุกอย่างอื่นที่คุณทำบนโมเดลนั้น
ที่ปรึกษาได้เห็นอะไรจริง ๆ บ้าง
บทสนทนาทั้งหมด รวมถึงการเรียกใช้เครื่องมือทุกครั้งและผลลัพธ์ของเครื่องมือทุกครั้ง — เนื้อหาไฟล์ เอาต์พุตคำสั่ง ข้อความแสดงข้อผิดพลาด ทั้งหมด มันทำงานภายใต้พรอมต์ระบบที่ Anthropic จัดให้ของตัวเอง และส่งคืนแผน การแก้ไข หรือสัญญาณหยุด มีรายละเอียดสองอย่างตามมาจากสิ่งนั้น อย่างแรก การปรึกษาแต่ละครั้งจะอ่านทรานสคริปต์ทั้งหมดซ้ำ ซึ่งเป็นเหตุผลว่าทำไมค่าใช้จ่ายจึงเพิ่มขึ้นตามลูปแทนที่จะคงที่ อย่างที่สอง หากเซสชันของคุณแตะต้องเนื้อหาที่คุณจะไม่ส่งไปยังโมเดลที่สองในระดับราคาของที่ปรึกษา ที่ปรึกษาก็คือโมเดลที่สองที่อ่านทั้งหมดนั้น
อะไรจะเปลี่ยนคำตอบ
สองเรื่อง และทั้งสองก็ใกล้กว่าที่ดูเหมือน หากผู้ทำเบนช์มาร์กอิสระเผยแพร่ผลการรัน Opus 5.5 เทียบกับ Fable 5.1 ที่ใช้ความพยายามเท่ากัน และยืนยันว่าช่องว่างที่แคบลงตามที่ Anthropic อ้างนั้นเป็นจริง ความได้เปรียบที่เหลืออยู่ของ advisor ในงานส่วนใหญ่ก็บางเฉียบ — และ loop ก็กลายเป็นเครื่องมือสำหรับส่วนท้ายที่ยาก แทนที่จะเป็นค่าเริ่มต้น แต่ถ้าอัตราการปรึกษายังคงเดิม และช่องว่างความสามารถยังกว้างในงาน agentic ที่ยาวนาน คณิตศาสตร์ข้างต้นคือสิ่งที่คุณกำลังเลือกอยู่ระหว่างมัน และคำแนะนำราคา $6 ต่อการรันราคา $14 ก็เป็นออปชันราคาถูกสำหรับการไม่ปล่อยของผิดออกไป
สิ่งที่จะไม่เปลี่ยนไปก็คือกลไกที่อยู่ตอนต้นของบทความนี้ บริบทของผู้ดำเนินการถูกแคชไว้และมีต้นทุนต่ำ ส่วนบริบทของผู้ให้คำปรึกษาไม่มีคุณสมบัติทั้งสองข้อนั้นเลย ลูปใดก็ตามที่เรียกใช้โมเดลที่มีราคาแพงกว่าระหว่างทำงาน ย่อมสืบทอดความไม่สมดุลนั้นไว้ ไม่ว่าตารางราคาจะระบุไว้อย่างไรในเดือนหน้า
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
