การ์ดชื่อเรื่องหลักที่มีหัวข้อว่า 'Claude Opus 5.5 ลงมือทำ, Claude Fable 5.1 ให้คำแนะนำ' พร้อมคำโปรยรองว่า 'การตั้งราคาลูปที่ปรึกษาของ Claude Code' แผนภาพจากซ้ายไปขวาที่แสดง Fable 5.1 กำลังเขียนแผน, Opus 5.5 กำลังดำเนินการลูป และลูกศรป้อนกลับแบบโค้งที่มีป้ายกำกับว่า 'ให้คำแนะนำและตรวจสอบ' และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

Claude Opus 5.5 ลงมือทำ, Claude Fable 5.1 ให้คำแนะนำ: การคิดราคาวงจรที่ปรึกษาของ Claude Code

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Claude Fable 5.1 เป็นตัวเขียนแผนการออกแบบ Claude Opus 5.5 เป็นตัวรันมันเป็นลูป แล้ว Fable 5.1 ก็กลับมารับบทที่ปรึกษาและตอบรับหรือปฏิเสธผลลัพธ์ นั่นคือแพตเทิร์นที่ X/@dotey โพสต์เมื่อวันที่ 22 กันยายน 2026 — วันที่ผู้ขายเปิดตัว Claude Opus 5.5 — โดยวางกรอบว่ามันเป็นกลไกประหยัดโทเคนที่เกิดขึ้นภายใต้แรงกดดันด้านต้นทุน: ตั้งที่ปรึกษาเป็น Fable, รัน Opus, แล้วปล่อยให้โมเดลแพงพูดเฉพาะจุดตัดสินใจเท่านั้น สิ่งที่พวกเขาใช้อยู่ไม่ใช่ทริกพรอมป์หรือการตั้งค่าซับเอเจนต์อีกต่อไปแล้ว มันคือเครื่องมือที่ปรึกษาในตัวของ Claude Code ฟีเจอร์ฝั่งเซิร์ฟเวอร์ที่คิดค่าบริการในอัตราของโมเดลที่ปรึกษา ซ้อนเพิ่มจากทุกอย่างที่โมเดลหลักใช้จ่ายไป และคำแนะนำคือส่วนที่ถูก ส่วนการอ่านบทสนทนาซ้ำเพื่อสร้างคำแนะนำนั้นไม่ถูก — คอนเท็กซ์ของผู้รันกลายเป็นของที่อ่านซ้ำได้ในราคาถูกไปแล้ว ส่วนคอนเท็กซ์ของที่ปรึกษาไม่เคยถูกเลย ความไม่สมมาตรเพียงข้อเดียวนี้ตัดสินว่าลูปนี้คุ้มที่จะรันหรือไม่ และนั่นคือสิ่งที่ส่วนที่เหลือของบทความนี้จะตีราคาออกมา

จริง ๆ แล้วลูปคืออะไร

เครื่องมือ advisor จะจับคู่โมเดลหลักของคุณกับโมเดลที่สอง ซึ่งโดยปกติจะแข็งแกร่งกว่า ที่ Claude ปรึกษาในช่วงเวลาสำคัญ — ก่อนตัดสินใจเลือกแนวทาง เมื่อเกิดข้อผิดพลาดซ้ำ ๆ หรือก่อนประกาศว่างานเสร็จแล้ว advisor จะได้รับบทสนทนาทั้งหมด รวมถึงการเรียกใช้เครื่องมือทุกครั้งและผลลัพธ์ของมัน แล้วส่งคำแนะนำกลับมา ซึ่งโมเดลหลักจะนำไปใช้ต่อไป มันจะไม่เรียกใช้เครื่องมือเลย และไม่สร้างเอาต์พุตที่ผู้ใช้เห็น คุณเป็นคนเลือกว่าโมเดลใดจะทำหน้าที่ให้คำปรึกษา; Claude เป็นผู้ตัดสินใจว่าจะเรียกใช้เมื่อใด

ส่วนสุดท้ายนั่นคือสิ่งที่ทำให้สิ่งนี้แตกต่างจากแพตเทิร์นแบบออร์เคสเตรเตอร์กับซับเอเจนต์ที่ชุมชน Claude Code กำลังแชร์กันในเดือนสิงหาคม Subagent คือการมอบหมายงาน: planner แตกงานออกเป็นส่วน ๆ แล้วส่งต่อไปยัง worker และคุณกำหนดค่าโมเดลของแต่ละเลนอย่างชัดเจน ส่วน advisor คือการยกระดับ: โมเดลเดียวขับเคลื่อนงานทั้งหมด และโมเดลราคาแพงจะถูกดึงเข้ามากลางทางเพื่อตัดสินใจในเรื่องที่ตัวขับเคลื่อนตัดสินใจเองไม่ได้ ไม่มี worker pool ไม่มี task graph และไม่มี orchestration prompt ให้ต้องดูแล ลูปในทางปฏิบัติที่ @dotey อธิบาย — วางแผน ลงมือทำ ตรวจสอบ ทำซ้ำ — คือหน้าตาของกลไกนั้นเมื่อคุณชี้ advisor ไปที่ Fable 5.1 และปล่อยให้มันคอยกำกับเงื่อนไขการออกจากลูป

การวางกรอบกลยุทธ์ของ Anthropic เองก็พูดตรง ๆ ถึงรูปร่างหน้าตาของชัยชนะว่า ที่ปรึกษา "มอบได้เพียงความสามารถที่ผู้ปฏิบัติขาดอยู่เท่านั้น" ทุกสิ่งด้านล่างนี้ล้วนเป็นผลสืบเนื่องมาจากความสามารถที่ขาดหายไปจริง ๆ มีมากน้อยเพียงใด และผู้ปฏิบัติยอมรับเรื่องนี้บ่อยแค่ไหน

ทำไม Claude Opus 5.5 ถึงเปลี่ยนวิธีคำนวณ

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

ตารางราคาที่ Anthropic เผยแพร่อย่างเป็นทางการ ต่อหนึ่งล้านโทเคน ตัวเลขเหล่านี้เป็นตัวเลขจากผู้ให้บริการ ไม่ใช่การประมาณการ:

• Claude Opus 5.5 — อินพุต $4, เอาต์พุต $20, อ่านแคช $0.20, เขียนแคช 5 นาที $5

Claude Opus 5 — $5 อินพุต, $25 เอาต์พุต, $0.50 การอ่านแคช, $6.25 สำหรับการเขียนแคช 5 นาที

• Claude Fable 5.1 — อินพุต $10, เอาต์พุต $50, อ่านแคช $0.25, เขียนแคช 5 นาที $12.50

รายละเอียดสองอย่างในรายการนั้นสำคัญกว่าราคาที่พาดหัวข่าว ประการแรก การอ่านแคชบน Opus 5.5 คิดเป็น 5% ของอินพุตฐาน ตามเชิงอรรถของ Anthropic เอง ซึ่งโมเดล Claude ส่วนใหญ่อยู่ที่ 10% และ Fable 5.1 อยู่ที่ 2.5% Fable 5.1 มีตัวคูณที่ดีกว่าและยังแพ้ในแง่จำนวนเงินจริง — 0.20 ดอลลาร์ เทียบกับ 0.25 ดอลลาร์ — เพราะอัตราอินพุตฐานของมันสูงกว่าสองเท่าครึ่ง

ข้อที่สอง และนี่คือกลไกที่ลูปนี้ทำงานโดยอาศัย: การสลับเปิด/ปิดที่ปรึกษาใน Claude Code ไม่ได้ทำให้แคชพรอมป์ของโมเดลหลักเป็นโมฆะ ดังนั้นบริบทที่ยาวและถูกส่งซ้ำหลายครั้งของตัวดำเนินการจึงยังคงมีต้นทุนต่ำที่ $0.20 ต่อล้าน การอ่านบทสนทนาของที่ปรึกษาเองไม่ถูกแคช การปรึกษาแต่ละครั้งจะประมวลผลบทสนทนาทั้งหมดใหม่ ณ อัตราค่าอินพุต $10 ต่อล้านของ Fable 5.1 ตัวดำเนินการที่อ่านบริบทขนาด 500K โทเคนซ้ำสิบครั้งจ่ายสำหรับการอ่านจากแคช; ที่ปรึกษาที่ถูกปรึกษาสิบครั้งจ่ายค่าอินพุตใหม่สิบรอบบนบทสนทนาที่เติบโตขึ้นตลอดเวลา ยิ่งบริบทของตัวดำเนินการถูกลงเท่าไร การอ่านแบบไม่แคชของที่ปรึกษาก็ยิ่งโดดเด่นขึ้นเท่านั้น — และ Opus 5.5 เพิ่งทำให้บริบทของตัวดำเนินการถูกลง 60% เมื่อเทียบกับ Opus 5

การตั้งค่าใน Claude Code

ที่ปรึกษาเป็นฟีเจอร์ทดลอง และ Anthropic ระบุไว้ในแบนเนอร์ของเซสชันว่า — "Advisor Tool (experimental) เปิดอยู่และอาจใช้โทเค็นมากขึ้น" พฤติกรรม ราคา และความพร้อมใช้งานอาจเปลี่ยนแปลงได้ เมื่อกล่าวข้อแม้ดังกล่าวแล้ว กลไกการทำงานมีเอกสารบันทึกไว้ดังนี้:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• เปิดใช้งานด้วย /advisor fable หรือรัน /advisor โดยไม่ใส่อาร์กิวเมนต์เพื่อเปิดตัวเลือก ตัวเลือกที่เลือกจะถูกบันทึกไว้ในการตั้งค่า advisorModel ในการตั้งค่าผู้ใช้ของคุณ และคงอยู่ข้ามเซสชัน /advisor off จะปิดการใช้งาน

• สำหรับเซสชันเดียวโดยไม่เปลี่ยนค่าเริ่มต้นที่บันทึกไว้ ให้เปิดใช้งานด้วย claude --advisor fable แฟล็กนี้ไม่ได้ระบุไว้ใน claude --help และ Claude Code จะออกเมื่อเปิดใช้งานหากการจับคู่นั้นไม่ถูกต้อง แทนที่จะเริ่มต้นด้วยที่ปรึกษาที่ถูกเพิกเฉยอย่างเงียบ ๆ

• ตั้งค่าเริ่มต้นแบบถาวรในไฟล์การตั้งค่าของคุณด้วย{"advisorModel": "fable"}.

• หากต้องการปิดการทำงานทั้งหมด ให้ตั้งค่า CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — คำสั่ง /advisor จะหายไป และ advisorModel ที่กำหนดค่าไว้จะถูกละเว้น

• การจับคู่ต้องมีความสามารถอย่างน้อยเทียบเท่ากับรุ่นหลัก Claude Opus 5.5 ยอมรับ Fable และ Opus 5 หรือใหม่กว่าเป็นที่ปรึกษา ที่ปรึกษา Opus 4.6 หรือ Sonnet จะถูกปฏิเสธโดย Claude Code; ที่ปรึกษา Opus 4.7 หรือ Opus 4.8 จะถูกแนบไปแล้วจึงถูกปฏิเสธโดย API Fable 5.1 ในฐานะรุ่นหลักยอมรับเฉพาะ Fable 5.1

• เวอร์ชันขั้นต่ำ: เครื่องมือ advisor ต้องใช้ Claude Code v2.1.98 หรือใหม่กว่า; Fable ไม่ว่าจะเป็นโมเดลหลักหรือ advisor ต้องใช้ v2.1.170 หรือใหม่กว่า; Fable 5.1 ต้องใช้ v2.1.257 หรือใหม่กว่า รูปแบบโทเค็นของ /advisor — แบบที่ใช้งานได้ใน -p, Agent SDK, แอปเดสก์ท็อป และ Remote Control — ต้องใช้ v2.1.260 หรือใหม่กว่า

• ที่ปรึกษาใช้ได้เฉพาะกับ Anthropic-API เท่านั้น ไม่มีให้บริการบน Amazon Bedrock, Claude Platform on AWS, Agent Platform ของ Google Cloud หรือ Microsoft Foundry และมันขึ้นอยู่กับการดึง feature flag ดังนั้นเซสชันที่มีการตั้งค่าตัวแปรเช่น DISABLE_TELEMETRY จะทำให้มันปิดอยู่

• สำหรับแผนที่การใช้งาน Fable ถูกเรียกเก็บเป็นเครดิตการใช้งาน การใช้ Fable เป็นที่ปรึกษาจะถูกเรียกเก็บในลักษณะเดียวกัน และต้องได้รับความยินยอมครั้งเดียว จนกว่าคุณจะยอมรับ /advisor fable จะไม่บันทึก และ claude --advisor fable จะออกเมื่อเริ่มทำงานโดยชี้ให้คุณไปที่ /model fable แทน

ซับเอเจนต์สืบทอดที่ปรึกษาที่คุณกำหนดค่าไว้ และรันการตรวจสอบการจับคู่แบบเดิมซ้ำกับโมเดลของตัวเอง นั่นคือปฏิสัมพันธ์เดียวระหว่างรูปแบบนี้กับรูปแบบซับเอเจนต์: ซับเอเจนต์ที่รันโมเดลที่เล็กกว่าอาจได้รับอนุญาตให้มีที่ปรึกษาที่พาเรนต์ของมันไม่ได้รับอนุญาต

รูปแบบของต้นทุน เมื่อวิเคราะห์อย่างละเอียดแล้ว

ไม่มีสิ่งใดด้านล่างนี้เป็นการวัด รูปแบบของโทเคนนี้ถูกสมมติขึ้นเพื่อให้มองเห็นการคำนวณได้ชัดเจน ราคาที่ใช้เป็นอัตราที่ Anthropic เผยแพร่ สมมติว่ามีเซสชันผู้ดำเนินการหนึ่งเซสชันที่อ่านโทเคนอินพุตใหม่ 1M และส่งออกโทเคนเอาต์พุต 500K และมีการขอคำปรึกษาจากที่ปรึกษาสามครั้ง โดยแต่ละครั้งอ่านทรานสคริปต์ขนาด 200K โทเคนซ้ำ และส่งคืนคำแนะนำประมาณ 600 โทเคน — ซึ่งใกล้เคียงกับการปรึกษา 2–3 ครั้งต่องานที่พรอมต์ระบบของ Anthropic เองระบุไว้

• Executor บน Claude Opus 5.5 — อินพุต 1M ในราคา $4.00 บวกเอาต์พุต 500K ในราคา $10.00 = $14.00

• ที่ปรึกษาบน Claude Fable 5.1 — อินพุต 600K ที่ $6.00 บวกกับโทเคนเอาต์พุตประมาณ 1,800 โทเคนที่ราว $0.09 = $6.09

• The loop รวม — ประมาณ $20.09

• รูปแบบเดียวกันที่รันแบบครบวงจรบน Fable 5.1 — อินพุต $10.00 บวกเอาต์พุต $25.00 = $35.00

• รูปแบบเดียวกันเมื่อใช้ Opus 5.5 เพียงอย่างเดียว — $14.00

ลูปนี้ตกอยู่ระหว่างสองสิ่งนั้น ซึ่งเป็นตำแหน่งที่ Anthropic วางไว้พอดี: ถูกกว่าการใช้ Fable 5.1 ตลอดทั้งกระบวนการประมาณ 43% และแพงกว่าการใช้ตัวดำเนินการเพียงอย่างเดียวประมาณ 44% ให้มองตัวเลขตัวที่สองเป็นตัวเลขที่ตรงไปตรงมา ที่ปรึกษาไม่ใช่การประหยัด แต่เป็นการซื้อวิจารณญาณระดับ Fable สำหรับการตัดสินใจสามเรื่อง และมันจะคุ้มค่าก็ต่อเมื่อการตัดสินใจสามเรื่องนั้นเปลี่ยนผลลัพธ์ ดันทรานสคริปต์ไปที่หน้าต่างบริบท 1M และการปรึกษาแต่ละครั้งมีค่าใช้จ่าย $10 แยกต่างหาก ปล่อยให้ตัวดำเนินการเริ่มถามในงานส่วนใหญ่แทนที่จะถามเพียงไม่กี่งาน แล้วคุณกำลังจ่ายในอัตราของที่ปรึกษาทั่วทั้งภาระงาน ซึ่ง ณ จุดนั้น ตามที่ Anthropic พูด การรันโมเดลของที่ปรึกษาเองเป็นเส้นทางที่ถูกกว่าเพื่อไปให้ถึงคะแนนเดียวกัน

สิ่งที่การวัดของ Anthropic เองบอก

Anthropic ได้เผยแพร่ผลการวัดสำหรับรูปแบบนี้ และเป็นข้อมูลที่ผู้ขายรายงานเอง: ดำเนินการโดยบริษัทที่ขายทั้งสองโมเดล บนชุดทดสอบ benchmark ของตัวเอง กระนั้นมันก็ยังเป็นตัวเลขเพียงชุดเดียวที่มีลักษณะเช่นนี้ และยังรวมกรณีที่คัดค้านรูปแบบนี้ไว้ด้วย ซึ่งเป็นเหตุผลว่าทำไมจึงคุ้มค่าที่จะอ่านอย่างละเอียด

• Opus 5 ในฐานะผู้ปฏิบัติงาน โดยมี Fable 5.1 เป็นที่ปรึกษา ทำคะแนนได้ $7.69 ต่อความพยายามบน benchmark การเขียนโค้ดแบบเอเจนต์ภายในของ Anthropic — เป็นการตั้งค่าที่แม่นยำที่สุดที่ Anthropic วัดได้ ซึ่งสูงกว่า Opus 5 เดี่ยว ๆ ที่การตั้งค่าเริ่มต้นของมันอยู่ 3.5 คะแนน ด้วยค่าใช้จ่ายที่น้อยกว่าเล็กน้อย และสูงกว่า Fable 5.1 เดี่ยว ๆ ประมาณ 2.5 คะแนน ด้วยค่าใช้จ่ายที่มากกว่าประมาณครึ่งหนึ่ง ช่องว่าง 3.5 คะแนนนี้แยกออกจากความแปรปรวนระหว่างการรันได้ด้วยการลองห้าครั้งต่องาน

• การจับคู่แบบเดียวกันในการอ่านแผนภูมิให้ผลเทียบเท่ากับ Fable 5.1 เพียงลำพังที่ความพยายามระดับกลางภายในเกณฑ์ความคลาดเคลื่อน — 65.0 เทียบกับ 67.5 — โดยมีต้นทุนต่อภารกิจราว 2.6 เท่า เนื่องจากมีการปรึกษาผู้ให้คำแนะนำในเกือบทุกภารกิจ

• บน GPQA Diamond การเพิ่มขึ้นสะท้อนช่องว่างความสามารถได้เกือบสมบูรณ์แบบ: ตัวดำเนินการ Haiku 4.5 เพิ่มขึ้นอย่างมาก ตัวดำเนินการ Sonnet 5 เพิ่มขึ้นไม่กี่จุด และตัวดำเนินการระดับแนวหน้าแทบไม่เพิ่มขึ้นเลย

• อัตราการปรึกษาเป็นตัวแปรที่เปราะบาง ผู้ดำเนินการ Sonnet 5 ที่ใช้ความพยายามต่ำได้คะแนนเพิ่ม 23 คะแนนบน DeepSWE เมื่อมีที่ปรึกษา จากนั้นก็หยุดถามไปเลยบน SWE-bench Pro และไม่ได้รับอะไรเพิ่มเลย

• ความหน่วง: การเรียกใช้โมเดลระดับแนวหน้าเพิ่มขึ้นประมาณสองครั้งต่อหนึ่งงาน โดยแต่ละครั้งอยู่บนเส้นทางวิกฤต

สองสิ่งเกี่ยวกับหลักฐานนั้นเกี่ยวข้องโดยตรงกับลูปในสภาพที่เป็นอยู่ในสัปดาห์นี้ การวัดใช้ Opus 5 เป็นผู้ดำเนินการ เพราะ Opus 5.5 ยังไม่มีอยู่ในตอนที่ทำการวัด และ Anthropic รายงานว่า Opus 5.5 ทำงานได้ในระดับเดียวกับ Fable 5.1 ในงานส่วนใหญ่ ขณะที่มีต้นทุนการรันต่ำลง 40% — ทั้งสองข้อเป็นคำกล่าวอ้างของผู้ขาย และไม่มีข้อใดถูกทำซ้ำโดยอิสระ หากช่องว่างระหว่างผู้ดำเนินการกับที่ปรึกษาคือสิ่งที่ที่ปรึกษาได้รับค่าจ้างให้ปิด ช่องว่างที่แคบลงก็ย่อมหมายถึงการซื้อที่เล็กลง รูปแบบไม่ได้แย่ลงเมื่อ Opus 5.5 เปิดตัว; สิ่งที่มันขายกลับหายากน้อยลง

โหมดความล้มเหลวที่คุณจะได้เจอจริง ๆ

พฤติกรรมเหล่านี้เป็นพฤติกรรมที่เอกสารระบุไว้ ไม่ใช่การคาดเดา และข้อแรกคือเหตุผลที่คุณควรอ่านส่วนนี้ก่อนเริ่มดีบักสิ่งใดก็ตาม:

• ที่ปรึกษาที่หายไปอย่างเงียบ ๆ หาก API ปฏิเสธการจับคู่ที่ปรึกษา Claude Code จะแนบที่ปรึกษาเข้าไป API ปฏิเสธมัน และ Claude Code จะส่งคำขออีกครั้งโดยไม่มีที่ปรึกษา จากนั้นบทสนทนาที่เหลือจะดำเนินไปโดยไม่มีที่ปรึกษาและไม่มีข้อความแจ้งข้อผิดพลาดใด ๆ มันจะยังคงปิดอยู่จนกว่า /clear หรือ /compact แม้หลังจากที่คุณสลับไปใช้โมเดลหลักที่เข้ากันได้แล้ว

• กรณีที่ถูกปฏิเสธแบบเงียบ ๆ สำหรับการจับคู่ที่ Claude Code เองปฏิเสธ ที่ปรึกษาจะไม่ถูกแนบไปกับคำขอของโมเดลหลักเลย เอาต์พุตของ /advisor และการแจ้งเตือนจะบอกคุณ — แต่ไม่มีอะไรล้มเหลว ดังนั้นเซสชันที่คุณคิดว่ากำลังมีที่ปรึกษาให้คำแนะนำอยู่นั้นอาจไม่เคยมีเลยก็ได้

• ความยินยอมที่คุณยังไม่ได้ให้ไว้ เมื่อเลือก Fable เป็นที่ปรึกษาในแผนที่ต้องได้รับความยินยอมในการใช้เครดิต คำขอจะถูกส่งออกไปโดยไม่มีที่ปรึกษาจนกว่าคุณจะยอมรับ เซสชันเบื้องหลังที่เริ่มด้วย --advisor fableจะเริ่มทำงานโดยไม่มีที่ปรึกษาแทนที่จะออกจากระบบ

• Allowlist ที่คุณไม่ได้ควบคุม หาก allowlist ขององค์กรของคุณavailableModels ไม่รวมโมเดล advisor, Claude Code จะไม่เรียกใช้งานมัน และคุณจำเป็นต้องเลือกโมเดลที่ได้รับอนุญาตด้วย /advisor

• ทุกที่ที่มันไม่มีอยู่ เฉพาะ Anthropic API เท่านั้น: ไม่มี Bedrock, ไม่มี Claude Platform on AWS, ไม่มี Google Cloud Agent Platform, ไม่มี Microsoft Foundry เมื่อผ่านเกตเวย์ ความพร้อมใช้งานขึ้นอยู่กับว่าเกตเวย์ส่งต่อคำขอไปยัง Anthropic API โดยสมบูรณ์หรือไม่ — ซึ่งเป็นคุณสมบัติของเกตเวย์ ไม่ใช่สิ่งที่คุณสามารถสันนิษฐานได้

OrcaRouter เหมาะกับที่ใด

โมเดลทั้งสองในลูปนี้พร้อมใช้งานบน OrcaRouter แล้ววันนี้ ในราคาตามที่ Anthropic ประกาศไว้เอง โดยบวกเพิ่ม 0% — ราคาที่ผู้ให้บริการกำหนดถูกส่งผ่านตรงถึงคุณ อัตราที่คุณเห็นจึงเป็นอัตราที่ Anthropic เผยแพร่ Claude Fable 5.1 อยู่ที่ anthropic/claude-fable-5.1 และ Claude Opus 5 ที่ anthropic/claude-opus-5 ภายใต้คีย์ API เดียว Claude Opus 5.5 ยังไม่ใช่หนึ่งในเส้นทางของเรา แต่พร้อมใช้งานผ่าน API ของ Anthropic เองและคลาวด์รายใหญ่ และเราจะบอกตามตรงเช่นนี้แทนที่จะพูดเป็นนัยเป็นอย่างอื่น

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

สิ่งที่คีย์เดียวซื้อให้คุณที่นี่คือความสามารถในการเปลี่ยนใจได้อย่างประหยัด เศรษฐศาสตร์ของลูปนั้นขึ้นอยู่กับอัตราส่วนราคาระหว่างผู้ดำเนินการกับที่ปรึกษา และอัตราส่วนนั้นเปลี่ยนไปสองครั้งในเจ็ดสัปดาห์ — Opus 5 เป็น Opus 5.5 เมื่อวันที่ 22 กันยายน และ Fable 5 เป็น Fable 5.1 เมื่อวันที่ 1 กันยายน ซึ่งลดการอ่านแคชของโมเดลนั้นจาก $1.00 เหลือ $0.25 ต่อล้าน ทุกการเปลี่ยนแปลงเหล่านี้เปลี่ยนคำตอบของคำถามที่ว่า "ที่ปรึกษาคุ้มค่าหรือไม่" และการทดสอบคำตอบนั้นไม่ควรต้องใช้สัญญาที่สอง การสลับสำรองอัตโนมัติเป็นอีกครึ่งหนึ่ง: มันช่วยให้คุณชี้ทราฟฟิกส่วนหนึ่งไปยังโมเดลที่คุณยังไม่ได้กำหนดคุณลักษณะไว้ โดยมีตัวสำรองเป็นโมเดลที่คุณมีอยู่แล้ว แทนที่จะเดิมพันเส้นทางโปรดักชันกับตารางเปิดตัว และถ้าคุณสร้างรูปแบบนี้ด้วยตัวเองแทนที่จะใช้เครื่องมือที่มีมาให้ใน Claude Code DSL การกำหนดเส้นทางจะประกอบโมเดลหลายตัวเข้าเป็นการเรียกครั้งเดียว — ขั้นตอนวางแผนบนโมเดลหนึ่ง ตามด้วยขั้นตอนดำเนินการบนอีกโมเดลหนึ่ง โดยอยู่เบื้องหลังเอนด์พอยต์เดียว

หมายเหตุเรื่องขอบเขตอย่างตรงไปตรงมาข้อหนึ่ง: เครื่องมือ advisor เองเป็นเครื่องมือฝั่งเซิร์ฟเวอร์ที่ทำงานบน API ของ Anthropic ดังนั้นเลเยอร์จัดเส้นทาง (routing layer) จึงไม่ใช่สิ่งที่จะมาแทนมันได้ สิ่งที่เราทำได้คือทำให้โมเดลเหล่านี้พร้อมใช้เพียงกดคีย์เดียว ในราคาตามรายการ เพื่อให้การตัดสินใจว่าจะเก็บหรือเลิกใช้ advisor นั้นเป็นของคุณ โดยพิจารณาจากตัวเลขของคุณเอง

วิธีตัดสินใจสำหรับปริมาณงานของคุณเอง

คำแนะนำของ Anthropic เองคือจุดเริ่มต้นที่ถูกต้อง และมันตรงไปตรงมาอย่างน่าสดชื่น: จงรันชุดประเมินของคุณกับสามการตั้งค่า — ผู้ปฏิบัติงานเดี่ยว, ผู้ปฏิบัติงานที่มีที่ปรึกษา, และโมเดลของที่ปรึกษาเพียงลำพังที่ความพยายามต่ำ — และตรวจสอบซ้ำทุกครั้งที่มีการเปิดตัวโมเดลใหม่ เพราะการเปิดตัวนั้นขยับทั้งช่องว่างความสามารถและอัตราส่วนราคา ตัวสุดท้ายในสามแบบนั้นคือเส้นฐานที่ต้องเอาชนะ หากโมเดลของที่ปรึกษาเพียงลำพังที่ความพยายามต่ำได้คะแนนเท่ากับลูปในราคาที่ถูกกว่า คุณก็ได้คำตอบแล้ว

ตัวแปรสองตัวที่ต้องจับตาคือตัวที่ Anthropic ตั้งชื่อ ช่องว่างความสามารถ: ช่องว่างที่กว้างระหว่างผู้ดำเนินการและที่ปรึกษาคือจุดที่ที่ปรึกษาคุ้มค่ากับค่าตอบแทน และ Opus 5.5 ได้ลดช่องว่างนั้นจากด้านล่าง อัตราการปรึกษา: ผลตอบแทนเพิ่มขึ้นตามอัตรานั้นเกือบหนึ่งต่อหนึ่ง และมันไวต่อพรอมต์พอที่จะพังทลาย — ผู้ดำเนินการที่ใช้ความพยายามต่ำอาจหยุดสังเกตว่าตนติดขัด และการจับคู่ที่ทำการปรึกษาในงานส่วนใหญ่ด้วยความพยายามเริ่มต้นอาจลดลงจนเกือบไม่มี พรอมต์ระบบที่ Anthropic จัดหาให้ขอให้เรียกที่ปรึกษาหนึ่งครั้งก่อนงานที่มีเนื้อหาสาระและอีกหนึ่งครั้งก่อนเสร็จ ซึ่งลงเอยที่สองถึงสามครั้งต่องาน; การจับคู่การเขียนโค้ดที่ให้กำไร 3.5 จุดทำงานที่จังหวะนั้น จัดงบสำหรับสิ่งนั้น จำกัดมัน และมองทุกการปรึกษาที่เกินกว่านั้นเป็นสัญญาณว่าผู้ดำเนินการของคุณตั้งค่าผิด มากกว่าที่ว่างานนั้นยาก

สำหรับลูปเฉพาะในบทความนี้ มีการตั้งค่าเพียงสามอย่างที่ทำงานหลักเกือบทั้งหมด ให้ Claude Opus 5.5 อยู่ที่ medium effort ซึ่งเป็นค่าเริ่มต้น แทนที่จะไปเร่งเป็น high เพราะ effort ส่งผลต่อค่าใช้จ่ายโดยตรง และตัวเลข Opus 5.5 ของ Anthropic เองก็แสดงว่า medium ให้ผลลัพธ์ลดลงเพียงเล็กน้อยเท่านั้น ตั้งค่า advisor ด้วย/advisor fable และตรวจสอบว่าแบนเนอร์ปรากฏขึ้นจริง — ถ้าไม่มีแบนเนอร์ ก็หมายความว่า advisor หายไปโดยไม่มีสัญญาณเตือนใด ๆ และก่อนที่คุณจะขยายรูปแบบนี้ไปใช้ ให้วัดจำนวนโทเค็นต่องานที่ทำเสร็จหนึ่งงาน แทนที่จะวัดราคาต่อโทเค็น เพราะนั่นคือตัวเลขที่ลูปนี้ควรจะขยับ

คำถามที่พบบ่อย

ที่ปรึกษาใช้โควตา Fable เท่ากับเซสชัน Fable หรือไม่

ในการคิดค่าบริการผ่าน API โทเค็นของ advisor จะถูกคิดค่าบริการตามอัตราอินพุตและเอาต์พุตของ Fable 5.1 เอง และขีดจำกัดอัตราการใช้งานของ advisor จะดึงมาจากบัคเก็ตต่อโมเดลเดียวกันกับการเรียกใช้โมเดลนั้นโดยตรง — ดังนั้นการเรียก advisor ที่ติดขีดจำกัดอัตราจะปรากฏเป็นข้อผิดพลาดภายในผลลัพธ์ของเครื่องมือ แทนที่จะทำให้คำขอของคุณล้มเหลว ในแผนแบบสมัครสมาชิก การใช้งาน advisor จะนับรวมในขีดจำกัดการใช้งานของแผนของคุณ ยกเว้นว่า advisor ที่เป็น Fable จะคิดเป็นเครดิตการใช้งานในแผนที่การใช้งาน Fable คิดเป็นเครดิตการใช้งาน ผลลัพธ์ในทางปฏิบัติก็คือ advisor ไม่ใช่งบประมาณแยกต่างหากที่คุณใช้จ่ายได้อย่างอิสระ แต่ต้องแข่งขันกับทุกอย่างอื่นที่คุณทำบนโมเดลนั้น

ที่ปรึกษาได้เห็นอะไรจริง ๆ บ้าง

บทสนทนาทั้งหมด รวมถึงการเรียกใช้เครื่องมือทุกครั้งและผลลัพธ์ของเครื่องมือทุกครั้ง — เนื้อหาไฟล์ เอาต์พุตคำสั่ง ข้อความแสดงข้อผิดพลาด ทั้งหมด มันทำงานภายใต้พรอมต์ระบบที่ Anthropic จัดให้ของตัวเอง และส่งคืนแผน การแก้ไข หรือสัญญาณหยุด มีรายละเอียดสองอย่างตามมาจากสิ่งนั้น อย่างแรก การปรึกษาแต่ละครั้งจะอ่านทรานสคริปต์ทั้งหมดซ้ำ ซึ่งเป็นเหตุผลว่าทำไมค่าใช้จ่ายจึงเพิ่มขึ้นตามลูปแทนที่จะคงที่ อย่างที่สอง หากเซสชันของคุณแตะต้องเนื้อหาที่คุณจะไม่ส่งไปยังโมเดลที่สองในระดับราคาของที่ปรึกษา ที่ปรึกษาก็คือโมเดลที่สองที่อ่านทั้งหมดนั้น

อะไรจะเปลี่ยนคำตอบ

สองเรื่อง และทั้งสองก็ใกล้กว่าที่ดูเหมือน หากผู้ทำเบนช์มาร์กอิสระเผยแพร่ผลการรัน Opus 5.5 เทียบกับ Fable 5.1 ที่ใช้ความพยายามเท่ากัน และยืนยันว่าช่องว่างที่แคบลงตามที่ Anthropic อ้างนั้นเป็นจริง ความได้เปรียบที่เหลืออยู่ของ advisor ในงานส่วนใหญ่ก็บางเฉียบ — และ loop ก็กลายเป็นเครื่องมือสำหรับส่วนท้ายที่ยาก แทนที่จะเป็นค่าเริ่มต้น แต่ถ้าอัตราการปรึกษายังคงเดิม และช่องว่างความสามารถยังกว้างในงาน agentic ที่ยาวนาน คณิตศาสตร์ข้างต้นคือสิ่งที่คุณกำลังเลือกอยู่ระหว่างมัน และคำแนะนำราคา $6 ต่อการรันราคา $14 ก็เป็นออปชันราคาถูกสำหรับการไม่ปล่อยของผิดออกไป

สิ่งที่จะไม่เปลี่ยนไปก็คือกลไกที่อยู่ตอนต้นของบทความนี้ บริบทของผู้ดำเนินการถูกแคชไว้และมีต้นทุนต่ำ ส่วนบริบทของผู้ให้คำปรึกษาไม่มีคุณสมบัติทั้งสองข้อนั้นเลย ลูปใดก็ตามที่เรียกใช้โมเดลที่มีราคาแพงกว่าระหว่างทำงาน ย่อมสืบทอดความไม่สมดุลนั้นไว้ ไม่ว่าตารางราคาจะระบุไว้อย่างไรในเดือนหน้า

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube