
Claude Opus 5.5는 실행하고 Claude Fable 5.1은 조언한다: Claude Code 어드바이저 루프의 가격 책정
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Claude Fable 5.1이 설계 계획을 작성합니다. Claude Opus 5.5가 이를 루프 안에서 실행합니다. Fable 5.1이 다시 어드바이저로 돌아와 결과를 수용하거나 거부합니다. 이것이 X/@dotey가 2026년 9월 22일 — 벤더가 Claude Opus 5.5를 출시한 날 — 에 게시한 패턴이며, 비용 압박 속에서 도출된 토큰 절약형 구성이라고 포장한 것입니다. 어드바이저를 Fable로 설정하고, Opus를 실행하되, 값비싼 모델은 의사 결정 지점에서만 입을 열게 하는 것이죠. 그들이 쓰고 있는 것은 더 이상 프롬프트 요령이나 서브에이전트 구성이 아닙니다. 이는 Claude Code에 내장된 어드바이저 도구로, 서버 측 기능이며 메인 모델이 지출하는 모든 것에 더해 어드바이저 모델의 요율로 청구됩니다. 그리고 조언 자체는 값싼 부분입니다. 그것을 만들어 내기 위해 대화를 다시 읽는 일은 그렇지 않습니다 — 실행자의 컨텍스트는 다시 읽는 비용이 저렴해졌지만, 어드바이저의 컨텍스트는 결코 저렴한 적이 없었습니다. 바로 이 단 하나의 비대칭성이 그 루프를 돌릴 가치가 있는지를 결정하며, 이 글의 나머지 부분이 값을 매기는 대상이기도 합니다.
루프가 실제로 무엇인지
어드바이저 도구는 기본 모델을 두 번째, 대개 더 강력한 모델과 짝지어 줍니다. Claude는 중요한 순간에 이 모델에 자문합니다. 접근 방식을 확정하기 전, 오류가 계속 반복될 때, 또는 작업 완료를 선언하기 전입니다. 어드바이저는 모든 도구 호출과 그 결과를 포함한 전체 대화를 받고, 기본 모델이 이후 적용할 지침을 반환합니다. 어드바이저는 도구를 호출하지 않으며 사용자에게 보이는 출력을 생성하지도 않습니다. 어떤 모델이 자문할지는 사용자가 선택하고, 언제 호출할지는 Claude가 결정합니다.
그 마지막 부분이 바로 이것을 Claude Code 커뮤니티가 8월에 회자하던 오케스트레이터-서브에이전트 패턴과 구분 짓는 요소다. 서브에이전트는 위임이다: 플래너가 작업을 분해해 워커들에게 분배하고, 각 레인의 모델을 명시적으로 설정한다. 어드바이저는 에스컬레이션이다: 하나의 모델이 전체 작업을 주도하고, 비싼 모델은 주도자가 혼자 내릴 수 없는 결정을 위해 진행 중에 투입된다. 워커 풀도, 작업 그래프도, 유지해야 할 오케스트레이션 프롬프트도 없다. @dotey가 설명하는 실용적 루프 — 계획하고, 실행하고, 검증하고, 반복하기 — 는 어드바이저를 Fable 5.1로 향하게 하고 그 루프의 종료 조건을 감시하게 했을 때 그 메커니즘이 보이는 모습이다.
이 전략에 대한 Anthropic 자신의 설명은 그 승리가 어떤 모습일지에 대해 노골적이다. 조언자는 "실행자에게 없는 역량만 넘겨줄 수 있다." 아래의 모든 내용은 실제로 얼마나 많은 역량이 결여되어 있는지, 그리고 실행자가 그 사실을 얼마나 자주 인정하는지에 따라 결정된다.
Claude Opus 5.5가 계산법을 바꾼 이유

Anthropic이 공개한 백만 토큰당 요금표입니다. 이는 추정치가 아니라 공급업체가 제시한 수치입니다:
• Claude Opus 5.5 — 입력 $4, 출력 $20, 캐시 읽기 $0.20, 5분 캐시 쓰기 $5
• Claude Opus 5 — 입력 $5, 출력 $25, 캐시 읽기 $0.50, 5분 캐시 쓰기 $6.25
• Claude Fable 5.1 — 입력 $10, 출력 $50, 캐시 읽기 $0.25, 5분 캐시 쓰기 $12.50
그 목록에서 두 가지 세부 사항은 헤드라인 가격보다 더 중요합니다. 첫째, Anthropic 자체 각주에 따르면 Opus 5.5의 캐시 읽기는 기본 입력의 5%인데, 대부분의 Claude 모델은 10%, Fable 5.1은 2.5%입니다. Fable 5.1은 배수가 더 좋지만 절대 달러 금액에서는 여전히 뒤처집니다 — $0.20 대 $0.25 — 기본 입력 요율이 2.5배 더 높기 때문입니다.
둘째, 그리고 이것이 바로 이 루프가 작동하는 메커니즘입니다. Claude Code에서 어드바이저를 켜고 꺼도 메인 모델의 프롬프트 캐시는 무효화되지 않으므로, 실행자의 길고 반복적으로 재전송되는 컨텍스트는 100만 토큰당 $0.20으로 저렴하게 유지됩니다. 어드바이저 자신의 대화 읽기는 캐시되지 않습니다. 각 조회는 전체 트랜스크립트를 Fable 5.1의 100만 토큰당 $10 입력 요율로 매번 새로 처리합니다. 500K 토큰 컨텍스트를 열 번 다시 읽는 실행자는 캐시 읽기 비용을 지불하지만, 열 번 조회되는 어드바이저는 계속 커지고 있는 트랜스크립트에 대해 열 번의 새 입력 요금을 지불합니다. 실행자의 컨텍스트가 저렴해질수록 어드바이저의 캐시되지 않은 읽기는 더욱 두드러집니다 — 그리고 Opus 5.5는 방금 실행자의 컨텍스트를 Opus 5보다 60% 더 저렴하게 만들었습니다.
Claude Code에서 설정하기
Advisor는 실험적이며 Anthropic은 세션 배너에서 이를 밝힙니다 — "Advisor Tool (experimental)이 켜져 있으며 더 많은 토큰을 사용할 수 있습니다." 동작, 요금 및 제공 여부는 변경될 수 있습니다. 이러한 주의 사항을 전제로, 작동 방식은 문서화되어 있습니다:

• 켜려면 /advisor fable 또는 /advisor를 인수 없이 실행하면 선택기가 나타납니다. 선택한 값은 사용자 설정의 advisorModel 항목에 저장되며 세션 간에도 유지됩니다. /advisor off를 입력하면 꺼집니다.
• 저장된 기본값을 변경하지 않고 단일 세션에만 사용하려면 claude --advisor fable 명령으로 실행하세요. 이 플래그는 claude --help에 나열되어 있지 않으며, Claude Code는 페어링이 유효하지 않으면 조용히 무시되는 advisor와 함께 시작하는 대신 실행 시 종료됩니다.
• 설정 파일에서 다음을 사용하여 영구 기본값을 설정하세요: {"advisorModel": "fable"}.
• 완전히 종료하려면 CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1을 설정하세요 — /advisor 명령이 사라지고 구성된 advisorModel은 무시됩니다.
• 페어링은 최소한 메인 모델만큼의 성능을 갖춰야 합니다. Claude Opus 5.5는 Fable과 Opus 5 이상을 어드바이저로 허용합니다. Opus 4.6 또는 Sonnet 어드바이저는 Claude Code에서 거부되며, Opus 4.7 또는 Opus 4.8 어드바이저는 연결된 후 API에서 거부됩니다. 메인 모델인 Fable 5.1은 Fable 5.1만 허용합니다.
• 최소 버전 요건: advisor 도구에는 Claude Code v2.1.98 이상이 필요합니다. Fable을 주 모델 또는 advisor로 사용하려면 v2.1.170 이상이, Fable 5.1에는 v2.1.257 이상이 필요합니다. /advisor의 토큰 형식 — -p, Agent SDK, 데스크톱 앱 및 Remote Control에서 작동하는 형식 — 은 v2.1.260 이상이 필요합니다.
• 어드바이저는 Anthropic API 전용입니다. Amazon Bedrock, AWS의 Claude Platform, Google Cloud의 Agent Platform 또는 Microsoft Foundry에서는 사용할 수 없으며, 기능 플래그 조회에 의존하기 때문에 DISABLE_TELEMETRY 같은 변수가 설정된 세션에서는 계속 꺼진 상태로 유지됩니다.
• Fable 사용량이 사용량 크레딧으로 청구되는 플랜에서는 Fable-as-advisor도 동일한 방식으로 청구되며 일회성 동의가 필요합니다. 이를 수락할 때까지 /advisor fable은(는) 저장되지 않으며 claude --advisor fable은(는) 실행 시 종료되어 대신 /model fable을(를) 가리킵니다.
서브에이전트는 구성한 어드바이저가 무엇이든 상속하고, 자신의 모델에 대해 동일한 페어링 검사를 다시 실행합니다. 이것이 이 패턴과 서브에이전트 패턴 사이의 유일한 상호작용입니다. 더 작은 모델을 실행하는 서브에이전트는 상위 에이전트가 허용받지 못한 어드바이저를 허용받을 수 있습니다.
비용 구조, 철저히 분석한
아래 내용 중 어느 것도 측정값이 아니다. 토큰 형태는 산술을 눈에 보이게 하려고 고안된 것이며, 가격은 Anthropic이 공개한 요율이다. 1M개의 새로운 입력 토큰을 읽고 500K개의 출력 토큰을 내보내는 실행자 세션 하나와, 각각 200K 토큰 분량의 대화 기록을 다시 읽고 약 600토큰의 지침을 반환하는 세 번의 어드바이저 상담을 가정하자 — 대략 Anthropic 자체 시스템 프롬프트가 요구하는 작업당 2~3회 상담에 해당한다.
• Claude Opus 5.5 기반 Executor — 1M 입력 $4.00 + 500K 출력 $10.00 = $14.00
• Claude Fable 5.1 어드바이저 — 입력 600K에 $6.00, 약 1,800개 출력 토큰에 대략 $0.09 = $6.09
• 루프, 합계 — 약 $20.09
• 동일한 형태를 Fable 5.1에서 엔드투엔드로 실행 — 입력 $10.00 + 출력 $25.00 = $35.00
• Opus 5.5 단독에서의 동일한 형태 — $14.00
루프는 그 둘 사이에 자리 잡는데, 바로 그 지점이 Anthropic이 이것을 위치시키는 곳이다. Fable 5.1을 처음부터 끝까지 돌리는 것보다 약 43% 저렴하고, 실행자(executor)만 단독으로 돌리는 것보다는 약 44% 더 비싸다. 두 번째 숫자를 정직한 숫자로 받아들여라. 어드바이저는 절약이 아니라, 세 가지 결정에 대해 Fable급 판단력을 사는 것이며, 그 세 가지 결정이 결과를 바꿀 때에만 값을 한다. 트랜스크립트를 1M 컨텍스트 윈도우까지 밀어 넣으면 컨설트 한 번에 그 자체로 10달러가 든다. 실행자가 몇몇 과제가 아니라 대부분의 과제에서 묻게 만들면, 전체 워크로드에 걸쳐 어드바이저 요율을 지불하는 셈이 되는데 — 이 지점에서, Anthropic의 표현대로라면, 같은 점수를 얻는 더 저렴한 경로는 어드바이저의 모델 자체를 돌리는 것이다.
앤스로픽 자체 측정이 말해주는 것
Anthropic은 이 패턴에 대해 측정된 결과를 발표했으며, 이는 벤더가 보고한 것입니다. 즉, 두 모델을 모두 판매하는 회사가 자체 벤치마크 하네스에서 실행한 것입니다. 그것들은 여전히 그런 종류의 유일한 수치이며, 이 패턴에 반대하는 사례까지 포함하고 있어서 자세히 읽어볼 가치가 있습니다.
• Opus 5를 실행자로, Fable 5.1을 조언자로 사용한 구성은 Anthropic의 내부 에이전트 코딩 벤치마크에서 시도당 $7.69를 기록했다 — Anthropic이 측정한 가장 정확한 구성이다. 이는 기본 설정의 Opus 5 단독보다 3.5점 높으면서 비용은 약간 더 적고, Fable 5.1 단독보다 약 2.5점 높으면서 비용은 약 1.5배이다. 3.5점 차이는 과제당 5회 시도로 실행 간 노이즈와 분리되었다.
• 차트 읽기에서 같은 조합은 중간 노력 수준에서 Fable 5.1 단독과 오차 범위 내로 맞먹었다 — 65.0 대 67.5 — 작업당 비용은 약 2.6배였는데, 거의 모든 작업에서 어드바이저가 참조되었기 때문이다.
• GPQA Diamond에서 이득은 역량 격차를 거의 완벽하게 따라간다: Haiku 4.5 실행자는 큰 이득을 얻었고, Sonnet 5 실행자는 몇 점을 얻었으며, 프런티어 실행자는 거의 아무것도 얻지 못했다.
• 자문 비율은 취약한 변수다. 낮은 노력의 Sonnet 5 실행자는 어드바이저와 함께 DeepSWE에서 23점을 얻었지만, SWE-bench Pro에서는 자문을 완전히 그만두었고 아무것도 얻지 못했다.
• 지연 시간: 작업당 약 두 번의 추가 프런티어 모델 호출이 발생하며, 각 호출은 크리티컬 패스 상에 있습니다.
그 증거에 관한 두 가지는 이번 주 현재의 루프에 직접적으로 관련된다. 측정에서는 Opus 5를 실행자로 사용했는데, 실행 당시 Opus 5.5가 존재하지 않았기 때문이다. 그리고 Anthropic은 Opus 5.5가 대부분의 작업에서 Fable 5.1 수준의 성능을 내면서 실행 비용은 40% 더 적다고 보고한다 — 둘 다 벤더의 주장이며, 어느 것도 독립적으로 재현되지 않았다. 실행자와 어드바이저 사이의 격차를 좁히는 것이 어드바이저가 돈을 받고 하는 일이라면, 더 좁은 격차는 더 작은 구매다. Opus 5.5가 출시되었을 때 그 패턴이 더 나빠진 것은 아니다. 그것이 파는 것이 덜 희소해졌을 뿐이다.
당신이 실제로 마주치게 될 실패 모드
이것들은 추측이 아니라 문서화된 동작이며, 첫 번째 것은 무엇이든 디버깅하기 전에 이 섹션을 읽어야 하는 이유입니다:
• 조용히 부재하는 어드바이저. API가 어드바이저 페어링을 거부하면 Claude Code가 어드바이저를 붙이고, API가 이를 거부하며, Claude Code는 어드바이저 없이 요청을 다시 보냅니다. 그러면 나머지 대화는 어드바이저 없이, 오류 메시지도 없이 진행됩니다. 이는 다음 전까지 꺼진 상태로 유지됩니다: /clear 또는 /compact, 호환되는 메인 모델로 전환한 뒤에도 마찬가지입니다.
• 조용히 거부된 사례. Claude Code 자체가 거부하는 페어링의 경우, advisor는 메인 모델의 요청에 아예 연결되지 않습니다. /advisor 출력과 알림이 이를 알려주지만, 실패하는 것은 없으므로, 어드바이저가 작동 중이라고 가정했던 세션이 실제로는 그렇지 않았을 수 있습니다.
• 아직 동의하지 않은 경우. 사용 크레딧 동의가 필요한 플랜에서 Fable을 어드바이저로 선택하면, 동의할 때까지 요청은 어드바이저 없이 전송됩니다. --advisor fable로 시작된 백그라운드 세션은 종료되는 대신 어드바이저 없이 시작됩니다.
• 귀하가 통제할 수 없는 허용 목록. 조직의 availableModels 허용 목록에서 어드바이저 모델을 제외하면 Claude Code가 해당 모델을 호출하지 않으므로, /advisor로 허용된 모델을 선택해야 합니다.
• 존재하지 않는 모든 곳에서는. Anthropic API만: Bedrock 없음, Claude Platform on AWS 없음, Google Cloud Agent Platform 없음, Microsoft Foundry 없음. 게이트웨이를 통하는 경우, 가용성은 게이트웨이가 요청을 손상 없이 Anthropic의 API로 전달하는지에 달려 있습니다. 이는 게이트웨이의 속성이지, 가정할 수 있는 것이 아닙니다.
OrcaRouter가 적합한 위치
이 루프의 두 모델 모두 오늘 OrcaRouter에서 이용할 수 있습니다 — Anthropic 자체 정가에 0% 마크업, 즉 제공자 정가를 그대로 전달하므로 보이는 요금이 곧 Anthropic이 공표한 요금입니다. Claude Fable 5.1은 anthropic/claude-fable-5.1, Claude Opus 5는 anthropic/claude-opus-5에 있으며, 하나의 API 키로 접근할 수 있습니다. Claude Opus 5.5는 아직 저희 경로 중 하나가 아닙니다. 이 모델은 Anthropic 자체 API와 주요 클라우드를 통해 이용할 수 있으며, 그렇지 않은 것처럼 암시하기보다 그대로 말씀드립니다.

여기서 키 하나로 얻을 수 있는 것은 값싸게 마음을 바꿀 수 있는 능력입니다. 이 루프의 경제성은 실행자 대 조언자 가격 비율에 달려 있는데, 그 비율은 7주 동안 두 번이나 바뀌었습니다 — 9월 22일 Opus 5에서 Opus 5.5로, 그리고 9월 1일 Fable 5에서 Fable 5.1로 바뀌면서 해당 모델의 캐시 읽기 비용이 백만 토큰당 $1.00에서 $0.25로 인하되었습니다. 그런 변화 하나하나가 "조언자가 그만한 가치가 있는가"라는 질문의 답을 바꾸며, 그 답을 검증하는 데 두 번째 계약이 필요해서는 안 됩니다. 자동 페일오버가 나머지 절반입니다. 즉, 아직 특성을 파악하지 못한 모델에 트래픽의 일부를 돌리고 이미 파악한 모델로 폴백할 수 있게 해 주므로, 출시 표에 프로덕션 경로를 걸어 두지 않아도 됩니다. 그리고 Claude Code의 내장 도구를 쓰지 않고 이 패턴을 직접 구축한다면, 라우팅 DSL이 여러 모델을 하나의 호출로 구성합니다 — 한 모델에서의 계획 단계에 이어 다른 모델에서의 실행 단계가 하나의 엔드포인트 뒤에서 이어집니다.
범위에 관한 솔직한 참고 사항 하나: 어드바이저 도구 자체는 Anthropic의 API에서 실행되는 서버 측 도구이므로, 라우팅 레이어가 그것을 대체할 수는 없습니다. 우리가 할 수 있는 일은 모델을 정가로, 키 하나만 있으면 쓸 수 있게 만들어 두는 것뿐입니다. 따라서 어드바이저를 유지할지 버릴지는 본인의 숫자를 놓고 직접 결정하시면 됩니다.
자신의 워크로드에 맞게 결정하는 방법
Anthropic의 자체 지침은 올바른 출발점이며, 상쾌할 정도로 냉정합니다: 세 가지 구성 — 실행자 단독, 어드바이저와 함께하는 실행자, 낮은 노력의 어드바이저 모델 단독 — 에 대해 평가 스위트를 실행하고, 모든 모델 릴리스마다 재확인하세요. 릴리스는 능력 격차와 가격 비율을 모두 변화시키기 때문입니다. 그중 마지막이 능가해야 할 기준선입니다. 낮은 노력의 어드바이저 모델 단독이 루프와 같은 점수를 더 적은 비용으로 낸다면, 답이 나온 것입니다.
주목해야 할 두 변수는 Anthropic이 명명한 것들이다. 역량 격차: 실행자와 어드바이저 사이의 큰 격차는 어드바이저가 수수료를 버는 지점이며, Opus 5.5는 그 격차를 아래에서 좁혔다. 상담 비율: 이득은 그것과 거의 일대일로 따라가며, 프롬프트에 민감해 급감할 수 있다 — 낮은 노력의 실행자는 자신이 막혔다는 것을 인지하지 못하게 될 수 있고, 기본 노력에서 대부분의 작업에 상담하는 페어링은 거의 전무하게 떨어질 수 있다. Anthropic이 제공한 시스템 프롬프트는 실질적인 작업 전에 한 번, 끝내기 전에 한 번의 어드바이저 호출을 요청하며, 이는 작업당 2~3회의 상담에 해당한다. 3.5포인트 상승을 만들어낸 코딩 페어링은 그 주기로 실행되었다. 그에 대한 예산을 책정하고, 상한을 두고, 그 이상의 모든 상담은 작업이 어려웠다는 신호가 아니라 실행자가 잘못 구성되었다는 신호로 취급하라.
이 글에서 다루는 특정 루프의 경우, 세 가지 구체적인 설정이 대부분의 역할을 해냅니다. Claude Opus 5.5는 high로 올리기보다 기본값인 medium effort로 유지하세요. effort가 비용을 직접 좌우하고, Anthropic 자체의 Opus 5.5 수치에서도 medium이 거의 손해 보는 게 없다는 점이 드러나기 때문입니다. 그리고 어드바이저는 /advisor fable로 설정한 뒤 배너가 실제로 나타나는지 확인하세요. 배너가 없다는 것은 어드바이저가 조용히 빠져 있다는 뜻입니다. 또한 이 패턴을 확장하기 전에, 토큰당 가격이 아니라 완료된 작업당 토큰을 측정하세요. 그것이 바로 이 루프가 움직여야 하는 수치이기 때문입니다.
자주 묻는 질문
어드바이저는 Fable 세션과 동일한 Fable 허용량을 소모하나요?
API 청구에서는 어드바이저 토큰이 Fable 5.1 자체의 입력 및 출력 요율로 청구되며, 어드바이저 속도 제한은 해당 모델에 대한 직접 호출과 동일한 모델별 버킷에서 가져옵니다. 따라서 속도 제한에 걸린 어드바이저 호출은 요청을 실패시키는 대신 도구 결과 내부에 오류로 나타납니다. 구독 요금제에서는 어드바이저 사용량이 요금제의 사용 한도에 포함됩니다. 단, Fable 어드바이저는 Fable 사용량이 사용 크레딧으로 청구되는 요금제에서 사용 크레딧으로 청구됩니다. 실질적인 결과는 어드바이저가 자유롭게 사용할 수 있는 별도의 예산이 아니라는 것입니다. 어드바이저는 해당 모델에서 하는 다른 모든 작업과 경쟁합니다.
어드바이저는 실제로 무엇을 볼 수 있나요?
전체 대화, 모든 도구 호출과 모든 도구 결과를 포함해서 — 파일 내용, 명령 출력, 오류 메시지, 그 모든 것까지. 그것은 Anthropic이 제공하는 자체 시스템 프롬프트 아래에서 실행되며 계획, 수정 또는 중지 신호를 반환합니다. 여기서 두 가지 세부 사항이 따릅니다. 첫째, 각 자문은 전체 트랜스크립트를 다시 읽습니다. 그래서 비용이 평평하게 유지되는 대신 루프에 따라 증가합니다. 둘째, 세션이 자문의 가격 등급에서 두 번째 모델에 보내지 않을 자료를 다룬다면, 그 자문은 그 모든 것을 읽는 두 번째 모델입니다.
답을 바꾸는 것은 무엇인가?
두 가지입니다. 그리고 둘 다 보이는 것보다 가깝습니다. 독립 벤치마커들이 Opus 5.5와 Fable 5.1의 동일 노력 조건 실행을 공개하고 Anthropic이 주장하는 격차 축소를 확인해 준다면, 대부분의 작업에서 어드바이저의 남은 우위는 미미합니다. 그러면 루프는 기본값이 아니라 어려운 꼬리 영역을 위한 도구가 됩니다. 반대로 자문 비율이 유지되고 긴 에이전트 작업에서 능력 격차가 여전히 크다면, 위의 계산이 바로 당신이 선택해야 할 대상이며, $14 실행에서 $6의 자문은 잘못된 것을 출시하지 않기 위한 값싼 옵션입니다.
변하지 않을 것은 이 글 맨 위에 있는 메커니즘이다. 실행자 컨텍스트는 캐시되어 저렴하고, 어드바이저 컨텍스트는 캐시되지도 않고 저렴하지도 않다. 작업 도중 더 비싼 모델에 자문하는 모든 루프는 다음 달 가격표에 무엇이 적혀 있든 그 비대칭성을 그대로 물려받는다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
