Claude Opus 5.5 대 Claude Fable 5.1을 위한 생성된 타이틀 카드로, 부제는 '더 저렴한 모델이 독립 지수에서 승리했다'이며, 실제 OrcaRouter 로고가 우측 하단에 합성되어 있고, 하단 문구는 '지수는 최대 노력 기준 Artificial Analysis 제공, 가격은 Anthropic 제공.'
Guides & Insights

Claude Opus 5.5 vs Claude Fable 5.1: 더 저렴한 모델이 독립 지수에서 승리했다

작성자

Magnus Corvin

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Anthropic은 이제 자사 라인업 최상단에서 두 개의 모델을 판매하고 있는데, 가격이 2.5배 더 비싼 쪽이 순위표 맨 위에 있는 모델은 아니다. Claude Opus 5.5는 2026년 9월 22일 출시되었고 입력 100만 토큰당 4달러, 출력 100만 토큰당 20달러에 Artificial Analysis Intelligence Index에서 58점을 기록한다. Claude Fable 5.1은 9월 1일부터 플래그십 자리를 지켜왔으며 입력 10달러, 출력 50달러에 53점을 기록한다. 두 수치 모두 같은 평가 기관에서 나왔고, 같은 구성 계열에서 측정되었으며, 격차는 가격표와 반대 방향으로 벌어진다. 이것이 이 비교가 출발해야 할 사실이다. 지난 한 주 동안 나온 거의 모든 출시 기사가 Opus 5.5를 Fable 5.1의 할인판 — 대부분의 작업에서 비싼 모델과 "동등한" 더 저렴한 모델 — 으로 묘사하고 있기 때문이다. 독립적인 수치는 그 할인 모델이 앞서 있다고 말한다.

그것이 배포할 대상을 바꿔야 하는지는 별개의 문제이며, 그 답은 5점 차이보다 헤드라인에 아무도 넣지 않는 두 가지 설정, 즉 각 모델이 기본값으로 두는 노력 수준과 어느 쪽을 빠르게 만들 수 있는지에 더 좌우된다.

독립적인 숫자들, 그리고 그것들이 공유하는 단 하나의 것

A two-column scoreboard comparing Claude Opus 5.5 and Claude Fable 5.1 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 53, ranked #4), price in and out ($4.00 / $20.00 per million against $10.00 / $50.00), context window (1M tokens on both), default effort (medium against high), knowledge cutoff (Jun 2026 on both) and fast mode (supported at $8.00 / $40.00 against not supported). The footer reads 'Index figures per Artificial Analysis at max effort; prices, effort defaults and fast-mode support per Anthropic.'

Artificial Analysis는 모델당 하나의 구성을 게시하며, 이 두 모델 모두에 대해서는 이를 “적응형 추론, 최대 노력, 기본 폴백”이라고 표기합니다. 동일한 라벨, 동일한 평가자, 동일한 실행 — 이로써 이번 비교는 두 모델이 각각 가진 맞대결 중 가장 깔끔한 맞대결이 됩니다:

• Intelligence Index — Claude Opus 5.5 58, 210개 중 1위 vs Claude Fable 5.1 53, 4위

• 출력 속도 — Claude Fable 5.1 65.8 토큰/초로, 71.0인 게시판 중앙값보다 낮음 vs Claude Opus 5.5는 아직 게시판에 공개되지 않음

• 첫 토큰까지 걸리는 시간 — Claude Fable 5.1 274.43초 vs 보드 중앙값 3.83초; Claude Opus 5.5는 아직 게시되지 않음

• 지수의 장황함 — Claude Opus 5.5는 2억 6천만 개의 출력 토큰을 생성했으며, 전체 중앙값은 8,800만 개였습니다

• 가격 — Claude Opus 5.5 백만당 $4.00 / $20.00 vs Claude Fable 5.1 백만당 $10.00 / $50.00

그 행들 중 두 개는 인용하기보다 읽어봐야 한다. 첫 번째는 "Max Effort" 레이블이다. 어느 모델의 점수도 출시 기본값을 반영하지 않으며, 두 기본값은 서로 같지 않다. 자세한 내용은 아래에서 다룬다. 두 번째는 장황함 행으로, 이는 Opus 5.5가 판매되어 온 방식과 어긋난다. Anthropic의 효율성 이야기는 모델이 더 적은 토큰으로 같은 답에 도달한다는 것이며, 출시 자료는 출력 토큰이 3분의 1에서 절반까지 줄었다고 보고한 파트너들을 인용한다. Index에서, 인용된 수치가 아니라 측정된 수치로 보면, Opus 5.5는 260M 토큰을 생성했으며 이는 보드 중앙값 88M과 대비된다. 비교 대상인 일반적인 모델보다 대략 세 배 더 말이 많았던 것이다. 두 가지 모두 사실일 수 있다. Claude Opus 5보다 토큰을 더 적게 사용하면서도 절대적인 기준에서는 장황한 모델일 수 있다. 하지만 "더 적은 토큰"이라는 문구를 기준으로 예산을 잡았고 자신의 청구서를 기준으로 하지 않았다면, 확인해야 할 것은 독립적인 측정치다.

백만 개당 추가 $6로 얻을 수 있는 것

A screenshot of Anthropic's Claude Platform Docs page for Claude Opus 5.5 showing its 'How it compares' table: Claude Fable 5.1 and Claude Opus 5.5 both at 1M context and 128K max output with a Jun 2026 cutoff, Fable 5.1 at $10 / $50 with high default effort and slower latency against Opus 5.5 at $4 / $20 with medium default effort and moderate latency, with Claude Sonnet 5 at $2 / $10 and a Jan 2026 cutoff and Claude Haiku 4.5 below them. The Opus 5.5 pricing panel underneath lists $4 input, $20 output, $5 and $8 cache writes, $0.20 cache read and a 50% batch discount.

벤치마크를 걷어내고 나면 남는 차이라곤 요금표뿐이다. 여기 있는 모든 내용은 Anthropic이 공개한 가격 페이지에서 가져온 것으로, 오늘 직접 확인할 수 있다:

• 입력 — Opus 5.5에서는 백만당 $4.00, Fable 5.1에서는 $10.00

• 출력 — 백만 개당 $20.00 대 $50.00

• 캐시 읽기 — Opus 5.5는 백만 개당 $0.20, Fable 5.1은 $0.25

• 캐시 배수 — Opus 5.5는 캐시 적중을 기본 입력의 0.05배로 청구하고, Fable 5.1은 0.025배로 청구하여 더 높은 기본 단가에 더 나은 배수를 적용합니다

• 캐시 쓰기 — Opus 5.5에서는 5분 창 기준 백만당 $5, 1시간 기준 $8이며, Fable 5.1에서는 $12.50과 $20입니다

• Batch API — Opus 5.5는 $2.00 / $10.00으로 절반, Fable 5.1은 $5.00 / $25.00으로 절반

• 빠른 모드 — Opus 5.5는 최대 약 2.5배의 출력 속도를 위해 $8.00 / $40.00에 이를 지원합니다; Fable 5.1은 빠른 모드를 전혀 지원하지 않습니다

캐시 라인은 두 번 살펴봐야 할 항목이다. 두 모델이 일반적인 패턴을 뒤집기 때문이다. Fable 5.1이 더 공격적인 배수를 가진다 — 기본 입력의 2.5%로 Opus 5.5의 5%와 대비된다 — 하지만 기본 요금이 $4가 아니라 $10이기 때문에, 캐시 읽기는 여전히 절대 달러 기준으로 둘 중 더 비싸다. 프리미엄 모델이 캐시된 컨텍스트 토큰에서 이기는 구성은 존재하지 않는다. 그리고 그 배수는 이식할 수 있는 것이 아니다: Fable 5.1의 캐싱 동작에 맞춰 조정된 에이전트 루프는 신선한 토큰당으로는 더 적게 지불하더라도, Opus 5.5에서는 캐시 적중당 비례적으로 더 많은 비용을 지불하게 된다.

패스트 모드가 더 뚜렷한 비대칭이다. Anthropic의 문서에는 Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8의 패스트 모드가 나열되어 있는데, Fable 5.1은 그 목록에 없다. 따라서 더 저렴한 모델은 비싼 모델에는 아예 없는 지연 시간 레버를 $8/$40에 갖추고 있으며, 이는 여전히 Fable 5.1의 표준 $10/$50 출력 요율보다 낮다. 워크로드가 충분히 인터랙티브해서 느린 첫 토큰이 제품 문제가 된다면, Fable 5.1의 측정된 첫 토큰까지의 시간이 274초라는 점을 기억해 두라. 그 수치는 최대 노력 추론의 부산물이지 결함이 아니지만, 평가자가 기록한 수치이기는 하다.

기본값은 동일하지 않으며, 바로 그것이 함정입니다.

Anthropic 자체 모델 문서는 두 모델을 나란히 비교하고 있는데, 대부분의 실제 비교를 결정짓는 항목은 가격이 아닙니다. 바로 기본 노력 수준입니다: medium은 Claude Opus 5.5, high는 Claude Fable 5.1입니다. 둘 다 끌 수 없는 적응형 사고를 실행하며, 깊이는 effort 파라미터를 통해서만 제어되는데, 그 범위는 low, medium, high, xhigh, max입니다.

이것이 출시 문구 "Opus 5.5가 대부분의 작업에서 Fable 5.1과 맞먹는다"와 그 아래에 있는 벤치마크 표가 서로 어긋나 보이는 이유입니다. Anthropic의 Opus 5.5 일대일 비교 행은 기본값보다 더 높은 effort 설정으로 표시되는 경우가 많습니다 — Fable 5.1의 55.8%에 맞선 Terminal-Bench 4.0의 66.4% 수치는 medium이 아니라 xhigh effort에서 실행되었습니다. 반면 Fable 5.1 자체의 수치는 더 높은 기본값에서 산출되었습니다. 서로 다른 effort 설정에서 비교된 두 모델은 전혀 비교되고 있는 것이 아니며, Anthropic은 자체 출시 자료에서 이 능력 수준의 벤치마크 격차가 점수가 시사하는 것보다 현실 세계의 차이를 판단하는 데 덜 신뢰할 만한 지침이라고 경고하면서 바로 그 점을 인정합니다.

실질적으로, 이는 그 결정을 선택이 아니라 튜닝 작업으로 바꿔 놓습니다. Fable 5.1에서 Opus 5.5로 옮기면서 effort 설정을 그대로 가져가면, 모델이 수행하는 사고의 양을 조용히 바꾼 셈이 되고, 그 이후에 산출하는 모든 품질 및 비용 수치는 교란됩니다. Anthropic의 지침은 이전 모델의 설정을 그대로 옮기는 대신 여러 effort 수준을 테스트하라는 것입니다. 그렇게 하는 데는 비용이 거의 들지 않지만 거의 아무도 하지 않습니다. 자체 평가를 두 번 돌려야 하기 때문입니다.

그 페어링이 제값을 하는 단 한 곳

둘 다 유지하는 것을 정당화하는 패턴은 어드바이저 루프입니다: Opus 5.5가 작업을 수행하고, Fable 5.1이 어려운 결정에 대해 자문을 제공합니다. Anthropic이 이를 측정했고, 이는 실제로 정확도를 높여줍니다 — 더 높은 비용과 더 높은 지연 시간을 대가로, 이는 더 느린 모델을 루프에 넣을 때 예상할 수 있는 트레이드오프입니다. 달라진 것은 그 뒤의 계산법입니다. 능력 격차가 더 컸을 때는 $5/$25 작업자를 감독하기 위해 $10/$50를 지불하는 것이 분명히 가치가 있었습니다. 이제 작업자가 독립 지수에서 어드바이저를 앞서면서, 어드바이저의 기여는 자체 평가에서 Opus 5.5를 능가하는 특정 작업으로 좁혀지며, 그 작업들은 직접 식별해야 하는 것들입니다. 이 루프는 어려운 하위 집합에는 여전히 타당하지만, 일괄 구성으로서는 더 이상 타당하지 않습니다.

둘 다 키 하나만 누르면 된다

여기서 팀들을 당황하게 만드는 마이그레이션의 핵심은 API 표면이 아니라, 이것들이 같은 벤더의 모델이면서도 서로 다른 effort 스케일, 서로 다른 캐시 배수, 서로 다른 기본 설정을 갖고 있다는 점이며, 이들을 정직하게 비교하려면 동일한 구성에서 두 모델 모두를 자체 프롬프트로 실행해 보는 것을 뜻합니다. Claude Opus 5.5는 OrcaRouter에서 Anthropic 자체 가격인 $4.00 / $20.00에, 그리고 Claude Fable 5.1은 OrcaRouter에서 $10.00 / $50.00에 제공됩니다 — 공급자 정가를 0% 마크업으로 그대로 전달하므로, 두 숫자 모두 Anthropic이 가격을 바꾸는 날 함께 바뀌며 어느 쪽도 별도의 계약이나 별도의 SDK를 요구하지 않습니다.

A screenshot of OrcaRouter's own model page for anthropic/claude-fable-5.1, headed 'Claude Fable 5.1' and credited to Anthropic, showing $10.00 input and $50.00 output per 1M tokens and a PERFORMANCE panel with 65.8 output tokens per second, a 274.43s time to first token, 88M output tokens over 7 days and a 0.00% error rate.

그것이 이 분할을 이론이 아니라 실용적으로 만드는 것입니다. 트래픽의 대부분을 Opus 5.5로 보내고, 진정으로 어려운 사례를 Fable 5.1로 에스컬레이션하는 라우팅 규칙을 고정하는 것은 두 개의 통합이 아니라 하나의 엔드포인트에서의 구성입니다 — 그리고 한 모델이 초안을 작성하는 동안 다른 모델이 검증하도록 호출을 구성하는 것은 구축하고 유지해야 하는 파이프라인이 아니라 라우팅 DSL 한 줄입니다. 에스컬레이션 경로가 당신의 워크로드에 잘못된 것으로 판명되면, 자동 장애 조치가 요청을 완전히 실패시키는 대신 이미 특성을 파악한 모델에 도착하게 유지합니다.

무엇이 그것을 해결할까요?

이 비교의 솔직한 현실은 이렇습니다. Anthropic은 더 저렴한 모델이 대부분의 행에서 승리하는 표를 하나 공개했고, Artificial Analysis는 그것이 완전한 승리를 거두는 또 다른 표를 공개했으며, 두 표 모두 여러분이 실제로 배포하지 않는 effort 설정에서 실행되었습니다. 어느 쪽도 동일한 기본값에서 맞붙인 통제된 정면 비교가 아니며, 제3자가 그런 비교를 수행한 적도 없습니다. 그 모든 것을 거치고도 남는 격차, 즉 Claude Opus 5.5가 요금표의 모든 항목에서 실질적으로 더 저렴하고, Fable 5.1이 지원하지 않는 패스트 모드를 지원하며, 두 모델이 가진 유일한 독립 점수에서도 뒤처지지 않는다는 점은 입증 책임이 넘어갈 만큼 충분히 큽니다. 기본적으로 Fable 5.1을 사용하고 있다면, 이제 질문은 Opus 5.5가 충분히 좋은지가 아니라, 여러분의 워크로드에서 어떤 구체적인 작업이 medium effort에서 실패하는지입니다. 왜냐하면 그것들이야말로 여러분이 프리미엄을 지불하고 있는 유일한 대상이기 때문입니다.

이 글에서 비교한 모델2

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트