
Claude Sonnet 5.5 vs Claude Fable 5.1: 저렴한 모델이 3점 앞선다
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 983 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 196 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
Claude Sonnet 5.5는 2026년 9월 28일에 출시되었으며, 입력 토큰 100만 개당 $2.00, 출력 토큰 100만 개당 $10.00입니다. 공급업체가 9월 1일에 출시한 Mythos급 모델인 Claude Fable 5.1은 같은 두 항목에서 $10.00과 $50.00에 책정되어 있습니다. 매혹적인 요약은 Fable 5.1이 더 비싼 모델이므로 더 나은 모델이라는 것이지만, Artificial Analysis Intelligence Index에서는 순서가 반대입니다: Claude Sonnet 5.5는 56점, Claude Fable 5.1은 53점을 기록합니다. 이는 반올림 오류가 아니며, 전부는 아닙니다. 왜냐하면 동일한 평가자가 동일한 스위트에서 두 모델을 작업당 3센트 이내로 평가하기 때문입니다 — $7.60 대 $7.63. 요금표상의 5배 차이는 작업이 완료될 때쯤이면 거의 사라집니다. 남는 것은 점수보다는 형태의 차이이며, 이 둘 중 하나를 선택하는 것은 주로 워크로드가 어떤 형태인지의 문제입니다.
두 개의 요금표, 그리고 그 격차가 다섯 배가 아닌 단 한 줄
토큰별 비교는 극명하며 별도의 해석이 필요 없다.
• 입력 — 백만 토큰당 $2.00인 Claude Sonnet 5.5 대 $10.00인 Claude Fable 5.1, 5배 차이
• 출력 — 백만 개당 $10.00 대 $50.00, 이번에도 정확히 5배
• 캐시 읽기 — 백만 개당 $0.25 대비 $0.20. 이 항목이 장시간 에이전트 실행을 지탱하는 부분이며, 할인율은 5배에서 20%로 급감합니다
• 캐시 쓰기 — 표준 5분 윈도우 기준 백만 개당 $2.50 대 $12.50으로, 두 카드 중 어느 쪽에서든 가장 큰 단일 격차
• Batch — Anthropic의 배치 모드는 Fable 5.1에 적용되는 방식처럼 이 두 카드에는 적용되지 않습니다. Fable 5.1은 배치 가격이 절반으로 줄어 입력 $5.00, 출력 $25.00으로 출시되었습니다. 이 제품군 전체에 적용된다고 가정하기 전에 Anthropic 자체 가격 페이지에서 배치 관련 항목을 확인하세요
• 컨텍스트와 상한 — 둘 다 1,000,000 토큰의 컨텍스트와 128,000 토큰의 최대 출력을 제공합니다. Message Batches API에서 Claude Sonnet 5.5는 output-300k-2026-03-24 베타 헤더를 통해 최대 300,000 출력 토큰을 지원하는데, 이는 대량 생성에 있어 실질적인 상한 차이이며 마케팅상의 차이가 아닙니다
Claude Sonnet 5.5에 유리한, 요금표가 과소평가하는 작은 점이 하나 있다. Anthropic은 이 모델이 같은 작업을 수행하는 데 일반적으로 전작보다 훨씬 적은 토큰이 필요하다고 보고하며, 이는 작업당 비용이 최대 30% 더 적어지는 것으로 이어진다고 말한다. 그것은 다른 비교, 즉 Sonnet 5.5 대 Sonnet 5에 관한 공급업체의 주장이며, 이번 맞대결에 관한 증거는 아니다. 그러나 그것은 독립적인 측정이 발견한 내용을 설명하는 메커니즘이다.
5배 가격 격차는 어디로 가는가
Artificial Analysis는 2026-09-29에 단일 하네스와 하나의 구성 레이블인 "Adaptive Reasoning, Max Effort, Default Fallback" 아래에서 두 모델을 Intelligence Index v4.3으로 실행했습니다. 두 핵심 수치는 Claude Sonnet 5.5가 56, Claude Fable 5.1이 53입니다 — 더 저렴한 모델이 약 3점 앞서 있는데, 이는 같은 평가자가 중간값 모델을 26에 위치시키는 척도에서입니다. 둘 다 같은 페이지에서 벤더명 모델로 표기되어 있으므로, 이는 두 개가 아니라 하나의 측정 도구와 하나의 스냅샷입니다.
그다음은 비용 열, 그리고 이 조합이 뻔하지 않고 흥미로운 이유입니다. 동일한 인덱스 실행에서 Claude Sonnet 5.5는 작업당 $7.602633이고 Claude Fable 5.1은 $7.629706입니다. 0.027달러 차이입니다. 분해해 보면 이상해집니다: Claude Fable 5.1의 입력 측만 작업당 $3.73인 반면, Sonnet 5.5의 입력 구성 요소는 훨씬 작습니다. 그리고 추론 토큰만 작업당 $2.36입니다. 토큰당 다섯 배 더 저렴한 모델이 완성된 작업당으로는 전혀 더 저렴하지 않습니다.
원인은 볼륨이며, 두 모델은 서로 반대 방향으로 실패한다.
• 인덱스 스위트 전반의 출력 토큰 — Claude Sonnet 5.5는 Claude Fable 5.1의 188,465,663에 대비해 410,577,501을 생성했으며, 이 스위트에서 추적된 중앙값은 8,800만입니다. 둘 다 중앙값을 크게 웃돕니다. Sonnet 5.5는 Fable 5.1의 두 배가 넘고 중앙값의 거의 다섯 배입니다.
• 작업당 출력 토큰 — Sonnet 5.5는 192,838, Fable 5.1은 78,111이며, 추론 비중은 142,386 대 47,240입니다. Sonnet 5.5는 작업당 대략 세 배 더 오래 사고합니다
• 인덱스 스위트 전반의 입력 토큰 — Sonnet 5.5는 185억 개로, Fable 5.1의 56억 개와 대비된다. Sonnet 5.5가 세 배나 더 많이 읽었다는 것인데, 이는 이 쌍에서 더 조용한 숫자이자 더 저렴한 입력 단가를 갉아먹는 숫자다.
• 입력, 캐시 읽기, 출력이 7:2:1로 혼합된 구성에서의 혼합 가격 — Sonnet 5.5는 $1.54인 반면 Fable 5.1은 $7.17입니다. 이것은 요율표와 일치하는 항목이며, 짧고 범위가 잘 한정된 출력을 가진 워크로드를 설명하는 항목입니다.
이것들을 종합하면 솔직한 말은 이렇습니다: 혼합 가격 격차는 실재하지만 작업당 격차는 그렇지 않습니다. 두 숫자 중 어느 것이 귀하의 청구서를 설명하는지는 전적으로 귀하의 작업이 종료되는지 아니면 질질 끄는지에 달려 있으며, index suite는 작업이 질질 끌도록 만들어졌습니다.
노력 사다리가 곧 실제 결정이다
두 모델 모두 effort 파라미터 — low, medium, high, xhigh, max — 를 제공하며, 둘 다 2026-09-29에 모든 단계에서 측정되었습니다. 이는 어떤 요금표로도 표현할 수 없는 비교의 일부입니다. 왜냐하면 저렴한 모델이 더 낮은 단계에서 비싼 모델보다 훨씬 큰 격차로 앞서고, 비싼 모델은 최상위 근처에서만 차별화되기 때문입니다.
• 낮은 노력 — Claude Sonnet 5.5는 작업당 $0.41로 35.84점을 기록하고, Claude Fable 5.1은 $2.37로 46.82점을 기록한다. 최하위 구간에서는 비싼 모델이 거의 6배의 비용으로 11점 앞선다.
• 중간 수준 노력 — $0.59에 40.74, $2.98에 48.92. Fable 5.1은 다섯 배의 비용으로 8점 앞선다
• 높은 노력 — $1.08에서 46.74, $3.91에서 51.15. 격차는 4.5점으로 좁혀지고, 비용 비율은 약 3.6배로 유지된다.
• Xhigh 노력 — $2.74에 51.85 대 $5.98에 53.20. 1과 3분의 1점 차이, 가격의 46%로
• 최대 노력 — $7.60에서 55.98 대 $7.63에서 53.35. 순서가 역전되고 비용은 0.5% 이내로 수렴한다
네 번째와 다섯 번째 행을 함께 읽으면 이 맞대결의 윤곽이 드러난다. xhigh에서 Claude Sonnet 5.5는 51.85를 기록한다 — 어떤 노력 수준에서든 Claude Fable 5.1의 최고 점수와 1.5 인덱스 포인트 이내이며 — 작업당 $2.74로 $7.63에 맞선다. 당신의 작업이 최전선에 정확히 있기보다 최전선 근처에 있으면 된다면, 그 행이 답 전부이며 완료된 작업당 64%를 절약한다. Sonnet 5.5를 max까지 밀어붙이면 2.8배 비용으로 3점을 더 사는 셈이고, 그러면 Fable 5.1의 max와 같은 청구액에 도달하면서 점수는 약간 더 나아지고 추론 프로필은 매우 달라진다.
그 마지막 문장은 확실히 짚고 넘어갈 가치가 있다. 두 번 확인해 볼 만큼 직관에 반하기 때문이다. 최대 노력을 동일하게 맞췄을 때, 요금표가 다섯 배 더 저렴한 모델은 작업당 비용이 요금표가 비싼 모델과 같다. 그 모델은 출력 토큰을 2.5배 더 많이 생성함으로써 그 지점에 도달하는데, 그중 추론이 차지하는 비중은 세 배 더 크다. Anthropic 자체 문서는 이 메커니즘의 일부를 설명한다. 토크나이저가 바뀌었고, 같은 텍스트가 이전 모델들보다 Claude Sonnet 5.5에서 약 30% 더 많은 토큰을 생성한다는 것이다. 이는 여러 기여 요인 중 하나이며, 출력 토큰 수는 그렇다고 밝히지 않고서는 토크나이저 리비전 간에 비교할 수 없다는 유용한 알림이다.
지연 시간은 두 가지가 서로 닮기를 멈추는 지점이다
점수 수렴은 시간까지 확장되지 않는다. 같은 2026-09-29 스냅샷에서 Artificial Analysis는 긴 프롬프트 슬라이스 기준으로 Claude Fable 5.1의 첫 토큰까지 걸리는 시간이 254.41초, Claude Sonnet 5.5가 2.80초라고 보고하며, 중앙값 출력 속도는 각각 초당 67.9개와 49.4개 토큰이다. 이는 호출자가 무언가가 도착하기 전에 기다리는 시간에서 두 자릿수(100배) 차이이며, 이 비교에서 운영상 가장 중대한 단일 수치이다.
두 수치 모두 해당 한정 조건을 분명히 밝혀야 한다. Fable 5.1의 TTFT는 긴 프롬프트 유형에서 측정된 값이다. 같은 날 같은 모델에 대한 평가자의 중간 프롬프트 슬라이스는 117.60초이므로, 254초라는 수치는 꼬리값이지 상수가 아니다. Sonnet 5.5의 2.80초는 전체 중앙값이며, 평가자 자체의 변동 범위는 5백분위의 1.91초에서 95백분위의 4.23초까지 이어진다. Anthropic의 플랫폼 문서는 Fable 5.1의 상대적 지연 시간을 더 느리다고, Sonnet 5.5의 지연 시간을 빠르다고 설명하는데, 이는 측정값은 아니지만 방향성은 일치한다.
우리 자체 인프라는 세 번째 해석을 제공합니다. 왜냐하면 우리는 Claude Fable 5.1을 라우팅하고 우리가 제공하는 것을 측정하기 때문입니다. 9월 28일까지의 7일 동안, OrcaRouter 자체 트래픽에서 Claude Fable 5.1은 중앙값 첫 토큰 6,973밀리초, 95번째 백분위수 10.0초, 출력 속도 초당 65.8토큰, 오류율 0.349%를 기록했습니다. 그 p50은 평가자의 긴 프롬프트 수치보다 100배 이상 빠른데, 이는 모순이라기보다 용어 정의에 가깝습니다: 짧은 프롬프트에 대한 개발자 대상 첫 토큰과 긴 프롬프트에 대한 벤치마크의 첫 토큰은 서로 다른 것을 측정한 것입니다. 리더보드 수치를 기준으로 계획하는 사람이라면 자신이 어느 쪽을 구매하는지 알아야 합니다.

소싱의 정직성, 리텐션, 그리고 아무도 언급하지 않는 마이그레이션
벤더 벤치마크 표와 독립 평가는 서로 다른 측정 도구이며, 결코 서로에서 빼서 비교해서는 안 됩니다. Anthropic 자체의 Claude Sonnet 5.5 출시 표는 Terminal-Bench 4.0을 70.6%로 보고합니다. 자체 하네스를 돌리는 Artificial Analysis는 같은 이름의 평가에서 동일 모델에 대해 63.6%를 보고합니다. Claude Fable 5.1에서는 차이가 반대 방향으로 나타납니다. Anthropic은 출시 당시 55.8%를 보고했고, 독립 하네스는 52.0%를 기록합니다. 어느 쌍도 서로를 보정한 것이 아닙니다. 각각을 나름의 기준으로 판단하고, 프로덕션 트래픽을 어디로 보낼지 결정할 때는 독립적인 쪽을 선호하세요.
보존 태세도 다르며, 이는 조달 검토에서만 드러나는 종류의 차이입니다. Anthropic은 Claude Sonnet 5.5가 제로 데이터 보존으로 제공된다고 밝히며, 이는 Opus 5.5와 Sonnet 5에서 취했던 것과 같은 태세입니다. Claude Fable 5.1의 출시 자료는 그와 함께 적용되는 점진적 데이터 사용 정책과 Project Glasswing 아래에서 안전 모니터링을 위해 기본 30일 보존 기간을 적용하는 별도 배포를 설명하며, 제로 보존 방식은 임시 상태로 설명됩니다. 귀하의 팀이 데이터 처리 검토에 답해야 한다면, 그 구분은 각주가 아니라 실제 항목이며, 이 요약을 포함해 어떤 요약보다 Anthropic의 현재 정책 페이지를 직접 읽을 가치가 있습니다.
마이그레이션 비용은 출시 보도에는 좀처럼 드러나지 않는 방식으로 비대칭적이다. Claude Sonnet 5.5로 옮기는 것은 모델 문자열 변경이 아니다. Anthropic의 마이그레이션 가이드에 따르면, 이제 기본값이 아닌 temperature, top_p 및 top_k 값은 400 오류를 반환하고, tool_choice가 any이거나 이름이 지정된 도구이면 곧바로 거부되며, 사전 thinking을 끈 상태로 실행 중이었다면 thinking: {"type": "disabled"}가 between_tools가 되어야 한다. between_tools 유형은 low, medium, high effort에서 허용되고 xhigh 또는 max에서는 400을 반환한다. Claude API와 Google Cloud에서 computer use는 computer_toolset_20260801 도구셋을 통해서만 지원되며, 이전 computer_20251124는 거부된다. 이런 것 중 어느 것도 Claude Fable 5.1로 옮기는 데에는 적용되지 않는다. Claude Fable 5.1은 Fable 5에서 같은 계열로 올라가는 업그레이드이며 자체적인 호환성 깨는 변경 세 가지가 있다. 두 모델을 병렬 마이그레이션 대상으로 저울질하고 있다면, 채택하기에 더 비싼 쪽은 더 저렴한 모델이다.

어느 것을 어디에 둘까요
숫자에서 도출되는 결정은 트래픽 중 얼마나 많은 부분이 적절히 범위가 설정되어 있는지에 관한 결정이다.
• 범위가 정해진, 대용량, 도구 기반 작업 — Claude Sonnet 5.5, 최전선에 가까워야 한다면 xhigh 노력 수준에서. 이 모델은 Fable 5.1의 최고 성능보다 1.5 인덱스 포인트 뒤처지지만 완료된 작업당 비용은 64% 더 저렴하고, 첫 토큰을 약 3초 만에 반환하며, 더 저렴한 캐시 쓰기 라인 덕분에 재구성된 컨텍스트 프리픽스를 감당할 수 있습니다
• 장기적이고 개방형인 작업으로, 잘못된 답변이 큰 대가를 치르게 하는 경우 — Claude Fable 5.1. 이는 동일한 작업당 비용으로 Sonnet 5.5의 최대 점수와 일치하면서도 추론 토큰은 3분의 1, 입력은 4분의 1로 그 지점에 도달하는데, 이는 작업이 진정으로 개방형이고 평가 스위트의 형태가 여러분의 문제와 유사할 때 중요합니다
• 지연 시간에 묶인 대화형 인터페이스 — Claude Sonnet 5.5, 그리고 이건 접전이 아니다. 평가자 자체 스냅샷에서 첫 토큰 격차는 긴 프롬프트 유형에서 100배에 달하며, 중간 프롬프트 측정값은 이를 약 118초로 좁힐 뿐이다. 채팅 인터페이스는 Fable 5.1 수치에 기대면서 배치 처리나 스트리밍으로 우회하지 않고서는 구축할 수 없다.
• 긴 출력을 사용하는 대량 생성 — Claude Sonnet 5.5. output-300k-2026-03-24 헤더를 통해 사용할 수 있는 Message Batches API에서는 300,000토큰 출력 상한을 제공하지만, 다른 모든 환경에서는 128,000토큰 상한이기 때문입니다. 커밋하기 전에 배치 가격을 확인하세요. 배치 요금은 두 카드에서 동일하지 않습니다.
• 계정을 넘나들거나 시스템 간에 추론을 넘겨야 하는 작업 — 둘 중 어느 쪽이든 하기에 앞서 Anthropic의 보존된 사고(preserved-thinking) 문서를 읽어 보라. 사고 블록은 이를 생성한 모델과 계정에 묶여 있으며, Sonnet 5.5는 추론 추출을 방지하는 분류기를 함께 제공하는 최초의 Sonnet이다. 이는 동시에 규정 준수 기능이자 제약이다
• 규제 대상 또는 보존 민감 워크로드 — 출시 적용 범위가 아니라 현재 정책을 확인하십시오. Claude Sonnet 5.5는 제로 데이터 보존이 가능한 상태로 출시되었습니다; Fable 5.1의 자료는 한 배포에서 기본 30일 기간을 두는 점진적 정책과 제로 보존을 중간 단계로 설명합니다

OrcaRouter에서는 Claude Fable 5.1과 Claude Sonnet 5가 모두 하나의 자격 증명 뒤에 있으며 기준으로0% 마크업이 붙은 공급자 정가, 따라서 두 모델 사이를 전환할 때 청구서를 움직이는 것은 캐시 읽기 항목과 토크나이저 변경뿐입니다. Claude Sonnet 5.5는 아직 저희 플랫폼의 라우트가 아닙니다 — 이 모델은 나온 지 하루밖에 되지 않았습니다 — 그러므로 솔직히 말하자면 오늘은 Anthropic 자체 API를 통해 접근하게 됩니다. 저희를 통해 Fable 5.1을 운영하는 누구든, 통합의 다른 어떤 것도 바꾸지 않고 출시되는 날 전환 비용을 산정할 수 있으며, 그동안 공급자 간 자동 장애 조치가 바로 이렇게 새로운 모델을 반드시 가동 상태를 유지해야 하는 경로에서 안전하게 시도할 수 있게 해주는 것입니다.
평결은 가격 격차가 시사하는 것보다 좁다. Claude Sonnet 5.5는 범위가 정해진 거의 모든 작업에서 더 나은 기본값이다. 독립 지수에서 3점 더 높고, 몇 초 만에 답하며, xhigh에서는 Fable 5.1의 상한선에 1.5점 이내로 들어오면서도 작업당 비용은 절반을 훨씬 밑돈다. Claude Fable 5.1에는 여전히 하나의 실질적인 논거가 남아 있고, 그것은 Anthropic 자체 비교표가 제시하는 바로 그 논거다. 작업이 개방형이고 틀렸을 때의 비용이 더 오래 생각하는 비용보다 클 때, 입력 가격이 다섯 배라는 점은 거기에 도달하기 위해 추론 토큰을 세 배로 쓰지 않고도 동일한 점수에 도달하는 모델을 사는 셈이다. 작업의 형태를 기준으로 고르세요, 요금표의 크기가 아니라. 노력 사다리의 꼭대기에서는 그 두 모델이 당신에게 같은 요금을 청구하기 때문이다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
