
Claude Fable 5.1 vs Claude Fable 5: Anthropic의 자체 플래그십 리프레시가 실제로 무엇을 가져오는가
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240지능72코딩
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0340지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2134지능69코딩
Claude Fable 5.1은 2026년 9월 1일에 출시된 Anthropic의 현재 플래그십이며, 대부분의 팀에게 가장 중요한 맞대결은 Anthropic이 스스로 만들어 낸 구도, 즉 Claude Fable 5.1과 그것이 대체하는 6월 9일의 플래그십 Claude Fable 5의 대결입니다. 가격은 동일합니다. 입력 토큰 100만 개당 $10.00, 출력 토큰 100만 개당 $50.00로 둘 다 같으며, 1M 토큰 컨텍스트 창도 마찬가지입니다. 달라진 것은 장기 에이전트 작업의 성격입니다. Anthropic 자체 수치에 따르면 Fable 5.1은 가장 어려운 과학 에이전트 벤치마크에서 Fable 5를 두 배 이상 앞섰고, 기업들이 데이터 보존을 두고 Fable 패밀리를 어떻게 대하는지에 관한 이번 주 보도는 오늘 둘 사이에서 선택하는 누구에게나 이번 리프레시에 한층 더 날카로운 두 번째 우위를 더해 줍니다.
날짜와 출처에 관한 메모를 먼저 밝힌다: Claude Fable 5.1은 9월 1일에 출시되었으므로, 모델 자체는 나온 지 2주 된 것이지 속보가 아니다. 현재 시점의 내용은 The Information에 출처를 둔 2026년 9월 14일자 보도다. 그 보도에 따르면 Nvidia, Palantir, Booz Allen이 민감한 기업 데이터 보관에 대한 우려로 Anthropic의 Fable 제품군 사용을 제한하고 있으며, Anthropic은 6월에 안전 모니터링을 위한 30일 롤링 사용 로그를 도입했고 고객이 해당 로그를 자체 저장할 수 있는 옵션은 '여전히 철회될 수 있다'고 한다. 이 보도는 출처가 명시되어 있으며 아직 독립적으로 확인되지 않았다. 아래에서 벤더 보고라고 표시된 모든 내용은 Anthropic 자체의 벤치마크 시트이며 중립적인 제3자에 의해 재현되지 않았다.
사양서, 치수별로
• 가격 — Claude Fable 5.1은 100만 토큰당 입력 $10.00 / 출력 $50.00으로, Claude Fable 5와 동일합니다. 이번 갱신에서도 두 가격 모두 변동이 없었습니다.
• 캐시된 입력 — Claude Fable 5.1 1M 토큰당 $0.25, Claude Fable 5의 $1.00에서 75% 인하. 캐시 쓰기 $12.50(5분) / $20(1시간); 배치 모드 $5 / $25.
• 컨텍스트와 출력 — 둘 다 1M 토큰 입력 창과 최대 128K 출력 토큰을 지원하며, 둘 다 텍스트와 이미지 입력을 받습니다. 둘 다 low에서 max까지 조절 가능한 노력 다이얼이 있는 동일한 적응형 추론 인터페이스 뒤에 있습니다.
• 독립 점수 — Artificial Analysis의 Intelligence Index 현재 버전에서 Claude Fable 5.1은 53을 기록해 추적 중인 201개 모델 중 1위이며, 초당 출력 토큰 67.2개, 인덱스 작업당 $7.63입니다. Claude Fable 5의 출시 당시 규모 인덱스 수치(62)는 9월 재산정보다 앞선 것이어서 비교할 수 없으므로, 해당 모델에 대해서는 현재 규모의 수치를 인용하지 않습니다.
• 공급업체 벤치마크 — Anthropic은 Terminal-Bench-Science 0.1에서 Claude Fable 5.1이 52.6%를 기록한 반면 Claude Fable 5는 24.7%; Terminal-Bench 4.0에서는 55.8% 대 42.0%; AutomationBench에서는 31.4% 대 17.1%; CursorBench 3.2.0에서는 73.4% 대 70.5%라고 보고합니다.
• 출시 — 2026년 9월 1일 Claude Fable 5.1; 2026년 6월 9일 Claude Fable 5.
새로고침이 진짜로 새로고침인 곳
Fable 5.1 출시의 핵심적인 묘수는 요금표에서는 아무것도 움직이지 않았는데 벤치마크 시트에서는 거의 모든 것이 움직였다는 점이다. 성과 향상은 장기 지평, 도구 사용, 에이전트형 작업에 집중된다 — Terminal-Bench-Science 0.1은 24.7%에서 52.6%로 두 배 이상 증가했고, Terminal-Bench 4.0은 42.0%에서 55.8%로 상승했으며, AutomationBench는 17.1%에서 31.4%로 거의 두 배가 되었다. Humanity's Last Exam에서 Anthropic은 도구 없이 60.9%, 도구를 사용하면 65.0%를 보고했으며, Claude Fable 5는 57.8%와 63.8%였다. 이 수치들은 이동 방향으로 읽어야 한다: 이는 공급업체 자체의 표이며, 가장 큰 단일 수치 주장은 더 엄격한 가드레일 뒤에서 같은 가중치를 공유하는 제한된 형제 모델인 Claude Mythos 5.1을 설명한다.

두 번째 지렛대는 비용이며, 이는 어떤 단일 벤치마크보다도 더 중요합니다. 캐시된 입력은 백만 토큰당 $1.00에서 $0.25로 떨어졌고, 긴 에이전트 실행에서는 재읽기가 지배적입니다. 도구 출력, 파일 내용, 이전 턴들이 계속해서 다시 전송됩니다. Anthropic은 일반적인 토큰 청구 워크로드에서 실효 비용이 약 25% 낮아지고, 고도로 에이전트적인 워크로드에서는 최대 45%까지 낮아진다고 추정합니다. 이는 벤더의 추정치이지만, 근본적인 가격 변화는 가격표에서 확인할 수 있습니다. 한 작업 동안 100K 토큰 컨텍스트를 50번 재읽는 장기 지평 에이전트는 Claude Fable 5 가격 기준으로 캐시 읽기에 $5.00를 지불하고, Claude Fable 5.1 기준으로는 $1.25를 지불합니다. 에이전트 플릿 전체로 보면 그 항목은 더 이상 반올림 오차가 아닙니다.
세 번째 변경 사항은 이전 세대 사용자들이 가장 먼저 체감하는 부분입니다: 바로 안전 분류기입니다. 개발자들은 예전 동작에 "Fable의 우울증"이라는 별명을 붙였습니다 — 분류기가 무해한 요청을 표시했을 때 출력이 조용히 더 약한 모델로 우회되던, 최상위 모델의 비용을 내고 받는 결과 말이죠. Anthropic에 따르면 Fable 5.1의 사이버 안전 장치는 이제 Claude Code 세션당 개입을 약 60% 줄였고, 생물학 안전 장치는 Fable 5 출시 당시보다 무해한 요청에서 85% 덜 발동한다고 합니다. 6월 모델에 대한 불만이 작업 중간의 핸드오프에 관한 것이었다면, 이것이 바로 그 문제를 직접 해결하는 업그레이드입니다.
이번 주의 리텐션 이야기, 그리고 그것이 결정에 미치는 영향
9월 14일 보도는 기업의 셈법을 바꾸는 부분이다. Fable 패밀리가 Anthropic의 가장 성능이 뛰어난 모델이 있는 곳이고, 데이터 보존 방침은 규제 대상 구매자가 적당히 얼버무릴 수 없는 바로 그런 사안이기 때문이다. 보도된 바에 따르면, Anthropic은 6월에 안전 모니터링을 위해 30일 롤링 사용 로그를 도입했다. 고객들은 대신 해당 로그를 직접 저장할 수 있다고 들었다. 그리고 보도는 그 옵션이 "여전히 철회될 수 있다"고 전한다. Palantir는 철회 불가능한 제로 데이터 보존 보증을 받을 때까지 Fable을 보류하고 있다고 묘사되며, Nvidia는 Fable을 덜 민감한 업무로 제한하고, Booz Allen은 자체 사이버보안 업무에서 이를 제외하는 것으로 묘사된다. 이 모든 것은 출처가 명시된 보도이며, 언급된 회사들 중 어느 곳도 이를 확인하지 않았고, 그 실질적 효과는 고르지 않다. 일부 고객은 매우 신경 쓸 것이고, 일부는 전혀 신경 쓰지 않을 것이다.
5.1 대 5 결정에 이것이 어떤 영향을 미치는지는 정확히 짚고 넘어갈 가치가 있습니다. 보존 관련 이야기는 Fable 제품군 전체에 적용되는 것으로, Fable 5와 Fable 5.1이 동일한 보존 정책을 공유하므로 두 모델 사이의 새로운 차이는 아닙니다. 이것이 실제로 바꾸는 것은 위험 가중 계산입니다. 워크로드가 철회 가능한 자체 저장 옵션이 실격 사유가 될 만큼 민감하다면, 현재로서는 어느 모델도 기준을 통과하지 못하며, 이 논의는 Anthropic의 Enterprise Frontier Safeguards(EFS) 로드맵에서 다루어야 합니다. 이 로드맵은 적격 고객을 대상으로 2026년 가을부터 제로 데이터 보존을 단계적으로 도입한다고 설명됩니다. 워크로드가 그렇게 민감하지 않다면, 보존 관련 보고 때문에 실제 성능 업그레이드를 포기해서는 안 됩니다. 다만 그것은 나중에 알게 되는 것이 아니라 의사 결정 기록에 남아 있어야 합니다.

누가 어떤 것을 골라야 하나요
잘못된 답변이나 포기된 답변의 비용이 토큰 비용을 압도할 때 Claude Fable 5.1을 선택하세요: 장기적인 에이전트형 리서치, 도구를 많이 쓰는 작업, Claude Code 내부에서 돌아가는 모든 것, 그리고 75% 더 저렴한 캐시 읽기가 단위 경제성을 바꿔 놓는 워크로드가 그렇습니다. 트래픽이 짧고 단발성이며 처리량에 관대하다면 Claude Fable 5에 머무르세요 — 가격은 동일하고 이전 모델의 점수도 여전히 최전선급입니다 — 또는 계약 중간이라 마이그레이션 부담이 실제로 클 때도 마찬가지입니다. 정직한 중간 지대는 아예 선택하지 않는 것입니다: 두 모델 모두 동일한 Anthropic API 표면 뒤에 있으며, 단일 엔드포인트를 통해 호출한다면 작업에 추론 상한이 필요할 때 Claude Fable 5.1로 에스컬레이션하고 두 번째 계약 없이 더 저렴하되 가격이 동일한 두 모델이 장애 조치를 공유하게 할 수 있습니다.
OrcaRouter에서는 Claude Fable 5와 Claude Fable 5.1을 두 모델 모두 각 제공사의 정가에 마크업 없이 이용할 수 있습니다. 따라서 위의 $10 / $50은 청구서에 찍히는 숫자 그대로이며, Anthropic 자체의 가격 변동도 리셀러 마진에 흡수되지 않고 같은 날 그대로 반영됩니다. 자체 트래픽으로 이번 리프레시를 테스트하는 것은 자동 페일오버가 적용된 라우팅 규칙 수정에 불과합니다. 두 모델이 하나의 키를 공유하므로 전환 비용은 거의 0에 가깝고, 모델 퓨전을 사용하면 하나 이상의 의견이 필요할 만큼 중요한 작업에서 여러 모델이 함께 답변하도록 할 수 있습니다.

요약하자면: Claude Fable 5.1은 Claude Fable 5와 가격이 같고, Anthropic이 강조하는 에이전트 과학(agentic-science) 벤치마크에서 대략 두 배 더 강력하며, 긴 세션을 지배하는 캐시 읽기에서는 75% 더 저렴하고, 작업 도중에 요청을 더 약한 모델로 넘길 가능성도 실질적으로 더 낮습니다. 9월 14일 리텐션 보고는 사실이며, 엄격한 데이터 요구 사항을 가진 기업이라면 따져볼 가치가 있습니다. 하지만 그것은 패밀리 전체에 적용되는 것이지 이 특정 업그레이드에 적용되는 것은 아니며, 벤치마크와 캐시 계산이 이미 결론을 내린 결정에서 한 줄에 불과해야 합니다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
