Claude Opus 5: Anthropic의 근접 최전선 모델, Fable 5 가격의 절반
Guides & Insights

Claude Opus 5: Anthropic의 근접 최전선 모델, Fable 5 가격의 절반

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

2026년 7월 24일, Anthropic이 출시한 Claude Opus 5 — 그리고 하루 만에 '저렴한' 모델로서는 드문 일을 해냈습니다: 독립적인 리더보드의 정상에 올랐습니다. Anthropic은 Opus 5가 절반 가격으로 최첨단 지능에 근접한다고 홍보했으며, Claude Fable 5 절반 가격에, 그리고 같은 날 Claude.ai, Claude API, Claude Code, Claude Cowork에서 출시되었습니다. 이후 Artificial Analysis는 이를 Intelligence Index에서 1위 모델로 평가했습니다. 이 가이드는 Opus 5가 실제로 무엇인지, 독립적으로 검증된 것과 공급업체가 보고한 것의 차이, 새로운 노력 다이얼(Effort Dial)과 안전 태세, 실제 비용, 그리고 누가 전환해야 하는지를 다룹니다.

아래의 모든 수치는 출처별로 표시되어 있습니다. 이 속도에서는 이야기가 매일 변하기 때문입니다. 출시일에 "아직 독립적인 점수 없음"이라고 읽혔던 것이 이제는 "독립적으로 1위"가 되었습니다. 벤치마크와 가격은 변동합니다 — 예산을 확정하기 전에 확인하세요.

TL;DR. Claude Opus 5는 입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $25로 책정되었습니다. 이는 Opus 4.8 과 동일하며, 정확히 Fable 5의 $10/$50의 절반입니다. Artificial Analysis Intelligence Index에서 현재 61점(max effort)으로 선두이며, 평가된 170개 모델 중 최고 모델로 Fable 5(60)를 앞지르면서도 동일한 클래스에서 절반의 비용을 자랑합니다. Anthropic 자체 출시 벤치마크에서도 이를 뒷받침합니다: Frontier-Bench v0.1 43.3%(Fable 5의 33.7% 대비), Zapier의 AutomationBench 및 OSWorld 2.0 컴퓨터 사용 벤치마크에서도 선두입니다. 두 가지 요소가 단순한 가격 인하 이상의 의미를 갖습니다: 요청당 비용과 성능을 교환하는 노력 다이얼(낮음/중간/높음/최대), 그리고 지금까지의 어떤 Opus보다 강력한 안전 태세입니다. 이미 Claude에서 구축 중이라면 업그레이드는 위험이 낮고 비용이 증가하지 않습니다; 플래그십 모델을 선택 중이라면 Opus 5는 이제 가성비와 품질의 선두주자입니다. 자신의 워크로드에서 검증해보세요.

주요 시사점

• 이제 독립적으로 #1. Artificial Analysis는 Claude Opus 5 (최대 노력)를 Intelligence Index에서 61점으로 평가하며, 최고 순위 모델로 Fable 5 (60점)를 앞섰다고 발표했습니다.

• Fable 5의 절반 가격. 1M 토큰당 $5 / $25, 이는 Opus 4.8과 동일하며 Fable 5의 $10 / $50의 절반입니다 — 중간 가격대에서 최첨단 품질.

• 새로운 노력 다이얼. 낮음/중간/높음/최대 설정은 토큰(비용)을 능력으로 교환합니다. "최대"는 리더보드 최상위를 차지하며, 더 저렴한 설정도 대부분의 경쟁자를 이깁니다.

• 에이전트 및 컴퓨터 사용을 위해 제작되었습니다. Anthropic은 단순한 답변뿐만 아니라 다단계 작업 완료(AutomationBench)와 실제 UI 구동(OSWorld 2.0)을 강조합니다.

• 지금까지 가장 안전한 Opus입니다. Anthropic은 이를 "가장 정렬된 Opus 모델"이라고 부르며, 사이버 분류기가 Fable 5보다 약 85% 덜 개입할 것으로 예상합니다 — 정당한 작업에 대한 거짓 거부가 줄어듭니다.

• 광범위하고 즉각적인 가용성. Claude Max에서는 기본 모델, Claude Pro에서는 가장 강력한 모델이며, API, Claude Code, Claude Cowork에서 출시 첫날부터 라이브로 제공됩니다.

이 브리프를 읽을 때 참고: Anthropic에 귀속된 모든 내용은 출시 자료의 공급업체 주장입니다. 독립적인 수치(Intelligence Index)는 Artificial Analysis에 귀속됩니다. 아직 게시되지 않은 숫자(별도의 SWE-bench Verified 점수)에 대해서는 추측하지 않고 그렇게 명시합니다.

Claude Opus 5의 실제 정체

Opus 5는 Anthropic의 Opus 라인업의 최신 모델입니다. Sonnet과 Haiku 위에 위치한 '헤비' 등급으로, Opus 4.8보다 상위에 있으며, 독립적인 Intelligence Index에서 Anthropic의 2026년 6월 프론티어 플래그십인 Fable 5를 앞질렀습니다. 주목할 만한 점은 적당한 성능 향상이 아니라 그 조합입니다: 거의 최상위 수준의 지능을 실용적인 가격에 제공합니다. Anthropic은 이 모델을 '사려 깊고 능동적인' 모델로 설명하며, 코딩, 에이전트 워크플로우 및 일상적인 엔터프라이즈 사무 작업을 대상으로 합니다.

구체적으로, Opus 5는 입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $25입니다. 이는 Opus 4.8과 동일한 가격이며, Fable 5의 $10/$50의 절반입니다. Claude Max의 기본 모델이자 Claude Pro에서 가장 강력한 옵션으로, 출시일부터 Claude API, Claude Code(코딩용), Claude Cowork(협업 에이전트 작업용)를 통해 사용할 수 있습니다. 컨텍스트 창은 Opus 제품군의 100만 클래스입니다.

실제로 새로운 점은 무엇인가요?

출시 당일 가장 명확한 신호는 Anthropic의 Frontier-Bench v0.1이라는 어려운 추론 및 작업 제품군이었습니다. Opus 5는 43.3%를 기록한 반면, Fable 5는 33.7%, Opus 4.8은 18.7%를 기록했습니다. 해당 벤치마크에서 Anthropic의 더 저렴한 새 모델이 자사의 더 비싼 주력 모델을 능가했으며, 이 주장은 이후 독립적인 평가에서도 확인되었습니다.

두 가지 추가 벤더 벤치마크가 '실제 작업에 최적화됨'이라는 스토리를 뒷받침합니다. 모델이 비즈니스 작업을 단순히 시작하는 것이 아니라 완료까지 수행하는지를 측정하는 Zapier의 AutomationBench에서 Anthropic은 Opus 5의 통과율이 동일 비용 기준으로 다음으로 가까운 모델보다 약 1.5배 높으며, 가장 저렴한 설정조차 모든 경쟁사의 최고 결과를 능가한다고 밝혔습니다. 컴퓨터 사용 벤치마크인 OSWorld 2.0에서는 Anthropic이 Opus 5가 모든 가격대에서 경쟁사를 앞지르고, 예산의 약 3분의 1만 사용해 Fable 5의 최고 점수를 넘어섰다고 보고했습니다. 또한 Opus 5는 Anthropic이 추적하는 모든 생명과학 평가에서 Opus 4.8보다 향상되었으며, 가장 큰 폭의 개선(10% 포인트 이상)은 분광 데이터로부터 분자 구조를 읽어내는 유기화학 작업에서 나타났습니다.

노력 다이얼: 필요한 기능에 대해서만 비용을 지불하세요

가장 주목할 만한 기능 — 그리고 대부분의 리뷰어들이 집중하는 부분 — 은 노력 설정입니다. Opus 5는 모델이 요청에 투자하는 노력의 정도를 선택할 수 있게 해줍니다: 낮음, 중간, 높음, 또는 최대. 노력이 높을수록 더 많은 내부 추론 토큰이 사용되며(따라서 비용과 지연 시간이 증가), 더 높은 품질을 제공합니다. 노력이 낮을수록 토큰을 절약하여 더 빠르고 저렴한 답변을 얻을 수 있습니다. 사실상, AI 청구서의 다이얼인 셈입니다.

이것이 Artificial Analysis가 Opus 5의 여러 항목(medium, high, xhigh, max)을 나열하는 이유입니다. 각 노력 수준은 비용-품질 곡선의 다른 지점입니다. 'max' 설정은 현재 Intelligence Index에서 61로 최고를 기록하고 있습니다. 낮은 설정은 약간의 품질을 희생하여 작업당 비용을 크게 낮추며, 심지어 그 설정들도 Anthropic에 따르면 대부분의 경쟁사 최고 결과를 능가합니다. 실제로 이는 하나의 모델이 지연 시간에 민감한 대량 호출(low/medium)과 가장 어려운 추론 작업(high/max) 모두에 사용될 수 있음을 의미합니다. 모델을 전환하는 대신 요청별로 조정하면 됩니다.

벤치마크 심층 분석: 이 테스트가 실제로 측정하는 것

각 숫자가 무엇을 의미하는지 알면 신뢰하기 전에 도움이 됩니다. Artificial Analysis Intelligence Index 는 다양한 독립 평가(추론, 수학, 코딩, 지식)로 구성된 복합 지표로, 제3자가 실행했습니다. 61점으로 Opus 5가 170개 모델 중 1위를 차지한 것은 여기서 가장 신뢰할 수 있는 단일 신호입니다. 왜냐하면 Anthropic이 이를 실행하지 않았기 때문입니다. Frontier-Bench v0.1 (Opus 5의 43.3%)는 Anthropic 자체의 어려운 테스트 세트입니다. 이는 Opus 5가 Fable 5(33.7%) 또는 Opus 4.8(18.7%)보다 더 어려운 문제를 푼다는 상대적 신호이지, 학술적인 의미에서 '43% 정답'이 아닙니다.

AutomationBenchOSWorld 2.0는 사용 사례가 에이전트라면 단일 추론 점수보다 더 중요합니다. AutomationBench는 작업 완료를 보상합니다 — 이메일을 작성하는 에이전트와 실제로 지출 보고서를 제출하는 에이전트의 차이 — 그리고 OSWorld 2.0은 실제 컴퓨터 UI를 조작하는 것을 보상합니다. Anthropic의 주장, 즉 Opus 5가 Fable 5의 OSWorld 최고점에 비해 비용은 3분의 1로 동등하다는 주장은, Intelligence Index가 그 일반적 지위를 뒷받침하는 지금, 에이전트 작업 부하를 Opus 5로 옮기는 강력한 논거입니다. 한 가지 공백: 아직 Opus 5에 대한 별도의 독립 감사를 받은 SWE-bench Verified 수치가 없습니다 (Fable 5는 95.0%, Opus 4.8은 88.6%입니다). 따라서 순수 코딩 정확성 인용을 위해서는 그 숫자를 기다리십시오.

실제 비용은 얼마인가

토큰당 가격은 추상적입니다. 실제 청구서에 반영되는 것은 작업당 가격입니다. 대표적인 에이전트 단계로 입력 토큰 20,000개와 출력 토큰 3,000개를 가정해 보겠습니다. Opus 5(및 Opus 4.8): 입력 20k × $5/1M = $0.10, 출력 3k × $25/1M = $0.075, 요청당 약 $0.175입니다. Fable 5의 경우 $10/$50: 입력 $0.20 + 출력 $0.15 = 약 $0.35로 대략 두 배입니다. 한 달에 이러한 호출이 100,000회 발생한다면 Opus 5에서는 약 $17,500인 반면 Fable 5에서는 약 $35,000입니다. Intelligence Index가 이제 Opus 5를 Fable 5보다 앞서는 것으로 평가하기 때문에, 이는 "Fable 5에 가까운 성능을 더 저렴한 가격에" 제공하는 것이 아니라, 월 청구액이 절반 수준으로 최고 수준의 품질을 제공하는 것입니다.

노력 다이얼은 수학을 다시 바꿉니다. 대량 지원 파이프라인은 대부분의 통화를 낮거나 중간 수준의 노력으로 처리할 수 있으며(위 숫자보다 저렴함), 진정으로 어려운 소수의 티켓에만 최대 노력을 아껴둡니다. Anthropic의 관점은 저렴한 설정조차도 경쟁사의 최고를 능가하므로 사용하지 않는 기능에 비용을 지불하는 경우가 거의 없다는 것입니다. 모든 통화가 최대 노력으로 실행된다고 가정하지 말고, 여러분만의 노력 수준 조합을 모델링하세요.

Claude Opus 5에 접근하고 사용하는 방법

Opus 5는 이제 Claude.ai (Max 요금제에서는 기본 모델이며 Pro에서는 가장 강력한 옵션), Claude API (Anthropic 문서에 모델 ID 명시), Claude Code (터미널 및 IDE 코딩용), Claude Cowork (협업형 멀티스텝 에이전트 작업용) 등 다섯 곳에서 즉시 사용할 수 있습니다. API 사용자는 노력 수준(effort level)을 파라미터로 설정할 수 있어, 요청별로 비용-성능 트레이드오프를 프로그래밍 가능하게 조정할 수 있습니다. 이미 Opus 4.8을 사용 중이라면, 동일한 가격에 모델 ID만 변경하면 되므로 Anthropic이 오랜만에 출시한 가장 마찰이 적은 업그레이드입니다.

대상: 세 가지 시나리오

1. 에이전트 기반 및 컴퓨터 사용 파이프라인

귀하의 제품이 멀티스텝 에이전트를 실행하거나 브라우저 또는 데스크톱을 구동한다면, Opus 5의 AutomationBench 및 OSWorld 2.0 결과가 정확히 귀하를 겨냥하고 있습니다 — 이제 독립적인 1위 Intelligence Index의 뒷받침을 받았습니다. 대부분의 단계는 중간 노력(medium effort)으로 실행하고, 어려운 단계는 높음/최대(high/max)로 에스컬레이션하십시오; 커밋하기 전에 자신의 에이전트 트레이스(agent traces)로 시험 운영하십시오.

2. 예산을 주시하는 코딩 팀

Opus 5는 출시 첫날부터 Claude Code에 포함되며 Opus 4.8 가격으로 제공됩니다. Intelligence Index 선두를 차지하면서 강력한 기본 코더로 자리 잡았으며, 유일하게 누락된 인용은 독립적인 SWE-bench Verified 수치입니다(Fable 5가 여전히 95.0%로 해당 기록을 보유). 이미 Claude를 사용 중인 팀에게 이 업그레이드는 위험이 낮고 가격 인상이 없습니다.

3. 하나의 모델로 표준화하는 기업들

폭넓은 가용성, 1M 규모 컨텍스트, 가장 안전한 Opus 정렬 프로필, 그리고 저렴한 대량 작업과 고난도 추론을 모두 아우르는 노력 다이얼 덕분에 Opus 5는 사무 및 엔지니어링 작업 혼합을 위한 합리적인 단일 기본값이 됩니다. 그 비용은 최전선 플래그십보다 훨씩 방어하기 쉽습니다.

안전 및 정렬

Anthropic은 Opus 5를 가장 안전한 Opus 릴리스로 자리매김하며, "가장 정렬된 Opus 모델"이자 "악용되도록 속아 넘어갈 가능성이 가장 낮은 모델"이라고 강조합니다. 실질적인 결과는 실제 배포에서 중요합니다. Anthropic은 Opus 5의 사이버 분류기가 Fable 5보다 약 85% 더 적게 개입할 것으로 예상합니다. 쉽게 말해, 이는 합법적인 보안, 코딩, 연구 작업에서 거짓 거부(false refusal)가 줄어든다는 뜻입니다. 이는 강력한 보호 장치를 갖춘 최첨단 모델에서 흔히 발생하는 불만 사항이며, 진정한 악용은 차단하면서 말이죠. 항상 그렇듯이, 맹목적으로 신뢰하지 말고 자체 콘텐츠 및 규정 준수 요구사항에 따라 검증하세요.

Fable 5 수출 통제 이야기는 이제 시스템 프롬프트에 있습니다.

Fable 5의 출시는 결코 순탄하지 않았으며, 그 맥락은 Claude Opus 5를 그것과 비교하는 모든 사람에게 중요합니다. 사흘 후, Claude Fable 5와 Claude Mythos 5가 2026년 6월 9일에 출시된 후, Anthropic은 미국 상무부의 수출통제 명령을 준수하기 위해 두 모델을 모두 중단했습니다. 통제는 6월 30일에 해제되었고 접근은 7월 1일에 복구되었습니다. 이 일련의 과정은 기록된 역사입니다 — Simon Willison은 Anthropic API가 실시간으로 오류를 반환하기 시작하는 것을 지켜봤으며, Anthropic은 중단과 복구에 관한 자체 성명을 발표했습니다.

새로운 점은 Opus 5가 이에 대한 질문을 다루는 방식입니다. 모델의 학습 기준 시점은 2026년 5월이므로, 셧다운과 그 번복은 모델이 학습한 내용의 범위를 벗어납니다. 약 200,000자에 달하는 Claude Opus 5 시스템 프롬프트 — 레드티머 Pliny the Liberator가 7월 25일에 게시했으며 Anthropic이 프로덕션과 일치한다고 확인하지 않은 문서 — 는 전체 타임라인을 기록하고 있으며, 모델이 중단에 관한 질문에 부인하지 않고 솔직하게 답변하도록 지시하고, 현재 상태를 확인할 수 없을 때는 사용자를 Anthropic의 공식 성명으로 안내합니다. 이는 공급업체가 학습 기준 이후의 역사를 프롬프트에 작성하여 모델이 자신의 계열에 대해 즉흥적으로 답변하지 않도록 하는 구체적인 사례입니다.

사용하지 말아야 할 때

오늘 인용할 독립적으로 감사된 SWE-bench Verified 코딩 수치가 특별히 필요하다면 Opus 5를 선택하지 마세요 — 그 수치는 아직 발표되지 않았으며, Fable 5 (95.0%)가 여전히 그 기록을 보유하고 있습니다. 모든 노력 설정이 #1이라고 가정하지 마세요; 리더보드 1위인 61은 최대 설정이며, 낮은 설정은 일부 품질을 비용과 교환하므로, 실제로 실행할 노력 수준을 벤치마킹하세요. 그리고 순수한 대량 처리, 지연 시간에 민감한 텍스트로서 추론이 필요하지 않은 경우, 더 저렴한 효율성 계층 모델 (예를 들어 Gemini 3.6 Flash $1.50 / $7.50에) 토큰당 여전히 더 저렴할 것입니다 — Opus 5는 추론 및 에이전트 모델이지, 대량 텍스트용 모델이 아닙니다.

자주 묻는 질문

Claude Opus 5의 가격은 얼마인가요?

입력 토큰 100만 개당 $5, 출력 토큰 100만 개당 $25 — Opus 4.8과 동일하며, Fable 5의 $10 / $50의 절반입니다. [Anthropic]

Opus 5가 정말 #1 모델인가요?

Artificial Analysis Intelligence Index에서, 이 글을 쓰는 시점 기준으로: Claude Opus 5 (max effort)가 170개 모델 중 61위로 Fable 5(60위)를 앞서고 있습니다. 이는 벤더의 주장이 아닌 독립적인 점수입니다. 다른 리더보드나 사용자의 워크로드에 따라 순위가 다를 수 있으며, 모델이 추가됨에 따라 순위가 변경됩니다.

노력 다이얼이란 무엇인가요?

요청별 설정(low/medium/high/max)으로, 토큰(따라서 비용과 지연 시간)을 능력과 맞바꿉니다. Max가 리더보드 최상위를 차지하지만, 저렴한 설정도 Anthropic에 따르면 대부분의 경쟁사를 능가합니다. API 사용자는 이를 파라미터로 설정합니다.

Opus 5가 Fable 5보다 더 좋나요?

독립적인 Intelligence Index (61 대 60)와 Anthropic의 Frontier-Bench v0.1 (43.3% 대 33.7%)에서, 그렇습니다 — 절반 가격으로 말이죠. Fable 5는 여전히 독립적으로 측정된 SWE-bench Verified (95.0%)에서 앞서고 있으므로, 순수 코딩 정확도 인용에 있어서는 Fable 5가 그 특정 왕관을 유지합니다.

Opus 5는 Opus 4.8과 비교하여 어떤가요?

동일한 $5/$25 가격, 실질적으로 더 높은 벤더 벤치마크(Frontier-Bench v0.1 43.3% 대 18.7%), 모든 추적된 생명과학 평가에서의 성과 향상, 새로운 노력 다이얼과 더 안전한 정렬. 기존 4.8 사용자에게는 가격 인상 없는 업그레이드입니다.

얼마나 안전한가요?

Anthropic은 이를 가장 정렬된 Opus 모델이자 오용 가능성이 가장 낮은 모델이라고 부르며, 사이버 분류기가 Fable 5의 경우보다 약 85% 덜 개입할 것으로 예상합니다. 일반적으로 합법적인 작업에 대한 거짓 거부가 더 적습니다.

Claude Opus 5는 어디에서 사용할 수 있나요?

Claude.ai (Max에서는 기본값, Pro에서는 가장 강력함), Claude API, Claude Code, Claude Cowork — 2026년 7월 24일부터 제공 중.

컨텍스트 창이란 무엇인가요?

Opus 계열 100만 토큰 클래스(Opus 4.8은 장기 컨텍스트 추가 요금 없이 100만 토큰입니다). Anthropic은 Opus 5 수치를 별도로 공개하지 않았으므로, 확인될 때까지 100만 토큰 클래스로 간주하세요.

이미지나 비디오를 지원하나요?

Opus 5는 주로 텍스트 및 도구 추론 모델입니다. 무거운 멀티모달(이미지/비디오) 이해를 위해서는 다음과 같은 모델이 Gemini 3.1 Pro 목적에 맞게 제작되었습니다. 텍스트, 코드 및 에이전트에는 Opus 5를 사용하세요.

결론

Claude Opus 5는 단순한 가격 조정 이상의 의미를 지니는 것으로 드러났습니다. 가격은 작업용 모델에 걸맞게 — $5/$25로, Fable 5의 절반이자 Opus 4.8과 동일 — 책정되었지만, 현재 독립적인 Artificial Analysis Intelligence Index에서 61점(최대 노력)으로 선두를 달리고 있으며, 강력한 벤더 벤치마크(Frontier-Bench v0.1 43.3%, AutomationBench, OSWorld 2.0), 실질적으로 유용한 노력 다이얼, 그리고 어떤 Opus보다 가장 안전한 정렬 프로필을 갖추고 있습니다. 한 가지 단점은 아직 독립적인 SWE-bench Verified 수치가 없다는 점인데, 여기서 Fable 5(95.0%)가 코딩 정확성 인용을 유지하고 있습니다. 기존 Claude 사용자에게 업그레이드는 위험이 낮고 비용이 증가하지 않습니다. 다른 모든 사용자에게 Opus 5는 이제 가격 대비 품질에서 따라잡아야 할 모델입니다. 자신의 작업 부하에서 검증해 보고, OrcaRouter에서 하나의 OpenAI 호환 엔드포인트를 통해 모든 경쟁 모델과 함께 라우팅하십시오.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트

© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

providers@orcarouter.ai

커뮤니티에 참여하세요

Discordsupport@orcarouter.aiXGitHubYouTube