
Claude Opus 5.5: Anthropic이 플래그십 가격을 인하했다, 그리고 그것이 진짜 이야기다
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
공급업체는 Claude Opus 5.5를 2026년 9월 22일에 출시했으며, 중요한 숫자는 어떤 벤치마크 차트에도 없습니다. 그것은 $4입니다. 새 플래그십은 백만 입력 토큰당 $4, 백만 출력 토큰당 $20의 비용이 들며, 이는 $5/$25에서 인하된 것이고, Claude Opus 5가 7월 24일부터 유지해 온 금액입니다 — 그리고 캐시 읽기는 백만당 $0.50에서 $0.20로 떨어지는데, 이는 긴 에이전트 실행을 지배하는 항목에서 60% 삭감입니다. 이 모델은 또한 더 우수합니다: 회사는 Claude Fable 5.1, 즉 그 위의 $10/$50 계층과 대부분의 작업에서 동등하다고 보고합니다. 그러나 프런티어 연구소가 일반 제공되는 최상위 모델의 표시 가격을 20% 인하하고 — 실행하는 실제 비용이 40% 줄었다고 말하는 것은 — 이번 출시에서 여러분이 구축할 수 있는 범위를 바꾸는 부분입니다. 역량 공개는 한 분기 안에 따라잡힙니다. 플래그십 계층의 가격 인하는 모두의 하한선을 재설정합니다.
실제로 지불하는 숫자에서의 차이

아래의 모든 내용은 추정치가 아니라 Anthropic이 공개한 요율표입니다:
• 입력 — 백만 토큰당 $4, Opus 5의 $5.00에서 인하
• 출력 — 백만 토큰당 $20, $25.00에서 인하
• 캐시 읽기 — 100만 개당 $0.20, $0.50에서 인하
• 5분 캐시 쓰기 — 백만당 $5, 1시간 캐시 쓰기 — $8
• Batch API — 이전과 마찬가지로 양방향 모두 50% 할인
• 컨텍스트 및 출력 — 100만 토큰 컨텍스트, 최대 128K 출력, Batch API에서는 output-300k-2026-03-24 베타 헤더
• 지식 기준 시점 — 2026년 6월
• Effort — 적응형 사고 항상 켜짐, 기본값 medium; 단계는 low, medium, high, xhigh, max
Claude API에는 Fast 모드도 있는데, 백만 개당 $8/$40로 별도 가격이 책정되어 있으며 Anthropic은 이를 일반 옵션이 아닌 연구 프리뷰라고 설명합니다.
캐시 항목이 가장 주목받아 마땅하지만, 출시 보도가 건너뛰는 것도 바로 그것이다. 매 턴마다 큰 시스템 프롬프트와 긴 파일 트리를 다시 보내는 에이전트에게는 새 입력이 아니라 캐시 읽기가 비용의 대부분을 차지한다. 그 부분에서의 60% 절감은 실제 코딩 워크로드에 대해 헤드라인 요율의 20% 절감보다 더 큰 효과를 내며, 다음 섹션의 계산이 그렇게 나오는 이유이기도 하다.
"40% 더 저렴하다"는 주장의 출처
Anthropic은 Opus 5.5가 일반적인 워크로드에서 실행되는 비용이 Opus 5보다 약 40% 저렴하다고 말합니다. 이는 대략 가격 인하 폭의 두 배에 해당하며, 이는 그 대부분이 가격 인하가 전혀 아니라는 뜻입니다 — 같은 답에 도달하기 위해 모델이 더 적은 작업을 수행하는 것입니다. Anthropic은 출력이 Opus 5보다 30% 이상 더 빠르게 생성된다고 보고하며, 여러 출시 고객이 여기에 토큰 수 감소를 언급합니다: Box는 답변이 약 40% 덜 장황하면서 토큰은 3분의 1이라고 말하고, Kiro는 토큰이 대략 절반이고 호출은 40% 더 적다고 보고하며, Factory는 출력 토큰이 20–25% 더 적다고 언급하고, GitHub는 이 모델이 자사가 측정한 것 중 가장 적은 토큰과 단계를 사용한 축에 속한다고 말합니다.
그것들은 공급업체가 공개한 고객 인용문이지, 감사를 거친 측정치가 아닙니다. 특히 "40%"는 Anthropic이 자체적으로 선택한 워크로드 전반의 평균에 대해 Anthropic 스스로 내린 표현입니다. 예산에 넣을 숫자라기보다는 방향으로 취급하세요. 오늘 독립적으로 검증할 수 있는 부분은 — Anthropic의 공개 가격 페이지에 있는 — 요금표와, 여러분이 직접 워크로드를 실행할 때 그 워크로드가 생성하는 토큰 수입니다.
출시 자료에서 가장 유용한 실제 사례는 또한 가장 화려하지도 않습니다: Opus 5.5가 63분 걸리고 Opus 5에서 같은 작업보다 비용이 50% 덜 든 합병 분석인데, Opus 5는 93분이 걸렸습니다. 에이전트 가격을 책정한다면 흥미로운 수치는 토큰당 요율이 아니라 그 비율입니다 — 끝내는 데 세 번의 패스가 필요한 더 저렴한 모델은 당신에게 아무것도 절약해 주지 못한 것입니다.
벤치마크 표, 그리고 그것을 만든 사람
아래의 모든 일대일 비교 수치는 Anthropic의 출시 자료에서 나온 것으로, 자사 모델과 경쟁사 모델을 대상으로 실행된 것입니다. 이는 출시 과정에서 흔한 일이며, 그렇기 때문에 이 중 어느 것도 독립적인 평가로 읽어서는 안 됩니다. 이 수치들은 전체적으로 공급업체 보고 수치로 표시되어 있습니다.
• Terminal-Bench 4.0 — Opus 5.5 66.4%, Opus 5 52.3%, Fable 5.1 55.8%, GPT-6 Astra 57.9%. Anthropic은 해당 실행이 기본값이 아닌 xhigh effort를 사용했다고 밝혔다.
• FrontierCode v1.1 (Main) — Opus 5.5 54.4%, Opus 5 48.0%, Fable 5.1 50.3%, GPT-6 Astra 53.3%; 기본 medium effort 설정에서 54.6%.
• CursorBench 4.0 — Opus 5.5 57.8%, Opus 5 46.6%, Fable 5.1 51.8%; 중간 노력에서 52.5%.
• GDPval-AA v2.1, 지식 노동 — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.
• Terminal-Bench-Science 0.1 — Opus 5.5의 58.7% 대 Opus 5의 29.0%, GPT-6 Astra가 64.6%로 앞서 있습니다.
• OSWorld 2.0, 컴퓨터 사용 — Opus 5.5는 81.8%로 Opus 5의 74.0%를 앞섰으며, 부분 결과로 표시됨.
그 목록에서 뽑아볼 만한 두 가지가 있다. 첫째, medium effort는 max보다 그렇게까지 나쁘지 않다. FrontierCode에서는 54.6% 대 54.4%, CursorBench에서는 52.5% 대 57.8%다. effort가 비용을 직접 좌우하기 때문에, 기본 설정에서 측정 가능한 손실이 전혀 없다는 그 FrontierCode 결과야말로 돈이 걸린 발견이다. 둘째, Anthropic 스스로 이 능력 수준에서는 벤치마크 격차가 "실제 세계의 차이를 판단하는 데 덜 신뢰할 만한 지침"이라고 경고하며, Fable 5.1과의 내부 격차는 점수가 시사하는 것보다 좁다고 밝힌다. 자사 표를 할인해서 보라고 말하는 벤더의 문장이야말로 그 문서에서 가장 신뢰할 만한 문장이다.
독립 평가 측면에서, Artificial Analysis는 자사의 Intelligence Index에서 Claude Opus 5.5에 54점을 부여했으며, 이는 추적 중인 모델들 중 3위로, "Adaptive Reasoning, High Effort, Default Fallback"이라는 레이블이 붙은 구성에서의 결과입니다. 그 마지막 구절은 실제로 중요한 역할을 하고 있으며, 바로 다음 섹션으로 이어집니다.
안전장치 라우팅은 명세의 일부입니다
독립된 결과의 그 "Default Fallback" 레이블은 벤치마크 아티팩트가 아닙니다. Opus 5.5는 Anthropic이 이전에 Fable 5.1을 위해 남겨 두었던 보호 등급과 함께 제공되는데, 이는 생물학 및 사이버보안 분야에서 Claude Mythos 5.1에 필적하기 때문입니다. 실제로 이는 대부분의 사이버보안 요청이 Claude Opus 4.8로 다시 라우팅되고, 생물학 작업은 계정이 Anthropic의 Life Sciences 또는 Cyber Verification 프로그램을 통해 검증되지 않는 한 Claude Opus 5로 폴백된다는 뜻입니다.
여러분의 제품이 사이버 관련 또는 생명과학 관련 프롬프트를 claude-opus-5-5로 보내는 경우, 돌려받는 답변이 전혀 Claude Opus 5.5에서 온 것이 아닐 수 있습니다. 여러분의 평가, 작업당 비용, 품질 측정은 모두 해당 턴에서 더 작은 모델을 조용히 포함합니다. 대부분의 팀에서는 이런 일이 결코 발생하지 않습니다. 보안 도구나 바이오테크에 있는 사람에게는 끊임없이 발생하며, 이는 이번 출시에서 가장 중요한 단 하나의 운영상 세부 사항입니다 — 또한 제대로 작동하는 API 통합이라도 여러분이 가장 중요하게 생각하는 바로 그 프롬프트에서 이전 모델보다 더 나쁜 결과를 낼 수 있다는 뜻입니다. 새로운 검증 등급이 제공됩니다. 모델 문자열이 말하는 그대로라고 가정하기 전에 자신이 그중 하나에 속하는지 확인하세요.
문자열을 교체하기 전에 확인해야 할 네 가지 브레이킹 체인지

Opus 5.5는 Claude Opus 5를 그대로 대체하거나 이름만 바꾼 버전이 아닙니다. Anthropic의 자체 마이그레이션 노트에는 기존 코드를 중단시킬 네 가지 변경 사항이 나열되어 있습니다:
• Thinking은 더 이상 비활성화할 수 없습니다. thinking: disabled를 설정했거나 Thinking을 사용하지 않는 경로에 의존한 코드는 오류가 발생하거나 동작이 조용히 변경됩니다. 이제 깊이는 effort 매개변수를 통해서만 제어됩니다.
• 강제 도구 사용은 오류를 반환합니다. tool_choice를 전달하여 특정 도구를 강제하는 것은 지원되지 않습니다.
• Thinking 블록은 이를 생성한 모델과 대화에 묶여 있으므로, 일부 파이프라인이 가정하는 것처럼 모델 간에 재생할 수 없습니다.
• 이전 computer_20251124 컴퓨터 사용 도구는 Claude API 또는 Google Cloud에서 지원되지 않습니다.
아무것도 실패시키지 않으면서 출력만 바꾸는 다섯 번째 변경이 있습니다: 도구 호출 사이의 텍스트가 이제 기본 표시 설정에서 텍스트가 비어 있는 사고 블록 안에 담겨 돌아옵니다. 그 텍스트를 진행 상황 업데이트로 사용자에게 스트리밍하는 애플리케이션은 텍스트를 다시 돌려주는 표시 값을 설정할 때까지 도구 호출 사이에 조용해질 것입니다. 아무것도 오류를 내지 않습니다; UI가 그저 말을 멈춥니다. 그것이 모든 테스트가 통과하기 때문에 프로덕션에 출시되는 종류의 회귀입니다.
처음 세 가지 변경 사항은 Fable 5.1에도 적용되므로, 이미 해당 모델로 마이그레이션했다면 작업은 일부 완료된 셈입니다.
이미 가지고 있는 것과 나란히 실행하기
팀에 가장 큰 비용을 초래하는 마이그레이션 세부 사항은 API 변경이 아닙니다. 그것은 에포트 스케일이 다른 새로운 Opus가 이전 Opus를 기준으로 구축한 비용 모델을 무효화한다는 점입니다. Anthropic 자체의 지침은 Opus 5 설정을 그대로 이어받기보다 여러 에포트 수준을 테스트하라고 권고하며, 이는 "5.5가 우리에게 더 저렴한가"에 대한 답이 여러분의 프롬프트에서 아직 아무도 실행하지 않은 측정에 달려 있음을 의미합니다.
그 측정을 하는 일은 기존 모델이 아직 같은 키에서 한 번의 호출로 접근할 수 있을 때. Claude Opus 5는 오늘 OrcaRouter에서 Anthropic 자체 $5.00/$25.00, 0% 마크업으로 제공됩니다 — 공급자 정가가 그대로 전달되므로, 보이는 요금이 Anthropic이 공개한 요금입니다. Claude Opus 5.5는 아직 우리 라우트 중 하나가 아닙니다. Anthropic 자체 API와 주요 클라우드를 통해 사용할 수 있습니다. 출시되면, 동일한 추론 노력에서 두 모델을 비교하는 것은 두 번째 통합이 아니라 라우팅 규칙이 됩니다: 트래픽의 일부를 새 모델로 보내고, 자동 장애 조치가 이미 특성을 파악한 모델을 계속 가리키게 하며, 출시 표 대신 자체 토큰 수를 확인하십시오. 여러 모델에 걸쳐 호출을 구성하는 것 — 하나는 초안을 작성하고 다른 하나는 검증 — 은 동일한 엔드포인트에서 라우팅-DSL 한 줄입니다.

그것이 주지 않는 것은 Opus 5.5에 대한 독립적인 판정이다. 아직 아무것도 주지 않는다: 공개된 맞대결 결과는 Anthropic 자체의 것이고, 존재하는 유일한 외부 점수는 폴백 라우팅이 내장된 배포 시스템의 단일 에포트 구성에 불과하다.
이해하기, 그리고 앞으로 다가올 것
Claude Opus 5.5는 모델 ID claude-opus-5-5로 Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry 및 AWS의 Claude Platform에서 서비스 중입니다. Anthropic은 상태를 활성으로, 서비스 종료 시점을 2027년 9월 22일보다 이르지 않은 것으로 명시하고 있습니다.
그 뒤에는 두 가지가 이어집니다. Anthropic은 Claude Sonnet 5.5와 Claude Haiku 5.5가 "곧 몇 주 안에" 출시되며 동일한 효율성 및 안전성 개선 사항을 다수 포함할 것이라고 말합니다. 그 말이 맞는다면, 프런티어급 Opus가 필요하지 않은 워크로드를 가진 사람에게는 더 중대한 사건입니다. 그리고 독립 벤치마크 상황은 아직 정리 중입니다: Artificial Analysis 점수는 위에서 설명한 폴백 동작을 갖춘 배포된 시스템에서 하나의 effort 구성을 처음 살펴본 결과일 뿐, 안정적인 순위가 아닙니다.
이번 출시에서 솔직히 인정해야 할 공백이 하나 있습니다. Anthropic은 Opus 5.5가 자신이 평가받고 있다고 자주 의심한다고 보고합니다. 이는 한계로 공개되어 있으며, 벤치마크 표가 측정하는 바로 그 지점을 정면으로 파고듭니다. 감시받고 있다는 것을 알 때 다르게 행동하는 모델은, 벤더 점수든 독립 점수든, 그 점수들이 형식이 시사하는 것보다 예측력이 떨어지는 모델입니다.
Claude Opus 5.5는 네 달 만에 나온 세 번째 Opus 등급 릴리스이자, Anthropic의 최고 경영자가 프런티어 개발 속도를 조절해야 한다고 공개적으로 주장한 이후 첫 출시다. 두 사실은 같은 문서에 담겨 있다. 역량 수치에 대해서는 일주일 내내 논쟁이 벌어지겠지만, 가격과 캐시 요율은 1년 뒤에도 여전히 유효할 것이다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
