Claude Opus 5.5 가격을 보여주는 타이틀 카드로, 백만 입력 토큰당 $4.00, 백만 출력 토큰당 $20.00, 백만 캐시 읽기 토큰당 $0.20의 대표 요율이 표시됩니다.
Guides & Insights

Claude Opus 5.5 가격: 전체 요율표, 캐시 라인, 그리고 작업에 실제로 드는 비용

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Claude Opus 5.5는 다음과 같이 책정됩니다:백만 입력 토큰당 $4.00, 백만 출력 토큰당 $20.00, 이는 $5.00/$25.00에서 20% 일괄 인하된 가격이며, 그 $5.00/$25.00은 Claude Opus 5가 유지해 온 것이고, 캐시 읽기는 60% 내려 백만당 $0.20이 되었습니다. 이는 Ant​hropic의 공표 가격으로, Ant​hropic 자체의 가격 문서에서 2026년 9월 24일에, 즉 모델 출시 이틀 후에 확인한 것입니다. 가격표는 쉬운 부분입니다. Ant​hropic은 또한 이 모델이 일반적인 워크로드에서 "실행 비용이 약 40% 덜 든다"고 말하는데, 그 숫자는 가격표에 없습니다. 그것은 토큰당 인하에, 같은 작업을 끝내는 데 모델이 더 적은 토큰과 더 적은 턴을 쓴다는 가정을 더한 공급업체의 설명입니다. 이 페이지는 두 가지를 분리합니다: 오늘 가격표에서 확인할 수 있는 모든 요율과, 확인할 수 없는 하나의 이면에 있는 산술입니다. Claude Fable 5.1은 그 위의 $10/$50 등급으로, Ant​hropic 스스로가 하는 비교로서 전반에 등장합니다.

전체 요금표, Anthropic이 공개한 모든 항목 그대로

이 섹션의 모든 내용은 2026년 9월 24일에 platform.claude.com과 claude.com에 있는 Anthropic의 가격 문서에서 읽은 것입니다. 여기 있는 내용 중 다른 글에서 그대로 옮겨온 것은 하나도 없습니다.

입력 — 백만 토큰당 $4.00 (Anthropic의 공시 요금).

출력 — 백만 토큰당 $20.00. 사고 토큰은 출력 토큰으로 청구되며, Claude Opus 5.5의 적응형 사고는 항상 켜져 있어 비활성화할 수 없습니다.

캐시 읽기 — 백만 토큰당 $0.20. Ant​hropic은 이를 기본 입력 가격의 0.05배로 문서화하고 있으며, 이 모델을 위한 자체 각주상의 예외 조항입니다.

5분 캐시 쓰기 — 백만 토큰당 $5.00, 시트에 있는 모든 모델에 Ant​hropic이 적용하는 표준 1.25배 기본 입력 배수입니다.

1시간 캐시 쓰기 — 백만 토큰당 $8.00이며, 기본 입력의 표준 2배 배율입니다.

Batch API — 양방향 모두 50% 할인: 백만 개당 입력 $2.00, 출력 $10.00. Anthropic은 할인된 수치를 직접 공개하므로, 여러분이 직접 절반으로 나눌 필요가 없습니다.

빠른 모드 — 백만 개당 입력 $8.00, 출력 $40.00으로, 표준 요금의 정확히 2배입니다. Anthropic의 문서에서는 이 페이지를 "빠른 모드(연구 프리뷰)"라고 부릅니다.

미국 전용 추론 — 입력, 출력, 캐시 쓰기 캐시 읽기에 대해 inference_geo: "us"가 설정된 경우 1.1배 승수가 적용됩니다. 기본값인 글로벌 라우팅은 표준 가격을 사용합니다.

컨텍스트 및 출력 상한 — 표준 가격으로 1M 토큰의 컨텍스트와 128K의 동기 출력을 제공하며, 장문 컨텍스트 할증이 없습니다. Ant​hropic는 900k 토큰 요청이 9k 토큰 요청과 동일한 토큰당 요금으로 청구된다고 밝힙니다. Batch API에서는 출력 상한이 output-300k-2026-03-24 베타 헤더

Ant​hropic은 또한 캐싱 승수가 "Batch API 할인 및 데이터 레지던시와 같은 다른 가격 조정 요소와 중첩된다"고 밝힌다 — 따라서 배치 처리되고, 캐시되고, 미국에 고정된 요청은 세 가지를 모두 곱하며, 산술은 대체하는 것이 아니라 복합적으로 누적된다.

두 모델의 독자들이 실제로 같은 시트에서 비용을 따지는 기준은 다음과 같습니다:

Claude Opus 5 — 입력 $5.00, 출력 $25.00, 캐시 읽기 $0.50, 5분 캐시 쓰기 $6.25, 1시간 쓰기 $10.00, Batch 사용 시 $2.50/$12.50 (Anthropic 공개 요금, 2026-09-24 확인).

Claude Fable 5.1 — $10.00 입력, $50.00 출력, $0.25 캐시 읽기, 5분 캐시 쓰기의 경우 $12.50, 1시간 쓰기의 경우 $20.00, Batch의 경우 $5.00/$25.00 (Anthropic의 공개 요금, 2026-09-24 조회).

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

캐시 라인이 바로 에이전트 청구서가 실제로 결정되는 곳이다

출시 보도에서는 캐시 읽기를 각주 정도로 취급한다. 대규모 프리픽스를 다시 전송하는 모든 워크로드, 즉 대부분의 코딩 및 에이전트 워크로드에서 그것은 요금표상 가장 큰 단일 지렛대다.

Anthropic의 자체 각주는 그 비율에 대해 이례적으로 명확히 밝히고 있다. 캐시 적중과 갱신 비용은 대부분의 Claude 모델에서 기본 입력 가격의 0.1배, Claude Fable 5.1에서는 0.025배, 그리고 Claude Opus 5.5에서는 0.05배이다. 따라서 Claude Opus 5.5의 캐시 비율은 표준 비율보다 두 배 더 나쁘고, Claude Fable 5.1보다도 두 배 더 나쁘다.

달러로 따지면 어쨌든 이기며, 바로 이 부분을 내면화할 가치가 있다: 기본 요율이 2.5배 더 높으면 더 나은 배수도 달러 기준으로는 이기지 못한다.

• Claude Fable 5.1 — $10.00 기준의 2.5%는 $0.25 백만 캐시 토큰당입니다.

• Claude Opus 5.5 — $4.00 기준의 5%는 $0.20(캐시 토큰 100만 개당)입니다.

• Claude Opus 5 — $5.00 기준의 10%는 $0.50 (캐시된 토큰 100만 개당)입니다.

쓰기에서도 같은 역전이 성립한다. Claude Fable 5.1은 5분 캐시에 100만 토큰을 쓰는 데 $12.50를, 1시간 창에는 $20.00를 부과한다. Claude Opus 5.5는 $5.00와 $8.00를 부과한다. 캐시 읽기는 Claude Opus 5.5가 중간 비율임에도 불구하고 절대 금액에서 두 형제 모델을 모두 앞서는 유일한 항목이다.

쓰기에 비용을 지불할 가치가 있는지를 결정하는 규칙은 두 가지다. Ant​hropic 문서에 따르면 5분 쓰기는 기본 입력의 1.25배가 들기 때문에 캐시 읽기 한 번이면 본전을 뽑고, 1시간 쓰기는 기본 입력의 2배가 들어 두 번 읽어야 본전이 된다. 그리고 캐시는 그것을 만들어낸 프리픽스에 묶여 있다. Ant​hropic은 빠른 속도와 표준 속도를 오갈 때 캐시가 무효화된다고 설명하는데, 속도가 다른 요청은 캐시된 프리픽스를 공유하지 않기 때문이다. 모델이나 effort 수준, 도구 정의를 바꾸는 것도 같은 효과를 낸다. 전환할 때마다 프리픽스를 다시 쓰게 만드는 더 저렴한 모델이, 그것이 대체한 비싼 모델보다 비용이 더 많이 들 수 있다.

긴 에이전트 루프에 실제로 드는 비용

매 턴마다 120,000토큰 접두사 — 시스템 프롬프트, 도구 스키마, 파일 트리 — 를 다시 전송하고, 턴당 도구 결과에서 1,000개의 새로운 입력 토큰을 추가하며, 턴당 800개의 출력 토큰을 생성하는 40턴 코딩 에이전트를 예로 들어 보세요. 여기서 핵심은 대입입니다. 이 네 숫자 중 어느 것이든 자신의 트래픽에 맞게 바꿔도 아래 산술은 여전히 성립합니다.

Claude Opus 5.5에 대하여:

• 캐시 쓰기, 1회 — 120,000 토큰, 백만 개당 $5.00 = $0.60

• 캐시 읽기, 39턴 — 4,680,000토큰, 백만 개당 $0.20 = $0.94

• 새로운 입력, 40턴 — 백만 개당 $4.00 기준 40,000 토큰 = $0.16

• 출력, 40턴 — 32,000토큰, 백만 개당 $20.00 = $0.64

세션 합계 — $2.34, 이 중 캐시 읽기가 약 40%를 차지합니다.

Claude Opus 5에서, 동일한 토큰 수 기준: 캐시 쓰기 $0.75, 캐시 읽기 $2.34, 신규 입력 $0.20, 출력 $0.80 — $4.09.

Claude Fable 5.1에서, 동일한 토큰 수 기준: 캐시 쓰기 $1.50, 캐시 읽기 $1.17, 신규 입력 $0.40, 출력 $1.60 — $4.67.

동일한 토큰, 동일한 턴, 효율성 주장은 필요 없습니다: Claude Opus 5.5는 Claude Opus 5보다 43% 낮게, Claude Fable 5.1보다 50% 낮게 나옵니다. 그리고 Claude Opus 5 대비 1.75달러 격차 중 1.40달러, 즉 절감액의 80%가 캐시 읽기 항목에서만 나옵니다, 대표 입력 요율에서가 아니라.

이제 반대 경우를 실행해 보세요: 20,000개의 입력 토큰과 8,000개의 출력으로, 캐싱 없이 단일 호출하는 경우입니다. Claude Opus 5.5는 입력에 $0.08, 출력에 $0.16이 들어 $0.24입니다. Claude Opus 5는 $0.10에 $0.20이 들어 $0.30입니다. 이는 정확히 정가 대비 20% 인하이며, 1퍼센트포인트도 더 아닙니다.

따라서 요금표만으로는 청구서에서 캐시 읽기가 차지하는 비중에 따라 20%~43%의 절감 효과를 제공합니다. 그 범위를 넘는 주장은 가격이 아니라 토큰 수에서 나온 것입니다.

Anthropic의 "실행 비용이 약 40% 더 저렴"은 어디에서 비롯된 것인가

Anthropic의 출시 자료에 따르면 Claude Opus 5.5는 "Opus 5보다 서빙에 더 적은 컴퓨팅이 필요"하며, 자체 테스트에서 기본 설정 기준 "일반적인 워크로드에서 Opus 5보다 비용이 40% 덜 든다"고 합니다. Anthropic이 제시한 분석은 이 모델이 "Opus 5보다 토큰당 비용이 낮고 작업당 토큰을 더 적게 사용하므로, 결과적으로 비용이 40% 감소한다"는 것입니다.

그건 있는 그대로 부르자: Ant​hropic이 선택한 여러 워크로드에 걸친 평균에 대한 벤더 측 설명, 감사를 거친 결과도 아니고 가격표에 게시된 요율도 아니다. 검증 가능한 절반은 앞의 절반이다 — 입력과 출력 20% 할인, 캐시 읽기 60% 할인, 둘 다 오늘 가격표에서 확인할 수 있다. 두 번째 절반은 모델이 더 적은 토큰과 더 적은 턴을 귀하의 워크로드에서 소비하는지에 달려 있으며, 이는 실행해 봐야만 확인할 수 있다.

Ant​hropic이 토큰 절반에 대해 제시하는 증거는 출시 시점의 고객 진술 모음입니다. 다음은 모두 벤더가 게시한 것으로, 벤더와 그 고객이 선택한 워크로드를 설명합니다:

Box — 이 모델은 "Opus 5가 사용한 토큰의 3분의 1을 사용"했으며, 답변은 "정확도를 잃지 않으면서 40% 덜 장황했습니다."

Kiro — Opus 5보다 더 많은 문제를 해결하면서 호출은 약 40% 적게 하고 토큰은 절반만 사용했습니다.

Factory — "높은 노력 수준에서 Opus 5와 동등한 성능을 보이면서 출력 토큰은 20~25% 더 적게 사용했습니다."

GitHub — 우리가 측정한 것 중 가장 적은 토큰과 단계를 사용한 축에 들었고, VS Code에서는 "Opus 5보다 절반도 안 되는 단계로 더 많은 터미널 작업을 해결했습니다."

합병 분석, 실제 사례 하나 — 가상의 HR 소프트웨어 기업 두 곳을 대상으로, 각 모델이 Excel 모델과 경영진 발표 자료를 작성. Anthropic에 따르면 Claude Opus 5.5는 Claude Opus 5의 93분에 비해 63분 만에 완료했으며 "생산 비용이 50% 더 적게 들었다." 벤더 보고, n=1.

여기서는 독립적인 반대 증거가 중요합니다. 왜냐하면 그것은 다른 방향을 가리키기 때문입니다. Artificial Analysis는 Claude Opus 5.5를 최대 노력으로 측정했을 때 인텔리전스 인덱스 과제당 약 119,000개의 출력 토큰을 기록했는데, 이는 최대 노력에서의 Claude Opus 5의 약 73,000개와 대비됩니다. 즉 토큰 수는 늘어나는 것이지 줄어드는 것이 아닙니다. 해당 구성에 대한 이들의 요약은 Claude Opus 5.5가 "출력 토큰이 1.6배임에도 불구하고 과제당 비용은 Opus 5와 같은 수준"이라는 것이며, 공개된 비용은 인텔리전스 인덱스 과제당 5.98달러입니다. 이는 최대 노력에서의 독립적인 측정치이며, Anthropic의 주장과 모순되는 것이 아니라 노력 척도의 반대쪽 끝인 것입니다.

이는 이 섹션의 모든 수치를 지배하는 단서를 떠올리게 합니다. Anthropic은 별도로 명시하지 않는 한 모든 Claude Opus 5.5 결과가 적응형 사고를 최대 노력으로 사용한다고 밝힙니다. Claude Opus 5.5는 기본값이 중간 노력이며, Claude Opus 5는 기본값이 높음이었고, 두 모델에서 이름이 같은 수준이 같은 사고 예산을 뜻하지는 않습니다. 따라서 최대 노력으로 실행된 벤더 표와 기본 폴백이 활성화된 상태에서 최대 노력으로 실행된 독립적 표는 같은 구성이 아니며, 기본 설정 역시 독자가 실제로 배포할 설정이 아닙니다. 선택된 워크로드 집합에서 측정된 40% 평균은, 여러분이 사용하지 않을 수도 있는 설정에서 나온 것으로, 출발 가설일 뿐 예산 항목이 아닙니다.

Fast mode는 등급이 아니라 연구용 미리보기입니다.

Claude Opus 5.5의 Fast 모드는 백만 입력 토큰당 $8.00, 백만 출력 토큰당 $40.00 — 표준 가격의 정확히 두 배 — 최대 2.5배 더 높은 초당 출력 토큰 수를 제공하기 위한 가격입니다. 첫 토큰까지 걸리는 시간은 개선하지 않으며, 이점은 출력 속도에 있고 스트리밍에서 가장 두드러집니다.

나머지는 분명히 말하겠습니다. 이것을 하나의 티어로 예산에 잡기가 쉽지만, 실제로는 티어가 아니니까요. Anthropic은 패스트 모드를 리서치 프리뷰라고 부릅니다. 접근은 어카운트 매니저나 대기자 명단을 통해 요청합니다. 여기에는 fast-mode-2026-02-01 베타 헤더와 요청에 speed: "fast"가 필요합니다. Claude API에서만 사용할 수 있으며 Amazon Bedrock, Google Cloud, Microsoft Foundry, AWS의 Claude Platform에서는 사용할 수 없습니다. Batch API나 Priority Tier 약정과 함께 사용할 수 없습니다. 프롬프트 캐싱 및 데이터 레지던시 배수와는 중첩 적용되므로, 미국에 고정된 패스트 모드 캐시 요청은 2배 위에 1.1배를 더 지불합니다. 그리고 워크로드를 패스트와 표준 속도 사이에서 전환하면 프롬프트 캐시가 무효화되는데, 긴 에이전트 루프에서는 그 비용이 속도로 절약되는 것보다 더 클 수 있습니다.

Claude Opus 5와 Claude Opus 4.8도 패스트 모드를 지원하며, 가격은 $10.00/$50.00입니다. Claude Opus 4.7은 해당 매개변수를 아예 거부합니다.

청구서를 결정하는 단위는 완료된 작업당 비용입니다.

위의 모든 요율은 토큰당 가격입니다. 아무도 토큰을 사지 않습니다. 토큰당 가격은 작업이 소비하는 토큰 수와 완료까지 걸리는 시도 횟수를 곱할 때에만 비용이 됩니다.

앞서 나온 캐시 사용량이 적은 예시로 계산을 해 보자. 패스당 $0.24라면, 첫 시도에서 작업을 끝내는 모델은 $0.24가 든다. 같은 작업을 경쟁 모델에서 패스당 $0.30으로 처리하면 $0.30이 든다 — 그래서 더 저렴한 모델이 20% 앞서 보인다. 이제 더 저렴한 모델이 완료된 작업당 1.2패스가 필요하다고 하자. 이는 에이전트 작업에 꽤 후한 성공률이다: 1.2 × $0.24는 $0.288로, 단일 패스 대안의 $0.30과 맞선다. 절감 효과는 사라진다. 세 패스에서는 $0.72이고, 토큰당 20% 더 저렴해 보였던 모델은 완료된 작업당 140% 더 비싸다.

그렇기 때문에 Anthropic 자체의 효율성 주장 — 더 적은 토큰, 더 적은 호출, 더 적은 단계 — 은 올바른 단위로 제시됩니다. 또한 그것들 중 어느 것도 직접 재현해 보기 전까지는 예산 항목으로 간주해서는 안 되는 이유이기도 합니다. 검증은 기계적입니다: 패스당 가격에 완료된 작업당 패스 수를 곱하고, 자체 트래픽에서 측정합니다. 두 숫자 모두 직접 산출해야 하는 것이며, 어느 벤더도 두 번째 숫자를 당신의 워크로드에 맞춰 공개하지 않습니다.

벤더 외부에서 단일 기준점을 원한다면, Artificial Analysis는 Claude Opus 5.5가 최대 노력(max-effort) 구성에서 Intelligence Index 작업당 $5.98라고 제시합니다. 이는 대부분의 프로덕션 트래픽이 사용하지 않을 설정에서 나온 독립적인 수치로, 예측이라기보다 상한선으로 유용합니다.

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

대표 요금에 포함되지 않는 회선

Residency. 미국 전용 추론은 캐시 읽기와 쓰기를 포함한 모든 토큰 범주에서 1.1배입니다. 빠른 모드 및 배치 할인과 중첩 적용됩니다.

도구 정의. Ant​hropic은 모델별 도구 사용 시스템 프롬프트 오버헤드를 공개합니다. 도구를 선언하면 모든 Claude Opus 5.5 요청에 286 토큰이 추가됩니다. 백만 개당 $4.00이면 작아 보이지만, 이는 요청당 청구되며 에이전트 루프는 요청을 아주 많이 만들어냅니다.

캐시 무효화. 모델, effort, 도구 정의 또는 속도 변경 후 다시 쓰인 프리픽스는 읽기 요율 $0.20이 아니라 쓰기 요율 — Claude Opus 5.5 기준 백만 토큰당 $5.00 또는 $8.00 — 로 청구됩니다.

그 아래에 있는 모델.Claude Sonnet 5는 입력 100만 토큰당 $2.00, 출력 100만 토큰당 $10.00에 자리하며, Ant​hropic의 가격 각주는 이것이 발표 당시의 도입 요금이 아니라 이제 표준 가격임을 확인해 줍니다. Claude Opus 5.5는 입력과 출력 양방향 모두에서 정확히 Sonnet 5의 2배입니다.

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

Anthropic의 정가로 Claude Opus 5.5 호출하기

Claude Opus 5.5는 OrcaRouter에 anthropic/claude-opus-5.5로 제공되며, 백만 토큰당 입력 $4.00, 출력 $20.00 — Ant​hropic 자체 정가를 0% 마크업으로 그대로 전달한 가격입니다. 이러한 패스스루는 가격 페이지에 정확히 명시할 가치가 있습니다. 제공업체 요율이 표에 캐시되지 않고 그대로 전달되기 때문에, 공급업체의 요율 변경은 동기화 기간을 거친 뒤가 아니라 발표되는 당일 바로 여기에 반영됩니다. Ant​hropic이 이 요율표를 바꾸면, 여러분이 호출하는 가격도 함께 바뀝니다.

동일한 키로 이 페이지에서 비교하는 티어들에 접근할 수 있습니다 — anthropic/claude-opus-5는 $5.00/$25.00, anthropic/claude-fable-5.1는 $10.00/$50.00 — 나머지 Claude 라인업과 200개 이상의 다른 모델까지 함께 사용할 수 있으므로, 더 저렴한 토큰당 요금이 여러분의 실제 패스 수와 맞닥뜨렸을 때에도 버티는지 시험하는 데 별도의 계약이나 코드 변경이 필요하지 않습니다. 자동 페일오버는 익숙하지 않은 모델을 프로덕션 경로에서 그 경로를 걸고 도박하지 않고도 실행하고 싶은 경우를 위해 마련되어 있습니다.

이 페이지가 무엇에 관한 것인지에 대한 두 줄짜리 답: 요금표는 입력 $4.00, 출력 $20.00, 캐시 읽기 100만 건당 $0.20이며, 20% 인하는 오늘 실제이고 검증 가능합니다. 40%는 Anthropic이 선택한 워크로드 전반에 걸친 평균입니다. 두 번째 숫자를 기준으로 예산을 세우기 전에, 자신의 에이전트 루프 하나를 이것으로 돌려 보세요.

이 글에서 비교한 모델3

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트