Claude Opus 5.5 vs Claude Sonnet 5를 위한 생성된 타이틀 카드로, '절반의 가격, 20 지수 포인트, 5개월의 사각지대'라는 부제가 있으며, 세 개의 플랫 라인 아이콘(스택형 데이터베이스 마크, 상승하는 막대 차트, 시계가 있는 달력)과 '지수는 최대 노력에서 Artificial Analysis 기준; 가격은 Anthropic 기준.'이라는 하단 문구가 있습니다. 실제 OrcaRouter 로고는 오른쪽 하단에 합성되어 있습니다.
Guides & Insights

Claude Opus 5.5 vs Claude Sonnet 5: 절반의 가격, 20 지수 포인트, 그리고 5개월의 사각지대

작성자

Elias Hawthorne

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

규칙만 원한다면: 기본적으로 Claude Sonnet 5를 실행하고, 작업이 실패하면 Claude Opus 5.5로 에스컬레이션하세요. 더 저렴한 모델이 정말로 절반 가격이고, 정말로 다른 능력 등급이기 때문입니다. 그 뒤에 있는 두 숫자는 38과 58입니다 — 동일한 평가자, 동일한 구성 계열에서 Artificial Analysis Intelligence Index에 대한 Sonnet 5와 Opus 5.5의 점수입니다. 그 지수에서 20점 차이는 타이브레이커가 아니며, 현재 구성할 수 있는 어떤 Claude 대 Claude 대결에서도 가장 큰 격차입니다: Claude Opus 5.5는 210개 모델 중 1위이고 Claude Sonnet 5는 54위이며, 두 모델의 가격 차이는 백만 입력 토큰당 2달러입니다.

그건 쉬운 절반이다. 어려운 절반은 선택적으로 에스컬레이션하려면 어떤 작업이 실패하는지 알아야 한다는 점이고, 두 모델이 2026년 1월 이후의 세계에 대해 어떤 평가도 오류로 드러내지 못하는 방식으로 서로 다르게 본다는 점이다.

맥락으로 본 20점 격차

A two-column scoreboard comparing Claude Opus 5.5 and Claude Sonnet 5 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 38, ranked #54), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), default effort (medium against high), knowledge cutoff (Jun 2026 against Jan 2026), output speed (not yet published against 79.3 tokens per second) and cache read ($0.20 per million on both). The footer reads 'Index and speed figures per Artificial Analysis at max effort; prices, effort defaults and cutoffs per Anthropic.'

Artificial Analysis는 각 모델을 하나의 공개된 구성으로 실행하며, 이 두 모델은 "Adaptive Reasoning, Max Effort"라는 동일한 패밀리 레이블을 공유하기 때문에 비교가 유난히 깔끔해집니다:

• 지능 지수 — Claude Opus 5.5 58, 210개 중 1위 vs Claude Sonnet 5 38, 54위

• 가격 — Claude Opus 5.5 백만 토큰당 입력 $4.00 / 출력 $20.00 vs Claude Sonnet 5 $2.00 / $10.00

• 출력 속도 — Claude Sonnet 5 초당 79.3 토큰 vs Claude Opus 5.5는 아직 리더보드에 공개되지 않음

• 첫 토큰까지 걸리는 시간 — Claude Sonnet 5 150.02초 vs 게시판 중앙값 3.83초

• 기본 노력 수준 — Claude Opus 5.5 중간 vs Claude Sonnet 5 높음

• 지식 컷오프 — Claude Opus 5.5는 2026년 6월, Claude Sonnet 5는 2026년 1월

• 컨텍스트 및 출력 — 둘 다 1M 컨텍스트와 128K 최대 출력

순위 열은 곱씹어 볼 만한 부분이다. 지수 20포인트는 리더보드에서 4계단이 아니라 49계단이다. 210개 모델이 있는 보드에서 Opus 5.5와 Sonnet 5는 가격 차이가 나는 이웃이 아니다 — 서로 다른 구간에 있으며, 백만 토큰당 2달러 격차는 배지가 아니라 실제 역량 단계를 사는 것이다. 이번 주 보도를 “Anthropic이 더 저렴한 Opus를 출시했다”고 읽고 Sonnet 등급이 그것을 흡수했다고 가정한 사람이라면 그 순위 쌍을 봐야 한다: Anthropic 자체 가격 페이지에는 여전히 Claude Sonnet 5가 현재 제품으로 올라 있고, 독립 보드에서의 위치는 움직이지 않았다.

이 이야기를 정직하게 유지하는 두 가지 단서가 있습니다. 두 점수 모두 최대 노력(max effort)으로 실행되었고, 어느 모델의 출시 기본값도 최대가 아닙니다. Sonnet 5의 기본값은 high이고, Opus 5.5는 medium입니다. 또한 속도 항목은 Sonnet 5에 유리한 쪽으로 이야기를 복잡하게 만듭니다. 초당 79.3토큰에 첫 토큰까지 150초라는 것은 실제로 측정된 지연 프로필이며, 두 모델 중 이 보드에 존재하는 유일한 수치입니다. Opus 5.5의 속도와 지연 시간은 Artificial Analysis가 공개하지 않았으므로, 이번 대결에서 "더 빠르다"는 주장은 현재로선 측정치가 아니라 벤더 자료에 기대고 있습니다.

Sonnet 5의 가격을 바꾸는 각주

Claude Sonnet 5를 두고 지난달 나온 가장 구체적인 내용은 대부분의 보도가 빠뜨린 한 문장이다. 이 모델이 2026년 6월 30일에 출시됐을 때, $2 / $10 요금은 8월 31일까지 적용되는 도입 가격으로 발표됐고, 9월 1일에는 $3 / $15로 인상될 예정이었다. Anthropic의 현재 가격 페이지에서 각주는 $2/$10 가격이 "이제 표준 가격"이며 그 인상은 "일어나지 않을 것"이라고 적고 있다.

그건 두 가지 이유에서 중요합니다. 뻔한 이유는 발표됐다가 취소된 50% 인상은 이제 계획을 세울 수 있는 비용 항목이라는 점입니다. Sonnet 5는 만료 시점을 모델링해야 하는 프로모션 요금이 아닙니다. 덜 뻔한 이유는 이것이 단계 상향 산술을 바로잡아 준다는 점입니다. Sonnet 5가 $2/$10으로 영구 고정되고 Opus 5.5가 $4/$20이라면, 두 등급 사이의 비율은 양방향 모두 정확히 2배이며 안정적입니다. 예컨대 트래픽의 5분의 1을 Opus 5.5로 보내는 상향 규칙이라면, 비용을 한 번 계산해 두고 다시 계산하지 않아도 됩니다.

배치 및 캐시 요금은 함께 움직이는데, 이것이 전체 표 비교를 유용하게 만듭니다. Sonnet 5는 배치 시 $1.00 / $5.00로, Opus 5.5의 $2.00 / $10.00과 대비되며, 둘 다 캐시 읽기를 백만 토큰당 $0.20로 청구합니다. 이 마지막 수치는 진정한 동점입니다. Opus 5.5는 캐시 읽기 요금을 $0.50에서 $0.20로 인하했고, Sonnet 5는 이미 그 수준이었습니다. 워크로드가 새로운 출력을 생성하기보다 대규모 캐시된 컨텍스트를 다시 읽는 것이 주를 이룬다면, 더 저렴한 모델의 가격 이점은 대표 비율이 시사하는 것보다 훨씬 작습니다. 왜냐하면 두 모델이 일치하는 유일한 항목이 바로 가장 많은 비용을 지출하는 항목이기 때문입니다.

차단은 조용히 실패하는 부분이다

A generated two-card graphic titled 'Knowledge cutoffs, five months apart', showing Claude Sonnet 5 with a knowledge cutoff of January 2026 against Claude Opus 5.5 with a cutoff of June 2026, separated by a marker reading '5 months of coverage'. The footer reads 'Cutoff dates per Anthropic's Claude model documentation, current as of September 2026.'

Claude Opus 5.5는 2026년 6월을 지식 컷오프로 삼습니다. Claude Sonnet 5의 지식 컷오프는 2026년 1월입니다. 이는 다섯 달의 차이이며, 이 비교에서 스스로를 드러내지 않는 유일한 차원입니다. 어떤 사건을 알지 못하는 모델이 그 사건에 대해 더 느리거나 덜 정확해지는 것은 당신의 오류 처리가 잡아낼 수 있는 방식이 아닙니다 — 그것은 이미 앞서 나가 버린 세상으로부터 자신 있게 답하며, 그 실패는 거부가 아니라 그럴듯한 오답처럼 보입니다.

일부 워크로드에서는 이것이 무관합니다. 관례가 안정적인 코드베이스를 리팩터링하거나, 사용자가 제공한 문서를 요약하거나, 구조화된 데이터를 변환하는 경우가 그렇습니다. 다른 워크로드에서는 20점의 지수 점수나 가격과 관계없이 그 자체로 자격 미달 사유가 됩니다. 2026년 하반기에 출시된 소프트웨어와 관련된 모든 것, 최근 사건에 관한 질문에 답하는 모든 것, 1월 이후 변경된 API나 라이브러리 버전에 의존하는 모든 것은 Opus 5.5로 에스컬레이션할 수 없고, 거기서 시작해야 합니다. 그 다섯 달은 품질 차이가 아니라 범위 제한이며, 이는 평가가 아니라 라우팅 규칙에 들어가야 합니다.

두 모델은 엔벨로프의 나머지 부분을 공유하므로, 컷오프를 얼마나 우회할 수 있는지가 제한됩니다. 둘 다 1M 토큰의 컨텍스트를 받고 최대 128K를 반환하며, 둘 다 끌 수 없는 적응형 사고를 실행하고, 깊이는 effort 매개변수를 통해서만 드러냅니다. Sonnet 5에 더 긴 문서를 넘겨 이를 보상하는 구성은 존재하지 않습니다.

분할 실행 중

이 맞대결의 실용적인 판단 기준은 기본값과 예외이며, 그 예외는 '어려운 작업'이 아닌 다른 무언가로 정의되어야 합니다. 견고하게 유지되는 패턴은 난이도가 아니라 작업 클래스에 따른 것입니다: Sonnet 5는 컷오프가 무관하고 지연 시간 프로필이 수용 가능한 대량 작업에, Opus 5.5는 최신 작업, 장기 지평 작업, 또는 실패한 시도가 토큰 차이보다 더 큰 비용을 초래하는 모든 작업에 사용합니다.

그것은 재작성이 아니라 라우팅 구성이며, 바로 여기에서 단일 엔드포인트가 제 몫을 해냅니다. Claude Sonnet 5는 OrcaRouter에서 Anthropic 자체 가격인 $2.00 / $10.00에 제공되고, 그리고 Claude Opus 5.5는 $4.00 / $20.00에 제공됩니다 — 공급자 정가를 0% 마크업으로 그대로 전달하므로, 에스컬레이션 규칙의 비용 비율은 Anthropic이 공개한 비용 비율 그대로이며, 이를 흔드는 마크업 계층이 전혀 없습니다. 두 모델 모두 하나의 키 뒤에 있기에, 에스컬레이션 경로는 두 번째 통합이 아니라 규칙을 한 번 수정하는 일이 되고, 자동 페일오버는 실패한 프라이머리가 요청까지 함께 끌고 내려가지 않도록 막아주며, 임계값을 결정하는 그 비교는 두 벤더의 표를 재구성하는 대신 여러분 자신의 트래픽 안에서 직접 실행할 수 있는 것이 됩니다.

A screenshot of OrcaRouter's own model page for anthropic/claude-sonnet-5, headed 'Claude Sonnet 5' and credited to Anthropic, showing $2.00 input and $10.00 output per 1M tokens, a 1M-token context and a PERFORMANCE panel with 79.3 output tokens per second, a 150.02s time to first token and 55M output tokens over 7 days.

누가 움직여야 하고, 누가 기다려야 할까요?

이미 Claude Sonnet 5를 사용 중이고 잘 작동하고 있다면, 그것을 교체할 명분은 약하다: 모델 가격이 절반이고, 그 요금은 이제 영구적이며, 지수 격차는 그 모델이 실패하는 작업에서만 문제가 된다. 그 위에 Claude Opus 5.5를 추가할 명분은 강하다. 단, 트리거를 명시할 수 있을 때에 한해서다 — 그리고 그 트리거는 보통 컷오프 실패이거나, Sonnet 5가 최대 노력 실행으로도 여전히 틀리는 작업이다.

첫 Claude 모델을 고르는 중이라면, 답은 가격 비율이 보여주는 것만큼 균형 잡혀 있지 않다. 20점의 지수 격차와 다섯 달 더 많은 지식은 토큰 두 배라는 대가를 치르는 거래인데, 대부분의 프로덕션 워크로드는 이 거래를 일부 호출에서만 받아들이고, 거의 모든 호출에서 받아들이는 경우는 없다. 어느 방향으로든 피해야 할 실수는 둘을 서로 바꿔 쓸 수 있는 것으로 취급하고 비용만 보고 갈아타는 것이다. 그 뒤에 따르는 실패는 더 나쁜 답이 아니라, 1월에 끝나버린 세상에 대한 자신감 넘치는 답이기 때문이다.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트