생성된 히어로 카드: 제목은 Claude Sonnet 5.5 출시, 부제는 이미 Claude Sonnet 5에서 실행 중인 코드를 위한 다섯 가지 브레이킹 체인지, 배지는 백만당 $2 / $10 변동 없음, Intelligence Index 56 vs 38, 출시 2026-09-28을 표시하며, 푸터에는 Index에 대해 Artificial Analysis v4.3.2를, 가격 및 수명 주기에 대해 Anthropic을 인용합니다.
Guides & Insights

Claude Sonnet 5.5, Claude와 API에서 롤아웃 시작 — 기존 코드를 깨뜨리는 다섯 가지 변경 사항 포함

작성자

Magnus Corvin

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Claude Sonnet 5.5가 출시되었습니다. 공급업체의 발표는 2026년 9월 28일자이며, Claude Platform 모델 페이지에는 "Latest"로 표시되어 있고, 식별자는 claude-sonnet-5-5이며, Claude API, Amazon Bedrock, 클라우드 콘솔, Microsoft Foundry, AWS의 Claude Platform 전반에 걸쳐 사용됩니다. Claude 자체와 API로의 롤아웃은 이번 주에 진행되는 부분입니다. 하루를 잡아먹을 부분은 같은 문서의 다른 곳에 있습니다. 다섯 가지 호환성 파괴 변경이 Claude Sonnet 5에서 이미 실행 중인 코드에 영향을 미치며, 여섯 번째 변경은 단 하나의 요청도 실패시키지 않으면서 응답 형태를 바꿉니다.

이것이 이번 릴리스의 형태입니다. 요금표는 움직이지 않았습니다: Claude Sonnet 5.5는 백만 입력 토큰당 2달러, 백만 출력 토큰당 10달러로, Claude Sonnet 5와 정확히 같은 비용이며, 캐시 읽기는 0.20달러, 5분 캐시 쓰기는 2.50달러입니다. 성능은 크게 향상되었습니다. Artificial Analysis의 현재 개정판에서 새 모델은 대체하는 모델보다 18점 앞서는데, 이는 해당 보드에서 연속된 두 Sonnet 모델 간의 가장 큰 격차입니다. 마이그레이션 비용도 그에 따라 가장 큽니다. 그 중 어느 것도 불만은 아닙니다 — 더 비싸지지 않으면서 더 좋아지는 모델은 좋은 사례입니다 — 하지만 두 가지 사실이 함께 오며, 릴리스 노트는 당신의 한 주가 괜찮을지를 결정하는 절반입니다.

9월 28일에 실제로 출시된 것은 무엇인가

Anthropic's Claude Platform documentation page for Claude Sonnet 5.5, headed 'The best combination of speed and intelligence', showing the model ID claude-sonnet-5-5, a 1M-token context window, 128K max output, input pricing of $2 per million tokens and output pricing of $10 per million tokens, and the five breaking changes listed in the overview.

이 사양은 새로운 형태라기보다 해당 계층의 곧바른 연속입니다:

• 모델 ID — claude-sonnet-5-5는 Claude API, AWS의 Claude Platform 및 Microsoft Foundry에서; anthropic.claude-sonnet-5-5는 Amazon Bedrock에서

• 가격 — 입력 $2 / MTok, 출력 $10 / MTok, 5분 캐시 쓰기 $2.50, 1시간 캐시 쓰기 $4, 캐시 읽기 $0.20

• 배치 — 양방향 모두 50% 할인, 따라서 MTok당 $1 / $5

• 컨텍스트 및 출력 — 동기 방식으로 1M 토큰 입력, 128K 토큰 출력, output-300k-2026-03-24 베타 헤더

• 사고 — 적응형, 기본 노력 수준은 높음; 지식 및 학습 컷오프는 모두 2026년 6월

• 수명 주기 — 출시 시점부터 데이터 보존 제로, 그리고 2027년 9월 28일보다 이르지 않은 것으로 공개된 서비스 종료 하한선

두 가지 세부 사항은 놓치기 쉽고 중요합니다. 첫째, 롱 컨텍스트 할증료가 없습니다: Anthropic은 전체 100만 토큰 윈도우에 표준 요율을 청구하므로, 900,000토큰 요청의 토큰당 비용은 9,000토큰 요청과 같습니다. 둘째, 이전 모델의 $2 / $10 요율은 원래 2026년 9월 1일에 $3 / $15로 인상될 예정이던 도입 가격이었습니다; Anthropic의 가격 페이지는 이제 그 인상이 일어나지 않을 것이라고 밝히고 있으며, 이는 Sonnet 등급의 현재 가격을 프로모션이 아니라 상시 약속으로 만듭니다. 이 둘 모두 독립적인 조사 결과가 아니라 공급업체의 진술입니다.

마이그레이션 목록, 문제가 터질 순서대로

Anthropic의 Sonnet 5.5 개요는 이 점에 대해 이례적으로 직접적으로 말합니다. 다섯 가지 호환성 파괴 변경이 이미 Claude Sonnet 5에서 실행 중인 코드에 영향을 미칩니다. 이것들은 스타일상의 문제가 아닙니다. 각각은 오류를 반환하거나 동작을 조용히 변경합니다.

• 강제 도구 사용은 거부됩니다. tool_choice가 "any", 또는 이름이 지정된 도구의 경우, 이제 모델을 제약하는 대신 오류를 반환합니다. 에이전트 루프가 구조화된 호출을 보장하기 위해 도구를 고정한다면, 그 루프는 첫 번째 요청에서 작동을 멈춥니다. 대체 방법은 모델이 선택하고 결과를 검증하도록 하거나, 보장을 구조화된 출력으로 옮기는 것입니다.

• thinking: {"type": "disabled"} 설정은 거부됩니다. 사고를 완전히 끄는 것은 더 이상 지원되는 설정이 아닙니다. 대체 설정은 between_tools이며, 사전 사고를 끄고 high 노력 수준 이하에서 작동합니다. 이는 모델에서 가장 낮은 사고 설정이며, 끄는 스위치가 아닙니다.

• 사고 블록은 모델과 대화에 묶여 있습니다. 이전 턴에서 생성된 추론은 Claude Sonnet 5에서 Claude Sonnet 5.5로 전달되지만, 다른 패밀리로는 전달되지 않고, 계정 간에도 전달되지 않습니다. 계정 간에 트랜스크립트를 재생하는 애플리케이션.

• computer_20251124은(는) Claude API 또는 Google Cloud에서 허용되지 않습니다. 이전 컴퓨터 사용 도구 버전을 선언한 코드는 현재 도구 세트로 옮겨야 합니다.

• 어드바이저 도구가 자기 가족을 거부합니다. Claude Opus 4.8, Claude Opus 4.7 및 Claude Sonnet 5는 어드바이저로 거부되므로, 더 작은 Claude 모델을 더 큰 모델에 대한 검사기로 사용하던 모든 파이프라인은 재페어링이 필요합니다.

그다음에는 아무것도 실패시키지 않는 변경이 있습니다. 모델이 도구 호출 사이에 내보내는 텍스트는 이제 thinking 블록 안으로 들어오며, 일반 출력으로는 들어오지 않습니다. 사용자에게 텍스트를 스트리밍하는 애플리케이션은 도구 호출 사이에 조용해집니다 — 오류도, 예외도 없이, 단지 UI가 멈춘 것처럼 보일 뿐입니다. display 값을 설정해 텍스트를 반환하게 하거나 between_tools로 전환할 때까지 말이죠. 이것은 테스트 스위트에서 아무것도 예외를 던지지 않기 때문에 프로덕션에 도달할 가능성이 가장 높은 실패 모드입니다.

완전성을 위해 하나 더: temperature, top_p 또는 top_k를 기본값이 아닌 값으로 설정하면 400이 반환됩니다. 게이트웨이나 클라이언트 라이브러리가 의도가 아니라 습관적으로 temperature를 설정한다면, 그 습관은 이제 장애입니다.

독립적 수치와 대조한 30% 주장

Artificial Analysis model page for Claude Sonnet 5.5 (adaptive reasoning, max effort, default fallback), released September 2026, showing an Intelligence Index of 56 at rank 3 of 216 models, pricing of $2.00 per million input tokens and $10.00 per million output tokens, an average cost of $7.60 per Intelligence Index task, a measured output speed of 142 tokens per second, 410M output tokens generated during the Index evaluation against a median of 88M, and a 1M-token context window.

Anthropic이 Claude Sonnet 5.5를 홍보하는 문구는 동일한 토큰당 요율에서 "작업당 비용이 이전 모델보다 최대 30% 적게 든다"는 것과 Claude Sonnet 5보다 "출력을 30% 이상 더 빠르게 생성한다"는 것입니다. 둘 다 가격이 아니라 토큰에 관한 주장이며, 둘 다 공급업체가 보고한 것입니다. 첫 번째 주장의 메커니즘은 공급업체 자체의 벤치마크 표에서 확인할 수 있습니다. Terminal-Bench의 Medium 노력 수준에서 Anthropic은 Claude Sonnet 5.5가 "작업당 비용의 10분의 1도 안 되는 비용"으로 Claude Sonnet 5의 최고 점수를 능가한다고 말하며, CursorBench의 Low 노력 수준과 AA-Briefcase의 Medium 수준에서도 비슷한 주장을 합니다.

독립적인 평가는 방향에는 동의하지만 규모에는 이견을 보인다. Artificial Analysis의 v4.3.2 Intelligence Index에서 — 모든 모델에 걸쳐 하나의 구성으로 실행된 10개 평가 — Claude Sonnet 5.5는 56점을 기록하며, 이 페이지는 이를 216개 중 3위로 올려놓는다. Claude Sonnet 5는 같은 순위표에서 38점을 기록한다. 이는 같은 등급, 같은 가격의 연속된 두 모델 사이의 18점 차이며, Anthropic이 올해 Sonnet 라인 내에서 벌린 가장 큰 격차다.

비용 수치는 벤더의 주장이 버티기 어려워지는 지점이다. Artificial Analysis는 Claude Sonnet 5.5가 Intelligence Index 과제당 7달러라고 측정한다. 그 금액은 동급 모델 중 어느 것보다 30% 낮은 수준이 아니다. 왜냐하면 이 모델은 극도로 장황하기 때문이다. Index 평가를 완료하는 데 4억 1,000만 개의 출력 토큰을 내보냈으며, 이는 비교 가능한 모델들의 중앙값 8,800만 개와 대비된다. 토큰당 효율과 과제당 효율은 서로 다른 양이며, Claude Sonnet 5.5는 전자에서는 유난히 뛰어나지만 후자에서는 평균에 그친다.

이번 릴리스에 대한 Anthropic 자체의 모든 벤치마크 수치는 벤더가 보고한 것이며 제3자가 재현하지 않았습니다. 그중 두 수치에는 다시 언급할 가치가 있는 각주가 달려 있습니다. GDPval-AA v2.1 및 AA-Briefcase v1.1 수치는 Artificial Analysis가 출시 전 배포 환경에서 실행했는데, 그 환경에는 점수를 실제보다 낮게 나타냈을 가능성이 있는 버그가 있었습니다. 그리고 FrontierCode 1.1 수치에 대한 Anthropic의 설명은 해당 평가에서 Claude Sonnet 5.5가 Max effort에서 Xhigh보다 더 낮은 점수를 받는 이유를 밝히고 있습니다. 모델이 더 낮은 effort 설정에서 자기 자신을 이기는 표는 그 벤치마크 구성이 아직 확정되지 않았음을 알려 주는 표입니다.

프로덕션 경로를 걸지 않고 테스트하는 방법

마이그레이션 과정에서 벤더 엔드포인트에 직접 요청하는 대신 라우터를 통해 Claude Sonnet 5.5를 실행해야 할 구체적인 이유가 있습니다. 어떤 모델이 맞는지 알아보는 동안 기존 모델과 새 모델 중 하나를 선택할 필요가 없기 때문입니다. OrcaRouter에서는 Claude Sonnet 5가 6월 30일부터 Anthropic 자체 가격인 $2 / $10으로 추가 마크업 없이 라우팅할 수 있었으며, 단일 OpenAI 호환 엔드포인트 뒤에 있는 200개 이상의 모델 중 하나이고, 여전히 대부분의 Claude API 트래픽이 사용하는 모델입니다. Claude Sonnet 5.5는 아직 저희 카탈로그에 없으므로, 오늘 그것으로 가는 경로는 Anthropic 자체 API입니다.

그동안 통하는 패턴은 트래픽의 일부를 새 모델로 보내고 나머지는 페일오버가 처리하도록 두는 것입니다 — 폴백으로 Claude Sonnet 5를 두면, 다섯 가지 브레이킹 체인지 중 하나에서 나온 400이 실패한 요청이 아니라 더 느린 답변으로 저하됩니다. 이는 또한 벤더의 주장이 알려주지 않는 것을 측정하는 가장 저렴한 방법이기도 합니다. 바로 동일한 에포트 설정에서 두 모델 모두에 대한 작업당 여러분 자신의 토큰 수입니다. 30%라는 수치는 Anthropic 자체 평가의 평균입니다. 여러분의 트래픽은 그 평균이 아닙니다.

다음에는 무엇이 도착할까

Anthropic의 발표에 따르면 Claude Haiku 5.5가 “앞으로 몇 주 안에” 패밀리에 합류하며, 이로써 소형 티어에서 5.5 세대가 완성될 예정이다. 그때까지는 프로덕션에서 Sonnet을 운영하는 팀 앞에 놓인 두 가지 결정을 분리해서 볼 수 있다: 마이그레이션은 일정에 잡아둘 수 있는 하루짜리 작업이고, 모델 교체는 미뤄도 되는 측정이다. 이 둘을 반대 순서로 처리하는 것—먼저 교체하고 프로덕션에서 forced-tool-use 오류를 발견하는 것—은 주말을 날려버리는 이번 롤아웃의 한 방식이다.

Single-column scoreboard for Claude Sonnet 5.5 with six rows: Released September 28 2026, Model ID claude-sonnet-5-5, Price $2.00 / $10.00 per 1M, Intelligence Index 56 at rank 3 of 216, Cost per Index task $7.60, and Output speed 142 tokens/sec, with a footer reading 'Index, cost per task and speed per Artificial Analysis v4.3.2; pricing and lifecycle per Anthropic.'