
Claude Sonnet 5.5: 중급 기본 모델, 완전한 사양
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
Claude Sonnet 5.5는 Claude 라인의 중간 계층 모델로, 2026년 9월 28일에 출시되었으며, 이 페이지를 만들 가치가 있는 이유는 전적으로 가격에 있다. 입력 토큰 백만 개당 $2, 출력 토큰 백만 개당 $10이며, 그에 맞서는 $4와 $20이 Claude Opus 5.5, 6일 먼저 출시된 플래그십의 가격이다. 이는 Artificial Analysis 지능 지수(Intelligence Index) 1.62포인트에 대해 출력 가격이 절반이라는 뜻이다. 중간 계층이 56.00, 플래그십이 57.62로, 두 수치 모두 지수 리비전 v4.3.2에서 Artificial Analysis가 측정한 것이지 우리가 측정한 것도, 벤더가 측정한 것도 아니다. 이 둘 위에는 Claude Fable 5.1이 $10 / $50, 같은 리비전에서 53.35로 자리한다. 플래그십보다 비싸면서 그보다 뒤처진다. Claude Sonnet 5.5와 같은 $2 / $10 정가에는 OpenAI의 GPT-6.1 Sol이 51.83으로 있는데, 선 반대편으로 지수 100분의 417(4.17포인트)만큼 떨어져 있으며, 이는 중간 계층을 저울질하는 독자가 실제로 해야 하는 비교다.
이 페이지는 참고 자료이며, 날짜는 최신성 때문이 아니라 그 이유를 말해 준다. Claude Sonnet 5.5는 2026-10-08 기준으로 출시 10일째이므로, 이 블로그가 뉴스를 다루는 7일 범위 밖에 있다. 그 범위 안에 있는 것은 6일 된 사건이다: 2026-10-02자 X 게시물 두 개가, 이 제품군의 후속 모델이 자사 공급업체가 완성해 놓고 공개하지 않은 모델을 능가한다고 주장한다. 그 주장 뒤에는 여기서 접근 가능한 어떤 레지스트리에도 모델 ID도, 요금표도, 컨텍스트 윈도도, 벤치마크도 없으며, 이 페이지의 주제도 아니다 — 출처 체인, 공급업체 표면 부재 확인, 5개 모델 인덱스 스프레드는 모두 이 블로그가 이미 《Claude Fable 5.5 Beat GPT-6.1 Astra Before It Exists — and That Is the Interesting Part》라는 제목으로 발행한 글(2026-10-03자)이 전적으로 다룬다. 그 주장이 실제로 만들어 낸 것은 독자들이 기다리는 동안 어떤 출시된 Claude 모델을 표준으로 삼을지 묻는 질문 대기열이며, 그 질문에는 존재하는 모델에 관한 페이지가 필요하다. 바로 이 페이지다.
2026년 9월 28일에 무엇이 출시되었나요?
벤더 자체의 문서가 사양을 직접 제시하고 있으며, 이는 새로운 형태라기보다 해당 티어의 연장선상에 있습니다. 아래의 모든 내용은 2026-10-08에 Anthropic의 Claude Platform 문서에서 읽은 것이므로, 독립적인 검증이 아니라 Anthropic의 사양입니다.
• 출시 — 2026년 9월 28일. 해당 모델 자체의 문서 페이지는 "최신. 2026년 9월 28일 출시."라는 문구로 시작합니다.
• 포지셔닝 — "속도와 지능의 최상의 조합"으로, 비교 지연 시간이 Claude Opus 5.5의 보통 대비 빠름, Claude Fable 5.1의 더 느림, 소형 등급의 가장 빠름으로 기재됨.
• 모델 ID — claude-sonnet-5-5 Claude API, Google Cloud, Microsoft Foundry 및 AWS의 Claude Platform에서; anthropic.claude-sonnet-5-5 Amazon Bedrock에서. 모든 Claude 모델 ID는 고정된 스냅샷이므로, 이 문자열은 사용자 몰래 바뀌는 포인터가 아닙니다.
• 컨텍스트와 출력 — Messages API에서 1,000,000 토큰의 컨텍스트와 128,000 토큰의 동기 출력을 제공하며, output-300k-2026-03-24 베타 헤더를 사용하면 300,000까지 증가합니다.
• Thinking — 적응형이며 기본적으로 항상 켜져 있고 기본 effort는 high입니다. 가장 낮은 설정은 between_tools이며, 이는 사전 사고를 끄고 high effort 이하에서 허용됩니다. temperature, top_p 또는 top_k를 기본값이 아닌 값으로 설정하면 400 오류가 반환되므로, temperature를 튜닝한 상태로 이전 Claude 모델에서 마이그레이션된 요청은 조용히 실패하지 않고 명확하게 실패합니다.
• 지식 컷오프 — 2026년 6월, 신뢰할 수 있는 기준 시점과 학습 데이터 기준 시점 모두.
• 수명 주기 — 활성(최신)이며, Anthropic이 운영하는 플랫폼에서는 2027년 9월 28일보다 이른 시점에 지원이 종료되지 않도록 보장합니다. Amazon Bedrock과 Google Cloud는 자체 일정을 따릅니다.
벤더의 출시 프레이밍은 인용할 가치가 있습니다. 그것은 측정값이 아니라 주장이기 때문입니다: Anthropic의 발표는 Claude Sonnet 5.5를 "Sonnet 5보다 확실한 업그레이드이며 대부분의 작업에서 30% 더 빠르게 실행되고 최대 30% 더 저렴합니다"라고 설명합니다. 그 문장은 벤더의 것이며 우리가 재현한 것이 아니고, 그것은 전적으로 어떤 작업을 앞에 놓느냐에 달려 있는 종류의 주장입니다. 또한 이 릴리스에는 이 페이지가 다룰 곳이 아닌 마이그레이션 비용이 따릅니다: 다섯 가지 브레이킹 체인지가 이미 Claude Sonnet 5에서 실행 중인 코드에 영향을 미치고, 여섯 번째 변경은 어떤 요청도 실패시키지 않으면서 응답 형태를 바꿉니다. 그 회계는 이 블로그가 출시 주간에 게시한 롤아웃 글에 속하며, 오늘 Sonnet 5를 프로덕션에서 사용하고 있다면 가장 먼저 읽어야 할 것입니다.

1.62 포인트, 그리고 반값
이 모델의 독립적인 점수는 한 곳에서 나오며, 그 점수에는 논쟁의 향방을 결정하는 숫자 하나가 담겨 있습니다. Artificial Analysis는 Claude Sonnet 5.5를 자사의 Intelligence Index, revision v4.3.2에서 56.00점으로, 페이지가 "Claude Sonnet 5.5 (Max, Default Fallback)"이라고 명명한 구성에서 측정합니다. 우리는 2026-10-08에 그 페이지를 읽었습니다. 같은 리비전, 같은 날:
• Claude Opus 5.5 — 57.62, 2026-09-22 출시, $4 / $20
• Claude Sonnet 5.5 — 56.00, 2026-09-28 출시, $2 / $10
• Claude Fable 5.1 — 53.35, 2026-09-01 출시, $10 / $50
• GPT-6 Astra — 52.67, 2026-09-03 출시, $10 / $50, 272,000 프롬프트 토큰 초과 장문맥 등급은 $20 / $75
• GPT-6.1 Sol — 51.83, 2026-09-29 출시, $2 / $10
어느 리비전인지 밝히는 것이 중요합니다. 인덱스의 한 버전에서 나온 점수는 다른 버전에서 나온 점수와 비교할 수 없기 때문입니다: v4.3.2는 열 가지 평가 — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1 — 를 포함하며, 그 집합의 구성은 리비전에 따라 바뀌어 왔습니다. 위의 다섯 수치는 모두 같은 리비전에서 나온 것이므로 서로 비교해 읽을 수 있고, 이전 버전에서 인용된 숫자와는 비교해 읽을 수 없습니다.
가격 비교는 행동을 결정하는 부분이다. Claude Sonnet 5.5의 출력 요금은 Claude Opus 5.5의 절반이고, 입력 요금도 절반이다. 벤더 자체 목록에서 중간 등급은 $2 / $10이고 플래그십은 $4 / $20이다. 발표된 두 숫자를 함께 놓고 계산하면 비율은 극명하다. 출력 목록 가격 1달러당 Claude Sonnet 5.5는 5.60 지수 포인트를, Claude Opus 5.5는 2.88을 기록한다 — Anthropic 자체 요금표와 Artificial Analysis 자체 측정에 따르면 출력 1달러당 거의 두 배의 지수다. 이는 무엇인가를 측정한 것이 아니라 발표된 두 수치에 대한 산술이며, 중간 등급을 위한 주장의 정직한 형태다. 이는 또한 판결이 아니다. 지수 포인트는 정확성의 단위가 아니며, 이 페이지의 나머지 부분의 요점은 1.62가 무엇으로 이루어졌고 무엇으로 이루어지지 않았는가이다.

요금표, 그리고 가장 많이 변동하는 두 항목
Anthropic의 전체 가격표, 2026-10-08 확인 기준. 이 섹션의 모든 수치는 공급업체가 제공한 값입니다.
• 입력 — 백만 토큰당 $2.00입니다. 출력 — 백만 토큰당 $10.00이며, 사고 토큰은 출력으로 청구되는데, 여기서는 적응형 사고가 기본적으로 켜져 있기 때문에 이를 억제할 수 없습니다.
• 캐시 읽기 — 백만 개당 $0.10이며, Anthropic은 이를 기본 입력 가격의 5퍼센트로 문서화하고 있습니다. 이는 Claude Opus 5.5가 제공하는 것과 동일한 비례 할인율이므로, 캐싱이 두 모델 간의 순위를 바꾸지는 않으며, 안정적인 프리픽스가 유지되는 긴 에이전트 실행에서는 다시 읽는 모든 항목에 입력 요율의 10분의 1만 지불하게 된다는 뜻입니다.
• 캐시 쓰기 — 5분 캐시의 경우 백만 토큰당 $2.50, 1시간 캐시의 경우 $4.00입니다. 최소 캐시 가능 프롬프트 길이는 512토큰이므로, 짧은 프롬프트는 할인을 전혀 받을 수 없습니다.
• Batch API — 양방향 모두 50% 할인되어, 기다릴 수 있는 작업은 입력 $1.00, 출력 $5.00입니다.
• 장문 컨텍스트 추가 요금 없음 — Anthropic은 이 모델에서 전체 100만 토큰 창을 표준 토큰당 요율로 청구하므로, 900,000토큰 요청도 9,000토큰 요청과 토큰당 비용이 같습니다. 이는 GPT-6 Astra와는 실질적인 차이입니다. GPT-6 Astra의 272,000 프롬프트 토큰 초과 장문 컨텍스트 등급은 $20 / $75로 올라가며, 프롬프트가 길어지면 두 공급업체의 대표 수치가 급격히 갈리는 유일한 지점이라는 점에서 언급할 가치가 있습니다.
대부분의 청구서를 결정하는 것은 대표 요율이 아니라 두 항목입니다: 긴 에이전트 실행 전반에 걸친 캐시 읽기 할인, 그리고 비동기 작업에 대한 배치 할인입니다. 리더보드에서 비교되는 것은 대표적인 $2 / $10이고, 월별 청구서가 실제로 만들어지는 근거는 캐시와 배치 항목입니다.
그 격차가 의미하는 것과 의미하지 않는 것
Intelligence Index는 고정된 작업 구성 전반에 걸친 하나의 숫자이며, 이 단일한 특성이 그 주변의 혼란 대부분을 설명합니다. v4.3.2를 뒷받침하는 열 가지 평가에는 에이전틱 코딩 및 터미널 작업, 대학원 수준의 과학적 추론, 소프트웨어 엔지니어링 세트, 에이전틱 자동화 세트, 장문 맥락 검색 세트가 포함되며, 이들은 하나의 합성 지표로 가중됩니다. 어떤 모델이 다른 모델보다 1.62점 뒤처져 있다면, 그것은 그 합성 지표에서 뒤처진 것이지, 여러분의 워크로드에서 뒤처진 것이 아닙니다. 여러분의 워크로드는 그 열 가지를 완전히 다른 비율로 가중할 수 있으며, 그중 어느 것도 대표하지 않는 작업을 포함할 수도 있습니다.
실제로 이것이 의미하는 것은 등급의 위세가 아니라 작업의 형태에 따른 구분이다. Anthropic 자체의 모델 선택기는 이 구분을 명시적으로 드러내며, 중간 등급을 치켜세우지 않기 때문에 읽어볼 가치가 있다. 문서는 독자들에게 "대부분의 워크로드에는 Claude Opus 5.5로 시작하라"고 말하고, Claude Fable 5.1은 "까다로운 추론과 장기 지평의 에이전트 작업에, 또는 더 높은 effort에서 Claude Opus 5.5에 대한 평가가 여전히 기준에 못 미칠 때" 선택하라고 한다. 그 문장이 시작하는 모델은 Claude Sonnet 5.5가 아니다. 그것은 같은 문서가 속도와 지능의 최상의 조합이라고 설명하는 모델이며, 소형 등급을 제외하면 가장 빠른 상대적 지연 시간을 갖는다 — 이는 다른 주장이고, 더 좁은 주장이다.
그렇다면 솔직한 해석은 이렇습니다. 중간 티어는 대개 범위가 잘 정의된 대량 작업에 맞는 정답입니다. 알려진 코드베이스를 대상으로 한 기능 개발과 버그 수정, 출력 형태가 정의된 추출 및 분류, 어려운 부분이 추론이 아니라 하네스인 도구 호출 루프, 그리고 역량의 마지막 2퍼센트보다 빠른 첫 토큰과 호출당 낮은 비용이 더 중요한 모든 작업이 그렇습니다. 플래그십은 작업이 진정으로 장기 지평일 때 그 요금을 받을 자격을 합니다. 즉 수 시간짜리 에이전트 실행, 프롬프트에 한 번에 담을 수 없는 파일들에 걸친 리팩터링, 그리고 더 높은 노력 수준에서 측정 가능하게 부족한 중간 티어 평가 같은 경우입니다. 마지막 조건은 공급업체가 직접 내세운 조건이며, 검증 가능한 조건입니다. 중간 티어의 노력 수준을 높이고 직접 평가를 실행해 격차가 좁혀지는지 보십시오. 그렇다면 1.62는 당신에게 없어서는 안 될 요소가 아니었던 것입니다. 그렇지 않다면, 당신은 다른 누군가의 종합 점수가 아니라 자신의 숫자로 답을 산 셈입니다.
그 격차가 1.62점이 아무것도 아니라는 뜻은 아니다. 그것은 두 모델 사이의 전체 격차이며, 동일한 조건에서 평가되는 고정 하네스에서는 실제적인 순위다. 그것은 단지 특정 작업 구성에서, 최대 노력(max effort)과 기본 폴백(default fallback)으로 얻은 순위일 뿐이며, 둘 중 어느 것도 벤치마크되지 않은 워크로드에서 둘 중 어느 쪽이 더 나은 선택인지는 말해주지 않는다.
이름의 함정: 이것이 어느 Claude Sonnet 5.5 페이지인가
이 모델의 이름을 검색하는 독자는 이 블로그에서 이 글처럼 보이지만 실제로는 그렇지 않은 여러 페이지를 만나게 된다. 2026-09-24 날짜의 글은 예고 페이지다: 모델이 출시되기 전에 작성되었으며, 그 주제는 스텔스 테스트를 주장하는 단일 X 게시물을, 해당 모델이 대체하게 될 모델의 수치에 맞춰 재구성한 것이었다. 출시 주간에 게시된 글은 롤아웃 기사다: 이미 Claude Sonnet 5에서 실행 중인 코드에 영향을 미치는 다섯 가지 브레이킹 체인지와, 오류를 발생시키지 않으면서 응답 형태를 바꾸는 여섯 번째 변경 사항을 다룬다. 또한 이 모델의 이름을 다른 벤더의 모델들과 맞붙여 놓은 대결 페이지들이 여러 개 있고, 이번 릴리스의 프로모션이 무엇을 포함하는지 다룬 적용 페이지도 있다.
그중 어느 것도 모델 페이지는 아니며, 이 글은 바로 그 공백을 메웁니다. 이 페이지는 독자가 모델의 이름 자체를 검색한 뒤 찾게 되는 참조 자료입니다. 즉, 그것이 무엇인지, 비용은 얼마인지, 무엇을 측정하는지, 그리고 어떤 작업이 그것에 속하는지를 다룹니다. 롤아웃 페이지의 마이그레이션 세부 정보와 예상 페이지의 소싱 비판은 각자의 자리에 그대로 남아 있습니다. 프로덕션에 Sonnet 5 코드가 있다면 롤아웃 페이지가 첫 번째 클릭 대상이고, 이 페이지는 여러분이 마이그레이션하려는 모델이 바로 원하는 모델인지 알려줍니다.
이왕 말이 나온 김에 바로잡을 만한 명명 관행이 하나 있습니다. 그것만으로도 오해를 불러일으키기 때문입니다. 5.5 접미사는 순위가 아니라 세대를 나타냅니다. Claude Sonnet 5.5와 Claude Opus 5.5는 같은 패밀리의 같은 세대이며, 점 앞의 숫자가 티어입니다. 접미사만으로는 어느 쪽이 벤치마크에서 이기는지 알 수 없습니다.
가용성, 날짜 표시
Claude Sonnet 5.5는 출시된 때부터 OrcaRouter에 anthropic/claude-sonnet-5.5로 등록되어 있으며, Anthropic 자체 정가에 추가 마진 없이 백만 토큰당 입력 $2.00, 출력 $10.00에 제공됩니다. 이 두 수치는 2026-10-08에 저희 자체 모델 엔드포인트에서 읽어온 값으로, 벤더의 요금표와 한 줄 한 줄 일치합니다. 저희의 해당 모델 페이지에는 동일한 100만 토큰 컨텍스트 윈도와 128K 최대 출력이 기재되어 있고, 허용 입력 유형으로 텍스트, 이미지, 파일을, 출력으로는 텍스트만을 나열하며, 2026-09-28에 출시되었고 지원 중단되지 않은 것으로 표시되어 있습니다. 또한 OpenAI 호환 chat-completions 엔드포인트와 Anthropic 자체 messages 엔드포인트 양쪽 모두를 통해 접근할 수 있는 것으로 나와 있는데, 바로 이 점 덕분에 둘 중 하나를 이미 사용 중인 통합이라면 그대로 갈아 끼우기만 하면 됩니다.
같은 카탈로그의 다른 모든 것은 동일한 키를 통해 접근할 수 있습니다: 200개 이상의 모델을 위한 하나의 API, 공급업체 정가가 0% 마크업으로 그대로 전달되며 따라서 공급업체의 가격 인하가 발표되는 당일 고객에게 반영되고, 자동 페일오버가 엔드포인트 성능이 저하될 때 작동하며, 모델을 고정하거나 여러 모델을 하나의 답변으로 조합하려는 경우를 위한 라우팅 DSL도 제공합니다. 이 조합이 바로 이 페이지의 질문을 값비싸게 답하는 대신 저렴하게 답할 수 있게 만드는 이유입니다. 위 비교의 두 모델은 동일한 자격 증명을 사용하므로, 비교 기준 가격은 리셀러가 아니라 공급업체가 직접 공개한 가격이며, 버전 테스트는 마이그레이션 프로젝트가 아니라 평가 실행 비용이 듭니다: 트래픽의 일부를 anthropic/claude-sonnet-5.5로 보내고, 나머지는 플래그십에 유지한 다음, 자신의 완료된 작업당 비용 수치가 어느 쪽을 기본값으로 할지 결정하게 하세요.

간략 버전
Claude Sonnet 5.5는 플래그십에 버금가는 수치와 플래그십 출력 가격의 절반이라는 값을 갖춘 중간 계층 모델이며, 이것이 여러분의 기본값이 될지를 결정하는 세 가지 사실은 다음과 같습니다. Artificial Analysis의 v4.3.2 지수에서 Claude Opus 5.5에 1.62점 뒤처지는데, 56.00 대 57.62이며, 두 수치 모두 동일한 리비전에서 기본 폴백을 사용한 동일한 max-effort 구성으로 측정되었습니다. 가격은 플래그십의 $4 / $20에 비해 $2 / $10이고, 캐시 및 배치 할인은 서로 다르기보다는 비례적이므로, 두 모델 중 어느 쪽이 제공하든 모든 할인을 적용해도 가격 차이는 그대로 유지됩니다. 그리고 이것은 기본값으로 high 노력을 사용하는 반면, 플래그십은 기본값으로 medium을 사용합니다. 이는 플래그십에서 이어받은 설정이 여기서는 더 낮은 게 아니라 한 단계 더 높게 작동한다는 뜻이며, 그에 따른 비용은 가정하지 말고 직접 측정해야 할 몫입니다.
Anthropic 자체 모델 선택기는 여전히 대부분의 워크로드에서 Claude Opus 5.5부터 시작합니다. 이는 무엇이든 표준화하기 전에 알아둘 만합니다. 하지만 이 모델의 이름을 검색해 이 페이지에 도착한 대부분의 독자에게는 중간 등급 모델이 합리적인 기본값이고, 플래그십은 자체 평가에서 요구할 때 구매하는 예외입니다. 즉, 대량으로 처리하는 범위가 명확한 작업, 빠른 지연 시간, 긴 컨텍스트 할증 없는 100만 토큰 창, 그리고 출력 비용 항목을 절반으로 줄이는 단가를 제공합니다. 두 모델 모두 OrcaRouter에서 키 하나만 있으면 사용할 수 있으며, 둘 중 무엇을 선택할지 결정하는 평가에는 마이그레이션이 아니라 반나절이면 충분합니다.
이 글에서 비교한 모델4
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
