Claude Sonnet 5.5용 히어로 카드로, 제목은 '스텔스 테스트, 아니면 이미 가지고 있는 가격표'이며, '미출시', '모델 ID 미공개', '발표됨: 몇 주 내'라고 적힌 세 개의 알약형 배지가 있고, 하단에는 2026년 9월 24일 X 게시물과 2026년 9월 22일 Anthropic의 Opus 5.5 출시 게시물을 인용한 문구가 있으며, 오른쪽 하단에 OrcaRouter 로고가 있다.
Guides & Insights

Claude Sonnet 5.5: 이미 존재하는 네 개의 숫자로 만들어진 스텔스 테스트 유출

작성자

Alistair Wren

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

9월 24일 X에는 Claude Sonnet 5.5가 "이미 은밀하게 테스트되고 있다"는 증거로 네 개의 숫자가 게시되었다: 1M 토큰 컨텍스트 윈도, 128K 토큰 최대 출력, 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10. 네 가지 모두 현재 Anthropic 자체 가격표에 있으며, 2026년 6월 30일부터 일반 제공된 Claude Sonnet 5 — 5.5가 대체하게 될 모델 — 에 붙어 있다. 동일한 $2 / $10 헤드라인은 OpenAI가 9월 22일 출시한 GPT-6 Sol에도 해당되며, 바로 그 중복 때문에 이 게시물은 일상적인 티어 갱신이 아니라 OpenAI에 대한 답변으로 읽힌다: "이것은 내게 GPT-6-Sol에 대한 직접적인 대응으로 읽힌다. 동일한 가격 책정과 아마도 유사한 성능."

그 어느 것도 그 주장을 틀리게 만들지는 않는다. 그것은 그 주장을 반증 불가능하게 만들 뿐이고, 이는 적어 둘 만한, 성격이 다르며 더 유용한 문제다. 스텔스 테스트 목격은 그 배후의 아티팩트만큼만 믿을 수 있는데, 이번 목격의 배후에 있는 아티팩트는 Anthropic이 12주 동안 서비스해 온 모델과 구분할 수 없는 사양표다.

실제로 게시된 내용은 무엇이었나요?

출처는 2026년 9월 24일자 @kimmonismus 계정의 단일 X 게시물입니다. 여기에는 컨텍스트 윈도우, 출력 상한, 그리고 두 가지 가격이 명시되어 있으며, 가격을 GPT-6 Sol과 비교하고 Sonnet 5.5가 테스트 중이라고 결론 내립니다. 스크린샷도, 모델 문자열도, API 응답도, 콘솔 목록도, 테스터 행동 설명도, 제2의 관찰자도 없습니다.

그것은 다른 종류의 Anthropic 출시 전 이야기와 분리해서 볼 가치가 있다. 2026년에는 둘 다 나왔는데, 서로 전혀 닮지 않았기 때문이다. 8월의 얼리 액세스 식별자 claude-marshmallow-eap와 claude-melon-eap는 요청에 존재했던 문자열이었다 — 못생기고, 볼품없으며, 확인 가능했다. 9월 내내 이어진 Opus 5.2 이야기는 라우팅 보고서다: 개발자들이 "Opus 5" 라벨 뒤의 백엔드가 다르게 응답한다는 점을 알아차리고 그 동작을 설명한 것이다. 둘 다 아티팩트다. 아티팩트가 붙지 않은 "이미 은밀히 테스트 중"이라는 말은 Sonnet 티어가 이미 판매하고 있는 것에 대한 요약이다.

출처 자체에도 주목할 만한 패턴이 하나 있다. 같은 계정이 9월 20일에 올린 요약 글은 "이미 테스트가 목격되고 있다"고 한 네 모델 — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2, Gemini 4 Pro — 로 시작했다. 그 네 이름 중 Opus와 Fable 항목에는 각각 별도로 교차 확인된 보도가 뒤따르고 있고, Gemini 항목에는 나름의 목격담이 있다. Sonnet 항목은 목록에서 한 자리를 차지했을 뿐이었다. 나흘 뒤, Sonnet 주장에는 스펙 시트가 하나 덧붙었고, 그 스펙 시트는 이미 존재하는 모델을 가리킨다.

네 개의 숫자는 Claude Sonnet 5의 숫자입니다

이것은 확인하는 데 30초면 걸리지만 거의 아무도 해 보지 않은 부분이다. 오늘 열어 본 Anthropic의 모델 개요 페이지에는 Claude Sonnet 5가 1M 토큰 컨텍스트 윈도우, 최대 출력 128K, 백만 토큰당 $2 / $10로 나와 있다. 유출된 내용을 그것과 대조해 보라:

• 컨텍스트 창 — Claude Sonnet 5.5는 1M 토큰 주장, Claude Sonnet 5는 1M 토큰 공개

• 최대 출력 — 128K 토큰 주장됨; 128K 토큰 공개됨

• 입력 가격 — 청구 기준 백만 개당 $2, 공개 기준 백만 개당 $2

• 출력 가격 — 백만 건당 $10(청구 기준); 백만 건당 $10(게시 기준)

• 모델 ID — Claude Sonnet 5.5의 경우 공개된 내용이 없음; Claude Sonnet 5의 경우 claude-sonnet-5

• 독립적인 점수 — 주장된 모델에 대해서는 없음; Artificial Analysis는 Claude Sonnet 5를 자사가 측정하는 210개 모델 중 54위, Intelligence Index 38로 위치시키며, 이는 적응형 추론, 최대 노력(max-effort) 구성에서의 결과임

Two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the scoreboard'. The left column, Claude Sonnet 5.5 (leaked), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID none published; independent scores none. The right column, Claude Sonnet 5 (shipped June 30, 2026), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID claude-sonnet-5; independent scores AA Index 38. The footer reads 'Claude Sonnet 5 figures per Anthropic and Artificial Analysis; Claude Sonnet 5.5 figures unverified, single observer.'

유출이 거꾸로 짚은 가격 포인트에는 두 번째 층위가 있다. Claude Sonnet 5가 출시됐을 때, $2 / $10은 2026년 8월 31일까지 적용되는 도입 가격으로 발표됐고, 9월 1일에는 $3 / $15로 인상될 예정이었다. 그 인상은 일어나지 않았다. Anthropic의 가격 페이지에는 이제 $2 / $10이 "이제 표준 가격"이며 "2026년 9월 1일로 예정됐던 백만 입력/출력 토큰당 $3 / $15 인상은 발생하지 않을 것"이라고 밝히는 각주가 있다. 따라서 유출이 새 모델의 경쟁 무기로 제시하는 가격은 기존 모델의 영구 요금이다. 즉 $2 / $10로 출시되는 Sonnet 5.5는 전혀 할인 없이, 이미 GPT-6 Sol에 맞서 가격이 책정된 등급으로 출시되는 셈이다.

Anthropic이 실제로 말한 단 하나의 것

익명의 유출자들에게서 나온 모든 내용을 걷어내면, 자사가 직접 밝힌 문장 하나만 살아남는다. Anthropic이 2026년 9월 22일에 Claude Opus 5.5를 출시했을 때, Claude Sonnet 5.5와 Claude Haiku 5.5가 "앞으로 몇 주 안에" 뒤따를 것이며 성능, 효율성, 안전성에서 비슷한 향상을 가져올 것이라고 밝혔다. 그 문장이 확인된 기록의 전부이다. 그 문장에는 모델 ID도, 컨텍스트 윈도도, 가격도, 벤치마크도, 날짜도 없다 — 특히 스텔스 테스트, 그레이 루트, 또는 어떤 종류의 테스트에 대해서도 아무것도 말하지 않는다.

Anthropic의 나머지 공개 영역도 그 해석과 일치한다. 모델 개요에는 여전히 네 가지 모델 — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5, Claude Haiku 4.5 — 만 나열되어 있으며, 다섯 번째 행도, 가격 항목도, Sonnet 후속 모델에 대한 "예정" 표시도 없다. 만약 Sonnet급 체크포인트가 개발자가 접근할 수 있는 어딘가에서 서빙되고 있었다면, 그 식별자가 가장 먼저 드러났을 것이다. 서빙되는 모델은 요청에 이름이 있어야 하기 때문이다. 아무것도 드러나지 않았다.

9월 발표가 확실히 해준 한 가지는, Haiku 라인이 단종되고 5.5 세대가 라인업을 재편할 것이라는 앞선 유출과 모순된다는 점이었다. Anthropic에 따르면 Haiku 5.5가 나온다. 이는 그 재편설이 유출자들이 좀처럼 틀리지 않는 방향으로 틀렸다는 뜻이다 — 저가 티어는 유지된다.

8월 유출은 200만 토큰이라고 했다. 이번 유출은 100만 토큰이라고 한다.

9월 24일 게시물로부터 6주 전인 8월 9일, 다른 X 계정이 훨씬 더 대담한 주장을 담은 "SONNET 5.5 LEAK" 스펙 시트를 게시했습니다: Sonnet 5의 두 배인 200만 토큰 컨텍스트 윈도우, 더 빠른 추론, 더 나은 브라우저 및 터미널 도구 사용, Claude Fable 5에 근접한 성능, 그리고 "다음 달" 출시. 그 유출에는 Anthropic 미리보기 카드처럼 보이도록 스타일링된 그래픽이 함께 있었습니다. 또한 비평가들이 즉시 주목한 치명적인 세부 사항도 있었습니다: 그것이 제시한 코드명 "Fennec"은 이미 6월 30일에 Claude Sonnet 5와 함께 출시된 코드명이었습니다. 코드명은 그것을 사용한 모델의 후속 모델에 대한 새로운 증거가 될 수 없습니다.

그래서 두 유출 물결은 가장 많이 인용된 단일 숫자에서 서로 어긋난다. 8월은 2M 컨텍스트라고 했다. 9월은 1M이라고 한다. 둘 다 같은 빌드를 설명할 수는 없다. 가장 가능성 높은 해석은 시시한 것이다. 9월 글이 Sonnet 등급의 공개된 한도를 설명하는 것은, 외부에서 볼 때 Sonnet 등급 모델이 바로 그렇게 보이기 때문이며, 8월 글은 리프레시가 그럴듯하게 두 배로 늘릴 수 있는 것에 대한 추측이었다. 숫자가 어느 방향으로 움직였는지 주목하라 — 아래로, 이미 존재하는 쪽으로.

그럼 GPT-6 Sol 비교가 맞는 건가요?

대체로 그렇고, 깨지는 지점이 흥미로운 부분이다. GPT-6 Sol은 2026년 9월 22일에 출시되었는데, Claude Opus 5.5와 같은 날이다. 정가는 백만 입력당 $2, 백만 출력당 $10부터 시작한다 — 정확히 Sonnet 5의 요금이며, 유출된 정보가 Sonnet 5.5에 대해 주장하는 것과 정확히 일치한다. 1,050,000토큰 컨텍스트 창과 128K 출력 상한을 제공하는데, 둘 다 Claude Sonnet 5의 수치와 약간 차이가 난다. 더 저렴한 형제 모델인 GPT-6 Luna의 가격은 $0.10 / $0.50이다.

긴 컨텍스트에서 결판이 난다. GPT-6 Sol은 두 구간으로 가격을 매긴다: 입력 토큰 272,000개까지는 $2 / $10, 그 이상은 $4 / $15다. Anthropic은 Sonnet 라인에서 그렇게 하지 않는다 — Claude Sonnet 5는 1M 전체 윈도우를 표준 요율로 청구하므로, 900K 토큰 요청도 토큰당 비용이 9K 요청과 같다. 따라서 실제 Sonnet 5.5와 실제 GPT-6 Sol은 일반적인 프롬프트에서는 가격이 동일하고, 두 모델 모두의 판매 포인트인 장문 문서 및 대형 리포지토리 워크로드에서는 두 배 차이가 난다. "동일 가격"은 헤드라인에서는 맞지만, 구간이 선택되는 워크로드에서는 틀리다.

두 번째 주의점은 전체 비교의 밑바탕에 깔려 있습니다. Claude Sonnet 5는 Anthropic의 더 새로운 토크나이저를 사용하며, 이는 같은 텍스트에 대해 이전 것보다 약 30% 더 많은 토큰을 생성합니다. 표면상의 요율은 청구서가 아닙니다. 청구서는 작업당 토큰 수이며, 그것이 어떤 유출 자료에도 담긴 적 없는 숫자입니다.

Sonnet 5.5가 의미를 갖게 하려면 무엇이 필요할까

그것이 존재하는지 여부는 제쳐 두고, 토큰 비용을 지불하는 사람에게 무엇이 달라질지 물어보자. 네 가지이며, 그중 어느 것도 사양서가 아니다.

첫 번째는 $2 / $10 미만의 가격이다. 9월 1일 인상이 취소되면서, 기존 모델의 요금은 이제 영구적이다 — 따라서 같은 요금을 유지하는 후속작은 수평적 이동이고, 돈을 움직이는 유일한 Sonnet 등급 뉴스는 인하뿐이다.

두 번째는 100만을 넘어선 컨텍스트입니다. 그것이 8월 유출의 실제 제안이었으며, 이는 해당 유출이 거론할 수 있는, 기존 사업자가 아직 해결하지 못한 유일한 역량 격차입니다.

세 번째는 작업당 토큰 수입니다. Claude Sonnet 5의 적응형 사고는 기본적으로 켜져 있으며, 독립 분석에서는 이것이 이전 모델보다 작업당 출력 토큰을 실질적으로 더 많이 생성하는 것으로 측정했습니다. $2 / $10 요금을 유지하면서 그 팽창을 막는 버전이라면, 요란하게 발표된 가격 인하보다 실제 청구액을 더 많이 줄일 것입니다.

네 번째는 식별자다. API 모델 문자열, 문서의 한 행, 가격 항목, 모델 카드 — 그중 어느 하나만으로도 논쟁은 끝난다. 그리고 그렇게 노골적인 유출 이후에 이 네 가지가 모두 없다는 사실 자체가, 이 이야기에서 가장 많은 것을 말해 주는 단서다.

오늘 전화할 수 있는 것

Claude Sonnet 5는 티어가 정리될 때까지 임시로 쓰이는 모델이 아닙니다. 이 모델은 이미 대부분의 Claude API 트래픽이 실행되는 모델이며, 1M 토큰 컨텍스트 윈도우, 128K 출력, 그리고 이제 프로모션이 아닌 표준이 된 $2 / $10 요금을 갖추고 있습니다.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38 at rank 54 of 210, an output speed of 79.3 tokens per second at rank 77 of 210, a cost of $2.00 per million input tokens and $10.00 per million output tokens with a 90% cache discount and $5.09 cost per Intelligence Index task, a verbosity of 370M output tokens, reasoning enabled, and a 1M token context window

6월부터 Anthropic 자체의 $2 / $10 가격으로 OrcaRouter에 올라와 있었습니다, 공급자 정가 그대로 마크업 없이 전달됩니다, 따라서 Sonnet 라인의 공급업체 가격 변경은 다음 청구 주기가 아니라 같은 날 여기에서 바로 반영됩니다. 동일한 키가 이미 $2 / $10로 GPT-6 Sol에 도달하는데, 이는 이와 같은 글에서 평소보다 더 중요합니다: 유출이 기대는 비교는 두 개의 계약이 아니라 하나의 자격 증명으로 직접 실행할 수 있는 비교입니다.

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M token context window, 128K maximum output, text plus image and file inputs, an INPUT price of $2.00 per million tokens and an OUTPUT price of $10.00 per million tokens, a p50 time to first token of 5.67 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

그것은 또한 유출이 제기하는 질문에 답하는 가장 저렴한 방법이기도 합니다. Sonnet 5.5가 실제로 등장한다면, 그것은 다른 모델들처럼 카탈로그에 들어오고, 여러분은 트래픽의 일부를 그쪽으로 라우팅하면 됩니다 Claude Sonnet 5로의 자동 장애 조치를 백업으로 두고 — 두 번째 통합도, 재협상도 없으며, 아무도 독립적으로 벤치마크하지 않은 모델에 프로덕션 경로가 의존하지도 않습니다. 검증되지 않은 티어를 시험하는 것은 마이그레이션 프로젝트가 아니라 라우팅 결정입니다.

다음 유출 게시물 대신 무엇을 볼까요

세 가지 신호를, 알려주는 정보의 양이 많은 순서대로 살펴보겠습니다. 식별자는 결정적입니다. 왜냐하면 서빙되는 모델은 요청에 이름이 있어야 하며, 2026년의 모든 검증 가능한 Anthropic 사전 공개 이야기가 바로 그렇게 검증 가능해졌기 때문입니다. 공급업체의 확인 — 모델 카드, 문서 행, 가격 책정 문구, 또는 모델이 Anthropic 자체 목록에 단순히 등장하는 것 — 은 이를 완전히 종결시킵니다. "앞으로 몇 주"라는 문구는 그중 하나가 실제로 약속되어 있음을 의미합니다. 사양이 아니라 동작을 설명하는 테스터 보고서는 세 가지 중 가장 약하지만, 오늘날 존재하는 것보다는 여전히 더 많은 정보를 제공합니다.

그중 하나가 현실이 되기 전까지, 정직한 요약은 Anthropic이 앞으로 몇 주 안에 Sonnet 리프레시를 약속했고, 한 관측자는 그것을 그것이 대체하게 될 모델의 수치를 사용해 설명했다는 것입니다. 여러분의 스택이 이미 claude-sonnet-5를 실행 중이라면, 기다릴 것도 없고 그에 맞춰 계획할 것도 없습니다. Claude Sonnet 5를 GPT-6 Sol과 저울질하고 있다면, 여러분이 행동에 옮길 수 있는 수치는 이미 공개된 것들이며 — 그것은 그 유출이 뉴스인 양 여러분에게 팔려고 하는 바로 그 수치입니다.

이 글에서 비교한 모델2

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트