
Claude Haiku 5.5: Anthropic, 유출이 단종됐다고 전한 지 몇 주 만에 가장 저렴한 티어가 출시된다고 밝혀
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
9월의 약 2주 동안, 해당 벤더의 로드맵을 추적하는 사람들 사이에서는 가장 저렴한 Claude 티어가 단종된다는 것이 일반적인 가정이었다. 그 유출 — 해당 벤더의 로드맵 주장으로 알려진 계정이 X에 올린 게시물 — 은 5.5 세대가 라인업을 재편할 것이라고 말했다: Claude Fable, Claude Opus, Claude Sonnet이 모두 5.5 버전을 받게 되고, Fable은 새로운 사전 학습 기반으로 이동하며, Haiku 라인은 퇴출된다는 것이었다. 회사는 이 중 어느 것도 확인하지 않았다. 그러다 2026년 9월 22일, Claude Opus 5.5의 출시와 함께, 회사는 한 문장으로 정반대를 말했다: "Claude Sonnet 5.5와 Claude Haiku 5.5가 앞으로 몇 주 안에 뒤따를 것입니다." Claude Haiku 5.5는 따라서 발표되었지만 날짜가 정해지지 않았고 출시되지도 않았다 — 그리고 그것이 존재하는 이유는 바로 그것에 관한 소문이 틀렸기 때문이다. 현재 출시되어 있는 소형 모델인 Claude Haiku 4.5가 오늘날 여전히 당신이 호출할 모델이다.
다음은 실제로 확립된 것, 추론인 것, 그리고 아직 아무도 모르는 것입니다. 이 구분은 여기서 평소보다 더 중요합니다. 왜냐하면 Haiku 5.5에 대해 떠도는 대부분의 내용은 그 위 계층에서 비롯된 외삽이기 때문입니다.
실제로 무엇이 확인되었으며, 누구에 의해 확인되었습니까?
확정된 세트는 작으며, 이를 작게 유지할 가치가 있습니다.

• 그 발표 — Anthropic이 직접 올린 Claude Opus 5.5 출시 게시물에는 이렇게 적혀 있습니다: "Claude Sonnet 5.5와 Claude Haiku 5.5가 앞으로 몇 주 안에 뒤따를 것입니다." 그것이 직접적 증거의 전부입니다. 그것은 누군가의 출시 게시물에 있는 한 문장일 뿐, Haiku 5.5 발표가 아닙니다.
• 약속의 범위 — 같은 게시물에서는 두 모델이 Claude Opus 5와 "성능, 효율성, 안전성에 대한 많은 동일한 개선 사항"을 갖출 것이라고 말합니다. 이는 명세가 아니라 범주 목록입니다. 벤치마크도, 가격도, 컨텍스트 윈도우도, 모델 ID도, 날짜도 없습니다.
• 티어 위치 — Haiku는 Anthropic의 현재 세 가지 티어 중 가장 빠르고 가장 저렴하며, Sonnet과 Opus 아래에 있습니다. 이는 해당 라인이 도입된 이후로 사실이었으며, 이견이 없습니다.
• 타임라인 — “다가오는 몇 주”라는 표현은 가장 이른 현실적 도착 시점을 2026년 9월 말이나 10월로 잡으면서도, 가장 늦은 시점에 대해서는 아무 말도 하지 않는다.
그 밖에 돌고 있는 모든 것은 Anthropic이 보증하지 않았고 발표 내용이 핵심 쟁점에서 반박하는 유출자의 주장이거나, Claude Opus 5.5에서 끌어낸 추론입니다. 둘 다 미검증된 것으로 취급하십시오.

그 소문이 구체적으로 무엇이었는지, 그리고 그것이 왜 그럴듯했는지
그 엑시트 주장은 멍청한 게 아니었다. 그것은 실질적인 근거가 있었고, 이를 이해하면 Anthropic의 스몰 티어가 어떻게 다뤄져 왔는지에 대해 알 수 있다.
Claude Haiku 4.5는 2025년 10월 15일에 출시되었으며, 입력 토큰 100만 개당 1달러, 출력 토큰 100만 개당 5달러로, 200K 토큰 컨텍스트 윈도우와 64K 출력 상한을 갖췄습니다. 이 모델은 라인업에서 가장 빠른 모델이었고 가격은 압도적으로 가장 저렴했으며, 코딩 및 에이전트 작업에서 이전 세대 Sonnet과 맞먹는 성능을 약 3분의 1의 비용으로 제공하는 것으로 포지셔닝되었습니다.
그런 다음 그 등급은 조용해졌다. 2025년 10월의 Haiku 4.5와 2026년 9월의 Opus 5.5 출시 사이 — 11개월 동안 — 다른 모든 Claude 등급은 적어도 두 번 움직였다. Opus는 4.5, 4.6, 4.7, 4.8, 5, 5.5로 갔다. Sonnet은 4.5, 4.6, 5로 갔다. Fable은 완전히 새로운 최상위 등급으로 등장했다. Haiku는 전혀 움직이지 않았다. 같은 기간에 Anthropic의 Haiku 4.5에 대한 지원 종료 약속은 "2026년 10월 15일 이전은 아님"으로 미뤄졌다 — 이 글을 쓰는 현재, 약 3주 남은 날짜다.
대략 6개월마다 갱신되던 티어에서 11개월의 공백이 생긴 데다 단종 시한까지 다가오는 것은, 제품 라인이 막을 내리는 길에 접어들 때 보이는 바로 그 모양이다. 유출에서 읽히는 내용도 바로 그것이었다. 합리적인 해석이었다. 하지만 그것은 틀렸고, 그 정정은 두 번째 유출자가 아니라 벤더로부터 나왔다.
Haiku 5.5가 Claude Opus 5.5로부터 거의 확실히 물려받게 될 것
이 섹션은 추론입니다. 이렇게 표시된 이유는 Anthropic이 이 중 어느 것도 확인하지 않았고, 위 티어와의 유추가 이용 가능한 유일한 신호 원천이기 때문입니다.
Anthropic이 약속한 "동일한 개선 사항 상당수"는 출발점이 될 목록을 제공한다. Claude Opus 5.5는 독자가 현재의 소형 모델과 대조해 확인할 수 있는 네 가지 속성을 갖추고 출시되었다:
• 가격 방향성 — Claude Opus 5.5는 백만 토큰당 입력 $4 / 출력 $20으로, Claude Opus 5의 $5 / $25에서 내려갔으며, 캐시 읽기는 $0.50에서 $0.20으로 인하되었다. 플래그십에서의 20% 인하는 소형 티어에도 상응하는 인하가 있을 가능성을 시사한다. 이는 약속이 아니며, 발표문 어디에도 그렇게 언급되어 있지 않다.
• 적응형 사고 — Claude Opus 5.5는 thinking: {"type": "disabled"} 또는 고정된 budget_tokens를 허용하지 않으며, 둘 다 400을 반환합니다. 사고는 항상 켜져 있고 effort가 제어 수단입니다. 오늘날 Claude Haiku 4.5는 그 반대입니다. 더 오래된 수동 {"type": "enabled", "budget_tokens": N} 형식을 사용하며 effort 매개변수가 전혀 없습니다.
• 컨텍스트 창 — Claude Opus 5.5는 1M 토큰 컨텍스트에 최대 출력 128K를 유지한다. Claude Haiku 4.5는 200K에 출력 64K다. 1M로의 도약은 소형 등급이 무엇에 유용한지를 바꿀 가장 큰 단일 요인이며, 동시에 아무도 당연하게 가정해서는 안 되는 부분이기도 하다.
• 안전장치 — Claude Opus 5.5는 거부 중단 사유를 더 넓은 범주 집합에서 반환할 수 있으며, 생물학 요청은 Claude Opus 5로, 대부분의 사이버보안 요청은 Claude Opus 4.8로 라우팅됩니다. 소형 티어가 동일한 분류기를 상속하는지, 아니면 더 가벼운 집합을 상속하는지는 알 수 없습니다.
Haiku 5.5가 더 작은 컨텍스트 윈도를 지닌, 더 저렴한 Claude Opus 5.5라고 가정한 채 마이그레이션을 계획하고 있다면, 당신은 비유에 기대어 계획하는 것이다. 그 비유는 이용할 수 있는 최선의 비유지만, 증거는 아니다.
왜 등급이 플래그십보다 더 중요한가
플래그십 릴리스는 언론의 주목을 받고 소형 모델은 트래픽을 가져가는데, 이는 이름 붙일 가치가 있는 불일치다.
Claude Haiku 4.5는 모델 호출이 하루 수십만 번 발생하고 토큰당 가격이 제품 결정의 전부인 영역에서 실행됩니다: 분류, 추출, 라우팅, 요약, 캐스케이드에서의 저렴한 첫 번째 패스, 비싼 모델이 파일을 읽지 않아도 되도록 파일을 읽는 하위 에이전트. Anthropic이 자체적으로 설명하는 바로는, 이것은 최전선에 가까운 지능을 갖춘 가장 빠른 모델이며, 지연 시간 프로필이 이를 뒷받침합니다 — 독립적인 측정 결과 초당 약 86개의 출력 토큰과 0.65초의 첫 토큰 시간을 기록하여, 두 측면 모두에서 해당 가격대의 중간값 비추론 모델보다 빠릅니다.
그에 반해 Haiku 4.5는 프런티어 모델이 아니며, 그런 척도 하지 않습니다. 독립적인 Artificial Analysis Intelligence Index 점수는 15로, 해당 순위표의 61개 모델 중 28위이며 추정치로 표시됩니다. 바로 이 숫자 때문에 5.5 리프레시가 일상적인 업데이트가 아니라 흥미로운 일이 됩니다. 소형 티어가 Claude Opus 5.5가 이룬 것과 비슷한 역량 도약을 얻는다면, 대량 작업의 가격 대비 성능 하한을 끌어올리게 되며, 많은 프로덕션 파이프라인이 바로 그 하한 위에 구축되어 있기 때문입니다.
오늘날 독자에게 실질적인 질문은 기다릴지 말지가 아니다. 그것은 기다림에 어떤 비용이 드느냐이다. Haiku 4.5를 기반으로 구축 중이라면, 11개월의 격차는 이미 그 티어가 의존할 만큼 안정적인지에 대한 답이다. 공급업체가 방금 그렇다고 말해준 것이다. Haiku 5.5를 위해 마이그레이션을 보류하고 있다면, 공개된 사양도 없고 출시일도 정해지지 않은 모델을 위해 보류하는 것이며, 이는 현재 존재하는 모델로 출시하고 새 모델이 나오면 이동하는 것보다 더 나쁜 상황이다.
가지고 있는 작은 티어를 그 위에 있는 티어들 옆에서 돌리기

Haiku 리프레시를 모델 검토 자리가 아니라 라우팅 자리에서 지켜볼 가치가 있는 이유는, 흥미로운 결정이 어떤 모델을 쓸지인 경우는 드물고 어떤 호출에 어떤 모델을 쓸지인 경우가 대부분이기 때문이다. 쉬운 80%를 소형 모델로 보내고 나머지는 상위로 에스컬레이션하는 캐스케이드는 표준적인 비용 전략이며, 두 계층 모두 같은 위치에서 같은 자격 증명으로 접근할 수 있을 때만 작동한다.
Claude Haiku 4.5는 Anthropic의 정가로 이미 OrcaRouter에서 사용할 수 있으며, Claude Opus 5와 Claude Sonnet 5도 마찬가지입니다 — 세 모델 모두 하나의 API 키로 이용할 수 있고, 0% 마크업, 즉 제공업체의 정가가 마크업 없이 그대로 전달됩니다. 공급업체가 가격을 인하하면 그 인하는 같은 날 우리 쪽에도 그대로 반영되는데, 이는 백 번 호출하는 등급보다 백만 번 호출하는 등급에서 더 중요합니다. 특히 캐스케이드의 경우, 라우팅 DSL을 사용하면 여러 등급을 하나의 호출로 구성할 수 있어 에스컬레이션 로직이 애플리케이션이 아니라 라우트에 자리하게 되고, 자동 페일오버 덕분에 한 제공업체의 안 좋은 하루가 파이프라인까지 함께 무너뜨리는 일은 없습니다.
두 가지 솔직한 유의사항이 있습니다. Claude Opus 5.5 자체는 OrcaRouter에 없습니다 — 최신 티어가 항상 최신 라우트인 것은 아니며, 우리는 그렇지 않은 듯 암시하기보다 그대로 말하는 편을 택합니다. 그리고 Haiku 5.5에 대해서는 라우팅할 수 있는 것이 아무것도 없습니다. 아직 존재하지 않기 때문입니다. 오늘 호출할 수 있는 모델은 위에 나열된 것들입니다.
순서대로 주의할 점
Haiku 5.5이 실제로 도착하면, 네 가지 사실이 거의 모든 미해결 질문을 정리해 줄 것이며, 그것들은 예측 가능한 순서로 도착할 것이다.
• Anthropic의 모델 개요 페이지에서 확인할 수 있는 모델 ID와 컨텍스트 윈도우 — claude-haiku-5-5 형식의 날짜 없는 ID라면 4.6 세대 이후의 관례와 부합할 것이고, 1M 토큰 윈도우가 헤드라인이 될 것입니다.
• 요금표. 이 티어가 존재하는 이유는 전적으로 가격입니다. $1/$5를 넘는 숫자는 재포지셔닝이 되고, 그 이하의 숫자는 그 자체로 개선입니다.
• 사고가 적응형 전용인지 여부. Haiku 5.5가 budget_tokens를 Claude Opus 5.5가 그러하듯 거부한다면, 이는 현재 이를 설정하는 모든 통합에 호환성을 깨는 변경이며, 실제로 실행해 봐야만 드러나는 종류의 문제입니다.
• 독립적인 점수. 해당 등급의 벤더 벤치마크는 역사적으로 독립 평가 기관이 측정하는 것에 비해 후한 편이었으므로, 첫 Artificial Analysis 순위는 출시 표보다 더 가치가 있습니다.
그것들이 존재하기 전까지는, 정확한 말은 시시한 말이다: Anthropic은 Claude Haiku 5.5가 앞으로 몇 주 안에 출시될 것이라고 말했지만 그것이 무엇인지는 밝히지 않았고, 취소됐다고 한 유출 정보는 틀렸다. 그 마지막 부분이 바로 뉴스다. 나머지는 전부 일정일 뿐이다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
