'Claude Haiku 5.5 비용이 10분의 1'이라는 생성된 히어로 카드로, '가장 저렴한 Claude'라는 배지가 붙고, 킥커는 'ANTHROPIC, 2026년 10월 7일', 부제는 '90% 요금 인하, 약 30% 더 많은 토큰을 추가하는 토크나이저, 그리고 Anthropic이 게시하지 않은 출시 영상'이다. 네 개의 칩에는 '$0.10 입력', '$0.50 출력', '1M 컨텍스트', '실질 75% 절감'이 적혀 있다. 아래의 두 카드에는 '내려간 것'('100,000 토큰 미만에서 입력은 $1.00에서 $0.10으로, 출력은 $5.00에서 $0.50으로')과 '올라간 것'('같은 텍스트가 이전보다 약 30% 더 많은 토큰으로 집계된다')이라는 라벨이 붙어 있다. 하단에는 '공급업체 가격 문서, 2026년 10월 8일 확인.'이라고 적혀 있다. OrcaRouter 로고가 오른쪽 아래 모서리에 합성되어 있다.
Guides & Insights

Claude Haiku 5.5: 90% 가격 인하, 새로운 토크나이저, 그리고 Anthropic이 올리지 않은 영상

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

누군가 한 문장을 Claude Haiku 5.5에 입력했더니 완성된 런칭 필름을 돌려받았다. 2026년 10월 7일 저녁 X에 게시된 그 프롬프트는 전문이 이렇다: "당신의 런칭을 위한, 당신이 얼마나 뛰어난 모션 디자이너인지 보여주는 10배 더 쩌는 영상을 만들어라." 게시물의 캡션은 세 단어뿐이다 — "이 영상 원샷" — 그리고 클립을 첨부 파일로 달고 있다. 재시도도, 스토리보드도, 편집자도 없었다. Claude 라인에서 가장 저렴한 모델이 이제 이런 일을 해낸다면, 그 등급은 더 이상 타협이 아니다.

그것이 이번 출시의 흥미로운 절반이다. 나머지 절반은 산수이며, 실제 뉴스가 자리한 곳이 바로 거기다: Claude Haiku 5.5는 최대 100,000토큰까지의 프롬프트에 대해 백만 입력 토큰당 $0.10, 백만 출력 토큰당 $0.50의 비용이 드는데, 이는 Claude Haiku 4.5의 고정 $1, $5에 맞선 것이다. Ant​hropic 자신의 각주는 이를 일반적인 경우 90% 더 저렴하다고 표현하면서 — 그러고는 같은 숨결로, 구매자가 계획의 기준으로 삼아야 할 숫자는 75%에 더 가깝다고 말한다. 두 숫자 모두 맞고, 그 둘 사이의 격차가 이번 릴리스에서 가장 중요한 것이다.

Anthropic이 10월 7일에 공식적으로 밝힌 내용

벤더의 출시 게시물과 가격 책정 문서는 그 대상의 형태에 대해 일치하며, 이는 가격 인하가 보통 동반하는 것보다 더 큰 변화입니다.

A generated scoreboard titled 'Claude Haiku 5.5 benchmark table - Anthropic's own harness' with two columns. Claude Haiku 5.5 reads GDPval-AA v2.1 1620, AA-Briefcase v1.1 1578, OSWorld 2.1 72.4%, Humanity's Last Exam 45.9%, Terminal-Bench 4.0 39.2% and Chartography 46.4%. Claude Haiku 4.5 reads 735, 614, 15.7%, 10.2%, 0.0% and 6.4%. A footer reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.'

• 가격 — 최대 100,000 토큰의 프롬프트에 대해 입력 토큰 100만 개당 $0.10, 출력 토큰 100만 개당 $0.50입니다. 해당 임계값을 초과하면 동일한 요청에 $0.50와 $2.50가 청구됩니다. 캐시 읽기는 최대 100K까지 100만 개당 $0.01, 그 이상은 $0.05입니다. 캐시 쓰기는 $0.125와 $0.625입니다.

• 컨텍스트 — 1M 토큰, 최대 출력 128,000 토큰. 이는 Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5가 갖춘 것과 동일한 윈도 및 동일한 출력 상한을 가장 저렴한 티어에서 구현한 것입니다.

• Thinking — effort 파라미터를 사용하는 적응형 사고이며 기본값은 medium입니다. Ant​hropic은 이것이 조정 가능한 effort 설정을 갖춘 최초의 Haiku급 모델이라고 말합니다. 즉, 다른 설정은 바꾸지 않고도 동일한 모델 ID를 저렴하게 실행하거나 신중하게 실행할 수 있습니다.

• 토크나이저 — Claude 4.7 이상과 공유되는 더 새로운 토크나이저로, "같은 텍스트에 대해 약 30% 더 많은 토큰을 생성합니다." Anthropic의 문서에 따르면 정확한 증가량은 콘텐츠와 워크로드 형태에 따라 달라집니다.

• 수명 주기 — 지식 컷오프는 2026년 6월이며, 은퇴(지원 종료) 시점은 "2027년 10월 7일보다 이르지 않음"으로 약속되어 있습니다.

• 가용성 — Claude API, Amazon Web Services, Goo​gle Cloud, Microsoft Azure, 그리고 AWS의 Claude Platform까지, 모두 첫날부터 동시에.

10x 스티커와 75%의 현실

10배 더 저렴하다는 숫자는 가장 멀리 퍼질 숫자이며, 누군가의 예산 모델에서 가장 잘못된 자리에 들어갈 가능성이 가장 큰 숫자이기도 하다. 이는 최대 100,000 토큰의 프롬프트에 적용된다. Haiku 5.5는 전체 윈도우에서 그 요율을 유지하지 않는다.

• 최대 100,000 토큰 — 입력 $0.10, 출력 $0.50으로, Haiku 4.5의 $1 및 $5와 대비됩니다. 이는 90% 인하이며, Anthropic에 따르면 이전 Haiku 모델에 대한 요청의 90%가 이 범위에 속했습니다.

• 100,000토큰 초과 — 입력 $0.50, 출력 $2.50. 여전히 동일한 요청에 대해 Haiku 4.5가 청구한 금액의 정확히 절반이며, 도달할 상한도 없습니다.

• 토크나이저 — 동일한 텍스트가 Haiku 4.5에서보다 약 30% 더 많은 토큰으로 토큰화되므로, 토큰당 단가 인하가 1:1로 더 적은 청구 금액으로 이어지지는 않습니다.

• 공급업체 자체 평균 — Anthropic은 이 조합을 "실행 비용이 약 75% 더 적다"라고 표현한다. 그것은 독립적인 측정치가 아니라 자체 수치이며, 예측에 넣어야 할 값은 바로 그것이다.

• 캐시 경제성 — 캐시 읽기 비용이 일반 구간에서 백만 개당 $0.10에서 $0.01로 떨어졌으며, 이는 긴 공유 프리픽스를 계속 다시 보내는 모든 파이프라인에서 입력 요율보다 더 중요합니다.

75%라는 수치는 독자가 자칫 모순으로 읽을 수 있는 점도 설명해 줍니다. 두 핵심 수치는 서로 충돌하지 않습니다. 하나는 요청 형태에 대한 비율이고, 다른 하나는 100K 초과 소수와 토크나이저의 추가 토큰을 포함하는 실제 트래픽 구성 전반에 걸친 혼합 추정치입니다. 지출을 모델링하고 있다면 75%를 사용하고, 더 나은 수치를 믿기 전에 자신의 프롬프트 길이 분포를 확인하세요.

영상이 주장하는 것과, 주장하지 않는 것

해당 클립은 실제이며, 프롬프트는 위에 그대로 인용되어 있고, 타임스탬프 — 10월 7일 19:49 UTC, 대략 모델이 공개된 바로 그날 — 는 확인할 수 있다. 이는 Ant​hropic이 아니라 개별 사용자에게 귀속된다.

그 구분은 여기서 중요하다. Anthropic 자체의 Claude Haiku 5.5 제품 페이지에는 임베드된 영상이 전혀 없기 때문이다. 플레이어도, 미디어 파일도 없고, 회사의 YouTube 채널로 가는 링크만 있다. 만약 이 모델로 런칭 필름을 만들었다면, 벤더는 그렇게 말하지 않았다. 따라서 정확한 진술은 좁다. 한 사용자가 Claude Haiku 5.5로 런칭 영상을 단번에 생성했다고 보고하고, 그 프롬프트를 공개했다. 그것이 단번에 된 것인지, 비용이 얼마였는지, 편집 후 얼마나 남았는지는 모두 단일 출처의 주장이다. 그 클립을 벤치마크가 아니라 시연으로 취급하라.

그럼에도 언급할 가치가 있는 이유는 비디오 생성이 그 모델의 사양에 포함되어 있지 않기 때문이다. Haiku 5.5는 텍스트와 이미지를 입력받아 텍스트를 반환한다. 그 정도 품질의 모션 디자인 결과물은 모델이 프레임 자체를 생성한 것이 아니라 다른 무언가—코드 생성 경로, 렌더링 파이프라인, 도구 루프—를 구동하고 있었음을 의미한다. 그것은 $0.10 입력에서의 에이전트 오케스트레이션에 관한 진술이며, 바로 이 점이 실제로 놀라운 부분이다.

The numbers Ant​hropic published

벤더의 출시 표는 Haiku 4.5 대비 전후 비교이며, 규모를 가늠할 수 있도록 GPT-6 Luna와 Claude Sonnet 5.5가 같은 열에 함께 있습니다. 아래의 모든 수치는 Anthropic이 자체 보고한 평가 결과로, Anthropic의 하네스에서 실행되었고, 그대로 인용되었지만 독립적으로 검증되지는 않았습니다.

A screenshot of Anthropic's Claude Haiku 5.5 launch page, dated October 7 2026 and headed with the model name, the identifier claude-haiku-5-5 and the launch standfirst, with the vendor's reported evaluation rows and pricing notes below.

• 지식 작업 — GDPval-AA v2.1은 1620으로 Haiku 4.5의 735, GPT-6 Luna의 1437, Sonnet 5.5의 1840과 대비된다. AA-Briefcase v1.1은 1578로 614, 1336, 1824와 대비된다.

• 컴퓨터 사용 — 오프라인 하위 집합에서 OSWorld 2.1이 72.4%를 기록한 반면, Haiku 4.5는 15.7%, GPT-6 Luna는 48.9%, Sonnet 5.5는 83.9%입니다.

• 다학제적 추론 — Humanity's Last Exam에서 도구 없이 45.9%, 도구 사용 시 57.4%를 기록했으며, Haiku 4.5는 각각 10.2%와 18.7%에 그쳤습니다.

• 에이전트형 코딩 — Terminal-Bench 4.0은 39.2%로 0.0%, 16.4%, 70.6%와 대비됩니다. FrontierCode 1.1 (Main)은 46.4%로 GPT-6 Luna의 42.4%, Sonnet 5.5의 52.1%와 대비됩니다.

• 시각적 추론 — Chartography는 도구 없이 46.4%, 6.4%, 29.1%, 61.6%와 대비.

Anthropic은 소형 티어가 승리하지 못하는 영역에 대해서도 이례적으로 솔직하다. Terminal-Bench 차트에 대한 자체 논평에서 Sonnet 5.5와 Opus 5.5는 "복잡한 에이전트형 코딩 작업에는 여전히 더 나은 선택으로 남아 있습니다"라고 말하며, Haiku 5.5는 대신 압축, 요약, 서브에이전트 작업에 위치시킨다. 게시물의 고객 인용문도 같은 방향을 가리키며 같은 단서를 달고 있다 — 이는 자체 평가를 설명하는 얼리 액세스 파트너들의 것이지 감사가 아니다: Asana는 작업 완료 지연 시간이 30% 이상 낮아졌고 에이전트 턴당 추론 속도가 최대 2.5배 빨라졌다고 보고한다; HubSpot은 CRM 포털 제품군에서 세 번 실행한 평균 92.8%를 보고한다; AlphaSense는 주당 약 800만 건의 호출을 처리하는 워크로드에서 400개 쿼리 전반에 걸쳐 0.84 대 0.76을 보고한다; Box는 Haiku 4.5보다 11포인트 높으면서 지연 시간은 약 절반이라고 보고한다; Rogo는 Haiku 5.5 서브에이전트가 10-K에서 부문 매출 라인을 뽑아내는 사례를 설명한다; 그리고 Cognition은 Devin Fusion이 Haiku 5.5를 사이드킥으로 두고 FrontierCode 점수 66.2를 유지한다고 보고한다.

독립 이사회가 말하는 것

벤더 테이블은 벤더의 것입니다. 첫 외부 배치는 해당 티어가 프로덕션 파이프라인을 바꿀 만큼 충분히 이동했는지 판단하려는 누구에게나 더 유용한 숫자입니다.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 in its Max configuration, showing an Intelligence Index v4.3.2 score of 43.40 ranked second of 182 models, an output speed of 242 tokens per second, a cost of $0.21 per Intelligence Index task, and the evaluator's note that the model generated 440 million output tokens against a 100 million median and is very verbose.

Artificial Analysis는 Claude Haiku 5.5가 모델의 Max 구성에서 Intelligence Index v4.3.2 기준 43점을 기록한다고 평가하며, 이는 해당 리더보드의 182개 모델 중 2위이고 리더보드 중앙값 13을 크게 웃도는 수치입니다. 같은 페이지에서는 초당 출력 토큰 242개를 측정하며, 이는 182개 중 9위이고 Intelligence Index 작업당 비용은 $0.21입니다.

그 페이지에서 헤드라인보다 더 값진 것이 두 가지 있다. 첫째는 장황함이다: Index를 평가하면서 Artificial Analysis는 4억 4천만 개의 출력 토큰을 기록했는데, 이는 중앙값 1억 개와 대비되며, 이 모델을 "매우 장황하다"고 설명한다. 토큰당 정가가 부과되므로, 길게 생각하는 모델은 그 대가를 치른다 — 바로 이것이 작업당 비용 수치가 거의 0이 아니라 $0.21에 머무는 이유이고, 90% 입력 절감이 전부가 아닌 이유다. 둘째는 노력 사다리다: 같은 페이지는 Max부터 Low까지의 구성을 드러내며, Anthropic의 기본값은 max가 아니라 medium이다. 리더보드의 43은 그 사다리의 꼭대기이지, 아무것도 하지 않을 때 얻는 설정이 아니다.

이미 호출할 수 있는 티어보다 한 단계 아래 티어를 운영하기

Claude Haiku 5.5는 OrcaRouter 카탈로그에 없으며, 그렇지 않은 것처럼 암시하기보다는 그 사실을 분명히 말하는 편이 좋겠습니다. 모델이 존재하는 시점과 라우팅 가능해지는 시점 사이의 출시 시점 격차는 보통 며칠이며, 때로는 더 깁니다.

현재 Anthropic의 카탈로그에 올라와 있는 것은 Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5이며, 각각 공급자의 정가에 0% 마크업만 붙여 그대로 전달되는 가격입니다. 따라서 Anthropic이 가격을 인하하면 그들이 적용받는 바로 그날 우리 쪽에도 반영됩니다. 지금 서브에이전트 패턴을 시험해 보려는 사람에게 이것이 실질적인 연결 다리입니다. 즉, 일상적인 턴은 Haiku 4.5로 보내고 어려운 턴은 상위 모델로 에스컬레이션하는 캐스케이드가 오늘 바로 작동합니다 키 하나와 SDK 하나만으로, 나중에 작은 쪽을 Haiku 5.5로 바꾸는 일은 마이그레이션이 아니라 모델 ID 변경에 불과합니다. 자동 페일오버는 어떤 구성을 선택하든 그 아래에서 동작하므로, 한 공급자가 잠시 삐걱거린다고 해서 파이프라인까지 함께 무너지지 않습니다.

전혀 기다리고 싶지 않으시다면, 동일한 $0.10 입력 요금 구간은 이미 GPT-6 Luna가 차지하고 있습니다. 저희가 실제로 라우팅하는 이 모델은 요금이 인상되기 전까지 최대 272,000 토큰까지 해당 요율을 유지합니다.

누가 이동해야 하고, 누가 이동하지 말아야 하는가

워크로드가 대량의 분류, 추출, 라우팅, 압축 또는 요약이고 프롬프트가 100,000 토큰 미만이라면, 상황은 단순합니다: 요율은 예전의 10분의 1이고, 윈도는 5배 더 넓어졌으며, 노력 다이얼을 사용하면 요청이 필요로 할 때 반대 방향으로 절충할 수 있습니다. 약 75% 더 낮게 예산을 잡으면 놀라지 않을 것입니다.

프롬프트가 습관적으로 100,000 토큰을 넘는다면, 당신은 90%가 아니라 50% 할인을 사고 있는 셈이며, 장문 컨텍스트를 위한 비교 검토는 여전히 오후 한나절을 투자할 가치가 있습니다 — 이 분야에는 이 등급의 100K 초과 요율과 같거나 그보다 낮은 모델이 여럿 있습니다.

그리고 당신의 eval이 여전히 Terminal-Bench 형태의 작업에서 실패한다면, 이것은 그것을 고치는 모델이 아닙니다; Ant​hropic 스스로 그렇게 말하며, Sonnet 5.5의 70.6%에 맞선 39.2%가 그 글에서 가장 명확한 증거입니다. 10월 7일에 대한 솔직한 요약은 유용한 지능의 바닥이 크게 떨어졌고 천장은 전혀 움직이지 않았다는 것입니다.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트