
OpenCode Go에서의 Claude Haiku 5.5: 월 $10로 실제로 얻는 것
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
Anthropic이 출시한 Claude Haiku 5.5는 2026년 10월 7일 공개되어, 하루 만에 OpenCode의 Go 및 Zen 카탈로그에 등재되었습니다. 이 카탈로그는 토큰을 청구하는 대신 월별 달러 허용량을 계량하는 코딩 에이전트 구독입니다. 두 번째 등재가 바로 잠시 짚고 넘어갈 지점인데, OpenCode가 Claude Haiku 5.5에 대해 공개한 허용량은 이 모델의 할인이 아니기 때문입니다. 그것은 Anthropic 자체의 정가로 설정된 예산 계량기이며, 그 이면의 모든 수치는 이를 공개한 두 페이지와 대조해 확인할 수 있습니다. 아직 Claude Haiku 4.5 대신 무엇을 호출할지 결정 중이라면, 결정 기준은 허용량이지 가격표가 아닙니다.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Anthropic이 10월 7일에 공식적으로 밝힌 내용
벤더는 이를 조용히 출시하지 않았다. Anthropic의 뉴스룸에는 날짜가 명시된 발표문, 벤치마크 표가 실린 제품 페이지, 시스템 카드, 가격표, 그리고 이름이 밝혀진 고객 인용문 6개가 있다. 살펴볼 저장소도, 공개된 가중치도 없다. 공개할 것이 애초에 없기 때문이다. Artificial Analysis는 Claude Haiku 5.5를 파라미터 수가 공개되지 않은 독점 모델로 기록한다. 이를 유출되었거나 발표되지 않은 모델이라고 설명하는 사람은 존재하지 않는 저장소를 읽고 있는 것이다.
Anthropic의 자기 규정은 프런티어 모델이 아니라 볼륨 모델이다:
• 포지셔닝 — "지금까지 출시한 소형 모델 중 가장 저렴하고 가장 빠르며 가장 성능이 뛰어난 모델"로, 요약, 압축, 데이터베이스 쿼리, 분류 작업을 겨냥하며, 코딩 작업에서 Claude Opus 5.5 및 Claude Sonnet 5.5와 짝을 이루는 서브에이전트로 제안된다.
• 가격 — 최대 100,000토큰의 프롬프트에 대해 백만 입력 토큰당 $0.10, 백만 출력 토큰당 $0.50; 그 이상은 $0.50 및 $2.50. 캐시 읽기 $0.01 / $0.05, 캐시 쓰기 $0.125 / $0.625.
• 컨텍스트 및 출력 — 최대 출력 128,000 토큰을 지원하는 1M 토큰 윈도우로, 더 큰 5.5 티어 모델들이 갖춘 것과 동일한 범위를 가장 저렴한 티어에서 그대로 구현했습니다.
• Effort — 조절 가능한 Effort 설정을 갖춘 최초의 Haiku급 모델로, Low부터 Max까지 작동하며 기본값은 medium입니다. Anthropic은 단일 수치가 아니라 각 설정에서의 정확도 대비 비용 곡선을 공개합니다.
• 벤치마크는 공급업체 보고 수치이며 독립적으로 재현되지 않음 — GDPval-AA v2.1 1620 대 Claude Haiku 4.5의 735; AA-Briefcase v1.1 1578 대 614; OSWorld 2.1 72.4% 대 15.7%; Humanity's Last Exam 도구 없이 45.9%, 도구 사용 시 57.4% 대 10.2%, 18.7%; Terminal-Bench 4.0 39.2% 대 0.0%; Chartography 46.4% 대 6.4%.
• 공급업체 스스로의 한계 — Anthropic이 자사의 Terminal-Bench 차트에 대해 남긴 논평에서는 Claude Sonnet 5.5와 Claude Opus 5.5가 "복잡한 에이전트형 코딩 작업에는 여전히 더 나은 선택으로 남는다"라고 말한다. 같은 게시물의 고객 인용문은 자체 평가를 설명하는 얼리 액세스 파트너들의 것이지 감사가 아니다: Asana는 에이전트 턴당 지연 시간이 30% 이상 낮아지고 추론 속도는 최대 2.5배 빨라졌다고 보고하고, HubSpot은 세 번의 실행 평균 92.8%, AlphaSense는 주당 약 800만 건의 호출 워크로드에서 400개 쿼리 전반에 걸쳐 0.84 대 0.76, Box는 지연 시간이 약 절반인 상태에서 11포인트 더 높으며, Cognition은 Haiku 5.5를 사이드킥으로 두고 FrontierCode 점수 66.2를 기록했다.

Anthropic은 또한 이번 출시를 계기로 인접한 두 가지 가격을 조정했습니다. Claude Sonnet 5.5의 캐시 읽기는 100만 토큰당 $0.10로 절반으로 줄었으며, 회사는 이로써 Sonnet 5.5가 대부분의 에이전트 작업에서 약 20% 더 저렴해진다고 말합니다. 또한 Claude Max 및 Team 구독자를 위한 새로운 월간 API 크레딧도 마련했습니다. 두 가지 모두 상위 티어에 대한 변경 사항이며, 둘 다 이미 Sonnet을 표준으로 사용하는 팀에게는 소형 모델을 알아보는 누구보다 더 중요합니다.
허용액은 할인이 아니라 달러 예산입니다
다음은 발표 트윗이 말하지 않은 부분입니다. OpenCode의 Go 문서에는 "사용 한도는 월별 달러 금액으로 정의된다"고 나와 있으며, 두 요금제에서 토큰 가격이 동일하고, 각 모델의 허용량은 정해진 일정에 따라 줄어든다고 합니다: 5시간마다 월 한도의 20%, 주당 50%, 월당 100%. 이 문서는 또한 이 모델에 대해 가정하는 요청당 토큰 프로필도 공개합니다 — 입력 토큰 1,100개, 캐시된 토큰 55,000개, 출력 토큰 240개.
그것들을 Anthropic의 정가에 대입해 보면, 공개된 요청 수는 더는 임의적인 배분처럼 보이지 않는다:
• 정가 기준 요청당 비용 — $0.10/M의 입력 1,100개 + $0.01/M의 캐시 읽기 55,000회 + $0.50/M의 출력 240개 = $0.000입니다.
• 월간 요청 수 — $15를 $0.00078로 나누면 19,230이며, 이는 문서에 표기된 숫자입니다. $40 플랜의 $60 허용량을 나누면 76,923이 되고, 문서에는 76,920이라고 표기되어 있습니다.
• 감량 — 19,230의 20%는 3,846이며, 5시간당 3,850으로 표기됩니다; 50%는 9,615이며, 주당 9,620으로 표기됩니다. Go Plus는 15,380과 38,460에서 동일한 계산을 따릅니다.
• 달러로 환산하면 무슨 뜻일까요 — 이 허용량은 $10 요금제에서 Anthropic 가격의 토큰 $15어치, $40 요금제에서는 $60어치에 해당합니다. 따라서 $10 구독으로는 이 모델의 토큰을 한 달에 최대 $15어치까지 살 수 있습니다. 허용량 전부를 Claude Haiku 5.5에만 쓰고 다른 것은 아무것도 쓰지 않는다면 말입니다.
그것이 Go 페이지의 "New" 배지를 읽는 정직한 방식이다. 구독료는 저렴하고 모델도 저렴하며, 이 두 사실은 서로 독립적이다: 허용량은 공급업체 자체 요율로 측정되는 예산이므로, 이 요금제는 모델 비용이 얼마나 적게 드는지가 아니라 얼마나 많이 지출할 수 있는지를 제한한다. 헤비 사용자는 한도에 부딪혀 Anthropic에 직접 비용을 지불하거나, 모델을 직접 라우팅한다.

90퍼센트, 75퍼센트, 그리고 5배의 절벽
Anthropic의 헤드라인은 Claude Haiku 5.5보다 약 90% 저렴하며, Claude Haiku 4.5최대 100,000 토큰의 프롬프트에서, 그리고 평균적으로는 "이제 실행 비용이 약 75% 더 적게 든다"는 것입니다. 두 수치 모두 벤더의 것입니다. 또한 둘 다 정확하며, 그 사이의 격차가 바로 가격 책정 위험의 전부입니다.
• 이 구간 내에서는 입력 $0.10, 출력 $0.50이며, Haiku 4.5의 고정 $1 및 $5와 대비됩니다. Anthropic에 따르면 이전 Haiku 모델에 대한 요청의 약 90%가 이 구간에 해당했으며, 90%라는 수치가 바로 여기서 나옵니다.
• 구간 위에서는 — 동일한 요청에 입력 $0.50, 출력 $2.50가 청구되며, 입력 기준 5배로 뛴다. 이는 여전히 Haiku 4.5 요율의 절반이지만, 90% 인하에는 턱없이 부족하다.
• 블렌디드 클레임 — 75%라는 수치는 실제 트래픽 구성 전반에 걸친 Anthropic 자체의 추정치이지 요율표가 아니며, 바로 예측에 넣어야 할 숫자입니다.
• 토크나이저 — Claude 4.7 이후 버전과 공유되는 최신 토크나이저는 Anthropic 자체 문서에 따르면 동일한 텍스트에 대해 약 30% 더 많은 토큰을 생성하므로, 토큰당 단가 인하가 청구서 감소로 일대일 대응되지는 않습니다.
에포트 다이얼은 이 모든 것을 증폭시킵니다. 기본값이 medium이고 공개된 곡선이 Max까지 올라가므로, 대부분의 호출자가 전혀 설정하지 않는 매개변수에 따라 동일한 프롬프트 비용이 몇 배 더 들 수 있습니다 — 그리고 OpenCode의 요청 추정치는 하나의 암묵적 설정에서 하나의 고정된 토큰 프로필을 가정합니다. 프롬프트가 100,000토큰 근처에 있거나, 사용량이 제한된 서브에이전트를 실행하거나, 에포트 다이얼을 변경한다면, 90%는 당신이 보게 될 숫자가 아닙니다.
독립 위원회는 점수에는 합의하면서도 자체 계산에는 문제를 제기한다
Artificial Analysis의 점수에 따르면, Claude Haiku 5.5는 모델의 Max 구성에서 해당 기관의 Intelligence Index v4.3.2에서 43점을 기록했으며, 리더보드 중앙값 13과 비교됩니다. 또한 초당 출력 토큰 241.9개를 측정했는데, 이는 비교 가능 모델 중앙값 110.9에 대비한 수치입니다. 같은 페이지에서는 비용을 Intelligence Index 작업당 $0.21로 제시하고, 이 모델이 평가 중 1억 개 중앙값에 대비해 4억 4천만 개의 출력 토큰을 생성했다고 보고하며, 이를 "매우 장황하다"라고 설명합니다.
장황함은 두 리더보드가 서로 맞물리는 지점입니다. 위의 허용량 계산은 토큰당 청구되므로, 길게 추론하는 모델은 요청 수가 시사하는 것보다 예산을 더 빨리 소모하며, OpenCode의 요청당 55,000개 캐시 토큰 프로필은 구독 사용자가 재현할 수도, 재현하지 못할 수도 있는 프롬프트 캐싱에 관한 가정입니다. Artificial Analysis 페이지의 두 가지 공개 정보는 헤드라인보다 더 큰 가치가 있습니다. 43은 아무것도 하지 않을 때 얻게 되는 effort 설정이 아니라 Max 구성이며, 해당 페이지에는 Claude Haiku 5.5가 더 긴 컨텍스트 입력에 대해 5배 더 높은 가격을 책정하며 이는 현재 비용 수치에 반영되지 않는다는 명시적 주석이 있습니다. 긴 컨텍스트 절벽은 실재하며, 독립 리더보드는 그것이 아직 자체 수치에 반영되지 않았다고 알려주고 있습니다.

대부분의 구매자가 건너뛸 리텐션 문구
OpenCode의 Go 문서에는 모델별 개인정보 보호 표가 있으며, 바로 이 행에서 Claude Haiku 5.5가 대부분의 카탈로그와 다릅니다. 공급업체의 자체 설명은 예외가 있는 제로 보존입니다. 해당 Go 표의 대부분 모델은 "0일"로 표시됩니다. 이 모델은 "30일"로 표시되며, 요청이 Anthropic의 데이터 정책에 따라 30일 동안 보존된다는 주석이 있습니다. 이는 GPT-6 Luna와 GPT-5.6 Luna에 적용하는 것과 동일한 처리이며, 목록의 대부분을 차지하는 0일 행과는 반대입니다.
코딩 에이전트의 경우, 이는 프롬프트, 파일 경로, 붙여넣은 소스가 마케팅 문구상 제로 보존을 내세우는 요금제에서 한 달 동안 업스트림 공급업체에 남아 있을 수 있다는 뜻입니다. 그렇다고 그 모델을 피해야 할 이유는 아닙니다. 배너가 아니라 해당 행을 읽어야 할 이유입니다. 한편 Anthropic의 출시 자료 중 API 측 입장을 바꾸는 것은 없습니다. Claude API는 제로 데이터 보존을 제공해 왔으며, 직접 통합을 규율하는 것은 모델 카드의 보존 조건입니다.
확인된 것과 확인되지 않은 것은 무엇인가?
확인된 항목 집합은 크고 구체적이며, 이는 이렇게 새로운 모델에서는 이례적이다. 확인되지 않은 것은 더 좁고, 얼버무리기보다 이름 붙일 가치가 있다:
• 확인됨 — 이 모델은 존재하며, id claude-haiku-5-5로 API 전용이고, Claude API와 Amazon Web Services, Google Cloud 및 Microsoft Azure를 통해 10월 7일에 출시되었으며, 위 가격으로 1M 토큰 창, 조정 가능한 effort, 공개된 시스템 카드를 갖추고 있습니다.
• 확인됨 — 두 개의 서드파티 플랫폼이 같은 날 모델 ID, 엔드포인트, 종량제 허용량과 함께 이를 등록했습니다.
• 확인되지 않음 — 우리가 찾을 수 있는 어떤 독립적인 벤치마크도 벤더의 표를 재현하지 못했습니다. Anthropic의 출시 게시물에 있는 모든 정확도 수치는 Anthropic 자체 하네스에서 나온 것이며, 모든 고객 인용문은 파트너가 스스로 보고한 초기 테스트입니다.
• 미확인 — 점검할 가중치도, 리포지토리도, 체크포인트도, 라이선스도 없다. 이 모델은 비공개이며, 아키텍처나 규모에 관한 모든 주장은 추론에 불과하다.
• 미확인 — 플랫폼의 요청 추정치가 가정된 토큰 프로파일이 아닌 다른 조건에서도 성립하는지, 그리고 5배 롱컨텍스트 요금이 독립 게시판의 비용 수치에 (과연, 그리고 언제) 반영되는지.
이미 당신이 부르고 있는 것 옆에서 실행하기
이번 출시로 생긴 실질적인 질문은 “Haiku 5.5가 좋은가”가 아니다 — 벤더의 표는 그렇다고 말하며, Anthropic 밖의 누구도 확인하지 않았다. 질문은 “청구서는 얼마인가, 그리고 이 특정 호출에 저렴한 등급이 적합한 등급이 아닐 때 무슨 일이 일어나는가”다. 두 측면 모두 라우팅 문제다.
비용에서 기준이 되는 것은 스티커 가격이 아니라 토큰 청구서다. 입력 90% 절감에 토크나이저 30% 확대, 장황한 추론 모델, 5배로 늘어난 롱컨텍스트 단계까지 더해지면, 자신의 프롬프트 길이 분포를 측정하지 않는 한 예측하는 숫자와 지불하는 숫자는 벌어진다. 100,000토큰 이상에서 5배 더 비싼 모델은 압축(compaction)에 보상을 준다 — 그리고 Haiku 5.5 자체가 압축 모델로 홍보되고 있다는 점은 눈여겨볼 만한 순환 고리다.
위험에 관해 말하자면, 검증되지 않은 티어는 바로 그것에 프로덕션 경로를 걸지 말아야 하는 대표적인 경우입니다. Claude Haiku 4.5는 이미 OrcaRouter에서 Anthropic의 정가에 0% 마크업으로 제공되고 있으므로, 기존 티어에는 새 계약이 필요하지 않으며, 새 모델에서 알려진 모델로 폴백하는 라우트는 재작성이 아니라 구성 변경에 불과합니다. effort 파라미터는 호출 단위로 적용되므로, 동일한 엔드포인트가 두 개의 통합을 유지할 필요 없이 낮은 effort로는 요약을, 높은 effort로는 까다로운 추출을 실행할 수 있습니다 — 라우팅 DSL은 바로 이런 형태의 결정을 위해 존재하며, 자동 장애 조치가 있기에 독립적인 수치를 확보하기 전에도 며칠 된 모델을 실제 트래픽 앞에 배치할 수 있습니다. 아직 사실이 아닌 것은 명백합니다: Claude Haiku 5.5는 오늘 우리 라우트에 없으며, 이번 주에 그것을 원한다면 Anthropic에 직접 전화하거나 그것을 발표한 플랫폼을 통해야 합니다.
전환해야 할 대상: 볼륨이 요약, 분류, 압축, 서브에이전트 작업인 팀. 여기에는 90% 구간이 적용되며, 토크나이저의 30%는 감당할 수 있는 계산상의 수치다. 기다려야 할 대상: 프롬프트가 일상적으로 100,000 토큰을 넘는 사람, 도입을 결정하기 전에 독립적인 벤치마크가 필요한 사람, 코드가 30일 보존 기간에 머물 수 없는 사람. 출시는 진짜이고 가격도 진짜다. 증명은 여전히 공급업체의 몫이다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
