
Claude Haiku 5.5, 이제 GitHub Copilot에 탑재: 크레딧 예산 안에서 가장 저렴한 Anthropic 모델의 비용은?
- OrcaNEWOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 100만 토큰당 · 71 tok/s
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 389 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
Claude Haiku 5.5는 2026년 10월 7일 GitHub Copilot 모델 선택기에 등장했습니다. 공급업체가 이를 출시한 바로 그날이었으며, 이를 알린 변경 로그 항목은 대부분의 분량을 지원 환경에 할애합니다. Visual Studio Code, Visual Studio, Copilot CLI, GitHub Copilot 클라우드 에이전트, Copilot 앱, github.com, iOS 및 Android용 GitHub Mobile, JetBrains IDE, Xcode, Eclipse. 예산을 쥐고 있는 사람이라면 중요한 문장은 더 짧습니다. 이 모델은 "사용량 기반 청구에서 공급자 정가로" 청구됩니다. Copilot 내에서 이는 AI 크레딧을 의미하며, Claude Haiku 5.5의 요금은 충분히 낮아 크레딧 계산이 출시의 부차적인 뒷생각이 아니라 흥미로운 부분이 됩니다. 이 글은 그 계산을 직접 해보고, GitHub이 실제로 입증한 것과 단지 주장한 것을 구분하며, 출시 보도가 대부분 건너뛴 공급업체 자체 문서의 두 가지 예외 조항을 다룹니다.
GitHub이 무엇을 출시했으며, 누구에게 제공했는가
해당 항목의 제목은 간단명료하게 “Claude Haiku 5.5 in GitHub Copilot”이며, 10월 7일 태평양 시간 13:12에 올라왔습니다. Copilot Pro, Pro+, Max, Business, Enterprise 구독자에게 제공됩니다. 즉 모든 유료 등급을 의미하며, 특히 무료 등급에는 제공되지 않습니다. 무료 등급에서는 모델 선택이 사용자가 아니라 여전히 자동으로 처리됩니다. 배포는 점진적으로 진행되므로 편집기의 선택기가 변경 로그보다 며칠 늦을 수 있습니다. 이는 사용자가 직접 알아내도록 내버려 두지 않고 해당 항목에 명시되어 있습니다.
GitHub가 이 모델의 용도를 스스로 규정한 방식은 주의 깊게 읽어볼 가치가 있습니다. 왜냐하면 그것은 공급업체의 규정보다 더 좁기 때문입니다:
• 빠르고 대량의 작업 — 서브에이전트, 빠른 편집, 터미널 작업을 GitHub의 표현 그대로 • 선택기에서 대형 모델을 대체하는 것이 아니라 그 아래의 저렴한 계층으로 포지셔닝됨 • GitHub의 지원 모델 레퍼런스에 따르면 일반 제공(GA) 상태로, 해당 문서에는 Claude Haiku 5.5가 GA로 기재되어 있음 • 같은 레퍼런스에 IDE 버전 행이 TBD로 표시되어 있어, 편집기 쪽에서 점진적으로 롤아웃되는 것처럼 보이는 실질적 이유가 됨 • 사용량 기반 청구 아래 제공업체 정가로 책정되며, Copilot 전용 마크업은 붙지 않음img src="2.png"> p>주변 변경 로그의 날짜들은 단일 모델 페이지에서는 알 수 없는 주기적 맥락을 제공한다. Claude Sonnet 5.5는 9월 28일에, Claude Opus 5.5는 9월 22일에, Claude Fable 5.1은 9월 1일에 Copilot에 등장했다. Anthropic은 대략 2~4주마다 Copilot 통합을 내놓고 있고, GitHub는 각각을 며칠 만에 마무리하고 있다. 이러한 주기 때문에 이 문제에는 시한이 붙는다. GitHub는 9월 중순에 10월 중순의 "selected GitHub Copilot models" 폐기 공지를 게시했고, 이어 10월 2일에는 해당 모델 제거를 확인하는 후속 공지를 올렸다. 팀에서 Copilot 구성에 모델을 고정(pin)해 두었다면, 이제 가장 깨지기 쉬운 것은 가격이 아니라 그 핀이다.

신용 원장으로 읽는 요율표
Claude Haiku 5.5는 두 가지 등급으로 청구되며, 선택하는 설정이 아니라 요청 크기에 따라 전환됩니다. 아래 내용은 모두 GitHub가 직접 공개한 요금표이며, 전부 백만 토큰당 기준입니다:
• 100,000 토큰 이하 구간 — 입력 $0.10, 캐시된 입력 $0.01, 캐시 쓰기 $0.125, 출력 $0.50 • 100,000 토큰 초과 구간 — 입력 $0.50, 캐시된 입력 $0.05, 캐시 쓰기 $0.625, 출력 $2.50 • Claude Haiku 4.5, 이와 대조적으로 — 입력 $1.00, 캐시된 입력 $0.10, 캐시 쓰기 $1.25, 출력 $5.00 • 한 단계 위인 Claude Sonnet 5.5 — 입력 $2.00, 캐시된 입력 $0.10, 캐시 쓰기 $2.50, 출력 $10.00 • Anthropic 모델에서는 캐시 쓰기가 캐시된 입력과는 별도로, 그 위에 추가로 청구된다 — 이는 선택 목록에 있는 모든 공급업체에 존재하는 항목은 아니다 img src="3.png"> p>이 행들을 함께 읽으면 두 가지가 나온다. 첫째, Claude Haiku 5.5의 숏 티어는 입력과 출력 모두에서 Claude Haiku 4.5보다 꼭 열 배 저렴하고, 입력 기준으로는 Claude Sonnet 5.5보다 대략 스무 배 저렴하다 — 이는 소규모 호출이 무리를 이루면 호출당 지불하는 비용이 배로 불어나는 서브에이전트 슬롯에 이것이 들어갈 만한 바로 그 이유다. 둘째, 롱 컨텍스트 티어는 동일한 100,000 토큰 기준선에서 모든 요율이 한꺼번에 정확히 숏 티어의 다섯 배다. 99,000 토큰 요청과 101,000 토큰 요청은 그 기준선을 넘어선 토큰들에서 2퍼센트 차이가 아니라, 그 모든 토큰에서 다섯 배 차이다. 그 계단식 요금은 Anthropic의 정가에서 그대로 물려받은 것이며, Copilot의 크레딧 시스템이 그것을 완만하게 만들어 주지 않는다.

이제 크레딧입니다. Copilot의 사용량 기반 청구는 모델 사용량을 크레딧당 $0.01이라는 문서화된 요율로 AI 크레딧으로 환산하며, 각 요금제에는 매월 제공되는 크레딧 풀이 있습니다:
• Copilot Pro, 월 $10 — 1,500 크레딧, 기본 1,000에 유연 500을 더한 것으로 표기 • Copilot Pro+, 월 $39 — 7,000 크레딧, 기본 3,900에 유연 3,100을 더한 것으로 표기 • Copilot Max, 월 $100 — 20,000 크레딧, 기본 10,000에 유연 10,000을 더한 것으로 표기 • Copilot Business, 시트당 월 $19 — 사용자당 1,900 크레딧 • Copilot Enterprise, 시트당 월 $39 — 사용자당 3,900 크레딧 • 조직 및 엔터프라이즈 풀은 사용자별로 분리되지 않고 시트 전체에 걸쳐 공유됩니다 • 풀을 초과하는 사용량은 크레딧당 $0.01로 청구됩니다 — 초과분에도 동일한 환산이 적용됩니다 • 코드 완성과 다음 편집 제안은 크레딧 청구 대상에서 완전히 제외되며 유료 플랜에서 무제한으로 유지됩니다p>이 둘을 함께 놓으면 이번 출시의 윤곽이 구체화됩니다. 적당한 규모의 에이전트 단계 하나를 가정해 보죠 — 입력 토큰 40,000개, 출력 토큰 2,000개, 캐싱 없음. Claude Haiku 5.5의 숏 티어에서는 40,000 곱하기 백만당 $0.10 더하기 2,000 곱하기 백만당 $0.50, 즉 $0.005이며, 이는 문서화된 환산 기준으로 0.5크레딧입니다. 동일한 호출을 Claude Haiku 4.5의 요율로 계산하면 $0.05, 즉 5크레딧이 됩니다. 여기서의 계산은 GitHub가 아니라 저희가 한 것이지만, 입력값은 모두 공개된 요금표에서 가져왔고 결론은 미묘하지 않습니다: Pro 구독자의 1,500크레딧 풀은 새 Haiku에서 이러한 호출을 약 3,000건 수용하는 반면, 구버전에서는 약 300건을 수용했습니다. 구독료는 그대로인데 풀은 열 배로 길어집니다.
그것이 솔직한 가치 제안이며, 여기에는 풀이 달러가 아니라 크레딧으로 표시된다는 솔직한 단서가 따릅니다. 따라서 요율표가 바뀔 때마다 요금제의 실제 상한도 움직입니다. 한 모델의 요금을 10분의 1로 인하해도 트래픽이 세 모델에 걸쳐 분산되어 있다면 풀이 10배로 늘어나지는 않습니다.
GitHub이 이 모델이 한다고 말하는 것, 그리고 아직 보여주지 않은 것
체인지로그에는 성능에 관한 주장이 하나 들어 있는데, 그 주장은 보도에서 감당할 수 있는 것보다 더 많은 일을 하고 있다. GitHub는 초기 테스트에서 Claude Haiku 5.5가 "많은 코딩 작업에서 Claude Sonnet 5와 맞먹었다"면서 "훨씬 적은 토큰과 단계"를 사용했다고 쓴다.
한정어들을 순서대로 읽어보세요. 이는 초기 테스트입니다. 그것은 GitHub의 테스트이고, GitHub의 과제에 대해 이루어지며, GitHub는 이 통합을 판매하는 당사자입니다. 어떤 하네스도 명시되지 않았고, 어떤 과제 세트도 공개되지 않았으며, 문장의 어느 쪽에도 수치가 동반되지 않았고, "많은"은 숫자가 아닙니다. 그 주장은 사실일 수도 있습니다 — 좁고 도구 형태의 코딩 과제에서 작은 모델이 큰 모델과 맞먹는 것은 2026년에 그럴듯한 결과입니다 — 하지만 발표된 그대로라면 그것은 공급업체의 주장이며, 반복될 때마다 그렇게 표시되어야 합니다. "더 적은 토큰과 단계"라는 부분은 둘 중 더 오래가는 쪽입니다. 왜냐하면 그것은 능력이 아니라 효율성에 대한 주장이고, Haiku 가격대에서의 효율성은 일주일 안에 여러분 자신의 사용 텔레메트리에 나타나기 때문입니다. 능력 부분은 슬라이드에 들어가기 전에 제3자 하네스를 필요로 합니다.
Anthropic 자체의 수치는 GitHub의 수치와는 별개의 주장이며, 동일한 출처 문제를 안고 있다. Anthropic은 Claude Haiku 5.5가 평균적으로 약 75퍼센트 더 저렴하게 실행된다고 밝히며, 이전에 Haiku급 모델로 전송된 요청의 약 90퍼센트가 100,000토큰 미만이고, 이 구간에서 모델이 "특히 가성비가 좋다"고 말한다. 둘 다 벤더가 자사 제품의 경제성을 설명하는 것이다. 이는 공개된 요금표와 일치한다 — 숏 티어는 큰 폭의 인하, 롱 티어는 더 작은 폭의 인하 — 그리고 측정된 결과라기보다는 벤더의 안내로서 유용하다.
이를 켜는 것은 관리자가 결정할 일이며, 기본값은 예입니다.
Copilot Business 및 Enterprise 구매자가 두 번 읽어야 할 변경 로그 부분은 액세스 제어 문단입니다. 관리자는 Copilot 설정의 모델 정책을 통해 모델 액세스를 관리하며, GitHub의 문서화된 기본 동작은 관리자가 전역 기본값을 꺼두거나 해당 특정 모델을 명시적으로 비활성화하지 않는 한 새 모델이 자동으로 활성화된다는 것입니다. 기본값은 허용적이며, 제한은 옵트아웃 방식입니다.
두 가지 결과가 따릅니다. 조직에서 엄격한 모델 거버넌스를 시행하고 있다면, Claude Haiku 5.5는 누구도 이름으로 승인하지 않았는데도 개발자가 이미 선택할 수 있는 상태일 수 있습니다. 반대로 조직에서 이미 전역 기본값을 비활성화했다면, 변경 로그에 무엇이 적혀 있든 해당 모델은 표시되지 않습니다. 이는 모든 Copilot 모델 출시 첫 주에 가장 흔한 지원 질문에 대한 가장 유력한 설명입니다. 선택기에 항목이 없는 문제를 디버깅하기 전에 모델 정책을 확인하세요.
Anthropic의 문서는 출시 게시물이 밝히지 않은 두 가지 예외 조항을 명시하고 있다.
이 두 가지는 모두 언론 보도가 아니라 Anthropic의 플랫폼 문서에서 나온 것이며, 둘 다 지불하는 비용이 아니라 무엇을 구축할 수 있는지에 영향을 줍니다:
• Priority Tier는 Claude Haiku 5.5에서 사용할 수 없습니다 — Anthropic의 서비스 티어 문서는 Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 및 Mythos 라인과 함께 이 모델을 명시적 제외 목록에 올려두었습니다. 아키텍처가 저렴한 티어에서 프로비저닝된 처리량을 가정한다면, 그 가정은 여기서 성립하지 않습니다. • 표준 가격에서의 전체 100만 토큰 컨텍스트 윈도는 "Claude 4.6 및 이후 모델(Claude Haiku 5.5 제외)"에 부여됩니다 — 이 괄호는 Anthropic의 것이며, Claude Haiku 5.5는 그 대상에서 제외된 유일한 현재 모델입니다. 이 윈도는 여전히 해당 모델의 스펙 행에 1M로 표기되며, 최대 출력은 128,000 토큰입니다. 이 제외가 의미하는 바는 포괄적인 장문 컨텍스트 가격 보장이 이 모델에 적용된다고 해석해서는 안 된다는 것입니다. • 토크나이저가 변경되었습니다. Anthropic은 Claude 4.7 및 이후 모델이 동일한 텍스트에 대해 약 30퍼센트 더 많은 토큰을 생성하는 더 새로운 토크나이저를 사용한다고 밝힙니다. 이는 토큰당 가격과 텍스트 한 페이지당 가격이 반대 방향으로 움직였다는 뜻입니다. Claude Haiku 5.5의 스펙 행에는 위치로 "Fastest", 적응형 사고 기본값 medium, 2026년 6월 지식 컷오프, 모델 ID claude-haiku-5-5가 나열되어 있습니다.
이 중 어느 것도 GitHub가 이 모델을 겨냥하는 서브에이전트 및 빠른 편집 워크로드에 결정적인 걸림돌은 아니다. 이들은 출시 게시물을 인용하는 것과 문서를 인용하는 것의 차이이며, 부하 테스트를 견뎌내는 쪽은 후자다.
도구를 바꾸기보다 그것을 라우팅하는 편이 더 낫다면
Claude Haiku 5.5를 채팅 및 편집기 구독을 통해서만이 아니라 자체 스택에서 직접 호출하는 데에는 타당한 근거가 있습니다. 중간에 크레딧 전환 없이 순수한 단기 등급 요율을 적용받을 수 있고, 라우팅 결정을 자체 코드에 유지할 수 있기 때문입니다. 가용성 상황을 명확히 말하자면, Anthropic은 이를 Claude Platform과 Amazon Bedrock, Vertex AI, Microsoft Azure를 통해 판매하고 있으며, 아직 저희 카탈로그에는 없습니다. OrcaRouter는 현재 200개가 조금 넘는 모델 카탈로그에서 Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1을 제공하고 있으며, Claude Haiku 5.5는 그 목록에 없습니다. 지금 이 모델 자체를 이용하려면 Anthropic이나 세 클라우드 중 하나를 직접 호출하세요.

우리가 적합한 지점은 그 주변 계층입니다. OrcaRouter는 공급자 정가를 마크업 없이 그대로 전달하므로, 공급업체가 모델 가격을 변경할 때 — Anthropic이 이 모델에서 그랬듯이 — 새 요율이 청구 주기가 끝난 뒤가 아니라 당일 우리 쪽에 반영됩니다. 자동 장애 조치는 오류가 발생한 저가 티어 호출이 요청 실패로 이어지지 않고 정상 작동하는 경로로 전달되게 합니다. 이는 단일 인터랙티브 세션보다 수천 건의 작은 호출을 수행하는 서브에이전트 플릿에 더 중요합니다. 그리고 라우팅 DSL은 바로 이번 출시가 만들어내는 의사결정 형태를 위해 존재합니다. 짧고 대량인 작업은 임계값 미만에서 가장 저렴한 모델로, 롱컨텍스트 작업은 임계값 이상에서 가장 저렴한 모델로 보내되, 하나의 엔드포인트와 하나의 청구서로 처리하는 것입니다. 그 분기를 두 개의 통합으로 구현하는 대신에 말이죠. Haiku 5.5가 카탈로그에 등장하면 코드 변경 없이 그 정책에 그대로 편입됩니다.
다음 스프린트 전에 이걸 어떻게 해야 할까요?
좁게 해석하자면, Anthropic의 현재 가장 저렴한 모델이 이제 모든 유료 Copilot 티어에서 선택 가능하며, 숏 티어에서 대체하는 Haiku보다 토큰당 대략 10배 저렴하다는 것입니다. 팀에서 Copilot을 통해 서브에이전트나 터미널 형태의 자동화를 실행하고 있다면, 모델 전환은 월간 크레딧 풀이 얼마나 오래 가는지에 크고 즉각적인 영향을 주는 설정 변경입니다.
가장 먼저 확인해 볼 가치가 있는 두 가지는 발표문이 묻어 둔 것들입니다. 요청 크기의 95번째 백분위수를 보세요. 그것이 100,000 토큰을 넘으면, 실제로 청구되는 등급은 두 번째 등급이고, 10배 비교는 5배 비교가 됩니다. 그리고 조직의 모델 정책에서 글로벌 기본값이 켜져 있는지도 확인하세요. Business 및 Enterprise 좌석의 경우, 그 단일 설정이 이번 출시를 개발자들이 아예 사용할 수 있는지 여부를 결정합니다.
