
Claude Haiku 5.5 vs Gemini 3.8 Flash: 지수 2포인트, 작업당 6배의 비용
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
Claude Haiku 5.5와 Gemini 3.8 Flash는 측정된 성능 면에서 이 가격대의 어떤 다른 조합보다도 서로 더 가깝습니다 — Artificial Analysis Intelligence Index v4.3.2에서 43.40 대 40.93으로, 둘 다 225개 모델 순위표의 상위 50위 안에 들었습니다. 이 둘을 갈라놓는 것은 그 지수 점수 하나에 드는 비용입니다. 동일한 독립 측정에서, 완료된 Intelligence Index 과제 하나의 비용은 Claude Haiku 5.5에서 $0.21, Gemini 3.8 Flash에서 $1.24입니다.
그것은 점수 차이 2.5점에 대해 6배의 격차이며, 이 비교를 결정해야 하는 수치다. 그 밖의 모든 것은 — 공표 요금, 모달리티 목록, Google의 가격 책정에 딸린 마감 기한 — 주변부에 관한 논쟁일 뿐이다.
두 모델 모두, 중요한 수치로
백만 토큰당 미국 달러 기준, Antropic과 Google의 자체 가격 책정 문서에서 발췌했으며, 독립적 측정치는 Artificial Analysis에 의한 것입니다. 2026-10-08에 캐시됨.

• 입력 — Claude Haiku 5.5는 최대 100,000토큰까지 $0.10, 그 이상은 $0.50; Gemini 3.8 Flash는 $0.75 정액이며, 2027년 1월 1일에는 $1.50로 인상됩니다.
• 출력 — Claude Haiku 5.5: 최대 100,000 토큰까지 $0.50, 초과분 $2.50; Gemini 3.8 Flash: $3.75 정액, 같은 날 $7.50로 인상.
• 캐시된 입력 — Claude Haiku 5.5 $0.01 및 $0.05; Gemini 3.8 Flash $0.075, 그리고 백만 토큰당 시간당 $0.50의 저장 요금.
• 컨텍스트 — 둘 다 1M 토큰. 최대 출력 — Claude Haiku 5.5는 128,000 토큰, Gemini 3.8 Flash는 65,536 토큰.
• 입력 모달리티 — Claude Haiku 5.5의 경우 텍스트와 이미지, Gemini 3.8 Flash의 경우 텍스트, 이미지, 음성, 동영상. 이 줄은 Google의 목록이 확실히 더 긴 유일한 항목이다.
• 독립 점수 — Intelligence Index v4.3.2에서 Claude Haiku 5.5 (Max)는 43.40, Gemini 3.8 Flash (High)는 40.93을 기록했습니다.
• 작업당 독립 비용 — 같은 보드에서 $0.21 대 $1.24.
• 속도 — 초당 출력 토큰 241.9개 대 125.2개, 둘 다 Artificial Analysis 측정.
6배라는 수치가 어디서 나온 것인지
작업당 비용 격차는 표면상 가격 격차보다 크며, 바로 그 점이 흥미로운 부분입니다. 왜냐하면 그것은 요율표만으로는 설명되지 않는다는 뜻이기 때문입니다.
가격표 산수는 아주 간단하다: 입력에서 $0.10 대 $0.75는 7.5배 더 저렴하고, 출력에서 $0.50 대 $3.75도 같은 비율이다. 두 모델이 같은 작업에 대해 동일한 토큰을 생성한다면, 그 비율은 청구서에 그대로 이어질 것이다.
그것은 이어지지 않으며, 두 효과 모두 구글에 유리하게 작용한다. Claude Haiku 5.5는 자사 제공사가 인정할 정도로 장황하다: Artificial Analysis는 Index를 실행하는 동안 4억 4천만 개의 출력 토큰을 기록했는데, 이는 중앙값 1억 개와 대비되며, 이 모델을 매우 장황하다고 평가한다. Gemini 3.8 Flash는 중앙값 8,100만 개 대비 1억 7천만 개를 생성했다 — 역시 장황하다고 표시되었지만, 토큰 수는 3분의 1이다. Anthropic 자체 문서는 두 번째 효과를 덧붙인다: Claude Haiku 5.5는 Claude 4.7 및 이후 버전과 공유되는 더 새로운 토크나이저를 사용하므로, 동일한 텍스트가 자신이 대체하는 모델에서보다 약 30% 더 많은 토큰으로 집계된다.
종합하면, 가격 주장의 솔직한 버전은 이렇다: 입력 단가 우위는 10대 1, 출력 단가 우위는 7.5대 1이지만, 답변마다 더 많은 토큰을 쓰는 모델 때문에 일부 상쇄되어, 전체 작업을 과금하는 측정 기준에서는 6대 1 우위에 도달한다. 여전히 압승이지만, 요금표가 시사하는 것보다는 작은 압승이다.
구글의 가격에는 날짜가 붙어 있다
Google의 가격 페이지에서 가장 유용한 단 한 가지는 대부분의 비교표가 빠뜨리는 한 문장이다.
Gemini 3.8 Flash는 입력 $0.75, 출력 $3.75로 "2026년 12월 31일까지" 책정되어 있으며, "2027년 1월 1일부터"는 $1.50와 $7.50로 책정됩니다. 캐시된 입력은 같은 날짜에 $0.075에서 $0.15로 변경됩니다. 이는 만료일이 바로 옆에 명시된 도입 요금으로, 이 글을 쓰는 시점에서 대략 11주 뒤입니다.
Anthropic의 카드 어디에도 그렇게 읽히는 내용은 없다. Claude Ha 5.5의 요금은 요금 그대로 명시되어 있으며, 달력이 아니라 프롬프트 길이를 기준으로 하는 2단계 구조와 2027년 10월 7일 이전에는 은퇴하지 않겠다는 약속이 있다. 내년까지 이어지는 파이프라인을 모델링하고 있다면, Google의 1월 단계는 두 배 인상이며 모델에 포함해야 한다; Anthropic의 경우에는 계획에 반영할 동등한 이벤트가 없다.
그것은 양쪽 모두에 해당하며, 공정한 해석은 '한 판매업체는 정직하고 다른 판매업체는 그렇지 않다'가 아니다. 프로모션 요금은 지속되는 동안에는 실제 요금이고, Google은 출시를 그런 방식으로 가격 책정할 권리가 있다. 1월 수치에서 더 저렴해 보이는 쪽이 바로 그것이 붙은 쪽이라는 것은 단지 비교에 관한 사실일 뿐이다.

지수 2포인트의 가치는 얼마인가요?
60점대까지 이르는 지수에서 2.47점 차이는 반올림 오차도 아니고, 거대한 격차도 아닙니다. 두 모델 모두 같은 실용 구간에 자리 잡고 있으며, 실질적인 질문은 그 차이가 여러분이 실제로 실행하는 작업에서 드러나는지 여부입니다.
벤더 자체 수치로 보면 두 모델은 같은 하네스에서 측정된 것이 아니므로 곧바로 나란히 비교할 수 없다 — Anthropic은 Claude Haiku 5.5에 대해 GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0, FrontierCode 결과를 공개하고, Google은 Gemini 3.8 Flash에 대해 자체 결과 세트를 공개하는데, 어느 벤더도 상대방의 스위트를 실행하지 않았다. 이용할 수 있는 유일한 동등 조건 비교는 독립 게시판이며, 그곳에서의 답은 Anthropic이 측정은 되지만 작은 차이로 앞서 있다는 것이다.
일부 팀에 더 중요하게 작용할 역량 차이는 모달리티 측면에 있습니다. Gemini 3.8 Flash는 음성과 비디오 입력을 받아들이고, Claude Haiku 5.5는 텍스트와 이미지를 받아들입니다. 통화 녹음이나 화면 캡처를 네이티브로 입력하는 파이프라인은 이 두 모델 중에서 가격을 기준으로 선택하는 것이 전혀 아닙니다 — 둘 중 하나는 앞단에 전사 또는 프레임 추출 단계 없이는 작업을 수행할 수 없고, 그 단계에는 그 나름의 비용과 그 나름의 실패 모드가 있습니다.
쌍의 더 저렴한 쪽을 운영하기
Gemini 3.8 Flash는 OrcaRouter 카탈로그에 Google 정가, 0% 마크업으로 등록되어 있습니다. 여기서는 이 점이 평소보다 더 중요합니다. 제공업체의 요율이 혼합되지 않고 그대로 전달되므로, 1월 인상이 청구서에 실제로 어떤 영향을 미치는지 확인하고 싶다면 Google의 숫자가 움직일 때 이 숫자도 함께 움직입니다. Claude Sonnet 5.5와 Claude Opus 5.5도 카탈로그에 있으므로, 3자 라우팅 테스트 — Google의 Flash 라인, Anthropic 중간 티어, 그리고 나중에 Anthropic 소형 티어 — 는 프로젝트가 아니라 구성이 됩니다. 키 하나, SDK 하나, 자동 페일오버, 그리고 애플리케이션 코드가 아니라 라우트에서 에스컬레이션을 표현하고 싶다면 라우팅 DSL.
Claude Haiku 5.5 자체는 아직 카탈로그에 없으며, 이를 모호하게 남겨 두기보다는 그렇게 말하는 편이 더 낫습니다. 이 비교의 Anthropic 쪽은 현재 Anthropic에서만 접근할 수 있는 반면, Google 쪽은 위에 표시된 가격으로 오늘 저희를 통해 호출할 수 있습니다.

어느 것이며, 누구를 위한 건가요?
여러분의 작업이 텍스트 입력 및 출력 작업이고, 프롬프트가 100,000 토큰 미만이며, 실제 사용량에 대해 토큰당 비용을 지불한다면, Claude Haiku 5.5는 이 글의 모든 지표에서 더 저렴한 모델이며, 유일한 공통 리더보드에서 더 높은 점수를 받은 모델입니다 — 단, 그 이점은 스티커 가격이 암시하는 10배가 아니라 작업당 비용 기준 6배라는 점을 유의해야 합니다.
오디오나 비디오 입력이 필요하거나, 65K를 넘는 응답이 필요하거나, 프롬프트가 늘 길다면 셈법이 달라진다: Gemini 3.8 Flash는 Anthropic의 소형 티어가 받아들일 수 없는 입력을 처리할 수 있고, 100,000 토큰을 넘어서면 Anthropic 자체의 두 번째 티어는 Google의 정액 요금을 훨씬 웃도는 가격이 매겨진다.
꼭 붙잡아야 할 것은 날짜다. Google의 요율은 연말까지 그대로 유지되고 그 이후에는 두 배가 된다. Anthropic의 요율은 기간 단계가 붙은 정액으로 명시돼 있다. 그중 어느 쪽에 서든, 파이프라인을 만들기 전에 스프레드시트에 일정표부터 넣어라.
