'인덱스 2점을 위한 6배의 비용'이라는 제목에 '작업당 비용' 배지를 달고, '플래시 등급 모델 두 종, 하나의 보드'라는 킥커와 'Intelligence Index v4.3.2에서 Claude Haiku 5.5는 43.40, Gemini 3.8 Flash는 40.93'이라는 부제를 붙인 생성형 히어로 카드입니다. 네 개의 칩에는 각각 '43.40 vs 40.93', '$0.21 vs $1.24', '$0.10 vs $0.75', '2027년 1월 1일 인상'이 표시되어 있습니다. 아래에 있는 두 카드에는 '앤트로픽의 강점'('공유 보드에서 더 높은 점수, 그리고 완료된 작업당 6배 저렴')과 '구글의 강점'('음성 및 영상 입력, 그리고 해당 기간 동안의 고정 요금')이라는 라벨이 붙어 있습니다. 하단에는 'Artificial Analysis의 독립적 측정치이며, 정가는 2026년 10월 8일 기준입니다.'라고 적혀 있습니다. OrcaRouter 로고는 오른쪽 아래 모서리에 합성되어 있습니다.
Guides & Insights

Claude Haiku 5.5 vs Gemini 3.8 Flash: 지수 2포인트, 작업당 6배의 비용

작성자

Alistair Wren

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Claude Haiku 5.5와 Gemini 3.8 Flash는 측정된 성능 면에서 이 가격대의 어떤 다른 조합보다도 서로 더 가깝습니다 — Artificial Analysis Intelligence Index v4.3.2에서 43.40 대 40.93으로, 둘 다 225개 모델 순위표의 상위 50위 안에 들었습니다. 이 둘을 갈라놓는 것은 그 지수 점수 하나에 드는 비용입니다. 동일한 독립 측정에서, 완료된 Intelligence Index 과제 하나의 비용은 Claude Haiku 5.5에서 $0.21, Gemini 3.8 Flash에서 $1.24입니다.

그것은 점수 차이 2.5점에 대해 6배의 격차이며, 이 비교를 결정해야 하는 수치다. 그 밖의 모든 것은 — 공표 요금, 모달리티 목록, Google의 가격 책정에 딸린 마감 기한 — 주변부에 관한 논쟁일 뿐이다.

두 모델 모두, 중요한 수치로

백만 토큰당 미국 달러 기준, Antropic과 Google의 자체 가격 책정 문서에서 발췌했으며, 독립적 측정치는 Artificial Analysis에 의한 것입니다. 2026-10-08에 캐시됨.

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• 입력 — Claude Haiku 5.5는 최대 100,000토큰까지 $0.10, 그 이상은 $0.50; Gemini 3.8 Flash는 $0.75 정액이며, 2027년 1월 1일에는 $1.50로 인상됩니다.

• 출력 — Claude Haiku 5.5: 최대 100,000 토큰까지 $0.50, 초과분 $2.50; Gemini 3.8 Flash: $3.75 정액, 같은 날 $7.50로 인상.

• 캐시된 입력 — Claude Haiku 5.5 $0.01 및 $0.05; Gemini 3.8 Flash $0.075, 그리고 백만 토큰당 시간당 $0.50의 저장 요금.

• 컨텍스트 — 둘 다 1M 토큰. 최대 출력 — Claude Haiku 5.5는 128,000 토큰, Gemini 3.8 Flash는 65,536 토큰.

• 입력 모달리티 — Claude Haiku 5.5의 경우 텍스트와 이미지, Gemini 3.8 Flash의 경우 텍스트, 이미지, 음성, 동영상. 이 줄은 Google의 목록이 확실히 더 긴 유일한 항목이다.

• 독립 점수 — Intelligence Index v4.3.2에서 Claude Haiku 5.5 (Max)는 43.40, Gemini 3.8 Flash (High)는 40.93을 기록했습니다.

• 작업당 독립 비용 — 같은 보드에서 $0.21 대 $1.24.

• 속도 — 초당 출력 토큰 241.9개 대 125.2개, 둘 다 Artificial Analysis 측정.

6배라는 수치가 어디서 나온 것인지

작업당 비용 격차는 표면상 가격 격차보다 크며, 바로 그 점이 흥미로운 부분입니다. 왜냐하면 그것은 요율표만으로는 설명되지 않는다는 뜻이기 때문입니다.

가격표 산수는 아주 간단하다: 입력에서 $0.10 대 $0.75는 7.5배 더 저렴하고, 출력에서 $0.50 대 $3.75도 같은 비율이다. 두 모델이 같은 작업에 대해 동일한 토큰을 생성한다면, 그 비율은 청구서에 그대로 이어질 것이다.

그것은 이어지지 않으며, 두 효과 모두 구글에 유리하게 작용한다. Claude Haiku 5.5는 자사 제공사가 인정할 정도로 장황하다: Artificial Analysis는 Index를 실행하는 동안 4억 4천만 개의 출력 토큰을 기록했는데, 이는 중앙값 1억 개와 대비되며, 이 모델을 매우 장황하다고 평가한다. Gemini 3.8 Flash는 중앙값 8,100만 개 대비 1억 7천만 개를 생성했다 — 역시 장황하다고 표시되었지만, 토큰 수는 3분의 1이다. Anthropic 자체 문서는 두 번째 효과를 덧붙인다: Claude Haiku 5.5는 Claude 4.7 및 이후 버전과 공유되는 더 새로운 토크나이저를 사용하므로, 동일한 텍스트가 자신이 대체하는 모델에서보다 약 30% 더 많은 토큰으로 집계된다.

종합하면, 가격 주장의 솔직한 버전은 이렇다: 입력 단가 우위는 10대 1, 출력 단가 우위는 7.5대 1이지만, 답변마다 더 많은 토큰을 쓰는 모델 때문에 일부 상쇄되어, 전체 작업을 과금하는 측정 기준에서는 6대 1 우위에 도달한다. 여전히 압승이지만, 요금표가 시사하는 것보다는 작은 압승이다.

구글의 가격에는 날짜가 붙어 있다

Google의 가격 페이지에서 가장 유용한 단 한 가지는 대부분의 비교표가 빠뜨리는 한 문장이다.

Gemini 3.8 Flash는 입력 $0.75, 출력 $3.75로 "2026년 12월 31일까지" 책정되어 있으며, "2027년 1월 1일부터"는 $1.50와 $7.50로 책정됩니다. 캐시된 입력은 같은 날짜에 $0.075에서 $0.15로 변경됩니다. 이는 만료일이 바로 옆에 명시된 도입 요금으로, 이 글을 쓰는 시점에서 대략 11주 뒤입니다.

Ant​hropic의 카드 어디에도 그렇게 읽히는 내용은 없다. Claude Ha 5.5의 요금은 요금 그대로 명시되어 있으며, 달력이 아니라 프롬프트 길이를 기준으로 하는 2단계 구조와 2027년 10월 7일 이전에는 은퇴하지 않겠다는 약속이 있다. 내년까지 이어지는 파이프라인을 모델링하고 있다면, Google의 1월 단계는 두 배 인상이며 모델에 포함해야 한다; Ant​hropic의 경우에는 계획에 반영할 동등한 이벤트가 없다.

그것은 양쪽 모두에 해당하며, 공정한 해석은 '한 판매업체는 정직하고 다른 판매업체는 그렇지 않다'가 아니다. 프로모션 요금은 지속되는 동안에는 실제 요금이고, Google은 출시를 그런 방식으로 가격 책정할 권리가 있다. 1월 수치에서 더 저렴해 보이는 쪽이 바로 그것이 붙은 쪽이라는 것은 단지 비교에 관한 사실일 뿐이다.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

지수 2포인트의 가치는 얼마인가요?

60점대까지 이르는 지수에서 2.47점 차이는 반올림 오차도 아니고, 거대한 격차도 아닙니다. 두 모델 모두 같은 실용 구간에 자리 잡고 있으며, 실질적인 질문은 그 차이가 여러분이 실제로 실행하는 작업에서 드러나는지 여부입니다.

벤더 자체 수치로 보면 두 모델은 같은 하네스에서 측정된 것이 아니므로 곧바로 나란히 비교할 수 없다 — Ant​hropic은 Claude Haiku 5.5에 대해 GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0, FrontierCode 결과를 공개하고, Google은 Gemini 3.8 Flash에 대해 자체 결과 세트를 공개하는데, 어느 벤더도 상대방의 스위트를 실행하지 않았다. 이용할 수 있는 유일한 동등 조건 비교는 독립 게시판이며, 그곳에서의 답은 Ant​hropic이 측정은 되지만 작은 차이로 앞서 있다는 것이다.

일부 팀에 더 중요하게 작용할 역량 차이는 모달리티 측면에 있습니다. Gemini 3.8 Flash는 음성과 비디오 입력을 받아들이고, Claude Haiku 5.5는 텍스트와 이미지를 받아들입니다. 통화 녹음이나 화면 캡처를 네이티브로 입력하는 파이프라인은 이 두 모델 중에서 가격을 기준으로 선택하는 것이 전혀 아닙니다 — 둘 중 하나는 앞단에 전사 또는 프레임 추출 단계 없이는 작업을 수행할 수 없고, 그 단계에는 그 나름의 비용과 그 나름의 실패 모드가 있습니다.

쌍의 더 저렴한 쪽을 운영하기

Gemini 3.8 Flash는 OrcaRouter 카탈로그에 Google 정가, 0% 마크업으로 등록되어 있습니다. 여기서는 이 점이 평소보다 더 중요합니다. 제공업체의 요율이 혼합되지 않고 그대로 전달되므로, 1월 인상이 청구서에 실제로 어떤 영향을 미치는지 확인하고 싶다면 Google의 숫자가 움직일 때 이 숫자도 함께 움직입니다. Claude Sonnet 5.5와 Claude Opus 5.5도 카탈로그에 있으므로, 3자 라우팅 테스트 — Google의 Flash 라인, Anth​ropic 중간 티어, 그리고 나중에 Anth​ropic 소형 티어 — 는 프로젝트가 아니라 구성이 됩니다. 키 하나, SDK 하나, 자동 페일오버, 그리고 애플리케이션 코드가 아니라 라우트에서 에스컬레이션을 표현하고 싶다면 라우팅 DSL.

Claude Haiku 5.5 자체는 아직 카탈로그에 없으며, 이를 모호하게 남겨 두기보다는 그렇게 말하는 편이 더 낫습니다. 이 비교의 Ant​hropic 쪽은 현재 Ant​hropic에서만 접근할 수 있는 반면, Google 쪽은 위에 표시된 가격으로 오늘 저희를 통해 호출할 수 있습니다.

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

어느 것이며, 누구를 위한 건가요?

여러분의 작업이 텍스트 입력 및 출력 작업이고, 프롬프트가 100,000 토큰 미만이며, 실제 사용량에 대해 토큰당 비용을 지불한다면, Claude Haiku 5.5는 이 글의 모든 지표에서 더 저렴한 모델이며, 유일한 공통 리더보드에서 더 높은 점수를 받은 모델입니다 — 단, 그 이점은 스티커 가격이 암시하는 10배가 아니라 작업당 비용 기준 6배라는 점을 유의해야 합니다.

오디오나 비디오 입력이 필요하거나, 65K를 넘는 응답이 필요하거나, 프롬프트가 늘 길다면 셈법이 달라진다: Gemini 3.8 Flash는 Ant​hropic의 소형 티어가 받아들일 수 없는 입력을 처리할 수 있고, 100,000 토큰을 넘어서면 Ant​hropic 자체의 두 번째 티어는 Google의 정액 요금을 훨씬 웃도는 가격이 매겨진다.

꼭 붙잡아야 할 것은 날짜다. Google의 요율은 연말까지 그대로 유지되고 그 이후에는 두 배가 된다. Ant​hropic의 요율은 기간 단계가 붙은 정액으로 명시돼 있다. 그중 어느 쪽에 서든, 파이프라인을 만들기 전에 스프레드시트에 일정표부터 넣어라.