
Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic이 가격 하한선을 방금 깼다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
2년 동안 시장의 저가 부문은 모두가 아는 구도를 갖고 있었다: 미국 연구소들은 더 비싸게, 중국 연구소들은 더 싸게 가격을 책정했고, 사람들은 그에 따라 편을 골랐다.Claude Haiku 5.5는 2026년 10월 7일, 백만 입력 토큰당 $0.10, 백만 출력 토큰당 $0.50에 출시하면서 그 구도를 깨뜨렸다 — DeepSeek V4 Flash, 여름부터 저가의 기준점이 되어 온 모델
들리는 것보다 범위가 좁은 승리이며, 그 이유는 헤드라인보다 더 가치가 있다. Anthropic 요금은 최대 100,000토큰의 프롬프트에만 적용된다. 그 이상에서는 $0.50와 $2.50가 되는데, 이는 DeepSeek 가격의 몇 배다. 그리고 DeepSeek 자체 요금표는 아무도 따라 하지 않는 구조를 띠는데, 평일 두 시간대에는 두 배가 된다. 두 공급업체, "저렴함"이 무엇을 뜻하는지에 대한 완전히 다른 두 가지 관점.
각 공급업체가 실제로 게시하는 내용
백만 토큰당, 미국 달러 기준입니다. Anthropic 수치는 Anthropic의 가격 문서에서 가져왔고, DeepSeek 수치는 DeepSeek 자체의 Models & Pricing 페이지에서 가져온 것으로, 이 페이지가 해당 모델의 공식 기준표입니다.

• 입력 — Claude Haiku 5.5 $0.10 최대 100,000 토큰, 초과 시 $0.50. DeepSeek V4 Flash 오프피크 $0.15, 피크 시간대 $0.30.
• 출력 — Claude Haiku 5.5는 최대 100,000 토큰까지 $0.50, 그 이상은 $2.50. DeepSeek V4 Flash는 오프피크 시 $0.60, 피크 시 $1.20.
• 캐시된 입력 — Claude Haiku 5.5는 최대 100,000토큰까지 $0.01, 그 이상은 $0.05입니다. DeepSeek V4 Flash는 비수기 $0.003, 피크 시간 $0.006으로, 3배 이상 저렴합니다.
• 피크 시간대 — Anthropic에는 없습니다; 요금은 프롬프트 길이에 따라서만 변합니다. DeepSeek은 월요일부터 금요일까지, 중국 공휴일을 제외하고 UTC 기준 01:00~04:00과 06:00~10:00에 요금을 두 배로 올립니다.
• 컨텍스트 및 출력 — Claude Haiku 5.5의 경우 1M 토큰과 최대 출력 128,000, DeepSeek V4 Flash의 경우 1M 토큰과 최대 출력 384,000.
• 모달리티 — Claude Haiku 5.5는 텍스트와 이미지를 받습니다; DeepSeek V4 Flash는 텍스트 전용이며, 비전은 이 모델이 아니라 형제 모델에 있습니다.
• 독립 점수 — Artificial Analysis Intelligence Index v4.3.2에서 Claude Haiku 5.5 (Max)는 43.40으로 182개 모델 중 2위, DeepSeek V4 Flash 0731 (Max)는 34.33으로 117개 모델 중 10위를 기록했습니다.
• 속도 — 동일한 출처에서 Claude Haiku 5.5의 경우 초당 출력 토큰 241.9개, DeepSeek V4 Flash의 경우 222.0개를 측정했으며, 자체 리더보드에서 두 번째로 빠릅니다.
크로스오버가 전부다
두 카드를 단일 요청에 나란히 놓으면 비교가 두 번 뒤집힌다.
100,000 토큰 미만에서 Anthropic은 두 요금 산정 기준 모두에서, 그리고 중요한 가격표에서도 더 저렴하다: 입력 $0.10 대 $0.15, 출력 $0.50 대 $0.60. 같은 조건으로 비교했을 때 Anthropic 소형 모델이 DeepSeek Flash 요금을 밑돈 것은 이번이 처음이며, 이는 출시 게시물이 가장 앞세우는 사실이다.
100,000토큰이 넘으면 상황이 크게 역전된다. Anthropic의 입력 $0.50은 DeepSeek의 오프피크 요금의 세 배가 넘고, 출력 $2.50은 그보다 네 배가 넘는다. 150,000토큰 프롬프트를 일상적으로 구성하는 검색 또는 장문 문서 파이프라인은 Claude Haiku 5.5의 고객이 전혀 아니다. 그것은 이미 사용하고 있던 모델의 고객이다.
그리고 DeepSeek의 두 평일 시간대에서는 두 번째 비교가 반대 방향에서 좁혀집니다. DeepSeek 자체 요금은 두 배가 되는데 Anthropic의 요금은 움직이지 않기 때문입니다. 추상적으로 보면 어느 벤더의 구조도 더 낫지 않습니다. 하나는 보내는 양으로 가격을 매기고, 다른 하나는 보내는 시점으로 가격을 매기는데, 요청 시점에 통제할 수 있는 것은 그중 하나뿐입니다.
완료된 작업에 드는 비용, 즉 유일하게 공정한 숫자
공시 요금은 토큰당이며, 두 모델은 같은 작업에 대해 동일한 수의 토큰을 생성하지 않습니다. 바로 이 지점에서 Anthropic의 출시 산수는 곤란해집니다.
Artificial Analysis는 Claude Haiku 5.5 (Max)를 Intelligence Index 작업당 $0.21, DeepSeek V4 Flash 0731 (Max)를 작업당 $0.22로 책정한다. 입력 단가의 10분의 1, 더 넓은 윈도, 그리고 26포인트의 Intelligence Index 격차 — 43.40 대 34.33 — 그런데도 작업 하나를 완료하는 데 드는 측정 비용은, 밑돌아야 했던 모델과 1센트 이내 차이에 머문다.
그 이유는 같은 페이지에 있다. Index를 평가할 때 Claude Haiku 5.5는 1억 중앙값 대비 4억 4천만 개의 출력 토큰을 생성했고, 평가자는 이를 매우 장황하다고 평가한다. DeepSeek V4 Flash는 1억 4천만 중앙값 대비 2억 4천만 개를 생성했고 역시 매우 장황하다는 평가를 받는다. 두 모델 모두 길게 생각하고, 둘 다 사고를 출력으로 청구하며, 출력이 청구 금액을 결정하는 계량기다. 90퍼센트 입력 절감은 실재하며, 청구서의 더 작은 절반에 부과된다.
두 번째의, 더 미묘한 효과가 있다. Anthropic 자체 문서에 따르면 Claude Haiku 5.5는 Claude 4.7 및 이후 버전과 공유되는 더 새로운 토크나이저를 사용하므로, 동일한 텍스트가 Claude Haiku 4.5에서보다 약 30% 더 많은 토큰으로 집계된다. 요율은 10분의 1로 떨어졌다; 토큰 수는 전혀 줄지 않았고, 같은 텍스트에서는 오히려 늘었다.

DeepSeek라는 이름 뒤에 있는 모델도 바뀌었다
몇 달도 전에 나온 벤치마크 표를 근거로 이 둘을 비교하려는 사람이라면, 그러기 전에 이 점을 알아야 한다.
DeepSeek의 가격 페이지에는 이제 deepseek-flash가 모델 이름으로 등록되어 있으며, DeepSeek-V4.1-Flash를 기반으로 하고, 기존 deepseek-v4-flash id는 여전히 허용되지만 "해당 모델들은 단종되었습니다"라고 명시되어 있습니다 — 예전 이름으로 들어온 요청은 더 새로운 모델이 처리하며 Flash 가격으로 청구됩니다. 다시 말해, 그 id는 이름과 가격, 라인업에서의 자리를 그대로 유지한 채 그 아래의 가중치만 바뀐 것입니다.
그것은 비판이 아닙니다. 그것은 벤치마크 표가 무엇을 기준으로 날짜가 매겨지는지에 대한 경고입니다. 이 글에서 인용하는 Artificial Analysis 항목은 Max 구성의 DeepSeek V4 Flash 0731 릴리스에 대한 것으로, 이는 해당 보드가 측정한 모델이며, 오늘 그 ID에 해당하는 무엇이든에 대한 진술이라고 자동으로 간주되는 것은 아닙니다. 반면 Anthropic의 Claude Haiku 5.5는 날짜 접미사도 별칭도 없는 고정 ID이고, 그 Index 배치는 자체 출시 주간을 기준으로 날짜가 매겨집니다.
두 개의 모델, 하나의 엔드포인트
이 비교를 스펙 시트에서보다 스스로 판단해 결론 내리기가 쉬운 이유는, 양쪽 모두 같은 곳에서 호출할 수 있기 때문입니다 — 단, 한 가지 언급할 만한 예외가 있습니다.
DeepSeek V4 Flash는 오늘 OrcaRouter 카탈로그에 올라와 있으며, 그리고 그 아래에 자동 페일오버가 깔려 있습니다. 그래서 이 비교에서 DeepSeek 쪽은 읽어서 아는 것이 아니라 오늘 아침 우리가 직접 호출할 수 있습니다. 당신이 직접 발견하도록 남겨두기보다 여기서 짚어둘 만한 주의점 하나: 이 모델에 대해 우리가 제시한 요금은 백만 토큰당 입력 $0.22, 출력 $0.66으로, DeepSeek의 오프피크 요금표보다는 높고 피크 요금표보다는 낮습니다. 피크·오프피크 구조에 관한 권위는 우리가 아니라 DeepSeek 페이지로 삼고, 우리 요금은 과금 실행을 시작할 때 기준으로 삼을 하나의 혼합 숫자로 보세요. Claude Sonnet 5.5와 Claude Opus 5.5도 카탈로그에 있습니다. 따라서 DeepSeek Flash 쪽과 Claude 쪽 사이의 A/B는 키 하나와 SDK 하나로 끝나며, 에스컬레이션 로직이 애플리케이션이 아니라 라우트에 속한다면 라우팅 DSL이 이들을 단일 호출로 구성해 줍니다.
Claude Haiku 5.5는 아직 카탈로그에 없습니다. 이것은 얼버무리는 말이 아닙니다 — 이 비교에서 Anthropic 쪽은 현재 Anthropic에 직접 접근해야 하지만, DeepSeek 쪽은 그럴 필요가 없습니다. 오늘 나머지 스택과 동일한 키로 DeepSeek 라인의 저렴한 티어를 원하신다면, 그 부분은 이미 라이브입니다.

어느 걸 고를까?
호출이 짧고 — 분류, 추출, 라우팅, 요약, 서브에이전트 턴 — 100,000 토큰 아래에 들어간다면, Claude Haiku 5.5는 이제 두 요금 기준 모두에서 더 저렴한 모델이고 독립 리더보드에서는 더 강력한 모델이며, 판단은 명확합니다. 또한 둘 중 이미지를 입력받는 유일한 모델이기도 합니다.
호출이 길거나, 큰 공유 프리픽스를 다시 보내거나, 일정을 조정할 수 있다면, 계산은 반대 방향을 가리키며 그 격차도 큽니다: DeepSeek의 비피크 시간대 캐시 입력은 $0.003으로 Anthropic의 $0.01보다 한 자릿수 낮고, 출력 상한은 세 배 더 높으며, 비피크 할인은 제품 한계라기보다 일정 조정 문제입니다.
그 출시가 실제로 확정한 것은 "Anthropic이 이제 저렴하다"보다 더 좁은 범위다. 그것은 미국 연구소들이 짧은 프롬프트의 경우 중국 연구소들보다 낮은 가격을 책정하리라는 점, 그리고 짧은 프롬프트의 경우가 대부분의 프로덕션 트래픽이 머무는 곳이라는 점을 확정했다. 100,000 토큰을 넘어가는 모든 것은 여전히 다른 모델의 시장이다.
