
Claude Haiku 5.5 vs GPT-5.6 Luna: 정가의 절반, 완료된 작업당 19% 더 높음
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
모두가 썼던 그 가격 매치는 사실이며, 그것은 이 모델과의 것이 아니다. Claude Haiku 5.5, 벤더가 2026년 10월 7일에 출시한 이 모델은 최대 100,000토큰 프롬프트까지 백만 입력 토큰당 $0.10, 백만 출력 토큰당 $0.50로 책정되어 있다. GPT-5.6 Luna, 2026년 7월 9일자 비용 최적화 티어는 $0.20 및 $1.20로 책정되어 있다. 따라서 벤더는 두 기준 모두에서 이전 모델 요금의 정확히 절반이며 — 그리고 정확히 GPT-6 Luna와 동일하다. 이 모델은 2026년 9월 22일에 이를 대체한 후속 모델이며, 벤더 자체 출시 게시물이 벤치마크 대상으로 삼는 모델이다.
그것은 비교를 작성하기에는 이상한 출발점이므로, 이 맞대결이 무엇을 위한 것인지 정확히 짚을 필요가 있다. GPT-5.6 Luna는 이 둘 중 독립 보드에서 디프리케이트된 유일한 모델이고, 더 이상 OpenAI의 플래그십 요금표에 있는 Luna가 아니며, 오늘날 여전히 많은 통합 코드에서 발견하게 되는 Luna이기도 하다. 그것을 Claude Haiku 5.5와 비교하는 것은 현재 모델 두 개 중 어느 것을 호출할지에 대한 질문이 아니라, 이미 떠안고 있을 수 있는 마이그레이션에 대한 질문이다.
그리고 뻔한 질문에 대한 답이 바로 흥미로운 부분이다. 동일한 독립 평가 실행에서, 완료된 Intelligence Index 작업 하나의 비용은 Claude Haiku 5.5에서는 $0.21, GPT-5.6 Luna에서는 $0.18. 토큰 가격은 절반인데 답변당 비용은 19% 더 높다.
두 개의 요금표
백만 토큰당 미국 달러 기준입니다. Anthropic과 OpenAI의 요금은 각자의 문서에서 가져왔으며, 공통 점수는 Artificial Analysis Intelligence Index v4.3.2(2026-10-08 확인)입니다.

• 입력 — Claude Haiku 5.5는 최대 100,000토큰까지 $0.10, 그 이상은 $0.50; GPT-5.6 Luna는 $0.20이며, 272,000토큰 초과 요청의 경우 $0.40으로 두 배가 됩니다.
• 출력 — Claude Haiku 5.5는 최대 100,000토큰까지 $0.50, 그 이상은 $2.50; GPT-5.6 Luna는 $1.20이며, 롱 컨텍스트 경로에서는 $1.80으로 상승합니다.
• 캐시된 입력 — Claude Haiku 5.5 $0.01 및 $0.05, 90% 할인; GPT-5.6 Luna $0.02, 역시 90%, 여기에 캐시 쓰기 요금 $0.25 추가.
• 컨텍스트 — Claude Haiku 5.5는 1M 토큰, GPT-5.6 Luna는 1,050,000개입니다. 두 모델 모두 단일 응답을 128,000 토큰으로 제한하며, OpenAI는 자사 모델의 지식 컷오프를 2026년 2월 16일로 공개했습니다.
• 추론 제어 — Claude Haiku 5.5는 Low부터 Max까지 조절 가능한 에포트 다이얼을 제공하며 기본값은 medium입니다. GPT-5.6 Luna는 none / low / medium(기본값) / high / xhigh / max의 여섯 가지 설정을 제공합니다.
• 독립 점수 — Claude Haiku 5.5 (Max)의 43.40 대 GPT-5.6 Luna (Max)의 37.32, 182개 모델 보드에서 6.07점 격차.
• 상태 — Claude Haiku 5.5는 현재 최신 버전으로, 독점 모델이며 API 전용입니다. GPT-5.6 Luna는 독립 게시판에서 지원 중단 플래그가 지정되어 있으며, 더 이상 OpenAI의 플래그십 가격표에서 한 줄을 차지하지 못합니다.

가격은 절반, 답변당 비용은 더 비쌈
여기 요율표 계산은 Anthropic에 유난히 유리합니다 — 짧은 프롬프트 구간에서 두 미터 모두 깔끔하게 2배 — 따라서 설명이 필요한 쪽은 태스크당 결과입니다.
Claude Haiku 5.5는 Intelligence Index 작업당 162,164개의 출력 토큰을 생성하며, 129,047개는 추론, 33,118개는 답변으로 나뉩니다. GPT-5.6 Luna는 41,235개를 생성하며, 28,098개는 추론, 13,136개는 답변으로 나뉩니다. Anthropic의 모델은 3.9배 많은 토큰을 같은 작업에 사용하며, 출력 속도가 절반이어서 완료된 작업당 19% 더 비쌉니다. 속도 이점과 장황함의 단점은 서로 두 배 이내 차이여서 거의 상쇄되며, 그 잔여분은 OpenAI 쪽으로 돌아갑니다.
작업당 두 비용은 비슷하지만, 각각이 구성되는 방식은 그렇지 않다. GPT-5.6 Luna의 작업당 $0.1783은 대략 절반이 캐시 쓰기이고 4분의 1이 출력이다. Claude Haiku 5.5의 $0.2128은 $0.1317의 입력 — 대부분 캐시된 읽기 — 에 $0.0811의 출력을 더한 것이다. 두 모델 모두 절대적인 기준으로 비싸지 않으며, 서로 다른 부분에서 비싸다. 바로 이 점 때문에 작업당 총액은 수렴하는 한편 요금표는 두 배 차이로 벌어져 있다.
이는 추론 모델을 토큰당 비교하는 것을 일반적으로 신뢰할 수 없게 만드는 바로 그 효과이며, 이를 분명히 짚고 넘어갈 가치가 있다: 값싼 계량기는 막대한 토큰 예산과 곱해지고, 당신이 지불하는 것은 그 곱이다. Anthropic 자체의 출시 노트도 이 점을 솔직하게 밝히고 있는데, Claude Haiku 5.5는 "최대 100,000토큰의 프롬프트가 있는 작업에 사용할 때 특히 가성비가 좋으며, 이는 우리의 이전 Haiku 모델에 대한 요청의 약 90%를 차지한다"고 말한다.
블렌드 계산은 같은 이야기를 반대 방향에서 들려준다. Artificial Analysis의 7:2:1 입력 중심 블렌드, 즉 대부분의 프로덕션 트래픽이 실제로 지닌 형태에서는 Claude Haiku 5.5가 백만 토큰당 $0.077로, GPT-5.6 Luna의 $0.174에 맞선다. 이는 스티커 가격에서 예상할 수 있는 2.26배다. 추론 워크로드가 하는 방식으로 출력 미터에 가중치를 둘 때에야 두 값이 수렴하며, 100,000토큰을 넘으면 서로 교차한다.
272,000 토큰짜리와 맞서는 100,000 토큰의 절벽
두 공급업체 모두 긴 요청의 가격을 다시 책정하는데, 임계값은 2.5배 넘게 차이가 납니다.
Anthropic의 기준점은 입력 토큰 100,000개입니다. 그 이상에서는 Claude Haiku 5.5의 요금이 입력 $0.50, 출력 $2.50가 됩니다 — 짧은 프롬프트 요율의 5배이며, 요청 전체에 적용됩니다. OpenAI의 기준점은 입력 토큰 272,000개입니다. 그 이상에서는 GPT-5.6 Luna의 요금이 입력 $0.40, 출력 $1.80가 됩니다 — 입력 2배, 출력 1.5배이며, 이 역시 요청 전체에 적용됩니다.
따라서 교차점은 느린 수렴이 아니라 한 단계의 도약이다. 120,000토큰 검색 프롬프트는 Anthropic의 롱 티어 요금이 적용되고 OpenAI의 숏 티어 안에 넉넉히 들어가는데, 이는 입력에서 Anthropic의 2배 우위를 OpenAI의 1.25배 우위로, 출력에서는 1.39배 우위로 뒤집는다. 그리고 Anthropic의 임계값은 문서가 많은 파이프라인이 일상적으로 넘어설 만큼 낮은 반면, OpenAI의 임계값은 그런 대부분의 파이프라인이 결코 마주하지 못할 만큼 높다.
100,000 토큰 미만에서는 이와 관련해 순서가 바뀌는 일이 없다. 272,000을 초과하면 순서가 뒤집히고 뒤집힌 상태로 유지된다.
비교하고 계신 모델을 대체한 것은 무엇인가요?
이것이 비교에 시간을 얼마나 쓸지 애초에 결정하는 부분입니다.
OpenAI는 2026년 9월 22일 GPT-6 Luna를 출시했습니다 — Anthropic이 Claude Haiku 5.5를 출시하기 15일 전이었습니다 — 입력 $0.10, 출력 $0.50에 1M 토큰 컨텍스트, 128,000 토큰 응답 상한, 그리고 동일한 6단계 추론 노력 제어를 갖췄습니다. 이는 짧은 프롬프트 영역에서 두 측정 기준 모두 Claude Haiku 5.5와 동일한 요금표입니다.
독립 보드에서 두 모델은 충분히 근접해 있어 종합 순위로는 결판이 나지 않는다: Claude Haiku 5.5는 43.40점으로 GPT-6 Luna의 38.12점을 앞선다 — 여전히 Anthropic이 5.28점 앞선다 — 그러나 완료된 작업당 비용은 $0.21 대 $0.068이다. 이는 세 배에 달하는 OpenAI 우위이며, 실제로 청구되는 수치에서 그러하다. 그리고 이는 위에서와 같은 장황함 때문이다: GPT-6 Luna는 Index 작업당 50,012개의 출력 토큰을 내보내는 반면, Claude Haiku 5.5는 162,164개를 내보낸다.
Anthropic의 출시 게시물은 그 비교를 스스로 수행하는데, Haiku 5.5를 "GPT-6 Luna"와 맞붙게 하는 표에서 GDPval-AA v2.1(1620 대 1437), AA-Briefcase v1.1(1578 대 1336), OSWorld 2.1 오프라인 서브셋(72.4% 대 48.9%), Terminal-Bench 4.0(39.2% 대 16.4%)을 보여준다. 이는 Anthropic 자체 수치이며 벤더가 보고한 것이지만, 상대 선택이 바로 단서다. Anthropic이 이기기 위해 고른 모델은 이 기사 제목에 나오는 모델 그다음 모델이다.
구형 Luna가 여전히 우위를 점하는 부분
세 가지입니다. 그리고 그중 어느 것도 역량이 아닙니다.
비디오와 오디오. 두 모델 모두 비디오 네이티브가 아닙니다 — Claude Haiku 5.5는 텍스트와 이미지를 읽고, GPT-5.6 Luna는 텍스트와 이미지를 읽습니다 — 따라서 이 항목은 무승부이며, 둘 다 미디어 파이프라인을 갖춘 무엇에도 뒤처집니다.
캐시 쓰기. OpenAI는 GPT-5.6 Luna에 대해 백만 개당 $0.25의 캐시 쓰기 요율을 공개하고, Anthropic은 Claude Haiku 5.5에 대해서는 아무 요율도 공개하지 않는다. 이는 쓰기 비용이 없는 것이 아니라 Anthropic의 $0.10 입력 요금 체계 안에 포함되어 있다는 것이 정직한 설명이라는 뜻이다. 수명이 짧은 캐시를 쓰는 프리픽스 비중이 높은 워크로드는 매 턴마다 그 차액을 지불한다.
그리고 롱컨텍스트 경로 자체는, OpenAI의 더 높은 임계값이 어느 모델이 더 똑똑한지와는 전혀 무관한 진정한 구조적 이점인 부분이다.

둘 다 호출 가능하지만, 그중 하나는 우리 것이 아닙니다.
GPT-5.6 Luna가 오늘 OrcaRouter 카탈로그에 올라왔습니다 openai/gpt-5.6-luna에서 — 입력 $0.20, 출력 $1.20, 캐시 쓰기 $0.25, 1,050,000토큰 컨텍스트와 128,000토큰 응답 상한, 그리고 272,000토큰 장문 컨텍스트 티어는 요금 기록에서 평균에 섞여 사라지지 않고 별도 단계로 반영됩니다. OpenAI의 정가에 0% 마크업으로 그대로 전달되며, 자동 페일오버가 그 아래에 있으며, 이는 의도적으로 대체된 모델에 특정한 가치가 있습니다: OpenAI 자체의 이 모델 수용력이 빠듯해지면, 라우트는 여러분의 오류 예산이 소진되기 전에 이동합니다.
Claude Haiku 5.5는 카탈로그에 없습니다. Anthropic의 API와 AWS, Google Cloud, Microsoft Azure를 통해 접근할 수 있으며, 이렇게 말하는 것이 정확합니다. 카탈로그가 Anthropic으로부터 실제로 제공하는 것은 Claude Sonnet 5.5와 Claude Opus 5.5이므로, 저렴한 분류 티어에서 중간급 에이전트 티어로 올라가는 경로는 통합 작업이 아니라 라우팅 설정입니다 — 그리고 같은 카탈로그에 Claude Haiku 5.5가 쓰는 것과 정확히 같은 요금표의 GPT-6 Luna가 있으므로, 이 가격대에서 정직한 A/B는 조달 절차가 아니라 두 개의 문자열을 바꾸는 일입니다.
이 비교를 어떻게 해야 할까요?
당신의 통합이 gpt-5.6-luna를 이름으로 지정한다면, 유용한 결론은 Claude Haiku 5.5가 지수 6포인트 차이로 그것을 앞선다는 것이 아닙니다. 그것은 당신이 공급업체가 자체 플래시 등급에서 이미 두 번이나 대체한 모델을 사용하고 있다는 점입니다 — 먼저 Terra의 세대에 의해, 그다음에는 Anthropic 스스로가 이 가격대의 현재 경쟁자로 취급하는 GPT-6 Luna에 의해. GPT-6 Luna로 마이그레이션하는 것은 동일한 독립 측정에서 요금표상 동등하며 완료된 작업당 비용이 3분의 1로 줄어드는 일입니다.
역량을 기준으로 Claude Haiku 5.5와 Luna 라인 중에서 고른다면, Anthropic이 종합 점수와 터미널 및 코드 항목, 컴퓨터 사용에서 앞서며, Anthropic 자체 벤더 표에서도 그렇게 밝히고 있습니다. 청구서를 기준으로 고른다면, Luna 라인은 이 비교의 모든 버전에서 큰 차이로 이겨 왔으며, 그 이유는 단 하나의 숫자에 있습니다: 작업당 출력 토큰 162,164개 대 41,235개.
이 맞대결이 실제로 판가름하는 것은, 두 배 더 저렴한 요금 기준이 네 배 더 효율적인 모델보다 가치가 낮다는 점이다. Anthropic은 Claude Haiku 5.5의 가격을 GPT-6 Luna에 맞추어 책정했고, 실제로 그렇게 했다 — 두 요금 기준 모두에서 정확히 — 그런데도 그것에서 답을 얻으려면 여전히 세 배 더 든다.
