GPT-5.6 API 가격: Sol, Terra, Luna 등급, 실제 비용 및 각각 호출하는 방법
Guides & Insights

GPT-5.6 API 가격: Sol, Terra, Luna 등급, 실제 비용 및 각각 호출하는 방법

작성자

Fengya Tian

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

GPT-5.6OpenAI의 2026년 7월 플래그십 제품군이며, 개발자에게 중요한 점은 가격이 하나가 아니라는 것입니다. 세 가지 등급(Sol, Terra, Luna)으로 제공됩니다. OpenAI API에서 Sol은 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 30달러이며, Terra는 2.50달러와 15달러, Luna는 1달러와 6달러입니다. 각 등급에는 캐시된 입력 할인이 있으며, 세 등급 모두 이미지 입력과 텍스트를 허용하며, 컨텍스트 창은 약 105만 토큰, 최대 128K 출력이 가능합니다.

정가(numeric span markers not present)는 실제 비용의 시작에 불과합니다. 실제로 필요한 등급, 캐싱하는 양, 모델이 생성하는 출력량, 그리고 대부분의 가이드가 생략하는 몇 가지 가격 규칙—272K 토큰 이상의 프롬프트, 데이터 상주 지역 할증료, 서비스 등급—은 표면 요금보다 훨씬 더 청구액을 좌우합니다. 이 가이드는 각 등급의 가격, 용도, 점수 산정 방식, GPT-5.5에서 마이그레이션하는 방법, 호출 방법, 그리고 Claude, GLM, Gemini, DeepSeek, Grok과의 비교를 분석합니다.

간략한 답변: GPT-5.6 가격 한눈에 보기

- 세 가지 티어 (백만 토큰당, 입력/출력): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.

- 캐시된 입력: 백만 토큰 당 $0.50(Sol), $0.25(Terra), $0.10(Luna); 캐시 쓰기는 캐시되지 않은 입력 요금의 1.25배입니다.

- 포지셔닝: 가장 어려운 추론 및 에이전트 작업에는 Sol, 균형 잡힌 기본값으로는 Terra, 대량 처리 및 비용에 민감한 작업에는 Luna.

- 모달리티: 멀티모달—GPT-5.6은 텍스트와 함께 이미지 입력을 받습니다. 컨텍스트 약 105만 토큰, 최대 출력 128K.

- 고려해야 할 두 가지 가격 책정 규칙: 272K 입력 토큰을 초과하는 프롬프트는 전체 요청에 대해 입력의 2배, 출력의 1.5배로 청구되며, 데이터 상주 엔드포인트는 10% 할증이 적용됩니다.

- 비용을 절약하는 방법: 배치는 표준의 50% 할인, 캐싱은 반복 입력을 10분의 1로 줄이며, 일상적인 작업을 하위 계층으로 라우팅하면 Sol의 $30 출력을 피할 수 있습니다.

- 지능: Artificial Analysis는 GPT-5.6 Sol을 Intelligence Index의 상위 근처에 배치합니다 (점수 59).

GPT-5.6 API 가격, 티어별

OpenAI가 GPT-5.6을 백만 토큰당 가격을 책정했으며, 출력이 모든 등급에서 입력보다 훨씬 비쌉니다. 현재 공시된 요금은 다음과 같습니다:

- GPT-5.6 Sol: $5.00 입력, $0.50 캐시된 입력, $30.00 출력 (캐시 쓰기 $6.25).

- GPT-5.6 Terra: 입력 $2.50, 캐시된 입력 $0.25, 출력 $15.00.

GPT-5.6 Luna: $1.00 입력, $0.10 캐시된 입력, $6.00 출력.

예산을 계획하기 전에 두 가지 세부 사항을 고려해야 합니다. 첫째, 출력 속도는 대부분의 실제 청구서, 특히 모델이 최종 답변 전에 긴 추적, 도구 호출 및 수정을 생성하는 추론 및 에이전트 작업에서 지배적입니다. 둘째, 가격 페이지에 별도의 "Sol Ultra" 가격 라인이 없습니다. "Sol Ultra"는 Sol(다중 에이전트 설정)의 더 높은 추론 구성으로, 독립적인 등급이 아닙니다. Sol, Terra 및 Luna를 기준으로 예산을 계획하십시오.

각 티어가 실제로 무엇을 위한 것인지

Luna: 대량 및 비용 민감

Luna는 경제 등급으로, 입력 1달러, 출력 6달러입니다. 분류, 추출, 라우팅, 요약, 초안 작성 및 소량의 품질 차이가 결과를 바꾸지 않는 대량의 일상 작업에 적합한 기본값입니다. 백만 출력 토큰당 6달러로, 대규모로 실행하고 반복적으로 샘플링하기에 충분히 저렴합니다.

Terra: 균형 잡힌 기본값

Terra는 $2.50와 $15 사이에 위치합니다. 대부분의 애플리케이션 및 코딩 작업에서 이는 합리적인 출발점입니다: 어려운 작업에서 Luna보다 눈에 띄게 강력하지만, Sol의 출력 가격의 절반입니다. 여기에서 시작한 다음, Terra가 명백히 실패할 때만 작업을 Sol로 옮기십시오.

Sol: 가장 어려운 추론 및 에이전트 작업

Sol은 $5 및 $30 버전의 플래그십 모델로, Artificial Analysis는 이를 인텔리전스 지수 상위권에 위치시킵니다. 복잡한 아키텍처, 까다로운 디버깅, 장기적 에이전트, 그리고 실패를 한 번만 피해도 프리미엄 가치가 있는 고위험 분석을 위해 아껴두세요. 일상적인 작업에 Sol을 사용하는 것은 GPT-5.6에 과도하게 지출하는 가장 흔한 방법입니다.

GPT-5.5에서 오셨나요? 어떤 티어가 가장 많이 절약하나요?

GPT-5.6 Sol의 가격은 GPT-5.5와 동일하게 입력 $5, 출력 $30으로 책정되어 있어, GPT-5.5 워크로드를 Sol로 바로 옮기면 청구 금액에 큰 변화가 없습니다. 비용 절감은 두 가지 새로운 하위 티어에서 발생합니다. Terra는 대부분의 작업에서 GPT-5.5급 품질을 절반 가격에 제공하므로, 가장 간단한 마이그레이션 방법은 기존 GPT-5.5 트래픽을 Terra로 보내고, 성능이 떨어지는 작업만 다시 Sol로 승격하는 것입니다.

실용적인 마이그레이션 계획은 세 단계로 이루어집니다: GPT-5.5 호출을 Terra로 재지정하고, 평가 세트를 실행하며, 명백히 일상적인 작업은 Luna로 내려 보내면서 실패한 경우만 Sol로 에스컬레이션합니다. 대부분의 GPT-5.5 워크로드는 이 방식으로 측정 가능한 품질 손실 없이 더 저렴하게 처리됩니다.

티어의 실제 점수 산정 방식

가격은 성능과 비교해서만 의미가 있습니다. OpenAI 자체 Terminal-Bench 2.1 수치에 따르면, 계층은 예상대로 구분됩니다: Sol 88.8%, Sol Ultra 91.9%, Terra 87.4%, 및 Luna 84.7%. 같은 표에서 맥락을 보면, GPT-5.5는 85.6%, Claude Opus 4.8는 78.9%, Claude Fable 5는 83.1%이며, Gemini 3.1 Pro (프리뷰)는 70.7%입니다. Artificial Analysis는 별도로 Sol의 Intelligence Index가 59로, 랭킹 상위권에 근접한 것으로 보고합니다.

이것들은 공급업체 보고서 및 방향성 지표로 읽으십시오. OpenAI는 GPT-5.6에 대한 제한된 평가 세트를 발표했으며, 현재 글을 쓰는 시점에서 SWE-bench Verified 또는 GPQA와 같은 전통적인 코딩 및 추론 벤치마크는 발표하지 않았습니다. 따라서 이 점수를 최종 판결이 아닌 자신의 워크로드에서 테스트할 항목을 결정하는 데 사용하십시오.

각 티어의 캐시된 입력 읽기 속도는 새 입력 속도의 10분의 1입니다: Sol에서는 $0.50, Terra에서는 $0.25, Luna에서는 $0.10입니다. 그러나 캐시에 쓰는 비용은 캐시되지 않은 입력 속도의 1.25배입니다(Sol에서는 백만 개당 약 $6.25). 따라서 캐싱은 안정적인 접두사가 쓰기 프리미엄을 회수할 만큼 충분히 재사용될 때만 이점이 있습니다. 예를 들어 시스템 지시사항, 대용량 문서, 저장소 규칙, 제품 분류체계 등입니다. 안정적인 내용은 프롬프트 앞쪽에, 변경되는 질문은 끝에 배치하고, 재사용 가능한 컨텍스트 앞에 타임스탬프나 임의 식별자를 삽입하지 마십시오.

캐싱은 반복되는 입력 비용을 줄이지만, 출력에는 아무 영향을 미치지 않습니다. 모든 계층에서 출력이 비싼 측면이기 때문에, GPT-5.6 청구서를 가장 크게 움직이는 두 가지 지렛대는 안정적인 프리픽스를 캐싱하는 것과 모델이 작성하는 양을 제어하는 것입니다.

어떤 티어를 선택해야 할까요?

평판으로 티어를 선택하지 마십시오. 테스트로 선택하십시오. 명확한 승인 기준을 가진 대표 작업 몇 개를 구성한 뒤, 먼저 Luna에서 실행하고 실패한 작업만 Terra로, 그다음 Sol로 승격시키십시오. 평균 토큰 가격이 아닌 승인된 작업당 비용을 측정하십시오. 세 번 시도해야 하는 더 저렴한 티어가 한 번에 성공하는 더 강력한 티어보다 더 많은 비용이 들 수 있기 때문입니다.

하나의 운영 습관이 실제 비용을 절약합니다: 각 호출에 기본 별칭을 사용하는 대신 정확한 티어 모델 ID를 고정시키면, 일상적인 요청이 조용히 가장 비싼 티어에서 실행되지 않습니다. 혼합 워크로드는 일반적으로 일상적인 변환 및 초안 작성에는 Luna, 일상적인 구현 및 분석에는 Terra, 어려운 소수 작업에는 Sol이 사용됩니다—대부분의 요청은 플래그십이 전혀 필요하지 않습니다.

GPT-5.6 대 경쟁사 가격 비교

GPT-5.6은 단독으로 존재하지 않습니다. 현재 시장(백만 토큰 기준, 입력/출력, 2026년 중반)과 비교해 보면: Claude Opus 4.8은 $5 / $25, Claude Fable 5(Anthropic의 가장 강력한 공개 모델)는 $10 / $50, GLM 5.2는 Z.AI에서 $1.40 / $4.40입니다(타사 호스트는 더 낮을 수 있음), Grok 4.5는 $2 / $6, Google의 Gemini 3.5 Flash는 약 $1.50 / $9이고, DeepSeek V4-Pro는 약 $0.44 / $0.87입니다. 각 항목을 공급업체의 자체 페이지에서 확인하세요. 가격은 변동됩니다.

핵심 내용은 구체적입니다. GPT-5.6 Sol은 입력에서 Opus 4.8과 일치하지만 출력에서 더 비쌉니다($30 대 $25). 따라서 출력이 많은 에이전트 작업에서 Opus는 토큰당 약간 저렴하고 Sol은 Intelligence Index에서 선두를 차지합니다. Terra는 두 플래그십 모델보다 저렴하며 OpenAI 제품군 내에서 가성비 좋은 선택입니다. Luna는 가격 면에서 더 저렴한 모델과 경쟁하지만, Grok 4.5, GLM 5.2, 특히 DeepSeek이 더 낮은 가격대에 있습니다. 단일 계층이나 공급업체가 모든 것을 지배하지는 않습니다. 이것이 바로 난이도별 라우팅이 하나에 고정하는 것을 이기는 이유입니다.

처리된 월 청구서

숫자를 붙이세요. 5천만 개의 입력 토큰과 1천만 개의 출력 토큰으로 이루어진 중간 정도의 많은 양의 달에, 캐싱 및 도구 사용 전 정가 기준으로 모델 요금은 대략 다음과 같습니다:

- GPT-5.6 Luna: 약 $110.

- GPT-5.6 Terra: 약 $275.

- GPT-5.6 Sol: 약 $550.

- 비교를 위해: GLM 5.2 약 $114, Grok 4.5 약 $160, Claude Opus 4.8 약 $500, Claude Fable 5 약 $1,000.

동일한 작업들이 지능적으로 라우팅될 때—대량 작업은 Luna와 Terra가, 어려운 소수 작업은 Sol이 처리—평균 비용은 모든 작업에 Sol을 사용했을 때의 고정 $550보다는 $110–$275 범위에 훨씬 가깝게 됩니다. 이 차이가 일 년 동안 곱해지면, 계층 기반 라우팅의 전체적인 근거가 됩니다.

계획해야 할 숨은 비용들

여러 가격 책정 규칙이 헤드라인 요율에 나타나지 않으며 나중에 팀을 놀라게 합니다:

- 긴 프롬프트: 입력 토큰이 272K를 초과하는 요청은 전체 요청에 대해 입력 2배, 출력 1.5배로 청구되므로, 대규모 컨텍스트 및 대규모 RAG 호출은 비용이 두 배 이상 증가할 수 있습니다.

- 출력량: 출력은 입력 속도의 최대 6배이므로, 상한이 없거나 높은 추론 출력이 가장 큰 초과 지출 위험입니다.

- 서비스 등급: Priority 처리는 표준 요금의 약 두 배입니다(Sol 기준 약 $10 입력 / $60 출력); Flex 및 Batch는 더 저렴합니다. service_tier 설정을 통해 등급을 신중하게 선택하십시오.

- 데이터 상주: 지역별 처리 엔드포인트는 2026년 3월 5일 이후 출시된 모델에 대해 10% 인상이 추가되며, 여기에는 GPT-5.6이 포함됩니다.

- 에이전트 루프 및 재시도: 지침, 도구, 기록이 매 턴마다 다시 전송되며, 실패한 긴 요청은 이미 지불한 입력을 낭비합니다.

- 티어 드리프트: “안전을 위해” 모든 것을 Sol에 두는 것은 가장 비용이 많이 드는 습관입니다.

덜 내는 방법

GPT-5.6 비용을 절감하는 세 가지 수단, 빌드하는 것을 바꾸지 않고. 배치: Batch 계층을 통한 비동기 요청은 표준 가격의 50% 할인이며, 지연 시간에 민감하지 않은 대량의 Luna 작업에 이상적입니다. 캐싱: 안정적인 프리픽스를 충분히 재사용하여 1.25배 쓰기 프리미엄을 상쇄하고 반복 입력 비용을 10분의 1로 줄입니다. 라우팅: 일상적인 작업은 Luna 또는 Terra로 보내고 어려운 소수만 Sol로 에스컬레이션하며, 가능하면 프롬프트를 272K 임계값 미만으로 유지하세요.

GPT-5.6 호출 방법

GPT-5.6는 OpenAI API와 OpenAI 호환 게이트웨이를 통해 사용할 수 있으므로, 모델이나 티어를 변경하더라도 통합 상태가 안정적으로 유지됩니다. 다음은 표준 OpenAI 호환 패턴입니다. 프로덕션에서 사용하기 전에 현재 모델 ID를 확인하고, 별칭이 아닌 정확한 티어를 고정하세요.

from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "이 모듈을 리팩터링하고 위험을 설명하세요."}],
)
print(response.choices[0].message.content)

티어 전환은 모델 필드에 대한 한 줄 변경으로, 이를 통해 난이도 기반 라우팅이 실용적이게 됩니다: 일상적인 호출은 Luna나 Terra로 보내고, 어려운 호출만 Sol로 에스컬레이션하세요.

GPT-5.6을 OrcaRouter를 통해 테스트 중

게이트웨이는 GPT-5.6을 도입하기 쉽게 만드는 두 가지 이유가 있습니다. 첫째, 동일한 OpenAI 호환 클라이언트가 세 가지 티어와 Claude Opus 4.8, GLM 5.2, Grok 4.5와 같은 비교 모델을 모두 호출할 수 있으므로 통합 코드를 다시 작성하지 않고도 모든 항목에 대해 하나의 평가 세트를 실행하고 허용된 작업당 실제 비용(도구 수수료, 재시도, 272K 추가 요금 포함)을 측정할 수 있습니다. 둘째, 게이트웨이는 공급자 간에 장애 조치를 수행하고 예산 한도를 적용할 수 있으므로 일시적인 용량 문제나 잘못된 Sol 호출이 한 달 예산을 초과하지 않습니다. 예산을 설정하기 전에 실제 GPT-5.6 경로와 현재 티어 ID를 확인하세요.

다음 단계: OrcaRouter에 등록하고 하나의 API 엔드포인트에서 자체 GPT-5.6 티어 비교를 실행하세요.

자주 묻는 질문

GPT-5.6 Sol, Terra, Luna 사이의 차이점은 무엇인가요?

동일한 제품군의 세 가지 등급으로, 가격과 성능 수준이 다릅니다. Sol은 가장 까다로운 작업을 위한 플래그십 모델(5달러/30달러)이고, Terra는 균형 잡힌 기본 모델(2.50달러/15달러)이며, Luna는 대량 작업을 위한 경제형 모델(1달러/6달러)입니다. 테스트를 통과하는 가장 낮은 등급을 선택하세요.

GPT-5.6 Sol Ultra 가격 체계가 있나요?

아니요. "Sol Ultra"는 Sol의 고급 추론 다중 에이전트 구성이며, 가격 페이지의 별도 라인이 아닙니다. 더 많은 토큰을 사용하고 작업당 비용이 더 많이 들지만, 더 높은 노력 수준의 Sol으로 예산을 책정합니다.

왜 내 GPT-5.6 청구서가 간단한 예상치를 초과했을까?

일반적으로 출력 토큰, 272K 긴 프롬프트 추가 요금(입력 2배, 출력 1.5배), 우선 서비스 티어, 데이터 레지던시 업리프트 또는 재시도가 해당됩니다. 전체 요청 체인을 기록하고 프롬프트당이 아닌 승인된 작업당 비용을 측정하세요.

GPT-5.6을 미세 조정할 수 있으며, 무료 티어가 있나요?

둘 다 아닙니다. GPT-5.6은 파인튜닝을 지원하지 않으며, API에는 무료 등급이 없습니다. 첫 번째 토큰부터 청구가 시작됩니다. 무료 액세스는 특정 ChatGPT 요금제 내에서만 존재하며, 이는 API와는 별개의 제품입니다.

어떤 ChatGPT 요금제가 어떤 등급을 사용할 수 있나요?

제품에 따라 다릅니다. ChatGPT Work 및 Codex에서 Free와 Go는 Terra를 사용할 수 있으며, Plus 이상은 Sol, Terra, Luna 중에서 선택할 수 있습니다. 가장 높은 울트라 설정은 Pro와 Enterprise로 제한됩니다. API와 ChatGPT 요금제는 별도로 취급하세요. API 키가 구독의 액세스 권한을 상속하지 않습니다.

요점

GPT-5.6의 가격 정책의 핵심은 계층 구조입니다. Sol($5/$30)은 지능 순위에서 선두를 달리고, Terra($2.50/$15)는 가성비 기본 옵션이자 기존 GPT-5.5 트래픽의 자연스러운 이동처이며, Luna($1/$6)는 대량 처리를 담당합니다. 캐싱을 사용하면 반복 입력이 10분의 1로 줄어들고(1.25배의 쓰기 프리미엄 적용), Batch는 절반 가격이지만, 출력은 모든 계층에서 비싼 쪽이며 272K를 초과하는 긴 프롬프트에는 추가 요금이 부과됩니다.

세 가지 계층을 단일 구매가 아닌 라우팅 문제로 취급하십시오: 기본은 낮게, 실패 시 에스컬레이션, 안정적인 컨텍스트는 캐시, 지연 시간이 허용되는 곳에서는 Batch를 사용하고, 동일한 엔드포인트를 통해 비교 모델에 접근 가능하도록 유지하십시오. 이렇게 하면 일상적인 작업에 플래그십 요금을 지불하는 것보다 승인된 작업당 비용이 훨씬 낮아집니다.


© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

문의하기

커뮤니티에 참여하세요

DiscordEmailXGitHubYouTube