
GPT-5.6 Sol API 가격: 1M 토큰당 $5 / $30, 캐시 $0.50, 그리고 실제 비용
- DeepSeekNEWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100만 토큰당
- z-aiNEWZ.ai: GLM 5.32026-08-1860지능75코딩
- obsidianNEWQwen3.8 27B2026-08-1552지능68코딩
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253지능69코딩
- grokNEWSpaceXAI: Grok 4.62026-08-1261지능77코딩
- metaMeta: Muse Spark 1.22026-08-0557지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0358지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2152지능69코딩
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137지능49코딩
- metaMeta: Muse Spark 1.12026-07-1653지능71코딩
- kimiMoonshotAI: Kimi K32026-07-1560지능76코딩
- openaiOpenAI: GPT-5.6 Luna2026-07-0952지능71코딩
- openaiOpenAI: GPT-5.6 Terra2026-07-0957지능77코딩
- openaiOpenAI: GPT-5.6 Sol2026-07-0961지능77코딩
GPT-5.6 Sol은 입력 토큰 100만 개당 $5.00, 출력 토큰 100만 개당 $30.00입니다. 이는 GPT-5.6 Sol API의 요금으로, OrcaRouter 디렉터리에서 플래그십 티어가 적용받는 것과 동일한 요율이며 2026-08-18 기준, 마크업이 전혀 없습니다. GPT-5.6 제품군에서 가장 비싼 티어이며, 7월 30일 인하 때 정가가 움직이지 않은 유일한 티어이므로, 실시간 GPT-5.6 Sol 모델 페이지의 요금표를 기준으로 예산을 세우는 것이 좋습니다. 헤드라인보다 조정 요소가 더 중요합니다. 프롬프트 캐싱을 이용하면 재사용 입력이 100만 개당 $0.50으로 청구되고, 배치 API는 $2.50 / $15.00으로 떨어지며, 고속 모드는 2배 프리미엄을 내고 최대 2.5배 속도를 얻는 구조입니다. 이 페이지는 Sol 전용의 가격 참고 자료입니다. 정확한 요금표, 실제 요청 비용, 플래그십이 다른 모델과 비교해 어떤지, 어떤 경우에 구매가 적절하지 않은지, 그리고 자체 키를 사용해 OpenAI 호환 엔드포인트 하나로 호출하는 방법을 담고 있습니다.
가격은 2026-08-18 기준 백만 토큰당(입력/출력)입니다. 달러 수치는 OpenAI가 게시한 API 요금을 기준으로 하며, GPT-5.6 Sol의 OrcaRouter 모델 페이지와 대조 확인되었습니다. 캐시, 배치, 패스트 모드 및 롱 컨텍스트 요금은 OpenAI가 공지한 수치입니다. 가격은 변동될 수 있습니다 — 구축 전에 확인하세요.
오늘 확인된 정확한 가격
다음은 2026-08-18에 검증된 GPT-5.6 Sol의 전체 요금표입니다:

• 입력 — 캐시 미스 시 1M 토큰당 $5.00.
• 출력 — 토큰 100만 개당 $30.00.
• 프롬프트 캐시 읽기 — 1M 토큰당 $0.50, 재전송하는 모든 입력에 대해 90% 할인.
• 프롬프트 캐시 쓰기 — 1M 토큰당 $6.25.
• 롱컨텍스트 티어 — 약 272K 토큰을 초과하는 입력은 입력 $10.00 / 출력 $45.00로 청구됩니다(입력 2배, 출력 1.5배).
• Batch API — 입력 $2.50 / 출력 $15.00, 일괄 50% 할인, 비동기, 일반적으로 약 24시간 내에 준비됩니다.
• 빠른 모드 — $10.00 입력 / $60.00 출력, 지능 변화 없이 최대 약 2.5배 출력 속도를 제공하는 2배 프리미엄.
• 컨텍스트 창 — 약 1.05M 토큰, 최대 128K 출력.
OrcaRouter는 공급자 요금을 마크업 없이 그대로 전달하므로, 디렉토리에 표시된 금액이 실제 지불 금액입니다. 라이브 모델 페이지에서 카드에는 1M당 $5.00 / $30.00, 캐시 읽기 $0.500이 표시되며, Vision, Tools, JSON 및 Reasoning 배지가 있습니다. Sol의 $5 / $30도 인하 전 가격입니다: OpenAI의 7월 30일 인하가 GPT-5.6 Luna(현재 $0.20 / $1.20)와 GPT-5.6 Terra(현재 $2 / $12)에 적용되었으며, 플래그십은 유지되었습니다.
실효 가격을 바꾸는 수단
기본 요금은 단지 출발점일 뿐입니다. 네 가지 수정 요소가 Sol의 실제 비용을 바꿉니다:
• 프롬프트 캐싱 — 재사용된 컨텍스트는 백만 개당 0.50달러로 청구되며, 신규 컨텍스트는 5달러이고, 캐시 쓰기는 백만 개당 6.25달러입니다. 모든 턴에서 큰 프리픽스를 다시 보내는 에이전트나 채팅의 경우, 캐싱은 비용에서 가장 큰 절감 요소입니다. OpenAI는 캐시를 프로젝트 및 API 키별로 키(key)로 관리하므로, 하나의 키(하나의 채널)를 유지하는 것이 캐시 적중을 유지하는 핵심입니다.
• 긴 컨텍스트 등급 — 입력이 대략 272K 토큰을 초과하는 요청은 기본 요금에서 $10/$45로 이동합니다. 몇 개의 대형 프롬프트가 평균 가격을 은근히 올릴 수 있으므로, 깊은 컨텍스트가 정말로 필요하지 않을 때는 일괄 처리하거나 잘라내세요.
• Batch — OpenAI의 배치 API는 작업을 비동기식으로 실행하며 약 24시간의 처리 시간에 정확히 절반 가격인 $2.50 / $15.00입니다. 캐시된 입력은 $0.25, 캐시 쓰기는 $3.13입니다. 프롬프트 캐싱과 함께 사용할 수 있으며 지연 시간이 중요하지 않은 평가, 대량 분류 및 오프라인 생성에 적합합니다.
• 빠른 모드 — $10 / $60으로 최대 ~2.5배 출력 처리량을 제공하며, 지연 시간에 민감하고 사용자가 기다리는 작업(예: 라이브 코딩 지원)에 유용합니다. 토큰당 표준 요금의 2배로 청구되며, 구매한 Scale Tier TPM 패키지에는 포함되지 않고, 공유 속도 제한을 초과하면 표준 처리로 대체될 수 있습니다.
요청의 실제 비용
토큰별 가격은 추상적이므로, 오늘의 요율로 실제 계산한 예시를 들어 보겠습니다.
• 채팅 호출 1회, 입력 50K + 출력 20K — $0.25 + $0.60 = $0.85.
• 입력 1M + 출력 1M — $5 + $30 = $35.
• 에이전트 턴, 200K 캐시된 컨텍스트 + 20K 새 입력 + 30K 출력 — $0.10 + $0.10 + $0.90 = $1.10. 콜드 캐시를 사용한 동일한 턴은 — 220K 새 입력에 $1.10 — 총 $2.00. 캐싱으로 거의 절반으로 줄어듭니다.
• 한 달 10M 토큰을 입력 70% / 출력 30% 비율로 사용하는 경우, 입력의 80%가 캐시에서 처리된다면: 신규 입력 1.4M($7.00) + 캐시 입력 5.6M($2.80) + 출력 3M($90) ≈ $100. 캐시를 사용하지 않으면 같은 달 비용은 $125 — 그리고 같은 달을 GPT-5.6 Terra로 처리하면 약 $50, GPT-5.6 Luna로 처리하면 약 $5입니다. Sol과 Luna 사이의 20배 차이가 티어 매칭이 어느 단일 요금보다 더 중요한 이유입니다.
두 가지 주의사항으로 인해 실효 요율이 올라갑니다. Sol은 추론 모델로, 내부 추론 토큰은 출력으로 간주되어 백만 개당 30달러로 청구됩니다. 어려운 프롬프트에 높은 추론 노력 설정을 사용하면 출력 예산의 상당 부분을 사고에 사용할 수 있습니다. 따라서 어려운 작업의 실효 출력 비용은 단순 추정치를 훨씬 웃돌 수 있습니다. 또한 OpenAI의 토크나이저는 일부 입력에서 이전 세대보다 더 상세하게 토큰을 생성하므로, 같은 텍스트라도 GPT-5.5에서보다 더 많은 토큰을 소모할 수 있습니다. 작업에 맞게 추론 노력을 조정하고, 가능한 곳에서 출력을 제한하며, 비용을 예측하기 전에 실제 사용량을 측정하세요.
Sol 가격이 경쟁사와 비교되는 방식

2026-08-18에 게시된 정가와 대조하여 읽기:
• GPT-5.6 Terra — $2 / $12, 할인 후 중간 등급입니다. Sol은 입력과 출력 모두에서 2.5배 더 비쌉니다. Terra는 플래그십 추론이 필요하지 않을 때 기본 선택입니다.
• GPT-5.6 Luna — $0.20 / $1.20, 할인 적용 후 볼륨 티어. Sol 대비 25배 입력 격차; Luna는 대부분의 일반 트래픽을 겨냥해 가격이 책정되었습니다.
• Claude Opus 5 — $5 / $25. 입력은 동일하고, 서류상 출력 비용은 20% 저렴합니다. 실제로 일부 워크로드에서는 비교 결과가 반대가 됩니다. 이 블로그는 이전에 동일한 영어/혼합 샘플에서 Sol이 Anthropic 모델보다 약 34.5% 더 적은 토큰을 사용한다고 측정했으며, 게재된 토큰 경제성 분석(TheBlockBeats)은 출력 요율이 더 높음에도 불구하고 동일한 작업에 대해 Sol의 총 비용이 Claude Opus 5보다 약 21% 낮을 수 있다고 추정했습니다. 표시 가격이 아닌 자체 토크나이저로 측정하세요.
• Claude Fable 5 — $10 / $50. Sol은 입력 가격의 절반이며, 출력은 Anthropic 최상위 등급보다 40% 저렴합니다.
• Claude Opus 4.8 — $5 / $25. Sol과 동일한 입력, 더 저렴한 출력 — 이전 세대 Anthropic 플래그십.
• Grok 4.6 — $2 / $6. 보드에서 가장 눈에 띄는 수치입니다. Artificial Analysis 지수에서 GPT-5.6 Sol과 동률(둘 다 61)을 기록했으며, 입력 비용은 2.5배, 출력 비용은 5배 더 저렴합니다.
• DeepSeek V4 Pro — 오프피크 기준 $0.44 / $0.88 (피크 시간대는 두 배). 저렴한 오픈 웨이트 모델 부문에서 완전히 다른 가격대를 형성합니다.
솔직하게 말하면, Sol은 프리미엄 출력 속도를 갖춘 프리미엄 플래그십입니다 — Claude Fable 5 아래의 폐쇄형 플래그십 중 가장 높은 출력 속도를 제공합니다. 절대 속도보다는 힘든 작업 단위당 실효 비용(토크나이저, 추론 능력, 긴 컨텍스트)에서 우위를 점합니다. 트래픽이 짧은 프롬프트와 단순 작업으로 구성되어 있다면, $2 Terra, $0.20 Luna, 또는 $2/$6 Grok 4.6이 더 저렴한 선택입니다 — 그리고 지수 기준으로 Grok 4.6은 서류상 아무것도 포기하지 않습니다.
Sol이 잘못된 선택일 때
이 가격이 원하는 가격이 아닌 네 가지 경우:
짧고 간단한 프롬프트. 대략 20K 토큰 미만이고 깊은 추론이 필요 없는 경우, 플래그십 프리미엄은 낭비입니다. GPT-5.6 Terra($2 / $12) 또는 GPT-5.6 Luna($0.20 / $1.20)는 비용의 극히 일부만으로 볼륨 티어를 처리하며, Grok 4.6 또는 DeepSeek급 모델은 그보다 더 저렴합니다.
추론 비중이 높은 볼륨. 추론이 출력으로 청구되므로, 높은 노력으로 실행되는 어려운 프롬프트는 명목 출력 라인보다 훨씬 많은 비용이 들 수 있습니다. 작업량이 어려운 호출로 가득하다면, 확정하기 전에 실제 출력 토큰을 측정하세요 — 실효 요율이 예상을 벗어날 수 있습니다.
토큰당 가격이 유일한 목표라면. Grok 4.6은 지수에서 Sol과 동률을 이루며 $2/$6이고, DeepSeek V4 Pro는 비수기 기준 $0.44/$0.88입니다. 최첨단 벤치마크 점수가 필수 조건이 아니라면, 이 모델들은 동급 작업에 대해 훨씬 낮은 토큰당 요율을 제공합니다.
엄격한 지연 시간 예산.Sol은 대규모 추론 모델이라 첫 토큰 생성 시간(time-to-first-token)이 Flash 등급 모델보다 훨씬 깁니다. 1초 미만의 TTFT가 중요한 실시간 채팅에서 $10/$60의 빠른 모드는 처리량만 높여 줄 뿐 첫 토큰 지연 시간을 줄여 주지 않습니다. 더 작은 모델이 여전히 더 저렴한 해결책입니다.
OrcaRouter에서 그것을 호출하는 방법

GPT-5.6 Sol은 OrcaRouter에 모델 ID openai/gpt-5.6-sol로 호스팅되며, OpenAI 호환 엔드포인트 api.orcarouter.ai/v1을 통해 제공업체 요금으로 마크업 없이 제공됩니다. 이미 OpenAI 클라이언트가 있다면 마이그레이션은 기본 URL과 모델 ID 변경일 뿐입니다 — 그 외에는 아무것도 아닙니다. 동일한 키와 엔드포인트는 200개 이상의 모델을 지원하므로, Sol은 GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 및 비교하고 싶은 오픈 가중치 모델과 나란히 제공되며, 각각을 다시 통합하는 대신 난이도에 따라 라우팅할 수 있습니다.
가격 페이지에서 언급할 만한 OrcaRouter의 두 가지 특징. BYOK: 자신의 OpenAI 키를 가져와 OpenAI가 자체 요율로 직접 청구합니다. OrcaRouter는 토큰당 $0만 추가하고 공급업체의 rate limit과 크레딧을 그대로 유지합니다. Guardrails: PII Shield와 콘텐츠 정책이 과금보다 먼저 실행되므로 차단된 요청은 400 오류를 반환하고 청구되지 않습니다. 또한 Agent Firewall은 도구와 MCP 호출이 실행되기 전에 평가합니다.
가격 페이지에서 중요한 정직성에 관한 메모: 우리는 모델을 라우팅할 뿐, 가격을 정하지 않습니다. $5 / $30 수치는 OpenAI의 요금을 그대로 전달한 것이며, OpenAI가 이를 변경하면 목록도 그에 따라 변경됩니다 — 이것이 바로 이 페이지에 날짜가 기재된 이유입니다. OpenAI에 직접 호출하면 동일한 요금을 얻습니다. OrcaRouter는 전체 모델 라인에서 하나의 엔드포인트를 원할 경우 단일 키, 제로 마크업 경로를 위해 존재합니다.
출처 및 날짜
위의 모든 가격은 2026-08-18에 검증되었습니다. GPT-5.6 Sol 수치는 OpenAI가 공개한 API 요금표에서 확인했으며, 같은 날 확인한 OrcaRouter의 GPT-5.6 Sol 모델 페이지 및 당사가 게시한 GPT-5.6 요금 페이지와 대조 검증했습니다. 배치(batch), 패스트 모드(fast-mode), 캐시 쓰기(cache-write), 장문 컨텍스트(long-context) 요금은 OpenAI가 발표한 내용입니다. Claude, Grok, DeepSeek 수치는 현재 OrcaRouter 디렉터리 등재 기준이며, DeepSeek V4 Pro는 비수기(off-peak) 요금으로 표시됩니다. OpenAI는 2026년 7월 9일 출시 이후 Sol의 공시 가격을 변경하지 않았습니다. 7월 30일 인하에서도 플래그십 모델은 영향을 받지 않았지만, 가격은 변동될 수 있습니다. 따라서 이전에 확인된 'GPT-5.6 Sol pricing' 페이지를 발견하더라도 해당 페이지의 확인 날짜를 기준으로 판단하시기 바랍니다. 여기에 나온 수치는 오늘 현재 기준입니다.
위의 모든 가격은 GPT-5.6 Sol on OrcaRouter의 실시간 요금입니다 — 2026-08-18 기준, 수수료 0%, 자신의 키로 사용할 준비가 되었습니다.
이 글에서 비교한 모델3
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
