GPT-5.6 Sol API 가이드용 타이틀 카드로, 둥근 게이트웨이 카드가 보이며, model: gpt-5.6-sol이라고 적힌 코드 칩, 1M 토큰당 $5 / $30라고 적힌 가격표, Reasoning effort라고 표시된 6개 위치의 다이얼, 그리고 GPT, Claude, Gemini, Qwen이라고 표시된 4개의 모델 칩이 얇은 선으로 단일 게이트웨이에 연결된 모습을 보여줍니다.
Guides & Insights

GPT-5.6 Sol API: 호출 방법, 비용, 그리고 다운그레이드 시점

작성자

Alistair Wren

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.

두 방언과 하나의 모델 ID

대부분의 GPT-5.6 Sol 튜토리얼은 하나의 방언만 보여주고 거기서 멈춥니다. 두 가지가 있으며, 둘 다 동일한 가중치에 도달합니다.

• Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.

• Responses API — client.responses.create. 동일한 모델 ID이지만 더 새로운 요청 형태: 단일 input 필드와 reasoning 블록 ({"effort": "high"})을 messages 배열 대신 사용합니다. OpenAI는 reasoning 파라미터를 직접 받고 reasoning 토큰을 일급 출력으로 반환하기 때문에 새 빌드에 이를 권장합니다. 가장 높은 effort 수준은 여기에서만 사용할 수 있습니다.

• 티어를 고정하세요. 단순 별칭 gpt-5.6은(는) 현재 Sol로 라우팅되지만, 별칭이란 공급업체가 새 플래그십을 출시할 때 변경하는 바로 그 대상입니다. 전달할 gpt-5.6-sol을 명시적으로 지정한다는 것은 모든 호출이 비용을 명시하며, 모든 게이트웨이가 기대하는 ID라는 뜻입니다.

당신이 받는 것 — 그리고 요금을 결정하는 다이얼

GPT-5.6 Sol은 OpenAI의 추론 중심 플래그십 모델로, 약 105만 토큰의 컨텍스트 창, 최대 128K 출력, 2026년 2월 16일의 지식 컷오프, 그리고 텍스트·이미지·파일 입력과 텍스트 출력을 지원합니다. 독립적인 Artificial Analysis 리더보드에서 AA 지능 지수 61 및 AA 코딩 점수 77을 기록했으며, SWE-bench Pro 점수 64.6%는 llm-stats가 독립적으로 측정한 값입니다. 에이전트 업계가 실제로 인용하는 수치는 바로 코딩 점수입니다.

A spec and benchmark scoreboard for GPT-5.6 Sol: model id gpt-5.6-sol, ~1.05M token context window, 128K max output, released July 9 2026, AA Intelligence Index 61 and AA Coding 77 per Artificial Analysis, SWE-bench Pro 64.6% independently measured by llm-stats, and six reasoning-effort levels from none to max.

추론은 기본적으로 켜져 있으며, 추론 노력 매개변수는 지연 시간과 비용 모두에 가장 큰 영향을 미치는 요소입니다:

• 6단계 — none, low, medium, high, xhigh, max. none은 기계적 작업에서는 추론을 끄고, max는 오류 비용이 높은 문제를 위한 것이며 Responses API에서만 사용할 수 있습니다.

• 중간에서 시작하여 한 번에 한 단계씩 조정하세요. apidog GPT-5.6 튜토리얼은 많은 GPT-5.5 워크로드가 5.6 제품군에서 한 단계 낮은 품질을 유지한다고 언급합니다. 더 많은 추론 비용을 지불하기 전에 품질을 측정하세요.

• Pro 모드는 설정이지 모델이 아닙니다. 로 설정하세요.reasoning.mode: \"pro\" 그러면 모델은 속도보다 답변 품질을 우선시합니다. 가격과 모델 ID는 변경되지 않습니다.

• 상세도 — 낮음, 중간 (기본값), 높음 — 출력 길이를 추론과 독립적으로 제어합니다.

• 추론 토큰은 출력으로 계산되어 백만 개당 30달러로 청구됩니다. xhigh 또는 max의 어려운 프롬프트에서는 내부 추론이 청구서를 지배할 수 있습니다. 이는 추론 모델 가격 책정의 숨은 부분으로, 표면 가격표에는 절대 나타나지 않습니다.

솔의 실제 비용

Sol의 기본 가격은 OpenAI의 2026년 7월 30일 가격 인하 이후에도 변함없이 유지되었습니다: 입력 100만 토큰당 $5, 출력 100만 토큰당 $30. 이번 인하는 두 저가 티어에 적용되었습니다 — GPT-5.6 Terra는 $2 / $12로 인하되었고, GPT-5.6 Luna는 $0.20 / $1.20로 인하되었습니다 — 이는 언제 Sol이 과한 선택이 되는지를 알려주는 정확한 비교 기준이기 때문에 여기서 중요합니다.

A price card for the GPT-5.6 Sol API: Sol at $5 input / $30 output per 1M with a $0.50 cache read and a $6.25 cache write, a long-context tier at $10 / $45, GPT-5.6 Terra at $2 / $12 and GPT-5.6 Luna at $0.20 / $1.20, and a worked example of 100K tokens in plus 20K out billing $1.10 uncached or about $0.65 with a cached input leg.

세 가지 수정자가 유효 비율을 변경합니다:

• 프롬프트 캐싱. 재사용된 입력은 대략 백만 개당 $0.50 (캐시 읽기 시, 신규 입력 대비 90% 할인)로 청구되며, 캐시 쓰기는 백만 개당 $6.25 (캐시되지 않은 입력 요금의 1.25배)로 청구됩니다. 캐싱은 기본적으로 암시적으로 수행되며, 다음을 통해 명시적으로 설정할 수 있습니다: prompt_cache_options와 함께 ttl. 캐시된 접두사는 최소 1,024개의 토큰이 필요하며 최소 30분 동안 유지됩니다.

• 롱 컨텍스트 티어. 입력 크기가 특정 임계값을 넘으면 Sol은 다음 가격으로 전환됩니다: 100만 개당 $10 / $45. 아주 긴 프롬프트 몇 개가 평균 가격을 조용히 움직입니다.

• 모델이 내보내는 모든 것은 출력입니다. 여기에는 내부 추론 토큰도 포함되므로, 추론이 많은 호출에서는 요금이 출력 부분에 집중됩니다.

구체적인 청구서를 예로 들면, 100K 토큰 요청이 20K 출력 토큰을 생성할 때 청구되는 금액은 입력에 $0.50, 출력에 $0.60, 즉 $1.10이며, 이는 캐시되지 않은 경우의 금액입니다. 다음 호출에서 그 100K 프롬프트가 캐시에서 제공되면 입력 비용은 약 $0.05로 내려가고, 전체 비용은 약 $0.65가 됩니다. 하루 종일 동일한 시스템 프롬프트를 재사용하는 긴 에이전트 루프에서 캐싱은 Sol이 감당 가능한 가격인지 아닌지를 결정합니다.

양자 컴퓨팅 실험을 실행하는 Sol: OpenAI의 글

현재 $5 / $30 요금제가 제공하는 것에 대한 가장 강력한 답변은 OpenAI가 2026년 9월 8일에 직접 공개한 사용 사례, 즉 공식 게시물 "GPT-5.6 Sol이 양자 컴퓨팅 실험을 실행하는 데 어떻게 도움을 주는가"이며, 이는 또 다른 코딩 벤치마크가 아닌 실제 연구실 하드웨어에 모델을 연결하는 방법에 관한 것입니다. 이 게시물에서 OpenAI는 MIT 공학 양자 시스템 그룹(EQuS, 절대 영도에 가깝게 냉각된 초전도 큐비트를 연구하는 연구실)의 대학원생인 Beatriz Yankelevich가 GPT-5.6 Sol을 Codex를 통해 칩의 측정을 조정하는 소프트웨어에 연결하는 과정을 설명합니다. 측정 관련 기술과 칩 설계 목표가 주어지자 GPT-5.6 Sol은 측정 매개변수를 선택하고, 하드웨어를 구동하며, 반환된 데이터를 분석하고, 무엇을 개선하거나 저장할지 결정했습니다. 보정되지 않은 6큐비트 칩에서 연구자의 개입이 거의 없는 상태로 표준 보정 절차를 완료했습니다: 각 큐비트의 전이 주파수를 찾아내고, 큐비트를 제어하고 판독하는 펄스를 보정했으며, 큐비트가 양자 정보를 유지하는 시간을 측정했습니다.

OpenAI는 한계에 대해 솔직하며, 그 경고는 그 주장과 같은 맥락에서 언급되어야 합니다. 실험 신호가 약하거나 노이즈가 많을 때, Sol은 작동 가능한 매개변수를 찾는 데 더 오래 걸렸고, 때로는 경험 많은 연구자가 방향을 잡아주어야 했습니다. 이 게시물을 OpenAI가 보고한 것으로 취급하십시오 — 공급업체 사례 연구이지 독립적인 벤치마크가 아니라 — 그리고 그 실제 신호를 워크로드 프로파일로 받아들이십시오. EQuS는 이제 에이전트가 일상적인 칩 특성 분석을 하룻밤 사이에 실행할 수 있게 해 주며, 이 작업은 이전에는 칩당 연구자의 며칠을 소비했습니다. 이것이 추론 다이얼이 존재하는 작업의 형태입니다: 길고, 다단계이며, 도구를 사용하는 루프로서, 모델이 다음에 무엇을 할지 결정하고 잘못된 선택은 비용이 큽니다. 그것은 또한 동일한 gpt-5.6-sol 가중치를 API를 통해 얻게 되는 것입니다 — Codex는 하네스일 뿐 다른 모델이 아닙니다.

단일 엔드포인트, 200개 이상의 모델

If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the 1.05M-token context window, 128K max output, the p50 TTFT of 4.59s, and the /v1/chat/completions and /v1/responses endpoints.

경제성은 정직한 부분입니다. OrcaRouter가 추가하는 것은 토큰당 $0입니다. 모델 페이지의 $5/$30는 OpenAI 요금을 그대로 전달한 것이며, 공급업체 가격 변경은 발표 당일에 저희 쪽에도 반영됩니다. 자체 키 가져오기는 일급 옵션입니다: 기존 OpenAI 키를 넘기면 자체 속도 제한과 크레딧을 유지할 수 있고, OpenAI가 직접 청구합니다. 가드레일(PII 보호장치 및 콘텐츠 정책)은 요청이 청구되기 전에 적용되며, 이후에는 적용되지 않습니다. 라우팅 DSL은 Sol이 오류를 반환하거나 트래픽 형태가 허용할 때 더 저렴한 모델이 응답하도록 장애 조치를 구성합니다.

Sol이 잘못된 티어에 있을 때

플래그십이라는 것이 모든 상황에 적합하다는 뜻은 아니며, $5/$30 요금이 불리한 세 가지 경우가 있습니다.

• 대량·저위험 호출. 월 1,000만 입력 토큰을 처리하는 분류 또는 추출 파이프라인의 비용은 Sol에서는 $50인 반면 GPT-5.6 Luna에서는 $2 — 동일한 엔드포인트, 동일한 키, ID 하나만 변경. Luna는 $0.20 / $1.20의 가격으로 정확히 이런 작업을 위해 책정되었습니다.

• 프런티어 수준의 깊이가 필요 없는 중간급 추론. GPT-5.6 Terra는 $2/$12 가격으로 볼륨과 플래그십 사이에 위치합니다. apidog 튜토리얼의 조언이 합리적인 기본값입니다: Terra에서 프로토타입을 만들고, Terra가 측정 가능할 정도로 실패하는 경우에만 Sol로 승격하며, 안정적인 대용량 경로는 Luna로 내리세요.

• 우리가 약속할 수 있는 범위.OrcaRouter는 라우팅과 결제를 처리하고, OpenAI는 가중치(weights)를 실행합니다. 엔드포인트, 제로 마크업, 장애 조치(failover), 그리고 안전장치는 우리의 몫이지만, 추론 품질과 안전 동작은 OpenAI의 몫이며, BYOK를 사용하면 비용이 OpenAI로 직접 전달됩니다. 이것이 명확히 밝힌 조건입니다: 어느 쪽이든 제공업체 요금을 지불하게 되며, 200개 이상의 모델을 위한 단일 엔드포인트가 그만한 가치가 있는지가 관건입니다.

결론

기존 OpenAI 클라이언트가 있다면 Chat Completions로, 새로 구축 중이라면 Responses API로 GPT-5.6 Sol API를 호출하세요. 모델 ID는 gpt-5.6-sol이며, $5/$30 요금과 동일한 추론 다이얼이 어느 쪽이든 적용됩니다. 이 모델은 작업이 어렵고 맥락이 길며 출력이 백만 토큰당 $30의 가치가 있을 때 적합한 모델입니다. 반면 작업이 일상적일 때는 Terra와 Luna가 가격의 일부에 불과하므로 적합하지 않습니다. 가장 깔끔한 설정은 마음을 바꿀 수 있는 설정입니다. 하나의 엔드포인트, 자신의 키, $0 마크업, 그리고 작업량이 변하는 날 교체할 수 있는 모델 ID를 갖추는 것입니다.

GPT-5.6 Sol이 OrcaRouter에서 OpenAI의 $5 / $30 정가 그대로, 토큰당 마크업 $0으로 출시되었습니다. 기존 OpenAI 키를 가져오면 공급업체가 직접 청구합니다. 시작하려면 OrcaRouter의 GPT-5.6 Sol로 하세요 — 하나의 엔드포인트, 추가 통합이 필요 없습니다.