Karta tytułowa przewodnika po API GPT-5.6 Sol, przedstawiająca zaokrągloną kartę bramki z chipem kodu zawierającym model: gpt-5.6-sol, metką cenową $5 / $30 za 1M tokenów, pokrętłem oznaczonym „Reasoning effort” z sześcioma pozycjami oraz czterema chipami modeli oznaczonymi GPT, Claude, Gemini i Qwen połączonymi cienkimi liniami z pojedynczą bramką.
Guides & Insights

GPT-5.6 Sol API: jak ją wywołać, ile kosztuje i kiedy przejść na niższą wersję

Autor

Alistair Wren

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.

Te dwa dialekty i ten jeden identyfikator modelu

Większość poradników GPT-5.6 Sol pokazuje jeden dialekt i na tym kończy. Są dwa, i oba osiągają te same wagi.

Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.

Responses API — client.responses.create. Ten sam identyfikator modelu z nowszym kształtem żądania: pojedyncze pole input oraz blok reasoning ({"effort": "high"}) zamiast tablicy messages. OpenAI zaleca go w nowych projektach, ponieważ przyjmuje parametry reasoning bezpośrednio i zwraca tokeny reasoning jako wynik pierwszej klasy — a najwyższy poziom wysiłku jest dostępny tylko tutaj.

Ustal poziom.Sam alias gpt-5.6kieruje do Sol dzisiaj, ale alias to dokładnie to, co dostawca zmienia, gdy pojawia się nowy flagowy model. Przekazanie gpt-5.6-solwprost oznacza, że każde wywołanie podaje, ile kosztuje, i jest to id, którego oczekuje każda brama.

Co dostajesz — i pokrętło, które decyduje o Twoim rachunku

GPT-5.6 Sol to flagowy model OpenAI nastawiony na rozumowanie: okno kontekstowe o długości ~1,05 mln tokenów, maksymalne wyjście 128K, granica wiedzy na 16 lutego 2026 r. oraz obsługa wejścia tekstowego, obrazkowego i plikowego z wyjściem tekstowym. Na niezależnej liście rankingowej Artificial Analysis osiąga wskaźnik inteligencji AA wynoszący 61 oraz wynik kodowania AA wynoszący 77, a wynik SWE-bench Pro na poziomie 64,6% zmierzony niezależnie przez llm-stats — to właśnie ten wynik kodowania przytacza społeczność agentowa.

A spec and benchmark scoreboard for GPT-5.6 Sol: model id gpt-5.6-sol, ~1.05M token context window, 128K max output, released July 9 2026, AA Intelligence Index 61 and AA Coding 77 per Artificial Analysis, SWE-bench Pro 64.6% independently measured by llm-stats, and six reasoning-effort levels from none to max.

Myślenie jest domyślnie włączone, a wysiłku rozumowania parametr jest największą pojedynczą dźwignią zarówno opóźnienia, jak i kosztów:

Sześć poziomównone, low, medium, high, xhigh, max. none wyłącza rozumowanie w przypadku zadań mechanicznych; max jest przeznaczony dla problemów o wysokim koszcie błędu i jest dostępny tylko przez Responses API.

Zacznij od średniego i przechodź o jeden poziom na raz. Samouczek apidog GPT-5.6 zauważa, że wiele obciążeń GPT-5.5 utrzymuje swoją jakość o jeden poziom niżej w rodzinie 5.6 — zmierz jakość, zanim zapłacisz za więcej myślenia.

Tryb Pro to ustawienie, a nie model. Ustaw reasoning.mode: "pro" a model priorytetowo traktuje jakość odpowiedzi ponad szybkość. Cena i identyfikator modelu pozostają bez zmian.

Szczegółowośćniska, średnia (domyślnie), wysoka — kontroluje długość odpowiedzi niezależnie od rozumowania.

Tokeny reasoning są rozliczane jako dane wyjściowe po 30 dolarów za milion. Przy trudnych promptach na poziomie xhigh lub max, wewnętrzne rozumowanie może zdominować rachunek — ukryta część wyceny modeli reasoning, której metka nigdy nie pokazuje.

Ile tak naprawdę kosztuje Sol

Cena bazowa Sola pozostała bez zmian po obniżce cen OpenAI z 30 lipca 2026 r.: $5 za milion tokenów wejściowych i $30 za milion tokenów wyjściowych. Obniżka objęła dwa tańsze poziomy — GPT-5.6 Terra spadł do $2 / $12 i GPT-5.6 Luna do $0.20 / $1.20 — co ma tutaj znaczenie, ponieważ to właśnie to porównanie pokazuje, kiedy Sol jest przesadą.

A price card for the GPT-5.6 Sol API: Sol at $5 input / $30 output per 1M with a $0.50 cache read and a $6.25 cache write, a long-context tier at $10 / $45, GPT-5.6 Terra at $2 / $12 and GPT-5.6 Luna at $0.20 / $1.20, and a worked example of 100K tokens in plus 20K out billing $1.10 uncached or about $0.65 with a cached input leg.

Trzy modyfikatory zmieniają efektywną stawkę:

Buforowanie promptów. Ponownie użyte dane wejściowe rozliczane są po około 0,50 USD za milion przy odczycie z pamięci podręcznej — 90% taniej niż świeże dane wejściowe — a zapisy do pamięci podręcznej kosztują 6,25 USD za milion (1,25x stawki bez pamięci podręcznej). Buforowanie jest domyślnie niejawne i można je uczynić jawnym za pomocą prompt_cache_options z parametrem ttl; buforowany prefiks wymaga co najmniej 1 024 tokenów i pozostaje aktywny przez co najmniej 30 minut.

Poziomy długiego kontekstu. Powyżej progu rozmiaru wejścia, Sol przechodzi na $10 / $45 za milion. Kilka bardzo długich promptów niepostrzeżenie podnosi średnią cenę.

Wszystko, co generuje model, jest wynikiem. Obejmuje to wewnętrzne tokeny rozumowania, więc w przypadku wywołań wymagających intensywnego rozumowania koszty koncentrują się po stronie wyników.

Konkretna faktura: żądanie o 100K tokenów, które generuje 20K tokenów wyjściowych, kosztuje 0,50 $ za wejście i 0,60 $ za wyjście — 1,10 $ bez cache. Jeśli ten 100K prompt zostanie obsłużony z cache przy następnym wywołaniu, koszt wejścia spadnie do około 0,05 $, a cały cykl wyniesie około 0,65 $. W długiej pętli agenta, która przez cały dzień używa tego samego promptu systemowego, cache'owanie to różnica między tym, czy Sol jest przystępny cenowo, czy nie.

Jeden endpoint, 200+ modeli

If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the 1.05M-token context window, 128K max output, the p50 TTFT of 4.59s, and the /v1/chat/completions and /v1/responses endpoints.

Ekonomia to uczciwa część. OrcaRouter dodaje $0 za token — kwoty $5 / $30 na stronie modelu to stawka OpenAI przekazana dalej, a zmiana ceny u dostawcy jest u nas aktualna tego samego dnia, w którym zostanie ogłoszona. Przynieś własny klucz to opcja pierwszej klasy: przekaż swój obecny klucz OpenAI, zachowaj własne limity i kredyty, a OpenAI obciąża Cię bezpośrednio. Zabezpieczenia — osłona PII i polityka treści — są egzekwowane przed obciążeniem żądania, a nie po. DSL routingu komponuje failover, dzięki czemu tańszy model odpowiada, gdy Sol zwraca błędy lub gdy charakter Twojego ruchu na to pozwala.

Gdy Sol jest w złym tierze

Bycie flagowcem to nie to samo, co bycie właściwym wyborem dla każdego połączenia — są trzy miejsca, w których stawka $5 / $30 przegrywa.

Wywołania o dużej objętości i niskim ryzyku. Potok klasyfikacji lub ekstrakcji przetwarzający 10M tokenów wejściowych miesięcznie kosztuje $50 na Sol w porównaniu z $2 na GPT-5.6 Luna — ten sam endpoint, ten sam klucz, jedna zmiana id. Luna w cenie $0.20 / $1.20 jest wyceniona właśnie pod taką pracę.

Rozumowanie średniej półki, które nie wymaga głębi z czołówki. GPT-5.6 Terra za $2 / $12 plasuje się między wersją masową a flagową. Zalecenie z samouczka apidog to rozsądny domyślny wybór: prototypuj na Terra, eskaluj do Sol tylko tam, gdzie Terra w mierzalny sposób zawodzi, a stabilne ścieżki o dużym wolumenie przenoś do Luna.

Granica tego, co możemy obiecać.OrcaRouter trasuje i rozlicza; OpenAI uruchamia modele. Endpoint, zerowa marża, failover i zabezpieczenia są po naszej stronie, ale jakość wnioskowania i bezpieczeństwo modelu zależą od OpenAI, a przy BYOK pieniądze trafiają bezpośrednio do nich. Tak wprost przedstawia się ten układ: i tak płacisz stawkę dostawcy, a pytanie brzmi, czy jeden endpoint dla ponad 200 modeli jest tego wart.

Sedno sprawy

Wywołaj API GPT-5.6 Sol za pomocą Chat Completions, jeśli masz istniejącego klienta OpenAI, a za pomocą Responses API, jeśli budujesz coś nowego — identyfikator modelu gpt-5.6-sol, stawkę $5 / $30, i ten sam poziom rozumowania w obu przypadkach. To właściwy model, gdy zadanie jest trudne, kontekst jest długi, a wynik jest wart $30 za milion tokenów — a niewłaściwy, gdy zadanie jest rutynowe, gdzie Terra i Luna kosztują ułamek tej ceny. Najczystsza konfiguracja to taka, która pozwala zmienić zdanie: jeden endpoint, własny klucz, $0 narzutu i identyfikator modelu, który możesz wymienić w dniu, w którym zmienia się obciążenie.

GPT-5.6 Sol jest już dostępny na OrcaRouter w cenie listowej OpenAI $5 / $30 z zerową marżą za token — użyj swojego istniejącego klucza OpenAI, a dostawca rozliczy Cię bezpośrednio. Zacznij od GPT-5.6 Sol on OrcaRouter — jeden endpoint, bez drugiej integracji.

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

Skontaktuj się z nami

Dołącz do społeczności

DiscordEmailXGitHubYouTube