
Claude Haiku 5.5 kontra GPT-6 Luna Pro: Model kontra moda
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Jedna strona tego porównania to model, a druga to ustawienie. Claude Haiku 5.5wszedł do ogólnej dostępności 7 października 2026 r. w cenie 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych, w Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry i Claude Platform on AWS. GPT-6 Luna Prow ogóle nie jest modelem: aby do niego dotrzeć, trzeba wywołać GPT-6 Luna — dostępnego od 22 września 2026 r. w tej samej cenie 0,10 i 0,50 USD — z reasoning.mode ustawionym na pro zamiast standard. Na stronie modeli OpenAI nie ma gpt-6-luna-pro identyfikatora. Uczciwe ujęcie tego starcia nie brzmi więc „który model wygrywa", tylko „co jest lepszym sposobem wydania dziesięciu centów za milion tokenów wejściowych": mały model z pokrętłem wysiłku czy większy model uruchomiony w trybie, który wykonuje więcej pracy i wystawia rachunek za tokeny, których ci nie pokazuje. Przy krótkiej pracy o dużym wolumenie odpowiedzią jest zwykle ten pierwszy. Przy trudnej, sporadycznej pracy może to być ten drugi — a liczby, która o tym decyduje, OpenAI nie opublikowało.
Czym jest „pro" mechanicznie
Poradnik OpenAI dotyczący rozumowania stwierdza, że modele GPT-5.6 i GPT-6 obsługują dwa tryby w Responses API, standard (domyślny) oraz pro, wybierane za pomocą reasoning.mode. Tryb to inna kontrola niż reasoning.effort: tryb decyduje o tym, ile pracy model wykonuje, zanim zdecyduje się na odpowiedź, a effort decyduje o tym, ile rozumowania odbywa się w wybranym przez Ciebie trybie. Udokumentowane wartości effort dla GPT-6 Luna to none, low, medium (domyślna), high, xhigh i max, a każdą z nich można łączyć z trybem pro.
W kwestii rozliczeń przewodnik jest jednoznaczny i nieco kontrintuicyjny. Tryb Pro agreguje całą pracę modelu stojącą za ostateczną odpowiedzią i nalicza opłaty za te tokeny „według standardowych stawek za tokeny wybranego modelu”. W cenniku nie ma żadnej dopłaty za tryb Pro. Koszt pojawia się jako wolumen, ponieważ tryb Pro „wykonuje więcej pracy modelu niż tryb standardowy, zwiększając zużycie tokenów i koszt” — a tokeny rozumowania są rozliczane jako tokeny wyjściowe, pojawiając się wyłącznie w obiekcie usage pod output_tokens_details.reasoning_tokens. Jeśli nie odczytasz tego pola, wzrost pozostanie niewidoczny aż do nadejścia faktury.
Z tego wynikają dwa porównania i warto je rozdzielać. W zestawieniu z GPT-6 Luna w trybie standardowym, tryb pro to ten sam model z nieznanym mnożnikiem zużycia tokenów. W zestawieniu z Claude Haiku 5.5, to również inny model w innej skali — 1 050 000 tokenów kontekstu wobec 1 mln, limit wejściowy 922 000 tokenów i data odcięcia wiedzy 18 maja 2026 r., w warstwie, którą sama dokumentacja premiery Anthropic sytuuje nieco powyżej Haiku w trudnej pracy agentowej. Obie różnice działają w tę samą stronę w przypadku kosztu i w przeciwne strony w przypadku możliwości, dlatego żadnej z nich nie da się odczytać z cennika.
Karty stawek obok siebie
Oba modele są rozliczane według dwóch progów, a progi te znajdują się w różnych miejscach — co ma większe znaczenie niż stawka nagłówkowa, ponieważ obie stawki nagłówkowe są identyczne.
• Wejście — Claude Haiku 5.5 0,10 USD za milion do 100 000 tokenów, 0,50 USD powyżej. GPT-6 Luna 0,10 USD do 272 000 tokenów, 0,20 USD powyżej.
• Wyjście — Claude Haiku 5.5 0,50 USD do 100 000 tokenów, 2,50 USD powyżej tego. GPT-6 Luna 0,50 USD do 272 000 tokenów, 0,75 USD powyżej tego.
• Buforowanie — W modelu Claude Haiku 5.5 odczyt z pamięci podręcznej kosztuje 0,01 USD, a zapis 0,125 USD poniżej progu, natomiast 0,05 USD i 0,625 USD powyżej niego. W modelu GPT-6 Luna odczyt z pamięci podręcznej kosztuje 0,01 USD, a zapis 0,125 USD poniżej 272 000 tokenów, natomiast 0,02 USD i 0,25 USD powyżej tego progu.
• Kontekst i dane wyjściowe — 1 mln tokenów i 128 000 maksymalnych tokenów wyjściowych dla Claude Haiku 5.5; 1 050 000 tokenów przy limicie wejściowym 922 000 tokenów i 128 000 maksymalnych tokenów wyjściowych dla GPT-6 Luna.
• Myślenie — adaptacyjne w obu. Claude Haiku 5.5 domyślnie ustawia średni wysiłek; GPT-6 Luna domyślnie ustawia średni wysiłek i standardowy tryb, a tryb pro jako opcja dodatkowa.
• Rabaty za partie i buforowanie — Claude Haiku 5.5 oferuje 50% zniżki w Message Batches API; GPT-6 Luna oferuje 50% zniżki w trybach Batch i Flex, podwaja stawkę w trybie Fast i dolicza 10% dopłaty za przetwarzanie regionalne.
Jedyną linią, która nie ma tego samego kształtu, jest tokenizer. Dokumentacja Anthropic zauważa, że Claude Haiku 5.5 używa nowszego tokenizera współdzielonego z Claude 4.7 i późniejszymi, więc ten sam tekst liczy się jako około 30% więcej tokenów niż w Claude Haiku 4.5. To nie zmienia stawki; zmienia to, jak szybko prompt osiąga próg 100 000 tokenów, i jest to realna różnica kosztów, której nie pokazuje żadna tabela stawek. Prompt o długości 90 000 tokenów mierzy około 117 000 i płaci 0,50 USD za milion tokenów wejściowych zamiast 0,10 USD — pięciokrotna stawka za prompt, który wygląda, jakby bezpiecznie mieścił się poniżej progu.
Ile kosztuje tryb pro — w jedynych jednostkach, jakich ktokolwiek może użyć
Ponieważ mnożnik nie został opublikowany, warto podać, ile kosztuje każdy dodatkowy token, a następnie, jak zachowują się prawdopodobne zakresy przy dużych ilościach.
• Przy cenie GPT-6 Luna wynoszącej 0,50 USD za milion tokenów wyjściowych każde dodatkowe 10 000 tokenów wyjściowych na zadanie kosztuje 0,005 USD. Uruchom 100 000 zadań dziennie, a ten przyrost to miliard dodatkowych tokenów — około 500 USD dziennie, czyli 15 000 USD miesięcznie, w modelu, którego cena w nagłówku to dziesięć centów za milion tokenów wejściowych.
• Dla zobrazowania skali, GPT-6 Luna przy maksymalnym wysiłku zużywa już 140 milionów tokenów wyjściowych, uruchamiając Intelligence Index wobec mediany 100 milionów, co oceniający określa jako nieco rozwlekłe. Tabela premierowa Anthropic, uruchomiona na własnym harnessie Anthropic, daje GPT-6 Luna 16,4% w Terminal-Bench 4.0 i 42,4% w FrontierCode 1.1, wobec 39,2% i 46,4% dla Claude Haiku 5.5 — raportowane przez dostawcę, zestaw jednego dostawcy, model konkurenta.
• Na niezależnej tablicy rankingowej różnice w kolejności są mniejsze. Artificial Analysis przyznaje Claude Haiku 5.5 43 punkty przy Max effort w Intelligence Index v4.3.2, co daje drugie miejsce spośród 182, a GPT-6 Luna (Max) 38 punktów, co daje ósme miejsce spośród 182. Obie liczby pochodzą z trybu standardowego przy maksymalnym wysiłku. Nie ma niezależnej oceny GPT-6 Luna w trybie pro: jego strona nie zawiera wpisu dla trybu pro, a Artificial Analysis nie umieszcza takiego na swojej liście.
Problemem strukturalnym trybu pro jest interakcja między tymi dwoma ostatnimi punktami. Cała przewaga kosztowa GPT-6 Luna nad Claude Haiku 5.5 wynika z efektywności tokenowej — 140 milionów tokenów wyjściowych w porównaniu z 440 milionami dla tego samego zestawu testów, przy identycznych stawkach, dlatego ta sama ewaluacja kosztuje $0.07 za zadanie w jednym przypadku i $0.21 w drugim. Tryb pro jest z definicji trybem, który emituje więcej tokenów. Włączenie go wyłącza to, co czyniło model tanim w tym porównaniu, a mnożnik, który powiedziałby, o ile, nie jest publikowany. To nie jest argument, że tryb pro jest złym interesem — w przypadku trudnych zadań więcej pracy zwykle oznacza lepszą pracę — to argument, że tryb pro konkuruje możliwościami, a nie ceną, i należy go oceniać na tle modeli średniej klasy, do których poziomu cenowego jest zbliżony, a nie na tle taniej klasy, w której się znajduje.

Gdzie każdy z nich faktycznie wygrywa
Sprowadź to do samej decyzji, a podział jest czysty, choć żadna ze stron nie jest wolna od zastrzeżeń.
Claude Haiku 5.5 zajmuje tanią część rynku. Jest szybszy w obu istotnych znaczeniach: 241,9 tokena wyjściowego na sekundę według pomiaru Artificial Analysis w porównaniu ze 123,0 dla GPT-6 Luna oraz 295 sekund do pierwszego tokena w przebiegu Index, co jest wypadkową tego, jak długo myśli przed odpowiedzią przy maksymalnym wysiłku, a nie wartością sieciową. Jego cennik osiąga drugi próg przy 100 000 tokenów, a jego tokenizer zawyża prompty o około 30%, więc obciążenia z długimi promptami płacą więcej, niż sugeruje metka, pod oboma względami. W zamian daje pięciopunktową przewagę w inteligencji w niezależnym indeksie oraz pokrętło wysiłku — od Low do Max — które jest pojedynczym najużyteczniejszym mechanizmem kontroli kosztów, jaki którykolwiek z dostawców dołączył do tych premier. Ustawienie wysiłku na stałym poziomie pozwala wymienić część tej pięciopunktowej przewagi na koszt na zadanie bliższy temu GPT-6 Luna.
GPT-6 Luna Pro obsługuje najtrudniejszy skraj, ale z niepoliczonym rachunkiem. Sam model pod spodem jest tańszy za token powyżej 272 000 tokenów wejściowych, niż Claude Haiku 5.5 jest powyżej 100 000 — o czynnik dwa i pół na wejściu i trzy i jedną trzecią na wyjściu, a jego pierwszy próg sięga osiemnaście razy dalej w głąb okna kontekstu. Tryb standardowy jest mierzalnie tańszy na ukończone zadanie. Tryb Pro wymienia to na więcej pracy na odpowiedź przy tych samych stawkach, a czy bije Claude Haiku 5.5 przy ustawieniu Max albo model średniej klasy w danym zadaniu — na to pytanie nie odpowiada żadna opublikowana liczba. Sposób, by na nie odpowiedzieć, to uruchomić zadanie obiema drogami i odczytać pole tokenów rozumowania.

Próbowanie jednego lub drugiego bez obstawiania tego
Niezręczna część tego porównania polega na tym, że jego najważniejsza liczba — rzeczywisty koszt trybu pro — może zostać uzyskana tylko przez przepuszczenie przez niego własnego ruchu, a efektywny koszt mniejszego modelu zależy od tego, gdzie Twoje prompty trafiają względem granicy 100 000 tokenów po ponownej tokenizacji. Oba są problemami pomiarowymi i oba są tańsze na współdzielonym endpoincie niż w przypadku dwóch klientów różnych dostawców.
GPT-6 Luna jest dziś w katalogu OrcaRouter w cenie katalogowej dostawcy, z 0% narzutu przekazanego dalej, więc bazowy tryb standardowy dla tego porównania można wywołać jednym kluczem, a zmiana ceny u dostawcy trafia po naszej stronie tego samego dnia, a nie dopiero w kolejnym cyklu rozliczeniowym. Claude Haiku 5.5 nie ma jeszcze w katalogu; warstwa Anthropic, którą obecnie kierujemy, to Claude Haiku 4.5, Claude Sonnet 5.5 i Claude Opus 5.5, dzięki czemu test eskalacji z taniej odnogi w górę przez średnią warstwę to reguła routingu, a nie zmiana w kodzie. Automatyczny failover pod spodem to właśnie dzięki niemu model mający dwa dni może obsługiwać ruch produkcyjny, podczas gdy wciąż go mierzysz: dostawca, który zaczyna zawodzić, jest omijany, zamiast ściągać żądanie w dół — a to różnica między pilotażem, który możesz uruchomić w tym tygodniu, a przełączeniem, które musisz zaplanować.
Co to rozstrzyga
Trzy rzeczy, uszeregowane według tego, jak bardzo zmieniłyby odpowiedź. Gdyby OpenAI opublikowało mnożnik tokenów dla trybu pro albo slug „pro" z własną pozycją cenową, zamieniłoby to główną niewiadomą w arytmetykę. Gdyby Artificial Analysis ponownie uruchomiło GPT-6 Luna w trybie pro przy dopasowanym wysiłku, zrobiłoby to od strony niezależnej. A drugie niezależne uruchomienie Claude Haiku 5.5 przy ustawieniu medium, a nie Max, powiedziałoby ci, ile model faktycznie kosztuje przy swoim domyślnym ustawieniu — czyli w konfiguracji, którą wdroży większość ludzi. 0,21 USD za zadanie w zestawieniu to wartość dla wysiłku Max, a Max nie jest ustawieniem domyślnym.
Do tego czasu trafne podsumowanie jest wąskie. Claude Haiku 5.5 to model, który możesz wywołać, wycenić i zbenchmarkować już dziś, a przy wolumenach, dla których zbudowano jego klasę, jest tańszym rozwiązaniem z udokumentowanym sposobem na uzyskanie jeszcze niższej ceny. GPT-6 Luna Pro to konfiguracja modelu, który możesz wywołać; jego cennik nie jest problemem, jego zużycie tokenów nie podlega audytowi, a cały argument za nim opiera się na zadaniach tak trudnych, że chodzi właśnie o wydanie większej liczby tokenów. Kup go do tych zadań, zmierz go, zanim to zrobisz, i nie umieszczaj go na ścieżce o wysokim wolumenie, dopóki ktoś nie opublikuje mnożnika.

