
Claude Haiku 5.5 kontra PPLX 27B: 0,00 USD za token to nie to samo co za darmo
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
PPLX 27B nie kosztuje nic za token. Działa lokalnie, na sprzęcie, który posiadasz, a gdy sprzęt został już kupiony, koszt krańcowy kolejnego tokenu naprawdę wynosi zero. Claude Haiku 5.5 kosztuje 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion wyjściowych — liczba to na tyle mała, że warto porządnie wykonać odejmowanie, zamiast przyjmować oczywisty wniosek. Maszyna zdolna dobrze uruchomić PPLX 27B to mniej więcej 4500 USD kosztujący DGX Spark albo komputer stacjonarny z kartą RTX o pamięci 24 GB lub większej, a 4500 USD w tokenach wyjściowych Claude Haiku 5.5 to około dziewięciu miliardów takich tokenów. Zatem pytanie, które tak naprawdę stawia to starcie, nie brzmi, co jest tańsze. Brzmi: ile tokenów spodziewasz się zużyć i czy odpowiedź na to zmienia się dlatego, że tokeny leżą na twoim biurku.
Claude Haiku 5.5 to mały model dostawcy, wydany 7 października 2026 r. PPLX 27B został ogłoszony przez Perplexity 25 sierpnia 2026 r. wraz z Portable Computer, zbudowanym z wykorzystaniem NVIDIA, i jest wersją modelu Qwen 3.8 27B o otwartych wagach poddaną dodatkowemu treningowi, dostrojoną do własnego środowiska uruchomieniowego Perplexity. Żaden z nich nie jest bezpośrednim zamiennikiem drugiego i żaden nie znajduje się w katalogu OrcaRouter.
Dwa modele i dlaczego jeden z nich mieszka na twoim biurku
Claude Haiku 5.5 — ID claude-haiku-5-5, dane wejściowe: tekst i obraz, dane wyjściowe: tekst, kontekst 1 mln tokenów, maksymalna długość wyjścia 128 000 tokenów z 300 000-tokenową ścieżką beta w Batch API, granica danych treningowych czerwiec 2026 r. oraz zobowiązanie, że nie zostanie wycofany przed 7 października 2027 r. Parametr Effort działa od Low do Max, domyślnie Medium; myślenie adaptacyjne jest domyślnie włączone; odczyty z pamięci podręcznej kosztują 0,01 USD za milion tokenów, a Batch obniża stawkę o połowę. To produkt hostowany: wysyłasz tokeny, otrzymujesz tokeny, nigdy nie widzisz GPU.
PPLX 27B — gęsty model o 27 miliardach parametrów oparty na Qwen 3.8 27B i poddany treningowi końcowemu pod własny harness agentowy Perplexity. Działa wewnątrz Portable Computer na DGX Spark lub na maszynie z systemem Linux z kartą NVIDIA RTX o 24 GB lub większej i nie opuszcza tej maszyny. Tryb hybrydowy dodany 1 września 2026 r. łączy go z modelem chmurowym do cięższych zadań za pośrednictwem działającej na urządzeniu bramki Privacy Gate; wsparcie dla RTX w systemie Linux pojawiło się 3 września; wsparcie dla kart RTX o 24 GB i większej w systemie Windows pojawiło się 14 września wraz z lokalnym MCP i zaplanowanymi zadaniami. Wagi po treningu końcowym są zastrzeżone i dostępne w ramach subskrypcji Perplexity Pro lub Max.

• Wymiary, każdy w jednej linii
• Koszt krańcowy na token — Claude Haiku 5.5: 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych przy promptcie do 100 tys. tokenów, potem 0,50 USD i 2,50 USD; PPLX 27B: nic, gdy sprzęt zostanie już opłacony.
• Koszt rozpoczęcia — nic ponad klucz API do Claude Haiku 5.5; około 4500 USD za DGX Spark lub komputer stacjonarny z kartą NVIDIA RTX o pojemności 24 GB lub większej, dla PPLX 27B.
• Okno kontekstu — 1 000 000 tokenów dla Claude Haiku 5.5 wobec około 262 144 tokenów odziedziczonych z Qwen 3.8 27B.
• Maksymalne wyjście — 128 000 tokenów dla Claude Haiku 5.5, z nagłówkiem beta 300 000 tokenów w Batch; nie opublikowano dla PPLX 27B.
• Dokąd trafiają dane — chmura Anthropic kontra twoja własna maszyna, a Privacy Gate w trybie hybrydowym decyduje, co ją opuszcza.
• Niezależny wynik — Artificial Analysis Intelligence Index 43 dla Claude Haiku 5.5, w konfiguracji Max 43,40, drugie miejsce spośród 182; dla PPLX 27B nic nie opublikowano, ponieważ Artificial Analysis go nie śledzi.
• Szybkość generowania — 243,4 tokena na sekundę dla Claude Haiku 5.5; zależy od Twojego GPU w przypadku PPLX 27B i nie można jej porównywać bez opublikowanej wartości.
• Modalności wejściowe — tekst i obrazy w zestawieniu z tekstem, odziedziczone z multimodalnej podstawy.
• Wagi — zastrzeżone w obu przypadkach, ale z różnych powodów: brak udostępnionych wag versus ograniczony post-train, do którego pozyskania wymagana jest subskrypcja.
Sprzęt to cena, a cena to test uczciwości.
„Darmowe” to niewłaściwe słowo w przypadku lokalnego wnioskowania i dostawcy doskonale o tym wiedzą, dlatego podawana liczba to zawsze koszt krańcowy. Właściwym porównaniem jest próg rentowności: maszyna za 4500 dolarów przy cenie Claude Haiku 5.5 wynoszącej 0,50 dolara za milion tokenów wyjściowych równa się dziewięciu miliardom tokenów wyjściowych, zanim sprzęt się zwróci. Zespół generujący sto milionów tokenów wyjściowych miesięcznie osiąga ten punkt po około siedmiu i pół roku, a do tego czasu GPU będzie przestarzały. Zespół generujący pięć miliardów miesięcznie osiąga go w mniej niż dwa miesiące.
Obie odpowiedzi są poprawne i są poprawne w przypadku różnych firm. Właśnie dlatego tego porównania nie da się rozstrzygnąć na podstawie specyfikacji i dlatego też powyższa arytmetyka pomija wszystko, co sprawia, że lokalna inferencja jest kosztowna w praktyce: energię elektryczną, miejsce w szafie rack, osobę odpowiedzialną za aktualizacje sterowników oraz fakt, że maszyna na biurku jest pojedynczym punktem awarii, chyba że kupiłeś dwie. Dodaj te czynniki, a próg opłacalności oddali się jeszcze bardziej.
To, co za te pieniądze daje lokalne wnioskowanie, to wcale nie koszt. To gwarancja, że prompt nigdy nie opuszcza murów firmy — a dla zespołu z branży prawnej, medycznej czy związanej z obronnością jest to warte więcej niż jakakolwiek stawka za token, i żaden rabat oferowany przez Anthropic tego nie zastąpi. I odwrotnie: kontekst 1M tokenów oraz limit wyjścia 128 000 tokenów w Claude Haiku 5.5 to coś, czego za żadne pieniądze nie kupisz na karcie 24GB, a maszyna za 4 500 dolarów tego nie zmieni.
Co faktycznie mierzy 85,4%
Opublikowany przez Perplexity wynik dla PPLX 27B wynosi 85,4% w jego własnym Local Knowledge Work Bench składającym się z 53 zadań, w porównaniu z 82,6% dla tego samego zestawu testowego uruchomionego na niedostrojonej bazie Qwen 3.8 27B, 77,6% dla Pi i 74,0% dla Hermes. Trzy rzeczy na ten temat zasługują na powiedzenie wprost, ponieważ relacje z premiery na ogół ich nie podały.
Jest to wynik raportowany przez dostawcę i nie został niezależnie odtworzony. To porównanie na własnym środowisku testowym dostawcy, które jest możliwie najsprawiedliwszym testem dla modelu dotrenowanego na tym środowisku — przewaga nad modelem bazowym jest częściowo przewagą w dopasowaniu do testu. Mierzy ono konkretnie lokalną pracę z wiedzą: wyszukiwanie, streszczanie, obsługę dokumentów — zadania, do których stworzono Portable Computer. Nie jest to ogólny wynik możliwości i nie należy go tak odczytywać.
Model bazowy to inna sprawa. Qwen 3.8 27B jest gęsty, licencjonowany na Apache-2.0, multimodalny i wydany 14 sierpnia 2026 r. z natywnym oknem kontekstowym 262 144 tokenów, a Artificial Analysis ocenia jego konfigurację rozumowania na Intelligence Index 44 — o punkt powyżej 43,40 Claude'a Haiku 5.5, w innej cenie. PPLX 27B to ten model plus post-training Perplexity, więc uczciwy odczyt jest taki, że bazowe wagi mieszczą się w paśmie możliwości Claude'a Haiku 5.5, a dostrajanie przesunęło je w stronę obciążenia jednego dostawcy. To, którą z tych dwóch rzeczy kupujesz, jest pytaniem, na które 85,4% ma celowo nie odpowiadać.
Gdzie Claude Haiku 5.5 wygrywa bez potrzeby benchmarku
Długi kontekst, po pierwsze: 1 mln tokenów w porównaniu z około 262 tys. oraz 128 000 tokenów maksymalnego wyjścia w porównaniu z niepublikowaną liczbą. Wejście obrazowe, po drugie, które posiada linia Qwen 3.8, ale którego harness Perplexity nie reklamuje. Kontrola wysiłku, po trzecie, i to ta niedoceniana — ustawienie Low istnieje specjalnie po to, aby można było przestać płacić za tokeny rozumowania przy wywołaniach, które ich nie potrzebują; to dźwignia kosztowa, której nie oferuje żaden lokalny model, ponieważ nie ma rachunku do obniżenia.
A dostępność – po czwarte. Claude Haiku 5.5 to ciąg znaków modelu w API, a niezależne liczby istnieją: Intelligence Index 43 ogółem i 43,40 przy Max effort, drugi wynik spośród 182, przy $0,21 za zadanie indeksowe i 243,4 tokenów wyjściowych na sekundę, z około 0,3 sekundy do pierwszego tokenu. Kiedy decydujesz, czy obciążenie jest gotowe do przeniesienia, opublikowany wynik, którego nie obliczyłeś samodzielnie, jest wart więcej niż szybsza liczba, którą sam uzyskałeś.

Gdzie PPLX 27B wygrywa, nie potrzebując benchmarku
Prywatność jest pierwsza i najważniejsza: tokeny nigdy nie opuszczają maszyny, czego żaden hostowany model nie jest w stanie dorównać. Drugi jest koszt przy dużej skali — staje się realny po przekroczeniu kilku miliardów tokenów wyjściowych miesięcznie. Trzeci to tryb offline — laptop w piwnicy bez połączenia wciąż odpowiada, a Claude Haiku 5.5 już nie. A tryb hybrydowy dodany 1 września to najciekawsze rozwiązanie w produkcie: model lokalny wykonujący rutynową pracę wraz z modelem chmurowym za bramką działającą na urządzeniu przy trudnych przypadkach to dokładnie sposób na połączenie prywatności i możliwości — i to architektura, którą większość zespołów powinna kopiować niezależnie od tego, od którego dostawcy ją czerpie.
PPLX 27B nie oferuje przenośnego rozwiązania. Jest powiązany z Portable Computer, wymaga subskrypcji, aby uzyskać wagi, a wagi są pochodną cudzego modelu — więc licencja, którą faktycznie posiadasz, jest licencją Perplexity, a nie Apache-2.0. Jeśli celem jest model, który możesz sforkować i wdrożyć, bazowy Qwen 3.8 27B ma permisywną licencję, ale to inny model niż ten, którego dotyczy ten artykuł.

Uruchamianie któregokolwiek z nich za pomocą jednego klawisza i gdzie to się zatrzymuje
PPLX 27B w ogóle nie jest udostępniany przez API: działa wewnątrz Portable Computer na własnym sprzęcie, a tryb hybrydowy sięga po model w chmurze wybrany przez Perplexity po drugiej stronie Privacy Gate. Claude Haiku 5.5 jest dostępny przez własne API Anthropic, a stamtąd — wszędzie tam, gdzie modele Anthropic są odsprzedawane. Żaden z nich nie znajduje się w katalogu OrcaRouter i nie będziemy sugerować inaczej — to, co kierujemy z tych dwóch rodzin, to anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 i anthropic/claude-fable-5.1, a osobno baza Qwen 3.8 27B, z której PPLX 27B jest dotrenowywany, która znajduje się w katalogu pod adresem qwen/qwen3.8-27b i jest hostowana samodzielnie na naszej własnej infrastrukturze.
Ten ostatni punkt jest tym praktycznym. Jeśli powodem, dla którego przyglądałeś się PPLX 27B, były znajdujące się pod nim wagi Qwen 3.8 27B, a nie lokalne uruchamianie, możesz mieć model bazowy przez jedno API obsługujące ponad 200 modeli, z jednym kluczem i jednym rachunkiem, z ceną katalogową dostawcy przekazywaną dalej przy 0% marży i automatycznym przełączaniem awaryjnym między dostawcami pod spodem. Jeśli tak naprawdę potrzebujesz, żeby prompt nigdy nie opuszczał maszyny, żadna brama nie jest odpowiedzią, a Portable Computer jest.
Decyzja, bez udawania, że liczby ją rozstrzygają
Jeśli Twoje prompty nie mogą opuścić Twojej infrastruktury, PPLX 27B jest jedynym z tych dwóch, który istnieje dla Ciebie, a 4500 USD nie jest porównaniem kosztów — to cena ograniczenia, którego nie możesz wynegocjować. Jeśli przepalasz więcej niż kilka miliardów tokenów wyjściowych miesięcznie, lokalne rozwiązanie zwraca się w ciągu kwartału, a potem nadal się opłaca.
Jeśli żadne z tych dwóch nie jest prawdą, Claude Haiku 5.5 jest lepszym zakupem przy niemal każdym wolumenie: żadnego sprzętu, żadnych operacji, okno 1 mln tokenów, limit wyjściowy 128 000 tokenów, wejście obrazowe, pokrętło wysiłku, które na żądanie obniża koszt, opublikowany niezależny wynik na poziomie 43 oraz cena 0,10 USD i 0,50 USD za milion, przy której próg opłacalności względem stacji roboczej wypada przy około dziewięciu miliardach tokenów. Wartość 0,00 USD za token jest prawdziwa. To po prostu nie całe odejmowanie.
Jeśli powodem, dla którego patrzyłeś na PPLX 27B, były leżące u jego podstaw wagi Qwen 3.8 27B, a nie lokalne wykonywanie, możesz mieć model bazowy przez jedno API dla ponad 200 modeli, jeden klucz i jeden rachunek , z ceną katalogową dostawcy przekazywaną przy 0% narzutu i automatycznym przełączaniem awaryjnym między dostawcami pod spodem.
