
Pareto 26.10 Preview vs Pareto: Ten sam ciąg modelu, dwa różne modele
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 221 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 103 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Unbiased wypuściło Pareto 26.10 Preview 1 października 2026 r. i pozostawiło poprzednie wydanie, Pareto, wymienione obok. Te dwa nie są wariantami jednej rodziny, między którymi wybiera się flagą. To dwa wydania pod jedną marką, a ciąg modelu samego dostawcy — pareto — obecnie wskazuje na nowsze, jawnie niestabilne. Zatem pytanie porównawcze nie brzmi tak naprawdę „które jest lepsze”. Brzmi: do którego z nich faktycznie dociera twoje żądanie i co dzieje się z odpowiedzią, gdy to zmienia się pod tobą?
Jedynym miejscem, w którym oba są opisywane jednym tchem, jest publiczna specyfikacja techniczna modelu. Karta modelu, strona z cennikiem i FAQ samego Unbiased opisują jeden produkt złożony i nigdy nie wspominają o podziale. Ta asymetria — szczegółowy publiczny diff po jednej stronie, cisza po drugiej — jest uczciwym punktem wyjścia do bezpośredniego porównania, bo mówi, skąd pochodzi każda liczba poniżej.
Sześć wymiarów, obie strony
Wszystko, co różni te wydania, zawiera się w tych sześciu wierszach. Po lewej stronie znajduje się Pareto 26.10 Preview; po prawej — wydanie Pareto z 17 września, to, które tekst katalogowy wersji Preview nazywa stabilnym wyborem.
• Okno kontekstowe — 1 048 576 tokenów vs 262 144 tokeny. Czterokrotnie więcej miejsca, na papierze, przy czym żadna z opcji nie oferuje mniejszego wariantu.
• Maksymalne wyjście — 131 072 tokeny vs 131 072 tokeny. Bez zmian. Większe okno nie przyniosło większej odpowiedzi.
• Cena wejścia, zgodnie z routingiem — 0,80 USD za milion vs 2,50 USD za milion. Wersja zapoznawcza to około jednej trzeciej ceny w tym cenniku.
• Cena wyjścia, zgodnie z routingiem — 3,20 USD za milion vs 7,50 USD za milion. Mniej niż połowa.
• Wejście z pamięci podręcznej, zgodnie z routingiem — 0,03 USD za milion vs 0,25 USD za milion. Najdłuższe trajektorie agentów zyskują tu najwięcej.
• Opublikowany arkusz benchmarków — cztery wyniki, wyraźnie oznaczone jako „wstępne” i „mogą się zmienić przed ostateczną publikacją” vs brak jakiejkolwiek opublikowanej tabeli benchmarków.
Dwa z tych wierszy to te, które przesądzają o rzeczywistej pracy. Okno kontekstowe to najważniejsza informacja, której dostawca nie poda na własnej stronie — znajduje się w wykazie, a nie na karcie modelu — a cena wejścia z pamięci podręcznej to ta, która zmienia rachunek agenta, a nie jego pułap. Wszystko inne to albo delta marketingowa, albo — w przypadku wyniku dla wyjścia — przyznanie: publikowanie liczb wersji zapoznawczej z etykietą „wstępne” jest uczciwsze niż alternatywa, a jednocześnie jest też ostrzeżeniem.

Cena, którą widzisz, zależy od tego, gdzie patrzysz.
Zestaw obie karty stawek obok siebie, a one się nie zgadzają — i to jest właśnie ta część tego porównania, której nikt nie wyjaśnił.
Własna platforma Unbiased, w dniu, w którym 26.10 Preview stał się bieżącym wydaniem, nadal podaje 2,50 USD za milion tokenów wejściowych, 0,25 USD za tokeny z pamięci podręcznej i 7,50 USD za tokeny wyjściowe. To wrześniowe liczby, niezmienione, zarówno na stronie z cennikiem, jak i na karcie modelu. Niższy zestaw — 0,80 USD, 0,03 USD, 3,20 USD — pojawia się we wpisie routowanego katalogu dla tego samego preview. Zatem klient, który wywołuje pareto bezpośrednio przez API dostawcy, płaci według starej karty za nowy model, podczas gdy routowany wpis reklamuje około jednej trzeciej tej kwoty. Oba są aktywne. Dostawca nie opublikował żadnej daty zakończenia promocji ani oświadczenia, które by je uzgadniało.
To pytanie o kanał, a w wydaniu zapoznawczym to także kwestia czasu: niezależnie od tego, na której liczbie oprzesz modelowanie kosztów, ta druga dzieli od poprawności tylko jedna notka wydania. Router, który przekazuje dalej cenę listową dostawcy przy 0% marży, usuwa dokładnie to tarcie — zmiana ceny przez dostawcę obowiązuje tego samego dnia, a nie dopiero przy następnym przeglądzie umowy — i to jest jedyna rzecz strukturalna, którą warto zapożyczyć od OrcaRouter w tym przypadku. Nie mamy dziś w ofercie żadnego z dwóch wydań Unbiased, więc bezpośrednia odpowiedź na pytanie „gdzie mam to wywołać” to własne API Unbiased — na tym z dwóch zestawów cen, który akurat zawiera oferta, przez którą kupujesz. Powód, dla którego mówię to wprost, jest taki, że różnica jest trzykrotna, a wersja zapoznawcza nie jest miejscem, by odkrywać, że wyceniono niewłaściwy z nich.
Co daje ci podgląd i ile cię kosztuje
Opis katalogowy samej wersji zapoznawczej określa warunki: „może ulec zmianie bez powiadomienia”, a każdy, kto potrzebuje przewidywalnego działania, jest odsyłany z powrotem do wydania z września. To nie jest szablonowa formułka — to definicja produktu. Porównaj to z praktycznym kształtem długiej sesji agenta, a kompromis staje się konkretny.
Agent, który prowadzi rozmowę, gromadzi kontekst, a to właśnie w długich rozmowach buforowanie podpowiedzi (prompt caching) się opłaca. Zmieniony model pod niezmienionym punktem końcowym to klasyczny sposób, by to stracić: pamięć podręczna jest powiązana z modelem, który wygenerował tokeny, więc cicha podmiana wersji w połowie trajektorii może unieważnić to, co już zostało zbuforowane, i ponownie obciążyć pracę, którą uważałeś za już opłaconą. Własna dokumentacja Unbiased argumentuje ten punkt w przeciwnym kierunku — przedstawia swoją mieszankę jako stabilną pod względem pamięci podręcznej, podczas gdy router przełączający taki nie jest — więc jest to ryzyko, które dostawca dobrze rozumie i po prostu akceptuje w zamian za udostępnienie wersji zapoznawczej. Warto je nazwać, ponieważ awaria jest niewidoczna w panelu: tokeny nadal są rozliczane, odpowiedzi nadal wracają, a liczba jest po prostu większa niż w zeszłym tygodniu.
Zalety wersji zapoznawczej są realne i mają swoje odzwierciedlenie w wadach. Czterokrotnie większy kontekst, buforowane dane wejściowe w cenie jednej ósmej stawki wydania stabilnego na liście trasowanej i w ogóle arkusz z wynikami benchmarków — wrześniowe wydanie nigdy nie miało publikowanych wyników. Jeśli Twoje obciążenie jest długokontekstowe i wrażliwe na koszty, wersja zapoznawcza jest tą, której chcesz, a sposobem na skorzystanie z niej bez stawiania całego stacku na jedną kartę jest świadome przypięcie jej: nazwany endpoint dla wersji zapoznawczej, nazwany endpoint dla wydania stabilnego i fallback między nimi skonfigurowany raz. DSL trasowania istnieje dokładnie dla takiego kształtu problemu — złóż oba jako osobne odnogi, skieruj do każdej wycinek rzeczywistego ruchu i pozwól dziennikowi żądań powiedzieć ci, co każde z nich faktycznie robi. Wersja zapoznawcza powinna być decyzją, którą można cofnąć jedną linią konfiguracji, a nie właściwością twojego endpointu, którą odkrywasz na podstawie faktury.

Obraz wydajności, który nie jest wystarczająco stabilny, by mu zaufać
Wszystkie powyższe wartości pochodzą z publicznego wykazu, a własny panel wydajności tego wykazu zmieniał się między odczytami w dniu premiery. Jeden odczyt strony 26.10 Preview wskazywał medianę opóźnienia 5,28 sekundy i 35 tokenów na sekundę; opublikowany tego samego dnia widok porównawczy podawał 3,54 sekundy i 21 tokenów na sekundę dla wersji zapoznawczej oraz 1,05 sekundy i 45 tokenów na sekundę dla wydania wrześniowego. To nie są małe rozbieżności. Zupełnie nowy model obsługiwany przez jednego dostawcę ma wąską podstawę pomiarową, a przesuwane okno obejmujące godziny będzie się zmieniać.
Uczciwe stanowisko jest takie, że żadne z tych wydań nie ma wskaźnika przepustowości ani opóźnienia na tyle stabilnego, by planować na jego podstawie, a w przypadku wersji zapoznawczej jest to wbudowane w produkt, a nie problem z pojedynczym pomiarem. Wydanie z września ma przynajmniej za sobą tygodnie ruchu — jego oferta pokazuje wielodniową dostępność na poziomie wysokich dziewięćdziesiątek procent, z pełną historią dostawcy w tle. Wersja zapoznawcza ma za sobą godziny. Jeśli powodem wyboru między nimi jest szybkość, a nie cena lub kontekst, dowody, na których można oprzeć wybór, jeszcze nie istnieją, a odpowiedzialnym krokiem jest zmierzenie na własnych promptach, a nie odczytywanie liczby z którejkolwiek strony.

Do którego zadzwonić i jak przestać się przejmować
Wywołaj wersję zapoznawczą, jeśli Twoja praca jest długokontekstowa, wrażliwa na koszty i poddaje się ocenie — sesje agentów, przetwarzanie wsadowe, cokolwiek, gdzie czterokrotnie większe okno i jedna trzecia ceny danych wejściowych rekompensują ryzyko zmiany w połowie tygodnia. Traktuj to jako próbę z linią konfiguracji pod spodem i zapisuj własne liczby, bo liczby dostawcy się zmienią.
Wybierz stable Pareto, jeśli Twoje obciążenie jest produkcyjne, wrażliwe na opóźnienia lub objęte przeglądem zgodności, który nie chce modelu opisywanego jako mogący zmienić się bez powiadomienia. Rezygnujesz z okna 1M, tańszego cache'u i publikowanych wyników; zachowujesz endpoint z udokumentowanymi osiągnięciami i nazwę, która w przyszłym tygodniu będzie znaczyć to samo. Dla wielu zespołów to wszystko, czego potrzeba.
Błędem jest traktowanie tego jako trwałego rozgałęzienia. Unbiased stworzył ten podział jako tymczasowy — wersja zapoznawcza istnieje po to, by ją oceniono, a następnie wchłonięto — a decyzja, która ma znaczenie, nie dotyczy tego, którą z dwóch wybierzesz, lecz tego, czy przełączanie się między nimi to pięciominutowa zmiana, czy kwartalny projekt. Na jednym endpoincie z jednym ciągiem modelu obecnie nie jest to ani jedno, ani drugie: to ogłoszenie, które trzeba wychwycić. Skonfiguruj ten wybór zamiast tego jako decyzję o routingu, a wersja, którą wywołujesz, stanie się pokrętłem — a to jedyna postawa, jaką wydanie zapoznawcze kiedykolwiek naprawdę nagradzało.
