
Claude Fable 5 jako Twój orkiestrator: Podręcznik subagentów, który obniża koszty tokenów
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
7 sierpnia Anthropic wprowadził największą pojedynczą zmianę w Claude Fable 5 od czasu premiery modelu 9 czerwca: ograniczył „fallbacki” związane z biologią o około 85%, dzięki czemu codzienne pytania dotyczące zdrowia i edukacji otrzymują teraz bezpośrednią odpowiedź, zamiast po cichu przełączać się na słabszy model. Jednak wzorzec, który w tym tygodniu faktycznie rozprzestrzenia się w społeczności Claude Code, nie ma nic wspólnego z biologią. Praktycy wciąż publikują workflow, w którym Claude Fable 5 prowadzi pętlę orkiestracji — doprecyzowanie wymagań, dekompozycję planu, przydzielanie zadań, akceptację wyników — podczas gdy wykonanie jest przekazywane subagentom Claude Opus 5. Deklarowany zysk: Fable 5 High staje się niedrogim domyślnym ustawieniem sesji, a gadatliwość Claude Opus 5 przestaje drenować sesję.
Najnowszym przykładem jest @dotey, opublikowany 14 sierpnia: krótki dopisek do ~/.claude/CLAUDE.md, który każe agentowi otwierać subagentów Opus do wykonywania zadań, pozostawiając Claude Fable 5 z wysokim poziomem rozumowania jako domyślne ustawienie sesji, przy czym autor podaje, że zużycie tokenów pozostaje rozsądne — oraz podaje bezpośredni powód, dla którego nie uruchamia Claude Opus 5 jako domyślnego: w jego rękach był zbyt wolny i spalał ogromną liczbę tokenów w głównej pętli. To odkrycie społeczności, a nie wytyczne Anthropic — i warto to zrozumieć, zanim to skopiujesz, bo z pozoru wygląda to odwrotnie.
Wzorzec w jednym akapicie. W Claude Code subagenci domyślnie dziedziczą model sesji, więc sposobem na utrzymanie szybkiej i taniej pętli jest uczynienie modelu sesji planistą i jawne wskazanie wykonawcom innego modelu. Claude Fable 5 — model klasy Mythos od Anthropic przystosowany do bezpiecznego, powszechnego użytku, wydany 9 czerwca 2026 r. w cenie 10/50 dolarów za milion tokenów — przechowuje wymagania, rozkłada pracę na części, rozdziela zadania i przyjmuje wyniki. Claude Opus 5 — wydany 24 lipca 2026 r. w cenie 5/25 dolarów za milion tokenów — wykonuje faktyczne implementacje w subagentach. Na kilka tur orkiestracji wykorzystujesz osąd klasy Fable, a na wiele tur wykonawczych — wykonanie klasy Opus, na które i tak trafia większość tokenów.
Dlaczego model głównej pętli jest prawdziwym problemem kosztowym.
W testach porównawczych wygląda to na rozwiązany problem — a odpowiedź brzmi: „domyślnie Opus 5”. Własne liczby firmy Anthropic (raportowane przez producenta, niepotwierdzone) pokazują, że Claude Opus 5 ma przewagę nad Claude Fable 5 w agentycznym benchmarku kodowania Frontier-Bench v0.1 (43,3% wobec 33,7%), w SWE-bench Verified (96,0% wobec 95,5%) oraz w ARC-AGI-3 (30,2%, czyli mniej więcej 4-krotnie więcej niż kolejny najlepszy publiczny model). Anthropic pozycjonuje model Opus 5 jako zbliżający się do inteligencji granicznej modelu Fable 5 za połowę ceny. Jeśli wybierasz domyślny model sesji wyłącznie na podstawie benchmarków producenta i ceny za token, Opus 5 jest oczywistym wyborem.
Praktycy, którzy naprawdę prowadzą długie sesje, przyjmują przeciwne ustawienie domyślne, a powodem są tokeny na zadanie, a nie cena za token. Tryb myślenia Opus 5 jest domyślnie włączony i adaptacyjny, a Anthropic twierdzi, że model weryfikuje własną pracę bez monitowania — co w praktyce oznacza, że każda iteracja pętli generuje znacznie więcej tokenów niż w przypadku Fable 5. Wyłączenie tego myślenia jest ograniczone do wysokiego nakładu pracy, więc nie można go całkowicie odchudzić. W sesji trwającej godziny to pętla się kumuluje: model, który jest najtańszy za token, może okazać się najdroższy w przeliczeniu na sesję, a model, który mówi najmniej, utrzymuje pętlę szybką.
To zgadza się z tym, co raportuje @dotey. Odwrócona konfiguracja utrzymuje zużycie tokenów na „niezłym” poziomie właśnie dlatego, że Opus 5 — ten gadatliwy — jest odizolowany do podagentów, gdzie jego wynik jest produktem dostarczanym, a nie narzutem.
Odwrócona architektura: Fable 5 planuje, Opus wykonuje
Architektura jest prosta do opisania i odrobinę nieintuicyjna w działaniu:
• Model sesji — Claude Fable 5 przy wysokim nakładzie rozumowania (to „High" w skrócie społeczności „Fable 5 High"). Odpowiada za rozmowę, plan i definicję ukończenia.
• Tury orkiestracji — doprecyzowanie wymagań, dekompozycja planu, przydział zadań i akceptacja wyników — wszystko odbywa się na Fable 5. To zaledwie kilka tur i niewielka część wszystkich tokenów.
• Tury wykonawcze — każde zadanie jest przekazywane podagentowi działającemu na Claude Opus 5. To właśnie te tury stanowią większość zużycia tokenów — a Opus 5 osiąga najwyższe raportowane przez dostawcę wyniki agentowe.
Ekonomika działa, ponieważ obie krzywe kosztów wskazują w różnych kierunkach. Mocną stroną Fable 5 jest osąd; używasz go oszczędnie. Mocną stroną Opus 5 jest wykonanie; używasz go intensywnie, ale równolegle, w izolacji od pętli. Pętla pozostaje szybka i tania, a kosztowna zdolność jest zużywana dokładnie tam, gdzie i tak zużywane są tokeny.
To jeden z dwóch wzorców społecznościowych w obiegu i są one swoimi lustrzanymi odbiciami. Częściej zalecany „wzorzec architekta” (stosowany na przykład przez wtyczkę fable-advisor) uruchamia Opusa jako architekta na pełen etat i rezerwuje Fable 5 dla najbardziej złożonych ścieżek implementacyjnych oraz obowiązkowego przeglądu na koniec dostarczanego elementu. Różnica to cel optymalizacji: wzorzec architekta wydaje tokeny klasy Opus na koordynację i używa Fable 5 jak skalpela; wzorzec odwrócony używa Fable 5 do koordynacji, a Opus 5 do wolumenu. Obie to wskazówki społeczności — Anthropic nie dokumentuje żadnej z nich — i obie są próbami wydawania tokenów granicznych tam, gdzie zmieniają one wynik.
Konfiguracja w Claude Code
Claude Code nie ma wbudowanego „trybu orkiestratora”, więc ten wzorzec jest egzekwowany na dwa sposoby: przez instrukcje w prompcie sesji oraz przez jawne przypięcia modeli po stronie wykonania.
Warstwa instrukcji znajduje się w ~/.claude/CLAUDE.md — tym samym pliku, który edytował @dotey. Zasadniczo prompt nakazuje głównemu agentowi wykonanie czterech rzeczy przed uznaniem jakiegokolwiek zadania za zakończone:
• Powtórz wymaganie i potwierdź zakres przed napisaniem kodu.
Podziel pracę na zadania, które mogą być wykonywane równolegle.
• Przydziel każde zadanie wykonawcze subagentowi przypisanemu do Claude Opus 5.
• Zweryfikuj każdy wynik z planem przed jego zaakceptowaniem.
Taki kształt warto przedstawić jako wskazówkę, a nie jako fragment do wklejenia — Twoje wymagania i Twój stos technologiczny zmieniają to, co powinno się w nim znaleźć.
Warstwa modelu ma większe znaczenie, niż zakłada większość konfiguracji. W Claude Code kolejność ustalania modelu subagenta jest następująca: zmienna środowiskowa CLAUDE_CODE_SUBAGENT_MODEL, następnie parametr modelu przekazywany przy wywołaniu, potem frontmatter definicji agenta, a na końcu model sesji. Agenci bez ustawionego modelu dziedziczą model sesji. Jeśli więc Twoja sesja działa na Fable 5, a Ty polegasz na argumencie modelu w narzędziu Agent, istnieje udokumentowane ryzyko, że zostanie on zignorowany (GitHub issue #83920): subagenci i tak dziedziczą model sesji, a Ty płacisz stawkę Fable 5 za wykonywanie, które zamierzałeś uruchomić na Opus 5.
Dwa niezawodne rozwiązania: ustaw CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 dla sesji albo przypnij model w frontmatterze subagenta. Ta jedna zmienna decyduje o tym, czy wzorzec działa zgodnie z przeznaczeniem, czy po cichu uruchamia całą sesję na drogim modelu.
Matematyka tokenów stojąca za podziałem
Oto dwa modele w dzisiejszych cenach (ceny opublikowane przez producenta, przekazywane po cenie katalogowej w OrcaRouter):
• Claude Fable 5 — $10 za 1M tokenów wejściowych, $50 za 1M wyjściowych; kontekst 1M tokenów, 128K wyjściowych.
• Claude Opus 5 — $5 za 1 mln tokenów wejściowych, $25 za 1 mln tokenów wyjściowych; kontekst 1 mln tokenów, 128 tys. tokenów wyjściowych.

Kontrintuicyjne jest to, że Opus 5 kosztuje połowę ceny za token, a mimo to może przegrać grę kosztową w przeliczeniu na sesję. Kształt tej zależności łatwo zobaczyć na przybliżonych liczbach: jeśli pętla na Opusie 5 generuje od dwóch do trzech razy więcej tokenów niż pętla na Fable 5 — liczba poglądowa, zgodna z doniesieniami praktyków o samoweryfikacyjnym zachowaniu Opusa 5, a nie zmierzona — to nawet przy połowie stawki za token koszt pętli jest mniej więcej taki sam, a jeśli różnica jest większa, Opus w pętli kosztuje więcej. Tymczasem tokeny wykonawcze, stanowiące większość sesji, w obu przypadkach pozostają na Opusie 5 w subagentach po tańszej stawce.
To cały argument za odwróconym wzorcem: umieść w pętli model, którego cena za token jest wyższa, ale którego pętla jest lżejsza, a na wolumenie umieść model tańszy za token. To decyzja dotycząca routingu przebrana za decyzję dotyczącą modelu.
Ponieważ OrcaRouter przekazuje ceny dostawców z 0% narzutem, powyższe liczby to dokładnie to, co faktycznie tu płacisz — bez dodatkowej opłaty platformowej — a jeśli Anthropic obniży którąkolwiek z cen, zmiana pojawia się na stronie modelu tego samego dnia.
Kiedy odwrócony wzorzec się sprawdza — a kiedy nie
Kopiowanie konfiguracji @dotey bez sprawdzenia kształtu własnego obciążenia to błąd w obie strony.
Odwrócony wzorzec wygrywa, gdy:
Wymagania są niejednoznaczne lub plan ma wiele ruchomych elementów — zdolność orkiestracji jest zasobem deficytowym.
• Wykonanie może być zrównoleglone do podagentów — wolumen opuszcza pętlę.
• Sesje są długie — rozwlekłość pętli kumuluje się w realny koszt.
Standardowa porada wygrywa, gdy:
• Większość Twojej sesji to ograniczona, mechaniczna praca — planer klasy Fable to przesada, a niższa cena i wyższe wyniki benchmarków Opusa 5 czynią go oczywistym wyborem domyślnym. Dlatego własna dokumentacja Claude Code ustawia Opusa jako domyślnego dla sesji, a Fable 5 pozostawia do jawnego wyboru.
• Nie można niezawodnie przypinać modeli subagentów — błąd dziedziczenia #83920 zamienia odwrócony wzorzec w „wszystko w cenniku Fable 5”.
Istnieje również środkowa ścieżka dostrajania. Opus 5 udostępnia parametr effort (od low do max, domyślnie high), więc można go przesunąć w stronę oszczędniejszego zachowania — ale nie do końca, ponieważ wyłączenie myślenia jest ograniczone do wysokiego wysiłku. Jeśli problemem jest rozwlekłość Opusa 5, zmniejszenie effort może wystarczyć i nie trzeba wcale odwracać architektury.
Co zmiana biologiczna z 7 sierpnia oznacza dla tej konfiguracji
Aktualizacja firmy Anthropic z 7 sierpnia przepisała i ponownie wytrenowała klasyfikator biologiczny modelu Claude Fable 5 — system, który decyduje, czy zapytanie wywołuje „fallback” do mniej wydajnego modelu. Według własnych danych firmy Anthropic (raportowanych przez dostawcę) liczba fallbacków związanych z biologią spadła o około 85% na wszystkich powierzchniach produktowych, a ogólna liczba fallbacków zmniejszyła się o ~67% w Claude.ai, ~55% w Cowork, ~17% w Claude Code i ~7% na Claude Platform.

Dla konfiguracji orkiestracji Fable 5 liczy się numer Claude Code. Fallback to sytuacja, w której system po cichu przełącza twoje zapytanie na inny model — w tym przypadku na Opus 5. W zwykłym czacie to niewidzialne tarcie; w sesji agentowej oznacza, że część twojego potoku działa na modelu, którego nie wybrałeś, i przy kosztach, których nie planowałeś. Aktualizacja tego nie usuwa: wirusologia, toksykologia i projektowanie molekularne nadal korzystają z fallbacku. Ale codzienna biologia zdrowotna i edukacyjna — odczytywanie wyników badań, rozumienie objawu, nauka biologii — pozostaje teraz na Fable 5.
Jedna uwaga wyprzedzająca, wyraźnie oznaczona: niepotwierdzone doniesienia z końca lipca (36kr, WinCentral) wskazują na możliwe odświeżenie Claude Fable 5.1 w tym miesiącu przy niezmienionej cenie. Anthropic nie potwierdził ani nazwy, ani daty, ani identyfikatora modelu API — traktuj to jako spekulację, dopóki się nie ukaże.
Wypróbuj to bez stawiania na szali swojego przepływu pracy
To, co sprawia, że odwrócony wzorzec warto wypróbować, to jego odwracalność, a kierowanie obu modeli przez jeden punkt końcowy sprawia, że odwrócenie jest tanie.
Na OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) i Claude Opus 5 (anthropic/claude-opus-5) działają za jednym kluczem API. Możesz uruchomić ścieżkę wykonania sesji na dowolnym z tych modeli bez zawierania drugiej umowy ani zmiany kodu — co jest dokładnie tym, czego potrzebuje eksperyment w rodzaju „Fable 5 jako orchestrator”, ponieważ cały sens polega na zmierzeniu własnego kosztu na sesję, zanim się zobowiążesz.

Dwie funkcje OrcaRouter przekładają się bezpośrednio na tę konfigurację. Automatyczny failover pozwala zdefiniować łańcuch rezerwowy — jeśli Fable 5 zwróci błąd lub przekroczy limit czasu, żądanie jest kierowane do Opus 5 lub tańszego modelu, zamiast kończyć się niepowodzeniem. A DSL routingu może złożyć tę parę w jedno wywołanie: krok planowania Fable 5, po którym następują kroki wykonawcze Opus 5, za jednym endpointem. To wzorzec orkiestracji wyrażony jako infrastruktura, a nie jako dyscyplina promptowania.
Sedno sprawy
Odwrócona architektura — Claude Fable 5 planuje, Claude Opus 5 wykonuje — to realna, działająca odpowiedź na realny problem: model najtańszy w przeliczeniu na token niekoniecznie jest najtańszy w przeliczeniu na sesję. To nie jest decyzja oparta na benchmarkach; Opus 5 wygrywa większość porównań agentowych raportowanych przez dostawców. To decyzja o trasowaniu tokenów, która opłaca się tylko wtedy, gdy trafne decyzje orkiestracyjne są rzadkością, a wykonanie można zrównoleglić.
Claude Fable 5 (9 czerwca 2026) i Claude Opus 5 (24 lipca 2026) to obecnie aktualne modele Anthropica, a zmiana zabezpieczeń z 7 sierpnia sprawia, że Fable 5 jest rzadziej przerywanym modelem do codziennej pracy. Obserwuj trzy rzeczy: czy doniesienia o Fable 5.1 cokolwiek wnoszą, czy Anthropic naprawi błąd dziedziczenia podagentów, który może po cichu cofnąć ten wzorzec, oraz — co najważniejsze — jaki będzie Twój koszt za ukończone zadanie w ciągu tygodnia prawdziwych sesji.
Często zadawane pytania
Czy Fable 5 jest domyślnym modelem w Claude Code?
Nie. Dokumentacja samego Claude Code stwierdza, że Fable 5 nie jest domyślnym modelem dla żadnego typu konta — sesje domyślnie korzystają ze standardowego modelu Opus, a Fable 5 wybiera się przez /model, ustawienie modelu lub alias „best”. Wzorzec zaprezentowany w tym artykule celowo działa wbrew temu domyślnemu ustawieniu.
Dlaczego po prostu nie użyć Opus 5 jako domyślnego, skoro jest tańszy za token i osiąga wyższe wyniki?
Ponieważ koszt sesji to tokeny na zadanie razy cena za token. Praktycy podają, że adaptacyjne myślenie i samoweryfikacja Opusa 5 generują znacznie więcej tokenów na turę, więc przy o połowę niższej stawce za token może wciąż działać wolniej i kosztować więcej w długiej pętli. Na tym ustaleniu społeczności opiera się ten playbook — zmierz to na własnym obciążeniu, zanim wybierzesz stronę.
Czy mogę wymusić, aby moje subagenty używały innego modelu niż sesja?
Tak, ale nie polegaj na parametrze modelu per wywołanie: GitHub issue #83920 dokumentuje, że jest on ignorowany, a subagenci dziedziczą zamiast tego model sesji. Ustaw CLAUDE_CODE_SUBAGENT_MODEL lub przypnij model we frontmatterze subagenta — to jest różnica między wykonaniem rozliczanym według cennika Opus 5 a cichym działaniem według cennika Fable 5.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
