Karta tytułowa hero artykułu 'Claude Fable 5 jako Twój orkiestrator' przedstawiająca centralny węzeł Claude Fable 5 rozgałęziający się do czterech mniejszych węzłów roboczych podagentów Opus 5, z podtytułem 'Podręcznik podagentów Claude Code pozwalający utrzymać niskie koszty tokenów' oraz logo OrcaRouter wkomponowane w róg.
Guides & Insights

Claude Fable 5 jako Twój orkiestrator: Podręcznik subagentów, który obniża koszty tokenów

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

7 sierpnia Anthropic wprowadził największą pojedynczą zmianę w Claude Fable 5 od czasu premiery modelu 9 czerwca: ograniczył „fallbacki” związane z biologią o około 85%, dzięki czemu codzienne pytania dotyczące zdrowia i edukacji otrzymują teraz bezpośrednią odpowiedź, zamiast po cichu przełączać się na słabszy model. Jednak wzorzec, który w tym tygodniu faktycznie rozprzestrzenia się w społeczności Claude Code, nie ma nic wspólnego z biologią. Praktycy wciąż publikują workflow, w którym Claude Fable 5 prowadzi pętlę orkiestracji — doprecyzowanie wymagań, dekompozycję planu, przydzielanie zadań, akceptację wyników — podczas gdy wykonanie jest przekazywane subagentom Claude Opus 5. Deklarowany zysk: Fable 5 High staje się niedrogim domyślnym ustawieniem sesji, a gadatliwość Claude Opus 5 przestaje drenować sesję.

Najnowszym przykładem jest @dotey, opublikowany 14 sierpnia: krótki dopisek do ~/.claude/CLAUDE.md, który każe agentowi otwierać subagentów Opus do wykonywania zadań, pozostawiając Claude Fable 5 z wysokim poziomem rozumowania jako domyślne ustawienie sesji, przy czym autor podaje, że zużycie tokenów pozostaje rozsądne — oraz podaje bezpośredni powód, dla którego nie uruchamia Claude Opus 5 jako domyślnego: w jego rękach był zbyt wolny i spalał ogromną liczbę tokenów w głównej pętli. To odkrycie społeczności, a nie wytyczne Anthrop​ic — i warto to zrozumieć, zanim to skopiujesz, bo z pozoru wygląda to odwrotnie.

Wzorzec w jednym akapicie. W Claude Code subagenci domyślnie dziedziczą model sesji, więc sposobem na utrzymanie szybkiej i taniej pętli jest uczynienie modelu sesji planistą i jawne wskazanie wykonawcom innego modelu. Claude Fable 5 — model klasy Mythos od Anthrop​ic przystosowany do bezpiecznego, powszechnego użytku, wydany 9 czerwca 2026 r. w cenie 10/50 dolarów za milion tokenów — przechowuje wymagania, rozkłada pracę na części, rozdziela zadania i przyjmuje wyniki. Claude Opus 5 — wydany 24 lipca 2026 r. w cenie 5/25 dolarów za milion tokenów — wykonuje faktyczne implementacje w subagentach. Na kilka tur orkiestracji wykorzystujesz osąd klasy Fable, a na wiele tur wykonawczych — wykonanie klasy Opus, na które i tak trafia większość tokenów.

Dlaczego model głównej pętli jest prawdziwym problemem kosztowym.

W testach porównawczych wygląda to na rozwiązany problem — a odpowiedź brzmi: „domyślnie Opus 5”. Własne liczby firmy Anthropic (raportowane przez producenta, niepotwierdzone) pokazują, że Claude Opus 5 ma przewagę nad Claude Fable 5 w agentycznym benchmarku kodowania Frontier-Bench v0.1 (43,3% wobec 33,7%), w SWE-bench Verified (96,0% wobec 95,5%) oraz w ARC-AGI-3 (30,2%, czyli mniej więcej 4-krotnie więcej niż kolejny najlepszy publiczny model). Anthropic pozycjonuje model Opus 5 jako zbliżający się do inteligencji granicznej modelu Fable 5 za połowę ceny. Jeśli wybierasz domyślny model sesji wyłącznie na podstawie benchmarków producenta i ceny za token, Opus 5 jest oczywistym wyborem.

Praktycy, którzy naprawdę prowadzą długie sesje, przyjmują przeciwne ustawienie domyślne, a powodem są tokeny na zadanie, a nie cena za token. Tryb myślenia Opus 5 jest domyślnie włączony i adaptacyjny, a Anthrop​ic twierdzi, że model weryfikuje własną pracę bez monitowania — co w praktyce oznacza, że każda iteracja pętli generuje znacznie więcej tokenów niż w przypadku Fable 5. Wyłączenie tego myślenia jest ograniczone do wysokiego nakładu pracy, więc nie można go całkowicie odchudzić. W sesji trwającej godziny to pętla się kumuluje: model, który jest najtańszy za token, może okazać się najdroższy w przeliczeniu na sesję, a model, który mówi najmniej, utrzymuje pętlę szybką.

To zgadza się z tym, co raportuje @dotey. Odwrócona konfiguracja utrzymuje zużycie tokenów na „niezłym” poziomie właśnie dlatego, że Opus 5 — ten gadatliwy — jest odizolowany do podagentów, gdzie jego wynik jest produktem dostarczanym, a nie narzutem.

Odwrócona architektura: Fable 5 planuje, Opus wykonuje

Architektura jest prosta do opisania i odrobinę nieintuicyjna w działaniu:

• Model sesji — Claude Fable 5 przy wysokim nakładzie rozumowania (to „High" w skrócie społeczności „Fable 5 High"). Odpowiada za rozmowę, plan i definicję ukończenia.

• Tury orkiestracji — doprecyzowanie wymagań, dekompozycja planu, przydział zadań i akceptacja wyników — wszystko odbywa się na Fable 5. To zaledwie kilka tur i niewielka część wszystkich tokenów.

• Tury wykonawcze — każde zadanie jest przekazywane podagentowi działającemu na Claude Opus 5. To właśnie te tury stanowią większość zużycia tokenów — a Opus 5 osiąga najwyższe raportowane przez dostawcę wyniki agentowe.

Ekonomika działa, ponieważ obie krzywe kosztów wskazują w różnych kierunkach. Mocną stroną Fable 5 jest osąd; używasz go oszczędnie. Mocną stroną Opus 5 jest wykonanie; używasz go intensywnie, ale równolegle, w izolacji od pętli. Pętla pozostaje szybka i tania, a kosztowna zdolność jest zużywana dokładnie tam, gdzie i tak zużywane są tokeny.

To jeden z dwóch wzorców społecznościowych w obiegu i są one swoimi lustrzanymi odbiciami. Częściej zalecany „wzorzec architekta” (stosowany na przykład przez wtyczkę fable-advisor) uruchamia Opusa jako architekta na pełen etat i rezerwuje Fable 5 dla najbardziej złożonych ścieżek implementacyjnych oraz obowiązkowego przeglądu na koniec dostarczanego elementu. Różnica to cel optymalizacji: wzorzec architekta wydaje tokeny klasy Opus na koordynację i używa Fable 5 jak skalpela; wzorzec odwrócony używa Fable 5 do koordynacji, a Opus 5 do wolumenu. Obie to wskazówki społeczności — Anthropic nie dokumentuje żadnej z nich — i obie są próbami wydawania tokenów granicznych tam, gdzie zmieniają one wynik.

Konfiguracja w Claude Code

Claude Code nie ma wbudowanego „trybu orkiestratora”, więc ten wzorzec jest egzekwowany na dwa sposoby: przez instrukcje w prompcie sesji oraz przez jawne przypięcia modeli po stronie wykonania.

Warstwa instrukcji znajduje się w ~/.claude/CLAUDE.md — tym samym pliku, który edytował @dotey. Zasadniczo prompt nakazuje głównemu agentowi wykonanie czterech rzeczy przed uznaniem jakiegokolwiek zadania za zakończone:

• Powtórz wymaganie i potwierdź zakres przed napisaniem kodu.

Podziel pracę na zadania, które mogą być wykonywane równolegle.

• Przydziel każde zadanie wykonawcze subagentowi przypisanemu do Claude Opus 5.

• Zweryfikuj każdy wynik z planem przed jego zaakceptowaniem.

Taki kształt warto przedstawić jako wskazówkę, a nie jako fragment do wklejenia — Twoje wymagania i Twój stos technologiczny zmieniają to, co powinno się w nim znaleźć.

Warstwa modelu ma większe znaczenie, niż zakłada większość konfiguracji. W Claude Code kolejność ustalania modelu subagenta jest następująca: zmienna środowiskowa CLAUDE_CODE_SUBAGENT_MODEL, następnie parametr modelu przekazywany przy wywołaniu, potem frontmatter definicji agenta, a na końcu model sesji. Agenci bez ustawionego modelu dziedziczą model sesji. Jeśli więc Twoja sesja działa na Fable 5, a Ty polegasz na argumencie modelu w narzędziu Agent, istnieje udokumentowane ryzyko, że zostanie on zignorowany (GitHub issue #83920): subagenci i tak dziedziczą model sesji, a Ty płacisz stawkę Fable 5 za wykonywanie, które zamierzałeś uruchomić na Opus 5.

Dwa niezawodne rozwiązania: ustaw CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 dla sesji albo przypnij model w frontmatterze subagenta. Ta jedna zmienna decyduje o tym, czy wzorzec działa zgodnie z przeznaczeniem, czy po cichu uruchamia całą sesję na drogim modelu.

Matematyka tokenów stojąca za podziałem

Oto dwa modele w dzisiejszych cenach (ceny opublikowane przez producenta, przekazywane po cenie katalogowej w OrcaRouter):

• Claude Fable 5 — $10 za 1M tokenów wejściowych, $50 za 1M wyjściowych; kontekst 1M tokenów, 128K wyjściowych.

• Claude Opus 5 — $5 za 1 mln tokenów wejściowych, $25 za 1 mln tokenów wyjściowych; kontekst 1 mln tokenów, 128 tys. tokenów wyjściowych.

A comparison scoreboard for Claude Fable 5 and Claude Opus 5 contrasting price ($10/$50 vs $5/$25 per 1M tokens), context (both 1M in / 128K out), Frontier-Bench v0.1 (33.7% vs 43.3%), SWE-bench Verified (95.5% vs 96.0%), loop behaviour, and the role each plays in the orchestrator pattern, with a footer noting prices are vendor-published and benchmarks vendor-reported.

Kontrintuicyjne jest to, że Opus 5 kosztuje połowę ceny za token, a mimo to może przegrać grę kosztową w przeliczeniu na sesję. Kształt tej zależności łatwo zobaczyć na przybliżonych liczbach: jeśli pętla na Opusie 5 generuje od dwóch do trzech razy więcej tokenów niż pętla na Fable 5 — liczba poglądowa, zgodna z doniesieniami praktyków o samoweryfikacyjnym zachowaniu Opusa 5, a nie zmierzona — to nawet przy połowie stawki za token koszt pętli jest mniej więcej taki sam, a jeśli różnica jest większa, Opus w pętli kosztuje więcej. Tymczasem tokeny wykonawcze, stanowiące większość sesji, w obu przypadkach pozostają na Opusie 5 w subagentach po tańszej stawce.

To cały argument za odwróconym wzorcem: umieść w pętli model, którego cena za token jest wyższa, ale którego pętla jest lżejsza, a na wolumenie umieść model tańszy za token. To decyzja dotycząca routingu przebrana za decyzję dotyczącą modelu.

Ponieważ OrcaRouter przekazuje ceny dostawców z 0% narzutem, powyższe liczby to dokładnie to, co faktycznie tu płacisz — bez dodatkowej opłaty platformowej — a jeśli Anthrop​ic obniży którąkolwiek z cen, zmiana pojawia się na stronie modelu tego samego dnia.

Kiedy odwrócony wzorzec się sprawdza — a kiedy nie

Kopiowanie konfiguracji @dotey bez sprawdzenia kształtu własnego obciążenia to błąd w obie strony.

Odwrócony wzorzec wygrywa, gdy:

Wymagania są niejednoznaczne lub plan ma wiele ruchomych elementów — zdolność orkiestracji jest zasobem deficytowym.

• Wykonanie może być zrównoleglone do podagentów — wolumen opuszcza pętlę.

• Sesje są długie — rozwlekłość pętli kumuluje się w realny koszt.

Standardowa porada wygrywa, gdy:

• Większość Twojej sesji to ograniczona, mechaniczna praca — planer klasy Fable to przesada, a niższa cena i wyższe wyniki benchmarków Opusa 5 czynią go oczywistym wyborem domyślnym. Dlatego własna dokumentacja Claude Code ustawia Opusa jako domyślnego dla sesji, a Fable 5 pozostawia do jawnego wyboru.

• Nie można niezawodnie przypinać modeli subagentów — błąd dziedziczenia #83920 zamienia odwrócony wzorzec w „wszystko w cenniku Fable 5”.

Istnieje również środkowa ścieżka dostrajania. Opus 5 udostępnia parametr effort (od low do max, domyślnie high), więc można go przesunąć w stronę oszczędniejszego zachowania — ale nie do końca, ponieważ wyłączenie myślenia jest ograniczone do wysokiego wysiłku. Jeśli problemem jest rozwlekłość Opusa 5, zmniejszenie effort może wystarczyć i nie trzeba wcale odwracać architektury.

Co zmiana biologiczna z 7 sierpnia oznacza dla tej konfiguracji

Aktualizacja firmy Anthropic z 7 sierpnia przepisała i ponownie wytrenowała klasyfikator biologiczny modelu Claude Fable 5 — system, który decyduje, czy zapytanie wywołuje „fallback” do mniej wydajnego modelu. Według własnych danych firmy Anthropic (raportowanych przez dostawcę) liczba fallbacków związanych z biologią spadła o około 85% na wszystkich powierzchniach produktowych, a ogólna liczba fallbacków zmniejszyła się o ~67% w Claude.ai, ~55% w Cowork, ~17% w Claude Code i ~7% na Claude Platform.

Screenshot of Anthropic's 'Improving Fable 5's biology safeguards' announcement dated August 7, 2026, describing the roughly 85% reduction in biology-related fallbacks across product surfaces.

Dla konfiguracji orkiestracji Fable 5 liczy się numer Claude Code. Fallback to sytuacja, w której system po cichu przełącza twoje zapytanie na inny model — w tym przypadku na Opus 5. W zwykłym czacie to niewidzialne tarcie; w sesji agentowej oznacza, że część twojego potoku działa na modelu, którego nie wybrałeś, i przy kosztach, których nie planowałeś. Aktualizacja tego nie usuwa: wirusologia, toksykologia i projektowanie molekularne nadal korzystają z fallbacku. Ale codzienna biologia zdrowotna i edukacyjna — odczytywanie wyników badań, rozumienie objawu, nauka biologii — pozostaje teraz na Fable 5.

Jedna uwaga wyprzedzająca, wyraźnie oznaczona: niepotwierdzone doniesienia z końca lipca (36kr, WinCentral) wskazują na możliwe odświeżenie Claude Fable 5.1 w tym miesiącu przy niezmienionej cenie. Anthropic nie potwierdził ani nazwy, ani daty, ani identyfikatora modelu API — traktuj to jako spekulację, dopóki się nie ukaże.

Wypróbuj to bez stawiania na szali swojego przepływu pracy

To, co sprawia, że odwrócony wzorzec warto wypróbować, to jego odwracalność, a kierowanie obu modeli przez jeden punkt końcowy sprawia, że odwrócenie jest tanie.

Na OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) i Claude Opus 5 (anthropic/claude-opus-5) działają za jednym kluczem API. Możesz uruchomić ścieżkę wykonania sesji na dowolnym z tych modeli bez zawierania drugiej umowy ani zmiany kodu — co jest dokładnie tym, czego potrzebuje eksperyment w rodzaju „Fable 5 jako orchestrator”, ponieważ cały sens polega na zmierzeniu własnego kosztu na sesję, zanim się zobowiążesz.

Screenshot of the OrcaRouter model page for Claude Fable 5 showing the slug anthropic/claude-fable-5, $10 per 1 million input tokens and $50 per 1 million output tokens, a 1M-token context, and the /v1/messages and /v1/chat/completions endpoints.

Dwie funkcje OrcaRouter przekładają się bezpośrednio na tę konfigurację. Automatyczny failover pozwala zdefiniować łańcuch rezerwowy — jeśli Fable 5 zwróci błąd lub przekroczy limit czasu, żądanie jest kierowane do Opus 5 lub tańszego modelu, zamiast kończyć się niepowodzeniem. A DSL routingu może złożyć tę parę w jedno wywołanie: krok planowania Fable 5, po którym następują kroki wykonawcze Opus 5, za jednym endpointem. To wzorzec orkiestracji wyrażony jako infrastruktura, a nie jako dyscyplina promptowania.

Sedno sprawy

Odwrócona architektura — Claude Fable 5 planuje, Claude Opus 5 wykonuje — to realna, działająca odpowiedź na realny problem: model najtańszy w przeliczeniu na token niekoniecznie jest najtańszy w przeliczeniu na sesję. To nie jest decyzja oparta na benchmarkach; Opus 5 wygrywa większość porównań agentowych raportowanych przez dostawców. To decyzja o trasowaniu tokenów, która opłaca się tylko wtedy, gdy trafne decyzje orkiestracyjne są rzadkością, a wykonanie można zrównoleglić.

Claude Fable 5 (9 czerwca 2026) i Claude Opus 5 (24 lipca 2026) to obecnie aktualne modele Anthropica, a zmiana zabezpieczeń z 7 sierpnia sprawia, że Fable 5 jest rzadziej przerywanym modelem do codziennej pracy. Obserwuj trzy rzeczy: czy doniesienia o Fable 5.1 cokolwiek wnoszą, czy Anthropic naprawi błąd dziedziczenia podagentów, który może po cichu cofnąć ten wzorzec, oraz — co najważniejsze — jaki będzie Twój koszt za ukończone zadanie w ciągu tygodnia prawdziwych sesji.

Często zadawane pytania

Czy Fable 5 jest domyślnym modelem w Claude Code?

Nie. Dokumentacja samego Claude Code stwierdza, że Fable 5 nie jest domyślnym modelem dla żadnego typu konta — sesje domyślnie korzystają ze standardowego modelu Opus, a Fable 5 wybiera się przez /model, ustawienie modelu lub alias „best”. Wzorzec zaprezentowany w tym artykule celowo działa wbrew temu domyślnemu ustawieniu.

Dlaczego po prostu nie użyć Opus 5 jako domyślnego, skoro jest tańszy za token i osiąga wyższe wyniki?

Ponieważ koszt sesji to tokeny na zadanie razy cena za token. Praktycy podają, że adaptacyjne myślenie i samoweryfikacja Opusa 5 generują znacznie więcej tokenów na turę, więc przy o połowę niższej stawce za token może wciąż działać wolniej i kosztować więcej w długiej pętli. Na tym ustaleniu społeczności opiera się ten playbook — zmierz to na własnym obciążeniu, zanim wybierzesz stronę.

Czy mogę wymusić, aby moje subagenty używały innego modelu niż sesja?

Tak, ale nie polegaj na parametrze modelu per wywołanie: GitHub issue #83920 dokumentuje, że jest on ignorowany, a subagenci dziedziczą zamiast tego model sesji. Ustaw CLAUDE_CODE_SUBAGENT_MODEL lub przypnij model we frontmatterze subagenta — to jest różnica między wykonaniem rozliczanym według cennika Opus 5 a cichym działaniem według cennika Fable 5.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie