
Claude Fable 5 als Ihr Orchestrator: Das Subagent-Playbook, das Token-Kosten niedrig hält
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Am 7. August nahm Anthropic die größte Einzeländerung an Claude Fable 5 vor, seit das Modell am 9. Juni erschienen ist: Es reduzierte biologiebezogene „Fallbacks“ um etwa 85 %, sodass alltägliche Gesundheits- und Bildungsfragen jetzt eine direkte Antwort erhalten, anstatt stillschweigend auf ein schwächeres Modell umzuschalten. Das Muster, das sich diese Woche tatsächlich in der Claude-Code-Community verbreitet, hat jedoch nichts mit Biologie zu tun. Praktiker posten immer wieder einen Workflow, in dem Claude Fable 5 die Orchestrierungsschleife ausführt – Anforderungsklärung, Planzerlegung, Aufgabenverteilung, Ergebnisabnahme – während die Ausführung an Claude Opus 5-Subagenten übergeben wird. Der genannte Vorteil: Fable 5 High wird zu einem erschwinglichen Standard für Sitzungen, und die Wortlastigkeit von Claude Opus 5 hört auf, die Sitzung auszulaugen.
Das jüngste Beispiel stammt von @dotey, veröffentlicht am 14. August: eine kurze Ergänzung zu ~/.claude/CLAUDE.md, die den Agenten anweist, Opus-Subagenten für die Ausführung zu öffnen, während Claude Fable 5 mit hoher Reasoning-Anstrengung als Standard für die Sitzung erhalten bleibt. Der Autor berichtet, dass der Token-Verbrauch vernünftig bleibt – und nennt einen unverblümten Grund, warum Claude Opus 5 nicht als Standard läuft: In seinen Händen war es zu langsam und verbrannte eine riesige Anzahl an Tokens in der Hauptschleife. Das ist eine Erkenntnis aus der Community, keine Anthropic-Empfehlung – und es lohnt sich, sie zu verstehen, bevor man sie übernimmt, denn auf dem Papier sieht sie rückwärts aus.
Das Muster in einem Absatz. In Claude Code erben Unteragenten standardmäßig Ihr Session-Modell. Um eine schnelle, kostengünstige Schleife beizubehalten, machen Sie das Session-Modell zum Planer und verweisen die Ausführenden explizit auf ein anderes Modell. Claude Fable 5 — Anthropics Mythos-Klasse-Modell, das für die allgemeine Nutzung sicher gemacht wurde, veröffentlicht am 9. Juni 2026 zu 10/50 Dollar pro Million Tokens — hält die Anforderungen fest, zerlegt die Arbeit, weist Aufgaben zu und nimmt Ergebnisse entgegen. Claude Opus 5 — veröffentlicht am 24. Juli 2026 zu 5/25 Dollar pro Million Tokens — führt die eigentlichen Implementierungen innerhalb der Unteragenten aus. Sie setzen Urteilsvermögen auf Fable-Niveau für die wenigen Orchestrierungsrunden ein und Ausführung auf Opus-Niveau für die vielen Ausführungsrunden, in denen bereits der Großteil der Tokens anfällt.
Warum das Main-Loop-Modell das eigentliche Kostenproblem ist
Bei Benchmarks wirkt das wie ein gelöstes Problem – und die Antwort scheint zu lauten: „Standardmäßig Opus 5.“ An Anthropics eigenen Zahlen (vom Anbieter gemeldet, nicht unabhängig reproduziert) liegt Claude Opus 5 bei dem agentischen Codierungs-Benchmark Frontier-Bench v0.1 vorn (43,3 % gegenüber 33,7 %), bei SWE-bench Verified (96,0 % gegenüber 95,5 %) und bei ARC-AGI-3 (30,2 %, etwa das Vierfache des nächstbesten öffentlichen Modells). Anthropic positioniert Opus 5 als Annäherung an Fable 5s Grenzintelligenz zum halben Preis. Wenn man den Standard für eine Sitzung rein anhand von Anbieter-Benchmarks und Token-Preisen festlegt, ist Opus 5 die offensichtliche Wahl.
Praktiker, die tatsächlich lange Sitzungen laufen lassen, kommen zu dem gegenteiligen Standard, und der Grund sind Tokens pro Aufgabe, nicht der Preis pro Token. Das Denken von Opus 5 ist standardmäßig aktiviert und adaptiv, und Anthropic sagt, dass es seine eigene Arbeit unaufgefordert überprüft – was in der Praxis bedeutet, dass jede Schleifeniteration deutlich mehr Tokens erzeugt als die von Fable 5. Das Deaktivieren dieses Denkens ist bei hohem Aufwand gedeckelt, sodass man es nicht vollständig schlank einstellen kann. Bei einer Sitzung, die stundenlang läuft, ist es die Schleife, die sich aufsummiert: Das Modell, das pro Token am günstigsten ist, kann am Ende pro Sitzung am teuersten sein, und das Modell, das am wenigsten spricht, hält die Schleife schnell.
Das deckt sich mit dem, was @dotey berichtet. Das invertierte Setup hält den Tokenverbrauch "nicht schlecht", gerade weil Opus 5 – das wortreiche Modell – in Subagenten abgeschottet ist, wo seine Ausgabe das Ergebnis und nicht der Overhead ist.
Die invertierte Architektur: Fable 5 plant, Opus führt aus
Die Architektur ist einfach zu beschreiben und etwas kontraintuitiv zu betreiben:
• Sitzungsmodell — Claude Fable 5 mit hoher Denkanstrengung (das „High" in der Community-Kurzform „Fable 5 High"). Es verantwortet das Gespräch, den Plan und die Definition von „fertig".
• Orchestrierungsrunden — Anforderungsklärung, Planzerlegung, Aufgabenverteilung und Ergebnisannahme finden alle auf Fable 5 statt. Dies sind wenige Runden und ein kleiner Anteil der gesamten Token.
• Ausführungsrunden — jede Aufgabe wird an einen Unteragenten übergeben, der Claude Opus 5 ausführt. Dies sind die vielen Runden und der Großteil des Token-Verbrauchs — und Opus 5 ist der Bereich, in dem die vom Anbieter gemeldeten Agentic-Scores am höchsten sind.
Die Ökonomie funktioniert, weil die beiden Kostenkurven in unterschiedliche Richtungen zeigen. Die Stärke von Fable 5 ist das Urteilsvermögen; man setzt es sparsam ein. Die Stärke von Opus 5 ist die Ausführung; man nutzt sie intensiv, aber parallel und isoliert von der Schleife. Die Schleife bleibt schnell und günstig, und die teure Fähigkeit wird genau dort eingesetzt, wo die Tokens ohnehin ausgegeben werden.
Dies ist eines von zwei in Umlauf befindlichen Community-Mustern, und sie sind Spiegelbilder voneinander. Das häufiger empfohlene „Architektenmuster" (das beispielsweise vom fable-advisor-Plugin verwendet wird) setzt Opus als Vollzeit-Architekten ein und reserviert Fable 5 für die Implementierungsarbeit höchster Komplexität sowie eine obligatorische Abschlussprüfung des jeweiligen Deliverables. Der Unterschied liegt in einem Optimierungsziel: Das Architektenmuster gibt Tokens der Opus-Klasse für die Koordination aus und nutzt Fable 5 wie ein Skalpell; das invertierte Muster nutzt Fable 5 für die Koordination und Opus 5 für das Volumen. Beide sind Community-Empfehlungen – Anthropic dokumentiert keines von beiden – und beide sind Versuche, Frontier-Tokens dort einzusetzen, wo sie das Ergebnis verändern.
Einrichten in Claude Code
Claude Code hat keinen eingebauten „Orchestrator-Modus“, daher wird das Muster auf zwei Arten durchgesetzt: durch Anweisungen im Session-Prompt und durch explizite Modell-Pins auf der Ausführungsseite.
Die Anweisungsebene befindet sich in ~/.claude/CLAUDE.md – derselben Datei, die @dotey bearbeitet hat. In seiner Form weist der Prompt den Hauptagenten an, vier Dinge zu tun, bevor er eine Aufgabe als erledigt betrachtet:
• Wiederholen Sie die Anforderung und bestätigen Sie den Umfang, bevor Sie Code schreiben.
• Zerlegen Sie die Arbeit in Aufgaben, die parallel ausgeführt werden können.
• Weisen Sie jede Ausführungsaufgabe einem an Claude Opus 5 gebundenen Teilagenten zu.
• Überprüfen Sie jedes Ergebnis anhand des Plans, bevor Sie es akzeptieren.
Diese Form sollte eher als Leitfaden formuliert werden denn als Snippet zum Einfügen — Ihre Anforderungen und Ihr Stack bestimmen, was hineingehört.
Die Modellebene ist wichtiger, als die meisten Setups annehmen. In Claude Code ist die Auflösungsreihenfolge für Subagent-Modelle: die Umgebungsvariable CLAUDE_CODE_SUBAGENT_MODEL, dann ein Modellparameter pro Aufruf, dann das Frontmatter der Agent-Definition, dann das Sitzungsmodell. Agenten ohne festgelegtes Modell erben das Sitzungsmodell. Wenn Ihre Sitzung also auf Fable 5 läuft und Sie sich auf das Modellargument des Agent-Tools verlassen, besteht ein dokumentiertes Risiko, dass es ignoriert wird (GitHub issue #83920): Subagenten erben ohnehin das Sitzungsmodell, und Sie zahlen den Fable-5-Preis für die Ausführung, die Sie auf Opus 5 ausführen wollten.
Zwei zuverlässige Lösungen: Setzen Sie CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 für die Sitzung, oder legen Sie das Modell im Frontmatter des Subagenten fest. Diese eine Variable entscheidet darüber, ob das Muster wie vorgesehen funktioniert oder ob die gesamte Sitzung stillschweigend auf dem teuren Modell läuft.
Die Token-Mathematik hinter dem Split
Hier sind die beiden Modelle in der heutigen Preisgestaltung (vom Anbieter veröffentlicht und auf OrcaRouter zum Listenpreis durchgereicht):
Claude Fable 5 — $10 pro 1M Eingabe-Token, $50 pro 1M Ausgabe; 1M-Token-Kontext, 128K-Ausgabe.
• Claude Opus 5 — $5 pro 1 Mio. Eingabe-Tokens, $25 pro 1 Mio. Ausgabe-Tokens; 1-Mio.-Token-Kontext, 128K-Ausgabe.

Der kontraintuitive Teil ist, dass Opus 5 halb so viel pro Token kostet und dennoch das Kostenspiel pro Sitzung verlieren kann. Die Form ist mit groben Zahlen leicht zu erkennen: Wenn die Schleife mit Opus 5 zwei- bis dreimal so viele Token erzeugt wie die Schleife mit Fable 5 – eine veranschaulichende Zahl, die mit Praktikerberichten über das selbstverifizierende Verhalten von Opus 5 übereinstimmt, nicht eine gemessene –, dann kostet die Schleife selbst bei halbem Preis pro Token ungefähr gleich viel, und wenn die Lücke größer ist, kostet Opus in der Schleife mehr. In der Zwischenzeit liegen die Ausführungs-Token, die den Großteil der Sitzung ausmachen, bei Opus 5 in Subagenten ohnehin zum günstigeren Satz.
Das ist das ganze Argument für das invertierte Muster: Setze das Modell, dessen Preis pro Token höher ist, dessen Schleife aber schlanker ist, auf die Schleife, und setze das günstigere Modell pro Token auf das Volumen. Es ist eine Routing-Entscheidung, die als Modellentscheidung verkleidet ist.
Da OrcaRouter die Preise der Anbieter mit 0% Aufschlag durchreicht, sind die obigen Zahlen das, was Sie hier tatsächlich bezahlen — ohne zusätzliche Plattformgebühr — und wenn Anthropic einen der beiden Preise senkt, erscheint die Änderung noch am selben Tag auf der Modellseite.
Wann das invertierte Muster gewinnt – und wann nicht.
Das Kopieren von @dotey's Setup, ohne die Form deiner eigenen Arbeitslast zu prüfen, ist in beide Richtungen ein Fehler.
Das invertierte Muster gewinnt, wenn:
• Die Anforderungen sind unklar oder der Plan hat viele bewegliche Teile — das Urteilsvermögen bei der Orchestrierung ist die knappe Ressource.
• Die Ausführung kann in Unteragenten parallelisiert werden — das Volumen verlässt die Schleife.
• Sitzungen sind lang — die Ausführlichkeit von Schleifen summiert sich zu echten Kosten.
Die Standardempfehlung gewinnt, wenn:
• Der Großteil Ihrer Sitzung ist begrenzte, mechanische Arbeit – ein Planer der Fable-Klasse ist übertrieben, und der niedrigere Preis und die höheren Benchmark-Ergebnisse von Opus 5 machen es zur offensichtlichen Standardwahl. Deshalb macht die Dokumentation von Claude Code Opus zum Standard für Sitzungen und reserviert Fable 5 für die explizite Auswahl.
• Man kann Subagent-Modelle nicht zuverlässig anpinnen – der #83920-Vererbungsfehler verwandelt das invertierte Muster in „alles zu Fable-5-Preisen“.
Es gibt auch einen Mittelweg bei der Feinabstimmung. Opus 5 stellt einen Aufwandsparameter bereit (von niedrig bis maximal, standardmäßig hoch), sodass Sie das Modell in Richtung eines schlankeren Verhaltens drücken können — aber nicht ganz, denn das Deaktivieren des Denkens ist bei hohem Aufwand gedeckelt. Wenn Ihr Problem die Weitschweifigkeit von Opus 5 ist, kann das Herunterdrehen des Aufwands ausreichen, und Sie müssen die Architektur überhaupt nicht umkehren.
Was die Biologie-Änderung vom 7. August für dieses Setup bedeutet
Das Update von Anthropic vom 7. August hat den Biologie-Klassifikator von Claude Fable 5 neu geschrieben und neu trainiert – das System, das entscheidet, ob eine Anfrage einen „Fallback“ auf ein weniger leistungsfähiges Modell auslöst. Nach Anthropics eigenen Zahlen (vom Anbieter gemeldet) sanken biologiebezogene Fallbacks um etwa 85 % über alle Produktflächen hinweg, wobei die Gesamt-Fallbacks auf Claude.ai um etwa 67 %, auf Cowork um etwa 55 %, bei Claude Code um etwa 17 % und auf der Claude Platform um etwa 7 % zurückgingen.

{{1}}Bei einem Fable-5-Orchestrierungs-Setup ist die Claude-Code-Nummer die entscheidende.{{/1}} {{2}}Ein Fallback bedeutet, dass das System Ihre Anfrage stillschweigend auf ein anderes Modell umstellt — in diesem Fall auf Opus 5.{{/2}} {{3}}In einem einfachen Chat ist das unsichtbare Reibung; in einer agentischen Sitzung bedeutet es, dass ein Teil Ihrer Pipeline auf einem Modell läuft, das Sie nicht gewählt haben, mit einem Kostenprofil, das Sie nicht geplant haben.{{/3}} {{4}}Das Update ändert daran nichts: Virologie, Toxikologie und Molekulardesign fallen weiterhin zurück.{{/4}} {{5}}Aber Alltagsbiologie in Gesundheit und Bildung — das Lesen eines Laborergebnisses, das Verstehen eines Symptoms, das Lernen von Biologie — bleibt jetzt auf Fable 5.{{/5}}
Eine Vorbemerkung, klar gekennzeichnet: Unbestätigte Berichte von Ende Juli (36kr, WinCentral) deuten auf ein mögliches Refresh von Claude Fable 5.1 in diesem Monat zu unveränderten Preisen hin. Anthropic hat weder einen Namen, ein Datum noch eine API-Modell-ID bestätigt — betrachten Sie das als Spekulation, bis es veröffentlicht wird.
Ausprobieren, ohne deinen Workflow zu riskieren.
Was das invertierte Muster einen Versuch wert macht, ist, dass es umkehrbar ist, und das Routen beider Modelle durch einen Endpunkt macht die Umkehrung kostengünstig.
Bei OrcaRouter befinden sich Claude Fable 5 (anthropic/claude-fable-5) und Claude Opus 5 (anthropic/claude-opus-5) hinter einem einzigen API-Schlüssel. Sie können den Ausführungspfad der Sitzung auf jedem der beiden Modelle ausführen, ohne einen zweiten Vertrag oder eine Codeänderung – genau das braucht ein Experiment wie „Fable 5 als Orchestrator“, denn der ganze Sinn besteht darin, Ihre eigenen Kosten pro Sitzung zu messen, bevor Sie sich festlegen.

Zwei OrcaRouter-Funktionen lassen sich direkt auf dieses Setup abbilden. Automatisches Failover ermöglicht es Ihnen, eine Fallback-Kette zu definieren — wenn Fable 5 einen Fehler meldet oder eine Zeitüberschreitung auftritt, wird die Anfrage an Opus 5 oder ein günstigeres Modell weitergeleitet, anstatt zu scheitern. Und die Routing-DSL kann das Paar zu einem einzigen Aufruf zusammenfassen: ein Fable-5-Planungsschritt, gefolgt von Opus-5-Ausführungsschritten hinter einem Endpunkt. Das ist das Orchestrierungsmuster, ausgedrückt als Infrastruktur und nicht als Prompt-Disziplin.
Fazit
Die invertierte Architektur — Claude Fable 5 plant, Claude Opus 5 führt aus — ist eine echte, funktionierende Antwort auf ein echtes Problem: Das Modell, das pro Token am günstigsten ist, ist nicht unbedingt das günstigste pro Sitzung. Es ist keine Benchmark-Entscheidung; Opus 5 gewinnt die meisten der von Anbietern gemeldeten agentischen Vergleiche. Es ist eine Token-Routing-Entscheidung, und sie zahlt sich nur aus, wenn Urteilsvermögen für die Orchestrierung knapp ist und die Ausführung parallelisiert werden kann.
Claude Fable 5 (9. Juni 2026) und Claude Opus 5 (24. Juli 2026) sind beide aktuelle Anthropic-Modelle, und die Änderung der Schutzvorkehrungen vom 7. August macht Fable 5 zu einem weniger unterbrochenen Alltagsbegleiter. Achten Sie auf drei Dinge: ob die Berichte zu Fable 5.1 irgendetwas ergeben, ob Anthropic den Vererbungsfehler bei Subagenten behebt, der dieses Muster unbemerkt rückgängig machen kann, und — am wichtigsten — wie Ihre eigenen Kosten pro abgeschlossener Aufgabe über eine Woche echter Sitzungen aussehen.
FAQ
There is no model called "Fable 5" in Claude Code. I'm not aware of any Anthropic model with that name. If you're seeing this somewhere, it might be a typo, an unfamiliar nickname, or possibly referencing another tool. You can run `/model` in Claude Code to see the list of available models, or check the official documentation.
Nein. Claude Codes eigene Dokumentation besagt, dass Fable 5 für keinen Kontotyp der Standard ist — Sitzungen verwenden standardmäßig das normale Opus-Modell, und Sie wählen Fable 5 über /model, eine Modelleinstellung oder den Alias „best" aus. Das Muster in diesem Artikel läuft bewusst gegen diese Standardeinstellung.
Warum nicht einfach Opus 5 als Standard verwenden, da es pro Token günstiger ist und besser abschneidet?
Denn die Kosten pro Sitzung ergeben sich aus Token pro Aufgabe multipliziert mit dem Preis pro Token. Praktiker berichten, dass Opus 5 durch adaptives Denken und Selbstverifikation pro Zug weit mehr Token erzeugt – selbst beim halben Preis pro Token kann es daher in einer langen Schleife langsamer und teurer sein. Genau darauf stützt sich dieses Playbook als Ergebnis der Community: Messen Sie es an Ihrer eigenen Workload, bevor Sie sich festlegen.
Kann ich meine Unteragenten zwingen, ein anderes Modell als die Sitzung auszuführen?
Ja, aber verlasse dich nicht auf den Modellparameter pro Aufruf: GitHub-Issue #83920 dokumentiert, dass er ignoriert wird, und Subagenten erben stattdessen das Sitzungsmodell. Setze CLAUDE_CODE_SUBAGENT_MODEL oder pinne das Modell im Frontmatter des Subagenten — das ist der Unterschied zwischen einer Ausführung zum Opus-5-Preis und einer stillen Ausführung zum Fable-5-Preis.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
