Hero-Titelkarte mit der Überschrift 'Claude Opus 5.5 führt aus, Claude Fable 5.1 berät' und dem Untertitel 'Preisgestaltung der Advisor-Schleife von Claude Code', ein von links nach rechts verlaufendes Diagramm, das Fable 5.1 beim Schreiben des Plans, Opus 5.5 beim Ausführen der Schleife sowie einen geschwungenen Feedback-Pfeil mit der Beschriftung 'berät und verifiziert' zeigt, und das OrcaRouter-Logo in der unteren rechten Ecke.
Guides & Insights

Claude Opus 5.5 führt aus, Claude Fable 5.1 berät: Preisgestaltung für den Advisor Loop von Claude Code

Autor

Gideon Frost

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Claude Fable 5.1 schreibt den Designplan. Claude Opus 5.5 führt ihn in einer Schleife aus. Fable 5.1 kommt als Berater zurück und nimmt das Ergebnis an oder lehnt es ab. Das ist das Muster, das X/@dotey am 22. September 2026 gepostet hat – an dem Tag, an dem der Anbieter Claude Opus 5.5 veröffentlichte – und es als ein unter Kostendruck zustande gekommenes Token-sparendes Arrangement darstellte: den Berater auf Fable setzen, Opus laufen lassen und das teure Modell nur an Entscheidungspunkten sprechen lassen. Was sie verwenden, ist kein Prompt-Trick und keine Subagent-Konfiguration mehr. Es ist das integrierte Berater-Tool von Claude Code, eine serverseitige Funktion, die zu den Tarifen des Beratermodells abgerechnet wird – zusätzlich zu allem, was das Hauptmodell verbraucht. Und die Beratung ist der günstige Teil. Das erneute Lesen der Konversation, um sie zu erzeugen, ist es nicht – der Kontext des Ausführenden lässt sich inzwischen günstig erneut lesen, und der des Beraters war es nie. Diese eine Asymmetrie entscheidet, ob sich die Schleife lohnt, und genau das rechnet der Rest dieses Artikels durch.

Was die Schleife eigentlich ist

Das Advisor-Tool kombiniert dein Hauptmodell mit einem zweiten, in der Regel stärkeren Modell, das Claude in Schlüsselmomenten konsultiert – bevor es sich auf einen Ansatz festlegt, wenn ein Fehler wiederholt auftritt oder bevor es eine Aufgabe als erledigt erklärt. Der Advisor erhält die vollständige Konversation, einschließlich jedes Tool-Aufrufs und dessen Ergebnisses, und gibt eine Empfehlung zurück, die das Hauptmodell dann anwendet. Es ruft niemals Tools auf und erzeugt niemals Ausgaben für Benutzer. Du wählst, welches Modell berät; Claude entscheidet, wann es aufgerufen wird.

Dieser letzte Teil ist es, was dies vom Orchestrator-und-Subagent-Muster unterscheidet, das die Claude-Code-Community im August herumreichte. Subagenten sind Delegation: Ein Planer zerlegt Arbeit und verteilt sie an Worker, und du konfigurierst das Modell jeder Spur explizit. Der Advisor ist Eskalation: Ein Modell steuert die gesamte Aufgabe, und das teure Modell wird mitten im Lauf hinzugezogen für eine Entscheidung, die der Steuernde nicht allein treffen kann. Es gibt keinen Worker-Pool, keinen Aufgaben-Graphen und keinen Orchestrierungs-Prompt, der gepflegt werden müsste. Die praktische Schleife, die @dotey beschreibt – planen, ausführen, verifizieren, wiederholen –, ist, wie dieser Mechanismus aussieht, wenn du den Advisor auf Fable 5.1 richtest und ihn die Abbruchbedingung der Schleife überwachen lässt.

Anthropics eigene Einordnung der Strategie ist unverblümt, was die Form des Gewinns angeht: Der Berater „kann nur Fähigkeiten weitergeben, die dem Ausführenden fehlen.“ Alles Folgende ergibt sich daraus, wie viel Fähigkeit tatsächlich fehlt und wie oft der Ausführende es einräumt.

Warum Claude Opus 5.5 die Arithmetik änderte

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Anthropics veröffentlichte Preisliste, pro Million Token. Dies sind Anbieterangaben, keine Schätzungen:

• Claude Opus 5.5 — 4 $ Eingabe, 20 $ Ausgabe, 0,20 $ Cache-Lesen, 5 $ für ein 5-minütiges Cache-Schreiben

Claude Opus 5 — 5 $ Eingabe, 25 $ Ausgabe, 0,50 $ Cache-Lesen, 6,25 $ für einen 5-Minuten-Cache-Schreibvorgang

• Claude Fable 5.1 — 10 $ Eingabe, 50 $ Ausgabe, 0,25 $ Cache-Lesevorgang, 12,50 $ für einen 5-Minuten-Cache-Schreibvorgang

Zwei Details in dieser Liste sind wichtiger als die Schlagzeilenpreise. Erstens: Cache-Lesevorgänge bei Opus 5.5 machen laut der eigenen Fußnote von Anthropic 5 % des Basis-Inputs aus, während die meisten Claude-Modelle bei 10 % liegen und Fable 5.1 bei 2,5 %. Fable 5.1 hat den besseren Multiplikator und verliert dennoch bei den absoluten Dollarbeträgen – 0,20 $ gegenüber 0,25 $ –, weil sein Basis-Input-Tarif zweieinhalbmal so hoch ist.

Zweitens, und das ist der Mechanismus, auf den es in dieser Schleife ankommt: Das Umschalten des Advisors in Claude Code macht den Prompt-Cache des Hauptmodells nicht ungültig, sodass der lange, wiederholt erneut gesendete Kontext des Executors günstig bei 0,20 $ pro Million bleibt. Der eigene Lesezugriff des Advisors auf die Konversation wird nicht gecacht. Jede Konsultation verarbeitet das vollständige Transkript neu, zum Eingabe-Tarif von Fable 5.1 von 10 $ pro Million. Ein Executor, der einen Kontext von 500K Token zehnmal erneut liest, zahlt für Cache-Lesevorgänge; ein Advisor, der zehnmal konsultiert wird, zahlt zehn frische Eingaberechnungen für ein Transkript, das die ganze Zeit wächst. Je günstiger der Kontext deines Executors wird, desto stärker fällt der ungecachte Lesezugriff des Advisors auf — und Opus 5.5 hat den Kontext des Executors gerade 60 % günstiger gemacht als den von Opus 5.

Einrichten in Claude Code

Der Advisor ist experimentell, und Anthropic weist im Sitzungsbanner darauf hin – „Advisor Tool (experimentell) ist aktiviert und verbraucht möglicherweise mehr Tokens.“ Verhalten, Preisgestaltung und Verfügbarkeit können sich ändern. Unter diesem Vorbehalt ist die Funktionsweise dokumentiert:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• Einschalten mit /advisor fable, oder führe /advisor ohne Argument aus, um eine Auswahl zu erhalten. Die Wahl wird in der Einstellung advisorModel in deinen Benutzereinstellungen gespeichert und bleibt über Sitzungen hinweg erhalten. /advisor off schaltet es aus.

• Für eine einzelne Sitzung, ohne die gespeicherte Standardeinstellung zu ändern, starten Sie mit claude --advisor fable. Das Flag wird in claude --help nicht aufgeführt, und Claude Code beendet sich beim Start, wenn die Paarung ungültig ist, anstatt mit einem stillschweigend ignorierten Advisor zu starten.

• Konfigurieren Sie einen dauerhaften Standard in Ihrer Einstellungsdatei mit {"advisorModel": "fable"}.

• Um es vollständig zu deaktivieren, setzen Sie CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — der Befehl /advisor verschwindet und jedes konfigurierte advisorModel wird ignoriert.

• Die Paarung muss mindestens genauso leistungsfähig sein wie das Hauptmodell. Claude Opus 5.5 akzeptiert Fable und Opus 5 oder neuer als Berater. Ein Opus-4.6- oder Sonnet-Berater wird von Claude Code abgelehnt; ein Opus-4.7- oder Opus-4.8-Berater wird angehängt und dann von der API abgelehnt. Fable 5.1 akzeptiert als Hauptmodell nur Fable 5.1.

• Mindestversionen: Das Advisor-Tool erfordert Claude Code v2.1.98 oder höher; Fable als Hauptmodell oder Advisor erfordert v2.1.170 oder höher; Fable 5.1 erfordert v2.1.257 oder höher. Die Token-Form von /advisor — diejenige, die in -p, dem Agent SDK, der Desktop-App und Remote Control funktioniert — erfordert v2.1.260 oder höher.

• Der Advisor ist ausschließlich über die Anthropic-API verfügbar. Er ist nicht auf Amazon Bedrock, Claude Platform on AWS, Google Cloud's Agent Platform oder Microsoft Foundry verfügbar und hängt vom Abrufen von Feature-Flags ab, sodass er in einer Sitzung mit einer gesetzten Variable wie DISABLE_TELEMETRY deaktiviert bleibt.

• Bei Tarifen, bei denen die Fable-Nutzung über Nutzungsguthaben abgerechnet wird, wird Fable als Berater auf dieselbe Weise abgerechnet und erfordert eine einmalige Zustimmung. Bis Sie sie akzeptieren, /advisor fable speichert nicht und claude --advisor fable beendet sich beim Start und verweist Sie auf /model fable stattdessen.

Subagenten erben den Advisor, den Sie konfiguriert haben, und führen dieselbe Paarungsprüfung erneut gegen ihr eigenes Modell aus. Das ist die eine Interaktion zwischen diesem Muster und dem Subagenten-Muster: Ein Subagent, der ein kleineres Modell ausführt, darf möglicherweise einen Advisor verwenden, den sein übergeordneter Agent nicht verwenden darf.

Die Kostenstruktur, durchgerechnet

Nichts des Folgenden ist eine Messung. Die Token-Form ist erfunden, um die Arithmetik sichtbar zu machen; die Preise sind Anthropics veröffentlichte Tarife. Angenommen, eine Executor-Sitzung, die 1M frische Eingabe-Tokens liest und 500K Ausgabe-Tokens erzeugt, und drei Beraterkonsultationen, die jeweils ein 200K-Token-Transkript erneut lesen und etwa 600 Tokens an Hinweisen zurückgeben – ungefähr die zwei bis drei Konsultationen pro Aufgabe, die Anthropics eigener System-Prompt verlangt.

• Executor auf Claude Opus 5.5 — 1 Mio. Eingabe zu 4,00 $ plus 500 Tsd. Ausgabe zu 10,00 $ = 14,00 $

• Berater auf Claude Fable 5.1 — 600K Eingabe zu 6,00 $ plus etwa 1.800 Ausgabe-Tokens zu ungefähr 0,09 $ = 6,09 $

• The Loop, Gesamt — etwa 20,09 $

• Dieselbe Shape End-to-End auf Fable 5.1 ausgeführt — $10.00 Eingabe plus $25.00 Ausgabe = $35.00

• Die gleiche Form allein auf Opus 5.5 — $14.00

Der Loop liegt zwischen den beiden, und genau dort positioniert Anthropic ihn: etwa 43 % günstiger als Fable 5.1 durchgängig laufen zu lassen und etwa 44 % teurer als der Executor allein. Lies die zweite Zahl als die ehrliche. Der Advisor ist keine Einsparung; er ist der Kauf von Urteilsvermögen auf Fable-Niveau bei drei Entscheidungen, und er zahlt sich nur aus, wenn diese drei Entscheidungen das Ergebnis ändern. Schiebe das Transkript in das 1M-Kontextfenster, und jede Konsultation kostet allein $10. Lass den Executor bei den meisten Aufgaben nachfragen statt bei einigen wenigen, und du zahlst Advisor-Sätze über die gesamte Workload — ab welchem Punkt, wie Anthropic es ausdrückt, das Advisor-Modell selbst laufen zu lassen der günstigere Weg zum selben Score ist.

Was Anthropics eigene Messungen sagen

Anthropic hat gemessene Ergebnisse für dieses Muster veröffentlicht, und sie sind vom Anbieter gemeldet: durchgeführt von dem Unternehmen, das beide Modelle verkauft, mit seinem eigenen Benchmark-Harness. Sie sind nach wie vor die einzigen Zahlen ihrer Art, und sie enthalten die Argumente gegen das Muster, weshalb es sich lohnt, sie genau zu lesen.

• Opus 5 als ausführendes Modell mit Fable 5.1 als Berater erzielte bei Anthropics internem Agentic-Coding-Benchmark 7,69 US-Dollar pro Versuch – die genaueste Konfiguration, die Anthropic gemessen hat. Das sind 3,5 Punkte mehr als Opus 5 allein in seiner Standardeinstellung, bei etwas geringeren Kosten, und etwa 2,5 Punkte mehr als Fable 5.1 allein, bei etwa anderthalbmal so hohen Kosten. Die 3,5-Punkte-Lücke wurde mit fünf Versuchen pro Aufgabe vom Rauschen von Durchlauf zu Durchlauf abgegrenzt.

• Dieselbe Paarung erzielte beim Diagrammlesen im Rahmen der Messungenauigkeit das gleiche Ergebnis wie Fable 5.1 allein bei mittlerem Aufwand – 65,0 gegenüber 67,5 – bei ungefähr 2,6-mal so hohen Kosten pro Aufgabe, weil der Berater bei nahezu jeder Aufgabe hinzugezogen wurde.

• Auf GPQA Diamond entspricht der Zugewinn fast perfekt der Fähigkeitslücke: Ein Haiku-4.5-Executor gewann sehr viel, ein Sonnet-5-Executor ein paar Punkte und ein Frontier-Executor fast nichts.

• Die Konsultationsrate ist die fragile Variable. Ein Executor mit geringem Aufwand auf Basis von Sonnet 5 gewann mit einem Berater 23 Punkte auf DeepSWE, stellte dann auf SWE-bench Pro das Fragen vollständig ein und gewann nichts.

• Latenz: etwa zwei zusätzliche Aufrufe an Frontier-Modelle pro Aufgabe, jeweils auf dem kritischen Pfad.

Zwei Dinge an diesen Belegen wirken sich direkt auf den Loop aus, wie er diese Woche steht. Für die Messungen wurde Opus 5 als Ausführender verwendet, weil Opus 5.5 noch nicht existierte, als sie durchgeführt wurden. Und Anthropic berichtet, dass Opus 5.5 bei den meisten Aufgaben auf dem Niveau von Fable 5.1 leistet, während sein Betrieb 40 % weniger kostet — beides Angaben des Anbieters, keine davon unabhängig reproduziert. Wenn der Berater dafür bezahlt wird, die Lücke zwischen Ausführendem und Berater zu schließen, dann ist eine engere Lücke ein kleinerer Kauf. Das Muster wurde nicht schlechter, als Opus 5.5 auf den Markt kam; das, was es verkauft, wurde weniger knapp.

Die Fehlermodi, auf die Sie tatsächlich stoßen werden

Dies sind dokumentierte Verhaltensweisen, keine Spekulation, und die erste ist der Grund, diesen Abschnitt zu lesen, bevor Sie irgendetwas debuggen:

• Ein stillschweigend fehlender Advisor. Wenn die API die Advisor-Kopplung ablehnt, hängt Claude Code ihn an, die API lehnt sie ab, und Claude Code sendet die Anfrage ohne den Advisor erneut. Der Rest der Unterhaltung läuft dann ohne Advisor und ohne Fehlermeldung. Er bleibt deaktiviert, bis /clear oder /compact, selbst nachdem Sie zu einem kompatiblen Hauptmodell gewechselt sind.

• Eine, die stillschweigend abgelehnt wird. Bei Paarungen, die Claude Code selbst ablehnt, wird der Advisor einfach nie an die Anfragen des Hauptmodells angehängt. Die /advisor-Ausgabe und eine Benachrichtigung teilen es Ihnen mit – aber nichts schlägt fehl, sodass eine Sitzung, von der Sie annahmen, dass sie berät, möglicherweise nie beraten hat.

• Einwilligung, die Sie nicht erteilt haben. Wenn Fable als Berater für einen Plan ausgewählt ist, der eine Einwilligung zu Nutzungsguthaben erfordert, werden Anfragen ohne den Berater gesendet, bis Sie sie akzeptieren. Eine Hintergrundsitzung, die mit --advisor fable gestartet wurde, startet ohne einen Berater, anstatt zu beenden.

• Eine Allowlist, die Sie nicht kontrollieren. Wenn die availableModels-Allowlist Ihrer Organisation das Advisor-Modell ausschließt, ruft Claude Code es nicht auf, und Sie müssen mit /advisor ein zulässiges Modell auswählen.

• Überall dort, wo es nicht existiert. Nur Anthropic API: kein Bedrock, keine Claude Platform on AWS, keine Google Cloud Agent Platform, kein Microsoft Foundry. Bei einem Gateway hängt die Verfügbarkeit davon ab, ob das Gateway die Anfrage unverändert an die API von Anthropic weiterleitet – was eine Eigenschaft des Gateways ist und nicht etwas, das man einfach voraussetzen kann.

Wo OrcaRouter passt

Beide Modelle in dieser Schleife sind heute auf OrcaRouter verfügbar zu Anthropics eigenem Listenpreis mit 0 % Aufschlag — der Listenpreis des Anbieters wird durchgereicht, der Tarif, den Sie sehen, ist also der Tarif, den Anthropic veröffentlicht. Claude Fable 5.1 finden Sie unter anthropic/claude-fable-5.1 und Claude Opus 5 unter anthropic/claude-opus-5, hinter einem einzigen API-Schlüssel. Claude Opus 5.5 ist noch keine unserer Routen; es ist über Anthropics eigene API und die großen Clouds verfügbar, und das sagen wir auch, statt etwas anderes anzudeuten.

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

Was ein Schlüssel Ihnen hier kauft, ist die Fähigkeit, Ihre Meinung günstig zu ändern. Die Ökonomie der Schleife hängt vom Preisverhältnis zwischen Executor und Advisor ab, und dieses Verhältnis hat sich zweimal in sieben Wochen verschoben — Opus 5 auf Opus 5.5 am 22. September und Fable 5 auf Fable 5.1 am 1. September, was den Cache-Read dieses Modells von 1,00 $ auf 0,25 $ pro Million senkte. Jede dieser Verschiebungen ändert die Antwort auf die Frage „Lohnt sich der Advisor?“, und diese Antwort zu testen sollte keinen zweiten Vertrag erfordern. Automatisches Failover ist die andere Hälfte: Es ermöglicht Ihnen, einen Teil des Traffics auf ein Modell zu lenken, das Sie noch nicht charakterisiert haben, mit einem Fallback auf das, das Sie bereits haben, statt einen Produktionspfad auf eine Launch-Tabelle zu verwetten. Und wenn Sie das Muster selbst bauen, anstatt das integrierte Tool von Claude Code zu verwenden, fügt die Routing-DSL mehrere Modelle zu einem einzigen Aufruf zusammen — ein Plan-Schritt auf einem Modell, gefolgt von Ausführungsschritten auf einem anderen, hinter einem einzigen Endpoint.

Eine ehrliche Anmerkung zum Umfang: Das Advisor-Tool selbst ist ein serverseitiges Tool, das über Anthropics API läuft, eine Routing-Schicht ist also kein Ersatz dafür. Was wir tun können, ist, die Modelle mit nur einem Schlüssel erreichbar und zum Listenpreis verfügbar zu machen, sodass die Entscheidung, den Advisor zu behalten oder fallen zu lassen, bei Ihnen liegt und Sie sie auf Grundlage Ihrer eigenen Zahlen treffen können.

Wie Sie sich für Ihre eigene Workload entscheiden

Anthropics eigene Leitlinie ist der richtige Ausgangspunkt, und sie ist erfrischend unsentimental: Lassen Sie Ihre Eval-Suite gegen drei Konfigurationen laufen — den Executor allein, den Executor mit einem Berater und das Modell des Beraters allein bei geringem Aufwand — und prüfen Sie bei jedem Modell-Release nach, denn Releases verschieben sowohl die Fähigkeitslücke als auch das Preisverhältnis. Die letzte der drei ist die Baseline, die es zu schlagen gilt. Wenn das Modell Ihres Beraters allein bei geringem Aufwand genauso abschneidet wie die Schleife, aber für weniger Geld, haben Sie Ihre Antwort.

Die beiden Variablen, auf die man achten sollte, sind die, die Anthropic benennt. Die Fähigkeitslücke: Eine große Lücke zwischen Ausführendem und Berater ist der Punkt, an dem der Berater seine Gebühr verdient, und Opus 5.5 hat diese Lücke von unten verkleinert. Die Konsultationsrate: Zugewinne folgen ihr fast eins zu eins, und sie ist prompt-empfindlich genug, um zusammenzubrechen – ein Ausführender mit geringem Aufwand kann aufhören zu bemerken, dass er feststeckt, und eine Paarung, die bei den meisten Aufgaben mit Standardaufwand konsultiert, kann auf nahezu null fallen. Der von Anthropic bereitgestellte System-Prompt verlangt einen Berateraufruf vor der inhaltlichen Arbeit und einen vor dem Abschluss, was auf zwei bis drei Konsultationen pro Aufgabe hinausläuft; die Coding-Paarung, die den Zugewinn von 3,5 Punkten erzielte, lief in diesem Rhythmus. Planen Sie das ein, legen Sie eine Obergrenze fest, und behandeln Sie jede Konsultation darüber als Signal dafür, dass Ihr Ausführender fehlkonfiguriert ist, und nicht dafür, dass die Aufgabe schwierig war.

Für die spezifische Schleife in diesem Artikel erledigen drei konkrete Einstellungen den Großteil der Arbeit. Belasse Claude Opus 5.5 beim standardmäßigen mittleren Aufwand, statt zu hoch zu greifen, denn der Aufwand treibt die Kosten direkt und Anthropics eigene Opus-5.5-Zahlen zeigen, dass der mittlere Aufwand nur sehr wenig einbüßt. Richte den Advisor mit /advisor fable ein und vergewissere dich, dass das Banner tatsächlich erscheint – ein fehlendes Banner bedeutet einen stillschweigend abwesenden Advisor. Und bevor du das Muster skalierst, miss Tokens pro abgeschlossener Aufgabe statt Preis pro Token, denn das ist die Zahl, die die Schleife bewegen soll.

FAQ

Verbraucht der Advisor dasselbe Fable-Kontingent wie eine Fable-Sitzung?

Bei der API-Abrechnung werden Advisor-Tokens zu den eigenen Input- und Output-Tarifen von Fable 5.1 abgerechnet, und Advisor-Ratenlimits beziehen sich auf denselben Bucket pro Modell wie direkte Aufrufe an dieses Modell – daher erscheint ein ratenlimitierter Advisor-Aufruf als Fehler innerhalb des Tool-Ergebnisses, statt deine Anfrage fehlschlagen zu lassen. In Abonnementplänen zählt die Advisor-Nutzung zu den Nutzungslimits deines Plans, mit der Ausnahme, dass ein Fable-Advisor auf Plänen, in denen Fable-Nutzung auf Nutzungsguthaben abgerechnet wird, ebenfalls auf Nutzungsguthaben abgerechnet wird. Die praktische Konsequenz ist, dass der Advisor kein separates Budget ist, das du frei ausgeben kannst; er konkurriert mit allem anderen, was du mit diesem Modell tust.

Was bekommt der Berater eigentlich zu sehen?

Die vollständige Konversation, einschließlich jedes Tool-Aufrufs und jedes Tool-Ergebnisses – Dateiinhalte, Befehlsausgaben, Fehlermeldungen, alles. Sie läuft unter ihrem eigenen, von Anthropic bereitgestellten System-Prompt und liefert einen Plan, eine Korrektur oder ein Stoppsignal. Daraus folgen zwei Details. Erstens liest jede Konsultation das gesamte Transkript erneut, weshalb die Kosten mit der Schleife wachsen, anstatt konstant zu bleiben. Zweitens: Wenn Ihre Sitzung Material berührt, das Sie nicht an ein zweites Modell in der Preisklasse des Beraters senden würden, dann ist der Berater ein zweites Modell, das alles liest.

Was würde die Antwort ändern?

Zwei Dinge, und beide sind näher, als sie scheinen. Wenn unabhängige Benchmarker einen Lauf mit vergleichbarem Aufwand von Opus 5.5 gegen Fable 5.1 veröffentlichen und die Verengung bestätigen, die Anthropic behauptet, ist der verbleibende Vorsprung des Beraters bei den meisten Aufgaben dünn — und die Schleife wird eher ein Werkzeug für den harten Tail als ein Standard. Wenn stattdessen die Konsultationsrate hält und die Fähigkeitslücke bei langen agentischen Arbeiten weit bleibt, ist die obige Rechnung genau die Wahl, zwischen der du stehst, und $6 Beratung bei einem $14-Lauf sind eine günstige Option darauf, nicht das Falsche auszuliefern.

Was sich nicht ändern wird, ist der Mechanismus am Anfang dieses Beitrags. Der Executor-Kontext ist gecacht und günstig; der Advisor-Kontext ist weder das eine noch das andere. Jede Schleife, die mitten in einer Aufgabe ein teureres Modell zu Rate zieht, erbt diese Asymmetrie – ganz gleich, was die Preisliste nächsten Monat sagt.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert