Claude Opus 5: Anthropics Near-Frontier-Modell zum halben Preis von Fable 5
Guides & Insights

Claude Opus 5: Anthropics Near-Frontier-Modell zum halben Preis von Fable 5

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Am 24. Juli 2026 lieferte Anthropic Claude Opus 5 aus – und innerhalb eines Tages gelang etwas, das für ein „günstigeres“ Modell selten ist: Es stieg an die Spitze der unabhängigen Bestenlisten. Anthropic bewarb Opus 5 als Modell, das nahe an die Grenzintelligenz von Claude Fable 5 zu halbem Preis heranreicht, und es wurde am selben Tag über Claude.ai, die Claude API, Claude Code und Claude Cowork eingeführt. Seitdem hat Artificial Analysis es als das #1‑Modell in seinem Intelligenzindex bewertet. Dieser Leitfaden erklärt, was Opus 5 tatsächlich ist, was unabhängig verifiziert versus herstellerberichtet ist, seinen neuen Aufwandsregler und Sicherheitsansatz, was es in der Praxis kostet und wer wechseln sollte.

Jede Abbildung unten ist nach Quelle gekennzeichnet, denn bei dieser Geschwindigkeit ändert sich die Geschichte täglich: Was am Starttag als „noch keine unabhängige Bewertung“ gelesen wurde, ist jetzt „unabhängig #1.“ Benchmarks und Preise ändern sich – überprüfen Sie, bevor Sie Ihr Budget festlegen.

Kurz gesagt. Claude Opus 5 kostet 5 $ pro 1 Mio. Eingabe-Token und 25 $ pro 1 Mio. Ausgabe-Token – identisch mit Opus 4.8 und genau die Hälfte von Fable 5s 10 $ / 50 $. Im Artificial Analysis Intelligence Index führt es nun mit 61 (maximaler Aufwand), das beste Modell von 170 bewerteten, knapp vor Fable 5 (60) und erreicht die gleiche Klasse bei halben Kosten. Anthropics eigene Start-Benchmarks bestätigen dies: Frontier-Bench v0.1 43,3 % (gegenüber Fable 5s 33,7 %), plus Führung bei Zapiers AutomationBench und dem OSWorld 2.0 Computer-Use-Benchmark. Zwei Dinge machen es mehr als eine Preissenkung: ein Aufwandsregler (niedrig/mittel/hoch/max), der Kosten gegen Fähigkeiten pro Anfrage tauscht, und die stärkste Sicherheitshaltung aller bisherigen Opus-Modelle. Wenn Sie bereits auf Claude aufbauen, ist ein Upgrade risikoarm und erhöht Ihre Rechnung nicht; wenn Sie zwischen Flaggschiffen wählen, ist Opus 5 jetzt der Preis-Leistungs- und Qualitätsführer – validieren Sie es mit Ihrer eigenen Arbeitslast.

Wichtige Erkenntnisse

• Nun unabhängig #1. Artificial Analysis listet Claude Opus 5 (max effort) mit 61 auf seinem Intelligence Index – das bestbewertete Modell, vor Fable 5 (60).

Die Hälfte des Preises von Fable 5. $5 / $25 pro 1M Token, gleich wie Opus 4.8 und die Hälfte von Fable 5s $10 / $50 — Spitzenqualität zu einem Preis der mittleren Preisklasse.

• Neuer Aufwand-Drehregler. Niedrig/mittel/hoch/max Einstellungen tauschen Tokens (Kosten) gegen Fähigkeit; „max“ ist das, was die Bestenliste anführt, günstigere Einstellungen schlagen immer noch die meisten Konkurrenten.

• Entwickelt für Agenten und Computernutzung. Anthropic betont das Abschließen mehrstufiger Aufgaben (AutomationBench) und das Bedienen einer echten Benutzeroberfläche (OSWorld 2.0), nicht nur einzelne Antworten.

• Bisher sicherster Opus. Anthropic bezeichnet es als "das am besten ausgerichtete Opus-Modell" und erwartet, dass seine Cyber-Klassifikatoren etwa 85% seltener eingreifen als Fable 5 — weniger falsche Ablehnungen bei legitimer Arbeit.

• Breite, sofortige Verfügbarkeit. Standardmodell auf Claude Max, stärkstes auf Claude Pro und ab dem ersten Tag live auf der API, Claude Code und Claude Cowork.

Eine Anmerkung zum Lesen dieser Zusammenfassung: Alles, was Anthropic zugeschrieben wird, ist eine Anbieterbehauptung aus den Startmaterialien; unabhängige Zahlen (der Intelligence Index) werden Artificial Analysis zugeschrieben. Wenn eine Zahl noch nicht veröffentlicht ist (ein separater SWE-bench Verified Score), geben wir dies an, anstatt zu raten.

Was Claude Opus 5 eigentlich ist

Opus 5 ist das neueste Mitglied der Opus-Reihe von Anthropic – die "schwere" Stufe oberhalb von Sonnet und Haiku. Es ist oberhalb von Opus 4.8 eingeordnet und hat sich im unabhängigen Intelligence Index nun knapp vor Fable 5 geschoben, dem Spitzenmodell von Anthropic vom Juni 2026. Was es bemerkenswert macht, ist nicht eine bescheidene Leistungssteigerung, sondern die Kombination: Intelligenz nahe der Spitzenklasse zu einem Arbeitspferd-Preis. Anthropic beschreibt es als ein "überlegtes und proaktives" Modell, das für Codierung, agentische Workflows und alltägliche Unternehmensbüroarbeit gedacht ist.

Konkret kostet Opus 5 $5 pro 1 Million Input-Tokens und $25 pro 1 Million Output-Tokens. Das ist derselbe Preis wie Opus 4.8 und die Hälfte von Fable 5 mit $10 / $50. Es ist der Standard auf Claude Max und die stärkste Option auf Claude Pro, und es ist ab dem Starttag über die Claude API, Claude Code (fürs Programmieren) und Claude Cowork (für kollaborative Agentenarbeit) verfügbar. Der Kontextfenster ist Opus-Familie 1M-Klasse.

Was ist eigentlich neu

Das klarste Signal am Starttag war Anthropics Frontier-Bench v0.1, eine schwierige Reihe von Denk- und Aufgabenaufgaben: Opus 5 erreicht 43,3 %, gegenüber 33,7 % für Fable 5 und 18,7 % für Opus 4,8. In diesem Benchmark übertrifft Anthropics günstigeres neues Modell sein eigenes teureres Flaggschiff – eine Behauptung, die inzwischen durch unabhängige Bewertungen bestätigt wurde.

Zwei weitere Anbieter-Benchmarks runden die Geschichte „für echte Arbeit entwickelt“ ab. Bei Zapiers AutomationBench, der misst, ob ein Modell eine geschäftliche Aufgabe bis zum Abschluss durchführt, anstatt sie nur zu beginnen, gibt Anthropic an, dass die Bestehensquote von Opus 5 bei vergleichbaren Kosten etwa 1,5-mal so hoch ist wie die des nächstbesten Modells, und dass selbst die günstigste Einstellung das beste Ergebnis jedes Konkurrenten übertrifft. Bei OSWorld 2.0, einem Computer-Nutzungs-Benchmark, berichtet Anthropic, dass Opus 5 zu jedem Preisniveau die Konkurrenz übertrifft und die Spitzenpunktzahl von Fable 5 mit etwa einem Drittel des Budgets übertrifft. Opus 5 verbessert sich auch gegenüber Opus 4.8 in jeder Life-Sciences-Bewertung, die Anthropic verfolgt, mit dem größten Sprung – über 10 Prozentpunkte – bei organisch-chemischen Aufgaben wie dem Ablesen von Molekülstrukturen aus Spektroskopiedaten.

Der Aufwandsregler: Nur für die benötigte Fähigkeit bezahlen.

Die Hauptfunktion – und diejenige, auf die sich die meisten Rezensenten konzentrieren – ist die Aufwandeinstellung. Opus 5 lässt Sie wählen, wie viel Aufwand das Modell für eine Anfrage aufwendet: niedrig, mittel, hoch oder maximal. Höherer Aufwand bedeutet mehr interne Denk-Token (also höhere Kosten und Latenz) und höhere Qualität; geringerer Aufwand spart Token für schnellere, günstigere Antworten. Es ist im Grunde ein Regler für Ihre KI-Rechnung.

Deshalb führt Artificial Analysis mehrere Opus 5-Einträge auf (medium, high, xhigh, max): Jede Anstrengungsstufe ist ein anderer Punkt auf der Kosten-Qualitäts-Kurve. Die Einstellung „max“ ist derzeit die Spitze des Intelligence Index mit 61; die niedrigeren Einstellungen tauschen ein wenig Qualität gegen deutlich niedrigere Kosten pro Aufgabe, und selbst sie übertreffen laut Anthropic die besten Ergebnisse der meisten Konkurrenten. In der Praxis bedeutet das, dass ein Modell sowohl Ihre latenzempfindlichen, hochvolumigen Anrufe (low/medium) als auch Ihre schwierigsten Denkaufgaben (high/max) bedienen kann – Sie passen es pro Anfrage an, anstatt die Modelle zu wechseln.

Der Benchmark-Deep-Dive: Was diese Tests tatsächlich messen

Es hilft zu wissen, was jede Zahl bedeutet, bevor man ihr vertraut. Der Artificial Analysis Intelligence Index ist eine Kombination vieler unabhängiger Bewertungen (Logik, Mathematik, Programmierung, Wissen), die von einem Dritten durchgeführt wurden; ein Wert von 61, der Opus 5 auf den ersten Platz von 170 Modellen setzt, ist hier das glaubwürdigste Einzelsignal, gerade weil Anthropic ihn nicht durchgeführt hat. Frontier-Bench v0.1 (43.3% für Opus 5) ist Anthropics eigener schwieriger Testsatz – ein relatives Signal, dass Opus 5 schwierigere Probleme löst als Fable 5 (33.7%) oder Opus 4.8 (18.7%), nicht "43% korrekt" im schulischen Sinne.

AutomationBench und OSWorld 2.0 sind wichtiger als eine einzelne Reasoning-Punktzahl, wenn Ihr Anwendungsfall Agenten sind. AutomationBench belohnt die Aufgabenerledigung – der Unterschied zwischen einem Agenten, der eine E-Mail entwirft, und einem, der tatsächlich den Spesenbericht einreicht – und OSWorld 2.0 belohnt die Steuerung einer echten Computer-Benutzeroberfläche. Anthropics Behauptung, dass Opus 5 den OSWorld-Spitzenwert von Fable 5 zu einem Drittel der Kosten erreicht, ist, da der Intelligence Index nun seine allgemeine Stellung bestätigt, ein starkes Argument, agentische Arbeitslasten auf Opus 5 zu verlagern. Die eine Lücke: Es gibt noch keine separate, unabhängig geprüfte SWE-bench Verified-Zahl für Opus 5 (Fable 5 liegt bei 95,0 %, Opus 4.8 bei 88,6 %), also warten Sie für eine reine Code-Genauigkeitsangabe auf diese Zahl.

Was es in der Praxis kostet

Preise pro Token sind abstrakt; die Kosten pro Aufgabe sind das, was auf Ihrer Rechnung erscheint. Nehmen Sie einen repräsentativen Agentenschritt von 20.000 Eingabe-Token und 3.000 Ausgabe-Token. Opus 5 (und Opus 4.8): Eingabe 20k × 5 $/1M = 0,10 $, Ausgabe 3k × 25 $/1M = 0,075 $, also etwa 0,175 $ pro Aufruf. Fable 5 zu 10 $ / 50 $: 0,20 $ Eingabe + 0,15 $ Ausgabe = etwa 0,35 $ — ungefähr das Doppelte. Bei 100.000 solcher Aufrufe pro Monat ergibt das etwa 17.500 $ für Opus 5 gegenüber etwa 35.000 $ für Fable 5. Da der Intelligence Index Opus 5 nun vor Fable 5 einordnet, handelt es sich nicht um „Fast-Fable-5 zum niedrigeren Preis“ – es ist führende Qualität für etwa die Hälfte der monatlichen Rechnung.

Der Aufwandsregler ändert die Rechnung erneut. Eine Pipeline für Support mit hohem Volumen kann die meisten Anrufe mit niedrigem oder mittlerem Aufwand bearbeiten – günstiger als die obigen Zahlen – und den maximalen Aufwand für die wenigen wirklich schwierigen Tickets reservieren. Die Darstellung von Anthropic ist, dass selbst die günstigen Einstellungen die besten der Konkurrenz übertreffen, sodass Sie selten für Fähigkeiten bezahlen, die Sie nicht nutzen. Modellieren Sie Ihre eigene Mischung von Aufwandsstufen, anstatt anzunehmen, dass jeder Anruf mit maximalem Aufwand läuft.

Wie man auf Claude Opus 5 zugreift und es verwendet

Opus 5 ist ab sofort an fünf Orten verfügbar: Claude.ai (wo es auf dem Max-Plan die Standardeinstellung und die stärkste Option auf Pro ist), die Claude-API (Modell-ID in den Anthropic-Dokumenten), Claude Code (für Terminal- und IDE-Codierung) und Claude Cowork (für kollaborative, mehrstufige Agentenarbeit). API-Nutzer legen den Aufwandsgrad als Parameter fest, sodass der Kompromiss zwischen Kosten und Leistung pro Anfrage programmierbar ist. Wenn Sie bereits Opus 4.8 aufrufen, ist der Wechsel eine Modell-ID-Änderung zum gleichen Preis – das Upgrade mit der geringsten Reibung, das Anthropic seit einiger Zeit ausgeliefert hat.

Für wen es gedacht ist: drei Szenarien

1. Agentenbasierte und Computer-Nutzungs-Pipelines

Wenn Ihr Produkt mehrstufige Agenten ausführt oder einen Browser oder Desktop steuert, richten sich die Ergebnisse von Opus 5's AutomationBench und OSWorld 2.0 direkt an Sie — jetzt untermauert durch einen unabhängigen #1 Intelligence Index. Führen Sie die meisten Schritte mit mittlerem Aufwand durch und steigern Sie sich bei den schwierigen auf hoch/maximal; pilotieren Sie zuerst mit Ihren eigenen Agent-Traces, bevor Sie sich festlegen.

2. Coding-Teams, die das Budget überwachen

Opus 5 ist von Anfang an in Claude Code zum Preis von Opus 4.8 erhältlich. Mit dem Intelligence-Index-Vorsprung ist es ein starker Standard-Coder; die einzige fehlende Bestätigung ist eine unabhängige SWE-bench-Verified-Zahl (Fable 5 hält diesen Rekord weiterhin mit 95,0%). Für Teams, die bereits Claude nutzen, ist das Upgrade risikoarm und ohne Preiserhöhung.

3. Unternehmen, die auf ein Modell standardisieren

Breite Verfügbarkeit, 1M-Klassen-Kontext, das sicherste Opus-Ausrichtungsprofil und ein Aufwandsregler, der sowohl günstige Massenarbeit als auch schwieriges Denken abdeckt, machen Opus 5 zu einem plausiblen einzelnen Standard für gemischte Büro- und Ingenieurarbeiten – zu Kosten, die weitaus leichter zu verteidigen sind als ein Grenzflaggschiff.

Sicherheit und Ausrichtung

Anthropic positioniert Opus 5 als sein sicherstes Opus-Release: "das am besten ausgerichtete Opus-Modell" und "das am wenigsten anfällige dafür, zu Missbrauch verleitet zu werden." Eine praktische Konsequenz ist für reale Einsätze relevant: Anthropic erwartet, dass die Cyber-Klassifikatoren von Opus 5 etwa 85 % seltener eingreifen als die von Fable 5. Einfach ausgedrückt bedeutet das weniger Fehlablehnungen bei legitimen Sicherheits-, Programmier- oder Forschungsarbeiten – eine häufige Frustration bei stark abgesicherten Frontier-Modellen – während echter Missbrauch weiterhin blockiert wird. Wie immer solltest du anhand deiner eigenen Inhalte und Compliance-Anforderungen validieren, statt die Haltung blind zu übernehmen.

Die Fable-5-Exportkontroll-Geschichte ist jetzt im Systemprompt enthalten.

Der Start von Fable 5 verlief alles andere als reibungslos, und dieser Kontext ist für jeden wichtig, der Claude Opus 5 damit vergleicht. Drei Tage nachdem Claude Fable 5 und Claude Mythos 5 am 9. Juni 2026 veröffentlicht wurden, setzte Anthropic beide Modelle aus, um einer Exportkontrollanordnung des US-Handelsministeriums nachzukommen; die Kontrollen wurden am 30. Juni aufgehoben und der Zugriff am 1. Juli wiederhergestellt. Diese Abfolge ist dokumentierte Geschichte — Simon Willison beobachtete in Echtzeit, wie die Anthropic-API begann, Fehler zu melden, und Anthropic veröffentlichte eine eigene Stellungnahme zur Aussetzung und Wiederherstellung.

Neu ist, wie Opus 5 mit Fragen dazu umgeht. Der Trainingsstichtag des Modells liegt im Mai 2026, daher fallen die Abschaltung und ihre Rücknahme außerhalb dessen, was es gelernt hat. Der etwa 200.000 Zeichen umfassende Claude Opus 5 System-Prompt, den der Red-Teamer Pliny the Liberator am 25. Juli veröffentlichte — ein Dokument, von dem Anthropic nicht bestätigt hat, dass es der Produktionsversion entspricht —, verzeichnet die vollständige Zeitleiste und weist das Modell an, Fragen zur Aussetzung offen zu beantworten, statt sie zu leugnen, und verweist die Nutzer auf die offizielle Stellungnahme von Anthropic, wenn es den aktuellen Status nicht bestätigen kann. Es ist ein konkretes Beispiel dafür, dass ein Anbieter die Ereignisse nach dem Trainingsstichtag in den Prompt aufnimmt, damit das Modell nicht über seine eigene Produktfamilie improvisiert.

Wann nicht verwenden

Greifen Sie nicht zu Opus 5, wenn Sie heute speziell eine unabhängig geprüfte SWE-bench Verified Kennzahl zum Zitieren benötigen – diese Zahl ist noch nicht veröffentlicht, und Fable 5 (95.0%) hält sie weiterhin. Gehen Sie nicht davon aus, dass jede Effort-Stufe die Nummer 1 ist; die 61 an der Spitze der Rangliste ist die maximale Stufe, und niedrigere Stufen tauschen etwas Qualität gegen Kosten ein, also testen Sie die Effort-Stufe, die Sie tatsächlich verwenden werden. Und für reine Massentexte mit geringer Latenz und ohne Denkanforderung ist ein günstigeres Effizienzstufen-Modell (zum Beispiel Gemini 3.6 Flash zu $1.50 / $7.50) pro Token immer noch günstiger – Opus 5 ist ein Reasoning- und Agent-Modell, kein Massentext-Modell.

FAQ

Wie viel kostet Claude Opus 5?

$5 pro 1 Million Eingabe-Token und $25 pro 1 Million Ausgabe-Token — das gleiche wie Opus 4.8 und die Hälfte von Fable 5's $10 / $50. [Anthropic]

Ist Opus 5 wirklich das #1 Modell?

Im Artificial Analysis Intelligence Index liegt zum Zeitpunkt dieses Schreibens Claude Opus 5 (max effort) mit 61 von 170 Modellen vorn, vor Fable 5 (60). Das ist eine unabhängige Bewertung, keine Herstellerangabe. Andere Bestenlisten und Ihre eigene Arbeitslast können anders einordnen, und die Rangfolgen ändern sich, wenn Modelle hinzugefügt werden.

Was ist der Aufwandregler?

Eine pro Anfrage festlegbare Einstellung (niedrig/mittel/hoch/maximal), die Tokens – und damit Kosten und Latenz – gegen Fähigkeiten eintauscht. Max führt die Rangliste an; günstigere Einstellungen schlagen laut Anthropic immer noch die meisten Konkurrenten. API-Nutzer legen es als Parameter fest.

Ist Opus 5 besser als Fable 5?

Beim unabhängigen Intelligence Index (61 vs 60) und Anthropics Frontier-Bench v0.1 (43,3 % vs 33,7 %), ja – zum halben Preis. Fable 5 führt weiterhin den unabhängig gemessenen SWE-bench Verified (95,0 %) an, also behält Fable 5 für reine Code-Genauigkeitszitate diese spezifische Krone.

Wie schneidet Opus 5 im Vergleich zu Opus 4.8 ab?

Gleicher $5/$25-Preis, wesentlich höhere Vendor-Benchmarks (Frontier-Bench v0.1 43.3% vs 18.7%) und Zuwächse bei jeder verfolgten Life-Sciences-Evaluation, plus der neue Effort-Dial und sicherere Ausrichtung. Für bestehende 4.8-Nutzer ist es ein Upgrade ohne Preiserhöhung.

Wie sicher ist es?

Anthropic bezeichnet es als das am stärksten ausgerichtete Opus-Modell und das am wenigsten anfällige für Missbrauch, und erwartet, dass seine Cyber-Klassifikatoren etwa 85 % seltener eingreifen als die von Fable 5 — typischerweise weniger falsche Ablehnungen bei legitimer Arbeit.

Wo kann ich Claude Opus 5 verwenden?

Claude.ai (Standard auf Max, stärkste auf Pro), die Claude API, Claude Code und Claude Cowork — live seit dem 24. Juli 2026.

Was ist das Kontextfenster?

Opus-Familie der 1M-Token-Klasse (Opus 4.8 ist 1M ohne Aufpreis für langen Kontext). Anthropic hat keine separate Opus-5-Zahl bekannt gegeben, behandeln Sie es also als 1M-Klasse, bis es bestätigt ist.

Unterstützt es Bilder oder Videos?

Opus 5 ist hauptsächlich ein Text- und Werkzeug-Denkmodell. Für das Verständnis von stark multimodalen Inhalten (Bild/Video) ist ein Modell wie Gemini 3.1 Pro speziell entwickelt; verwenden Sie Opus 5 für Text, Code und Agents.

Fazit

{{1}}Claude Opus 5 entpuppte sich als mehr als nur eine Preismaßnahme.{{/1}} Es ist wie ein Arbeitstier bepreist – $5/$25, die Hälfte von Fable 5 und dasselbe wie Opus 4.8 –, führt aber jetzt den unabhängigen {{2}}Artificial Analysis Intelligence Index{{/2}} bei 61 (maximalem Aufwand) an, gestützt auf starke Anbieter-Benchmarks ({{3}}Frontier-Bench v0.1 43.3%, AutomationBench, OSWorld 2.0{{/3}}), einen wirklich nützlichen Aufwand-Regler und das sicherste Alignment-Profil aller Opus-Modelle. Der eine Vorbehalt ist eine noch fehlende unabhängige {{4}}SWE-bench Verified{{/4}}-Zahl, wo {{5}}Fable 5 (95.0%){{/5}} den Genauigkeitsnachweis beim Codieren behält. Für bestehende Claude-Nutzer ist das Upgrade risikoarm und erhöht die Rechnung nicht; für alle anderen ist Opus 5 jetzt das Modell, das es in Sachen Qualität pro Dollar zu schlagen gilt – validieren Sie es mit Ihrer eigenen Arbeitslast und leiten Sie es zusammen mit jedem Konkurrenten über einen {{6}}OpenAI-kompatiblen{{/6}} Endpunkt bei {{7}}OrcaRouter{{/7}}.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert

© 2026 OrcaRouter

Für Anbieter

Du betreibst eine Inferenz-Plattform? Bring deine Modelle auf OrcaRouter.

providers@orcarouter.ai

Community beitreten

Discordsupport@orcarouter.aiXGitHubYouTube