
Claude Fable 5.1 vs Gemini 3.1 Pro: Ein neun Tage altes Flaggschiff gegen eine sieben Monate alte Vorschau
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiNEUOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleNEUGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenNEUQwen: Qwen3.8 Max (0902)2026-09-0240Intelligenz72Coding
- anthropicNEUAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligenz69Coding
Stellt man die falsche Frage zu Claude Fable 5.1 und Gemini 3.1 Pro Preview, bekommt man eine langweilige Antwort: Das neue Anthropic-Flaggschiff ist leistungsfähiger, das Google-Modell ist günstiger, Punkt. Die Frage, die dieses Duell tatsächlich entscheidet, ist eine Frage des Alters. Claude Fable 5.1 erschien am 1. September 2026 und ist damit zum Zeitpunkt des Schreibens neun Tage alt. Gemini 3.1 Pro Preview erschien am 19. Februar 2026, und Google bezeichnet es immer noch als Vorschau – was es zu einem Modell macht, das nun seit fast sieben Monaten unverändert dasteht, während eine Parade neuerer Gemini-Veröffentlichungen (die 3.5-, 3.6- und 3.7-Flash-Stufen sowie der Gemini 3.8 Flash vom 2. September) auf den Markt kam, getestet wurde und es überholte. Diese beiden zu vergleichen ist weniger eine Benchmark-Übung als eine Wette auf zwei sehr unterschiedliche Veröffentlichungsphilosophien, und die Aktualitätslücke ist das, was jedes Datenblatt auslässt.
Sieben Monate Vorschau, neun Tage Flaggschiff
Gemini 3.1 Pro war im Februar Googles führendes Reasoning-Modell – damals „Frontier“ – mit starken Software-Engineering- und Agentic-Ansprüchen und einem nativen multimodalen Fundament, das es noch immer auszeichnet. Google hat es seitdem nicht als allgemein verfügbar (GA) freigegeben. In den sieben Monaten, in denen es in der Vorschau war, hat Anthropic zwei Flaggschiff-Generationen veröffentlicht: Claude Opus 5 am 24. Juli und nun Claude Fable 5.1, das Anthropic als eine Mythos-Klasse über der Opus-Klasse positioniert und das mit 66 den ersten Platz im Artificial Analysis Intelligence Index belegte. Wenn du auf Gemini 3.1 Pro setzt, kaufst du ein Modell, dessen Nachfolgeentscheidungen Google bereits effektiv anderswo in seiner Produktpalette getroffen hat; wenn du auf Claude Fable 5.1 setzt, kaufst du das Modell, das Anthropic derzeit verbessert.
Diese Asymmetrie zeigt sich im Kleingedruckten. Eine eingefrorene Vorschau birgt das Risiko, dass die Fähigkeit, auf die Sie sich standardisieren, nie den GA-Schliff, die Preisanpassung oder die nachfolgenden Point-Release-Versionen erhält. Ein neun Tage altes Flaggschiff birgt das gegenteilige Risiko – dass nächsten Monat eine 5.2 oder ein Point-Release erscheint und die Zielvorgaben verschiebt. Keines der Risiken ist vermeidbar; der Punkt ist, dass sie in entgegengesetzte Richtungen weisen, und welches Sie tolerieren können, ist ein echter Eingangsfaktor für diese Entscheidung.
Das Datenblatt, Seite an Seite
• Preis — Claude Fable 5.1 $10.00 / $50.00 pro 1M vs. Gemini 3.1 Pro $2.00 / $12.00 pro 1M bis zu 200K Eingabetokens, danach $4.00 / $18.00 über 200K. Im Basistarif etwa 5x günstiger bei der Eingabe und 4x bei der Ausgabe.
• Kontext / max. Ausgabe – beide mit 1M-Token-Kontext; Claude Fable 5.1 gibt bis zu 128K aus, gegenüber einer Obergrenze von ~65K bei Gemini 3.1 Pro.
• Eingaben — Claude Fable 5.1 verarbeitet Text und Bilder. Gemini 3.1 Pro verarbeitet Text, Bilder, Audio, Video und PDFs, mit nativer Google-Suche-Anbindung.
• Unabhängiger Score — Claude Fable 5.1 bei 66 im Artificial Analysis Intelligence Index (maximale Anstrengung) vs. Gemini 3.1 Pro im oberen 40er-Bereich (startete bei 57 und ist nach unten abgedriftet, als AA seine Auswertungen erneut durchführte).
• Geschwindigkeit — Gemini 3.1 Pro streamt laut eigener Telemetrie von OrcaRouter etwa 540 Tokens/Sekunde, gegenüber den 67,2 Tokens/Sekunde, die Artificial Analysis für Claude Fable 5.1 gemessen hat — eine große Durchsatzlücke in die andere Richtung.
• Status — Claude Fable 5.1 stabil, GA, veröffentlicht am 01.09.2026; Gemini 3.1 Pro Preview, veröffentlicht am 19.02.2026, Stand Mitte September 2026 noch nicht allgemein verfügbar (GA).

Das Benchmark-Bild, ehrlich beschriftet.
Bei der rohen Leistungsfähigkeit sind die beiden Modelle nicht in derselben Klasse, und der unabhängige Index sagt das klarer als jede Herstellerfolie. Claude Fable 5.1s 66 im Artificial Analysis Intelligence Index (maximale Anstrengung) ist der höchste Wert, den AA je verzeichnet hat – allerdings listet AAs Modellseite für die Standard-Fallback-Konfiguration, die Anthropic ausliefert, 53, immer noch Platz 1 von 201 – während Gemini 3.1 Pro bei den oberen 40ern liegt. Bei den von Anthropic gemeldeten Komponenten-Benchmarks erzielt Fable 5.1 55,8 % bei Terminal-Bench 4.0 und 52,6 % bei Terminal-Bench-Science 0.1 – Werte, die in keinem unabhängigen Test bisher Gemini 3.1 Pro zugeschrieben wurden. Bei den weithin bestätigten SWE-bench-artigen Kategorien bleiben die Behauptungen von Gemini 3.1 Pro aus der Februar-Ära (etwa 75 % bei SWE-bench Verified laut Drittanbieter-Trackern) weit hinter der aktuellen Claude-Generation zurück.
Der ehrliche Vorbehalt gilt umgekehrt für alles Multimodale. Gemini 3.1 Pro liest natives Audio, natives Video und PDFs und hat die Google-Suche direkt ins Modell integriert – Fähigkeiten, die Claude Fable 5.1 überhaupt nicht bietet, da das Flaggschiff von Anthropic nur Text und Bilder verarbeitet. Bei langen Dokumenten, langen Videos oder suchgestützten Aufgaben ist Gemini 3.1 Pro nicht nur günstiger; es ist das einzige der beiden, das die Aufgabe in einem einzigen Aufruf bewältigen kann. Das ist ein echter Vorteil, und es ist leicht, ihn zu unterschätzen, wenn jeder Benchmark, den man betrachtet, auf Text und Code basiert.

Die Preisklippe verbirgt die wahre Kostengeschichte.
Der beworbene Preis von $2 / $12 bei Gemini 3.1 Pro gilt nur unterhalb von 200K Eingabe-Token pro Anfrage. Oberhalb dieser Grenze wird die gesamte Anfrage zu $4.00 Eingabe und $18.00 Ausgabe neu bepreist – eine Verdoppelung der Eingabekosten, die Gemini-Aufrufe mit langem Kontext weit weniger günstig macht, als die Marketingzahl vermuten lässt. Der Preis von $10 / $50 bei Claude Fable 5.1 bleibt über alle Längen konstant, mit Cache-Lesezugriffen bei $0.25, die relativ zum eigenen Listenpreis umso günstiger werden, je öfter eine Sitzung Kontext erneut liest. Der Umschlagpunkt hängt von der Arbeitslast ab: Kurze, hochvolumige multimodale Aufrufe sprechen haushoch für Gemini 3.1 Pro; lange Agentensitzungen, die wiederholt einen großen Kontext erneut lesen, begünstigen die Cache-Ökonomie von Claude Fable 5.1, noch bevor Fähigkeiten ins Spiel kommen.
Wer sollte welche auswählen?
Wählen Sie Gemini 3.1 Pro, wenn die Workload wirklich multimodal oder suchgestützt ist, wenn Ihnen Durchsatz zu niedrigem Preis wichtiger ist als die Spitze der Reasoning-Kurve, und wenn Sie sich damit wohlfühlen, auf ein Modell zu standardisieren, das Google seit sieben Monaten in der Vorschau belassen hat — idealerweise mit einem Migrationspfad zu dem, was Google als Nächstes allgemein verfügbar macht. Wählen Sie Claude Fable 5.1, wenn Sie die aktuelle Reasoning-Obergrenze benötigen, wenn Sie Agenten mit langem Zeithorizont bauen, bei denen die 128K-Ausgabegrenze und die Cache-Reads zu 0,25 $ wichtig sind, und wenn Sie eher auf ein Modell setzen möchten, das sein Anbieter aktiv verbessert. Beide sind über OrcaRouter zu den Listenpreisen ihrer Anbieter verfügbar ohne Aufschlag, sodass die Routing-DSL-Version dieser Entscheidung später kostengünstig zu ändern ist: senden Sie multimodalen und hochvolumigen Traffic an Gemini 3.1 Pro, stufen Sie den anspruchsvollen Reasoning- und Agentic-Traffic auf Claude Fable 5.1 hoch und justieren Sie die Aufteilung neu, sobald Google seine Pro-Stufe endlich allgemein verfügbar macht — oder sobald Anthropic das ausliefert, was nach Fable 5.1 kommt.

In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
