Hero-Titelkarte mit der Aufschrift „GPT-6 Sol Pro vs Gemini 3.1 Pro Preview“ und dem Untertitel „Sieben Monate Vorschau – und was das kostet“, mit dem echten OrcaRouter-Logo unten rechts.
Guides & Insights

GPT-6 Sol Pro vs. Gemini 3.1 Pro Preview: Sieben Monate Preview – und was dich das kostet

Autor

Alistair Wren

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Gemini 3.1 Pro Preview befindet sich seit sieben Monaten in der Vorschau. Der Anbieter hat es am 19. Februar 2026 zu 2,00 $ pro Million Eingabe-Token und 12,00 $ pro Million Ausgabe-Token veröffentlicht, und seit dieser Woche beschreibt die Modellkarte es nach wie vor als „in Vorschauform angeboten“, warnt, dass es „im Vergleich zu stabilen Releases Einschränkungen bei der Stabilität oder Verfügbarkeit aufweisen kann“, und erklärt, dass es „ohne Vorankündigung Änderungen erfahren oder eingestellt werden könnte“. In der Deprecation-Tabelle gibt es kein Datum für die allgemeine Verfügbarkeit und kein Abschaltdatum. GPT-6 Sol Pro – die Konfiguration von GPT-6 Sol, dem Modell, das am 22. September 2026 zu 2,00 $ für Eingabe und 10,00 $ für Ausgabe allgemein verfügbar wurde – ist die entgegengesetzte Konstellation: eine Produktions-API mit veröffentlichten Preisen, einem dokumentierten Effort-Regler und einem Anbieter, der sich auf die Zahl festgelegt hat.

Der interessante Vergleich zwischen diesen beiden Modellen ist nicht die Benchmark-Tabelle, sondern das, was jeder Anbieter Ihnen für das nächste Quartal versprochen hat.

Zwei Preiszeilen, von denen eine eine Vorschau ist

Beides sind Anbieterlisten. Googles und OpenAIs eigene Zahlen, unverändert weitergegeben von den Plattformen, die sie hosten.

• Eingabe — GPT-6 Sol 2,00 $ pro Million Tokens vs. Gemini 3.1 Pro Preview 2,00 $ pro Million Tokens

• Ausgabe — GPT-6 Sol 10,00 $ pro Million Token vs. Gemini 3.1 Pro Preview 12,00 $ pro Million Token

• Langkontext — Gemini 3.1 Pro Preview berechnet Eingaben ab einer Schwelle von 200.000 Tokens mit 4,00 $ und Ausgaben mit 18,00 $ pro Million Tokens neu; GPT-6 Sol wendet seine eigene Langkontext-Preisanpassung oberhalb einer höheren Eingabeschwelle an

• Cache-Lesevorgang — GPT-6 Sol 0,20 $ pro Million Tokens vs. Gemini 3.1 Pro Preview 0,20 $ pro Million Tokens

• Kontextfenster — GPT-6 Sol 1.050.000 Token vs. Gemini 3.1 Pro Preview 1.000.000 Token

• Maximale Ausgabe — GPT-6 Sol 128.000 Tokens vs. Gemini 3.1 Pro Preview 65.000 Tokens

• Eingabemodalitäten — GPT-6 Sol Text und Bild vs. Gemini 3.1 Pro Preview Text, Bild, Audio, Video und Datei

• Verfügbarkeitsstatus — GPT-6 Sol seit 22. September 2026 allgemein verfügbar vs. Gemini 3.1 Pro Preview seit 19. Februar 2026 in der Vorschau, ohne angekündigtes GA-Datum

Die beworbenen Preise liegen nah genug beieinander, dass sie nicht ausschlaggebend sind. Die Eingabe ist identisch. Die Ausgabe unterscheidet sich um 20 %. Die wahren Unterschiede sind die in den letzten beiden Zeilen: Gemini bietet vier weitere Eingabemodalitäten, das andere Modell die doppelte Ausgabengrenze in die andere Richtung — 65.000 Tokens gegenüber 128.000 — und ist seit fast einem Jahr als Vorschau verfügbar.

A two-column scoreboard card titled 'GPT-6 Sol vs Gemini 3.1 Pro Preview - the scoreboard'. Left column 'GPT-6 Sol': AA Index, current 48; index at Feb 2026 not scored; price in/out $2 / $10; cost per index task $1.06; max output 128K; input modalities text + image. Right column 'Gemini 3.1 Pro Preview': AA Index, current 30; index at Feb 2026 57, retired index; price in/out $2 / $12; cost per index task $0.67; max output 65K; input modalities text, image, audio, video. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Der Vorschau-Status ist eine echte operative Eigenschaft

Googles eigener Katalogtext sagt Entwicklern, sie sollen die Abschaffung von Vorschauversionen einplanen. Dieser Satz hat es in sich, und es lohnt sich, ihn als technische Randbedingung statt als Haftungsausschluss zu lesen.

Ein Preview-Modell ist eines, auf dem man aufbauen, mit dem man aber nicht planen kann. Daraus folgen drei Konsequenzen, und keine davon taucht in einer Preistabelle auf.

• Keine Stabilitätszusage. In der Modellkarte steht unmissverständlich, dass das Modell im Vergleich zu stabilen Releases Einschränkungen bei der Stabilität aufweisen kann und dass OrcaRouter für dieses Vorschaumodell keine spezifischen Latenzgarantien bietet. Unsere eigenen Telemetriedaten auf der Modellseite zeigen, dass die p50- und p95-Werte für die Zeit bis zum ersten Token über die vergangene Woche hinweg beide bei 10,00 Sekunden liegen, was dem oberen Rand des Anzeigebereichs entspricht und nicht einem gemessenen Median.

• Kein Abschaltdatum. Ein Modell mit einem Abschaltdatum kann aus einer Roadmap herausgeplant werden. Ein Modell mit weder einem GA-Datum noch einem Abschaltdatum kann überhaupt nicht eingeplant werden – weder in die eine noch in die andere Richtung: Sie wissen nicht, wann es sicher wird, sich darauf zu verlassen, und Sie wissen nicht, wann es aufhören wird zu funktionieren.

• Keine Position auf der Roadmap. Google hat neuere Flash-Modelle derselben Familie ausgeliefert, die Gemini 3.1 Pro inzwischen bei unabhängigen Composites übertreffen, darunter Gemini 3.8 Flash am 2. September 2026. Die 3.5-Pro-Generation wurde verzögert und Berichten zufolge beiseitegelegt. Es gibt kein Gemini 3.8 Pro. Das Modell, das den Namen Pro trägt, ist nicht mehr der Spitzenreiter seines Anbieters und befindet sich weiterhin in der Vorschauphase.

Das ist die ehrliche Einordnung für alle, die zwischen diesen beiden wählen. GPT-6 Sol ist sechs Tage alt und hat einen festen, veröffentlichten, dauerhaften Preis. Gemini 3.1 Pro Preview ist sieben Monate alt und hat statt einer Roadmap eine Statuszeile.

Was die unabhängige Aufzeichnung zeigt und warum die Versionsbezeichnung das ganze Argument ist

Artificial Analysis veröffentlicht für genau dieses Paar auf dem aktuellen Index eine direkte Vergleichsseite, was es zu einer der wenigen Paarungen in diesem Batch macht, bei denen die neutralen Zahlen wirklich direkt vergleichbar sind. GPT-6 Sol erzielt bei maximalem Aufwand 48 bei 1,06 $ pro Index-Aufgabe. Gemini 3.1 Pro Preview erzielt 30 bei 0,67 $ pro Index-Aufgabe.

Achtzehn Punkte sind eine große Lücke, und es ist nicht die Lücke, die das Modell im Februar hatte. Beim Start platzierte Artificial Analysis Gemini 3.1 Pro Preview mit 57 Punkten auf Platz eins seines Intelligence Index. Das Modell hat sich seitdem nicht verändert. Der Index hingegen schon – er wurde am 19. September 2026 neu bewertet, und dasselbe unveränderte Modell steht nun bei 30. Beide Zahlen stammen von Artificial Analysis; keine von beiden ist falsch; sie ohne die Versionsangabe nebeneinanderzustellen ist der mit Abstand häufigste Fehler in der Berichterstattung über dieses Modell, und deshalb wird ein Februar-Spitzenreiter auf so vielen Vergleichsseiten als im September gleichauf beschrieben.

Die Kosten pro Aufgabe erzählen eine zweite Geschichte, bei der sich das Nachrechnen lohnt. Gemini ist pro Aufgabe günstiger – 0,67 $ gegenüber 1,06 $ –, erzielt aber eine niedrigere Punktzahl. Die Kosten pro Indexpunkt belaufen sich auf 0,022 $ für GPT-6 Sol und 0,022 $ für Gemini. Gemessen daran liegen die beiden gleichauf, was die klarste Art ist zu sagen, was hier tatsächlich passiert: Gemini ist nicht der günstigere Weg, dieselbe Intelligenz zu kaufen, sondern der günstigere Weg, weniger davon zu kaufen.

Zwei weitere unabhängige Zahlen gehören daneben, beide gekennzeichnet. Auf OSWorld-Verified, dem Computer-Use-Benchmark, gibt Googles eigene Evaluierungsseite 76,2 % für Gemini 3.1 Pro an. Diese Zahl erscheint in Googles Materialien und in Zusammenfassungen Dritter dazu, und sie taucht nicht auf dem unabhängig verifizierten OSWorld-Board auf, das andere Gemini-Modelle auflistet – 3.6 Flash mit 83 %, 3.5 Flash mit 78,4 % – und überhaupt keine Zeile für 3.1 Pro enthält. Auf dem schwierigeren OSWorld-2.0-Board erzielt das Modell 30,6 %. Und auf GDPval-AA liegt das Modell bei rund 1.316 Elo, hinter Claude Sonnet 4.6 und Claude Opus 4.6.

Das ist kein Vorwurf der Böswilligkeit; selbst gemeldete Zahlen sind normal, und beide Anbieter veröffentlichen sie. Es ist eine Aussage darüber, was eine sieben Monate alte Vorschau einem tatsächlich bietet: genug Zeit, damit sich eine vom Anbieter gemeldete Zahl weithin verbreitet, und nicht genug unabhängige Replikation, um die Zahl überprüfen zu können. Im Gegensatz dazu ist die neutrale Bilanz von GPT-6 Sol kurz, eindeutig und sechs Tage alt.

Eine fünfzehnmonatige Wissenslücke, die niemand erwähnt

Der Wissensstand von Gemini 3.1 Pro Preview endet im Januar 2025. Der von GPT-6 Sol endet am 20. April 2026 – fünfzehn Monate später.

Diese Lücke fehlt auf jeder Vergleichsseite zu diesem Duell, und sie wiegt für eine bestimmte Art von Arbeit schwerer als der Unterschied beim Ausgabepreis: alles, was aktuelle APIs, aktuelle Bibliotheksversionen, aktuelle Ereignisse oder aktuelle organisatorische Fakten betrifft. Ein Modell mit einem Wissensstand bis Januar 2025 wird selbstsicher über eine Welt antworten, die ein Jahr und ein Quartal weitergezogen ist, und der Fehlermodus ist keine Fehlermeldung — es ist eine plausibel falsche Antwort. Bei retrieval-augmentierter Arbeit ist der Wissensstand nahezu irrelevant, weil der Kontext die Fakten trägt. Bei allem, was auf parametrischem Wissen beruht, ist er die erste Einschränkung, die man prüfen sollte, und die letzte, die irgendjemand prüft.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens.

Die Modalitätslücke ist das stärkste Argument für Gemini, und sie ist real.

Es wäre einfach, diesen Vergleich als eindeutigen Sieg für das neuere Modell darzustellen. Das ist es nicht, und der Grund dafür ist die Eingabezeile.

Gemini 3.1 Pro Preview akzeptiert Text-, Bild-, Audio-, Video- und Dateieingaben nativ am selben Endpunkt. GPT-6 Sol akzeptiert Text und Bild. Für eine Arbeitslast, die auf Videoverständnis, Besprechungstranskription oder formatübergreifende Dokumentverarbeitung ausgerichtet ist, ist das kein Funktionsunterschied – es ist der Unterschied zwischen einem einzigen API-Aufruf und einer Pipeline aus dreien, bei der die Zwischenschritte separat abgerechnet werden und sich die Fehlermodi vervielfachen.

Der ehrliche Vorbehalt dazu: Ein Vorschaumodell mit einer Fehlerrate von 77,6 %, die auf seiner gehosteten Modellseite angezeigt wird, ist ein Vorschaumodell, dessen multimodaler Vorteil gegen die Frage abgewogen werden muss, ob es überhaupt antworten wird. Diese Zahl ist so, wie sie auf der Seite angezeigt wird, und sie ist hoch genug, um eine Überprüfung zu rechtfertigen, bevor jemand darauf aufbaut – und genau darum geht es. Nach sieben Monaten lautet der ehrliche Rat zu diesem Modell immer noch „Messen Sie es selbst“, und das ist ein Satz, den niemand über ein GA-Release schreibt.

Wo eine Routing-Schicht die Arithmetik verändert

Gemini 3.1 Pro Preview ist in OrcaRouters Katalog für 2,00 $ Eingabe, 12,00 $ Ausgabe und 0,20 $ Cache-Read pro Million Tokens verfügbar, mit einem Kontextfenster von 1.000.000 Tokens, einer Ausgabe-Obergrenze von 65.000 Tokens, den Endpunkten /v1/chat/completions und /v1beta/models/{model}:generateContent sowie einer p50-Zeit bis zum ersten Token von 10,00 Sekunden, gemessen auf unserer eigenen Modellseite über die letzten sieben Tage. Die Listenpreise der Anbieter werden weitergegeben ohne Aufschlag obendrauf.

GPT-6 Sol ist keine unserer Routen, daher ist nichts hier eine Aussage über seinen Preis bei uns.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), captured 23 September 2026, showing Vision, Audio, Tools, JSON and Reasoning header badges, 'by Google — 2026-02-19', a 65K-token maximum output, an input price of $2.00 and an output price of $12.00 per million tokens, a p50 time to first token of 10.00 seconds, and both the /v1/chat/completions and /v1beta/models/{model}:generateContent endpoints.

Ein Preview-Modell ist der Lehrbuchfall für Routing statt feste Festlegung. Sowohl der Grund, Gemini 3.1 Pro Preview auszuprobieren, als auch der Grund, keinen Produktionspfad darauf aufzubauen, beruhen auf derselben Eigenschaft – es kann sich ohne Vorankündigung ändern –, und ein einzelner Endpunkt mit automatischem Failover ist der Weg, Ersteres zu nehmen, ohne Letzteres zu akzeptieren. Die Anfrageform ändert sich nicht, wenn sich das Modell dahinter ändert, sodass der Fallback-Pfad eher ein Konfigurationseintrag als eine Migration ist. Das ist hier wichtiger als in den meisten Vergleichen, denn das Modell, das dieses in einer Fallback-Kette am wahrscheinlichsten ersetzt, ist ein neueres Flash vom selben Anbieter, mit demselben Schlüssel, zu einem Bruchteil der Ausgaberate.

Die Entscheidungsregel

• Video-, Audio- oder gemischte Formateingabe in einem einzigen Aufruf — Gemini 3.1 Pro Preview. Nichts in der Spalte GPT-6 Sol akzeptiert eine Videodatei, und kein Preisunterschied wiegt eine Ingestion-Pipeline auf, die man selbst bauen muss.

• Alles, an das eine Verfügbarkeitszusage geknüpft ist — GPT-6 Sol. Sechs Tage alt, allgemein verfügbar, der veröffentlichte Preis als dauerhaft beschrieben, und ein dokumentierter Aufwandsregler. So sieht Planbarkeit aus.

• Lange Generierungen — GPT-6 Sol, auf die Ausgabeobergrenze statt auf die Rate bezogen. 128.000 Tokens gegenüber 65.000 sind die Einschränkung, die bei Synthesearbeit zuerst zum Tragen kommt, und sie schlägt früher zu als der 20-%-Unterschied beim Ausgabepreis.

• Gemini 3.1 Pro Preview evaluieren — und zwar hinter einem Failover-Pfad, und messen Sie die Fehlerrate selbst, bevor Sie die Workload dimensionieren. Sieben Monate Preview mit einer auf der gehosteten Seite angezeigten Fehlerrate von 77,6 % sind kein etabliertes Instrument.

• Wenn dein Plan davon abhängt, dass dieses Modell im nächsten Quartal günstig ist – weder noch. Geminis Preview kann ohne Vorankündigung neu bepreist oder eingestellt werden, und der Preis von GPT-6 Sol ist nur in dem Sinne dauerhaft, dass OpenAI das diese Woche gesagt hat. Ein Festpreis ist eine Zusage, keine Garantie; er ist einfach eine stärkere Zusage, als eine Preview-Karte sie darstellt.

In diesem Artikel verglichen3

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert