Eine generierte Titelkarte für den Artikel „Claude Opus 5.5 vs. GPT-6.1 Sol: Die 5-fache Abonnement-Wertlücke, gemessen“, mit der Überschrift „Claude Opus 5.5 vs. GPT-6.1 Sol: die Abonnement-Wertlücke“, mit der Unterüberschrift „Dieselben 200 $ pro Monat. Dieselbe agentische Arbeitslast. 5,6-facher API-äquivalenter Wert bei Anthropics Plan.“ und drei Karten mit dem Inhalt „200 $/Monat Claude Max 20x - Opus 5.5 / 11.726 $ API-äquivalent“, „200 $/Monat ChatGPT Pro 200 - GPT-6.1 Sol / 2.084 $ API-äquivalent“ und „Lücke / 5,6x“. Die Fußzeile lautet: „Agentische Arbeitslast, 96,6 % gecachte Eingabe. Wertangaben: SemiAnalysis, 5. Oktober 2026 – das Modell einer Publikation für Abonnement-Limits der Anbieter. Planpreise sind Anbieter-Listenpreise.“
Guides & Insights

Claude Opus 5.5 vs. GPT-6.1 Sol: Die fünffache Abo-Wert-Lücke, gemessen

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Für zweihundert Dollar im Monat bekommt man entweder einen Claude Max 20x-Seat oder einen ChatGPT Pro 200-Seat. Bei derselben agentischen Workload liefert eines davon 11.726 Dollar im Monat an First-Party-API-äquivalenten Tokens, und das andere liefert 2.084 Dollar — eine 5,6-fache Lücke zwischen Claude Opus 5.5 und GPT-6.1 Sol. Keines dieser Modelle ist der Grund für diese Nachricht, und keines ist neu: Claude Opus 5.5 erschien am 22. September 2026 und GPT-6.1 Sol am 29. September 2026, die Modelle selbst sind also zwei Wochen bzw. eine Woche alt. Neu ist, dass die Abonnement-Ökonomie ihres Betriebs jetzt mit einer gemessenen Zahl belegt ist, veröffentlicht von SemiAnalysis am 5. Oktober 2026 — einen Tag vor diesem Artikel —, nachdem das Unternehmen eine Methode entwickelt hatte, um Limits zu bepreisen, die die Anbieter nicht veröffentlichen.

Die Zahl, die für Schlagzeilen sorgt, kursiert seit dem Abend des 5. Oktober auf X, meist ohne ihre Einschränkungen. Also kommen die Einschränkungen zuerst, denn ohne sie ist die Zahl wertlos. Jeder Wert in der folgenden Grafik ist das Modell einer Forschungsveröffentlichung von den privaten Messwerten eines Dritten, gemessen über ein definiertes Arbeitslastprofil und als Spanne ausgewiesen, nicht als auditierter Benchmark. Die Tarifpreise sind die von den Anbietern selbst veröffentlichten Listenpreise. Die später genannten Capability-Scores stammen von Artificial Analysis, in benannten Konfigurationen. Und der ganze Vergleich dreht sich um Abonnements – ein Abrechnungsmodus mit eigenen Regeln – nicht darum, was jedes der beiden Modelle pro Token kostet, was eine andere Frage mit einer anderen Antwort ist.

Wie Sie einen Plan bepreisen, in den Sie nicht hineinschauen können

Anthropic und OpenAI geben die Abonnementnutzung beide als Prozentanzeige an, nicht als Preis. Es gibt ein Fünf-Stunden-Fenster und ein wöchentliches Limit, und keine Rechnung pro Anfrage. Die Anbieter unterscheiden die Tarife anhand von Multiplikatoren im Verhältnis zu ihren eigenen anderen Tarifen – Claudes Max 5x und Max 20x sind buchstäblich nach ihrer Position gegenüber Pro benannt, und die Tarife von ChatGPT wurden ebenso beworben, bis OpenAI die Formulierung zur relativen Nutzung von seiner Preisseite entfernte.

Derselbe Plan hat also einen unterschiedlichen Wert, je nachdem, für welches Modell man ihn einsetzt, weil ein Guthaben, das durch ein zwischengespeichertes Eingabe-Token verbraucht wird, und ein Guthaben, das durch ein Ausgabe-Token verbraucht wird, nicht in demselben Verhältnis bepreist werden, das die Anbieter über die API berechnen. Das ist die ganze These der Übung: Man kann nicht sagen, dass ein Plan für sich genommen $X wert ist. Man braucht den Plan, das Modell und die Workload zusammen.

Die Methode von SemiAnalysis ist es wert, beschrieben zu werden, weil sie bestimmt, wie viel Gewicht die Zahlen tragen können. Das Unternehmen führt wiederholte Aufrufe durch, die darauf ausgelegt sind, jeweils einen Token-Typ zu isolieren – einen Teil von War and Peace mit einem zufälligen Tag pro Aufruf für ungecachten Input, denselben Prompt, der für Cache-Schreibvorgänge als Cache gekennzeichnet ist, ein festes Tag für Cache-Lesevorgänge, einen langen technischen Essay, um Output zu erzwingen. Jeder Aufruf zeichnet die vom Anbieter in Rechnung gestellten Tokens und die Position des Verbrauchszählers auf. Da eine einzelne Anfrage den Zähler kaum bewegt, messen sie in Schritten: Die Token-Summen zwischen zwei Zählerbewegungen ergeben die Kosten einer Zählereinheit, Teilschritte an beiden Enden werden verworfen, und Schritte summieren sich, bis der Bereich innerhalb von ±5 % liegt. Cache-Lesevorgänge, die den Zähler nach 500 Millionen Tokens nicht bewegen, gelten als kostenlos. Die Workload-Mischung stammt dann aus den eigenen Nutzungsverhältnissen des Unternehmens vom September, und der Wert ist die resultierende Token-Kapazität multipliziert mit dem veröffentlichten API-Preis des Anbieters für jeden Token-Typ.

Die interessanteste Erkenntnis im Methodikabschnitt betrifft nicht die Großzügigkeit eines der beiden Labore. Bei der Validierung stellte SemiAnalysis fest, dass eines von drei Konten, die es im selben Tarif testete, um etwa 20 % niedrigere Limits hatte als die anderen beiden – ein älteres Konto. Der Anbieter bestätigte, dass es sich um einen „extrem winzigen“ A/B-Test zu Limits handelte, und betonte, dass er die Limits nicht pauschal gekürzt habe. Beide Aspekte davon sind wichtig: Es beweist, dass Abonnement-Limits jederzeit stillschweigend verschoben werden können, und es beweist, dass die Methode empfindlich genug ist, um eine Verschiebung um 20 % zu erkennen, wenn sie geschieht.

Was jede Stufe bei 200 $, 100 $ und 20 $ abwirft

Drei Stufen, beide Labs, agentische Workload, API-äquivalenter Wert pro Monat zu First-Party-Listenpreisen:

• 200 $ pro Monat — Claude Opus 5.5 auf Max 20x liefert 11.726 $ — 58,6-mal die Gebühr in API-äquivalenten Tokens; GPT-6.1 Sol auf ChatGPT Pro 200 liefert 2.084 $ — 10,4-mal die Gebühr. Verhältnis: 5,6x.

• $100 pro Monat — Claude Opus 5.5 bei Max 5x erzielt $5.725 (das 57,3-Fache der Gebühr); GPT-6.1 Sol bei ChatGPT Pro 100 erzielt $1.055 (das 10,6-Fache der Gebühr). Verhältnis: 5,4x.

• 20 $ pro Monat — Claude Opus 5.5 auf Claude Pro erwirtschaftet 1.178 $ (das 58,9-Fache der Gebühr); GPT-6.1 Sol auf ChatGPT Plus erwirtschaftet 211 $ (das 10,6-Fache der Gebühr). Verhältnis: 5,6-fach.

Dass die drei Stufen zwischen 5,4x und 5,6x liegen, ist das Ergebnis, nicht die einzelnen Dollarbeträge. Der Vergleich wird auf der mittleren Stufe des Katalogs jedes Labors durchgeführt – dem Modell, das beide Anbieter als das Arbeitstier für den Alltag positionieren und nicht als das Flaggschiff – und er wird über die gesamte Preisstaffel durchgeführt, sodass ein Leser mit einem 20-Dollar-Plan die gleiche Antwort erhält wie ein Leser mit einem 200-Dollar-Plan. Die eigene Zusammenfassung von SemiAnalysis ist unverblümt: Auf dieser Stufe ist Anthropic „ein überwältigend besseres Angebot, das durchweg den ~5-fachen API-äquivalenten Wert bietet.“

Die Workload-Form hinter allen drei Zeilen ist gekennzeichnet, und es lohnt sich, sie zweimal zu lesen: agentisch, 0,4 % ungecachte Eingabe, 96,6 % gecachte Eingabe, 2,6 % Cache-Schreibvorgänge, 0,3 % Ausgabe. So sieht eine Agentenschleife aus – eine kleine Menge frischer Anweisungen, eine riesige Menge erneut gelesenen Kontexts und ein winziger Streifen generierten Texts. Es ist zugleich, wie der nächste Abschnitt zeigt, die Mischung, die Anthropic am meisten schmeichelt.

A generated two-column scoreboard titled 'Claude Opus 5.5 vs GPT-6.1 Sol - the scoreboard'. Left column 'Claude Opus 5.5': Input $4.00 per Mtok, Output $20.00 per Mtok, Cache read $0.20 per Mtok, Released Sept 22 2026, AA Intelligence Index 58 (max effort), API value on the $200 plan $11,726. Right column 'GPT-6.1 Sol': Input $2.00 per Mtok, Output $10.00 per Mtok, Cache read $0.10 per Mtok, Released Sept 29 2026, AA Intelligence Index 51.8 (max effort), API value on the $200 plan $2,084. The footer reads 'Prices: vendor rate cards. Index: Artificial Analysis v4.3.2, max effort. $200-plan value: SemiAnalysis, Oct 5, 2026 - model estimate, not audited.'

Opus 5.5 kostet pro Token doppelt so viel und gewinnt trotzdem um das 5,6-Fache.

Das hier ist der Punkt, den die kursierende Version der Grafik auslässt. Claude Opus 5.5 ist nicht das günstigere Modell. Es ist das teurere – um den Faktor zwei.

Beide Tarifkarten sind öffentlich. Claude Opus 5.5 ist mit 4,00 $ pro Million Eingabe-Tokens, 0,20 $ pro Million Cache-Lesevorgänge, 5,00 $ pro Million Cache-Schreibvorgänge und 20,00 $ pro Million Ausgabe-Tokens gelistet. GPT-6.1 Sol ist mit 2,00 $, 0,10 $, 2,50 $ und 10,00 $ für dieselben vier Positionen gelistet. Gewichtet man diese mit dem oben genannten agentischen Mix, ergeben sich gemischte Sätze von rund 0,399 $ pro Million Tokens für Claude Opus 5.5 gegenüber 0,200 $ für GPT-6.1 Sol – ein Verhältnis von 2,00x. Diese Rechnung stammt von uns, auf Grundlage der veröffentlichten Karten der beiden Anbieter, doch sie ist unstrittig: Sie folgt direkt aus den veröffentlichten Preisen und dem ausgewiesenen Mix.

Teile die 5,6-fache Wertlücke durch die 2,0-fache Preislücke, und du erhältst rund 2,8-mal mehr Token pro Dollar Plan auf der Claude-Seite. Dieselbe Division ergibt auf der 20-Dollar-Stufe 2,79-mal – die Lücke besteht darin, dass ein Zähler deutlich großzügiger ist, fast exakt gleichmäßig über die Preisleiter hinweg, und nicht darin, dass ein Modell günstiger zu betreiben ist. Das bedeutet, die 5x-Schlagzeile ist eine Aussage über Anthropics Credit-Preisgestaltung, und sie gilt nur für Workloads, die dem gemessenen ähneln.

Ändere die Mischung, und die Zahl verschiebt sich. Die Mischung besteht zu 96,6 % aus gecachten Reads, wo Opus 5.5 $0.20 gegenüber Sols $0.10 berechnet. Eine cache-leichte Workload – lange frische Dokumente, wenig Wiederverwendung – lastet auf der Eingabe-Zeile, und dieselben 2x tauchen dort auf. Output-lastige Arbeit, etwa lange Generierungen statt lange Agentenläufe, trifft auf die Zeile, in der Opus $20.00 gegenüber $10.00 kostet. Und SemiAnalysis sagt ausdrücklich, dass die eigene bevorzugte Kennzahl einen Fehlermodus hat: Der API-äquivalente Wert „wird natürlich irreführend sein“, wenn ein Modell bei API-Preisen ein besonders gutes oder schlechtes Geschäft ist – und genau das ist hier der Fall: Das pro Token teurere Modell ist das mit dem besseren Abonnement. Das Unternehmen weigert sich zudem, sich auf Token-Effizienz-Diagramme zu stützen, und erklärt, es glaube nicht, dass typische agentische Benchmark-Aufgaben repräsentativ für echte Arbeit seien, und dass der Branche verlässliche Effizienzdaten fehlen. Betrachte die 5x als eine abgewogene Aussage über eine Workload-Form aus einer einzigen Publikation, nicht als dauerhafte Eigenschaft eines der beiden Modelle.

Was die Kluft zu einem echten Problem statt zu einem neutralen Tausch macht, ist, dass die Seite mit dem Abo und dem günstigeren Modell zugleich die stärkere Seite auf dem unabhängigen Board ist. Artificial Analysis setzt Claude Opus 5.5 auf seinem Intelligence Index auf 58, und zwar in der Konfiguration, die seine Modellseite "max with fallback" nennt und die im Varianten-Selektor als "Claude Opus 5.5 (Max, Default Fallback)" aufgeführt ist — der höchste Wert, den es bis dahin gemessen hatte, mit mehreren Punkten Abstand. GPT-6.1 Sol erreicht 51.8 bei maximalem Aufwand auf demselben Index, Indexversion v4.3.2, mit GPT-6 Astra bei 52.7. Ein Käufer, der die beiden 200-Dollar-Pläne gegeneinander abwägt, soll also 5.6-mal mehr pro Dollar nutzbarer Kapazität für das niedriger bewertete Modell zahlen. Die Punktzahlen sind von Drittanbietern und unabhängig; die Wertangaben stammen aus dem Modell von SemiAnalysis. Beide sind gekennzeichnet, und keines von beiden ist eine Herstellerangabe.

A screenshot of the OrcaRouter model page for Claude Opus 5.5 (anthropic/claude-opus-5.5), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the $4.00 input and $20.00 output pricing tiles, p50 TTFT 3.81 s, p95 TTFT 10.00 s, 48.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by Anthropic - 2026-09-22', an OpenAI-compatible code sample using base_url https://api.orcarouter.ai/v1, and the buttons 'Get the Claude Opus 5.5 API' and 'Try in playground'.

Was hat OpenAI am 29. September geändert?

Nichts davon war statisch. Der Grund, warum die Lücke diese Woche statt letzte Woche diskutiert wird, ist, dass OpenAI acht Tage, bevor die Messung eintraf, seine eigenen Maßstäbe verschob.

Am 29. September 2026 öffnete OpenAI die 200-Dollar-Pro-Abonnements wieder für neue Abonnenten und änderte zugleich mit der Wiedereröffnung, wie die Nutzung berechnet wird. Nach den eigenen Worten an diesem Tag würde die Änderung „unterm Strich auf halb so viele Dollar an API-Ausgaben hinauslaufen wie beim alten Pro-Plan für 200 $“, und ein zweiter Beitrag am selben Tag beschrieb eine Halbierung des API-äquivalenten Werts der Stufe. Das ist eine datierte Anbieteraussage über den eigenen Plan, und es ist das Ereignis, das eine Messung des Abonnementwerts publikationswürdig machte.

Drei Konsequenzen, wie SemiAnalysis sie gemessen hat:

• Die Tokens pro Stufe wurden halbiert, und der Wert der Sol-Klasse sank noch stärker als das. OpenAI senkte gleichzeitig den Preis für gecachten Input für GPT-6.1 Sol – auf 0,10 $ pro Million, was das Entwicklerkonto von OpenAI am 29. September als 95 % unter dem Standard-Input-Preis und 50 % unter dem gecachten Tarif von GPT-6 Sol beschrieb –, sodass der gemessene API-äquivalente Wert der Modelle der Sol-Klasse im Tarif um mehr als 50 % sank statt um die 50 %, die die reine Token-Kürzung implizieren würde.

• Eine 500-$-Stufe ist eingeführt worden, und sie stellt den Wert nicht wieder her. Der neue Pro-500-Plan bietet 21 % mehr GPT-6 Astra als der alte 200-$-Plan; wegen der Preissenkung für Sol ist der API-äquivalente Wert der Sol-Klasse in der 500-$-Stufe tatsächlich gesunken. Der Ultrafast-Modus – die Dienststufe mit 300 Tokens pro Sekunde – ist die eigentliche Neuerung dort, und SemiAnalysis sagt, dass seine Limits noch getestet werden.

• Bestehende Abonnenten haben bis zum 29. Oktober 2026 Bestandsschutz. Ein 200-Dollar-Tarif, den man vor der Kürzung hatte, behält bis zu diesem Datum das ältere, größere Kontingent und wechselt dann bei unverändertem Preis zum niedrigeren Kontingent. Für alle, die vor dem 29. September abgeschlossen haben, gilt der Vergleich in diesem Artikel für ihr Konto ab Ende des Monats, nicht ab heute.

Das Rebalancing ist der subtile Teil. Vor der Kürzung war der Wert pro Dollar bei OpenAI an der Spitze zu seinen eigenen Gunsten unausgewogen: Pro 200 bot auf Astra etwa doppelt so viel Wert pro Dollar wie Pro 100, das seinerseits etwa doppelt so viel wie Plus bot. Nach der Kürzung liefern Pro 100, Pro 200 und Pro 500 für jedes Modell die gleichen Tokens pro Dollar, und Plus ist auf Sol vergleichbar, auf Astra aber weiterhin relativ schlechter. OpenAI hat seine Leiter intern fair gemacht, indem es alles bis zur untersten Sprosse halbierte. Anthropic hingegen bot bereits auf jeder Stufe denselben Wert pro Dollar — weshalb dasselbe 5,6x auftaucht, egal ob du einen 20-Dollar-Plan oder einen 200-Dollar-Plan betrachtest. Wenn du Plus hast und auf den Astra-Zugang gesetzt hast, hat die Kürzung den Wert entfernt, der die höchste OpenAI-Stufe einst erstrebenswert gemacht hat.

OpenAI behält einen echten strukturellen Vorteil, und SemiAnalysis räumt ihn ein: Keine der Pro-Stufen hat ein Fünf-Stunden-Fenster, was es einfacher macht, einen hohen Anteil des Monatslimits in einer einzigen langen Sitzung zu verbrauchen. Die Einschätzung der Firma ist, dass dies eine Lücke von etwa dem 4- bis 5-Fachen beim API-äquivalenten Wert nicht ausgleicht.

Zwei Volkswirtschaften, ein Modellname

Es steckt eine Falle darin, irgendetwas davon als Aussage über die Modelle zu lesen. Wenn Sie pro Token bezahlen – ein API-Schlüssel, ein selbst gehosteter Stack, eine Agent-Plattform, die Sie bauen –, dann ist der 5,6x-Wert nicht Ihre Zahl und war es nie. Ihre Zahl ist der Mischwert von 2,00x, und auf dieser Grundlage ist GPT-6.1 Sol das günstigere Modell für dieselbe agentische Schleife. Der Abo-Vergleich beantwortet die Frage: „Welchen Platz sollte ich kaufen?“ Der API-Vergleich beantwortet die Frage: „Welches Modell sollte ich aufrufen?“ Sie weisen für diese beiden Modelle in entgegengesetzte Richtungen, und sie zu vermengen ist der mit Abstand häufigste Fehler in der Kommentierung rund um das Diagramm.

Die Runde der Preissenkungen, die in die Abonnement-Messung eingeflossen ist, steckt bereits in den API-Preislisten. Anthropic senkte beim Start des Modells am 25. September die Input- und Output-Preise von Opus 5.5 um 20 % gegenüber Opus 5 und die Cache-Lesevorgänge um 60 %. OpenAI halbierte den gecachten Input von GPT-6.1 Sol zum Start am 29. September. Das sind die beiden Listenpreis-Karten, die in diesem Artikel durchgängig verwendet werden, und sie gelten unabhängig davon, ob Sie einen Seat oder ein Token kaufen. Beide Modelle stehen im OrcaRouter-Katalog zum Listenpreis des Anbieters — Claude Opus 5.5 zum Anbieter-Listenpreis mit 0 % Aufschlag und GPT-6.1 Sol mit demselben Schlüssel hinter einem Endpunkt — eine Preissenkung eines Anbieters ist also live, sobald sie veröffentlicht wird, statt auf eine Aktualisierung der Routing-Tabelle zu warten.

Eine Sache, die man klar sagen sollte: OrcaRouter verkauft keine Abonnements, daher ändert diese Messung nichts daran, was ein OrcaRouter-Nutzer zahlt. Sie ändert, für welches Modell er zahlen sollte, und sie bepreist die Alternative. Die Plan-Seite des Vergleichs ist eine Wand, die Sie nicht kontrollieren — zwei Labore, von denen beide gezeigt haben, dass sie Limits verschieben werden, still und kurzfristig, in derselben Woche, in der sie die Preise senken. Das API-Äquivalent dieses Risikos ist die Möglichkeit, dieselbe Anfrage woandershin zu senden, ohne einen neuen Vertrag, wofür automatisches Failover über Anbieter hinweg da ist. Wenn Sie eine Agenten-Schleife mit 96,6 % Cache-Treffern betreiben, ist das, was Sie eigentlich wollen, die günstigste Route, die die Anfrage akzeptiert, und die Möglichkeit, Ihre Meinung zu ändern, wenn ein Anbieter seine Meinung ändert.

Wer sollte umziehen, und wer nicht?

Wer für ein Claude-Abo bezahlt und agentisches Coding oder lange Tool-Schleifen laufen lässt, für den ist das Argument zu bleiben jetzt messbar statt anekdotisch: Auf der $200-Stufe fließt einem das 58,6-Fache der eigenen Gebühr als API-äquivalente Kapazität zurück, gegenüber dem 10,4-Fachen beim vergleichbaren ChatGPT-Plan, und das gilt bei jedem Preisniveau. Wer einen ChatGPT Pro 200-Plan hat, der vor dem 29. September gekauft wurde, hat bis zum 29. Oktober 2026 das ältere Kontingent und danach das niedrigere – das Datum prüfen, bevor man irgendetwas entscheidet, denn in den nächsten drei Wochen vergleicht man mit einem Plan, den es für Neukäufer nicht mehr gibt.

Wenn Sie ein API-Entwickler sind, ignorieren Sie die 5,6x. Routen Sie anhand des Mischsatzes von 2,00x, bepreisen Sie es pro Aufgabe statt pro Token und überprüfen Sie es nach jeder Preisänderung eines Anbieters erneut, denn in diesem Quartal gab es vier davon — GPT-6 Sol, Fable 5.1, Opus 5.5 und GPT-6.1 Sol in etwas mehr als einem Monat. Die Messgröße, die bei einem Abonnement zählt, ist ein Zähler, den niemand außerhalb des Labors sehen kann. Die Messgröße, die bei einer API zählt, ist eine Preisliste, und diese ist öffentlich.

Was als Nächstes zu beobachten ist: ob die Opus-Limits von Anthropic das Quartal über Bestand haben, angesichts dessen, dass der eigene Wettbewerber die letzte Woche mit Kürzungen verbracht hat und dass beide Labore weiterhin die Möglichkeit behalten, die Messwerte still zu verschieben; ob OpenAI den Wert der Sol-Klasse im 500-Dollar-Tarif wiederherstellt, indem es die Limits erhöht statt erneut die Preise zu senken; und ob die Bestandsschutzregelung für den 200-Dollar-Tarif tatsächlich am 29. Oktober wie veröffentlicht endet. SemiAnalysis führt die zugrunde liegenden Zahlen als Live-Dashboard statt als feste Studie, sodass die hier genannten Werte den Stand vom 5. Oktober 2026 eines Datensatzes wiedergeben, der darauf ausgelegt ist, sich zu verändern.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol (openai/gpt-6.1-sol), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the reasoning / coding / agentic capability tags, the $2.00 input and $10.00 output pricing tiles, 10.60 s p50 TTFT, 10.00 s p95 TTFT and 248.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by OpenAI - 2026-09-29', and the buttons 'Get the GPT-6.1 Sol API' and 'Try in playground'.

In diesem Artikel verglichen2

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert