
GPT-5.6 Sol Ultrafast: Ultrafast zum 6-fachen Standardpreis veröffentlicht, doch dieses Modell ist weiterhin nur Preview
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 362 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Die Wartezeit für die Stufe ist vorbei, doch für dieses Modell nicht. Auf dem DevDay am 29. September 2026 machte der Anbieter Ultrafast zu etwas, das man kaufen kann: Der neue Tarif ChatGPT Pro 500 für 500 $ pro Monat bündelt es, die API veröffentlicht jetzt eine Ultrafast-Preisliste zum Sechsfachen des Standardtarifs — 60,00 $ Eingabe / 300,00 $ Ausgabe pro Million Token bei GPT-6 Astra —, und die Codex-Dokumentation des Anbieters bestätigt, dass die Pro-Tarife überhaupt kein fünfstündiges Nutzungslimit haben, ein Fenster, das für Plus gilt. All das ist vom Anbieter angegeben und auf der eigenen DevDay-Zusammenfassung, den Hilfeseiten und der Entwicklerdokumentation des Anbieters veröffentlicht. Was sich nicht bewegt hat, ist das Modell, um das es auf dieser Seite geht. GPT-5.6 Sol Ultrafast, angekündigt am 13. August 2026 als die Cerebras-beschleunigte Serving-Stufe für GPT-5.6 Sol mit bis zu 14-fachem Standarddurchsatz und 750 Ausgabe-Token pro Sekunde, ist weiterhin nur im Vorschauzugang erhältlich — vermittelt über das Account-Team des Anbieters — und hat weiterhin keinen eigenen veröffentlichten Preis. Die Stufe wurde ausgeliefert. Die Sol-Variante wartet noch.
Seit wir dies erstmals aufgeschrieben haben, sind zwei Preisbewegungen eingetreten, und sie zeigen in entgegengesetzte Richtungen. Das zugrunde liegende Modell wurde günstiger: Standard GPT-5.6 Sol wird jetzt mit 4,00 $ pro Million Eingabe-Token und 20,00 $ pro Million Ausgabe-Token abgerechnet – OpenAIs Aktionspreis, der laut Anbieter mindestens bis zum 21. November 2026 verfügbar ist – nicht mit den 5,00 $ / 30,00 $, die im August aktuell waren. Die darauf aufbauende Geschwindigkeitsstufe erhielt erstmals einen Preis, und der ist nicht günstig: Ultrafast auf GPT-6 Astra wird mit 60,00 $ / 300,00 $ pro Million abgerechnet. Jede Zahl in diesem Beitrag wurde am 30. September 2026 erneut gegen die von OpenAI veröffentlichte Preisliste, die API-Referenz und die Codex-Preisdokumentation geprüft.
Was der Ultrafast-Modus tatsächlich ist
Ultrafast ist eine Serving-Stufe, kein neues Modell. OpenAI kündigte es am 13. August 2026 als erstes Produkt seiner im Januar 2026 geschlossenen Compute-Partnerschaft mit dem Chiphersteller Cerebras an – ein Deal, der laut Berichten rund 10 Milliarden US-Dollar über drei Jahre umfasst. Während die standardmäßige GPT-5.6 Sol-Inferenz auf GPU-Clustern läuft und viel Zeit damit verbringt, Gewichte zwischen Speicher und Recheneinheit zu verschieben, lädt Ultrafast die Gewichte des Modells in 44 GB On-Chip-SRAM auf den Wafer-Scale-Chips von Cerebras; ein Modell der Größe von Sol erstreckt sich in Schichten über mehrere Wafer, sodass die Gewichte dort liegen, wo die Rechenleistung sitzt. Das Ergebnis ist eine Durchsatzobergrenze, die vom Silizium statt von der Speicherbandbreite gesetzt wird.
Die Hardware-Geschichte hat sich am 2026-08-18 weiterentwickelt. Bei seiner Supernova-Veranstaltung enthüllte Cerebras den CS-4, das System der nächsten Generation auf Rack-Ebene, das auf der Nexus-Plattform basiert – drei Wafer-Scale-Engine-Chips pro Rack, bis zu 2× der Token-Erzeugungsgeschwindigkeit des bisherigen CS-3 und laut Cerebras mehr als 1.000 Token pro Sekunde bei Modellen mit über 10 Billionen Parametern. Das sind Cerebras' Angaben für ein System im Early Access, das noch nicht allgemein verfügbar ist. Seit der Enthüllung behauptet ein einzelner Beitrag auf X, dass der CS-4 GPT-5.6 Sol bereits mit etwa 1.300 Token pro Sekunde bedient – das entspricht in der Richtung Cerebras' eigenen Zahlen, wurde aber bisher von niemandem bestätigt. Behandeln Sie es als ein frühes Signal: plausibel, unverifiziert und einen erneuten Check wert, bevor Sie die Kapazität darauf planen.
Der Teil, der für deinen Code zählt: die Modell-ID, die Gewichte, das Reasoning-Verhalten und die Ausgabe sind identisch mit dem Standard-GPT-5.6 Sol. OpenAI bezeichnet Ultrafast als „mehr nützliche Arbeit pro Sekunde“ und nicht als Qualitätsstufe, und die Vorschau läuft mit dem vollwertigen Flaggschiff – die Geschwindigkeit entsteht nicht durch den Austausch gegen ein günstigeres Modell. Was sich ändert, ist, wie schnell Tokens erzeugt werden.
Verwechsle Ultrafast nicht mit dem Fast-Modus. Der Fast-Modus ist eine separate, kostenpflichtige Stufe auf Standardhardware: bis zu ungefähr 2,5× Ausgabegeschwindigkeit bei einem Aufschlag von 2× pro Token, ohne Qualitätsänderung – er wurde am 30. Juli 2026 von Priority Processing umbenannt, und auf GPT-5.6 Sol kostet er 8,00 $ Eingabe / 40,00 $ Ausgabe pro 1 Mio. Ultrafast ist etwas anderes – Cerebras-Hardware, bis zu 14× auf GPT-5.6 Sol und bis zu 8× auf GPT-6 Astra, wobei es auf Astra das 6-Fache des Standardtarifs kostet und auf Sol noch nicht bepreist ist. Die beiden Namen stehen jetzt im selben Modellauswahlmenü nebeneinander, was nach wie vor das mit Abstand Verwirrendste an diesem Release ist.
Wie schnell — die Zahlen, die zählen.

Die in der Schlagzeile genannte Zahl ist 14×, und sie bedarf einer Definition. OpenAI zufolge erzeugt Ultrafast bis zu 750 Ausgabe-Token pro Sekunde, verglichen mit der standardmäßigen GPT-5.6-Sol-Verarbeitung. Das ist eine Durchsatzangabe für Ausgabe-Token, keine pauschale Aussage, dass „alles 14× schneller läuft“ — die End-to-End-Anfragezeit umfasst auch die Eingabeverarbeitung und das eigene Denken des Modells, weshalb 14× als Maximum ausgewiesen ist.
• Maximaler Ausgabedurchsatz — bis zu 750 Ausgabe-Tokens pro Sekunde, laut OpenAIs Ankündigung (13.08.2026).
• Im Vergleich zur Standardverarbeitung – bis zu 14× schneller, laut derselben Ankündigung; die tatsächlichen Zugewinne variieren je nach Eingabelänge und Aufgabentyp.
• Humanity's Last Exam, 2.500 Fragen — OpenAI/Cerebras berichten, dass GPT-5.6 Sol Ultrafast in 11 Stunden 11 Minuten abschließt, gegenüber 78 Stunden 27 Minuten für Claude Fable 5, bei vergleichbarer Genauigkeit. Es handelt sich um Angaben der Anbieter selbst, und der Vergleich umfasst die Hardware-Stacks zweier Anbieter — als Richtungsweiser zu lesen, nicht als Urteil.
• GDP-Val, Ende-zu-Ende — Cerebras meldet insgesamt 5,6× schneller ohne messbaren Qualitätsverlust. Ebenfalls vom Anbieter angegeben.
• Fast-Modus und Ultrafast im Vergleich – der Fast-Modus erreicht maximal etwa die 2,5-fache Ausgabegeschwindigkeit bei einem doppelten Preisaufschlag und ist auf dieselbe ~272K-Token-Grenze wie beim Standardpreis begrenzt. Ultrafast ist der größere Sprung: 14-fach bei GPT-5.6 Sol laut der August-Ankündigung und bis zu 8-fach bei GPT-6 Astra in Codex laut aktueller OpenAI-Dokumentation, wobei die Launch-Berichterstattung das mit bis zu 300 Ausgabe-Tokens pro Sekunde angibt.
• CS-4, die nächste Hardware — Cerebras behauptet, dass das CS-4-Rack bei Modellen mit über 10 Billionen Parametern mehr als 1.000 Token pro Sekunde liefert, bis zu 2× der Token-Erzeugung des CS-3. Ein unbestätigter Community-Bericht beziffert GPT-5.6 Sol auf CS-4 mit etwa 1.300 Token pro Sekunde — gleiche Richtung, aber noch nicht von OpenAI oder Cerebras bestätigt.
Eine Warnung, bevor Sie die 14× zitieren: Sie ist eine Obergrenze für den Ausgabedurchsatz auf der Hardware eines einzelnen Anbieters, und unabhängige Vergleiche des August-Starts reichten von etwa 7× bis 11×, je nachdem, welcher Teil einer Workload gemessen wurde. Dieselbe Vorsicht ist beim CS-4-Geschwindigkeitssignal angebracht – die Zahl von ~1.300 Token/s für GPT-5.6 Sol auf CS-4 ging ursprünglich auf einen einzelnen X-Post zurück, und weder OpenAI noch Cerebras haben sie bestätigt. Betrachten Sie all dies als Anbieter- und Community-Behauptungen, nicht als Benchmark-Urteile.
Was Ultrafast jetzt kostet – und warum Sol dadurch noch immer nicht bepreist wird

Hier ist der Stand der Preisfrage vom 30.09.2026, schlicht dargelegt. Ultrafast hat einen veröffentlichten Tarif – für GPT-6 Astra und nur für GPT-6 Astra. OpenAIs Preisseite enthält jetzt eine Ultrafast-Spalte neben Standard, Batch, Flex und Fast: $60.00 Input / $6.00 gecachter Input / $75.00 Cache-Schreibvorgänge / $300.00 Output pro Million Token im kurzen Kontext, was sich jenseits von ungefähr 272K Token auf $120.00 / $12.00 / $150.00 / $450.00 verdoppelt. Das ist das Sechsfache des Standard-Astra-Tarifs, während der Fast-Modus das Zweifache beträgt – und es ist die erste konkrete Zahl, die OpenAI für diese Stufe genannt hat. Die obige Karte ist unser eigener Schnappschuss vom 18.08.2026, und ihre Dollarzahlen sind gleich doppelt überholt – durch die Senkung des Standardtarifs und nun durch diese Ultrafast-Zeile. Was in dieser Tabelle noch fehlt, ist irgendein Ultrafast-Tarif für GPT-5.6 Sol: Die Ultrafast-Spalte listet genau ein Modell auf, gpt-6-astra. Die Stufe ist bepreist; dieses Modell nicht.
Was Sie heute bepreisen können – Modell für Modell:
• Standard GPT-5.6 Sol — 4,00 $ Eingabe / 20,00 $ Ausgabe pro 1 Mio. Tokens für Prompts mit bis zu etwa 272K Tokens. OpenAI gibt dies als Aktionspreis an, der mindestens bis zum 21. November 2026 verfügbar ist. Dies ist die Basis, die Sie jetzt aufrufen können.
• Fast-Modus — 8,00 $ / 40,00 $ bei kurzem Kontext auf GPT-5.6 Sol, ab etwa 272K Tokens verdoppelt sich das auf 16,00 $ / 60,00 $. Zum doppelten Standardtarif gibt es bis zu etwa 2,5-fache Ausgabegeschwindigkeit, und auf Sol ist es weiterhin das Schnellste, was man tatsächlich kaufen kann.
• Prompt-Cache — Cache-Lesevorgänge werden mit 0,40 $ pro 1 Mio. abgerechnet (90 % günstiger als frischer Input); Cache-Schreibvorgänge werden mit 5,00 $ pro 1 Mio. abgerechnet.
• Langkontext-Stufe — Eingaben, die über etwa 272K Token hinausgehen, werden bei Standardverarbeitung mit 8,00 $ / 30,00 $ abgerechnet, innerhalb des ~1,05-Mio.-Token-Fensters des Modells und der maximalen Ausgabe von 128K Token.
• Batch API — 2,00 $ / 10,00 $ für Kurzkontext und 4,00 $ / 15,00 $ für Langkontext, pauschal 50 % Rabatt bei einer Bearbeitungszeit von etwa 24 Stunden.
Für GPT-5.6 Sol ist die Astra-Zahl der beste verfügbare Hinweis und nichts weiter. OpenAI bepreist Ultrafast mit dem 6-fachen des Standardtarifs des zugrunde liegenden Modells; wendet man diesen Multiplikator auf Sols $4 / $20 an, landet man bei $24 / $120 pro Million. Das ist Arithmetik, kein veröffentlichter Preis – OpenAI hat nichts zu einem Sol-Ultrafast-Tarif gesagt, und die August-Preview-Kohorten wurden überhaupt nicht nach einem Stufentarif abgerechnet. Kalkulieren Sie mit Standard-Sol zu $4 / $20 oder dem Fast-Modus zu $8 / $40, bis der Anbieter die Zeile veröffentlicht.
So verwendest du es – auf Astra breit verfügbar, bei Sol weiterhin auf Anfrage
Der Zugriff teilte sich am 29. September in zwei auf, und die Aufteilung läuft dem Modell zuwider, das diese Seite behandelt. Ultrafast ist jetzt breit verfügbar auf GPT-6 Astra: Die API-Dokumentation von OpenAI besagt, dass es für alle API-Nutzer mit niedrigen Rate Limits offen ist – 500.000 Token pro Minute in den Nutzungsstufen 1–3, 1 Million in Stufe 4, 5 Millionen in Stufe 5 – und es ist in ChatGPT Work und Codex im neuen Pro-500-Plan sowie in berechtigten Enterprise- und Edu-Plänen enthalten, wo ein Workspace-Inhaber es aktivieren muss und wo es für Workspaces nicht unterstützt wird, die Inferenz außerhalb der Vereinigten Staaten erfordern. GPT-5.6 Sol Ultrafast ist nicht mitgezogen. Dieselbe Dokumentation beschreibt es weiterhin als Preview-Zugang über ein OpenAI-Account-Team, und die Beschreibung des Parameters selbst im API-Schema lautet weiterhin „currently available for gpt-5.6-sol“ – eine Zeile, die jetzt hinter dem Rest der Doku zurückbleibt, statt ihm vorauszugehen. Wer die Stufe heute will, will sie auf Astra.
Die Frage der Benutzeroberfläche ist ebenfalls geklärt. TestingCatalog berichtete am 26. September 2026, dass ein Geschwindigkeitswähler mit den Optionen Standard, Fast und Ultrafast unveröffentlicht im Responses API Playground lag; drei Tage später veröffentlichte OpenAI die Consumer-Version genau davon, wobei Ultrafast jetzt eine Option im Modellauswahlmenü in ChatGPT Work und Codex auf Pro 500 ist. Wir markierten diese Sichtung als Lesart einer einzelnen Publikation nicht veröffentlichter UI und sagten, OpenAI habe nichts davon bestätigt. Sie war in der Tendenz richtig, und der Rollout, auf den sie hindeutete, kam zum DevDay und nicht danach.
Die von OpenAI im August benannten Preview-Kohorten waren Coding, Commerce, Finanzforschung, Support und andere interaktive Workloads – Teams, deren Agenten viele Aufrufe pro Anfrage machen und bei denen die Antwortlatenz der Engpass ist. Jane Street, Rogo und Podium gehörten zu den benannten frühen Testern. Wenn Ihr Workload ein Single-Turn-Chat ist, spielt die Geschwindigkeitsstufe eine weit geringere Rolle als bei einer Agentenschleife mit 40 Aufrufen. Die praktische Antwort hängt jetzt davon ab, nach welchem Modell Sie fragen: Bei GPT-6 Astra können Sie service_tier: "ultrafast" heute Nachmittag festlegen, bei GPT-5.6 Sol geht das noch nicht.
Was Sie heute tun können — die praktische Antwort

Während GPT-5.6 Sol Ultrafast hinter der Preview-Tür bleibt, sind beide Flaggschiffmodelle live auf OrcaRouter zum Anbieterpreis mit 0 $ Aufschlag pro Token — Modell-ID openai/gpt-5.6-sol über den OpenAI-kompatiblen Endpunkt unter api.orcarouter.ai/v1, und GPT-6 Astra daneben zum Standardpreis von 10,00 $ / 50,00 $, das Modell, auf das OpenAI jetzt eine Ultrafast-Stufe draufgesetzt hat und das wir in dieser Stufe nicht routen. Der Screenshot unten ist von August 2026 und zeigt noch die damals aktuelle 5,00 $ / 30,00 $-Linie; der heutige Sol-Preis ist 4,00 $ / 20,00 $, was wir durchreichen. Diese Durchreichung ist der Grund, warum Preisänderungen der Anbieter noch am selben Tag bei uns ankommen: 4,00 $ Input / 20,00 $ Output, dieselben Zahlen, die OpenAI veröffentlicht, ohne zusätzlichen Aufschlag pro Token. Wenn Sie bereits einen OpenAI-Client haben, besteht die Migration in einer Änderung von Basis-URL und Modell-ID; sonst nichts. Derselbe Schlüssel und Endpunkt bedienen über 200 Modelle, sodass Sol neben seinen eigenen Geschwistern steht — GPT-5.6 Terra zu 2,00 $ / 12,00 $ und GPT-5.6 Luna zu 0,20 $ / 1,20 $ — sowie den Open-Weight-Modellen, mit denen Sie es vergleichen würden, und Sie können nach Schwierigkeit routen, statt jedes einzelne neu zu integrieren.
Zwei OrcaRouter-Besonderheiten sind es wert, auf einer Speed-Seite genannt zu werden. BYOK: Bringen Sie Ihren eigenen OpenAI-Schlüssel mit, und OpenAI rechnet Ihnen direkt zu seinen eigenen Tarifen ab — OrcaRouter fügt 0 $ pro Token hinzu und lässt die Rate-Limits und Credits Ihres Anbieters unangetastet. Guardrails: Der PII Shield und die Content Policy laufen vor der Abrechnung, sodass eine blockierte Anfrage ein sauberes 400 zurückgibt und nie berechnet wird, und die Agent Firewall bewertet Tool- und MCP-Aufrufe, bevor sie ausgeführt werden. Ultrafast selbst ist auf GPT-6 Astra breit verfügbar, aber nicht zu routbaren Bedingungen und nicht für Sol — es ist eine zugriffskontrollierte Stufe, die mit dem 6-fachen des Standardtarifs abgerechnet wird, und wir bieten es nicht an. Falls OpenAI es jemals zu Standardbedingungen anbietet, ist die Einbindung in denselben Endpunkt eine Änderung der Modell-ID; das Setup, das Sie heute aufbauen, bleibt bestehen.
Die ehrliche Grenze — wenn Ultrafast nicht die Antwort ist
Fünf Punkte, an denen die Geschichte vom Tempo noch immer nicht standhält, da nun die Hälfte davon geklärt ist:
Verfügbar ist nicht dasselbe wie für dich verfügbar. Ultrafast wurde für alle API-Nutzer auf GPT-6 Astra freigeschaltet, aber mit niedrigen Rate Limits; im Schema von OpenAI wird es weiterhin als zugriffskontrolliert beschrieben, es unterstützt keine Verarbeitung in der EU oder in anderen Nicht-US-Regionen, und in Enterprise-Workspaces ist es deaktiviert, bis ein Owner es aktiviert. Auf GPT-5.6 Sol wurde überhaupt nichts freigeschaltet. Prüfe deinen eigenen Zugriff, bevor du auf einem der beiden aufbaust.
14× ist ein Maximum, keine Garantie. Es ist eine Obergrenze für den Ausgabedurchsatz auf Cerebras-Hardware; die End-to-End-Latenz umfasst weiterhin die Eingabeverarbeitung, die Denkzeit des Modells und Ihr eigenes Netzwerk. Ein stark auf Reasoning ausgerichteter Prompt kann den Großteil seiner Wanduhrzeit mit Denken verbringen, wodurch der angepriesene Geschwindigkeitsvorteil schrumpft.
Beim einen Modell ist ein Preis angegeben, beim anderen nicht. Der Tarif Astra Ultrafast ist veröffentlicht — 6× Standard — und für GPT-5.6 Sol gibt es nirgends eine Ultrafast-Zeile. Kalkulieren Sie mit Standard-Sol zu $4 / $20 oder dem Fast-Modus zu $8 / $40, und behandeln Sie jede Zahl, die Sie für „GPT-5.6 Sol Ultrafast-Kosten“ sehen, einschließlich der obigen Extrapolation von $24 / $120, als Arithmetik und nicht als Tarifkarte.
Bei den Benchmarks handelt es sich um Anbieterangaben. Der 11-stündige HLE-Lauf und der 5,6×-GDP-Val-Wert sind OpenAI/Cerebras-Zahlen aus der August-Ankündigung; unabhängige Schätzungen der Beschleunigung reichen von etwa 7× bis 11×, je nachdem, was gemessen wird. Füge das CS-4-Signal dieser Liste hinzu: Die Zahl von ~1.300 Token/s für GPT-5.6 Sol auf CS-4 stammt aus einem einzelnen X-Post und hat keine unabhängige Bestätigung. Die neuen Astra-Ultrafast-Zahlen – 8× in Codex, 6× der Preis – sind ebenfalls Eigenangaben von OpenAI.
Und die eine, die Geld statt Zeit kostet: Sie behebt keinen Engpass, den Sie nicht haben. Wenn Ihre Agenten wegen Ihrer eigenen Orchestrierung, Tool-Latenz oder eingabelastigen Prompts langsam sind, verschiebt ein schnellerer Ausgabepfad den Tail nur geringfügig. Die Entscheidung zur Stufenwahl – GPT-5.6 Sol bei 4 $ / 20 $ gegenüber GPT-5.6 Terra bei 2 $ / 12 $ gegenüber GPT-5.6 Luna bei 0,20 $ / 1,20 $ – bewegt Ihre Rechnung weiterhin stärker als jede Geschwindigkeitsstufe.
Fazit. Ultrafast ist keine Wartelisten-Stufe mehr, über die man nur lesen kann. Seit dem 29. September 2026 verkauft OpenAI es: im ChatGPT Pro 500-Plan für $500 in Work und Codex enthalten, für alle API-Nutzer auf GPT-6 Astra mit niedrigen Ratenlimits geöffnet und zum Sechsfachen des Standardtarifs bepreist — $60 / $300 pro Million kurzen Kontext. GPT-5.6 Sol Ultrafast, die August-Vorschau, um die herum diese Seite aufgebaut wurde, ist unverändert: weiterhin zugangskontrolliert, weiterhin auf gpt-5.6-sol im API-Schema beschränkt, weiterhin ohne Preis, und die für Sol auf Cerebras' CS-4 gemeldete Zahl von ~1.300 Token/s ist weiterhin ein einzelner unbestätigter X-Post. Standard GPT-5.6 Sol zu $4 / $20 ist das, was du heute auf OrcaRouter zu $0 Aufschlag aufrufen kannst; GPT-6 Astra zu $10 / $50 ist das, was du aufrufen kannst, wenn du das Modell willst, das die Ultrafast-Zeile bekommen hat.
Ultrafast kostet jetzt auf GPT-6 Astra echtes Geld — 6× Standard oder gebündelt im 500-$-Pro-500-Tarif — während GPT-5.6 Sol Ultrafast eine Vorschau bleibt. Das vollständige GPT-5.6 Sol ist auf OrcaRouter für $4 / $20 pro Million Tokens ohne Aufschlag live, bereit für deinen eigenen Schlüssel.
In diesem Artikel verglichen2
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
