Artikel-Hero-Karte mit der Aufschrift „OpenAI o3 verlässt ChatGPT“, dem Datum „26. August 2026“ und dem Untertitel „Das letzte eigenständige Reasoning-Flaggschiff verabschiedet sich“, über einem sanften Weiß-Blau-Verlauf mit einem Motiv aus Uhr und Modell-Chip und dem OrcaRouter-Logo unten rechts.
Guides & Insights

OpenAI o3 verlässt ChatGPT am 26. August: Das letzte eigenständige Reasoning-Flaggschiff verabschiedet sich

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Fünf Tage. Am 26. August 2026 verschwindet Ope​nAI o3 – das Reasoning-Modell, das Ope​nAI am 16. April 2025 zusammen mit Ope​nAI o4-mini als die „klügsten bisher veröffentlichten Modelle“ des Unternehmens veröffentlichte – aus der Modellauswahl in den Web- und Mobile-Apps von ChatGPT. Das ist nicht das Einzige, was mit dem Modell passiert, und es ist nicht das Auffälligste. Das Auslaufdatum ist das, das fest im Kalender steht: Ope​nAI kündigte es am 28. Mai in den Versionshinweisen des Modells an und gab o3 eine 90-tägige Übergangsfrist, während die Ankündigung in dieselbe Konsolidierung der Modellliste eingebettet wurde, die bereits Ope​nAI o4-mini im Februar und GPT-4.5 im Juni aus ChatGPT entfernt hatte. Aber der Grund, warum die verbliebenen Fans von o3 diese Woche darüber sprechen, ist die andere Geschichte: ein Muster von o3-Antworten, die nach einem Neuladen der Seite zu verschwinden scheinen, wiederholt bei Ope​nAI in dessen offiziellen Community-Foren gemeldet und bis zum Zeitpunkt dieses Schreibens weiterhin unerklärt.

Wenn du kein ChatGPT-Power-User bist, der o3 manuell auswählt, betrifft dich das alles nicht – das Modell ist schon seit einiger Zeit keine Standardoption mehr, und Ope​nAI sagt, dass nur ein Bruchteil von einem Prozent der täglichen Nutzer es noch auswählt. Wenn du zu den Menschen gehörst, die das tun, oder ein Entwickler bist, der o3 über die API aufruft, dann sind die nächsten zwei Monate wichtiger als die nächsten fünf Tage – und die Details unten sind genau die, auf die es ankommt.

Was genau wird außer Betrieb genommen, und wann?

Die Ankündigung vom 28. Mai, die in den Modell-Release-Notes von Ope​nAI enthalten war, besagte, das Unternehmen „ziehe ältere Modelle mit begrenzter Nutzung in ChatGPT zurück, um neuere und leistungsfähigere Modelle besser zu unterstützen.“ Für Ope​nAI o3 bedeutet das konkret die ChatGPT-Oberfläche, nicht die API:

• ChatGPT Web und Mobil — o3 verlässt die Modellauswahl am 26. August 2026, dem Ende der 90-tägigen Auslaufphase. Bis dahin können zahlende Abonnenten es weiterhin manuell auswählen; es ist nur schon lange nicht mehr der Standard.

• Die API – die Einstellungsankündigung ließ die API ausdrücklich unberührt. Ein separater Entwicklerhinweis vom 11. Juni 2026 legte für zwei o3-Snapshots, o3-2025-04-16 und o3-pro-2025-06-10, API-Entfernungstermine auf den 11. Dezember 2026 fest. Entwicklern bleibt also mehr Zeit als ChatGPT-Nutzern, aber keine unbegrenzte.

• o3-pro — die rechenintensivere Version bleibt in ChatGPT für Pro-, Team-, Enterprise- und Edu-Abonnenten verfügbar. Die o3-Reihe ist nicht vollständig verschwunden; eingestellt wird nur das Verbraucher-o3.

Dieselbe Konsolidierungswelle erklärt das Muster. Ope​nAI o4-mini, o3s kleinerer Startbegleiter, wurde am 13. Februar 2026 nach einer Ankündigung vom 29. Januar aus ChatGPT entfernt. GPT-4.5 folgte am 27. Juni nach einer 30-tägigen Auslaufphase. o3s 90-Tage-Fenster war das längste der drei, was damit übereinstimmt, wie viel schwerer es ist, ein Reasoning-Modell zu ersetzen als ein Schreibmodell – die Sache, die o3 gut konnte, ist die Sache, die am schwersten zu übertragen ist.

Warum o3 überhaupt noch Fans hat

Der Ruf von o3 wurde in dem Jahr zwischen seiner Einführung im April 2025 und den ersten Ruhestandsankündigungen begründet. Es war das Flaggschiff der o-Serie: darauf trainiert, vor der Antwort nachzudenken, und bei den Benchmarks, die OpenAI bei der Einführung veröffentlichte, erzielte es Zahlen, die zu den Referenzwerten für „hartes Denken“ wurden — 96,7 % bei AIME 2024, 87,7 % bei GPQA Diamond, eine Codeforces-Elo von 2727 und 87,5 % bei ARC-AGI bei hoher Rechenleistung, alles Werte, die von OpenAI berichtet wurden und bei o3 im Jahr 2025 ungewöhnlich beständig gegenüber unabhängigen Nachprüfungen waren. Bei SWE-bench Verified gab OpenAI 69,1 % ohne eigenes Scaffolding an. Das Modell konnte auch „mit Bildern denken“, indem es Screenshots und Diagramme in seine Gedankenkette einbezog, bevor es antwortete.

Die Fans, die dabei geblieben sind, beschreiben die Erfahrung auf eine Weise, die sich kaum in einen Benchmark übersetzen lässt: o3 erklärte seine Überlegungen laut, und bei sorgfältiger, risikoreicher Arbeit – einem kniffligen Beweis, einem subtilen Code-Bug, einem komplizierten Refactoring – war das sichtbare Denken das Produkt. Genau diese Nutzer sind es, die in diesem Monat die Fehlerberichte einreichen.

Screenshot of the Artificial Analysis model page for o3 showing its rank of #107/182 on the Intelligence Index, a score of 31 (below the median of 35), a 200K-token context window, .00 per 1M input and .00 per 1M output pricing, and a 118 tokens-per-second speed reading.

Der Fehler mit verschwindenden Antworten und was Nutzer berichten

In mehreren langlaufenden Threads in den Community-Foren von Ope​nAI berichten zahlende Nutzer über ein konsistentes Fehlerbild: Sie erhalten eine gute o3-Antwort, laden die Seite neu oder wechseln weg und zurück, und die Antwort ist verschwunden — ersetzt durch nichts, durch „Beim Generieren einer Antwort ist ein Fehler aufgetreten", oder durch einen früheren Stand des Gesprächs. In den detaillierteren Berichten wird das Chatfenster nach einem Beitrag leer, das ausgewählte Modell wechselt zu etwas anderem (ein Nutzer sah, wie o3-mini-high stillschweigend zu einem Modell ohne Reasoning wurde), und der Verlauf kehrt erst nach einigem Herumklicken zurück. Einige Threads beschreiben, wie die letzten Antworten gemeinsam verschwinden; andere beschreiben einen „Global Reset", bei dem der Thread auf eine viel frühere Nachricht zurückgesetzt wird.

Dies sind Nutzerberichte, keine Bestätigung durch Ope​nAI. Ope​nAI hat zum Zeitpunkt dieses Schreibens weder eine Grundursache bestätigt noch einen Fix für diese Art von Fehler veröffentlicht, und die Threads mischen o3 und andere Modelle. Das Muster, das sich in den Berichten wiederholt, ist das, das zum Stilllegungszeitplan passt: lange Chat-Verläufe, Session-Neuladungen und insbesondere die o3/o3-mini-high-Endpunkte. Der praktische Ratschlag, auf den sich die Nutzer geeinigt haben – wichtige Antworten vor dem Neuladen aus ChatGPT kopieren oder die mobile App nutzen, wo die Konversation oft noch gerendert wird – ist genau der Ratschlag, den man sich selbst geben würde, wenn man davon ausginge, dass der Web-UI mit der letzten o3-Antwort nicht zu trauen ist. Das ist ein düsterer Zustand für ein kostenpflichtiges Produkt fünf Tage vor einer Stilllegung, und es ist ein weiterer Grund, warum die Migrationsfrage nicht nur um „Was kommt als Nächstes“ geht.

Was überlebt tatsächlich die Ausmusterung von o3?

Für API-Nutzer ist die ehrliche Antwort: das Modell, vorerst. o3-2025-04-16 ist weiterhin aufrufbar, und die Entwicklermitteilung gibt ihm bis zum 11. Dezember 2026 Zeit. Das ist nicht „für immer“, und die Mitteilung vom 11. Juni ist eine Warnung, dass das API-Angebot auf denselben Stand konsolidiert wird, auf den das ChatGPT-Angebot gebracht wurde — weshalb Teams, die heute neue Integrationen gegen o3 aufbauen, es als temporäre Abhängigkeit behandeln sollten, nicht als Plattform.

In ChatGPT ist der Nachfolgepfad, den Ope​nAI vorantreibt, die GPT-5-Familie. GPT-5.5 (Instant-, Thinking- und Pro-Stufen) ist seit Mai die Standardversion, und GPT-5.6 befindet sich Berichten zufolge in Entwicklung. Für die o3-Treuen ist o3-pro die größte Annäherung an das alte Erlebnis in Ope​nAIs eigenem Produkt, da es das bedachte Denkverhalten für Pro- und höhere Abonnenten beibehält. Die Einstellung der günstigen o3-Stufe ist praktisch ein Upsell-Trichter für alle, die weiterhin Reasoning in ChatGPT nutzen möchten, ohne Ope​nAI zu verlassen.

Wenn Sie ein API-Benutzer sind, sieht die Uhr anders aus.

Entwickler, die über die API auf o3 aufgebaut haben, haben eine echte, aber begrenzte Zeitspanne, und die entscheidende Frage ist, worauf man als Nächstes standardisieren sollte. o3 war nie die Budget-Option — selbst nachdem Ope​nAI seinen Preis im Juni 2025 um etwa 80 % gesenkt hat, von $10 auf $2 pro Million Input-Tokens und von $40 auf $8 pro Million Output-Tokens, werden Reasoning-Tokens als Output abgerechnet, und die effektiven Kosten einer Antwort mit langem Denkprozess summieren sich schnell. Die Modelle, die es an der Spitze der unabhängigen Bestenlisten ersetzt haben — Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro, GLM 5.2 — sind alle aktuell, alle getestet, und keines von ihnen wird verschwinden.

Genau hier kommt OrcaRouter ins Spiel, und es lohnt sich, genau zu sagen, was wir anbieten und was nicht. Ope​nAI o3 selbst ist nicht über den OrcaRouter-Schlüssel erhältlich – es bleibt über die eigene API von Ope​nAI und mehrere Drittanbieter-Plattformen verfügbar. Aber jeder ernsthafte Nachfolger ist es. Ein einziger OrcaRouter-API-Schlüssel deckt 200+ Modelle ab, wobei der Listenpreis des Anbieters ohne Aufschlag durchgereicht wird; ein Preisnachlass des Anbieters ist daher bei uns am selben Tag live wie beim Anbieter selbst, und automatisches Failover bedeutet, dass ein Produktionspfad auf zwei oder drei o3-Ersatzlösungen zeigen und nie ausfallen kann, während sich die Auswahl stabilisiert. Wenn Sie diesen Monat damit verbringen, zu entscheiden, wohin die Arbeitslast von o3 verlagert werden soll, spricht genau das dafür, die Ersatzlösungen über einen einzigen Endpunkt zu testen, anstatt fünf separate Integrationen aufzubauen, die Sie pflegen müssen.

Screenshot of the OrcaRouter model page for anthropic/claude-opus-5 showing a 1M-token context window, .00 per 1M input and 5.00 per 1M output tokens, and Vision/Tools/JSON/Reasoning capability chips, as an example of an o3 successor served at pass-through pricing.

Wofür die nächsten fünf Tage da sind.

Wenn du in ChatGPT immer noch o3 auswählst, ist die Liste der praktischen Maßnahmen kurz. Angesichts des Reload-Bugs exportiere alles aus langen o3-Threads, was du dir nicht leisten kannst zu verlieren – kopiere die wichtigen Antworten jetzt heraus, anstatt darauf zu vertrauen, dass die Konversation überlebt. Entscheide, ob o3-pro die Abo-Stufe wert ist, hinter der es steckt. Und wenn du ein API-Nutzer bist, betrachte den 11. Dezember als den eigentlichen Stichtag: Das Modell funktioniert bis dahin, aber jede Woche neuer Integration, die auf dem Modell aufbaut, ist eine Woche, die du mit der Migration verbringen wirst. Die Einstellung selbst ist keine Überraschung – sie wurde im Mai angekündigt, sie steht seit drei Monaten im Kalender, und das einzige wirklich Neue in dieser Woche sind die Bug-Meldungen, die deutlich machen, dass selbst die verbliebenen Fans des Modells aufhören sollten, sich darauf zu verlassen, dass die ChatGPT-Web-App ihre o3-Arbeit aufbewahrt. Der Countdown ist kurz, und anders als der Bug wird sich das Datum nicht ändern.

A generated timeline graphic charting the OpenAI o3 lifecycle: April 16 2025 launch with o4-mini, June 2025 price cut to /, February 13 2026 o4-mini retired from ChatGPT, May 28 2026 retirement notice with 90-day sunset, August 26 2026 o3 leaves ChatGPT, and a footer noting API snapshots follow on December 11 2026. OrcaRouter logo bottom-right.
© 2026 OrcaRouter

Für Anbieter

Du betreibst eine Inferenz-Plattform? Bring deine Modelle auf OrcaRouter.

providers@orcarouter.ai

Community beitreten

Discordsupport@orcarouter.aiXGitHubYouTube