Een vergelijkingstitelkaart voor GPT Image 2.5 vs GPT Image 2, met als kop 'GPT Image 2.5 vs GPT Image 2', drie chips met de tekst 'Zelfde tokenprijs', 'Scherpere bewerkingen' en 'Nog steeds onbewezen', en rechtsonder het OrcaRouter-logo verwerkt.
Guides & Insights

GPT Image 2.5 vs GPT Image 2: zelfde tokenprijs, scherpere bewerkingen, onbewezen.

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Toen OpenAI op 8 september GPT Image 2.5 uitbracht — onder de consumentennaam ChatGPT Images 2.5 en op de API als twee afzonderlijke identifiers, gpt-image-2.5-flare en gpt-image-2.5-sunburst — hanteerde het voor de nieuwe lijn exact dezelfde tokenprijslijst als GPT Image 2, het model dat het moet opvolgen. Daarmee is dit de zeldzame upgrade van een beeldmodel die op papier niets kost: dezelfde $8 per miljoen image-inputtokens en $30 per miljoen image-outputtokens, terwijl OpenAI scherpere details, nauwkeurigere multi-turn-bewerking en tot 50% lagere latentie dan GPT Image 2 claimt. De spanning zit hem erin dat al die beweringen afkomstig zijn van de leverancier zelf, en op de onafhankelijke ranglijsten is het nog steeds GPT Image 2 — verkrijgbaar sinds 21 april 2026 — dat de zichtbare kronen draagt. Deze head-to-head gaat over de vraag of een belofte tegen dezelfde prijs die je nog niet kunt verifiëren het vandaag waard is om op te acteren, of dat het model met het bewijs de betere productiestandaard blijft.

Wat er daadwerkelijk werd uitgebracht: twee modellen, niet één

OpenAI heeft één API-model vervangen door twee zustermodellen, en die splitsing is het eerste wat je moet begrijpen van deze upgrade. GPT-Image-2.5 Flare is het snelle standaardmodel — OpenAI positioneert het voor generatie op hoog volume en zegt dat het hogere kwaliteit levert dan GPT Image 2 met tot 50% lagere latentie. GPT-Image-2.5 Sunburst is het precisiemodel, bewust langzamer per generatie en gericht op bewerkingswerk 'waar bewerkingsprecisie het meest telt': campagnecreaties, productbeelden, alles wat een bewerking moet doorstaan onder kritische blikken. Aan de consumentenkant bracht dezelfde release ChatGPT Images 2.5 op dag één naar gebruikers van ChatGPT, ChatGPT Work en Codex, met nieuwe productfuncties — een Sketch-tool, lay-outsjablonen, reacties op afbeeldingen, het delen van prompts — die in het chatproduct zitten in plaats van in de API.

The OpenAI developer documentation page for image prompting, showing the model picker with GPT Image 2.5, GPT Image 2, GPT Image 1.5 and GPT Image 1 tabs, the 'GPT Image 2.5 prompting guide' heading, and text noting GPT Image 2.5's two model choices.

Voor wie een vergelijking maakt met GPT Image 2, zijn twee API-details van belang. Ten eerste voegen de 2.5-modellen xhigh en max toe aan de kwaliteitsladder — GPT Image 2 heeft high als maximum — en staan ze standaard op auto, waardoor het gedocumenteerde parameteroppervlak strikt breder is dan dat van de vorige generatie. Ten tweede zijn transparante achtergronden nu een eersteklas parameter: beide 2.5-identifiers accepteren background ingesteld op transparent, opaque of auto, met PNG- of WebP-output. Transparante output was een pijnpunt bij GPT Image 2: het model werd zonder die functie uitgebracht en kreeg pas later een preview-vlag. Ondersteuning voor transparantie vanaf dag één is daarmee een van de concretere verschillen in deze release. OpenAI merkt ook op dat de 2.5-uitrol additief is — GPT Image 2 blijft in de API vermeld staan — wat van belang is voor de beslissing hieronder, want niets dwingt tot een migratie.

De rechtstreekse vergelijking, dimensie voor dimensie

Release — GPT Image 2, 21 april 2026; GPT Image 2.5, 8 september 2026.

API-aanbod — één identifier, gpt-image-2, versus twee: gpt-image-2.5-flare (snel, hoge volumes) en gpt-image-2.5-sunburst (precisiebewerking).

Tokenprijzen — identieke gepubliceerde tariefkaart: $8 per miljoen image-input-tokens, $30 per miljoen image-output-tokens, waarbij tekstinvoer voor beide afzonderlijk wordt gefactureerd.

Kwaliteitsniveaus — GPT Image 2 ondersteunt laag, medium en hoog; het 2.5-paar voegt xhigh en max toe en staat standaard op auto.

Bewerkingsgedrag — GPT Image 2 heeft de neiging om opnieuw te renderen: bewerkingen kunnen de afbeelding herbouwen en afwijken van wat je wilde behouden. OpenAI's belofte voor 2.5 is gerichte bewerkingen die alleen het gevraagde gebied wijzigen en consistent blijven over opeenvolgende beurten.

Transparante achtergronden — GPT Image 2 kreeg ze pas later als preview-vlag; GPT Image 2.5 documenteert ze vanaf de lancering als standaard achtergrondparameter.

Onafhankelijke status — GPT Image 2 staat bovenaan de text-to-image-arena van Artificial Analysis en staat in de top twee voor beeldbewerking; geen van beide 2.5-modellen verschijnt nog op een onafhankelijke ranglijst.

A two-column scoreboard comparing GPT Image 2.5 (released Sep 8 2026, flare + sunburst API lineup, $30 per 1M image-output tokens, top quality max, targeted multi-turn editing, no independent scores yet) with GPT Image 2 (released Apr 21 2026, single model, $30 per 1M tokens, top quality high, re-rendering edits, Artificial Analysis text-to-image #1), footnoted that prices are per OpenAI and 2.5 claims are OpenAI-reported as of Sep 9 2026, with the OrcaRouter logo composited at the bottom right.

Het prijsverhaal: dezelfde tarieflijst, onbekende kosten per afbeelding

De identieke tokenprijzen zijn het belangrijkste beslissingsrelevante feit in deze vergelijking, en ze behoeven één kanttekening. Een tariefkaart is geen prijs per afbeelding — de kosten per afbeelding zijn het tarief vermenigvuldigd met het aantal tokens dat een model daadwerkelijk verbruikt, en OpenAI heeft geen tokenverbruik of een kostencalculator voor de 2.5 snapshots gepubliceerd. Voor GPT Image 2 zijn de cijfers per afbeelding bekend omdat onafhankelijke trackers ze hebben gemeten: ruwweg $0,21 voor een hoogwaardige 1024×1024 afbeelding, ongeveer $0,05 bij medium en rond $0,006 bij laag, volgens Artificial Analysis. Voor GPT Image 2.5 is het eerlijke antwoord dat niemand buiten OpenAI nog weet of Flare en Sunburst boven of onder die cijfers uitkomen bij een bepaalde kwaliteitsinstelling. Een model dat dezelfde tariefkaart hanteert maar meer tokens per afbeelding verbruikt, is niet echt een upgrade tegen dezelfde prijs, dus de kosten per afbeelding zijn het eerste wat je moet controleren voordat je volume vastlegt.

OrcaRouter's model page for openai/gpt-image-2, showing the token-billed model description, the /v1/images/generations endpoint, and the passed-through pricing of $8.00 input and $30.00 output per million tokens.

Het pass-through-punt is waar een routinglaag in deze specifieke vergelijking zijn nut bewijst. GPT Image 2 is vandaag op OrcaRouter verkrijgbaar tegen de lijstprijs van de provider — dezelfde $8/$30 per miljoen tokens, zonder opslag — dus de prijslijst die je ziet is die van OpenAI zelf, en op de dag dat OpenAI die prijslijst wijzigt, is de wijziging zonder heronderhandeling live aan onze kant. Omdat de 2.5-identifiers die prijslijst delen, draait de kostenvraag puur om tokenefficiëntie, niet om welke leverancier je aanroept. En om een onbewezen model uit te proberen, is een router de veilige manier: behoud één OpenAI-compatibel endpoint, stuur een deel van het verkeer naar gpt-image-2.5-flare wanneer het op een upstream-lijst verschijnt die je al aanroept, en laat de automatische failover naar GPT Image 2 intact, zodat een slechte batch niet de hele generatiewachtrij kan platleggen.

Latentie: waar de twee nieuwe modellen uiteenlopen

Het belangrijkste latentiecijfer — tot 50% lager dan GPT Image 2 — geldt voor Flare en is een eigen meting van OpenAI. Sunburst vormt het tegenwicht: OpenAI zegt dat Sunburst bewust snelheid inruilt voor precisie en er per generatie langer over doet. Dat betekent dat de echte vergelijking niet simpelweg '2.5 is sneller dan 2' is: OpenAI heeft het oude enkelvoudige model opgesplitst in een snelle baan en een zorgvuldige baan. De snelle baan draagt de belofte van lage latentie in zich, de zorgvuldige baan die van goede bewerkingen. Vroege lanceerpartners hebben grote praktische snelheidswinsten met Flare gemeld — de integraties die OpenAI koos om uit te lichten, beschreven snellere pipelines en nettere bewerkingen — maar dat zijn vroege klanten die de leverancier zelf heeft uitgekozen, geen onafhankelijke benchmark. Beschouw het cijfer van 50% als indicatief totdat iemand zonder commercieel belang de time-to-image van beide modellen meet bij dezelfde kwaliteitsinstelling.

Bewerken is het echte slagveld — en het is ongeverifieerd.

Als je leest waarom OpenAI zegt dat het 2.5 heeft gebouwd, is de hele release een antwoord op de meest bekritiseerde zwakte van GPT Image 2: bewerkingen die opnieuw renderen in plaats van chirurgisch behouden. De terugkerende klachten over GPT Image 2 waren dat een kleine gevraagde wijziging de hele afbeelding kon herbouwen, dat een persoon of product wegdreef tijdens een bewerking over meerdere rondes, en dat tekst of achtergronden achteruitgingen bij de tweede en derde ronde. De lanceermaterialen van 2.5 pakken precies die faalmodi aan: behoud van het onderwerp vanuit een referentiefoto, gerichte bewerkingen die de rest van het beeldkader intact laten, en consistentie over meerdere rondes, waarbij eerdere wijzigingen latere overleven. Vroege integraties weerspiegelen die bewering: de op bewerken gerichte partner die OpenAI liet zien, zegt dat het model 'begrijpt wat het niet moet veranderen'. Niets daarvan is op het moment van schrijven gereproduceerd door een onafhankelijke evaluatie, dus de kloof op het gebied van bewerken tussen GPT Image 2 en GPT Image 2.5 is voorlopig een belofte die wordt ondersteund door demo's, in plaats van een gemeten resultaat.

De benchmarkkloof en waarop te letten

Dit is het enige punt waarop de vergelijking in het voordeel van GPT Image 2 uitvalt. GPT Image 2 is een bekende grootheid op de onafhankelijke ranglijsten: het voert de text-to-image-arena van Artificial Analysis aan en staat begin september 2026 in de top twee van diens image-editing-arena — posities die verschuiven naarmate er nieuwe modellen bijkomen, maar het zijn echte, blinde menselijke voorkeursscores. GPT Image 2.5 staat nog op geen enkele onafhankelijke ranglijst. Er is één aspect om in de gaten te houden: anonieme checkpoints met een OpenAI-herkomst draaiden tot en met augustus in de image-arena's onder de codenamen mona-lisa-1 en luna-lisa-alpha, en waarnemers koppelden ze vóór de lancering aan de 2.5-lijn. Als die beweringen kloppen, hebben de modellen van 8 september mogelijk al een voorsprong in de arena-Elo die aan het licht zal komen zodra de ranglijsten ze onder hun echte namen opnemen.

De zaken om concreet in de gaten te houden zijn er drie. Ten eerste het tokenverbruik per afbeelding op Flare en Sunburst per kwaliteitsniveau — dat bepaalt of de claim van dezelfde prijs standhoudt bij een echte rekening. Ten tweede een onafhankelijke meting van latentie of doorvoer van Flare ten opzichte van GPT Image 2, aangezien het cijfer van 50% de grootste praktische aantrekkingskracht van de upgrade is. Ten derde waar Sunburst terechtkomt op een ranglijst voor beeldbewerking zodra het wordt toegevoegd — dat is het resultaat dat je zou vertellen of OpenAI daadwerkelijk de bewerkingskloof heeft gedicht die het claimt, niet alleen ten opzichte van GPT Image 2, maar ook ten opzichte van de gespecialiseerde editors die erboven staan.

Wie moet welke kiezen

Nieuw project, grootschalige generatie, kwaliteit telt — begin met GPT-Image-2.5 Flare. Het deelt de prijslijst van GPT Image 2, voegt kwaliteitsniveaus toe en is op papier sneller; draai je eerste batches parallel met GPT Image 2 en vergelijk ze op je eigen afbeeldingen voordat je de pipeline vastlegt.

De productie draait al op GPT Image 2, er is niets stuk — er is geen haast. De uitrol is additief, GPT Image 2 blijft op de lijst staan, en je zou een model met onafhankelijke leaderboardresultaten inruilen voor een model waarvan de claims nog steeds door de leverancier worden gerapporteerd. Migreer pas wanneer onafhankelijke scores of je eigen evaluaties dit rechtvaardigen, niet op de dag van de lancering.

Bewerkingen die de toets der kritiek moeten doorstaan — GPT-Image-2.5 Sunburst is het interessante model, maar het is ook het model waarover het minste publieke bewijsmateriaal bestaat. Als een deadline de keuze afdwingt, test het dan eerst op een representatieve set bewerkingen; wacht anders op de prijs per afbeelding en een vermelding op een leaderboard voor beeldbewerking.

Budgetgevoelig batchwerk op lage of gemiddelde kwaliteit — blijf op GPT Image 2 totdat het tokenverbruik van de 2.5-modellen op die niveaus is gedocumenteerd. Tegen $0.006 tot $0.05 per afbeelding is de huidige optie goedkoop en bekend; een opvolger met dezelfde tariefkaart kan je nog steeds naar boven toe verrassen.

De kern is een oordeel met een datum erop. GPT Image 2.5 is op papier de betere gok — dezelfde gepubliceerde prijs, een bredere kwaliteitsladder, transparantie vanaf dag één, en een bewerkingsverhaal dat rechtstreeks inspeelt op de bekende zwaktes van GPT Image 2 — maar elk voordeel is OpenAI's woord, terwijl GPT Image 2 degene is met onafhankelijk bewijs. Voor een beslissing in één zin: probeer GPT Image 2.5 nu uit als je het kunt meten op je eigen afbeeldingen, en houd GPT Image 2 als de productiestandaard totdat de leaderboards en de tokenmeter de nieuwe lijn een eigen oordeel geven.

Voor de modellen die OrcaRouter vandaag de dag routeert — blader door de modelcatalogus van OrcaRouter — waaronder openai/gpt-image-2 — is de prijs die u ziet de lijstprijs van de provider, zonder opslag doorberekend.