Hero-titelkaart voor Ideogram 4.5 vs GPT Image 2.5, met de tekst '97 Elo verschil bij bewerken — en de leverancier noemde de tegenstander', met chips voor 'Ideogram 4.5 — live 30 sep 2026', 'GPT Image 2.5 Sunburst — live 8 sep 2026', 'Ideogram 4.5 bewerkings-Elo 1.064', 'Sunburst bewerkings-Elo 1.182'. Het OrcaRouter-logo is in de rechteronderhoek gecompositeerd.
Guides & Insights

Ideogram 4.5 vs GPT Image 2.5: Ideogram begon deze strijd zelf

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

De meeste modelvergelijkingen worden samengesteld door degene die ze schrijft. Deze is samengesteld door Ideogram. De lanceringspagina voor Ideogram 4.5, online sinds 30 september 2026, toont een zij-aan-zij bewerkingsdemo en noemt zijn tegenstanders in het bijschrift: "dezelfde bewerkingen op Ideogram 4.5 vs. GPT Image 2.5 Sunburst, Nano Banana Pro en Nano Banana 2." Dan wordt er een bewering gedaan over wat de kijker zal zien — "GPT Image- en Nano Banana-outputs worden binnen een paar bewerkingen onbruikbaar, terwijl Ideogram 4.5 schoon blijft, bewerking na bewerking."

Dat is ongewoon direct. Een leverancier die het benchmarkdoel kiest en je van tevoren de uitkomst vertelt, moet je in één opzicht serieus nemen en in een ander met scepsis bekijken. GPT Image 2.5 is het sterkste dat op de onafhankelijke leaderboards in beide beeldcategorieën staat, dus het is de juiste tegenstander om te hebben gekozen. En het is een release met twee identifiers — Flare en Sunburst, beide uitgebracht op 8 september 2026 — met openbare arena-scores die Ideogram 4.5 momenteel niet evenaart. De interessante vraag is niet wie de arena wint. Het gaat erom of de claim van Ideogram iets meet dat de arena niet meet.

Waar beide modellen staan, precies

• Ideogram 4.5 — uitgebracht op 30 september 2026. Precisie-bewerkingsmodel; genereren plus bewerken bij vier rendersnelheden; native 2K; bewerkingen gedemonstreerd op bronresolutie tot 4.016 × 6.016 (24,2 MP). Tekst-naar-afbeelding 34e van 167 met 1.014 ± 11 Elo (2.247 stemmen); beeldbewerking 23e met 1.064 ± 11 Elo (2.382 stemmen). $0,03–$0,22 per afbeelding afhankelijk van de snelheidsinstelling.

• GPT Image 2.5 Sunburst — uitgebracht op 8 september 2026 als de op precisie gerichte helft van OpenAI's gesplitste afbeeldingsupgrade, API-identificatie gpt-image-2.5-sunburst. Tekst-naar-afbeelding Nr. 1 met 1.197 ± 9 Elo (14.023 stemmen); beeldbewerking Nr. 1 met 1.182 ± 8 Elo (17.899 stemmen). Prijs: $210,70 per 1.000 afbeeldingen volgens de conversie van het leaderboard.

• GPT Image 2.5 Flare — de snelle helft van dezelfde release, ID gpt-image-2.5-flare. Nr. 2 op beide ranglijsten: 1.190 tekst-naar-afbeelding, 1.162 bewerken. Dezelfde prijs: $210,70 per 1.000.

Zet de twee bewerkingscijfers naast elkaar en het verschil is 118 Elo — 1.182 tegen 1.064 — met betrouwbaarheidsintervallen van ±8 en ±11. De intervallen overlappen elkaar niet. Op de ranglijst die de voorkeur voor single-shot-bewerking meet, wint Sunburst, en het wint met ongeveer zeven en een half keer zoveel stemmen erachter.

Wat de leaderboard wel en niet meet

Dit is het deel dat bepaalt of de claim van Ideogram de confrontatie met het bewijs overleeft.

De editingarena van Artificial Analysis is blinde paarsgewijze menselijke voorkeur: stemmers zien dezelfde bronafbeelding en dezelfde instructie, krijgen twee bewerkte resultaten zonder labels en kiezen de betere. Het is een sterke methode voor "welke van deze twee outputs het meest lijkt op wat de instructie vroeg."

Het kan niet meten wat Ideogram adverteert. Een kiezer die één bewerking beoordeelt, kan niet zien of het model stilletjes het behang heeft veranderd, een gezicht twee millimeter heeft verschoven, of de korrel in de rest van het frame opnieuw heeft gerenderd. De fout die Ideogram zegt te verhelpen, wordt pas zichtbaar over een reeks — beurt vier, beurt zeven, beurt tien — en geen enkele mainstreamarena legt reeksen aan kiezers voor. Een Elo van 1.064 zegt dat de individuele bewerkingen van Ideogram goed zijn. Het zegt helemaal niets over of ze goed blijven.

Dat pakt voor Ideogram beide kanten uit, en de eerlijke versie is dit: de ranglijst bevestigt de driftbewering niet, en weerlegt die ook niet. Wat de ranglijst wél weerlegt, is de impliciete sterkere bewering die een lezer uit de lanceringspagina zou kunnen opmaken — dat 4.5 de betere editor is, punt uit. Tegenover de ranglijst is 4.5 de lager gerangschikte editor, met een marge die breder is dan de foutbalken.

Screenshot of the Ideogram 4.5 model page showing the model-comparison section headed 'Compare models across multi-turn edits', with a side-by-side video widget captioned to show the same edits applied to Ideogram 4.5 alongside GPT Image 2.5 Sunburst, Nano Banana Pro and Nano Banana 2

Wat elk doet wat het andere niet doet

• Bewerking op bronresolutie — de onderscheidende technische claim van Ideogram 4.5. De pagina toont een bewerking toegepast op een bron van 4.016 × 6.016 zonder verkleining, met de belofte dat de bewerkingsgrens goed genoeg behouden blijft om de uitsnede weer in het origineel te voegen. Voor drukwerk is dat het verschil tussen een op te leveren product en een compromis.

• Breedte van het parameteroppervlak — die van GPT Image 2.5. OpenAI voegde xhigh en max toe aan de kwaliteitsladder en maakte transparante achtergronden tot een eersteklas parameter, waarbij background kan worden ingesteld op transparent, opaque of auto en de uitvoer PNG of WebP is. Transparante uitvoer was een gemis bij GPT Image 2 en werd een uithangbordfunctie van het 2.5-duo.

• Snelspoor — Flare bestaat specifiek om de snelle standaard te zijn. OpenAI claimt tot 50% lagere latentie dan de vorige generatie; Sunburst is bewust langzamer en gericht op aanpassingen die de toets der kritiek moeten doorstaan.

• Prijsstructuur — Ideogram rekent per afbeelding af op basis van de rendersnelheid ($0,03 tot $0,22). OpenAI rekent af per token volgens dezelfde tariefkaart als GPT Image 2 — $8 per miljoen image-input-tokens, $30 per miljoen image-output-tokens — waardoor de onafhankelijke omrekening per afbeelding voor een hoogwaardige 1024 × 1024 op ongeveer $0,21 uitkomt.

De prijslijnen kruisen elkaar op een ongemakkelijke plek. Bij de instellingen Laag en Gemiddeld van Ideogram 4.5 is het per afbeelding dramatisch goedkoper dan het OpenAI-duo. Bij Hoog — waar de drift-demonstratie zich bevindt, en waar je een 24-megapixelbron zou draaien — liggen de twee dicht bij hetzelfde getal. De vergelijking die de meeste kopers daadwerkelijk zullen maken, is hoogwaardige Ideogram 4.5 tegen hoogwaardige Sunburst, en in die vergelijking is de prijs ongeveer gelijk, met een achterstand van 118 Elo op de gemeten ranglijst.

Wat prima is, als de bewering over drift waar is. Dat is de hele weddenschap.

Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.Comparison scoreboard for Ideogram 4.5 and GPT Image 2.5 Sunburst. Left column 'Ideogram 4.5': live Sep 30 2026, editing rank 23 at 1,064 Elo from 2,382 votes, text-to-image rank 34 at 1,014 Elo, $0.03 to $0.22 per image, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'GPT Image 2.5 Sunburst': live Sep 8 2026, editing rank 1 at 1,182 Elo from 17,899 votes, text-to-image rank 1 at 1,197 Elo, $210.70 per 1,000 images, transparent background output, quality ladder through max. A footer reads 'All leaderboard figures per Artificial Analysis, October 2026; price conversions are the board's own.'

Het toegankelijkheidsverschil dat niemand promoot

Eén praktische asymmetrie valt de andere kant op dan wat het scorebord laat zien. De twee identifiers van GPT Image 2.5 zijn nieuwer dan alles in de catalogus van OrcaRouter — onze OpenAI-afbeeldingslijn is vandaag GPT-Image-1.5 tegen $8/$32 per miljoen tokens en GPT-Image-2 tegen $8/$30, beide tegen de lijstprijs van de provider, zonder markup erbij. Het 2.5-tweetal is op de prijskaart van OpenAI verschenen tegen dezelfde $8/$30 als GPT-Image-2, wat betekent dat ze op het moment dat ze routeerbaar zijn op dezelfde doorgifteprijs uitkomen in plaats van op een nieuwe, en de kostenkwestie tussen hen gaat dan over token-efficiëntie in plaats van over welke leverancier je aanroept.

Ideogram 4.5 staat op het eigen platform van Ideogram en op partnerplatforms. Het staat niet op ons platform. Dat is op een saaie manier van belang voor de vergelijking: een van deze modellen is een drop-in voor een client in OpenAI-formaat en het andere is een nieuwe integratie. Als je GPT-Image-2 al gebruikt in een OpenAI-achtige opzet, dan kost het proberen van Suno een modelwissel; het proberen van Ideogram 4.5 kost een nieuwe integratie, nog voordat je überhaupt naar kwaliteit kijkt.

Een routeringslaag haalt dat verschil niet weg — hij haalt alleen het leidingwerk weg aan de kant die al compatibel is, en stelt je in staat een deel van het verkeer naar een nieuwkomer te sturen zonder er een productiepad aan vast te leggen. Failover is hier belangrijker dan gewoonlijk, omdat hetgeen je zou uitproberen een model is waarvan de centrale claim niet onafhankelijk is geverifieerd en waarvan de steekproefgroottes een vijfde zijn van die van zijn concurrent.

Hoe het op te lossen

Voer deze vergelijking niet uit op losse afbeeldingen. Dat is de methode van de arena en het is het verkeerde instrument — het zal je vertellen dat Sunburst wint, wat je al wist.

Voer het uit op sequenties. Neem vijf of tien afbeeldingen uit je eigen werk, schrijf dezelfde keten van zes of acht progressieve bewerkingen, en voer de identieke keten uit op Ideogram 4.5 (High) en op Sunburst (max). Vergelijk dan de eerste met de achtste iteratie voor elk model, op de regio's die je nooit aan het model hebt gevraagd aan te raken. Tel de pixels die zijn verschoven. Dat getal — divergentie in ongewijzigde regio's over een sequentie — is waarop Ideogram claimt te winnen, en voor zover ik weet publiceert niemand het voor een van beide modellen.

Bereken dan de prijs van beide runs per afgeronde sequentie. Op dat moment heb je een antwoord dat meer waard is dan 118 Elo, omdat het over jouw afbeeldingen zal gaan in plaats van over die van een kiezerspanel.

Wat deze matchup eigenlijk is

Ideogram 4.5 deed niet mee aan een wedstrijd die het op de ranglijsten wint, en het lijkt dat te weten — daarom demonstreert de lanceringspagina een gedrag in plaats van een rang te tonen. Het gedrag dat het demonstreert is echt genoeg om het testen waard te zijn en specifiek genoeg om falsifieerbaar te zijn: of herhaalde bewerkingen samenhangend blijven of niet, en een test van tien beurten op je eigen bestanden beslecht de kwestie in een middag.

De redelijke interpretatie vandaag is dat GPT Image 2.5 Sunburst de betere editor is volgens de enige onafhankelijke maatstaf die bestaat, met een marge die buiten de foutmarges valt, en met veel meer bewijs achter het cijfer — en dat Ideogram 4.5 een smallere, ongemeten eigenschap verkoopt tegen een prijs die bij lage instellingen goedkoper is en ongeveer gelijk bij de instelling waarvan zijn claim afhangt. Als multi-turn fidelity je productieknelpunt is, is de test goedkoop en verdient het model het. Zo niet, dan heeft de ranglijst al geantwoord.