Hero-titelkort för Ideogram 4.5 vs GPT Image 2.5, med texten '97 Elo isär på redigering – och leverantören namngav motståndaren', med chips för 'Ideogram 4.5 – live 30 sep 2026', 'GPT Image 2.5 Sunburst – live 8 sep 2026', 'Ideogram 4.5 redigerings-Elo 1 064', 'Sunburst redigerings-Elo 1 182'. OrcaRouter-logotypen är komponerad i nedre högra hörnet.
Guides & Insights

Ideogram 4.5 vs GPT Image 2.5: Ideogram valde den här striden själv

Författare

Alistair Wren

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

De flesta modelljämförelser sätts ihop av den som skriver dem. Den här sattes ihop av Ideogram. Lanseringssidan för Ideogram 4.5, som varit live sedan den 30 september 2026, kör en sida-vid-sida-redigeringsdemo och namnger sina motståndare i bildtexten: "samma redigeringar på Ideogram 4.5 vs. GPT Image 2.5 Sunburst, Nano Banana Pro och Nano Banana 2." Sedan kommer ett påstående om vad tittaren kommer att se – "GPT Image- och Nano Banana-utdata blir oanvändbara efter några redigeringar, medan Ideogram 4.5 förblir rent redigering efter redigering."

Det är ovanligt direkt. Att en leverantör väljer benchmark-mål och berättar resultatet i förväg är värt att ta på allvar i en bemärkelse och att se skeptiskt på i en annan. GPT Image 2.5 är det starkaste på de oberoende listorna i båda bildkategorierna, så det är rätt motståndare att ha valt. Och det är en utgåva med två identifierare – Flare och Sunburst, båda släppta den 8 september 2026 – med offentliga arenaresultat som Ideogram 4.5 för närvarande inte matchar. Den intressanta frågan är inte vem som vinner arenan. Det är om Ideograms påstående mäter något som arenan inte gör.

Exakt var båda modellerna står

• Ideogram 4.5 — släpptes 30 september 2026. Precisionsredigeringsmodell; generera plus redigera i fyra renderingshastigheter; inbyggd 2K; redigeringar demonstrerade vid källupplösning upp till 4 016 × 6 016 (24,2 MP). Text-till-bild: 34:e av 167 vid 1 014 ± 11 Elo (2 247 röster); bildredigering: 23:e vid 1 064 ± 11 Elo (2 382 röster). $0,03–$0,22 per bild beroende på hastighetsinställning.

• GPT Image 2.5 Sunburst — släpptes den 8 september 2026 som den precisionsprioriterade halvan av OpenAI:s uppdelade bilduppgradering, API-identifierare gpt-image-2.5-sunburst. Text-till-bild Nr 1 med 1 197 ± 9 Elo (14 023 röster); bildredigering Nr 1 med 1 182 ± 8 Elo (17 899 röster). Priset är $210,70 per 1 000 bilder enligt resultattavlans omräkning.

• GPT Image 2.5 Flare — den snabba halvan av samma lansering, identifierare gpt-image-2.5-flare. Nr 2 på båda listorna: 1 190 text-till-bild, 1 162 redigering. Samma $210,70 per 1 000.

Ställ de två redigeringstalen sida vid sida och gapet är 118 Elo — 1 182 mot 1 064 — med konfidensintervall på ±8 och ±11. Intervallen överlappar inte. På resultattavlan som mäter preferens för engångsredigering vinner Sunburst, och den vinner med ungefär sju och en halv gånger så många röster bakom sig.

Vad resultattavlan mäter och inte mäter

Det här är delen som avgör huruvida Ideograms påstående överlever kontakten med bevisningen.

Redigeringsarenan hos Artificial Analysis bygger på blind parvis mänsklig preferens: röstarna ser samma källbild och samma instruktion, får två redigerade resultat utan etiketter och väljer det bättre. Det är en stark metod för frågan "vilken av dessa två utdata som ser mest ut som det instruktionen bad om."

Det kan inte mäta det som Ideogram gör reklam för. En väljare som bedömer en enskild redigering kan inte se om modellen i tysthet ändrade tapeten, flyttade ett ansikte två millimeter eller renderade om korn över resten av bildrutan. Felet som Ideogram påstår sig åtgärda blir bara synligt över en sekvens – tur fyra, tur sju, tur tio – och ingen bred arena presenterar sekvenser för väljare. Ett Elo på 1 064 säger att Ideograms enskilda redigeringar är bra. Det säger ingenting alls om huruvida de förblir bra.

Det där slår åt båda hållen för Ideogram, och den ärliga versionen är den här: topplistan bekräftar inte driftpåståendet, och den motbevisar det inte heller. Vad den däremot motbevisar är det underförstådda starkare påståendet som en läsare kan få från lanseringssidan – att 4.5 är den bättre editorn, punkt slut. Ställd mot topplistan är den den lägre rankade editorn med en marginal som är bredare än dess felstaplar.

Screenshot of the Ideogram 4.5 model page showing the model-comparison section headed 'Compare models across multi-turn edits', with a side-by-side video widget captioned to show the same edits applied to Ideogram 4.5 alongside GPT Image 2.5 Sunburst, Nano Banana Pro and Nano Banana 2

Vad var och en gör som den andra inte gör

• Redigering i källupplösning — Ideogram 4.5:s utmärkande tekniska anspråk. Dess sida visar en redigering som utförts på en källbild på 4 016 × 6 016 utan nedskalning, med löftet att redigeringsgränsen bevaras tillräckligt väl för att kunna sy ihop utsnittet med originalet igen. För tryckarbete är det skillnaden mellan en leverans och en kompromiss.

• Bredd på parameterytan — GPT Image 2.5:s. OpenAI lade till xhigh och max i kvalitetsstegen och gjorde transparenta bakgrunder till en förstklassig parameter, med background inställd på transparent, opaque eller auto och PNG- eller WebP-utdata. Transparent utdata var en lucka i GPT Image 2 och blev en framträdande funktion i 2.5-paret.

• Snabbspår — Flare finns specifikt för att vara det snabba standardvalet. OpenAI hävdar upp till 50 % lägre latens än föregående generation; Sunburst är medvetet långsammare och riktar sig till redigeringar som måste hålla vid granskning.

• Prisstruktur — Ideogram mäter per bild utifrån renderingshastighet ($0,03 till $0,22). OpenAI mäter i tokens enligt samma prislista som GPT Image 2 — $8 per miljon bildinmatningstokens, $30 per miljon bildutmatningstokens — vilket är anledningen till att den oberoende omräkningen per bild hamnar nära $0,21 för en högkvalitativ 1024 × 1024.

Prislinjerna korsar varandra på ett besvärligt ställe. Vid Ideogram 4.5:s Low- och Medium-inställningar är det dramatiskt mycket billigare per bild än OpenAI-paret. Vid High — där driftdemonstrationen finns, och där man skulle köra en 24-megapixelkälla — ligger de två nära samma siffra. Den jämförelse de flesta köpare faktiskt kommer att göra är högkvalitativt Ideogram 4.5 mot högkvalitativ Sunburst, och i den jämförelsen är priset i stort sett lika, med ett 118-Elo-underskott på den uppmätta resultattavlan.

Vilket är okej, om driftpåståendet stämmer. Det är hela vadet.

Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.Comparison scoreboard for Ideogram 4.5 and GPT Image 2.5 Sunburst. Left column 'Ideogram 4.5': live Sep 30 2026, editing rank 23 at 1,064 Elo from 2,382 votes, text-to-image rank 34 at 1,014 Elo, $0.03 to $0.22 per image, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'GPT Image 2.5 Sunburst': live Sep 8 2026, editing rank 1 at 1,182 Elo from 17,899 votes, text-to-image rank 1 at 1,197 Elo, $210.70 per 1,000 images, transparent background output, quality ladder through max. A footer reads 'All leaderboard figures per Artificial Analysis, October 2026; price conversions are the board's own.'

Tillgänglighetsskillnaden ingen marknadsför

En praktisk asymmetri går i motsatt riktning mot resultattavlan. GPT Image 2.5:s två identifierare är nyare än något i OrcaRouters katalog – vår OpenAI-bildlinje i dag är GPT-Image-1.5 till $8/$32 per miljon tokens och GPT-Image-2 till $8/$30, båda till provider list price with no markup tillagt. 2.5-paret kom in på OpenAIs prislista till samma $8/$30 som GPT-Image-2, vilket innebär att i samma stund som de blir routbara landar de på samma pass-through-pris i stället för ett nytt, och kostnadsfrågan mellan dem handlar om token-effektivitet snarare än om vilken leverantör du anropar.

Ideogram 4.5 finns i Ideograms egen API och på partnerplattformar. Det finns inte i vår katalog. Det spelar roll för jämförelsen på ett tråkigt sätt: en av dessa två modeller är en drop-in för en OpenAI-kompatibel klient och den andra är en ny integration. Om du redan anropar GPT-Image-2 via en OpenAI-formad endpoint är kostnaden för att prova Sunburst ett byte av modell-ID; kostnaden för att prova Ideogram 4.5 är ett andra avtal och en andra klient, innan du ens kommer till att utvärdera kvaliteten.

Ett routningslager tar inte bort den skillnaden – det tar bara bort kabeldragningen från den sida som redan är kompatibel och låter dig lägga en del av trafiken på en ny aktör utan att binda en produktionsväg till den. Failover är viktigare än vanligt här, eftersom det du skulle testa är en modell vars centrala påstående saknar oberoende verifiering och vars urvalsstorlekar är en femtedel av konkurrentens.

Hur löser man det?

Kör inte den här jämförelsen på enstaka bilder. Det är arenans metod och fel instrument – den kommer att säga att Sunburst vinner, vilket du redan visste.

Kör det på sekvenser. Ta fem eller tio bilder från ditt eget arbete, skriv samma kedja med sex eller åtta progressiva redigeringar och kör den identiska kedjan på Ideogram 4.5 (High) och på Sunburst (max). Jämför sedan tur ett mot tur åtta för varje modell, på de områden som du aldrig bad modellen röra. Räkna pixlarna som flyttades. Det talet – divergens i oförändrade områden över en sekvens – är vad Ideogram hävdar att de vinner på, och så vitt jag vet publicerar ingen det för någon av modellerna.

Prissätt sedan båda körningarna per färdig sekvens. Vid det laget kommer du att ha ett svar som är värt mer än 118 Elo, eftersom det kommer att handla om dina bilder snarare än en väljarpanels.

Vad den här matchen egentligen är

Ideogram 4.5 ställde inte upp i en tävling som det vinner på topplistorna, och det verkar veta det – vilket är anledningen till att lanseringssidan demonstrerar ett beteende i stället för att skriva ut en placering. Beteendet det demonstrerar är tillräckligt verkligt för att vara värt att testa och tillräckligt specifikt för att vara falsifierbart: antingen håller upprepade redigeringar ihop eller så gör de inte det, och ett test med tio turer på dina egna filer avgör saken på en eftermiddag.

Den rimliga tolkningen i dag är att GPT Image 2.5 Sunburst är den bättre redigeraren enligt det enda oberoende mått som finns, med en marginal utanför felstaplarna, och med långt mer underlag bakom siffran – och att Ideogram 4.5 säljer en snävare, omätt egenskap till ett pris som är billigare vid låga inställningar och ungefär lika vid den inställning som dess påstående hänger på. Om trohet över flera turer är din produktionsflaskhals är testet billigt och modellen förtjänar det. Om inte, har resultattavlan redan svarat.