
Ideogram 4.5 vs GPT Image 2.5: Ideogram valde den här striden själv
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 261 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 216 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- xAISpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
De flesta modelljämförelser sätts ihop av den som skriver dem. Den här sattes ihop av Ideogram. Lanseringssidan för Ideogram 4.5, som varit live sedan den 30 september 2026, kör en sida-vid-sida-redigeringsdemo och namnger sina motståndare i bildtexten: "samma redigeringar på Ideogram 4.5 vs. GPT Image 2.5 Sunburst, Nano Banana Pro och Nano Banana 2." Sedan kommer ett påstående om vad tittaren kommer att se – "GPT Image- och Nano Banana-utdata blir oanvändbara efter några redigeringar, medan Ideogram 4.5 förblir rent redigering efter redigering."
Det är ovanligt direkt. Att en leverantör väljer benchmark-mål och berättar resultatet i förväg är värt att ta på allvar i en bemärkelse och att se skeptiskt på i en annan. GPT Image 2.5 är det starkaste på de oberoende listorna i båda bildkategorierna, så det är rätt motståndare att ha valt. Och det är en utgåva med två identifierare – Flare och Sunburst, båda släppta den 8 september 2026 – med offentliga arenaresultat som Ideogram 4.5 för närvarande inte matchar. Den intressanta frågan är inte vem som vinner arenan. Det är om Ideograms påstående mäter något som arenan inte gör.
Exakt var båda modellerna står
• Ideogram 4.5 — släpptes 30 september 2026. Precisionsredigeringsmodell; generera plus redigera i fyra renderingshastigheter; inbyggd 2K; redigeringar demonstrerade vid källupplösning upp till 4 016 × 6 016 (24,2 MP). Text-till-bild: 34:e av 167 vid 1 014 ± 11 Elo (2 247 röster); bildredigering: 23:e vid 1 064 ± 11 Elo (2 382 röster). $0,03–$0,22 per bild beroende på hastighetsinställning.
• GPT Image 2.5 Sunburst — släpptes den 8 september 2026 som den precisionsprioriterade halvan av OpenAI:s uppdelade bilduppgradering, API-identifierare gpt-image-2.5-sunburst. Text-till-bild Nr 1 med 1 197 ± 9 Elo (14 023 röster); bildredigering Nr 1 med 1 182 ± 8 Elo (17 899 röster). Priset är $210,70 per 1 000 bilder enligt resultattavlans omräkning.
• GPT Image 2.5 Flare — den snabba halvan av samma lansering, identifierare gpt-image-2.5-flare. Nr 2 på båda listorna: 1 190 text-till-bild, 1 162 redigering. Samma $210,70 per 1 000.
Ställ de två redigeringstalen sida vid sida och gapet är 118 Elo — 1 182 mot 1 064 — med konfidensintervall på ±8 och ±11. Intervallen överlappar inte. På resultattavlan som mäter preferens för engångsredigering vinner Sunburst, och den vinner med ungefär sju och en halv gånger så många röster bakom sig.
Vad resultattavlan mäter och inte mäter
Det här är delen som avgör huruvida Ideograms påstående överlever kontakten med bevisningen.
Redigeringsarenan hos Artificial Analysis bygger på blind parvis mänsklig preferens: röstarna ser samma källbild och samma instruktion, får två redigerade resultat utan etiketter och väljer det bättre. Det är en stark metod för frågan "vilken av dessa två utdata som ser mest ut som det instruktionen bad om."
Det kan inte mäta det som Ideogram gör reklam för. En väljare som bedömer en enskild redigering kan inte se om modellen i tysthet ändrade tapeten, flyttade ett ansikte två millimeter eller renderade om korn över resten av bildrutan. Felet som Ideogram påstår sig åtgärda blir bara synligt över en sekvens – tur fyra, tur sju, tur tio – och ingen bred arena presenterar sekvenser för väljare. Ett Elo på 1 064 säger att Ideograms enskilda redigeringar är bra. Det säger ingenting alls om huruvida de förblir bra.
Det där slår åt båda hållen för Ideogram, och den ärliga versionen är den här: topplistan bekräftar inte driftpåståendet, och den motbevisar det inte heller. Vad den däremot motbevisar är det underförstådda starkare påståendet som en läsare kan få från lanseringssidan – att 4.5 är den bättre editorn, punkt slut. Ställd mot topplistan är den den lägre rankade editorn med en marginal som är bredare än dess felstaplar.

Vad var och en gör som den andra inte gör
• Redigering i källupplösning — Ideogram 4.5:s utmärkande tekniska anspråk. Dess sida visar en redigering som utförts på en källbild på 4 016 × 6 016 utan nedskalning, med löftet att redigeringsgränsen bevaras tillräckligt väl för att kunna sy ihop utsnittet med originalet igen. För tryckarbete är det skillnaden mellan en leverans och en kompromiss.
• Bredd på parameterytan — GPT Image 2.5:s. OpenAI lade till xhigh och max i kvalitetsstegen och gjorde transparenta bakgrunder till en förstklassig parameter, med background inställd på transparent, opaque eller auto och PNG- eller WebP-utdata. Transparent utdata var en lucka i GPT Image 2 och blev en framträdande funktion i 2.5-paret.
• Snabbspår — Flare finns specifikt för att vara det snabba standardvalet. OpenAI hävdar upp till 50 % lägre latens än föregående generation; Sunburst är medvetet långsammare och riktar sig till redigeringar som måste hålla vid granskning.
• Prisstruktur — Ideogram mäter per bild utifrån renderingshastighet ($0,03 till $0,22). OpenAI mäter i tokens enligt samma prislista som GPT Image 2 — $8 per miljon bildinmatningstokens, $30 per miljon bildutmatningstokens — vilket är anledningen till att den oberoende omräkningen per bild hamnar nära $0,21 för en högkvalitativ 1024 × 1024.
Prislinjerna korsar varandra på ett besvärligt ställe. Vid Ideogram 4.5:s Low- och Medium-inställningar är det dramatiskt mycket billigare per bild än OpenAI-paret. Vid High — där driftdemonstrationen finns, och där man skulle köra en 24-megapixelkälla — ligger de två nära samma siffra. Den jämförelse de flesta köpare faktiskt kommer att göra är högkvalitativt Ideogram 4.5 mot högkvalitativ Sunburst, och i den jämförelsen är priset i stort sett lika, med ett 118-Elo-underskott på den uppmätta resultattavlan.
Vilket är okej, om driftpåståendet stämmer. Det är hela vadet.


Tillgänglighetsskillnaden ingen marknadsför
En praktisk asymmetri går i motsatt riktning mot resultattavlan. GPT Image 2.5:s två identifierare är nyare än något i OrcaRouters katalog – vår OpenAI-bildlinje i dag är GPT-Image-1.5 till $8/$32 per miljon tokens och GPT-Image-2 till $8/$30, båda till provider list price with no markup tillagt. 2.5-paret kom in på OpenAIs prislista till samma $8/$30 som GPT-Image-2, vilket innebär att i samma stund som de blir routbara landar de på samma pass-through-pris i stället för ett nytt, och kostnadsfrågan mellan dem handlar om token-effektivitet snarare än om vilken leverantör du anropar.
Ideogram 4.5 finns i Ideograms egen API och på partnerplattformar. Det finns inte i vår katalog. Det spelar roll för jämförelsen på ett tråkigt sätt: en av dessa två modeller är en drop-in för en OpenAI-kompatibel klient och den andra är en ny integration. Om du redan anropar GPT-Image-2 via en OpenAI-formad endpoint är kostnaden för att prova Sunburst ett byte av modell-ID; kostnaden för att prova Ideogram 4.5 är ett andra avtal och en andra klient, innan du ens kommer till att utvärdera kvaliteten.
Ett routningslager tar inte bort den skillnaden – det tar bara bort kabeldragningen från den sida som redan är kompatibel och låter dig lägga en del av trafiken på en ny aktör utan att binda en produktionsväg till den. Failover är viktigare än vanligt här, eftersom det du skulle testa är en modell vars centrala påstående saknar oberoende verifiering och vars urvalsstorlekar är en femtedel av konkurrentens.
Hur löser man det?
Kör inte den här jämförelsen på enstaka bilder. Det är arenans metod och fel instrument – den kommer att säga att Sunburst vinner, vilket du redan visste.
Kör det på sekvenser. Ta fem eller tio bilder från ditt eget arbete, skriv samma kedja med sex eller åtta progressiva redigeringar och kör den identiska kedjan på Ideogram 4.5 (High) och på Sunburst (max). Jämför sedan tur ett mot tur åtta för varje modell, på de områden som du aldrig bad modellen röra. Räkna pixlarna som flyttades. Det talet – divergens i oförändrade områden över en sekvens – är vad Ideogram hävdar att de vinner på, och så vitt jag vet publicerar ingen det för någon av modellerna.
Prissätt sedan båda körningarna per färdig sekvens. Vid det laget kommer du att ha ett svar som är värt mer än 118 Elo, eftersom det kommer att handla om dina bilder snarare än en väljarpanels.
Vad den här matchen egentligen är
Ideogram 4.5 ställde inte upp i en tävling som det vinner på topplistorna, och det verkar veta det – vilket är anledningen till att lanseringssidan demonstrerar ett beteende i stället för att skriva ut en placering. Beteendet det demonstrerar är tillräckligt verkligt för att vara värt att testa och tillräckligt specifikt för att vara falsifierbart: antingen håller upprepade redigeringar ihop eller så gör de inte det, och ett test med tio turer på dina egna filer avgör saken på en eftermiddag.
Den rimliga tolkningen i dag är att GPT Image 2.5 Sunburst är den bättre redigeraren enligt det enda oberoende mått som finns, med en marginal utanför felstaplarna, och med långt mer underlag bakom siffran – och att Ideogram 4.5 säljer en snävare, omätt egenskap till ett pris som är billigare vid låga inställningar och ungefär lika vid den inställning som dess påstående hänger på. Om trohet över flera turer är din produktionsflaskhals är testet billigt och modellen förtjänar det. Om inte, har resultattavlan redan svarat.
