
Ideogram 4.5 vs GPT Image 2.5: Ideogram ha scelto da solo questa battaglia
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 262 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- xAISpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
La maggior parte dei confronti tra modelli viene messa insieme da chi li scrive. Questo è stato messo insieme da Ideogram. La pagina di lancio di Ideogram 4.5, online dal 30 settembre 2026, presenta una demo di editing affiancata e nomina i suoi avversari nella didascalia: "le stesse modifiche su Ideogram 4.5 vs. GPT Image 2.5 Sunburst, Nano Banana Pro e Nano Banana 2". Poi avanza un'affermazione su ciò che vedrà lo spettatore — "gli output di GPT Image e Nano Banana diventano inutilizzabili dopo poche modifiche, mentre Ideogram 4.5 resta pulito modifica dopo modifica".
È insolitamente diretto. Un fornitore che sceglie l'obiettivo di benchmark e ti anticipa il risultato merita di essere preso sul serio in un senso e con scetticismo in un altro. GPT Image 2.5è la cosa più forte nelle classifiche indipendenti in entrambe le categorie di immagini, quindi è l'avversario giusto da aver scelto. Ed è un rilascio con due identificatori — Flare e Sunburst, entrambi pubblicati l'8 settembre 2026 — con punteggi pubblici dell'arena che Ideogram 4.5 al momento non eguaglia. La domanda interessante non è chi vince l'arena. È se l'affermazione di Ideogram stia misurando qualcosa che l'arena non misura.
Dove si collocano esattamente entrambi i modelli
• Ideogram 4.5 — rilasciato il 30 settembre 2026. Modello di modifica di precisione; genera e modifica a quattro velocità di rendering; 2K nativo; modifiche dimostrate alla risoluzione di origine fino a 4.016 × 6.016 (24,2 MP). Da testo a immagine: 34º su 167 con 1.014 ± 11 Elo (2.247 voti); modifica di immagini: 23º con 1.064 ± 11 Elo (2.382 voti). Da 0,03 a 0,22 $ per immagine in base all'impostazione della velocità.
• GPT Image 2.5 Sunburst — rilasciato l'8 settembre 2026 come la metà orientata alla precisione dell'aggiornamento delle immagini suddiviso in due parti di OpenAI, identificatore API gpt-image-2.5-sunburst. Da testo a immagine N. 1 con 1.197 ± 9 Elo (14.023 voti); modifica delle immagini N. 1 con 1.182 ± 8 Elo (17.899 voti). Prezzo di 210,70 $ per 1.000 immagini secondo la conversione della classifica.
• GPT Image 2.5 Flare — la metà veloce della stessa release, identificatore gpt-image-2.5-flare. N. 2 su entrambe le classifiche: 1.190 text-to-image, 1.162 editing. Stesso prezzo di 210,70 $ per 1.000.
Metti i due numeri di editing fianco a fianco e il divario è di 118 Elo — 1.182 contro 1.064 — con intervalli di confidenza di ±8 e ±11. Gli intervalli non si sovrappongono. Nella classifica che misura la preferenza per l'editing a singolo tentativo, Sunburst vince, e vince con all'incirca sette volte e mezzo il numero di voti alle spalle.
Cosa la classifica misura e cosa non misura
Questa è la parte che decide se l'affermazione di Ideogram sopravvive al contatto con le prove.
L'arena di editing di Artificial Analysis si basa sulla preferenza umana a coppie in cieco: i votanti vedono la stessa immagine di partenza e la stessa istruzione, ricevono due risultati modificati senza etichette e scelgono il migliore. È un metodo valido per rispondere alla domanda "quale di questi due output assomiglia di più a ciò che l'istruzione richiedeva".
Non può misurare ciò che Ideogram sta pubblicizzando. Un votante che giudica una singola modifica non può vedere se il modello ha alterato silenziosamente la carta da parati, spostato un volto di due millimetri o rigenerato la grana nel resto dell'inquadratura. Il difetto che Ideogram sostiene di correggere diventa visibile solo lungo una sequenza — turno quattro, turno sette, turno dieci — e nessuna arena mainstream presenta sequenze ai votanti. Un Elo di 1.064 dice che le modifiche individuali di Ideogram sono buone. Non dice assolutamente nulla sul fatto che restino buone.
È un'arma a doppio taglio per Ideogram, e la versione onesta è questa: la classifica non conferma la tesi del drift, e non la confuta nemmeno. Ciò che invece confuta è l'implicita tesi più forte che un lettore potrebbe trarre dalla pagina di lancio: che 4.5 sia l'editor migliore, punto e basta. Rispetto alla classifica, è l'editor classificato più in basso, per un margine più ampio delle sue barre d'errore.

Cosa fa ciascuno che l'altro non fa
• Editing alla risoluzione sorgente — La dichiarazione ingegneristica distintiva di Ideogram 4.5. La sua pagina mostra una modifica applicata a una sorgente da 4.016 × 6.016 senza ridimensionamento, con la promessa che il confine della modifica è preservato abbastanza bene da ricucire il ritaglio nell'originale. Per il lavoro di stampa, questa è la differenza tra un prodotto consegnabile e un compromesso.
• Ampiezza della superficie dei parametri — quella di GPT Image 2.5. OpenAI ha aggiunto xhigh e max alla scala di qualità e ha reso gli sfondi trasparenti un parametro di prima classe, con background impostato su transparent, opaque o auto e output in PNG o WebP. L'output trasparente era una lacuna di GPT Image 2 ed è diventato una funzionalità di punta nella coppia 2.5.
• Corsia veloce — Flare esiste proprio per essere il default veloce. OpenAI dichiara fino al 50% di latenza in meno rispetto alla generazione precedente; Sunburst è volutamente più lento e pensato per le modifiche che devono superare un esame accurato.
• Struttura dei prezzi — Ideogram fattura per immagine in base alla velocità di rendering (da $0,03 a $0,22). OpenAI fattura in base ai token, secondo la stessa tariffa di GPT Image 2 — 8 $ per milione di token di input immagine, 30 $ per milione di token di output immagine — ed è per questo che la conversione indipendente per immagine si attesta intorno a $0,21 per un'immagine 1024 × 1024 di alta qualità.
Le linee dei prezzi si incrociano in un punto scomodo. Con le impostazioni Low e Medium di Ideogram 4.5 è drasticamente più economico per immagine rispetto alla coppia OpenAI. Con High — che è il punto in cui si trova la dimostrazione del drift e dove eseguiresti una sorgente da 24 megapixel — i due sono vicini allo stesso numero. Il confronto che la maggior parte degli acquirenti farà davvero è Ideogram 4.5 di alta qualità contro Sunburst di alta qualità, e su quel confronto il prezzo è più o meno alla pari con un deficit di 118-Elo sulla classifica misurata.
Il che va bene, se la tesi della deriva è vera. È tutta lì la scommessa.


La differenza di accessibilità che nessuno pubblicizza
Una asimmetria pratica va nella direzione opposta rispetto al tabellone dei punteggi. I due identificatori di GPT Image 2.5 sono più recenti di qualsiasi cosa nel catalogo di OrcaRouter — la nostra linea di immagini OpenAI oggi è GPT-Image-1.5 a $8/$32 per milione di token e GPT-Image-2 a $8/$30, entrambi al prezzo di listino del provider senza ricarichi aggiunti. La coppia 2.5 è arrivata sul listino prezzi di OpenAI allo stesso $8/$30 di GPT-Image-2, il che significa che nel momento in cui saranno instradabili arriveranno allo stesso prezzo pass-through anziché a uno nuovo, e la questione dei costi tra loro diventa una questione di efficienza dei token anziché di quale fornitore si contatta.
Ideogram 4.5 è sull'API di Ideogram stessa e sulle piattaforme partner. Non è nel nostro catalogo. Questo conta per il confronto in modo noioso: uno di questi due modelli è un drop-in per un client compatibile con OpenAI e l'altro è una nuova integrazione. Se stai già chiamando GPT-Image-2 tramite un endpoint in stile OpenAI, il costo di provare Sunburst è un cambio di model-ID; il costo di provare Ideogram 4.5 è un secondo contratto e un secondo client, prima ancora di arrivare a valutare la qualità.
Un livello di routing non elimina quella differenza — rimuove solo il cablaggio dal lato già compatibile e ti permette di assegnare una porzione di traffico a un nuovo entrante senza impegnare un percorso di produzione su di esso. Il failover conta più del solito qui, perché ciò che testeresti è un modello la cui affermazione centrale non ha alcuna verifica indipendente e le cui dimensioni del campione sono un quinto di quelle del suo concorrente.
Come risolverlo
Non eseguire questo confronto su singole immagini. È il metodo dell'arena e non è lo strumento giusto — ti dirà che vince Sunburst, cosa che già sapevi.
Eseguilo su sequenze. Prendi cinque o dieci immagini dal tuo lavoro, scrivi la stessa catena di sei o otto modifiche progressive ed esegui la catena identica su Ideogram 4.5 (High) e su Sunburst (max). Poi confronta il turno uno con il turno otto per ciascun modello, sulle regioni che non hai mai chiesto al modello di toccare. Conta i pixel che si sono mossi. Quel numero — la divergenza nelle regioni invariate lungo una sequenza — è ciò su cui Ideogram sostiene di vincere e, per quanto ne sappia, nessuno lo pubblica per nessuno dei due modelli.
Poi calcola il prezzo di entrambe le esecuzioni per ogni sequenza completata. A quel punto avrai una risposta che vale più di 118 Elo, perché riguarderà le tue immagini anziché quelle di un panel di votanti.
Che cos'è davvero questo matchup
Ideogram 4.5 non ha partecipato a un contest che vince nelle classifiche, e sembra esserne consapevole — ecco perché la pagina di lancio mostra un comportamento invece di stampare una posizione in classifica. Il comportamento che mostra è abbastanza reale da valere la pena di essere testato e abbastanza specifico da essere falsificabile: o le modifiche ripetute restano coerenti oppure no, e un test di dieci turni sui tuoi file lo risolve in un pomeriggio.
La lettura ragionevole oggi è che GPT Image 2.5 Sunburst sia l'editor migliore secondo l'unica misura indipendente esistente, con un margine fuori dalle barre d'errore, con molte più prove a sostegno del dato — e che Ideogram 4.5 stia vendendo una proprietà più circoscritta e non misurata a un prezzo che è più basso alle impostazioni basse e più o meno uguale all'impostazione da cui dipende la sua affermazione. Se la fedeltà multi-turno è il tuo collo di bottiglia produttivo, il test è economico e il modello se lo merita. Se non lo è, la classifica ha già risposto.
