
Ideogram 4.5 vs GPT Image 2.5 : Ideogram a lui-même provoqué ce combat
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 261 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 216 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- xAISpaceXAI: Grok 4.62026-08-1244Intelligence77Code
La plupart des comparaisons de modèles sont assemblées par celui ou celle qui les rédige. Celle-ci a été assemblée par Ideogram. La page de lancement d'Ideogram 4.5, en ligne depuis le 30 septembre 2026, propose une démo d'édition côte à côte et nomme ses adversaires dans la légende : « les mêmes retouches sur Ideogram 4.5 vs GPT Image 2.5 Sunburst, Nano Banana Pro et Nano Banana 2 ». Elle avance ensuite une affirmation sur ce que le spectateur verra — « les sorties de GPT Image et Nano Banana deviennent inutilisables au bout de quelques retouches, tandis qu'Ideogram 4.5 reste propre retouche après retouche. »
C'est d'une franchise inhabituelle. Qu'un fournisseur choisisse lui-même la cible de référence et vous annonce le résultat à l'avance mérite d'être pris au sérieux d'un certain point de vue, et avec scepticisme d'un autre. GPT Image 2.5 est ce qui se fait de plus solide sur les classements indépendants dans les deux catégories d'images ; c'est donc le bon adversaire à avoir choisi. Et il s'agit d'une sortie à deux identifiants — Flare et Sunburst, tous deux lancés le 8 septembre 2026 — avec des scores d'arène publics qu'Ideogram 4.5 n'égale pas actuellement. La question intéressante n'est pas de savoir qui remporte l'arène. C'est de savoir si l'affirmation d'Ideogram mesure quelque chose que l'arène ne mesure pas.
Où en sont précisément les deux modèles
• Ideogram 4.5 — sorti le 30 septembre 2026. Modèle d’édition précise ; génération et édition à quatre vitesses de rendu ; 2K natif ; éditions démontrées à une résolution source allant jusqu’à 4 016 × 6 016 (24,2 MP). Génération texte-image : 34e sur 167 à 1 014 ± 11 Elo (2 247 votes) ; édition d’image : 23e à 1 064 ± 11 Elo (2 382 votes). 0,03 $–0,22 $ par image selon le réglage de vitesse.
• GPT Image 2.5 Sunburst — lancé le 8 septembre 2026 comme la moitié privilégiant la précision de la mise à niveau d'image scindée d'OpenAI, identifiant d'API gpt-image-2.5-sunburst. Génération d'images à partir de texte n° 1 à 1 197 ± 9 Elo (14 023 votes) ; édition d'images n° 1 à 1 182 ± 8 Elo (17 899 votes). Au prix de 210,70 $ pour 1 000 images selon la conversion du classement.
• GPT Image 2.5 Flare — la moitié rapide de la même version, identifiant gpt-image-2.5-flare. N° 2 dans les deux classements : 1 190 en texte-image, 1 162 en édition. Même tarif de 210,70 $ pour 1 000.
Placez les deux nombres d'édition côte à côte : l'écart est de 118 points Elo — 1 182 contre 1 064 — avec des intervalles de confiance de ±8 et ±11. Les intervalles ne se chevauchent pas. Sur le tableau qui mesure la préférence d'édition en un seul passage, Sunburst l'emporte, et il l'emporte avec environ sept fois et demie plus de votes derrière lui.
Ce que le classement mesure et ne mesure pas
C'est la partie qui détermine si l'affirmation d'Ideogram résiste au contact des preuves.
L’arène d’édition d’Artificial Analysis repose sur la préférence humaine aveugle en comparaison par paires : les votants voient la même image source et la même instruction, reçoivent deux résultats édités sans étiquettes, puis choisissent le meilleur. C’est une méthode solide pour répondre à « lequel de ces deux résultats ressemble le plus à ce que demandait l’instruction ».
Il ne peut pas mesurer ce dont Ideogram fait la promotion. Un votant qui juge une seule retouche ne peut pas voir si le modèle a discrètement modifié le papier peint, décalé un visage de deux millimètres ou recalculé le grain sur le reste de l'image. La défaillance qu'Ideogram prétend corriger ne devient visible que sur une séquence — tour quatre, tour sept, tour dix — et aucune arène grand public ne présente de séquences aux votants. Un score Elo de 1 064 dit que les retouches individuelles d'Ideogram sont bonnes. Il ne dit absolument rien sur le fait qu'elles restent bonnes.
C’est à double tranchant pour Ideogram, et la version honnête est la suivante : le classement ne confirme pas l’affirmation de dérive, et il ne la réfute pas non plus. Ce qu’il réfute, c’est l’affirmation implicite plus forte qu’un lecteur pourrait retenir de la page de lancement — à savoir que 4.5 est le meilleur éditeur, point final. Face au classement, il est l’éditeur le moins bien classé, avec un écart plus large que ses barres d’erreur.

Ce que chacun fait et que l’autre ne fait pas
• Édition à la résolution source — La revendication d'ingénierie distinctive d'Ideogram 4.5. Sa page montre une édition appliquée à une source de 4 016 × 6 016 sans réduction d'échelle, avec la promesse que la limite de l'édition est préservée suffisamment bien pour recoller la découpe à l'original. Pour le travail d'impression, c'est la différence entre un livrable et un compromis.
• Étendue de la surface des paramètres — celle de GPT Image 2.5. OpenAI a ajouté xhigh et max à l'échelle de qualité et a fait des arrière-plans transparents un paramètre de premier ordre, avec background défini sur transparent, opaque ou auto et une sortie PNG ou WebP. La sortie transparente était une lacune sur GPT Image 2 et est devenue une fonctionnalité phare de la paire 2.5.
• Voie rapide — Flare existe spécifiquement pour être l'option rapide par défaut. OpenAI annonce jusqu'à 50 % de latence en moins par rapport à la génération précédente ; Sunburst est délibérément plus lent et destiné aux modifications qui doivent résister à un examen minutieux.
• Structure tarifaire — Ideogram facture à l'image en fonction de la vitesse de rendu (de 0,03 $ à 0,22 $). OpenAI facture aux tokens sur la même grille tarifaire que GPT Image 2 — 8 $ par million de tokens d'entrée d'image, 30 $ par million de tokens de sortie d'image —, c'est pourquoi la conversion indépendante par image avoisine 0,21 $ pour une image haute qualité de 1024 × 1024.
Les courbes de prix se croisent à un endroit peu commode. Aux réglages Low et Medium d’Ideogram 4.5, c’est nettement moins cher par image que la paire OpenAI. À High — là où réside la démonstration de dérive, et où vous utiliseriez une source de 24 mégapixels — les deux sont proches du même chiffre. La comparaison que la plupart des acheteurs feront réellement est Ideogram 4.5 de haute qualité face à Sunburst de haute qualité, et sur cette comparaison, le prix est à peu près à égalité, avec un déficit de 118-Elo au classement mesuré.
Ce qui est très bien, si l’affirmation de dérive est réelle. Tout le pari est là.


La différence d’accessibilité que personne ne met en avant
Une asymétrie pratique joue en sens inverse du tableau des scores. Les deux identifiants de GPT Image 2.5 sont plus récents que tout ce qui figure au catalogue d'OrcaRouter — notre gamme d'images OpenAI se compose aujourd'hui de GPT-Image-1.5 à 8 $/32 $ par million de tokens et de GPT-Image-2 à 8 $/30 $, toutes deux au prix catalogue du fournisseur, sans marge ajoutée. Le duo 2.5 est apparu sur la grille tarifaire d'OpenAI au même tarif de 8 $/30 $ que GPT-Image-2, ce qui signifie qu'à l'instant où ils deviennent routables, ils arrivent au même prix de répercussion plutôt qu'à un nouveau prix, et la question du coût entre eux devient une question d'efficacité des tokens plutôt que du fournisseur auquel on s'adresse.
Ideogram 4.5 est disponible sur l’API propre à Ideogram et sur des plateformes partenaires. Il n’est pas dans notre catalogue. Cela compte pour la comparaison d’une manière assez banale : l’un de ces deux modèles s’utilise en remplacement direct dans un client compatible OpenAI, et l’autre constitue une nouvelle intégration. Si vous appelez déjà GPT-Image-2 via un point de terminaison au format OpenAI, le coût pour essayer Sunburst se résume à un changement d’ID de modèle ; le coût pour essayer Ideogram 4.5, c’est un second contrat et un second client, avant même d’en arriver à l’évaluation de la qualité.
Une couche de routage ne supprime pas cette différence — elle ne fait que retirer la plomberie du côté déjà compatible, et vous permet de diriger une partie du trafic vers un nouveau venu sans engager de chemin de production vers lui. Le basculement compte plus que d’habitude ici, parce que ce que vous testeriez est un modèle dont l’affirmation centrale ne fait l’objet d’aucune vérification indépendante et dont les tailles d’échantillon sont un cinquième de celles de son concurrent.
Comment le régler
Ne lancez pas cette comparaison sur des images isolées. C'est la méthode de l'arène, et c'est le mauvais instrument — elle vous dira que Sunburst gagne, ce que vous saviez déjà.
Exécutez-le sur des séquences. Prenez cinq ou dix images issues de votre propre travail, écrivez la même chaîne de six ou huit retouches progressives, puis exécutez la chaîne identique sur Ideogram 4.5 (High) et sur Sunburst (max). Ensuite, comparez le tour un au tour huit pour chaque modèle, sur les régions que vous n’avez jamais demandé au modèle de toucher. Comptez les pixels qui ont bougé. Ce nombre — la divergence des régions inchangées sur une séquence — est ce sur quoi Ideogram prétend l’emporter, et à ma connaissance, personne ne le publie pour l’un ou l’autre modèle.
Ensuite, chiffrez le coût des deux exécutions par séquence terminée. À ce stade, vous aurez une réponse qui vaut plus de 118 Elo, parce qu’elle concernera vos images plutôt que celles d’un panel de votants.
Ce qu'est réellement cette confrontation
Ideogram 4.5 n'a pas participé à un concours qu'il remporte sur les classements, et il semble le savoir — c'est pourquoi la page de lancement montre un comportement plutôt que d'afficher un rang. Le comportement qu'il démontre est bien assez réel pour valoir la peine d'être testé et assez précis pour être falsifiable : soit des modifications répétées tiennent ensemble, soit elles ne tiennent pas, et un test de dix tours sur vos propres fichiers le règle en un après-midi.
La lecture raisonnable aujourd’hui est que GPT Image 2.5 Sunburst est le meilleur éditeur selon la seule mesure indépendante qui existe, avec une marge en dehors des barres d’erreur, et bien plus de preuves derrière ce chiffre — et qu’Ideogram 4.5 vend une caractéristique plus étroite et non mesurée, à un prix plus bas aux réglages faibles et à peu près équivalent au réglage dont dépend sa promesse. Si la fidélité multi-tours est votre goulot d’étranglement de production, le test est bon marché et le modèle le mérite. Si ce n’est pas le cas, le classement a déjà répondu.
