Ideogram 4.5 vs GPT Image 2.5의 히어로 타이틀 카드로, '편집에서 Elo 97점 차 — 그리고 벤더가 상대를 지목했다'라는 문구가 들어가며, 'Ideogram 4.5 — 2026년 9월 30일 라이브', 'GPT Image 2.5 Sunburst — 2026년 9월 8일 라이브', 'Ideogram 4.5 편집 Elo 1,064', 'Sunburst 편집 Elo 1,182' 칩이 포함됩니다. OrcaRouter 로고는 오른쪽 아래 모서리에 합성됩니다.
Guides & Insights

Ideogram 4.5 vs GPT Image 2.5: Ideogram이 스스로 이 싸움을 걸었다

작성자

Alistair Wren

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

대부분의 모델 비교는 그것을 작성하는 사람이 구성합니다. 이 비교는 Ideogram이 구성했습니다. 2026년 9월 30일부터 공개된 Ideogram 4.5의 출시 페이지는 나란히 비교하는 편집 데모를 선보이며 캡션에서 경쟁 상대를 지목합니다: "Ideogram 4.5와 GPT Image 2.5 Sunburst, Nano Banana Pro, Nano Banana 2에서의 동일한 편집." 그런 다음 시청자가 무엇을 보게 될지에 대해 이렇게 주장합니다 — "GPT Image와 Nano Banana의 출력은 몇 번의 편집만 거치면 사용할 수 없게 되지만, Ideogram 4.5는 편집을 거듭해도 깨끗하게 유지됩니다."

그건 이례적으로 직접적이다. 벤더가 벤치마크 대상을 직접 고르고 결과를 미리 알려주는 것은 한 측면에서는 진지하게 받아들일 만하고, 다른 측면에서는 회의적으로 볼 만하다. GPT Image 2.5는 두 이미지 카테고리 모두에서 독립 보드상 가장 강력한 존재이므로, 상대로 고른 것은 옳은 선택이다. 그리고 이는 두 개의 식별자로 이루어진 릴리스 — Flare와 Sunburst, 둘 다 2026년 9월 8일 출시 — 로, 현재 Ideogram 4.5가 따라가지 못하는 공개 아레나 점수를 갖고 있다. 흥미로운 질문은 누가 아레나에서 이기느냐가 아니다. Ideogram의 주장이 아레나가 측정하지 않는 무언가를 측정하고 있느냐이다.

두 모델이 정확히 어디에 서 있는지

• Ideogram 4.5 — 2026년 9월 30일 출시. 정밀 편집 모델; 네 가지 렌더링 속도로 생성 및 편집; 네이티브 2K; 편집은 최대 4,016 × 6,016(24.2MP)의 원본 해상도에서 시연됨. 텍스트-이미지 부문 167개 중 34위, 1,014 ± 11 Elo(2,247표); 이미지 편집 부문 23위, 1,064 ± 11 Elo(2,382표). 속도 설정에 따라 이미지당 $0.03–$0.22.

• GPT Image 2.5 Sunburst — 2026년 9월 8일 출시된, OpenAI의 분할 이미지 업그레이드 중 정밀성 우선 버전이며 API 식별자는 gpt-image-2.5-sunburst. 텍스트-투-이미지 No. 1 1,197 ± 9 Elo(14,023표); 이미지 편집 No. 1 1,182 ± 8 Elo(17,899표). 보드 환산 기준 이미지 1,000장당 $210.70에 책정.

• GPT Image 2.5 Flare — 동일 릴리스의 빠른 버전이며, 식별자는 gpt-image-2.5-flare입니다. 두 보드 모두 2위: 텍스트-투-이미지 1,190, 편집 1,162. 1,000개당 동일하게 $210.70.

두 편집 점수를 나란히 놓으면 격차는 118 Elo입니다 — 1,182 대 1,064 — 신뢰구간은 ±8과 ±11입니다. 두 구간은 겹치지 않습니다. 단일 샷 편집 선호도를 측정하는 리더보드에서 Sunburst가 승리하며, 약 7.5배에 달하는 투표 수를 등에 업고 승리합니다.

리더보드가 측정하는 것과 측정하지 않는 것

이것이 아이디오그램의 주장이 증거와 맞닥뜨렸을 때 살아남을 수 있는지를 결정하는 부분이다.

Artificial Analysis의 편집 아레나는 블라인드 쌍대 인간 선호도입니다. 투표자는 동일한 원본 이미지와 동일한 지시문을 보고, 라벨이 없는 두 개의 편집 결과를 받아 더 나은 것을 선택합니다. 이는 "이 두 출력 중 어느 것이 지시문이 요청한 것에 더 가까워 보이는가"를 판단하는 강력한 방법입니다.

그것은 Ideogram이 광고하는 그 대상을 측정할 수 없다. 하나의 편집을 평가하는 투표자는 모델이 조용히 배경화면을 바꿨는지, 얼굴을 2밀리미터 옮겼는지, 아니면 프레임의 나머지 부분 전체에 그레인을 다시 렌더링했는지 알 수 없다. Ideogram이 고치겠다고 주장하는 결함은 연속된 시퀀스 — 네 번째 턴, 일곱 번째 턴, 열 번째 턴 — 에서만 드러나며, 어떤 주류 아레나도 투표자에게 시퀀스를 제시하지 않는다. 1,064 Elo는 Ideogram의 개별 편집이 좋다고 말해 준다. 그것이 계속 좋은지에 대해서는 전혀 말해 주지 않는다.

그것은 아이데오그램에게 양쪽으로 작용한다. 그리고 솔직히 말하면 이렇다: 리더보드는 그 드리프트 주장을 확인해 주지도 않고, 반박하지도 않는다. 그것이 실제로 반박하는 것은 독자가 출시 페이지에서 받아들일 수 있는 암묵적이고 더 강한 주장, 즉 4.5가 더 나은 편집기라는 단호한 주장이다. 리더보드에 비추어 보면, 4.5는 오차 범위보다 더 넓은 격차로 더 낮은 순위의 편집기이다.

Screenshot of the Ideogram 4.5 model page showing the model-comparison section headed 'Compare models across multi-turn edits', with a side-by-side video widget captioned to show the same edits applied to Ideogram 4.5 alongside GPT Image 2.5 Sunburst, Nano Banana Pro and Nano Banana 2

각각이 다른 쪽은 하지 않는 것

• 원본 해상도 편집 — Ideogram 4.5를 차별화하는 엔지니어링 상이다. 해당 페이지에는 다운스케일링 없이 4,016 × 6,016 원본에 적용된 편집이 나와 있으며, 편집 경계가 잘라낸 부분을 원본에 다시 이어 붙일 수 있을 만큼 충분히 보존된다고 약속한다. 인쇄 작업에서 이것은 납품 가능한 결과물과 타협 사이의 차이다.

• 매개변수 표면의 폭 — GPT Image 2.5의 것입니다. OpenAI는 xhigh와 max를 품질 단계에 추가하고 투명 배경을 일급 매개변수로 만들었으며, background를 transparent, opaque 또는 auto로 설정하고 PNG 또는 WebP로 출력할 수 있습니다. 투명 출력은 GPT Image 2에서는 빠져 있던 부분이었지만 2.5 쌍에서는 대표 기능이 되었습니다.

• 스피드 레인 — Flare는 빠른 기본값이 되기 위해 특별히 존재합니다. OpenAI는 이전 세대보다 지연 시간이 최대 50% 더 낮다고 주장하며, Sunburst는 의도적으로 더 느리고 면밀한 검토를 견뎌야 하는 편집을 겨냥합니다.

• 가격 구조 — Ideogram은 렌더링 속도에 따라 이미지당 요금을 매깁니다($0.03~$0.22). OpenAI는 GPT Image 2와 동일한 요율표를 기준으로 토큰 단위로 요금을 매깁니다 — 이미지 입력 토큰 100만 개당 $8, 이미지 출력 토큰 100만 개당 $30 — 그래서 독립적인 이미지당 환산 금액이 고품질 1024 × 1024 기준 약 $0.21에 이릅니다.

가격선은 어색한 지점에서 교차한다. Ideogram 4.5의 Low 및 Medium 설정에서는 이미지당 가격이 OpenAI의 두 모델보다 훨씬 저렴하다. High 설정에서는 — 드리프트 데모가 자리한 곳이며, 24메가픽셀 소스를 돌리게 되는 곳이기도 하다 — 둘은 거의 같은 수치에 가깝다. 대부분의 구매자가 실제로 하게 될 비교는 고품질 Ideogram 4.5 대 고품질 Sunburst이며, 그 비교에서 가격은 거의 동률이지만 측정 리더보드에서는 118 Elo 열세다.

드리프트 주장이 사실이라면, 그건 괜찮다. 그게 바로 전부를 건 승부다.

Screenshot of OrcaRouter's public model catalogue listing 206 models from 16 providers behind one API key, with the model cards and the three-step 'How to call any model' panel showing the OpenAI-compatible endpoint.Comparison scoreboard for Ideogram 4.5 and GPT Image 2.5 Sunburst. Left column 'Ideogram 4.5': live Sep 30 2026, editing rank 23 at 1,064 Elo from 2,382 votes, text-to-image rank 34 at 1,014 Elo, $0.03 to $0.22 per image, max edit resolution 4,016 by 6,016 pixels, open weights planned. Right column 'GPT Image 2.5 Sunburst': live Sep 8 2026, editing rank 1 at 1,182 Elo from 17,899 votes, text-to-image rank 1 at 1,197 Elo, $210.70 per 1,000 images, transparent background output, quality ladder through max. A footer reads 'All leaderboard figures per Artificial Analysis, October 2026; price conversions are the board's own.'

아무도 마케팅하지 않는 접근성의 차이

하나의 실질적인 비대칭은 스코어보드와 반대 방향으로 흐릅니다. GPT Image 2.5의 두 식별자는 OrcaRouter 카탈로그에 있는 어떤 것보다 최신입니다 — 오늘날 우리 OpenAI 이미지 라인은 백만 토큰당 $8/$32의 GPT-Image-1.5와 $8/$30의 GPT-Image-2이며, 둘 다 공급자 정가로 마크업 없이 추가됩니다. 2.5 쌍은 GPT-Image-2와 동일한 $8/$30으로 OpenAI 요금표에 등장했으며, 이는 라우팅 가능해지는 순간 새로운 가격이 아니라 동일한 패스스루 가격으로 책정된다는 뜻이고, 이들 사이의 비용 문제는 어느 공급업체를 호출하느냐가 아니라 토큰 효율성에 관한 것이 됩니다.

Ideogram 4.5는 Ideogram 자체 API와 파트너 플랫폼에는 있습니다. 우리 카탈로그에는 없습니다. 이 점은 비교에 지루하게도 중요합니다. 이 두 모델 중 하나는 OpenAI 호환 클라이언트에 그대로 넣을 수 있는 드롭인이고, 다른 하나는 새로 통합해야 하는 모델입니다. 이미 OpenAI 형태의 엔드포인트를 통해 GPT-Image-2를 호출하고 있다면, Sunburst를 시험해 보는 비용은 모델 ID를 바꾸는 것뿐입니다. Ideogram 4.5를 시험해 보는 비용은 품질을 평가해 보기도 전에 두 번째 계약과 두 번째 클라이언트를 필요로 한다는 것입니다.

라우팅 계층은 그 차이를 없애지 않는다 — 이미 호환되는 쪽에서 배관 작업을 제거하고, 그쪽에 프로덕션 경로를 확정하지 않은 채 신규 진입자에게 트래픽의 일부를 보낼 수 있게 해 줄 뿐이다. 여기서는 페일오버가 평소보다 더 중요하다. 시험하려는 대상이 핵심 주장에 대한 독립적 검증이 없고 표본 크기가 경쟁사 표본의 5분의 1에 불과한 모델이기 때문이다.

그것을 해결하는 방법

단일 이미지로 이 비교를 실행하지 마세요. 그건 아레나의 방식이고 잘못된 도구입니다 — Sunburst가 이긴다고 알려줄 테지만, 그건 이미 알고 있는 사실입니다.

시퀀스 단위로 실행해 보세요. 자신의 작업에서 이미지 다섯 장이나 열 장을 가져와, 동일한 6~8단계 점진적 편집 체인을 작성한 다음, 그 동일한 체인을 Ideogram 4.5 (High)와 Sunburst (max)에서 실행하세요. 그런 다음 각 모델에 대해, 모델에게 건드리라고 요청하지 않았던 영역에서 1턴과 8턴을 diff하세요. 움직인 픽셀 수를 세세요. 그 숫자 — 시퀀스 전반에 걸친 변경되지 않은 영역의 발산 — 가 바로 Ideogram이 우위를 점한다고 주장하는 지표이며, 제가 알기로는 두 모델 모두 이 수치를 공개하는 곳이 없습니다.

그런 다음 완성된 시퀀스당 두 실행 모두의 가격을 산정하세요. 그 시점에 당신은 118 Elo보다 더 가치 있는 답을 얻게 될 것입니다. 왜냐하면 그것은 투표자 패널의 이미지가 아니라 당신의 이미지에 관한 것이기 때문입니다.

이 매치업이 실제로 무엇인지

Ideogram 4.5는 리더보드에서 우승하는 경연에 참가하지 않았고, 그것을 아는 듯하다 — 그래서 출시 페이지는 순위를 표시하는 대신 행동을 시연한다. 그것이 시연하는 행동은 테스트해 볼 가치가 있을 만큼 실제적이고 반증 가능할 만큼 구체적이다: 반복 편집이 일관되게 유지되거나 그렇지 않거나 둘 중 하나이며, 자신의 파일로 하는 10턴 테스트면 오후 한나절에 결론이 난다.

오늘날 합리적인 해석은, GPT Image 2.5 Sunburst가 현존하는 유일한 독립적 척도에서 더 나은 편집기이고, 그 격차는 오차 범위를 벗어나며, 그 수치를 뒷받침하는 증거도 훨씬 많다는 것입니다 — 그리고 Ideogram 4.5는 더 좁고 측정되지 않은 속성을, 낮은 설정에서는 더 저렴하고 그 주장이 의존하는 설정에서는 거의 동일한 가격에 팔고 있다는 것입니다. 멀티턴 충실도가 당신의 프로덕션 병목이라면, 그 테스트는 저렴하고 그 모델은 그럴 만한 가치가 있습니다. 그렇지 않다면, 보드가 이미 답을 내렸습니다.