
MAI-Image-2.5-Pro vs Flux 3: 같은 주에 출시, 서로 다른 두 현실
- z-aiNEWZ.ai: GLM 5.32026-08-1860지능75코딩
- obsidianNEWQwen3.8 27B Uncensored (Aggressive)2026-08-1552지능68코딩
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253지능69코딩
- grokNEWSpaceXAI: Grok 4.62026-08-1261지능77코딩
- metaMeta: Muse Spark 1.22026-08-0557지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0358지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2152지능69코딩
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137지능49코딩
- metaMeta: Muse Spark 1.12026-07-1653지능71코딩
- kimiMoonshotAI: Kimi K32026-07-1560지능76코딩
- openaiOpenAI: GPT-5.6 Luna2026-07-0952지능71코딩
- openaiOpenAI: GPT-5.6 Terra2026-07-0957지능77코딩
- openaiOpenAI: GPT-5.6 Sol2026-07-0961지능77코딩
- grokxAI: Grok 4.52026-07-0856지능72코딩
MAI-Image-2.5-Pro 및 Flux 3은 같은 주(2026년 7월 23일)에 모두 발표되었습니다. 한 달 후, 두 모델은 전혀 다른 운명을 맞이했습니다. MAI-Image-2.5-Pro는 Microsoft의 고품질 이미지 모델로, Microsoft Foundry에서 공개 미리보기 중이며, 상승하여 Artificial Analysis Image Editing Arena에서 1위 (약 6,100개의 블라인드 투표에서 얻은 Elo 1,272)에 이르렀습니다. Flux 3는 Black Forest Labs의 통합 멀티모달 기반 모델로, 정확히 하나의 티어—비디오—만 출시했으며, 이미지 티어는 공개 엔드포인트도, 가격도, 누구나 실행할 수 있는 벤치마크도 없습니다. "어떤 이미지 모델을 사용해야 하나"라고 묻는 독자에게는 여기에 두 가지 후보가 있는 것이 아니라, 제품 하나와 약속 하나만 있을 뿐입니다.
각각이 실제로 무엇인지
• MAI-Image-2.5-Pro — 특화된 독점 이미지 생성 및 편집 모델로, Microsoft 자체 MAI-Image-2.5 제품군 중 최고 충실도 등급입니다. 토큰 사용량에 따라 과금되며 Foundry에서 호스팅되고, 히어로 이미지, 정밀 편집, 이미지 내 텍스트 렌더링을 대상으로 합니다. 이 모델의 전부는 이미지입니다.
• Flux 3 — 이미지, 비디오, 오디오(로봇 동작 예측 포함)를 함께 학습한 통합 멀티모달 파운데이션 모델로, BFL이 Self-Flow라고 부르는 플로우 매칭 방식으로 구축되었습니다. 다섯 가지 변형이 발표되었습니다: Flux 3 Video, Flux 3 Image, Flux 3 Action, 로보틱스용 Flux-mimic, 그리고 Flux 3 Dev(2026년 후반 가중치 공개 예정). 이미지는 더 큰 그림 안의 하나의 모달리티일 뿐, 제품 자체는 아닙니다.
그 구조적 차이는 어떤 사양보다 중요합니다. 이미지에 특화된 모델은 모든 역량을 정지 이미지에 집중하는 반면, 멀티모달 모델은 역량을 여러 매체에 분산합니다. MAI-Image-2.5-Pro는 이미지 편집에서 승리하기 위해 존재합니다. Flux 3는 모든 것을 처리하는 단일 모델이 되기 위해 존재하며, 그 이미지 계층은 아직 도래하지 않은 비전의 일부입니다.
가용성: 전체 비교
2026년 8월 중순 기준으로, 비대칭성은 절대적이다:
• MAI-Image-2.5-Pro — Azure AI Foundry에서 7개 글로벌 리전에 걸쳐 공개 미리보기로 제공되며, 무료 MAI Playground도 함께 제공됩니다. Microsoft 계정으로 오늘 바로 사용할 수 있으며, 이미 Bing Image Creator, PowerPoint, OneDrive를 구동하는 제품군의 품질 등급입니다.
• Flux 3 Image — 미출시 상태입니다. BFL 문서에는 이미지 엔드포인트가 없으며, 현재 호출 가능한 이미지 라인은 FLUX.2(Pro, Dev, Flex, Klein)입니다. Flux 3 페이지에는 시작하기 버튼 대신 '곧 출시' 라벨과 신청 양식이 있습니다. BFL은 7월 23일 발표 이후 '몇 주 내에' 이미지 얼리 액세스가 열릴 것이라고 밝혔지만, 현재까지 모델 ID, 이미지 사양, 프롬프트 제한은 공개되지 않았습니다. 일반 공급에 도달한 것은 Flux 3 Video뿐입니다(8월 4일, 초당 과금).
그래서 '오늘날 이미지 편집을 위해 무엇을 기반으로 삼을 수 있을까'라는 물음에 대한 실질적인 답에는 정확히 하나의 이름만 들어 있다.
각 측이 제시할 수 있는 증거
MAI-Image-2.5-Pro의 편집 성능은 독립적으로 측정됩니다. 편집 Elo 1위 외에도, 텍스트-이미지 순위는 1,292 Elo로 7위 — 좋은 결과이며 선두는 아닙니다. 이것이 전문가 모델을 솔직하게 평가하는 방법입니다. Microsoft는 또한 공급업체 보고 주장을 게시합니다: 텍스트 렌더링 정확도 96.8%(5개 언어를 다룬다고 표시됨), 내부 평가에서 GPT Image 1.5보다 프롬프트 준수율 27% 향상, 다중 이미지 캐릭터 일관성 94%. 이 모든 수치를 Microsoft 자체 수치로 표시하십시오; 리더보드는 독립적인 부분입니다.
Flux 3 Image에 대한 공개적인 증거는 전혀 없습니다. 테스트할 이미지 엔드포인트가 없기 때문에 이미지 벤치마크도 존재하지 않습니다. 이 제품군에서 BFL이 보고한 유일한 수치는 Flux 3 Video에 대한 것입니다. — BFL이 Omni Flash, H3, Seedance 2.0을 이긴다고 주장하는 내부 Elo 1,135(텍스트-투-비디오)와 1,051(이미지-투-비디오) — 그리고 이 수치들은 공급업체가 보고한 것이며 재현되지 않았고, 애초에 이미지 등급에는 적용되지 않습니다. Flux 3 이미지 품질을 "벤치마크"한다는 내용은 비디오 수치나 이전 FLUX.2 라인에서 추정한 것에 불과합니다.


Flux 3가 이미지에 대해 약속하는 것 (벤더 로드맵, 스펙 아님)
BFL의 이미지 티어에 대한 로드맵 주장은 그것들이 주장이라는 점 자체 때문에 정확히 알아둘 가치가 있다:
• 스타일, 종횡비, 해상도에 걸친 이미지 합성 및 편집
• 복잡한 프롬프트 처리 개선 및 고정확도 다국어 텍스트 렌더링
• 참조 이미지에서 제로샷 스타일 변환, 여러 스타일 참조를 한 번에 혼합
• 파인튜닝 없이 세대를 넘나드는 캐릭터 및 브랜드 일관성
• 비파괴 편집 — 텍스처, 그레인, 조명, 배경을 보존하여 다중 턴 편집 시에도 품질이 저하되지 않습니다
마지막 것이 흥미로운 주장입니다: 그것은 MAI-Image-2.5-Pro의 수술적 편집 설계가 이미 제공하며 성과를 내고 있는 "장면을 재생성하지 않는 편집" 속성과 동일합니다. Flux 3 Image가 그것을 실현한다면, MAI-Image-2.5-Pro가 이미 하고 있는 것과 직접 경쟁하게 될 것입니다. "If"가 핵심 단어입니다 — 그 목록의 모든 것은 엔드포인트가 존재할 때까지 검증되지 않은 상태입니다.
비용
• MAI-Image-2.5-Pro — 텍스트 입력 토큰 100만 개당 $5, 이미지 입력 토큰 100만 개당 $8, 이미지 출력 토큰 100만 개당 $106입니다. Artificial Analysis의 변환에 따르면 1024×1024 이미지는 약 1,000개당 $108.50입니다. 미리보기 가격이며, GA에 따라 달라질 수 있습니다.
• Flux 3 Image — 가격은 존재하지 않습니다. 엔드포인트가 존재하지 않기 때문입니다. Flux 3에 대해 공개된 유일한 가격은 비디오용입니다: 풀 렌더의 경우 $0.17/초(HD) 및 $0.29/초(FHD)입니다. 참고로 호출 가능한 FLUX.2 이미지 라인의 경우, BFL은 Flux Pro에 대해 이미지당 약 $0.04, Flux Dev에 대해 약 $0.015를 청구합니다. — 그러나 이는 이전 세대의 가격이며 예측이 아닙니다.
빈 줄과 가격을 비교할 수 없습니다. 오늘의 비용 비교는 MAI-Image-2.5-Pro의 프리미엄 요율을 전혀 없는 것과 비교하는 것입니다.

어느 것을 기반으로 해야 할까?
2026년에 산출물이 이미지라면 정답은 MAI-Image-2.5-Pro입니다(또는 다른 호스팅 편집기 중 하나 — GPT Image 2는 여전히 텍스트-이미지와 주요 편집 분야에서 선두입니다). 이 모델은 호출 가능하고, 독립적인 #1 편집 점수를 보유하며, 메가픽셀 안팎의 해상도 상한이 사용 사례에 부합하는지가 가장 확인해야 할 사항입니다. Flux 3는 주목할 만한 항목입니다. 이미지 티어가 출시되면, 비파괴 편집 및 브랜드 일관성에 대한 주장은 Microsoft가 현재 #1로 평가하는 바로 그 모델을 상대로 진지한 테스트를 받을 가치가 있습니다.
또한 대기를 라우팅 관점에서 바라보는 방법도 있습니다. Flux 3 Image가 마침내 엔드포인트를 얻게 되면, 벤치마크가 없는 새로운 모델을 저위험으로 도입하는 방법은 일부 트래픽을 그 모델로 라우팅하고 검증된 모델을 자동 장애 조치로 유지하는 것입니다 — 하나의 엔드포인트, 0% 마크업으로 전달되는 공급자 가격, 그리고 로드맵 슬라이드 대신 실제 트래픽에서 자리매김하는 검증되지 않은 모델. 이것이 OrcaRouter가 존재하는 패턴이며, MAI-Image-2.5-Pro와 같은 프리뷰 티어 모델이 일반 공급(GA)에 도달하기 전에 채택 가능하게 만드는 것과 동일한 패턴입니다.
평결
같은 출시 주, 한 달 후: MAI-Image-2.5-Pro는 오늘 바로 호출할 수 있는 검증된 1위 에디터이고, Flux 3는 이미지 계층이 여전히 로드맵상의 약속에 불과한 멀티모달 기반 모델입니다. 이미지 품질로 둘을 비교하는 것은 아직 링에 오르지 않은 파이터와 복서를 비교하는 것과 같습니다. 지금 이미지 작업에는 MAI-Image-2.5-Pro를 사용하고, Flux 3 Image는 엔드포인트가 실제로 출시되는 날 재평가할 목록에 넣어 두십시오.
