'Qwen-Image 2.1 vs Qwen-Image 3.0' 기사를 위해 생성된 히어로 카드로, 'Qwen-Image 2.1'과 'Qwen-Image 3.0'이라고 표시된 두 개의 둥근 모델 카드, 2026년 9월 20일과 2026년 7월 21일 날짜 마커, 한쪽에는 다운로드 아이콘, 다른 쪽에는 클라우드 아이콘, 그리고 '더 낮은 숫자가 더 새로운 모델입니다'라고 적힌 리본이 표시됩니다.
Guides & Insights

Qwen-Image 2.1 vs Qwen-Image 3.0: 더 낮은 숫자가 더 새로운 모델

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

모두를 헷갈리게 만드는 것부터 시작하자. Qwen-Image 2.1Qwen-Image 3.0보다 더 최신이다. 벤더는 2026년 7월 21일에 Qwen-Image 3.0을 출시했고 8월 5일에 정식 출시(GA)로 전환했다. Qwen-Image 2.1은 2026년 9월 20일에 출시했는데, 이는 7주 뒤이며 마이너 버전이 하나 낮다. 이 번호는 순서를 뜻하는 것이 아니다. 이름만 공유하는 두 개의 서로 다른 제품 라인이며, 이 둘 중 어느 쪽에 대해서든 가장 유용한 사실 하나는 그것 위에 무언가를 구축할 수 있는지를 결정하는 그 질문에서 두 제품이 정반대 입장을 취한다는 점이다. Qwen-Image 3.0은 가중치도, 라이선스도, 기술 보고서도 없는 폐쇄형 호스팅 모델이다. Qwen-Image 2.1은 오픈 가중치 모델로 오늘 바로 다운로드할 수 있으며, 비상업적 사용만 허용하는 연구용 라이선스가 적용된다.

우연히 이름이 겹치는 두 제품

Qwen-Image 제품군은 이제 지난 14개월 동안 세 가지 뚜렷한 라이선스 입장을 취해 왔으며, 이를 나열하면 대부분의 혼란이 해소됩니다:

Qwen-Image 1.0 and 2.0 — Hugging Face와 ModelScope에 Apache 2.0 오픈 웨이트 공개, 출시 당일 기술 보고서 제공, 자체 호스팅·파인튜닝·양자화 가능.

Qwen-Image 3.0 — 비공개. 가중치도, 명시된 라이선스도, 모델 카드도, 기술 보고서도, 공개된 벤치마크 표도 없습니다. Pro 및 Standard 에디션으로 제공되는 호스팅 API를 통해서만 접근할 수 있습니다.

Qwen-Image 2.1 — 다시 오픈 웨이트로 공개되었지만, 2026년 9월 20일자 Qwen Research License Agreement에 따라 "비상업적 목적에 한해서만" 권리를 부여하며, 상업적 사용은 별도로 협상된 라이선스로 안내한다.

타임라인이 아니라 패턴으로 읽으면 그 형태가 분명해진다: Alibaba는 더 이상 "오픈"을 이분법으로 다루지 않는다. Qwen-Image 2.1은 1.0과 2.0이 그랬던 허용적인 릴리스도 아니고, 3.0이 그랬던 폐쇄적인 릴리스도 아니다. 그것은 세 번째 위치다 — 살펴보고, 실행하고, 수정할 수 있는 가중치에, 앞단에 상업적 게이트가 볼트로 고정된.

각 모델이 실제로 무엇인지

Qwen-Image 2.1 — 시각 생성 구성 요소에 7B 파라미터를 갖춘 통합 텍스트-투-이미지 생성 및 이미지 편집 모델로, 32레이어 단일 스트림 DiT로 구축되었습니다. 여기에 Qwen3-VL 8B 텍스트 인코더와 16배 공간 압축의 64채널 RGBA VAE가 함께하며, 전체 다운로드 용량은 약 33GB로 텍스트 인코더가 절반 이상을 차지합니다. 텍스트에는 토큰 수준 인과 마스크를, 이미지 생성에는 청크 수준 양방향 마스크를 사용하는 블록-인과 어텐션과 다중 이미지 편집을 위한 프리픽스 KV 캐시 재사용을 갖추었습니다. 네이티브 2K를 지원하며 기본값은 40스텝의 2048×2048이고, 7가지 화면 비율 프리셋이 제공됩니다.

Qwen-Image 3.0 — Pro와 Standard 에디션으로 제공되는 클로즈드 호스팅 모델로, 하나의 API를 통해 이미지 생성과 편집을 제공합니다. 알리바바의 발표 자료는 최대 약 4,500 토큰의 프롬프트, 약 10픽셀까지 판독 가능한 텍스트, 20개 이상의 폰트에 걸친 12개 언어 지원을 주장하며, 출력은 최대 2048×2048이고 호출당 최대 6개의 이미지를 지원합니다. 파라미터 수는 공개되지 않았으며, 널리 회자되는 약 20B MMDiT 수치는 확인된 것이 아니라 보도된 것입니다.

실무에서 가장 중요한 아키텍처적 차이는 크기가 아니라, 모델이 어디에서 실행되는지 그리고 모델에 무엇을 할 수 있는지입니다. Qwen-Image 2.1은 검사하고, 양자화하고, 비공개 데이터로 미세 조정하고, 자체 하드웨어에서 실행할 수 있는 파일 형태로 등장했습니다. 심지어 가중치가 공개되기도 사흘 전에 SGLang 지원 풀 리퀘스트가 병합되었습니다. Qwen-Image 3.0은 엔드포인트로 등장합니다. 양자화할 수 없고, 미세 조정할 수 없으며, Alibaba가 실행하는 곳 외에는 어디에서도 실행할 수 없습니다.

편집은 둘이 가장 크게 갈라지는 지점이다

두 모델 모두 하나의 시스템에서 생성과 편집을 수행하므로, 흥미로운 비교는 편집 세부 사항에 있습니다. 그리고 여기서는 더 새롭고 더 작은 모델이 서류상으로는 더 유능한 쪽입니다.

참조 이미지 — Qwen-Image 2.1은 최대 10개의 입력 참조를 지원합니다. Qwen-Image 3.0의 Pro 문서에는 1~3개의 입력 이미지 지원이 설명되어 있습니다.

로컬 편집 제어 — Qwen-Image 2.1은 원, 그린 주석, 그리고 별도의 입력으로 제공되는 분리형 마스크를 지원하므로 원본 이미지에는 아무 표시도 남지 않습니다. Qwen-Image 3.0의 문서화된 편집 경로는 로컬 재작성, 콘텐츠 확장, 스타일 전환, 다중 카메라 앵글 생성을 아우르지만, 공개된 마스크 기반 워크플로는 없습니다.

투명도 — Qwen-Image 2.1은 RGBA 이미지를 기본적으로 생성 및 편집하고, 투명 레이어 내부의 텍스트를 편집하며, RGB 사진에서 피사체를 추출해 투명 레이어로 만듭니다. Qwen-Image 3.0의 발표에는 투명도에 대한 언급이 없습니다.

프롬프트 재작성 — Qwen-Image 2.1은 두 개의 전용 재작성 체크포인트를 제공하며, 둘 다 미세 조정된 Qwen3.5-VL 9B 모델로, 하나는 텍스트-투-이미지용, 하나는 편집용이고, 재작성 코드와 시스템 프롬프트가 공개되어 있습니다. Qwen-Image 3.0의 프롬프트 처리는 API 뒤의 블랙박스입니다.

Ecosystem — Qwen-Image 2.1은 Diffusers, ComfyUI, vLLM-Omni, SGLang, LightX2V에서 출시 첫날부터 지원되며, AMD ROCm 및 FlagOS 경로도 지원합니다. Qwen-Image 3.0은 API를 제공합니다.

마지막 문장은 수사적 미사여구가 아니다. 파이프라인이 ComfyUI에 있거나 추론 스택이 vLLM인 팀에게는, 병합된 파이프라인 클래스가 있는 모델과 HTTP 엔드포인트가 있는 모델의 차이가 곧 통합 작업과 재작성의 차이다.

A generated two-column comparison scoreboard titled 'Qwen-Image 2.1 vs Qwen-Image 3.0 — the scoreboard'. Left column 'Qwen-Image 2.1': rows reading Released: 20 Sep 2026; Licence: research, non-commercial; Access: 33 GB open download; Reference images: up to 10; Transparency: native RGBA; Published price: none. Right column 'Qwen-Image 3.0': rows reading Released: 21 Jul 2026, GA 5 Aug; Licence: not published; Access: closed hosted API; Reference images: 1 to 3; Transparency: none claimed; Published price: ~$0.04 Pro, $0.03 Std. Footer reads 'Qwen-Image 2.1 specs per vendor model card, unaudited; Qwen-Image 3.0 pricing is vendor list, unaudited.'

가격, 그리고 가격이 담아내지 못하는 것

Qwen-Image 3.0은 둘 중 유일하게 공개된 가격을 갖고 있습니다. 벤더의 클라우드에서 Pro는 이미지당 약 $0.04, Standard는 약 $0.03으로 책정되어 있으며, 중국 내 소비자 가격은 ¥0.18 부근에서 시작합니다. 이는 출시 당시 수치이며 독립적으로 검증된 적이 없습니다. Qwen-Image 2.1은 공개된 호스팅 요금이 전혀 없습니다. 이는 다운로드 방식이며, 비용은 자신의 GPU 시간에 드는 비용에 따라 달라집니다.

그 두 라인은 비교 대상이 아니며, 그렇지 않은 척하는 것이 이 비교에서 가장 흔한 오류다. 이미지당 가격에는 모델, 서빙 인프라, 스케일링, 그리고 다른 누군가의 업타임이 포함된다. 가중치 다운로드에는 그중 어느 것도 포함되지 않는다. 올바른 질문은 어느 숫자가 더 작은가가 아니라, 33GB 모델 스택을 돌릴 운영 역량이 있는가, 그리고 더 저렴한 쪽의 라이선스가 그것으로 하려는 계획을 허용하는가이다.

그러면 라이선스가 비교의 중심으로, 마땅히 있어야 할 자리로 돌아옵니다. Qwen-Image 3.0의 약관은 공개되지 않았는데, 이는 규제 대상이나 에이전시 작업에서 그 자체로 문제가 됩니다 — 인용할 문서가 없으니까요. Qwen-Image 2.1의 약관 공개되어 있으며, 비상업적이라고 명시합니다. 불분명한 라이선스와 명확히 제한적인 라이선스 사이에서라면, 명확히 제한적인 쪽이 계획을 세우기가 더 쉽습니다. 최소한 어떤 대화를 해야 하는지는 알 수 있으니까요.

A screenshot of the Qwen vendor blog page for Qwen-Image 3.0, captured September 20 2026, showing the launch announcement, the Pro and Standard edition descriptions, the claimed prompt-length and text-rendering figures, and the per-image list pricing.

어느 것을 선택해야 할까요?

텍스트가 많이 들어간 프로덕션 이미지가 필요하고 그 운영을 다른 사람에게 맡기고 싶다면 — Qwen-Image 3.0이 적합합니다. 다만 대표적인 텍스트 렌더링 수치는 벤더의 주장이며, 존재하는 독립 테스트에 따르면 작은 글꼴 텍스트가 일부 경우 여전히 깨진다고 합니다.

모델을 직접 실행하거나, 파인튜닝하거나, 데이터를 자체 하드웨어에 보관해야 한다면 — 둘 중 유일한 선택지는 Qwen-Image 2.1이며, 연구 라이선스가 입장료입니다.

투명 에셋이나 제품 누끼, 또는 3장을 초과하는 참조 이미지가 필요하다면 — 공개된 사양 기준으로 Qwen-Image 2.1이 더 강력한 도구이며, 참조 이미지 수에서는 격차가 상당합니다.

상업적 권리와 허용적 라이선싱이 필요합니다 — 이 둘 중 어느 것도 해당 모델에는 해당하지 않습니다. Qwen-Image 3.0은 공개된 약관이 전혀 없으며, Qwen-Image 2.1은 협상을 거친 상업용 라이선스가 필요합니다. 이 제품군에서 Apache-2.0으로 공개된 것은 이전의 Qwen-Image 1.0과 2.0입니다.

마지막 행은 곱씹어 볼 가치가 있습니다. 왜냐하면 그것은 줄어들고 있는 집합을 설명하기 때문입니다. 이미 부여된 라이선스는 소급해서 바뀌지 않으므로, Apache-2.0 Qwen-Image 릴리스들은 원래 조건대로 계속 사용할 수 있습니다. 하지만 최신 Qwen-Image가 허용적 라이선스로 제공될 것이라고 가정하고 상업적 이미지 파이프라인을 계획하고 있다면, 지난 세 번의 릴리스는 그 가정에 반하는 증거입니다.

파이프라인을 그것에 걸지 않고 둘 중 하나를 실행하기

이 두 모델 모두 오늘날 서로 다른 이유로 프로덕션 경로 뒤에 두기가 까다롭습니다. 하나는 라이선스 때문이고, 다른 하나는 블랙박스와 공개되지 않은 파라미터 수 때문입니다. 바로 이런 상황을 위해 라우팅 레이어가 만들어진 것입니다. OrcaRouter는 200개 이상의 모델을 하나의 OpenAI 호환 엔드포인트 뒤에 배치하며, 제공업체 정가 그대로 마크업 없이 이용할 수 있고, 제공업체 간 자동 장애 조치와 여러 모델을 단일 호출로 조합할 수 있는 라우팅 DSL을 제공합니다, 그래서 새롭거나 까다로운 모델이 검증된 모델 앞이 아니라 그 옆에 자리할 수 있습니다. 모델 퓨전은 같은 아이디어를 한 단계 더 발전시켜, 여러 모델을 패널로 함께 실행하고 출시 차트가 아니라 자신의 프롬프트로 비교할 수 있게 해줍니다.

Qwen-Image 2.1도 Qwen-Image 3.0도 오늘 우리가 라우팅하는 모델에 포함되어 있지 않으며, 이 글에서 그렇다고 암시하지도 않습니다. 우리가 실제로 라우팅하는 이미지 모델 — OpenAIGPT-Image 라인, Google의 Imagen 4 티어와 Gemini 이미지 프리뷰, 그리고 xAI의 Grok Imagine 이미지 엔드포인트 — 는 여러분이 Qwen 두 모델을 자체 기준으로 평가하는 동안 페일오버 경로를 실제로 구축하게 될 기반입니다.

주목할 것은 생각보다 범위가 좁다. 알리바바는 이제 같은 분기 안에 같은 제품군에서 공개 가중치, 비공개 호스팅 모델, 연구용 라이선스 다운로드를 모두 출시할 것임을 입증했다. 다음 릴리스는 어느 패턴이 승리했는지 알려주지 않을 것이다. 라이선스 파일이 알려줄 것이다.

A screenshot of the Qwen vendor blog page for Qwen-Image 2.1, captured September 20 2026, showing the 2026/09/20 date, the headline 'Compact, Efficient, and Unified Image Creation', the 'Now open weights' hero banner, GitHub, Hugging Face and ModelScope buttons, and the 7B parameter figure.