Vidu Q4 Preview vs Alibaba Wan 2.7을 위한 생성된 타이틀 카드로, 부제는 '두 가지 모드 대 네 가지 변형, 그리고 그들이 공유하는 단 하나의 보드'이며, 칩에는 'Vidu Q4 Preview — #3, Elo 1,179', 'Alibaba Wan 2.7 — #13, Elo 1,077', '이미지-투-비디오 격차: 102 Elo'라고 적혀 있습니다. OrcaRouter 로고는 오른쪽 아래 여백이 있는 스트립에 자리합니다.
Guides & Insights

Vidu Q4 Preview vs Alibaba Wan 2.7: 2가지 모드 대 4가지, 그리고 승부가 갈리는 한 판

작성자

Elias Hawthorne

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

전체 비교를 한 줄로 정리하면 이렇습니다: Vidu Q4 Preview는 Alibaba Wan 2.7을 Artificial Analysis 이미지-투-비디오 보드에서 102 Elo 차이로 앞서며, 텍스트-투-비디오나 비디오 편집 부문에서는 이와 나란히 평가에 올릴 수도 없습니다. Vidu Q4 Preview는 그 둘 다 지원하지 않기 때문입니다.

두 모델 모두 2026년에 출시되었으며 둘 다 소리와 함께 영상을 생성합니다. Vidu Q4 Preview는 Shengshu Technology에서 2026년 10월 7일, 전체 Q4 모델에 앞선 첫 공개 프리뷰로 등장했으며, Image-to-Video와 Reference-to-Video의 두 가지 모드로 제공됩니다. Alibaba Wan 2.7은 2026년 4월에 네 가지 변형 제품군으로 출시되었습니다: text-to-video, image-to-video, reference-to-video, video edit이며, 생성된 영상 1초당 과금됩니다. 따라서 대부분의 일대일 비교 페이지에서 승부를 가르는 요소인 점수는 한 축에만 존재하며, 이 둘을 정직하게 판단하는 방법은 실제로 어떤 축이 필요한지부터 묻는 것입니다.

점수판, 빈틈이 보이게 남겨진

Artificial Analysis는 세 개의 별도 비디오 리더보드를 운영합니다. 각 리더보드는 자체 Elo 척도와 자체 투표 풀을 사용하므로, 한 리더보드의 점수가 다른 리더보드로 이전되지 않습니다. 2026년 10월 8일 기준으로 읽었으며, 이번에도 오디오를 켜 둔 상태입니다:

• 이미지-투-비디오(AA-Video-I2V v1.0) — Vidu Q4 Preview 3위, 1,179 ±10, 5,543개 샘플, 2026년

• 텍스트-투-비디오 (AA-Video-T2V v2.0) — Vidu Q4 Preview 없음; Wan2.7-260612 13~14위, 1,030 ±9, 5,571개 샘플, 2026년 6월, 분당 $9.00

• 비디오 편집 (AA-Video-Editing v1.1) — Vidu Q4 Preview 없음; Wan 2.7 7위, 1,074, 20,021개 샘플, 2026년 4월, 분당 $16.90

그 표에서 두 가지 사실이 따라 나온다. Wan 2.7은 둘 중 훨씬 더 다재다능한 쪽이다 — 세 리더보드 모두에서 점수를 받은 유일한 모델이고, 그 편집 항목은 어디에서든 Wan 2.7이 받은 점수 가운데 가장 많은 투표 수를 안고 있는데, 표본이 2만 개에 달한다. 그리고 두 모델이 맞붙는 단 하나의 축에서는 Vidu Q4 Preview가 102 Elo 차이로 앞서는데, 이는 두 모델 각각의 신뢰구간 폭의 약 다섯 배에 해당한다.

102점 차이는 작은 결과가 아닙니다. 규모를 가늠해 보면: 이미지-투-비디오 보드의 상위 6개 순위 전체의 격차는 21 Elo입니다. Vidu Q4 Preview는 이미지-투-비디오에서 Wan 2.7보다 약간 앞선 것이 아닙니다; 그것은 다른 티어이며, 분당 $1.80 더 저렴하면서도 더 최근에 출시되었습니다. 이미지-투-비디오가 당신의 작업이라면, 결정은 접전이 아니며, 독립적인 보드가 그것이 접전이 아닌 이유입니다.

A generated two-column scoreboard for Vidu Q4 Preview and Alibaba Wan 2.7. Left column rows read 'I2V rank: #3, Elo 1,179', 'Modes: image, reference', 'Max clip: 16 seconds', 'Max resolution: 4K', 'Text-to-video: none' and 'Measured rate: $7.20 per minute'; right column rows read 'I2V rank: #13, Elo 1,077', 'Modes: four variants', 'Max clip: 15 seconds', 'Max resolution: 1080p', 'Text-to-video: yes' and 'Measured rate: $9.00 per minute'. A footer reads 'Ranks, Elo and rates per Artificial Analysis, 8 October 2026; modes, clip length and resolution are vendor-stated.' The OrcaRouter logo sits in the bottom-right padded strip.

Wan 2.7이 둘 중 유일하게 나타나는 경우

Wan 2.7의 자체 문서에서는 오디오 품질과 화면 텍스트의 정확도, 이 두 영역이 아직 개선이 필요하다고 밝힙니다. 이는 리뷰어가 아니라 벤더가 내린 평가이며, 두 모델 모두 동일한 핵심 주장을 내세우기 때문에 어떤 비교에서든 염두에 둘 가치가 있습니다 — 사후에 덧붙인 것이 아니라 영상과 함께 생성되는 네이티브 오디오라는 주장입니다.

차이는 기본 동작에서 갈립니다. Vidu Q4 Preview의 이미지-투-비디오 엔드포인트에는 audio 파라미터가 있고 기본값은 true입니다: 끄지 않으면 소리가 나오고, 끄는 것이 바로 무음 클립을 얻는 방법입니다. Wan 2.7은 같은 스위치를 같은 자리에 문서화하지 않습니다. 무음 출력이 파이프라인에 중요하다면 — 별도로 음악을 입히거나 다른 언어로 더빙할 계획이 있는 모든 작업에 그렇듯이 — 그 비대칭은 첫 통합 작업의 모습을 바꿉니다.

편집 보드에서 Wan 2.7의 20,021개 샘플 중 1,074점 7위는, 두 모델이 어느 보드에서든 기록한 결과 중 득표수 기준으로 가장 강력한 단일 성적입니다. 2만 표는 실질적인 무게가 실린 측정값이며, 그 보드에는 비교할 Vidu 모델이 나타나지 않습니다. 새 장면을 생성하기보다 기존 푸티지의 타이밍을 조정하거나 스타일을 바꾸는 작업이라면, 둘 중 적용되는 것은 Wan 2.7뿐입니다.

Alibaba Wan 2.7's Video Editing board entry, the single strongest result either model holds by vote count.

생성 측에서의 사양 격차

두 가지가 겹치는 부분에서는 거의 모든 측면에서 서로 다르며, 그 차이가 Wan에게 유리한 쪽으로 대칭적이지는 않다.

• 최대 해상도 — Vidu Q4 Preview 4K(2K 및 4K, 10비트 컬러) 대 Wan 2.7 최대 1080p

• 최대 클립 길이 — Vidu Q4 Preview 16초 (이미지→비디오 3-16초, 레퍼런스→비디오 1-16초) vs Wan 2.7 최대 15초

• 참조 이미지 — Vidu Q4 Preview는 한 번의 설정으로 최대 15개 vs Wan 2.7은 최대 10개 자산

• 참조 오디오 — 음성 일관성을 위한 최대 3개 클립을 지원하는 Vidu Q4 Preview vs Alibaba가 동일한 수준의 세부 정보로 공개하지 않음

작업 범위: Vidu Q4 Preview의 두 가지 모드(이미지-투-비디오, 레퍼런스-투-비디오) vs Wan 2.2 변형(텍스트-투-비디오 및 비디오 편집 추가)

• 공개 목록 요금 — Vidu Q4 Preview는 프로모션 기준 초당 $0.014부터; 독립 보드에서 측정된 분당 $7.20, 반면 Wan 2.7은 변형에 따라 초당 $0.10-$0.15, 측정 기준 분당 $9.00

해상도 항목은 신중하게 따져봐야 할 부분입니다. 10비트에서의 4K 출력은 화면이나 대형 디스플레이용으로 마무리하는 사람이라면 누구에게나 실질적인 결과물 차이이며, Wan 2.7이 어떤 변형에서도 제공하지 않는 기능입니다. 하지만 4K는 초당 가격이 흔히 광고되는 최저가처럼 보이지 않게 되는 지점이기도 하며, Vidu 자체의 출시 자료에도 최종 가격, 지원 해상도, 기능 제공 여부 및 사용 약관은 요금제와 지역에 따라 달라진다는 단서가 붙어 있습니다.

Vidu Q4 Preview's product page open on Reference-to-Video, showing the reference-image and audio upload surface.

워크로드 기준으로 어느 것?

정지 이미지 — 제품 사진, 캐릭터 레퍼런스 프레임, 스토리보드 — 를 애니메이션으로 만들고 있다면, 이용 가능한 유일한 독립적 증거에서 Vidu Q4 Preview가 더 나은 모델이며, 측정된 더 낮은 요율로 제공됩니다. 그것이 명백한 사례입니다.

텍스트-투-비디오, 이미지-투-비디오, 편집을 모두 아우르는 단일 계약이 필요하다면, Wan 2.7은 둘 중 이 요구에 부응하는 유일한 모델이며, 두 모델을 통틀어 가장 많은 투표 수를 기반으로 한 7위 편집 결과로 그렇게 합니다. 하나의 벤더로 통합하는 것은 실질적인 이점이며, 이 비교는 그렇지 않은 척하지 않습니다.

둘 다 필요하다면, 두 벤더를 운영하는 비용은 대개 라이선스가 아닙니다. 비용은 두 번째 통합, 두 번째 키, 두 번째 재시도 시맨틱, 그리고 최신 상태로 유지해야 하는 두 번째 스키마입니다. OrcaRouter는 이를 하나로 압축합니다: 200개 이상의 모델을 아우르는 하나의 OpenAI 호환 엔드포인트, 공급자 정가가 마크업 없이 그대로 전달되며, 공급자 간 자동 페일오버를 제공합니다. 특히 비디오 쪽에서는 MiniMax H3를 제공하는데, 이는 위의 이미지-투-비디오 순위표에서 현재 1위와 2위에 올라 있는 모델이며, 텍스트 모델과 동일한 엔드포인트와 동일한 키로 호출할 수 있습니다. Vidu Q4 Preview도, Ali​baba Wan 2.7도 현재 OrcaRouter 경로가 아니며, 이 페이지가 그렇다고 암시하는 것으로 읽혀서는 안 됩니다. 우리가 할 수 있는 일은 나머지 워크로드를 하나의 통합 위에 유지하여 비디오 실험이 프로젝트가 아니라 하나의 항목이 되도록 하는 것입니다.

무엇이 이것을 바꿀까요?

Vidu Q4 Preview는 프리뷰 버전입니다. 가격은 프로모션 성격이고, 벤더 자체 설명에 따르면 이 빌드는 정식 Q4 릴리스보다 앞서 있으며, API 문서에는 올바른 모델 별칭과 함께 오타가 난 모델 별칭이 여전히 포함되어 있습니다. 두 가지 결과가 중요합니다. 정식 Q4 릴리스가 텍스트-투-비디오를 추가하면 축이 무너지고 이는 하나 대신 세 개의 보드에서 직접 비교하는 것이 됩니다. 그렇지 않으면 분할은 그대로 유지되고 선택은 전적으로 워크로드 형태에 관한 것입니다.

반면, 이미지-투-비디오 보드에서 Wan 2.7의 샘플은 Vidu의 샘플보다 5개월 더 오래되었고 약 1,000개 더 적습니다. 두 격차 모두 줄어들 것입니다. 어느 모델의 순위도 그 옆에 인쇄된 날짜 이후까지 고정된 것으로 간주해서는 안 됩니다.

좁게 보면 답은 이렇습니다: 두 모델은 정확히 하나의 경쟁 축을 공유하며, Vidu Q4 Preview가 더 낮은 측정 요율로 그 축을 분명히 앞서고, Vidu가 경쟁하지 않는 모든 영역에서는 Wan 2.7이 기본값으로 승리합니다. 넓게 보면 답은 이렇습니다: 2모드 미리보기 모델과 4개 변형 제품군은 서로의 진정한 대안이 아니라 서로 다른 작업을 위한 대안이며, 이 비교에서 유용한 부분은 당신이 어떤 작업을 맡고 있는지 아는 것입니다.