
Vidu Q4 Preview vs Google Veo 3.1: Veo sprzedaje trzy poziomy, a różnica między nimi jest mniejsza niż luka w górę
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Google's Veo 3.1 comes in three tiers. On the Artificial Analysis image-to-video board they score 1,082, 1,071 and 1,066 — sixteen Elo across the range — while their per-minute prices span five times, from $4.80 to $24.00. Vidu Q4 Preview is one model, not three, scores 1,179 on the same board, and lists at $7.20 per minute. Read those numbers in order and the practical question stops being "which Veo tier" and becomes "why buy any of them" — which is not the comparison most pages write, and it deserves the specific answer below rather than a shrug.
Vidu Q4 Preview został wydany 7 października 2026 roku przez Shengshu Technology jako pierwszy publiczny podgląd swojego flagowego modelu nowej generacji, przed pełną premierą Q4, w dwóch trybach: Image-to-Video i Reference-to-Video. Veo 3.1 znajduje się w rankingach od stycznia 2026 roku, a w marcu dodano poziom Lite; przyjmuje zarówno polecenia tekstowe, jak i obrazy. Różne kształty, różne roczniki i jeden ranking, w którym można je ze sobą porównać.

Drabinka poziomów Veo, odczytana prosto z tablicy
Wszystkie poniższe dane pochodzą z Artificial Analysis, odczyt z 8 października 2026 r., z uwzględnieniem dźwięku. Każda tabela ma własną skalę Elo i własną pulę głosów, więc oba bloki nie są porównywalne ze sobą nawzajem — jedynie w obrębie każdego z nich.
Obraz do wideo (AA-Video-I2V v1.0):
• Vidu Q4 Preview — 3., 1 179 ±10, 5 543 próbki, paź 2026, $7,20/min
• Veo 3.1 — 12th, 1,082 ±7, 7,040 samples, Jan 2026, $24.00/min
• Veo 3.1 Lite — 15. miejsce, 1 071 ±8, 5 122 próbki, mar 2026, 4,80 USD/min
• Veo 3.1 Fast — 18., 1 066 ±6, 14 688 próbek, sty 2026, 9,00 USD/min
Generowanie wideo z tekstu (AA-Video-T2V v2.0):
• Veo 3.1 — 19–21, 962 ±10, 2998 próbek, sty 2026, 24,00 USD/min
• Veo 3.1 Fast — 20. miejsce, 961 ±10, 4 325 próbek, styczeń 2026, 7,20 USD/min
• Veo 3.1 — 22–25, 948 ±10, 2 000 próbek, marzec 2026, 4 USD/min
• Vidu Q4 Preview — nieobecny na tej tablicy
Te dwa bloki opowiadają tę samą historię z różnych perspektyw. W przypadku obrazu do wideo trzy poziomy Veo mieszczą się w szesnastopunktowym przedziale, podczas gdy cena różni się pięciokrotnie — więc płacenie pięć razy więcej za Veo 3.1 zamiast Veo 3.1 Lite daje jedenaście punktów Elo, mieszcząc się z dużym zapasem w przedziałach ±7 i ±8, które mają te dwa wyniki. W przypadku tekstu do wideo rozrzut wynosi czternaście punktów w tym samym pięciokrotnym zakresie cen, a tam uszeregowanie jest łaskawe dla taniej wersji: Veo 3.1 Fast jest o jeden punkt Elo za flagowcem za jedną trzecią ceny, mając za sobą więcej głosów.
Google's own tiering is therefore mostly a latency and resolution decision rather than a quality ladder, which is a reasonable thing for a vendor to sell. It is just not the thing most "which Veo" articles claim it is.

Porównanie, które się broni
Vidu Q4 Preview jest o 97 Elo wyżej niż najlepszy poziom Veo 3.1 w rankingu image-to-video, przy koszcie o 16,80 USD za minutę niższym, oraz o 113 Elo wyżej niż Veo 3.1 Fast. Te przewagi są pięć do siedmiu razy większe niż szerokość przedziałów, których dotyczą, więc nie są szumem.
The obvious objection is that this compares an October 2026 model against a January 2026 one, and it does — that is the entire finding. Veo 3.1 is eight months old on this board, its tiers were last meaningfully reshuffled when Lite arrived in March, and it has been overtaken by a preview build from a smaller lab at a lower price. The board's own notice says two models were added in the last 30 days, and Vidu Q4 Preview is one of them.
Równie oczywista przeciwwaga: Vidu Q4 Preview nie ma w ogóle trybu text-to-video, a właśnie tam mieszczą się dwa z trzech poziomów Veo. Jeśli Twoje obciążenie pracą zaczyna się od tekstowego promptu, a nie od klatki, żadne z tych porównań nie ma zastosowania i to drabina Veo jest jedyną z tych dwóch, która daje odpowiedź.

Co Veo daje ci, czego Vidu nie daje
Jest jeden wymiar, w którym luka ma charakter strukturalny, a nie liczbowy, i nie ma nic wspólnego z Elo.
Google's Veo 3.1 output is watermarked with SynthID on every frame and carries C2PA content credentials recording that it was AI-generated, with a detector available in the Gemini app. That is not a feature you switch on; it is what the model produces. For anyone shipping into a market with disclosure requirements, working with a platform that screens for synthetic media, or simply wanting an audit trail of which shots were generated, this is a procurement difference that no benchmark will show you. It is also, on some workflows, a reason not to use it — a watermark you cannot disable is a constraint if your deliverable needs to pass as unmarked footage.
Vidu Q4 Preview nie publikuje żadnego mechanizmu znakowania wodnego ani poświadczania pochodzenia o porównywalnej szczegółowości. To brak twierdzenia, a nie twierdzenie o braku, i tak należy to odnotować.
Dwie mniejsze asymetrie warte utrzymania:
• Domyślne audio — punkt końcowy image-to-video Vidu Q4 Preview ma audio parametr domyślnie ustawiony na wartość prawda, więc otrzymujesz dźwięk razem z obrazem, chyba że go wyłączysz; Veo 3.1 wycenia audio jako własną decyzję o poziomie, z około 0,40 USD/s w Standardzie włącznie z nim, w porównaniu do znacznie mniej za cichy wynik
• Budżet referencji — Vidu Q4 Preview przyjmuje do 15 obrazów referencyjnych i do 3 referencyjnych klipów audio w Reference-to-Video; obsługa referencji w Veo 3.1 nie jest udokumentowana na takim poziomie szczegółowości
Gdzie to pozostawia wybór
If you are generating from a still — a product frame, a character reference, a storyboard panel — the independent board puts Vidu Q4 Preview in a different tier from every Veo 3.1 variant at a fraction of the top tier's price, and the tier ladder inside Veo does not rescue it. That is the finding, and it is grounded in 5,543 votes against 7,040, 5,122 and 14,688 respectively. The vote counts are real; the rank will move as intervals narrow.
If you need provenance built in, text-to-video, or a vendor with Google's distribution and enterprise terms, Veo 3.1 is the answer for reasons the Elo table cannot express and should not be read as overriding.
Jeśli potrzebujesz obu, arytmetyka jest następująca: jedna integracja zamiast dwóch. OrcaRouter udostępnia jeden endpoint zgodny z OpenAI obejmujący ponad 200 modeli z przekazywanymi cennikami listowymi dostawców i bez doliczania marży, więc zmiana stawki u któregokolwiek z dostawców pojawia się na Twojej fakturze tego samego dnia, a nie dopiero przy odnowieniu, a automatyczne przełączanie awaryjne między dostawcami sprawia, że niedostępność jednej trasy nie pociąga za sobą żądania. Ani Vidu Q4 Preview, ani Veo 3.1 nie są dziś trasą w OrcaRouter — modele wideo, które obsługujemy, w tym MiniMax H3, można wywoływać na tym samym endpoincie — więc uczciwie rzecz ujmując, możemy utrzymać warstwę orkiestracji w stabilnym stanie, podczas gdy Ty decydujesz, która ścieżka renderowania zwycięży, a nie że hostujemy którykolwiek z tych dwóch.
Pytanie, które naprawdę się liczy
Veo 3.1 nie jest złym modelem. To model ze stycznia 2026 r., wyceniony jak flagowiec, podczas gdy trzy z jego własnych poziomów zbiegają się na tym samym wyniku, a teraz został porównany z zapowiedzią z października 2026 r., która bije jego najlepszy wariant przewagą większą niż cały wewnętrzny rozrzut Veo.
Co zmieniłoby obraz sytuacji: ogłoszono, że AA-Video-I2V v2.0 nadchodzi, zgodny z taksonomią T2V v2.0 i obejmujący 1080p w całym zakresie. Ponowne uruchomienie na nowej tablicy z nowymi pulami głosów może przetasować każde z tych miejsc, w górę lub w dół, a oba modele należy ponownie odczytać na tej tablicy, zamiast ufać liczbom na tej stronie.
Wąska odpowiedź dla czytelnika, który chce tylko jednej: na jedynym rankingu, na którym pojawiają się oba, pojedyncza wersja Vidu Q4 Preview plasuje się wyżej niż wszystkie trzy warianty Veo 3.1, i robi to przy cenie 7,20 USD za minutę w porównaniu z 24,00 USD w przypadku Veo 3.1 Standard i 9,00 USD w przypadku Veo 3.1 Fast — choć nie w porównaniu z Veo 3.1 Lite, który jest jedynym wariantem Veo mającym niższą cenę, wynoszącą 4,80 USD za minutę, i znajduje się osiemnaście miejsc niżej w tym samym rankingu. Sama drabinka wariantów Veo nie jest drabinką jakości i to jest ta część tego porównania, którą warto zapamiętać. Szeroka odpowiedź brzmi: są przeznaczone do różnych zadań, a o produkcie końcowym decyduje to, czy twoje dane wejściowe to fotografia, czy zdanie.
