Główna karta tytułowa dla „Tavus Griffin vs Runway Gen-4.5” z podtytułem „Rozmowa i renderowanie to dwa różne rachunki”, nad czterema chipami: Gen-4.5 0,12 USD za sekundę materiału; Gen-4.5 klipy 2–10 s, bez dźwięku; Griffin pełny dupleks, z możliwością przerwania; Griffin brak opublikowanej ceny.
Guides & Insights

Tavus Griffin vs Runway Gen-4.5: Konwersacja i renderowanie to dwa różne rachunki

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Postaw Tavus Griffin i Runway Gen-4.5 obok siebie, a pierwszą rzeczą, jaką zauważysz, jest to, że nie mają wspólnej jednostki miary. Griffin, ogłoszony przez Tavus w październiku 2026 r. jako podgląd badawczy, jest Human Interaction Model — systemem wideo-do-wideo, który prowadzi rozmowę na żywo twarzą w twarz i generuje twarz oraz głos drugiego uczestnika w trakcie trwania połączenia. Runway Gen-4.5, ogłoszony 1 grudnia 2025 r. i udostępniony płacącym subskrybentom od 12 grudnia, to generator tekstu na wideo i obrazu na wideo, który pobiera opłatę za każdą sekundę renderowanego materiału. Jeden z nich jest sprzedawany na turę, a drugi na sekundę, a jedynym uczciwym sposobem ich porównania jest zauważenie, że minuta Griffina i minuta Gen-4.5 to nie ta sama minuta.

Dwa zegary chodzące w przeciwnych kierunkach

Gen-4.5 znajduje się w rękach płacących klientów od blisko roku. Tworzy klipy od dwóch do dziesięciu sekund na podstawie promptu tekstowego lub nieruchomego obrazu, w 720p i przy 24 lub 25 klatkach na sekundę, w sześciu proporcjach obrazu. Nie ma ścieżki audio, storyboardów wieloujęciowych ani dialogów — to silnik renderujący, i to zdyscyplinowany. Jego API jest asynchroniczne, co jest właściwą formą dla zadania, które trwa dłużej, niż powinno trwać żądanie. Własne API Runway obsługuje również modele wideo innych firm obok własnych, a firma udostępnia model świata, GWM-1, który pokazuje, gdzie zdaniem Runway leży interesujący problem: nie w prowadzeniu rozmowy, lecz w modelowaniu sceny.

Griffin wskazuje w przeciwnym kierunku. Każda decyzja projektowa w opublikowanej architekturze Tavus dotyczy opóźnienia, a nie wierności. Kodek Tavec działa z częstotliwością 48 kHz, z 40 wartościami na ramkę przy 100 klatkach na sekundę, bez ksiąg kodowych, z w pełni przyczynowym dekoderem i pakietami już od 10 milisekund. Ścieżka wideo emituje 720p w 320-milisekundowych fragmentach, gdzie jeden latent obejmuje osiem klatek przy 25 fps, a każdy latent wymaga trzech kroków dyfuzji. Opóźnienie audio-wideo wynosi średnio 0,43 sekundy na H100, co według Tavus jest mniej więcej połową czasu następnej najszybszej zmierzonej metody. Nic w tym stosie nie próbuje renderować dziesięciu pięknych sekund. Wszystko w nim próbuje renderować kolejne 320 milisekund na czas.

Zatem porównanie specyfikacji jest realne, ale to nie jest tablica wyników:

• Jednostka rozliczeniowa — Runway Gen-4.5 jest rozliczany według sekund materiału wyjściowego; znasz swój koszt, zanim naciśniesz generowanie. Griffin nie ma żadnej opublikowanej ceny, ponieważ nie ma publicznego produktu.

• Długość klipu — Gen-4.5 generuje od dwóch do dziesięciu sekund; Griffin działa tak długo, jak trwa połączenie.

• Rozdzielczość i liczba klatek na sekundę — Gen-4.5 renderuje 720p przy 24 lub 25 fps; Griffin przesyła strumieniowo 720p przy 25 fps w 320-milisekundowych fragmentach.

• Audio — Gen-4.5 nie generuje ścieżki audio; Griffin generuje mowę i wideo jednocześnie i klonuje głos na podstawie około 10-sekundowej próbki.

• Interaktywność — Gen-4.5 to jednokierunkowe żądanie asynchroniczne; Griffin działa w trybie pełnego dupleksu i można mu przerwać w trakcie wypowiedzi.

• Dodatki do ruchu i korekcji kolorów — Gen-4.5 oferuje eksport ProRes i PNG za dopłatą 5 kredytów na sekundę oraz HDR za 20 kredytów na sekundę, rosnąco do 40 powyżej około czterech megapikseli; Griffin nie ma odpowiednika, ponieważ nie eksportuje plików.

• Dostępność — Gen-4.5 jest dostępny dla płacących subskrybentów od 12 grudnia 2025 r.; Griffin znajduje się w fazie podglądu badawczego dla wybranych testerów, a Tavus podaje, że nie jest dostępny do użytku przez klientów.

Board titled 'Two Clocks, Two Bills' with six labelled rows comparing Runway Gen-4.5 (left) against Tavus Griffin (right): billing unit 'Runway Gen-4.5 - 12 credits per second of video' versus 'Tavus Griffin - no price, no product'; clip length 2 to 10 seconds versus as long as the call runs; resolution 720p at 24 or 25 fps versus 720p at 25 fps in 320 ms chunks; audio no audio track versus speech and face generated together; interactivity one asynchronous request versus full duplex, interruptible; availability live for subscribers since 12 December 2025 versus research preview, not sellable.

Ustawa Gen-4.5 w prostych liczbach

Runway wycenia Gen-4.5 na 12 kredytów za sekundę generowanego wideo. Przy standardowym przeliczniku jednego centa za kredyt daje to 0,12 USD za sekundę, czyli około 7,20 USD za pełną minutę materiału, gdyby można było wygenerować ją w sposób ciągły — co nie jest możliwe, ponieważ model ma limit dziesięciu sekund, więc minuta oznacza sześć lub więcej osobnych generowań zszytych w całość z wszelkimi wynikającymi z tego błędami ciągłości. Wyjście w formatach ProRes i PNG dodaje 5 kredytów za sekundę, a HDR dodaje 20 kredytów za sekundę, rosnąc do 40 powyżej około czterech megapikseli. Kredyty API są rozliczane oddzielnie od kredytów z subskrypcji aplikacji, co jest szczegółem, który potrafi zaskoczyć zespoły, gdy prototypują w aplikacji internetowej, a następnie przechodzą na API.

Board titled 'What One Minute Costs'. Left card, a minute of Runway Gen-4.5: rate 12 credits per second, about $0.12; hard limit 10 seconds per generation; so a minute means six or more separate generations; list price if it could run straight through about $7.20; extras ProRes or PNG +5 credits per second; HDR +20 credits per second, up to +40 above 4 MP. Right card, a minute of Tavus Griffin: rate none published; product research preview for selected testers; so a minute means not obtainable at any price; published evidence 0.43 s average audio to video on H100s; vendor statement not available for customer use at this time; availability no API, no price, no date.

To, gdzie uzyskuje się dostęp do Gen-4.5, również ma znaczenie. Jest dostępny przez własne API Runway oraz przez kilka platform zewnętrznych. Nie jest to trasa OrcaRouter — nie hostujemy go i nie będziemy sugerować, że można go tu uzyskać.

Ile kosztuje Griffin — i dlaczego to niewłaściwe pytanie

Tavus Griffin nie ma jeszcze ceny. Materiały Tavus dotyczące premiery stwierdzają, że Griffin-Lite, podgląd badawczy, jest już dziś dostępny dla wybranej grupy wczesnych testerów, że nastąpi szersze udostępnienie mocniejszego modelu, że Griffin-Lite nie będzie obecnie dostępny do użytku klientów oraz że Griffin nie znajduje się jeszcze na platformie Tavus — pojawi się, gdy firma opracuje sposób bezpiecznego udostępnienia go.

Ten akapit robi kawał roboty. Oznacza to, że porównanie w tym artykule nie jest decyzją zakupową i nie może się nią stać, dopóki Tavus nie poda stawki. Oznacza to również, że Tavus jest nietypowo bezpośredni w kwestii wyniku, który większość dostawców wypuściłaby jako stronę produktu z przyciskiem „skontaktuj się z działem sprzedaży”.

To, co Griffin faktycznie publikuje, to dowody dotyczące zachowania. W badaniu przeprowadzonym wspólnie z Queen Mary University of London 26 z 54 uczestników — 48% — uznało po jednominutowej rozmowie wideo, że Griffin jest prawdziwą osobą, w porównaniu z 1 z 41 (2,4%) dla poprzedniego zestawu firmy Tavus: Phoenix-4.5, Sparrow-2 i Raven-1. W benchmarku VideoFDB firmy NVIDIA, ocenianym we wrześniu 2026 r., Tavus raportuje pierwsze miejsce w kategorii AI do rozmów twarzą w twarz: generowanie 3,83 wobec 2,80 najsilniejszego raportowanego wyniku bazowego i 3,92 dla ludzkiego odniesienia, percepcja 3,73 wobec 3,44 dla najlepszego raportowanego wyniku bazowego i 4,20 dla człowieka, przy 73,8% wskaźniku realizacji celów zadania po stronie percepcji wśród piętnastu ocenianych modeli. To liczby raportowane przez dostawcę, oparte na benchmarku zbudowanym przez NVIDIA, i dotyczą rozmowy, a nie kinematografii.

Screenshot of the Tavus website's Griffin announcement, captured 2 October 2026: the headline 'The First Human Interaction Model' under 'Introducing Griffin', a paragraph describing a video-to-video system that listens while the other person talks, and three statistic tiles reading 48% of people believed Griffin was a real person after a one-minute video call, #1 on NVIDIA's independent test of face-to-face AI, and 37% ahead of the next best AI at reacting in the moment, dated October 1st, 2026.

Różne zadania, przedstawione wprost

Jeśli chcesz ujęcie miasta o zmierzchu z ruchem kamery dopasowanym do klatki referencyjnej, Gen-4.5 to istniejące narzędzie, które potrafi to zrobić już dziś za około dwanaście centów za sekundę. Nie ma scenariusza, w którym Griffin ci pomoże, ponieważ Griffin nie przyjmuje promptu i nie zwraca pliku.

Jeśli chcesz twarz, która słucha, której można przerwać i która utrzymuje spójną rozmowę przez kilka minut, Gen-4.5 nie pomoże, ponieważ nie przyjmuje danych wejściowych po wysłaniu żądania. Dziesięciosekundowy klip z mówiącą głową to nie rozmowa; to wideo rozmowy, a Tavus sprzedaje dokładnie tę różnicę.

Pokrywanie się jest węższe, niż sugeruje etykieta „AI video”: oba wyświetlają piksele przedstawiające osobę i oba działają w 720p i 25 fps. Wszystko powyżej tego jest inne, w tym jednostka na fakturze.

Dlaczego router jest przydatny dokładnie w tym miejscu

Zespoły, które ostatecznie potrzebują obu tych rzeczy, zwykle odkrywają to na własnej skórze — produkt chce wygenerowanego ujęcia wprowadzającego a mówiącego awatara, a te dwa elementy przychodzą od różnych dostawców, z różnym uwierzytelnianiem, różnymi systemami rozliczeń i różnymi trybami awarii. To właśnie ten przypadek, w którym pojedynczy endpoint się opłaca. OrcaRouter udostępnia ponad dwieście modeli za jednym kluczem, przekazuje ceny katalogowe dostawców przy 0% marży, więc zmiana ceny dostawcy jest widoczna na karcie tego samego dnia, a ponawia próby u zdrowego dostawcy, gdy jedna trasa zawiedzie, zamiast zwracać ci przekroczenie limitu czasu. DSL routingu pozwala wysyłać szkice o niskim ryzyku tam, gdzie moc obliczeniowa jest najtańsza, i przypinać wszystko, co trafia do klienta, do konkretnego dostawcy, a fuzja modeli pozwala postawić tani model tekstowy przed drogim wywołaniem generowania, by przepisać prompt, zanim zdążysz stracić te sekundy.

Aby było dokładnie jasne, co to obejmuje, a czego nie obejmuje w tym zestawieniu: Gen-4.5 nie jest jedną z naszych tras, podobnie jak Griffin. Część wideo katalogu obejmuje minimax/minimax-h3, omnimodalny generator MiniMax, w cenie $0.08 za sekundę wyniku w 768P i $0.13 za sekundę w 2K — cena za sekundę na tej samej osi co u Runway, od modelu, który faktycznie możemy Ci dziś udostępnić. To uczciwa rekomendacja, jeśli potrzebujesz wygenerowanych sekund i chcesz mieć je na jednym rachunku razem ze wszystkim innym.

Które uwzględnić przy planowaniu?

Gen-4.5 to znacznie bezpieczniejsza zależność: jest w rękach płacących klientów od grudnia 2025 r., jego API jest udokumentowane, jego kredyty mają ustaloną cenę, a jego ograniczenia — dziesięć sekund, brak dźwięku, brak storyboardów — są publikowane, a nie odkrywane. Zespół, który potrzebuje wygenerowanego materiału filmowego, może zacząć w tym tygodniu.

Griffin to zakład o wyższym suficie i niższej podłodze. Jego 48% i średnie opóźnienie 0,43 sekundy opisują coś naprawdę nowego, a fakt, że Tavus na razie odmawia jego sprzedaży, jest sygnałem o dojrzałości tego czegoś, a nie decyzją marketingową. Nie umieszczaj go w roadmapie jako zależności; wpisz go na listę obserwacyjną i sprawdź ponownie, gdy zniknie nota bezpieczeństwa.