Card del titolo hero per 'Tavus Griffin vs Runway Gen-4.5' con il sottotitolo 'Conversazione e rendering sono due bollette diverse', sopra quattro chip: Gen-4.5 $0,12 al secondo di filmato; Gen-4.5 clip da 2-10 s, senza audio; Griffin full duplex, interrompibile; Griffin non ha un prezzo pubblicato.
Guides & Insights

Tavus Griffin vs Runway Gen-4.5: conversazione e rendering sono due bollette diverse

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Metti Tavus Griffin e Runway Gen-4.5 uno accanto all'altro e la prima cosa che noti è che non condividono un'unità di misura. Griffin, annunciato da Tavus nell'ottobre 2026 come anteprima di ricerca, è un Human Interaction Model — un sistema da video a video che sostiene una conversazione dal vivo faccia a faccia e genera il volto e la voce dell'altro partecipante mentre la chiamata è in corso. Runway Gen-4.5, annunciato il 1° dicembre 2025 e distribuito agli abbonati paganti dal 12 dicembre, è un generatore da testo a video e da immagine a video che ti fa pagare al secondo di filmato che renderizza. Uno dei due viene venduto a turno di conversazione e l'altro al secondo, e l'unico modo onesto di confrontarli è notare che un minuto di Griffin e un minuto di Gen-4.5 non sono lo stesso minuto.

Due orologi che vanno in direzioni opposte

Gen-4.5 è nelle mani dei clienti paganti da quasi un anno. Produce clip da due a dieci secondi a partire da un prompt testuale o da un'immagine fissa, a 720p e 24 o 25 fotogrammi al secondo, su sei rapporti d'aspetto. Non c'è traccia audio, né storyboard multi-inquadratura, né dialogo: è un motore di rendering, e anche disciplinato. La sua API è asincrona, la forma giusta per un lavoro che richiede più tempo di quanto dovrebbe una richiesta. Anche l'API di Runway stessa serve modelli video di terze parti accanto ai propri, e l'azienda rilascia un world model, GWM-1, che ti dice dove Runway ritiene si trovi il problema interessante: non nel portare avanti una conversazione, ma nel modellare una scena.

Griffin punta nella direzione opposta. Ogni decisione progettuale nell'architettura pubblicata di Tavus riguarda la latenza piuttosto che la fedeltà. Il codec Tavec funziona a 48 kHz con 40 valori per frame a 100 frame al secondo, senza codebook, un decoder completamente causale e pacchetti piccoli fino a 10 millisecondi. Il percorso video emette 720p in blocchi da 320 millisecondi, dove un latente copre otto frame a 25 fps e ogni latente richiede tre passi di diffusione. La latenza da audio a video è in media di 0,43 secondi su H100s, che secondo Tavus è circa la metà del secondo metodo più veloce che ha misurato. Niente in quello stack cerca di renderizzare dieci bellissimi secondi. Tutto al suo interno cerca di renderizzare i prossimi 320 millisecondi in tempo.

Quindi il confronto delle specifiche è reale ma non è un tabellone segnapunti:

• Unità di fatturazione — Runway Gen-4.5 viene fatturato in secondi di output; conosci il tuo costo prima di premere genera. Griffin non ha alcun prezzo pubblicato, perché non ha un prodotto pubblico.

• Durata della clip — Gen-4.5 genera da due a dieci secondi; Griffin continua finché dura la chiamata.

• Risoluzione e frequenza — Gen-4.5 esegue il rendering a 720p a 24 o 25 fps; Griffin trasmette in streaming a 720p a 25 fps in blocchi da 320 millisecondi.

• Audio — Gen-4.5 non produce alcuna traccia audio; Griffin genera parlato e video insieme e clona una voce a partire da un campione di circa 10 secondi.

• Interattività — Gen-4.5 è una richiesta asincrona unidirezionale; Griffin è full duplex e può essere interrotto nel mezzo dell'eloquio.

• Extra per motion e color grading — Gen-4.5 offre l'esportazione in ProRes e PNG con un sovrapprezzo di 5 crediti al secondo e HDR a 20 crediti al secondo, che sale a 40 oltre circa quattro megapixel; Griffin non ha un equivalente perché non esporta file.

• Disponibilità — Gen-4.5 è attivo per gli abbonati paganti dal 12 dicembre 2025; Griffin è in anteprima di ricerca per tester selezionati e Tavus dichiara che non è disponibile per l'uso da parte dei clienti.

Board titled 'Two Clocks, Two Bills' with six labelled rows comparing Runway Gen-4.5 (left) against Tavus Griffin (right): billing unit 'Runway Gen-4.5 - 12 credits per second of video' versus 'Tavus Griffin - no price, no product'; clip length 2 to 10 seconds versus as long as the call runs; resolution 720p at 24 or 25 fps versus 720p at 25 fps in 320 ms chunks; audio no audio track versus speech and face generated together; interactivity one asynchronous request versus full duplex, interruptible; availability live for subscribers since 12 December 2025 versus research preview, not sellable.

Il conto della Gen-4.5, in cifre semplici

Runway applica a Gen-4.5 un prezzo di 12 crediti per secondo di video generato. Al prezzo standard di un centesimo per credito, ciò equivale a 0,12 $ al secondo, o circa 7,20 $ per un minuto intero di filmato se si potesse generarne uno in modo continuo — cosa impossibile, perché il modello si ferma a dieci secondi, quindi un minuto significa sei o più generazioni separate montate insieme con tutti gli errori di continuità che ciò comporta. L'output ProRes e PNG aggiunge 5 crediti al secondo, e l'HDR aggiunge 20 crediti al secondo, che salgono a 40 oltre circa quattro megapixel. I crediti API vengono fatturati separatamente dai crediti dell'abbonamento all'app, un dettaglio che coglie impreparati i team quando fanno il prototipo nell'app web e poi passano all'API.

Board titled 'What One Minute Costs'. Left card, a minute of Runway Gen-4.5: rate 12 credits per second, about $0.12; hard limit 10 seconds per generation; so a minute means six or more separate generations; list price if it could run straight through about $7.20; extras ProRes or PNG +5 credits per second; HDR +20 credits per second, up to +40 above 4 MP. Right card, a minute of Tavus Griffin: rate none published; product research preview for selected testers; so a minute means not obtainable at any price; published evidence 0.43 s average audio to video on H100s; vendor statement not available for customer use at this time; availability no API, no price, no date.

Anche dove si può accedere a Gen-4.5 è importante. È disponibile tramite l'API di Runway stessa e tramite diverse piattaforme di terze parti. Non è una route di OrcaRouter — non lo ospitiamo e non suggeriremo che tu possa ottenerlo qui.

Quanto costa Griffin, e perché questa è la domanda sbagliata

Non c'è un prezzo per Tavus Griffin. Il materiale di comunicazione di Tavus afferma che Griffin-Lite, l'anteprima di ricerca, è disponibile da oggi per un gruppo selezionato di primi tester, che seguirà un rilascio più ampio di un modello più potente, che Griffin-Lite non sarà disponibile per l'uso da parte dei clienti al momento, e che Griffin non è ancora sulla piattaforma Tavus — arriverà una volta che l'azienda avrà stabilito come rilasciarlo in sicurezza.

Quel paragrafo sta facendo un gran lavoro. Significa che il confronto in questo articolo non è una decisione di acquisto e non può diventarlo finché Tavus non indica una tariffa. Significa anche che Tavus è insolitamente diretta riguardo a un risultato che la maggior parte dei fornitori avrebbe pubblicato come pagina di prodotto con un pulsante «contatta le vendite».

Quello che Griffin pubblica è una prova sul comportamento. In uno studio condotto con la Queen Mary University of London, 26 dei 54 partecipanti — il 48% — ha creduto che Griffin fosse una persona reale dopo una videochiamata di un minuto, contro 1 su 41 (2,4%) per il precedente stack Phoenix-4.5, Sparrow-2 e Raven-1 di Tavus. Sul benchmark VideoFDB di NVIDIA, con punteggi di settembre 2026, Tavus dichiara il primo posto nell'IA faccia a faccia: generazione 3,83 contro un 2,80 della migliore baseline dichiarata e un riferimento umano di 3,92, percezione 3,73 contro 3,44 della migliore baseline dichiarata e 4,20 per un essere umano, con un tasso del 73,8% di obiettivi del task sul versante della percezione su quindici modelli valutati. Sono numeri dichiarati dal fornitore e basati su un benchmark creato da NVIDIA, e riguardano la conversazione, non la cinematografia.

Screenshot of the Tavus website's Griffin announcement, captured 2 October 2026: the headline 'The First Human Interaction Model' under 'Introducing Griffin', a paragraph describing a video-to-video system that listens while the other person talks, and three statistic tiles reading 48% of people believed Griffin was a real person after a one-minute video call, #1 on NVIDIA's independent test of face-to-face AI, and 37% ahead of the next best AI at reacting in the moment, dated October 1st, 2026.

I diversi lavori, spiegati chiaramente

Se vuoi una ripresa di una città al crepuscolo con un movimento di macchina che corrisponda a un fotogramma di riferimento, Gen-4.5 è uno strumento che esiste e può farlo oggi per circa dodici centesimi al secondo. Non esiste uno scenario in cui Griffin ti aiuti, perché Griffin non accetta un prompt e non restituisce un file.

Se vuoi un volto che ascolta, subisce interruzioni e mantiene coerente una conversazione per diversi minuti, Gen-4.5 non può aiutarti, perché non accetta input dopo che la richiesta è stata inviata. Una clip di dieci secondi con una testa parlante non è una conversazione; è un video di una conversazione, e la distinzione è esattamente quella che Tavus sta vendendo.

La sovrapposizione è più ridotta di quanto suggerisca l'etichetta "video AI": entrambi producono pixel di una persona ed entrambi girano a 720p e 25 fps. Tutto il resto è diverso, compresa l'unità riportata in fattura.

Perché un router è utile proprio in questo punto

I team che finiscono per aver bisogno di entrambe le cose di solito lo scoprono a proprie spese — un prodotto vuole un'inquadratura di ambientazione generata e un avatar parlante, e i due arrivano da fornitori diversi con autenticazione diversa, sistemi di credito diversi e modalità di errore diverse. Questo è il caso in cui un singolo endpoint si ripaga da solo. OrcaRouter porta oltre duecento modelli dietro un'unica chiave, trasmette i prezzi di listino dei provider a 0% di ricarico così una variazione di prezzo di un fornitore è attiva sulla scheda il giorno stesso, e riprova su un provider sano quando una rotta fallisce invece di restituirti un timeout. Un DSL di routing ti consente di inviare bozze a basso rischio dove la capacità costa meno e di fissare qualsiasi cosa rivolta al cliente a un provider specifico, e la fusione di modelli ti consente di mettere un modello di testo economico davanti a una chiamata di generazione costosa per riscrivere un prompt prima di spendere i secondi.

Per essere precisi su ciò che copre e ciò che non copre in questo confronto: Gen-4.5 non è una delle nostre route, e nemmeno Griffin. Il lato video del catalogo include minimax/minimax-h3, il generatore omni-modale di MiniMax, a $0,08 al secondo di output a 768P e $0,13 al secondo a 2K — un prezzo al secondo sullo stesso asse di quello di Runway, da un modello che possiamo effettivamente servirti oggi. Questa è la raccomandazione onesta se ciò di cui hai bisogno sono secondi generati e vuoi averli su un'unica fattura con tutto il resto.

Su quale pianificare

Gen-4.5 è la dipendenza più sicura con un ampio margine: è nelle mani di clienti paganti da dicembre 2025, la sua API è documentata, i suoi crediti hanno un prezzo e i suoi limiti — dieci secondi, nessun audio, niente storyboarding — sono pubblicati anziché scoperti. Un team che ha bisogno di filmati generati può iniziare questa settimana.

Griffin è la scommessa con il tetto più alto e il pavimento più basso. Il suo 48% e la sua latenza media di 0,43 secondi descrivono qualcosa di realmente nuovo, e il fatto che Tavus si rifiuti di venderlo per ora è un segnale della maturità di quel qualcosa, più che una decisione di marketing. Non inserirlo in una roadmap come dipendenza; mettilo in una lista di osservazione e ricontrolla quando la nota di sicurezza sparirà.