Cartão de título principal para 'Tavus Griffin vs Runway Gen-4.5' com o subtítulo 'Conversa e renderização são duas contas diferentes', acima de quatro chips: Gen-4.5 US$ 0,12 por segundo de filmagem; Gen-4.5 clipes de 2 a 10 s, sem áudio; Griffin full duplex, interrompível; Griffin sem preço publicado.
Guides & Insights

Tavus Griffin vs Runway Gen-4.5: Conversa e renderização são duas contas diferentes

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Coloque Tavus Griffin e Runway Gen-4.5 lado a lado e a primeira coisa que você percebe é que eles não compartilham uma unidade de medida. Griffin, anunciado pela Tavus em outubro de 2026 como uma prévia de pesquisa, é um Modelo de Interação Humana — um sistema de vídeo para vídeo que mantém uma conversa ao vivo cara a cara e gera o rosto e a voz do outro participante enquanto a chamada acontece. Runway Gen-4.5, anunciado em 1º de dezembro de 2025 e disponibilizado para assinantes pagantes a partir de 12 de dezembro, é um gerador de texto para vídeo e de imagem para vídeo que cobra por segundo de vídeo que renderiza. Um deles é vendido por turno e o outro por segundo, e a única maneira honesta de compará-los é perceber que um minuto de Griffin e um minuto de Gen-4.5 não são o mesmo minuto.

Dois relógios andando em direções opostas

O Gen-4.5 está nas mãos de clientes pagantes por boa parte de um ano. Ele produz clipes de dois a dez segundos a partir de um comando de texto ou de uma imagem estática, em 720p e 24 ou 25 quadros por segundo, em seis proporções de tela. Não há faixa de áudio, nem storyboard com múltiplos planos, nem diálogo — é um motor de renderização, e um disciplinado. Sua API é assíncrona, o que é o formato certo para um trabalho que leva mais tempo do que uma requisição deveria. A própria API da Runway também atende modelos de vídeo de terceiros junto com os seus, e a empresa lança um modelo de mundo, o GWM-1, o que mostra onde a Runway acha que está o problema interessante: não em manter uma conversa, mas em modelar uma cena.

Griffin aponta na direção oposta. Toda decisão de design na arquitetura publicada da Tavus gira em torno de latência, e não de fidelidade. O codec Tavec funciona a 48 kHz, com 40 valores por quadro a 100 quadros por segundo, sem codebooks, um decodificador totalmente causal e pacotes de apenas 10 milissegundos. O caminho de vídeo emite 720p em blocos de 320 milissegundos, em que um latente cobre oito quadros a 25 fps e cada latente custa três etapas de difusão. A latência de áudio para vídeo é, em média, de 0,43 segundos em H100s, o que, segundo a Tavus, é cerca de metade do próximo método mais rápido que ela mediu. Nada nessa pilha está tentando renderizar dez belos segundos. Tudo nela está tentando renderizar os próximos 320 milissegundos a tempo.

Então, a comparação de especificações é real, mas não é um placar:

• Unidade de cobrança — O Runway Gen-4.5 é cobrado em segundos de saída; você sabe o seu custo antes de clicar em gerar. O Griffin não tem nenhum preço publicado, porque não tem produto público.

• Duração do clipe — O Gen-4.5 produz de dois a dez segundos; o Griffin dura enquanto durar a chamada.

• Resolução e taxa — O Gen-4.5 renderiza 720p a 24 ou 25 fps; o Griffin transmite 720p a 25 fps em blocos de 320 milissegundos.

• Áudio — O Gen-4.5 não produz faixa de áudio; o Griffin gera fala e vídeo juntos e clona uma voz a partir de uma amostra de cerca de 10 segundos.

• Interatividade — Gen-4.5 é uma solicitação assíncrona unidirecional; Griffin é full duplex e pode ser interrompido no meio da fala.

• Extras de movimento e gradação de cor — O Gen-4.5 oferece exportação em ProRes e PNG com um acréscimo de 5 créditos por segundo e HDR a 20 créditos por segundo, subindo para 40 acima de aproximadamente quatro megapixels; o Griffin não tem equivalente porque não exporta arquivos.

• Disponibilidade — O Gen-4.5 está disponível para subscritores pagos desde 12 de dezembro de 2025; o Griffin está em pré-visualização de investigação para testadores selecionados e a Tavus afirma que não está disponível para utilização por clientes.

Board titled 'Two Clocks, Two Bills' with six labelled rows comparing Runway Gen-4.5 (left) against Tavus Griffin (right): billing unit 'Runway Gen-4.5 - 12 credits per second of video' versus 'Tavus Griffin - no price, no product'; clip length 2 to 10 seconds versus as long as the call runs; resolution 720p at 24 or 25 fps versus 720p at 25 fps in 320 ms chunks; audio no audio track versus speech and face generated together; interactivity one asynchronous request versus full duplex, interruptible; availability live for subscribers since 12 December 2025 versus research preview, not sellable.

O projeto de lei Gen-4.5, em números simples

A Runway precifica o Gen-4.5 em 12 créditos por segundo de vídeo gerado. Ao padrão de um centavo por crédito, isso equivale a US$ 0,12 por segundo, ou cerca de US$ 7,20 por um minuto completo de filmagem, se fosse possível gerar um minuto continuamente — o que não é possível, porque o modelo é limitado a dez segundos, então um minuto significa seis ou mais gerações separadas emendadas umas às outras, com quaisquer erros de continuidade que isso implique. Saídas em ProRes e PNG acrescentam 5 créditos por segundo, e HDR acrescenta 20 créditos por segundo, subindo para 40 acima de cerca de quatro megapixels. Créditos de API são cobrados separadamente dos créditos da assinatura do app, um detalhe que pega as equipes de surpresa quando elas fazem protótipos no app web e depois migram para a API.

Board titled 'What One Minute Costs'. Left card, a minute of Runway Gen-4.5: rate 12 credits per second, about $0.12; hard limit 10 seconds per generation; so a minute means six or more separate generations; list price if it could run straight through about $7.20; extras ProRes or PNG +5 credits per second; HDR +20 credits per second, up to +40 above 4 MP. Right card, a minute of Tavus Griffin: rate none published; product research preview for selected testers; so a minute means not obtainable at any price; published evidence 0.43 s average audio to video on H100s; vendor statement not available for customer use at this time; availability no API, no price, no date.

Onde o Gen-4.5 pode ser acessado também importa. Ele está disponível por meio da própria API da Runway e de várias plataformas de terceiros. Não é uma rota do OrcaRouter — não o hospedamos, e não vamos sugerir que você pode obtê-lo aqui.

Quanto custa o Griffin, e por que essa é a pergunta errada

Não há preço para o Tavus Griffin. O material de lançamento da Tavus afirma que o Griffin-Lite, a prévia de pesquisa, está disponível hoje para um grupo seleto de testadores iniciais, que um lançamento mais amplo de um modelo mais poderoso virá em seguida, que o Griffin-Lite não estará disponível para uso por clientes no momento, e que o Griffin ainda não está na plataforma Tavus — ele chegará quando a empresa tiver definido como lançá-lo com segurança.

Esse parágrafo faz muita coisa. Ele significa que a comparação neste artigo não é uma decisão de compra e não pode se tornar uma até que a Tavus informe um preço. Também significa que a Tavus está sendo incomumente direta sobre um resultado que a maioria dos fornecedores teria lançado como uma página de produto com um botão "fale com vendas".

O que a Griffin publica é evidência sobre comportamento. Em um estudo realizado com a Universidade Queen Mary de Londres, 26 de 54 participantes — 48% — acreditaram que Griffin era uma pessoa real após uma chamada de vídeo de um minuto, contra 1 de 41 (2,4%) para a pilha anterior da Tavus, Phoenix-4.5, Sparrow-2 e Raven-1. No benchmark VideoFDB da NVIDIA, pontuado em setembro de 2026, a Tavus relata o primeiro lugar em IA cara a cara: geração 3,83 contra 2,80 da linha de base mais forte relatada e 3,92 de referência humana, percepção 3,73 contra 3,44 da melhor linha de base relatada e 4,20 para um humano, com uma taxa de objetivos de tarefa de 73,8% no lado da percepção em quinze modelos avaliados. Esses são números relatados pelo fornecedor, baseados em um benchmark criado pela NVIDIA, e são sobre conversa, não cinematografia.

Screenshot of the Tavus website's Griffin announcement, captured 2 October 2026: the headline 'The First Human Interaction Model' under 'Introducing Griffin', a paragraph describing a video-to-video system that listens while the other person talks, and three statistic tiles reading 48% of people believed Griffin was a real person after a one-minute video call, #1 on NVIDIA's independent test of face-to-face AI, and 37% ahead of the next best AI at reacting in the moment, dated October 1st, 2026.

Os diferentes trabalhos, ditos sem rodeios

Se você quiser uma tomada de uma cidade ao anoitecer com um movimento de câmera que corresponda a um quadro de referência, o Gen-4.5 é uma ferramenta que existe e pode fazer isso hoje por cerca de doze centavos por segundo. Não existe cenário em que o Griffin ajude você, porque o Griffin não aceita um prompt e não retorna um arquivo.

Se você quer um rosto que escuta, é interrompido e mantém uma conversa coerente ao longo de vários minutos, o Gen-4.5 não pode ajudar, porque não aceita entrada depois que a solicitação é enviada. Um clipe de dez segundos com uma cabeça falante não é uma conversa; é um vídeo de uma conversa, e a distinção é exatamente a que a Tavus está vendendo.

A sobreposição é mais estreita do que o rótulo "vídeo de IA" sugere: ambos geram pixels de uma pessoa, e ambos rodam a 720p e 25 fps. Tudo o que está acima disso é diferente, incluindo a unidade na fatura.

Por que um roteador é útil exatamente neste local

As equipas que acabam por precisar de ambos descobrem-no normalmente da forma mais difícil — um produto quer um plano de estabelecimento gerado e um avatar falante, e os dois chegam de fornecedores diferentes, com autenticação diferente, sistemas de créditos diferentes e modos de falha diferentes. É neste caso que um único endpoint se justifica. O OrcaRouter disponibiliza mais de duzentos modelos por trás de uma única chave, repassa os preços de tabela dos fornecedores com 0% de margem, para que uma alteração de preço de um fornecedor fique ativa no cartão no mesmo dia, e tenta novamente junto de um fornecedor saudável quando uma rota falha, em vez de te devolver um timeout. Uma DSL de encaminhamento permite-te enviar rascunhos de baixo risco para onde a capacidade for mais barata e fixar qualquer coisa virada para o cliente a um fornecedor específico, e a fusão de modelos permite-te colocar um modelo de texto barato à frente de uma chamada de geração dispendiosa para reescrever um prompt antes de gastares os segundos.

Para ser exato sobre o que isso cobre e não cobre neste confronto: Gen-4.5 não é uma das nossas rotas, e Griffin também não. O lado de vídeo do catálogo inclui minimax/minimax-h3, o gerador omni-modal da MiniMax, a US$ 0,08 por segundo de saída em 768P e US$ 0,13 por segundo em 2K — um preço por segundo no mesmo eixo que o da Runway, de um modelo que podemos de fato disponibilizar para você hoje. Essa é a recomendação honesta se o que você precisa são segundos gerados e quer tê-los em uma única fatura com todo o resto.

Em qual planejar em torno

Gen-4.5 é, de longe, a dependência mais segura: já está nas mãos de clientes pagantes desde dezembro de 2025, sua API está documentada, seus créditos têm preços definidos, e seus limites — dez segundos, sem áudio, sem storyboard — são publicados, em vez de descobertos. Uma equipe que precisa de filmagens geradas pode começar esta semana.

Griffin é a aposta com teto mais alto e piso mais baixo. Seu 48% e sua latência média de 0,43 segundos descrevem algo genuinamente novo, e o fato de a Tavus ainda se recusar a vendê-lo é um sinal sobre a maturidade desse algo, e não uma decisão de marketing. Não o coloque em um roadmap como dependência; coloque-o em uma lista de observação e volte a verificar quando a nota de segurança desaparecer.