
Tavus Griffin vs Runway Gen-4.5 : la conversation et le rendu, deux factures différentes
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 223 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Mettez Tavus Griffin et Runway Gen-4.5 côte à côte et la première chose que vous remarquez, c'est qu'ils ne partagent pas la même unité de mesure. Griffin, annoncé par Tavus en octobre 2026 comme un aperçu de recherche, est un Human Interaction Model — un système vidéo-vers-vidéo qui tient une conversation en face à face en direct et génère le visage et la voix de l'autre participant pendant que l'appel se déroule. Runway Gen-4.5, annoncé le 1er décembre 2025 et déployé auprès des abonnés payants à partir du 12 décembre, est un générateur de texte-vers-vidéo et d'image-vers-vidéo qui vous facture à la seconde de séquence générée. L'un se vend au tour de parole et l'autre à la seconde, et la seule façon honnête de les comparer est de remarquer qu'une minute de Griffin et une minute de Gen-4.5 ne sont pas la même minute.
Deux horloges tournant en sens opposés
Gen-4.5 est entre les mains de clients payants depuis bientôt un an. Il produit des clips de deux à dix secondes à partir d'une invite textuelle ou d'une image fixe, en 720p et à 24 ou 25 images par seconde, sur six rapports d'aspect. Il n'y a pas de piste audio, pas de storyboard multi-plans, ni de dialogue — c'est un moteur de rendu, et un moteur discipliné. Son API est asynchrone, ce qui est la bonne forme pour une tâche qui prend plus de temps qu'une requête ne le devrait. L'API de Runway sert aussi des modèles vidéo tiers aux côtés des siens, et l'entreprise livre un modèle du monde, GWM-1, qui vous indique où Runway situe le problème : non pas dans la tenue d'une conversation, mais dans la modélisation d'une scène.
Griffin pointe dans la direction opposée. Chaque décision de conception dans l’architecture publiée de Tavus concerne la latence plutôt que la fidélité. Le codec Tavec fonctionne à 48 kHz avec 40 valeurs par trame à 100 trames par seconde, sans dictionnaires de codes, avec un décodeur entièrement causal et des paquets aussi petits que 10 millisecondes. La voie vidéo émet du 720p par segments de 320 millisecondes, où un latent couvre huit images à 25 i/s et chaque latent coûte trois étapes de diffusion. La latence audio-vers-vidéo est en moyenne de 0,43 seconde sur des H100s, ce qui, selon Tavus, correspond à environ la moitié de la méthode la plus rapide suivante mesurée. Rien dans cette pile ne cherche à générer dix belles secondes. Tout y cherche à générer les 320 millisecondes suivantes à temps.
Donc la comparaison des spécifications est réelle, mais ce n’est pas un tableau de scores :
• Unité de facturation — Runway Gen-4.5 est facturé en secondes de sortie ; vous connaissez votre coût avant même de lancer la génération. Griffin n'a aucun tarif publié, faute de produit public.
• Durée du clip — Gen-4.5 produit des clips de deux à dix secondes. Griffin dure aussi longtemps que l'appel.
• Résolution et cadence — Gen-4.5 effectue le rendu en 720p à 24 ou 25 fps ; Griffin diffuse en streaming du 720p à 25 fps par blocs de 320 millisecondes.
• Audio — Gen-4.5 ne produit aucune piste audio ; Griffin génère la parole et la vidéo ensemble et clone une voix à partir d'un échantillon d'environ 10 secondes.
• Interactivité — Gen-4.5 est une requête asynchrone unidirectionnelle ; Griffin est full duplex et peut être interrompu en pleine énonciation.
• Options supplémentaires de mouvement et d’étalonnage — Gen-4.5 propose l’export en ProRes et PNG avec un supplément de 5 crédits par seconde et le HDR à 20 crédits par seconde, passant à 40 au-delà d’environ quatre mégapixels ; Griffin n’a pas d’équivalent car il n’exporte pas de fichiers.
• Disponibilité — Gen-4.5 est disponible pour les abonnés payants depuis le 12 décembre 2025 ; Griffin est en aperçu de recherche pour des testeurs sélectionnés et Tavus indique qu'il n'est pas disponible pour une utilisation par les clients.

Le projet de loi Gen-4.5, en chiffres clairs
Runway facture Gen-4.5 à 12 crédits par seconde de vidéo générée. Au tarif standard d’un centime par crédit, cela revient à 0,12 $ par seconde, soit environ 7,20 $ pour une minute complète de séquences si vous pouviez en générer une en continu — ce qui est impossible, car le modèle est plafonné à dix secondes ; une minute implique donc six générations distinctes ou plus, assemblées avec les erreurs de continuité que cela suppose. Une sortie ProRes et PNG ajoute 5 crédits par seconde, et le HDR ajoute 20 crédits par seconde, passant à 40 au-delà d’environ quatre mégapixels. Les crédits API sont facturés séparément des crédits d’abonnement à l’application, un détail qui prend les équipes au dépourvu lorsqu’elles prototypent dans l’application web puis passent à l’API.

L'endroit où l'on accède à Gen-4.5 compte aussi. Il est disponible via l'API propre à Runway et via plusieurs plateformes tierces. Ce n'est pas une route OrcaRouter — nous ne l'hébergeons pas, et nous ne suggérerons pas que vous puissiez l'obtenir ici.
Combien coûte Griffin, et pourquoi ce n'est pas la bonne question
Il n’existe pas de prix pour Tavus Griffin. La documentation de lancement de Tavus précise que Griffin-Lite, l’aperçu de recherche, est disponible dès aujourd’hui pour un groupe restreint de premiers testeurs ; qu’une diffusion plus large d’un modèle plus puissant suivra ; que Griffin-Lite ne sera pas disponible pour une utilisation par les clients pour le moment ; et que Griffin n’est pas encore sur la plateforme Tavus — il arrivera lorsque l’entreprise aura déterminé comment le lancer en toute sécurité.
Ce paragraphe en fait beaucoup. Il signifie que la comparaison dans cet article n’est pas une décision d’achat et ne peut pas le devenir tant que Tavus n’indique pas un tarif. Il signifie aussi que Tavus se montre inhabituellement direct au sujet d’un résultat que la plupart des fournisseurs auraient livré sous la forme d’une page produit avec un bouton « contacter le service commercial ».
Ce que Griffin publie, lui, ce sont des preuves sur le comportement. Dans une étude menée avec Queen Mary University of London, 26 des 54 participants — 48 % — croyaient que Griffin était une personne réelle après un appel vidéo d’une minute, contre 1 sur 41 (2,4 %) pour le précédent stack Phoenix-4.5, Sparrow-2 et Raven-1 de Tavus. Sur le benchmark VideoFDB de NVIDIA, évalué en septembre 2026, Tavus rapporte la première place pour l’IA en face-à-face : génération 3,83 contre 2,80 pour la meilleure référence rapportée et 3,92 pour une référence humaine ; perception 3,73 contre 3,44 pour la meilleure référence rapportée et 4,20 pour un humain, avec un taux d’atteinte des objectifs de tâche de 73,8 % du côté de la perception sur quinze modèles évalués. Ce sont des chiffres rapportés par le fournisseur, qui reposent sur un benchmark construit par NVIDIA, et ils portent sur la conversation, pas sur la cinématographie.

Les différents emplois, énoncés simplement
Si vous voulez un plan d’une ville au crépuscule avec un mouvement de caméra qui corresponde à une image de référence, Gen-4.5 est un outil qui existe et peut le faire aujourd’hui pour environ 12 cents par seconde. Il n’existe aucun scénario dans lequel Griffin vous aide, car Griffin n’accepte pas de prompt et ne renvoie pas de fichier.
Si vous voulez un visage qui écoute, se fait interrompre et garde une conversation cohérente pendant plusieurs minutes, Gen-4.5 ne peut pas vous aider, car il n’accepte aucune entrée après l’envoi de la requête. Un clip de dix secondes avec une tête parlante n’est pas une conversation ; c’est une vidéo d’une conversation, et la distinction est exactement celle que vend Tavus.
Le chevauchement est plus étroit que ne le suggère l’étiquette « vidéo IA » : les deux produisent des pixels d’une personne, et les deux tournent en 720p et 25 i/s. Tout ce qui va au-delà est différent, y compris l’unité sur la facture.
Pourquoi un routeur est utile exactement à cet endroit
Les équipes qui finissent par avoir besoin des deux le découvrent généralement à leurs dépens — un produit veut un plan d'ensemble généré et un avatar parlant, et les deux arrivent de fournisseurs différents, avec une authentification différente, des systèmes de crédits différents et des modes de défaillance différents. C'est précisément le cas où un endpoint unique justifie son coût. OrcaRouter regroupe plus de deux cents modèles derrière une seule clé, répercute les prix catalogue des fournisseurs à 0 % de marge, de sorte qu'un changement de prix d'un fournisseur est visible sur la fiche tarifaire le jour même, et réessaie auprès d'un fournisseur sain lorsqu'une route échoue au lieu de vous renvoyer un délai d'attente. Un DSL de routage vous permet d'envoyer les brouillons à faible enjeu là où la capacité est la moins chère et d'épingler tout ce qui s'adresse aux clients sur un fournisseur précis, et la fusion de modèles vous permet de placer un modèle textuel bon marché en amont d'un appel de génération coûteux pour réécrire un prompt avant de dépenser ces secondes.
Pour être précis sur ce que cela couvre et ne couvre pas dans cette comparaison : Gen-4.5 ne fait pas partie de nos routes, et Griffin non plus. Le volet vidéo du catalogue inclut minimax/minimax-h3, le générateur omni-modal de MiniMax, à 0,08 $ par seconde de sortie en 768P et 0,13 $ par seconde en 2K — un prix à la seconde sur le même axe que celui de Runway, d'un modèle que nous pouvons réellement vous fournir aujourd'hui. C'est la recommandation honnête si ce dont vous avez besoin, ce sont des secondes générées et que vous voulez les regrouper sur une seule facture avec tout le reste.
Lequel prendre en compte pour planifier ?
Gen-4.5 est de loin la dépendance la plus sûre : il est entre les mains de clients payants depuis décembre 2025, son API est documentée, ses crédits sont tarifés, et ses limites — dix secondes, pas d’audio, pas de storyboard — sont publiées plutôt que découvertes. Une équipe qui a besoin de séquences générées peut commencer cette semaine.
Griffin est le pari au plafond plus élevé et au plancher plus bas. Son taux de 48 % et sa latence moyenne de 0,43 seconde décrivent quelque chose de véritablement nouveau, et le fait que Tavus refuse encore de le vendre est un signal sur la maturité de cette chose plutôt qu’une décision marketing. Ne l’inscrivez pas dans une feuille de route comme dépendance ; mettez-le sur une liste de surveillance et revenez-y lorsque la note de sécurité disparaîtra.
