
Tavus Griffin対Runway Gen-4.5:会話とレンダリングは別勘定
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 223 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- xAINEWGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
Tavus Griffin と Runway Gen-4.5 を並べてみると、まず気づくのは両者が測定単位を共有していないことだ。Tavus が2026年10月に研究プレビューとして発表した Griffin は Human Interaction Model であり、ライブの対面会話を行い、通話が進むにつれて相手参加者の顔と声を生成するビデオtoビデオシステムだ。Runway Gen-4.5 は、2025年12月1日に発表され、12月12日から有料購読者に展開された、テキストtoビデオおよび画像toビデオの生成ツールで、レンダリングする映像の秒単位で課金する。一方はターン単位で販売され、もう一方は秒単位で販売されており、両者を比較する唯一の誠実な方法は、Griffin の1分と Gen-4.5 の1分は同じ1分ではないと気づくことだ。
二つの時計が反対方向に進んでいる
Gen-4.5は1年の大半にわたり、有料顧客の手に渡ってきた。テキストプロンプトまたは静止画から、2~10秒のクリップを、720p、毎秒24または25フレームで、6つのアスペクト比にわたって生成する。音声トラックはなく、マルチショットの絵コンテもなく、台詞もない——それはレンダリングエンジンであり、規律あるエンジンだ。そのAPIは非同期であり、これはリクエストにかかるべき時間よりも長くかかるジョブに適した形だ。Runway自身のAPIは自社モデルに加えてサードパーティの動画モデルも提供しており、同社はワールドモデルGWM-1を出荷している。これはRunwayがどこに興味深い問題があると考えているかを示している。会話を続けることではなく、シーンをモデリングすることに。
Griffinは逆の方向を指している。Tavusが公開したアーキテクチャにおけるあらゆる設計判断は、忠実度ではなくレイテンシーに関するものだ。Tavecコーデックは48 kHzで動作し、毎秒100フレームで1フレームあたり40値、コードブックなし、完全に因果的なデコーダ、そして10ミリ秒という小さなパケットを扱う。映像パスは720pを320ミリ秒のチャンクで出力し、そこでは1つの潜在表現が25 fpsで8フレームをカバーし、各潜在表現には3回の拡散ステップが必要だ。音声から映像へのレイテンシーはH100上で平均0.43秒で、Tavusによればこれは同社が測定した次に速い手法の約半分だ。そのスタックのどこも、美しい10秒間をレンダリングしようとはしていない。そのすべてが、次の320ミリ秒を間に合わせてレンダリングしようとしている。
つまり、仕様の比較は現実のものですが、それはスコアボードではありません:
• 課金単位 — Runway Gen-4.5 は出力の秒数単位で課金されるため、生成ボタンを押す前にコストがわかります。Griffin には公開された価格が一切ありません。公開された製品が存在しないからです。
• クリップの長さ — Gen-4.5は2~10秒を生成し、Griffinは通話が続く限り動作します。
• 解像度とフレームレート — Gen-4.5は720pを24または25 fpsでレンダリングし、Griffinは720pを25 fpsで320ミリ秒単位のチャンクでストリーミングします。
• 音声 — Gen-4.5は音声トラックを生成しません。Griffinは音声と映像を同時に生成し、約10秒のサンプルから声をクローンします。
• インタラクティブ性 — Gen-4.5は一方向の非同期リクエストです。Griffinは全二重で、発話の途中で中断できます。
• モーションとグレーディングの追加オプション — Gen-4.5はProResおよびPNGの書き出しを1秒あたり5クレジットの追加料金で提供し、HDRは1秒あたり20クレジット、約4メガピクセルを超える場合は40クレジットに上がります。Griffinはファイルを書き出さないため、相当する機能はありません。
• 可用性 — Gen-4.5は2025年12月12日以降、有料サブスクライバー向けに提供されています。Griffinは選ばれたテスター向けのリサーチプレビュー段階にあり、Tavusは顧客による利用には提供されていないと述べています。

Gen-4.5 法案を、わかりやすい数字で
RunwayはGen-4.5を生成動画1秒あたり12クレジットで価格設定している。標準的な1クレジット=1セントで計算すると、1秒あたり0.12ドル、つまり1分間の映像を連続で生成できたとすれば約7.20ドルになる——だがそれはできない。このモデルは最大10秒までなので、1分となれば6回以上の個別生成をつなぎ合わせることになり、それに伴う連続性の誤差は避けられない。ProResとPNGの出力では1秒あたり5クレジットが加算され、HDRでは1秒あたり20クレジット、約4メガピクセルを超えると40クレジットに上がる。APIクレジットはアプリのサブスクリプションクレジットとは別に請求される。これは、Webアプリでプロトタイプを作ってからAPIに移行する際にチームがつまずきやすいポイントだ。

Gen-4.5にどこでアクセスできるかも重要です。これはRunway自身のAPIを通じても、複数のサードパーティプラットフォームを通じても利用できます。これはOrcaRouterのルートではありません — 当社はこれをホストしておらず、ここで入手できるとは示唆しません。
グリフィンにかかる費用、そしてなぜそれが間違った問いなのか
Tavus Griffinに価格は設定されていません。Tavusのリリース資料には、研究プレビュー版であるGriffin-Liteが本日、選ばれた一部の初期テスター向けに利用可能であること、より強力なモデルのより広範なリリースが続くこと、Griffin-Liteは現時点では顧客向けに利用できないこと、そしてGriffinはまだTavusプラットフォーム上にはないこと——同社が安全にリリースする方法を確立でき次第、登場すること——が記されています。
あの段落は実に多くの役割を担っている。つまり、この記事での比較は調達上の決定ではなく、Tavusが料金を明示するまでは調達上の決定にはなり得ないということだ。また、ほとんどのベンダーなら「営業に問い合わせ」ボタン付きの製品ページとしてリリースしていたであろう結果について、Tavusが異例なほど率直に述べていることも意味している。
Griffinが実際に公表しているのは、行動に関する証拠だ。ロンドン大学クイーン・メアリー校と共同で実施された研究では、54人中26人(48%)が1分間のビデオ通話の後、Griffinを実在の人物だと信じた。これに対し、Tavusの以前のPhoenix-4.5、Sparrow-2、Raven-1のスタックでは41人中1人(2.4%)だった。2026年9月に採点されたNVIDIAのVideoFDBベンチマークにおいて、Tavusは対面AIで首位を報告している:生成は3.83で、報告されている最強のベースライン2.80および人間の参照値3.92に対して、知覚は3.73で、報告されている最良のベースライン3.44および人間の4.20に対して、評価された15のモデルにわたる知覚側のタスク目標達成率は73.8%である。これらはNVIDIAが構築したベンチマークに基づくベンダー報告の数値であり、会話に関するものであって、映像制作に関するものではない。

さまざまな職務、率直に述べると
夕暮れの都市を、参照フレームに一致するカメラムーブで撮影したいなら、Gen-4.5 は実在するツールで、今日すでに毎秒約12セントでそれを実現できます。Griffin があなたの役に立つシナリオは存在しません。なぜなら Griffin はプロンプトを受け付けず、ファイルも返さないからです。
聞き役になり、遮られても、数分間にわたって会話を一貫したものに保つような顔が欲しいのなら、Gen-4.5 は役に立たない。リクエストを送信した後は入力を受け付けないからだ。トーキングヘッドが映った10秒のクリップは会話ではない。それは会話の動画であり、その違いこそが Tavus が売っているものだ。
「AI動画」というラベルが示唆するより、重複部分は狭い。どちらも人物のピクセルを出力し、どちらも720p、25 fpsで動作する。それ以外はすべて異なっており、請求書の単位も違う。
なぜルーターがまさにこの場所で役立つのか
結局その両方が必要になるチームは、たいてい痛い思いをしてそれに気づく——製品が求めるのは生成されたエスタブリッシングショットとトーキングアバターであり、その2つは別々のベンダーから、それぞれ異なる認証、異なるクレジット体系、異なる障害の仕方でやってくる。これこそ、単一のエンドポイントがその真価を発揮するケースだ。OrcaRouterは200を超えるモデルを1つのキーの背後にまとめ、プロバイダーの定価を0%のマークアップでそのまま通すため、ベンダーの価格変更は同じ日に料金カードへ反映され、健全なプロバイダーへの再試行が、いずれかのルートが失敗したときにタイムアウトを返す代わりに行われる。ルーティングDSLを使えば、重要度の低いドラフトは容量が最も安い場所へ送り、顧客向けのものはすべて特定のプロバイダーに固定できる。モデルフュージョンを使えば、高価な生成呼び出しの前に安価なテキストモデルを置き、その数秒を費やす前にプロンプトを書き換えられる。
この対戦でそれが何をカバーし、何をカバーしないかを正確に言うと、Gen-4.5 は当社のルートのひとつではなく、Griffin も同様です。カタログの動画側にはminimax/minimax-h3、MiniMax のオムニモーダル生成モデルが含まれており、768P で出力1秒あたり $0.08、2K で1秒あたり $0.13 — Runway と同じ軸での秒単位の価格で、今日実際にお客様に提供できるモデルです。必要なのが生成された秒数であり、それをほかのすべてと同じ請求にまとめたいのであれば、それが正直な推奨です。
どちらを軸に計画すればよいですか?
Gen-4.5は大差でより安全な依存先です。2025年12月から有料顧客の手に渡っており、APIは文書化され、クレジットには価格が設定され、その制限——10秒、音声なし、ストーリーボーディングなし——は発見されるのではなく公開されています。生成映像を必要とするチームは今週から始められます。
Griffin は上限が高く、下限はより低い賭けだ。その 48% と平均 0.43 秒のレイテンシは、真に新しい何かを示している。そして Tavus がまだそれを販売しようとしていないという事実は、マーケティング上の判断ではなく、その何かの成熟度に関するシグナルだ。依存関係としてロードマップに載せてはいけない。ウォッチリストに入れ、安全性に関する注記が消えたらまた確認する。
