Kartu hero untuk "Tavus Griffin vs HeyGen Video 1" dengan tiga chip bertuliskan "HeyGen Video — $0.01 per detik", "Griffin — tanpa harga, minta akses" dan "HeyGen Video — 5 hingga 15 detik pada 768p", di atas enam baris: HeyGen diluncurkan: 30 September 2026; Griffin diumumkan: 1 Oktober 2026; Harga HeyGen: $0.01 per detik; Harga Griffin: tidak dipublikasikan; Output HeyGen: klip 5 hingga 15 detik; Output Griffin: sesi langsung. Footer: "HeyGen Video diluncurkan 30 September 2026; Griffin diumumkan 1 Oktober 2026 sebagai pratinjau."
Guides & Insights

Tavus Griffin vs HeyGen Video 1: Terpisah Tiga Puluh Enam Jam, dan Hanya Satu yang Dapat Dibeli

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua peluncuran terjadi dalam selang tiga puluh enam jam satu sama lain di sudut pasar yang sama, dan kalender adalah hal paling menarik dari pasangan ini. HeyGen Video mulai tersedia pada 30 September 2026 dengan tarif $0,01 per detik sepanjang Oktober, disetel dari MiniMax H3 dan dirilis dengan pengenal heygen-video-1. Tavus Griffin diumumkan pada 1 Oktober 2026 dengan studi tatap muka langsung di mana 26 dari 54 peserta meyakini mitra mereka adalah manusia sungguhan, dan produk ini hanya tersedia bagi penguji tepercaya terpilih melalui formulir permintaan, tanpa pengenal, tanpa endpoint, dan tanpa harga. Keduanya berkaitan dengan menghasilkan manusia yang meyakinkan. Alasan jujur untuk membandingkan Tavus Griffin dan HeyGen Video 1 bukanlah bahwa seorang pembeli akan memilih di antara keduanya — saat ini hanya satu dari keduanya yang dapat dibeli — melainkan bahwa perbedaannya menjelaskan untuk apa masing-masing dibangun, dan berapa nilai sebenarnya dari satu detik manusia yang dihasilkan.

Yang satu menjual klip, yang lain menjual percakapan.

HeyGen Video adalah model video serbaguna yang kebetulan luar biasa bagus dalam hal orang. Ia menerima sebuah prompt, atau prompt plus gambar, atau prompt plus hingga sembilan gambar referensi, tiga video referensi, dan tiga klip audio referensi, lalu mengembalikan klip berdurasi antara 5 dan 15 detik pada 480p atau 768p, 24 fps, dengan audio AAC pada 32 kHz stereo yang berisi dialog, ambiens, dan efek yang dihasilkan. Tiga mode mencakup pengondisian — text_to_video, image_to_video, dan reference_to_video, yang merupakan default — dan urutan daftar menjadi label yang Anda rujuk dalam prompt, sehingga entri pertama dari reference_images adalah <Picture 1>. Field yang tidak dikenal dalam permintaan ditolak, bukan diabaikan, dan seed adalah bilangan bulat 32-bit tak bertanda yang membuat sebuah shot dapat diulang saat Anda mempertahankan seed dan mengubah satu klausa pada satu waktu. Ini adalah alat produksi dengan envelope deterministik.

Griffin membalik hampir semua properti itu. Ia menghasilkan 720p dalam potongan 320 ms pada 25 fps dari satu foto referensi dan memutar setiap potongan saat didekode, jadi tidak ada panjang klip yang perlu ditentukan dan tidak ada file yang harus dikembalikan. Mesin Continuous Conversational Modeling menyerap audio dan video serta menilai ulang pertukaran itu pada interval di bawah satu detik, memilih apakah akan tetap diam, memberi sinyal, mengeluarkan backchannel, atau mengambil giliran, dan kontrol ekspresifnya menggerakkan generator ucapan streaming dan generator video streaming secara paralel. Keputusan yang dibuat di tengah kalimat muncul di suara dan wajah dalam mini-turn yang sama. Anda tidak menulis prompt; Anda berbicara kepadanya, dan ia merespons jeda, pandangan yang dialihkan, atau interupsi.

Itulah sebabnya keduanya bukan pengganti meskipun keduanya menghasilkan manusia. HeyGen Video ditanya seperti apa momen yang digambarkan. Griffin ditanya apa yang seharusnya terjadi selanjutnya.

Berapa biaya setiap detik, pada yang bisa Anda beli

Harga peluncuran HeyGen Video adalah $0.01 per detik hingga Oktober, dan uraian HeyGen sendiri menggambarkannya sebagai diskon 50% dari standar $0.02. Bagan biaya di halaman yang sama, dengan catatan kaki sebagai harga daftar per detik pada 768p dengan audio sebelum promosi peluncuran, menetapkannya pada $0.03. Itu adalah selisih 50% antara uraian dan bagan pada materi peluncuran milik vendor sendiri, dan sampai HeyGen menerbitkan halaman harga API, tafsir yang aman adalah bahwa $0.01 terkonfirmasi karena sudah berlaku, dan angka setelah Oktober berada di kisaran antara $0.02 dan $0.03.

Hitung angkanya untuk seribu detik — seratus klip sepuluh detik — unit yang sebenarnya digunakan tim bulk untuk berpikir:

• HeyGen Video pada Oktober — $10 dengan $0,01 per detik.

• HeyGen Video setelah Oktober — $20 pada $0.02, atau $30 pada $0.03 di grafik.

• MiniMax H3, model dasar yang menjadi asal penyetelannya — $80 pada harga daftar MiniMax sebesar $0,08 per detik.

• Kling 3.0 Pro — $168 dengan $0,168 per detik.

• Veo 3.1 — $400 dengan $0.40 per detik.

Alasan aritmetika menjadi sorotan utama peluncuran HeyGen adalah tingkat pembuangannya. Tim yang membuat potongan untuk media sosial, varian iklan, dan loop produk menghasilkan jauh lebih banyak daripada yang mereka rilis, dan dengan biaya sepuluh sen per percobaan sepuluh detik, ekonomi membuang kandidat berubah bentuk sepenuhnya. Masalahnya adalah batas atasnya: 768p pada 24 fps bukan format pengiriman 2K, dan MiniMax H3 mencapai 2K melalui modul regenerasi terpisah pada API yang dihosting sendiri oleh MiniMax dengan biaya $0.13 per detik, tanpa padanan di HeyGen Video. Jika target pengiriman Anda di atas 768p, detik murah itu bukan detik yang Anda butuhkan.

Kolom Griffin dalam daftar itu kosong, dan bukan dengan cara yang menjanjikan. Tavus belum menerbitkan tarif, karena Griffin-Lite adalah pratinjau riset yang menurut pengumumannya sendiri tidak akan tersedia untuk penggunaan pelanggan saat ini dan tidak ada di platform Tavus. Dalam model seribu detik, tidak ada yang bisa dicatat. Siapa pun yang menyebut angka untuk Griffin sedang mengarangnya.

Angka-angka kualitas, dan siapa yang menilai

Tak satu pun dari model ini memiliki skor independen, dan itu perlu dinyatakan sejak awal karena kedua vendor memiliki bagan.

Tabel HeyGen adalah tabel Elo dengan HeyGen Video dinormalisasi ke 1000, lalu Dreamina Seedance 2.0 di 955, keluarga H3 Max tersebar dari 952 turun ke 860, Kling 3.0 Pro di 857, dan Veo 3.1 di 744. Catatan kaki itu yang paling berperan: skor berasal dari set evaluasi internal kueri Artificial Analysis Arena dengan 4.800 suara, dan skor HeyGen sendiri dinormalisasi ke 1000 agar perbandingan lebih sederhana. Vendor yang menormalisasi dirinya ke puncak grafiknya sendiri adalah pilihan penyajian, bukan bukti bahwa ia memimpin. Jarak relatif di bawahnya adalah bagian yang informatif.

Yang lebih berguna adalah perbandingan head-to-head, satu-satunya tempat HeyGen diuji terhadap sesuatu yang tidak ia buat sendiri. HeyGen mengatakan penguji blind lebih memilih modelnya daripada H3 Max post-train yang tercantum dalam grafik pada 55,8% perbandingan dari 650 suara, dengan rentang 49–62%. Rentang itu adalah detail yang jujur: pada ujung bawahnya, rentang itu melintasi 50%, jadi menurut angka vendor sendiri, preferensi atas rival itu tidak terpisah jelas dari noise. Rincian per sumbu campur aduk dengan cara yang terbaca seperti profil kegagalan yang spesifik — 65% untuk tetap setia pada gambar sumber dan 66% untuk timing, dibandingkan 43% untuk konsistensi dan 45% untuk musik.

Angka Griffin berasal dari instrumen yang dibangun oleh orang lain, dan itulah perbedaan yang penting. VideoFDB milik NVIDIA adalah tolok ukur untuk percakapan audio-visual dupleks penuh yang dinilai pada dua jalur, dan NVIDIA yang membangunnya serta melakukan evaluasi dengan jurinya sendiri berdasarkan rubrik yang dipublikasikan. Griffin-Lite mencetak 3,83 dari 5 pada generasi, dibandingkan referensi manusia 3,92 dan 2,80 untuk sistem terpublikasi dengan skor tertinggi berikutnya, serta 3,73 pada persepsi terhadap referensi manusia 4,20. Tavus juga melaporkan latensi audio-ke-video sebenarnya sebesar 0,43 detik untuk generator tersebut dibandingkan empat baseline difusi streaming yang dipublikasikan di H100s. Kaveatnya tetap berlaku — selisih 0,09 poin dari manusia pada rubrik lima poin yang dinilai oleh model bahasa adalah "dekat", bukan "setara", dan sebagian dari keunggulan persepsi diukur terhadap sistem yang berjalan tanpa masukan video — tetapi penilainya bukan vendor.

• Skor kualitas independen — tidak ada dari keduanya yang memilikinya. HeyGen Video tidak muncul di satu pun dari tiga papan video Artificial Analysis per 2 Oktober 2026, dan Griffin juga tidak. Griffin mungkin tidak akan pernah: pemungutan suara preferensi berpasangan atas klip pendek tidak dapat menilai percakapan langsung.

Papan peringkat yang sama memang memuat model dasar. MiniMax H3 berada di peringkat ke-4 untuk teks-ke-video (dengan audio) pada Elo 1.139 dan peringkat ke-2 untuk gambar-ke-video pada 1.181, keduanya dengan biaya $4,80/menit — jadi pasca-latihan HeyGen bersaing di atas substrat yang oleh arena independen sudah dinilai mendekati puncak, yang merupakan argumen terkuat yang menguntungkannya, yang tidak diterbitkan sendiri oleh HeyGen.

A screenshot of the top of Artificial Analysis's text-to-video-with-audio board, captured 2 October 2026: Wan 3.0 first at Elo 1,157 and $12.00/min, Utopai X (based on MiniMax H3) second at 1,150, Dreamina Seedance 2.5 third at 1,144, MiniMax H3 (768p) fourth at Elo 1,139 with 7,496 votes and $4.80/min, MiniMax H3 Max (based on MiniMax H3) fifth at 1,134 with 5,510 votes, and FLUX 3 sixth at 1,127, with release months and per-minute API pricing columns visible.

Keduanya murah atau tidak dapat diberi harga karena alasan yang sama

Fakta struktural di balik kedua peluncuran itu adalah bahwa membuat manusia yang meyakinkan menjadi murah, dan keunggulan biaya kedua perusahaan itu tidak berasal dari hal yang mereka jual.

HeyGen Video adalah hasil pasca-pelatihan dari MiniMax H3, yang dirilis MiniMax dengan bobot tersedia di bawah lisensi komunitasnya sendiri. Hal itu mengubah H3 menjadi substrat yang dapat dikhususkan dan dijual kembali oleh perusahaan lain, dan HeyGen adalah produk kedua yang melakukannya dalam lima minggu untuk vertikal yang berbeda — video bisnis, demo produk, pelatihan, tur properti. Pola inilah sebabnya HeyGen dapat menetapkan harga di bawah model dasar: ia tidak menanggung biaya model dasar, dan model dasarnya adalah rilis open-weights milik pihak lain.

Griffin adalah taruhan yang berlawanan. Tavus membangun seluruh sistem — codec, generator pidato streaming, generator video streaming, model percakapan — di sekitar interaksi itu sendiri, menyuling guru difusi dua arah yang besar menjadi generator autoregresif beberapa langkah dalam tiga tahap agar rollout panjang tidak menyimpang. Itu penelitian mahal tanpa basis terbuka untuk berpijak, dan itu bagian yang masuk akal dari alasan rilisnya dibatasi: tidak ada substrat murah di bawahnya untuk diamortisasi.

Kedua perusahaan juga sampai pada titik yang sama-sama tidak nyaman dari arah yang berbeda. Dokumentasi HeyGen sendiri mencantumkan hal-hal yang paling buruk dilakukan model ini, yang jarang dan layak dibaca: teks panjang di layar, gerakan organik yang halus seperti kelopak bunga, kertas, dan rambut, serta pekerjaan tangan jarak dekat seperti merakit atau mengoperasikan peralatan. Model ini paling baik untuk bidikan pendek yang terbatas — satu subjek, satu tempat, satu tindakan, kamera terkunci atau nyaris tidak bergerak. Keterbatasan Griffin bukanlah daftar mode kegagalan, melainkan masalah keamanan yang belum terselesaikan: Tavus menyatakan secara gamblang bahwa properti yang membuat model interaksi manusia menjadi antarmuka yang lebih baik juga membuatnya lebih baik dalam meyakinkan seseorang bahwa mereka sedang berbicara dengan manusia, dan bahwa pihaknya menahan pratinjau tersebut sembari membangun mekanisme pengungkapan.

Apa yang sebenarnya bisa dilakukan seorang pembeli hari ini

HeyGen Video kini dapat dipanggil. Ia berjalan di POST /v3/models/videos dengan x-api-key header, hanya pada kunci API berbayar, dengan tautan unduhan yang ditandatangani dan kedaluwarsa — jadi polling menyegarkannya — dan callback yang hanya dicoba sekali per pekerjaan, yang menurut HeyGen sendiri harus Anda anggap sebagai optimasi latensi, bukan jaminan. Jika Anda mengujinya bulan ini, detik promosi $0,01 sedang berlaku, batas keluarannya 768p, dan mode peningkatan prompt adalah tuas biaya yang nyata: turbo secara default, quality untuk proses yang lebih panjang, disabled untuk mengirim teks Anda apa adanya.

Griffin tidak dapat dipanggil. Aksesnya berupa formulir permintaan dan pratinjau riset. Tidak ada kunci, tidak ada pengenal, tidak ada endpoint, dan tidak ada SLA, dan satu-satunya pernyataan yang dipublikasikan tentang ketersediaannya adalah bahwa hal itu akan tersedia setelah Tavus menemukan cara merilisnya dengan aman.

Satu hal yang dimiliki keduanya adalah bahwa tidak satu pun merupakan model yang bisa dibantu dijangkau oleh router, dan dalam kasus Griffin itu adalah masalah kategori, bukan masalah sementara — sesi dupleks penuh waktu nyata bukanlah panggilan permintaan-respons. Yang bisa dibantu oleh router dalam pipeline mana pun adalah lapisan di sekitar video. Ekspansi prompt, inventaris gambar referensi, deskripsi bidikan, pembuatan takarir, dan peringkasan ulasan semuanya adalah panggilan teks, dan panggilan dari OpenAI, Google, dan lainnya berada di katalog OrcaRouter di balik satu endpoint yang kompatibel dengan OpenAI dengan 200+ model pada kunci yang sama, pada harga daftar penyedia dengan penambahan markup 0%, sehingga perubahan harga vendor langsung berlaku pada hari yang sama. Mengenai model videonya sendiri, ada satu fakta berguna: MiniMax H3 — basis tempat HeyGen Video disetel, dan hal yang harga per detiknya sedang dipotong di bawah oleh $0.01 milik HeyGen — dirutekan di sini sebagai minimax/minimax-h3 pada $0.08 per detik, dengan 2K pada $0.13. HeyGen Video sendiri tidak ada di katalog kami dan Griffin juga tidak; keduanya dilayani melalui API vendor masing-masing dan beberapa platform pihak ketiga.

A screenshot of OrcaRouter's own model page for MiniMax-H3, captured 2 October 2026, showing the model id minimax/minimax-h3 labelled "text + image + video + audio", an Output type of video, a p50 time-to-first-token of 375 ms, and the OrcaRouter navigation and pricing panels alongside.

Yang mana, dan untuk siapa

• Gunakan HeyGen Video jika hasilnya berupa rekaman pendek, terbatas, berpusat pada orang dengan suara bawaan dan Anda bisa menerima 768p pada 24 fps. Anggarkan tarif pasca-Oktober di kisaran antara $0.02 dan $0.03 per detik, bukan tarif promosi 10 sen, dan ujilah teks panjang di layar serta pekerjaan tangan jarak dekat sebelum menetapkan alur kerja untuknya, karena HeyGen sudah memberi tahu Anda bahwa di situlah letak kegagalannya.

• Jangan membuat rencana yang bergantung pada Griffin. Minta akses jika pertanyaan Anda adalah apakah seseorang dapat membedakan manusia yang dihasilkan dari manusia asli dalam panggilan satu menit, atau jika Anda perlu melihat ke arah mana lapisan interaksi real-time ini menuju sebelum Anda menetapkan peta jalan untuk klip yang dirender.

• Perhatikan pertanyaan pengungkapan, karena itulah satu hal yang akan menggerakkan keduanya. Pelanggan HeyGen Video memiliki jawaban lugas yang tersedia — modelnya adalah pasca-latih dari basis berbobot terbuka dan outputnya adalah file dengan asal-usul yang diketahui — sementara Tavus menahan sebuah model secara khusus karena belum memilikinya. Perusahaan mana pun yang menerbitkan mekanisme pengungkapan yang lebih baik akan telah menyelesaikan masalah yang lebih berharga.

A two-column scoreboard titled "Tavus Griffin vs HeyGen Video 1 — the scoreboard". Left column "Tavus Griffin": Status: research preview; Price: none published; Output: live session; Resolution: 720p at 25 fps; Clip length: none - a session; Independent score: none. Right column "HeyGen Video 1": Status: live 30 September 2026; Price: $0.01 per second; Output: video file; Resolution: 768p at 24 fps; Clip length: 5 to 15 seconds; Independent score: none yet. Footer: "HeyGen price per HeyGen's launch page, October 2026. Neither has an independent score."