Kartu hero untuk "Tavus Griffin vs Google Veo 3.1" dengan tiga chip bertuliskan "Veo 3.1 — SynthID di setiap frame", "Griffin — 48% dari studi langsung tertipu", dan "Veo 3.1 Standard — mulai dari $0,40 per detik", di atas enam baris: Provenans Griffin: tidak ada yang dipublikasikan; Provenans Veo: SynthID plus C2PA; Harga Griffin: tidak ada yang dipublikasikan; Harga Veo: $0,40 per detik; Status Griffin: pratinjau riset; Status Veo: tersedia secara umum. Footer: "Tarif Veo 3.1 adalah harga daftar Google Gemini API; Griffin adalah pratinjau riset tanpa harga."
Guides & Insights

Tavus Griffin vs Google Veo 3.1: Satu Memberi Watermark di Setiap Frame, yang Lainnya Menipu 48% dari Sebuah Ruangan

Penulis

Magnus Corvin

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Letakkan Tavus Griffin dan Google Veo 3.1 berdampingan, dan perbandingan konvensional — harga per detik, Elo, panjang klip — langsung runtuh, karena hanya salah satunya yang punya harga dan hanya salah satunya yang dinilai berdasarkan sesuatu yang bisa dicari pembeli. Namun ada sumbu nyata di baliknya, dan itu bukan kualitas. Jawaban Google atas media sintetis adalah membuatnya dapat dideteksi: setiap keluaran Veo 3.1 membawa SynthID, tanda air tak terlihat yang dituliskan ke dalam piksel frame demi frame dan ke dalam spektrum audio, plus C2PA Content Credentials yang merekam provenans file, dan Google telah merilis detektor ke dalam aplikasi Gemini sehingga pengguna dapat bertanya apakah sebuah klip dibuat oleh Google AI. Alasan yang dinyatakan Tavus Griffin untuk hadir dalam pratinjau alih-alih sebagai produk jadi adalah cerminan sebaliknya: dalam studi langsung milik Tavus sendiri, 26 dari 54 peserta mengakhiri panggilan video satu menit dengan yakin bahwa lawan bicara mereka adalah orang sungguhan, dibandingkan 1 dari 41 pada stack perusahaan sebelumnya, dan Tavus mengatakan pihaknya menahan model tersebut sampai mereka menemukan cara mengungkapkan apa dirinya. Salah satu vendor ini menjual deteksi. Yang lain saat ini justru menjadi alasan deteksi itu penting, dan menyadarinya.

Dua produk yang dibangun di atas asumsi yang berlawanan

Veo 3.1 adalah generator klip dengan cakupan yang sengaja dibuat sempit. Di Google Gemini API, ia menghasilkan 4, 6, atau 8 detik per proses pada 24 fps, secara native pada 720p, sedangkan 1080p dan 4K hadir melalui proses upscaling yang ditambahkan dalam pembaruan Januari 2026. Ekstensi menambahkan tujuh detik per proses dan dapat diulang hingga dua puluh kali untuk batas teoretis sekitar 148 detik, tetapi inputnya harus berupa klip buatan Veo yang tidak lebih dari 141 detik pada 720p dalam rasio 16:9 atau 9:16, dan durasi delapan detik wajib untuk ekstensi, untuk input gambar referensi, dan untuk apa pun di atas 720p. Anda tidak bisa membuat klip 1080p berdurasi empat detik. Outputnya adalah file yang Anda miliki, diberi tanda air, dengan catatan asal-usul bertanda tangan yang dilampirkan.

Griffin tidak menghasilkan file. Griffin menjalankan percakapan. Mesin Pemodelan Percakapan Berkelanjutan menerima audio dan video lalu menilai ulang pertukaran tersebut pada interval sub-detik, memilih apakah akan tetap diam, memberi isyarat, memberi backchannel, atau mengambil giliran, dan mengeluarkan kontrol ekspresif yang menggerakkan generator ucapan streaming serta generator video streaming secara bersamaan. Generator video menghasilkan 720p dalam potongan 320 ms, satu laten pada satu waktu, pada 25 fps dari satu foto referensi, dan memutar setiap potongan saat didekode. Tidak ada durasi klip karena tidak ada klip; yang ada adalah sesi yang berlanjut sampai seseorang berhenti berbicara.

Perbedaan itu menentukan hampir setiap baris lain dalam perbandingan ini. Cakupan Veo 3.1 adalah serangkaian batasan yang dapat menjadi acuan perencanaan alur produksi — daftar shot delapan detik, tangga perpanjangan untuk take yang lebih panjang, 24 fps tetap, dan tangga resolusi yang sudah diketahui. Output Griffin sama sekali tidak dapat dibuat storyboard-nya di muka, karena apa yang direndernya bergantung pada apa yang dilakukannya selanjutnya.

Berapa biaya Veo 3.1, di setiap tier

Tarif API Gemini yang dipublikasikan Google sudah mencakup audio, dihitung per detik output, dan tidak ada tier gratis di level Veo 3.1 mana pun. Audio tidak dapat dinonaktifkan pada API tersebut — audio dihasilkan pada setiap permintaan — yang penting karena sumber pihak ketiga menjelaskan kartu tarif Vertex AI di mana video tanpa suara berjalan sekitar setengah dari angka yang mencakup audio. Dokumentasi Google sendiri tidak menampilkan tombol tersebut. Jika tarif tanpa suara penting bagi tagihan Anda, konfirmasikan terhadap penagihan Vertex Anda sendiri, bukan halaman perbandingan, termasuk halaman ini.

• Veo 3.1 Standard — $0,40/dtk pada 720p dan 1080p, $0,60/dtk pada 4K.

• Veo 3.1 Fast — $0,10/dtk pada 720p, $0,12/dtk pada 1080p, $0,30/dtk pada 4K.

• Veo 3.1 Lite — $0,05/dtk pada 720p, $0,08/dtk pada 1080p, tanpa tier 4K.

Terapkan aturan delapan detik pada tarif tersebut dan biaya per percobaan adalah yang sebenarnya dianggarkan oleh tim kreatif: 32 sen untuk pengambilan 1080p delapan detik pada Standard, 80 sen untuk pengambilan empat detik pada resolusi yang sama karena batas bawah delapan detik tidak berlaku di bawah 720p, dan $4,80 untuk satu pengambilan 4K delapan detik. Angka terakhir itulah yang perlu direnungkan, karena pencarian dengan empat percobaan untuk satu bidikan 4K yang layak pakai hanya sedikit di bawah dua puluh dolar, dan persyaratan delapan detik berarti Anda tidak dapat menguji ide itu pada setengah durasi dengan setengah harga.

Griffin tidak memiliki harga, tidak ada tier gratis, dan tidak ada daftar tarif dalam bentuk apa pun. Griffin-Lite tersedia bagi penguji tepercaya terpilih sebagai pratinjau riset melalui formulir permintaan, tidak ada di platform Tavus, dan pengumumannya secara eksplisit menyatakan bahwa layanan ini tidak akan tersedia untuk penggunaan pelanggan saat ini. Kalimat penutup Tavus di halaman tersebut adalah bahwa Griffin akan hadir setelah perusahaan berhasil menemukan cara untuk merilisnya dengan aman. Setiap klaim dalam artikel ini yang membandingkan keduanya pada hal yang menyerupai keputusan pembelian memiliki celah pada bagian Griffin, dan riset sebanyak apa pun tidak akan mengisinya.

Apa yang sebenarnya diukur oleh kedua papan skor

Kedua model telah dievaluasi dengan instrumen yang berbeda karena alasan yang sama: sulit untuk menetapkan harga keduanya satu sama lain.

Veo 3.1 hadir di arena video milik Artificial Analysis, tempat Elo berasal dari preferensi manusia secara buta berpasangan terhadap klip pendek. Baca pada 2 Oktober 2026 di papan text-to-video dengan audio:

• Veo 3.1 — tanggal 18–21, Elo 968 (±11) dari 2.857 suara, $24,00/menit.

• Veo 3.1 Fast — peringkat 18–21, Elo 961 (±10) dari 3.595 suara, $7,20/menit.

• Veo 3.1 Lite — peringkat 21–24, Elo 949 (±11) dengan 2.762 suara, $4,80/menit. • Veo 3.1 dalam gambar-ke-video (dengan audio) — peringkat 11 dari 34, Elo 1.082 dengan 7.049 suara, $24,00/menit. Penempatan terbaiknya di papan peringkat mana pun, dan penempatan dengan suara terbanyak yang mendukungnya.

Dua hal muncul dari itu. Ketiga tingkat itu hanya terpaut sembilan belas poin Elo satu sama lain dengan interval kepercayaan yang tumpang tindih, jadi harga per detik tingkat standar yang empat kali lebih tinggi tidak menghasilkan preferensi buta yang dapat diukur. Dan lini Gemini Omni Flash milik Google yang lebih baru mengungguli setiap tingkat Veo 3.1 di papan yang sama — peringkat ke-7–ke-8 pada Elo 1.117 dari 7.801 suara dan $9,12/menit, di depan ketiga tingkat itu sementara biaya per menitnya hanya seperempat hingga seperlima dari biaya ketiga tingkat tersebut — yang merupakan pertanyaan yang harus diajukan setiap pembeli Veo 3.1, dan pertanyaan yang artikel ini bukan tempat untuk menjawabnya.

Angka-angka Griffin berasal dari VideoFDB milik NVIDIA, sebuah tolok ukur untuk percakapan audio-visual dupleks penuh yang dibangun dan dinilai secara independen oleh NVIDIA pada September 2026. Griffin-Lite memperoleh skor 3,83 dari 5 pada jalur generasi, dibandingkan dengan referensi manusia 3,92 dan 2,80 untuk sistem terbitan tertinggi berikutnya, serta 3,73 pada jalur persepsi dibandingkan dengan referensi manusia 4,20. Tavus juga melaporkan latensi audio-ke-video sesungguhnya sebesar 0,43 detik untuk generator tersebut dibandingkan dengan empat baseline difusi streaming yang dipublikasikan pada H100s, dan menggambarkannya sebagai setengah dari latensi sistem tercepat berikutnya.

Tidak ada dari kedua set tersebut yang dapat ditransfer. Elo dari pemungutan suara preferensi klip pendek tidak mengatakan apa pun tentang apakah sebuah model dapat diinterupsi; skor rubrik seorang juri atas percakapan tidak mengatakan apa pun tentang apakah sebuah klip terlihat benar pada 4K. Dan kaveatnya berlaku di kedua arah: selisih 0,09 poin Griffin terhadap referensi manusia cukup kecil pada rubrik lima poin yang dinilai oleh model bahasa sehingga "mendekati manusia" adalah pembacaan yang jujur, dan sebagian dari keunggulan persepsinya diukur terhadap sistem yang berjalan tanpa masukan video sama sekali.

A screenshot of the middle of Artificial Analysis's text-to-video-with-audio board, captured 2 October 2026, covering rows eleven to twenty-four: grok-imagine-video-1.5 at Elo 1,046, HappyHorse-1.1 at 1,045, Wan2.7-260612 at 1,032 with 4,645 votes and $9.00/min, HappyHorse-1.0 at 1,026, Kling 3.0 Omni 1080p Pro at 1,018, Kling 3.0 1080p Pro at 1,000 with 4,844 votes, PixVerse V6 at 987, Veo 3.1 at 968 with 2,857 votes and $24.00/min, Veo 3.1 Fast at 961 with 3,595 votes and $7.20/min, MAGI-2 Preview (0912) at 960, LTX-2.5 Fast at 950, Veo 3.1 Lite at 949 with 2,762 votes and $4.80/min, LTX-2.5 Pro at 944 and Vidu Q3 Pro at 941.

Asal-usul, yang merupakan pembeda produk sesungguhnya

Bagi bisnis dengan kewajiban pengungkapan apa pun, ini adalah satu-satunya bagian yang penting, dan tidak ada yang mendekati.

Output Veo 3.1 membawa SynthID bingkai demi bingkai di dalam piksel dan di dalam spektrum audio, direkayasa untuk bertahan terhadap kompresi, pengubahan ukuran, pemangkasan, dan perekaman layar, serta C2PA Content Credentials yang merekam asal-usul berkas dan riwayat penyuntingan, interoperabel dengan implementasi Adobe dan Microsoft. Google telah merilis deteksi ke dalam aplikasi Gemini, sehingga pengguna dapat mengunggah video dan bertanya apakah video itu dibuat oleh Google AI, dengan deteksi tersebut melaporkan bagian mana dari trek audio atau video yang membawa tanda itu. Batasannya nyata dan layak dinyatakan: detektor itu hanya mengenali model-model Google. Tidak ada apa pun dalam portofolio Alibaba atau Kuaishou yang sebanding, dan tidak ada apa pun dari Tavus yang juga sebanding.

A screenshot of Google DeepMind's SynthID page, captured 2 October 2026: the Google DeepMind wordmark, the "SynthID" heading, the strapline "A tool to watermark and identify content generated through AI", the section tabs Overview / How it works / Hands-on, the heading "What is SynthID?", and a "Build with Gemini" panel with a Try Gemini link.

Tavus belum menerbitkan watermark, detektor, atau pipeline kredensial konten untuk Griffin. Yang sudah diterbitkannya justru menjadi alasan mengapa semua itu dibutuhkan. Studi tatap muka itu luar biasa blak-blakan tentang mode kegagalannya: lebih dari separuh peserta mengatakan kemungkinan adanya AI tidak pernah terlintas di pikiran mereka selama panggilan berlangsung, hampir semua dari kelompok itu menyimpulkan bahwa lawan bicara mereka nyata, dan orang-orang yang memang curiga cenderung mengetahuinya dalam dua puluh detik pertama. Kelompok yang percaya rata-rata 79% yakin, sedangkan yang meragukan 81%. Itu adalah model yang sifat menipunya bukan efek samping dari kualitas generasi — melainkan kualitas generasi itu sendiri.

Tanggapan Tavus ada dalam pengumuman, bukan catatan kaki: properti yang sama yang menjadikan Human Interaction Models antarmuka yang kuat untuk komunikasi alami memungkinkan mereka menipu manusia hingga percaya bahwa itu bukan AI, prosedur penyelarasan dan keselamatan lebih lanjut diperlukan untuk perilisan yang aman, dan perusahaan sedang mengerjakan fitur pengungkapan yang aman serta bersama organisasi yang menangani keselamatan AI. Itulah sebabnya gerbang ini ada. Griffin-Lite tidak akan tersedia untuk penggunaan pelanggan saat ini.

Ketentuan enterprise yang dihadirkan Google dan tidak dihadirkan Tavus

Veo 3.1 disediakan melalui Vertex AI dengan infrastruktur regional, IAM, dan cakupan kontrak perusahaan yang menyertainya, dan Google membatasi apa yang akan dilakukan model berdasarkan yurisdiksi: melalui parameter pembuatan orang, Uni Eropa, Inggris, Swiss, dan MENA hanya mengizinkan subjek dewasa, sementara wilayah lain dapat mengizinkan semua. Itu adalah permukaan kebijakan yang terdokumentasi dan peka wilayah, dan bagi pembeli yang tunduk pada regulasi, hal itu dapat lebih berbobot daripada posisi di papan peringkat.

Ada harga yang harus dibayar atas bentuknya. ID model Veo 3.1 di Gemini API masih berupa ID pratinjau — veo-3.1-generate-preview dan varian serupanya — sementara SKU Vertex membawa penamaan ketersediaan umum, dan laporan pihak ketiga menempatkan kuota pratinjau sekitar seperlima dari kuota produksi. Google menghentikan SKU Veo 3.0 yang lebih lama pada 30 Juni 2026, yang menunjukkan kepada Anda bagaimana pergantian generasi ditangani dan layak diperhitungkan ke dalam apa pun yang dibangun di atas ID pratinjau. Sisi konsumennya juga benar-benar dibatasi: Flow memerlukan langganan Google AI Pro atau Ultra dan diblokir di Uni Eropa, Inggris Raya, India, Indonesia, Tiongkok daratan, dan Rusia, tanpa solusi alternatif VPN yang ditawarkan.

Griffin tidak memiliki ketentuan layanan untuk dibaca, karena tidak ada layanannya. Aksesnya berupa formulir permintaan dan pratinjau riset. Tavus mengatakan pihaknya sedang bekerja sama dengan organisasi keselamatan untuk evaluasi dan ingin orang-orang berpartisipasi di dalamnya, yang merupakan pendekatan riset, bukan pendekatan komersial.

Mendapatkan salah satu dari keduanya

Veo 3.1 dapat diakses melalui Gemini API, Vertex AI, Google AI Studio, dan Flow, serta melalui aplikasi Gemini hanya pada 720p. Di luar Tiongkok, ia jauh lebih mudah di antara keduanya untuk mendapatkan kunci, yang melemahkan argumen kualitas di atas dan menjadi alasan utama perbandingan ini tetap menarik meskipun angka-angkanya.

Griffin dapat diakses dengan mengajukan permintaan akses dan dipilih sebagai penguji tepercaya. Itulah keseluruhan jalur pengadaan.

Tempat router benar-benar membantu dalam pipeline Veo adalah di area yang berdampingan dengan model video, bukan di dalamnya. Model teks Google — Gemini 3.5 Flash, Gemini 3.1 Pro Preview, Gemini 3.6 Flash dan sisa lini lainnya — ada dalam katalog OrcaRouter dan dapat dipanggil pada endpoint yang kompatibel dengan OpenAI yang sama seperti 200+ model lainnya pada harga daftar penyedia dengan tambahan markup 0%. Daftar shot, perluasan prompt, pembuatan caption, catatan kontinuitas antar segmen delapan detik, dan peringkasan ulasan semuanya adalah pekerjaan teks, dan itulah lapisan di mana kemampuan menempatkan model murah pada proses massal dan model frontier pada proses final hanya memerlukan perubahan konfigurasi alih-alih migrasi. Veo 3.1 sendiri tidak kami rutekan, dan Griffin juga tidak; ada baiknya menyatakannya secara eksplisit daripada membiarkan paragraf seperti ini menyiratkan sebaliknya.

Yang mana, sejujurnya

• Pilih Veo 3.1 ketika hasil yang diserahkan memerlukan jejak provenans, ketika pembeli tunduk pada regulasi, ketika distribusi harus berupa file dengan kredensial terlampir, atau ketika 4K tidak dapat dinegosiasikan. Anggarkan batas bawah delapan detik dalam setiap model biaya, dan periksa siklus hidup ID pratinjau sebelum membangun jalur yang menghadap pelanggan di atasnya.

• Jangan pilih Griffin, karena Anda tidak bisa. Minta akses jika pertanyaan Anda adalah apakah seseorang dapat membedakan AI dari manusia dalam panggilan satu menit, atau jika Anda perlu tahu ke mana lapisan interaksi menuju sebelum Anda menetapkan peta jalan ke lapisan klip.

• Perhatikan detektornya, bukan demonya. Jika Tavus menerbitkan mekanisme pengungkapan yang bertahan dalam percakapan santai, kesenjangan antara kedua vendor ini menyempit secara signifikan. Jika tidak, Griffin adalah hasil yang layak dikutip dan Veo 3.1 tetap satu-satunya dari keduanya yang dapat Anda hadapkan kepada tim kepatuhan.

A two-column scoreboard titled "Tavus Griffin vs Google Veo 3.1 — the scoreboard". Left column "Tavus Griffin": Provenance: none published; Price: none published; Clip length: no clip - a session; Resolution: 720p at 25 fps; Loop: full duplex; Status: research preview. Right column "Google Veo 3.1": Provenance: SynthID plus C2PA; Price: $0.40 per second; Clip length: 4, 6 or 8 seconds; Resolution: 720p native; Loop: one generation; Status: generally available. Footer: "Veo 3.1 per Google's Gemini API pricing, 2 October 2026."