
Tavus Griffin vs Google Veo 3.1: 하나는 모든 프레임에 워터마크를 표시하고, 다른 하나는 방 안 사람들의 48%를 속였다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 223 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAINEWGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
을 나란히 놓고 보면Tavus Griffin과 Google Veo 3.1초당 가격, Elo, 클립 길이 같은 통상적인 비교는 즉시 무너진다. 둘 중 하나만 가격이 매겨져 있고, 구매자가 찾아볼 수 있는 어떤 기준으로든 점수가 매겨지는 것도 둘 중 하나뿐이기 때문이다. 하지만 그 밑에는 진짜 축이 하나 있고, 그것은 품질이 아니다. 합성 미디어에 대한 구글의 답은 그것을 탐지 가능하게 만드는 것이다. 모든 Veo 3.1 결과물에는 SynthID가 담긴다. 프레임 단위로 픽셀에, 그리고 오디오 스펙트럼에 새겨지는 보이지 않는 워터마크이며, 파일 출처를 기록하는 C2PA Content Credentials도 함께다. 게다가 구글은 Gemini 앱에 탐지기를 탑재해, 사용자가 어떤 클립을 구글 AI가 만든 것인지 물어볼 수 있게 했다. Tavus Griffin이 제품이 아니라 프리뷰로 존재하는 이유로 내세우는 설명은 그 거울상이다. Tavus 자체의 실시간 연구에서 참가자 54명 중 26명이 1분짜리 영상 통화를 마친 뒤 상대가 실제 사람이라고 믿었는데, 회사의 이전 스택에서는 41명 중 1명이었다. 그리고 Tavus는 자신이 무엇인지 공개하는 방법을 알아낼 때까지 이 모델을 내놓지 않고 있다고 말한다. 이 벤더 중 하나는 탐지 기능을 판다. 다른 하나는 현재 탐지가 중요한 이유 그 자체이며, 그것을 알고 있다.
상반된 전제 위에 세워진 두 제품
Veo 3.1은 의도적으로 범위가 좁은 클립 생성기다. Google의 Gemini API에서 24fps로 한 회당 4초, 6초 또는 8초를 생성하며, 기본 해상도는 720p이고, 1080p와 4K는 2026년 1월 업데이트에서 추가된 업스케일링 과정을 통해 제공된다. 확장은 회당 7초를 더하고 최대 20회까지 반복할 수 있어 이론상 약 148초까지 가능하지만, 입력은 16:9 또는 9:16의 720p에서 141초 이하인 Veo 생성 클립이어야 하며, 8초 길이는 확장, 참조 이미지 입력, 그리고 720p를 초과하는 모든 경우에 필수다. 4초짜리 1080p 클립은 만들 수 없다. 출력물은 워터마크가 표시된, 소유권이 있는 파일이며 서명된 출처 기록이 첨부된다.
Griffin은 파일을 생성하지 않습니다. 그것은 대화를 실행합니다. Continuous Conversational Modeling 엔진은 오디오와 비디오를 입력받아 1초 미만 간격으로 대화를 재평가하며, 침묵할지, 신호를 보낼지, 맞장구를 칠지, 발언권을 가져갈지 선택하고, 스트리밍 음성 생성기와 스트리밍 비디오 생성기를 함께 구동하는 표현 제어를 출력합니다. 비디오 생성기는 단일 참조 사진으로부터 25 fps로 한 번에 하나의 잠재 변수씩 320ms 청크 단위로 720p를 생성하고, 각 청크를 디코딩되는 대로 재생합니다. 클립이 없으므로 클립 길이도 없습니다. 누군가 말을 멈출 때까지 계속되는 세션이 있을 뿐입니다.
그 차이가 이 비교의 거의 모든 다른 항목을 좌우한다. Veo 3.1의 범위는 제작 파이프라인이 이를 전제로 계획을 세울 수 있는 일련의 제약 조건이다 — 8초 단위의 숏 리스트, 더 긴 테이크를 위한 연장 사다리, 고정 24fps, 알려진 해상도 사다리. Griffin의 출력은 애초에 미리 스토리보드로 만들 수 있는 대상이 전혀 아니다. 렌더링되는 내용이 다음에 사람이 무엇을 하느냐에 달려 있기 때문이다.
모든 등급에서의 Veo 3.1 비용
Google이 공개한 Gemini API 요금은 오디오 포함 기준이고 출력 1초당 과금되며, Veo 3.1의 어떤 등급에도 무료 티어는 없습니다. 해당 API에서는 오디오를 비활성화할 수 없습니다. 모든 요청에서 오디오가 생성됩니다. 이는 중요한데, 제3자 출처가 무음 영상이 오디오 포함 요금의 약 절반에 해당하는 Vertex AI 요금표를 설명하고 있기 때문입니다. Google 자체 문서에는 그 전환 옵션이 공개되어 있지 않습니다. 무음 요금이 청구서에 중요하다면, 이 페이지를 포함한 어떤 비교 페이지가 아니라 본인의 Vertex 청구 내역과 대조해 확인하세요.
• Veo 3.1 Standard — 720p 및 1080p에서 초당 $0.40, 4K에서 초당 $0.60.
• Veo 3.1 Fast — 720p 기준 초당 $0.10, 1080p 기준 초당 $0.12, 4K 기준 초당 $0.30.
• Veo 3.1 Lite — 720p에서 초당 $0.05, 1080p에서 초당 $0.08, 4K 등급은 없음.
그 요금에 8초 규칙을 대입해 보면, 시도당 비용은 크리에이티브 팀이 실제로 예산에 잡는 금액입니다: Standard에서 8초 1080p 테이크는 32센트, 같은 해상도의 4초 테이크는 80센트인데, 8초 하한은 720p 미만에는 적용되지 않기 때문입니다. 그리고 단일 8초 4K 테이크는 4.80달러입니다. 마지막 숫자는 곱씹어 볼 만한데, 쓸 만한 4K 샷 하나를 찾기 위한 네 번의 시도가 20달러에 조금 못 미치기 때문이며, 8초 요건은 절반 길이로 절반 가격에 그 아이디어를 테스트할 수 없다는 뜻입니다.
Griffin에는 가격도, 무료 티어도, 어떤 종류의 요금표도 없습니다. Griffin-Lite는 요청 양식을 통해 일부 신뢰할 수 있는 테스터에게 연구 프리뷰로 제공되며, Tavus 플랫폼에는 없고, 이번에는 고객 사용용으로 제공되지 않을 것이라는 점을 발표에서 분명히 밝히고 있습니다. 해당 페이지에서 Tavus의 마지막 문장은 회사가 Griffin을 안전하게 출시할 방법을 마련하면 Griffin이 출시될 것이라는 내용입니다. 두 제품을 구매 결정에 가까운 어떤 기준으로든 비교하는 이 기사의 모든 주장은 Griffin 쪽 절반에 구멍이 있으며, 아무리 조사해도 그 구멍은 메워지지 않습니다.
두 스코어보드가 실제로 측정하는 것
두 모델이 서로를 기준으로 가격을 매기기 어려운 것과 같은 이유로, 두 모델은 서로 다른 수단으로 평가되어 왔다.
Veo 3.1은 Artificial Analysis의 비디오 아레나에 자리 잡고 있으며, 여기서 Elo는 짧은 클립에 대한 블라인드 쌍대 비교 인간 선호도에서 산출됩니다. 2026년 10월 2일, 오디오가 포함된 텍스트-투-비디오 리더보드에서 확인하세요:
• Veo 3.1 — 18–21위, Elo 968 (±11), 2,857표 기준, $24.00/분.
• Veo 3.1 Fast — 18~21위, 3,595표 기준 Elo 961(±10), 분당 $7.20.
• Veo 3.1 Lite — 21~24위, Elo 949(±11), 2,762표 기준, 분당 $4.80. • 이미지 투 비디오(오디오 포함) 부문의 Veo 3.1 — 34개 중 11위, Elo 1,082, 7,049표 기준, 분당 $24.00. 모든 리더보드에서 최고 순위이자, 가장 많은 표가 뒷받침된 기록입니다.
그로부터 두 가지가 나온다. 세 티어 모두 서로 19 Elo 포인트 이내에 있고 신뢰구간이 겹치므로, 스탠더드 티어의 네 배 높은 초당 가격이 측정 가능한 블라인드 선호를 사 주지는 않는다. 그리고 구글 자체의 더 새로운 Gemini Omni Flash 라인은 같은 리더보드에서 모든 Veo 3.1 티어를 앞선다 — 7,801표에서 Elo 1,117로 7~8위, 분당 $9.12로, 세 티어 모두를 앞서면서 분당 비용은 그 4분의 1에서 5분의 1에 불과하다 — 이는 모든 Veo 3.1 구매자가 물어야 할 질문이며, 이 글에서 답할 자리는 아니다.
Griffin의 수치는 NVIDIA가 2026년 9월에 독자적으로 구축하고 채점한 전이중 오디오-비주얼 대화용 벤치마크인 VideoFDB에서 나온 것입니다. Griffin-Lite는 생성 트랙에서 5점 만점에 3.83점을 기록했는데, 이는 인간 참조 점수 3.92점 및 그다음으로 높은 공개 시스템의 2.80점과 비교되는 점수이며, 인식 트랙에서는 4.20점의 인간 참조 점수와 비교해 3.73점을 기록했습니다. Tavus는 또한 H100에서 네 가지 공개 스트리밍 확산 베이스라인과 비교해 생성기의 실제 오디오-비디오 지연 시간이 0.43초라고 보고하며, 이를 두 번째로 빠른 시스템의 절반이라고 설명합니다.
두 세트 모두 전이되지 않는다. 짧은 클립 선호 투표에서 나온 Elo는 모델이 중단될 수 있는지에 대해 아무것도 말해주지 않는다. 대화에 대한 심사자의 루브릭 점수는 클립이 4K에서 제대로 보이는지에 대해 아무것도 말해주지 않는다. 그리고 주의사항은 양방향으로 적용된다: Griffin이 인간 기준과 보이는 0.09점 차이는 언어 모델이 채점한 5점 루브릭에서 ‘인간에 가깝다’는 것이 정직한 해석일 만큼 작으며, 지각 우위의 일부는 비디오 입력을 전혀 사용하지 않고 작동하는 시스템을 상대로 측정된 것이다.

프로버넌스, 그것이 진정한 제품 차별점
공시 의무가 있는 기업이라면, 이 섹션이 유일하게 중요한 부분이며, 그 차이는 비교할 수 없을 정도입니다.
Veo 3.1 출력은 픽셀과 오디오 스펙트럼에 프레임별로 SynthID를 담고 있으며, 압축, 크기 조정, 자르기, 화면 녹화에도 견디도록 설계되었다. 또한 파일 출처와 편집 이력을 기록하는 C2PA Content Credentials를 포함하며, 이는 Adobe 및 Microsoft의 구현과 상호 운용된다. Google은 Gemini 앱에 탐지 기능을 탑재했기에 사용자는 동영상을 업로드하고 Google AI가 만든 것인지 물어볼 수 있으며, 탐지 기능은 오디오 또는 비디오 트랙의 어느 부분에 마크가 들어 있는지 보고한다. 한계는 분명하며 짚고 넘어갈 가치가 있다. 그 탐지기는 Google의 모델만 인식한다. Alibaba나 Kuaishou가 보유한 것 중 이에 필적하는 것은 없으며, Tavus의 것도 마찬가지다.

Tavus는 Griffin을 위한 워터마크도, 탐지기도, 콘텐츠 자격 증명 파이프라인도 공개하지 않았다. 공개한 것은 그것이 왜 필요한지에 대한 이유다. 대면 실험 연구는 이 실패 양상에 대해 이례적으로 노골적이다: 절반이 넘는 참가자가 통화 중에 상대가 AI일 가능성을 떠올리지 못했다고 말했고, 그 집단의 거의 전원이 상대가 진짜 사람이라고 결론 내렸으며, 의심한 사람들은 대개 첫 20초 안에 그 결론에 도달하는 경향이 있었다. 믿은 쪽은 평균 79%, 의심한 쪽은 81%의 확신을 보였다. 이는 기만성이 생성 품질의 부작용이 아니라, 바로 그 생성 품질 자체인 모델이다.
Tavus의 대응은 각주가 아니라 발표문에 담겨 있습니다: Human Interaction Models를 자연스러운 의사소통을 위한 강력한 인터페이스로 만드는 바로 그 속성 때문에 사람이 그것을 AI가 아니라고 믿도록 속일 수 있으며, 안전한 출시를 위해서는 추가적인 정렬 및 안전 절차가 필요합니다. 또한 이 회사는 안전한 공개 기능을 개발하고 AI 안전을 다루는 조직들과 협력하고 있습니다. 그렇기 때문에 이 게이트가 존재합니다. Griffin-Lite는 현재 고객이 사용할 수 없습니다.
구글이 제시하지만 Tavus는 제시하지 않는 엔터프라이즈 조건
Veo 3.1은 지역 인프라, IAM, 그리고 그로 인해 수반되는 엔터프라이즈 계약 체계를 갖춘 Vertex AI를 통해 제공되며, Google은 관할권별로 모델이 수행할 수 있는 작업을 제한합니다. 인물 생성 매개변수를 통해 EU, 영국, 스위스, MENA는 성인 인물만 허용하는 반면, 다른 지역은 모두 허용할 수 있습니다. 이는 문서화된, 지역을 인식하는 정책 체계이며, 규제 업종의 구매자에게는 리더보드 순위보다 더 중요할 수 있습니다.
그 형태에는 대가가 따른다. Gemini API에서 Veo 3.1의 모델 ID는 여전히 프리뷰 ID다 — veo-3.1-generate-preview와 그 형제 모델들이 그러한데, Vertex SKU는 정식 제공(GA) 명명을 사용하며, 제3자 보고서에 따르면 프리뷰 할당량은 프로덕션 할당량의 약 5분의 1 수준이다. Google은 2026년 6월 30일에 이전 Veo 3.0 SKU를 폐기했는데, 이는 세대 교체가 어떻게 처리되는지를 보여주며 프리뷰 ID 위에 구축된 모든 것의 가격 산정에 반영해 볼 가치가 있다. 소비자용 접점도 실질적으로 제한적이다. Flow는 Google AI Pro 또는 Ultra 구독이 필요하며 EU, 영국, 인도, 인도네시아, 중국 본토, 러시아에서 차단되고, VPN 우회 방법도 제공되지 않는다.
Griffin에는 읽을 서비스 약관이 없다. 서비스가 없기 때문이다. 접근은 요청 양식과 연구 프리뷰다. Tavus는 안전 기관들과 함께 평가를 진행 중이며 사람들이 그 평가에 참여하기를 원한다고 밝혔다. 이는 상업적 태도라기보다 연구적 태도이다.
둘 중 하나를 얻는 것
Veo 3.1은 Gemini API, Vertex AI, Google AI Studio, Flow를 통해 이용할 수 있으며, Gemini 앱을 통해서는 720p로만 이용할 수 있습니다. 중국 밖에서는 두 제품 중 키를 발급받기가 단연 더 쉬운 쪽이며, 이는 위의 품질 주장과 상충되고 수치에도 불구하고 이 비교가 계속 흥미로운 주된 이유입니다.
Griffin은 액세스 요청을 제출하고 신뢰할 수 있는 테스터로 선정되면 이용할 수 있습니다. 이것이 전체 조달 경로입니다.
라우터가 Veo 파이프라인에서 진정으로 도움이 되는 지점은 비디오 모델 안이 아니라 그 옆입니다. Google의 텍스트 모델 — Gemini 3.5 Flash, Gemini 3.1 Pro Preview, Gemini 3.6 Flash 및 해당 라인의 나머지 모델 — 은 OrcaRouter 카탈로그에 있으며 200개 이상의 다른 모델과 동일한 OpenAI 호환 엔드포인트에서 호출할 수 있습니다제공업체 정가로, 0% 마크업이 추가되어. 숏 리스트, 프롬프트 확장, 캡션 생성, 8초 세그먼트 간의 연속성 노트, 리뷰 요약은 모두 텍스트 작업이며, 바로 그 계층에서 대량 처리에는 저렴한 모델을, 최종 처리에는 최전선 모델을 투입하는 것이 마이그레이션이 아니라 설정 변경 하나로 해결됩니다. Veo 3.1 자체는 저희가 라우팅하지 않으며 Griffin도 마찬가지입니다. 이와 같은 문단이 그렇지 않은 듯한 인상을 주지 않도록 이 점을 분명히 밝히는 것이 좋겠습니다.
솔직히, 어느 쪽이야?
• 산출물에 출처 추적이 필요할 때, 구매자가 규제 대상일 때, 배포가 자격 증명이 첨부된 파일이어야 할 때, 또는 4K가 양보 불가일 때 Veo 3.1을 선택하세요. 모든 비용 모델에서 8초 하한을 예산에 반영하고, 고객 대면 경로를 그 위에 구축하기 전에 프리뷰 ID 수명 주기를 확인하세요.
• Griffin을 선택하지 마세요. 선택할 수 없기 때문입니다. 당신의 질문이 1분 통화에서 사람이 AI와 인간을 구분할 수 있는지 여부이거나, 클립 레이어에 로드맵을 확정하기 전에 인터랙션 레이어가 어디로 가는지 알아야 하는 경우라면 액세스 권한을 요청하세요.
• 데모가 아니라 탐지기를 지켜보라. Tavus가 일상적인 대화에서도 견뎌내는 공개 메커니즘을 발표한다면, 이 두 공급업체 사이의 격차는 상당히 좁아진다. 그렇지 않다면 Griffin은 인용할 가치가 있는 결과이고, Veo 3.1은 컴플라이언스 팀 앞에 내놓을 수 있는 둘 중 유일한 것으로 남는다.

