
Gemini Omni 1.1 Flash, 향상된 제어로 빌드 가능 — 씬 확장, 프레임 제어, 4K 지원
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 223 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAINEWGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
2026년 8월 27일에 출시된 Gemini Omni 1.1 Flash는 멀티모달 비디오 모델의 프로덕션 업데이트로, 10초짜리 단일 촬영 생성기를 제어 가능한 편집 도구에 가깝게 변모시켰습니다. 가격이 변하지 않았기 때문에 주요 수치를 놓치기 쉽습니다. 720p 클립은 여전히 초당 $0.10입니다. 달라진 점은 여러분이 결정할 수 있는 촬영 범위입니다. 이제 모델은 장면을 최대 40초까지 확장하고, 지정된 첫 번째 및 마지막 프레임을 존중하며, 720p 비용의 약 1/3 수준으로 360p 미리보기를 초안 작성하고, 최종 출력을 1080p 또는 4K로 렌더링합니다. 출시 노트가 출시 자체보다 더 중요한 업데이트입니다.
이 모델은 2026년 6월 30일에 개발자에게 공개된 Gemini Omni Flash 프리뷰의 후속 모델로, 원본을 차별화했던 모든 것을 유지합니다: 단일 호출로 텍스트, 이미지, 오디오, 비디오를 처리하는 멀티모달 입력과, 처음부터 다시 생성하는 대신 클립에 대해 이야기하며 다듬는 대화형 멀티턴 편집입니다. Gemini Omni 1.1 Flash가 추가하는 것은 경계에서의 제어와 비용에 대한 제어로, 이는 정확히 프로덕션 파이프라인에 필요하고 연구 데모에는 필요하지 않은 것입니다.
업데이트가 실제로 추가하는 내용
1.1을 6월 프리뷰와 구분 짓는 네 가지 기능이 있으며, 각각은 빌더들이 원본에 대해 가졌던 구체적인 불만에 대한 해답입니다.
• 장면 확장. 이제 모델은 클립을 계속할 때 최대 10초의 이전 비디오 컨텍스트를 분석할 수 있습니다 — 이전 버전의 모델은 마지막 1초만 참조했습니다. 확장은 10초 단위로 이루어지며, 누적 최대 40초까지 가능합니다. 이제 처음으로 연속성이 있는 시퀀스로 읽히는 결과물을 만들 수 있으며, 단순히 인접한 클립들의 집합이 아닌 결과물을 만들 수 있습니다.
첫 번째/마지막 프레임 제어. 샷의 시작 및 종료 프레임을 지정하면 모델이 두 키프레임 사이의 연속적인 비디오를 생성합니다. 이로 인해 비디오 편집기 없이도 카메라 궤도, 줌 전환, 끊김 없는 루프가 가능해집니다. 이제 샷의 지오메트리가 추측이 아닌 제약 조건이 되기 때문입니다.
• 360p 초안 모드. 가벼운 미리보기는 표준 720p보다 최대 60% 더 빠르게 렌더링되며, 비용은 약 1/3 수준입니다. 이는 스토리보드/반복 작업 도구입니다. 저렴하게 수십 가지 변형을 테스트한 다음, 실제로 작동하는 하나만 전체 해상도로 렌더링하면 됩니다.
• 1080p 및 4K 출력. 최종 렌더링은 원래 720p 상한에서 1080p 또는 4K로 업스케일할 수 있으며, 이는 '소셜용으로 사용 가능한' 수준과 '방송용으로 사용 가능한' 수준의 차이입니다. 최대 3초 길이의 비디오 참조 자료도 이제 멀티모달 입력으로 포함하여 샷 간 캐릭터와 시각적 일관성을 유지할 수 있습니다.

가격 상황은 아직 결정되지 않고 있다.
{{1}}모두가 인용하는 초당 0.10달러 수치는 720p 표준 등급에 해당하며, 프리뷰에서와 동일하게 유지됩니다.{{/1}} {{2}}입력은 토큰이 텍스트, 이미지, 오디오, 비디오 중 무엇이든 백만 토큰당 1.50달러이며, 텍스트 출력은 백만 토큰당 9.00달러로 원본과 동일한 구조입니다.{{/2}} {{3}}Google이 아직 공개하지 않은 것은 새로운 1080p 및 4K 등급의 초당 가격입니다. 제3자 추정치는 720p 기본의 1.5배에서 3배 범위로 보지만, 이는 Google의 공식 수치가 아닌 추정치이므로 공식 요금이 Gemini API 가격 페이지에 표시될 때까지 고해상도의 모든 제작 예산은 잠정적인 것으로 간주해야 합니다.{{/3}}
360p 드래프팅 티어는 의도적인 비용 레버입니다. 720p 가격의 약 1/3이면서 최대 60% 더 빠르므로 반복 작업의 비용 구조를 바꿉니다. 360p로 샷의 초안을 10번 만드는 팀은 720p로 3번 만드는 것과 거의 같은 비용을 지출하며, 이는 탐색과 조기 확정 사이의 차이를 만듭니다. 전반적으로 벤더가 보고한 수치이지만, 처리량 계산은 Google이 자체적으로 공개한 수치로 단순 산술한 것입니다.

실제로 그렇게 부를 수 있는 곳
Gemini Omni 1.1 Flash는 현재 Google AI Studio의 Gemini API를 통해 모델 ID gemini-omni-1.1-flash로 제공되며, 프로덕션 워크로드를 위해 Gemini Enterprise Agent Platform에서도 이용할 수 있습니다. 이 플랫폼은 Adobe, Figma, GMI Cloud, Runway가 이미 자사 Agent Platform 통합을 위해 구축 중인 것과 동일한 인터페이스입니다. 소비자용 액세스도 동시에 출시되었습니다. Google Flow는 전 세계 모든 Google AI Plus, Pro, Ultra 구독자에게 전체 기능을 제공하며, Gemini 앱에서는 장면 확장(scene extension)이 제공됩니다. 즉, 이는 단순한 종이 출시(paper launch)가 아닙니다. API, 에이전트 플랫폼, 소비자 인터페이스가 모두 같은 날 공개되었습니다.
그 폭은 잠깐 살펴볼 가치가 있습니다. 원래 Gemini Omni Flash는 6월 30일에 공개 미리보기 라벨을 달고 개발자에게 배포되었으며, 10초로 고정된 생성 제한, 명시적으로 지원되지 않는 장면 확장, 그리고 스키마에서는 허용되지만 제대로 처리되지 않는 비디오 참조가 있었습니다. 1.1은 한 번의 업데이트로 그 목록의 대부분을 해결합니다. 40초 상한, 작동하는 비디오 참조, 적절한 해상도 사다리는 미리보기 시대가 남겨둔 바로 그 공백입니다. 미리보기가 10초를 넘어 장면을 유지하지 못해 실망했다면, 이번 릴리스가 바로 그 특정 불만에 대한 답입니다.

변하지 않은 것
새로운 제어 기능에도 불구하고, 기본 제품은 동일한 모델 제품군으로 동일한 트레이드오프를 가진다. 출력은 여전히 동기화된 오디오가 포함된 숏폼 비디오로, Google의 별도 원샷 고충실도 생성기인 Veo 3.1과는 다르며, 둘은 서로 다른 작업을 대상으로 한다. 장면 전환 시 캐릭터 일관성은 더 긴 룩백과 참조 비디오 입력 덕분에 개선되지만, 여전히 생성상의 약점이므로 가정하지 말고 테스트해야 한다. 또한 모델은 출력에 SynthID 워터마킹을 적용하므로, 출처 보증이 필요한 도구를 구축하는 경우 중요하다.
또한 아직 입증되지 않은 점을 분명히 밝힐 필요가 있다: 이 글을 쓰는 시점 현재, 공개 동영상 리더보드에는 Gemini Omni 1.1 Flash에 대한 독립적인 벤치마크가 없다. 구글의 주장(360p에서 60% 속도 향상, 1080p/4K에서의 품질)은 벤더가 직접 보고한 수치일 뿐이다. 이번 릴리스의 핵심은 차트의 점수가 아니라 기능 목록과 가격이며, 다르게 말하는 사람은 연구소 밖에서 아무도 만들어낸 적 없는 숫자를 인용하고 있는 것이다.
왜 '더 많은 통제'가 핵심 이야기인가
이번 릴리스의 핵심은 Google이 마침내 개발자에게 통제 수단을 부여했다는 점입니다. 길이, 구성, 해상도, 비용이 이제 출력값이 아닌 입력값이 되었습니다. 이 점이야말로 생성 모델을 슬롯머신이 아닌 도구처럼 느끼게 만드는 요소이며, 인프라 측면에서 비용 투명성이 중요한 것도 같은 이유입니다. 우리가 대화를 나누는 모든 생성 모델 팀이 동일한 두 가지 문제, 즉 단위 경제성과 반복 속도와 씨름하고 있는데, 반복 비용이 3분의 1로 줄어드는 모델은 두 문제를 동시에 해결합니다.
비용 관리라는 주제가 바로 라우팅 계층이 제 역할을 하는 부분입니다. OrcaRouter는 공급업체의 공시 가격을 마크업 없이 그대로 전달하므로, 모델의 초당 또는 토큰당 요금이 변경되면 당사 쪽에 표시되는 가격도 같은 날 변경됩니다. 고객과 Google의 공시 가격 사이에 어떤 마진도 없습니다. 하나의 API로 200개 이상의 모델을 지원하며, 공급업체가 다운되거나 하루 된 모델이 운영 중 오류를 반환하면 자동 장애 조치가 수행됩니다. 어제 막 출시된 모델의 경우, 장애 조치는 라이브 파이프라인을 걸지 않고 테스트할 수 있는 방법입니다. Gemini Omni 1.1 Flash 자체는 아직 당사를 통해 라우팅할 수 없습니다. 호스팅하지 않는 모델을 호스팅한다고 주장하지 않기 때문입니다. 그러나 핵심은 가격 규율입니다. 해당 API 티어가 제3자 라우팅에 개방되면 Google 공시 가격으로 표시될 것이며, 통합은 재작성이 아닌 구성 변경으로 이루어집니다.
결론
Gemini Omni 1.1 Flash는 Gemini의 비디오 모델을 신기한 데모가 아니라 실제 프로덕션 도구로 사용할 수 있게 만드는 업데이트다. 40초로 확장된 장면 길이, 첫/마지막 프레임 제어, 비용이 3분의 1인 360p 초안 등급, 그리고 1080p/4K 출력이 추가됐다. 초당 0.10달러인 720p 가격은 그대로이고, 고해상도 요금은 여전히 미공개이며, 독립적인 벤치마크도 아직 없다. 다른 누군가가 모델을 직접 돌려보기 전까지는 Google의 기능 주장을 공급업체 보고 수치로 간주해야 한다. 10초가 너무 짧고 720p가 너무 작아서 프리뷰를 기다리고 있었다면, 이제 기다림은 끝났다. 투자하기 전에 벤치마크나 공식 4K 요금이 필요하다면, 솔직한 답변은 아직 그걸 가진 사람이 아무도 없다는 것이다.
Gemini API 가격 책정 페이지에서 1080p/4K 초당 요금을 주시하고, 1.1 업데이트에 대한 최초의 독립 평가를 기다리며, Google Flow의 구독자 롤아웃을 팀이 모델 품질에 대해 규모에서 얼마나 자신감을 가지고 있는지를 가늠하는 대리 지표로 지켜보십시오. 출시는 실제이며, 통제도 실제이고, 요금 격차만이 여전히 변동 중인 유일한 부분입니다.
