
Gemini Omni 1.1 Flash でより細かい制御の制作が可能に — シーン拡張、フレーム制御、4K対応が登場
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 223 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- xAINEWGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
Gemini Omni 1.1 Flash は、2026年8月27日にマルチモーダル動画モデルのプロダクションアップデートとしてリリースされ、10秒間の単一ショット生成器を、より制御しやすい編集ツールに近いものへと変えました。主要な数字は見逃しがちです。価格が変わっていないからです。720pのクリップは今も1秒あたり0.10ドルです。変わったのは、ショットのどの部分を決定できるかという点です。モデルはシーンを最大40秒まで延長でき、指定された最初と最後のフレームを尊重し、360pでプレビューをドラフト作成します(コストは720pの約3分の1)。さらに最終出力は1080pまたは4Kでレンダリングされます。これは、ローンチそのものよりもリリースノートの方が重要な意味を持つ種類のアップデートです。
このモデルは、2026年6月30日に開発者向けに公開されたGemini Omni Flashプレビューの後継であり、オリジナルを特徴づけていたすべてを維持しています。テキスト、画像、音声、動画を1回の呼び出しで処理するマルチモーダル入力、そしてゼロから再生成するのではなくクリップについて会話しながら調整する対話型マルチターン編集です。Gemini Omni 1.1 Flashが新たに加えたのは、境界の制御とコストの制御であり、これはまさに、研究デモにはなく本番パイプラインに必要なものです。
このアップデートで実際に追加されるもの
1.1を6月のプレビューから際立たせる4つの機能があり、それぞれが当初のバージョンに対する開発者たちの具体的な不満に応えています。
• シーン拡張。クリップを継続する際、モデルはこれまで最大10秒の過去のビデオコンテキストを分析できるようになりました — 以前のモデルは最後の1秒のみを参照していました。拡張は10秒単位で行われ、累計で最大40秒までとなります。これまでにない、隣接したクリップの集合ではなく、連続性のあるシーケンスとして読めるものを生成できるようになりました。
• 先頭/末尾フレーム制御。ショットの開始フレームと終了フレームを指定すると、モデルは2つのキーフレーム間の連続ビデオを生成します。これにより、カメラオービット、ズームトランジション、シームレスなループがビデオエディターなしで実現可能になります。ショットのジオメトリが推測ではなく制約条件となるためです。
• 360pドラフトモード。軽量プレビューは標準の720pよりも最大60%高速にレンダリングされ、コストはおよそ3分の1です。これはストーリーボード/イテレーションツールです。安価に十数種類のバリエーションをテストし、うまくいったものだけをフル解像度でレンダリングできます。
• 1080pおよび4K出力。最終レンダリングは元の720p上限から1080pまたは4Kにアップスケール可能で、これは「ソーシャル向けに使用可能」と「放送向けに使用可能」の違いに相当します。最大3秒のビデオリファレンスもマルチモーダル入力として含めることができ、ショット間でキャラクターとビジュアルの一貫性を維持できるようになりました。

価格設定の状況はまだ定まっていない
皆が引用する1秒あたり0.10ドルという数字は720p標準ティアのもので、プレビュー版から変更されていません。入力はトークン100万個あたり1.50ドルで、そのトークンがテキスト、画像、オーディオ、ビデオのいずれであっても同額です。テキスト出力はトークン100万個あたり9.00ドルで、オリジナルと同じ構造です。Googleがまだ公開していないのは、新しい1080pおよび4Kティアの秒単位の料金です。サードパーティの見積もりでは720pベースの1.5倍から3倍の範囲とされていますが、それはあくまで見積もりであり、Googleの公式数値ではありません。そのため、高解像度での制作予算は、Gemini APIの料金ページに公式レートが掲載されるまでは暫定的なものとして扱ってください。
360pのドラフト階層は、意図的なコスト調整手段です。720pの価格の約3分の1で、最大60%高速であるため、反復の経済性を変えます。360pで1カットのドラフトを10回行うチームの費用は、720pで3回行う場合とほぼ同じであり、これは早期に探索するか、早期に確定するかの違いに相当します。全体を通じてベンダー報告に基づいていますが、スループットの計算はGoogleが公表している数値を用いた単純な算術です。

実際にそれを呼べる場所
Gemini Omni 1.1 Flashは、Google AI StudioのGemini APIで、モデルID gemini-omni-1.1-flashとして現在利用可能です。本番ワークロード向けには、Gemini Enterprise Agent Platformを通じても提供されます。これは、Adobe、Figma、GMI Cloud、RunwayがすでにAgent Platform統合のために構築しているものと同じインターフェースです。消費者向けアクセスも並行して展開されました。Google Flowでは、世界中のすべてのGoogle AI Plus、Pro、Ultraサブスクライバー向けに全機能が提供され、Geminiアプリではシーン拡張が公開されています。言い換えれば、これはペーパー発表ではなく、API、エージェントプラットフォーム、消費者向けサーフェスがすべて同じ日に動き出したのです。
その広がりは一考に値する。オリジナルのGemini Omni Flashは、6月30日にパブリックプレビューとして開発者向けにリリースされたが、厳格な10秒の生成制限、明示的にサポートされないシーン拡張、スキーマでは受け付けられるものの正しく処理されないビデオ参照といった制約があった。1.1は、1回のアップデートでそのリストのほとんどを解消している——40秒という上限、正常に機能するビデオ参照、適切な解像度ラダーは、まさにプレビュー時代が残したギャップだ。プレビューが10秒を超えてシーンを維持できずに離脱したのであれば、今回のリリースはその具体的な不満への答えとなる。

変わっていないもの
新しいコントロールがすべて追加されたとはいえ、基盤となるプロダクトは同じモデルファミリーであり、トレードオフも同じです。出力は依然として同期オーディオ付きの短尺動画であり、これはGoogleの別のワンショット高忠実度生成モデルであるVeo 3.1とは異なり、両者は異なる用途を想定しています。シーン変更時のキャラクター一貫性は、より長いルックバックと参照動画の入力によって改善されていますが、それでも生成上の弱点であり、想定せずにテストすべきです。また、このモデルは出力にSynthIDウォーターマークを付与するため、来歴の保証が必要なツールを構築している場合には重要です。
また、まだ証明されていないことをはっきり述べる価値もある。本稿執筆時点で、Gemini Omni 1.1 Flash の独立したベンチマークが公開ビデオリーダーボードに存在するわけではない。Google の主張、つまり 360p での 60% の高速化や 1080p/4K での品質は、ベンダーによる報告にすぎない。このリリースのポイントはチャート上のスコアではなく、機能リストと価格だ。そして、そうでないと主張する人がいるとすれば、その人はラボの外では誰も生み出していない数字を引用していることになる。
なぜ「より多くのコントロール」が物語なのか
このリリースの一貫したテーマは、Googleがついにビルダーたちにハンドルを与えたことだ。長さ、フレーミング、解像度、コスト——これらはすべて、出力ではなく入力になった。それこそが、生成モデルをスロットマシンではなくツールのように感じさせる所以であり、インフラ側でコストの透明性が重要になるのも同じ理由だ。私たちが話を聞くすべての生成モデルチームは、ユニットエコノミクスと反復速度という同じ2つの問題に直面している。そして、反復コストが3分の1で済むモデルは、その両方に効く。
コスト管理というテーマこそ、ルーティングレイヤーが存在価値を発揮するところです。OrcaRouterはプロバイダーの定価をマークアップなしでそのまま通します。そのため、モデルの1秒あたりまたは1トークンあたりの料金が変われば、当社側に表示される価格も同じ日に変わります。お客様とGoogleの公表価格の間にマージンは一切ありません。1つのAPIで200以上のモデルをカバーし、プロバイダーがダウンした場合や、リリース翌日のモデルが本番稼働中にエラーを返した場合には、自動フェイルオーバーが働きます。昨日リリースされたばかりのモデルにとって、フェイルオーバーは、本番パイプラインを賭けに出すことなくテストする方法です。Gemini Omni 1.1 Flash自体はまだ当社経由でのルーティングには対応していません——ホストしていないモデルをホストしていると主張することはありません——しかし、重要なのは価格設定の規律です。そのAPIティアがサードパーティのルーティングに開放されたとき、Googleの定価で表示され、統合は書き直しではなく設定変更で完了します。
結論
Gemini Omni 1.1 Flashは、Geminiのビデオモデルを目新しいものではなく本番ツールとして使えるようにするアップデートです。シーンの40秒への延長、先頭・末尾フレームの制御、3分の1のコストの360pドラフト用ティア、そして1080p/4K出力を実現します。720pの秒間0.10ドルの価格は変わらず、高解像度の価格はまだ未発表で、独立したベンチマークもまだありません。他の誰かがモデルを実行するまでは、Googleの機能主張はベンダー報告として扱ってください。10秒では短すぎる、720pでは小さすぎるという理由でプレビューを待っていたなら、待つ必要はもうありません。コミットする前にベンチマークや公式の4K料金が必要なら、正直な答えは、まだ誰もそれを持っていないということです。
Gemini APIの料金ページで1080p/4Kの秒あたりレートを確認し、1.1アップデートの最初の独立評価を待ち、そしてGoogle Flowの加入者展開を、チームが大規模環境でのモデルの品質にどれほど自信を持っているかの代理指標として見守ってください。リリースは本物であり、コントロールも本物であり、価格差だけがまだ変動している部分です。
