
Gemini Omni 1.1 Flash 讓您以更多控制進行創作 — 場景擴展、幀控制與 4K 登場
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 223 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
Gemini Omni 1.1 Flash 於 2026 年 8 月 27 日作為多模態影片模型的正式版更新推出,將原本只能生成 10 秒單一鏡頭的生成器,轉變為更接近可控編輯工具的存在。最引人注目的數字很容易被忽略,因為價格沒有變動:720p 片段每秒仍為 $0.10 美元。改變的是你對畫面的掌控程度——模型現在可將場景延長至 40 秒,遵循指定的首幀與末幀,以約 720p 三分之一的成本在 360p 下草擬預覽,並以 1080p 或 4K 渲染最終輸出。這類更新的重點在於版本說明,而非發布本身。
該模型是 2026 年 6 月 30 日向開發人員開放的 Gemini Omni Flash 預覽版的後繼產品,它保留了讓原版與眾不同的一切:多模態輸入——在單一呼叫中處理文字、圖像、音訊與影片——以及對話式多輪編輯,你透過討論來完善片段,而非從頭重新生成。Gemini Omni 1.1 Flash 新增的是邊界控制與成本控制,這正是生產管線所需、而研究示範所不需要的。
這次更新實際上新增了什麼
四項功能將 1.1 版與六月預覽版區分開來,每一項都回應了開發者對原始版本提出的具體抱怨。
• 場景延伸。模型現在在延續片段時,可分析最多 10 秒的先前影片內容——早期版本的模型只參考最後一秒。延伸以 10 秒為單位,累計最多可達 40 秒。這是首次你能產出具有連續性、讀起來像一段連貫序列的內容,而非一組彼此相鄰的片段。
• 首/尾幀控制。指定一個鏡頭的起始幀和結束幀,模型就會在兩個關鍵幀之間生成連續影片。這使得攝影機環繞、縮放轉場和無縫循環無需影片剪輯軟體即可實現,因為鏡頭的幾何結構現在是約束條件,而不是猜測。
• 360p 草稿模式。輕量預覽的渲染速度比標準 720p 快最多 60%,成本約為三分之一。這是一個分鏡/迭代工具:你可以低成本測試十幾種變化,然後只以完整解析度渲染可行的那一個。
• 1080p 和 4K 輸出。最終渲染可從原始的 720p 上限升級至 1080p 或 4K,這正是「可用於社交媒體」與「可用於廣播」之間的差異。現在也可將長達三秒的影片參考作為多模態輸入,以維持跨鏡頭的角色與視覺一致性。

定價情況仍在塵埃落定中。
大家常引用的每秒0.10美元數字,是720p標準方案,與預覽版相同。輸入端無論是文字、圖片、音訊或影片,皆為每百萬個token 1.50美元;文字輸出則為每百萬個token 9.00美元——結構與原始版本一致。Google尚未公布新的1080p與4K方案之每秒計價;第三方估算落在720p基礎方案的1.5倍至3倍區間,但那些只是估算,並非Google官方數字,因此在官方費率出現於Gemini API定價頁面之前,請將任何高解析度的製作預算視為暫定值。
360p 草稿層級是刻意的成本槓桿:價格約為 720p 的三分之一,速度最高可快 60%,改變了迭代的經濟效益。一個團隊用 360p 對同一個鏡頭進行十次草稿的花費,約等於用 720p 進行三次草稿——這就是及早探索與及早定案之間的差別。全程數據由供應商回報,但吞吐量的計算只是基於 Google 自家公布數據的簡單算術。

你實際上可以稱呼它的地方
Gemini Omni 1.1 Flash 現已透過 Gemini API 在 Google AI Studio 中提供,模型 ID 為 gemini-omni-1.1-flash,並可透過 Gemini Enterprise Agent Platform 用於正式工作負載——Adobe、Figma、GMI Cloud 和 Runway 已在整合其 Agent Platform 時使用相同介面。消費者端存取也已同步推出:Google Flow 已為全球所有 Google AI Plus、Pro 和 Ultra 訂閱者提供完整功能,而場景擴充功能也已在 Gemini App 中上線。換言之,這並非紙上發表——API、Agent 平台與消費者端介面都在同一天正式上線。
這種廣度值得花點時間檢視。最初的 Gemini Omni Flash 於 6 月 30 日以公開預覽的形式向開發者推出,當時有嚴格的 10 秒生成上限、明確不支援場景延伸,且影片參考雖獲 schema 接受,卻未被正確處理。1.1 在一次更新中清除了該清單的大部分項目——40 秒上限、可用的影片參考,以及合適的解析度階梯,正是預覽時代留下的缺口。如果你因為預覽版無法讓場景維持超過十秒而放棄,那麼這個版本正是針對那項具體抱怨的解答。

什麼沒有改變
儘管有所有這些新的控制功能,底層產品仍然是同一個模型家族,具有相同的取捨。輸出仍然是帶有同步音訊的短格式影片——這不是 Veo 3.1,Google 獨立的單次高保真生成器,兩者針對不同的任務。跨場景的角色一致性因更長的回顧視窗和參考影片輸入而有所改善,但這仍然是生成上的弱點,你應該測試而非假設。此外,該模型在輸出上帶有 SynthID 浮水印,如果你正在建構需要來源保證的工具,這點就很重要。
還有一點也值得直白地說清楚,那就是目前尚未獲得證實的部分:截至本文撰寫之際,公開的影片排行榜上尚無 Gemini Omni 1.1 Flash 的獨立基準測試。Google 所宣稱的——360p 時加快 60%、1080p/4K 下的畫質——皆為供應商自行報告的數據。這次發布的賣點在於功能列表與價格,而非圖表上的分數;任何跟你說得不一樣的人,其實是在引用一個實驗室以外無人產出的數字。
為什麼「更多控制」才是重點
這次發布的貫穿主線,是 Google 終於給了建構者操控手柄:長度、構圖、解析度和成本,現在都是輸入參數,而非生成結果。這正是讓生成式模型感覺像工具、而非老虎機的關鍵;也正因如此,成本透明度在基礎設施層面至關重要。我們接觸過的每一個生成式模型團隊,都在與同樣的兩個問題搏鬥——單位經濟效益與迭代速度——而一個迭代成本僅為三分之一的模型,正好能同時攻克這兩者。
成本控制的主題正是路由層證明其價值之所在。OrcaRouter 以零加價的方式直接轉傳供應商的定價列表價格,因此當某個模型按秒或按 token 的費率變動時,你在我們這邊看到的價格會在當天同步更新——你與 Google 公布的數字之間沒有任何價差。單一 API 涵蓋 200 多種模型;若供應商故障,或某個才推出不久的模型在生產途中回報錯誤,系統會自動進行故障轉移;對於昨天才上線的模型,故障轉移正是測試它的方式,而不必拿整個線上管道來賭。Gemini Omni 1.1 Flash 本身目前還無法透過我們進行路由——我們不會謊稱代管我們實際上沒有的模型——但定價紀律才是重點:當其 API 等級對第三方路由開放時,它會以 Google 的定價列表價格出現,而且整合只是變更設定,而非重寫程式。
底線
Gemini Omni 1.1 Flash 是讓 Gemini 的影片模型從新奇玩意變成生產工具的更新:場景延長至 40 秒、首/尾幀控制、價格僅三分之一的新 360p 草稿層級,以及 1080p/4K 輸出。每秒 0.10 美元的 720p 價格維持不變,高解析度定價仍未公布,目前也沒有獨立的基準測試——在其他人實際運行該模型之前,請將 Google 的功能宣稱視為廠商自行報告。如果你之前因為十秒太短、720p 太小而觀望預覽版,現在可以不用再等了。如果你需要在投入之前看到基準測試或官方 4K 費率,老實說,目前還沒有人有這些數據。
關注 Gemini API 定價頁面上的 1080p/4K 每秒費率,留意 1.1 更新的首批獨立評測,並觀察 Google Flow 的訂閱用戶推廣情況,以此作為團隊對模型大規模品質信心程度的參考指標。這次發布是真實的,管控措施也是真實的,唯一仍在變動的部分只有定價差距。
