Gemini Omni 1.1 Flash 發布文章的主視覺標題卡。大標題寫著『Gemini Omni 1.1 Flash — 讓您更能掌控影片』。四個功能標籤分別為:『場景延伸至40秒』、『首幀/末幀控制』、『360p 草稿,成本約 1/3』、『1080p 與 4K 輸出』。頁尾寫著『2026年8月27日透過 Gemini API 發布。』OrcaRouter 標誌合成在右下角。
Guides & Insights

Gemini Omni 1.1 Flash 進入生產就緒:40秒場景、幀控制與4K成品

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

把影片片段的最後一秒交給影片模型,要求它延續鏡頭,你就是在賭它的記憶力。這正是 Gemini Omni 1.1 Flash —— Go​gle 於 2026 年 8 月 27 日發布的正式版更新 —— 所要消除的問題:在延伸場景時,它不再只回看一秒的畫面,而是現在能讀取多達十秒。同時,Go​gle 也將用戶最常要求的控制選項從實驗欄位中移出:首幀與末幀條件控制、一個 360p 草稿方案(成本約為標準 720p 輸出的三分之一),以及最高 4K 的最終渲染。主力方案的價格沒有變動 —— 720p 片段仍是每秒 0.10 美元 —— 因此這次發布的重點在於控制與成本,而非價格震撼。

Gemini Omni 1.1 Flash 是 Gemini Omni Flash 預覽版的後繼版本,該預覽版於 2026 年 6 月 30 日向開發者推出。1.1 繼承了原版所有與眾不同的特點:支援文字、圖片、音訊和影片的多模態輸入,可在單一呼叫中完成;每個片段都有原生同步音訊;以及對話式多輪編輯,你可以透過與模型交談來調整場景,而非從頭重新下提示詞。1.1 新增的是原先缺少的工具——長度、構圖、解析度和疊代成本,現在都是建置者可以實際設定的輸入參數。

回顧問題,已解決。

影響最重大的單一變更在於上下文。此模型較早的版本在延續片段時,僅參照片段的最後一秒,因此延伸內容在角色、燈光與運鏡上會產生偏移。Gemini Omni 1.1 Flash 最多可分析先前 10 秒的影片,延伸內容以 10 秒為增量擴展,累計總長可達 40 秒。兩者實際上的差異,在於「一組相鄰片段」與「一段可視為單一場景的連續畫面」之間的區別。對於 30 秒的廣告或循環播放的品牌素材而言,這正是「拼湊」與「執導」之間的差別。

場景延伸。以10秒為一段繼續現有片段,上限為40秒,並提供最多10秒的回顧上下文,以保持接續內容的一致性。

• 首尾幀控制。指定一個鏡頭的起始幀和結束幀,模型便會在兩個關鍵幀之間生成連續影片——這是攝影機環繞運鏡、縮放轉場與無縫循環背後的基礎原理。

• 影片參考。多模態輸入中可包含最多三秒的參考片段,以在鏡頭間保持角色、服裝及動作風格。

• 原生音訊。生成的片段仍帶有同步對白、音效與環境音,因此輸出即為完成的短片,而非等待音訊後製的無聲素材。

Veo 的控制項、Omni 的管線

這項公告主打「你喜愛的 Veo 創意控制功能」這個說法,而這確實準確描述了這些功能的來源。Veo 3.1 是 Go​gle 獨立的單次生成高保真影片生成器,其工具組中早已具備關鍵影格式條件控制與超解析度功能;Gemini Omni 1.1 Flash 將這套控制詞彙帶入多模態 Omni 管線——在此管線中,輸入可以是影像、音訊與參考影片,編輯方式為對話式,而非每次重新生成。這兩個模型在 Go​gle 的產品線中並非競爭對手;Gemini API 文件將 Gemini Omni Flash 定位為影片生成的推薦預設,而 Veo 則定位為更高保真度的專業模型。

這之所以重要,背後有個實際原因:這些控制功能現在位於你最可能在日常影片工作中呼叫的模型中,而不是放在你需要學習第二個 API 才能使用的獨立高階方案中。幀控制、草稿繪製和放大共用同一個端點和同一種定價模式。

從草稿到完稿的工作流程

360p 草稿層級是這份公告中最不引人注目、卻可能最有價值的功能。360p 預覽的渲染速度比標準 720p 快上最多 60%,成本大約只有三分之一,這直接扭轉了迭代的經濟邏輯。以業界報出的每秒計價費率來看,一段 10 秒的 360p 草稿約需 $0.30,720p 則要 $1.00——用一次正式渲染的價錢,就能進行三輪探索。

預期的流程很明顯:先在 360p 下進行分鏡與迭代,再把可行的那一鏡以 720p、1080p 或 4K 渲染輸出。對於製作社群剪輯版或廣告變體的團隊而言,草稿層級能將受成本限制的工作流程轉變為受探索限制的工作流程。這裡的速度與成本數據皆為廠商自行回報——Go​gle 自身的說法,迄今未被複現——但據此進行的計算很簡單。

A generated scoreboard titled 'Gemini Omni 1.1 Flash — the scoreboard'. Six rows read 'Max scene length: 40s (10s increments)', 'Lookback context: 10s (was 1s)', 'Resolution: 720p, 1080p, 4K', 'Frame control: first/last frame', 'Draft tier: 360p, ~1/3 cost, ~60% faster', 'Independent benchmark: none yet'. A footer reads 'Vendor-reported; no independent scores yet. 720p $0.10/s per Google.' The OrcaRouter logo is composited in the bottom-right corner.

定價情況

一直被引用的每秒0.10美元這個數字,是Go​gle公布的720p標準層級,與預覽版相比並未改變。輸入端是每百萬個token 1.50美元,無論這些token是文字、圖片、音訊還是影片;文字輸出則為每百萬個token 9.00美元——與原本的計費結構相同。360p層級換算下來約為每秒0.03美元,這正是Go​gle「約為三分之一成本」說法所暗示的,也是轉售商清單現在顯示的數字。

Google 尚未公佈的是新 1080p 和 4K 方案的每秒費率。轉銷商清單中 1080p 每秒報價 0.15 美元、4K 每秒 0.30 美元,但這些是市集估算,不是 Google 的數字——在官方費率出現於 Gemini API 定價頁面之前,請將任何高解析度製作預算視為暫定。作為規模參考,720p 下一個 40 秒的完整場景最高 4.00 美元,以轉銷商報價費率計算,10 秒 4K 成品約 3.00 美元,而同樣 10 秒以 360p 草稿呈現約 0.30 美元。

每秒計費是主打亮點,但您實際支付的金額是由您購買的平臺所決定——Go​gle 以定價出售,而經銷商和 API 閘道會再加上自己的利潤。這正是 0%加成政策在基礎設施端如此重要的原因:OrcaRouter 直接傳遞提供者的定價,因此當模型費率變化時,我們這邊的價格也會在同一天更新,在您與供應商公佈的數字之間沒有任何利潤層。我們尚未路由 Gemini Omni 1.1 Flash——Go​gle 尚未向第三方路由開放 Omni 視訊 API,我們也不會聲稱託管我們沒有的模型——但定價紀律才是重點,當該 API 層級開放時,該模型將以定價出現。

A screenshot of the Gemini API Pricing page (ai.google.dev, captured August 28, 2026) showing the developer-docs navigation (Models, Gemini Omni Flash, Veo, Nano Banana, Imagen), the 'Gemini Developer API pricing' heading, and the Free tier card for developers getting started with the Gemini API — Google's own page for the model family's pricing and availability tiers.

你可以稱呼它的地方

Gemini Omni 1.1 Flash 現已以模型 ID gemini-omni-1.1-flash 正式推出,可透過 Gemini API 在 Go​gle AI Studio 中使用,定位為正式生產版本而非預覽版。根據公告,它也可透過 Gemini Enterprise Agent Platform 用於生產工作負載——這是 Adobe、Figma、GMI Cloud 和 Runway 已整合的同一介面。在消費者端,Go​gle Flow 為全球所有 AI Plus、Pro 和 Ultra 訂閱者提供完整功能集,場景擴充功能也已在 Gemini 應用程式中上線。這並非紙上談兵的發布:API、Agent 平台和消費者端介面都在同一天上線。

如果您嘗試過六月預覽版,但因其嚴格的 10 秒上限或無法維持場景連貫而卻步,此版本正好回應了這些確切問題——延長至 40 秒、可用的影片參考,以及完整的解析度階梯。API 的結構也值得了解:生成和編輯都透過 Interactions API 執行,這正是實現對話式、多輪編輯模型的關鍵,而 response_format 設定可以固定輸出解析度——草稿用 360p,成品用完整解析度。

A screenshot of the Gemini API developer documentation Models page (ai.google.dev, captured August 28, 2026) showing the docs navigation under 'Gemini API' — Models, Gemini Omni Flash, Nano Banana, Veo, Imagen — and the list of Gemini's generation models. It is the vendor's official developer page for the model family.

還有什麼仍未得到證實?

儘管有這些新的控制選項,定義原版的取捨依然延續。輸出仍然是帶有同步音訊的短片,而非 Veo 3.1 的替代品——這兩個模型針對的是不同的任務。跨場景變化的角色一致性透過 10 秒回看和參考影片輸入而有所改善,但它仍然是生成上的一個弱點,值得在你自己的素材上實際測試,而不是直接預設。每個生成的片段都帶有 SynthID 浮水印,這對於需要來源保證的工具來說至關重要。

而誠實的提醒是:截至撰寫本文時,沒有任何公開影片排行榜上有 Gemini Omni 1.1 Flash 的獨立基準測試。360p 草稿的 60% 加速、1080p 和 4K 下的品質、首/末幀條件的可靠性——這些都是廠商自行報告的數據,沒有任何第三方重現過。今天任何向你引用這個模型品質分數的人,所引用的數字都是 Go​gle 實驗室以外沒有人產生過的。

現在誰應該行動?

三類群體能立即從本次發佈中獲得價值。已經在 Omni API 上建置的團隊,應切換模型 ID 並重新測試其擴充與影格控制路徑——這次升級是請求欄位的變更,而非重新架構。任何需要大量短影片的人——廣告變體、社群剪輯、循環品牌素材——都應評估 360p 草稿到成片工作流程的價格,因為全新的成本計算邏輯正是在這裡。而一直在等待預覽版的團隊,現在就該試用此模型,因為先前讓預覽版無法用於生產的兩大障礙——十秒短片與缺乏場景連續性——正是這次更新所移除的內容。

應該暫緩投入的群體同樣明確:如果你需要在承諾預算之前取得第三方基準測試或官方每秒4K速率,目前還沒有人有這些數據,這點值得直言不諱,而不是含糊帶過。這次發布是真實的,控制項是真實的,唯一還在變動的部分是定價差距。請關注 Gemini API 定價頁面上的 1080p 和 4K 費率,並密切留意第一批獨立評測——一旦有其他團隊執行這個模型,本文中每一項品質聲明上所附的供應商報告註記,就會獲得一個勾選標記或紅旗警示。

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

providers@orcarouter.ai

加入我們的社區

Discordsupport@orcarouter.aiXGitHubYouTube