
Grok Imagine Video 1.5 Lite 在 Artificial Analysis Video Board 首次亮相,排名第 17,價格低 44%,但 Elo 落後其母模型 52 分
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
有兩個數字足以證明 Grok Imagine Video 1.5 Lite 的價值,而這兩個都不是發布說明開頭所主打的數字。在 Artificial Analysis 的 AA-Video-T2V v2.0 排行榜上,全新的 Grok Imagine Video 1.5 Lite 位居第 17 名,Elo 993(±10,5,715 個樣本),標價為每分鐘 $8.40(1080p 預設設定)。它的母模型Grok Imagine Video 1.5則高出七個名次,位居第 11 名——Elo 1045,每分鐘 $15.00。也就是說,每分鐘多付 $6.60 換來 52 Elo;這種取捨在影片生成領域並不尋常,因為旗艦之下的級別通常價格與旗艦相去不遠,只是做得更少。Grok Imagine Video 1.5 Lite 並非如此。它是一個蒸餾模型,而且附帶實實在在的折扣,而這個折扣正是重點所在。
什麼已經上線,以及何時上線
Grok Imagine Video 1.5 Lite 是 SpaceXAI 對 Grok Imagine Video 1.5 推出的更便宜、更快的版本,而且它是一個獨立模型,擁有自己的列表項目,而非同一組權重的更便宜服務層級。介面沒有改變:它接受文字轉影片與圖像轉影片請求、1 到 15 秒的整秒時長、此系列支援的七種長寬比(16:9、9:16、1:1、4:3、3:4、3:2、2:3)、一張首幀圖像與額外參考圖像,以及用於非同步完成的回呼 URL。生成採用兩步協議——POST 一個請求,取得作業 ID 與輪詢 URL,並收到附帶 202 的回應,然後輪詢直到狀態轉為完成,再從內容端點提取位元組。生成失敗不計費。
時間點的拿捏,會影響你怎麼解讀這份排名。Artificial Analysis 將這個模型的日期標定為 2026 年 8 月;排行榜上的登錄本身則更新,而真正讓這件事成為本週話題、而非夏季一則腳註的,正是把它送進排行榜的那份公告。一個模型可以悄悄推出,日後才成為新聞——等到獨立排行榜終於累積到足夠的盲測比較,足以將它排上榜為止;這次是 5,715 個樣本,對一個影片排行榜而言是相當可觀的評測規模。
兩塊板,其中一塊已驗證
公告指出,Grok Imagine Video 1.5 Lite 在 AA-Video-T2V v2.0 排行榜的有音訊與無音訊兩種版本上都排名第 17,並在該排行榜的品質與價格前沿上佔有一席之地。對於這些說法,我們能從已公布的排行榜直接確認有音訊的那一列:排名第 17、Elo 993、95% 區間為 983 到 1003、價格為每分鐘 8.40 美元,歸屬於 SpaceXAI。無音訊版本的排名與前沿定位則來自公告本身,我們並未獨立重現。
值得先釐清「帕雷托前沿」在這裡究竟能為讀者帶來什麼,因為這個說法經常被人隨口濫用。在品質對價格的散點圖上,當沒有任何其他模型同時更好又更便宜時,這個模型就位於前沿上。Grok Imagine Video 1.5 Lite 以 Elo 993、每分鐘 8.40 美元的成績,角逐的是這張圖表上好幾個模型聚集的某一區帶:PixVerse V6 位於低一列,Elo 985、價格 6.90 美元;Kling 3.0 1080p(Pro)位於高一列,Elo 1000、價格 10.08 美元。真正有意思的主張,並不是 Lite 打敗了其中任何一個模型,而是在這個價位上,它已經和排在它上面的模型夠接近,值得佔有一席之地。

折扣來自哪裡
Lite 有三件事比較便宜,而其中只有一件會顯示在價目表上。
第一個是刊登頁面直接列出的數字:1080p 輸出是以 720p 渲染後再升頻。那是模型本身說明中最有用的一句話,也是快速掃視價格表的買家會漏掉的一句。以 1080p 請求的 Lite 片段,實際上就是把 720p 渲染拉到 1080p 尺寸。就社群平台交付而言,這通常看不出來。但對於任何要調色、裁切或去背的素材,這就是「素材」與「素材近似品」之間的差別,也正是每分鐘價格可以只有母模型 56% 的原因。
第二個是蒸餾。Lite 被描述為更快、更便宜的影片生成,並從 Grok Imagine Video 1.5 蒸餾而來——就如同小型語言模型與它被訓練來模仿的大型語言模型之間的關係。蒸餾換來更低的延遲與成本,卻回吐了一點品質,而這正是排行榜所顯示的:52 Elo 的差距。
第三點是董事會看不到的。蒸餾後的影片模型不僅在整體偏好投票上較不準確;它在邊緣情況通常也更不可靠——長提示、不尋常的鏡頭運動,以及完整版本支援得更廣泛的參考影像調控。盲式成對投票把這些失敗平均成單一 Elo,而單一 Elo 很難預測你需要的特定鏡頭是否會生成出來。

數字無法證明的事
993 是偏好分數,不是保真度分數。評審小組在不知道哪個模型製作這些片段的情況下,於片段之間投票,這使它成為衡量人們偏好哪個片段的有力指標,卻是衡量片段是否符合需求簡報的薄弱指標。模型可以靠更漂亮的色彩贏得票數,卻丟掉你要求的那個鏡頭。
同時,價格是以每分鐘為單位,在指定解析度與預設設定下報價。只要改變其中任一項,比較基準就會變動:降到較低等級,每秒費率就會下降;延長一段剪輯,總額則會上升。任何只依單一每分鐘數字編列預算的人,其實是在依預設值編預算,而不是依自身的工作負載。
而且,在競技場之外,沒有對 Grok Imagine Video 1.5 Lite 的第三方評估——沒有公開的提示詞套件、沒有可重現的品質測試框架、沒有獨立的延遲基準測試。Elo 是唯一獨立的數字。關於該模型的其他一切,包括其解析度行為,都來自廠商。

誰實際上應該轉換?
這個決定比發表時的框架所暗示的還要窄。如果你的產出是 1080p 或以下的短版社群影片,而預算正是那道綁死的限制,那麼 Lite 每分鐘 $8.40、對比完整模型的 $15.00,幾乎等同於免費升級——你保留了這個家族的介面、它的時長與參考圖片輸入,放棄的只是大多數觀眾根本不會察覺的偏好分數中那幾個百分點。
如果你的輸出最終是調色、裁切、合成或交付規格,那麼升頻至 1080p 的細節就是不合格的,而完整的 Grok Imagine Video 1.5 依然是這個系列裡你想要的那個模型。
如果您的問題是該先試兩者中的哪一個,那其實是容錯移轉的問題,而不是承諾綁定的問題。OrcaRouter 並未提供這兩個模型——我們既不代管 Grok Imagine Video 1.5,也不代管 Grok Imagine Video 1.5 Lite,兩者都是透過供應商自家的 API 及數個第三方平台來存取。路由器真正涵蓋的是它們周邊的那一層:提示改寫、鏡頭清單生成、字幕與中繼資料處理,以及決定該保留哪個片段的模型呼叫。這一層在 OrcaRouter 上以一組 API 串接 200 多個模型,採供應商標價、0% 加成,並具備跨供應商的自動容錯移轉與路由 DSL,將多個模型組合成單一呼叫。按秒計費的影片價格從不會計入那筆帳單,這正是為什麼文字這一側才是路由決策能回本的地方。
接下來要看什麼
有兩件事能釐清這些懸而未決的問題。第一是無音訊排行榜上的名次,這將確認當音訊聲道移除後,Lite 的排名是否依然成立——如果它與母模型的差距在那裡大幅擴大,就表示音軌承載的 Lite Elo 比其視覺內容所承載的更多。第二是任何對升頻後 1080p 輸出的獨立評估,因為一款每分鐘要價 $8.40 的影片模型,其整體價值主張取決於 720p 算繪升到 1080p 後,能否經得起它被銷售進入的交付流程。
直到那時,誠實的總結仍相當狹隘:Grok Imagine Video 1.5 Lite 是任何人實測過、進入 Grok Imagine Video 系列最便宜的方式,它為此讓出 52 Elo,也放棄原生 1080p 細節——這項取捨,大多數社群優先團隊應該接受,而任何要完成影片成品的人則不該接受。
