一張 Gemini 3.7 Flash 與 DeepSeek V4 Flash 對比的標題卡,顯示兩道閃電:一個標有 Gemini 3.7 Flash 的封閉上鎖箱,附有 $0.75 / $3.75 標籤;以及一個帶有下載箭頭的開放箱,標有 DeepSeek V4 Flash,附有 $0.14 / $0.28 標籤。
Guides & Insights

Gemini 3.7 Flash 對比 DeepSeek V4 Flash:兩個「Flash」模型,對同一問題給出相反的答案

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

2026年最令人困惑的兩款同名模型都叫Flash,而它們回答同一個問題的方式可謂截然不同。Gemini 3.7 Flash 於2026年8月13日發布,是 Go​ogle 的閉源主力模型:每秒約輸出340個token,智能指數56,促銷價為每百萬輸入token 0.75美元、每百萬輸出token 3.75美元。DeepSeek V4 Flash 是 Deep​Seek V4 系列中的開源權重版本,4月推出,7月底更新:採用MIT授權、可下載,在 Deep​Seek 自家 API 上的定價為每百萬輸入token 0.14美元、每百萬輸出token 0.28美元——約為 Go​ogle 促銷輸入價格的五分之一、輸出價格的十三分之一。兩者都是「flash」模型,專為高流量工作打造,快速又便宜。而這個名字,就是它們唯一的相似之處。

它們給出不同答案的那個問題,正是定義這一代人的問題:你是租用智慧,還是擁有智慧?DeepSeek V4 Flash 是一個 2840 億參數的混合專家(Mixture-of-Experts)模型,每個 token 約有 130 億參數在運作,具備 100 萬 token 的上下文視窗與 384K 的輸出上限,並以 MIT 授權釋出——權重約為 160GB 的下載量,而 7 月 31 日的更新(V4-Flash-0731)則顯著強化了智能體(agentic)能力。Gemini 3.7 Flash 是基於 Gemini 3.6 Flash 打造的專有模型,具備 100 萬上下文、64K 輸出上限、多模態輸入,且無法自行託管。這兩款模型中,有一款可以離線隔離、微調,並在你自己的硬體上運行;另一款則只能在 Google 運行它的地方運行。

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

兩個 Flashes 並排

這兩個模型瞄準的是同一類買家——無法承擔旗艦級每 token 成本的高量產工作負載——但它們透過相反的架構達到這個目標。DeepSeek V4 Flash 的混合注意力(壓縮稀疏加上重度壓縮注意力)使其 1M 上下文能以這些價格販售仍具經濟效益;它是 Deep​Seek 指向舊版 `deepseek-chat` 和 `deepseek-reasoner` 端點的模型,這些端點已於七月退役。Gemini 3.7 Flash 是 Go​ogle 對其自家 Flash 系列的演算法精煉,其優勢在於服務吞吐量:獨立測量顯示它約為 340 tokens/s,而 DeepSeek V4 Flash 約為 113,而且它在接受 DeepSeek V4 Flash 無法處理的音訊和視訊輸入時仍能達到此速度。

智能指數 — 據 Artificial Analysis,Gemini 3.7 Flash 為 56,而 DeepSeek V4 Flash 為 50。

輸出速度 — 約 340 tokens/s 對比 約 113 tokens/s,兩者皆根據 Artificial Analysis。

上下文窗口 — 兩者均為 1M tokens;DeepSeek V4 Flash 輸出最高可達 384K,而 Gemini 3.7 Flash 僅 64K。

輸入價格 — $0.75(促銷價,至2026年),對比Deep​Seek自家API的$0.14。

輸出價格 — $3.75(促銷價)對比 $0.28。

權重 — 專有與 MIT 授權且可下載的。

A comparison scoreboard for Gemini 3.7 Flash and DeepSeek V4 Flash: Gemini 3.7 Flash leads 56 to 50 on the AA Index and ~340 to ~113 tokens per second, while DeepSeek V4 Flash leads 384K to 64K on max output, $0.14 to $0.75 on input and $0.28 to $3.75 on output, with both at 1M context and proprietary weights against MIT open weights.

六個指數點實際上能買到什麼?

六分的 Index 差距具有意義,但並非天壤之別,且主要落在 DeepSeek V4 Flash 未經最佳化的領域。Gemini 3.7 Flash 回報的代理式編碼數據(DeepSWE v1.1 為 65.3,FrontierCode 1.1 Main 為 43.6,皆為廠商回報)遙遙領先,其網頁開發 Elo(1588,亦為廠商回報)也反映了真實的 UI 生成改進。DeepSeek V4 Flash 自身回報的數字——SWE-bench Verified 79.0、LiveCodeBench 91.6,以及獨立追蹤者證實的 τ²-Bench 95.0——在有界編碼與工具使用上表現穩健,其 1M 上下文檢索(MRCR 78.7、CorpusQA 60.5)在同價位產品中亦具競爭力。整體模式:Gemini 3.7 Flash 在代理式深度與網頁工作上領先;DeepSeek V4 Flash 則以這些優勢換取原始 token 成本效益,以及沒有任何封閉式主力模型能匹敵的長上下文天花板。

開放權重改變的是採購方式,而不只是價格。

MIT 授權條款是這次比較中沒有任何基準測試表格能呈現的部分。DeepSeek V4 Flash 可以下載並在你自己的硬體上執行,用你自己的資料進行微調,也能在禁止 API 呼叫的環境中使用——而且此授權沒有基於規模的限制,所以你的成長不會改變任何條款。實際成本在於營運面:要以生產團隊想要的速度服務 284B 的 MoE 模型,需要實打實的 GPU 庫存,而對大多數團隊來說,誠實的選擇是託管 API。這正是價格差距真正發揮作用的地方:即使是託管路線,$0.14 / $0.28 的價格也便宜到足以成為長尾流量的預設選項。Gemini 3.7 Flash 完全不提供所有權路徑——你買到的是可靠管理、快速、多模態的服務,附帶促銷價格標籤,以及一月價格懸崖。

用量帳單

在同一天分別執行兩者:2000 萬個輸入 token 和 400 萬個輸出 token。在 DeepSeek V4 Flash 自家的 API 上,費用是 $2.80 + $1.12,約 $3.92。在 Gemini 3.7 Flash 的促銷價下,費用是 $15 + $15,約 $30——即使 Google 正在打折,差距仍達 7.6 倍。2027 年 1 月 1 日之後,當 Gemini 3.7 Flash 恢復為 $1.50 / $7.50 定價時,同樣一天的帳單約為 $58,是 DeepSeek 數字的十五倍。在互動式工作負載上,速度優勢能部分抵銷這個差距——更快的 token 代表需要更少的並行請求——但對於批次和背景作業,開源模型在帳單上毫無懸念地勝出。這兩個模型甚至瞄準的不是同一條成本曲線,而這正是重點所在。

The OrcaRouter model page for DeepSeek V4 Flash, showing the ~$0.15 per million input and ~$0.29 per million output pass-through pricing, a 1M-token context window with 384K max output, and the text-only 284B-total / 13B-active mixture-of-experts description.

誰應該在哪個上面建置

選擇 DeepSeek V4 Flash,當每 token 成本是決定性約束時,當你需要長達 384K 的輸出時,當你需要自架或氣隙部署的選項時,或當你正在打造的東西其利潤無法承受旗艦級定價的 token。選擇 Gemini 3.7 Flash,當你需要在互動迴圈中的速度、多模態輸入、Go​ogle 的受管可靠性,或 Go​ogle 所報告的更強代理式編碼成果——而且你安心接受促銷價格是暫時的。它們並非兩款旗艦互相競爭的那種關係;它們是披著相同名稱的兩種不同採購策略。路由層正是這些策略交會之處:DeepSeek V4 Flash 已在 OrcaRouter 上線,以 Deep​Seek 的牌價提供,0% 加價,而故障轉移模式也自然適合這種配對——一條規則讓大部分流量走 V4 Flash,並將困難的子集升級到更強大的封閉模型,同時在同一路由器的另一端,可透過 Go​ogle 自家的 Gemini API 觸及 Gemini 3.7 Flash。

誠實的解讀

如果你可以自行託管,或你純粹由成本驅動,DeepSeek V4 Flash 是更適合在此基礎上打造的模型,而其授權讓這個決定成為你永遠不必重新審視的選擇。如果你需要 Google 的服務速度、多模態輸入,或報導中所稱的代理式編碼優勢,那麼 Gemini 3.7 Flash 在促銷期間是更好的服務——一月價格翻倍已經列在行事曆上。兩個模型,同一個名稱,而市場將見證未來一年的流量會投票給哪一種哲學。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新