
Gemini 3.7 Flash 對比 DeepSeek V4 Flash:兩個「Flash」模型,對同一問題給出相反的答案
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0345智能76程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
2026年最令人困惑的兩款同名模型都叫Flash,而它們回答同一個問題的方式可謂截然不同。Gemini 3.7 Flash 於2026年8月13日發布,是 Google 的閉源主力模型:每秒約輸出340個token,智能指數56,促銷價為每百萬輸入token 0.75美元、每百萬輸出token 3.75美元。DeepSeek V4 Flash 是 DeepSeek V4 系列中的開源權重版本,4月推出,7月底更新:採用MIT授權、可下載,在 DeepSeek 自家 API 上的定價為每百萬輸入token 0.14美元、每百萬輸出token 0.28美元——約為 Google 促銷輸入價格的五分之一、輸出價格的十三分之一。兩者都是「flash」模型,專為高流量工作打造,快速又便宜。而這個名字,就是它們唯一的相似之處。
它們給出不同答案的那個問題,正是定義這一代人的問題:你是租用智慧,還是擁有智慧?DeepSeek V4 Flash 是一個 2840 億參數的混合專家(Mixture-of-Experts)模型,每個 token 約有 130 億參數在運作,具備 100 萬 token 的上下文視窗與 384K 的輸出上限,並以 MIT 授權釋出——權重約為 160GB 的下載量,而 7 月 31 日的更新(V4-Flash-0731)則顯著強化了智能體(agentic)能力。Gemini 3.7 Flash 是基於 Gemini 3.6 Flash 打造的專有模型,具備 100 萬上下文、64K 輸出上限、多模態輸入,且無法自行託管。這兩款模型中,有一款可以離線隔離、微調,並在你自己的硬體上運行;另一款則只能在 Google 運行它的地方運行。

兩個 Flashes 並排
這兩個模型瞄準的是同一類買家——無法承擔旗艦級每 token 成本的高量產工作負載——但它們透過相反的架構達到這個目標。DeepSeek V4 Flash 的混合注意力(壓縮稀疏加上重度壓縮注意力)使其 1M 上下文能以這些價格販售仍具經濟效益;它是 DeepSeek 指向舊版 `deepseek-chat` 和 `deepseek-reasoner` 端點的模型,這些端點已於七月退役。Gemini 3.7 Flash 是 Google 對其自家 Flash 系列的演算法精煉,其優勢在於服務吞吐量:獨立測量顯示它約為 340 tokens/s,而 DeepSeek V4 Flash 約為 113,而且它在接受 DeepSeek V4 Flash 無法處理的音訊和視訊輸入時仍能達到此速度。
• 智能指數 — 據 Artificial Analysis,Gemini 3.7 Flash 為 56,而 DeepSeek V4 Flash 為 50。
• 輸出速度 — 約 340 tokens/s 對比 約 113 tokens/s,兩者皆根據 Artificial Analysis。
• 上下文窗口 — 兩者均為 1M tokens;DeepSeek V4 Flash 輸出最高可達 384K,而 Gemini 3.7 Flash 僅 64K。
• 輸入價格 — $0.75(促銷價,至2026年),對比DeepSeek自家API的$0.14。
• 輸出價格 — $3.75(促銷價)對比 $0.28。
• 權重 — 專有與 MIT 授權且可下載的。

六個指數點實際上能買到什麼?
六分的 Index 差距具有意義,但並非天壤之別,且主要落在 DeepSeek V4 Flash 未經最佳化的領域。Gemini 3.7 Flash 回報的代理式編碼數據(DeepSWE v1.1 為 65.3,FrontierCode 1.1 Main 為 43.6,皆為廠商回報)遙遙領先,其網頁開發 Elo(1588,亦為廠商回報)也反映了真實的 UI 生成改進。DeepSeek V4 Flash 自身回報的數字——SWE-bench Verified 79.0、LiveCodeBench 91.6,以及獨立追蹤者證實的 τ²-Bench 95.0——在有界編碼與工具使用上表現穩健,其 1M 上下文檢索(MRCR 78.7、CorpusQA 60.5)在同價位產品中亦具競爭力。整體模式:Gemini 3.7 Flash 在代理式深度與網頁工作上領先;DeepSeek V4 Flash 則以這些優勢換取原始 token 成本效益,以及沒有任何封閉式主力模型能匹敵的長上下文天花板。
開放權重改變的是採購方式,而不只是價格。
MIT 授權條款是這次比較中沒有任何基準測試表格能呈現的部分。DeepSeek V4 Flash 可以下載並在你自己的硬體上執行,用你自己的資料進行微調,也能在禁止 API 呼叫的環境中使用——而且此授權沒有基於規模的限制,所以你的成長不會改變任何條款。實際成本在於營運面:要以生產團隊想要的速度服務 284B 的 MoE 模型,需要實打實的 GPU 庫存,而對大多數團隊來說,誠實的選擇是託管 API。這正是價格差距真正發揮作用的地方:即使是託管路線,$0.14 / $0.28 的價格也便宜到足以成為長尾流量的預設選項。Gemini 3.7 Flash 完全不提供所有權路徑——你買到的是可靠管理、快速、多模態的服務,附帶促銷價格標籤,以及一月價格懸崖。
用量帳單
在同一天分別執行兩者:2000 萬個輸入 token 和 400 萬個輸出 token。在 DeepSeek V4 Flash 自家的 API 上,費用是 $2.80 + $1.12,約 $3.92。在 Gemini 3.7 Flash 的促銷價下,費用是 $15 + $15,約 $30——即使 Google 正在打折,差距仍達 7.6 倍。2027 年 1 月 1 日之後,當 Gemini 3.7 Flash 恢復為 $1.50 / $7.50 定價時,同樣一天的帳單約為 $58,是 DeepSeek 數字的十五倍。在互動式工作負載上,速度優勢能部分抵銷這個差距——更快的 token 代表需要更少的並行請求——但對於批次和背景作業,開源模型在帳單上毫無懸念地勝出。這兩個模型甚至瞄準的不是同一條成本曲線,而這正是重點所在。

誰應該在哪個上面建置
選擇 DeepSeek V4 Flash,當每 token 成本是決定性約束時,當你需要長達 384K 的輸出時,當你需要自架或氣隙部署的選項時,或當你正在打造的東西其利潤無法承受旗艦級定價的 token。選擇 Gemini 3.7 Flash,當你需要在互動迴圈中的速度、多模態輸入、Google 的受管可靠性,或 Google 所報告的更強代理式編碼成果——而且你安心接受促銷價格是暫時的。它們並非兩款旗艦互相競爭的那種關係;它們是披著相同名稱的兩種不同採購策略。路由層正是這些策略交會之處:DeepSeek V4 Flash 已在 OrcaRouter 上線,以 DeepSeek 的牌價提供,0% 加價,而故障轉移模式也自然適合這種配對——一條規則讓大部分流量走 V4 Flash,並將困難的子集升級到更強大的封閉模型,同時在同一路由器的另一端,可透過 Google 自家的 Gemini API 觸及 Gemini 3.7 Flash。
誠實的解讀
如果你可以自行託管,或你純粹由成本驅動,DeepSeek V4 Flash 是更適合在此基礎上打造的模型,而其授權讓這個決定成為你永遠不必重新審視的選擇。如果你需要 Google 的服務速度、多模態輸入,或報導中所稱的代理式編碼優勢,那麼 Gemini 3.7 Flash 在促銷期間是更好的服務——一月價格翻倍已經列在行事曆上。兩個模型,同一個名稱,而市場將見證未來一年的流量會投票給哪一種哲學。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
