Kartu judul untuk perbandingan Gemini 3.7 Flash versus DeepSeek V4 Flash, menampilkan dua petir: kotak terkunci berlabel Gemini 3.7 Flash dengan label harga $0,75 / $3,75, dan kotak terbuka dengan panah unduhan berlabel DeepSeek V4 Flash dengan label harga $0,14 / $0,28.
Guides & Insights

Gemini 3.7 Flash vs DeepSeek V4 Flash: Dua Model "Flash", Jawaban Berlawanan untuk Pertanyaan yang Sama

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua model 2026 dengan penamaan paling membingungkan sama-sama disebut Flash, dan keduanya tidak bisa menjawab pertanyaan yang sama dengan cara yang lebih berbeda. Gemini 3.7 Flash, yang dirilis pada 13 Agustus 2026, adalah kuda kerja tertutup milik Go​ogle: sekitar 340 token keluaran per detik, Indeks Intelijen 56, dan harga promosi $0.75 per juta input dan $3.75 per juta output. DeepSeek V4 Flash adalah bagian berbobot terbuka dari keluarga V4 Deep​Seek, diluncurkan pada bulan April dan diperbarui pada akhir Juli: berlisensi MIT, dapat diunduh, dan dibanderol $0.14 per juta input dan $0.28 per juta output di API Deep​Seek sendiri — sekitar seperlima dari harga promosi input Go​ogle dan sepertiga belas dari harga output. Keduanya adalah model "flash", dirancang agar cepat dan murah untuk pekerjaan bervolume tinggi. Persamaan hanya sebatas kata itu.

Pertanyaan yang mereka jawab secara berbeda adalah pertanyaan penentu generasi ini: apakah Anda menyewa kecerdasan atau memilikinya? DeepSeek V4 Flash adalah model mixture-of-experts dengan 284 miliar parameter, sekitar 13B aktif per token, jendela konteks 1M token, dan batas output 384K, dirilis di bawah lisensi MIT — bobotnya adalah unduhan sebesar ~160GB, dan pembaruan 31 Juli (V4-Flash-0731) menambahkan kemampuan agenik yang jauh lebih kuat. Gemini 3.7 Flash adalah model proprietary yang dibangun di atas Gemini 3.6 Flash dengan konteks 1M, batas output 64K, input multimodal, dan tanpa jalur menuju self-hosting. Salah satu model ini dapat diisolasi dari jaringan (air-gapped), di-fine-tune, dan dijalankan di perangkat keras Anda sendiri. Model lainnya hanya berjalan di tempat Go​ogle menjalankannya.

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Kedua Flash, berdampingan

Kedua model menyasar pembeli yang sama — beban kerja produksi bervolume tinggi yang tidak mampu membayar model flagship untuk setiap token — tetapi keduanya mencapai hal tersebut melalui arsitektur yang berlawanan. Perhatian hibrida DeepSeek V4 Flash (sparse terkompresi plus perhatian yang sangat terkompresi) yang membuat konteks 1M-nya cukup ekonomis untuk dijual pada harga ini; inilah model yang ditunjuk oleh endpoint lama `deepseek-chat` dan `deepseek-reasoner` milik Deep​Seek, yang dipensiunkan pada bulan Juli. Gemini 3.7 Flash adalah penyempurnaan algoritmik Go​ogle atas lini Flash miliknya sendiri, dan keunggulannya adalah throughput penyajian: pengukuran independen mencatatnya sekitar 340 token/s dibandingkan DeepSeek V4 Flash yang sekitar 113, dan ia mencapainya sambil menerima input audio dan video yang tidak diterima oleh DeepSeek V4 Flash.

Intelligence Index — 56 untuk Gemini 3.7 Flash versus 50 untuk DeepSeek V4 Flash, menurut Artificial Analysis.

Kecepatan output — ~340 token/detik dibandingkan ~113 token/detik, keduanya menurut Artificial Analysis.

Jendela konteks — 1M token untuk keduanya; DeepSeek V4 Flash menghasilkan hingga 384K dibandingkan dengan 64K milik Gemini 3.7 Flash.

Harga input — $0,75 (promosi, hingga 2026) dibandingkan dengan $0,14 di API Deep​Seek sendiri.

Harga keluaran — $3.75 (promosi) dibandingkan $0.28.

Weights — proprietary versus berlisensi MIT dan dapat diunduh.

A comparison scoreboard for Gemini 3.7 Flash and DeepSeek V4 Flash: Gemini 3.7 Flash leads 56 to 50 on the AA Index and ~340 to ~113 tokens per second, while DeepSeek V4 Flash leads 384K to 64K on max output, $0.14 to $0.75 on input and $0.28 to $3.75 on output, with both at 1M context and proprietary weights against MIT open weights.

Apa yang sebenarnya dibeli oleh enam poin indeks

Celah Indeks enam poin cukup bermakna tetapi tidak terlalu jauh, dan sebagian besar berada di area yang tidak dioptimalkan oleh DeepSeek V4 Flash. Angka pengkodean agenik Gemini 3.7 Flash yang dilaporkan (65.3 pada DeepSWE v1.1, 43.6 pada FrontierCode 1.1 Main, dilaporkan oleh vendor) jauh lebih unggul, dan Elo pengembangan web-nya (1588, juga dilaporkan vendor) mencerminkan peningkatan nyata dalam pembuatan UI. Angka yang dilaporkan DeepSeek V4 Flash sendiri — 79.0 pada SWE-bench Verified, 91.6 pada LiveCodeBench, skor τ²-Bench 95.0 yang diperkuat oleh pelacak independen — bertahan dengan baik pada pengkodean terbatas dan penggunaan alat, dan penarikan konteks 1M-nya (78.7 pada MRCR, 60.5 pada CorpusQA) kompetitif dengan apa pun di kelas harganya. Polanya: Gemini 3.7 Flash unggul dalam kedalaman agenik dan pekerjaan web; DeepSeek V4 Flash menukarnya dengan ekonomi token mentah dan batas konteks panjang yang tidak dapat ditandingi oleh pekerja berat tertutup mana pun.

Bobot terbuka mengubah pengadaan, bukan hanya harganya.

Lisensi MIT adalah bagian dari perbandingan ini yang tidak tertangkap oleh tabel benchmark mana pun. DeepSeek V4 Flash dapat diunduh dan dijalankan di perangkat keras Anda sendiri, di-fine-tune dengan data Anda sendiri, dan digunakan di lingkungan yang tidak mengizinkan panggilan API — dan lisensinya tidak memiliki pembatasan berbasis skala, jadi tidak ada hal apa pun dalam pertumbuhan Anda yang mengubah ketentuannya. Biaya praktisnya bersifat operasional: melayani model MoE 284B dengan kecepatan yang diinginkan tim produksi membutuhkan stok GPU yang nyata, dan bagi sebagian besar tim, pilihan yang jujur adalah API yang dihosting. Di situlah kesenjangan harga benar-benar berperan: bahkan jalur yang dihosting, dengan harga $0.14 / $0.28, cukup murah untuk menjadi pilihan default bagi trafik long tail. Gemini 3.7 Flash tidak menawarkan jalur kepemilikan sama sekali — yang Anda beli adalah layanan multimodal yang dikelola dengan andal, cepat, dengan label harga promosi dan kenaikan drastis di bulan Januari.

Tagihan volume

Jalankan pada hari yang sama untuk keduanya: 20 juta token input dan 4 juta token output. Pada API DeepSeek V4 Flash sendiri, itu $2.80 + $1.12, sekitar $3.92. Pada Gemini 3.7 Flash dengan tarif promosi, itu $15 + $15, sekitar $30 — selisih 7.6x bahkan sementara Go​ogle sedang memberikan diskonnya. Setelah 1 Januari 2027, ketika Gemini 3.7 Flash kembali ke $1.50 / $7.50, tagihan untuk hari yang sama sekitar $58, lima belas kali lipat angka Deep​Seek. Keunggulan kecepatan sebagian mengompensasi ini pada beban kerja interaktif — token yang lebih cepat berarti lebih sedikit permintaan bersamaan — tetapi untuk pekerjaan batch dan latar belakang, model terbuka memenangkan tagihan tanpa perlawanan. Kedua model bahkan tidak menargetkan kurva biaya yang sama, dan itulah intinya.

The OrcaRouter model page for DeepSeek V4 Flash, showing the ~$0.15 per million input and ~$0.29 per million output pass-through pricing, a 1M-token context window with 384K max output, and the text-only 284B-total / 13B-active mixture-of-experts description.

Siapa yang harus membangun di atas yang mana

Pilih DeepSeek V4 Flash ketika biaya per token menjadi kendala yang mengikat, ketika Anda menginginkan output panjang hingga 384K, ketika Anda memerlukan opsi self-hosting atau deployment yang terisolasi (air-gapped), atau ketika Anda membangun sesuatu yang marginnya tidak akan bertahan dengan harga token kelas flagship. Pilih Gemini 3.7 Flash ketika Anda membutuhkan kecepatan dalam loop interaktif, input multimodal, keandalan terkelola Go​ogle, atau hasil agentic-coding yang lebih kuat yang dilaporkan Go​ogle — dan ketika Anda merasa nyaman bahwa harga promosi itu bersifat sementara. Mereka bukanlah pesaing seperti dua flagship yang saling bersaing; mereka adalah dua strategi pengadaan yang berbeda dengan nama yang sama. Lapisan routing adalah tempat kedua strategi itu bertemu: DeepSeek V4 Flash tersedia di OrcaRouter dengan harga list Deep​Seek tanpa markup 0%, dan pola failover cocok secara alami dengan pasangan ini — sebuah aturan yang menjalankan sebagian besar lalu lintas pada V4 Flash dan mengalihkan subset yang sulit ke model tertutup yang lebih kuat, dengan Gemini 3.7 Flash yang dapat dijangkau melalui API Gemini milik Go​ogle sendiri di sisi lain dari router yang sama.

Pembacaan yang jujur

Jika Anda dapat self-host atau Anda sepenuhnya digerakkan oleh biaya, DeepSeek V4 Flash adalah model yang lebih baik untuk dikembangkan, dan lisensinya menjadikannya keputusan yang tidak perlu Anda tinjau lagi. Jika Anda membutuhkan kecepatan penyajian Google, input multimodal, atau keunggulan agentic-coding yang dilaporkan, Gemini 3.7 Flash adalah layanan yang lebih baik selama promosi berlangsung — dengan penggandaan harga Januari yang sudah ada di kalender. Dua model, satu nama, dan pasar dapat melihat filosofi mana yang akan dipilih oleh trafik setahun ke depan.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari