
Gemini 3.7 Flash Telah Rilis: Setengah Harga, Konteks 1M, dan Apa yang Sebenarnya Dikonfirmasi
- grokBARUSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaBARUMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenBARUQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekBARUDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxBARUMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token · 2190 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Kecerdasan77Koding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Kecerdasan77Koding
- grokxAI: Grok 4.52026-07-0856Kecerdasan72Koding
- tencentTencent: Hy32026-07-0642Kecerdasan59Koding
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Kecerdasan42Koding
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Kecerdasan39Koding
- anthropicAnthropic: Claude Sonnet 52026-06-3055Kecerdasan72Koding
Gemini 3.7 Flash telah tayang. Google merilis model berikutnya dalam tier Flash-nya pada 13 Agustus 2026 — hanya tiga minggu setelah Gemini 3.6 Flash — dan mengumumkannya dengan harga $0,75 per juta token input dan $3,75 per juta token output, tepatnya setengah dari harga Gemini 3.6 Flash yang $1,50/$7,50. Bocoran yang dilacak blog ini seminggu lalu ternyata akurat pada setiap poin yang penting: modelnya nyata, nama "3.7" bertahan hingga ID model resmi, dan harga setengah yang dirumorkan menjadi harga yang diumumkan.
Gemini 3.7 {{1}}Flash{{/1}} adalah model multimodal yang digambarkan oleh kartu model {{2}}Google{{/2}} sebagai model Flash terbaru dan paling mumpuni, dirancang untuk pengodean kompleks, alur kerja agen, dan eksekusi multi-langkah yang andal. Penyajian peluncuran {{3}}Google{{/3}} mengedepankan peningkatan dalam pengodean, pekerjaan pengetahuan, dan pengembangan web — klaim vendor, yang dikaji di bawah — sementara spesifikasinya sudah tercatat: jendela konteks 1 juta token yang sama yang telah distandardisasi oleh tier Flash, output 64K token, dan ketersediaan melalui Gemini API (termasuk {{4}}Google{{/4}} AI Studio), {{5}}Google{{/5}} Antigravity, Gemini Enterprise, dan Gemini Spark untuk pelanggan AI Pro dan Ultra. Apa model ini, berapa biayanya, dan di mana ia berjalan kini sudah menjadi catatan; pertanyaan terbukanya adalah apa yang sebenarnya diberikannya.
Satu disiplin dari liputan kebocoran tersebut langsung terbawa ke artikel peluncuran: klaim kinerja Google dilaporkan oleh vendor hingga pengukuran independen mengonfirmasinya. Angka independen pertama muncul dalam sehari — Artificial Analysis memberi skor Gemini 3.7 Flash 56 pada Intelligence Index-nya dengan penalaran tinggi, empat poin di atas 52 yang dicetak Gemini 3.6 Flash saat peluncuran dan, menurut AA, berada di frontier Pareto antara kecerdasan dan kecepatan. Angka tolok ukur Google sendiri untuk coding, pekerjaan pengetahuan, dan pengembangan web masih merupakan klaim vendor. Anggaplah harga, jendela konteks, dan ketersediaan sebagai fakta. Anggaplah delta kinerja sebagai janji yang sedang diuji.
Dari kebocoran hingga peluncuran: sinyal-sinyal yang terkonfirmasi
Karena model ini pertama kali dilacak di sini sebagai kebocoran yang belum terverifikasi, ada baiknya mencatat bagaimana kebocoran itu berkembang — ini adalah perbedaan antara rumor dan pola yang kini telah ditunjukkan oleh tingkatan Flash secara berulang kali.
Postingan X tanggal 7 Agustus dari @chetaslua mengatakan bahwa persiapan untuk Gemini 3.7 Flash sudah "beres di pihak mereka," tanpa menyebut tanggal. Enam hari kemudian model tersebut dirilis. Perkiraan "lebih cepat daripada nanti" ternyata benar.
• Referensi 7–8 Agustus terhadap gemini-3.7-flash di dalam Python GenAI SDK milik Google sendiri di GitHub menunjuk pada ID model yang nyata — ID yang sama yang sekarang ada di Gemini API.
Laporan tanggal 13 Agustus bahwa Gemini 3.7 Flash ditempatkan di Gemini Enterprise dalam keadaan tersembunyi dengan kemungkinan rilis pada hari yang sama akurat mengenai tanggalnya, dan rumor harga $0.75/$3.75 akurat mengenai harganya.
Tidak ada satu pun dari itu yang membuat cakupan kebocoran menjadi berlebihan — sinyal yang sama ini bisa saja menghasilkan "ditunda" atau "diganti nama." Tetapi tingkatan yang dirilis secepat ini, setenang ini, dan semurah ini adalah alasan mengapa Google terus melakukan pekerjaannya yang paling menarik dalam Flash.
Apa yang sudah dikonfirmasi versus apa yang masih sekadar klaim.
Sekarang setelah modelnya aktif, pembukuan dari postingan bocor berbalik: sebagian besar dari apa yang "dilaporkan" telah masuk ke kolom terkonfirmasi, dan ketidakpastian yang tersisa adalah tentang kinerja, bukan keberadaannya.
• Dikonfirmasi — Google telah menerbitkan kartu model Gemini 3.7 Flash; model tersebut tersedia melalui Gemini API, Google AI Studio, Google Antigravity, Gemini Enterprise, dan Gemini Spark; harga yang diumumkan adalah $0.75/$3.75 per juta token hingga 31 Desember 2026; jendela konteksnya adalah 1 juta token dengan output 64K token.
• Diukur secara independen — Artificial Analysis menempatkan Gemini 3.7 Flash pada Intelligence Index-nya dalam sehari setelah peluncuran: 56 untuk penalaran tinggi (53 untuk sedang, 51 untuk rendah), empat poin di atas 52 yang dicetak Gemini 3.6 Flash saat peluncuran, dengan peningkatan yang sebagian besar diatribusikan AA pada evaluasi agentik.
• Dilaporkan vendor — Angka evaluasi Google sendiri untuk kasus penggunaan utama: 43.6% pada FrontierCode 1.1 (naik dari 34.4%), 65.3% pada DeepSWE v1.1, Elo 1588 di arena pengembangan web di mana menurut Google ia menempati peringkat #1, 34.0% pada GDP.pdf, dan 30.4% pada AutomationBench. Ini adalah angka-angka Google sampai pihak luar mereproduksinya.
• Belum diketahui — apakah Google memperpanjang tarif pengenalan melewati 31 Desember 2026 (tarifnya berlipat ganda menjadi $1,50/$7,50 pada 1 Januari 2027), apakah keuntungan tersebut mengubah kalkulasi yang selama ini membuat Gemini 3.5 Pro belum dirilis, dan bagaimana model tersebut bertahan pada beban kerja yang tidak diiklankan oleh vendor.
Sebagai konteks atas klaim-klaim "keunggulan atas Gemini 3.6 Flash" tersebut, inilah baseline independen yang menjadi acuan pengukuran Google:

Indeks Kecerdasan Artificial Analysis yang diukur secara independen dari Gemini 3.6 Flash sebesar 52 (peringkat #26 dari 185 model saat peluncuran) dan harga inputnya sebesar $1,50/1M adalah angka-angka yang harus diungguli Gemini 3.7 Flash — dan harga 3.7 itu sudah memangkas harga input 3.6 hingga setengahnya sebelum perbandingan performa apa pun dimulai.
Mengapa harga menjadi judul utama
Setengah harga adalah bagian yang paling menentukan dari peluncuran ini, dan perhitungannya sederhana. Pada beban kerja input 1M-token / output 1M-token, Gemini 3.6 Flash berbiaya $1.50 ditambah $7.50, atau $9.00. Gemini 3.7 Flash dengan tarif yang diumumkan berbiaya $0.75 ditambah $3.75, atau $4.50 — potongan 50% pada volume yang sama, dan jika perbaikan efisiensi yang diklaim Google bertahan, biaya efektif per tugas yang selesai turun lebih jauh lagi.
Dua peringatan yang perlu dicatat. Pertama, tarif $0.75/$3.75 bersifat perkenalan dan terbatas waktu: Google telah mengonfirmasi tarif ini berlaku hingga 31 Desember 2026, dan berlipat ganda menjadi $1.50/$7.50 pada 1 Januari 2027. Kedua, beberapa platform saat ini menawarkan harga promosi di bawah tarif yang diumumkan, jadi periksa harga langsung pada saat panggilan untuk mengetahui berapa yang sebenarnya akan Anda bayar — tarif yang diumumkan adalah batas bawah yang andal, tetapi itu adalah batas bawah yang memiliki tanggal.
Latar belakang Gemini 3.5 Pro masih penting.
Google's flagship Gemini 3.5 Pro masih belum dirilis hingga 14 Agustus 2026 — berbulan-bulan setelah I/O, dengan Bloomberg melaporkan pada pertengahan Juli bahwa model tersebut tertunda jadwal karena masalah kemampuan coding, dan laporan-laporan selanjutnya menggambarkan kemunduran tenggat waktu internal. Tingkatan Flash terus memberikan hasil sementara tingkatan Pro mandek, itulah sebabnya Flash yang lebih cepat dan setengah harga menjadi peristiwa yang lebih besar daripada perilisan poin biasa: ini adalah bukti bahwa lini andalan Google adalah tempat perusahaan itu benar-benar bersaing.
Jangan bingung dengan Qwen 3.7 Flash.
Kedua model "3.7 Flash" kini sudah dirilis, dan keduanya tidak bisa lebih berbeda.
• Gemini 3.7 Flash — model Flash-tier baru dari Google dengan harga $0.75/$3.75 per juta token, konteks 1M, multimodal, diumumkan pada 13 Agustus 2026.
• Qwen 3.7 Flash — model visi-bahasa milik Alibaba yang diluncurkan secara diam-diam pada akhir Juli 2026 dengan harga sekitar $0.03/$0.13 per juta token dan jendela konteks 1M, ditujukan untuk agen multimodal serta tugas penggunaan komputer.
Kesenjangan harga saja — sekitar 25x pada token input — memisahkan keduanya, dan vendor juga. Ketika seseorang berkata "Saya menjalankan 3.7 Flash," pertanyaan pertama tetap: yang mana.
Haruskah Anda beralih dari Gemini 3.6 Flash?
Jawaban yang jujur terbagi menjadi dua. Untuk biaya, harga setengah yang diumumkan adalah pengungkit yang nyata: jika Anda membayar volume yang signifikan di Gemini 3.6 Flash, beban kerja yang sama di Gemini 3.7 Flash memakan biaya setengahnya dalam token, sebelum ada klaim penghematan efisiensi. Itu adalah peralihan yang layak dimodelkan berdasarkan pola panggilan Anda sendiri. Untuk kepercayaan, situasinya membaik dalam sehari setelah peluncuran — Artificial Analysis Index independen sudah berada di angka 56 dibandingkan 52 milik 3.6 Flash — tetapi selisih spesifik untuk coding, kerja pengetahuan, dan pengembangan web yang dijual Google masih dilaporkan oleh vendor, dan Gemini 3.6 Flash tetap menjadi default yang stabil dan terdokumentasi. Pendekatan standar adalah mempertahankan model yang terbukti sebagai default dan mengarahkan sebagian lalu lintas ke model baru, membandingkan kualitas pada tugas-tugas Anda sendiri.
Tidak satu pun dari langkah tersebut memerlukan proyek jika Anda berada pada lapisan routing. Gemini 3.6 Flash dan Gemini 3.5 Flash keduanya tersedia hari ini melalui satu endpoint yang kompatibel dengan OpenAI di OrcaRouter dengan harga daftar penyedia tanpa markup — sehingga penurunan harga Google di mana pun dalam tingkatan tersebut akan terlihat di sisi kami pada hari yang sama, dan peralihan nanti dari satu model Flash ke model lainnya hanyalah perubahan nama model, bukan integrasi. Failover otomatis adalah pola untuk mengevaluasi model yang baru dirilis, bagaimana pun model itu disajikan: arahkan sebagian lalu lintas nyata ke model tersebut, biarkan router kembali ke model yang sudah terbukti saat terjadi kesalahan, batas kecepatan, atau penurunan kualitas yang jelas, dan pertahankan model lama sebagai jaring pengaman hingga model baru layak menerima lalu lintas tersebut. DSL perutean dan fusi model memungkinkan Anda menggabungkan model baru dengan model lain dalam satu panggilan, sehingga mengujinya terhadap beban kerja Anda sendiri hanyalah perubahan konfigurasi.
Tontonan Berikutnya
• Pemeriksaan independen berikutnya — Artificial Analysis telah menerbitkan Intelligence Index-nya (56 pada penalaran tinggi), sehingga pertanyaan terbuka telah bergeser dari "apakah keuntungan itu nyata" menjadi apakah klaim benchmark coding dan pengembangan web Google bertahan dalam reproduksi eksternal dan berlaku pada beban kerja Anda sendiri.
Harga — tarif $0,75/$3,75 kini menjadi fakta bertanggal: berlaku hingga 31 Desember 2026, lalu dua kali lipat. Perhatikan apakah Google memperpanjangnya, dan apakah harga promosi pihak ketiga menyesuaikan diri ke tarif tersebut.
• Gemini 3.5 Pro — jika andalan Google akhirnya rilis, sudut pandang 'Flash adalah tempat Google menyampaikan hasil' dari bulan lalu mungkin bergeser.
FAQ
Apakah Gemini 3.7 Flash sudah dirilis?
Ya — pada 13 Agustus 2026. Google telah menerbitkan kartu model Gemini 3.7 Flash yang menggambarkannya sebagai model Flash terbaru dan paling mumpuni; ID gemini-3.7-flash disediakan melalui Gemini API, dan Google mencantumkannya di Google AI Studio, Google Antigravity, Gemini Enterprise, dan Gemini Spark. Ini adalah model yang persiapannya dilaporkan di sini sebagai bocoran pada 7 Agustus.
Berapa harga Gemini 3.7 Flash?
$0,75 per juta token masukan dan $3,75 per juta keluaran pada harga pengantar yang diumumkan — setengah dari $1,50/$7,50 Gemini 3.6 Flash, menurut pengumuman Google. Tarif ini dikonfirmasi hingga 31 Desember 2026, dan berlipat ganda menjadi $1,50/$7,50 pada 1 Januari 2027. Beberapa platform saat ini menjalankan harga promosi di bawah tarif yang diumumkan, jadi tarif langsung pada saat panggilan adalah yang akan Anda bayar.
Haruskah saya meningkatkan dari Gemini 3.6 Flash ke Gemini 3.7 Flash?
Harganya setengah dan skor independen pertama telah masuk — Artificial Analysis Index 56 pada penalaran tinggi, naik dari 52 milik 3.6 Flash — tetapi peningkatan utama Google dalam coding, kerja pengetahuan, dan pengembangan web masih dilaporkan oleh vendor. Praktik standar: pertahankan Gemini 3.6 Flash sebagai default, evaluasi Gemini 3.7 Flash pada beban kerja Anda sendiri dengan failover, dan beralih ketika ia layak menerima traffic.
Gemini 3.7 Flash adalah tier Flash yang melakukan persis apa yang tier Flash lakukan — meluncur cepat, meluncur lebih murah, dan kali ini hadir dengan skor independen yang mengungguli pendahulunya. Bocoran itu tepat soal nama, tanggal, dan harga; klaim performa masih dalam pengujian. Jika biaya per tugas adalah pengungkit Anda, harga setengahnya membuat Gemini 3.7 Flash layak di-benchmark hari ini. Jika stabilitas adalah prioritas Anda, Gemini 3.6 Flash tetap menjadi pilihan yang terbukti — dan pindah nanti hanyalah perubahan nama model, bukan proyek.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
