Kartu judul untuk perbandingan Gemini 3.7 Flash versus Grok 4.6, menampilkan label harga diskon 50% dengan petir di sisi Gemini 3.7 Flash yang berhadapan dengan perisai bertanda centang di sisi Grok 4.6.
Guides & Insights

Gemini 3.7 Flash vs Grok 4.6: Perang Harga Google vs Agen Pemeriksa Mandiri SpaceXAI

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Tiga minggu setelah Gemini 3.6 Flash sebagian besar gagal, Go​ogle memangkas harga hingga setengahnya dan meluncurkan Gemini 3.7 Flash — sebuah langkah yang dibaca sebagian besar liputan sebagai serangan langsung terhadap Grok 4.6, andalan yang disetel untuk agen yang SpaceXAI luncurkan sehari sebelumnya dengan harga $2 dan $6. Waktu adalah inti ceritanya: dua model yang nyaris frontier, berselisih satu hari, sama-sama menyasar pembeli yang sama — tim yang menginginkan coding agen tanpa membayar harga frontier — dan dibanderol dengan filosofi yang berlawanan. Go​ogle membeli respons dengan promosi lima bulan. SpaceXAI menjual kepercayaan per tugas dengan harga daftar tetap.

Grok 4.6, dirilis pada 12 Agustus 2026, adalah penyempurnaan SpaceXAI atas fondasi Grok 4.5 berparameter 1,5 triliun, yang dibangun untuk agen berdurasi panjang yang memverifikasi penyelesaian subtugas mereka sendiri, dengan jendela konteks 500K, masukan teks dan gambar, serta tarif $2/$6 yang berlipat ganda pada token masukan di atas 200K+. Gemini 3.7 Flash, dirilis pada 13 Agustus 2026, adalah penyempurnaan algoritmik Go​ogle atas Gemini 3.6 Flash — konteks 1M, masukan multimodal termasuk video dan audio, dan tarif promosi $0,75/$3,75 yang berlipat ganda menjadi $1,50/$7,50 pada 1 Januari 2027. Pada indeks Artificial Analysis Intelligence yang independen, Grok 4.6 berada di angka 61, jelas lebih tinggi dari pembacaan awal sekitar 56 untuk Gemini 3.7 Flash.

Perang harga, satu baris per dimensi

Harga per 1 juta input — Gemini 3.7 Flash $0.75 (intro) vs Grok 4.6 $2.00. Google memangkas harga hingga lebih dari 60%.

Harga per 1M output — Gemini 3.7 Flash $3,75 (perkenalan) vs Grok 4.6 $6,00.

Setelah 1 Januari 2027Gemini berlipat ganda menjadi $1.50/$7.50 vs Grok tidak berubah pada $2/$6.

Jendela konteks — Gemini 3.7 Flash 1M vs Grok 4.6 500K.

Penagihan input panjang — Gemini mengenakan tarif tetap di seluruh jendelanya; Grok berlipat ganda menjadi $4/$12 pada input 200K atau lebih.

Token berpikir — Gemini memperhitungkannya sebagai output; biaya Grok diukur secara independen sekitar $0,84 per tugas.

Ringkasannya: Gemini 3.7 Flash lebih murah di setiap baris label harga hari ini, dan sebagian besar keunggulan itu hilang pada tanggal 1 Januari. Grok 4.6 memiliki harga yang sama di bulan Agustus seperti yang akan dimilikinya di bulan Maret.

A comparison scoreboard for Gemini 3.7 Flash and Grok 4.6: Gemini at AA Index ~56, $0.75/$3.75 intro pricing, 1M context, Google-reported GDPVal-AA v2 of 1,525 and per-task cost not yet measured, versus Grok 4.6 at AA Index 61, $2/$6, 500K context, GDPVal-AA v2 of 1,753 and about $0.84 per task per Artificial Analysis, both proprietary.

Ke mana uang Gemini 3.7 Flash pergi

Angka Go​ogle sendiri melaporkan lompatan besar untuk Gemini 3.7 Flash dibandingkan 3.6 Flash: 65,3% pada DeepSWE v1.1 (naik dari 49,0%), 43,6% pada FrontierCode 1.1 Main (naik dari 34,4%), 85,8% pada Terminal-bench 2.1 (naik dari 78,0%), dan Elo WebDev Arena 1588 (naik dari 1538). Ini adalah angka yang dilaporkan vendor, belum direproduksi — jenis angka yang mengukur lintasan, bukan vonis antar-vendor. Tetapi lintasannya justru intinya: perbaikan tersebut hadir tiga minggu setelah peluncuran yang oleh para pengulas secara luas dianggap gagal, yang memberi tahu Anda bahwa Go​ogle memperlakukan tingkat Flash sebagai medan pertempuran, bukan unggulan.

Hal lain yang dilakukan {{1}}promosi Google{{/1}} adalah mempersingkat jendela pembelian. Pada $0.75/$3.75, model ini cukup murah untuk diuji secara massal; pada $1.50/$7.50, model ini masih kompetitif tetapi tidak lagi menjadi senjata perang harga. Tim produksi mana pun yang mengadopsinya dalam jendela perkenalan harus mengevaluasi ulang ekonominya pada bulan Desember, tidak berasumsi bahwa {{2}}angkanya bergerak bersama mereka{{/2}}.

Ke mana uang Grok 4.6 pergi

Pitch Grok 4.6 berbeda: bukan token yang lebih murah, tetapi token yang lebih sedikit terbuang. Model ini dilatih untuk melakukan verifikasi mandiri — untuk memeriksa bahwa subtugas benar-benar selesai sebelum melanjutkan — dan pengukuran independen mendukung efeknya: Artificial Analysis memperkirakan biayanya sekitar $0,84 per tugas, dengan GDPVal-AA v2 sebesar 1.753 dan Intelligence Index 61. Itu adalah angka pihak ketiga, dan itu adalah angka terkuat dalam pertandingan ini, karena mereka menangkap hal yang dilewatkan oleh harga per token: model yang membutuhkan lebih sedikit langkah untuk menyelesaikan pekerjaan lebih murah per pekerjaan selesai bahkan pada harga token yang lebih tinggi.

Trade-off-nya adalah di mana model yang lebih murah memiliki ruang. Konteks 500K milik Grok 4.6 adalah setengah dari 1M milik Gemini 3.7 Flash, dan tarif $2/$6-nya berlipat ganda di atas input 200K — jadi beban kerja dengan konteks panjang dan input tinggi justru menjadi titik di mana harga daftar Grok 4.6 tidak lagi kompetitif dengan tarif promosi Gemini.

Ekonomi per-tugas

Pada harga perkenalan, tarif gabungan Gemini 3.7 Flash dengan pembagian input/output 80/20 kira-kira $1,35 per juta token; harga tertera Grok 4.6 pada pembagian yang sama adalah $2,80 per juta sebelum penalti input panjangnya. Di atas kertas, model Go​ogle tampak seperti pemenang volume dengan selisih jauh. Komplikasinya adalah token berpikir Gemini ditagih sebagai output, klaim benchmark-nya sudah berumur satu minggu, dan efisiensi per-tugasnya belum diukur secara independen — sementara Grok 4.6 sudah. Token murah ditambah giliran yang terbuang bisa memakan biaya lebih besar daripada token mahal yang menyelesaikan tugas, dan ini adalah pertandingan di mana satu pihak memiliki data tentang pertanyaan itu dan pihak lainnya tidak.

Bertaruh pada model baru tanpa bertaruh pada pipeline.

Grok 4.6 ada di OrcaRouter dengan harga daftar SpaceXAI sebesar $2/$6 dengan markup 0%, termasuk langkah 2x di atas 200K yang ditarik langsung oleh halaman model dari lapisan routing. Gemini 3.7 Flash baru berumur satu hari dan berada di API Google sendiri; pendahulunya, Gemini 3.6 Flash, ada di OrcaRouter dengan harga daftar Google.

The OrcaRouter model page for grok/grok-4.6, showing the New and Featured badges, the $2.00 per million input and $6.00 per million output pricing, a 500K-token context window, and the released August 12, 2026 label.The OrcaRouter model page for google/gemini-3.6-flash, showing the $1.50 per million input and $7.50 per million output pricing and the 1M-token context window.

Jika pertanyaan yang sebenarnya ingin dijawab oleh perbandingan ini adalah "haruskah saya mempertaruhkan pipeline agen saya pada model murah yang baru," lapisan routing adalah lindung nilainya: aturan failover yang menjalankan agen pada Grok 4.6 hari ini dan beralih ke Gemini 3.7 Flash begitu model itu rilis, atau panel fusi tempat keduanya menjawab dan seorang penilai menyelaraskan keduanya — jenis pengaturan yang memang menjadi alasan DSL routing diciptakan, dan yang tidak mengharuskan Anda memilih salah satu sisi sebelum bukti masuk.

Pembacaan yang jujur

Jika Anda ingin token termurah hari ini dan percaya pada penyelesaian dalam tiga minggu, Gemini 3.7 Flash adalah taruhan agresif — perang harga itu nyata, peningkatan benchmark telah dilaporkan, dan masa perkenalan adalah diskon yang sesungguhnya. Jika Anda menginginkan model yang efisiensi agennya diukur secara independen, yang harganya tidak berubah di bulan Januari, dan yang siklus verifikasi mandirinya dirancang untuk pekerjaan jangka panjang, Grok 4.6 adalah pilihan konservatif, dan data AA memberinya keunggulan pada biaya per tugas yang selesai. Satu sisi adalah obral dengan hitung mundur; sisi lainnya adalah harga dengan rekam jejak. Keduanya dapat dipertahankan — itulah yang menjadikan ini perbandingan yang nyata, bukan sekadar formalitas.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

providers@orcarouter.ai

Gabung komunitas kami

Discordsupport@orcarouter.aiXGitHubYouTube