Kartu judul untuk perbandingan Gemini 3.7 Flash versus Claude Opus 5, menampilkan kartu sprinter cepat berlabel Gemini 3.7 Flash dengan label harga $0.75 / $3.75, kartu menara tinggi berlabel Claude Opus 5 dengan label harga $5 / $25, dan ikon pecahan kecil 1/6 di antara keduanya.
Guides & Insights

Gemini 3.7 Flash vs Claude Opus 5: Apa yang Anda Dapat dari Pekerja Keras dengan Seperenam Harganya

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Inilah angka yang membuat perbandingan ini layak dilakukan: Claude Opus 5, andalan Anthrop​ic, mencetak skor 61 pada Artificial Analysis Intelligence Index, sementara Gemini 3.7 Flash, kuda kerja Go​ogle yang dirilis pada 13 Agustus 2026, mencetak skor 56. Lima poin. Dan dengan tarif promosi yang berlaku hingga akhir tahun, Gemini 3.7 Flash berharga $0,75 per juta token input dan $3,75 per juta output — sekitar seperenam dari $5,00 / $25,00 milik Claude Opus 5. Kesenjangan yang dulunya memisahkan "kuda kerja" dari "andalan" telah menyempit hingga titik di mana pertanyaan yang jujur bukanlah apakah model murah itu bagus, tetapi apa yang masih bisa dilakukan model mahal yang tidak bisa dilakukan model murah.

Cara membingkai perbandingan ini penting, karena ini bukan pertarungan yang setara, dan berpura-pura sebaliknya akan menyesatkan Anda. Claude Opus 5, dirilis pada 24 Juli 2026, adalah model umum paling canggih milik Anthrop​ic: model penalaran dengan konteks 1M token dan batas keluaran 128K, dirancang untuk tugas-tugas rekayasa, riset, dan penggunaan komputer yang paling sulit. Gemini 3.7 Flash adalah kuda kerja volume tinggi milik Go​ogle: konteks 1M, keluaran 64K, masukan teks/gambar/audio/video, dan spesifikasi desain yang merupakan kebalikan dari Opus — mengalirkan token sebanyak mungkin, semurah mungkin, untuk 95% lalu lintas yang bersifat rutin. Membandingkan keduanya berdasarkan satu angka saja adalah cara Anda mendapatkan jawaban yang salah; membandingkannya berdasarkan bentuk pekerjaan yang sebenarnya Anda jalankan adalah cara mendapatkan jawaban yang berguna.

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Lima poin, dijabarkan

Indeks Kecerdasan bukanlah skala linear, dan selisih antara 56 dan 61 lebih berharga pada beberapa tugas daripada yang lain. Opus 5 yang mendapat 61 berasal dari keunggulan pada anggota-anggota tersulit dalam gabungan tersebut — nilai 30.2 pada ARC-AGI-3, 43.3 pada FrontierBench, dan 79.2 pada SWE-bench Pro semuanya dilaporkan oleh vendor, tetapi itu adalah jenis hasil penalaran kelas frontier yang tidak dapat disentuh oleh model kelas Flash. Skor 56 Gemini 3.7 Flash diperoleh dengan cara berbeda: angka yang dilaporkan Go​ogle untuk model tersebut (65.3 pada DeepSWE v1.1, 1588 Elo pada WebDev Arena, 30.4 pada AutomationBench) menunjukkan model yang unggul dalam rekayasa dan agen yang terbatas serta bervolume tinggi, bukan dalam penalaran terbuka yang baru. Lima poin indeks karena itu menggambarkan jurang kemampuan yang nyata, meskipun jarak utama terlihat kecil.

• Intelligence Index — 56 untuk Gemini 3.7 Flash dibandingkan 61 untuk Claude Opus 5 (upaya maksimal), menurut Artificial Analysis.

• Kecepatan output — ~340 token/detik untuk Gemini 3.7 Flash, sedangkan ~53 token/detik untuk Claude Opus 5, keduanya menurut Artificial Analysis. Selisih 6,4x.

• Jendela konteks — 1M token untuk keduanya, tetapi batas atas keluaran Claude Opus 5 adalah 128K dibandingkan dengan 64K milik Gemini 3.7 Flash.

• Harga input — $0,75 (promosi, hingga 2026) dibanding $5,00 — selisih 6,7x.

• Harga output — $3,75 (promosi) dibandingkan $25,00 — selisih 6,7 kali lipat.

• Input multimodal — Gemini 3.7 Flash menerima teks, gambar, audio, dan video; Claude Opus 5 hanya teks dan gambar.

A comparison scoreboard for Gemini 3.7 Flash and Claude Opus 5: Claude Opus 5 leads 61 to 56 on the AA Index and 128K to 64K on max output, but Gemini 3.7 Flash leads ~340 to ~53 tokens per second, $0.75 to $5.00 input and $3.75 to $25.00 output, with both at 1M context.

Di mana Claude Opus 5 masih sepadan dengan harganya

Kasus produk unggulan ini bukan nostalgia, melainkan ekor dari distribusi tugas. Rekayasa otonom berwawasan panjang — sebuah model yang dibiarkan sendirian dengan basis kode selama satu jam untuk merencanakan, mengedit, menguji, dan melakukan iterasi — adalah tempat di mana keunggulan Opus 5 yang dilaporkan paling lebar, dan hasil penggunaan komputernya (71 di OSWorld, dilaporkan vendor) menempatkannya dalam kelas yang tidak dimasuki Gemini 3.7 Flash. Tim yang bermigrasi dari Claude Opus 4.8 juga harus tahu bahwa Opus 5 hadir dengan pemikiran adaptif yang aktif secara default dengan tingkat upaya yang dikalibrasi ulang, dan bahwa menonaktifkan pemikiran dibatasi pada upaya tinggi — perubahan perilaku yang dapat merusak pipeline yang ada. Semua itu tidak menjadikannya pilihan yang salah untuk pekerjaan berat; itu menjadikannya pilihan yang tepat untuk sebagian pekerjaan yang lebih sempit daripada yang disarankan oleh harganya.

Hal lain yang dijual Opus 5 adalah ekonomi platform Anthropic. Prompt caching-nya dapat memangkas biaya input efektif hingga 90% untuk cache hit, dan tier batch-nya memangkas harga hingga setengah untuk lalu lintas asinkron — sehingga beban kerja dengan cache dan batch tinggi pada Opus 5 ditagih jauh lebih mendekati bayangan harga stikernya daripada yang disiratkan oleh headline $5 / $25. Harga riil model premium bergantung pada beban kerja; harga model andalan tidak.

Di mana Gemini 3.7 Flash adalah pilihan yang lebih cerdas

Untuk apa pun yang mengalir, diproses dalam batch, atau mengandalkan konteks panjang, pekerja andalannya {{1}}bukan sekadar lebih murah, tetapi secara struktural memiliki posisi yang lebih baik{{/1}}. {{2}}Keunggulan kecepatan keluaran 6.4x mengubah apa yang dapat Anda bangun{{/2}}: {{3}}penyelesaian kode interaktif, perangkuman langsung dari seluruh repositori, loop agen yang membutuhkan banyak panggilan per menit{{/3}} — {{4}}semua ini menabrak tembok throughput pada model 53-token/s jauh sebelum menabrak tembok kualitas{{/4}}. {{5}}Gemini 3.7 Flash juga menerima input audio dan video{{/5}}, yang membuka kasus penggunaan ({{6}}transkripsi rapat, pemahaman bingkai video{{/6}}) yang {{7}}tidak dilakukan model Claude mana pun{{/7}} pada sumbu input tersebut. Dan {{8}}tingkat berpikir yang dapat disesuaikan berarti Anda dapat menjalankannya dengan upaya rendah untuk pekerjaan rutin yang murah dan dengan upaya tinggi untuk subset yang lebih sulit{{/8}}, {{9}}hanya membayar untuk penalaran yang Anda gunakan{{/9}}.

Buku Panduan Memasangkan

Para praktisi di lapangan sebagian besar telah berhenti memperlakukan ini sebagai pilihan salah satu/atau yang lain, dan pola yang terus muncul adalah loop divide-and-conquer: Claude Opus 5 melakukan perencanaan dan desain, Gemini 3.7 Flash melakukan implementasi bervolume tinggi, dan Opus 5 meninjau. Setiap model digunakan di tempat yang rasio kualitas terhadap biayanya paling baik, dan pipeline gabungan lebih murah dan lebih cepat daripada menjalankan salah satunya saja. Sebuah lapisan routing membuat pola itu praktis, bukan sekadar arsitektural: Claude Opus 5 live di OrcaRouter dengan harga daftar Anthrop​ic tanpa markup 0%, dan DSL routing memungkinkan Anda menyusun satu panggilan yang mengirim perencana ke Opus 5 dan pelaksana ke seluruh model kelas Flash di belakang satu endpoint yang kompatibel dengan OpenAI — dengan fusion model sebagai langkah lebih lanjut, di mana kedua model menjawab pertanyaan yang sama dan seorang juri merekonsiliasi kedua putusan tersebut.

The OrcaRouter model page for Claude Opus 5, showing Anthropic's $5.00 per million input and $25.00 per million output list pricing and a 1M-token context window.

RUU, berdampingan

Mari kita gunakan angka-angka nyata. Satu hari dengan 10 juta token masukan dan 1 juta token keluaran — sebuah pipeline agentik yang berat namun biasa — memakan biaya $75 + $375 = $450 dengan tarif standar Claude Opus 5. Lalu lintas yang sama dengan tarif promosi Gemini 3.7 Flash memakan biaya $7.50 + $37.50 = $45, persis sepersepuluhnya. Bahkan dengan memperhitungkan diskon cache Opus di sisi masukan, selisihnya tetap satu orde besarnya, dan itulah alasan "flash untuk sebagian besar, opus untuk ekor yang sulit" telah menjadi bentuk produksi standar, bukan yang eksotis. Saat promosi berakhir, tarif masukan Gemini 3.7 Flash menjadi dua kali lipat menjadi $1.50 — masih sepertiga dari tarif Opus, dan masih cukup murah untuk menjaga perhitungan pasangan ini tetap utuh.

Pembacaan yang jujur

Kesenjangan lima poin itu nyata dan berada persis di tempat yang Anda duga: pada pekerjaan dengan cakrawala terpanjang dan paling sulit. Jika beban kerja Anda didominasi oleh ekor itu — riset perbatasan, rekayasa otonom selama berjam-jam, penggunaan komputer — Claude Opus 5 membenarkan harganya dan Anda tidak perlu terlalu memikirkannya. Jika beban kerja Anda didominasi oleh volume, latensi, atau konteks panjang, Gemini 3.7 Flash dengan tarif promosi adalah pembelian yang jauh lebih baik, dan jarak ke model andalan hanyalah satu tingkat tolok ukur, bukan jurang. Model-model tersebut semakin konvergen, dan jawaban praktis bagi sebagian besar tim bukan lagi "yang mana" melainkan "bagian mana dari pekerjaan yang diberikan kepada masing-masing."

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari