
Gemini 3.7 Flash vs Claude Opus 5: Apa yang Anda Dapat dari Pekerja Keras dengan Seperenam Harganya
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 221 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 106 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Inilah angka yang membuat perbandingan ini layak dilakukan: Claude Opus 5, andalan Anthropic, mencetak skor 61 pada Artificial Analysis Intelligence Index, sementara Gemini 3.7 Flash, kuda kerja Google yang dirilis pada 13 Agustus 2026, mencetak skor 56. Lima poin. Dan dengan tarif promosi yang berlaku hingga akhir tahun, Gemini 3.7 Flash berharga $0,75 per juta token input dan $3,75 per juta output — sekitar seperenam dari $5,00 / $25,00 milik Claude Opus 5. Kesenjangan yang dulunya memisahkan "kuda kerja" dari "andalan" telah menyempit hingga titik di mana pertanyaan yang jujur bukanlah apakah model murah itu bagus, tetapi apa yang masih bisa dilakukan model mahal yang tidak bisa dilakukan model murah.
Cara membingkai perbandingan ini penting, karena ini bukan pertarungan yang setara, dan berpura-pura sebaliknya akan menyesatkan Anda. Claude Opus 5, dirilis pada 24 Juli 2026, adalah model umum paling canggih milik Anthropic: model penalaran dengan konteks 1M token dan batas keluaran 128K, dirancang untuk tugas-tugas rekayasa, riset, dan penggunaan komputer yang paling sulit. Gemini 3.7 Flash adalah kuda kerja volume tinggi milik Google: konteks 1M, keluaran 64K, masukan teks/gambar/audio/video, dan spesifikasi desain yang merupakan kebalikan dari Opus — mengalirkan token sebanyak mungkin, semurah mungkin, untuk 95% lalu lintas yang bersifat rutin. Membandingkan keduanya berdasarkan satu angka saja adalah cara Anda mendapatkan jawaban yang salah; membandingkannya berdasarkan bentuk pekerjaan yang sebenarnya Anda jalankan adalah cara mendapatkan jawaban yang berguna.

Lima poin, dijabarkan
Indeks Kecerdasan bukanlah skala linear, dan selisih antara 56 dan 61 lebih berharga pada beberapa tugas daripada yang lain. Opus 5 yang mendapat 61 berasal dari keunggulan pada anggota-anggota tersulit dalam gabungan tersebut — nilai 30.2 pada ARC-AGI-3, 43.3 pada FrontierBench, dan 79.2 pada SWE-bench Pro semuanya dilaporkan oleh vendor, tetapi itu adalah jenis hasil penalaran kelas frontier yang tidak dapat disentuh oleh model kelas Flash. Skor 56 Gemini 3.7 Flash diperoleh dengan cara berbeda: angka yang dilaporkan Google untuk model tersebut (65.3 pada DeepSWE v1.1, 1588 Elo pada WebDev Arena, 30.4 pada AutomationBench) menunjukkan model yang unggul dalam rekayasa dan agen yang terbatas serta bervolume tinggi, bukan dalam penalaran terbuka yang baru. Lima poin indeks karena itu menggambarkan jurang kemampuan yang nyata, meskipun jarak utama terlihat kecil.
• Intelligence Index — 56 untuk Gemini 3.7 Flash dibandingkan 61 untuk Claude Opus 5 (upaya maksimal), menurut Artificial Analysis.
• Kecepatan output — ~340 token/detik untuk Gemini 3.7 Flash, sedangkan ~53 token/detik untuk Claude Opus 5, keduanya menurut Artificial Analysis. Selisih 6,4x.
• Jendela konteks — 1M token untuk keduanya, tetapi batas atas keluaran Claude Opus 5 adalah 128K dibandingkan dengan 64K milik Gemini 3.7 Flash.
• Harga input — $0,75 (promosi, hingga 2026) dibanding $5,00 — selisih 6,7x.
• Harga output — $3,75 (promosi) dibandingkan $25,00 — selisih 6,7 kali lipat.
• Input multimodal — Gemini 3.7 Flash menerima teks, gambar, audio, dan video; Claude Opus 5 hanya teks dan gambar.

Di mana Claude Opus 5 masih sepadan dengan harganya
Kasus produk unggulan ini bukan nostalgia, melainkan ekor dari distribusi tugas. Rekayasa otonom berwawasan panjang — sebuah model yang dibiarkan sendirian dengan basis kode selama satu jam untuk merencanakan, mengedit, menguji, dan melakukan iterasi — adalah tempat di mana keunggulan Opus 5 yang dilaporkan paling lebar, dan hasil penggunaan komputernya (71 di OSWorld, dilaporkan vendor) menempatkannya dalam kelas yang tidak dimasuki Gemini 3.7 Flash. Tim yang bermigrasi dari Claude Opus 4.8 juga harus tahu bahwa Opus 5 hadir dengan pemikiran adaptif yang aktif secara default dengan tingkat upaya yang dikalibrasi ulang, dan bahwa menonaktifkan pemikiran dibatasi pada upaya tinggi — perubahan perilaku yang dapat merusak pipeline yang ada. Semua itu tidak menjadikannya pilihan yang salah untuk pekerjaan berat; itu menjadikannya pilihan yang tepat untuk sebagian pekerjaan yang lebih sempit daripada yang disarankan oleh harganya.
Hal lain yang dijual Opus 5 adalah ekonomi platform Anthropic. Prompt caching-nya dapat memangkas biaya input efektif hingga 90% untuk cache hit, dan tier batch-nya memangkas harga hingga setengah untuk lalu lintas asinkron — sehingga beban kerja dengan cache dan batch tinggi pada Opus 5 ditagih jauh lebih mendekati bayangan harga stikernya daripada yang disiratkan oleh headline $5 / $25. Harga riil model premium bergantung pada beban kerja; harga model andalan tidak.
Di mana Gemini 3.7 Flash adalah pilihan yang lebih cerdas
Untuk apa pun yang mengalir, diproses dalam batch, atau mengandalkan konteks panjang, pekerja andalannya {{1}}bukan sekadar lebih murah, tetapi secara struktural memiliki posisi yang lebih baik{{/1}}. {{2}}Keunggulan kecepatan keluaran 6.4x mengubah apa yang dapat Anda bangun{{/2}}: {{3}}penyelesaian kode interaktif, perangkuman langsung dari seluruh repositori, loop agen yang membutuhkan banyak panggilan per menit{{/3}} — {{4}}semua ini menabrak tembok throughput pada model 53-token/s jauh sebelum menabrak tembok kualitas{{/4}}. {{5}}Gemini 3.7 Flash juga menerima input audio dan video{{/5}}, yang membuka kasus penggunaan ({{6}}transkripsi rapat, pemahaman bingkai video{{/6}}) yang {{7}}tidak dilakukan model Claude mana pun{{/7}} pada sumbu input tersebut. Dan {{8}}tingkat berpikir yang dapat disesuaikan berarti Anda dapat menjalankannya dengan upaya rendah untuk pekerjaan rutin yang murah dan dengan upaya tinggi untuk subset yang lebih sulit{{/8}}, {{9}}hanya membayar untuk penalaran yang Anda gunakan{{/9}}.
Buku Panduan Memasangkan
Para praktisi di lapangan sebagian besar telah berhenti memperlakukan ini sebagai pilihan salah satu/atau yang lain, dan pola yang terus muncul adalah loop divide-and-conquer: Claude Opus 5 melakukan perencanaan dan desain, Gemini 3.7 Flash melakukan implementasi bervolume tinggi, dan Opus 5 meninjau. Setiap model digunakan di tempat yang rasio kualitas terhadap biayanya paling baik, dan pipeline gabungan lebih murah dan lebih cepat daripada menjalankan salah satunya saja. Sebuah lapisan routing membuat pola itu praktis, bukan sekadar arsitektural: Claude Opus 5 live di OrcaRouter dengan harga daftar Anthropic tanpa markup 0%, dan DSL routing memungkinkan Anda menyusun satu panggilan yang mengirim perencana ke Opus 5 dan pelaksana ke seluruh model kelas Flash di belakang satu endpoint yang kompatibel dengan OpenAI — dengan fusion model sebagai langkah lebih lanjut, di mana kedua model menjawab pertanyaan yang sama dan seorang juri merekonsiliasi kedua putusan tersebut.

RUU, berdampingan
Mari kita gunakan angka-angka nyata. Satu hari dengan 10 juta token masukan dan 1 juta token keluaran — sebuah pipeline agentik yang berat namun biasa — memakan biaya $75 + $375 = $450 dengan tarif standar Claude Opus 5. Lalu lintas yang sama dengan tarif promosi Gemini 3.7 Flash memakan biaya $7.50 + $37.50 = $45, persis sepersepuluhnya. Bahkan dengan memperhitungkan diskon cache Opus di sisi masukan, selisihnya tetap satu orde besarnya, dan itulah alasan "flash untuk sebagian besar, opus untuk ekor yang sulit" telah menjadi bentuk produksi standar, bukan yang eksotis. Saat promosi berakhir, tarif masukan Gemini 3.7 Flash menjadi dua kali lipat menjadi $1.50 — masih sepertiga dari tarif Opus, dan masih cukup murah untuk menjaga perhitungan pasangan ini tetap utuh.
Pembacaan yang jujur
Kesenjangan lima poin itu nyata dan berada persis di tempat yang Anda duga: pada pekerjaan dengan cakrawala terpanjang dan paling sulit. Jika beban kerja Anda didominasi oleh ekor itu — riset perbatasan, rekayasa otonom selama berjam-jam, penggunaan komputer — Claude Opus 5 membenarkan harganya dan Anda tidak perlu terlalu memikirkannya. Jika beban kerja Anda didominasi oleh volume, latensi, atau konteks panjang, Gemini 3.7 Flash dengan tarif promosi adalah pembelian yang jauh lebih baik, dan jarak ke model andalan hanyalah satu tingkat tolok ukur, bukan jurang. Model-model tersebut semakin konvergen, dan jawaban praktis bagi sebagian besar tim bukan lagi "yang mana" melainkan "bagian mana dari pekerjaan yang diberikan kepada masing-masing."
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
