Kartu hero yang dihasilkan berjudul 'Claude Haiku 5.5 vs Gemini 3.6 Flash' dengan kicker '7,5x BIAYA PER JAWABAN', menampilkan Claude Haiku 5.5 dengan Input $0,10, Output $0,50, dan Indeks 43,40 melawan Gemini 3.6 Flash dengan Input $0,75, Output $3,75, dan Indeks 33,98, di atas bilah yang bertuliskan 'Biaya per tugas yang diselesaikan $0,21 vs $1,60'.
Engineering & Research

Claude Haiku 5.5 vs Gemini 3.6 Flash: 7,5x Biaya per Jawaban, Model yang Sembilan Poin Lebih Rendah

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Claude Haiku 5.5 dan Gemini 3.6 Flash berada di tier yang sama dalam jajaran masing-masing — yang kecil, cepat, dan murah — dan di situlah kemiripannya berhenti. Pada Artificial Analysis Intelligence Index v4.3.2, Claude Haiku 5.5 mencetak 43,40 dalam konfigurasi Max-nya, dibandingkan 33,98 untuk Gemini 3.6 Flash dalam konfigurasi High-nya. Pada pengujian yang sama, biaya untuk satu tugas Index yang selesai adalah $0,21 pada Claude Haiku 5.5 dan $1,60 pada Gemini 3.6 Flash.

Baca kedua angka itu bersama-sama, karena jika dibaca sendiri-sendiri keduanya menyesatkan. Model yang lebih murah itu bukan hanya sedikit lebih murah; ia 7,5 kali lebih murah per tugas yang diselesaikan. Dan model yang ia kalahkan bukan hanya sedikit lebih lemah; ia lebih lemah 9,42 poin indeks, yang pada papan berisi 182 model adalah jarak antara kuartil atas dan titik tengah.

Kedua fakta itu berasal dari run independen yang sama, yang penting karena kartu vendor di sini tidak memberi tahu Anda satu pun dari keduanya. Anthropic meluncurkan Claude Haiku 5.5 pada 7 Oktober 2026; Google merilis Gemini 3.6 Flash pada 21 Juli 2026. Tiga bulan di antara keduanya adalah bagian yang menarik.

Kedua kartu itu, berdampingan

Per juta token dalam dolar AS. Tarif Anthropic dan Google berasal dari dokumentasi harga mereka sendiri; baris bersama adalah Artificial Analysis Intelligence Index v4.3.2. Di-cache 2026-10-08.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.6 Flash — the scoreboard' with rows Index v4.3.2 43.40 against 33.98, cost per task $0.21 against $1.60, input price $0.10 against $0.75, output tokens per task 162,164 against 41,606, Terminal Bench 4.0 0.3283 against 0.0707 and input modality 'text, image' against 'text, image, video, audio', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; Gemini 3.6 Flash is flagged deprecated on the board.'

• Input — Claude Haiku 5.5 $0,10 hingga 100.000 token dan $0,50 di atasnya; Gemini 3.6 Flash $0,75 tetap hari ini, naik menjadi $1,50 pada 1 Januari 2027.

• Keluaran — Claude Haiku 5.5 $0,50 hingga 100.000 token dan $2,50 di atasnya; Gemini 3.6 Flash $3,75 tetap hari ini, naik menjadi $7,50 pada tanggal yang sama.

• Input yang di-cache — Claude Haiku 5.5 $0.01 dan $0.05; Gemini 3.6 Flash $0.075, ditambah biaya penyimpanan $0.50 per juta token per jam.

• Konteks dan batas keluaran — 1 juta token untuk keduanya. Claude Haiku 5.5 membatasi respons pada 128.000 token; Gemini 3.6 Flash pada 65.536.

• Modalitas — Claude Haiku 5.5 menerima teks dan gambar. Gemini 3.6 Flash menerima teks, gambar, video, audio, dan file. Ini satu-satunya baris di mana pihak Google jelas lebih unggul, dan untuk pipeline pemahaman media, hal ini bisa menentukan seluruh pertanyaan.

• Skor independen — 43,40 untuk Claude Haiku 5.5 (Max) dibandingkan dengan 33,98 untuk Gemini 3.6 Flash (High).

• Biaya per tugas yang diselesaikan — $0,21 dibandingkan $1,60, pada evaluasi yang sama.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the pricing lines $0.10/$0.50 up to 100,000 tokens and $0.50/$2.50 over it, and the release line 'Released October 7, 2026'.

Mengapa per-task, bukan per-token, adalah angka yang harus digunakan

Kelipatan rate-card sudah terlihat seperti 7,5 pada input dan 7,5 pada output, jadi angka per tugas bukanlah kejutan di sini — tetapi ada baiknya menunjukkan mengapa kedua model berada di titik yang sama pada satu ukuran dan begitu berjauhan pada ukuran lainnya, karena aritmetika yang sama berlaku sebaliknya dalam perbandingan lain di batch ini.

Gemini 3.6 Flash adalah yang kurang bertele-tele di antara keduanya. Model ini menghasilkan 41.606 token keluaran per tugas Intelligence Index — 20.061 penalaran dan 21.545 jawaban — dibandingkan Claude Haiku 5.5 dengan 162.164, terbagi menjadi 129.047 penalaran dan 33.118 jawaban. Model Anthropic menghabiskan hampir empat kali lebih banyak token untuk melakukan pekerjaan yang sama, dan justru model inilah yang laju keluarannya sepertujuh dari Google, sehingga selisih token dan selisih laju berlipat, bukan saling meniadakan.

Kombinasi itu — meteran murah dikali pemakaian berat — adalah deskripsi jujur tentang ekonomi Claude Haiku 5.5, dan postingan peluncuran Anthropic sendiri mengakui sisi lain dari hal itu: model ini "terutama hemat ketika digunakan untuk tugas dengan prompt hingga 100.000 token, yang mencakup sekitar 90% permintaan ke model Haiku kami sebelumnya." Setelah melewati 100.000 token, meteran input menjadi $0,50 dan meteran output $2,50, yang pada titik itu kelipatan dibanding Gemini 3.6 Flash menyempit menjadi sekitar 1,5x.

Apa yang dilakukan tier milik Google sendiri sementara perbandingan ini tetap diam

Di sinilah tulisan ini berhenti menjadi perbandingan dua model dan menjadi peringatan tentang Gemini mana yang sebenarnya Anda bandingkan.

Google telah mempertahankan harga Flash tetap sama selama tiga generasi. Gemini 3.6 Flash, Gemini 3.7 Flash, dan Gemini 3.8 Flash semuanya tercantum pada $0,75 untuk input dan $3,75 untuk output dalam dokumentasi harga Google sendiri, dengan tarif cache $0,075 yang sama dan kenaikan yang sama pada 1 Januari 2027 menjadi $1,50 dan $7,50. Kartu Google untuk lini 3.6 menggambarkannya sebagai "model Flash generasi sebelumnya kami," yang merupakan kata-kata vendor itu sendiri untuknya.

Yang berubah adalah skornya, bukan harganya. Di papan independen, Gemini 3.6 Flash mencetak skor 33.98, Gemini 3.7 Flash 39.06, dan Gemini 3.8 Flash 40.93 — semuanya dalam konfigurasi terpublikasi berintensitas tertinggi mereka. Sembilan poin indeks hadir di dalam tier flash Google dalam enam minggu, tanpa perubahan tarif.

Konsekuensinya bagi siapa pun yang sedang di tengah evaluasi bersifat konkret: jika Anda menakar pertandingan ini tiga minggu lalu terhadap Gemini 3.7 Flash, hasil Anda sudah kedaluwarsa, dan jika Anda menakarnya terhadap Gemini 3.8 Flash, selisihnya dengan Claude Haiku 5.5 menyempit menjadi 2,47 poin. Gemini 3.6 Flash adalah versi perbandingan ini yang paling menyanjung Anthropic, dan itu juga versi yang paling jauh dari dijual oleh Google.

Artificial Analysis menandai entri 3.6 sebagai usang. Penetapan harga Google masih memublikasikan tarifnya, dan daftar modelnya masih mengarahkan ke bagian 3.6, jadi pembacaan yang jujur bukanlah "hilang" melainkan "digantikan dua kali di dalam keluarganya sendiri dalam sepuluh minggu" — dan itu adalah fakta tentang seberapa cepat tingkatan ini bergerak, bukan alasan untuk melewati perbandingan.

Untuk siapa ini sebenarnya menentukan

Ada alasan kuat untuk Gemini 3.6 Flash, dan itu bukan soal skornya.

Jika Anda memerlukan audio atau video dalam prompt, Claude Haiku 5.5 sama sekali tidak bisa melakukannya — ia membaca teks dan gambar, dan tidak ada yang lain. Gemini 3.6 Flash membaca teks, gambar, video, audio, dan file, dan katalog kami sendiri mencatatnya pada 582 token keluaran per detik yang terukur dengan median waktu ke token pertama 4,1 detik selama sepekan terakhir, yang merupakan model cepat bahkan berdasarkan standar Flash. Bagi pipeline pemahaman media, daftar modalitas adalah keseluruhan keputusannya dan selisih indeks hanyalah catatan kaki.

Jika pekerjaan Anda adalah teks dan gambar, perhitungannya tidak cukup dekat untuk diperdebatkan. Pada campuran 7:2:1 yang didominasi input — pola yang dimiliki sebagian besar trafik produksi — Claude Haiku 5.5 menjadi $0,077 per juta token dibandingkan $0,63 untuk Gemini 3.6 Flash. Untuk lebih dari satu juta token campuran per hari, itu 77 sen dibandingkan $6,30, dan angka kedua memburuk pada 1 Januari 2027 sementara angka pertama tidak bergerak.

Jurang 100.000 token adalah satu-satunya kondisi yang membalikkan keadaan. Pipeline retrieval atau pipeline dokumen panjang yang secara rutin menyusun prompt 150.000 token membayar tier $0,50/$2,50 milik Anthropic untuk seluruh permintaan, dan pada titik itu kedua model berada dalam rentang 1,5x satu sama lain dalam hal harga, sementara Gemini 3.6 Flash tetap unggul dalam hal modalitas dan pada angka 91,8% yang dipublikasikan Google untuk retrieval multi-needle pada rata-rata 128k. Itu dilaporkan vendor dan belum direproduksi, dan hal itu harus dibingkai persis seperti itu.

A capture of the OrcaRouter model page for Gemini 3.6 Flash under google/gemini-3.6-flash, showing a 65K maximum output, text, image, video, file and audio input, public benchmarks published by Google dated 2026-07-21, a p50 time to first token of 4.1 seconds, and the page's own description of the model as Google's fast, cost-efficient multimodal model in the Gemini 3 family with a 1M-token context window.

Memanggil keduanya, atau memanggil satu

Gemini 3.6 Flash sudah ada di katalog OrcaRouter hari ini di google/gemini-3.6-flash, pada harga daftar Google dengan markup 0% — $0.75 dan $3.75 dengan biaya baca cache $0.075, diteruskan sebagaimana penyedia menagihnya. Hal itu penting untuk model khusus ini karena kenaikan tarif Google per 1 Januari adalah perubahan tarif, dan katalog pass-through menerapkannya pada hari terjadinya, bukan pada perpanjangan kontrak berikutnya. Satu API key dan satu panggilan SDK dapat memanggil baik model ini maupun salah satu dari 200 lebih model lainnya di katalog, sehingga uji A/B antara jalur Google dan jalur Anthropic cukup berupa perubahan string model dengan failover otomatis di baliknya, bukan integrasi kedua.

Claude Haiku 5.5 tidak tercantum dalam katalog. Model Anthropic dapat diakses melalui API milik Anthropic sendiri dan melalui AWS, Google Cloud dan Microsoft Azure, dan itulah seluruh jawaban yang jujur. Yang kami sediakan dari jajaran itu adalah Claude Sonnet 5.5 dan Claude Opus 5.5 — yang menjadikan jalur eskalasi dari panggilan klasifikasi murah hingga panggilan agentik tingkat menengah sebagai keputusan perutean, bukan sebuah proyek.

Yang membuat putusannya cukup sederhana untuk dinyatakan secara gamblang. Untuk pekerjaan teks dan gambar pada panjang prompt pendek, Claude Haiku 5.5 unggul di setiap aspek kecuali batas respons. Untuk apa pun yang mengandung audio atau video, Gemini 3.6 Flash adalah satu-satunya dari keduanya yang setidaknya bisa menjawab — dan jika Anda akan membayar tarif Google untuk kemampuan itu, tanyakan Gemini mana yang Anda bayari untuk itu, karena pada tier ini Anda bisa mendapatkan sembilan poin indeks lebih banyak dengan uang yang sama dari saudara yang lebih baru.

Satu API untuk lebih dari 200 model, satu kunci, failover otomatis di baliknya, sehingga A/B antara jalur Google dan jalur Anthropic hanyalah perubahan string model, bukan integrasi kedua.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari