
Claude Haiku 5.5 vs Gemini 3.8 Flash: Dua Poin Indeks, Biaya per Tugas Enam Kali Lipat
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Claude Haiku 5.5 dan Gemini 3.8 Flash lebih dekat dalam kemampuan terukur dibandingkan pasangan lain mana pun di rentang harga ini — 43,40 berbanding 40,0 pada Artificial Analysis Intelligence Index v4.3.2, keduanya berada di dalam lima puluh besar dari papan 225 model. Yang membedakan keduanya adalah berapa biaya satu poin indeks tersebut. Pada pengukuran independen yang sama, Intelligence Index yang sudah selesai biayanya $0,21 pada Claude Haiku 5.5 dan $1,24 pada Gemini 3.8 Flash.
Itu adalah kesenjangan enam kali lipat untuk selisih skor dua setengah poin, dan angka itulah yang seharusnya menentukan perbandingan ini. Segala hal lainnya — tarif yang tertera, daftar modalitas, tenggat waktu yang dikaitkan dengan penetapan harga Google — hanyalah argumen tentang hal-hal di pinggiran.
Kedua model, pada angka-angka yang penting
Per juta token dalam dolar AS, dari dokumentasi penetapan harga milik Anthropic dan Google sendiri, dengan pengukuran independen yang diatribusikan kepada Artificial Analysis. Di-cache 2026-10-08.

• Masukan — Claude Haiku 5.5 $0.10 hingga 100.000 token dan $0.50 di atasnya; Gemini 3.8 Flash $0.75 tetap, naik menjadi $1.50 pada 1 Januari 2027.
• Output — Claude Haiku 5.5 $0,50 hingga 100.000 token dan $2,50 di atasnya; Gemini 3.8 Flash $3,75 flat, naik menjadi $7,50 pada tanggal yang sama.
• Input cache — Claude Haiku 5.5 $0.01 dan $0.05; Gemini 3.8 Flash $0.075, ditambah biaya penyimpanan $0.50 per juta token per jam.
• Konteks — 1M token untuk keduanya. Output maksimum — 128.000 token untuk Claude Haiku 5.5 dibandingkan 65.536 untuk Gemini 3.8 Flash.
• Modalitas masukan — teks dan gambar untuk Claude Haiku 5.5; teks, gambar, ucapan, dan video untuk Gemini 3.8 Flash. Inilah satu-satunya baris di mana daftar Google benar-benar lebih panjang.
• Skor independen — 43.40 untuk Claude Haiku 5.5 (Max) dibandingkan dengan 40.93 untuk Gemini 3.8 Flash (High), pada Intelligence Index v4.3.2.
• Biaya independen per tugas — $0.21 versus $1.24 pada board yang sama.
• Kecepatan — 241,9 token keluaran per detik dibandingkan 125,2, keduanya diukur oleh Artificial Analysis.
Dari mana angka enam kali itu berasal
Kesenjangan biaya per tugas lebih besar daripada kesenjangan harga yang tertera, dan itulah bagian yang menarik, karena itu berarti kartu tarif saja tidak menjelaskannya.
Aritmetika harga yang tertera cukup sederhana: $0.10 dibandingkan $0.75 untuk input berarti tujuh setengah kali lebih murah, dan $0.50 dibandingkan $3.75 untuk output memiliki rasio yang sama. Jika kedua model menghasilkan token yang sama untuk pekerjaan yang sama, rasio itu akan langsung terbawa ke faktur.
Hal itu tidak berlanjut, dan kedua efeknya menguntungkan Google. Claude Haiku 5.5 bersifat verbose dengan cara yang diakui vendornya sendiri: Artificial Analysis mencatat 440 juta token keluaran saat menjalankan Index, dibandingkan median 100 juta, dan menyebut model itu sangat verbose. Gemini 3.8 Flash menghasilkan 170 juta dibandingkan median 81 juta — juga ditandai verbose, tetapi hanya sepertiga dari jumlah tokennya. Dokumentasi Anthropic sendiri menambahkan efek kedua: Claude Haiku 5.5 menggunakan tokenizer yang lebih baru yang sama dengan Claude 4.7 dan versi setelahnya, sehingga teks yang sama dihitung sekitar 30% lebih banyak token daripada pada model yang digantikannya.
Jika disatukan, versi jujur dari klaim harga itu adalah ini: keunggulan tarif input sepuluh banding satu dan keunggulan tarif output tujuh setengah banding satu, yang sebagian termakan oleh model yang menulis lebih banyak token per jawaban, sehingga menghasilkan keunggulan enam banding satu dalam pengukuran yang menagih untuk keseluruhan pekerjaan. Tetap kemenangan telak, dan lebih kecil daripada yang disiratkan kartu tarif.
Harga Google memiliki tanggal di dalamnya
Satu hal yang paling berguna di halaman harga Google adalah kalimat yang dihilangkan oleh sebagian besar tabel perbandingan.
Gemini 3.8 Flash dicantumkan pada $0.75 untuk input dan $3.75 untuk output "hingga 31 Desember 2026," serta pada $1.50 dan $7.50 "mulai 1 Januari 2027." Input yang di-cache berubah dari $0.075 menjadi $0.15 pada tanggal yang sama. Itu adalah tarif perkenalan dengan masa berlaku yang tercetak di sebelahnya, sekitar sebelas minggu dari saat penulisan ini.
Tidak ada dalam kartu Anthropic yang berbunyi seperti itu. Tarif Claude Haiku 5.5 dinyatakan sebagai tarifnya, dengan struktur dua tingkat yang dikaitkan dengan panjang prompt, bukan dengan kalender, dan komitmen penghentian tidak lebih cepat dari 7 Oktober 2027. Jika Anda memodelkan pipeline yang berjalan hingga tahun depan, langkah Januari Google adalah penggandaan dan itu termasuk dalam model; milik Anthropic tidak memiliki peristiwa ekuivalen untuk direncanakan.
Itu bisa berlaku dua arah, dan tafsir yang adil bukanlah "satu vendor jujur dan yang lain tidak." Tarif promosi adalah tarif nyata selama masa berlakunya, dan Google berhak menetapkan harga peluncuran seperti itu. Ini sekadar fakta tentang perbandingan bahwa sisi angka Januari yang tampak lebih murah adalah sisi yang memiliki tenggat waktu.

Berapa nilai dua poin indeks?
Selisih 2,47 poin pada indeks yang skalanya mencapai enam puluhan bukanlah kesalahan pembulatan, dan juga bukan jurang pemisah. Kedua model berada dalam rentang kerja yang sama, dan pertanyaan praktisnya adalah apakah selisih itu muncul pada tugas-tugas yang benar-benar Anda jalankan.
Berdasarkan angka dari vendor masing-masing, keduanya tidak diukur pada harness yang sama, sehingga tidak dapat dibandingkan secara langsung — Anthropic menerbitkan hasil GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0, dan FrontierCode untuk Claude Haiku 5.5, dan Google menerbitkan kumpulan hasilnya sendiri untuk Gemini 3.8 Flash, dan tidak ada vendor yang menjalankan suite milik yang lain. Satu-satunya perbandingan setara yang tersedia adalah papan independen, dan di sana jawabannya adalah bahwa Anthropic unggul dengan margin yang terukur tetapi kecil.
Perbedaan kemampuan yang akan lebih penting bagi sebagian tim terletak pada lini modalitas. Gemini 3.8 Flash menerima input suara dan video; Claude Haiku 5.5 menerima teks dan gambar. Sebuah pipeline yang memasukkan rekaman panggilan atau tangkapan layar secara native sama sekali tidak memilih di antara kedua model ini berdasarkan harga — salah satunya tidak dapat melakukan pekerjaan tanpa langkah transkripsi atau ekstraksi frame di depannya, dan langkah itu memiliki biaya serta mode kegagalannya sendiri.
Menjalankan sisi yang lebih murah dari pasangan tersebut
Gemini 3.8 Flash ada di katalog OrcaRouter dengan harga daftar Google dan markup 0%, yang di sini lebih penting daripada biasanya: tarif penyedia diteruskan apa adanya alih-alih dicampur, jadi jika Anda ingin melihat apa yang sebenarnya dilakukan kenaikan Januari terhadap tagihan, angkanya ikut berubah saat angka Google berubah. Claude Sonnet 5.5 dan Claude Opus 5.5 juga ada di katalog, yang menjadikan uji routing tiga arah — jalur Flash dari Google, tier menengah Anthropic, dan tier kecil Anthropic nanti — sebagai sebuah konfigurasi, bukan proyek. Satu kunci, satu SDK, failover otomatis di baliknya, dan DSL routing jika Anda lebih suka menyatakan eskalasi di rute daripada di kode aplikasi.
Claude Haiku 5.5 sendiri belum ada di katalog, dan lebih baik mengatakan itu daripada membiarkannya ambigu. Bagian Anthropic dari perbandingan ini saat ini hanya dapat dijangkau di Anthropic, sedangkan bagian Google dapat dipanggil dari kami hari ini dengan harga yang ditunjukkan di atas.

Yang mana, dan untuk siapa
Jika pekerjaan Anda adalah teks masuk dan teks keluar, prompt Anda berada di bawah 100.000 token, dan Anda membayar per token untuk volume nyata, Claude Haiku 5.5 adalah model yang lebih murah menurut setiap ukuran dalam artikel ini dan model dengan skor lebih tinggi pada satu-satunya papan skor bersama — dengan catatan bahwa keunggulannya enam kali lipat pada biaya per tugas, bukan sepuluh kali lipat seperti yang tersirat dari label harganya.
Jika Anda memerlukan input audio atau video, atau Anda memerlukan respons 65K-plus, atau prompt Anda sering kali panjang, kalkulasinya berubah: Gemini 3.8 Flash menerima input yang tidak dapat ditangani oleh tier kecil Anthropic, dan setelah 100,000 token, tier kedua Anthropic sendiri harganya jauh di atas tarif tetap Google.
Satu hal yang perlu dipegang adalah tanggalnya. Tarif Google berlaku baik hingga akhir tahun dan berlipat ganda setelahnya. Tarif Anthropic dinyatakan flat dengan adanya tahapan durasi. Ke sisi mana pun Anda condong, bangun kalender ke dalam spreadsheet sebelum Anda membangun pipeline.
