
Claude Haiku 5.5 Kini Hadir di GitHub Copilot: Berapa Biaya Model Anthropic Termurah di Dalam Anggaran Kredit
- OrcaBARUOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 per 1 juta token · 71 tok/s
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 389 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
Claude Haiku 5.5 muncul di pemilih model GitHub Copilot pada 7 Oktober 2026 — pada hari yang sama saat vendor merilisnya — dan entri changelog yang mengumumkannya menghabiskan sebagian besar isinya untuk membahas permukaan. Visual Studio Code, Visual Studio, Copilot CLI, agen cloud GitHub Copilot, aplikasi Copilot, github.com, GitHub Mobile di iOS dan Android, IDE JetBrains, Xcode, Eclipse. Kalimat yang penting jika Anda yang memegang anggaran justru lebih pendek: model ini ditagih "pada harga daftar penyedia dalam penagihan berbasis penggunaan." Di dalam Copilot, itu berarti kredit AI, dan tarif Claude Haiku 5.5 cukup rendah sehingga perhitungan kredit menjadi bagian yang menarik dari peluncuran ini, bukan sekadar tambahan belakangan. Tulisan ini menjalankan perhitungan itu, memisahkan apa yang sebenarnya telah didemonstrasikan GitHub dari apa yang hanya diklaimnya, dan membahas dua pengecualian dalam dokumentasi vendor sendiri yang sebagian besar terlewatkan dalam liputan peluncuran.
Apa yang dirilis GitHub, dan kepada siapa
Entri itu berjudul, secara sederhana, "Claude Haiku 5.5 in GitHub Copilot," dan terbit pukul 13.12 Waktu Pasifik pada 7 Oktober. Entri ini tersedia bagi pelanggan Copilot Pro, Pro+, Max, Business, dan Enterprise — yang berarti semua tingkat berbayar, dan secara mencolok bukan tingkat gratis, di mana pemilihan model masih ditangani secara otomatis alih-alih oleh pengguna. Peluncurannya bertahap, jadi pemilih di editor Anda mungkin tertinggal beberapa hari dari changelog; hal itu dinyatakan dalam entri tersebut, bukan dibiarkan untuk Anda temukan sendiri.
Perumusan GitHub sendiri tentang tujuan model ini patut dibaca dengan saksama, karena perumusan itu lebih sempit daripada milik vendor:
• Pekerjaan cepat bervolume tinggi — subagen, pengeditan singkat, dan tugas terminal, dalam kata-kata GitHub sendiri • Tidak diposisikan sebagai pengganti model-model besar di pemilih, melainkan sebagai lapisan murah di bawahnya • Tersedia secara umum, menurut referensi model yang didukung GitHub, yang mencantumkan Claude Haiku 5.5 sebagai tersedia secara umum, dengan status GA • Juga tercantum pada referensi tersebut dengan baris versi IDE yang ditandai TBD, yang merupakan alasan praktis mengapa peluncurannya terkesan bertahap dari sisi editor • Dihargai sesuai harga daftar penyedia di bawah penagihan berbasis penggunaan, bukan dengan markup khusus Copilot img src="2.png"> p>Konteks tanggal changelog di sekitarnya memberikan gambaran irama yang tidak dapat diberikan oleh satu halaman model saja. Claude Sonnet 5.5 hadir di Copilot pada 28 September, Claude Opus 5.5 pada 22 September, dan Claude Fable 5.1 pada 1 September. Anthropic merilis integrasi Copilot kira-kira setiap dua hingga empat minggu dan GitHub memproses masing-masingnya dalam hitungan hari. Irama itu juga alasan mengapa ada batas waktu untuk hal ini: GitHub memasang pemberitahuan penghentian pada pertengahan September untuk "model GitHub Copilot terpilih" pada pertengahan Oktober, lalu tindak lanjut pada 2 Oktober yang mengonfirmasi penghapusan tersebut. Jika tim Anda menyematkan sebuah model dalam konfigurasi Copilot, pin itulah yang kini paling mungkin bermasalah, bukan harganya.

Kartu tarif, dibaca sebagai buku besar kredit
Claude Haiku 5.5 menagih berdasarkan dua tingkat, yang beralih berdasarkan ukuran permintaan, bukan berdasarkan pengaturan apa pun yang Anda pilih. Semua yang ada di bawah ini adalah daftar tarif resmi yang diterbitkan GitHub sendiri, dan semuanya dihitung per juta token:
• Pada atau di bawah 100.000 token masuk — $0.10 input, $0.01 input yang di-cache, $0.125 penulisan cache, $0.50 output • Di atas 100.000 token masuk — $0.50 input, $0.05 input yang di-cache, $0.625 penulisan cache, $2.50 output • Claude Haiku 4.5, sebagai perbandingan — $1.00 input, $0.10 input yang di-cache, $1.25 penulisan cache, $5.00 output • Claude Sonnet 5.5, tingkat di atasnya — $2.00 input, $0.10 input yang di-cache, $2.50 penulisan cache, $10.00 output • Penulisan cache ditagih terpisah pada model Anthropic, di luar input yang di-cache — item baris yang tidak ada pada setiap vendor di pemilih img src="3.png"> p>Dua hal muncul saat membaca baris-baris itu bersama-sama. Pertama, tingkat pendek Claude Haiku 5.5 bulat sepuluh kali lebih murah daripada Claude Haiku 4.5 baik untuk input maupun output, dan kira-kira dua puluh kali lebih murah untuk input dibanding Claude Sonnet 5.5 — itulah alasan utamanya ia cocok ditempatkan di slot subagen, tempat sekumpulan panggilan kecil mengalikan berapa pun yang Anda bayar per panggilan. Kedua, tingkat konteks panjang tepat lima kali lipat tingkat pendek pada setiap tarif sekaligus, pada garis 100.000 token yang sama. Permintaan 99.000 token dan permintaan 101.000 token tidak berbeda 2 persen pada token yang melewati garis itu; perbedaannya lima kali lipat pada semuanya. Lompatan itu diwarisi langsung dari harga daftar Anthropic, dan sistem kredit Copilot tidak menghaluskannya.

Sekarang soal kredit. Penagihan Copilot berbasis penggunaan mengonversi penggunaan model menjadi kredit AI dengan tarif terdokumentasi $0,01 per kredit, dan setiap paket memiliki kuota bulanan:
• Copilot Pro, $10 per bulan — 1.500 kredit, dinyatakan sebagai 1.000 kredit dasar ditambah 500 kredit fleksibel • Copilot Pro+, $39 per bulan — 7.000 kredit, dinyatakan sebagai 3.900 kredit dasar ditambah 3.100 kredit fleksibel • Copilot Max, $100 per bulan — 20.000 kredit, dinyatakan sebagai 10.000 kredit dasar ditambah 10.000 kredit fleksibel • Copilot Business, $19 per kursi per bulan — 1.900 kredit per pengguna • Copilot Enterprise, $39 per kursi per bulan — 3.900 kredit per pengguna • Kumpulan kredit organisasi dan perusahaan dibagikan di antara kursi, bukan dipisahkan per pengguna • Penggunaan di luar kumpulan ditagih $0,01 per kredit — konversi yang sama, yang diterapkan pada kelebihan pemakaian • Penyelesaian kode dan saran sunting-berikutnya sepenuhnya berada di luar penagihan kredit dan tetap tanpa batas pada paket berbayar p>Gabungkan keduanya, dan bentuk peluncuran itu menjadi konkret. Ambil langkah agen berukuran sedang — 40.000 token masukan, 2.000 token keluaran, tanpa caching. Pada tier pendek Claude Haiku 5.5, itu berarti 40.000 kali $0,10 per juta ditambah 2.000 kali $0,50 per juta, atau $0,005, yakni setengah kredit pada konversi yang didokumentasikan. Panggilan identik terhadap tarif Claude Haiku 4.5 menghasilkan $0,05, atau lima kredit. Perhitungan di sini adalah milik kami, bukan milik GitHub, tetapi semua masukannya berasal dari kartu tarif yang dipublikasikan, dan kesimpulannya tidaklah samar: kumpulan 1.500 kredit pelanggan Pro menyerap sekitar 3.000 panggilan semacam itu pada Haiku baru, sedangkan pada Haiku lama hanya sekitar 300. Kumpulan itu menjadi sepuluh kali lebih panjang tanpa perubahan pada langganan.
Itulah proposisi nilai yang jujur, dan disertai peringatan jujur bahwa pool tersebut dinyatakan dalam kredit, bukan dolar, sehingga plafon nyata sebuah paket berubah setiap kali daftar tarif berubah. Pemotongan sepuluh kali lipat pada satu model tidak memperluas pool sepuluh kali lipat jika lalu lintas Anda tersebar di tiga model.
Apa yang GitHub katakan tentang apa yang dilakukan model, dan apa yang belum ditunjukkannya
Catatan perubahan itu memuat satu klaim kinerja, dan klaim itu memikul lebih banyak beban dalam liputan daripada yang mampu ditanggungnya. GitHub menulis bahwa dalam pengujian awal, Claude Haiku 5.5 "menyamai Claude Sonnet 5 pada banyak tugas pengodean" sementara menggunakan "token dan langkah yang jauh lebih sedikit."
Baca kata-kata pembatasnya secara berurutan. Ini pengujian awal. Ini pengujian GitHub, pada tugas-tugas GitHub, dan GitHub adalah pihak yang menjual integrasi itu. Tidak ada harness yang disebutkan, tidak ada kumpulan tugas yang dipublikasikan, tidak ada angka yang menyertai masing-masing bagian kalimat itu, dan "many" bukanlah angka. Klaim itu bisa saja benar — model kecil yang menyamai model besar pada tugas-tugas coding sempit yang berbentuk alat adalah hasil yang masuk akal pada 2026 — tetapi sebagaimana dipublikasikan, itu adalah klaim vendor, dan harus diberi label seperti itu setiap kali diulang. Bagian "lebih sedikit token dan langkah" adalah yang lebih tahan lama di antara keduanya, karena itu adalah klaim tentang efisiensi, bukan kemampuan, dan efisiensi pada titik harga Haiku akan terlihat di telemetri penggunaan Anda sendiri dalam waktu satu minggu. Bagian kemampuan memerlukan harness pihak ketiga sebelum dimasukkan ke dalam slide.
Angka milik Anthropic sendiri merupakan klaim yang terpisah dari milik GitHub dan membawa masalah asal-usul yang sama. Anthropic menyatakan bahwa Claude Haiku 5.5 sekitar 75 persen lebih murah untuk dijalankan rata-rata, dan bahwa kira-kira 90 persen permintaan yang sebelumnya dikirim ke model kelas Haiku masuk di bawah 100.000 token, yang merupakan kisaran di mana model ini "sangat bernilai." Keduanya adalah vendor yang menjelaskan ekonomi produknya sendiri. Keduanya konsisten dengan kartu tarif yang diterbitkan — potongan besar untuk tier pendek, yang lebih kecil untuk tier panjang — dan keduanya berguna sebagai panduan vendor alih-alih sebagai hasil yang terukur.
Mengaktifkannya adalah keputusan admin, dan defaultnya adalah ya
Bagian catatan perubahan yang harus dibaca dua kali oleh pembeli Copilot Business dan Enterprise adalah paragraf kontrol akses. Administrator mengelola akses model melalui kebijakan model di pengaturan Copilot, dan perilaku default yang didokumentasikan GitHub adalah model baru diaktifkan secara otomatis kecuali administrator telah mematikan default global atau secara eksplisit menonaktifkan model tertentu tersebut. Default-nya permisif; pembatasannya bersifat opt-out.
Ada dua konsekuensi yang menyusul. Jika organisasi Anda memiliki tata kelola model yang ketat, Claude Haiku 5.5 mungkin sudah dapat dipilih oleh developer Anda tanpa ada yang menyetujuinya secara eksplisit. Dan jika sebaliknya organisasi Anda sudah menonaktifkan default global, model tersebut tidak akan muncul untuk Anda, apa pun yang dikatakan changelog — yang merupakan penjelasan paling mungkin untuk pertanyaan dukungan paling umum pada minggu pertama peluncuran model Copilot apa pun. Sebelum Anda men-debug entri pemilih yang hilang, periksa kebijakan model.
Dua pengecualian yang dokumentasi Anthropic nyatakan tetapi tidak dinyatakan oleh posting peluncuran.
Keduanya berasal dari dokumentasi platform Anthropic, bukan dari liputan pers mana pun, dan keduanya memengaruhi apa yang dapat Anda bangun, bukan berapa yang Anda bayar:
• Priority Tier tidak tersedia untuk Claude Haiku 5.5 — dokumentasi tingkat layanan Anthropic menyebut model tersebut dalam daftar pengecualian eksplisitnya, bersama Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1, dan lini Mythos. Jika arsitektur Anda mengasumsikan throughput yang disediakan pada tier murah, asumsi itu tidak berlaku di sini. • Jendela konteks penuh 1 juta token pada harga standar diberikan kepada "Claude 4.6 dan model yang lebih baru (kecuali Claude Haiku 5.5)" — pernyataan dalam tanda kurung itu berasal dari Anthropic, dan Claude Haiku 5.5 adalah satu-satunya model saat ini yang dikecualikan darinya. Jendela tersebut masih diiklankan pada baris spesifikasi model sebagai 1M, dengan output maksimum 128.000 token; yang dimaksud dengan pengecualian itu adalah Anda tidak boleh menganggap jaminan harga konteks panjang yang menyeluruh berlaku untuk model ini. • Tokenizer berubah. Anthropic menyatakan bahwa Claude 4.7 dan model yang lebih baru menggunakan tokenizer yang lebih baru yang menghasilkan sekitar 30 persen lebih banyak token untuk teks yang sama, yang berarti harga per token dan harga per halaman teks Anda bergerak ke arah yang berlawanan. Baris spesifikasi Claude Haiku 5.5 mencantumkan "Fastest" sebagai posisinya, default pemikiran adaptif medium, batas pengetahuan Juni 2026, dan ID model claude-haiku-5-5.
Tidak satu pun dari ini merupakan penghalang utama untuk beban kerja subagen dan penyuntingan cepat yang menjadi target model GitHub. Hal-hal inilah yang membedakan antara mengutip postingan peluncuran dan mengutip dokumentasi, dan yang kedua adalah yang bertahan saat dihadapkan pada uji beban.
Jika Anda lebih suka merutekannya daripada beralih alat
Ada alasan yang masuk akal untuk memanggil Claude Haiku 5.5 dari stack Anda sendiri, bukan hanya melalui langganan chat-dan-editor: Anda mendapatkan tarif tier pendek mentah tanpa konversi kredit di antaranya, dan Anda tetap memegang keputusan routing di kode Anda sendiri. Gambaran ketersediaannya, secara gamblang, adalah bahwa Anthropic menjualnya melalui Claude Platform dan melalui Amazon Bedrock, Vertex AI, dan Microsoft Azure — dan model itu belum ada di katalog kami. OrcaRouter saat ini menyediakan Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5, dan Claude Fable 5.1 di seluruh katalog yang berisi sedikit lebih dari 200 model, dan Claude Haiku 5.5 tidak termasuk di dalamnya. Untuk model itu sendiri saat ini, hubungi Anthropic atau salah satu dari tiga cloud tersebut secara langsung.

Di sinilah kami benar-benar cocok: lapisan di sekitarnya. OrcaRouter meneruskan harga daftar penyedia tanpa markup, jadi ketika vendor mengubah harga sebuah model — seperti yang dilakukan Anthropic pada model ini — tarif baru langsung berlaku di sisi kami pada hari yang sama, bukan setelah satu siklus penagihan. Failover otomatis berarti panggilan tingkat murah yang error akan mendarat di rute yang berfungsi, bukan menggagalkan permintaan; ini lebih penting bagi armada subagen yang melakukan ribuan panggilan kecil daripada bagi satu sesi interaktif. Dan DSL perutean ada justru untuk bentuk keputusan yang diciptakan peluncuran ini: kirim pekerjaan pendek bervolume tinggi ke model mana pun yang termurah di bawah ambang batas dan pekerjaan konteks panjang ke model mana pun yang termurah di atasnya, dari satu endpoint pada satu tagihan, alih-alih mengodekan pemisahan itu ke dalam dua integrasi. Jika Haiku 5.5 hadir di katalog, ia masuk ke kebijakan itu tanpa perubahan kode.
Apa yang harus dilakukan dengan ini sebelum sprint berikutnya
Pembacaan sempitnya adalah bahwa model Anthropic termurah saat ini kini dapat dipilih di setiap tier Copilot berbayar dan sekitar sepuluh kali lebih murah per token daripada Haiku yang digantikannya pada tier pendek. Jika tim Anda menjalankan subagent atau otomasi berbentuk terminal melalui Copilot, mengganti model hanyalah perubahan pengaturan dengan efek besar dan langsung pada seberapa jauh kumpulan kredit bulanan dapat bertahan.
Dua hal yang layak diperiksa lebih dulu adalah hal-hal yang tidak diungkap terang-terangan dalam pengumuman itu. Lihat persentil ke-95 dari ukuran permintaan Anda: jika berada di atas 100.000 token, tier yang sebenarnya Anda ditagihkan adalah tier kedua, dan perbandingan sepuluh kali lipat itu sebenarnya hanya lima kali lipat. Dan periksa apakah kebijakan model organisasi Anda mengaktifkan default global — untuk seat Business dan Enterprise, satu pengaturan itu menentukan apakah peluncuran ini tersedia sama sekali bagi para developer Anda.
