
Claude Sonnet 5.5 vs Grok 4.5: Dua Tarif Input $2 dan Penantian Enam Menit
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 931 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 192 tok/s
- OrcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- xAISpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
Claude Sonnet 5.5 dan Grok 4.5 mematok harga yang sama untuk input: $2,00 per juta token. Di situlah kesamaannya berakhir, dan satu angka menjelaskan intinya lebih baik daripada tabel spesifikasi mana pun. Pada revisi Intelligence Index v4.3.2 dari Artificial Analysis, median waktu ke token jawaban pertama untuk Claude Sonnet 5.5 pada pengaturan Max Effort-nya adalah 370,8 detik. Untuk Grok 4.5, 6,9 detik. Tarif input sama. Lima puluh tiga kali lebih lama menunggu sebelum apa pun kembali sama sekali. Claude Sonnet 5.5, dirilis 28 September 2026, dan Grok 4.5, dirilis 8 Juli 2026 dan sejak itu dua kali tersalip di dalam keluarganya sendiri, adalah dua cara termurah untuk masuk ke paruh depan frontier di atas kertas — dan kertas itu menyembunyikan keputusan yang sebenarnya penting, yaitu apa yang Anda beli dengan penantian itu.
Angka itu perlu segera diberi catatan, karena angka latensi tanpa konfigurasi tidak bermakna: 370,8 detik adalah mode penalaran default Anthropic pada upaya maksimum, yang menghabiskan anggaran berpikir yang sangat besar sebelum mengeluarkan token jawaban. Pemanggil yang menginginkan token pertama yang cepat akan mengonfigurasi hal lain. Tetapi arahnya nyata dan itu bukan artefak — Artificial Analysis mengukur kecepatan keluaran Claude Sonnet 5.5 pada 138,7 token per detik, hanya kalah dari segelintir model, dan Grok 4.5 pada 59,2. Model yang menunggu paling lama juga menulis paling cepat. Yang Anda pilih adalah antara deliberasi panjang yang diikuti jawaban cepat, dan deliberasi singkat yang diikuti jawaban yang lebih lambat.
Apa yang berubah pada 28 September?
Claude Sonnet 5.5 baru berumur satu hari. Anthropic merilisnya pada 28 September 2026 dengan pengenal API claude-sonnet-5-5, bersama Bedrock, Google Cloud, dan Microsoft Foundry, dan mendeskripsikannya berjalan 30% lebih cepat daripada Claude Sonnet 5 serta berbiaya hingga 30% lebih murah per tugas untuk sebagian besar pekerjaan. Angka-angka itu berasal dari vendor dan belum direproduksi secara independen; harga yang dijadikan pembandingnya nyata, karena tarifnya tetap datar di $2,00 per juta token masukan, $10,00 per juta token keluaran, $0,20 untuk pembacaan cache, dan $2,50 untuk penulisan cache. Jendelanya 1.000.000 token dengan batas keluaran sinkron 128.000 token, dan 300.000 token pada Message Batches API di balik header output-300k-2026-03-24. Batas pengetahuan adalah Juni 2026. Retensi nol data tersedia sejak peluncuran, dan Anthropic tidak akan menghentikan model ini sebelum 28 September 2027.

Halaman dokumentasi Anthropic sendiri juga secara tidak biasa eksplisit tentang biaya peningkatan versi ini: lima breaking change memisahkan Claude Sonnet 5.5 dari model yang saat ini menjalankan sebagian besar lalu lintas Claude, dan hal-hal tersebut dibahas lebih jauh di bawah.
Grok 4.5 adalah proposisi yang lebih lama dan yang lebih rumit. SpaceXAI — perusahaan yang masih merilis dengan merek xAI pada kartu modelnya — merilisnya pada 8 Juli 2026 sebagai campuran pakar berparameter 1,5 triliun, dilatih bersama editor kode Cursor, dengan jendela 500.000 token, input teks, gambar, dan berkas, serta pemasaran peluncuran yang hampir sepenuhnya dibangun di atas ekonomi token alih-alih skor teratas. Model ini bukan lagi produk unggulan. Grok 4.6 dan Grok 4.7 keduanya ada, keduanya membawa harga daftar $2.00 / $6.00 yang sama, dan katalog kami mencantumkan ketiganya. Pertanyaan yang menarik pada September 2026 karena itu bukanlah apakah Grok 4.5 bagus; melainkan apakah masih ada sesuatu yang membenarkan untuk memilih yang tertua dari ketiganya.
Tagihan bukan kartu tarif
Letakkan keduanya berdampingan di papan independen dan bentuk perdagangannya pun tampak.
• Indeks Kecerdasan, revisi v4.3.2 — Claude Sonnet 5.5 56 pada Upaya Maksimal vs Grok 4.5 39
• Biaya per tugas Index — Claude Sonnet 5.5 $7.60 vs Grok 4.5 $1.04, keduanya diukur, bukan diperkirakan
• Tarif output — Claude Sonnet 5.5 $10,00 per juta vs Grok 4.5 $6,00 per juta
• Kecepatan keluaran — Claude Sonnet 5.5 138,7 token/detik vs Grok 4.5 59,2 token/detik
• Waktu hingga token jawaban pertama, Upaya Maksimal — Claude Sonnet 5.5 370,8 detik vs Grok 4.5 6,9 detik
• Token yang dihasilkan di seluruh evaluasi Index — Claude Sonnet 5.5 410M vs Grok 4.5 77M
• Konteks — Claude Sonnet 5.5 1.000.000 token vs Grok 4.5 500.000 token
Baris verbositas adalah mekanisme di balik kesenjangan biaya per tugas, dan itu adalah angka tunggal yang paling berguna di halaman ini. Model yang mengeluarkan 410 juta token selama evaluasi ketika pesaingnya mengeluarkan 77 juta tidak memerlukan laju output 67% lebih tinggi untuk biayanya menjadi tujuh kali lebih besar per tugas — tetapi model itu tetap memilikinya, dan kedua efek tersebut mendorong ke arah yang sama. Pembingkaian Anthropic sendiri sejalan dengan interpretasi itu alih-alih bertentangan dengannya: "hingga 30% lebih sedikit per tugas" adalah klaim tentang jumlah token, bukan laju, karena laju tidak berubah antara Claude Sonnet 5 dan Claude Sonnet 5.5. Artificial Analysis mencapai kesimpulan yang sama dari sisi lain dan menggambarkan model itu dengan bahasa sederhana sebagai sangat cepat tetapi sangat verbose. Dibandingkan dengan model yang ringkas, sifat yang sama itu adalah risiko operasional terbesar Claude Sonnet 5.5.

Di mana tarif murah Grok 4.5 berhenti menjadi murah
Baris $2.00 / $6.00 adalah tier, bukan tarif. Pada dokumentasi pengembang milik SpaceXAI sendiri, harga itu berlaku hingga 200.000 token input dan berlipat ganda menjadi $4.00 input dan $12.00 output di luar batas itu. Jendela Grok 4.5 adalah 500.000 token, jadi paruh kedua jendela yang diiklankannya biayanya dua kali lipat dibandingkan paruh pertama. Memuat prompt berskala repositori ke Grok 4.5 bukan operasi output $6; ini operasi output $12, dan pada titik itu model dengan tarif output $10 yang "mahal" justru lebih murah untuk permintaan apa pun yang juga menghasilkan banyak token.
Claude Sonnet 5.5 tidak memiliki tier yang setara. Tarif $2,00 / $10,00 tetap berlaku di seluruh jendela 1.000.000 token, dan pembacaan cache ditagih $0,20 — sepersepuluh dari tarif input — yang membuat kasus konteks panjang dapat dijalankan secara praktis, bukan hanya di atas kertas.
Ukuran jendela adalah separuh lainnya dari argumen itu dan ia menunjuk ke arah yang sama. Jendela Grok 4.5 adalah 500.000 token dan setiap tokennya ditagih pada tarif yang diiklankan. Claude Sonnet 5.5 memiliki 1.000.000 token untuk digunakan, dan bentuk beban kerja itulah yang membuatnya penting: repositori untuk dicerna, transkrip agen yang panjang, tumpukan dokumen yang harus tetap terlihat. Plafon dua kali lipat, tanpa batas tier di separuhnya, dan pembacaan cache sepersepuluh dari tarif input adalah yang mengubah membawa konteks sebanyak itu di banyak panggilan menjadi pos biaya alih-alih anggaran.
Perbedaan praktisnya tidak samar:
• Prompt pendek dengan output padat — Grok 4.5 unggul dalam kecepatan dan kembali unggul dalam kebiasaan token
• Prompt yang melewati 200.000 token input — tarif Grok 4.5 menjadi dua kali lipat, sedangkan tarif Claude Sonnet 5.5 tidak.
• Pekerjaan interaktif yang sensitif terhadap latensi — Grok 4.5 menjawab lebih dulu, dengan selisih yang jauh, pada pengaturan default
• Proses agentik berhorizon panjang — skor komposit Claude Sonnet 5.5 dan batas keluaran 128K adalah alasan Anda membayar biaya tugas tambahan, dan batas 300K Batches memperluasnya lebih jauh
Migrasi bukanlah string model
Siapa pun yang beralih dari Claude Sonnet 5 ke Claude Sonnet 5.5 harus membaca catatan migrasi Anthropic sebelum menulis kode, karena lima perilaku berubah dan hanya satu di antaranya yang gagal secara mencolok di tempat yang jelas.
• Bukan default: temperature, top_p, atau top_k sekarang mengembalikan 400 — pipeline yang intensif melakukan sampling berhenti bekerja alih-alih menurun performanya
• thinking: {"type": "disabled"} mengembalikan 400 dan harus menjadi between_tools, dengan effort dibatasi ke low, medium, atau high; xhigh dan max ditolak
• Penggunaan tool secara paksa — tool_choice bernilai "any" atau tool bernama — ditolak mentah-mentah, sehingga loop yang memaksa panggilan yang valid sesuai skema harus beralih ke auto dengan strict tool use atau structured outputs
• Alat penggunaan komputer computer_20251124 yang lebih lama ditolak di Claude API dan di Google Cloud
• Blok Thinking terikat pada model dan akun yang menghasilkannya, sehingga penalaran berlanjut dari Claude Sonnet 5 tetapi tidak menyilang ke keluarga yang berbeda — dan alat advisor tidak lagi menerima Claude Opus 4.8, Claude Opus 4.7, atau Claude Sonnet 5 sebagai advisor di balik eksekutor Sonnet 5.5
Ada perubahan keenam yang sama sekali tidak membuat apa pun gagal, dan itulah yang menjadikannya berbahaya: teks di antara panggilan alat kini dikembalikan di dalam blok pemikiran. Aplikasi yang menstrimkan teks itu ke pengguna akan menjadi senyap di antara panggilan alat sampai aplikasi tersebut menetapkan nilai tampilan atau sepenuhnya mematikan pemikiran di awal. Tidak ada yang error. Outputnya sekadar berhenti muncul.
Grok 4.5 tidak menuntut semua itu. Ini adalah model berformat OpenAI dengan permukaan sampling yang tetap utuh, dan beralih ke model ini dari para pendahulu Grok 4.5 sendiri hanyalah perubahan string model. Biaya migrasinya sepenuhnya ditanggung sisi Claude, dan itu butuh kerja sehari, bukan sekadar satu sore.
Keduanya pada satu kredensial, dan batas jujur dari hal itu
Membandingkan dua vendor di kepala itu mudah; menjalankannya justru di situlah biayanya tersembunyi. OrcaRouter menempatkan 200+ model di balik satu endpoint yang kompatibel dengan OpenAI dengan harga daftar penyedia diteruskan apa adanya dan tanpa markup tambahan, sehingga perubahan tarif di sisi mana pun langsung aktif di sini pada hari yang sama, bukan pada perpanjangan kontrak berikutnya, dengan failover otomatis antar penyedia hulu dan DSL routing untuk menyusun panggilan. Seluruh lini Grok ada di katalog dengan tarif SpaceXAI sendiri, dan Grok 4.5 dapat dirutekan sebagai grok/grok-4.5 dengan $2,00 input dan $6,00 output per juta token di seluruh jendela 500.000 token-nya.
Claude Sonnet 5.5 tidak ada dalam katalog kami, dan halaman ini tidak akan menyiratkan sebaliknya. Jalur menuju model itu saat ini adalah API milik Anthropic sendiri, atau Bedrock dan Google Cloud jika di sanalah infrastruktur Anda sudah berada. Claude Sonnet 5 sudah dapat dirutekan di sini sejak 30 Juni dengan harga Anthropic sebesar $2,00 dan $10,00 dan tetap menjadi model yang menjalankan sebagian besar lalu lintas Claude API, sehingga menjadikannya target failover yang wajar selagi Claude Sonnet 5.5 masih berusia satu hari dan belum memiliki bukti produksi dari siapa pun.
Satu catatan perlu diberikan atas semua itu, dan ini bukan perkara kecil. Baris Grok 4.5 di atas adalah promosi dari vendor sebagaimana yang saat ini ditampilkan oleh katalog kami; penghitung lalu lintas pada entri itu menunjukkan nol selama tujuh hari terakhir dan angka throughput-nya tidak sedang diukur, dengan waktu ke token pertama berada di batas bawah satu detik yang biasanya ditunjukkan oleh model yang nyaris tidak dipanggil. Model tanpa lalu lintas terkini di sini bukanlah bukti bahwa model itu buruk — panggilan keluarga ini telah beralih ke 4.6 dan 4.7 — tetapi itu berarti angka operasional di halaman tersebut tipis, dan angka latensi yang layak dipercaya adalah pembacaan dari rute yang aktif.

Yang mana yang harus dipilih
Grok 4.5 adalah model yang tepat ketika prompt-nya pendek, jawabannya padat, dan integrasinya sudah berbicara OpenAI — dan ketika permintaan tidak akan melewati 200.000 token input, karena setelah garis itu, perhitungannya berpindah tangan. Ini juga pilihan yang tepat ketika token pertama harus tiba dalam hitungan detik, bukan menit. Yang perlu ditegaskan, ia bukan Grok flagship saat ini; Grok 4.6 dan Grok 4.7 berada di atasnya dengan harga daftar yang sama, dan alasan untuk memilih 4.5 dibandingkan salah satu dari keduanya haruslah spesifik.
Claude Sonnet 5.5 adalah model yang tepat ketika prompt sangat besar, pekerjaannya cukup agentic sehingga tujuh belas poin Index dan batas keluaran 128K membenarkan biaya per tugas tujuh kali lebih tinggi, atau skor komposit memang yang sedang dibeli. Verbositasnya adalah keputusan desain, bukan cacat, dan itulah angka yang harus diukur pada trafik Anda sendiri sebelum berkomitmen — karena $7,60 per tugas Index versus $1,04 adalah proksi untuk angka yang hanya dapat dihasilkan oleh beban kerja Anda.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
