Kartu judul hero untuk penjelasan Grok 4.5: judul utama 'Apa Itu Grok 4.5?' di atas subjudul 'Andalan V9 yang mengedepankan ekonomi token, bukan skor tertinggi', lalu tiga kartu bertuliskan 'Konteks - 500K token', 'Harga daftar per 1 juta - $2.00 / $6.00', dan 'Inteligensi AA - 39', dengan baris footer 'Grok 4.5 dirilis 8 Juli 2026. Harga menurut dokumentasi xAI; angka AA menurut Artificial Analysis Intelligence Index v4.3.2.' dan logo OrcaRouter di sudut kanan bawah.
Guides & Insights

Apa Itu Grok 4.5? Produk Unggulan V9 yang Menjual Ekonomi Token alih-alih Skor Teratas

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Grok 4.5 adalah model penalaran mixture-of-experts dengan 1,5 triliun parameter dari vendor — perusahaan yang kini merilis dan memasarkan dengan merek SpaceXAI — yang dirilis pada 8 Juli 2026. Model ini menerima input teks dan gambar, menghasilkan teks, memiliki jendela konteks 500.000 token, dan dipatok pada $2,00 per juta token input dan $6,00 per juta token output. Model inilah yang menempatkan "token per tugas yang diselesaikan" di bagian depan slide peluncuran, dan sejak itu model inilah yang menjadi dasar bagi lab tersebut untuk membangun dua model unggulan yang lebih baru.

Klausa terakhir itulah alasan utama halaman ini perlu ditulis. Cari "Grok 4.5" dan Anda akan mendapatkan liputan peluncuran dari Juli: kemitraan Cursor, kutipan "Opus-class", klaim 80 token per detik. Yang tidak Anda dapatkan adalah jawaban langsung atas pertanyaan yang sebenarnya dimiliki pengembang pada akhir September, yaitu apakah Grok 4.5 masih layak diintegrasikan ke apa pun ketika Grok 4.6 dan Grok 4.7 sudah ada dengan harga daftar yang sama. Jadi halaman ini adalah entri referensi, bukan artikel berita: apa model ini, di mana posisinya, apa yang secara terukur dilakukannya dengan baik, apa yang secara terukur dilakukannya dengan buruk, dan siapa yang sebaiknya memilih yang lain. Tidak ada yang dibingkai sebagai peluncuran di sini, karena memang bukan peluncuran.

Mengenai sumber, karena hal ini lebih penting daripada biasanya di halaman seperti ini: setiap angka di bawah ini diberi label menurut asalnya. Angka yang diterbitkan xAI tentang modelnya sendiri ditandai sebagai dilaporkan vendor. Angka dari Artificial Analysis adalah pengukuran independen, yang dibaca langsung dari halaman model pada 23 September 2026. Jika suatu angka tidak dapat dikonfirmasi pada sumber primer, halaman ini menyatakannya, bukan memperkirakannya.

Di mana posisi Grok 4.5 dalam keluarganya sendiri — dan itu bukan yang teratas

Kesalahan paling umum dalam liputan tentang Grok 4.5 adalah menganggapnya sebagai produk unggulan. Itu memang benar, selama sekitar lima minggu. Sejak saat itu, xAI telah merilis Grok 4.6 pada 12 Agustus 2026 dan Grok 4.7 pada awal September, yang keduanya masih dibanderol dengan harga $2.00 dan $6.00 per juta token. Grok 4.5 kini berada di tengah jajaran: lebih mumpuni daripada tier murah, dua generasi di belakang model terdepan, dan — inilah bagian yang penting — satu-satunya model dalam lini Grok saat ini yang tarif input cache-nya lebih murah daripada para penerusnya. Grok 4.5 mengenakan biaya cache $0.30 per juta token; Grok 4.6 dan Grok 4.7 keduanya mengenakan biaya cache $0.50, menurut tabel harga xAI sendiri.

Berikut adalah jajaran produk sebagaimana yang saat ini tercantum dalam dokumentasi harga vendor, semua angka per juta token dan semuanya diterbitkan oleh vendor:

• Grok 4.20 (tiga varian: multi-agen, penalaran, non-penalaran) — konteks 1M, $1.25 input / $2.50 output, $0.20 di-cache, dirilis 31 Maret 2026

• Grok 4.3 — konteks 1M, $1,25 input / $2,50 output, $0,20 untuk cache, ditambah diskon batch; cara termurah untuk mendapatkan satu juta token konteks Grok

• Grok 4.5 — konteks 500K, $2.00 input / $6.00 output, $0.30 di-cache, dirilis 8 Juli 2026

• Grok 4.6 — konteks 500K, $2,00 input / $6,00 output, $0,50 di-cache, dirilis 12 Agustus 2026

• Grok 4.7 — konteks 500K, $2,00 input / $6,00 output, $0,50 di-cache, dirilis awal September 2026

• Grok Build 0.1 — konteks 256K, input $1.00 / output $2.00, spesialis pengkodean, bukan model umum

Ada dua hal yang muncul dari daftar itu. Pertama, Grok 4.5 tidak mengalami pemotongan harga saat berhenti menjadi andalan — harganya tetap sebesar harga andalan, yang berarti Grok 4.6 sekarang jelas menawarkan nilai lebih baik untuk uang yang sama, kecuali Anda secara khusus menginginkan tarif cache yang lebih murah atau Anda terpaku pada snapshot 4.5. Kedua, Grok 4.5 memiliki setengah konteks Grok 4.3 dan keluarga 4.20 dengan harga input dua kali lipat. Fondasi V9 adalah alasannya: 1,5 triliun parameter, sekitar tiga kali ukuran Grok 4.3, dan model dasar yang lebih besar itulah yang membuat kemampuan tersebut diperoleh dengan mengorbankan jendela konteks.

Jika yang sebenarnya Anda butuhkan adalah konteks panjang dengan anggaran terbatas, Grok 4.3 adalah jawaban jujur di dalam keluarga ini dan Grok 4.5 bukan. Pertukaran itu — kemampuan versus jendela — adalah keputusan yang menentukan di lini Grok, dan layak dinyatakan secara terang-terangan daripada berpura-pura bahwa angka yang lebih baru lebih unggul dalam segala hal.

Lembar spesifikasi

Screenshot of the xAI developer documentation model page for grok-4.5, showing the model identifier and aliases grok-4.5-latest and grok-build-latest, the description 'intelligent coding model for agentic software, engineering, and workflow tasks', an At a glance block giving modalities 'Text, Image to Text' and a 500,000-token context window, capability rows for function calling, structured outputs and reasoning, and the pricing rows $2.00 input, $0.30 cached input and $6.00 output per million tokens, above a collapsed 'Higher context pricing' note about requests exceeding the 200K context window.

Ini adalah spesifikasi yang diterbitkan xAI di halaman modelnya sendiri, bukan perkiraan pihak ketiga:

• Pengenal model — grok-4.5, dengan alias grok-4.5-latest dan grok-build-latest

• Modalitas — teks dan gambar masuk, teks keluar. Gambar diterima sebagai masukan; model tidak menghasilkannya

• Jendela konteks — 500.000 token, dibagi antara prompt dan respons, bukan 500K untuk masukan ditambah alokasi keluaran terpisah

• Lisensi — berpemilik. Tidak ada bobot terbuka dan tidak ada checkpoint yang dapat diunduh; Anda mengakses Grok 4.5 melalui API atau melalui produk milik vendor itu sendiri

• Harga daftar — $2,00 per juta token masukan, $6,00 per juta keluaran, $0,30 masukan yang di-cache

• Harga konteks panjang — pada 200.000 token prompt dan di atasnya, tarifnya naik menjadi $4.00 input / $12.00 output / $0.60 cache, dan tarif yang lebih tinggi berlaku untuk setiap token dalam permintaan, bukan hanya token yang melewati ambang batas. Ini adalah detail paling mahal di halaman ini untuk dilewatkan

• Kontrol penalaran — empat tingkat, rendah, sedang, tinggi dan sangat tinggi, secara default tinggi. Penalaran tidak dapat dimatikan sepenuhnya, dan token penalaran ditagih sebagai token keluaran

• Dukungan alat dan format — pemanggilan fungsi dan output terstruktur didukung secara native. Alat pencarian sisi server ditagih di atas penggunaan token; kami tidak dapat mengonfirmasi tarif per panggilan saat ini di halaman model vendor, hanya bahwa itu ada

• Batas laju — 150 permintaan per detik dan 50 juta token per menit

• Batch API — tidak didukung di Grok 4.5, tidak seperti Grok 4.3

• Wilayah layanan — us-east-1 dan us-west-2 saat peluncuran. Ketersediaan di Eropa secara eksplisit tidak tersedia pada hari pertama dan dijelaskan oleh vendor sebagai diperkirakan pada pertengahan Juli 2026; kami tidak menemukan pernyataan sumber primer yang lebih baru yang mengonfirmasi tanggal pasti pembukaannya, jadi anggap linimasa UE sebagai belum dikonfirmasi di sini

Satu ketidaksesuaian yang layak dicatat alih-alih dihaluskan: entri katalog OrcaRouter sendiri untuk grok/grok-4.5 menunjukkan tarif baca cache sebesar $0,50 per juta, yang cocok dengan yang dikenakan xAI untuk Grok 4.6 dan Grok 4.7, bukan $0,30 yang ditampilkan tabel harga vendor untuk Grok 4.5. Dokumentasi vendor adalah acuan resmi untuk harga; halaman kami tampaknya memuat tarif cache penerusnya, dan hal ini telah ditandai alih-alih diam-diam diulang di sini.

Apa yang secara terukur dikuasai Grok 4.5

Klaim utama saat peluncuran adalah ekonomi token, dan itulah satu-satunya klaim di halaman peluncuran yang punya mekanisme di baliknya, bukan sekadar skor. Pada SWE-bench Pro, xAI melaporkan bahwa Grok 4.5 rata-rata menghasilkan 15.954 token keluaran per tugas yang diselesaikan, dibandingkan 67.020 untuk Claude Opus 4.8 yang berjalan pada upaya maksimal — sekitar 4,2 kali lebih sedikit token untuk menyelesaikan pekerjaan yang sama. Lebih sedikit token keluaran per tugas yang diselesaikan adalah pembeda antara model yang lebih murah dan model yang lebih murah dan lebih cepat dalam hitungan waktu nyata, karena token keluaranlah yang Anda tunggu. Dilaporkan oleh vendor, pada harness milik vendor sendiri, dan belum direproduksi oleh pihak independen mana pun — tetapi ini adalah klaim struktural, bukan persentase yang dipilih-pilih.

Tabel benchmark vendor, yang diterbitkan bersama model dan karena itu seluruhnya dilaporkan oleh vendor, tampil seperti ini jika dibandingkan dengan model yang sama:

• DeepSWE 1.0 — Grok 4.5 62,0%, tertinggal dari Claude Fable 5 pada 66,1% dan GPT-5.5 pada 64,31%, unggul dari Claude Opus 4.8 pada 55,75%

• SWE Marathon, tingkat penyelesaian — Grok 4.5 29,0%, unggul dari Claude Opus 4.8 dengan 26,0% dan Claude Fable 5 dengan 24,0%. Ini adalah satu-satunya tolok ukur coding di mana Grok 4.5 memimpin.

• Terminal-Bench 2.1 — Grok 4.5 83,3%, secara efektif setara dengan Claude Fable 5 pada 84,3% dan GPT-5.5 pada 83,4%, unggul dari Claude Opus 4.8 pada 78,9%

• DeepSWE 1.1 — Grok 4.5 53%, di bawah Claude Fable 5 pada 70% dan GPT-5.5 pada 67%

• SWE-bench Pro — Grok 4.5 64,7%, di bawah Claude Fable 5 pada 80,4% dan Claude Opus 4.8 pada 69,2%

Pembacaan yang jujur adalah bahwa Grok 4.5 unggul dalam penyelesaian tugas berhorizon panjang dan dalam ekonomi penyelesaian sebuah tugas, tetapi kalah pada tolok ukur pengodean sekali jalan yang lebih sulit. Model ini bagus untuk loop agen dan biasa saja untuk masalah sulit sekali jalan — dan pembedaan itulah yang persis diprediksi oleh angka efisiensi token.

A single-column scoreboard card for Grok 4.5 titled 'Grok 4.5 - the scoreboard' with six rows reading: AA Intelligence Index 39 (#52 of 212); Output speed 55.1 tok/s (#126 of 212); Time to first token 10.94 s; Context window 500K tokens; Price per 1M $2.00 / $6.00, $0.30 cached; SWE-bench Pro 64.7% (vendor). Footer: 'Price and spec rows per xAI docs; AA Index and speed per Artificial Analysis Intelligence Index v4.3.2; SWE-bench Pro vendor-reported.'

Gambaran independennya lebih tipis, dan di sinilah halaman ini harus berhati-hati. Artificial Analysis saat ini mencantumkan Grok 4.5 (high) dengan skor Intelligence Index 39, peringkat #52 dari 212 model, pada versi indeks v4.3.2 — di atas median 25 untuk model sebanding, tetapi tidak mendekati posisi terdepan. Jika Anda pernah melihat skor 54 atau 56 dikutip untuk model ini dalam liputan Juli, jangan membandingkannya dengan 39: Artificial Analysis telah merevisi indeks sejak peluncuran dan kedua angka tersebut berasal dari revisi yang berbeda. Inilah persis jenis perbandingan angka usang yang membuat tabel benchmark tidak dapat dipercaya, dan itulah sebabnya halaman ini mencantumkan versi indeks bersama skornya.

Apa saja hal yang secara terukur buruk pada Grok 4.5

Artificial Analysis melaporkan kecepatan output 55,1 token per detik, berada di peringkat #126 dari 212 model dan di bawah median 74 — jauh dari 80 token per detik yang dikutip xAI saat peluncuran dan lebih jauh lagi dari ~340 token per detik yang dicapai model tercepat saat ini. Laporan itu juga menyebut waktu ke token pertama 10,94 detik dibandingkan median 3,86 detik. Kedua angka tersebut bersama-sama menggambarkan biaya sesungguhnya dari model penalaran yang secara default disetel ke tinggi dan tidak dapat dimatikan: Anda menunggu, lalu ia berbicara dengan lambat. Biarkan tingkat penalaran pada default dan Grok 4.5 akan terasa seperti model paling lambat yang Anda miliki di key.

Tiga hal negatif terukur lagi, diurutkan berdasarkan seberapa besar pengaruhnya terhadap suatu keputusan:

• Artificial Analysis telah menandai Grok 4.5 sebagai deprecated dan mengatakan bahwa mereka hanya terus melakukan benchmark untuk beban kerja input 10.000 token default bagi model itu. Itu adalah pihak ketiga yang memberi tahu Anda bahwa mereka telah berhenti mengukur secara penuh model yang sedang Anda pertimbangkan, dan mereka merekomendasikan Grok 4.6 sebagai gantinya. Deprecated di papan peringkat tidak berarti tidak tersedia di API — itu berarti basis bukti independennya dibekukan

• Ia kalah dalam dua benchmark yang paling menyerupai coding sulit sekali jalan: DeepSWE 1.1 dan SWE-bench Pro, baik dari Claude Fable 5 maupun GPT-5.5, menurut tabel xAI sendiri

• Model ini hanya memiliki setengah konteks Grok 4.3 dengan harga input dua kali lipat, dan sama sekali tidak ada API batch. Jika beban kerja Anda adalah pemrosesan dokumen panjang atau inferensi batch offline, Grok 4.5 adalah model yang salah bahkan dalam keluarganya sendiri

Tentang halusinasi dan kalibrasi, halaman ini tidak dapat mengonfirmasi angka independen terkini. Liputan Juli menyebarkan tingkat halusinasi sekitar 54%, tetapi kami tidak dapat memverifikasi angka tersebut di halaman model Artificial Analysis yang kami baca, dan angka itu juga tidak muncul di halaman vendor. Daripada mengulang angka yang tidak dapat kami sumberkan, kami mencatatnya sebagai tidak diukur di sini.

Siapa yang harus memilih Grok 4.5, dan siapa yang harus memilih yang lain

Pilih Grok 4.5 jika Anda menjalankan loop agentik di mana biaya per tugas yang diselesaikan lebih penting daripada biaya per token, dan Anda sudah mengukur bahwa perilaku ekonomi token V9 berlaku pada beban kerja Anda. Ini juga pilihan yang tepat jika Anda memerlukan snapshot keluarga Grok dengan tarif input cache $0,30 pada prefiks besar, stabil, dan sering diakses berulang — tarif cache itu benar-benar lebih murah daripada yang dikenakan Grok 4.6 dan Grok 4.7, dan pada beban kerja yang padat cache, perbedaan itu bisa melebihi dua generasi kemampuan.

Pilih Grok 4.6 atau Grok 4.7 sebagai gantinya untuk hampir semua hal lainnya. Harga daftar sama, jendela 500K sama, pelatihan lebih baru, skor independen lebih baik, dan rekomendasi Artificial Analysis sendiri. Tidak ada versi dari "Saya ingin Grok terbaik" yang jawabannya adalah 4.5 hari ini.

Pilih Grok 4.3 jika konteks menjadi kendala: 1 juta token dengan $1,25 dan $2,50, dengan diskon batch yang tidak ditawarkan Grok 4.5. RAG dokumen panjang dan analisis seluruh repositori masih menjadi wilayahnya.

Pilih sesuatu di luar keluarga jika Anda mengoptimalkan skor puncak alih-alih harga per tugas — Claude Fable 5 memimpin setiap benchmark coding dalam tabel perbandingan xAI sendiri, dan GPT-5.5 berada di depan Grok 4.5 pada DeepSWE 1.0 dan 1.1. Jika Anda menginginkan bobot terbuka dan dapat menerima model yang lebih kecil, itu adalah pembelian yang sama sekali berbeda dan tidak ada model Grok yang bersaing untuk itu.

Memanggil Grok 4.5 tanpa kontrak kedua

Grok 4.5 sudah aktif di OrcaRouter dengan harga resmi xAI, dengan tarif penyedia diteruskan tanpa markup — jadi $2,00 dan $6,00 di atas adalah yang Anda bayarkan, dan perubahan harga vendor sampai di sisi kami pada hari yang sama ketika sampai di sisi mereka. Hal itu lebih penting dari biasanya untuk model khusus ini, karena keputusan yang dihadapi sebagian besar pembaca bukanlah "Grok 4.5 atau tidak sama sekali", melainkan "Grok 4.5 atau Grok 4.6 atau Grok 4.3", dan membandingkan tiga model dari satu keluarga justru merupakan hal yang menjadi murah berkat satu endpoint yang mencakup lebih dari 200 model. Satu kunci, tanpa kontrak kedua, dan uji A/B yang cukup mengubah satu string alih-alih melakukan integrasi.

Argumen failover di sini luar biasa konkret. Grok 4.5 masih dapat dirutekan tetapi tidak lagi sepenuhnya di-benchmark oleh pelacak independen dan bukan lagi andalan vendor — model yang mungkin ingin Anda tempatkan dalam rantai cadangan ketimbang sebagai satu-satunya jalur. Failover otomatis lintas penyedia adalah mekanisme yang memungkinkan Anda mempertahankannya untuk hal-hal yang menjadi keunggulannya tanpa mempertaruhkan rute produksi pada snapshot yang mulai ditinggalkan oleh ekosistem.

Yang tidak akan dilakukan halaman ini adalah berpura-pura bahwa pilihannya sudah jelas. Grok 4.5 adalah model bagus dengan kekuatan spesifik, berada dalam keluarga di mana uang yang sama kini membeli model yang lebih baru. Jika Anda memulai dari awal hari ini, rekomendasi jujurnya adalah Grok 4.6. Jika Anda sudah menjalankan Grok 4.5 dalam loop agen dan model itu menyelesaikan tugas dengan jumlah token yang Anda anggarkan, rekomendasi jujurnya adalah tidak mengubah apa pun dan mengukur ulang dalam satu kuartal.

Screenshot of the OrcaRouter model page for Grok 4.5 (grok/grok-4.5), showing the SpaceXAI provider label, the Featured badge, capability tags for Vision, Tools, JSON and Reasoning, the 500K-token context window, the $2.00 per million input and $6.00 per million output pricing rows, and the benchmark table sourced from Artificial Analysis.

Grok 4.5 dapat dirutekan di OrcaRouter hari ini, begitu juga Grok 4.6, Grok 4.7, dan Grok 4.3. OrcaRouter meneruskan harga daftar penyedia tanpa markup, sehingga perubahan harga vendor sampai di sisi kami pada hari yang sama saat perubahan itu sampai di sisi mereka, dan memindahkan beban kerja antara dua model Grok hanyalah perubahan string, bukan kontrak kedua.

Dibandingkan dalam artikel ini4

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari