
Apa Itu Grok 4.7? Spesifikasi, Harga, Context Window, dan Benchmark
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 300 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 195 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 112 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
Grok 4.7 adalah model unggulan SpaceXAI saat ini: model penalaran yang menerima teks dan gambar sebagai masukan, mengembalikan teks, memiliki jendela konteks 500.000 token, dan dipatok pada $2,00 per juta token masukan serta $6,00 per juta token keluaran dengan upaya penalaran yang dapat dipilih di empat tingkat. Model ini menggantikan Grok 4.6, menyamainya dalam harga dan konteks secara persis, serta ditujukan untuk pekerjaan berhorizon panjang — pengodean berjam-jam, lingkar alat agentik, pekerjaan pengetahuan profesional — yang kini menjadi poros penjualan seluruh lini produk perusahaan. Halaman ini adalah entri rujukan untuk model tersebut: apa modelnya, di mana posisinya, apa yang diterimanya, berapa biayanya, lalu dua hal yang sengaja dipisahkan — apa yang dikatakan SpaceXAI tentang modelnya sendiri, dan apa yang diukur oleh evaluator independen.
Mengapa ini halaman referensi dan bukan berita peluncuran. Grok 4.7 dirilis pada 21 September 2026, dan peluncuran itu sudah dibahas di blog ini (lihat artikel grok-4-7-release-date untuk ulasan hari pertama), jadi tanggal di bawah ini digunakan sebagai fakta yang memberi tanggal pada model, bukan sebagai peristiwa yang dilaporkan lagi. Pembaca yang menjadi alasan halaman ini ada adalah orang yang mengetikkan nama polos model ke kotak pencarian dan menginginkan modelnya, bukan beritanya: selama 28 hari hingga 25 September 2026, data Search Console kami sendiri mencatat 31.934 tayangan untuk kueri persis "grok 4.7" dan 34.160 di semua ejaan yang mengarah ke nama itu, berada pada posisi rata-rata 7,8 tanpa halaman khusus yang dapat dituju. Itu adalah ukuran dari apa yang orang ketik — sama sekali tidak menunjukkan seberapa bagus modelnya — dan itulah sebabnya halaman ini dimulai dengan pertanyaan paling sederhana yang mungkin. Setiap angka dalam artikel ini diberi label berdasarkan asalnya: dilaporkan vendor untuk apa pun dari dokumen, postingan peluncuran, atau halaman harga SpaceXAI sendiri, independen untuk Artificial Analysis, dan milik kami sendiri untuk apa yang ditunjukkan katalog kami dan data pencarian kami.
Di mana Grok 4.7 berada dalam lini Grok
Vendor kini menuliskan namanya sebagai SpaceXAI di dokumentasi pengembang dan halaman berita, sementara API-nya sendiri masih dilayani dari api.x.ai dan pengenal modelnya masih memakai grok. Grok 4.7 adalah puncak lini teks dan rekomendasi default vendor itu sendiri: saat ditanya model mana yang harus dipilih, halaman model menjawab bahwa untuk segala hal kecuali pekerjaan audio, gambar, dan video — "termasuk kode" — Anda harus menggunakan Grok 4.7, karena "itu adalah model paling mumpuni yang pernah kami buat." Saudara-saudaranya, dengan tarif yang dipublikasikan vendor sendiri per juta token, adalah:
• Grok 4.6 — konteks 500K, $2.00 input / $0.50 di-cache / $6.00 output, dirilis Agustus 2026. Pendahulu langsung dan model yang menjadi acuan penetapan harga 4.7.
• Grok 4.5 — konteks 500K, input $2.00 / cache $0.30 / output $6.00, dirilis Juli 2026. Harga daftar yang sama dengan para penerusnya tetapi tarif cache yang lebih murah, yang kini menjadi satu alasan konkret untuk tetap memilihnya.
• Grok 4.3 — konteks 1M, input $1,25 / cache $0,20 / output $2,50. Setengah harga dari model unggulan saat ini dan dua kali lipat jendela konteksnya.
• Grok 4.20 (varian penalaran, non-penalaran, dan multi-agen) — konteks 1M, $1.25 masukan / $0.20 di-cache / $2.50 keluaran.
• Grok Build 0.1 — konteks 256K, $1,00 input / $0,20 cache / $2,00 output. Spesialis coding, bukan model umum, dan model default agen Grok Build adalah Grok 4.7, bukan ini.
Jadi bentuk lini saat ini adalah trade-off antara kemampuan dan biaya: produk unggulan memberi Anda konteks 500K dengan harga $1/$1, dan tier 4.3/4.20 memberi Anda satu juta token penuh dengan harga input sekitar setengahnya dan harga output kurang dari setengahnya. Tidak ada apa pun dalam dokumentasi vendor yang menunjukkan bahwa Grok 4.7 adalah arsitektur yang berbeda dari Grok 4.6 — yang dijelaskan oleh rilis ini adalah model dasar yang lebih besar, proses reinforcement learning yang lebih panjang yang difokuskan pada tugas-tugas yang memerlukan berjam-jam untuk diselesaikan, kemampuan memperbaiki diri yang lebih baik, penanganan konteks panjang yang lebih baik, dan pelatihan pada Grok Bot agar model berperilaku lebih baik dalam pekerjaan percakapan dan pengetahuan. Klaim peningkatan, bukan desain baru. SpaceXAI tidak mencantumkan jumlah parameter untuk Grok 4.7 baik di halaman modelnya maupun tabel harganya, dan halaman ini tidak akan menebak-nebak.
Kapan dirilis, dan apa yang dirilis bersamanya
Posting peluncurannya bertanggal 21 September 2026, dan halaman model pengembang mencantumkan tanggal yang sama sebagai pembaruan terakhirnya, yang merupakan tingkat presisi paling tinggi yang bisa didapat — SpaceXAI tidak menerbitkan stempel waktu rilis selain hari itu. Yang dirilis hari itu bukan sekadar pengenal model. grok-4.7 slug langsung tersedia di Responses API dan Chat Completions dengan jendela konteks 500.000 token, batas pengetahuan Mei 2026, empat tingkat penalaran termasuk setelan puncak baru, varian Fast yang dibatasi hanya untuk dua antarmuka pihak pertama, endpoint regional khusus AS, dan harga daftar yang identik dengan Grok 4.6. Model ini sekaligus dijadikan model default agen pengodean Grok Build dan tersedia di Cursor pada semua paket. Jika Anda menginginkan reaksi hari pertama alih-alih spesifikasinya, artikel grok-4-7-release-date membahas hal itu; halaman ini menganggap tanggal yang sama sebagai fakta tentang model dan beralih ke apa yang sebenarnya akan dilakukan model ini untuk Anda.
Envelope: apa yang dapat Anda kirim, dan seberapa banyak.
Semua berikut ini berasal dari halaman model dan halaman models milik SpaceXAI sendiri, yang dibaca pada 28 September 2026, kecuali jika dinyatakan lain.

• Jendela konteks — 500.000 token. Sama seperti Grok 4.6, setengah dari yang ditawarkan Grok 4.3 dan keluarga 4.20.
• Batas pengetahuan — Mei 2026, tiga bulan lebih baru daripada Grok 4.6. Apa pun yang lebih baru memerlukan alat pencarian yang diaktifkan; model ini tidak memiliki kesadaran waktu nyata secara default.
Masukan — teks dan gambar. Gambar dapat berupa JPG/JPEG atau PNG, hingga 20 MiB per gambar, dan vendor tidak mencantumkan batas jumlah gambar dalam satu permintaan; gambar dan teks dapat muncul dalam urutan apa pun.
• Keluaran — hanya teks. Tidak ada pembuatan gambar, audio, atau video pada model ini; itu adalah model terpisah dalam lini SpaceXAI.
• Batas keluaran — vendor menyatakan tidak ada batas keluaran teks. Kartu model OrcaRouter kami sendiri untuk grok-4.7 mencantumkan keluaran maksimum 450.000 token, dan kedua angka tersebut tidak cocok. Kami menandai hal ini alih-alih diam-diam memilih salah satunya: dokumentasi SpaceXAI adalah otoritas tentang model SpaceXAI, dan pembacaan yang jujur adalah bahwa vendor tidak menerbitkan batas keluaran teks.
• Kontrol penalaran — reasoning_effort menerima low, medium, high (default dari vendor) atau xhigh. xhigh baru di generasi ini; Grok 4.6 juga menawarkan empat tingkat, dan angka benchmark yang dipublikasikan untuk 4.7 dikutip pada xhigh.
• Alat — pemanggilan fungsi, pencarian web, pencarian X, dan eksekusi kode, semuanya didokumentasikan sebagai alat sisi server.
• Output terstruktur — vendor mendokumentasikan kemampuan output terstruktur di samping pembuatan teks; halaman kami sendiri menampilkannya sebagai response_format dan structured_outputs.
• Parameter yang diterima halaman kami — include_reasoning, logprobs, max_tokens, reasoning, reasoning_effort, response_format, seed, structured_outputs, temperature, tool_choice, tools, top_logprobs, dan top_p. Satu catatan yang perlu diketahui sebelum Anda membangun di atas logprobs: halaman model SpaceXAI menyatakan bahwa logprobs dan top_logprobs tidak didukung oleh grok-4.20 dan model yang lebih baru serta "akan diabaikan secara diam-diam jika diatur", yang mencakup Grok 4.7. Pencantuman parameter tersebut di halaman kami bukan jaminan bahwa upstream mengembalikannya.
• Endpoint — API Chat Completions yang kompatibel dengan OpenAI dan API Responses.
• Caching prompt — vendor merekomendasikan untuk menetapkan prompt_cache_key pada Responses API (x-grok-conv-id header pada Chat Completions) sehingga permintaan suatu percakapan diarahkan ke server yang sama; tanpa itu, dokumentasi memperingatkan, Anda sering membayar harga input penuh pada server yang cache-nya dingin. Input yang di-cache dikenakan biaya $0.50 per juta token di bawah ambang 200K.
• Penalaran terenkripsi — pada Responses API, Grok 4.7 selalu mengembalikan reasoning.encrypted_content, bahkan saat Anda tidak memintanya, sehingga panggilan multi-turn tetap mempertahankan penalaran model tanpa konfigurasi tambahan. Chat Completions tidak berubah.
Kartu tarif, secara lengkap.
Penetapan harga bertingkat berdasarkan ukuran permintaan, dan seluruh permintaan begitu ambang terlampaui, bukan hanya token di atas garis. Setiap angka di sini berasal dari halaman harga SpaceXAI pada 28 September 2026:
• Standard, prompt di bawah 200K token — $2.00 input / $0.50 input yang di-cache / $6.00 output per juta token.
• Konteks panjang, prompt pada atau di atas 200K token — {{1}}$4,00 input / $1,00 input di-cache / $12,00 output per juta token{{/1}}.
• Grok 4.7 Fast — model yang sama di infrastruktur yang lebih cepat dengan tarif dua kali lipat dari standar: $4,00 / $1,00 / $12,00 di bawah 200K, dan $6,00 / $1,50 / $18,00 di atasnya. Ini hanya tersedia melalui Cursor dan Grok Build, sama sekali tidak ada di API publik, dan tier gratis Grok Build tidak mencakupnya.
• US regional endpoint — https://us.api.x.ai/v1 keeps inference in the United States and bills at 1.1×, which works out to $2.20 / $0.55 / $6.60 per million below 200K and $4.40 / $1.10 / $13.20 above. Only grok-4.7 and grok-4.6 are served there today.
Dibandingkan dengan sisa pasar, hal yang menarik bukanlah tarif utamanya — $2 masuk dan $6 keluar persis seperti yang dikenakan Grok 4.6 dan yang masih dikenakan Grok 4.5 — melainkan diskon cache, yang dipublikasikan vendor sebesar potongan 75% untuk input pada prefiks prompt yang berulang. Untuk loop agen yang panjang yang mengirim ulang system prompt dan konteks file yang sama setiap giliran, diskon itu adalah perbedaan antara harga daftar dan tagihan. Ini juga satu-satunya baris di mana Grok 4.7 lebih buruk daripada saudara tuanya: Grok 4.5 menyimpan cache sebesar $0.30 per juta, sedangkan Grok 4.7 $0.50.
Grok 4.7 tersedia di OrcaRouter sebagai grok/grok-4.7 dengan harga daftar milik SpaceXAI sendiri dengan markup 0% — harga penyedia diteruskan apa adanya, jadi perubahan harga vendor langsung aktif di sini pada hari yang sama, bukan setelah proses penetapan harga ulang. Hal itu lebih penting dari biasanya pada model dengan ambang prompt dua tingkat dan tarif cache, karena keduanya mengubah biaya yang sebenarnya Anda bayar. Ini adalah satu kunci dan satu endpoint yang kompatibel dengan OpenAI untuk seluruh lini Grok, jadi mengalihkan beban kerja dari Grok 4.7 ke Grok 4.5 atau 4.3 untuk menguji perbedaan biaya hanyalah perubahan string, bukan kontrak kedua.
Apa yang SpaceXAI klaim untuknya
Semua yang ada di bagian ini dilaporkan oleh vendor. Tidak ada satu pun yang telah direproduksi secara independen, dan pengaturan effort itu penting — tabel pada post peluncuran mengutip Grok 4.7 pada xHigh, Grok 4.6 pada High, dan dua model pembanding pada Max, yang bukan merupakan perbandingan yang sepadan.
• CursorBench 4.0 — 46,3% untuk Grok 4.7 pada xHigh, dibandingkan 40,4% untuk Grok 4.6 pada High. Pembingkaian dari postingan peluncurannya sendiri adalah bahwa di sinilah Grok 4.7 berada "di garis depan dalam hal harga-kinerja".
• Terminal-Bench 4.0 — 37,6%, dibandingkan dengan 20,3% untuk Grok 4.6. Delta tunggal terbesar dalam rilis ini, dan yang cocok dengan klaim "RL lebih lama pada tugas yang lebih sulit".
• DeepSWE v1.1 — 71,0%, ditandai dalam tabel milik vendor sendiri sebagai skor upaya tinggi, dibandingkan dengan 65,2% untuk Grok 4.6.
• AA Briefcase v1.1 — 1.657, dibandingkan 1.546 untuk Grok 4.6. Perhatikan benturan nama di sini: ini adalah vendor yang mengutip benchmark yang juga dijalankan oleh Artificial Analysis, dan hasil independennya dibahas di bagian berikutnya.
• EEBench — 64,0%, dibandingkan dengan 53,0% untuk Grok 4.6.
• Harvey Legal Agent Benchmark — 19,6%, dibandingkan dengan 15,8% untuk Grok 4.6.
• HealthBench Professional — 56,7%, dibandingkan 48,5% untuk Grok 4.6.
• GDPval — 1.695 Elo pada xhigh, dibandingkan 1.605 untuk Grok 4.6 pada high.
Klaim keamanannya juga dilaporkan oleh vendor, dan luar biasa spesifik: SpaceXAI mengatakan Grok 4.7 dibangun di atas tumpukan pengaman baru, bahwa model itu memuncaki tolok ukur biosafety LatchBio pada 62,4%, dan bahwa pada HackerBench v0.3 miliknya sendiri, model itu hanya meloloskan 3,3% prompt dual-use berisiko sambil jarang memblokir pekerjaan keamanan yang sah. Perusahaan juga mengatakan telah mulai memberikan akses khusus undangan kepada mitra keamanan siber terpilih ke kemampuan red-team model tersebut. Perlakukan semua itu sebagai pengujian vendor terhadap modelnya sendiri — ini adalah rangkaian klaim yang cukup spesifik untuk diperiksa nanti, yang tidak sama dengan diperiksa sekarang. Positioning satu baris pada postingan peluncuran, "dua kali lebih cepat, dengan setengah harga model-model sebanding", adalah pemasaran tentang para pesaing alih-alih pengukuran Grok 4.7, dan angka kecepatan independen di bawah ini tidak mendukung bagian "dua kali lebih cepat" darinya.

Apa yang diukur oleh evaluator independen
Artificial Analysis adalah satu-satunya sumber dalam cerita ini yang tidak memiliki kepentingan pada model tersebut, dan halaman Grok 4.7-nya secara eksplisit merupakan konfigurasi xhigh. Dibaca pada 28 September 2026:
• Kecerdasan — 46 pada Artificial Analysis Intelligence Index, versi indeks v4.3.2, yang berada di peringkat ke-21 dari 211 model di papan tersebut dan jauh di atas median indeks sebesar 26. Indeks itu merupakan komposit dari sepuluh evaluasi: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, dan AA-LCR v1.1.
• Biaya — $3,74 untuk menjalankan Intelligence Index sekali, dengan evaluator yang sama mempublikasikan diskon cache sebesar 75% dan tarif input/output yang sesuai dengan milik vendor ($2,00 / $6,00). Komentarnya sendiri adalah bahwa model tersebut "berharga wajar jika dibandingkan dengan model lain dengan harga serupa".
• Verbositas — 240M token keluaran yang dihasilkan di seluruh Intelligence Index, dibandingkan median 88M. Artificial Analysis menyebutnya "sangat verbose", dan ini adalah angka paling berguna di sini bagi siapa pun yang menyusun anggaran: model yang berpikir dalam rantai lebih panjang menelan biaya lebih besar per tugas bahkan pada tarif token yang tetap.
• Kecepatan — 82,6 token keluaran per detik, peringkat ke-83 dari 211 di papan itu, yang meskipun demikian dilabeli evaluator sebagai "lebih lambat dari rata-rata". Dua catatan penting sebelum Anda membawa angka ini ke mana pun. Artificial Analysis mengubah beban kerja tolok ukur defaultnya menjadi input 10.000 token agar lebih mencerminkan penggunaan produksi, dan bacaan kecepatan yang dipublikasikannya untuk model ini telah berubah secara signifikan antar snapshot, jadi perlakukan itu sebagai snapshot dari satu beban kerja, bukan konstanta. Di sisi penyedia API, evaluator yang sama hanya mencantumkan satu penyedia untuk model ini — SpaceXAI sendiri — sehingga latensi terukur dan harga gabungannya adalah angka pihak pertama, bukan sebaran pasar.
Katalog kami sendiri memuat tiga hasil Artificial Analysis tambahan untuk Grok 4.7, yang dievaluasi pada 21 September 2026: 43,1% pada Humanity's Last Exam, 76,7% pada evaluasi recall konteks panjang, dan 57,4% pada SciCode. Hasil-hasil itu diberi label independen karena berasal dari Artificial Analysis, dan layak dibaca berdampingan dengan klaim verifikasi sendiri pihak vendor, bukan sebagai konfirmasi atas klaim-klaim tersebut.
Catatan perbandingan yang jujur: angka SpaceXAI dan angka Artificial Analysis dihasilkan pada harness yang berbeda dengan pengaturan effort yang berbeda, dan keduanya belum dijalankan secara head to head dalam konfigurasi yang setara. Ketika nama benchmark yang sama muncul di kedua sisi — AA Briefcase, Terminal-Bench 4.0 — itu adalah nama yang sama, bukan run yang sama. Siapa pun yang mengutip angka vendor di samping angka independen seolah-olah keduanya adalah satu pengukuran sedang melakukan aritmetika yang tidak didukung oleh bukti.
Di mana Anda benar-benar bisa menyebutnya.
Grok 4.7 dapat dipanggil sejak hari peluncuran melalui API milik SpaceXAI sendiri di api.x.ai, menggunakan Responses API atau Chat Completions, dan melalui endpoint regional khusus AS dengan premi 10%. Model ini adalah model default dari agen coding Grok Build dan tersedia di Cursor pada semua paket, dengan varian Fast — model yang sama dengan tarif dua kali lipat — dibatasi hanya untuk dua permukaan tersebut dan tidak ada di API publik. Di luar akses pihak pertama, vendor menggambarkannya sebagai tersedia melalui harness coding pihak ketiga, router model, dan platform cloud.
Secara khusus di sisi kami: grok/grok-4.7 sudah tersedia di katalog OrcaRouter hari ini, dengan harga sesuai tarif daftar milik xAI sendiri dengan markup 0% dan dapat dipanggil di endpoint mana pun melalui kunci yang sama seperti sisa lini Grok. Jika Anda mengevaluasinya terhadap Grok 4.6 — harga sama, jendela sama, model yang berbeda di baliknya — merutekan keduanya melalui satu endpoint dengan rantai failover otomatis adalah cara murah untuk mengetahui mana yang sebenarnya lebih disukai beban kerja Anda, daripada mengikat jalur produksi ke model yang lebih baru hanya berdasarkan tabel vendor.

Apa yang perlu diperhatikan, mengingat catatan yang ada masih sangat tipis. SpaceXAI belum menerbitkan jumlah parameter, dan pertanyaan tentang batas atas keluaran benar-benar terbuka — klaim vendor "tanpa batas keluaran teks" versus 450K yang ditampilkan halaman kami sendiri adalah ketidaksesuaian yang belum diselesaikan siapa pun. Tidak ada perbandingan head-to-head dengan harness yang setara melawan model-model yang menjadi pesaing jualannya. Dan angka kecepatan di atas adalah angka yang paling mungkin berubah, karena memang sudah berubah. Itulah tiga tempat yang perlu diedit di halaman ini seiring catatan makin terisi, dan lebih baik mengatakannya daripada berpura-pura spesifikasinya sudah final.
Grok 4.7 dapat dirutekan di OrcaRouter hari ini, dan begitu pula Grok 4.6, Grok 4.5, Grok 4.3, serta keluarga Grok 4.20. OrcaRouterOrcaRouter meneruskan harga daftar penyedia tanpa markup, sehingga ambang batas prompt dua tingkat milik SpaceXAI dan tarif cache-nya masuk ke sisi kami pada hari yang sama saat berubah di sisi mereka, dan menguji beban kerja terhadap model Grok yang lebih lama dan lebih murah hanyalah perubahan string, bukan kontrak kedua.
Dibandingkan dalam artikel ini3
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
