Kartu judul hero untuk perbandingan GPT-6 dan Grok 4.7. Judul utamanya berbunyi 'GPT-6 vs Grok 4.7'. Sebuah chip berbunyi 'GPT-6 Sol: konteks 1,05M, output 128K, $2,00 / $10,00'. Sebuah chip berbunyi 'Grok 4.7: konteks 500K, output 450K, $2,00 / $6,00'. Footer berbunyi 'Harga input seri; harga output dan plafon output tidak.'
Guides & Insights

GPT-6 vs Grok 4.7: Kolom Output yang Menentukan

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

GPT-6 Sol dan Grok 4.7 mengenakan biaya yang sama untuk token masukan — $2,00 per juta, keduanya — yang membuat kolom masukan tidak berguna untuk memilih di antara keduanya. Keputusannya terletak satu kolom di sebelah kanan. GPT-6 Sol menagih $10,00 per juta token keluaran; Grok 4.7 menagih $6,00. Dan kedua model itu tidak sepakat tentang berapa banyak keluaran yang boleh Anda hasilkan dalam satu panggilan, dengan selisih faktor tiga setengah: GPT-6 Sol membatasi pada 128.000 token, sedangkan Grok 4.7 — produk andalan SpaceXAI, dirilis 21 September 2026 sebagai penerus Grok 4.6 — mencapai 450.000.

Semua hal lain dalam perbandingan ini mengikuti kedua fakta tersebut, ditambah satu fakta lagi: GPT-6 Sol membawa jendela konteks yang lebih besar, 1.050.000 token dibandingkan 500.000 milik Grok 4.7. Jadi ini bukan cerita tentang satu model yang lebih baik. Ini adalah cerita tentang dua model dengan bentuk yang berbeda, dan tentang bentuk mana yang dimiliki beban kerja Anda.

Pastikan dulu bentuk permintaan Anda sudah benar.

Cara yang berguna untuk memilah keputusan GPT-6 versus Grok 4.7 adalah berdasarkan sumber daya mana yang sebenarnya dikonsumsi oleh pekerjaan Anda. Tiga kasus mencakup sebagian besar trafik produksi.

Input panjang, output pendek. Anda memasukkan dokumen besar, basis kode, atau transkrip agen yang panjang dan menerima kembali ringkasan, diff, atau keputusan. Di sini jendela konteks adalah kendala yang mengikat, dan 1.050.000 token GPT-6 Sol kira-kira dua kali lipat 500.000 milik Grok 4.7. Tapi perhatikan garis tier pada kedua kartu: tarif $2,00 Grok 4.7 berlaku hingga 200.000 token input dan naik ke $4,00 setelah itu, sedangkan tarif $2,00 GPT-6 Sol berlaku sampai 272.000 dan beralih ke $4,00 setelahnya. Pada 200.001 token, Grok sudah menetapkan harga ulang dan GPT-6 Sol belum, jadi dokumen 250.000 token berbiaya $4,00 per juta pada Grok 4.7 dan $2,00 per juta pada GPT-6 Sol — dua kali lipat, sebelum Anda menghitung output.

Input singkat, output panjang. Anda menghasilkan: dokumen panjang, file kode besar, artefak terstruktur, atau rangkaian panggilan alat yang hasilnya harus dituliskan oleh model. Inilah kasus yang dirancang untuk Grok 4.7. Batas output 450.000 token lebih dari satu orde besaran melampaui apa yang diizinkan sebagian besar model, dan dengan $6,00 per juta output versus $10,00, Anda membayar 40% lebih sedikit untuk setiap token tersebut. Jika generasi Anda rutin melewati 128.000 token output, GPT-6 Sol sama sekali tidak dapat memenuhi permintaan itu dalam satu panggilan, sedangkan Grok 4.7 bisa.

Seimbang dan berat pada keduanya. Input panjang dan output panjang secara bersamaan adalah kasus ketika kedua kartu berinteraksi. Input 400.000 token dengan output 200.000 token dihargai $4,00 untuk input dan $12,00 untuk output pada Grok 4.7 (keduanya di atas ambang batasnya) dan $4,00 untuk input dan $15,00 untuk output pada GPT-6 Sol. Itulah satu-satunya konfigurasi di mana GPT-6 Sol menjadi model yang lebih mahal per token, dan ada baiknya memeriksa rata-rata Anda sendiri terhadapnya sebelum mengasumsikan bahwa default era ChatGPT lebih murah.

Apa yang diubah OpenAI, dan mengapa itu penting di sini

GPT-6 adalah keluarga tiga model, dan pada 7 Oktober 2026 OpenAI memperkenalkan model tengahnya kepada publik. GPT-6 di ChatGPT — peluncuran Intelligent UI — ditenagai oleh GPT-6 Sol untuk Plus, Pro, Business, dan Enterprise, serta oleh GPT-6 Luna untuk Free dan Go, menjangkau lebih dari 1,2 miliar orang yang menggunakan ChatGPT setiap minggu. Itu adalah fakta distribusi, bukan fakta kemampuan, dan itu mengubah arti "GPT-6" dalam sebuah perbandingan: ketika seseorang mengatakan GPT-6 mengalahkan atau kalah dari model lain pada suatu benchmark, yang mereka maksud biasanya adalah GPT-6 Sol secara spesifik, atau GPT-6 Astra sebagai model unggulan dengan harga $10,00 / $50,00.

Untuk pertandingan ini, peluncuran ChatGPT penting dalam satu cara yang konkret. Grok 4.7 dirilis pada 21 September 2026, empat hari sebelum GPT-6 Sol, dan ini adalah model API dan aplikasi murni tanpa padanan default konsumen dengan miliaran pengguna. Deskripsi SpaceXAI sendiri tentangnya sempit dan spesifik: sebuah unggulan untuk rekayasa perangkat lunak jangka panjang, alur kerja agentik dengan penggunaan alat dan verifikasi mandiri, serta pekerjaan pengetahuan. Itu adalah pernyataan tentang pekerjaan yang padat output, yang persis merupakan bentuk di mana kartu Grok lebih kuat.

Papan skor, dilabeli secara jujur

Evaluasi independen untuk keduanya berasal dari Artificial Analysis, dan ringkasannya adalah bahwa keduanya berdekatan pada indeks komposit dan berbeda pada masing-masing uji dengan cara yang selaras dengan produk-produk tersebut.

• AA Intelligence Index: Grok 4.7 46,4 (peringkat 16 dari model yang dievaluasinya), GPT-6 Sol 47,6 — GPT-6 Sol unggul sekitar satu poin
• Humanity's Last Exam: Grok 4.7 43,1%, GPT-6 Sol 47,9%
• SciCode: Grok 4.7 57,4%, GPT-6 Sol 57,6% — praktis setara
• Long-Context Recall: Grok 4.7 76,7%, GPT-6 Sol 83,7% — GPT-6 Sol unggul, konsisten dengan jendela yang lebih besar
• Terminal-Bench (v4.0 pada kartu Grok): Grok 4.7 25,8%, GPT-6 Sol 43,9% pada keluarga harness yang sama
• Coding: Grok 4.7 berada di desil teratas indeks pengodean, bersama model-model terkuat di papan peringkat

Dua catatan penting, dan keduanya bukan sekadar hiasan. Nilai indeks untuk kedua model dievaluasi pada tanggal yang berbeda, jadi ini bukan perbandingan head-to-head pada hari yang sama dan selisih satu poin masih berada dalam rentang pergerakan yang dihasilkan oleh sebuah revisi. Dan setiap angka Grok 4.7 di atas adalah angka terbitan penyedia sendiri sebagaimana dimuat dalam katalog, bukan skor yang kami jalankan ulang — pembacaan yang jujur adalah bahwa Grok 4.7 adalah model coding dekile teratas yang berada sekitar satu poin di belakang GPT-6 Sol pada komposit penalaran umum, dan bahwa selisih terminal-bench adalah sinyal tunggal terbesar dalam kumpulan ini.

Screenshot of the OrcaRouter model page for Grok 4.7, showing the SpaceXAI Grok 4.7 card with a 500,000-token context window, up to 450,000-token output, text/image/file input and text output, and a tiered rate of $2.00 per million input and $6.00 per million output up to 200,000 tokens, stepping to $4.00 and $12.00 above.

Latensi dan reliabilitas, yang disembunyikan oleh lembar spesifikasi

Kartu tarif yang dipublikasikan dan tabel benchmark sama-sama mengabaikan hal yang menentukan kualitas layanan produksi, jadi ada baiknya melihat angka yang terukur, bukan angka pemasaran.

Dalam pengukuran playground milik OrcaRouter sendiri selama minggu pertama Oktober 2026, Grok 4.7 mengembalikan latensi token pertama median sebesar 3.825 ms dan menghasilkan keluaran sekitar 123 token per detik, dengan tingkat kesalahan sekitar 8%. Latensi median terukur GPT-6 Sol pada jendela waktu yang sama lebih tinggi — 6.363 ms — dengan tingkat kesalahan yang jauh lebih tinggi. Observasi playground ini dilakukan pada layanan bersama, bukan pada SLA vendor, dan tingkat kesalahan 39% pada rute salah satu model adalah masalah perutean, bukan masalah model; itulah persis jenis celah yang ada untuk diisi oleh failover. Intinya untuk perbandingan adalah bahwa rute Grok 4.7 tampak jauh lebih responsif dan lebih andal daripada rute GPT-6 Sol pada jendela waktu tertentu itu, dan tidak satu pun kartu yang diterbitkan vendor akan memberi tahu Anda hal itu.

Menjalankan keduanya tanpa berkomitmen pada salah satu.

Godaan dalam pertandingan yang begitu ketat adalah memilih salah satu di muka berdasarkan harga lalu menemukan tiga bulan kemudian bahwa bentuk trafik Anda berubah. Itulah masalah yang dipecahkan oleh routing. Di OrcaRouter, baik grok/grok-4.7 maupun GPT-6 Sol adalah rute aktif dalam katalog yang sama di belakang satu API, pada harga daftar penyedia dengan markup 0% — jadi ketika SpaceXAI atau OpenAI mengubah tarif, perubahannya aktif pada hari yang sama, bukan pada rekonsiliasi faktur berikutnya. Failover otomatis antarpenyedia mencakup kasus ketika salah satu rute mengalami degradasi, yang relevan secara langsung mengingat sebaran tingkat galat di atas. Dan DSL routing memungkinkan Anda membagi trafik berdasarkan bentuk permintaan, bukan preferensi model: kirim pekerjaan dengan input panjang dan output pendek ke model dengan jendela lebih besar, kirim generasi output panjang ke model dengan batas 450K dan tarif output lebih murah, dan biarkan predikat ukuran permintaan yang memilih, bukan manusia.

Memilih

Jika pekerjaan Anda adalah analisis dokumen panjang, penalaran konteks besar, atau apa pun yang berada di atas 200.000 token masukan, GPT-6 Sol adalah pilihan yang lebih baik: konteks dua kali lipat, indeks independen yang lebih tinggi, dan ambang batas yang berada 72.000 token lebih jauh. Jika pekerjaan Anda adalah generasi — artefak kode panjang, penulisan panjang, rantai pemanggilan alat panjang di mana model harus menuliskan apa yang ditemukannya — Grok 4.7 adalah pilihan yang lebih baik: batas keluaran 450.000 token yang tidak dapat dicapai GPT-6 Sol, token keluaran 40% lebih murah, dan profil pengodean desil teratas yang setara. Jika Anda benar-benar melakukan keduanya, jawabannya bukan sebuah model. Melainkan sebuah rute.

A comparison card titled 'The shape of the request decides'. Left column 'Grok 4.7': rows 'Context: 500K', 'Output: up to 450K', 'Input: $2.00 to 200K, then $4.00', 'Output: $6.00, then $12.00', 'AA Index: 46.4'. Right column 'GPT-6 Sol': rows 'Context: 1,050,000', 'Output: 128K', 'Input: $2.00 to 272K, then $4.00', 'Output: $10.00, then $15.00', 'AA Index: 47.6'. A footer reads 'Figures per each vendor's published card and Artificial Analysis; evaluation dates differ between models.'Screenshot of the OrcaRouter model page for GPT-6 Sol, showing the OpenAI GPT-6 Sol card with a 1,050,000-token context window, 128,000 maximum output, text/image/file input, and the tiered rate card of $2.00 per million input and $10.00 per million output up to 272,000 tokens, stepping to $4.00 and $15.00 above that.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari