Kartu judul hero bertuliskan 'GPT-6 Sol Pro vs Gemini 3.1 Pro Preview' dengan subjudul 'Tujuh bulan pratinjau, dan berapa biayanya', dengan logo OrcaRouter asli di kanan bawah.
Guides & Insights

GPT-6 Sol Pro vs Gemini 3.1 Pro Preview: Tujuh Bulan Pratinjau, dan Berapa Biaya yang Harus Anda Tanggung

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Gemini 3.1 Pro Preview telah menjadi pratinjau selama tujuh bulan. Vendor menerbitkannya pada 19 Februari 2026 dengan harga $2,00 per juta token input dan $12,00 per juta token output, dan per minggu ini kartu model masih mendeskripsikannya sebagai "ditawarkan dalam bentuk pratinjau," memperingatkan bahwa model tersebut "mungkin memiliki keterbatasan dalam stabilitas atau ketersediaan dibandingkan dengan rilis stabil," dan menyatakan bahwa model tersebut "dapat mengalami perubahan atau depresiasi tanpa pemberitahuan." Tidak ada tanggal ketersediaan umum dan tidak ada tanggal penghentian pada tabel depresiasi. GPT-6 Sol Pro — konfigurasi GPT-6 Sol, model yang mencapai ketersediaan umum pada 22 September 2026 dengan harga $2,00 input dan $10,00 output — adalah pengaturan yang sebaliknya: API produksi dengan harga yang dipublikasikan, dial effort yang terdokumentasi, dan vendor yang telah berkomitmen pada angka tersebut.

Perbandingan yang menarik antara kedua model ini bukanlah tabel benchmark. Melainkan apa yang dijanjikan masing-masing vendor kepada Anda tentang kuartal berikutnya.

Dua baris harga, salah satunya adalah pratinjau

Keduanya adalah daftar vendor. Angka milik Google dan OpenAI sendiri, diteruskan tanpa diubah oleh platform yang menghostingnya.

• Masukan — GPT-6 Sol $2,00 per juta token vs Gemini 3.1 Pro Preview $2,00 per juta token

• Keluaran — GPT-6 Sol $10,00 per juta token vs Gemini 3.1 Pro Preview $12,00 per juta token

• Konteks panjang — Gemini 3.1 Pro Preview menetapkan ulang harga input pada $4.00 dan output pada $18.00 per juta token di atas ambang 200,000 token; GPT-6 Sol menerapkan penetapan harga ulang konteks panjangnya sendiri di atas ambang input yang lebih tinggi

• Pembacaan cache — GPT-6 Sol $0.20 per juta token vs Gemini 3.1 Pro Preview $0.20 per juta token

• Jendela konteks — GPT-6 Sol 1.050.000 token vs Gemini 3.1 Pro Preview 1.000.000 token

• Output maksimum — GPT-6 Sol 128.000 token vs Gemini 3.1 Pro Preview 65.000 token

• Modalitas masukan — teks dan gambar GPT-6 Sol vs teks, gambar, audio, video, dan file Gemini 3.1 Pro Preview

• Status ketersediaan — GPT-6 Sol tersedia secara umum sejak 22 September 2026 vs Gemini 3.1 Pro Preview dalam pratinjau sejak 19 Februari 2026 tanpa tanggal GA yang diumumkan

Tarif utamanya cukup berdekatan sehingga bukan itu yang menjadi penentu. Input identik. Output berbeda 20%. Perbedaan sebenarnya ada pada dua baris terakhir: Gemini menerima empat modalitas input lebih banyak dan batas output dua kali lipat ke arah sebaliknya — 65.000 token versus 128.000 — dan telah dirilis sebagai pratinjau selama hampir setahun.

A two-column scoreboard card titled 'GPT-6 Sol vs Gemini 3.1 Pro Preview - the scoreboard'. Left column 'GPT-6 Sol': AA Index, current 48; index at Feb 2026 not scored; price in/out $2 / $10; cost per index task $1.06; max output 128K; input modalities text + image. Right column 'Gemini 3.1 Pro Preview': AA Index, current 30; index at Feb 2026 57, retired index; price in/out $2 / $12; cost per index task $0.67; max output 65K; input modalities text, image, audio, video. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Status pratinjau adalah properti operasional yang nyata

Teks katalog Google sendiri memberi tahu para pengembang untuk merencanakan penghentian pratinjau. Kalimat itu memikul banyak beban, dan layak dibaca sebagai batasan rekayasa, bukan sebagai penafian.

Model pratinjau adalah model yang dapat Anda bangun di atasnya tetapi tidak dapat Anda jadikan dasar perencanaan. Ada tiga konsekuensi yang mengikutinya, dan tak satu pun muncul dalam tabel harga.

• Tidak ada komitmen stabilitas. Kartu tersebut menyatakan secara gamblang bahwa model ini mungkin memiliki keterbatasan dalam hal stabilitas dibandingkan dengan rilis stabil, dan bahwa OrcaRouter tidak memberikan jaminan latensi spesifik untuk model pratinjau ini. Telemetri kami sendiri di halaman model menunjukkan p50 dan p95 time to first token keduanya berada pada 10,00 detik selama sepekan terakhir, yang merupakan batas atas rentang tampilan, bukan median yang terukur.

• Tidak ada tanggal penghentian penggunaan. Model dengan tanggal penonaktifan dapat dijadwalkan keluar dari peta jalan. Model yang tidak memiliki tanggal GA maupun tanggal penonaktifan sama sekali tidak dapat dijadwalkan, ke arah mana pun — Anda tidak tahu kapan model itu akan aman untuk diandalkan, dan Anda tidak tahu kapan model itu akan berhenti berfungsi.

• Tidak ada posisi dalam roadmap. Google telah merilis model Flash yang lebih baru dalam keluarga yang sama yang sekarang mengungguli Gemini 3.1 Pro pada komposit independen, termasuk Gemini 3.8 Flash pada 2 September 2026. Generasi 3.5 Pro ditunda dan dilaporkan dikesampingkan. Tidak ada Gemini 3.8 Pro. Model yang menyandang nama Pro bukan lagi pencetak skor teratas dari vendornya, dan masih berstatus pratinjau.

Itulah cara pandang yang jujur bagi siapa pun yang memilih di antara keduanya. GPT-6 Sol baru berusia enam hari dan memiliki harga tetap, dipublikasikan, serta permanen. Gemini 3.1 Pro Preview sudah berusia tujuh bulan dan hanya punya baris status, bukan peta jalan.

Apa yang ditunjukkan catatan independen, dan mengapa label versi adalah seluruh argumennya

Artificial Analysis menerbitkan halaman perbandingan langsung untuk pasangan persis ini pada indeks terkini, yang menjadikannya salah satu dari sedikit perbandingan di kumpulan ini yang angka netralnya benar-benar setara. GPT-6 Sol pada upaya maksimum mencetak 48 dengan biaya $1,06 per tugas indeks. Gemini 3.1 Pro Preview mencetak 30 dengan biaya $0,67 per tugas indeks.

Delapan belas poin adalah selisih yang besar, dan itu bukan selisih yang dimiliki model tersebut pada Februari. Saat peluncurannya, Artificial Analysis menempatkan Gemini 3.1 Pro Preview di peringkat pertama pada Intelligence Index miliknya dengan skor 57. Model itu tidak berubah sejak saat itu. Indeksnya yang berubah — indeks tersebut dinilai ulang pada 19 September 2026, dan model yang sama tanpa perubahan kini tercatat 30. Kedua angka itu berasal dari Artificial Analysis; tidak ada yang salah; menempatkan keduanya berdampingan tanpa versinya adalah kesalahan paling umum dalam liputan tentang model ini, dan itulah sebabnya begitu banyak halaman perbandingan menggambarkan pemimpin Februari sebagai setara September.

Biaya per tugas menuturkan cerita kedua yang layak dihitung. Gemini lebih murah per tugas — $0,67 dibandingkan $1,06 — tetapi skornya lebih rendah. Biaya per poin indeks menjadi $0,022 untuk GPT-6 Sol dan $0,022 untuk Gemini. Berdasarkan ukuran itu, keduanya seri, yang merupakan cara paling gamblang untuk mengatakan apa yang sebenarnya terjadi di sini: Gemini bukan cara yang lebih murah untuk membeli kecerdasan yang sama, melainkan cara yang lebih murah untuk membeli lebih sedikit darinya.

Dua angka independen lainnya berada di samping angka-angka itu, keduanya berlabel. Pada OSWorld-Verified, tolok ukur penggunaan komputer, halaman evaluasi Google sendiri melaporkan 76,2% untuk Gemini 3.1 Pro. Angka itu muncul di materi Google dan dalam ringkasan pihak ketiga tentang materi tersebut, dan tidak muncul di papan OSWorld yang diverifikasi secara independen, yang mencantumkan model Gemini lain — 3.6 Flash pada 83%, 3.5 Flash pada 78,4% — dan sama sekali tidak ada baris 3.1 Pro. Pada papan OSWorld 2.0 yang lebih sulit, model ini mencetak 30,6%. Dan pada GDPval-AA, model ini berada di sekitar 1.316 Elo, di belakang Claude Sonnet 4.6 dan Claude Opus 4.6.

Ini bukan tuduhan iktikad buruk; angka yang dilaporkan sendiri adalah hal yang normal dan kedua vendor menerbitkannya. Ini adalah pernyataan tentang apa yang sebenarnya diberikan oleh pratinjau berusia tujuh bulan: cukup waktu bagi angka yang dilaporkan vendor untuk beredar luas, dan tidak cukup replikasi independen bagi angka itu untuk diperiksa. Sebaliknya, rekam jejak netral GPT-6 Sol singkat, tidak ambigu, dan berusia enam hari.

Kesenjangan pengetahuan lima belas bulan yang tidak disebutkan siapa pun

Gemini 3.1 Pro Preview memiliki batas pengetahuan Januari 2025. Batas pengetahuan GPT-6 Sol adalah 20 April 2026 — lima belas bulan kemudian.

Kesenjangan itu tidak ada di setiap halaman perbandingan pada matchup ini, dan itu lebih penting daripada perbedaan harga output untuk kelas pekerjaan tertentu: apa pun yang melibatkan API terbaru, versi pustaka terbaru, peristiwa terkini, atau fakta organisasi terkini. Model dengan batas waktu Januari 2025 akan menjawab dengan percaya diri tentang dunia yang telah bergerak maju selama satu tahun tiga bulan, dan mode kegagalannya bukanlah pesan kesalahan — melainkan jawaban salah yang masuk akal. Untuk pekerjaan dengan augmentasi retrieval, batas waktu hampir tidak relevan karena konteksnya membawa fakta. Untuk apa pun yang mengandalkan pengetahuan parametrik, itu adalah batasan pertama yang harus diperiksa dan yang terakhir diperiksa oleh siapa pun.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens.

Kesenjangan modalitas adalah argumen terkuat untuk Gemini, dan itu nyata

Akan mudah untuk menulis perbandingan ini sebagai kemenangan telak bagi model yang lebih baru. Namun tidak demikian, dan alasannya adalah baris masukan.

Gemini 3.1 Pro Preview menerima input teks, gambar, audio, video, dan file secara native pada endpoint yang sama. GPT-6 Sol menerima teks dan gambar. Untuk beban kerja yang dibangun seputar pemahaman video, transkripsi rapat, atau pemrosesan dokumen yang mencakup berbagai format, itu bukanlah perbedaan fitur — melainkan perbedaan antara satu panggilan API dan pipeline tiga tahap, dengan langkah-langkah perantara ditagih secara terpisah dan mode kegagalan yang berlipat ganda.

Peringatan jujur yang melekat pada hal itu: model pratinjau dengan tingkat kesalahan 77.6% yang ditampilkan di halaman model yang dihosting adalah model pratinjau yang keunggulan multimodalnya harus ditimbang dengan apakah ia akan menjawab. Angka itu seperti yang ditampilkan di halaman tersebut dan cukup tinggi untuk memerlukan verifikasi sebelum ada yang membangun di atasnya — yang justru menjadi intinya. Setelah tujuh bulan, saran jujur tentang model ini masih "ukur sendiri," dan itu adalah kalimat yang tidak akan ditulis siapa pun tentang rilis GA.

Di mana lapisan routing mengubah aritmetika

Gemini 3.1 Pro Preview ada di katalog OrcaRouter dengan harga input $2,00, output $12,00, dan pembacaan cache $0,20 per juta token, dengan jendela konteks 1.000.000 token, batas output 65.000 token, endpoint /v1/chat/completions dan /v1beta/models/{model}:generateContent, serta waktu ke token pertama p50 sebesar 10,00 detik sebagaimana diukur di halaman model kami sendiri selama sepekan terakhir. Harga daftar penyedia diteruskan tanpa markup tambahan.

GPT-6 Sol bukan salah satu rute kami, jadi tidak ada apa pun di sini yang merupakan klaim tentang harganya melalui kami.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), captured 23 September 2026, showing Vision, Audio, Tools, JSON and Reasoning header badges, 'by Google — 2026-02-19', a 65K-token maximum output, an input price of $2.00 and an output price of $12.00 per million tokens, a p50 time to first token of 10.00 seconds, and both the /v1/chat/completions and /v1beta/models/{model}:generateContent endpoints.

Model pratinjau adalah contoh klasik untuk routing alih-alih berkomitmen. Baik alasan untuk mencoba Gemini 3.1 Pro Preview maupun alasan untuk tidak membangun jalur produksi di atasnya adalah sifat yang sama — dapat berubah tanpa pemberitahuan — dan satu endpoint dengan failover otomatis adalah cara Anda mengambil yang pertama tanpa menerima yang kedua. Bentuk permintaan tidak berubah ketika model di belakangnya berubah, sehingga jalur fallback adalah entri konfigurasi alih-alih migrasi. Itu lebih penting di sini daripada di sebagian besar perbandingan, karena model yang paling mungkin menggantikan yang ini dalam rantai fallback adalah Flash yang lebih baru dari vendor yang sama, pada kunci yang sama, dengan sebagian kecil dari tarif output.

Aturan keputusan

• Input video, audio, atau format campuran dalam satu panggilan — Gemini 3.1 Pro Preview. Tidak ada apa pun di kolom GPT-6 Sol yang menerima file video, dan tidak ada selisih harga yang mengimbangi pipeline ingestion yang harus Anda bangun.

• Apa pun yang disertai komitmen ketersediaan — GPT-6 Sol. Berumur enam hari, tersedia secara umum, harga yang dipublikasikan digambarkan sebagai permanen, dan dial upaya yang didokumentasikan. Seperti itulah wujud "dapat dijadwalkan".

• Generasi panjang — GPT-6 Sol, pada plafon outputnya, bukan pada tarifnya. 128.000 token dibandingkan 65.000 adalah kendala yang lebih dulu terasa pada pekerjaan sintesis, dan itu terasa sebelum perbedaan harga output sebesar 20%.

• Mengevaluasi Gemini 3.1 Pro Preview — lakukan di balik jalur failover, dan ukur sendiri tingkat kesalahannya sebelum Anda menentukan skala beban kerja. Tujuh bulan pratinjau dengan tingkat kesalahan 77,6% yang ditampilkan di halaman yang dihosting bukanlah instrumen yang sudah mapan.

• Jika rencana Anda bergantung pada model ini menjadi murah kuartal depan — bukan keduanya. Pratinjau Gemini dapat diubah harganya atau dihentikan tanpa pemberitahuan, dan harga GPT-6 Sol bersifat permanen hanya dalam arti bahwa OpenAI telah mengatakan demikian minggu ini. Tarif tetap adalah komitmen, bukan jaminan; itu sekadar komitmen yang lebih kuat daripada yang dibuat oleh kartu pratinjau.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari