
Apa Itu Gemini 3.1 Pro? Tier Pro Google Belum Berubah dalam Tujuh Bulan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Gemini 3.1 Pro adalah satu-satunya model tingkat Pro yang masih aktif di keluarganya sendiri. Model ini diumumkan pada 19 Februari 2026, dan tujuh bulan kemudian dokumentasi model milik vendor itu sendiri masih menggolongkannya ke dalam “Preview” di endpoint gemini-3.1-pro-preview — belum tersedia secara umum, tidak ada tanggal penghentian, tidak ada penerus yang dirilis. Dalam tujuh bulan yang sama, vendor melepas lima rilis Flash, dan yang terbaru di antaranya, Gemini 3.8 Flash, kini mencetak skor sebelas poin lebih tinggi pada indeks independen yang paling banyak dikutip orang. Kesenjangan itulah alasannya halaman yang menjelaskan apa itu Gemini 3.1 Pro harus dibuka dengan apa yang bukan dirinya.
Jika Anda hanya menginginkan versi dua kalimat: Gemini 3.1 Pro adalah model penalaran multimodal secara native dengan bobot tertutup buatan Google DeepMind, yang membaca teks, gambar, video, audio, dan PDF serta menulis teks. Anda memanggilnya melalui API milik Google sendiri atau melalui router yang membawanya; ia menerima hingga 1.048.576 token masukan, dan biayanya $2,00 per juta token masukan serta $12,00 per juta token keluaran untuk prompt di bawah 200.000 token. Ia tetap andal sebagai pekerja keras multimodal konteks panjang. Ia bukan lagi model yang Anda pilih karena merupakan yang paling pintar yang tersedia.
Di mana posisinya dalam keluarga produknya sendiri
Ini adalah bagian yang paling sering dilewatkan oleh sebagian besar tulisan, dan inilah bagian yang paling penting. Keluarga Gemini 3 bukanlah satu tangga dengan Pro di puncaknya. Ini adalah dua tangga yang tidak lagi bisa dibandingkan.
Jenjang Flash-lah yang bergerak. Dokumentasi model Google, yang dibaca pada 23 September 2026, mencantumkan Gemini 3.8 Flash, Gemini 3.8 Live, dan Gemini 3.8 Live Extended Thinking sebagai rilis stabil baru, dengan Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash, dan Gemini 3.5 Flash-Lite yang masih stabil di belakangnya. Gemini 3.8 Flash hadir pada 2 September 2026 — rilis Flash ketiga dalam enam minggu.
Lini Pro adalah yang tidak. Tidak ada Gemini 3.5 Pro, 3.6 Pro, 3.7 Pro, atau 3.8 Pro dalam dokumentasi Google. Gemini 3 Pro, model yang seharusnya digantikan oleh Gemini 3.1 Pro, tercatat sudah dimatikan. Gemini 2.5 Pro masih bertahan, tetapi aksesnya dibatasi hanya untuk pengguna sebelumnya. Artinya, Gemini 3.1 Pro menjadi satu-satunya endpoint Gemini 3 tingkat Pro yang dapat Anda panggil hari ini — bukan karena ia memenangi perlombaan, melainkan karena tidak ada orang lain yang ikut serta.
Rencana yang dinyatakan Google pada Februari adalah bahwa pratinjau tersebut akan berlangsung cukup lama untuk “memvalidasi pembaruan-pembaruan ini” dan memajukan bidang-bidang seperti alur kerja agentik yang ambisius sebelum model tersebut “segera tersedia secara umum.” Itu adalah kata-kata Google dalam pengumuman Februari. Tujuh bulan kemudian, hal itu tidak terjadi, dan pemberitaan seputar penundaan ini layak dinyatakan secara gamblang sebagai pemberitaan, bukan fakta: SemiAnalysis menyimpulkan bahwa upaya Gemini 3.5 Pro telah dibatalkan secara diam-diam, dan Wall Street Journal, sebagaimana dikutip oleh media sekunder, melaporkan bahwa kandidat internal 3.5 Pro dihentikan karena tidak dapat melampaui seri Flash. Pernyataan resmi Google sendiri adalah bahwa 3.5 Pro masih dalam pengujian terbatas bersama mitra tanpa bulan yang dikonfirmasi. Kami tidak dapat menemukan pernyataan Google yang mengonfirmasi atau membantah pembatalan tersebut, dan kami tidak akan memihak salah satu sisi untuk mereka.
Konsekuensi praktisnya adalah jebakan penamaan. Jika Anda mencari “Gemini Pro terbaru,” model tingkat Pro paling baru yang akan Anda temukan berasal dari Februari, sementara nomor versi di sisi Flash telah naik ke 3.8. Nomor versi di sini tidak memberi peringkat kemampuan lintas tingkat; keduanya adalah dua jalur rilis yang terpisah.
Spesifikasi yang penting
Setiap angka di bawah ini diambil dari dokumentasi API Gemini milik Google sendiri pada 23 September 2026, kecuali jika dinyatakan lain.
• Konteks input — 1.048.576 token, jendela satu juta token yang sama yang telah dirilis Google sejak generasi 2.5. Output dibatasi secara terpisah pada 65.536 token, yang merupakan batas maksimum untuk jawaban, bukan untuk percakapan.
• Modalitas masukan — teks, gambar, video, audio, dan PDF. Modalitas keluaran — hanya teks. Tidak ada pembuatan audio, tidak ada pembuatan gambar, tidak ada Live API, jadi ini bukan model untuk agen suara real-time atau pipeline gambar. Google menyediakan varian Gemini 3.x Flash terpisah untuk tugas-tugas tersebut.
• Penalaran — didukung, dengan kontrol tingkat pemikiran. Token pemikiran ditagih dengan tarif output, itulah sebabnya harga output adalah angka yang mendominasi tagihan Anda.
• Perkakas — caching, eksekusi kode, pemanggilan fungsi, grounding Penelusuran, grounding Maps, output terstruktur, konteks URL, Batch API, inferensi flex, dan inferensi prioritas semuanya tercantum sebagai didukung. Penelusuran file hanya tercantum sebagai didukung di AI Studio.
• Lisensi dan bobot — proprietary. Tidak ada bobot terbuka, tidak ada checkpoint yang dapat diunduh, dan tidak ada jalur self-hosting. Setiap rute menuju model ini adalah API yang dihosting.
• Endpoint — gemini-3.1-pro-preview adalah kode model. Google juga mencantumkan gemini-3.1-pro-preview-customtools varian. Endpoint pratinjau dapat direvisi di bawah Anda tanpa kenaikan versi, yang merupakan alasan standar untuk menyematkan ID model yang tepat di produksi alih-alih alias.
• Tanggal pembaruan terdokumentasi — halaman model mencantumkan “Pembaruan terakhir: Februari 2026.” Kami tidak dapat menemukan tanggal batas pengetahuan yang dinyatakan di halaman model Google sendiri; daftar pihak ketiga menyebutkan Januari 2025, dan kami menandainya sebagai belum dikonfirmasi alih-alih mengulanginya sebagai fakta.
Berapa biayanya
Gemini 3.1 Pro memiliki tebing harga, dan itu adalah jenis detail yang mengubah estimasi yang tampak murah menjadi tagihan yang berlipat dua. Harga developer yang dipublikasikan Google dibedakan berdasarkan ukuran prompt, bukan berdasarkan versi model.
• Tier standar, prompt hingga 200.000 token — $2,00 per juta token input, $12,00 per juta token output, dengan token berpikir dihitung sebagai output.
• Tier Standar, prompt di atas 200.000 token — $4,00 input dan $18,00 output. Kedua tarif berlipat ganda pada ambang yang sama. Inilah jebakannya: beban kerja konteks panjang membayar dua kali tarif utama justru karena menggunakan fitur yang membuat model itu dibeli.
• Cache konteks — $0,20 atau $0,40 per juta token yang di-cache, bergantung pada sisi mana dari ambang 200.000 Anda berada, ditambah penyimpanan cache yang ditagih $4,50 per juta token per jam.
• Tingkat batch dan flex — $1,00 untuk input dan $6,00 untuk output di bawah 200.000 token, $2,00 dan $9,00 di atasnya. Sekitar setengah harga untuk pekerjaan yang bisa menunggu.
• Tingkat Prioritas — $3.60 input dan $21.60 output di bawah ambang batas, $7.20 dan $32.40 di atasnya.
• Tingkat gratis — tidak tersedia untuk model ini. Tidak ada batas laju gratis yang dapat digunakan untuk pembuatan prototipe.
Ada dua hal yang perlu diketahui tentang seberapa andal angka-angka itu. Halaman harga Google sendiri adalah acuan di sini dan kami membacanya langsung, jadi angka-angka di atas berlaku per 23 September 2026. Namun, daftar pihak ketiga untuk model ini benar-benar tidak konsisten — satu pelacak mencantumkan tarif $2,50 / $15,00, pelacak lain tarif campuran $4,50 — dan penjenjangan itulah penyebabnya. Jika sebuah halaman memberi Anda satu angka untuk Gemini 3.1 Pro tanpa memberi tahu rentang ukuran prompt mana yang berlaku, angka itu tidak dapat dipakai untuk estimasi yang sesungguhnya.
Apa yang secara terukur dikuasainya dengan baik, dan apa yang secara terukur tidak
Mulailah dengan apa yang diklaim Google, lalu pisahkan dari apa yang diukur oleh evaluator independen, karena keduanya telah menyimpang tajam sejak Februari.
Pengumuman Google sendiri memuat tepat satu angka tolok ukur: “skor terverifikasi 77,1%” pada ARC-AGI-2, yang menurut Google lebih dari dua kali performa penalaran Gemini 3 Pro. Itu angka dari vendor, dibaca dari postingan Google sendiri, dan itu satu-satunya yang bisa kami konfirmasi di sana. Liputan peluncuran menyebarkan kumpulan yang jauh lebih besar — GPQA Diamond, SWE-bench Verified, Terminal-Bench 2.0, LiveCodeBench, Humanity’s Last Exam — tetapi angka-angka itu tidak muncul dalam pengumuman Google sendiri, dan laporan sekunder saling bertentangan satu sama lain tentang angka yang kami periksa (GPQA Diamond muncul sebagai 94,1 dan 94,3 tergantung sumber yang Anda baca). Kami tidak mencetaknya sebagai hasil yang sudah mapan.
Gambaran independennya adalah titik ketika cerita berbalik. Pada Indeks Kecerdasan Artificial Analysis versi yang berlaku pada 23 September 2026, Gemini 3.1 Pro Preview mencetak skor 30 dan berada di peringkat ke-81 dari 212 model di kelas tersebut. Model median di kelas itu mencetak skor 25, jadi ia berada di atas rata-rata — dan pemimpin pada grafik yang sama, Claude Opus 5 pada pengaturan penalaran maksimumnya, mencetak skor 58. Indeks itu sendiri adalah penggaris yang berversi, bukan penggaris tetap: Artificial Analysis merevisinya setelah peluncuran Februari, dan catatan revisinya sendiri mencatat evaluasi-evaluasi baru yang bergabung ke dalam komposit. Gemini 3.1 Pro dilaporkan sebagai pemimpin mutlak pada indeks sebagaimana posisinya saat peluncuran Februari, dengan 57 poin. Itu bukan penggaris yang sama dengan angka 30, dan kami tidak akan menempatkan kedua angka itu berdampingan seolah-olah keduanya melacak penurunan.
Yang memang ditunjukkan oleh pemetaan saat ini adalah profil yang autentik, dan itu adalah profil yang berat sebelah:
• Kecerdasan — 30 pada indeks, peringkat 81 dari 212. Di atas median, jauh dari garis depan.
• Kecepatan — 116,5 token output per detik, peringkat 38 dari 212. Sangat cepat untuk model penalaran.
• Biaya — $0,67 untuk menjalankan satu tugas Intelligence Index, peringkat 31 dari 212. Itu murah per unit pekerjaan, karena model ini hemat dalam penggunaan token pemikiran.
• Verbositas — 67 juta token keluaran untuk menyelesaikan indeks, dibandingkan median kelas sebesar 88 juta. Peringkat 39 dari 212; Artificial Analysis menyebutnya “cukup ringkas.” Sebagai perbandingan, Gemini 3.8 Flash pada penalaran tinggi mengonsumsi 170 juta token pada suite yang sama dan berbiaya $1,24 per tugas — lebih mahal daripada Gemini 3.1 Pro, meskipun harga per tokennya lebih murah.
Jadi pembacaan yang jujur bukanlah "model lama dikalahkan di mana-mana." Gemini 3.1 Pro cepat dan hemat token, dan berdasarkan biaya per tugas, ia mengalahkan saudara barunya sendiri. Yang hilang darinya adalah kemampuan kelas atas, dan pada beban kerja apa pun yang kualitasnya menjadi kendala pengikat, itulah satu-satunya poros yang diperhitungkan.

Pertanyaan ketersediaan September
Ada satu perkembangan terkini seputar model ini, dan itu berupa pertanyaan, bukan peluncuran. Sejak 18 September 2026, pengguna di forum pengembang AI Studio milik Google sendiri telah melaporkan bahwa Gemini 3.1 Pro hilang dari pemilih model AI Studio — judul thread tersebut menyebutkan tanggal perubahan itu sebagai 2026-09-18 — dengan pengguna berbayar mengatakan bahwa mereka dipindahkan ke Gemini 3.8 Flash dan, dari sana, ke 3.7 dan 3.6 Flash. Tidak ada karyawan Google yang membalas di thread yang kami baca, tidak ada pemberitahuan penghentian, dan tidak ada penyebab yang dinyatakan. Model tersebut masih terdaftar dan masih dapat dipanggil melalui Gemini API serta melalui katalog kami sendiri saat kami memeriksanya pada 23 September 2026.
Kami menandai ini sebagai laporan pengguna yang belum terselesaikan di forum Google sendiri, bukan sebagai penghentian dan bukan sebagai gangguan. Tetapi jika jalur produksi Anda secara khusus bergantung pada model ini, itu adalah alasan untuk mengonfigurasi fallback daripada mengasumsikan bahwa endpoint pratinjau adalah sesuatu yang permanen.
Siapa yang sebaiknya memilihnya, dan siapa yang sebaiknya tidak
Pilih Gemini 3.1 Pro jika masalah Anda panjang dan multimodal. Jendela satu juta token dengan input video, audio, dan PDF native masih menjadi alasan untuk berada di sini, dan tidak ada hal tentang usia model yang mengubah itu. Secara konkret: analisis seluruh repositori, mengaudit jam-jam rekaman rapat atau rekaman video, mengekstraksi data terstruktur dari kumpulan dokumen media campuran, atau pipeline apa pun di mana satu prompt secara sah melewati 200.000 token dan alternatifnya adalah lapisan retrieval yang harus Anda bangun dan evaluasi. Efisiensi tokennya adalah argumen kedua yang nyata — model ini menyelesaikan rangkaian tugas dalam 67M token output sedangkan Gemini 3.8 Flash menghabiskan 170M, sehingga tagihan per tugas bisa lebih rendah meskipun tarif per tokennya tampak lebih tinggi.
Pilih yang lain dalam tiga kasus. Jika Anda menginginkan jawaban terbaik Google saat ini untuk pertanyaan penalaran sulit atau coding berhorizon panjang, Gemini 3.8 Flash mengungguli Gemini 3.1 Pro pada indeks independen saat ini, tersedia secara umum alih-alih pratinjau, berbiaya $0,75 per juta token masukan dan $3,75 per juta token keluaran hingga 31 Desember 2026, dan memiliki tier gratis yang tidak dimiliki Gemini 3.1 Pro. Ia menghabiskan lebih banyak token berpikir untuk mencapainya — itulah komprominya, dan itu kompromi yang nyata. Jika Anda membutuhkan yang terdepan mutlak, itu bukan model Google saat ini: pada grafik indeks yang sama, Claude Opus 5 pada penalaran maksimum memimpin dengan 58 melawan 30 milik Gemini 3.1 Pro. Dan jika beban kerja Anda sensitif terhadap latensi atau biaya dan dangkal — klasifikasi, ekstraksi, perutean, peringkasan singkat — tier Flash-Lite atau model open-weights kecil akan melakukan pekerjaan itu dengan sebagian kecil dari $2,00 per juta token masukan, dan membayar tarif Pro untuk itu hanyalah pemborosan.
Yang tidak akan kami lakukan adalah memilih Gemini 3.1 Pro karena ini adalah Pro terbaru dari Google. Ini bukan produk baru, dan per bulan ini Google belum memiliki penerus yang sudah dirilis untuknya.
Menyebutnya tanpa mempertaruhkan seluruh stack Anda pada endpoint pratinjau.
Bagian yang janggal dari pratinjau tujuh bulan adalah bahwa pratinjau itu cukup baik untuk dijadikan dasar pengembangan, tetapi tidak cukup stabil untuk dianggap pasti. Ada dua mitigasi yang layak disebutkan.
Sematkan kode model yang tepat, bukan alias. Endpoint pratinjau dapat direvisi di tempat, jadi gemini-3.1-pro-preview dalam file konfigurasi lebih aman daripada referensi “Pro terbaru” yang mengambang, dan itu membuat perubahan senyap terlihat dalam diff.
Biarkan routing berada di atas model. Di OrcaRouter, Gemini 3.1 Pro adalah google/gemini-3.1-pro-preview, dilayani dari kunci yang sama dan endpoint yang sama seperti setiap model lain yang kami sediakan, termasuk format native /v1beta/models/{model}:generateContent untuk kode yang ditulis terhadap Gemini SDK dan yang kompatibel dengan OpenAI /v1/chat/completions untuk semua hal lainnya. Karena penetapan harganya diteruskan apa adanya dengan markup 0%, $2.00 / $12.00 pada daftar harga Google adalah angka yang Anda bayarkan di sini, dan perubahan harga vendor berlaku langsung pada hari yang sama, bukan pada siklus penagihan berikutnya. Alasan hal itu penting khususnya untuk model preview adalah failover: rantai fallback yang dikonfigurasi berarti saat Gemini 3.1 Pro tidak tersedia, percobaan ulang Anda diarahkan ke model berikutnya dalam rantai sebelum respons dimulai, bukan setelah pengguna Anda menyadarinya. Itulah perbedaan antara preview yang bisa Anda rilis dan preview yang hanya bisa Anda demo.
Entri katalog kami sendiri untuk model ini memuat spesifikasi sebagaimana kami menyajikannya — konteks satu juta token, output maksimum 65.536 token, input audio/berkas/gambar/teks/video, output teks, dan median waktu-ke-token-pertama sebesar 10,00 detik selama tujuh hari terakhir, yang perlu diketahui sebelum Anda menganggap ini model latensi obrolan. Bukan.

Apa yang masih buka?
Tiga hal yang tidak dapat kami tutup, dan lebih baik kami nyatakan daripada kami tutup-tutupi. Google belum mengatakan apakah Gemini 3.1 Pro akan pernah mencapai ketersediaan umum, dan tidak ada tanggal penghentian yang dipublikasikan untuk kedua kemungkinan itu. Laporan AI Studio masih belum dijelaskan setelah lima hari, tanpa respons vendor yang dapat kami temukan. Dan pertanyaan tentang penerus hanya bisa dijawab secara negatif: halaman Pro Google telah mengiklankan perilisan Pro yang akan datang selama berbulan-bulan, laporan menyebutkan kandidat internal dibatalkan karena gagal mengalahkan lini Flash, dan per 23 September 2026 belum ada yang dirilis. Jika Gemini 3.5 Pro atau Gemini 4 Pro hadir, posisi Gemini 3.1 Pro dalam keluarga ini berubah untuk pertama kalinya sejak Februari — dan itu, bukan peluncuran awalnya, adalah peristiwa yang layak diperhatikan.

Gemini 3.1 Pro tersedia di OrcaRouter dengan harga daftar Google, di balik kunci yang sama seperti semua yang kami sediakan. Lihat halaman model Gemini 3.1 Pro untuk harga langsung, batas konteks, dan rantai fallback yang dapat Anda konfigurasi sebelum revisi pratinjau berikutnya hadir.
Dibandingkan dalam artikel ini3
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
