
Gemini 4 Argon: Apa yang Diumumkan Google, dan Apa yang Melekat pada Nama Itu
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Gemini 4 Argon adalah satu-satunya Gemini 4 yang ada. Kalimat itu terdengar sepele sampai Anda menghitung biayanya, dan menghitung biaya itulah tujuan halaman ini. Google mengumumkan Gemini 4 Argon pada 2026-09-30, dalam sebuah pos DeepMind yang dikreditkan kepada Koray Kavukcuoglu; ini adalah nama model nyata di halaman first-party yang nyata, telah diukur oleh Artificial Analysis pada Intelligence Index 52,56 pada revisi v4.3.2, dan berada dalam selisih setengah poin dari GPT-6 Astra pada 52,67 dan Claude Fable 5.1 pada 53,35 — sekaligus berada lima poin di bawah Claude Opus 5.5 pada 57,62 dan Claude Sonnet 5.5 pada 56,00, serta dalam selisih satu poin dari GPT-6.1 Sol pada 51,83. Yang tidak dimilikinya adalah hal yang dimiliki setiap pesaing tersebut: pengenal model yang bisa Anda masukkan ke dalam permintaan.
Jadi, jawaban jujur satu baris untuk “apa itu Gemini 4 Argon” adalah bahwa itu adalah model yang telah diumumkan dan di-benchmark oleh Google tetapi belum dapat dipanggil, bahwa nama itu melekat pada peluncuran terbatas alih-alih pada sebuah produk, dan bahwa “Gemini 4” sendiri sama sekali tidak melekat pada apa pun. Kedua bagian kalimat itu dapat diperiksa dari terminal, itulah sebabnya halaman ini memeriksanya alih-alih menyatakannya.
Namanya asli. Produknya tidak.
Mulailah dari apa yang sebenarnya dikembalikan oleh pemeriksaan entitas. Per 8 Oktober 2026, halaman keluarga Google di deepmind.google/models/gemini/ menampilkan Gemini 4 Argon sebagai kartu utamanya, di bawah tagline “Era berikutnya dari kecerdasan frontier kami”, dengan materi kemampuan yang menyebutkan rekayasa perangkat lunak, pekerjaan pengetahuan perusahaan di bidang hukum dan keuangan, serta keamanan siber defensif. Postingan pengumuman tersebut ada di blog.google/innovation-and-ai/models-and-research/gemini-models/ yang merupakan jalur. Ada halaman keluarga model. Ada tabel benchmark vendor dengan sembilan belas baris. Ada PDF metodologi evaluasi setebal lima halaman. Itu adalah jejak dokumen yang substansial, dan itu lebih dari yang didapat sebuah kebocoran.
Sekarang daftarkan apa yang hilang darinya, karena daftar yang hilang itulah artikelnya.
• Sebuah ID model — daftar model API Gemini tidak mengandung satu pun kemunculan “argon” dan tidak mengandung satu pun kemunculan “gemini-4”. Pengenal terbaru yang dikenali dokumentasi Google adalah keluarga 3.8.
• Endpoint atau harga yang dapat menjadi dasar penagihan Anda — tarif $2 input / $10 output per juta token dalam pengumuman tersebut adalah tarif perkenalan untuk peluncuran yang belum menjangkau pelanggan berbayar.
• Sebuah kartu model atau kartu sistem — indeks kartu model DeepMind tidak memiliki baris Argon, dan jalur kartu model keluarga tersebut mengembalikan 404.
• Sebuah jendela konteks — Google menerbitkan batas keluaran 1 juta token, naik dari batas sebelumnya 64K, dan tidak menerbitkan sisi masukan dari pasangan tersebut. Artificial Analysis mencatat 1M untuk model yang diukurnya.
• Tanggal ketersediaan umum — pengumuman tersebut menjelaskan peluncuran bertahap tanpa tanggal pada tahap mana pun setelah tahap pertama.
• Jumlah parameter, yang belum dipublikasikan Google untuk Gemini mana pun.
Peluncuran yang dijelaskan Google berjalan dalam tiga tahap dengan durasi yang tidak disebutkan. Pertama, kohort siber yang disebutkan namanya melalui Fairwind Program. Kedua, pelanggan API berbayar dan pelanggan berlangganan Google AI Ultra. Ketiga, pengembang, perusahaan, dan konsumen. Hanya tahap pertama yang aktif dalam pengertian apa pun yang dapat diverifikasi pembaca, dan Google tidak mencantumkan tanggal untuk tahap dua dan tiga. Itu bukan catatan kaki. Itu adalah perbedaan antara model dan hitung mundur.

Apa yang diklaim oleh tabel Google sendiri, dan siapa yang sebenarnya mengukurnya
Halaman keluarga Google memuat tabel tolok ukur empat kolom dengan Gemini 4 Argon, GPT-6 Astra, Claude Fable 5.1, dan Claude Opus 5.5. Tabel itu layak dibaca, dan layak dibaca dengan asal-usulnya tetap diperhatikan, karena Google mengungkapkan asal-usul tersebut dalam PDF metodologi, dan pengungkapan itu mengubah seberapa banyak yang bisa ditanggung tabel tersebut.
Klaim-klaim, yang dilabeli sebagai milik Google: Argon unggul pada Vals Index dengan 68,9 dibandingkan dengan 67,0 milik Opus 5.5 dan 65,8 milik Fable 5.1; pada AutomationBench dengan 51,3 dibandingkan 42,5, 31,4, dan 41,4; pada Vals Finance Agent v2 dengan 65,4; pada Harvey’s Legal Agent Benchmark dengan 19,6 dibandingkan 3,8, 6,7, dan 5,4 — selisih empat hingga lima kali lipat; pada DeepSWE v1.1 dengan 77,9 dibandingkan 74,2, 67,4, dan 74,1; pada Vibe Code Bench dengan 91,9, selisih 1,6 poin; pada LABBench 2 dengan 88,8 dibandingkan 73,1, 68,6, dan 85,4; pada RiemannBench dengan 76,0; pada kedua baris GraphWalks, 99,7 pada ≤128k dan 84,2 pada 256k–1M; pada Agent’s Last Exam dengan 39,5; pada Terminal-Bench Science 0.1 dengan 57,6; pada Chartography dengan 71,6; dan pada LVBench dengan 91,7 sebagai yang tercanggih saat ini.
Dan ia kalah, di halaman Google sendiri: FrontierSWE v2 pada 55,0 melawan 65,5 milik Astra dan 62,3 milik Opus 5.5; Terminal-bench 4.0 pada 57,4 melawan 66,4 milik Opus 5.5; PostTrainBench pada 45,3 melawan 49,3 milik Opus 5.5; dan OSWorld-2.0 pada 69,2 melawan 72,6 milik Astra. CWE-bench v1 seri pada 68,0 dengan Astra.
Baris asal-usul lebih penting daripada baris mana pun. Metodologi Google menyatakan bahwa hasilnya adalah pass@1, sekali percobaan, pada pengaturan thinking tertinggi, dan — yang krusial — bahwa angka non-Gemini dalam tabel itu adalah angka yang dilaporkan sendiri oleh para penyedia, dengan GPT-6 Astra, Claude Fable 5.1, dan Claude Opus 5.5 diambil pada thinking maksimum bila tersedia. Tabel vendor yang kolom pesaingnya berisi siaran pers para pesaing adalah dokumen yang berguna, tetapi itu bukan perbandingan yang terkendali. Setiap barisnya dilaporkan oleh Google, dan sebagian di antaranya adalah Google melaporkan apa yang dilaporkan pihak lain. Perlakukan margin, bukan sekadar nilainya, dengan sewajarnya.
Satu model, tiga angka indeks, dan mengapa semuanya benar
Posisi independen Argon lebih menarik daripada satu angka tunggal, karena angka itu bergerak bergantung pada dari mana Anda membacanya, dan pergerakan itu bukanlah sebuah kesalahan.
Artificial Analysis mengukur Gemini 4 Argon (High) pada 52,56 dalam revisi v4.3.2 Indeks Kecerdasannya. Indeks yang sama menempatkan Claude Opus 5.5 pada 57,62, Claude Sonnet 5.5 pada 56,00, Claude Fable 5.1 pada 53,35, GPT-6 Astra pada 52,67, GPT-6.1 Sol pada 51,83, dan Gemini 3.8 Flash pada 40,93. Dalam urutan yang ditampilkan papan peringkat, sekitar sepuluh model teratas terkompresi ke dalam kira-kira enam poin indeks, dan Argon berada dalam kerumunan itu, bukan di bawahnya.
Kemudian seorang pembaca melihat angka kedua — 53 — dalam tampilan pembulatan papan peringkat, dan angka ketiga jika mereka membandingkannya dengan konfigurasi berbeda dari model serumpun, lalu menyimpulkan salah satu sumbernya salah. Tidak ada yang salah. Angka 53 yang dibulatkan adalah pengukuran yang sama dengan 52.56. Yang berbeda antar konfigurasi adalah upaya berpikir: Artificial Analysis mengukur setiap model pada beberapa tingkat upaya, dan model yang sama pada tingkat upaya yang lebih tinggi bisa terpaut beberapa poin. Itulah sebabnya papan peringkat mencantumkan Opus 5.5 empat kali terpisah, pada 58, 56, 54, dan 51. Argon tercantum sekali, pada upaya tinggi, karena itulah satu-satunya konfigurasi yang disediakan Google untuk diukur. Jika Google merilis tingkat Argon pada upaya berpikir maksimum, baris itu akan bergerak, dan hal yang jujur untuk dikatakan tentangnya hari ini adalah bahwa baris itu belum bergerak.
Tiga angka independen Argon lainnya layak dicatat, semuanya dari Artificial Analysis dan semuanya diukur pada konfigurasi (High). Kecepatan output adalah median 60,69 token per detik. Waktu ke token jawaban pertama adalah median 2,92 detik. Biaya per tugas Intelligence Index — skor indeks yang dinormalisasi terhadap pengeluaran token yang diperlukan untuk memperolehnya — adalah $1,99. Angka terakhir itulah yang perlu diingat, karena di situlah posisi Argon menjadi tidak nyaman: Opus 5.5 mencetak skor lima poin lebih tinggi dan biaya $5,98 per tugas Index, jadi Argon tiga kali lebih murah per unit kemampuan terukur. Namun GPT-6.1 Sol mencetak skor setengah poin lebih rendah dan biaya $0,72, yang kira-kira sepertiga dari angka Argon. Argon bukan pilihan terbaik dari segi nilai di rentang indeksnya sendiri. Argon berada di tengah-tengahnya.
Ada dua bacaan independen lagi yang tidak boleh dikacaukan satu sama lain oleh pembaca yang cermat. Artificial Analysis mencatat angka AutomationBench Argon sebagai skor parsial dari 0,7751 pada skala 0–1, sementara tabel Google melaporkan 51,3 dari 100 pada papan AutomationBench. Itu bukan metrik yang sama, dan menjejerkannya berdampingan justru merupakan jenis perbandingan yang menghasilkan angka yang dibuat-buat. Peringatan yang sama berlaku untuk pengelompokan pekerjaan pengetahuan dalam tabel vendor: “memimpin dalam pekerjaan pengetahuan” adalah ringkasan Google atas tabel Google sendiri.
Halaman “Gemini 4” mana yang sebenarnya Anda cari
Inilah kebingungan yang ditimbulkan oleh nama itu, dan ada baiknya hal ini diselesaikan di satu tempat, karena blog ini kini telah menulis tentang lima hal “Gemini 4” yang berbeda dan semuanya bukan varian dari satu artikel.
• Jika Anda ingin tanggal rilis dan linimasa peluncuran bertahap — kapan Argon diumumkan, bagaimana peluncuran bertahapnya, dan apa yang dilakukan papan arena terhadapnya — itulah tulisan tentang tanggal rilis, yakni bagian yang memegang linimasa serta bacaan Text Arena dan Code Arena.
• Jika Anda ingin “apakah Gemini 4 Argon sebuah tier atau model”, dan apakah Gemini 4 Ultra ada — artikel tentang posisi tier, yang membaca jenjang itu dari jalur Google sendiri dan menjelaskan mengapa jalur Ultra berujung ke halaman langganan.
• Jika Anda menginginkan pertanyaan penamaan itu sendiri, argumen bahwa dari “Gemini 4” dan “Gemini 4 Argon” tepat satu merupakan model dan satu merupakan awalan generasi tanpa ID model, tanpa endpoint, dan tanpa harga — itulah adu langsung antara kedua nama Google tersebut.
• Jika Anda menginginkan hasil FrontierSWE v2 peringkat ketiga beserta observasi kritis-diri yang menyertainya, itulah bagian evaluasi FrontierSWE.
• Jika Anda ingin melihat Argon melawan rival tertentu berdasarkan angka, ada tiga belas halaman perbandingan di situs yang mencakup jajaran frontier, dan itu adalah tempat yang tepat untuk ulasan dua model.
Yang tidak dimiliki oleh satu pun dari mereka, dan yang dimiliki oleh halaman ini, adalah pilar: satu-satunya tempat yang menyatakan apa entitas itu, apa arti dan tidak arti dari setiap angka yang melekat padanya, dan apa yang benar-benar dapat Anda lakukan dengannya saat ini. Halaman terkait “Gemini 4 vs Gemini 4 Argon” sudah menyampaikan argumen penamaan secara lengkap dan halaman ini tidak akan mengulanginya. Semua yang di bawah ini baru.

Tekanan yang belum memberi tahu kita apa pun
Dua dari sinyal terkuat dalam cerita Argon menunjuk pada rilis developer yang sudah dekat, dan tidak satu pun dari keduanya merupakan bukti bahwa rilis developer telah terjadi.
Yang pertama adalah bahwa permukaan API milik Google sendiri telah bergerak maju tanpa Argon. Entri terbaru dalam catatan perubahan API Gemini adalah 6 Oktober 2026 — Gemini Nano Banana 2.1 tersedia secara umum, dengan pengenal gemini-nano-banana-2.1. Dengan kata lain, dalam delapan hari sejak Argon diumumkan, Google telah memilih konvensi penamaan untuk model Gemini dalam produksi dan merilis pengenal GA untuk model yang berbeda, dan gemini-4 namespace masih kosong. Model yang peluncurannya nyata meninggalkan jejak pada catatan perubahan. Yang ini belum meninggalkan jejak.
Yang kedua adalah pembingkaian keamanan nasional. Google menyatakan bahwa pihaknya “secara aktif terlibat dalam proses sukarela pemerintah AS untuk akses model pra-rilis”, dan tahap peluncuran pertamanya adalah kohort pembela siber yang disebutkan namanya. Hal itu konsisten dengan peluncuran bertahap ketika audiens dengan kemampuan terdepan mendapatkan model tersebut sebelum API publik mendapatkannya, dan sama-sama konsisten dengan model yang sekadar belum siap untuk trafik umum. Tidak ada apa pun dalam pembingkaian itu yang memberi tahu Anda yang mana. Siapa pun yang mengatakan demikian sedang membaca daun teh, dan Google belum menetapkan tanggal pada tahap API untuk memastikannya.
Apa yang bisa Anda sebut hari ini, dan apa yang tidak bisa
Ini adalah bagian halaman yang paling cepat menjadi usang, jadi bagian ini mencantumkan tanggalnya. Per 8 Oktober 2026, API model OrcaRouter mengembalikan HTTP 404 untuk google/gemini-4-argon. Itu tidak ada di rute kami. Tidak juga google/gemini-4, maupun google/gemini-4-argon-high, maupun google/gemini-4-pro — tidak satu pun pengenal tersebut dapat diresolusikan, karena tidak satu pun dari mereka ada sebagai model yang dapat dipanggil di mana pun.
Apa saja yang ada di rute kami hari ini, dari vendor yang sama, dan berapa biaya masing-masing menurut harga daftar penyedia:
• google/gemini-3.8-flash — dirilis 2026-09-02, jendela konteks 1.048.576 token dan keluaran maksimum 65.536 token, dengan harga $0,75 untuk input dan $3,75 untuk output per juta token. Inilah model yang nantinya akan dijadikan pembanding bagi Argon oleh orang-orang yang memiliki kartu kredit, dan ini adalah hal yang paling mendekati beban kerja yang serupa dengan Argon yang dapat Anda jalankan sore ini.
• google/gemini-3.6-flash — dirilis 2026-07-21, dengan harga $0.75 dan $3.75.
• google/gemini-3.5-flash — dirilis 2026-05-23, dengan harga $1.50 dan $9.00.
• google/gemini-3.5-flash-lite — dirilis 2026-07-21, dengan harga $0.30 dan $2.50.
• google/gemini-3.1-flash-lite — dengan harga $0.25 dan $1.50.
• google/gemini-3.1-pro-preview — dirilis 2026-02-19, dengan harga $2.00 dan $12.00. Ini adalah satu-satunya Gemini slot Pro yang dapat Anda panggil, dan ia tertinggal tiga setengah generasi di belakang entri terbaru lini Flash.
Semua itu berjalan pada kunci yang sama dengan model-model terdepan Claude dan OpenAI dalam pita indeks yang sama — Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1, GPT-6 Astra dan GPT-6.1 Sol semuanya berada di rute yang sama — yang berarti hal menarik tentang posisi Argon dapat diuji tanpa Argon. Jika Anda ingin mengetahui bagaimana rasanya sekitar 52 poin indeks pekerjaan pengetahuan dengan seperlima harga, Anda dapat mengukurnya hari ini terhadap google/gemini-3.8-flash pada 40,93, dan jika Anda ingin bagian atas pita, Anda dapat mengukur Claude Opus 5.5 pada 57,62 pada hari yang sama, di akun yang sama, tanpa kontrak kedua dan tanpa perubahan kode. Itulah gambaran praktis dari keseluruhan artikel: satu API untuk 200+ model, 0% markup pada harga daftar penyedia yang diteruskan, sehingga pemotongan harga vendor sampai kepada Anda pada hari yang sama saat diterapkan, dan failover otomatis antar penyedia untuk hari ketika model yang Anda andalkan berhenti menjawab. Kami menjelaskan hal itu di sini karena itu benar untuk Gemini 3.8 Flash yang dapat Anda panggil, bukan karena itu mengatakan sesuatu tentang Argon. Argon bukan salah satu dari mereka.
Jika Anda menginginkan Argon itu sendiri, pilihan Anda hari ini adalah kohort cyber-defender Fairwind dan menunggu. API milik Google sendiri tidak menyajikannya, dan kami juga tidak, dan tidak ada jalur pihak ketiga yang dapat menyajikan model yang tidak memiliki pengenal untuk dialamatkan.
Pertanyaan-pertanyaan yang masih terbuka, dan secara tepat apa yang akan menutupnya
Empat hal belum terselesaikan, dan masing-masing memiliki pemicu spesifik yang dapat diperiksa. Menjaga daftar itu tetap singkat adalah intinya — halaman seperti ini hanya berguna selama masih dapat difalsifikasi.
• Apakah Argon mendapatkan pengenal API Gemini? Pantau daftar model API untuk ID berawalan gemini-4. Begitu satu muncul, penetapan harga menjadi nyata dan tarif perkenalan $2 / $10 menjadi angka yang dapat ditagihkan kepada Anda, bukan sekadar angka dalam tulisan blog. Perhatikan juga apakah tarif perkenalan itu tetap berlaku hingga tahap API, dan apakah naik menjadi $4 / $20 atau ke angka lain.
• Apakah konfigurasi yang diukur berubah? Argon diukur pada satu tingkat pemikiran dan memperoleh skor 52,56. Jika Google mengekspos konfigurasi dengan upaya yang lebih tinggi, baris itu akan bergeser; model-model sebanding yang coba disusulnya semuanya terdaftar pada dua hingga empat tingkat upaya, jadi Argon yang hanya terdaftar sekali adalah fakta tentang ketersediaan, bukan tentang plafon model tersebut.
• Apakah klaim hukum dan keuangan bertahan dalam pengujian independen?Legal Agent Benchmark milik Harvey pada 19,6 melawan 3,8 milik pesaing, dan Vals Finance Agent v2 pada 65,4 yang memimpin bidang, adalah dua margin relatif terbesar dalam tabel Google. Keduanya juga merupakan dua baris yang paling mungkin diuji ulang oleh seseorang yang tidak bekerja untuk Google. Margin empat hingga lima kali lipat pada benchmark domain adalah entah kalimat terpenting dalam pengumuman atau perbedaan harness, dan cara untuk mengetahuinya adalah dengan mengawasi pengujian kedua.
• Apakah ada saudara? Postingan pengumuman Argon tidak menyebutkan keluarga, tidak memberikan pratinjau Pro dan tidak memberikan pratinjau Ultra. Jalur gemini-4-* kedua, kolom kedua, atau entri kartu model masing-masing akan membalik pembacaan itu dalam sehari. Tulisan tentang posisi tier mencantumkan daftar pemfalsifikasi secara lengkap.
Intinya
Gemini 4 Argon adalah model frontier sungguhan dengan tabel benchmark sungguhan dan skor indeks sungguhan 52,56 dari Artificial Analysis — dan ini bukan produk, dalam arti spesifik bahwa tidak ada pengenal model, endpoint, kartu model, jendela konteks, atau tanggal ketersediaan umum untuknya, dan baik dokumentasi Google sendiri maupun layanan pengukuran pihak ketiga sepakat bahwa tepat satu penyedia menghostingnya. “Gemini 4” dalam namanya adalah label generasi; “Argon” adalah bagian tempat model itu melekat. Jika Anda memilih sesuatu untuk dibangun di atasnya bulan ini, keputusan itu tidak melibatkan Argon: keputusan itu melibatkan Gemini 3.8 Flash yang dapat Anda panggil hari ini dengan harga $0,75 / $3,75 dan model-model frontier di pita indeks yang sama yang berada pada kunci yang sama. Baca ulang halaman ini ketika pengenal gemini-4 muncul di daftar API. Sampai saat itu, segala hal tentang Argon adalah klaim yang dibuat Google tentang model yang tidak dapat diakses oleh siapa pun di luar kohort pertama.

Dibandingkan dalam artikel ini3
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
