
GPT-6.1 Sol vs Gemini 4 Argon: Terpaut Setengah Poin, dan Hanya Salah Satunya yang Dijual
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Segala hal yang dapat Anda bandingkan antara GPT-6.1 Sol dan Gemini 4 Argon dapat diukur, dan tidak satu pun darinya dapat ditindaklanjuti, karena hanya satu dari kedua model itu yang dapat dibeli. Gemini 4 Argon diumumkan pada 30 September 2026 dalam postingan DeepMind yang dikreditkan kepada Koray Kavukcuoglu, dengan harga perkenalan yang dinyatakan sebesar $2,00 per juta token masukan dan $10,00 per juta token keluaran, dan digulirkan pertama kali kepada kohort para pembela siber yang disebutkan namanya melalui Fairwind Program. Model ini tidak memiliki pengenal model, tidak memiliki endpoint API, tidak memiliki tarif per token yang dipublikasikan yang dapat menjadi dasar penagihan Anda, dan tidak memiliki halaman yang dapat Anda akses sebagai pelanggan. GPT-6.1 Sol dirilis pada 29 September 2026 dengan harga $2,00 dan $10,00 dan kini tersedia. Pada Artificial Analysis Intelligence Index, keduanya terpaut 0,8 poin — Argon 52,6; Sol 51,8 — yang menjadikan ini pasangan terdekat dalam batch ini dan, jika hanya berdasarkan indeks, seri. Pada meteran yang menentukan penerapan nyata, salah satu dari model-model ini sama sekali bukan kandidat.
Asimetri itu bukan hal teknis belaka, dan juga bukan berita eksklusif. Itulah fakta yang seharusnya menentukan bagaimana perbandingan ini dibaca: angka-angka Argon menggambarkan sebuah model dalam peluncuran terkendali kepada satu kohort, sedangkan angka-angka GPT-6.1 Sol menggambarkan sebuah produk yang ada di daftar harga. Membandingkan keduanya tetap layak dilakukan — Argon adalah yang saat ini diunggulkan vendor, dan pengukurannya mengatakan sesuatu yang nyata tentang posisi puncak lini Gemini — tetapi setiap kesimpulan harus disertai frasa "jika produk itu dapat dibeli", dan tidak satu pun boleh menyertakan frasa "haruskah Anda beralih".
Indeks ini memungkinkan tepat satu perbandingan, dan hasilnya hampir seri.

Kedua model tersebut muncul di Artificial Analysis, dan keduanya membawa skor serta perhitungan tentang biaya yang dikeluarkan untuk menghasilkan skor itu.
• Indeks Kecerdasan, v4.3.2 — Gemini 4 Argon 52,6 vs GPT-6.1 Sol 51,8, selisih 0,8 poin
• Biaya per tugas indeks — Gemini 4 Argon $1,99 vs GPT-6.1 Sol $0,72, selisih 2,8× untuk 0,8 poin tersebut
• Biaya untuk menjalankan suite lengkap — Gemini 4 Argon $2,407 vs GPT-6.1 Sol $1,082
• Token keluaran yang dihasilkan pada suite tersebut — Gemini 4 Argon 110M vs GPT-6.1 Sol 67M, selisih verbositas 1,6×
• Harga perkenalan yang dinyatakan — $2,00 untuk input dan $10,00 untuk output per juta token pada keduanya, dengan input yang di-cache diskon 95% di Argon
• Jendela konteks — GPT-6.1 Sol 1.050.000 token; Argon belum dipublikasikan
Baris keempat menjelaskan baris kedua. Perbedaan biaya per tugas sebesar 2,8× pada tarif utama yang nyaris identik berasal dari penulisan token 1,6× lebih banyak dengan harga output yang sebanding, ditambah berapa pun biaya volume penalaran di baliknya. Argon bukan model yang mahal berdasarkan kartunya. Ia banyak bicara dalam evaluasi, dan perhitungannya diselesaikan pada output.
Konfigurasinya berbeda, dan arah perbedaannya menguntungkan model yang lebih murah. Artificial Analysis mencatat Gemini 4 Argon pada setelan upaya tinggi dan GPT-6.1 Sol pada maksimum — jadi Sol diukur pada setelan termahalnya dan Argon pada sesuatu di bawah batas atasnya. Selisih 0,8 poin karena itu adalah versi perbandingan yang menguntungkan bagi Sol: beri Argon setelan tertingginya dan selisihnya kemungkinan melebar, beri Sol setelan yang lebih rendah dan biayanya turun lebih jauh. Tidak satu pun dari langkah itu mengubah garis ketersediaan, yang merupakan satu-satunya garis yang mengakhiri keputusan deployment.
Membaca selisih 0,8 poin sama sekali
Perbedaan di bawah satu poin pada komposit sepuluh evaluasi bukanlah sebuah peringkat. Itu adalah dua model dalam band yang sama.
Yang tidak diterbitkan indeks untuk Argon adalah rincian komponen yang akan membuat rentang itu terbaca — evaluasi mana yang dimenangkannya, di mana ia lemah, bagaimana perilakunya di seluruh subskor yang membentuk komposit. Halaman GPT-6.1 Sol memuat baris-baris itu; halaman Argon memuat satu headline dan satu biaya. Perbandingan yang dibangun hanya berdasarkan headline dapat mengatakan bahwa keduanya setara dan tidak lebih, dan seharusnya mengatakan tepat itu alih-alih mengarang pemenang dari selisih 0,8 poin.
Ada satu titik data eksternal yang layak ditambahkan, dan itu justru mengarah ke arah sebaliknya. Dalam evaluasi coding pihak ketiga yang beredar setelah pengumuman, Argon berada di peringkat ketiga di belakang GPT-6 Astra dan Claude Opus 5.5 — hasil yang kuat untuk model dalam peluncuran terkendali, dan selaras dengan 52,6 pada komposit. Ini juga merupakan satu observasi tunggal dari satu evaluasi, yang diterbitkan pada hari-hari pertama sebuah pengumuman, sehingga menjadikannya bukti ketimbang rekam jejak. Beri label dan lanjutkan.
Apa sebenarnya fungsi kedua kartu harga itu
Tarif yang dinyatakan untuk Argon perlu lebih diperhatikan daripada baris indeks, karena ada dua angka di dalamnya.
Tarif perkenalannya adalah $2,00 untuk input dan $10,00 untuk output dengan input yang di-cache diskon 95%, yang pada sebuah kartu akan membuat Argon setara harga secara langsung dengan GPT-6.1 Sol. Catatan kaki vendor sendiri menyatakan bahwa setelah periode perkenalan yang tidak didefinisikannya, tarifnya menjadi $4,00 per juta token input dan $20,00 per juta token output. Pasangan kedua itu bukan hipotetis — itu adalah angka yang dipublikasikan yang diperkirakan akan menjadi harga tetap model — dan angka itu berada tepat pada harga daftar frontier saat ini, bukan di bawahnya. Perbandingan yang hanya mengutip pasangan perkenalan berarti mengutip angka promosi untuk model yang belum tersedia secara umum, yang merupakan dua tingkat kesementaraan dalam satu baris.
Kartu GPT-6.1 Sol adalah objek dari jenis yang berlawanan. $2.00 dan $10.00 adalah tarif tetap, bukan promosi; kenaikan konteks panjang ke $4.00 / $15.00 di atas 272.000 token prompt dipublikasikan dan berlaku pada batas yang terdefinisi; input yang di-cache seharga $0.10 sudah aktif hari ini dan dapat ditagih. Tidak ada apa pun di dalamnya yang memerlukan catatan kaki tentang periode yang vendor menolak untuk mendefinisikannya.
Itulah inti di balik keterangan ketersediaan. Bukan berarti Argon adalah model yang lebih buruk — indeksnya mengatakan keduanya setara — melainkan bahwa salah satu dari dua kartu ini adalah komitmen dan yang lainnya adalah niat.
Peluncuran itu sendiri adalah perbandingannya

Fairwind Program adalah bagian dari pengumuman Argon yang cenderung dilewatkan oleh perbandingan teknis, dan itulah bagian yang paling penting di sini.
Vendor menyerahkan model itu lebih dulu ke tangan sekelompok pembela siber yang disebutkan namanya, sebelum siapa pun. Tidak ada tanggal yang diumumkan untuk pembukaan umum, tidak ada daftar tunggu pengembang, dan tidak ada pengenal yang dipublikasikan yang bisa dijadikan acuan oleh pelanggan. Itu cara yang sah untuk merilis model terdepan, dan hal itu lazim untuk kemampuan sekelas ini. Ini juga berarti setiap klaim tentang biaya, latensi, throughput, dan keandalan Argon pada lalu lintas nyata saat ini belum terukur: tidak ada lalu lintas produksi untuk diukur. Proses benchmark milik vendor sendiri ada, dan komposit Artificial Analysis ada, dan di antara keduanya, itu hanyalah evaluasi satu lab dan rangkaian pengujian satu evaluator. Itulah keseluruhan catatannya.
Rekam jejak GPT-6.1 Sol berusia delapan hari dan lemah dengan cara yang berbeda: satu konfigurasi independen, tanpa korpus praktisi, dan produk yang sudah dirilis yang mode kegagalannya belum dituliskan di mana pun. Tidak ada dari kedua model itu yang buktinya kuat. Namun, salah satunya memiliki faktur.
Jadi untuk apa perbandingan ini
Tiga penggunaan, dan tak satu pun darinya merupakan keputusan pembelian.
Pertama, kalibrasi. Jika Anda melacak posisi Argon terhadap GPT-6.1 Sol, 52,6 berbanding 51,8 dengan selisih biaya per tugas 2,8× adalah jawaban saat ini, dan itu menunjukkan bahwa lini Gemini 4 kompetitif dalam hal kemampuan sambil masih menyelesaikan ketentuan komersialnya. Waspadai tarif perkenalan yang akan digantikan oleh pasangan $4,00 / $20,00, yang akan mengubah penyetaraan harga menjadi premi harga pada kemampuan yang tidak berubah.
Kedua, posisi menunggu. Model yang diumumkan, diukur, dan tidak dapat dirutekan adalah kasus paling jelas yang ada untuk mempertahankan abstraksi antara aplikasi Anda dan pilihan model Anda. Kedua model dalam tulisan ini dapat dijangkau dengan cara yang sama dari sisi kami: GPT-6.1 Sol ada di OrcaRouter dengan tarifnya sendiri $2.00 / $10.00 dengan input yang di-cache sebesar $0.10 dan tanpa tambahan apa pun, sehingga beban kerja dapat dibangun terhadapnya hari ini pada harga daftar penyedia. Jika dan ketika Argon mendapatkan pengenal dan kartu tarif, mengevaluasinya seharusnya menjadi perubahan konfigurasi alih-alih penulisan ulang — dan sampai saat itu, jumlah rekayasa yang tepat untuk dihabiskan pada Argon adalah jumlah yang menjaga hal itu tetap benar.
Ketiga, daftar pantau yang dapat difalsifikasi. Salah satu dari berikut akan mengubah ini dari tulisan tentang apa yang kita ketahui sejauh ini menjadi perbandingan yang dapat digunakan untuk berbelanja: pengenal model dalam dokumentasi pengembang, entri pada indeks kartu modelnya, postingan ketersediaan umum dengan tarif per token yang dipublikasikan, atau Artificial Analysis yang menerbitkan konfigurasi kedua pada tingkat upaya yang berbeda. Sampai salah satu dari itu terwujud, tulisan yang mengklaim Argon lebih murah, lebih cepat, atau lebih baik daripada GPT-6.1 Sol dalam produksi sedang menggambarkan model yang belum pernah dijalankan oleh siapa pun di luar satu kohort.

Penutup jujur itu adalah satu kalimat, dan itu tentang bentuk pertanyaannya, bukan skornya. Gemini 4 Argon dan GPT-6.1 Sol berada di satu-satunya papan independen tempat keduanya muncul, sehingga indeks tidak dapat memilih di antara keduanya; yang memilih di antara keduanya adalah bahwa yang satu tersedia dan yang satu adalah janji, dan janji bukanlah tempat untuk mengarahkan lalu lintas produksi. Pantau Argon, adopsi Sol jika harga dan modalitasnya cocok dengan pekerjaan Anda, dan jaga abstraksinya tetap cukup tipis sehingga ketika Argon menjadi nyata, itu hanya satu baris konfigurasi, bukan sebuah proyek.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
