Kartu hero yang dihasilkan berjudul 'GPT-6 Sol vs DeepSeek V4 Pro', dengan tajuk utama '12 poin Index', dengan dua baris yang membandingkan 'API tertutup seharga $2,00/$10,00 per 1 juta' dengan 'bobot terbuka MIT seharga $1,32/$3,96 per 1 juta', dan logo OrcaRouter di kanan bawah.
Guides & Insights

GPT-6 Sol vs DeepSeek V4 Pro: Selisih Indeks Dua Belas Poin untuk Harga Empat Kali Lipat

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Inilah hitung-hitungan yang tidak ada yang mencantumkannya di halaman peluncuran. DeepSeek V4 Pro mendapat skor 36 pada Indeks Kecerdasan Artificial Analysis. GPT-6 Sol mendapat skor 48. GPT-6 Sol berbiaya $2.00 per juta token masukan dan $10.00 per juta token keluaran. DeepSeek V4 Pro berbiaya $1.32 dan $3.96 pada papan yang sama — dan daftar tarif resminya sendiri, setelah dikonversi, menjadi sekitar $0.42 dan $0.87. Jadi selisih dua belas poin antara GPT-6 Sol dan DeepSeek V4 Pro dibeli dengan harga antara satu setengah hingga empat kali lipat, tergantung daftar tarif siapa yang Anda baca, dan model di sisi yang lebih murah adalah model yang dapat Anda unduh dan jalankan sendiri.

Itulah keseluruhan keputusannya, dan ini sungguh lebih tipis daripada yang ditunjukkan papan skor. DeepSeek V4 Pro dirilis pada 13 Agustus 2026 sebagai model mixture-of-experts berlisensi MIT dengan total 1,6 triliun parameter dan 49 miliar yang aktif per token. GPT-6 Sol dirilis pada 22 September 2026 sebagai model frontier berbobot tertutup dengan harga setengah dari pendahulunya sendiri. Yang satu adalah komoditas yang bisa Anda host; yang lain adalah kapabilitas yang Anda sewa. Keduanya membawa jendela konteks satu juta token. Keduanya adalah model penalaran. Tidak satu pun jelas merupakan pembelian yang salah.

Angka yang menentukan ini

Mulailah dari hal yang disepakati kedua vendor: konteks. DeepSeek V4 Pro membawa jendela konteks 1M dengan output maksimum 384K. GPT-6 Sol terdaftar pada 872.000 token oleh Artificial Analysis terhadap batas atas 1,05M dengan batas output 128K di bagian lain materi OpenAI. DeepSeek memberi Anda ruang output tiga kali lebih besar dan jendela input yang sebanding.

Lalu hal yang hanya dimiliki salah satunya: jurang penetapan harga ulang untuk konteks panjang. Tarif $2/$10 milik GPT-6 Sol tetap berlaku di bawah 272.000 token masukan. Di atas itu, seluruh permintaan ditetapkan ulang harganya — masukan kira-kira menjadi dua kali lipat ke $4 dan keluaran naik setengah menjadi sekitar $15. DeepSeek V4 Pro tidak memiliki langkah yang setara; tarif terbitannya berlaku di seluruh jendela, dengan jadwal jam sibuk dan luar sibuk yang diperkenalkan pada 17 Agustus yang mengubah harga berdasarkan waktu dalam sehari, bukan berdasarkan panjang konteks.

Jika digabungkan, perbandingannya justru terbalik di segmen atas. Permintaan DeepSeek V4 Pro yang membawa 400K token konteks dikenakan tarif normalnya. Permintaan yang sama pada GPT-6 Sol biayanya sekitar dua kali lipat harga utamanya. Jika beban kerja Anda memang berkonteks panjang secara alami — analisis dokumen, agen untuk repo besar, penalaran transkrip yang diperluas — selisih harga efektif antara kedua model ini jauh lebih lebar daripada yang disiratkan oleh $2 versus $1.32.

A generated two-column scoreboard titled 'GPT-6 Sol vs DeepSeek V4 Pro — the scoreboard'. Left column GPT-6 Sol: Price $2.00/$10.00, AA Index 48, Weights 'closed', Max output 128K, Terminal-Bench 2.1 'n/a', Context 872K. Right column DeepSeek V4 Pro: Price $1.32/$3.96, AA Index 36, Weights 'MIT', Max output 384K, Terminal-Bench 2.1 87.9, Context 1M. Footer: 'DeepSeek figures per DeepSeek and Artificial Analysis.'

Di mana DeepSeek V4 Pro benar-benar kompetitif

Hasil agentik dan coding DeepSeek bukanlah kompromi anggaran. Berdasarkan angka yang diterbitkan vendor:

• Terminal-Bench 2.1 — DeepSeek V4 Pro 87,9

• Toolathlon-Verified — DeepSeek V4 Pro 74.1

• DeepSWE — DeepSeek V4 Pro 62.7

• SWE-bench Verified — DeepSeek V4 Pro 80.6

• AA Intelligence Index — DeepSeek V4 Pro 36, peringkat ke-8 dari 114 model yang diukur

• Kecepatan keluaran — DeepSeek V4 Pro 67,8 token/detik

• Lisensi — MIT, bobot terbuka, dapat dihosting sendiri

Peringkat Index layak ditinjau ulang. Tiga puluh enam poin menempatkan DeepSeek V4 Pro di posisi kedelapan dari 114 model di papan peringkat, yang merupakan posisi kuat bagi model dengan bobot yang dapat diunduh dan lisensi MIT. Jarak ke GPT-6 Sol memang nyata, tetapi itu adalah jarak antara "sangat baik" dan "terdepan," bukan antara "bisa dipakai" dan "tidak."

Lisensi MIT adalah bagian yang tidak memiliki padanan pada GPT-6 Sol. Jika kendala Anda adalah residensi data, penerapan air-gapped, biaya per token yang menuju nol pada tingkat pemanfaatan tinggi, atau sekadar tidak ingin depresiasi vendor menjadi peristiwa migrasi, DeepSeek V4 Pro adalah satu-satunya dari dua ini yang menjawab pertanyaan tersebut. GPT-6 Sol hanya tersedia melalui API dan akan tetap demikian.

Di mana GPT-6 Sol unggul jauh

Dua belas poin Index adalah margin yang lebar di ujung tabel ini. GPT-6 Sol berada di peringkat ke-18 dari 212 model yang diukur, dibandingkan DeepSeek yang berada di peringkat ke-8 dari 114, dan ia mencapai posisi itu dengan serangkaian hasil agentik yang diterbitkan vendor yang tidak dibantah oleh DeepSeek:

• AutomationBench — GPT-6 Sol 33,2% dengan $0,27 per tugas

• Ujian Terakhir para Agen — GPT-6 Sol 56.4%

• DeepSWE v1.1 — GPT-6 Sol 68,8%

• OSWorld 2.0 — GPT-6 Sol 60,5%

• Kecepatan output — GPT-6 Sol 104,4 token/detik, dibandingkan DeepSeek V4 Pro 67,8

Itu dilaporkan oleh vendor dan OpenAI menjalankan harness-nya sendiri, jadi anggap semuanya sebagai klaim, bukan hasil pengukuran. Ada dua catatan yang perlu diingat. OpenAI memakai skor pesaing yang sudah dipublikasikan di beberapa baris, bukan menjalankan ulang model pesaing tersebut, dan titik pada grafik Agents' Last Exam untuk Claude Fable 5.1 tidak memasukkan fallback Opus 5 yang aktif pada sekitar 40% tugas. Tidak ada dari kedua catatan itu yang secara langsung memengaruhi perbandingan DeepSeek, tetapi keduanya alasan untuk tidak berpegang terlalu kaku pada seluruh tabel tersebut.

Pembacaan independen lebih terukur daripada pembacaan kedua vendor. Artificial Analysis menemukan bahwa GPT-6 Sol kira-kira memangkas biaya per tugas hingga setengah dibandingkan GPT-5.6 Sol sekaligus menghasilkan campuran peningkatan dan regresi — termasuk regresi pada GDPval-AA v2.1. Model yang menukar kemampuan di beberapa area dengan pengurangan biaya yang besar adalah model yang mengubah apa yang mampu Anda jalankan, bukan model yang menaikkan plafon di semua tempat.

Dan profil latensi GPT-6 Sol adalah kelemahan yang nyata. Waktu hingga token pertama adalah 107,18 detik dibandingkan median papan peringkat sebesar 3,87. Itu adalah token pertama paling lambat di papan peringkat dengan selisih yang sangat jauh. DeepSeek V4 Pro juga bukan model yang cepat, tetapi ia tidak berada di wilayah itu, dan untuk antarmuka interaktif apa pun, perbedaannya hanya mendiskualifikasi dalam satu arah.

Bobot terbuka versus frontier sewaan

Inilah dimensi di mana kedua model sebenarnya tidak benar-benar bersaing. DeepSeek V4 Pro adalah MoE dengan 1,6T parameter dan 49B parameter aktif, berlisensi MIT, serta dapat diunduh. Artinya, ada biaya tetap yang teramortisasi menjadi tidak berarti pada skala volume, deployment yang Anda kendalikan, dan model yang tidak dapat dideprekasi secara sepihak saat Anda masih bergantung padanya. Artinya juga Anda memiliki serving stack, menanggung tagihan GPU, dan bertanggung jawab atas setiap regresi.

GPT-6 Sol adalah taruhan yang berlawanan. Anda membayar per token selamanya, Anda mendapatkan kemampuan terdepan tanpa memiliki perangkat keras, dan OpenAI dapat mengubah harga, skema tarif, atau ketersediaannya hanya dengan sebuah postingan blog — seperti yang dilakukannya pada 22 September ketika memangkas separuh harga andalannya sendiri. Tidak ada versi GPT-6 Sol yang dapat Anda kunci.

Cara yang tepat untuk memikirkannya bukanlah "mana yang lebih baik" melainkan "risiko mana yang Anda pilih." Risiko vendor versus risiko operasional. Bagi startup tanpa tim infrastruktur dan dengan lalu lintas yang berfluktuasi, API jelas merupakan pilihan yang benar. Bagi organisasi yang sudah memiliki kapasitas GPU, batas kepatuhan, atau beban kerja yang volumenya membuat harga per token menjadi tidak masuk akal, bobot terbuka menang hanya dari segi ekonomi, dan dua belas poin Index adalah harga yang layak dibayar.

Jika Anda ingin berhenti memilih

Ada versi keputusan ini yang tidak memerlukan komitmen. DeepSeek V4 Pro tersedia di OrcaRouter dengan harga daftar DeepSeek, dengan model pass-through yang berarti perubahan tarif DeepSeek — termasuk jadwal peak dan off-peak — tercermin di sisi kami pada hari yang sama, bukan setelah reseller menegosiasi ulang. GPT-6 Sol tidak ada dalam katalog kami pada saat penulisan ini; model itu dapat diakses melalui API OpenAI sendiri, jadi rute yang mencakup keduanya berarti satu kunci untuk DeepSeek V4 Pro dan integrasi langsung untuk OpenAI.

Pemisahan itu layak dipertahankan karena alasan spesifik: kedua model ini gagal dengan cara yang berbeda. Deployment open-weight gagal ketika perangkat keras Anda mati; API gagal ketika vendor-nya mati. Failover otomatis antar penyedia adalah yang mengubahnya menjadi sore dengan performa menurun alih-alih pemadaman total, dan kemampuan memindahkan rute antara model murah berthroughput tinggi dan model mahal yang cermat dengan mengedit konfigurasi alih-alih jalur kode adalah yang memungkinkan Anda mengikuti kurva harga alih-alih bertaruh padanya.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

Siapa yang harus memilih yang mana

Pilih DeepSeek V4 Pro jika Anda memiliki infrastruktur, batas kepatuhan, atau masalah volume. Model ini berlisensi MIT, berada di peringkat kedelapan dari 114 pada indeks independen, menyediakan ruang keluaran 384K, dan kartu tarifnya tidak memiliki jurang konteks. Ini adalah jawaban yang tepat bagi siapa pun yang kendala utamanya adalah biaya dalam skala besar atau kendali atas penerapan, dan selisih dua belas poin dengan GPT-6 Sol adalah harga untuk itu.

Pilih GPT-6 Sol jika Anda membutuhkan yang terdepan dan konteks Anda tetap di bawah 272K token. Skornya 48 berbanding 36, ia menghasilkan token sekitar 50% lebih cepat, dan dengan $2/$10 ia adalah model teratas OpenAI yang paling murah yang pernah dibuat. Ketahuilah apa yang Anda beli: penantian seratus detik untuk token pertama, tier konteks panjang yang menggandakan tarif, dan model yang penilaian independennya merupakan campuran peningkatan dan regresi alih-alih peningkatan yang jelas.

Dan jika jawabannya adalah "keduanya, bergantung pada permintaannya," itu bukan keragu-raguan. Itu adalah arsitektur yang tepat untuk pasar tempat dua vendor memangkas separuh harga produk andalan mereka dalam selang enam minggu satu sama lain dan tak satu pun berhenti bergerak.

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro), showing the Tools, JSON and Reasoning badges, a 1M-token context with 384K maximum output and text-only input, a 3.56s p50 time to first token, and the description of DeepSeek V4 Pro as a flagship MoE with 1.6T total / 49B active parameters built for top-tier reasoning and agentic tool use.

Dibandingkan dalam artikel ini3

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari