Kartu judul hero bertuliskan 'GPT-6 Sol Pro vs DeepSeek V4 Pro' dengan subjudul 'Tarif tetap versus jadwal', sepasang label 'GPT-6 Sol Pro' / 'DeepSeek V4 Pro', dan baris footer bertuliskan 'Harga daftar vendor; angka menurut Artificial Analysis.', dengan logo OrcaRouter asli di kanan bawah.
Guides & Insights

GPT-6 Sol Pro vs DeepSeek V4 Pro: Tarif Tetap Berhadapan dengan Jadwal

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

GPT-6 Sol Pro dan DeepSeek V4 Pro adalah dua cara kredibel termurah untuk menjalankan beban kerja penalaran yang serius melalui API saat ini, dan keduanya dihargai berdasarkan prinsip yang sangat berbeda. GPT-6 Sol — model vendor yang dijalankan oleh konfigurasi gpt-6-sol-pro, tersedia umum sejak 22 September 2026 — berbiaya $2.00 per juta token masukan dan $10.00 per juta token keluaran, pada setiap jam setiap hari. DeepSeek V4 Pro, unggulan open-weights yang checkpoint 0813-nya mencapai ketersediaan umum pada 13 Agustus 2026, berbiaya $0.66 dan $1.98 untuk sebagian besar minggu ini dan tepat dua kali lipatnya untuk dua jendela sempit pada pagi hari kerja. Perbandingan apa pun yang menyebutkan satu tarif berarti menyebutkan setengah harga.

Jadwal adalah ceritanya. Segala hal lain tentang perbandingan ini — skor indeks, jendela konteks, ketentuan lisensi — merupakan konsekuensi dari fakta bahwa salah satu dari dua vendor ini telah memutuskan bahwa harga daftarnya adalah fungsi dari waktu.

Apa sebenarnya masing-masing baris harga itu

Kartu tarif GPT-6 Sol adalah satu baris. Input $2,00, input cache $0,20, penulisan cache $2,50, output $10,00 per juta token, dengan penetapan harga ulang konteks panjang di atas ambang input yang berlaku untuk seluruh permintaan begitu terlampaui. Tidak ada dimensi waktu dan tidak ada jendela promosi. OpenAI memangkas model pendahulunya ke angka-angka ini pada 22 September dan menyebutnya permanen.

Daftar tarif DeepSeek adalah tabel. Seperti yang tertera di halaman harga milik vendor itu sendiri:

• Input di luar jam sibuk — $0,66 per juta token, cache miss; $0,022 per juta token, cache hit

• Output di luar jam sibuk — $1,98 per juta token

• Input puncak — $1,32 per juta token, cache miss; $0,044 per juta token, cache hit

• Output puncak — $3,96 per juta token

• Jendela puncak — 01:00–04:00 dan 06:00–10:00 UTC, Senin hingga Jumat, tidak termasuk hari libur nasional Tiongkok

• Semua hal lainnya — di luar jam sibuk, termasuk sepanjang akhir pekan, sebuah aturan yang mulai berlaku pada tengah malam waktu Beijing pada 23 Agustus 2026

Tujuh jam puncak dari 168 jam dalam seminggu, lima hari dari tujuh, kira-kira 21% dari kalender dengan tarif yang lebih tinggi dan 79% dengan tarif yang lebih rendah. Jadi ringkasan jujur dalam satu angka untuk DeepSeek V4 Pro bukanlah $0,66 dan bukan $1,32 — melainkan di suatu tempat di antaranya, dan di mana tepatnya bergantung pada bentuk lalu lintas Anda, bukan pada kemurahan hati vendor.

Penetapan harga ulang yang menghasilkan tabel ini

Ada baiknya mengetahui betapa barunya struktur ini, karena hampir setiap halaman perbandingan masih mencantumkan angka yang digantikannya. Pada 22 Mei 2026, DeepSeek mengubah diskon waktu terbatas untuk V4 Pro menjadi harga permanen — potongan sekitar 75%, menjadi sekitar $0,435 untuk input dan $0,87 untuk output per juta token.

Pada 17 Agustus 2026 tengah malam waktu Beijing, hal itu dibalik dan bahkan lebih dari itu. Sistem puncak/luar puncak resmi berlaku dengan kenaikan rata-rata di baris-baris yang terdampak sekitar 3,5 kali dan maksimum 12 kali — angka 12× itu tepat jatuh pada tarif input cache-hit, yang naik dari ¥0,025 menjadi ¥0,30 per juta token pada jam puncak. Input cache-miss naik sekitar 200% dan output sekitar 350%. Enam hari kemudian, pengecualian akhir pekan ditambahkan, yang menarik kembali sebagian dari kenaikan itu bagi siapa pun yang pekerjaan batch-nya bisa dipindahkan.

Dua konsekuensi menyusul. Pertama, halaman mana pun yang memberi tahu Anda bahwa DeepSeek V4 Pro adalah model di bawah satu dolar sedang mengutip daftar tarif yang sudah digantikan dua kali. Kedua, bentuk kenaikannya adalah sinyal tentang apa yang sedang dioptimalkan DeepSeek: kenaikan proporsional terbesar terjadi pada cache hit, yakni tarif yang paling penting bagi tepatnya beban kerja — loop agen panjang yang mengirim ulang prefiks stabil — yang membuat model itu menarik sejak awal.

A two-column scoreboard card titled 'GPT-6 Sol vs DeepSeek V4 Pro - the scoreboard'. Left column 'GPT-6 Sol': AA Index, max 48; price in/out $2 / $10 flat; peak surcharge none; cost per index task $1.06; max output 128K; weights closed. Right column 'DeepSeek V4 Pro': AA Index, max 36; price in/out $0.66 / $1.98 off-peak; peak surcharge 2x, 7h a week; cost per index task $0.67; max output 384K; weights MIT, downloadable. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Nomor indeks yang dikutip semua orang sudah tidak digunakan lagi

Artificial Analysis adalah harness netral untuk perbandingan ini, dan telah beberapa kali memperbarui versi Intelligence Index-nya sepanjang 2026. Pada papan saat ini, GPT-6 Sol mencetak skor 48 pada upaya maksimal dengan $1,06 per tugas indeks. DeepSeek V4 Pro, pada checkpoint 0813 dengan upaya maksimal, mencetak skor 36 dengan $0,67 per tugas indeks.

Angka yang beredar untuk DeepSeek adalah 53. Angka itu nyata dan pernah dipublikasikan — pada revisi indeks yang lebih awal, sebelum pembuatan versi ulang yang menggeser sebagian besar skor model. Membandingkan angka 53 yang diambil dari artikel pra-v4.3 dengan angka 48 saat ini sama dengan membandingkan pengukuran yang sudah tidak dipakai lagi dengan pengukuran yang masih berlaku, dan ini menghasilkan kesalahan paling umum dalam perbandingan ini: klaim bahwa kedua model hanya terpaut satu poin. Pada indeks saat ini, keduanya terpaut dua belas poin, dan selisih harga per tugas yang diselesaikan bukanlah 3× seperti yang disiratkan tarif yang diumumkan, melainkan lebih dekat ke 1,6×, karena DeepSeek menghabiskan lebih banyak token untuk sampai pada jawabannya.

Dua titik data independen lainnya pantas berada di samping itu, keduanya diberi label sesuai kenyataannya. Vals AI, yang menjalankan harness terisolasi, menempatkan DeepSeek V4 Pro pada 96,40% di SWE-bench Verified dengan biaya $0,103 per tes — peringkat kedua di papan itu setelah Claude Opus 5 dengan 97,00%, dan jauh lebih murah per tes. Papan agen pengodean Artificial Analysis menunjukkan 14% pada Terminal-Bench 4.0 versus 44% milik GPT-6 Sol. Angka pertama menunjukkan DeepSeek kompetitif pada satu tugas pengodean yang sempit dan terdefinisi dengan baik. Angka kedua menunjukkan bahwa DeepSeek tidak kompetitif pada pekerjaan terminal agentik. Keduanya benar dan keduanya mengukur hal yang berbeda.

Ketika kedua model tersebut berbeda secara struktural, bukan sekadar berbeda harga

• Lisensi — GPT-6 Sol adalah API tertutup tanpa bobot; DeepSeek V4 Pro berlisensi MIT dengan checkpoint publik di Hugging Face, termasuk varian dasar untuk pra-pelatihan lanjutan

• Keluaran maksimum — GPT-6 Sol 128.000 token vs DeepSeek V4 Pro 384.000 token, tiga kali batas atas dengan seperlima tarif keluaran

• Jendela konteks — GPT-6 Sol 1.050.000 token vs DeepSeek V4 Pro 1.048.576 token, praktis identik

• Modalitas — baik teks masuk maupun teks keluar; keduanya tidak menerima gambar di API

• Penetapan harga konteks panjang — GPT-6 Sol menetapkan ulang harga seluruh permintaan di atas ambang inputnya; jadwal puncak/non-puncak DeepSeek V4 Pro adalah satu-satunya struktur harga yang dimilikinya

• Skala — DeepSeek V4 Pro adalah model mixture-of-experts dengan 1,6 triliun parameter dan 49 miliar parameter aktif per token; OpenAI tidak memublikasikan angka yang sebanding untuk GPT-6 Sol

Satu catatan tentang jumlah parameter itu, karena ini sering menjadi sumber kebingungan: angka 1,7 triliun yang muncul di beberapa daftar adalah ukuran paket Hugging Face dengan modul speculative decoding DSpark opsional yang disertakan, bukan model target yang lebih besar. Arsitektur yang dipublikasikan berjumlah total 1,6T. Mengurangkan badge yang telah dibulatkan untuk menyimpulkan ukuran modul draft bukanlah perhitungan yang valid, dan membaca angka yang lebih besar sebagai bukti bahwa model tersebut bertambah besar juga bukan hal yang valid.

Screenshot of OpenAI's developer model page for GPT-6 Sol, captured 23 September 2026, showing the model id gpt-6-sol, a 1,050,000-token context window with 922,000 maximum input tokens and a 128,000-token output ceiling, an April 20, 2026 knowledge cutoff, text and image input with text output, reasoning effort values of none, low, medium, high, xhigh and max with medium as the default, and Standard pricing of $2.00 input, $0.20 cached input, $2.50 cache writes and $10.00 output per million tokens.

Penarikan yang merupakan argumen sebenarnya untuk bobot terbuka

Pada 9 September 2026, DeepSeek mengumumkan bahwa mereka menghentikan V4 Pro secara bertahap, dan bahwa mulai pukul 04.00 UTC pada 14 September, setiap permintaan ke string model deepseek-v4-pro akan dialihkan ke DeepSeek V4.1 Flash dan ditagih dengan tarif Flash, berlanjut sampai model V4.1 Pro dirilis. String model tersebut tetap akan merespons. Model di baliknya bukanlah model yang pernah di-benchmark oleh siapa pun.

Para pengembang keberatan, dan pengalihan itu ditarik. Catatan perubahan DeepSeek kini menyatakan bahwa layanan API V4 Pro berlanjut melewati 14 September dengan penagihan yang tidak berubah, dan tabel harga masih mencantumkan deepseek-v4-pro sebagai baris aktif dengan tarifnya sendiri serta tanpa label penghentian. Halaman pengumuman sebelumnya masih memuat bahasa pengalihan, sehingga kedua dokumen itu saling bertentangan — dan halaman harga aktiflah yang menjelaskan apa yang sebenarnya terjadi saat Anda memanggilnya.

Episode itu adalah argumen terkuat dalam seluruh pertandingan ini, dan itu bukan argumen harga. Model tertutup dapat diubah harganya, dialihkan rutenya, atau dihentikan sesuai jadwal vendor, dan satu-satunya jalan keluar adalah bermigrasi. Model dengan bobot MIT di repositori publik dapat disajikan dari infrastruktur Anda sendiri, yang berarti checkpoint yang Anda evaluasi adalah checkpoint yang terus Anda layani terlepas dari apa yang dikatakan peta jalan vendor enam minggu kemudian. DeepSeek menunjukkan risikonya dan menyediakan mitigasinya dalam periode dua minggu yang sama.

Penyeimbang yang jujur adalah bahwa menghosting sendiri model dengan 1,6 triliun parameter bukanlah keputusan yang dibuat secara sembarangan oleh sebagian besar tim. Itu adalah opsi nyata dengan biaya tetap yang nyata, bukan lindung nilai gratis.

Di mana lapisan routing mengubah aritmetika

DeepSeek V4 Pro ada di OrcaRouterkatalog. Baik checkpoint saat ini maupun string model dasar berhasil diresolusi — deepseek/deepseek-v4-pro-0813 dan deepseek/deepseek-v4-pro — pada tarif daftar off-peak dengan pengali peak yang diterapkan pada jadwal UTC yang sama, jendela konteks 1.048.576 token, batas keluaran 384.000 token, dan waktu ke token pertama p50 sebesar 3,56 detik seperti yang diukur di halaman model kami sendiri. Harga daftar penyedia diteruskan tanpa markup tambahan, yang dalam hal ini berarti batas peak/off-peak muncul di faktur Anda pada saat yang sama dengan saat muncul di faktur DeepSeek.

GPT-6 Sol bukan salah satu rute kami, jadi tidak ada apa pun di sini yang merupakan klaim tentang harganya melalui kami.

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro), captured 23 September 2026, showing the model id, a 384K-token maximum output, a 1M-token context window, text-only input, Tools, JSON and Reasoning tags, an input price of $0.66 and an output price of $1.98 per million tokens, a p50 time to first token of 3.56 seconds, and both the /v1/chat/completions and /v1/responses endpoints.

Jadwal inilah yang membuat satu endpoint layak dimiliki secara khusus di sini. Beban kerja yang dapat digeser bernilai dua kali lipat dibandingkan yang tidak, dan menggesernya adalah keputusan routing, bukan migrasi — kunci yang sama, bentuk permintaan yang sama, jam yang berbeda atau model yang berbeda di baliknya. Memasangkan DeepSeek V4 Pro dengan DeepSeek V4.1 Flash pada satu endpoint adalah versi yang lebih tajam dari itu: model Flash 4,4× lebih murah untuk input dan 3,3× lebih murah untuk output daripada tarif off-peak V4 Pro, pada jendela konteks yang sama dan jendela puncak yang sama, yang menjadikannya tujuan alami bagi lalu lintas yang sama sekali tidak memerlukan model yang lebih besar. Failover otomatis penting untuk alasan yang sama seperti biasanya — tier murah yang menjadi dasar pipeline Anda tidak boleh menjadi satu titik kegagalan.

Aturan keputusan

• Pekerjaan batch dan offline yang dapat dijadwalkan — DeepSeek V4 Pro, dan jadwalkan itu. Sembilan puluh lima persen kalender pada $0.66 dan $1.98, dengan akhir pekan sepenuhnya di luar jam sibuk, adalah tarif kredibel termurah di papan ini dengan faktor tiga untuk input dan lima untuk output.

• Lalu lintas interaktif yang sensitif terhadap latensi yang masuk ke jendela puncak — GPT-6 Sol. Tarif tetap $2,00 dan $10,00 lebih mahal daripada tarif off-peak DeepSeek dan lebih murah daripada tidak ada, tetapi dapat diketahui sebelumnya, dan selama dua jam sehari, ini adalah yang lebih murah di antara keduanya untuk output.

Loop agen dengan prefiks stabil yang besar — jalankan perhitungan cache-hit sebelum memilih. Input cache-hit DeepSeek adalah $0,022 di luar jam sibuk, yaitu sepersembilan dari $0,20 milik GPT-6 Sol, tetapi itu juga baris yang dinaikkan DeepSeek dua belas kali lipat pada jam sibuk. Keunggulannya nyata dan bersyarat pada jamnya.

• Apa pun yang tunduk pada regulasi, atau apa pun yang Anda tidak dapat menanggung jika rutenya harus dialihkan — DeepSeek V4 Pro, di-host sendiri dari checkpoint MIT. Penarikan September adalah studi kasusnya, dan itu alasan yang lebih baik untuk menerima biaya tetap daripada perbandingan per token mana pun.

• Apa pun yang membutuhkan puncak rentang agentik — GPT-6 Sol. Dua belas poin indeks dan tiga puluh poin Terminal-Bench bukanlah selisih akibat pembulatan, dan angka yang dilaporkan vendor DeepSeek sendiri tidak menutup celah tersebut.

Tarif flat dan jadwal keduanya adalah rancangan penetapan harga yang jujur. Keduanya hanya menjawab pertanyaan yang berbeda: yang satu memberi tahu Anda berapa biaya satu token, yang lain memberi tahu Anda berapa biaya satu token saat Anda membutuhkannya.

Dibandingkan dalam artikel ini3

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari