
Mistral Large 4 vs GPT-6 Sol: Harga Pratinjau Berbanding Default yang Sudah Dirilis
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 143 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 293 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Di atas kertas, ini bukan pertarungan yang ketat. Mistral Large 4, model unggulan open-weight Mistral dengan 1,05 triliun parameter, dihargai $0,68 per juta token input dan $2,09 per juta token output. GPT-6 Sol, tier high-end yang hemat biaya, dihargai $2,00 dan $10,00 — sekitar tiga kali lipat untuk input dan hampir lima kali lipat untuk output, dan harganya berubah menjadi $4,00 dan $15,00 begitu sebuah permintaan melewati 272.000 token. Sebulan dengan 100 juta token pada rasio input/output 4:1 berbiaya sekitar $140 untuk Mistral Large 4 dan sekitar $480 untuk GPT-6 Sol. Itulah seluruh argumennya, dan itu argumen yang kuat, sampai Anda membaca baris kedua dokumentasi Mistral sendiri: Mistral Large 4 berada dalam pratinjau publik, dan itulah satu-satunya dari kedua model ini yang masih bergerak.
Perbedaan itulah keseluruhan perbandingannya. GPT-6 Sol dirilis pada 22 September 2026 dan stabil; perilakunya, daftar tarifnya, dan skor independennya sudah mapan. Mistral Large 4 hadir pada 6 Oktober 2026 dengan API pratinjau, janji rilis bobot "pada akhir bulan", dan proses reinforcement learning yang menurut Mistral masih berjalan. Versi yang Anda panggil hari ini bukan versi yang akan Anda miliki pada November. Jadi pertanyaan yang menarik bukanlah "mana yang lebih baik" — dalam hal kecerdasan terukur, keduanya belum berada di kelas yang sama — melainkan "mana yang cocok masuk ke stack Anda, dan dalam kondisi apa".
Apa yang sebenarnya dikirim oleh masing-masing vendor
Mistral Large 4 adalah model granular mixture-of-experts dengan 49 miliar parameter aktif dari total 1,05 triliun, plus encoder visi 1,6 miliar parameter. Model ini menerima teks dan gambar, melayani jendela konteks sekitar satu juta token, dan dilatih dari awal pada 3.800 GPU NVIDIA Grace Blackwell di pusat data Eropa milik Mistral sendiri. Mistral mendeskripsikannya sebagai model terbesar dan paling mumpuni hingga saat ini dan mengatakan bobotnya — dirilis di bawah lisensi terbuka — akan hadir sebelum akhir Oktober 2026, menunggu periode red-teaming yang dijalankan bersama mitra keamanan siber dan otoritas negara. Sementara itu, satu-satunya cara untuk mengaksesnya adalah API pratinjau.
GPT-6 Sol adalah tingkat menengah dari seri GPT-6 milik OpenAI, di bawah GPT-6 Astra yang menjadi unggulan dan di atas GPT-6 Luna yang cepat. Model ini menerima teks, gambar, dan file, memiliki jendela konteks sedikit di atas satu juta token dengan hingga 128.000 token keluaran, serta menyediakan upaya penalaran yang dapat dikonfigurasi, pemanggilan fungsi, keluaran terstruktur, dan pengambilan sampel dengan seed. Ini adalah API tertutup yang dimoderasi — kebalikan dari tawaran Mistral, yaitu bahwa suatu organisasi pada akhirnya dapat menjalankan ML4 di perangkat kerasnya sendiri berdasarkan kebijakannya sendiri.
• Total parameter — Mistral Large 4 1.05T (49B aktif) vs GPT-6 Sol tidak diungkapkan
• Jendela konteks — kira-kira 1 juta token masing-masing, Mistral Large 4 diiklankan sebesar 1 juta, GPT-6 Sol sekitar 1,05 juta
• Output maksimum — GPT-6 Sol 128K token vs Mistral Large 4 belum didokumentasikan
• Modalitas masukan — teks dan gambar Mistral Large 4 vs teks, gambar, dan berkas GPT-6 Sol
• Harga input — Mistral Large 4 $0.68 per 1 juta vs GPT-6 Sol $2.00, naik menjadi $4.00 setelah melewati 272K token
• Harga output — Mistral Large 4 $2.09 per 1 juta vs GPT-6 Sol $10.00, naik menjadi $15.00 setelah melewati ambang yang sama
• Input yang di-cache — Mistral Large 4 $0.07 per 1 juta vs GPT-6 Sol $0.20, naik menjadi $0.40
• Bobot — lisensi terbuka Mistral Large 4, dijanjikan pada akhir Oktober 2026 vs GPT-6 Sol tertutup
• Status rilis — Mistral Large 4 pratinjau publik, 6 Oktober 2026 vs GPT-6 Sol tersedia secara umum, 22 September 2026

Di mana GPT-6 Sol benar-benar unggul
Post peluncuran Mistral luar biasa terus terang soal ini, yang menghilangkan tebak-tebakan bagi semua orang. Pada Artificial Analysis Intelligence Index — revisi v4.3.2, sepuluh evaluasi dari AA-Briefcase hingga CritPt — GPT-6 Sol memperoleh skor 47.6 dan berada di sekitar peringkat ke-14 dari 147 model di papan tersebut. Mistral Large 4 sama sekali tidak memiliki skor Index yang dipublikasikan. Yang ada adalah baris parsial di Artificial Analysis, yang mencantumkan model itu sebagai "Mistral Large 4 Preview" dan melaporkan posisinya sebagai tidak tersedia untuk publik. Pada evaluasi individual yang terlihat, GPT-6 Sol unggul jelas: 47.9 terhadap ambang Humanity's Last Exam yang berhasil dilewatinya sementara ML4 tidak muncul, 83.7 berbanding 80.3 pada daya ingat konteks panjang AA-LCR, 43.9 berbanding 28.3 pada Terminal-Bench 4.0.
Angka-angka Terminal-Bench itu pantas diberi catatan yang justru berlawanan arah. 28,3% milik Mistral dan 59,4% pada SWE-Atlas-QnA berasal dari angka yang dievaluasi Artificial Analysis secara privat sebelum peluncuran harness, dan Mistral secara eksplisit menyatakan bahwa angka-angka itu akan muncul di Artificial Analysis Coding Agent Index saat harness tersebut dirilis. Angka-angka itu bukan buatan vendor, tetapi juga tidak dapat Anda reproduksi hari ini. Anggap saja angka-angka itu menjanjikan dan belum terverifikasi.
Ketika Mistral memang memublikasikan angka, beberapa di antaranya layak dibaca dengan saksama karena itu jenis klaim yang dibuat vendor saat mereka percaya diri. Mistral melaporkan bahwa pada salah satu tes Artificial Analysis Cyber Index — mereproduksi kerentanan nyata dalam perangkat lunak sumber terbuka, lalu menambalnya — ML4 mendapat skor 82%, tertinggi di antara model mana pun, dan bahwa ML4 menyelesaikan 93% dari 40 tantangan di Cybench. Mistral juga melaporkan bahwa model-model tertutup terkemuka termasuk Claude Opus 5.5 dan GPT-6 Astra mendapat skor mendekati nol pada tes reproduksibilitas yang sama karena mereka menolak tugas itu. Itu semua dilaporkan vendor dan belum direproduksi secara independen, tetapi mekanisme dasarnya tidak eksotis: model yang lebih sering menolak sebenarnya lebih sedikit menyelesaikan, dan Mistral telah menjual argumen itu sejak peralihannya ke open-weights.
Secara kemampuan umum, penilaian yang jujur adalah bahwa GPT-6 Sol adalah model yang lebih baik saat ini dan Mistral Large 4 adalah yang lebih murah. Jika beban kerja Anda adalah tugas tanya jawab atau pengkodean langsung tanpa preferensi untuk self-hosting, tambahan lima dolar per juta token keluaran untuk GPT-6 Sol membelikan Anda model yang perilakunya tidak akan berubah di bawah Anda.
Argumen untuk pratinjau, yang bukan sekadar harga
Tiga hal membuat Mistral Large 4 lebih dari sekadar opsi diskon, dan tak satu pun darinya adalah label harganya.
Yang pertama adalah kedaulatan dalam arti harfiah. ML4 dilatih di pusat data Eropa dengan perangkat keras Eropa dan akan dapat dilayani di wilayah Eropa yang dioperasikan Mistral secara end to end. Bagi pembeli yang teregulasi, itu bukan sekadar kalimat pemasaran; itu adalah persyaratan pengadaan yang saat ini tidak dapat dipenuhi GPT-6 Sol dengan harga berapa pun. Mistral mengumpulkan €3 miliar dalam Seri D khusus untuk mendanai ini, putaran ekuitas terbesar yang pernah dihimpun oleh perusahaan teknologi Eropa, dan model ini adalah tonggak pertama untuk tujuan tersebut.
Yang kedua adalah bobotnya. Saat bobot itu hadir, organisasi yang memiliki GPU dapat menjalankan ML4 secara on-premise tanpa melibatkan penyedia, yang mengubah perilaku penolakan sekaligus aspek residensi datanya. GPT-6 Sol akan tetap menjadi panggilan API saat itu terjadi. Jika peta jalan Anda memiliki fase on-premise, ML4 adalah satu-satunya dari keduanya yang memilikinya.
Yang ketiga adalah irama. Mistral mengatakan bahwa proses RL di balik pratinjau ini belum mencapai titik jenuh dan bahwa pihaknya memperkirakan "peningkatan yang besar dan cepat dalam beberapa minggu dan bulan mendatang". Ketika vendor merilis pratinjau dan menyatakan bahwa kurvanya masih menanjak, harga yang dikutip untuk Anda hari ini melekat pada versi model terburuk yang akan pernah ditagihkan kepada Anda. Harga GPT-6 Sol melekat pada kemampuan yang tetap.
Menjalankan keduanya tanpa memihak salah satunya

Bagian yang canggung dari sebuah pratinjau adalah Anda tidak dapat menyematkannya. Jika produk Anda bergantung pada perilaku ML4 saat ini, pembaruan minggu depan menjadi insiden produksi. Jika produk Anda bergantung pada GPT-6 Sol, Anda membayar premi tetap demi stabilitas. Bentuk yang masuk akal biasanya adalah keduanya, di balik satu endpoint, sehingga keputusannya menjadi aturan perutean dan bukan arsitektur.
Itulah gunanya OrcaRouter. Kedua model berada di balik satu API yang kompatibel dengan OpenAI dengan markup 0%, yang di sini lebih penting daripada biasanya: harga pratinjau Mistral adalah tarif peluncuran dan akan berubah — naik saat masa pratinjau berakhir, mungkin turun saat bobotnya dirilis dan persaingan pada model terbuka mulai terasa — dan karena harga list penyedia diteruskan langsung apa adanya, pemotongan harga vendor langsung berlaku di sisi kami pada hari yang sama, bukan menunggu kapan pun seseorang memperbarui tabel yang di-hardcode. DSL routing memungkinkan Anda mengirim pekerjaan dokumen berkonteks panjang ke model mana pun yang paling murah untuk bentuk tersebut, dan menjaga GPT-6 Sol sebagai fallback untuk apa pun yang harus stabil. Failover otomatis menangani kasus yang paling sering dipicu oleh API pratinjau: endpoint sibuk atau sempat tidak tersedia, yang wajar untuk model apa pun pada bulan pertamanya.

Mana yang harus dipilih
Pilih GPT-6 Sol jika beban kerjanya bersifat produksi, perilakunya lebih penting daripada harga per unit, dan Anda tidak memiliki persyaratan untuk menjalankan model itu sendiri. Nilai 47.6 pada Intelligence Index, batas keluaran 128K, dan pembacaan cache sebesar $0.20 menjadikannya opsi bawaan yang lebih aman, dan penyesuaian harga untuk konteks panjang pada 272.000 token mudah direncanakan karena ambang batasnya dipublikasikan.
Pilih Mistral Large 4 jika Anda sedang membangun sesuatu yang memenuhi salah satu dari tiga hal ini: Anda memerlukan model yang diterapkan di Eropa, Anda memerlukan open weights pada akhirnya, atau Anda bergerak di bidang riset keamanan tempat penolakan adalah kegagalan — 82% pada tes reproduce-and-patch dibandingkan hampir nol untuk alternatif tertutup adalah kesenjangan kemampuan yang nyata, baik dilaporkan vendor maupun tidak. Dan terimalah bahwa Anda membeli model yang masih dalam proses pengembangan. Perhitungkan bahwa permukaan API akan berubah, dan jangan meng-hard-code harga pratinjau ke dalam perkiraan untuk kuartal berikutnya.
Hal yang perlu diperhatikan sebelum menentukan pilihan ke salah satu arah: perilisan bobot yang sebenarnya pada akhir Oktober, momen ketika klaim open-weights berhenti menjadi sekadar janji; skor Artificial Analysis Intelligence Index pertama yang dipublikasikan untuk ML4, yang akan menentukan apakah selisih harga itu penawaran yang menguntungkan atau diskon untuk mendapatkan lebih sedikit; dan Coding Agent Index, tempat angka Terminal-Bench privat Mistral akan terbukti benar atau justru diam-diam tidak.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
