Kartu hero yang dihasilkan berjudul 'GPT-6.1 Sol vs generasi GPT-6', dengan tajuk 'Satu generasi, biaya 48x', menampilkan empat tingkat bertumpuk yang diberi label GPT-6 Astra (Indeks 52,7, $3,26 per tugas), GPT-6.1 Sol (Indeks 51,8, $0,72 per tugas), GPT-6 Sol (Indeks 47,6, $1,05 per tugas), dan GPT-6 Luna (Indeks 38,1, $0,07 per tugas), dengan footer bertuliskan 'Figures: Artificial Analysis v4.3.2.' dan logo OrcaRouter di kanan bawah.
Engineering & Research

GPT-6.1 Sol vs Generasi GPT-6: Generasi Satu

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Vendor menambahkan nama keempat ke lini modelnya pada 29 September 2026 dan menyebutnya sebagai sebuah generasi, dan aritmetika dari jajaran modelnya adalah hal yang paling menarik darinya: GPT-6.1 Sol adalah seluruh generasi tersebut. GPT-6 Luna dan GPT-6 Sol, keduanya dirilis pada 22 September 2026, tidak berubah; GPT-6 Astra, sudah ada sejak 4 September 2026, tidak berubah; penyegaran 6.1 menyentuh tepat satu tier. Sementara itu, GPT-6.1 Sol, dengan biaya masuk $2,00 dan keluar $10,00 per juta token, mencetak 51,83 pada Artificial Analysis Intelligence Index dengan biaya $0,724 per tugas — dalam selisih 0,84 poin dari GPT-6 Astra, yang memakan biaya $3,2575 per tugas pada $10,00/$50,00. Generasi yang sama pada label, empat ekonomi berbeda di baliknya.

Itu menjadikan "haruskah saya menggunakan generasi GPT-6" sebagai pertanyaan yang salah. Jajarannya mencakup rentang 48× dalam biaya per tugas dan rentang 14,6 poin dalam kecerdasan terukur, dan jawabannya sepenuhnya bergantung pada tingkat mana yang Anda maksud. Inilah tanggaannya, yang diukur.

Empat anak tangga itu, sebagaimana diukur

A chart titled 'The GPT-6 ladder - measured', subtitle 'Artificial Analysis Intelligence Index, and the measured cost of one task', with four horizontal bars whose lengths are proportional to the Intelligence Index: GPT-6 Luna Index 38.1 / $0.068 per task, GPT-6 Sol Index 47.6 / $1.05 per task, GPT-6.1 Sol Index 51.8 / $0.72 per task, GPT-6 Astra Index 52.7 / $3.26 per task; footer 'Bar length is proportional to the Intelligence Index (0-60 scale). All figures: Artificial Analysis v4.3.2.' OrcaRouter logo bottom-right.

• GPT-6 Luna — Indeks 38,12, $0,10 / $0,50 per 1 juta, $0,01 di-cache, $0,0678 per tugas, 50.012 token keluaran, 100,1 dtk ke token pertama
• GPT-6 Sol — Indeks 47,63, $2,00 / $10,00, $0,20 di-cache, $1,045 per tugas, 31.000 token keluaran, 124,3 dtk
• GPT-6.1 Sol — Indeks 51,83, $2,00 / $10,00, $0,10 di-cache, $0,724 per tugas, 38.128 token keluaran, 332,0 dtk
• GPT-6 Astra — Indeks 52,67, $10,00 / $50,00, $1,00 di-cache, $3,2575 per tugas, 27.206 token keluaran, 400,4 dtk

Setiap dari mereka memiliki jendela konteks 1,050,000 token yang sama dan keluaran maksimum 128,000 token yang sama, dan setiapnya menerima masukan teks, gambar, dan berkas. Tingkatan-tingkatan itu tidak dibedakan berdasarkan penanda kemampuan. Mereka dibedakan oleh seberapa banyak pemikiran yang bersedia Anda bayar, dan kedua ujung tangga itu terpaut 48 kali per tugas.

Apa yang sebenarnya diubah oleh pembaruan 6.1

Tiga hal, dan hanya satu di antaranya adalah skor.

Skornya berubah: 47,63 menjadi 51,83, kenaikan 4,2 poin, dalam sepekan. Tarif input yang di-cache menjadi separuh, dari $0,20 menjadi $0,10 per juta, itulah sebabnya biaya terukur per tugas turun dari $1,045 menjadi $0,724 meskipun harga daftarnya identik — kartu tarif yang sama, tagihan yang berbeda. Dan jumlah token keluaran naik dari 31.000 menjadi 38.128 sementara waktu aktual per tugas berubah dari 321 detik menjadi 640, yang merupakan satu-satunya aspek di mana pembaruan ini justru mundur dan paling tidak terlihat di lembar spesifikasi mana pun.

Dibandingkan dengan Astra, perbandingan inilah yang mengejutkan banyak orang. GPT-6.1 Sol tertinggal 0,84 poin indeks dari model unggulan dan 4,5 kali lebih murah per tugas. Keunggulan Astra yang tersisa bukanlah skor indeksnya; melainkan rangkaian evaluasi yang hanya mengukur dirinya, dan satu kemampuan yang OpenAI gambarkan sebagai keunikannya — menemukan kerentanan keamanan baru, yang menjadi alasan model ini dinilai "critical" di bawah Preparedness Framework milik vendor itu sendiri dan pengaturan paling mampunya dibatasi hanya untuk mitra yang telah diverifikasi.

Kartu OrcaRouter untuk GPT-6 Astra adalah ujung unggulan dari tangga yang sama: $10.00 / $50.00, p50 1,64 detik ke token pertama, 40,7 juta token selama tujuh hari, dan jendela konteks 1.050.000 token yang sama yang dimiliki setiap tingkat.

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the $10.00 input and $50.00 output per-million prices, a 1.64 s p50 time to first token, 40.7M tokens over seven days, a 1,050,000-token context window and 128K max output with text/image/file input, above the OpenAI-compatible code sample.

Dibandingkan dengan 6.0 Sol, pembaruan ini hampir merupakan peningkatan murni — lebih banyak indeks, lebih sedikit biaya — dengan catatan bahwa model 6.1 adalah model yang berbeda dan bukan checkpoint, dan ia mengeluarkan kembali penalarannya dengan lebih bertele-tele. Dibandingkan dengan Luna, ini sama sekali bukan perbandingan: biaya 10,7 kali lipat untuk 13,7 poin indeks, yang merupakan pertukaran bagus untuk pekerjaan berat dan pertukaran yang buruk untuk pekerjaan bervolume tinggi.

Apa yang menurut data perutean kami sendiri sudah diputuskan pasar

Satu hal yang dimiliki perbandingan ini dan tidak dimiliki lembar spesifikasi adalah gambaran tentang penggunaan aktual. Selama tujuh hari yang berakhir pada 7 Oktober 2026 di lapisan perutean kami sendiri, GPT-6.1 Sol memproses 284,2 juta token dan GPT-6 Sol yang digantikannya memproses 950 ribu — perbedaan 300 kali lipat untuk dua model yang selisih usianya sepekan, yang merupakan gambaran penggantian tingkat dari dalam. GPT-6 Luna, tingkat murahnya, memproses 641,6 juta token, lebih banyak daripada gabungan kedua model Sol. GPT-6 Astra memproses 40,7 juta token.

Bacalah itu sebagai tiga perilaku yang terpisah. Pekerjaan bervolume tinggi mengalir ke tingkat murah dalam volume terbesar. Pekerjaan serius terkonsolidasi ke Sol terbaru dalam waktu seminggu setelah peluncurannya, meninggalkan model yang digantikannya. Dan produk unggulan tetap menjadi ceruk: tingkat paling mumpuni, paling jarang digunakan, oleh tim yang masalahnya hanya bisa dipecahkan olehnya. Jajaran produk ini bukan tangga yang dipanjat orang; ini adalah kumpulan alat yang orang pilih, dan mereka memilih berdasarkan tingkat, bukan berdasarkan generasi.

Itulah sebabnya tier seharusnya ada di dalam request, bukan di dalam arsitektur

Masalah praktis dengan generasi empat tingkatan adalah jawaban yang tepat berubah per tugas dan per minggu — seperti yang ditunjukkan angka-angka trafik di atas, pasar menentukan ulang dalam tujuh hari. Meng-hard-code satu nama model ke dalam aplikasi adalah hal yang mengubah jajaran pilihan menjadi komitmen.

Keempatnya dapat dijangkau melalui satu endpoint OrcaRouter: satu API untuk 200+ model dengan harga daftar penyedia diteruskan dengan markup 0%. Bagian terakhir itulah yang krusial di sini, khususnya karena tiga dari empat tier berbagi harga daftar atau tarif cache yang sudah pernah berubah sekali — tarif cache GPT-6.1 Sol menjadi setengah dalam waktu seminggu setelah peluncuran, dan meter pass-through-lah yang membuatnya otomatis masuk ke invoice Anda.

A screenshot of the OrcaRouter model page for openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128K max output, text/image/file input with text output, the $2.00 input and $10.00 output per-million prices, a 4.54 s p50 time to first token and 284.2M tokens routed over seven days, above the OpenAI-compatible code sample.

Ada dua fitur lapisan perutean yang layak disebutkan untuk jajaran khusus ini. DSL perutean memungkinkan tingkat menjadi parameter permintaan, bukan penerapan — tingkat murah untuk tahap ekstraksi, 6.1 Sol untuk tahap penalaran, Astra hanya untuk panggilan yang membutuhkan hal yang secara unik dilakukan Astra. Dan fusi model memungkinkan panel dari mereka menjawab satu pertanyaan bersama-sama, yang merupakan cara jujur untuk menggunakan model unggulan yang tidak mampu Anda arahkan untuk semuanya: model itu menjadi satu suara dalam panel, bukan seluruh tagihan.

Apa yang harus dilakukan dengan generasi yang hanya terdiri dari satu orang

Jangan beli generasinya. Beli satu jenjang, dan beli lagi saat jenjangnya bergeser.

Untuk pekerjaan bervolume tinggi dan sensitif terhadap latensi, GPT-6 Luna dengan $0.0678 per tugas dan 100 detik hingga token pertama adalah tingkat yang sudah menangani lalu lintas terbanyak, dan harganya satu orde besaran lebih rendah daripada apa pun di tangga tersebut. Untuk penalaran umum dan pengodean, GPT-6.1 Sol kini menjadi default seperti yang dulu dimiliki model 6.0 — harga daftar sama, indeks lebih baik, biaya cache setengahnya, dan waktu tugas 640 detik adalah satu hal yang perlu diuji terhadap beban kerja Anda sendiri sebelum Anda menganggap peningkatan ini gratis. Untuk tugas-tugas yang memerlukan pengukuran terdepan atau pekerjaan keamanan yang hanya dilakukan oleh model unggulan, GPT-6 Astra tetap menjadi satu-satunya tingkat yang melakukannya, dengan biaya 4,5 kali lipat dari tingkat di bawahnya.

Yang perlu dicermati adalah apakah penyegaran 6.1 itu menjangkau tier-tier lainnya. Jika Luna atau Astra mendapat perlakuan yang sama, bentuk tangga itu berubah, dan begitu pula aritmetika per tugas dalam artikel ini. Sampai saat itu, "GPT-6.1" hanya menamai satu model, dan memperlakukannya sebagai sebuah keluarga adalah cara tim berakhir membayar tarif flagship untuk ekstraksi.