
Solar Mini 4 vs Qwen3.8-Max: Berapa Sebenarnya Biaya dari Dua Puluh Poin Indeks Terakhir
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 per 1 juta token
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 per 1 juta token · 159 tok/s
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 220 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
Solar Mini 4 berbiaya $0,10 per juta token masukan dan $0,40 per juta token keluaran. Qwen3.8-Max, model yang dimaksud kebanyakan orang saat mereka mengetik "Qwen 3.8" dan meminta API-nya, berbiaya $2,00 dan $6,00. Pada kartu tarif, itu terbaca sebagai perbedaan dua puluh kali lipat pada harga masukan. Pada evaluasi independen yang kini telah dilalui kedua model, angka yang jujur adalah bahwa Qwen3.8-Max mencetak 45,4 pada Artificial Analysis Intelligence Index, sementara Solar Mini 4 mencetak 24,1 — sekitar dua kali lipat kemampuan yang terukur — tetapi biayanya sekitar lima belas kali lebih besar per tugas yang diselesaikan. Segala hal yang layak diketahui tentang pasangan ini ada pada celah antara kedua rasio tersebut, dan pada fakta bahwa model Upstage berjalan pada 204 token per detik sementara model unggulan Alibaba berjalan pada 39.
Satu catatan penamaan sebelum angka-angkanya, karena ini mengubah apa yang Anda beli. Qwen 3.8 adalah sebuah generasi, bukan model: model unggulan yang dihosting adalah Qwen3.8-Max, diperbarui sebagai snapshot bertanggal 0902, dan anggota generasi yang sama yang dapat diunduh adalah Qwen3.8-2.4T-A95B, bobot 2,4 triliun parameter yang Alibaba publikasikan pada 12 Agustus 2026. Solar Mini 4, yang dirilis 22 September 2026, adalah sparse mixture-of-experts 35 miliar parameter milik Upstage dengan sekitar 3 miliar parameter aktif per token dan tanpa bobot terbuka pada harga berapa pun.
Kedua kolom, pada dimensi yang menentukan pengadaan
• Intelligence Index — 45,4 untuk Qwen3.8-Max (0902) dibandingkan 24,1 untuk Solar Mini 4, keduanya Intelligence Index v4.3.2.
• Biaya per tugas yang diselesaikan — $5.41 untuk Qwen3.8-Max dibandingkan $0.36 untuk Solar Mini 4. Kira-kira lima belas banding satu, dan rasio yang tidak ada yang mengutipnya.
• Daftar harga — $2.00 / $6.00 per juta token, input cache $0.25, untuk Qwen3.8-Max dibandingkan $0.10 / $0.40, input cache $0.01, untuk Solar Mini 4.
• Konteks — 1.000.000 token pada keduanya, yang merupakan satu-satunya dimensi di mana model murah tidak kalah. Artificial Analysis mencantumkan 983.616 untuk Qwen3.8-Max dan 1.048.576 untuk Solar Mini 4; dokumentasi Upstage sendiri menyebutkan 512K, jadi batas maksimum model kecil adalah yang lebih tidak pasti di antara keduanya.
• Bobot — Qwen3.8-Max bersifat proprietary dan dihosting; saudara terbukanya, Qwen3.8-2.4T-A95B, dapat diunduh di bawah lisensi khusus dan mencetak skor 39,9 pada indeks yang sama dengan konteks 262.000 token. Solar Mini 4 bersifat proprietary tanpa saudara terbuka.
• Throughput — 204 token keluaran per detik untuk Solar Mini 4 dibandingkan 39,5 untuk Qwen3.8-Max, seperti yang diukur oleh lab yang sama. Model yang biayanya seperlima belas per tugas lima kali lebih cepat dalam mengerjakannya.
Apa yang bisa dibeli dengan dua puluh satu poin indeks

Mereka membeli ujung tersulit dari distribusi. Pada Humanity's Last Exam, Qwen3.8-Max menjawab benar 43,1% item, dibandingkan Solar Mini 4 yang 25,8%. Pada pengodean ilmiah, angkanya 52,1% berbanding 47,6%. Pada pekerjaan pengetahuan agentik, kesenjangannya melebar ke kategori yang berbeda: Qwen3.8-Max mencapai 1663 Elo pada GDPval-AA, sementara Solar Mini 4 hanya mencapai 1072 — hampir enam ratus poin Elo, yang bukan perbedaan pembulatan melainkan perubahan dalam hal apa yang dapat dipercaya untuk dilakukan model tanpa pengawasan.
Satu-satunya evaluasi di mana model kecil tidak hanya bertahan tetapi menang adalah penalaran konteks panjang. Solar Mini 4 mencetak 83,3% pada AA-LCR v1.1 dan Qwen3.8-Max mencetak 80,3%. Itulah argumen terkuat untuk Solar Mini 4 dalam seluruh perbandingan ini: pada tolok ukur yang dibuat untuk menguji "membaca dokumen yang sangat panjang dan bernalar di seluruh isinya," harga lima belas kali lipat per tugas menghasilkan hasil yang tiga poin lebih buruk.
Bidang di mana kedua model bukan instrumen yang tepat adalah kerja terminal otonom. Solar Mini 4 meraih skor 1% pada Terminal-Bench 4.0; Qwen3.8-Max meraih 38,9%. Model yang mampu menuntaskan delapan dari dua puluh tugas terminal sulit memang benar-benar dapat digunakan di sana, sedangkan model lainnya tidak — ini contoh paling jelas dalam perbandingan ini tentang kesenjangan dalam jenis, bukan dalam derajat.
Mengapa tagihan per tugas model unggulan jauh lebih buruk daripada yang disiratkan oleh harga tokennya
Qwen3.8-Max menghasilkan lebih banyak keluaran per tugas daripada Solar Mini 4 — 107.700 token berbanding 88.300 — dan menghasilkannya pada tarif $6,00 per juta, bukan $0,40. Itulah sebagian besar kesenjangannya, bahkan sebelum perilaku cache dipertimbangkan. Alibaba memang menawarkan tarif input-cache sebesar $0,25, yang merupakan diskon nyata dibandingkan harga inputnya $2,00, dan saudara terbuka dari keluarga ini, Qwen3.8-2.4T-A95B, adalah model sparse berparameter 2,4 triliun dengan sekitar 95 miliar parameter aktif, jadi setiap token yang dihasilkannya dihasilkan oleh mesin yang jauh lebih besar. Tidak ada satu pun dari itu yang merupakan kritik. Itulah alasan adanya pengganda per tugas sebesar lima belas kali lipat, dan alasan perbandingan harga per token antara kedua model ini menyesatkan di kedua arah.
Konsekuensi praktisnya: Solar Mini 4 bukanlah "Qwen 3.8 versi hemat." Ia adalah spesialis yang kebetulan murah, cepat, dan kuat tepat pada satu sumbu — dokumen panjang — dan lemah pada sumbu yang paling mahal jika salah, yakni keandalan agentik. Qwen3.8-Max adalah generalis yang keunggulannya muncul justru ketika jawaban yang salah menjadi mahal.
Menjalankan pasangan itu alih-alih memilih di antara keduanya
Ini adalah kasus yang tidak biasa dalam seri Solar Mini 4, di mana kedua sisi perbandingannya adalah rute yang benar-benar bisa kami jual kepada Anda. Qwen3.8-Max dan snapshot 0902-nya yang bertanggal berada di OrcaRouter dengan tarif resmi vendor sebesar $2.00 / $6.00, bersanding dengan Qwen3.8-Flash pada $0.15 / $0.47 dan Qwen3.8-27B pada $0.33 / $2.40 — tiga tingkat dari generasi yang sama, satu kunci, tanpa kontrak kedua, dan tanpa perubahan kode selain string model. Per 1 Oktober 2026, pengukuran playground kami sendiri menempatkan Qwen3.8-Max pada p50 2,5 detik dengan 87,7 token keluaran per detik selama tujuh hari terakhir; jendela waktu itu bergulir, jadi bacalah kartu model yang live ketimbang kalimat ini. Model Upstage tidak tersedia melalui kami, dan Solar Mini 4 harus diakses melalui API milik Upstage sendiri.

Apa yang dimungkinkan oleh hal itu adalah pembagian yang diperjuangkan perbandingan ini: kirim lalu lintas dokumen panjang, berbahasa Korea, dan ekstraksi terstruktur ke tempat yang murah, rutekan permintaan yang berat penalaran dan menggunakan alat ke model andalan, dan biarkan failover menutupi penyedia yang mengalami hari buruk. Di sinilah juga DSL perutean membuktikan nilainya — menggabungkan model menjadi satu panggilan berarti tahap pertama yang murah dan tahap verifikasi yang mahal dapat menjadi satu permintaan ke satu endpoint alih-alih dua integrasi yang harus dijaga tetap sinkron.
Versi singkatnya

Jika beban kerja Anda adalah konteks panjang, bentuk keluaran tetap, dan anggaran latensi yang dapat ditoleransi, Solar Mini 4 memberi Anda 83% hasil konteks panjang dengan seperlima belas biaya tugas dan throughput lima kali lipat, dan dua puluh satu poin indeks yang hilang tidak akan pernah muncul di dasbor Anda. Jika beban kerja Anda melibatkan alat, agen multi-langkah, atau pertanyaan yang jawaban salahnya penuh keyakinan lebih buruk daripada tidak ada jawaban, poin yang hilang itu adalah keseluruhan produknya dan Qwen3.8-Max sepadan dengan lima belas kali harganya. Setiap angka yang dikaitkan dengan Artificial Analysis di atas adalah pengukuran independen organisasi tersebut; penamaan dan tanggal rilis Qwen3.8 adalah milik Alibaba, dan angka penyajian OrcaRouter adalah pengukuran playground kami sendiri pada jendela tujuh hari bergulir.
Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
