
Intern-S2-397B vs Qwen3.8-Max: Dua Andalan Tiongkok, Taruhan Ekonomi yang Berlawanan
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0240Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0340Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Kecerdasan69Koding
Intern-S2-397B dan Qwen3.8-Max adalah dua peluncuran unggulan Tiongkok yang paling berdampak pada awal September 2026, dan keduanya membuat taruhan ekonomi yang berlawanan. Intern-S2-397B, model multimodal ilmiah 403 miliar parameter yang dirilis tim InternLM Shanghai AI Laboratory di bawah Apache-2.0 pada 13 September, bertaruh bahwa bobot terbuka adalah cara untuk memenangkan beban kerja ilmiah dan agentik: tanpa harga per token, bobot tersedia di Hugging Face, dan perangkat keras Anda sendiri sebagai alat pengukurnya. Qwen3.8-Max, unggulan 2,4 triliun parameter milik Alibaba yang mulai tersedia umum (GA) pada 3 Agustus dan diperbarui pada 2 September, bertaruh pada API berbayar dengan harga $2,00 per juta token masukan dan $6,00 per juta token keluaran untuk konteks 1 juta token, dengan bobot terbuka yang hadir seminggu setelah GA dan skor Artificial Analysis independen yang sudah ada di papan skor. Pertarungan antara keduanya bukan tentang tolok ukur siapa yang menang, melainkan tentang taruhan mana — kepemilikan atau endpoint terukur — yang cocok dengan bentuk beban kerja Anda.
Dua flagship, dua taruhan
Qwen3.8-Max adalah tingkat kemampuan tertinggi milik Alibaba dalam lini Qwen, sebuah model sparse mixture-of-experts dengan total 2,4 triliun parameter dan sekitar 95 miliar parameter yang diaktifkan per token di 512 expert, dengan 10 expert aktif plus satu expert shared. Model ini memiliki jendela konteks 1M token (983.616 token saat thinking diaktifkan di API yang dihosting), batas output 131.072 token, input teks, gambar, dan video, serta disajikan melalui endpoint yang kompatibel dengan OpenAI. Langkah penetapan harga yang menjadi ciri khasnya adalah tarif tetap: $2,00 / $6,00 yang sama, baik prompt Anda 5.000 token maupun 900.000 token, dengan input yang di-cache dihargai lebih rendah — tanpa biaya tambahan konteks panjang, yang justru merupakan pengungkit yang masih dibebankan sebagian besar pesaing. Alibaba memposisikannya langsung melawan GPT-5.5, Claude Opus 4.7, dan Gemini 3.1 Pro dalam panduan migrasinya sendiri.
Intern-S2-397B adalah bentuk flagship yang berbeda. Ini adalah model mixture-of-experts dengan 60 lapisan dan 512 pakar (10 aktif per token), konteks penalaran teks 256K dan multimodal 64K, permukaan masukan berupa teks, gambar, dan deret waktu, serta paradigma pra-pelatihan yang membaca halaman mentah literatur ilmiah — gambar, tata letak, notasi simbolik, dan prosa — alih-alih mengurai teksnya terlebih dahulu. Pembelajaran penguatannya mencakup lebih dari dua puluh bidang ilmiah, dan model ini dilatih untuk kerja agen jangka panjang di lingkungan sandbox. Penetapan harganya bukanlah daftar tarif, melainkan ketiadaan daftar tarif: hosting sendiri bobot Apache-2.0, atau minta akses ke Intern API resmi.
• Harga — Intern-S2-397B: tidak ada daftar harga; self-host atau Intern API vs Qwen3.8-Max: $2.00 / $6.00 per 1 juta flat, input yang di-cache lebih rendah.
• Skala — Intern-S2-397B: total 403B, 512 pakar / 10 aktif vs Qwen3.8-Max: total 2,4T, 95B aktif, 512 pakar / 10 + 1 bersama.
• Konteks — Intern-S2-397B: teks 256K / multimodal 64K vs Qwen3.8-Max: 1 juta token, tarif tetap.
• Input — Intern-S2-397B: teks, gambar, deret waktu vs Qwen3.8-Max: teks, gambar, video.
• Bobot — Intern-S2-397B: Apache-2.0, terbuka pada hari rilis vs Qwen3.8-Max: lisensi khusus Qwen3.8-Max, dibuka 12 Agustus setelah GA.
• Skor independen — Intern-S2-397B: belum ada vs Qwen3.8-Max: AA Intelligence Index 40, GPQA Diamond 92,7.
Kedua tabel adalah tabel vendor, dan hanya satu yang memiliki wasit.
Kedua model diluncurkan dengan tabel benchmark yang dijalankan vendor, yang membuat disiplin sumbernya identik dan rekam jejaknya berbeda. Sejak itu, angka independen Qwen3.8-Max terus terakumulasi: Artificial Analysis menempatkannya di peringkat 40 pada Intelligence Index saat ini dengan GPQA Diamond 92,7, HLE 43,0, dan skor coding independen 71,8, dengan biaya sekitar $2,67 per tugas indeks pada skala saat ini. Itu adalah angka terukur dari pelacak pihak ketiga — wasit nyata pertama yang pernah dimiliki salah satu pun dari dua flagship ini.
Bukti Intern-S2-397B adalah kartunya sendiri, dijalankan melalui OpenCompass, VLMEvalKit, dan AgentCompass, diterbitkan bersama bobotnya: MMLU Pro 89.77, MMMU Pro 81.68, HMMT-2026 93.56, SWE-bench-Pro 68.54, dan TerminalBench 2.1 pada 64.04, angka yang kartunya sendiriunjukkan kalah dari generasi tertutup yang lebih tua. Baris-baris ilmiahnya adalah alasan kasus spesialis itu ada: Biology-Instructions 55.71, SciReasoner 1.5 63.28, Mol-Instructions 53.95, MolecularIQ 62.35. Semuanya milik InternLM sendiri, tidak direproduksi. Jika disandingkan, kedua basis bukti menceritakan kisah yang sama dari arah yang berlawanan: satu model adalah spesialis dengan baris umum yang terhormat dan tanpa pengukuran luar, yang lain adalah generalis dengan skor independen dan tanpa penyetelan ilmiah.

Apa yang sebenarnya dibeli oleh bentuk-bentuk uang
Tarif tetap $2 / $6 adalah jurus khas Qwen3.8-Max, dan ada baiknya diuraikan apa manfaatnya. Agen analisis repo yang memproses 200.000 token masukan konteks kode dalam satu panggilan membayar tarif per token yang sama seperti obrolan singkat — tanpa biaya tambahan untuk prompt panjang — dan dengan caching, konteks kode yang stabil menurunkan harga masukan efektif secara drastis pada lalu lintas berulang. Model ini juga dapat dipanggil sebagai open weights di bawah lisensi khusus Alibaba, yang mengizinkan penggunaan komersial dengan atribusi plus gerbang berbasis skala di atas 100 juta MAU atau pendapatan bulanan $20 juta, dan perjanjian terpisah untuk bisnis besar model-as-a-service.
Ekonomi Intern-S2-397B adalah kebalikannya: tidak ada meteran sama sekali, melainkan belanja modal. Bobotnya sekitar 807 GB dalam BF16 yang tersebar di 188 shard — sebuah node multi-GPU yang serius — dengan build FP8 yang memangkas jejaknya sekitar setengah. Jika Anda sudah memiliki kapasitas itu, biaya marginal untuk kueri ilmiah berikutnya mendekati biaya listrik, dan itulah taruhannya: kepemilikan membuat model spesialis menjadi murah secara marginal. Jika Anda tidak memiliki perangkat kerasnya, model "gratis" itu hanyalah uji coba, dan API Intern resmi adalah satu-satunya alternatif berbasis meteran.
Kedua model unggulan dapat berbagi satu titik integrasi jika Anda merutekannya. Qwen3.8-Max ada di OrcaRouter dengan harga daftar Alibaba yang diteruskan pada markup 0%, sehingga tarif tetap $2 / $6 dan setiap pemotongan harga di masa mendatang berlaku di sini pada hari yang sama. Intern-S2-397B tidak dirutekan — ini checkpoint yang benar-benar baru, dan jalur Anda untuk mengaksesnya adalah API milik vendor sendiri atau deployment yang di-host sendiri. Kirim lalu lintas umum, yang mendukung video, dan berkonteks panjang ke model berbayar sesuai pemakaian pada kunci yang sudah Anda miliki; pertahankan pekerjaan batch ilmiah pada model yang Anda jalankan; biarkan failover otomatis melindungi Anda saat endpoint salah satu pihak tidak sehat. Batasnya adalah aturan perutean, bukan integrasi kedua.

Putusan
Pilih Qwen3.8-Max untuk penalaran umum dan pekerjaan produksi yang mendukung video, ketika tarif tetap untuk satu juta token mengalahkan apa pun yang dibebankan para pesaingnya, dan ketika papan skor independen mengurangi risiko membangun di atasnya. Bobotnya cukup terbuka untuk relevan di bawah lisensi yang sudah dipatuhi sebagian besar tim, dan meterannya $2 / $6 adalah harga paling agresif di papan di antara para unggulan terdepan.
Pilih Intern-S2-397B untuk beban kerja ilmiah — makalah yang padat gambar, diagram molekuler, sinyal deret waktu — ketika inputnya bersifat multimodal dengan cara yang tidak pernah disetel untuk model generalis, dan ketika residensi data atau fine-tuning pada hasil proprietari menjadikan Apache-2.0 sebagai properti yang menentukan. Siapkan anggaran untuk perangkat keras, jalankan evaluasi Anda sendiri, dan perlakukan angka-angkanya sebagai klaim sampai muncul penilai independen.
Ringkasan jujurnya adalah bahwa dua produk unggulan ini sebenarnya bukan pengganti satu sama lain. Yang satu adalah instrumen ilmiah milik sendiri dengan kemampuan umum yang cukup terhormat; yang lain adalah generalis sewaan yang dinilai secara independen dengan tarif tetap dan minat sepintas pada sains. Tim yang membutuhkan keduanya harus memperlakukan batas ini sebagai keputusan perutean — dan harus menjalankan ulang evaluasi mereka sendiri pada Intern-S2-397B sebelum mempercayai angka apa pun di slide vendor mana pun.

