Kartu hero yang dihasilkan, Sonnet 3.5 vs Qwen 4 Max, dengan subjudul satu model punya kartu, yang lain hanya punya nama, dengan tiga kartu bertuliskan Sonnet 3.5 2026-09-28, Qwen 4 Max diumumkan tanpa kartu, dan Qwen3.8 Max Qwen yang bisa Anda panggil dengan tarif $2.00 / $6.00, dengan footer bertuliskan Qwen 4 Max diumumkan pada 2026-09 tanpa harga, jendela konteks, bobot, atau skor.
Guides & Insights

Claude Sonnet 5.5 vs Qwen 4 Max: Satu Model Punya Kartu, yang Lain Punya Nama

Penulis

Magnus Corvin

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua bagian dari judul ini bukan jenis objek yang sama, dan itulah yang perlu diketahui pembaca.Claude Sonnet 5.5dirilis pada 28 September 2026: ia memiliki pengenal API, kartu tarif, jendela konteks, batas penghentian yang dipublikasikan, dan satu baris di papan peringkat independen. Q​wen 4 Maxdipratinjau di konferensi Yunqi di Hangzhou pada 22 September 2026 sebagai model unggulan dari lini Q​wen 4 empat model yang diumumkan — dan per hari ini ia tidak memiliki harga, tidak memiliki jendela konteks, tidak memiliki skor yang dipublikasikan, tidak memiliki kartu model, dan tidak memiliki halaman di Artificial Analysis untuk dibuka. Itu bukan skandal; begitulah cara sebuah tingkatan diumumkan. Tetapi itu mengubah seperti apa perbandingan yang berguna. Perbandingan yang layak dilakukan adalah antara Sonnet terbaru yang telah dirilis dan model Q​wen yang benar-benar dapat Anda panggil hari ini, yaitu Qwen3.8 Max — karena model itu memiliki kartu tarif, dan kartu tarifnya memberi pelajaran.

Apa yang sebenarnya Alibaba ajukan

Q​wen 4 Max ditampilkan sebagai nama dalam sebuah jajaran, bukan sebagai produk. Pratinjau konferensi memperkenalkan struktur tier keluarga Q​wen 4, dan tidak ada apa pun tentangnya yang sejak itu diubah menjadi spesifikasi yang bisa menjadi acuan perencanaan bagi pengembang: tidak ada harga per juta token, tidak ada ukuran jendela, tidak ada keluaran maksimum, tidak ada tabel benchmark, tidak ada repositori Hugging Face, tidak ada entri dalam daftar model milik vendor itu sendiri. Apakah ia dirilis sebagai tier API tertutup, sebagai bobot terbuka, atau dalam kedua bentuk itu, tidak dinyatakan di mana pun yang telah dipublikasikan vendor. Ketika sebuah tier masih sedini itu, satu-satunya hal jujur yang bisa dikatakan sebuah artikel tentang spesifikasinya adalah bahwa spesifikasi itu tidak ada — dan halaman mana pun yang menawarkan lembar spesifikasi Q​wen 4 Max saat ini sedang mencetak proyeksi.

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Qwen 4 Max, the scoreboard, with six matched rows. Claude Sonnet 5.5: released 2026-09-28, $2.00 input, $10.00 output, Intelligence Index 56, 1,000,000-token context window, closed weights. Qwen 4 Max: announced with no model card, input and output price not published, no score published, context window not published, weights not stated. A footer reads Qwen 4 Max was announced 2026-09-22 with no specification published; Claude Sonnet 5.5 figures per Artificial Analysis v4.3.2 and Anthropic.

Satu hal yang secara berguna ditetapkan oleh pengumuman ini adalah arah. Flagship terbaru Alibaba yang sudah dirilis, Qwen3.8 Max, diposisikan oleh panduan migrasi milik vendor itu sendiri untuk bersaing langsung dengan GPT-5.5, Claude Opus 4.7, dan Gemini 3.1 Pro, dan itulah tier yang sedang dibangun Qwen 4 Max untuk menggantikannya. Jadi sasaran penerusnya tetap terbaca meskipun angka-angkanya tidak, dan model yang harus dikalahkannya soal harga adalah model yang sudah dijual.

Qwen yang dapat Anda panggil hari ini, dengan harga yang bersaing melawan Sonnet baru

Qwen3.8 Max telah tersedia secara umum sejak 3 Agustus 2026. Ini adalah tier dengan kemampuan tertinggi Alibaba hingga saat ini: multimodal secara native dengan input teks, gambar, dan video serta output teks, jendela 1.000.000 token, mode berpikir, pemanggilan fungsi, alat bawaan, dan output terstruktur, yang dilayani melalui endpoint yang kompatibel dengan OpenAI, kompatibel dengan Anthropic, dan DashScope native. Alibaba memosisikannya untuk analisis multi-langkah dan pekerjaan agentik yang menuntut yang sama seperti yang vendor posisikan untuk Claude Sonnet 5.5, dan keduanya berada pada tarif utama yang hampir persis sama — di sinilah perbandingannya menjadi menarik.

• Harga input — Claude Sonnet 5.5 $2.00 per juta vs Qwen3.8 Max $2.00 per juta, identik

• Harga output — Claude Sonnet 5.5 $10,00 per juta vs Qwen3.8 Max $6,00 per juta

• Pembacaan cache — Claude Sonnet 5.5 $0.20 per juta vs Qwen3.8 Max $0.25 per juta

• Penulisan cache — Claude Sonnet 5.5 $2,50 per juta vs Qwen3.8 Max $2,50 per juta

• Konteks — Claude Sonnet 5.5 1.000.000 token vs Qwen3.8 Max 1.000.000 token pada lembar spesifikasi vendor; Artificial Analysis mencatat snapshot yang diukurnya sebesar 983.616

• Output maksimal — Claude Sonnet 5.5 128.000 sinkron, 300.000 pada Batches vs Qwen3.8 Max tidak dipublikasikan oleh vendor

{{1}}Modalitas masukan.{{/1}} {{2}}Claude Sonnet 5.5{{/2}} teks, gambar, dan file vs {{3}}Qwen 3.5 Max{{/3}} teks, gambar, dan file

Tarif input yang identik dan tarif output 40% lebih murah merupakan posisi harga yang benar-benar kuat, dan itulah alasan Qwen3.8 Max terus muncul dalam perbandingan melawan model-model terdepan. Lalu Anda melihat pengukuran independen dan keunggulannya justru bergeser ke tempat yang sama sekali berbeda.

Apa kata angka-angka independen tentang keunggulan harga

Kedua model berada pada Artificial Analysis Intelligence Index yang sama, revisi v4.3.2, dan keduanya telah diukur, bukan diperkirakan.

• Indeks Kecerdasan — Claude Sonnet 5.5 56 pada Max Effort vs Qwen3.8 Max 45 pada snapshot 2 September

• Biaya per tugas Index — Claude Sonnet 5.5 $7.60 vs Qwen3.8 Max $5.41

• Kecepatan output — Claude Sonnet 5.5 138,7 token/detik vs Qwen3.8 Max 38,2 token/detik

• Waktu hingga chunk pertama — Claude Sonnet 5.5 370.8 detik pada Max Effort vs Qwen3.8 Max 3.0 detik

• Token output yang dihasilkan di seluruh Index — Claude Sonnet 5.5 410M vs Qwen3.8 Max 190M, yang ditandai papan sebagai sangat verbose dibandingkan median 88M

• GPQA Diamond — Claude Sonnet 5.5 tidak dipublikasikan di papan peringkat saat ini vs Qwen3.8 Max 92,8%

• Humanity's Last Exam — Claude Sonnet 5.5 55,0% vs Qwen3.8 Max 43,1%

• Pengingatan konteks panjang — Claude Sonnet 5.5 82.7% vs Qwen3.8 Max 80.3%

Ada dua hal yang menonjol, dan keduanya bukan harga. Yang pertama adalah tarif output 40% lebih murah menyusut menjadi tugas 30% lebih murah setelah Anda memperhitungkan jumlah token — Qwen3.8 Max menghasilkan 190 juta token di seluruh indeks, dibandingkan Claude Sonnet 5.5 yang 410 juta, yang lebih ramping, tetapi tidak cukup ramping untuk mempertahankan selisih tarif penuh. Yang kedua adalah kecepatan, dan di sini arahnya berbalik tajam: Claude Sonnet 5.5 menghasilkan output 3,6 kali lebih cepat daripada Qwen3.8 Max, 138,7 token per detik berbanding 38,2. Pada generasi panjang, itu adalah perbedaan antara satu menit dan beberapa menit, dan itu bukan perbedaan yang bisa diperbaiki oleh diskon per token apa pun.

Angka token pertama justru mengarah sebaliknya dan layak disertai catatan yang dinyatakan secara gamblang. 370,8 detik adalah Claude Sonnet 5.5 pada Max Effort dengan fallback default, konfigurasi penalaran yang menghabiskan anggaran berpikir sangat besar sebelum menjawab; pemanggil yang mengonfigurasi effort lebih rendah mendapatkan token pertama dalam hitungan detik. Angka 3,0 detik Qwen3.8 Max diukur pada model yang perilaku berpikirnya berbeda. Perbandingan itu nyata, tetapi ini perbandingan konfigurasi, bukan perbandingan vendor.

Artificial Analysis model page for Qwen3.8 Max (0902), a proprietary model released September 2026, showing an Intelligence Index of 45, an output speed of 38.2 tokens per second, $2.00 per million input tokens and $6.00 per million output tokens, $5.41 per Intelligence Index task, 190M output tokens generated during the Index evaluation described as very verbose, and a 984k-token context window.

Di mana biaya migrasi Sonnet yang hilang bermuara

Satu perbedaan operasional tidak muncul di baris mana pun di atas dan lebih penting daripada selisih harga bagi siapa pun yang menjalankan kode. Claude Sonnet 5.5 mengubah enam perilaku dibandingkan dengan Claude Sonnet 5, dan lima di antaranya merusak integrasi yang ada: non-default temperature, top_p dan top_k sekarang mengembalikan 400; thinking: {"type": "disabled"} mengembalikan 400 dan harus menjadi between_tools dengan effort dibatasi pada low, medium, atau high; pemaksaan pilihan tool berupa "any" atau tool bernama ditolak, sehingga loop harus beralih ke auto dengan penggunaan tool yang ketat atau output terstruktur; computer_20251124 tool computer-use ditolak di Claude API dan Goo​gle Cloud; dan blok thinking sekarang terikat pada model dan akun yang menghasilkannya, sehingga penalaran terbawa dari Sonnet 5 tetapi tidak keluar ke keluarga lain. Perubahan keenam tidak menggagalkan apa pun dan karena itu mudah dikirim dalam keadaan rusak: teks di antara pemanggilan tool sekarang dikembalikan di dalam blok thinking, sehingga aplikasi streaming menjadi hening di antara pemanggilan sampai menetapkan nilai tampilan atau menonaktifkan thinking di awal.

Qwen3.8 Max tidak menuntut semua itu dari pemanggil Qwen — ini adalah endpoint yang kompatibel dengan OpenAI dengan cakupan sampling lengkap dan bentuk tool-calling standar — dan endpoint yang kompatibel dengan Anthropic hadir justru agar kode yang ditulis untuk Claude dapat diarahkan ke sana hanya dengan mengubah base-URL. Bagi tim yang sudah memakai Sonnet 5, beralih ke Sonnet 5.5 adalah pekerjaan migrasi sehari dengan daftar lima item yang perlu diperiksa; beralih ke Qwen3.8 Max adalah perubahan konfigurasi dengan rangkaian risiko yang berbeda, terutama seputar pergeseran perilaku, bukan bentuk API.

Menempatkan yang dapat dijangkau ke kunci yang sama

Pipeline yang realistis pada akhir September 2026 tidak memilih salah satu dari ini. Pipeline ini menjalankan model Claude untuk jalur agentic dan model Q​wen di mana input video atau harganya penting, dan biaya dari pengaturan itu biasanya dua kontrak, dua kunci, dua permukaan batas laju, dan dua tempat di mana permintaan bisa gagal. OrcaRouter merangkumnya menjadi satu endpoint Open​AI-compatible di lebih dari 200 model, dengan harga daftar penyedia diteruskan dan tanpa markup tambahan, sehingga perubahan tarif vendor di salah satu sisi berlaku di sini pada hari yang sama, bukan pada pembaruan berikutnya, ditambah failover otomatis antara penyedia hulu dan DSL perutean untuk menyusun panggilan dari beberapa model.

Qwen3.8 Max dapat dirutekan di sini hari ini sebagai qwen/qwen3.8-max dengan harga input $2.00 dan output $6.00 milik A​libaba untuk seluruh jendela 1.000.000 token, dan snapshot 2 September yang diukur oleh Artificial Analysis dapat dialamatkan sebagai qwen/qwen3.8-max-0902 ketika Anda memerlukan revisi persis yang digunakan saat skor diambil. Baik Q​wen 4 Max maupun tier Q​wen 4 lainnya tidak ada dalam katalog kami, dan tidak ada tier Q​wen 4 yang akan ada sampai A​libaba menerbitkan sesuatu untuk dirutekan. Claude Sonnet 5.5 juga tidak ada dalam katalog — usianya baru sehari, dan rute ke sana adalah API milik A​nthropic sendiri, dengan Claude Sonnet 5 tersedia di sini dengan tarif A​nthropic sebesar $2.00 dan $10.00 sebagai target failover untuk sementara ini. Qwen3.8 Max menangani 52,0 juta token lalu lintas per minggu melalui katalog ini dan Claude Sonnet 5 menangani 7,9 juta, yang merupakan versi praktis dari argumen di atas: tier Q​wen bukanlah cadangan hanya dalam nama.

OrcaRouter model page for qwen/qwen3.8-max, dated 2026-08-03, showing text, image and video input, a 1M-token context window, $2.00 input and $6.00 output per million tokens, a p50 time to first token of 2.27 s, and 52.0M tokens of recent traffic.

Aturan untuk tier yang diumumkan

Perlakukan tier yang diumumkan sebagai masukan penjadwalan, bukan opsi pengadaan. Qwen 4 Max layak dilacak karena memberi tahu Anda ke mana flagship Alibaba mengarah dan karena pada akhirnya akan menggantikan Qwen3.8 Max di puncak lini. Tidak layak untuk dijadikan dasar perencanaan, karena tidak ada yang bisa dijadikan dasar: tidak ada pengenal, tidak ada harga, tidak ada jendela konteks, tidak ada bobot, tidak ada skor terukur. Bukti yang akan membuatnya nyata bersifat spesifik dan mudah dikenali — entri di daftar model Alibaba sendiri, baris harga, jendela konteks yang dipublikasikan, repositori Hugging Face jika bobotnya terbuka, dan halaman di Artificial Analysis, karena model yang tidak pernah diukur oleh siapa pun bukanlah model yang bisa Anda bandingkan.

Sampai saat itu, keputusannya ada di antara dua model yang keduanya sudah ada. Jika pekerjaan Anda bersifat agentic, tujuh belas poin Index dan kecepatan output 3,6× adalah yang Anda beli, dan biaya per tugas Claude Sonnet 5.5 yang lebih tinggi adalah harga untuk itu. Jika pekerjaan Anda menerima input video, memerlukan endpoint native yang kompatibel dengan Anthro​pic pada tagihan Q​wen, atau sekadar tidak dapat membenarkan tarif output $10, Qwen3.8 Max sedang diskon saat ini dengan harga input yang sama, output 40% lebih murah, dan token pertama yang tiba dalam hitungan detik — dan catatan jujurnya adalah bahwa model ini akan terasa lambat begitu generasi dimulai, itulah trade-off yang dibeli oleh tarif yang lebih murah.