Kartu hero yang dihasilkan berjudul 'Dots vs Qwen 3.8 Max', dengan subjudul 'Perbedaannya terletak pada di mana Anda diizinkan memindahkannya'. Sebuah garis vertikal membagi kartu: panel kiri, berlabel 'Dots', berbunyi 'satu tempat untuk menjalankannya'; panel kanan, berlabel 'Qwen 3.8 Max', berbunyi 'tiga format wire - lima wilayah - $2.00 / $6.00'. Logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

Dots vs Qwen 3.8 Max: Perbedaannya Terletak pada Di Mana Kamu Diizinkan Memindahkannya

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Qwen 3.8 Max diterbitkan pada 3 Agustus 2026 dan merupakan tingkat kemampuan tertinggi Alibaba hingga saat ini: multimodal secara native, menerima teks, gambar, dan video serta mengembalikan teks, dalam jendela konteks 1.000.000 token, dilayani melalui tiga format protokol — kompatibel dengan OpenAI, kompatibel dengan Anthropic, dan DashScope native — dari Beijing, Singapura, Tokyo, Frankfurt, dan Virginia, dengan harga $2.00 per juta token input dan $6.00 per juta token output dengan pembacaan cache sebesar $0.25. Dots adalah agen yang selalu aktif milik perusahaan, diumumkan di DevDay pada 29 September 2026: ia mendapatkan komputer cloud dan browser sendiri, menjangkau lebih dari 4.000 aplikasi, berjalan di GPT-6 Astra, dan disertakan dengan Pro dan Business Premium. Jika disandingkan, pertanyaan yang menarik bukanlah mana yang lebih mampu. Pertanyaannya adalah di berapa banyak tempat masing-masing diizinkan berada, dan siapa yang memutuskan.

Itu bukan pembedaan yang abstrak. Itulah yang menentukan apakah sebuah alat sama sekali tersedia di pasar Anda, apakah alat itu dapat diaudit oleh tim kepatuhan Anda, dan apakah pekerjaan yang Anda bangun di atasnya bertahan saat terjadi perubahan ketentuan. Kapabilitas adalah bagian yang mudah dalam perbandingan ini; portabilitas adalah bagian yang baru diselesaikan terlambat dan dengan biaya mahal.

Tiga cara untuk memanggil satu model

Format wire terdengar seperti detail rekayasa kecil sampai Anda harus memindahkan aplikasi antar vendor. Permukaan yang kompatibel dengan OpenAI berarti pustaka klien yang ada berfungsi tanpa lapisan terjemahan. Yang kompatibel dengan Anthropic berarti basis kode yang ditulis terhadap bentuk pesan vendor lain tidak perlu ditulis ulang. Antarmuka native DashScope mengekspos seluruh set fitur, termasuk toggle thinking. Tiga permukaan untuk satu model berarti biaya beralih hanyalah base URL dan kunci, bukan refaktor.

Itu paling penting ketika ia tidak ada. Tidak ada apa pun tentang sebuah titik yang menawarkan format, URL, atau kunci, karena titik bukanlah sesuatu yang Anda panggil — ia adalah sesuatu yang Anda ajak bicara di dalam antarmuka orang lain. Memindahkan logika agen Anda ke tempat lain berarti membangunnya ulang, lalu menyambungkan kembali empat ribu konektor yang menjadi sandarannya, lalu menemukan mana di antaranya yang berperilaku dengan cara yang belum Anda tuliskan.

• Apa yang Anda beli — worker yang dihosting di dalam ChatGPT, Slack, dan Teams (Dots) dibandingkan dengan endpoint model yang dapat Anda panggil dari mana saja (Qwen 3.8 Max)

• Antarmuka — tidak ada yang dipublikasikan untuk sebuah titik, terhadap permukaan yang kompatibel dengan OpenAI, kompatibel dengan Anthropic, dan DashScope native (Qwen 3.8 Max)

• Di mana ia berjalan — komputer cloud OpenAI dengan browsernya sendiri (Dots) terhadap lima region yang dilayani di Asia, Eropa, dan Amerika Utara (Qwen 3.8 Max)

• Kontrol penalaran — tidak diekspos untuk satu titik, dibandingkan dengan enable_thinking toggle, atau reasoning.effort pada Responses API (Qwen 3.8 Max)

• Biaya per unit — dot pertama sudah termasuk dengan Pro atau Business Premium, kuota tidak dipublikasikan (Dots) versus $2.00 per juta input dan $6.00 per juta output, pembacaan cache $0.25 (Qwen 3.8 Max)

• Bukti independen — demo vendor dan pernyataan kemampuan, tidak ada benchmark setitik pun, dibandingkan dengan Artificial Analysis Intelligence Index sebesar 45,4 pada peringkat kelima belas dari 145 model yang diukur dan 92,8 pada GPQA Diamond (Qwen 3.8 Max)

Di mana model itu berakhir, dalam angka yang dapat Anda periksa

Profil yang dipublikasikan Qwen 3.8 Max adalah profil frontier-menengah, dan layak dibaca secara presisi, bukan secara impresionistik. AA Intelligence Index sebesar 45,4 yang menempatkannya di urutan kelima belas dari 145 model yang diukur menempatkannya dalam sepuluh persen teratas tanpa menempatkannya di puncak. AA Coding Index sebesar 76,2 di peringkat kesembilan dari 138 lebih kuat, dan 88,8 pada Terminal-Bench 2.1 adalah angka eksekusi agentik yang benar-benar tinggi — lebih tinggi daripada 88,0 milik GPT-5.6 Sol pada papan peringkat yang sama. Di mana ia relatif lebih lemah adalah daya ingat konteks panjang pada 80,3, yang berada di bawah 88,7 milik Kimi K3 dan 83 milik MiniMax M3 meskipun ukuran jendelanya sebanding, serta SciCode pada 52,1.

Positioning Alibaba sendiri, dalam panduan migrasinya, menempatkan model ini langsung berhadapan dengan GPT-5.5, Claude Opus 4.7, dan Gemini 3.1 Pro, dan pembacaan yang jujur atas angka-angkanya adalah bahwa ini adalah model yang Anda pilih ketika perpaduan antara eksekusi agentik yang kuat dan input multimodal lebih penting daripada menjadi yang pertama di papan peringkat kecerdasan. Semua angka tersebut adalah pengukuran pihak ketiga yang disertai sumbernya di katalog kami, bukan klaim vendor — itulah alasan nilainya lebih besar daripada dek peluncuran.

Satu angka tidak ada dan sebaiknya disebutkan secara eksplisit, bukan diisi: katalog kami tidak mencantumkan panjang keluaran maksimum untuk model ini. Konteks satu juta token didokumentasikan; batas maksimum keluaran per respons tidak.

A screenshot of the OrcaRouter model page for Qwen3.8 Max, showing the identifier 'qwen/qwen3.8-max' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-03, a description of it as Alibaba's newest flagship with a 1M-token context window served through OpenAI-compatible, Anthropic-compatible and native DashScope interfaces across multiple regions, a side panel reading 1M tokens of context over text, image and video input, and a price strip reading $2.00 and $6.00 with a p50 time to first token of 2.44 seconds.

Apa yang tidak diberitahukan Dots kepada Anda, dan mengapa itu merupakan pilihan desain

OpenAI telah menerbitkan satu kalimat tentang berapa biaya satu dot dan kalimat itu tidak memuat angka: dot pertama disertakan dengan Pro dan Business Premium, dengan batas yang diperluas pada bulan pertama dan tanpa pengurangan batas penggunaan ChatGPT untuk percakapan dengan dot itu. Selain itu, tidak ada angka jatah, tidak ada harga dot kedua, tidak ada tarif untuk kapasitas tambahan, dan tidak ada biaya per tugas. Tingkat Pro 500 seharga $500 per bulan adalah jatah penggunaan ditambah mode Ultrafast, bukan tarif per dot, sehingga bahkan paket termahal pun tidak dapat dikonversi menjadi biaya per unit pekerjaan agen.

Menggoda untuk membacanya sebagai celah dokumentasi. Lebih akurat membacanya sebagai kategori: produk yang dihargai per seat tidak dapat memiliki harga per unit, karena inti dari seat adalah bahwa biaya marginal untuk menggunakannya tidak terlihat. Itu benar-benar memudahkan untuk pekerjaan eksploratif dan benar-benar merepotkan untuk apa pun yang harus Anda atribusikan ke proyek, klien, atau pos anggaran.

Perhatikan untuk apa kedua produk ini dioptimalkan. Qwen 3.8 Max dioptimalkan untuk dipanggil dari mana saja, oleh apa saja, dalam format apa pun yang sudah digunakan pemanggilnya. Sedangkan dot dioptimalkan untuk digunakan di satu tempat, oleh satu antarmuka, dengan seluk-beluk teknisnya disembunyikan. Keduanya adalah desain yang koheren; keduanya hanya menjawab pertanyaan yang berbeda, dan salah satunya menjawab "bisakah saya memindahkan ini nanti" dengan tidak.

A generated scoreboard titled 'Dots vs Qwen 3.8 Max - reach and reversibility', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; interfaces none published; regions OpenAI's cloud computer; connectors 4,000+ apps; independent benchmark none. The right column, 'Qwen 3.8 Max', lists: context 1,000,000 tokens; input text, image, video; interfaces OpenAI-compatible, Anthropic-compatible, DashScope; regions five; price $2.00 in / $6.00 out per 1M; AA Intelligence Index 45.4, 15th of 145. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Qwen 3.8 Max figures from independent listings as carried in the OrcaRouter catalogue.'

Dua jawaban atas "bagaimana jika vendor ini berubah"

Pertanyaan tentang portabilitas menjadi konkret begitu vendor mengubah harga, mendeprekasi pengenal, atau mengubah cakupan langganan. Untuk model terukur dengan tiga format wire, responsnya bersifat mekanis: arahkan klien ke base URL yang berbeda, atau ubah satu string model, dan aplikasi tetap berjalan. Tidak ada hal lain yang perlu diporting karena model itu tidak pernah menjadi apa pun selain panggilan.

Bagi dot, respons terhadap perubahan ketentuan adalah berhenti. Komputer, peramban, konektor, dan jatah semuanya milik OpenAI, dan tak satu pun dapat diekspor. Itu bukan kritik terhadap produk; itu deskripsi jujur tentang menyewa. Tetapi itu berarti bahwa pekerjaan yang Anda bangun sepenuhnya di dalam dot memiliki jalur migrasi yang melewati penulisan ulang, dan itu adalah fakta yang layak diperhitungkan sebelum Anda membangun sesuatu yang ingin Anda andalkan selama setahun.

OrcaRouter dibangun untuk kasus pertama. Qwen 3.8 Max dirutekan sebagai qwen/qwen3.8-max pada harga daftar penyedia Alibaba yang diteruskan dengan markup 0%, dalam katalog yang sama dengan 200+ model lain di balik satu kunci, dengan failover otomatis antar penyedia hulu dan DSL perutean untuk menggabungkan beberapa model menjadi satu permintaan. Itulah yang membuat pertanyaan tiga wilayah dapat dijawab di sisi Anda alih-alih di sisi vendor: pengenal yang sama mencapai model di mana pun ia dilayani, dan perubahan tarif dari Alibaba masuk ke tagihan Anda pada hari yang sama alih-alih pada perpanjangan berikutnya. Yang tidak dijangkau adalah apa pun di dalam sebuah titik — tidak ada endpoint untuknya, tidak ada pengenal, dan tidak ada kecerdasan pengganti untuk ditukar masuk.

Pertanyaan yang perlu diajukan sebelum Anda berkomitmen

Tanyakan apa yang terjadi pada pekerjaan Anda pada hari ketika vendor mengubah sesuatu yang tidak dapat Anda kendalikan. Jika jawabannya adalah "kami mengubah satu string lalu lanjut", Anda sedang membeli sebuah model, dan yang diukur pemakaiannya adalah pembelian yang lebih baik. Jika jawabannya adalah "kami harus membangunnya ulang", Anda sedang membeli sebuah produk, dan Anda harus membelinya dengan sadar — menyadari bahwa kenyamanan yang Anda bayar itu dibayar dengan reversibilitas.

Tidak ada jawaban yang salah. Membeli portabilitas yang tak akan pernah Anda gunakan sama borosnya dengan membeli kenyamanan yang perlu Anda hindari. Kesalahannya adalah tidak tahu mana yang Anda beli.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards and credit top-up offers visible beneath.

Dibandingkan dalam artikel ini2

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari