Qwen3.8 Max

qwen/qwen3.8-max
BaruUnggulan
VisiAlatJSONPenalaran
oleh Qwen · 2026-08-03

Qwen3.8-Max adalah model unggulan terbaru Alibaba dalam lini Qwen dan tingkat kapabilitas tertingginya sejauh ini. Alibaba memposisikannya langsung melawan GPT-5.5, Claude Opus 4.7, dan Gemini 3.1 Pro dalam panduan migrasinya sendiri, merekomendasikannya setiap kali suatu tugas membutuhkan penalaran terkuat yang tersedia — analisis multi-langkah yang kompleks, penurunan logika yang mendalam, dan pekerjaan agen yang menuntut. Model ini multimodal secara native, terdaftar oleh Alibaba di bawah generasi teks dan pemahaman gambar/video: ia menerima teks, gambar, dan video serta mengembalikan teks, dengan jendela konteks 1M-token. Matriks kapabilitas resmi mengonfirmasi dukungan penuh untuk mode berpikir, pemanggilan fungsi, alat bawaan, dan keluaran terstruktur, menjadikannya pengganti langsung yang lengkap untuk kerangka kerja agen dan pipeline pemanggilan alat. Qwen3.8-Max dilayani melalui tiga format wire — kompatibel OpenAI, kompatibel Anthropic, dan DashScope native — di Beijing, Singapura, Tokyo, Frankfurt, dan Virginia. Mode berpikir diaktifkan dengan parameter enable_thinking (atau reasoning.effort pada Responses API). Ini adalah tingkat premium dari keluarga ini: gunakan ketika kebenaran pada masalah sulit lebih penting daripada biaya, dan beralih ke Qwen3.7-Plus atau Qwen3.7-Flash untuk volume sehari-hari.

ctx1M token
Masukantext + image + video
Keluarantext
p50 TTFT5.03 s
INPUT$2.00/ 1M token
OUTPUT$6.00/ 1M token
p50 TTFT5.03 s7h
p95 TTFT10.00 s7h
LALU LINTAS52.8Mtoken / 7h

Qwen3.8 Max adalah model bahasa besar multimodal dari keluarga Qwen, tersedia melalui OrcaRouter dengan id model 'qwen/qwen3.8-max'. Penyedianya adalah qwen. Model ini memiliki jendela konteks…

Apa itu Qwen3.8 Max?

Untuk siapa Qwen3.8 Max dirancang?

Modalitas input apa yang didukung oleh Qwen3.8 Max?

Apa arti jendela konteks 1,000,000 token?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Harga

Input / 1M token$2.00
Output / 1M token$6.00
Baca cache / 1M$0.250
Tulis cache / 1M$2.50
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $32.00 · Dengan cache prompt $25.88

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.003034

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
5.03 s
Kecepatan output
53.7 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
0.17%

Benchmark publik

Sumber: Design Arena

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News4 sebutan · 7 hrnaik 4 dari minggu lalu

Perbandingan

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Input $/M$2.00$0.86$0.17$0.12
Output $/M$6.00$3.44$1.03$0.69
Konteks1.0M262K33K1.0M
Kualitas9/108/108/108/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa harga Qwen3.8 Max?
$2.00 per 1M token input dan $6.00 per 1M token output, ditagih dengan tarif penyedia qwen dengan markup nol di OrcaRouter.
Berapa ukuran jendela konteks dari Qwen3.8 Max?
1,000,000 token. Input dapat mencakup konten teks, gambar, dan video hingga batas token tersebut.
Apa saja kelebihan Qwen3.8 Max?
Kekuatan utamanya adalah konteks 1,000,000 token dan dukungan untuk input teks, gambar, dan video. Tidak ada skor tolok ukur yang tercantum, jadi verifikasi kualitasnya pada tugas-tugas Anda sendiri.
Bagaimana Qwen3.8 Max dibandingkan dengan model-model lainnya?
Model ini memiliki jendela konteks yang lebih besar dan input multimodal dibandingkan banyak model yang lebih kecil atau hanya teks, tetapi juga memiliki harga token yang lebih tinggi. Tanpa skor benchmark, bandingkan dengan mengujinya pada OrcaRouter.
Bagaimana OrcaRouter menangani data yang dikirim ke Qwen3.8 Max?
Entri katalog tidak menjelaskan penanganan data. Tinjau kebijakan privasi OrcaRouter dan ketentuan penyedia qwen sebelum mengirim data sensitif.
Bagaimana cara memanggil Qwen3.8 Max melalui API yang kompatibel dengan OpenAI?
Setel URL dasar ke https://api.orcarouter.ai/v1 dan ID model ke 'qwen/qwen3.8-max', lalu kirim permintaan chat completions dengan kunci API OrcaRouter Anda.
Bisakah Qwen3.8 Max memproses video?
Ya, video tercantum sebagai modalitas input, bersama dengan teks dan gambar. Skema yang tepat untuk video tidak ditentukan dalam entri katalog, jadi uji dengan OrcaRouter.
Apakah caching input tersedia untuk Qwen3.8 Max?
Caching tidak tercantum untuk model ini. Asumsikan token input ditagih sebesar $2,00 per 1 juta token. Periksa metadata penggunaan API untuk token yang di-cache jika penyedia mendukungnya.

Sematkan lencana ini

Qwen: Qwen3.8 Max$2.00/M in5029ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max di OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

Kartu model sebagai data

GET /api/public/models/qwen/qwen3.8-maxBuka