Qwen3.8 Flash

qwen/qwen3.8-flash
BaruUnggulan
VisiAlatJSONPenalaran
oleh Qwen · 2026-08-26

Qwen3.8 Flash adalah model penalaran multimodal dari Alibaba. Model ini cocok untuk asisten pengodean, alur kerja agen, pemahaman visual, analisis dokumen dan basis kode, interaksi desktop, analisis grafik, serta analisis video panjang.

ctx1M token
Output maks131K
Masukantext + image + video
Keluarantext
p50 TTFT4.25 s
INPUT$0.15/ 1M token
OUTPUT$0.47/ 1M token
p50 TTFT4.25 s7h
p95 TTFT10.00 s7h
LALU LINTAS1.0Mtoken / 7h

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Harga

Input / 1M token$0.150
Output / 1M token$0.470
Baca cache / 1M$0.018
Tulis cache / 1M$0.230
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $2.46 · Dengan cache prompt $2.00

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000238

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
4.25 s
Kecepatan output
119 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
0%

Benchmark publik

Sumber: Design Arena

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News9 sebutan · 7 hrnaik 9 dari minggu lalu

Perbandingan

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Input $/M$0.15$2.00$0.86$0.17
Output $/M$0.47$6.00$3.44$1.03
Konteks1.0M1.0M262K33K
Kualitas7/109/108/108/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa harga Qwen: Qwen3.8 Flash di OrcaRouter?
Qwen: Qwen3.8 Flash dihargai $0.15 per 1M token input dan $0.47 per 1M token output melalui OrcaRouter. Harga ditarik langsung dari lapisan perutean.
Apa jendela konteks dari Qwen: Qwen3.8 Flash?
Qwen: Qwen3.8 Flash mendukung jendela konteks 1M token. Gunakan fitur konteks panjang (RAG, peringkasan) hingga batas tersebut.
Bagaimana cara memanggil Qwen: Qwen3.8 Flash melalui OpenAI SDK?
Atur base_url OpenAI menjadi https://api.orcarouter.ai/v1, berikan kunci API OrcaRouter Anda, dan teruskan model="qwen/qwen3.8-flash" dalam panggilan chat.completions.create.
Apakah OrcaRouter membatasi laju Qwen: Qwen3.8 Flash?
Batas kecepatan per model mengikuti paket OrcaRouter Anda. Tingkat gratis hadir dengan batas konservatif; tingkat berbayar menaikkannya. Periksa /pricing untuk kuota saat ini.

Sematkan lencana ini

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="Qwen: Qwen3.8 Flash di OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

Kartu model sebagai data

GET /api/public/models/qwen/qwen3.8-flashBuka