Qwen3.8 Max (0902)

qwen/qwen3.8-max-0902
Nuovo
VisioneStrumentiJSONRagionamento
di Qwen · 2026-09-02

Snapshot datato 2 settembre 2026 di Qwen3.8 Max, il modello di ragionamento multimodale di punta di Alibaba: testo + immagine + video in ingresso, testo in uscita, contesto da 1M token. Stesse capacità e prezzi del modello base; fissalo per un comportamento riproducibile.

ctx1M token
Output max131K
Inputtext + image + video
Outputtext
p50 TTFT1.80 s
INGRESSO$2.00/ 1M token
USCITA$6.00/ 1M token
p50 TTFT1.80 s7 g
p95 TTFT2.80 s7 g
TRAFFICO9.7Ktoken / 7 g

Qwen3.8 Max (0902) è un modello elencato su OrcaRouter dal provider qwen, pubblicato con l'ID modello qwen/qwen3.8-max-0902. La notazione 0902 compare nell'elenco, ma le informazioni fornite non…

Cos'è Qwen3.8 Max (0902)?

A chi è destinato questo modello?

Quali tipi di input accetta questo modello?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max-0902",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Prezzi

Input / 1M token$2.00
Output / 1M token$6.00
Lettura cache / 1M$0.250
Scrittura cache / 1M$2.50
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $32.00 · Con cache dei prompt $25.88

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.003034

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
1.80 s
Velocità di output
89.0 tok/s
p95 TTFT
2.80 s
Tasso di errore
11.1%

Benchmark pubblici

Fonte: Design Arena

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News3 menzioni · 7 gg3 in più rispetto alla settimana scorsa

A confronto

Qwen3.8 Max (0902)Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Input $/M$2.00$2.00$0.86$0.17
Output $/M$6.00$6.00$3.44$1.03
Contesto1.0M1.0M262K33K
Qualità9/109/108/108/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Quanto costa Qwen3.8 Max su OrcaRouter?
Il prezzo indicato è di $2.00 per 1,000,000 di token di input e $6.00 per 1,000,000 di token di output, addebitato alla tariffa del fornitore senza alcun margine.
Quale finestra di contesto e output massimo supporta il modello?
Il modello supporta una finestra di contesto di 1.000.000 di token e un output massimo di 131.072 token. Tutti i token di input da testo, immagini e video vengono conteggiati nella finestra di contesto.
Quali sono i principali punti di forza di questo modello rispetto a un piccolo modello solo testuale?
I punti di forza elencati sono il suo contesto da 1.000.000 di token, il suo limite di output da 131.072 token e le sue modalità di input per testo, immagini e video. Non vengono forniti parametri di benchmark o di accuratezza.
Come si confronta questo modello con altri modelli su OrcaRouter?
I fatti forniti non includono un confronto modello-a-modello. Confronta per finestra di contesto, output massimo, modalità di input e prezzo. Questa scheda indica $2,00 per 1.000.000 di token di input e $6,00 per 1.000.000 di token di output.
Come gestisce OrcaRouter i dati quando chiamo questo modello?
I fatti del modello non dichiarano termini di conservazione o trattamento dei dati. Consultare i termini e l'informativa sulla privacy di OrcaRouter e i termini di utilizzo del fornitore prima di inviare dati sensibili.
Come faccio a chiamare questo modello tramite un'API compatibile con OpenAI?
Usa l'URL di base https://api.orcarouter.ai/v1 e l'ID del modello qwen/qwen3.8-max-0902. Mantieni il prompt totale sotto 1.000.000 di token e il limite di output non superiore a 131.072 token.
Questo modello genera immagini o video?
Nei dati non è elencata alcuna modalità di output. Le modalità di input sono testo, immagine e video. L'output è descritto solo dal limite massimo di token di output all'interno di un completamento chat compatibile con OpenAI.
Esiste un prezzo per la cache o un prezzo all'ingrosso?
Nelle informazioni sul modello non si fa menzione di nulla. La scheda indica solo $2,00 per 1.000.000 di token di input e $6,00 per 1.000.000 di token di output, fatturati alla tariffa del fornitore senza alcun ricarico.

Incorpora questo badge

Qwen: Qwen3.8 Max (0902)$2.00/M in1800ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg" alt="Qwen: Qwen3.8 Max (0902) su OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max (0902)](https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902)

Scheda del modello come dati

GET /api/public/models/qwen/qwen3.8-max-0902Apri
Leggibile dalle macchine:/llms.txt/llms-full.txt