Qwen3.8 Max

qwen/qwen3.8-max
NuovoIn evidenza
VisioneStrumentiJSONRagionamento
di Qwen · 2026-08-03

Qwen3.8-Max è il nuovo modello di punta di Alibaba nella linea Qwen e il suo livello di capacità più elevato fino ad oggi. Alibaba lo posiziona direttamente contro GPT-5.5, Claude Opus 4.7 e Gemini 3.1 Pro nella sua guida alla migrazione, raccomandandolo ogni volta che un'attività richiede il ragionamento più forte disponibile — analisi complesse multi-step, derivazione logica profonda e lavoro agentico impegnativo. È nativamente multimodale, elencato da Alibaba sia sotto la generazione di testo che la comprensione di immagini/video: accetta testo, immagini e video e restituisce testo, con una finestra di contesto di 1 milione di token. La matrice ufficiale delle capacità conferma il pieno supporto per la modalità di pensiero, il function calling, gli strumenti integrati e gli output strutturati, rendendolo un drop-in completo per framework di agenti e pipeline di tool calling. Qwen3.8-Max è servito attraverso tre formati wire — compatibile OpenAI, compatibile Anthropic e DashScope nativo — a Pechino, Singapore, Tokyo, Francoforte e Virginia. Il pensiero si attiva con il parametro enable_thinking (o reasoning.effort sull'API Responses). È il livello premium della famiglia: usalo quando la correttezza su problemi difficili supera il costo, e scendi a Qwen3.7-Plus o Qwen3.7-Flash per il volume quotidiano.

ctx1M token
Inputtext + image + video
Outputtext
p50 TTFT5.03 s
INGRESSO$2.00/ 1M token
USCITA$6.00/ 1M token
p50 TTFT5.03 s7 g
p95 TTFT10.00 s7 g
TRAFFICO52.8Mtoken / 7 g

Qwen3.8 Max è un modello linguistico di grandi dimensioni multimodale della famiglia Qwen, disponibile tramite OrcaRouter con l'ID del modello 'qwen/qwen3.8-max'. Il provider è qwen. Ha una finestra…

Che cos'è Qwen3.8 Max?

Per chi è progettato Qwen3.8 Max?

Quali modalità di input supporta Qwen3.8 Max?

Cosa significa la finestra di contesto da 1.000.000 di token?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Prezzi

Input / 1M token$2.00
Output / 1M token$6.00
Lettura cache / 1M$0.250
Scrittura cache / 1M$2.50
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $32.00 · Con cache dei prompt $25.88

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.003034

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
5.03 s
Velocità di output
53.7 tok/s
p95 TTFT
10.00 s
Tasso di errore
0.17%

Benchmark pubblici

Fonte: Design Arena

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News4 menzioni · 7 gg4 in più rispetto alla settimana scorsa

A confronto

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Input $/M$2.00$0.86$0.17$0.12
Output $/M$6.00$3.44$1.03$0.69
Contesto1.0M262K33K1.0M
Qualità9/108/108/108/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Quanto costa Qwen3.8 Max?
$2.00 per 1M token di input e $6.00 per 1M token di output, fatturati alla tariffa del provider qwen con zero ricarichi su OrcaRouter.
Qual è la finestra di contesto di Qwen3.8 Max?
1.000.000 di token. L'input può includere testo, immagini e video fino a tale limite di token.
Quali sono i punti di forza di Qwen3.8 Max?
I punti di forza principali sono il contesto da 1.000.000 di token e il supporto per input di testo, immagini e video. Non sono elencati punteggi benchmark, quindi verifica la qualità sui tuoi stessi task.
Come si confronta Qwen3.8 Max con altri modelli?
Ha una finestra di contesto più ampia e input multimodale rispetto a molti modelli più piccoli o solo testuali, ma ha anche un prezzo per token più elevato. Senza punteggi benchmark, confronta testando su OrcaRouter.
Come gestisce OrcaRouter i dati inviati a Qwen3.8 Max?
La voce di catalogo non descrive la gestione dei dati. Esamina l'informativa sulla privacy di OrcaRouter e i termini del provider qwen prima di inviare dati sensibili.
Come posso chiamare Qwen3.8 Max tramite un'API compatibile con OpenAI?
Imposta l'URL di base su https://api.orcarouter.ai/v1 e l'ID del modello su 'qwen/qwen3.8-max', poi invia una richiesta di chat completions con la tua chiave API OrcaRouter.
Qwen3.8 Max può elaborare video?
Sì, il video è elencato come modalità di input, insieme a testo e immagine. Lo schema esatto per il video non è specificato nella voce di catalogo, quindi prova con OrcaRouter.
È disponibile il caching dell'input per Qwen3.8 Max?
Il caching non è elencato per questo modello. Presumi che i token di input vengano fatturati a $2.00 per 1M di token. Controlla i metadati di utilizzo dell'API per i token in cache se il provider lo supporta.

Incorpora questo badge

Qwen: Qwen3.8 Max$2.00/M in5029ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max su OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

Scheda del modello come dati

GET /api/public/models/qwen/qwen3.8-maxApri
Leggibile dalle macchine:/llms.txt/llms-full.txt