qwen/qwen3-max-preview

qwen/qwen3-max-preview
StrumentiJSONRagionamento
di qwen

Qwen3 Max preview — anteprima chat proprietaria, contesto 256k, modalità pensiero + chiamata a funzioni.

ctx262K token
Output max65K
Inputtext
Outputtext
p50 TTFT10.00 s
INGRESSO$0.86/ 1M token
USCITA$3.44/ 1M token
p50 TTFT10.00 s7 g
p95 TTFT10.00 s7 g
TRAFFICO1.2Mtoken / 7 g

Qwen3-Max-Preview è un modello linguistico di grandi dimensioni solo testo della famiglia Qwen, sviluppato dal team Qwen di Alibaba Cloud. Attualmente è disponibile in stato di anteprima, il che…

Cos'è Qwen3-Max-Preview?

Chi dovrebbe usare questo modello?

Cosa lo distingue?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-max-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Prezzi

LivelloInput / 1M tokenOutput / 1M token
32K$0.861$3.441
128K$1.434$5.735
256K$2.151$8.602
Livello selezionato in base al numero di token di input di ogni richiesta

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $16.35

Stima basata sul prezzo di listino

Prezzi a livelli — questa stima usa le tariffe del livello base.

Stima di token e costo

Token di input: 17Costo per richiesta: $0.001735

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
10.00 s
Velocità di output
75.1 tok/s
p95 TTFT
10.00 s
Tasso di errore
24.1%

Benchmark pubblici

25.5
AA Coding
Migliore del 24% dei modelli confrontati
n. 104 su 137
19.4
AA Intelligence
Migliore del 17% dei modelli confrontati
n. 116 su 139
75.0
AA Math
Migliore del 68% dei modelli confrontati
n. 26 su 82
AIME 2025
75.0
GPQA Diamond
76.4
Humanity's Last Exam
10.1
IFBench
48.0
LiveCodeBench
65.1
Long-Context Recall
42.3
MMLU-Pro
83.8
SciCode
37.0
TerminalBench Hard
19.7
τ²-Bench
32.7
Fonte: artificialanalysis.ai

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News1 menzioni · 7 gg1 in più rispetto alla settimana scorsa

A confronto

qwen/qwen3-max-previewQwen3.8 MaxQwen3.8 Max (0902)Qwen3.5 397B A17B
Input $/M$0.86$2.00$2.00$0.17
Output $/M$3.44$6.00$6.00$1.03
Contesto262K1.0M1.0M33K
Qualità8/109/109/108/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per utilizzare qwen/qwen3-max-preview su OrcaRouter?
Il prezzo specifico per token per questo modello non è fornito nei fatti disponibili. Si prega di fare riferimento alla pagina dei prezzi di OrcaRouter o di contattare il loro team di vendita per le tariffe correnti.
Qual è la dimensione della finestra di contesto di Qwen3-Max-Preview?
Il modello supporta una finestra di contesto di 262.144 token.
Qual è la lunghezza massima dell'output?
Il modello può generare fino a 65,536 token in una singola risposta.
Quali sono i principali punti di forza del modello?
Combina una finestra di contesto estremamente grande (262K token) con un punteggio MMLU-Pro elevato (83.8) e un ampio limite di output, rendendolo potente per l'analisi di documenti lunghi e il ragionamento complesso.
Come si confronta questo modello con altri modelli Qwen?
Qwen3-Max-Preview è un'anteprima con una finestra di contesto più ampia rispetto ai precedenti modelli Qwen2.5. Rappresenta gli ultimi miglioramenti ma potrebbe essere meno stabile.
Il modello supporta input di immagini o audio?
No, è solo testo. Accetta solo input di testo e produce output di testo.
Come faccio a chiamare questo modello usando un'API compatibile con OpenAI?
Utilizza l'API di OrcaRouter su https://api.orcarouter.ai/v1 con il model id 'qwen/qwen3-max-preview'. L'API supporta i parametri standard di completamento chat di OpenAI.
Quali politiche di gestione dei dati si applicano?
La gestione dei dati segue i termini di servizio e l'informativa sulla privacy di OrcaRouter. I fatti forniti non dettagliano specifiche pratiche di conservazione o elaborazione dei dati; consultare la documentazione di OrcaRouter.
Questo modello è adatto per l'uso in produzione?
È una versione di anteprima, che potrebbe essere meno stabile di una versione di produzione. Valutala sul tuo carico di lavoro specifico prima di distribuirla in produzione.
Quali benchmark sono disponibili?
Viene fornito solo il punteggio MMLU-Pro di 83.8. Nessun altro risultato di benchmark fa parte dei fatti disponibili.

Incorpora questo badge

qwen/qwen3-max-preview$0.86/M in10000ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-max-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-max-preview.svg" alt="qwen/qwen3-max-preview su OrcaRouter" /> </a>
Markdown [![qwen/qwen3-max-preview](https://www.orcarouter.ai/embed/qwen/qwen3-max-preview.svg)](https://www.orcarouter.ai/models/qwen/qwen3-max-preview)

Scheda del modello come dati

GET /api/public/models/qwen/qwen3-max-previewApri
Leggibile dalle macchine:/llms.txt/llms-full.txt