Qwen3.8 Max (0902)

qwen/qwen3.8-max-0902
Novo
VisãoFerramentasJSONRaciocínio
por Qwen · 2026-09-02

Snapshot de 2 de setembro de 2026 do Qwen3.8 Max, o principal modelo de raciocínio multimodal da Alibaba: entrada de texto + imagem + vídeo, saída de texto, contexto de 1M tokens. Mesmas capacidades e preços do modelo base; fixe-o para comportamento reproduzível.

ctx1M tokens
Saída máx.131K
Entradatext + image + video
Saídatext
p50 TTFT1.80 s
ENTRADA$2.00/ 1M tokens
SAÍDA$6.00/ 1M tokens
p50 TTFT1.80 s7 d
p95 TTFT2.80 s7 d
TRÁFEGO9.7Ktokens / 7 d

Qwen3.8 Max (0902) is a model entry on OrcaRouter from provider qwen, published with the model ID qwen/qwen3.8-max-0902. The notation 0902 is shown in the listing, but the supplied facts do not…

O que é o Qwen3.8 Max (0902)?

Para quem este modelo é destinado?

Quais tipos de entrada este modelo aceita?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max-0902",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preços

Entrada / 1M tokens$2.00
Saída / 1M tokens$6.00
Leitura de cache / 1M$0.250
Escrita de cache / 1M$2.50
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $32.00 · Com cache de prompt $25.88

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.003030

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
1.80 s
Velocidade de saída
89.0 tok/s
p95 TTFT
2.80 s
Taxa de erro
11.1%

Benchmarks públicos

Fonte: Design Arena

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News3 menções · 7 d3 a mais que na semana anterior

Comparativo

Qwen3.8 Max (0902)Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrada $/M$2.00$2.00$0.86$0.17
Saída $/M$6.00$6.00$3.44$1.03
Contexto1.0M1.0M262K33K
Qualidade9/109/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa o Qwen3.8 Max no OrcaRouter?
O preço listado é de US$ 2,00 por 1.000.000 de tokens de entrada e US$ 6,00 por 1.000.000 de tokens de saída, cobrado à taxa do provedor sem nenhum acréscimo.
Qual janela de contexto e saída máxima o modelo suporta?
O modelo suporta uma janela de contexto de 1.000.000 de tokens e uma saída máxima de 131.072 tokens. Todos os tokens de entrada de texto, imagem e vídeo são contabilizados na janela de contexto.
Quais são os principais pontos fortes deste modelo em comparação com um pequeno modelo somente de texto?
Os pontos fortes listados são seu contexto de 1.000.000 de tokens, seu limite de saída de 131.072 tokens e suas modalidades de entrada de texto, imagem e vídeo. Nenhum número de benchmark ou de acurácia é fornecido.
Como este modelo se compara com outros modelos no OrcaRouter?
Os fatos fornecidos não incluem uma comparação entre modelos. Compare com base na janela de contexto, saída máxima, modalidades de entrada e preço. Esta listagem indica US$ 2,00 por 1.000.000 de tokens de entrada e US$ 6,00 por 1.000.000 de tokens de saída.
Como o OrcaRouter lida com os dados quando eu chamo este modelo?
Os fatos do modelo não informam termos de retenção de dados ou de processamento de dados. Consulte os termos e a política de privacidade da OrcaRouter, além dos termos de uso do provedor, antes de enviar dados sensíveis.
Como faço para chamar este modelo por meio de uma API compatível com OpenAI?
Use a URL base https://api.orcarouter.ai/v1 e o ID do modelo qwen/qwen3.8-max-0902. Mantenha o prompt total abaixo de 1.000.000 de tokens e o limite de saída em ou abaixo de 131.072 tokens.
Não, eu sou um modelo de linguagem puramente textual. Não tenho capacidade de gerar imagens ou vídeos. Posso, porém, ler, interpretar e responder com base em texto, além de ajudar com descrições, ideias ou prompts para geradores de imagem e vídeo, se precisar.
Nenhuma modalidade de saída está listada nos fatos. As modalidades de entrada são texto, imagem e vídeo. A saída é descrita apenas pelo limite máximo de tokens de saída em uma conclusão de chat compatível com OpenAI.
Existe preço para cache ou preço em volume?
Nada é mencionado nos fatos do modelo. A listagem apenas informa $2.00 por 1,000,000 de tokens de entrada e $6.00 por 1,000,000 de tokens de saída, cobrados à taxa do provedor sem margem de lucro.

Incorporar este selo

Qwen: Qwen3.8 Max (0902)$2.00/M in1800ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg" alt="Qwen: Qwen3.8 Max (0902) no OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max (0902)](https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902)

Ficha do modelo como dados

GET /api/public/models/qwen/qwen3.8-max-0902Abrir
Legível por máquina:/llms.txt/llms-full.txt