Qwen3.8 Max

qwen/qwen3.8-max
NovoDestaque
VisãoFerramentasJSONRaciocínio
por Qwen · 2026-08-03

Qwen3.8-Max é o modelo principal mais recente da Alibaba na linha Qwen e seu nível de maior capacidade até o momento. A Alibaba o posiciona diretamente contra GPT-5.5, Claude Opus 4.7 e Gemini 3.1 Pro em seu próprio guia de migração, recomendando-o sempre que uma tarefa exigir o raciocínio mais forte disponível — análise complexa de múltiplas etapas, derivação lógica profunda e trabalho agêntico exigente. Ele é nativamente multimodal, listado pela Alibaba tanto em geração de texto quanto em compreensão de imagem/vídeo: aceita texto, imagens e vídeo e retorna texto, com uma janela de contexto de 1M tokens. A matriz oficial de capacidades confirma suporte total ao modo de pensamento, chamada de funções, ferramentas integradas e saídas estruturadas, tornando-o uma substituição completa para frameworks de agentes e pipelines de chamada de ferramentas. O Qwen3.8-Max é servido por três formatos de protocolo — compatível com OpenAI, compatível com Anthropic e DashScope nativo — em Pequim, Singapura, Tóquio, Frankfurt e Virgínia. O pensamento é ativado com o parâmetro enable_thinking (ou reasoning.effort na API Responses). É o nível premium da família: recorra a ele quando a precisão em problemas difíceis superar o custo, e desça para o Qwen3.7-Plus ou Qwen3.7-Flash para volume cotidiano.

ctx1M tokens
Entradatext + image + video
Saídatext
p50 TTFT5.03 s
ENTRADA$2.00/ 1M tokens
SAÍDA$6.00/ 1M tokens
p50 TTFT5.03 s7 d
p95 TTFT10.00 s7 d
TRÁFEGO52.8Mtokens / 7 d

Qwen3.8 Max é um modelo de linguagem multimodal de grande escala da família Qwen, disponível através do OrcaRouter com o id de modelo 'qwen/qwen3.8-max'. O provedor é qwen. Ele possui uma janela de…

O que é Qwen3.8 Max?

Para quem é o Qwen3.8 Max projetado?

Quais modalidades de entrada o Qwen3.8 Max suporta?

O que significa a janela de contexto de 1,000,000 de tokens?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preços

Entrada / 1M tokens$2.00
Saída / 1M tokens$6.00
Leitura de cache / 1M$0.250
Escrita de cache / 1M$2.50
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $32.00 · Com cache de prompt $25.88

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.003030

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
5.03 s
Velocidade de saída
53.7 tok/s
p95 TTFT
10.00 s
Taxa de erro
0.17%

Benchmarks públicos

Fonte: Design Arena

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News4 menções · 7 d4 a mais que na semana anterior

Comparativo

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Entrada $/M$2.00$0.86$0.17$0.12
Saída $/M$6.00$3.44$1.03$0.69
Contexto1.0M262K33K1.0M
Qualidade9/108/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa o Qwen3.8 Max?
$2.00 por 1M de tokens de entrada e $6.00 por 1M de tokens de saída, cobrado à taxa do provedor qwen com margem zero no OrcaRouter.
Qual é a janela de contexto do Qwen3.8 Max?
1.000.000 de tokens. A entrada pode incluir texto, imagem e vídeo até esse limite de tokens.
Quais são os pontos fortes do Qwen3.8 Max?
Os principais pontos fortes são o contexto de 1.000.000 de tokens e o suporte para entrada de texto, imagem e vídeo. Nenhuma pontuação de benchmark está listada, então verifique a qualidade em suas próprias tarefas.
Como o Qwen3.8 Max se compara a outros modelos?
Ele tem uma janela de contexto maior e entrada multimodal em comparação com muitos modelos menores ou somente de texto, mas também tem um preço por token mais alto. Sem pontuações de benchmark, compare testando no OrcaRouter.
Como o OrcaRouter lida com dados enviados para o Qwen3.8 Max?
A entrada do catálogo não descreve o tratamento de dados. Revise a política de privacidade do OrcaRouter e os termos do provedor qwen antes de enviar dados sensíveis.
Como faço para chamar o Qwen3.8 Max via uma API compatível com OpenAI?
Defina a URL base para https://api.orcarouter.ai/v1 e o ID do modelo para 'qwen/qwen3.8-max', e envie uma solicitação de chat completions com sua chave de API OrcaRouter.
O Qwen3.8 Max consegue processar vídeo?
Sim, o vídeo é listado como uma modalidade de entrada, junto com texto e imagem. O esquema exato para vídeo não é especificado na entrada do catálogo, então teste com o OrcaRouter.
O cache de entrada está disponível para o Qwen3.8 Max?
Caching não está listado para este modelo. Assuma que os tokens de entrada são cobrados a $2.00 por 1M de tokens. Verifique os metadados de uso da API para tokens em cache, se o provedor suportar.

Incorporar este selo

Qwen: Qwen3.8 Max$2.00/M in5029ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max no OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

Ficha do modelo como dados

GET /api/public/models/qwen/qwen3.8-maxAbrir
Legível por máquina:/llms.txt/llms-full.txt