
Qwen 4 Max vs Claude Opus 5: o benchmark que se moveu sob ambos
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max foi apresentado em prévia na conferência Yunqi em Hangzhou, em 22 de setembro de 2026 — o nível de ponta de uma linha Qwen 4 de quatro modelos que foi anunciada e ainda não lançada, sem preço, sem janela de contexto e sem pontuação publicada. O Claude Opus 5 está disponível de forma geral desde 24 de julho de 2026, a US$ 5,00 por milhão de tokens de entrada e US$ 25,00 por milhão de tokens de saída, e tem sido o alvo em que todos os modelos de ponta desde o lançamento do Qwen3.8-Max têm mirado. A forma óbvia de escrever esta comparação é uma ficha técnica com uma coluna em branco. A forma útil é notar que, em 19 de setembro de 2026, três dias antes do anúncio, a Artificial Analysis recalculou seu Intelligence Index, e o Claude Opus 5 deixou de ser o modelo no topo dele. Essa única mudança reformula o que o Qwen 4 Max precisa superar.
O que mudou em 19 de setembro
A Artificial Analysis publicou a revisão v4.3.2 do índice em 19 de setembro de 2026. Na revisão atual, Claude Opus 5 pontua 51 no Intelligence Index em seu esforço máximo de raciocínio — 50 em xhigh, 48 em high, 45 em medium e 39 em low — e fica atrás de Claude Fable 5.1 e GPT-6 Astra, ambos com 53. O custo por tarefa nesse índice é US$ 5,86.
Se isso soa como um rebaixamento, não é. O modelo não mudou. O índice mudou. A nossa própria cobertura de julho e agosto citava Claude Opus 5 com 61 a 63 e no topo da tabela, e esses números estavam corretos segundo as revisões em vigor na época. Quem ainda os cita sem uma data de revisão está a citar um número retirado, e este é o erro mais comum em comparações escritas este mês. A consequência prática é que uma afirmação como "Claude Opus 5 é o modelo disponível com a pontuação mais alta" já não é verdadeira, e uma comparação baseada nela desmorona.
Do lado do Qwen, a consequência é ainda mais acentuada. Um nível flagship anunciado em setembro de 2026 está a ser apontado para um alvo que foi redefinido em setembro de 2026. Tudo o que a Alibaba vier a publicar para o Qwen 4 Max será lido à luz de uma tabela de classificação onde 53 é o número a bater, e não 63.

A comparação, dita honestamente
Um lado desta tabela está completo e o outro lado está vazio, e fingir o contrário seria exatamente o modo de falha deste artigo. Eis o que de fato se sabe:
• Status — Claude Opus 5 disponível em geral desde 24 de julho de 2026, em comparação com o Qwen 4 Max, anunciado em 22 de setembro de 2026, sem data de lançamento
• Preço de entrada — Claude Opus 5: US$ 5,00 por 1 milhão de tokens, versus Qwen 4 Max não divulgado
• Preço de saída — Claude Opus 5: $25,00 por 1 milhão de tokens, enquanto o do Qwen 4 Max não foi divulgado
• Entrada em cache — Claude Opus 5 $0,50 por 1M de tokens em uma leitura de cache, versus Qwen 4 Max não publicado
• Contexto — Claude Opus 5 1M tokens no padrão e no máximo, versus Qwen 4 Max não publicado
• Teto de saída — Claude Opus 5 com 128K tokens de forma síncrona e 300K na Batches API com um cabeçalho beta, em comparação com o Qwen 4 Max, que não divulga esse dado
• Modalidade — Claude Opus 5 entrada de texto, imagem e arquivo com saída de texto, versus Qwen 4 Max não publicado
• Preços para contextos longos — Claude Opus 5 não tem sobretaxa, então uma solicitação de 900.000 tokens é cobrada à mesma taxa por token que uma de 9.000 tokens, em comparação com o Qwen 4 Max, cujo preço não foi publicado
• Pontuação independente — Claude Opus 5: 51 no Artificial Analysis Intelligence Index v4.3.2 com esforço máximo, contra Qwen 4 Max, para o qual não existe avaliação independente
• Pontuações relatadas pelo fornecedor — Claude Opus 5 SWE-bench Verified 96,0%, SWE-bench Pro 79,2%, OSWorld 2.0 70,6%, Terminal-Bench 2.1 na casa dos 80 e poucos, dependendo do harness, em comparação com Qwen 4 Max, nada relatado
• Controle de raciocínio — pensamento adaptativo do Claude Opus 5 ativado por padrão, com uma escala de esforço de cinco níveis, versus Qwen 4 Max não divulgado
Dez linhas de “não publicado” não constituem um artifício retórico. É o estado das evidências, e a conclusão honesta a partir disso é que nenhuma comparação de capacidades entre esses dois modelos pode ser feita ainda por ninguém.
A parte da lacuna que não vai fechar
O preço e o contexto serão publicados eventualmente. Uma diferença sobreviverá ao lançamento, e vale a pena decidir sobre ela agora, em vez de na semana em que o Qwen 4 Max for lançado: os dois modelos foram criados para serem comprados de maneiras diferentes.
Claude Opus 5 é um único modelo fechado, a um único preço, de um único fornecedor, com um compromisso de descontinuação publicado de não antes de 24 de julho de 2027. Esse é um alvo estável para planejamento de capacidade. O Qwen 4 Max é o carro-chefe de uma família que a Alibaba lançou repetidamente em uma faixa de preço muito mais ampla — a geração Qwen 3.8 abrange um carro-chefe de ponta com preço de entrada de $2,00 e um nível Flash bem abaixo dele — e o nível de carro-chefe da linha Qwen tem sido historicamente aquele com a vida útil mais curta antes que um nível mais barato o alcance.
A outra diferença são os pesos abertos, e ela aponta na direção oposta. A geração Qwen 3.8 publicou os pesos do seu maior modelo sob uma licença Qwen personalizada, o que é justamente o que torna possível o ajuste fino, a quantização e a auto-hospedagem. O Claude Opus 5 não tem lançamento de pesos e não terá. Se a sua carga de trabalho precisa de um modelo que você possa executar dentro do seu próprio perímetro, ou modificar, essa é uma vantagem estrutural que nenhuma revisão de benchmark pode tirar da Alibaba — e é a razão mais forte para se importar com esta comparação em particular, em vez de tratá-la como um modelo principal contra outro.

Como executar esta comparação hoje
O Claude Opus 5 já está disponível, e o OrcaRouter o roteia como anthropic/claude-opus-5 ao preço de tabela da Anthropic com 0% de markup — a tarifa do provedor repassada sem alteração, de modo que os valores de US$ 5,00 e US$ 25,00 acima são o que você paga, e não um equivalente com margem adicionada. Isso importa mais do que o habitual para um modelo nessa faixa de preço: uma margem de plataforma de 10 por cento sobre uma tarifa de saída de US$ 25,00 é US$ 2,50 por milhão de tokens, o que é mais do que o custo total de entrada da maioria das alternativas de pesos abertos. Ao lado dele, o catálogo traz quase 200 modelos em um único endpoint compatível com a OpenAI, com failover automático quando um caminho de provedor se degrada e uma DSL de roteamento para expressar a política explicitamente em vez de codificar rigidamente o nome de um modelo na sua aplicação.
O que o OrcaRouter não oferece é o Qwen 4 Max, ou qualquer nível do Qwen 4. O catálogo tem zero entradas para a família, o que é o esperado para um modelo anunciado e não lançado. Quando os níveis forem lançados, eles apareceriam no mesmo lugar e, até lá, o modelo Qwen que vale a pena comparar com o Claude Opus 5 é aquele que você realmente pode chamar: Qwen3.8-Max, disponível geralmente desde 3 de agosto de 2026 a US$ 2,00 de entrada e US$ 6,00 de saída por milhão de tokens, com pesos publicados e uma pontuação de inteligência independente registrada de 56 a US$ 1,14 por tarefa — um número registrado sob uma revisão anterior do índice, portanto compare-o com o 51 do Claude Opus 5 apenas com essa ressalva.
O que fazer com isto antes que exista um cartão de modelo
Não há veredito a dar aqui, porque um dos dois modelos não existe como produto. O que se pode dizer é que a comparação mudou de forma em 19 de setembro de 2026 sem que nenhum dos fornecedores fizesse nada: o Claude Opus 5 já não é o modelo com melhor pontuação no índice independente no qual a maioria das comparações se baseia, e agora está dois pontos atrás de outros dois modelos. O lançamento do Qwen 4 Max vai cair nessa tabela, não na de julho.
Então, a decisão para os próximos meses não é Qwen 4 Max versus Claude Opus 5. É Claude Opus 5 versus o modelo Qwen que já foi lançado — um modelo de ponta a um quinto do preço de entrada, com pesos publicados — e essa comparação está disponível agora, com números reais dos dois lados. Reavalie-a quando a Alibaba publicar um model card, e trate qualquer tabela de benchmarks do Qwen 4 Max que você vir antes disso como não verificada.

Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
