
GPT-6 Sol vs Qwen 4 Max: O preço de entrada está empatado e quase todo o resto não é comparável
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligência
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligência
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAIGrok 4.72026-09-2146Inteligência
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
Aqui está o número que torna o par GPT-6 Sol e Qwen 4 Max digno de uma página própria: ambos estão listados a US$ 2,00 por milhão de tokens de entrada. É aí que começa a parte útil da comparação e, para o Qwen 4 Max, praticamente onde ela termina. A empresa anunciou o nível Qwen 4 Max em 22 de setembro de 2026 na sua conferência Apsara — no mesmo dia em que o GPT-6 Sol foi lançado — e, até o momento desta redação, não há ficha de modelo publicada para ele: sem preço, sem janela de contexto, sem declaração de pesos e sem pontuação de qualquer avaliador. O carro-chefe da Qwen que tem medições, e que você pode chamar hoje, é o Qwen3.8 Max, lançado em 3 de agosto de 2026 a US$ 2,00 / US$ 6,00. Então a questão prática não é como o Qwen 4 Max se sai contra o GPT-6 Sol. É o que o nível anunciado lhe diz sobre para onde vai o carro-chefe da empresa, e o que o Qwen que você pode de fato rotear faz contra o modelo GPT-6 hoje.
Essa distinção não é pedantismo. Um nível que foi anunciado mas não especificado pode absorver qualquer suposição que você queira fazer sobre ele, e um artigo que assume silenciosamente que Qwen 4 Max supera o GPT-6 Sol — porque o número da versão é maior — está fazendo um argumento que o fornecedor não fez e que as evidências não sustentam.
Três coisas que são comparáveis agora mesmo
• Preço de entrada — GPT-6 Sol $2.00 por milhão vs Qwen3.8 Max $2.00 por milhão, um empate exato
• Preço de saída — GPT-6 Sol $10.00 por milhão vs Qwen3.8 Max $6.00 por milhão
• Entrada em cache — GPT-6 Sol $0.20 por milhão vs Qwen3.8 Max $0.25 por milhão
• Janela de contexto — GPT-6 Sol 1,050,000 tokens vs Qwen3.8 Max 1,000,000 tokens
• Modalidades de entrada — ambas aceitam texto, imagem e vídeo ou arquivo; GPT-6 Sol texto, imagem e arquivo, Qwen3.8 Max texto, imagem e vídeo
• Degrau de solicitação longa — GPT-6 Sol precifica novamente toda a solicitação acima de 272,000 tokens de entrada para $4.00 / $15.00 vs Qwen3.8 Max sem degrau em seu card
• Intelligence Index — GPT-6 Sol 47.6 vs Qwen3.8 Max 45.4
• Coding index — GPT-6 Sol não publicado nesta revisão vs Qwen3.8 Max 76.2
• GPQA Diamond — GPT-6 Sol 96.1 vs Qwen3.8 Max 92.8
• Terminal-Bench 4.0 — GPT-6 Sol 43.9 vs Qwen3.8 Max 38.9
Duas dessas linhas são as que merecem uma reflexão mais demorada. A linha de entrada em cache contraria o padrão — o Qwen3.8 Max cobra cinco centavos a mais por milhão por leituras de cache do que o GPT-6 Sol, o que, num loop de agente com muito uso de cache, é o medidor que se move primeiro. E a cláusula de solicitação longa é onde o empate no preço de entrada se desfaz de vez: a exatos US$ 2,00 de entrada, os dois parecem intercambiáveis até um prompt ultrapassar 272.000 tokens, ponto em que a solicitação inteira do GPT-6 Sol é reprecificada para US$ 4,00 / US$ 15,00, enquanto a tabela do Qwen3.8 Max não traz nenhum patamar equivalente. Num prompt de contexto completo, o modelo da empresa não é apenas mais barato na saída. É o único dos dois cuja tarifa publicada você ainda consegue prever a partir do valor de manchete.
Duas coisas que não são comparáveis, e por que a diferença importa
A primeira é a capacidade do Qwen 4 Max. A empresa apresentou-o como um nível de uma gama, e não como um produto: sem tabela de benchmarks, sem número de contexto, sem declaração sobre pesos, sem preço. Tudo o que está escrito sobre como ele se sairá é uma projeção da trajetória da linha Qwen, incluindo esta frase. A única coisa legível é o alvo — o nível que ele substitui e o modelo que o sucessor está sendo construído para ultrapassar — e isso indica a direção do percurso, não o destino.
A segunda é a questão dos pesos abertos, e é a que mais vale sinalizar antes de você planejar em torno de uma implantação do Qwen 4 Max. A empresa publica os pesos de partes da família Qwen e não de outras. O Qwen3.8 Max, o carro-chefe, está listado como um modelo de API fechado — sem arquivo de licença, sem checkpoint para download — ainda que irmãos menores da mesma geração sejam publicados. Se o carro-chefe da série 4 seguirá os irmãos menores ou permanecerá fechado é uma questão sem resposta, e uma equipe que monte um plano de auto-hospedagem com base na expectativa de pesos abertos estaria apostando em um precedente que o carro-chefe atual não estabelece.
A comparação que de fato ocorre é GPT-6 Sol contra Qwen3.8 Max, e ela é mais acirrada do que os números de geração sugerem: 47,6 contra 45,4 no Intelligence Index, ambos os números de terceiros na mesma revisão, e GPQA Diamond um verdadeiro 96,1 contra 92,8. Uma diferença de 2,2 pontos no índice a três quartos do preço de saída é a versão mais apertada desse confronto disponível, e é a partir dela que se deve raciocinar até que a empresa publique algo para a série 4.

Do que o próprio anúncio é evidência
Um nível anunciado, mas não especificado, não é um sinal vazio. Ele informa que a empresa pretende que seu próximo carro-chefe fique no topo da linha e que está disposta a nomeá-lo publicamente antes que esteja pronto, o que é uma mudança de hábito de comunicação, e não uma alegação de capacidade. Ele também põe um relógio a contar: um nível anunciado em setembro cria a expectativa de uma janela de envio, e a lacuna entre o anúncio e a especificação é onde o posicionamento competitivo costuma acontecer.
Para quem atualmente usa o Qwen3.8 Max, a consequência prática é que a migração será uma questão de capacidade, e não de custo. O nível que o Qwen 4 Max está sendo criado para substituir já está em US$ 2,00 / US$ 6,00, e o sucessor tem de superar um modelo que pontua 45,4 enquanto custa um terço menos na saída do que o GPT-6 Sol. Se ele também fecha a lacuna até 47,6 — e em que data — é a única coisa que vale a pena acompanhar, e não há nada no anúncio que responda a isso.

Roteando um modelo que ainda não existe
Apenas um dos dois modelos Qwen nesta conversa está no nosso catálogo, e não é o da série 4. O Qwen3.8 Max é roteado pelo OrcaRouter sob o id de modelo qwen/qwen3.8-max, na mesma chave que o GPT-6 Sol e mais de 200 outros modelos, e o emparelhamento vale exatamente isso: uma mudança de rota, e não um projeto de integração, quando a empresa publicar o sucessor. O Qwen 4 Max será adicionado quando houver algo para rotear — um cartão, uma tarifa, um endpoint — e não antes, porque não há forma responsável de vender uma vaga com base em uma especificação que ainda não foi escrita.
Enquanto isso, o motivo de manter as duas colunas abertas é que os dois modelos discordam sobre onde são baratos. O Qwen3.8 Max não abre mão de nada no preço de entrada, corta um terço da tarifa de saída do GPT-6 Sol e não tem queda abrupta em contexto longo; o GPT-6 Sol traz um índice marginalmente melhor e um desconto muito mais generoso para entrada em cache, ao custo de reprecificar toda a requisição acima de 272.000 tokens. Uma carga de trabalho longa e com muita saída e uma carga curta e amigável a cache pedem respostas diferentes, e ambas estão a apenas uma regra de roteamento de distância, em vez de duas conversas de aquisição.
O failover importa aqui por um motivo específico deste confronto. O Qwen3.8 Max é um modelo de alto volume nas nossas rotas — mais de 100 milhões de tokens em uma janela — e é o volume que expõe a variação de endpoint. Uma segunda rota configurada por trás dele significa que um primário degradado vira uma nova tentativa, e uma alteração de tarifa no cartão da empresa, que é exatamente o tipo de evento que uma transição de modelo carro-chefe produz, entra em vigor do nosso lado no mesmo dia, porque nosso catálogo repassa os preços de tabela dos provedores sem markup.

O que fazer, este mês
Se você precisa de um modelo topo de linha da Qwen agora, o modelo ao qual recorrer é o Qwen3.8 Max, e ele é competitivo com o GPT-6 Sol em raciocínio a um preço de saída significativamente menor — esse é o estado honesto do confronto hoje. Se você precisa do resultado publicado mais forte nos benchmarks de raciocínio deste par, o 47,6 do GPT-6 Sol é o número, e seu desconto de entrada em cache é o mais barato da comparação. Se você está esperando o Qwen 4 Max, espere por uma ficha técnica em vez de uma data, porque o anúncio só lhe deu o nível e nada mais.
E, qualquer que seja a sua escolha, verifique o lado do GPT-6 antes de se comprometer com ele. O GPT-6 Sol já foi substituído pelo GPT-6.1 Sol pelo mesmo $2.00 / $10.00, com a entrada em cache reduzida pela metade para $0.10, e a sua própria página de modelo agora redireciona os leitores para ele. Uma comparação com o GPT-6 Sol é uma comparação com um modelo cujo sucessor está à venda, e a mesma cautela se aplica a qualquer valor do Qwen derivado do anúncio do 4 Max: ambos são formas de notícia, e só um deles é um produto comprável neste momento.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
