
Solar Pro 4 vs Qwen 3.8 Max: Um Agente de $0,03 vs a Aposta Aberta de 2,4T da Alibaba
- metaNOVOMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenNOVOQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekNOVODeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxNOVOMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2147 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
- grokxAI: Grok 4.52026-07-0856Inteligência72Código
- tencentTencent: Hy32026-07-0642Inteligência59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligência42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligência39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3055Inteligência72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligência52Código57Matemática
Na semana de 3 de agosto de 2026, a Alibaba lançou oQwen 3.8 Max, um MoE esparso de 2,4 trilhões de parâmetros que ocupa o 2º lugar no ranking global da Arena e o 12º no Índice de Codificação da Artificial Analysis, a US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída. Sete dias depois, a Upstage lançou oSolar Pro 4, um carro-chefe agêntico de pesos fechados com preço de US$ 0,03 e US$ 0,12. Ambos são comercializados como modelos "agênticos" projetados para trabalhos longos e de várias etapas. Um é a aposta de pesos abertos mais forte do verão chinês, o outro é o rótulo comercial "modelo de agente" mais barato de 2026. Eles não estão realmente competindo em capacidade — eles estão competindo sobre o que um desenvolvedor pode presumir sobre um modelo antes que o primeiro token seja gasto.
Dois lançamentos, duas suposições
Qwen 3.8 Max came out of Alibaba's labs on August 3 with the trappings of a frontier launch: 2.4T total parameters (about 95B active per token), a 1M-token context, native text-image-video input, a #2 Arena ranking, and an audited Artificial Analysis Intelligence Index of 58. It is, on independent evidence, in the global top tier of open-weight models. Alibaba has said the weights will be released, following the Qwen pattern, which would make it the first open-sourced Max-class Qwen. None of that is cheap in the frontier sense — $2/$6 — but it is cheap relative to the proprietary frontier.
O Solar Pro 4 chegou em 10 de agosto com um conjunto diferente de premissas. O material de divulgação da Upstage descreve melhorias em raciocínio de documentos longos, uso de ferramentas em múltiplas etapas e desempenho em tarefas de terminal em relação ao Solar Pro 3, sem revelar a contagem de parâmetros e sem benchmark independente. Seu único diferencial é o preço: $0,03/$0,12 é aproximadamente 66× mais barato na entrada e 50× mais barato na saída do que o Qwen 3.8 Max. Enquanto o Qwen 3.8 Max pede que você acredite em um modelo de 2,4T com pontuações auditadas, o Solar Pro 4 pede que você acredite em um preço.

O placar, lido honestamente.
• Índice de Inteligência — Qwen 3.8 Max: 58 (AA, auditado); Solar Pro 4: nenhum publicado
• Índice de Codificação — Qwen 3.8 Max: 71,8 (#12 de 126, AA); Solar Pro 4: ainda não medido
• Contexto — Qwen 3.8 Max: 1M tokens; Solar Pro 4: 524K
• Modalidades de entrada — {{1}}Qwen 3.8 Max{{/1}}: {{3}}texto, imagem, vídeo{{/3}}; {{2}}Solar Pro 4{{/2}}: {{4}}focado em texto{{/4}}
• Pesos — Qwen 3.8 Max: lançamento aberto prometido; Solar Pro 4: fechado
• Preço — Qwen 3.8 Max: $2.00/$6.00 por 1M; Solar Pro 4: $0.03/$0.12 por 1M

A assimetria é gritante e não é culpa do Solar Pro 4. O Qwen 3.8 Max é mensurável desde 3 de agosto; o Solar Pro 4 é mensurável desde 10 de agosto. Um modelo não medido não é um modelo ruim — é um modelo não medido. Mas esta comparação específica, agora, é "evidência auditada" contra "uma alegação de preço de lançamento", e a maneira honesta de ler qualquer confronto direto é dizer isso.
O que a diferença de 100× realmente proporciona
O número interessante aqui não é o preço por token; é o que o preço por token desbloqueia arquiteturalmente. Nas taxas do Solar Pro 4, deixar um conjunto completo de documentos de 500 mil tokens no contexto a cada turno de um loop de agente deixa de ser uma decisão de custo. Executar o mesmo prompt com três temperaturas diferentes e manter o melhor — um truque clássico de modelos baratos — torna-se gratuito. Essa é uma postura de desenvolvimento genuinamente diferente: você projeta como se computação fosse quase gratuita, do mesmo modo que as equipes faziam com os primeiros modelos baratos da camada GPT-3.5.
O custo é que você está apostando uma carga de trabalho de produção em uma alegação de qualidade não verificada. O Índice de Inteligência 58 do Qwen 3.8 Max e o ranking #2 na Arena não são a história completa — o próprio conjunto de benchmarks da Alibaba inclui números internos que devem ser lidos com o mesmo rótulo de "fornecido pelo fornecedor" — mas são algo. O Solar Pro 4 ainda não tem nada desse tipo. Se a qualidade dele estiver em qualquer lugar perto da do Qwen, é o melhor negócio do mercado. Se não estiver, o preço de $0,03 mostrará exatamente por que custa $0,03.

O fork de pesos abertos
É aqui que os dois modelos divergem estruturalmente, e é isso que decidirá este confronto daqui a seis meses. O lançamento aberto do Qwen 3.8 Max, quando acontecer, torna-o um ativo implantável: hospede-o você mesmo, ajuste-o, sirva-o a custo marginal, mantenha seus dados no seu próprio hardware. O Solar Pro 4 nunca será assim — fechado é fechado. Para uma empresa com requisitos de residência de dados ou uma curva de custo de longo prazo, "o Qwen 3.8 Max pode eventualmente viver no seu próprio cluster" é uma opção estratégica que nenhum preço por token pode igualar.
Para a equipe que só quer chamar um modelo hoje, a questão em aberto é acadêmica. Ambos estão por trás de APIs compatíveis com OpenAI, e ambos estão disponíveis pela própria API do fornecedor e por várias plataformas de terceiros. A resposta do roteamento — uma API para mais de 200 modelos, preço de tabela do provedor repassado sem acréscimo, failover automático — permite tratar isso como um gráfico de custo em vez de uma decisão de fidelidade: tráfego barato em volume para o modelo de $0,03, raciocínio de alto risco para o Qwen 3.8 Max, e o DSL de roteamento para dizer qual carga de trabalho vai para onde.
Conclusão
Qwen 3.8 Max é o melhor modelo, o modelo com melhores evidências e o modelo com um futuro que você pode possuir. Solar Pro 4 é o melhor preço por duas ordens de magnitude, com o asterisco honesto de que suas alegações de qualidade não foram reproduzidas até esta semana. Se sua carga de trabalho precisa de desempenho de fronteira auditado, pague pelo Qwen 3.8 Max. Se sua carga de trabalho é limitada por volume e tolerante a falhas, o agente de $0,03 é a aposta racional — verifique-o novamente quando os primeiros números independentes do Solar Pro 4 chegarem, que é também quando esta comparação deixa de ser uma comparação entre maçãs e laranjas e passa a ser uma escolha real.
