
Solar Mini 4 vs Qwen3.8-Max: O Que os Últimos Vinte Pontos de Índice Realmente Custam
- openaiNOVOOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 por 1M de tokens
- anthropicNOVOAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 por 1M de tokens · 159 tok/s
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 220 tok/s
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2238Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- AnthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- xAINOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
O Solar Mini 4 custa US$ 0,10 por milhão de tokens de entrada e US$ 0,40 por milhão de tokens de saída. O Qwen3.8-Max, o modelo que a maioria das pessoas quer dizer quando digita "Qwen 3.8" e pede a API, custa US$ 2,00 e US$ 6,00. Em uma tabela de preços, isso equivale a uma diferença de vinte vezes no preço de entrada. Na avaliação independente pela qual ambos os modelos agora passaram, o dado honesto é que o Qwen3.8-Max marca 45,4 no Artificial Analysis Intelligence Index, contra 24,1 do Solar Mini 4 — aproximadamente o dobro da capacidade medida — embora custe cerca de quinze vezes mais por tarefa concluída. Tudo o que vale a pena saber sobre essa dupla está na diferença entre essas duas proporções e no fato de que o modelo da Upstage roda a 204 tokens por segundo, enquanto o carro-chefe da Alibaba roda a 39.
Uma observação sobre nomenclatura antes dos números, porque isso muda o que você está comprando. Qwen 3.8 é uma geração, não um modelo: o carro-chefe hospedado é o Qwen3.8-Max, atualizado como um snapshot datado de 0902, e o membro baixável da mesma geração é o Qwen3.8-2.4T-A95B, os pesos de 2,4 trilhões de parâmetros que a Alibaba publicou em 12 de agosto de 2026. O Solar Mini 4, lançado em 22 de setembro de 2026, é o modelo esparso de mistura de especialistas de 35 bilhões de parâmetros da Upstage, com cerca de 3 bilhões de parâmetros ativos por token e nenhum peso aberto a preço algum.
As duas colunas, nas dimensões que determinam a aquisição
• Índice de Inteligência — 45,4 para o Qwen3.8-Max (0902) contra 24,1 do Solar Mini 4, ambos no Índice de Inteligência v4.3.2.
• Custo por tarefa concluída — US$ 5,41 para o Qwen3.8-Max contra US$ 0,36 para o Solar Mini 4. Aproximadamente quinze para um, e a proporção que ninguém cita.
• Tabela de preços — US$ 2,00 / US$ 6,00 por milhão de tokens, entrada em cache US$ 0,25, para o Qwen3.8-Max, em comparação com US$ 0,10 / US$ 0,40, entrada em cache US$ 0,01, para o Solar Mini 4.
• Contexto — 1.000.000 tokens em ambos, que é a única dimensão em que o modelo barato não fica devendo nada. A Artificial Analysis lista 983.616 para o Qwen3.8-Max e 1.048.100 para o Solar Mini 4; a própria documentação da Upstage diz 512K, então o teto do modelo pequeno é o menos certo dos dois.
• Pesos — O Qwen3.8-Max é proprietário e hospedado; seu irmão aberto Qwen3.8-2.4T-A95B pode ser baixado sob uma licença personalizada e obtém 39,9 no mesmo índice com 262.000 tokens de contexto. O Solar Mini 4 é proprietário e não tem irmão aberto.
• Taxa de transferência — 204 tokens de saída por segundo para o Solar Mini 4, contra 39,5 do Qwen3.8-Max, conforme medido pelo mesmo laboratório. O modelo que custa um quinze avos por tarefa é cinco vezes mais rápido ao executá-la.
O que vinte e um pontos de índice compram

Eles compram a extremidade mais difícil da distribuição. No Humanity's Last Exam, o Qwen3.8-Max responde corretamente a 43,1% dos itens, contra 25,8% do Solar Mini 4. Em codificação científica, é 52,1% contra 47,6%. No trabalho de conhecimento agêntico, a diferença se amplia e passa para outra categoria: o Qwen3.8-Max alcança 1663 Elo no GDPval-AA, enquanto o Solar Mini 4 chega a 1072 — quase seiscentos pontos Elo, o que não é uma diferença de arredondamento, mas uma mudança naquilo em que se pode confiar que o modelo faça sem supervisão.
A única avaliação em que o modelo pequeno não só mantém a sua posição, mas vence, é o raciocínio de contexto longo. O Solar Mini 4 obtém 83,3% no AA-LCR v1.1 e o Qwen3.8-Max obtém 80,3%. Este é o argumento mais forte a favor do Solar Mini 4 em toda esta comparação: no benchmark criado para testar «ler um documento muito longo e raciocinar sobre ele», um preço por tarefa quinze vezes superior compra um resultado que é três pontos pior.
Onde nenhum dos dois modelos é o instrumento certo é no trabalho autônomo em terminal. O Solar Mini 4 marca 1% no Terminal-Bench 4.0; o Qwen3.8-Max marca 38,9%. Um modelo que resolve oito de vinte tarefas difíceis de terminal é genuinamente utilizável nesse contexto, e o outro não, o que é o exemplo mais claro nesta comparação de uma diferença de natureza, e não de grau.
Por que a conta por tarefa do carro-chefe é muito pior do que o preço por token sugere
O Qwen3.8-Max emite mais saída por tarefa do que o Solar Mini 4 — 107.700 tokens contra 88.300 — e as emite a US$ 6,00 por milhão, em vez de US$ 0,40. Aí já está a maior parte da diferença, antes mesmo de se considerar o comportamento de cache. A Alibaba oferece uma tarifa de US$ 0,25 para entrada em cache, o que é um desconto real em relação ao seu preço de entrada de US$ 2,00, e o irmão aberto da família, Qwen3.8-2.4T-A95B, é um modelo esparso de 2,4 trilhões de parâmetros, com cerca de 95 bilhões de parâmetros ativos, então cada token que ele produz é produzido por uma máquina substancialmente maior. Nada disso é uma crítica. É a razão pela qual existe um multiplicador de quinze vezes por tarefa e pela qual uma comparação de preço por token entre esses dois modelos é enganosa em ambas as direções.
A consequência prática: o Solar Mini 4 não é "o Qwen 3.8 econômico". É um especialista que por acaso é barato, rápido e forte exatamente em um eixo — documentos longos — e fraco no eixo em que errar custa mais caro, que é a confiabilidade agêntica. O Qwen3.8-Max é o generalista cuja vantagem aparece justamente onde uma resposta errada é custosa.
Executando o par em vez de escolher entre eles
Este é o caso incomum na série Solar Mini 4 em que ambos os lados da comparação são rotas que realmente podemos vender a você. O Qwen3.8-Max e seu snapshot datado de 0902 estão no OrcaRouterpela própria tabela do fornecedor de US$ 2,00 / US$ 6,00, ao lado de Qwen3.8-Flash a US$ 0,15 / US$ 0,47e Qwen3.8-27B a US$ 0,33 / US$ 2,40 — três degraus da mesma geração, uma única chave, sem segundo contrato e sem nenhuma alteração de código além de uma string de modelo. Em 1º de outubro de 2026, nossa própria medição no playground coloca o Qwen3.8-Max em um p50 de 2,5 segundos com 87,7 tokens de saída por segundo nos últimos sete dias; essa janela é móvel, então consulte o card do modelo em tempo real em vez desta frase. Os modelos da Upstage não estão disponíveis por nosso intermédio, e o Solar Mini 4 só pode ser acessado pela própria API da Upstage.

O que isso torna possível é a divisão que esta comparação defende: enviar o tráfego de documentos longos, em coreano e de extração estruturada para algum lugar barato, encaminhar as requisições com uso intensivo de raciocínio e que usam ferramentas para o modelo de ponta, e deixar que o failover cubra o provedor que estiver tendo um dia ruim. É também aí que a DSL de roteamento justifica seu lugar — compor modelos em uma única chamada significa que uma primeira passagem barata e uma passagem de verificação cara podem ser uma única requisição a um único endpoint, em vez de duas integrações que precisam ser mantidas em sincronia.
A versão curta

Se a sua carga de trabalho for de contexto longo, com um formato de saída fixo e um orçamento de latência tolerável, o Solar Mini 4 oferece 83% do resultado de contexto longo a um quinze avos do custo da tarefa e cinco vezes a vazão, e os vinte e um pontos de índice ausentes nunca aparecerão no seu painel. Se a sua carga de trabalho envolver ferramentas, agentes de múltiplas etapas ou perguntas em que uma resposta errada com confiança é pior do que nenhuma resposta, os pontos ausentes são o produto inteiro e o Qwen3.8-Max vale quinze vezes o preço. Todos os números acima atribuídos à Artificial Analysis são a medição independente dessa organização; a nomenclatura e as datas de lançamento do Qwen3.8 são da Alibaba, e os números de serving do OrcaRouter são a nossa própria medição de playground em uma janela móvel de sete dias.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
