
Solar Pro 4 marca 42: O carro-chefe Agent-First da Upstage, agora medido de forma independente
- DeepSeekNOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.32026-08-1860Inteligência75Código
- obsidianNOVOQwen3.8 27B2026-08-1552Inteligência68Código
- qwenNOVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNOVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligência69Código
- grokNOVOSpaceXAI: Grok 4.62026-08-1261Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
Upstage Solar Pro 4 foi lançado em 10 de agosto de 2026, e o primeiro número que merecia atenção era o preço: US$ 0,30 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída na API própria da Upstage, com uma promoção de lançamento que reduz esses valores para US$ 0,03 e US$ 0,12 — 90% de desconto — nas listagens atuais. Quatro dias depois, chegou o segundo número que merecia atenção. Em 12 de agosto de 2026, a Artificial Analysis publicou a primeira avaliação independente do Solar Pro 4 e o pontuou em 42 no seu Índice de Inteligência, contra 14 do Solar Pro 3 — um ganho triplo em relação à pontuação medida do predecessor e um salto de 27 pontos pela própria aritmética do laboratório — confirmando o posicionamento da Upstage do Solar Pro 4 como seu carro-chefe proprietário, o modelo que substitui o Solar Pro 3 no topo da linha. De qualquer forma, barato; agora, também medido de forma independente.
O que realmente foi lançado
Solar Pro 4 é o carro-chefe comercial da virada da Upstage para a era de agentes. A empresa passou 2026 reconstruindo a linha Solar em torno de cargas de trabalho de agentes — sua contraparte de pesos abertos, Solar Open 2, foi lançada no final de julho — e o Solar Pro 4 é o produto hospedado para o qual essa virada apontava. A Upstage o resume em uma frase: um modelo para tarefas que exigem contexto sustentado, execução em múltiplas etapas e conclusão de ponta a ponta, em vez de respostas únicas.
Concretamente, a página do modelo o descreve como o modelo principal da Upstage, especializado para uso agêntico, adequado a fluxos de trabalho agênticos, produtividade de escritório, trabalho intensivo em documentos e codificação. No papel, é o maior contexto que a linha já lançou — o Solar Pro 3 oferecia 128K — e o único Solar até hoje com uma história de raciocínio publicada e superfície de chamada de ferramentas voltada para agentes autônomos.
Especificações conforme listadas no lançamento:
• Janela de contexto — 524.288 tokens (524K) na listagem do fornecedor, aproximadamente quatro vezes os 128K da geração anterior; a medição independente da Artificial Analysis registra 384K, portanto trate o número maior como afirmação da Upstage.
• Preço — tarifa oficial da API Upstage: $0,30 por 1M de tokens de entrada / $1,20 por 1M de tokens de saída, com entrada em cache a $0,06; uma promoção de lançamento oferece 90% de desconto, ficando em $0,03 / $0,12 nas listagens atuais.
• Capacidades — raciocínio, chamada de funções, modo JSON, streaming e pesquisa na web, com suporte para entrada de visão
• Pesos — proprietários, não abertos; sem lançamento no Hugging Face (em contraste com o Solar Open 2 aberto)
• Acesso — Upstage Console API e várias plataformas de terceiros; um aplicativo de chat em solar-chat.upstage.ai para testes práticos.
Esses números são a listagem do fornecedor, não uma folha de especificações auditada — e a primeira medição independente agora discorda de um deles. A Artificial Analysis registra uma janela de contexto de 384 mil tokens e uma saída máxima de 256 mil para o Solar Pro 4, contra os 524 mil e 128 mil–131 mil que o fornecedor lista. A lista de capacidades e o próprio número de contexto da Upstage vêm da página do modelo; os números da AA são a leitura independente.


O que mudou em relação ao Solar Pro 3 — os primeiros números independentes
As próprias alegações da Upstage para o Solar Pro 4 se concentram em três áreas de melhoria em relação ao Solar Pro 3, todas relevantes para agentes: raciocínio em documentos longos, uso de ferramentas em múltiplas etapas e desempenho em tarefas de terminal. Essas são exatamente as dimensões em que um modelo de agente mostra seu valor — manter um fio condutor ao longo de um documento extenso, sustentar uma sequência de chamadas de ferramentas sem perder o rumo e concluir tarefas executadas dentro de um shell.
A primeira rodada independente confirma a direção de cada uma dessas afirmações. A Artificial Analysis avaliou o Solar Pro 4 em 42 no seu Intelligence Index, contra 14 do Solar Pro 3, e os ganhos mais expressivos estão exatamente onde a Upstage apontou:
• Terminal-Bench v2.1 (tarefas de terminal): 12% → 57%
• AA-LCR (raciocínio de longo contexto): 31% → 71%
• τ³-Banking (uso de ferramentas em múltiplas rodadas): 9% → 23%
• GDPval-AA v2 (trabalho agêntico do mundo real): Elo 498 → 1.277, acima da linha de base humana de 1.000 e ligeiramente à frente de Qwen3.7 Max (1.272) e MiMo-V2.5-Pro (1.266)
O posicionamento no índice é o destaque: 42 fica ao lado de Inkling (xhigh, 42) e logo atrás de MiMo-V2.5-Pro (43). Um modelo com preço de categoria econômica agora tem desempenho de um agente sério.
Duas ressalvas acompanharam a pontuação. A melhoria AA-Omniscience (-53 → -1) é em grande parte abstenção: o Solar Pro 4 tenta apenas 41% das perguntas contra os 92% do Solar Pro 3, sua taxa de alucinação caiu de 88% para 24%, mas a precisão permaneceu estável em 19%. E o ganho de inteligência custou latência — cerca de 8,6 minutos por tarefa do Intelligence Index contra 6,0 do Solar Pro 3, enquanto o uso de tokens melhorou de aproximadamente 52k para 43k tokens de saída por tarefa. É um modelo mais inteligente, mais cuidadoso e mais lento.
Por que o preço importa mais do que as especificações
O argumento a favor do Solar Pro 4 é sua relação preço-inteligência medida. Mesmo na tabela oficial, um modelo com contexto de 384K–524K a US$ 0,30 por milhão de tokens de entrada subcotiza praticamente todo o mercado — cerca de um dezesseis avos do preço de entrada de um carro-chefe de fronteira — e a promoção de 90% de desconto reduz isso a um dezesseis avos de um dezesseis avos. Isso cai em uma faixa onde o mercado atualmente vende modelos pequenos e rápidos, não os capazes de agir com uma pontuação verificada de nível médio.

A posição cética não é mais a de que o Solar Pro 4 não foi comprovado — a execução da AA resolve isso — mas ela é real. O ganho de onisciência é em parte um padrão de recusa, não apenas conhecimento. A latência medida é um retrocesso em relação ao Solar Pro 3. O contexto de 384K da Artificial Analysis fica abaixo do número de destaque de 524K do fornecedor. E o selo "90% off" significa que o preço daqui em diante pode mudar quando o período promocional terminar — a taxa definitiva é o preço de tabela de US$ 0,30 / US$ 1,20, não o preço de etiqueta de US$ 0,03 / US$ 0,12.
Quem deve experimentar, quem deve esperar
Experimente agora se: você está prototipando um agente e o custo dominante são tokens, precisa de uma janela de contexto longa e sua carga de trabalho tolera um raciocínio mais lento, ou está avaliando cargas de trabalho de documentos em coreano e do Leste Asiático, onde a Upstage tem treinado consistentemente bem.
Espere, se: sua carga de trabalho é crítica para a produção e não pode absorver uma regressão enquanto o campo calibra as expectativas, você precisa de pesos abertos para auto-hospedagem ou ajuste fino — Solar Pro 4 não é esse modelo; Solar Open 2 é — ou você está comprando com base no número de contexto de 524K, que a primeira medição independente não reproduz.
Existe um caminho intermediário que vale a pena nomear: coloque o Solar Pro 4 atrás de uma camada de failover em vez de apostar um pipeline inteiro nele. Um gateway de roteamento que possa recorrer a um segundo modelo em caso de timeout ou erro permite capturar o benefício de um modelo novo e barato sem o risco de ponto único de falha — o padrão para o qual existe o failover automático do OrcaRouter, e como o OrcaRouter repassa os preços de lista dos provedores sem margem alguma, o que a Upstage cobra é exatamente o que você paga, sem margem de revenda por cima.
O que assistir em seguida
O capítulo "ainda sem números independentes" deste modelo está encerrado — levou quatro dias. O que importa agora é o que a primeira medição implica. O preço pós-promoção: o selo de 90% é um lance inicial, não um compromisso, e a tarifa base por trás dele é de US$ 0,30 / US$ 1,20. Resta saber se a Upstage responde à latência medida e à discrepância de contexto entre 384K e 524K, ambos os achados mais acionáveis na rodada do AA. E cargas de trabalho reais de agentes — o melhor teste para um modelo de chamada de ferramentas são tarefas de longa duração no mundo real, não um leaderboard. Em 13 de agosto de 2026, o resumo preciso do Solar Pro 4 é mais enxuto e mais forte do que há uma semana: um carro-chefe muito barato, moldado para agentes, de um laboratório sério, confirmado como o substituto da Upstage para o Solar Pro 3, com uma pontuação independente de 42 para se discutir.
