
Solar Mini 4: o modelo agente de 3B ativos da Upstage, e o modelo silencioso com que foi lançado
- OpenAINOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- OpenAINOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Upstage lançou duas coisas em 22 de setembro de 2026, e a segunda é o motivo para continuar lendo depois da primeira. O Solar Mini 4 é o modelo: um checkpoint de mistura de especialistas com 35 bilhões de parâmetros, com 3 bilhões de parâmetros ativos por token, uma janela de contexto de 512.000 tokens, até 128.000 tokens de saída e um preço de tabela de US$ 0,10 por milhão de tokens de entrada e US$ 0,40 por milhão de saída. Ele entrou no ar no Upstage Console, no Playground e como implantação local, sem rótulo de prévia e sem lista de espera. Esse é o lançamento, e é um lançamento sensato. A outra coisa que a Upstage entregou no mesmo dia foi o Solar Jev, um endpoint de decisão servido sobre o Solar Mini 4 que não gera texto corrido algum — ele retorna uma escolha, uma pontuação ou uma resposta sim/não com uma probabilidade associada, em uma única passagem direta, e a Upstage cobra zero pelos tokens de saída. Um desses dois anúncios é um lançamento de modelo. O outro é uma pequena aposta de que uma classe útil de trabalho de agente não quer que um modelo de linguagem fale.
O que realmente pousou em 22 de setembro
A entrada do changelog do Solar Mini 4 é curta e sem rodeios. Novo modelo, agora disponível. O próprio enquadramento da Upstage é a eficiência de custo para trabalho agêntico "onde a velocidade de resposta e o custo importam" — que é a frase que um laboratório escreve quando quer que você o compare a algo três vezes mais caro, em vez de à fronteira.

A ficha técnica, conforme a página de histórico de modelos da Upstage:
• Parâmetros — 35B no total, 3B ativos por token. Uma mistura esparsa de especialistas, então você paga para armazenar 35B e computa com 3B. A Upstage não detalha quantos especialistas existem nem como eles são roteados.
• Contexto — 512.000 tokens, com um máximo de 128.000 tokens de saída. Ambos os valores são idênticos aos do topo de linha, o que é a linha mais interessante da ficha.
• Data de corte do treinamento — fevereiro de 2026. Sete meses desatualizado no lançamento, o que é normal para um modelo desse porte e vale a pena saber antes de perguntar a ele sobre qualquer coisa recente.
• Idiomas — inglês, coreano e japonês. A Upstage descreve-o como "coreano fluente com fortes capacidades em inglês e japonês", que é a ordem correta para um laboratório coreano e provavelmente a ordem correta para o modelo.
• Capacidades — chat, raciocínio, saídas estruturadas e chamada de ferramentas. O raciocínio é uma mudança em relação à geração anterior: os modelos solar-mini mais antigos ignoram completamente um parâmetro reasoning_effort, e o Solar Mini 4 não.
• IDs de modelo — solar-mini4 é o alias, e atualmente ele é resolvido para o snapshot datado solar-mini4-260922. Um identificador solar-mini4-preview também tem circulado em ferramentas de agentes de terceiros, o que vale a pena saber se você estiver escrevendo uma configuração de roteamento com base em uma string de preview que pode não durar.
• Disponibilidade — Upstage Console, Playground e on-premises. Sem pesos abertos. A Upstage já publicou pesos abertos antes (o Solar Open 2 foi lançado em uma release do Hugging Face e seu serviço de API foi encerrado em 12 de agosto de 2026), mas nada sobre o Solar Mini 4 sugere que esse seja o plano aqui.
Solar Jev é a parte sobre a qual ninguém vai escrever
Solar Jev está em beta em um novo endpoint POST /v1/systemone. Você envia um pedaço de estado — um documento, uma linha de log, um ticket de suporte — mais uma lista de perguntas tipadas, e recebe de volta uma escolha de um conjunto que você forneceu, uma pontuação em uma rubrica, ou uma resposta sim/não, cada uma carregando uma probabilidade calibrada obtida diretamente do modelo, em vez de escrita como texto.
A consequência de design é que não há prosa. Nenhuma explicação, nenhuma cadeia de pensamento, nenhum preâmbulo. A Upstage diz que cada decisão é uma única passagem direta e que os tokens de saída são gratuitos. Com uma janela de contexto de 512K, todo o estado — um contrato inteiro, uma transcrição inteira — pode ser a entrada.
Este é um produto mais restrito do que parece à primeira vista, e a restrição é o ponto. Um modelo que não escreve nada não pode escrever algo errado. Se o seu pipeline atualmente pede a um modelo de chat para retornar um veredito em JSON e depois o analisa, e você já gastou algum tempo se defendendo contra o fato de o modelo envolver esse JSON em uma frase amigável, o Solar Jev é voltado diretamente para você. A troca é que você obtém uma probabilidade e nenhum rastro de raciocínio, então, quando ele erra, você não tem nada para ler.
Vale a pena ser preciso sobre o que o Solar Jev não é: ele não é um Solar Mini 4 menor, e não é um fine-tune que você pode baixar. É um endpoint servido sobre o Solar Mini 4, disponível no Upstage Console, em beta. Beta é a palavra que importa.
Quanto custa, e o prazo do desconto
O preço de tabela é de US$ 0,10 por milhão de tokens de entrada, US$ 0,01 por milhão de tokens de entrada em cache e US$ 0,40 por milhão de tokens de saída. Todos os valores excluem 10% de IVA.
Esses preços de tabela não são o que você vai pagar hoje. A Upstage está com um desconto de lançamento de 50% que a própria página de preços dela data de 22 de outubro de 2026 (UTC) — os dados estruturados subjacentes nessa página indicam a janela como de 22 de setembro, 05:00 UTC, a 23 de outubro, 00:00 UTC, o que é a mesma coisa dita de duas formas. Durante essa janela, as tarifas são US$ 0,05 de entrada, US$ 0,005 em cache e US$ 0,20 de saída.

Duas coisas decorrem disso. Primeiro, se você estiver comparando o custo disso com qualquer outra coisa, calcule-o com os dois números, porque um desconto de 50% que expira em um mês não é um preço, é uma promoção. Segundo, para dar contexto sobre onde o preço de tabela se situa: a geração anterior do Solar Mini tem preço de tabela de US$ 0,15 por milhão de tokens de entrada e saída, com uma janela de contexto de 32.768 tokens e nenhum modo de raciocínio. O Solar Mini 4 é mais barato na entrada, mais caro na saída e oferece dezesseis vezes a janela de contexto e um modo de raciocínio. Isso não é uma atualização. É um produto diferente usando o mesmo nome.
O que ninguém mediu ainda
O Solar Mini 4 tem um dia de vida e não possui avaliação independente. Nenhum Artificial Analysis Intelligence Index, nenhuma colocação no Agent Arena, nenhum benchmark agêntico de terceiros. A Upstage também não publicou nenhuma tabela de benchmark para ele — a entrada do changelog traz especificações e nenhuma pontuação. Qualquer pessoa que lhe cite um número para este modelo está citando outra coisa.
Há exatamente um ponto de dados meio que de terceiros em circulação, e ele precisa ser rotulado com cuidado porque não é nenhuma das duas coisas que aparenta ser. Um repositório da comunidade, hunkim/solar-mini4-jev, encapsula o Solar Mini 4 sob um formato compatível com a API de decisão TypeSafe Jev e publica sua própria execução test400, julgada por outro modelo sob uma rubrica declarada. Nessa execução, o Solar Mini 4 com reasoning_effort=none obteve 98,4% de acurácia de campos, contra 94,2% do próprio wrapper, errando 7 de 447 campos avaliados, contra 26; liderou tanto em coreano (98,8%) quanto em inglês (98,4%); e teve média de 1,21 segundo por chamada, contra 0,38 segundos do wrapper.
Leia isso pelo que é. Não é um benchmark de fornecedor — a Upstage não o publicou. Não é uma avaliação independente — nenhum órgão neutro o executou, o harness é do próprio concorrente, e o juiz é um modelo. É a comparação autorrelatada de um desenvolvedor de uma API hospedada com seu próprio wrapper, e o resumo honesto é que é o único sinal disponível e não deveria, por si só, mudar uma decisão de produção. Ela sugere, sim, duas coisas que vale a pena você mesmo testar: que o modelo é rápido o suficiente para uso interativo e que seu coreano é pelo menos tão forte quanto seu inglês.
Como experimentá-lo sem apostar um pipeline nisso
A parte incômoda de um modelo com um dia de existência e sem pontuações independentes é que a única forma de saber se ele se adequa é direcionar tráfego real por meio dele, e a única forma de fazer isso com segurança é ter algum lugar para onde esse tráfego possa ir quando ele não se adequar.
Failover é a resposta honesta aqui, e é para isso que serve uma camada de roteamento. Você coloca o Solar Mini 4 atrás de um endpoint, mantém o modelo que já está rodando como fallback e deixa o roteador redirecionar o tráfego quando o novo apresentar erros, atingir timeout ou começar a retornar saídas estruturadas que seu parser rejeita. Assim, a primeira semana de um novo modelo é um experimento com uma rede de segurança embaixo, em vez de um lançamento que você precisa defender.
Uma correção que vale a pena deixar clara, porque é fácil dar a entender o contrário: a OrcaRouter não roteia nenhum modelo da Upstage hoje. O Solar Mini 4, o Solar Pro 4 e o Solar Jev estão disponíveis pela própria API da Upstage e por várias plataformas de terceiros e, se você quer especificamente o Solar Mini 4, é lá que você o encontra. O que oferecemos é uma chave de API para os cerca de 190 modelos que roteamos, o que é útil se o experimento que você realmente quer fazer é "um modelo de agente compacto supera o que eu tenho" em vez de "este modelo coreano específico supera o que eu tenho". Essas são perguntas diferentes e apenas uma delas tem resposta errada.

A questão em aberto
A Upstage lançou agora um modelo compacto e um flagship com a mesma ficha técnica de 512K/128K, com três semanas de diferença nas faixas de preço, e colocou um endpoint de decisão no pequeno em vez do grande. Essa ordem é deliberada: o Solar Jev é servido no Solar Mini 4 porque uma decisão que não gera texto não precisa do raciocínio de um flagship, e porque você quer o modelo barato quando está fazendo um milhão deles.
O que ainda não está claro é se 3B parâmetros ativos proporcionam raciocínio suficiente para trabalho agêntico que envolve mais do que extração. O marketing da Upstage afirma que é agêntico. Os benchmarks da Upstage não dizem nada. Até que uma entidade independente o execute — e, dada a data de lançamento, isso está a semanas de distância, na melhor das hipóteses —, a postura correta é testá-lo em sua própria tarefa, pelo preço promocional, com um fallback configurado, e tratar qualquer alegação sobre sua qualidade agêntica, incluindo a do fornecedor, como uma hipótese.
