
Nex-N2.5 Pro vs DeepSeek V4 Pro: Apenas um conjunto desses pesos abertos é realmente aberto.
- openaiNOVOOpenAI: GPT-6 Astra2026-09-0455Inteligência77Código
- googleNOVOGoogle: Gemini 3.8 Flash2026-09-0247Inteligência76Código
- qwenNOVOQwen: Qwen3.8 Max (0902)2026-09-0247Inteligência72Código
- anthropicNOVOAnthropic: Claude Fable 5.12026-09-0157Inteligência82Código
- AlibabaNOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.3 Flash2026-08-2646Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1849Inteligência75Código
- obsidianQwen3.8 27B2026-08-1541Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1251Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0547Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0347Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2140Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Inteligência49Código
Aqui está o segredo da família que torna esse confronto mais estranho do que parece: o próprio Nex-N2.5 Max da Nex-AGI, o topo de linha da família que inclui o Nex-N2.5 Pro, é ele mesmo pós-treinado a partir do DeepSeek-V4-Pro-Base. A cobertura das notas de lançamento de 8 de setembro afirma abertamente — Mini e Pro são construídos a partir de variantes do Qwen3.5, enquanto o Max 1.6T, apenas texto, apoia-se na base aberta que a DeepSeek lançou em agosto. Portanto, quando o Nex-N2.5 Pro é comparado com o DeepSeek V4 Pro, o leitor vê um projeto de modelo aberto tomar emprestada a fundação do outro para o seu nível principal e depois tentar superar o doador no nível abaixo. Isso não é um insulto; é assim que a economia de pesos abertos funciona, e é o enquadramento mais honesto possível para uma comparação em que ambos os modelos têm licença aberta e apenas um deles pode de fato ser baixado hoje.
A assimetria conta toda a história. O DeepSeek V4 Pro — a build 0813 que entrou em disponibilidade geral em 13 de agosto — tem pesos licenciados sob MIT hospedados no Hugging Face neste exato momento: um grande modelo de mistura de especialistas com cerca de 1,6 trilhão de parâmetros totais, aproximadamente 49 bilhões ativos, contexto de 1M de tokens, teto de saída de 384K e uma API oficial por trás. O Nex-N2.5 Pro, anunciado em 8 de setembro, é um MoE esparso de 397 bilhões de parâmetros com cerca de 17 bilhões ativos, multimodal — enquanto o DeepSeek é somente texto — e voltado a agentes de uso de computador em vez de uso generalista de ferramentas. O card do Nex-N2.5 Pro no Hugging Face ainda anuncia que os pesos estão por vir sob licença Apache-2.0, sem data definida, enquanto apenas endpoints hospedados gratuitos o servem. Mesmo compromisso filosófico com pesos abertos. Estado de entrega completamente diferente.
Duas licenças, um conjunto de pesos realmente lançado
O contraste de licença importa menos do que o contraste de entrega, mas é ele que define os termos. O DeepSeek V4 Pro é oferecido sob a licença MIT — você pode baixar os shards hoje, hospedá-los você mesmo, fazer fine-tuning neles e construir um negócio em cima deles sem pedir permissão a ninguém; e, como os pesos já estão disponíveis, nenhum provedor, isoladamente, controla o preço. O Nex-N2.5 Pro é prometido sob a licença Apache-2.0, a licença igualmente permissiva que a aliança escolheu, mas o banner no card é inequívoco: os pesos não podem ser baixados e nenhuma data foi anunciada. Para uma equipe cujo requisito é “o modelo precisa ser nosso”, este confronto hoje não é uma disputa — o DeepSeek V4 Pro é o único candidato que você pode de fato possuir. A ressalva prática vale nos dois sentidos: auto-hospedar um MoE de ~1,6 trilhão de parâmetros exige infraestrutura séria; portanto, para a maioria das equipes, a licença MIT importa menos como plano de auto-hospedagem do que como garantia contra o lock-in e um piso de preço. O Nex-N2.5 Pro, quando seus shards forem lançados, será o design mais propício à auto-hospedagem — 17B de parâmetros ativos em um nó com oito H100 é uma configuração muito menor do que a de referência do DeepSeek.
As linhas onde os dois diferem.
Lado a lado, os dois modelos mal se sobrepõem em suas finalidades:
• Lançado — Nex-N2.5 Pro: 8 de setembro de 2026 (endpoints hospedados ativos, pesos pendentes). DeepSeek V4 Pro: 13 de agosto de 2026 (compilação GA 0813), pesos ativos.
• Escala — Nex-N2.5 Pro: 397B total / ~17B ativos. DeepSeek V4 Pro: ~1.6T total / ~49B ativos.
• Modalidade — Nex-N2.5 Pro: entrada de texto e imagem, saída de texto; projetado para uso em computador com leitura de tela. DeepSeek V4 Pro: apenas texto em sua API pública — sem visão nativa, entrada de imagem ou áudio.
• Contexto / saída — Nex-N2.5 Pro: contexto de 262.144 tokens. DeepSeek V4 Pro: contexto de 1M tokens, com até 384K tokens de saída.
• Controle de raciocínio — Nex-N2.5 Pro: nenhum / médio (adaptativo, padrão) / alto. DeepSeek V4 Pro: baixo / alto / esforço de raciocínio máximo na mesma string do modelo.
• Pesos — Nex-N2.5 Pro: Apache-2.0, em breve. DeepSeek V4 Pro: MIT, disponível para download agora.
• Superfície de API — Nex-N2.5 Pro: chamadas de chat compatíveis com OpenAI em endpoints hospedados gratuitos. DeepSeek V4 Pro: API Responses nativa da OpenAI, além de endpoints compatíveis com Anthropic, chamadas de ferramentas e saída JSON.
Dois produtos genuinamente diferentes compartilham a palavra "open." O Nex-N2.5 Pro é feito para olhar para uma tela e operá-la; o DeepSeek V4 Pro é feito para pensar, escrever código e chamar ferramentas — a diferença entre um operador e um analista.

O que é medido e o que é emprestado

O quadro de benchmarks é tão desequilibrado quanto o quadro de disponibilização. O DeepSeek V4 Pro tem uma presença mensurada e independente: uma entrada no Artificial Analysis Intelligence Index, semanas de cobertura da imprensa e tráfego de produção desde a GA de 0813, e números de codificação do fornecedor — Terminal-Bench 2.1 em 87.9 e DeepSWE em 62.7, segundo o relato do próprio DeepSeek — que, no mínimo, se apoiam em um modelo que qualquer pessoa pode baixar e executar novamente. O Nex-N2.5 Pro não tem nada disso. Seus números de destaque — OSWorld-2 em 56.4, Terminal-Bench 2.1 em 82.7, SWE-Bench Pro em 61.2, BrowseComp em 89.7 — são todas medições feitas pela própria Nex-AGI por meio de seu harness NexCUA, que a aliança afirma que vai disponibilizar como open-source, mas ainda não disponibilizou. Nas primeiras 48 horas após o lançamento, nenhum laboratório independente havia executado o Nex-N2.5 Pro, porque ninguém de fora da aliança pode fazê-lo.
Leia as duas séries de alegações lado a lado e a conclusão honesta não é "DeepSeek é mais inteligente." É "Os números da DeepSeek são verificáveis e os da Nex-N2.5 Pro não são." Onde as duas fichas técnicas dos fornecedores se sobrepõem — Terminal-Bench 2.1 — a DeepSeek afirma 87,9 contra 82,7 da Nex-N2.5 Pro, uma vantagem de cinco pontos para o modelo estabelecido que é exatamente a direção que um leitor cauteloso deve esperar: o modelo que já foi lançado tem pontuação mais alta na linha compartilhada do que aquele que não foi.
O preço: um número real, um número agendado e nenhum número.
O preço do DeepSeek V4 Pro não é um número único, e isso já é uma história por si só. Na GA 0813, a API oficial listava US$ 0,435 por milhão de entrada e US$ 0,87 por milhão de saída; em 16 de agosto, a DeepSeek mudou a família V4 para um esquema de pico/fora de pico, então a API oficial agora cobra US$ 0,66 de entrada / US$ 1,98 de saída fora de pico e US$ 1,32 / US$ 3,96 no pico, com entrada em cache a US$ 0,022 fora de pico e US$ 0,044 no pico. Dependendo de quando você chama a DeepSeek diretamente, o mesmo modelo custa entre cerca de 50% a mais e quatro vezes e meia o valor do lançamento. Rotas também importam: a página do modelo DeepSeek V4 Pro no OrcaRouter atualmente lista um valor fixo de US$ 0,44 de entrada / US$ 0,88 de saída por milhão — a taxa do provedor repassada sem margem — que fica abaixo até do cronograma oficial fora de pico. Essa rota de preço fixo é o valor a superar se você está comparando custo por token, e é o tipo de número que só existe porque uma camada de roteamento mostra a taxa real do provedor em vez de uma taxa reprcificada.

O Nex-N2.5 Pro não tem preço para colocar ao lado de nada disso. Seu nível hospedado é gratuito, e a Nex-AGI não publicou nenhuma tarifa paga por token para a família, portanto a economia do modelo é simplesmente desconhecida — os endpoints gratuitos provam que a construção funciona, nada mais. Se os pesos forem disponibilizados e um provedor começar a servir o Nex-N2.5 Pro a um preço de tabela, a comparação honesta se torna possível; até lá, "gratuito" é um mecanismo de prévia, não um sinal de mercado.
Dois tipos diferentes de agente
Escolher entre esses dois é escolher entre dois empregos, não duas pontuações. O Nex-N2.5 Pro é para o agente que opera um computador: ele lê uma tela, move um cursor, edita um arquivo, verifica o resultado visual e segue em frente — a sessão demonstrada de 468 ações em Pokemon Platinum é a forma dessa ambição. O DeepSeek V4 Pro é para o agente que opera uma API: raciocina, escreve código de múltiplos arquivos, chama ferramentas e produz saída estruturada longa, tudo por meio do canal de texto que o seu teto de saída de 384K e contexto de 1M existem para servir. Uma equipe que desenvolve automação de navegador deve ficar de olho no Nex-N2.5 Pro. Uma equipe que constrói um agente de codificação ou de trabalho de conhecimento deve comparar o DeepSeek V4 Pro com a fronteira fechada, e o Nex-N2.5 Pro ainda não é um candidato para esse trabalho — ele não consegue tirar a imagem do loop, e suas alegações de codificação são tanto menores quanto menos verificadas do que as do modelo com o qual está sendo comparado.
O veredito: espere por um, construa sobre o outro.
DeepSeek V4 Pro é o único alvo racional de construção neste confronto hoje. Seus pesos podem ser baixados, seu preço é conhecido — e mais barato pela rota de preço fixo do OrcaRouter do que na própria tarifa de pico da DeepSeek — e suas afirmações podem ser verificadas por qualquer pessoa em uma tarde. É também o lugar natural para começar a medir quanto custará o computer-use aberto: roteie o tráfego do agente de codificação pelo OrcaRouter com failover automático contornando o limite de ~500 concorrências da API oficial, e você tem uma referência funcional de pesos abertos a um preço real. O Nex-N2.5 Pro é a aposta mais interessante de longo prazo justamente por ser o design mais especializado — um operador multimodal com 17B de parâmetros ativos que poderia subcotar os líderes fechados de computer-use como a DeepSeek subcotou os generalistas fechados — mas um endpoint gratuito não verificável não é uma fundação. Quando os shards Apache-2.0 forem lançados e um harness independente rodar aquele número do OSWorld-2, este confronto muda da noite para o dia. Até lá, é uma comparação entre um modelo que você pode possuir e um modelo que você só pode observar.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
