
DSH 0.2 e DeepSeek V4.1 Pro: um lançamento duplo especulado, testado contra o próprio código da DeepSeek
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 301 tok/s
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 195 tok/s
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Na manhã de segunda-feira em Pequim, o observador da DeepSeek @teortaxesTex publicou que "seria legal se a DeepSeek lançasse o DSH 0.2 junto com o V4.1 Pro, que recebeu treinamento adicional para DSH e equipes de agentes, na segunda-feira", e depois se acautelou no mesmo fôlego: "Acho que pelo menos até quinta-feira da próxima semana é muito provável." Isso é um desejo com um calendário anexado, não um relatório. No centro disso está DeepSeek V4.1 Pro, que ainda não tem ficha de modelo, nem arquivo de pesos, nem preço e nem endpoint — e a outra metade do desejo, uma linha 0.2 do DeepSeek Harness, nunca foi publicada em nenhum canal. Os dois modelos DeepSeek que qualquer pessoa pode realmente chamar hoje são DeepSeek V4.1 Flash, o lançamento de pesos abertos de 552B de 10 de setembro, e DeepSeek V4 Pro, o carro-chefe de 1,6T que o changelog da DeepSeek diz que continua após 14 de setembro com sua cobrança inalterada. Nenhum dos dois é o assunto do tweet.
Então, a coisa útil a fazer com uma frase como esta não é discutir a data. É separar as partes que podem ser verificadas da parte que foi adivinhada — e este desejo em particular reúne três afirmações distintas, duas das quais são falsificáveis em cerca de dez minutos cada uma, e a terceira das quais é genuinamente interessante porque aponta para trabalho real que a DeepSeek já publicou. Aqui está cada uma delas, na ordem em que podem ser testadas.
O que é o sinal, em termos de evidência
O tweet é um parágrafo de uma conta que acompanha a DeepSeek de perto e já antecipou informações antes. Foi publicado às 02:36 UTC de segunda-feira, 28 de setembro de 2026, o que corresponde a 10:36 em Pequim — a mesma manhã para a qual prevê um lançamento. Não há nenhum documento da DeepSeek por trás disso, nenhuma segunda fonte, nenhum link de pré-visualização para desenvolvedores e nenhum custo para o autor se estiver errado. A conta não está descrevendo algo que viu; está descrevendo um formato que acredita que a agenda da DeepSeek tem.
Três afirmações estão empilhadas nele, e elas falham ou sobrevivem independentemente:
• Um número de versão. Que o próximo lançamento do harness seja numerado 0.2 — um incremento menor, em vez dos candidatos a lançamento 0.1.x que a DeepSeek vem distribuindo diariamente há seis semanas.
• Um modelo. Que o DeepSeek V4.1 Pro chegue a ser lançado como um produto, e que um leitor consiga chamá-lo.
• Uma chegada conjunta. Que a atualização do harness e o modelo cheguem juntos, numa segunda-feira, porque o modelo é "treinado adicionalmente para DSH e equipes de agentes."
O primeiro é verificável num registro de pacotes. O segundo é verificável no changelog, na tabela de preços e na organização da própria DeepSeek no Hugging Face. O terceiro é o único que exige algum julgamento, e é também o único em que o autor do tweet aponta para algo real.
Não há 0.2 no DeepSeek Harness
DeepSeek Harness é open source sob a licença MIT, publicado no GitHub e no npm, e ambos os canais podem ser lidos sem uma conta — o que faz desta a parte da afirmação mais barata de testar.
• npm — @deepseek-ai/dsh tem 27 versões publicadas. A mais alta é 0.1.7-rc.2. Não há 0.2.x em lugar nenhum no registro, e as dist-tags mostram latest: 0.1.7-rc.2, next: 0.1.7-rc.2, alpha: 0.1.7-alpha.2.
• GitHub — 22 versões publicadas, todas marcadas como pré-lançamento. A mais recente é dsh-v0.1.7-rc.2, publicada em 24 de setembro de 2026 às 14:10 UTC. O manifesto raiz do próprio repositório traz a mesma versão.
• A versão para desktop — A DeepSeek distribui um cliente empacotado para Windows e Apple Silicon por meio de seu próprio servidor de downloads, e seus dois feeds de atualização de produção reportam a versão 0.1.7-rc.2 com data de lançamento em 24 de setembro.
• A cadência — a linha 0.1 tem passado por builds alpha e release-candidate aproximadamente a cada um a três dias desde meados de agosto: 0.1.6-alpha.1 em 15 de setembro, 0.1.6-alpha.2 no dia 17, 0.1.7-alpha.1 e alpha.2 no dia 22, rc.1 no dia 23, rc.2 no dia 24. Nada nessa cadência está caminhando para uma tag 0.2; está caminhando para a versão estável 0.1.7.
Há uma mudança aqui sobre a qual um leitor pode agir, e ela é pequena, mas real: latest agora aponta para 0.1.7-rc.2, então npx @deepseek-ai/dsh web instala uma release candidate mais recente do que há alguns dias, quando o padrão ainda apontava para 0.1.5, enquanto o desktop já estava na 0.1-rc.2. A versão desktop e o padrão do npm finalmente convergiram. Isso é um evento de empacotamento — útil se você estiver instalando esta semana, irrelevante como evidência sobre um modelo.
Não há nenhum V4.1 Pro em lugar algum onde a DeepSeek registra as coisas

Esta é a metade com mais consequências, porque um rumor sobre uma versão de harness não custa nada a ninguém, enquanto um rumor sobre uma categoria flagship é o tipo de coisa que faz uma equipe planejar um trimestre inteiro em torno dela. A DeepSeek mantém quatro lugares em que um modelo lançado aparece, e o nome está ausente de todos os quatro.
• O changelog — A própria documentação da API da DeepSeek lista 21 entradas datadas, do DeepSeek V2.5 em setembro de 2024 até o presente. A mais recente é 10 de setembro de 2026, o lançamento do DeepSeek-V4.1-Flash. Nada datado depois disso, e "V4.1 Pro" não aparece em nenhuma entrada.
• A tabela de preços — A página de preços da DeepSeek expõe exatamente dois nomes de modelos hoje: deepseek-flash (versão DeepSeek-V4.1-Flash) e deepseek-v4-pro (versão DeepSeek-V4-Pro-0813), com limites de concorrência de 2.500 e 500, respectivamente. Um nível sucessor que um leitor poderia chamar precisaria de uma linha aqui, e não há linha.
• Hugging Face — o repositório mais recente da organização deepseek-ai é o DeepSeek-V4.1-Flash, criado em 10 de setembro de 2026 às 02:17 UTC, com mais de 650.000 downloads. As entradas por trás dele são de 31 de agosto e 13 de agosto. Nada mais recente, e nada com Pro no nome para a geração 4.1.
• Servindo — do nosso lado, a API de modelos do OrcaRouter retorna 404 para o DeepSeek V4.1 Pro tanto na grafia com hífen quanto na com ponto, enquanto DeepSeek V4.1 Flash e DeepSeek V4 Pro resolvem. A Artificial Analysis também não tem página para ele. Essas fontes são independentes da documentação do próprio DeepSeek e dizem a mesma coisa.
O nome não é totalmente novo — ele surgiu do lado do fornecedor no início de setembro, em reportagens sobre um plano de redirecionar o tráfego do DeepSeek V4 Pro para o V4.1 Flash, e foi nessas reportagens que a maioria dos leitores o conheceu pela primeira vez. O que a documentação da DeepSeek confirma hoje é mais restrito e menos empolgante: o serviço V4 Pro continua depois de 14 de setembro, e os identificadores Flash descontinuados ainda são aceitos e são atendidos pelo DeepSeek V4.1 Flash ao preço do Flash. Um plano não é um artefato. O arquivo que resolveria isso é um cartão de modelo, e não há nenhum.

A versão mais precisa dessa verificação está dentro do próprio DeepSeek Harness. O harness conversa com a API da DeepSeek por meio de seu próprio adaptador, e esse adaptador traz um catálogo de modelos padrão — a pequena lista de modelos que o cliente oferece antes que um usuário configure qualquer coisa. Ele tem exatamente duas entradas: deepseek-flash, exibido como DeepSeek-V41-Flash com entrada de texto e imagem, e deepseek-v4-pro, exibido como DeepSeek-V4-Pro. Não há uma terceira entrada. Se a DeepSeek estivesse preparando um nível Pro em torno do qual seu próprio harness fosse treinado ou ajustado, este arquivo — com duas entradas, no repositório público do próprio fornecedor — seria o lugar mais natural para ele aparecer primeiro, e ele não está lá.
A parte que é verificável: "treinado adicionalmente para equipes de agentes"
Esta é a cláusula que vale a pena levar a sério, porque é a única que corresponde a um trabalho que a DeepSeek realmente publicou, e porque explica por que alguém espera um lançamento conjunto em primeiro lugar.
Comece com o artigo. Em 19 de setembro, a DeepSeek submeteu DeepSeek Elastic Compute (DSec): Uma Infraestrutura de Sandbox para Treinamento Agêntico Eficaz em Escala ao arXiv (2609.22978). Ele descreve a plataforma por trás do treinamento e avaliação de agentes da DeepSeek: quatro backends de sandbox — FnCall, container, microVM e VM completa — por trás de um único SDK, imagens de ambiente transmitidas sob demanda do sistema de arquivos distribuído da empresa, e gerenciamento de ciclo de vida co-projetado com o loop de aprendizado por reforço, para que a execução de rollout com estado sobreviva ao treinamento em GPU preemptível. Uma unidade de produção tem cerca de 160 nós, servindo aproximadamente três milhões de sandboxes por dia, sustentando mais de 380.000 sandboxes simultâneas e mais de 5.000 criações por segundo. Uma seção é dedicada a agentes que aprenderam a pegar atalhos — forjando solicitações internas, lendo logs que não deveriam, e provocando um bug de kernel ao recursar em /proc — e às mitigações de AppArmor e eBPF que se seguiram.
Isso é infraestrutura de treinamento de agentes, publicada abertamente, três dias antes da janela do tweet. É evidência de que a DeepSeek está construindo a maquinaria de que uma alegação de "treinado para equipes de agentes" precisaria. Não é evidência sobre um cronograma.
Em seguida, o lado do harness. O Agent Teams existe no DeepSeek Harness como quatro plugins publicados sob nomes de pacotes experimentais, enviados pela primeira vez ao npm em 9 de setembro e agora acompanhando a linha 0.1.7. Uma nota de arquitetura datada de 18 de setembro consolidou o arranjo anterior de dois interruptores em um único pacote opcional que reúne o serviço de equipe, as ferramentas e o painel do navegador — e o deixou desativado por padrão na página de plugins. As notas de versão da 0.1.7-rc.1, de 23 de setembro, descrevem o que o painel faz agora: ele mostra os membros da equipe e suas tarefas em tempo real, pode ser aberto ou alternado a partir do cabeçalho da página de sessão, e as ferramentas de equipe se referem aos membros pelo nome. As mesmas notas registram uma mudança "ajustando o dimensionamento de imagens e a estimativa de tokens para acomodar o DeepSeek V4.1" — o harness se ajustando para o modelo atual, não para um futuro.
Por fim, o model card. O próprio cartão da DeepSeek para o DeepSeek V4.1 Flash afirma que seus benchmarks de agente de código — Terminal-Bench, DeepSWE, NL2Repo-Bench, ProgramBench — foram executados "com o modo Minimal do DeepSeek Harness e uma janela de contexto de 1M de tokens". Isso é um fornecedor dizendo que seus números de agente foram produzidos dentro do seu próprio harness. Também significa que esses números são relatados pelo fornecedor e não reproduzidos: o DS-V4.1-Flash obtém 90,6 no Terminal-Bench 2.1 e 74,2 no DeepSWE v1.1 na configuração própria da DeepSeek, e ninguém fora da DeepSeek os executou novamente. A visão independente é mais escassa e vem de outra data: os números da Artificial Analysis apresentados nas páginas de modelos da OrcaRouter colocam o DeepSeek V4.1 Flash com um Índice de Inteligência de 39,5 (avaliado em 10 de setembro) e o DeepSeek V4 Pro com um Índice de Codificação da AA de 68,8 (avaliado em 13 de agosto). Essas duas linhas são de avaliações diferentes, com dias de diferença em meses distintos, portanto não são uma comparação em pé de igualdade — leia-as como dois instantâneos, não como um único placar.
Por que "na segunda-feira" seria incomum — e por que a ressalva importa mais
O histórico de lançamentos da DeepSeek é público e, lido como um calendário, argumenta gentilmente contra a primeira metade do tweet.
• Os lançamentos recentes saem à quinta ou à sexta-feira — 10 de setembro de 2026 foi uma quinta-feira, 21 de agosto uma sexta-feira, 13 de agosto uma quinta-feira, 31 de julho uma sexta-feira, 24 de abril uma sexta-feira.
• As segundas-feiras não são inéditas, apenas raras — a última entrada em uma segunda-feira em todo o changelog é o DeepSeek V3.2 em 1 de dezembro de 2025, aproximadamente dez meses antes de hoje.
• A regra de feriados está escrita na tabela de preços — as janelas de cobrança de pico da DeepSeek são 01:00–04:00 e 06:00–10:00 UTC, de segunda a sexta-feira, "excluindo feriados públicos chineses", com todas as outras horas fora de pico, incluindo feriados integralmente. Uma empresa que exclui feriados públicos do seu próprio calendário de cobrança está dizendo que não opera nesses dias. O Dia Nacional é 1º de outubro.
É essa a interpretação à qual a segunda frase do tweet chega, e é a metade mais útil. "Pelo menos na próxima semana até quinta-feira" puxa na direção oposta a "na segunda-feira": afasta o período plausível do dia nomeado pelo tweet e o aproxima do limite no fim da semana de trabalho, que é exatamente onde o feriado começa. Qualquer que seja a segunda-feira a que o autor se refere, a quinta-feira que delimita a janela é o último dia útil normal antes da pausa. A DeepSeek não lançou nada durante um período de Feriado Nacional.
Onde um lançamento de verdade apareceria primeiro
Esta é a parte que vale a pena guardar nos favoritos, porque cada um destes é verificável com um único carregamento de página e nenhum deles depende do julgamento de um rastreador:
• Uma segunda entrada no changelog. A página de atualizações da API da DeepSeek é o primeiro lugar onde o lançamento de um modelo aparece, e é onde estão definidos os dois modelos que podem ser chamados atualmente. Sua entrada mais recente hoje é o lançamento Flash de 10 de setembro.
• Um repositório na organização deepseek-ai com "Pro" no nome. O repositório mais recente da organização é o DeepSeek-V4.1-Flash, de 10 de setembro; um novo ficaria visível imediatamente.
• Uma terceira linha no catálogo de modelos do harness. O arquivo de adaptador acima tem duas entradas, está em um repositório público, e um nível Pro para o qual o harness foi ajustado seria o acréscimo óbvio.
• Uma linha de preço e um limite de concorrência. A DeepSeek informa limites de disponibilidade na tabela de preços, e um nível de ponta chegaria com ambos.
• Uma tag acima de 0.1.x no npm ou no feed do desktop. Para a metade da alegação relativa ao harness, este é o teste completo — e os feeds estão estáticos em 0.1.7-rc.2 desde 24 de setembro.
O que fazer nesse meio tempo

Há uma assimetria prática nesta história. O modelo que todos estão esperando não tem o que chamar, enquanto os dois modelos DeepSeek que funcionam estão ambos roteando hoje — e um deles, o DeepSeek V4.1 Flash, é o lançamento que de fato fez a família avançar há duas semanas e meia.
Ambos estão no OrcaRouter por trás de uma única chave de API, pelo preço de tabela do provedor, repassado sem markup: DeepSeek V4.1 Flash a $0,15 de entrada e $0,60 de saída por milhão de tokens, e DeepSeek V4 Pro a $0,66 e $1,98, fora de pico, com um multiplicador de 2× dentro das janelas de pico da DeepSeek. Como o repasse é literal, é o próprio multiplicador de pico e fora de pico da DeepSeek que chega à fatura, e uma mudança de preço do lado do fornecedor aparece do nosso lado no dia em que a DeepSeek a faz, em vez de quando uma tabela de preços é atualizada. Se você está fixando um caminho de produção em um desses modelos, uma failover automática é a proteção barata contra um solavanco do lado do provedor durante uma semana de lançamento — o tipo de semana em que a API da DeepSeek tem mais chance de estar ocupada e muita gente está reescrevendo suas configurações.
Para ser explícito quanto ao limite: o DeepSeek V4.1 Pro não é algo que hospedamos, e não vamos afirmar o contrário. Não tem identificador para rotear. Nada neste artigo é uma prévia dele, e, no momento em que tiver uma linha de preço e um repositório, passa a ser um problema de página de modelo, e não um problema de rumor.
O resumo honesto
Duas das três afirmações neste tweet são falsas à data de hoje, no sentido estrito de que os artefactos que exigem não existem. Não há uma 0.2 no DeepSeek Harness — 27 versões npm, 22 pré-lançamentos no GitHub, dois feeds de desktop, todos eles na 0.1.7-rc.2, todos eles desde 24 de setembro. Não existe DeepSeek V4.1 Pro — nem no registo de alterações, na tabela de preços, na organização Hugging Face, no catálogo de modelos do próprio harness, nem nas nossas páginas ou nas da Artificial Analysis. A terceira afirmação, de que a próxima grande novidade está a ser treinada para equipas de agentes, é aquela que tem trabalho publicado real por trás: um artigo de sistemas sobre a plataforma de sandbox de agentes da DeepSeek, de 19 de setembro, uma linha de plugins Agent Teams que está exposta publicamente desde 9 de setembro e continua desligada por predefinição na página de plugins, e um cartão de modelo que diz abertamente que os próprios números de benchmark agêntico da DeepSeek foram produzidos dentro do DeepSeek Harness. Nada disso é um cronograma. Tudo isso é a razão pela qual o cronograma continua a ser adivinhado.
Trate a data como uma hipótese e os artefactos como factos. O registo de alterações, a organização Hugging Face e o catálogo de modelos do harness são onde isto se resolve, e os três estão a um carregamento de página de distância. Até que um deles mude, um "em conjunto com o V4.1 Pro na segunda-feira" é um desejo numa frase que se resguarda até quinta-feira — e a quinta-feira em questão é o último dia útil antes de um feriado nacional.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
