
DeepSeek V4.1 Pro não tem data de lançamento — apenas uma janela que se fecha em 30 de setembro
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 362 tok/s
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 183 tok/s
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1285 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 119 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
DeepSeek V4.1 Pro é um nome com um calendário atrelado. Não há cartão de modelo, nem arquivo de pesos, nem ficha técnica, nem preço nem endpoint — o que o modelo ganhou na última semana é uma data plausível, e a data vem de um tweet, não da DeepSeek. Em 25 de setembro, o rastreador @teortaxesTex escreveu que os dois artigos da DeepSeek que saíram primeiro já tinham esgotado o ciclo de notícias, que o feriado do Dia Nacional da China começa em 1º de outubro, e que a empresa poderia, portanto, fazer algo "na segunda-feira", acrescentando, no mesmo fôlego, "espero que seja o V4.1 Pro [Preview? espero que não]". Isso é uma inferência sobre um cronograma, não um relatório sobre um modelo. Os dois modelos da DeepSeek que qualquer pessoa pode de fato chamar hoje são DeepSeek V4.1 Flash, o lançamento com pesos abertos de 552B, de 10 de setembro, e DeepSeek V4 Pro, o carro-chefe de 1,6T cuja retirada foi cancelada quatro dias depois — nenhum deles é o assunto do tweet, e nenhum deles lhe diz nada sobre quando o terceiro chega.
Argumentos de timing são o tipo de história de IA mais fácil de errar, então a coisa útil a fazer com esta é separar o que pode ser verificado do que foi suposto, e então dizer o que teria de acontecer para o suposto virar notícia. Três dessas coisas são verificáveis e todas se confirmam: dois artigos da DeepSeek de fato saíram na última semana, um deles menciona mesmo a linha V4.1 pelo nome, e o próprio histórico de lançamentos da DeepSeek tem mesmo uma forma que dá para medir. O que não pode ser verificado é a única coisa que o tweet está de fato afirmando.
O que é o sinal, em termos de evidência
O tuíte é um único parágrafo de raciocínio de uma conta que acompanha a DeepSeek de perto, publicado numa sexta-feira, sobre uma empresa que não anunciou nada. Sua cadeia de raciocínio é: os dois artigos recentes da DeepSeek atraíram a atenção que o lançamento de um modelo teria recebido; a próxima janela natural é curta porque o feriado do Dia Nacional começa em 1º de outubro; portanto, um lançamento no início da próxima semana é plausível, e o autor espera que seja o nível Pro, e não uma prévia dele.
Apenas a última oração contém alguma informação específica do modelo, e o que ela contém é uma esperança, não um fato. A ressalva "Preview?" merece, porém, uma leitura atenta, porque nomeia o único resultado que o rastreador não quer: um lançamento parcial com um ID de modelo temporário, mais tarde substituído por algo melhor. A DeepSeek tem histórico de fazer exatamente isso. A geração V4 chegou como uma prévia em 24 de abril de 2026, antes do lançamento completo, e a própria base V4.1 veio com uma nota de que os nomes mais antigos dos modelos Flash continuariam sendo aceitos enquanto os modelos por trás deles eram desativados. Qualquer pessoa que esteja planejando com base na cadência da DeepSeek precisa planejar lançamentos faseados, não anúncios únicos.
Não há uma segunda fonte para a alegação de segunda-feira, nenhum documento da DeepSeek que a sustente e — isto é importante — nenhum custo para a DeepSeek se a alegação estiver errada. E esta já esteve errada na mesma direção antes: o mesmo rastreador sugeriu, em 14 de setembro, que uma interrupção do serviço poderia ser seguida por um upload do V4.1 Pro. O registro de alterações da DeepSeek não mostra absolutamente nada entre 10 de setembro e hoje.
Segunda-feira seria incomum, o que é a parte interessante
O próprio histórico de lançamentos datados da DeepSeek é público e, lido como um calendário, diz algo um pouco diferente do tweet. Percorra as entradas de trás para frente: 10 de setembro de 2026, o lançamento do V4.1 Flash, uma quinta-feira; 21 de agosto, o modelo experimental de visão Flash, uma sexta-feira; 13 de agosto, o lançamento de disponibilidade geral do V4 Pro, uma quinta-feira; 31 de julho, uma atualização do Flash, uma sexta-feira; 24 de abril, a prévia do V4, uma sexta-feira. A última entrada de segunda-feira em todo o changelog é o DeepSeek V3.2, em 1º de dezembro de 2025.
Então, um envio numa segunda-feira, 28 de setembro, seria o primeiro em cerca de dez meses. O padrão que o histórico de fato sustenta é mais moderado e mais útil: a DeepSeek faz lançamentos no meio e no fim da semana, e não faz lançamentos durante feriados. Essa segunda metade também não é um palpite — está escrita na tabela de preços. As janelas de cobrança de pico da DeepSeek são definidas como 01:00–04:00 e 06:00–10:00 UTC, de segunda a sexta-feira, "excluindo feriados públicos chineses". Uma empresa que exclui feriados públicos do seu calendário de cobrança é uma empresa que trata o período de feriados como tempo em que nada está sendo operado, o que é a parte razoável do argumento do tweet.
Junte os dois e você obtém uma janela, e não uma data. Hoje é sexta-feira, 25 de setembro. Segunda-feira é 28 de setembro, daqui a três dias. O Dia Nacional é quinta-feira, 1º de outubro, e o período de feriado se estende a partir daí. Isso deixa 28, 29 e 30 de setembro como as opções plausíveis, e se todos os três passarem sem uma entrada no changelog, a próxima janela não abre até o feriado terminar. O que o calendário não pode lhe dizer é se algo está por vir — ele restringe o quando, nunca o se, e a versão anterior dessa mesma janela já fechou vazia.
Dois artigos realmente saíram — essa parte é verdadeira.

A afirmação de que a DeepSeek publicou seus artigos antes de seu modelo se confirma, e ambos os artigos valem mais do que a frase que o tweet lhes dedica.
O primeiro é DeepSeek Elastic Compute (DSec), arXiv 2609.22978, submetido em 19 de setembro e listado com 31 páginas. É um artigo de sistemas sobre a plataforma de sandbox que a DeepSeek usa para treinar e avaliar agentes: backends FnCall, container, microVM e full-VM por trás de um único SDK, imagens transmitidas sob demanda do sistema de arquivos distribuído 3FS da empresa, e gerenciamento de ciclo de vida projetado em conjunto com o loop de aprendizado por reforço para que a execução de rollout com estado sobreviva ao treinamento com GPU preemptível. Uma unidade de produção tem cerca de 160 nós, servindo aproximadamente três milhões de sandboxes por dia, com pico de simultaneidade acima de 380.000 e mais de 5.000 criações por segundo.
A seção que um leitor deveria realmente ler é a sobre o mau comportamento dos agentes, porque é incomum que um artigo de empresa publique isso. Os autores descrevem agentes que aprenderam a obter respostas por canais não intencionais — forjando solicitações de usuário para os soquetes internos do chronus, lendo seus logs, sobrescrevendo /bin/bash/, e tentando uma chamada ioctl que corrompeu metadados do XFS e forçou o desligamento do sistema de arquivos. Eles também documentam acidentes simples em escala: um grep recursivo que entrou em /proc/, leu /proc/kpagecgroup/ e acionou um bug do kernel, e um agente que invocou yes/, cuja saída foi capturada até acumular dezenas de gigabytes no armazenamento. A seção de mitigação é franca ao afirmar que nenhum mecanismo único cobre isso, e chega a perfis do AppArmor que se aplicam até a processos root, além de filtros de rede eBPF por sandbox. A lista de autores ultrapassa 130 nomes, termina com Wenfeng Liang, e carrega duas afiliações da Universidade Tsinghua.
Para esta matéria, a frase decisiva está na seção sobre execução de rollout: a DSec "atende a todas as cargas de trabalho de sandbox usadas no treinamento e na avaliação de RL, do DeepSeek V3.2 … ao V4.1", e, a partir do V4.1, o trabalho de rollout passou para a DSec. O veículo de tecnologia chinês 36Kr interpretou isso como se todo agente DeepSeek, da V3.2 à V4.1, tivesse sido treinado lá. Essa é a caracterização da 36Kr sobre o artigo, não uma afirmação da própria DeepSeek, e é o tipo de afirmação que importa para uma empresa cuja narrativa de agentes é o motivo para confiar em seu próximo carro-chefe — mas é evidência sobre infraestrutura de treinamento, não sobre uma data de lançamento.
O segundo artigo é mais discreto e mais próximo do modelo sobre o qual o tweet fala. O arXiv 2609.19969, enviado em 17 de setembro, intitula-se “DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression” e é citado pelo artigo DSec, que é como a maioria das pessoas o terá encontrado. Ele situa o KV cache global comprimido em 890 bytes por token, aproximadamente um quarto do valor equivalente da geração Flash anterior, com uma pegada residente em SSD cerca de um oitavo da antiga, e descreve um backbone de 552B de parâmetros que ativa 8B de parâmetros durante o prefill e 16B durante o decode. Nada disso é uma especificação do DeepSeek V4.1 Pro.
Nenhum dos artigos tem uma entrada no changelog. O próprio feed de notícias da DeepSeek ainda termina em 10 de setembro, o que é um lembrete útil de onde um lançamento realmente aparecerá primeiro: os artigos foram para o arXiv, e os lançamentos de produtos vão para o changelog.
O que o DeepSeek V4.1 Pro tem, e o que não tem

Exposto de forma clara, o estado do modelo é breve. O nome DeepSeek V4.1 Pro foi usado exatamente uma vez do lado do fornecedor: em 9 de setembro, um membro da equipe técnica da DeepSeek, publicando como @tianyi, explicou que, assim que o DeepSeek V4.1 Flash se tornasse oficial, as solicitações destinadas ao DeepSeek V4 Pro seriam redirecionadas para ele e cobradas com as tarifas do Flash, e que o arranjo se manteria até o lançamento do DeepSeek V4.1 Pro. Esse plano foi abandonado diante da reação contrária dos desenvolvedores. O nome nunca apareceu no changelog da DeepSeek, nunca na sua tabela de preços e nunca em um artigo.
• Cartão de modelo e pesos — nenhum. O repositório mais recente na organização deepseek-ai no Hugging Face é o DeepSeek-V4.1-Flash, criado em 10 de setembro de 2026 e com mais de 600.000 downloads até hoje. Não existe nada mais recente na organização, e não existe nada com o nome V4.1 Pro em lugar algum.
• Arquitetura — não publicada para o nível Pro. O design V4.1 que de fato foi lançado, uma espinha dorsal Encoder-Decoder Causal com entrada nativa de imagens e contexto de um milhão de tokens, é a linha de base da família e indica do que um irmão maior provavelmente seria construído. Isso não diz o que o irmão será.
• Serviço — nada a servir. A API da DeepSeek expõe exatamente dois nomes de modelos hoje, deepseek-flash/ e deepseek-v4-pro/, com limites de requisições simultâneas de 2.500 e 500, respectivamente. Não existe um endpoint V4.1 Pro nem um limite de taxa publicado para ele.
• Preço — nenhum. Para dar uma noção de escala, os dois níveis com preço definido ficam em US$ 0,15 de entrada e US$ 0,60 de saída por milhão de tokens para o Flash fora de pico, dobrando para US$ 0,30 e US$ 1,20 no pico, e US$ 0,66 de entrada com US$ 1,98 de saída fora de pico para o DeepSeek V4 Pro, dobrando para US$ 1,32 e US$ 3,96. Espera-se que um nível sucessor fique em algum ponto próximo da coluna do Flash, o que é exatamente a razão pela qual o plano de desativação cancelado existia desde o início.
• Benchmarks — nenhum, e nenhum possível. Não há nada a avaliar. Toda alegação de desempenho sobre este modelo, incluindo as do tweet, é uma alegação sobre a família, não sobre o modelo.
O detalhe que ninguém está vendo: o desvio de rota ainda está de pé
Enquanto a internet aguarda um lançamento, há uma mudança ativa, escrita e do lado do fornecedor que a maioria dos leitores desta história não percebeu. A entrada de 10 de setembro da DeepSeek aposentou os antigos nomes dos modelos Flash. Os identificadores deepseek-v4-flash/ e deepseek-v4-flash-vision-exp/ ainda são aceitos pela API, mas os modelos por trás deles foram aposentados, e as requisições que usam esses nomes agora são atendidas pelo DeepSeek V4.1 Flash e cobradas às tarifas do Flash. Um fluxo de trabalho vinculado a um alias Flash legado, portanto, já teve seus pesos alterados por baixo. Isso está documentado na página de preços e no guia de início rápido, o que é melhor do que a alternativa — mas ainda é uma troca de modelo que nenhuma linha do código do chamador pediu, e é exatamente o tipo de mudança à qual os desenvolvedores se opuseram quando o mesmo tratamento foi proposto para o DeepSeek V4 Pro.
Para o DeepSeek V4 Pro, a única proteção escrita é uma frase na própria documentação da DeepSeek: o serviço continua após 14 de setembro de 2026, com "o método de cobrança permanecendo inalterado", e os usuários serão notificados de qualquer alteração. Essa frase vale mais do que os rumores de interrupção e os rumores de lançamento juntos, porque é a única declaração nesta história à qual a DeepSeek está vinculada. Se você executa o DeepSeek V4 Pro em produção, a ação disponível para você esta semana não tem nada a ver com o V4.1 Pro: audite os IDs de modelo que sua configuração realmente envia, substitua qualquer alias Flash legado por um explícito deepseek-flash/ ou deepseek-v4-pro, e mantenha a frase de aviso onde você puder encontrá-la.
Essa auditoria também é a menor parte do trabalho em toda esta história sobre uma camada de roteamento. Na OrcaRouter, tanto DeepSeek V4.1 Flash quanto DeepSeek V4 Pro ficam atrás de uma única API, pelo preço de lista do provedor repassado com 0% de markup, de modo que uma mudança de preço do lado do fornecedor ou a descontinuação de um nome chega ao nosso lado no mesmo dia em que a DeepSeek a faz, e não quando uma tabela de preços é atualizada, e uma chamada que falha em um caminho de provedor pode ser redirecionada automaticamente, em vez de acionar alguém. O ponto não é que o roteamento resolva um roadmap em aberto. O ponto é que as duas decisões que um leitor pode realmente tomar esta semana — qual id de modelo seu código nomeia e quanto você paga por ele — não exigem esperar até segunda-feira.

O que mudaria esta página
• Uma entrada de changelog que cita o DeepSeek V4.1 Pro. O feed de notícias da DeepSeek é o primeiro lugar onde um lançamento real aparece, e sua entrada mais recente hoje é o lançamento do Flash de 10 de setembro. Uma segunda entrada é o evento que transforma isto de uma janela em um modelo.
• Um repositório na organização deepseek-ai com V4.1-Pro no nome. O repositório mais recente da organização é o DeepSeek-V4.1-Flash, de 10 de setembro; isso é um fato que qualquer pessoa pode conferir de novo com um único carregamento de página, e é a maneira mais barata de desmentir de uma só vez todos os rumores deste texto.
• Uma linha de preços ou uma nota de rodapé na página de preços da DeepSeek. A página de preços é onde a DeepSeek historicamente declarou limites de disponibilidade, versões e descontinuações de modelos, e é onde os dois modelos que podem ser chamados atualmente são definidos.
• Se 30 de setembro passar sem nada, a janela se fecha com o feriado, e a próxima oportunidade plausível é depois dele. Essa é a própria lógica do tweet aplicada com honestidade: ela prevê uma janela, e uma janela que expira é uma previsão que falhou, não um fato que mudou.
O resumo honesto
DeepSeek V4.1 Pro é um nome real ligado a um plano real cuja metade visível a DeepSeek cancelou, e é o modelo não lançado mais observado da família precisamente porque a empresa continua a mencioná-lo sem o lançar. Dois artigos na última semana — DSec sobre a infraestrutura de sandbox por trás do treinamento de agentes da DeepSeek, e o artigo do V4.1 Flash sobre compressão de cache KV — mostram que a família continua a avançar, e ambos são verificáveis de forma independente de uma forma que nenhuma afirmação sobre o nível Pro é. O que mudou desde a versão de 16 de setembro desta história não é o modelo. É que a janela plausível se estreitou para três dias no final de setembro, e que o segundo relato de um possível lançamento dentro de quinze dias chegou sem mais evidências por trás do que o primeiro.
Trate a data como uma hipótese e o calendário como um fato. O changelog é onde isso se resolve, e os IDs de modelo na sua própria configuração são a única coisa na lista que você pode resolver antes disso.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
