
DeepSeek V4.1 Pro Está em Desenvolvimento: Um Aviso de Roteamento, uma Promessa de Arquitetura e o Que Ainda é Desconhecido
- openaiNOVOOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleNOVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenNOVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligência72Código
- anthropicNOVOAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaNOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123Inteligência49Código
DeepSeek V4.1 Pro não foi anunciado, listado, submetido a benchmarks ou precificado. Ele não aparece em nenhuma página de modelos, não tem ficha e nenhum endpoint responde ao seu nome — mas em 9 de setembro de 2026, um membro da equipe técnica da DeepSeek o declarou publicamente, quase de passagem, dentro de um aviso de duas frases sobre o que acontecerá com o tráfego do DeepSeek V4 Pro nesse meio tempo. Tianyi Cui, que publica como @tianyi, escreveu que, assim que o DeepSeek V4.1 Flash for lançado oficialmente — previsto para cerca de 10 de setembro, horário de Pequim —, todas as solicitações de API destinadas ao DeepSeek V4 Pro serão redirecionadas para o DeepSeek V4.1 Flash e cobradas pela tarifa mais baixa do Flash, e que esse arranjo permanece até que o próprio DeepSeek V4.1 Pro entre no ar.
Essa cláusula final é a novidade. Até agora, a linha V4.1 só havia aparecido através do beta de "versão intermediária" de dois dias que começou a servir em 8 de setembro sob o ID de modelo deepseek-v4.1-flash-expires-on-0910, além de um formulário de feedback perguntando aos testadores se o V4.1 Flash poderia substituir o DeepSeek V4 Pro em produção. Nomear o DeepSeek V4.1 Pro como ponto final da janela de roteamento é a primeira vez que o carro-chefe é reconhecido internamente pela empresa. O observador pseudônimo do DeepSeek, teortaxesTex, que citou o aviso, interpretou da mesma forma — e então acrescentou uma afirmação mais forte: que a existência do DeepSeek V4.1 Pro é a confirmação de que o DeepSeek "resolveu problemas arquiteturais da família V4, como se comprometeram a fazer no artigo do V4."
Uma nota sobre as fontes antes dos detalhes. Tudo o que se segue sobre o DeepSeek V4.1 Pro baseia-se em duas coisas: uma única publicação social datada de um membro da equipe técnica da DeepSeek, corroborada em poucas horas por vários veículos chineses, e a interpretação de um rastreador sobre ela. Não há relatório técnico, nem contagem de parâmetros, nem data de lançamento, e não há como acessar o modelo hoje. O aviso de roteamento é uma declaração; a leitura de "arquitetura resolvida" é inferência. Este texto mantém as duas coisas separadas, porque são tipos diferentes de evidência.
O que o aviso de 9 de setembro realmente disse
Por volta das 15h14, horário de Pequim, em 9 de setembro, Tianyi Cui escreveu no X que continuar vendendo o antigo DeepSeek V4 Pro com um preço premium não fazia mais sentido. Seu raciocínio, em suma: testes internos e externos mostram que o modelo V4.1 Flash supera de forma abrangente o DeepSeek V4 Pro em desempenho, custo, velocidade e tempo total de processamento. Portanto, cobrar dos usuários mais dinheiro, velocidades mais lentas e maior poder computacional por um modelo mais fraco seria inadequado. Assim, quando o V4.1 Flash for oficialmente lançado e até o lançamento do V4.1 Pro, as solicitações para o modelo V4 Pro serão uniformemente redirecionadas para o V4.1 Flash e cobradas pelo preço do Flash.
Essa alegação de "supera de forma abrangente" vem da própria equipe da DeepSeek, não foi verificada de forma independente: nenhuma tabela de benchmarks acompanhou a postagem, e o beta do V4.1 Flash também não tem model card. O que é verificável é o formato do plano. A DeepSeek está tratando seu nível Pro atual como obsoleto assim que o Flash se tornar oficial, e redirecionando o tráfego do Pro para o modelo mais barato até que o próximo Pro exista.
O que significa se você chamar o DeepSeek V4 Pro hoje
Para quem está rodando o atual carro-chefe — DeepSeek V4 Pro, o MoE de 1,6 trilhão de parâmetros que atingiu GA em meados de agosto — a mudança é automática e do lado do servidor. Assim que o redirecionamento entrar em vigor, uma requisição que especifica o modelo V4 Pro será atendida pela build V4.1 Flash e cobrada de acordo com a tabela de preços do Flash, sem nenhuma alteração de código do lado de quem faz a chamada. A mudança na cobrança é a parte mais contundente. A mídia chinesa que noticiou o comunicado estimou o preço máximo de saída da nova tabela Flash em ¥8 por milhão de tokens a partir de 10 de setembro, contra ¥27 por milhão para o nível Pro que ela substitui — um corte de cerca de 70% para o tráfego que costumava acessar o Pro, em um modelo que a equipe da DeepSeek afirma ser mais rápido. Como um anúncio que combina upgrade e redução de preço, é agressivo até para os padrões da DeepSeek.

Uma ressalva de cronograma, porque o enquadramento importa: se você tem uma chave DeepSeek V4 Pro hoje, nada muda até que o V4.1 Flash seja efetivamente lançado, e a descrição do redirecionamento vem da publicação da equipe e da cobertura feita sobre ela — ainda não de uma entrada de changelog. Conforme a captura de 9 de setembro acima, a página oficial de modelos da DeepSeek ainda listava a linha V4 padrão — DeepSeek V4 Flash, DeepSeek V4 Pro e DeepSeek-V4-Flash-Vision-Exp — sem nenhuma entrada V4.1 na tabela.
Por que "o documento V4" é a chave para o vazamento
A alegação específica de teortaxesTex é que o fato de o DeepSeek V4.1 Pro estar em desenvolvimento confirma que a DeepSeek resolveu os problemas arquiteturais da família V4 "como eles se comprometeram a fazer no artigo do V4." Essa referência é verificável. O relatório técnico do DeepSeek V4 — DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence — é excepcionalmente franco sobre o que o seu design ainda não faz bem e sobre o que as futuras iterações pretendiam abordar:
O relatório classifica sua própria arquitetura como "relativamente complexa" e assume o compromisso de que "em iterações futuras, realizaremos investigações mais abrangentes e fundamentadas para destilar a arquitetura até seus designs mais essenciais."
• Seus dois mecanismos de estabilização de treinamento — Anticipatory Routing e SwiGLU Clamping — funcionaram na prática, diz o relatório, mas seus princípios subjacentes permaneceram "insuficientemente compreendidos".
• A recuperação de contexto longo ainda decai após 128K tokens. Em um teste de recuperação com 8 agulhas citado no relatório, o V4-Pro-Max pontua aproximadamente 0,92 em 128K e cai para cerca de 0,59 em 1M — a diferença entre "pode carregar um milhão de tokens" e "pode realmente usá-los".
• E a linha V4 foi lançada somente com texto; a visão chegou mais tarde como um codificador experimental acoplado, DeepSeek-V4-Flash-Vision-Exp, em vez de fazer parte do modelo base.
Lendo contra essa lista, a história do V4.1 fica em foco. A própria descrição da DeepSeek sobre o beta do V4.1 Flash usa exatamente a linguagem que essas questões implicavam — uma "nova estrutura de modelo" e suporte multimodal nativo desde o início. Um V4.1 Pro construído sobre a mesma base resolvida é o próximo passo natural, que é precisamente a inferência que teortaxesTex está fazendo. É uma inferência, e deve continuar rotulada como tal: a DeepSeek não publicou nenhum relatório técnico do V4.1, e "em desenvolvimento" não é confirmado além da referência de um membro da equipe ao eventual lançamento do Pro.
O registro de evidências — o que é confirmado e o que não é
Sobrepor o sinal de 9 de setembro à versão beta de 8 de setembro resulta em uma curta lista de fatos confirmados e uma longa lista de questões em aberto.

• Declarações do fornecedor (corroboradas por vários veículos chineses em poucas horas) — A DeepSeek tem um modelo V4.1 Flash que planeja lançar em torno de 10 de setembro, horário de Pequim; o tráfego da API do DeepSeek V4 Pro será roteado para ele e cobrado pelas tarifas do Flash até o lançamento do V4.1 Pro; e a equipe da DeepSeek acredita que a versão Flash supera o Pro atual em custo, velocidade e tempo total.
• Plausível, porém não verificado — que o DeepSeek V4.1 Pro está atualmente em treinamento ou iminente de outra forma. O "em andamento" de teortaxesTex não traz data nem fonte interna; a única corroboração é a própria janela de roteamento, que pressupõe que um Pro acabará existindo.
Interpretação — que a existência do Pro prova que as promessas arquitetônicas do artigo do V4 foram cumpridas. As afirmações da versão beta do V4.1 Flash sobre "nova estrutura, multimodalidade nativa" apontam na mesma direção, mas nenhuma arquitetura do V4.1 foi publicada para verificá-las.
• Desconhecido — as especificações do V4.1 Pro, contagem de parâmetros, janela de contexto, preço, data de lançamento e se ele disponibiliza pesos abertos da mesma forma que o DeepSeek V4 Flash e o DeepSeek V4 Pro fizeram. O beta atual do V4.1 Flash é apenas via API e está prestes a expirar, então a questão dos pesos abertos está genuinamente em aberto, não apenas sem resposta.
O que assistir
• 10 de setembro, horário de Pequim — o lançamento oficial do V4.1 Flash, sua nova tabela de preços e o início do redirecionamento do V4 Pro. Se isso acontecer como descrito, o ID do modelo "DeepSeek V4 Pro" começa a retornar uma arquitetura V4.1 a preços de Flash a partir desse dia.
• Um relatório técnico V4.1 ou um cartão do modelo — a versão beta não tem nenhum dos dois, e o primeiro cartão é o que transformaria as afirmações sobre a arquitetura em algo que um revisor possa verificar.
• Primeiros benchmarks independentes — se a base V4.1 realmente corrige as lacunas conhecidas do relatório V4: recuperação além de 128K, e o déficit de raciocínio que o próprio relatório estimou em cerca de três a seis meses atrás dos modelos de fronteira.
• Nomeação e cronograma do V4.1 Pro — se o modelo que teortaxesTex chama de DeepSeek V4.1 Pro aparece como um cartão distinto, e com que rapidez ele chega após o Flash.
O que fazer enquanto isso
Ainda não há nada a anunciar. O DeepSeek V4.1 Pro não está em nenhuma API, e conectar a produção a um ID de modelo beta de dois dias seria um erro por si só. A notícia do redirecionamento, no entanto, muda um cálculo para os atuais usuários do DeepSeek V4 Pro: o modelo pelo qual eles pagam tarifas premium está prestes a ser oficialmente declarado descontinuado, o que argumenta contra firmar um compromisso de longo prazo com ele agora e a favor de aguardar o lançamento do Flash antes da próxima decisão de compra.
Essa postura de esperar para ver é exatamente onde uma camada de roteamento mostra seu valor. No OrcaRouter, DeepSeek V4 Flash, DeepSeek V4 Pro e DeepSeek-V4-Flash-Vision-Exp são acessíveis por meio de uma única API pelo preço de tabela da DeepSeek, repassado sem nenhum markup — então uma mudança de preço ou um novo roteamento do lado do fornecedor aparece no nosso lado no mesmo dia em que é lançado, não quando uma planilha de preços é atualizada. Quando o V4.1 Flash se tornar oficial e, mais tarde, se o V4.1 Pro aparecer, a mesma configuração é a forma de baixo custo de migração para adotá-los: envie uma fatia do tráfego para o novo modelo, mantenha um modelo estável como failover automático e deixe o DSL de roteamento decidir quais chamadas merecem um modelo não comprovado e quais devem permanecer no cavalo de batalha.

O ponto principal de um roteiro de duas frases.
A forma mais limpa de ler o sinal de 9 de setembro é que a DeepSeek disse ao mercado, da forma mais casual possível, que seu carro-chefe atual é um paliativo. O V4.1 Flash é a prova do lançamento, o redirecionamento é a admissão de que o DeepSeek V4 Pro, como é vendido hoje, já está superado, e a única frase "até o lançamento do V4.1 Pro" é o roteiro. O que falta nessa frase é tudo o que transformaria o DeepSeek V4.1 Pro de um vazamento em uma decisão de produto: uma data, uma especificação, um preço, um benchmark e qualquer evidência além da leitura de um rastreador de que as promessas arquitetônicas do artigo do V4 foram realmente cumpridas. Até que a DeepSeek publique algo, a posição racional é a que teortaxesTex defende — tratar o V4.1 Pro como real, tratar cada detalhe sobre ele como não confirmado e tratar o lançamento do Flash por volta de 10 de setembro como a primeira parcela verificável da arquitetura V4.1.
Embora o DeepSeek V4.1 Pro ainda não tenha nada a anunciar, o carro-chefe atual que você pode acessar por meio de uma única API hoje é DeepSeek V4 Pro on OrcaRouter — pelo preço de tabela da DeepSeek, repassado com margem de 0%.
E o modelo para o qual a DeepSeek diz que o tráfego do V4 Pro será redirecionado, se quiser comparar diretamente com ele: DeepSeek V4 Flash no OrcaRouter.
Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
