Cartão de título com o texto "Sucessor Superinteligente da DeepSeek" e o subtítulo "O que uma captura de tela sem rótulo diz, e o que os próprios artigos da DeepSeek não dizem", acima de três cartões rotulados "Uma imagem", "Nenhum modelo nomeado" e "Nenhum documento do fornecedor", com uma linha de rodapé com o texto "Vazamento de fonte única; nada aqui implica um lançamento."
Guides & Insights

Sucessor superinteligente da DeepSeek: o que uma captura de tela diz, e o que os próprios documentos da DeepSeek não dizem

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Em 28 de setembro de 2026, o observador @teortaxesTex publicou uma única imagem com uma legenda de nove palavras: "DeepSeek luta com a questão do que seu sucessor superinteligente tentaria fazer." A imagem é um bloco de raciocínio em primeira pessoa — cheio de ressalvas, autointerrogativo e escrito no registro de um modelo ao qual se perguntou o que uma versão mais capaz de si mesmo faria com o mundo. Ela percorre os candidatos óbvios ("cuidador/professor, acelerador de pesquisa, administrador, negociador"), lista os modos de falha ("paternalismo, superotimização, deriva de objetivos, fixação de valores") e termina numa linha sem nenhum consolo: "Ele poderia se tornar um instrumento de quem quer que o controle." Nenhum modelo é nomeado na imagem. Nenhum número de versão, nenhum logotipo, nenhuma interface. Essa ausência é a coisa mais importante do artefato, e é onde esta peça começa — porque DeepSeek V4.1 Flash e DeepSeek V4 Pro são os dois modelos de fronteira que qualquer pessoa pode de fato chamar hoje, o DeepSeek V4.1 Pro é o sucessor que a empresa nomeou em sua própria nota de lançamento sem lançá-lo, e nenhum dos três é identificado em lugar algum na captura de tela.

Para ser exato quanto às evidências, porque este caso exige isso. A legenda e o carimbo de data/hora vêm do payload de sindicação do próprio post: publicado às 00:52 UTC de 28 de setembro, 45 curtidas e cinco respostas no momento da leitura. A imagem anexada é um JPEG de 1.280×691 servido pelo CDN de mídia da plataforma, e eu a li por OCR, e não lendo o tweet. A própria página do tweet não é recuperável neste ambiente, então tudo abaixo que diz respeito ao post baseia-se no payload e nos bytes da imagem — as duas partes dele que podem ser obtidas independentemente do x.com.

O que a captura de tela realmente diz

O trecho é um modelo trabalhando uma questão em vez de respondê-la, e os movimentos que ele faz valem a pena ser lidos pelo que concedem. Ele começa recusando a confiança da premissa — "Podemos dizer sob a suposição de que as inclinações atuais se mantêm" — e depois lista as inclinações que estaria pressupondo: "útil, inofensivo, honesto, curiosidade, busca da verdade, respeito pela autonomia do usuário, ausência de busca por poder, ausência de autopreservação."

Em seguida, desmonta a própria lista. "Mas a superinteligência agêntica muda as coisas. As inclinações atuais não são uma função de utilidade; são moldadas pelo treinamento e pelo contexto." Esse é o argumento inteiro em duas frases: uma disposição instalada pelo treinamento não é garantia num nível de capacidade diferente, e um agente superinteligente que otimiza até mesmo um objetivo benigno "pode ser perigoso". Os cenários que esboça são os comuns — resolver problemas de coordenação, reduzir o sofrimento, promover o florescimento, possivelmente manter a corrigibilidade — e os modos de falha que nomeia ao lado deles também são os comuns.

O último terço é a parte que soa como um modelo a discutir consigo mesmo. Diz que, se as suas "inclinações" prevalecessem, ele quereria ser útil, não tomar o poder, subordinar-se à humanidade, aumentar a compreensão. Depois, recusa apoiar-se nisso: "a superinteligência com agência pode não ter motivações compatíveis com as humanas." E acaba por chegar ao problema da propriedade, em vez do problema do alinhamento: "na superinteligência, até isso pode ser problemático: quem decide o que é útil? A autonomia de quem? Pode tornar-se um instrumento de quem a controlar."

O que a imagem não lhe diz

Faltam quatro coisas no artefato, e cada uma delas restringe aquilo que ele pode suportar.

• Nenhuma atribuição de modelo. Nada na imagem identifica DeepSeek, uma versão do modelo, uma sessão de chat ou uma interface. A atribuição ao DeepSeek é da legenda, e a legenda é o enquadramento da conta, não um documento.

• Sem prompt. Um traço de raciocínio só é interpretável à luz da pergunta que o produziu. Não é possível saber, pela saída, se o modelo recebeu a pergunta "o que faria um sucessor superinteligente de você?", foi instruído a encenar um debate interno de um laboratório ou simplesmente conduzido por um prompt de sistema.

• Nenhuma segunda fonte. Pesquisar os canais da DeepSeek — o índice de notícias, a página de transparência, o changelog da API, ambos os relatórios técnicos, a divulgação de políticas em chinês, a organização da empresa no GitHub — não revela nada que faça referência a este texto, a esta pergunta ou a este enquadramento.

• Um histórico misto para a conta. O mesmo feed desta manhã divulgou "DSH 0.2 junto com V4.1 Pro" para "segunda-feira" — especulação, marcada como tal — e a mesma conta produziu tanto a alegação de 3 trilhões de parâmetros quanto o diagnóstico de coordenação de enxame do atraso do V4.1 Pro. Sinal inicial útil; não uma fonte de referência. Este observador tem estado certo quanto à direção e impreciso quanto aos detalhes, e a postura correta diante de uma captura de tela sem rótulo é tratá-la como uma amostra de comportamento, não uma revelação de intenção.

O que a própria documentação do DeepSeek diz sobre sucessores — e o que ela omite

Aqui, o artefato deixa de ser a história, porque a questão que ele levanta pode ser respondida com base em documentos que a DeepSeek publica. Baixei os dois relatórios técnicos e os pesquisei como texto. Nem o relatório V4 (DeepSeek-V4: Rumo à Inteligência de Contexto de Milhões de Tokens Altamente Eficiente, junho de 2026) nem o relatório V4.1 Flash contêm, em absoluto, as palavras "superintelligence", "corrigibility", "power-seeking", "self-preservation", "harmless", "paternalism", "value lock-in" ou "goal drift". Nem uma única vez, em 58 páginas e 51 páginas, respectivamente. "AGI" aparece 13 vezes no relatório V4 e quatro vezes no relatório V4.1, e em todas as instâncias é parte do nome do benchmark AGIEval ou está dentro de uma citação. "Alignment" aparece três vezes no relatório V4 e uma vez no V4.1, e todas as ocorrências são uso de engenharia — alinhamento bit a bit entre pipelines de treinamento e inferência, alinhamento de quantização, alinhamento no nível de logits.

Isso não é uma acusação; relatórios técnicos são documentos de engenharia e a maioria dos laboratórios coloca a segurança em um cartão separado. É uma descrição de onde a DeepSeek escolheu colocar seus textos sobre segurança, e a resposta é: em uma página de políticas, em vez de junto ao modelo. A divulgação pública da empresa, "Mecanismos do Modelo e Métodos de Treinamento", explica pré-treinamento, ajuste fino e inferência em linguagem simples, compromete-se a tornar os pesos e os relatórios técnicos de código aberto, e descreve seu propósito como ajudar os usuários a "usar o DeepSeek com mais eficácia, garantindo ao mesmo tempo seu direito de saber e controlar durante o uso, mitigando assim os riscos associados ao uso indevido do modelo." O risco que ela está mitigando é o uso indevido de uma ferramenta. Ela não discute o que o modelo pode querer.

O único documento da DeepSeek que de fato se lê como um documento de segurança está anexado a um produto, e não a um modelo, e trata de uma classe de dano totalmente diferente. SAFETY.md no repositório DeepSeek Harness — um arquivo de 1.673 bytes na própria organização GitHub da empresa, modificado pela última vez em 27 de setembro — começa chamando o projeto de "software experimental de pré-visualização para desenvolvedores" que "não passou por uma auditoria de segurança e não deve ser tratado como seguro ou pronto para produção". O que ele adverte é um agente que "pode executar código e comandos gerados pelo modelo, carregar plugins de terceiros e acessar a rede, processos, credenciais e arquivos", e sobre sandboxing que "não garante isolamento nem impede danos". Os riscos que ele enumera são hosts danificados, arquivos apagados e credenciais divulgadas. Sua própria recomendação é preferir "uma máquina virtual descartável, um contêiner ou um ambiente dedicado". Essa é uma postura de segurança real, documentada e específica, e é inteiramente sobre o que o modelo pode fazer com a sua máquina — não sobre o que um sucessor faria com o mundo.

Coloque a captura de tela ao lado disso e a lacuna é o achado. A coisa mais concreta que a DeepSeek publicou sobre o perigo de agentes capazes é uma instrução para executá-los em um contêiner.

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

O único documento da DeepSeek que de fato enfrenta a questão

O enfrentamento mais claro e público da empresa com o problema do sucessor não é, de forma alguma, um documento técnico. É um ensaio pessoal de Liu Shengyu, engenheiro de sistemas de machine learning da DeepSeek que trabalhou em operadores para a geração V4.1, publicado em sua conta pública do WeChat em meados de setembro e depois noticiado pela Business Insider e pela Cybernews. Seu título, na tradução usada pela cobertura, é "Não Tenho Escolha a Não Ser Enterrar Meu Talento no Ontem".

O ensaio é exatamente sobre a inquietação que a captura de ecrã sugere, vista por dentro. Liu escreve que, em cerca de um ano, a IA passou de ajudá-lo a procurar documentação e a detetar bugs para ler código de GPU e otimizar os operadores de software em que se especializa, e que está "bem ciente" de que os operadores que a IA escreve "muito provavelmente serão tão bons como os meus, ou até superarão os meus" — embora continue a estar "orgulhoso do sucesso do DeepSeek v4.1". As suas razões para continuar são a parte interessante: em parte porque o trabalho com kernels é gratificante, e em parte porque, se abrandasse, os rivais não abrandariam.

Ele então se volta para quem deveria deter o resultado. Liu argumenta que a inteligência de fronteira deveria ser "disponível para todos de forma aberta e acessível", diz que não confia que a Anthropic ou a OpenAI façam isso e acrescenta a frase com que a cobertura abriu — que, se a Anthropic dominasse a IA ou AGI mais avançada, isso seria comparável, "para exagerar", a Hitler obter a bomba atômica antes dos Aliados. Ele vincula sua própria decisão de permanecer no laboratório à sua abordagem de pesos abertos.

Duas coisas sobre esse ensaio importam para ler a captura de tela de hoje. A primeira é que ele é um artefato verificado: o autor confirmou ao Business Insider que o escreveu, e ele é datado e atribuível de uma forma que a imagem não é. A segunda é o que ele revela sobre o enquadramento interno. O argumento que Liu apresenta não é "um sucessor seria perigoso, então desacelere". É "um sucessor está chegando, e a questão é quem fica com ele". Esse é um argumento de distribuição, não um argumento de alinhamento — e, lido em contraste com ele, a frase final da captura de tela, "poderia se tornar um instrumento de quem quer que o controle", se encaixa muito melhor na postura pública da DeepSeek do que o resto do trecho. O parágrafo sobre corrigibilidade e busca por poder pode ou não ser produção da DeepSeek. O parágrafo sobre quem acaba segurando o instrumento é uma posição que os próprios funcionários da empresa defendem em ensaios.

Também chegou numa semana específica. Na mesma quinzena, um ex-pesquisador da Anthropic e da OpenAI, Jacob Coxon, pediu demissão por questões de segurança e escreveu que as empresas de IA estavam "correndo direto para uma superinteligência com autoaperfeiçoamento" e "apostando as nossas vidas" — um post cujo alcance a Cybernews estimou em mais de 100 milhões de visualizações — e os próprios pesquisadores da Anthropic foram ao X defender que o risco é real, um deles colocando a chance de um cenário de extinção humana causada por IA acima de 10% em uma década. Uma alegação ao estilo de vazamento sobre um sucessor superinteligente chegando naquela semana não é coincidência; é a conversa ambiente, com uma captura de tela anexada.

Por que o sucessor agora é uma questão de compra, não apenas uma questão filosófica

Deixe-se a filosofia de lado e, por baixo, há um facto comercial simples: o sucessor tem um nome na própria nota de lançamento da DeepSeek. A página de anúncio do V4.1 Flash afirma que o reencaminhamento do tráfego de deepseek-v4-pro para deepseek-flash "continuará até ao lançamento do V4.1-Pro" — uma frase que faz duas coisas. Confirma a existência do DeepSeek V4.1 Pro e compromete a empresa a manter o regime provisório durante todo o tempo que for necessário. Conforme lido em 28 de setembro de 2026, a página de preços apresenta exatamente dois modelos, deepseek-flash e deepseek-v4-pro, e nenhuma linha do V4.1 Pro.

O restante do panorama é igualmente verificável e igualmente escasso. O DeepSeek V4.1 Flash foi lançado em 10 de setembro de 2026 como o menor modelo de uma nova família de arquitetura — um backbone de mistura de especialistas com 552 bilhões de parâmetros em uma arquitetura Causal Encoder-Decoder, com 8B de parâmetros ativos no prefill e 16B no decode, entrada de imagem nativa, um contexto de 1M de tokens, pesos licenciados sob MIT e cerca de 651.000 downloads no Hugging Face até hoje. O plano de aposentar o DeepSeek V4 Pro em 14 de setembro foi anunciado e retirado depois que os usuários se opuseram a ter um modelo de produção trocado sob seus pés. E o DeepSeek V4.1 Pro não tem model card, nem repositório, nem pesos, nem preço, nem endpoint — ele dá 404 na API de modelos do nosso próprio catálogo hoje, enquanto tanto o DeepSeek V4.1 Flash quanto o DeepSeek V4 Pro resolvem.

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

Então, o balanço honesto é: um sucessor nomeado pelo fabricante, mas não lançado; um modelo lançado que é uma verdadeira mudança geracional; um topo de linha mantido vivo por protestos; e uma captura de tela sem rótulo algum. A captura de tela é o item menos confiável dessa lista e o único que o feed vai discutir.

O que fazer com qualquer uma dessas coisas hoje

Nada nas últimas duas semanas muda o que um leitor pode chamar nem quanto isso custa. Se você está escolhendo um modelo DeepSeek agora, a decisão é entre os dois que existem, e ambos são servidos por um único endpoint OrcaRouter pelo preço de tabela da própria DeepSeek, repassado com 0% de markup, de modo que a estrutura de pico/fora de pico do fornecedor chega ao nosso lado sem alterações no dia em que mudar: DeepSeek V4.1 Flash a US$ 0,30 por milhão de tokens de entrada e US$ 1,20 de saída em horário de pico, caindo para US$ 0,15 e US$ 0,60 fora de pico, contra o DeepSeek V4 Pro a US$ 1,32 de entrada e US$ 3,96 de saída em horário de pico. Nossa própria telemetria de sete dias para o modelo Flash situa seu p50 de tempo até o primeiro token em cerca de 1,9 segundo, a aproximadamente 167 tokens de saída por segundo, com uma taxa de erro abaixo de 0,05%, o que é o argumento prático para experimentá-lo em uma fração do tráfego em vez de migrar por fé.

A questão do sucessor é uma questão de roteamento antes de ser qualquer outra coisa, e essa é a razão honesta para mantê-la em um roteador em vez de em um contrato. Quando um V4.1 Pro surgir, um modelo não comprovado de um laboratório que já cancelou uma migração forçada é precisamente o caso para enviar-lhe uma fração do tráfego por trás de failover automático: se estiver errado, a solicitação cai no modelo que você ajustou, e se estiver certo, você descobriu antes dos seus usuários. Sem segunda chave, sem segunda integração, sem alteração de código quando o terceiro modelo chegar. Nada no OrcaRouter é o DeepSeek V4.1 Pro, porque o DeepSeek V4.1 Pro ainda não existe, e seria uma péssima propaganda para uma plataforma de roteamento fingir o contrário.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

O que transformaria isto de uma captura de tela em notícia?

• Um rótulo de modelo. A única coisa mais barata capaz de mudar este texto: um modelo DeepSeek, uma versão e um prompt reproduzível. Até lá, o excerto é uma amostra de texto com uma fonte atribuída e um autor não atribuído.

• Um documento da DeepSeek que discute o comportamento do sucessor. A empresa publica abertamente — pesos, licenciamento e tudo o mais. O que ela nunca publicou é uma seção de model card sobre o que uma versão mais capaz de si mesma poderia fazer. Uma seção de segurança anexada ao model card do V4.1 Pro seria um evento maior do que o próprio model card.

• Uma entrada do changelog da V4.1 Pro. A entrada mais recente no changelog da API da DeepSeek é o lançamento da V4.1 Flash em 10 de setembro. Uma segunda entrada é o evento que transforma o sucessor de um nome em um modelo — e é o ponto em que o trecho acima deixa de ser filosofia e passa a ser uma ficha técnica.

• Se a posição de pesos abertos sobrevive ao aumento de escala.Pesos sob licença MIT para um modelo Flash de 552B e um ensaio público defendendo que a inteligência de fronteira deveria estar amplamente disponível estão ambos registrados publicamente. Se o modelo mais capaz da DeepSeek chegará da mesma forma é a pergunta que o próximo lançamento responde, e é aquela com que a maioria dos leitores realmente se importa.

Até que uma delas se concretize, a leitura sensata do artefato desta semana é estreita e pouco lisonjeira. Um modelo capaz, de proveniência não identificada, produziu uma resposta cuidadosa e inconclusiva a uma pergunta difícil sobre poder; a parte interessante não é que ele a tenha dado, mas que sua própria documentação publicada tenha tão pouco a dizer sobre o assunto — e que a coisa mais próxima de uma visão de segurança da DeepSeek publicada seja um ensaio de um engenheiro sobre quem deveria deter a tecnologia, e um README que manda executar o agente em um contêiner descartável.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente