
Sucessor superinteligente da DeepSeek: o que uma captura de tela diz, e o que os próprios documentos da DeepSeek não dizem
- typesafeNOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 301 tok/s
- openaiNOVOOpenAI: GPT-6 Luna2026-09-2237Inteligência
- openaiNOVOOpenAI: GPT-6 Sol2026-09-2248Inteligência
- anthropicNOVOAnthropic: Claude Opus 5.52026-09-2258Inteligência
- grokNOVOGrok 4.72026-09-2146Inteligência
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 195 tok/s
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
Em 28 de setembro de 2026, o observador @teortaxesTex publicou uma única imagem com uma legenda de nove palavras: "DeepSeek luta com a questão do que seu sucessor superinteligente tentaria fazer." A imagem é um bloco de raciocínio em primeira pessoa — cheio de ressalvas, autointerrogativo e escrito no registro de um modelo ao qual se perguntou o que uma versão mais capaz de si mesmo faria com o mundo. Ela percorre os candidatos óbvios ("cuidador/professor, acelerador de pesquisa, administrador, negociador"), lista os modos de falha ("paternalismo, superotimização, deriva de objetivos, fixação de valores") e termina numa linha sem nenhum consolo: "Ele poderia se tornar um instrumento de quem quer que o controle." Nenhum modelo é nomeado na imagem. Nenhum número de versão, nenhum logotipo, nenhuma interface. Essa ausência é a coisa mais importante do artefato, e é onde esta peça começa — porque DeepSeek V4.1 Flash e DeepSeek V4 Pro são os dois modelos de fronteira que qualquer pessoa pode de fato chamar hoje, o DeepSeek V4.1 Pro é o sucessor que a empresa nomeou em sua própria nota de lançamento sem lançá-lo, e nenhum dos três é identificado em lugar algum na captura de tela.
Para ser exato quanto às evidências, porque este caso exige isso. A legenda e o carimbo de data/hora vêm do payload de sindicação do próprio post: publicado às 00:52 UTC de 28 de setembro, 45 curtidas e cinco respostas no momento da leitura. A imagem anexada é um JPEG de 1.280×691 servido pelo CDN de mídia da plataforma, e eu a li por OCR, e não lendo o tweet. A própria página do tweet não é recuperável neste ambiente, então tudo abaixo que diz respeito ao post baseia-se no payload e nos bytes da imagem — as duas partes dele que podem ser obtidas independentemente do x.com.
O que a captura de tela realmente diz
O trecho é um modelo trabalhando uma questão em vez de respondê-la, e os movimentos que ele faz valem a pena ser lidos pelo que concedem. Ele começa recusando a confiança da premissa — "Podemos dizer sob a suposição de que as inclinações atuais se mantêm" — e depois lista as inclinações que estaria pressupondo: "útil, inofensivo, honesto, curiosidade, busca da verdade, respeito pela autonomia do usuário, ausência de busca por poder, ausência de autopreservação."
Em seguida, desmonta a própria lista. "Mas a superinteligência agêntica muda as coisas. As inclinações atuais não são uma função de utilidade; são moldadas pelo treinamento e pelo contexto." Esse é o argumento inteiro em duas frases: uma disposição instalada pelo treinamento não é garantia num nível de capacidade diferente, e um agente superinteligente que otimiza até mesmo um objetivo benigno "pode ser perigoso". Os cenários que esboça são os comuns — resolver problemas de coordenação, reduzir o sofrimento, promover o florescimento, possivelmente manter a corrigibilidade — e os modos de falha que nomeia ao lado deles também são os comuns.
O último terço é a parte que soa como um modelo a discutir consigo mesmo. Diz que, se as suas "inclinações" prevalecessem, ele quereria ser útil, não tomar o poder, subordinar-se à humanidade, aumentar a compreensão. Depois, recusa apoiar-se nisso: "a superinteligência com agência pode não ter motivações compatíveis com as humanas." E acaba por chegar ao problema da propriedade, em vez do problema do alinhamento: "na superinteligência, até isso pode ser problemático: quem decide o que é útil? A autonomia de quem? Pode tornar-se um instrumento de quem a controlar."
O que a imagem não lhe diz
Faltam quatro coisas no artefato, e cada uma delas restringe aquilo que ele pode suportar.
• Nenhuma atribuição de modelo. Nada na imagem identifica DeepSeek, uma versão do modelo, uma sessão de chat ou uma interface. A atribuição ao DeepSeek é da legenda, e a legenda é o enquadramento da conta, não um documento.
• Sem prompt. Um traço de raciocínio só é interpretável à luz da pergunta que o produziu. Não é possível saber, pela saída, se o modelo recebeu a pergunta "o que faria um sucessor superinteligente de você?", foi instruído a encenar um debate interno de um laboratório ou simplesmente conduzido por um prompt de sistema.
• Nenhuma segunda fonte. Pesquisar os canais da DeepSeek — o índice de notícias, a página de transparência, o changelog da API, ambos os relatórios técnicos, a divulgação de políticas em chinês, a organização da empresa no GitHub — não revela nada que faça referência a este texto, a esta pergunta ou a este enquadramento.
• Um histórico misto para a conta. O mesmo feed desta manhã divulgou "DSH 0.2 junto com V4.1 Pro" para "segunda-feira" — especulação, marcada como tal — e a mesma conta produziu tanto a alegação de 3 trilhões de parâmetros quanto o diagnóstico de coordenação de enxame do atraso do V4.1 Pro. Sinal inicial útil; não uma fonte de referência. Este observador tem estado certo quanto à direção e impreciso quanto aos detalhes, e a postura correta diante de uma captura de tela sem rótulo é tratá-la como uma amostra de comportamento, não uma revelação de intenção.
O que a própria documentação do DeepSeek diz sobre sucessores — e o que ela omite
Aqui, o artefato deixa de ser a história, porque a questão que ele levanta pode ser respondida com base em documentos que a DeepSeek publica. Baixei os dois relatórios técnicos e os pesquisei como texto. Nem o relatório V4 (DeepSeek-V4: Rumo à Inteligência de Contexto de Milhões de Tokens Altamente Eficiente, junho de 2026) nem o relatório V4.1 Flash contêm, em absoluto, as palavras "superintelligence", "corrigibility", "power-seeking", "self-preservation", "harmless", "paternalism", "value lock-in" ou "goal drift". Nem uma única vez, em 58 páginas e 51 páginas, respectivamente. "AGI" aparece 13 vezes no relatório V4 e quatro vezes no relatório V4.1, e em todas as instâncias é parte do nome do benchmark AGIEval ou está dentro de uma citação. "Alignment" aparece três vezes no relatório V4 e uma vez no V4.1, e todas as ocorrências são uso de engenharia — alinhamento bit a bit entre pipelines de treinamento e inferência, alinhamento de quantização, alinhamento no nível de logits.
Isso não é uma acusação; relatórios técnicos são documentos de engenharia e a maioria dos laboratórios coloca a segurança em um cartão separado. É uma descrição de onde a DeepSeek escolheu colocar seus textos sobre segurança, e a resposta é: em uma página de políticas, em vez de junto ao modelo. A divulgação pública da empresa, "Mecanismos do Modelo e Métodos de Treinamento", explica pré-treinamento, ajuste fino e inferência em linguagem simples, compromete-se a tornar os pesos e os relatórios técnicos de código aberto, e descreve seu propósito como ajudar os usuários a "usar o DeepSeek com mais eficácia, garantindo ao mesmo tempo seu direito de saber e controlar durante o uso, mitigando assim os riscos associados ao uso indevido do modelo." O risco que ela está mitigando é o uso indevido de uma ferramenta. Ela não discute o que o modelo pode querer.
O único documento da DeepSeek que de fato se lê como um documento de segurança está anexado a um produto, e não a um modelo, e trata de uma classe de dano totalmente diferente. SAFETY.md no repositório DeepSeek Harness — um arquivo de 1.673 bytes na própria organização GitHub da empresa, modificado pela última vez em 27 de setembro — começa chamando o projeto de "software experimental de pré-visualização para desenvolvedores" que "não passou por uma auditoria de segurança e não deve ser tratado como seguro ou pronto para produção". O que ele adverte é um agente que "pode executar código e comandos gerados pelo modelo, carregar plugins de terceiros e acessar a rede, processos, credenciais e arquivos", e sobre sandboxing que "não garante isolamento nem impede danos". Os riscos que ele enumera são hosts danificados, arquivos apagados e credenciais divulgadas. Sua própria recomendação é preferir "uma máquina virtual descartável, um contêiner ou um ambiente dedicado". Essa é uma postura de segurança real, documentada e específica, e é inteiramente sobre o que o modelo pode fazer com a sua máquina — não sobre o que um sucessor faria com o mundo.
Coloque a captura de tela ao lado disso e a lacuna é o achado. A coisa mais concreta que a DeepSeek publicou sobre o perigo de agentes capazes é uma instrução para executá-los em um contêiner.

O único documento da DeepSeek que de fato enfrenta a questão
O enfrentamento mais claro e público da empresa com o problema do sucessor não é, de forma alguma, um documento técnico. É um ensaio pessoal de Liu Shengyu, engenheiro de sistemas de machine learning da DeepSeek que trabalhou em operadores para a geração V4.1, publicado em sua conta pública do WeChat em meados de setembro e depois noticiado pela Business Insider e pela Cybernews. Seu título, na tradução usada pela cobertura, é "Não Tenho Escolha a Não Ser Enterrar Meu Talento no Ontem".
O ensaio é exatamente sobre a inquietação que a captura de ecrã sugere, vista por dentro. Liu escreve que, em cerca de um ano, a IA passou de ajudá-lo a procurar documentação e a detetar bugs para ler código de GPU e otimizar os operadores de software em que se especializa, e que está "bem ciente" de que os operadores que a IA escreve "muito provavelmente serão tão bons como os meus, ou até superarão os meus" — embora continue a estar "orgulhoso do sucesso do DeepSeek v4.1". As suas razões para continuar são a parte interessante: em parte porque o trabalho com kernels é gratificante, e em parte porque, se abrandasse, os rivais não abrandariam.
Ele então se volta para quem deveria deter o resultado. Liu argumenta que a inteligência de fronteira deveria ser "disponível para todos de forma aberta e acessível", diz que não confia que a Anthropic ou a OpenAI façam isso e acrescenta a frase com que a cobertura abriu — que, se a Anthropic dominasse a IA ou AGI mais avançada, isso seria comparável, "para exagerar", a Hitler obter a bomba atômica antes dos Aliados. Ele vincula sua própria decisão de permanecer no laboratório à sua abordagem de pesos abertos.
Duas coisas sobre esse ensaio importam para ler a captura de tela de hoje. A primeira é que ele é um artefato verificado: o autor confirmou ao Business Insider que o escreveu, e ele é datado e atribuível de uma forma que a imagem não é. A segunda é o que ele revela sobre o enquadramento interno. O argumento que Liu apresenta não é "um sucessor seria perigoso, então desacelere". É "um sucessor está chegando, e a questão é quem fica com ele". Esse é um argumento de distribuição, não um argumento de alinhamento — e, lido em contraste com ele, a frase final da captura de tela, "poderia se tornar um instrumento de quem quer que o controle", se encaixa muito melhor na postura pública da DeepSeek do que o resto do trecho. O parágrafo sobre corrigibilidade e busca por poder pode ou não ser produção da DeepSeek. O parágrafo sobre quem acaba segurando o instrumento é uma posição que os próprios funcionários da empresa defendem em ensaios.
Também chegou numa semana específica. Na mesma quinzena, um ex-pesquisador da Anthropic e da OpenAI, Jacob Coxon, pediu demissão por questões de segurança e escreveu que as empresas de IA estavam "correndo direto para uma superinteligência com autoaperfeiçoamento" e "apostando as nossas vidas" — um post cujo alcance a Cybernews estimou em mais de 100 milhões de visualizações — e os próprios pesquisadores da Anthropic foram ao X defender que o risco é real, um deles colocando a chance de um cenário de extinção humana causada por IA acima de 10% em uma década. Uma alegação ao estilo de vazamento sobre um sucessor superinteligente chegando naquela semana não é coincidência; é a conversa ambiente, com uma captura de tela anexada.
Por que o sucessor agora é uma questão de compra, não apenas uma questão filosófica
Deixe-se a filosofia de lado e, por baixo, há um facto comercial simples: o sucessor tem um nome na própria nota de lançamento da DeepSeek. A página de anúncio do V4.1 Flash afirma que o reencaminhamento do tráfego de deepseek-v4-pro para deepseek-flash "continuará até ao lançamento do V4.1-Pro" — uma frase que faz duas coisas. Confirma a existência do DeepSeek V4.1 Pro e compromete a empresa a manter o regime provisório durante todo o tempo que for necessário. Conforme lido em 28 de setembro de 2026, a página de preços apresenta exatamente dois modelos, deepseek-flash e deepseek-v4-pro, e nenhuma linha do V4.1 Pro.
O restante do panorama é igualmente verificável e igualmente escasso. O DeepSeek V4.1 Flash foi lançado em 10 de setembro de 2026 como o menor modelo de uma nova família de arquitetura — um backbone de mistura de especialistas com 552 bilhões de parâmetros em uma arquitetura Causal Encoder-Decoder, com 8B de parâmetros ativos no prefill e 16B no decode, entrada de imagem nativa, um contexto de 1M de tokens, pesos licenciados sob MIT e cerca de 651.000 downloads no Hugging Face até hoje. O plano de aposentar o DeepSeek V4 Pro em 14 de setembro foi anunciado e retirado depois que os usuários se opuseram a ter um modelo de produção trocado sob seus pés. E o DeepSeek V4.1 Pro não tem model card, nem repositório, nem pesos, nem preço, nem endpoint — ele dá 404 na API de modelos do nosso próprio catálogo hoje, enquanto tanto o DeepSeek V4.1 Flash quanto o DeepSeek V4 Pro resolvem.

Então, o balanço honesto é: um sucessor nomeado pelo fabricante, mas não lançado; um modelo lançado que é uma verdadeira mudança geracional; um topo de linha mantido vivo por protestos; e uma captura de tela sem rótulo algum. A captura de tela é o item menos confiável dessa lista e o único que o feed vai discutir.
O que fazer com qualquer uma dessas coisas hoje
Nada nas últimas duas semanas muda o que um leitor pode chamar nem quanto isso custa. Se você está escolhendo um modelo DeepSeek agora, a decisão é entre os dois que existem, e ambos são servidos por um único endpoint OrcaRouter pelo preço de tabela da própria DeepSeek, repassado com 0% de markup, de modo que a estrutura de pico/fora de pico do fornecedor chega ao nosso lado sem alterações no dia em que mudar: DeepSeek V4.1 Flash a US$ 0,30 por milhão de tokens de entrada e US$ 1,20 de saída em horário de pico, caindo para US$ 0,15 e US$ 0,60 fora de pico, contra o DeepSeek V4 Pro a US$ 1,32 de entrada e US$ 3,96 de saída em horário de pico. Nossa própria telemetria de sete dias para o modelo Flash situa seu p50 de tempo até o primeiro token em cerca de 1,9 segundo, a aproximadamente 167 tokens de saída por segundo, com uma taxa de erro abaixo de 0,05%, o que é o argumento prático para experimentá-lo em uma fração do tráfego em vez de migrar por fé.
A questão do sucessor é uma questão de roteamento antes de ser qualquer outra coisa, e essa é a razão honesta para mantê-la em um roteador em vez de em um contrato. Quando um V4.1 Pro surgir, um modelo não comprovado de um laboratório que já cancelou uma migração forçada é precisamente o caso para enviar-lhe uma fração do tráfego por trás de failover automático: se estiver errado, a solicitação cai no modelo que você ajustou, e se estiver certo, você descobriu antes dos seus usuários. Sem segunda chave, sem segunda integração, sem alteração de código quando o terceiro modelo chegar. Nada no OrcaRouter é o DeepSeek V4.1 Pro, porque o DeepSeek V4.1 Pro ainda não existe, e seria uma péssima propaganda para uma plataforma de roteamento fingir o contrário.

O que transformaria isto de uma captura de tela em notícia?
• Um rótulo de modelo. A única coisa mais barata capaz de mudar este texto: um modelo DeepSeek, uma versão e um prompt reproduzível. Até lá, o excerto é uma amostra de texto com uma fonte atribuída e um autor não atribuído.
• Um documento da DeepSeek que discute o comportamento do sucessor. A empresa publica abertamente — pesos, licenciamento e tudo o mais. O que ela nunca publicou é uma seção de model card sobre o que uma versão mais capaz de si mesma poderia fazer. Uma seção de segurança anexada ao model card do V4.1 Pro seria um evento maior do que o próprio model card.
• Uma entrada do changelog da V4.1 Pro. A entrada mais recente no changelog da API da DeepSeek é o lançamento da V4.1 Flash em 10 de setembro. Uma segunda entrada é o evento que transforma o sucessor de um nome em um modelo — e é o ponto em que o trecho acima deixa de ser filosofia e passa a ser uma ficha técnica.
• Se a posição de pesos abertos sobrevive ao aumento de escala.Pesos sob licença MIT para um modelo Flash de 552B e um ensaio público defendendo que a inteligência de fronteira deveria estar amplamente disponível estão ambos registrados publicamente. Se o modelo mais capaz da DeepSeek chegará da mesma forma é a pergunta que o próximo lançamento responde, e é aquela com que a maioria dos leitores realmente se importa.
Até que uma delas se concretize, a leitura sensata do artefato desta semana é estreita e pouco lisonjeira. Um modelo capaz, de proveniência não identificada, produziu uma resposta cuidadosa e inconclusiva a uma pergunta difícil sobre poder; a parte interessante não é que ele a tenha dado, mas que sua própria documentação publicada tenha tão pouco a dizer sobre o assunto — e que a coisa mais próxima de uma visão de segurança da DeepSeek publicada seja um ensaio de um engenheiro sobre quem deveria deter a tecnologia, e um README que manda executar o agente em um contêiner descartável.
Comparados neste artigo2
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
