Kimi K3.1: O que o vazamento alega — e o que está realmente confirmado
Guides & Insights

Kimi K3.1: O que o vazamento alega — e o que está realmente confirmado

Autor

jinhao song

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Atenção: isso é um vazamento, não um anúncio. Em 27 de julho de 2026, a Moonshot AI não lançou oficialmente nem confirmou um "Kimi K3.1." Tudo sobre o K3.1 abaixo vem de uma única postagem não verificada em redes sociais e deve ser tratado como rumor até que a Moonshot disponibilize pesos ou um model card. O que está confirmado é Kimi K3 — o modelo de pesos abertos com 2,8 trilhões de parâmetros que a Moonshot lançou em 16 de julho de 2026. Este artigo separa os dois: o que o vazamento alega para o K3.1 e o que realmente sabemos hoje.

Por que escrever isso agora? Porque "Kimi K3.1" já está sendo pesquisado, e a versão honesta desta história — rotulando claramente rumor vs. fato — é mais útil do que hype ou silêncio. Atualizaremos este post se e quando a Moonshot publicar algo oficial.

TL;DR. Uma postagem de 26 de julho de 2026 no X (@Mr_Salio, intitulada "Vazamento do Kimi K3.1") lista um suposto conjunto de recursos para uma atualização do K3.1: desempenho reduzindo a diferença em relação ao GPT-5.6 e ao Claude Fable, inferência mais rápida/de menor latência, melhor eficiência de tokens em raciocínios longos, fluxos de codificação e agente mais confiáveis, menos etapas de raciocínio desperdiçadas, vantagem contínua sobre o Claude Opus 5 em algumas tarefas de codificação/agente, e um lançamento contínuo de pesos abertos. Nada disso é confirmado, não há números de benchmark e não há data de lançamento oficial. A linha de base confirmada é o Kimi K3: 2.8T de parâmetros, pesos abertos, #1 na Frontend Code Arena no lançamento.

Principais conclusões

• O vazamento não está verificado. Post único no X, sem números, sem data, sem confirmação da Moonshot. Trate como rumor.

• O suposto tema do K3.1 é eficiência, não um novo tamanho. Inferência mais rápida, latência menor, melhor eficiência de tokens, menos etapas de raciocínio.

• O posicionamento reivindicado: fechar a lacuna com GPT-5.6 Sol e Claude Fable 5, manter uma vantagem sobre o Claude Opus 5 em algumas tarefas de codificação/agente.

• Afirma-se que o peso aberto continua — consistente com o lançamento do MIT Modificado do K3.

• O que é real hoje é o Kimi K3 (2,8T, peso aberto, lançado em 16 de julho de 2026), não o K3.1.

O que o vazamento realmente diz

A fonte é uma única postagem no X de @Mr_Salio, com data de 26 de julho de 2026 e intitulada explicitamente "Kimi K3.1 Leak." Ela lista um conjunto de tópicos rumorados (parafraseado, atribuído a essa postagem):

• Desempenho que "fecha a lacuna" com GPT-5.6 e Fable.

• Mantém suas capacidades relatadas de nível superior ("Mythos-level") — a redação da postagem; "Mythos" não está definido no vazamento.

• Inferência mais rápida e menor latência.

• Melhor eficiência de tokens em tarefas longas de raciocínio.

• Fluxos de trabalho de codificação e agente mais confiáveis.

• Menos etapas de raciocínio desnecessárias.

• Continua a superar o Claude Opus 5 em tarefas-chave de codificação e agente.

• Permanece de peso aberto, mantendo a IA de fronteira livremente acessível.

Esse é todo o conteúdo do vazamento. Notavelmente ausente: qualquer pontuação de benchmark, contagem de parâmetros, comprimento de contexto, preço ou data de lançamento. A postagem termina até com uma pergunta em aberto aos leitores ("você acha que vai vencer o mythos?"), o que é um forte sinal de que isso é especulação, não um anúncio informado.

Quão crível é?

Baixo a moderado, e aqui está a leitura honesta. Por um lado, a direção especulada é plausível: as versões pontuais (uma ".1") quase sempre focam em eficiência e confiabilidade — inferência mais rápida, melhor economia de tokens, menos etapas de raciocínio desperdiçadas — em vez de uma arquitetura totalmente nova, e é exatamente isso que esta lista descreve. Também se encaixa na estratégia de pesos abertos da Moonshot com o K3.

Por outro lado, não há nada a verificar: é uma única conta anônima, sem números, sem capturas de tela de um model card, sem repositório do Hugging Face e nenhuma cobertura corroborativa em nenhum outro lugar até o momento da redação. Termos indefinidos como "Mythos-level" tornam impossível verificar. Até que a Moonshot publique pesos, um model card ou uma tabela de benchmarks — ou um veículo respeitável corrobore — isso deve ser arquivado como rumor, e não como roteiro.

O que está confirmado: Kimi K3

O modelo real, lançado é Kimi K3, lançado em 16 de julho de 2026 — um modelo Mixture-of-Experts de peso aberto com 2,8 trilhões de parâmetros, construído para codificação de longo horizonte, raciocínio e fluxos de trabalho de agente, com entrada multimodal nativa e uma janela de contexto de 1 milhão de tokens. No lançamento, saltou para o #1 no independente Frontend Code Arena (Elo relatado ~1.679), à frente do Claude Fable 5, GPT-5.6 Sol e GLM-5.2, e obteve 93,5% relatado no GPQA Diamond e ~91,2 no BrowseComp. A Moonshot comprometeu-se a liberar os pesos completos sob uma licença MIT Modificada. Esses são os números para se ancorar — e a linha de base realista a partir da qual qualquer "K3.1" construiria.

(Fontes para K3: materiais de lançamento da Moonshot e leaderboards independentes incluindo Frontend Code Arena e Artificial Analysis; os números são os relatados no lançamento e podem mudar.)

Se o vazamento estiver correto, o que significaria K3.1?

Lendo a lista rumorada com benevolência, o K3.1 seria umeficiência e confiabilidade lançamento, em vez de um salto de capacidade: aproximadamente qualidade de nível K3, mas mais rápido, mais barato por tarefa (melhor eficiência de tokens) e mais estável em loops agentivos (menos passos de raciocínio desperdiçados, uso de ferramentas mais confiável). Para equipes que já executam o K3, esse é o tipo de atualização mais valioso — reduz custo e latência sem forçar uma reavaliação da qualidade. A alegada "redução da lacuna com GPT-5.6 e Fable" e "vantagem sobre Opus 5 em algumas tarefas de codificação/agentes" manteriam, se verdadeiras, o K3.1 como a opção de pesos abertos mais forte para agentes de codificação. Mas novamente — se verdade.

Você deveria esperar por isso?

Não — não construa em torno de um rumor. Se você precisa de um modelo de codificação de pesos abertos de alto nível hoje, o Kimi K3 foi lançado, é aberto e é independentemente o #1 no Frontend Code Arena. Se o K3.1 chegar com ganhos reais de eficiência, adotá-lo depois é trivial (mesma família, pesos abertos). A ação racional é usar o K3 agora e testar novamente se e quando o K3.1 realmente for lançado com um cartão de modelo e números. Não atrase um projeto por um '.1.' não confirmado.

Como experimentar o Kimi K3 hoje

Kimi K3 é de peso aberto e está disponível através de provedores hospedados, inclusive via um endpoint compatível com OpenAI no OrcaRouter (modelo Kimi K3). Equipes neutras em relação a fornecedores roteiam o Kimi K3 junto com GPT-5.6 Sol, Claude Fable 5 e Claude Opus 5 por trás de um único endpoint, de modo que, se o K3.1 (ou qualquer novo modelo) for lançado, a troca é uma alteração de uma linha, em vez de uma migração.

Como isso se compara aos líderes atuais

Na imagem confirmada: o Kimi K3 lidera a Frontend Code Arena entre todos os modelos no lançamento e é a versão de peso aberto mais forte até hoje, enquanto modelos fechados de fronteira como Claude Fable 5 (líder do SWE-bench Verified) e Claude Opus 5 (#1 no Artificial Analysis Intelligence Index) ainda lideram em outros eixos. Um suposto K3.1 que "fecha a lacuna" tornaria uma corrida já acirrada ainda mais apertada — mas o vazamento não fornece números para posicioná-lo, então não vamos inventar nenhum.

Perguntas Frequentes

O Kimi K3.1 foi lançado?

Não. Em 27 de julho de 2026, não há um Kimi K3.1 oficial da Moonshot AI. A única fonte é uma postagem não verificada de 26 de julho no X.

O vazamento é confiável?

Trate como boato. É uma única postagem em rede social sem números de benchmark, sem ficha técnica, sem data de lançamento e sem corroboração. A direção (um lançamento pontual focado em eficiência) é plausível, mas não confirmada.

O que mudaria no K3.1 se o vazamento estiver correto?

Rumor: inferência mais rápida, latência menor, melhor eficiência de tokens em raciocínio longo, fluxos de trabalho de codificação/agentes mais confiáveis, menos etapas de raciocínio desperdiçadas — mantendo-se com pesos abertos e aproximadamente no nível K3 em qualidade.

O que é confirmado sobre Kimi K3?

K3 é um modelo real, lançado, com 2,8 trilhões de parâmetros e pesos abertos (16 de julho de 2026), #1 no Frontend Code Arena no lançamento, com contexto de 1 milhão de tokens e relatados 93,5% no GPQA Diamond e ~91,2 no BrowseComp.

O que é "Mythos"?

O vazamento faz referência a capacidades de 'nível Mythos' e pergunta se o K3.1 vai 'superar mythos', mas não define o termo. Não podemos verificar a que se refere, então estamos sinalizando em vez de adivinhar.

Devo esperar pelo K3.1 antes de escolher um modelo?

Não. Use o Kimi K3 (ou outro modelo atual) agora; reavalie se o K3.1 for lançado com especificações oficiais. Não planeje com base em um rumor.

Onde posso executar o Kimi K3?

Através de provedores hospedados e via API compatível com OpenAI da OrcaRouter, juntamente com os outros modelos de ponta para fácil comparação.

Conclusão

"Kimi K3.1" é, por enquanto, um vazamento — uma única postagem no X de 26 de julho descrevendo uma atualização de eficiência e confiabilidade (mais rápida, mais barata por tarefa, agentes mais estáveis, ainda com pesos abertos) sem números, sem ficha técnica e sem data. É plausível, mas não verificado, então estamos reportando como rumor, não como fato. A realidade confirmada é o Kimi K3: um modelo de 2,8T com pesos abertos, número 1 no Frontend Code Arena no lançamento, que você pode usar hoje. Se e quando a Moonshot lançar o K3.1 com benchmarks reais, atualizaremos esta postagem — e você poderá testá-lo em minutos através de um endpoint compatível com OpenAI no OrcaRouter.

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

Fale conosco

Junte-se à comunidade

DiscordEmailXGitHubYouTube