
Kimi K3.1: O que o vazamento alega — e o que está realmente confirmado
- orcaNOVOOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicNOVOAnthropic: Claude Opus 52026-07-2461Inteligência78Código
- googleNOVOGoogle: Gemini 3.6 Flash2026-07-2150Inteligência69Código
- googleNOVOGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaNOVOMeta: Muse Spark 1.12026-07-1651Inteligência71Código
- kimiNOVOMoonshotAI: Kimi K32026-07-1557Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Inteligência77Código
- grokxAI: Grok 4.52026-07-0854Inteligência72Código
- tencentTencent: Hy32026-07-0641Inteligência59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligência42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligência39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3053Inteligência72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligência52Código57Matemática
- z-aiZ.ai: GLM 5.22026-06-1651Inteligência69Código60Matemática
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Inteligência61Código61Matemática
- anthropicAnthropic: Claude Fable 52026-06-0960Inteligência77Código
- qwenQwen: Qwen3.7 Plus2026-06-0139Inteligência56Código59Matemática
- minimaxMiniMax: MiniMax M32026-05-3144Inteligência59Código59Matemática
Atenção: isso é um vazamento, não um anúncio. Em 27 de julho de 2026, a Moonshot AI não lançou oficialmente nem confirmou um "Kimi K3.1." Tudo sobre o K3.1 abaixo vem de uma única postagem não verificada em redes sociais e deve ser tratado como rumor até que a Moonshot disponibilize pesos ou um model card. O que está confirmado é Kimi K3 — o modelo de pesos abertos com 2,8 trilhões de parâmetros que a Moonshot lançou em 16 de julho de 2026. Este artigo separa os dois: o que o vazamento alega para o K3.1 e o que realmente sabemos hoje.
Por que escrever isso agora? Porque "Kimi K3.1" já está sendo pesquisado, e a versão honesta desta história — rotulando claramente rumor vs. fato — é mais útil do que hype ou silêncio. Atualizaremos este post se e quando a Moonshot publicar algo oficial.
TL;DR. Uma postagem de 26 de julho de 2026 no X (@Mr_Salio, intitulada "Vazamento do Kimi K3.1") lista um suposto conjunto de recursos para uma atualização do K3.1: desempenho reduzindo a diferença em relação ao GPT-5.6 e ao Claude Fable, inferência mais rápida/de menor latência, melhor eficiência de tokens em raciocínios longos, fluxos de codificação e agente mais confiáveis, menos etapas de raciocínio desperdiçadas, vantagem contínua sobre o Claude Opus 5 em algumas tarefas de codificação/agente, e um lançamento contínuo de pesos abertos. Nada disso é confirmado, não há números de benchmark e não há data de lançamento oficial. A linha de base confirmada é o Kimi K3: 2.8T de parâmetros, pesos abertos, #1 na Frontend Code Arena no lançamento.
Principais conclusões
• O vazamento não está verificado. Post único no X, sem números, sem data, sem confirmação da Moonshot. Trate como rumor.
• O suposto tema do K3.1 é eficiência, não um novo tamanho. Inferência mais rápida, latência menor, melhor eficiência de tokens, menos etapas de raciocínio.
• O posicionamento reivindicado: fechar a lacuna com GPT-5.6 Sol e Claude Fable 5, manter uma vantagem sobre o Claude Opus 5 em algumas tarefas de codificação/agente.
• Afirma-se que o peso aberto continua — consistente com o lançamento do MIT Modificado do K3.
• O que é real hoje é o Kimi K3 (2,8T, peso aberto, lançado em 16 de julho de 2026), não o K3.1.
O que o vazamento realmente diz
A fonte é uma única postagem no X de @Mr_Salio, com data de 26 de julho de 2026 e intitulada explicitamente "Kimi K3.1 Leak." Ela lista um conjunto de tópicos rumorados (parafraseado, atribuído a essa postagem):
• Desempenho que "fecha a lacuna" com GPT-5.6 e Fable.
• Mantém suas capacidades relatadas de nível superior ("Mythos-level") — a redação da postagem; "Mythos" não está definido no vazamento.
• Inferência mais rápida e menor latência.
• Melhor eficiência de tokens em tarefas longas de raciocínio.
• Fluxos de trabalho de codificação e agente mais confiáveis.
• Menos etapas de raciocínio desnecessárias.
• Continua a superar o Claude Opus 5 em tarefas-chave de codificação e agente.
• Permanece de peso aberto, mantendo a IA de fronteira livremente acessível.
Esse é todo o conteúdo do vazamento. Notavelmente ausente: qualquer pontuação de benchmark, contagem de parâmetros, comprimento de contexto, preço ou data de lançamento. A postagem termina até com uma pergunta em aberto aos leitores ("você acha que vai vencer o mythos?"), o que é um forte sinal de que isso é especulação, não um anúncio informado.

Quão crível é?
Baixo a moderado, e aqui está a leitura honesta. Por um lado, a direção especulada é plausível: as versões pontuais (uma ".1") quase sempre focam em eficiência e confiabilidade — inferência mais rápida, melhor economia de tokens, menos etapas de raciocínio desperdiçadas — em vez de uma arquitetura totalmente nova, e é exatamente isso que esta lista descreve. Também se encaixa na estratégia de pesos abertos da Moonshot com o K3.
Por outro lado, não há nada a verificar: é uma única conta anônima, sem números, sem capturas de tela de um model card, sem repositório do Hugging Face e nenhuma cobertura corroborativa em nenhum outro lugar até o momento da redação. Termos indefinidos como "Mythos-level" tornam impossível verificar. Até que a Moonshot publique pesos, um model card ou uma tabela de benchmarks — ou um veículo respeitável corrobore — isso deve ser arquivado como rumor, e não como roteiro.
O que está confirmado: Kimi K3
O modelo real, lançado é Kimi K3, lançado em 16 de julho de 2026 — um modelo Mixture-of-Experts de peso aberto com 2,8 trilhões de parâmetros, construído para codificação de longo horizonte, raciocínio e fluxos de trabalho de agente, com entrada multimodal nativa e uma janela de contexto de 1 milhão de tokens. No lançamento, saltou para o #1 no independente Frontend Code Arena (Elo relatado ~1.679), à frente do Claude Fable 5, GPT-5.6 Sol e GLM-5.2, e obteve 93,5% relatado no GPQA Diamond e ~91,2 no BrowseComp. A Moonshot comprometeu-se a liberar os pesos completos sob uma licença MIT Modificada. Esses são os números para se ancorar — e a linha de base realista a partir da qual qualquer "K3.1" construiria.
(Fontes para K3: materiais de lançamento da Moonshot e leaderboards independentes incluindo Frontend Code Arena e Artificial Analysis; os números são os relatados no lançamento e podem mudar.)
Se o vazamento estiver correto, o que significaria K3.1?
Lendo a lista rumorada com benevolência, o K3.1 seria umeficiência e confiabilidade lançamento, em vez de um salto de capacidade: aproximadamente qualidade de nível K3, mas mais rápido, mais barato por tarefa (melhor eficiência de tokens) e mais estável em loops agentivos (menos passos de raciocínio desperdiçados, uso de ferramentas mais confiável). Para equipes que já executam o K3, esse é o tipo de atualização mais valioso — reduz custo e latência sem forçar uma reavaliação da qualidade. A alegada "redução da lacuna com GPT-5.6 e Fable" e "vantagem sobre Opus 5 em algumas tarefas de codificação/agentes" manteriam, se verdadeiras, o K3.1 como a opção de pesos abertos mais forte para agentes de codificação. Mas novamente — se verdade.
Você deveria esperar por isso?
Não — não construa em torno de um rumor. Se você precisa de um modelo de codificação de pesos abertos de alto nível hoje, o Kimi K3 foi lançado, é aberto e é independentemente o #1 no Frontend Code Arena. Se o K3.1 chegar com ganhos reais de eficiência, adotá-lo depois é trivial (mesma família, pesos abertos). A ação racional é usar o K3 agora e testar novamente se e quando o K3.1 realmente for lançado com um cartão de modelo e números. Não atrase um projeto por um '.1.' não confirmado.
Como experimentar o Kimi K3 hoje
Kimi K3 é de peso aberto e está disponível através de provedores hospedados, inclusive via um endpoint compatível com OpenAI no OrcaRouter (modelo Kimi K3). Equipes neutras em relação a fornecedores roteiam o Kimi K3 junto com GPT-5.6 Sol, Claude Fable 5 e Claude Opus 5 por trás de um único endpoint, de modo que, se o K3.1 (ou qualquer novo modelo) for lançado, a troca é uma alteração de uma linha, em vez de uma migração.

Como isso se compara aos líderes atuais
Na imagem confirmada: o Kimi K3 lidera a Frontend Code Arena entre todos os modelos no lançamento e é a versão de peso aberto mais forte até hoje, enquanto modelos fechados de fronteira como Claude Fable 5 (líder do SWE-bench Verified) e Claude Opus 5 (#1 no Artificial Analysis Intelligence Index) ainda lideram em outros eixos. Um suposto K3.1 que "fecha a lacuna" tornaria uma corrida já acirrada ainda mais apertada — mas o vazamento não fornece números para posicioná-lo, então não vamos inventar nenhum.

Perguntas Frequentes
O Kimi K3.1 foi lançado?
Não. Em 27 de julho de 2026, não há um Kimi K3.1 oficial da Moonshot AI. A única fonte é uma postagem não verificada de 26 de julho no X.
O vazamento é confiável?
Trate como boato. É uma única postagem em rede social sem números de benchmark, sem ficha técnica, sem data de lançamento e sem corroboração. A direção (um lançamento pontual focado em eficiência) é plausível, mas não confirmada.
O que mudaria no K3.1 se o vazamento estiver correto?
Rumor: inferência mais rápida, latência menor, melhor eficiência de tokens em raciocínio longo, fluxos de trabalho de codificação/agentes mais confiáveis, menos etapas de raciocínio desperdiçadas — mantendo-se com pesos abertos e aproximadamente no nível K3 em qualidade.
O que é confirmado sobre Kimi K3?
K3 é um modelo real, lançado, com 2,8 trilhões de parâmetros e pesos abertos (16 de julho de 2026), #1 no Frontend Code Arena no lançamento, com contexto de 1 milhão de tokens e relatados 93,5% no GPQA Diamond e ~91,2 no BrowseComp.
O que é "Mythos"?
O vazamento faz referência a capacidades de 'nível Mythos' e pergunta se o K3.1 vai 'superar mythos', mas não define o termo. Não podemos verificar a que se refere, então estamos sinalizando em vez de adivinhar.
Devo esperar pelo K3.1 antes de escolher um modelo?
Não. Use o Kimi K3 (ou outro modelo atual) agora; reavalie se o K3.1 for lançado com especificações oficiais. Não planeje com base em um rumor.
Onde posso executar o Kimi K3?
Através de provedores hospedados e via API compatível com OpenAI da OrcaRouter, juntamente com os outros modelos de ponta para fácil comparação.
Conclusão
"Kimi K3.1" é, por enquanto, um vazamento — uma única postagem no X de 26 de julho descrevendo uma atualização de eficiência e confiabilidade (mais rápida, mais barata por tarefa, agentes mais estáveis, ainda com pesos abertos) sem números, sem ficha técnica e sem data. É plausível, mas não verificado, então estamos reportando como rumor, não como fato. A realidade confirmada é o Kimi K3: um modelo de 2,8T com pesos abertos, número 1 no Frontend Code Arena no lançamento, que você pode usar hoje. Se e quando a Moonshot lançar o K3.1 com benchmarks reais, atualizaremos esta postagem — e você poderá testá-lo em minutos através de um endpoint compatível com OpenAI no OrcaRouter.
