Um cartão de título gerado com o texto "Boreal vs Kimi K3" e o subtítulo "Nenhum dos dois roda no seu hardware", ícones de linha plana de um quadro de reprodução de vídeo, uma pilha de lâminas de servidor e um cadeado, com o logotipo da OrcaRouter composto no canto inferior direito.
Guides & Insights

Boreal vs Kimi K3: Nenhum dos dois roda no seu hardware

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Noventa e seis fragmentos Safetensors. É isso que baixar o Kimi K3 lhe dá — um modelo de mistura de especialistas com 2,8 trilhões de parâmetros, com 104 bilhões de parâmetros ativos por token, publicado sob uma licença MIT modificada em 27 de julho de 2026, onze dias depois que a Moonshot AI o lançou. A própria orientação da Moonshot para servi-lo recomenda configurações de supernó de pelo menos 64 aceleradores. Boreal não pode ser baixado de forma alguma: o modelo de vídeo publicitário da Creatify, lançado em 15 de setembro de 2026, é fechado e oferecido em autosserviço, com preço de um centavo por segundo de vídeo final de classe 720p. Um deles entrega-lhe os pesos e a conta de hardware. O outro fica com os pesos e cobra-lhe ao segundo. Nenhum dos dois está rodando no seu hardware, e os motivos são opostos — e é exatamente por isso que vale a pena fazer a comparação.

O que as "pesos abertos" realmente lhe entregam

O rótulo de pesos abertos faz um trabalho real nesta comparação, e faz menos trabalho do que parece.

O que você realmente obtém com o Kimi K3 é durabilidade. Os pesos existem como arquivos. Se a Moonshot AI mudasse seus preços, deixasse o modelo em segundo plano ou desaparecesse, o checkpoint ainda estaria lá — e também as pilhas de serving que o suportam, com vLLM, SGLang e TokenSpeed todos listados entre os caminhos compatíveis. Isso não é uma alegação de marketing; é uma propriedade do artefato. Para uma organização cujo registro de riscos inclui concentração de fornecedores, é o aspecto mais valioso do lançamento.

O que você não recebe é uma implantação que possa executar. Um modelo esparso de 2,8 trilhões de parâmetros com 896 especialistas não é algo que se quantiza e sai usando. A recomendação oficial de 64 ou mais aceleradores não é uma linha de base conservadora que uma equipe determinada consiga reduzir muito — é uma descrição da classe de máquina para a qual o modelo foi projetado. Equipes que executam o Kimi K3 em qualquer escala que se aproxime da de produção estão, na prática, alugando-o de alguém que opera um supernó. O que significa que a questão prática da disponibilidade não muda pelo fato de os pesos serem públicos: você continua comprando inferência de terceiros, e a licença é a única coisa que mudou.

Há um detalhe da licença que vale a pena ler com atenção, porque é a parte que a maioria dos resumos ignora. Os termos da MIT modificada condicionam as obrigações de marca e atribuição acima de 100 milhões de utilizadores ativos mensais ou 20 milhões de dólares em receita mensal, e exigem que empresas de modelo como serviço cuja receita do licenciado e de afiliadas exceda 20 milhões de dólares em quaisquer doze meses consecutivos celebrem um acordo separado com a Moonshot. A utilização interna e o ajuste fino são amplamente permitidos. A revenda está condicionada. Esta é uma licença razoável para um modelo de fronteira, e é algo materialmente diferente do MIT — para uma startup que planeie construir um produto com base nele, o limiar é uma negociação futura, não um direito presente.

O que a Boreal te envia em vez disso

A Boreal faz a troca oposta, e isso é mais deliberado do que parece.

A Creatify afirma que possui os pesos e os disponibiliza ela própria, e que o modelo base a partir do qual fez o pós-treinamento é um modelo de código aberto que gera áudio e vídeo em conjunto. Esses dois factos, em conjunto, constituem toda a estratégia de produto. A linhagem de código aberto indica-lhe aproximadamente que classe de modelo está a ser utilizada e que o áudio não é adicionado posteriormente. A propriedade indica-lhe que mais ninguém o pode disponibilizar, o que é precisamente o que torna possível, desde logo, um preço por segundo.

O que você obtém não é durabilidade — é vazão. A Creatify informa renderização a aproximadamente 1:1 com o tempo real: um segundo de vídeo finalizado a cada segundo de tempo real decorrido. Isso é um resultado de engenharia de inferência, e não de qualidade de modelo, e é isso que sobreviveria se os pesos fossem publicados amanhã. Se o checkpoint aparecesse no Hugging Face na próxima semana, a capacidade de renderizar um clipe de cinco segundos em cerca de cinco segundos por cinco centavos ainda pertenceria a quem construiu a pilha de serving — e a implementação de referência, com vazão equivalente a mais de 64 aceleradores já ajustada, ainda seria da Creatify.

Então, a simetria honesta é esta: o Kimi K3 oferece um checkpoint que você não tem como custear servir, e o Boreal oferece um serviço que você não consegue tirar do fornecedor. Ambos não podem ser auto-hospedados. Apenas um deles é uma proteção contra o risco do fornecedor, e é aquele em que a proteção custa mais do que aquilo que está sendo protegido.

A generated two-column scoreboard for Boreal vs Kimi K3 sharing six dimension labels. Boreal reads output rendered video, weights closed and vendor-served, self-hosting not possible, meter $0.01 per second, context not published, independent score none yet. Kimi K3 reads output text only, weights open with 96 shards, self-hosting 64+ accelerators, meter $3 / $15 per 1M, context 1M at a flat rate, independent score 1679 Elo front-end. Footer reads "Boreal figures vendor-run and unreproduced; Kimi K3 per our catalogue and third-party evaluators."

O contraste da especificação

• Saída — Boreal: vídeo renderizado, classe 720p, texto para vídeo e imagem para vídeo. Kimi K3: apenas texto.

• Pesos — Boreal: proprietário, de propriedade e disponibilizado pela Creatify. Kimi K3: publicado em 27 de julho de 2026, 96 shards Safetensors, MIT modificada com termos de revenda condicionados à receita.

• Auto-hospedagem — Boreal: não é possível. Kimi K3: possível em princípio, com a Moonshot recomendando pelo menos 64 aceleradores.

• Preço — Boreal: US$ 0,01 por segundo de vídeo finalizado. Kimi K3: US$ 3,00 por 1M de entrada / US$ 15,00 por 1M de saída, com leituras em cache a US$ 0,30 por 1M e uma tarifa fixa em toda a janela de contexto.

• Contexto — Boreal: não publicado. Kimi K3: 1.048.576 tokens, sem sobretaxa de contexto longo.

• Latência — Boreal: informada em 1:1 com o tempo real. Kimi K3: p50 do tempo até o primeiro token de 10,00 segundos em nosso quadro — o teto que nossa instrumentação reporta, então leia como "lento" em vez de uma medição precisa.

• Evidências — Boreal: apenas execuções do fornecedor. Kimi K3: linhas do fornecedor, incluindo 93,5 no GPQA Diamond e 88,3 no Terminal-Bench 2.1, um primeiro lugar na Frontend Code Arena com 1.679 de Elo, e descobertas independentes que incluem uma taxa de falha de 36% em problemas com invariantes ocultos.

O rastro que você não consegue desligar

O Kimi K3 tem uma propriedade de cobrança incomum até mesmo entre modelos de raciocínio, e é a diferença de custo mais concreta nesta comparação.

O modo de pensamento não pode ser desativado, e o esforço de raciocínio padrão está definido como máximo. Cada solicitação produz um traço de raciocínio completo, e cada token desse traço é cobrado a $15.00 por milhão de tokens de saída. Para uma tarefa em que a resposta é uma única palavra, você ainda está pagando por uma deliberação. As leituras de cache a $0.30 por milhão aliviam consideravelmente o lado da entrada, e o preço fixo em todo o contexto completo de 1M é genuinamente mais amigável do que as estruturas escalonadas que seus concorrentes usam — mas o lado da saída não tem modo barato.

O custo do Boreal não tem alavanca equivalente que possa ser ajustada incorretamente. Um clipe de cinco segundos custa cinco centavos, seja o modelo trabalhe muito ou trivialmente, porque o artefato é a unidade e o artefato é fixo. Isso não é obviamente melhor — simplesmente não é afetado por nada que o modelo faça internamente.

O Kimi K3 está no nosso catálogo, e é o modelo mais movimentado do nosso painel, com uma margem enorme: 3.150,6 milhões de tokens nos últimos sete dias, mais de dezessete vezes o tráfego do Grok 4.6 e treze vezes o do GPT-5.6 Sol. Esse volume é o que um modelo de fronteira de pesos abertos representa em produção — muitos chamadores, sensíveis a preço, dispostos a rotear em torno de quem o estiver servindo pior. Ele fica atrás da mesma chave do resto do catálogo, a preço de tabela do provedor com 0% de margem, o que importa mais para um modelo de pesos abertos do que para um fechado: quando o checkpoint é público, o preço é definido por quem quer que esteja servindo o modelo, então o preço é a variável competitiva e ele se move.

Boreal não está no nosso catálogo. O OrcaRouter não disponibiliza modelos de geração de vídeo, e a camada de texto de um pipeline de publicidade — os briefings, as variantes de gancho, a revisão de conformidade — é onde nós nos posicionamos em relação a ele.

A screenshot of Creatify's own launch post for Boreal, dated September 15 2026 and headed "Introducing Boreal: frontier-quality AI video at a cent a second", showing the Boreal by Creatify Labs logo card and the opening paragraph stating that Boreal generates text-to-video and image-to-video at one cent per second, about $0.05 for a five-second clip, and renders in realtime.

Qual deles, e o que assistir

Se a sua restrição é a concentração de fornecedores e você tem acesso a poder computacional sério, o Kimi K3 é o único desses dois que oferece uma resposta real, e a taxa de falha de 36% em problemas com invariantes ocultos é o número a ponderar contra isso. É um modelo de nível de fronteira com uma válvula de escape genuína acoplada, e a válvula de escape é cara o suficiente para que a maioria das equipes nunca a use.

Se a sua restrição é o custo por peça publicitária finalizada, a Boreal é a opção mais barata e muito mais previsível, e a restrição dela é a qualidade em um formato específico: um clipe de uma pessoa falando marcou 60% no próprio teste de 40 casos do fornecedor, contra 83% e 85% em cenas de produto e de criador. Teste esse formato antes de comprometer uma campanha com ele.

Uma ressalva sobre as evidências, porque se aplica a ambos. Os números publicados de inteligência do Kimi K3 foram revisados e republicados pelo menos uma vez, e números mais antigos na faixa de 57 a 60 não devem ser citados ao lado dos atuais do mesmo avaliador — um lembrete de que uma pontuação de benchmark é uma observação datada, não uma propriedade do modelo. E todos os números de qualidade associados ao Boreal vêm do próprio post de lançamento da Creatify. A primeira avaliação independente do Boreal, quando chegar, valerá mais do que tudo o que está atualmente publicado sobre ele.

A screenshot of the OrcaRouter model page for kimi/kimi-k3, showing Kimi K3 by MoonshotAI dated 2026-07-15 marked Featured, a 1M-token context, text + image input with text output, a p50 time to first token of 10.00 seconds, input $3.00 and output $15.00 per 1M tokens, and 3150.6M tokens of traffic in the last 7 days.