Um cartão de título com o texto Meta Muse, com o subtítulo A família inteira, e qual você quer, acima de uma fileira de seis rótulos: Muse Spark, Muse Image, Muse Video, Muse Glimmer, Muse Code e Muse Voice Transcribe.
Guides & Insights

Meta Muse: Todos os modelos da família de agentes pessoais da Meta, e qual deles você realmente quer

Autor

Elias Hawthorne

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Não existe uma única coisa chamada Meta Muse. Dependendo de qual link alguém enviou para você, isso significa o agente de consumo que a Meta colocou em circulação nos EUA em 8 de setembro de 2026 — ou um dos modelos por trás dele: Muse Spark, o modelo de raciocínio nativamente multimodal que faz o trabalho de pensamento de fato; Muse Image e Muse Video, os geradores de mídia que a Meta apresentou como prévia em 7 de julho de 2026; Muse Glimmer, o modelo de pesos abertos de 30 bilhões de parâmetros sob Apache 2.0; Muse Code, o agente de codificação para terminal; Muse Voice Transcribe, o modelo de fala para texto; e Muse Realtime Avatar, a camada de corporificação que a Meta mostrou na Connect 2026 em 23 de setembro. Dois desses nomes também são coisas que não são modelos de forma alguma: Muse Connectors é uma superfície de produto, e Muse Realtime Voice é a camada conversacional dentro do agente.

Esta página existe para esclarecer isso. Ela não é um artigo de notícias sobre um evento datado. É a página de referência canónica para uma família de modelos que está ativa no nosso catálogo hoje — a página a que o leitor chega depois de pesquisar o próprio nome do modelo. O seu fundamento é a procura de pesquisa constante que medimos em primeira mão a 2026-09-29, e não a novidade de um lançamento. As âncoras datáveis nela presentes (8 de setembro para o agente, 23 de setembro para o Connect) são factos usados para datar estes produtos, não eventos que esta página esteja a noticiar. Cobrimos o lançamento do agente separadamente e esta página não o volta a noticiar; se quiser essa história, a cobertura do lançamento é o sítio a consultar.

A tabela de roteamento de um minuto, em prosa

Comece com a pergunta que você está realmente fazendo e pare na linha que a responde.

• Se você quer o produto de consumo — um agente pessoal que lê seu e-mail, faz reservas, roda em segundo plano e pede permissão antes de gastar dinheiro —, esse é o Meta Muse, o agente, e sua interface é o app Muse ou a web em muse.ai. O post de anúncio da Meta lista a disponibilidade nos EUA em iOS, Android e muse.ai, e o descreve como gratuito "para a maior parte do que as pessoas precisam", com planos de assinatura acima disso. Esse enquadramento é da própria Meta, publicado na própria página da Meta, e é o único lugar em que se afirma a existência de um nível gratuito; nada sobre limites de uso ou cotas de crédito é publicado.

• Se você quer o modelo que responde a perguntas e escreve código — aquele que você chamaria de uma API — esse é Muse Spark, e o identificador atual é muse-spark-1.3. A própria página do modelo da Meta documenta uma janela de contexto de 1M de tokens a US$ 1,25 por milhão de tokens de entrada, US$ 0,15 por milhão de tokens de entrada em cache e US$ 4,25 por milhão de tokens de saída, com um nível de contribuidor mais barato a US$ 0,10 / US$ 0,002 / US$ 0,20 que opta seu tráfego para melhoria do produto.

• Se você quiser gerar ou editar uma imagem estática — isto é, Muse Image, um modelo de imagem agêntico que a Meta precifica em US$ 0,01 por imagem em sua própria página de modelo. Ele não é um modelo de texto para texto; ele recebe um prompt e imagens de referência e retorna imagens.

• Se você quer vídeo gerado — isso é Muse Video, e este é o único membro da família em que quase tudo ainda não foi anunciado. A Meta divulgou uma prévia dele em 7 de julho de 2026 e, desde então, não publicou data de lançamento, preço, duração do clipe, resolução nem regiões. Qualquer coisa que cite um dia de lançamento específico ou um preço para o Meta Muse Video sem um anúncio mais recente da Meta é especulação, e isso inclui nós.

• Se você quiser transcrever áudio — isso é Muse Voice Transcribe, com preço definido pela Meta de US$ 0,18 por hora (US$ 3,00 por 1.000 minutos) na página do modelo, com atribuição de falante. Não é um modelo de entrada de texto; ele consome áudio e emite texto.

• Se você quiser executar um agente no seu próprio hardware sem nenhuma chamada de API — trata-se do Muse Glimmer, 30 bilhões de parâmetros, Apache 2.0, pequeno o suficiente para uma única GPU de consumidor ou um Mac, e distribuído pela Meta como pesos para download em vez de por meio de um endpoint.

• Se você quer um agente no seu terminal ou na sua CI — esse é o Muse Code, uma CLI que controla o Muse Spark, instalada com um script de shell de uma linha, e a Meta agora documenta tanto um instalador para macOS/Linux quanto um instalador para Windows PowerShell.

• Se você quer um rosto e uma voz do outro lado de uma conversa — esse é o Muse Realtime Avatar, anunciado em 23 de setembro de 2026 junto com o post de pesquisa da Meta intitulado "Bringing Your Muse to Life".

A single-column scoreboard titled Meta Muse - the family scoreboard, listing Muse Spark at $1.25 and $4.25 per million tokens, Muse Image at $0.01 per image, Muse Voice Transcribe at $0.18 per hour, Muse Glimmer at 30B under Apache 2.0 with open weights, Muse Code as a terminal agent for macOS, Linux and Windows, and Muse Video with no date and no price announced, footnoted to Meta's own model pages read September 29, 2026.

O que diz a própria cronologia da Meta

A família é mais fácil de guardar na cabeça como uma sequência do que como uma lista, porque a Meta a lançou num ritmo constante ao longo de 2026. Estas datas vêm do índice do blog de pesquisa da Meta, que lemos diretamente, e não a partir do resumo de outra pessoa:

• 8 de abril de 2026 — "Apresentando o Muse Spark: Escalando Rumo à Superinteligência Pessoal", o primeiro modelo Muse do Meta Superintelligence Labs.

• 7 de julho de 2026 — Muse Image e Muse Video anunciados juntos. O Image foi lançado; o Video não.

• 9 de julho de 2026 — Muse Spark 1.1.

• 5 de agosto de 2026 — Muse Code e Muse Spark 1.2 no mesmo dia.

• 10 de agosto de 2026 — Muse Glimmer, o lançamento de pesos abertos.

• 1 de setembro de 2026 — Muse Voice Transcribe.

• 2 de setembro de 2026 — Muse Spark 1.3.

• 8 de setembro de 2026 — o próprio agente Muse, além do post complementar da Meta "Como construímos a segurança no Muse."

• 23 de setembro de 2026 — "Dando vida à sua musa", o trabalho de avatar em tempo real, publicado no dia de abertura do Connect.

Uma correção a fazer aqui, porque esta família é excepcionalmente fácil de errar em datas e uma das datas em ampla circulação está errada. A postagem de retrospectiva do Connect da Meta é datada de 24 de setembro de 2026 e começa com "Ontem no Connect 2026." Ela diz que a Meta está trazendo o Muse para seus óculos de IA "nos próximos meses." O acesso aos óculos foi anunciado em 23 de setembro; ele não está sendo distribuído, e a própria página da Meta não o descreve como disponível. Se você leu que o Muse chegou aos óculos de IA em 23 de setembro, isso é um anúncio sendo noticiado como disponibilidade, e a página da Meta prevalece.

A capture of Meta's research blog index listing the Muse release chronology in reverse order: Muse Spark 1.3 on September 2, 2026, Bringing Your Muse to Life on September 23, How We Built Safety Into Muse on September 8, Muse Voice Transcribe on September 1, Muse Glimmer on August 10, Muse Code and Muse Spark 1.2 on August 5, Muse Spark 1.1 on July 9, Muse Image and Muse Video on July 7, and Muse Spark on April 8.

A superfície do desenvolvedor, e por que ela importa mais do que o aplicativo

A parte desta família com que um construtor se deve preocupar não é o agente. É a Meta Model API, porque é a primeira vez que a Meta expõe um modelo Muse através de uma superfície que se parece com algo que já possui. O próprio guia de início rápido da Meta di-lo claramente: a Model API "é compatível de imediato com o SDK da OpenAI, o SDK da Anthropic e CLIs de agentes compatíveis com a OpenAI, pelo que a maioria das stacks funciona com uma alteração do URL base e da chave". O URL base é https://api.meta.ai/v1 e o ID do modelo para o Spark atual é muse-spark-1.3.

Se essa compatibilidade é real na prática é uma questão separada de saber se é verdadeira no papel, e não a testamos. O que é verificável hoje é que a Meta documenta caminhos de protocolo, e não apenas um — uma Responses API, uma Chat Completions API e uma Messages API — o que é um sinal mais forte do que um único endpoint "compatível com OpenAI" costuma ser, porque significa que o caminho no formato Anthropic foi construído, em vez de simplesmente acoplado.

As modalidades são o ponto que exige leitura atenta. As modalidades de entrada documentadas do Muse Spark, da Meta, são texto, imagem, PDF e vídeo, com saída em texto. Esse é um modelo nativamente multimodal com uso de ferramentas, não um modelo de texto com um endpoint de imagem ao lado. Se você precisa de saída que não seja texto, o Spark não é o membro da família que você procura — é exatamente por isso que Muse Image e Muse Voice Transcribe existem como modelos separados, com preços separados.

É também aqui que o roteamento se justifica. Uma família tão ampla significa que o modelo que você quer depende da requisição, e a diferença de custo entre os membros é grande: $0,01 por imagem e $0,18 por hora de áudio estão em um envelope orçamentário completamente diferente de $1,25 por milhão de tokens. Colocar vários deles atrás de um único endpoint, com failover quando um provedor apresenta degradação e uma regra de roteamento que escolhe o modelo por tipo de requisição, é um problema de engenharia menor do que integrar o SDK de cada fornecedor separadamente — e, como um roteador pass-through cobra o preço de tabela do provedor, uma mudança de preço da Meta entra em vigor no mesmo dia, em vez de na próxima renovação de contrato.

Muse Glimmer é o que você mesmo roda

Glimmer vale a pena ser separado do restante, porque inverte o modelo de distribuição. A Meta o chama de "um modelo aberto feito para agentes locais sempre ativos", com 30 bilhões de parâmetros sob Apache 2.0, e você o obtém baixando os pesos em vez de chamar um endpoint. O posicionamento da própria Meta é que ele é pequeno o suficiente para uma única GPU de consumidor ou um Mac, e ela aponta chamada de ferramentas, estado persistente entre reinicializações e memória autogerenciada ao longo de sessões longas como os objetivos de design.

A Meta publica uma tabela comparativa na página do modelo Glimmer em relação ao Gemma4-31B e ao Qwen3.6-27B no modo de pensamento. Trata-se de uma comparação selecionada pelo fornecedor, com benchmarks escolhidos pelo fornecedor, e deve ser lida dessa forma — o Glimmer lidera na maioria das linhas agênticas que a Meta escolheu publicar e fica atrás em GPQA Diamond e Humanity's Last Exam. Não repetimos os números individuais aqui porque eles pertencem a um modelo que não servimos; se você está escolhendo um modelo local, leia os números diretamente na própria página do modelo da Meta e no model card publicado por ela, e execute sua própria tarefa com ele. Observe também que uma versão anterior da nossa própria cobertura descrevia o Muse Code como apenas para macOS e Linux. A documentação atual da Meta também lista um instalador para Windows PowerShell, então essa afirmação está desatualizada e a página da Meta prevalece.

A arquitetura de segurança, em um parágrafo

O design de segurança do Muse é a engenharia mais substancial que a Meta publicou sobre a família, e vale a pena conhecer os contornos antes de decidir quanto acesso dar a um agente pessoal. O agente roda dentro da Muse Secure VM — uma VM Linux dedicada por usuário, com o harness agêntico dentro de um contêiner systemd-nspawn cujo root é mapeado para um usuário host sem privilégios, de modo que o root do contêiner não é o root do host. As credenciais nunca chegam ao agente: elas ficam em armazenamento pertencente ao hatch-authd, que emite tokens substitutos, e um agente Sentinel separado é a única autoridade de permissão para ações de conector e para toda a saída de rede. O Sentinel avalia uma requisição tanto em L4 quanto em L7, faz substituição de credenciais just-in-time na fronteira da rede e usa rastreamento de fluxo de dados em nível de kernel (a Meta chama isso de "tainted egress" — implementado com eBPF) para que um processo que leu seus dados não possa seguir por um caminho de permissão automática. Os classificadores de segurança rodam fora da célula de runtime justamente para que um invasor não possa desativá-los de dentro dela. Os próprios números da Meta para o programa de recompensas são a calibração útil: até US$ 300.000 por relatórios válidos, incluindo até US$ 130.000 por uma injeção de prompt que afeta um único usuário. Isso é uma empresa publicando um preço pelo modo de falha de seu próprio produto, o que não é a norma. O texto completo está em research.meta.ai/blog/security-and-safety-for-ai-agents-our-approach-with-muse e vale vinte minutos.

O que a Meta não publicou

Uma página de referência que apenas repete marketing não é uma página de referência. Aqui está o estado honesto das lacunas:

• Benchmarks monolíticos. Não há um único número de índice publicado que classifique esta família em relação a concorrentes de ponta nas próprias páginas da Meta. A página do Muse Spark 1.3 exibe uma pequena tabela que compara GDPval-AA v2, JobBench e uma coluna parcial com Muse Spark 1.2, GPT 5.6 Sol e Opus 5, e os valores são medidos pela Meta com configurações de esforço escolhidas pela Meta. Isso é uma ablação interna, não um confronto direto, e não se estende ao agent, ao Image, ao Video, ao Glimmer nem ao Voice Transcribe.

• Qualquer confronto direto com esforço e harness equivalentes. Dois desses modelos não foram comparados por benchmark entre si em nenhum lugar que pudéssemos verificar, em nenhuma das direções, na mesma bancada de avaliação. Quando existe um número, ele é informado pelo fornecedor, e dizemos isso na frase em que ele aparece.

• Toda a forma comercial do Muse Video. Sem data, preço, limite ou região, como abordado acima.

• Limites de taxa e estruturas de crédito. A página de documentação de preços e limites de taxa da Meta retorna, a partir daqui, uma estrutura vazia sem números legíveis — um documento de 107,8xx bytes sem valores em dólares — então qualquer número sobre os limites da Meta seria inventado. A única exceção são os preços por unidade citados acima, que lemos hoje nas páginas individuais de modelos da Meta.

• Qualquer coisa sobre o que ai.meta.com/muse/ diz. Esse URL retorna 200 com um título de confirmação e nenhum corpo que possamos extrair, portanto não vamos caracterizar o seu conteúdo.

O que é realmente chamável, e onde

Esta é a parte em que as alegações de disponibilidade ficam obsoletas mais rapidamente, por isso é declarada de forma restrita e a partir de uma verificação ao vivo, e não de um artigo irmão. Em 2026-09-29, o catálogo do OrcaRouter disponibiliza exatamente duas rotas Muse, verificadas individualmente em relação à API pública de modelos:

• Meta: Muse Spark 1.2 — contexto de 1,048,576 tokens, US$ 1,25 por milhão de tokens de entrada, US$ 0,15 por milhão de tokens de entrada em cache, US$ 4,25 por milhão de tokens de saída, data de lançamento informada: 2026-08-05.

• Meta: Muse Spark 1.1 — mesmo contexto de 1.048.576 tokens e a mesma tarifa de $1,25 / $0,15 / $4,25, data de lançamento indicada 2026-07-16.

Esses dois preços são iguais à tarifa que a Meta publica para muse-spark-1.3 na própria página do modelo, e é assim que se parece um repasse sem margem: você paga o preço de tabela da Meta, e nós não acrescentamos nada a ele. O Muse Spark 1.2 está disponível no OrcaRouter pelo preço de tabela exato da Meta e é a opção a escolher se você estiver migrando uma carga de trabalho Spark existente.

Nada mais da família está no nosso catálogo, e vale a pena ser direto sobre essa ausência: Muse Spark 1.3, Muse Image, Muse Video, Muse Glimmer, Muse Code e Muse Voice Transcribe todos retornam um não encontrado da API pública de modelos hoje. Se você quer o identificador 1.3 ou o preço de US$ 0,01 por imagem, esse é o endpoint da própria Meta, não o nosso. Uma afirmação confiante e errada sobre disponibilidade é pior do que nenhuma afirmação, então esse é o parágrafo inteiro.

A capture of the OrcaRouter model page for meta/muse-spark-1.2, showing the input modalities text, image, video, file and audio with text output, the pricing row of $1.25 per million input tokens and $4.25 per million output tokens, a p50 time-to-first-token of 10.00 seconds, and a listed release date of 2026-08-05.

Como pensar sobre a família em uma única passagem

Três separações fazem a maior parte do trabalho. Primeira, produto versus modelo: Meta Muse é um agente para consumidores com uma UI e um sistema de permissões, e não é algo que você chama a partir do código — o elemento chamável por baixo dele é o Muse Spark. Segunda, endpoint versus download: todos os membros, exceto o Muse Glimmer, são acessados por meio da Meta Model API ou de um cliente construído sobre ela, e o Glimmer é acessado baixando os pesos. Terceira, lançado versus anunciado: Image, Voice Transcribe, Spark e o agente estão sendo lançados; Video e o acesso aos óculos não estão, e ambos ganharam uma data falsa que circula.

Se você está decidindo o que construir neste trimestre, a leitura prática é que o Muse Spark é o único membro da família com preço publicado, janela de contexto publicada, API documentada e um caminho de failover barato — o que o torna o ponto de entrada de baixo risco e faz com que todo o resto seja algo para observar, e não algo em torno do qual planejar. Se você está decidindo o que ler, o post de segurança é o documento de maior valor que a Meta publicou sobre a família, porque é ele que diz o que acontece quando o agente erra.