Um cartão de título em destaque para o artigo {{1}}'Meta Watermelon: A Provocação da Próxima Fronteira, Decodificada'{{/1}} com um selo {{2}}'RELATO DE VAZAMENTO · O QUE SABEMOS ATÉ AGORA'{{/2}}, o subtítulo {{3}}explicando que em 2 de setembro Zuckerberg encerrou sua publicação de lançamento do Muse Spark 1.3 com duas promessas — um modelo provocado com um emoji de melancia e lançamentos de peso aberto do Muse Spark, ambos ainda não lançados{{/3}} — e quatro chips com os textos {{4}}'Alvo relatado: outubro de 2026'{{/4}}, {{5}}'Alegação de capacidade: equivale ao GPT-5.5 (avaliações não nomeadas)'{{/5}}, {{6}}'Computação: ~10x a geração anterior'{{/6}} e {{7}}'Distribuição: desconhecida — peso aberto não confirmado'{{/7}}, com o logotipo do {{8}}OrcaRouter{{/8}} inserido no canto inferior direito.
Guides & Insights

Meta Watermelon após o Meta Connect: A keynote veio e se foi sem ele

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Meta Watermelon deveria ser o motivo para assistir à Meta Connect 2026. A keynote aconteceu em 23 de setembro, em Menlo Park, e o modelo — um codinome de trabalho para o próximo sistema de escala de fronteira da Meta, provocado por Mark Zuckerberg em 2 de setembro com um único emoji de melancia — não estava lá. Nenhum novo modelo de fronteira foi anunciado. Nem a outra metade daquela promessa de 2 de setembro se concretizou: os pesos abertos do Muse Spark 1.2 ainda não estão no Hugging Face, agora quarenta e cinco dias depois de Zuckerberg dizer que chegariam "nas próximas semanas". O que a Connect entregou foi a superfície de produtos Muse, e não um novo cérebro — um modelo Muse Realtime Avatar para conversa por vídeo ao vivo, um Muse Voice personalizável e uma plataforma Connectors que foi aberta a desenvolvedores em 19 de setembro — enquanto o Muse Spark 1.3, o atual checkpoint de fronteira da Meta, continua sendo o modelo de fronteira mais recente que a Meta de fato lança.

Este ainda é um texto do tipo “o que sabemos até agora”, mas seu primeiro ponto de verificação agora se resolveu. O teaser de 2 de setembro estabeleceu duas expectativas e um evento; o evento passou e ambas as expectativas continuam em aberto. Tudo o que vem abaixo sobre a capacidade, o momento e a distribuição da Watermelon continua sendo declarado por fornecedores ou executivos, ou extraído de reportagens da imprensa sobre reuniões internas da Meta que a Meta nunca confirmou. O que mudou esta semana não é o modelo. É o calendário: a janela mais provável para uma revelação pública se fechou sem que ela acontecesse, o que transforma a meta de outubro noticiada de uma nota de rodapé no próximo item datado a acompanhar.

O que o provocador realmente disse.

A frase de encerramento, repassada no X pela conta @scaling01, diz: “A seguir 🍉 e lançamentos de pesos abertos do Muse Spark em breve.” Lida ao pé da letra, ela nomeia duas coisas futuras: um modelo cujo placeholder público é um emoji de melancia, e o lançamento de pesos abertos da linha Muse Spark. O contexto importa. A publicação que ela encerrava era um lançamento — Muse Spark 1.3, o quarto checkpoint Muse Spark da Meta em 2026, com preço inalterado de US$ 1,25 por milhão de tokens de entrada e US$ 4,25 por milhão de tokens de saída, com a Meta afirmando cerca de 25% menos tokens por tarefa do que o Muse Spark 1.2. Todos esses números são da própria Meta ou da Artificial Analysis; nada disso é o que tornou o tease digno de notícia.

O que o tornou digno de notícia foi o fato de um CEO ter anexado um produto carro-chefe não lançado e uma promessa de código aberto não cumprida a uma publicação de lançamento — um roteiro implícito, em público, sem datas. Na preparação para o keynote, a conta de monitoramento de desenvolvedores @testingcatalog publicou uma lista de expectativas pré-evento que citava um novo modelo da classe Watermelon, a abertura do código-fonte do Muse Spark, um lançamento do Muse Video com disponibilidade de API e novos modelos de voz e recursos de criação de voz como o que se poderia esperar. Essa lista era uma expectativa, não um cronograma, e o keynote não entregou a parte relativa a modelos. Um teaser como este não é uma ficha de especificações, mas continua sendo o sinal público mais forte de que Watermelon é real e é o próximo.

Meta Watermelon: o modelo por trás do emoji

Meta Watermelon é um codinome de trabalho, não um nome de produto que a Meta confirmou. O que se sabe vem de quatro camadas de reportagens, nenhuma delas um cartão de modelo oficial.

Primeiro, o The Information noticiou em 25 de agosto de 2026 que a Meta está mirando um lançamento do Watermelon para outubro de 2026, citando documentos internos. A mesma reportagem vinculou o Watermelon a uma investida mais ampla voltada ao consumidor — uma plataforma de agente de IA companheiro, supostamente com o codinome Hatch, com uma assinatura premium noticiada em até US$ 199,99 por mês — e observou que os documentos internos não esclareciam se o Watermelon seria lançado dentro da família Muse, como sucessor do Muse Spark, ou como um sistema independente. Segundo, uma reunião geral de 2 de julho de 2026, noticiada primeiro pelo Business Insider, traz Alexandr Wang — diretor de IA da Meta e chefe do Meta Superintelligence Labs — dizendo a funcionários que o Watermelon havia "alcançado" o GPT-5.5 da OpenAI em principais benchmarks, usando, conforme ele descreveu, uma ordem de magnitude mais de poder computacional do que a geração anterior. Os benchmarks não foram nomeados, a Meta se recusou a comentar e não existe avaliação independente. Terceiro, a CNBC noticiou desde então que a Meta pausou uma etapa de pré-treinamento em julho e depois a retomou, adiando o lançamento para não antes de outubro. Quarto, em 23 de setembro, enquanto a keynote acontecia, a cobertura repassou declarações de Wang de que a Meta lançaria em breve seu modelo mais capaz até agora, com a linha Muse Spark já lançada sendo enquadrada como um "aperitivo" — declarado por executivo e noticiado de forma indireta, embora o veículo não tenha datado as declarações e, de qualquer modo, não se trate de um anúncio de produto.

• Codinome de trabalho — Meta Watermelon; sem nome de produto, parâmetros ou arquitetura confirmados.

• Alvo noticiado — outubro de 2026, segundo a reportagem de 25 de agosto do The Information, que cita documentos internos; a reportagem da CNBC sobre a pausa no pré-treinamento aponta na mesma direção.

• Computação — "uma ordem de magnitude" a mais que a geração anterior, segundo a reunião geral de Wang em 2 de julho, conforme relatado; não verificada de forma independente. Relata-se que o cluster de treinamento é o Prometheus, a instalação da Meta em New Albany, Ohio, de aproximadamente 1 gigawatt, com cerca de 500.000 GPUs.

• Alegação de capacidade — de acordo com relatos, corresponde ao GPT-5.5 em benchmarks internos não revelados; não há execução externa.

• Linhagem — incerta: sucessor da família Muse, lançamento da família Llama ou modelo independente; documentos internos não esclarecem, segundo relatos.

• Distribuição — desconhecida, incluindo se será lançado com pesos abertos. Nada no Connect mudou isso.

O valor de "ordem de grandeza" citado para o poder computacional merece uma nota de ceticismo. Multiplicar por dez o poder computacional de treinamento de um modelo que já é grande não implica um modelo dez vezes melhor — as leis de escala são sublineares, e um aumento de dez vezes na computação normalmente rende apenas uma fração do ganho de capacidade. Trate a afirmação de paridade com o GPT-5.5 como uma declaração direcional sobre a postura computacional da Meta, não como um resultado verificado.

O que o Meta Connect realmente entregou

Meta Connect 2026 aconteceu em 23–24 de setembro, em Menlo Park. A palestra principal foi sobre o Muse, o agente pessoal da Meta, e sobre hardware: óculos Ray-Ban Meta Audio sem câmera por US$ 349, um Ray-Ban Meta de terceira geração a partir de US$ 449, os Meta VR Glasses de aproximadamente 100 gramas por US$ 1.299 para a primavera de 2027, e o dispositivo Muse Charm do tamanho da palma da mão. No lado dos modelos, o que foi lançado ficou mais limitado do que as expectativas anteriores ao evento.

• Anunciado no Connect — Muse Realtime Avatar, um modelo que controla o rosto, o corpo e a voz de um avatar durante uma conversa por vídeo ao vivo. A Meta descreveu-o como algo que chegará "nos próximos meses", e não como disponível em geral.

• Anunciado no Connect — Muse Voice, uma camada de personalização que permite ao usuário alterar a voz, o sotaque e a velocidade de fala do assistente descrevendo o que deseja.

• Lançado antes do Connect — os Muse Connectors chegaram aos desenvolvedores em 19 de setembro. A Meta diz que recebeu mais de 1.500 inscrições em menos de uma semana, com GitHub, Notion e Granola entre os parceiros nomeados.

• Não lançado — Muse Video. Pré-visualizado em 7 de julho de 2026 ao lado do Muse Image e prometido "em breve para criadores e na Meta AI", ele ainda não tem data de lançamento, API pública, preço, resolução nem duração de clipe. O único sinal de acesso para desenvolvedores continua sendo uma seção "Video Playground" não lançada, detectada na plataforma de desenvolvedores da Meta, que não contém endpoint, esquema nem identificador de modelo.

• Não lançado — um modelo ou API de geração de voz. O vestígio do "Voice Playground" ainda não foi lançado, e o modelo de voz que a Meta realmente lançou, Muse Voice Transcribe, é um modelo de transcrição, e não de criação de voz.

• Não lançado — qualquer novo modelo de fronteira, e qualquer revelação da classe Watermelon.

A distinção com maior probabilidade de se perder na cobertura é entre Muse Voice e Muse Voice Transcribe: o primeiro personaliza como o assistente da Meta soa, o segundo transforma fala em texto. Nenhum dos dois é uma API de clonagem de voz, e nada no Connect disponibilizou uma.

A metade de pesos abertos agora tem seis semanas.

A segunda cláusula — "lançamento dos pesos abertos do Muse Spark em breve" — não é nova. Em 10 de agosto de 2026, Zuckerberg anunciou que a Meta lançaria os pesos do Muse Spark 1.2 "nas próximas semanas", uma reversão da estratégia fechada e somente para convidados que a Meta havia adotado com a estreia do Muse Spark em abril. No mesmo dia, a Meta lançou o Muse Glimmer, um modelo de pesos abertos de 30 bilhões de parâmetros sob licença Apache 2.0, destilado das saídas do Muse Spark e voltado para uma única GPU de consumo ou um envelope de hardware classe laptop. O Muse Glimmer foi lançado; os pesos do Muse Spark 1.2 não.

Em 24 de setembro de 2026 — quarenta e cinco dias após a promessa de 10 de agosto e três semanas após a reafirmação do teaser — não existe nenhum repositório do Muse Spark 1.2 no Hugging Face. Uma verificação direta da organização de modelos da Meta no Hub hoje retorna quatro repositórios, todos eles variantes do Muse Glimmer: não há nenhum checkpoint do Muse Spark de qualquer versão, nenhuma licença, nenhuma especificação de hardware e nenhuma data. No lançamento de 2 de setembro, a Meta indicou separadamente que não decidiu se os pesos do Muse Spark 1.3 virão na sequência, e nada no Connect alterou isso. A situação prática para um desenvolvedor que decide se deve planejar em torno de um Muse Spark auto-hospedado permanece inalterada: a janela continua sendo declarada como "em breve", e o único modelo da família Muse com pesos abertos realmente baixável é o Muse Glimmer.

O que está confirmado versus o que é um palpite

Separar os dois é toda a função desta peça.

• Confirmado — que a provocação existe: a postagem de Zuckerberg de 2 de setembro sobre o Muse Spark 1.3 terminou com a linha "A seguir: 🍉 e lançamentos de pesos abertos do Muse Spark em breve", e @scaling01 a repassou.

• Confirmado — que o Muse Spark 1.3 foi lançado em 2 de setembro a US$ 1,25/US$ 4,25 com uma janela de contexto de 1M tokens, e que ainda é o modelo mais recente lançado pela Meta após o Connect. No Índice de Inteligência da Artificial Analysis, com dados de 24 de setembro, o Muse Spark 1.3 (max) obtém 48 pontos — atrás da fronteira fechada (Claude Opus 5.5 com 58, Claude Fable 5.1 e GPT-6 Astra com 53) e à frente dos líderes de pesos abertos (Qwen3.8 Max com 45, GLM-5.3 com 45, Kimi K3 com 44). A Artificial Analysis reajustou a base deste índice mais de uma vez desde setembro, portanto o instantâneo do ranking mais abaixo neste artigo é uma captura de 6 de setembro em uma revisão anterior, e seus números não são diretamente comparáveis aos de hoje.

• Confirmado — que a Meta prometeu os pesos do Muse Spark 1.2 em 10 de agosto de 2026, e que, até 24 de setembro, os pesos ainda não apareceram no Hugging Face; isto é verificável por qualquer pessoa.

• Confirmado — que o Muse Glimmer (30B, Apache 2.0) foi lançado como um modelo de pesos abertos em 10 de agosto de 2026.

• Confirmado — que a Meta Connect 2026 ocorreu em 23–24 de setembro e não anunciou nenhum novo modelo de fronteira; os resumos do keynote são públicos.

• Não verificado — que "Watermelon" seja de fato o nome do modelo sugerido; é um codinome provisório vindo de relatos da imprensa, e a Meta não confirmou que o emoji corresponde a ele.

• Não verificado — a meta de outubro de 2026, a alegação de paridade com o GPT-5.5, o número de dez vezes mais capacidade de computação e a noticiada pausa de julho no pré-treinamento; tudo isso se baseia em fontes não identificadas ou em relatos da imprensa.

• Não verificado — que Watermelon será de pesos abertos, ou que os pesos abertos do Muse Spark 1.2 chegarão em alguma data específica; "em breve" não é uma data.

A interpretação equivocada mais provável do teaser — de que a Meta está prestes a liberar os pesos do seu atual modelo de fronteira — é a que as evidências menos sustentam. A Meta se comprometeu a liberar o checkpoint anterior (Muse Spark 1.2), deixou explicitamente o 1.3 em aberto e não disse absolutamente nada sobre a distribuição do Watermelon.

A two-column infographic titled 'Watermelon & the Muse Spark open-weights tease — what is confirmed vs what is a guess'. Left column (green, 'CONFIRMED / CHECKABLE'): 'The tease exists — Sept 2, 2026 Zuckerberg post, relayed by @scaling01', 'Muse Spark 1.3 shipped Sept 2 at $1.25 / $4.25', 'Muse Spark 1.2 weights promised Aug 10 — none on Hugging Face by Sept 6', 'Muse Glimmer 30B open weights shipped Aug 10 (Apache-2.0)'. Right column (amber, 'UNVERIFIED / REPORTED'): 'The emoji maps to a model called Watermelon', 'October 2026 release target (The Information)', 'GPT-5.5 parity on unnamed internal benchmarks', 'An order of magnitude more compute than the prior generation'. Footer: 'Every Watermelon capability claim is internal or press-reported — no independent run exists.' OrcaRouter logo composited bottom-right.

Se ambas as metades caírem, o que realmente muda?

Vale a pena ser concreto sobre por que essa provocação importa para alguém que está escolhendo um modelo, porque as duas promessas apontam para decisões diferentes.

Um Muse Spark 1.2 de pesos abertos seria o primeiro modelo Meta quase de fronteira que uma equipe pode auto-hospedar — sem taxa de API por token, controle total dos dados, pesos sob qualquer licença que a Meta eventualmente escolher. No ranking de inteligência de setembro de 2026 que importa, o topo do Artificial Analysis Intelligence Index é um grupo de modelos fechados — Claude Opus 5.5, da Anthropic, com 58; Claude Fable 5.1, da Anthropic, e GPT-6 Astra, da OpenAI, com 53 — com Muse Spark 1.3 (max) em 48, acima dos atuais líderes de pesos abertos na casa dos 40 e pouco. Um Muse Spark 1.2 de pesos abertos seria competitivo com o topo do atual campo auto-hospedável, e não claramente acima dele — o cenário mais consequente é o Watermelon. Se o Watermelon for lançado com pesos abertos em algum lugar próximo da capacidade que a Meta alegou internamente, ele ficaria no topo ou acima de todo o campo de pesos abertos, e é exatamente por isso que a questão da distribuição é a que deve ser observada, e não a alegação de benchmark.

A outra mudança é mais sutil e já está visível: a Meta está repetindo o manual do Llama num ano em que a fronteira dos pesos abertos se deslocou para laboratórios chineses. Os líderes de pesos abertos que a Meta estaria perseguindo — e que um Muse Spark ou Watermelon aberto teria de superar — não são a OpenAI nem a Anthropic; são os modelos de pesos abertos de laboratórios como Alibaba, Z.ai e Moonshot que atualmente definem o que uma equipe consegue auto-hospedar no nível mais alto, ficando um degrau abaixo da fronteira fechada no mesmo índice. Connect não acrescentou nenhuma evidência nova de que essa lacuna esteja se fechando.

A screenshot of the top of the Artificial Analysis Intelligence Index leaderboard (captured September 6, 2026) sorted by intelligence, showing Claude Fable 5.1 (max with fallback) leading at index 57, GPT-6 Astra (max) at 55, GPT-6 Astra (xhigh) and Claude Opus 5 (max) at 54, Muse Spark 1.3 (max) at 53 and Muse Spark 1.3 (xhigh) at 52 in the same leading closed-model group, and the open-weight leaders a step below — Kimi K3 (max) at 50 and GLM-5.3 (max) at 49 — each row showing context window, creator, index value, cost per task and speed.

Esse também é o contexto para como agir em relação ao teaser enquanto ele ainda é apenas um teaser. Um modelo não lançado e uma promessa sem data não são algo em torno do qual construir um caminho de produção — mas a atual linha Muse Spark pode ser chamada hoje, e uma camada de roteamento é a maneira de menor comprometimento de testá-la contra a concorrência. O Muse Spark 1.2 está no OrcaRouter ao preço de tabela do provedor — US$ 1,25 por milhão de tokens de entrada e US$ 4,25 por milhão de tokens de saída, repassados com 0% de markup — então a tarifa do nosso lado é a própria tarifa da Meta, vigente no mesmo dia em que a Meta a altera. Muse Spark 1.3, Muse Glimmer, Muse Voice Transcribe, Muse Image e Muse Video não estão listados no OrcaRouter até o momento desta redação, então este artigo não afirma o contrário. O failover automático é o padrão seguro para exatamente esta situação: aponte um caminho de teste para o checkpoint mais recente, mantenha um fallback comprovado no mesmo endpoint e deixe o roteador trocar para o modelo confiável se o novo travar. Quando — e se — os pesos abertos realmente chegarem, a atitude honesta é avaliá-los no seu próprio hardware antes de se comprometer; até lá, uma única API que consegue alcançar todo o cenário atual é mais barata do que apostar numa data que a Meta não forneceu.

A screenshot of the OrcaRouter model page for Muse Spark 1.2 (meta/muse-spark-1.2, captured September 6, 2026) showing the model id, by Meta released 2026-08-05, text/image/video/file/audio input with text output, Vision/Audio/Tools/JSON/Reasoning capability chips, a p50 time-to-first-token of 6.33 seconds, the $1.25 input and $4.25 output per-1M-token pricing, and the description of Muse Spark 1.2 as Meta's reasoning model for complex agentic tasks and the current checkpoint of the Muse Spark family served on the same Standard tier at identical pricing.

O que assistir em seguida

Com a janela do Connect fechada, quatro eventos fariam isto passar de provocação para decisão, em ordem aproximada de quão cedo cada um poderia acontecer:

• Um repositório no Hugging Face para os pesos abertos do Muse Spark 1.2 — a promessa de 10 de agosto cumprida; verifique as organizações de modelos da Meta no Hub em vez de esperar por um anúncio.

• Uma licença e especificação de hardware para esses pesos, que a Meta ainda não publicou; a licença determina se "peso aberto" significa liberdade no estilo Apache ou uma licença comunitária no estilo Llama.

• Uma declaração oficial que nomeia Watermelon, confirma que é o modelo 🍉 e estabelece sua linhagem e distribuição — até então, o codinome é inferência, não fato.

• Uma primeira avaliação independente da capacidade relatada do Watermelon ou dos pesos do Muse Spark 1.2, assim que existirem; nada no teaser é verificado de forma independente hoje.

A janela de outubro noticiada é agora o próximo marco datado, e a teleconferência de resultados do terceiro trimestre da Meta, no final de outubro, dá a ela um palco natural — com a ressalva de que o mesmo raciocínio dizia que o Connect produziria algo, e não produziu. Fique de olho primeiro no Hub: pesos abertos são anunciados com datas muito menos confiáveis do que são anunciados, e, neste caso, a promessa tem quarenta e cinco dias e nada no registro para comprová-la.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente