Ett titelkort där det står Meta Muse, med undertexten Hela familjen, och vilken du vill ha, ovanför en rad med sex etiketter: Muse Spark, Muse Image, Muse Video, Muse Glimmer, Muse Code och Muse Voice Transcribe.
Guides & Insights

Meta Muse: Varje modell i Metas familj av personliga agenter – och vilken du faktiskt vill ha

Författare

Elias Hawthorne

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Det finns ingen enskild sak som kallas Meta Muse. Beroende på vilken länk någon skickade till dig, syftar det på den konsumentagent som Meta släppte ut i omlopp den 8 september – eller på en av modellerna under den, Muse Sparkden inbyggt multimodala resonemangsmodellen som gör själva tänkandet; Muse Image och Muse Video, mediegeneratorerna som Meta förhandsvisade den 7 juli 2026; Muse Glimmer, den öppna viktmodellen med 30 miljarder parametrar under Apache 2.0; Muse Code, terminalkodningsagenten; Muse Voice Transcribe, tal-till-text-modellen; Muse Realtime Avatar, förkroppsligandelagret som Meta visade på Connect 2026 den 23 september. Två av dessa namn är också saker som inte alls är modeller: Muse Connectors är en produktyta, och Muse Realtime Voice är det konversationslager som finns inuti agenten.

Den här sidan finns för att reda ut det. Den är inte en nyhetsartikel om en daterad händelse. Det är den kanoniska referenssidan för en modellfamilj som finns i vår katalog i dag – sidan en läsare når efter att ha sökt på modellens eget namn. Dess berättigande är bestående sökefterfrågan som vi mätte i förstapartsdata den 29 september 2026, inte hur färsk en lansering är. De daterbara hållpunkterna i den (8 september för agenten, 23 september för Connect) är fakta som används för att datera dessa produkter, inte händelser som den här sidan rapporterar om. Vi bevakade agentlanseringen separat och den här sidan rapporterar inte om den igen; vill du ha den historien är lanseringsbevakningen stället att gå till.

Enminutsroutningstabellen, i prosa

Börja med frågan du faktiskt ställer, och sluta vid raden som besvarar den.

• Om du vill ha konsumentprodukten – en personlig agent som läser din e-post, bokar saker, körs i bakgrunden och ber om tillåtelse innan den spenderar pengar – är det Meta Muse, agenten, och dess gränssnitt är Muse-appen eller webben på muse.ai. Metas tillkännagivandeinlägg listar tillgänglighet i USA på iOS, Android och muse.ai och beskriver den som gratis "för det mesta av vad folk behöver", med prenumerationsplaner ovanpå det. Den beskrivningen är Metas egen, publicerad på Metas egen sida, och det är den enda platsen där en gratisnivå påstås; ingenting om hastighetsbegränsningar eller kreditutrymmen publiceras.

• Om du vill ha modellen som svarar på frågor och skriver kod – den du skulle anropa från ett API – är det Muse Spark, och den nuvarande identifieraren är muse-spark-1.3. Metas egen modellsida dokumenterar ett kontextfönster på 1 M token till $1,25 per miljon indatatoken, $0,15 per miljon cachade indatatoken och $4,25 per miljon utdatatoken, med en billigare nivå för bidragsgivare på $0,10 / $0,002 / $0,20 som gör att din trafik används för produktförbättring.

• Om du vill generera eller redigera en stillbild – det vill säga Muse Image, en agentisk bildmodell som Meta prissätter till 0,01 USD per bild på sin egen modellsida. Det är inte en modell för text in, text ut; den tar en prompt och referensbilder och returnerar bilder.

Om du har genererat video – det vill säga Muse Video, och detta är den enda medlemmen i familjen där nästan allt fortfarande är oannonserat. Meta förhandsvisade videon den 7 juli 2026, och har sedan dess inte publicerat något releasedatum, ingen prissättning, ingen klipplängd, ingen upplösning och inga regioner. Allt som anger en specifik lanseringsdag eller ett pris för Meta Muse Video utan ett nyare tillkännagivande från Meta är spekulation, och det inkluderar oss.

• Om du vill transkribera ljud — det är Muse Voice Transcribe, prissatt av Meta till $0.18 per timme ($3.00 per 1 000 minuter) på Metas modellsida, med talarattribution. Det är inte en modell där text matas in; den tar emot ljud och avger text.

• Om du vill köra en agent på din egen hårdvara helt utan API-anrop – det är Muse Glimmer, 30 miljarder parametrar, Apache 2.0, litet nog för en enda konsument-GPU eller en Mac, och distribueras av Meta som vikter snarare än via en endpoint.

• Om du vill ha en agent i din terminal eller ditt CI — det är Muse Code, ett CLI som driver Muse Spark, installerat med ett enradigt shell-skript, och Meta dokumenterar nu både ett macOS/Linux-installationsprogram och ett Windows PowerShell-installationsprogram.

• Om du vill ha ett ansikte och en röst i andra änden av ett samtal – det är Muse Realtime Avatar, som tillkännagavs den 23 september 2026 tillsammans med Metas forskningsinlägg med titeln "Att väcka din Muse till liv."

A single-column scoreboard titled Meta Muse - the family scoreboard, listing Muse Spark at $1.25 and $4.25 per million tokens, Muse Image at $0.01 per image, Muse Voice Transcribe at $0.18 per hour, Muse Glimmer at 30B under Apache 2.0 with open weights, Muse Code as a terminal agent for macOS, Linux and Windows, and Muse Video with no date and no price announced, footnoted to Meta's own model pages read September 29, 2026.

Vad Metas egen kronologi säger

Familjen är lättare att hålla i huvudet som en sekvens än som en lista, eftersom Meta har släppt den i en jämn takt genom 2026. Dessa datum kommer från Metas forskningsbloggsindex, som vi läser direkt i stället för från någons sammanfattning av det:

• 8 april 2026 — "Introduktion av Muse Spark: Skalning mot personlig superintelligens", den första Muse-modellen från Meta Superintelligence Labs.

• 7 juli 2026 — Muse Image och Muse Video tillkännagavs tillsammans. Image släpptes; Video gjorde det inte.

• 9 juli 2026 — Muse Spark 1.1.

• 5 augusti 2026 — Muse Code och Muse Spark 1.2 samma dag.

• 10 augusti 2026 — Muse Glimmer, släppet med öppna vikter.

• 1 september 2026 — Muse Voice Transcribe.

• 2 september 2026 — Muse Spark 1.3.

• 8 september 2026 — själva Muse-agenten, samt Metas kompletterande inlägg "Hur vi byggde in säkerhet i Muse."

• 23 september 2026 — "Bringing Your Muse to Life", arbetet med realtidsavatarer, publicerat på Connect:s öppningsdag.

En rättelse behöver göras här, eftersom den här familjen är ovanligt lätt att få fel på när det gäller datum, och ett av de datum som florerar brett är fel. Metas sammanfattningsinlägg från Connect är daterat den 24 september 2026 och inleds med "Yesterday at Connect 2026". Det står att Meta tar Muse till sina AI-glasögon "in the coming months". Tillgång via glasögonen tillkännagavs den 23 september; det har inte börjat levereras, och Metas egen sida beskriver det inte som tillgängligt. Om du har läst att Muse nådde AI-glasögonen den 23 september, så är det ett tillkännagivande som rapporteras som en tillgänglighet, och Metas sida väger tyngst.

A capture of Meta's research blog index listing the Muse release chronology in reverse order: Muse Spark 1.3 on September 2, 2026, Bringing Your Muse to Life on September 23, How We Built Safety Into Muse on September 8, Muse Voice Transcribe on September 1, Muse Glimmer on August 10, Muse Code and Muse Spark 1.2 on August 5, Muse Spark 1.1 on July 9, Muse Image and Muse Video on July 7, and Muse Spark on April 8.

Utvecklarytan, och varför den spelar större roll än appen

Den del av den här familjen som en utvecklare bör bry sig om är inte agenten. Det är Meta Model API, eftersom det är första gången Meta exponerar en Muse-modell via en yta som ser ut som något du redan äger. Metas egen snabbstart säger det rakt ut: Model API "är drop-in-kompatibelt med OpenAI SDK, Anthropic SDK och OpenAI-kompatibla agent-CLI:er, så de flesta stackar fungerar med ett byte av bas-URL och nyckel." Bas-URL:en är https://api.meta.ai/v1 och modell-ID:t för nuvarande Spark är muse-spark-1.3.

Om den kompatibiliteten är verklig i praktiken är en separat fråga från om den är sann på pappret, och vi har inte kört den. Det som går att verifiera i dag är att Meta dokumenterar tre protokollvägar i stället för en — ett Responses API, ett Chat Completions API och ett Messages API — vilket är en starkare signal än vad en enda "OpenAI-kompatibel" slutpunkt vanligtvis är, eftersom det innebär att Anthropic-formatvägen byggdes avsiktligt i stället för att eftermonteras.

Modaliteter är det man ska läsa noga. Metas dokumenterade indatamodaliteter för Muse Spark är text, bild, PDF och video, med textutdata. Det är en nativt multimodal modell med verktygsanvändning, inte en textmodell med en bildslutpunkt bredvid sig. Om du behöver utdata som inte är text är Spark inte den familjemedlem du vill ha – det är hela anledningen till att Muse Image och Muse Voice Transcribe finns som separata modeller med separata priser.

Det är också här som routing förtjänar sin plats. En så bred familj innebär att modellen du vill använda beror på förfrågan, och kostnadsskillnaden mellan medlemmarna är stor: $0.01 per bild och $0.18 per ljudtimme ligger i en helt annan budgetram än $1.25 per miljon tokens. Att sätta flera av dem bakom en enda slutpunkt, med failover när en leverantör försämras och en routningsregel som väljer modell per förfrågningstyp, är ett mindre ingenjörsproblem än att koppla upp varje leverantörs SDK separat — och eftersom en pass-through-router fakturerar leverantörens listpris, slår en prisändring från Meta igenom samma dag i stället för vid nästa kontraktsförnyelse.

Muse Glimmer är den du kör själv

Glimmer är värd att särskilja från resten, eftersom den inverterar distributionsmodellen. Meta kallar den "en öppen modell byggd för ständigt aktiva lokala agenter", med 30 miljarder parametrar under Apache 2.0, och man får den genom att ladda ner vikterna i stället för att anropa en endpoint. Metas egen positionering är att den är tillräckligt liten för en enda konsument-GPU eller en Mac, och man pekar ut verktygsanrop, beständigt tillstånd över omstarter och självhanterat minne över långa sessioner som designmålen.

Meta publicerar en jämförelsetabell på Glimmers modellsida mot Gemma4-31B och Qwen3.6-27B i tänkandeläge. Det är en leverantörsvald jämförelse på leverantörsvalda benchmarks, och den bör läsas som en sådan – Glimmer leder i de flesta av de agentiska rader Meta valde att ta med, och ligger efter på GPQA Diamond och Humanity's Last Exam. Vi upprepar inte de enskilda siffrorna här eftersom de tillhör en modell som vi inte tillhandahåller; om du väljer en lokal modell bör du läsa siffrorna direkt från Metas egen modellsida och dess publicerade modellkort och köra din egen uppgift mot den. Notera också att en tidigare version av vår egen bevakning beskrev Muse Code som endast för macOS och Linux. Metas nuvarande dokumentation listar även en Windows PowerShell-installerare, så det påståendet är inaktuellt och Metas sida har företräde.

Säkerhetsarkitekturen, i ett stycke

Muses säkerhetsdesign är det mest substantiella ingenjörsarbete Meta har publicerat om produktfamiljen, och den är värd att känna till i huvuddrag innan du bestämmer hur mycket åtkomst du ska ge en personlig agent. Agenten körs inuti Muse Secure VM – en dedikerad Linux-VM per användare, med det agentiska ramverket inuti en systemd-nspawn-container vars root mappas till en oprivilegierad värdanvändare, så container-root är inte värd-root. Autentiseringsuppgifter når aldrig agenten: de finns i lagring som ägs av hatch-authd, som utfärdar surrogattoken, och en separat Sentinel-agent är den enda behörighetsinstansen för connector-åtgärder och för all utgående nätverkstrafik. Sentinel utvärderar en begäran på både L4 och L7, utför just-in-time-utbyte av autentiseringsuppgifter vid nätverksgränsen och använder dataflödesspårning på kärnnivå (Meta kallar det "tainted egress" – implementerat med eBPF) så att en process som har läst dina data inte kan utnyttja en automatiskt tillåten väg. Säkerhetsklassificerare körs utanför runtime-cellen just för att en angripare inte ska kunna stänga av dem inifrån den. Metas egna siffror för bounty-programmet är den användbara kalibreringen: upp till 300 000 dollar för giltiga rapporter, inklusive upp till 130 000 dollar för en prompt-injektion som påverkar en enskild användare. Det är ett företag som publicerar ett pris på felmodet hos sin egen produkt, vilket inte är normen. Den fullständiga redogörelsen finns på research.meta.ai/blog/security-and-safety-for-ai-agents-our-approach-with-muse och den är värd tjugo minuter.

Vad Meta inte har publicerat

En referenssida som bara upprepar marknadsföring är inte en referenssida. Här är det ärliga läget för luckorna:

• Monolitiska benchmarks. Det finns inget enskilt publicerat indexnummer som rangordnar den här familjen mot frontier-jämlikar på Metas egna sidor. Muse Spark 1.3:s sida visar en liten tabell som jämför GDPval-AA v2, JobBench och en partiell kolumn mot Muse Spark 1.2, GPT 5.6 Sol och Opus 5, och värdena är Meta-mätta vid Meta-valda effort-inställningar. Det är en intern ablation, inte en direkt jämförelse, och den sträcker sig inte till agenten, Image, Video, Glimmer eller Voice Transcribe.

• Varje direktjämförelse vid matchad ansträngning och testrigg. Två av dessa modeller har inte benchmarkats mot varandra någonstans där vi kunde verifiera det, i någon av riktningarna, på samma utvärderingsrigg. Där en siffra finns är den leverantörsrapporterad, och vi säger det i meningen som innehåller den.

• Muse Videos hela kommersiella utformning. Inget datum, pris, tak eller region, enligt ovan.

• Hastighetsbegränsningar och kreditstrukturer. Metas dokumentationssida för prissättning och hastighetsbegränsningar returnerar ett skal utan läsbara siffror härifrån – ett dokument på 107,8xx byte som inte innehåller några dollarvärden – så alla siffror om Metas gränser skulle vara påhittade. Det enda undantaget är de priser per enhet som anges ovan, som vi läste på Metas enskilda modellsidor i dag.

• Allt om vad ai.meta.com/muse/ säger. Den webbadressen returnerar 200 med en bekräftande titel och ingen brödtext som vi kan extrahera, så vi kommer inte att beskriva dess innehåll.

Vad är faktiskt anropbart, och var

Det här är delen där tillgänglighetspåståenden blir inaktuella snabbast, så det formuleras snävt och utifrån en livekontroll snarare än från en systerartikel. Från och med 2026-09-29 gäller att OrcaRouter-katalogen tillhandahåller exakt två Muse-rutter, verifierade individuellt mot det publika modell-API:et:

• Meta: Muse Spark 1.2 — kontext på 1 048 576 tokens, 1,25 USD per miljon indatatokens, 0,15 USD per miljon cachelagrade indatatokens, 4,25 USD per miljon utdatatokens, angivet releasedatum 2026-08-05.

• Meta: Muse Spark 1.1 — samma kontext på 1 048 576 token och samma taxa på 1,25 $ / 0,15 $ / 4,25 $, angivet releasedatum 2026-07-16.

De två priserna är samma som priset Meta publicerar för muse-spark-1.3 på sin egen modellsida, vilket är hur en vidarebefordran utan påslag ser ut: du betalar Metas listpris, och vi lägger inte till något. Muse Spark 1.2 är live på OrcaRouter till Metas exakta listpris och är den du ska välja om du porterar en befintlig Spark-arbetsbelastning.

Inget annat i familjen finns i vår katalog, och det är värt att vara tydlig med frånvaron: Muse Spark 1.3, Muse Image, Muse Video, Muse Glimmer, Muse Code och Muse Voice Transcribe returnerar alla ett ”not found” från det publika modell-API:et idag. Om du vill ha 1.3-identifieraren eller bildpriset på $0.01, är det Metas egen endpoint, inte vår. Ett självsäkert felaktigt påstående om tillgänglighet är värre än inget påstående, så det är hela stycket.

A capture of the OrcaRouter model page for meta/muse-spark-1.2, showing the input modalities text, image, video, file and audio with text output, the pricing row of $1.25 per million input tokens and $4.25 per million output tokens, a p50 time-to-first-token of 10.00 seconds, and a listed release date of 2026-08-05.

Hur man tänker på familjen i ett svep

Tre separationer gör det mesta av arbetet. För det första, produkt kontra modell: Meta Muse är en konsumentagent med ett användargränssnitt och ett behörighetssystem, och den är inte något man anropar från kod — det anropbara tinget under den är Muse Spark. För det andra, slutpunkt kontra nedladdning: varje medlem utom Muse Glimmer nås via Meta Model API eller en klient byggd på det, och Glimmer nås genom att ladda ner vikter. För det tredje, levererad kontra annonserad: Image, Voice Transcribe, Spark och agenten levereras; Video och glasögonåtkomst gör det inte, och båda har fått ett falskt datum i omlopp.

Om du ska besluta vad du ska bygga det här kvartalet är den praktiska tolkningen att Muse Spark är den enda medlemmen i familjen med ett publicerat pris, ett publicerat kontextfönster, ett dokumenterat API och en billig failover-väg — vilket gör den till den lågrisk-ingångspunkten och gör allt annat till något att hålla ögonen på snarare än något att planera kring. Om du bestämmer vad du ska läsaär säkerhetsinlägget det mest värdefulla dokumentet Meta har publicerat om familjen, eftersom det är det som talar om för dig vad som händer när agenten har fel.