Une carte de titre affichant Meta Muse, avec le sous-titre Toute la famille, et celui que vous voulez, au-dessus d'une rangée de six libellés : Muse Spark, Muse Image, Muse Video, Muse Glimmer, Muse Code et Muse Voice Transcribe.
Guides & Insights

Meta Muse : chaque modèle de la famille d’agents personnels de Meta, et celui que vous voulez vraiment

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Meta Muse ne désigne pas une chose unique. Selon le lien que quelqu'un vous a envoyé, il s'agit de l'agent grand public que Meta a mis en circulation aux États-Unis le 8 septembre 2026 — ou de l'un des modèles qui le sous-tendent : Muse Spark, le modèle de raisonnement nativement multimodal qui effectue la réflexion proprement dite ; Muse Image et Muse Video, les générateurs de médias que Meta a présentés en avant-première le 7 juillet 2026 ; Muse Glimmer, le modèle à poids ouverts de 30 milliards de paramètres sous Apache 2.0 ; Muse Code, l'agent de codage en terminal ; Muse Voice Transcribe, le modèle de transcription de la parole en texte ; et Muse Realtime Avatar, la couche d'incarnation que Meta a présentée à Connect 2026 le 23 septembre. Deux de ces noms désignent aussi des choses qui ne sont pas des modèles du tout : Muse Connectors est une surface produit, et Muse Realtime Voice est la couche conversationnelle à l'intérieur de l'agent.

Cette page existe pour régler cela. Elle n'est pas un article d'actualité sur un événement daté. C'est la page de référence canonique pour une famille de modèles présente dans notre catalogue aujourd'hui — la page qu'un lecteur atteint après avoir recherché le nom même du modèle. Sa justification est la demande de recherche permanente que nous avons mesurée en propre le 29 septembre 2026, et non la fraîcheur d'un lancement. Les repères datables qu'elle contient (8 septembre pour l'agent, 23 septembre pour Connect) sont des faits utilisés pour dater ces produits, et non des événements que cette page rapporte. Nous avons couvert le lancement de l'agent séparément et cette page ne le rapporte pas à nouveau ; si vous voulez cette histoire, la couverture du lancement est l'endroit où aller.

La table de routage en une minute, en prose

Commencez par la question que vous posez réellement, et arrêtez-vous à la ligne qui y répond.

• Si vous voulez le produit grand public — un agent personnel qui lit vos e-mails, réserve des choses, tourne en arrière-plan et demande la permission avant de dépenser de l'argent —, c'est Meta Muse, l'agent, et son interface est l'application Muse ou le web sur muse.ai. La publication d'annonce de Meta indique une disponibilité aux États-Unis sur iOS, Android et muse.ai, et le décrit comme gratuit « pour la plupart de ce dont les gens ont besoin », avec des formules d'abonnement au-dessus. Ce positionnement est celui de Meta lui-même, publié sur la propre page de Meta, et c'est le seul endroit où un niveau gratuit est affirmé ; rien sur les limites de débit ou les crédits alloués n'est publié.

• Si vous voulez le modèle qui répond aux questions et écrit du code — celui que vous appelleriez depuis une API — c'est Muse Spark, et l'identifiant actuel est muse-spark-1.3. La propre page de modèle de Meta documente une fenêtre de contexte d'1 million de tokens à 1,25 $ par million de tokens d'entrée, 0,15 $ par million de tokens d'entrée mis en cache, et 4,25 $ par million de tokens de sortie, avec un niveau contributeur moins cher à 0,10 $ / 0,002 $ / 0,20 $ qui intègre votre trafic à l'amélioration du produit.

• Si vous souhaitez générer ou modifier une image fixe — c'est-à-dire Muse Image, un modèle d'image agentique que Meta propose à 0,01 $ par image sur sa propre page de modèle. Ce n'est pas un modèle qui prend du texte en entrée et produit du texte en sortie ; il prend un prompt et des images de référence et renvoie des images.

• Si vous voulez de la vidéo générée — c'est-à-dire Muse Video, et c'est le seul membre de la famille dont presque tout est encore non annoncé. Meta en a fait la présentation le 7 juillet 2026, et n'a depuis publié ni date de sortie, ni tarif, ni durée de clip, ni résolution, ni régions. Tout ce qui cite un jour de lancement précis ou un prix pour Meta Muse Video sans une annonce Meta plus récente relève de la spéculation, nous y compris.

• Si vous souhaitez transcrire de l'audio — c'est-à-dire Muse Voice Transcribe, facturé par Meta à 0,18 $ de l'heure (3,00 $ pour 1 000 minutes) sur sa page de modèle, avec attribution des locuteurs. Ce n'est pas un modèle à entrée texte ; il consomme de l'audio et produit du texte.

• Si vous souhaitez exécuter un agent sur votre propre matériel sans aucun appel API — c'est Muse Glimmer, 30 milliards de paramètres, Apache 2.0, suffisamment petit pour un seul GPU grand public ou un Mac, et distribué par Meta sous forme de poids téléchargeables plutôt que via un point de terminaison.

• Si vous voulez un agent dans votre terminal ou votre CI — c'est Muse Code, une CLI qui pilote Muse Spark, installée avec un script shell d'une seule ligne, et Meta documente désormais à la fois un installateur macOS/Linux et un installateur Windows PowerShell.

• Si vous voulez un visage et une voix à l'autre bout d'une conversation — c'est Muse Realtime Avatar, annoncé le 23 septembre 2026 en même temps que l'article de recherche de Meta intitulé « Donner vie à votre Muse ».

A single-column scoreboard titled Meta Muse - the family scoreboard, listing Muse Spark at $1.25 and $4.25 per million tokens, Muse Image at $0.01 per image, Muse Voice Transcribe at $0.18 per hour, Muse Glimmer at 30B under Apache 2.0 with open weights, Muse Code as a terminal agent for macOS, Linux and Windows, and Muse Video with no date and no price announced, footnoted to Meta's own model pages read September 29, 2026.

Ce que dit la chronologie de Meta elle-même

Il est plus facile de garder la famille en tête sous forme de séquence que de liste, car Meta l’a publiée à un rythme régulier tout au long de 2026. Ces dates proviennent de l’index du blog de recherche de Meta, que nous lisons directement plutôt que de passer par le résumé qu’en fait qui que ce soit :

• 8 avril 2026 — « Présentation de Muse Spark : évoluer vers une superintelligence personnelle », le premier modèle Muse issu de Meta Superintelligence Labs.

• 7 juillet 2026 — Muse Image et Muse Video annoncés ensemble. Image est disponible ; Video ne l'est pas.

• 9 juillet 2026 — Muse Spark 1.1.

• 5 août 2026 — Muse Code et Muse Spark 1.2 le même jour.

• 10 août 2026 — Muse Glimmer, la version à poids ouverts.

• 1er septembre 2026 — Muse Voice Transcribe.

• 2 septembre 2026 — Muse Spark 1.3.

• 8 septembre 2026 — l’agent Muse lui-même, ainsi que l’article d’accompagnement de Meta « Comment nous avons intégré la sécurité à Muse »

• 23 septembre 2026 — « Donner vie à votre muse », l'œuvre d'avatar en temps réel, publiée le jour d'ouverture de Connect.

Une correction à apporter ici, car cette famille est exceptionnellement facile à confondre sur les dates et l'une des dates largement diffusées est erronée. La publication récapitulative de Connect de Meta est datée du 24 septembre 2026 et commence par « Hier à Connect 2026 ». Elle indique que Meta amène Muse sur ses lunettes d'IA « dans les prochains mois ». L'accès aux lunettes a été annoncé le 23 septembre ; il n'est pas encore commercialisé, et la page de Meta elle-même ne le décrit pas comme disponible. Si vous avez lu que Muse était arrivé sur les lunettes d'IA le 23 septembre, il s'agit d'une annonce relayée comme une disponibilité, et c'est la page de Meta qui fait foi.

A capture of Meta's research blog index listing the Muse release chronology in reverse order: Muse Spark 1.3 on September 2, 2026, Bringing Your Muse to Life on September 23, How We Built Safety Into Muse on September 8, Muse Voice Transcribe on September 1, Muse Glimmer on August 10, Muse Code and Muse Spark 1.2 on August 5, Muse Spark 1.1 on July 9, Muse Image and Muse Video on July 7, and Muse Spark on April 8.

La surface développeur, et pourquoi elle compte plus que l’application

La partie de cette famille qui devrait intéresser un développeur n'est pas l'agent. C'est Meta Model API, car c'est la première fois que Meta expose un modèle Muse par le biais d'une interface qui ressemble à quelque chose que vous possédez déjà. Le guide de démarrage rapide de Meta le dit sans détour : Model API « est compatible clé en main avec le SDK OpenAI, le SDK Anthropic et les CLI d'agents compatibles OpenAI, si bien que la plupart des piles fonctionnent avec un simple changement d'URL de base et de clé ». L'URL de base est https://api.meta.ai/v1 et l'identifiant du modèle pour le Spark actuel est muse-spark-1.3.

Que cette compatibilité soit réelle en pratique est une question distincte de celle de savoir si elle est vraie sur le papier, et nous ne l’avons pas testée. Ce qui est vérifiable aujourd’hui, c’est que Meta documente trois voies de protocole plutôt qu’une seule — une API Responses, une API Chat Completions et une API Messages — ce qui constitue un signal plus fort qu’un simple point de terminaison « compatible OpenAI » ne l’est habituellement, car cela signifie que la voie au format Anthropic a été conçue délibérément plutôt qu’ajoutée après coup.

Les modalités sont l'endroit à lire attentivement. Les modalités d’entrée documentées de Muse Spark par Meta sont le texte, l’image, le PDF et la vidéo, avec une sortie texte. Il s’agit d’un modèle nativement multimodal avec utilisation d’outils, et non d’un modèle texte accompagné d’un point de terminaison d’image. Si vous avez besoin d’une sortie qui n’est pas du texte, Spark n’est pas le membre de la famille qu’il vous faut — c’est précisément pour cette raison que Muse Image et Muse Voice Transcribe existent en tant que modèles distincts avec des tarifs distincts.

C'est aussi ici que le routage justifie sa place. Une famille aussi large signifie que le modèle à privilégier dépend de la requête, et l'écart de coût entre les membres est considérable : 0,01 $ par image et 0,18 $ par heure d'audio relèvent d'une enveloppe budgétaire totalement différente de 1,25 $ par million de tokens. Placer plusieurs d'entre eux derrière un point de terminaison unique, avec basculement en cas de dégradation d'un fournisseur et une règle de routage qui sélectionne le modèle selon le type de requête, constitue un problème d'ingénierie plus modeste que de connecter séparément le SDK de chaque fournisseur — et comme un routeur en mode pass-through facture au prix catalogue du fournisseur, un changement de tarif de Meta s'applique le jour même plutôt qu'à la prochaine renégociation de contrat.

Muse Glimmer est celui que vous lancez vous-même

Glimmer mérite d'être distingué du reste, car il inverse le modèle de distribution. Meta le qualifie de « modèle ouvert conçu pour des agents locaux toujours actifs », avec 30 milliards de paramètres sous Apache 2.0, et on l'obtient en téléchargeant les poids plutôt qu'en appelant un point de terminaison. La position de Meta elle-même est qu'il est suffisamment petit pour tenir sur un seul GPU grand public ou un Mac, et elle désigne l'appel d'outils, l'état persistant à travers les redémarrages et la mémoire auto-gérée sur de longues sessions comme objectifs de conception.

Meta publie un tableau comparatif sur la page modèle de Glimmer face à Gemma4-31B et Qwen3.6-27B en mode réflexion. Il s'agit d'une comparaison sélectionnée par le fournisseur sur des benchmarks choisis par le fournisseur, et il faut la lire comme telle — Glimmer arrive en tête sur la plupart des lignes agentiques que Meta a choisi de faire figurer, et est en retrait sur GPQA Diamond et Humanity's Last Exam. Nous ne reproduisons pas ici les chiffres individuels, car ils appartiennent à un modèle que nous ne servons pas ; si vous choisissez un modèle local, lisez directement les chiffres sur la page modèle de Meta et sa fiche de modèle publiée, puis lancez votre propre tâche sur ce modèle. Notez également qu'une version antérieure de notre propre couverture décrivait Muse Code comme étant uniquement pour macOS et Linux. La documentation actuelle de Meta mentionne aussi un installateur Windows PowerShell, donc cette affirmation est obsolète et la page de Meta fait foi.

L’architecture de sécurité, en un paragraphe

La conception de sécurité de Muse est l'ingénierie la plus substantielle que Meta ait publiée à propos de cette famille, et il vaut la peine d'en connaître les grandes lignes avant de décider quel niveau d'accès accorder à un agent personnel. L'agent s'exécute dans Muse Secure VM — une VM Linux dédiée par utilisateur, avec le harnais agentique dans un conteneur systemd-nspawn dont le root est mappé à un utilisateur hôte non privilégié, de sorte que le root du conteneur n'est pas le root de l'hôte. Les identifiants n'atteignent jamais l'agent : ils résident dans un stockage détenu par hatch-authd, qui émet des jetons de substitution, et un agent Sentinel distinct est la seule autorité de permission pour les actions des connecteurs et pour toutes les sorties réseau. Sentinel évalue une requête aux niveaux L4 et L7, effectue une substitution d'identifiants juste-à-temps à la frontière réseau et utilise un suivi des flux de données au niveau du noyau (que Meta appelle « tainted egress » — implémenté avec eBPF) afin qu'un processus ayant lu vos données ne puisse pas emprunter un chemin d'autorisation automatique. Les classificateurs de sécurité s'exécutent en dehors de la cellule d'exécution, précisément pour qu'un attaquant ne puisse pas les désactiver depuis l'intérieur de celle-ci. Les propres chiffres de Meta pour le programme de primes constituent le repère utile : jusqu'à 300 000 $ pour des rapports valides, y compris jusqu'à 130 000 $ pour une injection de prompt qui touche un seul utilisateur. C'est une entreprise qui publie un prix sur le mode de défaillance de son propre produit, ce qui n'est pas la norme. L'article complet se trouve à research.meta.ai/blog/security-and-safety-for-ai-agents-our-approach-with-muse et il vaut la peine d'y consacrer vingt minutes.

Ce que Meta n'a pas publié

Une page de référence qui ne fait que répéter du marketing n’est pas une page de référence. Voici l’état honnête des lacunes :

• Benchmarks monolithiques. Aucun numéro d'indice publié unique ne classe cette famille face aux pairs de pointe sur les propres pages de Meta. La page de Muse Spark 1.3 affiche un petit tableau comparant GDPval-AA v2, JobBench et une colonne partielle à Muse Spark 1.2, GPT 5.6 Sol et Opus 5, et les valeurs sont mesurées par Meta selon des paramètres d'effort choisis par Meta. Il s'agit d'une ablation interne, et non d'une comparaison directe, et elle ne s'étend pas à l'agent, Image, Video, Glimmer ou Voice Transcribe.

• Tout face-à-face à effort et harnais identiques. Deux de ces modèles n’ont été comparés l’un à l’autre nulle part où nous avons pu le vérifier, dans un sens comme dans l’autre, sur le même banc d’évaluation. Lorsqu’un chiffre existe, il est déclaré par le fournisseur et nous le précisons dans la phrase qui le contient.

• L'intégralité de la structure commerciale de Muse Video. Aucune date, aucun prix, aucun plafond ni aucune région, comme indiqué ci-dessus.

• Limites de débit et structures de crédits. La page de documentation de Meta sur la tarification et les limites de débit ne renvoie depuis ici qu'une coquille vide, sans aucun chiffre lisible — un document de 107 8xx octets qui ne contient aucune valeur en dollars —, donc tout chiffre concernant les plafonds de Meta serait inventé. La seule exception concerne les prix à l'unité cités ci-dessus, que nous avons relevés aujourd'hui sur les pages de modèles individuels de Meta.

• Tout ce qui concerne ce que dit ai.meta.com/muse/. Cette URL renvoie un code 200 avec un titre de confirmation et aucun corps que nous puissions extraire, donc nous ne caractériserons pas son contenu.

Qu'est-ce qui est réellement appelable, et où

C'est la partie où les affirmations de disponibilité deviennent obsolètes le plus rapidement, c'est pourquoi elle est formulée de manière restrictive et provient d'une vérification en direct plutôt que d'un article connexe. En date du 2026-09-29, le catalogue OrcaRouter propose exactement deux routes Muse, vérifiées individuellement par rapport à l'API publique des modèles :

• Meta : Muse Spark 1.2 — contexte de 1 048 576 jetons, 1,25 $ par million de jetons d'entrée, 0,15 $ par million de jetons d'entrée mis en cache, 4,25 $ par million de jetons de sortie, date de publication annoncée : 2026-08-05.

• Meta : Muse Spark 1.1 — même contexte de 1 048 576 jetons et le même tarif de 1,25 $ / 0,15 $ / 4,25 $, date de sortie indiquée : 2026-07-16.

Ces deux tarifs sont identiques au tarif que Meta publie pour muse-spark-1.3 sur sa propre page de modèle, ce à quoi ressemble une répercussion sans marge : vous payez le prix catalogue de Meta, et nous n'y ajoutons rien. Muse Spark 1.2 est disponible sur OrcaRouter au prix catalogue exact de Meta et c'est celui vers lequel vous tourner si vous portez une charge de travail Spark existante.

Rien d’autre dans la famille ne figure dans notre catalogue, et cette absence mérite qu’on soit direct : Muse Spark 1.3, Muse Image, Muse Video, Muse Glimmer, Muse Code et Muse Voice Transcribe renvoient tous un « not-found » depuis l’API publique des modèles aujourd’hui. Si vous voulez l’identifiant 1.3 ou le prix d’image à $0.01, c’est le point de terminaison de Meta, pas le nôtre. Une affirmation pleine d’assurance mais erronée sur la disponibilité est pire que pas d’affirmation du tout, donc c’est tout ce que contient ce paragraphe.

A capture of the OrcaRouter model page for meta/muse-spark-1.2, showing the input modalities text, image, video, file and audio with text output, the pricing row of $1.25 per million input tokens and $4.25 per million output tokens, a p50 time-to-first-token of 10.00 seconds, and a listed release date of 2026-08-05.

Comment penser la famille en une seule passe

Trois distinctions font l’essentiel du travail. Premièrement, le produit par opposition au modèle : Meta Muse est un agent grand public avec une interface utilisateur et un système de permissions, et ce n’est pas quelque chose que l’on appelle depuis du code — ce qui est appelable en dessous, c’est Muse Spark. Deuxièmement, le point de terminaison par opposition au téléchargement : tous les membres, sauf Muse Glimmer, sont accessibles via Meta Model API ou un client construit dessus, et Glimmer est accessible en téléchargeant les poids. Troisièmement, ce qui est livré par opposition à ce qui est annoncé : Image, Voice Transcribe, Spark et l’agent sont en cours de déploiement ; Video et l’accès aux lunettes ne le sont pas, et une fausse date circule pour les deux.

Si vous décidez ce qu’il faut développer ce trimestre, l’interprétation pratique est que Muse Spark est le seul membre de la famille à disposer d’un prix publié, d’une fenêtre de contexte publiée, d’une API documentée et d’un chemin de basculement peu coûteux — ce qui en fait le point d’entrée à faible risque et fait de tout le reste une chose à surveiller plutôt qu’une chose sur laquelle planifier. Si vous décidez quoi lire, l’article sur la sécurité est le document de la plus grande valeur que Meta ait publié sur la famille, car c’est celui qui vous dit ce qui se passe lorsque l’agent se trompe.