Karta tytułowa z napisem Meta Muse, z podtytułem Cała rodzina, i którą chcesz, nad rzędem sześciu etykiet: Muse Spark, Muse Image, Muse Video, Muse Glimmer, Muse Code i Muse Voice Transcribe.
Guides & Insights

Meta Muse: każdy model z rodziny osobistych agentów Meta i który z nich tak naprawdę chcesz

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Nie istnieje jedna rzecz o nazwie Meta Muse. W zależności od tego, który link ktoś ci wysłał, oznacza ona agenta konsumenckiego, którego Meta wprowadziła do obiegu w USA 8 września 2026 r. — albo jeden z modeli pod nim: Muse Spark, natywnie multimodalny model rozumowania, który wykonuje właściwe myślenie; Muse Image i Muse Video, generatory mediów, które Meta zaprezentowała 7 lipca 2026 r.; Muse Glimmer, model o otwartych wagach i 30 miliardach parametrów na licencji Apache 2.0; Muse Code, terminalowy agent kodujący; Muse Voice Transcribe, model zamiany mowy na tekst; oraz Muse Realtime Avatar, warstwa ucieleśnienia, którą Meta pokazała na Connect 2026 23 września. Dwie z tych nazw to także rzeczy, które wcale nie są modelami: Muse Connectors to powierzchnia produktu, a Muse Realtime Voice to warstwa konwersacyjna wewnątrz agenta.

Ta strona istnieje, aby to wyjaśnić. To nie jest artykuł informacyjny o wydarzeniu z określoną datą. Jest to kanoniczna strona referencyjna dla rodziny modeli, która jest dziś dostępna w naszym katalogu — strona, do której czytelnik trafia po wyszukaniu nazwy samego modelu. Jej uzasadnieniem jest stały popyt w wyszukiwaniu, który zmierzyliśmy na podstawie danych własnych w dniu 2026-09-29, a nie świeżość premiery. Dające się datować punkty odniesienia w niej (8 września w przypadku agenta, 23 września w przypadku Connect) to fakty służące do datowania tych produktów, a nie wydarzenia, które ta strona relacjonuje. Premierę agenta omówiliśmy osobno i ta strona jej nie powtarza; jeśli chcesz tę historię, relacja z premiery jest właściwym miejscem.

Minutowa tablica routingu, prozą

Zacznij od pytania, które faktycznie zadajesz, i zatrzymaj się na wierszu, który na nie odpowiada.

• Jeśli chcesz produktu konsumenckiego — osobistego agenta, który czyta twoją pocztę e-mail, rezerwuje różne rzeczy, działa w tle i pyta o pozwolenie, zanim wyda pieniądze — to jest nim Meta Muse, agent, a jego interfejsem jest aplikacja Muse lub strona internetowa muse.ai. W poście ogłaszającym premierę Meta podaje dostępność w USA na iOS, Androidzie i muse.ai oraz opisuje go jako darmowego „dla większości tego, czego ludzie potrzebują”, a powyżej tego dostępne są plany subskrypcyjne. To sformułowanie pochodzi od samej Meta, zostało opublikowane na jej własnej stronie i tylko tam pojawia się wzmianka o darmowym planie; nic na temat limitów czy przyznawanych środków nie zostało opublikowane.

• Jeśli chcesz model, który odpowiada na pytania i pisze kod — ten, do którego wywoływałbyś się z API — to jest Muse Spark, a jego obecny identyfikator to muse-spark-1.3. Własna strona modelu Meta dokumentuje okno kontekstowe 1 mln tokenów przy $1,25 za milion tokenów wejściowych, $0,15 za milion buforowanych tokenów wejściowych i $4,25 za milion tokenów wyjściowych, z tańszym progiem dla współtwórców wynoszącym $0,10 / $0,002 / $0,20, który włącza Twój ruch do ulepszania produktu.

• Jeśli chcesz wygenerować lub edytować obraz statyczny — to jest Muse Image, agentowy model obrazów, który Meta wycenia na 0,01 USD za obraz na własnej stronie modelu. Nie jest to model typu tekst-wejście, tekst-wyjście; przyjmuje prompt oraz obrazy referencyjne i zwraca obrazy.

• Jeśli chcesz wygenerowane wideo — czyli Muse Video, to jedyny członek tej rodziny, w przypadku którego prawie wszystko wciąż pozostaje nieogłoszone. Meta zaprezentowała go 7 lipca 2026 r. i od tego czasu nie opublikowała żadnej daty premiery, ceny, długości klipu, rozdzielczości ani regionów. Wszelkie informacje podające konkretny dzień premiery lub cenę Meta Muse Video bez nowszego ogłoszenia Meta to spekulacje — i dotyczy to również nas.

• Jeśli chcesz transkrybować dźwięk — to jest Muse Voice Transcribe, wyceniany przez Meta na 0,18 USD za godzinę (3,00 USD za 1000 minut) na jej stronie modelu, z przypisaniem mówcy. To nie jest model przyjmujący tekst na wejściu; konsumuje dźwięk i emituje tekst.

• Jeśli chcesz uruchomić agenta na własnym sprzęcie, bez żadnego wywołania API — to jest Muse Glimmer, 30 miliardów parametrów, Apache 2.0, wystarczająco mały dla pojedynczego konsumenckiego GPU lub Maca, i dystrybuowany przez Meta jako wagi do pobrania, a nie przez endpoint.

• Jeśli chcesz agenta w swoim terminalu lub w CI — to jest Muse Code, narzędzie CLI, które obsługuje Muse Spark, instalowane za pomocą jednolinijkowego skryptu powłoki, a Meta dokumentuje teraz zarówno instalator dla macOS/Linux, jak i instalator dla Windows PowerShell.

• Jeśli chcesz widzieć twarz i słyszeć głos po drugiej stronie rozmowy — to jest Muse Realtime Avatar, ogłoszony 23 września 2026 r. wraz z wpisem badawczym Meta zatytułowanym „Bringing Your Muse to Life”.

A single-column scoreboard titled Meta Muse - the family scoreboard, listing Muse Spark at $1.25 and $4.25 per million tokens, Muse Image at $0.01 per image, Muse Voice Transcribe at $0.18 per hour, Muse Glimmer at 30B under Apache 2.0 with open weights, Muse Code as a terminal agent for macOS, Linux and Windows, and Muse Video with no date and no price announced, footnoted to Meta's own model pages read September 29, 2026.

Co mówi własna chronologia Meta

Tę rodzinę łatwiej jest pomieścić w głowie jako sekwencję niż jako listę, ponieważ Meta wypuszczała ją w stałym rytmie przez cały 2026 rok. Te daty pochodzą z indeksu bloga badawczego Meta, który czytamy bezpośrednio, a nie z czyjegokolwiek podsumowania:

• 8 kwietnia 2026 — „Przedstawiamy Muse Spark: skalowanie w kierunku osobistej superinteligencji” — pierwszy model Muse z Meta Superintelligence Labs.

• 7 lipca 2026 — Muse Image i Muse Video ogłoszono razem. Image zostało wydane; Video nie.

• 9 lipca 2026 — Muse Spark 1.1.

• 5 sierpnia 2026 — Muse Code i Muse Spark 1.2 tego samego dnia.

• 10 sierpnia 2026 — Muse Glimmer, wydanie z otwartymi wagami.

• 1 września 2026 — Muse Voice Transcribe.

• 2 września 2026 — Muse Spark 1.3.

• 8 września 2026 — sam agent Muse, a także towarzyszący wpis Meta „Jak wbudowaliśmy bezpieczeństwo w Muse”.

• 23 września 2026 — „Ożywianie swojej muzy”, praca nad awatarem w czasie rzeczywistym, opublikowana w dniu otwarcia Connect.

Jedna poprawka tutaj, ponieważ tę rodzinę wyjątkowo łatwo pomylić w datach, a jedna z szeroko powielanych dat jest błędna. Wpis podsumowujący Meta z Connect ma datę 24 września 2026 r. i zaczyna się od „Wczoraj na Connect 2026”. Mówi, że Meta wprowadza Muse do swoich okularów AI „w nadchodzących miesiącach”. Dostęp do okularów ogłoszono 23 września; nie jest to jeszcze w sprzedaży, a własna strona Meta nie opisuje tego jako dostępnego. Jeśli przeczytałeś, że Muse pojawiło się w okularach AI 23 września, to jest to ogłoszenie podawane jako dostępność, a rację ma strona Meta.

A capture of Meta's research blog index listing the Muse release chronology in reverse order: Muse Spark 1.3 on September 2, 2026, Bringing Your Muse to Life on September 23, How We Built Safety Into Muse on September 8, Muse Voice Transcribe on September 1, Muse Glimmer on August 10, Muse Code and Muse Spark 1.2 on August 5, Muse Spark 1.1 on July 9, Muse Image and Muse Video on July 7, and Muse Spark on April 8.

Powierzchnia deweloperska — i dlaczego ma większe znaczenie niż aplikacja

Część tej rodziny, na której twórca powinien się skupić, to nie agent. To Meta Model API, ponieważ Meta po raz pierwszy udostępniła model Muse przez interfejs, który wygląda jak coś, co już posiadasz. Sam quickstart Meta mówi to wprost: Model API „jest kompatybilne w trybie drop-in z OpenAI SDK, Anthropic SDK oraz zgodnymi z OpenAI interfejsami CLI agentów, więc większość stosów działa po zmianie bazowego adresu URL i klucza”. Bazowy adres URL to https://api.meta.ai/v1, a identyfikator modelu dla obecnego Spark to muse-spark-1.3.

To, czy ta zgodność jest rzeczywista w praktyce, to odrębne pytanie od tego, czy jest prawdziwa na papierze, a my tego nie uruchamialiśmy. To, co da się dziś zweryfikować, to fakt, że Meta dokumentuje trzy ścieżki protokołu, a nie jedną — Responses API, Chat Completions API i Messages API — co jest silniejszym sygnałem, niż zwykle jest pojedynczy punkt końcowy „OpenAI-compatible”, ponieważ oznacza, że ścieżka w formacie Anthropic została zbudowana celowo, a nie doklejona.

Modalności to miejsce, w którym trzeba czytać uważnie. Udokumentowane przez Meta modalności wejściowe Muse Spark to tekst, obraz, PDF i wideo, z wyjściem tekstowym. To natywnie multimodalny model z obsługą narzędzi, a nie model tekstowy z endpointem do obrazów obok. Jeśli potrzebujesz danych wyjściowych innych niż tekst, Spark nie jest tym członkiem rodziny, którego szukasz — właśnie dlatego Muse Image i Muse Voice Transcribe istnieją jako osobne modele z osobnymi cenami.

To także tutaj routing zasługuje na swoje miejsce. Tak szeroka rodzina modeli oznacza, że model, którego potrzebujesz, zależy od żądania, a różnica kosztów między jej członkami jest duża: 0,01 USD za obraz i 0,18 USD za godzinę audio mieszczą się w zupełnie innej kopercie budżetowej niż 1,25 USD za milion tokenów. Umieszczenie kilku z nich za jednym punktem końcowym, z failoverem, gdy dostawca zaczyna działać gorzej, oraz regułą routingu, która wybiera model według typu żądania, jest mniejszym problemem inżynieryjnym niż osobne podłączanie SDK każdego dostawcy — a ponieważ router typu pass-through rozlicza według cennika katalogowego dostawcy, zmiana ceny Meta obowiązuje tego samego dnia, a nie dopiero przy kolejnym odnowieniu umowy.

Muse Glimmer to ten, który uruchamiasz sam

Glimmer warto wyróżnić spośród pozostałych, ponieważ odwraca model dystrybucji. Meta nazywa go „otwartym modelem stworzonym dla stale działających lokalnych agentów”, mającym 30 miliardów parametrów na licencji Apache 2.0, a otrzymuje się go poprzez pobranie wag, a nie przez wywołanie endpointu. Samo stanowisko Meta jest takie, że jest wystarczająco mały dla pojedynczego konsumenckiego GPU lub Maca, a jako cele projektowe wskazuje wywoływanie narzędzi, trwały stan między restartami oraz samodzielnie zarządzaną pamięć w długich sesjach.

Meta publikuje tabelę porównawczą na stronie modelu Glimmer z Gemma4-31B i Qwen3.6-27B w trybie myślenia. To porównanie wybrane przez dostawcę na wybranych przez dostawcę benchmarkach i tak należy je odczytywać — Glimmer prowadzi w większości wierszy agentowych, które Meta zdecydowała się zamieścić, a pozostaje w tyle w GPQA Diamond i Humanity's Last Exam. Nie powtarzamy tu poszczególnych liczb, ponieważ należą do modelu, którego nie udostępniamy; jeśli wybierasz model lokalny, odczytaj liczby bezpośrednio ze strony modelu Meta i jej opublikowanej karty modelu oraz uruchom na nim własne zadanie. Zauważ też, że wcześniejsza wersja naszego własnego materiału opisywała Muse Code jako dostępny tylko dla macOS i Linux. Aktualna dokumentacja Meta wymienia również instalator Windows PowerShell, więc to twierdzenie jest nieaktualne, a strona Meta ma pierwszeństwo.

Architektura bezpieczeństwa, w jednym akapicie

Projekt bezpieczeństwa Muse to najbardziej merytoryczne opracowanie inżynieryjne, jakie Meta opublikowała na temat tej rodziny, i warto znać go w zarysie, zanim zdecydujesz, ile dostępu przyznać osobistemu agentowi. Agent działa wewnątrz Muse Secure VM — dedykowanej maszyny wirtualnej z Linuksem dla każdego użytkownika, przy czym harness agentowy znajduje się w kontenerze systemd-nspawn, którego root jest mapowany na nieuprzywilejowanego użytkownika hosta, więc root kontenera nie jest rootem hosta. Dane uwierzytelniające nigdy nie trafiają do agenta: znajdują się w magazynie należącym do hatch-authd, który tworzy tokeny zastępcze, a osobny agent Sentinel jest wyłącznym organem uprawnień do działań konektorów i całego ruchu wychodzącego sieci. Sentinel ocenia żądanie zarówno na warstwie L4, jak i L7, dokonuje podmiany danych uwierzytelniających w trybie just-in-time na granicy sieci i używa śledzenia przepływu danych na poziomie jądra (Meta nazywa to „skażonym ruchem wychodzącym”, zaimplementowanym za pomocą eBPF), dzięki czemu proces, który odczytał Twoje dane, nie może skorzystać ze ścieżki automatycznego zezwolenia. Klasyfikatory bezpieczeństwa działają poza komórką wykonawczą właśnie po to, aby atakujący nie mógł ich wyłączyć od środka. Liczby podane przez samą Meta dla programu bug bounty są użyteczną kalibracją: do 300 000 USD za ważne zgłoszenia, w tym do 130 000 USD za iniekcję promptu, która dotyczy pojedynczego użytkownika. To firma, która publikuje cenę za tryb awarii własnego produktu, co nie jest normą. Pełny opis znajduje się pod adresem research.meta.ai/blog/security-and-safety-for-ai-agents-our-approach-with-muse i warto poświęcić mu dwadzieścia minut.

Czego Meta nie opublikowała

Strona referencyjna, która tylko powtarza marketing, nie jest stroną referencyjną. Oto uczciwy stan luk:

• Monolityczne benchmarki. Nie istnieje pojedynczy opublikowany wskaźnik liczbowy, który klasyfikowałby tę rodzinę względem czołowych konkurentów na własnych stronach Meta. Strona Muse Spark 1.3 zamieszcza niewielką tabelę porównującą GDPval-AA v2, JobBench oraz jedną częściową kolumnę z Muse Spark 1.2, GPT 5.6 Sol i Opus 5, a wartości są mierzone przez Meta przy wybranych przez Meta ustawieniach wysiłku. To wewnętrzna ablacja, a nie bezpośrednie porównanie, i nie obejmuje agenta, Image, Video, Glimmer ani Voice Transcribe.

• Jakiekolwiek bezpośrednie porównanie przy dopasowanym nakładzie i środowisku testowym. Dwa z tych modeli nie zostały porównane ze sobą w żadnym miejscu, które moglibyśmy zweryfikować, w żadnym kierunku, na tym samym stanowisku ewaluacyjnym. Tam, gdzie jakaś liczba istnieje, pochodzi ona od dostawcy, co zaznaczamy w zdaniu, w którym się pojawia.

• Muse Video w całym swoim komercyjnym kształcie. Brak daty, ceny, limitu lub regionu, jak omówiono powyżej.

• Limity szybkości i struktury kredytowe. Strona dokumentacji Meta dotycząca cen i limitów szybkości zwraca z tego miejsca jedynie powłokę bez czytelnych liczb — dokument o rozmiarze 107,8xx bajtów, w którym nie ma żadnych wartości w dolarach — więc każda liczba dotycząca limitów Meta byłaby wymyślona. Jedynym wyjątkiem są ceny za jednostkę przytoczone powyżej, które odczytaliśmy dziś na poszczególnych stronach modeli Meta.

• Cokolwiek na temat tego, co mówi ai.meta.com/muse/. Ten URL zwraca 200 z potwierdzającym tytułem i brakiem treści, którą możemy wyodrębnić, więc nie będziemy charakteryzować jego zawartości.

Co można faktycznie wywołać i gdzie

To jest część, w której twierdzenia o dostępności starzeją się najszybciej, więc jest to ujęte wąsko i na podstawie sprawdzenia na żywo, a nie z pokrewnego artykułu. Na dzień 2026-09-29 katalog OrcaRouter obsługuje dokładnie dwie trasy Muse, zweryfikowane indywidualnie względem publicznego API modelu:

• Meta: Muse Spark 1.2 — kontekst 1 048 576 tokenów, 1,25 USD za milion tokenów wejściowych, 0,15 USD za milion tokenów wejściowych z pamięci podręcznej, 4,25 USD za milion tokenów wyjściowych, podana data wydania 2026-08-05.

• Meta: Muse Spark 1.1 — ten sam kontekst 1 048 576 tokenów i ta sama stawka 1,25 / 0,15 / 4,25 USD, podana data wydania: 2026-07-16.

Te dwie ceny są takie same jak stawka, którą Meta publikuje dla muse-spark-1.3 na swojej własnej stronie modelu, co obrazuje przekazanie bez marży: płacisz cenę katalogową Meta, a my nic do niej nie dodajemy. Muse Spark 1.2 jest dostępny w OrcaRouter w dokładnie cenie katalogowej Meta i to po niego warto sięgnąć, jeśli przenosisz istniejące obciążenie Spark.

Nic więcej z tej rodziny nie znajduje się w naszym katalogu i warto powiedzieć o tym bez ogródek: Muse Spark 1.3, Muse Image, Muse Video, Muse Glimmer, Muse Code i Muse Voice Transcribe zwracają dziś z publicznego API modeli odpowiedź „not found”. Jeśli chcesz identyfikator 1.3 albo cenę obrazu $0.01, to jest własny endpoint Meta, a nie nasz. Pewne siebie, błędne twierdzenie o dostępności jest gorsze niż brak twierdzenia, więc to cały akapit.

A capture of the OrcaRouter model page for meta/muse-spark-1.2, showing the input modalities text, image, video, file and audio with text output, the pricing row of $1.25 per million input tokens and $4.25 per million output tokens, a p50 time-to-first-token of 10.00 seconds, and a listed release date of 2026-08-05.

Jak myśleć o rodzinie w jednym przebiegu

Trzy rozgraniczenia wykonują większość pracy. Po pierwsze, produkt kontra model: Meta Muse to agent konsumencki z interfejsem użytkownika i systemem uprawnień, i nie jest to coś, co wywołuje się z kodu — tym, co można wywołać pod spodem, jest Muse Spark. Po drugie, endpoint kontra pobieranie: do każdego członka oprócz Muse Glimmer można dotrzeć przez Meta Model API lub klienta na nim zbudowanego, a do Glimmer — przez pobranie wag. Po trzecie, wydane kontra zapowiedziane: Image, Voice Transcribe, Spark i agent są już dostępne; Video i dostęp przez okulary nie są, a oba zyskały fałszywą datę w obiegu.

Jeśli zastanawiasz się, co budować w tym kwartale, praktyczny wniosek jest taki, że Muse Spark to jedyny członek rodziny z opublikowaną ceną, opublikowanym oknem kontekstowym, udokumentowanym API i tanią ścieżką awaryjną — co czyni go punktem wejścia o niskim ryzyku i sprawia, że wszystko inne to rzecz do obserwowania, a nie rzecz, wokół której należy planować. Jeśli zastanawiasz się, co czytać, wpis o bezpieczeństwie jest najcenniejszym dokumentem, jaki Meta opublikowała na temat tej rodziny, ponieważ to on mówi ci, co się dzieje, gdy agent się myli.