
Muse Agent wystartował: konsumencki agent AI Meta działa na Muse Spark 1.3
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0455Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0247Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0247Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0157Inteligencja82Kod
- AlibabaNOWOŚĆQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiNOWOŚĆZ.ai: GLM 5.3 Flash2026-08-2646Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1849Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1541Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1251Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0547Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0347Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2140Inteligencja69Kod
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Inteligencja49Kod
Meta uruchomiła Muse Agent — konsumenckiego agenta AI, którego zapowiadała przez cały rok, oznaczonego po prostu jako „Muse” w swoich nowych aplikacjach na iOS i Androida — w Stanach Zjednoczonych 8 września 2026 roku. Napędza go Muse Spark 1.3, ten sam checkpoint, który Meta udostępniła na swoim API deweloperskim dokładnie tydzień wcześniej, i ten rodowód to sedno sprawy: Muse Agent to produktyzowana forma modelu, którego notatki o wydaniu opisywały długookresową pracę agentową. Meta opisuje agenta jako działającego na własnym komputerze — chmurowej maszynie wirtualnej z systemem plików i terminalem — dzięki czemu może przeglądać internet, pisać własny kod, tworzyć małe narzędzia i kontynuować pracę nad zadaniami po zamknięciu aplikacji.
To nie jest kolejna nakładka na czatbota. {{1}}Muse łączy się z kontami e-mail, kalendarzem, płatnościami i zakupami danej osoby i na nich działa: wysyła e-maile, rezerwuje podróże, kupuje rzeczy, negocjuje, wypełnia formularze.{{/1}} {{2}}Meta twierdzi, że celowo opóźniła produkt względem wewnętrznego terminu kwietniowego, aby go wzmocnić po tym, jak testy bezpieczeństwa wykryły rzeczywiste wady,{{/2}} a premiera jest ograniczona wyłącznie do USA, dla kont użytkowników w wieku 18 lat i więcej, oraz geograficznie zablokowana — {{3}}profil firmy trzymającej pierwszą wersję agenta z możliwością wydawania pieniędzy w promieniu rażenia, który wciąż może kontrolować.{{/3}} {{4}}Poniższy tekst omawia, co właściwie robi Muse Agent,{{/4}} {{5}}silnik Muse Spark 1.3, który go napędza,{{/5}} {{6}}architekturę bezpieczeństwa, którą Meta zbudowała, aby uzasadnić przyznanie sztucznej inteligencji portfela,{{/6}} i {{7}}co cennik mówi programiście budującemu własnego agenta.{{/7}}
Pomysł: agent z własnym komputerem
Wpis projektowy Meta dotyczący produktu mówi to wprost: Muse ma własny komputer, z systemem plików i terminalem, których może używać do pisania kodu i budowania narzędzi — a także pełną przeglądarkę do nawigowania po stronach, wypełniania formularzy i realizowania transakcji. To stwierdzenie architektoniczne, a nie marketingowy ozdobnik: Muse nie jest dużym modelem językowym odpowiadającym z kontekstu, lecz modelem obsługującym maszynę, tak jak Muse Code obsługuje maszynę programisty. Długoterminowe cele, takie jak zaplanowanie roku treningów czy uruchomienie małej firmy, są rozkładane na plany działań, które agent realizuje w czasie, a on może działać według harmonogramu lub w odpowiedzi na zdarzenia, powiadamiając użytkownika tylko wtedy, gdy coś jest naprawdę nowe lub wymaga decyzji.
Model interakcji to także odejście od czatu asystenta: jedna długa, przerywalna główna rozmowa, która przechowuje kontekst przez wiele dni, osobne czaty poboczne do odrębnych zadań, trwałe pliki pamięci, które użytkownik może czytać i edytować, oraz „artefakty” — dokumenty, pliki PDF, strony internetowe, pulpity nawigacyjne, listy zakupów — które mogą istnieć poza czatem. Użytkownicy mogą nadać agentowi imię, awatar i styl komunikacji, co w relacjach z premiery uznawane jest za kluczowy powód, dla którego ludzie się z nim wiążą. Jeśli chodzi o integracje, Meta wymienia na starcie Google Workspace (Gmail, Calendar, Drive), Ticketmaster, OpenTable, Spotify i Apple Health, z planowanymi Shop Pay od Shopify i 1Password, a także niestandardowe łączniki API, które użytkownicy mogą generować dla usług bez wbudowanej integracji.

Silnik: Muse Spark 1.3 — tydzień do premiery dla deweloperów.
Poniżej znajduje się Muse Spark 1.3, który Meta udostępniła 2 września za pośrednictwem Muse Code i Meta Model API. To czwarty checkpoint w linii Muse Spark od kwietnia i — według danych producenta — największy krok w kodowaniu i pracy agentowej, jaki rodzina dotychczas zrobiła: około 20% mniej wywołań narzędzi i około 25% mniej tokenów niż Muse Spark 1.2 przy porównywalnych zadaniach — rodzaj wydajności, który ma znaczenie, gdy pojedyncze zadanie agentowe może obejmować tysiące wywołań. Cena warstwy standardowej pozostała dokładnie na poziomie Muse Spark 1.2 — 1,25 dolara za milion tokenów wejściowych i 4,25 dolara za milion tokenów wyjściowych — a dla użytkowników, którzy pozwalają Meta trenować na swoim ruchu, dostępny jest poziom Contributor w cenie 0,10/0,20 dolara. Okno kontekstowe pozostaje na poziomie 1 miliona tokenów.
Niezależny obraz zaczyna się wyłaniać. W indeksie Artificial Analysis Coding Agent Index, który przypisuje każdemu modelowi jego natywne środowisko agentowe, Muse Spark 1.3 działający w środowisku Muse Code uzyskuje 68 punktów przy najwyższym ustawieniu rozumowania „max” — ustępując jedynie Claude Opus 5 (xhigh) w Claude Code i wyprzedzając Claude Fable 5 (max) — podczas gdy dostarczana konfiguracja xhigh uzyskuje 64 punkty. Uwaga co do zakresu tego wyniku: dotyczy on modelu sterującego własnym agentem programistycznym, a nie konsumenckiego produktu Muse Agent; Meta nie ujawniła też, z jakim ustawieniem rozumowania działa agent konsumencki. Własne liczby Meta z premiery — Terminal-Bench 2.1: 88,8; DeepSWE v1.1: 75,4 (przy max); OSWorld 2.0: 66,9 (przy max) — pozostają w chwili pisania tego tekstu danymi raportowanymi przez producenta, których nikt niezależnie nie odtworzył.

Tutaj łączą się wątki konsumencki i deweloperski. Agent, którego Meta sprzedaje w ramach miesięcznej subskrypcji, to produktowa wersja modelu, który deweloper może wywołać za 1,25 dolara za milion tokenów wejściowych — i ten sam model osiągnął najlepsze wyniki w kodowaniu we własnym środowisku testowym Meta, Muse Code. Muse Agent to udostępnienie przez Meta jej modelu granicznego bezpośrednio użytkownikowi końcowemu, zanim podmioty trzecie zdążą zbudować ten sam produkt na bazie API — co jest dokładnie pozycją, której obronie stworzono Superintelligence Labs.
Architektura bezpieczeństwa jest produktem.
Powód, dla którego ktokolwiek waha się przed przyznaniem AI dostępu do poczty, kalendarzy i metody płatności, to dokładnie to, na czym Meta spędziła czas swojego opóźnienia. Każda instancja Muse działa w dedykowanej maszynie wirtualnej Muse Secure VM — chmurowej maszynie wirtualnej, która izoluje agenta i dane użytkownika od otwartego internetu. Osobny agent systemowy o nazwie Sentinel jest jedyną ścieżką wyjścia: każda interakcja ze światem zewnętrznym przechodzi przez niego, to on przechowuje politykę i nie może zostać nadpisany przez samo Muse. W przypadku wrażliwych działań — wysłania wiadomości e-mail, wydania pieniędzy — wyświetlane są karty zatwierdzeń, które człowiek akceptuje lub odrzuca, a maszyna wirtualna prowadzi dziennik aktywności pod kontrolą użytkownika.
Projekt uwierzytelniania i płatności opiera się na tej samej zasadzie. Hasła przechowywane są w bezpiecznym magazynie poświadczeń, do którego agent nie ma dostępu, a zakupy realizowane są przez infrastrukturę Stripe Link, która zamiast prawdziwej karty użytkownika przekazuje agentowi jednorazowy numer karty dla każdej transakcji. Meta twierdzi, że dane rozmów nie są udostępniane jej systemom reklamowym, a użytkownicy mogą zrezygnować z wykorzystywania ich do trenowania modeli. Na mapie drogowej warto zwrócić uwagę na planowaną poufną maszynę wirtualną Muse, opracowaną z twórcą Signala, Moxie Marlinspike, w której to użytkownik — nie Meta — posiada klucze kryptograficzne, co oznacza, że nawet Meta nie mogłaby otworzyć tej maszyny wirtualnej. Byłoby to pierwsze takie rozwiązanie wśród konsumenckich agentów na masową skalę, ale nie jest ono jeszcze dostępne.
Cennik: subskrypcje dla ludzi, tokeny dla deweloperów
Konsumenckie ceny Muse to trzywarstwowa subskrypcja, a nie rozliczenie za użycie. Darmowy poziom działa w oparciu o około 100-milionowy tygodniowy limit tokenów z cotygodniowym resetem; Meta twierdzi, że większość ludzi powinna pozostać na darmowym poziomie, i pokazuje licznik zużycia, zanim działanie przekroczy próg płatny, choć nawet dla darmowego poziomu wymagana jest karta płatnicza — co kilku recenzentów uznało za utrudnienie. Poziomy płatne kosztują 20 USD/miesiąc i 100 USD/miesiąc, nazwane Power i Maximum w relacjach z premiery, dla użytkowników, którzy przekraczają darmowy limit lub chcą ciągłych obciążeń o wysokiej mocy obliczeniowej.
Jeśli chcesz zbudować agenta o takim zachowaniu, zamiast wynajmować takiego od Meta, istotna jest liczba przypadająca na token, a ekonomika modelu jest tu wyjątkowo przejrzysta. Muse Spark 1.3 jest dostępny dla każdego dewelopera za pośrednictwem Meta Model API w cenie 1,25 USD za milion tokenów wejściowych i 4,25 USD za milion tokenów wyjściowych, przy czym tokeny rozumowania są rozliczane jako wyjściowe, a tokeny wejściowe z pamięci podręcznej po 0,15 USD. Twierdzenie o 25% mniejszej liczbie tokenów to aspekt, na który warto uważać, ponieważ przy niezmienionej cenie katalogowej to ono stanowi całą historię kosztów. Co do routingu i failoveru, stanowisko OrcaRouter jest takie, jakie przedstawialiśmy w każdym tekście o Muse Spark 1.3: nowy checkpoint nie jest jeszcze w naszym katalogu według stanu na 9 września — nie umieszczamy na liście modeli, których nie możemy obsługiwać. Jego poprzednik to: Muse Spark 1.2 jest dostępny na OrcaRouter po dokładnej cenie katalogowej Meta, czyli 1,25 USD za milion tokenów wejściowych i 4,25 USD za milion tokenów wyjściowych, bez narzutu, więc powyższe twierdzenie o „utrzymanej cenie” można sprawdzić na prawdziwej stronie. Ponieważ przekazujemy dalej ceny katalogowe dostawców bez doliczania marży, w dniu, w którym dostawca routowany zacznie obsługiwać Muse Spark 1.3, pojawi się on tutaj w cenie Meta tego samego dnia, z automatycznym przełączaniem awaryjnym między dostawcami dla produkcyjnych obciążeń agentowych.

Co obejrzeć
Najważniejsze otwarte pytania nie znajdują się na arkuszu benchmarków. Po pierwsze, czy konfiguracja rozumowania i granice bezpieczeństwa produktu konsumenckiego utrzymają się w realnym świecie — kwietniowe opóźnienie podobno było spowodowane rzeczywistymi niepowodzeniami testów bezpieczeństwa, a agent, który może wydawać pieniądze, jest oceniany według innych standardów niż ten, który potrafi pisać kod. Po drugie, darmowy przydział 100 milionów tokenów to deklaracja dotycząca ekonomiki agentów: jeśli Meta będzie w stanie uruchomić naprawdę użytecznego osobistego agenta w ramach tego limitu na dużą skalę, cennik subskrypcyjny staje się poważną odpowiedzią na to, jak sprzedaje się możliwości agentów, a stawka API w wysokości 1,25/4,25 dolara zaczyna wyglądać jak minimum dla wszystkich innych budujących to samo. Po trzecie, Confidential VM, obiecane wydanie otwartych wag dla rodziny Muse Spark oraz wdrożenie bazowego modelu do aplikacji Instagram, Facebook i Meta AI w nadchodzących tygodniach. Muse Agent to pierwszy dzień tej sekwencji, a nie jej koniec.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
