
Muse Agent 출시: Meta의 소비자용 AI 에이전트, Muse Spark 1.3에서 구동
- openaiNEWOpenAI: GPT-6 Astra2026-09-0455지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0247지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0247지능72코딩
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0157지능82코딩
- AlibabaNEWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiNEWZ.ai: GLM 5.3 Flash2026-08-2646지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1849지능75코딩
- obsidianQwen3.8 27B2026-08-1541지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1251지능77코딩
- metaMeta: Muse Spark 1.22026-08-0547지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0347지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2140지능69코딩
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128지능49코딩
Meta가 연내 내내 예고해 왔던 소비자용 AI 에이전트인 Muse Agent를 2026년 9월 8일 미국에서 공식 출시했다. 이 에이전트는 자체 신규 iOS 및 Android 앱 안에서 단순히 "Muse"라는 이름으로 브랜딩되었다. Muse Agent는 메타가 정확히 일주일 전 개발자 API에 올린 것과 동일한 체크포인트인 Muse Spark 1.3으로 구동되며, 그 계보가 진짜 핵심이다. Muse Agent는 출시 노트가 장기 지평 에이전트 작업에 대해 작성된 모델의 제품화된 형태다. 메타는 이 에이전트가 자체 컴퓨터, 즉 파일 시스템과 터미널을 갖춘 클라우드 가상 머신 위에서 실행되므로 웹을 탐색하고, 자체 코드를 작성하고, 작은 도구를 만들고, 앱이 닫힌 후에도 작업을 계속 수행할 수 있다고 설명한다.
이것은 또 하나의 챗봇 껍데기가 아니다. 뮤즈(Muse)는 개인 사용자의 이메일, 캘린더, 결제, 쇼핑 계정에 연결해 그 계정에서 이메일 전송, 여행 예약, 물건 구매, 협상, 양식 작성 등의 작업을 직접 수행한다. 메타는 보안 테스트에서 실제 결함이 발견된 뒤 제품을 강화하기 위해 내부적으로 잡았던 4월 출시 목표를 의도적으로 연기했다고 밝혔다. 이번 출시는 미국에서만 이뤄지며 18세 이상 계정만 대상으로 하고 지역 제한(geo-gated)도 적용된다. 지출 능력을 가진 에이전트의 첫 버전을 여전히 통제할 수 있는 피해 범위(blast radius) 안에 두려는 회사의 면모가 드러나는 대목이다. 다음에서는 뮤즈 에이전트가 실제로 하는 일, 그 기반이 되는 뮤즈 스파크 1.3(Muse Spark 1.3) 엔진, AI에게 지갑을 쥐어주는 것을 정당화하기 위해 메타가 구축한 보안 아키텍처, 그리고 자체 에이전트를 만드는 개발자에게 가격 정책이 시사하는 바를 다룬다.
핵심 구상: 자신만의 컴퓨터를 가진 에이전트
Meta의 제품 디자인 포스트는 이를 명확히 밝히고 있다. Muse는 자체 컴퓨터를 갖고 있으며, 파일 시스템과 터미널을 통해 코드를 작성하고 도구를 구축할 수 있다. 또한 사이트 탐색, 양식 작성, 거래 완료를 위한 전체 브라우저도 갖추고 있다. 이는 마케팅적 수사가 아니라 구조적 선언이다. Muse는 맥락에서 답을 내놓는 대규모 언어 모델이 아니라, 기계를 작동시키는 모델이다. 마치 Muse Code가 개발자의 기계를 작동시키는 것과 같다. 1년간의 훈련 계획을 세우거나 소규모 사업을 설립하는 것 같은 장기 목표는 에이전트가 시간에 걸쳐 실행하는 행동 계획으로 분해되며, 일정에 따라 또는 이벤트에 반응하여 실행된다. 그리고 진정으로 새로운 정보가 있거나 결정이 필요할 때만 사용자에게 알린다.
상호작용 모델도 기존 어시스턴트 채팅과는 다르다. 며칠에 걸쳐 맥락을 유지하는 길고 중단 가능한 하나의 메인 대화, 개별 작업을 위한 별도의 사이드 채팅, 사용자가 읽고 편집할 수 있는 영구 메모리 파일, 그리고 채팅 밖에서도 존재할 수 있는 '아티팩트'(문서, PDF, 웹 페이지, 대시보드, 장보기 목록)로 구성된다. 사용자는 에이전트의 이름을 정하고 아바타와 커뮤니케이션 스타일을 지정할 수 있는데, 출시 보도에서는 이를 사람들이 에이전트와 유대감을 형성하는 핵심 이유로 꼽는다. 통합 측면에서 Meta는 출시 시점에 Google Workspace(Gmail, Calendar, Drive), Ticketmaster, OpenTable, Spotify, Apple Health를 지원하며, Shopify의 Shop Pay와 1Password도 계획하고 있다. 또한 기본 제공 통합이 없는 서비스를 위해 사용자가 직접 생성할 수 있는 맞춤형 API 커넥터도 지원한다.

엔진: Muse Spark 1.3, 개발자 출시까지 일주일 남음
아래는 메타가 9월 2일 Muse Code와 Meta Model API를 통해 공개한 Muse Spark 1.3이다. 이는 4월 이후 Muse Spark 계열의 네 번째 체크포인트로, 메타 자체 수치에 따르면 코딩 및 에이전틱 작업에서 이 계열이 이룬 가장 큰 진전이다. 비슷한 작업에서 Muse Spark 1.2보다 도구 호출이 약 20% 적고 토큰이 약 25% 적게 소모된다. 하나의 에이전틱 작업이 수천 번의 호출로 이어질 수 있음을 고려하면 중요한 효율성이다. 표준 등급 가격은 입력 토큰 100만 개당 1.25달러, 출력 토큰 100만 개당 4.25달러로 Muse Spark 1.2 수준에 정확히 맞춰졌으며, 메타의 모델 훈련에 자신의 트래픽 사용을 허용한 사용자에게는 $0.10/$0.20 Contributor 등급이 제공된다. 컨텍스트 윈도우는 100만 토큰으로 유지된다.
독립적인 검증 결과가 서서히 모습을 드러내고 있다. 각 모델을 자체 에이전트 하네스와 함께 평가하는 Artificial Analysis Coding Agent Index에서, Muse Code 하네스로 실행된 Muse Spark 1.3은 최상위 "max" 추론 설정에서 68점을 기록해 Claude Code의 Claude Opus 5(xhigh)에 이어 두 번째로 높은 점수를 받았고, Claude Fable 5(max)보다는 앞섰다. 한편 출시되는 xhigh 구성은 64점을 기록했다. 이 결과에 대한 범위상 유의점은, 이 지표가 소비자용 Muse Agent 제품이 아니라 모델이 자체 코딩 에이전트를 구동하는 방식을 측정한 것이며, Meta는 소비자용 에이전트가 어떤 추론 구성을 사용하는지 밝히지 않았다는 점이다. Meta가 자체 발표한 수치 — Terminal-Bench 2.1 88.8, DeepSWE v1.1 max 기준 75.4, OSWorld 2.0 max 기준 66.9 — 는 이 글을 쓰는 시점까지 여전히 공급업체가 보고한 값이며, 독립적으로 재현된 바 없다.

소비자와 개발자 스레드가 여기서 연결됩니다. Meta가 월 구독으로 판매하는 에이전트는 개발자가 입력 토큰 100만 개당 1.25달러에 호출할 수 있는 모델의 제품 형태이며, Meta 자체 Muse Code 하네스에서 가장 강력한 코딩 결과를 낸 바로 그 모델이기도 합니다. Muse Agent는 Meta가 자사의 프런티어 모델을 제3자가 API 위에 동일한 제품을 구축할 시간을 갖기 전에 최종 사용자에게 직접 제공하는 것입니다. 이는 정확히 슈퍼인텔리전스 랩이 방어하기 위해 만들어진 지위입니다.
보안 아키텍처가 곧 제품입니다.
사람들이 AI에 이메일, 캘린더, 결제 수단에 대한 접근 권한을 주는 것을 주저하는 이유는 메타가 지연을 겪으며 집중한 바로 그 부분입니다. 각 Muse 인스턴스는 전용 Muse Secure VM — 에이전트와 사용자 데이터를 공개 인터넷으로부터 격리하는 클라우드 가상 머신 — 에서 실행됩니다. Sentinel이라는 별도의 시스템 수준 에이전트가 외부로 나가는 유일한 통로입니다. 외부 세계와의 모든 상호작용은 이 에이전트를 거쳐야 하며, 이 에이전트가 정책을 보유하고 Muse 자신도 이를 재정의할 수 없습니다. 이메일 보내기, 돈 지출 같은 민감한 작업은 사용자가 수락하거나 거부하는 승인 카드로 표시되며, VM은 사용자의 통제 아래 활동 로그를 유지합니다.
자격 증명 및 결제 설계도 동일한 원칙을 따릅니다. 비밀번호는 에이전트가 읽을 수 없는 안전한 자격 증명 저장소에 보관되며, 결제는 Stripe의 Link 인프라를 통해 실행됩니다. 이 인프라는 사용자의 실제 카드가 아닌 거래당 일회용 카드 번호를 에이전트에게 제공합니다. 메타는 대화 데이터를 광고 시스템과 공유하지 않으며 사용자가 학습용 사용을 거부할 수 있다고 밝혔습니다. 주목해야 할 로드맵 항목은 Signal 창립자 믹시 말린스파이크와 함께 개발 중인 계획된 Muse Confidential VM으로, 이 경우 메타가 아닌 사용자가 암호화 키를 보유하므로 메타조차 VM을 열 수 없습니다. 이는 대중 시장용 소비자 에이전트로서는 최초가 될 것이며, 오늘 출시되는 기능은 아닙니다.
가격: 일반 사용자는 구독, 개발자는 토큰
Muse의 소비자 요금제는 사용량 기반 과금이 아닌 3단계 구독제입니다. 무료 티어는 매주 초기화되는 약 1억 토큰의 주간 할당량을 제공하며, Meta는 대부분의 사용자가 무료 티어에 머물러야 한다고 말합니다. 또한 작업이 유료 범위에 들어가기 전에 사용량 측정기를 보여주지만, 무료 이용에도 결제 카드를 등록해야 하는 점은 여러 리뷰어가 불편하다고 지적했습니다. 유료 티어는 월 20달러와 월 100달러이며, 출시 보도에서 Power 및 Maximum으로 불립니다. 이는 무료 할당량을 초과하는 사용자나 지속적인 고성능 컴퓨팅 워크로드를 원하는 사용자를 위한 것입니다.
만약 원하는 것이 Meta의 것을 임대하는 대신 이러한 동작을 가진 에이전트를 직접 구축하는 것이라면, 주목할 숫자는 토큰당 비용이며, 이 모델의 경제성은 이례적으로 명확합니다. Muse Spark 1.3은 Meta Model API를 통해 모든 개발자가 이용할 수 있으며, 입력 토큰 100만 개당 1.25달러, 출력 토큰 100만 개당 4.25달러입니다. 추론 토큰은 출력으로 과금되고, 캐시 입력은 100만 개당 0.15달러입니다. 25% 더 적은 토큰을 사용한다는 주장이 주목할 부분입니다. 공시 가격이 그대로인 상황에서 그 주장이 비용의 전부이기 때문입니다. 라우팅 및 장애 조치에 관한 OrcaRouter의 입장은 모든 Muse Spark 1.3 관련 글에서 밝혀온 바로 그 입장입니다. 이 글을 쓰는 시점인 9월 9일 현재 새 체크포인트는 아직 디렉터리에 없으며, 우리는 제공할 수 없는 것은 등재하지 않습니다. 그 전임자는 곧 Meta의 정확한 공시 가격으로 OrcaRouter에서 서비스 중인 Muse Spark 1.2입니다. 마크업 없이 입력 토큰 100만 개당 1.25달러, 출력 토큰 100만 개당 4.25달러이므로, 위의 '가격 유지' 주장은 실제 페이지에서 확인할 수 있습니다. 우리는 제공업체 공시 가격에 마진을 추가하지 않고 그대로 전달하기 때문에, 라우팅 제공업체가 Muse Spark 1.3을 서비스하기 시작하는 날에는 바로 그날 이곳에 Meta 가격으로 표시되며, 프로덕션 에이전트 워크로드에는 제공업체 간 자동 장애 조치가 적용됩니다.

볼 것
가장 중요한 미해결 질문은 벤치마크 시트에 없다. 첫째, {{1}}소비자 제품의 추론 구성과 안전 경계가 실제 환경에서도 유지되는지 여부다. 4월 연기는 실제 보안 테스트 실패로 인해 촉발된 것으로 알려졌으며, 돈을 쓸 수 있는 에이전트는 코드를 작성할 수 있는 에이전트와는 다른 기준으로 평가된다{{/1}}. 둘째, {{2}}1억 토큰 무료 허용량은 에이전트 경제학에 대한 선언이다. Meta가 그 범위 안에서 진정으로 유용한 개인 에이전트를 대규모로 운영할 수 있다면, 구독 가격 책정은 에이전트 역량이 어떻게 판매되는지에 대한 진지한 해답이 되고, $1.25/$4.25 API 요금은 동일한 것을 구축하는 다른 모든 업체에게 최저 기준선처럼 보이기 시작한다{{/2}}. 셋째, {{3}}Confidential VM, Muse Spark 제품군에 대해 약속된 오픈 가중치 출시, 그리고 향후 몇 주에 걸쳐 Instagram, Facebook, Meta AI 앱에 기본 모델이 배포되는 것이다{{/3}}. Muse Agent는 그 일정의 시작일 뿐, 끝이 아니다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
