
Muse Code: 누가 만드는가, 비용은 얼마인가, 그리고 어느 버전이 최신인가
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 316 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 196 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
Muse Code는 터미널과 CI를 위한 메타의 코딩 에이전트로, Muse Spark 모델 패밀리를 위해 만들어졌으며, 여기 방문하는 누구에게나 중요한 두 가지 버전은 Muse Spark 1.3 — 2026년 9월 2일자 최신 세대 — 그리고 Muse Spark 1.2, CLI가 별도로 지정하지 않는 한 여전히 선택하는 버전입니다. Muse Code는 네이티브 muse 바이너리로 설치되며, 대화형 또는 헤드리스로 실행되고, 세 가지 방식으로 판매됩니다: $5.00, $15.00, $50.00의 세 가지 월간 요금제와, Meta Model API에서 Standard 티어 기준 백만 입력 토큰당 $1.25, 백만 출력 토큰당 $4.25의 종량제 토큰 청구입니다. 다시 한 세대 전으로, Muse Spark 1.1는 여전히 동일한 티어에서 동일한 요금으로 제공됩니다.
이 글을 뉴스가 아니라 참조 페이지로 읽어라. Muse Code 자체는 보도할 만한 새로운 것이 아니다: Meta는 2026년 8월 5일 베타로 출시했고 2026년 8월 31일 베타를 종료했으며, 이 페이지는 그 날짜들을 모델을 발표하기 위해서가 아니라 시간축에 위치시키기 위해 사용한다. 이 페이지의 근거는 2026년 9월 28일에 우리가 직접 측정한 지속적인 검색 수요다. 여기서 단순 검색어 "muse code"는 최근 28일 동안 4,547회 노출을 기록했고 클릭은 0회였으며, 같은 의도를 상업적으로 표기한 검색어들 — "muse code free", "muse code plan", "muse code plans", "muse code free tier", "muse code 1.3" — 은 또 124회 노출을 기록했고 역시 클릭은 0회였다. 독자들은 네 가지 구체적인 질문을 하고 있다. 이 페이지는 Meta 자체 문서를 바탕으로 이 질문들에 순서대로 답하며, 수치가 독립적인 평가자가 아니라 Meta에서 나온 경우에는 이를 분명히 밝힌다.
실제로 필요한 것이 에이전트의 동작에 대한 리뷰이거나 다른 코딩 하네스와의 일대일 비교라면, 이 페이지는 그런 페이지가 아닙니다. 그런 글들은 이미 이 블로그에 있으며, 여러분의 시간을 들일 가치가 있는 글들은 끝부분에 링크되어 있습니다.
Muse Code란 무엇이며, 누가 만드는가
벤더 정의는 한 문장입니다: "Muse Code는 터미널과 CI를 위한 Meta의 코딩 에이전트이며, Muse Spark를 위해 구축되었습니다." 이것은 라이브러리가 아니고, 채팅 인터페이스도 아니며, 모델도 아닙니다 — 그것은 하네스입니다. 프로젝트 디렉터리 안에서 실행합니다. 이것은 작업을 완료하기 위해 계획을 세우고 파일을 편집하며 명령을 실행하는데, 첫 실행부터 승인과 OS 샌드박스가 활성화됩니다.
Meta는 Muse Code와 Meta Model API를 동일한 기반 모델에 이르는 두 가지 경로로 규정한다. 자체 에이전트나 애플리케이션을 구축할 때는 API를 직접 호출하고, 명령줄이나 파이프라인 안에서 바로 사용할 수 있는 완성형 코딩 에이전트를 원할 때는 Muse Code를 실행한다. 이러한 구분은 가격 책정에서 중요하다. 구독은 하네스를 구매하는 것이고 API 키는 토큰당 별도로 청구되기 때문이다.
설치는 한 줄 설치 프로그램이며, 두 공급업체 표면은 문자열에 대해 완전히 일치하지는 않습니다:
• macOS 및 Linux — curl -fsSL https://dev.meta.ai/install.sh | sh는 문서 페이지에서 사용하고, 동일한 명령의 끝에 | bash를 마케팅 페이지와 두 연구 블로그 게시물 모두에서 사용합니다
• Windows — irm https://dev.meta.ai/install.ps1 | iex, 문서 페이지에만 게시됨
• 확인 — muse --version을 실행한 다음, muse를 프로젝트 디렉터리에서 실행하여 대화형 세션을 시작하세요
• 첫 실행 — 워크스페이스를 신뢰하라는 요청을 받으며(이것이 스킬, 규칙 및 훅을 로드합니다), 브라우저 로그인 또는 API 키를 통해 인증하라는 요청도 받습니다. CI에서는META_API_KEY대신
• 두 가지 방식 — muse는 대화형 터미널 UI용이고, muse exec "<prompt>"는 완료까지 한 번의 비대화형 실행용입니다
• 자신의 프로그램에서 직접 실행하세요 — muse serve는 버전이 지정된 세션 프로토콜을 실행하고, muse schema는 JSON 스키마를 출력하며, npm install @muse-code/sdk 명령은 TypeScript 래퍼를 설치합니다
그 마지막 요점은 대부분의 요약이 놓치는 부분이다. Muse Code는 단지 CLI가 아니다: 세션 프로토콜은 문서화되고 버전이 지정된 인터페이스이며, 변경 로그는 그것이 의도적으로 확장되고 있음을 보여준다 — 세션은 프로토콜을 통해 이름을 바꿀 수 있고, 클라이언트는 각 편집에 대한 구조화된 diff 요약을 읽을 수 있으며, 구동 프로그램은 세션 전체에 적용되는 추론 노력 기본값을 설정할 수 있다.

Muse Code 비용과 무료 티어 질문에 대한 명쾌한 답
무료 티어는 없습니다. 이 점은 단호하게 말할 가치가 있습니다. 왜냐하면 그것은 수요 데이터에서 가장 많이 묻는 단일 상업적 질문이며, 답은 명확하기 때문입니다: Muse Code 제품 페이지, 구독 페이지, 변경 로그 어디에도 무료 요금제, 체험판, 무료 크레딧 할당, 속도 제한이 있는 무상 이용은 없습니다.
그 확인과 관련해 한 가지 주의할 점이 있습니다. Meta의 가격 문서는 "플랫폼 무료 티어 크레딧"이라는 표현을 한 번 사용합니다. 바로 Muse Voice Transcribe 관련 설명에서인데, 여기에는 제로 데이터 보존 전사가 Standard 티어와 동일한 가격으로 책정되며 플랫폼 무료 티어 크레딧이 적용된다고 나와 있습니다. Muse Voice Transcribe는 Meta Model API의 별도 제품으로 자체적인 시간당 청구 방식을 갖고 있습니다. 그 문장은 Muse Code에 대해서는 아무것도 말하지 않습니다. 그 대목이 Muse Code 무료 티어의 증거로 인용된 것을 발견한다면, 그것은 문맥에서 벗어나 읽힌 것입니다.
Meta가 공개하는 것은 세 가지 구독 등급으로, 모두 월별로 청구되며, 플랜의 프롬프트 허용량을 초과하는 모든 항목에 대한 종량제 토큰 청구가 추가됩니다:
• 일상 사용 — 월 $5.00; 최신 Muse 모델 이용 가능; 5시간마다 10–50개 프롬프트(이미지 및 동영상 업로드 포함); 음성 모드; 웹 검색
• 높은 사용량 — 월 $15.00; Everyday 플랜의 모든 기능; Everyday보다 5배 많은 사용량; 더 많은 프롬프트; 더 많은 멀티모달 입력
• Power Usage — 월 $50.00; High Usage 플랜의 모든 기능; Everyday 사용 허용량의 20배; 확장된 프롬프트; 신규 기능 조기 액세스; 더 높은 파일 업로드 한도
• 표준 토큰 요율 — 백만 입력 토큰당 $1.25, 백만 출력 토큰당 $4.25, 백만 캐시 입력 토큰당 $0.15, 다음에 대한 muse-spark-1.3, muse-spark-1.2 및 muse-spark-1.1 모두 동일
• 기여자 토큰 요금 — 백만 입력, 출력 및 캐시된 입력당 $0.10 / $0.20 / $0.002, muse-spark-1.3-contributor 및 muse-spark-1.2-contributor
Standard와 Contributor 등급은 단 하나의 실질적인 측면에서 차이가 있으며, Meta는 이를 모델 페이지와 요금표 모두에서 명시합니다: Standard에서는 귀하의 프롬프트와 완성이 Meta 모델을 학습하는 데 사용되지 않습니다; Contributor에서는 사용됩니다. 제품 페이지에서는 Contributor 행에 '제품 개선에 사용됨'이라고, Standard 행에 '제품 개선에 사용되지 않음'이라고 표시합니다. Contributor는 입력에서 약 12배 저렴하고 출력에서 약 21배 저렴한데, 이는 예산 결정이기 전에 데이터 거버넌스 결정이라고 할 만큼 충분히 큰 격차입니다.
가격 관련 세부 사항 세 가지는 놓치기 쉽지만, 워크로드 규모를 산정하기 전에 모두 알아둘 가치가 있습니다:
• 롱 컨텍스트 프리미엄 없음 — Meta의 요금표는 이를 명시합니다: 컨텍스트 윈도우가 대부분 비어 있든 거의 가득 차든 동일한 요율을 지불하며, 이는 이례적이고 장시간 에이전트 실행의 경제성을 실질적으로 바꿉니다
• 웹 검색 그라운딩은 별도로 과금됩니다 — 1,000건의 검색 쿼리당 $2.50이 요청의 토큰 비용에 추가로 부과되며, Muse Spark와 같은 텍스트 모델에 적용됩니다
• 속도 제한은 키당이 아니라 팀당입니다 — Standard에서는 분당 3,000건의 요청과 4,000,000개의 토큰, Contributor에서는 분당 100건의 요청과 3,000,000개의 토큰입니다. 한 팀 안에서 여러 키를 사용해도 할당량이 배로 늘어나지 않습니다
구독 메커니즘은 Meta의 구독 페이지에 문서화되어 있으며 일반적인 방식입니다: 업그레이드는 일할 계산되어 즉시 적용되고, 다운그레이드는 다음 결제 주기에 적용되며, 취소는 결제일 최소 24시간 전에 해야 하고, 취소된 구독에 대한 환불은 법률에서 요구하는 경우를 제외하고는 없습니다. 구독은 Muse Code CLI 자격 증명을 구체적으로 대상으로 하며, 추가 API 키는 종량제로 청구됩니다.

어느 버전이 현재인가요: 1.2.1, Muse Spark 1.3, 그리고 둘 다 아닌 기본값
이것은 수요 데이터가 가장 크게 말해 주는 질문입니다 — "muse code 1.3"이라는 검색어가 존재한다는 사실 자체가 — 그리고 이것은 정말로 혼란스럽습니다. 왜냐하면 "그 버전"은 세 가지 다른 것을 의미할 수 있고 Muse Code는 세 가지 모두를 공개하기 때문입니다.
• CLI 릴리스 — 현재 버전은 1.2.1입니다. Meta의 변경 로그에는 릴리스가 1.2.1, 1.1.1, 0.2.1, 0.1.0으로 나열되어 있으며, 그중 마지막 릴리스에는 "Launch version"이라는 레이블이 붙어 있습니다.
• 모델 세대 — 2026년 9월 2일에 발표되었고 Meta의 모델 페이지에서 "최신 버전 … 새로운 작업에 권장됨"이라고 설명된 Muse Spark 1.3
• CLI의 기본 모델 — muse-spark-1.2, 문서의 첫 실행 섹션에 명시되어 있으며 구성 페이지의 모델 선택 항목에서도 다시 언급됩니다
Muse Code 1.2.1을 새로 설치하면 Muse Spark 1.2가 실행됩니다. 단, 다음을 전달하지 않는 한:--model muse-spark-1.3 또는 다음 명령으로 세션 중 전환하지 않는 한:/models. Meta 자체의 퀵스타트 페이지는 muse-spark-1.3을 모든 API 예제에서 사용하는데, 이는 그 차이를 실제보다 더 오해하기 쉽게 만듭니다: API 예제와 CLI 기본값은 오늘날 같은 모델을 가리키지 않습니다.
1.2.1 체인지로그는 모델이 아니라 하네스에서 무엇이 바뀌었는지 설명하며, 주요 항목은 다음과 같습니다:
• macOS에서는 음성 입력이 기본적으로 켜져 있으며 Option+V에 바인딩되고 다음으로 관리됩니다: /voice
• /rewind 명령: 대화를 이전 입력으로 되돌리고, double-Esc에서 사용하는 선택기를 공유합니다
• [Image #N] 붙여넣거나 드롭한 이미지에 라벨을 붙여 모델에 번호로 특정 이미지에 대해 물어볼 수 있으며, 라벨과 소스 경로는 재개, 되감기, 포크 후에도 그대로 유지됩니다
• 번들로 제공되는 migrate 스킬: Claude Code 또는 Codex에서 메모리 노트와 MCP 서버 정의를 Muse Code로 가져옵니다
• /mcp 연결된 MCP 서버와 해당 도구의 실시간 목록을 확인하려면
• 새 세션이 자동 검토 권한 프로필에서 열리며, 이 프로필은 "Ask me"와 동일한 접근 권한을 부여하지만 승인 가능한 요청은 자동 검토자에게 전달하고, 검토자를 사용할 수 없을 때는 사용자에게 묻는 방식으로 대체합니다
• 보안 수정 사항, 그중 세 가지는 겉모습이 아닌 동작에 관한 것입니다: 다음과 같은 래퍼—env 및 setsid—를 통해 실행된 명령은 이제 실제로 실행하는 명령으로 검토됩니다. 세션 중간의 권한 모드 변경은 이미 실행 중인 도구의 다음 동작에 적용됩니다. 그리고 무제한 권한 프로필은 이제 --yolo
모델 측면에서, 9월 2일 발표는 Muse Spark 1.3이 다양한 하네스 세트 전반에서 훈련되었으며, Meta가 홍보한 것이 기본 모델 단독이 아니라 추론 등급 — "max reasoning을 갖춘 Muse Spark 1.3이 이제 Muse Code와 Meta Model API에서 사용 가능합니다" — 이었다는 점을 명시적으로 밝히고 있다. 8월 5일의 Muse Spark 1.2 출시 게시물은 그 이야기의 나머지 절반을 보태는데, Muse Spark 1.2는 Muse Code 자체와 공동 훈련되었으며, 거부 샘플링된 하네스 궤적과 목표, 컴팩션, 서브에이전트에 대한 레시피 작업을 사용했고, 하네스 호환성을 극대화하도록 Muse Code 도구 세트가 통합되었다. 모델과 하네스는 서로를 상대로 개발되었다.
엔벨로프: 맥락, 양식, 플랫폼
Muse Spark 1.3, Muse Spark 1.2, Muse Spark 1.1은 모두 하나의 범위를 공유하며, Meta는 이를 단일 표 행에 명시합니다: 모든 티어와 모든 버전에 걸쳐 1,048,576 토큰의 컨텍스트, 입력으로 텍스트, 이미지, 비디오, 오디오, PDF를, 출력으로는 텍스트만을 지원합니다.
모달리티 동등성에는 한 가지 주의 사항이 따르는데, Meta가 각주로 공개한 이 내용은 묻어두기보다 거듭 강조할 가치가 있습니다: Muse Spark 1.3의 오디오 이해는 완전히 지원되지 않으며 오디오 콘텐츠가 포함된 요청의 응답 품질이 저하될 수 있습니다. Meta의 자체 지침은 오디오에는 Muse Spark 1.2를 사용하거나, 전용 음성-텍스트 변환에는 Muse Voice Transcribe를 사용하라는 것입니다. CLI에서는 이를 실행에 옮길 수 있습니다 — --model muse-spark-1.2는 문서화된 오버라이드이며, 기본값은 이미 그 옵션을 가리킵니다.
Reasoning effort는 하네스 수준 설정으로 여덟 단계가 있으며, Meta의 구성 페이지에서는 이를 순서대로 none, minimal, low, medium, high(기본값), xhigh, max, ultra라고 부릅니다. 그 목록에서 세 가지 세부 사항은 핵심입니다:
• max는 가장 깊은 추론 수준으로, xhigh를 넘어선 확장된 추론이라고 설명되며, Muse Code는 Standard와 Contributor 등급 모두에서 이를 제공합니다
• ultra는 모델 티어가 아니라 클라이언트 측 설정입니다: 각 제공자가 지원하는 가장 높은 추론 티어에 매핑되며, Muse Code가 더 적극적으로 위임하도록 할 수 있습니다. 또한 제공자가 이를 지원하지 않는 경우 ultra 요청의 실행 위치는 다음과 같습니다: xhigh
Meta 제공자는 none을 허용하지 않으므로, 최저 수준은 하네스에 구성된 다른 제공자를 통해서만 사용할 수 있습니다
플랫폼 지원은 Meta의 두 페이지가 서로 어긋나는 지점이며, 그 불일치는 작지만 실재한다. 문서 페이지에서는 Muse Code가 하나의 코드베이스로 macOS, Linux, Windows에서 실행된다고 말하고, Windows에 특화된 동작 세 가지를 나열한다. PowerShell이 Bash를 대체하므로 에이전트가 실행하는 명령은 PowerShell 구문과 Windows 명령줄 도구를 사용한다. 샌드박스가 관리자 승인을 요청할 수 있으며, Windows에서는 샌드박스가 처음 초기화될 때 사용자 계정 컨트롤 프롬프트가 표시될 수 있지만 일반적인 사용에는 관리자 권한으로 실행할 필요가 없다. 그리고 두 가지 기능, 즉 음성 입력과 세션 메시징은 Windows에서 사용할 수 없으며, 둘 다 macOS와 Linux에서는 작동한다. 대조적으로 제품 페이지는 “MacOS 및 Windows에서 사용 가능”이라고만 말한다. 두 진술 모두 오늘 Meta 자체 사이트에서 나온 것이며, 함께 읽으면 Windows는 문서화된 격차가 있지만 지원되고, Linux는 마케팅 페이지에서 언급하지 않음에도 지원된다는 뜻이다.
가용성에 관한 또 하나의 미묘한 점은 마케팅 문구가 아니라 문서에서 비롯됩니다. 병렬 및 단계별 에이전트 오케스트레이션인 Workflows는 설치된 빌드에 워크플로 엔진이 포함되어 있고 롤아웃이 활성화된 경우에만 작업을 조정하며, Meta는 Workflows가 "모든 빌드나 플랫폼에서 사용할 수 있는 것은 아닙니다"라고 분명히 밝힙니다. 워크플로 기능이 설치 이유라면, 있다고 가정하지 말고 해당 빌드에 그 기능이 있는지 확인하세요.
하네스와 에포트를 명시한 Meta의 주장
Meta는 벤치마크 자료를 공개하므로, 여기서 정직한 표현은 "벤더 벤치마크가 없다"가 아니라 "이것들은 벤더 벤치마크이며, 비교 조건은 Meta가 명시한 곳에 명시되어 있다"입니다.
Meta가 본문에서 제시하는 유일한 정량적 주장은 Muse Spark 1.3 발표문에 있으며, 이는 제3자 평가가 아니라 내부 비교에 기인한다: "Meta 엔지니어들의 비교에서, 이는 훨씬 더 빠르고 효율적인 것으로 입증되었으며, 도구 호출은 약 20% 더 적게, 토큰은 약 25% 더 적게 사용했다." 기준선은 명시되어 있다 — Muse Spark 1.2 대비 — 그리고 노력 수준은 발표문 자체의 프레이밍에 있는데, 이 릴리스는 max reasoning을 갖춘 Muse Spark 1.3을 중심으로 제목이 붙었기 때문이다. 명시되지 않은 것은 작업 세트, 실행 횟수, 또는 그것이 Muse Code라는 사실 외의 하네스 구성이다. 두 백분율은 측정된 벤치마크 결과가 아니라 벤더가 보고한 진행 방향으로 취급하라.
다른 공개 결과는 점수가 아니라 사례 연구이며, 둘 중 더 흥미로운 쪽이다. Meta는 Muse Code의 에이전트형 코딩 환경을 사용해 1,000회 이상의 도구 호출과 최대 24시간에 걸쳐 GPU 커널을 반복적으로 최적화하는 Muse Spark 1.2의 능력을 시험했다고 보고한다. 이 환경을 통해 커널을 작성하고, 컴파일하고, 프로파일링하고, 주어진 기준선에 대비해 커널 성능을 점진적으로 개선했다. 워크로드도 이름이 붙어 있다 — NVIDIA Hopper GPU의 KDA 및 MLA 커널 — 제약도 마찬가지다: FLA와 같은 서드파티 커널 라이브러리는 금지되었고, 기준선은 Triton FLA KDA 구현이었다. 24시간, 1,000회 도구 호출 실행은 벤치마크 백분율과는 다른 종류의 증거다. 이는 장기 지평의 목표 아래에서의 지구력에 대해 뭔가를 말해 주지만, 비교 품질에 대해서는 거의 말해 주지 않는다.
Muse Spark 1.2와 Muse Spark 1.3의 출시 차트는 두 모델을 에이전트, 코딩, 지시 따르기, 장문맥 평가 전반에서 이름이 명시된 소수의 경쟁 모델과 비교해 배치합니다. 축에는 DeepSWE v1.1, SWE-Atlas-QnA, Terminal-Bench 2.1 및 4.0, tau2-bench, GDPval, SciCode, IFBench, MultiChallenge, AA-LCR v1.1이 포함됩니다. 그 차트는 벤더가 제작하고 벤더가 직접 그린 것이며, 차트에 등장하는 경쟁사 구성은 중립적인 패널이 아니라 Meta가 선택한 것입니다. 그런 이유로 여기서는 막대 값을 재현하지 않습니다. 벤더 차트를 리더보드로 읽는 것은 바로 이 페이지가 피하고자 하는 실패 유형이기 때문입니다.
얼버무리기보다 솔직하게 밝힐 만한 두 가지 간극이 있다:
• Meta는 명명된 작업 세트에서 동일한 노력으로 Muse Code를 Muse Spark 1.2와 정면 비교한 결과를 공개하지 않는다; 약 20%/25% 수치가 가장 근접한 것이며, 이는 점수가 아니라 명시된 효율 차이를 담은 내부 비교다.
• Meta는 CLI의 실시간 지연 평가를 공개하지 않으며, 공개된 수치 중 어느 것도 실제 편집 부하에서 세션이 어떤 느낌인지 설명하지 않습니다.
Artificial Analysis가 독립적으로 측정하는 항목
Artificial Analysis는 현재 Muse Code를 대상으로 하는 코딩 에이전트 측정 결과를 발표하는 독립 평가 기관이며, 이는 위의 어떤 수치와도 다른 종류의 숫자입니다: 각 행은 하네스와 모델의 쌍이며, 공급업체가 아니라 AA가 평가합니다.
Artificial Analysis Coding Agent Index에서 — 페이지는 자체 구조화 데이터에서 자신을 v1.5로 식별합니다 — Muse Code 행은 다음과 같습니다:
• Muse Code가 최대 추론으로 Muse Spark 1.3 실행 중 — 54.3
• Muse Code가 xhigh 추론으로 Muse Spark 1.3 실행 중 — 48.3
• 같은 순위표의 정상 — 최대 추론으로 Claude Opus 5.5를 구동하는 Claude Code, 66.0
그 수치들에 관해서는 수치 자체보다 더 중요한 두 가지가 있다. 첫째, max와 xhigh 행 사이의 5.0점 격차는 같은 하네스에서 설정 하나만 바꾼 같은 모델에서 나온 것이다. 이는 "Muse Code 점수"가 노력 수준을 밝히지 않으면 불충분하게 규정된다는 점을 상기시켜 주는 유용한 알림이다. 둘째, 이 보드는 우리가 9월에 Muse Spark 1.3을 다룬 보도에서 인용한 측정값과는 다른 측정이다. 앞선 기사에서는 Muse Spark 1.3의 max가 68, xhigh가 64, Claude Opus 5의 xhigh가 68이라고 인용했다. 그 숫자들은 이제 라이브 보드에 나타나지 않는다 — 현재 최상단 행은 max에서 Claude Opus 5.5가 66.0이고, Muse Code 행은 54.3과 48.3을 나타낸다. 지수는 개정되었고 평가 대상의 구성도 바뀌었다. 예전 수치를 계속 들고 다니고 있다면, 그것들은 대체된 것이며, 두 세트를 마치 같은 측정을 두 번 한 것처럼 나란히 인용해서는 안 된다.
Muse Spark 1.3의 AA 모델 페이지는 다시 별도의 화면이며, 자체 수치는 공급업체 보고가 아니라 AA가 측정한 것입니다: Intelligence Index 48.09, Terminal-Bench 2.1 84.3%, GPQA Diamond 93.5%, HLE 48.7%, SciCode 58.8%, 장문맥 리콜 83%이며, 출시일은 2026-09-02, 컨텍스트 창은 1,000,000토큰, 독점·폐쇄 가중치로 분류됩니다. 이는 한 모델 페이지의 한 인덱스 개정임을 유의하세요 — AA는 자체 일정에 따라 개정되는 모델별 지수를 공개하므로, 이 페이지의 수치를 다른 모델 페이지의 수치와 섞어도 동일 스냅샷 비교가 되지 않습니다.
이 모든 것에서 얻을 수 없는 것은 동일 조건의 비교다. AA 코딩 행들은 구조상 하네스를 교차한다 — Muse Code는 Codex에 대하고, Claude Code에 대하고, Grok Build에 대하고, Kimi Code CLI에 대한다 — 따라서 행 대 행으로 읽는 것은 한 하네스 아래의 두 모델이 아니라, 하나의 하네스-모델 쌍을 또 다른 하네스-모델 쌍과 비교하는 것이다. Meta가 동일 조건 비교를 수행하지 않았고 AA의 보드가 그 답을 내놓도록 만들어지지 않은 상황에서, 정직한 입장은 인접한 수치들로 그러한 비교를 구성하는 것이 아니라 동일한 노력과 하네스에서의 직접 맞대결은 존재하지 않는다고 말하는 것이다.
Orca가 라우팅하는 것과 라우팅하지 않는 것
OrcaRouter는 200개 이상의 모델을 지원하는 단일 엔드포인트이며, 각 제공업체의 정가로 마크업이 없습니다. 즉, 이 패밀리에 대한 가용성 답변은 정책의 문제가 아니라 확인 가능한 사안입니다. 오늘 저희의 실시간 공개 모델 목록과 대조해 확인했습니다:
• meta/muse-code — 카탈로그에 없습니다. Muse Code는 라우팅 가능한 모델이 아니라 하네스이며, 저희는 이를 제공하지 않습니다
• meta/muse-spark-1.3 — 카탈로그에 없음
• meta/muse-spark-1.2 — 라우팅 가능하며, 1,048,576토큰 컨텍스트 윈도우를 갖추고 있고 가격은 입력 토큰 100만 개당 $1.25, 출력 토큰 100만 개당 $4.25, 캐시 읽기 100만 개당 $0.15로, Meta가 공개한 것과 동일한 요율입니다
• meta/muse-spark-1.1 — 라우팅도 가능하며, 동일한 세 가지 요금으로
따라서 OrcaRouter에서 이것의 실질적인 형태는, 출시된 Muse Spark 세대에는 다른 모든 것에 사용하는 것과 동일한 엔드포인트를 통해 접근할 수 있지만, Muse Code나 현재 1.3 세대에는 이를 통해 접근할 수 없다는 것입니다. 이는 오늘날의 카탈로그에 대한 설명으로만 받아들이세요. 가용성은 바뀌며, 이를 확인할 곳은 모델 목록입니다.

이런 워크로드에서 라우터가 진가를 발휘하는 지점은 구독으로는 제공할 수 없는 두 가지입니다. 첫 번째는 단일 API 키가 라우팅 계층이라는 점인데, 공급자 성능이 저하되면 요청을 자동으로 페일오버하며, 이는 에이전트 실행이 수천 번의 도구 호출 깊이에 이르렀을 때 중요합니다. 업스트림 하나가 안 좋은 오후를 보내고 있다는 이유로 이를 잃고 싶지는 않을 테니까요. 두 번째는 요청이 하드코딩되는 대신 서술된다는 점입니다. Muse Spark 1.2를 다른 모델과 동일한 라우팅 DSL 뒤에 배치하고, 클라이언트를 변경하지 않고도 이를 처리하는 대상을 바꿀 수 있습니다.
자주 묻는 질문
CLI의 기본 모델이 현재 모델인가요? 아니요. Muse Code의 기본값은 muse-spark-1.2이며, 현재 세대는 2026년 9월 2일에 발표된 Muse Spark 1.3이고, 다음을 사용해 접근할 수 있습니다: --model muse-spark-1.3 또는 /models 명령.
어떤 표기가 맞나요 — "Muse Code 1.3"인가요, "Muse Spark 1.3"인가요? Muse Spark 1.3입니다. Muse Code 버전은 하네스 릴리스이며 현재 버전은 1.2.1입니다. 두 번호 체계는 서로 무관하며, 바로 이것이 "muse code 1.3" 검색이 혼란스러운 결과를 반환하는 이유입니다.
오디오 입력만 필요하다면 어떤 모델을 구성해야 하나요? Muse Spark 1.2입니다. Meta의 각주에 따르면 1.3의 오디오 이해는 완전히 지원되지 않아 응답 품질이 저하될 수 있으며, 오디오 작업에는 1.2 또는 Muse Voice Transcribe를 사용하도록 안내하고 있습니다.
기여자 등급은 무료 또는 체험판 등급인가요? 아니요, 자동으로 받을 수 있는 할인도 아닙니다. 이는 1.2 이후 모든 Muse Spark 버전에서 프롬프트와 완성 결과를 학습에 사용하도록 허용하는 대가로 제공되는 더 저렴한 변형이며, 1.1 세대에는 기여자 변형이 없습니다.
결론
Muse Code는 Meta의 터미널 및 CI 코딩 에이전트로, Meta가 자사의 Muse Spark 모델용으로 만들었으며, 월 $5.00, $15.00, $50.00의 세 가지 월간 요금제로 판매되고 무료 티어는 없습니다. 종량제 Standard 요금은 백만 토큰당 입력 $1.25, 출력 $4.25이며, Contributor 요금은 같은 토큰에 대해 입력 $0.10, 출력 $0.20입니다. 단, Meta가 해당 토큰으로 학습하도록 허용하는 경우에 적용됩니다. 현재 CLI 릴리스는 1.2.1이고, 현재 모델 세대는 Muse Spark 1.3이며, CLI는 여전히 Muse Spark 1.2를 기본값으로 사용합니다. 점수를 인용할 때는 항상 버전과 추론 강도를 명시하세요. Muse Code가 Muse Spark 1.3을 max와 xhigh에서 실행하는 것은 같은 측정이 아니며, 벤더의 대표적인 효율성 주장은 독립적인 결과가 아니라 내부 비교이기 때문입니다.
하네스 자체를 직접 살펴보시려면 참고하세요Muse Code 터미널 코딩 에이전트에 대한 저희 워크스루를.
이 글에서 비교한 모델3
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
