Một thẻ hero được tạo có tiêu đề 'Muse Code', phụ đề 'agent lập trình terminal của Meta dành cho Muse Spark' và hai viên thông tin bo tròn ghi 'Terminal + CI' và 'Từ $5/tháng'. Logo OrcaRouter được ghép ở góc dưới cùng bên phải.
Guides & Insights

Muse Code: Ai tạo ra nó, giá bao nhiêu, và phiên bản nào là hiện tại

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Muse Code là agent lập trình của Meta dành cho terminal và CI, được xây dựng cho dòng mô hình Muse Spark, và hai phiên bản quan trọng với bất kỳ ai đến đây là Muse Spark 1.3 — thế hệ hiện tại, ngày 2 tháng 9 năm 2026 — và Muse Spark 1.2, đây là phiên bản mà CLI vẫn chọn trừ khi bạn chỉ định khác. Muse Code được cài đặt dưới dạng một native muse binary, chạy ở chế độ tương tác hoặc headless, và được bán theo ba cách: ba gói hàng tháng ở mức $5.00, $15.00 và $50.00, và tính phí token theo mức sử dụng trên Meta Model API ở mức $1.25 cho mỗi triệu token đầu vào và $4.25 cho mỗi triệu token đầu ra trên gói Standard. Lùi lại một thế hệ nữa, Muse Spark 1.1, vẫn được cung cấp trên cùng gói với cùng mức giá.

Đọc trang này như một trang tham chiếu, không phải như tin tức. Bản thân Muse Code không phải là một điều gì mới để đưa tin: Meta đã phát hành nó dưới dạng bản beta vào ngày 5 tháng 8 năm 2026 và đưa nó ra khỏi beta vào ngày 31 tháng 8 năm 2026, và trang này dùng những ngày đó để định vị mô hình trong dòng thời gian thay vì để công bố nó. Căn cứ cho trang này là nhu cầu tìm kiếm thường trực mà chúng tôi đo được trực tiếp vào ngày 28 tháng 9 năm 2026, trong đó truy vấn trần "muse code" thu được 4.547 lượt hiển thị trong 28 ngày gần nhất với 0 lượt nhấp, và cách viết mang tính thương mại của cùng ý định đó — "muse code free", "muse code plan", "muse code plans", "muse code free tier", "muse code 1.3" — thu thêm 124 lượt hiển thị, cũng với 0 lượt nhấp. Độc giả đang đặt ra bốn câu hỏi cụ thể. Trang này trả lời chúng theo thứ tự, dựa trên tài liệu của chính Meta, và nói rõ khi một số liệu đến từ Meta chứ không phải từ một đơn vị đánh giá độc lập.

Nếu điều bạn thực sự cần là một bài đánh giá về hành vi của agent, hay một màn đối đầu trực tiếp với một coding harness khác, thì đây không phải là trang đó. Những bài như vậy đã có trên blog này và những bài đáng để bạn dành thời gian được liên kết ở cuối.

Muse Code là gì và ai tạo ra nó

Định nghĩa của nhà cung cấp chỉ gồm một câu: "Muse Code is Meta's coding agent for the terminal and CI, built for Muse Spark." Nó không phải là một thư viện, không phải một giao diện trò chuyện, và cũng không phải một mô hình — nó là một harness. Bạn chạy nó bên trong một thư mục dự án; nó lập kế hoạch, chỉnh sửa tệp và chạy lệnh để hoàn thành một tác vụ, với các phê duyệt và một sandbox của hệ điều hành được bật ngay từ lần chạy đầu tiên.

Meta định hình Muse Code và Meta Model API là hai con đường dẫn đến cùng một mô hình nền tảng: hãy gọi API trực tiếp khi bạn đang xây dựng agent hoặc ứng dụng của riêng mình, và chạy Muse Code khi bạn muốn có một coding agent làm sẵn tại dòng lệnh hoặc bên trong một pipeline. Sự khác biệt đó rất quan trọng đối với giá cả, vì gói đăng ký mua harness còn API key được tính phí riêng theo token.

Cài đặt là một trình cài đặt một dòng, và hai bề mặt nhà cung cấp không hoàn toàn thống nhất về chuỗi:

• macOS và Linux — curl -fsSL https://dev.meta.ai/install.sh | sh trên trang tài liệu, và lệnh tương tự kết thúc bằng | bash trên trang tiếp thị và trong cả hai bài đăng blog nghiên cứu

• Windows — irm https://dev.meta.ai/install.ps1 | iex, chỉ được đăng trên trang tài liệu

• Xác minh — muse --version, sau đó muse trong thư mục dự án để bắt đầu một phiên tương tác

• Lần chạy đầu tiên — bạn được yêu cầu tin cậy workspace (thứ tải các quy tắc và hook của nó) và xác thực, hoặc qua đăng nhập bằng trình duyệt hoặc bằng khóa API; trong CI, bạn đặt META_API_KEY thay vào đó

• Hai giao diện — muse cho giao diện terminal tương tác, muse exec "<prompt>" cho một lần chạy không tương tác đến khi hoàn tất

• Điều khiển nó từ chương trình của riêng bạn — muse serve chạy một giao thức phiên có phiên bản, muse schema in ra lược đồ JSON của nó, và npm install @muse-code/sdk cài đặt trình bao TypeScript

Điểm cuối cùng đó là phần mà hầu hết các bản tóm tắt đều bỏ sót. Muse Code không chỉ là một CLI: giao thức phiên là một giao diện được tài liệu hóa, có phiên bản, và nhật ký thay đổi cho thấy nó đang được mở rộng một cách có chủ đích — các phiên có thể được đổi tên thông qua giao thức, ứng dụng khách có thể đọc bản tóm tắt diff có cấu trúc cho mỗi chỉnh sửa, và một chương trình điều khiển có thể đặt mặc định mức nỗ lực suy luận trên toàn phiên.

A screenshot of Meta's Muse Code product page at dev.meta.ai, showing the headline 'A coding agent for your most complex coding workstreams. Build, debug and ship with Muse Code', the install command curl https://dev.meta.ai/install.sh | bash, and the availability line 'Available for MacOS and Windows.'

Muse Code tốn bao nhiêu, và câu hỏi về gói miễn phí được giải đáp rõ ràng

Không có gói miễn phí. Điều đó đáng được nói thẳng, bởi vì đây là truy vấn thương mại được hỏi nhiều nhất trong dữ liệu nhu cầu và câu trả lời là không thể nhập nhằng: trang sản phẩm Muse Code, trang đăng ký thuê bao và nhật ký thay đổi gộp lại không chứa gói miễn phí nào, không có bản dùng thử, không có phân bổ tín dụng miễn phí và không có quyền truy cập miễn phí bị giới hạn tốc độ.

Một lưu ý về kiểm tra đó. Tài liệu định giá của Meta có sử dụng cụm từ "platform free-tier credits" một lần — trong ghi chú về Muse Voice Transcribe, trong đó nói rằng phiên âm không lưu dữ liệu được định giá ngang bằng với gói Standard và rằng các tín dụng bậc miễn phí nền tảng được áp dụng. Muse Voice Transcribe là một sản phẩm riêng trên Meta Model API với cách tính phí theo giờ riêng; câu đó không nói gì về Muse Code. Nếu bạn thấy dòng đó được trích dẫn làm bằng chứng cho một gói miễn phí của Muse Code, thì nó đang bị đọc tách khỏi ngữ cảnh.

Điều Meta thực sự công bố là ba gói đăng ký, tất cả đều được tính phí hàng tháng, cộng với việc tính phí token theo mức sử dụng cho bất cứ thứ gì vượt quá hạn mức prompt của gói:

• Sử dụng hằng ngày — 5,00 USD/tháng; quyền truy cập các mô hình Muse mới nhất; 10–50 prompt mỗi 5 giờ, bao gồm tải lên hình ảnh và video; chế độ giọng nói; tìm kiếm web

• High Usage — 15,00 USD/tháng; mọi thứ trong gói Everyday; mức sử dụng nhiều gấp 5 lần so với Everyday; nhiều lệnh nhắc hơn; nhiều đầu vào đa phương thức hơn

• Power Usage — $50.00/tháng; mọi thứ trong gói High Usage; hạn mức sử dụng Everyday gấp 20×; prompt mở rộng; quyền truy cập sớm vào các tính năng mới; tải lên tệp lớn hơn

• Mức giá token tiêu chuẩn — 1,25 USD cho mỗi triệu token đầu vào, 4,25 USD cho mỗi triệu token đầu ra, 0,15 USD cho mỗi triệu token đầu vào được lưu trong bộ nhớ đệm, áp dụng cho muse-spark-1.3, muse-spark-1.2 và muse-spark-1.1 như nhau

• Đơn giá dành cho cộng tác viên — $0.10 / $0.10 / $0.002 mỗi một triệu token đầu vào, đầu ra và đầu vào được lưu trong bộ nhớ đệm, áp dụng cho muse-spark-1.3-contributor và muse-spark-1.2-contributor

Các gói Standard và Contributor khác nhau đúng một điểm thực chất, và Meta nêu rõ điều đó trên cả trang mô hình lẫn bảng giá: ở gói Standard, các prompt và completion của bạn không được dùng để huấn luyện các mô hình Meta; ở gói Contributor, chúng được dùng. Trang sản phẩm gắn nhãn các hàng Contributor là “Được dùng để cải thiện sản phẩm của chúng tôi” và các hàng Standard là “Không được dùng để cải thiện sản phẩm của chúng tôi.” Contributor rẻ hơn khoảng mười hai lần ở đầu vào và khoảng hai mươi mốt lần ở đầu ra, một khoảng cách đủ lớn đến mức trước tiên đây là quyết định về quản trị dữ liệu, rồi mới đến quyết định về ngân sách.

Ba chi tiết về giá rất dễ bị bỏ sót và đều đáng biết trước khi bạn xác định quy mô một khối lượng công việc:

• Không có phụ phí ngữ cảnh dài — bảng giá của Meta cho thấy điều này: bạn trả cùng một mức giá bất kể cửa sổ ngữ cảnh gần như trống rỗng hay gần đầy, đây là điều bất thường và tác động đáng kể đến khía cạnh kinh tế của các lượt chạy agent dài.

• Tính năng grounding bằng tìm kiếm web được tính phí riêng — 2,50 USD cho mỗi 1.000 truy vấn tìm kiếm, cộng thêm vào chi phí token của yêu cầu, và áp dụng cho các mô hình văn bản như Muse Spark

• Giới hạn tốc độ được tính theo nhóm, không phải theo từng khóa — 3.000 yêu cầu và 4.000.000 token mỗi phút ở gói Standard, 100 yêu cầu và 3.000.000 token mỗi phút ở gói Contributor; việc dùng nhiều khóa trong cùng một nhóm không làm tăng hạn mức

Cơ chế đăng ký được ghi lại trên trang đăng ký của Meta và mang tính thông lệ: nâng cấp được tính theo tỷ lệ và có hiệu lực ngay lập tức, hạ cấp có hiệu lực vào chu kỳ thanh toán kế tiếp, việc hủy yêu cầu ít nhất 24 giờ trước ngày thanh toán, và không có khoản hoàn tiền nào cho đăng ký đã hủy ngoại trừ trường hợp pháp luật yêu cầu. Đăng ký bao gồm cụ thể thông tin xác thực Muse Code CLI; các API key bổ sung được tính phí theo hình thức trả tiền theo mức sử dụng.

A generated scoreboard card titled 'Muse Code — the scoreboard', listing six vendor-published figures: Vendor Meta; current model Muse Spark 1.3; CLI release 1.2.1; Standard price $1.25 in / $4.25 out per 1M; Contributor price $0.10 in / $0.20 out per 1M; free tier none. The footer reads 'All figures vendor-published on dev.meta.ai, checked 2026-09-28.'

Phiên bản nào là hiện tại: 1.2.1, Muse Spark 1.3, và bản mặc định không phải cả hai

Đây là câu hỏi mà dữ liệu nhu cầu phản ánh rõ nhất — việc truy vấn "muse code 1.3" tồn tại — và nó thực sự gây nhầm lẫn, vì "phiên bản" có thể mang ba nghĩa khác nhau và Muse Code phát hành cả ba.

• Bản phát hành CLI — 1.2.1 là bản hiện tại. Nhật ký thay đổi của Meta liệt kê các bản phát hành gồm 1.2.1, 1.1.1, 0.2.1 và 0.1.0, bản cuối cùng trong số đó được gắn nhãn "Launch version"

• Thế hệ mô hình — Muse Spark 1.3, được công bố vào ngày 2 tháng 9 năm 2026 và được mô tả trên trang mô hình của Meta là “phiên bản mới nhất … Được khuyến nghị cho công việc mới”

• Mô hình mặc định của CLI — muse-spark-1.2, được nêu trong phần chạy lần đầu của tài liệu và một lần nữa trong mục chọn mô hình ở trang cấu hình

Vậy nên một bản cài đặt mới hoàn toàn của Muse Code 1.2.1 sẽ chạy Muse Spark 1.2 trừ khi bạn truyền --model muse-spark-1.3 hoặc chuyển đổi ngay giữa phiên bằng /models. Các trang hướng dẫn nhanh của chính Meta đều dùng muse-spark-1.3 trong mọi ví dụ API, khiến cho sự khác biệt này dễ bị hiểu nhầm hơn mức cần thiết: các ví dụ API và mặc định của CLI hiện nay không trỏ đến cùng một model.

Bản changelog 1.2.1 mô tả những gì đã thay đổi trong harness thay vì trong model, và các mục chính là:

• Nhập bằng giọng nói được bật mặc định trên macOS, gán với Option+V và được quản lý bằng /voice

• Lệnh /rewind đưa cuộc trò chuyện trở về một đầu vào trước đó, dùng chung trình chọn được dùng khi nhấn Esc hai lần

• [Ảnh #N] nhãn trên ảnh được dán và kéo thả để có thể hỏi model về một ảnh cụ thể theo số, với nhãn và đường dẫn nguồn vẫn được giữ lại khi khôi phục phiên, tua lại và phân nhánh

• Một kỹ năng migrate đi kèm để nhập ghi chú bộ nhớ và định nghĩa máy chủ MCP từ Claude Code hoặc Codex vào Muse Code

• /mcp để xem danh sách trực tiếp các máy chủ MCP đã kết nối và các công cụ của chúng

• Các phiên mới sẽ mở trong hồ sơ quyền Tự động xem xét, vốn cấp quyền truy cập tương tự như "Ask me" nhưng định tuyến các yêu cầu phê duyệt đủ điều kiện đến một trình xem xét tự động, và chuyển sang hỏi bạn khi trình xem xét không khả dụng

• Các bản sửa lỗi bảo mật, ba trong số đó liên quan đến hành vi thay vì hình thức: các lệnh được khởi chạy thông qua các trình bao bọc như env và setsid giờ đây được xem xét đúng như lệnh mà chúng thực sự khởi chạy; thay đổi chế độ quyền giữa phiên sẽ áp dụng cho các công cụ đang chạy ở hành động tiếp theo của chúng; và hồ sơ quyền Không giới hạn giờ đây hoạt động chính xác như --yolo

Về phía mô hình, thông báo ngày 2 tháng 9 nói rõ rằng Muse Spark 1.3 được huấn luyện trên một tập hợp đa dạng các harness, và rằng thứ mà Meta đang quảng bá là hạng suy luận — “Muse Spark 1.3 với suy luận tối đa hiện đã có trên Muse Code và Meta Model API” — chứ không phải chỉ mô hình nền. Bài đăng ra mắt Muse Spark 1.2 ngày 5 tháng 8 bổ sung nửa còn lại của câu chuyện đó: Muse Spark 1.2 được đồng huấn luyện với chính Muse Code, sử dụng các quỹ đạo harness được lấy mẫu bằng phương pháp từ chối cùng công việc recipe về mục tiêu, nén và tác tử con, với bộ công cụ Muse Code được tích hợp để tối đa hóa khả năng tương thích với harness. Mô hình và harness được phát triển dựa vào nhau.

Đường bao: ngữ cảnh, phương thức, nền tảng

Muse Spark 1.3, Muse Spark 1.2 và Muse Spark 1.1 đều dùng chung một khung, và Meta nêu rõ điều đó trong một hàng bảng duy nhất: 1.048.576 token ngữ cảnh, với văn bản, hình ảnh, video, âm thanh và PDF làm đầu vào và văn bản là đầu ra duy nhất, trên mọi hạng và mọi phiên bản.

Tính tương đương về phương thức đi kèm một lưu ý mà Meta công bố dưới dạng chú thích và đáng được nhắc lại thay vì giấu đi: khả năng hiểu âm thanh trong Muse Spark 1.3 không được hỗ trợ đầy đủ và chất lượng phản hồi cho các yêu cầu có chứa nội dung âm thanh có thể bị suy giảm; hướng dẫn của chính Meta là dùng Muse Spark 1.2 cho âm thanh, hoặc Muse Voice Transcribe cho chuyển giọng nói thành văn bản chuyên dụng. Trong CLI, điều đó có thể thực hiện được — --model muse-spark-1.2là một ghi đè được tài liệu hóa, và mặc định vốn đã trỏ đến đó.

Reasoning effort là một cài đặt ở cấp harness với tám mức, và trang cấu hình của Meta liệt kê chúng theo thứ tự: none, minimal, low, medium, high (mặc định), xhigh, max và ultra. Ba chi tiết trong danh sách đó đóng vai trò trụ cột:

• max là cấp độ lập luận sâu nhất, được mô tả là lập luận mở rộng vượt qua xhigh, và Muse Code cung cấp nó trên cả hai hạng Standard và Contributor

• ultra là một cài đặt phía máy khách chứ không phải một bậc mô hình: nó ánh xạ tới bậc suy luận cao nhất được hỗ trợ của từng nhà cung cấp và có thể khiến Muse Code phân công việc mạnh tay hơn, và ở những nơi nhà cung cấp không hỗ trợ nó thì một yêu cầu dùng ultra sẽ chạy ở mức xhigh

• Nhà cung cấp Meta không chấp nhận none, nên mức thấp nhất chỉ khả dụng thông qua các nhà cung cấp khác được cấu hình trong harness

Hỗ trợ nền tảng là điểm mà hai bề mặt của Meta không thống nhất, và sự khác biệt tuy nhỏ nhưng có thật. Trang tài liệu cho biết Muse Code chạy trên macOS, Linux và Windows từ một cơ sở mã duy nhất, và liệt kê ba hành vi riêng của Windows: PowerShell thay thế Bash, nên các lệnh do agent chạy dùng cú pháp PowerShell và công cụ dòng lệnh Windows; sandbox có thể nhắc yêu cầu phê duyệt của quản trị viên, và Windows có thể hiển thị lời nhắc User Account Control trong lần đầu sandbox khởi tạo, mặc dù sử dụng bình thường không yêu cầu chạy với quyền quản trị viên; và hai khả năng không có sẵn trên Windows — nhập bằng giọng nói và nhắn tin theo phiên, cả hai đều hoạt động trên macOS và Linux. Ngược lại, trang sản phẩm chỉ ghi "Available for MacOS and Windows." Cả hai phát biểu đều đến từ chính trang web của Meta hiện nay; khi đọc cùng nhau, chúng có nghĩa là Windows được hỗ trợ với các khoảng trống đã được ghi nhận, và Linux được hỗ trợ dù trang tiếp thị không đề cập đến nó.

Một sắc thái khả dụng nữa đến từ tài liệu chứ không phải từ nội dung tiếp thị: Workflows — cơ chế điều phối tác nhân song song và theo từng giai đoạn — chỉ phối hợp công việc khi bản dựng được cài đặt có bao gồm công cụ workflow và đợt triển khai được bật, và Meta nói thẳng rằng chúng "không có sẵn trên mọi bản dựng hay nền tảng." Nếu một tính năng workflow là lý do bạn đang cài đặt, hãy kiểm tra rằng bản dựng của bạn có tính năng đó thay vì cho rằng nó có.

Những gì Meta tuyên bố, với harness và effort được nêu rõ

Meta công bố tài liệu benchmark, nên cách định khung trung thực ở đây không phải là “không có benchmark từ nhà cung cấp” — mà là “đây là các benchmark từ nhà cung cấp, với những điều kiện so sánh được nêu tại nơi Meta nêu chúng.”

Tuyên bố định lượng duy nhất mà Meta đưa ra trong phần văn xuôi nằm trong thông báo về Muse Spark 1.3, và nó được gán cho so sánh nội bộ thay vì đánh giá của bên thứ ba: “Trong các so sánh do các kỹ sư Meta thực hiện, nó tỏ ra nhanh hơn và hiệu quả hơn đáng kể, sử dụng ít hơn ~20% lượt gọi công cụ và ít hơn ~25% token.” Mốc cơ sở đã được nêu — so với Muse Spark 1.2 — và mức độ nỗ lực nằm trong cách diễn đạt của chính thông báo, vì bản phát hành được đặt tiêu đề xoay quanh Muse Spark 1.3 với suy luận tối đa. Điều không được nêu là tập tác vụ, số lần chạy, hay cấu hình harness ngoài việc nó là Muse Code. Hãy coi hai tỷ lệ phần trăm đó là hướng phát triển do nhà cung cấp báo cáo, chứ không phải là kết quả benchmark đã đo lường.

Kết quả được công bố còn lại là một nghiên cứu điển hình chứ không phải một điểm số, và nó là kết quả thú vị hơn trong hai. Meta báo cáo đã thử nghiệm khả năng của Muse Spark 1.2 trong việc tối ưu hóa lặp đi lặp lại các nhân GPU qua hơn 1.000 lệnh gọi công cụ và tối đa 24 giờ, sử dụng môi trường lập trình tác tử của Muse Code để viết, biên dịch, phân tích hiệu năng và cải thiện dần hiệu năng nhân so với đường cơ sở được cung cấp. Khối lượng công việc được nêu tên — các nhân KDA và MLA trên GPU NVIDIA Hopper — và ràng buộc cũng vậy: các thư viện nhân bên thứ ba như FLA bị cấm, và đường cơ sở là một triển khai KDA FLA bằng Triton. Một lần chạy 24 giờ với hàng nghìn lệnh gọi công cụ là một loại bằng chứng khác với một tỷ lệ phần trăm benchmark. Nó nói lên điều gì đó về sức bền dưới một mục tiêu dài hạn và rất ít về chất lượng so sánh.

Các biểu đồ ra mắt cho cả Muse Spark 1.2 và Muse Spark 1.3 vẽ các mô hình đó so với một nhóm nhỏ các đối thủ được nêu tên trên các đánh giá agent, coding, tuân theo chỉ dẫn và ngữ cảnh dài — DeepSWE v1.1, SWE-Atlas-QnA, Terminal-Bench 2.1 và 4.0, tau2-bench, GDPval, SciCode, IFBench, MultiChallenge và AA-LCR v1.1 xuất hiện trong số các trục. Những biểu đồ đó do nhà cung cấp sản xuất và vẽ, và các cấu hình đối thủ trên đó là lựa chọn của Meta, không phải một bảng trung lập. Chúng tôi không tái tạo các giá trị cột ở đây vì lý do đó: một biểu đồ nhà cung cấp được đọc như bảng xếp hạng chính là kiểu thất bại mà trang này nhằm tránh.

Hai khoảng trống trung thực đáng được nêu ra thay vì che đậy:

• Meta không công bố so sánh đối đầu trực tiếp giữa Muse Code và Muse Spark 1.2 ở cùng mức nỗ lực trên một bộ tác vụ có tên; con số ~20%/~25% là thứ gần nhất, và đó là so sánh nội bộ với các mức chênh lệch hiệu quả được nêu rõ chứ không phải điểm số

• Meta không công bố đánh giá độ trễ trực tiếp của CLI, và không có con số nào được công bố mô tả cảm giác của một phiên làm việc dưới tải chỉnh sửa thực tế

Những gì Artificial Analysis đo lường một cách độc lập

Artificial Analysis là đơn vị đánh giá độc lập hiện đang công bố một phép đo dành cho coding agent bao gồm Muse Code, và đó là một loại số liệu khác với mọi thứ ở trên: các hàng là những cặp harness và model, được đánh giá bởi AA thay vì bởi nhà cung cấp.

Trên Artificial Analysis Coding Agent Index — trang tự nhận diện trong dữ liệu có cấu trúc của chính nó là v1.5 — các hàng Muse Code ghi là:

• Muse Code đang chạy Muse Spark 1.3 ở mức suy luận tối đa — 54.3

• Muse Code đang chạy Muse Spark 1.3 ở chế độ suy luận xhigh — 48.3

• Đứng đầu cùng bảng xếp hạng đó — Claude Code chạy Claude Opus 5.5 ở mức suy luận tối đa, đạt 66.0

Hai điều về những con số đó quan trọng hơn chính bản thân các con số. Thứ nhất, khoảng cách 5,0 điểm giữa hàng max và hàng xhigh là cùng một harness với đúng một thiết lập bị thay đổi, một lời nhắc hữu ích rằng một "Muse Code" là chưa đủ đặc tả nếu không nêu rõ mức effort. Thứ hai, bảng này là một phép đo khác với phép đo mà bài đưa tin hồi tháng Chín của chính chúng tôi về Muse Spark 1.3 đã dẫn: bài viết trước đó dẫn 64 cho Muse Spark 1.3 ở mức max, 64 ở mức xhigh, và 68 cho Claude Opus 5 ở mức xhigh. Những con số đó không còn xuất hiện trên bảng trực tuyến nữa — hàng trên cùng hiện tại là Claude Opus 5.5 ở mức max với 66,0, còn các hàng Muse Code ghi 54,3 và 48,3. Chỉ số đã được sửa đổi và thành phần của nhóm tham gia đã thay đổi. Nếu bạn vẫn còn mang theo những con số cũ, chúng đã bị thay thế, và không bao giờ nên trích dẫn hai bộ số đó cạnh nhau như thể chúng là cùng một phép đo được thực hiện hai lần.

Trang mô hình AA dành cho Muse Spark 1.3 lại là một bề mặt riêng, và các số liệu của chính nó do AA đo lường chứ không phải do nhà cung cấp báo cáo: Chỉ số Thông minh ở mức 48,09, Terminal-Bench 2.1 đạt 84,3%, GPQA Diamond đạt 93,5%, HLE đạt 48,7%, SciCode đạt 58,8% và khả năng ghi nhớ ngữ cảnh dài đạt 83%, với ngày phát hành là 2026-09-02, cửa sổ ngữ cảnh 1.000.000 token và được phân loại là độc quyền, trọng số đóng. Lưu ý rằng đây là một bản sửa đổi chỉ số trên một trang mô hình — AA công bố các chỉ số theo từng mô hình được sửa đổi theo lịch trình riêng của chúng, nên việc trộn một số liệu từ trang này với một số liệu từ trang của một mô hình khác sẽ không cho bạn phép so sánh cùng một ảnh chụp.

Điều mà không có gì trong số này mang lại cho bạn là một so sánh khớp cặp. Các dòng coding của AA vốn dĩ cắt ngang nhiều harness — Muse Code đối đầu với Codex, với Claude Code, với Grok Build, với Kimi Code CLI — nên việc đọc theo kiểu dòng-đối-dòng là đang so sánh một cặp harness-mô hình với một cặp harness-mô hình khác, chứ không phải hai mô hình dưới cùng một harness. Ở những nơi Meta chưa chạy so sánh khớp cặp và bảng của AA không được xây dựng để trả lời điều đó, lập trường trung thực là cuộc đối đầu trực diện ấy không tồn tại khi đã khớp về mức nỗ lực và harness, thay vì dựng ra một cuộc đối đầu như vậy từ những con số liền kề.

Những gì OrcaRouter định tuyến và những gì nó không

OrcaRouter là một điểm cuối duy nhất bao quát hơn 200 mô hình theo giá niêm yết của từng nhà cung cấp mà không cộng thêm bất kỳ khoản nào, nghĩa là câu trả lời về tính khả dụng cho dòng mô hình này có thể kiểm chứng được thay vì phụ thuộc vào chính sách. Đã đối chiếu với danh sách mô hình công khai hiện hành của chúng tôi hôm nay:

• meta/muse-code — không có trong danh mục. Muse Code là một harness, không phải mô hình có thể định tuyến, và chúng tôi không cung cấp nó

• meta/muse-spark-1.3 — không có trong danh mục

• meta/muse-spark-1.2 — có thể định tuyến, với cửa sổ ngữ cảnh 1.048.576 token và mức giá 1,25 USD cho mỗi triệu token đầu vào, 4,25 USD cho mỗi triệu token đầu ra và 0,15 USD cho mỗi triệu lượt đọc từ bộ nhớ đệm, đúng mức giá mà Meta công bố

• meta/muse-spark-1.1 — cũng có thể định tuyến, với cùng ba mức giá

Vậy hình dạng thực tế của việc này trên OrcaRouter là bạn có thể truy cập các thế hệ Muse Spark đã phát hành thông qua cùng endpoint mà bạn dùng cho mọi thứ khác, và bạn không thể truy cập Muse Code hoặc thế hệ 1.3 hiện tại thông qua đó. Hãy hiểu đó chỉ là mô tả về danh mục hiện tại mà thôi; tính khả dụng thay đổi và danh sách mô hình là nơi để kiểm tra điều đó.

A screenshot of the OrcaRouter model page for Meta: Muse Spark 1.2, showing the model slug meta/muse-spark-1.2, a 1,048,576-token context window, text, image, video, file and audio inputs with text output, pricing of $1.25 per million input tokens and $4.25 per million output tokens, and the OrcaRouter navigation in English.

Điểm mà một router thực sự phát huy giá trị cho một khối lượng công việc như thế này nằm ở hai thứ mà một gói đăng ký không thể mang lại cho bạn. Thứ nhất là một khóa API duy nhất đóng vai trò lớp định tuyến, lớp này tự động chuyển yêu cầu sang phương án dự phòng khi một nhà cung cấp gặp sự cố, điều này rất quan trọng khi một lượt chạy tác tử đã đi sâu hàng nghìn lệnh gọi công cụ và bạn không muốn đánh mất nó chỉ vì một dịch vụ thượng nguồn đang gặp trục trặc. Thứ hai là yêu cầu được mô tả thay vì mã hóa cứng — bạn có thể đặt Muse Spark 1.2 phía sau cùng một DSL định tuyến như bất kỳ mô hình nào khác và thay đổi thứ phục vụ nó mà không cần thay đổi phía máy khách của bạn.

Thường được hỏi

Model mặc định của CLI có phải là model hiện tại không? Không. Mặc định của Muse Code là muse-spark-1.2; thế hệ hiện tại là Muse Spark 1.3, được công bố vào ngày 2 tháng 9 năm 2026, và bạn truy cập nó bằng --model muse-spark-1.3 hoặc lệnh /models.

Cách diễn đạt nào đúng — "Muse Code 1.3" hay "Muse Spark 1.3"?Muse Spark 1.3. Các phiên bản Muse Code là các bản phát hành harness và bản hiện tại là 1.2.1; hai chuỗi đánh số này không liên quan đến nhau, đó chính là lý do truy vấn "muse code 1.3" trả về kết quả gây nhầm lẫn.

Nếu tôi chỉ cần đầu vào âm thanh, tôi nên cấu hình mô hình nào? Muse Spark 1.2. Chú thích của chính Meta cho biết khả năng hiểu âm thanh ở 1.3 chưa được hỗ trợ đầy đủ và có thể làm giảm chất lượng, đồng thời hướng dẫn các tác vụ âm thanh sang 1.2 hoặc Muse Voice Transcribe.

Gói Contributor có phải là gói miễn phí hay gói dùng thử không? Không, và đây cũng không phải là mức giảm giá mà bạn tự động được hưởng. Đây là một biến thể có giá thấp hơn ở mọi phiên bản Muse Spark từ 1.2 trở đi, đổi lại việc bạn cho phép huấn luyện trên prompt và kết quả trả lời của mình; thế hệ 1.1 không có biến thể Contributor.

Điểm mấu chốt

Muse Code là tác nhân lập trình trên terminal và CI của Meta, do Meta tạo ra cho các mô hình Muse Spark của mình, được bán dưới dạng ba gói hàng tháng với giá $5.00, $15.00 và $50.00, không có gói miễn phí, đi kèm mức giá Standard trả theo mức sử dụng là $1.25 cho đầu vào và $4.25 cho đầu ra trên mỗi triệu token, cùng mức Contributor là $0.10 và $0.20 cho cùng số token đó nếu bạn cho phép Meta huấn luyện trên chúng. Bản phát hành CLI hiện tại là 1.2.1, thế hệ mô hình hiện tại là Muse Spark 1.3, và CLI vẫn mặc định dùng Muse Spark 1.2 — hãy nêu rõ phiên bản và mức reasoning effort mỗi khi bạn trích dẫn điểm số, vì Muse Code chạy Muse Spark 1.3 ở max và ở xhigh không phải là cùng một phép đo, và tuyên bố hiệu quả nổi bật của nhà cung cấp là so sánh nội bộ chứ không phải kết quả độc lập.

Để có cái nhìn trực tiếp về chính harness, hãy xem bài hướng dẫn của chúng tôi về tác nhân lập trình trên terminal Muse Code.

So sánh trong bài viết này3

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày