
Muse Code vs Qoder Cantus: 価格リストを持つエージェント vs 乗数を持つモデル
- DeepSeekNEWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100万トークンあたり
- z-aiNEWZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianNEWQwen3.8 27B2026-08-1552知能68コーディング
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokNEWSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
6日違いで、2社が自律型コーディングエージェントの課金方法をめぐって正反対の賭けに出た。2026年8月1日、ハーフプライスキャンペーンはQoder Cantus(Alibabaの最上位コーディングモデルで、Qoderプラットフォーム内からのみアクセス可能)を対象としたもので、静かに失効し、その請求係数は1.6倍から3.2倍へと戻った。8月5日、MetaはMuse Code、動作基盤をMuse Spark 1.2とするターミナルコーディングエージェントを出荷した。これは、公開されたトークン単価と、現在のCantusの1ターンのコストのおおよそ100分の1に設定されたコントリビューターティアを備えている。この2つの製品のうち、一方はトークンのコストを正確に示す。もう一方は乗数を示し、メーターを信用するよう求める。
それが実際の比較であり、カテゴリ名が示唆するような比較ではない。その下にあるベンチマーク数値を伴うものはすべて、独立した測定が明示されている場合を除き、方法論を明記せずに公開されたMeta自身の発表チャートに由来している。Cantusについては、ラベル付けするものが何もない。Alibabaがベンチマークも、コンテキストウィンドウも、パラメータ数も、技術報告書も公開していないからだ——この事実は、見落としではなく構造的なものであることがわかる。
あなたは同じものを2つ比較しているわけではありません
Muse Code は、インストールするエージェントであり、レンタルするモデルです。1つのコマンドでバイナリがマシンに導入されます — curl -fsSL https://dev.meta.ai/install.sh | bash — そしてそこから、Meta Model API に対してトークン単位で課金されます。Muse Spark 1.2 もその API を通じて個別に販売されており、モデルとハーネスはそれぞれ独立して購入できる2つのものです。
Qoder Cantus は購入できる製品ではありません。ドロップダウンの1つの項目です。Qoder はこれを「内蔵のトップティア知的モデルであり、長時間の自律的タスク実行に優れる」と説明していますが、その一文が公式説明のすべてです。ローンチ告知はなく、7月19日に価格プロモーションがあっただけです。Cantus を使用するには、Qoder にサブスクライブし、Qoder を開き、モデル階層セレクターで Cantus を選択します。APIエンドポイントも、ダウンロード可能な重みも、既存ツールを接続する方法もありません。
その非対称性から生じる結果は、以降のすべてのセクションに及ぶため、この二つを率直に並べて示しておく価値がある:
• インストールするもの — Muse Code:ターミナルバイナリ。macOSとLinuxのみ、パブリックベータ。Qoder Cantus:インストールするものはありません。QoderデスクトップIDE、JetBrainsプラグイン、CLI、クラウドエージェント、モバイル/ウェブクライアント内の設定です。
• 対応オペレーティングシステム — Muse Code: macOS および Linux(ネイティブの Windows ビルドはなし)。Qoder: Windows、macOS、Linux(2026年5月15日の1.0リリース以降)。
• 課金単位 — Muse Code: 入力・キャッシュ入力・出力トークン。サブスクリプション不要、上限なし。Qoder Cantus: 月次プランのクレジットにモデルごとの係数を乗算し、プランに含まれる量を上限とする。
• ツール外部のモデル — Muse Spark 1.2: はい。パブリックプレビューのMeta Model APIを通じて可能です。Cantus: いいえ。設計上、不可です。
• 公開コンテキストウィンドウ — Muse Spark 1.2: 1,048,576トークン。Cantus: 非公開。Qoderのドキュメントには、選択するモデルに応じて200K、400K、1Mのオプションが記載されているが、Cantusについては数値が明記されていない。
• 公開済みベンチマーク — Muse Spark 1.2: 4つのボード、すべてMetaが実行。Cantus: 誰からもなし。
同じ通貨に換算された価格

Metaの料金は単純な算術で計算できます。標準ティアは、入力トークン100万件あたり1.25ドル、キャッシュ済み入力トークン100万件あたり0.15ドル、出力トークン100万件あたり4.25ドルです。コントリビューターティアは、Metaがセッションデータをモデル改善に使用することを許可するもので、それぞれ0.10ドル、0.002ドル、0.20ドルです。現実的なエージェントステップ(リポジトリコンテキストの入力60,000トークン、プラン・アンド・パッチの出力3,000トークン)を例にとると、標準ティアはコールド時で8.8セント、リポジトリコンテキストがキャッシュにヒットした場合は2.2セントかかります。コントリビューターティアは、コールド時で0.66セント、ウォーム時で0.072セントです。
Qoderの料金は換算が必要です。重要なプランでは、1クレジットは1セントに相当します。Proは2,000クレジットで20ドル、Ultraは20,000クレジットで200ドルで、どちらも正確に0.01ドルです。Qoderはタスクごとのクレジット見積もりを公開しています。200KのコンテキストでのEditorエージェントモードの1ターンは約12クレジット、Questエージェントモードのタスクは約50クレジット、ExpertsモードのQuestは約75クレジットです。また、それらを乗算する係数も別途公開しています。Cantusは3.2倍です。Qoderが計算例で示すことのないこれら2つの公開数値を組み合わせて読むと、CantusでのEditorエージェントの1ターンは約38クレジット、つまり38セントになります。Questタスクは約160クレジット、1.60ドルです。ExpertsモードのQuestは約2.40ドルです。
つまり、Cantusエージェントの1ターンは、コールドなMuse Codeステップの約4倍、キャッシュされたステップの約18倍、そしてコントリビューター層のステップの約58倍のコストがかかります。コンテキストサイズは同一ではありません——私たちのステップでは、Qoderの推定値は200Kとされ、Metaの60Kに対して示されています——また、Qoderはその表が提示価格ではなく統計的な推定であると明言しています。両方の注意点を大幅に考慮したとしても、その差が同等に近づくことはありません。
Cantus側をヘッドラインよりも悪くする詳細が2つある。1つ目は、割引がなくなったことだ。Cantusは「beyond Ultimate」を立ち上げた。これは、Qoderの従来の最上位ティアの1.6倍係数の2倍にあたる。7月19日〜31日のプロモーションでは、ちょうどUltimateレートで販売された。その期間は7月31日23:59に終了した。7月下旬にCantusを評価した人は誰でも、もはや存在しない価格を基準にしていたことになる。2つ目はオーバーフローだ。プランのクレジットを使い切ると、トップアップは1,500クレジットで20ドルかかる。これは1クレジットあたり0.0133ドルであり、0.01ドルではない。したがって、割り当てを超えると、Cantus Editorの1ターンは51セントを超える。
Qoderがその代わりに与えてくれるのは、上限(シーリング)だ。月20ドルは月20ドルであり、クレジットを使い切ればプラットフォームはベーシックモデルに切り替わり、請求は止まる。Muse Codeには上限がまったくない——Meta自身による24時間・1,000回のツール呼び出しのデモ実行でさえ、1ジョブあたり約88ドル分のスタンダード層トークンが必要になり、2回目を止める仕組みは製品内に何もない。予測可能な支出と安い支出は、レトリックではなく現実のトレードオフであり、小規模チームがこれまで上限付きの選択肢を選んできたのには、十分な理由がある。
これはまた、私たち自身のバイアスを隠すのではなく表明すべきセクションでもあります。OrcaRouterはマークアップ0%で請求し、プロバイダーのリスト価格をそのまま転嫁します。これは、信用係数というよりもMetaの公表料金にはるかに近い価格設定の哲学です。また、それが私たちがCantusの価格を提示できない理由でもあります——転嫁すべきリスト価格が存在せず、非公開のトークン数に適用される乗数があるだけだからです。
一方のベンダーは損失を公表した。もう一方は何も公表しなかった——いや、公表できないのだ。

メタの発表資料は、異例なほど自らに不利な内容だ。Terminal-Bench 2.1では、Claude Code上のClaude Opus 5が86.7%、Muse Code上のMuse Spark 1.2が82.9%、Codex上のGPT-5.6 Terraが81.8%、Grok 4.5が81.6%と報告している。DeepSWE 1.1では、Muse Spark 1.2が59.3%だったのに対し、Claude Opus 5は65.0%、GPT-5.6 Terraは64.8%だった。メタが自ら構築し管理する内部コーディングベンチマークでも、70.6%と、Claude Opus 5の79.4%に及ばない。メタが示すことを選んだすべてのリーダーボードで、自社のものを含めて2位か3位だ。また、独立系のArtificial Analysisによる測定では、Muse Spark 1.2はインテリジェンス・インデックスで54(Muse Spark 1.1は51)だったが、これはファーストトークンまでの時間が2.90秒に対して26.12秒という代償を払って得た数字だ — 現実の、外部検証済みの、そして不名誉な数字である。
それに対して、Cantusが提示するのは「トップクラス」という形容詞ひとつだけだ。ベンチマークはひとつもなく、独立した評価もなく、Artificial Analysisへの掲載もなく、LMArenaでの順位もなく、どのリーダーボードにも一行も載っていない。
重要なのは、これはQoderが来四半期に解消するドキュメントのバックログではないということだ。独立した評価にはプログラムによるアクセスが必要だが、CantusにはAPIがない。それを採点したい第三者は、デスクトップIDEを手動で操作するか、そのUIを自動化するしかない。しかもその相手となるモデルは、セッション間でその正体、バージョン、ルーティング動作が静かに変わってしまう可能性がある。Cantusは、出荷時のままだと、Alibabaの外部の誰にもベンチマークできない——そしてこれは一時的な状態ではなく、配布方法の選択に起因する恒久的な性質だ。
それは両刃の剣であり、正直な比較をするならば、そのことを明言しなければならない。負けたベンチマークデッキでも、デッキがまったくないよりは情報になる。しかし、Terminal-Bench での 82.9% という数字も、Muse Code があなたのモノレポを処理できるかどうかは教えてくれない。そして、多くのチームが、リーダーボードの順位が低いモデルの方がチケットを完了できるということを見出している。違いは、Muse Code ではそれを安価に、しかも元に戻せる形で確かめられるのに対し、Cantus で使える評価手段は20ドルのサブスクリプションと自分の目だけだということだ。
両者は長い仕事を乗り切ることに賭けている
価格とスコアを取り除けば、この2つの製品は驚くほど似た機構で同じワークロードを追いかけており、それがこの対決における最も興味深い収束である。
Muse Code の回答は、ローカルイベントログです。モデル呼び出し、ツール実行、承認、編集のすべてがディスクに追記されます。メタによれば、これによりセッションはリプレイ時に完全に一致し、再起動にも安全になります。プロセスがクラッシュしたり、マシンを失ったりしても、エージェントはコンテキストを再構築するのではなく、停止した場所から再開します。その上に、メタが「永続的な非同期バックグラウンドエージェント」と呼ぶものがあります。これは、サブタスクごとに生成・破棄されるのではなく、セッションをまたいで生存し、分離された git ワークツリーへと展開していくサブエージェントです。メタはこの仕組みにより、衝突なしに6つのゲーム機能を並行して構築したと述べています。それを裏付ける証拠は単一のケーススタディのみです。NVIDIA Hopper ハードウェア上で GPU カーネルを自律的に最適化する、1,000回以上のツール呼び出しを含む24時間の実行ですが、公表された高速化の数値はありません。そこで主張されているのは結果ではなく、実行時間なのです。
Qoderの答えはQuest Modeであり、その語彙も韻を踏んでいる。Questは、長時間実行される多段階の作業を引き渡すための専用ウィンドウであり、タスク追跡、成果物レビュー、チェックポイント、ローカルワークツリー実行を備えている。これはまさにCantusが売りにしているモード——「自律的な長時間タスク実行」——である。Qoderはまた、Metaには相当するものがないものをもたらす。それは、コードベースからRepo WikiとKnowledge Cardsを構築するKnowledge Engineであり、これによりエージェントは長いタスクを開始する際、リポジトリのコンテキストを再発見するのではなく、蓄積されたコンテキストを携えて臨める。これは同じ問題領域における真のアーキテクチャ上の違いであり、Qoderは5月の1.0以来、ずっとこれを出荷してきている。
どちらの主張も独立に検証されていません。MetaのイベントログはMetaの外部の誰によってもストレステストされておらず、Qoder's Questの結果は誰によっても測定されていません。長期にわたる信頼性が決め手となるなら、現在両ベンダーが求めているのは同じもの、すなわち信頼です。
スイッチングコストこそが、両者が真に分岐する点である。

Qoderのセレクターにあるモデルは、1つを除いてすべて離れることができます。Qwen3.7-Max、DeepSeek V4 Pro、GLM-5.2、Kimi-K2.7-Code、MiniMax-M3はすべて、それぞれの係数でそのドロップダウンに含まれており、これらはすべてQoderの外部にも存在します。自分のコードから呼び出し、互いに価格を比較し、プロンプトを持ち出すこともできます。Cantusは、そのリストの中で唯一の一方通行のドアです。それを中心にチームのワークフローを構築すると、撤退コストは設定変更ではありません。あなたが標準化したモデルを実行できる他の製品が存在しない、という発見なのです。
Muse Code は中途半端な立場にある。このモデルは移植可能であり、Muse Spark 1.2 は Meta Model API 上にあり、カスタムエンドポイントを受け入れるものであれば誰でも呼び出せる。しかし、プロバイダーはちょうど一つしかないため、構造的に単一障害点となっている。そして、その82.9%はモデルに帰属する。そのモデルは内部に存在し、Muse Code にある。Meta の見出しとなる主張は、これら二つが「外部モデルの汎用ラッパーよりも優れたツール使用、より少ない再試行、より高品質な出力」のために共同トレーニングされたというものだ。もしそれが本当なら、自分のハーネスから Muse Spark 1.2 を呼び出しても、モデル半分は得られるが、調整された半分は得られない。Meta の外では、誰も競合ハーネスでそれをテストして、スコアのうちどれだけがエージェントによるものかを確かめていない。
ここで提供できる内容を正確に述べます。Muse Spark 1.2 は Meta が直接提供しており、OrcaRouter のカタログには含まれていません。また、Cantus はどのカタログにも含めることはできません。Muse Spark 1.1 は当社で取り扱っており、価格は $1.25 と $4.25 です。これは Meta の定価とまったく同じです。当社はマークアップを 0% とし、プロバイダーの価格をそのままパススルーしているためです。そのため、ベンダーによる価格変更は、発生した当日に当社側にも反映されます。1.1 の本番テレメトリによると、time-to-first-token の p50 は 1.84 秒、p95 は 6.00 秒です。これは、チャット型ワークロードにとって、どのベンチマークハーネスが示す値よりも実用的なレイテンシーの期待値です。
より広い論点は、抽象化をどこに置くかということです。エージェントハーネスが、多数のモデルを束ねる単一のエンドポイントと通信し、プロバイダ間で自動フェイルオーバーを行うのであれば、コーディングエージェントの立ち上げは文字列の変更に過ぎず、ベンダーの障害は他人の問題です。ハーネスがベンダーのIDEであるなら、それらの決定はすべてベンダーのものになります。Qoder独自のAuto tierは、モデルルーティングを内部で行い、約1.0xクレジットで、タスクごとに最も安価で受け入れ可能なモデルを選択します——これは、私たちがインフラストラクチャとして販売しているのと同じアイデアですが、ハンドルを握る者が誰かという決定的な違いがあります。
コードの置き場所
Metaはこの点を明確に述べており、オファーが強気ではあるものの、その点は評価に値する。コントリビューターティアは、入力が12.5倍安く、出力が21倍安く、キャッシュ入力が75倍安い。その見返りとして、Metaがモデル改善のためにデータを使用することが許可される。ターミナルコーディングエージェントのプロンプトは、あなたのソースコードであり、社内APIであり、回避策が存在する理由を説明するコメントであり、テストフィクスチャに含まれるものすべてである。Metaは、スタンダードティアのプロンプトは製品改善に使用されないと述べている。それが、専有情報を扱うためのティアである。この選択は、課金上の好みではなく、割引が付いたデータ取り扱いの決定として捉え、黙ってダウングレードする動機がトークン支出に正確に比例して大きくなることに留意されたい。
Qoderは公開ドキュメントにおいて、Cantusレートに同等の条件を一切付していない。その割引はデータ量ではなく期間に限定されたものであり、トレーニング権利と引き換えに低価格を実現するようなプランも存在しない。その代わりにあなたが受け入れているのは、Alibaba Cloudがホストする出自不明のクローズドモデルがリポジトリを処理することであり、しかもそのセキュリティ体制は誰でも検証できるベンチマークではなく、Qoder自身のドキュメントに記載されているにすぎない。データの保存場所に関する要件があるチームにとって、これはエンジニアリングの問題である以前に調達の問題であり、Metaの方針とは正反対の方向を指している。Metaは何が必要かを正確に説明した上で、その分安く請求する。一方Qoderは明確な立場を取らず、いずれにせよ割引も提供しない。
この比較が実際に提起する問い
現実的なボリュームで、開発者1人にとってどちらが安いですか?
それは完全に、プランの上限に達するかどうかにかかっています。Qoder Proは2,000クレジットで20ドルですが、これは3.2倍のCantus係数に基づくと、200Kのコンテキストで約52回のEditorエージェントターン、または約12件のQuestタスクに相当します。また、その20ドルにはIDE、リポジトリインデックス、Repo Wiki、そしてセレクター内の他のすべてのモデルも含まれます。同じ20ドルでMuse Codeのスタンダード層トークンを購入すると、約228回のコールドステップまたは900回のキャッシュ済みステップが得られ、コントリビューター層では約3,000ステップですが、ツールは一切付いてきません。IDEを重視するライトユーザーはQoderの方が有利です。一方、2,000クレジットを使い切るほどエージェントを酷使するユーザーは、20ドルで1,500クレジットのトップアップを33%悪いレートで購入することになり、Metaの限界トークン価格は横ばいのままです。
正式に決定する前に、それらを互いに適切に評価できますか?
対称的ではありません。そして、これが実用上の罠です。Muse Code は使い捨てクローンで数ドルかけてテストできます。また Muse Spark 1.2 は既存のハーネスに差し替えて、モデルをエージェントから分離できます。Cantus は Qoder に登録し、その中で作業することでのみテストできます。つまり、IDE、コンテキストエンジン、Quest Mode、モデルをひとつの束として評価しており、その結果をどこかに帰属させる方法がないのです。Cantus の性能が良くても、どの部分がその成果をもたらしたのかはわかりません。悪ければ、どの部分のせいにすればいいのかもわかりません。
今日、どちらかをプロプライエタリなリポジトリに向けても安全ですか?
{{1}}Muse Codeを標準ティアで利用する件については、Metaが明示した条件に基づき同意する{{/1}}——{{2}}ただし、これは公開から1日しか経っていない公開ベータであり、クラッシュ安全性の保証をMeta社外の誰も検証していないという留保付きである{{/2}}。{{3}}Muse Codeをコントリビューターティアで利用する件については、データ取り扱いを承認する担当者が先に利用条件を確認しない限り、承諾できない{{/3}}。{{4}}Qoder Cantusは、目新しい判断というよりは通常の商用IDEの選択としての判断である{{/4}}が、{{5}}それは公開された出自情報のないクローズドモデルであり、Alibaba Cloud上で動作している{{/5}}ため、ソースコードの送信先がどこまで許容されるかという同じ議論に属する。
誰がどれを選ぶべきか
Muse Codeを選ぶのは、あなたの作業が長期間にわたりヘッドレスである場合です。つまり、移行、モノレポ全体にわたる依存関係のアップグレード、カーネルやビルドシステムの作業など、本来ならあなたが監視しなければならないようなものです。また、macOSまたはLinuxでターミナル環境に住んでいる場合も同様です。その価格はインフラストラクチャ並みで、モデルはポータブル、障害モードはあなたが所有するイベントログで確認でき、コントリビューター向けの料金なら試すコストはほぼゼロです。ベータ版であること、独自のベンダーが選んだすべてのボードで負けたこと、そしてWindowsがサポートされていないことを受け入れてください。
本当に欲しいのがIDEそのものであるなら、Qoder Cantusを選びましょう。リポジトリ知識エンジン、Quest Mode、JetBrains統合、クラウドエージェント、Windowsビルドは、Muse Codeがどんな価格でも提供しない真の利点です。また、従量課金に驚かされた経験のある小規模チームにとって、月額上限のある請求は価値があります。以下の3点を理解した上で導入してください。モデルはベンチマーク未実施かつ外部からのベンチマークも不可能であること、50%のローンチ割引は7月31日に終了したため現在の価格は初期評価者が支払った額の2倍であること、そしてチームの業務の中核となった場合に撤退経路がないことです。
この分析を変え得るものは、極めて限定的かつ具体的なものだけだ。もしQoderがCantus APIを公開するか、あるいは第三者が何とかしてそれに実数を当てはめることができれば、これは測定された製品と形容詞との比較ではなくなる。それまでの間、Muse Codeの最も強い論拠は、ベンチマークスコア(それでは負けている)ではなく、スコアが存在すること自体、公開された価格表、そして出口があることだ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
