
Claude Fable 5.1 vs GLM-5.2:インデックスの頂点をレンタルするか、最後のオープンフラッグシップを所有するか
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240知能72コーディング
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0340知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2134知能69コーディング
クローズドとオープンの比較で本当に問われているのは、「どちらのモデルが高いスコアを出すか」ではない——自分が構築の土台としているものを支配しているのが誰か、ということだ。Anthropic が2026年9月1日にリリースした旗艦モデル Claude Fable 5.1 は、Artificial Analysis Intelligence Index で現在トップの66を記録しているが、利用できるのはレンタルのみ。重みは非公開、API も非公開、安全性も価格設定も Anthropic が管理している。一方、Zhipu が2026年6月16日にリリースし、Hugging Face で MIT ライセンスの重みを公開している GLM-5.2 は、実際に所有できる最強のモデルだ。ファイルをダウンロードし、自前のGPUで実行し、ファインチューニングし、自社のファイアウォールの内側に置けば、ベンダーの料金表を二度と気にする必要はない。この比較における他のすべての要素——15ポイントの天井の差、7倍の価格差、マルチモーダル対応の差——は、その唯一の契約上の事実の下にある細部にすぎない。
ライセンスは仕様です
まず、各モデルで何ができるかに注目しましょう。それが他のすべての数値の前提となるからです。GLM-5.2のウェイトはMITライセンスで提供されており、これはオープンウェイトのスペクトラムの中でも最も寛容な側に位置します。商用利用の制限はなく、改変の制限もなく、変更を共有する義務もありません。これは約7,530億パラメータの混合エキスパート(MoE)モデルで、アクティブなパラメータは約400億です。実際には、これは大掛かりだが範囲が定められたインフラ投資を意味します — BF16で約1.5TB、マルチGPUノードで実行可能です。また、Zhipu自身のAPIやOrcaRouterでホステッド版を呼び出すだけで、ハードウェアを完全に省略することもできます。
Claude Fable 5.1は、そうしたものを一切提供しない。これは安全対策を備えたサービスである——Anthropicはこれを、Mythosクラスのウェイトを広く利用可能なかたちで提供する顔として出荷している。これは、審査済みのサイバーおよびライフサイエンス組織向けにゲート付きで提供されるClaude Mythos 5.1を支えるのと同じ基盤モデルである。能力と安全対策、そして継続的な改善を得られる一方で、ファイルを手放すことになる。素早く動きたいスタートアップにとって、そのトレードオフは問題ない。銀行、防衛関連企業、あるいは自社のVPCの外にデータを出せないあらゆる組織にとって、クローズドな選択肢は、ベンチマークが議論される以前に除外され得る。
測定された能力ギャップ
独立した指標では、その差は明白です。Claude Fable 5.1 は66(最大努力時)でリード——これは Artificial Analysis が記録した最高スコア——一方、GLM-5.2 は51で、リリース時点で最高のオープンウェイトモデルとなりました。AA のデフォルト設定では差は縮まり、Claude Fable 5.1 のデフォルト・フォールバック設定は53、GLM-5.2 は51と記載されています。つまり、正直な評価としては、天井の差は大きく、実際に提供される性能の差は小さいということです。Anthropic が報告したエージェントベンチマークでは、その差は別次元に広がります。Terminal-Bench-Science 0.1 での52.6%と Terminal-Bench 4.0 での55.8%は、現在どのオープンウェイトモデルも近づいていない数値です。
GLM-5.2の本当の強みは、より狭く、しかし現実的です。これは、主要なデザイン・フロントエンドアリーナで首位を獲得した初のオープンウェイトモデルであり、Design Arenaで1,360 Eloを記録してClaude Fable 5を僅差で上回りました。これはベンダー主導のアリーナ結果ではありますが、オープンモデルがほとんど上位に来ない分野における具体的な成果です。ZhipuはSWE-bench Proで62.1を報告しており、これはリリース時点でオープンウェイトモデルの中で最高のスコアです。また、GLM-5.2は日常的なコーディングや構造化生成でも健闘しています。正直な要約としては、GLM-5.2は非常に強力なオープンウェイトのコーディング・生成モデルであり、従来のClaude世代との差の大部分を埋めたものの、最も難しい推論や長期的なエージェントワークの分野では、Claude Fable 5.1が一段上であるということです。
スペックシートを並べて表示
• 価格 — Claude Fable 5.1 は 1M あたり $10.00 / $50.00、Z.AI 上の GLM-5.2 は 1M あたり $1.40 / $4.40(キャッシュ読み出し $0.26)。入力は約7倍、出力は約11倍安い。
• ライセンス — Claude Fable 5.1 はクローズド、APIのみ。GLM-5.2 はHugging Face上でMITオープンウェイト、セルフホスト可能。
• 規模 — Claude Fable 5.1は重み非公開 vs GLM-5.2は合計753B / アクティブMoE約40B、BF16で約1.5TB。
• コンテキスト / 最大出力 — 1Mトークンのコンテキストと約128Kの最大出力の両方。
• 入力 — Claude Fable 5.1 はテキストと画像を受け付け、GLM-5.2 はテキストのみです。
• 独立スコア — AA Intelligence Index で Claude Fable 5.1 は最大値の66、一方 GLM-5.2 はリリース時点でのオープンウェイト最高スコアとなる51。


それぞれの選択に隠された本当のコスト
月額請求の例で、賃貸と所有のトレードオフが具体的になります。月に1億トークンの入力と2000万トークンの出力を考えましょう。これは多忙なコーディング作業量であり、特別なものではありません。Claude Fable 5.1の定価では、入力が1,000ドル、出力が1,000ドルで、合計2,000ドルです。GLM-5.2のホステッド料金では、入力が140ドル、出力が88ドルで、約228ドルです。同じトークン量で約9倍の差があり、どちら側でもキャッシュ割引は考慮していません。これを1年分に換算すると、その差額で多くのインフラストラクチャを賄えます。
モデルを所有すると、見えるコストが変わるだけで、コストそのものが消えるわけではない。セルフホストのGLM-5.2は、トークン単位の課金をGPU、電力、推論チームに置き換える。この規模のモデルでは、ハードウェアの出費は確かに現実のものだ。だがそれは償却される固定費であり、使用量に応じて直線的に増えるものではなく、さらにAPIには決してかなわないデータ管理が付いてくる。この2つの選択肢は「高いAnthropicか、安いZhipuか」という話ではない。値札を付けたオペックス(運用費)の決断であり、キャペックス(設備投資)の決断なのである。
オープンな選択肢が本当に勝つとき
ボリュームが多く、タスクが十分に理解されている場合、GLM-5.2を選びましょう。大規模なコーディング支援、構造化抽出、生成パイプラインなど、モデルが「考える者」ではなく「働き手」として機能する場面です。データ主権の観点からAPIの使用が完全に除外される場合、専有コードでファインチューニングする必要がある場合、またはベンダーに取り消されることのない重みを持つモデルが必要な場合にも選びましょう。デザインアリーナの結果は、特定の明確に定義された分野では、オープンモデルが完全にリードできることを思い出させてくれます。そしてMITライセンスは、あなたが見つけたどんな優位性もあなたのものとして保持できることを意味します。
そうでないとき
タスクが推論の上限に達している場合——自律的研究、長期的な視野を持つエージェント、途中で諦めるモデルだと実行全体が失敗するような仕事——や、GLM-5.2が対応していない画像入力が必要な場合は、Claude Fable 5.1を選んでください。また、フラッグシップを積極的に改善しているベンダーの安全性の枠組みとアップグレードのペースを求める場合や、GPUを運用するよりもトークン単位で支払いたい場合にも、Claude Fable 5.1を選んでください。確信が持てない場合でも、ルーティングパターンが、恒久的な選択をせずに問題を解決してくれます:GLM-5.2とClaude Fable 5.1はどちらもOrcaRouter上でプロバイダーのリスト価格のまま、マークアップゼロで利用できるので、大量のワークロードはGLM-5.2に送り、難しいタスクはClaude Fable 5.1にエスカレーションし、評価結果に応じて分割を調整できます。また、後でトラフィック量がハードウェアの導入を正当化するようになった場合に備えて、GLM-5.2をセルフホストする選択肢も維持できます。

この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
