Claude Opus 5: Fable 5の半額で利用できるAnthropicの準フロンティアモデル
Guides & Insights

Claude Opus 5: Fable 5の半額で利用できるAnthropicの準フロンティアモデル

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

2026年7月24日、Anthropicはリリースしました Claude Opus 5 — そして1日も経たないうちに、この「より安価な」モデルとしては珍しいことを成し遂げました。つまり、独立系リーダーボードのトップに立ったのです。AnthropicはOpus 5を、フロンティア知能のClaude Fable 5の半額で提供し、同日にClaude.ai、Claude API、Claude Code、Claude Coworkでローンチされました。それ以来、Artificial AnalysisはIntelligence Indexで第1位のモデルとして評価しています。このガイドでは、Opus 5が実際に何なのか、独立に検証された情報とベンダー報告の違い、新しいエフォートダイヤルと安全性の姿勢、実際のコスト、そして誰が切り替えるべきかをカバーしています。

以下の各数値は出典元が明記されています。このスピードでは状況が日々変わるためです。発売日に「独立したスコアはまだありません」と書かれていたものが、今では「独立して第1位」となっています。ベンチマークや価格は変動します——予算を確定する前に必ず確認してください。

TL;DR. クロード・オーパス5の価格は、入力100万トークンあたり5ドル、出力100万トークンあたり25ドルであり、これはOpus 4.8と同一で、ファブル5の10ドル/50ドルのちょうど半分です。人工分析知能指数では、現在61(最大努力)でトップ、評価された170モデルの中で最高であり、ファブル5(60)をわずかに上回り、コスト半分でそのクラスに匹敵します。Anthropic自身のローンチベンチマークもこれを裏付けています: Frontier-Bench v0.1 43.3%(ファブル5の33.7%に対して)、さらにZapierのAutomationBenchとOSWorld 2.0コンピューターユースベンチマークでリードしています。2つの点で、これは単なる値下げ以上のものです: リクエストごとにコストと能力をトレードオフする努力ダイヤル(低/中/高/最大)、そしてこれまでのOpusの中で最も強力な安全性体制です。既にClaude上で構築している場合、アップグレードはリスクが低く、請求額も上がりません; フラッグシップモデルを選ぶ場合、Opus 5は今や価値と品質のリーダーです — 自分のワークロードで検証してください。

重要なポイント

• 現在、独立して#1。Artificial Analysisは、Claude Opus 5(max effort)をIntelligence Indexで61と評価しています — トップランクのモデルで、Fable 5(60)を上回っています。

• Fable 5の半額。1Mトークンあたり$5/$25、Opus 4.8と同じでFable 5の$10/$50の半額 — ミッドティアの価格でフロンティアをリードする品質。

• 新しい努力ダイヤル。低/中/高/最大の設定では、トークン(コスト)を能力と交換します。「最大」はリーダーボードのトップになりますが、より安い設定でもほとんどのライバルに勝ります。

• エージェントとコンピュータ利用向けに構築されています。Anthropicは、単一の回答だけでなく、マルチステップのタスク(AutomationBench)の完了や実際のUI操作(OSWorld 2.0)を重視しています。

• これまでで最も安全なOpusです。Anthropicはこれを「最も整合性の高いOpusモデル」と呼び、そのサイバー分類器がFable 5よりも約85%少ない頻度で介入することを期待しています——正当な作業に対する誤った拒否が減少します。

• 幅広く即座に利用可能。Claude Maxではデフォルトモデル、Claude Proでは最強のモデルとして提供され、API、Claude Code、Claude Coworkでも初日から利用できます。

この概要を読む際の注意事項:Anthropicに帰属するものはすべて、ローンチ資料からのベンダーの主張です。独立した数値(インテリジェンス・インデックス)はArtificial Analysisに帰属します。まだ公表されていない数値(別のSWE-bench Verifiedスコア)については、推測ではなくその旨を明記します。

Claude Opus 5 の正体

Opus 5は、AnthropicのOpusラインの最新メンバーです。SonnetやHaikuよりも上位に位置する「ヘビー」層です。Opus 4.8よりも上の階層に位置し、独立したIntelligence Indexでは、Anthropicの2026年6月のフロンティア旗艦モデルであるFable 5をわずかに上回っています。注目すべき点は、控えめな能力向上ではなく、その組み合わせにあります。すなわち、トップクラスに近い知能を、実用的な価格で提供することです。Anthropicはこれを「思慮深く、プロアクティブな」モデルと表現し、コーディング、エージェント型ワークフロー、そして日常のエンタープライズオフィス業務を対象としています。

具体的には、Opus 5は入力100万トークンあたり5ドル、出力100万トークンあたり25ドルです。これはOpus 4.8と同じ価格であり、Fable 5の10ドル/50ドルの半額です。Claude Maxではデフォルトのモデルであり、Claude Proでは最も強力なオプションです。また、リリース日からClaude API、Claude Code(コーディング用)、Claude Cowork(協調エージェント作業用)を通じて利用可能です。コンテキストウィンドウはOpusファミリーの100万トークンクラスです。

実際に何が新しいのか

発売日における最も明確な指標は、AnthropicのFrontier-Bench v0.1でした。これは困難な推論とタスクのスイートで、Opus 5が43.3%、Fable 5が33.7%、Opus 4.8が18.7%のスコアを記録しました。そのベンチマークでは、Anthropicのより安価な新モデルが、自社のより高価なフラッグシップを上回りました。この主張はその後、独立した評価によっても裏付けられています。

「実際の業務向け」というストーリーを補完する、さらに2つのベンダーベンチマークがあります。モデルがビジネスタスクを単に開始するだけでなく、完了まで実行できるかどうかを測定するZapierのAutomationBenchでは、Anthropicによると、Opus 5の合格率は同じコストで次点のモデルの約1.5倍であり、最も低コストの設定でも全競合の最高結果を上回るとのことです。コンピュータ使用のベンチマークであるOSWorld 2.0では、AnthropicはOpus 5があらゆる価格帯で競合を凌駕し、Fable 5のピークスコアを約3分の1の予算でクリアしたと報告しています。またOpus 5は、Anthropicが追跡するすべてのライフサイエンス評価においてOpus 4.8から改善しており、有機化学のタスク(分光データからの分子構造読み取りなど)で最大の改善(10パーセントポイント以上)を示しています。

努力のダイヤル:必要な機能にのみ支払う

注目の機能 — そしてほとんどのレビュアーが注目する点 — は努力設定です。Opus 5 では、モデルがリクエストに費やす努力の度合いを低、中、高、最大から選択できます。努力が高いほど、内部推論トークンが増え(そのためコストとレイテンシが高くなり)、品質も向上します。努力が低いほど、トークンを節約してより速く安価な回答が得られます。これは事実上、AI 費用のダイヤルです。

これは、Artificial Analysis が Opus 5 のエントリを複数(medium、high、xhigh、max)掲載している理由です。各努力レベルは、コストと品質の曲線上の異なる点です。「max」設定は現在 Intelligence Index でスコア61のトップに位置しています。低い設定は品質を少し犠牲にしてタスクあたりのコストを大幅に下げており、それらでさえ、Anthropic によれば、ほとんどの競合の最高の結果を上回ります。実際には、これは1つのモデルで、レイテンシーが重要で大量の呼び出し(low/medium)と最も難しい推論ジョブ(high/max)の両方に対応できることを意味します。モデルを切り替えるのではなく、リクエストごとにチューニングします。

ベンチマークの深掘り:これらのテストが実際に測定するもの

各数値の意味を理解してから信頼することが重要です。その Artificial Analysis Intelligence Indexは、第三者によって実施された多くの独立した評価(推論、数学、コーディング、知識)を合成した指標です。Opus 5が170モデル中1位となったスコア61は、ここで最も信頼できる単一のシグナルであり、それはまさにAnthropicがそれを実施しなかったからです。 Frontier-Bench v0.1(Opus 5で43.3%)はAnthropic自身のハードセットであり、Opus 5がFable 5(33.7%)やOpus 4.8(18.7%)よりも難しい問題を解決できることを示す相対的なシグナルであって、学校の意味で「43%正解」というわけではありません。

AutomationBenchOSWorld 2.0は、エージェントのユースケースにおいては、単一の推論スコアよりも重要です。AutomationBenchはタスク完了を重視します——メールの下書きを作成するエージェントと実際に経費報告書を提出するエージェントの違いです——そしてOSWorld 2.0は実際のコンピュータUIの操作を重視します。Anthropicが、Opus 5はFable 5のOSWorldピークを3分の1のコストで達成すると主張していることは、Intelligence Indexがその全般的な地位を裏付けた今、エージェントワークロードをOpus 5に移行する強力な根拠となります。唯一のギャップは、Opus 5の独立して監査されたSWE-bench Verifiedの数値がまだ存在しないことです(Fable 5は95.0%、Opus 4.8は88.6%)。したがって、純粋なコーディング精度の引用としては、その数値を待つべきです。

実際のコスト

トークン単位の価格は抽象的ですが、タスク単位が実際の請求額になります。20,000入力トークンと3,000出力トークンからなる代表的なエージェントのステップを考えます。Opus 5(およびOpus 4.8):入力20k × $5/1M = $0.10、出力3k × $25/1M = $0.075、つまり1コールあたり約$0.175。Fable 5は$10 / $50:入力$0.20 + 出力$0.15 = 約$0.35 — ほぼ倍です。月に10万コールの場合、Opus 5では約$17,500、Fable 5では約$35,000になります。Intelligence IndexがOpus 5をFable 5より上位に位置づけている今、これは「Fable 5に近い性能をより安く」ではなく、月額請求額が約半分でトップクラスの品質を提供しているのです。

努力度ダイヤルによって計算が再び変わります。大量のサポートパイプラインでは、ほとんどのコールを低または中程度の努力度で処理し(上記の数字よりも低コスト)、真に困難なチケットのごく一部に最大努力度を確保できます。Anthropicの枠組みでは、安価な設定でも競合の最高設定に勝るため、使用しない機能に対してお金を払うことはほとんどありません。すべてのコールが最大努力度で実行されると仮定するのではなく、独自の努力度レベルの組み合わせをモデル化してください。

Claude Opus 5 へのアクセスと使用方法

Opus 5は、Claude.ai(Maxプランではデフォルト、Proでは最強オプション)、Claude API(AnthropicのドキュメントにモデルIDあり)、Claude Code(ターミナルおよびIDEでのコーディング用)、Claude Cowork(コラボレーションによるマルチステップのエージェントワーク用)の5つの場所で即座に利用可能です。APIユーザーは努力レベルをパラメータとして設定するため、リクエストごとにコストと能力のトレードオフをプログラム可能です。すでにOpus 4.8を呼び出している場合、切り替えは同じ価格でモデルIDを変更するだけです。これはAnthropicがしばらくぶりに出した中で最も摩擦の少ないアップグレードです。

対象:3つのシナリオ

エージェンティックおよびコンピュータ使用パイプライン

製品がマルチステップエージェントを実行するか、ブラウザやデスクトップを操作する場合、Opus 5のAutomationBenchとOSWorld 2.0の結果はまさにあなたに向けられています。今や独立した#1インテリジェンスインデックスに裏付けられています。ほとんどのステップは中程度の労力で実行し、難しいものは高/最大にエスカレーションしてください。コミットする前に、自身のエージェントトレースでテストしてください。

2. 予算を監視するコーディングチーム

Opus 5は、初日からClaude Codeに搭載されており、価格はOpus 4.8のままです。Intelligence Indexでリードしているため、強力なデフォルトコーダーとなっています。唯一不足しているのは、独立したSWE-bench Verifiedのスコアです(Fable 5が95.0%でその記録を保持しています)。すでにClaudeを利用しているチームにとって、このアップグレードはリスクが低く、価格の上昇もありません。

3. 企業が1つのモデルに標準化する

幅広い可用性、100万クラスのコンテキスト、最も安全なOpusアライメントプロファイル、そして安価なバルク作業と高度な推論の両方をカバーする努力調整ダイヤルにより、Opus 5は混在するオフィスおよびエンジニアリング作業のための単一のデフォルトとして妥当です。そのコストはフロンティアのフラッグシップよりもはるかに擁護しやすいものです。

安全性とアライメント

AnthropicはOpus 5をこれまでで最も安全なOpusリリースと位置づけています:「最も整合性の取れたOpusモデル」、「悪用に騙されにくいモデル」です。実際の導入において重要なのは、AnthropicはOpus 5のサイバー分類器がFable 5のものより約85%少ない介入になると見込んでいることです。平たく言えば、これは正当なセキュリティ、コーディング、研究作業に対する誤った拒否が少なくなるはずであり、これは厳重にガードレールが施されたフロンティアモデルによくある不満ですが、同時に実際の悪用は阻止し続けます。いつものように、その姿勢を鵜呑みにせず、自社のコンテンツとコンプライアンス要件に照らして検証してください。

Fable 5の輸出管理ストーリーは、現在システムプロンプトに含まれています。

Fable 5のローンチは決してスムーズではなかった。そして、その状況は、比較する人にとっては、Claude Opus 5をそれと比較する場合に重要です。その3日後に、Claude Fable 5とClaude Mythos 5が2026年6月9日にリリースされた後、Anthropicは米国商務省の輸出管理命令に従うため、両モデルの提供を一時停止しました。規制は6月30日に解除され、アクセスは7月1日に復旧しました。この一連の経緯は記録された歴史であり、サイモン・ウィリソンはAnthropic APIがリアルタイムでエラーを返し始めるのを目撃しました。また、Anthropicも停止と復旧についての声明を発表しました。

新たな点は、Opus 5がそれに関する質問にどのように対処するかだ。このモデルのトレーニングデータの基準日は2026年5月であり、したがって停止とその撤回はモデルが学習した範囲外にある。およそ20万文字のClaude Opus 5システムプロンプトは、レッドチーマーのPliny the Liberatorが7月25日に公開したもので、Anthropicが本番環境と一致することを確認していない文書だが、完全なタイムラインを記録し、モデルに停止に関する質問には否定せず率直に答えるよう指示し、現在のステータスを確認できない場合はAnthropicの公式声明を参照するようユーザーを導いている。これは、モデルが自社について即興で答えないように、ベンダーがトレーニング基準日以降の履歴をプロンプトに書き込む具体的な例である。

使用すべきでない場合

Opus 5に手を伸ばさないでください。今日、独立監査済みのSWE-bench Verifiedコーディング番号を引用する必要がある場合は特にそうです。その数字はまだ公開されておらず、Fable 5 (95.0%)が依然としてそれを保持しています。すべての努力設定が#1であると想定しないでください。リーダーボードトップの61が最大設定であり、低い設定は品質とコストの一部をトレードオフするため、実際に実行する努力レベルをベンチマークしてください。そして、純粋な大容量、レイテンシに敏感なテキストで推論の必要がない場合、より安価な効率層モデル(例えばGemini 3.6 Flashの$1.50 / $7.50)は、トークンあたりのコストが依然として安くなります — Opus 5は推論・エージェントモデルであり、バルクテキスト向けではありません。

よくある質問

Claude Opus 5の料金はいくらですか?

入力トークン100万トークンあたり5ドル、出力トークン100万トークンあたり25ドル — Opus 4.8と同じで、Fable 5の10ドル/50ドルの半分です。[Anthropic]

Opus 5は本当にNo.1モデルですか?

Artificial Analysis Intelligence Indexでは、本記事執筆時点では、Claude Opus 5 (max effort)が170モデル中61モデルでトップに立ち、Fable 5 (60)を上回っています。これは独立したスコアであり、ベンダーの主張ではありません。他のリーダーボードやご自身のワークロードでは異なる順位になる可能性があり、新しいモデルが追加されるにつれて順位は変化します。

エフォートダイヤルとは何ですか?

リクエストごとの設定(低/中/高/最大)で、トークン、つまりコストとレイテンシを能力と引き換えます。最大がトップですが、より安価な設定でもAnthropicによるとほとんどの競合に勝ります。APIユーザーはそれをパラメータとして設定します。

Opus 5 は Fable 5 より優れていますか?

独立したインテリジェンス指数(61対60)とAnthropicのFrontier-Bench v0.1(43.3%対33.7%)では、はい — 半分の価格で。Fable 5は独立して測定されたSWE-bench Verified(95.0%)で依然としてリードしており、純粋なコーディング精度の引用としてはFable 5がその特定の王冠を保持しています。

Opus 5はOpus 4.8と比べてどうですか?

同じ$5/$25の価格で、ベンダーベンチマーク(Frontier-Bench v0.1 43.3% vs 18.7%)が大幅に向上し、追跡されているすべてのライフサイエンス評価で改善が見られ、加えて新たな努力ダイヤルとより安全なアライメントを実現。既存の4.8ユーザーにとっては、値上げなしの無料アップグレードです。

どのくらい安全ですか?

Anthropicはこれを最も調整されたOpusモデルであり、最も悪用されにくいモデルと呼び、そのサイバー分類器がFable 5のものよりも約85%少ない頻度で介入することを期待している—通常、正当な作業に対する誤った拒否が少ない。

Claude Opus 5はどこで使えますか?

Claude.ai(Maxでは標準、Proでは最強)、Claude API、Claude Code、Claude Cowork — 2026年7月24日から提供中。

コンテキストウィンドウとは?

Opusファミリーの1Mトークンクラス(Opus 4.8は1Mで、ロングコンテキストの追加料金なし)。AnthropicはOpus 5の数値を別途公表していないため、確認されるまでは1Mクラスとして扱うこと。

画像や動画に対応していますか?

Opus 5は主にテキストとツールの推論モデルです。重いマルチモーダル(画像/動画)理解には、例えばGemini 3.1 Proが専用に作られています。Opus 5はテキスト、コード、エージェントに使用してください。

結論

Claude Opus 5は、単なる値下げ以上のものだったことが判明しました。価格設定は実用的な作業馬のようなもので、$5/$25、Fable 5の半分でOpus 4.8と同じです。しかし、独立したArtificial Analysis Intelligence Indexで61(最大努力)を記録し、強力なベンダーベンチマーク(Frontier-Bench v0.1 43.3%、AutomationBench、OSWorld 2.0)、真に有用な努力ダイアル、そしてOpusの中で最も安全なアライメントプロファイルに支えられています。唯一の注意点は、独立したSWE-bench Verifiedの数値がまだ欠けていることで、そこではFable 5(95.0%)がコーディング精度の引用を維持しています。既存のClaudeユーザーにとってアップグレードはリスクが低く、請求額も上がりません。他のすべての人にとって、Opus 5は今や品質対コストで打ち負かすべきモデルです。自分のワークロードで検証し、OrcaRouterの1つのOpenAI互換エンドポイントを通じてすべての競合他社と並べてルーティングしてください。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube