OrcaRouter: Fusion

orcarouter/fusion
高品質
テキスト入力 · テキスト出力 · 1M ctx

Fable 5 は提供終了になりました。Fusion は、今も呼び出せるモデルからそのレベルを、わずかなコストで再構築します。

概要

次のモデルを待つのはやめましょう。能力の次の飛躍はチェックポイントではなくパネルから生まれます。Fusion は最も難しいプロンプトを複数のフロンティアモデルに同時に送り、ジャッジが一致点を比較し、矛盾を見つけ、その中で最も優れた1つの回答を返します——残りと相互チェック済みです。本当に重要な作業——深い推論、難しいコーディング、リサーチ、専門的なレビュー——間違いのコストが数回分の追加生成より高い場面で使ってください。

仕組み

1

タスクでルーティング

気軽なチャットはより安価なデフォルトに直接送られます。コーディング、エージェント、ツール利用のリクエストだけがパネルにファンアウトされます——こうした場面でこそ二番目の意見が本当に役立ちます。

2

パネルにファンアウト

あなたのプロンプトは複数のフロンティアモデルに同時に届きます。互いに独立した試行が、それぞれ他のモデルが見落としたものを捉えます。

3

最良の回答を選ぶ

ジャッジがすべての候補を読み、その中で最も優れた1つを返します。他の候補と相互チェック済みで、単一モデルの初回出力ではありません。

効果のある場面にだけ。 Fusionは、コーディング・エージェント型・ツール利用・高難度のプロンプトに対してパネルへ展開します。カジュアルな会話はコストの低いデフォルトモデルへ直接ルーティングされるため、セカンドオピニオンが価値をもたらすリクエストにのみパネルの費用が発生します。

パネルが単一モデルより優れている理由

単一モデルでは、プロンプトに対して1回の試行しか得られず、誤りを検出する手段もありません。Fusionは複数のフロンティアモデルを同じプロンプトで同時に実行し、独立した審査モデルがすべての回答を読み取って最も優れたものを返します。その際、他の回答と相互検証も行われます。強力なモデル間の意見の相違はシグナルです。単一モデルでは静かに誤りを犯してしまうような難しいケースを浮き彫りにします。

単一モデル

1つのモデル、1つの回答。セカンドオピニオンなし — 誤りがあってもそのまま出力されます。

自動ルーター

コスト削減のためプロンプトごとに1つのモデルを選択。賢い選定ですが、それでも回答は1つだけです。

Fusion

パネルが並列で回答し、審査モデルが他の回答と相互検証した上で最も優れたものを返します。

パネル+審査モデル(Mixture-of-Agents)65.1%
単一トップモデル(GPT-4o)57.5%
AlpacaEval 2.0 長さ制御勝率 — アグリゲーターを組み合わせたモデルパネルが単一トップモデルを上回ります。 Mixture-of-Agents, Wang et al. 2024

このルーターのモデル

モデル役割コンテキスト
Claude Opus 4.8パネル · ジャッジ1M
GPT-5.5パネル1M
Gemini 3.1 Proパネル1M

別の組み合わせが欲しいですか?ルーティング DSL エディタの "Claude Fable 5 Level" テンプレートから独自のパネルを作成できます。

ルーティングDSLを基盤として構築

Fusionは特例処理ではありません。各リクエストのルーティング方法を正確に定義するための小さなサンドボックス言語である、ルーティングDSLの組み込み設定です。「Fable 5 Level」テンプレートをクローンして、パネル・審査モデル・ゲートルール・勝者の選定方法を自由に変更できます。

Best of NFusionデフォルト設定

審査モデルがすべての候補をランク付けし、最も優れたものをそのまま返します。希釈されたマージは行いません。

多数決

パネルが構造化された回答に対して投票します。追加の審査モデル呼び出しは不要です。

合成

アグリゲーターモデルが候補を統合して1つの改善された回答を生成します(Mixture-of-Agents)。

テスト合格

コード用:実際にテストハーネスを通過したパッチを持つ候補が勝者となります。

最速

レース方式 — 最も低レイテンシの結果が勝者。速度が最優先の場合に適しています。

ブラックボックスなし。 独自のDSLでルーターを構築すると、すべての並列実行が記録されます。どのモデルが競合したか、各区間のレイテンシと状態、そして審判が選んだ回答が確認でき、コンソール上でなぜその回答が選ばれたかを正確に把握できます。

ルーティングDSLエディターを開く

コードサンプル

import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="orcarouter/fusion",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

料金

fusion はすべてのパネルメンバーとジャッジを実行するため、ファンアウトするリクエストは単一のモデルではなく、それら基盤となる補完の合計として課金されます——そして実際にファンアウトするリクエストにのみ課金されます。上乗せはゼロです。

よくある質問

Claude Fable 5 API はどこで使えますか?
Claude Fable 5 API は提供終了・制限され、広く呼び出すことはできなくなりました。OrcaRouter: Fusion はそのまま使える OpenAI 互換の代替手段です。フロンティアモデルのパネルを並列実行し、ジャッジが最も優れた回答を返します——Fable 5 級の選択肢を、今日 orcarouter/fusion として呼び出せます。
OrcaRouter: Fusion とは何ですか?
キュレートされたマルチモデルルーターです。実際の作業ではモデルのパネルを並列実行し、ジャッジが最良の1つの回答を選び、残りと相互チェックします。簡単なリクエストはより安価なデフォルトに回されます。
料金はどのように計算されますか?
実際に実行されたパネルメンバーとジャッジの合計として、ファンアウトしたリクエストにのみ課金されます。上乗せはゼロです。
Fusionは回答を統合しますか?
いいえ。審査モデルは最も優れた候補を1つ選び、そのまま返します。平均化やブレンドは行わず、常に実際のモデルの回答が得られます。
モデルの1つが失敗した場合はどうなりますか?
他の処理は引き続き実行され、審査モデルは成功した回答の中から選択します。また、ルーティングが次善のデプロイメントへフェイルオーバーするため、1つのプロバイダーの不具合でリクエスト全体が失敗することはありません。
すべてのリクエストがパネル全体を実行しますか?
いいえ — コーディング、エージェント型、ツール使用、および難易度の高いプロンプトのみがファンアウトされます。通常のチャットはより低コストなデフォルトにルーティングされるため、セカンドオピニオンが有効な場合にのみパネル料金が発生します。