計測可能なほど高精度なルーティング。
すべてのプロンプトを埋め込み、実トラフィックからオンラインで学習し続けるモデルがルーティング。公開RouterArenaリーダーボード(Jun 2026)では精度75.5%でトップ——GPT-5、Azure、Martian、NotDiamondを上回る。
OrcaRouter はすべてのプロンプトを評価し、インテリジェントにルーティングします。フロンティア品質の AI を最大 40% 低コストで。アダプティブルーティング、ロードバランシング、ガードレール、エージェントファイアウォール、可観測性、ガバナンス — すべて単一の OpenAI 互換エンドポイントで。
クレジットカード不要 · 60 秒で利用開始
- client = OpenAI(api_key="sk-...")+ client = OpenAI(+ base_url="https://api.orcarouter.ai/v1",+ api_key="sk-orca-..."+ )# Everything else stays the same.response = client.chat.completions.create(model="orcarouter/auto", # router picks the best model per requestmessages=[{"role": "user", "content": "..."}])# → orcarouter/auto grades the prompt → frontier or open-source, zero token markup ✓
わずか1行。各プロンプトを評価し、フロンティアまたはOSSへルーティング、上乗せは$0。
すべてのリクエストをスマートにルーティングし、自動でフェイルオーバー。
すべてのプロンプトを埋め込み、実トラフィックからオンラインで学習し続けるモデルがルーティング。公開RouterArenaリーダーボード(Jun 2026)では精度75.5%でトップ——GPT-5、Azure、Martian、NotDiamondを上回る。
プロバイダーがレート制限や 5xx を返した場合、OrcaRouter は応答が始まる前に 200+ のモデルから正常なものへリクエストを再試行します — 上流の一時的な障害がユーザーに影響しません。
orcarouter/auto は賢いデフォルトであり、ブラックボックスではありません。ワークスペースごとに目的を指定できます——品質基準を満たす最も安価なモデル、最高品質、その両立のいずれか——あるいは、実際のトラフィックからトレードオフを学習させることも可能です。単一の挙動に縛られることは決してありません。
デフォルトでは不十分なときは、ルーティングをコードとして記述できます——バージョン管理でき、レビュー可能で、数秒で反映。再デプロイもクライアントの変更も不要です。
version: 1rules:- id: hard_agent_taskwhen: task_class == "agent" && difficulty >= 0.6use:model: "claude-opus-4-7"reasoning_effort: high # spend where it matters- id: short_promptswhen: request.input_tokens < 500use: { delegate: cheapest }default:delegate: balanced # fall back to the chosen mode
すべての呼び出しを可視化し、証跡を残す——コスト、モデル、レイテンシ、その理由まで。
各リクエストがいくらかかったか、どのモデルが処理したか、どれだけ時間がかかったか、なぜ失敗したかを正確に把握できます——フィルタリング、リプレイ、実行可能なcURLとしてコピーできる完全な構造化ログを提供します。ルーティングが決してブラックボックスになることはありません。
各プロバイダーには、その正確な価格をお支払いいただきます——トークンあたり$0、決して上乗せしません。すべてのリクエストにグレード、選択されたモデル、プロバイダー、レイテンシ、価格が表示されるため、コストは不透明なブレンドレートではなく、グラスボックスです。
再デプロイなしで、プロンプトのバージョン管理とキャッシュを。
名前付きラベルの背後でプロンプトをバージョン管理し、A/B分割とワンクリックのロールバックに対応します。ラベルを移動すれば、すべてのリクエストが即座にそれを反映します——再デプロイも、コード変更も、クライアントの更新も不要です。
繰り返しおよびキャッシュされたプロンプトトークンは、5分および1時間のエフェメラルウィンドウにわたって、プロバイダーのキャッシュレート——多くの場合、入力価格のごく一部——で課金されます。同じ回答を、より少ない支出で、すべてのレシートにcached_tokensを記載してお届けします。
ガードレール、予算、そして実際に効くエージェントファイアウォール。
PII Shieldとコンテンツポリシーは、上流への呼び出しが課金される前に実行されます。ブロックされたリクエストはクリーンな400を返し、決して課金されません——ガードレールは後からログに記録されるのではなく、インラインで適用されます。
人にはバジェットとロールを、エージェントにはリスクスコアリング型のファイアウォールを。すべてのツール呼び出しとMCP呼び出しは、実行される前にALLOW、REVIEW、BLOCKのいずれかに格付けされ、異常検知が学習済みの週内時間帯ベースラインに対してレートとコストの急増をフラグ付けします。
URL を 1 つ変更するだけ。既存の SDK、モデル名、ストリーミングがそのまま動作します。
base_url を api.orcarouter.ai/v1 に設定し、API キーを入れ替えます。他のコード変更は不要です。
すべての呼び出しを最適なモデルへルーティングし、ガードレールで検査し、計測——判定は1ms未満。フェイルオーバー、キャッシュ、完全なログを標準装備。
トラフィックは各プロバイダーのファーストパーティAPIへ公開レートで直送——トークンあたりの上乗せは$0。ルーティング、可観測性、ガバナンスをひとつのOpenAI互換エンドポイントで。
200+のモデルをライブで横並び表示 — プロバイダーへ直接支払う額そのまま。上乗せは$0。
| モデル | ルーティング先 | 入力 /M | 出力 /M | コンテキスト | 品質 |
|---|---|---|---|---|---|
| meta/muse-spark-1.2NEW | — | $1.25 | $4.25 | 1M | 8.0 |
| qwen/qwen3.8-maxNEW | Alibaba Cloud | $2.00 | $6.00 | 1M | 9.0 |
| deepseek/deepseek-v4-flash-0731NEW | DeepSeek | $0.147 | $0.295 | 1M | 6.0 |
| minimax/minimax-h3NEW | — | $0.080 / 秒 | — | — | 5.0 |
| qwen/qwen3.7-flashNEW | Alibaba Cloud | $0.030 | $0.130 | 1M | 7.0 |
| orca/dubNEW | — | $0.600 / 分 | — | — | 5.0 |
| anthropic/claude-opus-5NEW | Anthropic Direct | $5.00 | $25.00 | 1M | 10.0 |
| google/gemini-3.6-flashNEW | Google Direct | $1.50 | $7.50 | 1M | 8.0 |
| + 194 のモデル · 価格は 60 秒ごとに更新 | |||||
トークン支出から一切を取ることはありません。収益はオプションのチーム機能から得られます。
私たちが何を、なぜ作っているのか — 最新の記事。

短く事実に基づく回答 — このページの構造化データで検索エンジンが見るものと同一です。
AIルーターはアプリと多数のモデルの間に位置し、リクエストごとに最適なモデルを選びます。OrcaRouterはすべてのプロンプトを1ミリ秒未満で評価してルーティングし — 高度な推論はフロンティア、定型処理はオープンソースへ — 200以上のモデルをトークン上乗せゼロでカバーします。
LLMルーターは各プロンプトを分類し、最も低コストで良い回答を返せる見込みのモデルに割り当てます。OrcaRouterはコンテキスト埋め込みと実トラフィックからのオンライン学習でルーティングし、公開のRouterArenaリーダーボードで精度75.5%を記録しています。
はい。OrcaRouterは本番向けAIゲートウェイです。OpenAI互換の単一エンドポイントに、アダプティブルーティング、ロードバランシング、自動フェイルオーバー、ガードレール、エージェントファイアウォール、プロンプトキャッシュ、リクエスト単位の可観測性を備えます。
CDNが最適なエッジからコンテンツを配信するように、AI CDNは最適なプロバイダーから推論を配信します。健全で高速かつ安価な容量へ振り分け、繰り返しプロンプトをキャッシュし、障害時にはフェイルオーバー。OrcaRouterは200以上のモデルでこの役割を担います。
アダプティブルーティングは、品質とコストのトレードオフをあなた自身のトラフィックから学習します。ワークスペースごとに「基準を満たす最安」「最高品質」「バランス」を指定するか、orcarouter/autoにリクエスト単位の調整を任せられます。
両者は別の問題 — ガバナンスとモデル選択 — を解きますが、2つのシステムは不要です。OrcaRouterは同じホップでリクエスト単位のルーティングを行いながら、予算・ガードレール・可観測性を適用します。
プロンプト評価は1ミリ秒未満、追加遅延の合計は50ミリ秒未満です — より高速なプロバイダーとキャッシュ済みプロンプトトークンで通常は何倍にも取り返せます。
いいえ。各プロバイダーの公表価格をそのまま支払います。OrcaRouterのトークン上乗せは$0で、収益は任意のTeam / Enterprise機能から得ています。
はい — base_urlをhttps://api.orcarouter.ai/v1に切り替えるだけで、OpenAI・Anthropic・GoogleのSDKコードはそのまま動きます。Chat Completions、Responses、Embeddings、Images、Audio、ストリーミングすべてに対応します。
OrcaRouterはレスポンス開始前に、同一または同等モデルの健全なフォールバック容量へ再試行します。上流の障害がユーザーに露出することはありません。
1行を差し替えるだけ。それが移行のすべて。
GitHub でサインアップ — カード登録不要。1 分以内に利用開始できます。