マークアップゼロ · 高い可用性 · より良い価格

ひとつのゲートウェイで、すべてのモデルを。 賢くルーティング。安全にリリース。コストは最小限に。

OrcaRouter はすべてのプロンプトを評価し、インテリジェントにルーティングします。フロンティア品質の AI を最大 40% 低コストで。アダプティブルーティング、ロードバランシング、ガードレール、エージェントファイアウォール、可観測性、ガバナンス — すべて単一の OpenAI 互換エンドポイントで。

クレジットカード不要 · 60 秒で利用開始

RouterArena で GPT-5 と Azure を上回る公開された研究に基づく
- client = OpenAI(api_key="sk-...")
+ client = OpenAI(
+ base_url="https://api.orcarouter.ai/v1",
+ api_key="sk-orca-..."
+ )
 
# Everything else stays the same.
response = client.chat.completions.create(
model="orcarouter/auto", # router picks the best model per request
messages=[{"role": "user", "content": "..."}]
)
# → orcarouter/auto grades the prompt → frontier or open-source, zero token markup ✓

わずか1行。各プロンプトを評価し、フロンティアまたはOSSへルーティング、上乗せは$0。

200+
モデルを、ひとつのエンドポイントで
0%
トークンの上乗せは一切なし
75.5%
ルーティング精度
<50ms
ストリーム途中でのフェイルオーバー
インテグレーション

使い慣れたツールでそのまま動く

OpenAI 互換でそのまま、またはエージェントを OrcaRouter MCP サーバー経由で接続 — お使いの SDK、フレームワーク、エディタをそのまま。

OrcaRouter MCP サーバーOpenAI SDKGoogle GenAI SDKAnthropic SDKLangChainLlamaIndexVercel AI SDKCamelAIDifyCursorOpenCodePromptfooOpenClawOpenHumanGitHubcURLなど
OrcaRouter を使ってる?話そう。XDiscordGitHub
本番環境向け AI ゲートウェイ

すべてのリクエストをスマートにルーティングし、自動でフェイルオーバー。

計測可能なほど高精度なルーティング。

すべてのプロンプトを埋め込み、実トラフィックからオンラインで学習し続けるモデルがルーティング。公開RouterArenaリーダーボード(Jun 2026)では精度75.5%でトップ——GPT-5、Azure、Martian、NotDiamondを上回る。

contextual embeddingsonline learning<1ms overheadRouterArena
* RouterArena リーダーボードのデータに基づく(2026年6月)。

プロバイダーがダウン。誰も気づかない。

プロバイダーがレート制限や 5xx を返した場合、OrcaRouter は応答が始まる前に 200+ のモデルから正常なものへリクエストを再試行します — 上流の一時的な障害がユーザーに影響しません。

200+ modelsauto-failoverno 429

ルーティングは、あなたの思いどおりに。

orcarouter/auto は賢いデフォルトであり、ブラックボックスではありません。ワークスペースごとに目的を指定できます——品質基準を満たす最も安価なモデル、最高品質、その両立のいずれか——あるいは、実際のトラフィックからトレードオフを学習させることも可能です。単一の挙動に縛られることは決してありません。

per-workspaceno markup either way<1ms overhead

モードだけでは足りない? ルールを書きましょう。

デフォルトでは不十分なときは、ルーティングをコードとして記述できます——バージョン管理でき、レビュー可能で、数秒で反映。再デプロイもクライアントの変更も不要です。

YAML + CELversion-controlledlive in seconds
routing.yaml
version: 1
rules:
- id: hard_agent_task
when: task_class == "agent" && difficulty >= 0.6
use:
model: "claude-opus-4-7"
reasoning_effort: high # spend where it matters
- id: short_prompts
when: request.input_tokens < 500
use: { delegate: cheapest }
default:
delegate: balanced # fall back to the chosen mode

すべての呼び出しを可視化し、証跡を残す——コスト、モデル、レイテンシ、その理由まで。

すべてを可視化。すべてを証明。

各リクエストがいくらかかったか、どのモデルが処理したか、どれだけ時間がかかったか、なぜ失敗したかを正確に把握できます——フィルタリング、リプレイ、実行可能なcURLとしてコピーできる完全な構造化ログを提供します。ルーティングが決してブラックボックスになることはありません。

Per-request logsgrade · model · costcopy-as-cURL

上乗せゼロ。ブラックボックスもゼロ。

各プロバイダーには、その正確な価格をお支払いいただきます——トークンあたり$0、決して上乗せしません。すべてのリクエストにグレード、選択されたモデル、プロバイダー、レイテンシ、価格が表示されるため、コストは不透明なブレンドレートではなく、グラスボックスです。

$0 / tokenprovider costglass-box receipt

再デプロイなしで、プロンプトのバージョン管理とキャッシュを。

変えるのはプロンプト。コードではなく。

名前付きラベルの背後でプロンプトをバージョン管理し、A/B分割とワンクリックのロールバックに対応します。ラベルを移動すれば、すべてのリクエストが即座にそれを反映します——再デプロイも、コード変更も、クライアントの更新も不要です。

VersionedA/BInstant rollbackNo deploy

支払いは一度。再利用は無料。

繰り返しおよびキャッシュされたプロンプトトークンは、5分および1時間のエフェメラルウィンドウにわたって、プロバイダーのキャッシュレート——多くの場合、入力価格のごく一部——で課金されます。同じ回答を、より少ない支出で、すべてのレシートにcached_tokensを記載してお届けします。

cache_controlcached_tokens5m / 1h windows

ガードレール、予算、そして実際に効くエージェントファイアウォール。

ちゃんと止めるガードレール。

PII Shieldとコンテンツポリシーは、上流への呼び出しが課金される前に実行されます。ブロックされたリクエストはクリーンな400を返し、決して課金されません——ガードレールは後からログに記録されるのではなく、インラインで適用されます。

PII Shieldenforced pre-billingclean 400

チームにも、エージェントにも安全。

人にはバジェットとロールを、エージェントにはリスクスコアリング型のファイアウォールを。すべてのツール呼び出しとMCP呼び出しは、実行される前にALLOW、REVIEW、BLOCKのいずれかに格付けされ、異常検知が学習済みの週内時間帯ベースラインに対してレートとコストの急増をフラグ付けします。

ALLOW · REVIEW · BLOCKMCP gatinganomaly detection
エージェント時代のために。必要になる前に。

セットアップ

60 秒でライブ。

URL を 1 つ変更するだけ。既存の SDK、モデル名、ストリーミングがそのまま動作します。

ステップ 1

SDK を当社に向ける

base_urlapi.orcarouter.ai/v1 に設定し、API キーを入れ替えます。他のコード変更は不要です。

ステップ 2

ルーティング、ガード、観測はおまかせ

すべての呼び出しを最適なモデルへルーティングし、ガードレールで検査し、計測——判定は1ms未満。フェイルオーバー、キャッシュ、完全なログを標準装備。

ステップ 3

あとは、ひとつのエンドポイントでリリースするだけ

トラフィックは各プロバイダーのファーストパーティAPIへ公開レートで直送——トークンあたりの上乗せは$0。ルーティング、可観測性、ガバナンスをひとつのOpenAI互換エンドポイントで。


すべてのモデル。1つの価格表。

200+のモデルをライブで横並び表示 — プロバイダーへ直接支払う額そのまま。上乗せは$0。

200+ モデルをすべて見る →
モデルルーティング先入力 /M出力 /Mコンテキスト品質
meta/muse-spark-1.2NEW$1.25$4.251M8.0
qwen/qwen3.8-maxNEWAlibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731NEWDeepSeek$0.147$0.2951M6.0
minimax/minimax-h3NEW$0.080 / 秒5.0
qwen/qwen3.7-flashNEWAlibaba Cloud$0.030$0.1301M7.0
orca/dubNEW$0.600 / 分5.0
anthropic/claude-opus-5NEWAnthropic Direct$5.00$25.001M10.0
google/gemini-3.6-flashNEWGoogle Direct$1.50$7.501M8.0
+ 194 のモデル · 価格は 60 秒ごとに更新

料金

ルーティングは無料。
お支払いは機能に。

トークン支出から一切を取ることはありません。収益はオプションのチーム機能から得られます。

ゼロマークアップ保証
プロバイダーに公表レートで直接お支払いいただきます。トークンコストに何も上乗せしません。ルーティングは無料です。オプションの Team プランがプラットフォームを支えます。
$0.00ルーティング料金

ハッカー

無料
永久無料。全トークンでゼロマークアップ。
✓ ルーティング — 200+ モデル、自動フェイルオーバー
✓ 可観測性 — 基本ダッシュボード
✓ 管理 — プロンプトのバージョン管理
✓ 3 API キー · 0% トークン上乗せ
無料で始める

エンタープライズ

カスタム
SLA コミット + プライベートデプロイ。
✓ Team のすべて
✓ プライベート / オンプレミスデプロイ
✓ 99.99% 稼働 SLA
✓ 専用インフラ
✓ 専任サポートとカスタム価格
信頼性とコンプライアンス
独立監査済み・継続的コンプライアンス — レポートはNDAの下で提供します。

ブログから

エンジンルームからの最新情報。

私たちが何を、なぜ作っているのか — 最新の記事。

すべての記事 →

よくある質問

AIルーター、LLMゲートウェイ、アダプティブルーティング — まとめて回答。

短く事実に基づく回答 — このページの構造化データで検索エンジンが見るものと同一です。

AIルーターとは何ですか?

AIルーターはアプリと多数のモデルの間に位置し、リクエストごとに最適なモデルを選びます。OrcaRouterはすべてのプロンプトを1ミリ秒未満で評価してルーティングし — 高度な推論はフロンティア、定型処理はオープンソースへ — 200以上のモデルをトークン上乗せゼロでカバーします。

LLMルーターとは?どう動作しますか?

LLMルーターは各プロンプトを分類し、最も低コストで良い回答を返せる見込みのモデルに割り当てます。OrcaRouterはコンテキスト埋め込みと実トラフィックからのオンライン学習でルーティングし、公開のRouterArenaリーダーボードで精度75.5%を記録しています。

OrcaRouterはAIゲートウェイですか?

はい。OrcaRouterは本番向けAIゲートウェイです。OpenAI互換の単一エンドポイントに、アダプティブルーティング、ロードバランシング、自動フェイルオーバー、ガードレール、エージェントファイアウォール、プロンプトキャッシュ、リクエスト単位の可観測性を備えます。

AI CDNとは何ですか?

CDNが最適なエッジからコンテンツを配信するように、AI CDNは最適なプロバイダーから推論を配信します。健全で高速かつ安価な容量へ振り分け、繰り返しプロンプトをキャッシュし、障害時にはフェイルオーバー。OrcaRouterは200以上のモデルでこの役割を担います。

アダプティブルーティングとは?

アダプティブルーティングは、品質とコストのトレードオフをあなた自身のトラフィックから学習します。ワークスペースごとに「基準を満たす最安」「最高品質」「バランス」を指定するか、orcarouter/autoにリクエスト単位の調整を任せられます。

AIゲートウェイとLLMルーターは両方必要ですか?

両者は別の問題 — ガバナンスとモデル選択 — を解きますが、2つのシステムは不要です。OrcaRouterは同じホップでリクエスト単位のルーティングを行いながら、予算・ガードレール・可観測性を適用します。

ルーティングで遅延は増えますか?

プロンプト評価は1ミリ秒未満、追加遅延の合計は50ミリ秒未満です — より高速なプロバイダーとキャッシュ済みプロンプトトークンで通常は何倍にも取り返せます。

OrcaRouterはトークン価格に上乗せしますか?

いいえ。各プロバイダーの公表価格をそのまま支払います。OrcaRouterのトークン上乗せは$0で、収益は任意のTeam / Enterprise機能から得ています。

既存のOpenAI SDKコードをそのまま使えますか?

はい — base_urlをhttps://api.orcarouter.ai/v1に切り替えるだけで、OpenAI・Anthropic・GoogleのSDKコードはそのまま動きます。Chat Completions、Responses、Embeddings、Images、Audio、ストリーミングすべてに対応します。

プロバイダーがダウンしたらどうなりますか?

OrcaRouterはレスポンス開始前に、同一または同等モデルの健全なフォールバック容量へ再試行します。上流の障害がユーザーに露出することはありません。

もっと賢く、もっと安全に、もっと低コストに。

1行を差し替えるだけ。それが移行のすべて。

GitHub でサインアップ — カード登録不要。1 分以内に利用開始できます。

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

お問い合わせ

コミュニティに参加

DiscordEmailXGitHubYouTube