ひとつのゲートウェイで、すべてのモデルを。

安全なゼロマークアップ推論を従量課金とサブスクリプションで。自分のキーの持ち込みも可能。アダプティブルーティングで請求額を抑えます。

クレジットカード不要 · 60 秒で稼働

200+
モデルを、ひとつのエンドポイントで
0%
トークンの上乗せは一切なし
75.5%
ルーティング精度
RouterArena で GPT-5 を上回る
<50ms
ストリーム途中でのフェイルオーバー
40+%
推論コストを削減
セッション対応のアダプティブルーティングで
<1%
品質低下
自動フロンティアエスカレーションで
すべての連携
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

わずか1行。各プロンプトを評価し、フロンティアまたはOSSへルーティング、上乗せは$0。

ゲートウェイ

賢くルーティング。安全にリリース。コストは最小限に。

ルーティング

すべてのプロンプトを採点し、最も的確に答えられるモデルへ送ります。

モデルを見る

可観測性

完全なログ、リアルタイムの費用、プロンプトごとの明細。ブラックボックスはありません。

明細を見る

管理

プロンプトをバージョン管理し、キャッシュ済みの呼び出しを再利用。コード変更は不要です。

プロンプトをバージョン管理

ガバナンス

ガードレールとエージェント・ファイアウォールは、記録するだけでなく実際に止めます。

エージェントファイアウォールを見る
セットアップ

60 秒でライブ。

ステップ 1

SDK を当社に向ける

base_url を api.orcarouter.ai/v1 に設定し、API キーを差し替えるだけ。他のコード変更は不要です。

→
ステップ 2

ルーティング・ガード・観測はこちらで

1ms 未満で採点。フェイルオーバー、キャッシュ、完全なログを標準搭載。

→
ステップ 3

あとは、ひとつのエンドポイントでリリースするだけ

各プロバイダーへ直接、公開価格のまま — トークンあたりの上乗せは $0 です。

モデル

すべてのモデル。1つの価格表。

リアルタイムの価格を横並びで — プロバイダーに直接払う額そのままです。

200+ をすべて見る →
モデルルーティング先入力 /M出力 /Mコンテキスト品質
typesafe/jev-1.13NEW—$0.042$0.04266K5.0
openai/gpt-6-lunaNEWOpenAI Direct$0.100$0.5001M8.0
openai/gpt-6-solNEWOpenAI Direct$2.00$10.001M9.0
anthropic/claude-opus-5.5NEWAnthropic Direct$4.00$20.001M9.0
grok/grok-4.7NEW—$2.00$6.00500K9.0
orca/orcaverify-text1.0NEW—$2.00$2.00—5.0
deepseek/deepseek-v4.1-flashNEWDeepSeek$0.150$0.6001M8.0
openai/gpt-6-astraNEWOpenAI Direct$10.00$50.001M9.0
+ 194 のモデル · 価格は 60 秒ごとに更新
トークンの支払い方法

トークンの支払い方法は 3 つ。

チャージとサブスクはプロバイダー価格。上乗せはありません。

下のプランはチーム機能向けで、トークン単価は変わりません。

料金

トークン費用から手数料をいただくことはありません。

収益は任意のチーム向け機能から得ています。

ハッカー

無料
永久無料。全トークンでゼロマークアップ。
ルーティング — 200+ モデル、自動フェイルオーバー
可観測性 — 基本ダッシュボード
管理 — プロンプトのバージョン管理
10 API キー · 0% トークン上乗せ
無料で始める

エンタープライズ

カスタム
SLA のコミットメントと専有キャパシティ。
Team のすべて
チームシート無制限
新モデルへの優先アクセス
非公開機能とベータ機能をすべて利用可能
専用インフラ
99.99% 稼働 SLA
専任サポートとカスタム価格
信頼性とコンプライアンス
独立監査済み・継続的コンプライアンス — レポートはNDAの下で提供します。
ブログから

エンジンルームからの最新情報。

私たちが何を、なぜ作っているのか — 最新の記事。

すべての記事 →
オープンデータ

エージェントが実際に何をしでかしたのか、公開して記録しています。

実世界の AI エージェントセキュリティ事象 340 件。いずれにも少なくとも一つの情報源と、被害が出たかどうかの明快な判定が付いています。無料で、引用でき、訂正も歓迎します。

340レコード126実害が確認されたもの548情報源
インシデントアーカイブを開く
月別レコード数、22 か月、2026-09-19 時点
よくある質問

AIルーター、LLMゲートウェイ、アダプティブルーティング — まとめて回答。

AIルーターとは何ですか?

AIルーターはアプリと多数のモデルの間に位置し、リクエストごとに最適なモデルを選びます。OrcaRouterはすべてのプロンプトを1ミリ秒未満で評価してルーティングし — 高度な推論はフロンティア、定型処理はオープンソースへ — 200以上のモデルをトークン上乗せゼロでカバーします。

LLMルーターとは?どう動作しますか?

LLMルーターは各プロンプトを分類し、最も低コストで良い回答を返せる見込みのモデルに割り当てます。OrcaRouterはコンテキスト埋め込みと実トラフィックからのオンライン学習でルーティングし、公開のRouterArenaリーダーボードで精度75.5%を記録しています。

OrcaRouterはAIゲートウェイですか?

はい。OrcaRouterは本番向けAIゲートウェイです。OpenAI互換の単一エンドポイントに、アダプティブルーティング、ロードバランシング、自動フェイルオーバー、ガードレール、エージェントファイアウォール、プロンプトキャッシュ、リクエスト単位の可観測性を備えます。

AI CDNとは何ですか?

CDNが最適なエッジからコンテンツを配信するように、AI CDNは最適なプロバイダーから推論を配信します。健全で高速かつ安価な容量へ振り分け、繰り返しプロンプトをキャッシュし、障害時にはフェイルオーバー。OrcaRouterは200以上のモデルでこの役割を担います。

アダプティブルーティングとは?

アダプティブルーティングは、品質とコストのトレードオフをあなた自身のトラフィックから学習します。ワークスペースごとに「基準を満たす最安」「最高品質」「バランス」を指定するか、orcarouter/autoにリクエスト単位の調整を任せられます。

AIゲートウェイとLLMルーターは両方必要ですか?

両者は別の問題 — ガバナンスとモデル選択 — を解きますが、2つのシステムは不要です。OrcaRouterは同じホップでリクエスト単位のルーティングを行いながら、予算・ガードレール・可観測性を適用します。

ルーティングで遅延は増えますか?

プロンプト評価は1ミリ秒未満、追加遅延の合計は50ミリ秒未満です — より高速なプロバイダーとキャッシュ済みプロンプトトークンで通常は何倍にも取り返せます。

OrcaRouterはトークン価格に上乗せしますか?

いいえ。各プロバイダーの公表価格をそのまま支払います。OrcaRouterのトークン上乗せは$0で、収益は任意のTeam / Enterprise機能から得ています。

既存のOpenAI SDKコードをそのまま使えますか?

はい — base_urlをhttps://api.orcarouter.ai/v1に切り替えるだけで、OpenAI・Anthropic・GoogleのSDKコードはそのまま動きます。Chat Completions、Responses、Embeddings、Images、Audio、ストリーミングすべてに対応します。

プロバイダーがダウンしたらどうなりますか?

OrcaRouterはレスポンス開始前に、同一または同等モデルの健全なフォールバック容量へ再試行します。上流の障害がユーザーに露出することはありません。

もっと賢く、もっと安全に、もっと低コストに。

1行を差し替えるだけ。それが移行のすべて。

RouterArena で GPT-5 と Azure を上回る公開された研究に基づく

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube