モデル名はひとつ。その裏にあらゆるモデルが揃う。
クライアントの向き先を orcarouter/auto に設定するだけで、すべてのプロンプトが自動評価され、品質基準を満たすモデルの中から最安値のものへ送信されます。セマンティック埋め込みはオプションのアップグレードとして利用可能です。
- ワークスペースごとに4つの目標を設定可能 — 最安値、バランス、高品質、または自社トラフィックからトレードオフを学習するアダプティブモード。
- オンライン学習:ルーターは固定ベンチマーク結果ではなく、本番環境のライブアウトカムから継続的に更新されます。
- ルーティングは既定で1ms未満ですが、セマンティック埋め込みを有効にすると埋め込み呼び出しの時間が加わります。いずれの場合も評価スコアと選択モデルはすべての明細に記録されます。
40以上のプロバイダー、単一エンドポイント
OpenAI互換リクエストはそのままあらゆるプロバイダーに送信でき、ヘルス対応の負荷分散が稼働中のプロバイダーへトラフィックを振り分けます。チャネルごとのヘルス状態・重み・優先度により、異常なアップストリームは自動的にローテーションから除外され、プロバイダー固有の差異はアダプター層で吸収されるため、クライアントコードに分岐処理は不要です。
ひとつの名前。すべてのモデル。
記述するのは orcarouter/auto の一行だけ。あとは各プロンプトが通過する際に内容が読み取られ、最も費用対効果よく回答できるモデルへ自動的に転送されます。新しい最先端モデルが火曜日にリリースされれば、移行作業もクライアントのリリースも会議も不要で、あなたのトラフィックはそのモデルを使い始めます。
デフォルト設定であって、ブラックボックスではない。
ワークスペースを実際に求める目標に向けて設定できます。最安値・高品質・バランス、あるいは他社のベンチマークではなく自分のトラフィックからトレードオフを学習する「アダプティブ」モード。下された判断はすべて、それを導いたスコアとともに明細に記録されます。