Une passerelle. Tous les modèles.

Inférence sécurisée sans marge, à l'usage ou par abonnement. Ou apportez vos propres clés. Le routage adaptatif allège votre facture.

Sans carte bancaire · en ligne en 60 secondes

200+
modèles, un seul endpoint
0%
de marge sur les tokens, jamais
75.5%
de précision de routage
devance GPT-5 sur RouterArena
<50ms
bascule en plein flux
40+%
de coût d'inférence en moins
avec le routage adaptatif par session
<1%
de perte de qualité
avec l'escalade automatique vers le frontier
Toutes les intégrations
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Une ligne. On note chaque prompt, on route vers un modèle de pointe ou OSS, et on ajoute 0 $.

La passerelle

Routez plus intelligemment. Livrez en toute sécurité. Dépensez moins.

Router

Chaque prompt est évalué, puis confié au modèle qui y répond le mieux.

Parcourir les modèles

Observer

Journaux complets, dépense en direct et un reçu par prompt. Aucune boîte noire.

Voir un reçu

Gérer

Versionnez vos prompts et réutilisez les appels en cache sans toucher au code.

Versionner un prompt

Gouverner

Des garde-fous et un pare-feu d'agents qui bloquent, pas seulement qui journalisent.

Voir le pare-feu
Installation

En ligne en 60 secondes.

Étape 1

Pointez votre SDK vers nous

Pointez base_url sur api.orcarouter.ai/v1 et remplacez votre clé API. Aucun autre changement de code.

Étape 2

Nous routons, protégeons et observons

Évalué en moins d'1 ms, avec bascule, cache et journaux complets intégrés.

Étape 3

Vous livrez, sur un seul endpoint

En direct chez chaque fournisseur, à son tarif public — nous ajoutons 0 $ par token.

Modèles

Tous les modèles. Une seule grille tarifaire.

Tarifs en direct, côte à côte — ce que vous paieriez au fournisseur directement.

Voir les 200+ →
ModèleRouté versEntrée /MSortie /MContexteQualité
z-ai/glm-5.3NOUVEAUZhipu AI$1.26$3.961M9.0
qwen/qwen3.8-27bNOUVEAUAlibaba Cloud$0.330$2.40262K4.0
qwen/qwen3.8-27b-freeNOUVEAUAlibaba Cloud66K4.0
deepseek/deepseek-v4-pro-0813NOUVEAUDeepSeek$0.442$0.8841M7.0
grok/grok-4.6NOUVEAU$2.00$6.00500K9.0
meta/muse-spark-1.2NOUVEAU$1.25$4.251M8.0
qwen/qwen3.8-maxNOUVEAUAlibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731NOUVEAUDeepSeek$0.147$0.2951M6.0
+ 194 modèles supplémentaires · prix mis à jour toutes les 60 s
Payer les tokens

Trois façons de payer vos tokens.

Recharges et abonnements au prix du fournisseur. Nous ajoutons 0 $.

Les offres ci-dessous concernent les fonctions d'équipe, pas le prix des tokens.

Tarifs

Nous ne prenons jamais de commission sur vos tokens.

Nos revenus viennent des fonctionnalités d'équipe optionnelles.

Hacker

Gratuit
À vie. Aucune majoration sur tous les tokens.
Router — 200+ modèles, bascule auto
Observer — tableau de bord de base
Gérer — versionnage des prompts
3 clés API · 0% de marge sur les tokens
Commencer gratuitement

Entreprise

Sur mesure
Engagements SLA et capacité dédiée.
Tout du forfait Team
Sièges d’équipe illimités
Accès prioritaire aux nouveaux modèles
Toutes les fonctionnalités masquées et bêta
Infrastructure dédiée
SLA de disponibilité 99.99%
Support dédié & tarif sur mesure
Confiance & conformité
Audité indépendamment, conforme en continu — rapports disponibles sous NDA.
Depuis le blog

Tout frais de la salle des machines.

Ce que nous construisons et pourquoi — nos derniers articles.

Tous les articles →
Guides & InsightsLuna-Lisa-Alpha : le prochain checkpoint GPT-image d'OpenAI fuit avec une nouvelle coupure de connaissances.Le prochain checkpoint GPT-image d'OpenAI, luna-lisa-alpha, fuit avec une date de coupure des connaissances récente, un meilleur rendu du texte et plus de réalisme. Non vérifié pour l'instant.Aug 20, 2026
FAQ

Routeurs IA, passerelles LLM, routage adaptatif — nos réponses.

Qu'est-ce qu'un routeur IA ?

Un routeur IA se place entre votre application et de nombreux modèles et choisit le meilleur modèle pour chaque requête. OrcaRouter évalue chaque prompt en moins de 1 ms et le route — frontier pour le raisonnement difficile, open source pour le courant — sur plus de 200 modèles, sans majoration de tokens.

Qu'est-ce qu'un routeur LLM et comment fonctionne-t-il ?

Un routeur LLM classifie chaque prompt et le dirige vers le modèle le plus susceptible de bien répondre au moindre coût. OrcaRouter route via des embeddings contextuels avec apprentissage en ligne sur le trafic réel — 75,5 % de précision au classement public RouterArena.

OrcaRouter est-il une passerelle IA (AI gateway) ?

Oui. OrcaRouter est une passerelle IA de production : un point d'accès compatible OpenAI avec routage adaptatif, répartition de charge, bascule automatique, garde-fous, pare-feu d'agents, cache de prompts et observabilité par requête.

Qu'est-ce qu'un AI CDN ?

Comme un CDN sert le contenu depuis la meilleure périphérie, un AI CDN sert l'inférence depuis le meilleur fournisseur : capacité saine, rapide et bon marché, prompts répétés mis en cache, bascule en cas de panne. OrcaRouter joue ce rôle sur plus de 200 modèles.

Qu'est-ce que le routage adaptatif ?

Le routage adaptatif apprend l'arbitrage qualité/coût à partir de votre propre trafic. Orientez chaque espace de travail vers « le moins cher qui passe la barre », la meilleure qualité ou l'équilibre — ou laissez orcarouter/auto affiner le choix requête par requête.

Faut-il à la fois une passerelle IA et un routeur LLM ?

Ils résolvent des problèmes différents — gouvernance vs choix du modèle — mais inutile d'avoir deux systèmes : OrcaRouter route requête par requête et applique budgets, garde-fous et observabilité sur le même saut.

Le routage ajoute-t-il de la latence ?

L'évaluation du prompt prend moins de 1 ms et la latence ajoutée totale reste sous 50 ms — largement récupérée par des fournisseurs plus rapides et les tokens de prompt en cache.

OrcaRouter majore-t-il le prix des tokens ?

Non. Vous payez le tarif publié de chaque fournisseur ; OrcaRouter ajoute 0 $ par token et se rémunère via les offres optionnelles Team et Enterprise.

Puis-je garder mon code OpenAI SDK existant ?

Oui — basculez base_url vers https://api.orcarouter.ai/v1 et votre code SDK OpenAI, Anthropic ou Google continue de fonctionner : Chat Completions, Responses, Embeddings, Images, Audio et streaming.

Que se passe-t-il quand un fournisseur tombe ?

OrcaRouter réessaie sur une capacité de secours saine pour le même modèle ou un équivalent avant le début de la réponse : les pannes amont n'atteignent jamais vos utilisateurs.

Plus intelligent, plus sûr, économique.

Changez une ligne. Voilà toute la migration.

Devance GPT-5 et Azure sur RouterArenaAppuyé par des recherches publiées

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube