Une inférence privée sur 200+ modèles, protégée à chaque appel. Zéro marge sur le paiement à l’usage et les abonnements. Ou apportez vos propres clés.
Sans carte bancaire · en ligne en 60 secondes · aucun prompt journalisé sans votre accord
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Une ligne. On note chaque prompt, on route vers un modèle de pointe ou OSS, et on ajoute 0 $.
Ce que vous demandez à une IA vous appartient. Ce que font vos agents, c’est à vous de l’approuver.
Ce que le modèle et nos serveurs peuvent voir.
Data Cloaking
Les noms, e-mails et numéros de carte sont remplacés par des substituts avant d’atteindre le modèle que vous appelez, puis restitués dans la réponse.
En un clicZDR
Les prompts ne sont pas journalisés tant que vous n’activez pas la journalisation. Signez un accord de rétention zéro pour la verrouiller.
Par défautPQC
Les journaux que vous choisissez de conserver sont scellés avec un ML-KEM hybride. La cryptographie est open source : SCUTTLE.
Par défautData Residency
Déclarez États-Unis, UE, Royaume-Uni, Asie-Pacifique ou Chine, et vos rapports de conformité portent cette région.
Sur demandeTEE
Des enclaves attestées, avec une preuve pour chaque réponse.
Sur demandeCe qui passe, et ce qui s’exécute.
Guardrails
PII, secrets, jailbreaks et injections de prompt sont arrêtés avant que le modèle ne les voie. Les règles par motifs sont gratuites ; une règle jugée par IA ne facture que sa propre vérification.
En un clicAgent Firewall
Chaque appel d’outil ou MCP est autorisé, soumis à une personne pour validation, ou bloqué avant de s’exécuter.
Surveillance par défautCompliance Packs
Une politique par réglementation. Observez-la d’abord sur du trafic réel, puis activez le blocage.
Offres payantesEt aussi :File d’approbation humaineMenaces classées selon l’OWASP LLM Top 10 et MITRE ATLASL’archive publique des incidents d’agents
Versionnez vos prompts et réutilisez les appels en cache sans toucher au code.
Versionner un promptLes plus récents de 200+ modèles, en direct, au prix du fournisseur lui-même.
| Modèle | Routé vers | Entrée /M | Sortie /M | Contexte | Route privée |
|---|---|---|---|---|---|
| openai/gpt-6.1-solTexteNOUVEAU | OpenAI Direct | $2.00 | $10.00 | 1M | Pas de route privée |
| anthropic/claude-sonnet-5.5TexteNOUVEAU | Anthropic Direct | $2.00 | $10.00 | 1M | Pas de route privée |
| typesafe/jev-1.13TexteNOUVEAU | — | $0.042 | $0.042 | 66K | Pas de route privée |
| openai/gpt-6-lunaTexteNOUVEAU | OpenAI Direct | $0.100 | $0.500 | 1M | Pas de route privée |
| openai/gpt-6-solTexteNOUVEAU | OpenAI Direct | $2.00 | $10.00 | 1M | Pas de route privée |
| anthropic/claude-opus-5.5TexteNOUVEAU | Anthropic Direct | $4.00 | $20.00 | 1M | Pas de route privée |
| grok/grok-4.7TexteNOUVEAU | — | $2.00 | $6.00 | 500K | Pas de route privée |
| orca/orcaverify-text1.0TexteNOUVEAU | — | $2.00 | $2.00 | — | Pas de route privée |
| + 194 modèles supplémentaires · prix mis à jour toutes les 60 s | |||||
Pointez base_url sur api.orcarouter.ai/v1 et remplacez votre clé API. Aucun autre changement de code.
Évalué en moins d'1 ms, avec bascule, cache et journaux complets intégrés.
En direct chez chaque fournisseur, à son tarif public — nous ajoutons 0 $ par token.
Nos revenus viennent des fonctionnalités d'équipe optionnelles.
Recharges et abonnements au prix du fournisseur. Nous ajoutons 0 $.
Rechargez quand vous voulez. Prix public, reçu à chaque appel.
Recharge votre portefeuille à chaque période. Montant intégral, tous les modèles, avec du crédit bonus sur les formules supérieures.
Utilisez vos propres clés de fournisseur, limites de débit et crédits.
Les forfaits ci-dessus concernent les fonctionnalités d’équipe. Ils ne changent pas le prix des tokens.
Ce que nous construisons et pourquoi — nos derniers articles.

Nous n’entraînons jamais de modèles sur vos prompts. Le contenu des prompts et des réponses n’est journalisé que si la journalisation est active pour votre espace de travail ; nous conservons les métadonnées (heure, modèle, tokens, coût, IP) pour la facturation et la sécurité. Un accord de rétention zéro verrouille cette journalisation.
Par le fournisseur qui sert le modèle choisi, dans ses propres régions. Le paramètre de région de votre espace de travail (États-Unis, UE, Royaume-Uni, Asie-Pacifique ou Chine) marque vos rapports de conformité avec cette région ; il ne fixe pas encore le lieu de stockage de vos données ni celui de l’inférence.
Les journaux de requêtes que vous choisissez de conserver peuvent être scellés par un chiffrement post-quantique hybride (ML-KEM-768 + X25519) : une copie dérobée aujourd’hui ne pourra pas être ouverte par un futur ordinateur quantique. Le code est open source : SCUTTLE. C’est activé par défaut sur notre service hébergé.
Un routeur IA se place entre votre application et de nombreux modèles et choisit le meilleur modèle pour chaque requête. OrcaRouter évalue chaque prompt en moins de 1 ms et le route — frontier pour le raisonnement difficile, open source pour le courant — sur plus de 200 modèles, sans majoration de tokens.
Un routeur LLM classifie chaque prompt et le dirige vers le modèle le plus susceptible de bien répondre au moindre coût. OrcaRouter route via des embeddings contextuels avec apprentissage en ligne sur le trafic réel — 75,5 % de précision au classement public RouterArena.
Oui. OrcaRouter est une passerelle IA de production : un point d'accès compatible OpenAI avec routage adaptatif, répartition de charge, bascule automatique, garde-fous, pare-feu d'agents, cache de prompts et observabilité par requête.
Comme un CDN sert le contenu depuis la meilleure périphérie, un AI CDN sert l'inférence depuis le meilleur fournisseur : capacité saine, rapide et bon marché, prompts répétés mis en cache, bascule en cas de panne. OrcaRouter joue ce rôle sur plus de 200 modèles.
Le routage adaptatif apprend l'arbitrage qualité/coût à partir de votre propre trafic. Orientez chaque espace de travail vers « le moins cher qui passe la barre », la meilleure qualité ou l'équilibre — ou laissez orcarouter/auto affiner le choix requête par requête.
Ils résolvent des problèmes différents — gouvernance vs choix du modèle — mais inutile d'avoir deux systèmes : OrcaRouter route requête par requête et applique budgets, garde-fous et observabilité sur le même saut.
L'évaluation du prompt prend moins de 1 ms et la latence ajoutée totale reste sous 50 ms — largement récupérée par des fournisseurs plus rapides et les tokens de prompt en cache.
Non. Vous payez le tarif publié de chaque fournisseur ; OrcaRouter ajoute 0 $ par token et se rémunère via les offres optionnelles Team et Enterprise.
Oui — basculez base_url vers https://api.orcarouter.ai/v1 et votre code SDK OpenAI, Anthropic ou Google continue de fonctionner : Chat Completions, Responses, Embeddings, Images, Audio et streaming.
OrcaRouter réessaie sur une capacité de secours saine pour le même modèle ou un équivalent avant le début de la réponse : les pannes amont n'atteignent jamais vos utilisateurs.
Changez une ligne. Voilà toute la migration.
Devance GPT-5 et Azure sur RouterArenaAppuyé par des recherches publiéesLire le code source de Scuttle (ouvre dans un nouvel onglet)Consulter le Centre de confiance
OrcaRouterVous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.
providers@orcarouter.ai