Un nom de modèle. Tous les modèles derrière lui.
Pointez votre client sur orcarouter/auto et chaque requête est évaluée puis envoyée au modèle qui satisfait votre seuil de qualité au meilleur prix — avec l'amélioration sémantique comme option avancée.
- Quatre objectifs par espace de travail — Le moins cher, Équilibré, Qualité ou Adaptatif, qui apprend le compromis à partir de votre propre trafic.
- Apprentissage en ligne : le routeur se met à jour en continu à partir des résultats de production réels, et non d'un benchmark figé.
- Le routage ajoute moins de 1 ms par défaut ; en activant l'embedding sémantique, vous payez aussi l'appel d'embedding. Dans les deux cas, la note et le modèle choisi figurent sur chaque reçu.
Plus de 40 fournisseurs, un seul point d'accès
La même requête compatible OpenAI atteint n'importe quel fournisseur, et un équilibrage de charge sensible à l'état de santé répartit le trafic sur les fournisseurs disponibles. La santé, le poids et la priorité par canal retirent automatiquement les sources défaillantes de la rotation, et les particularités propres à chaque fournisseur sont normalisées dans l'adaptateur afin que votre code client n'ait jamais à bifurquer.
Un seul nom. Tous les modèles.
Vous écrivez orcarouter/auto une seule fois. Ensuite, chaque invite est analysée à la volée et envoyée au modèle qui y répond le mieux pour le moindre coût. Un nouveau modèle de pointe arrive un mardi et votre trafic commence à l'utiliser — sans migration, sans nouvelle version client, sans réunion.
Un paramètre par défaut, pas une boîte noire.
Orientez un espace de travail vers l'objectif que vous visez vraiment. Le moins cher. La qualité. L'équilibre. Ou Adaptatif, qui apprend le compromis à partir de votre propre trafic plutôt que des benchmarks des autres. Chaque décision prise apparaît sur le récapitulatif avec la note qui l'a motivée.