Un seul endpoint pour le niveau gratuit — routé par difficulté entre les modèles gratuits de votre espace de travail.
Un point de terminaison unique pour le niveau gratuit. Au lieu de choisir vous-même un alias -free précis, appelez orcarouter/free : il répartit chaque requête selon sa difficulté entre les modèles gratuits de votre espace de travail — sans jamais toucher votre solde, l'usage gratuit étant plafonné par le débit de requêtes plutôt que par un nombre fixe d'appels.
Chaque requête est évaluée sur la longueur du prompt, la densité de code, les outils et les indices de raisonnement — le même signal qu'utilise notre routeur adaptatif.
Les prompts ordinaires vont au niveau gratuit léger, les plus difficiles au niveau gratuit supérieur — puisés parmi les modèles gratuits de votre espace de travail.
L’usage du modèle ne coûte rien : les deux niveaux sont à 0 $, peu importe donc lequel traite la requête.
L’accès gratuit est limité par le débit de requêtes, pas par un solde : l’usage du modèle lui-même ne coûte rien et l’allocation ne s’épuise jamais.
Chaque espace de travail dispose d’un quota de débit. Il augmente avec le total payé sur la durée de vie du compte : recharger relève donc aussi les limites gratuites.
Un modèle gratuit peut avoir son propre débit, plus strict : un modèle très sollicité est bridé sans affecter les autres.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/free",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)