Ein Endpoint für die kostenlose Stufe — nach Schwierigkeit über die kostenlosen Modelle deines Arbeitsbereichs geroutet.
Ein einziger Endpunkt für die kostenlose Stufe. Statt selbst einen bestimmten -free-Alias auszuwählen, rufst du orcarouter/free auf: Er verteilt jede Anfrage nach Schwierigkeit auf die kostenlosen Modelle deines Arbeitsbereichs — ohne je dein Guthaben anzutasten, wobei die kostenlose Nutzung über die Anfragerate statt über eine feste Anzahl an Aufrufen begrenzt wird.
Jede Anfrage wird anhand von Prompt-Länge, Code-Dichte, Tools und Reasoning-Hinweisen bewertet — dasselbe Signal, das unser adaptiver Router verwendet.
Alltägliche Prompts gehen an die leichte kostenlose Stufe, schwierige an die stärkere kostenlose Stufe — aus den kostenlosen Modellen deines Arbeitsbereichs.
Die Modellnutzung kostet nichts: Beide Stufen sind mit 0 $ bepreist, es macht also keinen Unterschied, welche die Anfrage bedient.
Der kostenlose Zugriff wird durch die Anfragerate begrenzt, nicht durch ein Guthaben – die Modellnutzung selbst kostet nichts, und das Kontingent wird nie aufgebraucht.
Jeder Workspace hat ein Kontingent an Anfragerate. Es wächst mit dem, was über die Lebensdauer des Kontos bezahlt wurde – Aufladen hebt also auch die Gratis-Limits.
Einzelne kostenlose Modelle können ein eigenes, strengeres Limit haben – ein stark ausgelastetes Modell wird gedrosselt, ohne die übrigen zu beeinträchtigen.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/free",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)