Eén endpoint voor het gratis niveau — op moeilijkheid gerouteerd over de gratis modellen van je workspace.
Eén endpoint voor de gratis laag. In plaats van zelf een specifieke -free alias te kiezen, roep je orcarouter/free aan: hij routeert elke aanvraag op moeilijkheid over de gratis modellen van je werkruimte — zonder ooit je saldo aan te raken, waarbij gratis gebruik wordt begrensd door de verzoeksnelheid in plaats van door een vast aantal aanroepen.
Elke aanvraag krijgt een score op basis van promptlengte, codedichtheid, tools en redeneersignalen — hetzelfde signaal dat onze adaptieve router gebruikt.
Alledaagse prompts gaan naar de lichte gratis laag; moeilijke naar de sterkere gratis laag — gekozen uit de gratis modellen van je werkruimte.
Modelgebruik kost niets — beide niveaus staan op $0, dus het maakt niet uit welk niveau de aanvraag afhandelt.
Gratis gebruik wordt begrensd door het aanvraagtempo, niet door een saldo — het modelgebruik zelf kost niets en het tegoed raakt nooit op.
Elke workspace heeft een tegoed aan aanvraagtempo. Dat groeit mee met wat er over de looptijd van het account is betaald, dus opwaarderen verhoogt ook de gratis limieten.
Losse gratis modellen kunnen een eigen, strakkere limiet hebben, zodat een zwaarbelast model wordt afgeknepen zonder de rest te raken.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/free",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)