Un único endpoint para el nivel gratuito — enrutado por dificultad entre los modelos gratuitos de tu espacio de trabajo.
Un único endpoint para el nivel gratuito. En lugar de elegir tú mismo un alias -free concreto, llama a orcarouter/free y enrutará cada solicitud según su dificultad entre los modelos gratuitos de tu espacio de trabajo, sin tocar nunca tu saldo y con el uso gratuito limitado por tasa de solicitudes en lugar de por un número fijo de llamadas.
Cada solicitud se puntúa según la longitud del prompt, la densidad de código, las herramientas y las señales de razonamiento: la misma señal que usa nuestro enrutador adaptativo.
Los prompts corrientes van al nivel gratuito ligero; los difíciles, al nivel gratuito más potente, tomados de los modelos gratuitos de tu espacio de trabajo.
El uso del modelo no cuesta nada: ambos niveles están a 0 $, así que da igual cuál atienda la petición.
El acceso gratuito lo limita la frecuencia de peticiones, no un saldo: el uso del modelo en sí no cuesta nada y la asignación nunca se agota.
Cada espacio de trabajo tiene una cuota de frecuencia de peticiones. Crece con lo que hayas pagado a lo largo de la vida de la cuenta, así que recargar también sube los límites gratuitos.
Cada modelo gratuito puede tener su propio límite más estricto, de modo que uno muy cargado se estrangula sin afectar a los demás.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/free",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)