Un unico endpoint per il livello gratuito — instradato per difficoltà tra i modelli gratuiti del tuo workspace.
Un unico endpoint per il livello gratuito. Invece di scegliere tu stesso uno specifico alias -free, chiama orcarouter/free: instraderà ogni richiesta in base alla difficoltà tra i modelli gratuiti della tua area di lavoro, senza mai toccare il tuo saldo e con l'uso gratuito limitato dalla frequenza delle richieste anziché da un numero fisso di chiamate.
Ogni richiesta viene valutata in base alla lunghezza del prompt, alla densità di codice, agli strumenti e agli indizi di ragionamento: lo stesso segnale usato dal nostro router adattivo.
I prompt ordinari vanno al livello gratuito leggero; quelli difficili al livello gratuito più potente, attingendo ai modelli gratuiti della tua area di lavoro.
L’uso del modello non costa nulla: entrambi i livelli sono a 0 $, quindi non fa differenza quale serva la richiesta.
L’accesso gratuito è limitato dalla frequenza delle richieste, non da un saldo: l’uso del modello in sé non costa nulla e la quota non si esaurisce mai.
Ogni spazio di lavoro ha una quota di frequenza delle richieste. Cresce con quanto hai pagato nell’intera vita dell’account, quindi ricaricare alza anche i limiti gratuiti.
I singoli modelli gratuiti possono avere un limite proprio più stretto, così uno molto carico viene rallentato senza toccare gli altri.
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orcarouter/free",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)