Un nome di modello. Tutti i modelli dietro di esso.
Punta il tuo client su orcarouter/auto e ogni prompt viene valutato e inviato al modello che soddisfa la tua soglia di qualità al prezzo più basso — con l'embedding semantico come funzionalità opzionale.
- Quattro obiettivi per workspace — Più economico, Bilanciato, Qualità o Adattivo, che apprende il compromesso ottimale dal tuo traffico reale.
- Apprendimento continuo: il router si aggiorna dai risultati di produzione in tempo reale, non da benchmark statici.
- Il routing aggiunge meno di 1 ms per impostazione predefinita; se attivi l'embedding semantico, paghi anche la chiamata di embedding. In entrambi i casi punteggio e modello scelto compaiono su ogni ricevuta.
40+ provider, un solo endpoint
La stessa richiesta compatibile con OpenAI raggiunge qualsiasi provider, e il bilanciamento con rilevamento dello stato distribuisce il carico tra quelli attivi. Salute, peso e priorità per canale escludono automaticamente gli upstream non disponibili dalla rotazione, e le peculiarità specifiche di ogni provider vengono normalizzate nell'adattatore, così il codice client non richiede mai ramificazioni.
Un solo nome. Ogni modello.
Scrivi orcarouter/auto una volta sola. Da quel momento, ogni prompt viene analizzato durante il transito e inviato al modello che lo gestisce meglio al costo più basso. Un nuovo modello all'avanguardia arriva un martedì e il tuo traffico inizia a usarlo — nessuna migrazione, nessuna release client, nessuna riunione.
Un'impostazione predefinita, non una scatola nera.
Punta un workspace sull'obiettivo che ti interessa davvero. Più economico. Qualità. Bilanciato. Oppure Adattivo, che apprende il compromesso dal tuo traffico anziché dai benchmark altrui. Ogni scelta effettuata appare nella ricevuta insieme al punteggio che l'ha determinata.