Inferenza privata su 200+ modelli, protetta a ogni chiamata. Zero ricarichi sul pagamento a consumo e sugli abbonamenti. Oppure porta le tue chiavi.
Senza carta di credito · online in 60 secondi · nessun prompt registrato se non lo attivi tu
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Una riga. Valutiamo ogni prompt, instradiamo a frontier o OSS e aggiungiamo $0.
Ciò che chiedi a un’IA resta tuo. Ciò che fanno i tuoi agenti lo approvi tu.
Cosa possono vedere il modello e i nostri server.
Data Cloaking
Nomi, email e numeri di carta vengono sostituiti con segnaposto prima di raggiungere il modello che chiami, e ripristinati nella risposta.
Con un clicZDR
I prompt non vengono registrati finché non attivi la registrazione. Firma un accordo di zero conservazione per bloccarla.
PredefinitoPQC
I log che scegli di conservare vengono sigillati con ML-KEM ibrido. La crittografia è open source: SCUTTLE.
PredefinitoData Residency
Dichiara USA, UE, Regno Unito, Asia-Pacifico o Cina, e i tuoi report di conformità vengono contrassegnati con quella regione.
Su richiestaTEE
Enclave attestate, con una prova per ogni risposta.
Su richiestaCosa passa e cosa viene eseguito.
Guardrails
PII, segreti, jailbreak e prompt injection vengono fermati prima che il modello li veda. Le regole a pattern sono gratuite; una regola con giudice IA addebita solo il proprio controllo.
Con un clicAgent Firewall
Ogni chiamata a strumenti e MCP viene consentita, inviata a una persona per la revisione o bloccata prima dell’esecuzione.
Monitoraggio predefinitoCompliance Packs
Una policy per normativa. Osservala prima sul traffico reale, poi attiva l’applicazione.
Piani a pagamentoInoltre:Coda di approvazione umanaMinacce classificate secondo OWASP LLM Top 10 e MITRE ATLASL’archivio pubblico degli incidenti con agenti
Le novità tra 200+ modelli, in tempo reale, al prezzo del provider stesso.
| Modello | Instradato a | Input /M | Output /M | Contesto | Percorso privato |
|---|---|---|---|---|---|
| openai/gpt-6.1-solTestoNUOVO | OpenAI Direct | $2.00 | $10.00 | 1M | Nessun percorso privato |
| anthropic/claude-sonnet-5.5TestoNUOVO | Anthropic Direct | $2.00 | $10.00 | 1M | Nessun percorso privato |
| typesafe/jev-1.13TestoNUOVO | — | $0.042 | $0.042 | 66K | Nessun percorso privato |
| openai/gpt-6-lunaTestoNUOVO | OpenAI Direct | $0.100 | $0.500 | 1M | Nessun percorso privato |
| openai/gpt-6-solTestoNUOVO | OpenAI Direct | $2.00 | $10.00 | 1M | Nessun percorso privato |
| anthropic/claude-opus-5.5TestoNUOVO | Anthropic Direct | $4.00 | $20.00 | 1M | Nessun percorso privato |
| grok/grok-4.7TestoNUOVO | — | $2.00 | $6.00 | 500K | Nessun percorso privato |
| orca/orcaverify-text1.0TestoNUOVO | — | $2.00 | $2.00 | — | Nessun percorso privato |
| + 194 modelli in più · prezzi aggiornati ogni 60 secondi | |||||
Imposta base_url su api.orcarouter.ai/v1 e sostituisci la tua chiave API. Nessun'altra modifica al codice.
Valutato in meno di 1 ms, con failover, cache e log completi inclusi.
Direttamente a ogni provider alla sua tariffa pubblica: aggiungiamo $0 per token.
I nostri ricavi vengono dalle funzioni per team opzionali.
Ricariche e abbonamenti al prezzo del provider. Non aggiungiamo nulla.
Ricarica quando vuoi. Prezzo pubblico, ricevuta a ogni chiamata.
Ricarica il tuo portafoglio a ogni periodo. Importo pieno, qualsiasi modello, con credito bonus sui piani più grandi.
Utilizza le tue chiavi provider, i limiti di frequenza e i crediti.
I piani qui sopra riguardano le funzionalità per i team. Non cambiano il prezzo dei token.
Cosa costruiamo e perché — i nostri articoli più recenti.

Non addestriamo mai modelli sui tuoi prompt. Il contenuto di prompt e risposte non viene registrato a meno che la registrazione non sia attiva per il tuo workspace; conserviamo i metadati (ora, modello, token, costo, IP) per fatturazione e sicurezza. Un accordo di zero conservazione blocca la registrazione.
Dal provider che serve il modello scelto, nelle sue regioni. L’impostazione della regione dati del tuo workspace (USA, UE, Regno Unito, Asia-Pacifico o Cina) contrassegna i tuoi report di conformità con quella regione; non fissa ancora dove sono conservati i dati né dove avviene l’inferenza.
I log delle richieste che scegli di conservare possono essere sigillati con crittografia post-quantistica ibrida (ML-KEM-768 + X25519): una copia sottratta oggi non potrà essere aperta da un futuro computer quantistico. Il codice è open source: SCUTTLE. È attivo per impostazione predefinita nel nostro servizio ospitato.
Un router IA sta tra la tua app e molti modelli e sceglie il modello migliore per ogni richiesta. OrcaRouter valuta ogni prompt in meno di 1 ms e lo instrada — frontier per il ragionamento difficile, open source per la routine — su oltre 200 modelli senza ricarico sui token.
Un router LLM classifica ogni prompt e lo abbina al modello con più probabilità di rispondere bene al costo più basso. OrcaRouter instrada con embedding contestuali e apprendimento online dal traffico reale: 75,5% di accuratezza nella classifica pubblica RouterArena.
Sì. OrcaRouter è un gateway IA di produzione: un endpoint compatibile OpenAI con routing adattivo, bilanciamento del carico, failover automatico, guardrail, firewall per agenti, cache dei prompt e osservabilità per richiesta.
Come un CDN serve i contenuti dal miglior edge, un AI CDN serve l'inferenza dal miglior provider: capacità sana, veloce ed economica, prompt ripetuti in cache, failover in caso di guasti. OrcaRouter svolge questo ruolo su oltre 200 modelli.
Il routing adattivo impara il compromesso qualità/costo dal tuo traffico. Punta ogni workspace su «il più economico che supera l'asticella», la massima qualità o l'equilibrio — o lascia che orcarouter/auto continui a calibrare la scelta a ogni richiesta.
Risolvono problemi diversi — governance vs scelta del modello — ma non servono due sistemi: OrcaRouter instrada per richiesta e applica budget, guardrail e osservabilità nello stesso hop.
La valutazione del prompt richiede meno di 1 ms e la latenza aggiuntiva totale resta sotto i 50 ms — di solito ripagata più volte da provider più veloci e token di prompt in cache.
No. Paghi la tariffa pubblicata di ogni provider; OrcaRouter aggiunge 0 $ per token e monetizza con le funzioni opzionali Team ed Enterprise.
Sì — sposta base_url su https://api.orcarouter.ai/v1 e il tuo codice SDK OpenAI, Anthropic o Google continua a funzionare: Chat Completions, Responses, Embeddings, Images, Audio e streaming.
OrcaRouter riprova su capacità di riserva sana per lo stesso modello o uno equivalente prima che la risposta inizi: i guasti upstream non arrivano ai tuoi utenti.
Cambia una riga. È tutta qui la migrazione.
Batte GPT-5 e Azure su RouterArenaSupportato da ricerca pubblicataLeggi il codice di Scuttle (apre in una nuova scheda)Visita il Trust Center
OrcaRouterGestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.
providers@orcarouter.ai