Privato per architettura · Protetto a ogni chiamata

Un gateway. Ogni modello. I tuoi dati restano tuoi.

Inferenza privata su 200+ modelli, protetta a ogni chiamata. Zero ricarichi sul pagamento a consumo e sugli abbonamenti. Oppure porta le tue chiavi.

Senza carta di credito · online in 60 secondi · nessun prompt registrato se non lo attivi tu

200+
modelli, un endpoint
0%
markup sui token, mai
0 B
prompt salvati per impostazione predefinita
la registrazione resta disattivata finché non la attivi
40+%
di risparmio sui costi di inferenza
con routing adattivo consapevole della cache
99%
accuratezza del routing
con escalation ai modelli di frontiera
<10ms
di latenza di routing con failover automatico
Tutte le integrazioni
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Una riga. Valutiamo ogni prompt, instradiamo a frontier o OSS e aggiungiamo $0.

Privacy e sicurezza

Privato per architettura. Protetto a ogni chiamata.

Ciò che chiedi a un’IA resta tuo. Ciò che fanno i tuoi agenti lo approvi tu.

I tuoi dati

Cosa possono vedere il modello e i nostri server.

  • Data Cloaking

    Mascherato.

    Nomi, email e numeri di carta vengono sostituiti con segnaposto prima di raggiungere il modello che chiami, e ripristinati nella risposta.

    Con un clic
  • ZDR

    Nulla viene conservato.

    I prompt non vengono registrati finché non attivi la registrazione. Firma un accordo di zero conservazione per bloccarla.

    Predefinito
  • PQC

    Resistente ai computer quantistici.

    I log che scegli di conservare vengono sigillati con ML-KEM ibrido. La crittografia è open source: SCUTTLE.

    Predefinito
  • Data Residency

    La tua regione.

    Dichiara USA, UE, Regno Unito, Asia-Pacifico o Cina, e i tuoi report di conformità vengono contrassegnati con quella regione.

    Su richiesta
  • TEE

    Protetto anche durante l’esecuzione.

    Enclave attestate, con una prova per ogni risposta.

    Su richiesta

I tuoi agenti

Cosa passa e cosa viene eseguito.

  • Guardrails

    Bloccato prima di essere addebitato.

    PII, segreti, jailbreak e prompt injection vengono fermati prima che il modello li veda. Le regole a pattern sono gratuite; una regola con giudice IA addebita solo il proprio controllo.

    Con un clic
  • Agent Firewall

    Ogni chiamata agli strumenti, valutata.

    Ogni chiamata a strumenti e MCP viene consentita, inviata a una persona per la revisione o bloccata prima dell’esecuzione.

    Monitoraggio predefinito
  • Compliance Packs

    Mappato su 32 framework.

    Una policy per normativa. Osservala prima sul traffico reale, poi attiva l’applicazione.

    Piani a pagamento

Inoltre:Coda di approvazione umanaMinacce classificate secondo OWASP LLM Top 10 e MITRE ATLASL’archivio pubblico degli incidenti con agenti

Il gateway

Instrada meglio. Spendi meno.

Instrada

Ogni prompt viene valutato e inviato al modello che risponde meglio.

Esplora modelli

Osserva

Log quando vuoi, spesa in tempo reale e una ricevuta per prompt.

Vedi una ricevuta

Gestisci

Versiona i prompt e riusa le chiamate in cache senza toccare il codice.

Versionare un prompt
Modelli

Ogni modello. Un solo listino.

Le novità tra 200+ modelli, in tempo reale, al prezzo del provider stesso.

Vedi tutti i 200+ →
ModelloInstradato aInput /MOutput /MContestoPercorso privato
openai/gpt-6.1-solTestoNUOVOOpenAI Direct$2.00$10.001MNessun percorso privato
anthropic/claude-sonnet-5.5TestoNUOVOAnthropic Direct$2.00$10.001MNessun percorso privato
typesafe/jev-1.13TestoNUOVO—$0.042$0.04266KNessun percorso privato
openai/gpt-6-lunaTestoNUOVOOpenAI Direct$0.100$0.5001MNessun percorso privato
openai/gpt-6-solTestoNUOVOOpenAI Direct$2.00$10.001MNessun percorso privato
anthropic/claude-opus-5.5TestoNUOVOAnthropic Direct$4.00$20.001MNessun percorso privato
grok/grok-4.7TestoNUOVO—$2.00$6.00500KNessun percorso privato
orca/orcaverify-text1.0TestoNUOVO—$2.00$2.00—Nessun percorso privato
+ 194 modelli in più · prezzi aggiornati ogni 60 secondi
Configurazione

Live in 60 secondi.

Passo 1

Punta il tuo SDK a noi

Imposta base_url su api.orcarouter.ai/v1 e sostituisci la tua chiave API. Nessun'altra modifica al codice.

→
Passo 2

Instradiamo, proteggiamo e osserviamo

Valutato in meno di 1 ms, con failover, cache e log completi inclusi.

→
Passo 3

Tu fai il deploy, su un solo endpoint

Direttamente a ogni provider alla sua tariffa pubblica: aggiungiamo $0 per token.

Prezzi

Non applichiamo mai ricarichi sui token che acquisti.

I nostri ricavi vengono dalle funzioni per team opzionali.

Hacker

Gratis
Per sempre. Zero ricarico su tutti i token.
Instrada — 200+ modelli, auto-failover
Osserva — dashboard base
Gestisci — versioning dei prompt
10 chiavi API · 0% markup sui token
Inizia gratis

Enterprise

Personalizzato
Impegni SLA e capacità dedicata.
Tutto di Team
Postazioni team illimitate
Accesso prioritario ai nuovi modelli
Tutte le funzioni nascoste e beta
Infrastruttura dedicata
SLA uptime 99.99%
Supporto dedicato e prezzi su misura
Fiducia e conformità
Non fidarti solo della nostra parola. I report di audit sono disponibili sotto NDA e la nostra crittografia post-quantistica è open source.
Pagare i token

Tre modi per pagare i token.

Ricariche e abbonamenti al prezzo del provider. Non aggiungiamo nulla.

I piani qui sopra riguardano le funzionalità per i team. Non cambiano il prezzo dei token.

Dal blog

Fresco di sala macchine.

Cosa costruiamo e perché — i nostri articoli più recenti.

Tutti gli articoli →
FAQ

Privacy, sicurezza e routing: le risposte.

Conservate i miei prompt o li usate per l’addestramento?

Non addestriamo mai modelli sui tuoi prompt. Il contenuto di prompt e risposte non viene registrato a meno che la registrazione non sia attiva per il tuo workspace; conserviamo i metadati (ora, modello, token, costo, IP) per fatturazione e sicurezza. Un accordo di zero conservazione blocca la registrazione.

Dove vengono elaborati i miei dati?

Dal provider che serve il modello scelto, nelle sue regioni. L’impostazione della regione dati del tuo workspace (USA, UE, Regno Unito, Asia-Pacifico o Cina) contrassegna i tuoi report di conformità con quella regione; non fissa ancora dove sono conservati i dati né dove avviene l’inferenza.

Cosa significa qui «resistente ai computer quantistici»?

I log delle richieste che scegli di conservare possono essere sigillati con crittografia post-quantistica ibrida (ML-KEM-768 + X25519): una copia sottratta oggi non potrà essere aperta da un futuro computer quantistico. Il codice è open source: SCUTTLE. È attivo per impostazione predefinita nel nostro servizio ospitato.

Che cos'è un router IA?

Un router IA sta tra la tua app e molti modelli e sceglie il modello migliore per ogni richiesta. OrcaRouter valuta ogni prompt in meno di 1 ms e lo instrada — frontier per il ragionamento difficile, open source per la routine — su oltre 200 modelli senza ricarico sui token.

Che cos'è un router LLM e come funziona?

Un router LLM classifica ogni prompt e lo abbina al modello con più probabilità di rispondere bene al costo più basso. OrcaRouter instrada con embedding contestuali e apprendimento online dal traffico reale: 75,5% di accuratezza nella classifica pubblica RouterArena.

OrcaRouter è un gateway IA?

Sì. OrcaRouter è un gateway IA di produzione: un endpoint compatibile OpenAI con routing adattivo, bilanciamento del carico, failover automatico, guardrail, firewall per agenti, cache dei prompt e osservabilità per richiesta.

Che cos'è un AI CDN?

Come un CDN serve i contenuti dal miglior edge, un AI CDN serve l'inferenza dal miglior provider: capacità sana, veloce ed economica, prompt ripetuti in cache, failover in caso di guasti. OrcaRouter svolge questo ruolo su oltre 200 modelli.

Che cos'è il routing adattivo?

Il routing adattivo impara il compromesso qualità/costo dal tuo traffico. Punta ogni workspace su «il più economico che supera l'asticella», la massima qualità o l'equilibrio — o lascia che orcarouter/auto continui a calibrare la scelta a ogni richiesta.

Servono sia un gateway IA sia un router LLM?

Risolvono problemi diversi — governance vs scelta del modello — ma non servono due sistemi: OrcaRouter instrada per richiesta e applica budget, guardrail e osservabilità nello stesso hop.

Il routing aggiunge latenza?

La valutazione del prompt richiede meno di 1 ms e la latenza aggiuntiva totale resta sotto i 50 ms — di solito ripagata più volte da provider più veloci e token di prompt in cache.

OrcaRouter ricarica i prezzi dei token?

No. Paghi la tariffa pubblicata di ogni provider; OrcaRouter aggiunge 0 $ per token e monetizza con le funzioni opzionali Team ed Enterprise.

Posso tenere il mio codice OpenAI SDK esistente?

Sì — sposta base_url su https://api.orcarouter.ai/v1 e il tuo codice SDK OpenAI, Anthropic o Google continua a funzionare: Chat Completions, Responses, Embeddings, Images, Audio e streaming.

Cosa succede quando un provider va giù?

OrcaRouter riprova su capacità di riserva sana per lo stesso modello o uno equivalente prima che la risposta inizi: i guasti upstream non arrivano ai tuoi utenti.

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

providers@orcarouter.ai

Unisciti alla community

Discordsupport@orcarouter.aiXGitHubYouTube