Un gateway. Ogni modello.

Inferenza sicura senza ricarico, a consumo o in abbonamento. Oppure porta le tue chiavi. Il routing adattivo abbassa la tua fattura.

Senza carta di credito · online in 60 secondi

200+
modelli, un endpoint
0%
markup sui token, mai
75.5%
accuratezza del routing
batte GPT-5 su RouterArena
<50ms
failover a metà stream
40+%
di costo di inferenza in meno
con routing adattivo per sessione
<1%
di perdita di qualità
con escalation automatica al frontier
Tutte le integrazioni
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Una riga. Valutiamo ogni prompt, instradiamo a frontier o OSS e aggiungiamo $0.

Il gateway

Routing più intelligente. Deploy più sicuri. Spesa più bassa.

Instrada

Ogni prompt viene valutato e inviato al modello che risponde meglio.

Esplora modelli

Osserva

Log completi, spesa in tempo reale e una ricevuta per prompt. Nessuna scatola nera.

Vedi una ricevuta

Gestisci

Versiona i prompt e riusa le chiamate in cache senza toccare il codice.

Versionare un prompt

Governa

Guardrail e un firewall per agenti che bloccano, non si limitano a registrare.

Vedi il firewall
Configurazione

Live in 60 secondi.

Passo 1

Punta il tuo SDK a noi

Imposta base_url su api.orcarouter.ai/v1 e sostituisci la tua chiave API. Nessun'altra modifica al codice.

Passo 2

Instradiamo, proteggiamo e osserviamo

Valutato in meno di 1 ms, con failover, cache e log completi inclusi.

Passo 3

Tu fai il deploy, su un solo endpoint

Direttamente a ogni provider alla sua tariffa pubblica: aggiungiamo $0 per token.

Modelli

Ogni modello. Un solo listino.

Prezzi live, affiancati: quanto pagheresti direttamente al provider.

Vedi tutti i 200+ →
ModelloInstradato aInput /MOutput /MContestoQualità
z-ai/glm-5.3NUOVOZhipu AI$1.26$3.961M9.0
qwen/qwen3.8-27b-freeNUOVOAlibaba Cloud66K4.0
qwen/qwen3.8-27bNUOVOAlibaba Cloud$0.330$2.40262K4.0
deepseek/deepseek-v4-pro-0813NUOVODeepSeek$0.442$0.8841M7.0
grok/grok-4.6NUOVO$2.00$6.00500K9.0
meta/muse-spark-1.2NUOVO$1.25$4.251M8.0
qwen/qwen3.8-maxNUOVOAlibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731NUOVODeepSeek$0.147$0.2951M6.0
+ 194 modelli in più · prezzi aggiornati ogni 60 secondi
Pagare i token

Tre modi per pagare i token.

Ricariche e abbonamenti al prezzo del provider. Non aggiungiamo nulla.

I piani sotto riguardano funzioni per team, non il prezzo dei token.

Prezzi

Non tratteniamo mai una quota della tua spesa in token.

I nostri ricavi vengono dalle funzioni per team opzionali.

Hacker

Gratis
Per sempre. Zero ricarico su tutti i token.
Instrada — 200+ modelli, auto-failover
Osserva — dashboard base
Gestisci — versioning dei prompt
3 chiavi API · 0% markup sui token
Inizia gratis

Enterprise

Personalizzato
Impegni SLA e capacità dedicata.
Tutto di Team
Postazioni team illimitate
Accesso prioritario ai nuovi modelli
Tutte le funzioni nascoste e beta
Infrastruttura dedicata
SLA uptime 99.99%
Supporto dedicato e prezzi su misura
Fiducia e conformità
Audit indipendente, conformità continua — report disponibili sotto NDA.
Dal blog

Fresco di sala macchine.

Cosa costruiamo e perché — i nostri articoli più recenti.

Tutti gli articoli →
FAQ

Router IA, gateway LLM, routing adattivo — le risposte.

Che cos'è un router IA?

Un router IA sta tra la tua app e molti modelli e sceglie il modello migliore per ogni richiesta. OrcaRouter valuta ogni prompt in meno di 1 ms e lo instrada — frontier per il ragionamento difficile, open source per la routine — su oltre 200 modelli senza ricarico sui token.

Che cos'è un router LLM e come funziona?

Un router LLM classifica ogni prompt e lo abbina al modello con più probabilità di rispondere bene al costo più basso. OrcaRouter instrada con embedding contestuali e apprendimento online dal traffico reale: 75,5% di accuratezza nella classifica pubblica RouterArena.

OrcaRouter è un gateway IA?

Sì. OrcaRouter è un gateway IA di produzione: un endpoint compatibile OpenAI con routing adattivo, bilanciamento del carico, failover automatico, guardrail, firewall per agenti, cache dei prompt e osservabilità per richiesta.

Che cos'è un AI CDN?

Come un CDN serve i contenuti dal miglior edge, un AI CDN serve l'inferenza dal miglior provider: capacità sana, veloce ed economica, prompt ripetuti in cache, failover in caso di guasti. OrcaRouter svolge questo ruolo su oltre 200 modelli.

Che cos'è il routing adattivo?

Il routing adattivo impara il compromesso qualità/costo dal tuo traffico. Punta ogni workspace su «il più economico che supera l'asticella», la massima qualità o l'equilibrio — o lascia che orcarouter/auto continui a calibrare la scelta a ogni richiesta.

Servono sia un gateway IA sia un router LLM?

Risolvono problemi diversi — governance vs scelta del modello — ma non servono due sistemi: OrcaRouter instrada per richiesta e applica budget, guardrail e osservabilità nello stesso hop.

Il routing aggiunge latenza?

La valutazione del prompt richiede meno di 1 ms e la latenza aggiuntiva totale resta sotto i 50 ms — di solito ripagata più volte da provider più veloci e token di prompt in cache.

OrcaRouter ricarica i prezzi dei token?

No. Paghi la tariffa pubblicata di ogni provider; OrcaRouter aggiunge 0 $ per token e monetizza con le funzioni opzionali Team ed Enterprise.

Posso tenere il mio codice OpenAI SDK esistente?

Sì — sposta base_url su https://api.orcarouter.ai/v1 e il tuo codice SDK OpenAI, Anthropic o Google continua a funzionare: Chat Completions, Responses, Embeddings, Images, Audio e streaming.

Cosa succede quando un provider va giù?

OrcaRouter riprova su capacità di riserva sana per lo stesso modello o uno equivalente prima che la risposta inizi: i guasti upstream non arrivano ai tuoi utenti.

Più intelligente, più sicuro, conveniente.

Cambia una riga. È tutta qui la migrazione.

Batte GPT-5 e Azure su RouterArenaSupportato da ricerca pubblicata

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

providers@orcarouter.ai

Unisciti alla community

Discordsupport@orcarouter.aiXGitHubYouTube