En gateway. Alla modeller.

Säker inferens utan påslag – betala per användning eller via prenumeration. Eller ta med egna nycklar. Adaptiv routing sänker din faktura.

Inget kreditkort · igång på 60 sekunder

200+
modeller, en slutpunkt
0%
påslag på tokens, någonsin
75.5%
routingnoggrannhet
slår GPT-5 på RouterArena
<50ms
failover mitt i strömmen
40+%
lägre inferenskostnad
med sessionsmedveten adaptiv routing
<1%
kvalitetsförlust
med automatisk frontier-eskalering
Alla integrationer
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

En rad. Vi bedömer varje prompt, dirigerar till frontier eller OSS, och lägger till $0.

Gatewayen

Dirigera smartare. Lansera säkrare. Spendera mindre.

Dirigera

Varje prompt betygsätts och skickas till modellen som svarar bäst på den.

Bläddra bland modeller

Observera

Fullständiga loggar, kostnad i realtid och ett kvitto per prompt. Inga svarta lådor.

Se ett kvitto

Hantera

Versionera prompts och återanvänd cachade anrop utan att röra koden.

Versionshantera en prompt

Styra

Skyddsräcken och en agentbrandvägg som stoppar, inte bara loggar.

Se brandväggen
Konfiguration

Igång på 60 sekunder.

Steg 1

Peka din SDK mot oss

Sätt base_url till api.orcarouter.ai/v1 och byt din API-nyckel. Inga andra kodändringar.

Steg 2

Vi dirigerar, skyddar och observerar

Betygsatt på under 1 ms, med failover, cachning och fullständiga loggar.

Steg 3

Du levererar, via en enda slutpunkt

Direkt till varje leverantör till deras listpris – vi lägger på $0 per token.

Modeller

Varje modell. En prislista.

Live-priser sida vid sida – exakt vad du skulle betala leverantören direkt.

Visa alla 200+ →
ModellRoutad tillIndata /MUtdata /MKontextKvalitet
qwen/qwen3.8-27bNYAlibaba Cloud$0.330$2.40262K4.0
qwen/qwen3.8-27b-freeNYAlibaba Cloud262K4.0
deepseek/deepseek-v4-pro-0813NYDeepSeek$0.442$0.8841M7.0
grok/grok-4.6NY$2.00$6.00500K9.0
meta/muse-spark-1.2NY$1.25$4.251M8.0
qwen/qwen3.8-maxNYAlibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731NYDeepSeek$0.147$0.2951M6.0
minimax/minimax-h3NY$0.080 / sekund5.0
+ 194 fler modeller · priser uppdateras var 60:e sekund
Betala för tokens

Tre sätt att betala för tokens.

Påfyllningar och prenumerationer till leverantörspris. Vi lägger inte på något.

Planerna nedan gäller teamfunktioner, inte tokenpriset.

Prissättning

Vi tar aldrig en andel av dina tokenkostnader.

Våra intäkter kommer från valfria teamfunktioner.

Hacker

Gratis
För alltid. Inget påslag på några tokens.
Routa – 200+ modeller, automatisk failover
Observera — grundläggande instrumentpanel
Hantera – promptversionering
3 API-nycklar · 0 % påslag på tokens
Kom igång gratis

Enterprise

Anpassad
SLA-åtaganden och privat driftsättning.
Allt i Team
Privat/lokal distribution
99,99 % drifttids-SLA
Dedikerad infrastruktur
Dedikerad support och anpassad prissättning
Förtroende och regelefterlevnad
Oberoende granskad, kontinuerligt efterlevande — rapporter tillgängliga under sekretessavtal.
Från bloggen

Färskt från maskinrummet.

Vad vi bygger och varför — våra senaste inlägg.

Alla inlägg →
Vanliga frågor

AI-routrar, LLM-gateways, adaptiv routning — besvarat.

Vad är en AI-router?

En AI-router sitter mellan din app och många modeller och väljer den bästa modellen för varje begäran. OrcaRouter bedömer varje prompt på under 1 ms och dirigerar den — frontier för svårt resonemang, open source för rutinuppgifter — över 200+ modeller utan något pålägg på tokens.

Vad är en LLM-router och hur fungerar den?

En LLM-router klassificerar varje prompt och matchar den mot den modell som mest sannolikt svarar bra till lägsta kostnad. OrcaRouter dirigerar utifrån kontextuella embeddings med online-inlärning från livetrafik — 75,5 % träffsäkerhet på den publika RouterArena-topplistan.

Är OrcaRouter en AI-gateway?

Ja. OrcaRouter är en AI-gateway för produktion: en OpenAI-kompatibel endpoint med adaptiv routning, lastbalansering, automatisk failover, guardrails, en agentbrandvägg, prompt-cachning och observability per begäran.

Vad är ett AI-CDN?

Precis som ett CDN levererar innehåll från den bästa noden levererar ett AI-CDN inferens från den bästa leverantören: frisk, snabb, billig kapacitet, cachade upprepade prompter, failover vid driftstopp. OrcaRouter fyller denna roll över 200+ modeller.

Vad är adaptiv routning?

Adaptiv routning lär sig avvägningen mellan kvalitet och kostnad från din egen trafik. Ställ in varje arbetsyta på billigast-som-klarar-ribban, högsta kvalitet eller balanserad — eller låt orcarouter/auto fortsätta finjustera valet per begäran.

Behöver jag både en AI-gateway och en LLM-router?

De löser olika problem — styrning kontra modellval — men du behöver inte två system: OrcaRouter dirigerar per begäran och tillämpar budgetar, guardrails och observability i samma hopp.

Tillför routning latens?

Promptbedömning tar under 1 ms och den totala tillagda latensen håller sig under 50 ms — vilket vanligtvis vinns tillbaka många gånger om genom snabbare leverantörer och cachade prompt-tokens.

Lägger OrcaRouter på ett pålägg på tokenpriser?

Nej. Du betalar varje leverantörs publicerade pris; OrcaRouter lägger till $0 per token och tjänar pengar på valfria Team- och Enterprise-funktioner.

Kan jag behålla min befintliga OpenAI SDK-kod?

Ja — byt base_url till https://api.orcarouter.ai/v1 så fortsätter din OpenAI-, Anthropic- eller Google-SDK-kod att fungera: Chat Completions, Responses, Embeddings, Images, Audio och streaming.

Vad händer när en leverantör går ner?

OrcaRouter försöker igen mot frisk reservkapacitet för samma eller en likvärdig modell innan svaret börjar, så att driftstopp uppströms inte märks av dina användare.

Smartare, säkrare, kostnadseffektivt.

Byt ut en rad. Det är hela migreringen.

Slår GPT-5 & Azure på RouterArenaBackat av publicerad forskning

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

Kontakta oss

Gå med i vår community

DiscordEmailXGitHubYouTube