Inget pålägg. Högre tillgänglighet. Bättre priser.

En gateway. Alla modeller. Dirigera smartare. Lansera säkrare. Spendera mindre.

OrcaRouter bedömer varje prompt och dirigerar den intelligent. AI av frontier-kvalitet till upp till 40 % lägre kostnad. Adaptiv routning, lastbalansering, guardrails, agentbrandvägg, observability och styrning — allt genom en enda OpenAI-kompatibel endpoint.

Inget kreditkort · igång på 60 sek

Slår GPT-5 & Azure på RouterArenaBackat av publicerad forskning
- client = OpenAI(api_key="sk-...")
+ client = OpenAI(
+ base_url="https://api.orcarouter.ai/v1",
+ api_key="sk-orca-..."
+ )
 
# Everything else stays the same.
response = client.chat.completions.create(
model="orcarouter/auto", # router picks the best model per request
messages=[{"role": "user", "content": "..."}]
)
# → orcarouter/auto grades the prompt → frontier or open-source, zero token markup ✓

En rad. Vi bedömer varje prompt, dirigerar till frontier eller OSS, och lägger till $0.

200+
modeller, en slutpunkt
0%
påslag på tokens, någonsin
75.5%
routingnoggrannhet
<50ms
failover mitt i strömmen
Integrationer

Fungerar med verktygen du redan använder

Drop-in OpenAI-kompatibel, eller anslut agenter via OrcaRouter MCP-servern — behåll din SDK, ditt ramverk och din editor.

OrcaRouter MCP-serverOpenAI SDKGoogle GenAI SDKAnthropic SDKLangChainLlamaIndexVercel AI SDKCamelAIDifyCursorOpenCodePromptfooOpenClawOpenHumanGitHubcURLoch mer
Bygger du på detta? Prata med oss.XDiscordGitHub
AI-gateway för produktion

Smart routning och automatisk failover på varje begäran.

Routning som är mätbart mer träffsäker.

Varje prompt embeddas och dirigeras av en modell som fortsätter lära sig online från verklig trafik. På den publika RouterArena-topplistan (juni 2026) leder den i träffsäkerhet — före GPT-5, Azure, Martian och NotDiamond — med 75,5 %.

contextual embeddingsonline learning<1ms overheadRouterArena
* Baserat på data från RouterArena-topplistan, juni 2026.

En leverantör går ner. Ingen märker det.

När en leverantör hastighetsbegränsar eller ger 5xx-fel försöker OrcaRouter igen med begäran mot en frisk modell bland 200+ alternativ innan svaret börjar — så att tillfälliga driftstopp uppströms inte märks av dina användare.

200+ modelsauto-failoverno 429

Dirigera på dina villkor.

orcarouter/auto är ett smart standardval, inte en svart låda. Rikta varje arbetsyta mot det mål du vill ha — den billigaste modellen som klarar din kvalitetsribba, högsta kvalitet, eller en balans mellan de två — eller låt den lära sig avvägningen från din egen trafik. Du blir aldrig låst till ett enda beteende.

per-workspaceno markup either way<1ms overhead

Behöver du mer än ett läge? Skriv regeln.

När standarden inte räcker till, uttryck routing som kod — versionshanterad, granskningsbar och live på några sekunder. Ingen omdistribuering, ingen klientändring.

YAML + CELversion-controlledlive in seconds
routing.yaml
version: 1
rules:
- id: hard_agent_task
when: task_class == "agent" && difficulty >= 0.6
use:
model: "claude-opus-4-7"
reasoning_effort: high # spend where it matters
- id: short_prompts
when: request.input_tokens < 500
use: { delegate: cheapest }
default:
delegate: balanced # fall back to the chosen mode

Se och bevisa varje anrop — kostnad, modell, latens och varför.

Se allt. Bevisa vad som helst.

Se exakt vad varje begäran kostade, vilken modell som betjänade den, hur lång tid det tog och varför den misslyckades — fullständiga strukturerade loggar som du kan filtrera, spela upp och kopiera som en körbar cURL. En route är aldrig en svart låda.

Per-request logsgrade · model · costcopy-as-cURL

Inget pålägg. Inga svarta lådor.

Du betalar varje leverantör deras exakta pris — vi lägger aldrig till mer än $0 per token. Varje begäran visar bedömningen, den valda modellen, leverantören, latensen och priset, så att kostnaden är genomskinlig, inte en dold blandad taxa.

$0 / tokenprovider costglass-box receipt

Versionshanterade prompter och cachning — utan omdistribution.

Ändra prompter. Inte kod.

Versionshantera prompter bakom namngivna etiketter med A/B-delning och återställning med ett klick. Flytta en etikett och varje begäran plockar upp den direkt — ingen omdistribution, ingen kodändring, ingen klientuppdatering.

VersionedA/BInstant rollbackNo deploy

Betala en gång. Återanvänd gratis.

Upprepade och cachade prompt-tokens faktureras till leverantörens cache-pris — ofta en bråkdel av inputpriset — över tillfälliga 5-minuters- och 1-timmesfönster. Samma svar, mindre kostnad, med cached_tokens på varje kvitto.

cache_controlcached_tokens5m / 1h windows

Guardrails, budgetar och en agentbrandvägg som tillämpar.

Guardrails som stoppar saker.

PII Shield och innehållspolicyer körs innan anropet uppströms faktureras. En blockerad begäran returnerar en ren 400 och debiteras aldrig — guardrails tillämpas inline, loggas inte i efterhand.

PII Shieldenforced pre-billingclean 400

Säkert för ditt team. Och dina agenter.

Budgetar och roller för människor; en riskbedömd brandvägg för agenter. Varje tool- och MCP-anrop bedöms som ALLOW, REVIEW eller BLOCK innan det körs, och avvikelsedetektering flaggar frekvens- och kostnadstoppar mot inlärda baslinjer per veckotimme.

ALLOW · REVIEW · BLOCKMCP gatinganomaly detection
Byggt för agentåldern. Innan du behövde det.

Konfiguration

Igång på 60 sekunder.

En URL-ändring. Din befintliga SDK, modellnamn och strömning fungerar precis som förut.

Steg 1

Peka din SDK mot oss

Ställ in base_url till api.orcarouter.ai/v1 och byt ut din API-nyckel. Inga andra kodändringar behövs.

Steg 2

Vi dirigerar, skyddar och övervakar

Varje anrop dirigeras till den bästa modellen, kontrolleras mot dina skyddsregler och mäts – bedöms på under 1 ms, med inbyggd failover, cachning och fullständig loggning.

Steg 3

Du levererar, via en enda slutpunkt

Trafiken går direkt till varje leverantörs förstapartsAPI till deras publicerade pris — vi lägger till $0 per token. En OpenAI-kompatibel slutpunkt för routning, observerbarhet och styrning.


Varje modell. En prislista.

200+ modeller med prissättning i realtid sida vid sida — vad du skulle betala leverantören direkt. Vi lägger till $0 ovanpå.

Visa alla 200+ modeller →
ModellRoutad tillIndata /MUtdata /MKontextKvalitet
anthropic/claude-opus-5NYAnthropic Direct$5.00$25.001M10.0
google/gemini-3.6-flashNYGoogle Direct$1.50$7.501M8.0
google/gemini-3.5-flash-liteNYGoogle Direct$0.300$2.501M6.0
meta/muse-spark-1.1NY$1.25$4.251M8.0
kimi/kimi-k3NYMoonshot$3.00$15.001M9.0
openai/gpt-5.6-lunaNYOpenAI Direct$1.00$6.001M7.0
openai/gpt-5.6-terraNYOpenAI Direct$2.50$15.001M8.0
openai/gpt-5.6-solNYOpenAI Direct$5.00$30.001M9.0
+ 194 fler modeller · Priser uppdateras var 60:e sekund

Prissättning

Routing är gratis.
Betala för funktioner.

Vi tar aldrig en andel av dina tokenutgifter. Våra intäkter kommer från valfria teamfunktioner.

Nollpåslagsgaranti
Du betalar leverantörerna direkt till deras publicerade priser. Vi lägger inget till ovanpå tokenkostnaderna. Routning är gratis; den valfria Team-planen finansierar plattformen.
$0.00routingavgift

Hacker

Gratis
För alltid. Inget påslag på några tokens.
✓ Routa – 200+ modeller, automatisk failover
✓ Observera — grundläggande instrumentpanel
✓ Hantera – promptversionering
✓ 3 API-nycklar · 0 % påslag på tokens
Kom igång gratis

Enterprise

Anpassad
SLA-åtaganden + privat distribution.
✓ Allt i Team
✓ Privat/lokal distribution
✓ 99,99 % drifttids-SLA
✓ Dedikerad infrastruktur
✓ Dedikerad support och anpassad prissättning
Förtroende och regelefterlevnad
Oberoende granskad, kontinuerligt efterlevande — rapporter tillgängliga under sekretessavtal.

Vanliga frågor

AI-routrar, LLM-gateways, adaptiv routning — besvarat.

Korta, sakliga svar — samma uppsättning som sökmotorer ser i sidans strukturerade data.

Vad är en AI-router?

En AI-router sitter mellan din app och många modeller och väljer den bästa modellen för varje begäran. OrcaRouter bedömer varje prompt på under 1 ms och dirigerar den — frontier för svårt resonemang, open source för rutinuppgifter — över 200+ modeller utan något pålägg på tokens.

Vad är en LLM-router och hur fungerar den?

En LLM-router klassificerar varje prompt och matchar den mot den modell som mest sannolikt svarar bra till lägsta kostnad. OrcaRouter dirigerar utifrån kontextuella embeddings med online-inlärning från livetrafik — 75,5 % träffsäkerhet på den publika RouterArena-topplistan.

Är OrcaRouter en AI-gateway?

Ja. OrcaRouter är en AI-gateway för produktion: en OpenAI-kompatibel endpoint med adaptiv routning, lastbalansering, automatisk failover, guardrails, en agentbrandvägg, prompt-cachning och observability per begäran.

Vad är ett AI-CDN?

Precis som ett CDN levererar innehåll från den bästa noden levererar ett AI-CDN inferens från den bästa leverantören: frisk, snabb, billig kapacitet, cachade upprepade prompter, failover vid driftstopp. OrcaRouter fyller denna roll över 200+ modeller.

Vad är adaptiv routning?

Adaptiv routning lär sig avvägningen mellan kvalitet och kostnad från din egen trafik. Ställ in varje arbetsyta på billigast-som-klarar-ribban, högsta kvalitet eller balanserad — eller låt orcarouter/auto fortsätta finjustera valet per begäran.

Behöver jag både en AI-gateway och en LLM-router?

De löser olika problem — styrning kontra modellval — men du behöver inte två system: OrcaRouter dirigerar per begäran och tillämpar budgetar, guardrails och observability i samma hopp.

Tillför routning latens?

Promptbedömning tar under 1 ms och den totala tillagda latensen håller sig under 50 ms — vilket vanligtvis vinns tillbaka många gånger om genom snabbare leverantörer och cachade prompt-tokens.

Lägger OrcaRouter på ett pålägg på tokenpriser?

Nej. Du betalar varje leverantörs publicerade pris; OrcaRouter lägger till $0 per token och tjänar pengar på valfria Team- och Enterprise-funktioner.

Kan jag behålla min befintliga OpenAI SDK-kod?

Ja — byt base_url till https://api.orcarouter.ai/v1 så fortsätter din OpenAI-, Anthropic- eller Google-SDK-kod att fungera: Chat Completions, Responses, Embeddings, Images, Audio och streaming.

Vad händer när en leverantör går ner?

OrcaRouter försöker igen mot frisk reservkapacitet för samma eller en likvärdig modell innan svaret börjar, så att driftstopp uppströms inte märks av dina användare.

Smartare, säkrare, kostnadseffektivt.

Byt ut en rad. Det är hela migreringen.

Registrera dig med GitHub — inget kreditkort krävs. Du är live på under en minut.

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

Kontakta oss

Gå med i vår community

DiscordEmailXGitHubYouTube