Eén gateway. Elk model.

Veilige inferentie zonder opslag, op basis van gebruik of abonnement. Of neem je eigen sleutels mee. Adaptieve routing verlaagt je rekening.

Geen creditcard · live in 60 seconden

200+
modellen, één endpoint
0%
tokenmarge, ooit
75.5%
routeringsnauwkeurigheid
verslaat GPT-5 op RouterArena
<50ms
failover midden in de stream
40+%
lagere inferentiekosten
met sessiebewuste adaptieve routing
<1%
kwaliteitsverlies
met automatische frontier-escalatie
Alle integraties
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Eén regel. Wij beoordelen elke prompt, routeren naar frontier of OSS, en voegen $0 toe.

De gateway

Routeer slimmer. Lever veiliger. Geef minder uit.

Routeren

Elke prompt wordt beoordeeld en naar het model gestuurd dat hem het best beantwoordt.

Modellen doorbladeren

Observeren

Volledige logs, live uitgaven en een bon per prompt. Geen black boxes.

Bekijk een bon

Beheren

Versiebeheer voor prompts en hergebruik van gecachte calls, zonder code aan te raken.

Prompts versiebeheren

Beheersen

Guardrails en een agent-firewall die tegenhouden, niet alleen loggen.

Bekijk de firewall
Configuratie

Live in 60 seconden.

Stap 1

Richt je SDK op ons

Zet base_url op api.orcarouter.ai/v1 en wissel je API-sleutel. Verder geen codewijzigingen.

Stap 2

Wij routeren, beschermen en observeren

Beoordeeld in minder dan 1 ms, met failover, caching en volledige logs.

Stap 3

Jij levert, op één endpoint

Rechtstreeks naar elke aanbieder tegen diens gepubliceerde tarief — wij tellen $0 per token op.

Modellen

Elk model. Eén prijslijst.

Live prijzen naast elkaar — wat je de aanbieder rechtstreeks zou betalen.

Bekijk alle 200+ →
ModelGerouteerd naarInvoer /MUitvoer /MContextKwaliteit
qwen/qwen3.8-27b-freeNEWAlibaba Cloud262K4.0
qwen/qwen3.8-27bNEWAlibaba Cloud$0.330$2.40262K4.0
deepseek/deepseek-v4-pro-0813NEWDeepSeek$0.442$0.8841M7.0
grok/grok-4.6NEW$2.00$6.00500K9.0
meta/muse-spark-1.2NEW$1.25$4.251M8.0
qwen/qwen3.8-maxNEWAlibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731NEWDeepSeek$0.147$0.2951M6.0
minimax/minimax-h3NEW$0.080 / seconde5.0
+ 194 modellen meer · prijzen worden elke 60 seconden bijgewerkt
Betalen voor tokens

Drie manieren om voor tokens te betalen.

Opwaarderingen en abonnementen tegen aanbiederprijs. Wij tellen niets bij.

De abonnementen hieronder zijn teamfuncties, geen tokenprijs.

Prijzen

Wij nemen nooit een deel van je tokenuitgaven.

Onze inkomsten komen uit optionele teamfuncties.

Hacker

Gratis
Voor altijd. Nul marge op alle tokens.
Route — 200+ modellen, auto-failover
Observeren — basisdashboard
Beheren — promptversionering
3 API-sleutels · 0% tokenmarge
Gratis starten

Enterprise

Op maat
SLA-toezeggingen en toegewijde capaciteit.
Alles in Team
Onbeperkt aantal teamplaatsen
Voorrang bij nieuwe modellen
Alle verborgen en bètafuncties
Toegewijde infrastructuur
99,99% uptime-SLA
Toegewijde support en aangepaste prijzen
Vertrouwen en compliance
Onafhankelijk geauditeerd, doorlopend compliant — rapporten beschikbaar onder NDA.
Van de blog

Vers uit de machinekamer.

Wat we bouwen en waarom — onze nieuwste posts.

Alle posts →
FAQ

AI-routers, LLM-gateways, adaptieve routering — beantwoord.

Wat is een AI-router?

Een AI-router zit tussen je app en veel modellen en kiest per verzoek het beste model. OrcaRouter beoordeelt elke prompt in minder dan 1 ms en routeert hem — frontier voor zwaar redeneren, open source voor routine — over 200+ modellen zonder token-opslag.

Wat is een LLM-router en hoe werkt die?

Een LLM-router classificeert elke prompt en koppelt hem aan het model dat waarschijnlijk het beste antwoordt tegen de laagste kosten. OrcaRouter routeert op contextuele embeddings met online leren van echt verkeer — 75,5% nauwkeurigheid op het publieke RouterArena-leaderboard.

Is OrcaRouter een AI-gateway?

Ja. OrcaRouter is een productie-AI-gateway: één OpenAI-compatibel endpoint met adaptieve routering, load balancing, automatische failover, guardrails, een agent-firewall, prompt-caching en observability per verzoek.

Wat is een AI CDN?

Zoals een CDN content vanaf de beste edge serveert, serveert een AI CDN inferentie vanaf de beste provider: gezonde, snelle, goedkope capaciteit, gecachte herhaalprompts, failover bij storingen. OrcaRouter vervult die rol over 200+ modellen.

Wat is adaptieve routering?

Adaptieve routering leert de kwaliteit/kosten-afweging van je eigen verkeer. Richt elke workspace op "het goedkoopste dat de lat haalt", de hoogste kwaliteit of balans — of laat orcarouter/auto de keuze per verzoek bijsturen.

Heb ik én een AI-gateway én een LLM-router nodig?

Ze lossen verschillende problemen op — governance vs modelkeuze — maar twee systemen zijn niet nodig: OrcaRouter routeert per verzoek en handhaaft budgetten, guardrails en observability in dezelfde hop.

Voegt routering latency toe?

De promptbeoordeling duurt minder dan 1 ms en de totale extra latency blijft onder 50 ms — meestal ruimschoots terugverdiend door snellere providers en gecachte prompt-tokens.

Rekent OrcaRouter een opslag op tokenprijzen?

Nee. Je betaalt het gepubliceerde tarief van elke provider; OrcaRouter voegt $0 per token toe en verdient aan de optionele Team- en Enterprise-functies.

Kan ik mijn bestaande OpenAI SDK-code houden?

Ja — zet base_url op https://api.orcarouter.ai/v1 en je OpenAI-, Anthropic- of Google-SDK-code blijft werken: Chat Completions, Responses, Embeddings, Images, Audio en streaming.

Wat gebeurt er als een provider uitvalt?

OrcaRouter probeert het vóór de start van het antwoord opnieuw op gezonde reservecapaciteit van hetzelfde of een gelijkwaardig model — upstream-storingen bereiken je gebruikers niet.

Slimmer, veiliger, kostenefficiënt.

Vervang één regel. Dat is de migratie.

Verslaat GPT-5 en Azure op RouterArenaOnderbouwd door gepubliceerd onderzoek

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

Neem contact op

Word lid van de community

DiscordEmailXGitHubYouTube