Geen opslag. Hogere beschikbaarheid. Betere prijzen.

Eén gateway. Elk model. Routeer slimmer. Lever veiliger. Geef minder uit.

OrcaRouter beoordeelt elke prompt en routeert die intelligent. AI van topkwaliteit tegen tot 40% lagere kosten. Adaptieve routering, load balancing, guardrails, agent-firewall, observability en governance — allemaal via één OpenAI-compatibel endpoint.

Geen creditcard · binnen 60 sec. live

Verslaat GPT-5 en Azure op RouterArenaOnderbouwd door gepubliceerd onderzoek
- client = OpenAI(api_key="sk-...")
+ client = OpenAI(
+ base_url="https://api.orcarouter.ai/v1",
+ api_key="sk-orca-..."
+ )
 
# Everything else stays the same.
response = client.chat.completions.create(
model="orcarouter/auto", # router picks the best model per request
messages=[{"role": "user", "content": "..."}]
)
# → orcarouter/auto grades the prompt → frontier or open-source, zero token markup ✓

Eén regel. Wij beoordelen elke prompt, routeren naar frontier of OSS, en voegen $0 toe.

200+
modellen, één endpoint
0%
tokenmarge, ooit
75.5%
routeringsnauwkeurigheid
<50ms
failover midden in de stream
Integraties

Werkt met de tools die u al gebruikt

Drop-in OpenAI-compatibel, of verbind agents via de OrcaRouter MCP-server — behoud uw SDK, framework en editor.

OrcaRouter MCP-serverOpenAI SDKGoogle GenAI SDKAnthropic SDKLangChainLlamaIndexVercel AI SDKCamelAIDifyCursorOpenCodePromptfooOpenClawOpenHumanGitHubcURLen meer
Hierop aan het bouwen? Neem contact met ons op.XDiscordGitHub
AI-gateway voor productie

Slimme routering en automatische failover bij elk verzoek.

Routering die meetbaar nauwkeuriger is.

Elke prompt wordt geëmbed en gerouteerd door een model dat online blijft leren van echt verkeer. Op het openbare RouterArena-leaderboard (jun 2026) staat het bovenaan qua nauwkeurigheid — vóór GPT-5, Azure, Martian en NotDiamond — met 75,5%.

contextual embeddingsonline learning<1ms overheadRouterArena
* Op basis van RouterArena-leaderboardgegevens, juni 2026.

Een provider valt uit. Niemand merkt het.

Wanneer een provider een rate-limit oplegt of 5xx's geeft, probeert OrcaRouter het verzoek opnieuw bij een gezond model uit 200+ opties voordat het antwoord begint — zodat tijdelijke storingen bovenstrooms niet zichtbaar worden voor uw gebruikers.

200+ modelsauto-failoverno 429

Routeer op jouw voorwaarden.

orcarouter/auto is een slimme standaard, geen black box. Wijs elke werkruimte op het doel dat je wilt — het goedkoopste model dat je kwaliteitslat haalt, de hoogste kwaliteit of een balans tussen beide — of laat het de afweging leren van je eigen verkeer. Je zit nooit vast aan één gedrag.

per-workspaceno markup either way<1ms overhead

Meer nodig dan een modus? Schrijf de regel.

Wanneer de standaard niet genoeg is, druk je routering uit als code — versiebeheerd, beoordeelbaar en binnen seconden live. Geen herdeployment, geen clientwijziging.

YAML + CELversion-controlledlive in seconds
routing.yaml
version: 1
rules:
- id: hard_agent_task
when: task_class == "agent" && difficulty >= 0.6
use:
model: "claude-opus-4-7"
reasoning_effort: high # spend where it matters
- id: short_prompts
when: request.input_tokens < 500
use: { delegate: cheapest }
default:
delegate: balanced # fall back to the chosen mode

Zie en bewijs elke aanroep — kosten, model, latentie en waarom.

Zie alles. Bewijs alles.

Zie precies wat elk verzoek kostte, welk model het bediende, hoe lang het duurde en waarom het mislukte — volledige gestructureerde logs die u kunt filteren, opnieuw afspelen en kopiëren als een uitvoerbare cURL. Een route is nooit een black box.

Per-request logsgrade · model · costcopy-as-cURL

Geen marge. Geen black boxes.

U betaalt elke provider zijn exacte prijs — wij voegen nooit $0 per token toe. Elk verzoek toont de beoordeling, het gekozen model, de provider, de latentie en de prijs, zodat de kosten een glass-box zijn, geen ondoorzichtig gemengd tarief.

$0 / tokenprovider costglass-box receipt

Versiebeheerde prompts en caching — zonder herimplementatie.

Wijzig prompts. Geen code.

Versiebeheer prompts achter benoemde labels met A/B-splitsingen en rollback met één klik. Verplaats een label en elk verzoek pikt het direct op — geen herimplementatie, geen codewijziging, geen client-update.

VersionedA/BInstant rollbackNo deploy

Eén keer betalen. Gratis hergebruiken.

Herhaalde en gecachete prompttokens worden afgerekend tegen het cachetarief van de provider — vaak een fractie van de invoerprijs — over efemere vensters van 5 minuten en 1 uur. Dezelfde antwoorden, lagere kosten, met cached_tokens op elke bon.

cache_controlcached_tokens5m / 1h windows

Guardrails, budgetten en een agent-firewall die afdwingt.

Guardrails die dingen tegenhouden.

PII Shield en contentbeleid draaien voordat de bovenstroomse aanroep wordt afgerekend. Een geblokkeerd verzoek geeft een nette 400 terug en wordt nooit in rekening gebracht — guardrails inline afgedwongen, niet achteraf gelogd.

PII Shieldenforced pre-billingclean 400

Veilig voor uw team. En uw agents.

Budgetten en rollen voor mensen; een risicobeoordeelde firewall voor agents. Elke tool- en MCP-aanroep wordt beoordeeld als ALLOW, REVIEW of BLOCK voordat die wordt uitgevoerd, en anomaliedetectie markeert piekende snelheid en kosten ten opzichte van geleerde baselines per uur van de week.

ALLOW · REVIEW · BLOCKMCP gatinganomaly detection
Gebouwd voor het agent-tijdperk. Voordat u het nodig had.

Configuratie

Live in 60 seconden.

Eén URL-wijziging. Je bestaande SDK, modelnamen en streaming werken precies als voorheen.

Stap 1

Richt je SDK op ons

Stel base_url in op api.orcarouter.ai/v1 en wissel je API-sleutel om. Geen andere codewijzigingen nodig.

Stap 2

Wij routeren, bewaken & observeren

Elke aanroep wordt gerouteerd naar het beste model, getoetst aan je guardrails en gemeten — gegradeerd in minder dan 1ms, met failover, caching en volledige logs ingebouwd.

Stap 3

Jij levert, op één endpoint

Verkeer gaat rechtstreeks naar de first-party API van elke provider tegen hun gepubliceerde tarief — we voegen $0 per token toe. Eén OpenAI-compatibel endpoint voor routering, observability en governance.


Elk model. Eén prijslijst.

200+ modellen met live, zij-aan-zij prijzen — wat u de provider rechtstreeks zou betalen. Wij voegen er $0 bovenop toe.

Alle 200+ modellen bekijken →
ModelGerouteerd naarInvoer /MUitvoer /MContextKwaliteit
deepseek/deepseek-v4-flash-0731NEWDeepSeek$0.147$0.2951M6.0
qwen/qwen3.7-flashNEWAlibaba Cloud$0.030$0.1301M7.0
orca/dubNEW$0.600 /call5.0
anthropic/claude-opus-5NEWAnthropic Direct$5.00$25.001M10.0
google/gemini-3.6-flashNEWGoogle Direct$1.50$7.501M8.0
google/gemini-3.5-flash-liteNEWGoogle Direct$0.300$2.501M6.0
meta/muse-spark-1.1NEW$1.25$4.251M8.0
kimi/kimi-k3NEWMoonshot$3.00$15.001M9.0
+ 194 modellen meer · Prijzen worden elke 60 seconden bijgewerkt

Prijzen

Routering is gratis.
Betaal voor functies.

We nemen nooit een deel van je token-uitgaven. Onze omzet komt uit optionele teamfuncties.

Garantie van nul marge
Je betaalt providers rechtstreeks tegen hun gepubliceerde tarieven. We voegen niets toe bovenop de tokenkosten. Routering is gratis; het optionele Team-abonnement financiert het platform.
$0.00routeringskosten

Hacker

Gratis
Voor altijd. Nul marge op alle tokens.
✓ Route — 200+ modellen, auto-failover
✓ Observeren — basisdashboard
✓ Beheren — promptversionering
✓ 3 API-sleutels · 0% tokenmarge
Gratis starten

Enterprise

Op maat
SLA-toezeggingen + private implementatie.
✓ Alles in Team
✓ Privé / on-prem implementatie
✓ 99,99% uptime-SLA
✓ Toegewijde infrastructuur
✓ Toegewijde support en aangepaste prijzen
Vertrouwen en compliance
Onafhankelijk geauditeerd, doorlopend compliant — rapporten beschikbaar onder NDA.

Van de blog

Vers uit de machinekamer.

Wat we bouwen en waarom — onze nieuwste posts.

Alle posts →

FAQ

AI-routers, LLM-gateways, adaptieve routering — beantwoord.

Korte, feitelijke antwoorden — dezelfde set die zoekmachines zien in de gestructureerde data van deze pagina.

Wat is een AI-router?

Een AI-router zit tussen je app en veel modellen en kiest per verzoek het beste model. OrcaRouter beoordeelt elke prompt in minder dan 1 ms en routeert hem — frontier voor zwaar redeneren, open source voor routine — over 200+ modellen zonder token-opslag.

Wat is een LLM-router en hoe werkt die?

Een LLM-router classificeert elke prompt en koppelt hem aan het model dat waarschijnlijk het beste antwoordt tegen de laagste kosten. OrcaRouter routeert op contextuele embeddings met online leren van echt verkeer — 75,5% nauwkeurigheid op het publieke RouterArena-leaderboard.

Is OrcaRouter een AI-gateway?

Ja. OrcaRouter is een productie-AI-gateway: één OpenAI-compatibel endpoint met adaptieve routering, load balancing, automatische failover, guardrails, een agent-firewall, prompt-caching en observability per verzoek.

Wat is een AI CDN?

Zoals een CDN content vanaf de beste edge serveert, serveert een AI CDN inferentie vanaf de beste provider: gezonde, snelle, goedkope capaciteit, gecachte herhaalprompts, failover bij storingen. OrcaRouter vervult die rol over 200+ modellen.

Wat is adaptieve routering?

Adaptieve routering leert de kwaliteit/kosten-afweging van je eigen verkeer. Richt elke workspace op "het goedkoopste dat de lat haalt", de hoogste kwaliteit of balans — of laat orcarouter/auto de keuze per verzoek bijsturen.

Heb ik én een AI-gateway én een LLM-router nodig?

Ze lossen verschillende problemen op — governance vs modelkeuze — maar twee systemen zijn niet nodig: OrcaRouter routeert per verzoek en handhaaft budgetten, guardrails en observability in dezelfde hop.

Voegt routering latency toe?

De promptbeoordeling duurt minder dan 1 ms en de totale extra latency blijft onder 50 ms — meestal ruimschoots terugverdiend door snellere providers en gecachte prompt-tokens.

Rekent OrcaRouter een opslag op tokenprijzen?

Nee. Je betaalt het gepubliceerde tarief van elke provider; OrcaRouter voegt $0 per token toe en verdient aan de optionele Team- en Enterprise-functies.

Kan ik mijn bestaande OpenAI SDK-code houden?

Ja — zet base_url op https://api.orcarouter.ai/v1 en je OpenAI-, Anthropic- of Google-SDK-code blijft werken: Chat Completions, Responses, Embeddings, Images, Audio en streaming.

Wat gebeurt er als een provider uitvalt?

OrcaRouter probeert het vóór de start van het antwoord opnieuw op gezonde reservecapaciteit van hetzelfde of een gelijkwaardig model — upstream-storingen bereiken je gebruikers niet.

Slimmer, veiliger, kostenefficiënt.

Vervang één regel. Dat is de migratie.

Meld je aan met GitHub — geen creditcard nodig. Binnen een minuut live.

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

Neem contact op

Word lid van de community

DiscordEmailXGitHubYouTube