Private Inferenz auf 200+ Modellen, geschützt bei jedem Aufruf. Kein Aufschlag bei nutzungsbasierter Abrechnung und Abos. Oder bring deine eigenen Schlüssel mit.
Ohne Kreditkarte · in 60 Sekunden live · Prompts werden nicht protokolliert, solange du es nicht einschaltest
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Eine Zeile. Wir bewerten jeden Prompt, routen zu Frontier oder OSS – und schlagen 0 $ auf.
Was Sie eine KI fragen, gehört Ihnen. Was Ihre Agenten tun, geben Sie frei.
Was das Modell und unsere Server sehen können.
Data Cloaking
Namen, E-Mail-Adressen und Kartennummern werden durch Platzhalter ersetzt, bevor sie das aufgerufene Modell erreichen, und in der Antwort wiederhergestellt.
Mit einem KlickZDR
Prompts werden nicht protokolliert, solange Sie die Protokollierung nicht einschalten. Mit einer Zero-Retention-Vereinbarung bleibt sie dauerhaft aus.
StandardPQC
Logs, die Sie aufbewahren, werden mit hybridem ML-KEM versiegelt. Die Kryptografie ist Open Source: SCUTTLE.
StandardData Residency
Geben Sie USA, EU, Vereinigtes Königreich, Asien-Pazifik oder China an, und Ihre Compliance-Berichte werden mit dieser Region gekennzeichnet.
Auf AnfrageTEE
Attestierte Enklaven, mit einem Nachweis zu jeder Antwort.
Auf AnfrageWas durchkommt – und was ausgeführt wird.
Guardrails
PII, Geheimnisse, Jailbreaks und Prompt-Injection werden gestoppt, bevor das Modell sie sieht. Musterregeln sind kostenlos; eine KI-Prüfregel berechnet nur ihre eigene Prüfung.
Mit einem KlickAgent Firewall
Jeder Tool- und MCP-Aufruf wird erlaubt, einem Menschen zur Prüfung vorgelegt oder vor der Ausführung blockiert.
Standardmäßig im BeobachtungsmodusCompliance Packs
Eine Richtlinie pro Regelwerk. Erst am echten Traffic beobachten, dann die Durchsetzung einschalten.
Bezahlte TarifeAußerdem:Warteschlange für menschliche FreigabenBedrohungen nach OWASP LLM Top 10 und MITRE ATLAS klassifiziertDas öffentliche Archiv von Agenten-Vorfällen
Prompts versionieren und gecachte Aufrufe wiederverwenden – ohne Codeänderung.
Prompts versionierenDie neuesten aus 200+ Modellen, live, zum eigenen Preis des Anbieters.
| Modell | Weitergeleitet an | Eingabe /M | Ausgabe /M | Kontext | Private Route |
|---|---|---|---|---|---|
| openai/gpt-6.1-solTextNEU | OpenAI Direct | $2.00 | $10.00 | 1M | Keine private Route |
| anthropic/claude-sonnet-5.5TextNEU | Anthropic Direct | $2.00 | $10.00 | 1M | Keine private Route |
| typesafe/jev-1.13TextNEU | — | $0.042 | $0.042 | 66K | Keine private Route |
| openai/gpt-6-lunaTextNEU | OpenAI Direct | $0.100 | $0.500 | 1M | Keine private Route |
| openai/gpt-6-solTextNEU | OpenAI Direct | $2.00 | $10.00 | 1M | Keine private Route |
| anthropic/claude-opus-5.5TextNEU | Anthropic Direct | $4.00 | $20.00 | 1M | Keine private Route |
| grok/grok-4.7TextNEU | — | $2.00 | $6.00 | 500K | Keine private Route |
| orca/orcaverify-text1.0TextNEU | — | $2.00 | $2.00 | — | Keine private Route |
| + 194 weitere Modelle · Preise alle 60 Sek. aktualisiert | |||||
Setze base_url auf api.orcarouter.ai/v1 und tausche deinen API-Key aus. Sonst keine Codeänderung.
Bewertet in unter 1 ms – mit Failover, Caching und vollständigen Logs.
Direkt zu jedem Anbieter zu dessen Listenpreis – wir schlagen $0 pro Token auf.
Unsere Einnahmen stammen aus optionalen Team-Funktionen.
Aufladungen und Abos zum Anbieterpreis. Wir schlagen 0 $ auf.
Aufladen, wann du willst. Anbieterpreis, Beleg pro Aufruf.
Lädt dein Guthaben in jeder Periode auf. Voller Betrag, jedes Modell, mit Bonusguthaben bei größeren Paketen.
Nutze deine eigenen Anbieter-Schlüssel, Ratenlimits und Guthaben.
Die Tarife oben gelten für Team-Funktionen. Am Token-Preis ändern sie nichts.
Was wir bauen und warum — die neuesten Beiträge.

Wir trainieren nie mit Ihren Prompts. Inhalte von Prompts und Antworten werden nur protokolliert, wenn die Protokollierung für Ihren Workspace eingeschaltet ist; Metadaten (Zeit, Modell, Tokens, Kosten, IP) behalten wir für Abrechnung und Sicherheit. Eine Zero-Retention-Vereinbarung sperrt die Protokollierung dauerhaft.
Beim Anbieter, der das gewählte Modell bereitstellt, in dessen Regionen. Die Datenregion Ihres Workspace (USA, EU, Vereinigtes Königreich, Asien-Pazifik oder China) kennzeichnet Ihre Compliance-Berichte mit dieser Region; wo Ihre Daten gespeichert werden oder die Inferenz läuft, legt sie noch nicht fest.
Request-Logs, die Sie aufbewahren, lassen sich mit hybrider Post-Quanten-Verschlüsselung (ML-KEM-768 + X25519) versiegeln – eine heute abgegriffene Kopie kann auch ein künftiger Quantencomputer nicht öffnen. Der Code ist Open Source: SCUTTLE. In unserem gehosteten Dienst ist das standardmäßig aktiviert.
Ein AI-Router sitzt zwischen Ihrer App und vielen Modellen und wählt für jede Anfrage das beste Modell. OrcaRouter bewertet jeden Prompt in unter 1 ms und routet ihn — Frontier für schweres Reasoning, Open Source für Routine — über 200+ Modelle ohne Token-Aufschlag.
Ein LLM-Router klassifiziert jeden Prompt und ordnet ihn dem Modell zu, das am wahrscheinlichsten zum niedrigsten Preis gut antwortet. OrcaRouter routet über kontextuelle Embeddings mit Online-Lernen aus echtem Traffic — 75,5 % Genauigkeit im öffentlichen RouterArena-Leaderboard.
Ja. OrcaRouter ist ein produktionsreifes AI-Gateway: ein OpenAI-kompatibler Endpunkt mit adaptivem Routing, Load Balancing, automatischem Failover, Guardrails, Agent-Firewall, Prompt-Caching und Observability pro Anfrage.
Wie ein CDN Inhalte von der besten Edge ausliefert, liefert ein AI CDN Inferenz vom besten Anbieter: gesunde, schnelle, günstige Kapazität, gecachte Wiederhol-Prompts, Failover bei Ausfällen. OrcaRouter übernimmt diese Rolle über 200+ Modelle.
Adaptives Routing lernt den Qualität/Kosten-Kompromiss aus Ihrem eigenen Traffic. Richten Sie jeden Workspace auf „das Günstigste über der Messlatte", höchste Qualität oder Balance — oder lassen Sie orcarouter/auto die Wahl pro Anfrage nachjustieren.
Sie lösen verschiedene Probleme — Governance vs. Modellwahl — aber zwei Systeme braucht es nicht: OrcaRouter routet pro Anfrage und setzt Budgets, Guardrails und Observability im selben Hop durch.
Die Prompt-Bewertung dauert unter 1 ms, die gesamte Zusatzlatenz bleibt unter 50 ms — meist mehrfach zurückgeholt durch schnellere Anbieter und gecachte Prompt-Tokens.
Nein. Sie zahlen den veröffentlichten Tarif jedes Anbieters; OrcaRouter addiert 0 $ pro Token und verdient an den optionalen Team- und Enterprise-Funktionen.
Ja — stellen Sie base_url auf https://api.orcarouter.ai/v1 um, und Ihr OpenAI-, Anthropic- oder Google-SDK-Code läuft weiter: Chat Completions, Responses, Embeddings, Images, Audio und Streaming.
OrcaRouter wiederholt die Anfrage vor Antwortbeginn gegen gesunde Ausweichkapazität desselben oder eines gleichwertigen Modells — Upstream-Ausfälle erreichen Ihre Nutzer nicht.
Tausche eine Zeile. Das ist die Migration.
Schlägt GPT-5 und Azure auf RouterArenaGestützt durch veröffentlichte ForschungScuttle-Quellcode lesen (öffnet in neuem Tab)Zum Trust Center
OrcaRouterDu betreibst eine Inferenz-Plattform? Bring deine Modelle auf OrcaRouter.
providers@orcarouter.ai