Privat durch Architektur · Geschützt bei jedem Aufruf

Ein Gateway. Jedes Modell. Deine Daten bleiben deine.

Private Inferenz auf 200+ Modellen, geschützt bei jedem Aufruf. Kein Aufschlag bei nutzungsbasierter Abrechnung und Abos. Oder bring deine eigenen Schlüssel mit.

Ohne Kreditkarte · in 60 Sekunden live · Prompts werden nicht protokolliert, solange du es nicht einschaltest

200+
Modelle, ein Endpunkt
0%
Token-Aufschlag, nie
0 B
Prompts standardmäßig gespeichert
Protokollierung ist aus, bis Sie sie einschalten
40+%
geringere Inferenzkosten
durch cache-bewusstes adaptives Routing
99%
Routing-Genauigkeit
mit Eskalation an Frontier-Modelle
<10ms
Routing-Latenz mit automatischem Failover
Alle Integrationen
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Eine Zeile. Wir bewerten jeden Prompt, routen zu Frontier oder OSS – und schlagen 0 $ auf.

Datenschutz & Sicherheit

Privat durch Architektur. Geschützt bei jedem Aufruf.

Was Sie eine KI fragen, gehört Ihnen. Was Ihre Agenten tun, geben Sie frei.

Ihre Daten

Was das Modell und unsere Server sehen können.

  • Data Cloaking

    Maskiert.

    Namen, E-Mail-Adressen und Kartennummern werden durch Platzhalter ersetzt, bevor sie das aufgerufene Modell erreichen, und in der Antwort wiederhergestellt.

    Mit einem Klick
  • ZDR

    Nichts bleibt.

    Prompts werden nicht protokolliert, solange Sie die Protokollierung nicht einschalten. Mit einer Zero-Retention-Vereinbarung bleibt sie dauerhaft aus.

    Standard
  • PQC

    Quantensicher.

    Logs, die Sie aufbewahren, werden mit hybridem ML-KEM versiegelt. Die Kryptografie ist Open Source: SCUTTLE.

    Standard
  • Data Residency

    Ihre Region.

    Geben Sie USA, EU, Vereinigtes Königreich, Asien-Pazifik oder China an, und Ihre Compliance-Berichte werden mit dieser Region gekennzeichnet.

    Auf Anfrage
  • TEE

    Geschützt, auch während der Ausführung.

    Attestierte Enklaven, mit einem Nachweis zu jeder Antwort.

    Auf Anfrage

Ihre Agenten

Was durchkommt – und was ausgeführt wird.

  • Guardrails

    Blockiert, bevor es berechnet wird.

    PII, Geheimnisse, Jailbreaks und Prompt-Injection werden gestoppt, bevor das Modell sie sieht. Musterregeln sind kostenlos; eine KI-Prüfregel berechnet nur ihre eigene Prüfung.

    Mit einem Klick
  • Agent Firewall

    Jeder Tool-Aufruf, bewertet.

    Jeder Tool- und MCP-Aufruf wird erlaubt, einem Menschen zur Prüfung vorgelegt oder vor der Ausführung blockiert.

    Standardmäßig im Beobachtungsmodus
  • Compliance Packs

    Auf 32 Frameworks abgebildet.

    Eine Richtlinie pro Regelwerk. Erst am echten Traffic beobachten, dann die Durchsetzung einschalten.

    Bezahlte Tarife

Außerdem:Warteschlange für menschliche FreigabenBedrohungen nach OWASP LLM Top 10 und MITRE ATLAS klassifiziertDas öffentliche Archiv von Agenten-Vorfällen

Das Gateway

Klüger routen. Weniger ausgeben.

Routen

Jeder Prompt wird bewertet und an das beste Modell geschickt.

Modelle ansehen

Beobachten

Logs, wenn du sie willst, laufende Kosten und ein Beleg pro Prompt.

Beleg ansehen

Verwalten

Prompts versionieren und gecachte Aufrufe wiederverwenden – ohne Codeänderung.

Prompts versionieren
Modelle

Jedes Modell. Eine Preisliste.

Die neuesten aus 200+ Modellen, live, zum eigenen Preis des Anbieters.

Alle 200+ ansehen →
ModellWeitergeleitet anEingabe /MAusgabe /MKontextPrivate Route
openai/gpt-6.1-solTextNEUOpenAI Direct$2.00$10.001MKeine private Route
anthropic/claude-sonnet-5.5TextNEUAnthropic Direct$2.00$10.001MKeine private Route
typesafe/jev-1.13TextNEU—$0.042$0.04266KKeine private Route
openai/gpt-6-lunaTextNEUOpenAI Direct$0.100$0.5001MKeine private Route
openai/gpt-6-solTextNEUOpenAI Direct$2.00$10.001MKeine private Route
anthropic/claude-opus-5.5TextNEUAnthropic Direct$4.00$20.001MKeine private Route
grok/grok-4.7TextNEU—$2.00$6.00500KKeine private Route
orca/orcaverify-text1.0TextNEU—$2.00$2.00—Keine private Route
+ 194 weitere Modelle · Preise alle 60 Sek. aktualisiert
Einrichtung

In 60 Sekunden live.

Schritt 1

SDK auf uns zeigen

Setze base_url auf api.orcarouter.ai/v1 und tausche deinen API-Key aus. Sonst keine Codeänderung.

→
Schritt 2

Wir routen, schützen und beobachten

Bewertet in unter 1 ms – mit Failover, Caching und vollständigen Logs.

→
Schritt 3

Du shippst, über einen Endpunkt

Direkt zu jedem Anbieter zu dessen Listenpreis – wir schlagen $0 pro Token auf.

Preise

Wir schlagen nie etwas auf die Tokens auf, die du kaufst.

Unsere Einnahmen stammen aus optionalen Team-Funktionen.

Hacker

Kostenlos
Für immer. Null Aufschlag auf alle Token.
Routen – 200+ Modelle, Auto-Failover
Beobachten – Basis-Dashboard
Verwalten – Prompt-Versionierung
10 API-Keys · 0 % Token-Aufschlag
Kostenlos starten

Enterprise

Individuell
SLA-Zusagen und dedizierte Kapazität.
Alles aus Team
Unbegrenzte Team-Plätze
Vorrangiger Zugang zu neuen Modellen
Alle verborgenen und Beta-Funktionen
Dedizierte Infrastruktur
99,99 % Uptime-SLA
Dedizierter Support & individuelle Preise
Vertrauen & Compliance
Verlassen Sie sich nicht nur auf unser Wort. Auditberichte gibt es unter NDA, und unsere Post-Quanten-Kryptografie ist Open Source.
Tokens bezahlen

Drei Wege, Tokens zu bezahlen.

Aufladungen und Abos zum Anbieterpreis. Wir schlagen 0 $ auf.

Die Tarife oben gelten für Team-Funktionen. Am Token-Preis ändern sie nichts.

Aus dem Blog

Frisch aus dem Maschinenraum.

Was wir bauen und warum — die neuesten Beiträge.

Alle Beiträge →
FAQ

Datenschutz, Sicherheit und Routing – beantwortet.

Speichern Sie meine Prompts oder trainieren Sie damit?

Wir trainieren nie mit Ihren Prompts. Inhalte von Prompts und Antworten werden nur protokolliert, wenn die Protokollierung für Ihren Workspace eingeschaltet ist; Metadaten (Zeit, Modell, Tokens, Kosten, IP) behalten wir für Abrechnung und Sicherheit. Eine Zero-Retention-Vereinbarung sperrt die Protokollierung dauerhaft.

Wo werden meine Daten verarbeitet?

Beim Anbieter, der das gewählte Modell bereitstellt, in dessen Regionen. Die Datenregion Ihres Workspace (USA, EU, Vereinigtes Königreich, Asien-Pazifik oder China) kennzeichnet Ihre Compliance-Berichte mit dieser Region; wo Ihre Daten gespeichert werden oder die Inferenz läuft, legt sie noch nicht fest.

Was bedeutet hier „quantensicher“?

Request-Logs, die Sie aufbewahren, lassen sich mit hybrider Post-Quanten-Verschlüsselung (ML-KEM-768 + X25519) versiegeln – eine heute abgegriffene Kopie kann auch ein künftiger Quantencomputer nicht öffnen. Der Code ist Open Source: SCUTTLE. In unserem gehosteten Dienst ist das standardmäßig aktiviert.

Was ist ein AI-Router?

Ein AI-Router sitzt zwischen Ihrer App und vielen Modellen und wählt für jede Anfrage das beste Modell. OrcaRouter bewertet jeden Prompt in unter 1 ms und routet ihn — Frontier für schweres Reasoning, Open Source für Routine — über 200+ Modelle ohne Token-Aufschlag.

Was ist ein LLM-Router und wie funktioniert er?

Ein LLM-Router klassifiziert jeden Prompt und ordnet ihn dem Modell zu, das am wahrscheinlichsten zum niedrigsten Preis gut antwortet. OrcaRouter routet über kontextuelle Embeddings mit Online-Lernen aus echtem Traffic — 75,5 % Genauigkeit im öffentlichen RouterArena-Leaderboard.

Ist OrcaRouter ein AI-Gateway?

Ja. OrcaRouter ist ein produktionsreifes AI-Gateway: ein OpenAI-kompatibler Endpunkt mit adaptivem Routing, Load Balancing, automatischem Failover, Guardrails, Agent-Firewall, Prompt-Caching und Observability pro Anfrage.

Was ist ein AI CDN?

Wie ein CDN Inhalte von der besten Edge ausliefert, liefert ein AI CDN Inferenz vom besten Anbieter: gesunde, schnelle, günstige Kapazität, gecachte Wiederhol-Prompts, Failover bei Ausfällen. OrcaRouter übernimmt diese Rolle über 200+ Modelle.

Was ist adaptives Routing?

Adaptives Routing lernt den Qualität/Kosten-Kompromiss aus Ihrem eigenen Traffic. Richten Sie jeden Workspace auf „das Günstigste über der Messlatte", höchste Qualität oder Balance — oder lassen Sie orcarouter/auto die Wahl pro Anfrage nachjustieren.

Brauche ich AI-Gateway und LLM-Router?

Sie lösen verschiedene Probleme — Governance vs. Modellwahl — aber zwei Systeme braucht es nicht: OrcaRouter routet pro Anfrage und setzt Budgets, Guardrails und Observability im selben Hop durch.

Fügt Routing Latenz hinzu?

Die Prompt-Bewertung dauert unter 1 ms, die gesamte Zusatzlatenz bleibt unter 50 ms — meist mehrfach zurückgeholt durch schnellere Anbieter und gecachte Prompt-Tokens.

Schlägt OrcaRouter auf Token-Preise auf?

Nein. Sie zahlen den veröffentlichten Tarif jedes Anbieters; OrcaRouter addiert 0 $ pro Token und verdient an den optionalen Team- und Enterprise-Funktionen.

Kann ich meinen bestehenden OpenAI-SDK-Code behalten?

Ja — stellen Sie base_url auf https://api.orcarouter.ai/v1 um, und Ihr OpenAI-, Anthropic- oder Google-SDK-Code läuft weiter: Chat Completions, Responses, Embeddings, Images, Audio und Streaming.

Was passiert, wenn ein Anbieter ausfällt?

OrcaRouter wiederholt die Anfrage vor Antwortbeginn gegen gesunde Ausweichkapazität desselben oder eines gleichwertigen Modells — Upstream-Ausfälle erreichen Ihre Nutzer nicht.

© 2026 OrcaRouter

Für Anbieter

Du betreibst eine Inferenz-Plattform? Bring deine Modelle auf OrcaRouter.

providers@orcarouter.ai

Community beitreten

Discordsupport@orcarouter.aiXGitHubYouTube