Sichere Inferenz ohne Aufschlag – nutzungsbasiert oder im Abo. Oder bring deine eigenen Schlüssel mit. Adaptives Routing senkt deine Rechnung.
Ohne Kreditkarte · in 60 Sekunden live
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Eine Zeile. Wir bewerten jeden Prompt, routen zu Frontier oder OSS – und schlagen 0 $ auf.
Vollständige Logs, laufende Kosten und ein Beleg pro Prompt. Keine Black Box.
Beleg ansehenPrompts versionieren und gecachte Aufrufe wiederverwenden – ohne Codeänderung.
Prompts versionierenGuardrails und eine Agent-Firewall, die blockieren – nicht nur protokollieren.
Firewall ansehenSetze base_url auf api.orcarouter.ai/v1 und tausche deinen API-Key aus. Sonst keine Codeänderung.
Bewertet in unter 1 ms – mit Failover, Caching und vollständigen Logs.
Direkt zu jedem Anbieter zu dessen Listenpreis – wir schlagen $0 pro Token auf.
Live-Preise nebeneinander – genau das, was du dem Anbieter direkt zahlen würdest.
| Modell | Weitergeleitet an | Eingabe /M | Ausgabe /M | Kontext | Qualität |
|---|---|---|---|---|---|
| z-ai/glm-5.3NEU | Zhipu AI | $1.26 | $3.96 | 1M | 9.0 |
| qwen/qwen3.8-27b-freeNEU | Alibaba Cloud | — | — | 66K | 4.0 |
| qwen/qwen3.8-27bNEU | Alibaba Cloud | $0.330 | $2.40 | 262K | 4.0 |
| deepseek/deepseek-v4-pro-0813NEU | DeepSeek | $0.442 | $0.884 | 1M | 7.0 |
| grok/grok-4.6NEU | — | $2.00 | $6.00 | 500K | 9.0 |
| meta/muse-spark-1.2NEU | — | $1.25 | $4.25 | 1M | 8.0 |
| qwen/qwen3.8-maxNEU | Alibaba Cloud | $2.00 | $6.00 | 1M | 9.0 |
| deepseek/deepseek-v4-flash-0731NEU | DeepSeek | $0.147 | $0.295 | 1M | 6.0 |
| + 194 weitere Modelle · Preise alle 60 Sek. aktualisiert | |||||
Aufladungen und Abos zum Anbieterpreis. Wir schlagen 0 $ auf.
Aufladen, wann du willst. Anbieterpreis, Beleg pro Aufruf.
Lädt dein Guthaben in jeder Periode auf. Voller Betrag, jedes Modell, mit Bonusguthaben bei größeren Paketen.
Nutze deine eigenen Anbieter-Schlüssel, Ratenlimits und Guthaben.
Die Tarife unten gelten Team-Funktionen, nicht dem Token-Preis.
Unsere Einnahmen stammen aus optionalen Team-Funktionen.
Was wir bauen und warum — die neuesten Beiträge.

Ein AI-Router sitzt zwischen Ihrer App und vielen Modellen und wählt für jede Anfrage das beste Modell. OrcaRouter bewertet jeden Prompt in unter 1 ms und routet ihn — Frontier für schweres Reasoning, Open Source für Routine — über 200+ Modelle ohne Token-Aufschlag.
Ein LLM-Router klassifiziert jeden Prompt und ordnet ihn dem Modell zu, das am wahrscheinlichsten zum niedrigsten Preis gut antwortet. OrcaRouter routet über kontextuelle Embeddings mit Online-Lernen aus echtem Traffic — 75,5 % Genauigkeit im öffentlichen RouterArena-Leaderboard.
Ja. OrcaRouter ist ein produktionsreifes AI-Gateway: ein OpenAI-kompatibler Endpunkt mit adaptivem Routing, Load Balancing, automatischem Failover, Guardrails, Agent-Firewall, Prompt-Caching und Observability pro Anfrage.
Wie ein CDN Inhalte von der besten Edge ausliefert, liefert ein AI CDN Inferenz vom besten Anbieter: gesunde, schnelle, günstige Kapazität, gecachte Wiederhol-Prompts, Failover bei Ausfällen. OrcaRouter übernimmt diese Rolle über 200+ Modelle.
Adaptives Routing lernt den Qualität/Kosten-Kompromiss aus Ihrem eigenen Traffic. Richten Sie jeden Workspace auf „das Günstigste über der Messlatte", höchste Qualität oder Balance — oder lassen Sie orcarouter/auto die Wahl pro Anfrage nachjustieren.
Sie lösen verschiedene Probleme — Governance vs. Modellwahl — aber zwei Systeme braucht es nicht: OrcaRouter routet pro Anfrage und setzt Budgets, Guardrails und Observability im selben Hop durch.
Die Prompt-Bewertung dauert unter 1 ms, die gesamte Zusatzlatenz bleibt unter 50 ms — meist mehrfach zurückgeholt durch schnellere Anbieter und gecachte Prompt-Tokens.
Nein. Sie zahlen den veröffentlichten Tarif jedes Anbieters; OrcaRouter addiert 0 $ pro Token und verdient an den optionalen Team- und Enterprise-Funktionen.
Ja — stellen Sie base_url auf https://api.orcarouter.ai/v1 um, und Ihr OpenAI-, Anthropic- oder Google-SDK-Code läuft weiter: Chat Completions, Responses, Embeddings, Images, Audio und Streaming.
OrcaRouter wiederholt die Anfrage vor Antwortbeginn gegen gesunde Ausweichkapazität desselben oder eines gleichwertigen Modells — Upstream-Ausfälle erreichen Ihre Nutzer nicht.
Tausche eine Zeile. Das ist die Migration.
Schlägt GPT-5 und Azure auf RouterArenaGestützt durch veröffentlichte Forschung
OrcaRouterDu betreibst eine Inferenz-Plattform? Bring deine Modelle auf OrcaRouter.
providers@orcarouter.ai