Prywatność w architekturze · Ochrona przy każdym wywołaniu

Jedna brama. Każdy model. Twoje dane zostają Twoje.

Prywatna inferencja na 200+ modelach, chroniona przy każdym wywołaniu. Zero marży przy płatności za użycie i w subskrypcjach. Albo użyj własnych kluczy.

Bez karty kredytowej · działa w 60 sekund · prompty nie są logowane, dopóki tego nie włączysz

200+
modeli, jeden endpoint
0%
narzutu na tokeny, nigdy
0 B
promptów zapisywanych domyślnie
logowanie jest wyłączone, dopóki go nie włączysz
40+%
oszczędności na inferencji
dzięki adaptacyjnemu routingowi uwzględniającemu cache
99%
dokładność routingu
z eskalacją do modeli frontier
<10ms
opóźnienie routingu z automatycznym przełączaniem
Wszystkie integracje
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Jedna linia. Oceniamy każdy prompt, kierujemy go do modelu frontier lub OSS i doliczamy $0.

Prywatność i bezpieczeństwo

Prywatność w architekturze. Ochrona przy każdym wywołaniu.

To, o co pytasz AI, pozostaje Twoje. To, co robią Twoi agenci, zatwierdzasz Ty.

Twoje dane

Co widzi model i nasze serwery.

  • Data Cloaking

    Zamaskowane.

    Imiona, adresy e-mail i numery kart są zastępowane zamiennikami, zanim trafią do wywoływanego modelu, i przywracane w odpowiedzi.

    Jednym kliknięciem
  • ZDR

    Nic nie jest zapisywane.

    Prompty nie są logowane, dopóki nie włączysz logowania. Podpisz umowę o zerowym przechowywaniu, by trwale je zablokować.

    Domyślnie
  • PQC

    Odporne na komputery kwantowe.

    Logi, które zdecydujesz się zachować, są pieczętowane hybrydowym ML-KEM. Kryptografia jest open source: SCUTTLE.

    Domyślnie
  • Data Residency

    Twój region.

    Zadeklaruj USA, UE, Wielką Brytanię, Azję-Pacyfik lub Chiny, a raporty zgodności zostaną oznaczone tym regionem.

    Na życzenie
  • TEE

    Chronione nawet podczas działania.

    Poświadczone enklawy z dowodem dla każdej odpowiedzi.

    Na życzenie

Twoi agenci

Co przechodzi i co się uruchamia.

  • Guardrails

    Zablokowane, zanim trafi na rachunek.

    PII, sekrety, jailbreaki i prompt injection są zatrzymywane, zanim model je zobaczy. Reguły wzorcowe są bezpłatne; reguła z sędzią AI nalicza opłatę tylko za własną kontrolę.

    Jednym kliknięciem
  • Agent Firewall

    Każde wywołanie narzędzia oceniane.

    Każde wywołanie narzędzia i MCP jest dopuszczane, przekazywane człowiekowi do weryfikacji lub blokowane, zanim się wykona.

    Domyślnie w trybie obserwacji
  • Compliance Packs

    Zmapowane na 32 frameworki.

    Jedna polityka na każdą regulację. Najpierw obserwuj ją na prawdziwym ruchu, potem włącz egzekwowanie.

    Plany płatne

Również:Kolejka zatwierdzeń przez człowiekaZagrożenia oznaczone według OWASP LLM Top 10 i MITRE ATLASPubliczne archiwum incydentów z agentami

Brama

Routuj mądrzej. Wydawaj mniej.

Routuj

Każdy prompt jest oceniany i trafia do modelu, który odpowie na niego najlepiej.

Przeglądaj modele

Obserwuj

Logi, kiedy ich potrzebujesz, wydatki na żywo i paragon dla każdego promptu.

Zobacz paragon

Zarządzaj

Wersjonuj prompty i korzystaj ponownie z zapytań z cache — bez zmian w kodzie.

Wersjonuj prompt
Modele

Każdy model. Jeden cennik.

Najnowsze z 200+ modeli, na żywo, w cenie samego dostawcy.

Zobacz wszystkie 200+ →
ModelPrzekierowane doWejście /MWyjście /MKontekstPrywatna trasa
openai/gpt-6.1-solTekstNOWYOpenAI Direct$2.00$10.001MBrak prywatnej trasy
anthropic/claude-sonnet-5.5TekstNOWYAnthropic Direct$2.00$10.001MBrak prywatnej trasy
typesafe/jev-1.13TekstNOWY—$0.042$0.04266KBrak prywatnej trasy
openai/gpt-6-lunaTekstNOWYOpenAI Direct$0.100$0.5001MBrak prywatnej trasy
openai/gpt-6-solTekstNOWYOpenAI Direct$2.00$10.001MBrak prywatnej trasy
anthropic/claude-opus-5.5TekstNOWYAnthropic Direct$4.00$20.001MBrak prywatnej trasy
grok/grok-4.7TekstNOWY—$2.00$6.00500KBrak prywatnej trasy
orca/orcaverify-text1.0TekstNOWY—$2.00$2.00—Brak prywatnej trasy
+ Kolejne 194 modele · ceny aktualizowane co 60 sekund
Konfiguracja

Działa w 60 sekund.

Krok 1

Skieruj swoje SDK do nas

Ustaw base_url na api.orcarouter.ai/v1 i podmień klucz API. Żadnych innych zmian w kodzie.

→
Krok 2

Routujemy, chronimy i obserwujemy

Ocena poniżej 1 ms, z wbudowanym failoverem, cache i pełnymi logami.

→
Krok 3

Ty wdrażasz, na jednym endpoincie

Bezpośrednio do każdego dostawcy po jego cenniku — doliczamy $0 za token.

Cennik

Nigdy nie doliczamy marży do tokenów, które kupujesz.

Zarabiamy na opcjonalnych funkcjach zespołowych.

Hacker

Darmowy
Na zawsze. Zero marży na wszystkich tokenach.
Routuj — 200+ modeli, auto-przełączanie
Obserwuj — podstawowy dashboard
Zarządzaj — wersjonowanie promptów
10 kluczy API · 0% narzutu na tokeny
Zacznij za darmo

Enterprise

Niestandardowy
Zobowiązania SLA i dedykowana moc obliczeniowa.
Wszystko z Team
Nielimitowana liczba miejsc w zespole
Priorytetowy dostęp do nowych modeli
Wszystkie ukryte funkcje i funkcje beta
Dedykowana infrastruktura
99.99% SLA dostępności
Dedykowane wsparcie i ceny na zamówienie
Zaufanie i zgodność
Nie wierz nam na słowo. Raporty z audytów są dostępne w ramach NDA, a nasza kryptografia postkwantowa jest open source.
Płatność za tokeny

Trzy sposoby płatności za tokeny.

Doładowania i subskrypcje po cenie dostawcy. Nie doliczamy nic.

Powyższe plany dotyczą funkcji zespołowych. Nie zmieniają ceny tokenów.

Z bloga

Prosto z maszynowni.

Co budujemy i dlaczego — nasze najnowsze wpisy.

Wszystkie wpisy →
FAQ

Prywatność, bezpieczeństwo i routing — odpowiadamy.

Czy przechowujecie moje prompty lub trenujecie na nich modele?

Nigdy nie trenujemy na Twoich promptach. Treść promptów i odpowiedzi nie jest logowana, chyba że logowanie jest włączone dla Twojego obszaru roboczego; metadane żądań (czas, model, tokeny, koszt, IP) przechowujemy na potrzeby rozliczeń i bezpieczeństwa. Umowa o zerowym przechowywaniu trwale blokuje logowanie treści.

Gdzie przetwarzane są moje dane?

Przez dostawcę obsługującego wybrany model, w jego regionach. Ustawienie regionu danych w Twoim workspace (USA, UE, Wielka Brytania, Azja-Pacyfik lub Chiny) oznacza tym regionem raporty zgodności; nie określa jeszcze, gdzie przechowywane są dane ani gdzie działa inferencja.

Co tu oznacza odporność na komputery kwantowe?

Logi żądań, które zdecydujesz się zachować, mogą być zaszyfrowane hybrydowym szyfrowaniem postkwantowym (ML-KEM-768 + X25519), więc kopii wykonanej dziś nie otworzy przyszły komputer kwantowy. Kod jest open source: SCUTTLE. W naszej usłudze hostowanej jest to domyślnie włączone.

Czym jest router AI?

Router AI stoi między Twoją aplikacją a wieloma modelami i wybiera najlepszy model dla każdego żądania. OrcaRouter ocenia każdy prompt w czasie poniżej 1 ms i kieruje go — frontier do trudnego rozumowania, open source do rutyny — po ponad 200 modelach bez marży za tokeny.

Czym jest router LLM i jak działa?

Router LLM klasyfikuje każdy prompt i dopasowuje go do modelu, który najprawdopodobniej odpowie dobrze przy najniższym koszcie. OrcaRouter kieruje na podstawie osadzeń kontekstowych z uczeniem online na żywym ruchu — 75,5% trafności w publicznym rankingu RouterArena.

Czy OrcaRouter to bramka AI?

Tak. OrcaRouter to produkcyjna bramka AI: jeden endpoint zgodny z OpenAI z routingiem adaptacyjnym, równoważeniem obciążenia, automatycznym failoverem, barierami ochronnymi, zaporą agentów, cache promptów i obserwowalnością per żądanie.

Czym jest AI CDN?

Tak jak CDN serwuje treści z najlepszego węzła brzegowego, AI CDN serwuje inferencję od najlepszego dostawcy: zdrowa, szybka i tania moc, cache powtarzających się promptów, failover przy awariach. OrcaRouter pełni tę rolę dla ponad 200 modeli.

Czym jest routing adaptacyjny?

Routing adaptacyjny uczy się kompromisu jakość/koszt z Twojego własnego ruchu. Ustaw każdy workspace na „najtańsze, co przechodzi poprzeczkę", najwyższą jakość albo balans — lub pozwól orcarouter/auto dostrajać wybór przy każdym żądaniu.

Czy potrzebuję i bramki AI, i routera LLM?

Rozwiązują różne problemy — nadzór vs wybór modelu — ale nie potrzebujesz dwóch systemów: OrcaRouter kieruje per żądanie i egzekwuje budżety, bariery i obserwowalność w tym samym skoku.

Czy routing dodaje opóźnienie?

Ocena promptu trwa poniżej 1 ms, a łączne dodatkowe opóźnienie pozostaje poniżej 50 ms — zwykle odzyskiwane wielokrotnie dzięki szybszym dostawcom i cache tokenów promptu.

Czy OrcaRouter dolicza marżę do cen tokenów?

Nie. Płacisz opublikowaną stawkę każdego dostawcy; OrcaRouter dodaje 0 $ za token, a zarabia na opcjonalnych planach Team i Enterprise.

Czy mogę zostawić dotychczasowy kod OpenAI SDK?

Tak — przełącz base_url na https://api.orcarouter.ai/v1, a Twój kod SDK OpenAI, Anthropic czy Google dalej działa: Chat Completions, Responses, Embeddings, Images, Audio i streaming.

Co się dzieje, gdy dostawca padnie?

OrcaRouter ponawia żądanie na zdrowej rezerwowej mocy tego samego lub równoważnego modelu, zanim zacznie się odpowiedź — awarie upstream nie docierają do Twoich użytkowników.

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

providers@orcarouter.ai

Dołącz do społeczności

Discordsupport@orcarouter.aiXGitHubYouTube