Prywatna inferencja na 200+ modelach, chroniona przy każdym wywołaniu. Zero marży przy płatności za użycie i w subskrypcjach. Albo użyj własnych kluczy.
Bez karty kredytowej · działa w 60 sekund · prompty nie są logowane, dopóki tego nie włączysz
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Jedna linia. Oceniamy każdy prompt, kierujemy go do modelu frontier lub OSS i doliczamy $0.
To, o co pytasz AI, pozostaje Twoje. To, co robią Twoi agenci, zatwierdzasz Ty.
Co widzi model i nasze serwery.
Data Cloaking
Imiona, adresy e-mail i numery kart są zastępowane zamiennikami, zanim trafią do wywoływanego modelu, i przywracane w odpowiedzi.
Jednym kliknięciemZDR
Prompty nie są logowane, dopóki nie włączysz logowania. Podpisz umowę o zerowym przechowywaniu, by trwale je zablokować.
DomyślniePQC
Logi, które zdecydujesz się zachować, są pieczętowane hybrydowym ML-KEM. Kryptografia jest open source: SCUTTLE.
DomyślnieData Residency
Zadeklaruj USA, UE, Wielką Brytanię, Azję-Pacyfik lub Chiny, a raporty zgodności zostaną oznaczone tym regionem.
Na życzenieTEE
Poświadczone enklawy z dowodem dla każdej odpowiedzi.
Na życzenieCo przechodzi i co się uruchamia.
Guardrails
PII, sekrety, jailbreaki i prompt injection są zatrzymywane, zanim model je zobaczy. Reguły wzorcowe są bezpłatne; reguła z sędzią AI nalicza opłatę tylko za własną kontrolę.
Jednym kliknięciemAgent Firewall
Każde wywołanie narzędzia i MCP jest dopuszczane, przekazywane człowiekowi do weryfikacji lub blokowane, zanim się wykona.
Domyślnie w trybie obserwacjiCompliance Packs
Jedna polityka na każdą regulację. Najpierw obserwuj ją na prawdziwym ruchu, potem włącz egzekwowanie.
Plany płatneRównież:Kolejka zatwierdzeń przez człowiekaZagrożenia oznaczone według OWASP LLM Top 10 i MITRE ATLASPubliczne archiwum incydentów z agentami
Każdy prompt jest oceniany i trafia do modelu, który odpowie na niego najlepiej.
Przeglądaj modeleWersjonuj prompty i korzystaj ponownie z zapytań z cache — bez zmian w kodzie.
Wersjonuj promptNajnowsze z 200+ modeli, na żywo, w cenie samego dostawcy.
| Model | Przekierowane do | Wejście /M | Wyjście /M | Kontekst | Prywatna trasa |
|---|---|---|---|---|---|
| openai/gpt-6.1-solTekstNOWY | OpenAI Direct | $2.00 | $10.00 | 1M | Brak prywatnej trasy |
| anthropic/claude-sonnet-5.5TekstNOWY | Anthropic Direct | $2.00 | $10.00 | 1M | Brak prywatnej trasy |
| typesafe/jev-1.13TekstNOWY | — | $0.042 | $0.042 | 66K | Brak prywatnej trasy |
| openai/gpt-6-lunaTekstNOWY | OpenAI Direct | $0.100 | $0.500 | 1M | Brak prywatnej trasy |
| openai/gpt-6-solTekstNOWY | OpenAI Direct | $2.00 | $10.00 | 1M | Brak prywatnej trasy |
| anthropic/claude-opus-5.5TekstNOWY | Anthropic Direct | $4.00 | $20.00 | 1M | Brak prywatnej trasy |
| grok/grok-4.7TekstNOWY | — | $2.00 | $6.00 | 500K | Brak prywatnej trasy |
| orca/orcaverify-text1.0TekstNOWY | — | $2.00 | $2.00 | — | Brak prywatnej trasy |
| + Kolejne 194 modele · ceny aktualizowane co 60 sekund | |||||
Ustaw base_url na api.orcarouter.ai/v1 i podmień klucz API. Żadnych innych zmian w kodzie.
Ocena poniżej 1 ms, z wbudowanym failoverem, cache i pełnymi logami.
Bezpośrednio do każdego dostawcy po jego cenniku — doliczamy $0 za token.
Zarabiamy na opcjonalnych funkcjach zespołowych.
Doładowania i subskrypcje po cenie dostawcy. Nie doliczamy nic.
Doładuj, kiedy chcesz. Cena dostawcy, rozliczenie każdego wywołania.
Zasila Twój portfel w każdym okresie. Pełna kwota, dowolny model, z bonusowymi środkami w większych planach.
Korzystaj z własnych kluczy dostawcy, limitów zapytań i kredytów.
Powyższe plany dotyczą funkcji zespołowych. Nie zmieniają ceny tokenów.
Co budujemy i dlaczego — nasze najnowsze wpisy.

Nigdy nie trenujemy na Twoich promptach. Treść promptów i odpowiedzi nie jest logowana, chyba że logowanie jest włączone dla Twojego obszaru roboczego; metadane żądań (czas, model, tokeny, koszt, IP) przechowujemy na potrzeby rozliczeń i bezpieczeństwa. Umowa o zerowym przechowywaniu trwale blokuje logowanie treści.
Przez dostawcę obsługującego wybrany model, w jego regionach. Ustawienie regionu danych w Twoim workspace (USA, UE, Wielka Brytania, Azja-Pacyfik lub Chiny) oznacza tym regionem raporty zgodności; nie określa jeszcze, gdzie przechowywane są dane ani gdzie działa inferencja.
Logi żądań, które zdecydujesz się zachować, mogą być zaszyfrowane hybrydowym szyfrowaniem postkwantowym (ML-KEM-768 + X25519), więc kopii wykonanej dziś nie otworzy przyszły komputer kwantowy. Kod jest open source: SCUTTLE. W naszej usłudze hostowanej jest to domyślnie włączone.
Router AI stoi między Twoją aplikacją a wieloma modelami i wybiera najlepszy model dla każdego żądania. OrcaRouter ocenia każdy prompt w czasie poniżej 1 ms i kieruje go — frontier do trudnego rozumowania, open source do rutyny — po ponad 200 modelach bez marży za tokeny.
Router LLM klasyfikuje każdy prompt i dopasowuje go do modelu, który najprawdopodobniej odpowie dobrze przy najniższym koszcie. OrcaRouter kieruje na podstawie osadzeń kontekstowych z uczeniem online na żywym ruchu — 75,5% trafności w publicznym rankingu RouterArena.
Tak. OrcaRouter to produkcyjna bramka AI: jeden endpoint zgodny z OpenAI z routingiem adaptacyjnym, równoważeniem obciążenia, automatycznym failoverem, barierami ochronnymi, zaporą agentów, cache promptów i obserwowalnością per żądanie.
Tak jak CDN serwuje treści z najlepszego węzła brzegowego, AI CDN serwuje inferencję od najlepszego dostawcy: zdrowa, szybka i tania moc, cache powtarzających się promptów, failover przy awariach. OrcaRouter pełni tę rolę dla ponad 200 modeli.
Routing adaptacyjny uczy się kompromisu jakość/koszt z Twojego własnego ruchu. Ustaw każdy workspace na „najtańsze, co przechodzi poprzeczkę", najwyższą jakość albo balans — lub pozwól orcarouter/auto dostrajać wybór przy każdym żądaniu.
Rozwiązują różne problemy — nadzór vs wybór modelu — ale nie potrzebujesz dwóch systemów: OrcaRouter kieruje per żądanie i egzekwuje budżety, bariery i obserwowalność w tym samym skoku.
Ocena promptu trwa poniżej 1 ms, a łączne dodatkowe opóźnienie pozostaje poniżej 50 ms — zwykle odzyskiwane wielokrotnie dzięki szybszym dostawcom i cache tokenów promptu.
Nie. Płacisz opublikowaną stawkę każdego dostawcy; OrcaRouter dodaje 0 $ za token, a zarabia na opcjonalnych planach Team i Enterprise.
Tak — przełącz base_url na https://api.orcarouter.ai/v1, a Twój kod SDK OpenAI, Anthropic czy Google dalej działa: Chat Completions, Responses, Embeddings, Images, Audio i streaming.
OrcaRouter ponawia żądanie na zdrowej rezerwowej mocy tego samego lub równoważnego modelu, zanim zacznie się odpowiedź — awarie upstream nie docierają do Twoich użytkowników.
Podmień jedną linię. To cała migracja.
Wyprzedza GPT-5 i Azure na RouterArenaPoparte opublikowanymi badaniamiKod źródłowy Scuttle (otwiera się w nowej karcie)Centrum zaufania
OrcaRouterProwadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.
providers@orcarouter.ai