Jedna nazwa modelu. Każdy model za nią.
Skieruj klienta na orcarouter/auto, a każdy prompt zostanie oceniony i wysłany do modelu spełniającego Twoje kryteria jakości w najniższej cenie — z opcjonalnym osadzaniem semantycznym jako rozszerzeniem.
- Cztery cele na przestrzeń roboczą — Najtańszy, Zbalansowany, Jakościowy lub Adaptacyjny, który uczy się kompromisów na podstawie Twojego ruchu.
- Uczenie online: router stale aktualizuje się na podstawie wyników produkcyjnych, a nie zamrożonych testów porównawczych.
- Routing domyślnie zajmuje poniżej 1 ms; po włączeniu osadzania semantycznego dochodzi jeszcze wywołanie osadzania. W obu przypadkach ocena i wybrany model trafiają na każdy rachunek.
Ponad 40 dostawców, jeden endpoint
To samo żądanie zgodne z OpenAI dociera do dowolnego dostawcy, a równoważenie obciążenia uwzględniające stan zdrowia rozkłada ruch na dostępne serwery. Stan, waga i priorytet każdego kanału automatycznie wykluczają niedostępne zasoby z rotacji, a specyficzne różnice dostawców są normalizowane w adapterze — Twój kod klienta nie wymaga rozgałęzień.
Jedna nazwa. Każdy model.
Piszesz orcarouter/auto raz. Od tej chwili każdy prompt jest analizowany po drodze i kierowany do modelu, który odpowie na niego najlepiej za najmniejsze pieniądze. Nowy model pojawia się w środę i Twój ruch zaczyna go używać — bez migracji, bez nowej wersji klienta, bez żadnego spotkania.
Domyślna reguła, nie czarna skrzynka.
Skieruj przestrzeń roboczą na cel, który naprawdę Cię interesuje: najtaniej, jakościowo, wyważenie. Albo Adaptacyjnie — tryb, który uczy się kompromisu z Twojego własnego ruchu, a nie cudzych benchmarków. Każda decyzja trafia na paragon wraz z oceną, która ją uzasadniała.