하나의 게이트웨이. 모든 모델.

종량제와 구독으로 이용하는 안전한 제로 마크업 추론. 직접 키를 가져올 수도 있습니다. 어댑티브 라우팅으로 청구액을 낮추세요.

신용카드 불필요 · 60초 만에 시작

200+
모델, 하나의 엔드포인트
0%
토큰 마크업, 영원히 없음
75.5%
라우팅 정확도
RouterArena에서 GPT-5보다 우수
<50ms
스트림 중 페일오버
40+%
추론 비용 절감
세션 인식 어댑티브 라우팅으로
<1%
품질 저하
자동 프런티어 에스컬레이션으로
전체 연동
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

단 한 줄. 각 프롬프트를 평가해 프런티어 또는 OSS로 라우팅하고, $0를 더합니다.

게이트웨이

더 똑똑하게 라우팅. 더 안전하게 출시. 더 적게 지출.

라우팅

모든 프롬프트를 평가한 뒤 가장 잘 답하는 모델로 보냅니다.

모델 둘러보기

관측

전체 로그, 실시간 지출, 프롬프트별 영수증. 블랙박스는 없습니다.

영수증 보기

관리

프롬프트를 버전 관리하고 캐시된 호출을 재사용합니다. 코드 수정은 필요 없습니다.

프롬프트 버전 관리하기

거버넌스

가드레일과 에이전트 방화벽이 기록만 하지 않고 실제로 차단합니다.

에이전트 방화벽 보기
설정

60초 만에 시작.

1단계

SDK를 우리에게 연결

base_urlapi.orcarouter.ai/v1로 설정하고 API 키만 바꾸세요. 다른 코드 변경은 필요 없습니다.

2단계

라우팅, 보호, 관측은 저희가

1ms 이내 평가, 장애 조치·캐싱·전체 로그 기본 제공.

3단계

당신은 하나의 엔드포인트로 출시

각 공급자에게 공시 요율 그대로 직접 — 토큰당 $0을 더합니다.

모델

모든 모델. 하나의 가격표.

실시간 가격을 나란히 — 공급자에게 직접 지불하는 금액 그대로입니다.

200+ 전체 보기 →
모델라우팅입력 /M출력 /M컨텍스트품질
z-ai/glm-5.3신규Zhipu AI$1.26$3.961M9.0
qwen/qwen3.8-27b신규Alibaba Cloud$0.330$2.40262K4.0
qwen/qwen3.8-27b-free신규Alibaba Cloud66K4.0
deepseek/deepseek-v4-pro-0813신규DeepSeek$0.442$0.8841M7.0
grok/grok-4.6신규$2.00$6.00500K9.0
meta/muse-spark-1.2신규$1.25$4.251M8.0
qwen/qwen3.8-max신규Alibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731신규DeepSeek$0.147$0.2951M6.0
+ 추가 194개 모델 · 가격은 60초마다 업데이트
토큰 결제 방식

토큰을 결제하는 세 가지 방법.

충전과 구독은 공급자 가격으로 청구되며 추가 요금이 없습니다.

아래 요금제는 팀 기능용이며 토큰 가격을 바꾸지 않습니다.

요금

토큰 지출에서 수수료를 떼지 않습니다.

수익은 선택적인 팀 기능에서 나옵니다.

Hacker

무료
영원히. 모든 토큰에 제로 마크업.
라우팅 — 200+ 모델, 자동 페일오버
관측 — 기본 대시보드
관리 — 프롬프트 버전 관리
API 키 3개 · 0% 토큰 마크업
무료로 시작

엔터프라이즈

맞춤
SLA 보장과 전용 인프라 용량.
Team의 모든 기능
팀 좌석 무제한
신규 모델 우선 이용
모든 비공개 및 베타 기능
전용 인프라
99.99% 가동 시간 SLA
전담 지원 및 맞춤 가격
신뢰 및 규정 준수
독립 감사, 상시 컴플라이언스 — 보고서는 NDA 하에 제공됩니다.
블로그 소식

엔진룸에서 전하는 최신 소식.

무엇을 왜 만드는지 — 최신 글.

모든 글 →
자주 묻는 질문

AI 라우터, LLM 게이트웨이, 어댑티브 라우팅 — 한 번에 답합니다.

AI 라우터란 무엇인가요?

AI 라우터는 앱과 여러 모델 사이에서 요청마다 최적의 모델을 고릅니다. OrcaRouter는 모든 프롬프트를 1ms 이내에 평가해 라우팅하며 — 고난도 추론은 프런티어, 일상 작업은 오픈소스로 — 200개 이상의 모델을 토큰 마진 0으로 지원합니다.

LLM 라우터란 무엇이고 어떻게 동작하나요?

LLM 라우터는 각 프롬프트를 분류해 최저 비용으로 좋은 답을 낼 가능성이 가장 높은 모델에 매칭합니다. OrcaRouter는 컨텍스트 임베딩과 실트래픽 온라인 학습으로 라우팅하며, 공개 RouterArena 리더보드에서 75.5% 정확도를 기록했습니다.

OrcaRouter는 AI 게이트웨이인가요?

네. OrcaRouter는 프로덕션 AI 게이트웨이입니다: OpenAI 호환 단일 엔드포인트에 어댑티브 라우팅, 로드 밸런싱, 자동 페일오버, 가드레일, 에이전트 방화벽, 프롬프트 캐싱, 요청 단위 관측성을 제공합니다.

AI CDN이란 무엇인가요?

CDN이 최적의 엣지에서 콘텐츠를 제공하듯 AI CDN은 최적의 공급자에서 추론을 제공합니다: 건강하고 빠르고 저렴한 용량으로 라우팅, 반복 프롬프트 캐싱, 장애 시 페일오버. OrcaRouter가 200개 이상의 모델에서 이 역할을 합니다.

어댑티브 라우팅이란?

어댑티브 라우팅은 품질/비용 트레이드오프를 당신의 트래픽에서 학습합니다. 워크스페이스마다 "기준을 넘는 것 중 최저가", 최고 품질, 균형을 지정하거나 orcarouter/auto가 요청마다 계속 조정하게 하세요.

AI 게이트웨이와 LLM 라우터가 둘 다 필요한가요?

둘은 다른 문제 — 거버넌스 vs 모델 선택 — 를 풀지만 두 시스템이 필요하진 않습니다: OrcaRouter는 같은 홉에서 요청 단위로 라우팅하며 예산·가드레일·관측성을 집행합니다.

라우팅이 지연을 늘리나요?

프롬프트 평가는 1ms 미만, 총 추가 지연은 50ms 미만입니다 — 보통 더 빠른 공급자와 캐시된 프롬프트 토큰으로 몇 배로 되돌려 받습니다.

OrcaRouter는 토큰 가격에 마진을 붙이나요?

아니요. 각 공급자의 공시 가격 그대로 지불하며, OrcaRouter의 토큰 마진은 $0입니다. 수익은 선택형 Team/Enterprise 기능에서 나옵니다.

기존 OpenAI SDK 코드를 그대로 쓸 수 있나요?

네 — base_url을 https://api.orcarouter.ai/v1 로 바꾸면 OpenAI, Anthropic, Google SDK 코드가 그대로 동작합니다: Chat Completions, Responses, Embeddings, Images, Audio, 스트리밍 모두 지원.

공급자가 다운되면 어떻게 되나요?

OrcaRouter는 응답 시작 전에 동일 또는 동급 모델의 건강한 예비 용량으로 재시도하므로, 업스트림 장애가 사용자에게 드러나지 않습니다.

더 똑똑하게, 더 안전하게, 비용 효율적으로.

한 줄만 교체. 그게 마이그레이션입니다.

RouterArena에서 GPT-5와 Azure를 앞섬공개된 연구로 뒷받침됨

© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

providers@orcarouter.ai

커뮤니티에 참여하세요

Discordsupport@orcarouter.aiXGitHubYouTube