Um gateway. Todos os modelos.

Inferência segura sem margem, por uso ou por assinatura. Ou traga as suas próprias chaves. O roteamento adaptativo reduz a sua fatura.

Sem cartão de crédito · no ar em 60 segundos

200+
modelos, um endpoint
0%
de markup por token, nunca
75.5%
de precisão no roteamento
supera o GPT-5 no RouterArena
<50ms
failover no meio do stream
40+%
menos custo de inferência
com roteamento adaptativo por sessão
<1%
de perda de qualidade
com escalonamento automático para frontier
Todas as integrações
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Uma linha. Avaliamos cada prompt, roteamos para frontier ou OSS e adicionamos $0.

O gateway

Roteie melhor. Lance com segurança. Gaste menos.

Roteie

Cada prompt é avaliado e enviado ao modelo que melhor responde.

Ver modelos

Observe

Registos completos, gastos em tempo real e um recibo por prompt. Sem caixas negras.

Ver um recibo

Gerencie

Faça versões dos prompts e reutilize chamadas em cache sem mexer no código.

Versionar um prompt

Governe

Guardrails e uma firewall de agentes que bloqueiam, não apenas registam.

Ver o firewall
Configuração

No ar em 60 segundos.

Passo 1

Aponte seu SDK para nós

Defina base_url como api.orcarouter.ai/v1 e troque a sua chave de API. Sem outras alterações de código.

Passo 2

Encaminhamos, protegemos e observamos

Avaliado em menos de 1 ms, com failover, cache e registos completos incluídos.

Passo 3

Você lança, em um só endpoint

Direto a cada fornecedor à tarifa publicada — acrescentamos $0 por token.

Modelos

Todos os modelos. Uma lista de preços.

Preços ao vivo, lado a lado — o que pagaria diretamente ao fornecedor.

Ver todos os 200+ →
ModeloRoteado paraEntrada /MSaída /MContextoQualidade
z-ai/glm-5.3NOVOZhipu AI$1.26$3.961M9.0
qwen/qwen3.8-27b-freeNOVOAlibaba Cloud66K4.0
qwen/qwen3.8-27bNOVOAlibaba Cloud$0.330$2.40262K4.0
deepseek/deepseek-v4-pro-0813NOVODeepSeek$0.442$0.8841M7.0
grok/grok-4.6NOVO$2.00$6.00500K9.0
meta/muse-spark-1.2NOVO$1.25$4.251M8.0
qwen/qwen3.8-maxNOVOAlibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731NOVODeepSeek$0.147$0.2951M6.0
+ Mais 194 modelos · preços atualizados a cada 60 s
Pagar pelos tokens

Três formas de pagar pelos tokens.

Recargas e assinaturas pelo preço do provedor. Não acrescentamos nada.

Os planos abaixo são recursos de equipe, não preço por token.

Preços

Nunca ficamos com uma parte do que gasta em tokens.

A nossa receita vem de funcionalidades de equipa opcionais.

Hacker

Grátis
Para sempre. Zero markup em todos os tokens.
Roteie — 200+ modelos, failover automático
Observe — dashboard básico
Gerencie — versionamento de prompts
3 chaves de API · 0% de markup por token
Começar grátis

Enterprise

Personalizado
Compromissos de SLA e capacidade dedicada.
Tudo do Team
Assentos de equipe ilimitados
Acesso prioritário a novos modelos
Todos os recursos ocultos e em beta
Infraestrutura dedicada
SLA de 99.99% de uptime
Suporte dedicado e preços personalizados
Confiança e conformidade
Auditado de forma independente, em conformidade contínua — relatórios disponíveis sob NDA.
Do blog

Direto da casa de máquinas.

O que estamos construindo e por quê — nossos posts mais recentes.

Todos os posts →
FAQ

Roteadores de IA, gateways LLM, roteamento adaptativo — respondido.

O que é um roteador de IA?

Um roteador de IA fica entre seu app e muitos modelos e escolhe o melhor modelo para cada requisição. O OrcaRouter avalia cada prompt em menos de 1 ms e o roteia — frontier para raciocínio difícil, open source para o rotineiro — em mais de 200 modelos, sem margem por token.

O que é um roteador LLM e como funciona?

Um roteador LLM classifica cada prompt e o direciona ao modelo com maior chance de responder bem ao menor custo. O OrcaRouter roteia com embeddings contextuais e aprendizado online do tráfego real — 75,5% de precisão no ranking público RouterArena.

O OrcaRouter é um gateway de IA?

Sim. O OrcaRouter é um gateway de IA de produção: um endpoint compatível com OpenAI com roteamento adaptativo, balanceamento de carga, failover automático, guardrails, firewall de agentes, cache de prompts e observabilidade por requisição.

O que é um AI CDN?

Assim como um CDN entrega conteúdo da melhor borda, um AI CDN entrega inferência do melhor provedor: capacidade saudável, rápida e barata, prompts repetidos em cache, failover em quedas. O OrcaRouter cumpre esse papel em mais de 200 modelos.

O que é roteamento adaptativo?

O roteamento adaptativo aprende o equilíbrio qualidade/custo com o seu próprio tráfego. Aponte cada workspace para "o mais barato que passa na régua", a máxima qualidade ou o equilíbrio — ou deixe o orcarouter/auto ajustar a escolha a cada requisição.

Preciso de um gateway de IA e de um roteador LLM?

Eles resolvem problemas diferentes — governança vs. escolha de modelo — mas você não precisa de dois sistemas: o OrcaRouter roteia por requisição e aplica orçamentos, guardrails e observabilidade no mesmo salto.

O roteamento adiciona latência?

A avaliação do prompt leva menos de 1 ms e a latência adicional total fica abaixo de 50 ms — geralmente recuperada muitas vezes por provedores mais rápidos e tokens de prompt em cache.

O OrcaRouter cobra margem sobre o preço dos tokens?

Não. Você paga a tarifa publicada de cada provedor; o OrcaRouter adiciona US$ 0 por token e monetiza com os recursos opcionais Team e Enterprise.

Posso manter meu código atual do SDK da OpenAI?

Sim — troque o base_url para https://api.orcarouter.ai/v1 e seu código dos SDKs da OpenAI, Anthropic ou Google continua funcionando: Chat Completions, Responses, Embeddings, Images, Audio e streaming.

O que acontece quando um provedor cai?

O OrcaRouter tenta novamente em capacidade reserva saudável do mesmo modelo ou de um equivalente antes de a resposta começar — quedas upstream não chegam aos seus usuários.

Mais inteligente, mais seguro, econômico.

Troque uma linha. É essa a migração.

Supera GPT-5 e Azure no RouterArenaApoiado por pesquisa publicada

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube