Inferência privada em 200+ modelos, protegida em cada chamada. Zero margem no pagamento por uso e nas assinaturas. Ou traga as suas próprias chaves.
Sem cartão de crédito · no ar em 60 segundos · nenhum prompt é registrado a menos que você ative
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Uma linha. Avaliamos cada prompt, roteamos para frontier ou OSS e adicionamos $0.
O que você pergunta a uma IA continua sendo seu. O que seus agentes fazem é você quem aprova.
O que o modelo e nossos servidores conseguem ver.
Data Cloaking
Nomes, e-mails e números de cartão são trocados por substitutos antes de chegar ao modelo que você chama, e restaurados na resposta.
Em um cliqueZDR
Os prompts não são registrados a menos que você ative o registro. Assine um acordo de retenção zero para bloqueá-lo.
PadrãoPQC
Os logs que você escolher manter são selados com ML-KEM híbrido. A criptografia é open source: SCUTTLE.
PadrãoData Residency
Declare EUA, UE, Reino Unido, Ásia-Pacífico ou China, e seus relatórios de conformidade recebem essa região.
Mediante solicitaçãoTEE
Enclaves atestados, com prova para cada resposta.
Mediante solicitaçãoO que passa e o que é executado.
Guardrails
PII, segredos, jailbreaks e prompt injection são barrados antes de o modelo vê-los. Regras de padrão são gratuitas; uma regra avaliada por IA cobra só a própria verificação.
Em um cliqueAgent Firewall
Cada chamada de ferramenta e MCP é permitida, enviada a uma pessoa para revisão ou bloqueada antes de ser executada.
Monitoramento por padrãoCompliance Packs
Uma política por regulamentação. Observe-a primeiro no tráfego real e depois ative a aplicação.
Planos pagosTambém:Fila de aprovação humanaAmeaças classificadas segundo OWASP LLM Top 10 e MITRE ATLASO arquivo público de incidentes com agentes
Faça versões dos prompts e reutilize chamadas em cache sem mexer no código.
Versionar um promptOs mais novos entre 200+ modelos, ao vivo, pelo preço do próprio fornecedor.
| Modelo | Roteado para | Entrada /M | Saída /M | Contexto | Rota privada |
|---|---|---|---|---|---|
| openai/gpt-6.1-solTextoNOVO | OpenAI Direct | $2.00 | $10.00 | 1M | Sem rota privada |
| anthropic/claude-sonnet-5.5TextoNOVO | Anthropic Direct | $2.00 | $10.00 | 1M | Sem rota privada |
| typesafe/jev-1.13TextoNOVO | — | $0.042 | $0.042 | 66K | Sem rota privada |
| openai/gpt-6-lunaTextoNOVO | OpenAI Direct | $0.100 | $0.500 | 1M | Sem rota privada |
| openai/gpt-6-solTextoNOVO | OpenAI Direct | $2.00 | $10.00 | 1M | Sem rota privada |
| anthropic/claude-opus-5.5TextoNOVO | Anthropic Direct | $4.00 | $20.00 | 1M | Sem rota privada |
| grok/grok-4.7TextoNOVO | — | $2.00 | $6.00 | 500K | Sem rota privada |
| orca/orcaverify-text1.0TextoNOVO | — | $2.00 | $2.00 | — | Sem rota privada |
| + Mais 194 modelos · preços atualizados a cada 60 s | |||||
Defina base_url como api.orcarouter.ai/v1 e troque a sua chave de API. Sem outras alterações de código.
Avaliado em menos de 1 ms, com failover, cache e registos completos incluídos.
Direto a cada fornecedor à tarifa publicada — acrescentamos $0 por token.
A nossa receita vem de funcionalidades de equipa opcionais.
Recargas e assinaturas pelo preço do provedor. Não acrescentamos nada.
Recarregue quando quiser. Preço público e recibo em cada chamada.
Recarrega a sua carteira em cada período. Valor integral, qualquer modelo, com crédito bónus nos planos maiores.
Utilize suas próprias chaves de provedor, limites de taxa e créditos.
Os planos acima são para recursos de equipe. Eles não alteram o preço dos tokens.
O que estamos construindo e por quê — nossos posts mais recentes.

Nunca treinamos com seus prompts. O conteúdo de prompts e respostas não é registrado a menos que o registro esteja ativado para seu espaço de trabalho; mantemos metadados (horário, modelo, tokens, custo, IP) para cobrança e segurança. Um acordo de retenção zero bloqueia esse registro.
Pelo provedor que serve o modelo escolhido, nas regiões desse provedor. A configuração de região de dados do seu workspace (EUA, UE, Reino Unido, Ásia-Pacífico ou China) marca seus relatórios de conformidade com essa região; ela ainda não fixa onde seus dados ficam armazenados nem onde a inferência é executada.
Os registros de requisições que você decide manter podem ser selados com criptografia pós-quântica híbrida (ML-KEM-768 + X25519), então uma cópia obtida hoje não poderá ser aberta por um futuro computador quântico. O código é aberto: SCUTTLE. Vem ativado por padrão no nosso serviço hospedado.
Um roteador de IA fica entre seu app e muitos modelos e escolhe o melhor modelo para cada requisição. O OrcaRouter avalia cada prompt em menos de 1 ms e o roteia — frontier para raciocínio difícil, open source para o rotineiro — em mais de 200 modelos, sem margem por token.
Um roteador LLM classifica cada prompt e o direciona ao modelo com maior chance de responder bem ao menor custo. O OrcaRouter roteia com embeddings contextuais e aprendizado online do tráfego real — 75,5% de precisão no ranking público RouterArena.
Sim. O OrcaRouter é um gateway de IA de produção: um endpoint compatível com OpenAI com roteamento adaptativo, balanceamento de carga, failover automático, guardrails, firewall de agentes, cache de prompts e observabilidade por requisição.
Assim como um CDN entrega conteúdo da melhor borda, um AI CDN entrega inferência do melhor provedor: capacidade saudável, rápida e barata, prompts repetidos em cache, failover em quedas. O OrcaRouter cumpre esse papel em mais de 200 modelos.
O roteamento adaptativo aprende o equilíbrio qualidade/custo com o seu próprio tráfego. Aponte cada workspace para "o mais barato que passa na régua", a máxima qualidade ou o equilíbrio — ou deixe o orcarouter/auto ajustar a escolha a cada requisição.
Eles resolvem problemas diferentes — governança vs. escolha de modelo — mas você não precisa de dois sistemas: o OrcaRouter roteia por requisição e aplica orçamentos, guardrails e observabilidade no mesmo salto.
A avaliação do prompt leva menos de 1 ms e a latência adicional total fica abaixo de 50 ms — geralmente recuperada muitas vezes por provedores mais rápidos e tokens de prompt em cache.
Não. Você paga a tarifa publicada de cada provedor; o OrcaRouter adiciona US$ 0 por token e monetiza com os recursos opcionais Team e Enterprise.
Sim — troque o base_url para https://api.orcarouter.ai/v1 e seu código dos SDKs da OpenAI, Anthropic ou Google continua funcionando: Chat Completions, Responses, Embeddings, Images, Audio e streaming.
O OrcaRouter tenta novamente em capacidade reserva saudável do mesmo modelo ou de um equivalente antes de a resposta começar — quedas upstream não chegam aos seus usuários.
Troque uma linha. É essa a migração.
Supera GPT-5 e Azure no RouterArenaApoiado por pesquisa publicadaLer o código do Scuttle (abre em nova aba)Visitar a Central de Confiança
OrcaRouterOpera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.
providers@orcarouter.ai