Inferencia privada en 200+ modelos, protegida en cada llamada. Sin margen en el pago por uso ni en las suscripciones. O usa tus propias claves.
Sin tarjeta de crédito · en marcha en 60 segundos · no se registran prompts a menos que tú lo actives
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Una línea. Calificamos cada prompt, enrutamos a frontera u OSS y añadimos $0.
Lo que le preguntas a una IA sigue siendo tuyo. Lo que hacen tus agentes lo apruebas tú.
Lo que pueden ver el modelo y nuestros servidores.
Data Cloaking
Los nombres, correos y números de tarjeta se sustituyen por marcadores antes de llegar al modelo al que llamas, y se restauran en la respuesta.
Con un clicZDR
Los prompts no se registran a menos que actives el registro. Firma un acuerdo de retención cero para bloquearlo.
PredeterminadoPQC
Los registros que decidas conservar se sellan con ML-KEM híbrido. La criptografía es de código abierto: SCUTTLE.
PredeterminadoData Residency
Declara EE. UU., UE, Reino Unido, Asia-Pacífico o China, y tus informes de cumplimiento quedan etiquetados con esa región.
Bajo solicitudTEE
Enclaves atestiguados, con prueba para cada respuesta.
Bajo solicitudLo que pasa y lo que se ejecuta.
Guardrails
PII, secretos, jailbreaks e inyección de prompts se detienen antes de que el modelo los vea. Las reglas de patrones son gratis; una regla evaluada por IA solo cobra su propia comprobación.
Con un clicAgent Firewall
Cada llamada a herramientas y MCP se permite, se envía a una persona para revisión o se bloquea antes de ejecutarse.
Vigilancia por defectoCompliance Packs
Una política por normativa. Obsérvala primero con tráfico real y después activa la aplicación.
Planes de pagoAdemás:Cola de aprobación humanaAmenazas clasificadas según OWASP LLM Top 10 y MITRE ATLASEl archivo público de incidentes con agentes
Lo más nuevo de 200+ modelos, en vivo, al precio del propio proveedor.
| Modelo | Enrutado a | Entrada /M | Salida /M | Contexto | Ruta privada |
|---|---|---|---|---|---|
| openai/gpt-6.1-solTextoNUEVO | OpenAI Direct | $2.00 | $10.00 | 1M | Sin ruta privada |
| anthropic/claude-sonnet-5.5TextoNUEVO | Anthropic Direct | $2.00 | $10.00 | 1M | Sin ruta privada |
| typesafe/jev-1.13TextoNUEVO | — | $0.042 | $0.042 | 66K | Sin ruta privada |
| openai/gpt-6-lunaTextoNUEVO | OpenAI Direct | $0.100 | $0.500 | 1M | Sin ruta privada |
| openai/gpt-6-solTextoNUEVO | OpenAI Direct | $2.00 | $10.00 | 1M | Sin ruta privada |
| anthropic/claude-opus-5.5TextoNUEVO | Anthropic Direct | $4.00 | $20.00 | 1M | Sin ruta privada |
| grok/grok-4.7TextoNUEVO | — | $2.00 | $6.00 | 500K | Sin ruta privada |
| orca/orcaverify-text1.0TextoNUEVO | — | $2.00 | $2.00 | — | Sin ruta privada |
| + 194 modelos más · precios cada 60 segundos | |||||
Apunta base_url a api.orcarouter.ai/v1 y cambia tu clave de API. Sin más cambios de código.
Calificado en menos de 1 ms, con failover, caché y registros completos incluidos.
Directo a cada proveedor a su tarifa publicada: añadimos $0 por token.
Nuestros ingresos vienen de funciones de equipo opcionales.
Recargas y suscripciones al precio del proveedor. No añadimos nada.
Recarga cuando quieras. Precio público y recibo en cada llamada.
Recarga tu monedero cada periodo. Importe íntegro, cualquier modelo, con crédito extra en los planes más grandes.
Utiliza tus propias claves de proveedor, límites de tasa y créditos.
Los planes de arriba son para funciones de equipo. No cambian el precio de los tokens.
Qué construimos y por qué — nuestros artículos más recientes.

Nunca entrenamos con tus prompts. El contenido de prompts y respuestas no se registra salvo que el registro esté activado para tu espacio de trabajo; conservamos metadatos (hora, modelo, tokens, coste, IP) para facturación y seguridad. Un acuerdo de retención cero bloquea ese registro.
Lo procesa el proveedor que sirve el modelo que elijas, en sus propias regiones. La región de datos de tu espacio de trabajo (EE. UU., UE, Reino Unido, Asia-Pacífico o China) etiqueta tus informes de cumplimiento con esa región; todavía no fija dónde se guardan tus datos ni dónde se ejecuta la inferencia.
Los registros de solicitudes que decidas conservar pueden sellarse con cifrado poscuántico híbrido (ML-KEM-768 + X25519), así que una copia robada hoy no podrá abrirla un futuro ordenador cuántico. El código es abierto: SCUTTLE. Está activado por defecto en nuestro servicio alojado.
Un router de IA se sitúa entre tu aplicación y muchos modelos y elige el mejor modelo para cada petición. OrcaRouter califica cada prompt en menos de 1 ms y lo enruta — frontier para razonamiento difícil, open source para lo rutinario — entre más de 200 modelos sin margen por token.
Un router LLM clasifica cada prompt y lo asigna al modelo con más probabilidades de responder bien al menor coste. OrcaRouter enruta con embeddings contextuales y aprendizaje en línea del tráfico real: 75,5 % de precisión en el ranking público RouterArena.
Sí. OrcaRouter es un gateway de IA de producción: un endpoint compatible con OpenAI con enrutamiento adaptativo, balanceo de carga, failover automático, guardarraíles, firewall de agentes, caché de prompts y observabilidad por petición.
Igual que un CDN sirve contenido desde el mejor borde, un AI CDN sirve inferencia desde el mejor proveedor: capacidad sana, rápida y barata, prompts repetidos en caché y failover ante caídas. OrcaRouter cumple ese papel en más de 200 modelos.
El enrutamiento adaptativo aprende el equilibrio calidad/coste de tu propio tráfico. Apunta cada workspace a «lo más barato que supere el listón», la máxima calidad o el equilibrio — o deja que orcarouter/auto ajuste la elección en cada petición.
Resuelven problemas distintos — gobernanza vs. elección de modelo — pero no hacen falta dos sistemas: OrcaRouter enruta por petición y aplica presupuestos, guardarraíles y observabilidad en el mismo salto.
La calificación del prompt tarda menos de 1 ms y la latencia añadida total queda por debajo de 50 ms — normalmente recuperada con creces por proveedores más rápidos y tokens de prompt cacheados.
No. Pagas la tarifa publicada de cada proveedor; OrcaRouter añade 0 $ por token y monetiza con las funciones opcionales Team y Enterprise.
Sí: cambia base_url a https://api.orcarouter.ai/v1 y tu código de los SDK de OpenAI, Anthropic o Google sigue funcionando: Chat Completions, Responses, Embeddings, Images, Audio y streaming.
OrcaRouter reintenta contra capacidad de respaldo sana del mismo modelo o uno equivalente antes de que empiece la respuesta, así las caídas upstream no llegan a tus usuarios.
Cambia una línea. Esa es la migración.
Supera a GPT-5 y Azure en RouterArenaRespaldado por investigación publicadaLeer el código de Scuttle (abre en una nueva pestaña)Visitar el Centro de confianza
OrcaRouter¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.
providers@orcarouter.ai