Un gateway. Todos los modelos.

Inferencia segura sin recargo, de pago por uso o por suscripción. O usa tus propias claves. El enrutamiento adaptativo reduce tu factura.

Sin tarjeta de crédito · en marcha en 60 segundos

200+
modelos, un endpoint
0%
recargo por token, nunca
75.5%
precisión de enrutamiento
supera a GPT-5 en RouterArena
<50ms
failover en pleno stream
40+%
menos coste de inferencia
con enrutamiento adaptativo por sesión
<1%
de pérdida de calidad
con escalado automático a frontier
Todas las integraciones
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Una línea. Calificamos cada prompt, enrutamos a frontera u OSS y añadimos $0.

La pasarela

Enruta mejor. Lanza seguro. Gasta menos.

Enrutar

Cada prompt se califica y se envía al modelo que mejor lo responde.

Ver modelos

Observar

Registros completos, gasto en vivo y un recibo por prompt. Sin cajas negras.

Ver un recibo

Gestionar

Versiona prompts y reutiliza llamadas en caché sin tocar el código.

Versionar un prompt

Gobernar

Guardrails y un firewall de agentes que bloquean, no solo registran.

Ver el firewall
Configuración

En vivo en 60 segundos.

Paso 1

Apunte su SDK a nosotros

Apunta base_url a api.orcarouter.ai/v1 y cambia tu clave de API. Sin más cambios de código.

Paso 2

Enrutamos, protegemos y observamos

Calificado en menos de 1 ms, con failover, caché y registros completos incluidos.

Paso 3

Tú lanzas, en un solo endpoint

Directo a cada proveedor a su tarifa publicada: añadimos $0 por token.

Modelos

Cada modelo. Una lista de precios.

Precios en vivo, lado a lado: lo que pagarías directamente al proveedor.

Ver los 200+ →
ModeloEnrutado aEntrada /MSalida /MContextoCalidad
z-ai/glm-5.3NUEVOZhipu AI$1.26$3.961M9.0
qwen/qwen3.8-27b-freeNUEVOAlibaba Cloud66K4.0
qwen/qwen3.8-27bNUEVOAlibaba Cloud$0.330$2.40262K4.0
deepseek/deepseek-v4-pro-0813NUEVODeepSeek$0.442$0.8841M7.0
grok/grok-4.6NUEVO$2.00$6.00500K9.0
meta/muse-spark-1.2NUEVO$1.25$4.251M8.0
qwen/qwen3.8-maxNUEVOAlibaba Cloud$2.00$6.001M9.0
deepseek/deepseek-v4-flash-0731NUEVODeepSeek$0.147$0.2951M6.0
+ 194 modelos más · precios cada 60 segundos
Pagar los tokens

Tres formas de pagar tus tokens.

Recargas y suscripciones al precio del proveedor. No añadimos nada.

Los planes de abajo son funciones de equipo, no precio por token.

Precios

Nunca nos quedamos con parte de tu gasto en tokens.

Nuestros ingresos vienen de funciones de equipo opcionales.

Hacker

Gratis
Para siempre. Cero recargo en todos los tokens.
Enrutar — 200+ modelos, failover automático
Observar — dashboard básico
Gestionar — versionado de prompts
3 claves API · 0% de recargo por token
Empieza gratis

Enterprise

Personalizado
Compromisos de SLA y capacidad dedicada.
Todo lo de Team
Puestos de equipo ilimitados
Acceso prioritario a modelos nuevos
Todas las funciones ocultas y en beta
Infraestructura dedicada
SLA de disponibilidad del 99.99%
Soporte dedicado y precios personalizados
Confianza y cumplimiento
Auditado de forma independiente, en cumplimiento continuo — informes disponibles bajo NDA.
Del blog

Recién salido de la sala de máquinas.

Qué construimos y por qué — nuestros artículos más recientes.

Todos los artículos →
FAQ

Routers de IA, gateways LLM, enrutamiento adaptativo — respondido.

¿Qué es un router de IA?

Un router de IA se sitúa entre tu aplicación y muchos modelos y elige el mejor modelo para cada petición. OrcaRouter califica cada prompt en menos de 1 ms y lo enruta — frontier para razonamiento difícil, open source para lo rutinario — entre más de 200 modelos sin margen por token.

¿Qué es un router LLM y cómo funciona?

Un router LLM clasifica cada prompt y lo asigna al modelo con más probabilidades de responder bien al menor coste. OrcaRouter enruta con embeddings contextuales y aprendizaje en línea del tráfico real: 75,5 % de precisión en el ranking público RouterArena.

¿Es OrcaRouter un gateway de IA?

Sí. OrcaRouter es un gateway de IA de producción: un endpoint compatible con OpenAI con enrutamiento adaptativo, balanceo de carga, failover automático, guardarraíles, firewall de agentes, caché de prompts y observabilidad por petición.

¿Qué es un AI CDN?

Igual que un CDN sirve contenido desde el mejor borde, un AI CDN sirve inferencia desde el mejor proveedor: capacidad sana, rápida y barata, prompts repetidos en caché y failover ante caídas. OrcaRouter cumple ese papel en más de 200 modelos.

¿Qué es el enrutamiento adaptativo?

El enrutamiento adaptativo aprende el equilibrio calidad/coste de tu propio tráfico. Apunta cada workspace a «lo más barato que supere el listón», la máxima calidad o el equilibrio — o deja que orcarouter/auto ajuste la elección en cada petición.

¿Necesito un gateway de IA y además un router LLM?

Resuelven problemas distintos — gobernanza vs. elección de modelo — pero no hacen falta dos sistemas: OrcaRouter enruta por petición y aplica presupuestos, guardarraíles y observabilidad en el mismo salto.

¿El enrutamiento añade latencia?

La calificación del prompt tarda menos de 1 ms y la latencia añadida total queda por debajo de 50 ms — normalmente recuperada con creces por proveedores más rápidos y tokens de prompt cacheados.

¿OrcaRouter recarga el precio de los tokens?

No. Pagas la tarifa publicada de cada proveedor; OrcaRouter añade 0 $ por token y monetiza con las funciones opcionales Team y Enterprise.

¿Puedo conservar mi código actual del SDK de OpenAI?

Sí: cambia base_url a https://api.orcarouter.ai/v1 y tu código de los SDK de OpenAI, Anthropic o Google sigue funcionando: Chat Completions, Responses, Embeddings, Images, Audio y streaming.

¿Qué pasa cuando un proveedor se cae?

OrcaRouter reintenta contra capacidad de respaldo sana del mismo modelo o uno equivalente antes de que empiece la respuesta, así las caídas upstream no llegan a tus usuarios.

Más inteligente, más seguro, rentable.

Cambia una línea. Esa es la migración.

Supera a GPT-5 y Azure en RouterArenaRespaldado por investigación publicada

© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

providers@orcarouter.ai

Únete a la comunidad

Discordsupport@orcarouter.aiXGitHubYouTube