from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
只改一行。我们为每条提示词评级,路由到前沿或开源模型,不加价。
把 base_url 改成 api.orcarouter.ai/v1,换上你的 API 密钥。其他代码无需改动。
1 毫秒内完成评级,内置故障转移、缓存与完整日志。
直连各家供应商,按其公开价格计费 —— 我们每 token 加价 $0。
实时并排比价 —— 与你直接向供应商支付的价格一致。
| 模型 | 路由到 | 输入 /M | 输出 /M | 上下文 | 质量 |
|---|---|---|---|---|---|
| z-ai/glm-5.3新 | Zhipu AI | $1.26 | $3.96 | 1M | 9.0 |
| qwen/qwen3.8-27b新 | Alibaba Cloud | $0.330 | $2.40 | 262K | 4.0 |
| qwen/qwen3.8-27b-free新 | Alibaba Cloud | — | — | 66K | 4.0 |
| deepseek/deepseek-v4-pro-0813新 | DeepSeek | $0.442 | $0.884 | 1M | 7.0 |
| grok/grok-4.6新 | — | $2.00 | $6.00 | 500K | 9.0 |
| meta/muse-spark-1.2新 | — | $1.25 | $4.25 | 1M | 8.0 |
| qwen/qwen3.8-max新 | Alibaba Cloud | $2.00 | $6.00 | 1M | 9.0 |
| deepseek/deepseek-v4-flash-0731新 | DeepSeek | $0.147 | $0.295 | 1M | 6.0 |
| + 还有 194 个模型 · 价格每 60 秒更新 | |||||
充值与订阅均按供应商价格计费,我们不加价。
下方套餐面向团队功能,不改变 token 价格。
我们的收入来自可选的团队功能。
我们在做什么、为什么做 —— 最新文章。

AI 路由器位于应用与众多模型之间,为每个请求挑选最合适的模型。OrcaRouter 在 1 毫秒内为每条提示词打分并路由 —— 复杂推理走前沿模型、常规任务走开源模型 —— 覆盖 200+ 模型,零 token 加价。
LLM 路由器对每条提示词进行分类,并将其匹配到最可能以最低成本给出优质回答的模型。OrcaRouter 基于上下文嵌入并从真实流量在线学习 —— 在公开的 RouterArena 榜单上准确率达 75.5%。
是。OrcaRouter 是生产级 AI 网关:一个 OpenAI 兼容端点,内建自适应路由、负载均衡、自动故障切换、护栏、Agent 防火墙、提示词缓存与逐请求可观测性。
正如 CDN 从最优边缘节点分发内容,AI CDN 从最优供应商分发推理:健康、快速、低价的容量,缓存重复提示词,故障时自动切换。OrcaRouter 在 200+ 模型上扮演这一角色。
自适应路由从你自己的流量中学习质量/成本的权衡。每个工作区可指向"达标里最便宜"、最高质量或均衡 —— 也可让 orcarouter/auto 逐请求持续调优。
它们解决不同的问题 —— 治理 vs 模型选择 —— 但你不需要两套系统:OrcaRouter 在同一跳上逐请求路由,并执行预算、护栏与可观测性。
提示词打分不到 1 毫秒,总新增延迟低于 50 毫秒 —— 通常会被更快的供应商与缓存的提示词 token 多倍赚回。
不会。你按各供应商公布的价格付费;OrcaRouter 每 token 加价 $0,通过可选的 Team 与 Enterprise 功能盈利。
能 —— 把 base_url 切换到 https://api.orcarouter.ai/v1,你现有的 OpenAI、Anthropic 或 Google SDK 代码照常工作:Chat Completions、Responses、Embeddings、Images、Audio 与流式全部直通。
OrcaRouter 会在响应开始前,对同一模型或等价模型的健康备用容量重试,上游故障不会暴露给你的用户。