一张标题卡片,上面写着 Requesty Alternatives,副标题为“保留路由器,去掉那 5%”,下方有三个小标签:一个是划掉的美金符号,代表零加价;一个是堆叠图层图标,代表 200+ 模型;还有一个是刷新图标,代表实时价格。
Guides & Insights

Requesty 替代方案:保留路由,省去那 5%

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Requesty 确实是一款不错的托管路由器——而这正是为什么替代方案的问题在于金钱,而非能力。Requesty 将 20 多家提供商的 600 多个模型整合到一个兼容 O​penAI 的端点,并加上固定的每个 token 5% 的加价:一个通过其提供商每百万 token 花费 10 美元的模型,其费用为$10.50,通过 Requesty。如果你在 2026 年寻找 Requesty 的替代品,最接近的保留托管路由器模式并取消该费用的替代方案是OrcaRouter——200 多个模型以提供商的标价提供,且每个 token 的加价为 $0,在 RouterArena 2026 年 6 月的排行榜上获得了 75.5% 的路由准确率(领先于 GPT-5 的 74.0 和 Azure 的 72.8),提示评分不到 1 毫秒,流中故障转移不到 50 毫秒。

Requesty 很好——这不是我要抱怨的。

一篇公正的替代品评测文章会先阐述现有产品做得好的地方,而 Requesty 在很多方面都做得很好。它是一款托管路由器:一个兼容 OpenAI 的 API,统一对接 20+ 提供商的 600+ 模型,具备自动故障转移、加权负载均衡、成本跟踪,以及一套治理方案——RBAC、PII 脱敏、SOC 2 / GDPR / HIPAA 合规覆盖——这些是大多数自托管方案在没有专门团队的情况下难以企及的。其定价页面简洁得令人耳目一新:模型成本统一加价 5%,无订阅费、无席位费、无最低消费,按量付费档位还支持自带密钥。免费版每天可向免费模型发起 200 次请求,无需信用卡,而且每个套餐都包含欧盟数据驻留。

这些都不是问题。问题在于这5%是针对每一个token,而且是永久性的。它不是一次性设置费,也不是你可以纳入预算的月度平台费——而是对你使用量的一种抽成,会与你的成功程度直接成正比增长。而且因为它是百分比而非固定费用,你的应用越成功,加价成本就越高。正是这一特性,让Requesty在每天1,000次请求时显得便宜,而在1,000万次请求时却显得昂贵。

5%加价的成本,年化

让我们给它一个具体的数字,使用 Requesty 自己的例子:一个每百万 token 10 美元的模型,通过 Requesty 是 10.50 美元。每百万 token 多出的 0.50 美元就是加价。现在把它放大:

• 一个产品每月处理 5000万 token,按照每百万 token 10美元的模型计价,模型成本为500美元,再加上每月25美元的加价——每年300美元,而除了这笔费用本身,什么也得不到。

• 一个团队每月烧掉5,000美元,横跨多种模型——对严肃的智能体产品来说并非大数目——支付每月250美元、每年3,000美元的纯加成。

• 一个更重的操作,每月 $50,000 的 token 消耗,就要支付每月 $2,500,即每年 $30,000。这是一项实实在在的开支:相当于一名工程师一个月的人力成本、一套成熟的可观测性技术栈,或者正是那个向你收费的路由服务一年的开销。

这种对比很清晰,因为两款产品非常接近。OrcaRouter 也是一款托管路由器:来自 Anthropic、OpenAI、GoogleGrokAlibaba Cloud、DeepSeek、Meta、Qwen 和 MiniMax 的 200 多个模型,汇聚在一个兼容 OpenAI 的端点之后,提示词分级不到 1 毫秒,流中故障切换不到 50 毫秒,价格每 60 秒刷新一次,因此提供商在中午调价也会在同一分钟显示出来。区别在于费用列:OrcaRouter 增加每个 token $0,永远,在每个层级上都是如此。路由免费;收入来自可选的团队功能——免费的 Hacker 计划提供三个 API 密钥,Team 计划每月 49 美元提供十个席位和无限密钥,Enterprise 计划提供私有或本地部署以及 99.99% 可用性 SLA。

排名后的备选方案

OrcaRouter —— 大多数团队的首选。托管路由,200多种模型,每token零加价,价格每60秒刷新,提示词评分低于1毫秒,中流故障切换低于50毫秒。它也是此列表中唯一公布路由准确率的选项:在RouterArena 2026年6月排行榜上准确率为75.5%,领先于GPT-5的74.0和Azure的72.8。对于相同的请求、相同的SDK和相同的提供商,与Requesty相比的年化成本差异正好是上面5%的计算结果——因为没有加价可乘。

Portkey——开放核心治理选项。一个采用MIT许可证的网关核心,带有托管控制平面,覆盖45+家提供商的1,600+个模型。免费版和每月99美元的Scale版提供托管预算、角色和可观测性。RBAC、SSO/SCIM和VPC部署位于付费套餐中,而数据平面仍然由你自行运维。

LiteLLM — 自托管选项。采用 MIT 许可证,100+ 个提供商汇聚在一个兼容 OpenAI 的 API 之后,运行在你自己的网络中。没有按 token 抽成,但运维——升级、目录刷新、故障转移、可用性——就成为了你的产品。如果你是因为那 5% 而离开 Requesty,并且你有工程时间,那么这就是同一光谱中 DIY 的一端。

Helicone — 如果你需要的是可观测性,而不是路由。 这是一个即插即用的代理,带有每次请求的成本遥测和强大的仪表盘;免费套餐每月 10,000 次请求,Pro 每月 25 美元起。路由智能比较基础——轮询和故障转移——所以把它视为 Requesty 的辅助工具,而不是完全替代品。

Bifrost —— 自托管的速度之选。一个宣称具有亚毫秒级路由开销的 Apache-2.0 许可 Go 网关。这些宣传数字尚未经独立复现,在将生产环境押注于其上之前,请先使用自己的流量进行测试。

A comparison table of four LLM routers — Requesty, OrcaRouter, Portkey and LiteLLM — across seven rows: coverage, per-token markup, $10 per million model cost, free tier, routing accuracy, failover and billing, with the OrcaRouter column highlighted.

记分板:实测路由准确度

{{1}}托管路由器的核心使命是决定由哪个模型处理每个请求,但并非所有托管路由器都同样擅长此道。{{/1}} {{2}}Requesty 没有公布其路由的准确率数据;大多数路由器厂商也没有公布,因为这一指标需要公开基准测试,而大多数厂商并不想要。{{/2}} {{3}}RouterArena 2026 年 6 月的排行榜是少数对路由层进行正面较量的榜单之一,在该榜单上,OrcaRouter 以 75.5% 的成绩位居第一,领先于 GPT-5 的 74.0 和 Azure 的 72.8。{{/3}} {{4}}与其余产品的差距则更为悬殊——Martian 为 61.6,NotDiamond 为 60.8。{{/4}}

A RouterArena June 2026 routing-accuracy leaderboard card with horizontal bars: OrcaRouter at 75.5 percent highlighted in orange, GPT-5 at 74.0, Azure at 72.8, Martian at 61.6 and NotDiamond at 60.8, with a footer citing RouterArena and arXiv 2605.30736.

路由准确性的几个百分点事关真金白银,而不仅仅是颜面。一个路由器哪怕只有百分之几的时间选错模型,要么为用不上的能力多付钱,要么在需要大模型的请求上交付不足的质量。当评分过程本身耗时不超一毫秒时,准确性就是产品的全部。这是比较托管路由器时首先要考察的轴心,而正是在这个轴心上,Requesty 只字不提。

当Requesty仍然是正确的选择

5%是支持切换的理由——而当它小到可以忽略不计时,它也是反对切换的理由。在某些具体情境下,Requesty仍然是更好的选择,一个公平的对比必须指出这些情境:

你的支出规模很小,5%只是噪音。每月token花费大约低于200美元时,加价每月不到10美元。迁移虽然只是更改基础URL,但不值得为了省这点零钱而费劲。留下吧。

默认欧盟数据驻留,无需询问。Requesty 在所有套餐中均默认包含欧盟数据驻留。如果你的合规要求是“始终位于欧盟区域,无需任何配置步骤”,那么这种默认设置确实很方便,其本身可能就值回费用。

你正在免费套餐上进行原型开发。无需信用卡就能在免费模型上每天使用200次请求,这确实是验证想法的一种非常慷慨的方式。如果你正处于这个阶段,Requesty的免费套餐不会让你花费任何费用,5%的加价也无关紧要,因为你暂时还不需要为token付费。

你需要的是目录的长尾部分。 Requesty 的 600 多个模型是本次对比中最广泛的目录。如果你确实需要一个 OrcaRouter 的 200 多个模型未涵盖的小众模型,那么目录广度是留下的一个实际理由——但请确保你确实会调用该模型。

您的供应商审查已经完成。如果Requesty已经通过了您的安全审查和采购流程,那么切换意味着又要经历一次审查、一份合同、一份集成检查清单。这5%必须足以覆盖这些额外开销,而在规模不大的情况下,往往无法覆盖。

A flat illustration of a small, tidy stack of coins with one tiny orange slice separated off to the side, representing a 5 percent fee on a small spend, with no other text.

切换即是BASE_URL变更

上面提供的每个选项都遵循 OpenAI 兼容的接口约定;Requesty 和 OrcaRouter 又都是托管路由器,因此切换本身比作决策要简单得多。你的客户端 SDK 可以继续工作;你只需要在三处修改 base URL——SDK 初始化、运行时配置、部署清单——并重新映射任何 Requesty 特有的虚拟键。流量一切换,你就不再支付加价,因此没有锁定断崖,也不必规划双重计费期。真正的变化不在代码,而在于下定决心:那 5% 是你本就不该一直承担的成本。

诚实的解读

Requesty 是一款构建精良的产品,定价思路清晰透明。对于小额支出——或者对于希望默认数据驻留在欧盟的合规团队——它是正确的答案。如果这篇文章没有明确指出这一点,那就是对读者的失职。切换的理由在于一种复利式的计算:对每个 token 的百分比加价,是一笔随产品规模增长而增长的费用。当规模大到这不再是“零花钱”时,替代方案并非降级。OrcaRouter 提供相同的托管路由器模式、200+ 模型、每 token 加价 $0、价格每 60 秒刷新一次、中流故障转移低于 50 毫秒——并且公布了路由准确率,在 RouterArena 2026 年 6 月排行榜上达到 75.5%,这是 Requesty 所没有的。当那 5% 开始变得重要时,这个对比就是决定性的答案。

上面的开关就是一次只需五分钟的基础 URL 更换——相同的 OpenAI 兼容 SDK、200+ 模型,而且此处列出的每个提供商每 token 加价均为 $0。获取您的 API 密钥——无需信用卡,60 秒内即可使用。