Suy luận an toàn, không phụ phí, theo mức dùng hoặc gói thuê bao. Hoặc dùng khóa của riêng bạn. Định tuyến thích ứng giúp giảm hóa đơn.
Không cần thẻ tín dụng · chạy trong 60 giây
from openai import OpenAIclient = OpenAI(base_url="https://api.orcarouter.ai/v1",api_key=ORCAROUTER_API_KEY,)resp = client.chat.completions.create(model="orcarouter/auto", # we grade + routemessages=[{"role": "user", "content": "..."}],)
Một dòng. Chúng tôi chấm điểm từng prompt, định tuyến tới frontier hoặc OSS, và cộng thêm $0.
Nhật ký đầy đủ, chi tiêu theo thời gian thực và hóa đơn cho từng prompt. Không hộp đen.
Xem một hóa đơnQuản lý phiên bản prompt và tái dùng lệnh gọi đã cache mà không đụng tới mã.
Quản lý phiên bản promptĐặt base_url thành api.orcarouter.ai/v1 và thay khóa API. Không cần đổi mã nào khác.
Chấm điểm dưới 1ms, tích hợp sẵn chuyển dự phòng, cache và nhật ký đầy đủ.
Đi thẳng tới từng nhà cung cấp theo giá niêm yết — chúng tôi cộng thêm $0 mỗi token.
Bảng giá trực tiếp, cạnh nhau — đúng bằng giá bạn trả thẳng cho nhà cung cấp.
| Mô hình | Định tuyến đến | Đầu vào /M | Đầu ra /M | Ngữ cảnh | Chất lượng |
|---|---|---|---|---|---|
| z-ai/glm-5.3MỚI | Zhipu AI | $1.26 | $3.96 | 1M | 9.0 |
| qwen/qwen3.8-27b-freeMỚI | Alibaba Cloud | — | — | 66K | 4.0 |
| qwen/qwen3.8-27bMỚI | Alibaba Cloud | $0.330 | $2.40 | 262K | 4.0 |
| deepseek/deepseek-v4-pro-0813MỚI | DeepSeek | $0.442 | $0.884 | 1M | 7.0 |
| grok/grok-4.6MỚI | — | $2.00 | $6.00 | 500K | 9.0 |
| meta/muse-spark-1.2MỚI | — | $1.25 | $4.25 | 1M | 8.0 |
| qwen/qwen3.8-maxMỚI | Alibaba Cloud | $2.00 | $6.00 | 1M | 9.0 |
| deepseek/deepseek-v4-flash-0731MỚI | DeepSeek | $0.147 | $0.295 | 1M | 6.0 |
| + Thêm 194 mô hình · Giá cập nhật mỗi 60 giây | |||||
Nạp tiền và đăng ký tính theo giá nhà cung cấp. Không cộng thêm.
Nạp khi bạn muốn. Giá nhà cung cấp, biên lai mỗi lượt gọi.
Nạp lại ví của bạn mỗi kỳ. Toàn bộ số tiền, mọi mô hình, kèm tín dụng thưởng ở các gói lớn hơn.
Sử dụng khóa nhà cung cấp, giới hạn tốc độ và tín dụng của riêng bạn.
Các gói bên dưới là tính năng nhóm, không đổi giá token.
Doanh thu của chúng tôi đến từ các tính năng nhóm tùy chọn.
AI router nằm giữa ứng dụng của bạn và nhiều mô hình, chọn mô hình tốt nhất cho từng yêu cầu. OrcaRouter chấm điểm mỗi prompt trong chưa đầy 1 ms và định tuyến — mô hình frontier cho suy luận khó, mã nguồn mở cho việc thường nhật — trên hơn 200 mô hình với 0 phụ phí token.
LLM router phân loại từng prompt và ghép nó với mô hình có khả năng trả lời tốt nhất ở chi phí thấp nhất. OrcaRouter định tuyến bằng embedding ngữ cảnh với học trực tuyến từ lưu lượng thật — độ chính xác 75,5% trên bảng xếp hạng công khai RouterArena.
Có. OrcaRouter là AI gateway cấp production: một endpoint tương thích OpenAI với định tuyến thích ứng, cân bằng tải, tự động failover, guardrail, tường lửa agent, cache prompt và khả năng quan sát theo từng yêu cầu.
Giống như CDN phân phối nội dung từ điểm biên tốt nhất, AI CDN phân phối suy luận từ nhà cung cấp tốt nhất: dung lượng khỏe, nhanh, rẻ; cache các prompt lặp lại; failover khi sự cố. OrcaRouter đảm nhiệm vai trò này trên hơn 200 mô hình.
Định tuyến thích ứng học sự đánh đổi chất lượng/chi phí từ chính lưu lượng của bạn. Hướng mỗi workspace tới "rẻ nhất mà vẫn đạt chuẩn", chất lượng cao nhất, hoặc cân bằng — hoặc để orcarouter/auto liên tục tinh chỉnh theo từng yêu cầu.
Chúng giải quyết hai bài toán khác nhau — quản trị và chọn mô hình — nhưng bạn không cần hai hệ thống: OrcaRouter định tuyến theo từng yêu cầu và thực thi ngân sách, guardrail, khả năng quan sát ngay trên cùng một chặng.
Chấm điểm prompt mất chưa đầy 1 ms và tổng độ trễ cộng thêm dưới 50 ms — thường được bù lại nhiều lần nhờ nhà cung cấp nhanh hơn và token prompt đã cache.
Không. Bạn trả đúng giá niêm yết của từng nhà cung cấp; OrcaRouter cộng $0 mỗi token và kiếm doanh thu từ các tính năng tùy chọn Team và Enterprise.
Có — đổi base_url sang https://api.orcarouter.ai/v1 và mã SDK OpenAI, Anthropic hay Google của bạn vẫn chạy bình thường: Chat Completions, Responses, Embeddings, Images, Audio và streaming.
OrcaRouter thử lại trên dung lượng dự phòng khỏe mạnh của cùng mô hình hoặc mô hình tương đương trước khi phản hồi bắt đầu, nên sự cố upstream không lộ ra với người dùng của bạn.
Đổi một dòng. Đó là toàn bộ việc migration.
Vượt GPT-5 và Azure trên RouterArenaĐược hỗ trợ bởi nghiên cứu đã công bố
OrcaRouterBạn vận hành nền tảng suy luận? Đưa mô hình của bạn lên OrcaRouter.
providers@orcarouter.ai