Riêng tư nhờ kiến trúc · Bảo vệ ở mọi lệnh gọi

Một gateway. Mọi mô hình. Dữ liệu của bạn vẫn là của bạn.

Suy luận riêng tư trên hơn 200 mô hình, được bảo vệ ở mọi lệnh gọi. Không phụ phí khi trả theo mức dùng hoặc thuê bao. Hoặc dùng khóa của riêng bạn.

Không cần thẻ tín dụng · chạy trong 60 giây · không ghi lại prompt trừ khi bạn bật

200+
mô hình, một endpoint
0%
phụ phí token, mãi mãi
0 B
prompt được lưu theo mặc định
ghi log tắt cho đến khi bạn bật
40+%
tiết kiệm chi phí suy luận
nhờ định tuyến thích ứng nhận biết bộ nhớ đệm
99%
độ chính xác định tuyến
nhờ nâng cấp lên mô hình frontier
<10ms
độ trễ định tuyến, kèm chuyển dự phòng tự động
Tất cả tích hợp
from openai import OpenAI
 
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=ORCAROUTER_API_KEY,
)
resp = client.chat.completions.create(
model="orcarouter/auto", # we grade + route
messages=[{"role": "user", "content": "..."}],
)

Một dòng. Chúng tôi chấm điểm từng prompt, định tuyến tới frontier hoặc OSS, và cộng thêm $0.

Quyền riêng tư & Bảo mật

Riêng tư nhờ kiến trúc. Bảo vệ ở mọi lệnh gọi.

Những gì bạn hỏi AI vẫn là của bạn. Những gì tác nhân của bạn làm, do bạn phê duyệt.

Dữ liệu của bạn

Những gì mô hình và máy chủ của chúng tôi có thể thấy.

  • Data Cloaking

    Che giấu.

    Tên, email và số thẻ được thay bằng giá trị thế chỗ trước khi đến mô hình bạn gọi, rồi được khôi phục trong câu trả lời.

    Một cú nhấp
  • ZDR

    Không giữ lại gì.

    Prompt không được ghi log trừ khi bạn bật. Ký thỏa thuận không lưu giữ để khóa tắt hoàn toàn.

    Mặc định
  • PQC

    Chống máy tính lượng tử.

    Log bạn chọn giữ lại được niêm phong bằng ML-KEM lai. Mã mật mã là nguồn mở: SCUTTLE.

    Mặc định
  • Data Residency

    Khu vực của bạn.

    Khai báo Mỹ, EU, Anh, Châu Á - Thái Bình Dương hoặc Trung Quốc, và báo cáo tuân thủ của bạn sẽ được gắn khu vực đó.

    Theo yêu cầu
  • TEE

    Được bảo vệ cả khi đang chạy.

    Enclave có chứng thực, kèm bằng chứng cho mọi câu trả lời.

    Theo yêu cầu

Tác nhân của bạn

Điều gì được đi qua, và điều gì được chạy.

  • Guardrails

    Chặn trước khi tính phí.

    PII, bí mật, jailbreak và prompt injection bị chặn trước khi mô hình nhìn thấy. Quy tắc theo mẫu là miễn phí; quy tắc do AI đánh giá chỉ tính phí cho chính lần kiểm tra đó.

    Một cú nhấp
  • Agent Firewall

    Mọi lệnh gọi công cụ đều được thẩm định.

    Mỗi lệnh gọi công cụ và MCP được cho phép, chuyển cho người duyệt, hoặc bị chặn trước khi chạy.

    Giám sát theo mặc định
  • Compliance Packs

    Ánh xạ tới 32 khung tuân thủ.

    Mỗi quy định một chính sách. Theo dõi trên lưu lượng thật trước, rồi bật chế độ thực thi.

    Gói trả phí

Ngoài ra:Hàng đợi phê duyệt thủ côngMối đe dọa được gắn nhãn theo OWASP LLM Top 10 và MITRE ATLASKho lưu trữ công khai các sự cố tác nhân

Cổng kết nối

Định tuyến thông minh hơn. Chi tiêu ít hơn.

Định Tuyến

Mỗi prompt được chấm điểm rồi gửi tới mô hình trả lời tốt nhất.

Duyệt mô hình

Quan Sát

Log khi bạn cần, chi tiêu theo thời gian thực và biên lai cho từng prompt.

Xem một hóa đơn

Quản Lý

Quản lý phiên bản prompt và tái dùng lệnh gọi đã cache mà không đụng tới mã.

Quản lý phiên bản prompt
Mô hình

Mọi model. Một bảng giá.

Những mô hình mới nhất trong hơn 200 mô hình, cập nhật trực tiếp, theo đúng giá của nhà cung cấp.

Xem tất cả 200+ →
Mô hìnhĐịnh tuyến đếnĐầu vào /MĐầu ra /MNgữ cảnhTuyến riêng tư
openai/gpt-6.1-solVăn bảnMỚIOpenAI Direct$2.00$10.001MKhông có tuyến riêng tư
anthropic/claude-sonnet-5.5Văn bảnMỚIAnthropic Direct$2.00$10.001MKhông có tuyến riêng tư
typesafe/jev-1.13Văn bảnMỚI—$0.042$0.04266KKhông có tuyến riêng tư
openai/gpt-6-lunaVăn bảnMỚIOpenAI Direct$0.100$0.5001MKhông có tuyến riêng tư
openai/gpt-6-solVăn bảnMỚIOpenAI Direct$2.00$10.001MKhông có tuyến riêng tư
anthropic/claude-opus-5.5Văn bảnMỚIAnthropic Direct$4.00$20.001MKhông có tuyến riêng tư
grok/grok-4.7Văn bảnMỚI—$2.00$6.00500KKhông có tuyến riêng tư
orca/orcaverify-text1.0Văn bảnMỚI—$2.00$2.00—Không có tuyến riêng tư
+ Thêm 194 mô hình · Giá cập nhật mỗi 60 giây
Cài đặt

Hoạt động trong 60 giây.

Bước 1

Hướng SDK về chúng tôi

Đặt base_url thành api.orcarouter.ai/v1 và thay khóa API. Không cần đổi mã nào khác.

→
Bước 2

Chúng tôi định tuyến, bảo vệ và giám sát

Chấm điểm dưới 1ms, tích hợp sẵn chuyển dự phòng, cache và nhật ký đầy đủ.

→
Bước 3

Bạn ship, trên một endpoint

Đi thẳng tới từng nhà cung cấp theo giá niêm yết — chúng tôi cộng thêm $0 mỗi token.

Giá

Chúng tôi không bao giờ cộng phụ phí vào token bạn mua.

Doanh thu của chúng tôi đến từ các tính năng nhóm tùy chọn.

Hacker

Miễn phí
Mãi mãi. Không phụ phí trên tất cả token.
Định Tuyến — 200+ mô hình, tự động chuyển dự phòng
Quan Sát — dashboard cơ bản
Quản Lý — phiên bản hóa prompt
10 API key · 0% phụ phí token
Bắt đầu miễn phí

Doanh nghiệp

Tuỳ chỉnh
Cam kết SLA và hạ tầng riêng.
Mọi thứ trong Team
Không giới hạn chỗ ngồi cho nhóm
Ưu tiên truy cập mô hình mới
Mọi tính năng ẩn và bản beta
Hạ tầng riêng
SLA uptime 99.99%
Hỗ trợ chuyên trách & giá tùy chỉnh
Tin cậy và tuân thủ
Đừng chỉ tin lời chúng tôi. Báo cáo kiểm toán có sẵn theo NDA, và mật mã hậu lượng tử của chúng tôi là mã nguồn mở.
Thanh toán cho token

Ba cách thanh toán cho token.

Nạp tiền và đăng ký tính theo giá nhà cung cấp. Không cộng thêm.

Các gói phía trên dành cho tính năng nhóm, không làm thay đổi giá token.

Từ blog

Tin mới từ phòng máy.

Chúng tôi đang xây dựng gì và vì sao — các bài viết mới nhất.

Tất cả bài viết →
Guides & InsightsClaude Fable 5.5 đánh bại GPT-6.1 Astra trước cả khi nó tồn tại — và đó mới là phần thú vịMột bài đăng trên X nói rằng Claude Fable 5.5 đánh bại GPT-6.1 Astra. Cả hai mô hình đều không tồn tại trên bất kỳ nền tảng nào của nhà cung cấp, và Astra đã bị hủy. Điều gì có thể kiểm chứng được ngày hôm nay.Oct 3, 2026
Câu hỏi thường gặp

Quyền riêng tư, bảo mật và định tuyến — giải đáp tất cả.

Các bạn có lưu trữ hay dùng prompt của tôi để huấn luyện không?

Chúng tôi không bao giờ huấn luyện trên prompt của bạn. Nội dung prompt và phản hồi không được ghi log trừ khi ghi log đang bật cho workspace của bạn; chúng tôi chỉ giữ siêu dữ liệu yêu cầu (thời gian, mô hình, token, chi phí, IP) để tính phí và bảo mật. Thỏa thuận không lưu giữ sẽ khóa tắt việc ghi log nội dung.

Dữ liệu của tôi được xử lý ở đâu?

Do nhà cung cấp phục vụ mô hình bạn chọn xử lý, tại các khu vực của nhà cung cấp đó. Cài đặt khu vực dữ liệu của workspace (Mỹ, EU, Anh, Châu Á - Thái Bình Dương hoặc Trung Quốc) gắn khu vực đó cho báo cáo tuân thủ; nó chưa cố định nơi lưu dữ liệu hay nơi chạy suy luận.

Chống lượng tử ở đây nghĩa là gì?

Log yêu cầu bạn chọn giữ lại có thể được niêm phong bằng mã hóa hậu lượng tử lai (ML-KEM-768 + X25519), nên bản sao bị lấy hôm nay cũng không thể bị máy tính lượng tử tương lai mở ra. Mã nguồn mở: SCUTTLE. Tính năng này bật mặc định trên dịch vụ được lưu trữ của chúng tôi.

AI router là gì?

AI router nằm giữa ứng dụng của bạn và nhiều mô hình, chọn mô hình tốt nhất cho từng yêu cầu. OrcaRouter chấm điểm mỗi prompt trong chưa đầy 1 ms và định tuyến — mô hình frontier cho suy luận khó, mã nguồn mở cho việc thường nhật — trên hơn 200 mô hình với 0 phụ phí token.

LLM router là gì và hoạt động ra sao?

LLM router phân loại từng prompt và ghép nó với mô hình có khả năng trả lời tốt nhất ở chi phí thấp nhất. OrcaRouter định tuyến bằng embedding ngữ cảnh với học trực tuyến từ lưu lượng thật — độ chính xác 75,5% trên bảng xếp hạng công khai RouterArena.

OrcaRouter có phải là AI gateway không?

Có. OrcaRouter là AI gateway cấp production: một endpoint tương thích OpenAI với định tuyến thích ứng, cân bằng tải, tự động failover, guardrail, tường lửa agent, cache prompt và khả năng quan sát theo từng yêu cầu.

AI CDN là gì?

Giống như CDN phân phối nội dung từ điểm biên tốt nhất, AI CDN phân phối suy luận từ nhà cung cấp tốt nhất: dung lượng khỏe, nhanh, rẻ; cache các prompt lặp lại; failover khi sự cố. OrcaRouter đảm nhiệm vai trò này trên hơn 200 mô hình.

Định tuyến thích ứng là gì?

Định tuyến thích ứng học sự đánh đổi chất lượng/chi phí từ chính lưu lượng của bạn. Hướng mỗi workspace tới "rẻ nhất mà vẫn đạt chuẩn", chất lượng cao nhất, hoặc cân bằng — hoặc để orcarouter/auto liên tục tinh chỉnh theo từng yêu cầu.

Có cần cả AI gateway lẫn LLM router không?

Chúng giải quyết hai bài toán khác nhau — quản trị và chọn mô hình — nhưng bạn không cần hai hệ thống: OrcaRouter định tuyến theo từng yêu cầu và thực thi ngân sách, guardrail, khả năng quan sát ngay trên cùng một chặng.

Định tuyến có làm tăng độ trễ không?

Chấm điểm prompt mất chưa đầy 1 ms và tổng độ trễ cộng thêm dưới 50 ms — thường được bù lại nhiều lần nhờ nhà cung cấp nhanh hơn và token prompt đã cache.

OrcaRouter có cộng phí vào giá token không?

Không. Bạn trả đúng giá niêm yết của từng nhà cung cấp; OrcaRouter cộng $0 mỗi token và kiếm doanh thu từ các tính năng tùy chọn Team và Enterprise.

Tôi có thể giữ nguyên mã OpenAI SDK hiện có không?

Có — đổi base_url sang https://api.orcarouter.ai/v1 và mã SDK OpenAI, Anthropic hay Google của bạn vẫn chạy bình thường: Chat Completions, Responses, Embeddings, Images, Audio và streaming.

Điều gì xảy ra khi một nhà cung cấp sập?

OrcaRouter thử lại trên dung lượng dự phòng khỏe mạnh của cùng mô hình hoặc mô hình tương đương trước khi phản hồi bắt đầu, nên sự cố upstream không lộ ra với người dùng của bạn.

Riêng tư. Thông minh hơn. Không phụ phí.

Đổi một dòng. Đó là toàn bộ việc migration.

Vượt GPT-5 và Azure trên RouterArenaĐược hỗ trợ bởi nghiên cứu đã công bốĐọc mã nguồn Scuttle (mở trong tab mới)Truy cập Trung tâm Tin cậy

© 2026 OrcaRouter

Dành cho nhà cung cấp

Bạn vận hành nền tảng suy luận? Đưa mô hình của bạn lên OrcaRouter.

providers@orcarouter.ai

Tham gia cộng đồng

Discordsupport@orcarouter.aiXGitHubYouTube