Tanpa markup. Ketersediaan lebih tinggi. Harga lebih baik.

Satu Gateway. Setiap Model. Rutekan Lebih Cerdas. Rilis Lebih Aman. Hemat Lebih Banyak.

OrcaRouter menilai setiap prompt dan merutekannya secara cerdas. AI berkualitas frontier dengan biaya hingga 40% lebih rendah. Perutean adaptif, penyeimbangan beban, guardrail, firewall agen, observabilitas, dan tata kelola — semua melalui satu endpoint yang kompatibel dengan OpenAI.

Tanpa kartu kredit · aktif dalam 60 detik

Mengungguli GPT-5 & Azure di RouterArenaDidukung riset yang dipublikasikan
- client = OpenAI(api_key="sk-...")
+ client = OpenAI(
+ base_url="https://api.orcarouter.ai/v1",
+ api_key="sk-orca-..."
+ )
 
# Everything else stays the same.
response = client.chat.completions.create(
model="orcarouter/auto", # router picks the best model per request
messages=[{"role": "user", "content": "..."}]
)
# → orcarouter/auto grades the prompt → frontier or open-source, zero token markup ✓

Satu baris. Kami menilai setiap prompt, merutekan ke frontier atau OSS, dan menambahkan $0.

200+
model, satu endpoint
0%
markup token, selamanya
75.5%
akurasi perutean
<50ms
failover di tengah-stream
Integrasi

Bekerja dengan alat yang sudah Anda gunakan

Drop-in kompatibel-OpenAI, atau hubungkan agen melalui server MCP OrcaRouter — pertahankan SDK, framework, dan editor Anda.

Server MCP OrcaRouterOpenAI SDKGoogle GenAI SDKAnthropic SDKLangChainLlamaIndexVercel AI SDKCamelAIDifyCursorOpenCodePromptfooOpenClawOpenHumanGitHubcURLdan lainnya
Sedang membangun dengan ini? Bicara dengan kami.XDiscordGitHub
Gateway AI untuk produksi

Perutean cerdas dan failover otomatis di setiap permintaan.

Perutean yang terukur lebih akurat.

Setiap prompt disematkan dan dirutekan oleh model yang terus belajar secara online dari lalu lintas nyata. Di papan peringkat publik RouterArena (Jun 2026), ia memimpin dalam akurasi — di depan GPT-5, Azure, Martian, dan NotDiamond — pada 75,5%.

contextual embeddingsonline learning<1ms overheadRouterArena
* Berdasarkan data papan peringkat RouterArena, Juni 2026.

Sebuah penyedia mati. Tidak ada yang menyadarinya.

Saat sebuah penyedia membatasi laju atau 5xx, OrcaRouter mencoba lagi permintaan ke model yang sehat di antara 200+ opsi sebelum respons dimulai — sehingga gangguan upstream sementara tidak muncul ke pengguna Anda.

200+ modelsauto-failoverno 429

Perutean sesuai keinginan Anda.

orcarouter/auto adalah default cerdas, bukan kotak hitam. Arahkan setiap ruang kerja ke tujuan yang Anda inginkan — model termurah yang melampaui standar kualitas Anda, kualitas tertinggi, atau keseimbangan keduanya — atau biarkan ia mempelajari trade-off dari lalu lintas Anda sendiri. Anda tidak pernah terkunci pada satu perilaku.

per-workspaceno markup either way<1ms overhead

Butuh lebih dari sekadar mode? Tulis aturannya.

Saat default tidak cukup, ekspresikan perutean sebagai kode — terkontrol-versi, dapat ditinjau, dan aktif dalam hitungan detik. Tanpa redeploy, tanpa perubahan klien.

YAML + CELversion-controlledlive in seconds
routing.yaml
version: 1
rules:
- id: hard_agent_task
when: task_class == "agent" && difficulty >= 0.6
use:
model: "claude-opus-4-7"
reasoning_effort: high # spend where it matters
- id: short_prompts
when: request.input_tokens < 500
use: { delegate: cheapest }
default:
delegate: balanced # fall back to the chosen mode

Lihat dan buktikan setiap panggilan — biaya, model, latensi, dan alasannya.

Lihat semuanya. Buktikan apa pun.

Lihat persis berapa biaya setiap permintaan, model mana yang melayaninya, berapa lama waktunya, dan mengapa gagal — log terstruktur lengkap yang dapat Anda filter, putar ulang, dan salin sebagai cURL yang dapat dijalankan. Sebuah rute tidak pernah jadi kotak hitam.

Per-request logsgrade · model · costcopy-as-cURL

Tanpa markup. Tanpa kotak hitam.

Anda membayar setiap penyedia dengan harga persisnya — kami menambah $0 per token, selamanya. Setiap permintaan menampilkan nilai, model terpilih, penyedia, latensi, dan harga, sehingga biaya bersifat kotak kaca, bukan tarif gabungan yang buram.

$0 / tokenprovider costglass-box receipt

Prompt berversi dan caching — tanpa redeploy.

Ubah prompt. Bukan kode.

Buat versi prompt di balik label bernama dengan pembagian A/B dan rollback satu klik. Pindahkan sebuah label dan setiap permintaan langsung mengikutinya — tanpa redeploy, tanpa perubahan kode, tanpa pembaruan klien.

VersionedA/BInstant rollbackNo deploy

Bayar sekali. Pakai ulang gratis.

Token prompt yang berulang dan ter-cache ditagih dengan tarif cache penyedia — sering kali sebagian kecil dari harga input — lintas jendela ephemeral 5 menit dan 1 jam. Jawaban yang sama, pengeluaran lebih sedikit, dengan cached_tokens di setiap struk.

cache_controlcached_tokens5m / 1h windows

Guardrail, anggaran, dan firewall agen yang menegakkan.

Guardrail yang menghentikan banyak hal.

PII Shield dan kebijakan konten berjalan sebelum panggilan upstream ditagih. Permintaan yang diblokir mengembalikan 400 yang bersih dan tidak pernah dikenai biaya — guardrail ditegakkan inline, bukan dicatat setelahnya.

PII Shieldenforced pre-billingclean 400

Aman untuk tim Anda. Dan agen Anda.

Anggaran dan peran untuk orang; firewall berskor risiko untuk agen. Setiap panggilan alat dan MCP dinilai ALLOW, REVIEW, atau BLOCK sebelum dijalankan, dan deteksi anomali menandai lonjakan laju dan biaya terhadap baseline jam-dalam-minggu yang dipelajari.

ALLOW · REVIEW · BLOCKMCP gatinganomaly detection
Dibuat untuk era agen. Sebelum Anda membutuhkannya.

Penyiapan

Aktif dalam 60 detik.

Satu perubahan URL. SDK, nama model, dan streaming Anda yang ada semuanya berfungsi persis seperti sebelumnya.

Langkah 1

Arahkan SDK Anda ke kami

Atur base_url ke api.orcarouter.ai/v1 dan ganti kunci API Anda. Tidak perlu perubahan kode lainnya.

Langkah 2

Kami merutekan, menjaga & mengamati

Setiap panggilan dirutekan ke model terbaik, diperiksa terhadap guardrail Anda, dan diukur — dinilai dalam kurang dari 1ms, dengan failover, caching, dan log lengkap bawaan.

Langkah 3

Anda rilis, di satu endpoint

Lalu lintas langsung ke API pihak-pertama setiap penyedia pada tarif resmi mereka — kami menambahkan $0 per token. Satu endpoint kompatibel-OpenAI untuk perutean, observabilitas, dan tata kelola.


Setiap model. Satu daftar harga.

200+ model dengan harga langsung berdampingan — sesuai yang akan Anda bayar ke penyedia. Kami menambahkan $0 di atasnya.

Lihat semua 200+ model →
ModelDirutekan keInput /MOutput /MKonteksKualitas
deepseek/deepseek-v4-flash-0731BARUDeepSeek$0.147$0.2951M6.0
qwen/qwen3.7-flashBARUAlibaba Cloud$0.030$0.1301M7.0
orca/dubBARU$0.600 /call5.0
anthropic/claude-opus-5BARUAnthropic Direct$5.00$25.001M10.0
google/gemini-3.6-flashBARUGoogle Direct$1.50$7.501M8.0
google/gemini-3.5-flash-liteBARUGoogle Direct$0.300$2.501M6.0
meta/muse-spark-1.1BARU$1.25$4.251M8.0
kimi/kimi-k3BARUMoonshot$3.00$15.001M9.0
+ 194 model lagi · Harga diperbarui setiap 60 detik

Harga

Perutean itu gratis.
Bayar untuk fitur.

Kami tidak pernah mengambil potongan dari pengeluaran token Anda. Pendapatan kami berasal dari fitur tim opsional.

Jaminan tanpa markup
Anda membayar penyedia secara langsung pada tarif resmi mereka. Kami tidak menambahkan apa pun di atas biaya token. Perutean gratis; paket Team opsional mendanai platform.
$0.00biaya perutean

Hacker

Gratis
Selamanya. Tanpa markup pada semua token.
✓ Rutekan — 200+ model, failover otomatis
✓ Amati — dasbor dasar
✓ Kelola — pembuatan versi prompt
✓ 3 kunci API · markup token 0%
Mulai gratis

Enterprise

Kustom
Komitmen SLA + deployment privat.
✓ Semua di Team
✓ Deployment privat / on-prem
✓ SLA uptime 99,99%
✓ Infrastruktur khusus
✓ Dukungan khusus & harga kustom
Kepercayaan & Kepatuhan
Diaudit independen, patuh berkelanjutan — laporan tersedia di bawah NDA.

Dari blog

Terbaru dari ruang mesin.

Apa yang kami bangun dan mengapa — artikel terbaru kami.

Semua artikel →

FAQ

AI router, gateway LLM, routing adaptif — terjawab.

Jawaban singkat dan faktual — set yang sama dengan yang dilihat mesin pencari di structured data halaman ini.

Apa itu AI router?

AI router berada di antara aplikasi Anda dan banyak model, lalu memilih model terbaik untuk setiap permintaan. OrcaRouter menilai setiap prompt dalam waktu kurang dari 1 ms dan merutekannya — model frontier untuk penalaran berat, open source untuk tugas rutin — di 200+ model tanpa markup token.

Apa itu LLM router dan bagaimana cara kerjanya?

LLM router mengklasifikasikan setiap prompt dan mencocokkannya dengan model yang paling mungkin menjawab baik dengan biaya terendah. OrcaRouter merutekan dengan embedding kontekstual dan pembelajaran online dari trafik nyata — akurasi 75,5% di papan peringkat publik RouterArena.

Apakah OrcaRouter sebuah AI gateway?

Ya. OrcaRouter adalah AI gateway kelas produksi: satu endpoint kompatibel OpenAI dengan routing adaptif, load balancing, failover otomatis, guardrail, firewall agen, cache prompt, dan observabilitas per permintaan.

Apa itu AI CDN?

Seperti CDN menyajikan konten dari edge terbaik, AI CDN menyajikan inferensi dari penyedia terbaik: kapasitas sehat, cepat, murah; prompt berulang di-cache; failover saat gangguan. OrcaRouter memainkan peran ini di 200+ model.

Apa itu routing adaptif?

Routing adaptif mempelajari kompromi kualitas/biaya dari trafik Anda sendiri. Arahkan tiap workspace ke "termurah yang lolos standar", kualitas tertinggi, atau seimbang — atau biarkan orcarouter/auto terus menyetel pilihan di tiap permintaan.

Apakah saya butuh AI gateway sekaligus LLM router?

Keduanya memecahkan masalah berbeda — tata kelola vs pemilihan model — tetapi Anda tidak butuh dua sistem: OrcaRouter merutekan per permintaan dan menegakkan anggaran, guardrail, serta observabilitas di hop yang sama.

Apakah routing menambah latensi?

Penilaian prompt butuh kurang dari 1 ms dan total latensi tambahan tetap di bawah 50 ms — biasanya terbayar berkali lipat lewat penyedia yang lebih cepat dan token prompt yang di-cache.

Apakah OrcaRouter menaikkan harga token?

Tidak. Anda membayar tarif resmi tiap penyedia; OrcaRouter menambahkan $0 per token dan meraih pendapatan dari fitur opsional Team dan Enterprise.

Bisakah saya tetap memakai kode OpenAI SDK yang ada?

Bisa — ganti base_url ke https://api.orcarouter.ai/v1 dan kode SDK OpenAI, Anthropic, atau Google Anda tetap berjalan: Chat Completions, Responses, Embeddings, Images, Audio, dan streaming.

Apa yang terjadi saat penyedia tumbang?

OrcaRouter mencoba ulang ke kapasitas cadangan yang sehat untuk model yang sama atau setara sebelum respons dimulai, sehingga gangguan upstream tidak sampai ke pengguna Anda.

Lebih cerdas, lebih aman, hemat biaya.

Ganti satu baris. Itulah migrasinya.

Daftar dengan GitHub — tanpa kartu kredit. Live dalam waktu kurang dari satu menit.

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube