Satu nama model. Setiap model di baliknya.
Arahkan klien Anda ke orcarouter/auto dan setiap prompt dinilai lalu dikirim ke model yang memenuhi standar kualitas Anda dengan harga terendah — dengan penyematan semantik sebagai peningkatan opsional.
- Empat tujuan per ruang kerja — Termurah, Seimbang, Kualitas, atau Adaptif, yang mempelajari kompromi dari lalu lintas Anda sendiri.
- Pembelajaran daring: router terus memperbarui diri dari hasil produksi langsung, bukan dari tolok ukur yang sudah beku.
- Perutean menambah kurang dari 1ms secara bawaan; jika Anda mengaktifkan embedding semantik, Anda juga membayar panggilan embedding. Keduanya tetap mencatat nilai dan model terpilih di setiap tanda terima.
40+ penyedia, satu endpoint
Permintaan yang kompatibel dengan OpenAI yang sama menjangkau penyedia mana pun, dan penyeimbangan berbasis kesehatan menyebarkan beban ke penyedia yang aktif. Kesehatan, bobot, dan prioritas per saluran secara otomatis mengeluarkan upstream yang tidak sehat dari rotasi, dan keunikan tiap penyedia dinormalisasi di adaptor sehingga kode klien Anda tidak perlu bercabang.
Satu nama. Semua model.
Anda cukup menulis orcarouter/auto sekali. Setelah itu, setiap prompt dibaca saat melewati gateway dan dikirim ke model yang paling tepat dengan biaya paling hemat. Model frontier baru hadir di hari Selasa dan trafik Anda langsung menggunakannya — tanpa migrasi, tanpa rilis klien, tanpa rapat.
Sebuah default, bukan kotak hitam.
Arahkan workspace ke tujuan yang benar-benar Anda inginkan. Termurah. Berkualitas. Seimbang. Atau Adaptif, yang mempelajari pertukaran dari trafik Anda sendiri, bukan dari tolok ukur orang lain. Setiap pilihan yang dibuatnya tercatat di struk beserta nilai yang menghasilkannya.