Lewati ke konten
kenari.

Routing & rute

Setiap model metered di kenari sudah punya rute. Ada dua bagian: routing otomatis yang berjalan tanpa konfigurasi, dan rute yang kamu susun sendiri lewat dashboard. Kode klien tidak berubah dalam kedua kasus: kamu cukup mengirim id model, atau nama rute, di field model.

Rute adalah urutan langkah yang kamu susun di dashboard (menu Rute). Tiap langkah memilih satu credential dan satu model. Kamu mengirim nama rute sebagai field model. kenari menjalankan langkah berurutan dan pindah ke langkah berikutnya saat satu langkah gagal atau kena limit. Pengecualiannya adalah request yang salah bentuk sebelum sampai ke backend manapun (body tidak valid): itu langsung dikembalikan sebagai error, tanpa mencoba langkah berikutnya, karena setiap langkah akan menolak request yang sama. Kode klien tidak berubah, hanya nilai model yang diganti dengan nama rute. Nama rute berlaku per akun.

  1. Buka menu Rute di dashboard.
  2. Beri nama rute, misalnya opus-hemat.
  3. Tambahkan langkah secara berurutan. Tiap langkah memilih satu credential (key sendiri/BYOK atau pool kenari) dan satu model.

Urutan langkah menentukan prioritas. Langkah pertama dicoba lebih dulu. Bila gagal atau kena limit, kenari pindah ke langkah berikutnya.

Pakai nama rute di field model, persis seperti memanggil model biasa.

Terminal window
curl https://kenari.id/v1/chat/completions \
-H "Authorization: Bearer kn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "opus-hemat",
"messages": [{"role": "user", "content": "Halo"}]
}'
PolaLangkah 1Langkah berikutnyaKapan dipakai
BYOK dulucredential BYOK kamupool kenaripakai kuota key sendiri lebih dulu, pool kenari sebagai cadangan
Murah dulumodel murahmodel kuatmulai dari yang hemat, naik ke yang kuat saat perlu

Setiap akun punya satu rute read-only bernama kenari-free. Rute ini mengarah ke model gratis tanpa biaya dan dibatasi per akun. Namanya dicadangkan: rute kenari-free tidak bisa diedit atau dihapus.

Tanpa menyusun rute pun, tiap model metered sudah dirutekan otomatis. Untuk satu model, kenari menyimpan beberapa backend provider dan memilih backend sehat sesuai urutan prioritas yang kami atur (di antara backend dengan prioritas sama, yang lebih hemat didahulukan), lalu naik ke backend berikutnya bila yang pertama gagal, kena limit, atau lambat.

Backend yang error masuk cooldown sejenak, lalu request langsung dialihkan ke backend berikutnya. Kamu tidak perlu mengatur apa pun.

Dalam satu sesi, akun cenderung tetap di backend yang sama selama backend itu sehat. Hasilnya lebih konsisten dan latensi lebih stabil.

Bila satu provider punya beberapa key, kenari memutarnya untuk membagi beban dan menghindari limit.

Backend last-resort hanya dipakai ketika semua opsi lain tidak tersedia.