TL;DR: Fallback model AI di 9Router diatur lewat fitur Combo: buka Dashboard, masuk Combos, buat combo baru, isi daftar model berurutan (model utama, cadangan murah, cadangan terakhir), lalu pakai nama combo itu sebagai nama model di Cursor, Claude Code, Cline, OpenClaw, atau tool lain yang mendukung endpoint OpenAI kustom. Menurut README resmi 9Router (per Oktober 2026), router akan pindah otomatis ke model berikutnya saat kuota habis atau terjadi error. Tidak ada checkbox pemicu khusus yang perlu dicentang, dan tagihan tiap provider tetap berjalan seperti biasa.
💡 KEY TAKEAWAY
- Combo = rantai fallback: urutan model di combo menentukan prioritas, dari atas ke bawah.
- Nama combo jadi nama model: tool kamu cukup diarahkan ke
http://localhost:20128/v1dengan model berisi nama combo. - Update dulu sebelum dipakai: versi 9Router sampai 0.4.41 punya celah kebocoran API key tanpa autentikasi (CVE-2026-62328).
- Fallback bukan gratis: model cadangan tetap ditagih provider-nya, dan kualitas jawabannya bisa beda dari model utama.
Lagi asyik ngoding pakai Cursor atau Claude Code, atau AI agent kamu sedang menjalankan workflow, lalu semuanya berhenti gara-gara pesan Error 429: Rate limit reached atau Insufficient quota. Cara paling praktis mencegah kejadian itu adalah membuat 9Router Combo: satu nama model virtual berisi beberapa model berurutan, sehingga saat model pertama kehabisan kuota atau error, request otomatis diteruskan ke model berikutnya tanpa kamu mengganti setting di tool.
Apa Itu Combo di 9Router dan Bagaimana Fallback Bekerja
9Router adalah AI router open-source yang berjalan di mesin atau server kamu sendiri dan menyediakan endpoint berformat OpenAI di http://localhost:20128/v1 — sumber: README resmi 9Router di GitHub. Semua tool AI kamu cukup terhubung ke satu endpoint itu, lalu 9Router yang meneruskan request ke provider seperti Anthropic, OpenAI, GLM, MiniMax, DeepSeek, atau Groq.
Combo adalah rantai fallback buatan kamu sendiri. Dokumentasi resmi 9Router menjelaskan Combo sebagai urutan model yang dicoba satu per satu sampai ada yang berhasil — sumber: dokumentasi Combos 9Router. README menyebut pemicunya secara umum: pindah otomatis “saat kuota habis atau terjadi error”. README tidak merinci pengaturan per kode status (misalnya khusus 429 atau timeout 30 detik), jadi jangan berharap ada menu pemicu semacam itu.
Pola yang dicontohkan README disebut Smart 3-Tier Fallback: langganan dulu, lalu API murah, lalu jalur gratis. Contoh nama model di bawah diambil dari README per Oktober 2026; awalan sebelum garis miring (cc/, glm/, minimax/, kr/) menunjukkan provider-nya.
| Tier | Fungsi | Contoh model (README, Okt 2026) | Catatan biaya |
|---|---|---|---|
| 1 — Utama / langganan | Model andalan untuk tugas berat dan reasoning | cc/claude-opus-4-7 |
Memakai kuota langganan Claude Code kamu |
| 2 — Cadangan murah | Ambil alih saat kuota tier 1 habis | glm/glm-5.1, minimax/MiniMax-M2.7 |
README mencantumkan GLM $0,6 dan MiniMax $0,20 per 1 juta token |
| 3 — Cadangan terakhir | Jaring pengaman supaya pekerjaan tidak berhenti total | kr/claude-sonnet-4.5 (Kiro), OpenCode Free |
Kiro gratis terbatas sekitar 50 kredit/bulan; daftar model OpenCode Free berubah-ubah |
Soal tier gratis, README 9Router mencatat Kiro AI pindah ke model berbayar sejak September 2025 dan jatah gratisnya kini dibatasi 50 kredit per bulan, sementara jalur gratis iFlow, Qwen Code, dan Gemini CLI sudah dihentikan di 2026. Jadi tier 3 adalah cadangan darurat, bukan sumber token tanpa batas.
Prasyarat Sebelum Mulai
Sebelum membuat combo, siapkan empat hal berikut:
- Node.js 20+ atau Docker di laptop atau server. README menyebut runtime Node.js 20+ untuk instalasi lewat npm.
- 9Router yang sudah terpasang dan berjalan. Kalau mau menaruhnya di server supaya bisa dipakai 24 jam, ikuti panduan install 9Router di VPS dengan Docker dulu, lalu kembali ke langkah konfigurasi di bawah.
- Minimal dua provider berbeda, bisa langganan, API key berbayar, atau provider gratis seperti Kiro dan OpenCode Free.
- Tool yang mendukung custom OpenAI base URL, misalnya Cursor, Claude Code, Cline, OpenClaw, atau script Python kamu sendiri.
Masih menimbang antara router lokal dan layanan gateway terkelola? Perbandingan biaya, privasi, dan cara kerjanya dibahas di OpenRouter vs 9Router: panduan memilih AI gateway.
Pastikan versi 9Router sudah terbaru
Langkah ini sering terlewat. Advisory keamanan GHSA-vjc7-jrh9-9j86 (CVE-2026-62328, dipublikasikan Juli 2026) mencatat 9Router versi 0.4.41 ke bawah membuka endpoint seperti /api/providers dan /api/usage/stats tanpa autentikasi, sampai bisa membocorkan API key utuh dan riwayat percakapan — sumber: GitHub Security Advisory 9Router. Advisory kedua, CVE-2026-56678, diperbaiki di versi 0.5.6 — sumber: advisory GHSA-6mwv-4mrm-5p3m.
Versi terbaru di registry npm per 9 Oktober 2026 adalah 0.5.99. Update dengan npm install -g 9router atau docker pull decolua/9router:latest sebelum kamu memasukkan API key apa pun.
Step-by-Step: Mengatur Fallback Model di 9Router
Enam langkah di bawah mengikuti alur di README dan dokumentasi Combos resmi. Nama menu bisa sedikit berbeda antar-versi, tapi urutannya sama.
Step 1: Buka dashboard 9Router
Setelah 9Router berjalan lewat terminal atau container, buka http://localhost:20128/dashboard di browser (ganti localhost dengan IP server kalau dipasang di VPS dan aksesnya sudah kamu amankan).
Password login pertama diatur lewat variabel lingkungan INITIAL_PASSWORD. Kalau variabel itu tidak diisi, README menyebut password bawaannya 123456, jadi segera ganti, terutama kalau dashboard bisa diakses dari luar mesin kamu.
Step 2: Hubungkan provider dan masukkan API key
- Masuk ke menu Providers.
- Untuk provider berbasis login (misalnya Kiro atau Claude Code), pilih Connect dan ikuti alur otorisasinya.
- Untuk provider berbasis API key (misalnya GLM atau MiniMax), pilih Add API Key lalu tempel key-nya.
- Untuk endpoint yang tidak ada di daftar, pakai provider OpenAI Compatible dan isi base URL-nya sendiri.
- (Opsional) Hubungkan OpenCode Free yang tidak butuh login, sebagai cadangan terakhir.
Model lokal seperti Ollama juga bisa dijadikan cadangan lewat jalur OpenAI Compatible karena Ollama menyediakan endpoint berformat OpenAI di /v1 — sumber: dokumentasi Ollama. Catatannya, 9Router harus bisa menjangkau alamat Ollama itu: 9Router di VPS tidak bisa memanggil Ollama yang berjalan di laptop kamu lewat localhost.
Step 3: Buat combo baru
Buka Dashboard → Combos → Create New, lalu beri nama yang mudah diingat. Nama inilah yang nanti diketik di tool kamu, jadi pakai huruf kecil dan tanda hubung, misalnya coding-tahan-limit. README sendiri mencontohkan nama seperti premium-coding dan free-combo.
Step 4: Susun urutan model
Di dalam combo, tambahkan model sesuai urutan prioritas. Model nomor 1 dicoba pertama, nomor 2 dipakai kalau nomor 1 gagal, dan seterusnya. Contoh dari README:
Name: premium-coding
Models:
1. cc/claude-opus-4-7 (langganan, utama)
2. glm/glm-5.1 (cadangan murah, $0.6/1M)
3. minimax/MiniMax-M2.7 (cadangan paling murah, $0.20/1M)
Simpan combo-nya. Tidak ada daftar pemicu yang perlu dicentang: menurut README, perpindahan terjadi otomatis saat kuota habis atau terjadi error. Kalau semua model di rantai gagal, dokumentasi Combos menyebut request akan dikembalikan sebagai error, jadi tambahkan tier gratis di urutan terakhir kalau kamu ingin pekerjaan tetap jalan.
Step 5: Hubungkan tool atau agent ke 9Router
Ganti pengaturan di tool AI kamu menjadi:
- Base URL / OpenAI endpoint:
http://localhost:20128/v1 - API key: salin API key yang dibuat di dashboard 9Router, bukan API key asli provider.
- Model: nama combo yang tadi dibuat, misalnya
premium-coding.
Khusus OpenClaw, README mencatat integrasinya hanya jalan dengan 9Router lokal dan menyarankan http://127.0.0.1:20128/v1 alih-alih localhost untuk menghindari masalah resolusi IPv6.
Step 6: Uji dan pantau fallback
Dashboard 9Router tidak menyediakan log request secara bawaan. README mencatat variabel ENABLE_REQUEST_LOGS bernilai false secara default. Ada tiga cara memantau:
- Usage Analytics dan quota tracking di dashboard, untuk melihat pemakaian token per provider dan model. README menegaskan angka “cost” di sana hanya estimasi pembanding, bukan tagihan.
docker logs -f 9routerkalau kamu memakai Docker.- Set
ENABLE_REQUEST_LOGS=truekalau butuh log request/response lengkap di folderlogs/. Matikan lagi setelah selesai karena log bisa berisi isi prompt.
Cara uji yang lebih hemat: buat combo uji yang model pertamanya sengaja memakai koneksi provider yang dinonaktifkan atau kuotanya sudah habis, kirim satu prompt, lalu cek di Usage Analytics apakah request tercatat di model kedua. Cara ini lebih hemat daripada membanjiri model utama dengan prompt sampai kena rate limit.
Pro Tips Komunitech untuk Efisiensi
Setelah combo jalan, tiga pengaturan berikut membantu kuota bertahan lebih lama.
- RTK Token Saver sudah aktif secara default. README menyebut fitur ini memampatkan output tool seperti
git diff,grep, dan log terminal sebelum dikirim ke model, dan mengklaim penghematan 20-40% token input per request. Angka itu klaim pengembang, bukan hasil uji independen. Kamu cukup memastikan toggle-nya masih ON di Dashboard → Endpoint settings. - Tambahkan beberapa akun per provider. README mendukung multi-akun per provider dengan routing round-robin atau berbasis prioritas, plus pindah ke akun berikutnya saat satu akun kena kuota. Ini fallback di level akun, melengkapi fallback antar-model di combo.
- Taruh provider yang paling cepat di urutan awal kalau aplikasimu butuh respons real-time, misalnya chatbot customer service. Ukur sendiri latensinya di Usage Analytics, karena kecepatan tiap provider berubah tergantung beban dan region.
Kapan Fallback Justru Bikin Masalah
Fallback menjaga pekerjaan tetap jalan, tapi ada harga yang dibayar. Tiga kondisi berikut perlu kamu pertimbangkan sebelum memasang combo di pekerjaan penting.
Kualitas dan format jawaban berubah diam-diam. Saat request pindah dari model premium ke model murah, gaya penulisan kode, kepatuhan pada format JSON, dan kemampuan reasoning ikut berubah. Untuk refactor besar atau kode produksi, dokumentasi Combos sendiri mencontohkan combo “quality-first” yang hanya berisi model premium dan memilih gagal dengan error daripada turun ke model murah.
Tagihan tetap berjalan. 9Router tidak menagih apa pun, tapi setiap token yang lewat model cadangan berbayar tetap ditagih provider-nya. Combo yang terlalu sering jatuh ke tier 2 adalah tanda kuota tier 1 tidak cukup.
Agent yang butuh konsistensi. AI agent yang memanggil tool dengan skema ketat bisa gagal di tengah jalan kalau model cadangan tidak mendukung function calling dengan baik. Uji tiap model di combo dengan alur agent yang sama sebelum mengandalkannya.
💡 KEY TAKEAWAY
- Pantau, jangan menebak: log request mati secara default; pakai Usage Analytics,
docker logs, atau nyalakanENABLE_REQUEST_LOGSsementara. - Dua lapis cadangan: multi-akun menahan rate limit di provider yang sama, combo menahan saat seluruh provider gagal.
- Pekerjaan kritis butuh combo terpisah: buat combo berisi model premium saja untuk kode produksi, dan combo murah untuk tugas ringan.
Komunitech: Bangun Karyawan AI yang Tidak Gampang Mogok
Router dengan fallback adalah fondasi sebelum AI agent dipakai untuk urusan bisnis. Agent yang membalas pelanggan jam 2 pagi tidak boleh berhenti hanya karena satu provider kehabisan kuota.
Di workshop OpenClaw yang diselenggarakan Komunitech, peserta belajar menyusun AI Agent berbasis OpenClaw menjadi Karyawan AI yang berjalan di server, termasuk menghubungkannya ke router model supaya biaya API tetap terkendali. Kalau kamu ingin melihat jalur lengkapnya dari konsep sampai agent aktif di server, mulai dari cara belajar bikin AI agent dari nol sampai deploy pakai OpenClaw.
Untuk tahu kenapa OpenClaw yang dipilih sebagai bahan ajar dan apa saja yang dipraktikkan, baca alasan Komunitech memakai OpenClaw untuk kursus AI, atau pantau jadwal batch berikutnya di halaman workshop Komunitech.
Pertanyaan yang Sering Ditanya
Apakah 9Router aman dipakai untuk data sensitif?
9Router berjalan self-hosted, dan request ke model diteruskan langsung ke provider yang kamu pilih. Ada dua catatan: fitur Cloud Sync bisa menyinkronkan provider, combo, dan pengaturan ke cloud 9Router (endpoint default https://9router.com), dan versi lama sampai 0.4.41 punya celah kebocoran API key. Cek pengaturan Cloud Sync dan pastikan versi terbaru sebelum dipakai untuk data sensitif.
Apakah saya tetap harus membayar ke OpenAI atau Anthropic?
Ya. 9Router hanya mengatur rute, bukan penyedia model. Setiap token yang dipakai tetap ditagih provider masing-masing sesuai harga dan paket kamu. Angka biaya di Usage Analytics hanya estimasi, jadi tetap pantau dashboard billing di tiap provider.
Apakah 9Router hanya untuk tool coding?
Tidak. README menyebut 9Router bisa dipakai tool apa pun yang mendukung endpoint OpenAI kustom. Selain Cursor, Claude Code, dan Cline, endpoint /v1 bisa dipanggil dari library OpenAI di Python atau Node.js, framework seperti LangChain, dan tool otomasi seperti n8n yang menyediakan isian base URL. Kompatibilitas tiap tool tetap perlu kamu uji sendiri.
Apa bedanya combo dengan multi-akun?
Combo memindahkan request ke model lain, misalnya dari Claude ke GLM. Multi-akun memindahkan request ke akun lain di provider yang sama, misalnya dari akun GLM pertama ke akun GLM kedua, dengan model yang tetap sama. Keduanya bisa dipakai bersamaan.
Apakah 9Router wajib meminta API key dari tool yang terhubung?
Tidak secara default. Variabel REQUIRE_API_KEY bernilai false, dan README merekomendasikan mengubahnya ke true untuk deploy yang bisa diakses dari internet. Di Docker, 9Router juga mendengarkan di 0.0.0.0, jadi batasi port 20128 dengan firewall atau SSH tunnel.
Disclaimer: pemakaian API dan batas kuota tunduk pada ketentuan layanan masing-masing provider AI. Nama model, harga, dan jatah gratis di halaman ini diambil dari dokumentasi resmi 9Router per Oktober 2026 dan bisa berubah sewaktu-waktu. Pantau dashboard billing tiap provider untuk menghindari biaya tak terduga.
Referensi
- README resmi 9Router — GitHub decolua/9router
- Dokumentasi Combos 9Router — Custom Fallback Chains
- GitHub Security Advisory GHSA-vjc7-jrh9-9j86 (CVE-2026-62328)
- GitHub Security Advisory GHSA-6mwv-4mrm-5p3m (CVE-2026-56678)
- Dokumentasi Ollama — OpenAI compatibility
Artikel telah diupdate pada 09/10/2026 untuk memastikan artikel tetap sesuai kondisi terkini.








Tinggalkan Balasan