Jalankan Cline di model katalog apa pun via OpenAI Compatible.
Updated 2026-07-29
Dropdown API Provider Cline mencakup OpenAI Compatible untuk tepat ini: Base URL https://api.apisrouter.com/v1, satu key, dan id model yang Anda inginkan menjalankan agent. Id Claude, Kimi, dan sekelas Codex menjadi backend coding yang bisa dipertukarkan, dengan mode Plan dan Act masing-masing bisa dipin.
Jawaban singkat: tiga field di pengaturan Cline.
Buka panel Cline di VS Code dan klik ikon gear pengaturan. Di dropdown API Provider pilih OpenAI Compatible, lalu isi tiga field: Base URL https://api.apisrouter.com/v1, key Anda di API Key, dan id katalog persis di field model, misalnya claude-sonnet-4-6. Karena Cline tidak bisa tahu apa yang bisa dilakukan model dari endpoint sembarang, provider ini menampilkan opsi konfigurasi-model yang harus Anda atur jujur: ukuran context window, max output token, dan flag kapabilitas seperti dukungan gambar, plus harga input dan output opsional agar tampilan biaya Cline sendiri cocok dengan kenyataan. Atur window dan batas dari dokumentasi model. Simpan, dan agent menjalankan tugas berikutnya melalui gateway; id-nya bisa ditukar kapan saja tanpa menyentuh workflow Anda.
API Provider: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Model: claude-sonnet-4-6
Konfig model: context window + max output tokens
dari dokumentasi model,
dukungan gambar hanya jika id-nya punyaBagaimana Cline menggunakan model yang dikonfigurasi.
Cline (sekitar 65K bintang GitHub) adalah agent coding otonom untuk VS Code: ia membaca codebase Anda, mengedit file, menjalankan perintah terminal, dan mengiterasi kegagalan, dengan gerbang persetujuan manusia di sepanjang jalan. Loop itu haus model dalam bentuk spesifik: context panjang (file tree, diff, output terminal) masuk, tool call dan kode keluar, banyak giliran per tugas. Provider OpenAI Compatible mengirim loop itu sebagai chat completions standar ke Base URL Anda dengan id model sebagai string biasa. Vendor tidak penting bagi format wire, yang membuat model shopping nyata di sini: claude-sonnet-4-6, kimi-k2.7-code, dan gpt-5.6-sol adalah backend yang bisa dipertukarkan di balik tiga field yang sama, alih-alih tiga konfigurasi provider terpisah dengan tiga akun vendor. Flag kapabilitas layak diperhatikan karena agent bergantung padanya. Cline merencanakan berdasarkan apa yang Anda deklarasikan: dukungan gambar diaktifkan membuatnya mengirim screenshot ke model yang mungkin tidak menerimanya, dan context window yang dilebih-lebihkan mengundang kegagalan context-terpotong di dalam tugas panjang. Deklarasikan apa yang dikatakan dokumentasi model, bukan apa yang Anda harapkan.
Plan dan Act: dua mode, dua model.
Cline membagi kerja menjadi mode Plan, di mana ia menjelajahi codebase dan menyusun strategi tanpa mengedit, dan mode Act, di mana ia mengeksekusi. Konfigurasi API mengikuti pembagian itu: dengan opsi use-different-models diaktifkan, pengaturan menampilkan tab per mode dan setiap mode mengingat provider dan model-nya sendiri, berpindah otomatis saat Anda mengubah toggle. Ekonomi dari pembagian ini adalah intinya. Mode Plan adalah tempat reasoning dalam terbayar: claude-opus-4-7 atau gpt-5.5 membaca codebase dan menulis pendekatannya. Mode Act adalah banyak giliran tool-calling cepat yang mengeksekusi rencana yang sudah ada, yang persis profil kimi-k2.7-code atau claude-sonnet-4-6. Karena kedua mode ditagih melalui key gateway yang sama, pemasangan ini adalah pilihan pengaturan alih-alih proyek multi-vendor. Satu peringatan jujur dari issue tracker: pemilihan model per mode punya sisi kasar khususnya dengan provider OpenAI Compatible, termasuk laporan mode Act diam-diam menggunakan kembali model Plan. Setelah mengonfigurasi pembagian ini, jalankan satu tugas dan konfirmasi di header tugas model mana yang benar-benar melayani setiap mode, dan cek log penggunaan Anda; perlakukan pembagian ini sebagai terverifikasi hanya setelah Anda melihat kedua id muncul.
Mode Plan: claude-opus-4-7 (baca, bernalar, susun strategi)
Mode Act: kimi-k2.7-code (eksekusi, edit, jalankan, iterasi)
verifikasi: jalankan satu tugas, cek id mana yang melayani tiap mode,
lalu konfirmasi kedua id muncul di log penggunaanMemilih model coding untuk loop agent.
Loop agent melipatgandakan pengeluaran token dengan cara yang tidak pernah dilakukan chat; satu tugas Cline bisa lusinan request membawa context file. Itu membuat pilihan model bisa diukur: jalankan kelas tugas yang sama pada dua id selama seminggu dan baca pengeluaran per model di sebelah seberapa sering Anda harus turun tangan.
- claude-sonnet-4-6 adalah jawaban default untuk kerja mode-Act: tool calling yang bisa diandalkan, diff yang kuat, dan cukup penilaian untuk pulih dari perintah yang gagal.
- kimi-k2.7-code adalah pilihan volume untuk sesi agentic panjang; disetel untuk kode, cepat, dan diberi harga untuk loop banyak-giliran yang sebenarnya dijalankan Cline.
- gpt-5.6-sol mendapat slot untuk edit terlingkup cepat dan run test-fixing, di mana latensi per giliran membentuk rasa sesi.
- claude-opus-4-7 tergolong di mode Plan untuk tugas sulit: perubahan arsitektur, refactor lintas-file, debugging yang butuh gambaran utuh.
- gpt-5.5 adalah generalist kuat untuk di-A/B melawan Claude di mode Plan pada codebase Anda sendiri, bukan pada benchmark.
Bayar sesuai pemakaian · di bawah harga resmi
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Harga Resmi | Harga Kami |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Mode kegagalan spesifik Cline.
Perilaku terpotong atau amnesia jauh di dalam tugas adalah deklarasi context-window: atur ke window terdokumentasi model, dan ingat Cline mengemas context file secara agresif, jadi window yang dilebih-lebihkan gagal tepat pada tugas terbesar dan paling menjengkelkan. Keanehan tool-call, edit yang cacat, atau agent yang bernarasi alih-alih bertindak biasanya berarti id yang dipilih lemah dalam function calling; beralih ke claude-sonnet-4-6 untuk memisahkan masalah konfigurasi dari pilihan model sebelum menyalahkan setup-nya. Error keras dipetakan bersih: autentikasi adalah field key; model-not-found adalah ejaan id terhadap listing /v1/models; 404 di setiap request adalah Base URL yang kehilangan /v1-nya atau menggandakannya. Provider ini menambahkan path route ke base yang Anda berikan. Dan peringatan per-mode diulang sekali lagi, karena itu menghabiskan uang sungguhan saat terlewat: jika Anda mengonfigurasi model Plan dan Act yang berbeda, verifikasi kedua id benar-benar melayani mode-nya pada tugas live. Fallback diam ke model Plan yang mahal untuk setiap giliran Act adalah jenis hal yang ditangkap log penggunaan pada hari pertama dan ditangkap statement kartu di akhir bulan.
Siapa yang merutekan Cline melalui gateway.
- Developer yang ingin Claude menjalankan agent mereka tanpa hubungan billing Anthropic, pada saldo prabayar tanpa kartu untuk mulai.
- Model shopper yang membandingkan model coding pada tugas nyata di codebase nyata mereka, di mana setiap kandidat adalah edit field-model.
- Pengguna Cline berat yang memasangkan model Plan mahal dengan model Act cepat untuk menjaga sesi panjang terjangkau tanpa kehilangan kualitas perencanaan.
- Tim yang memeteri pengeluaran agent per developer atau per proyek dengan penggunaan per-key, alih-alih menebak dari tagihan vendor bersama.
- Developer yang sudah merutekan tool terminal dan editor melalui gateway yang ingin agent VS Code pada key dan log yang sama.
Verifikasi endpoint dan debug tugas pertama.
Curl listing model dan satu chat completion dulu, dengan id persis yang Anda rencanakan konfigurasikan. Keduanya lolos berarti separuh gateway sudah selesai dan setiap gejala tersisa ada di pengaturan provider. Lalu beri Cline satu tugas nyata kecil, satu file, tujuan jelas, dan amati giliran pertama. Tool call yang bersih dan edit yang masuk akal berarti id dan flag kapabilitas cocok. Error dipetakan ke tiga field; perilaku agent yang aneh dipetakan ke pilihan model atau kapabilitas yang dideklarasikan. Jika Anda mengaktifkan model per mode, tugas pertama ini juga run verifikasi Anda untuk pembagian itu. Setelah tugas mengalir, konsol APIsRouter menunjukkan model per request, hitungan token, dan pengeluaran. Loop agent adalah cara paling intensif-token untuk menggunakan model, dan tampilan penggunaan per-key adalah tempat seminggu Cline menjadi angka konkret, per model, per hari, per mode jika Anda memisahkan key.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Pertanyaan umum
Bagaimana cara menggunakan endpoint OpenAI-compatible dengan Cline?
Buka pengaturan Cline di VS Code, pilih OpenAI Compatible di dropdown API Provider, dan atur Base URL https://api.apisrouter.com/v1, API key Anda, dan id model. Isi context window dan max output tokens dari dokumentasi model.
Bisakah Cline menjalankan model Claude melalui provider ini?
Ya. Provider ini meneruskan id model sebagai string biasa melalui chat completions standar, jadi claude-sonnet-4-6 dan claude-opus-4-7 berfungsi persis seperti id GPT, satu key untuk semuanya, dan berpindah vendor adalah edit field-model.
Bisakah mode Plan dan mode Act menggunakan model berbeda?
Ya. Aktifkan opsi use-different-models di konfigurasi API Cline dan setiap mode mendapat tab-nya sendiri dengan provider dan model-nya sendiri. Verifikasi pembagian ini di tugas live, karena pemilihan per mode punya sisi kasar yang dilaporkan dengan provider OpenAI Compatible, termasuk mode Act menggunakan kembali model Plan.
Apa yang harus saya atur untuk context window dan max output tokens?
Nilai terdokumentasi model, bukan default atau harapan. Cline mengemas context file panjang ke dalam request, jadi window yang dilebih-lebihkan gagal pada tugas terbesar dan yang dikurangi memotong kode keluar dari context. Max output tokens membatasi setiap respons, disesuaikan dengan yang diizinkan id.
Mengapa Cline berperilaku buruk di tool call dengan beberapa model?
Loop agent bergantung pada function calling yang bisa diandalkan, dan id sangat bervariasi di sana. Jika edit keluar cacat atau agent bernarasi alih-alih bertindak, uji tugas yang sama di claude-sonnet-4-6; jika itu memperbaiki perilakunya, itu pilihan model, bukan konfigurasi.
Bagaimana saya tahu berapa biaya seminggu Cline sebenarnya?
Tampilan penggunaan per-key di konsol APIsRouter menunjukkan token dan pengeluaran per request dan per model. Tugas agent adalah lusinan request masing-masing, jadi log itu satu-satunya ukuran jujur; tampilan biaya dalam-app Cline juga membantu jika Anda mengisi field harga opsional.