Arahkan Continue ke endpoint OpenAI-compatible kustom.
Updated 2026-07-29
Continue mengonfigurasi model secara deklaratif di config.yaml. Atur provider ke openai, arahkan apiBase ke https://api.apisrouter.com/v1, dan setiap blok model yang Anda tambahkan menjadi bisa dipilih di ekstensi, dengan role chat, edit, dan apply bisa diberikan per model di bawah satu key.
Jawaban singkat: blok model dengan provider openai dan apiBase.
Provider openai Continue menerima override apiBase, yang merupakan jalur terdokumentasi untuk server OpenAI-compatible apa pun. Tambahkan blok model ke config.yaml dengan provider diatur ke openai, apiBase diatur ke https://api.apisrouter.com/v1, id model persis, dan key Anda. Model itu muncul di selector model Continue, dan setiap request yang dibuatnya pergi ke gateway melalui /v1/chat/completions standar. Mekanisme yang sama mencakup sebanyak apa pun model yang Anda inginkan: satu blok per id, semuanya berbagi apiBase dan key yang sama. Karena Continue memperlakukan field model sebagai string biasa, id dari vendor berbeda, Claude di samping GPT di samping DeepSeek, duduk berdampingan di satu file konfigurasi.
models:
- name: Claude Sonnet 4.6
provider: openai
model: claude-sonnet-4-6
apiBase: https://api.apisrouter.com/v1
apiKey: sk-APIsRouter-...
roles:
- chat
- edit
- applyBagaimana Continue menugaskan pekerjaan ke model: role.
Continue (continuedev di GitHub, sekitar 34K bintang) adalah agent IDE untuk VS Code dan JetBrains, dan ide konfigurasi definitifnya adalah role. Setiap blok model membawa daftar roles, dan Continue merutekan setiap jenis pekerjaan ke model yang memegang role itu: chat untuk panel percakapan dan kerja agent, edit untuk transformasi kode inline, apply untuk menggabungkan perubahan yang diusulkan ke file, plus autocomplete, embed, dan rerank untuk subsistem masing-masing. Inilah tuas yang membuat endpoint multi-vendor menarik khusus di Continue. Chat menginginkan model terkuat yang bisa Anda justifikasi; edit dan apply adalah panggilan yang lebih singkat dan mekanis di mana id mid-tier yang cepat menyelesaikan tugasnya. Dengan satu apiBase melayani setiap vendor, pembagian itu murni YAML: id Claude memegang chat, id cepat memegang edit dan apply, satu key untuk semuanya. Satu batasan jujur: autocomplete adalah beban kerja fill-in-the-middle, dan role autocomplete Continue dibangun di sekitar model yang dilatih untuk format completion itu daripada chat. Gateway chat-completions adalah rumah yang tepat untuk traffic chat, edit, dan apply; jaga autocomplete pada setup FIM-capable apa pun yang Anda gunakan sekarang daripada menugaskan role itu ke model chat dan mengharapkan saran yang bagus.
Setup lengkap: beberapa model, role terpisah, context terdeklarasi.
File konfigurasinya berada di ~/.continue/config.yaml. Nama setiap blok adalah label yang ditampilkan di selector; model adalah id persis yang dilayani gateway. defaultCompletionOptions.contextLength mendeklarasikan context window model, dan Continue menggunakannya untuk memutuskan berapa banyak percakapan dan context file yang dikemas ke dalam request, jadi membiarkannya pada default konservatif pada model long-context memotong lebih awal dari seharusnya. Kapabilitas biasanya terdeteksi otomatis, tapi untuk id yang tidak dikenali Continue Anda bisa menyatakannya secara eksplisit: capabilities: [tool_use] memberi tahu mode agent bahwa ia boleh menjalankan tool dengan model itu. Soal key: YAML menerima apiKey literal, yang baik-baik saja untuk file lokal yang tidak pernah keluar dari mesin Anda. Continue juga mendukung sintaks template secrets berbentuk ${{ secrets.APISROUTER_API_KEY }} untuk konfigurasi yang dikelola melalui hub-nya, yang menjaga nilai literal keluar dari file bersama. Gunakan bentuk yang cocok dengan tempat konfigurasi Anda berada.
models:
- name: Claude Sonnet 4.6
provider: openai
model: claude-sonnet-4-6
apiBase: https://api.apisrouter.com/v1
apiKey: ${{ secrets.APISROUTER_API_KEY }}
roles: [chat, edit]
capabilities: [tool_use]
defaultCompletionOptions:
contextLength: 200000
- name: Claude Haiku 4.5
provider: openai
model: claude-haiku-4-5-20251001
apiBase: https://api.apisrouter.com/v1
apiKey: ${{ secrets.APISROUTER_API_KEY }}
roles: [edit, apply]
- name: GPT-5.5
provider: openai
model: gpt-5.5
apiBase: https://api.apisrouter.com/v1
apiKey: ${{ secrets.APISROUTER_API_KEY }}
roles: [chat]Memilih model per role.
Penugasan role juga menjadi mekanisme perbandingan. Tahan edit dan apply tetap, tukar blok chat antara dua id kandidat selama seminggu masing-masing, dan biarkan tampilan penggunaan per-key memberi harga perbedaannya pada beban kerja nyata Anda. Setiap kandidat adalah tiga baris YAML terhadap endpoint yang sama.
- chat mengangkut loop agent dan percakapan panjang: membaca file, merencanakan edit, menjawab pertanyaan atas context nyata. Model frontier (claude-sonnet-4-6, gpt-5.5) tergolong di sini, dan di sinilah sebagian besar token Anda pergi.
- edit menangani transformasi kode yang di-highlight. Panggilannya lebih singkat dan lebih mekanis dari chat, jadi id cepat seperti claude-haiku-4-5-20251001 atau gpt-5.4-mini menjaga loop edit tetap ketat tanpa menurunkan hasil.
- apply menggabungkan perubahan yang diusulkan ke file. Ini role paling mekanis dari ketiganya dan kandidat paling jelas untuk model mampu yang paling murah, termasuk deepseek-v4-flash.
- embed dan rerank menggerakkan retrieval codebase dan merupakan subsistem terpisah dengan bentuk model mereka sendiri; memindahkan traffic chat ke gateway tidak memerlukan menyentuhnya.
Bayar sesuai pemakaian · di bawah harga resmi
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Harga Resmi | Harga Kami |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.4 mini | $0.75 / $4.50 per M | $0.60 / $3.60 per M |
| DeepSeek V4 Flash | $0.14 / $0.28 per M | $0.10 / $0.30 per M |
Mode kegagalan spesifik Continue.
apiBase tanpa /v1. Continue menambahkan path route seperti /chat/completions ke base yang Anda berikan, jadi https://api.apisrouter.com/v1 benar dan host telanjang tidak. Error berbentuk-404 pada penggunaan pertama hampir selalu ini. Indentasi YAML diam-diam mengubah bentuk konfigurasi. models adalah daftar blok, dan apiBase yang salah indentasi menempel ke entri yang salah atau ke tidak ada apa-apa. Saat satu model berfungsi dan tetangganya tidak bisa autentikasi, diff indentasinya sebelum mencurigai gateway. Toggle completions legacy. Provider openai default ke /chat/completions, yang dilayani gateway. useLegacyCompletionsEndpoint: true mengarahkan blok ke route /completions legacy; jika suatu blok mengaturnya, request berbentuk chat berhenti berfungsi untuk model itu. Ekspektasi Responses-API pada id seri-GPT. Beberapa jalur Continue bisa mencoba protokol responses OpenAI yang lebih baru untuk nama model OpenAI tertentu. Gateway chat-completions tidak melayani protokol itu; jika blok seri-GPT error dengan bentuk route, atur useResponsesApi: false pada blok itu agar tetap di /chat/completions. contextLength yang basi. Continue mengemas context sesuai defaultCompletionOptions.contextLength, bukan sesuai apa yang bisa diterima model. Mendeklarasikan 32k pada model 200k tidak merusak apa pun secara terlihat; ia hanya diam-diam membuang context yang sudah Anda bayar. Deklarasikan apa yang benar-benar didukung model.
Siapa yang merutekan Continue melalui gateway.
- Developer IDE-first yang ingin Claude, GPT, dan DeepSeek bisa dipilih di dalam VS Code atau JetBrains tanpa memelihara satu set kredensial per vendor.
- Tim yang memisahkan role berdasarkan profil biaya: chat frontier, edit dan apply cepat, setiap role memegang id yang cocok, semua ditagih pada satu permukaan.
- Engineer yang membandingkan model chat pada kerja nyata. Setiap kandidat adalah satu blok YAML terhadap apiBase yang sama, bukan integrasi provider baru.
- Team lead yang menstandarkan onboarding: satu template config.yaml plus satu APISROUTER_API_KEY menggantikan checklist key per vendor, dan penggunaan per-key menunjukkan apa yang dibelanjakan setiap seat.
- Developer tanpa akses ke billing vendor tertentu. Akses berbasis top-up tanpa syarat kartu menghilangkan ketergantungan sign-up per provider.
Verifikasi endpoint dan debug request pertama.
Daftar apa yang dilayani gateway sebelum mengedit YAML; id yang dikembalikan /v1/models adalah persis string yang harus dicocokkan field model Anda. Kegagalan request pertama mengikuti pola. 401 berarti key di blok spesifik itu salah, atau referensi secrets tidak ter-resolve; cek blok yang gagal daripada file secara umum, karena key per-blok berarti kegagalan per-blok. Error model-not-found adalah salah ketik id, termasuk suffix versi. Error berbentuk-route pada id seri-GPT menunjuk ke toggle responses-API yang dibahas di atas. Dan jika ekstensi tidak menampilkan model kustom sama sekali, YAML-nya tidak ter-parse; validasi struktur file dulu. Setelah request mengalir, konsol APIsRouter menunjukkan model per request, hitungan token, dan pengeluaran. Karena Continue membagi kerja lintas role, tampilan penggunaan juga tempat pertama Anda melihat rasio traffic chat-ke-edit pada beban kerja nyata Anda, yang merupakan angka yang memberi tahu di mana pilihan model sungguh penting.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50Pertanyaan umum
Bisakah Continue menggunakan model Claude dan DeepSeek melalui provider openai?
Ya. Provider openai dengan apiBase diatur adalah jalur terdokumentasi untuk server OpenAI-compatible apa pun, dan Continue meneruskan field model sebagai string biasa. Id apa pun yang dilayani endpoint berfungsi, termasuk id Claude dan DeepSeek, satu blok model per id.
Apakah semua blok model saya berbagi satu apiBase dan key?
Setiap blok mendeklarasikan apiBase dan apiKey sendiri, jadi mereka bisa berbagi nilai atau tidak. Mengarahkan beberapa blok ke endpoint yang sama dengan key yang sama adalah normal, dan YAML anchor membiarkan Anda mendeklarasikan pasangan itu sekali dan mereferensikannya per blok.
Role mana yang harus dirutekan melalui gateway?
chat, edit, dan apply, yang semuanya berbicara /v1/chat/completions. Autocomplete adalah beban kerja fill-in-the-middle yang dibangun di sekitar model format-completion, jadi jaga role itu pada setup FIM Anda yang sudah ada. embed dan rerank adalah subsistem terpisah dan tidak butuh perubahan.
Mengapa satu blok model berfungsi sementara yang lain mengembalikan 401?
Key bersifat per blok di Continue, jadi tetangga yang berfungsi tidak membuktikan apa pun tentang blok yang gagal. Cek nilai apiKey blok yang gagal atau referensi secrets-nya, dan cek indentasinya: key yang salah indentasi menempel ke entri daftar yang salah.
Apa fungsi useLegacyCompletionsEndpoint dan apakah saya membutuhkannya?
Ia mengarahkan blok model dari /chat/completions ke route /completions legacy. Untuk gateway chat-completions Anda tidak menginginkannya; biarkan tidak diatur. Ini ada untuk server completion-only yang lebih lama.
Apakah contextLength benar-benar mengubah perilaku?
Ya. Continue mengemas context percakapan dan file sesuai defaultCompletionOptions.contextLength. Mengurangi nilainya pada model long-context diam-diam membuang context; atur ke apa yang benar-benar didukung model.