Arahkan Continue ke endpoint custom serasi OpenAI.

Updated 2026-07-29

Continue mengkonfigurasi model secara deklaratif dalam config.yaml. Tetapkan provider kepada openai, arahkan apiBase ke https://api.apisrouter.com/v1, dan setiap blok model yang anda tambah menjadi boleh dipilih dalam sambungan itu, dengan peranan chat, edit, dan apply boleh ditetapkan per model di bawah satu kunci.

Jawapan pantas: blok model dengan provider openai dan apiBase.

Penyedia openai Continue menerima override apiBase, yang merupakan laluan terdokumentasi untuk mana-mana pelayan serasi OpenAI. Tambah blok model ke config.yaml dengan provider ditetapkan kepada openai, apiBase ditetapkan kepada https://api.apisrouter.com/v1, id model yang tepat, dan kunci anda. Model itu muncul dalam pemilih model Continue, dan setiap permintaan yang dibuatnya pergi ke gateway melalui /v1/chat/completions standard. Mekanisme yang sama merangkumi seberapa banyak model yang anda mahu: satu blok per id, semuanya berkongsi apiBase dan kunci yang sama. Kerana Continue menganggap medan model sebagai rentetan biasa, id daripada vendor berbeza, Claude bersebelahan GPT bersebelahan DeepSeek, boleh berada dalam satu fail konfigurasi.

models:
  - name: Claude Sonnet 4.6
    provider: openai
    model: claude-sonnet-4-6
    apiBase: https://api.apisrouter.com/v1
    apiKey: sk-APIsRouter-...
    roles:
      - chat
      - edit
      - apply

Bagaimana Continue menetapkan kerja kepada model: peranan.

Continue (continuedev di GitHub, lebih kurang 34K bintang) ialah ejen IDE untuk VS Code dan JetBrains, dan idea konfigurasi definisinya ialah peranan. Setiap blok model membawa senarai roles, dan Continue menghalakan setiap jenis kerja kepada model yang memegang peranan itu: chat untuk panel perbualan dan kerja ejen, edit untuk transformasi kod inline, apply untuk menggabungkan perubahan yang dicadangkan ke dalam fail, ditambah autocomplete, embed, dan rerank untuk subsistem masing-masing. Inilah tuas yang menjadikan endpoint berbilang vendor menarik dalam Continue khususnya. Chat mahukan model paling kuat yang anda boleh wajarkan; edit dan apply adalah panggilan yang lebih pendek dan lebih mekanikal di mana id pertengahan yang pantas melakukan kerjanya. Dengan satu apiBase melayani setiap vendor, pembahagian itu adalah YAML tulen: id Claude memegang chat, id pantas memegang edit dan apply, satu kunci merentas semuanya. Satu sempadan jujur: autocomplete ialah beban kerja fill-in-the-middle, dan peranan autocomplete Continue dibina berdasarkan model yang dilatih untuk format penyempurnaan itu dan bukan sembang. Gateway chat-completions adalah rumah yang betul untuk trafik chat, edit, dan apply; kekalkan autocomplete pada apa sahaja persediaan berkeupayaan FIM yang anda gunakan sekarang dan bukan menetapkan peranan itu kepada model sembang dan mengharapkan cadangan yang baik.

Persediaan penuh: beberapa model, peranan berpisah, konteks yang diisytiharkan.

Fail konfigurasi berada di ~/.continue/config.yaml. Nama setiap blok ialah label yang ditunjukkan dalam pemilih; model ialah id tepat yang dilayani gateway. defaultCompletionOptions.contextLength mengisytiharkan tetingkap konteks model, dan Continue menggunakannya untuk memutuskan berapa banyak perbualan dan konteks fail untuk dimasukkan ke dalam permintaan, jadi membiarkannya pada lalai konservatif pada model konteks-panjang memotong lebih awal daripada sepatutnya. Keupayaan biasanya dikesan secara automatik, tetapi untuk id yang tidak dikenali Continue anda boleh menyatakannya secara eksplisit: capabilities: [tool_use] memberitahu mod ejen ia boleh memandu alat dengan model itu. Mengenai kunci: YAML menerima apiKey literal, yang baik untuk fail tempatan yang tidak pernah meninggalkan mesin anda. Continue juga menyokong sintaks templat rahsia dalam bentuk ${{ secrets.APISROUTER_API_KEY }} untuk konfigurasi yang diurus melalui hub-nya, yang mengekalkan nilai literal di luar fail yang dikongsi. Guna bentuk yang sepadan dengan di mana konfigurasi anda berada.

models:
  - name: Claude Sonnet 4.6
    provider: openai
    model: claude-sonnet-4-6
    apiBase: https://api.apisrouter.com/v1
    apiKey: ${{ secrets.APISROUTER_API_KEY }}
    roles: [chat, edit]
    capabilities: [tool_use]
    defaultCompletionOptions:
      contextLength: 200000

  - name: Claude Haiku 4.5
    provider: openai
    model: claude-haiku-4-5-20251001
    apiBase: https://api.apisrouter.com/v1
    apiKey: ${{ secrets.APISROUTER_API_KEY }}
    roles: [edit, apply]

  - name: GPT-5.5
    provider: openai
    model: gpt-5.5
    apiBase: https://api.apisrouter.com/v1
    apiKey: ${{ secrets.APISROUTER_API_KEY }}
    roles: [chat]

Memilih model setiap peranan.

Penetapan peranan juga mekanisme perbandingan. Kekalkan edit dan apply tetap, tukar blok chat antara dua id calon selama seminggu setiap satu, dan biarkan pandangan penggunaan per-kunci mengharga perbezaan pada beban kerja sebenar anda. Setiap calon adalah tiga baris YAML terhadap endpoint yang sama.

  • chat membawa gelung ejen dan perbualan panjang: membaca fail, merancang edit, menjawab soalan atas konteks sebenar. Model frontier (claude-sonnet-4-6, gpt-5.5) tergolong di sini, dan itulah tempat kebanyakan token anda pergi.
  • edit mengendalikan transformasi kod yang disorot. Panggilan lebih pendek dan lebih mekanikal daripada chat, jadi id pantas seperti claude-haiku-4-5-20251001 atau gpt-5.4-mini mengekalkan gelung edit ketat tanpa merosakkan hasil.
  • apply menggabungkan perubahan yang dicadangkan ke dalam fail. Ia peranan paling mekanikal daripada ketiga-tiga dan calon paling jelas untuk model berkeupayaan paling murah, deepseek-v4-flash termasuk.
  • embed dan rerank menguasakan pengambilan pangkalan kod dan adalah subsistem berasingan dengan bentuk model mereka sendiri; memindahkan trafik chat ke gateway tidak memerlukan menyentuhnya.

Bayar mengikut penggunaan · bawah harga rasmi

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModelHarga RasmiHarga Kami
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Haiku 4.5 20251001$1.00 / $5.00 per M$0.80 / $4.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.4 mini$0.75 / $4.50 per M$0.60 / $3.60 per M
DeepSeek V4 Flash$0.14 / $0.28 per M$0.10 / $0.30 per M

Mod kegagalan khusus Continue.

apiBase tanpa /v1. Continue melampirkan laluan route seperti /chat/completions kepada asas yang anda berikan, jadi https://api.apisrouter.com/v1 adalah betul dan hos kosong bukan. Ralat berbentuk 404 pada penggunaan pertama hampir selalu ini. Indentasi YAML secara senyap membentuk semula konfigurasi. models ialah senarai blok, dan apiBase yang tersalah indentasi melekat pada entri yang salah atau tiada apa-apa. Apabila satu model berfungsi dan jirannya tidak dapat mengesahkan, banding indentasi mereka sebelum mengesyaki gateway. Togol completions warisan. Penyedia openai secara lalai menggunakan /chat/completions, yang dilayani gateway. useLegacyCompletionsEndpoint: true mengalihkan blok ke route /completions warisan; jika blok mempunyainya ditetapkan, permintaan berbentuk chat berhenti berfungsi untuk model itu. Jangkaan Responses-API pada id siri GPT. Sesetengah laluan Continue boleh mencuba protokol responses OpenAI yang lebih baharu untuk nama model OpenAI tertentu. Gateway chat-completions tidak melayani protokol itu; jika blok siri GPT gagal dengan cara berbentuk route, tetapkan useResponsesApi: false pada blok itu supaya ia kekal di /chat/completions. contextLength yang lapuk. Continue mengemas konteks mengikut defaultCompletionOptions.contextLength, bukan mengikut apa yang boleh diterima model. Mengisytiharkan 32k pada model 200k tidak merosakkan apa-apa secara kelihatan; ia hanya secara senyap membuang konteks yang telah anda bayar. Isytiharkan apa yang benar-benar disokong model.

Siapa yang menghalakan Continue melalui gateway.

  • Pembangun berpaksikan IDE yang mahu Claude, GPT, dan DeepSeek boleh dipilih di dalam VS Code atau JetBrains tanpa menyelenggara satu set kelayakan setiap vendor.
  • Pasukan yang membahagikan peranan mengikut profil kos: chat frontier, edit dan apply pantas, setiap peranan memegang id yang sesuai dengannya, semua dibilkan pada satu permukaan.
  • Jurutera yang membandingkan model chat pada kerja sebenar. Setiap calon adalah satu blok YAML terhadap apiBase yang sama, bukan integrasi penyedia baharu.
  • Ketua pasukan yang menstandardkan orientasi: satu templat config.yaml ditambah satu APISROUTER_API_KEY menggantikan senarai semak kunci per-vendor, dan penggunaan per-kunci menunjukkan apa yang dibelanjakan setiap seat.
  • Pembangun tanpa akses kepada pengebilan vendor tertentu. Akses berasaskan top-up tanpa keperluan kad menghapuskan kebergantungan pendaftaran setiap penyedia.

Sahkan endpoint dan nyahpepijat permintaan pertama.

Senaraikan apa yang dilayani gateway sebelum mengedit YAML; id yang dikembalikan /v1/models adalah tepat rentetan yang mesti sepadan medan model anda. Kegagalan permintaan pertama mengikut corak. 401 bermaksud kunci dalam blok tertentu itu salah, atau rujukan secrets tidak diselesaikan; semak blok yang gagal dan bukan fail secara umum, kerana kunci per-blok bermaksud kegagalan per-blok. Ralat model-tidak-ditemui adalah kesilapan taip id, termasuk akhiran versi. Ralat berbentuk route pada id siri GPT menunjuk kepada togol responses-API yang dirangkumi di atas. Dan jika sambungan tidak menunjukkan langsung model custom, YAML itu tidak berjaya dihuraikan; sahkan struktur fail dahulu. Sebaik sahaja permintaan mengalir, konsol APIsRouter menunjukkan model per permintaan, kiraan token, dan perbelanjaan. Kerana Continue membahagikan kerja merentas peranan, pandangan penggunaan juga tempat pertama anda melihat nisbah trafik chat-ke-edit pada beban kerja sebenar anda, itulah nombor yang memberitahu anda di mana pilihan model benar-benar penting.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

Soalan lazim

Bolehkah Continue menggunakan model Claude dan DeepSeek melalui penyedia openai?

Ya. Penyedia openai dengan apiBase ditetapkan adalah laluan terdokumentasi untuk mana-mana pelayan serasi OpenAI, dan Continue meneruskan medan model sebagai rentetan biasa. Mana-mana id yang dilayani endpoint berfungsi, termasuk id Claude dan DeepSeek, satu blok model per id.

Adakah semua blok model saya berkongsi satu apiBase dan kunci?

Setiap blok mengisytiharkan apiBase dan apiKey sendiri, jadi ia boleh berkongsi nilai atau tidak. Mengarahkan beberapa blok ke endpoint yang sama dengan kunci yang sama adalah biasa, dan anchor YAML membolehkan anda mengisytiharkan pasangan itu sekali dan merujuknya per blok.

Peranan mana yang patut dihalakan melalui gateway?

chat, edit, dan apply, yang semuanya bertutur /v1/chat/completions. Autocomplete ialah beban kerja fill-in-the-middle yang dibina berdasarkan model format-penyempurnaan, jadi kekalkan peranan itu pada persediaan FIM sedia ada anda. embed dan rerank adalah subsistem berasingan dan tidak memerlukan perubahan.

Mengapa satu blok model berfungsi manakala yang lain mengembalikan 401?

Kunci adalah per blok dalam Continue, jadi jiran yang berfungsi tidak membuktikan apa-apa mengenai blok yang gagal. Semak nilai apiKey blok yang gagal atau rujukan secrets-nya, dan semak indentasinya: kunci yang tersalah indentasi melekat pada entri senarai yang salah.

Apa fungsi useLegacyCompletionsEndpoint dan adakah saya memerlukannya?

Ia mengalihkan blok model daripada /chat/completions ke route /completions warisan. Untuk gateway chat-completions anda tidak mahukannya; biarkan ia tidak ditetapkan. Ia wujud untuk pelayan penyempurnaan-sahaja yang lebih lama.

Adakah contextLength benar-benar mengubah tingkah laku?

Ya. Continue mengemas konteks perbualan dan fail mengikut defaultCompletionOptions.contextLength. Merendah-rendahkannya pada model konteks-panjang secara senyap membuang konteks; tetapkannya kepada apa yang benar-benar disokong model.