Fai girare Kilo Code su qualsiasi modello del catalogo via OpenAI Compatible.

Updated 2026-07-30

Kilo Code offre un flusso per provider personalizzato costruito per i gateway: scegli OpenAI Compatible come Provider API, imposta Base URL su https://api.apisrouter.com/v1, incolla una chiave, e Kilo recupera automaticamente l'elenco modelli da /v1/models. Gli id di classe Claude, Kimi, e Codex diventano backend intercambiabili per l'agente.

Risposta rapida: una voce provider personalizzata.

Apri le impostazioni di Kilo Code tramite l'icona a ingranaggio, vai alla scheda Providers, e scegli l'opzione provider personalizzato. Dagli un Provider ID e un nome visualizzato, imposta Provider API su OpenAI Compatible, Base URL su https://api.apisrouter.com/v1, e incolla la tua chiave. Una volta che Base URL e chiave sono validi, Kilo interroga l'elenco /v1/models dell'endpoint e presenta un selettore ricercabile di ogni id disponibile, così selezioni claude-sonnet-4-6 o kimi-k2.7-code da un elenco invece di digitarlo alla cieca. I modelli possono anche essere aggiunti manualmente, e gli header HTTP personalizzati sono supportati come coppie chiave-valore se ne hai bisogno. Salva, e il prossimo task dell'agente instrada attraverso il gateway.

Provider ID:    apisrouter
Display name:   APIsRouter
Provider API:   OpenAI Compatible
Base URL:       https://api.apisrouter.com/v1
API key:        sk-YOUR-APISROUTER-KEY
Models:         pick from the auto-fetched list
                (e.g. claude-sonnet-4-6, kimi-k2.7-code)

Come Kilo Code usa il provider.

Kilo Code (circa 26K stelle su GitHub) è un agente di coding AI open source per VS Code: pianifica, modifica file, esegue comandi, e itera sui fallimenti con gate di approvazione, nella linea di discendenza di Roo e Cline. Quel loop ha una forma di traffico specifica: contesto lungo in ingresso, chiamate a tool e diff in uscita, molti turni per task, il che rende il modello sottostante sia la leva di qualità sia il driver di costo. Il provider OpenAI Compatible invia quel loop come chat completions standard al tuo Base URL, con l'id del modello come stringa semplice. Il formato sul filo non si preoccupa dei fornitori, il che rende possibile un vero shopping di modelli: claude-sonnet-4-6, kimi-k2.7-code, e gpt-5.6-sol sono voci intercambiabili dietro un provider, invece di tre account fornitore con tre configurazioni di fatturazione. Per il tuning per modello, i limiti di token, il comportamento di tool-calling, e le varianti vivono nel file di config kilo.jsonc, che puoi modificare direttamente quando un modello ha bisogno di impostazioni che la UI non espone. Imposta i limiti dichiarati dalla documentazione del modello, non dall'ottimismo: l'agente impacchetta il contesto in modo aggressivo, e una finestra sovrastimata fallisce esattamente sui task più grandi.

Scegliere modelli di coding per il loop di Kilo.

Le modalità di Kilo lasciano che diversi tipi di lavoro portino configurazioni diverse, e il modo onesto di sfruttarlo è empirico: esegui la stessa classe di task su due id per una settimana, poi leggi la spesa per modello nella console del gateway accanto a quante volte hai dovuto intervenire. I loop agentici sono il modo più intensivo in token di usare un modello, quindi la differenza è misurabile, non una sensazione.

  • claude-sonnet-4-6 è il default affidabile: tool calling forte, diff puliti, e buon recupero quando un comando fallisce a metà task.
  • kimi-k2.7-code è la scelta di volume per sessioni agentiche lunghe, ottimizzato per il codice e prezzato per il loop a molti turni che Kilo esegue davvero.
  • gpt-5.6-sol si adatta a modifiche rapide e mirate e sessioni di correzione test dove la latenza per turno plasma la sessione.
  • claude-opus-4-7 guadagna la sua tariffa sui task difficili: refactoring cross-file, lavoro architetturale, debugging che ha bisogno dell'intero quadro nel contesto.
  • gpt-5.5 è il generalista di frontiera da mettere in A/B contro Claude sul tuo stesso repository piuttosto che sulle tabelle di benchmark.

Pagamento a consumo · sotto i prezzi ufficiali

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModelloPrezzo ufficialeIl nostro prezzo
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Modalità di errore specifiche di Kilo Code.

Fai debug nell'ordine standard: curl sull'elenco modelli, curl su una completion con l'id esatto, e solo dopo modifica le impostazioni di Kilo. Due comandi separano nettamente i problemi di gateway dalla configurazione dell'editor.

  • Il selettore modelli appare vuoto: Base URL o chiave sono sbagliati, poiché il selettore viene popolato da una chiamata /v1/models dal vivo. Fai una curl sull'elenco con gli stessi valori per confermare.
  • 404 su ogni richiesta: a Base URL manca /v1, oppure hai incollato un percorso completo /chat/completions dove va una base. Kilo accetta URL di endpoint completi, ma solo se puntano alla route chat-completions corretta.
  • Comportamento troncato o amnesiaco nel profondo di un task: i limiti di contesto dichiarati in kilo.jsonc superano ciò che il modello supporta davvero. Usa i valori documentati.
  • Chiamate a tool narrate invece che eseguite: l'id scelto è debole nel function calling. Riesegui il task su claude-sonnet-4-6 per separare la scelta del modello dalla configurazione prima di toccare le impostazioni.
  • Nota specifica su Azure dalla documentazione: i deployment Azure GPT-5 rifiutano il campo max_tokens che i provider compatibili OpenAI personalizzati inviano, quindi Azure dovrebbe usare il provider nativo azure di Kilo. Irrilevante per un gateway, ma spiega un errore confuso se testi entrambi.

Chi instrada Kilo Code tramite un gateway.

  • Sviluppatori che vogliono Claude a guidare l'agente senza una relazione di fatturazione Anthropic separata, su un saldo prepagato con avvio gratuito senza carta.
  • Chi fa shopping di modelli usando il selettore auto-recuperato per provare id di coding su task reali nel proprio repository reale.
  • Utenti intensivi che abbinano un modello di frontiera per lavoro di grado pianificazione a un modello di volume per sessioni di esecuzione lunghe.
  • Team che misurano la spesa agente per sviluppatore con utilizzo per chiave invece di fare reverse-engineering di una fattura fornitore condivisa.
  • Persone che già instradano altri strumenti tramite un gateway e vogliono l'agente VS Code sulla stessa chiave e log di utilizzo.

Verifica l'endpoint ed esegui il primo task.

Dimostra la metà gateway con curl prima di configurare l'editor: elenca i modelli, poi invia una completion con l'id che intendi scegliere. Quando entrambe passano, tutto il resto sta nel modulo del provider. Poi dai a Kilo un piccolo task reale con un obiettivo chiaro e osserva i primi turni. Chiamate a tool pulite e modifiche sensate significano che l'id si adatta al loop; gli errori duri si mappano sui tre campi. Una volta che i task fluiscono, la console di APIsRouter mostra il modello per richiesta, i token, e la spesa, che è dove una settimana di uso dell'agente diventa un numero concreto per modello.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Domande frequenti

Come aggiungo un provider OpenAI-compatible a Kilo Code?

Ingranaggio delle impostazioni → scheda Providers → provider personalizzato. Imposta Provider API su OpenAI Compatible, Base URL su https://api.apisrouter.com/v1, e incolla la tua chiave. Kilo poi recupera automaticamente l'elenco modelli da /v1/models e scegli gli id da un elenco ricercabile.

Kilo Code può far girare modelli Claude tramite questo provider?

Sì. Il provider inoltra l'id del modello come stringa semplice su chat completions standard, quindi claude-sonnet-4-6 e claude-opus-4-7 funzionano allo stesso modo degli id GPT, su una chiave, e cambiare fornitore è una selezione nel selettore.

Perché l'elenco modelli è vuoto dopo che ho aggiunto il provider?

L'auto-recupero si popola da una chiamata /v1/models dal vivo, quindi un elenco vuoto significa che Base URL o chiave sono sbagliati. Fai una curl sull'elenco con gli stessi valori; se funziona, ricontrolla cosa hai effettivamente salvato nel modulo provider. I modelli possono anche essere aggiunti manualmente.

Dove imposto la finestra di contesto e i limiti di token per un modello personalizzato?

In kilo.jsonc, il file di config di Kilo, che porta limiti di token per modello, impostazioni di tool-calling, e varianti oltre a ciò che il modulo provider espone. Usa i valori documentati del modello; limiti sovrastimati falliscono sui task più grandi.

La chiave API deve andare nel modulo?

Il campo chiave è il percorso normale, ma è opzionale se gestisci l'autenticazione tramite header personalizzati, che il modulo provider supporta come coppie chiave-valore. Per una configurazione gateway standard, il campo chiave è la scelta giusta.

Come faccio a sapere quanto costa una settimana di Kilo Code?

Leggi la vista di utilizzo per chiave nella console di APIsRouter: token e spesa per richiesta e per modello. I task dell'agente sono decine di richieste ciascuno, quindi il log è l'unica misura onesta di quanto costa il tuo pattern di utilizzo.