Fai girare Cline su qualsiasi modello del catalogo tramite OpenAI Compatible.
Updated 2026-07-29
Il menu a tendina API Provider di Cline include OpenAI Compatible esattamente per questo: Base URL https://api.apisrouter.com/v1, una chiave, e l'id del modello che vuoi guidi l'agente. Gli id Claude, Kimi e di classe Codex diventano backend di coding intercambiabili, con le modalità Plan e Act ciascuna fissabile separatamente.
Risposta rapida: tre campi nelle impostazioni di Cline.
Apri il pannello Cline in VS Code e clicca l'ingranaggio delle impostazioni. Nel menu a tendina API Provider scegli OpenAI Compatible, poi compila tre campi: Base URL https://api.apisrouter.com/v1, la tua chiave in API Key, e l'id esatto di catalogo nel campo model, per esempio claude-sonnet-4-6. Poiché Cline non può sapere cosa sia in grado di fare il modello di un endpoint arbitrario, il provider espone opzioni di configurazione del modello che dovresti impostare onestamente: dimensione della finestra di contesto, token di output massimi, e flag di capacità come il supporto immagini, più prezzi opzionali di input e output così che la visualizzazione del costo propria di Cline corrisponda alla realtà. Imposta la finestra e i limiti dalla documentazione del modello. Salva, e l'agente esegue il suo prossimo task attraverso il gateway; l'id è sostituibile in qualsiasi momento senza toccare il tuo workflow.
API Provider: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Model: claude-sonnet-4-6
Model config: context window + max output tokens
from the model's documentation,
image support only if the id has itCome Cline usa il modello configurato.
Cline (circa 65K stelle su GitHub) è l'agente di coding autonomo per VS Code: legge la tua codebase, modifica i file, esegue comandi da terminale, e itera sui fallimenti, con gate di approvazione umana lungo il percorso. Quel ciclo è affamato di modelli in una forma specifica: contesti lunghi (alberi di file, diff, output del terminale) in ingresso, tool call e codice in uscita, molti turni per task. Il provider OpenAI Compatible invia quel ciclo come chat completions standard al tuo Base URL con l'id del modello come semplice stringa. Il fornitore non conta per il formato di trasmissione, ed è ciò che rende reale qui la scelta comparativa dei modelli: claude-sonnet-4-6, kimi-k2.7-code e gpt-5.6-sol sono backend intercambiabili dietro gli stessi tre campi, invece di tre configurazioni di provider separate con tre account fornitore. I flag di capacità meritano attenzione perché l'agente dipende da essi. Cline pianifica in base a ciò che dichiari: il supporto immagini abilitato gli permette di inviare screenshot a un modello che potrebbe non accettarli, e una finestra di contesto sovrastimata invita a fallimenti di contesto troncato nel profondo di task lunghi. Dichiara ciò che dice la documentazione del modello, non ciò che speri.
Plan e Act: due modalità, due modelli.
Cline divide il lavoro in modalità Plan, dove esplora la codebase e pianifica strategicamente senza modificare, e modalità Act, dove esegue. La configurazione API segue questa divisione: con l'opzione use-different-models abilitata, le impostazioni mostrano schede per modalità e ciascuna modalità ricorda il proprio provider e modello, cambiando automaticamente quando commuti. L'economia della divisione è il punto centrale. La modalità Plan è dove il ragionamento profondo ripaga: claude-opus-4-7 o gpt-5.5 che legge la codebase e scrive l'approccio. La modalità Act è composta da molti turni veloci di tool-calling che eseguono un piano già esistente, che è esattamente il profilo di kimi-k2.7-code o claude-sonnet-4-6. Dato che entrambe le modalità fatturano attraverso la stessa chiave gateway, l'abbinamento è una scelta di impostazioni piuttosto che un progetto multi-fornitore. Un avvertimento onesto dall'issue tracker: la selezione del modello per modalità ha avuto asperità specificamente con il provider OpenAI Compatible, incluse segnalazioni della modalità Act che riutilizza silenziosamente il modello Plan. Dopo aver configurato la divisione, esegui un task e conferma nell'intestazione del task quale modello ha effettivamente servito ciascuna modalità, e controlla il tuo log di utilizzo; considera la divisione verificata solo dopo aver visto comparire entrambi gli id.
Plan mode: claude-opus-4-7 (read, reason, strategize)
Act mode: kimi-k2.7-code (execute, edit, run, iterate)
verify: run one task, check which id served each mode,
then confirm both ids appear in the usage logScegliere modelli di coding per il ciclo dell'agente.
I cicli agentici moltiplicano la spesa di token in modi che la chat non fa mai; un singolo task di Cline può essere decine di richieste che portano contesto di file. Questo rende misurabile la scelta del modello: esegui la stessa classe di task su due id per una settimana e leggi la spesa per modello accanto a quante volte hai dovuto intervenire.
- claude-sonnet-4-6 è la risposta predefinita per il lavoro in modalità Act: tool calling affidabile, diff solidi, e abbastanza giudizio per recuperare da comandi falliti.
- kimi-k2.7-code è la scelta a volume per sessioni agentiche lunghe; ottimizzato per il codice, veloce, e prezzato per il ciclo a molti turni che Cline esegue davvero.
- gpt-5.6-sol si guadagna uno slot per modifiche rapide e ben delimitate e per le sessioni di correzione dei test, dove la latenza per turno modella come si sente la sessione.
- claude-opus-4-7 appartiene alla modalità Plan sui task difficili: cambiamenti architetturali, refactoring cross-file, debugging che ha bisogno del quadro completo.
- gpt-5.5 è il forte generalista da confrontare in A/B con Claude in modalità Plan sulla tua stessa codebase, non sui benchmark.
Pagamento a consumo · sotto i prezzi ufficiali
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modello | Prezzo ufficiale | Il nostro prezzo |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Modalità di errore specifiche di Cline.
Il comportamento troncato o amnesico nel profondo di un task è la dichiarazione della finestra di contesto: impostala sulla finestra documentata del modello, e ricorda che Cline impacchetta il contesto di file in modo aggressivo, quindi una finestra sovrastimata fallisce esattamente sui task più grandi e fastidiosi. Stranezze nelle tool call, modifiche malformate, o l'agente che narra invece di agire di solito significa che l'id scelto è debole nel function calling; passa a claude-sonnet-4-6 per separare i problemi di configurazione dalla scelta del modello prima di dare la colpa alla configurazione. Gli errori difficili si mappano in modo pulito: l'autenticazione è il campo chiave; modello-non-trovato è un errore di ortografia dell'id rispetto all'elenco /v1/models; 404 su ogni richiesta sono un Base URL a cui manca il /v1 o che lo raddoppia. Il provider aggiunge percorsi di route alla base che gli dai. E l'avvertimento per modalità ripetuto una volta, perché costa soldi veri quando viene mancato: se hai configurato modelli Plan e Act diversi, verifica che entrambi gli id servano davvero le loro modalità su un task reale. Un fallback silenzioso al costoso modello Plan per ogni turno Act è il genere di cosa che il log di utilizzo cattura il primo giorno e un estratto conto cattura a fine mese.
Chi instrada Cline tramite un gateway.
- Sviluppatori che vogliono Claude a guidare il loro agente senza una relazione di fatturazione con Anthropic, su un saldo prepagato senza carta per iniziare.
- Chi confronta modelli di coding su task reali nella propria codebase reale, dove ogni candidato è una modifica al campo modello.
- Utenti intensivi di Cline che abbinano un costoso modello Plan a un veloce modello Act per mantenere le sessioni lunghe accessibili senza perdere qualità di pianificazione.
- Team che misurano la spesa dell'agente per sviluppatore o per progetto con l'utilizzo per chiave, invece di indovinare da una fattura fornitore condivisa.
- Sviluppatori che già instradano strumenti da terminale ed editor tramite un gateway e vogliono l'agente di VS Code sulla stessa chiave e log.
Verifica l'endpoint e fai debug del primo task.
Esegui prima curl sull'elenco dei modelli e su una chat completion, con l'id esatto che intendi configurare. Se entrambi passano, la metà gateway è fatta e ogni sintomo rimanente è nelle impostazioni del provider. Poi dai a Cline un piccolo task reale, un file, obiettivo chiaro, e osserva i primi turni. Tool call pulite e modifiche sensate significano che l'id e i flag di capacità sono adatti. Gli errori si mappano sui tre campi; il comportamento strano dell'agente si mappa sulla scelta del modello o sulle capacità dichiarate. Se hai abilitato i modelli per modalità, questo primo task è anche la tua run di verifica per la divisione. Una volta che i task scorrono, la console di APIsRouter mostra modello per richiesta, conteggi dei token e spesa. Un ciclo agentico è il modo più token-intensivo di usare un modello, e la vista di utilizzo per chiave è dove una settimana di Cline diventa un numero concreto, per modello, per giorno, per modalità se dividi le chiavi.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Domande frequenti
Come uso un endpoint compatibile OpenAI con Cline?
Apri le impostazioni di Cline in VS Code, scegli OpenAI Compatible nel menu a tendina API Provider, e imposta Base URL https://api.apisrouter.com/v1, la tua API key, e l'id del modello. Compila la finestra di contesto e i token di output massimi dalla documentazione del modello.
Cline può far girare modelli Claude tramite questo provider?
Sì. Il provider inoltra l'id del modello come semplice stringa su chat completions standard, quindi claude-sonnet-4-6 e claude-opus-4-7 funzionano esattamente come gli id GPT, una chiave per tutti loro, e cambiare fornitore è una modifica al campo modello.
La modalità Plan e la modalità Act possono usare modelli diversi?
Sì. Abilita l'opzione use-different-models nella configurazione API di Cline e ciascuna modalità ottiene la propria scheda con il proprio provider e modello. Verifica però la divisione su un task reale: la selezione per modalità ha avuto asperità segnalate con il provider OpenAI Compatible, incluso il riutilizzo del modello Plan da parte della modalità Act.
Cosa dovrei impostare per la finestra di contesto e i token di output massimi?
I valori documentati del modello, non default o speranze. Cline impacchetta lungo contesto di file nelle richieste, quindi una finestra sovrastimata fallisce sui task più grandi e una sottostimata taglia codice fuori dal contesto. I token di output massimi limitano ogni risposta, dimensionati su ciò che l'id consente.
Perché Cline si comporta male con le tool call con alcuni modelli?
I cicli agentici dipendono da un function calling affidabile, e gli id variano molto in questo. Se le modifiche escono malformate o l'agente narra invece di agire, testa lo stesso task su claude-sonnet-4-6; se corregge il comportamento, è una questione di scelta del modello, non di configurazione.
Come faccio a sapere quanto costa davvero una settimana di Cline?
La vista di utilizzo per chiave nella console di APIsRouter mostra token e spesa per richiesta e per modello. I task agentici sono decine di richieste ciascuno, quindi il log è l'unica misura onesta; anche la visualizzazione del costo in-app di Cline aiuta se inserisci i campi prezzo opzionali.