Draai Cline op elk catalogusmodel via OpenAI Compatible.
Updated 2026-07-29
De API Provider-dropdown van Cline bevat OpenAI Compatible voor precies dit doel: Base URL https://api.apisrouter.com/v1, één sleutel, en het model-ID dat de agent moet aansturen. Claude-, Kimi- en Codex-klasse-ID's worden inwisselbare coderingsbackends, waarbij Plan- en Act-modus elk vastgezet kunnen worden.
Snel antwoord: drie velden in de instellingen van Cline.
Open het Cline-paneel in VS Code en klik op het tandwiel voor instellingen. Kies in de API Provider-dropdown OpenAI Compatible, en vul dan drie velden in: Base URL https://api.apisrouter.com/v1, je sleutel in API Key, en het exacte catalogus-ID in het modelveld, bijvoorbeeld claude-sonnet-4-6. Omdat Cline niet kan weten wat het model van een willekeurig endpoint aankan, biedt de provider modelconfiguratieopties die je eerlijk moet instellen: contextvenstergrootte, max output tokens, en capaciteitsvlaggen zoals beeldondersteuning, plus optionele input- en outputprijzen zodat de eigen kostenweergave van Cline overeenkomt met de realiteit. Stel het venster en de limieten in op basis van de documentatie van het model. Sla op, en de agent draait zijn volgende taak via de gateway; het ID is op elk moment verwisselbaar zonder je workflow aan te raken.
API Provider: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Model: claude-sonnet-4-6
Model config: context window + max output tokens
from the model's documentation,
image support only if the id has itHoe Cline het geconfigureerde model gebruikt.
Cline (ruim 65K GitHub-sterren) is de autonome coderingsagent voor VS Code: het leest je codebase, bewerkt bestanden, voert terminalopdrachten uit en itereert op fouten, met goedkeuringspoorten voor de mens onderweg. Die lus is modelhongerig op een specifieke manier: lange contexten (bestandsbomen, diffs, terminaloutput) erin, tool calls en code eruit, veel beurten per taak. De OpenAI Compatible-provider verstuurt die lus als standaard chat completions naar je Base URL, met het model-ID als platte string. De leverancier maakt niet uit voor het wire-formaat, en dat maakt modelshoppen hier echt: claude-sonnet-4-6, kimi-k2.7-code en gpt-5.6-sol zijn inwisselbare backends achter dezelfde drie velden, in plaats van drie aparte providerconfiguraties met drie leveranciersaccounts. De capaciteitsvlaggen verdienen zorgvuldigheid omdat de agent ervan afhangt. Cline plant rondom wat je declareert: beeldondersteuning inschakelen laat het screenshots sturen naar een model dat ze misschien niet accepteert, en een overdreven contextvenster nodigt uit tot afgeknotte-contextfouten diep in lange taken. Declareer wat de documentatie van het model zegt, niet wat je hoopt.
Plan en Act: twee modi, twee modellen.
Cline splitst werk op in Plan-modus, waarin het de codebase verkent en strategieën uitstippelt zonder te bewerken, en Act-modus, waarin het uitvoert. De API-configuratie volgt die splitsing: met de optie use-different-models ingeschakeld, tonen de instellingen tabbladen per modus, en elke modus onthoudt zijn eigen provider en model, en schakelt automatisch bij het wisselen. De economie van de splitsing is precies het punt. Plan-modus is waar diep redeneren loont: claude-opus-4-7 of gpt-5.5 leest de codebase en schrijft de aanpak uit. Act-modus bestaat uit veel snelle tool-callende beurten die een reeds bestaand plan uitvoeren, en dat is precies het profiel van kimi-k2.7-code of claude-sonnet-4-6. Omdat beide modi via dezelfde gatewaysleutel factureren, is de koppeling een instellingskeuze in plaats van een project met meerdere leveranciers. Eén eerlijke kanttekening uit de issue tracker: modelselectie per modus heeft ruwe randjes gehad, specifiek met de OpenAI Compatible-provider, inclusief meldingen dat Act-modus stilletjes het Plan-model hergebruikte. Draai na het configureren van de splitsing één taak en bevestig in de taakheader welk model elke modus daadwerkelijk heeft bediend, en controleer je gebruikslogboek; behandel de splitsing pas als geverifieerd nadat je beide ID's hebt zien verschijnen.
Plan mode: claude-opus-4-7 (read, reason, strategize)
Act mode: kimi-k2.7-code (execute, edit, run, iterate)
verify: run one task, check which id served each mode,
then confirm both ids appear in the usage logCoderingsmodellen kiezen voor de agentlus.
Agentlussen vermenigvuldigen tokenuitgaven op manieren die chat nooit doet; één enkele Cline-taak kan tientallen verzoeken bevatten die bestandscontext meedragen. Dat maakt de modelkeuze meetbaar: draai dezelfde klasse taak een week lang op twee ID's en lees de uitgaven per model naast hoe vaak je moest ingrijpen.
- claude-sonnet-4-6 is het standaardantwoord voor Act-moduswerk: betrouwbare tool calls, sterke diffs, en genoeg beoordelingsvermogen om te herstellen van mislukte commando's.
- kimi-k2.7-code is de volumekeuze voor lange agentische sessies; codegestemd, snel, en geprijsd voor de veelbeurtige lus die Cline daadwerkelijk draait.
- gpt-5.6-sol verdient een plek voor snelle, afgebakende wijzigingen en test-fixruns, waar latentie per beurt bepaalt hoe de sessie aanvoelt.
- claude-opus-4-7 hoort thuis in Plan-modus bij moeilijke taken: architectuurwijzigingen, refactors over meerdere bestanden, debugging die het hele plaatje nodig heeft.
- gpt-5.5 is de sterke generalist om in Plan-modus tegen Claude te A/B-testen op je eigen codebase, niet op benchmarks.
Betaal naar gebruik · onder officiële prijzen
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Officiële prijs | Onze prijs |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Faalmodi specifiek voor Cline.
Afgeknot of vergeetachtig gedrag diep in een taak is de contextvensterdeclaratie: stel het in op het gedocumenteerde venster van het model, en onthoud dat Cline bestandscontext agressief inpakt, dus een overdreven venster faalt precies bij de grootste, meest vervelende taken. Vreemd gedrag bij tool calls, misvormde bewerkingen, of de agent die vertelt in plaats van handelt, betekent meestal dat het gekozen ID zwak is in function calling; schakel over naar claude-sonnet-4-6 om configuratieproblemen te scheiden van modelkeuze voordat je de instelling de schuld geeft. Harde fouten zijn helder te herleiden: authenticatie is het sleutelveld; model-not-found is de spelling van het ID tegenover de /v1/models-lijst; 404's bij elk verzoek zijn een Base URL zonder /v1 of met een dubbele /v1. De provider voegt routepaden toe aan de base die je opgeeft. En de kanttekening per modus nog eens herhaald, omdat het echt geld kost als je het mist: als je verschillende Plan- en Act-modellen hebt geconfigureerd, verifieer dan dat beide ID's daadwerkelijk hun modi bedienen bij een live taak. Een stille terugval naar het dure Plan-model bij elke Act-beurt is het soort ding dat het gebruikslogboek al op dag één opvangt, en een kaartafschrift pas aan het einde van de maand.
Wie routeert Cline via een gateway.
- Developers die Claude hun agent willen laten aansturen zonder een facturatierelatie met Anthropic, op een vooruitbetaald tegoed zonder kaart om te beginnen.
- Modelshoppers die coderingsmodellen vergelijken op echte taken in hun echte codebase, waar elke kandidaat een wijziging in het modelveld is.
- Zware Cline-gebruikers die een duur Plan-model koppelen aan een snel Act-model om lange sessies betaalbaar te houden zonder in te leveren op planningskwaliteit.
- Teams die agentuitgaven per developer of per project meten met gebruik per sleutel, in plaats van te gokken op basis van een gedeelde leveranciersrekening.
- Developers die terminal- en editortools al via een gateway routeren en de VS Code-agent op dezelfde sleutel en hetzelfde logboek willen.
Verifieer het endpoint en debug de eerste taak.
Curl eerst de modellijst op en één chat completion, met het exacte ID dat je van plan bent te configureren. Als beide slagen, is de gateway-helft klaar en zit elk resterend symptoom in de providerinstellingen. Geef Cline vervolgens een kleine, echte taak — één bestand, duidelijk doel — en kijk naar de eerste beurten. Schone tool calls en verstandige bewerkingen betekenen dat het ID en de capaciteitsvlaggen kloppen. Fouten zijn te herleiden naar de drie velden; vreemd agentgedrag naar modelkeuze of gedeclareerde capaciteiten. Als je modellen per modus hebt ingeschakeld, is deze eerste taak ook je verificatierun voor de splitsing. Zodra taken vloeien, toont de APIsRouter-console model per verzoek, tokenaantallen en uitgaven. Een agentlus is de tokenintensiefste manier om een model te gebruiken, en de gebruiksweergave per sleutel is waar een week Cline een concreet getal wordt, per model, per dag, per modus als je sleutels splitst.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Veelgestelde vragen
Hoe gebruik ik een OpenAI-compatibel endpoint met Cline?
Open de instellingen van Cline in VS Code, kies OpenAI Compatible in de API Provider-dropdown, en stel Base URL https://api.apisrouter.com/v1, je API-sleutel en het model-ID in. Vul het contextvenster en max output tokens in op basis van de documentatie van het model.
Kan Cline Claude-modellen draaien via deze provider?
Ja. De provider stuurt het model-ID als platte string door via standaard chat completions, dus claude-sonnet-4-6 en claude-opus-4-7 werken precies als GPT-ID's, met één sleutel voor allemaal, en van leverancier wisselen is een wijziging in het modelveld.
Kunnen Plan-modus en Act-modus verschillende modellen gebruiken?
Ja. Schakel de optie use-different-models in de API-configuratie van Cline in, en elke modus krijgt zijn eigen tabblad met zijn eigen provider en model. Verifieer de splitsing echter bij een live taak: modusselectie heeft gemelde ruwe randjes gehad met de OpenAI Compatible-provider, inclusief Act-modus die het Plan-model hergebruikt.
Wat moet ik instellen voor contextvenster en max output tokens?
De gedocumenteerde waarden van het model, niet standaardwaarden of hoop. Cline pakt lange bestandscontext in verzoeken, dus een overdreven venster faalt bij de grootste taken en een te laag ingeschat venster snijdt code uit de context. Max output tokens begrenst elke reactie, afgestemd op wat het ID toelaat.
Waarom gedraagt Cline zich slecht bij tool calls met sommige modellen?
Agentlussen zijn afhankelijk van betrouwbare function calling, en ID's variëren daar sterk in. Als bewerkingen misvormd uitkomen of de agent vertelt in plaats van handelt, test dezelfde taak dan op claude-sonnet-4-6; als dat het gedrag verhelpt, is het modelkeuze, geen configuratie.
Hoe weet ik wat een week Cline daadwerkelijk kost?
De gebruiksweergave per sleutel in de APIsRouter-console toont tokens en uitgaven per verzoek en per model. Agenttaken bestaan elk uit tientallen verzoeken, dus het logboek is de enige eerlijke maatstaf; de kostenweergave in de app van Cline helpt ook als je de optionele prijsvelden invult.