Draai Kilo Code op elk catalogusmodel via OpenAI Compatible.
Updated 2026-07-30
Kilo Code levert een aangepaste-providerflow gebouwd voor gateways: kies OpenAI Compatible als de Provider API, zet Base URL op https://api.apisrouter.com/v1, plak één sleutel, en Kilo haalt automatisch de modellijst op uit /v1/models. Claude-, Kimi- en Codex-achtige ID's worden verwisselbare backends voor de agent.
Snel antwoord: één aangepaste providervermelding.
Open de instellingen van Kilo Code via het tandwielicoon, ga naar het tabblad Providers, en kies de optie custom provider. Geef het een Provider ID en weergavenaam, zet Provider API op OpenAI Compatible, Base URL op https://api.apisrouter.com/v1, en plak je sleutel. Zodra de Base URL en sleutel geldig zijn, bevraagt Kilo de /v1/models-lijst van het endpoint en presenteert een doorzoekbare kiezer van elk beschikbaar ID, zodat je claude-sonnet-4-6 of kimi-k2.7-code selecteert uit een lijst in plaats van blind te typen. Modellen kunnen ook handmatig worden toegevoegd, en aangepaste HTTP-headers worden ondersteund als key-value-paren als je die nodig hebt. Sla op, en de volgende taak van de agent routeert via de gateway.
Provider ID: apisrouter
Display name: APIsRouter
Provider API: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API key: sk-YOUR-APISROUTER-KEY
Models: pick from the auto-fetched list
(e.g. claude-sonnet-4-6, kimi-k2.7-code)Hoe Kilo Code de provider gebruikt.
Kilo Code (ongeveer 26K GitHub-sterren) is een open-source AI-codeeragent voor VS Code: hij plant, bewerkt bestanden, draait commando's, en itereert op fouten met goedkeuringspoorten, in de lijn van Roo en Cline. Die lus heeft een specifieke verkeersvorm: lange context in, tool-aanroepen en diffs uit, veel beurten per taak, wat het onderliggende model zowel de kwaliteitshendel als de kostenaanjager maakt. De OpenAI Compatible-provider stuurt die lus als standaard chat completions naar je Base URL, met het model-ID als platte string. Het wireformaat maakt zich niet druk om leveranciers, wat echt modelwinkelen mogelijk maakt: claude-sonnet-4-6, kimi-k2.7-code en gpt-5.6-sol zijn verwisselbare vermeldingen achter één provider, in plaats van drie leveranciersaccounts met drie factureringsopstellingen. Voor tuning per model leven tokenlimieten, tool-aanroepgedrag en varianten in het configbestand kilo.jsonc, dat je rechtstreeks kunt bewerken wanneer een model instellingen nodig heeft die de UI niet blootstelt. Zet gedeclareerde limieten vanuit de documentatie van het model, niet vanuit optimisme: de agent pakt context agressief in, en een overschat venster faalt precies op de grootste taken.
Codeermodellen kiezen voor de lus van Kilo.
De modi van Kilo laten verschillende soorten werk verschillende configuratie dragen, en de eerlijke manier om dat te benutten is empirisch: draai dezelfde klasse taak op twee ID's gedurende een week, lees dan uitgaven per model in de gatewayconsole naast hoe vaak je moest ingrijpen. Agentlussen zijn de meest tokenintensieve manier om een model te gebruiken, dus het verschil is meetbaar, geen gevoel.
- claude-sonnet-4-6 is de betrouwbare standaard: sterke tool-aanroepen, schone diffs, en goed herstel wanneer een commando midden in een taak faalt.
- kimi-k2.7-code is de volumekeuze voor lange agentic sessies, code-afgestemd en geprijsd voor de veel-beurten-lus die Kilo daadwerkelijk draait.
- gpt-5.6-sol past bij snelle, afgebakende bewerkingen en test-fix-runs waar latentie per beurt de sessie vormt.
- claude-opus-4-7 verdient zijn tarief op moeilijke taken: cross-file refactors, architectuurwerk, debuggen dat het hele plaatje in context nodig heeft.
- gpt-5.5 is de frontier-generalist om tegen Claude te A/B'en op je eigen repository in plaats van op benchmarktabellen.
Betaal naar gebruik · onder officiële prijzen
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Officiële prijs | Onze prijs |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Faalmodi specifiek voor Kilo Code.
Debug in de standaardvolgorde: curl de modellenlijst, curl één completion met het exacte ID, en pas dan Kilo's instellingen aan. Twee commando's splitsen gatewayproblemen schoon van editorconfiguratie.
- Modelkiezer komt leeg op: de Base URL of sleutel is verkeerd, aangezien de kiezer wordt gevuld vanuit een live /v1/models-aanroep. Curl de lijst met dezelfde waarden om te bevestigen.
- 404 op elk verzoek: Base URL is zijn /v1 kwijt, of je hebt een volledig /chat/completions-pad geplakt waar een base hoort. Kilo accepteert volledige endpoint-URL's, maar alleen als ze naar de juiste chat-completions-route wijzen.
- Afgekapt of vergeetachtig gedrag diep in een taak: gedeclareerde contextlimieten in kilo.jsonc overschrijden wat het model daadwerkelijk ondersteunt. Gebruik gedocumenteerde waarden.
- Tool-aanroepen die worden verteld in plaats van uitgevoerd: het gekozen ID is zwak in function calling. Draai de taak opnieuw op claude-sonnet-4-6 om modelkeuze van configuratie te scheiden voordat je instellingen aanraakt.
- Azure-specifieke opmerking uit de documentatie: Azure GPT-5-deployments wijzen het max_tokens-veld af dat aangepaste OpenAI-compatibele providers sturen, dus Azure moet de native azure-provider van Kilo gebruiken. Irrelevant voor een gateway, maar het verklaart een verwarrende fout als je beide test.
Wie routeert Kilo Code via een gateway.
- Developers die willen dat Claude de agent aandrijft zonder een aparte Anthropic-factureringsrelatie, op een vooruitbetaald saldo met een gratis, kaartloze start.
- Modelwinkelaars die de automatisch opgehaalde kiezer gebruiken om codeer-ID's te proberen op echte taken in hun echte repository.
- Zware gebruikers die een frontiermodel voor planningswerk paren met een volumemodel voor lange uitvoeringssessies.
- Teams die agentuitgaven per developer meten met gebruik per sleutel in plaats van een gedeelde leveranciersrekening terug te ontwerpen.
- Mensen die andere tools al via een gateway routeren en de VS Code-agent op dezelfde sleutel en hetzelfde gebruikslogboek willen.
Verifieer het endpoint en draai de eerste taak.
Bewijs de gatewayhelft met curl voordat je de editor configureert: lijst de modellen op, stuur dan één completion met het ID dat je van plan bent te kiezen. Als beide slagen, zit alles wat overblijft in het providerformulier. Geef Kilo dan een kleine echte taak met een duidelijk doel en kijk naar de eerste beurten. Schone tool-aanroepen en verstandige bewerkingen betekenen dat het ID bij de lus past; harde fouten mappen naar de drie velden. Zodra taken stromen, toont de APIsRouter-console model, tokens en uitgaven per verzoek, wat waar een week agentgebruik een concreet cijfer per model wordt.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Veelgestelde vragen
Hoe voeg ik een OpenAI-compatibele provider toe aan Kilo Code?
Instellingen-tandwiel → tabblad Providers → custom provider. Zet Provider API op OpenAI Compatible, Base URL op https://api.apisrouter.com/v1, en plak je sleutel. Kilo haalt dan automatisch de modellijst op uit /v1/models en je kiest ID's uit een doorzoekbare lijst.
Kan Kilo Code Claude-modellen draaien via deze provider?
Ja. De provider geeft het model-ID door als platte string over standaard chat completions, dus claude-sonnet-4-6 en claude-opus-4-7 werken op dezelfde manier als GPT-ID's, op één sleutel, en van leverancier wisselen is een selectie in de kiezer.
Waarom is de modellijst leeg nadat ik de provider heb toegevoegd?
De automatische ophaling vult zich vanuit een live /v1/models-aanroep, dus een lege lijst betekent dat de Base URL of sleutel verkeerd is. Curl de lijst met dezelfde waarden; als dat werkt, controleer opnieuw wat je daadwerkelijk hebt opgeslagen in het providerformulier. Modellen kunnen ook handmatig worden toegevoegd.
Waar stel ik het contextvenster en tokenlimieten in voor een aangepast model?
In kilo.jsonc, het configbestand van Kilo, dat tokenlimieten per model, tool-aanroepinstellingen en varianten draagt buiten wat het providerformulier blootstelt. Gebruik de gedocumenteerde waarden van het model; overschatte limieten falen op de grootste taken.
Moet de API-sleutel in het formulier?
Het sleutelveld is het normale pad, maar het is optioneel als je authenticatie afhandelt via aangepaste headers, wat het providerformulier ondersteunt als key-value-paren. Voor een standaard gatewayopstelling is het sleutelveld de juiste keuze.
Hoe weet ik wat een week Kilo Code kost?
Lees de gebruiksweergave per sleutel in de APIsRouter-console: tokens en uitgaven per verzoek en per model. Agenttaken zijn elk tientallen verzoeken, dus het logboek is de enige eerlijke maatstaf voor wat je gebruikspatroon kost.