Kilo Code auf jedem Katalog-Modell via OpenAI Compatible betreiben.
Updated 2026-07-30
Kilo Code liefert einen für Gateways gebauten custom-Provider-Flow: wähl OpenAI Compatible als Provider API, setz Base URL auf https://api.apisrouter.com/v1, füg einen Key ein, und Kilo lädt die Modellliste automatisch aus /v1/models. Claude-, Kimi- und Codex-Klasse-IDs werden austauschbare Backends für den Agenten.
Kurzantwort: ein custom Provider-Eintrag.
Öffne Kilo Codes Settings über das Zahnrad-Icon, geh zum Providers-Tab und wähl die custom-Provider-Option. Gib ihr eine Provider ID und einen Anzeigenamen, setz Provider API auf OpenAI Compatible, Base URL auf https://api.apisrouter.com/v1, und füg deinen Key ein. Sobald Base URL und Key gültig sind, fragt Kilo die /v1/models-Liste des Endpoints ab und zeigt einen durchsuchbaren Picker jeder verfügbaren ID, du wählst also claude-sonnet-4-6 oder kimi-k2.7-code aus einer Liste, statt sie blind einzutippen. Modelle können auch manuell hinzugefügt werden, und custom HTTP-Header werden als Key-Value-Paare unterstützt, falls du sie brauchst. Speichern, und die nächste Aufgabe des Agenten routet über das Gateway.
Provider ID: apisrouter
Display name: APIsRouter
Provider API: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API key: sk-YOUR-APISROUTER-KEY
Models: pick from the auto-fetched list
(e.g. claude-sonnet-4-6, kimi-k2.7-code)Wie Kilo Code den Provider nutzt.
Kilo Code (rund 26.000 GitHub-Stars) ist ein Open-Source-KI-Coding-Agent für VS Code: er plant, editiert Dateien, führt Befehle aus und iteriert über Fehlschläge mit Freigabe-Gates, in der Abstammung von Roo und Cline. Dieser Loop hat eine spezifische Traffic-Form: langer Kontext rein, Tool-Calls und Diffs raus, viele Züge pro Aufgabe, was das zugrundeliegende Modell sowohl zum Qualitätshebel als auch zum Kostentreiber macht. Der OpenAI-Compatible-Provider sendet diesen Loop als Standard-Chat-Completions an deine Base URL, mit der Modell-ID als reinem String. Das Wire-Format kümmert sich nicht um Vendoren, was echtes Modell-Shopping möglich macht: claude-sonnet-4-6, kimi-k2.7-code und gpt-5.6-sol sind austauschbare Einträge hinter einem Provider, statt drei Vendor-Konten mit drei Billing-Setups. Für Per-Modell-Tuning leben Token-Limits, Tool-Calling-Verhalten und Varianten in der kilo.jsonc-Config-Datei, die du direkt editieren kannst, wenn ein Modell Einstellungen braucht, die die UI nicht exponiert. Setz deklarierte Limits aus der Dokumentation des Modells, nicht aus Optimismus: der Agent packt Kontext aggressiv, und ein überhöhtes Fenster scheitert genau bei den größten Aufgaben.
Coding-Modelle für Kilos Loop wählen.
Kilos Modi lassen unterschiedliche Arten von Arbeit unterschiedliche Konfiguration tragen, und der ehrliche Weg, das zu nutzen, ist empirisch: lauf dieselbe Aufgabenklasse eine Woche lang auf zwei IDs, lies dann die Ausgaben pro Modell in der Gateway-Konsole neben, wie oft du eingreifen musstest. Agenten-Loops sind die tokenintensivste Art, ein Modell zu nutzen, der Unterschied ist also messbar, kein Bauchgefühl.
- claude-sonnet-4-6 ist der verlässliche Default: starkes Tool-Calling, saubere Diffs und gute Erholung, wenn ein Befehl mitten in der Aufgabe scheitert.
- kimi-k2.7-code ist die Volumen-Wahl für lange agentische Sessions, code-getunt und bepreist für den vielzügigen Loop, den Kilo tatsächlich läuft.
- gpt-5.6-sol passt zu schnellen, eng umrissenen Edits und Test-Fixing-Runs, wo Latenz pro Zug die Session prägt.
- claude-opus-4-7 verdient sich seinen Preis bei harten Aufgaben: Cross-File-Refactors, Architektur-Arbeit, Debugging, das das ganze Bild im Kontext braucht.
- gpt-5.5 ist der Frontier-Generalist, den man an seinem eigenen Repository gegen Claude A/B-testet, nicht an Benchmark-Tabellen.
Nutzungsbasiert · unter offiziellem Preis
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modell | Offizieller Preis | Unser Preis |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Fehlerbilder speziell für Kilo Code.
Debugge in der Standard-Reihenfolge: curl die Modellliste, curl eine Completion mit der exakten ID, und erst dann Kilos Einstellungen anpassen. Zwei Befehle trennen Gateway-Probleme sauber von Editor-Konfiguration.
- Modell-Picker bleibt leer: Base URL oder Key sind falsch, da der Picker aus einem Live-/v1/models-Call gefüllt wird. Curl die Liste mit denselben Werten, um es zu bestätigen.
- 404 bei jedem Request: Base URL hat ihr /v1 verloren, oder du hast einen vollen /chat/completions-Pfad eingefügt, wo eine Base hingehört. Kilo akzeptiert volle Endpoint-URLs, aber nur, wenn sie auf die korrekte Chat-Completions-Route zeigen.
- Abgeschnittenes oder amnesisches Verhalten tief in einer Aufgabe: deklarierte Kontext-Limits in kilo.jsonc überschreiten, was das Modell tatsächlich unterstützt. Nutz dokumentierte Werte.
- Tool-Calls werden narrativ beschrieben statt ausgeführt: die gewählte ID ist schwach beim Function Calling. Lauf die Aufgabe erneut auf claude-sonnet-4-6, um Modellwahl von Konfiguration zu trennen, bevor du Einstellungen anfasst.
- Azure-spezifischer Hinweis aus den Docs: Azure-GPT-5-Deployments lehnen das max_tokens-Feld ab, das custom OpenAI-kompatible Provider senden, Azure sollte also Kilos nativen azure-Provider nutzen. Für ein Gateway irrelevant, erklärt aber einen verwirrenden Fehler, falls du beides testest.
Wer Kilo Code über ein Gateway routet.
- Entwickler, die Claude den Agenten antreiben lassen wollen, ohne eine separate Anthropic-Billing-Beziehung, auf einem vorausbezahlten Guthaben mit kostenlosem, kartenlosem Start.
- Modell-Shopper, die den automatisch geladenen Picker nutzen, um Coding-IDs an echten Aufgaben in ihrem echten Repository zu testen.
- Heavy User, die ein Frontier-Modell für Planungsarbeit mit einem Volumen-Modell für lange Ausführungssessions paaren.
- Teams, die Agenten-Ausgaben pro Entwickler mit Nutzung pro Key messen, statt eine geteilte Vendor-Rechnung zurückzuentwickeln.
- Leute, die bereits andere Tools über ein Gateway routen und den VS-Code-Agenten auf demselben Key und Nutzungslog wollen.
Endpoint verifizieren und die erste Aufgabe laufen lassen.
Beweis die Gateway-Hälfte mit curl, bevor du den Editor konfigurierst: liste die Modelle, dann sende eine Completion mit der ID, die du wählen willst. Bestehen beide, liegt alles Übrige im Provider-Formular. Gib Kilo dann eine kleine echte Aufgabe mit klarem Ziel und beobachte die ersten Züge. Saubere Tool-Calls und sinnvolle Edits bedeuten, die ID passt zum Loop; harte Fehler bilden sich auf die drei Felder ab. Sobald Aufgaben fließen, zeigt die APIsRouter-Konsole Modell, Token und Ausgaben pro Anfrage, wo eine Woche Agenten-Nutzung zu einer konkreten Zahl pro Modell wird.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Häufige Fragen
Wie füge ich Kilo Code einen OpenAI-kompatiblen Provider hinzu?
Settings-Zahnrad → Providers-Tab → custom provider. Setz Provider API auf OpenAI Compatible, Base URL auf https://api.apisrouter.com/v1, und füg deinen Key ein. Kilo lädt dann die Modellliste automatisch aus /v1/models, und du wählst IDs aus einer durchsuchbaren Liste.
Kann Kilo Code Claude-Modelle über diesen Provider laufen lassen?
Ja. Der Provider reicht die Modell-ID als reinen String über Standard-Chat-Completions weiter, claude-sonnet-4-6 und claude-opus-4-7 funktionieren also genauso wie GPT-IDs, auf einem Key, und der Vendor-Wechsel ist eine Picker-Auswahl.
Warum ist die Modellliste leer, nachdem ich den Provider hinzugefügt habe?
Der Auto-Fetch füllt sich aus einem Live-/v1/models-Call, eine leere Liste bedeutet also, Base URL oder Key sind falsch. Curl die Liste mit denselben Werten; funktioniert das, prüf erneut, was du tatsächlich im Provider-Formular gespeichert hast. Modelle können auch manuell hinzugefügt werden.
Wo setze ich Kontextfenster- und Token-Limits für ein custom Modell?
In kilo.jsonc, Kilos Config-Datei, die Per-Modell-Token-Limits, Tool-Calling-Einstellungen und Varianten jenseits dessen trägt, was das Provider-Formular exponiert. Nutz die dokumentierten Werte des Modells; überhöhte Limits scheitern bei den größten Aufgaben.
Muss der API Key ins Formular?
Das Key-Feld ist der normale Pfad, aber optional, wenn du Authentifizierung über custom Header abwickelst, was das Provider-Formular als Key-Value-Paare unterstützt. Für ein Standard-Gateway-Setup ist das Key-Feld die richtige Wahl.
Wie erfahre ich, was eine Woche Kilo Code kostet?
Lies die Nutzungsansicht pro Key in der APIsRouter-Konsole: Token und Ausgaben pro Anfrage und pro Modell. Agenten-Aufgaben sind je Dutzende Anfragen, das Log ist also das einzige ehrliche Maß dafür, was dein Nutzungsmuster kostet.