Kilo Code auf jedem Katalog-Modell via OpenAI Compatible betreiben.

Updated 2026-07-30

Kilo Code liefert einen für Gateways gebauten custom-Provider-Flow: wähl OpenAI Compatible als Provider API, setz Base URL auf https://api.apisrouter.com/v1, füg einen Key ein, und Kilo lädt die Modellliste automatisch aus /v1/models. Claude-, Kimi- und Codex-Klasse-IDs werden austauschbare Backends für den Agenten.

Kurzantwort: ein custom Provider-Eintrag.

Öffne Kilo Codes Settings über das Zahnrad-Icon, geh zum Providers-Tab und wähl die custom-Provider-Option. Gib ihr eine Provider ID und einen Anzeigenamen, setz Provider API auf OpenAI Compatible, Base URL auf https://api.apisrouter.com/v1, und füg deinen Key ein. Sobald Base URL und Key gültig sind, fragt Kilo die /v1/models-Liste des Endpoints ab und zeigt einen durchsuchbaren Picker jeder verfügbaren ID, du wählst also claude-sonnet-4-6 oder kimi-k2.7-code aus einer Liste, statt sie blind einzutippen. Modelle können auch manuell hinzugefügt werden, und custom HTTP-Header werden als Key-Value-Paare unterstützt, falls du sie brauchst. Speichern, und die nächste Aufgabe des Agenten routet über das Gateway.

Provider ID:    apisrouter
Display name:   APIsRouter
Provider API:   OpenAI Compatible
Base URL:       https://api.apisrouter.com/v1
API key:        sk-YOUR-APISROUTER-KEY
Models:         pick from the auto-fetched list
                (e.g. claude-sonnet-4-6, kimi-k2.7-code)

Wie Kilo Code den Provider nutzt.

Kilo Code (rund 26.000 GitHub-Stars) ist ein Open-Source-KI-Coding-Agent für VS Code: er plant, editiert Dateien, führt Befehle aus und iteriert über Fehlschläge mit Freigabe-Gates, in der Abstammung von Roo und Cline. Dieser Loop hat eine spezifische Traffic-Form: langer Kontext rein, Tool-Calls und Diffs raus, viele Züge pro Aufgabe, was das zugrundeliegende Modell sowohl zum Qualitätshebel als auch zum Kostentreiber macht. Der OpenAI-Compatible-Provider sendet diesen Loop als Standard-Chat-Completions an deine Base URL, mit der Modell-ID als reinem String. Das Wire-Format kümmert sich nicht um Vendoren, was echtes Modell-Shopping möglich macht: claude-sonnet-4-6, kimi-k2.7-code und gpt-5.6-sol sind austauschbare Einträge hinter einem Provider, statt drei Vendor-Konten mit drei Billing-Setups. Für Per-Modell-Tuning leben Token-Limits, Tool-Calling-Verhalten und Varianten in der kilo.jsonc-Config-Datei, die du direkt editieren kannst, wenn ein Modell Einstellungen braucht, die die UI nicht exponiert. Setz deklarierte Limits aus der Dokumentation des Modells, nicht aus Optimismus: der Agent packt Kontext aggressiv, und ein überhöhtes Fenster scheitert genau bei den größten Aufgaben.

Coding-Modelle für Kilos Loop wählen.

Kilos Modi lassen unterschiedliche Arten von Arbeit unterschiedliche Konfiguration tragen, und der ehrliche Weg, das zu nutzen, ist empirisch: lauf dieselbe Aufgabenklasse eine Woche lang auf zwei IDs, lies dann die Ausgaben pro Modell in der Gateway-Konsole neben, wie oft du eingreifen musstest. Agenten-Loops sind die tokenintensivste Art, ein Modell zu nutzen, der Unterschied ist also messbar, kein Bauchgefühl.

  • claude-sonnet-4-6 ist der verlässliche Default: starkes Tool-Calling, saubere Diffs und gute Erholung, wenn ein Befehl mitten in der Aufgabe scheitert.
  • kimi-k2.7-code ist die Volumen-Wahl für lange agentische Sessions, code-getunt und bepreist für den vielzügigen Loop, den Kilo tatsächlich läuft.
  • gpt-5.6-sol passt zu schnellen, eng umrissenen Edits und Test-Fixing-Runs, wo Latenz pro Zug die Session prägt.
  • claude-opus-4-7 verdient sich seinen Preis bei harten Aufgaben: Cross-File-Refactors, Architektur-Arbeit, Debugging, das das ganze Bild im Kontext braucht.
  • gpt-5.5 ist der Frontier-Generalist, den man an seinem eigenen Repository gegen Claude A/B-testet, nicht an Benchmark-Tabellen.

Nutzungsbasiert · unter offiziellem Preis

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModellOffizieller PreisUnser Preis
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Fehlerbilder speziell für Kilo Code.

Debugge in der Standard-Reihenfolge: curl die Modellliste, curl eine Completion mit der exakten ID, und erst dann Kilos Einstellungen anpassen. Zwei Befehle trennen Gateway-Probleme sauber von Editor-Konfiguration.

  • Modell-Picker bleibt leer: Base URL oder Key sind falsch, da der Picker aus einem Live-/v1/models-Call gefüllt wird. Curl die Liste mit denselben Werten, um es zu bestätigen.
  • 404 bei jedem Request: Base URL hat ihr /v1 verloren, oder du hast einen vollen /chat/completions-Pfad eingefügt, wo eine Base hingehört. Kilo akzeptiert volle Endpoint-URLs, aber nur, wenn sie auf die korrekte Chat-Completions-Route zeigen.
  • Abgeschnittenes oder amnesisches Verhalten tief in einer Aufgabe: deklarierte Kontext-Limits in kilo.jsonc überschreiten, was das Modell tatsächlich unterstützt. Nutz dokumentierte Werte.
  • Tool-Calls werden narrativ beschrieben statt ausgeführt: die gewählte ID ist schwach beim Function Calling. Lauf die Aufgabe erneut auf claude-sonnet-4-6, um Modellwahl von Konfiguration zu trennen, bevor du Einstellungen anfasst.
  • Azure-spezifischer Hinweis aus den Docs: Azure-GPT-5-Deployments lehnen das max_tokens-Feld ab, das custom OpenAI-kompatible Provider senden, Azure sollte also Kilos nativen azure-Provider nutzen. Für ein Gateway irrelevant, erklärt aber einen verwirrenden Fehler, falls du beides testest.

Wer Kilo Code über ein Gateway routet.

  • Entwickler, die Claude den Agenten antreiben lassen wollen, ohne eine separate Anthropic-Billing-Beziehung, auf einem vorausbezahlten Guthaben mit kostenlosem, kartenlosem Start.
  • Modell-Shopper, die den automatisch geladenen Picker nutzen, um Coding-IDs an echten Aufgaben in ihrem echten Repository zu testen.
  • Heavy User, die ein Frontier-Modell für Planungsarbeit mit einem Volumen-Modell für lange Ausführungssessions paaren.
  • Teams, die Agenten-Ausgaben pro Entwickler mit Nutzung pro Key messen, statt eine geteilte Vendor-Rechnung zurückzuentwickeln.
  • Leute, die bereits andere Tools über ein Gateway routen und den VS-Code-Agenten auf demselben Key und Nutzungslog wollen.

Endpoint verifizieren und die erste Aufgabe laufen lassen.

Beweis die Gateway-Hälfte mit curl, bevor du den Editor konfigurierst: liste die Modelle, dann sende eine Completion mit der ID, die du wählen willst. Bestehen beide, liegt alles Übrige im Provider-Formular. Gib Kilo dann eine kleine echte Aufgabe mit klarem Ziel und beobachte die ersten Züge. Saubere Tool-Calls und sinnvolle Edits bedeuten, die ID passt zum Loop; harte Fehler bilden sich auf die drei Felder ab. Sobald Aufgaben fließen, zeigt die APIsRouter-Konsole Modell, Token und Ausgaben pro Anfrage, wo eine Woche Agenten-Nutzung zu einer konkreten Zahl pro Modell wird.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Häufige Fragen

Wie füge ich Kilo Code einen OpenAI-kompatiblen Provider hinzu?

Settings-Zahnrad → Providers-Tab → custom provider. Setz Provider API auf OpenAI Compatible, Base URL auf https://api.apisrouter.com/v1, und füg deinen Key ein. Kilo lädt dann die Modellliste automatisch aus /v1/models, und du wählst IDs aus einer durchsuchbaren Liste.

Kann Kilo Code Claude-Modelle über diesen Provider laufen lassen?

Ja. Der Provider reicht die Modell-ID als reinen String über Standard-Chat-Completions weiter, claude-sonnet-4-6 und claude-opus-4-7 funktionieren also genauso wie GPT-IDs, auf einem Key, und der Vendor-Wechsel ist eine Picker-Auswahl.

Warum ist die Modellliste leer, nachdem ich den Provider hinzugefügt habe?

Der Auto-Fetch füllt sich aus einem Live-/v1/models-Call, eine leere Liste bedeutet also, Base URL oder Key sind falsch. Curl die Liste mit denselben Werten; funktioniert das, prüf erneut, was du tatsächlich im Provider-Formular gespeichert hast. Modelle können auch manuell hinzugefügt werden.

Wo setze ich Kontextfenster- und Token-Limits für ein custom Modell?

In kilo.jsonc, Kilos Config-Datei, die Per-Modell-Token-Limits, Tool-Calling-Einstellungen und Varianten jenseits dessen trägt, was das Provider-Formular exponiert. Nutz die dokumentierten Werte des Modells; überhöhte Limits scheitern bei den größten Aufgaben.

Muss der API Key ins Formular?

Das Key-Feld ist der normale Pfad, aber optional, wenn du Authentifizierung über custom Header abwickelst, was das Provider-Formular als Key-Value-Paare unterstützt. Für ein Standard-Gateway-Setup ist das Key-Feld die richtige Wahl.

Wie erfahre ich, was eine Woche Kilo Code kostet?

Lies die Nutzungsansicht pro Key in der APIsRouter-Konsole: Token und Ausgaben pro Anfrage und pro Modell. Agenten-Aufgaben sind je Dutzende Anfragen, das Log ist also das einzige ehrliche Maß dafür, was dein Nutzungsmuster kostet.