Faites tourner Kilo Code sur n'importe quel modèle du catalogue via OpenAI Compatible.

Updated 2026-07-30

Kilo Code embarque un flux de fournisseur personnalisé conçu pour les passerelles : choisissez OpenAI Compatible comme Provider API, réglez Base URL sur https://api.apisrouter.com/v1, collez une seule clé, et Kilo récupère automatiquement la liste de modèles depuis /v1/models. Les ids Claude, Kimi et de classe Codex deviennent des backends interchangeables pour l'agent.

Réponse rapide : une seule entrée de fournisseur personnalisé.

Ouvrez les réglages de Kilo Code via l'icône d'engrenage, allez dans l'onglet Providers, et choisissez l'option de fournisseur personnalisé. Donnez-lui un Provider ID et un nom d'affichage, réglez Provider API sur OpenAI Compatible, Base URL sur https://api.apisrouter.com/v1, et collez votre clé. Une fois la Base URL et la clé valides, Kilo interroge le listing /v1/models de l'endpoint et présente un sélecteur consultable de chaque id disponible, donc vous choisissez claude-sonnet-4-6 ou kimi-k2.7-code dans une liste plutôt que de le taper à l'aveugle. Les modèles peuvent aussi être ajoutés manuellement, et des en-têtes HTTP personnalisés sont pris en charge en paires clé-valeur si vous en avez besoin. Enregistrez, et la prochaine tâche de l'agent route via la passerelle.

Provider ID:    apisrouter
Display name:   APIsRouter
Provider API:   OpenAI Compatible
Base URL:       https://api.apisrouter.com/v1
API key:        sk-YOUR-APISROUTER-KEY
Models:         pick from the auto-fetched list
                (e.g. claude-sonnet-4-6, kimi-k2.7-code)

Comment Kilo Code utilise le fournisseur.

Kilo Code (environ 26 000 étoiles sur GitHub) est un agent de codage IA open source pour VS Code : il planifie, édite des fichiers, lance des commandes, et itère sur les échecs avec des portes d'approbation, dans la lignée de Roo et Cline. Cette boucle a une forme de trafic spécifique : long contexte en entrée, appels d'outils et diffs en sortie, de nombreux tours par tâche, ce qui fait du modèle sous-jacent à la fois le levier de qualité et le moteur de coût. Le fournisseur OpenAI Compatible envoie cette boucle comme des chat completions standard vers votre Base URL, avec l'id de modèle comme une simple chaîne. Le format sur le fil ne se soucie pas des fournisseurs, ce qui rend possible un vrai magasinage de modèles : claude-sonnet-4-6, kimi-k2.7-code et gpt-5.6-sol sont des entrées interchangeables derrière un seul fournisseur, plutôt que trois comptes fournisseur avec trois configurations de facturation. Pour l'ajustement par modèle, les limites de tokens, le comportement d'appel d'outils, et les variantes vivent dans le fichier de config kilo.jsonc, que vous pouvez éditer directement quand un modèle a besoin de réglages que l'UI n'expose pas. Réglez les limites déclarées d'après la documentation du modèle, pas par optimisme : l'agent empile le contexte de façon agressive, et une fenêtre surestimée échoue exactement sur les plus grosses tâches.

Choisir des modèles de codage pour la boucle de Kilo.

Les modes de Kilo laissent différents types de travail porter différentes configurations, et la façon honnête d'exploiter cela est empirique : faites tourner la même classe de tâche sur deux ids pendant une semaine, puis lisez la dépense par modèle dans la console de la passerelle à côté de la fréquence à laquelle vous avez dû intervenir. Les boucles d'agent sont la façon la plus intensive en tokens d'utiliser un modèle, donc la différence est mesurable, pas du ressenti.

  • claude-sonnet-4-6 est le défaut fiable : un appel d'outils solide, des diffs propres, et une bonne récupération quand une commande échoue en milieu de tâche.
  • kimi-k2.7-code est le choix de volume pour les longues sessions agentiques, ajusté pour le code et tarifé pour la boucle à nombreux tours que Kilo fait réellement tourner.
  • gpt-5.6-sol convient aux modifications ciblées rapides et aux exécutions de correction de tests où la latence par tour façonne la session.
  • claude-opus-4-7 justifie son tarif sur les tâches difficiles : refactorisations multi-fichiers, travail d'architecture, débogage qui a besoin de toute la vue d'ensemble en contexte.
  • gpt-5.5 est le généraliste de pointe à comparer en A/B contre Claude sur votre propre dépôt plutôt que sur des tableaux de benchmark.

Paiement à l'usage · en dessous du tarif officiel

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModèlePrix officielNotre prix
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Modes d'échec spécifiques à Kilo Code.

Déboguez dans l'ordre standard : faites un curl sur le listing de modèles, un curl sur une completion avec l'id exact, et seulement ensuite ajustez les réglages de Kilo. Deux commandes séparent proprement les problèmes de passerelle de la configuration de l'éditeur.

  • Le sélecteur de modèles arrive vide : la Base URL ou la clé est incorrecte, puisque le sélecteur est peuplé depuis un appel /v1/models en direct. Faites un curl sur le listing avec les mêmes valeurs pour confirmer.
  • 404 sur chaque requête : la Base URL a perdu son /v1, ou vous avez collé un chemin complet /chat/completions là où une base est attendue. Kilo accepte des URL d'endpoint complètes, mais seulement si elles pointent vers la bonne route chat-completions.
  • Comportement tronqué ou amnésique au cœur d'une tâche : les limites de contexte déclarées dans kilo.jsonc dépassent ce que le modèle supporte réellement. Utilisez des valeurs documentées.
  • Des appels d'outils racontés au lieu d'exécutés : l'id choisi est faible en function calling. Relancez la tâche sur claude-sonnet-4-6 pour séparer le choix du modèle de la configuration avant de toucher aux réglages.
  • Note spécifique à Azure tirée de la doc : les déploiements Azure GPT-5 rejettent le champ max_tokens qu'envoient les fournisseurs compatibles OpenAI personnalisés, donc Azure devrait utiliser le fournisseur azure natif de Kilo. Sans rapport pour une passerelle, mais cela explique une erreur déroutante si vous testez les deux.

Qui route Kilo Code via une passerelle.

  • Les développeurs qui veulent que Claude pilote l'agent sans relation de facturation Anthropic séparée, sur un solde prépayé avec un démarrage gratuit et sans carte.
  • Les acheteurs de modèles qui utilisent le sélecteur auto-récupéré pour tester des ids de codage sur de vraies tâches dans leur véritable dépôt.
  • Les gros utilisateurs qui associent un modèle de pointe pour le travail de niveau planification à un modèle de volume pour les longues sessions d'exécution.
  • Les équipes qui mesurent la dépense d'agent par développeur avec l'usage par clé au lieu de rétro-ingénierer une facture fournisseur partagée.
  • Les personnes qui routent déjà d'autres outils via une passerelle et veulent l'agent VS Code sur la même clé et le même journal d'usage.

Vérifiez l'endpoint et lancez la première tâche.

Prouvez la moitié passerelle avec curl avant de configurer l'éditeur : listez les modèles, puis envoyez une completion avec l'id que vous comptez choisir. Quand les deux passent, tout ce qui reste est dans le formulaire de fournisseur. Donnez ensuite à Kilo une petite tâche réelle avec un objectif clair et observez les premiers tours. Des appels d'outils propres et des modifications sensées signifient que l'id convient à la boucle ; les erreurs franches se rapportent aux trois champs. Une fois que les tâches circulent, la console APIsRouter affiche le modèle par requête, les tokens et la dépense, ce qui est là qu'une semaine d'usage de l'agent devient un chiffre concret par modèle.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Questions fréquentes

Comment ajouter un fournisseur compatible OpenAI à Kilo Code ?

Icône Settings → onglet Providers → fournisseur personnalisé. Réglez Provider API sur OpenAI Compatible, Base URL sur https://api.apisrouter.com/v1, et collez votre clé. Kilo récupère alors automatiquement la liste de modèles depuis /v1/models et vous choisissez des ids dans une liste consultable.

Kilo Code peut-il faire tourner des modèles Claude via ce fournisseur ?

Oui. Le fournisseur transmet l'id de modèle comme une simple chaîne sur des chat completions standard, donc claude-sonnet-4-6 et claude-opus-4-7 fonctionnent de la même façon que les ids GPT, sur une seule clé, et changer de fournisseur est une sélection dans le sélecteur.

Pourquoi la liste de modèles est-elle vide après avoir ajouté le fournisseur ?

La récupération automatique se peuple depuis un appel /v1/models en direct, donc une liste vide signifie que la Base URL ou la clé est incorrecte. Faites un curl sur le listing avec les mêmes valeurs ; si cela fonctionne, revérifiez ce que vous avez réellement enregistré dans le formulaire de fournisseur. Les modèles peuvent aussi être ajoutés manuellement.

Où régler la fenêtre de contexte et les limites de tokens pour un modèle personnalisé ?

Dans kilo.jsonc, le fichier de config de Kilo, qui porte les limites de tokens par modèle, les réglages d'appel d'outils, et les variantes au-delà de ce qu'expose le formulaire de fournisseur. Utilisez les valeurs documentées du modèle ; des limites surestimées échouent sur les plus grosses tâches.

La clé API doit-elle être mise dans le formulaire ?

Le champ de clé est le chemin normal, mais il est optionnel si vous gérez l'authentification via des en-têtes personnalisés, que le formulaire de fournisseur prend en charge en paires clé-valeur. Pour une configuration de passerelle standard, le champ de clé est le bon choix.

Comment savoir ce que coûte une semaine de Kilo Code ?

Lisez la vue d'usage par clé dans la console APIsRouter : tokens et dépense par requête et par modèle. Les tâches d'agent représentent des dizaines de requêtes chacune, donc le journal est la seule mesure honnête de ce que coûte votre profil d'usage.