Faites tourner Cline sur n'importe quel modèle du catalogue via OpenAI Compatible.

Updated 2026-07-29

Le menu déroulant API Provider de Cline inclut OpenAI Compatible exactement pour ça : Base URL https://api.apisrouter.com/v1, une seule clé, et l'id du modèle que vous voulez voir piloter l'agent. Les id Claude, Kimi et de classe Codex deviennent des backends de codage interchangeables, avec les modes Plan et Act chacun épinglables.

Réponse rapide : trois champs dans les réglages de Cline.

Ouvrez le panneau Cline dans VS Code et cliquez sur l'icône d'engrenage des réglages. Dans le menu déroulant API Provider, choisissez OpenAI Compatible, puis remplissez trois champs : Base URL https://api.apisrouter.com/v1, votre clé dans API Key, et l'id exact du catalogue dans le champ modèle, par exemple claude-sonnet-4-6. Comme Cline ne peut pas savoir ce que sait faire le modèle d'un endpoint arbitraire, le fournisseur expose des options de configuration de modèle que vous devez renseigner honnêtement : taille de la fenêtre de contexte, nombre max de tokens de sortie, et indicateurs de capacité comme le support des images, plus des prix d'entrée et de sortie optionnels pour que l'affichage de coût propre à Cline corresponde à la réalité. Réglez la fenêtre et les limites d'après la documentation du modèle. Enregistrez, et l'agent exécute sa prochaine tâche via la passerelle ; l'id est modifiable à tout moment sans toucher à votre workflow.

API Provider:  OpenAI Compatible
Base URL:      https://api.apisrouter.com/v1
API Key:       sk-YOUR-APISROUTER-KEY
Model:         claude-sonnet-4-6

Model config:  context window + max output tokens
               from the model's documentation,
               image support only if the id has it

Comment Cline utilise le modèle configuré.

Cline (environ 65 000 étoiles GitHub) est l'agent de codage autonome pour VS Code : il lit votre base de code, édite les fichiers, exécute des commandes terminal, et itère sur les échecs, avec des points de validation humaine en chemin. Cette boucle est gourmande en modèle d'une façon précise : de longs contextes en entrée (arborescences de fichiers, diffs, sortie terminal), des appels d'outils et du code en sortie, de nombreux tours par tâche. Le fournisseur OpenAI Compatible envoie cette boucle sous forme de chat completions standard vers votre Base URL, avec l'id du modèle comme simple chaîne de caractères. Le fournisseur n'a aucune importance pour le format sur le fil, ce qui rend le magasinage de modèles réel ici : claude-sonnet-4-6, kimi-k2.7-code et gpt-5.6-sol sont des backends interchangeables derrière les mêmes trois champs, au lieu de trois configurations de fournisseur séparées avec trois comptes fournisseur. Les indicateurs de capacité méritent de l'attention, car l'agent en dépend. Cline planifie en fonction de ce que vous déclarez : activer le support des images lui permet d'envoyer des captures d'écran à un modèle qui ne les accepte peut-être pas, et une fenêtre de contexte surestimée invite des échecs de contexte tronqué au cœur de longues tâches. Déclarez ce que dit la documentation du modèle, pas ce que vous espérez.

Plan et Act : deux modes, deux modèles.

Cline divise le travail en mode Plan, où il explore la base de code et élabore une stratégie sans éditer, et mode Act, où il exécute. La configuration API suit cette division : avec l'option use-different-models activée, les réglages affichent des onglets par mode et chaque mode se souvient de son propre fournisseur et modèle, en basculant automatiquement quand vous changez de mode. L'économie de cette division est tout l'intérêt. Le mode Plan est là où le raisonnement profond paie : claude-opus-4-7 ou gpt-5.5 lisant la base de code et rédigeant l'approche. Le mode Act est composé de nombreux tours rapides d'appels d'outils exécutant un plan qui existe déjà, ce qui est exactement le profil de kimi-k2.7-code ou claude-sonnet-4-6. Comme les deux modes facturent via la même clé de passerelle, cet appariement est un choix de réglages plutôt qu'un projet multi-fournisseurs. Une mise en garde honnête tirée du suivi des tickets : la sélection de modèle par mode a connu des aspérités spécifiquement avec le fournisseur OpenAI Compatible, y compris des signalements du mode Act réutilisant silencieusement le modèle de Plan. Après avoir configuré la division, lancez une tâche et vérifiez dans l'en-tête de la tâche quel modèle a réellement servi chaque mode, et consultez votre journal d'usage ; ne considérez la division comme vérifiée qu'après avoir vu apparaître les deux id.

Plan mode:  claude-opus-4-7      (read, reason, strategize)
Act mode:   kimi-k2.7-code       (execute, edit, run, iterate)

verify: run one task, check which id served each mode,
then confirm both ids appear in the usage log

Choisir des modèles de codage pour la boucle de l'agent.

Les boucles d'agent multiplient la dépense en tokens d'une façon que le chat ne fait jamais ; une seule tâche Cline peut représenter des dizaines de requêtes portant du contexte de fichiers. Cela rend le choix de modèle mesurable : lancez la même classe de tâche sur deux id pendant une semaine et lisez la dépense par modèle en regard de la fréquence à laquelle vous avez dû intervenir.

  • claude-sonnet-4-6 est la réponse par défaut pour le travail en mode Act : appels d'outils fiables, diffs solides, et assez de jugement pour se remettre de commandes échouées.
  • kimi-k2.7-code est le choix volume pour les longues sessions agentiques ; calibré pour le code, rapide, et tarifé pour la boucle à nombreux tours que Cline exécute réellement.
  • gpt-5.6-sol se justifie pour des éditions rapides et ciblées et des passes de correction de tests, où la latence par tour façonne la sensation de la session.
  • claude-opus-4-7 a sa place en mode Plan sur les tâches difficiles : changements d'architecture, refactorisations multi-fichiers, débogage qui a besoin de la vue d'ensemble.
  • gpt-5.5 est le généraliste solide à tester en A/B contre Claude en mode Plan, sur votre propre base de code, pas sur des benchmarks.

Paiement à l'usage · en dessous du tarif officiel

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModèlePrix officielNotre prix
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Modes d'échec spécifiques à Cline.

Un comportement tronqué ou amnésique au cœur d'une tâche renvoie à la déclaration de fenêtre de contexte : réglez-la sur la fenêtre documentée du modèle, et rappelez-vous que Cline empaquette le contexte de fichiers de façon agressive, donc une fenêtre surestimée échoue précisément sur les tâches les plus grosses et les plus agaçantes. Des bizarreries dans les appels d'outils, des éditions malformées, ou l'agent qui narre au lieu d'agir signifient généralement que l'id choisi est faible en function calling ; basculez vers claude-sonnet-4-6 pour séparer les problèmes de configuration du choix de modèle avant d'accuser la configuration. Les erreurs franches se déchiffrent proprement : l'authentification renvoie au champ clé ; modèle introuvable renvoie à l'orthographe de l'id face au listing /v1/models ; des 404 sur chaque requête viennent d'une Base URL à qui il manque /v1 ou qui le double. Le fournisseur ajoute les chemins de route à la base que vous lui donnez. Et la mise en garde par mode répétée une fois, car elle coûte de l'argent réel quand on la rate : si vous avez configuré des modèles Plan et Act différents, vérifiez que les deux id servent réellement leur mode sur une tâche réelle. Un repli silencieux vers le modèle Plan coûteux à chaque tour Act est le genre de chose que le journal d'usage détecte dès le premier jour, et qu'un relevé de carte détecte en fin de mois.

Qui route Cline via une passerelle.

  • Les développeurs qui veulent que Claude pilote leur agent sans relation de facturation avec Anthropic, sur un solde prépayé sans carte pour démarrer.
  • Les acheteurs de modèles qui comparent des modèles de codage sur de vraies tâches dans leur vraie base de code, où chaque candidat n'est qu'une modification du champ modèle.
  • Les gros utilisateurs de Cline qui associent un modèle Plan coûteux à un modèle Act rapide pour garder les longues sessions abordables sans perdre en qualité de planification.
  • Les équipes qui mesurent la dépense d'agent par développeur ou par projet avec l'usage par clé, plutôt que de deviner à partir d'une facture fournisseur partagée.
  • Les développeurs qui routent déjà leurs outils de terminal et d'éditeur via une passerelle et qui veulent l'agent VS Code sur la même clé et le même journal.

Vérifiez l'endpoint et déboguez la première tâche.

Interrogez d'abord en curl le listing des modèles et une completion de chat, avec l'id exact que vous prévoyez de configurer. Si les deux réussissent, la moitié passerelle est réglée et tout symptôme restant se trouve dans les réglages du fournisseur. Confiez ensuite à Cline une petite tâche réelle, un seul fichier, un objectif clair, et observez les premiers tours. Des appels d'outils propres et des éditions sensées signifient que l'id et les indicateurs de capacité conviennent. Les erreurs renvoient aux trois champs ; un comportement d'agent étrange renvoie au choix de modèle ou aux capacités déclarées. Si vous avez activé les modèles par mode, cette première tâche est aussi votre passe de vérification de la division. Une fois que les tâches circulent, la console APIsRouter affiche le modèle par requête, le nombre de tokens et la dépense. Une boucle d'agent est la façon la plus gourmande en tokens d'utiliser un modèle, et la vue d'usage par clé est là où une semaine de Cline devient un chiffre concret, par modèle, par jour, par mode si vous séparez les clés.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Questions fréquentes

Comment utiliser un endpoint compatible OpenAI avec Cline ?

Ouvrez les réglages de Cline dans VS Code, choisissez OpenAI Compatible dans le menu déroulant API Provider, et définissez Base URL https://api.apisrouter.com/v1, votre clé API, et l'id du modèle. Renseignez la fenêtre de contexte et le nombre max de tokens de sortie d'après la documentation du modèle.

Cline peut-il faire tourner des modèles Claude via ce fournisseur ?

Oui. Le fournisseur transmet l'id du modèle comme une simple chaîne via des chat completions standard, donc claude-sonnet-4-6 et claude-opus-4-7 fonctionnent exactement comme des id GPT, une seule clé pour tous, et changer de fournisseur se résume à modifier le champ modèle.

Les modes Plan et Act peuvent-ils utiliser des modèles différents ?

Oui. Activez l'option use-different-models dans la configuration API de Cline et chaque mode obtient son propre onglet avec son propre fournisseur et modèle. Vérifiez toutefois la division sur une tâche réelle : la sélection par mode a connu des aspérités signalées avec le fournisseur OpenAI Compatible, y compris le mode Act réutilisant le modèle de Plan.

Que dois-je définir pour la fenêtre de contexte et le nombre max de tokens de sortie ?

Les valeurs documentées du modèle, pas des valeurs par défaut ni des espoirs. Cline empaquette un long contexte de fichiers dans les requêtes, donc une fenêtre surestimée échoue sur les plus grosses tâches et une fenêtre sous-estimée coupe du code hors contexte. Le nombre max de tokens de sortie plafonne chaque réponse, calibré selon ce que permet l'id.

Pourquoi Cline se comporte-t-il mal sur les appels d'outils avec certains modèles ?

Les boucles d'agent dépendent d'un function calling fiable, et les id varient largement sur ce point. Si les éditions ressortent malformées ou que l'agent narre au lieu d'agir, testez la même tâche sur claude-sonnet-4-6 ; si cela corrige le comportement, c'est un choix de modèle, pas une question de configuration.

Comment savoir ce que coûte réellement une semaine de Cline ?

La vue d'usage par clé dans la console APIsRouter affiche les tokens et la dépense par requête et par modèle. Les tâches d'agent représentent chacune des dizaines de requêtes, donc le journal est la seule mesure honnête ; l'affichage de coût intégré à Cline aide aussi si vous renseignez les champs de prix optionnels.