Запустите Cline на любой модели каталога через OpenAI Compatible.
Updated 2026-07-29
Выпадающий список API Provider в Cline включает OpenAI Compatible именно для этого: Base URL https://api.apisrouter.com/v1, один ключ и ID модели, на которой должен работать агент. ID Claude, Kimi и уровня Codex становятся взаимозаменяемыми бэкендами для кода, при этом режимы Plan и Act каждый закрепляется отдельно.
Короткий ответ: три поля в настройках Cline.
Откройте панель Cline в VS Code и нажмите шестерёнку настроек. В выпадающем списке API Provider выберите OpenAI Compatible, затем заполните три поля: Base URL https://api.apisrouter.com/v1, свой ключ в API Key и точный ID каталога в поле модели, например claude-sonnet-4-6. Поскольку Cline не может знать, на что способна модель произвольного эндпоинта, провайдер выставляет опции конфигурации модели, которые стоит задавать честно: размер контекстного окна, максимум выходных токенов и флаги возможностей вроде поддержки изображений, плюс опциональные цены на вход и выход, чтобы собственное отображение стоимости в Cline соответствовало реальности. Задайте окно и лимиты по документации модели. Сохраните — и агент проведёт следующую задачу через шлюз; ID можно менять в любой момент, не трогая рабочий процесс.
API Provider: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Model: claude-sonnet-4-6
Model config: context window + max output tokens
from the model's documentation,
image support only if the id has itКак Cline использует настроенную модель.
Cline (около 65K звёзд на GitHub) — автономный агент для написания кода в VS Code: он читает вашу кодовую базу, редактирует файлы, запускает терминальные команды и итерирует по сбоям, с воротами подтверждения от человека на пути. Этот цикл прожорлив к моделям особым образом: длинные контексты (дерева файлов, диффы, вывод терминала) на входе, вызовы инструментов и код на выходе, много ходов на задачу. Провайдер OpenAI Compatible отправляет этот цикл как стандартные chat completions на ваш Base URL с ID модели как простой строкой. Вендор не важен для формата на проводе, и именно это делает выбор моделей здесь реальным: claude-sonnet-4-6, kimi-k2.7-code и gpt-5.6-sol — взаимозаменяемые бэкенды за одними и теми же тремя полями, вместо трёх отдельных конфигураций провайдера с тремя вендорскими аккаунтами. Флаги возможностей заслуживают внимания, потому что агент от них зависит. Cline планирует вокруг того, что вы объявили: включённая поддержка изображений позволяет ему отправлять скриншоты модели, которая может их не принимать, а завышенное контекстное окно провоцирует сбои с обрезанным контекстом глубоко внутри длинных задач. Объявляйте то, что говорит документация модели, а не то, на что вы надеетесь.
Plan и Act: два режима, две модели.
Cline разделяет работу на режим Plan, где он изучает кодовую базу и выстраивает стратегию без редактирования, и режим Act, где он исполняет. Настройка API следует этому разделению: при включённой опции use-different-models настройки показывают вкладки по режимам, и каждый режим запоминает свой провайдер и модель, переключаясь автоматически при переходе между режимами. Экономика этого разделения — вся суть. Режим Plan — там, где окупается глубокий reasoning: claude-opus-4-7 или gpt-5.5, читающие кодовую базу и пишущие подход. Режим Act — это много быстрых ходов с вызовом инструментов, исполняющих уже существующий план, и это ровно профиль kimi-k2.7-code или claude-sonnet-4-6. Поскольку оба режима тарифицируются через один и тот же ключ шлюза, такая пара — вопрос настроек, а не мультивендорный проект. Одна честная оговорка из трекера issues: выбор модели по режимам имел шероховатости именно с провайдером OpenAI Compatible, включая сообщения о том, что режим Act тихо переиспользует модель Plan. После настройки разделения запустите одну задачу и подтвердите в заголовке задачи, какая модель на самом деле обслужила каждый режим, и проверьте лог использования; считайте разделение проверенным только после того, как увидели появление обоих ID.
Plan mode: claude-opus-4-7 (read, reason, strategize)
Act mode: kimi-k2.7-code (execute, edit, run, iterate)
verify: run one task, check which id served each mode,
then confirm both ids appear in the usage logВыбор моделей для кода в цикле агента.
Циклы агента умножают расход токенов так, как чат никогда не умножает; одна задача Cline может быть десятками запросов, несущих контекст файлов. Это делает выбор модели измеримым: запустите один и тот же класс задач на двух ID в течение недели и сравните расходы по каждой модели с тем, как часто вам приходилось вмешиваться.
- claude-sonnet-4-6 — ответ по умолчанию для работы в режиме Act: надёжные вызовы инструментов, сильные диффы и достаточно суждения, чтобы восстановиться после неудачных команд.
- kimi-k2.7-code — выбор для объёма в длинных агентных сессиях: настроена под код, быстра и по цене подходит для многоходового цикла, который Cline и правда запускает.
- gpt-5.6-sol заслуживает место для быстрых точечных правок и прогонов по исправлению тестов, где задержка на ход формирует ощущение от сессии.
- claude-opus-4-7 принадлежит режиму Plan на сложных задачах: изменения архитектуры, кросс-файловый рефакторинг, отладка, требующая полной картины.
- gpt-5.5 — сильный генералист для A/B-сравнения с Claude в режиме Plan на вашей собственной кодовой базе, а не на бенчмарках.
Оплата по факту · дешевле официальных цен
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Модель | Официальная цена | Наша цена |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Сбои, специфичные именно для Cline.
Обрезанное или «амнезийное» поведение глубоко в задаче — это объявление контекстного окна: задайте его равным задокументированному окну модели и помните, что Cline агрессивно упаковывает контекст файлов, так что завышенное окно ломается ровно на самых больших и самых раздражающих задачах. Странности с вызовом инструментов, испорченные правки или агент, рассказывающий вместо того, чтобы действовать, обычно означают, что выбранный ID слаб в function calling; переключитесь на claude-sonnet-4-6, чтобы отделить проблемы конфигурации от выбора модели, прежде чем винить настройку. Явные ошибки маппятся чисто: аутентификация — это поле ключа; model-not-found — это опечатка ID против листинга /v1/models; 404 на каждом запросе — это Base URL без /v1 или с удвоенным /v1. Провайдер дописывает пути маршрутов к тому base, который вы дали. И повторим ещё раз оговорку по режимам, потому что пропуск её стоит реальных денег: если вы настроили разные модели для Plan и Act, проверьте, что оба ID реально обслуживают свои режимы на живой задаче. Тихий фолбэк на дорогую модель Plan для каждого хода Act — именно то, что лог использования ловит в первый же день, а выписка по карте — в конце месяца.
Кто направляет Cline через шлюз.
- Разработчики, которые хотят, чтобы Claude вёл их агента без биллинговых отношений с Anthropic, на предоплаченном балансе без карты для старта.
- Покупатели моделей, сравнивающие модели для кода на реальных задачах в реальной кодовой базе, где каждый кандидат — это правка поля модели.
- Активные пользователи Cline, комбинирующие дорогую модель Plan с быстрой моделью Act, чтобы длинные сессии оставались доступными без потери качества планирования.
- Команды, тарифицирующие расходы агента по разработчику или проекту через использование по ключу, вместо догадок по общему вендорскому счёту.
- Разработчики, уже направляющие терминальные и редакторские инструменты через шлюз и желающие видеть агента VS Code на том же ключе и в том же логе.
Проверьте эндпоинт и отладьте первую задачу.
Сначала выполните curl к листингу моделей и одному chat completion с точным ID, который планируете настроить. Если оба проходят успешно, половина, связанная со шлюзом, готова, и любой оставшийся симптом — в настройках провайдера. Затем дайте Cline небольшую реальную задачу — один файл, ясная цель — и понаблюдайте за первыми ходами. Чистые вызовы инструментов и разумные правки означают, что ID и флаги возможностей подходят. Ошибки маппятся на три поля; странное поведение агента — на выбор модели или объявленные возможности. Если вы включили модели по режимам, эта первая задача — заодно и ваш проверочный прогон для разделения. Как только задачи пойдут, консоль APIsRouter покажет модель на запрос, счётчики токенов и расходы. Цикл агента — самый токеноёмкий способ использования модели, и вид использования по ключу — это то, как неделя работы с Cline превращается в конкретное число, по модели, по дню, по режиму, если вы разделили ключи.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Частые вопросы
Как использовать OpenAI-совместимый эндпоинт с Cline?
Откройте настройки Cline в VS Code, выберите OpenAI Compatible в выпадающем списке API Provider и задайте Base URL https://api.apisrouter.com/v1, свой API-ключ и ID модели. Заполните контекстное окно и максимум выходных токенов из документации модели.
Может ли Cline запускать модели Claude через этот провайдер?
Да. Провайдер передаёт ID модели как простую строку по стандартным chat completions, так что claude-sonnet-4-6 и claude-opus-4-7 работают точно так же, как ID GPT, — один ключ для всех них, а смена вендора — это правка поля модели.
Могут ли режимы Plan и Act использовать разные модели?
Да. Включите опцию use-different-models в конфигурации API Cline, и каждый режим получит свою вкладку со своим провайдером и моделью. Проверьте разделение на живой задаче: выбор модели по режимам имел зафиксированные шероховатости с провайдером OpenAI Compatible, включая переиспользование моделью Act модели Plan.
Что задавать для контекстного окна и максимума выходных токенов?
Задокументированные значения модели, а не умолчания или предположения. Cline упаковывает в запросы длинный контекст файлов, так что завышенное окно ломается на самых больших задачах, а заниженное отрезает код из контекста. Максимум выходных токенов ограничивает каждый ответ, задавайте его по тому, что позволяет ID.
Почему Cline плохо ведёт себя с вызовами инструментов на некоторых моделях?
Циклы агента зависят от надёжного function calling, и здесь ID сильно различаются. Если правки выходят испорченными или агент рассказывает вместо того, чтобы действовать, протестируйте ту же задачу на claude-sonnet-4-6; если это исправляет поведение — дело в выборе модели, а не в конфигурации.
Как узнать, сколько реально стоит неделя работы с Cline?
Вид использования по ключу в консоли APIsRouter показывает токены и расходы на запрос и на модель. Задачи агента — это десятки запросов каждая, так что лог — единственная честная мера; собственное отображение стоимости в Cline тоже помогает, если вы заполните опциональные поля цен.