Запустите Cline на любой модели каталога через OpenAI Compatible.

Updated 2026-07-29

Выпадающий список API Provider в Cline включает OpenAI Compatible именно для этого: Base URL https://api.apisrouter.com/v1, один ключ и ID модели, на которой должен работать агент. ID Claude, Kimi и уровня Codex становятся взаимозаменяемыми бэкендами для кода, при этом режимы Plan и Act каждый закрепляется отдельно.

Короткий ответ: три поля в настройках Cline.

Откройте панель Cline в VS Code и нажмите шестерёнку настроек. В выпадающем списке API Provider выберите OpenAI Compatible, затем заполните три поля: Base URL https://api.apisrouter.com/v1, свой ключ в API Key и точный ID каталога в поле модели, например claude-sonnet-4-6. Поскольку Cline не может знать, на что способна модель произвольного эндпоинта, провайдер выставляет опции конфигурации модели, которые стоит задавать честно: размер контекстного окна, максимум выходных токенов и флаги возможностей вроде поддержки изображений, плюс опциональные цены на вход и выход, чтобы собственное отображение стоимости в Cline соответствовало реальности. Задайте окно и лимиты по документации модели. Сохраните — и агент проведёт следующую задачу через шлюз; ID можно менять в любой момент, не трогая рабочий процесс.

API Provider:  OpenAI Compatible
Base URL:      https://api.apisrouter.com/v1
API Key:       sk-YOUR-APISROUTER-KEY
Model:         claude-sonnet-4-6

Model config:  context window + max output tokens
               from the model's documentation,
               image support only if the id has it

Как Cline использует настроенную модель.

Cline (около 65K звёзд на GitHub) — автономный агент для написания кода в VS Code: он читает вашу кодовую базу, редактирует файлы, запускает терминальные команды и итерирует по сбоям, с воротами подтверждения от человека на пути. Этот цикл прожорлив к моделям особым образом: длинные контексты (дерева файлов, диффы, вывод терминала) на входе, вызовы инструментов и код на выходе, много ходов на задачу. Провайдер OpenAI Compatible отправляет этот цикл как стандартные chat completions на ваш Base URL с ID модели как простой строкой. Вендор не важен для формата на проводе, и именно это делает выбор моделей здесь реальным: claude-sonnet-4-6, kimi-k2.7-code и gpt-5.6-sol — взаимозаменяемые бэкенды за одними и теми же тремя полями, вместо трёх отдельных конфигураций провайдера с тремя вендорскими аккаунтами. Флаги возможностей заслуживают внимания, потому что агент от них зависит. Cline планирует вокруг того, что вы объявили: включённая поддержка изображений позволяет ему отправлять скриншоты модели, которая может их не принимать, а завышенное контекстное окно провоцирует сбои с обрезанным контекстом глубоко внутри длинных задач. Объявляйте то, что говорит документация модели, а не то, на что вы надеетесь.

Plan и Act: два режима, две модели.

Cline разделяет работу на режим Plan, где он изучает кодовую базу и выстраивает стратегию без редактирования, и режим Act, где он исполняет. Настройка API следует этому разделению: при включённой опции use-different-models настройки показывают вкладки по режимам, и каждый режим запоминает свой провайдер и модель, переключаясь автоматически при переходе между режимами. Экономика этого разделения — вся суть. Режим Plan — там, где окупается глубокий reasoning: claude-opus-4-7 или gpt-5.5, читающие кодовую базу и пишущие подход. Режим Act — это много быстрых ходов с вызовом инструментов, исполняющих уже существующий план, и это ровно профиль kimi-k2.7-code или claude-sonnet-4-6. Поскольку оба режима тарифицируются через один и тот же ключ шлюза, такая пара — вопрос настроек, а не мультивендорный проект. Одна честная оговорка из трекера issues: выбор модели по режимам имел шероховатости именно с провайдером OpenAI Compatible, включая сообщения о том, что режим Act тихо переиспользует модель Plan. После настройки разделения запустите одну задачу и подтвердите в заголовке задачи, какая модель на самом деле обслужила каждый режим, и проверьте лог использования; считайте разделение проверенным только после того, как увидели появление обоих ID.

Plan mode:  claude-opus-4-7      (read, reason, strategize)
Act mode:   kimi-k2.7-code       (execute, edit, run, iterate)

verify: run one task, check which id served each mode,
then confirm both ids appear in the usage log

Выбор моделей для кода в цикле агента.

Циклы агента умножают расход токенов так, как чат никогда не умножает; одна задача Cline может быть десятками запросов, несущих контекст файлов. Это делает выбор модели измеримым: запустите один и тот же класс задач на двух ID в течение недели и сравните расходы по каждой модели с тем, как часто вам приходилось вмешиваться.

  • claude-sonnet-4-6 — ответ по умолчанию для работы в режиме Act: надёжные вызовы инструментов, сильные диффы и достаточно суждения, чтобы восстановиться после неудачных команд.
  • kimi-k2.7-code — выбор для объёма в длинных агентных сессиях: настроена под код, быстра и по цене подходит для многоходового цикла, который Cline и правда запускает.
  • gpt-5.6-sol заслуживает место для быстрых точечных правок и прогонов по исправлению тестов, где задержка на ход формирует ощущение от сессии.
  • claude-opus-4-7 принадлежит режиму Plan на сложных задачах: изменения архитектуры, кросс-файловый рефакторинг, отладка, требующая полной картины.
  • gpt-5.5 — сильный генералист для A/B-сравнения с Claude в режиме Plan на вашей собственной кодовой базе, а не на бенчмарках.

Оплата по факту · дешевле официальных цен

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

МодельОфициальная ценаНаша цена
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Сбои, специфичные именно для Cline.

Обрезанное или «амнезийное» поведение глубоко в задаче — это объявление контекстного окна: задайте его равным задокументированному окну модели и помните, что Cline агрессивно упаковывает контекст файлов, так что завышенное окно ломается ровно на самых больших и самых раздражающих задачах. Странности с вызовом инструментов, испорченные правки или агент, рассказывающий вместо того, чтобы действовать, обычно означают, что выбранный ID слаб в function calling; переключитесь на claude-sonnet-4-6, чтобы отделить проблемы конфигурации от выбора модели, прежде чем винить настройку. Явные ошибки маппятся чисто: аутентификация — это поле ключа; model-not-found — это опечатка ID против листинга /v1/models; 404 на каждом запросе — это Base URL без /v1 или с удвоенным /v1. Провайдер дописывает пути маршрутов к тому base, который вы дали. И повторим ещё раз оговорку по режимам, потому что пропуск её стоит реальных денег: если вы настроили разные модели для Plan и Act, проверьте, что оба ID реально обслуживают свои режимы на живой задаче. Тихий фолбэк на дорогую модель Plan для каждого хода Act — именно то, что лог использования ловит в первый же день, а выписка по карте — в конце месяца.

Кто направляет Cline через шлюз.

  • Разработчики, которые хотят, чтобы Claude вёл их агента без биллинговых отношений с Anthropic, на предоплаченном балансе без карты для старта.
  • Покупатели моделей, сравнивающие модели для кода на реальных задачах в реальной кодовой базе, где каждый кандидат — это правка поля модели.
  • Активные пользователи Cline, комбинирующие дорогую модель Plan с быстрой моделью Act, чтобы длинные сессии оставались доступными без потери качества планирования.
  • Команды, тарифицирующие расходы агента по разработчику или проекту через использование по ключу, вместо догадок по общему вендорскому счёту.
  • Разработчики, уже направляющие терминальные и редакторские инструменты через шлюз и желающие видеть агента VS Code на том же ключе и в том же логе.

Проверьте эндпоинт и отладьте первую задачу.

Сначала выполните curl к листингу моделей и одному chat completion с точным ID, который планируете настроить. Если оба проходят успешно, половина, связанная со шлюзом, готова, и любой оставшийся симптом — в настройках провайдера. Затем дайте Cline небольшую реальную задачу — один файл, ясная цель — и понаблюдайте за первыми ходами. Чистые вызовы инструментов и разумные правки означают, что ID и флаги возможностей подходят. Ошибки маппятся на три поля; странное поведение агента — на выбор модели или объявленные возможности. Если вы включили модели по режимам, эта первая задача — заодно и ваш проверочный прогон для разделения. Как только задачи пойдут, консоль APIsRouter покажет модель на запрос, счётчики токенов и расходы. Цикл агента — самый токеноёмкий способ использования модели, и вид использования по ключу — это то, как неделя работы с Cline превращается в конкретное число, по модели, по дню, по режиму, если вы разделили ключи.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Частые вопросы

Как использовать OpenAI-совместимый эндпоинт с Cline?

Откройте настройки Cline в VS Code, выберите OpenAI Compatible в выпадающем списке API Provider и задайте Base URL https://api.apisrouter.com/v1, свой API-ключ и ID модели. Заполните контекстное окно и максимум выходных токенов из документации модели.

Может ли Cline запускать модели Claude через этот провайдер?

Да. Провайдер передаёт ID модели как простую строку по стандартным chat completions, так что claude-sonnet-4-6 и claude-opus-4-7 работают точно так же, как ID GPT, — один ключ для всех них, а смена вендора — это правка поля модели.

Могут ли режимы Plan и Act использовать разные модели?

Да. Включите опцию use-different-models в конфигурации API Cline, и каждый режим получит свою вкладку со своим провайдером и моделью. Проверьте разделение на живой задаче: выбор модели по режимам имел зафиксированные шероховатости с провайдером OpenAI Compatible, включая переиспользование моделью Act модели Plan.

Что задавать для контекстного окна и максимума выходных токенов?

Задокументированные значения модели, а не умолчания или предположения. Cline упаковывает в запросы длинный контекст файлов, так что завышенное окно ломается на самых больших задачах, а заниженное отрезает код из контекста. Максимум выходных токенов ограничивает каждый ответ, задавайте его по тому, что позволяет ID.

Почему Cline плохо ведёт себя с вызовами инструментов на некоторых моделях?

Циклы агента зависят от надёжного function calling, и здесь ID сильно различаются. Если правки выходят испорченными или агент рассказывает вместо того, чтобы действовать, протестируйте ту же задачу на claude-sonnet-4-6; если это исправляет поведение — дело в выборе модели, а не в конфигурации.

Как узнать, сколько реально стоит неделя работы с Cline?

Вид использования по ключу в консоли APIsRouter показывает токены и расходы на запрос и на модель. Задачи агента — это десятки запросов каждая, так что лог — единственная честная мера; собственное отображение стоимости в Cline тоже помогает, если вы заполните опциональные поля цен.