Запустіть Cline на будь-якій моделі каталогу через OpenAI Compatible.

Updated 2026-07-29

У випадному списку API Provider у Cline є саме для цього опція OpenAI Compatible: Base URL https://api.apisrouter.com/v1, один ключ і ID моделі, яка керуватиме агентом. ID Claude, Kimi і класу Codex стають взаємозамінними бекендами для кодування, причому режими Plan і Act можна закріпити кожен окремо.

Коротка відповідь: три поля в налаштуваннях Cline.

Відкрийте панель Cline в VS Code і натисніть значок шестерні налаштувань. У випадному списку API Provider оберіть OpenAI Compatible, тоді заповніть три поля: Base URL https://api.apisrouter.com/v1, ваш ключ у полі API Key і точний ID каталогу в полі моделі, наприклад claude-sonnet-4-6. Оскільки Cline не може знати, на що здатна модель довільного ендпоінта, провайдер відкриває опції конфігурації моделі, які варто заповнювати чесно: розмір контекстного вікна, максимум вихідних токенів і прапорці можливостей на кшталт підтримки зображень, а також опційні ціни на вхід і вихід, щоб власний індикатор вартості Cline відповідав реальності. Встановіть вікно і ліміти з документації моделі. Збережіть, і агент виконає наступне завдання через шлюз; ID можна змінити будь-коли, не торкаючись вашого робочого процесу.

API Provider:  OpenAI Compatible
Base URL:      https://api.apisrouter.com/v1
API Key:       sk-YOUR-APISROUTER-KEY
Model:         claude-sonnet-4-6

Model config:  context window + max output tokens
               from the model's documentation,
               image support only if the id has it

Як Cline використовує налаштовану модель.

Cline (приблизно 65 тис. зірок на GitHub) — автономний агент для кодування у VS Code: він читає вашу кодову базу, редагує файли, запускає термінальні команди й ітерує на невдачах, з контрольними точками схвалення людиною на шляху. Цей цикл «голодний» до моделі у специфічний спосіб: на вхід — довгі контексти (дерева файлів, diff-и, вивід термінала), на вихід — виклики інструментів і код, багато ходів на завдання. Провайдер OpenAI Compatible надсилає цей цикл як стандартні chat completions на ваш Base URL з ID моделі як звичайним рядком. Постачальник не має значення для формату передачі даних, і саме це робить «шопінг» моделей тут реальним: claude-sonnet-4-6, kimi-k2.7-code і gpt-5.6-sol — взаємозамінні бекенди за тими самими трьома полями, замість трьох окремих конфігурацій провайдера з трьома акаунтами постачальників. Прапорці можливостей заслуговують на увагу, оскільки агент залежить від них. Cline планує на основі того, що ви оголосили: увімкнена підтримка зображень дозволяє йому надсилати скріншоти моделі, яка, можливо, їх не приймає, а завищене контекстне вікно запрошує збої через обрізаний контекст глибоко всередині довгих завдань. Оголошуйте те, що каже документація моделі, а не те, на що ви сподіваєтесь.

Plan і Act: два режими, дві моделі.

Cline розділяє роботу на режим Plan, де він досліджує кодову базу і вибудовує стратегію без редагування, і режим Act, де він виконує. Конфігурація API йде за цим розділенням: з увімкненою опцією use-different-models налаштування показують вкладки для кожного режиму, і кожен режим пам'ятає власного провайдера і модель, перемикаючись автоматично під час перемикання режиму. Уся суть — в економіці цього розділення. Режим Plan — це там, де окупається глибоке міркування: claude-opus-4-7 чи gpt-5.5 читає кодову базу і пише підхід. Режим Act — це багато швидких ходів з викликом інструментів, що виконують уже готовий план, а це якраз профіль kimi-k2.7-code чи claude-sonnet-4-6. Оскільки обидва режими оплачуються через той самий ключ шлюзу, таке поєднання — це вибір налаштувань, а не мультипостачальницький проєкт. Одне чесне застереження з трекера завдань: вибір моделі для кожного режиму мав шорсткі краї саме з провайдером OpenAI Compatible, включно з повідомленнями про те, що режим Act тихо повторно використовував модель Plan. Після налаштування розділення запустіть одне завдання і підтвердіть у заголовку завдання, яка модель насправді обслуговувала кожен режим, а також перевірте журнал використання; вважайте розділення підтвердженим лише після того, як побачите обидва ID у списку.

Plan mode:  claude-opus-4-7      (read, reason, strategize)
Act mode:   kimi-k2.7-code       (execute, edit, run, iterate)

verify: run one task, check which id served each mode,
then confirm both ids appear in the usage log

Вибір моделей для кодування циклу агента.

Цикли агента множать витрати токенів так, як звичайний чат ніколи не робить; одне завдання Cline може бути десятками запитів, що несуть контекст файлів. Це робить вибір моделі вимірюваним: запустіть той самий клас завдання на двох ID протягом тижня і прочитайте витрати на кожну модель поряд з тим, як часто вам доводилось втручатись.

  • claude-sonnet-4-6 — типова відповідь для роботи в режимі Act: надійний виклик інструментів, сильні diff-и і достатньо здорового глузду, щоб відновитись після невдалих команд.
  • kimi-k2.7-code — вибір для обсягу в довгих агентних сесіях: налаштована під код, швидка і оцінена під багатоходовий цикл, який насправді запускає Cline.
  • gpt-5.6-sol заслуговує на місце для швидких точкових редагувань і запусків з виправленням тестів, де затримка на хід формує відчуття від сесії.
  • claude-opus-4-7 належить режиму Plan для складних завдань: архітектурні зміни, міжфайловий рефакторинг, дебагінг, який потребує повної картини.
  • gpt-5.5 — сильний узагальнений варіант для A/B-порівняння з Claude в режимі Plan на вашій власній кодовій базі, а не на бенчмарках.

Оплата за фактом · нижче офіційних цін

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

МодельОфіційна цінаНаша ціна
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Специфічні для Cline режими збоїв.

Обрізана чи «амнезійна» поведінка глибоко всередині завдання — це про декларацію контекстного вікна: встановіть його на задокументоване вікно моделі і пам'ятайте, що Cline агресивно пакує контекст файлів, тож завищене вікно провалюється саме на найбільших, найдратівливіших завданнях. Дивна поведінка при виклику інструментів, спотворені редагування чи агент, що розповідає замість того, щоб діяти, зазвичай означає, що обраний ID слабкий у виклику функцій; перемкніться на claude-sonnet-4-6, щоб відділити проблеми конфігурації від вибору моделі, перш ніж звинувачувати налаштування. Жорсткі помилки чітко відображаються: автентифікація — це поле ключа; «модель не знайдено» — це написання ID проти списку /v1/models; 404 на кожен запит — це Base URL без /v1 або з подвоєним /v1. Провайдер дописує шляхи маршрутів до base, який ви задаєте. І застереження щодо режимів повторимо ще раз, бо пропустити його коштує реальних грошей: якщо ви налаштували різні моделі для Plan і Act, перевірте, що обидва ID справді обслуговують свої режими на живому завданні. Тихий відкат до дорогої моделі Plan для кожного ходу Act — це те, що журнал використання спіймає в перший же день, а виписка з картки — в кінці місяця.

Хто маршрутизує Cline через шлюз.

  • Розробники, які хочуть, щоб Claude керував їхнім агентом без стосунків білінгу з Anthropic, на передоплаченому балансі без картки для старту.
  • Ті, хто «ходить по магазинах моделей», порівнюючи моделі для кодування на реальних завданнях у своїй реальній кодовій базі, де кожен кандидат — це редагування поля моделі.
  • Активні користувачі Cline, що поєднують дорогу модель Plan зі швидкою моделлю Act, щоб тримати довгі сесії доступними без втрати якості планування.
  • Команди, що вимірюють витрати агента на кожного розробника чи проєкт через використання за ключем, замість того щоб вгадувати зі спільного рахунку постачальника.
  • Розробники, що вже маршрутизують термінальні й редакторні інструменти через шлюз і хочуть тримати агента VS Code на тому самому ключі й у тому самому журналі.

Перевірте ендпоінт і налагодьте перше завдання.

Спершу виконайте curl для списку моделей і одного chat completion з точним ID, який плануєте налаштувати. Якщо обидва пройшли — половина роботи зі шлюзом завершена, і кожен наступний симптом — у налаштуваннях провайдера. Тоді дайте Cline невелике реальне завдання — один файл, чітка мета — і спостерігайте за першими ходами. Чисті виклики інструментів і розумні редагування означають, що ID і прапорці можливостей підходять. Помилки відображаються на три поля; дивна поведінка агента відображається на вибір моделі чи оголошені можливості. Якщо ви увімкнули моделі для кожного режиму, це перше завдання також є вашим перевірочним запуском для розділення. Щойно завдання почнуть виконуватись, консоль APIsRouter показує модель на кожен запит, кількість токенів і витрати. Цикл агента — найінтенсивніший за токенами спосіб використання моделі, і погляд на використання за ключем — це те місце, де тиждень Cline перетворюється на конкретне число: на модель, на день, на режим, якщо ви розділили ключі.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Поширені запитання

Як використовувати OpenAI-сумісний ендпоінт з Cline?

Відкрийте налаштування Cline в VS Code, оберіть OpenAI Compatible у випадному списку API Provider і встановіть Base URL https://api.apisrouter.com/v1, ваш API-ключ і ID моделі. Заповніть контекстне вікно і максимум вихідних токенів з документації моделі.

Чи може Cline запускати моделі Claude через цей провайдер?

Так. Провайдер передає ID моделі як звичайний рядок через стандартні chat completions, тож claude-sonnet-4-6 і claude-opus-4-7 працюють точно так само, як ID GPT, один ключ на всіх, а перемикання постачальників — це редагування поля моделі.

Чи можуть режими Plan і Act використовувати різні моделі?

Так. Увімкніть опцію use-different-models у конфігурації API Cline, і кожен режим отримає власну вкладку з власним провайдером і моделлю. Однак перевірте розділення на живому завданні: за повідомленнями, вибір для кожного режиму мав шорсткі краї з провайдером OpenAI Compatible, включно з тим, що Act повторно використовував модель Plan.

Що встановлювати для контекстного вікна і максимуму вихідних токенів?

Задокументовані значення моделі, а не значення за замовчуванням чи сподівання. Cline пакує довгий контекст файлів у запити, тож завищене вікно провалюється на найбільших завданнях, а занижене обрізає код із контексту. Максимум вихідних токенів обмежує кожну відповідь, підібраний під те, що дозволяє ID.

Чому Cline погано поводиться з викликами інструментів для деяких моделей?

Цикли агента залежать від надійного виклику функцій, і ID тут сильно різняться. Якщо редагування виходять спотвореними або агент розповідає замість того, щоб діяти, протестуйте те саме завдання на claude-sonnet-4-6; якщо це виправляє поведінку, справа у виборі моделі, а не в конфігурації.

Як дізнатись, скільки насправді коштує тиждень Cline?

Погляд на використання за ключем у консолі APIsRouter показує токени й витрати на кожен запит і кожну модель. Завдання агента — це десятки запитів кожне, тож журнал — єдиний чесний вимір; вбудований індикатор вартості Cline теж допомагає, якщо ви заповните опційні поля цін.