OpenAI Compatible로 카탈로그의 어떤 모델에서도 Cline 실행하기.
Updated 2026-07-29
Cline의 API Provider 드롭다운에는 정확히 이런 용도를 위한 OpenAI Compatible이 있습니다: Base URL https://api.apisrouter.com/v1, 키 하나, 그리고 에이전트를 구동할 모델 id. Claude, Kimi, Codex급 id가 서로 교체 가능한 코딩 백엔드가 되며, Plan과 Act 모드 각각에 모델을 고정할 수 있습니다.
빠른 답: Cline 설정의 세 필드.
VS Code에서 Cline 패널을 열고 설정 톱니바퀴를 클릭하세요. API Provider 드롭다운에서 OpenAI Compatible을 선택한 다음, 세 필드를 채우세요: Base URL https://api.apisrouter.com/v1, API Key에 여러분의 키, 그리고 모델 필드에 claude-sonnet-4-6 같은 정확한 카탈로그 id. Cline은 임의의 엔드포인트에 있는 모델이 무엇을 할 수 있는지 알 수 없으므로, 프로바이더는 정직하게 설정해야 할 모델 구성 옵션을 노출합니다: 컨텍스트 윈도우 크기, 최대 출력 토큰, 이미지 지원 같은 기능 플래그, 그리고 Cline 자체의 비용 표시가 실제와 맞도록 하는 선택적 입력·출력 가격. 윈도우와 한도는 모델 문서를 기준으로 설정하세요. 저장하면 에이전트가 다음 작업부터 게이트웨이를 통해 실행되며, 워크플로우를 건드리지 않고도 언제든 id를 바꿀 수 있습니다.
API Provider: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Model: claude-sonnet-4-6
Model config: context window + max output tokens
from the model's documentation,
image support only if the id has itCline이 설정된 모델을 사용하는 방법.
Cline(GitHub 스타 약 6.5만 개)은 VS Code용 자율 코딩 에이전트입니다: 코드베이스를 읽고, 파일을 수정하고, 터미널 명령을 실행하고, 실패를 반복적으로 수정하며, 그 과정에 사람의 승인 게이트가 있습니다. 이 루프는 특정한 방식으로 모델을 많이 소모합니다: 긴 컨텍스트(파일 트리, diff, 터미널 출력)가 들어가고, 툴 호출과 코드가 나오며, 작업당 턴 수가 많습니다. OpenAI Compatible 프로바이더는 이 루프를 모델 id를 그대로 문자열로 담아 표준 chat completions 형태로 Base URL에 보냅니다. 벤더가 무엇이든 통신 형식에는 상관없으며, 이 덕분에 여기서는 모델 쇼핑이 현실이 됩니다: claude-sonnet-4-6, kimi-k2.7-code, gpt-5.6-sol이 세 개의 별도 프로바이더 설정과 세 개의 벤더 계정 대신, 같은 세 필드 뒤에서 서로 교체 가능한 백엔드가 됩니다. 기능 플래그는 에이전트가 여기에 의존하기 때문에 신중하게 다뤄야 합니다. Cline은 여러분이 선언한 내용을 바탕으로 계획을 세웁니다: 이미지 지원을 켜두면 그것을 받지 못할 수도 있는 모델에 스크린샷을 보내게 되고, 컨텍스트 윈도우를 과장하면 긴 작업 도중 깊숙한 곳에서 컨텍스트가 잘리는 실패를 초래합니다. 바라는 값이 아니라 모델 문서에 적힌 값을 선언하세요.
Plan과 Act: 두 모드, 두 모델.
Cline은 작업을 편집 없이 코드베이스를 탐색하고 전략을 세우는 Plan 모드와, 실제로 실행하는 Act 모드로 나눕니다. API 설정도 이 구분을 따릅니다: use-different-models 옵션을 켜면 설정 화면에 모드별 탭이 나타나고, 각 모드가 자신의 프로바이더와 모델을 기억하며 토글할 때마다 자동으로 전환됩니다. 이 구분의 경제성이 핵심입니다. Plan 모드는 깊은 추론이 값어치를 하는 곳입니다: claude-opus-4-7이나 gpt-5.5가 코드베이스를 읽고 접근 방식을 작성합니다. Act 모드는 이미 존재하는 계획을 실행하는 빠른 툴 호출 턴이 많이 반복되는 곳으로, 이는 정확히 kimi-k2.7-code나 claude-sonnet-4-6의 특성입니다. 두 모드 모두 같은 게이트웨이 키로 청구되므로, 이 조합은 멀티 벤더 프로젝트가 아니라 단순한 설정 선택이 됩니다. 이슈 트래커에서 나온 솔직한 주의사항 하나: 모드별 모델 선택은 특히 OpenAI Compatible 프로바이더에서 매끄럽지 않은 부분이 있었으며, Act 모드가 Plan 모델을 조용히 재사용한다는 보고도 있었습니다. 구분을 설정한 다음 작업을 하나 실행해 작업 헤더에서 실제로 어떤 모델이 각 모드를 처리했는지 확인하고 사용량 로그도 확인하세요. 두 id가 모두 나타나는 것을 확인한 뒤에야 그 구분이 제대로 적용됐다고 간주하세요.
Plan mode: claude-opus-4-7 (read, reason, strategize)
Act mode: kimi-k2.7-code (execute, edit, run, iterate)
verify: run one task, check which id served each mode,
then confirm both ids appear in the usage log에이전트 루프를 위한 코딩 모델 선택.
에이전트 루프는 채팅과는 다른 방식으로 토큰 지출을 배가시킵니다. Cline의 작업 하나가 파일 컨텍스트를 담은 수십 개의 요청이 될 수 있습니다. 그래서 모델 선택을 수치로 측정할 수 있습니다: 같은 종류의 작업을 일주일간 두 id로 돌려보고, 얼마나 자주 개입해야 했는지와 함께 모델별 지출을 확인하세요.
- claude-sonnet-4-6은 Act 모드 작업의 기본 답입니다: 믿을 만한 툴 호출, 탄탄한 diff, 실패한 명령에서 회복할 만큼의 판단력을 갖추고 있습니다.
- kimi-k2.7-code는 긴 에이전틱 세션을 위한 물량용 선택입니다: 코딩에 특화되어 있고, 빠르며, Cline이 실제로 돌리는 많은 턴의 루프에 맞는 가격입니다.
- gpt-5.6-sol은 범위가 좁은 빠른 수정과 테스트 수정 작업에서 제 몫을 합니다 — 턴당 지연 시간이 세션의 체감을 좌우하는 곳입니다.
- claude-opus-4-7은 어려운 작업의 Plan 모드에 적합합니다: 아키텍처 변경, 여러 파일에 걸친 리팩터링, 전체 그림이 필요한 디버깅.
- gpt-5.5는 벤치마크가 아니라 여러분의 실제 코드베이스에서 Plan 모드의 Claude와 A/B 테스트해볼 만한 강력한 제너럴리스트입니다.
사용한 만큼 지불 · 공식 요금보다 저렴
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| 모델 | 공식 요금 | 저희 요금 |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Cline 특유의 실패 패턴.
작업 도중 깊숙한 곳에서 잘리거나 건망증에 걸린 듯한 동작은 컨텍스트 윈도우 선언 문제입니다: 모델 문서에 나온 윈도우로 설정하세요. Cline은 파일 컨텍스트를 적극적으로 채워 넣으므로, 윈도우를 과장하면 하필 가장 크고 가장 골치 아픈 작업에서 실패하게 됩니다. 이상한 툴 호출, 형식이 깨진 수정, 또는 실행 대신 설명만 늘어놓는 에이전트는 대개 선택한 id가 함수 호출에 약하다는 뜻입니다. 설정 탓을 하기 전에 claude-sonnet-4-6으로 바꿔서 설정 문제와 모델 선택 문제를 분리하세요. 명백한 오류는 깔끔하게 대응됩니다: 인증 오류는 키 필드 문제이고, model-not-found는 /v1/models 목록 대비 id 철자 문제이며, 모든 요청에서 나는 404는 Base URL에 /v1이 빠졌거나 중복된 것입니다. 프로바이더는 여러분이 준 베이스에 경로를 덧붙입니다. 그리고 놓치면 실제 돈이 나가는 문제이므로 모드별 주의사항을 한 번 더 반복합니다: Plan과 Act에 서로 다른 모델을 설정했다면, 실제 작업에서 두 id가 실제로 각자의 모드를 처리하는지 확인하세요. 모든 Act 턴에서 비싼 Plan 모델로 조용히 폴백되는 것은 사용량 로그로는 첫날 바로 잡히지만, 카드 명세서로는 월말에야 잡히는 종류의 문제입니다.
어떤 사람들이 게이트웨이를 통해 Cline을 쓰는가.
- Anthropic과의 결제 관계 없이 Claude가 에이전트를 구동하기를 원하는 개발자 — 카드 없이 선불 잔액으로 시작합니다.
- 실제 코드베이스의 실제 작업에서 코딩 모델을 비교하는 모델 쇼퍼 — 각 후보는 모델 필드 수정 한 번이면 됩니다.
- 긴 세션을 감당할 만한 비용으로 유지하면서도 계획 품질을 잃지 않기 위해 비싼 Plan 모델과 빠른 Act 모델을 조합하는 헤비 Cline 사용자.
- 공유된 벤더 청구서로 추측하는 대신, 키별 사용량으로 개발자별·프로젝트별 에이전트 지출을 계측하는 팀.
- 이미 터미널과 에디터 도구를 게이트웨이로 라우팅하고 있으며 VS Code 에이전트도 같은 키와 로그로 관리하고 싶은 개발자.
엔드포인트 검증 및 첫 작업 디버깅.
먼저 설정할 정확한 id로 모델 목록과 chat completion 하나를 curl로 확인하세요. 둘 다 성공하면 게이트웨이 쪽은 끝난 것이며, 남은 증상은 모두 프로바이더 설정 쪽에 있습니다. 그다음 Cline에 작은 실제 작업을 하나 주세요 — 파일 하나, 명확한 목표 — 그리고 첫 턴들을 지켜보세요. 깔끔한 툴 호출과 합리적인 수정은 id와 기능 플래그가 맞다는 뜻입니다. 오류는 세 필드에 대응하고, 이상한 에이전트 동작은 모델 선택이나 선언된 기능에 대응합니다. 모드별 모델을 켰다면, 이 첫 작업이 그 구분에 대한 검증 실행이기도 합니다. 작업이 순조롭게 흐르면, APIsRouter 콘솔이 요청별 모델, 토큰 수, 지출을 보여줍니다. 에이전트 루프는 모델을 가장 많이 소모하는 사용 방식이며, 키를 분리했다면 모델별·일별·모드별로, 키별 사용량 뷰에서 일주일간의 Cline 사용이 구체적인 숫자로 드러납니다.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'자주 묻는 질문
Cline에서 OpenAI 호환 엔드포인트는 어떻게 사용하나요?
VS Code에서 Cline 설정을 열고, API Provider 드롭다운에서 OpenAI Compatible을 선택한 다음, Base URL https://api.apisrouter.com/v1, API 키, 모델 id를 설정하세요. 컨텍스트 윈도우와 최대 출력 토큰은 모델 문서를 참고해 채우세요.
이 프로바이더로 Cline에서 Claude 모델을 실행할 수 있나요?
네. 프로바이더는 모델 id를 표준 chat completions를 통해 그대로 문자열로 전달하므로, claude-sonnet-4-6과 claude-opus-4-7도 GPT id와 똑같이 작동합니다. 모두 키 하나로 처리되며, 벤더 전환은 모델 필드 수정 한 번이면 됩니다.
Plan 모드와 Act 모드에 서로 다른 모델을 쓸 수 있나요?
네. Cline의 API 설정에서 use-different-models 옵션을 켜면 각 모드가 자신만의 프로바이더와 모델을 가진 탭을 갖게 됩니다. 다만 실제 작업에서 이 구분이 잘 적용되는지 확인하세요: 모드별 선택은 OpenAI Compatible 프로바이더에서 매끄럽지 않은 부분이 보고된 적이 있으며, Act 모드가 Plan 모델을 재사용하는 경우도 포함됩니다.
컨텍스트 윈도우와 최대 출력 토큰은 어떻게 설정해야 하나요?
기본값이나 짐작이 아니라 모델 문서에 나온 값입니다. Cline은 긴 파일 컨텍스트를 요청에 채워 넣으므로, 윈도우를 과장하면 가장 큰 작업에서 실패하고, 축소하면 코드가 컨텍스트에서 잘려 나갑니다. 최대 출력 토큰은 각 응답을 제한하며, 해당 id가 허용하는 크기로 설정하세요.
일부 모델에서 Cline의 툴 호출이 이상하게 작동하는 이유는?
에이전트 루프는 믿을 만한 함수 호출에 의존하는데, 이 부분에서 id별 차이가 큽니다. 수정 결과가 형식이 깨지거나 에이전트가 실행 대신 설명만 한다면, 같은 작업을 claude-sonnet-4-6으로 테스트해보세요. 그것으로 동작이 고쳐진다면 설정이 아니라 모델 선택 문제입니다.
일주일간 Cline을 실제로 얼마나 썼는지 어떻게 알 수 있나요?
APIsRouter 콘솔의 키별 사용량 뷰가 요청별·모델별 토큰과 지출을 보여줍니다. 에이전트 작업은 각각 수십 개의 요청이므로 이 로그가 유일하게 정직한 척도입니다. 선택적 가격 필드를 입력하면 Cline 자체의 앱 내 비용 표시도 도움이 됩니다.