Kilo Code를 OpenAI Compatible로 어떤 카탈로그 모델에서든 실행하기.
Updated 2026-07-30
Kilo Code는 게이트웨이를 위해 만들어진 커스텀 프로바이더 플로우를 제공합니다: Provider API로 OpenAI Compatible을 고르고, Base URL을 https://api.apisrouter.com/v1로 설정하고, 키 하나를 붙여넣으면 Kilo가 /v1/models에서 모델 목록을 자동으로 가져옵니다. Claude, Kimi, Codex급 id가 에이전트를 위한 서로 바꿔 끼울 수 있는 백엔드가 됩니다.
빠른 답: 커스텀 프로바이더 항목 하나.
톱니바퀴 아이콘을 통해 Kilo Code의 설정을 열고, Providers 탭으로 가서, 커스텀 프로바이더 옵션을 선택하세요. Provider ID와 표시 이름을 부여하고, Provider API를 OpenAI Compatible로, Base URL을 https://api.apisrouter.com/v1로 설정한 다음, 여러분의 키를 붙여넣으세요. Base URL과 키가 유효하면, Kilo는 엔드포인트의 /v1/models 목록을 조회해 사용 가능한 모든 id를 검색 가능한 피커로 보여주므로, claude-sonnet-4-6이나 kimi-k2.7-code를 무작정 타이핑하는 대신 목록에서 고를 수 있습니다. 모델은 수동으로 추가할 수도 있으며, 필요하다면 커스텀 HTTP 헤더도 key-value 쌍으로 지원됩니다. 저장하면 에이전트의 다음 작업이 게이트웨이를 통해 라우팅됩니다.
Provider ID: apisrouter
Display name: APIsRouter
Provider API: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API key: sk-YOUR-APISROUTER-KEY
Models: pick from the auto-fetched list
(e.g. claude-sonnet-4-6, kimi-k2.7-code)Kilo Code가 프로바이더를 사용하는 방식.
Kilo Code(GitHub에서 약 2.6만 스타)는 VS Code를 위한 오픈소스 AI 코딩 에이전트입니다: Roo와 Cline의 계보를 이어, 계획하고, 파일을 편집하고, 명령을 실행하고, 승인 게이트와 함께 실패를 반복 개선합니다. 그 루프는 특유의 트래픽 형태를 가집니다: 긴 컨텍스트가 들어가고 툴 호출과 diff가 나오며, 작업당 턴이 많은데, 이것이 뒷받침하는 모델을 품질 레버이자 비용 동인으로 동시에 만듭니다. OpenAI Compatible 프로바이더는 그 루프를 표준 chat completions로 여러분의 Base URL에 보내며, 모델 id는 그냥 문자열입니다. 와이어 포맷은 벤더를 신경 쓰지 않는데, 이것이 진짜 모델 쇼핑을 가능하게 합니다: claude-sonnet-4-6, kimi-k2.7-code, gpt-5.6-sol은 벤더 계정 세 개와 결제 설정 세 개가 아니라, 프로바이더 하나 뒤에서 서로 바꿔 끼울 수 있는 항목들입니다. 모델별 튜닝을 위해, 토큰 한도, 툴 호출 동작, 변형은 kilo.jsonc 설정 파일에 있으며, 모델에 UI가 노출하지 않는 설정이 필요할 때 직접 편집할 수 있습니다. 선언하는 한도는 낙관이 아니라 모델의 문서에서 가져오세요: 에이전트는 컨텍스트를 공격적으로 채우며, 과장된 윈도우는 정확히 가장 큰 작업에서 실패합니다.
Kilo의 루프를 위한 코딩 모델 선택.
Kilo의 모드는 서로 다른 종류의 작업이 서로 다른 설정을 가지게 해주며, 이를 활용하는 정직한 방법은 경험적입니다: 같은 종류의 작업을 두 id로 일주일 실행한 다음, 게이트웨이 콘솔에서 모델별 지출을 얼마나 자주 개입해야 했는지 옆에 놓고 읽으세요. 에이전트 루프는 모델을 쓰는 가장 토큰 집약적인 방식이므로, 그 차이는 느낌이 아니라 측정 가능합니다.
- claude-sonnet-4-6은 믿을 만한 기본값입니다: 강한 툴 호출, 깔끔한 diff, 작업 도중 명령이 실패했을 때의 좋은 회복력.
- kimi-k2.7-code는 긴 에이전트 세션을 위한 물량 선택입니다. 코드에 맞게 튜닝되어 있고 Kilo가 실제로 실행하는 많은 턴의 루프에 맞는 가격입니다.
- gpt-5.6-sol은 턴당 지연 시간이 세션의 형태를 결정하는 빠른 범위 편집과 테스트 수정 실행에 어울립니다.
- claude-opus-4-7은 어려운 작업에서 그 가격값을 합니다: 여러 파일에 걸친 리팩터링, 아키텍처 작업, 전체 그림이 컨텍스트에 필요한 디버깅.
- gpt-5.5는 벤치마크 표가 아니라 여러분 자신의 저장소에서 Claude와 A/B 테스트할 프론티어 제너럴리스트입니다.
사용한 만큼 지불 · 공식 요금보다 저렴
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| 모델 | 공식 요금 | 저희 요금 |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Kilo Code에 특유한 실패 패턴.
표준 순서로 디버깅하세요: 모델 목록을 curl하고, 정확한 id로 완성 하나를 curl한 다음, 그제서야 Kilo의 설정을 조정하세요. 두 개의 명령이 게이트웨이 문제와 에디터 설정을 깔끔하게 나눠줍니다.
- 모델 피커가 비어 있음: Base URL이나 키가 잘못되었습니다. 피커는 실시간 /v1/models 호출로 채워지기 때문입니다. 같은 값으로 목록을 curl해서 확인하세요.
- 모든 요청에서 404: Base URL이 /v1을 잃었거나, base가 있어야 할 자리에 전체 /chat/completions 경로를 붙여넣었습니다. Kilo는 전체 엔드포인트 URL도 받아들이지만, 그것이 올바른 chat-completions 라우트를 가리킬 때만 그렇습니다.
- 작업 깊숙이서 잘리거나 기억을 잃은 듯한 행동: kilo.jsonc에 선언된 컨텍스트 한도가 모델이 실제로 지원하는 것을 초과합니다. 문서화된 값을 쓰세요.
- 실행되지 않고 서술만 되는 툴 호출: 고른 id가 함수 호출에 약합니다. 설정을 건드리기 전에 claude-sonnet-4-6으로 작업을 다시 실행해 모델 선택과 설정 문제를 분리하세요.
- 문서에서 나온 Azure 특유의 참고 사항: Azure GPT-5 배포는 커스텀 OpenAI 호환 프로바이더가 보내는 max_tokens 필드를 거부하므로, Azure는 Kilo의 네이티브 azure 프로바이더를 써야 합니다. 게이트웨이에는 무관하지만, 둘 다 테스트한다면 헷갈리는 오류를 설명해 줍니다.
어떤 사람들이 게이트웨이를 통해 Kilo Code를 쓰는가.
- 별도의 Anthropic 결제 관계 없이, 카드 없는 무료 시작과 선불 잔액으로 Claude가 에이전트를 구동하길 원하는 개발자.
- 자동으로 가져온 피커를 이용해 실제 저장소의 실제 작업으로 코딩 id를 시험하는 모델 쇼퍼.
- 계획급 작업을 위한 프론티어 모델과 긴 실행 세션을 위한 물량 모델을 짝짓는 헤비 유저.
- 공유 벤더 청구서를 역산하는 대신 키별 사용량으로 개발자별 에이전트 지출을 계측하는 팀.
- 이미 다른 도구를 게이트웨이로 라우팅하고 있으며 VS Code 에이전트도 같은 키와 사용량 로그에 두고 싶은 사람들.
엔드포인트 검증 및 첫 작업 실행.
에디터를 설정하기 전에 curl로 게이트웨이 쪽을 먼저 증명하세요: 모델을 나열한 다음, 고르려는 id로 완성 하나를 보내세요. 둘 다 통과하면 남은 것은 모두 프로바이더 폼 안에 있습니다. 그런 다음 명확한 목표를 가진 작은 실제 작업을 Kilo에게 주고 처음 몇 턴을 지켜보세요. 깔끔한 툴 호출과 합리적인 편집은 그 id가 루프에 맞다는 뜻이며, 심각한 오류는 세 필드에 대응됩니다. 작업이 흐르기 시작하면 APIsRouter 콘솔에서 요청별 모델, 토큰, 지출을 볼 수 있는데, 여기가 일주일간의 에이전트 사용이 모델별 구체적인 숫자가 되는 곳입니다.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'자주 묻는 질문
Kilo Code에 OpenAI 호환 프로바이더를 어떻게 추가하나요?
설정 톱니바퀴 → Providers 탭 → 커스텀 프로바이더. Provider API를 OpenAI Compatible로, Base URL을 https://api.apisrouter.com/v1로 설정하고 여러분의 키를 붙여넣으세요. 그러면 Kilo가 /v1/models에서 모델 목록을 자동으로 가져오고, 검색 가능한 목록에서 id를 고를 수 있습니다.
Kilo Code가 이 프로바이더를 통해 Claude 모델을 실행할 수 있나요?
네. 프로바이더는 모델 id를 표준 chat completions를 통해 그냥 문자열로 전달하므로, claude-sonnet-4-6과 claude-opus-4-7도 GPT id와 같은 방식으로 작동하며, 키 하나로, 벤더 전환은 피커 선택 하나입니다.
프로바이더를 추가한 뒤 모델 목록이 왜 비어 있나요?
자동 가져오기는 실시간 /v1/models 호출로 채워지므로, 빈 목록은 Base URL이나 키가 잘못되었다는 뜻입니다. 같은 값으로 목록을 curl해 보세요; 그게 작동한다면 프로바이더 폼에 실제로 저장한 것을 다시 확인하세요. 모델은 수동으로도 추가할 수 있습니다.
커스텀 모델의 컨텍스트 윈도우와 토큰 한도는 어디서 설정하나요?
Kilo의 설정 파일인 kilo.jsonc에서요. 프로바이더 폼이 노출하는 것 이상으로 모델별 토큰 한도, 툴 호출 설정, 변형을 담습니다. 모델의 문서화된 값을 쓰세요; 과장된 한도는 가장 큰 작업에서 실패합니다.
API 키를 반드시 폼에 넣어야 하나요?
키 필드가 일반적인 경로이지만, 프로바이더 폼이 key-value 쌍으로 지원하는 커스텀 헤더로 인증을 처리한다면 선택 사항입니다. 표준 게이트웨이 설정에는 키 필드가 올바른 선택입니다.
일주일간의 Kilo Code 사용 비용은 어떻게 알 수 있나요?
APIsRouter 콘솔의 키별 사용량 뷰를 읽으세요: 요청별, 모델별 토큰과 지출. 에이전트 작업은 각각 수십 번의 요청이므로, 그 로그가 여러분의 사용 패턴이 얼마나 드는지 알 수 있는 유일한 정직한 방법입니다.