Rode o Kilo Code em qualquer modelo do catálogo via OpenAI Compatible.
Updated 2026-07-30
O Kilo Code vem com um fluxo de provider personalizado feito para gateways: escolha OpenAI Compatible como o Provider API, defina Base URL como https://api.apisrouter.com/v1, cole uma chave, e o Kilo busca automaticamente a lista de modelos de /v1/models. Ids Claude, Kimi, e classe Codex viram backends intercambiáveis para o agente.
Resposta rápida: uma entrada de provider personalizado.
Abra as configurações do Kilo Code pelo ícone de engrenagem, vá para a aba Providers, e escolha a opção de provider personalizado. Dê a ela um Provider ID e nome de exibição, defina Provider API como OpenAI Compatible, Base URL como https://api.apisrouter.com/v1, e cole sua chave. Assim que a Base URL e a chave são válidas, o Kilo consulta a listagem /v1/models do endpoint e apresenta um seletor pesquisável de todo id disponível, então você seleciona claude-sonnet-4-6 ou kimi-k2.7-code de uma lista em vez de digitá-lo às cegas. Modelos também podem ser adicionados manualmente, e headers HTTP personalizados são suportados como pares chave-valor se você precisar deles. Salve, e a próxima tarefa do agente roteia pelo gateway.
Provider ID: apisrouter
Display name: APIsRouter
Provider API: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API key: sk-YOUR-APISROUTER-KEY
Models: escolha da lista buscada automaticamente
(ex: claude-sonnet-4-6, kimi-k2.7-code)Como o Kilo Code usa o provider.
O Kilo Code (cerca de 26 mil estrelas no GitHub) é um agente de codificação de IA open-source para o VS Code: ele planeja, edita arquivos, roda comandos, e itera sobre falhas com portões de aprovação, na linhagem do Roo e do Cline. Esse loop tem um formato de tráfego específico: contexto longo entrando, chamadas de ferramenta e diffs saindo, muitos turnos por tarefa, o que faz do modelo por trás tanto a alavanca de qualidade quanto o motor de custo. O provider OpenAI Compatible envia esse loop como chat completions padrão para sua Base URL, com o id do modelo como uma string simples. O formato de conexão não se importa com fornecedores, o que é o que torna possível fazer compras reais de modelo: claude-sonnet-4-6, kimi-k2.7-code, e gpt-5.6-sol são entradas intercambiáveis atrás de um provider, em vez de três contas de fornecedor com três configurações de faturamento. Para ajuste fino por modelo, limites de token, comportamento de chamada de ferramenta, e variantes vivem no arquivo de config kilo.jsonc, que você pode editar diretamente quando um modelo precisa de configurações que a UI não expõe. Defina limites declarados a partir da documentação do modelo, não do otimismo: o agente empacota contexto agressivamente, e uma janela superestimada falha exatamente nas maiores tarefas.
Escolhendo modelos de codificação para o loop do Kilo.
Os modos do Kilo deixam diferentes tipos de trabalho carregarem configurações diferentes, e a forma honesta de explorar isso é empírica: rode a mesma classe de tarefa em dois ids por uma semana, depois leia o gasto por modelo no console do gateway ao lado de quantas vezes você precisou intervir. Loops de agente são a forma mais intensiva em tokens de usar um modelo, então a diferença é mensurável, não impressão.
- claude-sonnet-4-6 é o padrão confiável: uso de ferramenta forte, diffs limpos, e boa recuperação quando um comando falha no meio da tarefa.
- kimi-k2.7-code é a escolha de volume para sessões agênticas longas, ajustado para código e precificado para o loop de muitos turnos que o Kilo de fato roda.
- gpt-5.6-sol serve bem para edições rápidas e delimitadas e execuções de correção de teste, onde a latência por turno molda a sessão.
- claude-opus-4-7 justifica sua taxa em tarefas difíceis: refatorações entre arquivos, trabalho de arquitetura, depuração que precisa do quadro completo em contexto.
- gpt-5.5 é o generalista de ponta para fazer A/B contra Claude no seu próprio repositório em vez de em tabelas de benchmark.
Pague pelo uso · abaixo do preço oficial
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modelo | Preço oficial | Nosso preço |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Modos de falha específicos do Kilo Code.
Depure na ordem padrão: faça curl na listagem de modelos, faça curl em uma completion com o id exato, e só então ajuste as configurações do Kilo. Dois comandos separam problemas de gateway de configuração do editor de forma limpa.
- O seletor de modelo aparece vazio: a Base URL ou a chave está errada, já que o seletor é populado por uma chamada /v1/models ao vivo. Faça curl na listagem com os mesmos valores para confirmar.
- 404 em toda requisição: a Base URL perdeu seu /v1, ou você colou um caminho /chat/completions completo onde uma base pertence. O Kilo aceita URLs de endpoint completas, mas só se apontarem para a rota chat-completions correta.
- Comportamento truncado ou amnésico no fundo de uma tarefa: limites de contexto declarados em kilo.jsonc excedem o que o modelo de fato suporta. Use valores documentados.
- Chamadas de ferramenta narradas em vez de executadas: o id escolhido é fraco em function calling. Rode a tarefa de novo em claude-sonnet-4-6 para separar escolha de modelo de configuração antes de mexer em ajustes.
- Nota específica da Azure vinda da documentação: deploys Azure GPT-5 rejeitam o campo max_tokens que providers personalizados compatíveis com OpenAI enviam, então a Azure deve usar o provider azure nativo do Kilo. Irrelevante para um gateway, mas explica um erro confuso se você testar os dois.
Quem roteia o Kilo Code por um gateway.
- Desenvolvedores que querem Claude conduzindo o agente sem um relacionamento de faturamento separado com a Anthropic, em um saldo pré-pago com início gratuito e sem cartão.
- Compradores de modelo usando o seletor buscado automaticamente para testar ids de codificação em tarefas reais no seu repositório real.
- Usuários pesados combinando um modelo de ponta para trabalho de nível de planejamento com um modelo de volume para sessões de execução longas.
- Times medindo o gasto de agente por desenvolvedor com uso por chave em vez de fazer engenharia reversa de uma conta de fornecedor compartilhada.
- Pessoas que já roteiam outras ferramentas por um gateway e querem o agente do VS Code na mesma chave e log de uso.
Verifique o endpoint e rode a primeira tarefa.
Prove a metade do gateway com curl antes de configurar o editor: liste os modelos, depois envie uma completion com o id que você pretende escolher. Quando ambos passam, tudo o que resta está no formulário do provider. Depois dê ao Kilo uma pequena tarefa real com um objetivo claro e observe os primeiros turnos. Chamadas de ferramenta limpas e edições sensatas significam que o id se encaixa no loop; erros graves mapeiam para os três campos. Assim que as tarefas fluem, o console da APIsRouter mostra modelo, tokens, e gasto por requisição, que é onde uma semana de uso de agente vira um número concreto por modelo.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Perguntas frequentes
Como eu adiciono um provider compatível com OpenAI ao Kilo Code?
Engrenagem de Settings → aba Providers → provider personalizado. Defina Provider API como OpenAI Compatible, Base URL como https://api.apisrouter.com/v1, e cole sua chave. O Kilo então busca automaticamente a lista de modelos de /v1/models e você escolhe ids de uma lista pesquisável.
O Kilo Code pode rodar modelos Claude através desse provider?
Sim. O provider encaminha o id do modelo como uma string simples via chat completions padrão, então claude-sonnet-4-6 e claude-opus-4-7 funcionam da mesma forma que ids GPT, em uma chave, e trocar de fornecedor é uma seleção no seletor.
Por que a lista de modelos está vazia depois de adicionar o provider?
A busca automática é populada por uma chamada /v1/models ao vivo, então uma lista vazia significa que a Base URL ou a chave está errada. Faça curl na listagem com os mesmos valores; se funcionar, reverifique o que você de fato salvou no formulário do provider. Modelos também podem ser adicionados manualmente.
Onde eu defino janela de contexto e limites de token para um modelo personalizado?
Em kilo.jsonc, o arquivo de config do Kilo, que carrega limites de token por modelo, configurações de chamada de ferramenta, e variantes além do que o formulário do provider expõe. Use os valores documentados do modelo; limites superestimados falham nas maiores tarefas.
A chave de API precisa ir no formulário?
O campo de chave é o caminho normal, mas é opcional se você lidar com autenticação através de headers personalizados, que o formulário do provider suporta como pares chave-valor. Para uma configuração de gateway padrão, o campo de chave é a escolha certa.
Como eu sei quanto custa uma semana de Kilo Code?
Leia a visão de uso por chave no console da APIsRouter: tokens e gasto por requisição e por modelo. Tarefas de agente são dezenas de requisições cada, então o log é a única medida honesta do que seu padrão de uso custa.