Rode o Cline em qualquer modelo do catálogo via OpenAI Compatible.

Updated 2026-07-29

O menu API Provider do Cline inclui OpenAI Compatible exatamente para isso: Base URL https://api.apisrouter.com/v1, uma chave, e o id de modelo que você quer dirigindo o agente. Ids Claude, Kimi e classe Codex se tornam backends de codificação intercambiáveis, com os modos Plan e Act cada um fixável.

Resposta rápida: três campos nas configurações do Cline.

Abra o painel do Cline no VS Code e clique na engrenagem de configurações. No menu API Provider escolha OpenAI Compatible, depois preencha três campos: Base URL https://api.apisrouter.com/v1, sua chave em API Key, e o id exato do catálogo no campo de modelo, por exemplo claude-sonnet-4-6. Como o Cline não pode saber o que um endpoint arbitrário e seu modelo conseguem fazer, o provider expõe opções de configuração de modelo que você deve preencher com honestidade: tamanho da janela de contexto, máximo de tokens de saída, e flags de capacidade como suporte a imagem, além de preços opcionais de entrada e saída para que a exibição de custo do próprio Cline corresponda à realidade. Defina a janela e os limites a partir da documentação do modelo. Salve, e o agente roda sua próxima tarefa pelo gateway; o id é trocável a qualquer momento sem tocar no seu fluxo de trabalho.

API Provider:  OpenAI Compatible
Base URL:      https://api.apisrouter.com/v1
API Key:       sk-YOUR-APISROUTER-KEY
Model:         claude-sonnet-4-6

Model config:  janela de contexto + máximo de tokens de saída
               a partir da documentação do modelo,
               suporte a imagem só se o id tiver isso

Como o Cline usa o modelo configurado.

O Cline (cerca de 65 mil estrelas no GitHub) é o agente de codificação autônomo para o VS Code: ele lê seu código, edita arquivos, roda comandos de terminal, e itera sobre falhas, com portões de aprovação humana no caminho. Esse loop tem fome de modelo de uma forma específica: contextos longos (árvores de arquivo, diffs, saída de terminal) entrando, tool calls e código saindo, muitos turnos por tarefa. O provider OpenAI Compatible envia esse loop como chat completions padrão para sua Base URL com o id de modelo como uma string simples. O fornecedor não importa para o formato de conexão, o que é o que torna a comparação de modelo real aqui: claude-sonnet-4-6, kimi-k2.7-code e gpt-5.6-sol são backends intercambiáveis atrás dos mesmos três campos, em vez de três configurações de provider separadas com três contas de fornecedor. As flags de capacidade merecem cuidado porque o agente depende delas. O Cline planeja em torno do que você declara: suporte a imagem habilitado deixa que ele envie screenshots para um modelo que talvez não os aceite, e uma janela de contexto superestimada convida a falhas de contexto truncado no meio de tarefas longas. Declare o que a documentação do modelo diz, não o que você espera.

Plan e Act: dois modos, dois modelos.

O Cline divide o trabalho em modo Plan, onde ele explora o código e estrategiza sem editar, e modo Act, onde ele executa. A configuração de API segue a divisão: com a opção use-different-models habilitada, as configurações mostram abas por modo e cada modo lembra seu próprio provider e modelo, trocando automaticamente conforme você alterna. A economia da divisão é o ponto central. O modo Plan é onde o raciocínio profundo compensa: claude-opus-4-7 ou gpt-5.5 lendo o código e escrevendo a abordagem. O modo Act são muitos turnos rápidos de tool-calling executando um plano que já existe, que é exatamente o perfil de kimi-k2.7-code ou claude-sonnet-4-6. Como os dois modos são cobrados pela mesma chave de gateway, a combinação é uma escolha de configuração em vez de um projeto multi-fornecedor. Uma ressalva honesta do issue tracker: a seleção de modelo por modo teve arestas específicas com o provider OpenAI Compatible, incluindo relatos do modo Act reusando silenciosamente o modelo do Plan. Depois de configurar a divisão, rode uma tarefa e confirme no cabeçalho da tarefa qual modelo de fato serviu cada modo, e verifique seu log de uso; trate a divisão como verificada só depois de ter visto os dois ids aparecerem.

Modo Plan:  claude-opus-4-7      (ler, raciocinar, estrategizar)
Modo Act:   kimi-k2.7-code       (executar, editar, rodar, iterar)

verificar: rode uma tarefa, confira qual id serviu cada modo,
depois confirme que os dois ids aparecem no log de uso

Escolhendo modelos de codificação para o loop do agente.

Loops de agente multiplicam o gasto de token de formas que o chat nunca faz; uma única tarefa do Cline pode ser dezenas de requisições carregando contexto de arquivo. Isso torna a escolha de modelo mensurável: rode a mesma classe de tarefa em dois ids por uma semana e leia o gasto por modelo ao lado de quantas vezes você precisou intervir.

  • claude-sonnet-4-6 é a resposta padrão para trabalho no modo Act: tool calling confiável, diffs fortes, e julgamento suficiente para se recuperar de comandos falhos.
  • kimi-k2.7-code é a escolha de volume para sessões agênticas longas; ajustado para código, rápido, e precificado para o loop de muitos turnos que o Cline de fato roda.
  • gpt-5.6-sol ganha um lugar para edições rápidas e delimitadas e execuções de correção de teste, onde a latência por turno molda como a sessão parece.
  • claude-opus-4-7 pertence ao modo Plan em tarefas difíceis: mudanças de arquitetura, refatorações entre arquivos, depuração que precisa do quadro completo.
  • gpt-5.5 é o generalista forte para testar em A/B contra o Claude no modo Plan no seu próprio código, não em benchmarks.

Pague pelo uso · abaixo do preço oficial

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModeloPreço oficialNosso preço
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Modos de falha específicos do Cline.

Comportamento truncado ou amnésico no meio de uma tarefa é a declaração da janela de contexto: defina-a para a janela documentada do modelo, e lembre que o Cline empacota contexto de arquivo de forma agressiva, então uma janela superestimada falha exatamente nas tarefas maiores e mais irritantes. Estranheza em tool calls, edições malformadas, ou o agente narrando em vez de agir geralmente significa que o id escolhido é fraco em function calling; troque para claude-sonnet-4-6 para separar problemas de configuração de escolha de modelo antes de culpar a configuração. Erros graves mapeiam de forma limpa: autenticação é o campo da chave; modelo não encontrado é grafia do id contra a listagem /v1/models; 404s em toda requisição são uma Base URL sem o /v1 ou com ele duplicado. O provider anexa caminhos de rota à base que você fornece. E a ressalva por modo, repetida uma vez, porque custa dinheiro real quando ignorada: se você configurou modelos diferentes para Plan e Act, verifique que os dois ids de fato servem seus modos em uma tarefa ao vivo. Um fallback silencioso para o modelo caro do Plan em todo turno do Act é exatamente o tipo de coisa que o log de uso pega no primeiro dia e um extrato de cartão pega no fim do mês.

Quem roteia o Cline por um gateway.

  • Desenvolvedores que querem o Claude dirigindo seu agente sem uma relação de faturamento com a Anthropic, em um saldo pré-pago sem cartão para começar.
  • Compradores de modelo comparando modelos de codificação em tarefas reais no seu código real, onde cada candidato é uma edição no campo de modelo.
  • Usuários pesados do Cline combinando um modelo de Plan caro com um modelo de Act rápido para manter sessões longas acessíveis sem perder qualidade de planejamento.
  • Times medindo gasto de agente por desenvolvedor ou por projeto com uso por chave, em vez de adivinhar a partir de uma conta de fornecedor compartilhada.
  • Desenvolvedores que já roteiam ferramentas de terminal e editor por um gateway e querem o agente do VS Code na mesma chave e no mesmo log.

Verifique o endpoint e depure a primeira tarefa.

Faça curl na listagem de modelos e em uma chat completion primeiro, com o id exato que você planeja configurar. Os dois passando significa que a metade do gateway está pronta e todo sintoma restante está nas configurações do provider. Depois dê ao Cline uma tarefa real pequena, um arquivo, objetivo claro, e observe os primeiros turnos. Tool calls limpas e edições sensatas significam que o id e as flags de capacidade se encaixam. Erros mapeiam para os três campos; comportamento estranho do agente mapeia para escolha de modelo ou capacidades declaradas. Se você habilitou modelos por modo, essa primeira tarefa também é sua execução de verificação da divisão. Assim que as tarefas fluem, o console da APIsRouter mostra modelo, contagens de token e gasto por requisição. Um loop de agente é a forma mais intensiva em token de usar um modelo, e a visão de uso por chave é onde uma semana de Cline vira um número concreto, por modelo, por dia, por modo se você dividir chaves.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Perguntas frequentes

Como eu uso um endpoint compatível com OpenAI com o Cline?

Abra as configurações do Cline no VS Code, escolha OpenAI Compatible no menu API Provider, e defina Base URL https://api.apisrouter.com/v1, sua chave de API, e o id do modelo. Preencha a janela de contexto e o máximo de tokens de saída a partir da documentação do modelo.

O Cline pode rodar modelos Claude por esse provider?

Sim. O provider encaminha o id do modelo como uma string simples por chat completions padrão, então claude-sonnet-4-6 e claude-opus-4-7 funcionam exatamente como ids GPT, uma chave para todos eles, e trocar de fornecedor é uma edição no campo de modelo.

O modo Plan e o modo Act podem usar modelos diferentes?

Sim. Habilite a opção use-different-models na configuração de API do Cline e cada modo ganha sua própria aba com seu próprio provider e modelo. Verifique a divisão em uma tarefa ao vivo, porém: a seleção por modo teve arestas relatadas com o provider OpenAI Compatible, incluindo o modo Act reusando o modelo do Plan.

O que devo definir para janela de contexto e máximo de tokens de saída?

Os valores documentados do modelo, não padrões ou esperanças. O Cline empacota contexto longo de arquivo nas requisições, então uma janela superestimada falha nas maiores tarefas e uma subestimada corta código do contexto. O máximo de tokens de saída limita cada resposta, dimensionado pelo que o id permite.

Por que o Cline se comporta mal em tool calls com alguns modelos?

Loops de agente dependem de function calling confiável, e os ids variam bastante nisso. Se as edições saem malformadas ou o agente narra em vez de agir, teste a mesma tarefa em claude-sonnet-4-6; se isso corrige o comportamento, é escolha de modelo, não configuração.

Como eu sei quanto uma semana de Cline realmente custa?

A visão de uso por chave no console da APIsRouter mostra tokens e gasto por requisição e por modelo. Tarefas de agente são dezenas de requisições cada, então o log é a única medida honesta; a exibição de custo do próprio Cline também ajuda se você preencher os campos opcionais de preço.