Ejecuta Cline con cualquier modelo del catálogo vía OpenAI Compatible.
Updated 2026-07-29
El desplegable de API Provider de Cline incluye OpenAI Compatible para exactamente esto: Base URL https://api.apisrouter.com/v1, una clave y el id de modelo que quieras que impulse al agente. Los ids de Claude, Kimi y clase Codex se vuelven backends de codificación intercambiables, con los modos Plan y Act fijables por separado.
Respuesta rápida: tres campos en los ajustes de Cline.
Abre el panel de Cline en VS Code y haz clic en el engranaje de ajustes. En el desplegable de API Provider elige OpenAI Compatible, y rellena tres campos: Base URL https://api.apisrouter.com/v1, tu clave en API Key, y el id exacto del catálogo en el campo de modelo, por ejemplo claude-sonnet-4-6. Como Cline no puede saber qué es capaz de hacer un endpoint arbitrario, el proveedor expone opciones de configuración de modelo que debes rellenar con honestidad: tamaño de la ventana de contexto, máximo de tokens de salida y flags de capacidad como soporte de imágenes, además de precios opcionales de entrada y salida para que el propio indicador de coste de Cline coincida con la realidad. Configura la ventana y los límites según la documentación del modelo. Guarda, y el agente ejecuta su siguiente tarea a través del gateway; el id se puede cambiar en cualquier momento sin tocar tu flujo de trabajo.
API Provider: OpenAI Compatible
Base URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Model: claude-sonnet-4-6
Model config: context window + max output tokens
from the model's documentation,
image support only if the id has itCómo usa Cline el modelo configurado.
Cline (unas 65K estrellas en GitHub) es el agente de codificación autónomo para VS Code: lee tu base de código, edita archivos, ejecuta comandos de terminal e itera sobre los fallos, con puntos de aprobación humana en el camino. Ese bucle es voraz de modelo de una forma específica: entran contextos largos (árboles de archivos, diffs, salida de terminal), salen llamadas a herramientas y código, con muchos turnos por tarea. El proveedor OpenAI Compatible envía ese bucle como chat completions estándar a tu Base URL con el id de modelo como una cadena plana. El proveedor no le importa al formato de la conexión, y eso es lo que hace que comparar modelos sea algo real aquí: claude-sonnet-4-6, kimi-k2.7-code y gpt-5.6-sol son backends intercambiables detrás de los mismos tres campos, en lugar de tres configuraciones de proveedor separadas con tres cuentas de proveedor. Los flags de capacidad merecen cuidado porque el agente depende de ellos. Cline planifica según lo que declares: activar soporte de imágenes le permite enviar capturas de pantalla a un modelo que quizá no las acepte, y una ventana de contexto exagerada invita a fallos de contexto truncado en lo profundo de tareas largas. Declara lo que dice la documentación del modelo, no lo que esperas.
Plan y Act: dos modos, dos modelos.
Cline divide el trabajo en modo Plan, donde explora la base de código y traza la estrategia sin editar, y modo Act, donde ejecuta. La configuración de la API sigue esa división: con la opción use-different-models activada, los ajustes muestran pestañas por modo y cada modo recuerda su propio proveedor y modelo, cambiando automáticamente al alternar entre ellos. La economía de esa división es la clave. El modo Plan es donde el razonamiento profundo compensa: claude-opus-4-7 o gpt-5.5 leyendo la base de código y escribiendo el enfoque. El modo Act son muchos turnos rápidos de llamadas a herramientas ejecutando un plan que ya existe, exactamente el perfil de kimi-k2.7-code o claude-sonnet-4-6. Como ambos modos se facturan a través de la misma clave de gateway, la combinación es una decisión de ajustes en lugar de un proyecto multiproveedor. Una advertencia honesta del rastreador de issues: la selección de modelo por modo ha tenido asperezas específicamente con el proveedor OpenAI Compatible, incluidos reportes de que el modo Act reutiliza silenciosamente el modelo de Plan. Después de configurar la división, ejecuta una tarea y confirma en el encabezado de la tarea qué modelo sirvió realmente a cada modo, y revisa tu registro de uso; trata la división como verificada solo después de haber visto aparecer ambos ids.
Plan mode: claude-opus-4-7 (read, reason, strategize)
Act mode: kimi-k2.7-code (execute, edit, run, iterate)
verify: run one task, check which id served each mode,
then confirm both ids appear in the usage logElegir modelos de codificación para el bucle del agente.
Los bucles del agente multiplican el gasto de tokens de una forma que el chat nunca hace; una sola tarea de Cline puede ser docenas de peticiones cargando contexto de archivos. Eso hace que la elección de modelo sea medible: corre la misma clase de tarea en dos ids durante una semana y lee el gasto por modelo junto a cuántas veces tuviste que intervenir.
- claude-sonnet-4-6 es la respuesta por defecto para el trabajo en modo Act: llamadas a herramientas fiables, diffs sólidos y suficiente criterio para recuperarse de comandos fallidos.
- kimi-k2.7-code es la opción de volumen para sesiones agénticas largas; afinado para código, rápido y con un precio pensado para el bucle de muchos turnos que Cline realmente ejecuta.
- gpt-5.6-sol se gana un lugar para ediciones acotadas y rápidas y para corridas de arreglo de tests, donde la latencia por turno define cómo se siente la sesión.
- claude-opus-4-7 pertenece al modo Plan en tareas difíciles: cambios de arquitectura, refactorizaciones entre archivos, depuración que necesita ver el panorama completo.
- gpt-5.5 es el generalista fuerte para comparar frente a Claude en modo Plan, en tu propia base de código, no en benchmarks.
Pago por uso · por debajo del precio oficial
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modelo | Precio oficial | Nuestro precio |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Opus 4.7 | $5.00 / $25.00 per M | $4.00 / $20.00 per M |
| Kimi K2.7 Code | $0.95 / $4.00 per M | $1.00 / $4.00 per M |
| GPT-5.6 Sol | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
Modos de fallo específicos de Cline.
Un comportamiento truncado o amnésico avanzada la tarea es la declaración de la ventana de contexto: fíjala a la ventana documentada del modelo, y recuerda que Cline empaqueta contexto de archivos de forma agresiva, así que una ventana exagerada falla justo en las tareas más grandes y molestas. Rarezas en las llamadas a herramientas, ediciones mal formadas o el agente narrando en lugar de actuar suele significar que el id elegido es débil en function calling; cambia a claude-sonnet-4-6 para separar problemas de configuración de la elección de modelo antes de culpar al setup. Los errores duros se mapean con claridad: la autenticación es el campo de la clave; modelo no encontrado es un problema de ortografía del id contra el listado de /v1/models; 404 en cada petición es una Base URL a la que le falta el /v1 o lo duplica. El proveedor añade rutas al base que le des. Y la advertencia por modo, repetida una vez más porque cuesta dinero real cuando se pasa por alto: si configuraste modelos distintos para Plan y Act, verifica que ambos ids realmente sirven a sus modos en una tarea real. Un fallback silencioso al modelo Plan, más caro, en cada turno de Act es justo el tipo de cosa que el registro de uso detecta el primer día y un extracto de tarjeta detecta a fin de mes.
Quién enruta Cline a través de un gateway.
- Desarrolladores que quieren que Claude impulse su agente sin una relación de facturación con Anthropic, con un saldo prepagado y sin tarjeta para empezar.
- Compradores de modelos que comparan modelos de codificación en tareas reales dentro de su propia base de código, donde cada candidato es una edición del campo de modelo.
- Usuarios intensivos de Cline que combinan un modelo Plan costoso con un modelo Act rápido para mantener sesiones largas asequibles sin perder calidad de planificación.
- Equipos que miden el gasto del agente por desarrollador o por proyecto con uso por clave, en lugar de adivinar a partir de una factura de proveedor compartida.
- Desarrolladores que ya enrutan sus herramientas de terminal y editor por un gateway y quieren el agente de VS Code en la misma clave y el mismo registro.
Verifica el endpoint y depura la primera tarea.
Haz curl primero al listado de modelos y a una chat completion, con el id exacto que planeas configurar. Si ambas pasan, la mitad del gateway está lista y todo síntoma restante está en los ajustes del proveedor. Luego dale a Cline una tarea real pequeña, un archivo, un objetivo claro, y observa los primeros turnos. Llamadas a herramientas limpias y ediciones sensatas significan que el id y los flags de capacidad encajan. Los errores se mapean a los tres campos; el comportamiento extraño del agente se mapea a la elección de modelo o a las capacidades declaradas. Si activaste modelos por modo, esta primera tarea es también tu corrida de verificación de la división. Una vez que las tareas fluyen, la consola de APIsRouter muestra el modelo por petición, el recuento de tokens y el gasto. Un bucle de agente es la forma más intensiva en tokens de usar un modelo, y la vista de uso por clave es donde una semana de Cline se convierte en un número concreto, por modelo, por día, por modo si separas claves.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k2.7-code",
"messages":[{"role":"user","content":"ping"}]}'Preguntas frecuentes
¿Cómo uso un endpoint compatible con OpenAI en Cline?
Abre los ajustes de Cline en VS Code, elige OpenAI Compatible en el desplegable de API Provider, y configura Base URL https://api.apisrouter.com/v1, tu clave de API y el id de modelo. Rellena la ventana de contexto y el máximo de tokens de salida según la documentación del modelo.
¿Puede Cline ejecutar modelos de Claude con este proveedor?
Sí. El proveedor reenvía el id de modelo como una cadena plana sobre chat completions estándar, así que claude-sonnet-4-6 y claude-opus-4-7 funcionan exactamente igual que los ids de GPT, una sola clave para todos, y cambiar de proveedor es una edición del campo de modelo.
¿Pueden el modo Plan y el modo Act usar modelos distintos?
Sí. Activa la opción use-different-models en la configuración de la API de Cline y cada modo obtiene su propia pestaña con su propio proveedor y modelo. Aun así, verifica la división en una tarea real: la selección por modo ha tenido asperezas reportadas con el proveedor OpenAI Compatible, incluido que el modo Act reutilice el modelo de Plan.
¿Qué debo configurar para la ventana de contexto y el máximo de tokens de salida?
Los valores documentados del modelo, no valores por defecto ni conjeturas. Cline empaqueta contexto largo de archivos en las peticiones, así que una ventana exagerada falla en las tareas más grandes y una subestimada recorta código fuera del contexto. El máximo de tokens de salida limita cada respuesta, ajustado a lo que permite el id.
¿Por qué Cline se comporta mal en las llamadas a herramientas con algunos modelos?
Los bucles de agente dependen de un function calling fiable, y los ids varían mucho en eso. Si las ediciones salen mal formadas o el agente narra en lugar de actuar, prueba la misma tarea con claude-sonnet-4-6; si corrige el comportamiento, es elección de modelo, no configuración.
¿Cómo sé cuánto cuesta realmente una semana de Cline?
La vista de uso por clave en la consola de APIsRouter muestra tokens y gasto por petición y por modelo. Las tareas de agente son docenas de peticiones cada una, así que el registro es la única medida honesta; el indicador de coste dentro de la app de Cline también ayuda si introduces los campos opcionales de precio.