Ejecuta Kilo Code con cualquier modelo del catálogo vía OpenAI Compatible.

Updated 2026-07-30

Kilo Code trae un flujo de proveedor personalizado hecho para gateways: elige OpenAI Compatible como Provider API, configura Base URL a https://api.apisrouter.com/v1, pega una clave, y Kilo autodetecta la lista de modelos desde /v1/models. Ids de Claude, Kimi y clase Codex se vuelven backends intercambiables para el agente.

Respuesta rápida: una entrada de proveedor personalizado.

Abre los ajustes de Kilo Code con el icono de engranaje, ve a la pestaña Providers, y elige la opción de proveedor personalizado. Dale un Provider ID y un nombre visible, configura Provider API a OpenAI Compatible, Base URL a https://api.apisrouter.com/v1, y pega tu clave. Una vez que la Base URL y la clave son válidas, Kilo consulta el listado /v1/models del endpoint y presenta un selector con búsqueda de cada id disponible, así que eliges claude-sonnet-4-6 o kimi-k2.7-code de una lista en lugar de escribirlo a ciegas. Los modelos también pueden añadirse manualmente, y se admiten cabeceras HTTP personalizadas como pares clave-valor si las necesitas. Guarda, y la siguiente tarea del agente se enruta a través del gateway.

Provider ID:    apisrouter
Display name:   APIsRouter
Provider API:   OpenAI Compatible
Base URL:       https://api.apisrouter.com/v1
API key:        sk-YOUR-APISROUTER-KEY
Models:         pick from the auto-fetched list
                (e.g. claude-sonnet-4-6, kimi-k2.7-code)

Cómo usa Kilo Code el proveedor.

Kilo Code (unas 26K estrellas en GitHub) es un agente de codificación de IA de código abierto para VS Code: planifica, edita archivos, ejecuta comandos, e itera sobre fallos con puertas de aprobación, en el linaje de Roo y Cline. Ese bucle tiene una forma de tráfico específica: contexto largo de entrada, llamadas a herramientas y diffs de salida, muchos turnos por tarea, lo que hace que el modelo que hay detrás sea tanto la palanca de calidad como el motor del coste. El proveedor OpenAI Compatible envía ese bucle como chat completions estándar a tu Base URL, con el id del modelo como un string simple. El formato de transmisión no distingue proveedores, que es lo que hace posible el verdadero comparativo de modelos: claude-sonnet-4-6, kimi-k2.7-code y gpt-5.6-sol son entradas intercambiables detrás de un proveedor, en lugar de tres cuentas de proveedor con tres configuraciones de facturación. Para el ajuste por modelo, los límites de tokens, el comportamiento de uso de herramientas y las variantes viven en el archivo de config kilo.jsonc, que puedes editar directamente cuando un modelo necesita ajustes que la interfaz no expone. Configura los límites declarados a partir de la documentación del modelo, no del optimismo: el agente empaqueta contexto de forma agresiva, y una ventana sobreestimada falla justo en las tareas más grandes.

Elegir modelos de codificación para el bucle de Kilo.

Los modos de Kilo dejan que distintos tipos de trabajo lleven distinta configuración, y la forma honesta de aprovecharlo es empírica: ejecuta la misma clase de tarea con dos ids durante una semana, luego lee el gasto por modelo en la consola del gateway junto a cuántas veces tuviste que intervenir. Los bucles de agente son la forma más intensiva en tokens de usar un modelo, así que la diferencia es medible, no sensaciones.

  • claude-sonnet-4-6 es el valor por defecto confiable: uso de herramientas fuerte, diffs limpios, y buena recuperación cuando un comando falla en medio de una tarea.
  • kimi-k2.7-code es la opción de volumen para sesiones agénticas largas, afinado para código y con precio pensado para el bucle de muchos turnos que Kilo realmente ejecuta.
  • gpt-5.6-sol conviene para ediciones acotadas rápidas y ejecuciones de arreglo de tests donde la latencia por turno da forma a la sesión.
  • claude-opus-4-7 se gana su tarifa en tareas difíciles: refactors entre archivos, trabajo de arquitectura, depuración que necesita la imagen completa en contexto.
  • gpt-5.5 es el generalista de vanguardia para hacer A/B contra Claude en tu propio repositorio en lugar de en tablas de benchmark.

Pago por uso · por debajo del precio oficial

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModeloPrecio oficialNuestro precio
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Opus 4.7$5.00 / $25.00 per M$4.00 / $20.00 per M
Kimi K2.7 Code$0.95 / $4.00 per M$1.00 / $4.00 per M
GPT-5.6 Sol$5.00 / $30.00 per M$4.00 / $24.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M

Modos de fallo específicos de Kilo Code.

Depura en el orden estándar: haz curl al listado de modelos, haz curl a una completion con el id exacto, y solo entonces ajusta los ajustes de Kilo. Dos comandos separan limpiamente los problemas de gateway de la configuración del editor.

  • El selector de modelos aparece vacío: la Base URL o la clave están mal, ya que el selector se llena desde una llamada en vivo a /v1/models. Haz curl al listado con los mismos valores para confirmarlo.
  • 404 en cada petición: la Base URL perdió su /v1, o pegaste una ruta completa /chat/completions donde va una base. Kilo acepta URLs de endpoint completas, pero solo si apuntan a la ruta correcta de chat-completions.
  • Comportamiento truncado o amnésico bien entrado en una tarea: los límites de contexto declarados en kilo.jsonc exceden lo que el modelo realmente soporta. Usa valores documentados.
  • Llamadas a herramientas narradas en lugar de ejecutadas: el id elegido es débil en llamadas de función. Vuelve a correr la tarea en claude-sonnet-4-6 para separar la elección de modelo de la configuración antes de tocar ajustes.
  • Nota específica de Azure de la documentación: los despliegues de Azure GPT-5 rechazan el campo max_tokens que envían los proveedores personalizados compatibles con OpenAI, así que Azure debería usar el proveedor nativo azure de Kilo. Irrelevante para un gateway, pero explica un error confuso si pruebas ambos.

Quién enruta Kilo Code a través de un gateway.

  • Desarrolladores que quieren a Claude impulsando al agente sin una relación de facturación separada con Anthropic, con un saldo prepago y un inicio gratis sin tarjeta.
  • Compradores de modelos que usan el selector autodetectado para probar ids de codificación en tareas reales dentro de su repositorio real.
  • Usuarios intensivos que emparejan un modelo de vanguardia para trabajo de nivel planificación con un modelo de volumen para sesiones de ejecución largas.
  • Equipos que miden el gasto de agente por desarrollador con uso por clave en lugar de aplicar ingeniería inversa a una factura de proveedor compartida.
  • Personas que ya enrutan otras herramientas a través de un gateway y quieren el agente de VS Code en la misma clave y log de uso.

Verifica el endpoint y ejecuta la primera tarea.

Prueba la mitad del gateway con curl antes de configurar el editor: lista los modelos, luego envía una completion con el id que planeas elegir. Cuando ambas pasen, todo lo que queda está en el formulario del proveedor. Luego dale a Kilo una tarea real pequeña con un objetivo claro y observa los primeros turnos. Llamadas a herramientas limpias y ediciones sensatas significan que el id encaja con el bucle; los errores duros se mapean a los tres campos. Una vez que las tareas fluyen, la consola de APIsRouter muestra el modelo por petición, los tokens y el gasto, que es donde una semana de uso de agente se convierte en un número concreto por modelo.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"kimi-k2.7-code",
       "messages":[{"role":"user","content":"ping"}]}'

Preguntas frecuentes

¿Cómo añado un proveedor compatible con OpenAI a Kilo Code?

Icono de ajustes → pestaña Providers → proveedor personalizado. Configura Provider API a OpenAI Compatible, Base URL a https://api.apisrouter.com/v1, y pega tu clave. Kilo entonces autodetecta la lista de modelos desde /v1/models y eliges ids de una lista con búsqueda.

¿Puede Kilo Code correr modelos Claude a través de este proveedor?

Sí. El proveedor reenvía el id del modelo como un string simple sobre chat completions estándar, así que claude-sonnet-4-6 y claude-opus-4-7 funcionan igual que los ids de GPT, en una clave, y cambiar de proveedor es una selección en el selector.

¿Por qué la lista de modelos aparece vacía después de añadir el proveedor?

La autodetección se llena desde una llamada en vivo a /v1/models, así que una lista vacía significa que la Base URL o la clave están mal. Haz curl al listado con los mismos valores; si eso funciona, revisa de nuevo qué guardaste realmente en el formulario del proveedor. Los modelos también pueden añadirse manualmente.

¿Dónde configuro la ventana de contexto y los límites de tokens para un modelo personalizado?

En kilo.jsonc, el archivo de config de Kilo, que lleva límites de tokens por modelo, ajustes de llamadas a herramientas, y variantes más allá de lo que expone el formulario del proveedor. Usa los valores documentados del modelo; límites sobreestimados fallan en las tareas más grandes.

¿Tiene que ir la clave de API en el formulario?

El campo de clave es la ruta normal, pero es opcional si manejas la autenticación a través de cabeceras personalizadas, que el formulario del proveedor admite como pares clave-valor. Para una configuración de gateway estándar, el campo de clave es la elección correcta.

¿Cómo sé cuánto cuesta una semana de Kilo Code?

Lee la vista de uso por clave en la consola de APIsRouter: tokens y gasto por petición y por modelo. Las tareas de agente son docenas de peticiones cada una, así que el log es la única medida honesta de lo que cuesta tu patrón de uso.