Conecta Open WebUI a un endpoint personalizado compatible con OpenAI.
Updated 2026-07-29
Open WebUI trata las conexiones compatibles con OpenAI como un ajuste de administración de primera clase: añade una conexión en Admin Settings con https://api.apisrouter.com/v1 y una clave, y todos los modelos del catálogo aparecen en el selector de modelos para todos tus usuarios, junto a lo que corra en local.
Respuesta rápida: una conexión en Admin Settings.
Como administrador, abre Admin Settings, ve a Connections, y bajo la sección OpenAI API haz clic para añadir una conexión. Dos campos importan: la URL, configurada en https://api.apisrouter.com/v1, y la clave de API. Guarda, y Open WebUI consulta el listado /v1/models del endpoint para rellenar el selector de modelos; verifica con el control de comprobación de la conexión, y luego elige cualquier id del catálogo en un chat nuevo. Las conexiones añadidas así son para todo el espacio de trabajo: cada usuario de tu instancia de Open WebUI ve los modelos, sujeto a los controles de acceso a modelos que configures. Los mismos valores pueden venir como variables de entorno en el momento del despliegue en lugar de configurarse a golpe de clic, OPENAI_API_BASE_URL y OPENAI_API_KEY, que es la vía más limpia cuando la instancia se aprovisiona con archivos compose en lugar de configurarse manualmente.
URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Save → models auto-populate from /v1/models
(optional) Model IDs allowlist to curate the selectorCómo usa Open WebUI las conexiones de OpenAI.
Open WebUI (con unas 145K estrellas en GitHub) es la interfaz de chat de IA autoalojada por defecto: un cliente web completo con usuarios y permisos, RAG y colecciones de conocimiento, uso de herramientas y gestión de modelos, emparejado clásicamente con Ollama para modelos locales, pero igual de cómodo hablando con APIs remotas. Su modelo de conexiones es aditivo. La sección Ollama cubre los runtimes locales; la sección OpenAI API cubre cualquier endpoint que hable el dialecto estándar de chat completions, y puedes añadir varias conexiones lado a lado. Cada conexión aporta su lista de modelos al selector compartido, cada una tiene su propia clave, y cada una puede desactivarse sin borrar su configuración. Las peticiones llevan el id de modelo como una cadena simple hacia la conexión que lo sirva. Ese diseño hace que una conexión de gateway no desplace nada: tus modelos locales siguen corriendo por Ollama sin coste por token, mientras que claude-sonnet-4-6, gpt-5.5, gemini-3.5-flash y deepseek-v4-pro se convierten en entradas del selector para las conversaciones que necesitan calidad de vanguardia. Una sola clave cubre a todos, y el uso del lado de administración se mantiene legible porque el tráfico en la nube sale por exactamente un sitio.
Configuración en tiempo de despliegue: variables de entorno.
Para despliegues con docker-compose y Kubernetes, la conexión puede formar parte del manifiesto. OPENAI_API_BASE_URL toma el endpoint y OPENAI_API_KEY la clave; la instancia arranca con la conexión ya presente. Se admiten varios endpoints a través de las formas plurales (OPENAI_API_BASE_URLS y OPENAI_API_KEYS con valores separados por punto y coma) si ejecutas más de una fuente remota. Dos notas operativas. Primero, los valores configurados a través de la interfaz persisten en la base de datos de Open WebUI y tienen prioridad sobre los valores por defecto del entorno después del primer arranque, un comportamiento documentado que suele sorprender a operadores que cambian el entorno y no ven ningún efecto; ajusta las conexiones existentes en Admin Settings, o configura ENABLE_PERSISTENT_CONFIG=false si quieres que el entorno siga siendo la autoridad. Segundo, si el listado de modelos del endpoint es grande, usa la lista de permitidos Model IDs de la conexión para curar lo que ven tus usuarios; un selector de cuatro elementos se usa, uno de doscientos se recorre con scroll y se ignora. Nota de versión: la redacción de los menús ha cambiado a lo largo del ritmo de lanzamientos rápido del proyecto (Settings frente a Admin Settings, nombres de sección dentro de Connections), así que en versiones antiguas busca el par de URL base de la API de OpenAI y clave dondequiera que vivan las conexiones.
services:
open-webui:
image: ghcr.io/open-webui/open-webui:main
environment:
- OPENAI_API_BASE_URL=https://api.apisrouter.com/v1
- OPENAI_API_KEY=sk-YOUR-APISROUTER-KEY
ports:
- "3000:8080"Elegir modelos para un espacio de trabajo multiusuario.
Con cada modelo en la nube facturando a través de una sola clave, hacer pruebas A/B es una elección de selector. Ejecuta la misma carga de trabajo del equipo con dos semanas de diferencia sobre dos modelos por defecto candidatos y deja que la vista de uso por modelo en la consola de APIsRouter arbitre, por modelo y por día, en lugar de adivinar a partir de benchmarks.
- La elección del modelo por defecto es lo que más pesa en una instancia compartida. claude-haiku-4-5-20251001 o gemini-3.5-flash como modelo por defecto del espacio de trabajo mantiene plano el coste por conversación del uso casual.
- claude-sonnet-4-6 y gpt-5.5 pertenecen al selector para redacción, análisis y preguntas de código; los usuarios suben de nivel cuando la tarea lo merece.
- Los pipelines de RAG multiplican los tokens de entrada: cada respuesta lleva fragmentos recuperados. deepseek-v4-pro merece probarse como el caballo de batalla del RAG, donde su manejo de contexto largo por token gastado es el rasgo decisivo.
- Mantén el material realmente privado en modelos locales a través de Ollama y enruta todo lo demás por el gateway; el selector sostiene ambos carriles con honestidad.
- Usa la lista de permitidos Model IDs como política: lo que no está en el selector no puede sorprenderte en el registro de uso.
Pago por uso · por debajo del precio oficial
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Modelo | Precio oficial | Nuestro precio |
|---|---|---|
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Modos de fallo específicos de Open WebUI.
Que no aparezca ningún modelo tras añadir la conexión es el reporte más común. Las causas se ordenan así: la clave falló contra /v1/models (revísala con el control de verificación de la conexión), a la URL le falta el sufijo /v1, o el interruptor de la conexión está apagado. Open WebUI construye el selector a partir de lo que devuelve el listado, así que un selector vacío significa que la llamada al listado falló o no devolvió nada. Los cambios de entorno que parecen ignorados son la regla de configuración persistente descrita arriba: tras el primer arranque, la base de datos gana al entorno para los ajustes que gestiona la interfaz. Edita la conexión en Admin Settings, o desactiva la configuración persistente explícitamente. Un modelo que aparece en la lista pero da error al chatear suele ser un id que el listado expone pero tu clave no puede usar, o una errata introducida al editar a mano la lista de permitidos Model IDs; compara contra la salida cruda de /v1/models. Y mantén los carriles claros al depurar: los problemas de conexión de Ollama y los de conexión de OpenAI se ven idénticos desde la ventana de chat. La página de Connections muestra a qué carril pertenece cada modelo; prueba el carril que falla directamente antes de asumir que toda la instancia está caída.
Quién enruta Open WebUI a través de un gateway.
- Equipos que autoalojan una sola interfaz de chat para todos y quieren modelos de vanguardia disponibles sin emitir claves de proveedor a usuarios individuales.
- Usuarios de Ollama que mantienen modelos locales para trabajo privado pero quieren la calidad de Claude y GPT en el mismo selector para las conversaciones que lo necesiten.
- Administradores que necesitan que la factura en la nube sea legible: una conexión, una clave, y un registro de uso por modelo en lugar de recibos de cuatro proveedores.
- Operadores en regiones donde registrarse con algunos proveedores es complicado; el acceso basado en recargas sin necesidad de tarjeta elimina la dependencia por proveedor.
- Aficionados que ejecutan Open WebUI para el hogar, donde un solo saldo prepago es más fácil de gestionar que cualquier suscripción.
Verifica el endpoint y depura el primer chat.
Comprueba primero el endpoint desde el servidor, sobre todo en despliegues en contenedores donde la red del contenedor no es la de tu portátil. Un listado de modelos y una chat completion desde dentro del host confirman la mitad del gateway antes de que Open WebUI entre en escena. Luego añade la conexión y observa cómo se rellena el selector. Los errores de autenticación son el campo de clave; un selector vacío es la llamada al listado; una ruta duplicada (/v1/v1/...) en los registros del servidor significa que el campo de URL ya llevaba un /v1 y algo añadió otro, así que lee la URL exactamente como se guardó. Una vez que los chats fluyen, la consola de APIsRouter muestra el modelo, el recuento de tokens y el gasto por petición. Para una instancia multiusuario esta es la cifra que importa: qué modelos eligen realmente tus usuarios, y cuánto cuesta de verdad una semana del espacio de trabajo, por modelo, por día, en una sola página.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-4-5-20251001",
"messages":[{"role":"user","content":"ping"}]}'Preguntas frecuentes
¿Cómo añado un endpoint personalizado de la API de OpenAI a Open WebUI?
En Admin Settings, abre Connections y añade una conexión bajo la sección OpenAI API: URL https://api.apisrouter.com/v1 más tu clave. Guarda y el selector de modelos se rellena desde el listado /v1/models del endpoint; usa la lista de permitidos Model IDs para curarlo.
¿La URL necesita el sufijo /v1?
Sí. Open WebUI añade rutas como /chat/completions a la URL base que le des, así que el valor correcto es https://api.apisrouter.com/v1. Un sufijo ausente se manifiesta como una lista de modelos vacía; uno duplicado se manifiesta como 404 con /v1/v1 en los registros.
¿Puedo ejecutar Ollama y una conexión de gateway a la vez?
Sí, y es la configuración estándar. Las conexiones de Ollama y las de la API de OpenAI son secciones separadas que alimentan ambas al selector de modelos, así que los modelos locales e ids del catálogo como claude-sonnet-4-6 conviven, y cada conversación elige su carril.
¿Por qué se ignoran mis cambios en las variables de entorno?
Open WebUI guarda la configuración en su base de datos tras el primer arranque, y los valores guardados tienen prioridad sobre los valores por defecto del entorno. Edita la conexión en Admin Settings en su lugar, o configura ENABLE_PERSISTENT_CONFIG=false para que el entorno siga siendo la autoridad entre reinicios.
¿Todos los usuarios ven los modelos de una conexión de administrador?
Las conexiones añadidas en Admin Settings son para todo el espacio de trabajo por defecto, sujetas a los controles de acceso a modelos y permisos de espacio de trabajo que ofrezca tu versión. Cura el selector con la lista de permitidos Model IDs y los ajustes de acceso por modelo en lugar de claves por usuario.
¿Puede Open WebUI alcanzar Claude y Gemini a través de una sola conexión de OpenAI?
Sí. La conexión habla chat completions estándar y reenvía el id de modelo como una cadena simple, así que funciona cualquier id que sirva el gateway: ids de Claude, Gemini, DeepSeek y GPT, todos a través de una sola URL y una sola clave.