Ejecuta apps de Dify en un endpoint compatible con la API de OpenAI.

Updated 2026-07-29

Dify incluye un proveedor OpenAI-API-compatible exactamente para esto: instálalo desde el Marketplace, añade cada modelo con su id, https://api.apisrouter.com/v1 como API Base URL, y una sola clave. Tus chatflows, agentes y workflows corren entonces sobre cualquier modelo del catálogo, Claude y DeepSeek incluidos.

Respuesta rápida: instala el proveedor, añade modelos por id.

En Dify, abre Settings y ve a Model Provider. Desde Dify 1.0, los proveedores son plugins: busca OpenAI-API-compatible (publicado por langgenius) en la lista o instálalo desde el Marketplace, y luego haz clic en Add Model en su tarjeta. El diálogo es por modelo: elige el Model Type (LLM para modelos de chat), introduce el id exacto del catálogo en Model Name, pega tu clave en API Key, y configura API Base URL a https://api.apisrouter.com/v1. Deja Completion mode en Chat, y configura Model context size y Upper bound for max tokens a los límites documentados del id que estás añadiendo. Guarda, y el modelo aparece en la lista del proveedor, seleccionable desde el desplegable de modelos de cada app. Repite el diálogo para cada id que quieras; dos minutos por modelo, una sola vez.

Model Type:                LLM
Model Name:                claude-sonnet-4-6
API Key:                   sk-YOUR-APISROUTER-KEY
API Base URL:              https://api.apisrouter.com/v1
Completion mode:           Chat
Model context size:        200000
Upper bound for max tokens: 64000

Cómo habla Dify con un proveedor compatible.

Dify (langgenius en GitHub, unas 149K estrellas) es la plataforma de aplicaciones LLM de código abierto líder: workflows visuales, nodos de agentes, pipelines de RAG sobre bases de conocimiento, y apps publicadas con sus propios endpoints de API. Cada nodo LLM de esa pila se resuelve a un modelo registrado bajo algún proveedor. El proveedor OpenAI-API-compatible es deliberadamente genérico. Cada modelo que añades es un registro autocontenido, id, endpoint, clave, límites, y Dify envía peticiones estándar de chat-completions a la URL base configurada con tu Model Name como el string del modelo. Nada en la petición se preocupa por qué proveedor entrenó el modelo, así que claude-sonnet-4-6 y deepseek-v4-pro son tan válidos aquí como cualquier id de GPT, y distintos modelos pueden incluso apuntar a distintos endpoints si alguna vez lo necesitas. El registro por modelo que se siente como fricción también es la superficie de control: los valores de tamaño de contexto y de max-tokens que introduces son los que usa el orquestador de Dify para presupuestar prompts, recortar el historial de conversación y validar la configuración del nodo. Introduce números honestos de la documentación del modelo. Sobreestimar el contexto produce peticiones que el endpoint rechaza; subestimarlo trunca silenciosamente el contexto que tus nodos de RAG trabajaron para recuperar.

Los campos que hacen trabajo real.

Model Name es el valor de transmisión: debe coincidir carácter por carácter con el listado de /v1/models del gateway, ya que viaja en cada petición. El nombre visual opcional del modelo solo reetiqueta la interfaz. Completion mode debería quedarse en Chat para cada modelo del catálogo actual; la opción Completion existe para endpoints heredados de completado de texto y produce peticiones malformadas contra modelos de chat. Model context size y Upper bound for max tokens son el par que la gente apresura. El tamaño de contexto es la ventana total del modelo; el límite superior tapa cuántos tokens de salida puede pedir un nodo. Dify pone ambos por defecto en 4096, muy por debajo de lo que soportan los modelos actuales, y dejar los valores por defecto lastra silenciosamente el RAG de documentos largos y la generación de formato largo. Configúralos desde la documentación del modelo, no por costumbre. Los selectores de capacidad importan cuando tus apps los usan: Vision Support solo para ids que aceptan entrada de imagen, y el ajuste de function-call para que coincida con el soporte de uso de herramientas del modelo, ya que los nodos de agente dependen de ello. Una afirmación de capacidad incorrecta falla en tiempo de ejecución dentro del workflow, que es un lugar más lento para depurar que este diálogo. Si tu workspace también usa modelos de embedding o rerank, el mismo proveedor los registra bajo sus propias entradas de Model Type contra la misma URL base; confirma que los ids específicos son servidos por el endpoint antes de conectar la configuración de la base de conocimiento a ellos.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
# register these ids verbatim as Model Name entries

Elegir modelos para workflows y agentes.

Las propias páginas de resumen de Dify muestran tokens por app, pero la vista de uso por clave en la consola de APIsRouter añade el desglose por modelo entre todas las apps en la misma página, que es el número que decide qué id conserva el puesto.

  • Los nodos LLM de workflow son volumen: clasificación, extracción, enrutamiento, pasos de resumen que se disparan en cada ejecución. claude-haiku-4-5-20251001, gpt-5.4-mini y gemini-3.5-flash mantienen el coste por ejecución plano.
  • Los nodos de agente y los pasos de razonamiento complejo merecen claude-sonnet-4-6, y su uso fiable de herramientas importa más en agentes que las puntuaciones brutas de benchmark.
  • Los nodos de respuesta de RAG llevan contexto recuperado en cada llamada, así que el precio de entrada domina; deepseek-v4-pro merece probarse donde la recuperación es pesada y las respuestas son largas.
  • Registra un id rápido y uno fuerte para el mismo rol y compáralos por nodo con A/B: en Dify, cambiar el modelo de un nodo es un desplegable, no una migración.
  • Las apps publicadas heredan las elecciones de modelo de sus nodos, así que la decisión de desplegable que tomas en el editor es la economía unitaria de la app que envías.

Pago por uso · por debajo del precio oficial

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModeloPrecio oficialNuestro precio
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Haiku 4.5 20251001$1.00 / $5.00 per M$0.80 / $4.00 per M
GPT-5.4 mini$0.75 / $4.50 per M$0.60 / $3.60 per M
Gemini 3.5 Flash$1.50 / $9.00 per M$1.20 / $7.20 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

Modos de fallo específicos de Dify.

Que el proveedor falte en la lista significa que el plugin no está instalado: desde Dify 1.0 el proveedor OpenAI-API-compatible se distribuye como plugin de Marketplace, y las instancias autoalojadas nuevas empiezan sin él. Instálalo una vez por workspace. Un modelo que se guarda pero da error en el primer uso suele ser una de tres cosas: un Model Name que no coincide con la ortografía del catálogo, una URL base a la que le falta el /v1 (Dify añade rutas como /chat/completions a lo que introduces), o valores de contexto/max-tokens más allá de lo que acepta el modelo. El error aparece en el log de la app o del workflow; el arreglo está de vuelta en el diálogo Add Model. Que los nodos de agente fallen mientras los nodos de chat simples funcionan apunta al ajuste de capacidad de function-calling, o a un modelo cuyo uso de herramientas no cumple lo que espera la estrategia de agente. Prueba los agentes contra claude-sonnet-4-6 primero para separar problemas de configuración de problemas de elección de modelo. Y en instancias autoalojadas detrás de reglas de egreso estrictas, recuerda que es el contenedor api de Dify el que debe alcanzar el endpoint, no tu navegador; un curl desde dentro de ese contenedor resuelve rápido las dudas de conectividad.

Quién enruta Dify a través de un gateway.

  • Equipos que construyen apps LLM y quieren Claude, GPT, Gemini y DeepSeek seleccionables por nodo sin mantener una cuenta de proveedor por cada uno.
  • Autoalojadores que ejecutan Dify para herramientas internas, donde una clave en un proveedor mantiene todo el gasto en la nube del workspace en un solo log de uso.
  • Creadores que comparan modelos en workflows reales: cada candidato es un diálogo Add Model y un cambio de desplegable, no una integración nueva.
  • Desarrolladores sin acceso a la facturación de un proveedor concreto. El acceso mediante recarga sin necesidad de tarjeta elimina la dependencia de registrarse en cada proveedor.
  • Agencias que envían apps de clientes en Dify y necesitan claves por proyecto para que el gasto de modelo de cada cliente se reporte solo.

Verifica el endpoint y depura la primera ejecución.

Haz curl al listado de modelos primero y registra ids desde su salida; los Model Names escritos a mano son la principal causa de errores de no encontrado porque el campo es texto libre. Luego ejecuta una chat completion contra el id que registraste, con la misma clave. Dentro de Dify, prueba en una app de prueba antes de conectar workflows de producción: añade un nodo LLM, selecciona el modelo nuevo, ejecuta una vez. Los errores de autenticación apuntan al campo API Key; no encontrado al Model Name; errores de conexión a la URL base o al egreso del contenedor; errores de longitud a los valores de contexto y max-tokens. Una vez que las ejecuciones fluyen, la consola de APIsRouter muestra el modelo por petición, el recuento de tokens y el gasto. Los workflows multiplican las llamadas LLM de formas difíciles de estimar a ojo desde el editor, y el log de uso es donde se hace visible el perfil real de tokens de un pipeline de cinco nodos, por modelo, por día.

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-haiku-4-5-20251001",
       "messages":[{"role":"user","content":"ping"}]}'

Preguntas frecuentes

¿Cómo añado un proveedor OpenAI-API-compatible a Dify?

Settings, Model Provider, y luego instala el plugin OpenAI-API-compatible desde el Marketplace si no aparece en la lista. Haz clic en Add Model en su tarjeta y registra cada id con Model Name, API Key, y API Base URL https://api.apisrouter.com/v1.

¿Qué controlan Model context size y Upper bound for max tokens?

El tamaño de contexto le dice a Dify la ventana total del modelo, usada para presupuestar prompts e historial; el límite superior tapa los tokens de salida pedidos. Ambos son 4096 por defecto, demasiado bajo para los modelos actuales, así que configúralos según los límites documentados del modelo al registrarlo.

¿Puede Dify ejecutar Claude o DeepSeek a través de este proveedor?

Sí. El proveedor envía el string de Model Name a tu URL base sobre chat completions estándar, así que funciona cualquier id que sirva el gateway: claude-sonnet-4-6, deepseek-v4-pro, gemini-3.5-flash e ids de GPT lado a lado, una clave para todos ellos.

¿La API Base URL debe incluir /v1?

Sí: https://api.apisrouter.com/v1. Dify añade la ruta a lo que introduces, así que un /v1 faltante produce errores de conexión o 404 en el primer uso, y pegar la ruta completa /chat/completions duplica la ruta.

¿Una configuración cubre todas mis apps de Dify?

Los modelos se registran por workspace, así que cada app, workflow y agente del workspace puede seleccionarlos una vez añadidos. Varios workspaces o entornos repiten la configuración, lo que también permite que cada uno lleve su propia clave para reportes de uso separados.

¿Por qué falta el proveedor OpenAI-API-compatible en mi Dify?

Desde Dify 1.0, los proveedores de modelo se distribuyen como plugins, y las instancias autoalojadas empiezan sin ninguno instalado. Abre el Marketplace, instala OpenAI-API-compatible de langgenius, y la tarjeta aparece bajo la configuración de Model Provider con la acción Add Model.