Запустите приложения Dify на OpenAI-API-compatible эндпоинте.
Updated 2026-07-29
Dify поставляется с провайдером OpenAI-API-compatible именно для этого: установите его из Marketplace, добавьте каждую модель с её id, https://api.apisrouter.com/v1 в качестве API Base URL, и один ключ. Ваши chatflow, агенты и workflow затем работают на любой модели каталога, включая Claude и DeepSeek.
Короткий ответ: установите провайдера, добавьте модели по id.
В Dify откройте Settings и перейдите в Model Provider. Начиная с Dify 1.0 провайдеры — это плагины: найдите OpenAI-API-compatible (издатель langgenius) в списке или установите его из Marketplace, затем нажмите Add Model на его карточке. Диалог заполняется на модель: выберите Model Type (LLM для чат-моделей), введите точный id из каталога в Model Name, вставьте ваш ключ в API Key и установите API Base URL в https://api.apisrouter.com/v1. Оставьте Completion mode на Chat, затем задайте Model context size и Upper bound for max tokens по задокументированным лимитам добавляемого id. Сохраните — и модель появится в списке провайдера, доступная для выбора в выпадающем списке моделей любого приложения. Повторите диалог для каждого нужного id; две минуты на модель, один раз.
Model Type: LLM
Model Name: claude-sonnet-4-6
API Key: sk-YOUR-APISROUTER-KEY
API Base URL: https://api.apisrouter.com/v1
Completion mode: Chat
Model context size: 200000
Upper bound for max tokens: 64000Как Dify общается с совместимым провайдером.
Dify (langgenius на GitHub, около 149K звёзд) — ведущая open-source платформа для LLM-приложений: визуальные workflow, узлы агентов, RAG-пайплайны поверх баз знаний и опубликованные приложения с собственными API-эндпоинтами. Каждый LLM-узел в этом стеке резолвится в модель, зарегистрированную у какого-то провайдера. Провайдер OpenAI-API-compatible намеренно универсален. Каждая добавленная вами модель — это самодостаточная запись: id, эндпоинт, ключ, лимиты, и Dify отправляет стандартные запросы chat-completions на настроенный base url со строкой Model Name в качестве модели. Ничто в запросе не заботится о том, какой вендор обучал модель, так что claude-sonnet-4-6 и deepseek-v4-pro здесь так же валидны, как любой id GPT, и разные модели могут даже указывать на разные эндпоинты, если вам это когда-нибудь понадобится. Регистрация по каждой модели, которая ощущается как трение, — это также поверхность контроля: значения context size и max-tokens, которые вы вводите, — это то, что оркестратор Dify использует для бюджетирования промптов, обрезки истории разговора и валидации настроек узла. Вводите честные числа из документации модели. Завышение контекста даёт запросы, которые эндпоинт отклоняет; занижение тихо обрезает контекст, который ваши RAG-узлы потрудились извлечь.
Поля, которые выполняют реальную работу.
Model Name — это значение, которое идёт в запрос: оно должно совпадать с листингом /v1/models шлюза символ в символ, так как путешествует в каждом запросе. Опциональное отображаемое имя модели только переименовывает её в UI. Completion mode должен оставаться на Chat для каждой модели в текущем каталоге; опция Completion существует для устаревших text-completion эндпоинтов и даёт некорректно сформированные запросы к чат-моделям. Model context size и Upper bound for max tokens — та пара, которую люди проскакивают второпях. Context size — это полное окно модели; upper bound ограничивает, сколько выходных токенов может запросить узел. Dify по умолчанию ставит оба значения в 4096, что далеко ниже того, что поддерживают современные модели, и оставление умолчаний тихо калечит RAG по длинным документам и генерацию длинных текстов. Задавайте их по документации модели, а не по привычке. Селекторы возможностей важны, когда их используют ваши приложения: Vision Support — только для id, принимающих изображение на входе, и настройка function-call должна соответствовать поддержке вызова инструментов моделью, так как на неё полагаются узлы агентов. Неверное заявление о возможности даёт сбой во время выполнения внутри workflow, а это гораздо медленнее отлаживать, чем в этом диалоге. Если ваш workspace также использует модели embedding или rerank, тот же провайдер регистрирует их под собственными записями Model Type на том же base url; убедитесь, что конкретные id обслуживаются эндпоинтом, прежде чем подключать к ним настройки базы знаний.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
# register these ids verbatim as Model Name entriesВыбор моделей для workflow и агентов.
Собственные обзорные страницы Dify показывают токены по приложению, но вид использования по ключу в консоли APIsRouter добавляет разбивку по модели по всем приложениям на одной странице — это и есть число, которое решает, какой id сохранит своё место.
- LLM-узлы workflow — это объём: шаги классификации, извлечения, маршрутизации, суммаризации, срабатывающие на каждом прогоне. claude-haiku-4-5-20251001, gpt-5.4-mini и gemini-3.5-flash держат стоимость прогона стабильной.
- Узлы агентов и сложные шаги рассуждения заслуживают claude-sonnet-4-6, и его надёжное использование инструментов важнее в агентах, чем сырые баллы бенчмарков.
- Узлы ответов RAG несут извлечённый контекст в каждом вызове, так что цена входа доминирует; deepseek-v4-pro стоит протестировать там, где retrieval тяжёлый, а ответы длинные.
- Зарегистрируйте быстрый id и сильный id для одной и той же роли и A/B-тестируйте их по узлам: в Dify смена модели узла — это выпадающий список, а не миграция.
- Опубликованные приложения наследуют выбор моделей своих узлов, так что решение в выпадающем списке, принятое в редакторе, — это юнит-экономика приложения, которое вы поставляете.
Оплата по факту · дешевле официальных цен
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Модель | Официальная цена | Наша цена |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| GPT-5.4 mini | $0.75 / $4.50 per M | $0.60 / $3.60 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Сбои, специфичные именно для Dify.
Отсутствие провайдера в списке означает, что плагин не установлен: начиная с Dify 1.0 провайдер OpenAI-API-compatible поставляется как плагин Marketplace, и свежие self-hosted инстансы стартуют без него. Установите его один раз на workspace. Модель, которая сохраняется, но даёт ошибку при первом использовании, — обычно одна из трёх вещей: Model Name не совпадает с написанием в каталоге, base url без /v1 (Dify добавляет пути маршрута вроде /chat/completions к тому, что вы ввели), либо значения context/max-token за пределами того, что допускает модель. Ошибка проявляется в логе приложения или workflow; исправление — снова в диалоге Add Model. Если узлы агентов падают, а обычные чат-узлы работают, это указывает на настройку возможности function-calling, либо на модель, чьё использование инструментов не соответствует ожиданиям стратегии агента. Сначала протестируйте агентов на claude-sonnet-4-6, чтобы отделить проблемы конфигурации от выбора модели. И на self-hosted инстансах со строгими правилами egress помните: до эндпоинта должен дотянуться контейнер api Dify, а не ваш браузер; curl изнутри этого контейнера быстро решает вопросы связности.
Кто направляет Dify через шлюз.
- Команды, строящие LLM-приложения, которым нужны выбираемые по узлам Claude, GPT, Gemini и DeepSeek без поддержки аккаунта у вендора на каждого провайдера.
- Self-hosters, запускающие Dify для внутренних инструментов, где один ключ у одного провайдера держит все облачные расходы всего workspace в одном логе использования.
- Разработчики, сравнивающие модели на реальных workflow: каждый кандидат — это диалог Add Model и переключение в выпадающем списке, а не новая интеграция.
- Разработчики без доступа к биллингу конкретного вендора. Доступ на основе пополнения без требования карты убирает зависимость от регистрации у каждого провайдера.
- Агентства, поставляющие клиентские приложения на Dify, которым нужны ключи по проектам, чтобы расходы на модели каждого клиента отчитывались сами.
Проверьте эндпоинт и отладьте первый прогон.
Сначала curl'ните листинг моделей и регистрируйте id из его вывода; Model Name, введённые вручную, — главная причина ошибок not-found, так как поле свободнотекстовое. Затем прогоните один chat completion против зарегистрированного id, тем же ключом. Внутри Dify протестируйте в черновом приложении, прежде чем подключать продакшн-workflow: добавьте LLM-узел, выберите новую модель, прогоните один раз. Ошибки аутентификации указывают на поле API Key; not-found — на Model Name; ошибки подключения — на base url или egress контейнера; ошибки длины — на значения context и max-token. Как только прогоны начинают работать, консоль APIsRouter показывает модель на запрос, счётчики токенов и расходы. Workflow умножают вызовы LLM так, что это трудно прикинуть на глаз из редактора, и лог использования — это место, где реальный профиль токенов пятиузлового пайплайна становится видимым, по модели, по дню.
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-4-5-20251001",
"messages":[{"role":"user","content":"ping"}]}'Частые вопросы
Как добавить OpenAI-API-compatible провайдера в Dify?
Settings, Model Provider, затем установите плагин OpenAI-API-compatible из Marketplace, если его нет в списке. Нажмите Add Model на его карточке и зарегистрируйте каждый id с Model Name, API Key и API Base URL https://api.apisrouter.com/v1.
Что контролируют Model context size и Upper bound for max tokens?
Context size сообщает Dify полное окно модели, используемое для бюджетирования промптов и истории; upper bound ограничивает запрашиваемые выходные токены. Оба по умолчанию равны 4096, что слишком мало для современных моделей, так что задавайте их по задокументированным лимитам модели при регистрации.
Может ли Dify работать с Claude или DeepSeek через этого провайдера?
Да. Провайдер отправляет строку Model Name на ваш base url через стандартные chat completions, так что работает любой id, который обслуживает шлюз: claude-sonnet-4-6, deepseek-v4-pro, gemini-3.5-flash и id GPT бок о бок, один ключ на все.
Должен ли API Base URL включать /v1?
Да: https://api.apisrouter.com/v1. Dify добавляет путь маршрута к тому, что вы ввели, так что отсутствующий /v1 даёт ошибки подключения или 404 при первом использовании, а вставка полного пути /chat/completions удваивает маршрут.
Покрывает ли одна настройка все мои приложения Dify?
Модели регистрируются на уровне workspace, так что любое приложение, workflow и агент в workspace могут выбрать их после добавления. Несколько workspace или окружений повторяют настройку, что также позволяет каждому нести свой собственный ключ для раздельной отчётности по использованию.
Почему провайдер OpenAI-API-compatible отсутствует в моём Dify?
Начиная с Dify 1.0 провайдеры моделей поставляются как плагины, и self-hosted инстансы стартуют без установленных плагинов. Откройте Marketplace, установите OpenAI-API-compatible от langgenius, и карточка появится в настройках Model Provider с действием Add Model.