Uruchom aplikacje Dify na endpoincie kompatybilnym z OpenAI-API.
Updated 2026-07-29
Dify udostępnia dostawcę kompatybilnego z OpenAI-API dokładnie do tego: zainstaluj go z Marketplace, dodaj każdy model z jego identyfikatorem, https://api.apisrouter.com/v1 jako API Base URL i jeden klucz. Twoje chatflow, agenci i workflow działają wtedy na dowolnym modelu z katalogu, Claude i DeepSeek włącznie.
Szybka odpowiedź: zainstaluj dostawcę, dodaj modele po identyfikatorze.
W Dify otwórz Settings i przejdź do Model Provider. Od Dify 1.0 dostawcy są wtyczkami: znajdź OpenAI-API-compatible (publikowaną przez langgenius) na liście albo zainstaluj ją z Marketplace, a następnie kliknij Add Model na jej karcie. Okno dialogowe jest per model: wybierz Model Type (LLM dla modeli czatu), wpisz dokładny identyfikator z katalogu w Model Name, wklej swój klucz w API Key i ustaw API Base URL na https://api.apisrouter.com/v1. Zostaw Completion mode na Chat, a następnie ustaw Model context size i Upper bound for max tokens na udokumentowane limity dodawanego identyfikatora. Zapisz, a model pojawi się na liście dostawcy, wybieralny z rozwijanej listy modeli każdej aplikacji. Powtórz okno dialogowe dla każdego identyfikatora, którego chcesz; dwie minuty na model, jednorazowo.
Model Type: LLM
Model Name: claude-sonnet-4-6
API Key: sk-YOUR-APISROUTER-KEY
API Base URL: https://api.apisrouter.com/v1
Completion mode: Chat
Model context size: 200000
Upper bound for max tokens: 64000Jak Dify rozmawia z kompatybilnym dostawcą.
Dify (langgenius na GitHubie, około 149 tys. gwiazdek) to wiodąca open-source'owa platforma aplikacji LLM: wizualne workflow, węzły agentów, pipeline'y RAG na bazach wiedzy i publikowane aplikacje z własnymi endpointami API. Każdy węzeł LLM w tym stosie rozwiązuje się do modelu zarejestrowanego u któregoś dostawcy. Dostawca OpenAI-API-compatible jest celowo generyczny. Każdy dodany model to samodzielny rekord: identyfikator, endpoint, klucz, limity, a Dify wysyła standardowe żądania chat-completions do skonfigurowanego base URL z Twoim Model Name jako stringiem modelu. Nic w żądaniu nie obchodzi, który dostawca trenował model, więc claude-sonnet-4-6 i deepseek-v4-pro są tu tak samo prawidłowe jak dowolny identyfikator GPT, a różne modele mogą nawet wskazywać różne endpointy, jeśli kiedykolwiek tego potrzebujesz. Rejestracja per model, która wydaje się tarciem, jest też powierzchnią kontroli: wartości context size i max-tokens, które wpisujesz, to to, czego orkiestrator Dify używa do budżetowania promptów, przycinania historii rozmowy i walidacji ustawień węzła. Wpisuj uczciwe liczby z dokumentacji modelu. Zawyżenie kontekstu produkuje żądania odrzucane przez endpoint; zaniżenie go po cichu przycina kontekst, który Twoje węzły RAG pracowały, żeby pobrać.
Pola, które faktycznie wykonują pracę.
Model Name to wartość przesyłana na drucie: musi zgadzać się znak w znak z listingiem /v1/models bramki, ponieważ podróżuje w każdym żądaniu. Opcjonalna wyświetlana nazwa modelu tylko przeetykietowuje UI. Completion mode powinien zostać na Chat dla każdego modelu w obecnym katalogu; opcja Completion istnieje dla starszych endpointów text-completion i produkuje źle sformułowane żądania dla modeli czatu. Model context size i Upper bound for max tokens to para, z którą ludzie się śpieszą. Context size to całkowite okno modelu; upper bound ogranicza, ile tokenów wyjściowych może zażądać węzeł. Dify domyślnie ustawia oba na 4096, co jest dużo poniżej tego, co wspierają obecne modele, a pozostawienie domyślnych wartości po cichu okalecza długie RAG-i dokumentowe i długoformowe generowanie. Ustaw je z dokumentacji modelu, nie z przyzwyczajenia. Selektory możliwości mają znaczenie, gdy Twoje aplikacje ich używają: Vision Support tylko dla identyfikatorów akceptujących wejście obrazowe, a ustawienie function-call powinno zgadzać się z obsługą narzędzi przez model, ponieważ węzły agentów na tym polegają. Błędna deklaracja możliwości zawodzi w czasie działania wewnątrz workflow, co jest wolniejszym miejscem do debugowania niż to okno dialogowe. Jeśli Twój workspace używa też modeli embeddingu albo rerank, ten sam dostawca rejestruje je pod własnymi wpisami Model Type względem tego samego base URL; potwierdź, że konkretne identyfikatory są obsługiwane przez endpoint, zanim podłączysz do nich ustawienia bazy wiedzy.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
# register these ids verbatim as Model Name entriesDobór modeli do workflow i agentów.
Własne strony przeglądowe Dify pokazują tokeny per aplikacja, ale widok użycia per klucz w konsoli APIsRouter dodaje podział per model dla wszystkich aplikacji na tej samej stronie, co jest liczbą decydującą, który identyfikator zachowuje swój slot.
- Węzły LLM w workflow to wolumen: kroki klasyfikacji, ekstrakcji, routingu, streszczania odpalane przy każdym uruchomieniu. claude-haiku-4-5-20251001, gpt-5.4-mini i gemini-3.5-flash utrzymują koszt per uruchomienie na płaskim poziomie.
- Węzły agentów i złożone kroki rozumowania zasługują na claude-sonnet-4-6, a jego niezawodne użycie narzędzi ma w agentach większe znaczenie niż surowe wyniki benchmarków.
- Węzły odpowiedzi RAG niosą pobrany kontekst przy każdym wywołaniu, więc cena wejścia dominuje; warto przetestować deepseek-v4-pro tam, gdzie retrieval jest ciężki, a odpowiedzi długie.
- Zarejestruj szybki i silny identyfikator dla tej samej roli i testuj je A/B per węzeł: w Dify przełączenie modelu węzła to rozwijana lista, nie migracja.
- Publikowane aplikacje dziedziczą wybory modeli swoich węzłów, więc decyzja z rozwijanej listy, którą podejmujesz w edytorze, to ekonomika jednostkowa aplikacji, którą wypuszczasz.
Płatność za użycie · poniżej cen oficjalnych
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Cena oficjalna | Nasza cena |
|---|---|---|
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| GPT-5.4 mini | $0.75 / $4.50 per M | $0.60 / $3.60 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Tryby awarii charakterystyczne dla Dify.
Brak dostawcy na liście oznacza, że wtyczka nie jest zainstalowana: od Dify 1.0 dostawca OpenAI-API-compatible dostarczany jest jako wtyczka Marketplace, a świeże instancje self-hosted startują bez niej. Zainstaluj ją raz per workspace. Model, który się zapisuje, ale zawodzi przy pierwszym użyciu, to zwykle jedna z trzech rzeczy: Model Name niezgodny z zapisem w katalogu, base URL bez /v1 (Dify dokleja ścieżki tras, takie jak /chat/completions, do tego, co wpiszesz), albo wartości context/max-token przekraczające to, co akceptuje model. Błąd ujawnia się w logu aplikacji albo workflow; poprawka wraca do okna dialogowego Add Model. Węzły agentów zawodzące, podczas gdy zwykłe węzły czatu działają, wskazują na ustawienie możliwości function-calling albo na model, którego użycie narzędzi nie spełnia oczekiwań strategii agenta. Przetestuj agentów najpierw na claude-sonnet-4-6, żeby oddzielić problemy konfiguracji od wyboru modelu. A na instancjach self-hosted za ścisłymi regułami egress pamiętaj, że to kontener api Dify musi dosięgnąć endpointu, nie Twoja przeglądarka; curl z wewnątrz tego kontenera szybko rozstrzyga kwestie łączności.
Kto kieruje Dify przez bramkę.
- Zespoły budujące aplikacje LLM, które chcą, żeby Claude, GPT, Gemini i DeepSeek były wybieralne per węzeł, bez utrzymywania konta u dostawcy na każdego z osobna.
- Self-hosterzy prowadzący Dify dla narzędzi wewnętrznych, gdzie jeden klucz u jednego dostawcy utrzymuje wydatki chmurowe całego workspace na jednym logu użycia.
- Twórcy porównujący modele na rzeczywistych workflow: każdy kandydat to okno dialogowe Add Model i przełącznik z rozwijanej listy, nie nowa integracja.
- Deweloperzy bez dostępu do rozliczeń danego dostawcy. Dostęp oparty na doładowaniu, bez wymogu karty, usuwa zależność od rejestracji u każdego dostawcy z osobna.
- Agencje wypuszczające aplikacje klienckie na Dify, które potrzebują kluczy per projekt, żeby wydatki modelowe każdego klienta raportowały się same.
Zweryfikuj endpoint i debuguj pierwsze uruchomienie.
Odpytaj curlem listing modeli najpierw i rejestruj identyfikatory z jego wyniku; ręcznie wpisywane Model Name są główną przyczyną błędów not-found, ponieważ pole jest dowolnym tekstem. Potem uruchom jedno chat completion na zarejestrowanym identyfikatorze, tym samym kluczem. Wewnątrz Dify testuj w prowizorycznej aplikacji, zanim podłączysz produkcyjne workflow: dodaj węzeł LLM, wybierz nowy model, uruchom raz. Błędy uwierzytelniania wskazują na pole API Key; not-found na Model Name; błędy połączenia na base URL albo egress kontenera; błędy długości na wartości context i max-token. Gdy uruchomienia już płyną, konsola APIsRouter pokazuje model per żądanie, liczbę tokenów i wydatki. Workflow mnożą wywołania LLM w sposób trudny do oszacowania na oko z edytora, a log użycia to miejsce, gdzie rzeczywisty profil tokenów pięciowęzłowego pipeline'u staje się widoczny, per model, per dzień.
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-4-5-20251001",
"messages":[{"role":"user","content":"ping"}]}'Częste pytania
Jak dodać dostawcę kompatybilnego z OpenAI-API do Dify?
Settings, Model Provider, a następnie zainstaluj wtyczkę OpenAI-API-compatible z Marketplace, jeśli nie jest na liście. Kliknij Add Model na jej karcie i zarejestruj każdy identyfikator z Model Name, API Key i API Base URL https://api.apisrouter.com/v1.
Czym sterują Model context size i Upper bound for max tokens?
Context size mówi Dify o całkowitym oknie modelu, używanym do budżetowania promptów i historii; upper bound ogranicza żądane tokeny wyjściowe. Oba domyślnie wynoszą 4096, co jest za niskie dla obecnych modeli, więc ustaw je z udokumentowanych limitów modelu podczas rejestracji.
Czy Dify może uruchamiać Claude albo DeepSeek przez tego dostawcę?
Tak. Dostawca wysyła string Model Name do Twojego base URL przez standardowe chat completions, więc działa dowolny identyfikator obsługiwany przez bramkę: claude-sonnet-4-6, deepseek-v4-pro, gemini-3.5-flash i identyfikatory GPT obok siebie, jeden klucz dla nich wszystkich.
Czy API Base URL powinien zawierać /v1?
Tak: https://api.apisrouter.com/v1. Dify dokleja ścieżkę trasy do tego, co wpiszesz, więc brak /v1 produkuje błędy połączenia albo 404 przy pierwszym użyciu, a wklejenie pełnej ścieżki /chat/completions dubluje trasę.
Czy jedna konfiguracja obejmuje wszystkie moje aplikacje Dify?
Modele są rejestrowane per workspace, więc każda aplikacja, workflow i agent w workspace mogą je wybrać po dodaniu. Wiele workspace lub środowisk powtarza konfigurację, co też pozwala każdemu nosić własny klucz do osobnego raportowania użycia.
Dlaczego dostawca OpenAI-API-compatible brakuje w moim Dify?
Od Dify 1.0 dostawcy modeli dostarczani są jako wtyczki, a instancje self-hosted startują bez żadnej zainstalowanej. Otwórz Marketplace, zainstaluj OpenAI-API-compatible od langgenius, a karta pojawi się w ustawieniach Model Provider z akcją Add Model.