Draai Dify-apps op een OpenAI-API-compatible endpoint.

Updated 2026-07-29

Dify levert precies hiervoor een OpenAI-API-compatible provider: installeer hem vanuit de Marketplace, voeg elk model toe met zijn ID, https://api.apisrouter.com/v1 als API Base URL, en één sleutel. Je chatflows, agents en workflows draaien dan op elk catalogusmodel, Claude en DeepSeek inbegrepen.

Snel antwoord: installeer de provider, voeg modellen toe per ID.

Open in Dify Settings en ga naar Model Provider. Sinds Dify 1.0 zijn providers plugins: zoek OpenAI-API-compatible (uitgegeven door langgenius) in de lijst of installeer het vanuit de Marketplace, klik dan op Add Model op zijn kaart. De dialoog is per model: kies het Model Type (LLM voor chatmodellen), voer het exacte catalogus-ID in bij Model Name, plak je sleutel in API Key, en zet API Base URL op https://api.apisrouter.com/v1. Laat Completion mode op Chat staan, stel dan Model context size en Upper bound for max tokens in op de gedocumenteerde limieten van het ID dat je toevoegt. Sla op, en het model verschijnt in de lijst van de provider, selecteerbaar vanuit de modeldropdown van elke app. Herhaal de dialoog voor elk ID dat je wilt; twee minuten per model, eenmalig.

Model Type:                LLM
Model Name:                claude-sonnet-4-6
API Key:                   sk-YOUR-APISROUTER-KEY
API Base URL:              https://api.apisrouter.com/v1
Completion mode:           Chat
Model context size:        200000
Upper bound for max tokens: 64000

Hoe Dify praat met een compatibele provider.

Dify (langgenius op GitHub, ruim 149K sterren) is het toonaangevende open-source LLM-app-platform: visuele workflows, agent-nodes, RAG-pipelines over kennisbanken, en gepubliceerde apps met hun eigen API-endpoints. Elke LLM-node in die stack herleidt zich tot een model dat onder een provider is geregistreerd. De OpenAI-API-compatible provider is bewust generiek. Elk model dat je toevoegt is een op zichzelf staande vermelding, ID, endpoint, sleutel, limieten, en Dify stuurt standaard chat-completions-verzoeken naar de geconfigureerde base URL met je Model Name als model-string. Niets in het verzoek maakt uit welke leverancier het model heeft getraind, dus claude-sonnet-4-6 en deepseek-v4-pro zijn hier net zo geldig als elk GPT-ID, en verschillende modellen kunnen zelfs naar verschillende endpoints wijzen als je dat ooit nodig hebt. De registratie per model die als wrijving aanvoelt, is ook het besturingsoppervlak: de context size- en max-tokens-waarden die je invoert, zijn wat de orchestrator van Dify gebruikt om prompts te budgetteren, gespreksgeschiedenis te knippen, en node-instellingen te valideren. Voer eerlijke getallen in uit de documentatie van het model. Een te hoge context produceert verzoeken die het endpoint weigert; een te lage waarde knipt stilletjes de context weg die je RAG-nodes hebben opgehaald.

De velden die echt werk doen.

Model Name is de wire-waarde: het moet karakter voor karakter overeenkomen met de /v1/models-lijst van de gateway, aangezien het in elk verzoek meereist. De optionele model-weergavenaam relabelt alleen de UI. Completion mode moet voor elk model in de huidige catalogus op Chat blijven staan; de Completion-optie bestaat voor verouderde text-completion-endpoints en produceert misvormde verzoeken tegen chatmodellen. Model context size en Upper bound for max tokens zijn het paar dat mensen overhaasten. Context size is het totale venster van het model; de upper bound begrenst hoeveel outputtokens een node mag aanvragen. Dify zet beide standaard op 4096, wat ver onder is van wat huidige modellen ondersteunen, en de standaarden laten staan verlamt stilletjes lange RAG en lange generatie. Stel ze in vanuit de modeldocumentatie, niet vanuit gewoonte. De capaciteitsselectors doen ertoe wanneer je apps ze gebruiken: Vision Support alleen voor ID's die beeldinvoer accepteren, en de function-call-instelling om overeen te komen met de tool-use-ondersteuning van het model, aangezien agent-nodes ervan afhangen. Een verkeerde capaciteitsclaim faalt tijdens runtime binnen de workflow, wat een tragere plek is om te debuggen dan deze dialoog. Als je workspace ook embedding- of rerank-modellen gebruikt, registreert dezelfde provider ze onder hun eigen Model Type-vermeldingen tegen dezelfde base URL; bevestig dat de specifieke ID's door het endpoint worden bediend voordat je kennisbank-instellingen ernaar verwijst.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
# register these ids verbatim as Model Name entries

Modellen kiezen voor workflows en agents.

De eigen overzichtspagina's van Dify tonen tokens per app, maar de gebruiksweergave per sleutel in de APIsRouter-console voegt de per-model-splitsing toe over alle apps op dezelfde pagina, wat het getal is dat beslist welk ID de plek behoudt.

  • Workflow-LLM-nodes zijn volume: classificatie-, extractie-, routerings- en samenvattingsstappen die bij elke run afvuren. claude-haiku-4-5-20251001, gpt-5.4-mini en gemini-3.5-flash houden de kosten per run vlak.
  • Agent-nodes en complexe redeneerstappen verdienen claude-sonnet-4-6, en zijn betrouwbare tool use doet er in agents meer toe dan ruwe benchmarkscores.
  • RAG-antwoordnodes dragen opgehaalde context bij elke aanroep, dus inputprijs domineert; deepseek-v4-pro is het waard om te testen waar retrieval zwaar is en antwoorden lang zijn.
  • Registreer een snel ID en een sterk ID voor dezelfde rol en A/B ze per node: in Dify is het wisselen van het model van een node een dropdown, geen migratie.
  • Gepubliceerde apps erven de modelkeuzes van hun nodes, dus de dropdown-beslissing die je in de editor maakt, is de unit economics van de app die je uitbrengt.

Betaal naar gebruik · onder officiële prijzen

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

ModelOfficiële prijsOnze prijs
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
Claude Haiku 4.5 20251001$1.00 / $5.00 per M$0.80 / $4.00 per M
GPT-5.4 mini$0.75 / $4.50 per M$0.60 / $3.60 per M
Gemini 3.5 Flash$1.50 / $9.00 per M$1.20 / $7.20 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

Faalmodi specifiek voor Dify.

Ontbrekende provider in de lijst betekent dat de plugin niet is geïnstalleerd: sinds Dify 1.0 levert de OpenAI-API-compatible provider als Marketplace-plugin, en verse self-hosted instanties starten zonder hem. Installeer hem eenmaal per workspace. Een model dat opslaat maar fouten geeft bij eerste gebruik is meestal een van drie dingen: een Model Name die niet overeenkomt met de catalogusspelling, een base URL zonder zijn /v1 (Dify voegt routepaden zoals /chat/completions toe aan wat je invoert), of context/max-token-waarden die verder gaan dan wat het model accepteert. De fout verschijnt in het app- of workflowlogboek; de oplossing zit terug in de Add Model-dialoog. Agent-nodes die falen terwijl gewone chatnodes werken, wijzen naar de function-calling-capaciteitsinstelling, of naar een model wiens tool use niet voldoet aan wat de agentstrategie verwacht. Test agents eerst tegen claude-sonnet-4-6 om configuratieproblemen van modelkeuze te scheiden. En op self-hosted instanties achter strikte egress-regels, onthoud dat het de Dify-api-container is die het endpoint moet bereiken, niet je browser; een curl vanuit die container beslecht connectiviteitsvragen snel.

Wie routeert Dify via een gateway.

  • Teams die LLM-apps bouwen en Claude, GPT, Gemini en DeepSeek per node selecteerbaar willen zonder een leveranciersaccount per provider te onderhouden.
  • Self-hosters die Dify draaien voor interne tools, waar één sleutel in één provider de cloud-uitgaven van de hele workspace op één gebruikslogboek houdt.
  • Bouwers die modellen vergelijken op echte workflows: elke kandidaat is een Add Model-dialoog en een dropdown-wissel, geen nieuwe integratie.
  • Developers zonder toegang tot de facturering van een bepaalde leverancier. Toegang op basis van opwaarderen zonder kaartvereiste verwijdert de aanmeldingsafhankelijkheid per provider.
  • Bureaus die klant-apps op Dify uitbrengen en per-project-sleutels nodig hebben zodat de modeluitgaven van elke klant zichzelf rapporteren.

Verifieer het endpoint en debug de eerste run.

Curl eerst de modellenlijst en registreer ID's uit de output; handmatig getypte Model Names zijn de belangrijkste oorzaak van not-found-fouten omdat het veld vrije tekst is. Draai dan één chat completion tegen het ID dat je registreerde, met dezelfde sleutel. Test in Dify in een scratch-app voordat je productieworkflows bekabelt: voeg een LLM-node toe, selecteer het nieuwe model, draai eenmaal. Authenticatiefouten wijzen naar het API Key-veld; not-found naar Model Name; verbindingsfouten naar de base URL of container-egress; lengtefouten naar de context- en max-token-waarden. Zodra runs vloeien, toont de APIsRouter-console model per verzoek, tokenaantallen en uitgaven. Workflows vermenigvuldigen LLM-aanroepen op manieren die moeilijk te overzien zijn vanuit de editor, en het gebruikslogboek is waar het echte tokenprofiel van een vijf-nodes-pipeline zichtbaar wordt, per model, per dag.

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-haiku-4-5-20251001",
       "messages":[{"role":"user","content":"ping"}]}'

Veelgestelde vragen

Hoe voeg ik een OpenAI-API-compatible provider toe aan Dify?

Settings, Model Provider, installeer dan de OpenAI-API-compatible plugin vanuit de Marketplace als hij niet in de lijst staat. Klik op Add Model op zijn kaart en registreer elk ID met Model Name, API Key, en API Base URL https://api.apisrouter.com/v1.

Wat regelen Model context size en Upper bound for max tokens?

Context size vertelt Dify het totale venster van het model, gebruikt om prompts en geschiedenis te budgetteren; de upper bound begrenst gevraagde outputtokens. Beide staan standaard op 4096, wat te laag is voor huidige modellen, dus stel ze in vanuit de gedocumenteerde limieten van het model wanneer je het registreert.

Kan Dify Claude of DeepSeek draaien via deze provider?

Ja. De provider stuurt de Model Name-string naar je base URL over standaard chat completions, dus elk ID dat de gateway bedient werkt: claude-sonnet-4-6, deepseek-v4-pro, gemini-3.5-flash en GPT-ID's naast elkaar, één sleutel voor allemaal.

Moet de API Base URL /v1 bevatten?

Ja: https://api.apisrouter.com/v1. Dify voegt het routepad toe aan wat je invoert, dus een ontbrekende /v1 produceert verbindings- of 404-fouten bij eerste gebruik, en het plakken van het volledige /chat/completions-pad verdubbelt de route.

Dekt één configuratie al mijn Dify-apps?

Modellen worden per workspace geregistreerd, dus elke app, workflow en agent in de workspace kan ze selecteren zodra ze zijn toegevoegd. Meerdere workspaces of omgevingen herhalen de instelling, wat ook elk zijn eigen sleutel geeft voor aparte gebruiksrapportage.

Waarom ontbreekt de OpenAI-API-compatible provider in mijn Dify?

Sinds Dify 1.0 leveren modelproviders als plugins, en self-hosted instanties starten zonder installaties. Open de Marketplace, installeer OpenAI-API-compatible van langgenius, en de kaart verschijnt onder de Model Provider-instellingen met de Add Model-actie.