Verbind Open WebUI met een aangepast OpenAI-compatibel endpoint.
Updated 2026-07-29
Open WebUI behandelt OpenAI-compatibele verbindingen als een volwaardige admin-instelling: voeg een verbinding toe onder Admin Settings met https://api.apisrouter.com/v1 en één sleutel, en elk catalogusmodel verschijnt in de modelkiezer voor al je gebruikers, naast wat er lokaal draait.
Snel antwoord: één verbinding in Admin Settings.
Open als admin Admin Settings, ga naar Connections, en klik onder de sectie OpenAI API om een verbinding toe te voegen. Twee velden zijn van belang: de URL, ingesteld op https://api.apisrouter.com/v1, en de API-sleutel. Sla op, en Open WebUI bevraagt de /v1/models-lijst van het endpoint om de modelkiezer te vullen; verifieer met de controleknop van de verbinding, en kies dan een willekeurig catalogus-ID in een nieuwe chat. Verbindingen die op deze manier zijn toegevoegd, gelden workspace-breed: elke gebruiker van jouw Open WebUI-instantie ziet de modellen, onderworpen aan welke model-toegangscontroles je ook configureert. Dezelfde waarden kunnen in plaats daarvan ten tijde van deployment als omgevingsvariabelen meegeleverd worden, OPENAI_API_BASE_URL en OPENAI_API_KEY, wat het schonere pad is wanneer de instantie via compose-bestanden wordt geprovisioneerd in plaats van in vorm geklikt.
URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Save → models auto-populate from /v1/models
(optional) Model IDs allowlist to curate the selectorHoe Open WebUI OpenAI-verbindingen gebruikt.
Open WebUI (rond de 145K GitHub-sterren) is de standaard self-hosted AI-chatfrontend: een volwaardige webclient met gebruikers en rechten, RAG en kennisverzamelingen, tool calling, en modelbeheer, klassiek gekoppeld aan Ollama voor lokale modellen maar even goed thuis in het spreken met externe API's. Het verbindingsmodel is additief. De sectie Ollama dekt lokale runtimes; de sectie OpenAI API dekt elk endpoint dat het standaard chat-completions-dialect spreekt, en je kunt meerdere verbindingen naast elkaar toevoegen. Elke verbinding draagt zijn modellijst bij aan de gedeelde kiezer, elk heeft zijn eigen sleutel, en elk kan worden uitgeschakeld zonder zijn configuratie te verwijderen. Verzoeken dragen het model-ID als platte string mee naar welke verbinding het ook bedient. Dat ontwerp betekent dat een gatewayverbinding niets verdringt: je lokale modellen blijven draaien via Ollama zonder kosten per token, terwijl claude-sonnet-4-6, gpt-5.5, gemini-3.5-flash en deepseek-v4-pro kiezersvermeldingen worden voor de gesprekken die frontier-kwaliteit nodig hebben. Eén sleutel dekt ze allemaal, en het gebruik aan adminzijde blijft leesbaar omdat cloudverkeer via precies één plek naar buiten gaat.
Instelling ten tijde van deployment: omgevingsvariabelen.
Voor docker-compose- en Kubernetes-deployments kan de verbinding deel uitmaken van het manifest. OPENAI_API_BASE_URL neemt het endpoint en OPENAI_API_KEY de sleutel; de instantie komt op met de verbinding al aanwezig. Meerdere endpoints worden ondersteund via de meervoudsvormen (OPENAI_API_BASE_URLS en OPENAI_API_KEYS met puntkomma-gescheiden waarden) als je meer dan één externe bron draait. Twee operationele opmerkingen. Ten eerste blijven waarden die via de UI zijn ingesteld, bewaard in de database van Open WebUI en hebben ze voorrang op omgevingsstandaarden na de eerste opstart, een gedocumenteerd gedrag dat operators die de omgeving wijzigen en niets zien gebeuren, regelmatig verrast; pas bestaande verbindingen aan in Admin Settings, of zet ENABLE_PERSISTENT_CONFIG=false als je wilt dat de omgeving gezaghebbend blijft. Ten tweede, als de modellijst van het endpoint groot is, gebruik dan de Model IDs-allowlist van de verbinding om te cureren wat je gebruikers zien; een kiezer met vier items wordt gebruikt, een met tweehonderd items wordt voorbijgescrold. Opmerking over versies: menubewoording is verschoven over het snelle releasetempo van het project (Settings versus Admin Settings, sectienamen binnen Connections), dus zoek op oudere builds naar het paar OpenAI API base URL en sleutel waar verbindingen ook leven.
services:
open-webui:
image: ghcr.io/open-webui/open-webui:main
environment:
- OPENAI_API_BASE_URL=https://api.apisrouter.com/v1
- OPENAI_API_KEY=sk-YOUR-APISROUTER-KEY
ports:
- "3000:8080"Modellen kiezen voor een workspace met meerdere gebruikers.
Met elk cloudmodel dat via één sleutel factureert, is A/B-testen een kiezerskeuze. Draai dezelfde teamworkload twee weken na elkaar op twee kandidaat-standaarden en laat de gebruiksweergave per model in de APIsRouter-console arbiteren, per model en per dag, in plaats van te gokken op basis van benchmarks.
- De keuze van het standaardmodel doet het meeste werk in een gedeelde instantie. claude-haiku-4-5-20251001 of gemini-3.5-flash als workspace-standaard houdt de kosten per gesprek van terloops gebruik vlak.
- claude-sonnet-4-6 en gpt-5.5 horen in de kiezer thuis voor opstellen, analyse en codevragen; gebruikers stappen omhoog wanneer de taak het verdient.
- RAG-pipelines vermenigvuldigen inputtokens: elk antwoord draagt opgehaalde chunks mee. deepseek-v4-pro is het waard om te testen als de RAG-workhorse, waar langecontextverwerking per uitgegeven token de doorslaggevende eigenschap is.
- Houd echt privé materiaal op lokale modellen via Ollama en routeer al het andere via de gateway; de kiezer houdt beide rijstroken eerlijk uit elkaar.
- Gebruik de Model IDs-allowlist als beleid: wat niet in de kiezer staat, kan je niet verrassen op het gebruikslogboek.
Betaal naar gebruik · onder officiële prijzen
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Model | Officiële prijs | Onze prijs |
|---|---|---|
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Faalmodi specifiek voor Open WebUI.
Geen modellen die verschijnen na het toevoegen van de verbinding is de meest gemelde klacht. De oorzaken op volgorde: de sleutel faalde tegen /v1/models (controleer dit met de verificatieknop van de verbinding), de URL mist zijn /v1-suffix, of de verbindingsschakelaar staat uit. Open WebUI bouwt de kiezer op basis van wat de lijst teruggeeft, dus een lege kiezer betekent dat de lijstaanroep is mislukt of niets teruggaf. Omgevingswijzigingen die genegeerd lijken, zijn de bovenstaand beschreven persistent-config-regel: na de eerste opstart wint de database van de omgeving voor instellingen die de UI beheert. Bewerk de verbinding in Admin Settings of schakel persistent config expliciet uit. Een model dat in de lijst staat maar fouten geeft bij chat, is meestal een ID dat de lijst blootlegt maar dat je sleutel niet kan gebruiken, of een tikfout die is geïntroduceerd door de Model IDs-allowlist handmatig te bewerken; vergelijk met de ruwe /v1/models-output. En houd de rijstroken recht bij het debuggen: problemen met Ollama-verbindingen en problemen met OpenAI-verbindingen zien er identiek uit vanuit het chatvenster. De pagina Connections toont tot welke rijstrook een model behoort; test de falende rijstrook rechtstreeks voordat je aanneemt dat de hele instantie plat ligt.
Wie routeert Open WebUI via een gateway.
- Teams die één chatfrontend self-hosten voor iedereen en frontier-modellen beschikbaar willen zonder leverancierssleutels aan individuele gebruikers uit te geven.
- Ollama-gebruikers die lokale modellen aanhouden voor privéwerk maar Claude- en GPT-kwaliteit in dezelfde kiezer willen voor de gesprekken die het nodig hebben.
- Admins die de cloudrekening leesbaar nodig hebben: één verbinding, één sleutel, en een gebruikslogboek per model in plaats van bonnetjes van vier leveranciers.
- Operators in regio's waar sommige leveranciersaanmeldingen pijnlijk zijn; toegang op basis van opwaarderen zonder kaartvereiste verwijdert de afhankelijkheid per provider.
- Homelabbers die Open WebUI draaien voor het huishouden, waar één vooruitbetaald saldo makkelijker te doorgronden is dan welk abonnement dan ook.
Verifieer het endpoint en debug de eerste chat.
Bewijs het endpoint eerst vanaf de server, vooral bij gecontaineriseerde deployments waar het netwerk van de container niet dat van je laptop is. Een modellijst en één chat completion vanuit de host bevestigen de gateway-helft voordat Open WebUI in beeld komt. Voeg dan de verbinding toe en kijk hoe de kiezer wordt gevuld. Authenticatiefouten zitten in het sleutelveld; een lege kiezer is de lijstaanroep; een verdubbeld pad (/v1/v1/...) in serverlogs betekent dat het URL-veld al een /v1 droeg en iets er nog een heeft toegevoegd, dus lees de URL exact zoals opgeslagen. Zodra chats vloeien, toont de APIsRouter-console model per verzoek, tokenaantallen en uitgaven. Voor een instantie met meerdere gebruikers is dit het getal dat ertoe doet: welke modellen je gebruikers daadwerkelijk kiezen, en wat een week van de workspace echt kost, per model, per dag, op één pagina.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-4-5-20251001",
"messages":[{"role":"user","content":"ping"}]}'Veelgestelde vragen
Hoe voeg ik een aangepast OpenAI API-endpoint toe aan Open WebUI?
Open in Admin Settings Connections en voeg een verbinding toe onder de sectie OpenAI API: URL https://api.apisrouter.com/v1 plus je sleutel. Sla op en de modelkiezer wordt gevuld vanuit de /v1/models-lijst van het endpoint; gebruik de Model IDs-allowlist om te cureren.
Heeft de URL het /v1-suffix nodig?
Ja. Open WebUI voegt routepaden zoals /chat/completions toe aan de base-URL die je opgeeft, dus de correcte waarde is https://api.apisrouter.com/v1. Een ontbrekend suffix komt naar voren als een lege modellijst; een verdubbeld suffix komt naar voren als /v1/v1-404's in de logs.
Kan ik Ollama en een gatewayverbinding tegelijk draaien?
Ja, en dat is de standaardinstelling. Ollama-verbindingen en OpenAI API-verbindingen zijn aparte secties die beide de modelkiezer voeden, dus lokale modellen en catalogus-ID's zoals claude-sonnet-4-6 staan naast elkaar, waarbij elk gesprek zijn rijstrook kiest.
Waarom worden mijn wijzigingen aan omgevingsvariabelen genegeerd?
Open WebUI slaat instellingen op in zijn database na de eerste opstart, en opgeslagen waarden hebben voorrang op omgevingsstandaarden. Bewerk de verbinding in plaats daarvan in Admin Settings, of zet ENABLE_PERSISTENT_CONFIG=false zodat de omgeving gezaghebbend blijft over herstarts heen.
Zien alle gebruikers de modellen van een adminverbinding?
Verbindingen die in Admin Settings zijn toegevoegd, gelden standaard workspace-breed, onderworpen aan de model-toegangs- en workspace-rechtencontroles die jouw versie biedt. Cureer de kiezer met de Model IDs-allowlist en toegangsinstellingen per model in plaats van sleutels per gebruiker.
Kan Open WebUI Claude en Gemini bereiken via één OpenAI-verbinding?
Ja. De verbinding spreekt standaard chat completions en stuurt het model-ID als platte string door, dus elk ID dat de gateway bedient werkt: Claude-, Gemini-, DeepSeek- en GPT-ID's allemaal via één URL en één sleutel.