Open WebUI को एक custom OpenAI-compatible endpoint से connect करें।

Updated 2026-07-29

Open WebUI OpenAI-compatible connections को एक first-class admin setting की तरह treat करता है: Admin Settings के नीचे https://api.apisrouter.com/v1 और एक key के साथ एक connection add करें, और हर catalog model आपके सभी users के लिए model selector में दिखता है, locally जो भी चल रहा है उसके बगल में।

Quick answer: Admin Settings में एक connection।

Admin बनकर, Admin Settings खोलें, Connections पर जाएं, और OpenAI API section के नीचे एक connection add करने के लिए click करें। दो fields matter करती हैं: URL, https://api.apisrouter.com/v1 पर set, और API key। Save करें, और Open WebUI model selector populate करने के लिए endpoint की /v1/models listing query करता है; connection के check control से verify करें, फिर एक नई chat में कोई भी catalog id चुनें। इस तरीके से add की गई connections workspace-wide हैं: आपके Open WebUI instance का हर user models देखता है, आप जो भी model-access controls configure करते हैं उनके subject। यही values deploy time पर environment variables के तौर पर भी ship हो सकती हैं, OPENAI_API_BASE_URL और OPENAI_API_KEY, जो cleaner path है जब instance click करके shape देने की बजाय compose files से provision होता है।

URL:      https://api.apisrouter.com/v1
API Key:  sk-YOUR-APISROUTER-KEY

Save → models auto-populate from /v1/models
(optional) Model IDs allowlist to curate the selector

Open WebUI OpenAI connections कैसे use करता है।

Open WebUI (लगभग 145K GitHub stars) default self-hosted AI chat front end है: users और permissions, RAG और knowledge collections, tool calling, और model management वाला एक full-featured web client, classically local models के लिए Ollama के साथ paired लेकिन remote APIs से बात करने में equally at home। इसका connection model additive है। Ollama section local runtimes cover करता है; OpenAI API section standard chat-completions dialect बोलने वाले किसी भी endpoint को cover करता है, और आप कई connections side by side add कर सकते हैं। हर connection अपनी model list shared selector में contribute करती है, हर एक की अपनी key है, और हर एक को उसकी configuration delete किए बिना toggle off किया जा सकता है। Requests model id को एक plain string के तौर पर जो भी connection उसे serve करती है वहां carry करती हैं। उस design का मतलब है एक gateway connection कुछ भी displace नहीं करती: आपके local models Ollama के through बिना किसी per-token cost के चलते रहते हैं, जबकि claude-sonnet-4-6, gpt-5.5, gemini-3.5-flash, और deepseek-v4-pro उन conversations के लिए selector entries बन जाते हैं जिन्हें frontier quality चाहिए। एक key इन सबको cover करती है, और admin-side usage readable बना रहता है क्योंकि cloud traffic exactly एक जगह से निकलता है।

Deploy-time setup: environment variables।

docker-compose और Kubernetes deployments के लिए, connection manifest का हिस्सा हो सकती है। OPENAI_API_BASE_URL endpoint लेता है और OPENAI_API_KEY key लेता है; instance connection के पहले से मौजूद रहते हुए up आता है। अगर आप एक से ज़्यादा remote source चलाते हैं तो plural forms (semicolon-separated values वाले OPENAI_API_BASE_URLS और OPENAI_API_KEYS) के through कई endpoints support होते हैं। दो operational notes। पहला, UI के through set की गई values Open WebUI के database में persist होती हैं और first boot के बाद environment defaults से precedence लेती हैं, एक documented behavior जो अक्सर उन operators को surprise करता है जो env बदलते हैं और कुछ होता नहीं देखते; Admin Settings में existing connections adjust करें, या अगर आप चाहते हैं कि environment authoritative बना रहे तो ENABLE_PERSISTENT_CONFIG=false set करें। दूसरा, अगर endpoint की model listing बड़ी है, connection के Model IDs allowlist का use करके curate करें कि आपके users क्या देखते हैं; एक four-item selector use होती है, एक two-hundred-item selector scroll हो जाती है। Version note: project की fast release cadence के across menu wording drift हुई है (Settings बनाम Admin Settings, Connections के अंदर section names), तो पुराने builds पर OPENAI API base URL और key pair जहां भी connections रहती हैं वहां देखें।

services:
  open-webui:
    image: ghcr.io/open-webui/open-webui:main
    environment:
      - OPENAI_API_BASE_URL=https://api.apisrouter.com/v1
      - OPENAI_API_KEY=sk-YOUR-APISROUTER-KEY
    ports:
      - "3000:8080"

एक multi-user workspace के लिए models चुनना।

हर cloud model एक key के through bill होने के साथ, A/B testing एक selector choice है। दो हफ्ते अलग same team workload को दो candidate defaults पर run करें और APIsRouter console में per-model usage view को referee करने दें, प्रति model और प्रति day, benchmarks से guess करने की बजाय।

  • एक shared instance में Default-model choice सबसे ज़्यादा काम करती है। claude-haiku-4-5-20251001 या gemini-3.5-flash को workspace default के तौर पर रखना casual use की प्रति-conversation cost flat रखता है।
  • claude-sonnet-4-6 और gpt-5.5 drafting, analysis, और code questions के लिए selector में belong करते हैं; जब task इसके लायक हो users step up करते हैं।
  • RAG pipelines input tokens multiply करती हैं: हर answer retrieved chunks carry करता है। deepseek-v4-pro RAG workhorse के तौर पर test करने लायक है, जहां प्रति token खर्च के हिसाब से long-context handling decisive trait है।
  • सच में private material को Ollama के through local models पर रखें और बाकी सब gateway के through route करें; selector दोनों lanes को honestly hold करता है।
  • Model IDs allowlist को policy की तरह use करें: जो selector में नहीं है वह usage log पर surprise नहीं कर सकता।

जितना उपयोग उतना भुगतान · आधिकारिक मूल्य से कम

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

मॉडलआधिकारिक मूल्यहमारा मूल्य
Claude Haiku 4.5 20251001$1.00 / $5.00 per M$0.80 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M
Gemini 3.5 Flash$1.50 / $9.00 per M$1.20 / $7.20 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

Open WebUI के लिए specific failure modes।

Connection add करने के बाद कोई models न दिखना सबसे common report है। Causes इस order में हैं: key /v1/models के against fail हुई (connection के verify control से check करें), URL में /v1 suffix missing है, या connection toggle off है। Open WebUI selector को उसी से build करता है जो listing return करती है, तो एक empty selector का मतलब है listing call fail हुई या कुछ भी return नहीं हुआ। Environment changes जो ignore होते लगते हैं वही ऊपर describe किया गया persistent-config rule है: first boot के बाद, UI-managed settings के लिए database environment को beat करता है। Connection को Admin Settings में edit करें या explicitly persistent config disable करें। एक model जो list होता है लेकिन chat पर error करता है आमतौर पर एक ऐसी id है जो listing expose करती है लेकिन आपकी key use नहीं कर सकती, या Model IDs allowlist को हाथ से edit करने से आई एक typo है; raw /v1/models output के against compare करें। और debug करते समय lanes साफ़ रखें: Ollama connection problems और OpenAI connection problems chat window से identical दिखते हैं। Connections page दिखाता है कि कोई model किस lane का है; पूरे instance को down मान लेने से पहले failing lane को directly test करें।

कौन Open WebUI को एक gateway के through route करता है।

  • Teams जो सबके लिए एक chat front end self-host करती हैं और individual users को vendor keys issue किए बिना frontier models available चाहती हैं।
  • Ollama users जो private work के लिए local models रखते हैं लेकिन उन conversations के लिए same selector में Claude और GPT quality चाहते हैं जिन्हें इसकी ज़रूरत है।
  • Admins जिन्हें cloud bill legible चाहिए: एक connection, एक key, और चार vendors की receipts की बजाय एक per-model usage log।
  • Operators जिन regions में कुछ vendor sign-ups painful हैं; बिना card requirement वाला top-up based access प्रति provider dependency हटा देता है।
  • Homelabbers जो household के लिए Open WebUI चलाते हैं, जहां एक prepaid balance किसी भी subscription से reason करने में आसान है।

Endpoint verify करें और पहली chat को debug करें।

Server से endpoint prove करें सबसे पहले, especially containerized deployments में जहां container का network आपके laptop का नहीं है। Host के अंदर से एक models listing और एक chat completion Open WebUI picture में आने से पहले gateway half confirm करते हैं। फिर connection add करें और selector populate होते देखें। Authentication errors key field हैं; एक empty selector listing call है; server logs में एक doubled path (/v1/v1/...) का मतलब है URL field पहले से एक /v1 carry करती थी और किसी ने एक और append कर दिया, तो URL को exactly वैसे पढ़ें जैसे save हुआ। एक बार chats flow होने लगें, APIsRouter console प्रति-request model, token counts, और spend दिखाता है। एक multi-user instance के लिए यही वह number है जो matter करती है: आपके users actually कौन से models pick करते हैं, और workspace का एक हफ्ता actually कितना cost करता है, प्रति model, प्रति day, एक page पर।

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-haiku-4-5-20251001",
       "messages":[{"role":"user","content":"ping"}]}'

अक्सर पूछे जाने वाले प्रश्न

Open WebUI में एक custom OpenAI API endpoint कैसे add करूं?

Admin Settings में, Connections खोलें और OpenAI API section के नीचे एक connection add करें: URL https://api.apisrouter.com/v1 plus आपकी key। Save करें और model selector endpoint की /v1/models listing से populate होता है; इसे curate करने के लिए Model IDs allowlist use करें।

क्या URL को /v1 suffix चाहिए?

हां। Open WebUI आपके दिए base URL पर /chat/completions जैसे route paths append करता है, तो सही value https://api.apisrouter.com/v1 है। एक missing suffix एक empty model list के तौर पर दिखता है; एक doubled suffix logs में /v1/v1 404s के तौर पर दिखता है।

क्या मैं Ollama और एक gateway connection एक साथ चला सकता हूं?

हां, और यह standard setup है। Ollama connections और OpenAI API connections अलग sections हैं जो दोनों model selector को feed करते हैं, तो local models और claude-sonnet-4-6 जैसी catalog ids साथ बैठती हैं, हर conversation अपनी lane चुनते हुए।

मेरे environment variable changes क्यों ignore होते हैं?

Open WebUI first boot के बाद settings को अपने database में persist करता है, और persisted values environment defaults से precedence लेती हैं। इसकी बजाय connection को Admin Settings में edit करें, या ENABLE_PERSISTENT_CONFIG=false set करें ताकि restarts के across environment authoritative बना रहे।

क्या सभी users को एक admin connection के models दिखते हैं?

Admin Settings में add की गई connections default रूप से workspace-wide हैं, आपका version जो भी model-access और workspace-permission controls offer करता है उनके subject। Selector को Model IDs allowlist और per-model access settings से curate करें, per-user keys से नहीं।

क्या Open WebUI एक OpenAI connection के through Claude और Gemini तक पहुंच सकता है?

हां। Connection standard chat completions बोलती है और model id को एक plain string के तौर पर forward करती है, तो जो भी id gateway serve करता है वह काम करता है: Claude, Gemini, DeepSeek, और GPT ids सब एक URL और एक key के through।