חברו את Open WebUI ל-endpoint מותאם אישית תואם OpenAI.

Updated 2026-07-29

Open WebUI מתייחס לחיבורי OpenAI-compatible כהגדרת ניהול ממדרגה ראשונה: הוסיפו חיבור תחת Admin Settings עם https://api.apisrouter.com/v1 ומפתח אחד, וכל מודל בקטלוג מופיע בבורר המודל עבור כל המשתמשים שלכם, לצד כל מה שרץ מקומית.

תשובה מהירה: חיבור אחד ב-Admin Settings.

כמנהל, פתחו את Admin Settings, עברו ל-Connections, ותחת סעיף ה-OpenAI API לחצו כדי להוסיף חיבור. שני שדות חשובים: ה-URL, מוגדר ל-https://api.apisrouter.com/v1, ומפתח ה-API. שמרו, ו-Open WebUI שואל את רשימת ה-/v1/models של ה-endpoint כדי לאכלס את בורר המודל; אמתו עם בקרת הבדיקה של החיבור, ואז בחרו כל id מהקטלוג בצ'אט חדש. חיבורים שנוספו בדרך הזו הם ברמת-מרחב-העבודה: כל משתמש ב-instance של Open WebUI שלכם רואה את המודלים, כפוף לכל בקרות גישת-מודל שתגדירו. אותם ערכים יכולים להישלח כמשתני סביבה בזמן הפריסה במקום זאת, OPENAI_API_BASE_URL ו-OPENAI_API_KEY, שזה המסלול הנקי יותר כש-instance מסופק על ידי קבצי compose ולא מוקלק לצורה.

URL:      https://api.apisrouter.com/v1
API Key:  sk-YOUR-APISROUTER-KEY

Save → models auto-populate from /v1/models
(optional) Model IDs allowlist to curate the selector

איך Open WebUI משתמש בחיבורי OpenAI.

Open WebUI (בערך 145K כוכבי GitHub) הוא חזית ה-AI-chat העצמאית ברירת המחדל: קליינט web מלא-פיצ'רים עם משתמשים והרשאות, RAG ואוספי ידע, קריאת כלים, וניהול מודלים, מוצמד קלאסית ל-Ollama למודלים מקומיים אבל בבית בדיוק כמו זה בדיבור עם APIs מרוחקים. מודל החיבורים שלו הוא תוספתי. סעיף ה-Ollama מכסה runtimes מקומיים; סעיף ה-OpenAI API מכסה כל endpoint שמדבר את הדיאלקט הסטנדרטי של chat-completions, ואתם יכולים להוסיף כמה חיבורים זה לצד זה. כל חיבור תורם את רשימת המודלים שלו לבורר המשותף, לכל אחד יש מפתח משלו, וכל אחד ניתן לכיבוי בלי למחוק את ההגדרה שלו. בקשות נושאות את id המודל כמחרוזת פשוטה לכל חיבור שמשרת אותו. העיצוב הזה אומר שחיבור gateway לא מעיף שום דבר: המודלים המקומיים שלכם ממשיכים לרוץ דרך Ollama בלי עלות-לפי-טוקן, בעוד claude-sonnet-4-6, gpt-5.5, gemini-3.5-flash, ו-deepseek-v4-pro הופכים לערכי בורר עבור השיחות שצריכות איכות מובילה. מפתח אחד מכסה את כולם, ושימוש בצד המנהל נשאר קריא מכיוון שתעבורת ענן יוצאת דרך בדיוק מקום אחד.

הגדרה בזמן-פריסה: משתני סביבה.

עבור פריסות docker-compose ו-Kubernetes, החיבור יכול להיות חלק מה-manifest. OPENAI_API_BASE_URL לוקח את ה-endpoint ו-OPENAI_API_KEY את המפתח; ה-instance עולה עם החיבור כבר נוכח. כמה endpoints נתמכים דרך הצורות ברבים (OPENAI_API_BASE_URLS ו-OPENAI_API_KEYS עם ערכים מופרדים בנקודה-פסיק) אם אתם מריצים יותר ממקור מרוחק אחד. שתי הערות תפעוליות. ראשית, ערכים שהוגדרו דרך ה-UI נשמרים במסד הנתונים של Open WebUI וגוברים על ברירות המחדל של הסביבה אחרי ה-boot הראשון, התנהגות מתועדת שבאופן קבוע מפתיעה מפעילים שמשנים את הסביבה ורואים שכלום לא קורה; התאימו חיבורים קיימים ב-Admin Settings, או הגדירו ENABLE_PERSISTENT_CONFIG=false אם אתם רוצים שהסביבה תישאר סמכותית. שנית, אם רשימת המודלים של ה-endpoint גדולה, השתמשו ברשימת-ההיתר Model IDs של החיבור כדי לאצור מה המשתמשים שלכם רואים; בורר עם ארבעה פריטים נמצא בשימוש, בורר עם מאתיים נגלל. הערת גרסה: ניסוח התפריט נסחף על פני קצב השחרור המהיר של הפרויקט (Settings מול Admin Settings, שמות סעיפים בתוך Connections), אז ב-builds ישנים יותר חפשו את הזוג OpenAI API base URL ומפתח בכל מקום שהחיבורים חיים בו.

services:
  open-webui:
    image: ghcr.io/open-webui/open-webui:main
    environment:
      - OPENAI_API_BASE_URL=https://api.apisrouter.com/v1
      - OPENAI_API_KEY=sk-YOUR-APISROUTER-KEY
    ports:
      - "3000:8080"

בחירת מודלים למרחב עבודה רב-משתמשים.

עם כל מודל ענן מחויב דרך מפתח אחד, בדיקת A/B היא בחירת בורר. הריצו את אותו עומס עבודה צוותי שבועיים בהפרש בין שני מועמדים ברירת מחדל ותנו לתצוגת השימוש-לפי-מודל בקונסולת APIsRouter לשפוט, לכל מודל ולכל יום, במקום לנחש מ-benchmarks.

  • בחירת מודל ברירת המחדל עושה את רוב העבודה ב-instance משותף. claude-haiku-4-5-20251001 או gemini-3.5-flash כברירת המחדל של מרחב העבודה שומרים על העלות-לכל-שיחה של שימוש מזדמן שטוחה.
  • claude-sonnet-4-6 ו-gpt-5.5 שייכים לבורר לניסוח, ניתוח, ושאלות קוד; משתמשים משדרגים כשהמשימה מצדיקה זאת.
  • צינורות RAG מכפילים טוקני קלט: כל תשובה נושאת קטעים שאוחזרו. deepseek-v4-pro שווה בדיקה כסוס-העבודה של RAG, שם טיפול ארוך-הקשר לכל טוקן שהוצא הוא התכונה המכריעה.
  • שמרו חומר באמת פרטי על מודלים מקומיים דרך Ollama ונתבו כל השאר דרך ה-gateway; הבורר מחזיק את שני הנתיבים ביושר.
  • השתמשו ברשימת-ההיתר Model IDs כמדיניות: מה שלא בבורר לא יכול להפתיע אתכם ביומן השימוש.

תשלום לפי שימוש · מתחת למחיר הרשמי

Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.

מודלמחיר רשמיהמחיר שלנו
Claude Haiku 4.5 20251001$1.00 / $5.00 per M$0.80 / $4.00 per M
Claude Sonnet 4.6$3.00 / $15.00 per M$2.40 / $12.00 per M
GPT-5.5$5.00 / $30.00 per M$4.00 / $24.00 per M
Gemini 3.5 Flash$1.50 / $9.00 per M$1.20 / $7.20 per M
DeepSeek V4 Pro$0.43 / $0.87 per M$0.40 / $0.90 per M

מצבי כשל ספציפיים ל-Open WebUI.

שום מודל לא מופיע אחרי הוספת החיבור הוא הדיווח הנפוץ ביותר. הסיבות מדורגות: המפתח נכשל מול /v1/models (בדקו אותו עם בקרת האימות של החיבור), ל-URL חסרה סיומת ה-/v1, או שה-toggle של החיבור כבוי. Open WebUI בונה את הבורר ממה שהרשימה מחזירה, אז בורר ריק אומר שקריאת הרשימה נכשלה או החזירה כלום. שינויי סביבה שנראים מתעלמים הם כלל ה-persistent-config שתואר למעלה: אחרי ה-boot הראשון, מסד הנתונים גובר על הסביבה עבור הגדרות שה-UI מנהל. ערכו את החיבור ב-Admin Settings או בטלו את ה-persistent config במפורש. מודל שמופיע ברשימה אבל נכשל בצ'אט הוא בדרך כלל id שהרשימה חושפת אבל המפתח שלכם לא יכול להשתמש בו, או שגיאת הקלדה שהוכנסה על ידי עריכה ידנית של רשימת ה-Model IDs; השוו מול פלט ה-/v1/models הגולמי. ושמרו על הנתיבים ברורים בזמן דיבוג: בעיות חיבור Ollama ובעיות חיבור OpenAI נראות זהות מחלון הצ'אט. עמוד Connections מראה לאיזה נתיב מודל שייך; בדקו את הנתיב הכושל ישירות לפני שתניחו שכל ה-instance למטה.

מי מנתב את Open WebUI דרך gateway.

  • צוותים שמארחים בעצמם חזית צ'אט אחת לכולם ורוצים מודלים מובילים זמינים בלי להנפיק מפתחות ספק למשתמשים בודדים.
  • משתמשי Ollama ששומרים על מודלים מקומיים לעבודה פרטית אבל רוצים איכות Claude ו-GPT באותו בורר עבור השיחות שצריכות זאת.
  • מנהלים שצריכים את חשבון הענן קריא: חיבור אחד, מפתח אחד, ויומן שימוש-לכל-מודל במקום קבלות מארבעה ספקים.
  • מפעילים באזורים שבהם הרשמות ספק מסוימות כואבות; גישה מבוססת-הטענה בלי דרישת כרטיס מסירה את התלות לכל-ספק.
  • הומלאברים שמריצים Open WebUI למשק הבית, שם יתרה משולמת מראש אחת קלה יותר לחשוב עליה מכל מנוי.

אמתו את ה-endpoint ובצעו דיבוג לצ'אט הראשון.

הוכיחו את ה-endpoint מהשרת קודם, במיוחד בפריסות מוכלות שבהן הרשת של הקונטיינר היא לא זו של המחשב הנייד שלכם. רשימת מודלים והשלמת צ'אט אחת מתוך המארח מאשרות את חצי ה-gateway לפני ש-Open WebUI נכנס לתמונה. אז הוסיפו את החיבור וצפו בבורר מתאכלס. שגיאות אימות הן שדה המפתח; בורר ריק הוא קריאת הרשימה; נתיב כפול (/v1/v1/...) ביומני השרת אומר ששדה ה-URL כבר נשא /v1 ומשהו הוסיף עוד אחד, אז קראו את ה-URL בדיוק כפי שנשמר. ברגע שצ'אטים זורמים, קונסולת APIsRouter מציגה מודל לכל בקשה, ספירות טוקן, והוצאה. עבור instance רב-משתמשים זה המספר שחשוב: אילו מודלים המשתמשים שלכם באמת בוחרים, ומה שבוע של מרחב העבודה באמת עולה, לכל מודל, לכל יום, בעמוד אחד.

curl -s https://api.apisrouter.com/v1/models \
  -H "Authorization: Bearer $APISROUTER_API_KEY" | head -50

curl -s https://api.apisrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $APISROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-haiku-4-5-20251001",
       "messages":[{"role":"user","content":"ping"}]}'

שאלות נפוצות

איך מוסיפים endpoint מותאם אישית תואם OpenAI ל-Open WebUI?

ב-Admin Settings, פתחו את Connections והוסיפו חיבור תחת סעיף ה-OpenAI API: URL https://api.apisrouter.com/v1 בתוספת המפתח שלכם. שמרו ובורר המודל מתאכלס מרשימת ה-/v1/models של ה-endpoint; השתמשו ברשימת-ההיתר Model IDs כדי לאצור אותו.

האם ה-URL צריך את סיומת ה-/v1?

כן. Open WebUI מוסיף נתיבי route כמו /chat/completions ל-base URL שאתם נותנים לו, אז הערך הנכון הוא https://api.apisrouter.com/v1. סיומת חסרה מופיעה כרשימת מודלים ריקה; אחת כפולה מופיעה כ-404s של /v1/v1 ביומנים.

האם אני יכול להריץ Ollama וחיבור gateway בו-זמנית?

כן, וזו ההגדרה הסטנדרטית. חיבורי Ollama וחיבורי OpenAI API הם סעיפים נפרדים ששניהם מזינים את בורר המודל, כך שמודלים מקומיים ו-ids מהקטלוג כמו claude-sonnet-4-6 יושבים זה לצד זה, כל שיחה בוחרת את הנתיב שלה.

למה שינויי משתנה הסביבה שלי מתעלמים?

Open WebUI שומר הגדרות במסד הנתונים שלו אחרי ה-boot הראשון, וערכים שנשמרו גוברים על ברירות מחדל של הסביבה. ערכו את החיבור ב-Admin Settings במקום זאת, או הגדירו ENABLE_PERSISTENT_CONFIG=false כך שהסביבה תישאר סמכותית על פני restarts.

האם כל המשתמשים רואים את המודלים מחיבור מנהל?

חיבורים שנוספו ב-Admin Settings הם ברמת-מרחב-העבודה כברירת מחדל, כפוף לבקרות גישת-מודל והרשאת-מרחב-עבודה שהגרסה שלכם מציעה. אצרו את הבורר עם רשימת-ההיתר Model IDs ובקרות גישה-לכל-מודל במקום מפתחות לכל-משתמש.

האם Open WebUI יכול להגיע ל-Claude ו-Gemini דרך חיבור OpenAI אחד?

כן. החיבור מדבר chat completions סטנדרטי ומעביר את id המודל כמחרוזת פשוטה, כך שכל id שה-gateway משרת עובד: ids של Claude, Gemini, DeepSeek, ו-GPT כולם דרך URL אחד ומפתח אחד.