Підключіть Open WebUI до кастомного OpenAI-сумісного ендпоінта.
Updated 2026-07-29
Open WebUI трактує OpenAI-сумісні з'єднання як повноцінне налаштування адміна: додайте з'єднання під Admin Settings з https://api.apisrouter.com/v1 і одним ключем, і кожна модель каталогу з'являється в селекторі моделей для всіх ваших користувачів, поряд з усім, що працює локально.
Коротка відповідь: одне з'єднання в Admin Settings.
Як адмін, відкрийте Admin Settings, перейдіть до Connections і в розділі OpenAI API натисніть, щоб додати з'єднання. Мають значення два поля: URL, встановлений на https://api.apisrouter.com/v1, і API-ключ. Збережіть, і Open WebUI опитує список /v1/models ендпоінта, щоб заповнити селектор моделей; перевірте елементом перевірки з'єднання, тоді оберіть будь-який ID каталогу в новому чаті. З'єднання, додані так, діють на весь робочий простір: кожен користувач вашої інстанції Open WebUI бачить моделі, з урахуванням будь-яких контролів доступу до моделей, які ви налаштуєте. Ті самі значення можуть натомість постачатись як змінні середовища під час розгортання — OPENAI_API_BASE_URL і OPENAI_API_KEY, що є чистішим шляхом, коли інстанція забезпечується файлами compose, а не клацається до готовності.
URL: https://api.apisrouter.com/v1
API Key: sk-YOUR-APISROUTER-KEY
Save → models auto-populate from /v1/models
(optional) Model IDs allowlist to curate the selectorЯк Open WebUI використовує з'єднання OpenAI.
Open WebUI (приблизно 145 тис. зірок на GitHub) — типовий самостійно хостований AI-чат-фронтенд: повнофункціональний веб-клієнт з користувачами й дозволами, RAG і колекціями знань, викликом інструментів і керуванням моделями, класично поєднаний з Ollama для локальних моделей, але однаково добре почувається, спілкуючись із віддаленими API. Його модель з'єднань адитивна. Розділ Ollama охоплює локальні середовища виконання; розділ OpenAI API охоплює будь-який ендпоінт, що говорить стандартним діалектом chat-completions, і ви можете додати кілька з'єднань пліч-о-пліч. Кожне з'єднання додає свій список моделей до спільного селектора, кожне має власний ключ, і кожне можна вимкнути без видалення його конфігурації. Запити несуть ID моделі як звичайний рядок до того з'єднання, яке його обслуговує. Такий дизайн означає, що з'єднання шлюзу нічого не витісняє: ваші локальні моделі продовжують працювати через Ollama без вартості за токен, тоді як claude-sonnet-4-6, gpt-5.5, gemini-3.5-flash і deepseek-v4-pro стають записами селектора для розмов, які потребують передової якості. Один ключ покриває їх усі, і використання на боці адміна лишається зрозумілим, оскільки хмарний трафік виходить рівно через одне місце.
Налаштування під час розгортання: змінні середовища.
Для розгортань docker-compose і Kubernetes з'єднання може бути частиною маніфесту. OPENAI_API_BASE_URL бере ендпоінт, а OPENAI_API_KEY — ключ; інстанція піднімається вже з наявним з'єднанням. Кілька ендпоінтів підтримуються через форми множини (OPENAI_API_BASE_URLS і OPENAI_API_KEYS зі значеннями, розділеними крапкою з комою), якщо ви запускаєте більше одного віддаленого джерела. Дві операційні примітки. По-перше, значення, встановлені через UI, зберігаються в базі даних Open WebUI і мають пріоритет над значеннями середовища за замовчуванням після першого запуску — задокументована поведінка, яка регулярно дивує операторів, що змінюють середовище й нічого не бачать; змініть наявні з'єднання в Admin Settings, або встановіть ENABLE_PERSISTENT_CONFIG=false, якщо хочете, щоб середовище лишалось авторитетним. По-друге, якщо список моделей ендпоінта великий, скористайтесь allowlist Model IDs з'єднання, щоб курувати те, що бачать ваші користувачі; селектором з чотирьох пунктів користуються, а той, що з двохсот пунктів, просто прогортують. Примітка про версії: формулювання меню зсувалось через швидкий темп релізів проєкту (Settings проти Admin Settings, назви розділів всередині Connections), тож у старіших збірках шукайте пару base URL і ключа OpenAI API там, де живуть з'єднання.
services:
open-webui:
image: ghcr.io/open-webui/open-webui:main
environment:
- OPENAI_API_BASE_URL=https://api.apisrouter.com/v1
- OPENAI_API_KEY=sk-YOUR-APISROUTER-KEY
ports:
- "3000:8080"Вибір моделей для багатокористувацького робочого простору.
Оскільки кожна хмарна модель оплачується через один ключ, A/B-тестування — це вибір у селекторі. Запустіть те саме навантаження команди з різницею у два тижні на двох кандидатських типових моделях і дозвольте погляду на використання за моделлю в консолі APIsRouter судити, за моделлю і за днем, а не гадати за бенчмарками.
- Вибір типової моделі виконує найбільше роботи в спільній інстанції. claude-haiku-4-5-20251001 чи gemini-3.5-flash як типова модель робочого простору тримає вартість повсякденного використання на розмову плаваючою на низькому рівні.
- claude-sonnet-4-6 і gpt-5.5 належать у селекторі для чернеток, аналізу і питань про код; користувачі підвищують рівень, коли завдання цього заслуговує.
- Пайплайни RAG множать вхідні токени: кожна відповідь несе отримані фрагменти. deepseek-v4-pro варто протестувати як робочого коня RAG, де вирішальна риса — обробка довгого контексту на витрачений токен.
- Тримайте справді приватні матеріали на локальних моделях через Ollama і маршрутизуйте все інше через шлюз; селектор чесно тримає обидві смуги.
- Використовуйте allowlist Model IDs як політику: те, чого немає в селекторі, не може здивувати вас у журналі використання.
Оплата за фактом · нижче офіційних цін
Selected models are priced below official list prices. Exact input, output, cache, and per-request prices are shown for each model.
| Модель | Офіційна ціна | Наша ціна |
|---|---|---|
| Claude Haiku 4.5 20251001 | $1.00 / $5.00 per M | $0.80 / $4.00 per M |
| Claude Sonnet 4.6 | $3.00 / $15.00 per M | $2.40 / $12.00 per M |
| GPT-5.5 | $5.00 / $30.00 per M | $4.00 / $24.00 per M |
| Gemini 3.5 Flash | $1.50 / $9.00 per M | $1.20 / $7.20 per M |
| DeepSeek V4 Pro | $0.43 / $0.87 per M | $0.40 / $0.90 per M |
Специфічні для Open WebUI режими збоїв.
Відсутність моделей після додавання з'єднання — найпоширеніше повідомлення. Причини за рангом: ключ провалився проти /v1/models (перевірте елементом перевірки з'єднання), URL відсутній суфікс /v1, чи перемикач з'єднання вимкнений. Open WebUI будує селектор з того, що повертає список, тож порожній селектор означає, що виклик списку провалився чи нічого не повернув. Зміни середовища, що здаються ігнорованими, — це правило постійної конфігурації, описане вище: після першого запуску база даних перемагає середовище для налаштувань, якими керує UI. Редагуйте з'єднання в Admin Settings чи явно вимкніть постійну конфігурацію. Модель, що з'являється в списку, але видає помилку в чаті, зазвичай — це ID, який показує список, але ваш ключ не може використати, або помилка, внесена ручним редагуванням allowlist Model IDs; порівняйте із сирим виводом /v1/models. І тримайте смуги чіткими під час налагодження: проблеми з'єднання Ollama і проблеми з'єднання OpenAI виглядають ідентично з вікна чату. Сторінка Connections показує, до якої смуги належить модель; тестуйте смугу, що провалюється, напряму, перш ніж припускати, що вся інстанція не працює.
Хто маршрутизує Open WebUI через шлюз.
- Команди, що самостійно хостять один чат-фронтенд для всіх і хочуть мати доступні передові моделі, не видаючи ключі постачальників окремим користувачам.
- Користувачі Ollama, що тримають локальні моделі для приватної роботи, але хочуть якість Claude і GPT у тому самому селекторі для розмов, які цього потребують.
- Адміни, яким потрібен зрозумілий хмарний рахунок: одне з'єднання, один ключ і журнал використання за моделлю замість квитанцій від чотирьох постачальників.
- Оператори в регіонах, де деякі реєстрації в постачальників болючі; доступ на основі поповнення без вимоги картки прибирає залежність від кожного провайдера.
- Домашні ентузіасти, що запускають Open WebUI для родини, де про єдиний передоплачений баланс легше міркувати, ніж про будь-яку підписку.
Перевірте ендпоінт і налагодьте перший чат.
Спершу підтвердіть ендпоінт із сервера, особливо в контейнеризованих розгортаннях, де мережа контейнера не така, як у вашого ноутбука. Список моделей і один chat completion зсередини хоста підтверджують половину зі шлюзом, перш ніж Open WebUI входить у картину. Тоді додайте з'єднання і спостерігайте за заповненням селектора. Помилки автентифікації — це поле ключа; порожній селектор — це виклик списку; подвоєний шлях (/v1/v1/...) у серверних логах означає, що поле URL уже несло /v1, і щось дописало ще один, тож читайте URL точно так, як він збережений. Щойно чати почнуть проходити, консоль APIsRouter показує модель на кожен запит, кількість токенів і витрати. Для багатокористувацької інстанції це те число, яке має значення: які моделі насправді обирають ваші користувачі і скільки насправді коштує тиждень робочого простору, за моделлю, за днем, на одній сторінці.
curl -s https://api.apisrouter.com/v1/models \
-H "Authorization: Bearer $APISROUTER_API_KEY" | head -50
curl -s https://api.apisrouter.com/v1/chat/completions \
-H "Authorization: Bearer $APISROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-4-5-20251001",
"messages":[{"role":"user","content":"ping"}]}'Поширені запитання
Як додати кастомний ендпоінт OpenAI API в Open WebUI?
В Admin Settings відкрийте Connections і додайте з'єднання в розділі OpenAI API: URL https://api.apisrouter.com/v1 плюс ваш ключ. Збережіть, і селектор моделей заповнюється зі списку /v1/models ендпоінта; скористайтесь allowlist Model IDs, щоб його курувати.
Чи потрібен URL суфікс /v1?
Так. Open WebUI дописує шляхи маршрутів на кшталт /chat/completions до base URL, який ви задаєте, тож правильне значення — https://api.apisrouter.com/v1. Відсутній суфікс проявляється як порожній список моделей; подвоєний проявляється як 404 /v1/v1 у логах.
Чи можу я запускати Ollama і з'єднання шлюзу одночасно?
Так, і це стандартне налаштування. З'єднання Ollama і з'єднання OpenAI API — окремі розділи, які обидва живлять селектор моделей, тож локальні моделі й ID каталогу на кшталт claude-sonnet-4-6 сидять пліч-о-пліч, і кожна розмова обирає свою смугу.
Чому мої зміни змінних середовища ігноруються?
Open WebUI зберігає налаштування у своїй базі даних після першого запуску, і збережені значення мають пріоритет над значеннями середовища за замовчуванням. Натомість редагуйте з'єднання в Admin Settings, або встановіть ENABLE_PERSISTENT_CONFIG=false, щоб середовище лишалось авторитетним між перезапусками.
Чи всі користувачі бачать моделі з адмінського з'єднання?
З'єднання, додані в Admin Settings, за замовчуванням діють на весь робочий простір, з урахуванням контролів доступу до моделей і дозволів робочого простору, які пропонує ваша версія. Куруйте селектор через allowlist Model IDs і налаштування доступу для кожної моделі, а не ключі для кожного користувача.
Чи може Open WebUI дістатись Claude і Gemini через одне з'єднання OpenAI?
Так. З'єднання говорить стандартними chat completions і пересилає ID моделі як звичайний рядок, тож працює будь-який ID, який обслуговує шлюз: ID Claude, Gemini, DeepSeek і GPT — усі через один URL і один ключ.