Ползвате трима различни доставчици на модели, всеки със свой прозорец за чат, абонамент и история. Open WebUI ги събира зад един интерфейс, който хоствате сами: избирате модел за всеки разговор, пазите цялата история на своя сървър, споделяте го с екипа и включвате локални модели, когато нищо не бива да напуска машината.
Два начина да го пуснете
Като интерфейс за API. Open WebUI се свързва с всяко OpenAI-съвместимо API — хоствани доставчици, LiteLLM proxy или ваш собствен endpoint. Сървърът почти нищо не прави; малък план стига с излишък.
С локални модели. Добавете Ollama на същия сървър и пускайте локално модели с отворени тегла. Тогава ограничението е RAM, а изводът на процесор е бавен. Честният компромис: пълна поверителност, скромна скорост.
| Конфигурация | План |
|---|---|
| Интерфейс за API, лична употреба | Micro — 1 vCPU, 2 GB, $5/мес. (SSH тунел) |
| Интерфейс за API, достъп на екипа през HTTPS | Micro-IP — 1 vCPU, 2 GB, $10/мес. |
| Локални модели 3B през Ollama | AI-Agent — 2 vCPU, 4 GB, $10/мес. |
| Локални модели 7–8B | Medium — 4 vCPU, 6 GB, $12/мес., или Pro планове за по-големи |
Инсталиране с Docker
На сървър с инсталиран Docker:
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 \
-v open-webui:/app/backend/data \
ghcr.io/open-webui/open-webui:main
Свързването към 127.0.0.1 го държи извън публичния интернет, докато не решите как да го отворите. Чатовете, потребителите и настройките живеят във volume-а open-webui.
Безопасен достъп
SSH тунел — работи на всички планове, включително NAT:
ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10
Отворете http://localhost:3000. При NAT план ползвайте личния си SSH порт.
HTTPS на вашия домейн — за екип на план с dedicated IP. Насочете поддомейн към сървъра (ръководство) и направете proxy с nginx, включително WebSocket заглавките:
location / {
proxy_pass http://127.0.0.1:3000;
proxy_set_header Host $host;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
proxy_read_timeout 300s;
}
След това пуснете certbot --nginx -d chat.example.com. Дългият timeout за четене е важен: бавните модели стриймват отговори с минути.
Първи стъпки вътре
- Регистрирайте се веднага. Първият акаунт става администратор. Не оставяйте нова инсталация публична — някой друг може да я присвои.
- Затворете регистрациите. Администраторски настройки → задайте ролята по подразбиране за нови потребители на „в изчакване" или изключете регистрацията.
- Добавете връзка. Настройки → Връзки → поставете базов URL на API и ключ. Моделите на този доставчик се появяват в избора на модел.
Добавяне на локални модели
Инсталирайте Ollama на хоста (нашето ръководство), изтеглете малък модел и пуснете Open WebUI така, че да го достига:
ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main
Volume-ът пази чатовете ви при рестарта. Очаквайте по няколко токена в секунда на процесор — добре за резюмета и лични бележки, бавно за дълги текстове. За по-сериозен локален извод вижте VPS за Ollama.
Полезно е да знаете
- Обновяванията са чести.
docker pull ghcr.io/open-webui/open-webui:main, после пресъздайте контейнера. Първо архивирайте volume-а. - Разходите за API са ваши. Open WebUI по подразбиране не ограничава ползването за потребител; следете разходите, ако го споделяте с екип.
- Това е чат приложение, не модел. Качеството на отговорите зависи изцяло от модела зад него.
Лимитите и надграждането на плановете са в документацията за плановете.
Коментари
Още няма коментари. Бъди първият.