−25%

за Windows при годишно плащане, до 31.10. Към плановете

EQVPS

VPS за Open WebUI: личен чат интерфейс за LLM

Хоствайте Open WebUI на VPS като личен чат интерфейс за всяко OpenAI-съвместимо API или локални модели в Ollama: Docker, безопасен достъп и оразмеряване.

Ползвате трима различни доставчици на модели, всеки със свой прозорец за чат, абонамент и история. Open WebUI ги събира зад един интерфейс, който хоствате сами: избирате модел за всеки разговор, пазите цялата история на своя сървър, споделяте го с екипа и включвате локални модели, когато нищо не бива да напуска машината.

Два начина да го пуснете

Като интерфейс за API. Open WebUI се свързва с всяко OpenAI-съвместимо API — хоствани доставчици, LiteLLM proxy или ваш собствен endpoint. Сървърът почти нищо не прави; малък план стига с излишък.

С локални модели. Добавете Ollama на същия сървър и пускайте локално модели с отворени тегла. Тогава ограничението е RAM, а изводът на процесор е бавен. Честният компромис: пълна поверителност, скромна скорост.

КонфигурацияПлан
Интерфейс за API, лична употребаMicro — 1 vCPU, 2 GB, $5/мес. (SSH тунел)
Интерфейс за API, достъп на екипа през HTTPSMicro-IP — 1 vCPU, 2 GB, $10/мес.
Локални модели 3B през OllamaAI-Agent — 2 vCPU, 4 GB, $10/мес.
Локални модели 7–8BMedium — 4 vCPU, 6 GB, $12/мес., или Pro планове за по-големи

Инсталиране с Docker

На сървър с инсталиран Docker:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

Свързването към 127.0.0.1 го държи извън публичния интернет, докато не решите как да го отворите. Чатовете, потребителите и настройките живеят във volume-а open-webui.

Безопасен достъп

SSH тунел — работи на всички планове, включително NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

Отворете http://localhost:3000. При NAT план ползвайте личния си SSH порт.

HTTPS на вашия домейн — за екип на план с dedicated IP. Насочете поддомейн към сървъра (ръководство) и направете proxy с nginx, включително WebSocket заглавките:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

След това пуснете certbot --nginx -d chat.example.com. Дългият timeout за четене е важен: бавните модели стриймват отговори с минути.

Първи стъпки вътре

  1. Регистрирайте се веднага. Първият акаунт става администратор. Не оставяйте нова инсталация публична — някой друг може да я присвои.
  2. Затворете регистрациите. Администраторски настройки → задайте ролята по подразбиране за нови потребители на „в изчакване" или изключете регистрацията.
  3. Добавете връзка. Настройки → Връзки → поставете базов URL на API и ключ. Моделите на този доставчик се появяват в избора на модел.

Добавяне на локални модели

Инсталирайте Ollama на хоста (нашето ръководство), изтеглете малък модел и пуснете Open WebUI така, че да го достига:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

Volume-ът пази чатовете ви при рестарта. Очаквайте по няколко токена в секунда на процесор — добре за резюмета и лични бележки, бавно за дълги текстове. За по-сериозен локален извод вижте VPS за Ollama.

Полезно е да знаете

Лимитите и надграждането на плановете са в документацията за плановете.

Готов за deploy? Плати в crypto, без KYC — онлайн за около минута.

Deploy-ни сега →

Въпроси

Колко RAM му трябва на Open WebUI?

Самият Open WebUI работи с около 1 GB. Ако говори само с отдалечени API, план с 2 GB стига. Паметта я искат локалните модели през Ollama — 4 GB за малки модели 3B, 6 GB или повече за модели 7–8B.

Мога ли да пускам локални модели на VPS без GPU?

Да, с реалистични очаквания. Малките квантизирани модели отговарят на процесора с по няколко токена в секунда. Става за кратки задачи и лични експерименти, не за бърз чат с дълги отговори.

Мога ли да го ползвам на NAT план?

Да, през SSH тунел по личния ви SSH порт. За публичен HTTPS адрес, който екипът ви отваря в браузър, ви трябва план с dedicated IP.

Кой може да създава акаунти?

Първият регистриран акаунт става администратор. След това сложете новите регистрации в изчакване или ги изключете от администраторските настройки, иначе всеки, който намери URL адреса, може да си направи акаунт.

Къде се пазят разговорите ми?

В Docker volume на вашия сървър. Нищо не отива при трети страни, освен промптовете, които пращате към свързаното API на модела.

Коментари

Още няма коментари. Бъди първият.

Остави коментар

Коментарите се модерират преди да се появят.