−25%

na Windows przy płatności rocznej, do 31.10. Do planów

EQVPS

VPS dla Open WebUI: prywatny interfejs czatu dla LLM

Postaw Open WebUI na VPS jako prywatny czat dla dowolnego API zgodnego z OpenAI lub lokalnych modeli Ollama: Docker, bezpieczny dostęp i dobór zasobów.

Korzystasz z trzech różnych dostawców modeli, każdy z własnym oknem czatu, subskrypcją i historią. Open WebUI zbiera je za jednym interfejsem, który hostujesz sam: wybierasz model do każdej rozmowy, całą historię trzymasz na swoim serwerze, dzielisz się nim z zespołem i podłączasz lokalne modele, gdy nic nie powinno opuszczać maszyny.

Dwa sposoby użycia

Jako interfejs do API. Open WebUI łączy się z dowolnym API zgodnym z OpenAI — hostowanymi dostawcami, proxy LiteLLM albo własnym endpointem. Serwer prawie nic nie robi; mały plan w zupełności wystarczy.

Z lokalnymi modelami. Dodaj Ollamę na tym samym serwerze i uruchamiaj lokalnie modele z otwartymi wagami. Teraz ograniczeniem jest RAM, a inferencja na CPU jest powolna. Uczciwy kompromis: pełna prywatność, skromna szybkość.

KonfiguracjaPlan
Interfejs API, użytek prywatnyMicro — 1 vCPU, 2 GB, $5/mies. (tunel SSH)
Interfejs API, dostęp zespołu przez HTTPSMicro-IP — 1 vCPU, 2 GB, $10/mies.
Lokalne modele 3B przez OllamęAI-Agent — 2 vCPU, 4 GB, $10/mies.
Lokalne modele 7–8BMedium — 4 vCPU, 6 GB, $12/mies., albo plany Pro dla większych

Instalacja w Dockerze

Na serwerze z zainstalowanym Dockerem:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

Powiązanie z 127.0.0.1 trzyma go z dala od internetu, dopóki nie zdecydujesz, jak go udostępnić. Czaty, użytkownicy i ustawienia żyją w wolumenie open-webui.

Bezpieczny dostęp

Tunel SSH — działa na każdym planie, także NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

Otwórz http://localhost:3000. Na planie NAT użyj osobistego portu SSH.

HTTPS na twojej domenie — dla zespołu na planie z dedykowanym IP. Skieruj subdomenę na serwer (poradnik) i puść ją przez nginx razem z nagłówkami WebSocket:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

Potem uruchom certbot --nginx -d chat.example.com. Długi timeout odczytu ma znaczenie: wolne modele strumieniują odpowiedzi przez całe minuty.

Pierwsze kroki w środku

  1. Zarejestruj się od razu. Pierwsze konto zostaje administratorem. Nie zostawiaj świeżej instalacji publicznie — ktoś inny może ją przejąć.
  2. Zamknij rejestrację. Ustawienia administratora → domyślna rola nowych użytkowników na oczekującą albo wyłącz rejestrację.
  3. Dodaj połączenie. Ustawienia → Połączenia → wklej bazowy URL API i klucz. Modele tego dostawcy pojawią się w wyborze modelu.

Dodawanie lokalnych modeli

Zainstaluj Ollamę na hoście (nasz poradnik), pobierz mały model i uruchom Open WebUI tak, żeby mógł do niego sięgnąć:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

Wolumen zachowuje twoje czaty po restarcie. Spodziewaj się kilku tokenów na sekundę na CPU — dobre do streszczeń i prywatnych notatek, wolne przy długich tekstach. Do poważniejszej lokalnej inferencji zobacz VPS dla Ollamy.

Warto wiedzieć

Limity i rozbudowa planów są opisane w dokumentacji planów.

Gotowy na wdrożenie? Płać kryptowalutą, bez KYC — online w około minutę.

Wdróż teraz →

FAQ

Ile RAM potrzebuje Open WebUI?

Samo Open WebUI działa na około 1 GB. Jeśli rozmawia tylko ze zdalnymi API, wystarczy plan z 2 GB. Pamięci wymagają lokalne modele przez Ollama — 4 GB dla małych modeli 3B, 6 GB lub więcej dla modeli 7–8B.

Czy mogę uruchamiać lokalne modele na VPS bez GPU?

Tak, przy realistycznych oczekiwaniach. Małe skwantyzowane modele odpowiadają na CPU z prędkością kilku tokenów na sekundę. To wystarczy do krótkich zadań i prywatnych testów, ale nie do żwawego czatu z długimi odpowiedziami.

Czy mogę używać go na planie NAT?

Tak, przez tunel SSH na twoim osobistym porcie SSH. Do publicznego adresu HTTPS, który zespół otwiera w przeglądarce, potrzebny jest plan z dedykowanym IP.

Kto może zakładać konta?

Pierwsze zarejestrowane konto zostaje administratorem. Potem ustaw nowe rejestracje jako oczekujące albo wyłącz je w ustawieniach administratora, inaczej każdy, kto znajdzie URL, może założyć konto.

Gdzie są przechowywane moje rozmowy?

W wolumenie Dockera na twoim serwerze. Nic nie trafia do osób trzecich poza promptami, które wysyłasz do podłączonego API modelu.

Komentarze

Brak komentarzy. Bądź pierwszy.

Zostaw komentarz

Komentarze są moderowane przed pojawieniem się.