−25%

på Windows ved årlig betaling, til 31/10. Se pakkerne

EQVPS

VPS til Open WebUI: en privat chatbrugerflade til LLM'er

Host Open WebUI på en VPS som privat chatbrugerflade til enhver OpenAI-kompatibel API eller lokale Ollama-modeller: Docker, sikker adgang og dimensionering.

Du bruger tre forskellige modeludbydere, hver med sit eget chatvindue, abonnement og historik. Open WebUI samler dem bag én brugerflade, som du selv hoster: vælg en model pr. samtale, behold hele historikken på din server, del den med dit team, og tilslut lokale modeller, når intet må forlade maskinen.

To måder at køre det på

Som brugerflade til API'er. Open WebUI forbinder til enhver OpenAI-kompatibel API — hostede udbydere, en LiteLLM-proxy eller dit eget endpoint. Serveren laver næsten ingenting; en lille plan er rigeligt.

Med lokale modeller. Tilføj Ollama på samme server, og kør modeller med åbne vægte lokalt. Nu er RAM begrænsningen, og inferens på CPU er langsom. Det ærlige kompromis: fuldt privatliv, beskeden hastighed.

OpsætningPlan
API-brugerflade, personlig brugMicro — 1 vCPU, 2 GB, $5/md. (SSH-tunnel)
API-brugerflade, teamadgang over HTTPSMicro-IP — 1 vCPU, 2 GB, $10/md.
Lokale 3B-modeller via OllamaAI-Agent — 2 vCPU, 4 GB, $10/md.
Lokale 7–8B-modellerMedium — 4 vCPU, 6 GB, $12/md., eller Pro-planer til større

Installation med Docker

På en server med Docker installeret:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

Bindingen til 127.0.0.1 holder det væk fra det offentlige internet, indtil du beslutter, hvordan det skal eksponeres. Chats, brugere og indstillinger ligger i volumen open-webui.

Sikker adgang

SSH-tunnel — virker på alle planer, også NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

Åbn http://localhost:3000. På en NAT-plan bruger du din personlige SSH-port.

HTTPS på dit domæne — til et team på en plan med dedikeret IP. Peg et subdomæne på serveren (guide), og proxy det med nginx, inklusive WebSocket-headers:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

Kør derefter certbot --nginx -d chat.example.com. Den lange read-timeout betyder noget: langsomme modeller streamer svar i flere minutter.

De første skridt indenfor

  1. Registrér dig med det samme. Den første konto bliver administrator. Lad ikke en frisk installation stå offentligt — en anden kan overtage den.
  2. Luk for tilmeldinger. Administratorindstillinger → sæt standardrollen for nye brugere til afventende, eller slå registrering fra.
  3. Tilføj en forbindelse. Indstillinger → Forbindelser → indsæt en basis-URL til API'en og en nøgle. Modellerne fra den udbyder dukker op i modelvælgeren.

Tilføj lokale modeller

Installér Ollama på værten (vores guide), hent en lille model, og start Open WebUI, så det kan nå den:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

Volumen beholder dine chats ved genstarten. Regn med nogle få tokens i sekundet på CPU — fint til resuméer og private noter, langsomt til lange tekster. Til tungere lokal inferens, se VPS til Ollama.

Værd at vide

Planernes grænser og opgraderinger står i dokumentationen om planer.

Klar til at deploye? Betal med krypto, ingen KYC — live på cirka et minut.

Deploy nu →

FAQ

Hvor meget RAM kræver Open WebUI?

Open WebUI i sig selv kører på omkring 1 GB. Hvis det kun taler med fjern-API'er, er en plan med 2 GB nok. Det er lokale modeller via Ollama, der kræver hukommelse — 4 GB til små 3B-modeller, 6 GB eller mere til 7–8B-modeller.

Kan jeg køre lokale modeller på en VPS uden GPU?

Ja, med realistiske forventninger. Små kvantiserede modeller svarer på CPU'en med nogle få tokens i sekundet. Det duer til korte opgaver og private eksperimenter, ikke til en kvik chat med lange svar.

Kan jeg bruge det på en NAT-plan?

Ja, via en SSH-tunnel på din personlige SSH-port. Til en offentlig HTTPS-adresse, som dit team åbner i en browser, skal du bruge en plan med dedikeret IP.

Hvem kan oprette konti?

Den første registrerede konto bliver administrator. Sæt derefter nye tilmeldinger til afventende, eller slå dem fra i administratorindstillingerne, ellers kan alle, der finder URL'en, oprette en konto.

Hvor bliver mine samtaler gemt?

I en Docker-volume på din server. Intet går til tredjeparter, bortset fra de prompts, du sender til den model-API, du har forbundet.

Kommentarer

Ingen kommentarer endnu. Vær den første.

Skriv en kommentar

Kommentarer modereres, før de vises.