−25%

στα Windows με ετήσια χρέωση, έως 31/10. Δείτε τα πακέτα

EQVPS

VPS για Open WebUI: ιδιωτικό περιβάλλον chat για LLM

Φιλοξενήστε το Open WebUI σε VPS ως ιδιωτικό chat για οποιοδήποτε API συμβατό με OpenAI ή τοπικά μοντέλα Ollama: Docker, ασφαλής πρόσβαση και διαστασιολόγηση.

Χρησιμοποιείτε τρεις διαφορετικούς παρόχους μοντέλων, ο καθένας με το δικό του παράθυρο chat, συνδρομή και ιστορικό. Το Open WebUI τους βάζει πίσω από ένα περιβάλλον που φιλοξενείτε εσείς: διαλέγετε μοντέλο ανά συνομιλία, κρατάτε όλο το ιστορικό στον server σας, το μοιράζεστε με την ομάδα και συνδέετε τοπικά μοντέλα όταν τίποτα δεν πρέπει να φύγει από το μηχάνημα.

Δύο τρόποι να το τρέξετε

Ως περιβάλλον για API. Το Open WebUI συνδέεται σε οποιοδήποτε API συμβατό με OpenAI — φιλοξενούμενους παρόχους, έναν LiteLLM proxy ή δικό σας endpoint. Ο server δεν κάνει σχεδόν τίποτα· ένα μικρό πλάνο αρκεί και περισσεύει.

Με τοπικά μοντέλα. Προσθέστε το Ollama στον ίδιο server και τρέξτε τοπικά μοντέλα ανοιχτών βαρών. Τώρα ο περιορισμός είναι η RAM, και η εκτέλεση σε CPU είναι αργή. Ο ειλικρινής συμβιβασμός: πλήρης ιδιωτικότητα, μέτρια ταχύτητα.

ΔιάταξηΠλάνο
Περιβάλλον API, προσωπική χρήσηMicro — 1 vCPU, 2 GB, $5/μήνα (SSH tunnel)
Περιβάλλον API, πρόσβαση ομάδας μέσω HTTPSMicro-IP — 1 vCPU, 2 GB, $10/μήνα
Τοπικά μοντέλα 3B μέσω OllamaAI-Agent — 2 vCPU, 4 GB, $10/μήνα
Τοπικά μοντέλα 7–8BMedium — 4 vCPU, 6 GB, $12/μήνα, ή πλάνα Pro για μεγαλύτερα

Εγκατάσταση με Docker

Σε server με εγκατεστημένο Docker:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

Η δέσμευση στο 127.0.0.1 το κρατά εκτός δημόσιου internet μέχρι να αποφασίσετε πώς θα το εκθέσετε. Συνομιλίες, χρήστες και ρυθμίσεις ζουν στο volume open-webui.

Ασφαλής πρόσβαση

SSH tunnel — δουλεύει σε όλα τα πλάνα, και σε NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

Ανοίξτε το http://localhost:3000. Σε πλάνο NAT χρησιμοποιήστε την προσωπική σας θύρα SSH.

HTTPS στο domain σας — για ομάδα σε πλάνο με αποκλειστική IP. Δείξτε ένα subdomain στον server (οδηγός) και κάντε proxy με nginx, μαζί με τα headers για WebSocket:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

Μετά τρέξτε certbot --nginx -d chat.example.com. Το μεγάλο timeout ανάγνωσης μετράει: τα αργά μοντέλα στέλνουν απαντήσεις για λεπτά.

Πρώτα βήματα μέσα

  1. Εγγραφείτε αμέσως. Ο πρώτος λογαριασμός γίνεται διαχειριστής. Μην αφήνετε μια φρέσκια εγκατάσταση δημόσια — μπορεί να την «πάρει» κάποιος άλλος.
  2. Κλείστε τις εγγραφές. Ρυθμίσεις διαχειριστή → ορίστε τον προεπιλεγμένο ρόλο νέων χρηστών σε αναμονή, ή απενεργοποιήστε την εγγραφή.
  3. Προσθέστε σύνδεση. Ρυθμίσεις → Συνδέσεις → επικολλήστε το βασικό URL του API και ένα κλειδί. Τα μοντέλα αυτού του παρόχου εμφανίζονται στην επιλογή μοντέλου.

Προσθήκη τοπικών μοντέλων

Εγκαταστήστε το Ollama στον host (ο οδηγός μας), κατεβάστε ένα μικρό μοντέλο και ξεκινήστε το Open WebUI ώστε να μπορεί να το φτάσει:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

Το volume κρατά τις συνομιλίες σας στην επανεκκίνηση. Περιμένετε λίγα tokens το δευτερόλεπτο σε CPU — καλό για περιλήψεις και ιδιωτικές σημειώσεις, αργό για μεγάλα κείμενα. Για βαρύτερη τοπική εκτέλεση, δείτε το VPS για Ollama.

Αξίζει να ξέρετε

Όρια και αναβαθμίσεις των πλάνων στην τεκμηρίωση των πλάνων.

Έτοιμοι για ανάπτυξη; Πληρωμή με crypto, χωρίς KYC — έτοιμο σε περίπου ένα λεπτό.

Ανάπτυξη τώρα →

Συχνές ερωτήσεις

Πόση RAM χρειάζεται το Open WebUI;

Το ίδιο το Open WebUI τρέχει με περίπου 1 GB. Αν μιλά μόνο με απομακρυσμένα API, αρκεί πλάνο με 2 GB. Τη μνήμη τη ζητούν τα τοπικά μοντέλα μέσω Ollama — 4 GB για μικρά μοντέλα 3B, 6 GB ή περισσότερα για μοντέλα 7–8B.

Μπορώ να τρέξω τοπικά μοντέλα σε VPS χωρίς GPU;

Ναι, με ρεαλιστικές προσδοκίες. Τα μικρά κβαντισμένα μοντέλα απαντούν στη CPU με λίγα tokens το δευτερόλεπτο. Κάνει για σύντομες εργασίες και ιδιωτικές δοκιμές, όχι για γρήγορο chat με μεγάλες απαντήσεις.

Μπορώ να το χρησιμοποιήσω σε πλάνο NAT;

Ναι, μέσω SSH tunnel στην προσωπική σας θύρα SSH. Για δημόσια διεύθυνση HTTPS που θα ανοίγει η ομάδα σας στον browser, χρειάζεστε πλάνο με αποκλειστική IP.

Ποιος μπορεί να δημιουργεί λογαριασμούς;

Ο πρώτος λογαριασμός που εγγράφεται γίνεται διαχειριστής. Μετά βάλτε τις νέες εγγραφές σε αναμονή ή απενεργοποιήστε τις στις ρυθμίσεις διαχειριστή, αλλιώς όποιος βρει το URL μπορεί να φτιάξει λογαριασμό.

Πού αποθηκεύονται οι συνομιλίες μου;

Σε ένα Docker volume στον server σας. Τίποτα δεν πάει σε τρίτους, εκτός από τα prompts που στέλνετε στο API του μοντέλου που έχετε συνδέσει.

Σχόλια

Δεν υπάρχουν ακόμη σχόλια. Γίνετε ο πρώτος.

Αφήστε ένα σχόλιο

Τα σχόλια ελέγχονται πριν εμφανιστούν.