−25%

על Windows בתשלום שנתי, עד 31.10. לחבילות

EQVPS

VPS ל-Open WebUI: ממשק צ'אט פרטי למודלי שפה

ארחו את Open WebUI ב-VPS כממשק צ'אט פרטי לכל API תואם OpenAI או למודלי Ollama מקומיים: התקנה עם Docker, גישה בטוחה ובחירת גודל.

אתם משתמשים בשלושה ספקי מודלים שונים, לכל אחד חלון צ'אט, מנוי והיסטוריה משלו. Open WebUI מאחד אותם מאחורי ממשק אחד שאתם מארחים: בוחרים מודל לכל שיחה, שומרים את כל ההיסטוריה על השרת שלכם, משתפים עם הצוות ומחברים מודלים מקומיים כששום דבר לא אמור לצאת מהמכונה.

שתי דרכים להריץ את זה

כממשק ל-APIs. Open WebUI מתחבר לכל API תואם OpenAI — ספקים מתארחים, proxy של LiteLLM או endpoint משלכם. השרת כמעט לא עושה כלום; תוכנית קטנה יותר ממספיקה.

עם מודלים מקומיים. הוסיפו Ollama על אותו שרת והריצו מקומית מודלים עם משקלים פתוחים. עכשיו ה-RAM הוא המגבלה, והסקה על מעבד איטית. הפשרה הכנה: פרטיות מלאה, מהירות צנועה.

תצורהתוכנית
ממשק API, שימוש אישיMicro — 1 vCPU, 2 GB, $5 לחודש (מנהרת SSH)
ממשק API, גישת צוות דרך HTTPSMicro-IP — 1 vCPU, 2 GB, $10 לחודש
מודלי 3B מקומיים דרך OllamaAI-Agent — 2 vCPU, 4 GB, $10 לחודש
מודלי 7–8B מקומייםMedium — 4 vCPU, 6 GB, $12 לחודש, או תוכניות Pro לגדולים יותר

התקנה עם Docker

בשרת עם Docker מותקן:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

הקישור ל-127.0.0.1 משאיר אותו מחוץ לאינטרנט הציבורי עד שתחליטו איך לחשוף אותו. צ'אטים, משתמשים והגדרות חיים ב-volume open-webui.

גישה בטוחה

מנהרת SSH — עובדת בכל התוכניות, כולל NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

פתחו את http://localhost:3000. בתוכנית NAT השתמשו בפורט ה-SSH האישי שלכם.

HTTPS על הדומיין שלכם — לצוות בתוכנית עם IP ייעודי. כוונו תת-דומיין לשרת (מדריך) והעבירו אותו דרך nginx, כולל כותרות WebSocket:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

אחר כך הריצו certbot --nginx -d chat.example.com. זמן הקריאה הארוך חשוב: מודלים איטיים משדרים תשובות במשך דקות.

הצעדים הראשונים בפנים

  1. הירשמו מיד. החשבון הראשון הופך למנהל. אל תשאירו התקנה חדשה פתוחה לציבור — מישהו אחר עלול לתפוס אותה.
  2. סגרו הרשמות. הגדרות ניהול ← הגדירו את תפקיד ברירת המחדל למשתמשים חדשים כממתין, או כבו את ההרשמה.
  3. הוסיפו חיבור. הגדרות ← חיבורים ← הדביקו כתובת בסיס של API ומפתח. המודלים של הספק הזה יופיעו בבורר המודלים.

הוספת מודלים מקומיים

התקינו Ollama על המארח (המדריך שלנו), משכו מודל קטן והפעילו את Open WebUI כך שיוכל להגיע אליו:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

ה-volume שומר את הצ'אטים שלכם בהפעלה מחדש. צפו לכמה טוקנים לשנייה על מעבד — טוב לסיכומים ולהערות פרטיות, איטי לטקסטים ארוכים. להסקה מקומית כבדה יותר, ראו VPS ל-Ollama.

כדאי לדעת

מגבלות ושדרוגים של התוכניות בתיעוד התוכניות.

מוכנים להקים? שלמו בקריפטו, ללא KYC — חי בערך תוך דקה.

הקימו עכשיו →

שאלות נפוצות

כמה RAM צריך Open WebUI?

Open WebUI עצמו רץ עם בערך 1 GB. אם הוא מדבר רק עם APIs מרוחקים, תוכנית של 2 GB מספיקה. את הזיכרון דורשים המודלים המקומיים דרך Ollama — 4 GB למודלים קטנים של 3B, ו-6 GB ומעלה למודלים של 7–8B.

אפשר להריץ מודלים מקומיים ב-VPS בלי GPU?

כן, עם ציפיות מציאותיות. מודלים קטנים ומכומתים עונים על המעבד בקצב של כמה טוקנים לשנייה. זה מתאים למשימות קצרות ולניסויים פרטיים, לא לצ'אט זריז עם תשובות ארוכות.

אפשר להשתמש בזה בתוכנית NAT?

כן, דרך מנהרת SSH בפורט ה-SSH האישי שלכם. לכתובת HTTPS ציבורית שהצוות פותח בדפדפן צריך תוכנית עם IP ייעודי.

מי יכול ליצור חשבונות?

החשבון הראשון שנרשם הופך למנהל. אחר כך הגדירו הרשמות חדשות כממתינות או כבו אותן בהגדרות הניהול, אחרת כל מי שמוצא את הכתובת יכול לפתוח חשבון.

איפה השיחות שלי נשמרות?

ב-volume של Docker על השרת שלכם. שום דבר לא עובר לצד שלישי, חוץ מהפרומפטים שאתם שולחים ל-API של המודל שחיברתם.

תגובות

אין עדיין תגובות. היו הראשונים.

השאירו תגובה

התגובות עוברות מודרציה לפני שהן מופיעות.