−25%

Windows کی سالانہ ادائیگی پر، 31 اکتوبر تک۔ پلانز دیکھیں

EQVPS

Open WebUI کے لیے VPS: LLMs کے لیے نجی چیٹ انٹرفیس

Open WebUI کو VPS پر کسی بھی OpenAI سے مطابقت رکھنے والی API یا مقامی Ollama ماڈلز کے لیے نجی چیٹ انٹرفیس کے طور پر ہوسٹ کریں: Docker، محفوظ رسائی اور سائز کا انتخاب۔

آپ تین مختلف ماڈل فراہم کنندگان استعمال کرتے ہیں، ہر ایک کی اپنی چیٹ ونڈو، سبسکرپشن اور ہسٹری۔ Open WebUI انہیں ایک ایسے انٹرفیس کے پیچھے جمع کرتا ہے جسے آپ خود ہوسٹ کرتے ہیں: ہر گفتگو کے لیے ماڈل چنیں، ساری ہسٹری اپنے سرور پر رکھیں، ٹیم کے ساتھ شیئر کریں، اور جب کچھ بھی مشین سے باہر نہ جانا ہو تو مقامی ماڈلز جوڑیں۔

اسے چلانے کے دو طریقے

APIs کے لیے انٹرفیس کے طور پر۔ Open WebUI کسی بھی OpenAI سے مطابقت رکھنے والی API سے جڑتا ہے — ہوسٹڈ فراہم کنندگان، LiteLLM پراکسی یا آپ کا اپنا اینڈ پوائنٹ۔ سرور تقریباً کچھ نہیں کرتا؛ چھوٹا پلان کافی سے زیادہ ہے۔

مقامی ماڈلز کے ساتھ۔ اسی سرور پر Ollama شامل کریں اور کھلے ویٹس والے ماڈلز مقامی طور پر چلائیں۔ اب RAM حد ہے، اور CPU پر انفرنس سست ہے۔ ایماندارانہ سودا: مکمل پرائیویسی، معمولی رفتار۔

سیٹ اپپلان
API انٹرفیس، ذاتی استعمالMicro — 1 vCPU، 2 GB، $5 ماہانہ (SSH ٹنل)
API انٹرفیس، HTTPS پر ٹیم کی رسائیMicro-IP — 1 vCPU، 2 GB، $10 ماہانہ
Ollama کے ذریعے مقامی 3B ماڈلزAI-Agent — 2 vCPU، 4 GB، $10 ماہانہ
مقامی 7–8B ماڈلزMedium — 4 vCPU، 6 GB، $12 ماہانہ، یا بڑے ماڈلز کے لیے Pro پلانز

Docker سے انسٹالیشن

Docker انسٹال شدہ سرور پر:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

127.0.0.1 پر باندھنا اسے پبلک انٹرنیٹ سے تب تک دور رکھتا ہے جب تک آپ طے نہ کریں کہ اسے کیسے کھولنا ہے۔ چیٹس، صارفین اور سیٹنگز open-webui والیوم میں رہتے ہیں۔

محفوظ رسائی

SSH ٹنل — ہر پلان پر چلتا ہے، NAT سمیت:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

http://localhost:3000 کھولیں۔ NAT پلان پر اپنا ذاتی SSH پورٹ استعمال کریں۔

آپ کے ڈومین پر HTTPS — مخصوص IP والے پلان پر ٹیم کے لیے۔ ایک سب ڈومین کو سرور سے جوڑیں (گائیڈ) اور nginx سے پراکسی کریں، WebSocket ہیڈرز سمیت:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

پھر certbot --nginx -d chat.example.com چلائیں۔ لمبا ریڈ ٹائم آؤٹ اہم ہے: سست ماڈلز کئی منٹ تک جوابات اسٹریم کرتے ہیں۔

اندر پہلے قدم

  1. فوراً رجسٹر کریں۔ پہلا اکاؤنٹ ایڈمن بنتا ہے۔ نئی انسٹالیشن کو پبلک نہ چھوڑیں — کوئی اور اسے اپنا سکتا ہے۔
  2. رجسٹریشن بند کریں۔ ایڈمن سیٹنگز ← نئے صارفین کا ڈیفالٹ کردار زیر التوا کریں، یا رجسٹریشن بند کر دیں۔
  3. ایک کنکشن شامل کریں۔ سیٹنگز ← کنکشنز ← API کا بیس URL اور کلید پیسٹ کریں۔ اس فراہم کنندہ کے ماڈلز ماڈل چننے والی فہرست میں آ جاتے ہیں۔

مقامی ماڈلز شامل کرنا

ہوسٹ پر Ollama انسٹال کریں (ہماری گائیڈ)، ایک چھوٹا ماڈل لائیں، اور Open WebUI کو اس طرح شروع کریں کہ وہ اس تک پہنچ سکے:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

والیوم ری اسٹارٹ کے بعد بھی آپ کی چیٹس رکھتا ہے۔ CPU پر چند ٹوکن فی سیکنڈ کی توقع رکھیں — خلاصوں اور نجی نوٹس کے لیے ٹھیک، لمبی تحریروں کے لیے سست۔ زیادہ بھاری مقامی انفرنس کے لیے Ollama کے لیے VPS دیکھیں۔

جاننے کے قابل

پلانز کی حدود اور اپ گریڈ پلانز کی دستاویزات میں ہیں۔

تعینات کے لیے تیار؟ کرپٹو میں ادائیگی کریں، بغیر KYC — تقریباً ایک منٹ میں لائیو۔

ابھی ڈیپلائے کریں →

عمومی سوالات

Open WebUI کو کتنی RAM چاہیے؟

Open WebUI خود تقریباً 1 GB میں چلتا ہے۔ اگر یہ صرف ریموٹ APIs سے بات کرتا ہے تو 2 GB والا پلان کافی ہے۔ میموری Ollama کے ذریعے مقامی ماڈلز مانگتے ہیں — چھوٹے 3B ماڈلز کے لیے 4 GB، اور 7–8B ماڈلز کے لیے 6 GB یا زیادہ۔

کیا میں GPU کے بغیر VPS پر مقامی ماڈلز چلا سکتا ہوں؟

ہاں، حقیقت پسندانہ توقعات کے ساتھ۔ چھوٹے کوانٹائزڈ ماڈلز CPU پر چند ٹوکن فی سیکنڈ کی رفتار سے جواب دیتے ہیں۔ یہ مختصر کاموں اور نجی تجربات کے لیے ٹھیک ہے، لمبے جوابات والی تیز چیٹ کے لیے نہیں۔

کیا میں اسے NAT پلان پر استعمال کر سکتا ہوں؟

ہاں، اپنے ذاتی SSH پورٹ پر SSH ٹنل کے ذریعے۔ ایسے پبلک HTTPS ایڈریس کے لیے جسے آپ کی ٹیم براؤزر میں کھولے، مخصوص IP والا پلان چاہیے۔

اکاؤنٹس کون بنا سکتا ہے؟

پہلا رجسٹر ہونے والا اکاؤنٹ ایڈمن بن جاتا ہے۔ اس کے بعد نئی رجسٹریشنز کو زیر التوا کر دیں یا ایڈمن سیٹنگز میں بند کر دیں، ورنہ URL ڈھونڈنے والا کوئی بھی اکاؤنٹ بنا سکتا ہے۔

میری گفتگو کہاں محفوظ ہوتی ہے؟

آپ کے سرور پر ایک Docker والیوم میں۔ کچھ بھی تیسرے فریق کو نہیں جاتا، سوائے ان پرامپٹس کے جو آپ منسلک ماڈل API کو بھیجتے ہیں۔

تبصرے

ابھی کوئی تبصرہ نہیں۔ پہلے بنیں۔

ایک تبصرہ چھوڑیں

تبصرے ظاہر ہونے سے پہلے moderate کیے جاتے ہیں۔