آپ تین مختلف ماڈل فراہم کنندگان استعمال کرتے ہیں، ہر ایک کی اپنی چیٹ ونڈو، سبسکرپشن اور ہسٹری۔ Open WebUI انہیں ایک ایسے انٹرفیس کے پیچھے جمع کرتا ہے جسے آپ خود ہوسٹ کرتے ہیں: ہر گفتگو کے لیے ماڈل چنیں، ساری ہسٹری اپنے سرور پر رکھیں، ٹیم کے ساتھ شیئر کریں، اور جب کچھ بھی مشین سے باہر نہ جانا ہو تو مقامی ماڈلز جوڑیں۔
اسے چلانے کے دو طریقے
APIs کے لیے انٹرفیس کے طور پر۔ Open WebUI کسی بھی OpenAI سے مطابقت رکھنے والی API سے جڑتا ہے — ہوسٹڈ فراہم کنندگان، LiteLLM پراکسی یا آپ کا اپنا اینڈ پوائنٹ۔ سرور تقریباً کچھ نہیں کرتا؛ چھوٹا پلان کافی سے زیادہ ہے۔
مقامی ماڈلز کے ساتھ۔ اسی سرور پر Ollama شامل کریں اور کھلے ویٹس والے ماڈلز مقامی طور پر چلائیں۔ اب RAM حد ہے، اور CPU پر انفرنس سست ہے۔ ایماندارانہ سودا: مکمل پرائیویسی، معمولی رفتار۔
| سیٹ اپ | پلان |
|---|---|
| API انٹرفیس، ذاتی استعمال | Micro — 1 vCPU، 2 GB، $5 ماہانہ (SSH ٹنل) |
| API انٹرفیس، HTTPS پر ٹیم کی رسائی | Micro-IP — 1 vCPU، 2 GB، $10 ماہانہ |
| Ollama کے ذریعے مقامی 3B ماڈلز | AI-Agent — 2 vCPU، 4 GB، $10 ماہانہ |
| مقامی 7–8B ماڈلز | Medium — 4 vCPU، 6 GB، $12 ماہانہ، یا بڑے ماڈلز کے لیے Pro پلانز |
Docker سے انسٹالیشن
Docker انسٹال شدہ سرور پر:
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 \
-v open-webui:/app/backend/data \
ghcr.io/open-webui/open-webui:main
127.0.0.1 پر باندھنا اسے پبلک انٹرنیٹ سے تب تک دور رکھتا ہے جب تک آپ طے نہ کریں کہ اسے کیسے کھولنا ہے۔ چیٹس، صارفین اور سیٹنگز open-webui والیوم میں رہتے ہیں۔
محفوظ رسائی
SSH ٹنل — ہر پلان پر چلتا ہے، NAT سمیت:
ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10
http://localhost:3000 کھولیں۔ NAT پلان پر اپنا ذاتی SSH پورٹ استعمال کریں۔
آپ کے ڈومین پر HTTPS — مخصوص IP والے پلان پر ٹیم کے لیے۔ ایک سب ڈومین کو سرور سے جوڑیں (گائیڈ) اور nginx سے پراکسی کریں، WebSocket ہیڈرز سمیت:
location / {
proxy_pass http://127.0.0.1:3000;
proxy_set_header Host $host;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
proxy_read_timeout 300s;
}
پھر certbot --nginx -d chat.example.com چلائیں۔ لمبا ریڈ ٹائم آؤٹ اہم ہے: سست ماڈلز کئی منٹ تک جوابات اسٹریم کرتے ہیں۔
اندر پہلے قدم
- فوراً رجسٹر کریں۔ پہلا اکاؤنٹ ایڈمن بنتا ہے۔ نئی انسٹالیشن کو پبلک نہ چھوڑیں — کوئی اور اسے اپنا سکتا ہے۔
- رجسٹریشن بند کریں۔ ایڈمن سیٹنگز ← نئے صارفین کا ڈیفالٹ کردار زیر التوا کریں، یا رجسٹریشن بند کر دیں۔
- ایک کنکشن شامل کریں۔ سیٹنگز ← کنکشنز ← API کا بیس URL اور کلید پیسٹ کریں۔ اس فراہم کنندہ کے ماڈلز ماڈل چننے والی فہرست میں آ جاتے ہیں۔
مقامی ماڈلز شامل کرنا
ہوسٹ پر Ollama انسٹال کریں (ہماری گائیڈ)، ایک چھوٹا ماڈل لائیں، اور Open WebUI کو اس طرح شروع کریں کہ وہ اس تک پہنچ سکے:
ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main
والیوم ری اسٹارٹ کے بعد بھی آپ کی چیٹس رکھتا ہے۔ CPU پر چند ٹوکن فی سیکنڈ کی توقع رکھیں — خلاصوں اور نجی نوٹس کے لیے ٹھیک، لمبی تحریروں کے لیے سست۔ زیادہ بھاری مقامی انفرنس کے لیے Ollama کے لیے VPS دیکھیں۔
جاننے کے قابل
- اپ ڈیٹس بار بار آتی ہیں۔
docker pull ghcr.io/open-webui/open-webui:main، پھر کنٹینر دوبارہ بنائیں۔ پہلے والیوم کا بیک اپ لیں۔ - API کے اخراجات آپ کے ذمے ہیں۔ Open WebUI ڈیفالٹ طور پر فی صارف استعمال محدود نہیں کرتا؛ ٹیم کے ساتھ شیئر کریں تو خرچ پر نظر رکھیں۔
- یہ چیٹ ایپ ہے، ماڈل نہیں۔ جوابات کا معیار مکمل طور پر اس کے پیچھے موجود ماڈل پر منحصر ہے۔
پلانز کی حدود اور اپ گریڈ پلانز کی دستاویزات میں ہیں۔
تبصرے
ابھی کوئی تبصرہ نہیں۔ پہلے بنیں۔