आप तीन अलग मॉडल प्रदाता इस्तेमाल करते हैं, हर एक की अपनी चैट विंडो, सब्सक्रिप्शन और हिस्ट्री। Open WebUI उन्हें एक ऐसे इंटरफ़ेस के पीछे लाता है जिसे आप ख़ुद होस्ट करते हैं: हर बातचीत के लिए मॉडल चुनें, पूरी हिस्ट्री अपने सर्वर पर रखें, टीम के साथ शेयर करें, और जब कुछ भी मशीन से बाहर न जाना हो तो लोकल मॉडल जोड़ें।
इसे चलाने के दो तरीक़े
API के इंटरफ़ेस के रूप में। Open WebUI किसी भी OpenAI-संगत API से जुड़ता है — होस्टेड प्रदाता, LiteLLM प्रॉक्सी या आपका अपना एंडपॉइंट। सर्वर लगभग कुछ नहीं करता; छोटा प्लान काफ़ी से ज़्यादा है।
लोकल मॉडल के साथ। उसी सर्वर पर Ollama जोड़ें और ओपन-वेट मॉडल लोकल चलाएँ। अब RAM सीमा है, और CPU पर इन्फ़रेंस धीमा है। ईमानदार सौदा: पूरी निजता, मामूली रफ़्तार।
| सेटअप | प्लान |
|---|---|
| API इंटरफ़ेस, निजी इस्तेमाल | Micro — 1 vCPU, 2 GB, $5 प्रति माह (SSH टनल) |
| API इंटरफ़ेस, HTTPS पर टीम एक्सेस | Micro-IP — 1 vCPU, 2 GB, $10 प्रति माह |
| Ollama के ज़रिए लोकल 3B मॉडल | AI-Agent — 2 vCPU, 4 GB, $10 प्रति माह |
| लोकल 7–8B मॉडल | Medium — 4 vCPU, 6 GB, $12 प्रति माह, या बड़े मॉडल के लिए Pro प्लान |
Docker से इंस्टॉल
Docker इंस्टॉल किए सर्वर पर:
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 \
-v open-webui:/app/backend/data \
ghcr.io/open-webui/open-webui:main
127.0.0.1 पर बाँधना इसे पब्लिक इंटरनेट से तब तक दूर रखता है जब तक आप तय न करें कि इसे कैसे खोलना है। चैट, यूज़र और सेटिंग्स open-webui वॉल्यूम में रहते हैं।
सुरक्षित एक्सेस
SSH टनल — हर प्लान पर चलता है, NAT समेत:
ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10
http://localhost:3000 खोलें। NAT प्लान पर अपना निजी SSH पोर्ट इस्तेमाल करें।
आपके डोमेन पर HTTPS — डेडिकेटेड IP वाले प्लान पर टीम के लिए। एक सबडोमेन को सर्वर पर पॉइंट करें (गाइड) और nginx से प्रॉक्सी करें, WebSocket हेडर समेत:
location / {
proxy_pass http://127.0.0.1:3000;
proxy_set_header Host $host;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
proxy_read_timeout 300s;
}
फिर certbot --nginx -d chat.example.com चलाएँ। लंबा रीड टाइमआउट अहम है: धीमे मॉडल कई मिनट तक जवाब स्ट्रीम करते हैं।
अंदर पहले क़दम
- तुरंत रजिस्टर करें। पहला अकाउंट एडमिन बनता है। नया इंस्टॉल पब्लिक न छोड़ें — कोई और उसे हथिया सकता है।
- रजिस्ट्रेशन बंद करें। एडमिन सेटिंग्स ← नए यूज़र की डिफ़ॉल्ट भूमिका पेंडिंग करें, या रजिस्ट्रेशन बंद करें।
- कनेक्शन जोड़ें। सेटिंग्स ← कनेक्शन ← API का बेस URL और कुंजी पेस्ट करें। उस प्रदाता के मॉडल मॉडल चुनने वाली सूची में आ जाते हैं।
लोकल मॉडल जोड़ना
होस्ट पर Ollama इंस्टॉल करें (हमारी गाइड), एक छोटा मॉडल लाएँ, और Open WebUI को ऐसे शुरू करें कि वह उस तक पहुँच सके:
ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main
वॉल्यूम रीस्टार्ट के बाद भी आपकी चैट रखता है। CPU पर कुछ टोकन प्रति सेकंड की उम्मीद रखें — सारांश और निजी नोट के लिए ठीक, लंबे लेखों के लिए धीमा। भारी लोकल इन्फ़रेंस के लिए Ollama के लिए VPS देखें।
जानने लायक़
- अपडेट बार-बार आते हैं।
docker pull ghcr.io/open-webui/open-webui:main, फिर कंटेनर दोबारा बनाएँ। पहले वॉल्यूम का बैकअप लें। - API का ख़र्च आपका है। Open WebUI डिफ़ॉल्ट रूप से प्रति यूज़र इस्तेमाल सीमित नहीं करता; टीम के साथ शेयर करें तो ख़र्च पर नज़र रखें।
- यह चैट ऐप है, मॉडल नहीं। जवाबों की गुणवत्ता पूरी तरह उसके पीछे के मॉडल पर निर्भर है।
प्लान की सीमाएँ और अपग्रेड प्लान दस्तावेज़ में हैं।
टिप्पणियाँ
अभी तक कोई टिप्पणी नहीं। पहले बनें।