−25%

Windows के सालाना भुगतान पर, 31 अक्टूबर तक। प्लान देखें

EQVPS

Open WebUI के लिए VPS: LLM के लिए निजी चैट इंटरफ़ेस

Open WebUI को VPS पर किसी भी OpenAI-संगत API या लोकल Ollama मॉडल के लिए निजी चैट इंटरफ़ेस के रूप में होस्ट करें: Docker, सुरक्षित एक्सेस और सही आकार।

आप तीन अलग मॉडल प्रदाता इस्तेमाल करते हैं, हर एक की अपनी चैट विंडो, सब्सक्रिप्शन और हिस्ट्री। Open WebUI उन्हें एक ऐसे इंटरफ़ेस के पीछे लाता है जिसे आप ख़ुद होस्ट करते हैं: हर बातचीत के लिए मॉडल चुनें, पूरी हिस्ट्री अपने सर्वर पर रखें, टीम के साथ शेयर करें, और जब कुछ भी मशीन से बाहर न जाना हो तो लोकल मॉडल जोड़ें।

इसे चलाने के दो तरीक़े

API के इंटरफ़ेस के रूप में। Open WebUI किसी भी OpenAI-संगत API से जुड़ता है — होस्टेड प्रदाता, LiteLLM प्रॉक्सी या आपका अपना एंडपॉइंट। सर्वर लगभग कुछ नहीं करता; छोटा प्लान काफ़ी से ज़्यादा है।

लोकल मॉडल के साथ। उसी सर्वर पर Ollama जोड़ें और ओपन-वेट मॉडल लोकल चलाएँ। अब RAM सीमा है, और CPU पर इन्फ़रेंस धीमा है। ईमानदार सौदा: पूरी निजता, मामूली रफ़्तार।

सेटअपप्लान
API इंटरफ़ेस, निजी इस्तेमालMicro — 1 vCPU, 2 GB, $5 प्रति माह (SSH टनल)
API इंटरफ़ेस, HTTPS पर टीम एक्सेसMicro-IP — 1 vCPU, 2 GB, $10 प्रति माह
Ollama के ज़रिए लोकल 3B मॉडलAI-Agent — 2 vCPU, 4 GB, $10 प्रति माह
लोकल 7–8B मॉडलMedium — 4 vCPU, 6 GB, $12 प्रति माह, या बड़े मॉडल के लिए Pro प्लान

Docker से इंस्टॉल

Docker इंस्टॉल किए सर्वर पर:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

127.0.0.1 पर बाँधना इसे पब्लिक इंटरनेट से तब तक दूर रखता है जब तक आप तय न करें कि इसे कैसे खोलना है। चैट, यूज़र और सेटिंग्स open-webui वॉल्यूम में रहते हैं।

सुरक्षित एक्सेस

SSH टनल — हर प्लान पर चलता है, NAT समेत:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

http://localhost:3000 खोलें। NAT प्लान पर अपना निजी SSH पोर्ट इस्तेमाल करें।

आपके डोमेन पर HTTPS — डेडिकेटेड IP वाले प्लान पर टीम के लिए। एक सबडोमेन को सर्वर पर पॉइंट करें (गाइड) और nginx से प्रॉक्सी करें, WebSocket हेडर समेत:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

फिर certbot --nginx -d chat.example.com चलाएँ। लंबा रीड टाइमआउट अहम है: धीमे मॉडल कई मिनट तक जवाब स्ट्रीम करते हैं।

अंदर पहले क़दम

  1. तुरंत रजिस्टर करें। पहला अकाउंट एडमिन बनता है। नया इंस्टॉल पब्लिक न छोड़ें — कोई और उसे हथिया सकता है।
  2. रजिस्ट्रेशन बंद करें। एडमिन सेटिंग्स ← नए यूज़र की डिफ़ॉल्ट भूमिका पेंडिंग करें, या रजिस्ट्रेशन बंद करें।
  3. कनेक्शन जोड़ें। सेटिंग्स ← कनेक्शन ← API का बेस URL और कुंजी पेस्ट करें। उस प्रदाता के मॉडल मॉडल चुनने वाली सूची में आ जाते हैं।

लोकल मॉडल जोड़ना

होस्ट पर Ollama इंस्टॉल करें (हमारी गाइड), एक छोटा मॉडल लाएँ, और Open WebUI को ऐसे शुरू करें कि वह उस तक पहुँच सके:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

वॉल्यूम रीस्टार्ट के बाद भी आपकी चैट रखता है। CPU पर कुछ टोकन प्रति सेकंड की उम्मीद रखें — सारांश और निजी नोट के लिए ठीक, लंबे लेखों के लिए धीमा। भारी लोकल इन्फ़रेंस के लिए Ollama के लिए VPS देखें।

जानने लायक़

प्लान की सीमाएँ और अपग्रेड प्लान दस्तावेज़ में हैं।

तैनात करने के लिए तैयार? क्रिप्टो से भुगतान करें, बिना KYC — लगभग एक मिनट में ऑनलाइन।

अभी तैनात करें →

FAQ

Open WebUI को कितनी RAM चाहिए?

Open WebUI ख़ुद लगभग 1 GB में चलता है। अगर यह सिर्फ़ रिमोट API से बात करता है तो 2 GB वाला प्लान काफ़ी है। मेमोरी Ollama के ज़रिए लोकल मॉडल माँगते हैं — छोटे 3B मॉडल के लिए 4 GB, और 7–8B मॉडल के लिए 6 GB या ज़्यादा।

क्या बिना GPU वाले VPS पर लोकल मॉडल चला सकता हूँ?

हाँ, व्यावहारिक उम्मीदों के साथ। छोटे क्वांटाइज़्ड मॉडल CPU पर कुछ टोकन प्रति सेकंड की रफ़्तार से जवाब देते हैं। यह छोटे कामों और निजी प्रयोगों के लिए ठीक है, लंबे जवाबों वाली तेज़ चैट के लिए नहीं।

क्या मैं इसे NAT प्लान पर इस्तेमाल कर सकता हूँ?

हाँ, अपने निजी SSH पोर्ट पर SSH टनल के ज़रिए। ऐसे पब्लिक HTTPS पते के लिए जिसे आपकी टीम ब्राउज़र में खोले, डेडिकेटेड IP वाला प्लान चाहिए।

अकाउंट कौन बना सकता है?

पहला रजिस्टर होने वाला अकाउंट एडमिन बन जाता है। उसके बाद नए रजिस्ट्रेशन को पेंडिंग पर रखें या एडमिन सेटिंग्स में बंद कर दें, वरना URL ढूँढने वाला कोई भी अकाउंट बना सकता है।

मेरी बातचीत कहाँ सेव होती है?

आपके सर्वर पर एक Docker वॉल्यूम में। कुछ भी तीसरे पक्ष को नहीं जाता, सिवाय उन प्रॉम्प्ट के जो आप जोड़े गए मॉडल API को भेजते हैं।

टिप्पणियाँ

अभी तक कोई टिप्पणी नहीं। पहले बनें।

एक टिप्पणी छोड़ें

टिप्पणियाँ दिखने से पहले मॉडरेट की जाती हैं।