আপনি তিনটে আলাদা মডেল সরবরাহকারী ব্যবহার করেন, প্রত্যেকের নিজস্ব চ্যাট উইন্ডো, সাবস্ক্রিপশন আর ইতিহাস। Open WebUI এদের একটা ইন্টারফেসের পেছনে আনে যা আপনি নিজে হোস্ট করেন: প্রতিটি কথোপকথনে মডেল বাছুন, পুরো ইতিহাস নিজের সার্ভারে রাখুন, টিমের সাথে শেয়ার করুন, আর যখন কিছুই মেশিনের বাইরে যাওয়া চলবে না তখন লোকাল মডেল যুক্ত করুন।
চালানোর দুটো উপায়
API-র ইন্টারফেস হিসেবে। Open WebUI যেকোনো OpenAI-সামঞ্জস্যপূর্ণ API-তে যুক্ত হয় — হোস্টেড সরবরাহকারী, একটা LiteLLM প্রক্সি বা আপনার নিজের এন্ডপয়েন্ট। সার্ভার প্রায় কিছুই করে না; ছোট প্ল্যানই যথেষ্টর বেশি।
লোকাল মডেল সহ। একই সার্ভারে Ollama যোগ করুন আর ওপেন-ওয়েট মডেল লোকালি চালান। এখন RAM-ই সীমা, আর CPU-তে ইনফারেন্স ধীর। সৎ লেনদেন: পূর্ণ গোপনীয়তা, সাধারণ গতি।
| সেটআপ | প্ল্যান |
|---|---|
| API ইন্টারফেস, ব্যক্তিগত ব্যবহার | Micro — 1 vCPU, 2 GB, মাসে $5 (SSH টানেল) |
| API ইন্টারফেস, HTTPS দিয়ে টিমের অ্যাক্সেস | Micro-IP — 1 vCPU, 2 GB, মাসে $10 |
| Ollama দিয়ে লোকাল 3B মডেল | AI-Agent — 2 vCPU, 4 GB, মাসে $10 |
| লোকাল 7–8B মডেল | Medium — 4 vCPU, 6 GB, মাসে $12, বা বড় মডেলের জন্য Pro প্ল্যান |
Docker দিয়ে ইনস্টল
Docker ইনস্টল করা সার্ভারে:
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 \
-v open-webui:/app/backend/data \
ghcr.io/open-webui/open-webui:main
127.0.0.1-এ বাঁধলে এটা পাবলিক ইন্টারনেট থেকে দূরে থাকে যতক্ষণ না আপনি ঠিক করেন কীভাবে খুলবেন। চ্যাট, ইউজার আর সেটিংস থাকে open-webui ভলিউমে।
নিরাপদ অ্যাক্সেস
SSH টানেল — সব প্ল্যানে চলে, NAT সহ:
ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10
http://localhost:3000 খুলুন। NAT প্ল্যানে আপনার ব্যক্তিগত SSH পোর্ট ব্যবহার করুন।
আপনার ডোমেইনে HTTPS — ডেডিকেটেড IP প্ল্যানে টিমের জন্য। একটা সাবডোমেইনকে সার্ভারের দিকে নির্দেশ করুন (গাইড) আর nginx দিয়ে প্রক্সি করুন, WebSocket হেডার সহ:
location / {
proxy_pass http://127.0.0.1:3000;
proxy_set_header Host $host;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
proxy_read_timeout 300s;
}
তারপর certbot --nginx -d chat.example.com চালান। লম্বা রিড টাইমআউট জরুরি: ধীর মডেল কয়েক মিনিট ধরে উত্তর স্ট্রিম করে।
ভেতরে প্রথম ধাপ
- এখনই নিবন্ধন করুন। প্রথম অ্যাকাউন্ট অ্যাডমিন হয়। নতুন ইনস্টল পাবলিক ফেলে রাখবেন না — অন্য কেউ দখল করে নিতে পারে।
- নিবন্ধন বন্ধ করুন। অ্যাডমিন সেটিংস ← নতুন ইউজারের ডিফল্ট ভূমিকা পেন্ডিং করুন, বা নিবন্ধন বন্ধ করুন।
- একটা সংযোগ যোগ করুন। সেটিংস ← সংযোগ ← API-র বেস URL আর কী পেস্ট করুন। সেই সরবরাহকারীর মডেল মডেল বাছাইয়ের তালিকায় আসে।
লোকাল মডেল যোগ করা
হোস্টে Ollama ইনস্টল করুন (আমাদের গাইড), একটা ছোট মডেল টানুন, আর Open WebUI এমনভাবে চালু করুন যাতে এটা সেখানে পৌঁছাতে পারে:
ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main
রিস্টার্টের পরও ভলিউম আপনার চ্যাট রাখে। CPU-তে সেকেন্ডে কয়েকটা টোকেন আশা করুন — সারাংশ আর ব্যক্তিগত নোটের জন্য ভালো, লম্বা লেখার জন্য ধীর। ভারী লোকাল ইনফারেন্সের জন্য Ollama-র জন্য VPS দেখুন।
জানা দরকার
- আপডেট ঘন ঘন আসে।
docker pull ghcr.io/open-webui/open-webui:main, তারপর কনটেইনার আবার তৈরি করুন। আগে ভলিউমের ব্যাকআপ নিন। - API-র খরচ আপনার। Open WebUI ডিফল্টভাবে প্রতি ইউজারের ব্যবহার সীমিত করে না; টিমের সাথে শেয়ার করলে খরচে নজর রাখুন।
- এটা চ্যাট অ্যাপ, মডেল নয়। উত্তরের মান পুরোপুরি পেছনের মডেলের ওপর নির্ভর করে।
প্ল্যানের সীমা আর আপগ্রেড প্ল্যানের ডকুমেন্টেশনে আছে।
মন্তব্য
এখনো কোনো মন্তব্য নেই। প্রথম হোন।