−25%

روی پرداخت سالانه Windows، تا ۳۱ اکتبر. مشاهده پلن‌ها

EQVPS

VPS برای Open WebUI: رابط چت خصوصی برای مدل‌های زبانی

Open WebUI را روی VPS به‌عنوان رابط چت خصوصی برای هر API سازگار با OpenAI یا مدل‌های محلی Ollama میزبانی کنید: راه‌اندازی Docker، دسترسی امن و انتخاب اندازه.

از سه سرویس‌دهنده‌ی مدل مختلف استفاده می‌کنید، هر کدام با پنجره‌ی چت، اشتراک و تاریخچه‌ی جداگانه. Open WebUI همه را پشت یک رابط که خودتان میزبانی می‌کنید جمع می‌کند: برای هر گفتگو مدلی انتخاب کنید، کل تاریخچه را روی سرور خودتان نگه دارید، با تیمتان به اشتراک بگذارید و وقتی نمی‌خواهید چیزی از دستگاه بیرون برود، مدل‌های محلی را وصل کنید.

دو روش اجرا

به‌عنوان رابط برای APIها. Open WebUI به هر API سازگار با OpenAI وصل می‌شود — سرویس‌دهنده‌های میزبانی‌شده، یک پراکسی LiteLLM یا اندپوینت خودتان. سرور تقریباً هیچ کاری نمی‌کند؛ یک پلن کوچک بیش از کافی است.

با مدل‌های محلی. Ollama را روی همان سرور اضافه کنید و مدل‌های با وزن باز را محلی اجرا کنید. حالا رم محدودیت است و استنتاج روی CPU کند است. بده‌بستان صادقانه: حریم خصوصی کامل، سرعت متوسط.

پیکربندیپلن
رابط API، استفاده‌ی شخصیMicro — ۱ vCPU، ۲ گیگابایت، ۵ دلار در ماه (تونل SSH)
رابط API، دسترسی تیم از طریق HTTPSMicro-IP — ۱ vCPU، ۲ گیگابایت، ۱۰ دلار در ماه
مدل‌های محلی 3B از طریق OllamaAI-Agent — ۲ vCPU، ۴ گیگابایت، ۱۰ دلار در ماه
مدل‌های محلی 7 تا 8BMedium — ۴ vCPU، ۶ گیگابایت، ۱۲ دلار در ماه، یا پلن‌های Pro برای بزرگ‌ترها

نصب با Docker

روی سروری با Docker نصب‌شده:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

اتصال به 127.0.0.1 آن را تا وقتی تصمیم بگیرید چطور بازش کنید از اینترنت عمومی دور نگه می‌دارد. چت‌ها، کاربران و تنظیمات در ولوم open-webui زندگی می‌کنند.

دسترسی امن

تونل SSH — روی همه‌ی پلن‌ها، از جمله NAT، کار می‌کند:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

http://localhost:3000 را باز کنید. روی پلن NAT از پورت SSH شخصی‌تان استفاده کنید.

HTTPS روی دامنه‌ی شما — برای یک تیم روی پلن IP اختصاصی. یک زیردامنه را به سرور وصل کنید (راهنما) و با nginx، همراه با هدرهای WebSocket، پراکسی کنید:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

سپس certbot --nginx -d chat.example.com را اجرا کنید. مهلت خواندن طولانی مهم است: مدل‌های کند پاسخ‌ها را چند دقیقه استریم می‌کنند.

قدم‌های اول در داخل

  1. فوراً ثبت‌نام کنید. اولین حساب مدیر می‌شود. نصب تازه را عمومی رها نکنید — ممکن است کس دیگری تصاحبش کند.
  2. ثبت‌نام را ببندید. تنظیمات مدیریت ← نقش پیش‌فرض کاربران تازه را روی «در انتظار» بگذارید یا ثبت‌نام را غیرفعال کنید.
  3. یک اتصال اضافه کنید. تنظیمات ← اتصال‌ها ← آدرس پایه‌ی API و یک کلید را بچسبانید. مدل‌های آن سرویس‌دهنده در انتخابگر مدل ظاهر می‌شوند.

افزودن مدل‌های محلی

Ollama را روی میزبان نصب کنید (راهنمای ما)، یک مدل کوچک بگیرید و Open WebUI را طوری اجرا کنید که به آن دسترسی داشته باشد:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

ولوم چت‌هایتان را در ری‌استارت نگه می‌دارد. روی CPU چند توکن در ثانیه انتظار داشته باشید — برای خلاصه‌ها و یادداشت‌های خصوصی خوب، برای متن‌های طولانی کند. برای استنتاج محلی سنگین‌تر، VPS برای Ollama را ببینید.

ارزش دانستن دارد

محدودیت‌ها و ارتقای پلن‌ها در مستندات پلن‌ها آمده است.

آماده استقرار؟ با رمزارز بپرداز، بدون KYC — در حدود یک دقیقه فعال می‌شود.

← همین حالا مستقر کن

سؤالات متداول

Open WebUI چقدر رم لازم دارد؟

خود Open WebUI با حدود ۱ گیگابایت اجرا می‌شود. اگر فقط با APIهای راه دور صحبت کند، پلن ۲ گیگابایتی کافی است. حافظه را مدل‌های محلی از طریق Ollama می‌خواهند — ۴ گیگابایت برای مدل‌های کوچک 3B و ۶ گیگابایت یا بیشتر برای مدل‌های 7 تا 8B.

می‌توانم مدل‌های محلی را روی VPS بدون GPU اجرا کنم؟

بله، با انتظارات واقع‌بینانه. مدل‌های کوچکِ کوانتیزه‌شده روی CPU با سرعت چند توکن در ثانیه جواب می‌دهند. برای کارهای کوتاه و آزمایش‌های خصوصی خوب است، نه برای چت سریع با پاسخ‌های طولانی.

می‌توانم روی پلن NAT از آن استفاده کنم؟

بله، از طریق تونل SSH روی پورت SSH شخصی‌تان. برای آدرس HTTPS عمومی که تیمتان در مرورگر باز کند، به پلن IP اختصاصی نیاز دارید.

چه کسی می‌تواند حساب بسازد؟

اولین حسابی که ثبت‌نام کند مدیر می‌شود. بعد از آن، ثبت‌نام‌های تازه را در حالت انتظار بگذارید یا در تنظیمات مدیریت غیرفعالشان کنید، وگرنه هر کسی که آدرس را پیدا کند می‌تواند حساب بسازد.

گفتگوهایم کجا ذخیره می‌شوند؟

در یک ولوم Docker روی سرور شما. هیچ چیز به طرف سوم نمی‌رود، جز پرامپت‌هایی که به API مدلِ متصل‌شده می‌فرستید.

نظرات

هنوز نظری نیست. اولین نفر باشید.

یک نظر بگذارید

نظرات پیش از نمایش بررسی می‌شوند.