−25%

untuk Windows tahunan, hingga 31 Okt. Lihat paket

EQVPS
Mulai

VPS untuk Open WebUI: antarmuka obrolan privat untuk LLM

Hosting Open WebUI di VPS sebagai antarmuka obrolan privat untuk API apa pun yang kompatibel OpenAI atau model Ollama lokal: Docker, akses aman, dan pemilihan ukuran.

Anda memakai tiga penyedia model yang berbeda, masing-masing dengan jendela obrolan, langganan, dan riwayatnya sendiri. Open WebUI menyatukan semuanya di balik satu antarmuka yang Anda hosting sendiri: pilih model untuk setiap percakapan, simpan seluruh riwayat di server Anda, bagikan ke tim, dan sambungkan model lokal saat tidak boleh ada data yang keluar dari mesin.

Dua cara menjalankannya

Sebagai antarmuka untuk API. Open WebUI terhubung ke API apa pun yang kompatibel OpenAI — penyedia yang di-hosting, proxy LiteLLM, atau endpoint milik Anda. Server hampir tidak bekerja; paket kecil lebih dari cukup.

Dengan model lokal. Tambahkan Ollama di server yang sama dan jalankan model open-weight secara lokal. Kini RAM menjadi batasannya, dan inferensi di CPU lambat. Kompromi yang jujur: privasi penuh, kecepatan sedang.

PenyiapanPaket
Antarmuka API, pemakaian pribadiMicro — 1 vCPU, 2 GB, $5/bulan (terowongan SSH)
Antarmuka API, akses tim lewat HTTPSMicro-IP — 1 vCPU, 2 GB, $10/bulan
Model lokal 3B lewat OllamaAI-Agent — 2 vCPU, 4 GB, $10/bulan
Model lokal 7–8BMedium — 4 vCPU, 6 GB, $12/bulan, atau paket Pro untuk yang lebih besar

Instalasi dengan Docker

Di server dengan Docker terinstal:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

Mengikat ke 127.0.0.1 menjauhkannya dari internet publik sampai Anda memutuskan cara membukanya. Obrolan, pengguna, dan pengaturan tersimpan di volume open-webui.

Mengakses dengan aman

Terowongan SSH — berfungsi di semua paket, termasuk NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

Buka http://localhost:3000. Di paket NAT, pakai port SSH pribadi Anda.

HTTPS di domain Anda — untuk tim di paket IP dedicated. Arahkan subdomain ke server (panduan) lalu proxy dengan nginx, termasuk header WebSocket:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

Lalu jalankan certbot --nginx -d chat.example.com. Timeout baca yang panjang itu penting: model yang lambat men-stream jawaban selama bermenit-menit.

Langkah pertama di dalam

  1. Segera mendaftar. Akun pertama menjadi admin. Jangan biarkan instalasi baru terbuka untuk umum — orang lain bisa mengklaimnya.
  2. Tutup pendaftaran. Pengaturan admin → atur peran default pengguna baru menjadi tertunda, atau nonaktifkan pendaftaran.
  3. Tambahkan koneksi. Pengaturan → Koneksi → tempel URL dasar API dan kuncinya. Model dari penyedia itu muncul di pemilih model.

Menambahkan model lokal

Instal Ollama di host (panduan kami), tarik model kecil, dan jalankan Open WebUI supaya bisa menjangkaunya:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

Volume menyimpan obrolan Anda saat restart. Harapkan beberapa token per detik di CPU — cukup untuk ringkasan dan catatan privat, lambat untuk tulisan panjang. Untuk inferensi lokal yang lebih berat, lihat VPS untuk Ollama.

Perlu diketahui

Batas paket dan upgrade ada di dokumentasi paket.

Siap deploy? Bayar dengan kripto, tanpa KYC — online dalam sekitar satu menit.

Deploy →

Pertanyaan umum

Berapa RAM yang dibutuhkan Open WebUI?

Open WebUI sendiri berjalan dengan sekitar 1 GB. Kalau hanya berbicara dengan API jarak jauh, paket 2 GB sudah cukup. Yang butuh memori adalah model lokal lewat Ollama — 4 GB untuk model kecil 3B, 6 GB atau lebih untuk model 7–8B.

Bisakah saya menjalankan model lokal di VPS tanpa GPU?

Bisa, dengan harapan yang realistis. Model kecil yang terkuantisasi menjawab di CPU dengan kecepatan beberapa token per detik. Itu cocok untuk tugas singkat dan eksperimen privat, bukan obrolan gesit dengan jawaban panjang.

Bisakah dipakai di paket NAT?

Bisa, lewat terowongan SSH di port SSH pribadi Anda. Untuk alamat HTTPS publik yang dibuka tim Anda di browser, Anda butuh paket IP dedicated.

Siapa yang bisa membuat akun?

Akun pertama yang mendaftar menjadi admin. Setelah itu, atur pendaftaran baru menjadi tertunda atau matikan di pengaturan admin, kalau tidak siapa pun yang menemukan URL bisa membuat akun.

Di mana percakapan saya disimpan?

Di volume Docker di server Anda. Tidak ada yang dikirim ke pihak ketiga, kecuali prompt yang Anda kirim ke API model yang Anda hubungkan.

Komentar

Belum ada komentar. Jadilah yang pertama.

Tinggalkan komentar

Komentar dimoderasi sebelum muncul.