คุณใช้ผู้ให้บริการโมเดลสามเจ้า แต่ละเจ้ามีหน้าแชต สมาชิก และประวัติของตัวเอง Open WebUI รวมทั้งหมดไว้หลังหน้าจอเดียวที่คุณโฮสต์เอง: เลือกโมเดลต่อบทสนทนา เก็บประวัติทั้งหมดบนเซิร์ฟเวอร์ของคุณ แชร์กับทีม และเสียบโมเดลในเครื่องเมื่อไม่อยากให้อะไรออกจากเครื่องเลย
สองวิธีในการรัน
เป็นหน้าจอสำหรับ API Open WebUI เชื่อมกับ API ใดก็ได้ที่เข้ากันได้กับ OpenAI — ผู้ให้บริการแบบโฮสต์ LiteLLM proxy หรือ endpoint ของคุณเอง เซิร์ฟเวอร์แทบไม่ต้องทำอะไร แพ็กเกจเล็กก็เหลือเฟือ
ใช้กับโมเดลในเครื่อง เพิ่ม Ollama บนเซิร์ฟเวอร์เดียวกันแล้วรันโมเดลแบบ open-weight ในเครื่อง คราวนี้ RAM คือข้อจำกัด และการประมวลผลบน CPU ช้า ข้อแลกเปลี่ยนตรงๆ: ความเป็นส่วนตัวเต็มที่ ความเร็วปานกลาง
| การตั้งค่า | แพ็กเกจ |
|---|---|
| หน้าจอ API ใช้ส่วนตัว | Micro — 1 vCPU, 2 GB, $5/เดือน (SSH tunnel) |
| หน้าจอ API ทีมเข้าผ่าน HTTPS | Micro-IP — 1 vCPU, 2 GB, $10/เดือน |
| โมเดล 3B ในเครื่องผ่าน Ollama | AI-Agent — 2 vCPU, 4 GB, $10/เดือน |
| โมเดล 7–8B ในเครื่อง | Medium — 4 vCPU, 6 GB, $12/เดือน หรือแพ็กเกจ Pro สำหรับตัวที่ใหญ่กว่า |
ติดตั้งด้วย Docker
บนเซิร์ฟเวอร์ที่ติดตั้ง Docker แล้ว:
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 \
-v open-webui:/app/backend/data \
ghcr.io/open-webui/open-webui:main
การผูกกับ 127.0.0.1 ทำให้มันอยู่นอกอินเทอร์เน็ตสาธารณะจนกว่าคุณจะตัดสินใจว่าจะเปิดอย่างไร แชต ผู้ใช้ และการตั้งค่าอยู่ใน volume open-webui
เข้าถึงอย่างปลอดภัย
SSH tunnel — ใช้ได้ทุกแพ็กเกจ รวมถึง NAT:
ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10
เปิด http://localhost:3000 บนแพ็กเกจ NAT ให้ใช้พอร์ต SSH ส่วนตัวของคุณ
HTTPS บนโดเมนของคุณ — สำหรับทีมบนแพ็กเกจ IP เฉพาะ ชี้ซับโดเมนมาที่เซิร์ฟเวอร์ (คู่มือ) แล้วทำ proxy ด้วย nginx พร้อมเฮดเดอร์ WebSocket:
location / {
proxy_pass http://127.0.0.1:3000;
proxy_set_header Host $host;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
proxy_read_timeout 300s;
}
จากนั้นรัน certbot --nginx -d chat.example.com ค่า read timeout ที่ยาวมีความสำคัญ: โมเดลที่ช้าจะสตรีมคำตอบเป็นนาที
ก้าวแรกข้างใน
- ลงทะเบียนทันที บัญชีแรกจะเป็นแอดมิน อย่าปล่อยการติดตั้งใหม่ไว้แบบสาธารณะ — คนอื่นอาจยึดไปก่อน
- ปิดการลงทะเบียน การตั้งค่าแอดมิน → ตั้งบทบาทเริ่มต้นของผู้ใช้ใหม่เป็นรออนุมัติ หรือปิดการลงทะเบียน
- เพิ่มการเชื่อมต่อ การตั้งค่า → การเชื่อมต่อ → วาง base URL ของ API และคีย์ โมเดลของผู้ให้บริการนั้นจะโผล่ในตัวเลือกโมเดล
เพิ่มโมเดลในเครื่อง
ติดตั้ง Ollama บนโฮสต์ (คู่มือของเรา) ดึงโมเดลเล็กมาหนึ่งตัว แล้วสตาร์ต Open WebUI ให้เข้าถึงได้:
ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main
volume จะเก็บแชตของคุณไว้ข้ามการรีสตาร์ต คาดหวังไม่กี่โทเคนต่อวินาทีบน CPU — พอสำหรับสรุปความและโน้ตส่วนตัว แต่ช้าสำหรับเรียงความยาว ถ้าต้องการประมวลผลในเครื่องที่หนักกว่านี้ ดู VPS สำหรับ Ollama
ควรรู้ไว้
- อัปเดตบ่อย
docker pull ghcr.io/open-webui/open-webui:mainแล้วสร้างคอนเทนเนอร์ใหม่ สำรอง volume ก่อน - ค่า API เป็นของคุณ โดยค่าเริ่มต้น Open WebUI ไม่จำกัดการใช้งานต่อผู้ใช้ ถ้าแชร์กับทีมให้คอยดูค่าใช้จ่าย
- นี่คือแอปแชต ไม่ใช่โมเดล คุณภาพคำตอบขึ้นกับโมเดลที่อยู่เบื้องหลังทั้งหมด
ขีดจำกัดและการอัปเกรดแพ็กเกจอยู่ในเอกสารแพ็กเกจ
ความคิดเห็น
ยังไม่มีความคิดเห็น เป็นคนแรกสิ