모델 제공사를 세 군데 쓰고 있고, 곳마다 채팅 창, 구독, 기록이 따로 있습니다. Open WebUI는 이들을 내가 호스팅하는 하나의 화면 뒤로 모아 줍니다. 대화마다 모델을 고르고, 기록은 전부 내 서버에 두고, 팀과 공유하고, 아무것도 밖으로 나가면 안 될 때는 로컬 모델을 연결하면 됩니다.
두 가지 사용 방식
API의 프런트엔드로. Open WebUI는 OpenAI 호환 API라면 무엇이든 연결됩니다. 호스팅형 제공사, LiteLLM 프록시, 자체 엔드포인트 등. 서버는 거의 일을 하지 않으니 작은 요금제로 넉넉합니다.
로컬 모델과 함께. 같은 서버에 Ollama를 올리고 오픈 웨이트 모델을 로컬에서 돌립니다. 이제 메모리가 제약이 되고, CPU 추론은 느립니다. 솔직한 맞교환은 완전한 프라이버시와 무난한 속도입니다.
| 구성 | 요금제 |
|---|---|
| API 프런트엔드, 개인용 | Micro — 1 vCPU, 2 GB, 월 $5 (SSH 터널) |
| API 프런트엔드, 팀이 HTTPS로 접속 | Micro-IP — 1 vCPU, 2 GB, 월 $10 |
| Ollama로 로컬 3B 모델 | AI-Agent — 2 vCPU, 4 GB, 월 $10 |
| 로컬 7~8B 모델 | Medium — 4 vCPU, 6 GB, 월 $12, 더 큰 모델은 Pro 요금제 |
Docker로 설치하기
Docker가 설치된 서버에서:
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 \
-v open-webui:/app/backend/data \
ghcr.io/open-webui/open-webui:main
127.0.0.1에 바인딩하면 공개 방식을 정할 때까지 공용 인터넷에서 보이지 않습니다. 채팅, 사용자, 설정은 open-webui 볼륨에 저장됩니다.
안전하게 접속하기
SSH 터널 — NAT를 포함한 모든 요금제에서 됩니다.
ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10
http://localhost:3000을 여세요. NAT 요금제라면 개인 SSH 포트를 쓰세요.
내 도메인에서 HTTPS — 전용 IP 요금제에서 팀이 쓰는 경우. 서브도메인을 서버로 연결하고(가이드), WebSocket 헤더까지 포함해 nginx로 프록시합니다.
location / {
proxy_pass http://127.0.0.1:3000;
proxy_set_header Host $host;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
proxy_read_timeout 300s;
}
그다음 certbot --nginx -d chat.example.com을 실행하세요. 읽기 타임아웃을 길게 잡는 데는 이유가 있습니다. 느린 모델은 답을 몇 분씩 스트리밍합니다.
들어가서 처음 할 일
- 바로 가입하세요. 첫 계정이 관리자가 됩니다. 막 설치한 상태로 공개해 두지 마세요. 다른 사람이 가로챌 수 있습니다.
- 가입을 닫으세요. 관리자 설정 → 신규 사용자의 기본 역할을 승인 대기로 두거나, 가입을 끄세요.
- 연결을 추가하세요. 설정 → 연결 → API 기본 URL과 키를 붙여 넣으세요. 해당 제공사의 모델이 모델 선택기에 나타납니다.
로컬 모델 추가하기
호스트에 Ollama를 설치하고(가이드), 작은 모델을 받은 뒤, Open WebUI가 거기에 닿도록 실행합니다.
ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main
볼륨 덕분에 재시작해도 채팅은 남습니다. CPU에서는 초당 몇 토큰 정도로 생각하세요. 요약이나 개인 메모에는 괜찮지만 긴 글에는 느립니다. 더 무거운 로컬 추론은 Ollama용 VPS를 보세요.
알아 둘 것
- 업데이트가 잦습니다.
docker pull ghcr.io/open-webui/open-webui:main후 컨테이너를 다시 만드세요. 먼저 볼륨을 백업하세요. - API 비용은 내 몫입니다. Open WebUI는 기본적으로 사용자별 사용량을 제한하지 않습니다. 팀과 공유한다면 지출을 지켜보세요.
- 이건 채팅 앱이지 모델이 아닙니다. 답의 품질은 뒤에 있는 모델에 전적으로 달려 있습니다.
요금제 한도와 업그레이드는 요금제 문서에 있습니다.
댓글
아직 댓글이 없습니다. 첫 번째가 되세요.